inference 7
- 텍스트를 쓰지 않고 고르기만 하는 모델, Strands Decider 2B가 에이전트에서 맡는 역할
- DeepSeek의 KV 캐시 압축과 서구 연구소의 캐시 가격 인하, 우연인가 채택인가
- Unreal Agent의 비용 절감, 도구를 기다리는 일을 모델 밖으로 옮긴다
- 지능이 싸질 때 바뀌는 소프트웨어, 토큰 가격과 작업 비용부터 구분하기
- Jev가 다시 꺼낸 빠른 구조화 출력, 모델보다 추론 방식의 차이일까
- GLM의 추론 인프라를 바꾼 촘촘한 피드백
- 같은 모델 이름이 같은 동작을 보장하지 않는다 - OpenRouter의 제공업체별 실행 계약