
Mercury 2.5, 초당 1,107토큰에 100만 토큰당 4센트로 나왔다
전화 에이전트 스타트업은 Mercury가 최악의 응답 시간을 수 분에서 1초로 줄였다고 밝혔다. Inception Labs의 새 디퓨전 모델은 그런 숫자를 겨냥해 만들어졌다.
Seung Jung·
5분
전화 에이전트 스타트업은 Mercury가 최악의 응답 시간을 수 분에서 1초로 줄였다고 밝혔다. Inception Labs의 새 디퓨전 모델은 그런 숫자를 겨냥해 만들어졌다.

arXiv 연구에서 LLM 수리 루프의 정상 코드 손상률은 0.261, 버그 코드 수리율은 0.023으로 나왔다. 연구진은 이를 몰고 가는 내부 방향까지 찾아냈다.

GitHub의 프로젝트 하이드라퓨전은 Copilot 코딩 요청마다 다중 모델 실행 계획을 짠다. 단일 모델의 단순함을 내주고 비용을 크게 낮췄다.

OpenAI는 연구 조직에서 사람의 하루 근무당 에이전트가 3.1일치 작업을 돌린다고 밝혔다. 다만 오래 걸린 성공 작업은 대부분 사람의 개입이 필요했다.

Cognition은 SWE-2가 FrontierCode 1.1 Main에서 50.0%로 Fable 5.1에 1점 뒤지면서 비용은 64% 낮다고 밝혔다. 베이스는 중국산 오픈 모델이다.

투자자들은 5월의 두 배 값에 Cognition에 투자했다. 이 회사는 넉 달 전 매각된 경쟁사 규모의 절반에도 못 미친다. 기울기에 건 베팅이다.