
Mercury 2.5 上线:每秒1,107个词元,百万词元四美分
一家电话智能体初创公司称,Mercury 把最差情况下的响应时间从数分钟压到了一秒。Inception Labs 的新扩散模型正是围绕这类数字打造的。
Seung Jung·
5分鐘
一家电话智能体初创公司称,Mercury 把最差情况下的响应时间从数分钟压到了一秒。Inception Labs 的新扩散模型正是围绕这类数字打造的。

反垄断执法者首次真正审视这种在AI领域取代了收购的交易结构:英伟达已收到司法部的正式资料索取要求。

DeepSeek V4.1 Flash只需567GB显存而非763GB,因为其中1960亿参数本就是按跑在系统内存上设计的。

AI 生成的内核比 OpenAI 专家手写版本快出最多 1.8 倍,Jalapeño 首次公布 InferenceX 基准测试结果。