
Mercury 2.5、毎秒1,107トークンで100万トークン4セント
電話エージェントのスタートアップは、Mercuryによって最悪時の応答が数分から1秒に縮んだと述べています。Inception Labsの新しい拡散モデルは、その種の数字を軸に設計されています。
Seung Jung·
5分
電話エージェントのスタートアップは、Mercuryによって最悪時の応答が数分から1秒に縮んだと述べています。Inception Labsの新しい拡散モデルは、その種の数字を軸に設計されています。

反トラスト当局が、AI業界で買収に取って代わった取引スキームを初めて本格的に調べ始めました。エヌビディアは司法省から正式な資料提出要求を受けています。

DeepSeek V4.1 Flashが763GBではなく567GBのGPUメモリで済むのは、1960億の重みがシステムRAM上で動くよう設計されているからだ。

AIが書いたカーネルがOpenAIの専門家による実装を最大1.8倍上回った。JalapeñoのInferenceXベンチマーク結果が初公開された。