AI Newsway
ログイン新規登録
AI & 機械学習LLM & チャットボット生産性&自動化開発者ツールSaaS & Cloudテック&ビジネスガイド&レビュー

ニュースレター購読

毎朝、主要ニュースをメールでお届けします

AI Newsway
サービス紹介お問い合わせプライバシーポリシー利用規約よくある質問

© 2026 AI Newsway. 無断転載を禁じます。

  1. ホーム
  2. /# ai-inference

#ai-inference

Mercury 2.5、毎秒1,107トークンで100万トークン4セント
LLM & チャットボット

Mercury 2.5、毎秒1,107トークンで100万トークン4セント

電話エージェントのスタートアップは、Mercuryによって最悪時の応答が数分から1秒に縮んだと述べています。Inception Labsの新しい拡散モデルは、その種の数字を軸に設計されています。

Seung Jung·4 日前
5分
エヌビディアは270億ドルを投じながら企業結合の届出を一度も行わなかった。司法省がその理由を問う
テック&ビジネス分析

エヌビディアは270億ドルを投じながら企業結合の届出を一度も行わなかった。司法省がその理由を問う

反トラスト当局が、AI業界で買収に取って代わった取引スキームを初めて本格的に調べ始めました。エヌビディアは司法省から正式な資料提出要求を受けています。

Seung Jung·5 日前
5分
200GBの問い:モデルの重みのうち、本当にGPUに置くべきものはどれか
AI & 機械学習分析

200GBの問い:モデルの重みのうち、本当にGPUに置くべきものはどれか

DeepSeek V4.1 Flashが763GBではなく567GBのGPUメモリで済むのは、1960億の重みがシステムRAM上で動くよう設計されているからだ。

Seung Jung·7 日前
5分
OpenAI「自社モデルがJalapeñoの設計を9か月に短縮した」
テック&ビジネス分析

OpenAI「自社モデルがJalapeñoの設計を9か月に短縮した」

AIが書いたカーネルがOpenAIの専門家による実装を最大1.8倍上回った。JalapeñoのInferenceXベンチマーク結果が初公開された。

Seung Jung·23 日前
4分