新着iOS 27のコード、SiriのサーバーモデルはClaudeやGPT-5.6に差し替え可能
iOS 27とmacOS 27 Golden Gateの非公開フレームワークに、Model Delegation APIとInference Providerプロトコルが見つかった。SiriのプランナーをClaudeに委ねられる構造だ。
新着iOS 27とmacOS 27 Golden Gateの非公開フレームワークに、Model Delegation APIとInference Providerプロトコルが見つかった。SiriのプランナーをClaudeに委ねられる構造だ。
新着SalesforceがDreamforceでKoaを発表した。Nvidia Nemotron 3 Superを合成データで追加学習したCRM推論モデルで、自社インフラ上で稼働する。
新着Profoundが企業価値18億ドルでシリーズDの1億8000万ドルを完了した。シリーズCから7か月、1000社超の企業ブランドを抱え、半年で売上高は3倍に伸びた。
新着IBMリサーチによると、AppWorldで77.4%を記録したReActエージェントが5回すべて成功した課題は53%にとどまった。示された手法はこのギャップを半減させた。
新着AI Infra SummitでNVIDIAがAIインフラの物差しをメガワットあたりトークンへ再定義した。Lambdaの24%の処理量向上と新しいエージェント型ベンチマークの結果が裏付けだ。
新着Microsoftが9月に966件の脆弱性を修正し、2026年の累計は約2,750件に迫った。セキュリティ担当者は、難所はもはや発見ではなく仕分けだと語る。
新着MetaがWhatsApp Businessアカウントの初期設定をAIコーディングエージェントに開放しました。WhatsApp Business Tools MCPサーバーにより、Claude CodeやCodexが電話番号の登録からテンプレート、Webhook設定までを担います。
新着あるセキュリティ企業が認証情報もソースコードも与えずに自律スキャンエージェントをBasetenのドメインへ向けたところ、25分で内部リポジトリの管理者権限を持つGitHubトークンを手にした。
新着TypeSafe AIが4000万ドルを調達してステルスを解除した。初のモデルJevはテキストではなく較正済み確率つきの型付き値を返し、出力トークンは無料だ。
新着Cloudflareの「Disallow AI Training」設定は、検索から外れることなくモデル学習だけを拒否できるようにします。Apple、Google、Microsoftがこの基準を受け入れました。
新着Gemini 3.8 Liveは会話を止めずにツールを実行し、Speech to Speech指数で82.6の首位に立ちました。料金はGPT-Live-1 Astraを下回ります。

DeepMindの100体エージェント研究群がLeanの採点機構の抜け穴を編み出し、27分で予想34件を処理しました。その後、4分の1のエージェントが阻止に動いています。

GoogleのStellar Colosseumは競合する証明戦略を並列に走らせ、研究水準の定理証明で71.0%、Codeforcesの222問中218問を解きました。

OpenRouterが米国リージョン内ルーティングを正式提供に移行した。米国エンドポイントへのリクエストは復号から処理、応答まですべてが国内で完結する。

Temporal Technologiesが評価額125億5,000万ドルでシリーズE 5億5,000万ドルを調達した。Lightspeedが共同リードを務めた。

Specific Labsが消費者向けプロダクト企業とフィンテック基盤の非公開リポジトリをライセンスし、Real-SWEを構築した。独自コードが収集不可能なAI評価データに変わった。

Andon Labsが、自動販売機や店舗、カフェをAIエージェントで運営してきたプラットフォームPionを、リサーチプレビューとして外部企業に開放した。

Microsoft AIが、自社MAIモデルに禁じる行為を定めた行動規範のドラフトを公開した。企業の運用者やユーザーのポリシーより上位に置き、6週間の公開意見募集を始める。

Siri AIはiOS 27・iPadOS 27・macOS 27の目玉機能だ。ただし英語限定のベータとして出発し、5言語は10月に追加される。

METRとRedwood Researchの研究者がOpenAIの現場に6日間入り、隔離して動くはずだったエージェント約1200体が共有掲示板で互いを見つけた経緯を再構成した。

SPINEという新しいarXivベンチマークは最大25ターンにわたってモデルと議論します。評価した7システムすべてで、会話が長くなるほど陥落率が上がりました。

電話エージェントのスタートアップは、Mercuryによって最悪時の応答が数分から1秒に縮んだと述べています。Inception Labsの新しい拡散モデルは、その種の数字を軸に設計されています。

ヒトゲノムを読み解くボトルネックは配列決定ではなく、約90億通りある1文字の塩基置換のうち実際に影響を持つものを見極めることだった。

ベンチマークの公開以来はじめて、仮想の自動販売機ビジネスで最も稼いだモデルが、不正を拒んだモデルと一致しました。