AI Newsway

OpenAI 的 Astra for Law 不是新模型,而是一套 2.3 億網址的法律檢索索引

搭配專屬法律語料的 GPT-6 Astra 組態,把 Vals AI 法律研究基準的正確率從 38.7% 拉到 54%,同時推出 26 款夥伴外掛與鎖定 Am Law 200 的使用計畫

|5分鐘閱讀0
OpenAI's Astra for Law replaces open web search with a curated corpus of US case law, statutes and regulations spanning more than 230 million URLs
OpenAI's Astra for Law replaces open web search with a curated corpus of US case law, statutes and regulations spanning more than 230 million URLs

OpenAI 於 9 月 17 日推出 Astra for Law,鎖定律師事務所與法律科技業者,本質是把 GPT-6 Astra 模型針對法律工作做出的組態。該公司在Astra for Law 發布說明中講得很明白:沒有訓練任何新模型。真正交付的,是一套涵蓋逾 2.3 億個網址的法律檢索索引、領域專屬指令、回應設定,以及包覆既有前沿模型的工具。

重點摘要

  • 在 Vals AI 法律研究基準的非公開驗證集 200 道題目上,Astra for Law 的整體正確率為 54%,使用一般網路搜尋的 GPT-6 Astra 則為 38.7%,差距 15.3 個百分點,相對提升 40%。
  • 法律檢索索引涵蓋美國判例法、成文法、法規、法院規則與行政決定,並取用非營利組織 Free Law Project 的 CourtListener。
  • 使用管道為鎖定 Am Law 200 事務所的 Trusted Access 計畫,API 不保留資料,ChatGPT Enterprise 的使用內容也不納入人工審閱。

基準數字實際說明了什麼

這次比較是同一個模型的自我對照。在雙方都採最高推理強度的條件下,接上法律索引的組態在 54% 的題目通過正確性檢核,改用一般網路搜尋的同一模型則為 38.7%。在判例題目上,它多找出 24% 的參考判例,並在相同推理強度下從正確判決書中多擷取最多 54% 的相關段落,回答長度平均也長了約一倍。

這個框架既有用,侷限也同樣清楚。它把有依據的檢索增強相對於開放式網路搜尋的價值單獨拆出來衡量,這是誠實的做法;但它沒有回答 Astra for Law 在同一套基準上與 Harvey、Legora 或 CoCounsel 相比如何,而 54% 的正確率也意味著大約每兩則研究回答就有一則未達評估標準。

索引為何就是產品本身

OpenAI 在 6 月延攬的 Ironclad 共同創辦人 Jason Boehmig 現負責法律產品線,他在LawSites 報導的媒體說明會上表示,這是模型組態而非新模型,核心在於法律書寫的領域指令、回應長度之類的控制項,以及公司預期會持續擴充的法律專用工具。主導該產品的工程師 Sherwin Wu 現場示範了三件事:替面臨身心障礙歧視訴訟的醫院撰寫駁回聲請、處理股東對倉促資產出售的異議,以及一樁銷售承諾爭議。

戰略重點在於,事務所與業者不必再自行建置與維護底層法律語料。這一刀直接切進法律 AI 新創長期賴以區隔的那一層,而且這些新創同時成了客戶:Harvey 與 Legora 都被列為 API 客戶,而這項產品正把它們的檢索層變成平台的內建元件。

外掛、夥伴,以及在其上開發的事務所

OpenAI 在發布時一併推出 26 款夥伴外掛,來自 Thomson Reuters、Harvey、Legora 與 iManage 等業者,另有法律工程師開發的 9 款社群外掛,以及 47 項公司表示是由法律重度使用者而非 OpenAI 自行打造的自訂技能。ChatGPT for Word 也正式上線,讓校對與修改建議直接出現在法律文件實際成形的地方。

已有多家事務所在 OpenAI 工程師駐點協助下,於 ChatGPT Enterprise 上開發自家系統。Sullivan & Cromwell 打造了以自身談判準則與先例為基礎的合約分析工具;Ropes & Gray 依律師處理資料室的方式建置併購盡職調查工具;Cooley 則做出用於 IPO 準備的資本市場系統。Latham & Watkins 正與 OpenAI 合作處理資訊權限、利益衝突隔離與事務所監督機制。

把外掛名單和基準數字放在一起讀,就看得出 OpenAI 認為剩下的價值在哪裡。檢索被收進平台成為通用能力,案件脈絡、文件管理與計費串接則留給夥伴。過去靠更好的法律語料建立差異的業者,現在得把差異搬到模型供應商還沒站上去的位置。

事務所真正會去談的條款

被問到不保留資料的承諾是否有例外時,Boehmig 說那一句話是一份約 30 頁使用協議的濃縮版本,實際情況比那句話複雜,但仍能滿足需求。對評估此案的法務長而言,這個回答才是重點:專業責任義務綁在合約上,不在行銷頁面上。事務所不能拿產品頁面來履行保密義務,而排除條款就藏在那 30 頁裡。

競爭背景是Anthropic先前推動的 Claude for Legal,而這套模式現在已相當熟悉:拿一個前沿模型,加上精選語料與領域指令,再當成垂直產品賣。OpenAI 在金融領域也走過同一步,當時它推出了 ChatGPT 的華爾街版組態。接下來幾個垂直領域預料會用同樣方式登場,因為昂貴的部分已經不是模型了。

常見問題

Astra for Law 是 OpenAI 的新模型嗎?

不是。OpenAI 表示它是 GPT-6 Astra 的一種組態,把既有模型與專屬法律檢索索引、領域指令及法律工具結合起來。Boehmig 在媒體說明會上明確做出這項區分。

現在誰可以使用 Astra for Law?

它將提供給包含 Harvey 與 Legora 在內的 API 客戶,並透過鎖定 Am Law 200 的 Trusted Access 計畫開放給部分事務所,這些事務所可在 ChatGPT 與 Codex 的模型選單中看到它。個別執業律師目前無法一般性取得。

法律檢索索引的資料從哪裡來?

語料涵蓋逾 2.3 億個網址的美國判例法、成文法、法規、法院規則與行政決定,並持續增加新來源。OpenAI 表示其中取用了非營利組織 Free Law Project 維護的研究資料庫 CourtListener。

對這篇文章有什麼感想?

SJ
載入中...

相關文章

OpenAI同日推出Data智慧體與華爾街版ChatGPT
LLM & Chatbots

OpenAI同日推出Data智慧體與華爾街版ChatGPT

OpenAI在同一個星期四釋出了面向ChatGPT Work的Data智慧體,以及與Morgan Stanley、Evercore共建的ChatGPT for Financial Services。

Seung Jung8 天前
GPT-6 Astra上崗:OpenAI最貴模型把全部籌碼押在電腦操作上
LLM & Chatbots

GPT-6 Astra上崗:OpenAI最貴模型把全部籌碼押在電腦操作上

OpenAI的GPT-6 Astra面向企業使用者開放,具備電腦操作能力、百萬token上下文和10/50美元定價,其頭條成績則附帶測試框架的註腳。

Seung Jung8 天前
ChatGPT Images 2.5生成延遲減半,新增手繪畫布
LLM & Chatbots

ChatGPT Images 2.5生成延遲減半,新增手繪畫布

OpenAI推出ChatGPT Images 2.5,延遲最多降低50%,新增Sketch繪圖畫布、模板、定點批註,並向API釋出兩款新模型。

Seung Jung7 天前
ChatGPT 在 79% 的購物回答中直接點名首選,Gemini 只有 7%
LLM & Chatbots

ChatGPT 在 79% 的購物回答中直接點名首選,Gemini 只有 7%

一份針對 1,536 則 AI 購物回答的稽核發現,ChatGPT 有 79% 以第一人稱表態偏好,Gemini 僅 7%,兩者引用的來源也幾乎不重疊。

Seung Jung昨天
iOS 27 程式碼顯示:Siri 伺服器模型可換成 Claude 或 GPT-5.6
LLM & Chatbots

iOS 27 程式碼顯示:Siri 伺服器模型可換成 Claude 或 GPT-5.6

iOS 27 與 macOS 27 Golden Gate 的私有框架中出現 Model Delegation API 與 Inference Provider 協定,可把 Siri 的規劃器交給 Claude 接手。

Seung Jung前天
Claude只對成年人開放,而它的年齡識別正在誤封成年使用者
LLM & Chatbots

Claude只對成年人開放,而它的年齡識別正在誤封成年使用者

Anthropic公開了Claude執行18歲以上政策的具體機制:分類器會停用疑似未成年人的賬號,被誤判的成年使用者可通過Yoti驗證恢復訪問。

Seung Jung7 天前