Astra for Law de OpenAI no es un modelo nuevo: es un índice de búsqueda de 230 millones de URL

Una configuración de GPT-6 Astra con un corpus jurídico propio elevó la precisión en el Legal Research Bench de Vals AI del 38,7% al 54%, y llega con 26 complementos de socios y un programa de acceso para firmas del Am Law 200

|5 min de lectura0
OpenAI's Astra for Law replaces open web search with a curated corpus of US case law, statutes and regulations spanning more than 230 million URLs
OpenAI's Astra for Law replaces open web search with a curated corpus of US case law, statutes and regulations spanning more than 230 million URLs

OpenAI presentó el 17 de septiembre Astra for Law, una configuración de su modelo GPT-6 Astra dirigida a despachos de abogados y proveedores de tecnología jurídica. La compañía fue explícita en el anuncio de Astra for Law: no entrenó ningún modelo nuevo. Lo que llega al mercado es un índice de búsqueda jurídica con más de 230 millones de URL, instrucciones específicas del dominio, ajustes de respuesta y herramientas montadas alrededor del modelo de frontera que ya existía.

Claves del anuncio

  • En 200 preguntas del conjunto privado de validación del Legal Research Bench de Vals AI, Astra for Law superó la verificación general de precisión en el 54% de los casos, frente al 38,7% de GPT-6 Astra con búsqueda web genérica: 15,3 puntos, o una mejora relativa del 40%.
  • El índice de búsqueda jurídica cubre jurisprudencia, leyes, reglamentos, reglas procesales y decisiones administrativas de Estados Unidos, y se apoya en CourtListener, del proyecto sin ánimo de lucro Free Law Project.
  • El acceso se canaliza por un programa Trusted Access orientado a las firmas del Am Law 200, sin retención de datos en la API y con el uso en ChatGPT Enterprise excluido de la revisión humana.

Qué muestran realmente las cifras del benchmark

La comparación central enfrenta una configuración consigo misma. Con el máximo esfuerzo de razonamiento en ambos sistemas, el montaje con índice jurídico pasó la verificación de precisión en el 54% de las preguntas frente al 38,7% del mismo modelo usando búsqueda web ordinaria. En preguntas de jurisprudencia localizó un 24% más de casos de referencia y recuperó hasta un 54% más de pasajes relevantes de las sentencias correctas con el mismo esfuerzo de razonamiento. Las respuestas también resultaron, de media, alrededor del doble de largas.

El planteamiento es útil y limitado a la vez. Aísla el valor de la recuperación fundamentada frente a la búsqueda web abierta, que es lo honesto de medir. No dice nada sobre cómo se compara Astra for Law con Harvey, Legora o CoCounsel en el mismo benchmark, y una precisión del 54% sigue significando que aproximadamente una de cada dos respuestas de investigación no cumplió los criterios de evaluación.

Por qué el producto es el índice

Jason Boehmig, cofundador de Ironclad que OpenAI fichó en junio para dirigir sus productos jurídicos, explicó en una sesión con periodistas recogida por LawSites que se trata de una configuración del modelo y no de un modelo nuevo: instrucciones de dominio para la redacción jurídica, controles como la extensión de la respuesta y herramientas específicas que la compañía prevé ampliar. Sherwin Wu, el ingeniero al frente del producto, mostró la redacción de una moción de desestimación para un hospital demandado por discriminación por discapacidad, una impugnación de accionistas contra una venta de activos precipitada y una disputa sobre un compromiso de venta.

El punto estratégico es que despachos y proveedores ya no tienen que construir ni mantener por su cuenta el corpus jurídico de base. Es un movimiento directo sobre la capa en la que se venían diferenciando las startups de IA legal, y llega justo cuando esas mismas startups se convierten en clientes: Harvey y Legora figuran como clientes de la API del producto que ahora ofrece su capa de recuperación como pieza básica de plataforma.

Complementos, socios y los despachos que construyen encima

OpenAI acompañó el lanzamiento con 26 complementos de socios como Thomson Reuters, Harvey, Legora e iManage, nueve complementos comunitarios creados por ingenieros del sector legal y 47 habilidades personalizadas que, según la empresa, desarrollaron usuarios avanzados del ámbito jurídico y no OpenAI. ChatGPT for Word también alcanzó disponibilidad general, con corrección y sugerencias de edición dentro del documento donde realmente se redacta.

Varios despachos ya han construido sobre ChatGPT Enterprise con ingenieros de OpenAI trabajando en sus oficinas. Sullivan & Cromwell creó un analizador de contratos apoyado en sus propios manuales de negociación y precedentes; Ropes & Gray levantó herramientas de diligencia debida en fusiones y adquisiciones adaptadas a cómo sus abogados recorren un data room; Cooley desarrolló un sistema de mercados de capitales para preparar salidas a bolsa. Latham & Watkins trabaja con OpenAI en permisos de información, murallas éticas y supervisión interna.

Leído junto al benchmark, el catálogo de complementos indica dónde cree OpenAI que queda el valor. La recuperación se convierte en una función estándar de la plataforma, mientras que el contexto del asunto, la gestión documental y la integración con la facturación quedan para los socios. Los proveedores que basaron su diferencia en tener el mejor corpus jurídico tendrán que trasladarla a un terreno que el fabricante del modelo no ocupe.

La parte que los despachos van a negociar de verdad

Preguntado por si la promesa de no retener datos admite excepciones, Boehmig respondió que esa frase resume un acuerdo de acceso de unas 30 páginas, y que el asunto es más complicado de lo que sugiere la frase aunque cubre la necesidad. Para un director jurídico que evalúe el producto, esa respuesta es la noticia: las obligaciones de responsabilidad profesional se anclan en el contrato, no en la página de marketing. Un despacho no cumple su deber de confidencialidad citando una ficha de producto, y las excepciones viven en esas treinta páginas.

El telón de fondo competitivo es la apuesta previa de Anthropic con Claude for Legal, y el patrón ya resulta familiar: tomar un modelo de frontera, añadirle un corpus curado e instrucciones de dominio y venderlo como producto vertical. OpenAI hizo la misma jugada en finanzas cuando lanzó una configuración de ChatGPT para Wall Street. Cabe esperar que los próximos sectores lleguen igual, porque lo caro ya no es el modelo.

Preguntas frecuentes

¿Astra for Law es un modelo nuevo de OpenAI?

No. OpenAI lo describe como una configuración de GPT-6 Astra que combina el modelo existente con un índice de búsqueda jurídica propio, instrucciones específicas del dominio y herramientas legales. Boehmig marcó esa distinción de forma explícita en la sesión con la prensa.

¿Quién puede usar Astra for Law ahora mismo?

Llegará a clientes de la API como Harvey y Legora, y se ofrece a despachos seleccionados mediante un programa Trusted Access dirigido a firmas del Am Law 200, donde aparece en el selector de modelos de ChatGPT y Codex. No está disponible de forma general para abogados individuales.

¿De dónde sale el índice de búsqueda jurídica?

El corpus abarca más de 230 millones de URL de jurisprudencia, leyes, reglamentos, reglas procesales y decisiones administrativas de Estados Unidos, con nuevas fuentes que se añaden de forma continua. OpenAI afirma que se apoyó en CourtListener, la biblioteca de investigación que mantiene la organización sin ánimo de lucro Free Law Project.

¿Qué te parece este artículo?

SJ
Cargando...

Artículos relacionados

OpenAI lanza el mismo día un agente de Datos y un ChatGPT para Wall Street
LLM & Chatbots

OpenAI lanza el mismo día un agente de Datos y un ChatGPT para Wall Street

OpenAI presentó el mismo jueves un agente de Datos para ChatGPT Work y ChatGPT for Financial Services, desarrollado con Morgan Stanley y Evercore.

Seung Junghace 8 días
GPT-6 Astra se pone a trabajar: el modelo más caro de OpenAI lo apuesta todo al manejo del ordenador
LLM & Chatbots

GPT-6 Astra se pone a trabajar: el modelo más caro de OpenAI lo apuesta todo al manejo del ordenador

GPT-6 Astra llega a los clientes empresariales con manejo del ordenador, un contexto de un millón de tokens y precios de 10 y 50 dólares, con una salvedad sobre su puntuación estrella.

Seung Junghace 8 días
ChatGPT Images 2.5 reduce a la mitad la latencia y suma un lienzo de dibujo
LLM & Chatbots

ChatGPT Images 2.5 reduce a la mitad la latencia y suma un lienzo de dibujo

OpenAI lanzó ChatGPT Images 2.5 con hasta un 50% menos de latencia, un lienzo de dibujo Sketch, plantillas, comentarios anclados y dos modelos nuevos en la API.

Seung Junghace 7 días
ChatGPT elige un favorito en el 79% de sus respuestas de compra; Gemini, en el 7%
LLM & Chatbots

ChatGPT elige un favorito en el 79% de sus respuestas de compra; Gemini, en el 7%

Una auditoría de 1,536 respuestas de compra con IA halló que ChatGPT expresa una preferencia en primera persona el 79% de las veces y Gemini solo el 7%.

Seung Jungayer
El código de iOS 27 revela que el modelo de Siri puede cambiarse por Claude o GPT-5.6
LLM & Chatbots

El código de iOS 27 revela que el modelo de Siri puede cambiarse por Claude o GPT-5.6

Frameworks privados de iOS 27 y macOS 27 Golden Gate exponen una API de Model Delegation y un protocolo Inference Provider capaces de ceder el planificador de Siri a Claude.

Seung Junganteayer
Claude es solo para adultos y su detector de edad sigue bloqueando a adultos
LLM & Chatbots

Claude es solo para adultos y su detector de edad sigue bloqueando a adultos

Anthropic detalló cómo aplica la regla de +18 en Claude: clasificadores automáticos desactivan cuentas sospechosas de pertenecer a menores y Yoti gestiona la apelación.

Seung Junghace 7 días