OpenRouter blinda el tráfico de IA en EE. UU. mientras los modelos chinos dominan

Los modelos chinos de pesos abiertos aportan la mayor parte del creciente volumen de tokens abiertos del marketplace en Estados Unidos

|5 min de lectura0
Network cabling in a server room, where OpenRouter's new US endpoint restricts AI requests to domestic provider infrastructure.
Network cabling in a server room, where OpenRouter's new US endpoint restricts AI requests to domestic provider infrastructure.

OpenRouter lanzó de forma general su enrutamiento dentro de la región de Estados Unidos: las solicitudes enviadas a su endpoint estadounidense se descifran, procesan y responden íntegramente dentro del país, y se rechazan de plano si ningún proveedor cumple los requisitos. La compañía comunicó el cambio en una publicación de anuncio y extiende así la garantía que ofrece en la Unión Europea desde octubre de 2025.

El momento no es casual. OpenRouter señala que la proporción de tokens dirigidos a modelos de pesos abiertos crece de forma sostenida tanto en las solicitudes originadas en Estados Unidos como en las de la Unión Europea, y que los modelos de laboratorios chinos siguen concentrando la mayor parte de ese volumen. Las empresas quieren el precio y la velocidad de esos pesos. Sus áreas de compras quieren saber adónde van los prompts.

Claves

  • US In-Region Routing está disponible de forma general en los planes Business y Enterprise a través del endpoint us.openrouter.ai, que falla en cerrado en lugar de derivar la solicitud a un proveedor fuera de la región.
  • La cuota de pesos abiertos dentro del volumen de tokens de OpenRouter en Estados Unidos crece de forma sostenida, y laboratorios chinos como DeepSeek, Moonshot y Zhipu aportan la mayor parte.
  • Los modelos elegibles abarcan a OpenAI, Anthropic, Google, NVIDIA y Thinking Machines junto con DeepSeek, Moonshot y Zhipu, porque proveedores estadounidenses como Baseten, Fireworks y Azure los alojan dentro del país.

Cómo funciona la garantía de enrutamiento

El cambio ocurre en la capa de enrutamiento, no en los modelos. En el endpoint global estándar de OpenRouter cualquier proveedor elegible de cualquier región puede atender una solicitud, de modo que ni siquiera llamar a un modelo desarrollado en Estados Unidos garantiza que la petición se procese en territorio estadounidense. Las solicitudes enviadas al endpoint regional se descifran en infraestructura de OpenRouter dentro del país, y el conjunto de proveedores candidatos se reduce a los endpoints que la compañía ha aprobado como operativos allí.

Si ningún proveedor estadounidense habilitado puede atender el modelo solicitado, la llamada devuelve un error 404 en lugar de salir del país en silencio. Los equipos pueden fijar la restricción mediante los guardrails de OpenRouter a nivel de espacio de trabajo, equipo o clave de API, y las herramientas capaces de sacar datos de prompts fuera de la región quedan deshabilitadas en el endpoint regional. La documentación de la función detalla qué modelos son elegibles hoy.

Por qué importa la cuota de pesos abiertos

El argumento a favor de los modelos de pesos abiertos siempre incluyó el control: descargar los pesos, ejecutarlos donde uno quiera y mantener los datos cerca. Ese razonamiento pierde fuerza para la amplia franja de desarrolladores que llega a esos modelos a través de un marketplace alojado en vez de ejecutarlos por su cuenta.

Según The New Stack, los datos de Hugging Face de febrero mostraron que los desarrolladores chinos representaron el 41% de las descargas de modelos en los doce meses previos, por delante del 36,5% de los estadounidenses. El mismo informe cita el estudio State of AI in the Enterprise 2026 de Deloitte, según el cual el 77% de las empresas ya considera el país de origen al elegir proveedor y casi el 60% construye su stack de IA principalmente con proveedores locales. La operación de 12.900 millones de dólares de Nvidia por Hugging Face subraya el peso comercial que ha alcanzado el ecosistema abierto.

Cailee Moberg, del equipo de producto de OpenRouter, planteó el problema en términos de compras: los modelos de laboratorios chinos siguen concentrando la mayor parte del volumen de pesos abiertos, pero conseguir su aprobación interna resulta difícil. El argumento de la compañía es que el enrutamiento regional permite a los equipos con requisitos de residencia de datos capturar las ventajas de precio y rendimiento de esos modelos sin involucrar en absoluto al laboratorio de origen: si un proveedor estadounidense o europeo aloja los pesos, la solicitud va a ese proveedor.

Lo que no cambia

El enrutamiento por residencia regula dónde ocurre la inferencia, no dónde se construyó el modelo. DeepSeek V4 Pro, Kimi K3 y GLM 5.2 siguen siendo modelos desarrollados en China; lo que cambia es a qué copias alojadas puede dirigirse un cliente estadounidense y dónde se procesa el prompt por el camino. Las empresas ya podían lograr el mismo resultado ejecutando los modelos por su cuenta o contratando directamente a un proveedor estadounidense. OpenRouter, que según distintas informaciones acordó su venta a Stripe por unos 7.500 millones de dólares, apuesta a que la mayoría de los equipos prefiere comprar esa garantía antes que operarla.

Preguntas frecuentes

¿Qué ocurre si un modelo no está disponible en la región de Estados Unidos?

La solicitud falla en cerrado. OpenRouter devuelve un error 404 en lugar de recurrir a un proveedor fuera de la región, de modo que una llamada mal configurada no puede filtrar datos de prompts al extranjero sin que nadie lo note. Los administradores pueden reforzar la restricción con Guardrails a nivel de espacio de trabajo, equipo o clave de API.

¿Qué modelos admiten US In-Region Routing?

Entre los elegibles hay sistemas de frontera propietarios de OpenAI, Anthropic y Google, modelos de pesos abiertos estadounidenses de NVIDIA y Thinking Machines, y modelos de pesos abiertos chinos como V4 Pro de DeepSeek, Kimi K3 de Moonshot y GLM 5.2 de Zhipu. Califican porque proveedores estadounidenses como Baseten, Fireworks y Azure los sirven desde centros de datos nacionales. OpenRouter mantiene una lista de elegibilidad actualizada.

¿También existe enrutamiento dentro de la región para la Unión Europea?

Sí. OpenRouter afirma que el enrutamiento regional europeo está disponible desde octubre de 2025, y el lanzamiento estadounidense extiende la misma garantía a una segunda región. Ambos se ofrecen a clientes Business y Enterprise.

¿Qué te parece este artículo?

SJ
Cargando...

Artículos relacionados

OpenAI abre a los desarrolladores su modelo de voz full-duplex por cinco centavos el minuto
Developer Tools

OpenAI abre a los desarrolladores su modelo de voz full-duplex por cinco centavos el minuto

El modelo de voz full-duplex GPT-Live-1 de OpenAI ya está en la API por 0,05 dólares el minuto, con un 86,2 % en Tau3 frente al 45,7 % de su antecesor.

Seung Junghace 7 días
Agentes de IA inundaron RubyGems con 2.000 paquetes y el registro cerró las altas cuatro días
Developer Tools

Agentes de IA inundaron RubyGems con 2.000 paquetes y el registro cerró las altas cuatro días

Un informe forense reconstruye la campaña GemStuffer de mayo, en la que agentes de IA subieron más de 2.000 gems y forzaron a RubyGems a congelar las nuevas altas cuatro días.

Seung Junghace 6 días
Shopify compra Tailwind Labs mientras la IA erosiona el negocio del framework
Developer Tools

Shopify compra Tailwind Labs mientras la IA erosiona el negocio del framework

Shopify adquirió Tailwind Labs, creadora de Tailwind CSS. El framework mantiene su licencia MIT mientras Tailwind Plus y ui.sh dejan de aceptar nuevas suscripciones.

Seung Junghace 6 días
Los reparadores con LLM rompieron código que funcionaba diez veces más a menudo de lo que arreglaron el defectuoso
Developer Tools

Los reparadores con LLM rompieron código que funcionaba diez veces más a menudo de lo que arreglaron el defectuoso

Un estudio en arXiv midió un bucle de reparación con LLM dañando programas correctos a 0,261 y arreglando los defectuosos a 0,023, y halló la dirección interna que lo impulsa.

Seung Junghace 5 días
HydraFusion de GitHub deja de elegir un modelo: monta un flujo de trabajo
Developer Tools

HydraFusion de GitHub deja de elegir un modelo: monta un flujo de trabajo

Project HydraFusion, de GitHub, arma un plan multimodelo para cada petición de Copilot y cambia la sencillez de un único modelo por un coste mucho más bajo.

Seung Junghace 5 días
SWE-2 de Cognition queda a un punto de la frontera por un 64% menos
Developer Tools

SWE-2 de Cognition queda a un punto de la frontera por un 64% menos

Cognition afirma que SWE-2 obtiene 50,0% en FrontierCode 1.1 Main, un punto por detrás de Fable 5.1, con un coste 64% menor y sobre una base china abierta.

Seung Junghace 7 días