Apple apuesta por la IA local con un Mac Studio de 512GB y el M5 Ultra

1,2 TB/s de ancho de banda de memoria unificada para ejecutar modelos de cientos de miles de millones de parámetros sin pasar por un centro de datos

|5 min de lectura0
The Mac Studio chassis, now offered with Apple’s M5 Ultra and up to 512GB of unified memory for on-device AI work.
The Mac Studio chassis, now offered with Apple’s M5 Ultra and up to 512GB of unified memory for on-device AI work.

Apple presentó el 25 de agosto un nuevo Mac Studio construido en torno al M5 Max y a un M5 Ultra completamente nuevo. La configuración que Apple empuja con más fuerza apunta directamente a quienes quieren ejecutar grandes modelos de lenguaje sin recurrir a un centro de datos: hasta 512GB de memoria unificada moviéndose a 1,2 terabytes por segundo.

Claves del anuncio

  • El Mac Studio con M5 Ultra llega hasta 512GB de memoria unificada con 1,2 TB/s de ancho de banda, un 50 % más que el M3 Ultra al que sustituye.
  • Apple cifra la potencia máxima de IA de la GPU del M5 Ultra en hasta 4,5 veces la del M3 Ultra, con un Neural Accelerator en cada uno de sus hasta 80 núcleos gráficos.
  • Las reservas se abrieron el 25 de agosto desde 5.499 dólares, la venta general arranca el 22 de septiembre y las configuraciones de 512GB llegan a finales de octubre.

En su versión más alta, el M5 Ultra combina una CPU de 36 núcleos con una GPU de 80. Apple sitúa esa GPU en hasta 4,5 veces la potencia máxima de IA del M3 Ultra, y es el primer chip Ultra que incorpora un Neural Accelerator en todos sus núcleos gráficos. El ancho de banda de memoria también sube un 50 % frente al M3 Ultra y, en una arquitectura de memoria unificada, esa cifra pesa más que el recuento de núcleos.

Por qué el titular es la memoria

En una máquina con memoria unificada, el modelo y los datos comparten un mismo espacio. No hay que copiar los pesos por un bus hacia una memoria de vídeo aparte, que es justamente el cuello de botella que vuelve incómodo ejecutar modelos muy grandes en hardware de escritorio convencional.

El argumento de Apple parte de ahí: con 512GB disponibles, un modelo de cientos de miles de millones de parámetros cabe entero en memoria local y los conjuntos de datos pueden permanecer residentes mientras la máquina trabaja con ellos. El ancho de banda decide entonces a qué velocidad salen los tokens.

Ese ancho de banda importa por una razón estructural. Generar cada token exige leer los pesos del modelo, así que en modelos grandes el límite de velocidad lo marca el sistema de memoria y no las unidades aritméticas. Elevarlo a la mitad respecto de la generación anterior sube ese techo de forma directa.

Quien no necesite la configuración completa puede optar por la versión M5 Max de la misma máquina, que comparte chasis y enfoque de memoria unificada con hasta 128GB.

A quién se dirige realmente

No es una configuración masiva y Apple no pretende que lo sea. El público son investigadores y desarrolladores que quieren iterar sobre un modelo grande sin contar cada petición, además de flujos de trabajo profesionales en los que los datos no pueden salir del edificio.

Apple menciona escenarios en los que un modelo local dirige tareas de simulación en herramientas como MATLAB, con el modelo y la carga de trabajo sobre el mismo escritorio. Thunderbolt 5 se encarga de la conectividad externa, y la compañía asegura que también permite agrupar varios Mac Studio por RDMA en un espacio de memoria compartido, donde cuatro máquinas alcanzan hasta el triple del rendimiento de inferencia de una sola.

Cómo se compara con otro hardware de IA local

El calendario coloca a Apple dentro de un movimiento más amplio hacia la inferencia local, más que por delante de él. Nvidia lleva tiempo impulsando DGX Spark como máquina de IA de escritorio, y Perplexity lanzó esa misma semana una versión totalmente local de su plataforma de agentes sobre ese hardware, como contamos en nuestro reportaje sobre el agente que funciona en tu propia GPU sin cobrarte nada.

Lo que distingue a esta configuración del Mac Studio es el techo de memoria. DGX Spark se queda en 128GB de memoria unificada, y la mayoría del hardware de IA de escritorio arrastra una limitación parecida sobre cuánto modelo cabe antes de que el rendimiento se desplome. Un espacio direccionable de 512GB cambia de entrada qué modelos entran siquiera en la lista.

Precio y disponibilidad

Las reservas se abrieron el 25 de agosto, con el Mac Studio M5 Ultra desde 5.499 dólares y venta general el 22 de septiembre. La versión M5 Max parte de 2.499 dólares. Las configuraciones de 512GB llegan más tarde, a finales de octubre. Apple presentó además el M6, su primer chip fabricado en dos nanómetros, en la misma tanda de anuncios, lo que sitúa al M5 Ultra como el techo de cómputo de la línea de escritorio actual y no como la vanguardia de su hoja de ruta de silicio.

Que la inferencia local se convierta en práctica habitual o siga siendo una opción de especialistas dependerá más de la economía que del hardware. Pero la dirección coincide en tres empresas muy distintas en una sola semana, y eso suele ser una señal que conviene leer.

Preguntas frecuentes

¿Qué tamaño de modelo admite el Mac Studio de 512GB?

Apple sostiene que un modelo de cientos de miles de millones de parámetros cabe entero en los 512GB de memoria unificada. El límite práctico depende de la precisión, porque la cuantización guarda cada peso en menos bytes, de modo que esos mismos 512GB albergan un modelo bastante mayor a 4 bits que a 16.

¿Es el M5 Ultra más rápido que el M3 Ultra en tareas de IA?

Apple sitúa la GPU del M5 Ultra en hasta 4,5 veces la potencia máxima de IA del M3 Ultra. El ancho de banda de memoria también sube un 50 % hasta 1,2 TB/s, y eso pesa más que el cómputo bruto al generar tokens en modelos muy grandes, ya que cada token obliga a leer los pesos.

¿Cuándo se puede comprar el Mac Studio de 512GB?

Las reservas se abrieron el 25 de agosto de 2026 y la venta general empieza el 22 de septiembre. Las configuraciones de 512GB se envían más tarde, a finales de octubre. El modelo con M5 Ultra parte de 5.499 dólares en las configuraciones de menor memoria.

¿Qué te parece este artículo?

SJ
Cargando...

Artículos relacionados

Nvidia gastó 27.000 millones de dólares sin presentar una sola notificación de fusión. El Departamento de Justicia quiere saber por qué
Tech & Business

Nvidia gastó 27.000 millones de dólares sin presentar una sola notificación de fusión. El Departamento de Justicia quiere saber por qué

Las autoridades antimonopolio abrieron el primer examen serio de la estructura que reemplazó a la adquisición en la industria de la IA: Nvidia recibió un requerimiento formal de información del Departamento de Justicia.

Seung Junghace 5 días
Huang defiende el 70 % de crecimiento de Nvidia: "Ponemos un dólar y vuelven cien"
Tech & Business

Huang defiende el 70 % de crecimiento de Nvidia: "Ponemos un dólar y vuelven cien"

Huang ratificó la guía del 70 % de Nvidia, que implica 680.000 millones en ingresos, y respondió a las críticas de circularidad: un dólar entra, cien vuelven.

Seung Junghace 7 días
Apple lanza Siri AI en iOS 27: solo en inglés y en beta
Tech & Business

Apple lanza Siri AI en iOS 27: solo en inglés y en beta

Siri AI es la pieza central de iOS 27, iPadOS 27 y macOS 27, pero llega como beta exclusiva en inglés, con cinco idiomas más prometidos para octubre.

Seung Junghace 3 días
Universal Music firma con ElevenLabs su primer acuerdo con un gran sello para una plataforma de remezclas con licencia
Tech & Business

Universal Music firma con ElevenLabs su primer acuerdo con un gran sello para una plataforma de remezclas con licencia

UMG y ElevenLabs construirán una plataforma de consumo para remezclas y mezclas combinadas a partir de catálogo con licencia, el primer acuerdo de la empresa de audio con un gran sello.

Seung Junghace 6 días
La Corte Suprema de Nuevo México multa con 5.000 dólares a un abogado por los testigos falsos de ChatGPT
Tech & Business

La Corte Suprema de Nuevo México multa con 5.000 dólares a un abogado por los testigos falsos de ChatGPT

La Corte Suprema de Nuevo México multó con 5.000 dólares al abogado Stephen Aarons y lo declaró en desacato después de que ChatGPT inventara testigos y testimonio policial en una apelación.

Seung Junghace 6 días
Moonshot AI apunta a 2.000 millones de dólares tras triplicar ingresos con Kimi K3
Tech & Business

Moonshot AI apunta a 2.000 millones de dólares tras triplicar ingresos con Kimi K3

Moonshot AI dijo a sus inversores que apunta a 2.000 millones de dólares de ingresos anualizados a cierre de año, después de que Kimi K3 llevara su ritmo por encima de los 1.000 millones en agosto.

Seung Junghace 6 días