Se estima que cada instalación de AMD Helios costará más de $5 millones. A ese precio, incluso un acelerador que encabece las pruebas de rendimiento puede dejar al comprador sin capacidad de cómputo utilizable.

Puntos clave

  • Helios transforma el desafío de AMD a Nvidia: ya no es una competencia entre chips, sino una prueba de homologación a escala de gabinete en la que aceleradores, CPU, HBM, redes, refrigeración, programas, capacidad en la nube, energía y financiamiento deben funcionar en conjunto.
  • Un acelerador más rápido o barato no aporta capacidad utilizable si no están disponibles componentes escasos como HBM, encapsulado, conexiones ópticas, programas estables o energía lista para suministrarse.
  • AMD está invirtiendo más allá de los chips —al respaldar empresas de capacidad en la nube y gestión de infraestructura— para reducir el trabajo de integración que, de otro modo, recaería en sus clientes.
  • La inferencia de menor costo solo se convierte en una ventaja duradera cuando los compradores pueden trasladar de manera confiable sus cargas de producción a la capacidad de AMD; los descuentos en chips no bastan.
  • AMD debe ofrecer suficiente integración para ser una alternativa viable en la operación, sin renunciar a la apertura y la competencia de precios que vuelven valiosa a una segunda fuente.

Durante buena parte de la recuperación de AMD, los clientes podían delimitar con claridad un producto alrededor de una CPU o una GPU. AMD desarrollaba un componente mejor, convencía a los fabricantes de sistemas de adoptarlo y dejaba que los clientes armaran el resto de la máquina. Era posible comparar componentes porque el resto de la arquitectura seguía siendo razonablemente modular.

Los compradores de sistemas de vanguardia están ampliando ese perímetro. Cada vez adquieren con mayor frecuencia los aceleradores junto con CPU, memoria, redes, refrigeración, programas, capacidad en la nube, energía y un plan de instalación. Un chip puede ganar la prueba de rendimiento y aun así perder el contrato de instalación.

Para esos compradores, la lista de requisitos de una segunda fuente ya no se limita a la compatibilidad entre componentes: también incluye a los proveedores y operadores encargados de poner la capacidad en producción.

Zen resolvió el producto; Helios debe homologar el sistema

AMD entendió pronto los límites de competir solo por precio. En 2015, la empresa afirmó que no podía competir únicamente como la opción más barata y centró su propuesta de CPU Zen y GPU equipadas con HBM en el rendimiento. Esa fue la respuesta correcta para un mercado de componentes: eliminar la desventaja de desempeño y después aprovechar el precio y la libertad de elección para abrirse paso en nuevas cuentas.

Quarterly coverage volume: AMDCoverage of AMD by quarter, 2024 Q4 to 2026 Q3: from 18 to 18 articles per quarter, peaking at 44.peak 44182024 Q42026 Q3
Quarterly coverage · AMD · 2024 Q4–2026 Q3 · current quarter projected

Los compradores podían adoptar AMD en una categoría de componentes a la vez. Una CPU competitiva no exigía que AMD suministrara la memoria, la red, la planta de refrigeración, el entorno de programas y el financiamiento a su alrededor. El sistema del cliente absorbía el componente.

Los modelos de IA de gran escala invierten esa relación. En 2023, AMD lanzó la MI300X con 192GB de HBM3 y un enfoque explícito en los grandes modelos de lenguaje. El lanzamiento acercó a AMD a cargas de trabajo cuyo resultado útil depende en gran medida de la memoria del acelerador, las interconexiones, los programas y el diseño del conjunto de equipos.

Helios vuelve a ampliar ese perímetro. AMD planea enviar su primer sistema de IA a escala de gabinete más adelante en 2026 a Microsoft, Meta, OpenAI y otros clientes.

A ese precio, el comprador adquiere un activo de capital que debe instalar, energizar, operar y amortizar con base en la producción útil de los modelos. No está homologando las especificaciones de un acelerador, sino la capacidad de AMD para hacer productivo todo el activo.

La lista de materiales define ahora el terreno competitivo

Un comprador solo puede instalar una alternativa a escala de gabinete cuando está disponible el insumo complementario más escaso. Este requisito convierte una competencia entre semiconductores en una competencia entre cadenas de suministro.

AMD y Samsung firmaron un acuerdo preliminar que abarca HBM4 de próxima generación para los aceleradores MI455X y DDR5 para Helios. El acuerdo forma parte de un régimen más amplio de asignación de memoria: el acceso a memoria avanzada determina si un acelerador diseñado puede convertirse en capacidad efectivamente entregada.

Los desarrolladores de IA también enfrentan escasez y aumentos de precios en láseres, sustratos, fibra óptica y conectores. Además, compiten por equipos de refrigeración, inmuebles y energía. Un acelerador disponible no genera capacidad si no hay conexiones ópticas para enlazarlo o si las instalaciones no pueden enfriarlo.

Se ha señalado que Nvidia, SK Hynix, TSMC y ASML concentran participaciones de entre 80% y 100% en sus respectivos segmentos de la cadena de suministro de IA. Ante la presión de la demanda sobre la capacidad de TSMC, AMD y otras empresas han solicitado a Samsung la fabricación de chips avanzados. Los competidores deben homologar rutas alternas dentro de la cadena antes de necesitarlas con urgencia.

AMD puede imponerse en una comparación gracias a un acelerador más rápido. Pero, para concretar una orden de compra, también necesita HBM reservado, acceso a fundición, encapsulado, redes y energía lista para suministrarse.

Los programas y el capital ya forman parte del gabinete

Después de que AMD entrega los equipos, el comprador todavía debe ejecutar cargas de producción sin convertir cada instalación en un proyecto de ingeniería hecho a la medida.

Un análisis detallado de las pruebas de rendimiento de la MI300X encontró especificaciones teóricas atractivas y ventajas en el costo total de propiedad frente a las alternativas de Nvidia, pero los errores en los programas frenaron al acelerador. Cuando la inestabilidad consume tiempo de ingeniería, retrasa el aprovechamiento de los equipos o reduce el número de cargas que pueden ejecutarse con confianza, el cliente compra ahorros en chips y termina pagando costos de integración.

Por lo tanto, Helios debe homologar un conjunto completo de programas e instalación, no limitarse a integrar componentes de AMD. La ampliación de la relación entre AMD y Microsoft abarca GPU, CPU, redes y programas, y Microsoft prevé instalar Helios para la inferencia de modelos de vanguardia. Al suministrar esas capas en conjunto, las empresas reducen las excepciones que cada cliente debe resolver por su cuenta.

Las inversiones de AMD alrededor de los chips responden al mismo problema. La empresa encabezó la Serie B de TensorWave por $350 millones, y TensorWave afirmó que usaría el capital para equipar más centros de datos con chips de AMD. AMD también participó en la Serie D de Spectro Cloud por $100 millones; Spectro Cloud se enfoca en la gestión de infraestructura de IA y los costos por unidad procesada.

TensorWave puede ampliar la capacidad en la nube basada en AMD que los clientes pueden contratar, mientras Spectro Cloud trabaja en la capa de gestión necesaria para operar infraestructura heterogénea de forma eficiente y rentable. AMD está utilizando capital para construir los elementos complementarios que el mercado de componentes antes dejaba en manos de los clientes.

Los clientes o intermediarios también deben financiar los equipos antes de que las cargas de trabajo comiencen a utilizarlos. Sin un operador, instalaciones y demanda comprometida, los equipos siguen siendo inventario costoso en lugar de capacidad utilizable.

La inferencia vuelve económicamente valiosa la homologación

Los clientes aceptan este trabajo de integración debido a la economía de la inferencia. OpenAI y Anthropic han presentado proyecciones en las que los costos de inferencia superaban la mitad de los ingresos. Cuando el cómputo se convierte en un gasto operativo recurrente de gran peso, la concentración de proveedores deja de ser solo un riesgo para la continuidad y pasa a ser un problema de márgenes.

Una segunda fuente creíble no necesita ganar todas las cargas de trabajo. Debe permitir que un número suficiente de ellas pueda trasladarse, de modo que los compradores asignen la demanda según el precio, la disponibilidad y la eficiencia del sistema. El poder de negociación proviene de la posibilidad real de mover las cargas, no de una amenaza escrita en un memorando de compras.

Oracle planea instalar 50,000 chips Instinct MI450 a partir de la segunda mitad de 2026. Microsoft, Meta y OpenAI también figuran como clientes de Helios. Estas empresas están evaluando si la capacidad de AMD puede convertirse en un recurso operativo dentro de grandes infraestructuras de IA.

Los compradores no reducirán los costos de inferencia únicamente mediante descuentos en chips; tendrán que rediseñar el sistema. Si los equipos de AMD pueden suministrarse, instalarse, administrarse y reasignarse entre cargas de producción, los compradores obtendrán otra forma de convertir capital y electricidad en unidades de texto procesadas. La propuesta de valor pasa de “este acelerador cuesta menos” a “esta carga de trabajo tiene otro lugar donde ejecutarse”.

Los programas imponen un primer límite. Según informes, ingenieros de OpenAI encontraron una forma de reducir los costos de inferencia a menos de la mitad, lo que demuestra que los algoritmos y los programas de sistemas pueden capturar beneficios que, de otro modo, quedarían en manos de los proveedores de infraestructura.

Los desarrolladores que no pueden acceder a los chips más avanzados imponen otro límite. Algunos están eligiendo modelos más pequeños de pesos abiertos y enfoques de “IA austera” en lugar de las mayores instalaciones a escala de gabinete. No todos los problemas de escasez generan demanda por otro gabinete gigantesco; algunos conducen a modelos más pequeños.

AMD solo se beneficia cuando las cargas siguen exigiendo gran capacidad de cómputo, la infraestructura puede sustituirse y los programas de producción permiten trasladarlas en la práctica. Fuera de esas condiciones, una ventaja teórica de costos no genera poder de negociación.

Nvidia también está ampliando el perímetro del sistema

AMD no se está expandiendo hacia una capa desocupada. Nvidia está extendiendo su propio perímetro hacia las CPU y los sistemas completos. Las primeras pruebas de su CPU Vera, que utiliza 88 núcleos Olympus diseñados por Nvidia, reportaron un rendimiento superior al de las CPU x86_64 de Intel y AMD. Esto reduce la capacidad de AMD para apoyarse en su fortaleza histórica en CPU como una posición protegida dentro del gabinete de IA.

Los grandes proveedores de servicios en la nube están ampliando el campo desde otra dirección. AWS está instalando Trainium, Meta ha desarrollado sus propios chips de IA y OpenAI presentó un chip de inferencia junto con Broadcom. CloudMatrix 384 de Huawei demuestra otra modalidad de sustitución a escala de gabinete: puede conservar su utilidad estratégica en China pese a ser menos eficiente en consumo eléctrico que GB200 NVL72 de Nvidia.

AMD y Nvidia ya no compiten dentro de un ecosistema neutral. Los sistemas integrados, los chips diseñados a la medida por grandes proveedores de nube, las cadenas regionales de suministro y los métodos informáticos que reducen las necesidades de equipo capturan valor de maneras distintas.

AMD debe conservar la apertura y la ventaja de precios que vuelven atractiva a una segunda fuente, al mismo tiempo que proporciona suficiente integración para que los clientes no tengan que asumir por sí mismos el costo de armar la alternativa.

Para el comprador detrás de esa orden de Helios por más de $5 millones, la prueba de rendimiento de AMD es apenas el primer filtro. Deben asignarse HBM, estabilizarse los programas, financiarse la capacidad y estar disponible la energía antes de que el menor costo se traduzca en poder de negociación. Hasta entonces, Helios no es una segunda fuente; es un resultado de laboratorio a la espera de una cadena de suministro.

El camino de AMD: de los chips a la capacidad de IA lista para operar

  • 2024 — Spectro Cloud fue valuada en $750 millones, lo que estableció el punto de referencia antes de que AMD participara en una ronda posterior de financiamiento enfocada en la gestión de infraestructura de IA.
  • 2026-06-10 — TensorWave recaudó una Serie B de $350 millones con una valuación posterior a la inversión de $1.55 mil millones, encabezada por AMD y Magnetar; afirmó que el capital se utilizaría para equipar más centros de datos con chips de AMD.
  • 2026-07-16 — Spectro Cloud recaudó una Serie D de $100 millones de AMD, LG y otros inversionistas, con una valuación superior a $1 mil millones.
  • 2026-07-20 — Se estimó que Helios costaría más de $5 millones, y AMD planeaba iniciar los envíos a Microsoft, Meta, OpenAI y otros clientes más adelante en 2026.

Preguntas frecuentes

¿Por qué una buena prueba de rendimiento de un acelerador de AMD no basta para ganar contratos de infraestructura de IA?

Los compradores de sistemas de vanguardia adquieren sistemas productivos, no chips aislados. Una buena prueba de rendimiento no compensa la falta de HBM, redes, refrigeración, energía, programas estables, capacidad en la nube o financiamiento para la instalación.

¿Qué necesita AMD para ser homologada como una verdadera segunda fuente frente a Nvidia?

AMD debe demostrar que cuenta con una cadena de suministro industrial reproducible que abarque aceleradores, CPU, memoria, capacidad de fundición y encapsulado, redes, programas, operadores, instalaciones, energía y capital. La prueba consiste en determinar si los clientes pueden poner sus cargas en producción sin tratar cada instalación como un proyecto de ingeniería hecho a la medida.

¿Por qué la economía de la inferencia abre una oportunidad para AMD?

La inferencia puede consumir una proporción considerable de los ingresos de una empresa de IA, lo que convierte la concentración de proveedores en un problema de márgenes. Si las cargas pueden trasladarse de forma confiable a infraestructura de AMD, los compradores podrán asignar la demanda según el precio, la disponibilidad y la eficiencia del sistema.

¿Cómo está construyendo AMD el ecosistema alrededor de sus chips?

AMD amplió su relación con Microsoft para abarcar GPU, CPU, redes y programas, además de invertir en TensorWave para aumentar la capacidad en la nube basada en AMD y en Spectro Cloud para mejorar la gestión de infraestructura y la economía del procesamiento de unidades de texto.

¿Qué podría impedir que Helios se convierta en una ventaja competitiva duradera?

La inestabilidad de los programas puede borrar los ahorros en equipos al elevar los costos de ingeniería y reducir su aprovechamiento, mientras que los algoritmos pueden disminuir el gasto de inferencia sin necesidad de equipos nuevos. Algunos desarrolladores con acceso limitado también podrían optar por modelos más pequeños de pesos abiertos o por IA austera, en lugar de otra gran instalación a escala de gabinete.