Em 2026, a AMD planeja enviar o Helios, seu primeiro sistema de IA em escala de rack, por um preço estimado acima de $5 milhões. O compromisso da Core Scientific de destinar mais de 500MW de capacidade de data centers nos EUA à AMD começa em 2027.

Principais pontos

  • A AMD planeja enviar o Helios no fim de 2026 por um preço estimado acima de $5 milhões por rack.
  • O acordo da Core Scientific nos EUA fornece à AMD mais de 500MW de capacidade de data centers a partir de 2027, com potencial de expansão para 2.5GW.
  • A primeira implantação programada de MI450 pela OpenAI é de 1GW no segundo semestre de 2026, dentro de um acordo de até 6GW ao longo de vários anos.
  • A Meta planeja implantar 1GW de hardware da AMD em 2026 sob um acordo avaliado em mais de $100 bilhões e que abrange até 6GW.
  • O acordo da Anthropic cobre até 2GW de chips MI450 a partir do primeiro semestre de 2027; a AMD também concordou em investir até $5 bilhões na Anthropic.

A AMD apresentou os chips de aprendizado de máquina Radeon Instinct para servidores em 2016 como componentes posicionados contra a Nvidia. Em 2023, lançou o MI300X com a alegação de até 1.6 vez o desempenho de inferência do H100 HGX da Nvidia. Capacidade de memória, rede, energia, resfriamento, acesso à nuvem e software ainda apareciam como condições de suporte em torno do benchmark.

O Helios transforma o sistema implantável na unidade competitiva da infraestrutura de IA. Para servir como segunda fonte da Nvidia, a AMD precisa combinar seu silício com memória, rede, energia, espaço em data center, software utilizável, acesso à nuvem e clientes comprometidos por tempo suficiente para financiar a montagem. Os gargalos dão à incumbente margem para continuar precificando a máquina montada.

A escassez reprecifica a máquina montada

Os servidores B300 da Nvidia chegaram a cerca de $1 milhão cada na China depois que a forte demanda e a oferta mais restrita no mercado negro quase dobraram os preços reportados. Os compradores pagaram um prêmio de escassez por servidores que conseguiam obter sob restrições, além de qualquer explicação possível por uma comparação de chips isolados.

O Stargate da OpenAI teria contratado 900,000 wafers de DRAM por mês, cerca de 40% da produção global. Esse compromisso torna a memória um insumo limitante ao lado das GPUs, enquanto as escassezes em armazenamento e outros componentes reduzem ainda mais o número de sistemas que os operadores conseguem montar. Fornecedores no emergente mercado de alocação de memória para IA ganham vantagem ao qualificar, reservar e integrar memória, em vez de apenas especificá-la em uma ficha de produto.

O CloudMatrix 384 da Huawei torna a mesma estrutura visível a partir da China. O sistema em escala de rack concorre com o GB200 NVL72 da Nvidia apesar da menor eficiência energética, uma troca cujo custo depende do ambiente operacional. A Huawei pode tolerar a penalidade de eficiência porque o CloudMatrix oferece aos clientes chineses um sistema disponível no país, permitindo que os compradores escolham qual restrição absorver.

A AMD está reservando o que os clientes não podem improvisar

Microsoft, Meta, OpenAI e outros clientes devem receber o Helios no fim de 2026. Suas implantações testarão se a AMD consegue entregar uma instalação operável, e não um processador para outro fornecedor integrar.

A Core Scientific vinculou esse roteiro à capacidade física por meio de um acordo nos EUA que começa em 2027 e pode se expandir além de seu compromisso inicial.

Capacidade de data centers nos EUA contratada pela AMD a partir de 2027, expansível para 2.5GW

A AMD pode concluir o projeto de um processador sem controlar onde ele será executado. O acordo com a Core Scientific trata do espaço energizado necessário após fabricação, montagem e envio. Os clientes não podem improvisar capacidade elétrica, resfriamento, rede e comissionamento quando um rack chega.

O Helios está programado para ser enviado no fim de 2026, enquanto a capacidade da Core Scientific começa em 2027. A defasagem de capacidade de um ano não mostra que nenhum dos planos falhou, mas impede a AMD de tratar um anúncio como prova do outro. A AMD assegurou um pré-requisito para a competição em escala de rack e ainda precisa demonstrar entrega em escala.

O megawatt contratado muda a economia antes que um prédio esteja totalmente ocupado. A AMD pode usar compromissos de clientes de longa duração para planejar capacidade, enquanto a capacidade reservada torna seus compromissos de hardware mais críveis, embora cada elo acrescente outro cronograma que precisa se sustentar.

Contratos em gigawatts tornam público o prazo de execução

OpenAI e AMD concordaram com implantações de até 6GW de GPUs Instinct ao longo de vários anos. A primeira implantação de 1GW de MI450 está programada para o segundo semestre de 2026, e a OpenAI poderia ficar com uma participação de até 10% na AMD. Separadamente, a Meta concordou em adquirir até 6GW em um acordo avaliado em mais de $100 bilhões, com 1GW planejado para 2026. A Anthropic assinou por até 2GW de chips MI450 a partir do primeiro semestre de 2027, enquanto a AMD concordou em investir até $5 bilhões na Anthropic.

Cada número de “até” estabelece um teto; o hardware instalado pode ficar abaixo dele. A AMD enfrenta testes mais concretos nas primeiras parcelas datadas: OpenAI e Meta em 2026, seguidas por Anthropic e Core Scientific em 2027.

Cada gigawatt que a AMD assina vincula um atraso de chip ao plano de capital de um cliente.

A AMD precisa sincronizar processadores, montagem de racks, ROCm, capacidade de data centers e prontidão dos clientes. Se a AMD enviar um rack atrasado, a capacidade pode ficar ociosa. Se a Core Scientific entregar capacidade atrasada, os clientes podem adiar a aceitação do hardware. Se o ROCm não estiver pronto, ambos podem ser subutilizados. Os contratos elevam o ônus da prova da AMD ao mesmo tempo que estabelecem a demanda.

OpenAI e Meta ganham poder de barganha com uma alternativa crível à Nvidia apenas se a AMD cumprir seus requisitos práticos no prazo. Se migrar para a AMD adia a implantação, esse poder desaparece. Suas parcelas datadas medirão quanto resiste à implantação.

ROCm transforma cada rack em um projeto de migração

A AMD entrou nessa disputa em 2023 com a alegação de benchmark do MI300X. Microsoft, Meta, Oracle e OpenAI disseram que planejavam usar o acelerador. A Microsoft planejava oferecê-lo via Azure, reduzindo o trabalho necessário para obter hardware da AMD. O Azure não poderia eliminar o trabalho de executar cargas de trabalho de produção em uma pilha de software diferente.

O ROCm avançou rapidamente, mas ainda ficava atrás do CUDA da Nvidia. Ao longo do ciclo de vida de um rack, a AMD precisa persuadir desenvolvedores a migrar cargas de trabalho, ajudar operadores a integrá-las e manter a compatibilidade à medida que os ciclos de lançamento de hardware e software continuam. Um benchmark mede uma carga de trabalho delimitada sob condições especificadas; uma plataforma de produção acumula exceções.

A AMD adquiriu a Taalas para buscar inferência específica para cargas de trabalho. A Taalas integra pesos de modelos diretamente ao silício para melhorar o desempenho de inferência, dando à AMD uma forma de se diferenciar no local em que um modelo é executado. Os desenvolvedores ainda precisam migrar o software de produção.

Investidores ainda precificam a lacuna de entrega

A AMD reportou receita de $11.5 bilhões no Q2, com receita de Data Center de $6.7 bilhões, alta de 107% em relação ao ano anterior. O crescimento mostra demanda em toda a operação de data centers da AMD. Ainda assim, a AMD projetou receita do Q3 abaixo de algumas estimativas de analistas, e suas ações caíram mais de 7% no after-hours. Os investidores ainda queriam evidências mais claras de conversão no curto prazo.

A AMD estaria planejando uma emissão de títulos com grau de investimento de até $5 bilhões para sustentar gastos relacionados à IA. Nenhum financiamento concluído ou plano definido de alocação de capital havia sucedido a reportagem. A escala considerada se encaixa em uma empresa que financia capacidade e sistemas ao lado do desenvolvimento de chips.

Operadores de data centers têm pouca margem para infraestrutura ociosa. As vendas globais de IA, excluindo a China, chegaram a $25 bilhões no primeiro trimestre, acima dos estimados $21 bilhões em custos de depreciação de data centers e chips, mas as margens permaneceram estreitas. A AMD pode registrar forte demanda por componentes enquanto clientes e investidores ainda examinam se racks caros chegam, operam com confiabilidade e geram receita antes de sua depreciação.

Perguntas frequentes

Quanto a receita da AMD no Q2 superou as estimativas dos analistas?

A AMD reportou receita de $11.5 bilhões no Q2, ante estimativas de $11.3 bilhões, uma diferença de $200 milhões. A empresa disse que a receita total cresceu 50% em relação ao ano anterior.

Quanto a AMD pagou para adquirir a Taalas?

O preço de compra não foi divulgado. As evidências fornecidas registram a aquisição como concluída em reportagens datadas de August 6 e August 7, 2026.

Quais especificações do rack Helios a AMD divulgou?

O material informa um preço estimado acima de $5 milhões e um cronograma de envio para o fim de 2026, mas não fornece uma configuração detalhada do rack Helios, volume de envios ou alocação por cliente.

Marcos programados de rack, clientes e capacidade da AMD

Parte ou sistemaMarco programadoEscala ou valor divulgado
HeliosFim de 2026Preço estimado acima de $5 milhões por rack
OpenAISegundo semestre de 2026: primeira implantação de MI450Primeira parcela de 1GW; até 6GW ao longo de vários anos
Meta20261GW planejado; até 6GW em um acordo avaliado acima de $100 bilhões
AnthropicPrimeiro semestre de 2027Até 2GW de chips MI450; investimento da AMD de até $5 bilhões
Core Scientific2027Mais de 500MW de capacidade nos EUA, expansível para 2.5GW

Em 2016, a AMD podia colocar Radeon Instinct diante da Nvidia em um slide e declarar iniciada a disputa. Em 2026, esse slide se tornou um rack Helios que custa mais de $5 milhões, com 500 megawatts aguardando atrás dele uma data de início em 2027. A AMD agora compete na baia energizada, onde hardware, software e contrato precisam chegar no mesmo dia.