Voltar ao Blog

AMD Helios: Rackscale de 72 GPUs Entra em Produção Para IA de Fronteira

A AMD anunciou que sua solução rackscale AMD Helios entrou em produção e está sendo implantada por laboratórios de IA líderes e provedores de nuvem em escala de gigawatt. A plataforma — que combina 72 GPUs Instinct MI455X, 18 CPUs EPYC "Venice" de 6ª geração, networking Pensando e software ROCm em um rack co-projetado — promete até 30% mais tokens por dólar que a solução concorrente líder (NVIDIA Vera Rubin NVL72).

O anúncio, feito durante o evento Advancing AI 2026 em julho e agora em fase de implantação, marca a transição da AMD de fornecedora de componentes para fornecedora de sistemas rackscale completos — um movimento estratégico para capturar valor em toda a stack de infraestrutura de IA.

AMD Helios rackscale 72 GPUs

AMD Helios: 72 GPUs MI455X, EPYC Venice, Pensando networking em rack co-projetado

O Que É o AMD Helios

O AMD Helios é uma solução rackscale AI de referência, construída sobre o padrão OCP Open Rack Wide (ORW) submetido pela Meta ao Open Compute Project. Cada rack integra:

O design organiza as 72 GPUs em 4 cartuchos scale-up conectados via UALink over Ethernet (UALoE), entregando 260 TB/s de bandwidth scale-up agregado — conectando as 72 GPUs em um único domínio scale-up. Para scale-out, 43 TB/s de bandwidth Ethernet via Pensando 800 AI NIC.

Números Que Impressionam

Métrica AMD Helios (por rack) NVIDIA Vera Rubin NVL72 (comparativo)
GPUs por rack 72x MI455X 72x (arquitetura não detalhada publicamente)
FP4 Peak Performance 2.9 ExaFLOPs
FP8 Peak Performance 1.4 ExaFLOPs
HBM4 Capacity Total 31 TB (432 GB/GPU)
Memory Bandwidth Total 1.4 PB/s (19.6 TB/s per GPU)
Scale-up Bandwidth 260 TB/s (UALoE) ~170 TB/s (NVLink)
Scale-out Bandwidth 43 TB/s (Ethernet 800G)
Tokens/$ (Kimi K2, 32K in/8K out) +15% (baixa interatividade) Baseline
Tokens/$ (média/alta interatividade) +12% / +10% Baseline

Em testes com Kimi K2 Thinking (32K input, 8K output), o Helios modelado entrega 15% mais throughput a baixa interatividade, 12% em média, 10% em alta vs. NVL72 modelado. A vantagem vem de maior capacidade HBM (50% mais), maior bandwidth scale-up (50% mais), e scale-out (50% mais).

AMD Helios: Especificações-Chave

Parcerias Estratégicas: OpenAI, Anthropic, Meta

A AMD não está apenas vendendo hardware — está co-projetando com os maiores consumidores:

OpenAI: Otimização Full-Stack Triton + ROCm

A OpenAI e AMD anunciaram parceria estratégica para otimizar cargas GPT-class no MI455X e Helios, usando o framework Triton da OpenAI com ROCm da AMD. A OpenAI espera colocar Helios online no Q4 2026, com deployments acelerando em 2027. É a primeira vez que a OpenAI valida publicamente hardware não-NVIDIA para cargas de fronteira em escala de produção.

Anthropic: Até 2 GW de MI455X em Helios

A Anthropic e AMD anunciaram parceria estratégica para implantar até 2 gigawatts de GPUs MI455X em racks Helios. Isso representa dezenas de milhares de GPUs — um compromisso massivo que sinaliza confiança da Anthropic no roadmap AMD para treinamento de fronteira (Claude Opus 5, Sonnet 4.5, modelos futuros).

Meta: Co-design Para Gigawatt-Scale

A Meta e AMD estão co-projetando para deployments em escala de gigawatt, otimizando a stack completa AMD (Helios, ROCm, networking) para cargas Meta (Llama, sistemas de recomendação, IA generativa). A Meta submeteu o padrão OCP Open Rack Wide que o Helios segue.

Supermicro, HPE, Celestica, Nutanix: Ecossistema de Deploy

Por Que Helios Importa: A Mudança Para Rackscale Aberto

Por anos, a NVIDIA definiu o padrão de fato para infraestrutura de IA (DGX, HGX, NVLink, NVLink Switch). O Helios representa a primeira alternativa viável, de padrão aberto, em escala de rack completo:

Para CSPs, neoclouds, e soberanos que querem evitar dependência única, o Helios oferece uma arquitetura de referência completa, validada por OpenAI/Anthropic/Meta, com supply chain diversificado (Supermicro, HPE, Celestica, etc.).

O Fator ROCm: Software Como Diferencial

O histórico calcanhar de Aquiles da AMD foi software. Em 2026, o ROCm amadureceu significativamente:

Ainda não há paridade total com CUDA (ecossistema 15 anos mais maduro), mas para treinamento/inferência de larga escala com modelos abertos, a lacuna fechou o suficiente para adoção em produção.

Implicações Para o Mercado

1. Pressão Competitiva Sobre Preços

Com 30% mais tokens/$ reivindicado, o Helios força a NVIDIA a responder — seja no preço do NVL72, no roadmap Vera Rubin, ou no custo total de propriedade (power, cooling, rackspace).

2. Soberania e Diversificação de Supply Chain

Governo dos EUA (CHIPS Act), EU (EU Chips Act), e nações soberanas querem alternativas à NVIDIA. Helios + supply chain diversificado (Supermicro, HPE, Celestica, múltiplos foundries) = opção viável.

3. Padrão Aberto Como Moeda

O compromisso da AMD com OCP ORW, UALink, UEC, ROCm aberto atrai organizações que querem controlar seu destino de infraestrutura — não ficar refém de roadmap proprietário.

Conclusão

O AMD Helios não é "apenas mais um rack de GPUs" — é a primeira plataforma rackscale de padrão aberto, co-projetada com os maiores laboratórios de IA, entrando em produção em escala de gigawatt. Com 72 MI455X, HBM4, UALink, Ethernet 800G, e ROCm maduro, ele entrega o que o mercado pedia: alternativa viável, aberta, e economicamente superior para IA de fronteira.

Para CTOs, arquitetos de infraestrutura, e estrategistas de IA: o Helios merece evaliação séria no próximo ciclo de capex. A combinação OpenAI+Anthropic+Meta adotando, 30% tokens/$ vantagem, e stack aberto muda a conversa de "NVIDIA ou nada" para "qual mix otimizado para minha carga".

A era do rackscale proprietário único acabou. Bem-vindos à era do AI factory aberto, multi-vendor, co-projetado.

Referências

Sobre o Blog Wirebird

O Blog Wirebird é uma fonte confiável de conteúdo técnico sobre Inteligência Artificial, Cloud Computing, DevOps e transformação digital.