A AMD anunciou que sua solução rackscale AMD Helios entrou em produção e está sendo implantada por laboratórios de IA líderes e provedores de nuvem em escala de gigawatt. A plataforma — que combina 72 GPUs Instinct MI455X, 18 CPUs EPYC "Venice" de 6ª geração, networking Pensando e software ROCm em um rack co-projetado — promete até 30% mais tokens por dólar que a solução concorrente líder (NVIDIA Vera Rubin NVL72).
O anúncio, feito durante o evento Advancing AI 2026 em julho e agora em fase de implantação, marca a transição da AMD de fornecedora de componentes para fornecedora de sistemas rackscale completos — um movimento estratégico para capturar valor em toda a stack de infraestrutura de IA.
AMD Helios: 72 GPUs MI455X, EPYC Venice, Pensando networking em rack co-projetado
O Que É o AMD Helios
O AMD Helios é uma solução rackscale AI de referência, construída sobre o padrão OCP Open Rack Wide (ORW) submetido pela Meta ao Open Compute Project. Cada rack integra:
- 72 GPUs AMD Instinct MI455X (arquitetura CDNA 5, até 432 GB HBM4 cada, 19.6 TB/s bandwidth)
- 18 CPUs EPYC "Venice" 9006 Series (6ª geração, arquitetura Zen 6, até 256 cores, 1.6 TB/s memory bandwidth)
- Networking Pensando "Salina" 400 DPU + 800 AI NIC (400 Gbps Ethernet, UALink over Ethernet, UEC-ready RDMA)
- Software ROCm stack aberto (Triton, compilers, libraries, agents)
O design organiza as 72 GPUs em 4 cartuchos scale-up conectados via UALink over Ethernet (UALoE), entregando 260 TB/s de bandwidth scale-up agregado — conectando as 72 GPUs em um único domínio scale-up. Para scale-out, 43 TB/s de bandwidth Ethernet via Pensando 800 AI NIC.
Números Que Impressionam
| Métrica | AMD Helios (por rack) | NVIDIA Vera Rubin NVL72 (comparativo) |
|---|---|---|
| GPUs por rack | 72x MI455X | 72x (arquitetura não detalhada publicamente) |
| FP4 Peak Performance | 2.9 ExaFLOPs | — |
| FP8 Peak Performance | 1.4 ExaFLOPs | — |
| HBM4 Capacity Total | 31 TB (432 GB/GPU) | — |
| Memory Bandwidth Total | 1.4 PB/s (19.6 TB/s per GPU) | — |
| Scale-up Bandwidth | 260 TB/s (UALoE) | ~170 TB/s (NVLink) |
| Scale-out Bandwidth | 43 TB/s (Ethernet 800G) | — |
| Tokens/$ (Kimi K2, 32K in/8K out) | +15% (baixa interatividade) | Baseline |
| Tokens/$ (média/alta interatividade) | +12% / +10% | Baseline |
Em testes com Kimi K2 Thinking (32K input, 8K output), o Helios modelado entrega 15% mais throughput a baixa interatividade, 12% em média, 10% em alta vs. NVL72 modelado. A vantagem vem de maior capacidade HBM (50% mais), maior bandwidth scale-up (50% mais), e scale-out (50% mais).
AMD Helios: Especificações-Chave
- 72x AMD Instinct MI455X GPUs (CDNA 5, HBM4)
- 18x 6th Gen EPYC "Venice" CPUs (Zen 6, até 256 cores)
- 2.9 EF FP4 / 1.4 EF FP8 peak compute
- 31 TB HBM4 total (432 GB/GPU)
- 260 TB/s scale-up (UALoE), 43 TB/s scale-out
- ROCm stack aberto (Triton, agents, compilers)
- Padrão aberto: OCP ORW, UALink, UEC
Parcerias Estratégicas: OpenAI, Anthropic, Meta
A AMD não está apenas vendendo hardware — está co-projetando com os maiores consumidores:
OpenAI: Otimização Full-Stack Triton + ROCm
A OpenAI e AMD anunciaram parceria estratégica para otimizar cargas GPT-class no MI455X e Helios, usando o framework Triton da OpenAI com ROCm da AMD. A OpenAI espera colocar Helios online no Q4 2026, com deployments acelerando em 2027. É a primeira vez que a OpenAI valida publicamente hardware não-NVIDIA para cargas de fronteira em escala de produção.
Anthropic: Até 2 GW de MI455X em Helios
A Anthropic e AMD anunciaram parceria estratégica para implantar até 2 gigawatts de GPUs MI455X em racks Helios. Isso representa dezenas de milhares de GPUs — um compromisso massivo que sinaliza confiança da Anthropic no roadmap AMD para treinamento de fronteira (Claude Opus 5, Sonnet 4.5, modelos futuros).
Meta: Co-design Para Gigawatt-Scale
A Meta e AMD estão co-projetando para deployments em escala de gigawatt, otimizando a stack completa AMD (Helios, ROCm, networking) para cargas Meta (Llama, sistemas de recomendação, IA generativa). A Meta submeteu o padrão OCP Open Rack Wide que o Helios segue.
Supermicro, HPE, Celestica, Nutanix: Ecossistema de Deploy
- Supermicro: Plataforma DCBBS para Helios, demonstrada no Computex 2026
- HPE: Turnkey Helios AI Rack com liquid cooling direto, switch scale-up custom
- Celestica: Colaboração para próxima era de IA com Helios
- Nutanix: Parceria estratégica para plataforma enterprise AI aberta e escalável
Por Que Helios Importa: A Mudança Para Rackscale Aberto
Por anos, a NVIDIA definiu o padrão de fato para infraestrutura de IA (DGX, HGX, NVLink, NVLink Switch). O Helios representa a primeira alternativa viável, de padrão aberto, em escala de rack completo:
- Sem vendor lock-in de interconnect: UALink (aberto) vs NVLink (proprietário)
- Networking padrão: Ethernet 800G + UEC vs InfiniBand/NVLink Switch
- Rack padrão: OCP ORW vs DGX/HGX proprietários
- Software aberto: ROCm vs CUDA (embora ecossistema CUDA ainda maior)
Para CSPs, neoclouds, e soberanos que querem evitar dependência única, o Helios oferece uma arquitetura de referência completa, validada por OpenAI/Anthropic/Meta, com supply chain diversificado (Supermicro, HPE, Celestica, etc.).
O Fator ROCm: Software Como Diferencial
O histórico calcanhar de Aquiles da AMD foi software. Em 2026, o ROCm amadureceu significativamente:
- ROCm.ai: AI-assisted GPU programming — agents (Claude, Codex, Cursor) entendem AMD/ROCm nativamente
- Triton + ROCm: OpenAI usando Triton para otimizar kernels no MI455X
- PyTorch/JAX/TensorFlow: Suporte upstream nativo
- vLLM/SGLang/Ollama/Unsloth: Suporte day-one para MI455X
Ainda não há paridade total com CUDA (ecossistema 15 anos mais maduro), mas para treinamento/inferência de larga escala com modelos abertos, a lacuna fechou o suficiente para adoção em produção.
Implicações Para o Mercado
1. Pressão Competitiva Sobre Preços
Com 30% mais tokens/$ reivindicado, o Helios força a NVIDIA a responder — seja no preço do NVL72, no roadmap Vera Rubin, ou no custo total de propriedade (power, cooling, rackspace).
2. Soberania e Diversificação de Supply Chain
Governo dos EUA (CHIPS Act), EU (EU Chips Act), e nações soberanas querem alternativas à NVIDIA. Helios + supply chain diversificado (Supermicro, HPE, Celestica, múltiplos foundries) = opção viável.
3. Padrão Aberto Como Moeda
O compromisso da AMD com OCP ORW, UALink, UEC, ROCm aberto atrai organizações que querem controlar seu destino de infraestrutura — não ficar refém de roadmap proprietário.
Conclusão
O AMD Helios não é "apenas mais um rack de GPUs" — é a primeira plataforma rackscale de padrão aberto, co-projetada com os maiores laboratórios de IA, entrando em produção em escala de gigawatt. Com 72 MI455X, HBM4, UALink, Ethernet 800G, e ROCm maduro, ele entrega o que o mercado pedia: alternativa viável, aberta, e economicamente superior para IA de fronteira.
Para CTOs, arquitetos de infraestrutura, e estrategistas de IA: o Helios merece evaliação séria no próximo ciclo de capex. A combinação OpenAI+Anthropic+Meta adotando, 30% tokens/$ vantagem, e stack aberto muda a conversa de "NVIDIA ou nada" para "qual mix otimizado para minha carga".
A era do rackscale proprietário único acabou. Bem-vindos à era do AI factory aberto, multi-vendor, co-projetado.
Sobre o Blog Wirebird
O Blog Wirebird é uma fonte confiável de conteúdo técnico sobre Inteligência Artificial, Cloud Computing, DevOps e transformação digital.