Voltar ao Blog

Amazon e Qualcomm: Acordo de $60 Bilhões Para Silício Customizado de Inferência IA

A Amazon e a Qualcomm anunciaram uma parceria estratégica de US$ 60 bilhões para desenvolver silício customizado de inferência de IA, marcando uma das maiores parcerias de hardware para IA da história. O acordo, revelado em 8 de setembro e detalhado em filings SEC, inclui um warrant para 25 milhões de ações da Qualcomm a $161,26 por ação, com potencial de até US$ 60 bilhões em compras ao longo do termo do warrant (expirando em setembro 2036).

A parceria visa resolver o maior gargalo da IA atual: o custo e eficiência energética da inferência em escala massiva. Com o crescimento exponencial de agentes IA, RAG, e workloads de inferência contínua, a Amazon busca reduzir dependência de GPUs NVIDIA e ganhar controle total da stack de hardware para inferência.

Amazon Qualcomm 60B AI Inference Deal

Parceria Amazon-Qualcomm: $60B em silício customizado para inferência IA

Os Pilares da Parceria

1. Silício Customizado: CPUs C1000 e Aceleradores IA

A Qualcomm desenvolverá silício customizado para a Amazon focado em inferência memory-first:

Componente Especificação Disponibilidade
CPU C1000 Server CPU custom, arquitetura ARM Neoverse Produção H2 2028 (Meta usará em frota server 2028)
Aceleradores AI200/250/300 Inference accelerators, memory-first architecture Deploy imediato, escalando 2027
Chip Asimov (Gen 2) Custom silicon, multi-terabyte memory, Titan system Tapeout late 2026, produção H2 2027
Conectividade 800G e 1.6T optical connectivity Integrado nos aceleradores

2. Arquitetura Memory-First: LPDDR5X vs HBM

A abordagem memory-first da Qualcomm evita o gargalo de HBM (High Bandwidth Memory) + CoWoS que limita a NVIDIA:

O sistema Atlas (Gen 1) já está deployado em escala na Oracle Cloud Infrastructure (50+ racks). O Asimov (Gen 2) fará tapeout late 2026, produção H2 2027, alimentando o sistema Titan (4-8 chips Asimov, modelos >16T params, context window >10M tokens).

3. Warrant de $60B: Alinhamento Multi-Geracional

O warrant para 25 milhões de ações Qualcomm a $161,26/ação (prêmio sobre preço atual) vincula a Qualcomm a entregas multi-geracionais:

Matt Kimball (Moor Insights): "Hyperscalers don't typically commit to multiple generations for commodity parts. This multi-generational aspect is significant."

Meta: Primeiro Cliente Enterprise do C1000

A Meta será o primeiro cliente enterprise do C1000 CPU da Qualcomm, planejando deploy em sua frota de servidores de próxima geração H2 2028. A Meta também assinou acordo multi-geracional separado com a Qualcomm para data center CPUs.

A Qualcomm projeta mais de $15 bilhões em receita de data center até FY2029, com portfólio incluindo:

Liberty Global Tech Ventures: Investidor Estratégico

A Liberty Global Tech Ventures (braço de venture da Liberty Global) participou da rodada, juntando-se a portfolio que inclui Higgsfield, XBOW, Legora, ElevenLabs. Para a Liberty, a aposta é em inferência distribuída na edge — sua rede global de cabos/data centers pode hospedar inferência de baixa latência perto dos usuários finais usando hardware Qualcomm.

"A inferência distribuída na edge é o próximo frontier. A arquitetura memory-first da Positron permite deploy em nossa infraestrutura global sem retrofit de cooling ou power."

— Porta-voz Liberty Global

Contexto: A Guerra Da Inferência

A parceria Amazon-Qualcomm chega num momento crítico. A inferência está se tornando o maior custo de IA para empresas — estima-se que 80-90% do compute de IA em produção seja inferência. A dominância da NVIDIA em HBM/CoWoS cria single point of failure.

Outros players também atacam esse espaço:

A diferença da Qualcomm: arquitetura memory-first com commodity DRAM (LPDDR5X), não HBM. Evita gargalo CoWoS, permite deploy em infra padrão.

Conclusão

O acordo Amazon-Qualcomm de $60B sinaliza uma mudança estrutural na infraestrutura de IA: hyperscalers assumindo controle total da stack de inferência via silício customizado. Para a Qualcomm, é a entrada definitiva no data center. Para a Amazon, controle total da stack de inferência — do silício ao software.

Para CTOs planejando infraestrutura 2027-2030: a diversificação além de NVIDIA GPUs está acelerando. Opções como Qualcomm C1000/Asimov, AMD MI455X, AWS Trainium/Inferentia, Google TPU, e Positron Atlas criam um cenário multi-vendor pela primeira vez em anos.

O warrant multi-geracional ($60B até 2036) mostra que Amazon e Qualcomm estão apostando em parceria de décadas, não apenas contrato pontual. A inferência distribuída na edge (Liberty Global) e o silício customizado para workloads específicos (Meta C1000) são os próximos capítulos.

Principais Números do Acordo

Referências

Sobre o Blog Wirebird

O Blog Wirebird é uma fonte confiável de conteúdo técnico sobre Inteligência Artificial, Cloud Computing, DevOps e transformação digital.