NOTAS DE QUEM CONSTRÓI · #002

O capex de IA bateu US$ 725 bilhões em 2026, e boa parte da conta é memória, não GPU

No mesmo mês em que um fornecedor de modelo cortou preço em 80%, os quatro maiores compradores de infraestrutura de IA anunciaram o maior aumento de capex da história, e a culpa é da memória RAM.

Welly4 MIN

O capex de IA bateu US$ 725 bilhões em 2026, e boa parte da conta é memória, não GPU

O ano em que a IA devia ficar mais barata

Se você fechou o orçamento de 2026 contando que rodar IA ia continuar ficando mais barato, abre a planilha de novo. No mesmo mês em que um fornecedor de modelo cortou 80% do preço numa ponta do catálogo, os quatro maiores compradores de infraestrutura de IA do planeta (Amazon, Alphabet, Microsoft e Meta) anunciaram capex combinado de US$ 725 bilhões para 2026. Em 2025 foram US$ 410 bilhões. Salto de 77% em um ano, segundo dados de resultados trimestrais compilados pelo Financial Times e reportados pela Yahoo Finance.

As duas coisas são verdade ao mesmo tempo. O preço por token caiu para quem usa a API certa. E o custo de construir a capacidade que gera esse token subiu com força.

A conta maior é de memória, não de GPU

Nas teleconferências de resultado, a explicação que as empresas deram não foi "a demanda cresceu, então compramos mais placa". Foi preço de componente. Amy Hood, CFO da Microsoft, atribuiu US$ 25 bilhões do capex de 2026 da empresa direto ao aumento no preço de memória e de outros componentes. Esse dinheiro não compra um servidor a mais. Paga o mesmo servidor mais caro.

O gargalo é de oferta. O preço de contrato de DRAM subiu cerca de 95% na comparação trimestral no primeiro trimestre de 2026, com projeção de mais 58% a 63% no trimestre seguinte, segundo a cobertura do Tom's Hardware. A Meta citou o mesmo fator, junto com disputa por energia, terreno e gente que sabe levantar datacenter.

EmpresaCapex projetado para 2026
AmazonUS$ 200 bi
Alphabet (Google)US$ 175 a 185 bi
MicrosoftUS$ 190 bi
MetaUS$ 115 a 135 bi

Essa parte me incomoda por um motivo específico. A queda de preço que a IA vinha entregando desde 2023 nunca foi lei da física. Ela é resultado de fornecedor de modelo brigando por participação de mercado, e essa briga acontece em cima de uma infraestrutura cujo custo de construção está subindo por uma razão que não tem nada a ver com IA. O pente de memória que vai no seu notebook ficou mais caro para todo mundo.

Por que isso chega no seu orçamento, mesmo sem comprar GPU

Nenhuma empresa brasileira de médio porte compra cluster de GPU. Mas toda empresa que roda produto em cima de API de IA paga, por tabela, a conta de quem constrói a infraestrutura por baixo. Quando o custo de montar datacenter sobe 77% em um ano, o fornecedor de modelo escolhe: absorve na margem, repassa no preço, ou faz os dois em proporções diferentes dependendo do modelo. A terceira opção já está em curso. O modelo mais barato de um fornecedor caiu de preço enquanto o mais caro do mesmo catálogo ficou parado.

Apostar que 2027 repete a curva dos últimos dois anos é apostar contra o que as próprias fabricantes de infraestrutura estão dizendo em público, com CFO no telefone e analista ouvindo.

O preço por token caiu. O preço de construir a capacidade que gera aquele token, não.

O que muda na segunda de manhã

Se o seu modelo de unidade econômica para 2027 assume custo de IA caindo no ritmo dos últimos 24 meses, esse é o primeiro número a revisar. Depois dele:

  1. Não trave preço de produto em cima de projeção de queda no custo de modelo. Se o seu markup depende de a API ficar mais barata, o markup é frágil.
  2. Meça custo por chamada por modelo, e não custo médio. Um roteador simples, que manda tarefa fácil para o modelo barato e só escala para o caro quando precisa, evita pagar a conta da infraestrutura mais cara por engano.

E tem a parte que quase todo mundo só faz depois do susto: teto de gasto com alerta antes de escalar o uso. Um guardrail básico cabe em poucas linhas.

# exemplo ilustrativo, orçamento de IA por serviço
budget:
  servico: atendimento-ia
  teto_mensal_usd: 1200
  alerta_em: 80%      # avisa antes de estourar
  acao_no_teto: bloquear_modelo_caro
  fallback: modelo_economico

Esse tipo de guardrail entra no diagnóstico antes de qualquer linha de código na consultoria de software da Overflow. Decidir arquitetura sem contar com a volatilidade do custo de infraestrutura é decidir com metade da informação.

Fontes

COMPARTILHARLINKEDINXWHATSAPP

// NEWSLETTER

O que a gente aprende, você recebe.

Bastidor de projeto, decisão técnica e o que estamos vendo em IA dentro das empresas. Sem enrolação e sem spam.

// PRÓXIMO PASSO

Tem um problema
parecido?