O ano em que a IA devia ficar mais barata
Se você fechou o orçamento de 2026 contando que rodar IA ia continuar ficando mais barato, abre a planilha de novo. No mesmo mês em que um fornecedor de modelo cortou 80% do preço numa ponta do catálogo, os quatro maiores compradores de infraestrutura de IA do planeta (Amazon, Alphabet, Microsoft e Meta) anunciaram capex combinado de US$ 725 bilhões para 2026. Em 2025 foram US$ 410 bilhões. Salto de 77% em um ano, segundo dados de resultados trimestrais compilados pelo Financial Times e reportados pela Yahoo Finance.
As duas coisas são verdade ao mesmo tempo. O preço por token caiu para quem usa a API certa. E o custo de construir a capacidade que gera esse token subiu com força.
A conta maior é de memória, não de GPU
Nas teleconferências de resultado, a explicação que as empresas deram não foi "a demanda cresceu, então compramos mais placa". Foi preço de componente. Amy Hood, CFO da Microsoft, atribuiu US$ 25 bilhões do capex de 2026 da empresa direto ao aumento no preço de memória e de outros componentes. Esse dinheiro não compra um servidor a mais. Paga o mesmo servidor mais caro.
O gargalo é de oferta. O preço de contrato de DRAM subiu cerca de 95% na comparação trimestral no primeiro trimestre de 2026, com projeção de mais 58% a 63% no trimestre seguinte, segundo a cobertura do Tom's Hardware. A Meta citou o mesmo fator, junto com disputa por energia, terreno e gente que sabe levantar datacenter.
| Empresa | Capex projetado para 2026 |
|---|---|
| Amazon | US$ 200 bi |
| Alphabet (Google) | US$ 175 a 185 bi |
| Microsoft | US$ 190 bi |
| Meta | US$ 115 a 135 bi |
Essa parte me incomoda por um motivo específico. A queda de preço que a IA vinha entregando desde 2023 nunca foi lei da física. Ela é resultado de fornecedor de modelo brigando por participação de mercado, e essa briga acontece em cima de uma infraestrutura cujo custo de construção está subindo por uma razão que não tem nada a ver com IA. O pente de memória que vai no seu notebook ficou mais caro para todo mundo.
Por que isso chega no seu orçamento, mesmo sem comprar GPU
Nenhuma empresa brasileira de médio porte compra cluster de GPU. Mas toda empresa que roda produto em cima de API de IA paga, por tabela, a conta de quem constrói a infraestrutura por baixo. Quando o custo de montar datacenter sobe 77% em um ano, o fornecedor de modelo escolhe: absorve na margem, repassa no preço, ou faz os dois em proporções diferentes dependendo do modelo. A terceira opção já está em curso. O modelo mais barato de um fornecedor caiu de preço enquanto o mais caro do mesmo catálogo ficou parado.
Apostar que 2027 repete a curva dos últimos dois anos é apostar contra o que as próprias fabricantes de infraestrutura estão dizendo em público, com CFO no telefone e analista ouvindo.
O preço por token caiu. O preço de construir a capacidade que gera aquele token, não.
O que muda na segunda de manhã
Se o seu modelo de unidade econômica para 2027 assume custo de IA caindo no ritmo dos últimos 24 meses, esse é o primeiro número a revisar. Depois dele:
- Não trave preço de produto em cima de projeção de queda no custo de modelo. Se o seu markup depende de a API ficar mais barata, o markup é frágil.
- Meça custo por chamada por modelo, e não custo médio. Um roteador simples, que manda tarefa fácil para o modelo barato e só escala para o caro quando precisa, evita pagar a conta da infraestrutura mais cara por engano.
E tem a parte que quase todo mundo só faz depois do susto: teto de gasto com alerta antes de escalar o uso. Um guardrail básico cabe em poucas linhas.
# exemplo ilustrativo, orçamento de IA por serviço
budget:
servico: atendimento-ia
teto_mensal_usd: 1200
alerta_em: 80% # avisa antes de estourar
acao_no_teto: bloquear_modelo_caro
fallback: modelo_economico
Esse tipo de guardrail entra no diagnóstico antes de qualquer linha de código na consultoria de software da Overflow. Decidir arquitetura sem contar com a volatilidade do custo de infraestrutura é decidir com metade da informação.
Fontes
- Google, Microsoft, Meta, and Amazon capex spending to hit $725 billion in 2026, up 77% from last year (Yahoo Finance, 2026)
- Skyrocketing component prices push Big Tech capex to record $725 billion. Microsoft alone attributes $25 billion of AI budget to increased memory and chip costs (Tom's Hardware, 2026)
- Microsoft's Capex Spending for 2026 Is 23% Higher Than What Analysts Were Expecting. The Problem Is Rising Memory Prices (Yahoo Finance, 2026)

