Sinais globais
A guerra de preços da IA na China durou uma semana
A China abriu uma guerra de preços de IA em agosto e recuou em apenas seis dias. Para quem opera IA no Brasil, o custo por token virou variável de risco.
Em uma semana de agosto, o custo de rodar IA na China subiu, caiu e mudou de modelo de negócio. No dia 1, a DeepSeek colocou no ar o V4 Flash com preço de categoria nano e capacidade muito acima disso. A demanda explodiu. No dia 3, a Alibaba respondeu com o Qwen3.8-Max, um modelo de 2,4 trilhões de parâmetros que ela pretende abrir. No dia 6, a própria DeepSeek anunciou aumento de preço e, nas palavras da imprensa que cobriu o setor, encerrou a guerra de preços que tinha começado. Quem opera IA em produção assistiu ao piso de custo do mercado balançar em tempo real.
O que aconteceu, dia a dia
A sequência importa porque mostra a velocidade. O V4 Flash da DeepSeek, versão 0731, saiu com input na casa de quatorze centavos de dólar por milhão de tokens, um preço que normalmente vem acompanhado de um modelo fraco. Só que a capacidade não era de nano. Foi essa combinação, barato e competente, que reescreveu o default de muito desenvolvedor da noite para o dia. A adoção veio rápido demais para o compute disponível.
Dois dias depois, a Alibaba anunciou o Qwen3.8-Max: arquitetura de mistura de especialistas com 2,4 trilhões de parâmetros totais, cerca de 95 bilhões ativos, janela de contexto de um milhão de tokens e entrada nativa de texto, imagem e vídeo. A Bloomberg reportou benchmarks que rivalizam com os modelos de ponta da Anthropic. E, pela primeira vez, a Alibaba sinalizou que vai abrir os pesos de um modelo da classe Max, disponibilizando o download em vez de só oferecer uma API.
No dia 6, o roteiro virou. A DeepSeek comunicou um aumento significativo de preço na API, revertendo parte do movimento que tinha feito cinco dias antes. A leitura da Semafor e de outros veículos foi direta: o preço de isca atraiu volume que a infraestrutura não deu conta de servir, e subir a tabela foi a forma de voltar a atender. A guerra que dominou as manchetes do setor durou seis dias.
Por que isso não é ruído
É tentador tratar essa gangorra como fofoca de provedor. Não é. O que ela revela é que o custo por token, a variável que muita gente trata como constante na hora de desenhar a arquitetura, virou uma das mais instáveis do sistema. Em uma semana, um provedor dobrou de preço, outro derrubou o dele e um terceiro transformou um modelo de fronteira em software que roda na sua máquina. Nenhuma planilha de custo de IA feita em julho sobreviveu intacta a agosto.
Há também um recado geopolítico embutido, que conversa com o que a China vem fazendo com modelos abertos como infraestrutura padrão e com a corrida da DeepSeek para ter chip próprio e driblar o controle americano. Abrir os pesos de um modelo grande não é generosidade, é estratégia de distribuição. Quanto mais gente construir sobre o Qwen ou sobre a família DeepSeek, mais esses modelos viram o padrão de fato, independentemente de qual API cobra o quê no mês seguinte. Preço baixo compra adoção, peso aberto compra permanência.
O que muda para quem opera IA no Brasil
A primeira lição é de arquitetura. Se o custo por token oscila desse jeito, amarrar o produto a um único provedor é assumir um risco que não precisa existir. A defesa é conhecida e barata: isolar o modelo atrás de uma camada própria, um roteador ou um gateway que troca de fornecedor sem reescrever o produto. Quem fez isso passou a semana ajustando uma variável de configuração. Quem embutiu o nome do provedor no código passou a semana reescrevendo integração.
A segunda lição é de custo unitário. Modelo chinês barato e capaz muda a conta de casos que antes não fechavam. Aquele fluxo de classificação em alto volume, aquele resumo rodado milhões de vezes, aquele agente que consome tokens sem parar: com input a centavos, a margem aparece. Vale reabrir a planilha dos casos que você tinha arquivado por serem caros demais. Alguns podem ter virado viáveis nesta semana, e podem deixar de ser na próxima, o que reforça a primeira lição.
A terceira lição é de disciplina. Preço de isca é isca. O aumento da DeepSeek no dia 6 mostra que a tabela de hoje não é promessa para amanhã. Adotar um provedor porque ele está barato nesta semana, sem medir o que acontece com a sua conta se o preço triplicar, é construir sobre areia. A pergunta certa não é qual é o mais barato agora, é o quanto o seu produto aguenta se o mais barato de agora dobrar de preço, como acabou de acontecer.
Peso aberto acrescenta uma quarta opção que o Brasil costuma ignorar: rodar o modelo dentro de casa. Não serve para todo caso, exige compute e time, mas para quem tem restrição de dado sensível ou volume que justifique o investimento, um Qwen3.8-Max aberto é uma base que não depende da política de preço de ninguém. É a diferença entre alugar e ter, com todos os custos e liberdades que isso implica.
No fim, a semana da guerra de preços chinesa é menos sobre a China e mais sobre a natureza do insumo. A IA em produção roda sobre um custo que se comporta como commodity volátil, não como tarifa estável. Quem trata o modelo como uma peça trocável, com preço monitorado e fornecedor intercambiável, opera com folga. Quem trata como decisão definitiva fica refém do próximo comunicado de um provedor do outro lado do mundo.
Se você quer desenhar sua arquitetura de IA para trocar de modelo sem reescrever o produto, e proteger a margem da volatilidade de preço, fale com a AI Boutique no WhatsApp. A gente ajuda a montar a camada que te deixa livre do fornecedor.
Fontes
- DeepSeek releases cheaper new AI model as China's price war intensifies
- Alibaba unveils biggest Qwen model as DeepSeek deepens China's AI price war
- Alibaba Adds to China AI Breakthroughs With New Qwen Model
- Alibaba Qwen Releases Qwen3.8-Max: A 2.4 Trillion Parameter MoE Model
- China turns up the heat with open model blitz as US model makers panic
Perguntas frequentes
Por que a DeepSeek aumentou o preço se estava ganhando a guerra?
O V4 Flash ficou barato demais para a capacidade que entregava e a demanda superou o compute disponível. Segundo a Semafor, o volume de uso obrigou a empresa a subir a tabela em 6 de agosto para conseguir servir. Preço de isca sem compute vira fila, não vantagem.
O que muda com o Qwen3.8-Max ter os pesos abertos?
É a primeira vez que a Alibaba promete abrir um modelo da classe Max. Se cumprir, um modelo de fronteira roda na sua infraestrutura, sem depender da API de ninguém. Para quem tem restrição de dado ou de custo, é uma base nova para construir.
Isso afeta quem usa modelos americanos no Brasil?
Sim, por tabela. A pressão de preço chinesa força os provedores americanos a responder e derruba o piso do mercado. O risco não é escolher lado, é depender de um único fornecedor num mês em que o preço variou três vezes.