O ritmo que não para

A corrida pela inteligência artificial entre China e Estados Unidos entrou em uma nova marcha. De acordo com o Nikkei Asia, dez grandes desenvolvedores chineses — entre eles DeepSeek, Alibaba, Tencent e Xiaomi — lançaram 16 novos modelos de IA no mês de setembro, apenas em modelos de geração de imagem e áudio, sem contar versões modificadas de sistemas já existentes.

O anúncio vem em momento delicado: o CEO da Anthropic, Dario Amodei, publicou um apelo para que o setor desacelere o desenvolvimento de modelos de fronteira, citando riscos crescentes de segurança e uso malicioso. A resposta de Pequim foi clara: não há intenção de frear.

Dados que impressionam

O site de benchmarks BenchLM confirmou a tendência. Oito grandes desenvolvedores chineses rastreados pela plataforma publicaram 20 modelos de linguagem (LLMs) entre julho e setembro — um salto expressivo frente aos 2 modelos do primeiro trimestre e os 17 do segundo trimestre do ano.

Nos Estados Unidos, o ritmo também está acelerando: 59 modelos foram lançados entre janeiro e setembro, com 34 deles só no terceiro trimestre. Mesmo assim, a liderança em uso real está na China.

Uso real: o argumento que muda o jogo

Dados da plataforma OpenRouter mostram que, na semana de 21 a 27 de setembro, modelos chineses processaram 62,22 trilhões de tokens, contra 14,2 trilhões dos modelos americanos. Em números absolutos, isso é uma vantagem de mais de 4x.

Na semana de 28 de setembro a 4 de outubro, o cenário se manteve: DeepSeek V4.1 Flash liderou com 25,6 trilhões de tokens, seguido por GLM 5.3 Flash (Z.ai) com 9,73 trilhões, MiMo-V2.6-Flash (Xiaomi) com 9,63 trilhões e Hy4 preview (Tencent) com 6,51 trilhões.

O que os números mostram: empresas estão priorizando custo-benefício e capacidade para agentes de IA — não apenas métricas de desempenho bruto.

Por que isso importa para o Brasil

Para o mercado brasileiro e latino-americano, a onda de modelos chineses representa três mudanças concretas:

  1. Custo de inferência em queda acelerada — modelos com licença permissiva (MIT, Apache-2.0) permitem auto-hospedagem sem pagar por API.
  2. Capacidade agêntica de classe mundial — DeepSeek V4.1-Flash, com 552 bilhões de parâmetros MoE e contexto de 1 milhão de tokens, já alcança 90,6 no Terminal-Bench 2.1.
  3. Velocidade de iteração — o tempo entre o teste interno e o lançamento comercial encurtou significativamente, o que significa que ferramentas baseadas em IA chinesa vão chegar ao mercado global mais rápido.

O aviso da Anthropic

O Threat Intelligence Report da Anthropic de setembro de 2026 documentou casos reais de uso malicioso de modelos de IA por atores estatais, criminosos financeiros e indivíduos politicamente motivados entre dezembro de 2025 e agosto de 2026. O relatório destaca a detecção de campanhas de destilação ilícita — quando modelos de terceiros são usados para treinar sistemas concorrentes — e operações de espionagem cibernética.

O argumento da Anthropic é legítimo: modelos de fronteira sem salvaguardas adequadas podem ser usados para ciberataques, bioterrorismo e manipulação em larga escala. Mas a resposta chinesa é pragmática: o mercado global já escolheu custo e disponibilidade como critérios prioritários.

O que vem pela frente

Alibaba planeja expandir seu modelo Qwen de 240 bilhões de parâmetros para entre 500 bilhões e 1 trilhão no futuro. DeepSeek está construindo um data center em Mongólia Interior com pelo menos 160 mil chips Huawei Ascend-950DT, marcando um passo histórico na redução da dependência de GPUs NVIDIA.

A corrida está longe de terminar. E para quem constrói com IA, a mensagem é clara: os modelos chineses não são mais a alternativa barata — são a opção padrão em muitos cenários empresariais.

Fontes e referências

Eric
Eric

Editor responsável pela Gbyte News.

Mais deste colunista ↗

Encontrou uma informação que precisa de correção? Fale com a redação.