Resumo:
De acordo com os dados mais recentes do OpenRouter, o número total de chamadas globais de grandes modelos de IA na semana passada (31 de agosto a 6 de setembro) foi de 115 trilhões de tokens, um aumento mensal de 1,77%. Entre os grandes modelos de IA da lista, o volume de uso semanal dos grandes modelos de IA da China atingiu 56,72 trilhões de Tokens, um aumento mensal de 2,83%; durante o mesmo período, o volume de uso semanal de grandes modelos americanos de IA foi de 16,54 trilhões de tokens, uma redução mensal de 3,1%. O número de ligações semanais para grandes modelos na China ultrapassou o dos Estados Unidos por 19 semanas consecutivas, ocupando o primeiro lugar no mundo.


O "Daily Economic News" notou que na semana passada, entre as cinco principais chamadas globais, havia quatro grandes modelos chineses de IA. Entre eles, a pré-visualização do Tencent Hunyuan Hy4 ficou em primeiro lugar, com chamadas semanais atingindo 14,7 trilhões de tokens, um aumento mensal de 379%.
A pré-visualização do Hy4 foi lançada oficialmente e de código aberto em 28 de agosto, com um parâmetro total de 770B, um parâmetro de ativação de 49B e um comprimento de contexto superior a 1M. Ele se concentra na otimização de cenários de agente, codificação e produtividade para aprimorar a capacidade de concluir tarefas complexas em cenários reais de negócios.
Em 1º de setembro, a equipe Tencent Hunyuan anunciou o lançamento do modelo de versão leve de pré-visualização do Hy4, comprimindo o peso da pré-visualização do Hy4 de 1,5 TB para aproximadamente 214 GB, reduzindo ainda mais o limite de implantação local. Segundo relatos, a capacidade de compreensão de texto longo do modelo compactado é quase a mesma do modelo original, e as múltiplas rodadas de recuperação de contexto longo estão basicamente no mesmo nível da versão original.
GPT-5.6 Luna ficou em segundo lugar, com chamadas semanais atingindo 12,9 trilhões de Tokens, um aumento mensal de 66%; GLM-5.3 Flash subiu para o terceiro lugar, com um volume de chamadas semanais de 12,4 trilhões de Tokens, um aumento mensal de 101%; DeepSeek-V4-Flash-0731 (a versão oficial do DeepSeek-V4-Flash) ficou em quarto lugar, com um volume de chamadas semanais de 12,4 trilhões de Tokens; DeepSeek-V4-Flash-0423 (uma versão prévia do DeepSeek-V4-Flash) ficou em quinto lugar, com um volume de chamadas semanais de 5,19 trilhões de tokens.
Depois de quase um mês, o MiniMax M3 voltou à lista, ficando em sexto lugar, com ligações semanais atingindo 5,02 trilhões de Tokens, um aumento mensal de 95%. A MiniMax anunciou anteriormente que, de 24 de agosto a 6 de setembro, os desenvolvedores poderão usar modelos como o MiniMax M3 gratuitamente por meio do GMI Cloud e do OpenRouter.
MiniMax M3 foi lançado e de código aberto em junho deste ano. É o modelo carro-chefe do MiniMax para codificação, agentes e cenários multimodais nativos. O modelo conduz treinamento misto multimodal de texto, imagens e vídeos desde o estágio inicial do treinamento e oferece suporte a milhões de contextos em nível de token.
Além disso, na semana passada, a HUMAIN, uma empresa de inteligência artificial subordinada ao Fundo de Investimento Público Saudita (PIF), lançou o primeiro grande modelo árabe HUMAIN M3, que é baseado no MiniMax M3 para treinamento em língua árabe e capacidade de localização. Ao contrário do passado, os grandes modelos chineses entraram principalmente nos mercados internacionais através de APIs ou produtos de aplicação. Nesta cooperação, o MiniMax M3 tornou-se diretamente o modelo básico para o desenvolvimento de modelos locais no exterior.

Vale ressaltar que o Xiaomi MiMo-V2.5, que ficou em terceiro lugar na semana anterior, e o Gemini 3.7 Flash, que ficou em nono lugar, saíram da lista.
Comentários