Alibaba lança o modelo fechado Qwen3.7-Max e aumenta os investimentos em computação para aprendizado por reforço

A equipe do Qwen da Alibaba lançou, em 20 de maio, o modelo flagship fechado Qwen3.7-Max, que obteve 56,6 pontos no índice de inteligência da Artificial Analysis e ficou em primeiro lugar entre os modelos chineses em diversos testes de referência, como código, matemática e tarefas com Agentes. No benchmark desafiador CritPt, o Qwen3.7-Max registrou um aumento de quase quatro vezes em relação à geração anterior, superando também o Gemini 3.5 Flash e o Claude Opus 4.6/4.7; além disso, obteve 92,3% de acerto no GPQA Diamond, 80,4% no SWE-bench Verified e 97,1% na prova matemática HMMT 2026. O modelo suporta uma janela de contexto de até 1 milhão de tokens; testes demonstraram que consegue operar continuamente por 35 horas e realizar mais de 1.100 chamadas a ferramentas, sendo ideal para cenários corporativos que demandam Agentes com fluxos de trabalho longos.

Chujie Zheng, membro da equipe do Qwen, afirmou no X que a capacidade computacional empregada na fase de treinamento por reforço (RL) do Qwen3.7-Max foi “muito superior a qualquer outra utilizada anteriormente”, destacando que esse é apenas o ponto de partida para a expansão dessa abordagem. Atualmente, o modelo está disponível por meio da API da plataforma Bailian, da Alibaba Cloud, sem previsão de tornar-se de código aberto. O lançamento coincidiu com a apresentação do chip de IA próprio da Alibaba, o Zhenwu M890, que conta com 144 GB de memória gráfica e largura de banda de interconexão entre chips de 800 GB/s.

X @teortaxestex | X @ChujieZheng