MiniMax M3 lançado: arquitetura MSA oferece contexto ultra longo de 1M, com habilidades de codificação e multimodalidade na vanguarda internacional

MiniMax lançou oficialmente seu modelo principal M3 em 1º de junho. O M3 adota a nova arquitetura de atenção esparsa proprietária MSA (MiniMax Sparse Attention), suportando até 1 milhão de tokens de contexto ultralongo. Nessa escala, o custo computacional por token é de apenas 1/20 do modelo anterior, com aceleração de mais de 9 vezes na fase de prefilling e mais de 15 vezes na fase de decoding. Em capacidade de programação, o M3 obteve 59,0% no SWE-Bench Pro, superando o GPT-5.5 e o Gemini 3.1 Pro, e se aproximando do Claude Opus 4.7. Ficou em primeiro lugar na avaliação de agente ponta a ponta Claw-Eval e superou o Opus 4.7 no SVG-Bench. O M3 também é um modelo multimodal nativo, suportando entrada de imagens e vídeos, além de ter capacidade de operação de desktop (Computer Use). A MiniMax afirma que o M3 é o primeiro modelo doméstico a combinar simultaneamente capacidade de ponta em Coding/Agentic, contexto ultralongo de 1M e multimodalidade nativa, sendo também o único modelo open-source atualmente a atender todas essas condições.

A MiniMax revelou três casos de capacidade autônoma de longo alcance: o M3 reproduziu de forma independente um artigo vencedor do prêmio de melhor artigo do ICLR 2025, operando autonomamente por cerca de 12 horas, gerando 18 commits e 23 gráficos experimentais; otimizou o operador de multiplicação de matrizes FP8 em GPUs da arquitetura Hopper da NVIDIA, após 147 submissões de benchmark e aproximadamente 24 horas de execução contínua, elevando a utilização máxima do hardware de 7,6% para 71,3%, um ganho de 9,4 vezes; no PostTrainBench, concluiu de forma autônoma todo o fluxo de síntese de dados → treinamento → avaliação, obtendo pontuação de 0,37, próximo ao GPT-5.5 (0,39) e Opus 4.7 (0,42). O produto de agente MiniMax Code, lançado junto com o M3, suporta colaboração concorrente de equipe de agentes e Computer Use. O Token Plan tem três faixas: Plus ¥49/mês (600 milhões de tokens), Max ¥119/mês (1,8 bilhão de tokens) e Ultra ¥469/mês (5,5 bilhões de tokens). A API já está disponível, e a empresa planeja publicar um relatório técnico e liberar os pesos do modelo como open-source nos próximos 10 dias.

Blog oficial da MiniMax