
Mistral Medium 3 — Benchmarks, Capacidades e Casos de Uso
O Mistral Medium 3 é um modelo de IA proprietário da Mistral, classificado como nível Avançado com janela de contexto de 128K tokens. Explore pontuações de benc...
O MiniMax M3 é um modelo de IA frontier de alto nível, desenvolvido pela MiniMax e lançado em junho de 2026. Como um modelo de pesos abertos, seus pesos treinados estão disponíveis publicamente — você pode auto-hospedá-lo, fazer fine-tuning com dados proprietários ou executá-lo localmente sem dependências de API. A janela de contexto de 1 milhão de tokens é grande o suficiente para armazenar bases de código inteiras, documentos técnicos extensos ou sessões agênticas prolongadas sem truncamento.
No FlowHunt AI Leaderboard, é um dos 24 modelos monitorados, avaliado em 2 benchmarks. Pontuações de destaque: 59,0% no SWE-bench Pro (#6 de 9); 66,0% no Terminal-Bench (#6 de 8).
O MiniMax M3 foi lançado em 1 de junho de 2026 como uma declaração deliberada: o primeiro modelo frontier de pesos abertos a igualar provedores de API fechados em comprimento de contexto (1 milhão de tokens) e incluir compreensão multimodal nativa. A MiniMax passou três anos desenvolvendo técnicas de extensão de contexto e infraestrutura de treinamento multimodal para tornar isso possível. O lançamento de pesos abertos do M3 criou uma nova categoria de modelo — de classe frontier, multimodal e totalmente auto-hospedável — que anteriormente não existia. O lançamento foi amplamente coberto nos círculos de pesquisa de IA como o momento em que os modelos de pesos abertos fecharam a última grande lacuna de capacidade com os modelos de API fechados.
Nota: Primeiro de pesos abertos: codificação frontier + 1M de contexto + multimodal nativo. Pesos pendentes.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Pro | 59.0% | 6 of 9 | SR | Multi-language, standardised scaffold |
| Terminal-Bench | 66.0% | 6 of 8 | SR | Agentic Linux terminal task completion |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | MiniMax M3 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-Pro | 59.0% | 69.2% | 64.3% |
| Terminal | 66.0% | 74.6% | 66.1% |
A MiniMax é uma startup chinesa de IA fundada em 2021 por Yan Junjie, que anteriormente liderou a investigação de visão computacional na SenseTime. A empresa é apoiada por grandes investidores chineses, incluindo a Hillhouse Capital, Yunqi Partners e Tencent. A MiniMax concentrou-se inicialmente em aplicações de IA voltadas para o consumidor — incluindo o chatbot Hailuo AI — antes de transitar para o desenvolvimento de modelos fundacionais. O lançamento do modelo M3 em junho de 2026 marcou a entrada da empresa no nível de fronteira: o primeiro modelo de pesos abertos a igualar os fornecedores de API fechados em comprimento de contexto (1 milhão de tokens), incluindo capacidades multimodais nativas. A MiniMax posiciona-se como o laboratório chinês de IA mais amigável para programadores, lançando pesos de modelos publicamente com licenças permissivas.
Casos de Uso
O MiniMax M3 alcança 66% no Terminal-Bench (#6 de 8 modelos), tornando-o competente para scripts de shell comuns, fluxos de trabalho de linha de comando e tarefas leves de administração de sistemas em pipelines agênticos.
O MiniMax M3 é de pesos abertos (MoE (não divulgado) parâmetros) — seus pesos treinados estão disponíveis publicamente para download e auto-implantação. Execute-o em seu próprio hardware GPU ou nuvem privada para garantir que os dados nunca saiam do seu ambiente, elimine custos de API por token em escala ou faça fine-tuning do modelo em conjuntos de dados proprietários.
Com uma janela de contexto de 1 milhão de tokens, o MiniMax M3 pode processar repositórios de software inteiros, contratos jurídicos extensos, relatórios de pesquisa do tamanho de livros ou históricos de conversas longos em um único prompt — permitindo Q&A profundo de documentos, raciocínio entre arquivos de código e sumarização abrangente sem heurísticas de chunking ou pipelines de RAG.
Mais para Comparar
Compare todos os 24 modelos em 11 benchmarks — classificáveis, com fontes e atualizados em junho de 2026.

O Mistral Medium 3 é um modelo de IA proprietário da Mistral, classificado como nível Avançado com janela de contexto de 128K tokens. Explore pontuações de benc...

O Qwen 3.7-Max é um modelo de IA proprietário da Alibaba, classificado como nível Frontier, com uma janela de contexto de 1 milhão de tokens. Está disponível di...

O Mistral Large 3 é um modelo de IA de pesos abertos da Mistral (41B/675B MoE), classificado como nível Avançado, com janela de contexto de 256K tokens. Está di...
Consentimento de Cookies
Usamos cookies para melhorar sua experiência de navegação e analisar nosso tráfego. See our privacy policy.