
Mistral Medium 3 — Benchmarks, egenskaber og anvendelsesmuligheder
Mistral Medium 3 er en proprietær AI-model fra Mistral, klassificeret som Advanced-niveau med en kontekstvindue på 128K tokens. Udforsk benchmark-score, styrker...
MiniMax M3 er en top-klasse frontier AI-model, udviklet af MiniMax og udgivet i juni 2026. Som open-weight model er dens trænede vægte offentligt tilgængelige — du kan selv-host den, finjustere den på proprietære data eller køre den on-premise uden API-afhængigheder. Kontekstvinduet på 1M tokens er stort nok til at indeholde hele kodebaser, lange tekniske dokumenter eller udvidede agent-sessioner uden trunkering.
På FlowHunt AI Leaderboard er den en af 24 spores modeller, evalueret på tværs af 2 benchmarks. Fremtrædende resultater: 59,0% på SWE-bench Pro (#6 af 9); 66,0% på Terminal-Bench (#6 af 8).
MiniMax M3 blev udgivet den 1. juni 2026 som en bevidst erklæring: den første open-weight frontier-model, der matcher lukkede API-udbydere på kontekstlængde (1M tokens) og inkluderer indbygget multimodal forståelse. MiniMax havde brugt tre år på at udvikle kontekstudvidelsesteknikker og multimodal træningsinfrastruktur for at gøre dette muligt. M3’s open-weight-udgivelse skabte en ny kategori af model — frontier-klasse, multimodal og fuldt selv-hostbar — som tidligere ikke havde eksisteret. Udgivelsen blev bredt dækket i AI-forskningskredse som det øjeblik, hvor open-weight-modeller lukkede det sidste store kapabilitetsgab med lukkede API-modeller.
Bemærk: Første open-weight: frontier-kodning + 1M kontekst + indbygget multimodal. Vægte afventer.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Pro | 59.0% | 6 of 9 | SR | Multi-language, standardised scaffold |
| Terminal-Bench | 66.0% | 6 of 8 | SR | Agentic Linux terminal task completion |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | MiniMax M3 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-Pro | 59.0% | 69.2% | 64.3% |
| Terminal | 66.0% | 74.6% | 66.1% |
MiniMax er en kinesisk AI-startup grundlagt i 2021 af Yan Junjie, der tidligere ledede forskning i computersyn hos SenseTime. Virksomheden støttes af store kinesiske investorer, herunder Hillhouse Capital, Yunqi Partners og Tencent. MiniMax fokuserede oprindeligt på forbrugerrettede AI-applikationer — inklusive Hailuo AI-chatbotten — før det gik over til fundamentmodeludvikling. M3-modeludgivelsen i juni 2026 markerede virksomhedens indtræden i frontlinjen: den første åbne vægtmodel, der matchede lukkede API-udbydere på kontekstlængde (1M tokens) samtidig med at den inkluderede native multimodale egenskaber. MiniMax positionerer sig som det mest udviklervenlige kinesiske AI-laboratorium og udgiver modelvægte offentligt med tilladende licenser.
Anvendelsesmuligheder
MiniMax M3 opnår 66% på Terminal-Bench (#6 af 8 modeller), hvilket gør den kompetent til almindelige shell-scripts, kommandolinje-workflows og lette systemadministrationsopgaver i agent-pipelines.
MiniMax M3 er open-weight (MoE (ikke oplyst) parametre) — dens trænede vægte er offentligt tilgængelige til download og selv-implementering. Kør den på din egen GPU-hardware eller private cloud for at sikre, at data aldrig forlader dit miljø, eliminer API-omkostninger pr. token i stor skala, eller finjuster modellen på proprietære datasæt.
Med et kontekstvindue på 1M tokens kan MiniMax M3 indtage hele softwarearkiver, lange juridiske kontrakter, boglange forskningsrapporter eller omfattende samtalehistorikker i en enkelt prompt — hvilket muliggør dybdegående dokument-Q&A, tværfiltlig kodebaseræsonnering og omfattende opsummering uden chunking-heuristikker eller RAG-pipelines.
Mere at sammenligne
Sammenlign alle 24 modeller på tværs af 11 benchmarks — sorterbar, dokumenteret og opdateret juni 2026.

Mistral Medium 3 er en proprietær AI-model fra Mistral, klassificeret som Advanced-niveau med en kontekstvindue på 128K tokens. Udforsk benchmark-score, styrker...

Qwen 3.7-Max er en proprietær AI-model fra Alibaba, klassificeret som Frontier-niveau med en kontekstvindue på 1M tokens. Den er tilgængelig direkte i FlowHunt....

Mistral Large 3 er en open-weight AI-model fra Mistral (41B/675B MoE), klassificeret som Advanced-niveau med et kontekstvindue på 256K tokens. Den er tilgængeli...
Cookie Samtykke
Vi bruger cookies til at forbedre din browsingoplevelse og analysere vores trafik. See our privacy policy.