
Mistral Medium 3 — Benchmarks, Fähigkeiten und Anwendungsfälle
Mistral Medium 3 ist ein proprietäres KI-Modell von Mistral, eingestuft in die Kategorie Advanced mit einem Kontextfenster von 128K Token. Entdecken Sie Benchma...
MiniMax M3 ist ein erstklassiges Frontier-KI-Modell, entwickelt von MiniMax und veröffentlicht im Juni 2026. Als Open-Weight-Modell sind seine trainierten Gewichte öffentlich verfügbar – Sie können es selbst hosten, auf proprietären Daten feintunen oder vor Ort ohne API-Abhängigkeiten betreiben. Das Kontextfenster von 1 Million Token ist groß genug, um gesamte Codebasen, umfangreiche technische Dokumente oder ausgedehnte Agentiksitzungen ohne Kürzung aufzunehmen.
Auf der FlowHunt KI-Rangliste ist es eines von 24 verfolgten Modellen, bewertet in 2 Benchmarks. Herausragende Ergebnisse: 59,0 % bei SWE-bench Pro (#6 von 9); 66,0 % bei Terminal-Bench (#6 von 8).
MiniMax M3 wurde am 1. Juni 2026 als bewusstes Statement veröffentlicht: das erste Open-Weight-Frontier-Modell, das geschlossene API-Anbieter bei der Kontextlänge (1 Mio. Token) erreicht und nativ multimodales Verständnis bietet. MiniMax hatte drei Jahre lang Kontexterweiterungstechniken und multimodale Trainingsinfrastruktur entwickelt, um dies zu ermöglichen. Die Open-Weight-Veröffentlichung von M3 schuf eine neue Modellkategorie – Frontier-Klasse, multimodal und vollständig selbst hostbar – die es zuvor nicht gab. Die Veröffentlichung wurde in KI-Forschungskreisen weithin als der Moment diskutiert, in dem Open-Weight-Modelle die letzte große Fähigkeitslücke zu geschlossenen API-Modellen schlossen.
Hinweis: Erstes Open-Weight: Frontier-Coding + 1M Kontext + natives multimodales. Gewichte ausstehend.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Pro | 59.0% | 6 of 9 | SR | Multi-language, standardised scaffold |
| Terminal-Bench | 66.0% | 6 of 8 | SR | Agentic Linux terminal task completion |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | MiniMax M3 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-Pro | 59.0% | 69.2% | 64.3% |
| Terminal | 66.0% | 74.6% | 66.1% |
MiniMax ist ein chinesisches KI-Startup, das 2021 von Yan Junjie gegründet wurde, der zuvor die Forschung im Bereich Computer Vision bei SenseTime leitete. Das Unternehmen wird von großen chinesischen Investoren unterstützt, darunter Hillhouse Capital, Yunqi Partners und Tencent. MiniMax konzentrierte sich zunächst auf verbraucherorientierte KI-Anwendungen – darunter den Hailuo-AI-Chatbot – bevor es zur Entwicklung von Foundation-Modellen überging. Die Veröffentlichung des M3-Modells im Juni 2026 markierte den Einstieg des Unternehmens in die Spitzenklasse: das erste Open-Weight-Modell, das mit geschlossenen API-Anbietern bei der Kontextlänge (1 M Token) mithalten konnte und gleichzeitig native multimodale Fähigkeiten bot. MiniMax positioniert sich als das entwicklerfreundlichste chinesische KI-Labor und veröffentlicht Modellgewichte öffentlich unter großzügigen Lizenzen.
Anwendungsfälle
MiniMax M3 erreicht 66 % beim Terminal-Bench (#6 von 8 Modellen) und eignet sich daher für allgemeine Shell-Scripting-, CLI-Workflows und leichte Systemadministrationsaufgaben in agentischen Pipelines.
MiniMax M3 ist Open-Weight (MoE (nicht offengelegt) Parameter) – seine trainierten Gewichte sind öffentlich zum Herunterladen und zur Selbstbereitstellung verfügbar. Führen Sie es auf Ihrer eigenen GPU-Hardware oder in Ihrer privaten Cloud aus, um sicherzustellen, dass Daten Ihre Umgebung nie verlassen, eliminieren Sie nutzungsabhängige API-Kosten im großen Maßstab oder feintunen Sie das Modell auf proprietären Datensätzen.
Mit einem Kontextfenster von 1 Million Token kann MiniMax M3 gesamte Software-Repositories, lange rechtliche Verträge, buchlange Forschungsberichte oder umfangreiche Gesprächsverläufe in einer einzigen Eingabe aufnehmen – und ermöglicht so tiefgehende Dokumenten-Q&A, codebase-übergreifende Analyse und umfassende Zusammenfassungen ohne Heuristiken oder RAG-Pipelines.
Weitere Vergleiche
Vergleichen Sie alle 24 Modelle in 11 Benchmarks – sortierbar, bequellt und aktualisiert Juni 2026.

Mistral Medium 3 ist ein proprietäres KI-Modell von Mistral, eingestuft in die Kategorie Advanced mit einem Kontextfenster von 128K Token. Entdecken Sie Benchma...

Qwen 3.7-Max ist ein proprietäres KI-Modell von Alibaba, eingestuft als Frontier-Tier mit einem Kontextfenster von 1 Mio. Tokens. Es ist direkt in FlowHunt verf...

Mistral Large 3 ist ein Open-Weight-KI-Modell von Mistral (41B/675B MoE), eingestuft in die Kategorie „Advanced" mit einem Kontextfenster von 256K Token. Es ist...
Cookie-Zustimmung
Wir verwenden Cookies, um Ihr Surferlebnis zu verbessern und unseren Datenverkehr zu analysieren. See our privacy policy.