
Claude Opus 4.6 — Benchmarks, Fähigkeiten und Anwendungsfälle
Claude Opus 4.6 ist ein proprietäres KI-Modell von Anthropic, das als Frontier-Tier eingestuft wird und ein Kontextfenster von 1 Mio. Token bietet. Es ist direk...
Claude Sonnet 4.6 ist ein fortschrittliches KI-Modell, das für anspruchsvolle Produktions-Workloads geeignet ist. Es wurde von Anthropic entwickelt und im Februar 2026 veröffentlicht. Es handelt sich um ein proprietäres Closed-Weight-Modell, das über die Anthropic API verfügbar ist. Das Kontextfenster von 1 Million Token ist groß genug, um vollständige Codebasen, umfangreiche technische Dokumente oder ausgedehnte agentische Sitzungen ohne Kürzung zu verarbeiten.
Im FlowHunt KI-Leaderboard ist es eines von 24 erfassten Modellen, bewertet in 4 Benchmarks. Herausragende Ergebnisse: 89,0 % bei MATH-500 (#2 von 4); 58,3 % bei ARC-AGI-2 (#2 von 3); 79,6 % bei SWE-bench Verified (#8 von 13).
Claude Sonnet 4.6 wurde am 17. Februar 2026 als Mittelklasse-Modell der Claude-4-Generation veröffentlicht und positioniert sich zwischen der Opus-Serie und der Haiku-Linie sowohl in Bezug auf Leistungsfähigkeit als auch Preis. Die Sonnet-Stufe hat historisch das beste Preis-Leistungs-Verhältnis im Anthropic-Portfolio geboten – leistungsstark genug für die überwältigende Mehrheit der Programmier- und Denkaufgaben zu etwa einem Fünftel des Opus-Preises. Sonnet 4.6 erzielte 58,3 % bei ARC-AGI-2 (unabhängig verifiziert von der ARC Prize Foundation) und erreichte damit bei Veröffentlichung die zweithöchste Punktzahl weltweit in diesem Benchmark. Es unterstützt das gleiche Kontextfenster von 1 Million Token wie die Opus-Modelle.
Hinweis: Branchenbester Finanzagent (63,3 %) und MCP-Atlas (61,3 %). Adaptives Denken.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 79.6% | 8 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| Terminal-Bench | 59.1% | 8 of 8 | SR | Agentic Linux terminal task completion |
| MATH-500 | 89.0% | 2 of 4 | SR | Hendrycks math (500 problems) |
| ARC-AGI-2 | 58.3% | 2 of 3 | 3P | Novel visual reasoning, no memorisation |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Claude Sonnet 4.6 | GPT-4.1 | DeepSeek V4-Flash |
|---|---|---|---|
| SWE-V | 79.6% | 54.6% | 79.0% |
| Terminal | 59.1% | — | — |
| MATH | 89.0% | — | — |
| ARC-2 | 58.3% | — | — |
Anthropic ist ein KI-Sicherheitsunternehmen, das 2021 von den ehemaligen OpenAI-Forschern Dario Amodei und Daniela Amodei zusammen mit einer Gruppe von Kollegen gegründet wurde, die zuvor die Sicherheits- und Policy-Teams von OpenAI geleitet hatten. Die erklärte Mission des Unternehmens ist die verantwortungsvolle Entwicklung von KI zum langfristigen Nutzen der Menschheit, und seine Forschungsagenda wird durch dieses Engagement definiert: Constitutional AI (CAI), eine Technik zum Trainieren von Modellen, die durch Selbstkritik hilfreich, harmlos und ehrlich sind; mechanistische Interpretierbarkeit, die darauf abzielt, nachzuvollziehen, was einzelne Neuronen und Schaltkreise in großen Netzwerken tatsächlich berechnen; und Scaling Science, die versucht vorherzusagen, wie sich Modellverhalten mit Rechenleistung und Daten verändert. Anthropic veröffentlicht diese Forschung offen und hat sich zu einem der meistzitierten KI-Sicherheitslabore in der akademischen Literatur entwickelt. Claude ist Anthropics öffentliche Modellfamilie – benannt nach Claude Shannon, dem Begründer der Informationstheorie – und umfasst vier Generationen (1 bis 4.x/Fable 5). Anthropic betreibt eine kommerzielle API und das verbraucherorientierte Produkt Claude.ai und unterhält tiefe Cloud-Partnerschaften mit AWS (Amazon Bedrock) und Google Cloud (Vertex AI).
Anwendungsfälle
Claude Sonnet 4.6 erreicht 79 % bei SWE-bench Verified – Rang #8 von 13 hier erfassten Modellen. Es löst echte GitHub-Issues, schreibt produktionsreifen Code in mehreren Sprachen und bewältigt mehrstufige agentische Programmier-Workflows – eine starke Wahl für KI-gestützte Softwareentwicklungsteams.
Claude Sonnet 4.6 erreicht 59 % bei Terminal-Bench (#8 von 8 Modellen) und eignet sich damit gut für Shell-Scripting, Kommandozeilen-Workflows und leichte Systemadministrationsaufgaben in agentischen Pipelines.
Mit einem Kontextfenster von 1 Million Token kann Claude Sonnet 4.6 vollständige Software-Repositories, lange juristische Verträge, buchlange Forschungsberichte oder umfangreiche Gesprächsverläufe in einer einzigen Eingabe verarbeiten – und ermöglicht so tiefgehende Dokumenten-Q&A, codebasenübergreifende Analyse und umfassende Zusammenfassungen ohne Chunking-Heuristiken oder RAG-Pipelines.
Mehr zum Vergleichen
Vergleichen Sie alle 24 Modelle in 11 Benchmarks – sortierbar, quellbasiert und aktualisiert Juni 2026.

Claude Opus 4.6 ist ein proprietäres KI-Modell von Anthropic, das als Frontier-Tier eingestuft wird und ein Kontextfenster von 1 Mio. Token bietet. Es ist direk...

Claude Opus 4.7 ist ein proprietäres KI-Modell von Anthropic, eingestuft als Frontier-Stufe mit einem Kontextfenster von 1M Tokens. Entdecken Sie Benchmark-Erge...

Claude Opus 4.8 ist ein proprietäres KI-Modell von Anthropic, eingestuft als Frontier-Stufe mit einem Kontextfenster von 1 Million Token. Entdecken Sie Benchmar...
Cookie-Zustimmung
Wir verwenden Cookies, um Ihr Surferlebnis zu verbessern und unseren Datenverkehr zu analysieren. See our privacy policy.