
Claude Opus 4.6 — Vertailuarvot, Ominaisuudet ja Käyttötapaukset
Claude Opus 4.6 on Anthropicin kehittämä oma tekoälymalli, joka luokitellaan Frontier-tasolle ja jossa on 1 miljoonan tokenin konteksti-ikkuna. Se on saatavilla...
Claude Sonnet 4.6 on kehittynyt tekoälymalli, joka sopii vaativiin tuotantotyökuormiin. Sen on kehittänyt Anthropic ja se julkaistiin helmikuussa 2026. Se on suljetun painon omaava malli, joka on saatavilla Anthropic API:n kautta. 1 miljoonan tokenin konteksti-ikkuna on riittävän suuri käsittelemään kokonaisia koodikantoja, pitkiä teknisiä dokumentteja tai laajoja agenttisessioita ilman katkaisua.
FlowHunt AI Leaderboardilla se on yksi 24 seuratusta mallista, arvioituna 4 vertailuarvolla. Huomattavat pisteet: 89,0 % MATH-500:ssa (#2/4); 58,3 % ARC-AGI-2:ssa (#2/3); 79,6 % SWE-bench Verifiedissä (#8/13).
Claude Sonnet 4.6 julkaistiin 17. helmikuuta 2026 keskitasoisena mallina Claude 4 -sukupolvessa, sijoittuen Opus-sarjan ja Haiku-linjan väliin sekä ominaisuuksiltaan että hinnaltaan. Sonnet-taso on historiallisesti tarjonnut parhaan hinta-laatusuhteen Anthropicin valikoimassa — riittävän tehokas valtaosaan koodaus- ja päättelytehtävistä noin viidesosalla Opuksen hinnasta. Sonnet 4.6 sai 58,3 % ARC-AGI-2:ssa (riippumattomasti varmennettu ARC Prize Foundationin toimesta), mikä antoi sille toiseksi korkeimman pistemäärän maailmanlaajuisesti kyseisessä vertailuarvossa julkaisuhetkellä. Se tukee samaa 1 miljoonan tokenin konteksti-ikkunaa kuin Opus-mallit.
Huomautus: Parhaan luokkansa finanssiagentti (63,3 %) ja MCP-Atlas (61,3 %). Mukautuva ajattelu.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 79.6% | 8 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| Terminal-Bench | 59.1% | 8 of 8 | SR | Agentic Linux terminal task completion |
| MATH-500 | 89.0% | 2 of 4 | SR | Hendrycks math (500 problems) |
| ARC-AGI-2 | 58.3% | 2 of 3 | 3P | Novel visual reasoning, no memorisation |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Claude Sonnet 4.6 | GPT-4.1 | DeepSeek V4-Flash |
|---|---|---|---|
| SWE-V | 79.6% | 54.6% | 79.0% |
| Terminal | 59.1% | — | — |
| MATH | 89.0% | — | — |
| ARC-2 | 58.3% | — | — |
Anthropic on vuonna 2021 perustettu tekoälyturvallisuusyritys, jonka perustivat entiset OpenAI-tutkijat Dario Amodei ja Daniela Amodei yhdessä kollegoiden kanssa, jotka olivat johtaneet OpenAIN turvallisuus- ja politiikkatiimejä. Yrityksen julkilausuttu tavoite on tekoälyn vastuullinen kehittäminen ihmiskunnan pitkäaikaiseksi hyödyksi, ja sen tutkimusohjelma määräytyy tämän sitoumuksen perusteella: Constitutional AI (CAI) – menetelmä mallien kouluttamiseksi avuliaiksi, vaarattomiksi ja rehellisiksi itsekritiikin avulla; mekanistinen tulkittavuus, jonka tavoitteena on käänteissuunnitella, mitä yksittäiset neuronit ja piirit suurten verkkojen sisällä todellisuudessa laskevat; sekä skaalautumistiede, joka pyrkii ennustamaan, miten mallin käyttäytyminen muuttuu laskentatehon ja datan myötä. Anthropic julkaisee tämän tutkimuksen avoimesti ja on noussut yhdeksi eniten siteeratuista tekoälyturvallisuuslaboratorioista akateemisessa kirjallisuudessa. Claude on Anthropicin julkinen malliperhe – nimetty Claude Shannonin, informaatioteorian perustajan, mukaan – ja se kattaa neljä sukupolvea (1–4.x/Fable 5). Anthropic ylläpitää kaupallista APIa ja kuluttajille suunnattua Claude.ai-tuotetta sekä syviä pilviyhteistyökumppanuuksia AWS:n (Amazon Bedrock) ja Google Cloudin (Vertex AI) kanssa.
Käyttötapaukset
Claude Sonnet 4.6 saa 79 % SWE-bench Verified -testissä — sijoitettuna sijalle #8/13 tässä seuratuista malleista. Se ratkaisee oikeita GitHub-ongelmia, kirjoittaa tuotantolaatuista koodia useilla kielillä ja käsittelee monivaiheisia agenttisia koodaustyönkulkuja — vahva valinta tekoälyavusteisille ohjelmistokehitystiimeille.
Claude Sonnet 4.6 saavuttaa 59 % Terminal-Bench-testissä (#8/8 mallia), mikä tekee siitä pätevän komentosarjojen kirjoittamiseen, komentorivityönkulkujen käsittelyyn ja kevyisiin järjestelmänhallintatehtäviin agenttiputkistoissa.
1 miljoonan tokenin konteksti-ikkunalla Claude Sonnet 4.6 pystyy käsittelemään kokonaisia ohjelmistovarastoja, pitkiä oikeudellisia sopimuksia, kirjanpituisia tutkimusraportteja tai laajoja keskusteluhistorioita yhdellä kehotteella — mahdollistaen syvällisen dokumenttien kysely-vastaus-toiminnon, useita tiedostoja kattavan koodikantapäättelyn ja kattavan tiivistämisen ilman pilkkomisheuristiikkoja tai RAG-putkistoja.
Lisää vertailtavaa
Vertaa kaikkia 24 mallia 11 vertailuarvon yli — lajiteltava, lähdeviitteillä varustettu ja päivitetty kesäkuussa 2026.

Claude Opus 4.6 on Anthropicin kehittämä oma tekoälymalli, joka luokitellaan Frontier-tasolle ja jossa on 1 miljoonan tokenin konteksti-ikkuna. Se on saatavilla...

Claude Opus 4.7 on Anthropicin kehittämä oma tekoälymalli, joka luokitellaan Frontier-tasolle ja jossa on 1 miljoonan tokenin konteksti-ikkuna. Tutustu testitul...

Lue lisää Anthropicin Claude 3.5 Sonnet -mallista: miten se vertautuu muihin malleihin, sen vahvuudet, heikkoudet ja käyttökohteet esimerkiksi päättelyssä, kood...