
Llama 4 Maverick — Benchmarky, schopnosti a případy použití
Llama 4 Maverick je open-weight AI model od společnosti Meta (17B/400B MoE (128 expertů)), zařazený do kategorie Established s kontextovým oknem 1M tokenů. Proz...
Llama 3.3 70B je osvědčený model AI, který je stále široce nasazován v produkčních systémech. Byl vyvinut společností Meta a vydán v prosinci 2024. Jako open-weight model jsou jeho natrénované váhy veřejně dostupné — můžete jej hostovat sami, dolaďovat na vlastních datech nebo provozovat na vlastní infrastruktuře bez závislosti na API. Podporuje kontextové okno o velikosti 128K tokenů, dostačující pro většinu dokumentů a vícekolové aplikace.
Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů, hodnocených na 4 benchmarkách. Výrazná skóre: 88,4 % na HumanEval (#1 z 2); 77,0 % na MATH-500 (#3 ze 4); 68,9 % na MMLU-Pro (#7 z 8).
Llama 3.3 70B byl vydán 6. prosince 2024 jako jeden z posledních modelů řady Llama 3 od společnosti Meta před architektonickým přechodem na Llama 4. Jako hustý (non-MoE) model se 70B parametry odrážel filozofii generace Llama 3 — přímočará škálovatelná architektura: více parametrů, lepší výsledky, transparentní struktura. Jeho kontextové okno 128K a silné výsledky v MMLU-Pro a SWE-bench z něj učinily přední self-hosted model pro týmy s dostatečnými GPU prostředky pro inferenci hustého 70B modelu, nikoli však pro systém MoE. Zůstává populární v regulovaných odvětvích — zdravotnictví, finance, právo — kde transparentnost a auditovatelnost husté architektury v kombinaci s dostupností open-weight záleží stejně jako samotný výkon.
Poznámka: Kvalita blížící se 405B za cenu 70B. Pouze text. IFEval 92,1 %.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 50.5% | 13 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 68.9% | 7 of 8 | SR | Hard knowledge reasoning, 12K questions |
| MATH-500 | 77.0% | 3 of 4 | SR | Hendrycks math (500 problems) |
| HumanEval pass@1 | 88.4% | 1 of 2 | SR | Python code generation (saturated at frontier) |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | Llama 3.3 70B | GPT-4o | Llama 4 Maverick |
|---|---|---|---|
| GPQA ◇ | 50.5% | 53.6% | 69.8% |
| MMLU-P | 68.9% | 72.6% | 80.5% |
| MATH | 77.0% | — | — |
| HumEval | 88.4% | — | — |
Meta Platforms (dříve Facebook) je jednou z největších technologických společností na světě se sídlem v Menlo Parku v Kalifornii, známá především díky Facebooku, Instagramu, WhatsAppu a Threads. Prostřednictvím Meta AI (dříve FAIR) se společnost stala nejplodnějším vydavatelem velkých jazykových modelů s otevřenými váhami v rámci rodiny Llama. Řada Llama 4 – Maverick, Scout a Behemoth – byla vydána pod liberálními komunitními licencemi a zůstává nejstahovanějšími modely s otevřenými váhami na platformách jako Hugging Face. AI strategie Meta je mezi velkými laboratořemi jedinečná: namísto provozování komerčního API uvolňuje Meta modely otevřeně pro výzkumné a komerční účely, integruje funkce generativní AI do svých vlastních aplikací a veřejně se zasazuje o uvolňování modelů s otevřenými váhami jako o nejdemokratičtější přístup k vývoji AI.
Případy použití
Llama 3.3 70B dosahuje 50 % na GPQA Diamond (#13 ze 14 modelů). Zvládá obecné vědecké dotazy na solidní úrovni, přičemž špičkové modely dosahují o 25+ procentních bodů vyšších skóre u nejobtížnějších postgraduálních problémů.
Llama 3.3 70B je open-weight (70B dense parametrů) — jeho natrénované váhy jsou veřejně dostupné ke stažení a samostatnému nasazení. Spouštějte jej na vlastním GPU hardwaru nebo privátním cloudu, zajistěte, že data nikdy neopustí vaše prostředí, eliminujte průběžné náklady za tokeny při škálování nebo model dolaďte na proprietárních datových sadách.
Více ke srovnání
Porovnejte všech 24 modelů napříč 11 benchmarky — řaditelné, s uvedením zdrojů, aktualizováno červen 2026.

Llama 4 Maverick je open-weight AI model od společnosti Meta (17B/400B MoE (128 expertů)), zařazený do kategorie Established s kontextovým oknem 1M tokenů. Proz...

Llama 4 Scout je open-weight model umělé inteligence od Meta (17B/109B MoE (16 expertů)), zařazený do kategorie Established s kontextovým oknem 10 milionů token...

Velký jazykový model Meta AI (LLaMA) je špičkový model pro zpracování přirozeného jazyka vyvinutý společností Meta. S až 65 miliardami parametrů vyniká LLaMA v ...