
Llama 4 Maverick — Benchmarky, schopnosti a prípady použitia
Llama 4 Maverick je open-weight AI model od spoločnosti Meta (17B/400B MoE (128 expertov)), zaradený do úrovne Established s kontextovým oknom 1M tokenov. Presk...
Llama 3.3 70B je overený AI model, ktorý je stále široko nasadený v produkčných systémoch. Vyvinula ho spoločnosť Meta a bol vydaný v decembri 2024. Ako open-weight model sú jeho natrénované váhy verejne dostupné — môžete si ho hostovať sami, jemne doladiť na vlastných dátach alebo ho spúšťať on-premise bez závislosti na API. Podporuje kontextové okno s veľkosťou 128K tokenov, dostatočné pre väčšinu dokumentov a viackolové aplikácie.
Na FlowHunt AI Leaderboard je jedným z 24 sledovaných modelov, vyhodnotených na 4 benchmarkoch. Výnimočné skóre: 88,4 % na HumanEval (#1 z 2); 77,0 % na MATH-500 (#3 zo 4); 68,9 % na MMLU-Pro (#7 z 8).
Llama 3.3 70B bol vydaný 6. decembra 2024 ako jeden z posledných modelov série Llama 3 od Meta pred architektonickým prechodom na Llama 4. Ako dense (non-MoE) model so 70B parametrami odrážal filozofiu generácie Llama 3 — priamočiara škálovateľná architektúra: viac parametrov, lepšie výsledky, transparentná štruktúra. Jeho 128K kontextové okno a silné skóre v MMLU-Pro a SWE-bench z neho urobili vedúci self-hostovaný model pre tímy s GPU zdrojmi dostatočnými pre dense 70B inferenciu, ale nie pre MoE systém. Stále je populárny v regulovaných odvetviach — zdravotníctvo, financie, právo — kde transparentnosť a auditovateľnosť dense architektúry v kombinácii s dostupnosťou open-weight vážia rovnako ako surový výkon.
Poznámka: Kvalita blížiaca sa 405B za cenu 70B. Iba text. IFEval 92,1 %.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 50.5% | 13 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 68.9% | 7 of 8 | SR | Hard knowledge reasoning, 12K questions |
| MATH-500 | 77.0% | 3 of 4 | SR | Hendrycks math (500 problems) |
| HumanEval pass@1 | 88.4% | 1 of 2 | SR | Python code generation (saturated at frontier) |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | Llama 3.3 70B | GPT-4o | Llama 4 Maverick |
|---|---|---|---|
| GPQA ◇ | 50.5% | 53.6% | 69.8% |
| MMLU-P | 68.9% | 72.6% | 80.5% |
| MATH | 77.0% | — | — |
| HumEval | 88.4% | — | — |
Meta Platforms (predtým Facebook) je jednou z najväčších technologických spoločností na svete so sídlom v Menlo Park v Kalifornii a je známa najmä vďaka Facebooku, Instagramu, WhatsApp a Threads. Prostredníctvom Meta AI (predtým FAIR) sa spoločnosť stala najplodnejším vydavateľom veľkých jazykových modelov s otvorenými váhami prostredníctvom rodiny Llama. Séria Llama 4 – Maverick, Scout a Behemoth – bola vydaná pod otvorenými komunitnými licenciami a zostáva najsťahovanejšími modelmi s otvorenými váhami na platformách ako Hugging Face. AI stratégia Meta je medzi veľkými laboratóriami výnimočná: namiesto prevádzkovania komerčného API Meta vydáva modely otvorene na výskumné a komerčné účely, integruje funkcie generatívnej AI do svojich vlastných aplikácií a verejne obhajuje vydávanie otvorených váh ako najdemokratickejší prístup k vývoju AI.
Prípady použitia
Llama 3.3 70B dosahuje 50 % na GPQA Diamond (#13 zo 14 modelov). Zvláda všeobecné vedecké otázky a odpovede na solídnej úrovni, pričom špičkové modely dosahujú o 25+ percentuálnych bodov vyššie skóre na najťažších problémoch na úrovni absolventa.
Llama 3.3 70B je open-weight (70B dense parametre) — jeho natrénované váhy sú verejne dostupné na stiahnutie a samostatné nasadenie. Spúšťajte ho na vlastnom GPU hardvéri alebo v súkromnom cloude, aby ste zaistili, že dáta nikdy neopustia vaše prostredie, eliminujte poplatky za API na základe tokenov vo veľkom rozsahu alebo jemne dolaďte model na vlastných dátových sadách.
Viac na porovnanie
Porovnajte všetkých 24 modelov naprieč 11 benchmarkmi — zoraditeľné, so zdrojmi, aktualizované jún 2026.

Llama 4 Maverick je open-weight AI model od spoločnosti Meta (17B/400B MoE (128 expertov)), zaradený do úrovne Established s kontextovým oknom 1M tokenov. Presk...

Llama 4 Scout je model AI s otvorenými váhami od spoločnosti Meta (17B/109B MoE (16 expertov)), zaradený do úrovne Established s kontextovým oknom 10 miliónov t...

Veľký jazykový model Meta AI (LLaMA) je špičkový model na spracovanie prirodzeného jazyka vyvinutý spoločnosťou Meta. S počtom parametrov až 65 miliárd vyniká L...