
Llama 4 Scout — Benchmarki, Możliwości i Zastosowania
Llama 4 Scout to model AI o otwartych wagach od Meta (17B/109B MoE (16 ekspertów)), sklasyfikowany jako poziom Established z oknem kontekstowym 10 mln tokenów. ...
Llama 4 Maverick to sprawdzony model AI wciąż szeroko stosowany w systemach produkcyjnych, opracowany przez Meta i wydany w kwietniu 2025 roku. Jako model o otwartych wagach, jego wytrenowane wagi są publicznie dostępne — możesz go hostować samodzielnie, dostroić na własnych danych lub uruchomić lokalnie bez zależności od API. Okno kontekstowe o wielkości 1M tokenów jest wystarczająco duże, aby pomieścić całe bazy kodu, obszerne dokumenty techniczne lub rozszerzone sesje agencyjne bez konieczności przycinania.
Na tabeli liderów FlowHunt AI jest jednym z 24 śledzonych modeli, ocenianym w 3 benchmarkach. Wyróżniające się wyniki: 80,5% w MMLU-Pro (#4 z 8); 43,4% w LiveCodeBench (#4 z 5); 69,8% w GPQA Diamond (#11 z 14).
Llama 4 Maverick został wydany 5 kwietnia 2025 roku jako flagowy model Llama 4 od Meta. Maverick wprowadził natywną multimodalną architekturę mixture-of-experts — pierwszy model Llama zdolny do przetwarzania obrazów na poziomie wnioskowania — wykorzystując 17B aktywnych parametrów z puli 400B z 128 ekspertami. W momencie premiery był to najsilniejszy model o otwartych wagach w zadaniach rozumienia obrazu, umożliwiając powstanie pierwszej generacji agentów o otwartych wagach zdolnych do widzenia. Jego okno kontekstowe 1M i multimodalne możliwości uczyniły go modelem referencyjnym dla rozwoju aplikacji agencyjnych o otwartych wagach przez pierwszą połowę 2025 roku, zanim zamknięte modele poziomu Frontier zwiększyły swoją przewagę.
Uwaga: Najlepszy w swojej klasie multimodalny model o otwartych wagach w momencie premiery. Mieści się na pojedynczym hoście H100.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 69.8% | 11 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 80.5% | 4 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 43.4% | 4 of 5 | SR | Competitive programming, continuously updated |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | Llama 4 Maverick | GPT-4o | Llama 4 Scout |
|---|---|---|---|
| GPQA ◇ | 69.8% | 53.6% | — |
| MMLU-P | 80.5% | 72.6% | 52.2% |
| LiveCode | 43.4% | — | 32.8% |
Meta Platforms (dawniej Facebook) to jedna z największych firm technologicznych na świecie, z siedzibą w Menlo Park w Kalifornii, znana przede wszystkim z Facebooka, Instagrama, WhatsAppa i Threads. Dzięki Meta AI (dawniej FAIR) firma stała się najbardziej płodnym wydawcą modeli językowych o otwartych wagach za pośrednictwem rodziny Llama. Seria Llama 4 – Maverick, Scout i Behemoth – została wydana na liberalnych licencjach społecznościowych i pozostaje najczęściej pobieranymi modelami o otwartych wagach na platformach takich jak Hugging Face. Strategia AI Meta różni się od innych głównych laboratoriów: zamiast prowadzić komercyjne API, Meta udostępnia modele otwarcie do badań i użytku komercyjnego, integruje funkcje generatywnej AI we własnych aplikacjach i publicznie opowiada się za udostępnianiem otwartych wag jako najbardziej demokratycznym podejściem do rozwoju AI.
Zastosowania
Llama 4 Maverick osiąga 69% w GPQA Diamond (#11 z 14 modeli), czyli w okolicach lub powyżej średniej dla doktorantów-ekspertów. Radzi sobie z wymagającym wnioskowaniem naukowym, streszczaniem literatury badawczej i zadaniami wymagającymi dużej wiedzy w dyscyplinach STEM.
Llama 4 Maverick ma otwarte wagi (17B/400B MoE (128 ekspertów) parametrów) — jego wytrenowane wagi są publicznie dostępne do pobrania i samodzielnego wdrożenia. Uruchom go na własnym sprzęcie GPU lub w prywatnej chmurze, aby dane nigdy nie opuściły Twojego środowiska, wyeliminować koszty API za token przy większej skali lub dostroić model na własnych zbiorach danych.
Dzięki oknu kontekstowemu o wielkości 1M tokenów, Llama 4 Maverick może przetworzyć całe repozytoria oprogramowania, długie umowy prawne, raporty badawcze długości książki lub obszerne historie konwersacji w pojedynczym zapytaniu — umożliwiając dogłębne pytania i odpowiedzi dotyczące dokumentów, wnioskowanie w poprzek plików kodu oraz kompleksowe streszczanie bez konieczności dzielenia na fragmenty czy używania potoków RAG.
Więcej do porównania
Porównaj wszystkie 24 modele w 11 benchmarkach — sortowalne, ze źródłami i aktualizowane w czerwcu 2026.

Llama 4 Scout to model AI o otwartych wagach od Meta (17B/109B MoE (16 ekspertów)), sklasyfikowany jako poziom Established z oknem kontekstowym 10 mln tokenów. ...

Llama 3.3 70B to model AI o otwartych wagach od Meta (70B gęsty), sklasyfikowany jako poziom Established (Ugruntowany) z oknem kontekstowym 128K tokenów. Jest d...

MiniMax M3 to model AI o otwartych wagach od firmy MiniMax (MoE (nieujawnione)), sklasyfikowany jako poziom Frontier z oknem kontekstowym 1 miliona tokenów. Jes...
Zgoda na Pliki Cookie
Używamy plików cookie, aby poprawić jakość przeglądania i analizować nasz ruch. See our privacy policy.