
Llama 4 Scout — Benchmarks, mogelijkheden en gebruiksscenario's
Llama 4 Scout is een open-weight AI-model van Meta (17B/109B MoE (16 experts)), geclassificeerd als Established-tier met een contextvenster van 10M tokens. Het ...
Llama 4 Maverick is een bewezen AI-model dat nog steeds breed wordt ingezet in productiesystemen, ontwikkeld door Meta en uitgebracht in april 2025. Als open-weight model zijn de getrainde gewichten openbaar beschikbaar — u kunt het zelf hosten, fine-tunen op eigen data, of on-premise draaien zonder API-afhankelijkheden. Het contextvenster van 1M tokens is groot genoeg om volledige codebases, langdurige technische documenten of uitgebreide agentsessies zonder afkapping te verwerken.
Op het FlowHunt AI Leaderboard is het een van de 24 gevolgde modellen, geëvalueerd op 3 benchmarks. Opvallende scores: 80,5% op MMLU-Pro (#4 van 8); 43,4% op LiveCodeBench (#4 van 5); 69,8% op GPQA Diamond (#11 van 14).
Llama 4 Maverick werd uitgebracht op 5 april 2025 als Meta’s vlaggenschip Llama 4-model. Maverick introduceerde een native multimodale mixture-of-experts-architectuur — het eerste Llama-model dat afbeeldingen op redeneerniveau kan verwerken — met 17B actieve parameters uit een pool van 400B met 128 experts. Bij lancering was het het sterkste open-weight model voor visuele begripstaken, wat de eerste generatie visueel-capabele open-weight agenten mogelijk maakte. Het contextvenster van 1M tokens en de multimodale mogelijkheid maakten het tot het referentiemodel voor de ontwikkeling van open-weight agentische toepassingen in de eerste helft van 2025, voordat de Frontier-modellen met gesloten gewichten hun voorsprong uitbreidden.
Opmerking: Best-in-class multimodaal open-weight bij lancering. Past op een enkele H100-host.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 69.8% | 11 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 80.5% | 4 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 43.4% | 4 of 5 | SR | Competitive programming, continuously updated |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | Llama 4 Maverick | GPT-4o | Llama 4 Scout |
|---|---|---|---|
| GPQA ◇ | 69.8% | 53.6% | — |
| MMLU-P | 80.5% | 72.6% | 52.2% |
| LiveCode | 43.4% | — | 32.8% |
Meta Platforms (voorheen Facebook) is een van de grootste technologiebedrijven ter wereld, gevestigd in Menlo Park, Californië, en vooral bekend van Facebook, Instagram, WhatsApp en Threads. Via Meta AI (voorheen FAIR) is het bedrijf de meest productieve uitgever geworden van open-gewicht grote taalmodellen via de Llama-familie. De Llama 4-serie — Maverick, Scout en Behemoth — werden uitgebracht onder permissieve gemeenschapslicenties en blijven de meest gedownloade open-gewicht modellen op platforms zoals Hugging Face. De AI-strategie van Meta is onderscheidend onder de grote laboratoria: in plaats van een commerciële API te exploiteren, brengt Meta modellen openlijk uit voor onderzoek en commercieel gebruik, integreert het generatieve AI-functies in haar eigen toepassingen, en heeft het publiekelijk gepleit voor open-gewicht releases als de meest democratische benadering van AI-ontwikkeling.
Gebruiksscenario's
Llama 4 Maverick scoort 69% op GPQA Diamond (#11 van 14 modellen), rond of boven de basislijn van menselijke PhD-experts. Het kan veeleisend wetenschappelijk redeneren, onderzoeksliteratuur samenvatten en kennisintensieve taken aan in STEM-disciplines.
Llama 4 Maverick is open-weight (17B/400B MoE (128 experts) parameters) — de getrainde gewichten zijn openbaar beschikbaar om te downloaden en zelf te implementeren. Draai het op uw eigen GPU-hardware of privécloud om te voorkomen dat gegevens uw omgeving verlaten, elimineer per-token API-kosten op grote schaal, of fine-tune het model op eigen datasets.
Met een contextvenster van 1M tokens kan Llama 4 Maverick volledige softwarerepository's, lange juridische contracten, onderzoeksrapporten van boeklengte of uitgebreide gespreksgeschiedenissen in één enkele prompt verwerken — wat diepgaande document-Q&A, cross-bestand codebase-redeenering en uitgebreide samenvatting mogelijk maakt zonder chunking-heuristieken of RAG-pijplijnen.
Meer om te vergelijken
Vergelijk alle 24 modellen op 11 benchmarks — sorteerbaar, gebronneerd en bijgewerkt juni 2026.

Llama 4 Scout is een open-weight AI-model van Meta (17B/109B MoE (16 experts)), geclassificeerd als Established-tier met een contextvenster van 10M tokens. Het ...

Llama 3.3 70B is een AI-model met open gewichten van Meta (70B dense), geclassificeerd als Established-tier met een contextvenster van 128K tokens. Het is direc...

GPT-4.1 is een propriëtair AI-model van OpenAI, geclassificeerd als Advanced-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHunt. O...