Meta-logo

Meta

Llama 4 Maverick

EstablishedOpen-weight

Llama 4 Maverick is een bewezen AI-model dat nog steeds breed wordt ingezet in productiesystemen, ontwikkeld door Meta en uitgebracht in april 2025. Als open-weight model zijn de getrainde gewichten openbaar beschikbaar — u kunt het zelf hosten, fine-tunen op eigen data, of on-premise draaien zonder API-afhankelijkheden. Het contextvenster van 1M tokens is groot genoeg om volledige codebases, langdurige technische documenten of uitgebreide agentsessies zonder afkapping te verwerken.

Op het FlowHunt AI Leaderboard is het een van de 24 gevolgde modellen, geëvalueerd op 3 benchmarks. Opvallende scores: 80,5% op MMLU-Pro (#4 van 8); 43,4% op LiveCodeBench (#4 van 5); 69,8% op GPQA Diamond (#11 van 14).

Llama 4 Maverick werd uitgebracht op 5 april 2025 als Meta’s vlaggenschip Llama 4-model. Maverick introduceerde een native multimodale mixture-of-experts-architectuur — het eerste Llama-model dat afbeeldingen op redeneerniveau kan verwerken — met 17B actieve parameters uit een pool van 400B met 128 experts. Bij lancering was het het sterkste open-weight model voor visuele begripstaken, wat de eerste generatie visueel-capabele open-weight agenten mogelijk maakte. Het contextvenster van 1M tokens en de multimodale mogelijkheid maakten het tot het referentiemodel voor de ontwikkeling van open-weight agentische toepassingen in de eerste helft van 2025, voordat de Frontier-modellen met gesloten gewichten hun voorsprong uitbreidden.

Opmerking: Best-in-class multimodaal open-weight bij lancering. Past op een enkele H100-host.

Uitgebracht
April 2025
Parameters
17B/400B MoE (128 experts)
Context
1M tokens
Gewichten
Open
Niveau
Established
Aanbieder
Meta

Llama 4 Maverick Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
GPQA Diamond69.8%11 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro80.5%4 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench43.4%4 of 5SRCompetitive programming, continuously updated

Detailed Benchmark Scores

GPQA ◇ SR
69.8%
Graduate-level Google-proof science Q&A
MMLU-P SR
80.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
43.4%
Competitive programming, continuously updated

Llama 4 Maverick vs. Established Peers

Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.

BenchmarkLlama 4 MaverickGPT-4oLlama 4 Scout
GPQA ◇69.8%53.6%
MMLU-P80.5%72.6%52.2%
LiveCode43.4%32.8%

About Meta

Meta Founded 2004 · Menlo Park, CA
Website →

Meta Platforms (voorheen Facebook) is een van de grootste technologiebedrijven ter wereld, gevestigd in Menlo Park, Californië, en vooral bekend van Facebook, Instagram, WhatsApp en Threads. Via Meta AI (voorheen FAIR) is het bedrijf de meest productieve uitgever geworden van open-gewicht grote taalmodellen via de Llama-familie. De Llama 4-serie — Maverick, Scout en Behemoth — werden uitgebracht onder permissieve gemeenschapslicenties en blijven de meest gedownloade open-gewicht modellen op platforms zoals Hugging Face. De AI-strategie van Meta is onderscheidend onder de grote laboratoria: in plaats van een commerciële API te exploiteren, brengt Meta modellen openlijk uit voor onderzoek en commercieel gebruik, integreert het generatieve AI-functies in haar eigen toepassingen, en heeft het publiekelijk gepleit voor open-gewicht releases als de meest democratische benadering van AI-ontwikkeling.

Gebruiksscenario's

Waar Llama 4 Maverick voor te gebruiken

Wetenschappelijk & Technisch Redeneren
Zelf-Gehoste & Privé Implementaties
Lange Documenten & Codebase Analyse

Strengths & Limitations

Strengths

  • Geavanceerde wetenschappelijke Q&A — 69% GPQA Diamond
  • Zelf-gehoste & data-privé implementaties (open-weight)
  • Zeer lange documenten en grote codebases (1M context)

Limitations

  • Aanzienlijk achter op 2026 frontier-modellen op het gebied van agentisch programmeren en complex redeneren

Bekijk het volledige AI-model Leaderboard

Veelgestelde vragen

Meer informatie

GPT-4.1 — Benchmarks, mogelijkheden en gebruiksscenario's
GPT-4.1 — Benchmarks, mogelijkheden en gebruiksscenario's

GPT-4.1 — Benchmarks, mogelijkheden en gebruiksscenario's

GPT-4.1 is een propriëtair AI-model van OpenAI, geclassificeerd als Advanced-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHunt. O...

3 min lezen