
Llama 4 Maverick — Prestanda, Kapaciteter och Användningsområden
Llama 4 Maverick är en AI-modell med öppna vikter från Meta (17B/400B MoE (128 experter)), klassificerad som etablerad nivå med ett kontextfönster på 1M tokens....
Llama 3.3 70B är en beprövad AI-modell som fortfarande är brett använd i produktionssystem, utvecklad av Meta och lanserad i december 2024. Som en modell med öppna vikter är dess tränade vikter offentligt tillgängliga — du kan själv hosta den, finjustera den på egen data eller köra den lokalt utan API-beroenden. Den stöder ett kontextfönster på 128K tokens, tillräckligt för de flesta dokument och flerstegsapplikationer.
På FlowHunt AI Leaderboard är den en av 24 spårade modeller, utvärderad över 4 benchmarktester. Framstående resultat: 88,4 % på HumanEval (#1 av 2); 77,0 % på MATH-500 (#3 av 4); 68,9 % på MMLU-Pro (#7 av 8).
Llama 3.3 70B lanserades den 6 december 2024 som en av Metas sista modeller i Llama 3-serien före den arkitektoniska övergången till Llama 4. Som en tät (icke-MoE) modell med 70B parametrar återspeglade den Llama 3-generationens filosofi med enkel skalbar arkitektur: fler parametrar, bättre resultat, transparent struktur. Dess kontextfönster på 128K och starka resultat på MMLU-Pro och SWE-bench gjorde den till den ledande självhostade modellen för team med GPU-resurser tillräckliga för inferens med täta 70B-modeller men inte ett MoE-system. Den förblir populär inom reglerade branscher — sjukvård, finans, juridik — där transparensen och granskningsbarheten hos en tät arkitektur, i kombination med tillgång till öppna vikter, väger lika tungt som rå kapacitet.
Not: Nästan 405B-kvalitet till 70B-kostnad. Endast text. IFEval 92,1 %.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 50.5% | 13 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 68.9% | 7 of 8 | SR | Hard knowledge reasoning, 12K questions |
| MATH-500 | 77.0% | 3 of 4 | SR | Hendrycks math (500 problems) |
| HumanEval pass@1 | 88.4% | 1 of 2 | SR | Python code generation (saturated at frontier) |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | Llama 3.3 70B | GPT-4o | Llama 4 Maverick |
|---|---|---|---|
| GPQA ◇ | 50.5% | 53.6% | 69.8% |
| MMLU-P | 68.9% | 72.6% | 80.5% |
| MATH | 77.0% | — | — |
| HumEval | 88.4% | — | — |
Meta Platforms (tidigare Facebook) är ett av världens största teknikföretag, med huvudkontor i Menlo Park, Kalifornien, och mest känt för Facebook, Instagram, WhatsApp och Threads. Genom Meta AI (tidigare FAIR) har företaget blivit den mest produktiva utgivaren av öppna viktmodeller för stora språkmodeller via Llama-familjen. Llama 4-serien — Maverick, Scout och Behemoth — släpptes under tillåtande communitylicenser och är fortfarande de mest nedladdade öppna viktmodellerna på plattformar som Hugging Face. Metas AI-strategi är särpräglad bland de stora laboratorierna: i stället för att driva ett kommersiellt API släpper Meta modeller öppet för forskning och kommersiellt bruk, integrerar generativa AI-funktioner i sina egna applikationer, och har offentligt förespråkat öppna viktmodeller som den mest demokratiska metoden för AI-utveckling.
Användningsområden
Llama 3.3 70B uppnår 50 % på GPQA Diamond (#13 av 14 modeller). Den hanterar allmänna vetenskapliga frågor och svar på en solid nivå, även om frontlinjemodeller presterar 25+ procentenheter högre på de svåraste forskarnivåproblemen.
Llama 3.3 70B har öppna vikter (70B täta parametrar) — dess tränade vikter är offentligt tillgängliga för nedladdning och egen driftsättning. Kör den på din egen GPU-hårdvara eller privata moln för att säkerställa att data aldrig lämnar din miljö, eliminera API-kostnader per token i stor skala, eller finjustera modellen på egna dataset.
Mer att jämföra
Jämför alla 24 modeller över 11 benchmarktester — sorterbara, källhänvisade och uppdaterade juni 2026.

Llama 4 Maverick är en AI-modell med öppna vikter från Meta (17B/400B MoE (128 experter)), klassificerad som etablerad nivå med ett kontextfönster på 1M tokens....

Llama 4 Scout är en AI-modell med öppna vikter från Meta (17B/109B MoE (16 experter)), klassificerad som etablerad nivå med ett kontextfönster på 10 miljoner to...

Large Language Model Meta AI (LLaMA) är en banbrytande modell för naturlig språkbehandling utvecklad av Meta. Med upp till 65 miljarder parametrar utmärker sig ...