
Llama 4 Scout — Điểm chuẩn, Khả năng và Trường hợp sử dụng
Llama 4 Scout là mô hình AI trọng số mở từ Meta (17B/109B MoE (16 chuyên gia)), được xếp hạng Established với cửa sổ ngữ cảnh 10 triệu token. Mô hình có sẵn trự...
Llama 4 Maverick là mô hình AI đã được kiểm chứng, vẫn được triển khai rộng rãi trong các hệ thống sản xuất, được phát triển bởi Meta và phát hành vào tháng 4 năm 2025. Là mô hình trọng số mở, các trọng số đã huấn luyện của nó được công bố công khai — bạn có thể tự lưu trữ, tinh chỉnh trên dữ liệu độc quyền, hoặc chạy tại chỗ mà không phụ thuộc vào API. Cửa sổ ngữ cảnh 1 triệu token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác vụ đại lý kéo dài mà không bị cắt ngắn.
Trên Bảng xếp hạng AI FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 3 điểm chuẩn. Các điểm số nổi bật: 80,5% trên MMLU-Pro (#4/8); 43,4% trên LiveCodeBench (#4/5); 69,8% trên GPQA Diamond (#11/14).
Llama 4 Maverick được phát hành vào ngày 5 tháng 4 năm 2025 với tư cách là mô hình Llama 4 chủ lực của Meta. Maverick giới thiệu kiến trúc hỗn hợp chuyên gia đa phương thức gốc — mô hình Llama đầu tiên có khả năng xử lý hình ảnh ở cấp độ suy luận — sử dụng 17B tham số hoạt động từ một tập hợp 400B với 128 chuyên gia. Khi ra mắt, đây là mô hình trọng số mở mạnh nhất về các tác vụ hiểu hình ảnh, mở ra thế hệ đầu tiên của các tác nhân trọng số mở có khả năng thị giác. Cửa sổ ngữ cảnh 1 triệu token và khả năng đa phương thức đã biến nó thành mô hình tham chiếu cho phát triển ứng dụng tác nhân trọng số mở trong nửa đầu năm 2025, trước khi các mô hình đóng thuộc Frontier-tier mở rộng khoảng cách dẫn đầu.
Lưu ý: Mô hình đa phương thức trọng số mở tốt nhất khi ra mắt. Chạy vừa trên một máy chủ H100.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 69.8% | 11 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 80.5% | 4 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 43.4% | 4 of 5 | SR | Competitive programming, continuously updated |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | Llama 4 Maverick | GPT-4o | Llama 4 Scout |
|---|---|---|---|
| GPQA ◇ | 69.8% | 53.6% | — |
| MMLU-P | 80.5% | 72.6% | 52.2% |
| LiveCode | 43.4% | — | 32.8% |
Meta Platforms (trước đây là Facebook) là một trong những công ty công nghệ lớn nhất thế giới, có trụ sở chính tại Menlo Park, California, và nổi tiếng nhất với Facebook, Instagram, WhatsApp và Threads. Thông qua Meta AI (trước đây là FAIR), công ty đã trở thành nhà xuất bản năng suất nhất của các mô hình ngôn ngữ lớn trọng số mở thông qua dòng Llama. Dòng Llama 4 — Maverick, Scout và Behemoth — được phát hành theo các giấy phép cộng đồng cho phép và vẫn là các mô hình trọng số mở được tải xuống nhiều nhất trên các nền tảng như Hugging Face. Chiến lược AI của Meta khác biệt so với các phòng thí nghiệm lớn khác: thay vì vận hành một API thương mại, Meta phát hành các mô hình một cách công khai cho mục đích nghiên cứu và thương mại, tích hợp các tính năng AI tạo sinh trên các ứng dụng của riêng mình, và đã công khai ủng hộ việc phát hành trọng số mở như là cách tiếp cận dân chủ nhất đối với phát triển AI.
Trường hợp sử dụng
Llama 4 Maverick đạt 69% trên GPQA Diamond (#11/14 mô hình), xung quanh hoặc trên mức cơ sở của chuyên gia có trình độ tiến sĩ. Mô hình xử lý các suy luận khoa học đòi hỏi cao, tóm tắt tài liệu nghiên cứu và các tác vụ đòi hỏi nhiều kiến thức trong các lĩnh vực STEM.
Llama 4 Maverick là mô hình trọng số mở (17B/400B MoE (128 chuyên gia) tham số) — các trọng số đã huấn luyện của nó được công bố công khai để tải về và tự triển khai. Chạy nó trên phần cứng GPU hoặc đám mây riêng của bạn để đảm bảo dữ liệu không bao giờ rời khỏi môi trường của bạn, loại bỏ chi phí API theo token ở quy mô lớn, hoặc tinh chỉnh mô hình trên các tập dữ liệu độc quyền.
Với cửa sổ ngữ cảnh 1 triệu token, Llama 4 Maverick có thể tiếp nhận toàn bộ kho mã nguồn, hợp đồng pháp lý dài, báo cáo nghiên cứu dài như sách hoặc lịch sử hội thoại phong phú trong một prompt duy nhất — cho phép hỏi đáp tài liệu chuyên sâu, suy luận mã nguồn xuyên tệp và tóm tắt toàn diện mà không cần các heuristic phân đoạn hoặc pipeline RAG.
Thêm để So sánh
So sánh tất cả 24 mô hình qua 11 điểm chuẩn — có thể sắp xếp, có nguồn gốc và cập nhật tháng 6/2026.

Llama 4 Scout là mô hình AI trọng số mở từ Meta (17B/109B MoE (16 chuyên gia)), được xếp hạng Established với cửa sổ ngữ cảnh 10 triệu token. Mô hình có sẵn trự...

Llama 3.3 70B là mô hình AI trọng lượng mở từ Meta (70B dense), được phân loại cấp Established với cửa sổ ngữ cảnh 128K token. Mô hình có sẵn trực tiếp trong Fl...

Mô hình Ngôn ngữ Lớn Meta AI (LLaMA) là một mô hình xử lý ngôn ngữ tự nhiên tiên tiến do Meta phát triển. Với số lượng tham số lên đến 65 tỷ, LLaMA xuất sắc tro...
Đồng Ý Cookie
Chúng tôi sử dụng cookie để cải thiện trải nghiệm duyệt web của bạn và phân tích lưu lượng truy cập của mình. See our privacy policy.