Benchmark mô hình AI Việt Nam
Bộ dữ liệu chuyên sâu về benchmark mô hình ai tại Việt Nam, ưu tiên phân tổ trong nước như tỉnh/thành, ngành, nhóm đối tượng hoặc entity khi nguồn chính thức có.
Mã lược đồ chuẩn hoábop.entity-registry (v2.2.0)
Quy mô bản ghi10 dòng dữ liệu
| Mã định danh | Tên / chỉ tiêu | Địa bàn | Phân loại | Trạng thái | Ngày hiệu lực | Mô tả | URL nguồn |
|---|---|---|---|---|---|---|---|
| vmlu-vai-llm-v1-6-plus | VAI-LLM-v1.6+ | Việt Nam — đánh giá tiếng Việt | 2026-08-06 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 1 trên bảng fine-tuned của VMLU; điểm trung bình 90.04. Điểm theo nhóm: STEM 91.81, khoa học xã hội 89.73, nhân văn 89.65, nhóm khác 87.05. Nhà phát triển: VAI; mô hình nền được ghi là VAI-1.2-120B; quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-v-llm-v2-1 | V-LLM v2.1 | Việt Nam — đánh giá tiếng Việt | 2026-07-31 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 2 trên bảng fine-tuned của VMLU; điểm trung bình 89.85. Điểm theo nhóm: STEM 91.92, khoa học xã hội 89.73, nhân văn 88.95, nhóm khác 86.96. Nhà phát triển: VinSmart Future; mô hình nền: Unknown; quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-vai-llm-v1-6 | VAI-LLM-v1.6 | Việt Nam — đánh giá tiếng Việt | 2026-06-22 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 3 trên bảng fine-tuned của VMLU; điểm trung bình 87.63. Điểm theo nhóm: STEM 89.07, khoa học xã hội 88.16, nhân văn 87.15, nhóm khác 84.63. Nhà phát triển: VAI; mô hình nền: VAI-1.2-120B; quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-v-llm-v1-2 | V-LLM v1.2 | Việt Nam — đánh giá tiếng Việt | 2026-05-04 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 4 trên bảng fine-tuned của VMLU; điểm trung bình 87.20. Điểm theo nhóm: STEM 89.22, khoa học xã hội 88.21, nhân văn 86.06, nhóm khác 83.64. Nhà phát triển: VinSmart Future; mô hình nền: Unknown; quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-axis-sovereign | axis-sovereign | Đánh giá tiếng Việt; nhà phát triển ghi là International AXIS | 2026-04-20 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 5 trên bảng fine-tuned của VMLU; điểm trung bình 85.75. Điểm theo nhóm: STEM 86.47, khoa học xã hội 86.45, nhân văn 86.23, nhóm khác 82.31. Quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-vai-llm-v1-5 | VAI-LLM-v1.5 | Việt Nam — đánh giá tiếng Việt | 2026-06-01 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 6 trên bảng fine-tuned của VMLU; điểm trung bình 85.47. Điểm theo nhóm: STEM 89.36, khoa học xã hội 86.55, nhân văn 82.93, nhóm khác 80.24. Nhà phát triển: VAI; mô hình nền: VT-Super-120B; quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-vi-qwen3-6 | Vi-Qwen3.6 | Việt Nam — đánh giá tiếng Việt | 2026-05-04 | LLM tinh chỉnh; VMLU | Đã đánh giá | Hạng 7 trên bảng fine-tuned của VMLU; điểm trung bình 85.36. Điểm theo nhóm: STEM 89.37, khoa học xã hội 85.85, nhân văn 83.01, nhóm khác 80.15. Nhà phát triển: Zoom AI Lab; mô hình nền: Qwen3.6; quyền truy cập: Private. | https://vmlu.ai/leaderboard |
| vmlu-v-llm-v1 | V-LLM v1 | Việt Nam — đánh giá tiếng Việt | 2026-03-20 | LLM tinh chỉnh; VMLU và V-Bench | Đã đánh giá | Trên VMLU: hạng 8 bảng fine-tuned, điểm trung bình 85.11; STEM 88.00, khoa học xã hội 86.36, nhân văn 82.99, nhóm khác 81.23. Trên V-Bench, trang xếp hạng công bố điểm dẫn đầu theo hạng mục An toàn và chủ quyền số: 99.6 ở bài kiểm tra công khai và 99.3 ở bài kiểm tra chuyên sâu. Nhà phát triển: VinSmart Future; quyền truy cập VMLU: Private. | https://vmlu.ai/leaderboard |
| vbench-claude-opus-5-high | Claude Opus 5 (high) | Đánh giá theo năng lực tiếng Việt và ngữ cảnh Việt Nam | — | LLM; V-Bench | Đã đánh giá | Bảng V-Bench hiển thị điểm tổng hợp 78.65 và 32 mô hình đã đánh giá. Mô hình này dẫn đầu ở Kiến thức học thuật (76.6 công khai; 71.4 chuyên sâu). V-Bench do Trung tâm Nghiên cứu AI, VinUniversity khởi xướng; bộ đánh giá bao gồm tri thức văn hóa, vùng miền, an toàn và sức khỏe cộng đồng. | https://vbench.ai/leaderboard |
| vbench-gpt-5-6-sol-high | GPT-5.6 Sol (high) | Đánh giá theo năng lực tiếng Việt và ngữ cảnh Việt Nam | — | LLM; V-Bench | Đã đánh giá | Trang V-Bench công bố điểm tổng hợp 77.75; điểm theo nhóm: Kiến thức học thuật 75.3, An toàn và chủ quyền số 84.1, Tri thức văn hóa, xã hội, vùng miền 84.5, Y tế và sức khỏe cộng đồng 75.6, Agentic 69.6. | https://vbench.ai/leaderboard |