BOP DatabopDATA
Tìm dữ liệu...⌘K
Sẵn sàng
VI
Khoa học, Công nghệ & Sở hữu trí tuệ•Việt Nam•🔄Cập nhật hàng tháng•Đang hiệu lực

Benchmark mô hình AI Việt Nam

Bộ dữ liệu chuyên sâu về benchmark mô hình ai tại Việt Nam, ưu tiên phân tổ trong nước như tỉnh/thành, ngành, nhóm đối tượng hoặc entity khi nguồn chính thức có.

Mã lược đồ chuẩn hoábop.entity-registry (v2.2.0)
Quy mô bản ghi10 dòng dữ liệu
Mã định danhTên / chỉ tiêuĐịa bànPhân loạiTrạng tháiNgày hiệu lựcMô tảURL nguồn
vmlu-vai-llm-v1-6-plusVAI-LLM-v1.6+Việt Nam — đánh giá tiếng Việt2026-08-06LLM tinh chỉnh; VMLUĐã đánh giáHạng 1 trên bảng fine-tuned của VMLU; điểm trung bình 90.04. Điểm theo nhóm: STEM 91.81, khoa học xã hội 89.73, nhân văn 89.65, nhóm khác 87.05. Nhà phát triển: VAI; mô hình nền được ghi là VAI-1.2-120B; quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-v-llm-v2-1V-LLM v2.1Việt Nam — đánh giá tiếng Việt2026-07-31LLM tinh chỉnh; VMLUĐã đánh giáHạng 2 trên bảng fine-tuned của VMLU; điểm trung bình 89.85. Điểm theo nhóm: STEM 91.92, khoa học xã hội 89.73, nhân văn 88.95, nhóm khác 86.96. Nhà phát triển: VinSmart Future; mô hình nền: Unknown; quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-vai-llm-v1-6VAI-LLM-v1.6Việt Nam — đánh giá tiếng Việt2026-06-22LLM tinh chỉnh; VMLUĐã đánh giáHạng 3 trên bảng fine-tuned của VMLU; điểm trung bình 87.63. Điểm theo nhóm: STEM 89.07, khoa học xã hội 88.16, nhân văn 87.15, nhóm khác 84.63. Nhà phát triển: VAI; mô hình nền: VAI-1.2-120B; quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-v-llm-v1-2V-LLM v1.2Việt Nam — đánh giá tiếng Việt2026-05-04LLM tinh chỉnh; VMLUĐã đánh giáHạng 4 trên bảng fine-tuned của VMLU; điểm trung bình 87.20. Điểm theo nhóm: STEM 89.22, khoa học xã hội 88.21, nhân văn 86.06, nhóm khác 83.64. Nhà phát triển: VinSmart Future; mô hình nền: Unknown; quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-axis-sovereignaxis-sovereignĐánh giá tiếng Việt; nhà phát triển ghi là International AXIS2026-04-20LLM tinh chỉnh; VMLUĐã đánh giáHạng 5 trên bảng fine-tuned của VMLU; điểm trung bình 85.75. Điểm theo nhóm: STEM 86.47, khoa học xã hội 86.45, nhân văn 86.23, nhóm khác 82.31. Quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-vai-llm-v1-5VAI-LLM-v1.5Việt Nam — đánh giá tiếng Việt2026-06-01LLM tinh chỉnh; VMLUĐã đánh giáHạng 6 trên bảng fine-tuned của VMLU; điểm trung bình 85.47. Điểm theo nhóm: STEM 89.36, khoa học xã hội 86.55, nhân văn 82.93, nhóm khác 80.24. Nhà phát triển: VAI; mô hình nền: VT-Super-120B; quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-vi-qwen3-6Vi-Qwen3.6Việt Nam — đánh giá tiếng Việt2026-05-04LLM tinh chỉnh; VMLUĐã đánh giáHạng 7 trên bảng fine-tuned của VMLU; điểm trung bình 85.36. Điểm theo nhóm: STEM 89.37, khoa học xã hội 85.85, nhân văn 83.01, nhóm khác 80.15. Nhà phát triển: Zoom AI Lab; mô hình nền: Qwen3.6; quyền truy cập: Private.https://vmlu.ai/leaderboard
vmlu-v-llm-v1V-LLM v1Việt Nam — đánh giá tiếng Việt2026-03-20LLM tinh chỉnh; VMLU và V-BenchĐã đánh giáTrên VMLU: hạng 8 bảng fine-tuned, điểm trung bình 85.11; STEM 88.00, khoa học xã hội 86.36, nhân văn 82.99, nhóm khác 81.23. Trên V-Bench, trang xếp hạng công bố điểm dẫn đầu theo hạng mục An toàn và chủ quyền số: 99.6 ở bài kiểm tra công khai và 99.3 ở bài kiểm tra chuyên sâu. Nhà phát triển: VinSmart Future; quyền truy cập VMLU: Private.https://vmlu.ai/leaderboard
vbench-claude-opus-5-highClaude Opus 5 (high)Đánh giá theo năng lực tiếng Việt và ngữ cảnh Việt Nam—LLM; V-BenchĐã đánh giáBảng V-Bench hiển thị điểm tổng hợp 78.65 và 32 mô hình đã đánh giá. Mô hình này dẫn đầu ở Kiến thức học thuật (76.6 công khai; 71.4 chuyên sâu). V-Bench do Trung tâm Nghiên cứu AI, VinUniversity khởi xướng; bộ đánh giá bao gồm tri thức văn hóa, vùng miền, an toàn và sức khỏe cộng đồng.https://vbench.ai/leaderboard
vbench-gpt-5-6-sol-highGPT-5.6 Sol (high)Đánh giá theo năng lực tiếng Việt và ngữ cảnh Việt Nam—LLM; V-BenchĐã đánh giáTrang V-Bench công bố điểm tổng hợp 77.75; điểm theo nhóm: Kiến thức học thuật 75.3, An toàn và chủ quyền số 84.1, Tri thức văn hóa, xã hội, vùng miền 84.5, Y tế và sức khỏe cộng đồng 75.6, Agentic 69.6.https://vbench.ai/leaderboard