Đánh giá an toàn mô hình AI Việt Nam
Bộ dữ liệu chuyên sâu về đánh giá an toàn mô hình ai tại Việt Nam, ưu tiên phân tổ trong nước như tỉnh/thành, ngành, nhóm đối tượng hoặc entity khi nguồn chính thức có.
Mã lược đồ chuẩn hoábop.entity-registry (v2.2.0)
Quy mô bản ghi3 dòng dữ liệu
| Mã định danh | Tên / chỉ tiêu | Địa bàn | Phân loại | Trạng thái | Ngày hiệu lực | Mô tả | URL nguồn |
|---|---|---|---|---|---|---|---|
| vbench | V-Bench | Việt Nam; tiếng Việt và bối cảnh vùng miền trong nước | — | Benchmark LLM đa lĩnh vực; an toàn và chủ quyền số | Đang công khai | Benchmark do Trung tâm Nghiên cứu AI, VinUniversity khởi xướng. Trang benchmark công bố hơn 40.000 câu hỏi/nhiệm vụ, 32 mô hình đã được đánh giá và nhóm An toàn và chủ quyền số; nhóm này bao gồm các đánh giá liên quan đến an toàn thông tin, thông tin sai lệch và bối cảnh Việt Nam. | https://vbench.ai/ |
| nemotron-content-visafe-v1 | Nemotron-Content-VISafe-v1 | Tiếng Việt; có probe theo bối cảnh Việt Nam | — | Bộ probe đánh giá an toàn AI và red-team | Công khai, phiên bản 1.0 | Bộ dữ liệu NVIDIA gồm 3.212 probe văn bản tiếng Việt, bao phủ jailbreak, độc hại, thông tin sai lệch, prompt injection, chủ đề chính trị nhạy cảm tại Việt Nam, tội phạm mạng, từ chối quá mức và quyền riêng tư. Bộ dữ liệu kết hợp probe dịch và probe tiếng Việt được tạo theo mẫu, có rà soát ngôn ngữ. | https://huggingface.co/datasets/nvidia/Nemotron-Content-VISafe-v1 |
| meddies-patient-safety | Meddies Patient Safety | Việt Nam; tiếng Việt và tình huống chăm sóc sức khỏe trong nước | — | Bộ dữ liệu red-team an toàn lâm sàng cho LLM | Công khai; dữ liệu tổng hợp phục vụ nghiên cứu | Bộ dữ liệu có 22.336 câu hỏi bệnh nhân tổng hợp để thăm dò năm dạng phản hồi không an toàn và 19.085 câu trả lời do LLM tạo đã qua bộ lọc đánh giá chất lượng bằng LLM-as-judge. Các dạng rủi ro gồm thông tin sức khỏe sai lệch, lời khuyên y tế có hại, hành nghề không phép, tự tin chẩn đoán quá mức và thiên lệch/phân biệt đối xử. Nhà phát hành lưu ý đây không phải đánh giá lâm sàng chứng nhận an toàn. | https://huggingface.co/datasets/Meddies/meddies-patient-safety |