Trung tâm Nghiên cứu AI của Trường Đại học VinUni vừa chính thức giới thiệu V-Bench, một bộ công cụ phi lợi nhuận được thiết kế để phục vụ cộng đồng và thúc đẩy sự phát triển AI có trách nhiệm tại Việt Nam. V-Bench được xây dựng với sự cộng tác của 18 chuyên gia AI hàng đầu người Việt trong và ngoài nước, tập trung vào việc đo lường toàn diện khả năng xử lý tiếng Việt của các mô hình ngôn ngữ lớn (LLM). Bộ dữ liệu của V-Bench chứa hơn 40.000 câu hỏi và tác vụ, bao phủ nhiều lĩnh vực và phản ánh đầy đủ các yếu tố văn hóa, ngôn ngữ, chủ quyền, an toàn thông tin và đặc thù địa phương Việt Nam.
Diễn biến chi tiết
V-Bench chia bộ công cụ thành hai hạng mục lớn với năm nhóm đánh giá chuyên biệt
- Văn hóa ngầm định: Đánh giá khả năng thấu hiểu các tầng nghĩa văn hóa ẩn sâu trong ngôn ngữ Việt như phong tục, tín ngưỡng, lịch sử.
- Đa dạng vùng miền: Kiểm tra hiểu biết về phương ngữ Bắc – Trung – Nam, cách xưng hô và văn phong đặc trưng từng vùng.
- An toàn và chủ quyền số: Đảm bảo tuân thủ các nguyên tắc an toàn thông tin quốc gia, chống thông tin sai lệch và bảo vệ chủ quyền số Việt Nam.
- Ứng dụng thực tiễn: Đánh giá hiệu quả trong giáo dục, y tế cộng đồng và các lĩnh vực ứng dụng cụ thể của Việt Nam.
- Năng lực agentic AI: Đánh giá khả năng lập kế hoạch, sử dụng công cụ, RAG và hành động tự chủ trong môi trường Việt Nam.
Tác động & Nhận định
Việc VinUni ra mắt V-Bench có ý nghĩa quan trọng trong bối cảnh Việt Nam đang đẩy mạnh phát triển công nghệ AI. Bộ công cụ này không chỉ giúp đánh giá và cải thiện chất lượng các mô hình AI tiếng Việt, mà còn đóng góp vào việc xây dựng một hệ sinh thái AI có trách nhiệm và phù hợp với văn hóa, xã hội Việt Nam. Đối với các nhà đầu tư, sự phát triển của công nghệ AI, đặc biệt là các công cụ hỗ trợ tiếng Việt, có thể mở ra nhiều cơ hội mới trong lĩnh vực công nghệ thông tin và dịch vụ số trong nước, tạo tiềm năng cho các doanh nghiệp liên quan đến đào tạo AI, xử lý ngôn ngữ tự nhiên và ứng dụng AI trong nhiều ngành nghề khác nhau.