Việt Nam phát triển mô hình AI tiếng Việt mở đầu tiên

Viện Nghiên cứu AI Việt Nam (VinAI) vừa công bố PhoBERT-Large-VN – mô hình ngôn ngữ lớn tiếng Việt mở đầu tiên với 1,3 tỷ tham số, được huấn luyện trên 50GB dữ liệu văn bản tiếng Việt chất lượng cao.

Mô hình đạt kết quả SOTA (State-of-the-art) trên 8 benchmark tiếng Việt: phân loại văn bản, nhận diện thực thể, phân tích cảm xúc, dịch máy, tóm tắt văn bản, hỏi đáp, sinh văn bản và sửa lỗi chính tả.

VinAI cam kết mở mã nguồn mô hình, dữ liệu huấn luyện và công cụ fine-tuning để cộng đồng phát triển ứng dụng AI tiếng Việt. Đây là bước tiến quan trọng cho chủ quyền AI của Việt Nam.

Để lại một bình luận

Email của bạn sẽ không được hiển thị công khai. Các trường bắt buộc được đánh dấu *