Công nghệ Thứ Năm 04/06/2026, 18:13

Viettel huấn luyện mô hình AI chủ quyền tiếng Việt với 120 tỷ tham số

Viettel AI phát triển VT-Super-120B-A12B - mô hình ngôn ngữ lớn tiếng Việt 120 tỷ tham số, hướng tới xây dựng các hệ thống AI am hiểu sâu dữ liệu, ngôn ngữ và tri thức tiếng Việt.

Trung tâm Dịch vụ dữ liệu và Trí tuệ nhân tạo Viettel (Viettel AI) đang thúc đẩy phát triển AI chủ quyền tại Việt Nam, đồng thời ghi nhận kết quả rõ rệt về năng lực mô hình thông qua quá trình huấn luyện và tinh chỉnh trên các mô hình mở NVIDIA Nemotron.

Thông qua các bài kiểm tra, VT-Super-120B-A12B - mô hình ngôn ngữ lớn (Large Language Model - LLM) tiếng Việt do Viettel AI nghiên cứu và làm chủ đạt hiệu suất cao, nằm trong nhóm dẫn đầu về độ chính xác so với các mô hình có cùng quy mô. Đây là kết quả của việc mô hình được huấn luyện trên dữ liệu bản địa và tối ưu cho các bài toán nghiệp vụ trong nước. Đáng chú ý, VT-Super-120B-A12B tăng cường năng lực xử lý tiếng Việt mà không làm suy giảm hiệu năng tiếng Anh của mô hình gốc, đồng thời hạn chế hiện tượng quên kiến thức cũ (catastrophic forgetting) thường gặp trong quá trình huấn luyện và tinh chỉnh mô hình AI.

VT-Super-120B-A12B được xây dựng trên kiến trúc mở NVIDIA Nemotron 3 Super với quy mô 120 tỷ tham số, do đội ngũ kỹ sư Việt Nam trực tiếp huấn luyện, tinh chỉnh và tối ưu cho tiếng Việt. Khả năng xử lý ngữ cảnh dài của kiến trúc NVIDIA Nemotron cho phép mô hình duy trì mạch thông tin xuyên suốt giữa nhiều tài liệu, quy trình và hội thoại phức tạp trong cùng một tác vụ.

VT-Super-120B-A12B được xây dựng trên kiến trúc mở NVIDIA Nemotron 3 Super, có khảnăng xử lý ngữ cảnh dài (Ảnh: NVIDIA)

Đây là năng lực đặc biệt quan trọng với các bài toán vận hành đặc thù tại Việt Nam, nơi nhiều quy định và quy trình có thể thay đổi tùy theo loại hồ sơ, đối tượng liên quan hoặc bối cảnh thực thi cụ thể. Việc sở hữu một mô hình lõi có khả năng ghi nhớ và thích ứng linh hoạt với dữ liệu thực tế tạo tiền đề để Viettel AI tinh chỉnh LLM đạt độ chính xác cao, giải quyết triệt để việc tối ưu hóa ứng dụng AI cho từng tổ chức, doanh nghiệp Việt Nam

Bên cạnh việc kế thừa năng lực từ kiến trúc NVIDIA Nemotron 3 Super, Viettel AI cũng xây dựng quy trình huấn luyện LLM dựa trên các nguồn dữ liệu mang tính bản địa như dữ liệu hành chính, nghiệp vụ doanh nghiệp, hội thoại thực tế và hệ thống văn bản chuyên ngành tại Việt Nam. Quá trình này bao gồm nhiều giai đoạn huấn luyện; trong đó, giai đoạn tiếp tục tiền huấn luyện (continued pre-training) mở rộng năng lực ngôn ngữ và tri thức tiếng Việt trên kho dữ liệu quy mô lớn. Tiếp theo, mô hình được tinh chỉnh có giám sát (supervised fine-tuning) nhằm cải thiện khả năng suy luận, sau đó được học tăng cường (reinforcement learning) để nâng cao độ chính xác trong phản hồi và khả năng xử lý nghiệp vụ.

Ông Nguyễn Mạnh Quý, Giám đốc Viettel AI, nhận định: "AI đang chuyển từ vai trò hỗ trợ sang lớp hạ tầng công nghệ mới. Quốc gia nào làm chủ được mô hình, dữ liệu và năng lực huấn luyện sẽ có lợi thế tạo ra những hệ thống phục vụ đúng nhu cầu phát triển của mình. Với Viettel, làm chủ LLM tiếng Việt là bước đi cốt lõi để hình thành các giải pháp AI chủ quyền có khả năng đồng hành thực sự cùng các tổ chức, doanh nghiệp Việt Nam."

Làm chủ LLM tiếng Việt là bước đi cốt lõi để hình thành các giải pháp AI chủ quyền tạiViệt Nam

Shilpa Kolhatkar, Giám đốc AI Nations của NVIDIA cho biết: "Thông qua việc thúc đẩy phát triển AI chủ quyền và AI chuyên biệt theo từng lĩnh vực, Viettel đang góp phần phổ cập khả năng tiếp cận trí tuệ nhân tạo trên quy mô toàn xã hội, đồng thời chuyển hóa ngôn ngữ và dữ liệu bản địa thành những giá trị ứng dụng thực tiễn cho cơ quan chính phủ và doanh nghiệp."

Trên nền tảng mô hình này, Viettel AI đang phát triển nền tảng AI Agent dành cho người Việt với khả năng tự thực hiện chuỗi tác vụ trong cùng một không gian làm việc. Trong đó, Trợ lý AI Pháp luật là một trong những ứng dụng đầu tiên, được kỳ vọng sẽ sở hữu khả năng hỗ trợ phân tích hồ sơ, đối chiếu quy định, tổng hợp dữ liệu và đề xuất giải pháp xử lý theo bài toán cụ thể của người dùng, với chất lượng được nâng cao đáng kể so với các phiên bản trước đây.

Từ hành chính công, chăm sóc khách hàng đến vận hành doanh nghiệp và phân tích dữ liệu, VT-Super-120B-A12B được định hướng trở thành công nghệ lõi cho các hệ thống AI hiểu và phục vụ đúng nhu cầu thực tế của tổ chức, doanh nghiệp Việt Nam.

Ý kiến của bạn
Bình luận
Xem thêm bình luận

Có thể bạn sẽ thích

Giá vàng hôm nay 4/6: Tiếp tục giảm mạnh

Giá vàng hôm nay 4/6: Tiếp tục giảm mạnh

Kinh tế 09:50 04/06/2026

(HTV) - Giá vàng trong nước và thế giới tiếp tục trượt dốc khi liên tiếp giảm mạnh trong hai ngày liên tiếp. Giá vàng miếng SJC mua vào hiện ở mức 154 triệu đồng/lượng.

Giá xăng dầu hôm nay 4/6: Giá dầu thế giới nối dài đà tăng

Giá xăng dầu hôm nay 4/6: Giá dầu thế giới nối dài đà tăng

Kinh tế 09:49 04/06/2026

(HTV) - Giá dầu thế giới tiếp tục tăng 2%, nối dài đà tăng từ phiên trước đó do xung đột tại Trung Đông bùng phát trở lại, các cuộc đàm phán giữa Tehran và Washington hầu như không đạt được tiến triển.

TP Hồ Chí Minh dự kiến công bố điểm thi lớp 10 sau ngày 12/6

TP Hồ Chí Minh dự kiến công bố điểm thi lớp 10 sau ngày 12/6

Giáo dục 07:35 04/06/2026

Sau khi hoàn tất kỳ thi tuyển sinh lớp 10 công lập năm học 2026 - 2027, Sở Giáo dục và Đào tạo TP Hồ Chí Minh cho biết, công tác chấm thi sẽ bắt đầu từ ngày 3/6 và dự kiến công bố điểm thi sau ngày 12/6.

Khai mạc Phiên trọng thể Đại hội Công đoàn Việt Nam lần thứ XIV

Khai mạc Phiên trọng thể Đại hội Công đoàn Việt Nam lần thứ XIV

Chính trị 09:22 04/06/2026

Sáng 4/6/2026, tại Trung tâm Hội nghị Quốc gia (Hà Nội), Đại hội XIV Công đoàn Việt Nam nhiệm kỳ 2026-2031 tiến hành Phiên trọng thể. Tổng Bí thư, Chủ tịch nước Tô Lâm cùng nhiều đồng chí lãnh đạo, nguyên lãnh đạo Đảng, Nhà nước đến dự.

Xem thêm