Viettel huấn luyện mô hình ai chủ quyền tiếng Việt 120 tỷ tham số, đạt hiệu suất thuộc nhóm dẫn đầu cùng quy mô

0:00 / 0:00
0:00
(Ngày Nay) - Viettel AI phát triển VT-Super-120B-A12B - mô hình ngôn ngữ lớn tiếng Việt 120 tỷ tham số, hướng tới xây dựng các hệ thống AI am hiểu sâu dữ liệu, ngôn ngữ và tri thức tiếng Việt.

Trung tâm Dịch vụ dữ liệu và Trí tuệ nhân tạo Viettel (Viettel AI) đang thúc đẩy phát triển AI chủ quyền tại Việt Nam, đồng thời ghi nhận kết quả rõ rệt về năng lực mô hình thông qua quá trình huấn luyện và tinh chỉnh trên các mô hình mở NVIDIA Nemotron.

Thông qua các bài kiểm tra, VT-Super-120B-A12B - mô hình ngôn ngữ lớn (Large Language Model - LLM) tiếng Việt do Viettel AI nghiên cứu và làm chủ đạt hiệu suất cao, nằm trong nhóm dẫn đầu về độ chính xác so với các mô hình có cùng quy mô. Đây là kết quả của việc mô hình được huấn luyện trên dữ liệu bản địa và tối ưu cho các bài toán nghiệp vụ trong nước. Đáng chú ý, VT-Super-120B-A12B tăng cường năng lực xử lý tiếng Việt mà không làm suy giảm hiệu năng tiếng Anh của mô hình gốc, đồng thời hạn chế hiện tượng quên kiến thức cũ (catastrophic forgetting) thường gặp trong quá trình huấn luyện và tinh chỉnh mô hình AI.

VT-Super-120B-A12B được xây dựng trên kiến trúc mở NVIDIA Nemotron 3 Super với quy mô 120 tỷ tham số, do đội ngũ kỹ sư Việt Nam trực tiếp huấn luyện, tinh chỉnh và tối ưu cho tiếng Việt. Khả năng xử lý ngữ cảnh dài của kiến trúc NVIDIA Nemotron cho phép mô hình duy trì mạch thông tin xuyên suốt giữa nhiều tài liệu, quy trình và hội thoại phức tạp trong cùng một tác vụ.

Viettel huấn luyện mô hình ai chủ quyền tiếng Việt 120 tỷ tham số, đạt hiệu suất thuộc nhóm dẫn đầu cùng quy mô ảnh 1
VT-Super-120B-A12B được xây dựng trên kiến trúc mở NVIDIA Nemotron 3 Super, có khả năng xử lý ngữ cảnh dài (Ảnh: NVIDIA)

Đây là năng lực đặc biệt quan trọng với các bài toán vận hành đặc thù tại Việt Nam, nơi nhiều quy định và quy trình có thể thay đổi tùy theo loại hồ sơ, đối tượng liên quan hoặc bối cảnh thực thi cụ thể. Việc sở hữu một mô hình lõi có khả năng ghi nhớ và thích ứng linh hoạt với dữ liệu thực tế tạo tiền đề để Viettel AI tinh chỉnh LLM đạt độ chính xác cao, giải quyết triệt để việc tối ưu hóa ứng dụng AI cho từng tổ chức, doanh nghiệp Việt Nam.

Bên cạnh việc kế thừa năng lực từ kiến trúc NVIDIA Nemotron 3 Super, Viettel AI cũng xây dựng quy trình huấn luyện LLM dựa trên các nguồn dữ liệu mang tính bản địa như dữ liệu hành chính, nghiệp vụ doanh nghiệp, hội thoại thực tế và hệ thống văn bản chuyên ngành tại Việt Nam. Quá trình này bao gồm nhiều giai đoạn huấn luyện; trong đó, giai đoạn tiếp tục tiền huấn luyện (continued pre-training) mở rộng năng lực ngôn ngữ và tri thức tiếng Việt trên kho dữ liệu quy mô lớn. Tiếp theo, mô hình được tinh chỉnh có giám sát (supervised fine-tuning) nhằm cải thiện khả năng suy luận, sau đó được học tăng cường (reinforcement learning) để nâng cao độ chính xác trong phản hồi và khả năng xử lý nghiệp vụ.

Ông Nguyễn Mạnh Quý, Giám đốc Viettel AI, nhận định: “AI đang chuyển từ vai trò hỗ trợ sang lớp hạ tầng công nghệ mới. Quốc gia nào làm chủ được mô hình, dữ liệu và năng lực huấn luyện sẽ có lợi thế tạo ra những hệ thống phục vụ đúng nhu cầu phát triển của mình. Với Viettel, làm chủ LLM tiếng Việt là bước đi cốt lõi để hình thành các giải pháp AI chủ quyền có khả năng đồng hành thực sự cùng các tổ chức, doanh nghiệp Việt Nam.”

Làm chủ LLM tiếng Việt là bước đi cốt lõi để hình thành các giải pháp AI chủ quyền tại Việt Nam

Shilpa Kolhatkar, Giám đốc AI Nations của NVIDIA cho biết: “Thông qua việc thúc đẩy phát triển AI chủ quyền và AI chuyên biệt theo từng lĩnh vực, Viettel đang góp phần phổ cập khả năng tiếp cận trí tuệ nhân tạo trên quy mô toàn xã hội, đồng thời chuyển hóa ngôn ngữ và dữ liệu bản địa thành những giá trị ứng dụng thực tiễn cho cơ quan chính phủ và doanh nghiệp.”

Trên nền tảng mô hình này, Viettel AI đang phát triển nền tảng AI Agent dành cho người Việt với khả năng tự thực hiện chuỗi tác vụ trong cùng một không gian làm việc. Trong đó, Trợ lý AI Pháp luật là một trong những ứng dụng đầu tiên, được kỳ vọng sẽ sở hữu khả năng hỗ trợ phân tích hồ sơ, đối chiếu quy định, tổng hợp dữ liệu và đề xuất giải pháp xử lý theo bài toán cụ thể của người dùng, với chất lượng được nâng cao đáng kể so với các phiên bản trước đây.

Từ hành chính công, chăm sóc khách hàng đến vận hành doanh nghiệp và phân tích dữ liệu, VT-Super-120B-A12B được định hướng trở thành công nghệ lõi cho các hệ thống AI hiểu và phục vụ đúng nhu cầu thực tế của tổ chức, doanh nghiệp Việt Nam.

Viettel huấn luyện mô hình ai chủ quyền tiếng Việt 120 tỷ tham số, đạt hiệu suất thuộc nhóm dẫn đầu cùng quy mô

Viettel AI phát triển VT-Super-120B-A12B - mô hình ngôn ngữ lớn tiếng Việt 120 tỷ tham số, hướng tới xây dựng các hệ thống AI am hiểu sâu dữ liệu, ngôn ngữ và tri thức tiếng Việt.

Trung tâm Dịch vụ dữ liệu và Trí tuệ nhân tạo Viettel (Viettel AI) đang thúc đẩy phát triển AI chủ quyền tại Việt Nam, đồng thời ghi nhận kết quả rõ rệt về năng lực mô hình thông qua quá trình huấn luyện và tinh chỉnh trên các mô hình mở NVIDIA Nemotron.

Thông qua các bài kiểm tra, VT-Super-120B-A12B - mô hình ngôn ngữ lớn (Large Language Model - LLM) tiếng Việt do Viettel AI nghiên cứu và làm chủ đạt hiệu suất cao, nằm trong nhóm dẫn đầu về độ chính xác so với các mô hình có cùng quy mô. Đây là kết quả của việc mô hình được huấn luyện trên dữ liệu bản địa và tối ưu cho các bài toán nghiệp vụ trong nước. Đáng chú ý, VT-Super-120B-A12B tăng cường năng lực xử lý tiếng Việt mà không làm suy giảm hiệu năng tiếng Anh của mô hình gốc, đồng thời hạn chế hiện tượng quên kiến thức cũ (catastrophic forgetting) thường gặp trong quá trình huấn luyện và tinh chỉnh mô hình AI.

VT-Super-120B-A12B được xây dựng trên kiến trúc mở NVIDIA Nemotron 3 Super với quy mô 120 tỷ tham số, do đội ngũ kỹ sư Việt Nam trực tiếp huấn luyện, tinh chỉnh và tối ưu cho tiếng Việt. Khả năng xử lý ngữ cảnh dài của kiến trúc NVIDIA Nemotron cho phép mô hình duy trì mạch thông tin xuyên suốt giữa nhiều tài liệu, quy trình và hội thoại phức tạp trong cùng một tác vụ.

Viettel huấn luyện mô hình ai chủ quyền tiếng Việt 120 tỷ tham số, đạt hiệu suất thuộc nhóm dẫn đầu cùng quy mô ảnh 2
VT-Super-120B-A12B được xây dựng trên kiến trúc mở NVIDIA Nemotron 3 Super, có khả năng xử lý ngữ cảnh dài (Ảnh: NVIDIA)

Đây là năng lực đặc biệt quan trọng với các bài toán vận hành đặc thù tại Việt Nam, nơi nhiều quy định và quy trình có thể thay đổi tùy theo loại hồ sơ, đối tượng liên quan hoặc bối cảnh thực thi cụ thể. Việc sở hữu một mô hình lõi có khả năng ghi nhớ và thích ứng linh hoạt với dữ liệu thực tế tạo tiền đề để Viettel AI tinh chỉnh LLM đạt độ chính xác cao, giải quyết triệt để việc tối ưu hóa ứng dụng AI cho từng tổ chức, doanh nghiệp Việt Nam.

Bên cạnh việc kế thừa năng lực từ kiến trúc NVIDIA Nemotron 3 Super, Viettel AI cũng xây dựng quy trình huấn luyện LLM dựa trên các nguồn dữ liệu mang tính bản địa như dữ liệu hành chính, nghiệp vụ doanh nghiệp, hội thoại thực tế và hệ thống văn bản chuyên ngành tại Việt Nam. Quá trình này bao gồm nhiều giai đoạn huấn luyện; trong đó, giai đoạn tiếp tục tiền huấn luyện (continued pre-training) mở rộng năng lực ngôn ngữ và tri thức tiếng Việt trên kho dữ liệu quy mô lớn. Tiếp theo, mô hình được tinh chỉnh có giám sát (supervised fine-tuning) nhằm cải thiện khả năng suy luận, sau đó được học tăng cường (reinforcement learning) để nâng cao độ chính xác trong phản hồi và khả năng xử lý nghiệp vụ.

Ông Nguyễn Mạnh Quý, Giám đốc Viettel AI, nhận định: “AI đang chuyển từ vai trò hỗ trợ sang lớp hạ tầng công nghệ mới. Quốc gia nào làm chủ được mô hình, dữ liệu và năng lực huấn luyện sẽ có lợi thế tạo ra những hệ thống phục vụ đúng nhu cầu phát triển của mình. Với Viettel, làm chủ LLM tiếng Việt là bước đi cốt lõi để hình thành các giải pháp AI chủ quyền có khả năng đồng hành thực sự cùng các tổ chức, doanh nghiệp Việt Nam.”

Làm chủ LLM tiếng Việt là bước đi cốt lõi để hình thành các giải pháp AI chủ quyền tại Việt Nam

Shilpa Kolhatkar, Giám đốc AI Nations của NVIDIA cho biết: “Thông qua việc thúc đẩy phát triển AI chủ quyền và AI chuyên biệt theo từng lĩnh vực, Viettel đang góp phần phổ cập khả năng tiếp cận trí tuệ nhân tạo trên quy mô toàn xã hội, đồng thời chuyển hóa ngôn ngữ và dữ liệu bản địa thành những giá trị ứng dụng thực tiễn cho cơ quan chính phủ và doanh nghiệp.”

Trên nền tảng mô hình này, Viettel AI đang phát triển nền tảng AI Agent dành cho người Việt với khả năng tự thực hiện chuỗi tác vụ trong cùng một không gian làm việc. Trong đó, Trợ lý AI Pháp luật là một trong những ứng dụng đầu tiên, được kỳ vọng sẽ sở hữu khả năng hỗ trợ phân tích hồ sơ, đối chiếu quy định, tổng hợp dữ liệu và đề xuất giải pháp xử lý theo bài toán cụ thể của người dùng, với chất lượng được nâng cao đáng kể so với các phiên bản trước đây.

Từ hành chính công, chăm sóc khách hàng đến vận hành doanh nghiệp và phân tích dữ liệu, VT-Super-120B-A12B được định hướng trở thành công nghệ lõi cho các hệ thống AI hiểu và phục vụ đúng nhu cầu thực tế của tổ chức, doanh nghiệp Việt Nam.

Khoảng cách khoa học dai dẳng đe dọa các nước đang phát triển, báo cáo mới của UNESCO cảnh báo
Khoảng cách khoa học dai dẳng đe dọa các nước đang phát triển, báo cáo mới của UNESCO cảnh báo
(Ngày Nay) - Ngày 15/7/2026, UNESCO khai mạc Hội nghị Toàn cầu 2026 của Thập kỷ Quốc tế về Khoa học vì Phát triển Bền vững (International Decade of Sciences for Sustainable Development - IDSSD), đồng thời công bố những dữ liệu mới cho thấy bức tranh trái chiều của khoa học toàn cầu: cộng đồng khoa học đã có sự huy động mạnh mẽ trong hai năm qua, nhưng khoảng cách giữa các quốc gia vẫn còn rất lớn, đặc biệt đối với các nước đang phát triển.
Sự kiện AI quy tụ hơn 1.000 chuyên gia và doanh nghiệp sẽ diễn ra tại TP.HCM vào tháng 8
Sự kiện AI quy tụ hơn 1.000 chuyên gia và doanh nghiệp sẽ diễn ra tại TP.HCM vào tháng 8
(Ngày Nay) - Hơn 1.000 lãnh đạo doanh nghiệp, chuyên gia công nghệ và nhà đầu tư từ nhiều quốc gia Đông Nam Á dự kiến sẽ tham dự The Future of Artificial Intelligence: Chapter 4 , diễn ra ngày 18/8/2026 tại TP.HCM. Đây là lần thứ tư hội nghị được tổ chức, do JDI và Hiệp hội Doanh nghiệp Hồng Kông tại Việt Nam đồng tổ chức, với sự hỗ trợ của NVIDIA AI Technology Centre (NVAITC) và Singapore Global Network.
Quốc lộ 12A là tuyến giao thông huyết mạch có hàng trăm lượt phương tiện vận tải lưu thông mỗi ngày. (Ảnh: Hoàng Anh)
Xe chở vật liệu vượt thành thùng trên Quốc lộ 12A, tiềm ẩn nguy cơ mất an toàn giao thông
(Ngày Nay) - Dù các quy định về tải trọng, kích thước xếp hàng và che chắn phương tiện đã được tuyên truyền, kí cam kết chấp hành trong hoạt động vận tải, tình trạng xe chở vật liệu xây dựng rời mỏ với hàng hóa chất cao vượt thành thùng vẫn được ghi nhận trên Quốc lộ 12A, tỉnh Quảng Trị. Thực trạng này tiềm ẩn nguy cơ mất an toàn giao thông và ảnh hưởng đến môi trường.
Gemini Hùng Huỳnh, UPRIZE cùng dàn nghệ sĩ trẻ hội tụ tại VSHOW Hòa Âm Quang Phổ
Gemini Hùng Huỳnh, UPRIZE cùng dàn nghệ sĩ trẻ hội tụ tại VSHOW Hòa Âm Quang Phổ
(Ngày Nay) - VShow Hòa Âm Quang Phổ sẽ diễn ra lúc 19 giờ ngày 25/7 tại Quảng trường Châu Âu, Vinhomes Royal Island (Vũ Yên, Hải Phòng), với sự góp mặt của UPRIZE, Hoàng Duyên, Phúc Du, MaiQuinn, Gemini Hùng Huỳnh và OgeNus. Lấy thông điệp "Bùng nổ giác quan" , chương trình được xây dựng như một không gian nơi sáu cá tính âm nhạc cùng hội tụ, tạo nên bức tranh thanh xuân với nhiều gam màu khác nhau. 
Nhiều trang báo quốc tế đưa tin về DANAFF IV
Nhiều trang báo quốc tế đưa tin về DANAFF IV
(Ngày Nay) - Khép lại vào đầu tháng 7/2026, Liên hoan phim Châu Á Đà Nẵng lần thứ IV (DANAFF IV) đã tạo được sự chú ý đáng kể trên truyền thông quốc tế. Từ những tạp chí chuyên ngành điện ảnh của Hollywood đến hệ thống báo chí, trang tin giải trí tại châu Á và châu Âu, hơn 40 cơ quan truyền thông tại Hàn Quốc, Hoa Kỳ, Bangladesh, Italy, Thổ Nhĩ Kỳ và Pháp đã đưa tin về sự kiện, cho thấy vị thế ngày càng rõ nét của DANAFF trên bản đồ liên hoan phim khu vực.
Trung Quốc - Kính AI trở thành công cụ gian lận mới
Trung Quốc - Kính AI trở thành công cụ gian lận mới
(Ngày Nay) - Sự xuất hiện của kính thông minh tích hợp trí tuệ nhân tạo (AI) đang tạo ra thách thức mới đối với công tác coi thi tại Trung Quốc, khi một số thí sinh lợi dụng thiết bị này để gian lận trong các kỳ thi.
Đồng chí Trần Cẩm Tú, Ủy viên Bộ Chính trị, Thường trực Ban Bí thư chủ trì giao ban. Ảnh: Phương Hoa/TTXVN
Thường trực Ban Bí thư Trần Cẩm Tú chủ trì Hội nghị giao ban quý II/2026
(Ngày Nay) - Sáng 14/7, tại Hà Nội, Ủy viên Bộ Chính trị, Thường trực Ban Bí thư Trần Cẩm Tú chủ trì Hội nghị giao ban quý II/2026 với các tỉnh ủy, thành ủy, đảng ủy, các ban đảng, 4 văn phòng, các đơn vị sự nghiệp trực thuộc Trung ương, đánh giá thực hiện nhiệm vụ quý II/2026 và triển khai những nhiệm vụ trọng tâm thời gian tới.