image Thứ Tư, 25/02/2026

Alibaba ra mắt mô hình ngôn ngữ lớn dành riêng cho Đông Nam Á

Hoàng Hà

14/12/2023

Chia sẻ

Các mô hình ngôn ngữ lớn LLM dự kiến sẽ hỗ trợ tối ưu cho một số ngôn ngữ địa phương trong khu vực, bao gồm tiếng Việt, Indonesia, Thái Lan, Malay, Khmer, Lào, Tagalog và Miến Điện…

Alibaba DAMO Academy tuyên bố ra mắt SeaLLMs. Hình ảnh do AI tạo ra
Alibaba DAMO Academy tuyên bố ra mắt SeaLLMs. Hình ảnh do AI tạo ra

Tuần trước, Singapore đã công bố kế hoạch phát triển hệ sinh thái mô hình ngôn ngữ lớn (LLM) đầu tiên, phục vụ cho văn hóa và ngôn ngữ đa dạng của khu vực Đông Nam Á. Hiện tại, hầu hết các LLM hiện có đều chỉ sẵn các giá trị và chuẩn mực phục vụ nhiều hơn cho các nước phương Tây.

HỖ TRỢ CÁC NGÔN NGỮ ĐỊA PHƯƠNG CỦA ĐÔNG NAM Á

Giống như tham vọng LLM của Singapore, Học viện Alibaba Damo của Trung Quốc cũng đã tiết lộ SEALLMS. Alibaba Seallms là một LLM tiên phong đi kèm với 13 tỷ phiên bản tham số và 7 tỷ phiên bản được thiết kế đặc biệt để phục vụ cho các ngôn ngữ đa dạng của Đông Nam Á.

Mặc dù tiếng Anh vẫn được sử dụng rộng rãi trong khu vực, ngôn ngữ bản địa vẫn là một công cụ truyền thông quan trọng của các nước. Ví dụ, ở Malaysia, mặc dù tiếng Anh vẫn được nói chủ yếu, nhưng Malay vẫn là ngôn ngữ được các cơ quan chính phủ sử dụng để truyền thông chính thức, giống như tại các nước Thái Lan, Indonesia, Campuchia, Lào, Việt Nam và Myanmar. Ở Philippines, tiếng Anh là một ngôn ngữ chính, nhưng Tagalog chủ yếu được sử dụng trong giao tiếp.

Các mô hình LLM dự kiến sẽ hỗ trợ tối ưu cho một số ngôn ngữ địa phương trong khu vực, bao gồm tiếng Việt, Indonesia, Thái Lan, Malay, Khmer, Lào, Tagalog và Miến Điện. Seallm-Chat, mô hình hội thoại, cho thấy khả năng thích ứng với kết cấu văn hóa độc đáo của mỗi thị trường, phù hợp với phong tục, phong cách và khung pháp lý địa phương, làm trợ lý chatbot cho các doanh nghiệp tham gia với các thị trường Đông Nam Á.

SEALLMS là một loạt các mô hình AI không chỉ hiểu các ngôn ngữ địa phương mà còn bao gồm sự phong phú về văn hóa của Đông Nam Á. Sự đổi mới này được thiết lập để đẩy nhanh việc dân chủ hóa AI, trao quyền cho các cộng đồng được thể hiện trong lịch sử trong lĩnh vực kỹ thuật số.

SEALLM HOẠT ĐỘNG NHƯ THẾ NÀO?

Theo một báo cáo của các nhà nghiên cứu Alibaba Damo, các mô hình SEALLM-cơ sở đã trải qua việc đào tạo trước trên một bộ dữ liệu chất lượng cao, đa dạng bao gồm các ngôn ngữ từ khu vực. Điều này là để đảm bảo một sự hiểu biết sắc thái về bối cảnh địa phương và giao tiếp bản địa.

Bộ dữ liệu đào tạo của SEALLM được hình thành bởi các tài liệu từ các nguồn công cộng khác nhau, bao gồm các văn bản web, tài liệu tin tức, bài báo học thuật và văn bản có kiến thức chuyên môn. Trước tiên Alibaba sử dụng định danh ngôn ngữ fasttext để lọc các tài liệu không thuộc về ngôn ngữ Đông Nam Á.

Để tiếp tục loại bỏ nội dung có hại hoặc không mong muốn, Alibaba phát triển một đường ống với các mô -đun lọc và lọc dữ liệu khác nhau để xử lý trước dữ liệu được thu thập. Trong khi đó, để duy trì hiệu suất tiếng Anh của SEALLMS, Alibaba cũng giới thiệu một tập hợp các văn bản tiếng Anh chất lượng cao được lấy mẫu từ Redpajama-Data vào đào tạo trước, các nhà nghiên cứu cho biết.

Công việc này đặt nền tảng cho các mô hình trò chuyện như SEALLM-Chat, được hưởng lợi từ các kỹ thuật điều chỉnh tinh chỉnh nâng cao và bộ dữ liệu đa ngôn ngữ được xây dựng tùy chỉnh. Do đó, các trợ lý chatbot dựa trên các mô hình này không chỉ có thể hiểu mà còn tôn trọng và phản ánh chính xác bối cảnh văn hóa của các ngôn ngữ này trong khu vực, chẳng hạn như các quy tắc xã hội và phong tục, sở thích phong cách và cân nhắc pháp lý.

VnEconomy

Một lợi thế kỹ thuật đáng chú ý của Alibaba Seallms là hiệu quả của chúng, đặc biệt là với các ngôn ngữ không phải là Latin. Chúng có thể giải thích và xử lý văn bản dài hơn tới chín lần (hoặc ít hơn các mã thông báo cho cùng một chiều dài của văn bản) so với các mô hình khác như ChatGPT cho các ngôn ngữ không phải là tiếng Latin như Miến Điện, Khmer, LAO và tiếng Thái. Điều đó chuyển thành khả năng thực hiện nhiệm vụ phức tạp hơn, giảm chi phí hoạt động và tính toán và chi phí môi trường thấp hơn. 


OpenAI quyết định khai tử mô hình mô hình 4o vì quá nịnh nọt người dùng?

Mô hình 4o của ChatGPT được rất nhiều người dùng ưa chuộng nhưng đây cũng có nhiều tranh cãi liên quan đến xu hướng trả lời nịnh nọt và những tác hại…

10:23 24/02/2026
Động cơ máy bay trở thành “nguồn phát điện mới” cho cơn khát AI

AI khiến các trung tâm dữ liệu cần nguồn điện khổng lồ và nhanh chóng, các nhà sản xuất truyền thống chưa kịp phản ứng và đã khoảng trống cho những “tay chơi” mới…

22:50 23/02/2026
CMC đặt mục tiêu đẩy mạnh chiến lược đi ra toàn cầu năm 2026

Bước sang năm 2026, Tập đoàn CMC đẩy mạnh chiến lược "Go Global" với mục tiêu thiết lập sự hiện diện vững chắc tại các thị trường công nghệ trọng điểm…

22:49 23/02/2026
Startup tạo bước ngoặt với pin giấy sinh học: Không lithium, không cháy nổ, có thể phân hủy hoàn toàn

Pin giấy có chi phí sản xuất thấp, dễ mở rộng quy mô và không phụ thuộc vào chuỗi cung ứng khoáng sản tập trung toàn cầu. Đây là yếu tố chiến lược trong bối cảnh các quốc gia ngày càng quan tâm đến an ninh năng lượng và tự chủ công nghệ...

14:33 13/02/2026
Nhật Bản thử nghiệm trung tâm dữ liệu AI nổi ngoài khơi

Đây là dự án thử nghiệm trung tâm dữ liệu nổi ngoài khơi sử dụng 100% năng lượng tái tạo...

14:31 13/02/2026
Trung Quốc "dốc toàn lực" cho robot hình người, tham vọng vượt Mỹ

Trung Quốc đang tăng tốc mạnh mẽ để thống lĩnh lĩnh vực robot hình người. Đây là lĩnh vực Bắc Kinh xác định sẽ nắm vai trò dẫn dắt trong vòng 5 năm tới...

19:40 10/02/2026
LinkedIn: AI trở thành tiêu chuẩn mới trong tuyển dụng

Nhà tuyển dụng sử dụng AI nhiều hơn nhằm chuẩn hóa quy trình tuyển dụng và tìm ứng viên nhanh hơn…

14:50 10/02/2026
Vốn đầu tư mạo hiểm đang "đổ bộ" vào robot hình người Trung Quốc

Đáng chú ý, làn sóng vốn mới đổ vào robot Trung Quốc đang chuyển sang trọng tâm xây dựng “bộ não” cho robot hình người…

18:52 06/02/2026
Mạng xã hội mới UpScrolled trở thành tâm điểm chú ý tại Hoa Kỳ trong bối cảnh TikTok tái cấu trúc

UpScrolled muốn tạo ra không gian nơi người dùng có thể “tự do bày tỏ suy nghĩ, chia sẻ khoảnh khắc và kết nối mọi người” bên ngoài các nền tảng Big Tech truyền thống…

18:52 06/02/2026
Không phải lập trình phần mềm, đâu mới là nghề đang được săn lùng khi AI nở rộ?

Khi các nội dung AI na ná nhau xuất hiện ngày càng nhiều, cuộc đua tìm kiếm những con người có thể kể chuyện thật sự ngày càng khốc liệt hơn…

18:51 06/02/2026