Alibaba ra mắt mô hình ngôn ngữ lớn dành riêng cho Đông Nam Á

Hoàng Hà

14/12/2023

Các mô hình ngôn ngữ lớn LLM dự kiến sẽ hỗ trợ tối ưu cho một số ngôn ngữ địa phương trong khu vực, bao gồm tiếng Việt, Indonesia, Thái Lan, Malay, Khmer, Lào, Tagalog và Miến Điện…

Alibaba DAMO Academy tuyên bố ra mắt SeaLLMs. Hình ảnh do AI tạo ra

Tuần trước, Singapore đã công bố kế hoạch phát triển hệ sinh thái mô hình ngôn ngữ lớn (LLM) đầu tiên, phục vụ cho văn hóa và ngôn ngữ đa dạng của khu vực Đông Nam Á. Hiện tại, hầu hết các LLM hiện có đều chỉ sẵn các giá trị và chuẩn mực phục vụ nhiều hơn cho các nước phương Tây.

HỖ TRỢ CÁC NGÔN NGỮ ĐỊA PHƯƠNG CỦA ĐÔNG NAM Á

Giống như tham vọng LLM của Singapore, Học viện Alibaba Damo của Trung Quốc cũng đã tiết lộ SEALLMS. Alibaba Seallms là một LLM tiên phong đi kèm với 13 tỷ phiên bản tham số và 7 tỷ phiên bản được thiết kế đặc biệt để phục vụ cho các ngôn ngữ đa dạng của Đông Nam Á.

Mặc dù tiếng Anh vẫn được sử dụng rộng rãi trong khu vực, ngôn ngữ bản địa vẫn là một công cụ truyền thông quan trọng của các nước. Ví dụ, ở Malaysia, mặc dù tiếng Anh vẫn được nói chủ yếu, nhưng Malay vẫn là ngôn ngữ được các cơ quan chính phủ sử dụng để truyền thông chính thức, giống như tại các nước Thái Lan, Indonesia, Campuchia, Lào, Việt Nam và Myanmar. Ở Philippines, tiếng Anh là một ngôn ngữ chính, nhưng Tagalog chủ yếu được sử dụng trong giao tiếp.

Các mô hình LLM dự kiến sẽ hỗ trợ tối ưu cho một số ngôn ngữ địa phương trong khu vực, bao gồm tiếng Việt, Indonesia, Thái Lan, Malay, Khmer, Lào, Tagalog và Miến Điện. Seallm-Chat, mô hình hội thoại, cho thấy khả năng thích ứng với kết cấu văn hóa độc đáo của mỗi thị trường, phù hợp với phong tục, phong cách và khung pháp lý địa phương, làm trợ lý chatbot cho các doanh nghiệp tham gia với các thị trường Đông Nam Á.

SEALLMS là một loạt các mô hình AI không chỉ hiểu các ngôn ngữ địa phương mà còn bao gồm sự phong phú về văn hóa của Đông Nam Á. Sự đổi mới này được thiết lập để đẩy nhanh việc dân chủ hóa AI, trao quyền cho các cộng đồng được thể hiện trong lịch sử trong lĩnh vực kỹ thuật số.

SEALLM HOẠT ĐỘNG NHƯ THẾ NÀO?

Theo một báo cáo của các nhà nghiên cứu Alibaba Damo, các mô hình SEALLM-cơ sở đã trải qua việc đào tạo trước trên một bộ dữ liệu chất lượng cao, đa dạng bao gồm các ngôn ngữ từ khu vực. Điều này là để đảm bảo một sự hiểu biết sắc thái về bối cảnh địa phương và giao tiếp bản địa.

Bộ dữ liệu đào tạo của SEALLM được hình thành bởi các tài liệu từ các nguồn công cộng khác nhau, bao gồm các văn bản web, tài liệu tin tức, bài báo học thuật và văn bản có kiến thức chuyên môn. Trước tiên Alibaba sử dụng định danh ngôn ngữ fasttext để lọc các tài liệu không thuộc về ngôn ngữ Đông Nam Á.

Để tiếp tục loại bỏ nội dung có hại hoặc không mong muốn, Alibaba phát triển một đường ống với các mô -đun lọc và lọc dữ liệu khác nhau để xử lý trước dữ liệu được thu thập. Trong khi đó, để duy trì hiệu suất tiếng Anh của SEALLMS, Alibaba cũng giới thiệu một tập hợp các văn bản tiếng Anh chất lượng cao được lấy mẫu từ Redpajama-Data vào đào tạo trước, các nhà nghiên cứu cho biết.

Công việc này đặt nền tảng cho các mô hình trò chuyện như SEALLM-Chat, được hưởng lợi từ các kỹ thuật điều chỉnh tinh chỉnh nâng cao và bộ dữ liệu đa ngôn ngữ được xây dựng tùy chỉnh. Do đó, các trợ lý chatbot dựa trên các mô hình này không chỉ có thể hiểu mà còn tôn trọng và phản ánh chính xác bối cảnh văn hóa của các ngôn ngữ này trong khu vực, chẳng hạn như các quy tắc xã hội và phong tục, sở thích phong cách và cân nhắc pháp lý.

Một lợi thế kỹ thuật đáng chú ý của Alibaba Seallms là hiệu quả của chúng, đặc biệt là với các ngôn ngữ không phải là Latin. Chúng có thể giải thích và xử lý văn bản dài hơn tới chín lần (hoặc ít hơn các mã thông báo cho cùng một chiều dài của văn bản) so với các mô hình khác như ChatGPT cho các ngôn ngữ không phải là tiếng Latin như Miến Điện, Khmer, LAO và tiếng Thái. Điều đó chuyển thành khả năng thực hiện nhiệm vụ phức tạp hơn, giảm chi phí hoạt động và tính toán và chi phí môi trường thấp hơn.

Chủ tịch CMC trao quyết định bổ nhiệm Tổng giám đốc Tập đoàn cho ông Đặng Tùng Sơn

CMC bổ nhiệm CEO 8X, tăng tốc chiến lược chuyển đổi AI toàn cầu

Tập đoàn Công nghệ CMC bổ nhiệm ông Đặng Tùng Sơn làm Tổng giám đốc trong bối cảnh doanh nghiệp bước vào giai đoạn đổi mới lần thứ hai, đặt mục tiêu trở thành công ty chuyển đổi AI quy mô toàn cầu...

16:06 05/06/2026

Garena Việt Nam chính thức công bố mảng đầu tư mạo hiểm.

Garena Việt Nam công bố mảng Đầu tư mạo hiểm, đồng hành cùng các game studio Việt Nam

Garena Việt Nam mở rộng cam kết với ngành game nội địa thông qua hoạt động đầu tư, ươm tạo và xây dựng cộng đồng dành cho các nhà phát triển game tại Việt Nam.

14:31 05/06/2026

Chủ tịch HĐQT, Chủ tịch điều hành Tập đoàn Công nghệ CMC Nguyễn Trung Chính phát biểu tại Lễ kỷ niệm 33 năm thành lập CMC, tổ chức tại Hoàng thành Thăng Long

CMC vượt mốc doanh thu 10.500 tỷ đồng

Lần đầu vượt mốc doanh thu hơn 10.500 tỷ đồng sau 33 năm phát triển, CMC đặt mục tiêu bước vào chu kỳ đổi mới lần hai, lấy AI-X làm động lực tăng trưởng mới.

17:31 30/05/2026

Tổng thư ký Tạp chí Kinh tế Việt Nam/VnEconomy Đào Quang Bính chia sẻ với ông Lê Hồng Quang, Tổng Giám đốc Tập đoàn MISA về bộ giải pháp AI Made in Vietnam Askonomy dành cho doanh nghiệp và tổ chức - Ảnh Việt Dũng.

Askonomy nhận được sự quan tâm lớn tại Vietnam –Asia DX Summit 2026

Xuất hiện tại không gian triển lãm của Diễn đàn Vietnam – Asia DX Summit 2026, bộ giải pháp AI Made in Vietnam Askonomy đã thu hút sự quan tâm của giới chức và các doanh nghiệp công nghệ hàng đầu khi trình diễn năng lực tự động hóa thông minh dựa trên nền tảng công nghệ lõi tự phát triển...

16:22 28/05/2026

Robot hình người hiện là một phần quan trọng trong chiến lược công nghiệp dài hạn của Bắc Kinh.

Đào tạo nghề cho robot: Trung Quốc chuẩn bị đưa máy móc gia nhập lực lượng lao động

Những kỹ năng robot được học rất đa dạng: dọn dẹp nhà cửa, massage, sắp xếp hàng hóa trên kệ siêu thị, sửa chữa kim loại hay làm việc trên dây chuyền công nghiệp…

18:45 22/05/2026

Hạ tầng AI đang định hình lại căn bản cách điện năng được cung cấp

ADI chi 1,5 tỷ USD mua lại Empower Semiconductor, mở rộng giải pháp nguồn điện cho AI

Thông qua thỏa thuận này, ADI và Empower hỗ trợ định hình kiến trúc cung cấp điện năng cho AI cũng như các ứng dụng đòi hỏi năng lực tính toán cao.

18:45 22/05/2026

Tính đến mùa giải 2026, VinFuture có 17.154 đối tác đề cử đến từ 117 quốc gia và vùng lãnh thổ trên cả 5 châu lục, tăng khoảng 16% so với năm 2025

VinFuture 2026 nhận 1.819 đề cử từ 117 quốc gia và vùng lãnh thổ

Giải thưởng Khoa học Công nghệ toàn cầu VinFuture vừa khép lại vòng đề cử mùa giải 2026 với 1.819 hồ sơ đến từ khắp thế giới, đồng thời ghi nhận mạng lưới hơn 17.000 đối tác đề cử đến từ 117 quốc gia và vùng lãnh thổ...

20:48 19/05/2026

Asian Hackathon for Green Future hướng tới trở thành nền tảng thúc đẩy giao lưu, hợp tác xuyên biên giới của giới trẻ khu vực để phát triển những giải pháp thiết thực cho cộng đồng. Ảnh: Trường ĐH VinUni.

Gần 450 đội thi từ khắp châu Á tham gia Asian Hackathon for Green Future 2026

Cuộc thi hướng đến mục tiêu tìm kiếm và hỗ trợ các sáng kiến công nghệ có khả năng ứng dụng thực tiễn để giải quyết những thách thức môi trường cấp bách tại châu Á, đồng thời thúc đẩy tinh thần đổi mới sáng tạo và hợp tác liên ngành trong thế hệ trẻ...

20:48 19/05/2026

Mạng lưới sức mạnh tính toán quốc gia được mô tả như một “phiên bản điện toán của lưới điện quốc gia”

Trung Quốc tăng tốc xây dựng mạng lưới sức mạnh tính toán quốc gia

Trung Quốc tham vọng biến hạ tầng trí tuệ nhân tạo (AI) thành một loại tiện ích công cộng tương tự điện, nước hay viễn thông...

10:19 18/05/2026

Đội ngũ IoT/Smart Devices Lab của CMC ATI phát triển các giải pháp AI ứng dụng cho thiết bị thông minh và định danh số

Thêm giải pháp AI "Make in Vietnam" đạt chuẩn quốc tế về chống giả mạo khuôn mặt

CIVAMS.FACE-FAS, giải pháp chống giả mạo khuôn mặt do CMC ATI phát triển, vượt qua bài đánh giá iBeta Level 1 theo tiêu chuẩn ISO/IEC 30107-3, tiếp tục ghi dấu năng lực AI “Make in Vietnam” trên các bảng xếp hạng quốc tế.

09:10 14/05/2026