Alibaba ra mắt các mô hình AI chuyên về toán học được cho là vượt trội hơn LLM từ OpenAI, Google

Nguyễn Hà

14/08/2024

Alibaba vừa công bố một bước tiến quan trọng trong lĩnh vực AI với mô hình toán học mới, cho phép giải quyết các bài toán phức tạp một cách hiệu quả hơn. Mô hình này được kỳ vọng sẽ tạo ra những đột phá trong nhiều lĩnh vực, từ nghiên cứu khoa học đến ứng dụng thực tiễn…

Các mô hình LLM dành riêng cho toán học của Alibaba đã nâng cao vị thế của công ty trong lĩnh vực AI

Để dẫn đầu trong cuộc đua phát triển trí tuệ nhân tạo, Alibaba đã cho ra mắt Qwen2-Math. Đây là một bộ các mô hình ngôn ngữ lớn được thiết kế đặc biệt để giải quyết các bài toán toán học. Alibaba tự tin cho biết Qwen2-Math có khả năng vượt qua cả GPT-4o của OpenAI, một trong những mô hình AI hàng đầu hiện nay.

Trong một bài đăng trên GitHub, nhóm Qwen thuộc đơn vị điện toán đám mây của Alibaba đã chia sẻ về quá trình nghiên cứu kéo dài một năm để cải thiện khả năng lập luận toán học của các mô hình ngôn ngữ lớn. Nhóm nghiên cứu đã tập trung vào việc nâng cao khả năng giải quyết các bài toán số học của các mô hình này.

THÀNH TÍCH VƯỢT TRỘI CỦA QWEN2 TRONG LĨNH VỰC TOÁN HỌC

Nhóm Qwen chia sẻ trong bài đăng rằng: "Trong năm qua, chúng tôi đã dành nhiều nỗ lực để nghiên cứu và nâng cao khả năng lập luận của các mô hình ngôn ngữ lớn (LLM), đặc biệt tập trung vào khả năng giải quyết các bài toán số học".

Alibaba đã phát hành Qwen2 vào tháng 6, một hệ thống gồm nhiều mô hình AI khác nhau. Những mô hình này được thiết kế để tạo ra các văn bản giống như con người. Mỗi mô hình trong Qwen2 có một số lượng tham số khác nhau.

Tham số ở đây giống như những nút điều chỉnh nhỏ, giúp chúng ta tùy chỉnh cách mô hình hoạt động để đạt được kết quả mong muốn. Nhờ vào các tham số này, các mô hình AI có thể thực hiện nhiều tác vụ phức tạp, từ viết văn, dịch thuật cho đến trả lời các câu hỏi phức tạp.

Theo nhóm Qwen, mô hình Qwen2-Math-72B-Instruct, với số lượng tham số lớn nhất, đã xuất sắc vượt qua các đối thủ cạnh tranh đến từ các công ty công nghệ hàng đầu Hoa Kỳ như OpenAI (GPT-4o), Anthropic (Claude 3.5 Sonnet), Google (Gemini 1.5 Pro) và Meta (Llama-3.1-405B) trong các bài kiểm tra toán học.

Mặc dù nhóm Qwen bày tỏ hy vọng rằng Qwen2-Math sẽ trở thành công cụ hữu ích để giải quyết các bài toán phức tạp, họ cũng thừa nhận rằng mô hình hiện tại chỉ hỗ trợ tiếng Anh. Tuy nhiên, nhóm đang tích cực phát triển các phiên bản song ngữ và đa ngôn ngữ để mở rộng phạm vi ứng dụng của mô hình trong tương lai.

Tongyi Qianwen, còn được gọi là Qwen, hiện bao gồm các LLM dành riêng cho toán học.

Thành tích dẫn đầu bảng xếp hạng 10 mô hình nguồn mở hàng đầu thế giới của Qwen-72B-Instruct LLM đã càng khẳng định vị thế hàng đầu của Alibaba trong lĩnh vực trí tuệ nhân tạo. Những mô hình toán học tiên tiến này không chỉ góp phần nâng cao uy tín của công ty mà còn chứng tỏ sự phát triển vượt bậc của AI tại Trung Quốc.

TIỀM NĂNG CỦA CÁC MÔ HÌNH NGÔN NGỮ LỚN TRUNG QUỐC

Với việc mở cửa mã nguồn Tongyi Qianwen trong hơn một năm, Alibaba đã tạo ra một cộng đồng phát triển sôi động. Các nhà phát triển trên toàn thế giới có thể tự do truy cập, sửa đổi và chia sẻ mã nguồn, từ đó tạo ra những ứng dụng và dịch vụ mới dựa trên nền tảng này. Điều này không chỉ thúc đẩy sự phát triển của AI mà còn góp phần xây dựng một hệ sinh thái công nghệ mở.

Trong bảng xếp hạng LLM của SuperClue vào tháng 7, Qwen2-72B-Instruct đã thể hiện khả năng vượt trội, chỉ xếp sau hai mô hình hàng đầu là GPT-4o và Claude 3.5 Sonnet. Điều này chứng tỏ mô hình này có khả năng tính toán, suy luận logic, mã hóa và hiểu văn bản rất tốt.

Theo đánh giá của SuperClue, khoảng cách giữa các mô hình AI của Trung Quốc và Mỹ đang dần thu hẹp lại. Kết quả này cho thấy nỗ lực không ngừng của các nhà nghiên cứu Trung Quốc trong việc phát triển các LLM có khả năng cạnh tranh trên trường quốc tế.

Năm mô hình của Trung Quốc, bao gồm Alibaba, công ty khởi nghiệp Deepseek, SenseTime niêm yết tại Hồng Kông, nhà cung cấp điện thoại thông minh Oppo và nỗ lực hợp tác giữa Đại học Thanh Hoa và công ty khởi nghiệp Zhipu AI, đã vượt trội hơn GPT-4 Turbo – một trong những mô hình tốt nhất từ OpenAI do Microsoft hậu thuẫn, theo SuperClue.

Một bài kiểm tra riêng được công bố vào tháng 7 bởi LMSYS - một tổ chức nghiên cứu mô hình AI được hỗ trợ bởi Đại học California, Berkeley - cho thấy Qwen2-72B được xếp hạng 20, trong khi các mô hình độc quyền từ OpenAI, Anthropic và Google chiếm hầu hết các vị trí trong top 10.

Nhận thức người dùng là “lá chắn” trong cuộc chiến chống gian lận tài chính thời AI

Dù lừa đảo trực tuyến tại Việt Nam có dấu hiệu giảm nhiệt, các hình thức gian lận ngày càng tinh vi như “gian lận ủy quyền thanh toán” vẫn đặt ra thách thức lớn cho ngành tài chính. Các chuyên gia cho rằng bên cạnh công nghệ bảo mật, nâng cao nhận thức người dùng là yếu tố then chốt trong phòng chống lừa đảo…

10:50 12/06/2026

SpaceX vừa lần đầu công bố thiết kế vệ tinh trung tâm dữ liệu AI trên quỹ đạo mang tên AI1

SpaceX hé lộ trung tâm dữ liệu AI đầu tiên trên quỹ đạo

Dự án điện toán ngoài không gian hiện đóng vai trò trung tâm trong câu chuyện tăng trưởng mà SpaceX đang trình bày với giới đầu tư...

16:28 11/06/2026

Dự án trung tâm dữ liệu dưới biển Shanghai Lingang chính thức đi vào hoạt động từ tháng 5, với công suất 24 MW

Trung Quốc vận hành trung tâm dữ liệu dưới biển đầu tiên thế giới

Trung Quốc vừa đưa vào vận hành trung tâm dữ liệu dưới biển sử dụng điện gió ngoài khơi đầu tiên trên thế giới, đánh dấu một bước thử nghiệm mới nhằm giải quyết bài toán năng lượng cho hạ tầng AI…

17:37 10/06/2026

Phòng thí nghiệm mới sử dụng trí tuệ nhân tạo sẽ tập trung vào nghiên cứu về di truyền học, protein và hoạt động não bộ, hướng đến mục tiêu phát triển các loại thuốc mới.

Nhật Bản xây phòng thí nghiệm tự động hóa 100%, robot và AI là “nhân sự chính”

Dự án sẽ tập trung vào các lĩnh vực công nghệ sinh học như nghiên cứu gene, protein và hoạt động của não bộ...

16:51 09/06/2026

Chủ tịch CMC trao quyết định bổ nhiệm Tổng giám đốc Tập đoàn cho ông Đặng Tùng Sơn

CMC bổ nhiệm CEO 8X, tăng tốc chiến lược chuyển đổi AI toàn cầu

Tập đoàn Công nghệ CMC bổ nhiệm ông Đặng Tùng Sơn làm Tổng giám đốc trong bối cảnh doanh nghiệp bước vào giai đoạn đổi mới lần thứ hai, đặt mục tiêu trở thành công ty chuyển đổi AI quy mô toàn cầu...

16:06 05/06/2026

Garena Việt Nam chính thức công bố mảng đầu tư mạo hiểm.

Garena Việt Nam công bố mảng Đầu tư mạo hiểm, đồng hành cùng các game studio Việt Nam

Garena Việt Nam mở rộng cam kết với ngành game nội địa thông qua hoạt động đầu tư, ươm tạo và xây dựng cộng đồng dành cho các nhà phát triển game tại Việt Nam.

14:31 05/06/2026

Chủ tịch HĐQT, Chủ tịch điều hành Tập đoàn Công nghệ CMC Nguyễn Trung Chính phát biểu tại Lễ kỷ niệm 33 năm thành lập CMC, tổ chức tại Hoàng thành Thăng Long

CMC vượt mốc doanh thu 10.500 tỷ đồng

Lần đầu vượt mốc doanh thu hơn 10.500 tỷ đồng sau 33 năm phát triển, CMC đặt mục tiêu bước vào chu kỳ đổi mới lần hai, lấy AI-X làm động lực tăng trưởng mới.

17:31 30/05/2026

Tổng thư ký Tạp chí Kinh tế Việt Nam/VnEconomy Đào Quang Bính chia sẻ với ông Lê Hồng Quang, Tổng Giám đốc Tập đoàn MISA về bộ giải pháp AI Made in Vietnam Askonomy dành cho doanh nghiệp và tổ chức - Ảnh Việt Dũng.

Askonomy nhận được sự quan tâm lớn tại Vietnam –Asia DX Summit 2026

Xuất hiện tại không gian triển lãm của Diễn đàn Vietnam – Asia DX Summit 2026, bộ giải pháp AI Made in Vietnam Askonomy đã thu hút sự quan tâm của giới chức và các doanh nghiệp công nghệ hàng đầu khi trình diễn năng lực tự động hóa thông minh dựa trên nền tảng công nghệ lõi tự phát triển...

16:22 28/05/2026

Robot hình người hiện là một phần quan trọng trong chiến lược công nghiệp dài hạn của Bắc Kinh.

Đào tạo nghề cho robot: Trung Quốc chuẩn bị đưa máy móc gia nhập lực lượng lao động

Những kỹ năng robot được học rất đa dạng: dọn dẹp nhà cửa, massage, sắp xếp hàng hóa trên kệ siêu thị, sửa chữa kim loại hay làm việc trên dây chuyền công nghiệp…

18:45 22/05/2026

Hạ tầng AI đang định hình lại căn bản cách điện năng được cung cấp

ADI chi 1,5 tỷ USD mua lại Empower Semiconductor, mở rộng giải pháp nguồn điện cho AI

Thông qua thỏa thuận này, ADI và Empower hỗ trợ định hình kiến trúc cung cấp điện năng cho AI cũng như các ứng dụng đòi hỏi năng lực tính toán cao.

18:45 22/05/2026