DeepSeek ra mắt V3.2, cạnh tranh GPT-5 và Gemini 3

Sơn Trần

09/12/2025

Trong cuộc đua tạo ra các mô hình AI thế hệ mới, khả năng mở rộng sức mạnh tính toán đang trở thành yếu tố quyết định…

DeepSeek khẳng định năng lực mô hình mới tương đương GPT-5 của OpenAI và Gemini-3.0-Pro của Google

Startup trí tuệ nhân tạo Trung Quốc - DeepSeek vừa công bố hai mô hình mới nhất của hãng: DeepSeek-V3.2 và DeepSeek-V3.2-Speciale. Công ty khẳng định đây là những mô hình mạnh nhất mà họ từng phát triển, với năng lực tương đương GPT-5 của OpenAI và Gemini-3.0-Pro của Google.

Đáng chú ý, DeepSeek cho biết phiên bản V3.2-Speciale đã đạt “thành tích huy chương vàng” trong bài kiểm tra nội bộ mô phỏng kỳ thi Olympic Toán học quốc tế (IMO), theo Kr Asia.

DeepSeek công bố tiếp tục mở rộng chiến lược bằng cách tạo ra hiệu suất cạnh tranh nhưng giảm đáng kể mức tiêu thụ tính toán nhờ tối ưu kiến trúc. Mô hình V3.2 tích hợp cơ chế DeepSeek Sparse Attention (DSA) – một cơ chế chú ý độc quyền nhằm giảm tải xử lý khi làm việc với tài liệu dài và nhiệm vụ phức tạp. DSA phát triển từ kiến trúc V3.1-Terminus và đã được thử nghiệm thông qua phiên bản thử nghiệm DeepSeek-V3.2-Exp ra mắt hồi tháng 9.

TỐI ƯU SỨC MẠNH TÍNH TOÁN

Theo cơ chế truyền thống, attention của AI, công nghệ cho phép mô hình hiểu ngữ cảnh, sẽ tăng chi phí tính toán theo cấp số nhân khi độ dài đầu vào tăng. Xử lý một văn bản dài gấp đôi thường cần lượng tính toán gấp bốn lần. DeepSeek cho biết cơ chế DSA giải quyết triệt để điểm nghẽn này nhờ “bộ lập chỉ mục lightning indexer”, cho phép xác định vùng ngữ cảnh liên quan nhất và bỏ qua phần còn lại.

Theo báo cáo kỹ thuật, DSA giúp giảm khoảng một nửa chi phí suy luận với tác vụ chuỗi dài. Kiến trúc này “giảm đáng kể độ phức tạp tính toán nhưng vẫn giữ chất lượng mô hình”, DeepSeek cho biết, đồng thời ước tính mức giảm chi phí suy luận tổng thể đạt khoảng 70%.

Tính toán hiệu quả đã trở thành dấu ấn trong các sản phẩm DeepSeek gần đây. Mô hình V3 ra mắt tháng 1 sử dụng kiến trúc mixture-of-experts, chỉ kích hoạt một phần tham số cho mỗi token. Thay vì định vị V3 là bước đệm cho mô hình lớn hơn, công ty nhấn mạnh rằng việc định tuyến thông minh có thể duy trì sức mạnh mà vẫn giảm áp lực vận hành.

Ngay sau đó là R1 – mô hình dùng huấn luyện tăng cường để nâng cao khả năng suy luận và lập trình. Các công bố cho thấy R1 chạy trên GPU Nvidia H800 cũ hơn và được huấn luyện với chi phí thấp hơn đáng kể so với nhiều mô hình cùng thời. Khả năng suy luận rẻ và giấy phép mở linh hoạt giúp R1 được nhiều doanh nghiệp lựa chọn, đồng thời góp phần đẩy mạnh làn sóng AI mã nguồn mở, cùng với mô hình Qwen của Alibaba và Hunyuan của Tencent.

DeepSeek-V3.2 và V3.2-Speciale tiếp tục tập trung và nhiệm vụ suy luận và workflow agent trong khi duy trì mức vận hành nhẹ, ít tốn tài nguyên.

ÁP LỰC CHI PHÍ VÀ NĂNG LƯỢNG

DeepSeek thu hút nhiều sự chú ý một phần vì kinh tế triển khai AI vẫn còn là thách thức. Dù doanh nghiệp đổ hàng tỷ USD vào trung tâm dữ liệu và phần cứng, chi phí suy luận vẫn chưa giảm đủ nhanh để cải thiện biên lợi nhuận. Ngay cả OpenAI, công ty tạo ra bước ngoặt với ChatGPT, sau ba năm vẫn chưa có lãi. Trong khi đó, kích thước mô hình ngày càng lớn, khiến chi phí vận hành vẫn rất cao.

Những áp lực này từng thúc đẩy doanh nghiệp sớm đón nhận mô hình R1. Các công ty tích hợp R1 thường nhấn mạnh chi phí suy luận thấp là yếu tố then chốt, đặc biệt trong ngành mà độ trễ và chi phí tác động trực tiếp đến trải nghiệm người dùng và biên lợi nhuận sản phẩm.

Tiêu thụ năng lượng cũng là một rào cản. Ở nhiều khu vực, sự mở rộng của trung tâm dữ liệu làm dấy lên lo ngại về nguồn điện và tác động môi trường. Vì suy luận chiếm tỷ trọng lớn trong tổng năng lượng AI, một số mô hình hiệu quả có thể giảm đáng kể chi phí và gánh nặng hạ tầng. Cách tiếp cận kỹ thuật của DeepSeek hướng trực tiếp vào bài toán này, nỗ lực mở rộng khả năng suy luận mà không cần đầu tư hạ tầng quy mô khổng lồ.

Tuy nhiên, chiến lược “tập trung hiệu suất” của DeepSeek cũng đi kèm giới hạn khi doanh nghiệp so sánh với mô hình của OpenAI hay Google. Một trong những hạn chế đó là DeepSeek đạt điểm mạnh ở suy luận và tác vụ có cấu trúc, nhưng lại không có sự đa nhiệm đa phương thức hoặc khả năng vận hành end-to-end của hệ thống lớn.

Ở tình huống cần xử lý audio, hình ảnh, video hoặc tool use, nhiều lựa chọn khác vẫn nổi trội hơn. Ví dụ, Kling AI của Kuaishou đang gây chú ý lớn trong mảng tạo video. Trong khi đó, Janus, dòng mô hình đa phương thức của DeepSeek ra mắt năm ngoái, không tạo được sức ảnh hưởng quốc tế tương tự. Mô hình DeepSeek-OCR công bố hồi tháng 10 chủ yếu tập trung tối ưu ngữ cảnh dài bằng kỹ thuật ánh xạ quang học 2D.

GIỚI HẠN TRUY CẬP

DeepSeek-V3.2 hiện có mặt trên ứng dụng web, app di động và API. Trong khi đó, V3.2-Speciale, phiên bản được khẳng định là mạnh nhất, mới chỉ có qua API và công ty chưa thông báo liệu có mở trên kênh khác hay không.

Tính đến tháng 10, ứng dụng di động DeepSeek có khoảng 72 triệu người dùng hoạt động trên toàn cầu, theo dữ liệu từ Aicpb.

Hai mô hình mới cho thấy DeepSeek đang tiếp tục đóng vai “kẻ thách thức” bằng cách theo đuổi con đường tối ưu hóa năng lực – chi phí, thay vì chạy đua kích thước mô hình. Trong bối cảnh ngành AI chịu sức ép về chi phí, năng lượng và hạ tầng, chiến lược này có thể giúp DeepSeek giữ lợi thế khác biệt so với các ông lớn.

Từ khóa:

AI đang mở ra một cuộc cạnh tranh mới. Ảnh: Forbes

AI chuyển sang cuộc đua mới: Lớn nhất không còn là “tốt nhất”

Thay vì chỉ chạy đua xây dựng những mô hình ngày càng lớn và đắt đỏ, các doanh nghiệp hiện quan tâm nhiều hơn đến các mô hình thông minh và hiệu quả nhất…

16:39 16/07/2026

StepFun, startup được Tencent hậu thuẫn, đã giới thiệu mẫu StepX Neo. Ảnh: SCMP

Startup Trung Quốc ra smartphone AI đầu tiên trên thế giới

Trong khi Apple và OpenAI vướng vào cuộc chiến pháp lý liên quan đến phần cứng AI, startup StepFun của Trung Quốc đã giới thiệu mẫu smartphone được xây dựng hoàn toàn xoay quanh các AI agent, thay vì chỉ bổ sung các tính năng AI lên nền tảng di động truyền thống…

16:39 16/07/2026

Giống sắn được phát triển từ nghiên cứu của GS. Lê Huy Hàm hội tụ đồng thời nhiều đặc tính ưu việt: Kháng bệnh khảm lá, cho năng suất tinh bột cao và có kiểu hình thân thẳng. Ảnh: Quỹ Thiện tâm.

Mạng lưới khoa học quốc tế: "Hạ tầng mềm" cho đổi mới sáng tạo Việt Nam

Từ nghiên cứu vật liệu, nông nghiệp, y tế đến chuyển đổi xanh, ngày càng nhiều kết nối giữa các nhà khoa học quốc tế và các nhóm nghiên cứu trong nước đang được chuyển hóa thành những dự án hướng trực tiếp vào các bài toán phát triển của Việt Nam...

16:38 16/07/2026

Airbus dự báo thế giới sẽ cần khoảng 42.060 máy bay mới trong 20 năm tới.

Công nghệ máy bay mở ra mạng lưới hàng không mới

Những bước tiến về hiệu quả khai thác, tầm bay và khả năng tiết kiệm nhiên liệu của máy bay thế hệ mới đang làm thay đổi cách ngành hàng không phát triển mạng lưới kết nối trên toàn cầu...

15:20 10/07/2026

WAIC năm nay, diễn ra từ ngày 17-20/7 tại Thượng Hải, được xem là một trong những sự kiện AI lớn nhất châu Á. Ảnh: SCMP

Trung Quốc phô diễn sức mạnh AI, hé lộ điện thoại AI Agent đầu tiên thế giới

Hội nghị Trí tuệ nhân tạo Thế giới (World Artificial Intelligence Conference - WAIC) 2026 sẽ trở thành sân khấu để Trung Quốc trình làng hàng loạt công nghệ AI thế hệ mới, từ hạ tầng tính toán quy mô lớn đến các thiết bị AI dành cho người dùng cuối…

11:49 09/07/2026

Trung Quốc đang nổi lên như một trong những động lực tăng trưởng quan trọng nhất của ngành robotaxi. Ảnh: SCMP

Thị trường robotaxi toàn cầu có thể đạt 1.000 tỷ USD vào năm 2040

Dự kiến chi phí linh kiện cho mỗi chiếc xe taxi tự lái sản xuất tại Trung Quốc sẽ giảm xuống còn từ 35.000 đến 40.000 đô la Mỹ vào năm 2027…

16:33 07/07/2026

Đại sứ quán Đan Mạch tại Việt Nam và Bảo hiểm Xã hội (BHXH) Việt Nam vừa ký kết Biên bản ghi nhớ (MoU) giai đoạn 2026–2028

Đan Mạch và Việt Nam thúc đẩy y tế số, nâng cao chất lượng chăm sóc sức khỏe

Hợp tác giữa Đại sứ quán Đan Mạch và Bảo hiểm Xã hội Việt Nam bước vào giai đoạn hợp tác mới 2026–2028 với trọng tâm là phát triển y tế số, ứng dụng dữ liệu y tế và kinh tế y tế trong hoạch định chính sách…

16:33 07/07/2026

Nhu cầu về các giải pháp an ninh mạng đang tăng mạnh, đặc biệt khi các quy định về an ninh thông tin và bảo vệ dữ liệu ngày càng chặt chẽ

Doanh nghiệp Việt trước thách thức kép về an ninh mạng từ bên ngoài và trong nội bộ

Trong bối cảnh nền kinh tế số tại Việt Nam phát triển với tốc độ chóng mặt, khối lượng dữ liệu được tạo ra tăng lên vượt bậc, khiến dữ liệu trở thành tài sản giá trị nhưng cũng dễ bị thất thoát và lạm dụng hơn bao giờ hết.

16:33 07/07/2026

Theo bảng xếp hạng TOP500 công bố tháng 6/2026, siêu máy tính LineShine của Trung Quốc đạt hiệu năng 2,198 exaflop trên bài kiểm tra HPL. Ảnh: Reuters

Trung Quốc vượt Mỹ trên bảng xếp hạng TOP500 siêu máy tính nhanh nhất thế giới

Sau ba năm đứng ngoài bảng xếp hạng TOP500, Trung Quốc đã trở lại đầy ấn tượng khi siêu máy tính LineShine vươn lên vị trí số một thế giới trong bảng xếp hạng tháng 6/2026...

16:29 06/07/2026

V-Bench là bộ công cụ đánh giá năng lực của các mô hình ngôn ngữ lớn (LLM) dành cho tiếng Việt

VinUni ra mắt bộ công cụ đánh giá năng lực AI dành cho tiếng Việt

Bộ công cụ có khả năng đánh giá toàn diện năng lực tiếng Việt của các mô hình AI, qua đó cung cấp hệ tham chiếu khách quan, độc lập, làm cơ sở cho việc lựa chọn và ứng dụng AI trong thực tiễn...

16:28 06/07/2026