DeepSeek và các mô hình mã nguồn mở đang thay đổi AI như thế nào?

Mai Anh

11/09/2025

Sự xuất hiện của DeepSeek và các mô hình có chi phí rẻ hơn dấy lên một cuộc đua mới không chỉ về hiệu suất giữa các mô hình AI…

Vị thế độc quyền của một số mô hình lớn từ Mỹ đã bị đe dọa kể từ khi DeepSeek ra đời. Ảnh: Bloomberg

Hồi đầu tháng 8 vừa qua, OpenAI thông báo phát hành hai mô hình ngôn ngữ tiên tiến có trọng số mở, lần đầu tiên kể từ khi triển khai GPT-2 vào năm 2019. Hai mô hình này, được gọi là gpt-oss-120b và gpt-oss-20b, chỉ có định dạng văn bản và được thiết kế để phục vụ các lựa chọn chi phí thấp hơn mà các nhà phát triển, nhà nghiên cứu và doanh nghiệp có thể dễ dàng tùy chỉnh.

“Nhìn thấy một hệ sinh thái phát triển thật thú vị, và chúng tôi rất vui khi được đóng góp vào hệ sinh thái đó, thúc đẩy ranh giới và xem điều gì sẽ xảy ra tiếp theo”, Chủ tịch OpenAI – ông Greg Brockman phát biểu trong cuộc họp báo công bố.

Một mô hình trí tuệ nhân tạo được xem là trọng số mở nếu các tham số, hoặc các yếu tố cải thiện kết quả đầu ra và dự đoán trong quá trình đào tạo, được công khai.

Các công ty công nghệ và giới học thuật từ lâu đã tranh luận về rủi ro và lợi ích khi xây dựng phần mềm mã nguồn mở. Nhưng làn sóng bùng nổ quanh trí tuệ nhân tạo tạo sinh đã mang lại ý nghĩa mới cho cuộc tranh luận này.

Làn sóng ấy được kích hoạt mạnh mẽ khi DeepSeek – một doanh nghiệp khởi nghiệp non trẻ của Trung Quốc và một số công ty khác tại thị trường này đã tung ra hàng loạt mô hình mã nguồn mở giá rẻ, cạnh tranh với phần mềm của các nhà phát triển AI hàng đầu Mỹ.

Để giành lại thị phần và người dùng, các ông lớn công nghệ của Mỹ cũng không thể nằm ngoài cuộc chơi, buộc phải tìm cách tung ra các mô hình có chi phí rẻ hơn, đơn cử như OpenAI. Chính quyền của Tổng thống Mỹ Donald Trump cũng kêu gọi nhiều công ty công nghệ Mỹ làm điều tương tự.

MÃ NGUỒN MỞ LÀ GÌ?

Thuật ngữ mã nguồn mở đề cập đến phần mềm có mã nguồn được công khai miễn phí để bất kỳ ai cũng có thể sử dụng hoặc chỉnh sửa. Theo Sáng kiến Mã nguồn mở (OSI), một tổ chức phi lợi nhuận có trụ sở tại California chuyên vận động cho lợi ích của cách làm này, để đáp ứng đủ các điều kiện được coi là mã nguồn mở, phần mềm phải tuân thủ những điều khoản cụ thể về phân phối và truy cập.

Đối với một mô hình AI được coi là thực sự mở, OSI cho rằng, các nhà phát triển phải cung cấp thông tin chi tiết về dữ liệu được dùng để huấn luyện, đồng thời, cho phép mọi người nghiên cứu, sử dụng và chỉnh sửa hệ thống cho bất kỳ mục đích nào.

Ngược lại, mã nguồn đóng đề cập đến phần mềm và mô hình được kiểm soát bởi nhà phát triển, không thể chỉnh sửa, và ít minh bạch hơn về nền tảng kỹ thuật.

AI nguồn mở không chỉ là một phong trào mà là được xem là bước tiến mới trong phát triển AI. Ảnh: Devluke

Hiện nay, nhiều công ty công nghệ quảng bá phần mềm AI là mã nguồn mở nhưng thực tế không phải doanh nghiệp nào cũng đáp ứng đầy đủ định nghĩa của thuật ngữ này.

Đơn cử, Meta Platforms, OpenAI của Mỹ, Mistral – một doanh nghiệp khởi nghiệp của Pháp hay DeepSeek đều đã phát hành các mô hình AI được giới thiệu là mã nguồn mở.

Tuy nhiên, các mô hình này chủ yếu ở dạng “open-weight”. Điều này có nghĩa rằng ngoài việc cung cấp mô hình và có thể cả một phần mã nguồn, các công ty còn công bố “trọng số” – tức những giá trị số học mà mô hình thu nhận và được điều chỉnh trong quá trình huấn luyện, giúp các nhà phát triển tùy biến tốt hơn. Tuy nhiên, các doanh nghiệp lại không tiết lộ chi tiết về dữ liệu thực tế đã được sử dụng để huấn luyện.

Ví dụ, Meta từng cung cấp trọng số và một phần mã nguồn cho dòng mô hình AI Llama, nhưng không cung cấp thông tin chi tiết về dữ liệu huấn luyện. Meta cũng từng bị OSI chỉ trích vì các điều khoản cấp phép có kèm theo một số hạn chế về mục đích thương mại.

Tương tự, hồi tháng 1, DeepSeek thông báo phát hành hệ thống R1 dưới dạng mô hình mã nguồn mở, nhưng lại không công bố mã nguồn hay dữ liệu huấn luyện. Điều đó dẫn đến nhiều nghi vấn về việc công ty này thực sự sử dụng dữ liệu gì để xây dựng mô hình.

OpenAI, dù trong tên gọi có chữ “open” – nghĩa là mở, nhưng lại không công khai hầu hết mô hình. Tuy nhiên, ngay sau khi DeepSeek gây tiếng vang, Giám đốc điều hành OpenAI – ông Sam Altman thừa nhận rằng, nhà sản xuất ChatGPT cần phải “tìm ra một chiến lược mã nguồn mở khác”. Ông nói thêm: “Cá nhân tôi nghĩ rằng chúng tôi đã đứng nhầm phía của lịch sử trong vấn đề này”.

LỢI ÍCH CỦA MÃ NGUỒN MỞ

Theo Bloomberg, những người ủng hộ phần mềm mã nguồn mở thường nhấn mạnh vào mức chi phí rẻ hơn cho người dùng bởi không phải trả phí cấp phép như hệ thống đóng.

Mức giá sử dụng thấp hơn sẽ mở đường cho ứng dụng AI rộng rãi hơn, đồng thời khuyến khích đổi mới sáng tạo.

Những người ủng hộ cũng cho rằng, cách tiếp cận này giúp tăng tính minh bạch và trách nhiệm giải trình của các nhà phát triển hệ thống AI khi người khác có thể hiểu rõ hơn cách mô hình vận hành.

Trong khi đó, các hệ thống đóng lại tiềm ẩn rủi ro tạo ra một thị trường AI bị thống trị bởi một số ít công ty quyền lực. Ông Aaron Levie, Giám đốc điều hành Công ty lưu trữ đám mây Box Inc., phân tích: “Trong thế giới AI đắt đỏ và độc quyền, các nhà cung cấp AI có thể sẽ giữ toàn bộ lợi ích kinh tế cho riêng mình và về cơ bản là loại bỏ cơ hội của các nhà phát triển và hệ sinh thái”.

Với những công ty như Meta, mã nguồn mở mang đến thêm lợi ích: mức độ phổ biến. Khi cho phép các nhà phát triển khác tự do truy cập và xây dựng trên nền tảng phần mềm mã nguồn mở của mình, Meta đã mở rộng được tầm ảnh hưởng trong toàn bộ hệ sinh thái AI.

Các mô hình có mã nguồn mở thường có chi phí sử dụng thấp hơn các mô hình đóng. Ảnh: SCMP

Ở chiều ngược lại, những người chỉ trích phần mềm mã nguồn mở lập luận rằng mô hình này kém an toàn hơn.

Trong trường hợp của AI, một số ý kiến ở Mỹ lo ngại rằng việc sử dụng các mô hình từ đối thủ như Trung Quốc sẽ đe dọa an ninh quốc gia, ảnh hưởng đến sự an toàn của công dân. Ví dụ, các mô hình thu thập lượng lớn dữ liệu người dùng có thể bị khai thác cho mục đích giám sát.

Ngoài ra, cũng có lo ngại rằng các công ty Mỹ tung ra mô hình AI với nhiều mức độ mở khác nhau có thể vô tình trao cho các quốc gia đối thủ cơ hội tận dụng để vượt mặt Mỹ về công nghệ.

VÌ SAO DEEPSEEK CHỌN HƯỚNG ĐI MỞ?

Bằng việc áp dụng cách tiếp cận cởi mở hơn (dù có một số giới hạn), DeepSeek có thể đã làm dịu đi những lo ngại của người dùng toàn cầu về việc Trung Quốc kiểm soát quá chặt chẽ công nghệ.

Doanh nghiệp này cũng có khả năng mở rộng tầm ảnh hưởng của chatbot tại thị trường phương Tây bằng cách giúp các nhà phát triển khác dễ dàng điều chỉnh công nghệ nền tảng để đáp ứng nhu cầu của họ.

Nói cách khác, theo các tác giả trên Bloomberg, DeepSeek trên thực tế đã đi theo đúng công thức mà Meta sử dụng để chiếm lĩnh nhiều hơn hệ sinh thái AI – điều mà dường như CEO Meta Mark Zuckerberg không bỏ qua.

“Đây là một cuộc cạnh tranh địa chính trị khổng lồ, và Trung Quốc đang lao vào với tốc độ cực nhanh”, ông Zuckerberg từng nói trong một cuộc phỏng vấn trên The Joe Rogan Experience. “Nếu có một mô hình mã nguồn mở mà mọi người đều sử dụng, mô hình đó nên đến từ nước Mỹ”.

DeepSeek dần cho thấy tiềm năng khi không chỉ có mức giá sử dụng rẻ hơn mà hiệu suất cũng tăng dần. Ảnh: SCMP

Giống như một số mô hình mới nhất từ các nhà phát triển Mỹ hàng đầu, bao gồm OpenAI và Google, R1 của DeepSeek được thiết kế để mô phỏng cách con người suy nghĩ, dành thời gian xử lý trước khi đưa ra câu trả lời cho câu hỏi của người dùng.

Tuy nhiên, phiên bản của DeepSeek được xây dựng trên nền tảng V3 mới được phát hành gần đây lại cho thấy hiệu suất khác biệt.

Nhóm phát triển đã có cách làm sáng tạo. Trong khi đối thủ sử dụng số lượng lớn chip máy tính hiệu năng cao để xây dựng các mô hình AI tương tự, nhóm của DeepSeek dường như đã tìm ra cách tận dụng hiệu quả lượng chip ít hơn và kém tiên tiến hơn mà họ có thể tiếp cận do lệnh kiểm soát xuất khẩu của Mỹ đối với các loại chip tối tân nhất.

Họ cũng tận dụng mạnh mẽ kỹ thuật được gọi là “học tăng cường” (reinforcement learning), trong đó hệ thống được “thưởng” cho câu trả lời đúng và “phạt” cho câu trả lời sai.

Theo Bloomberg, tại Mỹ, một số lãnh đạo công nghệ và chính sách đã thừa nhận những tiến bộ này, đồng thời đặt ra câu hỏi liệu công ty Trung Quốc có xây dựng chatbot dựa trên công nghệ phương Tây hay không, qua đó né tránh một phần chi phí khổng lồ trong việc phát triển các mô hình ngôn ngữ lớn – nền tảng của chatbot.

Công ty tư vấn hàng đầu thế giới Bain & Company đánh giá, hiệu suất của DeepSeek dựa trên một loạt các cải tiến kỹ thuật, giúp giảm đáng kể chi phí suy luận đồng thời cải thiện chi phí đào tạo. Kiến trúc hỗn hợp chuyên gia (MoE) của DeepSeek chỉ kích hoạt 37 tỷ trong số 671 tỷ tham số để xử lý mỗi token, giảm thiểu chi phí tính toán mà không làm giảm hiệu suất.

Công ty này cũng đã tối ưu hóa các kỹ thuật, cho phép chuyển giao khả năng suy luận từ các mô hình lớn hơn sang các mô hình nhỏ hơn. Bằng cách sử dụng học tăng cường, DeepSeek nâng cao hiệu suất mà không cần tinh chỉnh có giám sát mở rộng.

Ngành game đang phải đối mặt với những tác động bất ngờ từ làn sóng trí tuệ nhân tạo. Ảnh minh họa

"Cơn ác mộng tồi tệ nhất" của ngành game trong kỷ nguyên AI

Từ tình trạng thiếu RAM toàn cầu đẩy giá console lên cao đến làn sóng mất việc trong ngành, ngành công nghiệp game đang trở thành một trong những “nạn nhân” lớn nhất của cơn bùng nổ AI...

15:51 16/03/2026

OpenClaw đã và đang trở thành một hiện tượng thu hút người dùng Trung Quốc. Ảnh: SCMP

Các địa phương Trung Quốc trải thảm đón dự án ứng dụng OpenClaw

Chính quyền một số địa phương tại Trung Quốc đã nhanh chóng khuyến khích ứng dụng OpenClaw dù có một số nghi ngại liên quan đến công cụ này…

14:05 14/03/2026

Vừa xếp hàng cài OpenClaw, người dùng Trung Quốc lại ồ ạt trả tiền để gỡ OpenClaw

Cơn sốt cài đặt tác nhân AI OpenClaw tại Trung Quốc đang có bước ngoặt trớ trêu: sau khi trả tiền để cài đặt, nhiều người dùng nay lại tiếp tục chi tiền để gỡ bỏ phần mềm này…

13:48 13/03/2026

Nhiều hãng PC lớn đang chuẩn bị tăng giá sản phẩm thêm hàng trăm USD hoặc buộc phải điều chỉnh cấu hình để giảm chi phí

Lenovo, HP, Dell, Asus, Acer và cả Apple đang lên kế hoạch tăng giá laptop

Khi các trung tâm dữ liệu AI tiêu thụ hơn một nửa lượng DRAM của thế giới, các hãng máy tính cá nhân như Lenovo, HP, Dell, Asus hay Acer đang chịu áp lực lớn phải tăng giá sản phẩm hoặc cắt giảm cấu hình...

09:37 13/03/2026

Cuộc xung đột giữa Mỹ, Israel và Iran đang khiến thị trường bán dẫn toàn cầu theo dõi sát sao diễn biến tại Trung Đông

Chiến tranh Iran và giá dầu tăng đang đe dọa chuỗi cung ứng bán dẫn toàn cầu

Trung Đông – khu vực tưởng chừng ít liên quan đến ngành chip – thực tế lại nắm giữ nhiều nguyên liệu chiến lược như heli và bromine...

09:36 13/03/2026

Thị trường chứng khoán Trung Quốc đang chứng kiến sự trỗi dậy của một thế hệ nhà đầu tư trẻ, am hiểu công nghệ và sẵn sàng thử nghiệm những phương thức đầu tư hoàn toàn mới. Ảnh: Bloomberg

Chatbot: 'Trợ thủ' đầu tư mới của giới trẻ Trung Quốc

Là thế hệ am hiểu công nghệ và có khẩu vị rủi ro cao, Gen Z đang dần thay đổi thói quen đầu tư khi ưu tiên sử dụng trí tuệ nhân tạo và các diễn đàn trực tuyến để đưa ra quyết định chọn mã cổ phiếu...

09:33 13/03/2026

Những lĩnh vực được hưởng lợi không chỉ dừng ở các ngành quen thuộc như sản xuất chip mà còn mở rộng sang nhiều ngành công nghệ tiên phong khác.

Trung Quốc đang thúc đẩy mạnh mẽ “nền kinh tế thông minh”

Định hướng xây dựng “nền kinh tế thông minh” đang trở thành trụ cột trong chiến lược phát triển mới của Trung Quốc. Nhà đầu tư săn tìm làn sóng cổ phiếu công nghệ mới...

14:02 10/03/2026

Để thu hút nhân tài, TSMC đưa ra mức đãi ngộ cạnh tranh.

Hãng bán dẫn lớn nhất thế giới TSMC tuyển 8.000 nhân sự năm 2026, đãi ngộ cao

Nhà sản xuất bán dẫn theo hợp đồng lớn nhất thế giới – TSMC – cho biết sẽ tuyển khoảng 8.000 nhân viên trong năm 2026 nhằm đáp ứng nhu cầu mở rộng sản xuất và phát triển các công nghệ bán dẫn thế hệ mới...

14:02 10/03/2026

Chính khả năng “làm việc thay con người” khiến OpenClaw được xem là bước tiến quan trọng trong sự phát triển của AI

Cơn sốt OpenClaw lan rộng tại Trung Quốc, cả ngàn người xếp hàng chờ cài đặt

Một phần mềm AI agent mã nguồn mở mang tên OpenClaw đang tạo nên cơn sốt tại Trung Quốc khi người dùng từ lập trình viên đến nhân viên văn phòng, nội trợ hay sinh viên đổ xô cài đặt để tự động hóa công việc…

18:50 09/03/2026

Ông Andrea Baronchelli, đồng sáng lập kiêm CEO của Aspire. Ảnh: Aspire

Thế hệ doanh nhân mới châu Á mạnh tay chi tiêu cho công cụ AI

Việc sử dụng một số công cụ lập trình AI đã tăng hơn bốn lần, theo dữ liệu từ Aspire…

18:45 09/03/2026