Tờ South China Morning Post dẫn nguồn tin từ một số công ty đang phát triển các mô hình ngôn ngữ lớn (LLM) hàng đầu Trung Quốc, cho biết những mô hình AI tiên tiến nhất của nước này hiện vẫn chủ yếu được huấn luyện trên chip Nvidia.
Nguyên nhân là vì chi phí chuyển đổi sang chip bán dẫn trong nước quá lớn.
Dù năng lực phần cứng nước này ngày càng tiến bộ, việc chuyển nền tảng chip vẫn đặt ra những thách thức kỹ thuật không nhỏ. Một trong những trở ngại lớn nhất nằm ở hệ sinh thái phần mềm.
Nền tảng CUDA (Compute Unified Device Architecture) của Nvidia đã được sử dụng rộng rãi trong ngành công nghiệp AI trong nhiều năm và trở thành nền tảng quen thuộc đối với các nhà phát triển.
Trong khi đó, nền tảng CANN (Compute Architecture for Neural Networks) của Huawei Technologies, được phát triển để phục vụ các chip AI Ascend, lại đòi hỏi các nhà phát triển phải viết lại và tối ưu hóa một lượng lớn mã nguồn.
James Wang, người phát triển các mô hình AI tại một viện nghiên cứu trực thuộc một trường đại học ở Thượng Hải, cho biết: “Các quy trình huấn luyện hiện tại của chúng tôi phụ thuộc vào CUDA. Mã nguồn CUDA không thể chạy trực tiếp trên chip Ascend mà cần phải viết lại rất nhiều”.
Theo ông Wang, việc chuyển các quy trình làm việc hiện có sang chip Ascend của Huawei có thể khiến nhóm của ông phải mất thêm ít nhất 50% thời gian và chi phí.
Một kỹ sư tại Bắc Kinh, người trực tiếp tham gia chuyển đổi các tác vụ huấn luyện LLM sang chip Ascend, cho biết thời gian cần thiết để thay đổi nền tảng chip trong hệ thống sẽ phụ thuộc vào nhiều yếu tố, trong đó có mức độ mở của mô hình và mức độ hoàn thiện của hệ sinh thái phần mềm đi kèm.
Đối với các mô hình mã nguồn mở như DeepSeek của Trung Quốc và các phiên bản rút gọn từ mô hình này, việc huấn luyện trên chip Ascend có thể khiến một nhóm từ hai đến ba kỹ sư phải mất thêm khoảng một tháng so với khi sử dụng chip Nvidia. Trong khi nếu tiếp tục dùng chip Nvidia, các nhà phát triển có thể tận dụng hệ sinh thái phần mềm và các công cụ hỗ trợ sẵn có của nhà cung cấp này.
Chẳng hạn với một mô hình như Kimi K3 của Moonshot AI, dựa trên công bố trọng số, tức các tham số nền tảng tạo nên khả năng xử lý của mô hình, theo vị kỹ sư, quá trình chuyển sang chip Ascend có thể đòi hỏi một nhóm khoảng 10 kỹ sư phải làm việc thêm hơn 6 tháng.
Việc các doanh nghiệp Trung Quốc vẫn phải dựa vào chip Nvidia cho thấy những khó khăn mà nước này đang đối mặt trong nỗ lực giảm phụ thuộc vào nguồn cung công nghệ nước ngoài, ngay cả khi các phòng thí nghiệm và công ty trong nước đang chạy đua nâng cao năng lực AI.
Quá trình phát triển một hệ thống AI thường gồm hai giai đoạn chính là huấn luyện và suy luận. Trong đó, suy luận là quá trình đưa một mô hình đã được huấn luyện vào sử dụng để xử lý dữ liệu mới và đưa ra dự đoán. Nếu huấn luyện mô hình đòi hỏi lượng tài nguyên tính toán lớn cùng quy trình kỹ thuật phức tạp, thì suy luận thường đơn giản hơn đáng kể.
Các hệ thống như DeepSeek-V4 và Kimi K3 của Moonshot đã được triển khai thành công trên những nền tảng phần cứng của Trung Quốc như Huawei và Alibaba Group Holding. Tuy nhiên, cả DeepSeek và Moonshot đều không công bố loại chip AI được sử dụng trong quá trình huấn luyện các mô hình này.
Theo một báo cáo của trang tin The Information hồi tháng 7, Kimi K3 được cho là đã được huấn luyện trên chip Nvidia, trong đó có cả các bộ xử lý Blackwell thế hệ mới.
Báo cáo cũng cho biết các công ty AI Trung Quốc vẫn tiếp tục dựa vào phần cứng Nvidia để huấn luyện những mô hình AI tiên tiến nhất, bất chấp nỗ lực mở rộng các lựa chọn thay thế do Trung Quốc tự phát triển.
Tuy nhiên, một số nhóm phát triển AI tại Trung Quốc đã bắt đầu đưa chip nội địa vào quá trình huấn luyện. Tháng 6 vừa qua, Meituan ra mắt LongCat-2.0, một mô hình có 1,6 nghìn tỷ tham số.
Công ty cho biết mô hình này được huấn luyện và vận hành hoàn toàn trên một cụm máy chủ trong nước, sử dụng 50.000 card xử lý. Tuy nhiên, Meituan không công bố nhà cung cấp cụm thiết bị này.
Nhà đầu tư trong nước nếu giao dịch tài sản mã hóa được chào bán, phát hành cho nhà đầu tư nước ngoài, sẽ bị phạt từ 70 - 100 triệu đồng...
Việt Nam vừa ghi thêm dấu mốc quan trọng trên bản đồ hạ tầng số toàn cầu khi lần đầu tiên lọt vào nhóm 10 quốc gia có tốc độ Internet nhanh nhất thế giới ở cả hai hạng mục băng rộng di động và băng rộng cố định...
Các lãnh đạo công nghệ hàng đầu Mỹ kêu gọi các nước G20 coi trí tuệ nhân tạo (AI) là một dạng hạ tầng thiết yếu và đẩy mạnh đầu tư trung tâm dữ liệu. Tuy nhiên, ngay tại Mỹ, các dự án trung tâm dữ liệu đang vấp phải sự phản đối của cộng đồng do lo ngại về giá điện và tác động xã hội…
PricewaterhouseCoopers LLP (PwC) ước tính tổng chi tiêu cho các trung tâm dữ liệu phục vụ AI có thể lên tới 31,6 nghìn tỷ USD trong khoảng 15 năm tới. Trong kịch bản lạc quan, con số này thậm chí có thể chạm mốc 50 nghìn tỷ USD…
Năng lực chế tạo thiết bị quang khắc của Trung Quốc hiện tương đương với trình độ của ASML vào khoảng năm 2004…
Để thực hiện Nghị quyết số 19-NQ/TW, cũng trong ngày 28/7/2026 Bộ Chính trị đã ký ban hành Chương trình hành động thực hiện Nghị quyết với 40 chỉ tiêu và 51 nhiệm vụ, giải pháp cụ thể.
Thông tin mới nhất từ Cục Thống kê cho thấy, chỉ số giá tiêu dùng (CPI) tháng 8/2026 tăng 0,47% so với tháng trước, so với cùng kỳ năm trước tăng 4,89%. Nguyên nhân chủ yếu do giá xăng dầu trong nước điều chỉnh tăng theo giá nhiên liệu thế giới.