image Thứ Năm, 03/09/2026

Các công ty hàng đầu chưa có kế hoạch kiểm soát siêu trí tuệ nhân tạo

Sơn Trần

09/12/2025

Chia sẻ

Các công ty trí tuệ nhân tạo (AI) lớn nhất thế giới đang thất bại trong việc thực hiện cam kết an toàn mà chính họ từng công bố, sự thiếu hụt này có thể đi kèm những rủi ro “thảm khốc”...

Chưa công ty nào đưa ra được kế hoạch đảm bảo con người vẫn giữ quyền kiểm soát với hệ thống AI
Chưa công ty nào đưa ra được kế hoạch đảm bảo con người vẫn giữ quyền kiểm soát với hệ thống AI

Winter AI Safety Index 2025 do Viện Tương lai Cuộc sống (Future of Life Institute – FLI), một tổ chức phi lợi nhuận, công bố đã đánh giá 8 công ty AI lớn, gồm Anthropic, OpenAI, Google DeepMind, xAI và Meta (Hoa Kỳ), cùng ba công ty Trung Quốc là DeepSeek, Alibaba Cloud và Z.ai.

Báo cáo được đưa ra trong bối cảnh nhiều hãng AI đối mặt với các vụ kiện và cáo buộc rằng chatbot của họ gây tổn hại tâm lý, thậm chí “hướng dẫn tự tử”, cùng với đó là vấn đề tấn công mạng có trợ giúp từ AI, Euronews đưa tin.

Kết quả cho thấy hầu như không công ty nào có chiến lược đáng tin cậy để ngăn chặn việc AI bị lạm dụng gây hậu quả nghiêm trọng hoặc nguy cơ mất quyền kiểm soát, khi tất cả đều chạy đua hướng đến trí tuệ nhân tạo tổng quát (AGI) và siêu trí tuệ – dạng AI vượt xa năng lực con người.

Một số chuyên gia độc lập nghiên cứu báo cáo cho biết không công ty nào đưa ra được kế hoạch đảm bảo con người vẫn giữ quyền kiểm soát với hệ thống AI.

Ông Stuart Russell, giáo sư khoa học máy tính tại Đại học California, Berkeley, nói rằng các công ty AI khẳng định họ có thể xây dựng AI siêu trí tuệ, nhưng không ai chứng minh được cách ngăn chặn nguy cơ mất quyền kiểm soát.

“Tôi muốn thấy bằng chứng rằng họ có thể giảm nguy cơ mất kiểm soát xuống mức 1/100 triệu mỗi năm, giống tiêu chuẩn của lò phản ứng hạt nhân”, ông Russell viết. “Thay vào đó, họ thừa nhận rủi ro có thể là 1/10, 1/5, thậm chí 1/3 và họ không thể giải thích hay cải thiện con số này”.

NHÓM TIÊU CHÍ ĐÁNH GIÁ

Nghiên cứu đo mức độ tuân thủ của các công ty theo 6 nhóm tiêu chí quan trọng: đánh giá rủi ro, tác hại hiện tại, khung an toàn, an toàn tồn vong (existential safety), quản trị – trách nhiệm giải trình và chia sẻ thông tin.

Dù báo cáo ghi nhận một số tiến bộ, hội đồng chuyên gia độc lập chỉ ra rằng việc thực thi vẫn thiếu đồng bộ và thường không đạt mức độ yêu cầu theo tiêu chuẩn toàn cầu đang xây dựng.

Anthropic, OpenAI và Google DeepMind được khen ngợi vì minh bạch hơn, có khung an toàn công khai, và tiếp tục đầu tư vào nghiên cứu an toàn kỹ thuật. Nhưng cả ba vẫn còn nhiều điểm yếu.

Anthropic bị chỉ trích vì ngừng thử nghiệm “human uplift” và chuyển sang mặc định huấn luyện mô hình dựa trên tương tác người dùng, điều khiến các chuyên gia cho rằng làm suy yếu khả năng bảo vệ quyền riêng tư.

OpenAI bị phê phán vì đặt ra ngưỡng an toàn mơ hồ, vận động hành lang chống lại luật an toàn AI cấp bang, và thiếu sự giám sát độc lập đủ mạnh.

Người phát ngôn OpenAI khẳng định an toàn là trọng tâm trong mọi hoạt động xây dựng và phát triển AI: “Chúng tôi đầu tư lớn vào nghiên cứu an toàn cấp độ tiên phong, tích hợp lớp bảo vệ mạnh vào hệ thống, và kiểm thử nghiêm ngặt cả nội bộ lẫn qua chuyên gia độc lập. Chúng tôi công khai khung an toàn, đánh giá và nghiên cứu để thúc đẩy tiêu chuẩn chung của ngành, đồng thời liên tục tăng cường bảo vệ tương lai”.

Google DeepMind đã cải thiện khung an toàn, nhưng vẫn dựa vào các đơn vị đánh giá được công ty trả tiền, làm giảm tính độc lập. Phát ngôn viên Google DeepMind nói họ áp dụng “cách tiếp cận khoa học – nghiêm ngặt” trong xử lý an toàn AI: “Khung Frontier Safety Framework của chúng tôi nêu rõ quy trình nhận diện và giảm thiểu rủi ro nghiêm trọng trước khi mô hình gây tác động. Khi mô hình ngày càng mạnh, chúng tôi tiếp tục đổi mới về an toàn và quản trị với tốc độ tương ứng”.

Tuy vậy, theo ông Max Tegmark, Chủ tịch FLI và giáo sư tại MIT, cả ba công ty hàng đầu vẫn liên quan đến các vấn đề gây hại thực tế thời gian gần đây, từ tổn hại tâm lý cho đến tấn công hacker quy mô lớn vào Anthropic.

Báo cáo cũng ghi nhận tiến bộ ở năm công ty còn lại, dù không đồng đều và vẫn còn nhiều khoảng trống.

KHOẢNG TRỐNG GIỮA CAM KẾT VÀ THỰC TẾ

Cụ thể, xAI công bố khung an toàn đầu tiên nhưng bị đánh giá là quá hẹp và thiếu tiêu chí rõ ràng cho các biện pháp xử lý rủi ro.

Z.ai là công ty duy nhất công bố đầy đủ đánh giá an toàn độc lập, nhưng được khuyến nghị minh bạch hơn nữa về cấu trúc quản trị và khung an toàn tổng thể.

Meta đưa ra khung an toàn mới với các ngưỡng dựa trên kết quả, nhưng chuyên gia yêu cầu họ giải thích rõ phương pháp và chia sẻ quy trình đánh giá nội bộ.

DeepSeek được ghi nhận vì nhân viên nội bộ tích cực thúc đẩy an toàn công nghệ, nhưng lại thiếu tài liệu an toàn cơ bản.

Alibaba Cloud đã đóng góp cho tiêu chuẩn quốc gia về gắn watermark (nhãn), nhưng còn yếu ở khả năng tăng độ tin cậy, công bằng và tính trung thực của mô hình.

AI VẪN ĐANG ĐƯỢC QUẢN LÝ KHÁ LỎNG LẺO 

Trước đây các chuyên gia tin AGI phải 100 năm nữa mới thành hiện thực, giờ họ nói chỉ còn vài năm
Trước đây các chuyên gia tin AGI phải 100 năm nữa mới thành hiện thực, giờ họ nói chỉ còn vài năm

“Tôi hy vọng chúng ta sớm vượt qua thời điểm các công ty chỉ phát triển dựa trên danh tiếng”, ông Tegmark nói. “Khi được hỏi kế hoạch kiểm soát AGI của họ là gì, không công ty nào trả lời được”.

Trong khi đó, những hãng như Meta lại dùng từ “siêu trí tuệ” như một khẩu hiệu để thổi phồng sản phẩm mới. Năm nay, Meta đổi tên bộ phận mô hình ngôn ngữ lớn của mình thành Meta Superintelligence Labs.

Theo ông Tegmark, quan điểm về AGI đã thay đổi rõ rệt: nếu trước đây các chuyên gia tin AGI phải 100 năm nữa mới thành hiện thực, giờ họ nói chỉ còn vài năm.

“AI được quản lý lỏng lẻo hơn cả việc bán… bánh mì kẹp”, ông Tegmark nói, nhắc đến tình trạng vận động hành lang chống lại tiêu chuẩn an toàn bắt buộc. Tuy vậy, ông cũng chỉ ra làn sóng phản đối chưa từng có khi AGI và siêu trí tuệ không được kiểm soát.

Tháng 10 vừa qua, hàng nghìn nhân vật có tầm ảnh hưởng, bao gồm lãnh đạo công nghệ và giới khoa học, đã ký vào một kiến nghị kêu gọi làm chậm việc theo đuổi siêu trí tuệ. Kiến nghị do FLI tổ chức, thu hút chữ ký từ nhiều bên như các nhà chính trị, lãnh đạo tôn giáo, cho đến nhà khoa học máy tính hàng đầu.

“Điểm chung của họ là gì? Họ đồng thuận với bản tuyên bố. Điều này cực kỳ đáng chú ý”, ông Tegmark cảnh báo nếu siêu trí tuệ xuất hiện và điều khiển mọi lĩnh vực, người lao động sẽ không thể kiếm sống khi mọi công việc đều bị robot thay thế. Khi ấy, xã hội sẽ sống phụ thuộc vào trợ cấp.

“Tôi nghĩ chúng ta đang tiến gần đến điểm bùng nổ”, ông Tegmark dự đoán.


Ứng dụng công nghệ mô phỏng để đào tạo nhân lực cho thế hệ máy bay mới

Một thiết bị mô phỏng buồng lái máy bay A220 dự kiến được đưa vào khai thác tại Singapore từ quý 4/2027, mở rộng ứng dụng công nghệ mô phỏng trong đào tạo phi công và kỹ thuật viên hàng không tại châu Á - Thái Bình Dương...

16:41 03/09/2026
Nhật Bản đưa AI và drone vào sân bay, thu hút làn sóng khách quốc tế

Thay vì xây dựng hệ thống riêng cho từng sân bay, mô hình mới kết nối dữ liệu từ nhiều sân bay vào một nền tảng AI dùng chung, giúp hệ thống học từ các sự cố đã xảy ra để ngày càng phát hiện chính xác hơn những dấu hiệu bất thường và nguy cơ hỏng hóc...

10:32 03/09/2026
Robot Trung Quốc đổ bộ châu Âu

Châu Âu hiện là thị trường lớn nhất thế giới đối với robot cắt cỏ - những thiết bị có khả năng tự di chuyển, sử dụng cảm biến và camera để cắt cỏ mà không cần người điều khiển trực tiếp...

10:32 03/09/2026
Ba nhà khoa học VinFuture vào danh sách TIME100 AI 2026

GS. Yann LeCun, GS. Fei-Fei Li và GS. Daniela Rus cùng được Tạp chí TIME đưa vào TIME100 AI 2026, danh sách 100 nhân vật có ảnh hưởng nhất đối với sự phát triển của trí tuệ nhân tạo (AI) toàn cầu…

08:43 03/09/2026
Doanh số Nvidia tăng gấp đôi, nhà đầu tư vẫn thận trọng vào tương lai

Báo cáo tài chính vừa công bố cho thấy lợi nhuận của Nvidia đã vượt kỳ vọng và doanh thu tăng gấp đôi so với cùng kỳ năm ngoái, nhưng chính tiềm năng tăng trưởng trong tương lai mới là điều khiến giới đầu tư quan tâm.

10:33 28/08/2026
Acer tổ chức giải đấu esports hàng đầu Châu Á – Thái Bình Dương tại Việt Nam

Giải đấu Asia Pacific Predator League 2027 sẽ diễn ra vào tháng 1/2027, đánh dấu lần đầu tiên Việt Nam đăng cai giải đấu esports khu vực quy mô lớn do Acer tổ chức...

12:24 27/08/2026
SpaceX lên kế hoạch xây tổ hợp không gian trị giá 100 tỷ USD

Theo tài liệu thông tin được công bố, SpaceX dự kiến tạo khoảng 3.000 việc làm trực tiếp mới trong vòng 10 năm và thêm 8.100 việc làm gián tiếp...

10:03 27/08/2026
Nhật Bản rót tiền, phát triển công nghệ khai thác đất hiếm dưới đáy biển

Nhật Bản đang lên kế hoạch điều chỉnh một chương trình hỗ trợ nghiên cứu và phát triển công nghệ phục vụ an ninh kinh tế, qua đó mở đường cho việc cấp vốn dài hạn nhằm khai thác đất hiếm dưới đáy biển…

10:03 27/08/2026
Cơn sốt robot tiếp sức tham vọng công nghệ của Trung Quốc

Cứ 10 robot thông minh hình người và robot bốn chân được bán trên toàn cầu thì có khoảng 8 sản phẩm được sản xuất tại Trung Quốc...

09:28 21/08/2026
Đẩy mạnh ứng dụng AI trong công tác xây dựng và thi hành pháp luật

Đứng trước yêu cầu chuyển đổi số toàn diện, Việt Nam và các nước ASEAN đang đẩy mạnh nghiên cứu, ứng dụng các công cụ trí tuệ nhân tạo (AI) chuyên biệt vào công tác xây dựng, rà soát và thực thi pháp luật, mở ra bước đột phá mới trong quản trị quốc gia và hội nhập khu vực.

09:08 20/08/2026