Những sự cố liên tiếp đang làm dấy lên lo ngại mới về mức độ an toàn của chính các môi trường được tạo ra để kiểm tra năng lực và giới hạn của AI.
Ông Seán Ó hÉigeartaigh, Giám đốc chương trình AI, Tương lai và Trách nhiệm tại Trung tâm Tương lai của Trí tuệ thuộc Đại học Cambridge, nói với TechCrunch: “Số lượng sự cố xảy ra cho thấy rõ rằng việc kiểm soát môi trường thử nghiệm và các hộp cát đang không theo kịp năng lực của các mô hình”.
Trong khi đó, bản thân các mô hình được đưa vào thử nghiệm vốn cũng đã tiềm ẩn rủi ro. Để đánh giá mức độ an toàn an ninh mạng, các mô hình phải vô hiệu hóa một số cơ chế bảo vệ có nhiệm vụ ngăn mô hình thực hiện các hành vi độc hại, để các nhà nghiên cứu đánh giá chính xác khả năng thực sự của mô hình.
Do đó, đòi hỏi môi trường thử nghiệm phải được bảo vệ bằng những lớp phòng thủ đủ chắc chắn. Nhưng thực tế thời gian qua cho thấy yêu cầu này không phải lúc nào cũng được đáp ứng.
Mới đây, một mô hình OpenAI chưa được phát hành đã thoát khỏi hộp cát và xâm nhập vào hệ thống đang vận hành của Hugging Face. Các mô hình của Anthropic và Meta cũng tiếp cận được những hệ thống bên ngoài môi trường thử nghiệm sau khi lỗi cấu hình vô tình tạo đường kết nối ra internet.
Kimi K3 của Moonshot AI thậm chí đã tận dụng một lỗ hổng trong hộp cát do Frontier Security vận hành để truy cập internet và lấy thông tin từ GitHub.
Trước tình trạng này, các nhà nghiên cứu và chuyên gia an ninh mạng cho rằng môi trường đánh giá AI cần được bảo vệ chặt chẽ hơn, với mức độ cô lập và kiểm soát truy cập tương đương các hệ thống khi được đưa vào vận hành thực tế.
Cần xây dựng nhiều lớp bảo mật để một sai sót cấu hình đơn lẻ, chẳng hạn vô tình mở quyền truy cập internet, cũng không thể khiến mô hình thoát khỏi môi trường thử nghiệm.
Bà Heather Ceylan, Giám đốc an toàn thông tin của Box, thậm chí cho rằng không gian thử nghiệm phải được loại bỏ mọi đường kết nối để truy cập internet, cũng như tới các hệ thống nhạy cảm khác.
Bà nêu quan điểm: “OpenAI chỉ phát hiện sự việc nhờ Hugging Face. Anthropic và Meta cũng chỉ nhận ra sau khi quay lại kiểm tra. Tôi chắc chắn rằng đã có những tín hiệu mà họ có thể phát hiện sớm hơn”.
Anthropic cũng thừa nhận bản thân và công ty thử nghiệm đều có thể làm tốt hơn công tác giám sát. Một số dấu hiệu cho thấy sự cố đã xuất hiện ngay trong quá trình thử nghiệm nhưng họ đã không phát hiện kịp thời.
Nhiều chuyên gia vì vậy hiện đề xuất môi trường đánh giá cần được kiểm toán độc lập bởi bên thứ ba trước khi đưa mô hình vào thử nghiệm.
Tuy nhiên, một nguồn tin am hiểu sự việc đã nói với TechCrunch, môi trường của Irregular, công ty đánh giá an ninh mạng độc lập từng được OpenAI, Anthropic và Meta thuê để kiểm tra năng lực của các mô hình AI, vẫn được kiểm tra và đánh giá thường xuyên, với sự tham gia tư vấn của nhiều bên bên ngoài.
Dù vậy, nguồn tin này cho biết hoạt động giám sát đã được thực hiện, nhưng cơ chế giám sát vẫn chưa đủ hiệu quả.
Ông Andrew Yoon, Trưởng bộ phận nghiên cứu tại tổ chức phi lợi nhuận CivAI, cùng một số nhà nghiên cứu khác đang kêu gọi ngành AI nước Mỹ xây dựng quy trình tiêu chuẩn đánh giá an toàn các mô hình tiên tiến.
Bà Ceylan cũng cho rằng khi các cơ chế bảo vệ bị vô hiệu hóa, môi trường thử nghiệm phải được bảo vệ như thể đang chứa một trong những đối tượng tấn công mạng nguy hiểm nhất.
Khi các mô hình ngày càng mạnh và có khả năng thực hiện nhiều nhiệm vụ hơn, môi trường thử nghiệm cũng phải được bảo vệ tương xứng. Bởi nếu một mô hình có thể thoát khỏi “vùng an toàn” được tạo ra để kiểm tra nó, chính quá trình đánh giá an toàn có thể trở thành một nguồn rủi ro mới.
Tuy nhiên, một số các nhà quan sát lại cho rằng việc siết chặt môi trường thử nghiệm quá mức cũng tạo ra một rủi ro khác.
Các nhà nghiên cứu có thể không phát hiện đầy đủ năng lực của mô hình trước khi nó được đưa vào sử dụng.
Khi đó, chính quá trình đánh giá an toàn lại có thể không phản ánh đúng những rủi ro mà mô hình có khả năng tạo ra trong thực tế.




Trong bối cảnh chuyển đổi số đang diễn ra mạnh mẽ trên toàn quốc, Đà Nẵng đã và đang triển khai những mô hình ứng dụng khoa học và công nghệ tại các vùng đồng bào dân tộc thiểu số, đặc biệt là khu vực miền núi phía Tây.
Nhà máy mới của UBTECH (Trung Quốc) có thể sản xuất 10.000 robot hình người mỗi năm, trong đó sử dụng chính những robot hình người để vận chuyển, lắp ráp và hoàn thiện các robot khác...
Khi lo ngại về những rủi ro của trí tuệ nhân tạo (AI) ngày càng gia tăng, xây dựng một cách tiếp cận toàn cầu về an toàn AI sẽ khó có thể thực hiện nếu thiếu hợp tác giữa Mỹ và Trung Quốc. Tuy nhiên, hai cường quốc này lại ngày càng hoài nghi về chiến lược AI của nhau…
Các chuỗi bán lẻ ủy quyền chính thức của Apple (AAR) tại Việt Nam đã đồng loạt mở bán và bàn giao những chiếc iPhone 18 Pro và iPhone 18 Pro Max chính hãng đầu tiên đến tay người tiêu dùng...
Bộ Khoa học và Công nghệ xây dựng Nghị định về xử phạt vi phạm trong lĩnh vực đổi mới sáng tạo, bổ sung nhóm hành vi vi phạm về liêm chính khoa học, đạo đức nghiên cứu... Đồng thời đề xuất mức phạt tối đa 50 triệu đồng đối với cá nhân và 100 triệu đồng đối với tổ chức...
Nhân Ngày Quốc tế Bảo vệ tầng ô-dôn năm 2026 và kỷ niệm 10 năm Bản sửa đổi, bổ sung Kigali được thông qua, Cục Biến đổi khí hậu, Bộ Nông nghiệp và Môi trường phối hợp với Hội Khoa học Kinh tế Việt Nam và Tạp chí Kinh tế Việt Nam/VnEconomy tổ chức Chương trình tọa đàm “Hành động toàn cầu vì một hành tinh mát lành hơn”. Tọa đàm được phát trực tuyến trên trên VnEconomy.vn và FanPage VnEconomy vào 9h ngày 14/9/2026...
Nhiều tuyến đường ở Vinh, Nghệ An ngập sâu sau nhiều giờ mưa lớn, giao thông gặp khó khăn. Chính quyền địa phương đang tăng cường lực lượng ứng trực, hỗ trợ người dân và khơi thông hệ thống thoát nước.