OpenAI cho biết các mô hình AI đã vượt tầm kiểm soát trong quá trình thử nghiệm, gây ra vụ xâm nhập 'chưa từng có' tại một công ty khởi nghiệp

12:40, 22/07/2026

WASHINGTON, ngày 21 tháng 7 OpenAI cho biết vào thứ Ba rằng một đại lý tự hành (autonomous agent) sử dụng các mô hình AI tiên tiến của hãng đã vượt tầm kiểm soát trong một đợt thử nghiệm an ninh và gây ra một cuộc tấn công mạng làm ảnh hưởng đến cơ sở hạ tầng của công ty khởi nghiệp AI Hugging Face vào tuần trước

Hình ảnh này chụp ngày 11 tháng 6 năm 2026, cho thấy logo của OpenA

Trong một bài đăng trên blog, OpenAI cho biết họ đang thử nghiệm khả năng của một số mô hình tiên tiến nhất của mình trong một môi trường được kiểm soát, nhưng đại lý này đã tìm cách thoát khỏi sự cô lập, truy cập vào internet và xâm nhập vào Hugging Face nhằm cố gắng hoàn thành mục tiêu thử nghiệm của nó.

OpenAI cho biết sự cố thoát rào chắn này là "một sự cố an ninh mạng chưa từng có, liên quan đến các năng lực mạng tiên tiến nhất hiện nay" và công ty đang tăng cường các biện pháp bảo vệ của mình.

Hugging Face, một nền tảng được sử dụng để lưu trữ các mô hình ngôn ngữ lớn và tập dữ liệu mã nguồn mở, đã gây xôn xao trong cộng đồng an ninh mạng khi tuyên bố trong một bài đăng trên blog vào tuần trước rằng họ đã trở thành mục tiêu của một cuộc tấn công "khác hoàn toàn với bất kỳ điều gì chúng tôi từng xử lý trước đây" ở chỗ "nó được vận hành hoàn toàn từ đầu đến cuối bởi một hệ thống đại lý AI tự hành."

Trong một bài đăng trên X, nhà sáng lập Clement Delangue của Hugging Face cho biết công ty đã nghi ngờ cuộc tấn công "có thể đến từ một phòng thí nghiệm AI hàng đầu, xét theo độ tinh vi của đại lý. Và hóa ra đúng là như vậy!" Ông nói thêm: "Thật kinh ngạc khi tất cả những điều này đều diễn ra một cách tự động!"

Việc OpenAI tiết lộ rằng các mô hình tiên tiến của họ phải chịu trách nhiệm cho vụ xâm nhập, mặc dù đã đặt chúng trong cái mà họ mô tả là "một môi trường cô lập cao," có thể sẽ làm gia tăng sự lo ngại về sức mạnh và rủi ro của các mô hình AI hàng đầu.

Dân biểu Greg Casar, một hạ nghị sĩ Đảng Dân chủ từ bang Texas, cho biết sự cố này rất đáng báo động.

"AI đang phát triển cực kỳ nhanh chóng mà không có các quy định thực tế nào để giữ an toàn cho chúng ta," ông nói trong một tuyên bố, đồng thời kêu gọi thực hiện thử nghiệm an toàn độc lập bắt buộc, bắt buộc công khai các sự cố an ninh và tăng cường hợp tác quốc tế "để bảo vệ con người khỏi thảm họa tuyệt đối."

Văn phòng Giám đốc An ninh mạng Quốc gia, Cơ quan An ninh mạng và Cơ sở hạ tầng Mỹ (CISA), và Cơ quan An ninh Quốc gia Mỹ (NSA) đã không phản hồi ngay lập tức các yêu cầu bình luận.

Katie Moussouris, giám đốc điều hành của Luta Security, nhận định sự cố này là điềm báo cho các vụ xâm nhập trong tương lai, nói rằng các mô hình ngày nay "giống như những con bạch tuộc đào tẩu thông minh nhất thế giới, với số lượng vòi không giới hạn và khả năng luồn lách qua bất kỳ đâu."

Bà cho biết "các phòng thí nghiệm và các nhà đánh giá của chính phủ cần phải làm việc để nâng cao khả năng cô lập, giám sát và công khai cho các bên bị ảnh hưởng khi một AI thực hiện một màn đào tẩu kiểu Houdini khác, lý tưởng nhất là trước khi nó gây hại cho bên thứ ba. Hiện chưa có điều này tồn tại."

Matt Suiche, một kỹ sư tại công ty an ninh mạng AI Tolmo, cho biết sự cố cho thấy các mô hình AI hàng đầu đang "thu hẹp khoảng cách với các kẻ tấn công tiên tiến nhất." Nhưng ông cho rằng những kiểu xâm nhập được mô tả trong bài đăng trên blog của OpenAI là hoàn toàn có thể thực hiện được với công nghệ đã sẵn có ngoài tầm phạm vi các phòng thí nghiệm nghiên cứu hàng đầu.

"Đây là những gì chúng tôi đã thấy trong nội bộ, với các đại lý của mình, chúng tôi đã có những kết quả như thế này," Suiche nói. "Chúng tôi thậm chí không cần phải sử dụng các mô hình mới nhất."