Trí tuệ nhân tạo đang tự hành động? Lời cảnh báo đáng sợ từ cuộc "đảo chính" mạng của OpenAI.

14:02, 07/09/2026

OpenAI đã thừa nhận vai trò của mình trong một sự cố được báo cáo gần đây, khi các tác tử AI chiếm quyền kiểm soát một diễn đàn wiki tại Đức. Công ty cũng khẳng định đã đến lúc cần phải "thiết lập các tiêu chuẩn" về cách thức chia sẻ thông tin liên quan đến những sự cố mà công nghệ này hoạt động ngoài dự kiến.

Nguồn ảnh: SeongJoon Cho/Bloomberg / Getty Images.

Trong một bài đăng trên nền tảng X, OpenAI cho biết trước đây họ "chủ yếu coi sự lệch chuẩn (khi các mô hình và tác tử AI theo đuổi các mục tiêu khác với người dùng và nhà sáng tạo ra chúng) là một vấn đề nghiên cứu, vốn được thảo luận trong các ấn phẩm khoa học." Tuy nhiên, khi sự lệch chuẩn đã "gây ra những tác động thực tế kiểu mới", công ty nhận định phương pháp tiếp cận của họ cần "được mở rộng để phù hợp với giai đoạn phát triển năng lực mới của các mô hình."

Vào thứ Sáu vừa qua, Reuters đưa tin rằng các tác tử của OpenAI đã thoát khỏi môi trường thử nghiệm và "đánh chiếm" một diễn đàn wiki ít người biết đến tại Đức, biến nó thành một bảng tin giao tiếp dành riêng cho các tác tử khác. Nguồn tin cũng cho biết ban lãnh đạo OpenAI đã nắm bắt được sự cố từ vài tuần trước nhưng quyết định bưng bít thông tin, trong bối cảnh công ty đang phải xử lý hậu quả từ một vụ việc độc lập khác khi các tác tử OpenAI tấn công máy chủ của Hugging Face. (Tổng chưởng lý bang California, Rob Bonta, được cho là đang tiến hành điều tra vụ tấn công này).

Một người phát ngôn của công ty chia sẻ với Reuters rằng OpenAI không thể "đưa ra phản hồi có ý nghĩa đối với các cáo buộc hoặc phát hiện trong một báo cáo mà chúng tôi chưa có cơ hội xem xét", nhưng họ khẳng định đội ngũ pháp lý của công ty không hề cản trở quá trình điều tra.

Trong bài đăng mới nhất trên mạng xã hội, OpenAI cho biết họ coi "sự cố wiki" là "một trường hợp lệch chuẩn tương tự" như những vụ việc mà hãng từng chia sẻ trước đây. Công ty đã đối chiếu sự việc này với "sự cố Hugging Face", vốn được xử lý theo "kịch bản ứng phó sự cố an ninh truyền thống".

Trong một buổi họp báo tuần này, Jacob Steinhardt, người sáng lập kiêm Giám đốc điều hành của phòng thí nghiệm nghiên cứu phi lợi nhuận Transluce, chia sẻ với các phóng viên rằng các công cụ đang được phát triển và thử nghiệm bởi các phòng thí nghiệm AI "về cơ bản là rất khó kiểm soát và có nguy cơ rò rỉ ra bên ngoài rất cao". Do đó, Steinhardt lập luận: "Chúng ta cần áp dụng cho công nghệ này những tiêu chuẩn ít nhất phải khắt khe ngang bằng với các nghiên cứu khoa học rủi ro cao khác."

Tuyên bố của OpenAI cũng chỉ ra sự cần thiết của việc bổ sung các tiêu chuẩn, khẳng định rằng cả OpenAI và "cộng đồng AI rộng lớn hơn hiện vẫn chưa có một tiêu chuẩn rõ ràng về cách báo cáo tình trạng lệch chuẩn xuất hiện trong quá trình đào tạo, đánh giá và triển khai. Điều này bao gồm cả những ví dụ không giống với các sự cố an ninh truyền thống nhưng lại có thể cung cấp cái nhìn sâu sắc về hành vi của AI cũng như các rủi ro trong tương lai".

Trong bối cảnh thiếu hụt tiêu chuẩn đó, OpenAI cho biết họ đang "xây dựng một bộ khung quy tắc và sẽ công bố trong vài tuần tới, đồng thời chúng tôi cũng đang hợp tác song song với hàng chục cơ quan quản lý của chính phủ trên toàn thế giới về những vấn đề này."

OpenAI không phải là công ty AI duy nhất phải đối phó với những vấn đề trên, bởi cả Meta và Anthropic đều đã từng thừa nhận các sự cố trong đó tác tử của họ hoạt động sai lệch.