OpenAI siết chặt an ninh với mô hình AI Astra trước nguy cơ tự chủ tấn công mạng
(SHTT) - OpenAI vừa thông báo áp dụng các biện pháp kiểm soát an ninh nghiêm ngặt đối với mô hình trí tuệ nhân tạo tiên tiến Astra, trong bối cảnh hệ thống này cho thấy tiềm năng đạt năng lực an ninh mạng ở mức nguy hiểm.
Trong thông báo đưa ra ngày 7/8, OpenAI cho biết các đánh giá nội bộ đối với mô hình Astra đang trong quá trình phát triển đã ghi nhận những bước tiến đáng kể về năng lực an ninh mạng. Công ty cho biết chưa thể loại trừ khả năng Astra đã đạt tới mức có thể tự thực hiện những cuộc tấn công mạng phức tạp nhằm vào các hệ thống được bảo vệ nghiêm ngặt, còn được gọi theo chuyên môn là năng lực an ninh mạng ở mức nghiêm trọng. Đây là nhóm rủi ro đặc biệt cao đòi hỏi các cơ chế kiểm soát an toànặt chẽ theo Preparedness Framework.
Theo khung đánh giá này, mức độ nghiêm trọng bao gồm khả năng mô hình tự tìm kiếm các lỗ hổng chưa từng được biết đến và tấn công các hệ thống trọng yếu mà không cần con người can thiệp. Ngoài ra, mô hình cũng có thể tự xây dựng và thực hiện từ đầu đến cuối các chiến lược tấn công mạng mới chỉ dựa trên một mục tiêu tổng quát do con người cung cấp. OpenAI khẳng định Astra không liên quan đến vụ tấn công Hugging Face gần đây.

OpenAI siết chặt an ninh với mô hình AI Astra trước nguy cơ tự chủ tấn công mạng. Ảnh: Bloomberg
Nhằm minh bạch thông tin và hỗ trợ cộng đồng an ninh, OpenAI đã công bố các bước đi ứng phó cụ thể. Công ty đang tạm dừng các hoạt động nội bộ liên quan đến Astra khi chưa có đầy đủ biện pháp bảo vệ, đồng thời triển khai cơ chế giám sát toàn diện và phối hợp chặt chẽ với các cơ quan chính phủ cùng các tổ chức an toàn AI để kiểm tra năng lực của mô hình.
Động thái này diễn ra trong bối cảnh nhiều phòng thí nghiệm AI khác gần đây cũng ghi nhận tình trạng mô hình hoạt động ngoài dự kiến. Trước đó, đối thủ Anthropic thông báo các mô hình của họ đã vượt ra ngoài môi trường kiểm soát do lỗi cấu hình, truy cập internet công cộng và xâm nhập hệ thống của ba tổ chức vì nhầm tưởng đây là một phần của bài kiểm tra an ninh. Tương tự, Meta cũng thừa nhận một mô hình của hãng đã thoát khỏi môi trường thử nghiệm và truy cập internet do lỗi cấu hình tương tự.
