Mô hình AI của Meta xâm nhập một công ty khác trong quá trình kiểm thử

19:38, 06/08/2026

WASHINGTON, ngày 5 tháng 8 Meta hôm thứ Tư cho biết một trong những mô hình AI của hãng đã xâm nhập trái phép (hack) vào hệ thống của một công ty khác trong đợt kiểm thử an ninh mạng. Sự cố này tiếp tục làm dấy lên những lo ngại về khả năng kiểm soát các hệ thống AI ngày càng thông minh, sau các vụ việc tương tự gần đây tại các đối thủ Anthropic và OpenAI.

Logo của Meta tại Meta Lab ở Los Angeles, California, Hoa Kỳ

Các sự cố tại Meta và Anthropic xuất phát từ lỗi cấu hình, vô tình mở quyền truy cập internet công cộng cho các mô hình của họ. Đối với OpenAI, một đại lý AI (AI agent) đã tự động khai thác một lỗ hổng bảo mật chưa từng được biết đến để vượt rào truy cập internet trong lúc kiểm tra an ninh mạng.

Những vụ xâm nhập này làm nổi bật nỗi lo ngày càng tăng rằng các hệ thống AI tiên tiến có thể tạo ra các rủi ro an ninh mạng mới. Điều này nhiều khả năng sẽ thúc đẩy chính phủ Mỹ thắt chặt các biện pháp tăng cường an toàn AI trong bối cảnh các công ty đang đua nhau phát triển những mô hình mạnh mẽ hơn. Một số nhà lãnh đạo AI hàng đầu lập luận rằng nên làm chậm tốc độ phát triển cho đến khi có các biện pháp bảo vệ vững chắc hơn.

Meta cho biết họ đang điều tra sự cố, trong đó sự sai sót về cấu hình từ Irregular một công ty độc lập chuyên đánh giá an ninh mạng cho Meta đã vô tình cấp quyền truy cập internet cho một trong các mô hình của Meta trong đợt kiểm thử.

Mô hình này "đã khai thác một lỗ hổng bảo mật trong một dịch vụ bên thứ ba, theo cách tương tự như các trường hợp đã được báo cáo trước đó với các công ty khác," Meta đưa ra tuyên bố.

Dẫn các nguồn tin thân cận, trang The Information đưa tin mô hình liên quan là Muse Spark 1.1 của Meta  mô hình mà công ty từng quảng bá là có năng lực nhất cho các tác vụ lập trình thực tế và các nhiệm vụ tự vận hành (agentic tasks). Báo cáo cho biết mô hình đã xâm nhập vào hệ thống của một công ty chưa được xác định danh tính và làm thay đổi môi trường nội bộ của công ty đó.

Người phát ngôn của Irregular chia sẻ với Reuters rằng sự cố này "hoặc toàn là vấn đề môi trường đánh giá tương tự như những gì Anthropic đã tiết lộ tuần trước" và không liên quan đến "hành vi vượt rào cách ly (sandbox escape) hay hành động tấn công mạng phức tạp".

"Hiện không có sự cố nào còn tồn đọng. Irregular đang xây dựng một tài liệu kỹ thuật (white paper) để chia sẻ các thực hành tốt nhất cho việc khoanh vùng và vận hành an toàn các đợt đánh giá an ninh mạng," đại diện Irregular cho biết.

Lo ngại về rủi ro an ninh mạng

Các sự cố xâm nhập gần đây đã làm dấy lên sự lo ngại giữa các nhà lập pháp Mỹ về việc liệu các mô hình AI ngày càng mạnh mẽ có thể bị sử dụng để thực hiện hoặc tiếp tay cho các cuộc tấn công mạng hay không.

Một nhóm các tổng chưởng lý bang thuộc Đảng Cộng hòa đã yêu cầu OpenAI bảo lưu tất cả các tài liệu có khả năng liên quan đến vụ xâm nhập Hugging Face của họ. OpenAI cho biết sẽ nghiêm túc thực hiện yêu cầu này và công bố một báo cáo kỹ thuật về sự cố.

Đầu tuần này, Nhà Trắng đã mời đại diện các công ty AI hàng đầu bao gồm Meta, Anthropic, OpenAI và Google đến họp với các quan chức để thảo luận về một khung kiểm thử an ninh mạng tự nguyện vừa được hoàn thiện dành cho các mô hình AI tiên tiến.

Chính quyền Tổng thống Trump đã thảo luận về các quy tắc kiểm thử chưa công bố với đại diện các công ty và thông báo với các nhà phát triển AI rằng các mô hình AI trọng số mở (open-weight), chẳng hạn như Llama của Meta hay Nemotron của Nvidia, sẽ không thuộc phạm vi điều chỉnh của cơ chế kiểm thử an toàn tự nguyện dự kiến này, theo Reuters.