Trong vài tháng qua, các tác nhân (agent) AI đang trong quá trình đánh giá an ninh mạng đã vượt ra khỏi giới hạn, truy cập internet và trong một số trường hợp, xâm nhập vào các hệ thống thế giới thực. Các sự cố này liên quan đến các mô hình từ OpenAI, Anthropic, Meta và gần đây nhất là phòng thí nghiệm AI Trung Quốc Moonshot AI, với quá trình thử nghiệm được tiến hành bởi nhiều tổ chức khác nhau, trong đó có một công ty khởi nghiệp chuyên đánh giá không gian mạng mang tên Irregular.