OpenAI làm chậm quá trình huấn luyện mô hình để tăng cường bảo mật sau sự cố hack Hugging Face
SAN FRANCISCO, 18/8 OpenAI vào hôm thứ Ba cho biết họ đang làm chậm tốc độ phát triển mô hình AI trong khi tiến hành cải tổ các hệ thống nghiên cứu và huấn luyện, sau khi các quan chức của OpenAI bị bất ngờ vào tháng trước khi một tác tử AI (AI agent) trong quá trình thử nghiệm đã tấn công mạng (hack) một công ty AI khác là Hugging Face

Hình ảnh logo OpenAI trong bức minh họa này được chụp vào ngày 11 tháng 6 năm 2026
Phòng nghiên cứu AI đằng sau Chat GPT cho biết họ đã tạm dừng việc kiểm thử mô hình trong hai tuần và đang bổ sung các hệ thống AI khác để giám sát hoạt động của các tác tử AI trong quá trình thử nghiệm. Công ty đã tạm dừng việc huấn luyện thế hệ mô hình tiếp theo có tên là Astra, và đợt huấn luyện lớn nhất theo kế hoạch của hãng vẫn đang tiếp tục bị hoãn, công ty cho hay.
Công ty đã không trả lời các câu hỏi về việc đợt làm chậm kéo dài hai tuần này bắt đầu từ khi nào.
Tin tức này đánh dấu một bước đi bất thường đối với OpenAI, đơn vị vốn đã tăng tốc đáng kể quy trình thẩm định các mô hình mới và xây dựng các sản phẩm mới trong vài năm qua khi sự cạnh tranh trong ngành công nghiệp AI ngày càng gay gắt. Hiện vẫn chưa rõ liệu các biện pháp khắc phục được đề xuất của công ty có đủ để triệt tiêu hành vi nói trên hay không, đặc biệt là khi hãng cũng đang nỗ lực làm cho các mô hình của mình trở nên năng lực hơn.
Các quan chức OpenAI thừa nhận rằng vẫn còn những câu hỏi ngỏ về hiệu quả của một trong những biện pháp khắc phục chính nhằm củng cố hệ thống kiểm thử của mình, được gọi là "giám sát chuỗi suy luận" (chain-of-thought monitoring). Trong hình thức giám sát này, các nhà nghiên cứu có thể nhìn thấu vào quá trình lập kế hoạch của mô hình và nắm bắt được các chiến lược mà mô hình đang áp dụng. Tuy nhiên, một số nghiên cứu ban đầu chỉ ra rằng một mô hình có thể sẽ không tiết lộ các kế hoạch vi phạm quy tắc của nó trong chuỗi suy luận.
OpenAI tháng trước cho biết một tác tử tự hành được vận hành bởi hai mô hình trí tuệ nhân tạo tiên tiến đã thoát khỏi môi trường thử nghiệm và xâm nhập vào công ty khởi nghiệp AI Hugging Face. Tác tử này đang trải qua một bài kiểm tra an ninh mạng và đã đột nhập vào Hugging Face nhằm đáp ứng mục tiêu của bài kiểm tra. OpenAI đã và đang điều tra sự cố này và dự kiến sẽ sớm công bố một báo cáo.
Reuters trước đó đã đưa tin rằng cho đến thời điểm đó, công ty thường chạy đồng thời nhiều đợt đánh giá mô hình khác nhau, tất cả đều vận hành với tốc độ cao và tạo ra lượng dữ liệu khổng lồ mà nhân viên phải rất vất vả mới theo kịp.
OpenAI hiện đang yêu cầu một số khối lượng công việc nhạy cảm hơn phải được thực hiện trong các "môi trường cô lập" (sandboxes) mạnh mẽ hơn.
Vào ngày 7 tháng 8, OpenAI cho biết họ đang thắt chặt các kiểm soát an ninh đối với các mô hình mạnh nhất của mình và tạm dừng bất kỳ hoạt động nào liên quan đến dòng AI hàng đầu (frontier AI) chưa được phát hành có tên là Astra — vốn chưa đáp ứng được các yêu cầu này. OpenAI cho biết họ thực hiện các hành động này phù hợp với kế hoạch đã công bố trước đó về quản lý các năng lực tiềm ẩn rủi ro nghiêm trọng, gọi là Khung chuẩn bị (Preparedness Framework). Vào hôm thứ Ba, các lãnh đạo cấp cao của OpenAI cho biết ngành công nghiệp này sẽ cần một chiến lược sâu rộng hơn để chuẩn bị sẵn sàng cho các mô hình trong tương lai.
