Các phòng thí nghiệm AI Trung Quốc âm thầm dùng hàng triệu cuộc hội thoại của Claude để huấn luyện mô hình, Anthropic cho biết
Anthropic cho biết họ đã phát hiện và ngăn chặn các nỗ lực quy mô lớn trái phép từ các phòng thí nghiệm AI tại Trung Quốc - bao gồm Alibaba, Moonshot và DeepSeek - nhằm sử dụng dữ liệu của Claude để huấn luyện các mô hình riêng.

Jonathan Raa
Trong báo cáo tình báo an ninh công bố hôm thứ Năm, công ty AI của Mỹ cho biết các đơn vị này đã tham gia vào hoạt động mà họ mô tả là "trích xuất phi pháp" (illicit distillation). Đây là quá trình sử dụng đầu ra từ một mô hình AI tiên tiến hơn để huấn luyện mô hình khác nhằm sao chép năng lực mà không được cấp phép.
"Một số cuộc trao đổi này chứa thông tin nhạy cảm từ người dùng cá nhân, các tập đoàn đa quốc gia lớn và các cơ quan liên quan đến nhà nước... Những hành vi này nhiều khả năng vi phạm luật bảo mật dữ liệu cũng như điều khoản dịch vụ của chính các phòng thí nghiệm đó," báo cáo nhấn mạnh.
Anthropic cho biết các nhóm liên kết với Alibaba đã dùng phản hồi của Claude để hỗ trợ huấn luyện dòng mô hình Qwen. Trong khi đó, Moonshot chuyển hướng một số yêu cầu của người dùng Kimi sang Claude và dùng các cuộc trao đổi thu được để huấn luyện mô hình riêng.
Chiến dịch của Alibaba là chiến dịch trích xuất dữ liệu lớn nhất mà Anthropic từng ghi nhận, với hơn 151 triệu lượt trao đổi với Claude từ tháng 5 đến tháng 7. Hoạt động này đạt đỉnh gần 3 triệu lượt trao đổi mỗi ngày thông qua hơn 3.500 tài khoản giả mạo. Báo cáo cũng cho biết Alibaba còn dùng Claude cho các nghiên cứu AI rộng hơn, bao gồm học tăng cường và kiến trúc mô hình.
Moonshot và DeepSeek
Anthropic cũng chi tiết hóa hoạt động liên quan đến Moonshot AI, công ty có trụ sở tại Bắc Kinh đứng sau dòng mô hình Kimi.
Theo báo cáo, Moonshot đã âm thầm chuyển tiếp các yêu cầu của khách hàng Kimi sang Claude, sau đó hiển thị câu trả lời của Claude cho người dùng mà họ không hề hay biết. Trong một đợt cao điểm kéo dài 10 ngày, Moonshot đã chuyển tiếp gần 300.000 yêu cầu sang Anthropic, phần lớn hướng tới dòng mô hình Claude Opus. Các yêu cầu này được điều hướng qua mạng lưới 5.380 tài khoản giả mạo đặt tại Singapore và Nhật Bản.
Báo cáo cho biết Moonshot đã lưu lại ít nhất một phần các cuộc trao đổi đó và trích xuất chuỗi suy luận (reasoning transcripts) của Claude để làm dữ liệu huấn luyện. Tổng cộng hơn 23 triệu lượt trao đổi được cho là do Moonshot thực hiện từ tháng 5 đến tháng 7. Một số yêu cầu chứa thông tin nhạy cảm và Anthropic không rõ liệu Moonshot có thông báo cho khách hàng về việc dữ liệu bị gửi sang Anthropic hay không.
Anthropic cho biết DeepSeek — đơn vị thu hút sự chú ý lớn từ năm ngoái nhờ năng lực cao và chi phí rẻ — cũng áp dụng các thủ thuật tương tự Moonshot khi chuyển giao các cuộc hội thoại sang Claude mà không báo cho người dùng. Công ty ghi nhận hơn 12 triệu cuộc tấn công trích xuất dữ liệu từ DeepSeek trong vòng 14 ngày vào tháng 7 năm 2026.
Báo cáo đề cập đến nhiều công ty AI lớn khác của Trung Quốc, bao phủ các hoạt động mà Anthropic cho biết đã ngăn chặn từ tháng 12 năm 2025 đến tháng 8 năm 2026 trên 7 lĩnh vực: thao túng không gian mạng, chiến dịch ảnh hưởng, giám sát, lừa đảo, lạm dụng sinh học, phát triển vũ khí thông thường và trích xuất dữ liệu.
Alibaba, Moonshot, DeepSeek, Xiaomi và Anthropic hiện chưa phản hồi ngay lập tức các yêu cầu bình luận từ CNBC.
