OpenAI tung “vũ khí” bảo vệ quyền riêng tư, nhắm tới lợi thế trước Anthropic
Khi các mô hình AI ngày càng trở nên mạnh mẽ, nguy cơ những mô hình này bị lạm dụng cũng tăng theo, kéo theo đó là những lời kêu gọi về các rào chắn an toàn nhằm ngăn chặn tình trạng này. Các công ty AI hiện đang phải đi trên một sợi dây thăng bằng mỏng manh giữa việc tôn trọng quyền riêng tư của khách hàng doanh nghiệp và việc giám sát quá trình sử dụng để phát hiện các vấn đề tiềm ẩn.

Nguồn ảnh: Kyle Grillot/Bloomberg / Getty Images.
Nhận thấy cơ hội để "vượt mặt" đối thủ Anthropic, OpenAI vừa công bố một phương pháp an toàn tập trung vào quyền riêng tư để giám sát hành vi lạm dụng. Công ty đang cho một số khách hàng chọn lọc dùng thử dịch vụ mới có tên là Xử lý An toàn Riêng tư (Private Safety Processing). Đây là một hệ thống tự động theo dõi các dấu hiệu lạm dụng tiềm ẩn nhưng đồng thời không lưu giữ bất kỳ dữ liệu nào của khách hàng.
Hệ thống này rõ ràng đi ngược lại với chính sách lưu giữ dữ liệu mà Anthropic mới công bố gần đây. Chính sách này, vốn đã khiến một số khách hàng bức xúc, cho phép phòng thí nghiệm AI giữ lại dữ liệu người dùng (tất cả các phiên làm việc và các cuộc trò chuyện trong đó) trong khoảng thời gian 30 ngày đối với các "mô hình nằm trong phạm vi áp dụng". Công ty cho biết các mô hình này bao gồm tất cả các mô hình thuộc lớp Mythos và "các mô hình trong tương lai có khả năng tương tự".
Chính sách được công bố vào tháng 7 này vốn được thiết kế vì mục đích an toàn, cho phép phòng thí nghiệm sàng lọc và phân tích các hành vi không phù hợp tiềm ẩn. Tuy nhiên, nó lại gây lo ngại sâu sắc cho một số doanh nghiệp đang xử lý lượng lớn dữ liệu nhạy cảm và không muốn dữ liệu đó bị lưu trữ (hoặc kiểm tra) bởi phòng thí nghiệm AI này.
OpenAI - cũng giống như hầu hết các công ty AI khác vốn đã cung cấp cho khách hàng một mức độ riêng tư tương đối bằng cách tuân thủ chính sách có tên là Không lưu giữ dữ liệu (Zero Data Retention - ZDR). ZDR sử dụng các tác vụ tự động (agent) bên trong API của OpenAI để giám sát hành vi lạm dụng trên cơ sở từng phiên. Bằng cách này, dữ liệu khách hàng không bị công ty lưu giữ nhưng các công ty vẫn có thể quét các hoạt động xấu mà không cần sự can thiệp của con người. Đáng chú ý là Anthropic phần lớn cũng tuân thủ ZDR ngoại trừ khi liên quan đến các "mô hình nằm trong phạm vi áp dụng", chẳng hạn như Fable.
OpenAI cho biết Xử lý An toàn Riêng tư là một công nghệ mới giúp mở rộng phạm vi của ZDR. Công ty mô tả đây là một hình thức giám sát an toàn dài hạn, giúp đánh giá các dữ liệu đầu vào và đầu ra của nhiều cuộc trò chuyện chứ không chỉ một. Một lần nữa, quá trình giám sát được thực hiện bởi một tác vụ tự động, và nếu được kích hoạt, nó sẽ nắm bắt các tương tác và phân tích chúng qua nhiều phiên để tìm kiếm các dấu hiệu lạm dụng tiềm ẩn.
Một người phát ngôn chia sẻ với TechCrunch rằng công nghệ mới này giúp OpenAI phát hiện hành vi sử dụng AI với mục đích xấu diễn ra qua nhiều phiên. Một kẻ xấu - giả sử là một người đang cố gắng lập trình mã độc cho một cuộc tấn công mạng - có thể chia nhỏ các yêu cầu của họ để tránh bị phát hiện. Xử lý An toàn Riêng tư có thể phân tích nhiều cuộc trò chuyện đó để tìm ra dấu hiệu lạm dụng mà không cần con người phải trực tiếp xem xét các đoạn hội thoại của người dùng.
Công ty cho biết, trong trường hợp hệ thống được kích hoạt, nó có thể gửi một "tín hiệu được xác định trong phạm vi hẹp" tới OpenAI để cảnh báo về một loại hoạt động cụ thể. Dựa trên tín hiệu đó, OpenAI có thể quyết định xem có "cần thiết phải thực thi biện pháp xử lý" hay không. Người phát ngôn cho biết thêm, nếu có, OpenAI sẽ liên hệ với khách hàng để nắm thêm bối cảnh hoặc để cùng họ giải quyết vấn đề, và khách hàng có thể toàn quyền quyết định việc có chia sẻ dữ liệu với OpenAI hay không.
Ngược lại, Anthropic lưu ý rằng việc con người xem xét dữ liệu khách hàng có thể xảy ra, nhưng chỉ "thông qua một đường dẫn truy cập được kiểm soát" giới hạn ở "một nhóm nhỏ những người đánh giá được phê duyệt". Công ty khẳng định mỗi phiên xem xét đó đều được "ghi lại trong một nhật ký chống giả mạo mà người đánh giá không thể che giấu hay chỉnh sửa".
Cuộc cạnh tranh giữa OpenAI và Anthropic hiện đang rất căng thẳng, khi cả hai công ty đều đang tìm kiếm mọi cơ hội để giành lợi thế trước đối thủ. Một báo cáo gần đây cho thấy quý 2 của OpenAI tăng trưởng chậm hơn so với Anthropic. Doanh thu dự phóng hàng năm của Anthropic hiện được báo cáo ở mức 65 tỷ USD (khoảng 1,62 triệu tỷ VNĐ). Các nhà đầu tư của Anthropic cho biết công ty này có thể tiến hành IPO (Chào bán chứng khoán lần đầu ra công chúng) với mức định giá lên tới 2 nghìn tỷ USD (khoảng 50 triệu tỷ VNĐ), trong khi OpenAI cũng đang ráo riết chuẩn bị cho đợt IPO của riêng mình.
