Thêm 2 cơ quan báo chí tố OpenAI và Microsoft vi phạm bản quyền trong đào tạo AI

09:42, 08/09/2026

Seattle Times và Newsday mới đây đã đệ đơn khởi kiện OpenAI và Microsoft tại Mỹ với cáo buộc hai công ty sử dụng các tác phẩm báo chí có bản quyền để huấn luyện và vận hành các hệ thống trí tuệ nhân tạo (AI) mà khi chưa xin cấp phép.

Theo đơn kiện được đệ trình lên Tòa án Quận phía Nam New York, hai cơ quan báo chí cáo buộc OpenAI và Microsoft đã thu thập, sao chép nội dung từ các website của họ, trong đó có cả những bài viết nằm sau tường phí, sau đó đưa vào các tập dữ liệu được sử dụng để huấn luyện và vận hành những sản phẩm như ChatGPT, Microsoft Copilot và các tính năng AI của Bing.

Seattle Times và Newsday cho rằng các hệ thống AI có khả năng tái hiện những đoạn nội dung từ các bài báo của họ, diễn đạt lại rất gần với bản gốc và cung cấp câu trả lời trực tiếp cho người dùng. Theo các nhà xuất bản, điều này có thể làm giảm nhu cầu truy cập website, đọc bài viết hoặc đăng ký thuê bao của độc giả.

Hai cơ quan báo chí cáo buộc các công ty công nghệ đã "có hệ thống" thu thập nội dung báo chí, thậm chí vượt qua cơ chế tường phí để tiếp cận những bài viết không được cung cấp công khai. Họ cho rằng việc sử dụng nội dung theo cách này gây tổn hại đến mô hình kinh doanh của các cơ quan báo chí, trong đó có doanh thu quảng cáo kỹ thuật số và doanh thu từ thuê bao.

Seattle Times và Newsday cũng cáo buộc các hệ thống AI đôi khi tạo ra thông tin sai lệch nhưng lại gắn những nội dung này với tên của hai cơ quan báo chí, đồng thời làm mất hoặc loại bỏ thông tin quản lý bản quyền đi kèm các bài viết.

Chủ tịch kiêm Tổng giám đốc điều hành Seattle Times Alan Fisco cho biết đây không phải là quyết định dễ dàng, nhưng tờ báo cần bảo vệ những nội dung được đầu tư hàng triệu USD mỗi năm để sản xuất khỏi việc bị sử dụng mà không có sự đồng ý hoặc bồi hoàn.

Theo đơn kiện, các nguyên đơn yêu cầu bồi thường thiệt hại, đồng thời đề nghị tòa án yêu cầu tiêu hủy hoặc thu giữ các bản sao tác phẩm của họ, những tập dữ liệu huấn luyện và các mô hình AI có tích hợp nội dung bị cáo buộc vi phạm bản quyền.

OpenAI và Microsoft phản hồi

OpenAI cho biết các mô hình của công ty được huấn luyện bằng dữ liệu công khai và dựa trên nguyên tắc sử dụng hợp lý, hay "fair use", trong luật bản quyền Mỹ. Công ty không đưa ra bình luận cụ thể về vụ kiện.

Microsoft cho biết bất ngờ trước vụ kiện, đồng thời nhấn mạnh tầm quan trọng của báo chí địa phương và bày tỏ sẵn sàng thảo luận để tìm kiếm giải pháp cho những tranh chấp dạng này.

Microsoft từ năm 2019 đã đầu tư hàng tỷ USD vào OpenAI và là đối tác điện toán đám mây quan trọng của công ty. Hai bên cũng hợp tác phát triển các mô hình ngôn ngữ lớn đứng sau ChatGPT và những sản phẩm AI của Microsoft.

Mặc dù quan hệ hợp tác giữa hai công ty đã được điều chỉnh theo hướng trao cho OpenAI mức độ độc lập lớn hơn, Microsoft vẫn duy trì vai trò quan trọng trong cấu trúc sở hữu và quan hệ kinh doanh với OpenAI.

Tranh chấp bản quyền AI ngày càng lan rộng

Vụ kiện của Seattle Times và Newsday diễn ra trong bối cảnh ngày càng nhiều nhà xuất bản và chủ sở hữu bản quyền tại Mỹ đưa các công ty AI ra tòa vì việc sử dụng tác phẩm có bản quyền để huấn luyện mô hình.

Năm 2023, The New York Times đã kiện OpenAI và Microsoft với cáo buộc tương tự, cho rằng hàng triệu bài báo của mình đã được sử dụng để phát triển các hệ thống AI mà không được cho phép. Vụ kiện này vẫn đang trong quá trình giải quyết.

Một số nhà xuất bản khác cũng lựa chọn con đường pháp lý, trong khi một số tổ chức truyền thông lại ký thỏa thuận với các công ty AI để cho phép sử dụng nội dung báo chí. Associated Press và Vox Media là những ví dụ về các đơn vị đã hợp tác với OpenAI.

Seattle Times và Newsday cho rằng sự phát triển của các công cụ AI tạo sinh có thể tạo ra sự thay đổi đáng kể đối với cách độc giả tiếp cận thông tin, qua đó tác động trực tiếp đến lượng truy cập, doanh thu quảng cáo và số lượng thuê bao của các cơ quan báo chí.

Trong khi đó, OpenAI và các công ty công nghệ lập luận rằng việc sử dụng các tác phẩm có bản quyền để huấn luyện mô hình AI có thể được bảo vệ theo nguyên tắc "fair use", đặc biệt khi hệ thống tạo ra nội dung mới thay vì đơn thuần sao chép tác phẩm gốc.

Seattle Times vẫn sử dụng AI trong một số hoạt động

Đáng chú ý, Seattle Times không hoàn toàn đứng ngoài quá trình ứng dụng AI. Tòa soạn này từng nhận khoản tài trợ để triển khai một chương trình nghiên cứu về tính bền vững của mô hình kinh doanh báo chí và ứng dụng AI trong hoạt động của cơ quan báo chí.

Tờ báo cũng sử dụng một số tài khoản ChatGPT phục vụ phân tích dữ liệu và cho phép ứng dụng AI trong một số nhiệm vụ có giới hạn, chẳng hạn như chuyển lời nói thành văn bản và phân tích dữ liệu, sau khi trải qua quy trình đánh giá rủi ro.

Theo chính sách được Seattle Times công khai, những trường hợp AI đóng vai trò đáng kể trong quá trình sản xuất nội dung sẽ được ghi rõ. Tòa báo cho biết không sử dụng AI để tự động tạo ra các bài báo.

Vụ kiện mới nhất cho thấy tranh chấp giữa ngành báo chí và các công ty AI không chỉ xoay quanh vấn đề liệu dữ liệu có bản quyền có thể được sử dụng để huấn luyện mô hình hay không, mà còn liên quan đến tác động kinh tế của các hệ thống AI đối với hoạt động xuất bản, đặc biệt là khả năng làm giảm lượng độc giả truy cập trực tiếp vào các website tin tức.

Trong bối cảnh đó, bài toán xây dựng cơ chế cấp phép nội dung, chia sẻ doanh thu và bảo vệ quyền tác giả đang ngày càng trở thành vấn đề trung tâm trong mối quan hệ giữa ngành báo chí và ngành công nghiệp AI.