Ngán ngẩm với "rác AI"? Các ông lớn công nghệ cũng vậy
Trên khắp không gian mạng, các công ty công nghệ đang tiến hành một cuộc "thanh lọc" rác thải tạo sinh (generative waste) – trong nhiều trường hợp, chính họ cũng đang bị quá tải bởi mớ rác do chính các công cụ AI của mình tiếp tay.

Trụ sở của Google tại Mountain View, bang California, ngày 22 tháng 7 năm 2025. | Nguồn ảnh: Kelsey McClellan/The New York Times.
Những "bãi rác" tồi tệ nhất của trí tuệ nhân tạo (AI slop) đã làm xáo trộn kết quả tìm kiếm trên Google với các công thức làm bánh pizza phủ... keo dán, tràn ngập các danh sách sản phẩm trên Amazon bằng những cuốn tiểu sử giả mạo và phủ kín bảng tin Facebook bằng những hình ảnh "Chúa Jesus Tôm" (Shrimp Jesus) kỳ dị.
Đống "nước thải kỹ thuật số" này đã lan rộng khắp các nền tảng công nghệ, làm giảm giá trị của những nội dung ý nghĩa và gây ô nhiễm hệ sinh thái thông tin, trong bối cảnh các chatbot và công cụ tạo video AI vẫn tiếp tục không ngừng tiến hóa.
Giờ đây, Thung lũng Silicon đang muốn bắt tay vào "dọn rác".
Spotify cho biết họ đã xóa bỏ 75 triệu lượt tải lên hàng loạt, các bài hát trùng lặp và các bản nhạc mang tính chất "thư rác" (spam) trong năm ngoái - chiếm một phần không nhỏ trong tổng danh mục của nền tảng. Hồi tháng 7, LinkedIn tuyên bố rằng "rác AI đang là ưu tiên hàng đầu của tất cả chúng tôi" và đã phát triển một nút bấm để người dùng có thể báo cáo tình trạng này. Các nhà nghiên cứu từ Google, công ty mẹ của YouTube, cũng đã mô tả cách một dịch vụ video quét sạch 130.000 kênh chứa nội dung kém chất lượng khỏi nền tảng của mình chỉ trong vòng sáu tháng.
Trên khắp không gian mạng, các công ty công nghệ đang tiến hành một đợt thanh lọc rác AI, trong khi bản thân họ cũng thường xuyên bị quá tải bởi chính những mớ rác rưởi từng được tạo ra từ các công cụ AI của riêng mình. Các ứng dụng nhắn tin di động, trang web đánh giá nhà hàng, kho lưu trữ học thuật và các dịch vụ hẹn hò đều đang nỗ lực nhổ tận gốc hoặc làm giảm sự xuất hiện của các nội dung rác do AI tạo ra - và nhiều nền tảng trong số đó lại đang dựa vào chính công nghệ AI để thực hiện cuộc thanh trừng này.
Trở thành gánh nặng của không gian mạng
Mọi người đang dần mệt mỏi với tác động của AI đối với môi trường, cũng như áp lực của nó lên vấn đề việc làm và sức khỏe tinh thần. Rác AI chỉ là một "vết thương đang mưng mủ" khác, theo nhận định của Aidan Walker, một nhà sáng tạo nội dung và nhà nghiên cứu xu hướng trực tuyến làm việc cho Quỹ Carnegie vì Hòa bình Quốc tế (Carnegie Endowment for International Peace), một tổ chức tư vấn các vấn đề toàn cầu.
"Người dùng đã dần trở nên ngày càng bức xúc về vấn đề này," ông cho biết. "Luồng ý kiến dư luận giờ đây đã thay đổi một cách rõ rệt, vì vậy các công ty này cuối cùng cũng phải đối mặt với những vấn đề cốt lõi."
Generative AI (AI tạo sinh) có khả năng sản xuất ra các hình ảnh, âm thanh và video ngày càng chân thực, nhưng chỉ một phần trong số đó mới bị xếp loại là "rác" (slop). Các công ty công nghệ phần lớn đang nhắm mục tiêu vào các loại nội dung câu view (clickbait) rẻ tiền, dễ tạo ra, dễ lan truyền, dễ tiêu thụ và cũng dễ bị lãng quên - giống như cách thời trang ăn liền (fast fashion) lấn át thời trang cao cấp (couture), hay thịt xay công nghiệp (pink slime) thay thế món bít tết hảo hạng.
Nếu không được kiểm soát, "vũng lầy" nội dung tổng hợp trên mạng có thể "chèn ép sự sáng tạo của con người, ăn mòn các giá trị văn hóa và gây bất ổn cho các cuộc tranh luận công khai," các nhà nghiên cứu Châu Âu từng cảnh báo vào năm ngoái.
Từ "Slop" đã trở nên phổ biến đến mức nhà xuất bản từ điển Merriam-Webster đã chọn nó làm từ khóa của năm vào năm 2025. Deezer, một dịch vụ phát trực tuyến của Pháp, cho biết vào mùa xuân năm nay rằng gần một nửa số bản nhạc được tải lên hệ thống của họ mỗi ngày đều được tạo ra bằng AI, và nhiều bài trong số đó thậm chí chưa từng được người dùng nghe tới. AI cũng tạo ra hơn một phần ba lượng nội dung được tải lên nền tảng Apple Music.
Adam Mosseri, người đứng đầu Instagram, đã phát biểu vào cuối năm ngoái rằng sẽ sớm "thực tế hơn" khi truy xuất "nguồn gốc của các phương tiện truyền thông chân thực thay vì các phương tiện truyền thông giả mạo." Nhận xét của ông được đưa ra không lâu sau khi Meta, công ty mẹ của Instagram, tung ra một luồng video hoàn toàn bằng AI, thứ bị nhiều người chế giễu là một màn trình diễn của những "bãi rác" nội dung.
Kẻ tạo ra cũng là người "dọn rác"
Nhiều công ty công nghệ hiện đang cố gắng quản lý rác AI cũng chính là những kẻ đang dung túng cho chúng. Vào tháng 7, Meta cam kết sẽ hỗ trợ một hiệp ước của Châu Âu nhằm giúp nội dung do AI tạo ra dễ nhận biết hơn thông qua quá trình phát hiện, dán nhãn và gắn thẻ. Tuy nhiên, cũng trong tháng đó, công ty này lại phát hành một công cụ tạo hình ảnh tự động sử dụng các tài khoản Instagram công khai làm nguồn dữ liệu tham khảo cho công cụ. (Meta đã phải gỡ bỏ tính năng này chỉ sau ba ngày trước làn sóng phản đối dữ dội).
"Rác AI là một con dao hai lưỡi bởi lẽ rất nhiều nền tảng trong số này đã ghi nhận sự gia tăng về mức độ tương tác nhờ vào chúng," Paul Shovlin, một chuyên gia về AI tại Đại học Ohio cho biết. "Nhưng sau đó, mọi thứ đi đến một giới hạn mà nó trở thành một gánh nặng, bởi vì có quá nhiều thứ rác rưởi trôi nổi đến mức người dùng giờ đây rất khó để tìm thấy những nội dung chất lượng mà họ đang tìm kiếm."
Lấy Google làm ví dụ, hãng này đã dồn toàn lực vào AI khi liên kết mô hình Gemini của mình với các dịch vụ email, bản đồ, du lịch và tìm kiếm. Hơn 20% số lượng video ngắn ban đầu trên YouTube được đề xuất cho người dùng mới là rác do AI tạo ra, theo một cuộc thử nghiệm được thực hiện vào năm ngoái bởi Kapwing, một trình chỉnh sửa video trực tuyến được hỗ trợ bởi AI.
Theo ước tính của Kapwing, một trong những kênh rác phổ biến nhất trên YouTube đã kiếm được 4,25 triệu USD (khoảng 106.250.000.000 VNĐ) mỗi năm. (Kênh này sau đó đã bị đình chỉ khỏi chương trình kiếm tiền của YouTube). CEO của YouTube, Neal Mohan, đã viết trong một bài đăng trên blog rằng "quản lý rác AI" là ưu tiên hàng đầu của nền tảng trong năm nay.
Gần đây, các nhà nghiên cứu tại Google đã bắt tay vào giải quyết thách thức này. Thay vì đánh giá từng video riêng lẻ, họ xem xét tốc độ tải lên, các mẫu biểu (templates) lặp đi lặp lại và các hành vi khác có thể báo hiệu một cuộc tấn công lạm dụng có tổ chức. Họ đã tìm thấy và xóa bỏ 50.000 cụm tài khoản có dấu hiệu vi phạm. Tuy nhiên, một số chuyên gia truyền thông kỹ thuật số lo ngại rằng phương pháp tiếp cận này có thể đi quá giới hạn và trừng phạt nhầm cả những nhà sáng tạo nội dung chân chính thường xuyên xuất bản khối lượng lớn nội dung.
"Mặc dù nghiên cứu học thuật giúp thúc đẩy sự hiểu biết của toàn ngành, nhưng nó không phản ánh đầy đủ nhiều lớp phòng thủ mà chúng tôi sử dụng để thực thi các chính sách của mình," đại diện YouTube cho biết trong một tuyên bố. "Hệ thống này bao gồm các biện pháp bảo vệ vững chắc nhằm đảm bảo rằng những nhà sáng tạo có thiện chí sử dụng công cụ AI sẽ không bị ảnh hưởng."
Những phương thức ứng phó đa dạng
Các công ty khác đang chuyển sang áp dụng hàng loạt chiến lược kết hợp để giải quyết "rác AI", bao gồm cả việc kêu gọi chính những người dùng quen thuộc của mình giúp sức xác định chúng. Vào tháng 10, Pinterest đã cập nhật hệ thống của mình để cho phép người dùng giới hạn số lượng bài đăng do AI tạo ra mà họ nhìn thấy. TikTok cho biết họ đang thử nghiệm một tính năng tại Mỹ, cho phép người dùng tùy chỉnh tăng giảm mức độ hiển thị của các nội dung AI. (Công ty cũng cho biết họ đã tự động dán nhãn cho hơn 3 tỷ video do AI tạo ra). Trong ba tháng đầu năm, TikTok đã gỡ bỏ hơn 377.000 video vì vi phạm các chính sách về AI của nền tảng này.
Theo Pangram, một công ty khởi nghiệp chuyên về phát hiện AI, trí tuệ nhân tạo đã được sử dụng để tạo ra gần một nửa số bài đăng có độ dài trên 50 từ trên nền tảng mạng xã hội X của Elon Musk. Nhằm đối phó với "một lượng khổng lồ rác AI và bình luận rác", nền tảng mạng xã hội này trong năm nay đã cấm các ứng dụng gián tiếp khuyến khích bot đăng bài thông qua hình thức trả tiền cho nội dung, Nikita Bier - người từng là Giám đốc Sản phẩm của X cho đến tháng này - chia sẻ.
Chris Best, CEO của Substack, đã viết vào tháng trước rằng "ngày càng khó để phân biệt đâu là thật trên internet," và rằng "những nền tảng trao thưởng cho sự giả dối sẽ tạo ra một cuộc đua xuống đáy." Nền tảng bản tin (newsletter) này đã công bố một công cụ phát hiện AI dành riêng cho người dùng, được cung cấp sức mạnh bởi Pangram. Công cụ này được thiết kế để quét các câu trả lời, bình luận và bài đăng dài hơn 100 từ, từ đó xác định xem chúng có khả năng được viết bởi con người hay có sự can thiệp của AI.
Tuy nhiên, một số cây bút viết bản tin đã phàn nàn rằng công cụ này nhầm lẫn các bài đăng do con người viết thành sản phẩm của AI. Họ cho rằng hệ thống đã không tính đến vai trò hỗ trợ tiềm năng của AI trong quá trình sáng tạo, đồng thời gây ra áp lực không đáng có, buộc các tác giả phải tự bảo vệ danh tiếng của mình trước một hệ thống đo lường thiếu minh bạch.
Mùa xuân năm nay, Camille François cùng với gần hai chục chuyên gia AI khác đã triệu tập một sự kiện mang tên Slop Salon tại Menlo Park, California, nơi họ đã cùng nhau thảo luận về những khó khăn trong việc phân loại và quản lý "rác AI".
"Mớ hỗn độn của các chiến thuật phòng chống là một triệu chứng cho thấy chúng ta đang phải đối mặt với một vấn đề mang tính hệ thống đối với môi trường thông tin, chứ không chỉ đơn thuần là một phân khúc nội dung tồi tệ mang tên 'rác' mà chúng ta có thể dễ dàng định nghĩa và xóa bỏ," François, người chuyên nghiên cứu các công nghệ kỹ thuật số độc hại tại Đại học Columbia, chia sẻ trong một cuộc phỏng vấn. "Suy cho cùng, AI là một công cụ sáng tạo và mang tính đa diện. Các nền tảng nếu xử lý vấn đề này một cách yếu kém sẽ phải chứng kiến cảnh người dùng quay lưng và chuyển sang những nơi khác."
