AI nguồn mở và bài toán làm chủ công nghệ, dữ liệu của doanh nghiệp Việt
Khi AI tạo sinh ngày càng được đưa vào hoạt động sản xuất, kinh doanh, câu chuyện bản quyền không còn dừng ở phần mềm mà mở rộng sang dữ liệu huấn luyện, mô hình và sản phẩm do AI tạo ra. Với doanh nghiệp Việt Nam, lựa chọn các công nghệ AI có tính mở đang được đặt trong bài toán lớn hơn: làm chủ công nghệ, kiểm soát dữ liệu và tuân thủ pháp luật.
Trong khuôn khổ Hội thảo "Linux và Phần mềm nguồn mở - Hướng đi giúp doanh nghiệp Việt Nam tuân thủ pháp luật về bản quyền với chi phí hợp lý", ông Lê Trung Nghĩa, Viện Nghiên cứu, Đào tạo và Phát triển Tài nguyên Giáo dục Mở (InOER) thuộc Hiệp hội các trường Đại học, Cao đẳng Việt Nam đã trình bày bài tham luận quan trọng về chủ đề "AI Nguồn Mở và mối quan hệ giữa AI tạo sinh và Sở hữu trí tuệ".
Nội dung tham luận đem đến góc nhìn toàn diện về thực trạng pháp lý, định nghĩa chuẩn hóa cũng như tiềm năng của AI Nguồn Mở đối với sự phát triển bền vững của doanh nghiệp Việt.
Áp lực tuân thủ pháp lý và thực trạng bản quyền

Ông Lê Trung Nghĩa trình bày tham luận AI Nguồn Mở và mối quan hệ giữa Al tạo sinh và sở hữu trí tuệ.
Theo ông Lê Trung Nghĩa, việc nghiên cứu, phát triển và ứng dụng AI tại Việt Nam đang đứng trước yêu cầu ngày càng cao về tuân thủ pháp luật. Luật Trí tuệ nhân tạo số 134/2005/QH15 (có hiệu lực từ ngày 01/03/2026) xác lập nhiều nguyên tắc trong phát triển và sử dụng AI. Các nguyên tắc này đặt con người làm trung tâm, đòi hỏi tính minh bạch, bảo đảm an toàn hệ thống, an ninh dữ liệu và phát triển AI xanh, bền vững.
Dẫn chứng từ nghiên cứu của tổ chức Open Praxis, ông Nghĩa chỉ ra rằng AI mang lại 15 tác động tích cực như nâng cao hiệu suất và thúc đẩy đổi mới sáng tạo, nhưng đồng thời cũng tiềm ẩn tới 20 rủi ro tiêu cực liên quan đến quyền riêng tư, thiên vị dữ liệu và nguy cơ mất an toàn thông tin.
Đặc biệt, vấn đề tuân thủ bản quyền phần mềm và sở hữu trí tuệ đang đặt ra những thách thức lớn đối với cộng đồng doanh nghiệp. Điều 225 Bộ luật Hình sự 2015 quy định mức phạt cao nhất đối với cá nhân vi phạm bản quyền lên đến 3 năm tù, trong khi doanh nghiệp có thể bị phạt tới 3 tỷ đồng hoặc đình chỉ hoạt động có thời hạn. Cùng với đó, Công điện số 38/CĐ-TTg ngày 05/05/2026 của Thủ tướng Chính phủ cũng yêu cầu tập trung chỉ đạo xử lý quyết liệt các hành vi xâm phạm quyền sở hữu trí tuệ.
Trong bối cảnh khảo sát của Revenera năm 2026 vẫn xếp Việt Nam nằm trong nhóm 10 quốc gia sử dụng phần mềm lậu nhiều nhất thế giới, việc chuyển dịch sang ứng dụng và phát triển AI Nguồn Mở được đánh giá là giải pháp bắt buộc và tối ưu chi phí.
Thế nào mới là AI nguồn mở?
Một điểm được ông Lê Trung Nghĩa nhấn mạnh là không nên đánh đồng AI Nguồn Mở với những mô hình chỉ công khai mã nguồn hoặc trọng số.

Ông Lê Trung Nghĩa nhấn mạnh là không nên đánh đồng AI Nguồn Mở với những mô hình chỉ công khai mã nguồn hoặc trọng số.
Theo Định nghĩa AI nguồn mở của Tổ chức Khởi xướng Nguồn Mở (OSI) và Khung Tính mở Mô hình (MOF) của Linux Foundation, một hệ thống AI Nguồn Mở chuẩn mực phải đảm bảo cho người dùng 4 quyền tự do cơ bản: Sử dụng, Nghiên cứu, Sửa đổi và Chia sẻ.
Tuy nhiên, điểm khác biệt cốt lõi giữa AI Nguồn Mở và phần mềm nguồn mở truyền thống nằm ở chỗ AI bao gồm cả ba thành phần chính: mã nguồn, dữ liệu và tài liệu. Để đáp ứng định nghĩa nguồn mở, ngoại trừ kết quả đầu ra nằm trong phạm vi công cộng, tất cả các yếu tố từ tham số mô hình, tập dữ liệu đào tạo đến mã nguồn xử lý và báo cáo kỹ thuật đều phải được cấp phép mở phù hợp như CDLA-Permissive-2.0, CC BY 4.0 hoặc các giấy phép do OSI phê chuẩn.
Ông Nghĩa cũng lưu ý về tình trạng thiếu minh bạch dữ liệu ở nhiều hệ thống AI hiện nay. Dựa trên Chỉ số Minh bạch Dữ liệu AI (AIDTI) của Viện Dữ liệu Mở (ODI), đại đa số các hệ thống AI trên thị trường, kể cả những mô hình nổi tiếng như DeepSeek của Trung Quốc, dù mở mã nguồn phần mềm nhưng lại giữ kín dữ liệu đào tạo.
Việc thiếu minh bạch về dữ liệu đầu vào không chỉ mang lại rủi ro về định kiến mà còn tiềm ẩn nguy cơ vi phạm bản quyền nghiêm trọng. Vì vậy, việc khai thác các bộ dữ liệu huấn luyện mở được quản lý minh bạch bởi cộng đồng như Common Crawl, Starcoder Data, Red Pajama hay ROOTS là điều rất cần thiết.
AI Nguồn Mở hay AI Nguồn Đóng: Lựa chọn mang tính tự chủ
Từ câu chuyện minh bạch dữ liệu, một vấn đề khác cũng được đặt ra với doanh nghiệp là nên lựa chọn AI nguồn mở hay tiếp tục sử dụng các nền tảng AI nguồn đóng. Đây không chỉ là lựa chọn về công nghệ, mà còn liên quan trực tiếp đến khả năng kiểm soát dữ liệu, mức độ phụ thuộc vào nhà cung cấp và chi phí vận hành.
So sánh giữa AI Nguồn Mở và AI Nguồn Đóng, ông Lê Trung Nghĩa cho rằng hai mô hình có những khác biệt đáng chú ý về khả năng kiểm soát và chi phí. Các mô hình nguồn đóng như GPT-4o, Claude 3.5 hay Gemini có lợi thế dẫn đầu ở các bài kiểm tra hiệu năng nhưng lại vận hành theo cơ chế "hộp đen", tính phí theo lượt truy cập API và khiến người dùng phụ thuộc hoàn toàn vào nhà cung cấp. Trái lại, các mô hình nguồn mở hoặc trọng số mở như LLaMA 4, Google Gemma 4, Qwen 3.5 hay Mistral mang đến khả năng can thiệp sâu, tự do tùy chỉnh, bảo mật thông qua sự kiểm toán của cộng đồng và không tốn chi phí bản quyền mô hình.
Trích dẫn báo cáo khuyến nghị từ Nhà Trắng (Mỹ), ông Nghĩa khẳng định các mô hình AI Nguồn Mở có vai trò then chốt trong việc thúc đẩy đổi mới sáng tạo cho các doanh nghiệp khởi nghiệp. Đặc biệt, đây là lựa chọn duy nhất đảm bảo tính tự chủ và an toàn thông tin cho các cơ quan chính phủ cũng như các doanh nghiệp sở hữu dữ liệu nhạy cảm - những đơn vị không thể gửi dữ liệu nội bộ ra các hệ thống AI nguồn đóng bên ngoài.
Một nội dung đáng chú ý trong tham luận là mối quan hệ giữa AI tạo sinh và Luật Sở hữu trí tuệ. Ông Nghĩa cho biết, căn cứ theo hướng dẫn của Văn phòng Bản quyền Hoa Kỳ và Điều 43 Luật Sở hữu trí tuệ 2025 của Việt Nam, sản phẩm đầu ra do AI tạo sinh hoàn toàn không đủ điều kiện để được bảo hộ bản quyền. AI không được công nhận là tác giả hay đồng tác giả, và các nội dung do AI tạo ra đương nhiên thuộc về phạm vi công cộng, được coi là Tài nguyên Giáo dục Mở (OER) theo chuẩn của UNESCO.
Ngược lại, các câu lệnh hay lời nhắc (prompts) tinh xảo do con người đầu tư trí tuệ sáng tạo ra để điều khiển AI lại được pháp luật bảo hộ bản quyền. Tác giả các lời nhắc này được khuyến khích áp dụng giấy phép mở để chia sẻ cộng đồng cùng khai thác và phát triển.
Theo ông Lê Trung Nghĩa, phát triển và sử dụng AI nguồn mở có thể tạo thêm điều kiện để Việt Nam chủ động hơn trong tiếp cận, nghiên cứu và làm chủ công nghệ, đồng thời tăng khả năng kiểm soát dữ liệu và giảm sự phụ thuộc vào các nền tảng bên ngoài. Với doanh nghiệp, đây cũng là một hướng để chủ động hơn trước những vấn đề về bản quyền và sở hữu trí tuệ.
Trong khi công nghệ AI vẫn đang phát triển rất nhanh, còn nhiều quy định pháp lý trên thế giới tiếp tục được hoàn thiện, việc nắm rõ các nguyên tắc nguồn mở, giấy phép sử dụng và nguồn gốc dữ liệu sẽ ngày càng cần thiết. Làm chủ AI, vì vậy, không chỉ là làm chủ một mô hình hay công cụ, mà còn phải làm chủ dữ liệu, công nghệ và những quyền đi kèm với chúng.
