Việc đào tạo AI trên sách có bản quyền có hợp pháp? Tòa án đưa ra lời giải phức tạp

Những mô hình LLM hiện nay, bao gồm ChatGPT, Gemini và Claude, được huấn luyện trên một kho dữ liệu khổng lồ gồm sách, bài viết và tài liệu học thuật. Nhiều tác giả đã không được thông báo hay đồng ý khi tác phẩm của họ được dùng để đào tạo, tạo ra lo ngại về vi phạm bản quyền. Cô luật sư Cathy Gellis cho biết, “vấn đề này rất phức tạp và cảm xúc của mọi người rất mạnh mẽ”.

Vào năm ngoái, Thẩm phán William Alsup đã ra phán quyết buộc Anthropic trả 1,5 tỷ USD cho nhóm nhà văn, nhưng đồng thời khẳng định việc đào tạo AI của công ty là hợp pháp vì các cuốn sách được lấy từ các thư viện bóng tối bất hợp pháp. Thẩm phán nhấn mạnh rằng việc “đọc” một tác phẩm để học không giống “sao chép” tác phẩm.

Gellis cho rằng phán quyết này thực tế có lợi cho các công ty AI, vì khoản phạt lớn so với doanh thu dự kiến 200 tỷ USD vào năm 2028. Cô giải thích rằng luật bản quyền hiện tại, được soạn thảo năm 1976, chưa có quy định rõ ràng về việc sử dụng dữ liệu cho đào tạo mô hình, khiến các tòa án phải dựa vào nguyên tắc “fair use” để quyết định.

  • Yếu tố “fair use” bao gồm mục đích sử dụng, tính chất của tác phẩm, lượng nội dung được dùng và ảnh hưởng tới thị trường.
  • Nhiều chuyên gia cho rằng nếu mục đích là tạo ra mô hình mới, chứ không phải sao chép nguyên bản, thì có thể được coi là sử dụng hợp pháp.

Đối với cộng đồng AI Việt Nam, vụ án này là lời cảnh tỉnh: cần xây dựng khung pháp lý cập nhật, đồng thời thúc đẩy các nhà phát triển AI tuân thủ quyền sở hữu trí tuệ để bảo vệ cả người sáng tạo và người dùng cuối.

Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account