Dấu nước AI trong văn bản vẫn dễ bị xóa – Thách thức cho EU AI Act

Luật AI của Liên minh Châu Âu (EU AI Act) dự kiến có hiệu lực từ tháng 8/2026 và đưa ra yêu cầu mới: mọi nội dung do LLM tạo ra phải có dấu “watermark” để có thể nhận dạng là do AI sinh ra. Đây là một bước quan trọng nhằm bảo vệ người tiêu dùng và ngăn chặn lạm dụng công nghệ.

Tuy nhiên, việc gắn watermark vào văn bản gặp nhiều rào cản. Khác với hình ảnh, văn bản là một phương tiện nén cao; bất kỳ thay đổi nào đều dễ bị người đọc nhận ra. Các phương pháp như chèn ký tự Unicode đặc biệt hay điều chỉnh tần suất xuất hiện của một số ký tự có thể làm giảm chất lượng và gây lỗi chính tả.

Google đã triển khai SynthID cho hình ảnh, nhưng chưa có giải pháp chuẩn cho văn bản. Một số nhà nghiên cứu đề xuất sử dụng mô hình dự đoán token để kiểm tra tính đồng nhất, nhưng cách này tốn kém và dễ tạo ra kết quả dương tính giả.

Đối với cộng đồng AI Việt Nam, việc theo dõi và đóng góp vào các tiêu chuẩn watermark sẽ giúp các công ty nội địa chuẩn bị tốt hơn cho thị trường EU, đồng thời thúc đẩy nghiên cứu về steganography trong ngôn ngữ tự nhiên.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account