
Anthropic vừa công bố chi tiết cách họ sẽ áp dụng watermark văn bản vô hình cho mô hình Claude, nhằm tuân thủ quy định minh bạch AI của Liên minh Châu Âu. Theo thông cáo, hệ thống này là “phiên bản của SynthID‑Text”, một công nghệ watermark nguồn mở được Google DeepMind phát triển, cho phép tạo ra các mẫu từ xác suất từ ngữ mà chỉ có khóa giải mã mới phát hiện được.
Nguyên tắc hoạt động dựa trên việc thay đổi nguồn ngẫu nhiên khi mô hình chọn từ tiếp theo. Khi một câu như “Thời tiết hôm nay rất…” được sinh ra, các từ có khả năng cao như “lạnh” hoặc “ẩm” sẽ được lựa chọn dựa trên một khóa đặc biệt, tạo ra một chuỗi mẫu không nhận thấy bởi người đọc nhưng có thể được công cụ kiểm tra phát hiện. Điều này cho phép các bên thứ ba xác định nội dung là do AI tạo ra mà không làm thay đổi nghĩa hay chất lượng văn bản.
Anthropic khẳng định tính năng này sẽ không làm tăng chi phí sử dụng Claude và không gây ảnh hưởng thực tế tới nội dung đầu ra. Ngoài Claude, Google Gemini đã tích hợp SynthID‑Text từ năm 2024, trong khi OpenAI chưa công bố kế hoạch tương tự cho ChatGPT, mặc dù cũng phải tuân thủ AI Act.
Đối với cộng đồng AI Việt Nam, việc hiểu và áp dụng công nghệ watermark mở sẽ giúp các doanh nghiệp và nhà phát triển đáp ứng yêu cầu pháp lý quốc tế, đồng thời tăng cường niềm tin của người dùng trong việc sử dụng nội dung AI.
Nguồn: The Verge — Biên dịch & tổng hợp: danhbaai.com