
Anthropic vừa công bố một bài viết trên blog nhằm giải đáp các câu hỏi cơ bản về cách công ty sẽ đánh dấu watermark cho văn bản do chatbot Claude tạo ra. Động thái này được thực hiện để tuân thủ Mã minh bạch của Đạo luật AI EU, yêu cầu các công ty AI phải sử dụng các hệ thống giúp xác định nội dung do AI tạo ra.
Bài viết giải thích rằng khi thực hiện “các lựa chọn低stakes” — chẳng hạn như chọn giữa từ “overcast” và “grey” để mô tả thời tiết — Claude có thể tạo ra một mẫu trong các câu trả lời “không thể phát hiện được bởi người đọc, nhưng có thể được bất kỳ ai có khóa mã hóa phát hiện.” Anthropic xác nhận sẽ sử dụng phương pháp SynthID-Text do nhóm Google DeepMind công bố năm 2024 và có kế hoạch phát hành API phát hiện watermark. Công ty cũng nhấn mạnh watermark không ảnh hưởng đến chất lượng đầu ra của Claude.
Một điểm quan trọng là khả năng chỉnh sửa để ẩn watermark: “việc chỉnh sửa nhẹ có thể sẽ không xóa watermark hoàn toàn”, trong khi “một lần viết lại hoàn toàn trong đó mọi từ都被替换” sẽ loại bỏ được watermark. Đối với code, watermark sẽ ít hơn vì model cần tạo code hoạt động và không có sự tự do lựa chọn giữa nhiều tùy chọn hợp lệ tương đương. Anthropic cũng lưu ý rằng Claude không phải là chatbot AI duy nhất sẽ tạo ra văn bản có watermark, vì “các nhà phát triển model lớn khác đã ký cùng một Bộ Quy tắc và sẽ triển khai watermark riêng của họ.”
Sự phát triển này có ý nghĩa quan trọng với cộng đồng AI và người dùng Việt Nam. Nó cho thấy xu hướng minh bạch hóa nội dung AI đang trở thành tiêu chuẩn bắt buộc, đặc biệt với các khung pháp luật như EU AI Act. Đối với người dùng Claude tại Việt Nam, watermark là một công cụ tiềm năng để xác minh nguồn gốc nội dung, hỗ trợ tính trung thực trong học tập và công việc, đồng thời đặt ra câu hỏi về quyền riêng tư và tự do biểu đạt khi sử dụng AI.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com