AI watermark trong văn bản: Google và Claude dùng “dice‑roll” để nhúng dấu vết vô hình

Google và Anthropic đã công bố tính năng watermark cho văn bản do các mô hình Gemini và Claude tạo ra. Dù văn bản không có pixel hay metadata, dấu vết vẫn tồn tại khi người dùng copy‑paste, vì nó ẩn trong các lựa chọn từ ngữ của mô hình.

Cơ chế hoạt động dựa trên một “dice‑roll” có trọng số: khi mô hình dự đoán từ tiếp theo, nó có một danh sách ngắn các từ khả thi. Một khóa bí mật sẽ tô màu xanh (green) hoặc đỏ (red) cho mỗi từ trong danh sách, sau đó nghiêng nhẹ xác suất chọn các từ xanh. Nghiêng này rất nhẹ, nên câu vẫn đọc bình thường, nhưng khi đếm tần suất các từ xanh trong toàn bộ đoạn, tỉ lệ sẽ cao hơn 50% nếu có watermark.

Phát hiện watermark không cần phân tích nội dung hay phong cách viết. Trình phát hiện chỉ tái tạo lại quá trình tô màu bằng cùng khóa, sau đó đếm số từ xanh. Nếu tỉ lệ xanh vượt ngưỡng (ví dụ 55% trên tài liệu 1.500 từ), văn bản được xác định có dấu vết. Đánh dấu sẽ mất nếu người dùng chỉnh sửa hoặc cắt bỏ các chuỗi từ, vì mỗi từ phụ thuộc vào ngữ cảnh ngắn trước đó.

Việc đưa watermark vào văn bản giúp ngăn ngừa lạm dụng nội dung AI và tăng độ tin cậy cho các ứng dụng tại Việt Nam. Các nhà phát triển và doanh nghiệp trong nước có thể áp dụng công nghệ này để bảo vệ bản quyền và xác thực nguồn gốc nội dung AI.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account