
Anthropic gần đây công bố kế hoạch áp dụng watermark cho mọi nội dung sinh ra bởi mô hình Claude, bao gồm cả văn bản, để đáp ứng quy định AI của Liên Xô châu Âu. Mục tiêu là tạo ra một dấu ấn kỹ thuật số không thể nhìn thấy được nhưng vẫn có thể phát hiện sau này.
Thay vì dùng ký tự ẩn như nhiều dự đoán ban đầu, Anthropic sẽ dùng kỹ thuật steganography, trong đó lựa chọn từ hoặc token trong quá trình sinh text sẽ tạo ra dấu vân tay có thể được phát hiện bằng thuật toán probabilístico. Khi một mô hình Claude sinh ra câu trả lời, hệ thống sẽ chèn những dấu vân tay này vào từ ngữ, giúp xác định nguồn gốc của nội dung mà không làm thay đổi ý nghĩa hay chất lượng.
Đây không phải là lần đầu tiên các nhà phát triển AI áp dụng các biện pháp phát hiện nội dung sinh成 tự động. Các nghiên cứu trước đó đã đề cập tới các phương pháp chèn dấu ẩn trong văn bản, nhưng Anthropic là người đầu tiên công bố chi tiết cụ thể về cách thực hiện. Các chuyên gia cho rằng việc áp dụng watermark có thể giúp tăng tính minh bạch trong việc phân biệt nội dung do AI tạo ra và nội dung do con người viết.
Việc áp dụng watermark này có thể tạo ra một tiêu chuẩn mới cho việc quản lý nội dung AI trong cộng đồng Việt Nam, giúp người dùng dễ dàng nhận biết những bài viết hoặc thông tin mà nguồn gốc là máy móc, từ đó có thể đánh giá tính tin cậy một cách chính xác hơn.
Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com