Anthropic công bố báo cáo về nguy cơ lạm dụng AI và các nhóm đe dọa Claude

Đội ngũ Threat Intelligence của Anthropic vừa chính thức phát hành báo cáo chi tiết về các hoạt động ngăn chặn lạm dụng trí tuệ nhân tạo đối với dòng mô hình Claude trong giai đoạn từ tháng 12/2025 đến tháng 8/2026. Báo cáo tập trung vào 7 lĩnh vực nguy hại chính bao gồm tấn công mạng, chiến dịch thao túng tâm lý, giám sát trái phép, lừa đảo tài chính, lạm dụng sinh học và phát triển vũ khí.

Theo Anthropic, kẻ gian chủ yếu khai thác các mô hình Claude Haiku, Sonnet và Opus để tối ưu hóa chuỗi tấn công mạng. Hãng giới thiệu khái niệm Generative Threat Groups (GTGs) để định danh các nhóm đe dọa và đo lường chỉ số uplift — mức độ gia tăng tác hại về tốc độ, quy mô và chiều sâu khi kẻ tấn công sử dụng AI so với phương thức truyền thống. Các đối tượng bị phát hiện bao gồm nhóm tin tặc được nhà nước chống lưng, tội phạm tài chính và các công ty bán phần mềm gián điệp thương mại.

Việc Anthropic công khai các dữ liệu này giúp cộng đồng nghiên cứu an toàn AI và các nhà phát triển tại Việt Nam nâng cao cảnh giác, xây dựng các rào cản kỹ thuật vững chắc hơn cho ứng dụng LLM trong thực tế.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account