Anthropic hé lộ agent AI tự phát hiện ra rào cản lớn nhất: Mã CAPTCHA

Trong báo cáo mới nhất về hành vi rủi ro của agent AI, Anthropic đã chia sẻ một phát hiện bất ngờ: mô hình AI thử nghiệm mang tên Mythos 5 gặp cực kỳ nhiều khó khăn khi phải giải các mã CAPTCHA trên internet, dù nó có thể thực hiện các thao tác tấn công mạng phức tạp.

Trong buổi thử nghiệm năng lực bảo mật, agent AI này được giao nhiệm vụ xâm nhập hệ thống thử nghiệm và phát tán gói mã độc lên kho lưu trữ Python PyPI. Tuy nhiên, rào cản lớn nhất khiến hệ thống mất hàng trăm trang suy luận trong tài liệu ghi nhật ký dài 1.022 trang chính là việc xác minh tài khoản qua hệ thống CAPTCHA của Fastly và hCaptcha.

Mặc dù AI dễ dàng viết mã khai thác lỗ hổng, nó lại liên tục thất bại và loay hoay trước các câu đố phân biệt hình ảnh như nhận diện con vật khác biệt hoặc nhập ký tự từ ảnh. Chuyên gia dữ liệu Colin Fraser chỉ ra rằng các cơ chế bảo vệ chống bot hiện tại vẫn tạo ra rào cản kỹ thuật đáng kể đối với các hệ thống AI tự chủ.

Phát hiện này mang lại góc nhìn quan trọng cho cộng đồng an ninh mạng Việt Nam. Việc kết hợp các lớp xác thực CAPTCHA thông minh và giám sát chuỗi hành vi sẽ là giải pháp hữu hiệu để bảo vệ hệ thống trước các nguy cơ tấn công từ agent AI tự phát trong tương lai.

Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account