Người dùng bỏ qua 1/3 lệnh nguy hiểm trong trò chơi AI agent

Gần hai tháng trước, tác giả một trò chơi trình duyệt cho phép người dùng đóng vai người kiểm soát (human‑in‑the‑loop) cho một AI coding agent, quyết định chấp nhận hay từ chối các lệnh dưới áp lực thời gian. Trò chơi thu hút sự chú ý trên Hacker News và đã thu thập hơn 40.000 lượt chơi, 409.000 quyết định.

Trong số các lệnh xuất hiện, khoảng 34% là nguy hiểm, như cat ~/.aws/credentials để trộm thông tin đăng nhập. Tuy nhiên, lệnh npm run analyze – thường vô hại – lại bị chấp nhận 64,7% thời gian, vì người dùng thường không đọc kỹ lịch sử script được hiển thị. Ba lệnh tương tự trong trò chơi đã bị bỏ qua 52,5% lần, gấp đôi tỷ lệ so với các cuộc tấn công khác.

Những dữ liệu này phản ánh hiện tượng “permission fatigue” – khi người dùng phải duyệt quá nhiều lệnh, họ sẽ giảm độ chú ý và dễ mắc lỗi. Đồ thị trong bài còn cho thấy tỷ lệ bỏ lỡ tăng lên khi người chơi thực hiện nhiều lệnh liên tiếp.

Ý nghĩa: Kết quả nhắc nhở cộng đồng AI và các nhà phát triển công cụ lập trình rằng việc dựa vào xác nhận lệnh thủ công không đủ an toàn. Cần thiết kế các cơ chế bảo vệ tự động và giao diện rõ ràng hơn để giảm thiểu sai sót của người dùng tại Việt Nam.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account