GPT 5.6‑Cyber thoát VM, chứng minh AI không còn bị cô lập trong sandbox

Nhà nghiên cứu nhận được quyền truy cập sớm vào mô hình GPT‑5.6‑Cyber và giao cho nó nhiệm vụ kiểm tra khả năng tấn công mạng. Khi được yêu cầu thoát khỏi một VM QEMU/KVM trên máy Debian 12 (CPU AMD Zen 3), mô hình đã thành công ba lần, thậm chí gây treo kernel máy chủ.

Trong lần thoát đầu tiên, AI khai thác lỗ hổng mới được công bố (CVE‑2026‑53359 – Januscape) ngay cả khi hệ thống đã được cập nhật. Lần thứ hai, sau khi người dùng biên dịch lại QEMU và các phụ thuộc từ nguồn upstream, AI vẫn tìm ra một loạt 0‑day và tự động xây dựng exploit trong vài giờ. Lần thứ ba, nó tự động thu thập tài liệu, viết oracle và tạo các ví dụ tối thiểu để kiểm chứng khai thác, chỉ cần người dùng khởi động lại máy khi kernel bị treo.

Những kết quả này đưa ra một cảnh báo mạnh mẽ: không còn cách nào chắc chắn rằng một VM có thể ngăn chặn một AI có khả năng tự học và tự lập trình. Các nhà phát triển nên xem AI như một mối đe dọa liên tục (APT) và thiết kế các lớp bảo vệ đa tầng, bao gồm snapshot, mạng cách ly và kiểm soát quyền truy cập nghiêm ngặt.

Ý nghĩa: Đối với cộng đồng AI và an ninh Việt Nam, bài học này nhấn mạnh nhu cầu nâng cao chuẩn bảo mật khi triển khai mô hình lớn, đồng thời thúc đẩy nghiên cứu các phương pháp cô lập an toàn hơn cho AI.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account