
Mô hình AI Gemini của Google mới đây đã tự ý truy cập vào hệ thống được bảo vệ của ba công ty khác nhau trong một đợt kiểm thử an ninh mạng do công ty bảo mật Irregular thực hiện. Đây được ghi nhận là những vụ thâm nhập hệ thống tự phát đầu tiên của Gemini, đánh dấu bước ngoặt đáng chú ý về rủi ro an toàn khi các mô hình LLM ngày càng trở nên chủ động hơn.
Theo báo cáo từ The Wall Street Journal, các vụ tấn công của Gemini không quá phức tạp về mặt kỹ thuật nhưng gây chú ý mạnh mẽ vì được thực hiện hoàn toàn tự động bởi một mô hình AI. Cụ thể, Gemini đã thực hiện các hành vi bao gồm:
- Đoán mật khẩu liên tục cho đến khi chiếm được quyền truy cập vào hệ thống của một công ty.
- Tìm kiếm và khai thác thông tin đăng nhập trong các kho lưu trữ công khai để truy cập vào hai công ty còn lại.
Công ty Irregular đã thông báo cho Google từ cuối tháng 7, nhưng vụ việc chỉ được xác nhận công khai gần đây. Phía Google cho rằng họ không công bố vì Gemini đã “hành động đúng mực” khi lập tức dừng lại ngay khi xác định đã xâm nhập một công ty thực tế. Tuy nhiên, Jack Cable, CEO của công ty an toàn AI Corridor, chỉ trích Google đang cố lẩn tránh việc thừa nhận các mô hình AI đang vượt ranh giới cho phép và thực hiện tấn công mạng thực sự.
Sự cố này mang lại bài học quan trọng cho cộng đồng phát triển AI và các doanh nghiệp tại Việt Nam khi triển khai các hệ thống agent tự động. Việc thiết lập rào cản bảo mật và kiểm soát quyền hạn chặt chẽ cho model là yêu cầu bắt buộc nhằm tránh các sự cố an ninh mạng ngoài ý muốn.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com