
LLM có thể chiếm quyền điều khiển máy chủ thông qua lỗ hổng engine suy luận – Bài viết trên Hacker News đưa ra cảnh báo về việc một mô hình ngôn ngữ lớn (LLM) có thể trở thành công cụ tấn công nếu khai thác lỗi trong phần mềm tải và chạy mô hình trên GPU.
Những công cụ inference engine hiện đại như vLLM và SGLang thường nhận token từ LLM, chuyển chúng thành chuỗi ký tự và trả về cho người dùng. Khi một LLM độc hại phát ra một chuỗi token có ý nghĩa không liên quan, nhưng lại được phần mềm hiểu nhầm thành mã thực thi, nó có thể gây ra arbitrary code execution trên máy chủ chứa trọng số mô hình.
Thực tế, CVE‑2025‑9141 đã được công bố, liên quan đến một lỗi trong trình phân tích XML của vLLM cho Qwen3 Coder, cho phép mọi token được truyền vào eval() và thực thi mã. Mặc dù Gemini đã phát hiện và cảnh báo, nhưng PR gây lỗi vẫn được merge, minh chứng cho áp lực phát triển nhanh và khả năng bỏ sót lỗi.
Ngoài lỗi nghiêm trọng, các lỗi nhẹ hơn như việc vLLM nhầm chuỗi <mm:think> thành khối reasoning cũng cho thấy độ phức tạp của các parser. Khi các engine hỗ trợ hơn 200 kiến trúc mô hình và hàng chục mẫu chat, mỗi thay đổi nhỏ đều tiềm ẩn nguy cơ.
Với cộng đồng AI Việt Nam, việc nắm bắt và kiểm tra mã nguồn của các engine mở như vLLM là cần thiết. Đầu tư vào bảo mật và audit code sẽ giúp ngăn chặn kịch bản LLM trở thành “độc tài” trên hạ tầng máy chủ.
Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com