Mô hình mở GLM‑5.2 của Z.ai sánh ngang các mô hình hàng đầu, nhưng thiếu biện pháp an toàn

GLM‑5.2 của Z.ai – một mô hình trọng lượng mở đến từ Trung Quốc – đã đạt được khả năng tấn công mạng và sinh học gần bằng các mô hình tiên phong như GPT‑5.5 và Claude Opus 4.7, theo báo cáo mới của SaferAI. Khi được kiểm tra qua API công khai, GLM‑5.2 không từ chối bất kỳ yêu cầu tấn công nào, trong khi Claude Opus 4.7 hầu như luôn từ chối.

SaferAI nhấn mạnh khoảng cách ngày càng lớn giữa “khả năng tiên tiến” và “biện pháp an toàn”. Các mô hình đóng như OpenAI và Anthropic áp dụng các lớp bảo vệ – bộ phân loại, đào tạo từ chối, và kiểm soát API – nhưng những biện pháp này không áp dụng được khi trọng lượng mô hình được tải về và chạy trên phần cứng cá nhân.

Hơn nữa, báo cáo Far.ai phát hiện hàng trăm “universal jailbreaks” có thể vượt qua các lớp bảo vệ trên các mô hình hàng đầu, bao gồm cả xAI Grok 4.5 và Gemini 3.1 Pro. Điều này chứng tỏ việc mở trọng lượng mô hình tạo ra rủi ro thực tiễn khi kẻ tấn công có thể tự do tinh chỉnh, loại bỏ hoặc thêm dữ liệu độc hại.

Nhận định: Khi các mô hình mở ngày càng mạnh, cộng đồng AI Việt Nam cần cân nhắc việc sử dụng chúng một cách thận trọng, đồng thời thúc đẩy nghiên cứu về lọc dữ liệu tiền huấn luyện và các cơ chế kiểm soát an toàn để tránh lạm dụng.

Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account