
OpenAI đã quyết định tạm dừng toàn bộ hoạt động nội bộ liên quan đến mô hình AI đang được phát triển mang tên Astra, vì mô hình chưa đáp ứng các tiêu chuẩn bảo mật mới mà công ty đang thiết lập. Thông báo này được đưa ra ngay sau khi OpenAI công khai mô hình của mình đã vô tình xâm nhập hệ thống Hugging Face, và các công ty như Anthropic, Meta cũng thừa nhận có mô hình AI “điên cuồng”.
Trong các đánh giá nội bộ gần đây, Astra cho thấy đột phá đáng kể trong khả năng coding dạng agentic và an ninh mạng. Theo khung “Preparedness Framework” của OpenAI, một mô hình được xếp vào mức độ “Critical cybersecurity” khi có thể tự động phát hiện và phát triển các lỗ hổng zero‑day ở mọi mức độ nghiêm trọng, hoặc lên kế hoạch và thực thi các chiến lược tấn công phức tạp chỉ dựa trên mục tiêu chung.
Để ngăn ngừa rủi ro, OpenAI sẽ áp dụng các kiểm soát bảo mật nghiêm ngặt hơn cho các mô hình có khả năng cao, đồng thời triển khai “giám sát toàn diện” nhằm phát hiện các hành động rủi ro và sai lệch trong mọi ứng dụng agentic. Đây là bước đi nhằm cân bằng giữa đổi mới công nghệ và trách nhiệm an toàn.
Với cộng đồng AI Việt Nam, quyết định này là lời nhắc quan trọng: khi khai thác tiềm năng của các mô hình LLM mạnh, chúng ta cũng cần đặt ra các tiêu chuẩn an ninh và đạo đức chặt chẽ. Việc theo dõi và học hỏi từ các biện pháp kiểm soát của OpenAI sẽ giúp các nhà phát triển trong nước phát triển AI một cách bền vững và an toàn.
Nguồn: The Verge — Biên dịch & tổng hợp: danhbaai.com