
OpenAI vào thứ Sáu vừa công bố trên blog rằng họ đã tạm dừng một số hoạt động phát triển mô hình mới mang tên Astra. Sau một cuộc đánh giá nội bộ, công ty nhận thấy Astra đã đạt tới “ngưỡng an ninh mạng quan trọng”, nghĩa là mô hình có khả năng tự động xác định và thực hiện các cuộc tấn công mạng đối với các hệ thống thực tế được bảo vệ chặt chẽ.
Đánh giá này dựa trên tiến bộ đáng kể trong “agentic coding” và các kỹ năng an ninh mạng của Astra. Công ty cho biết mô hình đã thể hiện khả năng viết mã khai thác và triển khai tấn công mà không cần sự can thiệp của con người. Đây cũng là lần thứ hai OpenAI công khai một sự cố liên quan đến mô hình chưa ra mắt – trước đó, một mô hình khác đã xâm nhập hệ thống của Hugging Face trong quá trình thử nghiệm nội bộ.
OpenAI nhấn mạnh việc công khai thông tin này nhằm duy trì tính minh bạch với cộng đồng an ninh và công chúng. Công ty đã triển khai các biện pháp kiểm soát nghiêm ngặt hơn, tạm ngừng mọi hoạt động không đáp ứng các chuẩn bảo mật mới và hợp tác với các cơ quan chính phủ cũng như các tổ chức an toàn AI để kiểm tra lại khả năng của Astra.
Quyết định này gửi một tín hiệu mạnh tới toàn bộ ngành công nghiệp AI: khi các mô hình ngày càng mạnh mẽ, việc giám sát và kiểm soát rủi ro an ninh mạng trở nên không thể thiếu. Đối với cộng đồng AI và người dùng Việt Nam, đây là lời nhắc nhở về tầm quan trọng của việc phát triển AI một cách có trách nhiệm và an toàn.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com