
Làn sóng lo ngại về an toàn AI lại bùng lên gay gắt sau khi Jacob Coxon, nhà nghiên cứu từng huấn luyện các mô hình AI tại OpenAI và Anthropic, quyết định từ chức. Ông cáo buộc hai công ty hàng đầu này đang tham gia vào một cuộc đua nguy hiểm hướng tới siêu trí tuệ tự cải tiến (self-improving superintelligence) mà phớt lờ các rủi ro an toàn cốt lõi.
Ngay sau đó, Evan Hubinger, trưởng nhóm an toàn AI tại Anthropic, cũng thừa nhận những lo ngại này là có cơ sở. Hubinger tiết lộ khả năng AI có thể tiêu diệt toàn bộ loài người trong vòng 10 năm tới là lớn hơn 10%, đồng thời thừa nhận Anthropic hiện chưa có kế hoạch cụ thể cũng như chưa đi đúng lộ trình để đảm bảo các hệ thống AI nâng cao luôn an toàn và đồng nhất với giá trị con người.
Cuộc đua phát triển các hệ thống siêu thông minh diễn ra trong bối cảnh các công ty AI chịu áp lực thương mại lớn trước các kế hoạch IPO sắp tới. Sự vội vã này làm dấy lên nghi ngại rằng lợi nhuận đang được ưu tiên hơn việc kiểm soát các rủi ro thảm họa từ mô hình AI tự học.
Sự việc này là hồi chuông cảnh báo quan trọng cho cộng đồng công nghệ và người dùng AI tại Việt Nam. Việc hiểu rõ rủi ro từ các mô hình frontier model không chỉ giúp doanh nghiệp thận trọng hơn khi triển khai agent tự động mà còn thúc đẩy việc xây dựng các tiêu chuẩn an toàn AI thiết thực trong tương lai.
Nguồn: The Verge — Biên dịch & tổng hợp: danhbaai.com