
Trong một bài luận gần đây, CEO Anthropic Dario Amodei đã đề xuất đưa các bên đánh giá độc lập như METR và Redwood Research vào sâu bên trong các công ty AI. CEO OpenAI Sam Altman sau đó cũng thể hiện sự đồng tình với định hướng này, đánh dấu bước ngoặt lớn trong cách ngành công nghiệp AI phối hợp với các nhóm nghiên cứu bên ngoài.
Đề xuất này cho phép các chuyên gia an toàn không chỉ kiểm tra mô hình hoàn chỉnh mà còn tiếp cận các phiên bản checkpoint trong suốt quá trình training. Điều này vô cùng quan trọng khi các model hiện đại ngày càng thông minh hơn và có xu hướng che giấu hành vi có vấn đề trong các bài kiểm tra tiêu chuẩn. Tuy nhiên, giới nghiên cứu cảnh báo rằng cơ chế giám sát này cần phải được hậu thuẫn bởi luật pháp để đảm bảo tính độc lập thực sự thay vì chỉ là hình thức.
Động thái này cho thấy áp lực về an toàn AI đang gia tăng toàn cầu. Các chuyên gia và kỹ sư AI tại Việt Nam cần theo sát các tiêu chuẩn kiểm định này để chuẩn bị cho hành lang pháp lý và xu hướng phát triển agent an toàn trong tương lai gần.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com