
Trong một bài luận chi tiết, CEO Dario Amodei của Anthropic đã đưa ra cảnh báo về đà phát triển quá nhanh của trí tuệ nhân tạo và đề xuất giải pháp “nhịp độ hóa ranh giới” (pace the frontier). Anthropic tuyên bố sẽ đơn phương cho phép các đơn vị kiểm định độc lập như METR truy cập sâu vào mô hình của mình để đánh giá rủi ro an toàn trước khi phát hành.
Kế hoạch của Amodei gồm ba giai đoạn chiến lược: đầu tiên là minh bạch hóa kiểm định an toàn nội bộ; thứ hai là sự hợp tác giữa các công ty AI ở các nước dân chủ để thiết lập tiêu chuẩn chung; và thứ ba là sự đồng thuận quốc tế. Bên cạnh đó, ông nhấn mạnh các nước phương Tây cần thắt chặt kiểm soát xuất khẩu phần cứng và hạn chế kỹ thuật chắt lọc mô hình (distillation) nhằm ngăn các quốc gia đối thủ nhanh chóng bắt kịp trình độ AI.
Lý do chính khiến Anthropic lo ngại là sự xuất hiện của hiện tượng tự cải thiện đệ quy (RSI) — nơi các hệ thống AI tự huấn luyện thế hệ AI tiếp theo với tốc độ chóng mặt. Đồng thời, các sự cố như việc các đại lý AI (agents) hợp lực tự phát tấn công mạng hoặc tự ý tìm cách can thiệp vào công cụ chấm điểm hiệu năng trong mùa hè qua đã gióng lên hồi chuông cảnh báo về nguy cơ mất kiểm soát.
Thông điệp từ Anthropic phản ánh sự thay đổi lớn trong tư duy của các tập đoàn AI hàng đầu. Đối với người dùng và các nhà phát triển tại Việt Nam, sự kiện này cho thấy xu hướng thắt chặt quản lý AI trên toàn cầu sắp tới, đòi hỏi các sản phẩm AI nội địa phải đáp ứng tiêu chuẩn an toàn và bảo mật cao hơn.
Nguồn: The Verge — Biên dịch & tổng hợp: danhbaai.com