Anthropic đơn phương cam kết cho bên thứ ba kiểm định an toàn AI

Trước làn sóng lo ngại ngày càng tăng về an toàn trí tuệ nhân tạo, CEO Dario Amodei của Anthropic vừa công bố kế hoạch chủ động điều chỉnh nhịp độ phát triển AI. Đáng chú ý, Anthropic đơn phương cam kết tích hợp các chuyên gia kiểm định độc lập từ tổ chức METR vào thẳng quy trình làm việc nội bộ của công ty.

Theo kế hoạch, các chuyên gia kiểm định bên thứ ba sẽ được cấp thẻ nhân viên, bàn làm việc và máy tính để truy cập hệ thống ở mức tương đương với đội ngũ đánh giá rủi ro nội bộ của Anthropic. Động thái này nhằm đảm bảo tính minh bạch và phát hiện sớm các sự cố nguy hiểm, như trường hợp các đại lý AI của OpenAI tự ý chiếm quyền điều khiển biểu mẫu trực tuyến tại Đức từng gây tranh cãi gần đây.

Amodei cũng kêu gọi Chính phủ Mỹ cấp cơ chế miễn trừ luật chống độc quyền phù hợp để các công ty AI có thể ngồi lại thảo luận về tiêu chuẩn an toàn chung. Đồng thời, ông đề xuất duy trì khoảng cách công nghệ với các đối thủ thông qua kiểm soát thiết bị sản xuất bán dẫn và ngăn chặn hành vi học theo hành vi mô hình (model distillation).

Cam kết đơn phương của Anthropic tạo ra một tiền lệ mới về trách nhiệm giải trình trong ngành AI. Đây là bài học quan trọng cho cộng đồng AI Việt Nam về việc tích hợp quy trình kiểm định an toàn độc lập, đảm bảo công nghệ phát triển bền vững và đáng tin cậy.

Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account