
Base Labs, nhóm nghiên cứu trực thuộc Baseten, vừa công bố hợp tác cùng Hugging Face và Goodfire AI để phát triển hạ tầng an toàn cho các mô hình trọng số mở (open-weight models). Sáng kiến này nhằm giải quyết thách thức ngày càng lớn về an toàn AI khi các kỹ thuật như abliteration có thể dễ dàng loại bỏ bộ lọc an toàn trên hàng nghìn mô hình nguồn mở.
Thay vì áp dụng các giải pháp bảo mật chắp vá sau khi model đã hoàn thiện, liên minh này tập trung xây dựng các phương pháp huấn luyện và giám sát tích hợp trực tiếp vào vòng đời của mô hình. Với sự tham gia của Goodfire AI – đơn vị chuyên giải mã “hộp đen” của mạng nơ-ron – dự án kỳ vọng mang lại độ minh bạch cao hơn và công cụ kiểm soát trực quan cho nhà phát triển.
Động thái này củng cố niềm tin của cộng đồng công nghệ vào tính ưu việt của mã nguồn mở trong việc đảm bảo an toàn AI. Đối với các kỹ sư và nhà nghiên cứu tại Việt Nam, khung tiêu chuẩn mới này sẽ tạo nền tảng vững chắc hơn để khai thác các model mở một cách an toàn và hiệu quả.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com