
OpenAI vừa công bố mô hình Astra mới, áp dụng kỹ thuật “recurrent depth” (còn gọi là “opaque recurrence”). Khác với các mô hình suy luận truyền thống dựa trên chuỗi bước tuần tự, Astra lặp lại cùng một truy vấn trong một vòng lặp, làm giảm đáng kể khả năng hiển thị chain‑of‑thought (CoT) cho người quan sát.
Kỹ thuật này khiến quá trình suy luận của mô hình trở nên ít minh bạch hơn, gây lo ngại cho các nhà nghiên cứu an toàn AI. Redwood Research và các chuyên gia như Buck Shlegeris và Zvi Mowshowitz đã lên tiếng, cho rằng nếu OpenAI mở rộng việc sử dụng “opaque recurrence”, việc giám sát hành vi sai lệch của mô hình sẽ trở nên khó khăn hơn rất nhiều.
Mặc dù OpenAI khẳng định Astra vẫn duy trì khả năng ghi lại CoT ở mức có thể đọc được, nhưng việc tăng cường mức độ lặp lại trong tương lai có thể “đốt cháy” khả năng theo dõi. Công ty cũng công bố sẽ triển khai các hệ thống giám sát CoT mạnh mẽ hơn, nhằm giảm thiểu rủi ro.
Với cộng đồng AI Việt Nam, việc hiểu và theo dõi các kỹ thuật mới như “recurrent depth” là rất quan trọng. Nếu không có cơ chế giám sát thích hợp, các mô hình mạnh mẽ có thể gây ra những hậu quả không lường trước, ảnh hưởng đến niềm tin và việc áp dụng AI trong các lĩnh vực quan trọng.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com