Qwen có dấu hiệu học từ dữ liệu của GPT-5.5 Pro qua thử nghiệm Reasoning Prefill

Một nghiên cứu độc lập phiên bản v1.1 kiểm tra hiện tượng reasoning prefill trên các mô hình AI mã nguồn mở vừa công bố kết quả đáng chú ý về mối liên hệ giữa mô hình Qwen và GPT-5.5 Pro.

Trong thử nghiệm đánh giá trên 45 bài toán (bao gồm 15 bài STEM, 15 bài non-STEM và 15 câu đố tổng hợp), nhà nghiên cứu đã đo lường mức độ xuất hiện câu trả lời của mô hình giáo viên (GPT-5.5 Pro) trong 100 token đầu tiên của mô hình mục tiêu. Đáng chú ý, chỉ số trùng lặp (source recall) của Qwen đã tăng tới +18,18 điểm phần trăm hướng về GPT-5.5 Pro, bao gồm hiệu ứng lớn trên các câu đố tổng hợp riêng biệt. Trái ngược với thử nghiệm trước đó khi Qwen hầu như không phản ứng với Claude Opus 4.8, dữ liệu mới gợi ý Qwen có thể đã học từ dữ liệu do GPT-5.5 Pro hoặc một mô hình GPT liên quan tạo ra.

Bên cạnh đó, thử nghiệm cũng ghi nhận mô hình Kimi K3 có tỷ lệ trùng lặp cao nhất với GPT-5.5 Pro cả khi không dùng và có dùng prefill (lần lượt đạt 31,11% và 35,65%), dù mức tăng prefill chỉ là +4,54 điểm.

Đối với cộng đồng nghiên cứu AI tại Việt Nam, thử nghiệm này cung cấp thêm phương pháp luận giá trị trong việc kiểm chứng nguồn gốc dữ liệu huấn luyện và đánh giá năng lực suy luận thực tế của các LLM mã nguồn mở.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account