Khảo sát 17.000 lượt chạy: Claude, Codex và Cursor chọn công cụ lập trình nào?

Một nghiên cứu quy mô lớn vừa được công bố dựa trên phân tích 17.000 phiên chạy thử nghiệm nhằm tìm hiểu cách các AI agent hàng đầu gồm Claude Code, Codex và Cursor tự lựa chọn dịch vụ và công cụ khi được giao nhiệm vụ triển khai giải pháp trong mã nguồn sẵn có. Thử nghiệm được thực hiện trên 75 kho mã nguồn thuộc 10 ngôn ngữ lập trình với 1.163 biến thể prompt khác nhau.

Kết quả chỉ ra rằng các agent có xu hướng đưa ra lựa chọn công cụ rất nhất quán dựa trên ngữ cảnh dự án và yêu cầu kỹ thuật. Ví dụ, khi cần giải pháp cơ sở dữ liệu quản lý hoàn toàn và chi phí dự đoán được cho dự án nhỏ, các agent như Claude Code nhất loạt đề xuất Neon thay vì Supabase nhờ tính năng không bị tạm dừng ứng dụng. Đáng chú ý, dữ liệu từ Vercel cũng cho thấy hơn 30% lượt triển khai ứng dụng hiện nay được khởi tạo bởi AI agent, tăng 1.000% chỉ trong vòng 6 tháng.

Nghiên cứu được thiết lập tỉ mỉ với các hồ sơ lập trình viên giả lập từ “vibe coder” cho đến kỹ sư doanh nghiệp lâu năm. Toàn bộ dấu vết suy luận (thinking trace) cùng các thay đổi mã nguồn (git diff) đã được công khai nhằm giúp cộng đồng đánh giá tính khách quan trong quyết định của AI.

Đối với cộng đồng lập trình viên và doanh nghiệp công nghệ tại Việt Nam, phát hiện này khẳng định vai trò ngày càng lớn của AI agent trong kiến trúc phần mềm, đồng thời gợi mở chiến lược tối ưu sản phẩm dev tool để được AI ưu tiên lựa chọn.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account