Mô hình bệnh viện thực hành giúp agent lập trình xử lý 1 triệu dòng lệnh

Nhóm kỹ sư tại Cockroach Labs vừa chia sẻ thành công từ thử nghiệm áp dụng mô hình bệnh viện thực hành (MOLT Sinai) để quản lý quy trình làm việc của các AI agent lập trình. Hệ thống phân chia ranh giới và vai trò rõ ràng cho các agent như Y tá phân loại, Bác sĩ nội trú, Bác sĩ duyệt và Y tá xuất viện nhằm thắt chặt kiểm duyệt trước khi hợp nhất mã nguồn.

Trong suốt 5 tháng vận hành, hệ thống agent này đã tự động xử lý hơn 1 triệu dòng code nhưng chỉ xảy ra đúng 7 lần phải hoàn tất thao tác đảo ngược mã (revert). Điểm sáng lớn nhất là khi nâng cấp công cụ MOLT để hỗ trợ cơ sở dữ liệu IBM Db2, các agent chỉ mất chưa đầy 2 ngày với chi phí token là 4.172 USD. Trước đó, công việc tương tự với Oracle vào năm 2024 đã tốn tới 9 tháng phát triển và 160.000 USD chi phí nhân sự, tức hệ thống agent mới giúp tăng tốc 164 lần và tiết kiệm 38 lần chi phí.

Để đạt được kết quả này, agent quy hoạch đã tự động chia nhỏ yêu cầu phức tạp thành 15 vấn đề con cùng biểu đồ phụ thuộc chi tiết. Trong suốt quá trình phát triển 27 dòng lệnh cập nhật (pull request), các agent kiểm duyệt đã trả lại bài tới 55 lần để chỉnh sửa và chỉ chuyển 2 trường hợp khó lên cho kỹ sư con người xử lý trực tiếp.

Mô hình phối hợp agent theo cấu trúc phân tầng này mang lại bài học vô giá cho các lập trình viên và doanh nghiệp phần mềm tại Việt Nam. Việc thiết lập quy trình kiểm thử và phân chia vai trò nghiêm ngặt giúp tối ưu hóa sức mạnh của AI agent mà vẫn đảm bảo độ tin cậy tuyệt đối cho các hệ thống phần mềm doanh nghiệp.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account