
Inherent, phòng lab AI tại London do các cựu nhân sự Google DeepMind thành lập, đã giới thiệu Faraday, một AI agent được thiết kế để tái lập độc lập kết quả của các bài báo khoa học mà không được cung cấp trước đáp án. Công ty cho biết Faraday đã vượt các hệ thống dựa trên Claude Opus 4.8 của Anthropic và GPT-5.5 của OpenAI trong tác vụ cụ thể này.
Điểm Inherent nhấn mạnh là Faraday vận hành trên Qwen 3.6, một model có 27 tỷ tham số và nhỏ hơn đáng kể so với các frontier model được đem ra so sánh. Mục tiêu đánh giá không chỉ là tái tạo đúng kết quả, mà còn bao gồm “research taste”: khả năng nhận biết thí nghiệm nào đáng thực hiện và thiết kế chúng hợp lý. Đồng sáng lập kiêm giám đốc khoa học Edward Hughes ví quá trình tái lập nghiên cứu với bài tập phổ biến của nghiên cứu sinh tiến sĩ.
Để phát triển năng lực này, Inherent tập trung vào reinforcement learning, thưởng cho agent khi tạo ra kết quả tốt thay vì cố mô tả đầy đủ các quy tắc làm khoa học. Faraday cũng không tự đảm nhiệm mọi công cụ: theo công ty, agent sử dụng GPT-5.5 Codex của OpenAI cho công việc coding, tương tự cách nhà khoa học dùng phần mềm có sẵn. Inherent đặt mục tiêu dài hạn là xây dựng một “AI scientist” có thể chủ động đề xuất và thực hiện thí nghiệm.
Startup này vừa rời chế độ stealth sau vòng seed 50 triệu USD và hiện có khoảng 12 nhân viên làm việc trực tiếp tại King’s Cross, London. Kết quả vẫn là tuyên bố từ Inherent và cần benchmark độc lập, nhưng cách kết hợp model nhỏ với agent, công cụ ngoài và reinforcement learning cho thấy năng lực nghiên cứu không chỉ phụ thuộc vào số lượng tham số.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com