Cuộc đua trí tuệ nhân tạo tại Trung Quốc vừa đón nhận bất ngờ lớn khi tân binh StartLux tung ra mô hình thử nghiệm StartLux-V1.0-27B-Preview. Dù chỉ sở hữu 27 tỷ tham số, mô hình này đã xuất sắc vươn lên vị trí thứ hai trong bài kiểm tra chuyên biệt MCP do Viện Công nghệ Thông tin và Truyền thông Trung Quốc (CAICT) tổ chức, chỉ đứng sau siêu mô hình DeepSeek-V4-Pro 1,6 nghìn tỷ tham số.
StartLux được sáng lập bởi Trần Đản Nghiên (Chen Danyan), cựu đồng sáng lập Shanda Network. Trái ngược với xu hướng chạy đua quy mô trên đám mây, StartLux tập trung tối ưu hóa các mô hình local tinh gọn, cho phép vận hành trực tiếp trên máy tính cá nhân. Bài kiểm tra MCP của CAICT đánh giá năng lực Agent thực tế qua 6 tác vụ phức tạp gồm điều hướng, tìm kiếm web, tự động hóa trình duyệt, phân tích tài chính, quản lý mã nguồn và thiết kế 3D. Kết quả cho thấy mô hình 27B này đạt điểm tổng hợp 39,25%, vượt qua nhiều đối thủ cỡ lớn như DeepSeek-V4-Flash (284B), Step-3.7-Flash (198B) và vượt Qwen 3.6 (27B) tới 5,34 điểm phần trăm.
Đặc biệt, StartLux-V1.0-27B-Preview dẫn đầu ở các hạng mục thành phần như phân tích tài chính và tự động hóa trình duyệt. Sự xuất hiện của StartLux chứng minh rằng năng lực Agent mạnh mẽ hoàn toàn có thể tích hợp vào phần cứng thương mại phổ thông mà không phụ thuộc hạ tầng đám mây đắt đỏ. Đây là tín hiệu rất tích cực cho cộng đồng phát triển AI Việt Nam, mở ra triển vọng triển khai các ứng dụng Agent bảo mật, chi phí thấp ngay trên thiết bị của người dùng.
Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com