
DeepSeek vừa công bố kết quả ấn tượng của mô hình V4 Flash 0731 trên hai bộ đề ARC-AGI trong chế độ Semi‑Private. Khi chạy ở mức tối đa, mô hình đạt 89.0% trên ARC‑AGI‑1 với chi phí chỉ $0.02 mỗi tác vụ, và 61.4% trên ARC‑AGI‑2 với $0.04 mỗi tác vụ.
Những con số này cho thấy DeepSeek V4 Flash không chỉ mạnh về độ chính xác mà còn rất hiệu quả về chi phí. So với các mô hình LLM hiện nay, mức giá $0.02‑$0.04 mỗi truy vấn là mức thấp nhất trong cùng phân khúc, mở ra khả năng áp dụng rộng rãi cho các doanh nghiệp và nhà nghiên cứu tại Việt Nam.
DeepSeek cho biết mô hình được tối ưu hoá bằng kỹ thuật flash attention và kiến trúc Transformer mới, giúp giảm thời gian tính toán và tiêu thụ GPU. Đội ngũ phát triển cũng đã thực hiện đào tạo trên tập dữ liệu đa ngôn ngữ, bao gồm tiếng Việt, nhằm nâng cao khả năng hiểu và sinh ngôn ngữ địa phương.
Với kết quả này, cộng đồng AI Việt Nam có thể kỳ vọng sẽ tiếp cận các giải pháp LLM mạnh mẽ, chi phí hợp lý, hỗ trợ cho các dự án nghiên cứu, ứng dụng trong giáo dục và doanh nghiệp.
Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com