
OpenAI vừa giới thiệu chế độ Ultrafast – một bản nâng cấp tốc độ cho mô hình ngôn ngữ mới nhất GPT‑5.6 Sol. Theo blog post của công ty, Ultrafast cho phép mô hình xử lý nhanh gấp 14 lần so với chế độ mặc định, giúp tạo ra tới 750 token mỗi giây khi tương tác với người dùng.
Khả năng này đồng nghĩa với việc giảm thời gian chờ đợi đáng kể trong các ứng dụng thời gian thực. Trước đây, để đạt tốc độ tương tự, người dùng thường phải chuyển sang mô hình nhỏ hơn hoặc chuyên biệt. Ultrafast mở ra hướng đi mới: “nhiều công việc hữu ích hơn mỗi giây”.
OpenAI cho biết chế độ này đang được triển khai trong giai đoạn preview, nhờ sự hợp tác với nhà sản xuất chip Cerebras. Hiện tại, chỉ một số khách hàng doanh nghiệp được mời thử, nhưng công ty hứa sẽ mở rộng khi năng lực tăng lên. Các lĩnh vực được đề xuất áp dụng bao gồm phản hồi sự cố, dịch vụ khách hàng, phân tích thị trường tài chính và thương mại điện tử.
Với tốc độ xử lý cao, Ultrafast có thể giúp các doanh nghiệp Việt Nam rút ngắn thời gian phản hồi, nâng cao trải nghiệm người dùng và giảm chi phí tính toán. Đây là bước tiến quan trọng trong cuộc đua cung cấp AI thời gian thực cho thị trường doanh nghiệp.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com