
OpenAI công bố chip Jalapeño mới trong một bài blog và buổi briefing với báo chí, nhấn mạnh khả năng cung cấp độ trễ thấp và thông lượng cao hơn so với các giải pháp hiện có. Richard Ho, phó chủ tịch phần cứng, mô tả Jalapeño là “sự kết hợp tốt nhất của hai thế giới” – vừa giảm latency, vừa tăng throughput.
Jalapeño là một ASIC được thiết kế cùng Broadcom, tập trung vào AI inference. Khi được thử nghiệm trên nền tảng InferenceX, chip đã đạt 1,5‑1,9 lần nhiều công việc AI trên mỗi watt và giảm độ trễ cuối‑cùng 1,7‑3,6 lần so với các siêu chip Nvidia GB200/GB300 trên các mô hình GPT‑OSS 120B, DeepSeek R1 và Kimi K2.5 1T.
Công ty dự kiến sẽ đưa Jalapeño ra thị trường ở quy mô nhỏ vào cuối năm 2026, sau đó tăng sản lượng vào năm 2027. Tuy nhiên, OpenAI không có kế hoạch thay thế toàn bộ danh mục chip hiện tại, mà sẽ tiếp tục hợp tác với các đối tác như Nvidia và phát triển các thế hệ tiếp theo của Jalapeño.
Đối với người dùng và doanh nghiệp Việt Nam, việc có một chip inference mạnh mẽ và tiết kiệm năng lượng sẽ giúp các dịch vụ AI đáp ứng nhanh hơn, giảm chi phí vận hành và mở rộng quy mô dễ dàng hơn. Điều này hứa hẹn thúc đẩy sự phát triển của các ứng dụng AI thời gian thực trong các lĩnh vực như chatbot, trợ lý ảo và phân tích dữ liệu lớn.
Nguồn: The Verge — Biên dịch & tổng hợp: danhbaai.com