
Trong bối cảnh các siêu máy tính AI ngày càng mở rộng quy mô, Nvidia đã công bố kiến trúc mới mang tên Vera Rubin, một hệ thống tích hợp sâu giữa GPU Rubin, CPU Vera, bộ tăng tốc inference Groq 3 LPX và các thành phần lưu trữ‑mạng chuyên dụng. Đây không còn là chỉ “GPU mạnh” mà là một bộ giải pháp toàn diện để điều phối dữ liệu hiệu quả.
CPU Vera được thiết kế để giải quyết vấn đề truyền dữ liệu giữa bộ nhớ và GPU, nơi mà khả năng lưu trữ trong một máy chủ luôn bị giới hạn. Theo Jason Hardy, Phó Chủ tịch công nghệ lưu trữ của Nvidia, CPU Vera đã mang lại cải thiện lên tới ba lần trong các thao tác dữ liệu, cho phép sử dụng flash bộ nhớ ở mức tối đa mà không gây tắc nghẽn.
Kiến trúc này phản ánh xu hướng mới: khi tính toán AI đạt mức gigawatt, việc tối ưu hoá “đường giao thông” dữ liệu trở nên quan trọng hơn việc tăng tốc token‑per‑second. Các đối thủ như OpenAI cũng đang tập trung giảm di chuyển dữ liệu, ví dụ với chip Jalapeño, nhưng Nvidia đã đưa giải pháp này vào một hệ sinh thái hoàn chỉnh.
Với Vera Rubin, Nvidia không chỉ bảo vệ vị thế dẫn đầu mà còn mở ra cơ hội cho các trung tâm dữ liệu ở Việt Nam nâng cao hiệu suất năng lượng và giảm chi phí vận hành, đồng thời thúc đẩy việc triển khai các mô hình AI quy mô lớn trong nước.
Nguồn: TechCrunch — Biên dịch & tổng hợp: danhbaai.com