Nvidia đang định vị lại lợi thế cạnh tranh của mình không chỉ ở GPU mà còn ở toàn bộ hệ thống xung quanh nó, theo phân tích của TechCrunch sau báo cáo thu nhập quý 2 vượt kỳ vọng của hãng.
Trong nhiều năm, câu chuyện chính về Nvidia là: GPU của họ là nguồn cung duy nhất cho các phòng lab AI, và điều đó mang lại lợi nhuận khổng lồ. Nhưng khi các hyperscaler (Amazon, Google) bắt đầu tự xây chip, câu hỏi đặt ra là lợi thế của Nvidia có bền không.
Câu trả lời của Nvidia là: lợi thế của họ không chỉ nằm ở GPU. Kiến trúc Vera Rubin đang được triển khai, kết hợp Rubin GPU với Vera CPU, Groq 3 LPX (tăng tốc suy luận), cùng các rack lưu trữ và mạng chuyên dụng. Nếu GPU là động cơ, thì phần còn lại là cả chiếc xe — và Nvidia đang dẫn đầu trong việc xây dựng toàn bộ chiếc xe đó.
Theo Jason Hardy, Phó chủ tịch mảng lưu trữ của Nvidia: “Vera rất quan trọng vì chỉ có thể gắn một lượng bộ nhớ nhất định vào một server.” Khi trung tâm dữ liệu mở rộng, việc đưa dữ liệu đến GPU đúng lúc là bài toán không hề đơn giản. Vera CPU giúp tăng tốc các thao tác này lên tới 3 lần, cho phép tận dụng tối đa flash mà không bị nghẽn cổ chai.
Cách tiếp cận của OpenAI với chip Jalapeño cũng cho thấy cùng một logic: thiết kế chip để giảm thiểu di chuyển dữ liệu, giữ toàn bộ workload trong một hệ thống tích hợp. Sự khác biệt là Jalapeño là chip tùy chỉnh của OpenAI, còn Vera Rubin là hệ sinh thái có sẵn của Nvidia.
Điều này mở ra một cuộc cạnh tranh mới ở một tầng khác: xây dựng GPU đối thủ chỉ là một phần của trận đấu; quan trọng hơn là làm cho toàn bộ hệ thống hoạt động hiệu quả. Và ở giai đoạn đầu này, Nvidia đang chiếm lợi thế dẫn đầu rõ rệt.