Wydajność Vera Rubin ujawniona po raz pierwszy, znaczny wzrost wydajności! Nvidia „wbija się” tuż przed konferencją AMD
Nvidia intensywnie prezentuje nowe produkty tuż przed doroczną konferencją AMD: wydajność procesora Vera CPU jest niemal dwukrotnie wyższa niż chipów x86, opóźnienia zmniejszone sześciokrotnie, a w testach Vera Rubin NVL72 efektywność energetyczna wzrosła dziesięciokrotnie w porównaniu do poprzedniej generacji. OpenAI, Anthropic i SpaceX już otrzymały pierwsze egzemplarze tych chipów. Ta starannie zaplanowana ofensywa informacyjna to bezpośredni atak na AMD, a także jednoznaczne wejście Nvidia na rynek procesorów CPU z zamiarem zawalczenia o udział w rynku wartym 200 miliardów dolarów.
Nvidia uderzyła mocno tuż przed doroczną premierą produktów AMD, intensywnie ujawniając rzeczywiste dane dotyczące wydajności nowej generacji platformy Vera Rubin oraz oficjalnie prezentując pełne specyfikacje własnego CPU Vera.
We wtorek Nvidia poinformowała, że wydajność CPU Vera przy zadaniach agentowych AI jest niemal dwukrotnie wyższa niż w przypadku chipów x86, a opóźnienia zostały zmniejszone sześciokrotnie. Jednocześnie, wstępne testy produkcyjne partnera chmurowego CoreWeave pokazują, że platforma Vera Rubin NVL72 podczas pracy z modelem DeepSeek R1 generuje dziesięciokrotnie większą przepustowość tokenów na megawat mocy obliczeniowej niż poprzednia generacja systemu GB200 NVL72 opartego na architekturze Blackwell.
Moment publikacji tych danych jest nieprzypadkowy. AMD organizuje w San Francisco w czwartek doroczną premierę "Advancing AI", a skumulowane ujawnienie danych przez Nvidia jest powszechnie postrzegane jako celowa akcja marketingowa. Dla dostawców chmury i klientów korporacyjnych oceniających inwestycje w kolejną generację infrastruktury AI, dane te mogą bezpośrednio wpłynąć na decyzje zakupowe.
Równocześnie Nvidia oficjalnie ogłosiła, że CPU Vera zostały dostarczone po raz pierwszy w czerwcu, a klientami są m.in. OpenAI, Anthropic i SpaceX. Oznacza to, że Nvidia oficjalnie wkracza na rynek CPU, stanowiąc bezpośrednie wyzwanie dla AMD i Intela.
Pojawienie się CPU Vera: Nvidia oficjalnie wchodzi na rynek serwerowych CPU
We wtorek Nvidia przedstawiła pełne specyfikacje CPU Vera dla centrów danych, wyniki benchmarków oraz informacje architektoniczne – dane kluczowe dla potencjalnych klientów chcących ocenić ten chip. Firma poinformowała, że chipy Vera od czerwca zostały dostarczone klientom takim jak OpenAI, Anthropic i SpaceX.
Vera to pierwszy serwerowy CPU Nvidii zaprojektowany od podstaw, oparty na niestandardowej mikroarchitekturze "Olympus core", a nie na gotowych rozwiązaniach Arm.
Hannah Coutand, dyrektor ds. marketingu rynkowego CPU Vera, wyjaśniła, że projekt koncentruje się na szybkości pojedynczego rdzenia, wysokiej przepustowości pamięci i niskich opóźnieniach, a celem jest "umożliwienie agentom jak najszybszego powrotu do GPU i utrzymanie wysokiego obciążenia GPU". Vera zużywa od 250 do 450 watów, obsługuje do 1,5 TB niskomocowej pamięci.
W najnowszych testach Nvidia zaprezentowała, że Vera osiąga 1,9-krotny wzrost wydajności i 6-krotnie niższe opóźnienie w zadaniach agentowych AI w porównaniu do chipów x86. Nvidia poinformowała też, że Vera w niektórych standardowych benchmarkach przewyższyła flagowy EPYC Turin CPU od AMD o prawie 100%. Wcześniej Nvidia twierdziła, że ogólna wydajność Vera w zadaniach AI agentowych jest o 50% wyższa niż w przypadku chipów x86.
Pojawienie się Vera to kolejny etap strategii wertykalnej integracji Nvidii. Wolfe Research szacuje, że cena jednego chipu Vera wynosi około 5000 dolarów, a dostawy w tym roku mogą osiągnąć 1,3 mln sztuk. Ian Buck, VP ds. superskalowych obliczeń w Nvidia, oznajmił, że agentowe AI sprawia, iż CPU są "bardziej niezbędne niż kiedykolwiek", a potencjalny rynek serwerowych CPU może osiągnąć wartość 200 mld dolarów.
Rzeczywiste testy Vera Rubin: 10-krotny wzrost efektywności energetycznej
Na początku czerwca CoreWeave po raz pierwszy wdrożył i zweryfikował Vera Rubin NVL72 – potwierdzając pełne stacki energii, chłodzenia, sieci i obliczeń. Szczegółowe wyniki, które dziś ujawniono, to pierwsze publiczne wyniki rzeczywistych testów wydajności chipów Vera Rubin NVL72.
Test opiera się na modelu DeepSeek R1; przy tym samym zakładanym poziomie interaktywności, Vera Rubin NVL72 generuje tokeny na megawat sekundę dziesięciokrotnie szybciej niż GB200 NVL72. CoreWeave dodało, że optymalizacje dla Vera Rubin można zastosować również do GB200 NVL72 – dzięki czemu w ciągu trzech miesięcy przepustowość tokenów na megawat wzrosła ponad czterokrotnie. Nvidia informuje, że wyniki zostały zweryfikowane w ponad 250 tys. konfiguracjach i podczas ponad 1,4 mln godzin GPU.
Z perspektywy architektonicznej, regał Vera Rubin NVL72 łączy 72 Rubin GPU i 36 Vera CPU przez pełną sieć NVLink 6 o przepustowości 260 TB/s, obsługując natywnie NVFP4. Według CoreWeave, wzrost efektywności pozwala klientom na obsługę większego ruchu inferencyjnego przy tym samym budżecie energetycznym, lub zmniejszenie kosztu tokena poprzez zużycie mniejszej ilości energii.
CoreWeave ujawnił także konkretne scenariusze zastosowania: globalna firma zajmująca się cyberbezpieczeństwem planuje realizować inferencje detekcji zagrożeń z dziesięciokrotną wydajnością na wat; firma rozwijająca autonomiczne agenty programistyczne planuje rozszerzyć zadania agentowe znacząco obniżając koszt tokena; natywna wyszukiwarka AI zamierza poszerzyć ofertę wyszukiwania czasu rzeczywistego dla większej liczby użytkowników, bez przekraczania limitów czasowych na odpowiedź.
Zoptymalizowana infrastruktura: integracja sprzętu i oprogramowania daje większą wydajność
Nvidia podkreśla, że wzrost wydajności wynika z kompleksowej optymalizacji sprzętu i oprogramowania, a nie tylko z samych chipów. Dzięki dynamicznej optymalizacji pełnej infrastruktury i stacku energetycznego, Nvidia twierdzi, że może wdrożyć o 40% więcej GPU w tym samym zakresie zużycia energii.
W zakresie chłodzenia Nvidia stosuje zamknięty system chłodzenia cieczą o temperaturze 45°C, dzięki czemu roczna oszczędność wody na megawat wynosi około 4 mln galonów w porównaniu do standardowych rozwiązań. Na poziomie sieciowym, szósta generacja NVLink 6 przewyższa architekturę Ethernet pod względem przepustowości dekodowania modeli językowych 2,3-krotnie; platforma Spectrum-X umożliwia 1,6-krotnie szybszy zdalny dostęp do pamięci bezpośredniej, zmniejsza liczbę przełączników o 1,7 razy, podnosi efektywność mocy światła 5-krotnie oraz tysiąckrotnie zwiększa niezawodność.
Najnowocześniejsza platforma Spectrum-6 od Nvidia jest już dostarczana klientom takim jak CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. i Tesla. Obecnie Nvidia przyspiesza dostawy do klientów i partnerów takich jak Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI i CoreWeave.
Nvidia nadal wyzwaniem dla rynku CPU
Mimo imponujących danych wydajnościowych Vera, Nvidia wciąż stoi przed wyzwaniem zdobycia znaczącego udziału w rynku CPU. Analityk Gartner Kevin Knox twierdzi, że AMD jest obecnie głównym konkurentem w sektorze CPU AI dla przedsiębiorstw. Według doniesień, Intel posiada około 66,8% udziału w rynku CPU dla serwerów, AMD – około 33%, przy czym AMD stale zdobywa kolejne udziały i rozwija współpracę z największymi dostawcami chmury.
Wraz z rozwojem agentowego AI, popyt na CPU rośnie – od początku roku akcje AMD i Intela wzrosły odpowiednio o 128% i 149%, znacznie przewyższając wzrost Nvidia, który wyniósł ok. 8%, czyniąc je najbardziej dynamicznymi akcjami chipowymi roku 2026.
Na obecnym etapie lista głównych partnerów chmurowych Nvidii obejmuje tylko Oracle, a innych kluczowych dostawców jeszcze nie ma. Hannah Coutand przyznała, że Vera znajduje się na "etapie wczesnej adopcji", jednak OpenAI planuje rozpocząć masowe wdrożenie chipów Vera już w tym kwartale.
Założyciel Cambrian AI Research, Karl Freund, podsumował strategię Nvidii następująco: "Chcą, by klienci uniezależnili się od CPU Intel lub AMD, bo zależy im na tych przychodach. Skupili się na stworzeniu unikalnego CPU, jakiego nikt jeszcze nie oferuje na rynku."
Zastrzeżenie: Treść tego artykułu odzwierciedla wyłącznie opinię autora i nie reprezentuje platformy w żadnym charakterze. Niniejszy artykuł nie ma służyć jako punkt odniesienia przy podejmowaniu decyzji inwestycyjnych.
Może Ci się również spodobać
Czy SanDisk jest naprawdę tak opłacalny jak się mówi, bardziej niż DRAM?

Nvidia inwestuje 1,5 miliarda dolarów w SB Energy, zabezpieczając 8GW mocy obliczeniowej dla AI, OpenAI zostanie jedynym najemcą
Nvidia rozszerza swoją konkurencyjną przewagę z GPU i serwerów na grunt, energię i budowę centrów danych AI. Firma współpracuje z SB Energy nad rozwojem ogromnego centrum danych AI o mocy 8 GW w Ohio, inwestując w niego 1,5 miliarda dolarów i zapewniając wsparcie kredytowe dla finansowania infrastruktury, a OpenAI jest jej jedynym najemcą. To oznacza, że Nvidia przekształca się z dostawcy chipów w organizatora infrastruktury AI, wcześniej zabezpieczając zasoby LPS, aby powiązać przyszłe zapotrzebowanie na kolejne generacje GPU.
Meta (META.US) i BlackRock (BLK.US) wpadły w "ubezpieczeniową czarną dziurę" dotyczącą centrum danych o wartości 14 miliardów dolarów: pokrycie wynosi tylko 3,2%, pożyczkodawcy mogą ponieść ryzyko sięgające miliardów dolarów
Według doniesień, Meta i BlackRock inwestują 14 miliardów dolarów w budowę centrum danych w Teksasie, które stoi w obliczu ryzyka ubezpieczeniowego.


