NVIDIA Vera Rubin to platforma obliczeniowa AI nowej generacji, nastepca architektury Grace Blackwell. Laczy nowe GPU Rubin (proces 3 nm, pamiec HBM4, ok. 50 petaFLOPS w formacie FP4 na GPU) z nowym, autorskim CPU Vera, ktore zawiera 88 rdzeni NVIDIA Olympus (Arm), podsystem pamieci LPDDR5X oraz druga generacje NVIDIA Scalable Coherent Fabric. Vera jest nastepca CPU Grace.
Flagowa konfiguracja rack-scale, Vera Rubin NVL144, laczy 144 GPU Rubin (72 pakiety) oraz 36 CPU Vera w jednej szafie. System osiaga do 3,6 exaFLOPS w FP4 dla inferencji i 1,2 exaFLOPS w FP8 dla treningu, co daje w przyblizeniu 3,3-krotnie wyzsza wydajnosc niz obecna platforma GB300 NVL72. Wyposazony jest w pamiec HBM4 o przepustowosci ok. 13 TB/s oraz okolo 75 TB szybkiej pamieci systemowej.
Laczność zapewniaja NVLink 6 (ok. 260 TB/s przepustowosci scale-up w szafie), karty sieciowe NVIDIA ConnectX-9 (ok. 28,8 TB/s) oraz platforma BlueField/Quantum-X. Calosc dziala na stosie oprogramowania NVIDIA (CUDA, biblioteki AI). Rubin i Vera Rubin NVL144 sa spodziewane w 2. polowie 2026 r.; kolejnym krokiem mapy drogowej jest Rubin Ultra NVL576 (2027, ok. 100 PFLOPS FP4 na GPU).

System rack-scale AI
Do jakiej grupy należy NVIDIA Vera Rubin (NVL144) i jak jest skonstruowany
Typ komponentu obejmujacy kompletne systemy rack-scale do AI: dziesiatki GPU/akceleratorow polaczonych z CPU i szybka siecia (scale-up/scale-out) w obrebie jednej szafy, projektowane pod trening i inferencje modeli frontier AI.
Konstrukcja rack-scale, w ktorej GPU (akceleratory AI), CPU i karty sieciowe sa wspolprojektowane i gesto polaczone (np. przez UALink, Infinity Fabric, Ethernet), zwykle w otwartym formacie szafy (np. double-wide ORW), aby maksymalizowac przepustowosc, ruch danych i skalowalnosc dla frontier AI.
Podstawowe właściwości fizyczne NVIDIA Vera Rubin (NVL144) — wymiary, masa i materiały
Inne części sprzętowe powiązane z NVIDIA Vera Rubin (NVL144)

Rack-scale, ciekłochłodzony system obliczeniowy oparty na 72 procesorach graficznych NVIDIA Blackwell Ultra (B300) i 36 procesorach NVIDIA Grace, przeznaczony do wnioskowania i trenowania dużych modeli AI.

Rack-scale, ciekłochłodzony system obliczeniowy oparty na 72 procesorach graficznych NVIDIA Blackwell (B200) i 36 procesorach NVIDIA Grace, przeznaczony do trenowania i wnioskowania dużych modeli AI.