
Dell Pro Max z GB10 – Twoje lokalne AI na biurku
Dziś lokalne AI nie musi oznaczać serwerowni, drogich instancji GPU ani wysyłania danych do zewnętrznej chmury. Dell Pro Max z GB10 przenosi zaawansowane modele AI bezpośrednio na biurko. Sami go przetestowaliśmy!
Dell Pro Max z GB10 to kompaktowa stacja robocza zaprojektowana z myślą o lokalnym rozwoju i wnioskowaniu sztucznej inteligencji. W praktyce pełni funkcję niewielkiego, lokalnego centrum danych – urządzenia, które pozwala programistom i zespołom IT uruchamiać modele AI we własnej infrastrukturze.
To podejście ma szczególne znaczenie wszędzie tam, gdzie dane, własność intelektualna i kontrola nad środowiskiem przetwarzania są równie ważne jak sama moc obliczeniowa.
Lokalne AI zamiast chmury
Najważniejszą cechą Dell Pro Max z GB10 jest możliwość uruchamiania modeli AI lokalnie, bez korzystania z zewnętrznego API. Dane oraz zapytania pozostają w firmowej infrastrukturze.
Co to oznacza?
- Wrażliwe informacje, kod źródłowy czy własność intelektualna mogą być przetwarzane bez opuszczania bezpiecznej sieci wewnętrznej.
- Większa kontrola nad całym procesem inference – od modelu i danych, przez środowisko uruchomieniowe, aż po dostęp użytkowników.
- Lokalne środowisko eliminuje koszt każdego pojedynczego zapytania do zewnętrznego API. Zamiast rozliczenia za tokeny lub wynajmowania GPU w chmurze firma otrzymuje stały zasób obliczeniowy do testów, eksperymentów i prac R&D.
NVIDIA GB10 – serce lokalnej stacji AI
Za możliwości Dell Pro Max odpowiada NVIDIA Grace Blackwell GB10. Jest tosuperczip łączący procesor CPU z układem GPU NVIDIA Blackwell.
Konfiguracja obejmuje:
- 20-rdzeniowy procesor ARM NVIDIA GB10,
- GPU NVIDIA Blackwell,
- 128 GB ujednoliconej pamięci LPDDR5x,
- przepustowość pamięci na poziomie 273 GB/s,
- połączenie CPU i GPU przez NVLink C2C,
- pobór energii przy pełnym obciążeniu GPU na poziomie około 85–90 W,
- zasilanie za pomocą adaptera 280 W USB Type-C,
- system NVIDIA DGX OS oparty na Ubuntu Linux.
Kluczowe znaczenie ma tutaj architektura pamięci i komunikacji między CPU a GPU. Zamiast klasycznego połączenia przez PCIe zastosowano NVLink C2C, co pozwala ograniczyć wąskie gardła podczas przesyłania danych między procesorem i układem graficznym.
128 GB zunifikowanej pamięci pozwala natomiast ładować i uruchamiać duże modele w całości, bez konieczności dzielenia ich pomiędzy różne zasoby pamięci.
128 GB pamięci dla dużych modeli AI
Dla zastosowań związanych z generatywnym AI istotna jest nie tylko moc GPU, ale również ilość dostępnej pamięci.
W przypadku Dell Pro Max z GB10 128 GB zunifikowanej pamięci LPDDR5x pozwala pracować z dużymi modelami lokalnie. Ma to znaczenie również wtedy, gdy celem nie jest wyłącznie inference modeli językowych.
Warto podkreślić, że Dell Pro Max z GB10 może obsługiwać bardzo duże modele językowe. Dla pojedynczej jednostki granica sięga modeli o rozmiarze około 200 miliardów parametrów, podczas gdy połączenie dwóch to już 400-405 miliardów parametrów i około 1,4 tokena/s.
Dell Pro Max z GB10 jako lokalny serwer AI dla zespołu
„Lokalne AI na biurku” nie oznacza, że z urządzenia musi korzystać wyłącznie jedna osoba. Dzięki portowi LAN oraz możliwości skonfigurowania bezpiecznego dostępu SSH Dell Pro Max z GB10 może działać jako centralny node AI dla zespołu.
Programiści mogą korzystać z jego mocy obliczeniowej ze swoich standardowych laptopów, podczas gdy właściwe obciążenie AI jest wykonywane na lokalnym urządzeniu.
Konfiguracja podstawowego środowiska nie wymaga przy tym długiego wdrożenia:
- dostęp SSH – około 5 minut,
- integracja z VS Code – około 5 minut,
- środowisko Ollama – około 15 minut,
- DGX Dashboard – około 30 minut.
W efekcie jedno urządzenie może stać się wspólnym środowiskiem do prototypowania, testowania modeli i prac badawczo-rozwojowych.
Zobacz, jak wygląda lokalne AI w praktyce.
Na Dell Pro Max z GB10 zainstalowaliśmy Ollama, uruchomiliśmy i przetestowaliśmy m.in. DeepSeek-Coder-V2 oraz Qwen, a następnie sprawdziliśmy obciążenie CPU i GPU oraz wykorzystanie 128 GB zunifikowanej pamięci.
Dla kogo Dell Pro Max z GB10?
Dell Pro Max z GB10 jest przede wszystkim narzędziem dla zespołów, które chcą rozwijać, testować i uruchamiać AI we własnej infrastrukturze.
Szczególnie istotne mogą być takie zastosowania jak:
- lokalne inference modeli językowych,
- prototypowanie aplikacji wykorzystujących AI,
- testowanie nowych modeli,
- prace R&D nad generatywnym AI,
- praca z dużymi modelami bez wysyłania danych do chmury,
- lokalne generowanie obrazu i wideo,
- stworzenie wspólnego serwera AI dla zespołu programistów,
- eksperymentowanie z modelami bez kosztów za każde zapytanie API.
Co to oznacza dla IT?
Najważniejsza zmiana, jaką wnosi Dell Pro Max z GB10, nie sprowadza się wyłącznie do parametrów sprzętowych. To zmiana sposobu pracy z AI. Model, dane i środowisko uruchomieniowe mogą znajdować się pod kontrolą organizacji, a lokalny node może być współdzielony przez cały zespół.
Podsumujmy, co to oznacza w praktyce:
- Lokalne modele zamiast zewnętrznego API: Całkowite uniezależnienie się od zewnętrznych dostawców i chmury. Daje to możliwość lokalnego uruchamiania i testowania nawet bardzo zaawansowanych modeli bezpośrednio na własnym biurku.
- Dane i wnioskowanie (inference) pod pełną kontrolą organizacji: Kluczowa kwestia dla branż, w których bezpieczeństwo i prywatność danych są najwyższym priorytetem. Wszystkie zapytania oraz wrażliwa własność intelektualna firmy są przetwarzane lokalnie i nigdy nie opuszczają bezpiecznej sieci wewnętrznej.
- Dostęp przez sieć dla zespołu: Dzięki wbudowanemu portowi LAN oraz konfiguracji bezpiecznego dostępu SSH (która zajmuje zaledwie 5 minut), GB10 działa jako centralny serwer. Deweloperzy mogą zdalnie korzystać z jego pełnej mocy obliczeniowej bezpośrednio ze swoich zwykłych laptopów.
- Jeden lokalny node do testów i pracy z AI: Prawdziwe „laboratorium AI w pudełku” (AI Lab in a Box) dedykowane do szybkiego prototypowania i prac R&D. Kompletne środowisko programistyczne konfiguruje się błyskawicznie: dostęp SSH i integracja z VS Code zajmują po 5 minut, środowisko Ollama 15 minut, a panel DGX Dashboard jest gotowy w pół godziny.
- Brak kosztów za tokeny (Koniec z „Cloud Tax”): Zamiast płacić gigantyczne, nieprzewidywalne rachunki za utrzymanie instancji chmurowych GPU (sięgające od 12 mln do ponad 56 mln wonów, czyli ok. 3 500 – 16 000 PLN miesięcznie) oraz opłat za każdy token, firma inwestuje w jeden stały zasób. Dalsze eksperymenty, testy i tysiące zapytań są całkowicie darmowe.
- 2 x Dell Pro Max z GB10 to możliwość fizycznego spięcia dwóch urządzeń za pomocą dedykowanego kabla i portów QSFP (karta ConnectX-7). Taka konfiguracja pozwala na lokalne, w 100% bezpieczne (offline) uruchomienie gigantycznych modeli o rozmiarze 400–405 miliardów parametrów (jak np. pełna Llama 3 405B) przy stabilnej prędkości wnioskowania na poziomie około 1,4 tokena na sekundę. Dla porównania, pojedyncza jednostka obsługuje modele do 200 miliardów parametrów.
Chcesz zobaczyć, jak lokalne AI sprawdzi się w Twojej organizacji?
Skontaktuj się z nami – pomożemy Twojej firmie dobrać konfigurację i udostępnimy sprzęt do testów, żeby Twój zespół mógł samodzielnie sprawdzić Dell Pro Max z GB10 w swoich zastosowaniach.


