Opublikowano:

Dell Pro Max z GB10 – Twoje lokalne AI na biurku

Dziś lokalne AI nie musi oznaczać serwerowni, drogich instancji GPU ani wysyłania danych do zewnętrznej chmury. Dell Pro Max z GB10 przenosi zaawansowane modele AI bezpośrednio na biurko. Sami go przetestowaliśmy!

Dell Pro Max z GB10 to kompaktowa stacja robocza zaprojektowana z myślą o lokalnym rozwoju i wnioskowaniu sztucznej inteligencji. W praktyce pełni funkcję niewielkiego, lokalnego centrum danych – urządzenia, które pozwala programistom i zespołom IT uruchamiać modele AI we własnej infrastrukturze.

To podejście ma szczególne znaczenie wszędzie tam, gdzie dane, własność intelektualna i kontrola nad środowiskiem przetwarzania są równie ważne jak sama moc obliczeniowa.

Lokalne AI zamiast chmury

Najważniejszą cechą Dell Pro Max z GB10 jest możliwość uruchamiania modeli AI lokalnie, bez korzystania z zewnętrznego API. Dane oraz zapytania pozostają w firmowej infrastrukturze.

Co to oznacza?

  • Wrażliwe informacje, kod źródłowy czy własność intelektualna mogą być przetwarzane bez opuszczania bezpiecznej sieci wewnętrznej.
  • Większa kontrola nad całym procesem inference – od modelu i danych, przez środowisko uruchomieniowe, aż po dostęp użytkowników.
  • Lokalne środowisko eliminuje koszt każdego pojedynczego zapytania do zewnętrznego API. Zamiast rozliczenia za tokeny lub wynajmowania GPU w chmurze firma otrzymuje stały zasób obliczeniowy do testów, eksperymentów i prac R&D.

NVIDIA GB10 – serce lokalnej stacji AI

Za możliwości Dell Pro Max odpowiada NVIDIA Grace Blackwell GB10. Jest tosuperczip łączący procesor CPU z układem GPU NVIDIA Blackwell.

Konfiguracja obejmuje:

  • 20-rdzeniowy procesor ARM NVIDIA GB10,
  • GPU NVIDIA Blackwell,
  • 128 GB ujednoliconej pamięci LPDDR5x,
  • przepustowość pamięci na poziomie 273 GB/s,
  • połączenie CPU i GPU przez NVLink C2C,
  • pobór energii przy pełnym obciążeniu GPU na poziomie około 85–90 W,
  • zasilanie za pomocą adaptera 280 W USB Type-C,
  • system NVIDIA DGX OS oparty na Ubuntu Linux.

Kluczowe znaczenie ma tutaj architektura pamięci i komunikacji między CPU a GPU. Zamiast klasycznego połączenia przez PCIe zastosowano NVLink C2C, co pozwala ograniczyć wąskie gardła podczas przesyłania danych między procesorem i układem graficznym.

128 GB zunifikowanej pamięci pozwala natomiast ładować i uruchamiać duże modele w całości, bez konieczności dzielenia ich pomiędzy różne zasoby pamięci.

128 GB pamięci dla dużych modeli AI

Dla zastosowań związanych z generatywnym AI istotna jest nie tylko moc GPU, ale również ilość dostępnej pamięci.

W przypadku Dell Pro Max z GB10 128 GB zunifikowanej pamięci LPDDR5x pozwala pracować z dużymi modelami lokalnie. Ma to znaczenie również wtedy, gdy celem nie jest wyłącznie inference modeli językowych.

Warto podkreślić, że Dell Pro Max z GB10 może obsługiwać bardzo duże modele językowe. Dla pojedynczej jednostki granica sięga modeli o rozmiarze około 200 miliardów parametrów, podczas gdy połączenie dwóch to już 400-405 miliardów parametrów i około 1,4 tokena/s.

Dell Pro Max z GB10 jako lokalny serwer AI dla zespołu

„Lokalne AI na biurku” nie oznacza, że z urządzenia musi korzystać wyłącznie jedna osoba. Dzięki portowi LAN oraz możliwości skonfigurowania bezpiecznego dostępu SSH Dell Pro Max z GB10 może działać jako centralny node AI dla zespołu.

Programiści mogą korzystać z jego mocy obliczeniowej ze swoich standardowych laptopów, podczas gdy właściwe obciążenie AI jest wykonywane na lokalnym urządzeniu.

Konfiguracja podstawowego środowiska nie wymaga przy tym długiego wdrożenia:

  • dostęp SSH – około 5 minut,
  • integracja z VS Code – około 5 minut,
  • środowisko Ollama – około 15 minut,
  • DGX Dashboard – około 30 minut.

W efekcie jedno urządzenie może stać się wspólnym środowiskiem do prototypowania, testowania modeli i prac badawczo-rozwojowych.

Zobacz, jak wygląda lokalne AI w praktyce.

Na Dell Pro Max z GB10 zainstalowaliśmy Ollama, uruchomiliśmy i przetestowaliśmy m.in. DeepSeek-Coder-V2 oraz Qwen, a następnie sprawdziliśmy obciążenie CPU i GPU oraz wykorzystanie 128 GB zunifikowanej pamięci.

Dla kogo Dell Pro Max z GB10?

Dell Pro Max z GB10 jest przede wszystkim narzędziem dla zespołów, które chcą rozwijać, testować i uruchamiać AI we własnej infrastrukturze.

Szczególnie istotne mogą być takie zastosowania jak:

  • lokalne inference modeli językowych,
  • prototypowanie aplikacji wykorzystujących AI,
  • testowanie nowych modeli,
  • prace R&D nad generatywnym AI,
  • praca z dużymi modelami bez wysyłania danych do chmury,
  • lokalne generowanie obrazu i wideo,
  • stworzenie wspólnego serwera AI dla zespołu programistów,
  • eksperymentowanie z modelami bez kosztów za każde zapytanie API.

Co to oznacza dla IT?

Najważniejsza zmiana, jaką wnosi Dell Pro Max z GB10, nie sprowadza się wyłącznie do parametrów sprzętowych. To zmiana sposobu pracy z AI. Model, dane i środowisko uruchomieniowe mogą znajdować się pod kontrolą organizacji, a lokalny node może być współdzielony przez cały zespół.

Podsumujmy, co to oznacza w praktyce:

  • Lokalne modele zamiast zewnętrznego API: Całkowite uniezależnienie się od zewnętrznych dostawców i chmury. Daje to możliwość lokalnego uruchamiania i testowania nawet bardzo zaawansowanych modeli bezpośrednio na własnym biurku.
  • Dane i wnioskowanie (inference) pod pełną kontrolą organizacji: Kluczowa kwestia dla branż, w których bezpieczeństwo i prywatność danych są najwyższym priorytetem. Wszystkie zapytania oraz wrażliwa własność intelektualna firmy są przetwarzane lokalnie i nigdy nie opuszczają bezpiecznej sieci wewnętrznej.
  • Dostęp przez sieć dla zespołu: Dzięki wbudowanemu portowi LAN oraz konfiguracji bezpiecznego dostępu SSH (która zajmuje zaledwie 5 minut), GB10 działa jako centralny serwer. Deweloperzy mogą zdalnie korzystać z jego pełnej mocy obliczeniowej bezpośrednio ze swoich zwykłych laptopów.
  • Jeden lokalny node do testów i pracy z AI: Prawdziwe „laboratorium AI w pudełku” (AI Lab in a Box) dedykowane do szybkiego prototypowania i prac R&D. Kompletne środowisko programistyczne konfiguruje się błyskawicznie: dostęp SSH i integracja z VS Code zajmują po 5 minut, środowisko Ollama 15 minut, a panel DGX Dashboard jest gotowy w pół godziny.
  • Brak kosztów za tokeny (Koniec z „Cloud Tax”): Zamiast płacić gigantyczne, nieprzewidywalne rachunki za utrzymanie instancji chmurowych GPU (sięgające od 12 mln do ponad 56 mln wonów, czyli ok. 3 500 – 16 000 PLN miesięcznie) oraz opłat za każdy token, firma inwestuje w jeden stały zasób. Dalsze eksperymenty, testy i tysiące zapytań są całkowicie darmowe.
  • 2 x Dell Pro Max z GB10 to możliwość fizycznego spięcia dwóch urządzeń za pomocą dedykowanego kabla i portów QSFP (karta ConnectX-7). Taka konfiguracja pozwala na lokalne, w 100% bezpieczne (offline) uruchomienie gigantycznych modeli o rozmiarze 400–405 miliardów parametrów (jak np. pełna Llama 3 405B) przy stabilnej prędkości wnioskowania na poziomie około 1,4 tokena na sekundę. Dla porównania, pojedyncza jednostka obsługuje modele do 200 miliardów parametrów.

Chcesz zobaczyć, jak lokalne AI sprawdzi się w Twojej organizacji?

Skontaktuj się z nami – pomożemy Twojej firmie dobrać konfigurację i udostępnimy sprzęt do testów, żeby Twój zespół mógł samodzielnie sprawdzić Dell Pro Max z GB10 w swoich zastosowaniach.