Jeszcze niedawno uruchomienie dużego modelu językowego we własnej serwerowni oznaczało szafę z GPU za setki tysięcy złotych. Superukład NVIDIA GB10 Grace Blackwell zmienił tę arytmetykę: moc obliczeniowa klasy centrum danych mieści się dziś w obudowie wielkości książki, zasilanej ze zwykłego gniazdka. Na tym układzie dwaj producenci zbudowali biurkowe stacje AI - Lenovo ThinkStation PGX i Dell Pro Max GB10 - a my dostarczamy i wdrażamy obie. W tym artykule wyjaśniamy, co te stacje potrafią, dla kogo mają sens i dlaczego argument regulacyjny bywa ważniejszy niż techniczny.
Superkomputer AI na biurku - co się właściwie zmieniło
Sercem obu stacji jest ten sam superukład NVIDIA GB10: 20-rdzeniowy procesor Arm połączony z GPU architektury Blackwell i wspólną, zunifikowaną pamięcią. W praktyce oznacza to trzy przełomy naraz:
- Moc - około 1 PFLOP w precyzji FP4, czyli wydajność AI, która do niedawna wymagała infrastruktury serwerowej,
- Pamięć - 128 GB zunifikowanej pamięci wspólnej dla CPU i GPU: cały duży model językowy mieści się w pamięci bez kompromisów,
- Pobór energii - około 240 W, czyli mniej niż typowa stacja robocza z kartą graficzną; bez klimatyzowanej serwerowni i bez hałasu.
Jedna stacja obsługuje modele do 200 miliardów parametrów, a dwie stacje spięte szybką siecią ConnectX-7 - modele do 405 miliardów. Całość pracuje pod kontrolą NVIDIA DGX OS z kompletnym stosem narzędzi AI - tym samym, który działa w wielkich centrach danych. Jeszcze kilka lat temu podobne możliwości oznaczały dedykowaną serwerownię z odpowiednim zasilaniem i chłodzeniem - dziś wystarcza biurko i gniazdko.
Lenovo ThinkStation PGX i Dell Pro Max GB10 - dwie marki, jedno serce
Parametry obu stacji są bliźniacze, bo wynikają z konstrukcji superukładu. Różnice to detale konfiguracji:
| Parametr | Lenovo ThinkStation PGX | Dell Pro Max GB10 |
|---|---|---|
| Superukład | NVIDIA GB10 Grace Blackwell: 20-rdzeniowy CPU Arm + GPU Blackwell | |
| Moc AI | do 1 PFLOP w precyzji FP4 | |
| Pamięć | 128 GB zunifikowanej pamięci LPDDR5x | |
| Dysk | 1 TB lub 4 TB NVMe z samoszyfrowaniem (SED) | 4 TB NVMe |
| Sieć | ConnectX-7, 10GbE, Wi-Fi 7 | ConnectX-7, 10GbE |
| Skalowanie | 2 stacje spięte ConnectX-7 - modele do 405 mld parametrów | |
| System | NVIDIA DGX OS + stos NVIDIA AI (PyTorch, Jupyter, mikroserwisy NIM) | |
Obie stacje mają format kompaktowego mini-PC i pracują cicho - stoją na biurku analityka czy prawnika, nie w szafie rack. W praktyce o wyborze marki decydują dostępność, konfiguracja dysku i spójność z resztą floty. Jako partner obu producentów przedstawiamy oferty równolegle, dbamy o dobro klienta i zabiegamy o możliwie najatrakcyjniejszą ofertę finansową - wybór należy do Ciebie. Pełną specyfikację i warianty wdrożenia opisujemy na stronie infrastruktura AI.
Co realnie uruchomisz - w tym polskie modele Bielik i PLLuM
Stacja GB10 to nie ciekawostka dla działu badań, tylko narzędzie do codziennych zadań:
- Otwarte modele językowe - Llama, Mistral, Qwen, a przede wszystkim polskie modele Bielik i PLLuM, trenowane na polszczyźnie i dobrze radzące sobie z urzędowym i prawniczym językiem,
- RAG na dokumentach firmy - asystent, który odpowiada na pytania o Twoje umowy, procedury i dokumentację, cytując źródła - bez wysyłania ani jednej strony poza organizację,
- Firmowy czat dla zespołu - serwowanie modelu wielu użytkownikom naraz, z kontrolą dostępu i logami zapytań do celów audytowych,
- Anonimizacja i klasyfikacja - masowe przetwarzanie pism, ekstrakcja danych z formularzy, przygotowanie dokumentów do publikacji,
- Fine-tuning i prototypowanie - dostrajanie modeli na danych firmowych w środowisku zgodnym z serwerami GPU, więc praca nie przepada przy skalowaniu.
Argument regulacyjny: KNF, DORA i NIS2 a łańcuch dostaw ICT
Dla wielu organizacji najważniejszy argument za lokalnym AI nie jest techniczny, lecz prawny. Każda chmurowa usługa AI to kolejny zewnętrzny dostawca ICT: podmioty nadzorowane przez KNF muszą uwzględniać go w zarządzaniu ryzykiem zgodnie z DORA, a firmy objęte NIS2 - w analizie bezpieczeństwa łańcucha dostaw. Lokalny model językowy ten problem eliminuje u źródła: stacja stojąca za Twoim firewallem to zasób własny, a nie usługa strony trzeciej - nie rozszerza łańcucha dostaw ICT i nie dodaje kolejnego podmiotu do analizy ryzyka.
To samo dotyczy tajemnicy zawodowej: kancelaria prawna czy dział HR nie mogą wklejać dokumentów do publicznych czatów, ale mogą pytać model, który fizycznie stoi w ich biurze. Nasze doświadczenie w tym obszarze opisujemy na stronie compliance KNF / DORA / NIS2.
Lokalny model językowy odwraca logikę ryzyka: zamiast pilnować, dokąd płyną dane i co robi z nimi kolejny dostawca, po prostu nie wypuszczasz ich z organizacji - a regulatorowi pokazujesz zasób własny, nie umowę z chmurą.
Stacja to początek - o wdrożeniu i hybrydzie
Sprzęt bez wdrożenia zostaje drogim gadżetem. Dlatego dostarczamy stacje razem z pakietem startowym: dobór modelu pod zadania, uruchomienie serwowania (vLLM/Ollama), interfejs czatu z logowaniem firmowym, RAG na repozytoriach dokumentów oraz opieka serwisowa - całość opisana w usłudze Private AI. Ekonomia również działa na korzyść rozwiązania lokalnego: inwestycja w stację jest jednorazowa i nie rośnie wraz z liczbą zapytań, co przy intensywnym użyciu odróżnia ją od rozliczeń za tokeny w chmurze. Warto też pamiętać, że lokalne AI nie wyklucza chmury: częstym wzorcem jest hybryda, w której dane wrażliwe przetwarza stacja GB10, a zadania kreatywne trafiają do Claude AI w wariancie zespołowym.
Od czego zacząć
Najlepiej od jednego procesu, w którym AI realnie oszczędzi czas: analiza umów, odpowiedzi na powtarzalne pisma, wyszukiwanie po dokumentacji. Pilotaż na jednej stacji Lenovo ThinkStation PGX lub Dell Pro Max GB10 pozwala zweryfikować jakość odpowiedzi na własnych danych, zanim zapadnie decyzja o skali. Typowy harmonogram wygląda tak:
- Tydzień 1 - warsztat use-case'ów i wybór procesu pilotażowego,
- Tygodnie 2-3 - uruchomienie stacji, modelu i RAG na próbce dokumentów,
- Tydzień 4 - testy z zespołem, ocena jakości odpowiedzi i decyzja o dalszej skali.
Umów bezpłatną konsultację - pokażemy działające wdrożenia i przygotujemy wycenę obu wariantów w 1 dzień roboczy.