Infolinia: +48 690 479 761 Wsparcie 24/7 - jesteśmy dostępni
PL · EN · DE

Lokalne AI w firmie - stacje NVIDIA GB10: Lenovo ThinkStation PGX i Dell Pro Max

Jeszcze niedawno uruchomienie dużego modelu językowego we własnej serwerowni oznaczało szafę z GPU za setki tysięcy złotych. Superukład NVIDIA GB10 Grace Blackwell zmienił tę arytmetykę: moc obliczeniowa klasy centrum danych mieści się dziś w obudowie wielkości książki, zasilanej ze zwykłego gniazdka. Na tym układzie dwaj producenci zbudowali biurkowe stacje AI - Lenovo ThinkStation PGX i Dell Pro Max GB10 - a my dostarczamy i wdrażamy obie. W tym artykule wyjaśniamy, co te stacje potrafią, dla kogo mają sens i dlaczego argument regulacyjny bywa ważniejszy niż techniczny.

Superkomputer AI na biurku - co się właściwie zmieniło

Sercem obu stacji jest ten sam superukład NVIDIA GB10: 20-rdzeniowy procesor Arm połączony z GPU architektury Blackwell i wspólną, zunifikowaną pamięcią. W praktyce oznacza to trzy przełomy naraz:

  • Moc - około 1 PFLOP w precyzji FP4, czyli wydajność AI, która do niedawna wymagała infrastruktury serwerowej,
  • Pamięć - 128 GB zunifikowanej pamięci wspólnej dla CPU i GPU: cały duży model językowy mieści się w pamięci bez kompromisów,
  • Pobór energii - około 240 W, czyli mniej niż typowa stacja robocza z kartą graficzną; bez klimatyzowanej serwerowni i bez hałasu.

Jedna stacja obsługuje modele do 200 miliardów parametrów, a dwie stacje spięte szybką siecią ConnectX-7 - modele do 405 miliardów. Całość pracuje pod kontrolą NVIDIA DGX OS z kompletnym stosem narzędzi AI - tym samym, który działa w wielkich centrach danych. Jeszcze kilka lat temu podobne możliwości oznaczały dedykowaną serwerownię z odpowiednim zasilaniem i chłodzeniem - dziś wystarcza biurko i gniazdko.

Lenovo ThinkStation PGX i Dell Pro Max GB10 - dwie marki, jedno serce

Parametry obu stacji są bliźniacze, bo wynikają z konstrukcji superukładu. Różnice to detale konfiguracji:

ParametrLenovo ThinkStation PGXDell Pro Max GB10
SuperukładNVIDIA GB10 Grace Blackwell: 20-rdzeniowy CPU Arm + GPU Blackwell
Moc AIdo 1 PFLOP w precyzji FP4
Pamięć128 GB zunifikowanej pamięci LPDDR5x
Dysk1 TB lub 4 TB NVMe z samoszyfrowaniem (SED)4 TB NVMe
SiećConnectX-7, 10GbE, Wi-Fi 7ConnectX-7, 10GbE
Skalowanie2 stacje spięte ConnectX-7 - modele do 405 mld parametrów
SystemNVIDIA DGX OS + stos NVIDIA AI (PyTorch, Jupyter, mikroserwisy NIM)

Obie stacje mają format kompaktowego mini-PC i pracują cicho - stoją na biurku analityka czy prawnika, nie w szafie rack. W praktyce o wyborze marki decydują dostępność, konfiguracja dysku i spójność z resztą floty. Jako partner obu producentów przedstawiamy oferty równolegle, dbamy o dobro klienta i zabiegamy o możliwie najatrakcyjniejszą ofertę finansową - wybór należy do Ciebie. Pełną specyfikację i warianty wdrożenia opisujemy na stronie infrastruktura AI.

Co realnie uruchomisz - w tym polskie modele Bielik i PLLuM

Stacja GB10 to nie ciekawostka dla działu badań, tylko narzędzie do codziennych zadań:

  1. Otwarte modele językowe - Llama, Mistral, Qwen, a przede wszystkim polskie modele Bielik i PLLuM, trenowane na polszczyźnie i dobrze radzące sobie z urzędowym i prawniczym językiem,
  2. RAG na dokumentach firmy - asystent, który odpowiada na pytania o Twoje umowy, procedury i dokumentację, cytując źródła - bez wysyłania ani jednej strony poza organizację,
  3. Firmowy czat dla zespołu - serwowanie modelu wielu użytkownikom naraz, z kontrolą dostępu i logami zapytań do celów audytowych,
  4. Anonimizacja i klasyfikacja - masowe przetwarzanie pism, ekstrakcja danych z formularzy, przygotowanie dokumentów do publikacji,
  5. Fine-tuning i prototypowanie - dostrajanie modeli na danych firmowych w środowisku zgodnym z serwerami GPU, więc praca nie przepada przy skalowaniu.

Argument regulacyjny: KNF, DORA i NIS2 a łańcuch dostaw ICT

Dla wielu organizacji najważniejszy argument za lokalnym AI nie jest techniczny, lecz prawny. Każda chmurowa usługa AI to kolejny zewnętrzny dostawca ICT: podmioty nadzorowane przez KNF muszą uwzględniać go w zarządzaniu ryzykiem zgodnie z DORA, a firmy objęte NIS2 - w analizie bezpieczeństwa łańcucha dostaw. Lokalny model językowy ten problem eliminuje u źródła: stacja stojąca za Twoim firewallem to zasób własny, a nie usługa strony trzeciej - nie rozszerza łańcucha dostaw ICT i nie dodaje kolejnego podmiotu do analizy ryzyka.

To samo dotyczy tajemnicy zawodowej: kancelaria prawna czy dział HR nie mogą wklejać dokumentów do publicznych czatów, ale mogą pytać model, który fizycznie stoi w ich biurze. Nasze doświadczenie w tym obszarze opisujemy na stronie compliance KNF / DORA / NIS2.

Lokalny model językowy odwraca logikę ryzyka: zamiast pilnować, dokąd płyną dane i co robi z nimi kolejny dostawca, po prostu nie wypuszczasz ich z organizacji - a regulatorowi pokazujesz zasób własny, nie umowę z chmurą.

Stacja to początek - o wdrożeniu i hybrydzie

Sprzęt bez wdrożenia zostaje drogim gadżetem. Dlatego dostarczamy stacje razem z pakietem startowym: dobór modelu pod zadania, uruchomienie serwowania (vLLM/Ollama), interfejs czatu z logowaniem firmowym, RAG na repozytoriach dokumentów oraz opieka serwisowa - całość opisana w usłudze Private AI. Ekonomia również działa na korzyść rozwiązania lokalnego: inwestycja w stację jest jednorazowa i nie rośnie wraz z liczbą zapytań, co przy intensywnym użyciu odróżnia ją od rozliczeń za tokeny w chmurze. Warto też pamiętać, że lokalne AI nie wyklucza chmury: częstym wzorcem jest hybryda, w której dane wrażliwe przetwarza stacja GB10, a zadania kreatywne trafiają do Claude AI w wariancie zespołowym.

Od czego zacząć

Najlepiej od jednego procesu, w którym AI realnie oszczędzi czas: analiza umów, odpowiedzi na powtarzalne pisma, wyszukiwanie po dokumentacji. Pilotaż na jednej stacji Lenovo ThinkStation PGX lub Dell Pro Max GB10 pozwala zweryfikować jakość odpowiedzi na własnych danych, zanim zapadnie decyzja o skali. Typowy harmonogram wygląda tak:

  • Tydzień 1 - warsztat use-case'ów i wybór procesu pilotażowego,
  • Tygodnie 2-3 - uruchomienie stacji, modelu i RAG na próbce dokumentów,
  • Tydzień 4 - testy z zespołem, ocena jakości odpowiedzi i decyzja o dalszej skali.

Umów bezpłatną konsultację - pokażemy działające wdrożenia i przygotujemy wycenę obu wariantów w 1 dzień roboczy.

Chcesz zobaczyć lokalny model językowy w działaniu?

Pokażemy działające wdrożenie na stacji GB10 - na przykładach zadań z Twojej branży.

Porozmawiaj o AI w firmie →
Kontakt

Zapytaj o wycenę lub konsultację

Odpowiadamy w ciągu 1-2 dni roboczych. Zapraszamy do kontaktu telefonicznego w godzinach 8-17. Oczywiście Klienci z odpowiednią umową SLA mają dostępną linię 24/7.

Dane firmyDQH Solutions Sp. z o.o.ul. Lęborska 3B, 80-386 GdańskNIP: 584 281 60 64
OddziałyWarszawa
Telefon: +48 690 479 761
Kontakt mailowy: kontakt@dqh.plKontakt z działem handlowym: handlowy@dqh.pl
Administratorem danych jest DQH Solutions Sp. z o.o. Zgłoszenie trafia bezpośrednio do naszego działu handlowego i do wewnętrznego rejestru zapytań. Przysługuje Ci prawo dostępu, sprostowania, usunięcia i sprzeciwu - szczegóły w polityce prywatności. Formularz chroniony przez reCAPTCHA v3 - obowiązują Polityka prywatności i Warunki usługi Google.