Infolinia: +48 690 479 761 Wsparcie 24/7 - jesteśmy dostępni
PL · EN · DE

Infrastruktura AI - sztuczna inteligencja za Twoim firewallem

Możliwości dużych modeli językowych bez wysyłania danych poza firmę. Dostarczamy stacje AI i serwery GPU pod lokalne modele (LLM), wdrażamy środowisko i szkolimy zespół - zgodnie z RODO, DORA i tajemnicą przedsiębiorstwa.

Porozmawiaj o AI w firmie
Dlaczego lokalnie

Kiedy AI on-premise wygrywa z chmurą

Dane zostają w firmie

Umowy, dane klientów, dokumentacja techniczna - nic nie trafia do zewnętrznych dostawców. Kluczowe dla podmiotów pod RODO, DORA i NIS2 oraz firm chroniących know-how.

Przewidywalne koszty

Przy intensywnym użyciu jednorazowa inwestycja w sprzęt bywa tańsza niż miesięczne rachunki za tokeny - i nie rośnie wraz z liczbą zapytań.

Niezależność

Model działa bez internetu, bez limitów dostawcy i bez ryzyka, że usługa zmieni cennik albo zniknie z rynku.

Portfolio

Sprzęt i wdrożenie

Stacje AI

Kompaktowe maszyny do pracy z modelami lokalnie - na biurku, nie w chmurze.

  • Stacje klasy desktop AI z dużą pamięcią zunifikowaną (m.in. Dell GB10)
  • Mobilne stacje robocze z NPU/GPU do pracy z AI w terenie
  • Idealne do pilotaży: RAG na dokumentach, asystenci wewnętrzni
Zapytaj o stację AI →

Serwery GPU pod LLM

Dla zespołów i całych firm - wielu użytkowników, większe modele, stała dostępność.

  • Serwery z GPU NVIDIA (m.in. Lenovo ThinkSystem i Dell PowerEdge)
  • Środowisko inferencyjne: vLLM/Ollama, kontrola dostępu, logowanie
  • Integracja z infrastrukturą: sieć, zasilanie, chłodzenie
Zapytaj o serwer GPU →

Doradztwo: AI za firewallem

Zanim kupisz sprzęt - ustalmy, co AI ma robić i czy się spina biznesowo.

  • Warsztat use-case'ów: gdzie AI realnie oszczędzi czas w Twojej firmie
  • Analiza zgodności: RODO, DORA, tajemnica przedsiębiorstwa
  • Pilotaż na wybranym procesie przed pełnym wdrożeniem
  • Szkolenia zespołu i rozwój kolejnych zastosowań
Usługa: Private AI →
FAQ

Najczęstsze pytania o infrastrukturę AI

Po co firmie lokalna infrastruktura AI, skoro są usługi chmurowe?
Trzy powody: dane (dokumenty, umowy, dane klientów nie opuszczają firmy - istotne przy RODO, DORA i tajemnicy przedsiębiorstwa), koszty (przy intensywnym użyciu stała inwestycja w sprzęt bywa tańsza niż opłaty za tokeny) oraz niezależność (model działa także bez internetu i bez zmian cenników dostawców).
Jaki sprzęt jest potrzebny do uruchomienia lokalnego modelu językowego?
Do modeli klasy 7-70B parametrów wystarczy stacja AI z odpowiednią ilością zunifikowanej pamięci lub serwer z 1-2 GPU. Większe modele i wielu równoczesnych użytkowników wymagają serwera z kilkoma GPU. Dobór zaczynamy od pytania „co model ma robić i dla ilu osób" - nie od katalogu sprzętu.
Czy lokalne AI poradzi sobie z dokumentami po polsku?
Tak - otwarte modele językowe dobrze radzą sobie z polszczyzną, a w połączeniu z techniką RAG (przeszukiwanie własnej bazy dokumentów) potrafią odpowiadać na pytania o Twoje umowy, procedury czy dokumentację techniczną, cytując źródła.
1 PFLOPmocy AI (FP4) na biurku - klasa superkomputera
128 GBzunifikowanej pamięci dla modelu
200 mldparametrów LLM na 1 stacji (405 mld na 2 połączonych)
240 Wpobór mocy - zwykłe gniazdko zamiast serwerowni
Dell Pro Max GB10 · Lenovo ThinkStation PGX

Superkomputer AI wielkości książki - do wyboru w dwóch markach

NVIDIA zamknęła architekturę Grace Blackwell (znaną z centrów danych DGX) w superukładzie GB10 - a Lenovo i Dell zbudowały na nim biurkowe stacje AI. Dostarczamy obie: Lenovo ThinkStation PGX i Dell Pro Max GB10. Parametry są bliźniacze - wybór marki należy do Ciebie.

ParametrDell Pro Max GB10Lenovo ThinkStation PGX
SuperukładNVIDIA GB10 Grace Blackwell - 20-rdzeniowy CPU Arm (10× Cortex-X925 + 10× Cortex-A725) + GPU Blackwell (6144 rdzeni CUDA, Tensor Cores 5. gen.)
Moc AIdo 1 petaFLOPa w precyzji FP4
Pamięć128 GB LPDDR5x zunifikowanej (wspólnej dla CPU i GPU), 273 GB/s - cały duży model mieści się w pamięci
Dysk4 TB NVMe1 TB lub 4 TB NVMe z samoszyfrowaniem (SED)
SiećConnectX-7, 10GbEConnectX-7 (2× QSFP), 10GbE, Wi-Fi 7, 3× USB4
Skalowanie2 stacje spięte przez ConnectX-7 obsługują modele do 405 mld parametrów
SystemNVIDIA DGX OS (Ubuntu) + kompletny stos NVIDIA AI: PyTorch, Jupyter, mikroserwisy NIM
Rozmiar / pobórformat mini-PC (mieści się w dłoniach), ~240 W - bez klimatyzowanej serwerowni, bez hałasu

Co to oznacza w praktyce? Moc obliczeniowa, która jeszcze niedawno wymagała szafy serwerowej z GPU za setki tysięcy złotych, stoi dziś na biurku, zasilana ze zwykłego gniazdka - a dane, które przetwarza, nigdy nie opuszczają Twojej organizacji.

Możliwości

Co realnie uruchomisz na tych stacjach

Otwarte modele LLM - także polskie

Llama, Mistral, Qwen, GPT-OSS oraz polskie modele Bielik i PLLuM, trenowane na polszczyźnie - do 200 mld parametrów. Modele klasy 70B (jakość porównywalna z komercyjnymi czatami) pracują z komfortowym zapasem.

RAG - asystent na Twoich dokumentach

Model połączony z bazą dokumentów organizacji (umowy, procedury, orzecznictwo, dokumentacja) odpowiada na pytania pracowników i cytuje źródła - bez wysyłania ani jednej strony poza firmę.

Wielu użytkowników naraz

Serwowanie przez vLLM/Ollama z kontrolą dostępu: jeden „firmowy ChatGPT" dla całego zespołu, z logowaniem zapytań do celów audytowych i rozliczalności.

Anonimizacja i klasyfikacja

Masowe przetwarzanie dokumentów: anonimizacja danych osobowych przed publikacją, klasyfikacja pism przychodzących, ekstrakcja danych z formularzy - lokalnie, bez ryzyka wycieku.

Fine-tuning i prototypowanie

Dostrajanie modeli na danych firmowych i rozwój własnych aplikacji AI w środowisku DGX OS - ten sam stos oprogramowania, co w wielkich centrach danych NVIDIA.

Ścieżka rozwoju

Zaczynasz od jednej stacji, spinasz dwie (405 mld parametrów), a gdy urośniesz - ten sam kod przenosi się na serwery GPU lub DGX Cloud. Inwestycja się nie marnuje.

Dla kogo to rozwiązanie

AI, które nie wychodzi poza organizację - sektor po sektorze

Publiczne czaty AI odpadają tam, gdzie dane są objęte tajemnicą, nadzorem lub regulacjami. Lokalny LLM na stacji GB10/PGX rozwiązuje ten problem u źródła: model stoi za Twoim firewallem, a dane nigdy nie trafiają do zewnętrznego dostawcy.

Podmioty nadzorowane przez KNF (DORA)

Bank spółdzielczy, TFI czy ubezpieczyciel nie musi wpisywać kolejnego dostawcy chmurowego do rejestru informacji DORA - lokalna AI to zasób własny, nie usługa ICT strony trzeciej.

  • Analiza umów kredytowych i regulaminów (setki stron w pamięci modelu)
  • Asystent compliance: „co na to nasza procedura i rekomendacja KNF?"
  • Wsparcie raportowania i przygotowania odpowiedzi dla nadzoru
  • Dane klientów i tajemnica bankowa - fizycznie w Twojej serwerowni
Nasza praktyka KNF/DORA →

Urzędy i administracja publiczna

Dane obywateli nie mogą krążyć po zagranicznych chmurach - a urzędnicy toną w pismach. Lokalny asystent AI łączy jedno z drugim.

  • Asystent urzędnika: szkice decyzji i odpowiedzi zgodne z KPA
  • Anonimizacja dokumentów przed publikacją w BIP
  • Obsługa wniosków o informację publiczną - wyszukiwanie po zasobie urzędu
  • Polskie modele (Bielik, PLLuM) - urzędowa polszczyzna bez kalek językowych
Zapytaj o wdrożenie dla JST →

Kancelarie prawne i notariusze

Tajemnica adwokacka i radcowska wyklucza wklejanie akt do publicznych czatów. Lokalny model czyta akta - i nikt poza kancelarią ich nie widzi.

  • Analiza akt sprawy: chronologia, sprzeczności, luki dowodowe
  • Due diligence: przegląd setek umów pod ryzykowne klauzule
  • Wyszukiwanie po własnym archiwum pism i orzecznictwie
  • Szkice pism procesowych w stylu kancelarii
Zapytaj o wdrożenie dla kancelarii →

Firmy objęte NIS2

Art. 21 NIS2 każe pilnować łańcucha dostaw ICT - każdy zewnętrzny dostawca AI to nowy element do analizy ryzyka. Lokalny model ten problem eliminuje.

  • Wiedza operacyjna i dokumentacja bezpieczeństwa pod ręką (RAG)
  • Wsparcie analizy incydentów i przygotowania zgłoszeń (24h/72h)
  • Zero nowych podmiotów w łańcuchu dostaw - prostszy audyt
  • Logi zapytań jako materiał rozliczalności
Co powinieneś wiedzieć o NIS2 →
Wdrożenie z DQH

Od pudełka do działającego asystenta - bierzemy to na siebie

Stacja GB10/PGX to sprzęt deweloperski z systemem DGX OS (Ubuntu) - bez wdrożenia zostaje drogim gadżetem. Nasz pakiet startowy:

Dobór i dostawa

Dell Pro Max GB10 lub ThinkStation PGX (porównamy 1:1), konfiguracja dysku SED i sieci - z opcją drugiego węzła pod większe modele.

Model i serwowanie

Dobór LLM pod zadania (w tym polskie Bielik/PLLuM), uruchomienie vLLM/Ollama, interfejs czatu dla pracowników z logowaniem firmowym.

RAG na dokumentach

Podpięcie repozytoriów (udziały, SharePoint, DMS), indeksacja, testy jakości odpowiedzi z zespołem - model cytuje źródła.

Bezpieczeństwo i opieka

Kontrola dostępu, logi audytowe, aktualizacje stosu AI i monitoring stacji w ramach umowy serwisowej.

FAQ

Najczęstsze pytania o stacje GB10 / PGX

Dell Pro Max GB10 czy Lenovo ThinkStation PGX - co wybrać?
Serce jest identyczne (superukład NVIDIA GB10, 128 GB, 1 PFLOP FP4) - różnice to detale: PGX oferuje wariant 1 TB z dyskiem samoszyfrującym i Wi-Fi 7, Dell standardowo 4 TB. W praktyce decydują cena dnia, dostępność i preferencja marki w Twojej flocie. Jako partner obu producentów przedstawimy oferty równolegle - wybór należy do Ciebie.
Czy lokalny model dorówna ChatGPT?
Do zadań firmowych - tak. Otwarte modele klasy 70-120B w połączeniu z RAG na Twoich dokumentach często odpowiadają lepiej niż publiczny czat, bo znają kontekst organizacji. Do najtrudniejszych zadań kreatywnych chmurowe modele frontier wciąż prowadzą - dlatego częstym wzorcem jest hybryda: dane wrażliwe lokalnie, reszta w Claude Team/Enterprise.
Ile kosztuje takie wdrożenie?
Stacja GB10/PGX to koszt rzędu kilkunastu-dwudziestu kilku tysięcy złotych netto (zależnie od konfiguracji i kursu) - ułamek ceny serwera GPU o podobnych możliwościach dla LLM. Do tego wdrożenie i opieka wg zakresu. Konkretną wycenę z porównaniem obu marek przygotujemy w 1 dzień roboczy.
Czy 128 GB pamięci wystarczy dla naszej firmy?
Dla asystenta RAG i modeli do ~120B parametrów - z zapasem. Gdy potrzeba więcej: dwie stacje spięte ConnectX-7 obsłużą modele do 405B, a wyrośnięcie ponad to oznacza naturalne przejście na serwery GPU - z tym samym oprogramowaniem, więc bez wyrzucania dotychczasowej pracy.
Kontakt

Zapytaj o wycenę lub konsultację

Odpowiadamy w ciągu 1-2 dni roboczych. Zapraszamy do kontaktu telefonicznego w godzinach 8-17. Oczywiście Klienci z odpowiednią umową SLA mają dostępną linię 24/7.

Dane firmyDQH Solutions Sp. z o.o.ul. Lęborska 3B, 80-386 GdańskNIP: 584 281 60 64
OddziałyWarszawa
Telefon: +48 690 479 761
Kontakt mailowy: kontakt@dqh.plKontakt z działem handlowym: handlowy@dqh.pl
Administratorem danych jest DQH Solutions Sp. z o.o. Zgłoszenie trafia bezpośrednio do naszego działu handlowego i do wewnętrznego rejestru zapytań. Przysługuje Ci prawo dostępu, sprostowania, usunięcia i sprzeciwu - szczegóły w polityce prywatności. Formularz chroniony przez reCAPTCHA v3 - obowiązują Polityka prywatności i Warunki usługi Google.