Infrastruktura AI - sztuczna inteligencja za Twoim firewallem
Możliwości dużych modeli językowych bez wysyłania danych poza firmę. Dostarczamy stacje AI i serwery GPU pod lokalne modele (LLM), wdrażamy środowisko i szkolimy zespół - zgodnie z RODO, DORA i tajemnicą przedsiębiorstwa.
Porozmawiaj o AI w firmieKiedy AI on-premise wygrywa z chmurą
Dane zostają w firmie
Umowy, dane klientów, dokumentacja techniczna - nic nie trafia do zewnętrznych dostawców. Kluczowe dla podmiotów pod RODO, DORA i NIS2 oraz firm chroniących know-how.
Przewidywalne koszty
Przy intensywnym użyciu jednorazowa inwestycja w sprzęt bywa tańsza niż miesięczne rachunki za tokeny - i nie rośnie wraz z liczbą zapytań.
Niezależność
Model działa bez internetu, bez limitów dostawcy i bez ryzyka, że usługa zmieni cennik albo zniknie z rynku.
Sprzęt i wdrożenie
Stacje AI
Kompaktowe maszyny do pracy z modelami lokalnie - na biurku, nie w chmurze.
- Stacje klasy desktop AI z dużą pamięcią zunifikowaną (m.in. Dell GB10)
- Mobilne stacje robocze z NPU/GPU do pracy z AI w terenie
- Idealne do pilotaży: RAG na dokumentach, asystenci wewnętrzni
Serwery GPU pod LLM
Dla zespołów i całych firm - wielu użytkowników, większe modele, stała dostępność.
- Serwery z GPU NVIDIA (m.in. Lenovo ThinkSystem i Dell PowerEdge)
- Środowisko inferencyjne: vLLM/Ollama, kontrola dostępu, logowanie
- Integracja z infrastrukturą: sieć, zasilanie, chłodzenie
Doradztwo: AI za firewallem
Zanim kupisz sprzęt - ustalmy, co AI ma robić i czy się spina biznesowo.
- Warsztat use-case'ów: gdzie AI realnie oszczędzi czas w Twojej firmie
- Analiza zgodności: RODO, DORA, tajemnica przedsiębiorstwa
- Pilotaż na wybranym procesie przed pełnym wdrożeniem
- Szkolenia zespołu i rozwój kolejnych zastosowań
Najczęstsze pytania o infrastrukturę AI
Po co firmie lokalna infrastruktura AI, skoro są usługi chmurowe?
Jaki sprzęt jest potrzebny do uruchomienia lokalnego modelu językowego?
Czy lokalne AI poradzi sobie z dokumentami po polsku?
Superkomputer AI wielkości książki - do wyboru w dwóch markach
NVIDIA zamknęła architekturę Grace Blackwell (znaną z centrów danych DGX) w superukładzie GB10 - a Lenovo i Dell zbudowały na nim biurkowe stacje AI. Dostarczamy obie: Lenovo ThinkStation PGX i Dell Pro Max GB10. Parametry są bliźniacze - wybór marki należy do Ciebie.
| Parametr | Dell Pro Max GB10 | Lenovo ThinkStation PGX |
|---|---|---|
| Superukład | NVIDIA GB10 Grace Blackwell - 20-rdzeniowy CPU Arm (10× Cortex-X925 + 10× Cortex-A725) + GPU Blackwell (6144 rdzeni CUDA, Tensor Cores 5. gen.) | |
| Moc AI | do 1 petaFLOPa w precyzji FP4 | |
| Pamięć | 128 GB LPDDR5x zunifikowanej (wspólnej dla CPU i GPU), 273 GB/s - cały duży model mieści się w pamięci | |
| Dysk | 4 TB NVMe | 1 TB lub 4 TB NVMe z samoszyfrowaniem (SED) |
| Sieć | ConnectX-7, 10GbE | ConnectX-7 (2× QSFP), 10GbE, Wi-Fi 7, 3× USB4 |
| Skalowanie | 2 stacje spięte przez ConnectX-7 obsługują modele do 405 mld parametrów | |
| System | NVIDIA DGX OS (Ubuntu) + kompletny stos NVIDIA AI: PyTorch, Jupyter, mikroserwisy NIM | |
| Rozmiar / pobór | format mini-PC (mieści się w dłoniach), ~240 W - bez klimatyzowanej serwerowni, bez hałasu | |
Co to oznacza w praktyce? Moc obliczeniowa, która jeszcze niedawno wymagała szafy serwerowej z GPU za setki tysięcy złotych, stoi dziś na biurku, zasilana ze zwykłego gniazdka - a dane, które przetwarza, nigdy nie opuszczają Twojej organizacji.
Co realnie uruchomisz na tych stacjach
Otwarte modele LLM - także polskie
Llama, Mistral, Qwen, GPT-OSS oraz polskie modele Bielik i PLLuM, trenowane na polszczyźnie - do 200 mld parametrów. Modele klasy 70B (jakość porównywalna z komercyjnymi czatami) pracują z komfortowym zapasem.
RAG - asystent na Twoich dokumentach
Model połączony z bazą dokumentów organizacji (umowy, procedury, orzecznictwo, dokumentacja) odpowiada na pytania pracowników i cytuje źródła - bez wysyłania ani jednej strony poza firmę.
Wielu użytkowników naraz
Serwowanie przez vLLM/Ollama z kontrolą dostępu: jeden „firmowy ChatGPT" dla całego zespołu, z logowaniem zapytań do celów audytowych i rozliczalności.
Anonimizacja i klasyfikacja
Masowe przetwarzanie dokumentów: anonimizacja danych osobowych przed publikacją, klasyfikacja pism przychodzących, ekstrakcja danych z formularzy - lokalnie, bez ryzyka wycieku.
Fine-tuning i prototypowanie
Dostrajanie modeli na danych firmowych i rozwój własnych aplikacji AI w środowisku DGX OS - ten sam stos oprogramowania, co w wielkich centrach danych NVIDIA.
Ścieżka rozwoju
Zaczynasz od jednej stacji, spinasz dwie (405 mld parametrów), a gdy urośniesz - ten sam kod przenosi się na serwery GPU lub DGX Cloud. Inwestycja się nie marnuje.
AI, które nie wychodzi poza organizację - sektor po sektorze
Publiczne czaty AI odpadają tam, gdzie dane są objęte tajemnicą, nadzorem lub regulacjami. Lokalny LLM na stacji GB10/PGX rozwiązuje ten problem u źródła: model stoi za Twoim firewallem, a dane nigdy nie trafiają do zewnętrznego dostawcy.
Podmioty nadzorowane przez KNF (DORA)
Bank spółdzielczy, TFI czy ubezpieczyciel nie musi wpisywać kolejnego dostawcy chmurowego do rejestru informacji DORA - lokalna AI to zasób własny, nie usługa ICT strony trzeciej.
- Analiza umów kredytowych i regulaminów (setki stron w pamięci modelu)
- Asystent compliance: „co na to nasza procedura i rekomendacja KNF?"
- Wsparcie raportowania i przygotowania odpowiedzi dla nadzoru
- Dane klientów i tajemnica bankowa - fizycznie w Twojej serwerowni
Urzędy i administracja publiczna
Dane obywateli nie mogą krążyć po zagranicznych chmurach - a urzędnicy toną w pismach. Lokalny asystent AI łączy jedno z drugim.
- Asystent urzędnika: szkice decyzji i odpowiedzi zgodne z KPA
- Anonimizacja dokumentów przed publikacją w BIP
- Obsługa wniosków o informację publiczną - wyszukiwanie po zasobie urzędu
- Polskie modele (Bielik, PLLuM) - urzędowa polszczyzna bez kalek językowych
Kancelarie prawne i notariusze
Tajemnica adwokacka i radcowska wyklucza wklejanie akt do publicznych czatów. Lokalny model czyta akta - i nikt poza kancelarią ich nie widzi.
- Analiza akt sprawy: chronologia, sprzeczności, luki dowodowe
- Due diligence: przegląd setek umów pod ryzykowne klauzule
- Wyszukiwanie po własnym archiwum pism i orzecznictwie
- Szkice pism procesowych w stylu kancelarii
Firmy objęte NIS2
Art. 21 NIS2 każe pilnować łańcucha dostaw ICT - każdy zewnętrzny dostawca AI to nowy element do analizy ryzyka. Lokalny model ten problem eliminuje.
- Wiedza operacyjna i dokumentacja bezpieczeństwa pod ręką (RAG)
- Wsparcie analizy incydentów i przygotowania zgłoszeń (24h/72h)
- Zero nowych podmiotów w łańcuchu dostaw - prostszy audyt
- Logi zapytań jako materiał rozliczalności
Od pudełka do działającego asystenta - bierzemy to na siebie
Stacja GB10/PGX to sprzęt deweloperski z systemem DGX OS (Ubuntu) - bez wdrożenia zostaje drogim gadżetem. Nasz pakiet startowy:
Dobór i dostawa
Dell Pro Max GB10 lub ThinkStation PGX (porównamy 1:1), konfiguracja dysku SED i sieci - z opcją drugiego węzła pod większe modele.
Model i serwowanie
Dobór LLM pod zadania (w tym polskie Bielik/PLLuM), uruchomienie vLLM/Ollama, interfejs czatu dla pracowników z logowaniem firmowym.
RAG na dokumentach
Podpięcie repozytoriów (udziały, SharePoint, DMS), indeksacja, testy jakości odpowiedzi z zespołem - model cytuje źródła.
Bezpieczeństwo i opieka
Kontrola dostępu, logi audytowe, aktualizacje stosu AI i monitoring stacji w ramach umowy serwisowej.
Najczęstsze pytania o stacje GB10 / PGX
Dell Pro Max GB10 czy Lenovo ThinkStation PGX - co wybrać?
Czy lokalny model dorówna ChatGPT?
Ile kosztuje takie wdrożenie?
Czy 128 GB pamięci wystarczy dla naszej firmy?
Zapytaj o wycenę lub konsultację
Odpowiadamy w ciągu 1-2 dni roboczych. Zapraszamy do kontaktu telefonicznego w godzinach 8-17. Oczywiście Klienci z odpowiednią umową SLA mają dostępną linię 24/7.