Jaki model AI zamieszka na Twoim serwerze? Wybierz świadomie.
Modele open source, które uruchamiamy dla klientów na kartach NVIDIA — od polskiego Bielika po modele klasy największych systemów komercyjnych. Poniżej uczciwie: co każdy robi dobrze, w czym jest słabszy i do czego byśmy go użyli. Bez żargonu.
Ten sam model może działać u nas, u Ciebie w firmie albo na wynajętym dedyku — dane zawsze zostają w Polsce.
Większy model myśli głębiej, mniejszy odpowiada szybciej i taniej. Do 80% firmowych zadań wystarczy model średni.
Mówi, z czym porównać możliwości modelu w świecie narzędzi, które znasz (ChatGPT, Gemini). To orientacja, nie obietnica — model dobierzemy do zadania na bezpłatnej konsultacji.
{{ grp.title }}
Uczciwa granica: największe modele świata open source (np. pełny DeepSeek R1, ~671 mld parametrów) wymagają klastra kilku–kilkunastu kart. Takie wdrożenia wyceniamy indywidualnie w konfiguracji multi-GPU — a większości firm po prostu nie są potrzebne.
Która karta na co wystarczy
| Serwer | Co realnie uruchomisz | Typowe zastosowanie |
|---|---|---|
| Dedyk GPU (RTX 5090, 32 GB) — 1 599 zł/mc | Bielik, PLLuM, Qwen3 32B, Mistral 24B, Gemma 27B, Whisper, modele widzące, generator grafik | firmowy czat + asystent dokumentów do ~50 osób; transkrypcje; OCR |
| Dedyk GPU PRO (RTX PRO 6000, 96 GB) — 9 899 zł/mc | wszystko powyżej ORAZ Llama 3.3 70B, gpt-oss-120B, DeepSeek R1 70B | poważne analizy prawne/finansowe, RAG na dziesiątkach tysięcy stron, kilka modeli naraz |
| 2× RTX PRO 6000 (192 GB) — konfigurator | wszystko powyżej ORAZ Qwen3 235B — czołówka open source | „supermózg" dla firm, które chcą maksimum bez chmury |
| GPU na godziny — od 19 zł/h | dowolny model z katalogu, na próbę | przetestuj zanim zdecydujesz |
Model to silnik. Poniżej — gotowe maszyny.
Każdą usługę uruchamiamy na modelach z katalogu, na serwerze w Polsce. W ramach wdrożenia (od 19 900 zł) łączymy dowolne z poniższych; utrzymanie od 1 990 zł/mies.