AI on-premise · sovereign by design

Twoje dane.Twój model.Twoja infrastruktura.

ONPREMA.ai wdraża generatywną AI w Twojej serwerowni lub prywatnej chmurze. Zero wycieków promptów do zewnętrznych API. Zero uzależnienia od cenników per token. Pełna zgodność z RODO, DORA i AI Act.

0
danych opuszcza Twoją sieć
100%
kontroli nad modelem i wagami
4-8 tyg.
typowy czas pilotażu
Dlaczego on-premise

Chmurowe API to nie jest opcja dla każdego

Sektor publiczny, finansowy, medyczny, obronny i przemysł mają twarde wymogi wobec danych. Budujemy AI, która ich nie łamie.

Suwerenność danych

Dane osobowe, dokumenty prawne, kod źródłowy i tajemnice handlowe nie opuszczają Twojej infrastruktury — nigdy.

Przewidywalny koszt

CAPEX zamiast rosnącego OPEX per token. Znasz koszt wdrożenia i utrzymania z góry, bez zaskoczeń przy wzroście użycia.

Zgodność regulacyjna

RODO, KSC/NIS2, DORA, AI Act, KNF. Modele działają w Twojej strefie zaufania i podlegają Twoim politykom bezpieczeństwa.

Niezależność od dostawcy

Otwarte modele (Llama, Qwen, Mistral, Bielik). Możesz wymienić model bez przepisywania aplikacji — nie jesteś zamknięty w ekosystemie.

Latencja i dostępność

Model działa obok Twoich danych. Brak zależności od publicznego internetu, brak limitów rate limitów zewnętrznego API.

Fine-tuning na Twoich danych

Dostrajamy modele do Twojej domeny, żargonu i procesów. Wynik jest Twoją własnością intelektualną — nie trafia do treningu obcego modelu.

Rozwiązania

Od gotowych integracji po dedykowane wdrożenia

Mamy działające konektory do systemów, których używacie na co dzień. Startujemy od nich i rozbudowujemy pod Twój proces.

Integracja

AI Copilot dla Mint Service Desk

Automatyczna klasyfikacja i priorytetyzacja ticketów, sugerowane odpowiedzi na bazie bazy wiedzy, streszczenia długich wątków, generowanie artykułów KB z rozwiązanych zgłoszeń. Wtyczka działa natywnie w Mint SD (mintsd.com).

  • Redukcja czasu obsługi zgłoszenia o 30-50%
  • Auto-routing do właściwej grupy wsparcia
  • Wykrywanie SLA-at-risk w czasie rzeczywistym
Integracja

Semantyczne wyszukiwanie na Apache SOLR

Hybrydowe wyszukiwanie (BM25 + wektory) nad Twoim indeksem SOLR. Model embeddingów działa lokalnie, indeks pozostaje w Twojej infrastrukturze. RAG bez wysyłania dokumentów do zewnętrznych API.

  • Wyszukiwanie w języku naturalnym w PL i EN
  • Reranking wyników modelem cross-encoder
  • Cytowania ze źródła — pełna audytowalność
Dedykowane

Prywatny asystent AI dla organizacji

Chat oparty o dokumenty firmowe (RAG), z SSO, kontrolą uprawnień na poziomie dokumentu i pełnym audit log. Model, embeddingsy i vector store działają w Twojej sieci.

  • SSO: Entra ID / Keycloak / LDAP
  • Row-level security zgodne z Twoim IAM
  • Audit log każdego promptu i odpowiedzi
Dedykowane

Fine-tuning i modele domenowe

Dostrajamy otwarte modele (Bielik, Llama, Qwen) na Twoich danych — dokumentacji, ticketach, kodzie, protokołach. Cały proces treningu odbywa się na Twoim sprzęcie.

  • LoRA / QLoRA na dostępnym GPU
  • Ewaluacja na Twoich zbiorach testowych
  • Wersjonowanie modeli i eksperymentów (MLflow)
Architektura

Jak to wygląda pod maską

Referencyjny stack, który dostrajamy do Twojego środowiska — bare metal, VMware, OpenShift, Proxmox czy prywatna chmura.

your-network.local
01Warstwa aplikacji
Mint Service DeskPortale wewnętrzneWłasne aplikacje
02Warstwa AI
Orchestrator (LangGraph / własny)RAG pipeline · re-rankerGuardrails · PII redaction
03Warstwa modeli
vLLM / TGI / OllamaLLM: Bielik, Llama, Qwen, MistralEmbeddings · Reranker · Whisper
04Warstwa danych
Apache SOLR (hybrid search)Qdrant / pgvectorMinIO · PostgreSQL
05Warstwa infrastruktury
GPU: NVIDIA H100 / L40S / RTXKubernetes / OpenShift / bare metalMonitoring: Prometheus · Grafana · Loki
Cały ruch AI zamknięty w Twojej strefie sieciowej. Zero wywołań do publicznych API modeli.
Proces wdrożenia

Od pierwszej rozmowy do produkcji

01
step 01

Discovery (1-2 tyg.)

Warsztaty z Twoim zespołem: use case'y, dane, ograniczenia, wymogi compliance, dostępny sprzęt.

02
step 02

PoC / Pilot (4-6 tyg.)

Uruchamiamy wybrany scenariusz na Twojej infrastrukturze. Mierzalne KPI ustalone przed startem.

03
step 03

Produkcja

Hardening, SSO, backup, monitoring, dokumentacja, szkolenie zespołu Twojego działu IT.

04
step 04

Rozwój i wsparcie

SLA, aktualizacje modeli, rozbudowa o kolejne use case'y, Managed Service jeśli chcesz.

O ONPREMA.ai

Marka technologiczna ITSM Software S.A.

ONPREMA.ai to inicjatywa ITSM Software S.A. — polskiego producenta oprogramowania z doświadczeniem w budowie systemów klasy enterprise (m.in. Mint Service Desk używany w Polsce i za granicą). Łączymy wieloletnią praktykę we wdrożeniach on-premise, integracjach i utrzymaniu systemów produkcyjnych z kompetencjami w zakresie generatywnej AI, RAG i MLOps.

itsmsoftware.pl

Polski producent

Kontrakty, wsparcie i dokumentacja po polsku.

Doświadczenie enterprise

Lata wdrożeń w sektorze publicznym i finansowym.

Własne produkty

Mint Service Desk i konektory rozwijane in-house.

Porozmawiajmy

Zaplanuj rozmowę techniczną

30 minut z naszym architektem AI. Bez slajdów sprzedażowych — pytamy o Twój use case, dane i infrastrukturę, mówimy co jest realne.

sales@itsmsoftware.pl