Skip to content
Annatech_

Prywatne AI / lokalne LLM

Poważne możliwości AI. Twój sprzęt, Twoje dane, kropka.

Dla firm, których dane nie mogą trafić do chmurowego dostawcy AI - z powodu regulacji, umów albo zdrowego rozsądku. Modele open-weight na infrastrukturze, którą kontrolujesz, zbudowane w platformę, z której Twój zespół będzie naprawdę korzystał.

English version: Private AI / Local LLM

Oferta

Co zawiera prywatna platforma AI

Współczesne modele open-weight wystarczają do czatu, pracy z dokumentami, wsparcia researchu i agentów w większości zastosowań biznesowych - pod warunkiem, że ktoś porządnie zbuduje wokół nich platformę: serwowanie modeli dopasowane do sprzętu, frontend, który pracownicy zaakceptują, wyszukiwanie po własnych dokumentach, dostęp do narzędzi pod realnymi uprawnieniami i operacje, które przetrwają awarię dysku w sobotę.

To jest ten pakiet. Nie notatnik proof-of-concept, tylko działający system z właścicielem, polityką aktualizacji i śladem audytowym. Pytania o rezydencję danych i RODO stają się krótkie, kiedy uczciwa odpowiedź brzmi: nic nie wychodzi poza budynek.

wywołań zewnętrznych API AI - prompty i dokumenty nie opuszczają Twojej sieci
0
tokenów kontekstu na własnych modelach open-weight
262K
narzędzi agentów za wielopoziomową autoryzacją
30+
lokalny tor głosowy - Whisper STT, Piper TTS
PL + EN

Dlaczego my

Używamy tego, co sprzedajemy

Nasza własna działalność działa na platformie, którą oferujemy: inferencja GPU na dwóch backendach, wielomodelowy frontend czatu, warstwa narzędzi agentów z poziomami uprawnień, lokalny głos, generowanie obrazów i samonaprawiająca się infrastruktura - bez żadnego zewnętrznego API AI. To nie ćwiczenie laboratoryjne: platforma codziennie odpowiada na nasze pytania i uruchamia nasze automatyzacje, a hartowały ją prawdziwe awarie, nie hipotetyczne.

Kiedy wymiarujemy Twoje wdrożenie, rekomendacje biorą się z eksploatacji tego stosu - które kwantyzacje się trzymają, gdzie długość kontekstu naprawdę ma znaczenie, co pęka pod presją pamięci - a nie ze slajdu z benchmarkiem producenta.

YOUR NETWORK - NOTHING LEAVES IT external AI APIs: 0 GPU inference node 4x RTX A5000 · 98 GB VRAMvLLM · FP8 27B · 262K ctx Apple-silicon node MoE model · 163K ctxlow-power redundancy Local voice Whisper STT · Piper TTSPolish + English Chat & agent frontend Open WebUI · 12 curated model presets Permission tiers LAN = admin · remote = tokenrate limits · deny-lists MCP tool layer — 30+ tools research · documents · images · facility integrations Operations Proxmox 2-node · watchdogsVLAN segmentation · backups
Platforma referencyjna w dzisiejszej postaci - dostosowywana per klient do sprzętu, polityki modeli i wymagań zgodności.
private AI platform — live inventory
$ platform status
inference backends   2   gpu: 4x A5000 / vLLM / FP8 27B / 262K ctx · apple-silicon: MoE / 163K ctx
model presets        12  per-task system prompts + parameters
mcp tools            30+ research · documents · images · facility integrations
auth tiers           2   lan = admin scope · remote = bearer token + rate limits
voice                PL EN whisper stt · piper tts, fully local
external AI APIs     0   no prompt, document or token leaves the network

Counts and configuration are the real, operating platform.

Prywatne AI / Infrastruktura

Prywatna platforma AI bez zewnętrznych API AI

Inferencja LLM na dwóch backendach, 30+ narzędzi agentów za wielopoziomową autoryzacją, głos, generowanie obrazów i samonaprawiająca się infrastruktura - kompletna platforma AI, z której żaden prompt, dokument ani token nie opuszcza sieci.

Studium przypadku (po angielsku)

Dla kogo

  • Kancelarie prawne, praktyki medyczne, firmy finansowe i instytucje publiczne z obowiązkiem poufności
  • Producenci chroniący know-how procesowe i dane dostawców
  • Każda firma, której umowy zabraniają przetwarzania danych przez strony trzecie
  • Zespoły, które chcą dźwigni AI bez ekonomii SaaS liczonej od stanowiska i od tokena

Co dostajesz

  • Serwowanie modeli (vLLM lub równoważne) dobrane do sprzętu i budżetu
  • Frontend czatu z gotowymi ustawieniami modeli per zadanie
  • Wyszukiwanie po Twoich dokumentach; narzędzia agentów pod poziomami uprawnień
  • Kopie zapasowe, monitoring, polityka aktualizacji - i dokumentacja

Metoda

Kształt wdrożenia

  1. 01

    Wykonalność i wymiarowanie

    Twoje przypadki użycia zmapowane na klasy modeli i sprzęt: co dziś działa dobrze lokalnie, co wymaga węzła GPU, co naprawdę jeszcze się nie mieści. Uczciwe odpowiedzi w cenie.

  2. 02

    Pilot

    Działająca platforma na Twojej infrastrukturze albo na naszej jako szablonie: serwowanie inferencji, frontend czatu, podłączone Twoje dokumenty, wymuszony Twój model uprawnień.

  3. 03

    Produkcja

    Hardening, kopie zapasowe, monitoring, polityka aktualizacji modeli, zarządzanie narzędziami - warstwa operacyjna, która odróżnia platformę od eksperymentu.

  4. 04

    Przekazanie albo opieka

    Twój zespół przeszkolony do samodzielnej eksploatacji albo prowadzimy platformę razem z Tobą. Dokumentacja, z której Twoi administratorzy naprawdę skorzystają.

Twoje dane nie powinny być czyimś zbiorem treningowym

Opisz przypadek użycia i ograniczenia - liczbę użytkowników, wolumeny dokumentów, wymagania zgodności. Dostaniesz realistyczną rekomendację sprzętu i modeli, łącznie z tym, co przemawia przeciwko wdrożeniu lokalnemu. Po polsku lub po angielsku.