■ Modele językowe · LLM
Bielik, PLLuM, Llama, Qwen.Na Twoich GPU, w Polsce.
Uruchamiamy polskie i otwarte modele językowe na dedykowanej infrastrukturze, serwujemy je przez vLLM i łączymy z wiedzą firmy przez RAG. Wybierasz model do zadania — nie jednego dostawcę na zawsze.
# API zgodne z OpenAI, model w Polsce curl https://api.suwerenai.pl/v1/chat/completions \ -H "Authorization: Bearer $KEY" \ -d '{"model": "bielik", "messages": [{"role": "user", "content": "Streść umowę"}]}'
■ Katalog
Modele, które uruchamiamy dla firm
Każdy asystent może korzystać z innego modelu. Dobór potwierdzamy testami na Twoich dokumentach, a nie na benchmarkach z internetu.
| Model | Pochodzenie | Najlepszy do | Rozmiary |
|---|---|---|---|
| Bielik🇵🇱 | Polska · SpeakLeash, ACK Cyfronet AGH | Polska korespondencja, dokumenty, obsługa klienta, teksty prawne | Kompaktowe modele, które mieszczą się na jednej karcie GPU |
| PLLuM🇵🇱 | Polska · konsorcjum uczelni i instytutów | Administracja publiczna, urzędowy język polski, pisma | Rodzina modeli w kilku rozmiarach |
| Llama | Meta · otwarte wagi | Uniwersalny asystent, analiza, streszczenia, wielojęzyczność | Od małych modeli po 70B+ |
| Qwen | Alibaba · otwarte wagi | Rozumowanie, analiza danych, programowanie, długi kontekst | Modele gęste i MoE, od kilku do setek mld parametrów |
| Mistral | Francja · otwarte wagi | Europejski model ogólnego przeznaczenia, szybkie odpowiedzi | Modele kompaktowe i średnie |
| Twój model | Fine-tuning na Twoich danych | Specjalistyczna terminologia, styl firmy, powtarzalne zadania | Dostrajanie LoRA lub pełne na dedykowanym klastrze |
■ Polskie LLM
Bielik AI i PLLuM w firmie
Bielik to polski otwarty model językowy rozwijany przez społeczność SpeakLeash we współpracy z ACK Cyfronet AGH. PLLuM to rodzina modeli stworzona przez konsorcjum polskich uczelni i instytutów przy wsparciu Ministerstwa Cyfryzacji. Oba projekty mają ten sam cel: AI, która dobrze rozumie polszczyznę i może działać lokalnie.
Samo pobranie wag nie wystarczy, żeby polski LLM pracował w firmie. Potrzebne są serwery GPU, silnik inferencji, wyszukiwanie w dokumentach, kontrola dostępu, logowanie przez SSO, monitoring i aktualizacje. Suweren AI dostarcza to wszystko jako usługę: wybierasz model, a my odpowiadamy za to, żeby działał szybko, stabilnie i bezpiecznie.
Lokalny LLM czy model w chmurze?
Lokalny LLM na laptopie (np. przez Ollama) sprawdza się do eksperymentów, ale nie obsłuży kilkuset pracowników, nie zna uprawnień do dokumentów i nie ma audytu. Dedykowane GPU z vLLM dają wydajność produkcyjną, a dane nadal nie opuszczają Polski.
■ Otwarte modele
Dlaczego firmy wybierają otwarte LLM
- 01
Dane nie opuszczają infrastruktury
Otwarty model działa na GPU przydzielonych Twojej firmie. Zapytania i dokumenty nie trafiają do zewnętrznego API.
- 02
Brak uzależnienia od dostawcy
Wagi modelu są dostępne publicznie. Możesz zmienić model, dostawcę infrastruktury lub przenieść wszystko on-premise.
- 03
Przewidywalny koszt
Płacisz za GPU, nie za tokeny. Więcej zapytań nie oznacza wyższego rachunku.
- 04
Polski język i kontekst
Bielik i PLLuM są trenowane na polskich tekstach i rozumieją nasze realia, odmianę i terminologię.
- 05
API zgodne z OpenAI
vLLM udostępnia endpoint w standardzie OpenAI. Istniejące aplikacje przełączasz, zmieniając adres i klucz.
- 06
RAG zamiast trenowania
Wiedza firmy trafia do modelu przez wyszukiwanie w dokumentach, więc jest zawsze aktualna i ma źródła.
Szukasz sprzętu pod model? Zobacz dedykowane serwery GPU H100, H200 i B200.
■ FAQ
Pytania o modele językowe
Czym jest Bielik AI?
Bielik to rodzina polskich otwartych modeli językowych rozwijana przez społeczność SpeakLeash we współpracy z ACK Cyfronet AGH. Modele są trenowane na dużym korpusie polskich tekstów, dzięki czemu dobrze rozumieją polską gramatykę, terminologię i realia. Można je uruchomić na własnej infrastrukturze.
Czym jest PLLuM?
PLLuM (Polish Large Language Model) to rodzina polskich modeli językowych opracowana przez konsorcjum polskich uczelni i instytutów badawczych przy wsparciu Ministerstwa Cyfryzacji. Modele są projektowane z myślą o zastosowaniach w administracji publicznej i biznesie.
Który model wybrać: Bielik, PLLuM, Llama czy Qwen?
Do pracy na polskich dokumentach, korespondencji i tekstach prawnych dobrym wyborem są Bielik i PLLuM. Do analizy danych, programowania i zadań wymagających rozumowania często lepiej sprawdzają się duże modele Qwen lub Llama. W praktyce łączymy je: różne asystenty korzystają z różnych modeli, a wybór weryfikujemy testami na Twoich danych.
Czym jest vLLM i dlaczego go używacie?
vLLM to otwarty silnik do serwowania modeli językowych. Dzięki technikom takim jak PagedAttention i ciągłe batchowanie obsługuje wielu użytkowników jednocześnie na tym samym GPU, co obniża koszt i czas odpowiedzi. Udostępnia API zgodne z OpenAI, więc istniejące aplikacje można przełączyć na prywatny model bez przepisywania kodu.
Czym jest RAG i po co firmie?
RAG (Retrieval-Augmented Generation) to technika, w której model przed odpowiedzią wyszukuje fragmenty Twoich dokumentów i opiera na nich odpowiedź. Dzięki temu AI zna aktualne procedury, umowy i dane firmy bez kosztownego trenowania modelu, a każda odpowiedź ma źródła, które można sprawdzić.
■ Kontakt
Przetestuj Bielika i Qwen na swoich dokumentach.
Przygotujemy porównanie modeli na próbce Twoich danych i dobierzemy konfigurację GPU.
kontakt@suwerenai.pl · odpowiadamy w 1 dzień roboczy