Przejdź do treści
suweren.ai

■ Modele językowe · LLM

Bielik, PLLuM, Llama, Qwen.Na Twoich GPU, w Polsce.

Uruchamiamy polskie i otwarte modele językowe na dedykowanej infrastrukturze, serwujemy je przez vLLM i łączymy z wiedzą firmy przez RAG. Wybierasz model do zadania — nie jednego dostawcę na zawsze.

# API zgodne z OpenAI, model w Polsce
curl https://api.suwerenai.pl/v1/chat/completions \
  -H "Authorization: Bearer $KEY" \
  -d '{"model": "bielik",
        "messages": [{"role": "user",
        "content": "Streść umowę"}]}'

■ Katalog

Modele, które uruchamiamy dla firm

Każdy asystent może korzystać z innego modelu. Dobór potwierdzamy testami na Twoich dokumentach, a nie na benchmarkach z internetu.

ModelPochodzenieNajlepszy doRozmiary
Bielik🇵🇱Polska · SpeakLeash, ACK Cyfronet AGHPolska korespondencja, dokumenty, obsługa klienta, teksty prawneKompaktowe modele, które mieszczą się na jednej karcie GPU
PLLuM🇵🇱Polska · konsorcjum uczelni i instytutówAdministracja publiczna, urzędowy język polski, pismaRodzina modeli w kilku rozmiarach
LlamaMeta · otwarte wagiUniwersalny asystent, analiza, streszczenia, wielojęzycznośćOd małych modeli po 70B+
QwenAlibaba · otwarte wagiRozumowanie, analiza danych, programowanie, długi kontekstModele gęste i MoE, od kilku do setek mld parametrów
MistralFrancja · otwarte wagiEuropejski model ogólnego przeznaczenia, szybkie odpowiedziModele kompaktowe i średnie
Twój modelFine-tuning na Twoich danychSpecjalistyczna terminologia, styl firmy, powtarzalne zadaniaDostrajanie LoRA lub pełne na dedykowanym klastrze

■ Polskie LLM

Bielik AI i PLLuM w firmie

Bielik to polski otwarty model językowy rozwijany przez społeczność SpeakLeash we współpracy z ACK Cyfronet AGH. PLLuM to rodzina modeli stworzona przez konsorcjum polskich uczelni i instytutów przy wsparciu Ministerstwa Cyfryzacji. Oba projekty mają ten sam cel: AI, która dobrze rozumie polszczyznę i może działać lokalnie.

Samo pobranie wag nie wystarczy, żeby polski LLM pracował w firmie. Potrzebne są serwery GPU, silnik inferencji, wyszukiwanie w dokumentach, kontrola dostępu, logowanie przez SSO, monitoring i aktualizacje. Suweren AI dostarcza to wszystko jako usługę: wybierasz model, a my odpowiadamy za to, żeby działał szybko, stabilnie i bezpiecznie.

Lokalny LLM czy model w chmurze?

Lokalny LLM na laptopie (np. przez Ollama) sprawdza się do eksperymentów, ale nie obsłuży kilkuset pracowników, nie zna uprawnień do dokumentów i nie ma audytu. Dedykowane GPU z vLLM dają wydajność produkcyjną, a dane nadal nie opuszczają Polski.

■ Otwarte modele

Dlaczego firmy wybierają otwarte LLM

  • 01

    Dane nie opuszczają infrastruktury

    Otwarty model działa na GPU przydzielonych Twojej firmie. Zapytania i dokumenty nie trafiają do zewnętrznego API.

  • 02

    Brak uzależnienia od dostawcy

    Wagi modelu są dostępne publicznie. Możesz zmienić model, dostawcę infrastruktury lub przenieść wszystko on-premise.

  • 03

    Przewidywalny koszt

    Płacisz za GPU, nie za tokeny. Więcej zapytań nie oznacza wyższego rachunku.

  • 04

    Polski język i kontekst

    Bielik i PLLuM są trenowane na polskich tekstach i rozumieją nasze realia, odmianę i terminologię.

  • 05

    API zgodne z OpenAI

    vLLM udostępnia endpoint w standardzie OpenAI. Istniejące aplikacje przełączasz, zmieniając adres i klucz.

  • 06

    RAG zamiast trenowania

    Wiedza firmy trafia do modelu przez wyszukiwanie w dokumentach, więc jest zawsze aktualna i ma źródła.

Szukasz sprzętu pod model? Zobacz dedykowane serwery GPU H100, H200 i B200.

■ FAQ

Pytania o modele językowe

Czym jest Bielik AI?

Bielik to rodzina polskich otwartych modeli językowych rozwijana przez społeczność SpeakLeash we współpracy z ACK Cyfronet AGH. Modele są trenowane na dużym korpusie polskich tekstów, dzięki czemu dobrze rozumieją polską gramatykę, terminologię i realia. Można je uruchomić na własnej infrastrukturze.

Czym jest PLLuM?

PLLuM (Polish Large Language Model) to rodzina polskich modeli językowych opracowana przez konsorcjum polskich uczelni i instytutów badawczych przy wsparciu Ministerstwa Cyfryzacji. Modele są projektowane z myślą o zastosowaniach w administracji publicznej i biznesie.

Który model wybrać: Bielik, PLLuM, Llama czy Qwen?

Do pracy na polskich dokumentach, korespondencji i tekstach prawnych dobrym wyborem są Bielik i PLLuM. Do analizy danych, programowania i zadań wymagających rozumowania często lepiej sprawdzają się duże modele Qwen lub Llama. W praktyce łączymy je: różne asystenty korzystają z różnych modeli, a wybór weryfikujemy testami na Twoich danych.

Czym jest vLLM i dlaczego go używacie?

vLLM to otwarty silnik do serwowania modeli językowych. Dzięki technikom takim jak PagedAttention i ciągłe batchowanie obsługuje wielu użytkowników jednocześnie na tym samym GPU, co obniża koszt i czas odpowiedzi. Udostępnia API zgodne z OpenAI, więc istniejące aplikacje można przełączyć na prywatny model bez przepisywania kodu.

Czym jest RAG i po co firmie?

RAG (Retrieval-Augmented Generation) to technika, w której model przed odpowiedzią wyszukuje fragmenty Twoich dokumentów i opiera na nich odpowiedź. Dzięki temu AI zna aktualne procedury, umowy i dane firmy bez kosztownego trenowania modelu, a każda odpowiedź ma źródła, które można sprawdzić.

■ Kontakt

Przetestuj Bielika i Qwen na swoich dokumentach.

Przygotujemy porównanie modeli na próbce Twoich danych i dobierzemy konfigurację GPU.

Umów rozmowę z inżynierem Zobacz demo na swoich danych

kontakt@suwerenai.pl · odpowiadamy w 1 dzień roboczy