Bielik czy PLLuM? Porównanie polskich modeli językowych

Bielik i PLLuM to dwie rodziny otwartych modeli językowych trenowanych z myślą o polszczyźnie, ale powstają w innych miejscach i do innych zadań. Bielika rozwija Fundacja SpeakLeash ze społecznością, we współpracy z ACK Cyfronet AGH, a modele od wersji 2.0 udostępnia na licencji Apache 2.0. PLLuM to projekt publiczny finansowany przez Ministerstwo Cyfryzacji, nastawiony głównie na administrację i odpowiadanie na pytania na podstawie dokumentów.

W praktyce: jeśli chcesz w kilka minut uruchomić polski model na własnym komputerze, prościej zacząć od Bielika, który ma oficjalne paczki dla Ollamy. Jeśli budujesz asystenta dla urzędu albo wyszukiwarkę w firmowych dokumentach, PLLuM był trenowany właśnie pod takie scenariusze. Opis według stanu na październik 2026.

Bielik w skrócie

  • Twórcy: Fundacja SpeakLeash (projekt znany też jako Spichlerz) i społeczność Bielika, we współpracy z ACK Cyfronet AGH.
  • Licencja: Apache 2.0 dla modeli od wersji 2.0 – można je bezpłatnie wykorzystywać, także komercyjnie. Pierwszy Bielik-7B-Instruct-v0.1 z 2024 r. miał niekomercyjną licencję CC BY-NC 4.0.
  • Aktualna generacja: v3. Główny model to Bielik 11B v3.0 Instruct, dostrojony z modelu bazowego Bielik-11B-v3-Base. Obok niego są lżejsze warianty: Bielik Minitron 7B v3.0 oraz Bielik 4.5B v3.0 i 1.5B v3.0.
  • Języki: według karty modelu 32 języki europejskie, z optymalizacją pod polski.
  • Gdzie użyć: czat w przeglądarce na chat.bielik.ai (wymaga zalogowania – kontem SpeakLeash albo m.in. przez Google, GitHub lub Apple), pliki modeli na Hugging Face, gotowe paczki w Ollamie.

Wokół modelu powstają też narzędzia poboczne, m.in. Bielik Guard (Sójka), czyli małe modele wykrywające szkodliwe treści, udostępnione w wersjach 0.1B i 0.5B.

PLLuM w skrócie

  • Twórcy: w 2024 r. konsorcjum sześciu instytucji – Politechnika Wrocławska, Instytut Podstaw Informatyki PAN, Instytut Slawistyki PAN, NASK-PIB, Ośrodek Przetwarzania Informacji – PIB i Uniwersytet Łódzki. Od 2025 r. prace kontynuuje szerszy sojusz HIVE AI, skupiony na technologiach językowych dla administracji.
  • Finansowanie: Ministerstwo Cyfryzacji. Według konsorcjum to ministerstwo jest właścicielem modeli wytworzonych w pierwszym projekcie, a na Hugging Face publikuje je konto ministerstwa CYFRAGOVPL.
  • Premiera: modele trafiły do publicznego dostępu 24 lutego 2025 r.
  • Aktualna generacja: 2512 (przygotowana w grudniu 2025 r.) – 11 modeli w rozmiarach 4B, 8B, 12B i 70B. Powstały przez dalsze trenowanie otwartych modeli bazowych na polskich danych: wersja 4B bazuje na Gemma 3, 8B i 70B na Llama 3.1, a 12B na Mistral Nemo.
  • Licencje: Apache 2.0 dla 4B i 12B, licencja Llama 3.1 dla 8B i 70B. Starsze modele z dopiskiem „nc” są wyłącznie do użytku niekomercyjnego.
  • Gdzie użyć: demonstracyjny czat na pllum.clarin-pl.eu oraz modele na Hugging Face, na koncie CYFRAGOVPL – według strony projektu łącznie 37 modeli.

Modele występują w odmianach base (model bazowy do dalszego trenowania), instruct (do wykonywania poleceń) i chat (dodatkowo dopasowany do preferencji ludzi, według twórców bezpieczniejszy w rozmowie). Modele PLLuM uczono też pracy w trybie RAG, czyli odpowiadania wyłącznie na podstawie dostarczonych dokumentów, z odwołaniami do źródeł.

Najważniejsze różnice

Pochodzenie i przeznaczenie

Bielik jest projektem społecznościowym ogólnego przeznaczenia. PLLuM powstał w projekcie publicznym, a jego dokumentacja wprost wskazuje administrację publiczną oraz tematy urzędowe i prawne jako główny obszar zastosowań. Na stronie projektu jest nawet opis wdrożenia modelu w urzędzie lub firmie w czterech krokach: od zdefiniowania potrzeb, przez przygotowanie dokumentów i sprzętu, po instalację przez zespół IT.

Dane treningowe

W pierwszym etapie projektu (2024) zespół PLLuM zebrał korpus liczący po oczyszczeniu ok. 150 mld tokenów, z którego powstawały modele naukowe (niekomercyjne). Wydzielono z niego tzw. biały korpus – ponad 28 mld tokenów, które zgodnie z prawem autorskim można wykorzystać do modeli otwartych, także komercyjnych. Projekt podkreśla też ręcznie przygotowany zbiór instrukcji i pierwszy polski korpus preferencji – szczegóły są w podsumowaniu prac konsorcjum.

Licencje w praktyce

Przy Bieliku sprawa jest prostsza: modele od wersji 2.0, w tym cała generacja v3, są na Apache 2.0, a niekomercyjną licencję miał tylko pierwszy Bielik-7B-Instruct-v0.1. Przy PLLuM trzeba sprawdzić konkretny model: 4B i 12B z generacji 2512 są na Apache 2.0, 8B i 70B dziedziczą licencję Llama 3.1 z jej warunkami, a warianty „nc” wykluczają użycie komercyjne.

Wymagania sprzętowe

Bielik 11B v3.0 w Ollamie, w kwantyzacji Q4_K_M, zajmuje 6,7 GB, a Minitron 7B – 4,5 GB, więc oba da się uruchomić na mocniejszym komputerze osobistym. PLLuM jest opisywany przede wszystkim jako model serwerowy. Według strony projektu we wdrożeniu z wyszukiwaniem dokumentów sam generator 12B potrzebuje ok. 48 GB pamięci GPU, 8B ok. 34 GB, a 70B ok. 168 GB. Do tego dochodzi moduł wyszukiwania z rerankerem, który wymaga od 24 do 48 GB.

Jak uruchomić Bielika lokalnie

  1. Zainstaluj Ollamę ze strony ollama.com (wersje na Windows, macOS i Linux).
  2. W terminalu wpisz: ollama run SpeakLeash/bielik-11b-v3.0-instruct:Q4_K_M. Ollama pobierze model (6,7 GB) i otworzy rozmowę.
  3. Jeśli komputer ma mniej pamięci, wybierz lżejszy wariant: ollama run SpeakLeash/bielik-minitron-7B-v3.0-instruct:Q4_K_M (4,5 GB).

Model ma okno kontekstu 32 tys. tokenów. Dostępne są też dokładniejsze kwantyzacje: Q5_K_M (7,9 GB), Q6_K (9,2 GB) i Q8_0 (12 GB). Twórcy w karcie wersji GGUF uprzedzają, że modele kwantyzowane odpowiadają słabiej i częściej halucynują niż pełna wersja. Te same pliki GGUF obsługują m.in. LM Studio i llama.cpp. Rozmowa z modelem uruchomionym lokalnie nie opuszcza komputera, co ma znaczenie przy danych firmowych.

Jak uruchomić PLLuM

Najszybszy test to czat demonstracyjny. Do własnych zastosowań modele pobiera się z Hugging Face i uruchamia przez bibliotekę Transformers. Karta modelu PLLuM-12B-chat-2512 zawiera gotowe przykłady kodu oraz szablon promptu do RAG. Jeśli w dostarczonych dokumentach nie ma odpowiedzi, model ma zwrócić komunikat „Nie udało mi się odnaleźć odpowiedzi na pytanie” zamiast zgadywać.

Który model wybrać

  • Lokalny asystent na komputerze, nauka, prototyp: Bielik 11B v3.0 lub Minitron 7B przez Ollamę.
  • Produkt komercyjny: Bielik v2 lub v3 albo PLLuM 4B lub 12B na Apache 2.0; przy 8B i 70B najpierw przeczytaj licencję Llama 3.1.
  • Chatbot urzędu lub wyszukiwarka w dokumentach: PLLuM, trenowany pod RAG i opisany pod kątem wdrożeń w administracji.
  • Teksty w kilku językach europejskich: Bielik, który deklaruje obsługę 32 języków.

Rankingi jakości zmieniają się z każdą wersją, dlatego najlepszym sprawdzianem jest test na własnych zadaniach: przygotuj kilkanaście typowych pytań i porównaj odpowiedzi obu modeli. Oba mogą się mylić – twórcy PLLuM piszą o ryzyku halucynacji wprost w karcie modelu, a SpeakLeash ostrzega przed nim przy wersjach skompresowanych. Bieżące informacje o polskiej sztucznej inteligencji publikujemy w dziale AI, a o nowych narzędziach dla programistów – w kategorii Technologie.

Najczęściej zadawane pytania

Czy Bielik jest darmowy?

Tak. Aktualne modele Bielik (od wersji 2.0) są udostępniane na licencji Apache 2.0, która pozwala na bezpłatne użycie, także komercyjne. Czat chat.bielik.ai wymaga zalogowania.

Czy PLLuM można używać w firmie?

Tak, ale zależy to od modelu. PLLuM 4B i 12B z generacji 2512 są na Apache 2.0, 8B i 70B na licencji Llama 3.1, a modele z oznaczeniem „nc” są wyłącznie niekomercyjne.

Jak uruchomić Bielika na swoim komputerze?

Najprościej przez Ollamę, poleceniem ollama run SpeakLeash/bielik-11b-v3.0-instruct:Q4_K_M. Model zajmuje 6,7 GB, a lżejszy Minitron 7B – 4,5 GB.

Gdzie przetestować PLLuM online?

Demonstracyjny czat działa pod adresem pllum.clarin-pl.eu. Modele do pobrania są na Hugging Face, na koncie CYFRAGOVPL.

Bielik czy PLLuM – który jest lepszy?

Nie ma jednej odpowiedzi: Bielika łatwiej uruchomić lokalnie i ma prostą licencję, a PLLuM projektowano pod administrację i odpowiedzi na podstawie dokumentów. Najlepiej porównać oba na własnych pytaniach.