Wróć do bloga
Technologia

Nowe modele AI w PolandAI, GPT-OSS 120B i Llama 4

14 kwietnia 2026
2 min czytania
Zespół PolandAI
Zespół PolandAI przed ormiańskim kościołem historycznym

Podmieniliśmy silniki pod maską. Asystent grantowy i raportowy dostały GPT-OSS 120B, największy model open-source dostępny na Groq. Social media przesiadły się na Llama 4 Scout.

Aktualizacja z 21 sierpnia 2026. Ten wpis opisuje stan sprzed roku i część opisanych tu modeli już nie istnieje. Groq wycofał całą rodzinę Llamy: llama-3.3-70b-versatile, llama-3.1-8b-instant i llama-4-scout zwracają dziś błąd 404. Wszystkie czaty PolandAI korzystają obecnie z openai/gpt-oss-120b, jedynego modelu z dostępnego nam katalogu, który dobrze radzi sobie z polszczyzną. Aktualna lista modeli zmienia się bez uprzedzenia, więc traktuj poniższy tekst jako zapis historyczny.

Co się zmieniło

Przez ostatnie dwa tygodnie testowaliśmy nowe modele dostępne na Groq. Efekt: dwa najważniejsze czaty PolandAI (asystent grantowy i raportowy) używają teraz GPT-OSS 120B, czyli 120-miliardowego modelu open-source udostępnionego przez OpenAI we współpracy z Groq. Social media przeszły na Llama 4 Scout.

Co to znaczy w praktyce

GPT-OSS 120B to na ten moment najlepszy model open-source dostępny na Groq. Ma szerszy kontekst (do 128 tysięcy tokenów), lepiej radzi sobie z długimi wnioskami grantowymi i precyzyjniej trzyma się polskiej terminologii sektorowej. Dla wniosku do FESL czy NOWEFIO oznacza to mniej błędów rzeczowych i lepsze wyczucie różnicy między produktem a rezultatem projektu.

Llama 4 Scout to nowszy model z serii Meta Llama, zoptymalizowany pod zadania kreatywne. Dla postów w social media daje bardziej naturalny ton, mniej „korporacyjnego języka AI".

Pełne zestawienie

Rozkład modeli po zmianach wygląda tak. Dla czatów grantowego i raportowego, GPT-OSS 120B. Dla ogólnego, e-mailowego i tłumacza, Llama 3.3 70B Versatile. Dla social media, Llama 4 Scout 17B. Dla szybkiego pytania, Llama 3.1 8B Instant (512 tokenów, najszybsze odpowiedzi).

Każdy model ma swoje zastosowanie. Im większy model, tym więcej sensu ma używanie go do złożonych zadań (długie wnioski, raporty, analizy). Im mniejszy, tym szybszy (dobry do krótkich pytań, gdzie liczy się czas odpowiedzi).

Co dalej

Testujemy kolejne modele. Na liście są Qwen 3, Compound Beta i nowsza wersja Llama 4 Maverick (rollback, bo w testach wewnętrznych zwracał puste odpowiedzi). Jeśli któryś się sprawdzi w testach polskojęzycznych, dołączy do puli. Zawsze priorytetem jest jakość odpowiedzi po polsku i stabilność, nie sama wielkość modelu.

Zmiana modeli nie wymaga niczego od użytkowników. Logujesz się, wybierasz czat, piszesz. Pod spodem sam system przełącza silnik na najlepszy do zadania.

ZP

Autor

Zespół PolandAI

Chcesz korzystać z AI w swojej organizacji?

Zarejestruj swoją NGO i uzyskaj darmowy dostęp do najlepszych modeli AI.

Zarejestruj NGO