Ollama wprowadziła lokalną obsługę modeli decyzyjnych opartych na API Jev firmy TypeSafe. Nowy endpoint /v1/systemone, dostępny od wersji Ollama 0.35, pozwala przesłać tekst wraz z zestawem nazwanych pytań i dostać odpowiedzi od modelu działającego na własnym komputerze — bez dodatkowych opłat i bez wysyłania danych przez sieć.
Nowy interfejs /v1/systemone i sterowanie w czasie rzeczywistym
O obsłudze modeli decyzyjnych (decision models) Ollama poinformowała w komunikacie na X oraz we wpisie na swoim blogu z 29 września 2026 roku. Modele te opierają się na API Jev firmy TypeSafe, stworzonym do szybkich, typowanych decyzji. Endpoint /v1/systemone jest dostępny od wersji Ollama 0.35: wysyłasz tekst jako stan (state) oraz zestaw nazwanych pytań, a model działający na twoim komputerze odpowiada na wszystkie w jednym żądaniu.
Na próbę możesz pobrać model Nimble poleceniem ollama pull nimble. W materiale wideo z wpisu na X model ten podejmował decyzje w czasie rzeczywistym w grze Ollama racer, a w przykładzie z gry Pac-Man na blogu Ollamy średni czas decyzji Nimble 9B wyniósł 91 ms (MacBook Pro z układem M5 Max).
Główne zastosowania w infrastrukturze
Zamiast generować tekst, modele decyzyjne zwracają wynik dla pytań trzech typów: wyboru jednej z opcji (choice), pytania tak/nie (noul) oraz oceny na skali (score). Według Ollamy sprawdzają się w zadaniach wymagających szybkiej decyzji:
- Kierowanie zgłoszeń (ticket triage) – wybór właściwej kategorii lub zespołu dla przychodzącego zgłoszenia.
- Routing modeli (model routing) – decyzja, do którego modelu skierować dane zapytanie.
- Moderacja treści i bezpieczeństwa – ocena, czy dana treść wymaga interwencji.
Zapytania nie podróżują przez sieć, więc opóźnienie jest niskie, choć wynik zależy od sprzętu i konfiguracji. Dokumentacja wymienia też ograniczenia: API zwraca jedną odpowiedź JSON, nie obsługuje strumieniowania, obrazów ani narzędzi, a pojedyncze żądanie może mieć najwyżej 64 KiB.
Na start dostępne są trzy modele: nimble – otwartoźródłowy model 9B od Bespoke Labs, tev1 – eksperymentalny model 4B od Together AI oraz tev1:0.8b – eksperymentalny model 0,8B od Together AI. Ollama zapowiada kolejne, także obsługiwane w jej chmurze.
Co ta zmiana oznacza dla projektów automatyzacji
To dodatkowe narzędzie, a nie zamiennik dużych modeli: do prostej klasyfikacji, decyzji tak/nie czy oceny na skali wystarczy wyspecjalizowany model pokroju Nimble, zamiast uruchamiania dużego modelu generatywnego, który miałby zwrócić jedno słowo. Model działa lokalnie, bez dodatkowych kosztów i bez wysyłania danych przez sieć.
Dla administratorów i deweloperów warto zajrzeć do dokumentacji i przykładów Ollamy przed wdrożeniem — to nowa funkcja, a modele tev1 są oznaczone jako eksperymentalne.
Źródła
- https://x.com/ollama/status/2105152056382345544
- https://ollama.com/blog/ollama-now-supports-jev-style-decision-models
- https://docs.ollama.com/capabilities/decision
- https://docs.ollama.com/api/systemone
- https://ollama.com/library/nimble
- https://ollama.com/library/tev1:4b
- https://ollama.com/library/tev1:0.8b
Komentarze