Downloads · 30 days
29
15% of all-time downloads
Situus/STARK-4B-Thinking
STARK-4B-Thinking is a text generation model from Situus. Use it when you need the model to write or continue text. It is set up for transformers. The card lists the license as gemma.
<div align="center" <img src="https://img.shields.io/badge/Status-Experimental-yellow?style=for-the-badge" alt="Status Status" <img src="https://img.shields.io/badge/Language-Polish-red?style=for-the-badge" alt="Langu…
Downloads · 30 days
29
15% of all-time downloads
All-time downloads
199
Public
Parameters
4.3B
8.6 GB on disk
Likes
1
Public
Click a slice to open those files.
.safetensors8.6 GB · 100%
From the Hugging Face model README
STARK-4B-Thinking (System Transparentnego Analitycznego Rozumowania i Kontekstu) to kompaktowy, polskojęzyczny asystent AI oparty na architekturze Gemma 3 (4B). Model ten został zaprojektowany w celu dostarczenia zaawansowanych możliwości rozumowania do klasy lekkich modeli językowych, co pozwala na wydajną pracę lokalną przy zachowaniu wysokiej rzetelności merytorycznej.
System wykorzystuje mechanizm "rozważnej pauzy", implementując proces Chain of Thought (CoT), który pozwala modelowi na weryfikację logiki i planowanie odpowiedzi przed wygenerowaniem ostatecznego tekstu.
Wprowadzenie dedykowanej fazy myślowej pozwala modelowi STARK-4B na osiągnięcie stabilności oraz precyzji w zadaniach logicznych, które zazwyczaj wymagają znacznie większych zasobów obliczeniowych.
Wizualizacja sprawności operacyjnej:
MODEL BAZOWY (4B) [████████████████████░░░░░░░░░░░░░░]
STARK-4B (Thinking) [██████████████████████████░░░░░░░░] + BOOST REASONING
Dzięki alokacji tokenów na wewnętrzne procesy rozumowania (Reasoning Trace), model wykazuje podwyższoną dokładność w zadaniach logicznych oraz wyższą odporność na błędy w niejednoznacznych interakcjach z użytkownikiem.
STARK-4B-Thinking nie generuje wypowiedzi w sposób impulsywny. System opiera się na procesie analitycznym, który kieruje ostatecznym wynikiem.
<think> ... </think>.Wydajność modelu STARK-4B jest efektem zastosowania elitarnego korpusu treningowego:
Sekcja ta została ujednolicona z parametrami operacyjnymi modelu STARK-12B, aby zapewnić spójność ekosystemu STARK.
Model jest kompatybilny z narzędziami obsługującymi format GGUF, takimi jak LM Studio, KoboldCPP czy llama.cpp.
Rekomendowany format promptu:
<start_of_turn>user
Twoje pytanie lub polecenie tutaj<end_of_turn>
<start_of_turn>model
<think>
Tutaj model przeprowadza proces myślowy...
</think>
Tutaj znajduje się właściwa odpowiedź.
Model podlega warunkom użytkowania Gemma: Gemma Terms of Use.