Skip to content

MYTH-Lab

GoT-R1-4B

Based on Qwen/Qwen3-4B

Tags

  • safetensors
  • qwen3
  • reinforcement-learning
  • grpo
  • graph-of-thought
  • reasoning
  • rlhf
  • conversational
  • en
  • base_model:Qwen/Qwen3-4B
  • base_model:finetune:Qwen/Qwen3-4B
  • license:apache-2.0

Languages

en

Author
MYTH-Lab
Task
text-generation
Architecture
qwen3
License
apache-2.0
Base model
Qwen/Qwen3-4B
Downloads
92
Likes
3
GoT-R1-4B — AI Model — AIMarketly