Skip to content

OX-PIXL

SpatialThinker-3B

Based on Qwen/Qwen2.5-VL-3B-Instruct

Tags

  • safetensors
  • qwen2_5_vl
  • spatial-reasoning
  • multimodal
  • vision-language
  • scene-graph
  • reinforcement-learning
  • conversational
  • en
  • arxiv:2511.07403
  • base_model:Qwen/Qwen2.5-VL-3B-Instruct
  • base_model:finetune:Qwen/Qwen2.5-VL-3B-Instruct

Languages

en

Author
OX-PIXL
Task
image-text-to-text
Architecture
qwen2_5_vl
License
apache-2.0
Base model
Qwen/Qwen2.5-VL-3B-Instruct
Downloads
31
Likes
4
SpatialThinker-3B — AI Model — AIMarketly