Skip to content

Falconss1

VideoThinker-R1-3B

Based on Qwen/Qwen2.5-VL-3B-Instruct

Tags

  • safetensors
  • qwen2_5_vl
  • image-text-to-text
  • video-understanding
  • reasoning
  • multimodal
  • reinforcement-learning
  • question-answering
  • en
  • dataset:CLEVRER
  • dataset:MMVU
  • dataset:Video-Holmes

Languages

en

Author
Falconss1
Task
video-text-to-text
Library
transformers
Architecture
qwen2_5_vl
License
mit
Base model
Qwen/Qwen2.5-VL-3B-Instruct
Downloads
20
Likes
2
VideoThinker-R1-3B — AI Model — AIMarketly