Skip to content

Enxin

VideoNSA

Tags

  • safetensors
  • qwen2_5_vl
  • video-understanding
  • sparse-attention
  • vision-language
  • qwen2.5-vl
  • multimodal
  • en
  • arxiv:2510.02295
  • license:apache-2.0
  • region:us

Languages

en

Author
Enxin
Task
video-text-to-text
Architecture
qwen2_5_vl
License
apache-2.0
Downloads
118
Likes
2
VideoNSA — AI Model — AIMarketly