ahmedehabb
Memory-R2-answer-agent
Based on Qwen/Qwen2.5-7B-Instruct
Tags
- safetensors
- qwen2
- memory
- long-horizon
- reinforcement-learning
- agent
- conversational
- arxiv:2605.21768
- base_model:Qwen/Qwen2.5-7B-Instruct
- base_model:finetune:Qwen/Qwen2.5-7B-Instruct
- license:apache-2.0
- region:us
- Author
- ahmedehabb
- Task
- text-generation
- Architecture
- qwen2
- License
- apache-2.0
- Base model
- Qwen/Qwen2.5-7B-Instruct
- Downloads
- 128
- Likes
- 0
