Downloads · 30 days
33
9% of all-time downloads
DinoStackAI/Qwen3-8b-lora-qasper
Qwen3-8b-lora-qasper is a question answering model from DinoStackAI. Use it when the input is a question plus a passage. It is set up for peft. The card lists the license as apache-2.0.
LoRA adapter for Qwen/Qwen3-8B fine-tuned on the qasper RAG generative dataset (DinoStackAI/qasper-rag). - Best dev metric: evalloss = 1.2768
Downloads · 30 days
33
9% of all-time downloads
All-time downloads
364
Public
Repo size
361 MB
Likes
0
Public
Click a slice to open those files.
.safetensors175 MB · 92%
From the Hugging Face model README
LoRA adapter for Qwen/Qwen3-8B fine-tuned on the qasper RAG generative dataset (DinoStackAI/qasper-rag).
eval_loss = 1.2768from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base_model = AutoModelForCausalLM.from_pretrained(
"Qwen/Qwen3-8B",
torch_dtype="auto",
device_map="auto",
)
model = PeftModel.from_pretrained(base_model, "DinoStackAI/Qwen3-8b-lora-qasper")
tokenizer = AutoTokenizer.from_pretrained("DinoStackAI/Qwen3-8b-lora-qasper")
from vllm import LLM
from vllm.lora.request import LoRARequest
llm = LLM(
model="Qwen/Qwen3-8B",
enable_lora=True,
max_lora_rank=16,
)
outputs = llm.generate(
prompts,
lora_request=LoRARequest("qasper", 1, "DinoStackAI/Qwen3-8b-lora-qasper"),
)
Use this adapter with scripts/generation/run_rag_generation.py --lora-path DinoStackAI/Qwen3-8b-lora-qasper.
Qwen/Qwen3-8BDinoStackAI/qasper-ragr=16, lora_alpha=32, lora_dropout=0.05)q_proj, k_proj, v_proj, o_proj, gate_proj, up_proj, down_projassistant_only_loss=True)eval_loss