Downloads ยท 30 days
17
50% of all-time downloads
amacca/swlbot
swlbot is a text generation model from amacca. Use it when you need the model to write or continue text. It is set up for transformers. The card lists the license as agpl-3.0.
Modello fine-tunato con QLoRA su dominio radioascolto / Short Wave Listening / BCL in italiano.
Downloads ยท 30 days
17
50% of all-time downloads
All-time downloads
34
Public
Repo size
2 GB
Likes
0
Public
Click a slice to open those files.
.gguf1.9 GB ยท 98%
From the Hugging Face model README
Modello fine-tunato con QLoRA su dominio radioascolto / Short Wave Listening / BCL in italiano.
Partenza: unsloth/Qwen2.5-3B-bnb-4bit (Qwen2.5-3B Instruct in 4-bit).
Dataset: coppie Q&A estratte da radioascoltopratico.org.
Il modello risponde in italiano, in modo pratico e diretto, con riferimenti concreti a frequenze, stazioni e strumenti reali.
| File | Descrizione |
|---|---|
swlbot-Q4_K_M.gguf | Modello quantizzato Q4_K_M pronto per Ollama / llama.cpp |
adapter/adapter_config.json | Config LoRA |
adapter/adapter_model.safetensors | Adapter LoRA raw (per merge/inference con PEFT) |
Modelfile | Modelfile Ollama (import in 1 comando) |
# Scarica il GGUF da HF (o usa il Modelfile incluso)
ollama create swlbot -f Modelfile
ollama run swlbot "Qual รจ la migliore frequenza per Radio Romania la sera?"
โ ๏ธ Nel
Modelfile, modifica il pathFROMse carichi il GGUF localmente:FROM ./swlbot-Q4_K_M.gguf
| Parametro | Valore |
|---|---|
| Base model | unsloth/Qwen2.5-3B-bnb-4bit |
| Metodo | QLoRA (4-bit) |
| LoRA rank | 8 |
| LoRA alpha | 16 |
| Target modules | q_proj, v_proj, k_proj, o_proj, gate_proj, up_proj |
| LoRA dropout | 0.05 |
| Epochs | 3 |
| Learning rate | 2e-4 |
| Batch size | 1 ร 8 (effective 8) |
| Max seq length | 1024 |
| Train examples | 255 |
| Eval examples | 64 |
| Final loss | ~1.33 |
Export: save_pretrained_gguf di Unsloth (auto-merge LoRA โ quantizzazione Q4_K_M).
radioascoltopratico.orgAGPL-3.0 (in linea con Unsloth). Deriva da Qwen2.5 (licenza Apache-2.0 del modello base).