Downloads · 30 days
51
38% of all-time downloads
LUMAMODEL/luma
luma is a text generation model from LUMAMODEL. Use it when you need the model to write or continue text. It is set up for transformers. The card lists the license as apache-2.0.
Downloads · 30 days
51
38% of all-time downloads
All-time downloads
136
Public
Parameters
494M
1.5 GB on disk
Likes
0
Public
Click a slice to open those files.
.safetensors988 MB · 64%
From the Hugging Face model README
Компактная дообученная Qwen2.5-0.5B-Instruct для живого общения по-русски
Это не просто очередная нейронка — это твой собеседник-ассистент, обученный вести естественные русские диалоги: здороваться, общаться, поддерживать беседу, отвечать на вопросы.
Дообучена методом LoRA поверх Qwen2.5-0.5B-Instruct на корпусе русских диалогов.
Адаптер влит в веса — здесь лежит готовая полная модель, ничего дополнительно не нужно.
| Файл | Что это | Размер |
|---|---|---|
model.safetensors | Полные веса модели (merged) | 988 МБ |
luma-q8_0.gguf | GGUF q8_0 — для LM Studio / Ollama | 531 МБ |
config.json, tokenizer.* | Конфигурация и токенизатор | — |
chat_template.jinja | Chat-шаблон общения | — |
README.md | Этот файл 😊 | — |
from transformers import AutoModelForCausalLM, AutoTokenizer
tok = AutoTokenizer.from_pretrained("LUMAMODEL/luma")
model = AutoModelForCausalLM.from_pretrained("LUMAMODEL/luma", torch_dtype="auto")
prompt = tok.apply_chat_template(
[{"role": "user", "content": "Привет! Как дела?"}],
tokenize=False, add_generation_prompt=True,
)
inputs = tok(prompt, return_tensors="pt")
out = model.generate(**inputs, max_new_tokens=256, do_sample=True, temperature=0.8)
print(tok.decode(out[0], skip_special_tokens=True))
LUMAMODEL/luma и скачай luma-q8_0.gguf;ollama create luma -f - <<'EOF'
FROM https://huggingface.co/LUMAMODEL/luma/resolve/main/luma-q8_0.gguf
EOF
ollama run luma
LUMA обучена с системным промптом «программист» и без него может отвечать коротко. Для длинного и полного кода:
Ты — LUMA, русскоязычный ассистент и программист. Когда просят код — отвечай полным, готовым к запуску кодом без сокращений и без лишнего текста. Код делай чистым и валидным: только корректные CSS-единицы (px, em, rem, %, vw, vh), семантические HTML-теги, все теги закрыты, без PHP, без JSP и серверных шаблонов (${...}), без невалидных конструкций и обрывков чужого кода.
⚙️ Рекомендуемая генерация: temperature 0.7, top_p 0.8, repetition_penalty 1.1.
Вы: Привет! Как у тебя дела?
LUMA: Привет! Всё отлично, спасибо 😊 Рад, что ты заглянул. Чем могу помочь сегодня?
| Параметр | Значение |
|---|---|
| База | Qwen/Qwen2.5-0.5B-Instruct (Apache-2.0) |
| Метод | LoRA: r=8, alpha=16, dropout 0.1 |
| Целевые слои | q/k/v/o/gate/up/down proj |
| Данные | Корпус русских диалогов (ассистент) |
| Точность | bf16, batch=1, grad-accum=16 |
| LR | 1.5e-4, cosine + warmup |
| Контекст | 1024–2048 токенов |
| Loss | только по токенам ответов ассистента (+KL-рег. 0.5) |
📊 Дата-сеты обучения:
LUMAMODEL/luma-dataset