hellcatAI
trainer_output
Based on HuggingFaceTB/SmolLM-135M-Instruct
Tags
- safetensors
- llama
- generated_from_trainer
- reward-trainer
- trl
- dataset:HumanLLMs/Human-Like-DPO-Dataset
- base_model:HuggingFaceTB/SmolLM-135M-Instruct
- base_model:finetune:HuggingFaceTB/SmolLM-135M-Instruct
- text-embeddings-inference
- endpoints_compatible
- region:us
- Author
- hellcatAI
- Task
- text-classification
- Library
- transformers
- Architecture
- llama
- Base model
- HuggingFaceTB/SmolLM-135M-Instruct
- Downloads
- 5
- Likes
- 0
