Downloads · 30 days
27
20% of all-time downloads
fiel1986/andromeda
andromeda is a machine learning model from fiel1986. Use it for the machine learning task on the model card, and read the license before you ship it in a product. The card lists the license as apache-2.0.
Este repositorio contiene el modelo Qwen2.5-3B cuantizado en formato GGUF con el esquema Q40. Este modelo es ideal para ejecutar inferencia localmente con baja latencia y un uso eficiente de la memoria RAM/VRAM, graci…
Downloads · 30 days
27
20% of all-time downloads
All-time downloads
138
Public
Repo size
1.8 GB
Likes
0
Public
Click a slice to open those files.
.gguf1.8 GB · 100%
From the Hugging Face model README
Este repositorio contiene el modelo Qwen2.5-3B cuantizado en formato GGUF con el esquema Q4_0.
Este modelo es ideal para ejecutar inferencia localmente con baja latencia y un uso eficiente de la memoria RAM/VRAM, gracias a herramientas como llama.cpp, LM Studio, KoboldCPP o Ollama.
Puedes cargar y ejecutar este modelo utilizando varias herramientas compatibles con GGUF.
llama.cppSi tienes compilado llama.cpp, puedes ejecutar la inferencia directamente:
./main -m qwen2.5-3b-q4_0.gguf -p "Hola, ¿cómo estás?" -n 256