Downloads · 30 days
34
7% of all-time downloads
litmudoc/Chatterbox-Multilingual-MLX-v2-fp16
Chatterbox-Multilingual-MLX-v2-fp16 is a text-to-speech model from litmudoc. Use it when you need text read aloud. It is set up for mlx-audio.
This model was converted to MLX format from ResembleAI/chatterbox using mlx-audio version 0.2.10.
Downloads · 30 days
34
7% of all-time downloads
All-time downloads
479
Public
Parameters
644M
2.6 GB on disk
Likes
1
Public
Click a slice to open those files.
.safetensors2.6 GB · 100%
From the Hugging Face model README
This model was converted to MLX format from ResembleAI/chatterbox using mlx-audio version 0.2.10.
Note: This model requires the S3Tokenizer weights from mlx-community/S3TokenizerV2, which will be downloaded automatically.
pip install -U mlx-audio
curl -L -o ko.wav https://huggingface.co/litmudoc/Chatterbox-Multilingual-MLX-v2-fp16/resolve/main/ko.wav
mlx_audio.tts.generate \
--model litmudoc/Chatterbox-Multilingual-MLX-v2-fp16 \
--text ", 지난달 우리는 유튜브 채널에서 이십억 조회수라는 새로운 이정표에 도달했습니다." \
--lang_code ko \
--ref_audio ko.wav \
--ref_text "우리는 정말로 허름한 호텔에 묵었지만, 그래도 행복했다." \
--verbose --play
from mlx_audio.tts.generate import generate_audio
generate_audio(
text=", 지난달 우리는 유튜브 채널에서 이십억 조회수라는 새로운 이정표에 도달했습니다.",
model="litmudoc/Chatterbox-Multilingual-MLX-v2-fp16",
lang_code="ko",
ref_audio="ko.wav",
ref_text="우리는 정말로 허름한 호텔에 묵었지만, 그래도 행복했다.",
file_prefix="output",
)