Downloads · 30 days
23
15% of all-time downloads
Alenkar/KairosASR
KairosASR is a automatic speech recognition model from Alenkar. Use it when you need speech turned into text. The card lists the license as mit.
Downloads · 30 days
23
15% of all-time downloads
All-time downloads
153
Public
Repo size
893 MB
Likes
3
Public
Click a slice to open those files.
.onnx892 MB · 100%
From the Hugging Face model README
Kairos ASR — высокопроизводительная библиотека распознавания русской речи на базе GigaAM-style RNN-T и ONNX. Фокус: скорость, точность и простая интеграция в микросервисы и десктопы.
Основные возможности:
[gpu]) и Metal (MPS, extra [metal])Модельный репозиторий Alenkar/KairosASR содержит:
kairos_asr_encoder.onnxkairos_asr_decoder.onnxkairos_asr_joint.onnxkairos_asr_tokenizer.modelkairos-asr загружает эти файлы через huggingface_hub автоматически. Можно скачать вручную:
from huggingface_hub import hf_hub_download
path = hf_hub_download("Alenkar/KairosASR", "kairos_asr_encoder.onnx")
print(path)
pip install kairos-asr[cpu]
# для GPU (Windows/Linux): pip install kairos-asr[gpu]
# для macOS (Metal/MPS): pip install kairos-asr[metal]
Если нужна конкретная сборка Torch под вашу CUDA:
# пример под CUDA 12.1/12.2 (cu121)
pip install torch==2.6.0 torchaudio==2.6.0 \
--index-url https://download.pytorch.org/whl/cu121 --upgrade
Минимальный пример:
from kairos_asr import KairosASR
asr = KairosASR() # device="auto" по умолчанию
result = asr.transcribe(wav_file="audio.wav")
print(result.full_text)
Требования к аудио:
ffmpeg; ресемплинг до 16 kHz.Установите пакет, затем:
# Проверить окружение
kairos-asr doctor
# Список локальных/доступных моделей
kairos-asr list
# Скачать все модели заранее
kairos-asr download
# Перевести файл в текст
kairos-asr transcribe <wav_file>
ffmpeg должен быть доступен в PATH (загрузка и ресемплинг аудио).HF_TOKEN (huggingface-cli login или экспорт переменной окружения).Для получения дополнительной информации об исходной модели смотрите ее карточку модели.