Downloads · 30 days
0
SuperPauly/AudioSR
AudioSR is a audio-to-audio model from SuperPauly. Use it for the audio-to-audio task on the model card, and read the license before you ship it in a product. It is set up for diffusers. The card lists the license as mit.
Pre-trained AudioSR (Versatile Audio Super Resolution) models for use with ComfyUI-AudioSR custom node.
Downloads · 30 days
0
Access
Public
Updated Mar 21, 2026
Repo size
12.4 GB
Likes
1
Public
Click a slice to open those files.
.safetensors12.4 GB · 100%
From the Hugging Face model README
Pre-trained AudioSR (Versatile Audio Super Resolution) models for use with ComfyUI-AudioSR custom node.
<audio controls src="https://huggingface.co/drbaph/AudioSR/resolve/main/samples/speech_up_4.wav"></audio> <audio controls src="https://huggingface.co/drbaph/AudioSR/resolve/main/samples/speech_audiosr_4.wav"></audio>

ComfyUI/models/AudioSR/ComfyUI Workflow:
Load Audio → AudioSR → Preview/Save Audio
Recommended Settings:
audiosr_speech_fp32.safetensors for voice, audiosr_basic_fp32.safetensors for everything elseAudioSR upscales low-quality audio to high-quality 48kHz output using latent diffusion. It:
Based on AudioSR: Versatile Audio Super-Resolution by Haohe Liu et al.
Original repository: https://github.com/haoheliu/versatile_audio_super_resolution
License: MIT