由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
audio
话题找到数量
huggingface/transformers
🤗 Transformers:面向文本、视觉、音频及多模态模型的尖端机器学习模型定义框架,支持推理与训练全流程。
RVC-Project/Retrieval-based-Voice-Conversion-WebUI
用不超过10分钟的语音数据轻松训练优质语音克隆模型!
OpenTalker/SadTalker
[CVPR 2023] SadTalker:学习真实感3D运动系数以实现风格化音频驱动的单图说话人脸动画
abus-aikorea/voice-pro
为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。
multimodal-art-projection/YuE
YuE2: frontier music generation with symbolic planning, zero-shot covers, and agentic music editing.
QwenAudio/SenseVoice
开源 SenseVoiceSmall 模型,适用于普通话、粤语、英语、日语和韩语 ASR、语言 ID、情绪识别和音频事件检测。
ronitsingh10/FineTune
FineTune是一款macOS菜单栏应用,提供单应用音量控制、多设备输出、音频路由及十段均衡器功能。它是SoundSource的免费开源替代品。