由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
audio
话题找到数量
huggingface/transformers
🤗 Transformers:面向文本、视觉、音频及多模态模型的尖端机器学习模型定义框架,支持推理与训练全流程。
RVC-Project/Retrieval-based-Voice-Conversion-WebUI
用不超过10分钟的语音数据轻松训练优质语音克隆模型!
ossrs/srs
SRS是一款简单高效的实时媒体服务器,支持RTMP、WebRTC、HLS、HTTP-FLV、HTTP-TS、SRT、MPEG-DASH和GB28181协议。
OpenTalker/SadTalker
[CVPR 2023] SadTalker:学习真实感3D运动系数以实现风格化音频驱动的单图说话人脸动画
abus-aikorea/voice-pro
为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。