由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

cloning

话题找到数量

RVC-Boss/GPT-SoVITS

1分钟的语音数据也可以用来训练一个好的TTS模型! (几张声音克隆镜头)

61k
6.6k
1.1k
+24
排名 #19
8月27日
查看详情

OpenBMB/VoxCPM

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

37k
4.3k
1.3k
+99
排名 #18
9月16日
查看详情

debpalash/VoiceStudio

VoiceStudio 是 ElevenLabs 的开源、完全本地化替代方案 — 提供 646 种语言的语音克隆、语音设计、视频配音、听写、转录和有声读物创建。

32k
3.8k
414
+10k
排名 #15
9月16日
查看详情

DrewThomasson/ebook2audiobook

从电子书生成有声书,支持语音克隆及1107种以上语言!

19k
1.7k
1.2k
+141
排名 #10
8月19日
查看详情

Huanshere/VideoLingo

Netflix级字幕切割、翻译、对齐、甚至加上配音,一键全自动AI视频字幕团队

18k
2k
890
+31
排名 #5
8月2日
查看详情

duixcom/Duix-Avatar

🚀 真正开源的 AI 数字人工具包,支持离线视频生成与数字人克隆

15k
2.6k
978
+423
排名 #9
9月16日
查看详情

canopy-network/canopy

Canopy Network协议的官方Go语言实现

13k
15k
1k
+271
排名 #9
7月1日
查看详情

abus-aikorea/voice-pro

为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。

12k
1.7k
666
+46
排名 #11
8月3日
查看详情

multimodal-art-projection/YuE

YuE2: frontier music generation with symbolic planning, zero-shot covers, and agentic music editing.

9.4k
1k
80
+332
排名 #5
9月16日
查看详情

0xShug0/audio.cpp

一款用于音频模型的一体化纯 C++ 推理引擎,由 ggml 提供支持。支持TTS、STT、VAD、语音转换、音乐生成等,性能高度优化。没有 Python 依赖。

2.8k
315
195
+396
排名 #4
9月16日
查看详情

OpenMOSS/MOSS-TTS

MOSS‑TTS 系列是由 MOSI.AI 与 OpenMOSS 团队开发的开源语音与声音生成模型系列。

2.8k
247
870
+904
排名 #21
5月31日
查看详情

ddalcu/mlx-serve

专为Apple Silicon打造的原生LLM推理服务器,兼容OpenAI与Anthropic API,无需Python环境。包含基于MLX Core的macOS应用,支持聊天、智能体模式及工具调用功能。

1.4k
129
961
+25
排名 #1
9月19日
查看详情
助手