由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

项目竞品项目

项目竞品项目数量
abus-aikorea

abus-aikorea/voice-pro

相关项目
12.0k 1.7k

为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。

Python speech-recognition speech-synthesis speech-to-text text-to-speech
项目竞品项目相似度
90%
+46
sgl-project

sgl-project/sglang-omni

相关项目
819 341

SGLang-Omni 为 TTS、ASR、语音和全向模型提供高性能服务。

Python multimodal speech-recognition text-to-speech
项目竞品项目相似度
68%
+12
fikrikarim

fikrikarim/parlor

相关项目
1.9k 232

设备端实时多模态AI。与完全运行在您本机上的AI进行自然的语音和视觉对话,由Gemma 4 E2B和Kokoro驱动。

HTML apple-silicon mlx multimodal speech-recognition text-to-speech
项目竞品项目相似度
65%
+3
argmaxinc

argmaxinc/argmax-oss-swift

相关项目
6.3k 596

面向苹果芯片的端侧语音人工智能

Swift speech-recognition speech-to-text text-to-speech transformers
项目竞品项目相似度
60%
+2
debpalash

debpalash/VoiceStudio

相关项目
32.1k 3.8k

VoiceStudio 是 ElevenLabs 的开源、完全本地化替代方案 — 提供 646 种语言的语音克隆、语音设计、视频配音、听写、转录和有声读物创建。

Python mlx speech-to-text text-to-speech
项目竞品项目相似度
52%
+10.2k
soniqo

soniqo/speech-swift

相关项目
977 122

面向 Apple Silicon 的 AI 语音工具包 — 基于 MLX 和 CoreML 的 ASR、TTS、语音到语音、VAD 及说话人分离功能。

Swift apple-silicon mlx speech-recognition text-to-speech
项目竞品项目相似度
50%
+13
OpenBMB

OpenBMB/VoxCPM

相关项目
37.7k 4.3k

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

Python speech-synthesis text-to-speech
项目竞品项目相似度
45%
+99
modelscope

modelscope/FunASR

相关项目
18.8k 1.9k

端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。

Python speech-recognition speech-to-text
项目竞品项目相似度
45%
+2.1k
jianchang512

jianchang512/pyvideotrans

相关项目
17.9k 2.2k

将视频从一种语言翻译为另一种语言,并嵌入配音与字幕。

Python speech-to-text text-to-speech
项目竞品项目相似度
45%
+22
snakers4

snakers4/silero-models

相关项目
6.0k 370

Silero模型:提供预训练语音转文本、文本转语音和文本增强模型,极致简化实现

Jupyter Notebook speech-synthesis speech-to-text text-to-speech
项目竞品项目相似度
45%
+5
Osmantic

Osmantic/ODS

相关项目
5.8k 814

将您的PC、Mac或Linux设备转变为AI服务器,支持大语言模型推理、聊天界面、语音、智能体、工作流、RAG及图像生成。

Python speech-to-text text-to-speech
项目竞品项目相似度
45%
+497
dograh-hq

dograh-hq/dograh

相关项目
4.0k 797

开源语音代理平台

Python speech-to-text text-to-speech
项目竞品项目相似度
45%
+1.3k
0xShug0

0xShug0/audio.cpp

相关项目
2.8k 315

一款用于音频模型的一体化纯 C++ 推理引擎,由 ggml 提供支持。支持TTS、STT、VAD、语音转换、音乐生成等,性能高度优化。没有 Python 依赖。

C++ apple-silicon speech-to-text text-to-speech
项目竞品项目相似度
45%
+396
OpenMOSS

OpenMOSS/MOSS-TTS

相关项目
2.8k 247

MOSS‑TTS 系列是由 MOSI.AI 与 OpenMOSS 团队开发的开源语音与声音生成模型系列。

Python multimodal text-to-speech
项目竞品项目相似度
45%
+904
huggingface

huggingface/speech-to-speech

相关项目
0 0

语音转语音:致力于构建开源模块化GPT4-o的项目

Python speech-synthesis speech-to-text
项目竞品项目相似度
45%
ggml-org

ggml-org/whisper.cpp

相关项目
53.7k 6.2k

OpenAI Whisper模型的C/C++移植版本

C++ speech-recognition speech-to-text
项目竞品项目相似度
30%
+173
screenpipe

screenpipe/screenpipe

相关项目
20.9k 2.1k

screenpipe将您的电脑转变为个人AI助手,它能知晓您的一切操作。记录、搜索、自动化,全部本地运行,完全私密,尽在您掌控。

Rust multimodal speech-to-text
项目竞品项目相似度
30%
+33
alphacep

alphacep/vosk-api

相关项目
15.1k 1.8k

适用于Android、iOS、树莓派及服务端的离线语音识别API,支持Python、Java、C#和Node.js开发语言。

Jupyter Notebook speech-recognition speech-to-text
项目竞品项目相似度
30%
+27
k2-fsa

k2-fsa/sherpa-onnx

相关项目
14.8k 1.7k

基于新一代Kaldi与onnxruntime的离线语音转文字、文字转语音、说话人日志、语音增强、源分离及语音活动检测技术。支持嵌入式系统、Android、iOS、HarmonyOS、树莓派、RISC-V架构、x86_64服务器、WebSocket服务端/客户端,兼容12种编程语言。

C++ speech-to-text text-to-speech
项目竞品项目相似度
30%
+19
NVIDIA

NVIDIA/DeepLearningExamples

相关项目
14.8k 3.4k

按模型组织的尖端深度学习脚本——易于在企业级基础设施上进行训练和部署,并具备可复现的准确性与性能。

Jupyter Notebook speech-recognition speech-synthesis
项目竞品项目相似度
30%
助手