由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
soniqo/speech-swift
面向 Apple Silicon 的 AI 语音工具包 — 基于 MLX 和 CoreML 的 ASR、TTS、语音到语音、VAD 及说话人分离功能。
dograh-hq/dograh
开源语音代理平台
argmaxinc/argmax-oss-swift
面向苹果芯片的端侧语音人工智能
Osmantic/ODS
将您的PC、Mac或Linux设备转变为AI服务器,支持大语言模型推理、聊天界面、语音、智能体、工作流、RAG及图像生成。
Light-Heart-Labs/ODS
将您的PC、Mac或Linux设备转变为AI服务器,支持LLM推理、聊天界面、语音、智能体、工作流、RAG及图像生成。
Light-Heart-Labs/DreamServer
随处可用的本地AI,人人皆可——涵盖LLM推理、聊天界面、语音、智能体、工作流、RAG及图像生成。无需云端,无需订阅。
snakers4/silero-models
Silero模型:提供预训练语音转文本、文本转语音和文本增强模型,极致简化实现
fikrikarim/parlor
设备端实时多模态AI。与完全运行在您本机上的AI进行自然的语音和视觉对话,由Gemma 4 E2B和Kokoro驱动。
CrispStrobe/CrispASR
面向多语言ASR与TTS模型的C++ ggml运行时中心:支持Cohere Transcribe、Parakeet TDT、Voxtral、Canary 1B v2等,并集成通用强制对齐等功能
abus-aikorea/voice-pro
为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。
jianchang512/pyvideotrans
将视频从一种语言翻译为另一种语言,并嵌入配音与字幕。
k2-fsa/sherpa-onnx
基于新一代Kaldi与onnxruntime的离线语音转文字、文字转语音、说话人日志、语音增强、源分离及语音活动检测技术。支持嵌入式系统、Android、iOS、HarmonyOS、树莓派、RISC-V架构、x86_64服务器、WebSocket服务端/客户端,兼容12种编程语言。
supertone-inc/supertonic
闪电般快速、设备端运行的多语言TTS——通过ONNX原生执行。
phuc-nt/my-translator
实时语音翻译——支持macOS和Windows,免费TTS,无需服务器,仅需使用你自己的API密钥
unslothai/unsloth
大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存
myshell-ai/OpenVoice
MIT与MyShell联合开发的即时语音克隆技术
OpenBMB/VoxCPM
VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统
alphacep/vosk-api
适用于Android、iOS、树莓派及服务端的离线语音识别API,支持Python、Java、C#和Node.js开发语言。
moonshine-ai/moonshine
面向边缘设备的快速准确自动语音识别
GetStream/Vision-Agents
Stream 推出的开放视觉智能体平台。使用任意模型或视频提供商快速构建视觉智能体。利用 Stream 的边缘网络实现超低延迟。
相关项目推荐
jaywcjlove/awesome-mac
如今我们已发展壮大,与最初理念有所不同。汇集各类精品软件。
swiftlang/swift
Swift编程语言
vsouza/awesome-ios
精选的优质 iOS 生态系统列表,包含 Objective-C 和 Swift 项目
apple/container
一款在Mac上使用轻量级虚拟机创建和运行Linux容器的工具。采用Swift语言编写,并为Apple芯片优化。
iina/iina
适用于 macOS 的现代视频播放器。
Alamofire/Alamofire
Swift 中的优雅 HTTP 网络框架