由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

audio

话题找到数量

huggingface/transformers

🤗 Transformers:面向文本、视觉、音频及多模态模型的尖端机器学习模型定义框架,支持推理与训练全流程。

162k
33k
964
+61
排名 #12
7月2日
查看详情

mrdoob/three.js

JavaScript三维图形库

113k
36k
688
+37
排名 #5
7月13日
查看详情

mudler/LocalAI

🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。

48k
4.3k
746
+280
排名 #9
8月2日
查看详情

RVC-Project/Retrieval-based-Voice-Conversion-WebUI

用不超过10分钟的语音数据轻松训练优质语音克隆模型!

37k
5.2k
315
+81
排名 #16
8月4日
查看详情

google-ai-edge/mediapipe

面向直播与流媒体的跨平台可定制机器学习解决方案

36k
6.1k
724
+141
排名 #8
8月2日
查看详情

mpv-player/mpv

🎥 命令行媒体播放器

36k
3.5k
907
+23
排名 #11
8月2日
查看详情

OpenBMB/VoxCPM

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

30k
3.4k
684
+418
排名 #5
6月17日
查看详情

ossrs/srs

SRS是一款简单高效的实时媒体服务器,支持RTMP、WebRTC、HLS、HTTP-FLV、HTTP-TS、SRT、MPEG-DASH和GB28181协议。

28k
5.7k
654
+62
排名 #18
5月24日
查看详情

fingerprintjs/fingerprintjs

最先进的免费开源浏览器指纹识别库

28k
2.6k
300
+18
排名 #9
7月31日
查看详情

navidrome/navidrome

🎧☁️您的个人流媒体服务平台

22k
1.6k
587
+24
排名 #13
7月27日
查看详情

screenpipe/screenpipe

screenpipe将您的电脑转变为个人AI助手,它能知晓您的一切操作。记录、搜索、自动化,全部本地运行,完全私密,尽在您掌控。

20k
2k
515
+1.1k
排名 #16
7月31日
查看详情

ExistentialAudio/BlackHole

BlackHole是一款现代macOS音频回环驱动程序,允许应用程序以零额外延迟将音频传递给其他应用程序。

19k
819
403
+10
排名 #18
7月7日
查看详情

DrewThomasson/ebook2audiobook

从电子书生成有声书,支持语音克隆及1107种以上语言!

19k
1.6k
608
+9
排名 #21
6月12日
查看详情

modelscope/FunASR

端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。

18k
1.9k
707
+2.1k
排名 #14
6月30日
查看详情

ffmpegwasm/ffmpeg.wasm

基于WebAssembly的浏览器端FFmpeg

17k
1.1k
432
+6
排名 #2
6月6日
查看详情

audacity/audacity

音频编辑器

17k
2.6k
545
+54
排名 #21
6月21日
查看详情

koel/koel

真正可用的音乐流媒体解决方案

17k
2.1k
493
+4
排名 #10
6月15日
查看详情

pion/webrtc

纯Go语言实现的WebRTC API接口

16k
1.9k
775
+4
排名 #22
6月4日
查看详情

advplyr/audiobookshelf

自托管有声书与播客服务器

13k
1.1k
863
+115
排名 #8
8月2日
查看详情

OpenTalker/SadTalker

[CVPR 2023] SadTalker:学习真实感3D运动系数以实现风格化音频驱动的单图说话人脸动画

13k
2.6k
343
+2
排名 #15
5月10日
查看详情

abus-aikorea/voice-pro

为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。

12k
1.7k
33
+46
排名 #11
8月3日
查看详情

wwmm/easyeffects

适用于PipeWire应用的限幅器、压缩器、卷积器、均衡器、自动音量等多种插件

9.7k
360
704
+8
排名 #8
7月7日
查看详情

deniscerri/ytdlnis

基于 yt-dlp 的安卓全功能音视频下载工具

9.5k
423
828
+103
排名 #11
8月2日
查看详情

juce-framework/JUCE

JUCE是开源的跨平台C++应用程序框架,适用于桌面和移动应用,支持VST、VST3、AU、AUv3、LV2和AAX音频插件开发

8.6k
2.1k
631
+9
排名 #5
7月6日
查看详情
助手