由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

transformer

话题找到数量

Blaizzy/mlx-audio

基于 Apple MLX 框架构建的文本转语音 (TTS)、语音转文本 (STT) 和语音转语音 (STS) 库,可在 Apple Silicon 上提供高效的语音分析。

7.8k
689
1.1k
+12
排名 #15
8月17日
查看详情

adithya-s-k/omniparse

摄取、解析并优化任意数据格式 ➡️ 从文档到多媒体 ➡️ 以增强与GenAI框架的兼容性

7.4k
610
727
+100
排名 #13
5月28日
查看详情

vladmandic/sdnext

SD.Next:用于 AI 生成图像和视频创建、字幕和处理的一体化 WebUI

7.3k
573
714
+24
排名 #10
8月9日
查看详情

MakazhanAlpamys/Soup

从一个 YAML 微调 LLM。层流在 4 GB 笔记本电脑 GPU 上训练 8B 模型。

6.7k
1k
517
+104
排名 #14
9月16日
查看详情

argmaxinc/argmax-oss-swift

面向苹果芯片的端侧语音人工智能

6.3k
596
870
+2
排名 #8
8月16日
查看详情

FareedKhan-dev/train-llm-from-scratch

一种训练大语言模型的直接方法,涵盖从数据下载到文本生成的完整流程。

6.1k
835
854
+105
排名 #13
6月14日
查看详情

argosopentech/argos-translate

用Python编写的开源离线翻译库

6k
458
959
+17
排名 #17
5月14日
查看详情

cactus-compute/cactus

在手机、可穿戴设备及AI原生硬件上本地运行人工智能

6k
497
1.1k
+425
排名 #17
8月31日
查看详情

salesforce/BLIP

BLIP 模型的 PyTorch 实现:通过自举法实现语言-图像预训练,达成统一视觉-语言理解与生成

5.7k
765
872
排名 #9
7月4日
查看详情

vllm-project/semantic-router

面向混合模型的智能路由器。

5.6k
917
1.2k
+198
排名 #8
9月6日
查看详情

Michael-A-Kuykendall/shimmy

⚡ 无需Python的Rust推理服务器 — 兼容OpenAI-API。支持GGUF与SafeTensors、热模型切换、自动发现、单二进制文件。现在免费,永远免费。

5.6k
533
794
+11
排名 #17
6月29日
查看详情

OpenBMB/UltraRAG

UltraRAG v3:一个用于构建复杂创新RAG管道的低代码MCP框架

5.4k
387
1k
+13
排名 #10
3月3日
查看详情

vllm-project/vllm-omni

一个面向全模态模型的高效推理框架。

5.1k
1.1k
1.4k
+24
排名 #15
6月10日
查看详情

Blaizzy/mlx-vlm

MLX-VLM:基于MLX在Mac上进行视觉语言模型推理与微调的工具包

4.7k
522
938
+50
排名 #11
5月7日
查看详情

OpenNMT/CTranslate2

面向Transformer模型的快速推理引擎

4.5k
497
771
+3
排名 #5
6月27日
查看详情

huggingface/course

Hugging Face transformers 课程

4.2k
1.4k
1.3k
+25
排名 #21
9月16日
查看详情

JohnSnowLabs/spark-nlp

顶尖自然语言处理技术

4.1k
743
1.1k
排名 #10
7月17日
查看详情

androidx/media

Jetpack Media3 媒体用例支持库,包含用于 Android 的可扩展媒体播放器 ExoPlayer

2.9k
894
1.4k
+11
排名 #18
8月9日
查看详情

vllm-project/vllm-ascend

面向昇腾平台的vLLM社区维护硬件插件

2.9k
2.3k
1.7k
+1
排名 #3
9月19日
查看详情

bbruceyuan/Hands-On-Large-Language-Models-CN

动手学习大模型

2.8k
309
775
+4
排名 #18
8月15日
查看详情

liustack/modlens

DeepSeek Harness 的第一个视觉插件,以及每个纯文本编码代理的视觉桥。粘贴图像,获取结构化 JSON 证据(OCR、布局、语义)。 | 全网第一个 DeepSeek Harness 视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得格式化 JSON 证据(OCR、版面、语义)。

2.8k
76
547
+441
排名 #4
8月17日
查看详情

vita-epfl/Stable-Video-Infinity

[ICLR 26] Stable Video Infinity:基于错误回收的无限长度视频生成

1.7k
135
1k
+45
排名 #3
2月1日
查看详情

kyegomez/awesome-multi-agent-papers

最佳多智能体论文汇编

1.6k
158
867
+2
排名 #9
8月4日
查看详情

thu-ml/SpargeAttn

SpargeAttention:一种免训练的稀疏注意力机制,可加速任何模型推理

1.2k
105
1.1k
+21
排名 #6
9月19日
查看详情
助手