由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

vllm

话题找到数量

modelscope/FunASR

端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。

18k
1.9k
1.3k
+2.1k
排名 #14
6月30日
查看详情

meta-llama/llama-cookbook

欢迎来到Llama实践指南!这是您使用Llama进行开发的必备指南:涵盖推理入门、微调及RAG技术。我们还将展示如何利用Llama模型家族解决端到端问题,并在不同云服务平台上进行部署

18k
2.8k
1.2k
+184
排名 #13
7月31日
查看详情

LMCache/LMCache

通过最快的KV缓存层为您的LLM加速

10k
1.5k
1.1k
+101
排名 #9
7月10日
查看详情

OpenDCAI/DataFlow

借助基于最新大语言模型的算子与流水线轻松实现数据准备。

7k
881
746
+38
排名 #15
7月26日
查看详情

kvcache-ai/Mooncake

Mooncake是Moonshot AI旗下领先大语言模型服务Kimi的部署平台。

6.6k
1.2k
1.3k
+10
排名 #15
9月18日
查看详情

Orchestra-Research/AI-Research-SKILLs

面向任意AI模型的综合性开源人工智能研究与工程技能库。

6.2k
485
1.1k
+393
排名 #1
4月5日
查看详情

kserve/kserve

面向 Kubernetes 可扩展多框架部署的标准化分布式生成式与预测式 AI 推理平台

5.9k
1.7k
1.3k
+79
排名 #8
9月16日
查看详情

vllm-project/semantic-router

面向混合模型的智能路由器。

5.6k
917
1.2k
+198
排名 #8
9月6日
查看详情

mostlygeek/llama-swap

llama.cpp(或任何兼容本地OpenAI API的服务器)的模型热替换

5.5k
432
1k
+13
排名 #10
8月24日
查看详情

OpenBMB/UltraRAG

UltraRAG v3:一个用于构建复杂创新RAG管道的低代码MCP框架

5.4k
387
1k
+13
排名 #10
3月3日
查看详情

vllm-project/vllm-ascend

面向昇腾平台的vLLM社区维护硬件插件

2.9k
2.3k
1.7k
+1
排名 #3
9月19日
查看详情

SemiAnalysisAI/InferenceX

开源持续推理基准测试:Qwen3.5、DeepSeek、GPTOSS - GB200 NVL72对比MI355X、B200、GB300 NVL72、H100,即将支持TPUv6e/v7/Trainium2/3

1.1k
202
1k
+11
排名 #8
6月17日
查看详情

ai-dynamo/dynamo

数据中心级分布式推理服务框架

0
0
1.4k
排名 #9
9月12日
查看详情

gpustack/gpustack

用于高性能 AI 模型服务(vLLM、SGLang)和按需可通过 SSH 访问的 GPU 实例的 GPU 集群管理器。

0
0
327
排名 #7
9月11日
查看详情
助手