LIVESSI 79,780.00▲0.01%
未登录 · 登录

大厅 / 全部 / 部署推理

部署推理

LLMOPS · ALL REGIONS · INFRA

收录 187今日新增 0数据源 GitHub 每日快照

部署推理分类当前收录 187开源模型与基建项目,按 S-Score 排名靠前的有 ollama(S·95)transformers(S·94)llama.cpp(S·93)。S-Score 基于 GitHub 星标量级与维护活跃度算法计算,每小时重排、付费不影响排名,数据每日快照。本分类属于「模型 · 基建」板块,不进入 Skill 主榜,总览见 模型看板

本榜单每小时重排 · 方法论
1ollama本地一键跑开源大模型,最流行的本地 LLM 运行器95 181.0k+543
2transformers最主流预训练模型库,一行代码加载数十万个模型94 166.0k+1016
3llama.cpp纯 C/C++ 高效推理 LLaMA,CPU 也能跑93 128.2k+812
4vllm高吞吐低延迟大模型推理引擎,PagedAttention91 91.8k+571
5OmniRoute免费AI网关,一个入口对接231+模型商90 66.2k+3677
6headroom把工具输出/日志/RAG 块先压缩再喂给 LLM,省 20-95% token90 72.2k+2022
广告位招商中 —— 你的产品出现在这里自助投放 · 周结算 · 广告内容与榜单排序无关了解 →广告 AD
7litellm一套 OpenAI 格式调 100+ LLM API:代理网关+计费+负载均衡89 58.7k+503
8LocalAI本地自托管的 OpenAI 兼容 API,一行替换云端88 49.1k+146
9llmfit一条命令,找到你硬件能跑的大模型87 36.6k+1522
10textgen本地大模型的网页界面,插件生态丰富87 47.7k+37
11sglang高性能大模型服务框架,支持结构化生成87 36.0k+356
12langfuse开源LLM工程平台,评测可观测性一体86 34.6k+299
13airllm单张 4GB 显卡推理 70B 大模型86 34.3k+506
14gpt4all任意设备本地跑 LLM,开源可商用86 77.4k+7
15promptfoo提示词与Agent测试评估,支持AI红队测试85 25.1k+190
169router免费 AI 编码模型路由,连接 40+ 提供商85 28.8k+1077
17mlflow开源 AI 工程平台:Agent/LLM/ML 全生命周期85 28.0k+104
18opikLLM 应用调试评测监控,全链路追踪84 22.0k+164
19mlc-llm通用大模型部署引擎,基于机器编译优化推理83 23.2k+16
20ggml高效机器学习张量计算库,支撑本地大模型推理82 15.4k+50
21one-api一站式大模型API网关,统一分发与计费82 36.9k+114
22OpenLLM把开源 LLM 一键跑成 OpenAI 兼容 API81 12.5k+1
23bisheng毕昇:企业级 LLM DevOps 开放平台81 12.0k+32
24phoenixAI可观测与评测平台,追踪LLM应用表现81 11.5k+97
25runanywhere-sdks本地跑 AI 的生产级工具箱80 10.3k
26metaflowNetflix开源的AI/ML系统构建部署平台80 10.3k+7
27openvino英特尔 OpenVINO:AI 推理优化部署工具箱80 10.9k+40
28flyte动态韧性 AI 编排:数据/模型/算力协同79 7.5k+69
29evidently开源ML/LLM可观测性框架,百余项评估指标79 7.9k+17
30lmdeployLLM 压缩部署服务工具箱(InternLM 团队)79 8.1k+24
31gateway极速 AI 网关:1600+ LLM 路由 + 50+ 护栏79 13.0k+68
32serve云原生多模态 AI 应用框架79 21.9k
33bifrost高性能企业级AI网关,统一接入千余模型79 8.1k+205
34rigRust 构建模块化可扩展 LLM 应用79 8.6k+79
35dynamo数据中心级分布式推理服务框架79 8.1k+86
36vllm-omni全模态模型高效推理框架78 6.8k+92
37clearmlAI 工作流自动化:实验/数据/管线管理78 6.9k+5
38PowerInfer面向本地部署的高速大模型推理引擎78 9.8k+11
39helicone一行代码接入的开源LLM可观测性平台78 6.2k+22
40flashinfer面向大模型推理的高性能内核加速库78 6.4k+64
41stable-diffusion.cpp纯 C/C++ 跑扩散模型(SD/Flux/Wan/Qwen)78 7.0k+50
42BentoML最易用的 AI 服务框架:推理 API/队列/多模型管线781 8.8k+16
43ODS把电脑变成AI服务器,推理聊天RAG一体78 6.5k+261
44gpustackGPU集群管理平台,支持模型服务与按需实例77 5.7k+70
45planoAgent 应用的 AI 原生代理与数据面77 7.1k+9
46lemonade调用本机GPU/NPU运行优化大模型77 5.7k+55
47coze-loop新一代AI智能体全生命周期优化平台77 5.7k+15
48mlx-vlmMac 上用 MLX 推理/微调视觉语言模型77 5.5k+22
49giskard-oss开源LLM Agent评估测试库77 5.8k+9
50kserve面向Kubernetes的标准化AI推理平台77 5.9k+44
51cactus面向移动端与穿戴设备的低延迟AI引擎77 6.0k+24
52zenml一体化AI平台,覆盖流水线到Agent全流程77 5.6k+4
53semantic-router混合模型智能路由,异构 LLM 高效推理77 5.8k+153
54openllmetry基于 OpenTelemetry 的 GenAI 可观测性77 7.4k+14
55RagaAI-CatalystAgent AI 可观测性与评测 SDK77 16.2k+1
56ragasLLM 应用评测加速器(RAG 评测标准库)77 15.7k+75
57archestra企业级AI平台,内置护栏、MCP注册中心与网关76 4.3k+16
58mcp-context-forge统一网关代理MCP/A2A/REST等接口76 4.5k+37
59lmms-eval覆盖文本图像视频音频的多模态统一评测工具76 4.4k+7
60VLMEvalKit支持220+模型的多模态大模型评测工具包76 4.4k+8

展示前 60 名 · 完整榜单见 每日热榜 →

SKILL·STUDY · 夜市每 10 分钟补货一次 · 排名公正性政策SKILL.STUDYS·96README 徽章 · 一键佩戴本夜市靈感來自 士林 · 寧夏 · 饒河