LIVESSI 79,780.00▲0.01%
未登录 · 登录

大厅 / 🌍 国外 / 部署推理

部署推理

LLMOPS · GLOBAL · INFRA

收录 187今日新增 0数据源 GitHub 每日快照

部署推理(国外)分类当前收录 187开源模型与基建项目,按 S-Score 排名靠前的有 ollama(S·95)transformers(S·94)llama.cpp(S·93)。S-Score 基于 GitHub 星标量级与维护活跃度算法计算,每小时重排、付费不影响排名,数据每日快照。本分类属于「模型 · 基建」板块,不进入 Skill 主榜,总览见 模型看板

本榜单每小时重排 · 方法论
1ollama本地一键跑开源大模型,最流行的本地 LLM 运行器95 181.0k+543
2transformers最主流预训练模型库,一行代码加载数十万个模型94 166.0k+1016
3llama.cpp纯 C/C++ 高效推理 LLaMA,CPU 也能跑93 128.2k+812
4vllm高吞吐低延迟大模型推理引擎,PagedAttention91 91.8k+571
5headroom把工具输出/日志/RAG 块先压缩再喂给 LLM,省 20-95% token90 72.2k+2022
6OmniRoute免费AI网关,一个入口对接231+模型商90 66.2k+3677
广告位招商中 —— 你的产品出现在这里自助投放 · 周结算 · 广告内容与榜单排序无关了解 →广告 AD
7litellm一套 OpenAI 格式调 100+ LLM API:代理网关+计费+负载均衡89 58.7k+503
8LocalAI本地自托管的 OpenAI 兼容 API,一行替换云端88 49.1k+146
9llmfit一条命令,找到你硬件能跑的大模型87 36.6k+1522
10sglang高性能大模型服务框架,支持结构化生成87 36.0k+356
11textgen本地大模型的网页界面,插件生态丰富87 47.7k+37
12langfuse开源LLM工程平台,评测可观测性一体86 34.6k+299
13gpt4all任意设备本地跑 LLM,开源可商用86 77.4k+7
14airllm单张 4GB 显卡推理 70B 大模型86 34.3k+506
159router免费 AI 编码模型路由,连接 40+ 提供商85 28.8k+1077
16mlflow开源 AI 工程平台:Agent/LLM/ML 全生命周期85 28.0k+104
17promptfoo提示词与Agent测试评估,支持AI红队测试85 25.1k+190
18opikLLM 应用调试评测监控,全链路追踪84 22.0k+164
19mlc-llm通用大模型部署引擎,基于机器编译优化推理83 23.2k+16
20ggml高效机器学习张量计算库,支撑本地大模型推理82 15.4k+50
21OpenLLM把开源 LLM 一键跑成 OpenAI 兼容 API81 12.5k+1
22bisheng毕昇:企业级 LLM DevOps 开放平台81 12.0k+32
23phoenixAI可观测与评测平台,追踪LLM应用表现81 11.5k+97
24openvino英特尔 OpenVINO:AI 推理优化部署工具箱80 10.9k+40
25metaflowNetflix开源的AI/ML系统构建部署平台80 10.3k+7
26runanywhere-sdks本地跑 AI 的生产级工具箱80 10.3k
27bifrost高性能企业级AI网关,统一接入千余模型79 8.1k+205
28gateway极速 AI 网关:1600+ LLM 路由 + 50+ 护栏79 13.0k+68
29evidently开源ML/LLM可观测性框架,百余项评估指标79 7.9k+17
30flyte动态韧性 AI 编排:数据/模型/算力协同79 7.5k+69
31rigRust 构建模块化可扩展 LLM 应用79 8.6k+79
32dynamo数据中心级分布式推理服务框架79 8.1k+86
33serve云原生多模态 AI 应用框架79 21.9k
34ODS把电脑变成AI服务器,推理聊天RAG一体78 6.5k+261
35PowerInfer面向本地部署的高速大模型推理引擎78 9.8k+11
36helicone一行代码接入的开源LLM可观测性平台78 6.2k+22
37flashinfer面向大模型推理的高性能内核加速库78 6.4k+64
38vllm-omni全模态模型高效推理框架78 6.8k+92
39BentoML最易用的 AI 服务框架:推理 API/队列/多模型管线781 8.8k+16
40clearmlAI 工作流自动化:实验/数据/管线管理78 6.9k+5
41stable-diffusion.cpp纯 C/C++ 跑扩散模型(SD/Flux/Wan/Qwen)78 7.0k+50
42planoAgent 应用的 AI 原生代理与数据面77 7.1k+9
43mlx-vlmMac 上用 MLX 推理/微调视觉语言模型77 5.5k+22
44coze-loop新一代AI智能体全生命周期优化平台77 5.7k+15
45giskard-oss开源LLM Agent评估测试库77 5.8k+9
46RagaAI-CatalystAgent AI 可观测性与评测 SDK77 16.2k+1
47gpustackGPU集群管理平台,支持模型服务与按需实例77 5.7k+70
48ragasLLM 应用评测加速器(RAG 评测标准库)77 15.7k+75
49lemonade调用本机GPU/NPU运行优化大模型77 5.7k+55
50zenml一体化AI平台,覆盖流水线到Agent全流程77 5.6k+4
51semantic-router混合模型智能路由,异构 LLM 高效推理77 5.8k+153
52kserve面向Kubernetes的标准化AI推理平台77 5.9k+44
53cactus面向移动端与穿戴设备的低延迟AI引擎77 6.0k+24
54openllmetry基于 OpenTelemetry 的 GenAI 可观测性77 7.4k+14
55openevolveAlphaEvolve的开源实现,LLM驱动代码进化76 7.4k+38
56langwatch面向LLM效果评估与Agent测试的平台76 4.8k+1261
57agenta开源LLMOps一体化平台76 4.8k+24
58mcp-context-forge统一网关代理MCP/A2A/REST等接口76 4.5k+37
59lmms-eval覆盖文本图像视频音频的多模态统一评测工具76 4.4k+7
60agent-starter-pack快速将AI Agent部署到Google Cloud的模板集76 6.6k+3

展示前 60 名 · 完整榜单见 每日热榜 →

SKILL·STUDY · 夜市每 10 分钟补货一次 · 排名公正性政策SKILL.STUDYS·96README 徽章 · 一键佩戴本夜市靈感來自 士林 · 寧夏 · 饒河