llama.cpp
攤 No.623纯 C/C++ 高效推理 LLaMA,CPU 也能跑
SKILL SCORE
93/ 100—(7日)
30D · STARS
安装
INSTALL$https://github.com/ggml-org/llama.cpp官方安装 / 下载入口
AI 速读
TL;DR这是什么
- 纯 C/C++ 实现,CPU 也能高效跑 LLaMA 系模型
- GGUF 量化让大模型塞进消费级设备
- 众多本地推理工具(含 Ollama)的底层引擎
适合谁
研究与应用大语言模型的开发者与研究者
上手门槛
中 —— 依项目而定:调用类 SDK 易上手,训练类需算力
由 AI 生成 · 数据截至 2026-09-15 · 方法论 v2.3
星标增长
STARS GROWTH站内指标 · ON-SITE 30D
页面浏览0
收藏0
安装复制0
摊前留言
COMMENTS · 0还没有留言 · 登录后可发第一条
S·95ollama本地一键跑开源大模型,最流行的本地 LLM 运行器★181.0k—7日 +543★部署推理S·94transformers最主流预训练模型库,一行代码加载数十万个模型★166.0k—7日 +1016★部署推理S·91vllm高吞吐低延迟大模型推理引擎,PagedAttention★91.8k—7日 +571★部署推理S·90OmniRoute免费AI网关,一个入口对接231+模型商★66.2k—7日 +3677★部署推理S·90headroom把工具输出/日志/RAG 块先压缩再喂给 LLM,省 20-95% token★72.2k—7日 +2022★部署推理S·89litellm一套 OpenAI 格式调 100+ LLM API:代理网关+计费+负载均衡★58.7k—7日 +503★部署推理



