chinese-llm-benchmark
攤 No.321非线智能 NoneLinear - ReLE评测:中文AI大模型能力评测(持续更新):目前已囊括374个大模型,覆盖chatgpt、gpt-5.4、谷歌gemini-3.1-pro、Claude-4.6、文心ERNIE-X1.1、ERNIE-5.0、qwen3.6-max、qwe
SKILL SCORE
78/ 100—(7日)
30D · STARS
安装
INSTALL$git clone https://github.com/jeinlee1991/chinese-llm-benchmark.git拉源码本地跑,README 有完整安装说明
AI 速读
TL;DR这是什么
- 中文大模型能力评测平台
- 覆盖374个中外主流大模型
- 持续更新评测榜单数据
适合谁
需要构建自主智能体、多步任务编排的开发者与团队
上手门槛
中 —— 有 Python 与 LLM API 基础即可上手,复杂编排需理解 Agent 循环
由 AI 生成 · 数据截至 2026-09-15 · 方法论 v2.3
星标增长
STARS GROWTH站内指标 · ON-SITE 30D
页面浏览0
收藏0
安装复制0
摊前留言
COMMENTS · 0还没有留言 · 登录后可发第一条
S·96deepseek-harnessDeepSeek Harness: Everything is a Plugin.★224.0k—7日 +8880★Agent框架S·95n8n可视化工作流自动化,连接 400+ 服务与任意 LLM★204.3k—7日 +643★Agent框架S·95AutoGPT自主 Agent 开山之作,设定目标自动执行任务★187.3k—7日 +159★Agent框架S·94dify开源 LLM 应用开发平台,编排+RAG+Agent 一站式★155.7k—7日 +865★Agent框架S·94langchainAgent 工程平台,最主流的 LLM 应用开发框架★146.3k—7日 +450★Agent框架S·94langflow可视化搭建与部署 AI Agent 工作流的强力工具★154.8k—7日 +394★Agent框架


