模型 · 基建
MODELS & INFRA · 参考层开源大语言模型本体与 AI 基建(部署推理、微调训练、多模态视觉)的 S-Score 总览。 模型是 Skill 脚下的基建 —— 本板块与 Skill 主榜 分开呈现、互不混排; S-Score 口径一致(星标量级 × 维护活跃度,见 方法论), 闭源产品(ChatGPT/Claude 等)不评分、仅在旗舰产品栏参考收录。
开源模型榜
MODELS · S-SCORE · TOP 60#Skill / 摊位S-ScoreStars ★ 7D趋势
1whisper音频语音MODELOpenAI 开源语音识别,多语种转写与翻译S·91—★ 109.1k+3972DeepSeek-V3大语言模型MODEL深度求索开源 MoE 大模型,性能对标顶级闭源S·87—★ 104.4k+143DeepSeek-R1大语言模型MODEL深度求索开源推理大模型,对标o1级能力S·86—★ 92.0k4VoxCPM音频语音MODEL免 tokenizer 的多语言 TTS:创意声音设计与逼真克隆S·86—★ 37.4k+5765fish-speech音频语音MODEL多语种零样本语音克隆TTS,低延迟高保真S·85▼1★ 32.7k+976llama大语言模型MODELMeta Llama 2,开源大模型里程碑S·84—★ 59.6k+207grok-1大语言模型MODELxAI开源Grok-1,314B参数MoE大模型S·84—★ 52.2k8index-tts音频语音MODEL工业级可控高效的零样本 TTS 系统S·84—★ 24.0k+1619FinGPT大语言模型MODEL开源金融领域大语言模型S·84—★ 21.3k+2910bark音频语音MODEL文本直接生成带情绪的语音/音效/笑声S·82—★ 39.3k+811OpenVoice音频语音MODEL秒级声音克隆,跨语言音色迁移S·82—★ 37.5k+5912CosyVoice音频语音MODEL多语言语音大模型:推理/训练/部署全栈S·82—★ 23.6k+11813sam2多模态视觉MODELSAM 2:图像视频统一分割,追踪任意对象S·82—★ 19.9k+3914supertonic音频语音MODEL极速端侧多语言 TTS(ONNX 原生)S·82—★ 13.8k+915ControlNet设计绘图MODEL给扩散模型加精确控制,姿态线稿深度可控生成S·81—★ 34.1k+316llama3大语言模型MODELMeta Llama 3官方仓库,开源模型新标杆S·81—★ 29.2k17Chinese-LLaMA-Alpaca大语言模型MODEL中文LLaMA与Alpaca大模型,支持本地训练部署S·81—★ 18.9k+318mamba大语言模型MODEL状态空间模型Mamba,线性复杂度挑战TransformerS·81—★ 18.8k+2119MiniCPM大语言模型MODEL面壁 MiniCPM,端侧小钢炮大模型S·81▲1★ 11.0k+60420Qwen3大语言模型MODEL阿里通义千问 2.5,全尺寸多语言开源模型S·80—★ 27.6k+2321generative-models影片生成MODELStable Video Diffusion官方仓库,图生视频S·80—★ 27.3k+622flux设计绘图MODELBlack Forest Labs开源文生图模型S·80—★ 26.0k+1423LLaVA多模态视觉MODEL视觉指令微调,开源多模态对话大模型S·80—★ 25.0k+824MOSS大语言模型MODEL复旦大学开源的工具增强对话大模型S·80—★ 12.2k+525FlagEmbedding知识库检索MODEL面向检索增强生成的向量检索模型S·80—★ 12.2k+1826SenseVoice音频语音MODEL多语种语音识别模型,支持情感与事件检测S·80—★ 9.3k+4827Sana设计绘图MODELSANA:线性扩散 Transformer 高效高清图像合成S·80—★ 9.1k+11128Qwen大语言模型MODEL阿里通义千问开源大模型,中英双语全尺寸S·79—★ 21.7k+1929HRM大语言模型MODEL官方发布的分层推理模型S·79—★ 12.6k+630HunyuanVideo影片生成MODEL腾讯混元视频:大规模视频生成系统框架S·79—★ 12.5k+2331chandra多模态视觉MODEL精准处理复杂版面的OCR识别模型S·79—★ 12.3k+3232dia音频语音MODEL一次生成多角色超真实对话的TTS模型S·78—★ 19.4k+633Janus多模态视觉MODELDeepSeek Janus:统一多模态理解与生成模型S·78—★ 17.8k34Wan2.2影片生成MODEL通义万相:开放的大规模视频生成模型S·78—★ 17.5k+8235Wan2.1影片生成MODEL阿里通义万相开源视频生成,中文场景领先S·78—★ 17.0k+2936mistral-inference大语言模型MODELMistral AI 官方模型推理库,开源欧洲之光S·78—★ 10.8k37ChatRWKV大语言模型MODEL基于RWKV架构的开源对话模型,类ChatGPT体验S·78—★ 9.5k38Dolphin办公效率MODEL基于异构锚点提示的文档图像解析模型S·78—★ 9.0k39StableLM大语言模型MODELStability AI开源语言模型系列S·77—★ 15.7k40ChatGLM2-6B大语言模型MODEL智谱开源双语对话大语言模型S·77—★ 15.5k41minimind-v多模态视觉MODEL2小时从零训练65M参数视觉多模态VLMS·77—★ 8.6k+5042GLM-OCR办公效率MODEL智谱推出的精准快速OCR识别模型S·77—★ 7.4k+3543CogVideo影片生成MODEL智谱清影开源的CogVideoX系列文生视频模型S·76—★ 13.0k+1144DALLE2-pytorch设计绘图MODELDALL-E 2文生图模型的PyTorch开源实现S·76—★ 11.3k45LTX-Video影片生成MODEL实时级DiT文生视频,消费级显卡可跑S·76—★ 11.0k+1446Chinese-LLaMA-Alpaca-2大语言模型MODEL中文LLaMA-2/Alpaca-2,支持64K长上下文S·76—★ 7.1k47GLM-4大语言模型MODEL智谱 GLM-4 开源大模型,中文对话强S·76—★ 7.1k48silero-models音频语音MODEL开箱即用的预训练文本转语音模型库S·76—★ 6.1k+1249gemma大语言模型MODELGoogle Gemma 开源轻量模型,同源 Gemini 技术S·76—★ 5.7k+1550dolly大语言模型MODELDatabricks开源大语言模型S·75—★ 10.8k+451GroundingDINO多模态视觉MODEL用文字框选图中目标,开放词汇检测S·75—★ 10.6k+2652InternVL多模态视觉MODEL性能对标GPT-4o的开源多模态对话模型S·75—★ 10.2k+753GLiNER大语言模型MODEL轻量级通用命名实体识别模型,支持任意实体类型S·75—★ 3.6k+3054CodeGeeX编程开发MODEL开源多语言代码生成大模型,支持自动补全S·74—★ 8.8k+655Yi大语言模型MODEL01-ai团队从零训练的开源大模型系列S·74—★ 7.8k56llama-models大语言模型MODELMeta Llama 全系列官方模型仓库S·74—★ 7.7k+157CodeGeeX2编程开发MODEL支持多语言的强大代码生成模型S·74—★ 7.5k58HunyuanVideo-1.5影片生成MODEL腾讯混元推出的轻量级视频生成模型S·74—★ 4.6k+359lingbot-world影片生成MODEL推进开源世界模型研发的项目S·74—★ 4.5k+3260Fengshenbang-LM大语言模型MODELIDEA研究院主导的中文大模型开源体系S·74—★ 4.1k+1



















