模型 · 基建
MODELS & INFRA · 参考层开源大语言模型本体与 AI 基建(部署推理、微调训练、多模态视觉)的 S-Score 总览。 模型是 Skill 脚下的基建 —— 本板块与 Skill 主榜 分开呈现、互不混排; S-Score 口径一致(星标量级 × 维护活跃度,见 方法论), 闭源产品(ChatGPT/Claude 等)不评分、仅在旗舰产品栏参考收录。
开源模型榜
MODELS · S-SCORE · TOP 60#Skill / 摊位S-ScoreStars ★ 7D趋势
1whisper音频语音MODELOpenAI 开源语音识别,多语种转写与翻译S·90—★ 105.8k+5122DeepSeek-V3大语言模型MODEL深度求索开源 MoE 大模型,性能对标顶级闭源S·87—★ 104.0k+603DeepSeek-R1大语言模型MODEL深度求索开源推理大模型,对标o1级能力S·86—★ 92.0k4fish-speech音频语音MODEL多语种零样本语音克隆TTS,低延迟高保真S·86—★ 31.4k+555VoxCPM音频语音MODEL免 tokenizer 的多语言 TTS:创意声音设计与逼真克隆S·85—★ 34.3k+4116llama大语言模型MODELMeta Llama 2,开源大模型里程碑S·84—★ 59.5k+37FinGPT大语言模型MODEL开源金融领域大语言模型S·84—★ 21.0k+478grok-1大语言模型MODELxAI开源Grok-1,314B参数MoE大模型S·83—★ 52.1k+799index-tts音频语音MODEL工业级可控高效的零样本 TTS 系统S·83—★ 22.2k+18010mamba大语言模型MODEL状态空间模型Mamba,线性复杂度挑战TransformerS·83—★ 18.7k+4411bark音频语音MODEL文本直接生成带情绪的语音/音效/笑声S·82—★ 39.2k+1512OpenVoice音频语音MODEL秒级声音克隆,跨语言音色迁移S·82—★ 37.0k+5113CosyVoice音频语音MODEL多语言语音大模型:推理/训练/部署全栈S·82—★ 22.4k+14614Qwen大语言模型MODEL阿里通义千问开源大模型,中英双语全尺寸S·82—★ 21.5k+3015supertonic音频语音MODEL极速端侧多语言 TTS(ONNX 原生)S·82—★ 13.5k+6916ControlNet设计绘图MODEL给扩散模型加精确控制,姿态线稿深度可控生成S·81—★ 34.0k+1017llama3大语言模型MODELMeta Llama 3官方仓库,开源模型新标杆S·81—★ 29.3k18sam2多模态视觉MODELSAM 2:图像视频统一分割,追踪任意对象S·81—★ 19.6k+4119Chinese-LLaMA-Alpaca大语言模型MODEL中文LLaMA与Alpaca大模型,支持本地训练部署S·81—★ 18.9k20Wan2.2影片生成MODEL通义万相:开放的大规模视频生成模型S·81—★ 16.9k+9321Wan2.1影片生成MODEL阿里通义万相开源视频生成,中文场景领先S·81—★ 16.7k+5322Qwen3大语言模型MODEL阿里通义千问 2.5,全尺寸多语言开源模型S·80—★ 27.4k+2523generative-models影片生成MODELStable Video Diffusion官方仓库,图生视频S·80—★ 27.2k24flux设计绘图MODELBlack Forest Labs开源文生图模型S·80—★ 25.8k+6725LLaVA多模态视觉MODEL视觉指令微调,开源多模态对话大模型S·80—★ 24.9k+1926HunyuanVideo影片生成MODEL腾讯混元视频:大规模视频生成系统框架S·80—★ 12.4k+2427MiniCPM大语言模型MODEL面壁 MiniCPM,端侧小钢炮大模型S·80▲2★ 10.0k+7328HRM大语言模型MODEL官方发布的分层推理模型S·79—★ 12.6k+129MOSS大语言模型MODEL复旦大学开源的工具增强对话大模型S·79—★ 12.2k+1430FlagEmbedding知识库检索MODEL面向检索增强生成的向量检索模型S·79—★ 12.0k+3431chandra多模态视觉MODEL精准处理复杂版面的OCR识别模型S·79—★ 11.8k+7832ChatRWKV大语言模型MODEL基于RWKV架构的开源对话模型,类ChatGPT体验S·79—★ 9.5k+433SenseVoice音频语音MODEL多语种语音识别模型,支持情感与事件检测S·79—★ 8.9k+4234Sana设计绘图MODELSANA:线性扩散 Transformer 高效高清图像合成S·79—★ 8.6k+8035dia音频语音MODEL一次生成多角色超真实对话的TTS模型S·78—★ 19.4k+2036Janus多模态视觉MODELDeepSeek Janus:统一多模态理解与生成模型S·78—★ 17.8k+137mistral-inference大语言模型MODELMistral AI 官方模型推理库,开源欧洲之光S·78—★ 10.8k+538Dolphin办公效率MODEL基于异构锚点提示的文档图像解析模型S·78—★ 9.0k+439minimind-v多模态视觉MODEL2小时从零训练65M参数视觉多模态VLMS·78—★ 8.4k+3440StableLM大语言模型MODELStability AI开源语言模型系列S·77—★ 15.7k41ChatGLM2-6B大语言模型MODEL智谱开源双语对话大语言模型S·77—★ 15.5k42llama-models大语言模型MODELMeta Llama 全系列官方模型仓库S·77—★ 7.7k+443gemma大语言模型MODELGoogle Gemma 开源轻量模型,同源 Gemini 技术S·77—★ 5.6k+2644CogVideo影片生成MODEL智谱清影开源的CogVideoX系列文生视频模型S·76—★ 12.9k+2245DALLE2-pytorch设计绘图MODELDALL-E 2文生图模型的PyTorch开源实现S·76—★ 11.3k+146GLM-OCR办公效率MODEL智谱推出的精准快速OCR识别模型S·76—★ 7.2k+3747Chinese-LLaMA-Alpaca-2大语言模型MODEL中文LLaMA-2/Alpaca-2,支持64K长上下文S·76—★ 7.1k48LLM4Decompile编程开发MODEL用大语言模型做二进制代码反编译S·76—★ 6.8k+2249DiffSinger音频语音MODEL浅扩散机制驱动的歌声与语音合成S·76—★ 4.8k+350dolly大语言模型MODELDatabricks开源大语言模型S·75—★ 10.8k51LTX-Video影片生成MODEL实时级DiT文生视频,消费级显卡可跑S·75—★ 10.8k+5852GroundingDINO多模态视觉MODEL用文字框选图中目标,开放词汇检测S·75—★ 10.5k+3853InternVL多模态视觉MODEL性能对标GPT-4o的开源多模态对话模型S·75—★ 10.1k+654silero-models音频语音MODEL开箱即用的预训练文本转语音模型库S·75—★ 6.0k+955lingbot-world影片生成MODEL推进开源世界模型研发的项目S·75—★ 4.3k+4656MOSS-TTS音频语音MODELOpenMOSS团队开源的高保真语音生成模型家族S·75—★ 3.9k+5857GLiNER大语言模型MODEL轻量级通用命名实体识别模型,支持任意实体类型S·75—★ 3.4k+3158CodeGeeX编程开发MODEL开源多语言代码生成大模型,支持自动补全S·74—★ 8.8k+459VAR设计绘图MODELNeurIPS 2024最佳论文的自回归图像生成模型S·74—★ 8.7k+560HunyuanVideo-1.5影片生成MODEL腾讯混元推出的轻量级视频生成模型S·74—★ 4.5k+16



















