大厅 / 全部 / 音频语音
音频语音 AUDIO · ALL REGIONS 收录 184 今日新增 0 数据源 GitHub 每日快照
音频语音分类当前收录 184 个 AI Skill,按 S-Score 排名靠前的有 whisper (S·91)、whisper.cpp (S·89) 、GPT-SoVITS (S·88) 。S-Score 基于 GitHub 星标量级与维护活跃度算法计算,每小时重排、付费不影响排名,数据每日快照。
旗舰产品 FLAGSHIP · 官方 闭源产品 · 不评 S-Score # SKILL · 摊位 S-SCORE STARS ★ 7D 趋势
1 whisper OpenAI 开源语音识别,多语种转写与翻译 S·91 — ★ 109.1k+397 ☆ 2 whisper.cpp Whisper 语音识别的 C/C++ 移植,纯本地推理 S·89 — ★ 53.7k+160 ☆ 3 GPT-SoVITS 1 分钟语音就能训出好听 TTS,少样本声音克隆 S·88 — ★ 61.8k+108 ☆ 5 VoxCPM 免 tokenizer 的多语言 TTS:创意声音设计与逼真克隆 S·86 — ★ 37.4k+576 ☆ AD ◧ 广告位招商中 —— 你的产品出现在这里 自助投放 · 周结算 · 广告内容与榜单排序无关 了解 → 广告 AD 8 ChatTTS 对话级中文语音合成,自然停顿与笑声 S·85 — ★ 39.8k+21 ☆ 9 index-tts 工业级可控高效的零样本 TTS 系统 S·84 — ★ 24.0k+161 ☆ 10 whisperX Whisper 增强版:词级时间戳 + 说话人分离 S·84 — ★ 24.0k+111 ☆ 11 FunASR 开源语音识别工具箱,全流程支持流式ASR S·84 — ★ 20.3k+107 ☆ 13 TTS 深度学习文本转语音工具箱,多语种声音克隆 S·83 — ★ 46.0k+25 ☆ 14 leon 开源个人语音助手 S·83 — ★ 17.5k+15 ☆ 15 CosyVoice 多语言语音大模型:推理/训练/部署全栈 S·82 — ★ 23.6k+118 ☆ 16 bark 文本直接生成带情绪的语音/音效/笑声 S·82 — ★ 39.3k+8 ☆ 22 espnet 端到端语音处理工具包,覆盖识别与合成 S·80 — ★ 10.0k+11 ☆ 23 vosk-api 离线语音识别 API,手机/树莓派/服务器全平台 S·80 — ★ 15.1k+14 ☆ 26 mlx-audio Apple MLX 上的 TTS/STT/语音转换库 S·79 — ★ 7.9k+37 ☆ 27 voice-pro 创作者的 Gradio 语音工作台:TTS + 零样本声音克隆 S·79 — ★ 12.8k+50 ☆ 28 edge-tts 免密钥调用微软Edge在线语音合成 S·79 — ★ 11.9k+59 ☆ 31 FunClip 基于FunASR的视频转录字幕与AI剪辑工具 S·78 — ★ 6.3k+76 ☆ 33 Amphion 音频、音乐与语音生成研究工具包 S·78 — ★ 10.3k+10 ☆ 34 dia 一次生成多角色超真实对话的TTS模型 S·78 — ★ 19.4k+6 ☆ 36 kaldi 经典开源语音识别工具包Kaldi S·77 — ★ 15.5k+6 ☆ 37 dograh 可自托管的开源语音AI平台 S·77 — ★ 5.7k+40 ☆ 43 wenet 面向生产环境的端到端语音识别工具包 S·76 ▼1 ★ 5.2k+2 ☆ 44 abogen 将电子书PDF一键转为带字幕有声书 S·76 ▼1 ★ 6.0k+82 ☆ 47 annyang 为网站提供语音识别功能的JS库 S·76 — ★ 6.8k☆ 51 MOSS-TTS-Nano A 100M-parameter multilingual TTS model for real-time CPU inference, voice cloning, and 48 kHz stereo generation S·75 — ★ 4.4k+60 ☆ 52 Applio 简单易用的高音质AI变声工具 S·75 — ★ 3.7k+25 ☆ 53 TTS Mozilla出品的深度学习语音合成库 S·75 — ★ 10.2k+1 ☆ 54 openless Hold a key, speak, release — AI-polished text appears at your cursor in any app. Open-source voice input for macOS & Windows. (按住快捷键说话,松开即得润 S·75 — ★ 3.5k+66 ☆ 55 vits 端到端语音合成模型,生成自然流畅的语音 S·74 — ★ 7.9k+3 ☆ 57 MOSS-TTS OpenMOSS团队开源的高保真语音生成模型家族 S·74 — ★ 4.1k+32 ☆ 60 ml-road 机器学习与智能体AI学习资源合集 S·74 — ★ 4.9k+4 ☆ 展示前 60 名 · 完整榜单见 每日热榜 →