LIVESSI 79,387.00▲0.03%
未登录 · 登录

大厅 / 全部 / 音频语音

音频语音

AUDIO · ALL REGIONS

收录 175今日新增 0数据源 GitHub 每日快照

音频语音分类当前收录 175 AI Skill,按 S-Score 排名靠前的有 whisper(S·92)GPT-SoVITS(S·89)whisper.cpp(S·89)。S-Score 基于 GitHub 星标量级与维护活跃度算法计算,每小时重排、付费不影响排名,数据每日快照。

旗舰产品

FLAGSHIP · 官方闭源产品 · 不评 S-Score
本榜单每小时重排 · 方法论
1whisperOpenAI 开源语音识别,多语种转写与翻译922 105.9k+574
2GPT-SoVITS1 分钟语音就能训出好听 TTS,少样本声音克隆89 60.2k+163
3whisper.cppWhisper 语音识别的 C/C++ 移植,纯本地推理891 52.4k+317
4Retrieval-based-Voice-Conversion-WebUI检索式实时变声,几分钟训练个人声线87 36.8k+250
5fish-speech多语种零样本语音克隆TTS,低延迟高保真86 31.4k+77
6ChatTTS对话级中文语音合成,自然停顿与笑声85 39.7k+38
广告位招商中 —— 你的产品出现在这里自助投放 · 周结算 · 广告内容与榜单排序无关了解 →广告 AD
7MockingBird5 秒克隆声音,实时生成任意语音85 36.9k
8VoxCPM免 tokenizer 的多语言 TTS:创意声音设计与逼真克隆85 34.4k+473
9index-tts工业级可控高效的零样本 TTS 系统83 22.2k+204
10leon开源个人语音助手83 17.4k+17
11whisperXWhisper 增强版:词级时间戳 + 说话人分离83 23.3k+137
12FunASR开源语音识别工具箱,全流程支持流式ASR83 19.5k+131
13TTS深度学习文本转语音工具箱,多语种声音克隆83 45.8k+44
14pyvideotrans视频跨语言翻译,自动配音加字幕83 18.5k+71
15CosyVoice多语言语音大模型:推理/训练/部署全栈82 22.5k+136
16bark文本直接生成带情绪的语音/音效/笑声82 39.2k+13
17supertonic极速端侧多语言 TTS(ONNX 原生)82 13.5k+70
18OpenVoice秒级声音克隆,跨语言音色迁移82 37.0k+50
19sherpa-onnx语音识别/合成/说话人分离全家桶,本地离线跑82 13.8k+138
20vosk-api离线语音识别 API,手机/树莓派/服务器全平台81 15.0k+39
21voice-pro创作者的 Gradio 语音工作台:TTS + 零样本声音克隆80 11.3k+131
22espnet端到端语音处理工具包,覆盖识别与合成80 9.9k+5
23OmniVoice-Studio开源本地语音克隆工具,ElevenLabs替代方案80 9.2k+369
24faster-whisperCTranslate2加速Whisper,转写快4倍80 24.6k+169
25PaddleSpeech易用语音工具包,流式识别合成一体化80 12.7k+3
26edge-tts免密钥调用微软Edge在线语音合成79 11.6k+55
27mlx-audioApple MLX 上的 TTS/STT/语音转换库79 7.6k+39
28speechbrain基于PyTorch的开源语音处理工具包79 11.7k+15
29SenseVoice多语种语音识别模型,支持情感与事件检测79 9.0k+39
30Amphion音频、音乐与语音生成研究工具包78 10.0k+16
31espeak-ng支持上百种语言的开源语音合成引擎78 6.7k+26
32argmax-oss-swiftApple芯片本地运行的语音AI库781 6.3k+14
33dia一次生成多角色超真实对话的TTS模型78 19.4k+19
34annyang为网站提供语音识别功能的JS库77 6.8k+3
35FunClip基于FunASR的视频转录字幕与AI剪辑工具77 6.1k+31
36dograh可自托管的开源语音AI平台77 5.1k+87
37abogen将电子书PDF一键转为带字幕有声书77 5.4k+99
38kaldi经典开源语音识别工具包Kaldi77 15.4k+5
39speech_recognitionPython语音识别模块,支持多引擎多API77 9.0k+2
40wav2letterMeta出品的端到端语音识别工具包77 6.4k
41ASRT_SpeechRecognition基于深度学习的中文语音识别系统77 8.4k+2
42pocketsphinx轻量级离线语音识别引擎76 4.3k+2
43YouDub-webui开源AI视频本地化与配音工具76 5.2k+58
44DiffSinger浅扩散机制驱动的歌声与语音合成76 4.8k+6
45WhisperLive基于Whisper的近实时语音转写工具76 4.2k+45
46Kokoro-FastAPIKokoro-82M文本转语音的Docker化API761 5.3k+29
47ml-road机器学习与智能体AI学习资源合集75 4.9k+13
48silero-models开箱即用的预训练文本转语音模型库75 6.0k+10
49porcupine设备端低延迟语音唤醒词检测引擎751 4.9k+3
50Applio简单易用的高音质AI变声工具75 3.5k+25
51MOSS-TTSOpenMOSS团队开源的高保真语音生成模型家族75 3.9k+55
52whisper-diarization基于Whisper的语音识别与说话人分离工具75 5.6k+8
53TTSMozilla出品的深度学习语音合成库75 10.2k+2
54wenet面向生产环境的端到端语音识别工具包75 5.2k+37
55vits端到端语音合成模型,生成自然流畅的语音74 7.9k+3
56aeneas音频与文本自动强制对齐工具74 2.9k+3
57elevenlabs-pythonElevenLabs语音合成官方Python SDK74 3.0k+8
58EmotiVoice支持多音色与情感控制的TTS引擎74 8.5k+6
59TTS-WebUI整合多种语音合成引擎的Gradio+React WebUI74 3.2k+9
60willow开源本地自托管语音助手系统74 3.1k+7

展示前 60 名 · 完整榜单见 每日热榜 →

SKILL·STUDY · 夜市每 10 分钟补货一次 · 排名公正性政策SKILL.STUDYS·96README 徽章 · 一键佩戴本夜市靈感來自 士林 · 寧夏 · 饒河