LIVESSI 79,780.00▲0.01%
未登录 · 登录

大厅 / 全部 / 音频语音

音频语音

AUDIO · ALL REGIONS

收录 184今日新增 0数据源 GitHub 每日快照

音频语音分类当前收录 184 AI Skill,按 S-Score 排名靠前的有 whisper(S·91)whisper.cpp(S·89)GPT-SoVITS(S·88)。S-Score 基于 GitHub 星标量级与维护活跃度算法计算,每小时重排、付费不影响排名,数据每日快照。

旗舰产品

FLAGSHIP · 官方闭源产品 · 不评 S-Score
本榜单每小时重排 · 方法论
1whisperOpenAI 开源语音识别,多语种转写与翻译91 109.1k+397
2whisper.cppWhisper 语音识别的 C/C++ 移植,纯本地推理89 53.7k+160
3GPT-SoVITS1 分钟语音就能训出好听 TTS,少样本声音克隆88 61.8k+108
4OmniVoice-Studio开源本地语音克隆工具,ElevenLabs替代方案861 29.2k+8592
5VoxCPM免 tokenizer 的多语言 TTS:创意声音设计与逼真克隆86 37.4k+576
6fish-speech多语种零样本语音克隆TTS,低延迟高保真851 32.7k+97
广告位招商中 —— 你的产品出现在这里自助投放 · 周结算 · 广告内容与榜单排序无关了解 →广告 AD
7Retrieval-based-Voice-Conversion-WebUI检索式实时变声,几分钟训练个人声线85 38.2k+51
8ChatTTS对话级中文语音合成,自然停顿与笑声85 39.8k+21
9index-tts工业级可控高效的零样本 TTS 系统84 24.0k+161
10whisperXWhisper 增强版:词级时间戳 + 说话人分离84 24.0k+111
11FunASR开源语音识别工具箱,全流程支持流式ASR84 20.3k+107
12pyvideotrans视频跨语言翻译,自动配音加字幕83 19.0k+81
13TTS深度学习文本转语音工具箱,多语种声音克隆83 46.0k+25
14leon开源个人语音助手83 17.5k+15
15CosyVoice多语言语音大模型:推理/训练/部署全栈82 23.6k+118
16bark文本直接生成带情绪的语音/音效/笑声82 39.3k+8
17sherpa-onnx语音识别/合成/说话人分离全家桶,本地离线跑82 14.8k+107
18MockingBird5 秒克隆声音,实时生成任意语音82 36.9k
19OpenVoice秒级声音克隆,跨语言音色迁移82 37.5k+59
20supertonic极速端侧多语言 TTS(ONNX 原生)82 13.8k+9
21SenseVoice多语种语音识别模型,支持情感与事件检测80 9.3k+48
22espnet端到端语音处理工具包,覆盖识别与合成80 10.0k+11
23vosk-api离线语音识别 API,手机/树莓派/服务器全平台80 15.1k+14
24faster-whisperCTranslate2加速Whisper,转写快4倍80 25.4k+122
25speechbrain基于PyTorch的开源语音处理工具包80 11.8k+19
26mlx-audioApple MLX 上的 TTS/STT/语音转换库79 7.9k+37
27voice-pro创作者的 Gradio 语音工作台:TTS + 零样本声音克隆79 12.8k+50
28edge-tts免密钥调用微软Edge在线语音合成79 11.9k+59
29PaddleSpeech易用语音工具包,流式识别合成一体化79 12.7k+2
30espeak-ng支持上百种语言的开源语音合成引擎78 6.8k+21
31FunClip基于FunASR的视频转录字幕与AI剪辑工具78 6.3k+76
32EmotiVoice支持多音色与情感控制的TTS引擎78 8.5k
33Amphion音频、音乐与语音生成研究工具包78 10.3k+10
34dia一次生成多角色超真实对话的TTS模型78 19.4k+6
35speech_recognitionPython语音识别模块,支持多引擎多API78 9.0k+2
36kaldi经典开源语音识别工具包Kaldi77 15.5k+6
37dograh可自托管的开源语音AI平台77 5.7k+40
38YouDub-webui开源AI视频本地化与配音工具77 5.5k+50
39wav2letterMeta出品的端到端语音识别工具包77 6.4k
40Kokoro-FastAPIKokoro-82M文本转语音的Docker化API77 5.4k+22
41ASRT_SpeechRecognition基于深度学习的中文语音识别系统77 8.4k
42argmax-oss-swiftApple芯片本地运行的语音AI库76 6.4k+8
43wenet面向生产环境的端到端语音识别工具包761 5.2k+2
44abogen将电子书PDF一键转为带字幕有声书761 6.0k+82
45pocketsphinx轻量级离线语音识别引擎761 4.3k+5
46silero-models开箱即用的预训练文本转语音模型库76 6.1k+12
47annyang为网站提供语音识别功能的JS库76 6.8k
48porcupine设备端低延迟语音唤醒词检测引擎76 4.9k+5
49WhisperLive基于Whisper的近实时语音转写工具76 4.3k+25
50whisper-diarization基于Whisper的语音识别与说话人分离工具751 5.6k+2
51MOSS-TTS-NanoA 100M-parameter multilingual TTS model for real-time CPU inference, voice cloning, and 48 kHz stereo generation75 4.4k+60
52Applio简单易用的高音质AI变声工具75 3.7k+25
53TTSMozilla出品的深度学习语音合成库75 10.2k+1
54openlessHold a key, speak, release — AI-polished text appears at your cursor in any app. Open-source voice input for macOS & Windows. (按住快捷键说话,松开即得润75 3.5k+66
55vits端到端语音合成模型,生成自然流畅的语音74 7.9k+3
56RealtimeTTS实时文本转语音工具,支持流式语音合成74 4.0k+4
57MOSS-TTSOpenMOSS团队开源的高保真语音生成模型家族74 4.1k+32
58DiffSinger浅扩散机制驱动的歌声与语音合成74 4.9k+5
59elevenlabs-pythonElevenLabs语音合成官方Python SDK74 3.1k+9
60ml-road机器学习与智能体AI学习资源合集74 4.9k+4

展示前 60 名 · 完整榜单见 每日热榜 →

SKILL·STUDY · 夜市每 10 分钟补货一次 · 排名公正性政策SKILL.STUDYS·96README 徽章 · 一键佩戴本夜市靈感來自 士林 · 寧夏 · 饒河