LIVESSI 79,780.00▲0.01%
未登录 · 登录

大厅 / 🌍 国外 / 音频语音

音频语音

AUDIO · GLOBAL

收录 184今日新增 0数据源 GitHub 每日快照

音频语音(国外)分类当前收录 184 AI Skill,按 S-Score 排名靠前的有 whisper(S·91)whisper.cpp(S·89)OmniVoice-Studio(S·86)。S-Score 基于 GitHub 星标量级与维护活跃度算法计算,每小时重排、付费不影响排名,数据每日快照。

旗舰产品

FLAGSHIP · 官方闭源产品 · 不评 S-Score
本榜单每小时重排 · 方法论
1whisperOpenAI 开源语音识别,多语种转写与翻译91 109.1k+397
2whisper.cppWhisper 语音识别的 C/C++ 移植,纯本地推理89 53.7k+160
3OmniVoice-Studio开源本地语音克隆工具,ElevenLabs替代方案861 29.2k+8592
4VoxCPM免 tokenizer 的多语言 TTS:创意声音设计与逼真克隆86 37.4k+576
5whisperXWhisper 增强版:词级时间戳 + 说话人分离84 24.0k+111
6index-tts工业级可控高效的零样本 TTS 系统84 24.0k+161
广告位招商中 —— 你的产品出现在这里自助投放 · 周结算 · 广告内容与榜单排序无关了解 →广告 AD
7TTS深度学习文本转语音工具箱,多语种声音克隆83 46.0k+25
8pyvideotrans视频跨语言翻译,自动配音加字幕83 19.0k+81
9leon开源个人语音助手83 17.5k+15
10MockingBird5 秒克隆声音,实时生成任意语音82 36.9k
11bark文本直接生成带情绪的语音/音效/笑声82 39.3k+8
12CosyVoice多语言语音大模型:推理/训练/部署全栈82 23.6k+118
13supertonic极速端侧多语言 TTS(ONNX 原生)82 13.8k+9
14sherpa-onnx语音识别/合成/说话人分离全家桶,本地离线跑82 14.8k+107
15espnet端到端语音处理工具包,覆盖识别与合成80 10.0k+11
16speechbrain基于PyTorch的开源语音处理工具包80 11.8k+19
17SenseVoice多语种语音识别模型,支持情感与事件检测80 9.3k+48
18vosk-api离线语音识别 API,手机/树莓派/服务器全平台80 15.1k+14
19faster-whisperCTranslate2加速Whisper,转写快4倍80 25.4k+122
20edge-tts免密钥调用微软Edge在线语音合成79 11.9k+59
21mlx-audioApple MLX 上的 TTS/STT/语音转换库79 7.9k+37
22voice-pro创作者的 Gradio 语音工作台:TTS + 零样本声音克隆79 12.8k+50
23espeak-ng支持上百种语言的开源语音合成引擎78 6.8k+21
24dia一次生成多角色超真实对话的TTS模型78 19.4k+6
25speech_recognitionPython语音识别模块,支持多引擎多API78 9.0k+2
26Amphion音频、音乐与语音生成研究工具包78 10.3k+10
27Kokoro-FastAPIKokoro-82M文本转语音的Docker化API77 5.4k+22
28kaldi经典开源语音识别工具包Kaldi77 15.5k+6
29dograh可自托管的开源语音AI平台77 5.7k+40
30wav2letterMeta出品的端到端语音识别工具包77 6.4k
31wenet面向生产环境的端到端语音识别工具包761 5.2k+2
32pocketsphinx轻量级离线语音识别引擎761 4.3k+5
33silero-models开箱即用的预训练文本转语音模型库76 6.1k+12
34annyang为网站提供语音识别功能的JS库76 6.8k
35WhisperLive基于Whisper的近实时语音转写工具76 4.3k+25
36abogen将电子书PDF一键转为带字幕有声书761 6.0k+82
37porcupine设备端低延迟语音唤醒词检测引擎76 4.9k+5
38argmax-oss-swiftApple芯片本地运行的语音AI库76 6.4k+8
39TTSMozilla出品的深度学习语音合成库75 10.2k+1
40whisper-diarization基于Whisper的语音识别与说话人分离工具751 5.6k+2
41Applio简单易用的高音质AI变声工具75 3.7k+25
42MOSS-TTS-NanoA 100M-parameter multilingual TTS model for real-time CPU inference, voice cloning, and 48 kHz stereo generation75 4.4k+60
43vits端到端语音合成模型,生成自然流畅的语音74 7.9k+3
44MeloTTSMyShell出品的多语言高质量语音合成库74 7.6k+15
45elevenlabs-pythonElevenLabs语音合成官方Python SDK74 3.1k+9
46DiffSinger浅扩散机制驱动的歌声与语音合成74 4.9k+5
47ml-road机器学习与智能体AI学习资源合集74 4.9k+4
48RealtimeTTS实时文本转语音工具,支持流式语音合成74 4.0k+4
49MOSS-TTSOpenMOSS团队开源的高保真语音生成模型家族74 4.1k+32
50whisper-timestamped多语言语音识别,支持词级时间戳标注73 2.8k+1
51qwen-audio-agentA realtime voice runtime that keeps Agents talking, working, and present. Real-time Voice Runtime for AI Agents73 2.6k+239
52StyleTTS2风格扩散驱动,逼近人类水准的文本转语音73 6.3k+4
53TTS-WebUI整合多种语音合成引擎的Gradio+React WebUI731 3.3k+8
54willow开源本地自托管语音助手系统73 3.1k
55audio.cppAn all-in-one, pure C++ inference engine for audio models, powered by ggml. Supports TTS, STT, VAD, voice conversion, music generation, and 73 2.7k+369
56VieNeu-TTS越南语文本转语音工具,支持即时声音克隆73 2.6k+67
57whisper-asr-webservice基于Whisper的语音识别Web服务72 3.3k+4
58aeneas音频与文本自动强制对齐工具72 2.9k+5
59GPA单一小模型实现语音多功能处理72 3.1k
60whishper基于Whisper的本地语音转字幕工具72 3.1k+3

展示前 60 名 · 完整榜单见 每日热榜 →

SKILL·STUDY · 夜市每 10 分钟补货一次 · 排名公正性政策SKILL.STUDYS·96README 徽章 · 一键佩戴本夜市靈感來自 士林 · 寧夏 · 饒河