AI音频
-
3D-Speaker
ModelScope 开源的多模态声纹识别与说话人分离工具包
-
Eleven Music ElevenLabs
ElevenLabs 的 AI 音乐生成平台,兼顾创作者工作台、商业授权市场和可嵌入式 Music API
-
OpenAI Whisper OpenAI
OpenAI 开源通用语音识别模型,支持多语种转录与翻译
-
Whisper OpenAI
OpenAI 开源通用语音识别模型,MIT 许可,支持 99+ 种语言的转写与翻译
-
ElevenLabs ElevenLabs
面向创作与客服场景的全栈 AI 语音与会话平台
-
OpenAI Advanced Voice OpenAI
ChatGPT 内置的实时语音对话模式,支持情感感知、打断交互与多轮自然对话
-
WellSaid Labs WellSaid
面向企业团队的高拟真文本转语音平台,主打安全合规的 AI 配音
-
Ekhos AI
AI 语音合成与音频内容创作平台
-
Omnilingual ASR Meta FAIR
Meta FAIR 开源 1600+ 语言的语音转写系统
-
Voicery Voicery
高质量AI语音合成服务,提供自然逼真的文字转语音能力
-
Ecrett Music ecrett
面向创作者的 AI 免版税配乐生成工具,按场景、情绪和类型快速生成可商用音乐
-
Omnilingual ASR Meta FAIR
Meta FAIR 开源 1600+ 语言的语音转写系统










