AI音频
-
AssemblyAI API AssemblyAI
面向开发者的语音AI API 平台,提供从转录、理解到语音 Agent 的全链路基础设施
-
Gemini 3.1 Flash TTS Google
Google推出的新一代文本转语音模型,支持70+语言和音频标签导演级控制
-
Stable Audio Stable Audio
Stability AI 旗下 AI 音乐生成工具,文本/音频输入生成最长 6 分钟立体声音乐与音效
-
AIVA AIVA
AI 管弦乐配乐生成平台,支持 250+ 风格与商业版权购买
-
FunASR Tongyi Lab
阿里通义实验室开源的工业级语音识别工具包,50+语言170x实时率、私有化部署
-
Speechmatics Speechmatics
面向企业和开发者的低延迟语音 AI API,主打 56+ 语言转写、语音代理和多部署形态
-
Aispect Aispect
把现场语音实时变成可视化图像,让抽象演讲有了可分享的视觉表达
-
Fun-CosyVoice 3.5 FunAudioLLM
阿里通义实验室FunAudioLLM团队推出的多语种语音生成模型,支持FreeStyle自然语言指令控制与零样本语音克隆
-
Speechify Speechify
把朗读、语音输入AI 总结和语音问答打包成一套 Voice AI Productivity Assistant
-
AInterview AInterview
你做嘉宾 AI 做主持人,几分钟生成一期播客访谈
-
Fun-AudioGen-VD Alibaba Tongyi Lab
阿里通义实验室推出的音色设计模型,支持自然语言描述生成音色、情绪与场景化音频。
-
Soundraw Soundraw
AI 音乐创作平台,自由定制每个乐器的旋律与编曲











