AIオーディオ
-
ディープグラム API AIStartMap
リアルタイム音声認識、合成、インテリジェント分析、会話型 AI エージェント インフラストラクチャを提供する統合音声 AI API プラットフォーム
-
エクレットの曲 ecrett
クリエイター向けAIロイヤリティフリーサウンドトラック生成ツール、シーン、気分、ジャンルごとに商用利用可能な音楽を素早く生成
-
イレブンミュージック ElevenLabs
イレブンラボの AI 音楽生成プラットフォームは、クリエイター ワークベンチ、商用ライセンス マーケットプレイス、埋め込み可能な音楽 API を組み合わせています
-
3Dスピーカー
ModelScope は、オープンソースのマルチモーダル声紋認識および話者分離ツールキットです。
-
エースステップ ACE-Step
ACE Studio と StepFun は共同で、音楽生成の基本モデルをオープンソース化し、効率的な生成と歌詞編集をサポートします。
-
魚オーディオ Fish
オープンソースの Fish-Speech モデルを背後に持つ、感情表現力に焦点を当てたテキスト読み上げおよび音声クローン作成プラットフォーム
-
エアロ-1-オーディオ Aero-1-Audio
わずか 1 億 5,000 万のパラメータを備えた軽量オーディオ モデルで、15 分間の連続オーディオ処理をサポート
-
楽しいアスル Fun-ASR
Tongyi Lab のオープンソースのエンドツーエンド音声認識モデルは、中国語の方言と 31 の言語をサポートしています。
-
Aインタビュー AInterview
あなたがゲスト、AI がホストとなり、数分でポッドキャスト インタビューが生成されます
-
Fun-AudioGen-VD Alibaba Tongyi Lab
Alibaba Tongyi Lab が発表した音色設計モデルは、音色、感情、シーンベースのオーディオを生成するための自然言語記述をサポートしています。
-
AssemblyAI API AssemblyAI
開発者向け音声 AI API プラットフォーム。文字起こしから理解、音声エージェントまでのフルリンク インフラストラクチャを提供
-
ジェミニ 3.1 フラッシュ TTS Google
Googleが発表した次世代の音声合成モデルは70以上の言語とオーディオタグディレクターレベルの制御をサポート











