1時間目
Hour One は、エンタープライズ レベルの AI バーチャル アンカー ビデオ生成プラットフォームであり、テキスト スクリプトを使用して AI デジタル ヒューマン アンカーの話し言葉ビデオを駆動し、複数の言語とアンカーの役割をサポートします。
HourOne
1 時間目のコアパラメータと統計
| パラメータ項目 | 説明 |
|---|---|
| 製品のポジショニング | エンタープライズレベルの AI バーチャルアンカービデオ生成プラットフォーム |
| 仮想アンカーの役割 | 100 以上のプリセット役割 + カスタマイズされた企業デジタル担当者 |
| サポートされている言語 | 自動口調整機能を含む 30 以上の言語 |
| 出力品質 | 最大4K (3840×2160) |
| シナリオテンプレート | 200 以上の業界テンプレート (トレーニング、マーケティング、製品デモンストレーションなど) |
| 入力形式 | テキスト スクリプト PPT/PDF、URL コンテンツのインポート |
| ライブブロードキャストモード | AIアンカーによるリアルタイムライブブロードキャストをサポート(API統合が必要) |
| 導入方法 | SaaS クラウド + エンタープライズ プライベート展開 (エンタープライズ プラン) |
| APIアクセス | RESTful API、バッチビデオ生成とワークフロー統合をサポート |
| プラットフォームのサポート | ウェブ (Chrome/Firefox/Edge) + API |
ポジショニングの解釈: デジタル ヒューマン ビデオの分野における Hour One の主な違いは、消費者レベルではなく「企業レベル」です。市販されている一般的なショートビデオ デジタル ヒューマン生成ツールと比較して、Hour One は出力品質要件が高く (4K 配信)、カスタマイズ可能性が高く (ブランド デジタル ヒューマンのトレーニングとキャリブレーション)、コンプライアンス シナリオでのブランド デジタル ヒューマン イメージ管理をサポートします。対象となる顧客は、個人の YouTuber やソーシャル メディア クリエーターではなく、人的規模とプロセスの標準化要件 (企業トレーニング、マーケティング、電子商取引業務) を持つ組織です。 主な制約: カスタム デジタル ヒューマンの作成には、高品質の実写ビデオ素材 (通常は 5 ~ 15 分のマルチアングル正面撮影が必要) の提出が必要です。つまり、初期展開には一定の制作準備期間が必要であり、純粋に合成された仮想キャラクターのようにそのまま使用することはできません。
Hour One のユーザーと市場の認知度
現場でのユーザーの意識が徐々に高まり、コンテンツ作成者やチームは製品の機能を使用して作業効率を向上させます。特定のユーザー規模および業界での採用データは、公式リアルタイム ページの対象となります。
1 時間目のコストメリット
Hour One のコスト構造は、ユーザーのタイプに基づいて、個人/チームの API 開発者、企業/民営化の 3 つの層に分かれています。各層の請求ロジックと隠れたコストはまったく異なります。
C サイド/個人およびチーム
Hour One には無料プランはありません。エントリー プランでは、小規模チーム向けに、一定量のビデオ生成時間と 720p 出力を含む月額サブスクリプションを提供します。主な制限は次のとおりです。
- 出力品質の制限: エントリー プランは通常 720p に制限されており、4K 出力はエンタープライズ プランでのみ利用可能です。
- デジタル ヒューマン キャラクター数: エントリーレベル プランではプリセット キャラクターの数が限られており、独自のデジタル ヒューマンをカスタマイズするにはプランをアップグレードする必要があります。
- 商用認可の範囲: エントリーレベル プランのビデオ使用範囲は制限される場合があります。企業は、シナリオを外部に公開する場合、完全な商業的認可が含まれているかどうかを確認する必要があります。
API/開発者
Hour One は、ビデオの長さによって料金が請求される API ソリューションを提供します。これは、デジタル ヒューマン ビデオ機能を独自のシステムのワークフローに統合するのに適しています。 API の価格は次の影響を受けます。
- 出力解像度: 720p と 4K の単価差は 2 ~ 3 倍になる場合があります。
- デジタル ヒューマン キャラクターの選択: カスタム デジタル ヒューマン キャラクターを使用する API 呼び出しは、通常、プリセット キャラクターよりもコストがかかります。
- ボリューム ディスカウント: 年間使用量または前払い分を約束すると、段階的な割引が受けられます。
開発者向けヒント: API ソリューションを評価する場合は、「ビデオのレンダリング時間」と「課金時間」の換算関係を計算に含めることをお勧めします。一部のプラットフォームでは、完成したビデオの長さではなくレンダリング時間に基づいて料金が請求されるため、この 2 つの間に違いがある場合があります。
企業/民営化
エンタープライズプランは年間契約制を採用しており、以下の代表的なコンポーネントが含まれます。
- 年間サブスクリプション料金: 一定量のビデオ生成をカバーする、プラットフォームの基本使用料。
- カスタマイズされたデジタル ヒューマン トレーニング料金: 企業固有のデジタル ヒューマンを作成するたびに、口の形、表情、動きの専門的な調整を含む 1 回限りのトレーニング料金を支払う必要があります。
- プライベート展開追加料金: 顧客独自の領域 (VPC またはローカル データ センター) に展開する必要がある場合は、追加のインフラストラクチャ認証料金を支払う必要があります。
- SLA およびテクニカル サポート: 通常、エンタープライズ プランには、専任のアカウント マネージャー、優先的なテクニカル サポートの対応、および 99.9% の可用性 SLA が含まれます。
主要なコスト変数: Hour One のエンタープライズ プランは公開価格表をサポートしておらず、すべては商談の対象となります。これは、調達までの時間コストが高くつくことを意味します。要件の伝達、POC 検証、契約交渉などの複数の段階を経る必要があります。通常、最初の連絡から正式な展開までに 4 ~ 8 週間かかります。
競合製品のコスト比較控除 (年間総コストに基づく、非公式データ、参考のみ):
| コスト ディメンション | 1 時間目 | シンセシア | ヘイジェン | 説明 |
|---|---|---|---|---|
| エントリープランの月額料金 | 未公開 | 月額 29 ドルから | 月額 24 ドルから | Hour One が純粋に個人的なプランを提供するかどうかは、公式 Web サイトに従うものとします。 |
| 4K出力対応 | エンタープライズプラン | エンタープライズプラン | エンタープライズプラン | 3 社とも、エンタープライズ バージョンの差別化された機能として 4K を使用しています。 |
| カスタムデジタルヒューマン研修料金 | 1 回限りのビジネス見積もり | 1 回限り $1000 以上 | 一回限りのお見積り | トレーニング料金は通常、年間サブスクリプション料金には含まれていません。 |
| API 請求単位 | 分/解像度 | 分/解像度 | 分/解像度 | 動画の長さに基づいた業界全体の料金請求 |
| 企業向けの最小年間コミットメント | ビジネスの確認が必要です | 年間 $12,500 から | ビジネスの確認が必要です | 企業顧客向けの最低年間契約額 |
Hour One の主な機能
AI デジタル ヒューマン アンカー: さまざまな年齢、性別、人種のキャラクターを含む 100 以上のプリセット キャラクターのライブラリから仮想アンカー画像を選択します。デジタル ヒューマン アンカーは、体の動き、表情、口の動きを AI によって制御します。録画のために実際の人間がカメラに映る必要はありません。 実装のヒント: プリセット キャラクターのアクションの豊富さとジェスチャーの習慣はまったく同じではありません。大量生産の前に、小規模な A/B テストを実施して、ブランド トーンに最も適合するキャラクターを選択し、異なる動画間でのアンカー スタイルのジャンプを避けることをお勧めします。
言語対応リップシンク: 30 以上の言語でのテキスト入力をサポートします。デジタルパーソンがさまざまな言語を話すとき、口の形は言語の発音の特徴に自動的に一致します。英語と日本語では、口の動きのパターンがまったく異なります。英語では、唇と歯の接触や顎の開閉がより顕著に必要となりますが、日本語は顎の動きが少ないという特徴があります。 Hour One の言語対応口形状予測モデルは、単純に口の形状をオーディオ トラックのタイムラインに合わせるのではなく、入力テキストの言語に応じて口の形状生成パラメータを自動的に切り替えます。 受け入れに関する懸念事項: 購入する前にターゲット言語 (特に必要な言語の組み合わせ) で実際のテストを行い、特定の言語での口の形の自然さが期待どおりであるかどうかを確認することをお勧めします。
PPT/PDF からビデオ: PowerPoint または PDF ファイルをアップロードすると、AI が各ページの重要なポイントを自動的に分析し、対応する説明スクリプトを生成します。デジタルヒューマンアンカーがビデオでページごとに説明しており、ページを切り替えるときの視覚的な遷移が自然です。 動作メカニズム: システムは最初に文書のテキスト階層 (タイトル、段落、リスト) を抽出し、次に各ページに独立した説明段落を生成し、最後にそれらを連結して完全なビデオ スクリプトを作成します。図表や写真を含むページの場合、システムは自動的に写真を保持し、口頭ブロードキャスト中に対応するナレーション ガイダンスを提供します。この機能は主にトレーニング シナリオと製品デモンストレーションを目的としており、静的ドキュメントを配布可能および保持可能なビデオ アセットに変換します。
リアルタイム ライブ ブロードキャスト アンカー (v4 の新機能): AI デジタル ピープルは、リアルタイム ライブ ブロードキャスト ストリームにアクセスし、リアルタイム入力スクリプト、集中砲火、または Q&A コンテンツに基づいてホストの口頭応答を動的に生成できます。 技術実装パス: この機能は、API を介して Hour One のレンダリング エンジンをライブ ストリーミング ツールに統合する必要があり、サードパーティのライブ ブロードキャスト プラットフォーム (YouTube Live、Twitch、企業所有のライブ ブロードキャスト システムなど) によって配信されます。 Hour One は独立したライブ ブロードキャスト プラットフォームを提供しませんが、既存のライブ ブロードキャスト ワークフローをレンダリング モジュールの形式で埋め込みます。これは、企業が統合を完了するには、一定の技術開発能力が必要であることを意味します。
ブランド デジタル ヒューマンのカスタマイズ: ブランドの広報担当者または実際の従業員に基づいて、独自のデジタル ヒューマン イメージを作成します。作成プロセスには通常、5 ~ 15 分のマルチアングル正面高解像度ビデオ素材の提出 → Hour One チームが唇、表情、動きのプロレベルの調整トレーニングを実施 → 公式の外部コンテンツに使用できるブランドのデジタル ピープルを出力します。 使用の境界: カスタマイズされたデジタル ピープルは、現実の人物が登場するシーンを完全に置き換えることはできません。豊かな微表情や高い感情的緊張が要求されるコンテンツ (CEO のスピーチ、感情的なブランド ストーリーなど) では、カスタマイズされたデジタル ピープルと現実の人物のパフォーマンスの間には、依然として目に見えるギャップが存在します。
チーム コラボレーションとワークフロー: スクリプト管理、ビデオ承認、バージョン管理、プロジェクト レベルの権限制御など、マルチユーザー チーム コラボレーションをサポートします。エンタープライズ プランでは、API バッチ呼び出しおよびカスタム ビデオ テンプレート ライブラリ管理のための SSO (シングル サインオン) との統合もサポートされています。
Hour One のモデルとバージョンの進化
Hour One バージョンの進化は、エンタープライズ レベルのデジタル ヒューマン ビデオ テクノロジーが「利用可能」から「使いやすい」への道を反映しています。中心となるコンテキストは、カスタマイズされたデジタル ヒューマン、多言語機能、リアルタイム インタラクションの 3 つの方向に焦点を当てています。
v2.0 (2024-08): 多言語およびシーン テンプレートの画期的な
2 番目のメジャー バージョンでは、「単一言語、単一シーン」の制限が解決されています。
- 主要なユーラシア言語をカバーする多言語リップシンク機構を導入。
- トレーニング、マーケティング、製品説明などの一般的な企業シナリオをカバーする 200 以上の業界シナリオ テンプレートをリリースしました。
- 50 以上の文字の選択肢を提供する、プリセット文字ライブラリの初期確立。
- ビデオ生成機能のサードパーティ システム コールをサポートするための基本的な API インターフェイスを開始しました。
このバージョンのマイルストーンは、「単一のデジタルヒューマンデモンストレーション」から「複数の言語と複数のシナリオをサポートできるコンテンツ制作ツール」に拡張することです。
v3.0 (2025-06): カスタムのデジタル人材とブランディング
3 番目のバージョンでは、製品が「ユニバーサル ツール」から「エンタープライズ ブランド資産」に移行します。
- コア新機能: カスタムデジタルヒューマンイメージ作成機能。企業は、実際の人物の映像に基づいて専用のデジタル ヒューマンをトレーニングでき、出力効果は口の形、表情、動きで専門的に調整されます。
- デジタル ヒューマン キャラクターの自然さの向上: より洗練された顔の動きユニット制御を導入して、「不気味の谷」効果を軽減します。
- テンプレート システムのアップグレード: エンタープライズ向けにカスタマイズされたブランド テンプレート ライブラリをサポートし、ビデオのビジュアル スタイルを統一します。
- API 機能の強化: スクリプトとビデオ生成タスクのバッチ送信をサポートします。
このバージョンの課題は、デジタル ヒューマンをカスタマイズするためのトレーニング期間が長く (通常 2 ~ 4 週間)、実写の映像に対する品質要件が高いことです。すべての企業が、適切なトレーニング資料を迅速に提供できるわけではありません。
v4.0 (2026-05): ライブ ブロードキャストとビデオへの PPT
最新バージョンは、リアルタイムの対話とドキュメントのビデオへの自動変換に重点を置いています。
- リアルタイム ライブ ブロードキャスト アンカー: AI デジタル担当者はライブ ストリームにアクセスし、リアルタイム スクリプトまたは Q&A に基づいて口頭ブロードキャストを動的に生成できます。ただし、注意してください: Hour One はライブ ブロードキャスト プラットフォームではなくレンダリング エンジンを提供するため、企業はライブ ブロードキャスト システムの統合を自社で完了する必要があります。
- PPT をビデオに: PPT/PDF をアップロードし、重要なポイントを自動的に抽出してスクリプトを生成し、デジタル担当者がページごとに説明します。この機能により、「ドキュメントからビデオへ」制作の敷居が大幅に下がります。
- 唇同期精度の最適化: 口の形と発音の不一致の問題を軽減するために、中国語、日本語、韓国語、その他のアジア言語に対して特別な最適化が行われています。
- 4K 出力は製品レベルの安定性 (エンタープライズ ソリューション) に達し、フレーム レートは 30fps をサポートします。
- エンタープライズ レベルのバッチ制作シナリオでのスケジュールの最適化をサポートするビデオ レンダリング キュー管理を追加しました。
バージョン選択の提案: シーンに単一言語のプリセット文字と基本的な音声ビデオのみが必要な場合は、v2/v3 の機能はすでにカバーされています。ブランドのデジタルカスタマイズや多言語コンテンツ制作が必要な場合は、v3/v4 の精度の最適化をアップグレードする価値があります。リアルタイム ライブ ブロードキャスト モードはまだ商用化の初期段階にあるため、決定を下す前にライブ ブロードキャストの統合計画を確認することをお勧めします。
Hour One の技術的利点
2D ニューラル レンダリングと 3D モデリング
Hour One のデジタル ヒューマン テクノロジー ルートは、従来の 3D モデリング + ボーン バインディング ソリューションではなく、2D ニューラル レンダリング (ニューラル レンダリング) に基づいています。 2D ニューラル レンダリングの中心となるアイデアは、多数の実際の人物の会話ビデオを通じてエンドツーエンドの顔生成モデルをトレーニングすることです。テキスト/音声信号を入力すると、3D顔メッシュを構築することなく、唇、表情、頭の姿勢の連続画像を直接生成できます。
動作メカニズム: トレーニング段階では、特定のキャラクターの数時間のビデオが収集され、口の形状の状態と各フレームの対応する音素/テキストのシーケンスがマークされます。推論段階では、入力テキストの音声特徴と参照フレームを考慮して、モデルが顔の動きパラメータを予測し、出力画像をフレームごとにレンダリングします。このルートの利点は次のとおりです。
- 高い自然さ: 出力画像は、3D モデルの「プラスチック感」ではなく、実際の人物の肌の質感、光の質感、顔の微小な動きを保持します。
- 優れた口形状精度: 口形状マッピング関係はビデオ データを使用して直接トレーニングされ、理論的には 3D ボーン バインディングの口形状範囲よりも自然です。
- 計算能力要件はトレーニング側に集中しています: 推論 (ビデオの生成) に必要な計算能力はトレーニングよりもはるかに低く、SaaS 大規模配信に適しています。
コストと制限: 2D ニューラル レンダリングの弱点は視野角の制限です。デジタル ユーザーは通常、正面または正面に近い角度しか維持できず、頭を大きく回転させたり横に回転させたりすると画像の歪みが発生します。さらに、長時間のビデオでは顔のテクスチャのちらつきや口の形のドリフトが発生する可能性があり、フレーム後のスムージング処理によって軽減する必要があります。
言語を意識した口の形の予測
多言語リップシンクのエンジニアリングの難しさは、過小評価されがちです。言語ごとに発音の口の形の特徴は大きく異なります。
- 英語では、唇と歯の接触 (例: /f/、/v/) と顎の開閉の変化が必要です。
- 日本語は顎の小さな動きに支配されており、唇の形状の変化は母音に集中しています。
- 中国語 (マンダリン) の 4 声調の変化は、口の形状の持続時間の分布にわずかに影響します。
- ドイツ語とフランス語の口蓋垂母音/円唇母音には、特別な唇の処理が必要です。
Hour One の 言語対応リップシンク ソリューションは、言語ごとに独立した口の形状予測ブランチをトレーニングまたは微調整し、推論段階で入力テキストの言語ラベルに応じて対応するブランチを自動的に切り替えます。これは、「すべての言語をカバーするように一般的なモデルをトレーニングする」というソリューションよりも、さまざまな言語にわたる口の形状のパフォーマンスが安定しています。
4K 出力パイプライン
4K デジタル ヒューマン ビデオの生成には、次の体系的なエンジニアリングの最適化が含まれます。
- レンダリング パイプライン: 2D ニューラル レンダリングでは、各フレームの独立した生成によって引き起こされるちらつきを避けるために、顔の生成から完全なビデオの合成まで 4K 解像度でフレームの一貫性を維持する必要があります。
- エンコーディングの最適化: 4K ビデオのコード レート制御とエンコーディング効率は、出力ファイル サイズと再生の滑らかさに直接影響します。 Hour One では、さまざまな配信プラットフォームの要件に合わせて調整可能なエンコード パラメーターが提供されます。
- レンダリング時間: 4K ビデオのレンダリング時間は、通常、ビデオの長さの 2 ~ 5 倍です (キャラクターの複雑さとシーン テンプレートによって異なります)。バッチ タスクでは、レンダリング キューの合理的な計画が必要です。
エンタープライズ統合アーキテクチャ
Hour One のプラットフォーム アーキテクチャは、バックボーンとして API を使用して、会社の既存のワークフローとの統合をサポートします。
「」 エンタープライズ システム (LMS/HRMS/CMS) → API ゲートウェイ → Hour One レンダリング エンジン §── デジタルヒューマンロールマネジメント §── スクリプトと音声の合成 §── リップシンクとビデオレンダリング └── 映像出力・配信 「」
エンジニアリング上の落とし穴に関するガイド:
- バッチ レンダリングの同時実行制限: Hour One の API ソリューションには通常、同時レンダリング タスクの数に上限があります。それを超えるとキューに入れられて待機します。大量生産する場合は、一度に大量に送信すると一部のタスクがタイムアウトになるのを避けるために、最初にスクリプトをバッチで送信することをお勧めします。
- カスタム キャラクター トレーニング資料の仕様: トレーニング資料を自分で記録する場合、よくある落とし穴には、背景が雑然としている (AI のキャラクター セグメンテーションの精度が低下する)、照明が不均一である (出力で顔の明るい部分と暗い部分が一貫していないことになる)、過剰な撮影角度 (2D モデルは正面以外の視点をカバーできない) などがあります。公式の撮影ガイドラインに厳密に従うことをお勧めします。
- ライブ ブロードキャスト遅延制御: リアルタイム ライブ ブロードキャスト モードでは、入力テキストからデジタル人口同期出力までのエンドツーエンド遅延が中心的な指標となります。 Hour One のレンダリング エンジンは、超低遅延 (500 ミリ秒未満) シナリオ向けに設計されていないため、リアルタイム Q&A ライブ ブロードキャストでは 2 ~ 5 秒の応答遅延が発生する可能性があります。
1 時間目の使用方法
Hour One には、さまざまなユーザーの役割とシナリオに適した 2 つの主要な入り口があります。
Web エディター (技術者以外のユーザー向け)
ブラウザから Hour One 公式 Web サイトにアクセスし、登録を完了すると、Web インターフェイスでビデオ制作の完全なプロセスを完了できます。
- 役割の選択: プリセット キャラクター ライブラリからデジタル ヒューマン アンカーを選択するか、トレーニングを受けた企業固有のデジタル ヒューマンを選択します。
- 入力スクリプト: ホストの話した内容をテキスト形式で入力し、一時停止マークとトーン プロンプトの挿入をサポートします。
- テンプレート/レイアウトの選択: ビデオの背景テンプレート (ブランド カラーのロゴ、グラフィック、テキスト レイアウトを含む) を選択するか、カスタム背景をアップロードします。
- プレビューと調整: プレビュービデオを生成して、リップシンク効果、体の動き、全体のリズムを確認します。
- レンダリング エクスポート: 出力解像度と形式 (主に MP4) を選択し、レンダリング タスクを送信して完了を待ちます。
技術者以外のユーザーが最初のビデオ制作を独力で完了するのにかかる一般的な学習コストは、約 1 ~ 2 時間です。
API 統合 (開発者向け)
API ソリューションは、デジタル ヒューマン ビデオ機能を企業所有のシステムに組み込むために使用されます。コア API エンドポイントには次のものが含まれます。
| エンドポイント | 機能 | 典型的な使用シナリオ |
|---|---|---|
POST /v1/videos |
ビデオ生成タスクを送信する | スクリプト テキストからデジタル ヒューマン ビデオを作成する |
GET /v1/videos/{id} |
タスクのステータスを問い合わせる | 投票レンダリングの進行状況 |
POST /v1/characters |
カスタムのデジタル人物を作成する | ブランド化されたデジタル人材を作成するためのトレーニング資料を提出する |
GET /v1/templates |
利用可能なテンプレートのリストを取得する | コンテンツに一致するテンプレートを自動的に選択 |
POST /v1/live/stream |
ライブブロードキャストモードを開始 | リアルタイムのライブ ストリームにアクセス |
クイック スタートの例 (疑似コード プロセス): 「」パイソン
1. API キーを取得する (Hour One コンソールで生成)
2. ビデオ生成タスクを送信する
投稿 https://api.hourone.ai/v1/videos
ヘッダー: 権限: ベアラー
3. ポーリングタスクのステータス
https://api.hourone.ai/v1/videos/{video_id} を取得します
4. 完成した動画をダウンロードする(ステータスが完了した場合)
「」
注意: 上記のエンドポイントの名前とパラメーターは参照のみを目的としています。 1 時間目の実際の API ドキュメントが優先されます。
企業民営化の展開
エンタープライズ ソリューションは、顧客独自の環境での Hour One レンダリング エンジンの展開をサポートします。これは、高度なデータ セキュリティ要件や機密性の高いビデオ コンテンツ (財務コンプライアンス、医療トレーニングなど) を必要とする業界に適しています。導入サイクルは、コンテキストの評価、導入の実装、エンタープライズ システムとの統合と共同デバッグを含めて、通常 4 ~ 8 週間です。
1 時間あたりの製品価格
Hour One では、無料プランを含む公開価格表は提供されていません。以下の情報は、製品開示ページ、業界の慣行、および競合製品のベンチマーク分析に基づいています。実際の価格は公式のリアルタイム相場の影響を受けます。
計画レベルの概要
| 計画 | 対象ユーザー | 請求方法 | 一般的な制限 |
|---|---|---|---|
| スタータープラン | 小規模チーム | 月額購読 | 720p 出力、事前構築されたキャラクター、時間制限 |
| プロフェッショナルプラン | 中規模のチーム/部門 | 月額/年間サブスクリプション | 1080p、より多くのロールとテンプレート、基本的な API |
| エンタープライズプラン | 大組織 | 年間契約 | 4K、カスタム デジタル ピープル、プライベート展開オプション |
| APIプラン | 開発者/ISV | 分単位の請求 | 解決策と役割のタイプごとに異なる価格設定 |
コスト構成の詳細
- サブスクリプション基本料金: ユーザーまたはチーム シートごとに請求されるプラットフォーム使用料金。
- ビデオ生成料金:ビデオの長さ (分) に基づいて請求されます。解像度が高くなると単価も高くなります。
- カスタム デジタル ヒューマン トレーニング料金: 材料評価、モデル トレーニング、品質校正を含む 1 回限りの料金。
- API 呼び出し料金: API 呼び出しの数またはビデオの生成時間に基づいて請求されます。通常、毎月の最低使用量要件があります。
- 民営化導入追加料金: インフラストラクチャの認可、運用およびメンテナンスのサポートを含め、毎年請求されます。
無料の割り当てとトライアル
アワーワンが無料お試しプランを提供するかどうかは、公式ウェブサイトの最新のポリシーに従うものとします。業界の慣行では通常、効果を検証するために企業顧客に期間限定の無料 POC (概念実証) アカウントを提供しますが、出力解像度、デジタル ヒューマン ロールの選択、およびビデオ ウォーターマークが制限される場合があります。
購入の提案: 正式な見積もりを取得する前に、次の変数を明確にすることをお勧めします - ① 予想される月間合計ビデオ制作時間、② 必要な最高出力解像度、③ カスタマイズされたデジタル ヒューマンが必要かどうか、④ 多言語コンテンツが含まれるかどうか、⑤ API 統合または民営化された展開が必要かどうか。これらの変数は、最終的な価格計算に直接影響します。
1 時間目のアプリケーション シナリオ
企業研修ビデオ(経費削減控除)
シナリオの説明: 大企業の人事トレーニング チームは、世界中の従業員向けに、オンボーディング トレーニング、コンプライアンス トレーニング、製品知識トレーニング ビデオをさまざまな言語で作成する必要があります。従来の方法では、スタジオを借り、実際のインストラクターを雇い、ポストエディットを行い、多言語の字幕/吹き替えを行う必要があります。 1 コースの制作サイクルは約 5 ~ 10 営業日で、コストは数千ドルから数万ドルの範囲です。
Hour One プラン: 人事チームは、企業ブランドのデジタル ヒューマン講師を作成し、ワンクリックで Hour One の PPT からビデオ機能を介して、トレーニング PPT をデジタル ヒューマンの説明付きのトレーニング ビデオに変換します。講師スクリプトは統一的に記述され、APIを通じて一括翻訳され多言語版が生成されます。各バージョンのデジタル人口統計は、ターゲット言語に自動的に調整されます。
コスト削減と効率向上の定量的控除 (業界平均データに基づいており、Hour One からの正式な約束ではありません):
| 中程度 | 伝統的な方法 | 1時間プラン | 時短勤務 |
|---|---|---|---|
| シングルコース撮影 | 1 日 (セットおよび機器のデバッグを含む) | 0 (実際の人物の撮影は必要ありません) | 100% |
| 多言語吹き替え・字幕 | 3~5日(外注翻訳+吹き替え) | API自動生成(30分) | 90%以上 |
| ポストエディット | 2~3日(ラフカット+微編集) | プレビューと微調整 (1 ~ 2 時間) | 80%以上 |
| マルチバージョンメンテナンス | 各言語の独立したファイル管理 | 単一のスクリプト + 言語パラメータ | 60%以上 |
人間とマシンのコラボレーションの境界: スクリプトの内容 (特に規制遵守に関わる部分) は、AI 生成後に法務/コンプライアンス チームによって手動でレビューされる必要があります。ブランドデジタルヒューマンの最初のトレーニングでは、実際の人間が素材を記録する必要があり、完全に AI で生成することはできません。完成したビデオは、従業員に公開する前にトレーニング部門による最終確認を受ける必要があります。
マーケティング動画の大規模制作(コスト削減控除)
シナリオの説明: ブランド マーケティング部門は、さまざまな言語市場 (英語、スペイン語、日本語、韓国語など) 向けにローカライズされた製品紹介ビデオを作成する必要があります。従来の手法では、市場ごとに撮り直しや現地の声優を起用して再収録する必要があり、時間がかかり、ブランドの一貫性を保つことが困難でした。
Hour One ソリューション: ブランドに合わせてカスタマイズされたデジタル ヒューマンを統一アンカーとして使用します。中国語のスクリプトが書かれた後、ターゲット言語に翻訳されます。 Hour One を通じて入力すると、対応する言語でのデジタル人間放送ビデオが自動的に生成されます。デジタル担当者の服装、背景、ブランド要素はすべての言語バージョンで一貫しており、音声言語を切り替えるだけで済みます。
人間と機械のコラボレーションの境界: 異文化マーケティングにおける重要な情報 (スローガン、文化的に敏感なコンテンツなど) は、現地の市場チームによる手動レビューが必要であり、機械翻訳と AI による口頭ブロードキャストの自動化されたリンクに完全に依存することはできません。ハイエンドブランドのキャンペーンの中心的なビデオは、依然として実際の人間によって撮影されることが推奨されており、AI デジタル ヒューマンは、高頻度で中低コストの日常的なマーケティング コンテンツ (製品の更新手順、プロモーション イベントの紹介 FAQ ビデオなど) により適しています。
Eコマースライブ中継AIアンカー(コスト削減控除)
シナリオの説明: 電子商取引プラットフォームは、オフピーク時間 (午前 0 時から午前 8 時まで) に製品説明の 24 時間ライブ ブロードキャストを実施する必要があります。ライブ アンカーのスケジューリング コストは高く、トラフィックが少ない時間帯では ROI が低くなります。
Hour One ソリューション: Hour One のライブ ブロードキャスト モード API を e コマース ライブ ブロードキャスト ルームに接続し、AI デジタル ヒューマン アンカーを構成して、製品情報を自動的に説明し、無人時間中によくある質問に回答します。ライブブロードキャストスクリプトは、運用チームによって事前に作成またはナレッジベースで構成されており、AIアンカーは設定されたフレームワーク内で対話します。
コスト削減と効率向上の定量的控除:
| 寸法 | ヒューマンアンカー(3交替) | AI アンカー (1 時間目) | 変更点 |
|---|---|---|---|
| 月々の人件費 | 3名×15,000円=45,000円 | API利用料(概算) | コストの 50 ~ 70% 削減 |
| 補償期間 | 1 日あたり 16 時間 (スケジュール上のギャップを含む) | 24時間ノンストップ | 50% 改善 |
| 商品説明取材 | セッションあたり 20 ~ 30 SKU | セッションごとに 50 ~ 100 SKU | 2~3倍の改善 |
人間と機械のコラボレーションの境界: AI アンカーは、複雑な顧客の苦情、価格交渉、限定版の急ぎ販売など、感情的に緊張するシナリオの処理には適していません。ライブブロードキャストルームに「AIアンカー+実際の担当者」モードを設定することをお勧めします。AIアンカーは通常期間中は製品説明を担当し、複雑な質問や購入決定のガイダンスに遭遇した場合は、実際の担当者のカスタマーサービスに転送されます。さらに、AI が生成する不適切な表現によるブランド リスクを回避するために、AI アンカーの発話内容は運用チームによるコンプライアンス レビューを受ける必要があります。
他の適応シナリオ
- 製品デモンストレーション ビデオ: API を通じてバッチで生成される、SaaS 企業の製品アップデートの説明ビデオ。
- 社内コミュニケーション ビデオ: 経営陣による四半期ごとの全メンバーへのレター、政策プロモーション、その他の社内ビデオはすべて、ブランドのデジタル担当者によって紹介されています。
- コンプライアンス トレーニング ビデオ: 金融業界および医療業界における定期的なコンプライアンス トレーニングでは、従業員の学習の進捗状況を記録する必要があります。
1時間目の対象者
企業のトレーニングおよび人事チーム: トレーニング ビデオを高頻度で制作する必要がある企業のトレーニング部門に適しています。 Hour One の PPT からビデオへの変換機能により、コースウェアからビデオへの変換コストが直接削減され、ブランドのデジタル人材が企業内トレーニングの講師として登場する可能性があります。 不適当な境界: トレーニング コンテンツを頻繁に (週に数回) 更新する必要があり、ビデオの長さが 30 分を超えるシナリオでは、レンダリング コストと更新メンテナンス コストが大幅に増加します。本格的なプロモーションの前に、小規模なパイロットを使用して検証することをお勧めします。
マーケティング部門: 多言語のローカライズされたマーケティング コンテンツを必要とする企業のマーケティング チームに適しています。ブランドのデジタル担当者は、さまざまな市場でビデオのブランドの一貫性を確保でき、API バッチ生成機能は、主要なプロモーションやその他のノードの集中的なコンテンツのニーズをサポートします。 境界線には適さない: 高級ブランドのイメージ広告や CEO の年次講演など、感情が強く、個人的なスタイルが強いコンテンツに AI デジタル ヒューマンを使用することはお勧めできません。生身の人間の感情を伝える力は、依然としてかけがえのないものです。
電子商取引業務およびライブ ブロードキャスト チーム: 24 時間中断のないライブ ブロードキャストや大規模な SKU の説明を必要とする電子商取引のシナリオに適しています。 AI アンカーは、交通量の少ない時間帯に勤務する実際の人の代わりに使用できるため、スケジュール設定のコストを削減できます。 境界には適さない: 物理的な製品の表示 (衣服の試着、食品の試食など) やライブ インタラクション中の実際のジェスチャー操作のデモンストレーションが必要なシーンは、AI アンカーで置き換えることはできません。
エンタープライズ IT およびシステム統合チーム: デジタル ヒューマン ビデオ機能を既存の LMS、HRMS、CMS などのワークフローに組み込む必要があるエンタープライズ IT 部門向け。 Hour One の RESTful API とバッチ レンダリング機能により、エンタープライズ システムとの統合が可能になります。 前提条件: チームは基本的な API 統合開発能力を備えている必要があります。 Hour One は、ゼロコード/ローコード統合ツールを提供しません (少なくとも HTTP リクエストと JSON データを処理できる必要があります)。
群衆には適していません:
- 個人クリエイター/YouTuber: Hour One の企業的位置付けにより、そのプログラムの基準額とサブスクリプション費用は、HeyGen、Synthesia、および同様に個人ユーザーを対象とするその他の製品よりも高いと判断されます。個々のクリエイターは、より費用対効果の高いソリューションを優先することをお勧めします。
- 高度にカスタマイズされたオリジナル ビデオを必要とするチーム (アニメーション スタジオ、映画、テレビ制作など): Hour One は、アニメーション キャラクター デザイン、マルチショット ナラティブ、特殊効果合成などの映画やテレビ レベルのニーズを満たすことができない、標準化されたデジタル人間の外観ビデオを提供します。
- 純粋な音声/吹き替えのみを必要とするシーン: デジタル ヒューマンの出演が必要ない場合、純粋な TTS または AI 吹き替えソリューションのコストは 1 時間目よりもはるかに低くなります。
1 時間目の概要と展望
核となる競争力: エンタープライズレベルのデジタルヒューマンビデオ分野における Hour One の核となる障壁は 3 つの側面に反映されています。 ① 出力品質: 4K 解像度は類似製品の中で高レベルであり、外部コンテンツのビデオ品質に厳しい要件を持つブランドに適しています。 ② 多言語リップシンク精度: 言語を意識したリップシンク予測モデルは、言語を超えたコンテンツ制作における一般的なソリューションよりも優れたパフォーマンスを発揮し、デジタル ヒューマン ビデオの共通の問題点である「リップシンクの恥ずかしさ」を軽減します。 ③エンタープライズ統合の深さ: API ソリューションと民営化された展開オプションにより、エンタープライズ レベルの顧客にデータ セキュリティとプロセス統合の柔軟性が提供されます。
現在の制限と不確実性:
- カスタム デジタル ヒューマン作成の敷居は依然として高い: 実写トレーニング教材 (5 ~ 15 分のマルチアングル正面高解像度ビデオ) の品質要件により、企業は事前に撮影コストを投資する必要があり、「数枚の写真をアップロードしてデジタル ヒューマンを作成する」という便利なエクスペリエンスを実現できません。
- AI アンカーの自然さの上限: 2D ニューラル レンダリングは静止画像や短期間の口頭ブロードキャストでは自然に実行されますが、長時間の口頭ブロードキャスト (10 分以上) や豊かな微表情を必要とするコンテンツは依然として「不気味の谷」効果に影響されます。顔の筋肉の微妙な変化、目の自然な偏り、感情の重なり合いは、現在の AI デジタル ヒューマンの共通のボトルネックであり、Hour One に特有のものではありません。
- リアルタイム ライブ ブロードキャスト モードは商用化の初期段階です: v4 の新しいライブ ブロードキャスト アンカー機能は、まだ大規模に商用化されていません。実際の展開では、エンドツーエンドの遅延、安定性、サードパーティのライブ ブロードキャスト プラットフォームとの互換性を検証する必要があります。
- 価格の透明性が低い: 価格表が公開されていないということは、購入決定に必要な情報コストが高く、企業顧客はビジネス コミュニケーションに時間を費やす必要があることを意味します。契約交渉における受諾の根拠として、POC 段階では口の形状の精度と対象言語の 4K 出力効果の検証に重点を置くことをお勧めします。
- 市場における競合製品の同質性の加速: Synthesia、HeyGen、Colossyan およびその他のトラック製品は、機能と価格が近づいています。 Hour One は、競合に対抗するために企業の導入コストを削減しながら、画質と多言語の正確さで差別化を維持し続ける必要があります。
調達/採用リスク評価: Hour One は、既存のビデオ コンテンツ制作プロセスがあり、スケールアップが必要な企業組織、特に多言語運用とブランドの一貫性に対する高い要件があるシナリオに適しています。決定を下す前に、次の検証を完了することをお勧めします。 ① 営業チームに(一般的なデモではなく)対象言語での実際のビデオ サンプルを依頼し、リップシンクの精度が外部リリースの基準を満たしているかどうかを確認します。 ② 4K 出力とカスタムデジタルヒューマン API を明確にする 契約プランに具体的な割り当て条件を設定することで、その後の使用における過剰な出費を回避できます。 ③ デジタルヒューマンポートレートの使用に関する契約の長期条件を理解する - 訓練された企業デジタルヒューマンが特定の従業員に基づいている場合、その従業員が退職した後のデジタルヒューマン画像の使用権と削除プロセスを明確にする必要があります。 ④ 同一トラック内の製品(Synthesia、HeyGen)と並行してPOCを作成し、出力品質、レンダリング速度、単価を水平比較し、単一メーカーによるロックインのリスクを軽減します。
関連ツール: runway、pika
1 時間目の使用方法
- Webクライアント:公式Webサイトにアクセスし、アカウントを登録することで利用できます。ほとんどの機能はインストールする必要がありません。
- API アクセス: RESTful API を提供し、開発者は API キーを取得して独自のアプリケーションに統合できます。
バージョン情報
- 1 時間目 v4 :新しいリアルタイム ライブ ブロードキャスト アンカー モードが追加され、ビデオへの PPT 変換をサポートし、リップ シンクの精度を最適化します。
- 1 時間目 v3 :企業ブランドのデジタルヒューマンを支援するカスタムデジタルヒューマン画像作成機能をご紹介します。
- 1 時間目 v2 :多言語リップシンクとマルチシーンテンプレートを追加しました。
ユーザーレビュー