ボイスエージェントの返答
ビジュアルボイス計画プレビュー
ご要望に合うオプションを3つ発見しました。最も早い予約は明日午後2時30分です。
- Direction
- 直接的で簡潔かつ最初の聴取で理解しやすい
- Settings cue
- 自然な会話速度に近づけるように調整してください。発音のコントロールが必要な場合はlanguage_codeを使用してください。
- Best for
- アシスタント、サポートフロー、IVRプロンプト、および短い会話応答
速度に最適化された低遅延・高品質テキスト読み上げ。32言語対応、約300msの応答時間、標準モデルの3倍高速。
スピード最優先のTTSガイド
これらは保存されたモデル出力ではなく、計画的なプレビューです。上記のライブジェネレーターを実行する前に、Turboルートがスクリプトに適しているかどうかを判断するために使用してください。
ビジュアルボイス計画プレビュー
ご要望に合うオプションを3つ発見しました。最も早い予約は明日午後2時30分です。
ビジュアルボイス計画プレビュー
次のキャンペーンを数分で開始しましょう。スクリプトを書く、声を選択し、仕上げられたドラフトを生成します。
ビジュアルボイス計画プレビュー
エクスポートが完了しました。ファイルを確認し、最終版を承認するか、修正を依頼してください。
Turbo v2.5を使うタイミング
このページは非アクティブになった音声認識やサウンドエフェクトワークフローではなく、現在有効なKIEテキストto音声ルート用です。
プロバイダールート
KIE + ElevenLabs
AISnapEditは、elevenlabs/text-to-speech-turbo-2-5モデルルートを使用して、KIEに生成タスクを送信します。
主な利点
迅速な反復
多数の短いパス、迅速なプレビュー、またはスピードに敏感なTTSドラフトが必要な場合にこのモデルを使用してください。
言語制御
language_code
このルートでは、アクティブなAISnapEditリクエストにlanguage_codeを含めることができます。
課金基準
Characters
TTSのコストはテキスト長に基づくため、短いプロンプトやレビュー済みのコピーを使用することで支出を予測可能に保てます。
短い応答、繰り返されるシステムメッセージ、インタラクティブなコピーは通常、迅速な反復によって恩恵を受けます。
ワークフローで明示的な言語コードが必要な場合、Turbo v2.5から始め、発音を早期にレビューしてください。
すべてのパスを最終ナレーションとして扱わずに、広告、UI、またはサポートメッセージの複数のバリエーションを生成できます。
プロンプトは短く保ち、必要に応じて言語を明示的に制御し、スケーリングする前に各生成パスをレビューしてください。
Turboは、すでに簡潔で発話しやすいスクリプトに対して最適に機能します。
チャンネルに合った音声を選択し、ターゲット言語を明示的に制御する必要がある場合は language_code を追加してください。
短い代替案を実行し、明瞭さを比較してから、調整が必要な部分だけを再生成してください。
これらのコントロールは、AISnapEdit によって公開されているアクティブな KIE 要求フィールドと一致しています。
Text
すべての生成において
簡潔な口語表現を使用してください。音声エージェントの場合、ユーザーが実際に聞くべき文を正確に記述してください。
Voice
チャンネルとの整合性
製品フローまたはキャンペーンごとに1つの音声を選択し、繰り返しのプロンプトが一貫した印象になるようにしてください。
言語コード
発音制御
スクリプトの言語を明示的に指定したい場合、language_code を使用してください。
Stability
繰り返しプロンプト
アプリメッセージ、エージェント、IVRプロンプトなど、一貫した再生が必要な場合、安定性を高めてください。
Timestamps
字幕または同期作業
字幕、リップシンク、または下流の同期が必要な場合にのみ有効にしてください。
前回/次回のテキスト
セグメントの連続性
別々のスニペットが一つのつながったスクリプトのように聞こえるようにする場合、隣接するテキストを渡してください。
KIE は現在、AISnapEdit の TTS ルートを両方公開しています。クレジット消費前に、この違いを活用して選択してください。
主な適合性
品質最優先のナレーション、表現力豊かなボイスオーバー、およびマルチリンガルコンテンツの計画。
高速なドラフト作成、音声エージェント、短いプロンプト、言語コードワークフロー。
表現範囲よりもイテレーション速度が重要である場合、Turbo を使用してください。
言語処理
自然なマルチリンガルナレーションに適しており、それに合った音声を使用できます。
ワークフロー内で明示的な language_code 制御が必要な場合に最適です。
フルバッチ生成の前に、どちらのモデルでも早期に発音を確認してください。
スクリプトの種類
長い講義、解説、視聴者向けナレーション。
エージェントの返答、広告、アラート、短いトレーニング動画、UIの音声プロンプト。
実際に公開する音声の種類に応じてモデルを選んでください。
プロバイダの状態
アクティブな KIE ルート。
アクティブな KIE ルートですが、ElevenLabs のドキュメントでは、新規の低レイテンシーケースに対して Flash を推奨しています。
このページは、現在のKIEを通じてAISnapEditが生成できる内容を反映しています。
廃止されたトランスクリプションページはアーカイブガイドとしてインデックス可能ですが、このアクティブなモデルページはテキストから音声への生成のみをサポートしています。
短いプロンプトでも、発音、ペース、文脈、およびプロバイダー側のセーフティ処理についての確認が必要です。
Find answers to common questions about this model
Turbo v2.5は速度に最適化された低遅延・高品質テキスト読み上げモデルです。約300msの応答時間(Multilingual v2の3倍高速)を実現しながら、32言語で優れた音声品質を維持します。
Turbo v2.5は約250〜300msで音声を生成し、音声エージェントやインタラクティブ体験などのリアルタイムアプリケーションに最適です。
英語、中国語、日本語、韓国語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、ヒンディー語、アラビア語、オランダ語、ポーランド語、スウェーデン語、トルコ語、ベトナム語、ハンガリー語、ノルウェー語など32言語に対応しています。
1回のリクエストで最大40,000文字を変換でき、約40分の音声を生成できます。
Turbo v2.5は3倍高速で、1文字あたりのコストが50%低減されています。速度重視のアプリケーションにはTurboを、最大の感情表現力を求める場合はMultilingual v2を選択してください。
有効にすると、Turbo v2.5は生成された音声の各単語のタイミングデータを返します。リップシンク、キャプション、同期アプリケーションに便利です。
リアルタイムアプリケーション向けの低遅延・高品質音声合成