音声文字起こしの音声テキスト変換モデル
音声の文字起こしでは、LLM の利用状況と言語サポートを決定する特定の音声-to-テキストモデルを使用して、音声インタラクション中に会話がテキストに変換されます。
必要なエディション
この記事の対象:
Salesforce Voice (ネイティブテレフォニー)
| 使用可能なチャネル: Agentforce Contact Center と Salesforce Voice |
| 使用可能なエディション: Enterprise Edition、Unlimited Edition、および Developer Edition |
| 必要なユーザー権限 | |
|---|---|
| 音声-to-テキストモデルを使用する | Agentforce コンタクトセンター管理者 (Salesforce Voice) 権限セット |
音声文字起こしモデル
音声-to-テキストモデルでは、音声インタラクション中に音声がどのように処理され、文字起こしされるかを決定します。この設定は組織レベルで適用され、サービス担当者の音声通話の文字起こしをサポートします。使用可能なプライマリモデルは 2 つあります。
- Low Latency Speech Model (低遅延音声モデル) — リアルタイムの文字起こし用に最適化されており、ライブ音声会話中の応答時間が短い。
- Universal Speech Model (ユニバーサル音声モデル) — さまざまな言語と地域での文字起こしをサポートするように設計されています。
低遅延音声モデル
リアルタイムの音声インタラクションには低遅延音声モデルを使用します。このモデルは会話形式の音声認識用に最適化されており、対話型の音声環境向けに低遅延のストリーミング文字起こしをサポートしています。
主な特徴は次のとおりです。
- 低遅延のストリーミング文字起こし用に最適化
- 会話オーディオの文字起こし精度の向上
- 多言語の文字起こし機能をサポート
- ライブ会話での応答時間を短縮する設計
ユニバーサル音声モデル
ユニバーサル音声モデルを使用して、音声インタラクションで使用されるさまざまな言語での文字起こしをサポートします。このモデルでは、複数の言語と地域バリエーションのストリーミング文字起こしがサポートされます。
主な特徴は次のとおりです。
- 大規模な導入向けに設計されたエンタープライズ クラスのインフラストラクチャ
- 幅広いグローバル言語のサポート
- 多言語の文字起こし機能をサポート
- 複数の国および言語で事業を展開する組織に適しています。
サポートされる言語
| 低遅延音声モデル | ユニバーサル音声モデル |
|---|---|
| 英語 | 英語 (英国、米国、カナダ) |
| ドイツ語 | ドイツ語 |
| フランス語 | フランス語 |
| スペイン語 | スペイン語 (スペイン、メキシコ) |
| イタリア語 | イタリア語 |
| オランダ語 | オランダ語 |
| ポルトガル語 | ポルトガル語 (ブラジル、ポルトガル) |
| 日本語 | 日本語 |
| ヒンドゥー語 | ヒンドゥー語 |
| フィンランド語 | |
| タミル語 | |
| テルグ語 | |
| ベンガル語 | |
| マラーティー語 | |
| インドネシア語 | |
| マレー語 |
この記事で問題は解決されましたか?
ご意見をお待ちしております。

