Sie befinden sich hier:
Speech-to-Text-Modell für Voice-Abschriften
Die Sprachabschrift wandelt gesprochene Unterhaltungen während Sprachinteraktionen mithilfe spezifischer Sprach-zu-Text-Modelle, die die LLM-Nutzung und die Sprachunterstützung bestimmen, in Text um.
Erforderliche Editionen
Dieser Artikel gilt für:
Salesforce Voice (native Telefonie)
| Verfügbarkeit: Agentforce Contact Center mit Salesforce Voice |
| Verfügbarkeit: Enterprise, Unlimited und Developer Edition |
| Erforderliche Benutzerberechtigungen | |
|---|---|
| Verwenden des Sprach-zu-Text-Modells: | Berechtigungssatz "Agentforce Contact Center Admin (Salesforce Voice)" (Agentforce-Kontaktcenter-Administrator) |
Voice-Abschriftsmodelle
Sprach-zu-Text-Modelle bestimmen, wie gesprochenes Audio während Sprachinteraktionen verarbeitet und transkribiert wird. Diese Konfiguration wird auf Organisationsebene angewendet und unterstützt die Sprachanrufabschrift für Servicemitarbeiter. Es sind zwei Hauptmodelle verfügbar:
- Low Latency Speech Model (Sprachmodell mit geringer Latenz): Optimiert für Echtzeit-Abschriften mit schnellen Antwortzeiten während Live-Sprachunterhaltungen.
- Universal Speech Model (Universelles Sprachmodell): Entwickelt, um die Abschrift in einer breiten Palette von Sprachen und Regionen zu unterstützen.
Sprachmodell mit geringer Latenz
Verwenden Sie das Sprachmodell mit geringer Latenz für Echtzeit-Sprachinteraktionen. Dieses Modell ist für die Unterhaltungsspracherkennung optimiert und unterstützt Streaming-Abschriften mit geringer Latenz für interaktive Spracherfahrungen.
Zu den wichtigsten Merkmalen zählen:
- Optimiert für Streaming-Abschriften mit geringer Latenz
- Höhere Abschriftsgenauigkeit für Unterhaltungsaudio
- Unterstützt mehrsprachige Abschriftsfunktionen
- Konzipiert für schnellere Antwortzeiten in Live-Unterhaltungen
Universelles Sprachmodell
Verwenden Sie das universelle Sprachmodell, um die Abschrift in einer Vielzahl von Sprachen zu unterstützen, die in Sprachinteraktionen verwendet werden. Dieses Modell unterstützt Streaming-Abschriften für mehrere Sprachen und regionale Varianten.
Zu den wichtigsten Merkmalen zählen:
- Infrastruktur auf Unternehmensebene für umfangreiche Bereitstellungen
- Breite Unterstützung globaler Sprachen
- Unterstützt mehrsprachige Abschriftsfunktionen
- Geeignet für Organisationen, die über mehrere Länder und Sprachen hinweg tätig sind
Unterstützte Sprachen
| Sprachmodell mit geringer Latenz | Universelles Sprachmodell |
|---|---|
| Englisch | Englisch (UK, USA und Kanada) |
| Deutsch | Deutsch |
| Französisch | Französisch |
| Spanisch | Spanisch (Spanien, Mexiko) |
| Italienisch | Italienisch |
| Niederländisch | Niederländisch |
| Portugiesisch | Portugiesisch (Brasilien, Portugal) |
| Japanisch | Japanisch |
| Hindi | Hindi |
| Finnisch | |
| Tamil | |
| Telugu | |
| Bangla | |
| Marathi | |
| Bahasa-Indonesisch | |
| Malay |

