Die Audiotranskription verwendet Audio als Output und nutzt automatisierte Spracherkennung sowie automatisierte Sprecheridentifizierung, um Text-Output zu generieren. Insbesondere verwendet das System eine proprietäre Instanz des OpenAI Whisper-Systems zur automatisierten Spracherkennung.
Einsprachige Terminus-Datenbanken können auf der Seite erstellt werden, um die Genauigkeit der KI-Transkription für spezialisierte oder schwierige Termini zu verbessern. Um falsche Übereinstimmungen zu reduzieren, halten Sie Terminus-Listen auf spezialisierte oder schwierige Termini beschränkt, die wahrscheinlich nicht mit gebräuchlichen Wörtern oder Zahlen verwechselt werden, vermeiden Sie das Hinzufügen kurzer oder allgemeiner Termini und überprüfen Sie den Transkriptions-Output auf falsch angewendete Termini vor der Fertigstellung.
Terminus-Datenbanken werden automatisch mit allen Benutzern derselben Organisation im schreibgeschützten Modus geteilt.
Phrase Studio verbraucht Video Localization Hours.
Anwendungsfälle
-
Ein 45-minütiges Kundeninterview, das als MP4-Datei aufgezeichnet wurde.
Ein Texttranskript wird mit Sprecheridentifizierung erstellt, das verwendet werden kann, um eine Fallstudie zu erstellen und Zitate für eine Website zu extrahieren.
Um ein Audiotranskriptionsprojekt zu erstellen, folgen Sie diesen Schritten:
-
Klicken Sie in Phrase Studio auf New Project.
Die Seite öffnet sich.
-
Ziehen Sie entweder eine Datei in das Feld zum hochladen oder klicken Sie auf Upload file, um eine Datei auf Ihrem System zu suchen.
Die hochgeladene Datei wird angezeigt.
-
Geben Sie optional die Anzahl der in der hochgeladenen Datei an.
-
Um die Anzahl der Sprecher manuell festzulegen, öffnen Sie das Dropdown-Menü und wählen Sie einen Wert von 1 bis 5 aus. Wenn die Datei mehr als fünf Sprecher enthält, verwenden Sie die Standardoption .
-
-
Geben Sie einen Namen für das Projekt an und legen Sie die Projektsichtbarkeit wie gewünscht fest:
-
Neue Projekte sind standardmäßig öffentlich. Öffentliche Projekte sind für alle Benutzer in der Organisation sichtbar, die auf Studio zugreifen können.
-
Deaktivieren Sie , um ein privates Projekt zu erstellen, das nur für den Eigentümer des Projekt sichtbar ist. Ein privates Projekt kann bei Bedarf dennoch für ausgewählte Benutzer freigegeben werden.
-
-
Wählen Sie manuell die aus oder aktivieren Sie für die automatische Erkennung.
-
Aktivieren Sie bei Bedarf unter die Option und wählen Sie die Sprache(n) für die zu übersetzende Datei aus.
-
Wenn ausgewählt ist, wird die Datei sofort transkribiert, übersetzt und synchronisiert, ohne dass die Möglichkeit besteht, die Übersetzung vorab zu überprüfen.
-
Wählen Sie ein aus, um die Regeln für die Untertitelanzeige festzulegen.
Aktivieren Sie , um ein Profil für jede Sprache auszuwählen.
-
Optional können Sie aktivieren, um vorhandene Aussprachen und zugehörige Paare für Dubbing-Workflows auszuwählen.
-
Konfigurieren Sie bei Bedarf weitere Optionen:
-
Öffnen Sie den Bereich , um vorhandene Untertiteldateien im SRT- oder VTT-Format für die Ausgangssprache und die Zielsprache zu importieren.
Das System überspringt die automatische Audiotranskription mit Sprecheridentifizierung und gleicht die vorhandenen Untertitel mit dem Video ab. Benutzer müssen Sprecher manuell erstellen und zuweisen, da SRT/VTT-Dateien keine Sprecherinformationen enthalten.
-
Öffnen Sie den Bereich , um die Einstellungen auf Ebene des User-Kontos zu überschreiben und die bevorzugte auf Ebene des Projekt auszuwählen.
-
Öffnen Sie den Bereich , um eine vorhandene Termbank auszuwählen oder Begriffe hinzuzufügen, die verwendet werden, um ähnlich klingende Wörter während der Transkription zu erkennen und zu matchen.
-
Öffnen Sie den Bereich , um die gewünschten Zusammenfassungen und Erkenntnisse auszuwählen, die für die hochgeladene Aufnahme generiert werden sollen, sowie die relevanten KI-Modelle.
-
-
Klicken Sie auf Projekt erstellen.
Die Datei wird hochgeladen und auf der Seite angezeigt.
Klicken Sie auf den Namen der Aufnahme, um sie im Editor zu öffnen und in den Registerkarten und anzuzeigen. Beide Texte können bei Bedarf bearbeitet werden.
Klicken Sie auf herunterladen, um die Transkription und die Übersetzungen zum herunterladen auf Ihr System auszuwählen. Es ist auch möglich, reine Audiospuren im MP3-Format herunterladen.
Extrahiert mithilfe von KI-Modellen strukturierte und aussagekräftige Erkenntnisse wie Zusammenfassungen, Stimmung, Qualitätskennzeichen oder Sicherheitsprobleme aus Untertiteln.
Erkenntnisse, die auf der Seite erstellt wurden, werden automatisch für alle Benutzer derselben Organisation im schreibgeschützt Modus freigegeben.
Anwendungsfälle
-
Fassen Sie Kundensupport-Anrufe zusammen oder identifizieren Sie potenziell unsichere oder minderwertige Kommunikation. Phrase Studio gibt eine Zusammenfassung zurück und markiert Abschnitte zur Überprüfung.
Erkennt und beschriftet verschiedene Sprecher in einer Audiodatei für klarere Transkripte und Untertitel.
Die automatische Sprecheridentifizierung ist für Projekte mit importierten Untertiteldateien nicht verfügbar.
Anwendungsfälle
-
Ein Podcast mit mehreren Teilnehmern wird verarbeitet und jeder Sprecher wird automatisch markiert (z. B. „Sprecher 1“, „Sprecher 2“).
Klicken Sie unter dem Menü auf Sprecher verwalten, um den Sprechernamen zu Bearbeiten oder andere Sprecher hinzufügen.
Verwenden Sie den Umschalter Kombiniert/Sprecher unten im Editor, um zwischen einer einzelnen Wellenform und individuellen Wellenformen für jeden Sprecher zu wechseln. Wenn mehrere Sprecher erkannt werden, können Segmente innerhalb einer Zeile gezogen werden, um überlappende Sprache abzubilden, oder in eine andere Zeile verschoben werden, um den zugewiesenen Sprecher zu ändern.