La trascrizione audio prende l'audio come input e usa il Riconoscimento vocale automatico e l'Identificazione automatica del parlante per generare un output testuale. Nello specifico, il sistema usa un'istanza proprietaria del sistema di Riconoscimento vocale automatico OpenAI Whisper.
Le basi terminologiche monolingue possono essere create nella pagina per migliorare la precisione della trascrizione IA per termini specializzati o difficili. Per ridurre le false corrispondenze, mantenere gli elenchi di termini limitati a termini specializzati o difficili che difficilmente possono essere confusi con parole o numeri comuni, evitare di aggiungere termini brevi o generici e rivedere l'output di trascrizione per termini applicati erroneamente prima di finalizzare.
Le basi terminologiche sono condivise automaticamente con tutti gli utenti della stessa organizzazione in modalità sola lettura.
Phrase Studio consuma Ore di localizzazione video.
Casi d'uso
-
Un'intervista al cliente di 45 minuti registrata come file MP4.
Viene generata una trascrizione testuale con identificazione del parlante che può essere usata per creare un caso d'uso ed estrarre citazioni per un sito web.
Per creare un progetto di trascrizione audio, seguire questi passaggi:
-
Da Phrase Studio, fare clic su Nuovo progetto.
Si apre la pagina .
-
Trascinare un file nel campo di caricamento oppure fare clic su Caricare file per individuare un file sul proprio sistema.
Il file caricato viene visualizzato.
-
Facoltativamente, specificare il numero di nel file caricato.
-
Per impostare manualmente il numero di parlanti, aprire il menu a discesa e Seleziona un valore da 1 a 5. Se il file include più di cinque parlanti, usare l'opzione predefinita .
-
-
Fornire un nome per il progetto e impostare la visibilità del progetto come richiesto:
-
I nuovi progetti sono pubblici per impostazione predefinita. I progetti pubblici sono visibili a tutti gli utenti nell'organizzazione che hanno accesso a Studio.
-
Deseleziona per creare un progetto privato visibile solo al proprietario del progetto. Un progetto privato può comunque essere condiviso con utenti selezionati, se necessario.
-
-
Seleziona manualmente la o abilita per il rilevamento automatico.
-
Se richiesto, in , abilita e seleziona la/le lingua/e in cui il file deve essere tradotto.
-
Il motore di traduzione è configurabile.
-
Se viene selezionato , il file verrà trascritto, tradotto e doppiato immediatamente senza la possibilità di controllare la traduzione in anticipo.
-
-
Seleziona un per determinare le regole di visualizzazione dei sottotitoli.
Abilita per selezionare un profilo per ogni lingua.
-
Facoltativamente, abilita per selezionare pronunce esistenti e coppie correlate per i flussi di lavoro di doppiaggio.
-
Se necessario, configura opzioni aggiuntive:
-
Apri la sezione per importare file di sottotitoli esistenti in formato SRT o VTT sia per la lingua di origine che per quella di destinazione.
Il sistema salterà la trascrizione audio automatica con identificazione del parlante e allineerà i sottotitoli esistenti con il video. Gli utenti devono creare e assegnare i parlanti manualmente poiché i file SRT/VTT non includono informazioni sui parlanti.
-
Apri la sezione per sovrascrivere le impostazioni dell'account e selezionare il preferito a livello di progetto.
-
Apri la sezione per selezionare una termbase esistente o aggiungere termini che verranno utilizzati per rilevare e trovare una corrispondenza con parole dal suono simile durante la trascrizione.
-
Apri la sezione per Seleziona i riepiloghi e gli approfondimenti desiderati che verranno generati per la registrazione caricata e i relativi modelli di IA.
-
-
Fai clic su creare progetto.
Il file viene caricato e visualizzato nella pagina .
Fai clic sul nome della registrazione per aprirla nell'editor e visualizzarla nelle schede e . Entrambi i testi possono essere modificati se necessario.
Fai clic su download per Seleziona la trascrizione e le traduzioni per il download sul tuo sistema. È anche possibile download tracce solo audio in formato MP3.
Estrae approfondimenti strutturati e significativi come riepiloghi, sentiment, indicatori di qualità o problemi di sicurezza dai sottotitoli utilizzando modelli di IA.
Gli approfondimenti creati nella pagina sono condivisi automaticamente con tutti gli utenti della stessa organizzazione in modalità sola lettura.
Casi d'uso
-
Riepiloga le chiamate del cliente di assistenza o identifica comunicazioni potenzialmente non sicure o di bassa qualità. Phrase Studio restituisce un riepilogo e contrassegna le sezioni per la revisione.
Rileva ed etichetta diversi parlanti in un file audio per trascrizioni e sottotitoli più chiari.
L'identificazione automatica del parlante non è disponibile per i progetti con file di sottotitoli importati.
Casi d'uso
-
Un podcast con più partecipanti viene elaborato e ogni parlante viene etichettato automaticamente (ad es. "Parlante 1", "Parlante 2").
Fai clic su Gestisci parlanti nel menu per Modifica il nome del parlante o aggiungere altri parlanti.
usare l'interruttore Combinato/Parlanti nella parte inferiore dell'editor per passare da una singola forma d'onda a forme d'onda individuali per ciascun parlante. Quando vengono rilevati più parlanti, i segmenti possono essere trascinati all'interno di una riga per riflettere il parlato sovrapposto, o spostati in un'altra riga per modificare il parlante assegnato.