Přepis zvuku přijímá zvuk jako vstup a používá automatické rozpoznávání řeči a automatickou identifikaci mluvčího k vygenerování textového výstup. Konkrétně systém používá proprietární instanci systému automatického rozpoznávání řeči OpenAI Whisper.
Jednojazyčné termínové databáze lze vytvořit na stránce pro zlepšení přesnosti přepisu umělá inteligence u specializovaných nebo obtížných termínů. Chcete-li snížit počet chybných shod, omezte seznamy termínů na specializované nebo obtížné termíny, u nichž je nepravděpodobné, že by byly zaměněny za běžná slova nebo čísla, vyhněte se přidávání krátkých nebo obecných termínů a před dokončením zkontrolujte výstup přepisu, zda neobsahuje nesprávně použité termíny.
Termínové databáze jsou automaticky sdíleny se všemi uživateli stejné organizace v režimu pouze pro čtení.
Phrase Studio spotřebovává Hodiny lokalizace videa.
Případy použití
-
45minutový rozhovor se zákazník nahraný jako soubor MP4.
Generuje se textový přepis s identifikací mluvčího, který lze použít k vytvoření případové studie a získání citací pro webové stránky.
Pro vytvoření projektu přepisu zvuku postupujte podle těchto kroků:
-
Ve Phrase Studio klikněte na Nový projekt.
Otevře se stránka .
-
Buď přetáhněte soubor do pole pro nahrát, nebo klikněte na Nahrát soubor a vyhledejte soubor ve svém systému.
Nahraný soubor se zobrazí.
-
Volitelně zadejte počet v nahraném souboru.
-
Chcete-li nastavit počet mluvčích ručně, otevřete rozevírací nabídku a Vybrat hodnotu od 1 do 5. Pokud soubor obsahuje více než pět mluvčích, použít výchozí možnost .
-
-
Zadejte název pro projekt a nastavte viditelnost projektu podle potřeby:
-
Nové projekty jsou ve výchozím nastavení veřejné. Veřejné projekty jsou viditelné pro všechny uživatele v organizace, kteří mají přístup do Studio.
-
Zrušte výběr a vytvořte soukromý projekt, který je viditelný pouze pro vlastník projektu. Soukromý projekt lze v případě potřeby stále sdílet s vybranými uživateli.
-
-
Ručně vyberte nebo Povolit pro automatickou detekci.
-
V případě potřeby v části Povolit a Vybrat jazyk(y), do kterých má být soubor přeložen.
-
nástroj pro překlad je konfigurovatelný.
-
Pokud je vybráno , soubor bude přepsán, přeložen a nadabován okamžitě bez možnosti předchozí kontroly překladu.
-
-
Vybrat pro určení pravidel zobrazení titulků.
Povolit a Vybrat profil pro každý jazyk.
-
Volitelně Povolit
-
V případě potřeby nakonfigurujte další možnosti:
-
Otevřete sekci a importujte existující soubory titulků ve formát SRT nebo VTT pro zdrojový i cílový jazyk.
Systém přeskočí automatický přepis zvuku s identifikací mluvčího a zarovná existující titulky s videem. Uživatelé musí vytvořit a přiřadit mluvčí ručně, protože soubory SRT/VTT neobsahují informace o mluvčích.
-
Otevřete sekci pro přepsání nastavení na úrovni uživatelský účet a vyberte preferovaný na úrovni projekt.
-
Otevřete sekci a vyberte existující glosář nebo přidejte termíny, které budou použity k detekci a shoda podobně znějících slov během přepisu.
-
Otevřete sekci a vyberte požadovaná shrnutí a postřehy, které budou vygenerovány pro nahraný záznam, a příslušné modely umělá inteligence.
-
-
Klikněte na vytvořit projekt.
Soubor je nahrán a zobrazen na stránce .
Kliknutím na název nahrávky ji otevřete v editor a zobrazíte ji na kartách a . Oba texty lze v případě potřeby Upravit.
Klikněte na stáhnout a Vybrat přepis a překlady ke stažení do vašeho systému. Je také možné stáhnout pouze zvukové stopy ve formát MP3.
Extrahuje strukturované a smysluplné poznatky, jako jsou shrnutí, sentiment, příznaky kvality nebo bezpečnostní problémy z titulků pomocí modelů umělá inteligence.
Poznatky vytvořené na stránce jsou automaticky sdíleny se všemi uživateli stejné organizace v režimu pouze pro čtení.
Případy použití
-
Shrňte hovory zákaznické podpory nebo identifikujte potenciálně nebezpečnou či nekvalitní komunikaci. Phrase Studio vrátí shrnutí a označí sekce ke kontrole.
Detekuje a označuje různé mluvčí v audio souboru pro přehlednější přepisy a titulky.
Automatická identifikace mluvčího není k dispozici pro projekty s importovanými soubory titulků.
Případy použití
-
Podcast s více účastníky je zpracován a každý mluvčí je automaticky označen (např. „Mluvčí 1“, „Mluvčí 2“).
Klikněte na Spravovat mluvčí v nabídce pro Upravit jméno mluvčího nebo přidat další mluvčí.
Použít přepínač Kombinované/Mluvčí v dolní části editor pro přepínání mezi jednou vlnovou délkou a jednotlivými vlnovými délkami pro každého mluvčího. Když je detekováno více mluvčích, segmenty lze přetahovat v rámci řádku, aby se projevila překrývající se řeč, nebo přesunout na jiný řádek pro změnit přiřazeného mluvčího.