音频转写以音频作为输入,并使用自动语音识别和自动发言人识别来生成文本输出。
可以在 页面中创建单语术语库,以提高 AI 转写针对专业或生僻术语的准确性。为减少错误匹配,请将术语列表限制为不太可能与常用词或数字混淆的专业或生僻术语,避免添加简短或通用的术语,并在最终确定前检查转写输出中是否存在误用的术语。
术语库会自动以只读模式与同一公司的所有用户共享。
Phrase Studio 会消耗 Video Localization Hours。
使用场景示例
-
一段录制为 MP4 文件的 45 分钟客户访谈。
系统正在生成带有发言人识别的文本转写,可用于创建案例研究并为网站提取引语。
若要创建音频转写项目,请遵循以下步骤:
-
在 Phrase Studio 中,点击 New Project。
页面随即打开。
-
将文件拖入上传区域,或点击 Upload file 以在您的系统中查找文件。
上传的文件将会显示。
-
您可以选择指定上传文件中 的数量。
-
若要手动设置发言人数量,请打开下拉菜单并选择 1 到 5 之间的值。如果文件包含超过五名发言人,请使用默认的 选项。
-
-
为项目提供名称,并根据需要设置项目可见性:
-
新项目默认为公开。公开项目对公司内所有有权访问 Studio 的用户可见。
-
取消勾选 以创建一个仅对项目所有者可见的私有项目。如果需要,私有项目仍然可以与选定的用户共享。
-
-
手动选择 或启用 以进行自动检测。
-
如果需要,在 下,启用 并选择要将文件翻译成的语言。
-
选择一个 以确定字幕显示规则。
启用 以便为每种语言选择个人资料。
-
(可选)启用 以选择现有的 发音 和相关对,用于配音工作流。
-
如果需要,配置其他选项:
-
打开 部分,以导入 SRT 或 VTT 格式 的现有字幕文件,用于原文和译文语言。
系统将跳过带有说话人识别的自动音频转写,并将现有字幕与视频对齐。用户需要手动创建并分配说话人,因为 SRT/VTT 文件不包含说话人信息。
-
打开 部分以覆盖账户级别的设置,并在项目级别选择首选的 。
-
打开 部分以选择现有的术语库,或添加将在转写过程中用于检测和匹配相似发音词汇的术语。
-
打开 部分,以选择要为上传的录音生成的所需摘要和见解,以及相关的 AI 模型。
-
-
点击 创建项目。
文件已上传,并显示在 页面上。
点击录音名称以在编辑器中打开它,并在 和 选项卡中查看。如果需要,这两个文本都可以进行编辑。
点击 下载 以选择转录内容和翻译内容并下载到您的系统中。也可以下载 MP3 格式的纯音频轨道。