Phrase Studio

配音(工作室)

文本由 Phrase Language AI 从英语机器翻译而得。

配音会将文件中的原始音频替换为不同语言的新版本,同时保留原始说话者的语音特征和情感基调。

配音工作流需要正确的说话者分配。如果使用导入的字幕文件来跳过自动音频转录,请确保在进行配音之前已分配所有说话者。

使用场景示例

  • 一家媒体公司希望在西班牙和日本发行一部最初为英语的纪录片。该平台的AI会识别每位说话者,转录并翻译对话,然后生成西班牙语和日语的新音轨。生成的语音保留了原始说话者的特质,为新观众创造了真实的观看体验。

要为文件创建配音,请按照以下步骤操作:

  1. 在编辑器中,点击配音选项卡下的箭头并选择添加配音。

    添加配音窗口随即打开。

  2. 从下拉列表选择所需的翻译语言。

    注释

    如果选择了区域语言变体(例如法语(加拿大)或葡萄牙语(巴西)),系统会自动回退到相应的基本语言进行配音。

    区域语言选择仍会保留在项目和元数据中。

  3. (可选)启用应用发音规则以提高文本转语音准确性,以便为配音工作流选择现有的发音及相关配对。

  4. 点击添加配音。

    窗口关闭,配音选项卡会显示配音完成的时间。

点击配音更改以更新对文本所做的任何更改的配音。

点击管理语音以选择不同的配音语音。对于每种语言,系统会根据性别和年龄匹配自动建议最多 7 种推荐语音。

音频和配音控件

音频控件通过标记添加副语言信息的关键声音细微差别,有助于使配音更具表现力和准确性。右键点击一个句段,通过选择一个或多个可用选项,在所需位置添加音频控件。

注释

音频控件可能无法在所有语言或语音模型中工作。建议使用所选语音进行测试以确认兼容性。

测试后的音频调整或重新配音不会消耗额外分钟数。

当项目包含多个说话人时,可以在配音选项卡中为每个说话人轨道和单个句段调整配音设置。

  • 说话人轨道控件

    • 文本量

      点击波形中所需说话人名称旁边的音量图标volume.jpeg以调整音量滑块。该调整适用于该说话人所说的所有句段。

  • 句段控件

    • 文本量

    • 稳定性

      控制生成语音听起来有多一致和可预测。

    • 相似度

      控制生成语音与所选个人资料的匹配程度。

    在时间轴中选择一个句段以打开句段设置面板,并根据需要调整配音设置。点击配音选项卡右上角的立即保存以保存更改。

    调整稳定性或相似度后需要重新配音。点击配音更改以应用更新后的设置。

调整配音速度

默认情况下,配音以1倍速度生成,这意味着系统会根据句段中的文本量确定最自然的语速。

当前速度显示为时间轴上每个语音气泡上的标签。

如有需要,有两种方法可以调整配音速度:

  1. 延长或缩短波形上的语音气泡:

    示例

    如果配音音频在 1× 速度下超出了预定场景,请拖动语音气泡的结束时间。配音将略微加速以适应句段,速度标签也会相应更新。

  2. 编辑文本并重新配音:

    示例

    如果音频在 1× 速度下明显溢出,则该句段可能包含过多的文本。重写文本并配音更改。

发音

发音控制配音中特定单词或短语的读法。它们确保品牌名称、技术术语、缩写词和外来词的发音一致。

可以在项目创建期间定义自定义发音对并将其应用于配音工作流程。

对于现有项目,在编辑器的配音选项卡中添加新的配音语言时,也可以选择发音。

发音会自动以只读模式与同一公司的所有用户共享。

先决条件

要创建发音,请按照以下步骤操作:

  1. 在设置<1>页面中,选择发音<2>选项卡。

  2. 点击创建新发音。

    创建发音窗口已显示。

  3. 输入发音名称和可选的描述。

  4. 选择可用的以使该发音可供项目选择。

  5. 点击保存。

    该发音列在发音选项卡中。

每个发音可以包含单一语言的多个配对。要添加发音配对,请按照以下步骤操作:

  1. 选择一个现有发音并点击创建新配对。

  2. 提供原始原文/源语<1>单词或Phrase。

  3. 在译文字段中定义所需的发音。

    使用拼音拼写、音节断字或近似发音。

  4. 选择相关语言。

  5. (可选)点击预览以根据需要进行收听和调整。

  6. 点击保存。

    新配对已添加到所选发音中。

可以通过选择发音或配对旁边的编辑来更新或删除现有发音及相关配对。

更新发音配对后请重新运行配音;之前渲染的音频不会自动更改。

发音示例

  • 品牌名称

    • Apple: ap-pul

    • Microsoft: mai-kroh-soft

  • 技术术语

    • GIF: jif

    • SQL:ess-cue-el

  • 外来词

    • 羊角面包:krwa-san

    • 圣保罗:sow-pow-loo

语音克隆

语音克隆基于真实说话者的录音生成合成语音。克隆后的语音随后可用于 AI 配音,使翻译后的音频能够保留原始说话者的语调和声音特征。

克隆过程使用从上传的音频或视频样本中选择的语音范围来训练语音模型。样本处理完成后,可以在保存语音之前生成预览。

语音克隆在设置页面的我的语音选项卡中创建和管理。一旦创建,该语音即可用于配音工作流程。

语音样本要求

  • 所选范围的总时长必须在 15 到 180 秒之间

  • 最大上传文件时长:5 分钟

  • 最大样本文件数:3 个

  • 最大文件大小:每个文件 30 MB

  • 最大样本范围数:50 个

  • 如果语音样本包含多名说话者,则必须使用范围来隔离来自单一说话者的样本。

要创建语音克隆,请按照以下步骤操作:

  1. 在设置页面的我的语音选项卡中,点击创建新语音。

    创建您的声音部分已显示。

  2. 上传样本以生成声音复制。

    上传的媒体会出现在波形播放器中,可以在其中标记范围。

  3. 使用时间轴定义包含说话者声音的范围,然后单击完成。

    选定的范围已确认。可以通过单击添加范围以相同方式上传和处理其他文件。

    注释

    仅使用选定的范围来生成声音复制。

  4. 选中同意复选框并确认。

  5. 单击下一个。

    声音详情步骤已显示。

  6. 输入声音名称。(可选)提供声音描述、性别和标签以对其进行分类。

  7. 单击下一个。

    预览步骤已显示。第一个预览会自动生成。

  8. 选择预览语言并提供预览文本。

  9. 单击预览声音。

    音频样本已生成。这通常需要几秒钟。

  10. 点击保存。

    新声音已添加到我的声音列表。

可以从我的声音选项卡中预览或移除现有的声音复制。

这篇文章有帮助吗?
★ ★ ★ ★ ★

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.