Phrase Studio

Транскрипция аудио (Studio)

Контент автоматически переведен с английского языка с помощью Phrase Language AI.

Транскрипция аудио принимает аудио в качестве входных данных и использует автоматическое распознавание речи и автоматическую идентификацию спикера для создания текстового результата. В частности, система использует проприетарный экземпляр системы автоматического распознавания речи OpenAI Whisper.

Одноязычные базы терминов можно создать на странице настройки для повышения точности транскрипции ИИ для специализированных или сложных терминов. Чтобы уменьшить количество ложных совпадений, ограничьте списки терминов специализированными или сложными терминами, которые вряд ли будут перепутаны с обычными словами или числами, избегайте добавления коротких или общих терминов и проверяйте результат транскрипции на наличие неправильно примененных терминов перед завершением.

Базы терминов автоматически предоставляются всем пользователям одной организации в режиме только для чтения.

Phrase Studio расходует часы локализации видео.

Примеры использования

  • 45-минутное интервью с клиентом, записанное в виде файла MP4.

    Создается текстовая транскрипция с идентификацией спикера, которую можно использовать для создания тематического исследования и извлечения цитат для веб-сайта.

Чтобы создать проект транскрипции аудио, выполните следующие действия:

  1. В Phrase Studio нажмите Создать проект.

    Откроется страница Создать новый проект.

  2. Перетащите файл в поле загрузки или нажмите Загрузить файл, чтобы найти файл в вашей системе.

    Загруженный файл отображается.

  3. При необходимости укажите количество спикеров в загруженном файле.

    • Чтобы задать количество спикеров вручную, откройте раскрывающийся список и выберите значение от 1 до 5. Если в файле более пяти спикеров, используйте параметр по умолчанию Автоопределение.

  4. Укажите название для проекта и установите видимость проекта по мере необходимости:

    • Новые проекты по умолчанию являются общедоступными. Общедоступные проекты видны всем пользователям в организации, которые могут получить доступ к Studio.

    • Снимите выбор с Public project, чтобы создать закрытый проект, который будет виден только ответственный за проект. Закрытый проект при необходимости можно предоставить другим выбранным пользователям.

  5. Вручную Выбрать Source Language или Включить Auto-detect source language для автоматического определения.

  6. При необходимости в разделе Localization Options Включить Translate subtitles и Выбрать язык(и), на который будет переведен файл.

    • Translation engine можно настроить.

    • Если выбрано Dub into target languages, файл будет транскрибирован, переведен и dubbed немедленно без возможности предварительной проверки перевод.

  7. Выбрать Subtitle profile для определения правил отображения субтитров.

    Включить Use different subtitle profiles for specific languages, чтобы Выбрать профиль для каждого язык.

  8. При необходимости Включить Apply pronunciation rules to improve text-to-speech accuracy, чтобы Выбрать существующие pronunciations и связанные пары для рабочих процессов дублирования.

  9. При необходимости настройте дополнительные параметры:

    • Откройте раздел Subtitles, чтобы импортировать существующие файлы субтитров в SRT or VTT format как для оригинал, так и для перевод языков.

      Система пропустит автоматическую транскрипцию аудио с идентификацией говорящего и синхронизирует существующие субтитры с видео. Пользователям необходимо создавать и назначать говорящих вручную, так как файлы SRT/VTT не содержат информацию о говорящих.

    • Откройте раздел Automated translation, чтобы переопределить настройки учетная запись и выбрать предпочтительную Translation engine на уровне проект.

      • Если выбрано Phrase Language AI, отображаются раскрывающиеся меню MT Profile и Translation Memory.

        • Выбрать один из доступных профиль машинный перевод (МТ) и, при необходимости, память переводов.

      • Если выбрано AI Translation Agent, отображается раскрывающееся меню Translation Memory.

        • Выбрать одну из доступных память переводов (TM).

    • Откройте раздел Resources, чтобы Выбрать существующую база терминов или добавить термины, которые будут использоваться для обнаружения и совпадение похожих по звучанию слов во время транскрипции.

    • Откройте раздел AI-generated summaries and insights, чтобы Выбрать желаемые сводки и аналитические данные, которые будут созданы для загруженной записи, а также соответствующие модели искусственный интеллект (ИИ).

  10. Нажмите Создать проект.

    Файл загружен и отображается на странице Мои записи.

Нажмите на название записи, чтобы открыть ее в редактор и просмотреть на вкладках Транскрибировать и Перевод. Оба текста можно Редактировать при необходимости.

Нажмите Скачивание, чтобы Выбрать транскрипцию и переводы для скачивание на вашу систему. Также можно выполнить скачивание только аудиодорожек в формат MP3.

Сводки искусственный интеллект (ИИ)

Извлекает структурированные и значимые данные, такие как сводки, тональность, флаги качества или проблемы безопасности из субтитров с помощью моделей искусственный интеллект (ИИ).

Данные, созданные на странице Настройки, автоматически предоставляются всем пользователям той же организация в режиме только для чтения.

Примеры использования

  • Обобщайте звонки в службу поддержки клиентов или выявляйте потенциально небезопасное или некачественное общение. Phrase Studio возвращает краткое содержание и помечает разделы для проверки.

Идентификация говорящего

Обнаруживает и помечает разных говорящих в аудиофайле для получения более четких транскриптов и субтитров.

Автоматическая идентификация говорящего недоступна для проектов с импортированными файлами субтитров.

Примеры использования

  • Подкаст с несколькими участниками обрабатывается, и каждый говорящий автоматически помечается (например, «Speaker 1», «Speaker 2»).

Нажмите Управление говорящими в меню Транскрибировать, чтобы Редактировать имя говорящего или добавить других говорящих.

Использовать переключатель Объединенный/Говорящие в нижней части редактор, чтобы переключаться между единой формой волны и отдельными формами волны для каждого говорящего. Когда обнаружено несколько говорящих, сегменты можно перетаскивать внутри строки, чтобы отразить наложение речи, или перемещать в другую строку, чтобы изменить назначенного говорящего.

Была ли эта статья полезной?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.