Транскрипция аудио принимает аудио в качестве входных данных и использует автоматическое распознавание речи и автоматическую идентификацию спикера для создания текстового результата. В частности, система использует проприетарный экземпляр системы автоматического распознавания речи OpenAI Whisper.
Одноязычные базы терминов можно создать на странице для повышения точности транскрипции ИИ для специализированных или сложных терминов. Чтобы уменьшить количество ложных совпадений, ограничьте списки терминов специализированными или сложными терминами, которые вряд ли будут перепутаны с обычными словами или числами, избегайте добавления коротких или общих терминов и проверяйте результат транскрипции на наличие неправильно примененных терминов перед завершением.
Базы терминов автоматически предоставляются всем пользователям одной организации в режиме только для чтения.
Phrase Studio расходует часы локализации видео.
Примеры использования
-
45-минутное интервью с клиентом, записанное в виде файла MP4.
Создается текстовая транскрипция с идентификацией спикера, которую можно использовать для создания тематического исследования и извлечения цитат для веб-сайта.
Чтобы создать проект транскрипции аудио, выполните следующие действия:
-
В Phrase Studio нажмите Создать проект.
Откроется страница .
-
Перетащите файл в поле загрузки или нажмите Загрузить файл, чтобы найти файл в вашей системе.
Загруженный файл отображается.
-
При необходимости укажите количество в загруженном файле.
-
Чтобы задать количество спикеров вручную, откройте раскрывающийся список и выберите значение от 1 до 5. Если в файле более пяти спикеров, используйте параметр по умолчанию .
-
-
Укажите название для проекта и установите видимость проекта по мере необходимости:
-
Новые проекты по умолчанию являются общедоступными. Общедоступные проекты видны всем пользователям в организации, которые могут получить доступ к Studio.
-
Снимите выбор с , чтобы создать закрытый проект, который будет виден только ответственный за проект. Закрытый проект при необходимости можно предоставить другим выбранным пользователям.
-
-
Вручную Выбрать или Включить для автоматического определения.
-
При необходимости в разделе Включить и Выбрать язык(и), на который будет переведен файл.
-
Translation engine можно настроить.
-
Если выбрано , файл будет транскрибирован, переведен и dubbed немедленно без возможности предварительной проверки перевод.
-
-
Выбрать для определения правил отображения субтитров.
Включить , чтобы Выбрать профиль для каждого язык.
-
При необходимости Включить , чтобы Выбрать существующие pronunciations и связанные пары для рабочих процессов дублирования.
-
При необходимости настройте дополнительные параметры:
-
Откройте раздел , чтобы импортировать существующие файлы субтитров в SRT or VTT format как для оригинал, так и для перевод языков.
Система пропустит автоматическую транскрипцию аудио с идентификацией говорящего и синхронизирует существующие субтитры с видео. Пользователям необходимо создавать и назначать говорящих вручную, так как файлы SRT/VTT не содержат информацию о говорящих.
-
Откройте раздел , чтобы переопределить настройки учетная запись и выбрать предпочтительную на уровне проект.
-
Откройте раздел , чтобы Выбрать существующую база терминов или добавить термины, которые будут использоваться для обнаружения и совпадение похожих по звучанию слов во время транскрипции.
-
Откройте раздел , чтобы Выбрать желаемые сводки и аналитические данные, которые будут созданы для загруженной записи, а также соответствующие модели искусственный интеллект (ИИ).
-
-
Нажмите Создать проект.
Файл загружен и отображается на странице .
Нажмите на название записи, чтобы открыть ее в редактор и просмотреть на вкладках и . Оба текста можно Редактировать при необходимости.
Нажмите Скачивание, чтобы Выбрать транскрипцию и переводы для скачивание на вашу систему. Также можно выполнить скачивание только аудиодорожек в формат MP3.
Извлекает структурированные и значимые данные, такие как сводки, тональность, флаги качества или проблемы безопасности из субтитров с помощью моделей искусственный интеллект (ИИ).
Данные, созданные на странице , автоматически предоставляются всем пользователям той же организация в режиме только для чтения.
Примеры использования
-
Обобщайте звонки в службу поддержки клиентов или выявляйте потенциально небезопасное или некачественное общение. Phrase Studio возвращает краткое содержание и помечает разделы для проверки.
Обнаруживает и помечает разных говорящих в аудиофайле для получения более четких транскриптов и субтитров.
Автоматическая идентификация говорящего недоступна для проектов с импортированными файлами субтитров.
Примеры использования
-
Подкаст с несколькими участниками обрабатывается, и каждый говорящий автоматически помечается (например, «Speaker 1», «Speaker 2»).
Нажмите Управление говорящими в меню , чтобы Редактировать имя говорящего или добавить других говорящих.
Использовать переключатель Объединенный/Говорящие в нижней части редактор, чтобы переключаться между единой формой волны и отдельными формами волны для каждого говорящего. Когда обнаружено несколько говорящих, сегменты можно перетаскивать внутри строки, чтобы отразить наложение речи, или перемещать в другую строку, чтобы изменить назначенного говорящего.