Phrase Studio

Transcription audio (Studio)

Le contenu est traduit de l’anglais par Phrase Language AI.

La transcription audio prend l'audio comme sortie et utilise la reconnaissance vocale automatisée et l'identification automatisée des locuteurs pour générer une sortie textuelle. Plus précisément, le système utilise une instance propriétaire du système de reconnaissance vocale automatisée OpenAI Whisper.

Des bases de termes monolingues peuvent être créées dans la page Paramètres pour améliorer la précision de la transcription par IA pour des termes spécialisés ou difficiles. Pour réduire les fausses correspondances, limitez les listes de termes aux termes spécialisés ou difficiles qui ne risquent pas d'être confondus avec des mots ou des nombres courants, évitez d'ajouter des termes courts ou génériques, et vérifiez la sortie de transcription pour détecter les termes mal appliqués avant de finaliser.

Les bases de termes sont automatiquement partagées avec tous les utilisateurs de la même organisation en mode lecture seule.

Phrase Studio consomme des Heures de localisation vidéo.

Cas d'utilisation

  • Un entretien client de 45 minutes enregistré sous forme de fichier MP4.

    Une transcription textuelle est générée avec l'identification des locuteurs, qui peut être utilisée pour créer une étude de cas et extraire des citations pour un site web.

Pour créer un projet de transcription audio, suivez ces étapes :

  1. Depuis Phrase Studio, cliquez sur Nouveau projet.

    La page Créer un projet s'ouvre.

  2. Faites glisser un fichier dans la zone de chargement ou cliquez sur Charger le fichier pour localiser un fichier sur votre système.

    Le fichier chargé s'affiche.

  3. Optionnellement, spécifiez le nombre de Locuteurs dans le fichier chargé.

    • Pour définir manuellement le nombre de locuteurs, ouvrez la liste déroulante et sélectionnez une valeur de 1 à 5. Si le fichier comprend plus de cinq locuteurs, utilisez l'option par défaut Détection automatique.

  4. Donnez un nom au projet et définissez la visibilité du projet selon vos besoins :

    • Les nouveaux projets sont publics par défaut. Les projets publics sont visibles par tous les utilisateurs de l'organisation qui ont accès à Studio.

    • Désélectionner Projet public pour créer un projet privé qui n'est visible que par le responsable du projet. Un projet privé peut toujours être partagé avec des utilisateurs sélectionnés si nécessaire.

  5. Sélectionner manuellement la langue source ou activer Détection automatique de la langue source pour une détection automatique.

  6. Si nécessaire, sous Options de localisation, activer Traduire les sous-titres et sélectionner la ou les langues vers lesquelles le fichier doit être traduit.

    • Le moteur de traduction est configurable.

    • Si Doubler dans les langues cibles est sélectionné, le fichier sera transcrit, traduit et doublé immédiatement sans possibilité de vérifier la traduction au préalable.

  7. Sélectionner un profil de sous-titres pour déterminer les règles d'affichage des sous-titres.

    Activer Utiliser différents profils de sous-titres pour des langues spécifiques pour sélectionner un profil pour chaque langue.

  8. Optionnellement, activer Appliquer des règles de prononciation pour améliorer la précision de la synthèse vocale pour sélectionner des prononciations existantes et des paires associées pour les flux de travail de doublage.

  9. Si nécessaire, configurer des options supplémentaires :

    • Ouvrir la section Sous-titres pour importer des fichiers de sous-titres existants au format SRT ou VTT pour les langues source et cible.

      Le système ignorera la transcription audio automatique avec identification des locuteurs et alignera les sous-titres existants avec la vidéo. Les utilisateurs doivent créer et assigner des locuteurs manuellement car les fichiers SRT/VTT n'incluent pas d'informations sur les locuteurs.

    • Ouvrir la section Traduction automatisée pour remplacer les paramètres du compte et sélectionner le moteur de traduction préféré au niveau du projet.

      • Si Phrase Language AI est sélectionné, les menus déroulants Profil TA et mémoire de traduction s'affichent.

        • Sélectionner l'un des profils TA disponibles et, optionnellement, une mémoire de traduction.

      • Si agent de traduction par IA est sélectionné, le menu déroulant mémoire de traduction s'affiche.

        • Sélectionner l'une des mémoires de traduction disponibles.

    • Ouvrir la section Ressources pour sélectionner une base terminologique existante ou ajouter des termes qui seront utilisés pour détecter et trouver une correspondance pour des mots aux sonorités similaires pendant la transcription.

    • Ouvrez la section résumés et insights générés par IA pour sélectionner les résumés et insights souhaités qui seront générés pour l'enregistrement téléchargé, ainsi que les modèles d'IA pertinents.

  10. Cliquez sur créer projet.

    Le fichier est téléchargé et s'affiche sur la page Mes enregistrements.

Cliquez sur le nom de l'enregistrement pour l'ouvrir dans l'éditeur et le visualiser dans les onglets Transcrire et Traduction. Les deux textes peuvent être modifiés si nécessaire.

Cliquez sur téléchargement pour sélectionner la transcription et les traductions pour le téléchargement vers votre système. Il est également possible de procéder au téléchargement de pistes audio uniquement au format MP3.

Résumés IA

Extrait des insights structurés et significatifs tels que des résumés, des sentiments, des indicateurs de qualité ou des problèmes de sécurité à partir de sous-titres en utilisant des modèles d'IA.

Les insights créés dans la page paramètres sont automatiquement partagés avec tous les utilisateurs de la même organisation en mode lecture seule.

Cas d'utilisation

  • Résumez les appels du service client ou identifiez les communications potentiellement dangereuses ou de faible qualité. Phrase Studio renvoie un résumé et signale des sections pour examen.

Identification des locuteurs

Détecte et étiquette différents locuteurs dans un fichier audio pour des transcriptions et des sous-titres plus clairs.

L'identification automatique des locuteurs n'est pas disponible pour les projets avec des fichiers de sous-titres importés.

Cas d'utilisation

  • Un podcast avec plusieurs participants est traité et chaque locuteur est automatiquement étiqueté (par ex., « Locuteur 1 », « Locuteur 2 »).

Cliquez sur Gérer les locuteurs sous le menu Transcrire pour modifier le nom du locuteur ou ajouter d'autres locuteurs.

Utilisez le bouton Combiné/Locuteurs en bas de l'éditeur pour basculer entre une forme d'onde unique et des formes d'onde individuelles pour chaque locuteur. Lorsque plusieurs locuteurs sont détectés, les segments peuvent être glissés dans une ligne pour refléter un chevauchement de parole, ou déplacés vers une autre ligne pour modifier le locuteur assigné.

Cet article vous a-t-il été utile ?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.