Phrase Studio

Transcription audio (Studio)

Le contenu est traduit de l’anglais par Phrase Language AI.

La transcription audio prend de l'audio en entrée et utilise la reconnaissance vocale automatisée et l'identification automatisée des locuteurs pour générer une sortie texte. Plus précisément, le système utilise une instance propriétaire du système de reconnaissance vocale automatisée OpenAI Whisper.

Des bases de termes monolingues peuvent être créées dans la page Paramètres pour améliorer la précision de la transcription par IA pour des termes spécialisés ou difficiles. Les bases de termes sont automatiquement partagées avec tous les utilisateurs de la même organisation en mode lecture seule.

Phrase Studio consomme des Heures de localisation vidéo.

Cas d'utilisation

  • Un entretien client de 45 minutes enregistré sous forme de fichier MP4.

    Une transcription textuelle est générée avec l'identification des locuteurs, qui peut être utilisée pour créer une étude de cas et extraire des citations pour un site web.

Pour créer un projet de transcription audio, suivez ces étapes :

  1. Depuis Phrase Studio, cliquez sur Nouveau projet.

    La page Créer un nouveau projet s'ouvre.

  2. Faites glisser un fichier dans la zone de chargement ou cliquez sur Charger un fichier pour localiser un fichier sur votre système.

    Le fichier chargé s'affiche.

  3. Optionnellement, spécifiez le nombre d'Intervenants dans le fichier chargé.

    • Pour définir manuellement le nombre d'intervenants, ouvrez la liste déroulante et sélectionnez une valeur de 1 à 5. Si le fichier inclut plus de cinq intervenants, utilisez l'option par défaut Détection automatique.

  4. Donnez un nom au projet et définissez la visibilité du projet selon vos besoins :

    • Les nouveaux projets sont publics par défaut. Les projets publics sont visibles par tous les utilisateurs de l'organisation qui ont accès à Studio.

    • Désélectionnez projet public pour créer un projet privé qui n'est visible que par le responsable du projet. Un projet privé peut toujours être partagé avec des utilisateurs sélectionnés si nécessaire.

  5. Sélectionnez manuellement la langue source ou activez Détection automatique de la langue source pour une détection automatique.

  6. Si nécessaire, sous Options de localisation, activez Traduire les sous-titres et sélectionnez la ou les langues vers lesquelles le fichier doit être traduit.

    • Le moteur de traduction est configurable.

    • Si Doubler dans les langues cibles est sélectionné, le fichier sera transcrit, traduit et doublé immédiatement sans possibilité de vérifier la traduction au préalable.

  7. Sélectionnez un profil de sous-titres pour déterminer les règles d'affichage des sous-titres.

    Activez Utiliser différents profils de sous-titres pour des langues spécifiques pour sélectionner un profil pour chaque langue.

  8. Optionnellement, activez Appliquer des règles de prononciation pour améliorer la précision de la synthèse vocale pour sélectionner des prononciations existantes et des paires associées pour les flux de travail de doublage.

  9. Si nécessaire, configurez des options supplémentaires :

    • Ouvrez la section Sous-titres pour importer des fichiers de sous-titres existants au format SRT ou VTT pour les langues source et cible.

      Le système ignorera la transcription audio automatique avec identification des locuteurs et alignera les sous-titres existants avec la vidéo. Les utilisateurs doivent créer et assigner des locuteurs manuellement car les fichiers SRT/VTT n'incluent pas d'informations sur les locuteurs.

    • Ouvrez la section Traduction automatisée pour remplacer les paramètres du compte et sélectionner le moteur<2> de traduction préféré au niveau du projet.

      • Si Phrase Language AI est sélectionné, les menus déroulants profil TA et mémoire de traduction s'affichent.

        • Sélectionnez l'un des profils de TA disponibles et, éventuellement, une mémoire de traduction.

      • Si agent de traduction par IA est sélectionné, le menu déroulant mémoire de traduction s'affiche.

        • Sélectionnez l'une des mémoires de traduction disponibles.

    • Ouvrez la section Ressources pour sélectionner une base terminologique existante ou ajouter des termes qui seront utilisés pour détecter et faire correspondre des mots aux sonorités similaires pendant la transcription.

    • Ouvrez la section Résumés et insights générés par IA pour sélectionner les résumés et insights souhaités qui seront générés pour l'enregistrement téléchargé, ainsi que les modèles d'IA pertinents.

  10. Cliquez sur Créer projet.

    Le fichier est téléchargé et s'affiche sur la page Mes enregistrements.

Cliquez sur le nom de l'enregistrement pour l'ouvrir dans l'éditeur et le visualiser dans les onglets Transcrire et Traduction. Les deux textes peuvent être modifiés si nécessaire.

Cliquez sur Téléchargement pour sélectionner la transcription et les traductions à télécharger sur votre système. Il est également possible de télécharger des pistes audio uniquement au format MP3.

Résumés IA

Extrait des informations structurées et significatives telles que des résumés, des sentiments, des indicateurs de qualité ou des problèmes de sécurité à partir des sous-titres en utilisant des modèles d'IA.

Les informations créées sur la page Paramètres sont automatiquement partagées avec tous les utilisateurs de la même organisation en mode lecture seule.

Cas d'utilisation

  • Résumez les appels du service client ou identifiez les communications potentiellement dangereuses ou de faible qualité. Phrase Studio renvoie un résumé et signale des sections pour examen.

Identification des locuteurs

Détecte et étiquette différents locuteurs dans un fichier audio pour des transcriptions et des sous-titres plus clairs.

L'identification automatique des locuteurs n'est pas disponible pour les projets avec des fichiers de sous-titres importés.

Cas d'utilisation

  • Un podcast avec plusieurs participants est traité et chaque locuteur est automatiquement étiqueté (par ex., « Locuteur 1 », « Locuteur 2 »).

Cliquez sur Gérer les locuteurs sous le menu Transcrire pour modifier le nom du locuteur ou ajouter d'autres locuteurs.

Utilisez le bouton Combiné/Locuteurs en bas de l'éditeur pour basculer entre une forme d'onde unique et des formes d'onde individuelles pour chaque locuteur. Lorsque plusieurs locuteurs sont détectés, les segments peuvent être glissés dans une ligne pour refléter les chevauchements de parole, ou déplacés vers une autre ligne pour modifier le locuteur assigné.

Cet article vous a-t-il été utile ?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.