Peut-on transcrire une conversation en deux langues sur iPhone ?
En une seule passe, non. La reconnaissance vocale d'iOS reçoit l'indication d'une seule langue à attendre et s'y tient pendant tout l'enregistrement, si bien qu'une conversation qui passe d'une langue à l'autre se retrouve avec l'une bien transcrite et l'autre forcée dans des mots qui ne lui appartiennent pas. La solution n'est pas un réglage — c'est de savoir laquelle de deux méthodes convient à l'enregistrement que vous avez.
Le cas se présente dans des situations courantes : un appel avec un proche bilingue qui passe du français à l'anglais en pleine phrase, un cours qui commence dans une langue et reçoit des questions dans une autre, une séance de pratique linguistique où l'on change volontairement de langue. L'enregistrement lui-même n'a aucun mal avec tout cela — un microphone se moque de la langue qui lui arrive. C'est la transcription qui pose problème.
Pourquoi iOS ne peut pas simplement suivre
La reconnaissance vocale sur iPhone n'écoute pas pour deviner quelle langue est parlée et s'ajuster en cours de route. On lui indique, avant que la passe ne commence, une seule langue à attendre, et elle passe tout l'enregistrement à faire correspondre ce qu'elle entend aux sons et au vocabulaire de cette langue. C'est vrai que la passe tourne sur l'appareil ou qu'elle recoure au serveur d'Apple — la langue est un réglage fait à l'avance, pas quelque chose de détecté pendant que l'audio joue.
Pour un enregistrement dans une seule langue du début à la fin, ce fonctionnement est invisible. Pour un enregistrement qui change de langue, cela signifie que le réglage n'est jamais juste que pour une partie de l'audio.
À quoi ressemble vraiment la transcription
Ni une erreur, ni un trou. Les passages parlés dans la langue indiquée au moteur de reconnaissance reviennent à peu près normaux. Les passages parlés dans l'autre langue sont tout de même rapprochés des mots qui sonnent le plus proche dans la langue attendue, parce que c'est le seul vocabulaire dont dispose le moteur pour deviner — la même chose qui se produit quand tout l'enregistrement est réglé sur la mauvaise langue, mais limitée à la partie qui l'était vraiment. Le résultat se lit comme de vrais mots à la mauvaise place, pas comme une erreur visible au premier coup d'œil, ce qui justifie de vérifier une transcription contre l'audio avant de faire confiance à un passage auquel on n'a pas prêté grande attention en le prononçant.
Les variantes régionales d'une même langue fonctionnent pareil pour ce cas de figure. Anglais (États-Unis) et anglais (Royaume-Uni) sont des entrées distinctes qu'un réglage de transcription peut viser, pas des accents qu'un seul modèle absorbe, si bien qu'un enregistrement qui passe de l'un à l'autre a le même genre de problème qu'un enregistrement qui passe entre deux langues sans rapport, en plus léger.
Choisir quelle langue régler
Quand une langue domine clairement l'enregistrement — un cours presque entier dans une langue avec quelques questions dans une autre, un appel où c'est surtout une personne qui parle dans sa propre langue — réglez la langue de transcription sur celle qui couvre le plus d'audio. Cela donne juste la majeure partie de la transcription et réduit les passages minoritaires à ce qu'il faut relire contre l'enregistrement et corriger à la main, ce qui est un travail plus modeste qu'il n'y paraît quand il s'agit de quelques phrases plutôt que de tout le texte.
Quand les deux langues sont à peu près à égalité, aucun réglage ne fait mieux que l'autre — chaque choix donne juste environ la moitié de l'enregistrement et déforme le reste. C'est la situation où découper l'enregistrement, plutôt que choisir une langue et vivre avec le résultat, vaut l'effort supplémentaire.
Quand découper l'enregistrement en vaut la peine
Découper n'aide que si les langues se répartissent en tranches de temps bien distinctes plutôt qu'en alternant mot à mot à l'intérieur d'une même phrase — un cours qui est dans une langue pour la première moitié et dans une autre pour la seconde, une conversation où une personne parle entièrement dans une langue et l'autre entièrement dans la sienne. Coupez au point où la langue change, transcrivez chaque morceau avec son propre réglage de langue, et chaque moitié obtient la même précision qu'aurait un enregistrement dans une seule langue. Une alternance rapide à l'intérieur d'une phrase ne se découpe pas proprement du tout — il n'y a pas de point de coupe qui sépare les langues, donc une transcription de ce genre de parole aura de toute façon besoin d'une relecture corrigée à la main, quel que soit le réglage choisi.
Comment découper l'enregistrement en pratique
Couper un .m4a en morceaux est le travail d'un outil de découpage, et il vaut mieux savoir quelles applications en ont un avant de supposer que celle qui sert à enregistrer l'inclut. L'application Dictaphone d'Apple intègre un découpage basique, et GarageBand permet des coupes plus élaborées. Une fois chaque morceau devenu un fichier à part, l'importer dans l'application utilisée pour transcrire et régler la bonne langue pour ce morceau est une passe de transcription tout à fait ordinaire — rien ne change du fait qu'il vienne d'un découpage.
Vivre avec, l'autre option
Pour une bonne partie des cas où cela se présente — une conversation familiale, une note vocale rapide qui change de langue par habitude plus que par structure — découper le fichier demande plus d'effort que ce que vaut la transcription. Régler la langue dominante et corriger à la main les passages minoritaires ensuite donne une transcription lisible et utilisable en une seule passe et une seule correction, ce qui, pour la plupart des enregistrements personnels, est le chemin le plus rapide vers quelque chose que l'on relira vraiment.
Comment Voice Studio gère cela
Voice Studio transcrit avec un seul réglage de langue, choisi parmi 38 langues prises en charge, et ce réglage s'applique à tout l'enregistrement sur lequel il tourne — il n'y a pas d'option par segment ni de détection automatique, parce que la reconnaissance vocale d'iOS elle-même n'en propose aucune. La transcription est du texte modifiable, donc corriger les passages transcrits dans la mauvaise langue est une modification manuelle ordinaire, comme corriger n'importe quel autre mot erroné. Voice Studio n'inclut pas d'outil de découpage, donc découper un enregistrement par langue signifie le couper d'abord dans Dictaphone ou GarageBand puis réimporter chaque morceau — importer de l'audio existant est pris en charge, et chaque morceau importé se transcrit exactement comme un enregistrement fait dans l'application. Rien de tout cela n'est limité dans la version gratuite : enregistrer, importer, transcrire et exporter sont sans restriction.
Questions fréquentes
iOS détecte-t-il automatiquement la langue parlée ?
Non. Une passe de transcription reçoit à l'avance l'indication d'une seule langue à attendre, et passe tout l'enregistrement à faire correspondre ce qu'elle entend à cette langue, quelle que soit la langue réellement parlée.
Que devient la partie d'un enregistrement parlée dans une langue que je n'ai pas réglée ?
Elle est rapprochée des mots qui sonnent le plus proche dans la langue réglée, plutôt que d'échouer purement et simplement ou de changer de langue toute seule. Elle se lit comme du texte réel à la mauvaise place, donc il vaut mieux la vérifier contre l'audio plutôt que la considérer correcte d'office.
Vaut-il la peine de découper un enregistrement en fichiers séparés par langue ?
Seulement si les langues se répartissent en tranches de temps bien distinctes plutôt qu'en alternant à l'intérieur d'une même phrase. Un cours qui change de langue à mi-parcours se découpe proprement ; une alternance rapide non, et nécessite de toute façon une relecture corrigée à la main.
Voice Studio prend-il en charge plus d'une langue de transcription par enregistrement ?
Non — un seul réglage de langue s'applique à tout l'enregistrement, la même limite qu'a en général la reconnaissance vocale d'iOS. Importer un morceau découpé et le transcrire séparément avec son propre réglage de langue est la solution de contournement.
Essayer dans Voice Studio
Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.
Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure