Voice Studio

Modifier une transcription change-t-il l'enregistrement d'origine sur iPhone ?

Non. Une transcription est du texte posé à côté d'un enregistrement, pas une couche écrite dans le fichier audio lui-même. Corriger un nom mal entendu, supprimer une ligne dupliquée, nettoyer un passage plein d'hésitations — rien de tout cela n'atteint le .m4a. Voici pourquoi les deux sont des objets séparés, et ce que cette séparation vous apporte concrètement.

Deux choses différentes partagent un même enregistrement

Une note vocale, ce sont en réalité deux objets qui portent un seul nom : l'audio lui-même, un fichier AAC écrit sur le disque pendant que vous parliez, et une transcription, un bloc de texte produit ensuite en demandant à un moteur de reconnaissance vocale d'écouter ce fichier déjà terminé et de deviner les mots. Ils sont créés à des moments différents, par des processus différents, et conservés comme des données différentes — l'audio par le micro et l'encodeur, la transcription par un passage à part qui ne démarre qu'une fois l'enregistrement déjà existant. Une fois la transcription faite, les deux se retrouvent côte à côte dans la même fiche, mais « côte à côte » fait ici tout le travail : ni l'un ni l'autre n'est intégré à l'intérieur du second.

Ce qu'une modification de transcription touche réellement

Corriger une transcription est une modification de texte au sens le plus simple — le genre de changement qu'on ferait dans n'importe quel champ modifiable : sélectionner un mot, le remplacer, passer à la suite. Cela ne rappelle jamais l'audio. Rien ne décode le .m4a, rien ne le ré-encode, et rien ne relance le moteur de reconnaissance vocale dessus. La correction met à jour une seule chose — le texte de la transcription rattaché à cet enregistrement — et s'arrête là. L'audio a fini d'être écrit au moment où l'enregistrement s'est terminé ; une modification de transcription faite une heure, une semaine ou un an plus tard n'a aucun chemin de retour vers un fichier refermé bien avant cette modification.

Cela mérite d'être distingué d'une action réellement différente : retranscrire un enregistrement, qui, elle, rappelle bien l'audio pour produire une transcription neuve depuis le début. Retranscrire relit l'audio. Corriger un mot dans la transcription existante ne relit pas l'audio du tout — cela change du texte déjà présent.

Pourquoi les deux sont tenus à part dès le départ

Un moteur de reconnaissance vocale traite l'audio qu'on lui donne comme une source, pas comme quelque chose à modifier — il écoute une fois, écrit sa meilleure supposition comme une donnée à part, et n'a plus jamais aucune raison de retoucher l'enregistrement d'origine. Le construire autrement voudrait dire qu'une app modifie discrètement son propre audio à votre place, en se basant sur une supposition de ce qui aurait dû s'y trouver plutôt que sur ce qui a réellement été enregistré. Garder l'audio comme un fichier brut, non modifié, et la transcription comme une supposition à part, modifiable, sur ce fichier, c'est ce qui permet de corriger autant de mots qu'on veut sans risque : aucune correction, ni cent d'entre elles, ne peut remonter jusqu'à l'enregistrement lui-même.

Ce que « modifiable » ne veut pas dire : aucun historique de versions

Modifier une transcription écrase le texte sur place plutôt que de garder une trace de ce qu'il disait avant la modification. Il n'y a pas d'historique à ouvrir, pas de brouillon antérieur caché derrière la version actuelle, et aucun moyen de comparer une correction à la supposition d'origine du moteur après coup. La même chose se produit quand une transcription est régénérée dans une autre langue après en avoir choisi une mauvaise au départ — le nouveau résultat remplace ce qui était là au lieu de se poser à côté. Si la formulation d'origine du moteur, erreurs comprises, mérite d'être conservée pour comparaison, exportez la transcription avant de faire des changements que vous pourriez vouloir annuler ; l'export est un instantané, d'une manière que le champ de transcription en direct n'est pas.

Pourquoi cette séparation est réellement utile

Cela veut dire que vous pouvez nettoyer une transcription aussi énergiquement que vous voulez sans avoir à mettre cela en balance avec un quelconque risque pour l'enregistrement. Corriger un nom mal deviné par le moteur, supprimer une ligne dupliquée, nettoyer un passage plein d'hésitations — rien de tout cela n'est une décision qui touche aussi l'unique copie de ce qui a réellement été dit. Pour tout ce dont l'audio d'origine importe comme témoignage à part entière — un entretien qu'il faudra peut-être revérifier plus tard, une note que vous transcrivez à la va-vite juste pour pouvoir la retrouver par la recherche — cela vous donne la liberté de modifier la version lisible sans retenue, pendant que l'audio reste en dessous, intact, comme le compte-rendu réel de ce qui s'est passé.

Comment cela se traduit à l'export

Comme la transcription et l'audio sont deux choses séparées, exporter l'une est une action distincte d'exporter l'autre, dans tous les cas, pas seulement celui-ci. Exporter l'audio livre le .m4a exactement tel qu'enregistré, sans aucun effet des modifications de transcription faites avant ou après. Exporter la transcription livre ce que dit le champ de texte au moment précis, corrections comprises. Faire un export ne dit rien sur l'état de l'autre. Et si vous avez déjà exporté une transcription une fois puis que vous la corrigez ensuite, la question de savoir si cette copie déjà exportée se met à jour toute seule est une question voisine mais distincte, qui mérite d'être lue à part.

Comment Voice Studio gère cela

La transcription d'un enregistrement est du texte ordinaire et modifiable — corriger un nom, supprimer une ligne, nettoyer un passage plein d'hésitations — et rien de tout cela ne touche le .m4a en dessous, qui est écrit une seule fois, quand l'enregistrement se termine, et jamais réécrit par quoi que ce soit que fait la transcription ensuite. Il n'y a pas d'historique de versions sur les modifications de transcription, donc une correction remplace ce qui était là au lieu de le garder pour comparaison ; exportez la transcription d'abord si la formulation d'origine mérite d'être conservée. Enregistrer, transcrire, modifier et exporter sont sans restriction dans l'app gratuite — la séparation entre texte et audio n'est pas une fonctionnalité Pro, c'est simplement la façon dont ces deux données ont toujours fonctionné.

Questions fréquentes

Si je corrige une erreur dans la transcription, cela change-t-il le fichier audio ?

Non. Modifier la transcription ne change que le texte rattaché à l'enregistrement. Le fichier audio .m4a est écrit une seule fois, quand l'enregistrement se termine, et rien dans le fait de modifier la transcription ensuite ne le relit ni ne le réécrit.

Puis-je retrouver la transcription d'origine après l'avoir modifiée ?

Pas depuis l'app — une modification écrase le texte sur place, sans historique de versions vers lequel revenir. Exportez la transcription avant si la formulation d'origine, juste ou fausse, mérite d'être conservée pour comparaison.

Modifier une transcription revient-il à retranscrire un enregistrement ?

Non. Modifier change du texte existant à la main et ne relit jamais l'audio. Retranscrire relance le moteur de reconnaissance vocale sur l'audio une seconde fois et remplace la transcription par un résultat neuf.

Exporter la transcription exporte-t-il aussi l'audio, ou l'inverse ?

Ni l'un ni l'autre. Ce sont deux exports séparés — l'audio en tant que .m4a d'origine, la transcription en TXT ou en JSON — et faire l'un ne touche ni n'inclut l'autre.

Essayer dans Voice Studio

Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.

Télécharger dans l’App Store

Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure