Voice Studio

Comment réunir plusieurs transcriptions de notes vocales en un seul document

Une app de transcription transcrit un enregistrement à la fois, parce que c'est l'unité qu'elle a réellement en main : l'audio capturé en une seule prise continue. Quand ce que vous voulez vraiment, c'est une semaine de journal, ou les deux moitiés d'un entretien, lues comme un seul texte, c'est du texte, et le texte se réunit. Il ne se réunit simplement pas tout seul.

Ce cas revient plus souvent que le mot « fusionner » ne le laisse penser. Ce n'est presque jamais un enregistrement qui s'est mystérieusement coupé en deux. C'est plus souvent plusieurs enregistrements qui ont toujours été distincts — une seconde séance du même entretien un autre jour, un cours où chaque séance est son propre fichier, un projet sur lequel vous prenez des notes vocales depuis une semaine — et que vous voulez seulement, après coup, lire ensemble, comme un document unique plutôt que comme une étagère d'entrées titrées séparément.

Quand ce sont vraiment plusieurs enregistrements, pas un seul qui s'est cassé

Ça vaut la peine d'être précis, parce que cela change ce que vous cherchez. Un enregistrement continu unique interrompu par un appel n'a besoin d'aucune réunion : l'app le met en pause à l'interruption et reprend dans le même fichier, vous obtenez donc un enregistrement avec un trou, pas deux. Deux fichiers distincts pour ce qui ressemblait à une seule séance vient en général de quelque chose de précis : le téléphone a manqué de stockage ou de batterie en cours de route, et la suite a dû être un nouvel enregistrement une fois le problème réglé, ou une interruption par appel est arrivée à un moment où la reprise n'était vraiment pas possible. Si l'une ou l'autre vient tout juste de vous arriver, cela vaut le coup d'être lu à part. Cette page traite du cas bien plus courant : des enregistrements qui n'ont jamais été une seule prise et que vous voulez maintenant quand même assembler en un seul document.

Il n'existe pas de fusion en lot, et ce n'est pas un problème

Aucune app d'enregistrement ne surveille les enregistrements liés entre eux pour proposer de coudre leurs transcriptions ensemble — cela demanderait de deviner lesquels vont ensemble, un jugement que vous seul pouvez porter. Ce que chaque enregistrement possède bel et bien, c'est une transcription que vous pouvez sortir en texte brut, et assembler du texte brut en un seul document est un travail de cinq minutes avec des outils que vous avez déjà, pas une fonction qui manque.

Corrigez chaque transcription avant de les réunir, pas après

Faites-le en premier, parce que c'est bien plus fastidieux une fois que plusieurs transcriptions sont déjà collées dans un même document. La reconnaissance vocale n'a aucune mémoire d'un enregistrement à l'autre — un nom mal entendu lundi est deviné à nouveau, à zéro, jeudi, et rien ne dit qu'elle retombera sur la même orthographe erronée deux fois. Relisez chaque transcription séparément et corrigez ce qui est faux tant que c'est encore un seul fichier et que vous vous souvenez encore de ce qui a vraiment été dit ; repérer une orthographe différente du même nom répartie sur trois transcriptions distinctes, une fois qu'elles ne forment plus qu'un document, est une lecture bien plus difficile.

Réglez l'ordre avant de coller quoi que ce soit

Chronologique est le choix par défaut correct dans presque tous les cas où cela s'applique — un entretien en plusieurs séances, une semaine de journal, un cours en plusieurs séances. Triez la bibliothèque par date pour voir l'ordre réel des événements, plutôt que de vous fier à votre mémoire ou à l'ordre dans lequel les enregistrements se trouvent affichés à l'écran ; l'ordre dans lequel vous avez enregistré et celui dans lequel vous les regardez maintenant ne coïncident pas toujours.

Exporter chacun d'eux

Pour un document destiné à être lu, exportez en TXT plutôt qu'en JSON. L'export TXT place déjà le titre, la date, l'heure et le lieu au-dessus de la transcription — cet en-tête rend ici un service utile en dehors de son usage d'origine, car une fois plusieurs transcriptions collées dans un même document, c'est lui qui indique où finit un enregistrement et où commence le suivant. Gardez-le plutôt que de le supprimer pour une page plus nette.

Pour deux ou trois enregistrements, exporter l'un après l'autre via la feuille de partage et coller chaque texte dans une app de notes ou de documents au fur et à mesure suffit largement. Pour une série plus longue — un cours entier, un mois de journal —, tout sortir d'un coup via l'app Fichiers est plus rapide que répéter la feuille de partage enregistrement par enregistrement, puisque cela vous donne tous les fichiers exportés au même endroit plutôt qu'un par un.

Assembler le document

Collez chaque transcription dans l'ordre retenu et laissez son en-tête TXT en place comme séparateur de section — vous obtenez ainsi un document unique où « la séance de mardi » et « la séance de jeudi » sont toutes deux visibles et attribuables, plutôt qu'un seul bloc de texte indifférencié qui était autrefois deux enregistrements distincts. Une ligne vide ou un trait entre les sections suffit ; rien de plus élaboré n'est nécessaire pour un document dont tout le but est d'être lu d'une traite.

Quand le JSON est en fait la meilleure source

Coller à la main est le bon outil pour une poignée d'enregistrements lus par une personne. Si vous construisez plutôt quelque chose qui doit traiter un grand nombre de transcriptions de façon régulière — les importer dans un tableur, alimenter un script qui assemble le document à votre place —, le JSON est le format prévu pour cela. Il garde la date, la durée et la transcription comme des champs séparés qu'un programme peut trier et coudre de façon fiable, plutôt que du texte qu'une personne doit lire et placer à l'œil. Lequel choisir dépend entièrement de si c'est une personne ou un programme qui assemble, pas de quel format serait « meilleur ».

Ce qui ne survit pas dans un document réuni

Un repère posé pendant l'un des enregistrements d'origine est une ligne sur la forme d'onde de cet enregistrement précis, destinée à ramener la lecture à un instant de l'audio — il n'a aucun équivalent en texte brut, il n'apparaît donc pas dans l'export et ne peut pas apparaître dans un document construit à partir de plusieurs exports collés bout à bout. Si un instant repéré pendant l'enregistrement mérite d'être conservé dans le document réuni, c'est une note manuelle que vous ajoutez vous-même en l'assemblant, pas quelque chose qui survit automatiquement à l'export.

Ce n'est pas le même travail qu'une sauvegarde complète

Une sauvegarde complète est un unique fichier JSON couvrant tous les enregistrements du téléphone, conçue pour restaurer toute la bibliothèque, pas pour qu'une poignée d'enregistrements liés se lise comme un seul document. Elle n'a aucune notion de quels enregistrements vont ensemble, et elle n'est pas destinée à être ouverte et lue comme on lit un document réuni — c'est une assurance pour le jour où le téléphone est perdu, pas un raccourci pour cela. Construire le document que vous voulez vraiment lire suppose toujours de choisir les enregistrements pertinents et de les exporter individuellement, que vous mainteniez ou non par ailleurs une sauvegarde complète.

Comment Voice Studio s’inscrit dans tout cela

Il n'existe aucun moyen intégré de sélectionner plusieurs enregistrements et d'exporter un document réuni : chaque enregistrement exporte sa transcription en TXT ou en JSON de son côté, ou son audio comme le .m4a d'origine, et la bibliothèque peut être triée par plus récent, par durée ou par nombre de mots pour obtenir les enregistrements dans l'ordre voulu avant de commencer. La transcription reste modifiable jusqu'au moment de l'exporter, donc corriger un nom dans la séance de lundi avant de la coller à côté de celle de jeudi coûte un instant à ce moment-là et évite une lecture bien plus longue ensuite. Rien de tout cela n'exige Pro : l'export, et la correction qui rend l'export utile, sont tous deux dans l'app gratuite.

Questions fréquentes

Existe-t-il un moyen de sélectionner plusieurs enregistrements et d'exporter un fichier réuni ?

Non. Chaque enregistrement exporte sa transcription ou son audio séparément, en TXT, en JSON ou en .m4a d'origine. Réunir plusieurs enregistrements en un document signifie exporter chacun et les assembler soi-même, ce qui, pour une poignée d'enregistrements, reste un travail rapide.

Dans quel ordre placer les transcriptions ?

Chronologique, dans presque tous les cas où cela se pose — un entretien en plusieurs séances, un cours en plusieurs séances, une série d'entrées de journal. Triez la bibliothèque par date plutôt que de vous fier à l'ordre où les enregistrements se trouvent affichés à l'écran.

Un repère posé pendant l'enregistrement apparaîtra-t-il dans le document réuni ?

Non. Un repère est une position sur la forme d'onde de cet enregistrement précis, destinée à y ramener la lecture — il n'a aucun équivalent en texte et n'apparaît dans aucun export TXT ou JSON. Notez vous-même l'instant s'il doit survivre dans le document réuni.

Devrais-je utiliser la sauvegarde complète plutôt qu'exporter chaque enregistrement séparément ?

Non. La sauvegarde complète est un unique JSON couvrant toute la bibliothèque, destinée à tout restaurer si le téléphone est perdu, pas à assembler une poignée d'enregistrements liés en un document lisible. Exportez plutôt individuellement les enregistrements précis dont vous avez besoin.

Essayer dans Voice Studio

Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.

Télécharger dans l’App Store

Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure