Peut-on exporter un mémo vocal avant de le transcrire ?
Oui, pour l'audio. Le .m4a est terminé à l'instant où l'enregistrement s'arrête, et le partager ne vérifie pas si quelqu'un a déjà demandé une transcription. Ce qui a réellement besoin qu'une transcription existe au préalable, c'est l'export de la transcription — une exportation distincte, d'une chose distincte, et le seul endroit où l'ordre compte vraiment ici.
C'est une hypothèse raisonnable : transcrire donne l'impression d'être l'étape qui achève un enregistrement, donc exporter avant peut sembler aller trop vite. En réalité, les deux actions ne se suivent pas. Ce sont deux gestes indépendants qui partent tous les deux du même enregistrement, et un seul des deux a une quelconque raison de se soucier de savoir si l'autre a déjà eu lieu.
Ce qui existe juste après avoir arrêté d'enregistrer
À l'instant où un enregistrement se termine, il y a exactement une chose dans la bibliothèque : un fichier audio. Transcrire est une étape que l'on effectue ensuite, volontairement — cela ne se déclenche pas automatiquement au moment où l'on appuie sur Stop —, et un enregistrement sans transcription n'est pas un enregistrement cassé ou inachevé, c'est simplement un enregistrement que personne n'a encore demandé de transformer en texte. Rien dans le fichier lui-même n'attend que cela se produise.
Exporter l'audio ne vérifie jamais l'existence d'une transcription
Partager un enregistrement sous forme de .m4a est une opération de fichier : copier ceci là où on l'envoie. Il n'y a aucune étape, dans ce processus, qui regarde si une transcription existe, parce qu'une transcription ne fait pas partie de ce qui rend un fichier audio audio. On peut enregistrer quelque chose et le partager trente secondes plus tard, avant même d'avoir rouvert l'enregistrement, sans que l'export soit incomplet pour avoir sauté la transcription. Les mots ne font tout simplement pas partie de ce qui est envoyé.
C'est concrètement utile dans le cas courant où c'est l'audio qui presse : envoyer un message vocal à quelqu'un tout de suite, transmettre un extrait à un monteur qui en a besoin le jour même, ou sortir un enregistrement du téléphone avant même d'avoir décidé si l'on a personnellement besoin d'une transcription. Rien de tout cela n'a besoin d'attendre qu'un moteur de reconnaissance vocale termine quoi que ce soit.
Exporter la transcription est la seule qui en a réellement besoin
Un export de transcription en TXT ou en JSON est un fichier construit à partir de texte, et ce texte doit exister avant de pouvoir être écrit dans un fichier. Si un enregistrement n'a pas été transcrit, il n'y a rien encore à écrire dans l'un ou l'autre format — pas une erreur, une absence, de la même façon qu'un document sans un seul mot tapé n'a rien à enregistrer. Transcrire d'abord puis exporter la transcription ensuite n'est pas tant une règle imposée par l'application que le seul ordre qui ait un sens pour ce que fait réellement cet export.
C'est là que se cache la vraie distinction derrière la question initiale. « Exporter » sonne comme une seule action avec une seule exigence, mais un dictaphone qui propose à la fois un export audio et un export de transcription propose en réalité deux exports de deux choses différentes, et une seule d'entre elles a besoin d'une transcription comme ingrédient.
Où se situe une sauvegarde complète
Une sauvegarde complète est un unique fichier JSON couvrant toute la bibliothèque — le titre, la date, la durée et la transcription de chaque enregistrement, réunis dans un fichier pensé pour restaurer la bibliothèque plutôt que pour être lu tel quel. Lancer cette sauvegarde n'attend pas que tout soit transcrit au préalable. Un enregistrement auquel on ne s'est pas encore attaqué y figure avec ce qu'il a déjà — son titre, sa date, sa durée — et sans texte de transcription, puisqu'aucun n'a été produit. Ce n'est pas un trou dans la sauvegarde ; c'est un reflet fidèle de l'état réel de cet enregistrement à cet instant. Le transcrire plus tard, et la sauvegarde suivante en tiendra compte.
Pourquoi il vaut mieux garder les deux indépendants
Obliger à transcrire avant d'exporter reviendrait à lier un geste rapide, hors ligne et entièrement local — copier un fichier — à un autre plus lent, qui passe parfois par le service vocal d'Apple et prend toujours un minimum de temps de traitement. Rien ne justifie que le premier attende le second. Un dictaphone qui permet de sortir l'audio immédiatement et de régler la question des mots à son propre rythme fait le choix le plus utile, surtout quand c'est l'audio lui-même qui presse pour quelqu'un, pas une transcription de celui-ci.
Ce que transcrire ensuite ne change pas
Si l'audio a déjà été exporté et que l'enregistrement est transcrit plus tard, rien ne change dans le fichier déjà envoyé et rien n'a besoin d'être refait — il ne lui manquait rien, puisqu'il n'était jamais censé porter la transcription avec lui. Faire parvenir les mots à cette même personne plus tard est un export à part, ordinaire — TXT, JSON ou un bloc de texte copié — envoyé une fois la transcription réellement prête, pas une correction de ce qui a déjà été transmis.
Comment Voice Studio gère cela
Enregistrer, transcrire et exporter sont trois fonctions distinctes et sans restriction dans l'application gratuite, et aucune ne conditionne les autres. Le .m4a d'un enregistrement se partage dès qu'il est capturé, qu'on l'ait rouvert pour le transcrire ou non. Exporter la transcription en TXT ou en JSON, ou la copier, fonctionne dès qu'une transcription existe — produite en appuyant pour transcrire, ce qui tente toujours d'abord la voie sur l'appareil et ne se rabat sur le serveur d'Apple que si cette tentative locale revient vide ou échoue. La sauvegarde complète, dans Réglages, reprend ce que chaque enregistrement possède à cet instant, transcription incluse uniquement là où elle a réellement été faite — un lot d'enregistrements non transcrits n'empêche donc jamais de sauvegarder aujourd'hui.
Questions fréquentes
Faut-il transcrire un enregistrement avant de pouvoir en partager l'audio ?
Non. Partager le .m4a est une simple opération de fichier qui ne vérifie pas l'existence d'une transcription. L'audio peut être exporté dès la fin de l'enregistrement, transcrit ou non.
Que se passe-t-il si l'on essaie d'exporter la transcription d'un enregistrement qui n'a pas encore été transcrit ?
Il n'y a encore rien à mettre dans le fichier, puisque transcrire est une étape que l'on déclenche soi-même plutôt qu'un geste automatique au moment d'arrêter l'enregistrement. Il faut transcrire l'enregistrement d'abord, puis exporter la transcription.
Exporter l'audio déclenche-t-il la transcription en arrière-plan ?
Non. Exporter se contente de copier le .m4a là où on l'envoie. Cela n'appelle pas le moteur de reconnaissance vocale, et transcrire plus tard ne modifie en rien le fichier audio déjà exporté.
Si l'on transcrit un enregistrement après avoir déjà exporté l'audio, faut-il refaire cet export ?
Non. Le fichier audio était complet et inchangé dans les deux cas. Récupérer les mots ensuite est un export à part de la transcription, fait quand elle est prête, pas un nouvel export de l'audio.
Essayer dans Voice Studio
Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.
Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure