Voice Studio

Quelle place occupe vraiment une sauvegarde de notes vocales ?

Réponse courte : presque rien, et ça ne grossit pas comme on pourrait le croire. Une sauvegarde complète, ce sont les informations et la transcription de chaque enregistrement dans un seul fichier — pas les enregistrements eux-mêmes — et le texte occupe une fraction infime de ce que pèse l'audio pour la même durée de parole.

Le mot « sauvegarde » traîne beaucoup de bagages venus des photos et des vidéos, où il désigne quelque chose qu'on lance avant de dormir et qu'on vérifie le lendemain matin, ou un forfait cloud qu'il a fallu agrandir. Une sauvegarde de notes vocales, quand elle ne contient que le compte-rendu de ce qui a été dit et non l'audio lui-même, ne se comporte pas du tout de cette façon, et l'écart entre les deux mérite d'être compris avant de supposer que l'un implique l'autre.

Ce qu'il y a vraiment dans le fichier

Une exportation de sauvegarde complète est un registre des informations et de la transcription de chaque enregistrement — titre, date, durée, texte transcrit — réunis dans un seul fichier. Ce n'est pas l'audio réempaqueté de la même façon. Les enregistrements restent des fichiers individuels, et une sauvegarde de ce type est conçue pour restaurer ce que l'app sait de votre bibliothèque, pas pour être une seconde copie du son lui-même.

Cette distinction est toute la raison pour laquelle le fichier reste petit. Vous ne sauvegardez pas des heures de son. Vous sauvegardez les mots qui en sont sortis.

Pourquoi le texte et l'audio ne sont pas volumineux de la même façon

L'audio compressé doit quand même représenter une onde continue, des dizaines de milliers de fois par seconde, même après qu'un codec comme l'AAC ait jeté ce qu'un auditeur ne remarquerait pas. C'est fondamentalement beaucoup de données par seconde, aussi bonne que soit la compression. Le texte ne fonctionne pas du tout ainsi — un mot coûte une poignée d'octets, quel que soit le temps qu'il a fallu pour le prononcer. Une phrase qui prend quatre secondes à dire peut représenter trente caractères de transcription, et trente caractères, c'est une erreur d'arrondi à côté de quatre secondes d'audio même bien compressé.

Ce n'est ni un réglage ni un choix de conception dont l'un ou l'autre format aurait pu se dispenser. C'est la différence entre stocker un son et stocker une description d'un son, et une description sera toujours plus petite — souvent de deux ou trois ordres de grandeur — parce qu'elle a tout jeté sauf les mots.

Mettre de vrais chiffres côte à côte

Une transcription seule, exportée à part, pèse quelques kilo-octets — une page ou deux de texte, à peu près, pour un enregistrement de longueur normale. L'audio vocal mono compressé, lui, pèse plusieurs dizaines de mégaoctets par heure. En mettant les deux côte à côte, une sauvegarde couvrant des mois d'enregistrements, entièrement sous forme de texte transcrit, peut encore rester plus petite qu'une seule heure de l'audio qu'elle décrit.

Passez à l'échelle. Une bibliothèque de quelques centaines d'enregistrements avec des transcriptions généreuses reste, au total, un fichier texte de quelques mégaoctets tout au plus — le genre de chose qui s'ouvre instantanément et se joint à un e-mail sans y réfléchir à deux fois. Cela reste vrai même pour quelqu'un qui enregistre tous les jours et laisse les mois s'accumuler, parce que la croissance se fait en mots, pas en forme d'onde.

Ce que cela change concrètement

Quand cela pourrait finir par compter (probablement pas quand même)

Rien ici n'est littéralement nul, et une archive personnelle vraiment énorme — des milliers d'enregistrements longs, tous transcrits — représente plus de texte qu'une poignée de notes. Même dans ce cas, le texte grossit lentement comparé à presque tout ce qui se dispute la place sur un téléphone ; une bibliothèque de cette taille reste peu susceptible de rivaliser avec ce qu'occupent quelques dizaines de photos, et encore moins avec de la vidéo. Si vous voulez savoir précisément quelle taille fait la vôtre plutôt que de vous fier à une réponse générale, exportez-la une fois et vérifiez vous-même la taille du fichier — c'est un chiffre plus honnête que n'importe lequel cité ici, parce que c'est votre bibliothèque réelle, pas une moyenne.

Comment Voice Studio gère cela

Les réglages proposent une exportation de sauvegarde complète : un seul fichier JSON avec le titre, la date, la durée et la transcription de chaque enregistrement, conçu pour être restauré d'un bloc plutôt que lu ligne par ligne. Il ne contient pas l'audio — les enregistrements se partagent séparément comme fichiers .m4a d'origine, non modifiés, via le menu de partage habituel. Il n'y a ni compte ni synchronisation CloudKit derrière tout cela, donc l'export est un simple fichier qui va exactement là où vous l'envoyez et nulle part ailleurs — ce qui est aussi la raison pour laquelle rien ne vous empêche d'en refaire un dès que ça vous arrange, plutôt que d'économiser sur la fréquence.

Questions fréquentes

Une bibliothèque de notes vocales plus grande donne-t-elle un fichier de sauvegarde beaucoup plus gros ?

Il grossit, mais lentement, parce qu'il grossit en texte et non en audio. Doubler le nombre d'enregistrements double à peu près le texte transcrit, ce qui reste un petit fichier — rien à voir avec doubler des heures d'audio.

Puis-je simplement m'envoyer une sauvegarde complète par e-mail plutôt que d'utiliser un câble ou le cloud ?

En général, oui. Une sauvegarde construite à partir de transcriptions plutôt que d'enregistrements reste généralement assez petite pour être jointe directement à un e-mail ou un message, sans avoir besoin d'un service pensé pour les gros fichiers.

Le fichier de sauvegarde contient-il les enregistrements audio eux-mêmes ?

Non. Une sauvegarde complète de ce type couvre le titre, la date, la durée et la transcription de chaque enregistrement. L'audio reste sous forme de fichiers .m4a séparés, exportables à part si vous voulez les enregistrements en plus.

Pourquoi une sauvegarde faite après des mois d'enregistrement reste-t-elle aussi petite ?

Parce que c'est du texte, pas du son. Une transcription coûte une poignée de kilo-octets quelle que soit la durée de l'enregistrement, tandis que l'audio lui-même pèse plusieurs dizaines de mégaoctets par heure — les deux grossissent à des rythmes totalement différents.

Essayer dans Voice Studio

Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.

Télécharger dans l’App Store

Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure