Voice Studio

Qualité standard, élevée ou ultra sur iPhone : laquelle choisir ?

Le réglage existe, il propose trois options, et rien dans l'app n'explique ce qui change entre elles. Voici ce que fait vraiment chacune, ce qu'elle coûte, et une règle simple qui couvre presque toutes les situations réelles.

Un sélecteur de qualité à trois niveaux sans explication appelle le même réflexe que n'importe quel autre écran de réglages : prendre le plus haut, par précaution. Pour un enregistrement de voix, ce réflexe gaspille surtout du stockage sans rien protéger, et cela vaut la peine de savoir pourquoi avant de monter le niveau par prudence.

Ce qui change vraiment entre les trois niveaux

Dans Voice Studio, les trois niveaux — standard, élevée et ultra — fixent la fréquence d'échantillonnage : le nombre de fois par seconde où le signal du microphone est mesuré. Standard enregistre à 22,05 kHz, élevée à 44,1 kHz, et ultra à 48 kHz. Les trois enregistrent de l'AAC mono dans un fichier .m4a. Rien d'autre ne change entre eux : même codec, même nombre de canaux, même type de fichier.

Une fréquence d'échantillonnage plus élevée capture une tranche plus large du spectre audible et, comme il y a davantage de signal mesuré à encoder, produit un fichier un peu plus lourd pour la même durée. C'est tout l'échange : un peu plus de plage de fréquences et de taille de fichier, contre rien que vous ayez demandé à sacrifier.

Pourquoi cette « plage plus large » compte à peine pour une voix

Une voix humaine, avec tout ce qui rend la parole intelligible, se situe surtout en dessous d'environ 8 kHz. Pour capturer une fréquence proprement, un enregistreur doit échantillonner à peu près au double de cette valeur, si bien que même le réglage standard, à 22,05 kHz, se situe confortablement au-dessus de ce dont une voix parlée a besoin. Élevée et ultra capturent davantage le détail des hautes fréquences de la pièce — un grincement de chaise, le souffle d'une bouche d'aération, le haut du spectre d'un instrument — pas davantage de la voix elle-même, puisque la voix était déjà entièrement présente au plus bas des trois réglages.

Ce n'est pas dire que les trois niveaux sonnent de façon identique sur tout. C'est une affirmation précise sur l'audio parlé, ce qu'un microphone de téléphone tenu à la main ou posé sur un bureau enregistre l'écrasante majorité du temps.

Ce qui dégrade vraiment un enregistrement, et ce qui n'y touche pas

Aucun des trois réglages ne touche à ce qui rend vraiment un enregistrement de voix difficile à écouter ou à transcrire ensuite : la distance entre le téléphone et la personne qui parle, la réverbération de la pièce, le bruit de fond d'un ventilateur ou de la circulation, et l'audio saturé parce qu'on parle trop près ou trop fort. Tout cela atteint l'enregistrement de la même façon quel que soit le niveau choisi. Rapprocher le téléphone de quinze centimètres fait plus pour un enregistrement que de passer de standard à ultra ne le fera jamais.

Le seul cas où le niveau supérieur mérite son poids

Il existe une raison précise et étroite de choisir ultra : un enregistrement destiné à un projet vidéo qui tourne à 48 kHz. Faire correspondre la fréquence d'échantillonnage native de l'audio à celle de la timeline vidéo évite une étape de rééchantillonnage plus tard, ce qui est un confort pour ce flux de travail précis plutôt qu'une différence de qualité audible en soi. En dehors de ce cas, ultra sert surtout à qui veut le fichier le plus fidèle possible que l'app puisse produire, par principe, indépendamment du fait que la différence s'entende ou non.

Ce que coûte de monter d'un niveau

Une fréquence d'échantillonnage plus élevée signifie davantage de signal mesuré arrivant à l'encodeur, et cela se traduit par un fichier plus lourd pour la même durée d'enregistrement — l'écart exact dépend de l'audio et de l'encodeur, mais la tendance reste constante : standard produit les fichiers les plus légers des trois, ultra les plus lourds. Sur un enregistrement long, ou l'habitude d'enregistrer souvent, c'est cette différence-là qui se voit vraiment ensuite, comme espace libre sur le téléphone plutôt que comme quoi que ce soit de perceptible à l'écoute.

Une façon simple de choisir

Il n'y a pas de mauvais choix ici au sens d'un enregistrement gâché — les trois produisent un .m4a propre et utilisable. Le seul vrai coût d'un mauvais choix est du stockage dépensé sur une plage de fréquences qu'une voix n'allait jamais utiliser.

Comment Voice Studio gère cela

Le réglage de qualité est un choix gratuit, pas quelque chose de réservé à Pro — standard, élevée et ultra sont tous disponibles dès le départ, et vous pouvez changer le réglage d'un enregistrement à l'autre à tout moment. Élevée est le réglage par défaut, ce qui correspond à la recommandation ci-dessus pour la plupart des enregistrements parlés. Quel que soit le niveau choisi, la transcription se comporte de la même façon : elle tente d'abord le passage sur l'appareil, quelle que soit la fréquence d'échantillonnage utilisée à l'enregistrement, car le réglage de qualité ne fait pas partie de ce sur quoi se construit une transcription.

Questions fréquentes

Quelle est la différence réelle entre les qualités standard, élevée et ultra ?

La fréquence d'échantillonnage : 22,05 kHz pour standard, 44,1 kHz pour élevée, et 48 kHz pour ultra. Les trois enregistrent de l'AAC mono dans le même type de fichier .m4a — rien d'autre ne change.

Un réglage de qualité plus élevé rend-il un enregistrement de voix plus clair ?

Pas pour la parole, d'aucune façon perceptible. L'intelligibilité de la parole se situe dans une plage de fréquences déjà couverte par le réglage standard. Ce qui affecte vraiment la clarté, c'est la distance à la personne qui parle, le bruit de la pièce et l'écho — rien de tout cela ne change avec le réglage de qualité.

Quel réglage utiliser par défaut ?

Élevée est un choix par défaut raisonnable pour presque tout enregistrement parlé. Standard est un choix sensé si le stockage est limité, puisqu'il ne coûte rien dont la parole a besoin. Ultra vaut surtout le coup si l'audio part vers un projet vidéo à 48 kHz.

Le réglage de qualité affecte-t-il la taille du fichier ?

Oui — une fréquence d'échantillonnage plus élevée signifie davantage de signal mesuré à stocker par l'encodeur, donc le fichier grossit un peu en passant de standard à élevée puis à ultra pour la même durée d'enregistrement. C'est le principal vrai compromis entre les trois.

Essayer dans Voice Studio

Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.

Télécharger dans l’App Store

Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure