Pourquoi ma transcription est-elle passée par le cloud ?
Ce n'est presque certainement pas un réglage que vous avez changé. Les applications construites sur le framework Speech d'Apple sont conçues pour essayer d'abord la voie locale, à chaque fois, et n'atteindre le serveur qu'en second recours, quand la tentative locale revient vide ou échoue. Si une transcription est passée par le cloud, quelque chose dans cet enregistrement précis a fait échouer la première tentative.
Cette question revient généralement après avoir remarqué quelque chose d'indirect : une transcription plus longue que d'habitude, un pic de données mobiles, ou simplement la lecture d'une explication sur la confidentialité en se demandant si elle s'appliquait à une transcription déjà obtenue. La réponse honnête est qu'il est impossible de savoir après coup quel chemin a pris un enregistrement donné sans l'avoir testé sur le moment — mais on peut savoir précisément ce qui l'aurait provoqué, ce qui est en général plus utile.
Un ordre d'opérations, pas un réglage
Ce n'est pas un interrupteur caché dans les réglages qui aurait basculé. C'est une séquence intégrée à la façon dont l'application appelle la reconnaissance vocale d'Apple : tenter la transcription en demandant la reconnaissance sur l'appareil, et seulement si cette tentative ne renvoie rien ou échoue, réessayer le même audio avec la reconnaissance sur l'appareil désactivée. C'est cette seconde tentative qui atteint le serveur d'Apple. La plupart du temps, la première tentative réussit et la seconde ne s'exécute jamais — les fois où elle s'exécute sont précisément celles qui motivent cette question.
Cette structure existe pour une raison simple : l'alternative au nouvel essai est de vous remettre une transcription vide et de s'arrêter là. Un résultat vide n'est pas un échec plus sûr, juste plus inutile. Le nouvel essai échange un peu de certitude sur la destination de l'audio contre une transcription qui existe réellement.
Ce qui fait échouer la première tentative
La langue n'a pas de modèle sur l'appareil
La reconnaissance vocale sur l'appareil est construite par Apple langue par langue, pas activée d'un bloc pour toutes. Si la langue transcrite n'a pas de modèle local sur votre téléphone, la tentative sur l'appareil échoue immédiatement, à chaque fois, quelle que soit la qualité de l'enregistrement. Rien dans la qualité audio n'aurait changé ce résultat.
Le modèle existe mais n'a jamais été téléchargé
Qu'une langue soit prise en charge et qu'elle soit présente sur votre téléphone précis sont deux choses différentes. Le modèle local d'une langue arrive généralement après que vous l'avez ajoutée quelque part que le système remarque — le clavier ou les réglages de dictée — et que le téléphone a eu le temps, sur le Wi-Fi, de le récupérer. Une langue jamais utilisée pour la dictée peut simplement ne pas encore avoir son modèle sur votre appareil, même si cette langue est prise en charge sur l'appareil en général.
L'audio lui-même a mis en échec un modèle plus petit
Les modèles sur l'appareil sont assez compacts pour tourner sur un téléphone, ce qui les rend moins tolérants que le modèle serveur qui se trouve derrière. Une voix faible ou lointaine, un fort bruit de fond, un accent marqué ou plusieurs personnes qui parlent en même temps sont le genre d'audio pour lequel un modèle local a plus de chances de ne rien renvoyer, alors que le modèle serveur, plus grand, traite le même extrait sans difficulté. C'est le cas où la langue est réellement prise en charge sur l'appareil et finit quand même par passer par le serveur, uniquement à cause du son de l'enregistrement.
Une décision par enregistrement, pas par application
Comme le déclencheur est « cette tentative précise a-t-elle échoué », deux enregistrements dans la même langue, faits à quelques minutes d'écart, peuvent prendre des chemins différents. L'un, net et proche, peut se transcrire entièrement sur l'appareil ; l'autre, plus faible, fait depuis l'autre bout de la pièce, dans la même langue, peut échouer en local et se rabattre sur le serveur. Rien n'a changé dans les réglages entre les deux — c'est l'audio lui-même qui a tranché.
Ce qui a réellement été envoyé, en cas de recours au serveur
Quand le nouvel essai s'exécute, c'est l'audio qui est transmis au service de reconnaissance vocale d'Apple — pas un résumé, pas seulement du texte partiel. Ce service est une voie propre à Apple, la même que celle derrière la dictée du clavier, et non une entreprise tierce choisie par l'application. « Propre à Apple » n'est pas la même affirmation que « local », et il vaut la peine de garder les deux séparées : l'audio a bien quitté le téléphone, même s'il n'a pas quitté l'écosystème d'un service qu'Apple documente et exploite déjà.
Comment le savoir à l'avance plutôt qu'après coup
Comme la bifurcation se joue par enregistrement, la seule façon de le savoir à l'avance est de retirer la possibilité de se rabattre sur le serveur et de voir ce qui se passe : mettez le téléphone en mode avion, Wi-Fi coupé, puis transcrivez. Sans réseau accessible, le nouvel essai n'a nulle part où aller. Une transcription qui revient signifie que la tentative sur l'appareil a réussi seule ; rien qui revienne signifie que cet enregistrement — dans cette langue, dans cette pièce — allait de toute façon avoir besoin du serveur.
Ce test est propre à l'enregistrement sur lequel il est fait. Une pièce différente, une langue différente ou une personne différente peuvent tomber de l'autre côté de la même bifurcation, donc cela vaut la peine de le refaire pour tout ce dont la réponse compte vraiment, plutôt que de généraliser à partir d'un seul résultat.
La place de Voice Studio là-dedans
Voice Studio tente toujours la transcription sur l'appareil en premier, pour chaque enregistrement et dans chacune de ses 38 langues de transcription, et ne réessaie avec la reconnaissance sur l'appareil désactivée que si cette première passe revient vide ou échoue. C'est ce nouvel essai qui envoie de l'audio au service vocal d'Apple, et c'est le seul chemin par lequel de l'audio quitte le téléphone — Voice Studio n'a ni compte, ni serveur propre, ni SDK d'analytique, donc rien d'un enregistrement ne va ailleurs, quelle que soit la tentative qui a produit la transcription. Pour obtenir une certitude sur un enregistrement précis plutôt qu'une explication après coup, le transcrire en mode avion tranche directement la question : soit la passe sur l'appareil s'en charge, soit rien ne revient, et dans les deux cas aucun audio n'a été envoyé.
Questions fréquentes
Puis-je désactiver le recours au cloud et n'obtenir que des transcriptions locales ?
Pas comme un réglage, mais vous pouvez forcer le même résultat en transcrivant en mode avion. Sans réseau disponible, seule la tentative sur l'appareil peut produire un résultat : si elle échoue, vous obtenez une transcription vide plutôt qu'une transcription envoyée au serveur.
Une transcription passée par le cloud signifie-t-elle que l'application a choisi de l'envoyer quelque part ?
Cela signifie que la tentative sur l'appareil pour cet enregistrement précis est revenue vide ou a échoué, et que l'application a réessayé sans demander la reconnaissance locale. C'est une réponse à une tentative locale échouée, pas une décision prise à l'avance.
Pourquoi la même langue s'est-elle transcrite en local hier et est-elle passée par le serveur aujourd'hui ?
Parce que le déclencheur est l'enregistrement individuel, pas la langue dans son ensemble. Un enregistrement plus clair ou plus proche peut réussir sur l'appareil, tandis qu'un autre plus faible ou plus bruyant, dans la même langue, échoue en local et se rabat sur le serveur.
La transcription serveur d'Apple est-elle envoyée à un tiers ?
Non. C'est un service propre à Apple, le même que celui utilisé pour la dictée au clavier. L'audio quitte bien le téléphone, ce qui est la partie à retenir, mais il n'est pas remis à une entreprise extérieure.
Essayer dans Voice Studio
Voice Studio enregistre, transcrit à l’intérieur de votre iPhone et range chaque note par heure et par lieu — pour que l’idée venue en voiture soit encore retrouvable le mois prochain.
Téléchargement gratuit · iPhone et iPad · iOS 16.4 ou version ultérieure