Voice Studio

¿Editar una transcripción cambia la grabación original en el iPhone?

No. Una transcripción es texto que vive junto a una grabación, no una capa escrita dentro del propio archivo de audio. Corregir un nombre mal oído, borrar una línea repetida, limpiar un tramo de muletillas: nada de eso llega hasta el .m4a. Esto es por qué los dos son objetos separados, y qué te da exactamente esa separación.

Dos cosas distintas comparten una misma grabación

Una nota de voz son en realidad dos objetos con un solo nombre: el audio en sí, un archivo AAC escrito en el disco mientras hablabas, y una transcripción, un bloque de texto producido después al pedirle a un reconocedor de voz que escuche ese archivo ya terminado y adivine las palabras. Se crean en momentos distintos, con procesos distintos, y se guardan como datos distintos: el audio lo genera el micrófono y el codificador; la transcripción, un proceso aparte que solo arranca cuando la grabación ya existe. Una vez que la transcripción se ha hecho, las dos cosas quedan una junto a la otra en la misma entrada, pero "junto a" hace ahí un trabajo de verdad: ninguna está incrustada dentro de la otra.

Qué toca realmente editar una transcripción

Corregir una transcripción es una edición de texto en el sentido más llano: el mismo tipo de cambio que harías en cualquier campo editable — seleccionas una palabra, la sustituyes, sigues. En ningún momento vuelve a llamar al audio. Nada decodifica el .m4a, nada lo vuelve a codificar, y nada vuelve a ejecutar el reconocedor de voz sobre él. La corrección actualiza una sola cosa — el texto de la transcripción asociado a esa grabación — y ahí se queda. El audio terminó de escribirse en el momento en que acabó la grabación; una edición de la transcripción hecha una hora, una semana o un año después no tiene ningún camino de vuelta hacia un archivo que se cerró mucho antes de esa edición.

Merece la pena distinguir esto de una acción genuinamente distinta: volver a transcribir una grabación, que sí vuelve a llamar al audio para producir una transcripción nueva desde cero. Volver a transcribir lee el audio otra vez. Corregir una palabra en la transcripción ya existente no lee el audio en absoluto: cambia texto que ya estaba ahí.

Por qué se mantienen separadas desde el principio

Un reconocedor de voz trata el audio que recibe como una fuente, no como algo que modificar: lo escucha una vez, escribe su mejor suposición como un dato aparte, y no tiene ningún motivo para volver a tocar la grabación original nunca más. Construirlo de otra manera significaría que una app edita en silencio su propio audio en tu nombre, basándose en una suposición de lo que debería haber ahí en vez de lo que realmente se grabó. Mantener el audio como un archivo plano, sin modificar, y la transcripción como una suposición aparte y editable sobre ese archivo es lo que permite corregir todas las palabras que hagan falta sin riesgo: no hay forma de que una corrección, ni cien, lleguen hacia atrás hasta la propia grabación.

Lo que "editable" no significa: sin historial de versiones

Editar una transcripción sobrescribe el texto en el sitio, en vez de guardar constancia de lo que decía antes de la edición. No hay un historial que abrir, ni un borrador anterior escondido detrás del actual, ni forma de comparar una corrección con la suposición original del reconocedor después de hecha. Pasa lo mismo cuando una transcripción se vuelve a generar en otro idioma tras haber elegido mal al principio: el resultado nuevo sustituye al que había, en vez de quedarse al lado. Si la redacción original del reconocedor, errores incluidos, merece conservarse para comparar, exporta la transcripción antes de hacer cambios que puedas querer deshacer; la exportación es una fotografía fija, de un modo en que el campo de transcripción en vivo no lo es.

Por qué esta separación resulta útil de verdad

Significa que puedes ser todo lo agresivo que quieras al limpiar una transcripción sin sopesar eso frente a ningún riesgo para la grabación. Corregir un nombre que el reconocedor adivinó mal, borrar una línea que se duplicó, ordenar un tramo lleno de muletillas: nada de eso es una decisión que también toque la única copia de lo que realmente se dijo. Para cualquier caso donde el audio original importe como registro por derecho propio — una entrevista que quizá necesites volver a revisar, una nota que estás transcribiendo de forma laxa solo para poder buscarla — eso te da permiso para editar la versión legible con libertad mientras el audio queda debajo, intacto, como el relato real de lo que pasó.

Cómo se refleja esto al exportar

Como la transcripción y el audio son cosas separadas, exportar una es una acción distinta de exportar la otra, en todos los casos, no solo en este. Exportar el audio entrega el .m4a exactamente como se grabó, sin que le afecte ninguna edición de la transcripción hecha antes o después. Exportar la transcripción entrega lo que diga en ese momento el campo de texto, correcciones incluidas. Hacer una exportación no te dice nada sobre el estado de la otra. Y si ya has exportado una transcripción una vez y después la corriges, si esa copia anterior se actualiza sola o no es una pregunta relacionada pero distinta, que merece la pena leer aparte.

Cómo lo resuelve Voice Studio

La transcripción de una grabación es texto normal y editable — corrige un nombre, borra una línea, ordena un tramo de muletillas — y nada de eso toca el .m4a que hay debajo, que se escribe una sola vez, cuando la grabación termina, y que nada de lo que hagas después con la transcripción vuelve a reescribir. No hay historial de versiones en las ediciones de la transcripción, así que una corrección sustituye lo que había en vez de conservarlo para comparar; exporta la transcripción antes si la redacción original merece guardarse. Grabar, transcribir, editar y exportar están sin restricciones en la app gratuita: la separación entre texto y audio no es algo de Pro, es simplemente cómo han funcionado siempre esos dos datos.

Preguntas frecuentes

Si corrijo un error en la transcripción, ¿cambia el archivo de audio?

No. Editar la transcripción cambia solo el texto asociado a la grabación. El archivo de audio .m4a se escribe una sola vez, cuando la grabación termina, y nada de editar la transcripción después lo lee ni lo reescribe.

¿Puedo recuperar la transcripción original después de editarla?

No desde dentro de la app: una edición sobrescribe el texto en el sitio, sin historial de versiones al que volver. Exporta la transcripción antes si la redacción original, acertada o no, merece conservarse para comparar.

¿Editar una transcripción es lo mismo que volver a transcribir una grabación?

No. Editar cambia texto ya existente a mano y nunca vuelve a leer el audio. Volver a transcribir ejecuta el reconocedor de voz sobre el audio una segunda vez y sustituye la transcripción por un resultado nuevo.

¿Exportar la transcripción también exporta el audio, o al revés?

Ninguna de las dos cosas. Son dos exportaciones separadas — el audio como el .m4a original, la transcripción como TXT o JSON — y hacer una no toca ni incluye la otra.

Pruébalo en Voice Studio

Voice Studio graba, transcribe dentro de tu iPhone y archiva cada nota por hora y lugar, para que la idea que se te ocurrió en el coche siga estando localizable el mes que viene.

Descargar en el App Store

Descarga gratuita · iPhone y iPad · iOS 16.4 o posterior