Voice Studio

¿Puede un iPhone leer en voz alta una transcripción de una nota de voz?

Sí — y la función que lo hace no pertenece a ninguna app de grabación en concreto. Es Contenido hablado, una función de accesibilidad integrada en iOS que lee cualquier texto que haya en pantalla en ese momento, en cualquier app, transcripción o no.

Es una necesidad habitual: hay una transcripción delante y leerla en silencio no es lo que ayuda en ese momento. Puede que sea más fácil detectar una palabra equivocada de oído que a la vista — un error tipográfico se esconde de tu propia lectura y salta en cuanto alguien lo lee en voz alta. O puede que tengas las manos y los ojos ocupados en otra cosa mientras los oídos están libres. En cualquier caso, la pregunta es si el iPhone puede simplemente decir las palabras en lugar de mostrarlas, y la respuesta está en Ajustes, no en la app que escribió la transcripción.

La función se llama Contenido hablado, y es de iOS, no de la app

En Ajustes → Accesibilidad → Contenido hablado hay dos herramientas relacionadas: Hablar selección, que lee el texto que has resaltado después de tocar Hablar en el menú emergente, y Hablar pantalla, que lee todo lo que hay visible con un deslizamiento hacia abajo con dos dedos desde arriba, sin necesidad de seleccionar nada. Las dos funcionan leyendo lo que hay dibujado en pantalla en ese instante. Ninguna le pide permiso o colaboración a la app de debajo, porque no lo necesita — para iOS, una transcripción es solo texto, igual que un mensaje, una página web o un correo.

Por qué una app no tiene que construir nada para que esto funcione

Es fácil dar por hecho que esto es una función que unas apps tienen y otras no, como una barra de búsqueda o un botón para compartir. No es ese tipo de función. Contenido hablado lee la propia pantalla, a nivel del sistema operativo, así que funciona en una transcripción igual que en cualquier otra cosa con texto — la app de grabación no tiene que activar nada ni añadir un botón para que esté disponible. Si una transcripción está en pantalla y se puede leer con los ojos, Contenido hablado también puede leerla.

Dónde funciona bien

Dónde lee mal: una exportación JSON en bruto

Este es el único punto donde el formato sí importa de verdad. Una exportación JSON guarda el título, la fecha, la hora, el lugar, la duración y otros datos de la transcripción como campos separados y etiquetados, envueltos en llaves y comillas, pensados para que los lea un programa, no una persona. Abre ese archivo directamente y pídele a Contenido hablado que lo lea, y te lee cada llave, cada dos puntos y cada nombre de campo en voz alta junto con las palabras — antes de llegar a lo que realmente se dijo. Una exportación TXT no tiene nada de esa estructura. Es el título, la fecha, la hora y el lugar como líneas de texto normal, seguidas de la transcripción como texto corrido — la forma para la que se pensó Contenido hablado, y la que conviene exportar si esto es lo que buscas.

La velocidad y la voz también se ajustan fuera de la app

Hablar pantalla muestra unos controles pequeños en pantalla mientras lee — reproducir y pausar, retroceder o avanzar una frase, y un control de velocidad que va de notablemente más lento que una persona hablando a bastante más rápido. Qué voz lee, y en qué idioma, también se ajusta una sola vez en los ajustes de Contenido hablado, no transcripción a transcripción. Nada de eso lo configura una app de grabación; es la misma experiencia de lectura venga el texto de una nota de voz, de una página web o de cualquier otra cosa del teléfono.

Cómo lo maneja Voice Studio

Voice Studio no tiene un botón propio de lectura en voz alta, y no lo necesita — una transcripción dentro de la app es texto normal en pantalla, como cualquier otro, así que Hablar pantalla la lee igual que lee cualquier otra cosa. Exportar es TXT o JSON, un ajuste y no un valor fijo: elige TXT para cualquier cosa pensada para leerse en voz alta o a la vista, y guarda JSON para cuando de verdad quieras los campos estructurados — duración, estado de ánimo, etiquetas — que un programa o una hoja de cálculo aprovecharían.

Preguntas frecuentes

¿La app de grabación necesita una función de texto a voz para que esto funcione?

No. Contenido hablado es una función de accesibilidad de todo iOS que lee lo que haya en pantalla, en cualquier app. Una app de grabación no necesita construir ni activar nada para que funcione sobre una transcripción.

¿Cómo activo Hablar pantalla?

En Ajustes → Accesibilidad → Contenido hablado, activa Hablar pantalla. Después, un deslizamiento hacia abajo con dos dedos desde la parte superior lee lo que haya visible en ese momento, en cualquier app.

¿Por qué suena raro al leerse en voz alta una transcripción exportada en JSON?

JSON envuelve cada campo en llaves, comillas y dos puntos pensados para que los interprete un programa, no para que los oiga una persona. Contenido hablado lo lee todo tal cual. Una exportación TXT no tiene esa estructura y se lee como frases normales.

¿Puedo cambiar la velocidad o la voz con la que lee?

Sí, las dos cosas se ajustan una sola vez en Ajustes → Accesibilidad → Contenido hablado — un control de velocidad y un selector de voz e idioma — y se aplican a todo lo que Contenido hablado lea después, no transcripción por transcripción.

Pruébalo en Voice Studio

Voice Studio graba, transcribe dentro de tu iPhone y archiva cada nota por hora y lugar, para que la idea que se te ocurrió en el coche siga estando localizable el mes que viene.

Descargar en el App Store

Descarga gratuita · iPhone y iPad · iOS 16.4 o posterior