Permiso de micrófono vs permiso de reconocimiento de voz en iPhone: ¿cuál es la diferencia?
Respuesta corta: el permiso de Micrófono deja que una app capte sonido, sin más. El de Reconocimiento de voz le permite pasar ese sonido al motor de voz de Apple y recibir texto a cambio. Son interruptores independientes, y una app puede tener uno sin el otro.
Instala una app que graba y además transcribe, y normalmente verás dos avisos de permiso distintos antes de haber grabado nada — uno para el micrófono, y un segundo, con un texto diferente, para el reconocimiento de voz. Es razonable preguntarse por qué son dos, y si negar uno rompe el otro sin que te des cuenta.
Grabar y transcribir son dos trabajos distintos
iOS trata captar audio e interpretarlo como dos capacidades separadas, gestionadas por dos partes distintas del sistema. Grabar — convertir un sonido en un archivo guardado — pasa por las API de sesión de audio del sistema. Transcribir — convertir ese sonido en palabras — pasa por el framework de voz de Apple, una pieza distinta del sistema con su propio paso de autorización. Una app puede usar uno sin el otro: algo que solo graba nunca tiene que pedir reconocimiento de voz, y el dictado del teclado usa reconocimiento de voz sin guardar nunca un archivo.
Qué controla en realidad el permiso de Micrófono
Este es estrecho: si la app puede encender el micrófono. Concédelo, y el botón de grabar funciona. Deniégalo, y el botón de grabar falla al instante — no hay audio con el que trabajar, así que nada de lo que viene después importa todavía. Es el mismo permiso que pide cualquier app que toque el micrófono, sea grabadora o no, y no tiene relación con lo que pase con el audio después.
Qué controla en realidad el permiso de Reconocimiento de voz
Este es sobre una acción concreta: pedirle al motor de voz de Apple, ya sea el modelo local o el del servidor, que convierta audio en texto. Tiene su propia fila en Ajustes y su propio aviso de autorización, independiente del micrófono. El detalle que sorprende a la gente: este permiso hace falta incluso cuando el modelo local se encarga de todo y no se transmite nada. "En el dispositivo" describe dónde ocurre el procesamiento, no si el sistema deja de querer que hayas dado tu consentimiento explícito para que el reconocimiento de voz funcione. Negarlo no toca la grabación — solo bloquea la acción concreta de pedir una transcripción.
Por qué iOS los mantiene separados
Porque son decisiones genuinamente distintas para una persona. Alguien puede estar totalmente cómodo con que una app grabe su voz para escucharla después, sin ningún interés en que esa voz se convierta en texto buscable y citable. Otra persona puede querer un reconocimiento de voz al estilo dictado en una app que nunca guarde una grabación. Meter los dos en un solo aviso forzaría una única respuesta para dos preguntas distintas. Separarlos hace que cada uno aparezca como su propio interruptor en Ajustes → Privacidad y seguridad, y que cada uno se pueda conceder o revocar por su cuenta, en cualquier momento, sin tocar el otro.
Qué cambia en realidad según cuál concedas
- Micrófono concedido, Reconocimiento de voz denegado: la grabación funciona sin problema. Pedir una transcripción de cualquier grabación falla hasta que se conceda el Reconocimiento de voz.
- Micrófono denegado, Reconocimiento de voz concedido: todavía no hay nada que transcribir, porque no hay forma de captar audio de entrada. La app no puede grabar hasta que se conceda el Micrófono.
- Los dos concedidos: la grabación y la transcripción funcionan, y qué vía toma una transcripción — en el dispositivo o el servidor de Apple como respaldo — es una pregunta distinta de si el permiso en sí se concedió.
- Revocar cualquiera de los dos más tarde, en Ajustes, solo bloquea esa acción de ahí en adelante. Las grabaciones y transcripciones ya hechas se quedan exactamente donde estaban.
Cómo lo hace Voice Studio
Voice Studio pide Micrófono para grabar y, por separado, Reconocimiento de voz para transcribir, porque llama al framework de voz de Apple en vez de traer su propio modelo. La transcripción siempre intenta primero el paso en el dispositivo y solo reintenta con esa marca desactivada — lo que significa que el audio va al servidor de Apple — si ese primer intento vuelve vacío o da error, así que el permiso de Reconocimiento de voz también hace trabajo real en la vía local, no solo abre la puerta a una llamada de red. No hay cuenta ni servidor propio de Voice Studio en ningún caso; las grabaciones y las transcripciones se quedan en el almacenamiento propio de la app en el dispositivo, se haya concedido el permiso que se haya concedido.
Preguntas frecuentes
¿Negar el Reconocimiento de voz me impide grabar?
No. Grabar solo necesita el permiso de Micrófono. El Reconocimiento de voz es un permiso aparte que solo bloquea pedir una transcripción después.
¿Hace falta conceder el Reconocimiento de voz aunque solo quiera transcripción en el dispositivo?
Sí. El reconocimiento en el dispositivo también depende del mismo permiso de sistema que la vía del servidor — dónde ocurre el procesamiento es una pregunta distinta de si se permite que la transcripción funcione en absoluto.
¿Puedo revocar Micrófono o Reconocimiento de voz sin afectar al otro?
Sí. Ajustes → Privacidad y seguridad los muestra como filas separadas, y cada uno se puede desactivar por su cuenta en cualquier momento sin tocar el otro.
Si revoco el Reconocimiento de voz más tarde, ¿se borran las transcripciones que ya tenía?
No. Revocar un permiso solo bloquea esa acción de ahí en adelante. Las grabaciones y transcripciones ya hechas se quedan intactas en el almacenamiento de la app.
Pruébalo en Voice Studio
Voice Studio graba, transcribe dentro de tu iPhone y archiva cada nota por hora y lugar, para que la idea que se te ocurrió en el coche siga estando localizable el mes que viene.
Descarga gratuita · iPhone y iPad · iOS 16.4 o posterior