Quién entrena con tu audio

Algunos enlaces de esta página son de afiliado: tu precio no cambia. Cómo trabajamos.

Tu voz normalmente sale de tu máquina. Nueve de las catorce herramientas de abajo mandan audio a un servidor cada vez que las usas, y otras dos recurren a un servidor cuando tu hardware o tu idioma no están soportados.

Por la redacción de VoiceBoardActualizado el 28 de agosto de 2026

La versión corta

Esto es para quien haya llegado aquí con un producto concreto en la cabeza. Tres de los nueve entrenan con lo que les mandas salvo que vayas y lo desactives. Un cuarto publica dos páginas propias que se contradicen sobre en qué posición arranca su interruptor. Y uno de esos tres no da a una cuenta corriente ninguna forma de desactivarlo.

Donde el interruptor existe, casi nunca está en la primera pantalla, y en un caso no es un interruptor sino un correo que tienes que enviar.

La parte que nos sorprendió más que cualquier política concreta: en seis de las catorce, la frase que responde a la pregunta no aparece en ningún documento con fecha. Vive en una página de marketing, o en un artículo de ayuda sellado con un «actualizado hace 14 días». Y en cinco de ellas, dos textos publicados por la misma empresa dicen cosas distintas.

Cómo leer esta página

A cada producto se le hicieron las mismas tres preguntas.

  1. ¿El audio sale del dispositivo?
  2. ¿El fabricante entrena con él por defecto?
  3. ¿Cómo se desactiva eso, y qué documento lo dice?

En la tercera nos importa dónde vive la respuesta, porque resulta que eso decide cuánto vale. Una política de privacidad o unos términos de servicio llevan fecha de entrada en vigor, historial de versiones y peso jurídico. Una página titulada «Privacidad y seguridad», con un icono de escudo y sin fecha, no lleva nada de eso. Los artículos del centro de ayuda quedan en medio: suelen ser exactos, suelen estar al día y se reescriben sin avisar.

Así que cada fila de abajo dice de qué clase de texto salió la respuesta:

Leímos todo esto en las fechas indicadas. Las políticas cambian, así que esta página se vuelve a comprobar según un calendario fijo y después de cualquier anuncio de un fabricante, y la fecha de la última lectura está arriba del todo.

La tabla

Producto¿El audio sale de tu dispositivo?¿Entrena con él por defecto?Cómo pararloQué lo dice
VoiceInkNo, salvo que añadas tú un proveedor de nubeNo, el fabricante no tiene servidores con los que entrenarNada que desactivarcontrato, política de privacidad, 20 abr 2026
Whisper en local (Buzz, whisper.cpp, WhisperX)NoNoNada que desactivararquitectura
HandyNoNoNada que desactivararquitectura, licencia MIT, sin política de privacidad publicada
superwhisperSolo si eliges un modelo en la nubeNoElige un modelo de voz local y sáltate el posprocesadocontrato, términos, junio de 2026
MacWhisperLocal para transcribir, nube si conectas un proveedorNo se diceNo añadas claves de APIescaparate, su política es anterior a las funciones de nube
Wispr FlowSí, siempre, procesado en Estados UnidosSí en cuentas de prueba y estándar, no en empresa y HIPAASettings, Data and Privacy, «Improve the model for everyone»ayuda para el valor por defecto, contrato para el resto, 19 ago 2026
VoicySí, a los servidores de Voicy y de ahí a GroqNo, y la política nombra el mecanismoNada que desactivar, no existe modo localescaparate para la promesa, contrato para el mecanismo, sin fecha
TranskriptorSí, procesado dentro de la UENo, dicho sin condicionesNada que desactivar, el plazo de conservación lo fijas túescaparate, y la página legal conjunta no lleva fecha
OtterSí, y para las cuentas corrientes no existe forma de salirseNada disponible por debajo del plan de empresacontrato, política de privacidad, 16 jun 2026
RevSí, y además una persona en la transcripción humanaEscribir a support@rev.comel contrato dice que entrena, el centro de ayuda guarda la salida
DescriptEn disputa entre sus propias dos páginas, ver más abajoApp Settings, pestaña Profile, «Share data with Descript»contrato, política de privacidad, 14 abr 2025
NottaNo se dice en ninguna parteNada que desactivarno se dice, política de privacidad, 11 mar 2025
Google, GboardEn el dispositivo solo en Pixel 6 y posteriores, en lo demás no se diceAprendizaje federado sí, fragmentos de audio noAjustes del teclado, Privacidad, Donaciones de audioayuda, más la política de privacidad, 2 abr 2026
Dictado de AppleEn el dispositivo en muchos idiomas, compruébalo en Ajustes de tecladoAudio no, transcripciones sí, hasta dos añosAjustes, Privacidad y seguridad, Análisis y mejorascontrato, aviso sobre Siri y Dictado, 11 feb 2026
Microsoft, Win+HSí, siempre, vía AzureNo, los fragmentos de voz son opcionalesConfiguración, Privacidad y seguridad, Vozayuda, más la declaración de privacidad, julio de 2026
OpenAI, dictado de ChatGPTAudio no, texto y transcripciones síConfiguración, Controles de datossolo ayuda, la política de privacidad calla

Dieciséis filas para catorce productos, porque Whisper en local y Handy son la misma respuesta a la que se llega por dos caminos, y los dos pertenecen a una tabla sobre adónde va el audio.

Donde el escaparate y el contrato no coinciden

Esta es la parte que no publica nadie más, así que aquí van las parejas, con las dos citas.

Rev

La página de seguridad dice: «nunca entrenaremos LLM externos con tus datos». El centro de ayuda va más lejos y dice que Rev «no usa datos de clientes, incluidas transcripciones, subtítulos o cualquier otro contenido subido, para entrenar modelos de IA o grandes modelos de lenguaje (LLM)», y que «Rev solo entrena modelos propios de reconocimiento automático del habla (ASR)».

Los términos de servicio, actualizados el 15 de mayo de 2026, dicen: «your Customer Content will be analyzed by our ASR models and other Rev artificial intelligence models and may be used for continuous training of those models» (tu contenido de cliente será analizado por nuestros modelos de ASR y por otros modelos de inteligencia artificial de Rev, y puede usarse para el entrenamiento continuo de esos modelos; el peso del argumento está en ese «y por otros modelos»).

El centro de ayuda lo estrecha al reconocimiento del habla. El contrato deja la puerta abierta para el resto. Si alguna vez hay que reconciliar esos dos textos, gana el que lleva fecha de entrada en vigor.

Hay una segunda cosa en el centro de ayuda de Rev que conviene saber, porque es inusualmente franca: «Rev ahora usa los datos de forma perpetua, no solo mientras eres cliente activo». Cancelar la cuenta no retira lo que ya subiste.

La opción de salirse existe y es fácil de pasar por alto, porque no es un ajuste: «Los clientes pueden dejar de compartir sus datos con fines de entrenamiento en cualquier momento, escribiendo a support@rev.com». Ese artículo se actualizó por última vez el 12 de septiembre de 2025. Las páginas de ayuda de Rev bloquean nuestras peticiones, así que lo leímos en una copia archivada del 23 de octubre de 2025, y lo señalamos en vez de fingir lo contrario.

Un hueco más en el mismo producto. «Cada transcriptor firma un estricto acuerdo de confidencialidad» y que las identidades se verifican «a fondo» son afirmaciones de la página de seguridad. El contrato solo dice que Rev «firmará un acuerdo por escrito con cada subcontratista». Lo más probable es que la selección sea exactamente como la describen. Sencillamente no es una promesa a la que puedas agarrarte.

Otter

La página de seguridad dice: «No customer data will be used to train or improve our AI Service Provider(s)' artificial intelligence models/algorithms» (ningún dato de clientes se usará para entrenar ni mejorar los modelos o algoritmos de inteligencia artificial de nuestros proveedores de servicios de IA).

Léelo dos veces. Es una promesa sobre otras empresas. Dos párrafos más abajo, esa misma página dice lo que hace Otter en sí: «Otter usa un método propio para desidentificar los datos de usuario antes de entrenar nuestros modelos, de modo que no se pueda identificar a ningún usuario concreto».

La política de privacidad, en vigor desde el 16 de junio de 2026, es más rotunda: Otter trata tus datos para «mejorar y supervisar los Servicios, incluido el entrenamiento de nuestra tecnología propia de IA con grabaciones de audio desidentificadas y con transcripciones (que pueden contener información personal)». Esa misma política enumera «proveedores de servicios de etiquetado de datos que prestan servicios de anotación y usan los datos que compartimos para crear datos de entrenamiento y de evaluación». Los términos de servicio, en vigor desde el 19 de septiembre de 2025, lo dejan cerrado: Otter «puede recopilar, crear, tratar, transmitir, almacenar, usar y divulgar datos agregados y/o desidentificados derivados de los Datos o del uso de los Servicios para sus fines empresariales, incluidos el aprendizaje automático y el entrenamiento».

De ahí se siguen dos cosas que no vas a encontrar en las comparativas al uso.

Una cuenta corriente no tiene forma de salirse del entrenamiento. Miramos en la política de privacidad, en los términos, en la página de seguridad y en el centro de ayuda. La política ofrece salirse de la «venta» de información personal y de la publicidad segmentada, nada más. El único artículo de ayuda con «opt out» en el título se limita a sí mismo en su primera línea: «Enviar el siguiente formulario sirve únicamente para desactivar las funciones de IA, incluidos Otter Chat y Topics. Esto no afecta a ninguna de las demás funciones ni integraciones». Para las organizaciones sí hay una vía, y es una conversación más que un interruptor: la página de empresa de Otter dice «Mantén los datos de tu organización fuera del entrenamiento de modelos de IA. Contacta con tu gestor de cuenta para empezar».

La afirmación, muy repetida, de que puedes desactivarlo en los ajustes de la cuenta no la sostiene ningún documento de Otter que hayamos podido abrir. Aparece en respuestas de IA y en índices de confianza de terceros. No está en la política. Si has leído en algún sitio que ya lo desactivaste, comprueba qué desactivaste en realidad.

Y «desidentificadas» está cargando con mucho peso en esa frase. Quitarle a un archivo de audio los datos de la cuenta no le quita la voz, ni los nombres que se pronuncian dentro, ni el fondo de lo que se dijo.

Descript

La página de seguridad: «Esta opción está desactivada por defecto y solo puedes activarla tú».

El centro de ayuda, explicando cómo desactivarla: «Baja hasta la sección Share data with Descript y haz clic en Allowed para desactivar el uso compartido de datos». Señala además que «las unidades Enterprise no tienen la opción de alternar el uso compartido de datos, que está desactivado por defecto», una aclaración que no tiene sentido si ya estuviera desactivado para todo el mundo.

Los dos textos son de Descript. Uno dice que el interruptor arranca apagado. El otro lo describe marcando «Allowed» (permitido) y te dice que hagas clic en él. No podemos resolverlo sin crear una cuenta, así que te contamos lo que dice cada página y dónde está el interruptor: App Settings (Command o Control más coma), la pestaña Profile, la sección «Share data with Descript».

Justicia para quien la merece, porque el centro de ayuda de Descript contiene también las frases más claras de esta página: «Los modelos de IA actualmente en producción no usan ningún dato de usuarios de Descript», y «No tenemos planes de usar los datos de ningún usuario que se haya salido del uso compartido de datos en ninguna fase de investigación, desarrollo o producción». La política de privacidad, actualizada por última vez el 14 de abril de 2025, respalda ese derecho: «Puedes impedir que tus Proyectos se usen para mejorar el Servicio Descript desactivando el ajuste Share Data with Descript».

La clonación de voz es otro asunto y Descript lo dice sin rodeos: ahí «usamos el audio que compartiste como "Audio de entrenamiento" para mejorar nuestro servicio», y «empleados de Descript pueden escuchar muestras».

superwhisper y MacWhisper

Las dos venden privacidad con honestidad y las dos tienen una política de privacidad que se ha quedado atrás respecto del producto.

Los términos de superwhisper, actualizados en junio de 2026, dicen lo que uno querría: «tus datos no se usan para entrenar, ajustar ni mejorar modelos de IA», y el audio «no se conserva en nuestros servidores». Su política de privacidad, actualizada por última vez el 19 de junio de 2024, describe una app «que transcribe todos los datos de audio localmente en tu dispositivo» y concluye que «no hay necesidad de transmitir datos». La app actual ofrece modelos de voz y modelos de lenguaje en la nube de Deepgram, Anthropic, OpenAI y Groq. El compromiso en el que te apoyarías vive en los términos y en la documentación, no en el documento etiquetado como política de privacidad.

La política de privacidad de MacWhisper, actualizada por última vez el 14 de febrero de 2024, dice: «MacWhisper does all it's functionality on your device. No data (audio, text or other) leaves your device» (MacWhisper hace toda su funcionalidad en tu dispositivo. Ningún dato, ni audio ni texto ni de otro tipo, sale de tu dispositivo). La página de precios del mismo sitio enumera ocho proveedores de nube que puedes conectar con tus propias claves de API, además de pasos de flujo de trabajo que suben las transcripciones terminadas a Notion, Zapier o un webhook. La transcripción en sí es local de verdad, y esa es la razón para usarlo. La política sencillamente describe una versión de la app de hace dos años y medio, y no tiene nada que decir sobre la mitad que va por la nube.

Ninguna de las dos es un escándalo. Las dos son un motivo para mirar la fecha del documento antes de citárselo a tu equipo de seguridad.

Las herramientas, y qué hacen con el audio

Nada sale de la máquina

VoiceInk es la respuesta más limpia de la tabla y, cosa rara, su contrato es más estricto que su marketing. La política de privacidad, actualizada por última vez el 20 de abril de 2026, dice: «Por defecto, todo el procesamiento de transcripción ocurre enteramente en tu dispositivo usando modelos de IA locales. Ningún dato sale de tu ordenador salvo que elijas explícitamente activar servicios de nube opcionales». Y luego enumera ella misma las excepciones, cosa que casi nadie hace: la transcripción en la nube manda el archivo de audio al proveedor que hayas elegido, la mejora en la nube manda solo el texto, y el contexto del portapapeles o de la ventana solo va si activas esas opciones. El fabricante tampoco puede entrenar contigo de ninguna de las dos maneras: «VoiceInk no opera servidores en la nube para almacenar datos de usuario». La app está bajo GPL-3.0 en GitHub, así que la afirmación es inspeccionable y no meramente declarada.

Una cosa que el marketing no te cuenta y la política sí: tus propias transcripciones y tu audio se acumulan localmente para siempre salvo que configures la limpieza. «Transcripciones: se conservan indefinidamente por defecto hasta que las borres». Si la razón por la que te fuiste a local es un portátil que viaja, activa el borrado automático.

Whisper en local, ya sea a través de Buzz, whisper.cpp, WhisperX o una app de Mac, no promete nada por la misma razón: no hay ningún fabricante en medio. Esa es una garantía más fuerte que cualquier frase que pueda escribir un abogado, y tiene un límite honesto. El procesamiento local protege el trayecto, no el archivo. La grabación sigue estando en un disco que puede estar compartido, copiado o sin cifrar.

Handy es gratuita, con licencia MIT y, en sus propias palabras, «funciona completamente sin conexión». No tiene política de privacidad de ningún tipo. En un producto cuyo código puedes leer, eso nos molesta menos de lo que nos molestaría en otro sitio, y lo hacemos constar en vez de disimularlo.

superwhisper pertenece aquí siempre que elijas un modelo de voz local y te saltes el paso del modelo de lenguaje. Su documentación deletrea la configuración: usa Voice Mode, «que produce texto transcrito en bruto sin ningún modelo de lenguaje de por medio. Esta es la configuración totalmente local más sencilla». Elige en su lugar un modelo en la nube y estarás en la otra mitad de la tabla, con un compromiso de retención cero cubriéndolo. Fíjate en la salvedad que pone el propio fabricante, que es una buena frase y poco común: la retención cero «se aplica solo al uso de la API», así que dictar dentro de la app de ChatGPT pone tus palabras bajo los términos de consumo de OpenAI y no bajo los de superwhisper.

MacWhisper transcribe en local, cuesta €64 una sola vez con actualizaciones de por vida, y se convierte en un producto de nube en el momento en que pegas una clave de API. Las dos mitades están bien. Ten claro cuál estás usando.

Nube, sin entrenamiento

Voicy es un producto de nube sin modo sin conexión, y lo dice en su propia tabla comparativa. El audio va a los servidores de Voicy y de ahí a Groq, que ejecuta el modelo Whisper. Lo que hace inusual a su política es que explica el mecanismo en vez de limitarse a prometer un resultado: «We do not store any recording or transcription data. The Groq API does not retain any information we send it as we have enabled their Zero Data Retention settings and we do not use Groq's batch or fine-tuning endpoints» (no almacenamos ningún dato de grabación ni de transcripción. La API de Groq no conserva nada de lo que le enviamos, porque tenemos activados sus ajustes de retención cero de datos y no usamos los endpoints de lote ni de ajuste fino de Groq). Nombrar los endpoints concretos que no usan es más informativo que casi todas las tranquilizaciones de esta página.

Dos apuntes por exactitud. La frase «No usamos tus grabaciones para entrenar un modelo de IA ni para ningún otro fin» está en las preguntas frecuentes del sitio, no en la política de privacidad, y la política de privacidad no lleva fecha alguna. Y dos documentos de Voicy describen geografías distintas: la política de privacidad dice que los servidores están «alojados en la UE y en Estados Unidos», mientras que la política de seguridad, versión 1.3 con fecha del 31 de julio de 2025, dice que «todo el procesamiento ocurre en infraestructura ubicada en Estados Unidos». Si el procesamiento en la UE es un requisito para ti, pregunta antes de comprar en lugar de quedarte con la página que hayas encontrado primero.

Transkriptor enuncia la respuesta de «no entrenamos» sin ninguna condición: «We do not use your content to train, develop, or improve any AI or machine learning models» (no usamos tu contenido para entrenar, desarrollar ni mejorar ningún modelo de IA o de aprendizaje automático), y la misma frase continúa: «ni en nuestro beneficio, ni en el de ningún tercero. Tus transcripciones siguen siendo exclusivamente tuyas». Alrededor de eso pone las cosas que hacen comprobable una promesa: procesamiento «alojado exclusivamente dentro de la Unión Europea», ISO 27001 y SOC 2, un plazo de borrado que fijas tú «desde tan poco como 1 minuto hasta 1 año», y el derecho a exigir el borrado en diez días hábiles con un certificado que lo acredite.

Dónde vive esa frase conviene saberlo, y es la misma vara que aplicamos a todos los demás. Está en la página de seguridad y en la lista de funciones del plan Pro. La política de privacidad, los términos de servicio y el acuerdo de tratamiento de datos se publican como una sola página que no lleva fecha de entrada en vigor, y las palabras entrenar, aprendizaje automático y modelo no aparecen en ella. El respaldo jurídico más cercano es la limitación de finalidad del acuerdo de tratamiento: el encargado «no tratará los Datos Personales del Cliente para fines distintos de los especificados en este Acuerdo». Eso es una protección real, y es indirecta. En la página de precios, la línea de «no entrenamos» está listada bajo Pro, y no está listada bajo Lite ni bajo Team.

Notta no dice nada sobre entrenamiento en ninguna parte. Leímos su política de privacidad y sus términos, ambos en vigor desde el 11 de marzo de 2025, su página de seguridad y su centro de ayuda. La única línea sobre mejora habla de comportamiento y no de contenido: «Podemos usar la información recabada para hacer análisis estadísticos del comportamiento de los usuarios o para evaluar y mejorar el Servicio Notta». La única negación tajante del entrenamiento se aplica solo a los datos de Google Workspace y es texto estándar que exige Google.

El silencio no es una promesa. Tampoco es una acusación, y hay un detalle a favor de Notta que no hemos visto mencionado en ningún sitio: su licencia de contenido es la más estrecha de los cinco servicios de transcripción de aquí. Le concedes a Notta derechos «solo en la medida razonablemente necesaria» para prestar, mantener y actualizar el servicio, resolver problemas, cumplir la ley o lo que autorices por escrito. El entrenamiento no está en esa lista, así que el contrato no parece autorizarlo. Eso es un argumento, no una garantía.

Circulan por las reseñas afirmaciones de que Notta entrena con los datos del nivel gratuito, o de que borra el audio a los noventa días. Ninguna de las dos está en ningún documento de Notta que hayamos podido encontrar.

Nube, con entrenamiento activado por defecto

Wispr Flow lo procesa todo en remoto y no lo esconde: «La transcripción siempre ocurre en la nube. Es la mejor manera que tenemos de ofrecer una transcripción precisa y de baja latencia». Todo el procesamiento sucede en Estados Unidos.

Sobre el entrenamiento, el documento que te da el estado de la cuestión es el centro de ayuda: «Privacy Mode off (standard mode): audio and transcription data may be used to evaluate, train, and improve Wispr's models. This is the default for trial and standard accounts» (con Privacy Mode desactivado, es decir en modo estándar, los datos de audio y de transcripción pueden usarse para evaluar, entrenar y mejorar los modelos de Wispr; este es el estado por defecto en las cuentas de prueba y estándar). Los clientes de empresa y con acuerdo HIPAA funcionan con Privacy Mode activado por defecto. El ajuste se presenta durante la configuración inicial, ya marcado, como «Improve the model for everyone», que es además su nuevo nombre dentro de la app. Si instalaste Flow deprisa un martes y no volviste a mirar, ese es el estado en el que estás.

Desactivarlo lleva cosa de un minuto: Settings, Data and Privacy, y apagar «Improve the model for everyone». Si no quieres que se guarde nada en absoluto, son dos ajustes y no uno, y el centro de ayuda lo dice con precisión: «Zero Data Retention (ZDR) es la forma abreviada de Privacy Mode activado más Cloud Sync desactivado: sin entrenamiento y sin almacenamiento en servidor de los datos de dictado».

Hay aquí un compromiso mejor que el de casi todo el sector y que se aplica elijas lo que elijas: «Wispr mantiene siempre acuerdos de retención cero de datos con todos los proveedores externos de IA», y esos proveedores «no usan tus datos para entrenar sus modelos, y todos los datos compartidos se borran a los 30 días». Eso cubre a los subcontratistas sea cual sea la posición de tu propio interruptor.

Los documentos legales, ambos actualizados el 19 de agosto de 2026, describen la elección y no el valor por defecto: «If you choose to share your content with us for model training, we may also use your Customer Content to train our AI models» (si eliges compartir tu contenido con nosotros para el entrenamiento de modelos, también podemos usar tu contenido de cliente para entrenar nuestros modelos de IA). El estado por defecto aparece solo en el centro de ayuda. Preferiríamos que estuviera en la política, que es lo mismo que hemos dicho de otros seis productos de esta página.

Otter y Rev están tratados más arriba. Los dos entrenan por defecto. Rev te deja salirte por correo. Otter, en una cuenta corriente, no te deja salirte en absoluto.

Descript entrena solo con datos compartidos, y en qué estado empiezas depende de a cuál de sus páginas le creas.

Los integrados, que casi nadie eligió

Estos importan más que las apps de pago, porque probablemente estés usando uno ahora mismo sin haberlo elegido.

Google y Gboard

El dictado por voz que funciona enteramente en el dispositivo es una función de los Pixel, no de Android. La página de ayuda de Google es concreta: «El texto que dictas se queda en tu dispositivo y no se envía a los servidores de Google, salvo cuando usas las funciones "Corregir" o de edición detallada», y para tenerlo «debes tener un Pixel 6 o posterior». En el resto de los móviles Android, las páginas de Gboard de Google no dicen dónde ocurre el reconocimiento, lo que en sí mismo es una especie de respuesta. Para quien lea esto en español hay dos precisiones que la versión inglesa no necesita. El español sí está entre los seis idiomas de esas «funciones avanzadas de Escribir por voz», junto con el inglés, el francés, el alemán, el italiano y el japonés, así que el modo que no sale del teléfono no es un privilegio del inglés. Pero las dos funciones que Google exceptúa en esa frase, «Corregir» y la edición detallada, son solo en inglés y piden un Pixel 8 o posterior, de manera que en español esa excepción no te va a saltar por la sencilla razón de que la función no existe para ti.

Funcionan dos mecanismos de aprendizaje, y sus valores por defecto apuntan en direcciones opuestas. El aprendizaje federado está activado: «Importante: el aprendizaje federado está activado por defecto». Envía lo que el modelo aprendió, no lo que tú dijiste. La donación de audio está desactivada hasta que aceptes: los fragmentos se «envían a Google y los almacena Google para mejorar el reconocimiento de voz para todo el mundo», con un tope de 15 segundos, conservados no más de 18 meses, y «revisores humanos pueden escuchar o transcribir algunos fragmentos».

Guardar las grabaciones de voz en tu cuenta de Google es una tercera cosa, distinta, y arranca desactivada: «Este ajuste de actividad de voz y audio está desactivado a menos que decidas activarlo». Fíjate en la trampa de esa misma página de ayuda: «Si desactivas este ajuste de actividad de voz y audio, el audio guardado anteriormente no se elimina». Desactivarlo no limpia lo que quedó detrás.

Y aquí está el desajuste. La política de privacidad de Google, en vigor desde el 2 de abril de 2026, dice: «Según tu configuración, podemos guardar grabaciones de audio de interacciones de voz con servicios como la Búsqueda de Google, el Asistente, Maps y Gboard para desarrollar y mejorar las tecnologías de audio de Google». Gboard está en esa lista. La página de ayuda sobre el ajuste en sí nombra solo la Búsqueda, el Asistente y Maps.

Para cambiarlo: en el teclado, Ajustes, Privacidad, luego Voz, luego Donaciones de audio. En tu cuenta, Datos y privacidad, Actividad en la Web y en Aplicaciones, y luego «Incluir actividad de voz y audio».

Apple

El manual de usuario de Apple dice que las peticiones de dictado «se procesan en tu dispositivo en muchos idiomas», y que «no se requiere conexión a internet». El aviso legal, con fecha del 11 de febrero de 2026, es más cuidadoso y más útil: «tu dispositivo indicará en Ajustes de teclado si tu audio y tus transcripciones se procesan en el dispositivo y no se envían a los servidores de Apple. En caso contrario, lo que dictas se envía al servidor y se procesa allí». Si dictas en español estás en el lado bueno de esa frase: Apple enumera cinco variantes del español, España, México, Chile, Colombia y Estados Unidos, entre los idiomas de dictado en el dispositivo, así que esa lista no es un club anglosajón. Dos huecos concretos, eso sí, que la versión inglesa de esta página no tiene por qué mencionar. La puntuación automática cubre el español de España, México, Colombia y Estados Unidos, pero no el de Chile. Y la edición por voz de lo ya dictado existe únicamente en inglés de Estados Unidos: puedes dictar en español, pero no corregir en español hablando.

La parte que casi todo el mundo entiende mal es qué cubre eso de «no se almacena». El audio no se conserva salvo que lo autorices. Las transcripciones sí, por defecto, y se usan para entrenar. Palabras del propio Apple: «Apple puede conservar y usar estos datos hasta dos años para desarrollar y mejorar Siri, Dictado, Búsqueda... las transcripciones pueden usarse para ajustar Siri, Búsqueda, Control por voz, Traducir y los modelos de reconocimiento automático del habla». Un subconjunto pasa por revisión humana y «puede conservarse más allá de dos años».

Si autorizas «Mejorar Siri y Dictado», el audio se suma al montón, revisado por plantilla y no por contratistas externos: «la revisión de audio la realizan únicamente empleados de Apple».

Para cambiarlo: Ajustes, Privacidad y seguridad, Análisis y mejoras para la autorización. Ajustes, Siri, Historial de Siri y Dictado para borrar lo que hay guardado. Ajustes, General, Teclado para desactivar el dictado por completo.

Conviene saberlo al sopesar las promesas de Apple: las acusaciones de que Siri grababa a personas sin consentimiento produjeron una demanda colectiva, Lopez contra Apple, presentada el 7 de agosto de 2019 en el Distrito Norte de California. El tribunal aprobó preliminarmente un acuerdo el 10 de febrero de 2025, el caso se dio por terminado el 14 de octubre de 2025, y los abogados de la clase cifraron la cantidad final en $95 millones.

Microsoft y Win+H

Windows tiene dos sistemas de voz y no son intercambiables. La escritura por voz, la que sale con Win+H, es siempre remota: «La escritura por voz usa el reconocimiento de voz en línea, que funciona con los servicios de voz de Azure», y necesita conexión a internet. El acceso por voz, construido como función de accesibilidad, funciona «sin conexión a internet» tras la primera descarga del idioma. Un apunte para el lector en español: la lista de idiomas de la escritura por voz ofrece dos variantes, español de España y español de México, y ninguna otra de América Latina, así que si hablas con otro acento vas a estar dictando contra el modelo más cercano y no contra el tuyo. La exigencia de internet es idéntica en español que en inglés.

La redacción de Microsoft es donde hace falta cuidado: «Voice data is sent to Microsoft only to provide the service and create text transcriptions. Microsoft does not store, sample, or listen to voice recordings without your permission» (los datos de voz se envían a Microsoft únicamente para prestar el servicio y crear transcripciones de texto. Microsoft no almacena, ni muestrea, ni escucha grabaciones de voz sin tu permiso). La segunda frase habla de almacenar y de escuchar. La primera dice que el audio se envía igualmente. Si pulsas Win+H, tu voz llega a Azure todas las veces, con permiso o sin él.

El entrenamiento es opcional y Microsoft lo dice dos veces: «Puedes usar la escritura por voz sin aportar fragmentos de voz. Aportar fragmentos de voz es opcional». Si los aportas, hay humanos de por medio: «Empleados de Microsoft y proveedores que trabajan por cuenta de Microsoft podrán revisar tus fragmentos de voz». La empresa afirma además que «dejó de registrar cualquier dato de voz para mejoras de producto a partir del 30 de octubre de 2020».

Para cambiarlo: Inicio, Configuración, Privacidad y seguridad, Voz, y desactivar el reconocimiento de voz en línea. Prepárate para la consecuencia que Microsoft indica directamente: solo quedan las funciones basadas en el dispositivo, lo que significa que Win+H deja de funcionar y el acceso por voz pasa a ser tu dictado. Los fragmentos de voz tienen su propio control dentro de la barra de Win+H, en Configuración.

La declaración de privacidad, actualizada por última vez en julio de 2026, describe los datos de voz usándose «para desarrollar y mejorar la precisión del reconocimiento de voz» sin el matiz de «con tu permiso» que sí aparece en las páginas de ayuda.

OpenAI y el dictado de ChatGPT

No hay opción local. Pulsa el micrófono del cuadro de mensaje y «el audio grabado se envía a nuestros modelos para transcribirlo».

Tres funciones vecinas guardan el audio durante tres periodos distintos, que es la razón de que la gente salga de ahí confundida. El audio del dictado se conserva «mientras el chat forme parte de tu historial de chats», y se borra dentro de los 30 días siguientes a que borres el chat. Los fragmentos del modo de voz se guardan 30 días. La vieja promesa de que los fragmentos se borran justo después de transcribirlos sigue ahí, ahora acotada a un solo modo: «Si usas nuestro modo de voz estándar heredado, los fragmentos de audio de ChatGPT se transcriben antes de que generemos una respuesta. Borramos los fragmentos de audio en cuanto la transcripción termina».

Sobre el entrenamiento, el audio está desactivado y el texto activado. «Por defecto, no entrenaremos nuestros modelos con fragmentos de audio o vídeo» de los chats de voz. Mientras tanto, en la página sobre la mejora del modelo: «ChatGPT, por ejemplo, mejora entrenándose con las conversaciones que la gente tiene con él, salvo que te salgas». Desactivar solo el uso compartido del audio deja las transcripciones en juego, y OpenAI lo dice: «Para salirte por completo del entrenamiento de nuestros modelos, desactiva Improve the model for everyone».

Para cambiarlo: Configuración, Controles de datos («Data Controls» en la interfaz en inglés), y luego «Mejorar el modelo para todos» y el interruptor «Incluir tus grabaciones de audio» que hay dentro.

La política de privacidad, actualizada el 18 de mayo de 2026, menciona el audio una sola vez, en una lista de tipos de contenido. Cada plazo de conservación y cada regla de entrenamiento de arriba salen de artículos de ayuda sellados con un «actualizado hace 6 días» en lugar de con una fecha, y que se reescriben sin historial de versiones. Nuestras peticiones a los dominios de OpenAI están bloqueadas, así que leímos todo esto en copias archivadas capturadas el 4 de junio, el 29 de julio, el 19 de agosto y el 25 de agosto de 2026, y preferimos decirlo antes que dar a entender una lectura en vivo.

Lo que ahora mismo examina un tribunal

Hay un caso que conviene conocer porque pone a prueba exactamente la pregunta de esta página.

Brewer contra Otter.ai, número de caso 5:25-cv-06911-EKL, se presentó en el Distrito Norte de California el 15 de agosto de 2025 por Justin Brewer, y cuatro demandas relacionadas se acumularon ante la jueza Eumi K. Lee el 22 de octubre de 2025. La demanda alega que el asistente de reuniones de Otter grabó a participantes sin el consentimiento de todos los presentes en la llamada, y que Otter «ha usado los datos capturados para entrenar sus modelos de reconocimiento del habla». Invoca la ley federal de escuchas, la Computer Fraud and Abuse Act y la California Invasion of Privacy Act, y pide la certificación como demanda colectiva e indemnizaciones por encima de $5 millones.

Esto son alegaciones. No se ha probado nada, Otter niega las acusaciones, y una demanda presentada es un conjunto de afirmaciones y no una conclusión judicial. La incluimos porque es el único sitio donde las declaraciones sobre entrenar con grabaciones las está poniendo a prueba alguien que no es un blog, y porque el desenlace importará para todos los productos de la tabla.

Elegir según tu restricción

Estás bajo un acuerdo de confidencialidad, o manejas asuntos de clientes, material médico o jurídico. Solo local. VoiceInk, superwhisper con un modelo local, Handy, o Whisper a través de Buzz. Nada de la mitad de nube de esta tabla resuelve el problema, porque el problema no es si el fabricante es de fiar, sino si el archivo llegó a salir del edificio.

Tu empresa o tu cliente exige procesamiento en la UE. Transkriptor declara procesamiento solo en la UE. Cualquier otra cosa, compruébala en sus propios documentos y no por un sello, y ten en cuenta que al menos un fabricante de aquí tiene dos páginas que no coinciden sobre geografía.

Estás haciendo investigación con un comité de ética. La política del fabricante es un documento que vas a tener que nombrar en tu protocolo, así que elige un producto cuya respuesta esté en un documento con fecha y no en una página de marketing. Solo ese criterio acorta mucho la lista. Un investigador planteó lo mismo en Hacker News en julio de 2026, explicando por qué se construyó su propia herramienta: no había «ninguna opción real para transcribir entrevistas con detección de hablantes que se pueda usar en la evaluación de un estudio universitario sin subir los datos a la nube de otro con políticas de privacidad cuestionables».

Dictas texto de trabajo corriente y sencillamente no quieres ser un conjunto de entrenamiento. Todos los productos de nube de aquí se pueden configurar para que paren. Reserva cinco minutos y recórrelos: Wispr Flow en Data and Privacy, ChatGPT en Controles de datos, Windows en Privacidad y seguridad, Apple en Análisis y mejoras, Gboard en la Privacidad del teclado. Ese es el trabajo entero.

Tienes un montón de grabaciones que convertir en texto y ningún problema de confidencialidad. Coge el nivel gratuito de un servicio de transcripción y pásale tu peor audio antes de pagarle a nadie. Si además quieres la cuestión del entrenamiento resuelta por escrito, Transkriptor es el que lo declara sin condiciones en esta tabla y el que te deja fijar tu propio plazo de borrado, de un minuto a un año. Lee el párrafo de arriba sobre dónde vive esa declaración, decide si te basta para tu situación y, si no te basta, vete a local. Nuestra guía para transcribir entrevistas y clases pone precio a cada camino, incluidos los gratuitos.

Cómo lo hemos comprobado

El 27 de agosto de 2026 leímos, para cada producto, la política de privacidad, los términos de servicio cuando existen por separado, la página de seguridad o de confianza y los artículos pertinentes del centro de ayuda. Los citamos en vez de parafrasearlos, y anotamos la fecha de entrada en vigor impresa en cada documento. Donde el sitio de un fabricante nos bloqueó, usamos copias archivadas y dijimos qué instantánea y de qué fecha. Donde una afirmación existe solo en la reseña de otro, la dejamos fuera.

Lo que no hicimos, y no vamos a insinuar que sí: no interceptamos tráfico de red, no descompilamos ninguna app y no creamos cuentas de pago para observar desde dentro los ajustes por defecto. Esta página te dice lo que catorce empresas han puesto por escrito y dónde. Si una empresa hace algo distinto de lo que escribió, este método no lo va a pillar, y ninguna cantidad de lectura de políticas lo pillaría.

Cuatro cosas que no pudimos resolver. Las páginas de ayuda de empresa de Otter nos devuelven un error, así que la afirmación muy repetida de que los espacios de trabajo de empresa quedan excluidos del entrenamiento por defecto queda aquí sin verificar; la única declaración de Otter que pudimos leer sobre ello es la página de empresa que te dice que contactes con un gestor de cuenta. El estado por defecto de Descript se contradice entre sus propias dos páginas. Microsoft nunca publica el valor por defecto del interruptor de reconocimiento de voz en línea. Y Reddit no es accesible desde donde trabajamos, así que los comentarios de profesionales de esta página vienen de Hacker News, que tira a lo técnico.

Cuándo cambia esta página

Los precios se quedan rancios despacio. Las políticas no. Dos de los documentos citados aquí se actualizaron en la última quincena, uno se reescribió dos veces este año, y uno es una demanda colectiva que va a producir resoluciones.

Así que esta página tiene un calendario fijo de revisión y no un «ya lo miraremos». Cada documento se vuelve a leer en ese ciclo, y fuera de ciclo siempre que un fabricante anuncie un cambio o se mueva la fecha de una política. Cuando cambia una fila, cambia la fila y con ella la fecha de arriba de la página. Si encuentras aquí algo que ya no coincide con lo que publica hoy un fabricante, dínoslo y lo volveremos a leer.

Preguntas frecuentes

¿Otter entrena con mis grabaciones?

Sí. Su política de privacidad, en vigor desde el 16 de junio de 2026, enumera «el entrenamiento de nuestra tecnología propia de IA con grabaciones de audio desidentificadas y con transcripciones» entre los fines para los que trata tus datos, y sus términos de servicio permiten el uso de datos desidentificados «incluidos el aprendizaje automático y el entrenamiento». No encontramos ninguna forma de que una cuenta personal, Pro o Business se salga, en ningún documento de Otter que pudiéramos leer. A las organizaciones se les dice que contacten con un gestor de cuenta. La línea tranquilizadora sobre entrenamiento que hay en la página de seguridad de Otter es una promesa sobre sus proveedores de IA, no sobre Otter.

¿Qué apps de dictado no mandan mi voz a ninguna parte?

VoiceInk por defecto, Handy, Whisper en local a través de Buzz o whisper.cpp, superwhisper cuando eliges un modelo de voz local y te saltas el posprocesado, y MacWhisper mientras no hayas conectado una clave de API. El dictado de Apple funciona en el dispositivo en muchos idiomas y en hardware reciente, y tus Ajustes de teclado te dirán si el tuyo cumple. Todo lo demás de la tabla manda audio a un servidor.

¿Desactivar el entrenamiento es lo mismo que desactivar el almacenamiento?

No, y esto pilla a mucha gente. En la mayoría de los productos de nube son dos ajustes separados. Wispr Flow lo dice explícitamente: nada de entrenamiento más nada de almacenamiento en servidor es «Privacy Mode activado más Cloud Sync desactivado», que son dos interruptores. En ChatGPT, desactivar el uso compartido del audio deja tus transcripciones disponibles para el entrenamiento salvo que desactives también «Mejorar el modelo para todos». Comprueba los dos.

¿Por qué os fiais más de una política de privacidad que de una página que dice «nunca entrenamos con tus datos»?

Porque una tiene fecha de entrada en vigor y consecuencias jurídicas, y la otra tiene un icono de escudo. En los catorce productos de aquí, cinco publican dos textos propios que dicen cosas distintas, y en todos esos casos la versión más tranquilizadora era la que no llevaba fecha. Cuando se contradicen, manda el documento fechado, así que ese es el que citamos.

Cada política, contrato, página de ayuda y documento judicial citado arriba se leyó en su fuente, y cada uno se vuelve a leer según un calendario fijo porque este es el material que más deprisa se mueve de todo el sitio. La tabla de arriba se revisa según ese calendario, y la fecha de arriba de la página es la de la última pasada. Donde un fabricante bloqueó nuestras peticiones lo dijimos y nombramos la copia archivada que usamos en su lugar.

Comentarios

Todavía no hay comentarios. Haz una pregunta o cuéntanos qué te ha funcionado.

Dejar un comentario

Los comentarios se revisan antes de publicarse, normalmente en menos de 24 horas.