Quem treina com o seu áudio
A sua voz normalmente sai da sua máquina. Nove das catorze ferramentas abaixo mandam áudio para um servidor toda vez que você as usa, e outras duas recorrem a um servidor quando o seu hardware ou o seu idioma não têm suporte.
Isto é para quem chegou aqui com um produto em mente. Três dos nove treinam com o que você manda, a menos que você vá lá e desligue. Um quarto publica duas páginas próprias que discordam sobre em que posição a chave dele começa. E um dos três não dá a uma conta comum nenhuma forma de desligar.
Onde a chave existe, ela quase nunca está na primeira tela, e num dos casos não é uma chave, é um e-mail que você tem de mandar.
A parte que nos surpreendeu mais do que qualquer política isolada: em seis das catorze, a frase que responde à pergunta não aparece em nenhum documento que tenha data. Ela está numa página de marketing, ou num artigo de ajuda carimbado com "atualizado há 14 dias". E em cinco delas, dois textos publicados pela mesma empresa dizem coisas diferentes.
Como ler esta página
Todo produto recebeu as mesmas três perguntas.
- O áudio sai do aparelho?
- O fornecedor treina com ele por padrão?
- Como se desliga isso, e qual documento diz?
Na terceira, o que nos importa é onde a resposta vive, porque é isso que decide quanto ela vale. Uma política de privacidade ou um termo de serviço tem data de vigência, histórico de versões e peso jurídico. Uma página intitulada "Privacidade e Segurança", com ícone de escudo e sem data, não tem nada disso. Artigos de central de ajuda ficam no meio: em geral corretos, em geral atuais, e reescritos sem aviso.
Então cada linha abaixo diz de que tipo de texto veio a resposta:
- contrato: política de privacidade, termos de serviço ou acordo de tratamento de dados, com data de vigência
- ajuda: a central de ajuda ou a documentação do próprio fornecedor, normalmente datada só de forma relativa
- vitrine: uma página de marketing sem data nenhuma
- arquitetura: nada é prometido porque nada é possível, o áudio nunca chega ao fornecedor
- não declarado: nenhuma afirmação em lugar algum, o que não é a mesma coisa que uma promessa
Lemos tudo isso nas datas indicadas. Políticas mudam, então esta página é reconferida em calendário fixo e depois de qualquer anúncio de fornecedor, e a data da última leitura fica no topo.
A tabela
| Produto | O áudio sai do seu aparelho? | Treina com ele por padrão? | Como parar | O que diz isso |
|---|---|---|---|---|
| VoiceInk | Não, a menos que você mesmo adicione um provedor de nuvem | Não, o fornecedor não tem servidores para treinar | Nada a desligar | contrato, política de privacidade, 20 abr 2026 |
| Whisper local (Buzz, whisper.cpp, WhisperX) | Não | Não | Nada a desligar | arquitetura |
| Handy | Não | Não | Nada a desligar | arquitetura, licença MIT, nenhuma política de privacidade publicada |
| superwhisper | Só se você escolher um modelo em nuvem | Não | Escolha um modelo de voz local e pule o pós-processamento | contrato, Termos, junho de 2026 |
| MacWhisper | Local para transcrever, nuvem se você conectar um provedor | Não declarado | Não adicione chaves de API | vitrine, e a política é anterior aos recursos de nuvem |
| Wispr Flow | Sim, sempre, processado nos EUA | Sim em contas de teste e comuns, não em empresariais e HIPAA | Settings, Data and Privacy, "Improve the model for everyone" | ajuda para o padrão, contrato para o resto, 19 ago 2026 |
| Voicy | Sim, para os servidores da Voicy e de lá para a Groq | Não, e a política nomeia o mecanismo | Nada a desligar, não existe modo local | vitrine para a promessa, contrato para o mecanismo, sem data |
| Transkriptor | Sim, processado dentro da União Europeia | Não, afirmado sem condições | Nada a desligar, o prazo de retenção é você quem define | vitrine, e a página jurídica única não tem data |
| Otter | Sim | Sim, e não há como recusar em contas comuns | Nada disponível abaixo do plano empresarial | contrato, política de privacidade, 16 jun 2026 |
| Rev | Sim, mais um ser humano na transcrição feita por pessoas | Sim | Escreva para support@rev.com | o contrato diz que treina, a central de ajuda guarda a recusa |
| Descript | Sim | Contestado pelas duas páginas dele mesmo, veja abaixo | App Settings, aba Profile, "Share data with Descript" | contrato, política de privacidade, 14 abr 2025 |
| Notta | Sim | Não declarado em lugar nenhum | Nada a desligar | não declarado, política de privacidade, 11 mar 2025 |
| Google, Gboard | Só no aparelho no Pixel 6 e posteriores, e ainda assim em seis idiomas; fora disso, não declarado | Aprendizado federado sim, trechos de áudio não | Ajustes do teclado, Privacidade, Doações de áudio | ajuda, mais política de privacidade, 2 abr 2026 |
| Ditado da Apple | No aparelho em muitos idiomas, inclusive português do Brasil; confira nos Ajustes de Teclado | Áudio não, transcrições sim, por até dois anos | Ajustes, Privacidade e Segurança, Análises e Melhorias | contrato, aviso sobre Siri e Ditado, 11 fev 2026 |
| Microsoft, Win+H | Sim, sempre, via Azure | Não, os trechos de voz são opcionais | Configurações, Privacidade e segurança, Fala | ajuda, mais declaração de privacidade, julho de 2026 |
| OpenAI, ditado do ChatGPT | Sim | Áudio não, texto e transcrições sim | Settings, Data Controls | só ajuda, a política de privacidade se cala |
São dezesseis linhas para catorze produtos, porque o Whisper local e o Handy são a mesma resposta alcançada por dois caminhos, e os dois pertencem a uma tabela sobre para onde vai o áudio.
Onde a vitrine e o contrato discordam
Esta é a parte que mais ninguém publica, então aqui estão os pares, com as duas citações.
Rev
A página de segurança diz: "we'll never train external LLMs on your data" (nunca vamos treinar LLMs externos com os seus dados). A central de ajuda vai além e diz que a Rev "does not use customer data, including transcripts, captions, or any other uploaded content, to train AI models or large language models (LLMs)" (não usa dados de clientes, incluindo transcrições, legendas ou qualquer outro conteúdo enviado, para treinar modelos de IA ou grandes modelos de linguagem), e que a "Rev only trains proprietary automatic speech recognition (ASR) models" (a Rev só treina modelos proprietários de reconhecimento automático de fala).
Os termos de serviço, atualizados em 15 de maio de 2026, dizem: "your Customer Content will be analyzed by our ASR models and other Rev artificial intelligence models and may be used for continuous training of those models" (o seu conteúdo será analisado pelos nossos modelos de ASR e por outros modelos de inteligência artificial da Rev, e pode ser usado para o treinamento contínuo desses modelos).
A central de ajuda estreita tudo para reconhecimento de fala. O contrato mantém a porta aberta para o resto. Se um dia esses dois tiverem de ser conciliados, vence o que tem data de vigência.
Há uma segunda coisa na central de ajuda da Rev que vale saber, porque é de uma franqueza incomum: "Rev now uses data perpetually, not just while being an active customer" (a Rev agora usa os dados perpetuamente, não apenas enquanto você é cliente ativo). Cancelar a conta não retira o que você já enviou.
A recusa existe e é fácil de não ver, porque não é um ajuste: "Customers are able to opt out of sharing their data for training purposes at any time, by emailing support@rev.com" (os clientes podem, a qualquer momento, recusar o compartilhamento dos seus dados para fins de treinamento, escrevendo para support@rev.com). Esse artigo foi atualizado pela última vez em 12 de setembro de 2025. As páginas de ajuda da Rev bloqueiam as nossas requisições, então lemos numa cópia arquivada de 23 de outubro de 2025, e sinalizamos isso em vez de fingir o contrário.
Mais uma lacuna no mesmo produto. "Every transcriptionist signs a strict NDA" (todo transcritor assina um acordo de sigilo rigoroso) e identidades "thoroughly verified" (minuciosamente verificadas) são afirmações da página de segurança. O contrato diz apenas que a Rev "will enter into a written agreement with each subcontractor" (celebrará um acordo por escrito com cada subcontratado). A checagem provavelmente é exatamente como descrita. Só não é uma promessa que você poderia cobrar de alguém.
Otter
A página de segurança diz: "No customer data will be used to train or improve our AI Service Provider(s)' artificial intelligence models/algorithms." (Nenhum dado de cliente será usado para treinar ou melhorar os modelos ou algoritmos de inteligência artificial dos nossos fornecedores de serviços de IA.)
Leia isso duas vezes. É uma promessa sobre outras empresas. Dois parágrafos abaixo, a mesma página diz o que a Otter faz por conta própria: "Otter uses a proprietary method to de-identify user data before training our models so that an individual user cannot be identified." (A Otter usa um método proprietário para desidentificar dados de usuário antes de treinar nossos modelos, de modo que um usuário individual não possa ser identificado.)
A política de privacidade, em vigor desde 16 de junho de 2026, é mais direta: a Otter processa os seus dados para "Improve and monitor the Services, including training our proprietary AI technology on de-identified audio recordings and on transcriptions (which may contain Personal Information)" (melhorar e monitorar os serviços, incluindo treinar nossa tecnologia proprietária de IA com gravações de áudio desidentificadas e com transcrições, que podem conter informações pessoais). A mesma política lista "Data labeling service providers who provide annotation services and use the data we share to create training and evaluation data" (fornecedores de rotulagem de dados que prestam serviços de anotação e usam os dados que compartilhamos para criar dados de treino e avaliação). Os termos de serviço, em vigor desde 19 de setembro de 2025, fecham a questão: a Otter "may collect, create, process, transmit, store, use, and disclose aggregated and/or deidentified data derived from Data or use of the Services for its business purposes, including for machine learning and training" (pode coletar, criar, processar, transmitir, armazenar, usar e divulgar dados agregados ou desidentificados derivados dos dados ou do uso dos serviços para seus fins comerciais, inclusive para aprendizado de máquina e treinamento).
Disso decorrem duas coisas que você não vai achar nas comparações por aí.
Não existe recusa de treinamento para uma conta comum. Procuramos na política de privacidade, nos termos, na página de segurança e na central de ajuda. A política oferece recusa da "venda" de informações pessoais e da publicidade direcionada, e nada além. O único artigo de ajuda com "opt out" no título se limita já na primeira linha: "Submitting a form below is only for opting out of AI features, including Otter Chat & Topics. This does not affect any of the other features or integrations." (Enviar o formulário abaixo serve apenas para recusar recursos de IA, incluindo Otter Chat e Topics. Isso não afeta nenhum dos outros recursos ou integrações.) Para organizações existe caminho, e ele é uma conversa, não um botão: a página empresarial da Otter diz "Keep your organization's data out of AI model training. Contact your account manager to get started." (Mantenha os dados da sua organização fora do treinamento de modelos de IA. Fale com o seu gerente de conta para começar.)
A afirmação muito repetida de que dá para recusar nas configurações da conta não é sustentada por nenhum documento da Otter que conseguimos abrir. Ela aparece em respostas de IA e em índices de confiança de terceiros. Não está na política. Se você leu em algum lugar que já desligou isso, confira o que você desligou de fato.
E "desidentificado" carrega muito peso naquela frase. Tirar os dados da conta de um arquivo de áudio não tira a voz, nem os nomes ditos dentro dele, nem o teor do que foi falado.
Descript
A página de segurança: "This option is disabled by default and can only be enabled by you." (Esta opção vem desativada por padrão e só pode ser ativada por você.)
A central de ajuda, explicando como desligar: "Scroll down to the Share data with Descript section and click Allowed to toggle off data sharing." (Role até a seção Share data with Descript e clique em Allowed para desativar o compartilhamento de dados.) Ela também observa que "Enterprise drives do not have the option to toggle data sharing, which is disabled by default" (as unidades empresariais não têm a opção de alternar o compartilhamento de dados, que vem desativado por padrão), esclarecimento que não faria sentido nenhum se aquilo já estivesse desligado para todo mundo.
Os dois textos são da Descript. Um diz que a chave começa desligada. O outro descreve a chave marcada como "Allowed" e manda você clicar nela. Não conseguimos resolver isso sem criar uma conta, então dizemos o que cada página afirma e onde fica o botão: App Settings (Command ou Control mais vírgula), aba Profile, seção "Share data with Descript".
Crédito onde é devido, porque a central de ajuda da Descript também contém as frases mais claras desta página: "Current AI models in production use no Descript user data" (os modelos de IA atualmente em produção não usam nenhum dado de usuário da Descript) e "We have no plans to use any user's data who has opted out of data sharing at any stage of research, development, or production" (não temos planos de usar os dados de nenhum usuário que tenha recusado o compartilhamento, em qualquer etapa de pesquisa, desenvolvimento ou produção). A política de privacidade, atualizada pela última vez em 14 de abril de 2025, respalda o direito: "You can opt out of having your Projects used to improve the Descript Service by disabling the Share Data with Descript setting." (Você pode recusar que seus projetos sejam usados para melhorar o serviço desativando o ajuste Share Data with Descript.)
Clonagem de voz é outro assunto, e a Descript diz isso com todas as letras: ali, "we use the audio that you shared as 'Training Audio' to improve our service" (usamos o áudio que você compartilhou como "áudio de treino" para melhorar nosso serviço), e "Descript employees may listen to samples" (funcionários da Descript podem ouvir amostras).
superwhisper e MacWhisper
Os dois vendem privacidade com honestidade e os dois têm uma política de privacidade que ficou para trás do produto.
Os termos do superwhisper, atualizados em junho de 2026, dizem o que você gostaria: "your data is not used to train, fine-tune, or improve AI models" (seus dados não são usados para treinar, ajustar ou melhorar modelos de IA), e o áudio "is not retained on our servers" (não é retido em nossos servidores). Já a política de privacidade dele, atualizada pela última vez em 19 de junho de 2024, descreve um app "that transcribes all audio data locally on your device" (que transcreve todos os dados de áudio localmente no seu aparelho) e conclui que "there is no need for data transmission" (não há necessidade de transmissão de dados). O app atual oferece modelos de voz e modelos de linguagem em nuvem, da Deepgram, da Anthropic, da OpenAI e da Groq. O compromisso em que você se apoiaria vive nos termos e na documentação, não no documento chamado política de privacidade.
A política de privacidade do MacWhisper, atualizada pela última vez em 14 de fevereiro de 2024, diz: "MacWhisper does all it's functionality on your device. No data (audio, text or other) leaves your device." (O MacWhisper faz tudo no seu aparelho. Nenhum dado, de áudio, texto ou outro tipo, sai do seu aparelho.) A página de preços do mesmo site lista oito provedores de nuvem que você pode conectar com as suas próprias chaves de API, além de etapas de fluxo que enviam transcrições prontas para o Notion, o Zapier ou um webhook. A transcrição em si é mesmo local, e essa é a razão de usá-lo. A política simplesmente descreve uma versão do app de dois anos e meio atrás, e não tem nada a dizer sobre a metade em nuvem.
Nenhum dos dois é escândalo. Os dois são motivo para conferir a data do documento antes de citá-lo para a sua equipe de segurança.
As ferramentas que guardam o áudio
Nada sai da máquina
VoiceInk é a resposta mais limpa da tabela, e, incomum, o contrato dele é mais rigoroso do que o marketing. A política de privacidade, atualizada pela última vez em 20 de abril de 2026, diz: "By default, all transcription processing happens entirely on your device using local AI models. No data leaves your computer unless you explicitly choose to enable optional cloud services." (Por padrão, todo o processamento da transcrição acontece inteiramente no seu aparelho, com modelos de IA locais. Nenhum dado sai do seu computador a menos que você opte explicitamente por ativar serviços opcionais em nuvem.) Em seguida ela mesma lista as exceções, coisa que quase ninguém faz: a transcrição em nuvem manda o arquivo de áudio para o provedor que você escolheu, o aprimoramento em nuvem manda só o texto, e o conteúdo da área de transferência ou da janela só vai se você ligar isso. O fornecedor também não pode treinar com você de jeito nenhum: "VoiceInk does not operate cloud servers for storing user data." (A VoiceInk não opera servidores em nuvem para armazenar dados de usuário.) O app é GPL-3.0 no GitHub, então a afirmação é inspecionável, e não apenas declarada.
Uma coisa que o marketing não conta e a política conta: as suas transcrições e o seu áudio se acumulam localmente para sempre, a menos que você configure a limpeza. "Transcriptions: Kept indefinitely by default until you delete them." (Transcrições: mantidas indefinidamente por padrão até você apagá-las.) Se o motivo de você ter ido para o local é um laptop que viaja, ligue a exclusão automática.
O Whisper local, seja pelo Buzz, pelo whisper.cpp, pelo WhisperX ou por um app de Mac, não promete nada pelo mesmo motivo: não há fornecedor no meio. Isso é uma garantia mais forte do que qualquer frase que um advogado consiga escrever, e tem um limite honesto. O processamento local protege o trajeto, não o arquivo. A gravação continua num disco que pode ser compartilhado, ter cópia de segurança ou estar sem criptografia.
Handy é gratuito, licenciado sob MIT e, nas palavras dele mesmo, "works completely offline" (funciona totalmente offline). Não tem política de privacidade nenhuma. Num produto cujo código você pode ler, isso nos incomoda menos do que incomodaria em outro lugar, e registramos em vez de disfarçar.
superwhisper pertence a esta seção sempre que você escolhe um modelo de voz local e pula a etapa de modelo de linguagem. A documentação dele detalha a configuração: use o Voice Mode, "which outputs raw transcribed text with no language model involved. This is the simplest fully-local configuration." (que produz o texto transcrito bruto, sem nenhum modelo de linguagem envolvido. Esta é a configuração totalmente local mais simples.) Escolha um modelo em nuvem e você está na outra metade da tabela, com um compromisso de retenção zero cobrindo aquilo. Repare na ressalva do próprio fornecedor, que é uma boa frase e rara: a retenção zero "applies to API usage only" (aplica-se somente ao uso via API), então ditar dentro do app do ChatGPT coloca as suas palavras sob os termos de consumo da OpenAI, e não sob os do superwhisper.
MacWhisper transcreve localmente, custa €64 uma vez com atualizações vitalícias, e vira um produto de nuvem no instante em que você cola uma chave de API. As duas metades estão bem. Saiba qual delas você está usando.
Nuvem, sem treinamento
Voicy é um produto de nuvem sem modo offline, e ele diz isso na própria tabela comparativa. O áudio vai para os servidores da Voicy e de lá para a Groq, que roda o modelo Whisper. O que torna a política dele incomum é que ela explica o mecanismo em vez de só prometer um resultado: "We do not store any recording or transcription data. The Groq API does not retain any information we send it as we have enabled their Zero Data Retention settings and we do not use Groq's batch or fine-tuning endpoints." (Não armazenamos nenhum dado de gravação ou transcrição. A API da Groq não retém nada do que enviamos, porque ativamos as configurações de retenção zero de dados dela e não usamos os endpoints de lote ou de ajuste fino da Groq.) Nomear os endpoints específicos que não usam é mais informativo do que a maior parte das garantias desta página.
Duas observações de precisão. A frase "We do not use your recordings to train an AI model or for any other purpose" (não usamos suas gravações para treinar um modelo de IA nem para qualquer outra finalidade) está no FAQ do site, não na política de privacidade, e a política de privacidade não tem data nenhuma. E dois documentos da Voicy descrevem geografias diferentes: a política de privacidade diz que os servidores são "hosted in the EU and US" (hospedados na União Europeia e nos EUA), enquanto a política de segurança, versão 1.3, de 31 de julho de 2025, diz que "All processing occurs in USA-based infrastructure" (todo o processamento ocorre em infraestrutura sediada nos EUA). Se processamento na União Europeia é exigência para você, pergunte antes de comprar, em vez de escolher a página que apareceu primeiro.
Transkriptor declara a resposta de não treinamento sem nenhuma condição pendurada: "We do not use your content to train, develop, or improve any AI or machine learning models" (não usamos o seu conteúdo para treinar, desenvolver ou melhorar nenhum modelo de IA ou de aprendizado de máquina), e a mesma frase continua, "not for our own benefit, and not for any third party. Your transcriptions remain exclusively yours." (nem em benefício próprio, nem de terceiros. Suas transcrições continuam exclusivamente suas.) Em torno disso ele coloca as coisas que tornam uma promessa verificável: processamento "hosted exclusively within the European Union" (hospedado exclusivamente dentro da União Europeia), ISO 27001 e SOC 2, um prazo de exclusão que você mesmo define, "from as short as 1 minute to up to 1 year" (de apenas 1 minuto até 1 ano), e o direito de exigir a exclusão em até dez dias úteis com certificado comprovando.
Onde essa frase vive é o que importa saber, e é a mesma régua que aplicamos a todo mundo. Ela está na página de segurança e na lista de recursos do plano Pro. A política de privacidade, os termos de serviço e o acordo de tratamento de dados são publicados como uma página única que não traz data de vigência, e as palavras treinar, aprendizado de máquina e modelo não aparecem nela. O apoio jurídico mais próximo é a limitação de finalidade no acordo de tratamento: o operador "shall not process Client Personal Data for any purposes other than those specified in this Agreement" (não processará dados pessoais do cliente para finalidades diferentes das especificadas neste acordo). É uma proteção que funciona, e é indireta. Na página de preços, a linha de não treinamento aparece listada no Pro, e não aparece no Lite nem no Team.
Notta não diz nada sobre treinamento em lugar nenhum. Lemos a política de privacidade e os termos, ambos em vigor desde 11 de março de 2025, a página de segurança e a central de ajuda. A única linha sobre melhoria é sobre comportamento, não sobre conteúdo: "We may use the information gathered to perform statistical analysis of user behavior or to evaluate and improve the Notta Service." (Podemos usar as informações coletadas para análise estatística do comportamento dos usuários ou para avaliar e melhorar o serviço Notta.) A única negação categórica de treinamento vale apenas para dados do Google Workspace e é texto padrão que o Google exige.
Silêncio não é promessa. Também não é acusação, e há um detalhe a favor da Notta que não vimos mencionado em lugar algum: a licença de conteúdo dela é a mais estreita dos cinco serviços de transcrição aqui. Você concede à Notta direitos "only as reasonably necessary" (apenas na medida razoavelmente necessária) para prestar, manter e atualizar o serviço, corrigir problemas, cumprir a lei ou como você autorizar por escrito. Treinamento não está nessa lista, então o contrato aparentemente não autoriza. Isso é um argumento, não uma garantia.
Afirmações de que a Notta treina com dados do plano gratuito, ou apaga o áudio depois de noventa dias, circulam em resenhas. Nenhuma das duas está em qualquer documento da Notta que conseguimos encontrar.
Nuvem, treinamento ligado por padrão
Wispr Flow processa tudo remotamente e não esconde: "Transcription always occurs on the cloud. This is the best way for us to provide accurate, low latency transcription." (A transcrição sempre ocorre na nuvem. É a melhor forma de entregarmos transcrição precisa e de baixa latência.) Todo o processamento acontece nos Estados Unidos.
Sobre treinamento, é a central de ajuda que dá o estado das coisas: "Privacy Mode off (standard mode): audio and transcription data may be used to evaluate, train, and improve Wispr's models. This is the default for trial and standard accounts. Enterprise and HIPAA BAA customers run with Privacy Mode on by default." (Privacy Mode desligado, modo padrão: dados de áudio e de transcrição podem ser usados para avaliar, treinar e melhorar os modelos da Wispr. Esse é o padrão para contas de teste e comuns. Clientes empresariais e com BAA de HIPAA rodam com o Privacy Mode ligado por padrão.) O ajuste é apresentado durante a configuração inicial, já marcado, como "Improve the model for everyone" (melhore o modelo para todo mundo), que é também o novo nome dele dentro do app. Se você instalou o Flow correndo numa terça-feira e nunca mais voltou lá, é nesse estado que você está.
Desligar leva mais ou menos um minuto: Settings, Data and Privacy, e desligue o "Improve the model for everyone". Se você quer que nada seja armazenado, são dois ajustes e não um, e a central de ajuda diz isso com precisão: "Zero Data Retention (ZDR) is shorthand for Privacy Mode on plus Cloud Sync off: no training and no server-side storage of dictation data." (Retenção zero de dados é abreviação de Privacy Mode ligado mais Cloud Sync desligado: nenhum treinamento e nenhum armazenamento dos dados de ditado no servidor.)
Um compromisso aqui é melhor do que a maior parte do campo e vale qualquer que seja a sua escolha: "Wispr always maintains zero data retention agreements with all third-party AI providers" (a Wispr sempre mantém acordos de retenção zero de dados com todos os provedores externos de IA), e esses provedores "do not use your data to train their models, and all shared data is deleted after 30 days" (não usam seus dados para treinar os modelos deles, e todo dado compartilhado é apagado depois de 30 dias). Isso cobre os subcontratados independentemente de como a sua chave estiver.
Os documentos jurídicos, ambos atualizados em 19 de agosto de 2026, descrevem a escolha e não o padrão: "If you choose to share your content with us for model training, we may also use your Customer Content to train our AI models." (Se você optar por compartilhar seu conteúdo conosco para treinamento de modelos, também podemos usar o seu conteúdo para treinar nossos modelos de IA.) O estado padrão aparece só na central de ajuda. Preferiríamos que estivesse na política, que é a mesma coisa que dissemos sobre outros seis produtos desta página.
Otter e Rev estão tratados acima. Os dois treinam por padrão. A Rev deixa você recusar por e-mail. A Otter, numa conta comum, não deixa recusar de jeito nenhum.
Descript treina só com dados compartilhados, e em qual estado você começa depende de em qual página da Descript você acredita.
Os embutidos, que quase ninguém escolheu
Esses importam mais do que os apps pagos, porque você provavelmente está usando um agora mesmo sem ter escolhido.
Google e Gboard
Digitação por voz totalmente no aparelho é recurso do Pixel, não do Android. A página de ajuda do Google é específica: "The text you speak stays on your device and isn't sent to Google servers except when you use the 'Fix it' or detailed edits features" (o texto que você fala fica no seu aparelho e não é enviado aos servidores do Google, exceto quando você usa a correção rápida ou as edições detalhadas), e para ter isso "you must have Pixel 6 or up" (você precisa ter um Pixel 6 ou posterior). Nos demais aparelhos Android, as páginas do Gboard não dizem onde o reconhecimento acontece, o que já é uma resposta de certo tipo. E há um acréscimo que muda a conta para quem lê em português: mesmo num Pixel, a mesma página de ajuda limita a digitação por voz avançada a seis idiomas, inglês, francês, alemão, italiano, japonês e espanhol. O português não está entre eles. Ou seja, ditando em português no Gboard, a sua voz vai para o Google de qualquer forma, em qualquer aparelho.
Dois mecanismos de aprendizado rodam ali, e os padrões deles apontam para lados opostos. O aprendizado federado está ligado: "Important: Federated learning is turned on by default." (Importante: o aprendizado federado vem ligado por padrão.) Ele envia o que o modelo aprendeu, não o que você disse. A doação de áudio fica desligada até você concordar: os trechos são "sent to and stored by Google to improve speech recognition for everyone" (enviados ao Google e por ele armazenados para melhorar o reconhecimento de fala para todos), limitados a 15 segundos, guardados por não mais de 18 meses, e "human reviewers may listen to or transcribe some snippets" (revisores humanos podem ouvir ou transcrever alguns trechos).
Salvar gravações de voz na sua conta do Google é uma terceira coisa, separada, e ela começa desligada: "This voice and audio activity setting is off unless you choose to turn it on." (Esta configuração de atividade de voz e áudio fica desligada a menos que você escolha ligá-la.) Repare na armadilha da mesma página de ajuda: "If you turn this voice and audio activity setting off, previously saved audio is not deleted." (Se você desligar esta configuração, o áudio salvo anteriormente não é apagado.) Desligar não limpa o que ficou para trás.
E eis a divergência. A política de privacidade do Google, em vigor desde 2 de abril de 2026, diz: "Depending on your settings, we can save audio recordings of voice interactions with services like Google Search, Assistant, Maps, and Gboard to develop and improve Google audio technologies." (Dependendo das suas configurações, podemos salvar gravações de áudio de interações por voz com serviços como Pesquisa, Assistente, Maps e Gboard para desenvolver e melhorar as tecnologias de áudio do Google.) O Gboard está nessa lista. A página de ajuda sobre a própria configuração cita apenas Pesquisa, Assistente e Maps.
Para mudar: no teclado, Configurações, Privacidade, depois Voz, depois Doações de áudio. Na sua conta, Dados e privacidade, Atividade na Web e de apps, depois "Incluir atividade de voz e áudio".
Apple
O guia do usuário da Apple diz que as solicitações de ditado "are processed on your device in many languages" (são processadas no seu aparelho em muitos idiomas), com "no internet connection is required" (nenhuma conexão de internet é necessária). O aviso legal, datado de 11 de fevereiro de 2026, é mais cuidadoso e mais útil: "your device will indicate in Keyboard Settings if your audio and transcripts are processed on your device and not sent to Apple servers. Otherwise, the things you dictate are sent to and processed on the server." (o seu aparelho vai indicar, nos Ajustes de Teclado, se o seu áudio e as suas transcrições são processados no aparelho e não enviados aos servidores da Apple. Caso contrário, o que você dita é enviado ao servidor e processado lá.) Para quem lê em português, uma boa notícia verificável: a página de disponibilidade de recursos da Apple lista português do Brasil entre os idiomas de ditado no aparelho, com a ressalva de que é preciso baixar os modelos de fala.
A parte que quase todo mundo entende errado é o que "não armazenado" cobre. O áudio não é guardado, a menos que você aceite. As transcrições são, por padrão, e são usadas para treinamento. Nas palavras da própria Apple: "Apple may retain and use this data for up to two years to develop and improve Siri, Dictation, Search... transcripts may be used to fine-tune Siri, Search, Voice Control, Translate, and automatic speech recognition models." (A Apple pode reter e usar esses dados por até dois anos para desenvolver e melhorar Siri, Ditado, Busca... as transcrições podem ser usadas para ajustar modelos de Siri, Busca, Controle por Voz, Tradução e reconhecimento automático de fala.) Uma parcela passa por revisão humana e "may be kept beyond two years" (pode ser mantida além de dois anos).
Aceite o "Melhorar a Siri e o Ditado" e o áudio entra na pilha, revisado por funcionários e não por terceirizados: "audio review being conducted only by Apple employees" (a revisão de áudio é feita apenas por funcionários da Apple).
Para mudar: Ajustes, Privacidade e Segurança, Análises e Melhorias para a autorização. Ajustes, Siri, Histórico da Siri e do Ditado para apagar o que está guardado. Ajustes, Geral, Teclado para desligar o ditado por completo.
Vale saber ao pesar as promessas da Apple: as acusações de que a Siri gravou pessoas sem consentimento geraram uma ação coletiva, Lopez contra Apple, protocolada em 7 de agosto de 2019 no Distrito Norte da Califórnia. O tribunal concedeu aprovação preliminar de um acordo em 10 de fevereiro de 2025, o caso foi encerrado em 14 de outubro de 2025, e os advogados da classe apontaram o valor final em $95 milhões.
Microsoft e Win+H
O Windows tem dois sistemas de fala e eles não são intercambiáveis. A digitação por voz, a que você abre com Win+H, é sempre remota: "Voice typing uses online speech recognition, which is powered by Azure Speech services" (a digitação por voz usa reconhecimento de fala online, movido pelos serviços de fala do Azure), e precisa de conexão de internet. Já o Acesso por voz, construído como recurso de acessibilidade, funciona "without an internet connection" (sem conexão de internet) depois do primeiro download de idioma.
A formulação da Microsoft é onde é preciso ter cuidado: "Voice data is sent to Microsoft only to provide the service and create text transcriptions. Microsoft does not store, sample, or listen to voice recordings without your permission." (Os dados de voz são enviados à Microsoft apenas para prestar o serviço e criar transcrições. A Microsoft não armazena, amostra nem escuta gravações de voz sem a sua permissão.) A segunda frase é sobre armazenar e escutar. A primeira diz que o áudio vai de qualquer jeito. Se você aperta Win+H, a sua voz chega ao Azure toda vez, com permissão ou sem.
O treinamento é por adesão e a Microsoft diz isso duas vezes: "You can use voice typing without contributing voice clips. Contributing voice clips is optional." (Você pode usar a digitação por voz sem contribuir com trechos de voz. Contribuir é opcional.) Se você contribuir, há gente no circuito: "Microsoft employees and vendors working on behalf of Microsoft will be able to review your voice clips." (Funcionários da Microsoft e fornecedores atuando em nome dela poderão revisar os seus trechos de voz.) A empresa também afirma que "stopped logging any voice data for product improvements beginning on October 30, 2020" (parou de registrar qualquer dado de voz para melhoria de produtos a partir de 30 de outubro de 2020).
Para mudar: Iniciar, Configurações, Privacidade e segurança, Fala, e desligue o reconhecimento de fala online. Prepare-se para a consequência que a Microsoft declara direto, de que restam apenas os recursos baseados no aparelho, o que significa que o Win+H para de funcionar e o Acesso por voz passa a ser o seu ditado. Os trechos de voz têm controle próprio dentro da barra do Win+H, em Configurações.
A declaração de privacidade, atualizada pela última vez em julho de 2026, descreve os dados de voz sendo usados "to develop and improve speech recognition accuracy" (para desenvolver e melhorar a precisão do reconhecimento de fala) sem a ressalva de "com a sua permissão" que aparece nas páginas de ajuda.
OpenAI e o ditado do ChatGPT
Não existe opção local. Aperte o microfone na caixa de mensagem e "the recorded audio is sent to our models to be transcribed" (o áudio gravado é enviado aos nossos modelos para ser transcrito).
Três recursos vizinhos guardam áudio por três prazos diferentes, e é por isso que as pessoas saem de lá confusas. O áudio de ditado é guardado "for as long as the chat is part of your chat history" (enquanto a conversa fizer parte do seu histórico), e apagado em até 30 dias depois que você apaga a conversa. Os trechos do modo de voz ficam 30 dias. A antiga promessa de que os trechos são apagados logo depois da transcrição continua lá, agora restrita a um modo só: "If you are using our legacy standard voice mode, audio clips from ChatGPT are transcribed before we generate a response. We delete audio clips once transcription is complete." (Se você está usando nosso modo de voz padrão legado, os trechos de áudio são transcritos antes de gerarmos a resposta. Apagamos os trechos assim que a transcrição termina.)
Sobre treinamento, o áudio está desligado e o texto está ligado. "By default, we won't train our models with audio or video clips" (por padrão, não treinaremos nossos modelos com trechos de áudio ou vídeo) das conversas por voz. Enquanto isso, na página sobre melhoria de modelos: "ChatGPT, for instance, improves by further training on the conversations people have with it, unless you opt out." (O ChatGPT, por exemplo, melhora treinando com as conversas que as pessoas têm com ele, a menos que você recuse.) Desligar só o compartilhamento de áudio deixa as transcrições em jogo, e a OpenAI diz isso: "To opt out of training our models entirely, please disable Improve the model for everyone." (Para recusar por completo o treinamento dos nossos modelos, desative o "Improve the model for everyone".)
Para mudar: Settings, Data Controls, depois "Improve the model for everyone" e, dentro dele, a chave "Include your audio recordings".
A política de privacidade, atualizada em 18 de maio de 2026, menciona áudio uma vez, numa lista de tipos de conteúdo. Todo prazo de retenção e toda regra de treinamento acima vêm de artigos de ajuda carimbados com "atualizado há 6 dias", em vez de uma data, e reescritos sem histórico de versões. Nossas requisições aos domínios da OpenAI são bloqueadas, então lemos tudo isso em cópias arquivadas capturadas em 4 de junho, 29 de julho, 19 de agosto e 25 de agosto de 2026, e preferimos dizer isso a insinuar uma leitura ao vivo.
O que um tribunal está examinando agora
Um caso vale conhecer, porque testa exatamente a pergunta que esta página faz.
Brewer contra Otter.ai, processo número 5:25-cv-06911-EKL, foi protocolado no Distrito Norte da Califórnia em 15 de agosto de 2025 por Justin Brewer, e quatro ações relacionadas foram reunidas perante a juíza Eumi K. Lee em 22 de outubro de 2025. A petição alega que o assistente de reuniões da Otter gravou participantes sem o consentimento de todos na chamada, e que a Otter "has used captured data to train its speech recognition models" (usou dados capturados para treinar seus modelos de reconhecimento de fala). Ela invoca a lei federal de interceptação, o Computer Fraud and Abuse Act e a Lei da Califórnia contra a Invasão de Privacidade, e pede certificação de classe e indenização acima de $5 milhões.
São alegações. Nada foi provado, a Otter contesta as acusações, e uma petição protocolada é um conjunto de afirmações, não uma conclusão judicial. Incluímos porque é o único lugar em que declarações sobre treinamento com gravações estão sendo testadas por alguém que não é um blog, e porque o desfecho vai importar para todos os produtos da tabela.
Escolhendo pela sua restrição
Você está sob acordo de sigilo, ou lida com material de cliente, médico ou jurídico. Só local. VoiceInk, superwhisper num modelo local, Handy ou Whisper pelo Buzz. Nada da metade em nuvem desta tabela resolve o problema, porque o problema não é se o fornecedor é confiável, é se o arquivo saiu do prédio.
Seu empregador ou cliente exige processamento na União Europeia. A Transkriptor declara processamento apenas na UE. Cheque qualquer outro pelos documentos dele, e não por um selo, e repare que pelo menos um fornecedor aqui tem duas páginas que discordam sobre geografia. Se a exigência que pesa sobre você é brasileira, e não europeia, a pergunta muda de forma: a LGPD não obriga a manter os dados no país, mas exige base legal e transparência sobre transferência internacional, então o que você precisa do fornecedor é o documento datado, não o país.
Você faz pesquisa com comitê de ética. A política do fornecedor é um documento que você vai ter de nomear no seu protocolo, então escolha um produto cuja resposta esteja num documento datado e não numa página de marketing. Só esse critério já encurta bastante a lista. Um pesquisador colocou a mesma questão no Hacker News em julho de 2026, explicando por que construiu a própria ferramenta: não havia "no real options for interview transcriptions with speaker detection that can be used in an university study evaluation context where you do not upload the data into a someone's else's cloud with questionable privacy policies" (nenhuma opção real de transcrição de entrevistas com identificação de quem fala que sirva para avaliação de estudo universitário sem subir os dados para a nuvem de outra pessoa, com políticas de privacidade duvidosas).
Você dita texto comum de trabalho e só não quer virar conjunto de treino. Todo produto de nuvem aqui pode ser configurado para parar. Separe cinco minutos e passe por eles: Wispr Flow em Data and Privacy, ChatGPT em Data Controls, Windows em Privacidade e segurança, Apple em Análises e Melhorias, Gboard na Privacidade do teclado. É esse o trabalho inteiro.
Você tem uma pilha de gravações para virar texto e nenhum problema de confidencialidade. Pegue o plano gratuito de um serviço de transcrição e rode o seu pior áudio nele antes de pagar a quem quer que seja. Se você também quer a questão do treinamento resolvida por escrito, a Transkriptor é a que declara isso sem condições nesta tabela e deixa você definir o próprio prazo de exclusão, de um minuto a um ano. Leia o parágrafo acima sobre onde essa declaração vive, decida se isso basta para a sua situação e, se não bastar, vá para o local. Nosso guia de transcrição de entrevistas e aulas precifica todos os caminhos, inclusive os gratuitos.
Como checamos isso
Em 27 de agosto de 2026 lemos, para cada produto, a política de privacidade, os termos de serviço onde existe um documento separado, a página de segurança ou de confiança, e os artigos relevantes da central de ajuda. Citamos em vez de parafrasear, e registramos a data de vigência impressa em cada documento. Onde o site do fornecedor nos bloqueou, usamos cópias arquivadas e dissemos qual captura e de que data. Onde uma afirmação existe apenas na resenha de outra pessoa, deixamos de fora.
O que não fizemos, e não vamos insinuar: não interceptamos tráfego de rede, não descompilamos nenhum app e não criamos contas pagas para observar os ajustes padrão por dentro. Esta página conta o que catorze empresas colocaram por escrito e onde. Se uma empresa faz algo diferente do que escreveu, este método não vai pegar, e nenhuma quantidade de leitura de política pegaria.
Quatro coisas que não conseguimos resolver. As páginas de ajuda empresarial da Otter devolvem erro para nós, então a afirmação muito repetida de que os espaços de trabalho empresariais ficam fora do treinamento por padrão está aqui como não verificada; a única declaração da Otter que conseguimos ler sobre isso é a página empresarial mandando falar com um gerente de conta. O estado padrão da Descript é contradito entre duas páginas dela mesma. A Microsoft nunca publica o valor padrão da chave de reconhecimento de fala online. E o Reddit é inalcançável de onde trabalhamos, então os comentários de profissionais nesta página vêm do Hacker News, que puxa para o lado técnico.
Quando esta página muda
Preços envelhecem devagar. Políticas, não. Dois dos documentos citados aqui foram atualizados nas últimas duas semanas, um foi reescrito duas vezes este ano, e um é uma ação coletiva que vai produzir decisões.
Então esta página está em calendário fixo de reconferência, e não no regime de "uma hora a gente olha". Todo documento é relido nesse ciclo, e fora dele sempre que um fornecedor anuncia mudança ou a data de uma política se move. Quando uma linha muda, a linha muda e a data no topo da página se move junto. Se você encontrar aqui algo que não corresponde mais ao que um fornecedor publica hoje, avise que a gente relê.
Perguntas frequentes
A Otter treina com as minhas gravações?
Sim. A política de privacidade dela, em vigor desde 16 de junho de 2026, lista "treinar nossa tecnologia proprietária de IA com gravações de áudio desidentificadas e com transcrições" entre as finalidades para as quais processa os seus dados, e os termos de serviço permitem o uso de dados desidentificados "inclusive para aprendizado de máquina e treinamento". Não encontramos, em nenhum documento da Otter que conseguimos ler, forma de uma conta pessoal, Pro ou Business recusar. Organizações são orientadas a falar com um gerente de conta. A frase tranquilizadora sobre treinamento na página de segurança da Otter é uma promessa sobre os fornecedores de IA dela, não sobre a Otter.
Quais apps de ditado nunca mandam a minha voz para lugar nenhum?
VoiceInk por padrão, Handy, Whisper local pelo Buzz ou pelo whisper.cpp, superwhisper quando você seleciona um modelo de voz local e pula o pós-processamento, e MacWhisper enquanto você não conectar uma chave de API. O ditado da Apple roda no aparelho em muitos idiomas, incluindo o português do Brasil em hardware recente, e os Ajustes de Teclado dizem se o seu se qualifica. Todo o resto da tabela manda áudio para um servidor.
Desligar o treinamento é a mesma coisa que desligar o armazenamento?
Não, e isso pega muita gente. Na maioria dos produtos de nuvem são dois ajustes separados. O Wispr Flow declara isso de forma explícita: nenhum treinamento mais nenhum armazenamento no servidor é "Privacy Mode ligado mais Cloud Sync desligado", ou seja, duas chaves. No ChatGPT, desligar o compartilhamento de áudio ainda deixa as suas transcrições disponíveis para treinamento, a menos que você também desligue o "Improve the model for everyone". Confira as duas.
Por que vocês confiam mais numa política de privacidade do que numa página que diz "nunca treinamos com os seus dados"?
Porque uma tem data de vigência e consequências jurídicas, e a outra tem um ícone de escudo. Nos catorze produtos aqui, cinco publicam dois textos próprios que dizem coisas diferentes, e em todos esses casos a versão mais tranquilizadora era a sem data. Quando discordam, vale o documento datado, e é esse que a gente cita.
Toda política, contrato, página de ajuda e registro judicial citado acima foi lido na fonte, e cada um é relido em calendário fixo, porque este é o material que mais se move neste site. A tabela acima é reconferida em calendário, e a data no topo da página é a data da última passagem. Onde um fornecedor bloqueou as nossas requisições, dissemos isso e nomeamos a cópia arquivada que usamos.
Comentários
Ainda não há comentários. Faça uma pergunta ou conte o que funcionou para você.