Herramientas de dictado de código abierto, comprobadas una por una (2026)
Busca «dictado de código abierto» y acabas en uno de dos sitios, y ninguno responde a tu pregunta.
El primero es una comparativa de modelos de reconocimiento de voz, ordenados por tasa de error por palabra, publicada por una empresa que vende reconocimiento de voz como API. Útil si estás construyendo un producto. Inútil si lo que quieres es dictar un correo. El segundo es la página de inicio de una app concreta que resulta que posiciona para esa búsqueda, donde la respuesta a «¿qué herramienta de dictado de código abierto debería usar?» es, previsiblemente, esta.
Entre medias hay una buena lista curada en GitHub con más de cuarenta proyectos. Sin fechas, sin licencias, sin criterio. Cuarenta es peor que ninguno, porque la mayoría de esos cuarenta los publicó una sola persona en un fin de semana durante los últimos dieciocho meses, y no tienes forma de saber cuáles.
Así que hicimos la parte aburrida. En un solo día sacamos el archivo de licencia, el número de estrellas y la fecha de la última versión de dos docenas de proyectos, y leímos las quejas de quienes de verdad intentaron instalarlos. Esto es lo que sobrevive.
Comprobado el 27 de agosto de 2026. Cada licencia, cada recuento de estrellas y cada fecha de publicación de aquí abajo se leyó ese día en el repositorio del propio proyecto o en la página del propio fabricante.
- En un Mac: VoiceInk si quieres dictado local con alguien detrás manteniéndolo (GPL-3.0, y puedes compilarlo tú mismo sin pagar nada). FluidVoice u OpenSuperWhisper si quieres gratis y no te importan las asperezas.
- En Windows: Handy. Licencia MIT, 30,459 estrellas, publicado tres días antes de nuestra comprobación. Cuenta con que tu antivirus refunfuñe con el instalador.
- En Linux: Handy otra vez, con la salvedad de que el soporte de Wayland se sigue arreglando a la vista de todos. Speech Note si prefieres algo empaquetado como Flatpak y quieres traducción y lectura en voz alta en la misma app.
- En Android: Transcribro, si quieres un teclado que funcione dentro del dispositivo bajo una licencia de código abierto de verdad. FUTO Keyboard es la opción más conocida y no es código abierto, digan lo que digan los resultados de búsqueda.
- Si lo que tienes es una carpeta de grabaciones y no un documento en blanco: Buzz o Vibe. Ese es otro trabajo, y la mayoría de estas listas mezclan los dos.
El panorama de un vistazo
| Proyecto | Mejor para | Licencia | Plataformas | Estrellas / última versión (27 ago 2026) | Precio |
|---|---|---|---|---|---|
| Handy | La primera opción por defecto en cualquier escritorio | MIT | macOS, Windows, Linux | 30,459 / v0.9.6, 24 ago 2026 | Gratis |
| VoiceInk | Dictado local en un Mac con alguien que lo mantiene | GPL-3.0 | macOS 14.4+, solo Apple silicon; app para iOS | 6,126 / v2.13, 27 ago 2026 | Gratis desde el código; $29 / $49 / $69 pago único por la versión compilada |
| FluidVoice | Alternativa gratuita para Mac con un repositorio activo | GPL-3.0 | macOS, con versión para Windows disponible | 10,970 / commits el 27 ago 2026 | Gratis |
| OpenWhispr | Dictado local con recurso opcional a la nube | MIT | macOS, Windows, Linux, iOS | 5,780 / commits el 27 ago 2026 | Gratis en local, pago por uso en la nube |
| Speech Note | Linux, empaquetado, con traducción y lectura en voz alta incluidas | MPL-2.0 | Linux (Flatpak) | 1,610 / v4.9.0, 28 jun 2026 | Gratis |
| nerd-dictation | Programarte tu propio dictado en Linux | GPL-3.0 | Linux | 1,913 / nunca ha tenido versión etiquetada, último commit el 10 oct 2025 | Gratis |
| Transcribro | Teclado de voz privado en Android | ISC | Android | 739 / commits el 29 ago 2025 | Gratis |
| FUTO Keyboard | Teclado de Android sin conexión, con el código a la vista | FUTO Source First 1.1, no es código abierto | Android | 3,087 en el espejo de GitHub / 0.1.30, 4 ago 2026 | Pago único, opcional |
| Buzz | Transcribir archivos, no dictar | MIT | macOS, Windows, Linux | 21,162 / v1.4.5, 23 ago 2026 | Gratis |
| Vibe | Transcribir archivos con una interfaz más amable | MIT | macOS, Windows, Linux | 7,216 / v3.1.2, 23 ago 2026 | Gratis |
| Talon | Manejar el ordenador entero por voz | EULA propietario | Windows, macOS, Linux solo con X11 | no aplica | Nivel gratuito, acceso anticipado por Patreon |
| whisper.cpp | El motor sobre el que está construido casi todo lo anterior | MIT | Todo | 53,232 / v1.9.3, 20 ago 2026 | Gratis |
Tres cosas de este campo no son lo que dice la etiqueta
Esta es la parte que ninguna de estas listas hace, porque lleva diez minutos y molesta a algunos.
FUTO Keyboard y FUTO Voice Input tienen el código a la vista, pero no son de código abierto. El código está publicado, la app funciona entera sin conexión, la promesa de privacidad se sostiene y para mucha gente en Android es sinceramente la mejor respuesta. Pero el archivo de licencia se llama FUTO Source First License 1.1, y dice: «You may modify the software only for non-commercial purposes» (solo puedes modificar el software con fines no comerciales) y «You may distribute the software or any part of its source code only if you do so free of charge for non-commercial purposes» (solo puedes distribuir el software, o cualquier parte de su código fuente, si lo haces de forma gratuita y con fines no comerciales). Eso no es una licencia de código abierto según ninguna definición aceptada, y si eliges FUTO porque tu requisito es el código abierto, conviene que sepas que ese requisito no se está cumpliendo.
El núcleo de Talon es propietario. Talon es la opción seria para quien no puede usar las manos y necesita manejar la máquina entera por voz, y sus scripts de usuario sí son abiertos y se comparten mucho, que es de donde viene la confusión. La aplicación en sí no lo es. Su EULA dice que «Talon binaries, updates, files, code, and any works produced from reverse-engineered Talon code... are not permitted to be redistributed in public or private» (no se permite redistribuir, ni en público ni en privado, los binarios, las actualizaciones, los archivos ni el código de Talon, ni obra alguna derivada de código de Talon obtenido por ingeniería inversa). Otra cosa que conviene saber antes de hacer planes con él: la documentación dice que el soporte de Linux es solo para X11, y que «los compositores de Wayland carecen de las API necesarias para Talon, y no está previsto dar soporte a Wayland».
Código abierto y gratis no son la misma palabra. VoiceInk lo publica todo bajo GPL-3.0. Puedes leerlo, auditarlo y compilarlo tú mismo sin gastar nada, y el archivo BUILDING.md del repositorio explica cómo. El desarrollador vende además una versión firmada por $29 con actualizaciones automáticas y soporte. Las dos cosas son ciertas a la vez, y esto no es una trampa sino el arreglo más sano de la categoría: alguien cobra por mantenerlo funcionando y, si deja de hacerlo, el código sigue siendo tuyo.
Casi todas ejecutan los mismos tres motores
En cuanto te fijas en esto, elegir se vuelve mucho más fácil.
Whisper (OpenAI, MIT, 108,018 estrellas) es el multilingüe por defecto, cubre 99 idiomas y es lo que traen de serie casi todos los clientes de escritorio. Va bien en una máquina moderna y lento en una vieja.
Parakeet (NVIDIA, el modelo parakeet-tdt-0.6b-v3 en Hugging Face, CC-BY-4.0, uso comercial permitido) es el rápido. Cubre 25 idiomas europeos, el español entre ellos, necesita unos 2 GB de RAM y corre a una velocidad usable en CPU, que es la razón por la que el autor de Handy dice que lo recomienda por defecto. Un usuario de MacWhisper que lo ejecutaba en un portátil M1 resumió la diferencia así en Hacker News el 18 de agosto de 2025: «La velocidad de transcripción de las grabaciones se siente al menos 10 veces más rápida que con Whisper, y encima la precisión es mejor».
Vosk (Apache-2.0, 15,080 estrellas) es la vieja guardia: modelos diminutos de unos 50 MB que corren en una Raspberry Pi, más de 30 idiomas y el motor que hay detrás de nerd-dictation. Fíjate en la fecha, eso sí. Siguen entrando commits (el más reciente que vimos es del 9 de agosto de 2026), pero la última versión etiquetada es la v0.3.50, del 22 de abril de 2024. Si instalas hoy una herramienta basada en Vosk, estás instalando un paquete de hace dos años.
La conclusión práctica: la calidad de la transcripción la decide sobre todo el modelo, y todos tienen acceso a los mismos modelos. Lo que eliges de verdad al comparar proyectos es la envoltura. ¿Funciona el atajo de teclado? ¿Aterriza el texto en la ventana correcta? ¿Sobrevive a una actualización del sistema? ¿Hay alguien arreglando fallos?
En un Mac
El Mac es donde más opciones abiertas hay, porque es donde más gente las escribe.
VoiceInk es la que recomendamos, y el motivo es aburrido más que ideológico: es el único proyecto de aquí donde el código abierto y la versión mantenida vienen de la misma persona, y los dos están al día. El archivo de licencia es una GPL-3.0 sin adornos. La versión 2.13 salió el mismo día que hicimos la comprobación. Ejecuta Whisper y Parakeet en el Neural Engine, así que nada sale de la máquina, y el paso opcional por la nube toca solo el texto ya dictado, nunca el audio. En la práctica se siente como las apps de pago y no como un proyecto: diccionario personal para nombres y jerga, modos que cambian los ajustes según la app en la que estés, un atajo de teclado que se comporta como esperas desde el primer día. También hay app para iOS.
Los límites son duros y hay que decirlos claros. Solo Apple silicon, macOS 14.4 o posterior. En un MacBook Intel de 2019 esto no es una opción a ningún precio. Los modelos locales piden RAM, y la primera descarga del modelo tarda lo suyo con una conexión lenta.
Si tienes un Mac reciente y quieres dictado local que no haya que vigilar, prueba VoiceInk. Son $29 una sola vez para un Mac, $49 para dos y $69 para tres, con 14 días de devolución, o gratis si prefieres abrir Xcode y compilarlo. Nuestro repaso largo está en el análisis de VoiceInk.
FluidVoice es la opción gratuita para Mac con más impulso: GPL-3.0, 10,970 estrellas, commits el mismo día que miramos y ahora también una versión para Windows. OpenSuperWhisper (MIT, 2,727 estrellas) es más pequeña y más simple. Handy también funciona en el Mac, y es la que hay que probar si quieres la misma herramienta en todos los equipos que tienes.
En Windows
Handy es la opción práctica por defecto. MIT, 30,459 estrellas, v0.9.6 el 24 de agosto de 2026, instalable con winget o con un instalador normal, y hace lo único que quieres: pulsas un atajo, hablas, sueltas y el texto aparece donde está el cursor. El silencio se filtra antes de transcribir, y en los ajustes eliges entre los tamaños de Whisper y Parakeet.
Dos apuntes honestos sobre ella. El autor es franco en la página del propio proyecto, citada en su hilo de Hacker News del 28 de septiembre de 2025: «Este es mi primer proyecto en Rust, y se nota. Hay fallos, asperezas y decisiones de arquitectura...». Y conviene saber que las apps de escritorio de código abierto de este tipo disparan los antivirus. Cuando Whispering publicó la versión 7.3.0 en agosto de 2025, un comentarista subió el 18 de agosto los resultados de VirusTotal, donde AVG y Avast marcaban el instalador como potencialmente no deseado. Como dijo otro en el mismo hilo, una app que escribe dentro de otras ventanas se comporta exactamente como aquello que el software de seguridad está hecho para cazar. Las versiones sin firmar de proyectos pequeños van a seguir provocando esto, y tendrás que decidir si te fías de la fuente.
OpenWhispr es la otra opción vigente: MIT, 5,780 estrellas, macOS, Windows, Linux e iOS desde una sola base de código, modelos locales por defecto y un nivel de nube de pago que puedes ignorar.
Windows también trae dictado gratuito integrado (Win+H), que conviene conocer antes de instalar nada, pero es un servicio en la nube. La propia documentación de Microsoft dice que necesita conexión a internet. Gratis y privado son dos problemas distintos, y la herramienta integrada resuelve solo uno. Nuestro repaso completo de Windows está en las mejores apps de dictado para Windows.
En Linux
Aquí el código abierto no es una preferencia, es la única categoría que existe, y el retrato honesto tiene algunas aristas.
Handy funciona en Linux y es el proyecto grande con impulso real. Wayland es la salvedad. A finales de agosto de 2026 hay incidencias y pull requests abiertos sobre atajos globales e inserción de texto bajo GNOME con Wayland, presentados entre el 27 de abril y el 13 de agosto de 2026, varios todavía en discusión. En X11 se porta bien. En Wayland, mira el rastreador de incidencias de tu compositor antes de organizar el día alrededor de esto.
Speech Note es la opción más tranquila en Linux y la menos comentada. MPL-2.0, distribuida como Flatpak en Flathub, versión 4.9.0 del 28 de junio de 2026, y mete en una sola app el reconocimiento de voz, la lectura en voz alta y la traducción sin conexión, con complementos opcionales de GPU para AMD y NVIDIA. Todo corre en local, sin ninguna conexión de red. Es antes una app de notas que otra cosa, así que el dictado para todo el sistema no es su centro de gravedad, pero para escribir en una ventana y sacar texto funciona sin que compiles nada.
nerd-dictation se merece un párrafo sobre todo como advertencia de cómo se escriben estas listas. Es un script de Python de un solo archivo, bien hecho, montado sobre Vosk; convierte los números dichos en voz alta a cifras y su configuración es Python puro, así que puedes reescribir la salida como quieras. También es cierto que no ha tenido nunca una versión etiquetada, y que su último commit es del 10 de octubre de 2025. Un comentarista de Hacker News lo resumió allá por enero de 2022 y la descripción sigue encajando: «Está claramente más orientado al bricolaje y al hacker que a ser una solución de verdad». Aparece casi en lo alto de todas las listas de «mejor dictado de código abierto para Linux» publicadas este año, normalmente sin ninguna indicación de que se apoya en un motor cuya última versión es de 2024.
Si te gustan los scripts, ese es un camino legítimo y son unas veinte líneas. Un lector de Hacker News publicó el suyo en agosto de 2025: asocia una tecla a arrancar la grabación con ffmpeg, asocia el soltarla a matarla, pasa el archivo por whisper-cli de whisper.cpp y escribe el resultado. Sin instalador, sin aviso del antivirus, sin nada que actualizar. Si eso es un placer o una lata es la pregunta entera de esta sección. Nuestra guía por plataforma está en las mejores apps de dictado para Linux.
En Android
Transcribro (licencia ISC, 739 estrellas) es la respuesta limpia: un teclado y un servicio de reconocimiento que corren enteros dentro del dispositivo, montados sobre whisper.cpp y disponibles a través de F-Droid. El desarrollo está tranquilo, con los últimos commits que vimos fechados el 29 de agosto de 2025, así que tómatelo como algo estable más que como algo en crecimiento.
FUTO Keyboard y FUTO Voice Input son la pareja conocida. Funcionan enteros sin conexión, no piden cuenta y se financian con un pago único opcional en lugar de una suscripción. Lee la sección de licencias de más arriba antes de archivarlos bajo «código abierto», y hazle caso al propio proyecto cuando dice que todavía está completando funciones e idiomas.
El punto de partida gratuito en Android es «Escribir por voz», el dictado del propio Gboard, que casi todo el mundo ya tiene instalado. Un matiz para quien lea esto en español: el modo que se queda entero dentro del teléfono, el que Google llama «funciones avanzadas de Escribir por voz», sí incluye el español, pero exige un Pixel 6 o posterior. En cualquier otro Android, Google no publica para qué idiomas hay paquete de reconocimiento sin conexión, así que no des por hecho que el tuyo lo tiene hasta comprobarlo en los ajustes del teléfono.
Dónde pierde todavía el código abierto, en concreto
Sin vaguedades. Aquí están los cinco puntos, con fuentes.
1. Nadie limpia lo que has dicho. Esta es la carencia de verdad y explica casi toda la decepción. Las herramientas de nube de pago dan dos pasos: transcriben y luego reescriben. La reescritura convierte «o sea, creo que deberíamos, eh, quizá mover la reunión, bueno, mejor la movemos al jueves» en una frase limpia. Los modelos locales dan solo el primer paso. El responsable de Whispering lo dijo sin rodeos en Hacker News el 19 de agosto de 2025: «Los modelos de transcripción recientes no traen una inferencia ni una limpieza integradas muy buenas, y en el caso de Whisper el parámetro "prompt" es muy flojo», y el mejor apaño disponible es pasar después la transcripción por un modelo de lenguaje aparte. Eso puedes montarlo. Varios proyectos ya lo traen. Pero recién instalado, lo que obtienes es lo que dijiste, muletillas incluidas.
2. Whisper se inventa cosas durante los silencios. En «Careless Whisper: Speech-to-Text Hallucination Harms» (FAccT 2024), Koenecke y sus colegas encontraron que el 1.4% de los fragmentos de audio producía una secuencia alucinada, texto que nadie había pronunciado, y que el 38% de esas alucinaciones contenía daños explícitos, como violencia inventada o atribuciones falsas. Las alucinaciones se concentraban alrededor de las pausas del habla. Para dictar un correo esto es una curiosidad. Para cualquier cosa que no vayas a releer, no lo es. Y hay un detalle que solo se ve dictando en español: cuando Whisper alucina sobre un silencio, lo que suele salir son créditos de subtítulos, y el caso documentado una y otra vez es «Subtítulos realizados por la comunidad de Amara.org». El motivo es que el modelo se entrenó con subtítulos, y esas líneas van al final del vídeo, cuando ya no habla nadie. En inglés la frase típica es otra, «Thank you», así que los ejemplos que veas en artículos en inglés no son los que te vas a encontrar tú.
3. La instalación cuesta de verdad. Avisos del antivirus con versiones sin firmar, descargas de modelos que fallan sin un error útil, diálogos de permisos, Wayland. Un usuario contó su intento con el AppImage de Whispering en Linux en agosto de 2025: no consiguió descargar un modelo, conectó los modelos a mano y acabó con un archivo de audio de longitud cero, y concluyó el 21 de agosto: «este software todavía no está listo para el uso diario, al menos no en Linux». Es un proyecto en un día concreto y desde entonces ha avanzado, pero la forma de esa experiencia es lo bastante común como para que fingir lo contrario fuese deshonesto.
4. El soporte es un rastreador de incidencias. No hay servicio de atención. Si el atajo deja de funcionar tras una actualización del sistema, tus opciones son esperar, leer el hilo o arreglarlo tú.
5. La mayoría de estos proyectos habrá desaparecido. Entre noviembre de 2025 y agosto de 2026 contamos más de una docena de apps de dictado local casi idénticas publicadas en Hacker News: Ito, Vocalinux, Toice, Purr, Fonos, TypeWhisper, Recitey, TongueType, Plainsay, Velora, Dictata y otras. La mayoría reunió menos de cinco puntos y cero comentarios. Y esto tampoco es exclusivo de los proyectos pequeños. DeepSpeech, de Mozilla, con 26,772 estrellas, está archivado. Coqui STT, el proyecto que recogió el testigo, no tiene commits desde marzo de 2024, y la empresa que había detrás cerró ese mismo año. El número de estrellas mide el entusiasmo del día del lanzamiento. Las fechas de publicación miden si queda alguien ahí.
Dónde gana, y esta parte no es pequeña
Tu audio no va a ninguna parte. No como política escrita en una página de seguridad, sino porque no hay ninguna llamada de red. Esa es la única promesa de privacidad que no depende de fiarte de nadie, y es la razón por la que médicos, abogados y gente que trabaja bajo acuerdo de confidencialidad acaban aquí.
Sin topes, sin cuenta, sin renovación. El dictado de pago va de $8 a $15 al mes, y los niveles gratuitos se paran en un par de miles de palabras por semana, que son unos quince minutos hablando. Las herramientas locales no tienen contador de palabras porque no hay ningún servidor contando.
Eliges tú el modelo. Puede que Whisper Medium le siente mejor a tu voz que Large. Puede que Parakeet sea cinco veces más rápido en tu portátil. El autor de Handy descubrió que Medium le iba mejor que Turbo para su propia forma de hablar, que es exactamente el tipo de cosa que solo se descubre cuando te dejan cambiar de modelo.
Sigue funcionando. Ningún fabricante puede descontinuar tu montaje, cambiar el precio o decidir que tu país ya no está soportado. Quien tuviera Dragon y viera cómo se desmontaba la línea de consumo sabe lo que eso vale.
Puedes leerlo. No es que vayas a hacerlo. Pero alguien puede, y en una categoría donde una app mira todo lo que escribes, eso importa más de lo habitual.
Si solo quieres dictado que funcione hoy
Merece decirse sin titubear: si este tipo de cosas no te divierte, el código abierto no es ahora mismo el camino más corto hacia un buen dictado. Las herramientas de pago limpian mejor, están firmadas y notarizadas, tienen una dirección de soporte y cuestan entre dos y quince dólares al mes.
Si ese eres tú, sáltate la categoría entera y empieza por una guía de plataforma: las mejores apps de dictado para Mac, para Windows o para Linux. Cada una pone primero la opción integrada y gratuita, porque en dos de esas tres plataformas le basta de verdad a mucha gente.
Qué hemos dejado fuera y por qué
Amical (MIT, 1,508 estrellas), VoiceTypr (AGPL-3.0, 692), OpenSuperWhisper (MIT, 2,727) y unas treinta más. Todas reales, todas mantenidas hoy. No están en la tabla principal porque hacen lo mismo que las de arriba con menos gente detrás, y recomendar un proyecto joven para algo que vas a usar a diario es la vía rápida para reinstalar dentro de seis meses. Si quieres el campo completo, la lista awesome-voice-typing en GitHub es la más exhaustiva que encontramos.
Whispering. Citada varias veces en esta página y sigue siendo buena herramienta, pero ojo: el repositorio independiente está archivado; ahora vive dentro del monorepo Epicenter, que es donde hay que mirar si te pones a buscarlo.
Bibliotecas de modelos: faster-whisper, WhisperX, sherpa-onnx, NeMo. Son componentes, no aplicaciones. Si estás construyendo algo, son excelentes. Si lo que quieres es dictar, te has equivocado de estantería.
Cualquier cosa cuya página diga «código abierto» sin un archivo de licencia. Productos de pago y de código cerrado posicionan en estas búsquedas con páginas construidas enteras alrededor de la expresión. La comprobación lleva un minuto: busca el repositorio, abre el archivo LICENSE y lee la primera línea.
Cómo lo hemos comprobado
El 27 de agosto de 2026 consultamos la API de GitHub para cada proyecto de esta página y anotamos cuatro cosas: el contenido del archivo de licencia, el número de estrellas, la fecha de la última versión etiquetada y la fecha del último commit. Los precios y los requisitos del sistema salieron de las páginas de los propios fabricantes ese mismo día. Las afirmaciones sobre licencias están citadas del archivo de licencia o del EULA, no del texto de marketing, que es la razón por la que las entradas de FUTO y Talon acaban aquí con otra cara que en otros sitios.
No montamos ninguna competición de precisión, y en esta página no hay tasas de error por palabra propias. Donde se describe velocidad o precisión, viene de un estudio publicado o de un usuario con nombre en un hilo público y fechado, y así se indica. Cada queja que citamos está atribuida a una persona y a una fecha para que juzgues lo rancia que está, y varias son de 2025 y puede que ya estén arregladas.
Preguntas frecuentes
¿Cuál es hoy la mejor app de dictado de código abierto?
Handy, para la mayoría de la gente y en la mayoría de las plataformas. Licencia MIT, 30,459 estrellas, publicada el 24 de agosto de 2026, ejecuta Whisper o Parakeet en local en macOS, Windows y Linux, gratis. En un Mac en concreto, VoiceInk está más pulida y la mantiene alguien a quien le pagan por mantenerla, que es la razón por la que allí la recomendamos aunque la versión ya compilada cueste $29.
¿El dictado de código abierto es tan preciso como las apps de pago?
Para la transcripción en bruto de habla clara en un idioma común, sí, porque están ejecutando los mismos modelos por debajo. La diferencia está en el segundo paso, esa capa de limpieza que reescribe tu divagación como una frase terminada. Las apps de pago o la hacen en sus servidores o te conectan un modelo de lenguaje dentro de la app; los clientes de código abierto casi siempre te entregan la transcripción y te dejan a ti el cableado. Si tu queja con el dictado es «escribe exactamente lo que dije, muletillas incluidas», ahí está la carencia, y es real.
¿Código abierto significa que mi voz se queda en mi ordenador?
No. Son preguntas separadas. Una licencia te dice qué puedes hacer con el código; no dice nada sobre adónde va el audio. Varios de los clientes de código abierto de aquí pueden mandar audio a una API en la nube si les das una clave. Comprueba si la herramienta tiene modo sin conexión, si es el modo por defecto y si se descargó algún modelo a tu máquina. Si no se descargó nada, no hay nada corriendo en local.
¿Qué herramientas de dictado de código abierto funcionan en Linux?
Handy (con Wayland todavía en obras), Speech Note como Flatpak, OpenWhispr y nerd-dictation si quieres programártelo. Talon también corre en Linux, pero es propietario y solo con X11, y su documentación dice que no está previsto dar soporte a Wayland.
¿Puedo usar dictado de código abierto en el móvil?
En Android, sí: Transcribro es un teclado que trabaja dentro del dispositivo bajo licencia ISC, y «Escribir por voz» de Gboard es la opción gratuita que ya viene puesta, aunque su modo que no sale del teléfono, con el español incluido, pide un Pixel 6 o posterior, y para el resto de los Android Google no publica qué idiomas tienen paquete sin conexión. El teclado y la entrada de voz de FUTO son la opción popular y funcionan enteros sin conexión, aunque su licencia deja el código a la vista sin ser de código abierto. En iOS el campo es mucho más flaco. VoiceInk tiene app para iOS y OpenWhispr declara soporte de iOS; más allá de eso, el proyecto comunitario al que apunta la gente es WhisperBoard. Para la mayoría de quienes usan iPhone, el dictado propio de Apple, que trabaja en el dispositivo, sigue siendo la respuesta gratuita realista.
Comentarios
Todavía no hay comentarios. Haz una pregunta o cuéntanos qué te ha funcionado.