Dictée vocale pour les développeurs (2026) : Claude Code, Cursor, VS Code et le terminal

Certains liens de cette page sont des liens affiliés : le prix ne change pas pour vous. Notre méthode.

Avant d'installer quoi que ce soit : l'outil que vous utilisez déjà contient probablement une dictée. Claude Code a livré /voice au printemps, Cursor a un microphone dans sa zone de discussion depuis octobre 2025, et VS Code dicte dans l'éditeur depuis plus longtemps encore. Tout ce qui suit a été relevé le 27 août 2026 dans la documentation officielle, les changelogs et les registres de paquets, y compris les conditions que les guides écrits par les vendeurs de dictée passent sous silence, et il y en a plusieurs.

Par la rédaction de VoiceBoardMis à jour le 28 août 2026

Notre choix

La raison d'ajouter un outil payant n'est pas que les fonctions intégrées seraient mauvaises. C'est que chacune couvre exactement une fenêtre. Si vous passez d'un terminal à un éditeur, puis à un navigateur et à Slack, vous finissez par vouloir un seul raccourci qui marche partout, et c'est cela que vous payez.

Pour un raccourci unique partout, Wispr Flow est ce que nous conseillons à la plupart des développeurs. Si le code n'a pas le droit de quitter votre machine, Handy fait le même travail gratuitement et n'envoie jamais d'audio nulle part.

Commencez ici

Deux métiers différents se cachent derrière l'expression « coder à la voix »

Presque toutes les disputes sur le sujet viennent de leur confusion.

Dicter une intention à un agent. Vous dites ce que vous voulez, de la prose arrive dans une zone de saisie, le modèle écrit le code. Rien ne change dans votre éditeur. C'est ce que font les fonctions intégrées, c'est ce que fait une application de dictée, et pour la plupart des lecteurs de cette page c'est toute la tâche. Temps d'installation : environ une minute.

Piloter l'éditeur à la voix. Vous lancez des commandes structurées qui déplacent le curseur, sélectionnent un token, suppriment un argument, renomment un symbole. Aucune frappe nulle part dans la boucle. C'est le domaine de Talon et de Cursorless, une compétence qui s'apprend plutôt qu'une application qui s'installe, et ceux qui la maîtrisent s'y sont mis parce que taper avait commencé à faire mal.

Le premier métier est devenu facile en 2026. Le second est possible depuis 2018 environ et reste difficile. Si vous êtes ici parce que vos poignets vous font souffrir, sautez directement à la section Talon : une application de dictée ne résoudra pas votre problème.

Pourquoi cela devient soudain pertinent

Une consigne envoyée à un agent de code n'est pas une ligne de code. Ce sont deux cents mots de prose qui décrivent ce que vous voulez, quels fichiers sont concernés, ce que vous avez déjà essayé et quelles sont les contraintes. La prose est exactement ce que la parole fait bien et exactement ce qui est lent à taper.

Les chiffres que tout le monde cite viennent d'une seule étude de 2016, signée Ruan, Wobbrock, Liou, Ng et Landay (arXiv:1608.07323). Sur un iPhone 6 Plus, la saisie vocale en anglais atteignait 153 mots par minute contre 52 au clavier tactile, soit environ trois fois plus vite, avec 123 contre 43 en mandarin. À savoir avant de répéter le chiffre : il s'agissait de taper avec les pouces sur un téléphone. La comparaison qui vous intéresse porte sur un clavier physique, et la plus vaste étude sur ce point, celle de Dhakal et ses collègues à CHI 2018, avec 168 000 participants et 136 millions de frappes, aboutit elle aussi à une moyenne de 52 mots par minute, les 5 % les plus rapides dépassant 80.

Pour un dactylo moyen, l'écart est donc bien d'environ trois contre un. Si vous tapez à 100 mots par minute, il tombe plutôt à 1,5, et l'argument de la vitesse s'évapore. La même étude de 2016 a trouvé que la parole laissait un peu plus d'erreurs non corrigées dans le texte final, 1,30 % contre 0,79 %, ce qui pèse davantage quand vous dictez un chemin de fichier qu'une phrase.

La version honnête de l'argumentaire : la dictée ne fait pas de vous un programmeur plus rapide. Elle rend les longues consignes bon marché, si bien que vous écrivez la version en trois phrases au lieu de celle en six mots, et l'agent devine moins.

Vue d'ensemble

OutilCe qu'il couvrePrix vérifié le 27 août 2026Où l'audio est traité
Claude Code /voiceLa zone de saisie de Claude Code, dans le terminal et dans l'extension VS CodeGratuit avec une offre Claude.ai, aucun coût en tokensServeurs d'Anthropic
Voix de CursorLa zone de discussion de Cursor, rien d'autreCompris dans CursorNon documenté
VS Code SpeechCopilot Chat et l'éditeur VS CodeGratuitSur votre machine
Voix de WarpLes zones de saisie de Warp et son agentCompris dans WarpLe service de Wispr Flow
Wispr FlowToutes les applications sur Mac, Windows, iPhone, AndroidGratuit 2 000 mots/semaine ; Pro $15/mois, $12/mois à l'annéeCloud
SuperwhisperToutes les applications sur Mac, Windows, iOSOffre gratuite permanente ; Pro $8.49/moisModèles locaux ou cloud, au choix
HandyToutes les applications sur Mac, Windows, LinuxGratuit, licence MITSur votre machine, toujours
VoiceInkToutes les applications sur Mac Apple Silicon$29 / $49 / $69 une foisSur votre machine par défaut
VoicyToutes les applications sur Mac, Windows, Linux, plus mobile30 minutes gratuites ; $8.49/mois ; $260 à vieCloud (Groq)
VoibeToutes les applications sur Mac et Windows$7.50/mois, $59/an, $149 à vieLocal sur Apple Silicon, cloud sur Windows
Talon + CursorlessToute la machine, et l'édition structurelle dans VS CodeGratuit, Patreon pour les versions bêtaSur votre machine

Claude Code : la commande /voice

C'est elle qui attire les recherches, et c'est aussi celle que les articles bien classés décrivent le plus mal. Voici donc le tableau complet, d'après la documentation d'Anthropic.

L'activation. Tapez /voice dans la CLI. Le premier lancement fait un test de microphone, et sur macOS c'est le moment où votre terminal demande enfin l'autorisation micro. Le pied de page de la zone de saisie confirme l'état :

Voice mode enabled (hold). Hold space to record. Dictation language: en (/config to change).

/voice hold, /voice tap et /voice off règlent le mode directement. Le réglage survit aux redémarrages, et vous pouvez vous passer complètement de la commande en le plaçant dans votre fichier de réglages utilisateur :

{ "voice": { "enabled": true, "mode": "tap" } }

Le mode hold, celui par défaut, fonctionne en appui maintenu sur la barre d'espace. Une bizarrerie mérite d'être connue : Claude Code détecte une touche maintenue en guettant les événements de répétition envoyés par le terminal, d'où un court temps de chauffe, le pied de page affichant keep holding… avant listening…, et les premiers espaces parasites sont nettoyés automatiquement. Le texte apparaît en grisé pendant que vous parlez et s'insère au curseur quand vous relâchez, ce qui vous permet de taper une demi-phrase, de dicter la suite et de continuer.

Le mode tap supprime le temps de chauffe : une frappe sur espace pour démarrer, une autre pour arrêter, et la consigne s'envoie d'elle-même si la transcription fait au moins trois mots. L'enregistrement s'arrête tout seul après 15 secondes de silence ou deux minutes au total. La première frappe ne fonctionne que si la saisie est vide, ce qui vous laisse taper un espace normalement.

Deux réglages à changer dès le premier jour. Ajoutez "autoSubmit": true à l'objet voice si vous voulez que le mode hold envoie au relâchement plutôt qu'en attendant Entrée. Et si le temps de chauffe de la barre d'espace vous agace, réaffectez l'action dans ~/.claude/keybindings.json, parce qu'une combinaison avec modificateur démarre l'enregistrement dès la première frappe, sans aucune chauffe :

{ "bindings": [ { "context": "Chat", "bindings": { "meta+k": "voice:pushToTalk" } } ] }

Le moteur de transcription a été orienté vers notre vocabulaire plutôt que vers la parole générale. Anthropic indique qu'il gère correctement des termes comme regex, OAuth, JSON ou localhost, et que le nom de votre projet en cours et celui de votre branche git lui sont fournis automatiquement comme indices de reconnaissance. Ce dernier détail décide souvent si une dictée est utilisable, et aucun outil tiers ne peut faire pareil sans lire votre dépôt.

Vingt langues de dictée, réglables par /config ou par le paramètre language : tchèque, danois, néerlandais, anglais, français, allemand, grec, hindi, indonésien, italien, japonais, coréen, norvégien, polonais, portugais, russe, espagnol, suédois, turc, ukrainien. Le reste retombe sur l'anglais, avec un avertissement à l'activation.

Maintenant les conditions, là où les guides des vendeurs deviennent silencieux. La dictée vocale exige :

L'audio part vers les serveurs d'Anthropic. La documentation le dit en quatre mots : « Audio is not processed locally. » En revanche, la transcription « ne consomme ni messages Claude ni tokens et ne compte pas dans les limites affichées par /usage », donc la fonction est gratuite au sens qui compte.

L'extension VS Code offre la même fonction avec la même exigence de compte Claude.ai, et elle n'est pas disponible dans les sessions VS Code Remote, c'est-à-dire SSH, Dev Containers et Codespaces. L'administrateur de votre organisation peut aussi tout couper par une règle, auquel cas /voice vous le dit.

Sous Linux, l'enregistrement passe par un module natif, et si celui-ci ne se charge pas, Claude Code se rabat sur arecord d'ALSA utils ou sur rec de SoX. Sous WSLg, il vous faut explicitement le backend PulseAudio, sudo apt install sox libsox-fmt-pulse, parce que sox seul tire le backend ALSA alors qu'il n'y a pas de /dev/snd où enregistrer. Cette ligne-là fera gagner une soirée à quiconque développe sous WSL.

Date d'arrivée. Anthropic ne date pas son changelog, nous avons donc pris le problème de biais. Sur les 377 versions du changelog public, la première entrée qui mentionne la voix est la 2.1.69, celle qui a ajouté dix langues de dictée pour arriver à vingt, et le registre npm donne à cette version une date de publication au 4 mars 2026. La fonction a donc atterri tout début mars 2026 et reçoit des correctifs à un rythme régulier depuis, la plupart concernant l'audio sous Linux, WSL et les terminaux qui n'envoient pas d'événements de répétition de touche.

Cursor : le microphone de la zone de discussion

Cursor a ajouté la voix dans Cursor 2.0, le 29 octobre 2025, décrite dans son changelog comme le contrôle de l'agent par la voix via une reconnaissance vocale intégrée, avec des mots-clés d'envoi que vous définissez dans les réglages, de sorte que prononcer votre mot déclencheur lance l'exécution. Cursor 3.1, le 13 avril 2026, l'a reconstruite : maintenez Ctrl+M pour parler, et l'éditeur enregistre désormais l'extrait complet puis le transcrit en un seul lot au lieu de le diffuser en continu, ce qui, d'après le changelog, a amélioré la qualité. Pendant l'enregistrement, vous voyez une forme d'onde, un minuteur et des boutons d'annulation et de confirmation.

Une page actuellement bien classée sur cette requête affirme que la saisie vocale de Cursor « n'est pas couverte par une documentation publique que nous ayons pu vérifier ». Elle l'est. Les entrées de changelog ci-dessus sont publiques, datées et précises, ce qui en dit long sur le soin apporté aux écrits de ce domaine.

Ce que le microphone de Cursor ne fait pas, c'est sortir de la zone de discussion. Il n'atteint ni Cmd+K, ni l'éditeur lui-même, ni le terminal intégré, ni l'onglet du navigateur où vous lisez une doc d'API. Si vous faites tourner Claude Code ou Codex dans le terminal de Cursor, le microphone de la discussion ne vous sert à rien là-bas, et c'est la première raison pour laquelle les développeurs sous Cursor finissent quand même par installer un outil système.

Le forum communautaire de Cursor charrie aussi un flux régulier de bugs vocaux : une saisie qui ouvre un contexte audio mais ne capte que du silence, des formes d'onde qui s'animent sans qu'aucun texte n'arrive, du texte dicté qui atterrit en fin de première ligne quelle que soit la position du curseur. Rien de tout cela ne veut dire que la fonction est cassée pour tout le monde. Cela veut dire qu'il faut la tester avant de construire une habitude autour.

VS Code et Copilot Chat

VS Code dicte à deux endroits, et les raccourcis valent la peine d'être mémorisés : Ctrl+I (⌘I sur Mac) parle dans la discussion, Ctrl+Alt+V (⌥⌘V) dicte dans l'éditeur, à l'emplacement du curseur. Les deux fonctionnent en appui maintenu. Il existe aussi une activation par mot-clé, « Hey Code », si vous préférez ne toucher aucune touche.

Le point qui compte pour quiconque a un employeur strict : la documentation de Microsoft indique que le modèle par défaut « traite l'audio du microphone sur votre appareil » et qu'après le téléchargement initial du modèle, la reconnaissance vocale n'a pas besoin de connexion Internet. Voilà une option vraiment capable, vraiment locale, livrée par le même éditeur que votre IDE, et gratuite.

Sur les plateformes de bureau grand public, la capacité est désormais intégrée. L'extension séparée VS Code Speech reste nécessaire sur le web, sur les Mac Intel, sur les systèmes 32 bits et Arm32 et sur les distributions Linux basées sur musl. Elle affiche 1 417 222 installations, la version 0.16.0, et couvre 26 langues via le réglage accessibility.voice.speechLanguage.

La limite est évidente. Cela marche dans VS Code et nulle part ailleurs. Et comme Cursor est un fork de VS Code et non VS Code, ne partez pas du principe que l'extension s'y comporte à l'identique.

Les terminaux

Warp est l'exception : la voix y est une fonction de premier plan, configurée sous Settings, Agents, Warp Agent, Voice, utilisable dans toutes ses zones de saisie et pas seulement en mode agent. La documentation de Warp précise que sa transcription « est assurée par Wispr Flow » et que l'audio est traité en temps réel puis n'est pas conservé comme enregistrement. Si vous payez déjà Wispr Flow, vous faites tourner le même moteur à deux endroits.

Pour iTerm2, Windows Terminal, Ghostty, Alacritty ou un simple gnome-terminal, il n'y a pas de dictée intégrée et il n'y en aura pas. Un terminal est une surface de texte comme une autre, donc la réponse est une couche système qui écrit dans la fenêtre active. C'est aussi la réponse pour les IDE JetBrains, pour Zed, pour Neovim, et pour les agents en ligne de commande que vous lancez à l'intérieur de tout cela.

La couche système

Ces outils restent en arrière-plan, écoutent tant que vous maintenez un raccourci et collent le texte fini là où se trouve le curseur. Un seul outil, toutes les fenêtres. Ils sont comparés ici sur les mêmes critères : ce que vous payez, où va l'audio, où il est traité.

Wispr Flow

Celui qui a été conçu précisément pour ce public. Sa page destinée aux développeurs promet une dictée qui « comprend le jargon des devs », gère le camelCase, le snake_case et les acronymes, retient des noms de produits comme Supabase ou MongoDB, et référence les fichiers dans Cursor et Windsurf pour que le bon contexte arrive dans votre consigne. Elle annonce une livraison 4x plus rapide, chiffre du vendeur et non mesure publiée.

Voici ce qui lui vaut notre recommandation malgré le prix. Vous maintenez une touche, vous parlez comme vous parlez, et de la prose propre atterrit dans la fenêtre où vous étiez : hésitations disparues, ponctuation posée, la phrase que vous aviez recommencée rendue telle que vous la pensiez. Cela marche dans le terminal, dans un panneau de discussion, dans un commentaire GitHub et dans Slack sans savoir ni se soucier duquel il s'agit, si bien que la question « sur quel microphone j'appuie ici » disparaît au bout de deux jours. L'équipe de Warp l'a choisi comme moteur de sa propre fonction vocale, ce qui est un vrai vote de gens qui avaient évalué les alternatives.

Les petits caractères. L'offre gratuite donne 2 000 mots par semaine sur ordinateur, Pro coûte $15 par mois ou $12 par mois en facturation annuelle. C'est un service en ligne, donc pas de connexion, pas de dictée. Windows est x64 uniquement : les machines ARM, autrement dit les portables Snapdragon, ne sont pas prises en charge, pas plus que les machines virtuelles ou le bureau à distance, ce qui l'exclut d'une bonne part des environnements d'entreprise. Il n'y a pas de version Linux. Notre test complet est ici, et les alternatives sont .

Essayer Wispr Flow

Superwhisper

La nouvelle date d'hier au moment où nous écrivons : le 26 août 2026, Superwhisper a lancé une offre gratuite permanente. Zéro dollar donne désormais la reconnaissance vocale dans toutes les applications, l'enregistrement et la transcription de réunions, la prise en charge de plus de 100 langues et un usage illimité des modèles Whisper. L'offre Pro, à $8.49 par mois, ajoute vos propres clés d'API, des modèles d'IA locaux et en ligne, la traduction, et la transcription de fichiers audio et vidéo. Les nouveaux utilisateurs reçoivent 3 000 mots de Pro pour essayer, après quoi les fonctions gratuites leur restent indéfiniment.

Il tourne sur Mac, Windows et iOS, et c'est l'une des rares applications commerciales à traiter votre parole entièrement sur votre propre machine. Les modèles hors ligne réclament de l'Apple Silicon ; l'éditeur conseille aux Mac Intel de rester sur les modèles en ligne.

Il existe aussi une intégration dédiée à Claude Code, ajoutée en avril 2026, qui place une fenêtre Superwhisper flottante devant l'agent pour lui parler sans repasser par le terminal. L'installation tient en un script d'une ligne récupéré sur leur site. Des pages équivalentes existent pour OpenCode, Codex, Pi et Grok CLI.

Handy

Gratuit, sous licence MIT, et il fait une seule chose : vous appuyez sur un raccourci, vous parlez, le texte arrive dans le champ actif, et rien ne quitte l'ordinateur. La transcription tourne sur des modèles Whisper ou sur Parakeet V3, optimisé pour le CPU et capable de détecter la langue tout seul, avec la détection d'activité vocale Silero qui filtre les silences. Windows, macOS et Linux, version actuelle v0.9.6 du 24 août 2026, et 30 430 étoiles sur GitHub.

Le projet se décrit comme cherchant à être l'application de reconnaissance vocale la plus facile à forker plutôt que la meilleure, positionnement d'une honnêteté rare et aussi la bonne attente à avoir. Il n'y a pas de couche de finition qui corrige votre grammaire, pas de dictionnaire qui apprenne les noms de vos collègues. Pour un développeur à l'aise avec le choix d'une taille de modèle et prêt à vivre avec quelques aspérités, Handy est la meilleure option gratuite de cette page.

VoiceInk

macOS sur Apple Silicon uniquement, modèles locaux sur le Neural Engine, code ouvert, 6 123 étoiles, et un tarif à l'achat unique : $29 pour un Mac, $49 pour deux, $69 pour trois, mises à jour à vie. Les fournisseurs cloud ne sont disponibles que si vous apportez votre propre clé d'API et le choisissez.

Si votre Mac est la machine où se trouve le code du client, c'est le chemin le plus court vers une dictée qui n'envoie jamais d'audio nulle part, et payer $29 une fois plutôt que $144 par an d'abonnement est amorti en une dizaine de semaines. Notre comparatif Mac va plus loin.

Voir VoiceInk

Voicy

L'option commerciale qui livre réellement une version Linux : .deb, .rpm et AppImage, pour Ubuntu, Debian, Fedora et Arch. Elle écrit dans toutes les applications, tous les terminaux et tous les navigateurs du système, fonctionne dans VS Code et dans les éditeurs JetBrains, et tourne aussi sur Windows, macOS, Chrome et mobile. L'essai gratuit couvre 30 minutes d'enregistrement, l'offre Pro coûte $8.49 par mois, et il existe une licence à vie à $260. Les étudiants et les personnes en situation de handicap bénéficient de 20 % de remise.

La limite, dite franchement : il n'y a pas de mode hors ligne. La reconnaissance passe par l'infrastructure de Groq, donc l'audio quitte votre machine à chaque fois. Voicy affirme qu'il est supprimé juste après traitement et jamais utilisé pour l'entraînement, ce qui est une politique raisonnable et reste autre chose qu'un traitement local.

Voir Voicy

Voibe

À citer pour une fonction que les autres n'ont pas : un mode développeur qui résout les identifiants prononcés contre votre espace de travail réel, si bien que « auth middleware point t s » ressort en authMiddleware.ts et non en mots. C'est le défaut le plus agaçant de la dictée dans un éditeur, réglé directement. $7.50 par mois, $59 par an, ou $149 une fois, sur Mac et Windows.

Une correction qui circule mal ailleurs : Voibe fonctionne intégralement sur l'appareil en Apple Silicon, mais sous Windows il tourne en mode cloud sans rétention, selon sa propre FAQ. L'absence de rétention est une politique qui a du sens. Ce n'est pas la même chose que de l'audio qui ne sort jamais de la pièce.

Si le code n'a pas le droit de quitter la machine

C'est la question qui sépare une installation de loisir d'une installation utilisable au travail, et le marketing de cette catégorie l'embrouille délibérément. Deux choses sont confondues : où l'audio est traité, et ce que le vendeur promet d'en faire ensuite. Seule la première est un fait technique.

L'audio ne quitte jamais votre ordinateur : VS Code Speech, Handy, VoiceInk sur Apple Silicon, Superwhisper en modèles locaux, Voibe sur Apple Silicon, Talon.

L'audio part vers un serveur : Claude Code /voice, la voix de Cursor, la voix de Warp, Wispr Flow, Voicy, Voibe sous Windows, Superwhisper en modèles cloud.

Notez où se situe Claude Code, et notez l'effet de second ordre : /voice n'est pas disponible sur Bedrock, sur l'Agent Platform de Google Cloud ni sur Microsoft Foundry, qui sont précisément les déploiements que choisissent les entreprises réglementées. Si votre employeur a mis Claude Code derrière Bedrock pour des raisons de conformité, le microphone intégré n'est pas une option à négocier, puisqu'il n'apparaîtra pas.

Pour ce lecteur, la recommandation ne coûte rien : Handy si vous voulez du multiplateforme et du gratuit, VS Code Speech si vous vivez dans un seul éditeur, VoiceInk si vous êtes sur un Mac Apple Silicon et préférez payer une fois pour quelque chose de plus abouti. Vérifiez quand même auprès de la personne qui détient votre politique de sécurité, parce que « tourne en local » est une affirmation à contrôler et non à hériter d'une page comme celle-ci.

Talon et Cursorless : l'autre sport

Si vous êtes ici à cause de vos mains, rien de ce qui précède n'est votre réponse. La dictée écrit des mots. Elle ne déplace pas un curseur, ne sélectionne pas le troisième argument et ne refactorise rien.

Talon est un système de saisie sans les mains : commandes vocales, contrôle par bruit (un sifflement ou un « pop » devient un clic), suivi oculaire, et scripts Python pour définir ce que vous voulez. Il tourne hors ligne sur son propre moteur de reconnaissance, sous macOS, Windows et Linux avec X11, et il est gratuit, avec un palier Patreon pour les versions bêta. Regardez les numéros de version avant de vous lancer : la version publique est la 0.4.0, datée du 24 juillet 2023 dans le changelog de Talon. C'est sur le canal bêta que se trouve le travail récent, dont un moteur Whisper hybride, un « mode mixte » qui accepte simultanément commandes et dictée, et le modèle Conformer D auquel le changelog attribue environ 20 % de précision en plus. Le développement est bien vivant ; le téléchargement stable ne le montre simplement pas.

Cursorless est la couche qui rend l'édition structurelle plutôt que positionnelle. Elle peint un « chapeau » coloré sur un caractère de chaque token visible, et vous adressez le code par ces chapeaux : "chuck bat" supprime le token dont le chapeau se pose sur ce b. C'est une extension VS Code pilotée par Talon, sous licence MIT, 1 335 étoiles, et elle recevait encore un commit le 26 août 2026. Le jeu de commandes communautaire talonhub/community, celui que la plupart des gens font tourner par-dessus Talon, a été modifié pour la dernière fois le 24 août 2026. Les deux projets se portent bien.

Ne laissez personne vous vendre cela comme une victoire rapide. Vous apprenez une langue parlée pour éditer du texte, et le bénéfice arrive en semaines plutôt qu'en heures. Le récit le plus lu sur le sujet, Cursorless is alien magic from the future de Xe Iaso, a atteint la une de Hacker News le 10 novembre 2023 avec 790 points et 337 commentaires, et lire ce fil est le moyen le plus rapide de se calibrer : la conversation porte presque entièrement sur les TMS, les tendinites et le fait de rester employable, et à peine sur la vitesse. Voilà à qui cela s'adresse.

Serenade figure encore dans les listes d'outils de programmation à la voix. Son site est debout et son bouton de téléchargement fonctionne, mais le dépôt GitHub n'a plus reçu de push depuis le 11 juin 2024. Considérez-le comme non maintenu tant que cela ne change pas.

Dicter pour obtenir un résultat exploitable

Les habitudes ci-dessous découlent de la forme du problème plutôt que d'un outil particulier, et elles valent autant pour /voice que pour Cursor ou pour une application système.

Dites l'intention, pas la syntaxe. « Pagine la table des utilisateurs, vingt par page, côté serveur » vaut mieux que de raconter une boucle for. L'agent est meilleur en syntaxe que votre microphone, et chaque symbole que vous essayez de prononcer est une occasion de se tromper.

Dix à trente mots par salve, puis une pause. Les longs monologues d'un seul tenant se dégradent, et les salves trop courtes perdent le contexte qui permet à la transcription de tomber juste.

Laissez l'outil résoudre les noms, et vérifiez ceux qu'il ne peut pas résoudre. Claude Code transmet au moteur les noms de votre projet et de votre branche ; Voibe confronte les identifiants prononcés à l'espace de travail ; Wispr Flow apprend le jargon à l'usage. Aucun ne trouvera de façon fiable le nom de famille d'un collègue ou le nom de code d'un service interne, alors jetez un œil à la consigne avant de l'envoyer.

Attendez avant d'activer l'envoi automatique, le temps de faire confiance à ce qui revient. Envoyer d'office à partir de trois mots est pratique, jusqu'à la seconde où une phrase à moitié entendue déclenche une exécution que vous ne vouliez pas et où vous passez deux minutes à l'arrêter.

Enfin, gardez le clavier sous la main. Toute bonne implémentation permet de mélanger les deux dans un même message : les chemins de fichiers, les options et les expressions régulières se tapent plus vite, et il n'y a aucun prix à gagner pour la pureté.

Comment nous avons vérifié, et ce que nous n'avons pas vérifié

Aucun test de précision n'a été réalisé pour cet article, et nous n'allons pas laisser croire le contraire. Lisez les pages actuellement bien classées sur ces requêtes et vous trouverez des chiffres assurés, « environ 98 % de précision », « 200 ms contre 700 ms », « 97,3 % sur le benchmark AISpeak », publiés par des entreprises qui vendent l'outil arrivé premier dans leur propre comparatif, sans enregistrement, sans script et sans donnée brute.

Ce que nous avons fait à la place, le 27 août 2026, c'est vérifier à la source ce qui peut l'être.

Trois points que nous n'avons pas pu vérifier et que nous signalons au lieu de les enjoliver. Les affirmations des vendeurs sur la précision et la latence relèvent du marketing, elles sont rapportées comme telles et non reprises à notre compte. Cursor ne documente ni le lieu de sa transcription ni son prestataire, donc la ligne du tableau dit « non documenté » plutôt que de deviner. Et Reddit n'est pas accessible depuis notre environnement de recherche, si bien que l'opinion de la communauté citée ici vient de sources cliquables : un fil Hacker News daté et le forum public de Cursor.

Les outils regardés et écartés

Aqua Voice, Willow Voice, Spokenly, Vibe Typer, VoiceDash et le reste de la bande « blog d'abord ». Ce sont de vrais produits avec de vrais utilisateurs, et leur machine à contenu explique pourquoi ce sujet est difficile à documenter : chacun publie un guide qui présente les fonctions intégrées comme un problème et son propre téléchargement comme la solution. Certains sont sûrement bons. Nous ne les avons pas testés et nous ne classerons pas ce que nous n'avons pas vérifié.

Les serveurs MCP vocaux comme mcp-voice-hooks. C'est astucieux, et cela permet à un agent de vous parler au lieu de seulement écouter. C'est aussi une pièce mobile de plus dans votre configuration d'agent pour un travail qu'un raccourci clavier fait déjà. À regarder si vous voulez une conversation dans les deux sens, pas si vous voulez des consignes plus rapides.

Ski, freeflow, Yap et la vague hebdomadaire des Show HN. De nouveaux outils de dictée locale sortent sur Hacker News au rythme d'environ un par semaine en ce moment, la plupart gratuits et hors ligne. Si vous aimez arriver tôt, c'est le flux à suivre. Handy est celui qui a déjà accumulé les utilisateurs, les versions et l'empaquetage.

Dragon Professional. Toujours la référence pour corriger et mettre en forme à la voix, toujours Windows uniquement, toujours autour de $699 chez les revendeurs, et sa distribution grand public a été démontée : ce qui est arrivé à Dragon. Il n'a jamais été conçu pour les éditeurs ni pour les terminaux.

La dictée système de macOS et de Windows. Gratuite, déjà installée, très bien pour une phrase dans un champ de texte. Toutes deux s'écroulent sur le vocabulaire technique, qui est tout le contenu de la parole d'un développeur.

Et maintenant

Consacrez cinq minutes à ce que vous avez déjà : /voice dans Claude Code, Ctrl+M dans Cursor, Ctrl+I dans VS Code. Si la seule chose qui vous agace est d'avoir un microphone différent par fenêtre, c'est exactement le problème que résout une couche système, et vous pouvez trancher avec l'offre gratuite de Wispr Flow avant de payer quoi que ce soit. Si votre code ne peut pas quitter la machine, installez plutôt Handy, ou VoiceInk si vous êtes sur un Mac Apple Silicon et voulez quelque chose de plus abouti pour $29 une fois. Et si vous êtes ici parce que taper fait mal, rien de tout cela n'est votre réponse : commencez par Talon et Cursorless, et donnez-vous des semaines.

Questions fréquentes

Claude Code a-t-il une saisie vocale ?

Oui. Lancez /voice dans la CLI pour activer la dictée, puis maintenez la barre d'espace pour parler, ou utilisez /voice tap pour l'enregistrement par frappe. Cela fonctionne dans le terminal et dans l'extension VS Code de Claude Code. Un compte Claude.ai est nécessaire, cela ne marche ni par SSH ni sur le web, et la transcription ne consomme pas de tokens.

Pourquoi /voice n'apparaît-il pas dans mon Claude Code ?

Presque à coup sûr, c'est votre mode d'authentification. La dictée vocale n'est pas disponible quand Claude Code utilise directement une clé d'API Anthropic, Amazon Bedrock, l'Agent Platform de Google Cloud ou Microsoft Foundry. Les commandes indisponibles pour votre configuration sont masquées plutôt qu'affichées. Une règle d'organisation peut aussi la désactiver, auquel cas /voice vous le dit.

La saisie vocale de Claude Code consomme-t-elle des tokens ?

Non. La documentation d'Anthropic indique que la transcription ne consomme ni messages Claude ni tokens et ne compte pas dans les limites affichées par /usage.

Comment dicter dans Cursor ?

Maintenez Ctrl+M dans la zone de discussion. La voix est arrivée dans Cursor 2.0 le 29 octobre 2025 et a été reconstruite dans Cursor 3.1 le 13 avril 2026, avec l'ajout de la forme d'onde, du minuteur et des contrôles d'annulation, et le passage à la transcription de l'extrait entier d'un coup. Cela n'atteint que la zone de discussion, ni Cmd+K, ni l'éditeur, ni le terminal intégré.

Peut-on dicter dans le terminal ?

Warp a la voix intégrée. Tous les autres terminaux ont besoin d'une application de dictée système qui écrit dans la fenêtre active : Wispr Flow, Superwhisper, Handy, Voicy ou VoiceInk feront l'affaire. Si vous faites tourner un agent en ligne de commande dans le panneau terminal de votre éditeur, c'est la seule approche qui l'atteigne.

Existe-t-il une saisie vocale gratuite pour les développeurs ?

Plusieurs. Le /voice de Claude Code est compris dans une offre Claude.ai, la dictée de VS Code est gratuite et tourne sur votre machine, le microphone de Cursor est compris dans Cursor, Handy est gratuit et open source sur les trois plateformes de bureau, Superwhisper a désormais une offre gratuite permanente, et Talon est en téléchargement libre.

Que puis-je utiliser si mon code est sous NDA ?

Tout ce qui transcrit en local : l'extension VS Code Speech, Handy, VoiceInk ou Superwhisper en modèles locaux, Voibe sur Apple Silicon, ou Talon. Claude Code, Cursor, Warp, Wispr Flow et Voicy envoient tous l'audio à un serveur, quelle que soit leur politique de conservation.

Peut-on vraiment écrire du code à la voix, et pas seulement des consignes ?

Oui, avec Talon et Cursorless, et cela relève de l'apprentissage plutôt que de l'installation. Cursorless marque chaque token visible d'un chapeau coloré et vous éditez en les nommant, ce qui rend l'édition structurelle possible sans clavier. Comptez des semaines avant que cela devienne naturel. La plupart de ceux qui y arrivent ont été poussés par les TMS plutôt qu'attirés par la vitesse.

Talon est-il encore maintenu ?

Oui, même si la page de téléchargement le cache. La version publique est la 0.4.0 de juillet 2023, tandis que le développement actif se déroule sur le canal bêta Patreon, qui porte actuellement un moteur Whisper hybride et un mode mixte commandes et dictée. Le jeu de commandes communautaire sur GitHub a été mis à jour le 24 août 2026.

La dictée est-elle vraiment plus rapide que le clavier pour un développeur ?

Pour les consignes, oui en général : la parole mesurée à 153 mots par minute contre 52 pour un dactylo moyen, soit environ trois contre un. Pour du code, non, et personne de sérieux ne prétend l'inverse. Si vous tapez à plus de 80 mots par minute, l'argument de la vitesse s'évapore, et les raisons qui restent sont vos poignets et le fait qu'une consigne plus longue ne vous coûte rien à produire.

Et GitHub Copilot ?

Copilot Chat est l'une des surfaces où la dictée de VS Code écrit. Appuyez sur Ctrl+I pour parler dans la discussion, ou dites « Hey Code » si l'activation par mot-clé est active. Il n'y a pas de produit vocal Copilot séparé à installer.

Commentaires

Pas encore de commentaires. Posez une question ou dites-nous ce qui a marché pour vous.

Laisser un commentaire

Les commentaires sont vérifiés avant publication, généralement sous 24 heures.