Dictée vocale gratuite et 100 % locale : je ne paie plus 15 €/mois pour dicter

dictee-vocale-gratuite-locale-handy

Lecture : 8 min

Oui, tu peux dicter au lieu de taper, gratuitement, et sans qu’aucune de tes données ne quitte ton ordinateur. La dictée vocale gratuite existe vraiment, et elle tourne autour du même moteur que les outils à 15 €/mois.

Ce moteur s’appelle Whisper. Il a été rendu public par OpenAI, et il est gratuit. Ce que tu payes avec un abonnement, c’est juste l’emballage autour.

L’outil que je te conseille s’appelle Handy. Il est gratuit, son code est public, et il fonctionne 100 % en local : ta voix reste sur ta machine, rien ne part sur un serveur.

Et parler va deux à trois fois plus vite que taper. Sur mon propre suivi de trois mois et demi, ça représente plus de 100 heures gagnées par an, soit trois semaines de travail. Dans cet article, je te montre comment l’installer en cinq minutes, et je te donne un réglage caché qui change vraiment la qualité quand tu dictes des noms propres ou du jargon.

Tu préfères regarder plutôt que lire ? La démo complète est dans la vidéo.

Pourquoi dicter au lieu de taper

Si tu es créateur de contenu ou solopreneur sur le web, ton métier principal, c’est d’écrire. Des posts, des emails, des messages, des idées, des instructions. Toute la journée.

Et taper au clavier, c’est lent. Tu écris deux à trois fois plus lentement que tu ne parles.

Ce n’est pas juste une impression, c’est physique. En conversation, on parle autour de 150 mots par minute (le chiffre du National Center for Voice and Speech). Au clavier, on tape en moyenne autour de 40 mots par minute. Et quand tu composes tes propres phrases, au lieu de recopier un texte, tu descends encore plus bas.

C’est un écart énorme, et il joue tous les jours, sur tout ce que tu produis.

Aujourd’hui, la dictée vocale existe et elle marche bien. De nombreux outils se sont développés avec l’arrivée de l’intelligence artificielle. Le souci, c’est ce qu’ils te demandent en échange.

Le vrai problème des outils de dictée payants

Deux choses coincent avec ces outils. Le prix d’abord. Au minimum 15 € par mois, soit 180 € par an à ajouter à tes dépenses.

Et surtout, ce qui se passe avec tes données.

Sur l’un des outils les plus connus, Wispr Flow, une option appelée « Context Awareness » est activée par défaut. D’après leur propre documentation, elle « lit une quantité limitée de texte près de ton curseur et identifie ton application active ». Puis elle envoie ce contenu, y compris une capture d’écran de ta fenêtre, sur leurs serveurs à chaque dictée. C’est activé par défaut sur Mac et sur Windows.

Moi, je l’ai utilisé pendant trois mois et demi sans savoir que cette option faisait ça.

Tu peux la désactiver, il existe un mode privé. Mais avec tout ce qui sort en ce moment sur du texte qui part vers des serveurs aux États-Unis, c’est quelque chose que je préfère éviter.

Le même moteur gratuit derrière tous ces outils

Ce que personne ne te dit, c’est que tous ces outils fonctionnent autour du même cœur.

Ce cœur, c’est un modèle de reconnaissance vocale qui s’appelle Whisper. Il a été créé par OpenAI, qui l’a rendu public et gratuit sous licence libre en septembre 2022. Il a été entraîné sur 680 000 heures d’audio et il gère plus de 90 langues.

C’est ce moteur qui a fait naître tous les outils de dictée qu’on voit apparaître depuis deux ans.

Donc ce que tu payes, ce n’est pas le fonctionnement principal. C’est l’emballage autour. Et récemment, un emballage gratuit est arrivé, dont le code est public et qui garde toutes les données sur ta machine.

Comparatif de plusieurs outils de dictée vocale posés sur le même moteur gratuit Whisper : SuperWhisper, FastDictate, Wispr Flow et Handy, avec Handy en 100 % local et gratuit
Tous ces outils tournent autour de Whisper, le moteur gratuit d’OpenAI. Ce que tu payes, c’est l’emballage.

Handy : la dictée vocale gratuite et 100 % locale

Cet emballage gratuit, c’est Handy.

Handy se décrit lui-même comme « une application de reconnaissance vocale libre, open source et extensible, qui fonctionne entièrement hors ligne ». Sa promesse est claire : « ta voix reste sur ton ordinateur, tu obtiens tes transcriptions sans envoyer d’audio dans le cloud ».

Le code est sous licence MIT, c’est-à-dire public et libre. Et à l’intérieur, il utilise justement les modèles Whisper.

Pas de compte. Pas de carte bancaire. Pas d’abonnement. Tu télécharges, tu installes, ça marche sur ta machine.

Installer Handy en cinq minutes

Tu vas voir, ça prend cinq minutes.

Tu te rends sur le site handy.computer et tu télécharges le logiciel pour ta plateforme, Windows, Mac ou Linux. Tu le lances, tu vas dans l’onglet Modèle et tu télécharges un modèle. En français, celui que je te conseille, c’est Whisper Turbo. J’en ai testé pas mal, celui-là est très performant.

Ensuite, tu vas dans Général, tu choisis un raccourci pour démarrer et arrêter la transcription, et surtout tu choisis ta langue, le français.

Et voilà. Tu places ton curseur là où tu veux écrire, tu appuies sur ton raccourci, tu parles, tu réappuies. Ton texte s’écrit tout seul, avec la ponctuation. Moi, je suis quasiment toute la journée là-dessus dans Claude Code, et ça marche très bien.

Le réglage caché qui rend le dictionnaire vraiment bon

Il y a un réglage à faire si tu utilises des mots techniques, du jargon, des noms propres ou des noms de clients.

D’abord, le dictionnaire. Il est dans l’onglet Avancé de Handy, dans une section appelée « mots personnalisés ». Petit à petit, tu repères les mots mal transcrits et tu les ajoutes. Par exemple, si je n’ajoute pas Libreneur ou Claude Code, je peux être sûr que ça va être mal écrit.

Mais il y a une subtilité, et c’est le réglage que presque personne ne connaît. Il n’est pas dans l’interface de Handy. Il faut aller le modifier à la main dans un fichier de configuration.

Ce fichier s’appelle settings_store.json. Sur Windows, tu le trouves dans le dossier AppData\Roaming\com.pais.handy (le chemin complet, c’est C:\Users\ton-nom\AppData\Roaming\com.pais.handy\settings_store.json). Sur Mac ou Linux, c’est le même fichier settings_store.json, rangé dans le dossier de configuration de Handy.

Ouvre ce fichier et cherche le réglage qui s’appelle word_correction_threshold. Par défaut, sa valeur est 0.18, une limite de correction un peu stricte. Remplace-la par 0.35.

Une chose importante : pour que ça marche, tu dois d’abord fermer complètement Handy. Tu le quittes, tu ouvres le fichier, tu changes 0.18 en 0.35, tu enregistres, et seulement après tu relances Handy.

Pourquoi ce réglage ? Parce que quand tu dictes toute la journée en étant concentré sur autre chose, ton élocution baisse. Tu fais des petites erreurs de prononciation. Avec la limite à 0.35, l’outil retrouve quand même les bons mots dans 90 % des cas ou plus. Tes noms propres et ton jargon ressortent corrects.

La preuve que c’est 100 % local : ça marche sans Internet

Le meilleur test, c’est de couper Internet.

Je l’ai fait. Je débranche mon câble Ethernet, l’icône réseau se coupe, plus d’accès. Et là, je dicte quand même. La transcription est toujours aussi rapide et aussi précise. Ça tourne 100 % en local, sans passer par un serveur à l’étranger.

Ta voix entre dans ton ordinateur sous une bulle de protection et n'en sort pas, le lien vers un serveur cloud distant est coupé
Ta voix et ton texte restent sur ta machine. Le lien vers le cloud est coupé.

Comme le code est public, je l’ai aussi fait analyser. À part une vérification de mise à jour au démarrage du logiciel, rien ne sort de ta machine. Ni ton texte, ni tes données.

L’échelle de confidentialité de tes données

Pour t’y retrouver, imagine une échelle.

En bas, tu as les outils américains ou étrangers, comme Wispr Flow, qui font transiter tes données par leurs serveurs. Au milieu, les outils hébergés en Europe ou en France, qui respectent un peu plus le RGPD mais font quand même sortir ton texte de ta machine. Et tout en haut, ce genre d’outil comme Handy, qui reste 100 % local, chez toi.

Si tu manipules des données clients ou des données de santé, ça change tout. Là, il vaut mieux utiliser un outil qui ne fonctionne que sur ta machine, en local, même sans Internet.

Le post-traitement par IA, et pourquoi je l’évite

Les outils en ligne ont souvent une fonction en plus, qu’ils appellent le post-traitement. Handy la propose aussi.

L’idée : quand tu parles trop vite, la ponctuation saute et la mise en forme n’est pas parfaite. Le post-traitement fait passer ton texte par une intelligence artificielle, en local ou en externe, pour le remettre en forme.

J’ai testé une IA en local. Deux problèmes. D’abord, ça consomme beaucoup de ressources sur ta machine. Ensuite, les performances sont vraiment moyennes, et surtout elle inventait des tournures de phrases que je n’avais pas dites.

Ça, c’est exactement ce que je ne veux pas. Quand tu écris, l’idée est de garder ta voix, pas de laisser une IA réécrire tes mots.

L’autre option, c’est de passer par une API externe plus performante. Mais on retombe alors dans le souci des données qui circulent ailleurs. Moi, j’ai choisi de tout faire en local, et je trouve que ça fait vraiment le job.

Mon retour après quatre mois : plus de 100 heures par an

J’utilise la dictée vocale depuis quatre mois, avec des chiffres précis sur trois mois et demi.

Sur cette durée, j’ai dicté plus de 282 000 mots. Ça représente un gain d’environ 2h30 par semaine, soit 34 heures sur trois mois et demi, et à peu près 100 heures sur l’année. À la fin de l’année, ça fait trois semaines de travail gagnées.

Bilan chiffré de mon usage de la dictée vocale : 282 251 mots dictés, environ 34 heures gagnées en trois mois et demi, soit près de 100 heures par an
Mon suivi réel sur trois mois et demi. Le gain dépend surtout de ta vitesse de frappe.

Et je tape déjà assez vite, autour de 70 mots par minute. Les sites des outils payants affichent des chiffres bien plus impressionnants, mais un gros gain suppose que tu tapes lentement au départ. Plus tu tapes vite, plus l’écart avec la parole se réduit. Donc plus tu tapes lentement, plus le gain est grand pour toi.

Il y a aussi le côté santé. J’ai deux hernies cervicales depuis longtemps. Quand je tapais beaucoup, j’avais des douleurs et des fourmillements dans la main en fin de journée. Depuis que je suis passé à la dictée, je n’ai plus rien de tout ça. Si tu as des soucis de posture ou de tendinite, ça peut vraiment aider.

Dernière observation. Quand j’étais sur un outil en ligne, j’avais souvent des ralentissements, ou des moments où ça ne marchait plus, parce que les serveurs des IA sont régulièrement dépassés par la demande. Le passage en local a complètement éradiqué ça. C’est toujours rapide, et les mots sont plus précis.

Franchement, pour une transition vers un outil gratuit, je suis assez bluffé.

Je t’ai aussi préparé un petit calculateur pour estimer le temps que tu gagnerais toi, selon ta vitesse de frappe. Il est gratuit dans ma communauté, la tribu des Libreneurs.

Rejoindre la tribu des Libreneurs

Tu y trouveras le calculateur de temps gagné, gratuit, plus le reste de mes outils pour créer sans y passer ta vie.

Questions fréquentes

Handy est-il vraiment gratuit ?

Oui. Handy est gratuit et son code est open source, sous licence MIT. Pas de compte, pas de carte bancaire, pas d’abonnement. Tu télécharges le logiciel et tu l’utilises sans limite.

Mes données partent-elles quelque part avec Handy ?

Non. Handy fonctionne 100 % en local. Ta voix et ton texte restent sur ton ordinateur. La seule chose qui sort, c’est une vérification de mise à jour du logiciel au démarrage. Tu peux même l’utiliser sans aucune connexion Internet.

Quel modèle choisir pour dicter en français ?

Whisper Turbo. C’est celui que je conseille après en avoir testé plusieurs. Il est rapide et précis en français. Tu le télécharges directement depuis l’onglet Modèle de Handy.

Handy ou Wispr Flow, quelle différence ?

Wispr Flow est un outil en ligne, payant, dont une option, activée par défaut selon leur documentation, lit ta fenêtre active et envoie ces données sur leurs serveurs. Handy est gratuit, open source et 100 % local : rien ne sort de ta machine. Les deux utilisent le même type de moteur, Whisper.

La dictée vocale est-elle vraiment plus rapide que taper ?

Oui. En conversation, on parle autour de 150 mots par minute, alors qu’on tape en moyenne autour de 40 mots par minute, encore moins quand on compose ses propres phrases. Sur mon propre usage, ça représente environ 100 heures gagnées par an.

Handy marche-t-il sur Mac, Windows et Linux ?

Oui. Handy est disponible pour les trois plateformes. Tu télécharges la version correspondant à ton système sur handy.computer.

Pour résumer

  • Tu peux dicter au lieu de taper, gratuitement, avec le même moteur (Whisper) que les outils payants.
  • Handy est gratuit, open source et 100 % local : aucune donnée ne quitte ton ordinateur.
  • Pense au réglage caché du dictionnaire, la limite de correction à 0,35, pour bien gérer tes noms propres et ton jargon.
  • Sur mon suivi, la dictée vocale gratuite représente plus de 100 heures gagnées par an, plus un vrai confort côté santé.

C’est une belle découverte, et je n’ai rien à y gagner à t’en parler. C’est gratuit, le code est public. Teste ça, et dis-moi combien de temps tu arrives à gagner.

Récupérer le calculateur gratuit

Marc-Antoine Richard

Marc-Antoine Richard, fondateur de Libreneur. Écologue de formation devenu expert web, il teste depuis 2014 les outils, l'automatisation et l'IA pour aider les solopreneurs à créer du contenu sans y laisser leur temps ni leur énergie. Il partage ses méthodes sur YouTube et dans la Tribu des Libreneurs.

Laissez un Commentaire ci-dessous

D'AUTRES ARTICLES QUI POURRAIENT VOUS INTÉRESSER

Laissez un commentaire