Sommaire11 parties
Handy est une application de bureau gratuite et open source qui transcrit ta voix en texte, sans envoyer d’audio dans le cloud. Tu appuies sur un raccourci, tu parles, et le texte est collé dans le champ de l’application que tu utilises. Elle fonctionne sur Windows, macOS et Linux, avec les modèles Whisper ou Parakeet V3.
En bref
- Dicter du texte dans n’importe quel champ, avec un raccourci clavier
- Transcription locale : la voix reste sur l’ordinateur
- Modèles Whisper (Small, Medium, Turbo, Large) ou Parakeet V3
- Windows, macOS et Linux, sous licence MIT
- Version v0.9.8 publiée le 3 octobre 2026
Qu’est-ce que Handy ?
Handy est une application de dictée vocale pour ordinateur. Son principe tient en une phrase : tu prononces un texte, et il apparaît dans la zone de saisie où tu écris, que ce soit un traitement de texte, un navigateur ou une messagerie. Le projet est écrit par cjpais et publié sous licence MIT.
Son auteur le présente comme une réponse au manque d’outil de dictée vraiment ouvert et extensible. Le site du projet résume sa philosophie en quatre mots : gratuit, open source, privé et simple. Selon lui, les outils d’accessibilité ne devraient pas se trouver derrière un abonnement, et ta voix ne devrait pas quitter ta machine pour obtenir une transcription.
Comment fonctionne Handy
Tout commence par un raccourci clavier que tu choisis dans les réglages. Par défaut, le mode « push-to-talk » est activé : tu maintiens les touches enfoncées pour enregistrer et tu relâches pour arrêter. Tu peux aussi le désactiver pour qu’une première pression lance l’enregistrement et qu’une seconde l’arrête. Le README précise que des modes réservés à l’un ou à l’autre existent aussi.
Quand tu relâches, Handy traite ta parole avec Whisper, puis colle le texte dans l’application active. Tout se passe en local. Les silences sont d’abord retirés grâce à une détection d’activité vocale (VAD) fondée sur Silero, puis un modèle de transcription convertit l’audio en texte.
Les modèles de transcription proposés
Handy te laisse choisir le modèle qui fait la transcription. Le README en cite deux familles : les modèles Whisper, qui profitent de l’accélération par carte graphique quand elle est disponible, et Parakeet V3, décrit comme optimisé pour le processeur et capable de détecter la langue automatiquement.
Les tailles de téléchargement figurent dans la section dépannage du README, pour les personnes qui doivent installer les modèles à la main.
- Whisper Small : 487 Mo
- Whisper Medium : 492 Mo
- Whisper Turbo : 1600 Mo
- Whisper Large : 1100 Mo
- Parakeet Unified EN 0.6B, au format .gguf (Q8_0) : 731 Mo, indiqué comme recommandé dans le README
Installer Handy sur Windows, macOS et Linux
Le plus simple est de télécharger la dernière version sur la page des versions du dépôt ou sur le site du projet, puis de l’installer. Au premier lancement, Handy demande les autorisations système, notamment l’accès au micro et à l’accessibilité. Tu règles ensuite ton raccourci dans les paramètres. Le README signale que le paquet Homebrew et celui de winget ne sont pas maintenus par les développeurs de Handy.
Sous Debian ou Ubuntu, le README demande d’installer le fichier .deb avec APT pour que les dépendances arrivent automatiquement, et déconseille dpkg -i sauf si elles sont déjà présentes.
brew install --cask handy
winget install cjpais.Handy
sudo apt install ./Handy_*.deb
Piloter Handy en ligne de commande
Handy accepte des options de ligne de commande pour contrôler une instance déjà lancée ou personnaliser le démarrage. Le README qualifie cette fonction de largement en bêta. --toggle-transcription démarre ou arrête l’enregistrement, --toggle-post-process fait de même avec un post-traitement, et --cancel annule l’opération en cours.
Au démarrage, --start-hidden évite d’afficher la fenêtre principale et --no-tray masque l’icône de la zone de notification. Ces options se combinent, par exemple pour un lancement automatique à l’ouverture de session. Un raccourci personnalisé de ton environnement de bureau peut aussi appeler ces commandes, ce que le README décrit pour GNOME, KDE Plasma, Sway, i3 et Hyprland.
handy --toggle-transcription
handy --start-hidden --no-tray
Où en est le projet Handy
Le dépôt a été créé le 13 février 2025. Au relevé du 7 octobre 2026, il compte 33 101 étoiles, 3 080 copies, 176 contributeurs et 158 tickets et demandes de fusion ouverts. Le code est écrit à 61 % en Rust et à 29 % en TypeScript.
La dernière version, la v0.9.8, date du 3 octobre 2026 et se limite à des corrections : le modèle est déchargé après un enregistrement sans audio, l’enregistrement ne démarre plus si aucun modèle ne peut transcrire, et un sélecteur d’écriture chinoise a été ajouté. La v0.9.7 du 18 septembre 2026 a notamment corrigé la perte de la fin de l’audio, ajouté une implémentation expérimentale de détection vocale, ainsi que des traductions en catalan et en indonésien. La v0.9.6 du 24 août 2026 a, entre autres, rétabli le micro par défaut après une déconnexion.
Ce qu’il faut savoir avant de se lancer
Le projet se dit en développement actif et tient la liste de ses limites à jour. Sur Mac, les raccourcis qui utilisent la touche fn (Globe) ne fonctionnent qu’avec les claviers Apple, ce que le README décrit comme une limite matérielle. Un micro de casque Bluetooth peut aussi réduire la qualité ou le volume de lecture pendant l’enregistrement.
Sous Linux, la prise en charge de Wayland est limitée. Pour que le texte s’insère correctement, le README recommande xdotool sous X11 et wtype sous Wayland ; dotool fonctionne sur les deux et demande d’ajouter ton utilisateur au groupe input. Sans ces outils, Handy se rabat sur une bibliothèque dont la compatibilité peut être limitée. La fenêtre indiquant l’enregistrement est désactivée par défaut sur Linux, car elle peut voler le focus et empêcher le collage.
Si le texte collé est un ancien contenu du presse-papiers, le README renvoie vers le mode debug, accessible par Ctrl+Shift+D (Cmd+Shift+D sur macOS). Le projet ne donne pas de configuration matérielle minimale.
sudo apt install xdotool
sudo apt install wtype
Quelques repères
- Détection d’activité vocale : Technique qui repère, dans un enregistrement audio, les moments où quelqu’un parle et ceux où règne le silence. Elle permet de ne traiter que la parole.
- Accélération par carte graphique : Usage du processeur graphique d’un ordinateur pour effectuer certains calculs lourds plus vite que le processeur principal. Les logiciels d’intelligence artificielle s’en servent souvent pour gagner du temps.
Questions fréquentes
Handy fonctionne-t-il hors ligne ?
Oui, Handy traite ta voix sur ton ordinateur, sans envoyer d’audio au cloud. Si le réseau t’empêche de télécharger les modèles depuis l’application, le README prévoit une installation manuelle des fichiers.
Handy est-il gratuit ?
Oui, Handy est présenté comme gratuit et open source, sous licence MIT. Le projet indique que ses sponsors l’aident à rester gratuit.
Sur quels systèmes Handy fonctionne-t-il ?
Handy fonctionne sur Windows, macOS et Linux. Sous Linux, la prise en charge de Wayland est limitée et demande un outil de saisie comme wtype ou dotool.
Quels modèles de transcription Handy utilise-t-il ?
Handy propose les modèles Whisper (Small, Medium, Turbo, Large) et Parakeet V3. Les modèles Whisper peuvent profiter de la carte graphique, et Parakeet V3 est optimisé pour le processeur avec détection automatique de la langue.
À retenir
Handy transcrit ta voix en texte directement sur ton ordinateur, avec Whisper ou Parakeet V3, et colle le résultat dans l’application active. Le projet est sous licence MIT, en développement actif, et signale lui-même des limites sous Linux et sur Mac.
Sources
- cjpaisREADME
- handy.computerdocumentation officielle
- GitHubnotes de version






