Comparer
Les programmes auxquels on nous compare le plus souvent, dans un seul tableau. Honnêtement, y compris là où nous perdons. Prix et fonctions tels que chaque éditeur les publie.
| HoldToType | Handy | Wispr Flow | Dragon | Whisper Flow | DictaFlow | Typeless | |
|---|---|---|---|---|---|---|---|
| Versions signées | Pas encore | Oui | Oui | Oui | Oui | Oui | Oui |
| Prix | Gratuit | Gratuit | 12 $ / mois | 699 $ une fois | Dès 9 $ / mois | 7 $ / mois | 12 $ / mois |
| Abonnement ou crédits | Aucun | Aucun | Abonnement | Licence unique | Crédits | Abonnement | Abonnement |
| Compte | Aucun | Aucun | Obligatoire | Obligatoire | Obligatoire | Obligatoire | Obligatoire |
| L'audio quitte votre ordinateur | Non | Non | Oui | Non | Oui | Oui | Oui |
| Fonctionne hors ligne | Oui | Oui | Non | Oui | Non | Option payante | Non |
| Open source | MIT | MIT | Non | Non | Non | Non | Non |
| Langues | 99 | 99 | 100+ | 7 | 100+ | 90+ | 100+ |
| Texte en direct pendant la parole | Oui | Non | Non | Oui | Non | Non | Oui |
| Traduction | 7 langues | Non | Non | Non | Non | Non | Oui |
| Correction par un modèle local | Oui | Non | Cloud | Non | Cloud | Cloud | Cloud |
| Choix du modèle de reconnaissance | 9 modèles, un par langue | Tailles de Whisper et Parakeet | Non, le leur | Non, le leur | Non, le leur | Non, le leur | Non, le leur |
| Vos propres modèles de reconnaissance | Tout fichier Whisper GGML ou modèle sherpa-onnx déposé dans le dossier models | — | Non | Non | Non | Non | Non |
| Modèles qui affichent le texte pendant la parole | Nemotron 3.5 | Non | Non | Son propre moteur | Non | Non | Son propre moteur |
| Post-traitement par un modèle | Oui | Non | Oui | Non | Oui | Oui | Oui |
| Où tourne le post-traitement | Sur votre disque, ou un serveur de votre choix | — | Leur cloud | — | Leur cloud | Leur cloud | Leur cloud |
| Choix du modèle éditeur | Tout GGUF de Hugging Face, ou toute API | Non | Non | Non | Non | Non | Non |
| Vos propres prompts | Oui, en chaînes, chacune avec un raccourci | Non | Styles intégrés | Non | — | — | Corrections intégrées |
| Serveur de reconnaissance sur un autre ordinateur | Oui | Non | Non | Non | Non | Non | Non |
| Commandes vocales que vous définissez | Oui | Non | Intégrées seulement | Oui | — | — | Intégrées seulement |
| Où est gardé l'historique des dictées | Sur votre disque, désactivé par défaut | Sur votre disque | Leurs serveurs | — | Leurs serveurs | Leurs serveurs | Leurs serveurs, option sur l'appareil |
| Langues de l'interface | 8 | — | Anglais | Plusieurs | — | — | — |
| Vocabulaire personnalisé | Oui | Non | Oui | Oui | Oui | Oui | Oui |
| Dossier portable | Oui | Non | Non | Non | Non | Non | Non |
Prix et fonctions tels que publiés par chaque éditeur en septembre 2026. Un tiret signifie que l'éditeur ne le dit pas.
Pas de Mac et pas de téléphone. Les versions ne sont pas encore signées, donc Windows avertit une fois. Pas de synchronisation cloud entre vos ordinateurs : réglages et historique vivent dans le dossier, et c'est vous qui les copiez.
La précision sur la parole courante est proche partout : les mêmes modèles ouverts se trouvent sous la plupart de ces programmes. Le vocabulaire personnalisé est courant. Les payants livrent une prise en main soignée qu'un projet d'une seule personne ne peut égaler.
Rien à payer et rien où s'inscrire. L'audio ne quitte jamais l'ordinateur. Le code est ouvert sous MIT. Un modèle par langue, du texte en direct pendant que vous parlez, la traduction vers sept langues, un modèle éditeur qui tourne sur votre disque, et un dossier portable à emporter sur une clé.
La saisie vocale de Windows, l'outil intégré derrière Win+H, est gratuite et ne demande aucune installation, mais pour la plupart des langues elle envoie l'audio à Microsoft et n'a pas de dictionnaire pour vos propres mots. Les programmes réservés au Mac comme VoiceInk, FluidVoice ou HoldType, celui au nom proche, sont laissés de côté parce que HoldToType est pour Windows. Vibe et les autres transcripteurs de fichiers font un autre travail : ils transcrivent des enregistrements, pas ce que vous dites au curseur.