Dictée vocale hors ligne, gratuite et open source pour Windows, macOS et Linux
Dictée vocale hors ligne, gratuite et open source pour Windows, macOS et Linux
Partager sur les réseaux
Murmure est une application de dictée vocale qui transforme la parole en texte et insère ce texte dans l’application active, quelle qu’elle soit : traitement de texte, messagerie, navigateur, logiciel métier. Sa particularité tient moins à ce qu’elle fait qu’à la façon dont elle le fait. La reconnaissance de la parole s’exécute intégralement sur l’ordinateur de l’utilisateur, sans connexion internet, sans compte, sans transmission d’audio vers un serveur. L’application est distribuée gratuitement sous licence libre AGPL v3.
Avant d’entrer dans le détail, une distinction mérite d’être posée, car elle commande l’essentiel des préconisations. La reconnaissance vocale se décline en deux usages distincts : la dictée vocale, qui convertit la parole en texte, et la commande vocale, qui pilote l’ordinateur (ouvrir une application, cliquer, corriger un mot, se déplacer dans un document). Murmure ne fait que de la dictée. Il ne remplace pas un accès à l’ordinateur : il suppose que la personne dispose déjà d’un moyen de placer le curseur dans un champ de saisie et de corriger ses erreurs. C’est un accélérateur de production écrite, pas une solution d’accès complète. Sur ce point, l’Accès vocal de Windows 11 et Dragon Professional couvrent un périmètre nettement plus large.
Le moteur de reconnaissance est le modèle Parakeet TDT 0.6B v3, publié par NVIDIA et exécutable sur processeur, sans carte graphique dédiée. Il prend en charge vingt-cinq langues européennes, dont le français, et détecte automatiquement la langue parlée. Ce choix technique explique à la fois les qualités de l’application — rapidité, fonctionnement hors ligne sur du matériel modeste — et ses limites, sur lesquelles nous reviendrons.
| Référence | Murmure, version 1.10.1 (août 2026) |
|---|---|
| Éditeur | Projet indépendant porté par un développeur individuel (pseudonyme Kieirra / Al1x-ai) |
| Téléchargement | www.murmure.app — documentation : docs.murmure.app — code source : github.com/Kieirra/murmure |
| Prix | Gratuit. Logiciel libre, GNU AGPL v3 |
Sous Windows, l’installation se fait par un fichier .msi ou un programme d’installation classique, ou en ligne de commande via WinGet. Elle requiert les droits administrateur et la présence du composant Microsoft Visual C++ Redistributable, déjà installé sur la plupart des machines. Quelques utilisateurs signalent des blocages par certains antivirus, à traiter par une exclusion. Sous macOS, l’application se glisse dans le dossier Applications, puis réclame les autorisations micro, accessibilité et surveillance de la saisie : ces permissions sont indispensables au fonctionnement, et un redémarrage de l’application est nécessaire pour qu’elles prennent effet. Sous Linux, l’installation par paquet Debian ou AppImage est simple, mais les environnements Wayland posent une difficulté réelle : sous GNOME, les raccourcis globaux ne fonctionnent pas nativement et doivent être configurés au niveau du système, le mode « appui maintenu » devenant alors indisponible.
En établissement, ces prérequis ne sont pas anodins : droits administrateur, autorisations d’accessibilité au niveau système et exclusions antivirus supposent une coopération du service informatique. Il existe une fonction d’import de configuration en ligne de commande, pensée pour un déploiement sur plusieurs postes, qui peut faciliter cette discussion.
Le principe d’usage est immédiat : on place le curseur dans un champ de saisie, on presse le raccourci (Ctrl+Espace par défaut), on parle, on relâche, le texte s’inscrit. Les paramètres système proposent deux modes de déclenchement : l’appui maintenu, où l’on garde la touche enfoncée pendant toute la dictée, et le mode bascule, où un premier appui démarre l’enregistrement et un second l’arrête. Cette distinction, anodine pour un utilisateur tout-venant, est déterminante en situation de handicap : le mode bascule divise par deux l’effort moteur et supprime la contrainte de maintien, qui est souvent le facteur limitant en cas de fatigabilité ou de faiblesse musculaire.

Le raccourci est entièrement reconfigurable et accepte notamment les boutons latéraux de souris, ce qui ouvre la voie à des adaptations : un contacteur relié à une interface qui émule une touche du clavier peut ainsi servir de déclencheur, à condition de choisir une combinaison compatible. La durée d’enregistrement est plafonnée à cinq minutes, et les énoncés de moins d’une seconde échouent régulièrement.
L’insertion du texte s’effectue par défaut en simulant un copier-coller, ce qui écrase le presse-papier et peut échouer dans certaines applications. Deux modes alternatifs existent, dont un mode « direct » qui simule la frappe caractère par caractère, plus lent mais plus universel. Un test préalable dans les applications réellement utilisées par la personne est indispensable, en particulier avec les logiciels métiers, les environnements protégés et les logiciels de CAA.
Enfin, l’historique des transcriptions se limite aux cinq dernières, conservées en mémoire vive et perdues à la fermeture. C’est un choix cohérent avec la promesse de confidentialité, mais une limite pratique : un long texte dicté puis mal inséré n’est pas récupérable après l’arrêt du logiciel.
Deux outils permettent d’ajuster le résultat. Le dictionnaire sert à corriger les noms propres et les termes spécifiques mal reconnus. Les règles de formatage, plus puissantes, appliquent des remplacements sur le texte transcrit, y compris par expressions régulières.
Un point mérite d’être souligné, car il est régulièrement source de malentendu : ces deux mécanismes agissent après la reconnaissance, sur le texte produit, et non sur le modèle acoustique. Ils corrigent une sortie, ils n’apprennent pas la voix de la personne. La feuille de route du projet mentionne d’ailleurs un projet d’amorçage du décodage par le dictionnaire, ce qui confirme que la version actuelle n’en dispose pas. Il n’existe donc ni profil utilisateur, ni phase d’apprentissage vocal, ni adaptation progressive au locuteur — là où Dragon construit et affine un profil au fil de l’usage.
Conséquence directe : la ponctuation. Murmure ne reconnaît pas nativement les commandes dictées du type « virgule », « point », « à la ligne », contrairement à la dictée d’iOS et Android ou à l’Accès vocal de Windows.
Néanmoins, le modèle Parakeet TDT de NVIDIA intègre de manière native la ponctuation automatique et l’utilisation des majuscules dans ses transcriptions. Une courte pause marquée pendant la dictée peut être interprétée par le modèle comme une virgule ou un point-virgule. Et à l’usage, cela s’avère beaucoup plus naturel que d’avoir à explicitement préciser le signe de ponctuation attendue… Sans compter sur le fait, que l’on ressemble alors à une institutrice en train de faire une dictée !

Pour ceux qui souhaiteraient malgré tout le faire, il est possible de reconstituer une ponctuation dictée à coups d’expressions régulières. La documentation en donne des exemples en français. Cependant la manipulation reste réservée à un utilisateur averti et n’est pas exempte d’effets de bord : dicter le mot « virgule » dans son sens ordinaire déclenchera aussi la règle. Pour la rédaction de textes longs et structurés, c’est une limite sérieuse, à mettre en balance avec la qualité de transcription du modèle.
Trois fonctions complémentaires méritent l’attention, chacune pour des raisons différentes.

Le mode vocal permet de déclencher la dictée par un mot d’éveil, sans aucune action motrice. C’est la fonction la plus intéressante pour notre public, puisqu’elle rend l’usage entièrement mains libres, avec des mots dédiés pour enregistrer, valider ou annuler. Elle reste toutefois annoncée comme expérimentale, consomme des ressources processeur en continu et suppose une articulation suffisamment stable pour que le mot d’éveil soit reconnu — précisément la condition qui fait défaut aux personnes pour lesquelles la commande manuelle est difficile. Cette fonction est à éprouver individuellement avant toute préconisation.
Le micro déporté transforme un smartphone en microphone sans fil, par simple lecture d’un QR code, sans installation sur le téléphone. Au-delà du micro, l’interface propose un pavé tactile pilotant le pointeur ainsi que des boutons Entrée et Retour arrière. Pour une personne alitée ou installée à distance de l’ordinateur, c’est un usage à explorer sérieusement, y compris pour le déclenchement de la dictée.

La connexion à un modèle de langage permet de post-traiter automatiquement le texte dicté : corriger la syntaxe, reformuler, traduire, ou transformer une sélection à la voix. La fonction est intéressante pour compenser une dysorthographie ou fluidifier un écrit télégraphique, mais elle appelle deux réserves.
D’abord technique : utiliser un modèle local requiert une machine équipée d’une carte graphique puissante et des compétences techniques certaines ; d’un autre côté, recourir à un modèle distant annule la garantie de traitement local qui fait tout l’intérêt de l’application.
Ensuite éthique, et elle nous concerne directement : plus la machine reformule, moins le texte produit appartient à la personne.
En communication alternative comme en rédaction assistée, la frontière entre aider quelqu’un à s’exprimer et parler à sa place est étroite, et le confort du résultat ne doit pas la faire oublier. Une option de relecture avant insertion figure au rang des évolutions envisagées ; elle serait bienvenue.
L’argument central du projet est le traitement intégralement local. En effet, l’audio est supprimé après transcription, aucun historique n’est écrit sur le disque, aucune télémétrie n’est transmise, aucun compte n’est requis. Pour un professionnel du médico-social qui dicte des comptes rendus, des bilans ou des notes nominatives, l’écart avec un service de transcription en ligne est considérable. Il est en effet de nature à débloquer des usages qu’un service cloud rendrait juridiquement délicats.
Ces affirmations sont vérifiables en droit, puisque le code est public sous licence AGPL, mais elles n’ont pas fait l’objet d’un audit indépendant. Vérifiable ne veut pas dire vérifié : dans les faits, l’utilisateur accorde sa confiance à un projet porté par une personne seule, comme il l’accorderait à un éditeur. La différence tient à ce que la promesse est ici structurellement contrôlable, et qu’une application fonctionnant hors ligne ne peut pas trahir discrètement cet engagement sans que le trafic réseau le révèle.
Murmure trouve sa place auprès d’une personne qui dispose déjà d’un accès fonctionnel à l’ordinateur — clavier, pointeur, contacteur — mais pour qui la saisie est lente, coûteuse en énergie ou douloureuse, et dont la parole est intelligible. Il s’adresse aussi aux utilisateurs de macOS et de Linux, pour lesquels l’offre de dictée hors ligne est pauvre, et aux professionnels contraints par la confidentialité de leurs écrits.
Face à l’Accès vocal de Windows 11, gratuit et natif, Murmure perd sur la commande vocale, la correction à la voix et la ponctuation dictée ; il gagne sur la portabilité entre systèmes, sur le nombre de langues et sur la maîtrise des données. Face à Dragon Professional, dont la licence reste onéreuse malgré le tarif réduit accordé aux personnes en situation de handicap, il ne joue pas dans la même catégorie fonctionnelle, mais son coût nul en fait un test grandeur nature utile avant tout engagement financier. Et finalement, face à la dictée intégrée d’iOS et d’Android, il ne concerne pas les mêmes supports.
Il ne conviendra pas à une personne qui a besoin de piloter entièrement son ordinateur à la voix, ni à une personne qui ne peut ni presser une touche ni prononcer un mot d’éveil de manière fiable. La question de la dysarthrie reste ouverte : le modèle a été entraîné sur des corpus de parole ordinaire, aucune donnée publique ne documente ses performances sur des voix atypiques, et l’absence d’adaptation au locuteur laisse peu de marge de rattrapage. Prudence donc, et essai systématique avec la personne concernée avant toute recommandation.
Enfin, comme toujours lorsqu’on évoque des applications de reconnaissance vocale, la qualité du microphone est le premier facteur de réussite, avant le choix du logiciel. La documentation du projet le dit sans détour : un micro médiocre dégrade la transcription et fait dériver la détection automatique de langue, un texte français se retrouvant transcrit en anglais. Les fiches consacrées aux microphones SpeechWare et au Micro Silence Privo restent pleinement pertinentes ici.
Murmure est un projet sobre et bien conçu, qui fait une chose et la fait bien : transcrire de la parole en texte, localement, gratuitement, sur trois systèmes d’exploitation, dans une langue française correctement prise en charge. Sa gratuité et l’absence de collecte de données en font une piste à essayer très tôt dans un accompagnement, avant d’envisager des solutions coûteuses.
Ses limites sont tout aussi nettes, et elles tiennent à son périmètre : pas de commande vocale, pas de correction à la voix, pas de ponctuation dictée sans configuration, pas d’adaptation à une voix atypique. Le déclenchement de la dictée reste le point de vigilance principal en situation de handicap moteur, et la réponse mains libres proposée par le mode vocal est, certes, fonctionnelle encore expérimentale.
Reste la question de la pérennité. Le projet repose sur un développeur unique, sans modèle économique, à un rythme de publication soutenu. C’est une fragilité, tempérée par deux garanties propres au logiciel libre : une version installée continue de fonctionner indéfiniment, puisqu’elle ne dépend d’aucun service en ligne, et la licence AGPL autorise quiconque à reprendre le code. C’est exactement l’inverse du risque encouru avec un service de transcription en ligne, qui peut fermer, changer de tarif ou de politique de données du jour au lendemain.
Cette œuvre est mise à disposition selon les termes de la Licence Creative Commons Attribution – Pas d’Utilisation Commerciale – Pas de Modification 4.0 International
| Auteur | Sébastien Vermandel |
|---|
SMR Marc Sautelet
10, rue du Petit Boulevard
59650 VILLENEUVE D’ASCQ – FRANCE
03 28 80 07 64
Les kits sont prêtés pour deux à trois semaines, ce qui permet de tester les matériels en situation écologique, c’est-à-dire dans les différents contextes de vie de la personne (maison, travail, ESMS…), et sur la durée. La plupart des kits sont constitués de manière à proposer des essais comparatifs : vous trouverez dans ce cas dans la valise plusieurs aides techniques ayant la même finalité.
Paiement des frais d’expédition, de logistique, maintenance et assurance du matériel
Vous bénéficiez d’un demi-tarif si vous effectuez le retrait et la restitution du kit dans nos locaux à Villeneuve d’Ascq.
Vous recevez le kit en quelques jours via Colissimo.
De 2 à 3 semaines
Avis
Il n’y a pas encore d’avis.