Outil de CAA combinant une synthèse vocale personnalisée (par clonage de la voix) et une intelligence contextuelle permettant de fluidifier les échanges.
Outil de CAA combinant une synthèse vocale personnalisée (par clonage de la voix) et une intelligence contextuelle permettant de fluidifier les échanges.
Partager sur les réseaux
Invincible Voice est un outil d’intelligence artificielle vocale. Développé en open source par Kyutai, un laboratoire de recherche français, en étroite collaboration avec Olivier Goy, entrepreneur atteint de la sclérose latérale amyotrophique (SLA). Le projet est né d’une réalité concrète et urgente : la perte progressive de la voix, l’une des conséquences les plus dévastatrices de certaines maladies neurodégénératives. Face à cette situation, l’équipe de Kyutai a développé une solution permettant de restituer à la personne sa propre voix, clonée par l’IA, et de l’utiliser pour communiquer en temps réel avec son entourage.
L’outil repose sur trois fonctions combinées : la transcription en temps réel de la parole des interlocuteurs, la génération automatique de réponses contextualisées par l’IA, et la synthèse vocale avec la voix personnalisée de l’utilisateur. Ensemble, ces trois fonctions visent à rétablir un échange conversationnel aussi naturel que possible, malgré l’incapacité à s’exprimer oralement.
À ce stade de développement, Invincible Voice n’est pas un produit grand public finalisé. Il s’agit d’un prototype mis à disposition gratuitement. L’équipe souhaite le partager avec les professionnels de la Communication Alternative et Améliorée (CAA) afin qu’ils s’appuient sur ces avancées — disponibles en open source — pour améliorer leurs propres pratiques ou solutions. Ce positionnement est important à comprendre. L’outil nécessite un accompagnement professionnel lors de la prise en mains. Ses limites doivent être expliquées à l’utilisateur et à son entourage.
| Référence | Invicible Voice |
|---|---|
| Distributeur | Kyutai (laboratoire de recherche IA, Paris). Une initiatative d’Olivier Goy, avec la technologie de synthèse vocale Gradium. |
| Site | https://www.invincible-voice.com |
| Prix | Gratuit (version libre) en Open Source |
Invincible Voice s’adresse en priorité aux personnes atteintes de maladies neurodégénératives entraînant une perte progressive de la voix, notamment la SLA (sclérose latérale amyotrophique, également appelée maladie de Charcot). L’outil peut toutefois être envisagé pour tout public en situation de handicap de communication vocale, à condition que la personne maîtrise le langage écrit et conserve une capacité de saisie textuelle — qu’il s’agisse d’un clavier physique, d’un clavier virtuel ou d’une commande oculaire.
Deux situations cliniques distinctes justifient son utilisation. En phase de prévention vocale, lorsque la voix est encore exploitable, un enregistrement de qualité permet de créer un clone vocal fidèle avant que la voix ne soit trop altérée. Cette étape, réalisée suffisamment tôt dans l’évolution de la pathologie, permet de préserver l’identité vocale de la personne. Si la parole est déjà perdue, un enregistrement antérieur d’une durée minimale de 10 secondes peut suffire. En phase de compensation, lorsque la parole n’est plus fonctionnelle, l’outil peut être proposé comme aide à la communication, en complément ou en alternative aux dispositifs de CAA classiques, avec l’avantage d’une voix personnalisée et d’une génération contextuelle des réponses.
L’application est entièrement basée sur le web : aucune installation de logiciel n’est nécessaire. L’utilisateur doit disposer d’un ordinateur (PC ou Mac) équipé d’un microphone et d’enceintes, d’une connexion internet stable, et d’un navigateur web récent. L’accès se fait via l’adresse : https://invincible-voice.kyutai.org/. L’interface est en français.
La première étape consiste à créer un compte utilisateur sur la plateforme avec une adresse Gmail. Cette opération est simple et rapide. Elle conditionne l’accès à toutes les fonctionnalités de personnalisation, qui sont au cœur de l’expérience proposée par Invincible Voice.

La configuration constitue l’étape la plus déterminante pour la qualité de l’expérience. Elle comporte plusieurs volets.

L’utilisateur peut choisir une voix de synthèse par défaut dans la bibliothèque intégrée à l’application, ou créer sa propre voix à partir d’un enregistrement audio d’une durée minimale de 10 secondes.

On peut enregistrer sa voix en allant dans “Sauver votre voix” sur https://www.invincible-voice.com La qualité du clone dépend directement de celle de l’enregistrement : son clair, sans bruit de fond, une seule voix à la fois. Il est fortement conseillé de réaliser cet enregistrement dans de bonnes conditions acoustiques, idéalement à un stade où la voix est encore bien intelligible. Le professionnel de santé a un rôle déterminant à jouer lors de cette étape.

L’utilisateur est invité à se décrire aussi précisément que possible : identité, contexte de vie, environnement social, centres d’intérêt, habitudes de communication, pathologie si pertinent. Plus ce profil est détaillé, plus les réponses générées par l’IA seront adaptées au contexte de chaque conversation. Pour les personnes disposant d’une empreinte numérique significative, il est possible de solliciter un outil de type ChatGPT, Claude ou Mistral pour rédiger un portrait à partir d’informations publiques ou transmises par la personne ou ses proches.
L’application permet de pré-enregistrer les prénoms des interlocuteurs habituels (famille, soignants, amis proches) ainsi que les expressions fréquentes du quotidien, notamment celles liées aux besoins spécifiques de la personne. Cela évite de ressaisir ces éléments à chaque conversation et améliore la réactivité de l’outil.
Il est possible d’ajouter des documents thématiques destinés à enrichir la base de connaissances de l’IA : loisirs, parcours professionnel, sujet médical spécifique, événement familial à venir, etc. Ces documents peuvent être préparés avec l’aide d’un outil d’IA générative et constituent un levier important pour la qualité des échanges sur des sujets précis.

Une fois l’application configurée, la conversation peut démarrer selon deux modes :
À l’initiative de l’utilisateur : la personne saisit un mot-clé ou une intention (par exemple : « me présenter », « demander de l’aide », « parler du week-end »). L’IA génère automatiquement quatre propositions de phrases complètes, adaptées au profil et au contexte. L’utilisateur peut cliquer sur celle qui lui convient pour qu’elle soit lue avec sa voix clonée, ou éditer la proposition la plus proche pour la personnaliser.
À l’initiative de l’interlocuteur : l’application transcrit en temps réel ce que le microphone capte, c’est-à-dire la parole de l’interlocuteur. Sur la base de cette transcription et du profil utilisateur, l’IA propose quatre réponses possibles. L’utilisateur sélectionne ou édite la réponse souhaitée, qui est alors lue à voix haute.

Pour tirer le meilleur parti de l’outil, plusieurs conditions doivent être réunies lors de l’utilisation :

L’outil présenté est un prototype, et non un dispositif médical certifié. Il ne bénéficie d’aucun agrément en tant qu’aide technique. Il est essentiel d’en informer clairement l’utilisateur ainsi que ses aidants afin d’éviter toute confusion sur la nature et les limites de l’outil.
Aucun service après-vente ni accompagnement formalisé n’est proposé. Des retours peuvent être transmis via un formulaire de contact, mais sans garantie de réponse. Dans ce contexte, le professionnel de santé devient le relais principal pour accompagner l’utilisateur au quotidien.
La création d’un clone vocal nécessite le traitement de données personnelles sensibles, notamment la voix et le profil de l’utilisateur. Avant toute utilisation, il est indispensable de consulter la politique de confidentialité de la plateforme et d’en expliquer les implications au patient.
Pour interagir avec l’outil, l’utilisateur doit être capable de saisir du texte. En l’absence d’adaptation spécifique — comme la commande oculaire ou un contacteur — l’accès à l’application peut s’avérer extrêmement difficile, voire impossible, pour certains patients.
La qualité du clone vocal est directement liée à celle de l’échantillon audio enregistré. Si la voix de la personne est déjà fortement altérée au moment de l’enregistrement, le résultat risque d’être décevant. Il est donc fortement recommandé d’anticiper cette étape et de la réaliser le plus tôt possible dans le parcours de soin.
L’outil fonctionne uniquement avec une connexion internet stable. En cas de coupure réseau, l’application devient totalement inutilisable, ce qui peut représenter un obstacle important pour des utilisateurs vivant à domicile avec une connexion instable ou limitée.
L’outil étant encore en cours de développement, ses fonctionnalités, son interface et ses performances sont amenées à évoluer. Il est recommandé de consulter régulièrement le site afin de rester informé des mises à jour et des éventuels changements qui pourraient affecter son utilisation.
Invincible Voice occupe une place singulière dans le paysage des outils de CAA : comme IGOOR documenté récemment, il est l’un des rares à combiner dans une même solution le clonage vocal — garantissant le maintien de l’identité sonore de la personne — et la génération contextuelle de réponses, qui vise à restituer la fluidité naturelle de l’échange. Ces deux dimensions répondent à des besoins fondamentaux des personnes en perte de communication vocale.
Pour l’orthophoniste, l’outil peut s’inscrire à plusieurs étapes du parcours d’accompagnement. En phase préventive, il convient de recommander et d’encadrer l’enregistrement vocal avant que la voix ne soit trop dégradée — la page dédiée du site (https://www.invincible-voice.com/sauver) propose une procédure simplifiée pour « sauver sa voix » en quelques minutes. En phase de bilan, il s’agit d’évaluer l’adéquation de l’outil au profil du patient : capacité de saisie, environnement informatique, disponibilité de l’entourage pour la mise en place. En phase d’adaptation, le professionnel peut accompagner la configuration initiale (profil, mots-clés, documents de contexte), former le patient et ses proches, et ajuster les paramètres au fil du temps. Enfin, dans une logique pluridisciplinaire, l’outil peut utilement être partagé avec les équipes médicales et paramédicales impliquées dans la prise en charge.
La gratuité et l’open source d’Invincible Voice en font une ressource à valoriser, notamment dans les structures ne disposant pas d’accès à des solutions commerciales onéreuses. Le code source est librement accessible sur GitHub pour les équipes souhaitant développer des adaptations spécifiques.
Un grand merci à Olivier Goy pour son retour !
Cette œuvre est mise à disposition selon les termes de la Licence Creative Commons Attribution – Pas d’Utilisation Commerciale – Pas de Modification 4.0 International
| Auteur | Aurélie Régent |
|---|
SMR Marc Sautelet
10, rue du Petit Boulevard
59650 VILLENEUVE D’ASCQ – FRANCE
03 28 80 07 64
Les kits sont prêtés pour deux à trois semaines, ce qui permet de tester les matériels en situation écologique, c’est-à-dire dans les différents contextes de vie de la personne (maison, travail, ESMS…), et sur la durée. La plupart des kits sont constitués de manière à proposer des essais comparatifs : vous trouverez dans ce cas dans la valise plusieurs aides techniques ayant la même finalité.
Paiement des frais d’expédition, de logistique, maintenance et assurance du matériel
Vous bénéficiez d’un demi-tarif si vous effectuez le retrait et la restitution du kit dans nos locaux à Villeneuve d’Ascq.
Vous recevez le kit en quelques jours via Colissimo.
De 2 à 3 semaines
Avis
Il n’y a pas encore d’avis.