Différences

Ci-dessous, les différences entre deux révisions de la page.

Lien vers cette vue comparative

Les deux révisions précédentesRévision précédente
Prochaine révision
Révision précédente
reconnaissance_vocale [Le 18/02/2017, 09:34] – Ajout reconnaissance vocale Lucidia Sefranreconnaissance_vocale [Le 31/08/2026, 19:58] (Version actuelle) – [Reconnaissance vocale] lien wpfr krodelabestiole
Ligne 1: Ligne 1:
 {{tag>portail accessibilité audio multimédia}} {{tag>portail accessibilité audio multimédia}}
- 
----- 
- 
- 
  
 ====== Reconnaissance vocale ====== ====== Reconnaissance vocale ======
  
 +Cette page est consacrée à la [[wpfr>Reconnaissance automatique de la parole|reconnaissance vocale]] sous Ubuntu et plus généralement sous Linux.
  
-Cette page est consacrée à la **reconnaissance vocale** sous Ubuntu et plus généralement sous Linux.+[[:KDE]] intègre un module de reconnaissance vocale, basique et simple à utiliser, basé sur [[:CMU Sphinx]].
  
-Canonical prévoit d'intégrer prochainement le logiciel libre [[speechcontrol]] pour ubuntu linux, développé par canonical, et pourrait faire à l'avenir de la [[synthèse vocale]] également. +Enfin, pour aider l'amélioration des modèles libres de reconnaissance vocale pour Linux, consultez le site [[https://www.voxforge.org/fr|Voxforge.org]].
- +
-[[:KDE]] intègre un module de reconnaissance vocale, basique et simple à utiliser, basé sur [[http://en.wikipedia.org/wiki/CMU_Sphinx|CMU Sphinx]]. +
- +
-Enfin, pour aider l'amélioration des modèles libres de reconnaissance vocale pour Linux, consultez le site [[http://www.voxforge.org/fr|Voxforge.org]].+
 Vous pouvez y enregistrer un texte qui permettra d'intégrer votre voix dans les modèles de reconnaissance vocale, et ainsi les améliorer. Vous pouvez y enregistrer un texte qui permettra d'intégrer votre voix dans les modèles de reconnaissance vocale, et ainsi les améliorer.
  
 La [[synthèse vocale]], qui n'est pas à confondre avec la reconnaissance vocale, peut aussi vous intéresser. La [[synthèse vocale]], qui n'est pas à confondre avec la reconnaissance vocale, peut aussi vous intéresser.
  
-===== Logiciels de reconnaissance vocale =====+===== Applications de reconnaissance vocale =====
  
-  * [[:CMU Sphinx]] : Sphinx est une bibliothèque écrite en java et a une variante en  C+==== Pour la commande vocale ==== 
 + 
 +  * [[:NoComprendo]] : commande vocale pour Linux
   * [[:Perlbox]] : permet de commander l'environnement [[KDE]] par la voix. Basé sur Sphinx.   * [[:Perlbox]] : permet de commander l'environnement [[KDE]] par la voix. Basé sur Sphinx.
-  * [[Simon]] : permet de contrôler de multiples applications (firefox, rhythmbox, ...) ainsi que le bureau aisément. Disponible [[http://sourceforge.net/projects/speech2text/]] +  * [[:Simon]] : permet de contrôler de multiples applications (firefox, rhythmbox, ...) ainsi que le bureau aisément. 
-  * [[:X voice]] : utilise une librairie ViaVoice d'IBM qui est payante.  +  * **VoiceExecute** : permet de lancer des applications par la voix
-  [[VoiceExecute]] : permet de lancer des logiciels par la voix +
-  * [[http://en.wikipedia.org/wiki/Dragon_NaturallySpeaking|Dragon Naturally Speaking]] : fonctionne [[http://appdb.winehq.org/appview.php?versionId=3227|moyennement]] sous Wine, il permet de dicter dans NotePad par exemple. Il peut aussi être utilisé grâce à l'interface [[http://thenerdshow.com/platypus.html|Platypus]]. +
-  * [[FreeSpeech]]+
   * Google search sous [[google_chrome|Chrome]] : le moteur de recherche Google intègre désormais un bouton pour faire une recherche vocale sous Chrome.   * Google search sous [[google_chrome|Chrome]] : le moteur de recherche Google intègre désormais un bouton pour faire une recherche vocale sous Chrome.
-  * [[Jasper]] +  * [[https://github.com/kalliope-project/kalliope|Kalliope]] est un framework permettant de créer son propre assistant personnel. Le programme supporte plusieurs langues, possède des modules de reconnaissance vocale(STT) offline et self-hosted. 
-  * [[https://github.com/claritylab/lucida|Lucida]] est un assistant personnel intelligent basé sur la parole et la vision inspiré par [[http://sirius.clarity-lab.org/|Sirius]]. Visitez le [[http://lucida.ai/|site Web]] pour le tutoriel, et [[http://groups.google.com/forum/#!forum/lucida-users|Lucida-users]] pour de l'aide. Le projet est publié sous [[https://github.com/claritylab/lucida/blob/master/LICENSE|licence BSD]], sauf pour certains sous-modules qui contiennent leurs propres licence. +  * [[https://github.com/claritylab/lucida|Lucida]] est un assistant personnel intelligent basé sur la parole et la vision inspiré par [[https://sirius.clarity-lab.org/|Sirius]]. Visitez le [[https://lucida.ai/|site Web]] pour le tutoriel. Le projet est publié sous [[https://github.com/claritylab/lucida/blob/master/LICENSE|licence BSD]], sauf pour certains sous-modules qui contiennent leurs propres licence. 
-  +  * [[https://jasperproject.github.io/|Jasper]], pour raspberry
-Logiciels dont le développement est arrêté : +
-  * [[http://www.kiecza.net/daniel/linux/index.html|CVoiceControl]] : n'est plus soutenu par son créateur depuis 2002 +
-  * [[:gnome-voice-control]] : permet de contrôler l'environnement [[GNOME]] par la voix. N'est plus dans les dépôts d'Ubuntu depuis 12.04. +
-  * [[Google2Ubuntu]]: utilise la reconnaissance vocale de Google. Arreté en 2014 depuis que Google a changé son API et demande désormais une clef+
  
 +==== Pour la dictée vocale via une application ====
  
 +  * **[[https://flathub.org/fr/apps/net.mkiol.SpeechNote|Speech Note]]**, est une application qui permet de convertir ce que vous dictez en texte. Elle est présente en [[:Flatpak]] sur [[https://flathub.org/fr/apps/net.mkiol.SpeechNote|Flathub]].
 +  * **X voice** : utilise une librairie ViaVoice d'IBM qui est payante.
 +  * [[wp>Dragon_NaturallySpeaking|Dragon Naturally Speaking]] : fonctionne [[https://appdb.winehq.org/appview.php?versionId=3227|moyennement]] sous Wine, il permet de dicter dans NotePad par exemple. Il peut aussi être utilisé grâce à l'interface [[https://thenerdshow.com/platypus.html|Platypus]].
 +  * **[[https://www.thenerdshow.com/freespeech.html|FreeSpeech]]** utilise les librairies [[pocketsphinx|pocketsphinx]].
 +  * **[[https://alphacephei.com/vosk/|VOSK]]** : [[https://forge.chapril.org/tykayn/transcription|mode d'emploi pour transcrire un fichier audio]] par Tykayn
 +  * **[[https://doc.linto.ai/#/services/linstt|LinSTT]]** : service Speech-To-Text de l'assistant vocal LinTO
 +  * **[[https://handy.computer/|Handy]]** est une application disponible en [[appimage]] multiplateforme qui utilise les bibliothèque Parakeet où Whisper .
 +
 +==== Dictée vocale en ligne ====
 +
 +  * **[[https://www.murmure.app/|Murmure]]**(([[https://github.com/Kieirra/murmure|GitHub]])) : [[:web#applications_web|application Web]] [[wpfr>logiciel libre|libre]] et [[:hebergement#auto-hebergement|auto-hébergeable]] !
 +
 +Les solutions suivantes peuvent poser des problèmes de [[:anonymat|confidentialité des données]] :
 +  * [[https://speechnotes.co/fr/|SpeechNotes]] ou [[https://voicenotebook.com/|VoiceNotebook]] marchent dans Chrome/Chromium (pas dans Firefox). Non libres. Basés sur le moteur de Google.
 +  * [[https://docs.google.com/document/?usp=mkt_docs|Google Docs]] : une fois un document créé ou ouvert, aller dans le menu //Outils// puis //Saisie vocale//
 +  * [[https://voicenotebook.com/|Voice notebook]] : reconnaissance vocale via une application (multi plateforme), ou extension Chrome
 +
 +==== Autres ====
 +
 +   * [[:CMU Sphinx]] : Sphinx est une bibliothèque écrite en Java et a une variante en  C
 +   * [[:CommonVoice]] le projet de Mozilla (ex-DeepSpeech)
 + 
 +Application dont le développement est arrêté :
  
 +===== Voir aussi =====
  
-=====Voir aussi=====+  * [[:Synthèse vocale]] (Opération inverse)
  
-  *[[http://forum.ubuntu-fr.org/viewtopic.php?pid=3532304|Discussion "Reconnaissance vocale"]] sur le forum ubuntu-fr +==== Pages en rapport ====
-  *[[synthese_vocale|Synthèse vocale]] (Opération inverse) +
-  * (en) Tutoriel [[http://www.gear21.com/speech/html/|Automatic Speech Recognition on Linux]] date de 2002 +
-  * [[http://www.bostonherald.com/business/technology/general/view.bg?articleid=1303065&srvc=rss|Google launches next phase of voice-recognition project]] ( dec 2010 )+
  
-===== Pages en rapport ===== +{{topic>reconnaissance_vocale&simplelist}}
-{{topic>reconnaissance_vocale&header}}+