N’arrêtez jamais d’apprendre !
La reconnaissance vocale fonctionne grâce à des algorithmes qui transforment la voix en texte, puis analysent ce texte pour comprendre la demande.
Quand on parle à un assistant numérique (comme Siri, Alexa ou Google Assistant), le micro capte la voix et la convertit en un signal numérique.
Ce signal passe ensuite dans un logiciel d’analyse qui découpe la parole en petits sons (phonèmes) et les compare à une immense base de données pour reconnaître les mots.
Une fois le texte obtenu, un autre programme essaie de comprendre le sens de la phrase et d’y répondre au mieux. Tout cela se fait en quelques secondes, grâce à l’intelligence artificielle et au “machine learning”.
Les premiers systèmes de reconnaissance vocale, dans les années 1950, ne comprenaient que dix chiffres différents… et il fallait parler très lentement !