La reconnaissance automatique de la parole transcrit ce qui se dit en texte, presque en temps réel. Visioconférences, vidéos en ligne et conversations en face à face peuvent ainsi être sous-titrées sans préparation.
Pour les personnes sourdes ou malentendantes, c’est un accès immédiat à des échanges jusque-là difficiles à suivre. Le service aide aussi dans un lieu bruyant ou dans une langue que l’on maîtrise mal.
La transcription automatique se trompe encore : noms propres, vocabulaire technique, accents et prises de parole simultanées restent délicats. Pour un contenu préparé, un sous-titrage relu par une personne demeure la référence.
Côté conception, il faut prévoir l’emplacement des sous-titres, un contraste suffisant, une taille réglable et la possibilité de relire ce qui vient d’être dit.