Parole en texte

Convertissez gratuitement la parole en texte, aussi souvent que vous le souhaitez. Choisissez un fichier audio ou enregistrez au microphone, puis créez localement une transcription et des sous-titres.

Déposez un fichier audio ici ou cliquez pour le sélectionner

Votre audio est traité dans ce navigateur et n’est pas envoyé à un serveur.

Le mode Standard est plus rapide et utilise moins de mémoire. Le mode Amélioré peut améliorer la reconnaissance, mais nécessite un téléchargement plus volumineux, plus de mémoire et plus de temps.

La détection automatique est activée par défaut. Choisissez une langue si la détection est incorrecte.

Les numéros de locuteurs sont des estimations à vérifier.

Utilisez cet outil de conversion audio en texte pour transcrire des notes vocales, des entretiens, des cours et des réunions enregistrées. Le premier lancement télécharge les modèles nécessaires ; les suivants peuvent réutiliser le cache du navigateur lorsqu’il est disponible. La vitesse de traitement dépend de votre appareil. Vérifiez le texte, les horodatages et les éventuelles étiquettes de locuteurs avant de partager le résultat.

Questions fréquentes sur la conversion de la parole en texte

Mon audio est-il envoyé à un serveur ?

Non. Le décodage et la transcription sont effectués dans votre navigateur ; votre enregistrement n’est pas envoyé à un serveur. Une connexion est nécessaire pour télécharger les modèles et ressources qui ne sont pas encore en cache.

Quelle langue dois-je choisir ?

La détection automatique identifie la langue à partir de la parole au début de l’enregistrement. Vous pouvez aussi la sélectionner manuellement. De nombreuses langues sont proposées, mais la précision dépend de la langue, de l’accent, du bruit et de la qualité de l’enregistrement. Les langues mélangées et les voix simultanées nécessitent une vérification attentive.

Quelle est la différence entre Standard et Amélioré, et lequel choisir ?

Le mode Amélioré est sélectionné par défaut. Il peut améliorer la reconnaissance, mais nécessite un premier téléchargement plus volumineux, plus de mémoire et généralement plus de temps de traitement. Choisissez Amélioré si la qualité de reconnaissance est votre priorité. Le mode Standard est plus rapide et utilise moins de mémoire ; choisissez-le pour les longs enregistrements ou les appareils aux ressources limitées.

Puis-je distinguer les différents locuteurs ?

Les étiquettes de locuteurs sont facultatives et désactivées par défaut. Elles estiment qui a parlé et peuvent être incorrectes, surtout pour les interventions brèves ou les voix qui se chevauchent.

Outils associés : Réduction du bruit audio par IA · Séparateur audio · Éditeur de sous-titres · Décalage temporel SRT · Décalage temporel VTT