fr

Audio vers texte

Transforme un enregistrement parlé en texte écrit, dans le navigateur par reconnaissance vocale IA (Whisper), sans aucun envoi.

Traitement en local sur votre appareil ...

Langue de l'enregistrement
  • Détection automatique
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

Traitement en local sur votre appareil ...

0%

Mon fichier est-il envoyé ?

Non. Tout s’exécute dans votre navigateur - votre fichier ne quitte jamais votre appareil. Comment le vérifier

Aucun envoi100 % en local
Vos contenus restent chez vousaucun accès par des tiers
Hosted in GermanyGlobal Content Delivery
Audité en externeTLS A+ · En-têtes A+

Une interview, l'enregistrement d'un cours, un mémo vocal avec une idée en déplacement : cet outil écoute l'enregistrement et le retranscrit en texte consultable et copiable. Le modèle de reconnaissance est Whisper d'OpenAI, ici sous forme d'un WebAssembly mono-thread spécialement compilé - la même technologie de base que celle utilisée par les services de transcription connus, à ceci près qu'elle s'exécute entièrement sur ton appareil plutôt que sur un serveur externe.

Par défaut, Whisper détecte lui-même la langue parlée ("Détection automatique") - pour les enregistrements courts ou multilingues, la langue peut aussi être fixée, ce qui peut légèrement améliorer la précision et la vitesse. Le résultat apparaît sous forme de texte continu avec un paragraphe par segment de parole ; pour les vidéos qui ont besoin d'horodatages intégrés, il existe l'outil jumeau "Vidéo vers sous-titres", qui utilise la même reconnaissance mais produit un fichier SRT/VTT avec des repères temporels exacts.

Comme le traitement se fait sans mémoire partagée (pas d'isolation cross-origin), la reconnaissance s'exécute en mono-thread plutôt qu'en multi-thread - correct, mais sensiblement plus lent qu'un service côté serveur. C'est pourquoi une limite de durée bien plus stricte s'applique ici que pour les autres outils audio de cette page ; mieux vaut être honnêtement lent que promettre une fausse vitesse.

Fiche technique

Fiche technique
Formats d'entréeMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Conversion automatiqueMP4
Format de sortieTXT
Traitement par lotsNon
TraitementEn local dans le navigateur (WebAssembly)
Téléversement de fichiersAucun

En 3 étapes

  1. Dépose ton fichier audio.
  2. Choisis une langue ou laisse "Détection automatique".
  3. Copie le texte reconnu ou télécharge-le en TXT.

Limites: S'exécute en mono-thread (pas de mode d'isolation cross-origin sur cette page) et est donc sensiblement plus lent que les services côté serveur - une limite de durée par appareil bien plus stricte s'applique ici (plus courte que pour les autres outils audio). Le modèle compact de niveau "tiny" est utilisé : bon pour une parole claire, plus faible avec beaucoup de bruit de fond, des dialectes ou du jargon qu'un modèle plus grand. La reconnaissance n'est pas exempte d'erreurs - vérifie le résultat, surtout les noms propres et les chiffres.

Questions fréquentes

Mon enregistrement est-il envoyé ?

Non, la reconnaissance s'exécute entièrement en local, dans le navigateur, via WebAssembly.

Quelles langues sont reconnues ?

Près de 100 langues ; détectées automatiquement ou choisies explicitement.

Pourquoi est-ce plus long que pour d'autres outils audio ?

La reconnaissance vocale demande beaucoup de calcul et s'exécute ici sans multi-threading - correct, mais délibérément plus lent plutôt que de promettre une rapidité fausse.

Existe-t-il aussi une version avec horodatages pour les sous-titres ?

Oui, l'outil jumeau "Vidéo vers sous-titres" produit du SRT/VTT avec des repères temporels exacts.

Outils associés

Vidéo vers sous-titres · Supprimer le bruit · Image en texte (OCR) · Image de forme d'onde · Enregistrer l'audio · Échanger les canaux