Vos contenus restent chez vousaucun accès par des tiers
Aucun traitement du contenu de vos fichiers n'a lieu sur un serveur. Vous n'avez besoin d'aucun contrat de sous-traitance avec gottrix pour vos documents confidentiels ou professionnels.
Hosted in GermanyGlobal Content Delivery
Serveurs d'origine chez Hetzner en Allemagne, diffusion mondiale via un réseau de diffusion de contenu (CDN). Le contenu de vos fichiers n'est jamais transmis dans ce cadre - il ne quitte jamais votre appareil.
Une interview, l'enregistrement d'un cours, un mémo vocal avec une idée en déplacement : cet outil écoute l'enregistrement et le retranscrit en texte consultable et copiable. Le modèle de reconnaissance est Whisper d'OpenAI, ici sous forme d'un WebAssembly mono-thread spécialement compilé - la même technologie de base que celle utilisée par les services de transcription connus, à ceci près qu'elle s'exécute entièrement sur ton appareil plutôt que sur un serveur externe.
Par défaut, Whisper détecte lui-même la langue parlée ("Détection automatique") - pour les enregistrements courts ou multilingues, la langue peut aussi être fixée, ce qui peut légèrement améliorer la précision et la vitesse. Le résultat apparaît sous forme de texte continu avec un paragraphe par segment de parole ; pour les vidéos qui ont besoin d'horodatages intégrés, il existe l'outil jumeau "Vidéo vers sous-titres", qui utilise la même reconnaissance mais produit un fichier SRT/VTT avec des repères temporels exacts.
Comme le traitement se fait sans mémoire partagée (pas d'isolation cross-origin), la reconnaissance s'exécute en mono-thread plutôt qu'en multi-thread - correct, mais sensiblement plus lent qu'un service côté serveur. C'est pourquoi une limite de durée bien plus stricte s'applique ici que pour les autres outils audio de cette page ; mieux vaut être honnêtement lent que promettre une fausse vitesse.
Fiche technique
Fiche technique
Formats d'entrée
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Conversion automatique
MP4
Format de sortie
TXT
Traitement par lots
Non
Traitement
En local dans le navigateur (WebAssembly)
Téléversement de fichiers
Aucun
En 3 étapes
Dépose ton fichier audio.
Choisis une langue ou laisse "Détection automatique".
Copie le texte reconnu ou télécharge-le en TXT.
Limites: S'exécute en mono-thread (pas de mode d'isolation cross-origin sur cette page) et est donc sensiblement plus lent que les services côté serveur - une limite de durée par appareil bien plus stricte s'applique ici (plus courte que pour les autres outils audio). Le modèle compact de niveau "tiny" est utilisé : bon pour une parole claire, plus faible avec beaucoup de bruit de fond, des dialectes ou du jargon qu'un modèle plus grand. La reconnaissance n'est pas exempte d'erreurs - vérifie le résultat, surtout les noms propres et les chiffres.
Questions fréquentes
Mon enregistrement est-il envoyé ?
Non, la reconnaissance s'exécute entièrement en local, dans le navigateur, via WebAssembly.
Quelles langues sont reconnues ?
Près de 100 langues ; détectées automatiquement ou choisies explicitement.
Pourquoi est-ce plus long que pour d'autres outils audio ?
La reconnaissance vocale demande beaucoup de calcul et s'exécute ici sans multi-threading - correct, mais délibérément plus lent plutôt que de promettre une rapidité fausse.
Existe-t-il aussi une version avec horodatages pour les sous-titres ?
Oui, l'outil jumeau "Vidéo vers sous-titres" produit du SRT/VTT avec des repères temporels exacts.
Uniquement avec votre accord, nous mesurons l'utilisation de manière anonymisée via des cookies afin d'améliorer gottrix. Vos fichiers restent toujours en local, sur votre appareil. Confidentialité