El contingut es queda amb tusense accés de tercers
No hi ha cap tractament del contingut dels teus fitxers en cap servidor. No et cal cap contracte d'encàrrec de tractament amb gottrix per treballar amb documents confidencials o de feina.
Hosted in GermanyGlobal Content Delivery
Servidors d'origen a Hetzner, a Alemanya, amb lliurament mundial mitjançant una xarxa de distribució de continguts (CDN). El contingut dels teus fitxers no es transmet mai en aquest procés - no surt mai del teu dispositiu.
Una entrevista, la gravació d'una classe, una nota de veu amb una idea pel camí: aquesta eina escolta la gravació i la transcriu com a text cercable i copiable. El model de reconeixement és Whisper d'OpenAI, aquí com una compilació WebAssembly pròpia i d'un sol fil: la mateixa tecnologia de base que fan servir els serveis de transcripció coneguts, només que aquí s'executa íntegrament al teu dispositiu en lloc d'un servidor extern.
Per defecte, Whisper detecta ell mateix l'idioma parlat ("Detecció automàtica"): en gravacions curtes o multilingües l'idioma també es pot fixar, cosa que pot millorar lleugerament la precisió i la velocitat. El resultat apareix com a text continu amb un paràgraf per segment de parla; per a vídeos que necessiten marques de temps incrustades hi ha l'eina germana "Vídeo a subtítols", que fa servir el mateix reconeixement però genera un fitxer SRT/VTT amb marques de temps exactes.
Com que es treballa sense memòria compartida (sense aïllament d'origen creuat), el reconeixement s'executa en un sol fil en lloc de diversos: correcte, però notablement més lent que un servei del costat del servidor. Per això aquí s'aplica un límit de durada molt més estricte que a la resta d'eines d'àudio d'aquesta pàgina; més val ser honestament lent que prometre una velocitat falsa.
Fitxa tècnica
Fitxa tècnica
Formats d'entrada
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Conversió automàtica
MP4
Format de sortida
TXT
Processament per lots
No
Processament
En local al navegador (WebAssembly)
Càrrega de fitxers
Cap
En 3 passos
Deixa anar el teu fitxer d'àudio.
Tria un idioma o deixa-ho en "Detecció automàtica".
Copia el text reconegut o descarrega'l com a TXT.
Límits: S'executa en un sol fil (sense mode d'aïllament d'origen creuat en aquesta pàgina) i per això és notablement més lent que els serveis del costat del servidor: aquí s'aplica un límit de durada per dispositiu molt més estricte (més curt que a la resta d'eines d'àudio). S'utilitza el model compacte de nivell "tiny": bo per a parla clara, més feble amb molt soroll de fons, dialectes o argot tècnic que un model més gran. El reconeixement no és lliure d'errors: revisa el resultat, sobretot els noms propis i els números.
Preguntes freqüents
Es puja la meva gravació?
No, el reconeixement s'executa totalment en local, al navegador, mitjançant WebAssembly.
Quins idiomes es reconeixen?
Gairebé 100 idiomes; detectats automàticament o triats de manera fixa.
Per què triga més que altres eines d'àudio?
El reconeixement de veu exigeix molt de càlcul i aquí s'executa sense múltiples fils: correcte, però deliberadament més lent en lloc de prometre una rapidesa falsa.
També existeix amb marques de temps per a subtítols?
Sí, l'eina germana "Vídeo a subtítols" genera SRT/VTT amb marques de temps exactes.
Només amb el teu consentiment mesurem l'ús de manera anonimitzada mitjançant galetes per millorar gottrix. Els teus fitxers sempre romanen en local, al teu dispositiu. Privadesa