Non avviene alcun trattamento dei contenuti dei tuoi file. Non ti serve un accordo sul trattamento dei dati con gottrix per gestire documenti riservati o aziendali.
Hosted in GermanyGlobal Content Delivery
Server di origine presso Hetzner in Germania, distribuzione mondiale tramite una rete di distribuzione dei contenuti (CDN). Il contenuto dei tuoi file non viene mai trasmesso in questo processo - non lascia il tuo dispositivo.
Un'intervista, la registrazione di una lezione, un memo vocale con un'idea al volo: questo strumento ascolta la registrazione e la trascrive in un testo ricercabile e copiabile. Il modello di riconoscimento è Whisper di OpenAI, qui come build WebAssembly compilata appositamente, a thread singolo - la stessa tecnologia di base usata dai noti servizi di trascrizione, solo che qui viene eseguita interamente sul tuo dispositivo invece che su un server esterno.
Per impostazione predefinita, Whisper riconosce da solo la lingua parlata ("Rilevamento automatico") - per registrazioni brevi o multilingue si può però anche impostare la lingua in modo fisso, il che può migliorare leggermente precisione e velocità. Il risultato appare come testo continuo con un paragrafo per ogni segmento vocale; per i video che necessitano di marcatori temporali incorporati esiste lo strumento gemello "Video in sottotitoli", che usa lo stesso riconoscimento ma genera un file SRT/VTT con marcatori temporali esatti.
Poiché si lavora senza memoria condivisa (nessun isolamento cross-origin), il riconoscimento viene eseguito a thread singolo anziché multithread - corretto, ma sensibilmente più lento di un servizio lato server. Per questo qui vale un limite di durata decisamente più severo rispetto agli altri strumenti audio di questa pagina; meglio essere onestamente lenti che promettere una velocità falsa.
Scheda tecnica
Scheda tecnica
Formati di input
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Conversione automatica
MP4
Formato di output
TXT
Elaborazione in batch
No
Elaborazione
In locale nel browser (WebAssembly)
Caricamento file
Nessuno
In 3 passaggi
Rilascia il tuo file audio.
Scegli una lingua oppure lascia "Rilevamento automatico".
Copia il testo riconosciuto o scaricalo come TXT.
Limiti: Viene eseguito a thread singolo (nessuna modalità di isolamento cross-origin su questa pagina) ed è quindi sensibilmente più lento dei servizi lato server - qui vale un limite di durata per dispositivo decisamente più severo (più corto rispetto agli altri strumenti audio). Viene usato il modello compatto di livello "tiny": buono per un parlato chiaro, più debole con forte rumore di fondo, dialetti o gergo tecnico rispetto a un modello più grande. Il riconoscimento non è privo di errori: controlla il risultato, specialmente nomi propri e numeri.
Domande frequenti
La mia registrazione viene caricata online?
No, il riconoscimento viene eseguito interamente in locale, nel browser, tramite WebAssembly.
Quali lingue vengono riconosciute?
Quasi 100 lingue; rilevate automaticamente oppure scelte in modo fisso.
Perché richiede più tempo rispetto ad altri strumenti audio?
Il riconoscimento vocale richiede molto calcolo e qui viene eseguito senza multithreading - corretto, ma volutamente più lento invece di promettere una rapidità falsa.
Esiste anche con marcatori temporali per i sottotitoli?
Sì, lo strumento gemello "Video in sottotitoli" genera SRT/VTT con marcatori temporali esatti.
Solo con il tuo consenso misuriamo l'utilizzo in forma anonimizzata tramite cookie per migliorare gottrix. I tuoi file restano sempre in locale, sul tuo dispositivo. Privacy