Não há qualquer subcontratação no tratamento do conteúdo dos seus arquivos. Não precisa de um contrato de tratamento de dados com a gottrix para processar documentos confidenciais ou empresariais.
Hosted in GermanyGlobal Content Delivery
Servidores de origem na Hetzner, na Alemanha, com entrega mundial por meio de uma rede de distribuição de conteúdo (CDN). O conteúdo dos seus arquivos nunca é transmitido nesse processo - ele não sai do seu dispositivo.
Uma entrevista, a gravação de uma aula, uma nota de voz com uma ideia em movimento: esta ferramenta ouve a gravação e transcreve-a como texto pesquisável e copiável. O modelo de reconhecimento é o Whisper da OpenAI, aqui como uma compilação WebAssembly própria, de thread única - a mesma tecnologia de base usada pelos serviços de transcrição conhecidos, só que aqui corre inteiramente no teu dispositivo em vez de num servidor externo.
Por predefinição, o Whisper deteta sozinho o idioma falado ("Deteção automática") - em gravações curtas ou multilingues, o idioma também pode ser fixado, o que pode melhorar ligeiramente a precisão e a velocidade. O resultado aparece como texto corrido com um parágrafo por segmento de fala; para vídeos que precisam de marcas de tempo incorporadas existe a ferramenta irmã "Vídeo em legendas", que usa o mesmo reconhecimento mas gera um ficheiro SRT/VTT com marcas de tempo exatas.
Como se trabalha sem memória partilhada (sem isolamento cross-origin), o reconhecimento corre numa única thread em vez de várias - correto, mas visivelmente mais lento do que um serviço no lado do servidor. Por isso aplica-se aqui um limite de duração bem mais rigoroso do que nas restantes ferramentas de áudio desta página; mais vale ser honestamente lento do que prometer uma velocidade falsa.
Ficha técnica
Ficha técnica
Formatos de entrada
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Conversão automática
MP4
Formato de saída
TXT
Processamento em lote
Não
Processamento
Localmente no navegador (WebAssembly)
Upload de arquivos
Nenhum
Em 3 passos
Larga o teu ficheiro de áudio.
Escolhe um idioma ou deixa em "Deteção automática".
Copia o texto reconhecido ou descarrega-o como TXT.
Limites: Corre numa única thread (sem modo de isolamento cross-origin nesta página) e por isso é visivelmente mais lento do que os serviços no lado do servidor - aplica-se aqui um limite de duração por dispositivo bem mais rigoroso (mais curto do que nas restantes ferramentas de áudio). É usado o modelo compacto de nível "tiny": bom para fala clara, mais fraco com muito ruído de fundo, dialetos ou jargão do que um modelo maior. O reconhecimento não é isento de erros: verifica o resultado, sobretudo nomes próprios e números.
Perguntas frequentes
A minha gravação é enviada?
Não, o reconhecimento corre totalmente em local, no navegador, através de WebAssembly.
Que idiomas são reconhecidos?
Quase 100 idiomas; detetados automaticamente ou escolhidos de forma fixa.
Porque demora mais do que outras ferramentas de áudio?
O reconhecimento de voz exige muito cálculo e aqui corre sem várias threads - correto, mas deliberadamente mais lento em vez de prometer uma rapidez falsa.
Também existe com marcas de tempo para legendas?
Sim, a ferramenta irmã "Vídeo em legendas" gera SRT/VTT com marcas de tempo exatas.
Apenas com o seu consentimento medimos a utilização de forma anonimizada através de cookies para melhorar o gottrix. Os seus arquivos permanecem sempre locais, no seu dispositivo. Privacidade