Tidak ada pemrosesan atas isi berkasmu di server mana pun. Kamu tidak perlu perjanjian pemrosesan data dengan gottrix untuk menangani dokumen rahasia maupun bisnis.
Hosted in GermanyGlobal Content Delivery
Server origin berada di Hetzner di Jerman, dengan pengiriman ke seluruh dunia melalui jaringan pengiriman konten (CDN). Isi berkasmu tidak pernah dikirimkan dalam proses ini - berkas tidak pernah meninggalkan perangkatmu.
Sebuah wawancara, rekaman kuliah, atau memo suara berisi ide saat di perjalanan: tool ini mendengarkan rekaman lalu menuliskannya sebagai teks yang bisa dicari dan disalin. Model pengenalannya adalah Whisper dari OpenAI, di sini dikompilasi khusus sebagai WebAssembly satu thread - teknologi dasar yang sama dengan layanan transkripsi terkenal, hanya saja di sini prosesnya berjalan sepenuhnya di perangkatmu, bukan di server orang lain.
Secara default, Whisper mengenali sendiri bahasa yang diucapkan ("Deteksi otomatis") - tapi untuk rekaman pendek atau multibahasa, bahasa juga bisa ditentukan secara tetap, yang bisa sedikit meningkatkan akurasi dan kecepatan. Hasilnya muncul sebagai teks mengalir dengan paragraf per segmen bicara; untuk video yang butuh timestamp tertanam, ada tool serupa "Video ke Subtitel" yang memakai pengenalan yang sama tapi menghasilkan file SRT/VTT dengan penanda waktu yang presisi.
Karena berjalan tanpa shared memory (tanpa cross-origin isolation), pengenalan berjalan satu thread, bukan multi-thread - benar secara teknis, tapi terasa lebih lambat dibanding layanan berbasis server. Karena itu berlaku batas durasi yang jauh lebih ketat di sini dibanding tool audio lain di situs ini - lebih baik jujur lambat daripada menjanjikan kecepatan yang salah.
Data teknis
Data teknis
Format masukan
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Konversi otomatis
MP4
Format keluaran
TXT
Pemrosesan massal
Tidak
Pemrosesan
Lokal di peramban (WebAssembly)
Unggah berkas
Tidak ada
Dalam 3 langkah
Letakkan file audio.
Pilih bahasa atau biarkan pada "Deteksi otomatis".
Salin teks yang dikenali atau unduh sebagai TXT.
Batasan: Berjalan satu thread (tidak ada mode cross-origin isolation di situs ini) sehingga terasa lebih lambat dibanding layanan berbasis server - berlaku batas durasi per perangkat yang jauh lebih ketat di sini (lebih pendek dari tool audio lainnya). Menggunakan model tingkat "tiny" yang ringkas: bagus untuk suara yang jelas, kurang optimal untuk bising latar yang kuat, dialek, atau istilah teknis dibanding model yang lebih besar. Pengenalannya tidak sempurna - periksa hasilnya, terutama nama diri dan angka.
Pertanyaan umum
Apakah rekaman saya diunggah?
Tidak, pengenalan berjalan sepenuhnya lokal di browser lewat WebAssembly.
Bahasa apa saja yang dikenali?
Hampir 100 bahasa; bisa dideteksi otomatis atau dipilih secara tetap.
Kenapa ini lebih lama dibanding tool audio lain?
Pengenalan suara sangat berat secara komputasi dan di sini berjalan tanpa multi-thread - benar secara teknis, tapi sengaja lebih lambat daripada menjanjikan kecepatan yang salah.
Apakah ada versi dengan timestamp untuk subtitel?
Ya, tool serupa "Video ke Subtitel" menghasilkan SRT/VTT dengan penanda waktu yang presisi.
Hanya dengan persetujuan Anda, kami mengukur penggunaan secara anonim melalui cookie untuk menyempurnakan gottrix. Berkas Anda selalu tetap lokal, di perangkat Anda. Privasi