ms

Tukar Audio ke Teks

Tukar rakaman suara kepada teks bertulis - secara tempatan dalam pelayar melalui pengecaman suara AI (Whisper), tanpa muat naik langsung.

Memproses secara setempat pada peranti anda ...

Bahasa rakaman
  • Kesan automatik
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

Memproses secara setempat pada peranti anda ...

0%

Adakah fail saya dimuat naik?

Tidak. Semuanya berjalan dalam pelayar anda - fail anda tidak pernah meninggalkan peranti. Bagaimana ini boleh disahkan

Tiada muat naik100% setempat
Kandungan kekal milik andatiada capaian pihak ketiga
Hosted in GermanyGlobal Content Delivery
Diaudit bebasTLS A+ · HTTP header A+

Satu temu bual, rakaman kuliah, atau memo suara yang merakam idea semasa dalam perjalanan: alat ini mendengar rakaman lalu menulisnya sebagai teks yang boleh dicari dan disalin. Model pengecaman ialah Whisper daripada OpenAI, di sini dikompil khas sebagai WebAssembly satu bebenang - teknologi asas yang sama dengan perkhidmatan transkripsi yang terkenal, cuma di sini ia berjalan sepenuhnya pada peranti anda dan bukan pada pelayan orang lain.

Secara lalai, Whisper mengecam sendiri bahasa yang dituturkan ("Kesan automatik") - tetapi bagi rakaman pendek atau berbilang bahasa, bahasa juga boleh ditetapkan secara tegar, yang boleh meningkatkan sedikit ketepatan dan kelajuan. Hasilnya dipaparkan sebagai teks berterusan dengan perenggan bagi setiap segmen pertuturan; untuk video yang memerlukan cap masa terbenam, ada alat berkembar "Video ke Sari Kata" yang menggunakan pengecaman yang sama tetapi menghasilkan fail SRT/VTT dengan penanda masa yang tepat.

Kerana beroperasi tanpa shared memory (tiada cross-origin isolation), pengecaman berjalan satu bebenang, bukan berbilang bebenang - betul dari segi teknikal, tetapi terasa lebih perlahan berbanding perkhidmatan berasaskan pelayan. Justeru had tempoh yang jauh lebih ketat terpakai di sini berbanding alat audio lain di laman ini - lebih baik jujur perlahan daripada menjanjikan kelajuan yang salah.

Data teknikal

Data teknikal
Format inputMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Penukaran automatikMP4
Format outputTXT
Pemprosesan kelompokTidak
PemprosesanSetempat dalam pelayar (WebAssembly)
Muat naik failTiada

Dalam 3 langkah

  1. Letakkan fail audio anda.
  2. Pilih bahasa atau biarkan pada "Kesan automatik".
  3. Salin teks yang dikecam atau muat turun sebagai TXT.

Batasan: Berjalan satu bebenang (tiada mod cross-origin isolation pada laman ini) dan justeru terasa lebih perlahan berbanding perkhidmatan berasaskan pelayan - had tempoh bagi setiap peranti yang jauh lebih ketat terpakai di sini (lebih pendek daripada alat audio lain). Menggunakan peringkat model "tiny" yang padat: baik untuk pertuturan yang jelas, kurang baik untuk bunyi latar yang kuat, dialek atau istilah khusus berbanding model yang lebih besar. Pengecaman ini tidak bebas ralat - semak hasilnya, terutamanya nama khas dan nombor.

Soalan lazim

Adakah rakaman saya dimuat naik?

Tidak, pengecaman berjalan sepenuhnya secara tempatan dalam pelayar melalui WebAssembly.

Bahasa apa yang dikecam?

Hampir 100 bahasa; sama ada dikesan secara automatik atau dipilih secara tegar.

Kenapa ini mengambil masa lebih lama daripada alat audio lain?

Pengecaman suara memerlukan pengiraan yang berat dan berjalan di sini tanpa berbilang bebenang - betul dari segi teknikal, tetapi sengaja dibuat lebih perlahan berbanding menjanjikan kelajuan yang tidak benar.

Adakah terdapat versi dengan cap masa untuk sari kata?

Ya, alat berkembar "Video ke Sari Kata" menghasilkan SRT/VTT dengan penanda masa yang tepat.

Alat berkaitan

Tukar ke Subtitel · Buang Bising · Tukar Imej ke Teks · Imej bentuk gelombang · Rakam audio · Tukar saluran