bg

Аудио към текст

Превърнете говорим запис в писмен текст - локално в браузъра чрез ИИ разпознаване на реч (Whisper), напълно без качване.

Обработва се локално на устройството ви ...

Език на записа
  • Автоматично разпознаване
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

Обработва се локално на устройството ви ...

0%

Качва ли се файлът ми?

Не. Всичко работи в браузъра ви - файлът ви никога не напуска устройството. Как се проверява това

Без качване100% локално
Съдържанието остава у теббез достъп на трети страни
Hosted in GermanyGlobal Content Delivery
Независимо провереноTLS A+ · Заглавки A+

Интервю, запис на лекция, гласова бележка с идея по пътя: този инструмент слуша записа и го записва като текст, който може да се търси и копира. Моделът за разпознаване е Whisper на OpenAI, тук компилиран специално като еднопоточен WebAssembly модул - същата технология, която стои зад познатите услуги за транскрибиране, само че тук работи изцяло на вашето устройство, а не на чужд сървър.

По подразбиране Whisper сам разпознава говоримия език ("Автоматично разпознаване") - но при кратки или многоезични записи езикът може да се зададе изрично, което леко подобрява точността и скоростта. Резултатът се появява като непрекъснат текст с отделен абзац за всеки речеви откъс; за видеа, при които са нужни вградени времеви маркери, съществува сродният инструмент "Видео в субтитри", който използва същото разпознаване, но извежда файл SRT/VTT с точни времеви маркери.

Тъй като няма споделена памет (без междусайтова изолация), разпознаването работи еднопоточно, а не многопоточно - коректно, но забележимо по-бавно от услуга на сървър. Затова тук важи много по-строго ограничение на дължината, отколкото при останалите аудио инструменти на сайта - честно бавно е по-добре от обещана, но невярна скорост.

Технически данни

Технически данни
Входни форматиMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Автоматично конвертиранеMP4
Изходен форматTXT
Пакетна обработкаНе
ОбработкаЛокално в браузъра (WebAssembly)
Качване на файловеНяма

В 3 стъпки

  1. Пуснете аудио файла си.
  2. Изберете език или оставете "Автоматично разпознаване".
  3. Копирайте разпознатия текст или го изтеглете като TXT.

Ограничения: Работи еднопоточно (на тази страница няма режим на междусайтова изолация) и затова е забележимо по-бавен от услугите на сървър - тук важи много по-строго ограничение на дължината за отделно устройство, отколкото при останалите аудио инструменти. Използва се компактното ниво на модела "tiny": добро при ясна реч, по-слабо при силен фонов шум, диалекти или специализирана терминология в сравнение с по-голям модел. Разпознаването не е безпогрешно - проверете резултата, особено собствените имена и числата.

Чести въпроси

Качва ли се записът ми на сървър?

Не, разпознаването работи изцяло локално в браузъра чрез WebAssembly.

Кои езици се разпознават?

Почти 100 езика - или автоматично разпознати, или избрани изрично.

Защо това отнема повече време от другите аудио инструменти?

Разпознаването на реч изисква много изчисления и тук работи без многопоточност - коректно, но съзнателно по-бавно, вместо да обещава невярна скорост.

Има ли вариант с времеви маркери за субтитри?

Да, сродният инструмент "Видео в субтитри" извежда SRT/VTT с точни времеви маркери.

Сходни инструменти

Видео в субтитри · Премахване на шум · Снимка в текст · Вълнова форма · Запис на аудио · Размени каналите