ru

Аудио в текст

Превратите устную запись в письменный текст - локально в браузере с помощью ИИ-распознавания речи (Whisper), полностью без загрузки на сервер.

Обработка локально на вашем устройстве ...

Язык записи
  • Определить автоматически
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

Обработка локально на вашем устройстве ...

0%

Загружается ли мой файл?

Нет. Всё выполняется в вашем браузере - ваш файл никогда не покидает устройство. Как это можно проверить

Без загрузки100% локально
Содержимое остаётся у васнет доступа у третьих лиц
Hosted in GermanyGlobal Content Delivery
Независимый аудитTLS A+ · Заголовки A+

Интервью, запись лекции, голосовая заметка с идеей, пришедшей в дороге: этот инструмент прослушивает запись и превращает её в текст, который можно искать и копировать. Модель распознавания - Whisper от OpenAI, здесь собранная отдельно как однопоточный WebAssembly-модуль: та же технология, что лежит в основе известных сервисов транскрибации, только работает она целиком на вашем устройстве, а не на чужом сервере.

По умолчанию Whisper сам определяет язык записи ("Определить автоматически") - но для коротких или многоязычных записей язык можно задать явно, что немного повышает точность и скорость распознавания. Результат появляется как связный текст с абзацем на каждый речевой фрагмент; для видео, где нужны встроенные тайм-коды, есть родственный инструмент "Видео в субтитры" - он использует то же распознавание, но выдаёт файл SRT/VTT с точными временными метками.

Поскольку общая память недоступна (нет межсайтовой изоляции), распознавание работает в один поток, а не в несколько - это корректно, но заметно медленнее серверного сервиса. Поэтому здесь действует значительно более строгое ограничение длины, чем у остальных аудиоинструментов сайта: честная медлительность лучше обещанной, но ложной скорости.

Технические данные

Технические данные
Входные форматыMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Автоматическое преобразованиеMP4
Выходной форматTXT
Пакетная обработкаНет
ОбработкаЛокально в браузере (WebAssembly)
Загрузка файловОтсутствует

В 3 шага

  1. Перетащите аудиофайл.
  2. Выберите язык или оставьте "Определить автоматически".
  3. Скопируйте распознанный текст или скачайте его как TXT.

Ограничения: Работает в один поток (на этой странице нет режима межсайтовой изоляции), поэтому заметно медленнее серверных сервисов - здесь действует значительно более строгое ограничение длины на устройство, чем у остальных аудиоинструментов. Используется компактный уровень модели "tiny": хорошо справляется с чёткой речью, но слабее при сильном фоновом шуме, диалектах или узкой терминологии, чем более крупная модель. Распознавание не безошибочно - проверяйте результат, особенно имена собственные и числа.

Частые вопросы

Моя запись загружается на сервер?

Нет, распознавание полностью работает локально в браузере через WebAssembly.

Какие языки распознаются?

Почти 100 языков - либо автоматически, либо по явному выбору.

Почему это дольше, чем у других аудиоинструментов?

Распознавание речи требует много вычислений и здесь работает без многопоточности - корректно, но осознанно медленнее вместо ложного обещания скорости.

Есть ли вариант с тайм-кодами для субтитров?

Да, родственный инструмент "Видео в субтитры" выдаёт SRT/VTT с точными временными метками.

Похожие инструменты

Видео в субтитры · Удаление шума · Изображение в текст · Форма волны · Запись аудио · Поменять каналы