Содержимое остаётся у васнет доступа у третьих лиц
Содержимое ваших файлов нигде не обрабатывается на стороне сервера. Вам не нужен договор об обработке данных с gottrix, чтобы работать с конфиденциальными или деловыми документами.
Hosted in GermanyGlobal Content Delivery
Исходный сервер у Hetzner в Германии, доставка по всему миру через сеть доставки контента (CDN). Содержимое ваших файлов при этом никогда не передаётся - оно не покидает ваше устройство.
Интервью, запись лекции, голосовая заметка с идеей, пришедшей в дороге: этот инструмент прослушивает запись и превращает её в текст, который можно искать и копировать. Модель распознавания - Whisper от OpenAI, здесь собранная отдельно как однопоточный WebAssembly-модуль: та же технология, что лежит в основе известных сервисов транскрибации, только работает она целиком на вашем устройстве, а не на чужом сервере.
По умолчанию Whisper сам определяет язык записи ("Определить автоматически") - но для коротких или многоязычных записей язык можно задать явно, что немного повышает точность и скорость распознавания. Результат появляется как связный текст с абзацем на каждый речевой фрагмент; для видео, где нужны встроенные тайм-коды, есть родственный инструмент "Видео в субтитры" - он использует то же распознавание, но выдаёт файл SRT/VTT с точными временными метками.
Поскольку общая память недоступна (нет межсайтовой изоляции), распознавание работает в один поток, а не в несколько - это корректно, но заметно медленнее серверного сервиса. Поэтому здесь действует значительно более строгое ограничение длины, чем у остальных аудиоинструментов сайта: честная медлительность лучше обещанной, но ложной скорости.
Технические данные
Технические данные
Входные форматы
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Автоматическое преобразование
MP4
Выходной формат
TXT
Пакетная обработка
Нет
Обработка
Локально в браузере (WebAssembly)
Загрузка файлов
Отсутствует
В 3 шага
Перетащите аудиофайл.
Выберите язык или оставьте "Определить автоматически".
Скопируйте распознанный текст или скачайте его как TXT.
Ограничения: Работает в один поток (на этой странице нет режима межсайтовой изоляции), поэтому заметно медленнее серверных сервисов - здесь действует значительно более строгое ограничение длины на устройство, чем у остальных аудиоинструментов. Используется компактный уровень модели "tiny": хорошо справляется с чёткой речью, но слабее при сильном фоновом шуме, диалектах или узкой терминологии, чем более крупная модель. Распознавание не безошибочно - проверяйте результат, особенно имена собственные и числа.
Частые вопросы
Моя запись загружается на сервер?
Нет, распознавание полностью работает локально в браузере через WebAssembly.
Какие языки распознаются?
Почти 100 языков - либо автоматически, либо по явному выбору.
Почему это дольше, чем у других аудиоинструментов?
Распознавание речи требует много вычислений и здесь работает без многопоточности - корректно, но осознанно медленнее вместо ложного обещания скорости.
Есть ли вариант с тайм-кодами для субтитров?
Да, родственный инструмент "Видео в субтитры" выдаёт SRT/VTT с точными временными метками.
Только с вашего согласия мы анонимно измеряем использование с помощью файлов cookie, чтобы улучшать gottrix. Ваши файлы всегда остаются локально, на вашем устройстве. Конфиденциальность