Съдържанието остава у теббез достъп на трети страни
Не възниква обработка на съдържанието на файловете ти. Не ти трябва договор за обработка на данни с gottrix, за да работиш с поверителни или служебни документи.
Hosted in GermanyGlobal Content Delivery
Основни сървъри в Hetzner в Германия, глобално доставяне чрез мрежа за доставяне на съдържание (CDN). Съдържанието на файловете ти никога не се предава в този процес - то не напуска устройството ти.
Интервю, запис на лекция, гласова бележка с идея по пътя: този инструмент слуша записа и го записва като текст, който може да се търси и копира. Моделът за разпознаване е Whisper на OpenAI, тук компилиран специално като еднопоточен WebAssembly модул - същата технология, която стои зад познатите услуги за транскрибиране, само че тук работи изцяло на вашето устройство, а не на чужд сървър.
По подразбиране Whisper сам разпознава говоримия език ("Автоматично разпознаване") - но при кратки или многоезични записи езикът може да се зададе изрично, което леко подобрява точността и скоростта. Резултатът се появява като непрекъснат текст с отделен абзац за всеки речеви откъс; за видеа, при които са нужни вградени времеви маркери, съществува сродният инструмент "Видео в субтитри", който използва същото разпознаване, но извежда файл SRT/VTT с точни времеви маркери.
Тъй като няма споделена памет (без междусайтова изолация), разпознаването работи еднопоточно, а не многопоточно - коректно, но забележимо по-бавно от услуга на сървър. Затова тук важи много по-строго ограничение на дължината, отколкото при останалите аудио инструменти на сайта - честно бавно е по-добре от обещана, но невярна скорост.
Технически данни
Технически данни
Входни формати
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Автоматично конвертиране
MP4
Изходен формат
TXT
Пакетна обработка
Не
Обработка
Локално в браузъра (WebAssembly)
Качване на файлове
Няма
В 3 стъпки
Пуснете аудио файла си.
Изберете език или оставете "Автоматично разпознаване".
Копирайте разпознатия текст или го изтеглете като TXT.
Ограничения: Работи еднопоточно (на тази страница няма режим на междусайтова изолация) и затова е забележимо по-бавен от услугите на сървър - тук важи много по-строго ограничение на дължината за отделно устройство, отколкото при останалите аудио инструменти. Използва се компактното ниво на модела "tiny": добро при ясна реч, по-слабо при силен фонов шум, диалекти или специализирана терминология в сравнение с по-голям модел. Разпознаването не е безпогрешно - проверете резултата, особено собствените имена и числата.
Чести въпроси
Качва ли се записът ми на сървър?
Не, разпознаването работи изцяло локално в браузъра чрез WebAssembly.
Кои езици се разпознават?
Почти 100 езика - или автоматично разпознати, или избрани изрично.
Защо това отнема повече време от другите аудио инструменти?
Разпознаването на реч изисква много изчисления и тук работи без многопоточност - коректно, но съзнателно по-бавно, вместо да обещава невярна скорост.
Има ли вариант с времеви маркери за субтитри?
Да, сродният инструмент "Видео в субтитри" извежда SRT/VTT с точни времеви маркери.
Само с вашето съгласие измерваме употребата анонимно чрез бисквитки, за да подобряваме gottrix. Вашите файлове винаги остават локално, на вашето устройство. Поверителност