Жодної обробки вмісту ваших файлів на сервері не відбувається. Вам не потрібен договір про обробку даних із gottrix, щоб працювати з конфіденційними чи службовими документами.
Hosted in GermanyGlobal Content Delivery
Основні сервери розміщено в Hetzner у Німеччині, доставлення по всьому світу відбувається через мережу доставлення контенту (CDN). Вміст ваших файлів при цьому ніколи не передається - він не залишає ваш пристрій.
Інтерв'ю, запис лекції, голосова нотатка з ідеєю, що прийшла в дорозі: цей інструмент прослуховує запис і перетворює його на текст, який можна шукати й копіювати. Модель розпізнавання - Whisper від OpenAI, тут зібрана окремо як однопотоковий модуль WebAssembly: та сама технологія, що лежить в основі відомих сервісів транскрибації, лише працює вона повністю на вашому пристрої, а не на чужому сервері.
За замовчуванням Whisper сам визначає мову запису ("Визначити автоматично") - але для коротких або багатомовних записів мову можна вказати явно, що трохи підвищує точність і швидкість розпізнавання. Результат з'являється як зв'язний текст з абзацем на кожен мовленнєвий фрагмент; для відео, де потрібні вбудовані часові мітки, є споріднений інструмент "Відео в субтитри" - він використовує те саме розпізнавання, але видає файл SRT/VTT із точними часовими мітками.
Оскільки спільна пам'ять недоступна (немає міжсайтової ізоляції), розпізнавання працює в один потік, а не в декілька - це коректно, але помітно повільніше за серверний сервіс. Тому тут діє значно суворіше обмеження довжини, ніж у решти аудіоінструментів сайту: чесна повільність краща за обіцяну, але хибну швидкість.
Технічні дані
Технічні дані
Вхідні формати
MP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Автоматичне перетворення
MP4
Вихідний формат
TXT
Пакетна обробка
Ні
Обробка
Локально в браузері (WebAssembly)
Завантаження файлів
Немає
У 3 кроки
Перетягніть аудіофайл.
Виберіть мову або залиште "Визначити автоматично".
Скопіюйте розпізнаний текст або завантажте його як TXT.
Обмеження: Працює в один потік (на цій сторінці немає режиму міжсайтової ізоляції), тому помітно повільніше за серверні сервіси - тут діє значно суворіше обмеження довжини на пристрій, ніж у решти аудіоінструментів. Використовується компактний рівень моделі "tiny": добре справляється з чіткою мовою, але слабший за сильного фонового шуму, діалектів чи вузької термінології, ніж більша модель. Розпізнавання не є бездоганним - перевіряйте результат, особливо власні назви й числа.
Часті запитання
Мій запис завантажується на сервер?
Ні, розпізнавання повністю працює локально в браузері через WebAssembly.
Які мови розпізнаються?
Майже 100 мов - автоматично або за явним вибором.
Чому це триває довше, ніж в інших аудіоінструментах?
Розпізнавання мовлення вимагає багато обчислень і тут працює без багатопотоковості - коректно, але свідомо повільніше замість хибної обіцянки швидкості.
Чи є варіант із часовими мітками для субтитрів?
Так, споріднений інструмент "Відео в субтитри" видає SRT/VTT із точними часовими мітками.
Лише за вашою згодою ми анонімно вимірюємо використання за допомогою файлів cookie, щоб покращувати gottrix. Ваші файли завжди залишаються локально, на вашому пристрої. Конфіденційність