uk

Аудіо в текст

Перетворіть усний запис на письмовий текст - локально в браузері за допомогою ШІ-розпізнавання мовлення (Whisper), повністю без завантаження.

Обробка локально на вашому пристрої ...

Мова запису
  • Визначити автоматично
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

Обробка локально на вашому пристрої ...

0%

Чи завантажується мій файл?

Ні. Усе працює у вашому браузері - ваш файл ніколи не залишає пристрій. Як це перевірити

Без завантаження100% локально
Вміст лишається у васбез доступу третіх осіб
Hosted in GermanyGlobal Content Delivery
Незалежний аудитTLS A+ · Заголовки A+

Інтерв'ю, запис лекції, голосова нотатка з ідеєю, що прийшла в дорозі: цей інструмент прослуховує запис і перетворює його на текст, який можна шукати й копіювати. Модель розпізнавання - Whisper від OpenAI, тут зібрана окремо як однопотоковий модуль WebAssembly: та сама технологія, що лежить в основі відомих сервісів транскрибації, лише працює вона повністю на вашому пристрої, а не на чужому сервері.

За замовчуванням Whisper сам визначає мову запису ("Визначити автоматично") - але для коротких або багатомовних записів мову можна вказати явно, що трохи підвищує точність і швидкість розпізнавання. Результат з'являється як зв'язний текст з абзацем на кожен мовленнєвий фрагмент; для відео, де потрібні вбудовані часові мітки, є споріднений інструмент "Відео в субтитри" - він використовує те саме розпізнавання, але видає файл SRT/VTT із точними часовими мітками.

Оскільки спільна пам'ять недоступна (немає міжсайтової ізоляції), розпізнавання працює в один потік, а не в декілька - це коректно, але помітно повільніше за серверний сервіс. Тому тут діє значно суворіше обмеження довжини, ніж у решти аудіоінструментів сайту: чесна повільність краща за обіцяну, але хибну швидкість.

Технічні дані

Технічні дані
Вхідні форматиMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
Автоматичне перетворенняMP4
Вихідний форматTXT
Пакетна обробкаНі
ОбробкаЛокально в браузері (WebAssembly)
Завантаження файлівНемає

У 3 кроки

  1. Перетягніть аудіофайл.
  2. Виберіть мову або залиште "Визначити автоматично".
  3. Скопіюйте розпізнаний текст або завантажте його як TXT.

Обмеження: Працює в один потік (на цій сторінці немає режиму міжсайтової ізоляції), тому помітно повільніше за серверні сервіси - тут діє значно суворіше обмеження довжини на пристрій, ніж у решти аудіоінструментів. Використовується компактний рівень моделі "tiny": добре справляється з чіткою мовою, але слабший за сильного фонового шуму, діалектів чи вузької термінології, ніж більша модель. Розпізнавання не є бездоганним - перевіряйте результат, особливо власні назви й числа.

Часті запитання

Мій запис завантажується на сервер?

Ні, розпізнавання повністю працює локально в браузері через WebAssembly.

Які мови розпізнаються?

Майже 100 мов - автоматично або за явним вибором.

Чому це триває довше, ніж в інших аудіоінструментах?

Розпізнавання мовлення вимагає багато обчислень і тут працює без багатопотоковості - коректно, але свідомо повільніше замість хибної обіцянки швидкості.

Чи є варіант із часовими мітками для субтитрів?

Так, споріднений інструмент "Відео в субтитри" видає SRT/VTT із точними часовими мітками.

Схожі інструменти

Відео в субтитри · Видалення шуму · Зображення в текст · Форма хвилі · Запис аудіо · Поміняти канали