Добавь запись — подойдёт и звук, и видео: дорожку мы вытащим сами
Расшифровка аудио и видео в текст
Запись урока, совещания, интервью или голосового сообщения превращается в готовый текст с абзацами. Полтора часа речи — несколько минут ожидания.
Как пользоваться
Укажи язык, если знаешь его точно — так распознавание заметно точнее
Забери готовый текст, разбитый на абзацы по паузам в речи
Частые вопросы
Файл правда уходит на чужой сервер?
Да, и это единственный инструмент на сайте, который так делает. Всё остальное считается либо прямо в браузере, либо на нашем сервере в Москве. Распознавание речи в браузере не запустить — модель весит сотни мегабайт. Поэтому звук отправляется в сервис распознавания, и мы говорим об этом прямо, а не мелким шрифтом. Не загружай сюда записи, которые нельзя показывать посторонним.
Сколько это занимает?
Обычно минуту-две на час записи. Дольше всего идёт не распознавание, а загрузка файла: перед отправкой мы сжимаем звук примерно в сто раз, поэтому час речи весит около десяти мегабайт.
Какой максимум длины?
Полтора часа на одну запись. Если материал длиннее, разрежь его нашим же инструментом «Обрезать аудио» на части и расшифруй по очереди.
Что с точностью?
На чистой речи — высокая, вплоть до отдельных слов. Хуже становится там, где плохо слышно и человеку: далёкий микрофон, эхо в классе, несколько говорящих разом, сильный акцент. Имена, термины и числа стоит перечитать глазами.
Кто говорит — распознаётся?
Нет, разделения по говорящим пока нет: получится сплошной текст с абзацами по паузам. Если нужны реплики по ролям, проще расставить их вручную по готовому тексту.
Файл потом хранится?
Нет. И запись, и результат удаляются с сервера через два часа, а сервис распознавания получает только сжатый звук — без твоего адреса и без имени файла.