Можно ли перевести аудио в текст онлайн бесплатно?
Демо-транскрибатор на этой странице работает бесплатно и без регистрации: выберите пример, нажмите «играть» — и читайте текст с таймкодами. Всё происходит в браузере, аудио никуда не отправляется. Регистрация нужна только для списка ожидания полной версии, где можно грузить свои файлы любой длины и выгружать результат.
Как расшифровать голосовое сообщение из WhatsApp или Telegram?
Сохраните голосовое как файл (в WhatsApp — «Поделиться → Сохранить», в Telegram долгим нажатием «Сохранить в загрузки») и загрузите его в транскрибатор. Форматы ogg, m4a, mp3 — то, в чём мессенджеры хранят голосовые, — распознаются напрямую. Пример «Голосовое от клиента» показывает, как выглядит такая расшифровка: с запятыми и убранными «эээ» и «ну».
Поддерживается ли транскрибация совещания с несколькими спикерами?
Да, это отдельный режим: транскрибатор разделяет запись по спикерам и подписывает, кто что сказал, с таймкодами — получается готовый протокол планёрки. В демо это пример «Планёрка команды»: включите тумблер «Разметка по спикерам». Точность разделения зависит от качества записи; при одновременной речи границы могут смещаться.
В каком формате скачивается расшифровка — txt, srt или doc?
Прямо в демо можно скачать .txt (чистый текст с таймкодами и спикерами) и .srt (субтитры с точными метками — их сразу подхватывают видеоредакторы и YouTube). Оба файла собираются в браузере и весят считанные килобайты. В полной версии добавим экспорт в .doc и .pdf и выгрузку реплик выбранного спикера.
Аудио загружается на зарубежный сервер? Нужен ли VPN?
Нет. Сервис делается в России и работает без VPN — в отличие от западных транскрайберов, которые из РФ открываются только через обход блокировок и просят иностранную карту. Демо целиком работает в браузере: аудио примеров не уходит на сервер. Полная версия обрабатывает записи на серверах в России по 152-ФЗ — это важно, ведь в интервью и совещаниях звучат персональные данные.
Какие форматы аудио поддерживаются — mp3, m4a, ogg, wav?
Планируемые форматы — mp3, m4a (запись iPhone и голосовые Telegram), ogg (голосовые WhatsApp), wav, а также дорожка из видео (mp4, mov). Отдельно конвертировать ничего не нужно — загружаете файл как есть. Записи звонков и диктофонные заметки тоже подходят, главное — чтобы речь было слышно.
Насколько точная расшифровка и распознаёт ли текст нейросеть?
Само распознавание речи в полной версии — это нейросеть: она превращает звук в слова. А наведение порядка — запятые, абзацы, удаление слов-паразитов, разбивка по спикерам — устроено понятными правилами, и в демо вы видите именно эту механику. На чистой записи точность обычно высокая; шум, сильный акцент и одновременная речь её снижают, поэтому итог стоит бегло вычитать.
Сколько длится расшифровка часа записи?
Вручную расшифровка часа записи занимает три-четыре часа: отматывать, переслушивать, вычитывать. Автоматическая транскрибация укладывается в минуты — обычно быстрее, чем длится сама запись. Эту разницу показывает счётчик в демо: рядом с текстом видно, сколько времени ушло бы на ручную расшифровку той же длины.
Можно ли быстро вытащить цитаты и субтитры из записи?
Да, для этого у каждой реплики есть таймкод. Кликнули по строке в демо — плеер перемотался ровно на это место, удобно проверить цитату на слух перед публикацией. А выгрузка в .srt даёт готовые субтитры с временными метками: их можно сразу загрузить в видеоредактор для нарезки рилсов или подписей к подкасту.