Аудио в текст — с именами говорящих, а не «Спикер 1»

Загрузите запись — получите текст с пунктуацией, таймкодами и разделением по голосам. Первые три минуты бесплатно, без регистрации. Запись не сохраняем.

mp3, wav, m4a, ogg, aac, webm, mp4, mov · до 3 минут и 20 МБ бесплатно

Так выглядит результат

[00:12] Софья Петрова: Давайте зафиксируем: бюджет на третий квартал — 4,2 млн рублей.
[00:19] Игорь Лапин: Тогда переносим закупку оборудования на октябрь?
[00:24] Софья Петрова: Да. И согласуем с финансовым отделом до двадцатого числа.

Имена подставлены автоматически: сервис уже слышал эти голоса в прошлых записях. Экспорт — TXT, SRT и JSON с таймкодами слов.

Чем отличаемся от онлайн-конвертеров

Имена, а не номера

Обычные сервисы пишут «Speaker 1» и «Speaker 2», и в каждой новой записи нумерация своя. Мы храним голосовой отпечаток: назвали человека один раз — в следующих записях он определяется сам.

Текст сразу читаемый

Пунктуация и числа расставляются моделью, а не приделываются потом. Точность знаков: запятая 84,5 %, точка 86,7 % (данные Сбера по GigaAM v3).

Час записи — около пяти минут

Замер: совещание 17 минут 52 секунды обработано за 94 секунды на процессоре ноутбука, без видеокарты. Разделение по голосам из этого — 35 секунд.

Длительность не ограничена

Ни в одном режиме. Многочасовые записи идут фоновой задачей с прогрессом и возможностью отменить.

Что можно расшифровать

Совещания · интервью · звонки · лекции · подкасты · записи с диктофона · голосовые из мессенджеров · видео с монтажа

Форматы

Аудио: mp3, wav, m4a, ogg, opus, aac, flac, webm. Видео: mp4, mov, mkv, webm — дорожку достаём сами, конвертировать заранее не нужно.

Что происходит с вашей записью

Файл обрабатывается и удаляется. Распознанный текст в бесплатном режиме нигде не сохраняется — ни в журнале, ни в базе. Для организаций есть версия, которая ставится на ваш сервер: тогда запись вообще не покидает вашу сеть, и работает это без доступа в интернет.

Для разработчиков

curl -X POST https://rechetext.ru/api/transcribe \
  -H "Authorization: Bearer $KEY" \
  -F "audio=@meeting.mp3" -F "timestamps=true"

Синхронное распознавание, фоновые задачи для длинных записей, потоковый режим по WebSocket, справочник голосов. Ключ выдаётся в кабинете после регистрации.

Вопросы

Сколько бесплатно?

Три минуты аудио без регистрации. После регистрации — бесплатная квота, дальше по тарифу за минуту.

Нужна ли регистрация?

Нет, для первой расшифровки не нужна.

Сколько человек различает?

Столько, сколько их в записи. Число говорящих определяется само, задавать его не нужно.

Сохраняете ли вы мои записи?

Нет. Файл удаляется после обработки, текст в бесплатном режиме не сохраняется.

Работает с плохой записью?

Да, но точность падает — как у любой системы. Диктофон в кармане или два перебивающих друг друга человека дадут больше ошибок, чем запись с петличкой.

Можно поставить у себя?

Да, один контейнер, работает без интернета.