Аудио в текст — с именами говорящих, а не «Спикер 1»
Загрузите запись — получите текст с пунктуацией, таймкодами и разделением по голосам. Первые три минуты бесплатно, без регистрации. Запись не сохраняем.
mp3, wav, m4a, ogg, aac, webm, mp4, mov · до 3 минут и 20 МБ бесплатно
Так выглядит результат
[00:12] Софья Петрова: Давайте зафиксируем: бюджет на третий квартал — 4,2 млн рублей. [00:19] Игорь Лапин: Тогда переносим закупку оборудования на октябрь? [00:24] Софья Петрова: Да. И согласуем с финансовым отделом до двадцатого числа.
Имена подставлены автоматически: сервис уже слышал эти голоса в прошлых записях. Экспорт — TXT, SRT и JSON с таймкодами слов.
Чем отличаемся от онлайн-конвертеров
Имена, а не номера
Обычные сервисы пишут «Speaker 1» и «Speaker 2», и в каждой новой записи нумерация своя. Мы храним голосовой отпечаток: назвали человека один раз — в следующих записях он определяется сам.
Текст сразу читаемый
Пунктуация и числа расставляются моделью, а не приделываются потом. Точность знаков: запятая 84,5 %, точка 86,7 % (данные Сбера по GigaAM v3).
Час записи — около пяти минут
Замер: совещание 17 минут 52 секунды обработано за 94 секунды на процессоре ноутбука, без видеокарты. Разделение по голосам из этого — 35 секунд.
Длительность не ограничена
Ни в одном режиме. Многочасовые записи идут фоновой задачей с прогрессом и возможностью отменить.
Что можно расшифровать
Совещания · интервью · звонки · лекции · подкасты · записи с диктофона · голосовые из мессенджеров · видео с монтажа
Форматы
Аудио: mp3, wav, m4a, ogg, opus, aac, flac, webm. Видео: mp4, mov, mkv, webm — дорожку достаём сами, конвертировать заранее не нужно.
Что происходит с вашей записью
Файл обрабатывается и удаляется. Распознанный текст в бесплатном режиме нигде не сохраняется — ни в журнале, ни в базе. Для организаций есть версия, которая ставится на ваш сервер: тогда запись вообще не покидает вашу сеть, и работает это без доступа в интернет.
Для разработчиков
curl -X POST https://rechetext.ru/api/transcribe \ -H "Authorization: Bearer $KEY" \ -F "audio=@meeting.mp3" -F "timestamps=true"
Синхронное распознавание, фоновые задачи для длинных записей, потоковый режим по WebSocket, справочник голосов. Ключ выдаётся в кабинете после регистрации.
Вопросы
Сколько бесплатно?
Три минуты аудио без регистрации. После регистрации — бесплатная квота, дальше по тарифу за минуту.
Нужна ли регистрация?
Нет, для первой расшифровки не нужна.
Сколько человек различает?
Столько, сколько их в записи. Число говорящих определяется само, задавать его не нужно.
Сохраняете ли вы мои записи?
Нет. Файл удаляется после обработки, текст в бесплатном режиме не сохраняется.
Работает с плохой записью?
Да, но точность падает — как у любой системы. Диктофон в кармане или два перебивающих друг друга человека дадут больше ошибок, чем запись с петличкой.
Можно поставить у себя?
Да, один контейнер, работает без интернета.