Пресс-кит

Материалы для редакций, каталогов и обзоров: описания сервиса нужной длины, цифры, которые можно проверить, логотип и контакт. Всё можно брать без согласования — достаточно указать источник.

Цифры на этой странице читаются из того же файла, что и страница открытого замера: пресс-кит не может разойтись с методикой.

Факты коротко

Что делает
переводит аудио- и видеозаписи в текст на русском языке: разделение по говорящим, таймкоды у каждого слова, автоматическая пунктуация
Как доступен
веб-интерфейс и API; бесплатная проба без регистрации
Объём замера
2398 записей, 3,1 часа аудио, три открытых набора данных
Ошибки в словах (WER)
6,71 % на подготовленной начитке, 8,76 % на живой спонтанной речи, 12,81 % на записях с бытовых устройств в шуме
Скорость
час записи обрабатывается за 7–9 минут на обычных процессорах, без видеокарт
Дата замера
2026-08-25; метрики считает библиотека jiwer, не самописный счётчик
Что открыто
правила нормализации текста, скрипты прогона, тесты нормализатора, контрольные суммы файлов и агрегаты результатов

Описания сервиса

Три готовых варианта под разные поля: одна фраза, короткий абзац и полное описание. Тексты можно сокращать и править, но цифры просим оставлять как есть — они сверены с прогоном.

Одной фразой

«Речетекст» — сервис расшифровки русской речи: аудио и видео переводятся в текст с разделением по говорящим, таймкодами и пунктуацией.

Абзац, около 50 слов

«Речетекст» переводит аудио- и видеозаписи в текст на русском языке: реплики разделяются по говорящим, у каждого слова проставлено время, знаки препинания расставляются автоматически. Точность опубликована вместе с методикой замера: 6,71 % ошибок в словах на подготовленной начитке и 12,81 % на записях в шуме. Работает через веб-интерфейс и API.

Полное описание, около 150 слов

«Речетекст» — сервис расшифровки русской речи. Аудио- и видеозаписи переводятся в текст: реплики разделяются по говорящим, участники подписываются именами, у каждого слова проставлено время, знаки препинания расставляются автоматически. Готовый текст выгружается в TXT, SRT и JSON.

Сервис устроен вокруг проверяемости. Точность и скорость опубликованы не одной цифрой, а по срезам речи, вместе с методикой: 2398 записей, 3,1 часа аудио, три открытых набора данных. Доля ошибок в словах — 6,71 % на подготовленной начитке, 8,76 % на живой спонтанной речи и 12,81 % на записях с бытовых устройств в шуме. Разброс двукратный, и он показан явно: средняя цифра скрывает именно то, что важно заказчику. Правила приведения текстов и скрипты прогона выложены, расчёт можно повторить; на сайте есть открытый калькулятор WER, работающий по тем же правилам.

Сервис применяют там, где расшифровка — часть работы: юридическая практика, медиа и подкасты, контакт-центры, исследования, образование, протоколы совещаний. Есть бесплатная проба без регистрации; тарификация по минутам звучания.

Цитата для материала

Готова к публикации, атрибуция — «основатель сервиса „Речетекст“».

Заявленной точности распознавания нельзя верить, пока не опубликована методика замера. Одна цифра без описания записей и правил сравнения не говорит ничего: на подготовленной начитке и на диктофоне в переговорной результат отличается вдвое. Поэтому мы публикуем не «точность 97 %», а шесть значений по срезам речи — и всё, чем они посчитаны.

Логотип и файлы

Логотип можно масштабировать, но не перекрашивать, не растягивать и не помещать на фон, где он теряет читаемость. Снимки интерфейса присылаем по запросу под конкретный материал — в них попадают тексты расшифровок, поэтому мы готовим их отдельно, а не выкладываем набором.

Как писать название

  • По-русски — «Речетекст», одним словом, с заглавной Р. Не «РечеТекст» и не «Рече-текст».
  • Латиницей — rechetext (в адресах и там, где кириллица неуместна).
  • Адрес сайта — rechetext.ru. Ссылку лучше вести на конкретную страницу по теме материала, а не только на главную.
  • Юридическая форма в текстах не указывается: сервис работает как проект, не как ООО или ИП.

Чего мы не утверждаем

Этот раздел здесь не для порядка: он избавляет и нас, и редакцию от формулировок, которые пришлось бы потом опровергать.

  • Мы не утверждаем, что распознаём точнее других сервисов: прогона чужих систем по этой методике у нас нет, а часть провайдеров запрещает такое использование в своих соглашениях. Сравнение появится, когда будет юридически чистым.
  • Опубликованные цифры получены на открытых наборах данных, а не на записях клиентов. На конкретной записи результат будет лучше или хуже в зависимости от того, на какой срез она похожа.
  • Замер выполнен на процессорах, без видеокарт. Это осознанный выбор ради стоимости обработки, и цифры скорости надо читать с этой оговоркой.

Контакт для редакций

Почта mail@rechetext.ru — отвечаем в тот же или на следующий рабочий день. Комментарий по теме распознавания речи, цифры под конкретный материал, снимки интерфейса, доступ для теста — по этому же адресу.