Расшифровка звонков для контакт-центра

Точный текст звонка с разделением на оператора и клиента, именами и таймкодами — через API или загрузкой. Голоса операторов узнаются между звонками, а не нумеруются заново в каждой записи.

Три минуты бесплатно · до 2 ГБ на файл

Узнавание между звонками — то, чего нет у облачных платформ

Разделить одну запись на двоих умеют все. Проблема начинается на второй записи: у обычной диаризации нумерация говорящих своя в каждом звонке, поэтому «Спикер 1» из вчерашнего разговора и «Спикер 1» из сегодняшнего — разные люди, и сопоставить их нечем.

У нас голоса живут в справочнике организации. Один раз названный оператор дальше опознаётся сам, а вместе с ним — постоянный клиент, который звонит регулярно. Практическая разница:

  • Разбор по операторам без сверки с расписанием смен: в расшифровке уже стоит имя.
  • История клиента собирается по голосу, даже если он звонит с разных номеров.
  • Проверка спорного звонка — понятно, кто говорил, без прослушивания «на опознание».
Как это работает по порогам. При высокой близости голоса имя подставляется сразу; при средней остаётся подсказкой, которую подтверждает человек; при низкой говорящий считается новым. Один порог здесь не годится: высокий не узнаёт почти никого, низкий подставляет чужие имена — а неверное имя в отчёте хуже, чем его отсутствие.

Где мы в вашем контуре

Мы — слой распознавания, а не платформа аналитики. Это осознанно: строить дашборды и правила скоринга поверх чужих данных умеет ваша система, а качество текста на входе определяет всё, что она потом посчитает.

телефония → запись звонка → Речетекст (текст, участники, таймкоды) → ваша CRM или аналитика
  • Приём — запись уходит на POST /api/jobs сырым потоком, отвечает идентификатор задачи.
  • Готовность — по событиям SSE или опросом статуса; ждать в цикле не нужно.
  • Результат — JSON: реплики с границами слов, метки и имена говорящих, длительность.
  • Термины — названия продуктов и тарифов передаются подсказками, чтобы не править их в каждом звонке.

Что важно знать про записи из телефонии

  • Полоса 8 кГц. Стандарт телефонии режет высокие частоты: «с» и «ш» путаются. Это ограничение канала, а не модели — цифры и фамилии в критичных местах стоит сверять.
  • Разведённые каналы. Если оператор и клиент записаны в разные каналы стерео, принадлежность реплик известна точно — лучший вариант из возможных.
  • Гарнитура против громкой связи. Гарнитура даёт чистый ближний звук; громкая связь добавляет эхо и наложение речи, на котором разметка иногда смазывается.
  • Музыка на удержании. В текст она не попадает: участки без речи не распознаются, и платить за них не приходится.

Вопросы

Это речевая аналитика?

Нет, и подменять её мы не пытаемся. Мы отдаём точный текст звонка с разделением по участникам, именами и таймкодами через API — а отчёты, скоринг и правила строит ваша система или платформа аналитики, которой этот текст и нужен на входе.

Как сервис узнаёт оператора между звонками?

Голос оператора попадает в справочник организации, и в следующих записях он опознаётся автоматически. Именно это отличает нас от облачных решений, где нумерация говорящих начинается заново в каждой записи.

Записи из телефонии на 8 кГц — нормально?

Это основной материал. Узкая полоса режет шипящие, поэтому цифры и фамилии стоит проверять, но смысл диалога и разметка по участникам получаются надёжно. Если каналы разведены по стерео, оператор и клиент различаются точно.

Сколько стоит обработка при больших объёмах?

Оплата за секунды обработанного аудио, тариф на странице цен. Нет ни подписки, ни платы за рабочие места: месяц без звонков — ноль в счёте.

Как гонять поток звонков без ручной загрузки?

По ключу организации: запись отправляется на /api/jobs, готовность приходит по SSE, результат забирается JSON. Ключи выдаются на каждую интеграцию отдельно и отзываются по одному.

Можно ли не хранить расшифровки у вас?

Да, хранение отключается на уровне организации: в журнале не останется ни текста, ни имени файла. Загруженный файл удаляется после обработки всегда.

Ещё:расшифровка звонковузнавание по голосудиаризацияAPI и интеграциясколько стоит