Расшифровка звонков для контакт-центра
Точный текст звонка с разделением на оператора и клиента, именами и таймкодами — через API или загрузкой. Голоса операторов узнаются между звонками, а не нумеруются заново в каждой записи.
Три минуты бесплатно · до 2 ГБ на файл
Узнавание между звонками — то, чего нет у облачных платформ
Разделить одну запись на двоих умеют все. Проблема начинается на второй записи: у обычной диаризации нумерация говорящих своя в каждом звонке, поэтому «Спикер 1» из вчерашнего разговора и «Спикер 1» из сегодняшнего — разные люди, и сопоставить их нечем.
У нас голоса живут в справочнике организации. Один раз названный оператор дальше опознаётся сам, а вместе с ним — постоянный клиент, который звонит регулярно. Практическая разница:
- Разбор по операторам без сверки с расписанием смен: в расшифровке уже стоит имя.
- История клиента собирается по голосу, даже если он звонит с разных номеров.
- Проверка спорного звонка — понятно, кто говорил, без прослушивания «на опознание».
Где мы в вашем контуре
Мы — слой распознавания, а не платформа аналитики. Это осознанно: строить дашборды и правила скоринга поверх чужих данных умеет ваша система, а качество текста на входе определяет всё, что она потом посчитает.
- Приём — запись уходит на
POST /api/jobsсырым потоком, отвечает идентификатор задачи. - Готовность — по событиям SSE или опросом статуса; ждать в цикле не нужно.
- Результат — JSON: реплики с границами слов, метки и имена говорящих, длительность.
- Термины — названия продуктов и тарифов передаются подсказками, чтобы не править их в каждом звонке.
Что важно знать про записи из телефонии
- Полоса 8 кГц. Стандарт телефонии режет высокие частоты: «с» и «ш» путаются. Это ограничение канала, а не модели — цифры и фамилии в критичных местах стоит сверять.
- Разведённые каналы. Если оператор и клиент записаны в разные каналы стерео, принадлежность реплик известна точно — лучший вариант из возможных.
- Гарнитура против громкой связи. Гарнитура даёт чистый ближний звук; громкая связь добавляет эхо и наложение речи, на котором разметка иногда смазывается.
- Музыка на удержании. В текст она не попадает: участки без речи не распознаются, и платить за них не приходится.
Вопросы
Это речевая аналитика?
Нет, и подменять её мы не пытаемся. Мы отдаём точный текст звонка с разделением по участникам, именами и таймкодами через API — а отчёты, скоринг и правила строит ваша система или платформа аналитики, которой этот текст и нужен на входе.
Как сервис узнаёт оператора между звонками?
Голос оператора попадает в справочник организации, и в следующих записях он опознаётся автоматически. Именно это отличает нас от облачных решений, где нумерация говорящих начинается заново в каждой записи.
Записи из телефонии на 8 кГц — нормально?
Это основной материал. Узкая полоса режет шипящие, поэтому цифры и фамилии стоит проверять, но смысл диалога и разметка по участникам получаются надёжно. Если каналы разведены по стерео, оператор и клиент различаются точно.
Сколько стоит обработка при больших объёмах?
Оплата за секунды обработанного аудио, тариф на странице цен. Нет ни подписки, ни платы за рабочие места: месяц без звонков — ноль в счёте.
Как гонять поток звонков без ручной загрузки?
По ключу организации: запись отправляется на /api/jobs, готовность приходит по SSE, результат забирается JSON. Ключи выдаются на каждую интеграцию отдельно и отзываются по одному.
Можно ли не хранить расшифровки у вас?
Да, хранение отключается на уровне организации: в журнале не останется ни текста, ни имени файла. Загруженный файл удаляется после обработки всегда.