Расшифровка глубинных интервью
Загрузите записи волны — получите дословный текст с разделением на модератора и респондента и временем у каждой реплики. Голос модератора запоминается, поэтому во всех следующих интервью он подписывается сам.
mp3, wav, m4a, mp4 — дословно, с разделением на модератора и респондента
Загружайте запись любой длины — бесплатно расшифруем первые 3 минуты. Без регистрации.
Волна интервью, а не одна запись
Качественное исследование редко состоит из одного разговора. Обычно это двадцать-тридцать интервью по одному гайду, собранные за две-три недели, — и расшифровка каждого нужна целиком, дословно, потому что дальше по ней идёт кодирование.
Именно поэтому ручная расшифровка здесь съедает не вечер, а недели: час записи набирается четыре-шесть часов, а в волне таких часов тридцать. Отдать на сторону — значит показать записи респондентов подрядчику и ждать очереди.
Смета волны
24 интервью по 75 минут — это 30 часов записи. Расшифровка с разделением по голосам обойдётся в 720 ₽ на всю волну, одно интервью — 30 ₽. Оплата идёт за обработанные секунды: пауза между волнами не стоит ничего, а неизрасходованный пакет не сгорает, потому что пакетов нет.
Модератор подписывается сам во всей волне
В глубинном интервью два голоса, и один из них — ваш, один и тот же во всех записях. Сервис хранит голосовые отпечатки: назвав модератора один раз, вы получаете его имя во всех следующих расшифровках автоматически. Размечать каждую из двадцати четырёх записей заново не нужно — это и есть та часть работы, которую обычно приходится делать руками.
Респондента можно оставить под обозначением из гайда — R7, «участник 3», код скрининга. Имя говорящего хранится отдельно от текста и подставляется при чтении, поэтому уточнение обозначения обновляет все ранее расшифрованные интервью сразу.
Дословно — потому что кодировать придётся не смысл, а слова
Причёсанная расшифровка ломает качественный анализ. «Ну, наверное, я бы попробовал» и «я бы попробовал» — разные данные: в первом случае сомнение, во втором готовность. Поэтому текст остаётся дословным: слова-заполнители, повторы и оговорки на месте, а знаки препинания расставляются автоматически, чтобы реплику можно было читать.
- Цитата с проверкой. Таймкод стоит у каждого слова — вернуться к месту в записи и услышать интонацию можно за секунду, в том числе спустя месяц после интервью.
- Таблица для кодирования. Выгрузка JSON содержит время каждого слова и метку говорящего: из неё собирается таблица реплик для программы качественного анализа или для обычной сводки в электронной таблице.
- Сверка с гайдом. Реплики модератора видны отдельно, поэтому легко проверить, все ли блоки гайда были заданы и где интервью ушло в сторону.
Что портит расшифровку исследовательского интервью
Точность зависит от материала сильнее, чем от системы: на подготовленной начитке наш замер даёт 6,71 % ошибок в словах, на живой спонтанной речи — 8,76 %, а на записях с бытовых устройств в шуме — 12,81 %. Глубинное интервью — это как раз живая речь, и обычно не в студии. Что реально сдвигает результат:
- Созвон вместо встречи. Записывайте средствами самой встречи, а не микрофоном ноутбука «в комнату»: во втором случае к речи респондента добавляется эхо колонок.
- Ноутбук в центре стола. Дальний микрофон добавляет больше ошибок, чем выбор системы распознавания. Диктофон ближе к респонденту или гарнитура улучшают текст сильнее, чем любые настройки.
- Тихий респондент и громкий модератор. Разница в громкости мешает не распознаванию, а разделению по голосам. Если слышно, что респондента еле слышно, — стоит подвинуть микрофон, а не надеяться на обработку.
- Профессиональный жаргон и названия. После регистрации термины передаются вместе с записью списком через запятую, и похожие распознанные слова заменяются на ваше написание.
Вопросы
Сколько стоит расшифровать волну интервью?
Оплата идёт за обработанные минуты, без подписки и без пакетов. Волна из 24 интервью по 75 минут — это 30 часов записи и 720 ₽ вместе с разделением по голосам. Одно интервью на 75 минут — 30 ₽. Месяц без записей стоит ноль.
Расшифровка дословная или причёсанная?
Дословная. Модель распознаёт то, что сказано, и не переписывает фразу гладко: для кодирования это принципиально — «ну, я не знаю, наверное» и «я не знаю» относятся к разным категориям. Знаки препинания расставляются автоматически, а слова-заполнители остаются на месте.
Как отделяются реплики модератора от реплик респондента?
Сервис делит запись по голосам без разметки, а вы один раз называете говорящих. Голос модератора запоминается на организацию, поэтому во всех следующих интервью волны он подписывается сам — размечать каждую запись заново не нужно. Респонденту при этом можно оставить обозначение вместо имени.
Что происходит с записями респондентов?
Файл удаляется после обработки. Расшифровка остаётся в вашей организации, доступ к ней — у тех, кого вы пригласили. Условия описаны на странице «Конфиденциальность»; если вы работаете по согласиям респондентов, читать стоит именно её, а не эту страницу.
В каком виде выгружается текст для анализа?
TXT — реплики с именами и временем, обычный текст для чтения и цитирования. SRT — то же с отрезками времени, читается видеоредакторами. JSON — время каждого слова и метки говорящих, из него собирается таблица для программ качественного анализа или для своей сводки.
Насколько точно распознаётся живая речь респондента?
На нашем открытом замере доля ошибок в словах на живой спонтанной речи — 8,76 %, а на записях с бытовых устройств в шуме — 12,81 %. Это измерено на 2398 записях, методика и скрипты открыты. Планируйте вычитку: расшифровка снимает набор текста, но не заменяет сверку цитат перед публикацией.
Страница обновлена 3 сентября 2026