Статус «неизвестно» в аналитике: что делать, когда доказательств недостаточно
Система, которая принудительно присваивает значение каждому разговору, делает отчёт полнее реальности. В статье — роль статуса «неизвестно» в аналитике, разница трёх статусов, правильный расчёт процентов, отчёт об охвате и честный ответ на вопрос о несобранных данных.
Короткий ответ
Аналитике разговоров нужен статус «неизвестно» (или «неясно»), потому что во многих разговорах для поля просто нет информации: клиент не называет бюджет, не возражает, не выражает явно намерение. Если система принудительно присваивает значение каждому разговору, пробел заполняется ближайшим значением, и отчёт выглядит полнее и увереннее реальности. Статус «неизвестно» предотвращает эту ложную точность.
Нужно различать три ситуации: «другое» (информация есть, но подходящего значения в списке нет), «неизвестно» (информации нет) и «не проанализировано» (разговор ещё не проанализирован или анализ завершился ошибкой). Если свалить их вместе, не видно ни качества списка, ни охвата отчёта.
Цена принудительной категоризации
Представьте поле «диапазон бюджета» всего с четырьмя значениями и без «неизвестно». Большинство клиентов о бюджете ничего не говорят. AI вынужден выбрать значение для каждого разговора и обычно выбирает самое «среднее». В итоге отчёт показывает, что у большинства клиентов средний бюджет, — а на деле это просто отсутствие информации, собранное в одно значение. Маркетинг строит рекламу на средний сегмент по этой цифре.
Три статуса: определение и разница
- ДругоеКлиент что-то сказал по этому полю, но это не подходит ни под одно значение списка. Сигнал: возможно, список нужно расширить.
- НеизвестноВ разговоре нет информации для этого поля. Сигнал: этот вопрос в разговоре вообще не поднимался.
- Не проанализированоРазговор ещё в очереди, не подходит под условия анализа или завершился ошибкой. Сигнал: число неполное.
«Неизвестно» само по себе инсайт
Высокая доля «неизвестно» — не проблема, а информация. Если у 70% лидов бюджет неизвестен, значит, отдел продаж не спрашивает о бюджете — и, возможно, должен. Если «причина потери» неизвестна в большинстве разговоров, клиенты уходят, не называя причину, — нужен follow-up-вопрос. Доля «неизвестно» по каждому полю — сигнал и о качестве разговоров, и о скрипте.
Как правильно снизить долю «неизвестно»
Если доля «неизвестно» высокая, её нельзя снижать, требуя от AI «выбирать смелее» или удаляя значение «неизвестно», — это просто возврат к принудительной категоризации. Правильный путь — создать информацию в самом разговоре: добавить один-два уточняющих вопроса в первые сообщения оператора или бота («в каком районе ищете?», «когда нужно?»). Когда клиент отвечает, информация появляется в разговоре, и поле заполняется честно. Снижение доли «неизвестно» после такого изменения показывает, что улучшились и аналитика, и сам продающий разговор.
Как считать проценты в отчёте
Есть два разных процента, и их смешение создаёт ложное впечатление. Первый — от всех разговоров: «возражение по цене в 12% разговоров с возражением». Второй — от разговоров, где информация есть: «40% клиентов с известным бюджетом — в нижнем сегменте». Рядом с каждым процентом пишите знаменатель и отдельно показывайте долю «неизвестно». Иначе число, прочитанное как «40% клиентов», на деле относится к небольшой их части.
Отчёт об охвате
- Сколько разговоров было за период.
- Сколько проанализировано, сколько в очереди, сколько с ошибкой или пропущено.
- Среди проанализированных — доля «неизвестно» по каждому полю.
- Доля «другого».
Эти четыре строки должны стоять в начале каждого отчёта. Они сразу показывают читателю, насколько полны цифры.
Вопрос о данных, которые не собирались
Крайняя форма «неизвестно» — поле, которое вообще не создавали. Руководитель спрашивает «какой цвет клиенты спрашивают чаще?», а поля «цвет» нет. Плохая система возьмёт соседнее поле — например, «интересующий продукт» — и придумает ответ. Хорошая система прямо скажет: эти данные не собираются, нужно создать поле. Для пользователя это неприятный ответ, но единственно честный.
Разрешить AI выбирать «неизвестно»
В инструкции каждого поля прямо напишите: «если в разговоре нет информации об этом, выбери «неизвестно»; не угадывай». Дайте примеры, какой разговор должен быть «неизвестно», а какой «другое». При проверке отдельно фиксируйте случаи, когда «неизвестно» выбрано ошибочно (информация была, но AI её не увидел), — это часть процесса проверки AI-категоризации.
Иллюстративный пример
Это иллюстративный пример. Агентство недвижимости включило поле «количество комнат» без «неизвестно». Отчёт показывает, что большинство клиентов ищут двухкомнатные квартиры, и агентство делает ставку на двухкомнатные проекты. Когда «неизвестно» добавляют и разговоры анализируют заново, выясняется, что большинство клиентов число комнат вообще не называют — AI записывал их в самое частое значение.
Решение меняется: сначала в первое сообщение операторов добавляют вопрос «сколько комнат вы ищете?», а реальное распределение измеряют снова через месяц.
Типичные ошибки
- Не добавлять в поле значение «неизвестно».
- Объединять «неизвестно» и «другое» в одно значение.
- Показывать проценты от знаменателя без «неизвестно» и не писать об этом.
- Считать непроанализированные разговоры нулевым результатом.
- Прятать долю «неизвестно» как проблему — это сам по себе сигнал.
Границы
- AI иногда выбирает «неизвестно», когда информация есть, — проверка ловит это как ложноотрицательную ошибку.
- Если «неизвестно» очень много, поле может не подходить для этого канала или типа разговора.
- Показатель охвата говорит о полноте анализа, а не о правильности результата.
«Неизвестно» и охват в Vexvon
В Vexvon каждое поле возвращает список, и если в разговоре информация не найдена, список остаётся пустым — от AI не требуют угадывать. Ответы, попавшие в «другое», хранятся отдельно. Отчёты из базы анализа показывают, какая доля периода проанализирована, а панель считает проанализированные, ожидающие и ошибочные разговоры. Когда руководитель спрашивает о данных, которые компания не собирает, AI-помощник не подставляет соседнее поле, а говорит, что данных нет. Подробнее: аналитика Vexvon.
Следующий шаг
Проверьте, что в каждом поле есть отдельные значения «неизвестно» и «другое», и добавьте в начало отчёта блок охвата из четырёх строк. Правила таксономии — в статье таксономия аналитики разговоров; формат отчёта можно собрать вместе на демо.
Продолжение темы: метрики дашборда аналитики разговоров.
- Данные, таксономия и надёжность5 мин чтенияТочность транскрипции и аналитика: как ошибки искажают результаты
- Данные, таксономия и надёжность5 мин чтенияИнтеграция аналитики разговоров с CRM: как связать данные звонков и чатов
- Данные, таксономия и надёжность5 мин чтенияТаксономия аналитики разговоров: как построить правильную систему категорий