← Блог
Метод6 июля 2026 г.·7 мин чтения·Сергей Полухин, CTO, PapAI Soft

Скоринг звонков менеджеров: как построить систему баллов без искажений

Почему один общий балл за звонок вводит в заблуждение и как построить скоринг по критериям с опорой на цитаты из разговора.

РОП выгружает отчёт за неделю: у Марии 92 балла, у Дениса 61. На планёрке Денис спрашивает, что именно не так с его звонками — и внятного ответа нет. Балл посчитан, а что за ним стоит, никто объяснить не может. Через месяц выясняется, что Мария просто быстро проговаривает приветствие и имя компании — два формальных пункта из десяти — а по факту не выясняет потребность и продавливает возражения молчанием. Балл был высоким, а звонки — слабыми.

Это типичная ловушка скоринга: одна цифра пытается описать разговор, в котором на самом деле смешаны десять разных навыков. Чтобы балл работал, а не вводил в заблуждение, его нужно строить иначе.

Почему один балл почти всегда врёт

Единая оценка звонка — это среднее по больнице. Она складывает вещи, которые физически нельзя складывать: соблюдение скрипта, работу с возражениями, тон разговора, факт назначения следующего шага. Менеджер может получить 85 баллов из 100 за счёт того, что аккуратно проговорил приветствие, регламентные фразы и прощание, и при этом полностью провалить выявление потребности — просто потому что вес этого критерия в общей формуле оказался небольшим.

Проблема усугубляется, когда балл считает человек на слух, выборочно прослушивая часть звонков. Оценка становится не столько измерением качества, сколько измерением настроения проверяющего в конкретный день. У большинства сервисов на рынке в принципе нет ресурса слушать каждый звонок вручную — ОКК держится на выборке, и та часть менеджера, что попала под прослушку, определяет весь его балл за месяц.

Единственный способ убрать это искажение — не пытаться сжать разговор в одно число, а честно раскладывать его на составляющие и проверять каждую отдельно.

Разбивка по критериям вместо общего балла

Рабочая модель скоринга строится не от балла, а от регламента продаж, который менеджеры реально должны соблюдать: приветствие, выявление потребности, презентация по болям клиента, отработка возражений, фиксация договорённостей, следующий шаг. Каждый критерий — это отдельный вопрос с отдельным вердиктом: выполнено, выполнено частично, не выполнено.

В CANAL это устроено так, что сам регламент или скрипт продаж загружается в систему пользователем, а LLM строит из него чек-лист критериев — то есть шкала оценки соответствует тому, как реально работает именно этот отдел продаж, а не общей универсальной методичке. Если в регламенте нет пункта про допродажу, скоринг не будет штрафовать за её отсутствие; если есть жёсткое требование фиксировать бюджет клиента — это станет отдельным проверяемым критерием.

Итоговый балл при такой структуре — это не магическое число, а сумма или взвешенное среднее по прозрачным составляющим, которые всегда можно развернуть обратно и посмотреть, из чего они собраны. РОП видит не «61 балл», а «выявление потребности — не выполнено, работа с возражением по цене — частично, фиксация следующего шага — выполнено». С этим можно идти на разбор звонка и что-то менять.

Что разложить в первую очередь

Есть смысл начать с трёх-пяти критериев, которые прямо влияют на конверсию: выяснение потребности, презентация решения под конкретную боль, отработка ключевых возражений, назначение следующего шага с датой. Формальные вещи вроде приветствия и представления компании тоже стоит проверять, но не давать им вес, сопоставимый с содержательными этапами разговора — иначе получится та же ловушка, только с более длинным списком пунктов.

Как менеджеры учатся играть на балл

Как только скоринг становится метрикой, от которой зависит премия или место в рейтинге, менеджеры начинают оптимизировать не разговор, а сам балл. Это происходит с любой системой оценки, если она непрозрачна: проговаривается регламентная фраза-триггер, которую якобы ищет система, клиенту не дают договорить до возражения, звонок искусственно затягивается, потому что «умный» алгоритм где-то в отчётах считал долгие звонки более качественными.

Единая цифра без разбивки на критерии особенно уязвима к этому: менеджер быстро вычисляет, какие два-три действия дают основной вклад в балл, и начинает исполнять именно их, игнорируя суть разговора. Формальное соответствие растёт, реальное качество — нет.

Разбивка по критериям снижает соблазн играть на систему просто потому, что критериев больше и они содержательные: нельзя одной фразой закрыть сразу «выявление потребности» и «отработку возражения», если это два разных вопроса с разными ответами. Но полностью проблема решается только на следующем шаге — когда за вердиктом стоит не абстрактная оценка, а конкретное доказательство.

Evidence как защита от искажений

Ключевая механика, которая не даёт скорингу превратиться в чёрный ящик, — evidence-разбор: под каждым вердиктом по критерию система приводит точную цитату из разговора с таймкодом, а не голую оценку. Не «выявление потребности: не выполнено», а конкретная фраза менеджера и клиента в том месте разговора, где потребность нужно было выяснить и не выяснили.

Это меняет саму природу спора о качестве. Раньше разбор строился на памяти и интерпретации: РОП утверждает одно, менеджер — другое, и оба правы в рамках собственных ощущений от разговора. С цитатой и таймкодом спорить не о чем — можно переслушать конкретные тридцать секунд и увидеть, было выполнено требование регламента или нет.

Evidence решает и вопрос доверия к системе в целом. Когда менеджер видит не абстрактный балл, а точную выдержку из своего звонка, он не может обвинить систему в предвзятости или в том, что «алгоритм не понимает контекст» — контекст здесь в буквальном смысле процитирован. Это же работает и в обратную сторону: если менеджер уверен, что критерий выполнен, а система поставила низкий вердикт, цитата либо подтверждает вердикт, либо вскрывает ошибку модели — и это тоже полезный сигнал.

Ровно так устроен демо-разбор звонка в CANAL — без регистрации можно посмотреть, как вердикт по каждому критерию сопровождается цитатой и таймкодом, а не просто цифрой.

Как внедрить скоринг без переделки CRM

Практический вопрос — сколько это стоит внедрить. Если отдел продаж работает в Bitrix24, amoCRM или Chatwoot, подключение делается самостоятельно за 10 минут, без звонка менеджеру и без внедренцев — интеграция описана на странице как это работает. Для прочих CRM и телефонии подключение делает инженер по запросу, и это уже входит в стоимость подписки.

Дальше важно, что при таком подходе проверяются все звонки, а не выборка: 100% разговоров разбираются автоматически по загруженному регламенту, и каждый попадает в отчёт с разбивкой по критериям и цитатами, а не только те, что случайно прослушал руководитель. Тарифы — от бесплатного плана без карты для теста до корпоративных условий по запросу — указаны на странице тарифов, а данные звонков хранятся на серверах в РФ с разграничением доступа по ролям, что описано на странице безопасности.

Частые вопросы

Сколько критериев должно быть в скоринге, чтобы он был рабочим, а не избыточным? Универсального числа нет, но практика показывает, что имеет смысл начинать с 5–8 критериев, привязанных к реальным этапам разговора из регламента, и добавлять новые только когда появляется конкретная причина — иначе чек-лист превращается в формальность, которую никто не читает целиком.

Что делать, если у разных менеджеров разные скрипты продаж — например, для входящих и исходящих звонков? Регламент и чек-лист критериев привязываются к загруженному документу, поэтому для разных типов звонков можно вести разные наборы критериев — система строит чек-лист из того текста, который загружен, а не навязывает единую универсальную структуру.

Как быть с субъективными критериями вроде тона голоса или эмпатии? Такие критерии стоит переформулировать в проверяемые действия — не «был ли менеджер эмпатичным», а «признал ли менеджер проблему клиента словами, прежде чем предлагать решение». Формулировка в виде конкретного действия делает вердикт проверяемым по цитате, а не оценочным.

Можно ли использовать скоринг для премий менеджеров сразу после внедрения? Разумнее сначала откалибровать систему на исторических звонках и сверить вердикты с оценками РОПа хотя бы за пару недель, а уже потом привязывать к деньгам — так меньше риска, что часть критериев окажется неточно сформулирована и повлияет на выплаты несправедливо.

Балл без разбивки на критерии и без цитат — это просто число, которому приходится верить на слово. Балл, который раскладывается на конкретные этапы разговора и подтверждается цитатой с таймкодом, — это инструмент, с которым можно спорить, проверять и опираться на него в разговоре с менеджером.

Проверьте это на своих звонках

Подключите CRM или телефонию сами за 10 минут и получите разбор с цитатой-доказательством. Free — без карты.