Субъективность
Два контролёра ставят разные баллы одной реплике. Спор съедает 1:1, а стандарт не калибруется.
Качество
Супервайзер успевает несколько переписок в месяц. Остальное — слепая зона: тон, дыра в регламенте, угроза жалобой. volbor ставит scorecard на каждый закрытый диалог. Путь оплаты — на сквозной аналитике, скорость смены — в Live View.
Выборка
Ручной аудит держит охват порядка 2–5% обращений: остальное не попадает в таблицу контролёра.[1]
Два контролёра ставят разные баллы одной реплике. Спор съедает 1:1, а стандарт не калибруется.
Волна «деньги не вернулись» всплывает через неделю, когда часть людей уже не пишет.
Часы QA уходят в заполнение чек-листа, а не в разбор системной ошибки в базе знаний.
Один диалог
Клиент спросил про возврат. Итог 92 / 100: тон и регламент закрыты, FRT второй реплики — единственный минус.[2]
Тимлиду: тон в порядке. Смотреть скорость в пик — не переписывать скрипт.
Охват
Каждый завершённый чат в виджете, Telegram, WhatsApp и почте проходит модель. Приветствие, тон, полнота, ссылки на регламент — по вашей карте, не по универсальному «вежливости».
Темы
«Курьер опоздал», «карта не проходит», «непонятный кабинет» собираются из тысяч формулировок. Это вход продукту. Конверсия шага сценария считается на хабе аналитики.
Калибровка
Апелляция открывает обоснование модели по репликам. Решение человека калибрует карту. Auto-QA не заменяет QA-лида — снимает первичную вычитку.
Поддержка — эмпатия и FRT. Продажи — потребность и возражение. Разные отделы не делят один чек-лист.
Средний балл смены и частые дыры. Для премии по скорости смотрите Live View, здесь — качество реплики.
Часы QA
Если QA-лид тратит 80 часов в месяц на первичную вычитку при ставке $50/час, это $4 000. Если первый проход забирает модель, а человек оставляет ~24 часа на апелляции и обучение, экономия порядка $2 800 на этой ставке. Два контролёра на том же объёме дают вилку до ~$9 000.[3]
Перед скорингом PII маскируется. Оценка живёт в контуре тенанта. Удаление диалога по GDPR убирает и материал аудита.
FAQ
В спорном месте ставится нейтральный флаг и диалог уходит супервайзеру, не «тихий провал».
Да. Карта привязывается к очереди и роли, не к одному глобальному шаблону.
Нет. Лид разбирает системные дыры и калибрует карту, а не вычитывает каждую переписку.
Обычно 5–15 секунд после закрытия обращения.[4]
Да, в профиле: баллы, реплики, апелляция.
Связанные решения
Scorecard не считает FRT смены и не строит воронку оплаты.
ЗачемОтличить «ответили быстро» от «ответили по регламенту».
Если нетКарточка смены зелёная, тон уже гонит людей.
ЗачемFRT в scorecard без таймера на тикете — оценка после факта.
Если нетБалл за скорость ставится, а эскалации нет.
ЗачемСверка факта: модель видит, что ссылка на регламент не отправлена.
Если нетВежливые, но неверные ответы проходят как «хорошо».
ЗачемРазбор спорного диалога внутри треда, не в стороннем чате.
Если нетАпелляция тонет в переписке супервайзеров.
ЗачемКластер «доставка» связать с обрывом шага воронки.
Если нетЗнаете боль, не знаете, где в сценарии её чинить.
ЗачемОткрыть тот же диалог, который получил 62 балла.
Если нетОтчёт качества без рабочего окна.
Старт
Запустите калибровку на сотнях диалогов рядом с ручной оценкой, затем откройте охват на всю очередь.
Открыть кабинетПояснения к цифрам
Оценка ёмкости: несколько диалогов на оператора в месяц при потоке сотен. Это описание типичной выборки, не исследование рынка и не метрика кабинета.
Учебный разбор на странице: сумма критериев 10+25+20+20+17 = 92. Штраф только за FRT второй реплики 4 мин при цели 2 мин.
Сценарий: 80 ч/мес × $50/ч = $4 000 полной вычитки. После Auto-QA остаётся ~24 ч калибровки: экономия (80−24)×$50 = $2 800. Верхняя граница — два таких контура (~$5 600–$9 000 при большей ставке или втором контролёре). Не обещание продукта.
Типичное время прогона закрытого диалога в контуре Auto-QA volbor, не SLA внешнего хранилища.