Реклама. ИП Ахунов Александр Раисович, ИНН 665911236854
AI-агент на первой линии МСП: сценарии, handoff и KPI 30–60 дней

AI-агент на первой линии МСП: сценарии, handoff и KPI 30–60 дней

AI-агент на первой линии для МСП в РФ окупается, когда закрывает 40–70% типовых диалогов сам, передаёт «сложные» человеку с полным контекстом за менее 30 секунд и даёт измеримые KPI уже на 30–60 день: % авто-резолва, SLA ответа, CSAT после handoff и стоимость закрытого обращения — а не «красивый чат на сайте».

Я ставлю первую линию так же, как смену операторов: узкий scope, stop-list, очередь эскалаций и ежедневный разбор провалов. Ниже — рабочие сценарии для продаж и поддержки, протокол handoff, таблица KPI и типовые сбои, которые убивают ROI.


Что должна делать первая линия (и чего не должна)

Первая линия — это квалификация + FAQ + маршрутизация, а не «закрытие сделки нейросетью». Для МСП это обычно Telegram, сайт-виджет, WhatsApp/MAX и иногда голос.

КаналЧто агент делает самКогда handoff обязателен
Сайт / виджетFAQ, прайс-ориентир, сбор контакта, слот в CRMЖалоба, юр. спор, кастомный расчёт, VIP
Telegram / MAXСтатус заказа, документы, запись, квалификация лидаНегатив, повторная претензия, B2B-переговоры
Продажи (inbound)BANT-лайт, отрасль, бюджет-диапазон, следующий шагСкидка вне сетки, tender, «созвон с ЛПР»
ПоддержкаСброс доступа, инструкции, типовые инциденты L1Инцидент P1, деньги/возврат, угроза оттока

Чеклист scope перед запуском:

  • 30–50 эталонных диалогов «успех / handoff / отказ»
  • Stop-list тем (медицина, юр. ответственность, цены «от балды»)
  • Поля CRM, которые агент обязан заполнить
  • Фраза-дисклеймер: клиент знает, что пишет AI
  • Владелец базы знаний (1 человек, не «вся команда»)

Handoff человеку: протокол, без которого первая линия ломается

Без handoff-протокола клиент повторяет историю, оператор злится, CSAT падает именно на «пограничных» диалогах. Я фиксирую передачу как смену смены.

Поле при handoffЗачемМинимум
Intent + summary3–5 предложенийобязательно
Sentiment / рискнегатив, VIP, churnscore 1–5
Уже сделано агентомссылки, тикеты, обещаниясписок
Почему эскалацияправило / confidenceкод причины
Next best actionчто сказать человеку1 шаг
Trace IDаудит и QAобязательно

Правила эскалации (пример для МСП):

  1. Клиент дважды уточняет одно и то же → handoff.
  2. Confidence ниже порога или hit stop-list → handoff сразу.
  3. Слова «юрист / возврат / претензия / роспотреб» → handoff + приоритет.
  4. Сделка выше N ₽ или enterprise-аккаунт → soft-handoff с саммари, агент не торгуется.
  5. Тишина оператора сверх SLA → агент пишет статус «передал коллеге, ждите до …».

Подробный каркас QA и скоринга я разбирал отдельно: протокол handoff и QA-скоринг.


KPI за 30 и 60 дней: что смотреть, а не «вау-эффект»

На 7-й день метрики ещё «шум». На 30-й — видно product-market fit агента. На 60-й — unit-экономика.

KPIДень 0–14 (baseline)Цель к дню 30Цель к дню 60Как считать
Auto-resolve rate15–25%40–55%50–70%закрыто без человека / все диалоги in-scope
First response timeминуты–часыменее 30 сек (чат)стабильноp50 / p90
Handoff qualityнет данных≥ 80% «ок» у оператора≥ 90%оценка 1–5 после приёма
CSAT / CSI postкак былоне хуже baseline+0.1…0.3только in-scope
Cost per resolvedFTE-доля−20–35%−30–50%(LLM + FTE handoff) / резолвы
Lead→SQL (продажи)baseline+10–20% квалиф.стабильный upliftCRM stage
Hallucination / wrong answerниже 3% выборкиниже 1,5%ежедневный QA 20–50 диалогов

30 дней — операционный каркас:

  • Неделя 1: shadow-mode (агент пишет черновик, человек отправляет).
  • Неделя 2: go-live на 20–30% трафика, узкий FAQ.
  • Неделя 3–4: расширение интентов, правка KB по топ-провалам.

60 дней — экономика:

  • Считаем cost per resolved и payback внедрения.
  • Режем «мусорные» интенты, где агент только тратит токены.
  • Решаем: один агент хватает или нужен multi-agent (см. оркестрацию).

Типовые сбои первой линии (и как чинить)

СбойСимптомКореньФикс за 1–5 дней
«Умный, но врёт»жалобы на факты, ценыKB дырявая / нет ground truthFAQ из CRM/доков, запрет выдумывать цены
Бесконечный пинг-понг8+ реплик без решениянет exit-criteriamax turns → handoff
Handoff «пустой»оператор переспрашиваетнет summary-схемыжёсткий JSON handoff
Двойные ответыагент и человек пишут вместенет lock диалогаclaim/lock в очереди
Утечка scopeагент лезет в юр/медицинуслабый guardrailstop-list + classifier
Пик токеновсчёт LLM ×3длинный контекст, retry-штормtrim history, idempotency
«Всё на AI»CSAT падает на сложныхнет HITLматрица эскалаций
Мёртвая CRMлиды без полейагент не пишет в CRMобязательные поля + алерт

Антипаттерн: запускать «универсального бота на весь бизнес» в день 1. Для МСП выигрывает узкий first-line на 1–2 канала и 1 воронку.


Чеклист запуска за 2 недели (практика)

  1. День 1–2: 40 диалогов из истории → кластеры интентов, stop-list.
  2. День 3–5: KB + 15 golden answers + интеграция CRM (контакт, этап, источник).
  3. День 6–8: shadow-mode, QA-скоринг, правка промпта/ролей.
  4. День 9–11: 25% live-трафика, SLA handoff, lock диалога.
  5. День 12–14: разбор топ-20 провалов, go/no-go на 100% in-scope.

Если нужен каркас ролей и guardrails — см. архитектуру агента: роли, guardrails, handoff.


Часто задаваемые вопросы

Нужен ли отдельный «отдел AI», чтобы поставить первую линию?

Нет. Для МСП достаточно владельца процесса (продажи или поддержка), доступа к CRM/мессенджеру и 1 технической точки (интегратор или сильный no-code). Отдел AI имеет смысл, когда агентов больше 3 и есть compliance/аудит.

Можно ли сразу заменить ночную смену операторов?

Частично — да, на FAQ и статусах. Полная замена ночи без handoff-дежурного опасна: P1 и деньги требуют человека. Я оставляю on-call хотя бы в режиме «забрать эскалацию за 15 минут».

Какая модель лучше для первой линии в РФ?

Важнее grounding и протокол, чем бренд модели. Для диалога — стабильный LLM с tool-calling; для данных — ваша CRM/KB. Учитывайте закон о маркировке AI-контента и дисклеймер в чате.

Сколько диалогов нужно, чтобы понять, что агент «поехал»?

Минимум 100–150 live in-scope за 2 недели плюс ежедневная выборка 20–30 на QA. До этого любые % auto-resolve — лотерея.


Читайте также


Готовый first-line под вашу CRM и мессенджеры — без «бота ради бота»: https://raisovich.ru

Какие KPI первой линии смотреть уже на 30-й день?

Auto-resolve rate 40–55%, first response p50 менее 30 секунд в чате, handoff quality ≥ 80% у операторов и cost per resolved −20–35% к baseline — без этих цифр «красивый бот» ещё не продукт.

Что обязательно передать человеку при handoff?

Intent и краткое summary, sentiment/риск, список уже сделанного агентом, код причины эскалации, next best action и trace ID — иначе оператор переспрашивает клиента и CSAT падает на пограничных диалогах.

Почему нельзя запускать универсального бота на весь бизнес в день 1?

Узкий first-line на 1–2 канала и одну воронку даёт измеримый ROI; «универсальный» scope размывает KB, раздувает токены и ломает stop-list до того, как появятся эталонные диалоги.

Р
Команда экспертов по AI-автоматизации бизнеса, созданию сайтов и продвижению нейросетями. Помогаем бизнесу расти с помощью современных технологий.

Часто задаваемые вопросы

Какие KPI первой линии смотреть уже на 30-й день?

Auto-resolve rate 40–55%, first response p50 менее 30 секунд в чате, handoff quality ≥ 80% у операторов и cost per resolved −20–35% к baseline — без этих цифр «красивый бот» ещё не продукт.

Что обязательно передать человеку при handoff?

Intent и краткое summary, sentiment/риск, список уже сделанного агентом, код причины эскалации, next best action и trace ID — иначе оператор переспрашивает клиента и CSAT падает на пограничных диалогах.