AI-агент на первой линии МСП: сценарии, handoff и KPI 30–60 дней
AI-агент на первой линии для МСП в РФ окупается, когда закрывает 40–70% типовых диалогов сам, передаёт «сложные» человеку с полным контекстом за менее 30 секунд и даёт измеримые KPI уже на 30–60 день: % авто-резолва, SLA ответа, CSAT после handoff и стоимость закрытого обращения — а не «красивый чат на сайте».
Я ставлю первую линию так же, как смену операторов: узкий scope, stop-list, очередь эскалаций и ежедневный разбор провалов. Ниже — рабочие сценарии для продаж и поддержки, протокол handoff, таблица KPI и типовые сбои, которые убивают ROI.
Что должна делать первая линия (и чего не должна)
Первая линия — это квалификация + FAQ + маршрутизация, а не «закрытие сделки нейросетью». Для МСП это обычно Telegram, сайт-виджет, WhatsApp/MAX и иногда голос.
| Канал | Что агент делает сам | Когда handoff обязателен |
|---|---|---|
| Сайт / виджет | FAQ, прайс-ориентир, сбор контакта, слот в CRM | Жалоба, юр. спор, кастомный расчёт, VIP |
| Telegram / MAX | Статус заказа, документы, запись, квалификация лида | Негатив, повторная претензия, B2B-переговоры |
| Продажи (inbound) | BANT-лайт, отрасль, бюджет-диапазон, следующий шаг | Скидка вне сетки, tender, «созвон с ЛПР» |
| Поддержка | Сброс доступа, инструкции, типовые инциденты L1 | Инцидент P1, деньги/возврат, угроза оттока |
Чеклист scope перед запуском:
- 30–50 эталонных диалогов «успех / handoff / отказ»
- Stop-list тем (медицина, юр. ответственность, цены «от балды»)
- Поля CRM, которые агент обязан заполнить
- Фраза-дисклеймер: клиент знает, что пишет AI
- Владелец базы знаний (1 человек, не «вся команда»)
Handoff человеку: протокол, без которого первая линия ломается
Без handoff-протокола клиент повторяет историю, оператор злится, CSAT падает именно на «пограничных» диалогах. Я фиксирую передачу как смену смены.
| Поле при handoff | Зачем | Минимум |
|---|---|---|
| Intent + summary | 3–5 предложений | обязательно |
| Sentiment / риск | негатив, VIP, churn | score 1–5 |
| Уже сделано агентом | ссылки, тикеты, обещания | список |
| Почему эскалация | правило / confidence | код причины |
| Next best action | что сказать человеку | 1 шаг |
| Trace ID | аудит и QA | обязательно |
Правила эскалации (пример для МСП):
- Клиент дважды уточняет одно и то же → handoff.
- Confidence ниже порога или hit stop-list → handoff сразу.
- Слова «юрист / возврат / претензия / роспотреб» → handoff + приоритет.
- Сделка выше N ₽ или enterprise-аккаунт → soft-handoff с саммари, агент не торгуется.
- Тишина оператора сверх SLA → агент пишет статус «передал коллеге, ждите до …».
Подробный каркас QA и скоринга я разбирал отдельно: протокол handoff и QA-скоринг.
KPI за 30 и 60 дней: что смотреть, а не «вау-эффект»
На 7-й день метрики ещё «шум». На 30-й — видно product-market fit агента. На 60-й — unit-экономика.
| KPI | День 0–14 (baseline) | Цель к дню 30 | Цель к дню 60 | Как считать |
|---|---|---|---|---|
| Auto-resolve rate | 15–25% | 40–55% | 50–70% | закрыто без человека / все диалоги in-scope |
| First response time | минуты–часы | менее 30 сек (чат) | стабильно | p50 / p90 |
| Handoff quality | нет данных | ≥ 80% «ок» у оператора | ≥ 90% | оценка 1–5 после приёма |
| CSAT / CSI post | как было | не хуже baseline | +0.1…0.3 | только in-scope |
| Cost per resolved | FTE-доля | −20–35% | −30–50% | (LLM + FTE handoff) / резолвы |
| Lead→SQL (продажи) | baseline | +10–20% квалиф. | стабильный uplift | CRM stage |
| Hallucination / wrong answer | — | ниже 3% выборки | ниже 1,5% | ежедневный QA 20–50 диалогов |
30 дней — операционный каркас:
- Неделя 1: shadow-mode (агент пишет черновик, человек отправляет).
- Неделя 2: go-live на 20–30% трафика, узкий FAQ.
- Неделя 3–4: расширение интентов, правка KB по топ-провалам.
60 дней — экономика:
- Считаем cost per resolved и payback внедрения.
- Режем «мусорные» интенты, где агент только тратит токены.
- Решаем: один агент хватает или нужен multi-agent (см. оркестрацию).
Типовые сбои первой линии (и как чинить)
| Сбой | Симптом | Корень | Фикс за 1–5 дней |
|---|---|---|---|
| «Умный, но врёт» | жалобы на факты, цены | KB дырявая / нет ground truth | FAQ из CRM/доков, запрет выдумывать цены |
| Бесконечный пинг-понг | 8+ реплик без решения | нет exit-criteria | max turns → handoff |
| Handoff «пустой» | оператор переспрашивает | нет summary-схемы | жёсткий JSON handoff |
| Двойные ответы | агент и человек пишут вместе | нет lock диалога | claim/lock в очереди |
| Утечка scope | агент лезет в юр/медицину | слабый guardrail | stop-list + classifier |
| Пик токенов | счёт LLM ×3 | длинный контекст, retry-шторм | trim history, idempotency |
| «Всё на AI» | CSAT падает на сложных | нет HITL | матрица эскалаций |
| Мёртвая CRM | лиды без полей | агент не пишет в CRM | обязательные поля + алерт |
Антипаттерн: запускать «универсального бота на весь бизнес» в день 1. Для МСП выигрывает узкий first-line на 1–2 канала и 1 воронку.
Чеклист запуска за 2 недели (практика)
- День 1–2: 40 диалогов из истории → кластеры интентов, stop-list.
- День 3–5: KB + 15 golden answers + интеграция CRM (контакт, этап, источник).
- День 6–8: shadow-mode, QA-скоринг, правка промпта/ролей.
- День 9–11: 25% live-трафика, SLA handoff, lock диалога.
- День 12–14: разбор топ-20 провалов, go/no-go на 100% in-scope.
Если нужен каркас ролей и guardrails — см. архитектуру агента: роли, guardrails, handoff.
Часто задаваемые вопросы
Нужен ли отдельный «отдел AI», чтобы поставить первую линию?
Нет. Для МСП достаточно владельца процесса (продажи или поддержка), доступа к CRM/мессенджеру и 1 технической точки (интегратор или сильный no-code). Отдел AI имеет смысл, когда агентов больше 3 и есть compliance/аудит.
Можно ли сразу заменить ночную смену операторов?
Частично — да, на FAQ и статусах. Полная замена ночи без handoff-дежурного опасна: P1 и деньги требуют человека. Я оставляю on-call хотя бы в режиме «забрать эскалацию за 15 минут».
Какая модель лучше для первой линии в РФ?
Важнее grounding и протокол, чем бренд модели. Для диалога — стабильный LLM с tool-calling; для данных — ваша CRM/KB. Учитывайте закон о маркировке AI-контента и дисклеймер в чате.
Сколько диалогов нужно, чтобы понять, что агент «поехал»?
Минимум 100–150 live in-scope за 2 недели плюс ежедневная выборка 20–30 на QA. До этого любые % auto-resolve — лотерея.
Читайте также
- Протокол handoff AI-агент↔человек: QA-скоринг в production
- Handoff AI→человек: матрица эскалаций и KPI
- Архитектура AI-агента: роли, guardrails, handoff
Готовый first-line под вашу CRM и мессенджеры — без «бота ради бота»: https://raisovich.ru
Какие KPI первой линии смотреть уже на 30-й день?
Auto-resolve rate 40–55%, first response p50 менее 30 секунд в чате, handoff quality ≥ 80% у операторов и cost per resolved −20–35% к baseline — без этих цифр «красивый бот» ещё не продукт.
Что обязательно передать человеку при handoff?
Intent и краткое summary, sentiment/риск, список уже сделанного агентом, код причины эскалации, next best action и trace ID — иначе оператор переспрашивает клиента и CSAT падает на пограничных диалогах.
Почему нельзя запускать универсального бота на весь бизнес в день 1?
Узкий first-line на 1–2 канала и одну воронку даёт измеримый ROI; «универсальный» scope размывает KB, раздувает токены и ломает stop-list до того, как появятся эталонные диалоги.
Подпишитесь на @raisovich_news
Первыми получайте новые статьи об AI-автоматизации, нейросетях для бизнеса и создании сайтов. Без спама — только полезный контент.
Часто задаваемые вопросы
Какие KPI первой линии смотреть уже на 30-й день?
Auto-resolve rate 40–55%, first response p50 менее 30 секунд в чате, handoff quality ≥ 80% у операторов и cost per resolved −20–35% к baseline — без этих цифр «красивый бот» ещё не продукт.
Что обязательно передать человеку при handoff?
Intent и краткое summary, sentiment/риск, список уже сделанного агентом, код причины эскалации, next best action и trace ID — иначе оператор переспрашивает клиента и CSAT падает на пограничных диалогах.