AI-агент в бизнес-процессе: tools, память, HITL и чеклист
AI-агент в бизнес-процессе работает только как исполнитель с tools, ограниченной памятью и human-in-the-loop на деньгах и исключениях — иначе это чат с логотипом, а не production-система с измеримым до/после.
Я не «подключаю GPT к CRM» и не продаю магию. Я вырезаю один процесс, даю агенту инструменты и правила, оставляю человека на критичных шагах и меряю baseline через 30–60 дней. Ниже — рабочая схема: роль, tools/память, HITL, метрики, риски и чеклист запуска.
Роль агента: не «коллега», а слот в процессе
Агент занимает конкретный слот в цепочке: принять заявку → классифицировать → достать факт → ответить / создать задачу → эскалировать. Без слота он болтает.
| Роль | Что делает | Чего не делает |
|---|---|---|
| First-line support | FAQ, статус, сбор данных | Скидки «от себя», юр. обещания |
| Квалификатор лида | BANT/ICP, слот в календарь | Закрытие сделки без менеджера |
| Ops-рутина | Сверка, напоминания, черновики | Финальный платёж/подпись без HITL |
| Research-assist | Сводка по правилам | Публикация без QA |
Правило, которое я фиксирую в ТЗ: один процесс, один владелец, один go/no-go. Расширение scope — только после метрик, не «раз уж запустили».
Tools и память: без чего агент — просто LLM
Tools (инструменты)
Агенту нужны явные действия, а не «сам догадается»:
- чтение CRM / таблицы / базы знаний (read);
- запись статуса, тикета, тега (write с ACL);
- webhook/API мессенджера;
- калькулятор/прайс по формуле;
- поиск по утверждённым документам (RAG с источником).
Связка с трендом 2026: модели с programmatic tool calling умеют оркестрировать tools эффективнее, но бизнес-правила и ACL всё равно ваши — модель не заменяет политику доступа.
Память
| Тип | Срок жизни | Зачем | Риск |
|---|---|---|---|
| Session | диалог | контекст реплик | утечка PII в логах |
| Working | задача/тикет | состояние шагов | «залипший» статус |
| Long-term | профиль/предпочтения | персонализация | устаревшие факты |
| Knowledge | KB/RAG | правда компании | галлюцинации вне корпуса |
Я разделяю: память диалога ≠ источник правды. Цены, остатки, статусы заказов — только из tools/API, не из «помню, что вчера сказали».
Минимальный каркас
- System policy + stop-list.
- Router intent → tool plan.
- Tool result → ответ с цитатой источника (id записи/дока).
- Confidence / policy check → HITL или publish.
- Audit log: prompt version, tools, latency, outcome.
Human-in-the-loop: где человек обязателен
HITL — не «если бот не справился», а проектные ворота:
| Триггер | Действие человека | SLA |
|---|---|---|
| Сумма / скидка / возврат выше порога | approve / reject | ≤15–30 мин в рабочее |
| Юр., мед., фин. обещания | шаблон или эскалация | немедленный handoff |
| Confidence ниже порога | правка ответа | в очереди HITL |
| Жалоба / конфликт | только человек | приоритет P1 |
| Новый intent вне scope | разбор + KB | daily review |
Схема, которая стабильно живёт в МСП:
- Shadow 1–2 недели: агент предлагает, человек шлёт.
- Assist: агент отвечает, человек видит и может перехватить.
- Auto в scope + HITL на edge: 40–70% закрытий без касания, остальное — очередь.
Без очереди HITL и владельца смены «эскалация» превращается в чёрную дыру в Telegram.
Метрики до/после: что я снимаю
Без baseline разговор про ROI — маркетинг.
| Метрика | До (пример) | После 45–60 дн. (target) |
|---|---|---|
| Доля автозакрытий в scope | 0% | 40–60% |
| First response | 15–120 мин | <60 сек бот / <5 мин HITL |
| Время на тикет у оператора | 8–12 мин | 3–6 мин (assist) |
| Повторные обращения 7 дн. | baseline | −10–25% при хорошей KB |
| False escalation | — | 8–15% |
| Hallucination / fact error | — | <1% после stop-list + tools |
| CSAT / CES | baseline | не хуже, лучше +0,2–0,5 |
Экономика грубо: (часы, снятые с линии × fully loaded ставка) − (токены + сопровождение + HITL-FTE). Пилот часто 0,2–0,5 FTE надзора; «агент без людей» — миф на старте.
Риски и чеклист запуска
Риски, которые реально бьют
- Facts in heads → агент выдумывает.
- Write-tools без ACL → порча CRM.
- Нет versioning промптов/KB → «вчера работало».
- Scope creep на 2-й неделе.
- Игнор 152-ФЗ / согласия / маркировки ИИ-ответов где нужно.
- Метрики только vanity (число сообщений бота).
Чеклист запуска (go-live)
- Один процесс и владелец названы письменно
- Baseline 2–4 недели цифр снят
- Stop-list + policy «бот использует ИИ»
- ≥30–60 карточек знаний с источником
- Tools: read/write с правами, dry-run на стенде
- HITL-очередь, дежурный, SLA эскалации
- Логи: intent, tools, confidence, outcome, версия
- Go/no-go критерии на день 30 записаны до запуска
- Rollback: выключить auto, оставить handoff
- Обучение смены 1–2 часа + шпаргалка перехвата
Часто задаваемые вопросы
Нужна ли «агентная» платформа или хватит бота с tools?
Для одного узкого процесса часто хватает gateway + LLM + 3–7 tools + HITL. Платформа/оркестратор окупается, когда появляются мультишаги, несколько ролей и жёсткий audit. Сначала процесс и метрики, потом фреймворк.
Сколько памяти хранить о клиенте?
Минимум для задачи: id, открытые тикеты, согласие на коммуникацию, явные предпочтения. Не тащите сырые переписки в long-term без политики хранения и доступа — это и риск, и шум для модели.
Когда убирать HITL с шага?
Только после 2–4 недель стабильных метрик на этом шаге: error rate, жалобы, ручные правки. Снимаю HITL точечно (например, статусы заказа), никогда «весь процесс сразу».
Чем tools лучше «просто хорошего промпта»?
Промпт не видит актуальный остаток и не создаёт задачу в CRM атомарно. Tools дают проверяемый факт и действие; промпт задаёт политику, тон и когда звать человека.
Читайте также
- Архитектура AI-агента: роли, guardrails и handoff
- Внедрение AI-агента за 90 дней: этапы, цифры и процесс
- TCO AI-агента: KPI и стоимость владения за 30–90 дней
🚀 Нужен AI-агент в одном процессе — с tools, HITL и метриками до/после?
Соберу scope, политику, контур tools и чеклист go-live так, чтобы через месяц было что показать в цифрах, а не в демо-чате.
Заказать консультацию — raisovich.ru
Какой процесс брать первым под AI-агента?
Узкий, повторяемый, с ясным owner и измеримым baseline: first-line FAQ, квалификация лида или ops-рутина. Без одного go/no-go scope агент расползается в «чат про всё».
Что обязательно снять до go-live агента?
Baseline 2–4 недели: first response, время на тикет, доля ручных шагов, повторные обращения. Без цифр «до» разговор про ROI после запуска — маркетинг, а не управление.
Чем shadow mode отличается от auto с HITL?
В shadow агент только предлагает, человек отправляет; в auto в scope ответы уходят сами, а HITL остаётся на порогах денег, низком confidence и жалобах. Снимать HITL точечно после стабильных метрик, не «весь процесс сразу».
Подпишитесь на @raisovich_news
Первыми получайте новые статьи об AI-автоматизации, нейросетях для бизнеса и создании сайтов. Без спама — только полезный контент.
Часто задаваемые вопросы
Какой процесс брать первым под AI-агента?
Узкий, повторяемый, с ясным owner и измеримым baseline: first-line FAQ, квалификация лида или ops-рутина. Без одного go/no-go scope агент расползается в «чат про всё».
Что обязательно снять до go-live агента?
Baseline 2–4 недели: first response, время на тикет, доля ручных шагов, повторные обращения. Без цифр «до» разговор про ROI после запуска — маркетинг, а не управление.