Реклама. ИП Ахунов Александр Раисович, ИНН 665911236854
AI-агент в бизнес-процессе: tools, память, HITL и чеклист

AI-агент в бизнес-процессе: tools, память, HITL и чеклист

AI-агент в бизнес-процессе работает только как исполнитель с tools, ограниченной памятью и human-in-the-loop на деньгах и исключениях — иначе это чат с логотипом, а не production-система с измеримым до/после.

Я не «подключаю GPT к CRM» и не продаю магию. Я вырезаю один процесс, даю агенту инструменты и правила, оставляю человека на критичных шагах и меряю baseline через 30–60 дней. Ниже — рабочая схема: роль, tools/память, HITL, метрики, риски и чеклист запуска.


Роль агента: не «коллега», а слот в процессе

Агент занимает конкретный слот в цепочке: принять заявку → классифицировать → достать факт → ответить / создать задачу → эскалировать. Без слота он болтает.

РольЧто делаетЧего не делает
First-line supportFAQ, статус, сбор данныхСкидки «от себя», юр. обещания
Квалификатор лидаBANT/ICP, слот в календарьЗакрытие сделки без менеджера
Ops-рутинаСверка, напоминания, черновикиФинальный платёж/подпись без HITL
Research-assistСводка по правиламПубликация без QA

Правило, которое я фиксирую в ТЗ: один процесс, один владелец, один go/no-go. Расширение scope — только после метрик, не «раз уж запустили».


Tools и память: без чего агент — просто LLM

Tools (инструменты)

Агенту нужны явные действия, а не «сам догадается»:

  • чтение CRM / таблицы / базы знаний (read);
  • запись статуса, тикета, тега (write с ACL);
  • webhook/API мессенджера;
  • калькулятор/прайс по формуле;
  • поиск по утверждённым документам (RAG с источником).

Связка с трендом 2026: модели с programmatic tool calling умеют оркестрировать tools эффективнее, но бизнес-правила и ACL всё равно ваши — модель не заменяет политику доступа.

Память

ТипСрок жизниЗачемРиск
Sessionдиалогконтекст репликутечка PII в логах
Workingзадача/тикетсостояние шагов«залипший» статус
Long-termпрофиль/предпочтенияперсонализацияустаревшие факты
KnowledgeKB/RAGправда компаниигаллюцинации вне корпуса

Я разделяю: память диалога ≠ источник правды. Цены, остатки, статусы заказов — только из tools/API, не из «помню, что вчера сказали».

Минимальный каркас

  1. System policy + stop-list.
  2. Router intent → tool plan.
  3. Tool result → ответ с цитатой источника (id записи/дока).
  4. Confidence / policy check → HITL или publish.
  5. Audit log: prompt version, tools, latency, outcome.

Human-in-the-loop: где человек обязателен

HITL — не «если бот не справился», а проектные ворота:

ТриггерДействие человекаSLA
Сумма / скидка / возврат выше порогаapprove / reject≤15–30 мин в рабочее
Юр., мед., фин. обещанияшаблон или эскалациянемедленный handoff
Confidence ниже порогаправка ответав очереди HITL
Жалоба / конфликттолько человекприоритет P1
Новый intent вне scopeразбор + KBdaily review

Схема, которая стабильно живёт в МСП:

  • Shadow 1–2 недели: агент предлагает, человек шлёт.
  • Assist: агент отвечает, человек видит и может перехватить.
  • Auto в scope + HITL на edge: 40–70% закрытий без касания, остальное — очередь.

Без очереди HITL и владельца смены «эскалация» превращается в чёрную дыру в Telegram.


Метрики до/после: что я снимаю

Без baseline разговор про ROI — маркетинг.

МетрикаДо (пример)После 45–60 дн. (target)
Доля автозакрытий в scope0%40–60%
First response15–120 мин<60 сек бот / <5 мин HITL
Время на тикет у оператора8–12 мин3–6 мин (assist)
Повторные обращения 7 дн.baseline−10–25% при хорошей KB
False escalation8–15%
Hallucination / fact error<1% после stop-list + tools
CSAT / CESbaselineне хуже, лучше +0,2–0,5

Экономика грубо: (часы, снятые с линии × fully loaded ставка) − (токены + сопровождение + HITL-FTE). Пилот часто 0,2–0,5 FTE надзора; «агент без людей» — миф на старте.


Риски и чеклист запуска

Риски, которые реально бьют

  • Facts in heads → агент выдумывает.
  • Write-tools без ACL → порча CRM.
  • Нет versioning промптов/KB → «вчера работало».
  • Scope creep на 2-й неделе.
  • Игнор 152-ФЗ / согласия / маркировки ИИ-ответов где нужно.
  • Метрики только vanity (число сообщений бота).

Чеклист запуска (go-live)

  • Один процесс и владелец названы письменно
  • Baseline 2–4 недели цифр снят
  • Stop-list + policy «бот использует ИИ»
  • ≥30–60 карточек знаний с источником
  • Tools: read/write с правами, dry-run на стенде
  • HITL-очередь, дежурный, SLA эскалации
  • Логи: intent, tools, confidence, outcome, версия
  • Go/no-go критерии на день 30 записаны до запуска
  • Rollback: выключить auto, оставить handoff
  • Обучение смены 1–2 часа + шпаргалка перехвата

Часто задаваемые вопросы

Нужна ли «агентная» платформа или хватит бота с tools?

Для одного узкого процесса часто хватает gateway + LLM + 3–7 tools + HITL. Платформа/оркестратор окупается, когда появляются мультишаги, несколько ролей и жёсткий audit. Сначала процесс и метрики, потом фреймворк.

Сколько памяти хранить о клиенте?

Минимум для задачи: id, открытые тикеты, согласие на коммуникацию, явные предпочтения. Не тащите сырые переписки в long-term без политики хранения и доступа — это и риск, и шум для модели.

Когда убирать HITL с шага?

Только после 2–4 недель стабильных метрик на этом шаге: error rate, жалобы, ручные правки. Снимаю HITL точечно (например, статусы заказа), никогда «весь процесс сразу».

Чем tools лучше «просто хорошего промпта»?

Промпт не видит актуальный остаток и не создаёт задачу в CRM атомарно. Tools дают проверяемый факт и действие; промпт задаёт политику, тон и когда звать человека.


Читайте также


🚀 Нужен AI-агент в одном процессе — с tools, HITL и метриками до/после?
Соберу scope, политику, контур tools и чеклист go-live так, чтобы через месяц было что показать в цифрах, а не в демо-чате.

Заказать консультацию — raisovich.ru

Какой процесс брать первым под AI-агента?

Узкий, повторяемый, с ясным owner и измеримым baseline: first-line FAQ, квалификация лида или ops-рутина. Без одного go/no-go scope агент расползается в «чат про всё».

Что обязательно снять до go-live агента?

Baseline 2–4 недели: first response, время на тикет, доля ручных шагов, повторные обращения. Без цифр «до» разговор про ROI после запуска — маркетинг, а не управление.

Чем shadow mode отличается от auto с HITL?

В shadow агент только предлагает, человек отправляет; в auto в scope ответы уходят сами, а HITL остаётся на порогах денег, низком confidence и жалобах. Снимать HITL точечно после стабильных метрик, не «весь процесс сразу».

Р
Команда экспертов по AI-автоматизации бизнеса, созданию сайтов и продвижению нейросетями. Помогаем бизнесу расти с помощью современных технологий.

Часто задаваемые вопросы

Какой процесс брать первым под AI-агента?

Узкий, повторяемый, с ясным owner и измеримым baseline: first-line FAQ, квалификация лида или ops-рутина. Без одного go/no-go scope агент расползается в «чат про всё».

Что обязательно снять до go-live агента?

Baseline 2–4 недели: first response, время на тикет, доля ручных шагов, повторные обращения. Без цифр «до» разговор про ROI после запуска — маркетинг, а не управление.