Пилот AI-агента за 30 дней: план для бизнеса
План 30-дневного пилота AI-агента: базовая линия, знания, тесты, безопасность, внутренний и внешний запуск, расчёт результата и решение о масштабе.

Содержание статьи
- До старта: назначьте владельца и границы
- Дни 1–3: соберите базовую линию
- Дни 4–7: выберите сценарий и знания
- Дни 8–10: настройте поведение
- Дни 11–14: создайте тестовый набор
- Дни 15–17: исправьте причины ошибок
- Дни 18–20: проведите проверку безопасности
- Дни 21–24: внутренний запуск
- Дни 25–27: ограниченный внешний трафик
- Дни 28–29: посчитайте результат
- День 30: примите одно из трёх решений
- Масштабировать
- Доработать и повторить
- Остановить
- Что оставить после пилота
- Частые вопросы
За 30 дней можно проверить не «возможности AI вообще», а один конкретный бизнес-сценарий. Хороший пилот отвечает на три вопроса: агент даёт корректный результат, процесс безопасен и подтверждённая выгода превышает затраты на эксплуатацию.
Этот план рассчитан на клиентскую поддержку или первичную квалификацию входящих лидов. Срок не означает обязательный запуск на весь трафик: если тесты выявили критические ошибки, правильный результат пилота — доработка или остановка.
До старта: назначьте владельца и границы#
У пилота должен быть один ответственный за итог. В рабочую группу обычно входят владелец процесса, специалист по контенту, представитель поддержки или продаж и человек, который отвечает за доступы и интеграции.
Зафиксируйте на одной странице:
- проблему и выбранный поток обращений;
- канал и аудиторию;
- что агент делает и чего не делает;
- критерии успеха;
- критические ошибки, при которых запуск останавливается;
- бюджет времени и сервисов.
Не выбирайте одновременно поддержку, продажи, HR и внутренний поиск. Один узкий сценарий даст больше полезных данных, чем четыре незавершённых демонстрации.
Дни 1–3: соберите базовую линию#
Измерьте текущий процесс до AI:
- число подходящих обращений;
- долю решённых задач;
- время первого полезного ответа;
- время сотрудника;
- повторные контакты;
- ошибки и эскалации;
- конверсию в следующий шаг, если это продажи.
Возьмите реальные диалоги, а не только сводный отчёт. Они покажут язык клиентов, скрытые исключения и вопросы, которых нет во внутреннем FAQ.
Дни 4–7: выберите сценарий и знания#
Сгруппируйте обращения по причинам и выберите одну–три связанные темы. Хороший первый сценарий часто встречается, имеет утверждённый ответ и низкую цену обратимой ошибки.
Соберите только нужные источники. Удалите старые версии, внутренние комментарии и противоречия. Для публичных материалов можно подключить сайт, для регламентов — загрузить документы, а важные исключения оформить как пары «вопрос — ответ».
Назначьте владельца каждого меняющегося факта: цены, срока, состава услуги и контактных данных.
Дни 8–10: настройте поведение#
Опишите:
- роль агента и целевую аудиторию;
- разрешённые темы;
- обязательные уточнения;
- запрет на догадки;
- тон ответа;
- условия передачи сотруднику;
- допустимые действия и подтверждения.
Сделайте инструкцию короткой и проверяемой. Вместо «будь максимально полезным» используйте правило «если подтверждения в источниках нет, сообщи об ограничении и предложи оператора».
Дни 11–14: создайте тестовый набор#
Соберите 50–100 примеров. Примерно половина должна происходить из реальных обращений, остальные — проверять границы:
- опечатки и разговорные формулировки;
- продолжения без повторения темы;
- несколько вопросов в одном сообщении;
- отсутствующие сведения;
- жалобы и просьбы об операторе;
- запросы внутренних данных;
- prompt injection;
- ошибки внешнего действия.
Для каждого теста запишите факты, которые должны присутствовать, запрещённые утверждения и ожидаемое действие. Это станет регрессионным набором для следующих изменений.
Дни 15–17: исправьте причины ошибок#
Разделяйте проблемы:
- источник не содержит ответа;
- поиск не выбрал нужный фрагмент;
- документы противоречат;
- инструкция неоднозначна;
- эскалация не сработала;
- инструмент принял неверные параметры.
Не лечите каждую ошибку добавлением фразы в промпт. Если факт отсутствует или спрятан в неудобном документе, исправьте базу знаний. Для проблем поиска используйте гайд почему AI-агент не находит ответ.
Дни 18–20: проведите проверку безопасности#
Проверьте минимальность доступов и данных. Убедитесь, что:
- права контролирует сервер, а не модель;
- агент не видит лишние документы;
- действие ограничено текущим пользователем или организацией;
- необратимая операция требует подтверждения;
- таймаут и ошибка интеграции не превращаются в ложное обещание;
- есть журнал и аварийное отключение.
Профиль генеративного AI от NIST предлагает рассматривать управление, картирование, измерение и снижение рисков на всём жизненном цикле. Для пилота это означает, что тестирование и план инцидента должны появиться до внешнего трафика.
Дни 21–24: внутренний запуск#
Дайте агенту реальные вопросы, но отвечайте пока сотрудникам или тестовой группе. Попросите нескольких людей оценивать диалоги независимо по одинаковой шкале:
- фактическая корректность;
- полнота;
- уместность следующего шага;
- корректность эскалации;
- отсутствие лишних данных.
Разногласия между проверяющими полезны: они выявляют неясные правила самого бизнеса.
Дни 25–27: ограниченный внешний трафик#
Подключите один канал Chatix, например виджет на сайте, и направьте на агента небольшую долю подходящих обращений. Сотрудник должен видеть очередь и иметь возможность продолжить разговор.
В первые дни просматривайте все диалоги. Не расширяйте трафик сразу после нескольких удачных примеров.
Дни 28–29: посчитайте результат#
Сравните пилот с базовой линией или контрольной группой. Оцените:
- корректность и критические ошибки;
- долю решённых задач;
- время клиента и сотрудника;
- качество передачи;
- повторные обращения;
- стоимость сервисов и сопровождения;
- бизнес-результат выбранного сценария.
Число сообщений и субъективное впечатление команды оставьте вспомогательными показателями.
День 30: примите одно из трёх решений#
Масштабировать#
Качество стабильно, критических ошибок нет, выгода подтверждена. Добавьте только одну новую тему или увеличьте долю трафика, сохранив контрольную выборку.
Доработать и повторить#
Ценность видна, но одна причина системно снижает результат. Сформулируйте ограниченный список изменений и повторите тот же тестовый набор.
Остановить#
Цена ошибки выше пользы, процесс слишком неоднозначен или обслуживание знаний обходится дороже эффекта. Это нормальный результат пилота: он предотвратил дорогое масштабирование неподходящего сценария.
Что оставить после пилота#
Даже если проект остановлен, у компании остаются полезные артефакты: карта обращений, очищенная база знаний, тестовый набор, правила эскалации и базовые метрики. Они улучшают работу людей и ускоряют следующий эксперимент.
AI Index 2026 показывает важный разрыв: AI уже широко используется организациями, но масштабное применение агентов остаётся ранним. Поэтому дисциплинированный пилот полезнее ставки на то, что технология сама найдёт процесс.
Частые вопросы
Можно ли реально проверить AI-агента за 30 дней?
Да, если ограничить пилот одной задачей и одним каналом. Масштабное внедрение нескольких процессов за этот срок обычно не даёт надёжной оценки.
Сколько тестов нужно для пилота?
Для узкого сценария подготовьте 50–100 примеров: реальные обращения, переформулировки, вопросы без ответа, эскалации и проверки безопасности.
Что считать успешным результатом пилота?
Стабильное качество без критических ошибок и подтверждённый бизнес-эффект относительно базовой линии с учётом всех затрат на работу и сопровождение.