Перейти к содержимому
Entagl

industry · product

Как запустить ИИ-агента и не потерять клиентов

Запуск в четыре этапа: соберите тестовый набор из собственных переписок, прогоните агента в теневом режиме, включите его на одной узкой задаче и расширяйте охват, только когда цифры это подтвердят.

Entagl Team10 мин. чтения
Как запустить ИИ-агента и не потерять клиентов

Запускайте ИИ-агента этапами и пропускайте его дальше по доказательствам, а не по дате в календаре. Соберите тестовый набор из прошлых переписок, прогоните агента в теневом режиме, выпустите его в живую работу на одной узкой задаче и расширяйте охват, только когда цифры держатся. В опросе Gartner, который охватил 3,566 клиентов B2B и B2C и проводился в феврале и марте 2026 года, 87% ответили, что возможность связаться с живым оператором обязательна, когда компания использует генеративный ИИ, и лишь 50% сказали, что ИИ упростил их обращение. Наши собственные данные тянут в другую сторону, когда речь о скорости: по 32,581 переписке в 1,247 компаниях из девяти стран ответы в пределах 60 секунд конвертировали в 35.1% против 7.1% у ответов, на которые уходило от часа до 24 часов. Затянутый запуск тоже стоит денег.

О том, почему ИИ-проекты буксуют, мы писали в статье Почему большинство ИИ-пилотов не доходят до продакшена. Здесь вторая половина: последовательность, по которой вы действуете, когда агент уже настроен и весь вопрос в том, когда дать ему заговорить.

Что идёт не так, когда ИИ-агента включают без подготовки?

Две неудачи, и обе задокументированы публично.

Первая: юридическая ответственность. 14 февраля 2024 года Гражданский трибунал по разрешению споров Британской Колумбии признал Air Canada ответственной за условия траурного тарифа, которые чат-бот на её сайте описал неверно. Авиакомпания в своей позиции назвала чат-бот «отдельным юридическим лицом, которое отвечает за свои действия». Трибунал этот довод отклонил и обязал авиакомпанию выплатить Moffatt $812.02 в качестве возмещения и издержек. В разборе дела от American Bar Association вывод сформулирован прямо: компании продолжают нести ответственность за то, что их ИИ-инструменты говорят клиентам.

Вторая: дрейф качества, который видно только снаружи. В феврале 2024 года Klarna объявила, что её ИИ-ассистент ведёт две трети чатов поддержки. К маю 2025 года компания снова нанимала живых операторов, а её CEO Sebastian Siemiatkowski сказал Bloomberg, что «стоимость, к сожалению, оказалась слишком доминирующим критерием оценки при организации всего этого, и в итоге получаешь более низкое качество». ИИ там по-прежнему обрабатывает две трети обращений. Изменилось другое: круг задач, которые ему доверили, и то, насколько легко клиенту через него пройти.

Инженеров хватало и в той, и в другой компании. Не хватало этапа между «это работает на тестах» и «это отвечает всем».

Этап 1: на каких переписках тестировать агента до запуска?

На своих собственных. Выгрузите последние 90 дней из входящего ящика и соберите фиксированный набор реальных случаев, которые агент обязан отработать правильно, записав для каждого ожидаемое поведение.

Руководство Teradata по AgentOps рекомендует эталонный набор от 30 до 100 реалистичных задач на каждый рабочий процесс, включая пограничные случаи и негативные сценарии, такие как истёкшие токены или нехватка прав. Для агента, который занимается записью или продажами, это превращается в нечто более приземлённое и более полезное, чем бенчмарк.

Что включить Почему это нужно в наборе
Ваши 20 самых частых вопросов, дословно Это основная часть вашего объёма; правильные ответы на них и есть базовый уровень
Три вопроса, на которые вы сознательно не отвечаете публично Подтверждает, что агент отказывается, а не придумывает политику на ходу
Сообщение о возврате или жалоба, написанные в гневе Проверяет тон и то, передаёт ли агент разговор человеку вместо спора
Клиент, который меняет язык посреди сообщения Проверяет определение языка, а не только перевод
Фото или документ вместо текста Большинство реальных входящих ящиков состоят не только из текста
Запрос, который нарушает ваши правила (слот вне часов работы) Агент должен отказать и предложить реальную альтернативу
Клиент, который просит человека в первом же сообщении Здесь есть ровно один правильный ответ

Оценивайте каждый случай по записанному поведению, а не по формулировке, которую вы себе представляли. Агент, который сказал иначе, но записал клиента на нужное время, тест прошёл. Агент, который звучит безупречно и выдумывает политику, тест провалил, и именно этому трибунал по делу Air Canada назначил цену. Набор сохраните: вы прогоняете его после каждого изменения инструкций, и окупается он на втором прогоне.

Этап 2: что показывает теневой режим такого, чего не покажет демо?

Теневой режим означает, что агент читает живые входящие сообщения и готовит черновик ответа, который никто не отправляет. Ваша команда отвечает как обычно. В конце каждого дня вы сравниваете два варианта.

Так вы ловите то, до чего не дотягивается ни один тестовый набор, потому что ваш набор писал человек, который бизнес уже знает. Реальные клиенты приходят с половиной названия товара, со скриншотом, с голосовым в 11 вечера и с представлением о вашей политике возврата, которого вы раньше никогда не слышали. Именно поэтому руководство Teradata ставит теневой режим перед канареечным релизом: сначала тихо работать параллельно с людьми, потом открыть агента небольшой группе, потом расширять.

Честная оговорка: теневой режим не бесплатен. Кто-то должен читать черновики, и если этого не делает никто, вы добавили неделю задержки и ничего не узнали. Заложите час в день на пять дней и отдайте эту работу тому, кто отвечает на наибольшее число сообщений. Он за две секунды заметит неверный ответ, который руководитель в той же переписке пропустит.

О скорости теневой режим тоже ничего не скажет. У черновика, который лежит в очереди, нет скорости ответа, поэтому эффект ответа за 40 секунд вместо 40 минут остаётся невидимым до этапа 3.

Этап 3: насколько узким должен быть первый живой запуск?

Уже, чем кажется осмысленным. Один канал, один тип вопросов, одно временное окно.

Начните с часов, которые никто не закрывает. Ночные сообщения и сообщения в выходные это самое безопасное место для живого запуска, потому что честное сравнение здесь не «ИИ против вашего лучшего оператора», а «ИИ против ответа в понедельник». Разрыв в конверсии в нашем исследовании скорости ответа шире всего именно тут, на сообщении, которое иначе пролежит до тех пор, пока кто-нибудь не откроет ящик. Нерабочие часы это тот слот, где поэтапный запуск окупается сразу и рискует меньше всего.

На этом этапе держите три вещи полностью открытыми:

  1. Передача человеку. По любой просьбе о живом сотруднике разговор уходит человеку сразу, без уточняющих вопросов.
  2. Видимость. Каждая переписка попадает в тот же ящик, за которым команда и так следит, чтобы плохой диалог был пойман за минуты, а не при разборе в конце месяца.
  3. Выключатель. Знайте, кто может отключить ИИ-ответы для этого канала, и убедитесь, что этот человек хотя бы раз проделал это до того, как понадобится.

Этап 4: какие данные дают право расширять охват?

Выберите критерии до запуска, пока вы смотрите на это спокойно. После недели в живом режиме появляется соблазн расшириться, потому что ничего явно не сломалось, а «ничего явно не сломалось» это не измерение.

Сигнал Где смотреть Когда расширять
Корректность Перезапустите тестовый набор с этапа 1 По-прежнему проходит, включая случаи с отказом
Качество передачи Переписки, которые забрал человек Передача происходит в нужный момент, а не на три сообщения позже
Реакция клиентов Ответы после сообщения ИИ Нет роста вопросов «это бот?» и повторных вопросов
Бизнес-действие Записи, заказы, собранные лиды Выполненное действие совпадает с тем, о чём договорились в чате
Жалобы Ваш обычный канал жалоб Ровный уровень, и вы прочитали те, что пришли

Расширяйте по одной переменной за раз: добавьте канал, или добавьте тип запроса, или продлите часы. Измените две сразу, и падение качества ничего не скажет вам о причине.

Единственное, что нельзя вводить поэтапно: путь к человеку

Любой другой контроль можно вводить постепенно. Этот работает с первого дня и в полную силу.

Разрыв здесь хорошо задокументирован. Исследование Zoom вместе с Morning Consult, охватившее 3,500 взрослых в семи странах, показало, что 81% потребителей ожидают, что бот передаст разговор человеку, когда это нужно, и лишь 38% говорят, что так и происходит. То же исследование показало, что главное раздражение от чат-ботов и голосовых ботов, 43%, состоит попросту в том, что они не решают вопрос, а 82% перестанут покупать у бренда после неточного или неудовлетворительного решения.

Аналитик Gartner Eric Keller формулирует правило проектирования прямо: «Руководителям сервиса не следует делать генеративный ИИ обязательным первым шагом для каждого обращения». Когда клиента прогоняют через несколько неудачных попыток ИИ, прежде чем он доберётся до человека, он с меньшей вероятностью воспользуется этим инструментом снова.

Поэтому проверяйте путь передачи так, как проверяют пожарный выход. Попросите человека пятью разными формулировками, одной из них на другом языке, и убедитесь, что каждая доходит до сотрудника, который видит всё сказанное ранее.

Чего поэтапный запуск не чинит

Он не спасёт скудную базу знаний. Если ваши часы работы указаны неверно в трёх местах, а политика возврата существует только в голове владельца, каждый этап честно вытащит наружу один и тот же пробел, и чинить это надо контентом, а не запуском. Об этой стороне мы писали в статье Как обучить ИИ-агента знаниям о вашем бизнесе.

Он также стоит времени, а это время не бесплатно. Четырёхнедельный запуск это четыре недели поздних ответов, про которые вы уже знаете, что они дорого обходятся. Лучше сокращайте этапы, чем пропускайте их: три дня теневого режима на загруженном ящике дают больше, чем три недели на тихом. И ничто из этого не заставит слабое предложение конвертировать.

Где здесь Entagl

Receptionist от Entagl отвечает в WhatsApp, в директе и комментариях Instagram, в Facebook Messenger, в Telegram, в чат-виджете на сайте, по почте, пересылаемой с существующего ящика компании, и через публичный API. Поэтапный запуск на нём реален, потому что ИИ-ответы планируются и включаются отдельно по каждому каналу и могут быть поставлены на паузу в одной конкретной переписке, так что «один канал, один тип запроса» это настройка, а не обходной путь.

Передача уходит в общий командный ящик, где сотрудник видит переписку целиком, включая то, что агент уже пообещал. Ответы перед отправкой проходят через ограничители на выходе, и каждый обмен сообщениями сохраняется как стенограмма, которую можно перечитать, когда вы решаете, расширять ли охват. Агент определяет язык клиента и отвечает на нём, а таких языков больше 100, с переключением прямо посреди разговора, и поэтому смена языка должна быть в вашем тестовом наборе, а не в продакшене.

Принесите на 30-минутное демо десять своих худших прошлых переписок и посмотрите, что агент с ними сделает. Записаться на демо.

FAQ

Сколько ИИ-агенту стоит оставаться в теневом режиме?

Столько, чтобы покрыть показательную неделю, включая ваш самый загруженный день и самый тихий. На ящике с большим объёмом это могут быть три дня; в бизнесе, где двадцать сообщений в неделю, ближе к месяцу, потому что важна выборка, а не календарь. Останавливайтесь, когда новые переписки перестают вас удивлять.

Можно ли пропустить тестовый набор, если платформу уже протестировал вендор?

Нет, потому что вендор тестировал модель, а вам нужно протестировать свой бизнес. Сбои, которые стоят денег, завязаны на ваши правила, ваши часы работы и те товары, которые вы отказываетесь обсуждать в чате. Бенчмарк вендора не может знать, что на одну конкретную услугу вы никогда не называете цену.

Что ИИ должен делать, когда он не уверен?

Задать уточняющий вопрос или передать разговор человеку и никогда не затыкать пробел правдоподобной догадкой. Договориться об этом до запуска и есть самый ценный час во всём внедрении. О механике мы писали в статье Как избавить ИИ-агента от галлюцинаций.

Относится ли поэтапный запуск и к голосовым агентам?

Да, с одной поправкой: телефонного агента нельзя прогнать в тихом теневом режиме, потому что черновика для проверки не существует. Замените его записанными тестовыми звонками по тому же набору сценариев, а затем запускайте на узком слоте, например на переливе звонков в нерабочее время. Сценарии именно для звонков разобраны в статье Как оценить и проверить телефонного ИИ-ассистента.

Начните с переписок, которые у вас уже есть

Тестовый набор это та часть, которую большинство команд пропускает, и та, что делает каждый следующий этап решаемым. Сорок реальных переписок из вашего ящика, к каждой из которых приписано правильное поведение, превращают «вроде неплохо» в число, которое можно перепроверять после каждого изменения. Выгрузите их до того, как поменяете хоть одну настройку.


Источники: опрос клиентов Gartner, август 2026 (3,566 клиентов, опрос проводился в феврале и марте 2026); Zoom и Morning Consult, «AI alone won't save CX. Resolution will.», июль 2025 (3,500 взрослых, семь стран); Moffatt v. Air Canada, British Columbia Civil Resolution Tribunal, февраль 2024; материал CX Dive о Klarna, май 2025; рекомендации Teradata по AgentOps, ноябрь 2025; Entagl Response Velocity Study 2026.

Опубликовано Entagl Team on