Ловушка девяноста процентов
Опасен не сбой агента, а работа, которая выглядит выполненной. Почему я почти не проверяю за агентами, где это перестаёт быть безопасным и почему потерянный разговор не попадает ни в один отчёт.
Мой агент довёл клиента до оплаты. Разговор шёл ровно, человек согласился, оставалось отправить ссылку. Агент её отправил. И клиент пропал.
Ссылку он не видел. Площадка вырезала её из сообщения — так работает защита от спама. Клиент смотрел в пустоту и не понимал, чего от него хотят. А агент считал, что задачу выполнил, и слал снова.
Никто не сломался. Агент сделал ровно то, что ему поручили. Ошибки не было — а оплата чуть не потерялась.
Вот это и есть ловушка девяноста процентов. Опасна не ошибка. Опасна работа, которая выглядит выполненной.
Я не первый, кто в неё попал. В опросе Stack Overflow за 2025 год шестьдесят шесть процентов разработчиков назвали своим главным раздражением ровно это: решения, которые почти правильные, но не совсем.
Но проверяю я мало
Тут я скажу вещь, которая противоречит всему, что обычно пишут про работу с машиной.
Я почти не проверяю за агентами. По моей оценке, на проверку уходит меньше двух процентов того времени, которое заняла бы работа, сделанная руками.
Причина простая, и она стоит того, чтобы её понять. Проверять процесс дорого. Перечитывать, из чего агент собрал результат, шаг за шагом — это дольше, чем собрать самому. Проверять результат дёшево: пробежаться глазами по тексту, открыть страницу, посмотреть документ. Секунды.
Поэтому я смотрю на результат и не смотрю в процесс. А на саму проверку часто ставлю отдельного агента — проверка это тоже работа, и её тоже можно отдать.
Большую часть сделанного я не проверяю вообще.
Тогда где ловушка
Она там, где результата не видно.
Документ ты откроешь и просмотришь — увидишь и лишнюю строку, и не ту. Текст прочитаешь. Страницу откроешь. Во всех этих случаях ошибка агента лежит перед тобой и стоит секунду внимания.
А разговор — не лежит нигде. Человек просто не ответил. Он не написал «мне не понравилось, как со мной говорили», он не написал вообще ничего. Смотреть не на что, и никакой отчёт эту потерю не покажет.
Ровно поэтому история со ссылкой продержалась дольше, чем должна была. Со стороны системы всё было хорошо.
У меня был и второй такой случай, из другой части хозяйства: система, которая сама наполняет мой сайт, однажды решила, что публиковать больше нечего, и убрала всё. Она не сломалась и не пожаловалась — она отчиталась об успехе. Я увидел это, только когда открыл сайт глазами.
Что я с этим делаю
Первое время я читал переписки живьём. Не для контроля качества, а потому что это было единственное место, где ошибку нельзя увидеть задним числом.
Когда агент говорил не то, я перехватывал разговор, доводил человека сам — и только потом шёл и правил агента.
В этом порядке всё дело. Сначала спасти клиента руками, потом чинить систему. Соблазн обратный: увидел поломку, полез в настройки, а человек в это время ушёл. Разговор нельзя поставить на паузу.
Что это значит, если у тебя команда
Твоё внимание — ресурс, и распределять его надо не поровну.
Всё, что оставляет след, можно смотреть быстро и выборочно: документы, письма, отчёты, описания, выгрузки. Ошибка там видна и дёшево ловится.
Всё, что происходит в живом разговоре, требует другого отношения. Не потому что машина там хуже, а потому что провал в разговоре не оставляет следа. Клиент не жалуется. Он уходит.
И когда считаешь, сколько времени сэкономил, помни: сэкономленное считается по тому, что ты видишь. Потерянное в разговорах не попадает ни в один отчёт.
Чего не делать
Не считай зелёный отчёт доказательством результата. Система отчитывается о том, что сделала, а не о том, что дошло.
Не чини агента, пока клиент ещё в разговоре. Сначала человек, потом настройки.
И не строй проверку там, где смотреть удобно. Строй её там, где ошибку не видно.