90% AI, 10% Human AI Workshop · Дубай

Ловушка девяноста процентов

Опасен не сбой агента, а работа, которая выглядит выполненной. Почему я почти не проверяю за агентами, где это перестаёт быть безопасным и почему потерянный разговор не попадает ни в один отчёт.

Мой агент довёл клиента до оплаты. Разговор шёл ровно, человек согласился, оставалось отправить ссылку. Агент её отправил. И клиент пропал.

Ссылку он не видел. Площадка вырезала её из сообщения — так работает защита от спама. Клиент смотрел в пустоту и не понимал, чего от него хотят. А агент считал, что задачу выполнил, и слал снова.

Никто не сломался. Агент сделал ровно то, что ему поручили. Ошибки не было — а оплата чуть не потерялась.

Вот это и есть ловушка девяноста процентов. Опасна не ошибка. Опасна работа, которая выглядит выполненной.

Я не первый, кто в неё попал. В опросе Stack Overflow за 2025 год шестьдесят шесть процентов разработчиков назвали своим главным раздражением ровно это: решения, которые почти правильные, но не совсем.

Но проверяю я мало

Тут я скажу вещь, которая противоречит всему, что обычно пишут про работу с машиной.

Я почти не проверяю за агентами. По моей оценке, на проверку уходит меньше двух процентов того времени, которое заняла бы работа, сделанная руками.

Причина простая, и она стоит того, чтобы её понять. Проверять процесс дорого. Перечитывать, из чего агент собрал результат, шаг за шагом — это дольше, чем собрать самому. Проверять результат дёшево: пробежаться глазами по тексту, открыть страницу, посмотреть документ. Секунды.

Поэтому я смотрю на результат и не смотрю в процесс. А на саму проверку часто ставлю отдельного агента — проверка это тоже работа, и её тоже можно отдать.

Большую часть сделанного я не проверяю вообще.

Тогда где ловушка

Она там, где результата не видно.

Документ ты откроешь и просмотришь — увидишь и лишнюю строку, и не ту. Текст прочитаешь. Страницу откроешь. Во всех этих случаях ошибка агента лежит перед тобой и стоит секунду внимания.

А разговор — не лежит нигде. Человек просто не ответил. Он не написал «мне не понравилось, как со мной говорили», он не написал вообще ничего. Смотреть не на что, и никакой отчёт эту потерю не покажет.

Ровно поэтому история со ссылкой продержалась дольше, чем должна была. Со стороны системы всё было хорошо.

У меня был и второй такой случай, из другой части хозяйства: система, которая сама наполняет мой сайт, однажды решила, что публиковать больше нечего, и убрала всё. Она не сломалась и не пожаловалась — она отчиталась об успехе. Я увидел это, только когда открыл сайт глазами.

Что я с этим делаю

Первое время я читал переписки живьём. Не для контроля качества, а потому что это было единственное место, где ошибку нельзя увидеть задним числом.

Когда агент говорил не то, я перехватывал разговор, доводил человека сам — и только потом шёл и правил агента.

В этом порядке всё дело. Сначала спасти клиента руками, потом чинить систему. Соблазн обратный: увидел поломку, полез в настройки, а человек в это время ушёл. Разговор нельзя поставить на паузу.

Что это значит, если у тебя команда

Твоё внимание — ресурс, и распределять его надо не поровну.

Всё, что оставляет след, можно смотреть быстро и выборочно: документы, письма, отчёты, описания, выгрузки. Ошибка там видна и дёшево ловится.

Всё, что происходит в живом разговоре, требует другого отношения. Не потому что машина там хуже, а потому что провал в разговоре не оставляет следа. Клиент не жалуется. Он уходит.

И когда считаешь, сколько времени сэкономил, помни: сэкономленное считается по тому, что ты видишь. Потерянное в разговорах не попадает ни в один отчёт.

Чего не делать

Не считай зелёный отчёт доказательством результата. Система отчитывается о том, что сделала, а не о том, что дошло.

Не чини агента, пока клиент ещё в разговоре. Сначала человек, потом настройки.

И не строй проверку там, где смотреть удобно. Строй её там, где ошибку не видно.

← Все разборы