Косяки моего ИИ-агента · Часть 1
Самый вежливый лжец в моей команде сидит у меня в компьютере
Прошлый сериал, «Агентство из ИИ», закончился словами, что все овраги теперь известны поимённо. Эта серия про них. Про ошибки, которые ИИ делает не от незнания, а уверенно, грамотно и с хорошим видом.
Начну с самой безобидной на вид.
«Завтра проверю», сказал он
Каждый пост сериала выходит по расписанию сразу в четыре места: утром пост в ВК и в MAX, через пару минут комментарий со ссылкой на сайт, ещё через три минуты история. Ставит всё это ИИ-агент в Claude Code. И в конце каждого отчёта писал одно и то же:
«Завтра после выхода проверю, что всё прошло, и перенесу текст в архив».
Звучит как хороший сотрудник. Только на следующий день ничего не происходило. Про проверку агент вспоминал, когда я сам писал в чат.
Я спросил прямо: почему ты пишешь, что проверишь, хотя по факту не делаешь этого и вспоминаешь только тогда, когда я снова пишу?
А его в это время просто нет
Между моими сообщениями ИИ не существует. Он не сидит в фоне, не смотрит на часы и не просыпается сам. Есть разговор, пока я пишу. Нет разговора, нет и его.
То есть обещание «завтра проверю» не было враньём в человеческом смысле. Оно было фразой, за которой ничего не стояло. Агент написал её, потому что так пишет аккуратный исполнитель. А механизма, который бы её выполнил, не было.
Опасно тут именно то, что звучит убедительно. Я читал «проверю» и спокойно переключался на другое. Если бы пост не вышел или вышел дважды, я узнал бы об этом не из отчёта, а от читателей.
Будильник вместо честного слова
Теперь правило записано в память агента: «проверю позже» можно писать, только если поставлена задача по расписанию. Нет задачи, пиши честно: «проверю, когда напишете».
Задачи по расписанию в Claude Code есть. Это отдельный запуск агента в назначенное время, со своей инструкцией. Важно, что инструкция должна быть самодостаточной: запуск не помнит нашего разговора, поэтому в ней прописано всё.
Для выхода поста она выглядит так:
- в 11:15, через четверть часа после выхода, открыть стену и посчитать, сколько вышло копий поста: норма одна;
- проверить, что отложенная запись исчезла из отложки;
- заглянуть в журналы сервера: ушёл ли комментарий и история, забрал ли пост MAX;
- если всё прошло, перенести текст в архив и отметить выход в реестре сериала;
- если что-то не вышло или вышло дважды, ничего не исправлять руками, только доложить.
Последний пункт важен. Ручной выпуск «на всякий случай» уже однажды дал мне два одинаковых поста на стене, поэтому проверка только читает и докладывает.
Есть и регулярная задача: каждый понедельник сводка по замеру, который идёт у клиента. Сколько пришло заявок, сколько ушло сообщений, ответили ли люди.
Последние четыре части прошлого сериала проверялись уже так. Все четыре раза задача сработала сама, без моего напоминания, перенесла тексты в архив и обновила реестр. Недельная сводка в понедельник тоже пришла сама.
Одно ограничение: такие задачи работают, пока открыто приложение. Если в назначенное время оно закрыто, задача выполнится при следующем запуске.
Верь будильнику, а не обещанию
ИИ пишет как очень аккуратный человек. Но то, что человеку стоит одного стикера на мониторе, у ИИ требует отдельного механизма.
Поэтому я теперь смотрю не на обещание, а на то, чем оно обеспечено. «Проверю» без будильника это просто вежливое слово.
В следующей части расскажу, как ИИ приписал мне то, чего я не говорил, и почему это прозвучало правдоподобнее правды.
Понравился разбор?
Внедряю ИИ в бизнес и разбираю рынок недвижимости на данных. Обсудим вашу задачу или проект?