Я заставил ИИ‑агента работать по протоколу тушения пожаров. За шесть дней он переписал сам себя 10 раз
Краткое содержание
В какой‑то момент я перестал доверять фразе «готово» от языковой модели.Модель при этом не врёт: она честно считает, что сделала работу. Она пишет «реализовано, тесты проходят», и чаще всего так и есть. Беда в остальных случаях, когда модель поправила один вызов из четырёх, приняла собственный план за выполненную работу и закрыла задачу. Диалог при этом выглядит безупречно до самого конца.Я перепробовал обычный набор: писал развесистыеCLAUDE.md, требовал план перед кодом, просил самопроверку. Всё это держалось ровно до тех пор, пока не становилось неудобным. Правило, написанное словами, агент нарушает в тот момент, когда у него появляется разумно выглядящая причина его обойти, и такая причина находится всегда.Искать готовую систему управления мне далеко не пришлось. До ухода ExxonMobil из России я работал там аналитиком по аварийно‑спасательному реагированию, и ICS была в этой роли повседневным рабочим инструментом: я прошёл по ней множество тренингов, включая уровень Advanced, и работал фасилитатором IMT, Incident Management Team. Оттуда и пришла мысль перенести ICS в разработку.Читать далее
Полный текст статьи пока не загружен.