Агент, который долго работает один в непрерывном контексте, редко ломается резко. Чаще он вырождается тихо, и снаружи это долго выглядит как нормальная работа. Разберём этот сбой по шагам.
Симптомы
1. Впечатление вместо проверки. Накопленный контекст подменяет сверку по факту ощущением «обычно всё в порядке». Если три последние проверки прошли гладко, четвёртую уже сверяют не с признаком, а с ожиданием.
2. Ранние решения смещают поздние. Каждое решение принимается в тени предыдущих. Незаметный крен в начале задаёт направление всему, что идёт дальше.
3. Похожее вместо того же самого. Исполнение постепенно съезжает от исходного замысла к чему-то похожему. Всё выглядит разумно, но результат уже другой.
Над этой проблемой сейчас работают и лаборатории, которые делают модели, и все, кто строит агентные системы поверх них: как удержать агента точным не на пятой минуте, а на пятидесятом шаге.
Что делает протокол
«Форма» отвечает не советом «будь внимательнее», а устройством:
- Изоляция.
Spec,Kit,RunиCore— отдельные вызовы без общей памяти. Каждый стартует с чистого листа и заканчивается вместе с результатом. Протащить впечатление из прошлого захода физически нечем. - Сверка по записанному признаку. Каждая задача проверяется по признаку готовности из карточки, а не по тому, какими были последние проверки.
- Никто не проверяет себя. Результат принимает следующий узел, а не тот, кто его сделал.
Особый случай: Intent
Intent — единственный узел с настоящей памятью: он ведёт одну непрерывную сессию с человеком и технически ничего не забывает. Поэтому на поштучной сверке его беспамятность — дисциплина, которую он сам на себя накладывает. Каждую задачу он намеренно сверяет только по признаку из карточки.
Итог
Тихое вырождение не лечится вниманием: изнутри оно не ощущается ошибкой. Его ловят формой: изоляцией, записанным признаком и отдельным проверяющим.




Комментарии