последний пост
Компилировать, а не выращивать
Выращивание — фаза открытия, компиляция — фаза продакшена, а понять, что процедура агента сошлась, можно подсчётом, без модели
Есть один момент, который я подсмотрел, наблюдая за агентами не как разработчик, а как дата-инженер — то есть человек, которого профессионально раздражает, когда одна и та же работа делается заново без причины.
У меня есть self-hosted панель, которая выдаёт клиентские конфиги для подключения, и раз в пару недель кому-то нужен новый. Работа на пять минут: сходить в панель, завести клиента, отдать конфиг. И каждый раз агент соображает её заново. В одну из сессий он пошёл в API панели, получил 404 на первом же эндпоинте, решил проявить инициативу и полез писать в базу напрямую — база залочена, рестарт сервиса рвёт ssh-сессию, в панели повисает клиент-призрак, откатываем руками. В другую — всё вышло чисто с первого захода: правильный эндпоинт панели, бэкап базы перед мутацией, рестарт, проверка, что новый клиент реально виден в живом конфиге.
То есть процедура есть. Она лежит в моей же истории — в той сессии, где всё получилось. Просто следующая сессия начинается с нуля и не обязана к ней прийти.
В какой-то момент я перестал прикидывать на глаз и посчитал. Написал майнер, который читает мои собственные транскрипты Claude Code — все проекты, все сессии, никакой модели в цикле, — и спросил его, какую работу я переоткрываю чаще всего. Выдача конфига: шесть сессий, три проекта. Шесть раз агент шёл рассуждением к процедуре, которая уже была найдена в одной из этих сессий.
Вот в этом и расхождение: мы построили целую индустрию на том, чтобы выращивать поведение агента заново при каждом запуске — там, где его давно пора было скомпилировать.