Контрольные точки агента

Контрольные точки агента — это сохранение состояния прогона в заданных местах, чтобы прогон можно было продолжить, а не запускать заново. Сохранять стоит больше, чем стенограмму диалога: счётчик шагов и израсходованный бюджет, уже сделанные вызовы инструментов и их результаты, всё, что агент успел закрепить во внешних системах, и незавершённый план. Прогон, который нельзя продолжить, после любого перерыва приходится выполнять с начала, а повторное выполнение агента не бесплатно. Оно снова стоит токенов и повторяет все побочные эффекты, которые уже вызвала первая попытка. Именно вторая статья расходов объясняет, почему контрольные точки и идемпотентность — одна задача проектирования, увиденная с двух сторон. Чтобы безопасно продолжить, надо знать, какие внешние действия уже произошли, а надёжный способ это знать — записывать намерение действовать до действия, отмечать выполнение после и давать каждому действию ключ идемпотентности, чтобы повтор поглощался, а не дублировался. Без такой записи продолженный агент отправляет второй счёт. Контрольные точки меняют и возможности оператора. Прогон, поставленный на паузу в контрольной точке, можно осмотреть, поправить и продолжить — так человеческое согласование встраивается в длинную задачу без того, чтобы кто-то сидел над ней от начала до конца, — а сбойный прогон можно перезапустить с последней хорошей точки с исправленным входом вместо того чтобы выбросить. Механизм стоит места и задержки на запись, поэтому ставьте точки на осмысленных границах, а не после каждого вызова модели: когда сохранён результат инструмента, когда закрыт шаг плана и перед всем необратимым. Воспроизведение не восстановит состояние точно, потому что вывод модели недетерминирован, — ровно поэтому состояние хранят, а не пересчитывают.

Похожие термины

Ещё термины: ИИ-агенты