Планирование ИИ-агента: цель, наблюдения и остановка
Планирование ИИ-агента — выбор шагов и их пересмотр по мере получения наблюдений. Полезный план связывает шаг с результатом, предварительными условиями и проверкой. Планирование предлагает путь; управление исполнением определяет разрешённость действий и условия, при которых система обязана остановиться.

Длинный список выглядит убедительно, даже если скрывает отсутствующие исходные данные. Этот урок делает план проверяемым. Спроектируем маршрут к вводному уроку и изменим его, когда поиск покажет недостаточную предварительную подготовку.
Главные идеи
- Определите результат до перечисления действий.
- Меняйте план при изменении оснований.
- Связывайте завершённый шаг с наблюдением или проверкой.
- Исчерпание бюджета означает остановку, а не успех.
Задайте проверяемую цель
Цель 'изучить ИИ' слишком широка для понимания завершения. 'Найти вводный урок в разрешённом каталоге и вернуть требуемую подготовку' можно проверить. Запишите источник входа, разрешённые операции и приемлемый выход. Если цель учащегося неясна, предусмотрите уточнение вместо поиска по всем предметам. Итог должен объяснять найденное и оставшиеся пробелы. Тогда у системы есть основание завершиться, а у человека — способ оценить соответствие исходной задаче.
Свяжите шаги с результатами
Шаг 'искать' называет действие, но не его необходимость. Напишите 'получить запись урока по выбранному предмету' и определите ожидаемое свидетельство. Следующий шаг проверяет предварительную подготовку только после получения записи. Так видны зависимости. При отсутствии данных план останавливается вместо перехода к неподтверждённой рекомендации только потому, что в списке остались пункты. Проверяемые предварительные условия помогают отличить реальное продвижение от простого выполнения очередного вызова.
Пересматривайте план по произошедшему
Цикл сопоставляет наблюдения с предположениями плана. Если найден продвинутый урок, найдите нужное введение или сообщите, что разрешённого материала нет. Ошибку поиска отделяйте от пустой выдачи. ReAct — исследовательский пример объединения принятия решений, действий и наблюдений. Для упражнения важна привычка: изменять следующий шаг по новым основаниям и сохранять причину изменения. Убедительно сформулированный первоначальный маршрут не должен перевешивать сведения, действительно полученные от инструмента.
Спроектируйте условия остановки
Различайте успех, невозможность завершить, ожидание проверки и лимит запуска. В примере на Python бюджет шагов ограничивает бесконечные предложения. Рабочему приложению также могут понадобиться лимиты времени, обращений и использования. Задавайте их в контроллере, а не полагайтесь на память модели. После достижения лимита возвращайте известное и нерешённое без заявления о завершении исходной задачи. Честный статус позволяет человеку принять дальнейшее решение на основании фактического продвижения.
Проверяйте план и общий итог
Проверьте разрешённость шагов и достижение запрошенного результата. Даже идеально оформленный план способен рекомендовать урок вне каталога. Сохраняйте цель, идентификаторы источников, выполненные шаги и финальную проверку в краткой записи. Если участвуют несколько агентов, она поможет отличить завершённую часть от ожидающей передачи. Изучайте ошибки, чтобы менять цель, инструменты или переходы. Хорошая оценка рассматривает весь путь: от заданного входа до доказательства приемлемости конечного ответа.
Простыми словами
План — маршрут на карте. Наблюдения показывают, открыта ли дорога. Планировщик меняет путь по данным, а контроллер удерживает его в разрешённой области и определяет остановку.
Попробуйте сами
Спроектируйте рекомендацию каталога в четырёх шагах. Добавьте ветки отсутствующей записи и продвинутого урока. Для каждого шага задайте наблюдение, а для упражнения — бюджет в три обращения.
Ожидаемый результат
План с явными зависимостями, честными нерешёнными исходами и остановкой по заданному бюджету обращений.
Проверьте себя: Успешный вызов инструмента означает успех всей задачи?
Только если результат удовлетворяет исходному критерию. Вызов способен успешно вернуть неподходящую или неполную запись.
Вопросы и ответы
Агент должен точно следовать первому плану?
План направляет работу, но допускает пересмотр. Новые наблюдения выявляют отсутствующее предварительное условие или ошибочное предположение. Сохраняйте цель и ограничения, объясняйте изменение и проверяйте новый путь. Слепое следование первому плану способно перенести раннюю ошибку на последующие шаги.
Как остановить повторяющиеся действия?
В контроллере задайте бюджет и учёт выполненных операций. Определите поведение одинакового запроса без новой информации: остановка, уточнение или другой разрешённый поиск. Испытайте это правило. Одной просьбы к модели избегать повторов недостаточно для обеспечения ограничения на исполнение.
Объясняйте шаг через ожидаемый результат и основания. Полезный план способен измениться, приостановиться и закончиться с честным статусом.
Источники и дальнейшее чтение
- Yao et al. — ReAct: Synergizing Reasoning and Acting in Language Models ↗Источники проверены:
- Anthropic — Building effective agents ↗Источники проверены:
- LangChain — LangGraph overview ↗Источники проверены: