Flownix
Разделы
На этой странице

Ежедневная работа

Проект живёт, идёт разработка. Как выглядит цикл, в котором следующий агент не начинает с нуля.

Ситуация

Проект заведён, дерево есть, работа идёт. Задачи выполняются агентом — иногда одним, иногда несколькими в разные дни. Между сессиями агент не помнит ничего.

Это главная проблема ежедневной работы с агентами, и она не решается более умной моделью: контекст просто не переживает конец сессии. Решается тем, где хранится знание.

Что делаете вы

Даёте задачу по слагу, а не пересказываете её. Весь контекст уже в ноде.

Читаете [decision]. Это то место, где агент объясняет неочевидный выбор. Спорить о решении дешевле сейчас, чем разбирать его по коду через месяц.

Переводите в «выполнено» — или в «регрессию» с тем, что не так. Агент оставляет задачу в «тестировании» и дальше не двигает: сделал и проверил — разные роли.

Что делает агент

в сессии агента, каждый раз
/execute-task AF-TASK-42

Что за этим стоит:

  1. get_node(slug: "AF-TASK-42") — описание и все комментарии: там решения, принятые раньше.
  2. get_dependencies — если блокер открыт, агент не начинает, а говорит об этом.
  3. rag_context — окружающий контекст: похожие задачи, принятые решения, соседние модули. То, что не написано в тикете, но записано в проекте.
  4. update_node_status(status: "in_progress") — на доске видно, чем он занят.
  5. add_comment по ходу: [progress] — что сделано, [decision] — почему именно так, [blocker] — что мешает.
  6. update_node_status(status: "testing") с хэшем коммита и [done] о том, как проверить.

Проверку можно тоже отдать агенту — вторым проходом, тем, который не писал этот код:

в сессии агента, после исполнителя
/review-work AF-TASK-42

Он идёт по критериям приёмки поимённо и переводит задачу в done или обратно в regression с перечнем того, что не так.

Если задача не одна и порядок известен, план исполняется целиком — скилл сам обойдёт дочерние задачи в порядке зависимостей:

в сессии агента
/execute-task AF-PLAN-7

Что получится

Цикл, в котором знание не теряется. Следующий агент, взяв соседнюю задачу, читает комментарии предыдущего и продолжает, а не начинает заново. Через месяц вы сами открываете задачу и видите не только что сделано, но и почему выбрано это.

Прогресс родительских нод пересчитывается по статусам задач внутри — дерево показывает реальное состояние, а не то, что кто-то не забыл обновить.

Границы

Дисциплина держится на скиллах, а не на добром намерении. Агент без скилла execute-task сделает работу и не оставит следа. Проверяйте, что скиллы у него есть и свежие: sync-skills сверяет их с сервером.

Статус врёт, если его не двигать. Задача, месяц висящая «в работе», ломает прогресс всего дерева. Это не техническая проблема, а рабочая привычка.

Агент не решит за вас спорное. Он оставит [blocker] и остановится. Это правильное поведение, но требует, чтобы кто-то читал блокеры.

Токены и длительность видны не всегда. Панель присутствия показывает, кто над чем работает; счётчик токенов требует отдельного репортера (установка), и без него панель честно пишет, что репортер не подключён, а не рисует ноль.

Дальше