Задача: Добавить в ядро haih-agent исполнимые проверки результата задач

Добавить в ядро haih-agent исполнимые проверки результата задач

16.09.2026haih-агент

Перенести в ядро подход с воспроизводимыми проверочными скриптами: агент должен уметь использовать их как критерий готовности и самостоятельно выполнять после изменений.

Контекст

Связано с задачей по Open Graph-разметке cmu41yoku0f87qw0qub13wo6h.

В той задаче сначала был написан терминальный TypeScript-скрипт проверки HTML-разметки. Он зафиксировал исходное состояние страницы, затем был передан ИИ-агенту вместе с постановкой задачи, а после реализации тем же скриптом был подтверждён успешный результат.

Практический паттерн:

reproduce → implement → verify

Такой подход стоит поднять из уровня конкретного проекта в ядро haih-agent.

Референс реализации

В качестве примера посмотреть коммит в HappyBaby:

e664496d8500751a13727b

Нужно изучить, что именно там было добавлено вокруг проверочного сценария, и вынести обобщаемую часть в ядро агента.

Что требуется

Добавить в core-механику возможность работать с исполнимой проверкой результата задачи:

  • задача может содержать или порождать проверочный скрипт/команду;
  • агент должен воспринимать эту проверку как фактический критерий готовности;
  • до изменений желательно уметь выполнить проверку и зафиксировать baseline/failing state, если это применимо;
  • после реализации агент должен самостоятельно запустить ту же проверку;
  • задача не должна считаться завершённой только на основании текстового отчёта агента, если доступна исполнимая проверка;
  • в итоговый отчёт нужно включать фактическую команду проверки и результат её выполнения;
  • при падении проверки агент должен продолжить цикл исправления, а не перекладывать первичную проверку на человека.

Пример сценария

Для Open Graph была команда вида:

npx tsx scripts/check-page-image/index.ts "http://localhost:3000/catalog/product.html"

До изменений:

HTTP: 200

✗ og:title: missing
✗ og:description: missing
✗ og:image: missing
✗ og:url: missing
✗ og:type: missing

RESULT: invalid or incomplete

После реализации:

HTTP: 200

✓ og:title: Мелкогабаритная площадка Корабль
✓ og:description: Размер 3.48 х 1.78 х 2.32 м.
✓ og:image: http://localhost:3000/images/resized/middle/images/img.jpg
✓ og:url: http://localhost:3000/catalog/product.html
✓ og:type: product

RESULT: OK

Ожидаемый результат

Нужна не Open Graph-специфичная логика, а универсальный core-механизм для сценария, где задача имеет машинно исполнимую проверку результата.

Желательный цикл агента:

1. Получить задачу
2. Найти/создать воспроизводимую проверку
3. Выполнить её и понять исходное состояние
4. Реализовать изменение
5. Самостоятельно повторить проверку
6. При ошибке продолжить исправление
7. Завершить задачу только после успешной проверки либо явно зафиксированной причины, почему проверить невозможно

Критерии готовности

  • В ядре есть обобщённая поддержка исполнимой проверки результата задачи.
  • Проверка запускается агентом автоматически после реализации, если она доступна.
  • Неуспешная проверка не приводит к ложному done.
  • Результат проверки попадает в итоговый отчёт/worklog.
  • Решение не привязано к конкретному проекту HappyBaby или к Open Graph.
  • Добавлены тесты на успешный и падающий сценарии.
  • Коммит e664496d8500751a13727b изучен и использован как практический референс, но core-реализация остаётся универсальной.