Задача: Проработать инфраструктурную наблюдаемость проекта

Проработать инфраструктурную наблюдаемость проекта

Понять минимальную наблюдаемость, необходимую агенту и специалисту для безопасного обслуживания работающего проекта.

Проблема

После deploy проект нельзя считать обслуживаемым только потому, что процесс запущен. Нужно быстро понимать, работает ли сайт, не появились ли ошибки и что изменилось после конкретного действия.

Что исследовать

Нужно определить минимально полезные сигналы: доступность, health checks, application/runtime logs, ошибки, состояние ключевых сервисов и другие признаки в зависимости от проекта.

Цель — не построить собственный аналог большой observability-платформы. Общая инфраструктура должна уметь использовать доступные сигналы и показывать агенту достаточно контекста для диагностики.

Связано с агентным циклом, deploy/rollback и существующей задачей подробного логирования действий агента.