Files
healthlog/docs/tasks/items/stream-silence-alert.md
T
av d79189be18 docs: документация переведена на канон av-dev-pm
- беклог и план переехали в docs/tasks (38 задач, 11 целей), слаги
  переименованы с транслита на английские, 85 ссылок поправлены
- conventions.md разобран в docs/conventions/, local-research.md — в
  docs/research/, review-journal.md — в docs/review.md с разделом настройки
  конвейера; заведены security.md, adr/ и .pm.json
- шаг docs.py check добавлен в task gate; поведение в architecture.md помечено
  девятью маркерами долга, database.md получил настройки с числовым значением
2026-08-03 17:14:53 +03:00

2.3 KiB

Активный алерт «данных нет N часов»

Секция: инфра · Хук: Пропажу потока сейчас замечает человек, а не сервис · Теги: goal:observability

Пропажу потока сейчас замечает человек. /stats покажет факт, но только если туда заглянуть — а заглядывают ровно тогда, когда уже что-то заподозрили.

Активное уведомление закрывает разрыв: сервис сам сообщает, что данных нет дольше порога. Канал — тот же, что у остальных моих проектов.

Порог не единый: быстрый проход идёт каждые 5 минут, но ночью телефон заблокирован и тишина штатна (находка 28). Значит порог считается по времени суток или по последней успешной доставке каждой автоматизации отдельно.

Приоритет низкий, пока сервис на рабочей машине и я вижу его каждый день. После деплоя на rivendell поднимется.

Источник алерта не может жить внутри serve

Отказ стража версии схемы (база новее бинаря) останавливает процесс, а restart: unless-stopped даёт цикл перезапуска. Значит алерт «данных нет N часов», живущий внутри сервиса, на эту причину остановки не сработает по построению — он не поднимется вместе с ним. Обоснование стража («откат делает оператор, он в этот момент рядом») верно для ручного отката и не покрывает перезапуск хоста или откат деплоя.

Пришло из задачи «Дозакрыть находки ревью по слиянию сущностей» (проход ops, negative).