Files
healthlog/docs/tasks/items/rebuild-memory-footprint.md
T
avandClaude Opus 5 a53d0f0f2f задачи: мета переехала в блок, поле «Хук» стало «Зачем»
49 файлов, миграция сделана командой tasks.py check --fix — той самой, ради
которой в скрипте оставлена читаемость старой формы. Побочно тот же прогон
проставил тег decomposed целям, у которых есть задачи: это его штатная работа.

check после миграции зелёный, индексы согласованы.

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
2026-08-03 17:31:29 +03:00

2.2 KiB

Пересборка держит весь журнал в памяти

  • Секция: ядро
  • Зачем: Учёт доставок и список путей архива материализуются целиком: расход растёт вместе с журналом, а у журнала конца нет
  • Теги: goal:journal-and-rebuild

healthlog reindex материализует целиком две вещи: учёт доставок из базы и список путей архива. На сегодняшнем объёме (сотня тел) это незаметно, на квартальном (~12 тысяч) — терпимо, а дальше растёт линейно и без предела: журнал по определению не подчищается до следующего проверенного экспорта.

Отдельно к этому примешивается размер заголовков: MaxHeaderBytes у сервера не задан, то есть верхней границы у колонки delivery.headers нет вовсе. Раздутый заголовок множится на число доставок.

Порог, за которым это перестаёт быть теорией, не измерен — с него и стоит начинать, если задача берётся. Лечится потоковым перечислением журнала (курсор по учёту, обход каталога партиями по суткам) вместо двух срезов в памяти.

Сегодня недостижимо, поэтому приоритет низкий. Естественно склеивается с ретеншеном сырого архива: та задача задаёт, где у журнала конец, эта — как его читать, не поднимая целиком.

Готово, когда пересборка на журнале в десятки тысяч доставок идёт с потреблением памяти, не зависящим от его длины.

Связано: internal/replay, cmd/healthlog/reindex.go.