Files
transcriber/tasks/items/intake-limits-measure.md
T
av 9a54afba60 tasks: заведены три задачи под незакрытые пункты цели о долгих записях
- intake-limits-measure меряет четыре звена, которых не берёт speechkit-limits:
  приём из Telegram и по HTTP, конвертацию и заливку в Object Storage;
- reject-oversized-recording отклоняет запись сверх потолка на приёме,
  long-text-delivery отдаёт текст в сотни килобайт файлом вместо сотни
  сообщений Telegram;
- все шесть пунктов «Завершения» цели теперь закрыты задачами.
2026-08-11 10:28:56 +03:00

33 lines
2.2 KiB
Markdown

# 🔬 Потолки приёма, конвертации и заливки по длине записи
- **Тип:** research
- **Категория:** Очередь
- **Зачем:** Из пяти звеньев задача speechkit-limits замерила только модель распознавания: где отваливается шестичасовая запись до неё, неизвестно.
- **Теги:** goal:long-recordings
Пункт 1 «Завершения» цели требует замера пяти звеньев, а разведка
`speechkit-limits` меряет одно — модель `deferred-general`. Остальные четыре
дешевле: они не требуют боевых ключей и считаются локально, кроме заливки.
Числа нужны раньше кода: они назначают потолок, который проверяет приём, и длину
фрагмента, на которые режет `long-audio-chunking`.
## Вопрос
На какой длине и на каком весе записи отказывает каждое звено до распознавания —
приём из Telegram, приём по HTTP вместе с обратным прокси, конвертация `ffmpeg`
и заливка в Object Storage, — и сколько времени и места на диске занимает
шестичасовая запись на каждом из них.
## Куда ляжет ответ
`docs/research/intake-limits.md` — числами и с командой замера по каждому звену.
Оттуда их берут задачи `reject-oversized-recording` и `long-audio-chunking`.
## Рамки
Заливка в Object Storage оплачивается по факту — число прогонов назначает
человек, пробные файлы после замера удаляются. Прочие звенья меряются локально,
на файлах, созданных `ffmpeg`, а не на записях пользователей. Потолок самой
модели меряет `speechkit-limits`, здесь он не трогается.