Files
transcriber/tasks/items/long-recordings.md
T
av d2c85af80a tasks: целевая картина пересобрана — три цели, тринадцать задач, сдвинутые границы
- паспорт: сервис объявлен архивом с бессрочным хранением записей и текстов,
  машинная вычитка расшифровки внутри границ, приложение — основной вход;
  добавлены две границы: не файловое хранилище общего назначения и не биллинг;
- заведены цели upload-reliability, user-settings, usage-stats и тринадцать
  задач; очередь пересобрана — сперва починки, затем разведки о хранилище,
  затем доступ и владелец, и только потом экраны;
- архитектура: четыре новых открытых вопроса — приём большого файла, учёт
  расхода, срок хранения, потолок шести часов.
2026-08-11 10:05:22 +03:00

29 lines
2.4 KiB
Markdown

# 🎯 Запись длиной до шести часов доходит до текста
- **Тип:** goal
- **Секция:** Направления
- **Зачем:** Потолок не замерен ни на одном звене: Telegram не отдаёт больше 20 МиБ, границы модели deferred-general неизвестны, а перезапуск на середине начинает распознавание заново.
- **Теги:** decomposed
Лекция, созвон, интервью и диктофонная запись из семейного архива целиком
превращаются в текст. Сегодня неизвестно даже, на каком звене такая запись
отваливается, — цель начинается с замера, а не с переделки.
Расчётный потолок — **шесть часов**: он взят с запасом под диктофонные записи и
дорожки из видео, и замер проверяет, каким звеном он ограничен на самом деле.
## Завершение
1. Потолки каждого звена замерены и записаны в `research/` с командой замера:
приём из Telegram, приём по HTTP, конвертация, заливка в Object Storage,
модель `deferred-general`.
2. Запись, превышающая потолок, отклоняется на приёме понятным текстом, а не
висит в конвейере до истечения захвата.
3. Запись в пределах потолка доходит до текста и не теряет его хвост.
4. Текст в несколько сотен килобайт доходит до получателя: и в браузере, и в
Telegram, где предел сообщения — 4000 символов.
5. Долгая задача не блокирует короткие: запись на три часа не останавливает
конвейер для голосового на десять секунд.
6. Перезапуск сервиса на середине долгой расшифровки не начинает её заново:
работа продолжается с места остановки.