Files
transcriber/tasks/items/speechkit-limits.md
T
av 5501384cdc tasks: упразднены цели и роадмап, объявлена стадия build
- 11 записей типа goal закрыты с причиной, называющей задачи-наследники;
  ROADMAP.md удалён, индекс остался один — BACKLOG.md;
- 33 записи переписаны: ссылка «Двигает пункты N «Завершения» цели» уступила
  место прямому утверждению — без целей номера пунктов вели в никуда;
- шапка BACKLOG.md размечена парой <!-- стадия -->, порядок строк теперь
  объявлен зависимостью, а не важностью.
2026-08-13 16:00:14 +03:00

2.1 KiB
Raw Blame History

🔬 Потолки SpeechKit по длине записи и по формату

  • Тип: research
  • Категория: Очередь — Долгие записи начинаются с замера: без потолков ни отказ на приёме, ни резка не проектируются.
  • Зачем: Потолок длины записи и перечень принимаемых форматов неизвестны, а работа над долгими записями без них не начинается.

Запись длиной в несколько часов упирается в то, что неизвестно, на каком звене она отваливается. Начинать с переделки приёма или с деления записи на куски — разные работы, и выбор между ними определяет замер, а не рассуждение.

Отдельно висит расхождение: конвертер отдаёт ogg/vorbis (libvorbis), а SpeechKit получает заявку ContainerAudio_OGG_OPUS. Работает ли это и что происходит с записью — не разбиралось.

Вопрос

Какую самую длинную запись модель deferred-general доводит до текста, что происходит при превышении и какие контейнеры она принимает на самом деле.

Куда ляжет ответ

docs/research/speechkit.md — числами и с командой замера. Ответ на вопрос про OGG_OPUS уходит туда же и снимает открытый вопрос из architecture.md.

Рамки

Замер идёт за деньги: распознавание и хранение в Object Storage оплачиваются по факту. Число прогонов и длину пробных записей назначает человек. Боевые записи пользователей для замера не берём.