Files
transcriber/tasks/items/speechkit-limits.md
T
av d21da8575c Единый список задач вместо двух секций, порядок по выполнению
Секции «Ядро» и «Инфра» слиты в одну «Очередь»: полок домена у проекта
нет, а две секции держали два независимых порядка вместо одного.

Порядок: красный гейт, потом долги, задевающие интерфейсы, потом
хранилище, вход, разграничение, приложение. Разведка потолков SpeechKit
последней — она обслуживает направление, а не очередь.
2026-08-10 21:39:55 +03:00

33 lines
2.1 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 🔬 Потолки SpeechKit по длине записи и по формату
- **Тип:** research
- **Категория:** Очередь
- **Зачем:** Потолок длины записи и перечень принимаемых форматов неизвестны, а цель про долгие записи без них не начинается.
- **Теги:** goal:long-recordings
Цель «запись длиной в несколько часов доходит до текста» упирается в то, что
неизвестно, на каком звене такая запись отваливается. Начинать с переделки
приёма или с деления записи на куски — разные работы, и выбор между ними
определяет замер, а не рассуждение.
Отдельно висит расхождение: конвертер отдаёт ogg/vorbis (`libvorbis`), а
SpeechKit получает заявку `ContainerAudio_OGG_OPUS`. Работает ли это и что
происходит с записью — не разбиралось.
## Вопрос
Какую самую длинную запись модель `deferred-general` доводит до текста, что
происходит при превышении и какие контейнеры она принимает на самом деле.
## Куда ляжет ответ
`docs/research/speechkit.md` — числами и с командой замера. Ответ на вопрос про
`OGG_OPUS` уходит туда же и снимает открытый вопрос из
[architecture.md](../../docs/architecture.md).
## Рамки
Замер идёт за деньги: распознавание и хранение в Object Storage оплачиваются по
факту. Число прогонов и длину пробных записей назначает человек. Боевые записи
пользователей для замера не берём.