- слово «провенанс» снято из словаря проектных текстов: у числа теперь «происхождение», у вопроса и находки — «откуда» - правлены форма вопроса в docs/review.md, шапка раздела об OIDC в docs/research/pocketbase.md и две записи задач; формулировки прошли вычитку агентами doc-wording и task-wording - архив openspec/changes/archive/ не тронут: слово, верное на день записи, остаётся свидетельством
31 lines
2.2 KiB
Markdown
31 lines
2.2 KiB
Markdown
# 🔬 Перечень форматов, которые конвейер принимает на самом деле
|
|
|
|
- **Тип:** research
|
|
- **Категория:** Очередь — Форматы: сначала замер того, что конвейер берёт на самом деле.
|
|
- **Зачем:** Команда ffmpeg проверена на голосовых Telegram, а что она берёт помимо них, не мерил никто: перечень выведен из документации, а не из прогона.
|
|
|
|
Замер даёт перечень принимаемых форматов и разбирает расхождение `ogg/vorbis`
|
|
против заявленного SpeechKit `OGG_OPUS`.
|
|
|
|
## Вопрос
|
|
|
|
Какие форматы доходят до текста целиком, какие ломаются на конвертации, какие —
|
|
на распознавании, и чем на самом деле кодирует конвертер: `vorbis` или `opus`.
|
|
|
|
## Куда ляжет ответ
|
|
|
|
- `docs/research/audio-formats.md` — таблица «формат на входе → исход», с
|
|
командой замера и версией ffmpeg, на которой он сделан;
|
|
- расхождение `ogg/vorbis` против `OGG_OPUS`: строка о том, устранено оно или
|
|
проверено безвредно, и чем это подтверждено;
|
|
- форматы, которые принять нельзя, — задачей об отказе на приёме, и она
|
|
называет эту разведку.
|
|
|
|
## Рамки
|
|
|
|
Замер идёт на своих файлах во временном каталоге и на подставном распознавателе
|
|
`internal/adapter/recognizer/memory.go`; прогон на реальных ключах Yandex
|
|
запрещён — там, где без настоящего SpeechKit не обойтись, ответ берётся из
|
|
задачи `speechkit-limits`, а не оплачивается заново. Видеофайлы здесь только
|
|
измеряются, приём их заводит `video-audio-track-intake`.
|