- слово «провенанс» снято из словаря проектных текстов: у числа теперь «происхождение», у вопроса и находки — «откуда» - правлены форма вопроса в docs/review.md, шапка раздела об OIDC в docs/research/pocketbase.md и две записи задач; формулировки прошли вычитку агентами doc-wording и task-wording - архив openspec/changes/archive/ не тронут: слово, верное на день записи, остаётся свидетельством
2.2 KiB
2.2 KiB
🔬 Перечень форматов, которые конвейер принимает на самом деле
- Тип: research
- Категория: Очередь — Форматы: сначала замер того, что конвейер берёт на самом деле.
- Зачем: Команда ffmpeg проверена на голосовых Telegram, а что она берёт помимо них, не мерил никто: перечень выведен из документации, а не из прогона.
Замер даёт перечень принимаемых форматов и разбирает расхождение ogg/vorbis
против заявленного SpeechKit OGG_OPUS.
Вопрос
Какие форматы доходят до текста целиком, какие ломаются на конвертации, какие —
на распознавании, и чем на самом деле кодирует конвертер: vorbis или opus.
Куда ляжет ответ
docs/research/audio-formats.md— таблица «формат на входе → исход», с командой замера и версией ffmpeg, на которой он сделан;- расхождение
ogg/vorbisпротивOGG_OPUS: строка о том, устранено оно или проверено безвредно, и чем это подтверждено; - форматы, которые принять нельзя, — задачей об отказе на приёме, и она называет эту разведку.
Рамки
Замер идёт на своих файлах во временном каталоге и на подставном распознавателе
internal/adapter/recognizer/memory.go; прогон на реальных ключах Yandex
запрещён — там, где без настоящего SpeechKit не обойтись, ответ берётся из
задачи speechkit-limits, а не оплачивается заново. Видеофайлы здесь только
измеряются, приём их заводит video-audio-track-intake.