Files
transcriber/tasks/items/audio-format-coverage-measure.md
T
av b7d4660aef канон: раскладка повышена до версии 4
- слово «провенанс» снято из словаря проектных текстов: у числа теперь
  «происхождение», у вопроса и находки — «откуда»
- правлены форма вопроса в docs/review.md, шапка раздела об OIDC в
  docs/research/pocketbase.md и две записи задач; формулировки прошли
  вычитку агентами doc-wording и task-wording
- архив openspec/changes/archive/ не тронут: слово, верное на день записи,
  остаётся свидетельством
2026-08-14 09:51:01 +03:00

31 lines
2.2 KiB
Markdown

# 🔬 Перечень форматов, которые конвейер принимает на самом деле
- **Тип:** research
- **Категория:** Очередь — Форматы: сначала замер того, что конвейер берёт на самом деле.
- **Зачем:** Команда ffmpeg проверена на голосовых Telegram, а что она берёт помимо них, не мерил никто: перечень выведен из документации, а не из прогона.
Замер даёт перечень принимаемых форматов и разбирает расхождение `ogg/vorbis`
против заявленного SpeechKit `OGG_OPUS`.
## Вопрос
Какие форматы доходят до текста целиком, какие ломаются на конвертации, какие —
на распознавании, и чем на самом деле кодирует конвертер: `vorbis` или `opus`.
## Куда ляжет ответ
- `docs/research/audio-formats.md` — таблица «формат на входе → исход», с
командой замера и версией ffmpeg, на которой он сделан;
- расхождение `ogg/vorbis` против `OGG_OPUS`: строка о том, устранено оно или
проверено безвредно, и чем это подтверждено;
- форматы, которые принять нельзя, — задачей об отказе на приёме, и она
называет эту разведку.
## Рамки
Замер идёт на своих файлах во временном каталоге и на подставном распознавателе
`internal/adapter/recognizer/memory.go`; прогон на реальных ключах Yandex
запрещён — там, где без настоящего SpeechKit не обойтись, ответ берётся из
задачи `speechkit-limits`, а не оплачивается заново. Видеофайлы здесь только
измеряются, приём их заводит `video-audio-track-intake`.