Files
transcriber/tasks/items/audio-format-coverage-measure.md
T
av b7d4660aef канон: раскладка повышена до версии 4
- слово «провенанс» снято из словаря проектных текстов: у числа теперь
  «происхождение», у вопроса и находки — «откуда»
- правлены форма вопроса в docs/review.md, шапка раздела об OIDC в
  docs/research/pocketbase.md и две записи задач; формулировки прошли
  вычитку агентами doc-wording и task-wording
- архив openspec/changes/archive/ не тронут: слово, верное на день записи,
  остаётся свидетельством
2026-08-14 09:51:01 +03:00

2.2 KiB

🔬 Перечень форматов, которые конвейер принимает на самом деле

  • Тип: research
  • Категория: Очередь — Форматы: сначала замер того, что конвейер берёт на самом деле.
  • Зачем: Команда ffmpeg проверена на голосовых Telegram, а что она берёт помимо них, не мерил никто: перечень выведен из документации, а не из прогона.

Замер даёт перечень принимаемых форматов и разбирает расхождение ogg/vorbis против заявленного SpeechKit OGG_OPUS.

Вопрос

Какие форматы доходят до текста целиком, какие ломаются на конвертации, какие — на распознавании, и чем на самом деле кодирует конвертер: vorbis или opus.

Куда ляжет ответ

  • docs/research/audio-formats.md — таблица «формат на входе → исход», с командой замера и версией ffmpeg, на которой он сделан;
  • расхождение ogg/vorbis против OGG_OPUS: строка о том, устранено оно или проверено безвредно, и чем это подтверждено;
  • форматы, которые принять нельзя, — задачей об отказе на приёме, и она называет эту разведку.

Рамки

Замер идёт на своих файлах во временном каталоге и на подставном распознавателе internal/adapter/recognizer/memory.go; прогон на реальных ключах Yandex запрещён — там, где без настоящего SpeechKit не обойтись, ответ берётся из задачи speechkit-limits, а не оплачивается заново. Видеофайлы здесь только измеряются, приём их заводит video-audio-track-intake.