tasks: выкинуты задачи про сбор базы человеком
- закрыты few-shot на правках человека и eval-харнес с размеченным корпусом: направление — тюнинг автоматического распознавания без участия человека - цель распознавания переписана: точность видна по рабочему потоку, а не по фиксированному корпусу - поправлены ссылки на удалённые задачи в CLAUDE.md, review.md, research/README.md и в задаче про confidence-гейт
This commit is contained in:
@@ -14,8 +14,9 @@
|
||||
Наблюдения снимались вручную, по ходу разработки, на домашнем контуре: реальные
|
||||
сообщения торрент-бота в Telegram, реальные ответы qBittorrent WebUI API и
|
||||
LLM-эндпоинта на живых раздачах. Автоматического сбора и корпуса кейсов **нет** —
|
||||
это отдельная задача (eval-харнес распознавания), до неё числа здесь единичные
|
||||
и приведены как условия, а не как статистика.
|
||||
и не планируется: размеченный корпус решено не собирать
|
||||
(`../tasks/REJECTED.md`, 2026-08-06). Числа здесь единичные и приведены как
|
||||
условия, а не как статистика.
|
||||
|
||||
Зафиксированные образцы чужих форматов лежат прямо в тестах пакета-разборщика —
|
||||
там они заодно и проверяются; где именно и почему без каталога `testdata/`, см.
|
||||
|
||||
Reference in New Issue
Block a user