Отчёт о прогрессе · TechCon ML · 12.08.2026 — 08.09.2026 · эталонная разовая задача

Парсер справочников УПВС

Образцовая разовая задача: один день автоматизированной работы вместо недели ручного перепечатывания справочников отделом производства — и попутно найдены ошибки, которые были в самом исходном документе.

1
день на всю основную работу
от постановки задачи до готового результата
1 неделя
ручного труда сэкономлена
отделу производства не пришлось перепечатывать справочники вручную
191 / 516
страница / таблица
разобрано из исходного веб-справочника
26
проверок достоверности
все прошли
Что это

Разовый конвейер: рассеянный справочник → единый документ

Справочники УПВС (укрупнённые показатели восстановительной стоимости) существовали как разрозненный веб-ресурс — неудобно для регулярной работы отдела производства, который иначе перепечатывал бы нужные таблицы вручную. Задача решена за один день: весь справочник разобран и собран в два стандартных формата — редактируемый документ и таблицу, — с единым порядком разделов, общим для обоих файлов.

Один день автоматизированной работы заменил собой неделю ручного труда и дал готовый, сразу применимый результат.

Не только парсинг — ещё и проверка источника

Ошибки исходного документа найдены и не унаследованы

Конвейер не просто переносил текст — он сверял его. Часть расхождений и неточностей, которые существовали в самом исходном веб-справочнике, найдена в процессе разбора и не попала в итоговый документ: сотрудники, которые будут пользоваться результатом, защищены от недостатков первоисточника, а не унаследовали их вместе с текстом.

Дословный разбор с явным реестром правок

Текст переносится дословно из первоисточника; любое отклонение от дословного переноса — включая найденные ошибки самого источника — зафиксировано отдельной записью в явном реестре, а не потеряно молча.

Кворум двух независимых ИИ-агентов

Каждая правка, включая исправление найденной ошибки источника, проверяется двумя независимо работающими агентами — принимается только при согласии обоих.

Единый порядок документа для обоих форматов

Документ и таблица собраны по одному и тому же порядку разделов — читатель не теряется, переключаясь между форматами.

Технологичный пайплайн

Пять шагов от веб-справочника до готовых файлов

1

Забор исходника

Постраничная выгрузка веб-справочника, без пропусков

2

Дословный разбор

Текст переносится без вольного пересказа

3

Кворум двух агентов

Независимая проверка каждой правки

4

Поиск ошибок источника

Расхождения в самом справочнике выявлены и запротоколированы

5

Сборка DOCX + XLSX

Единый порядок разделов в обоих форматах

Экономика одного дня

Неделя ручного труда — за один день автоматизированной работы

80%
экономия времени
Вручную5 дней
Конвейер1 день
1 день вместо 5. Ручное перепечатывание справочников отделом производства заняло бы рабочую неделю — конвейер справился за один день.
304 КБ документ, 1.4 МБ таблица. Оба формата — с одинаковым порядком разделов и без вольного пересказа исходника.
5 из 7 кандидатов на включение одобрены по итогам отбора.
Ограничение: все 26 проверок достоверности прошли, но пока только в ручном прогоне — автоматический запуск этих проверок в CI ещё не подключён. Это отмечено как следующий шаг.
Куда движемся дальше

Закрытая задача — эталонный пример хорошо сделанной разовой работы

Работа завершена и подтверждена командой, ставившей задачу, как закрытая: результат разово собран, дальнейшего регулярного развития этого репозитория в текущих планах нет. Эту задачу стоит держать как пример того, как должна выглядеть хорошо сделанная разовая работа — с чёткой дисциплиной проверки и измеримым результатом, а не как черновик, который потом придётся переделывать.