Замер 28 июля 2026, 23:0x · хаб A-2022BAYAREA · считано скриптами, не на глаз ·
источники: обход файловой системы + разбор 5 981 журнала сессий + Coverage-Map.md + Regression-Status.md
consensus_s10_staged.py — 1 823 строки| Язык | Файлов | Строк | Код | Комментарии | Доля кодовой базы |
|---|---|---|---|---|---|
| Python | 2 592 | 380 299 | 320 059 | 20 345 | 96,7% |
| JavaScript | 32 | 7 203 | 5 955 | 248 | 1,8% |
| PowerShell | 97 | 5 531 | 3 913 | 1 229 | 1,4% |
| Shell | 6 | 218 | 148 | 57 | 0,1% |
| Рядом, но вне «чистого кода»: Batch 4 386 строк (295 файлов) · HTML-дашборды 3 103 (17) · YAML 615 (15) | |||||
| Тест | Симптом | Что это значит |
|---|---|---|
_shared\_test_consensus.py | FileNotFoundError | старая копия теста в _shared; рабочий тест зелёный 48/48 → снести копию |
cc-review\_test_verdict_parse.py | AttributeError: нет parse_verdict | парсер вердиктов внешних ревьюеров СЕЙЧАС не покрыт |
_test_dr_gate.py | пустая заметка insight-DR26-07-03-11 | тот самый харнес-DR Кирилла оказался пустым |
_test_funnel_writeback.py | нет registry\limits.json | пропал конфиг лимитов воронки контента |
regress_run.py и coverage_map.py живут ТОЛЬКО на ноуте HP17-ZBook.
На хабе (эта машина, мастер всего) их НЕТ — доехали только их отчёты через волт. То есть главная машина не может пересчитать собственное покрытие.
Это ровно тот P0 из реестра: «у пиров нет автоканала доставки ~/.claude/scripts».
5 879 живых сессий, 1 838 часов. Классификация не по первой фразе, а по тому, что руки реально делали внутри сессии (правки кода / правки волта / отправки наружу) и сколько это шло по часам.
| Куда | Сессий | Часов | Доля времени |
|---|---|---|---|
| 🔧 Стройка инфраструктуры | 1 580 | 1 073 | 58,4% |
| 🩹 Починка | 76 | 274 | 14,9% |
| 📚 Волт и знания | 103 | 252 | 13,7% |
| 🚀 Аутрич наружу | 388 | 161 | 8,8% |
| 💬 Разговор без действий | 3 722 | 55 | 3,0% |
| 🔬 Ресёрч | 10 | 23 | 1,2% |
| Месяц | Починка | Стройка инфры | Аутрич | Волт | Ресёрч |
|---|---|---|---|---|---|
| 2026-05 | 8 | 40 | 0 | 0 | 0 |
| 2026-06 | 156 | 471 | 71 | 121 | 23 |
| 2026-07 | 110 | 562 | 90 | 130 | 0 |
| Метрика | Индустриальная норма | У нас | Вердикт |
|---|---|---|---|
| Покрытие тестами | 60% приемлемо · 75% хорошо · 90% образцово (шкала Google) | 2,5% деталей | сильно ниже |
| Объём тестового кода | примерно 1:1 к продакшн-коду | ~1:100 | сильно ниже |
| Документация на модуль | обычно 30–60% модулей | 98,6% | выше нормы |
| Комментарии в коде | 10–20% строк | 5,4% (Python) | ниже, но док-паспорта компенсируют |
| Длина файла | < 400–500 строк | 74 файла нарушают | локально |
| Change failure rate (DORA) | элита < 5% · слабые 40–60% | не измеряем | нет метрики |
| MTTR — время до восстановления (DORA) | элита < 1 часа | не измеряем · 4 теста лежали красными «молча» | нет метрики |
| Доля времени на незапланированную работу | 20–40% норма · >50% кризис | 15% чистая починка | в норме |
| Доля времени на инструменты vs продукт | здоровая команда 10–20% на тулинг | 73% | главная аномалия |
| Микросервисы | метрика архитектуры, не качества | монолит из ~700 скриптов + SQLite | для соло-оператора верно |
| Кто | Что предлагал | Когда | Статус |
|---|---|---|---|
| Кирилл Симаков Monosnap 2.5M MAU |
20 оптимизаций харнеса с A/B; «Agent Learning Infrastructure» — апгрейд чужих харнесов через A2A; прямое предложение: «will help you to evolve/upgrade your agents / harness or create a custom one»; фрактальный рой агентов (−десятки % токенов и скорости); zero-trust на апдейты харнеса через смарт-контракты | 03.07 коммент · 10.07 зум · 21.07 TG-группа | разобрано в Decision Memo 04.07, часть отложена |
| Денис Смирнов | AgentPlane.org — платформа-харнес/оркестрация агентов с облачным слоем | 2026 | не разбирали |
| Grok Heavy (DR 28.07) | DeepEval (pytest-native), mutation-тестирование mutmut против ложного зелёного, Keep Rate по git как метрика | 28.07 | ждёт решения |
| ChatGPT Pro DR | Promptfoo или DeepEval; heartbeat-паттерн; предупреждение: Ragas теряет поддержку, Promptfoo куплен OpenAI но MIT сохранён | 28.07 | ждёт решения |
| Gemini Pro DR | Promptfoo (DeepEval отклонить — UI завязан на SaaS), Inspect AI отклонить; ⚠️ Syncthing нельзя пускать на живые .git и SQLite-WAL | 28.07 | ждёт решения |
E:\Obsidian\Anton-Knowledge\02-Decisions\decision-2026-07-28-qa-process-and-test-harness.md —
синтез 10 отчётов от 3 вендоров, статус «предложено». Там четыре вопроса ждут твоего «+»:
(1) стартуем ли Неделю 1 · (2) Promptfoo или DeepEval · (3) порог «выношу в отдельную сессию» 3 / 5 / 10 файлов · (4) проверяем ли гипотезу Syncthing × .git прямо сейчас.
Мы написали очень много: почти 400 тысяч строчек, это как 8 толстых книг. Почти всё на одном языке — Python. Язык выбран правильно, тут менять нечего.
У каждой детали есть инструкция «как чинить» — таких почти у всех, 98 из 100. А вот проверялки, которая сама дёргает деталь и говорит «сломалось», почти нет: только у 18 деталей из 708. Сегодня мы первый раз дёрнули все проверялки разом — и четыре оказались красными, они лежали сломанные молча.
И главное. Ты чувствовал, что чинишь больше, чем идёшь вперёд. Посчитали: чинишь 274 часа, а вот строишь инструменты 1073 часа. Наружу к людям ушло всего 161 час. Получается, мы всё время строим станок, а деталей на нём делаем мало. Это не поломка — это перекос.
loc_census.py и session_census2.py (обход ФС + разбор 5 981 журнала сессий) ·
данные покрытия из 00-System\Coverage-Map.md (ноут, 28.07 22:45) ·
красные тесты из 00-System\Regression-Status.md (ноут, 28.07 08:48) ·
время сессии капнуто 4 часами, чтобы брошенные окна не завышали ·
классификация сессии = по действиям внутри неё, а не по первой фразе.