Итог в цифрах
Эквивалентная стоимость
Pay-per-token equivalent (эквивалент при оплате за токены). Фактическое списание по Codex subscription может отличаться.
Стоимость по моделям
gpt-5.6-solgpt-5.6-terra| Модель | Fresh input | Cached input | Output |
|---|---|---|---|
gpt-5.6-sol | $5,00 / 1M | $0,50 / 1M | $30,00 / 1M |
gpt-5.6-terra | $2,00 / 1M | $0,20 / 1M | $12,00 / 1M |
Цены взяты из локального analytics report (аналитического отчёта), собранного 8 августа 2026 года.
Календарное время
7 212 минут, или около 120 часов полного elapsed time (календарного времени).
Размер итогового diff
4 824 строки: +4 155 / −669. На одну итоговую строку пришлось около 68,4 тыс. raw tokens.
Куда ушли токены
Взаимоисключающая классификация по доминирующему действию model call (вызова модели).
Измеримый overhead
66,9 млн токенов, $37,39 и 563 вызова модели — измеримый non-development operational overhead (операционный расход вне анализа и правок).
make check feedback loop
57,2 млн токенов, или $32,58, — нижняя граница стоимости проверок. Верхняя граница вместе со всеми последующими правками — 104,5 млн, но она включает изменения по замечаниям пользователя.
Ограничение финальной проверки
Последний полный make check не стал полностью green (успешным) из-за двух зафиксированных несвязанных Integration errors: ModelPriceModel::getProvider и InvitationModel::getCount. Targeted checks, static analysis, unit tests и Source pipeline прошли; пользователь принял это состояние.
Расход по этапам
| Этап | Agent active | Human wait | Вызовы |
|---|---|---|---|
| Первичная разработка | 285,1 мин | 0 мин | 240 |
| Self-review и code review | 21,6 мин | 294,6 мин | 129 |
| Проверка PR и исправления | 411,1 мин | 6 133,4 мин | 2 234 |
| Cross-user E2E и финализация | 55,5 мин | 11,2 мин | 225 |
Где возник основной rework
CreateByUri и workflowОколо 69% всех токенов ушло на две группы проблем: границы API/domain relation и перепроектирование CreateByUri с Source workflow.
Что в итоге улучшилось
- Readiness (готовность) стала project-scoped (ограниченной проектом).
- Состояние подготовки перенесено в relation
Source ↔ Project. Document Listосвобождён от посторонней ответственности.- Уточнены transaction и event boundaries (границы транзакций и событий).
- Убраны необоснованные locks и прямые вызовы handler.
- Cross-user E2E покрывает общий Source для двух пользователей.
- Финальный Source pipeline: 17 tests, 235 assertions.
Главные изменения процесса
Зафиксировать ownership, API, transaction/event boundaries, global и project-scoped state.
Передавать commit range, conventions, invariants и нужные файлы вместо всей истории.
После первого системного замечания проверять весь diff на аналогичные нарушения.
Порядок: архитектура → реализация → targeted tests → self-review → independent review.
Вместо локальной четвёртой правки выполнить root-cause review и перепроектировать блок целиком.
Сохранить исходные ошибки и состояние Source pipeline, чтобы не расследовать чужой drift.
Прогноз экономии
Baseline (фактический результат): 330 млн токенов
Основной рычаг: ограничить повторную передачу контекста. 96,8% input составлял cached context, а не новый ввод. Dollar forecast (прогноз в долларах) предполагает неизменное соотношение моделей и типов токенов.
Методика и ограничения
- Данные рассчитаны по локальным Codex session logs основного агента и сабагентов.
- Погрешность этапов — около 5%; функциональной классификации model calls — 10–15%.
- Human wait включает сон, личные дела, чтение PR и анализ кода: разделить причины по журналам нельзя.
- 57,2 млн токенов tool feedback — нижняя граница: отдельные последующие исправления учитываются как development.
- Raw tokens не равны стоимости: cached input обычно дешевле non-cached input.