К основному содержимому
Логотип Research Insights Made Simple
Research Insights Made Simple #19 · 14 июля 2026Подкаст · с Максимом Смирновым

Loop Engineering

Как проектировать системы, которые сами запускают coding agents — и остаются управляемыми

/ Research Insights Made Simple #19 · Loop Engineering

Содержание слайдов

  1. 1. Loop Engineering

    Как проектировать системы, которые сами запускают coding agents — и остаются управляемыми

  2. 2. IEEE-верстка не делает текст IEEE-публикацией

    Что это

    Working note 2026

    Переформатированный Orange Book

    Практический playbook

    Чем это не является

    Не IEEE publication

    Не Anthropic paper

    Не benchmark study

  3. 3. Инженер выходит из исполнения — в дизайн цикла

    Внутри loop

    Давать следующий prompt

    Следить за каждым turn

    Вручную запускать работу

    Снаружи loop

    Определять discovery

    Проектировать evaluator

    Оставлять stop points

  4. 4. За одну неделю практика получила имя

  5. 5. Цикл надстраивается над средой запуска (harness)

    Перерисовано по HuaShu, Fig. 1 и Table I · PDF с. 2

  6. 6. Чем выше слой, тем дольше живёт ошибка

  7. 7. Каждый проход цикла включает пять обязательных шагов

    Перерисовано по HuaShu, Fig. 2 и Table II · PDF с. 3

  8. 8. Утренний разбор превращает сигналы в проверяемый PR

    Перерисовано по HuaShu, Table II · PDF с. 3

  9. 9. Шесть компонентов реализуют пять шагов цикла

    Перерисовано по HuaShu, Table III · PDF с. 4

  10. 10. Повторный запуск — ещё не loop

  11. 11. Самая сложная часть должна уметь сказать «нет»

    Проверять result, а не уверенный self-report

    Считать reject нормальным исходом

    Возвращать причины в следующий turn

    Не путать green tests с «правильно»

  12. 12. Автор решения и проверяющий должны работать независимо

    Перерисовано по HuaShu, Fig. 3 · PDF с. 4

  13. 13. Проверяющий должен действовать как пользователь

  14. 14. Полный harness резко увеличивает цену прогона

    Retro game · Opus 4.5

    Solo · 20 min · $9

    Full harness · 6 h · $200

    Один prompt, разный output

    DAW · V2 harness

    3 h 50 min

    $124.70

    Opus 4.6 · другой prompt

  15. 15. Evaluator оправдан за границей надёжного solo

  16. 16. Каждый пропущенный шаг ведёт к своему антипаттерну

    Перерисовано по HuaShu, Fig. 4 · PDF с. 5

  17. 17. Детерминированные проверки ограничивают работу LLM

    Перерисовано по HuaShu, Fig. 5 · PDF с. 6

  18. 18. Масштаб подтверждён, точная цифра зависит от источника

    HuaShu · podcast retelling

    1 300 PRs / week

    Формулировка: merged

    Machine-written

    Stripe Sessions · official

    Over 1 000 / week

    Shipped to production

    Human review + approval

  19. 19. Три режима запуска требуют разного уровня доверия

    Перерисовано по HuaShu, Table IV · PDF с. 6 · product snapshot июня 2026

  20. 20. Четыре долга усиливают друг друга

    Перерисовано по HuaShu, Fig. 6 · PDF с. 7

  21. 21. Успешные PR могут скрывать провал контроля

  22. 22. Discovery превращает внешний текст во вход управления

  23. 23. Автономность требует обратимых и ограниченных действий

  24. 24. Когда генерация дешевеет, оценка становится узким местом

  25. 25. Три дисциплины сохраняют право сказать «нет»

  26. 26. Первый loop должен быть маленьким, но полным

    Перерисовано по HuaShu, Table VI · PDF с. 9

  27. 27. Playbook даёт гипотезы; наш eval — доказательства

  28. 28. Loop должен работать сам — и оставаться останавливаемым

    Книжный куб

    Ссылки на working note, первичные источники и новые инженерные разборы — в канале

    Александр Поломодов, Technical Director & Fellow, Т-Технологии

    @Book_Cube