Инженерия обвязки: среда для агентов
Участники выпуска
Сольный выпуск без приглашённых гостей.
Что обсудили голосом
В выпуске №35 Александр Поломодов разбирает статью Райана Лопополо «Harness engineering: leveraging Codex in an agent-first world». Команда OpenAI начинает с пустого репозитория и выбирает ограничение: весь код пишет Codex. Люди задают приоритеты, критерии приёмки и меняют среду, когда агент застревает. Это опыт внутреннего продукта, созданного с нуля; перенос на существующие системы требует отдельной проверки.
Узким местом становится внимание инженеров к изменениям. Отдельные рабочие деревья Git и экземпляры приложения, Chrome DevTools, логи, метрики и трассы позволяют агентам самостоятельно проверять результат. Знания из переписки и документов переезжают в репозиторий. AGENTS.md служит картой к архитектурным документам, планам и спецификациям, а линтеры объясняют нарушения и способ исправления.
Строгие границы и проверяемые инварианты оставляют свободу реализации внутри модулей. Агент может воспроизвести баг, записать поведение до и после исправления, открыть PR и пройти проверку с эскалацией человеку при необходимости решения. Минимум блокирующих проверок в описанном продукте связан с ценой ожидания и исправления; ведущий подчёркивает, что цена ошибки может требовать других правил. Фоновая очистка по общим принципам помогает бороться с накоплением неудачных паттернов.
Миллион строк, около 1500 PR и оценка десятикратного ускорения не заменяют измерение качества и стоимости. В статье нет контрольной группы, распределения времени людей, затрат на токены и долгосрочных результатов. Ведущий предлагает проверять один механизм на повторяющихся сбоях, сравнивать несколько прогонов с исходным вариантом и считать принятые задачи, время людей и агента. Эпилог посвящён Symphony: управление поднимается от отдельных сессий к задачам, а открытая черновая спецификация и реализация на Elixir позволяют изучить этот следующий шаг.