ИИ-агенты как основной инструмент разработки

Разработчик локального заметочника Nitinol рассказал, как полностью перестроил процесс создания продукта вокруг ИИ-агентов. Замысел был радикальным: код руками почти не писать, а только управлять процессом, оставив написание кода моделям. Начав в Cursor, он быстро упёрся в ограничения встроенного ассистента и перешёл на Claude Code, а вторую модель — Codex — привлёк как независимого ревьюера, который работает строго в режиме чтения и никогда не пишет код.

Что такое харнесс и зачем он нужен

Центральная идея статьи — «харнесс»: обвязка вокруг модели, набор правил, гейтов и скриптов, которые ведут задачу от постановки до коммита. У каждого класса задач — от простой опечатки до рискованных изменений, затрагивающих сеть, базу данных и секреты, — свой обязательный набор проверок.

  • Спека-контракт: задача не стартует без описания проблемы, сценария и критериев приёмки.
  • Ревью плана до написания кода: отдельная модель проверяет контракт, замечания разбираются до реализации.
  • Ревью диффа в чистом контексте: ревьюер не видит рассуждений автора, только сам дифф и требования.
  • Адъюдикация, тестовый гейт и сверка «квитанций» перед коммитом.

Почему спек-ориентированная разработка вместо TDD

Интересное наблюдение автора: с моделями классический TDD дал сбой — модель писала кривые тесты, а затем подгоняла под них реализацию, формально всё оставалось зелёным. Поэтому он перешёл на spec-driven development: источником истины становится спецификация, а не тест. Замечание к тексту спеки стоит копейки, тогда как то же замечание к готовому коду — переделка.

Экономика: подписки вместо команды

Самый спорный вывод статьи — оценка масштаба. По подсчётам автора, проект сопоставим с 4–8 человеко-годами работы; команда из четырёх человек потратила бы на него полтора-два года. У него же от первого коммита до рабочей версии прошло 56 дней: за это время накопилось почти 1400 коммитов и около 290 тысяч строк кода с тестами. Вся инфраструктура — подписки на Claude Max и ChatGPT Pro — обходится примерно в 500 долларов в месяц, что в разы дешевле зарплаты даже одного разработчика.

Главный вывод автора: харнесс не должен быть высечен в камне. Он растёт от измерений, а не от интуиции, и меняется вместе с моделями. А три правила, которые он советует забрать всем: ревьюеру давать чистый контекст, план проверять до кода и для рискованных изменений повторять отрицательный вердикт независимо.