Исследования
Новый дебат Codex Agentic-Work показывает, что программная инженерия становится управляемой системой
Исследования агентного кодирования продвигают разговор за пределы автозаполнения. Сложная проблема теперь заключается в оркестровке: как агенты планируют, изменяют, тестируют, объясняют и безопасно передают работу обратно людям.
Автор: Лео В ·

Последняя волна агентного software-engineering исследование движется ИИ программирование дебаты за пределами автозаполнения. Вопрос уже не в том, могут ли модели писать полезные фрагменты кода. Вопрос в том, могут ли агенты планировать изменения, ориентироваться в больших кодовых базах, запускать тесты, объяснять компромиссы и возвращать работу людям, не делая систему более хрупкой.
Это другая категория продукта. Автозаполнение помогает разработчику набирать текст. Агентский рабочий процесс пытается взять на себя границы задачи. Он может просматривать файлы, изменять код, выполнять команды, интерпретировать ошибки и повторять действия. Потенциал увеличения производительности выше, но также выше и зона поражения.
Настоящая проблема — это оркестровка
Работа с корпоративным программным обеспечением полна скрытых ограничений: наследуемые API, недокументированное поведение, хрупкие тесты, ритуалы развертывания, проверки на соответствие, и командные соглашения. Полезный агент по кодированию должен достаточно хорошо понимать эту среду, чтобы избегать элегантных, но опасных изменений.

Проверка является центром проблемы. Если агент изменяет код, но не может доказать, что именно он изменил, почему он это сделал и как тестировал результат, человек-ревьюер все равно несет риск. Лучшие системы будут облегчать проверку, а не просто генерировать больше кода для инспекции.
Менеджерам понадобятся новые показатели
Инструменты для программирования с ИИ будут оцениваться по пропускной способности, уровни дефектов, бремя обзора, уровень безопасности, и уверенность разработчиков. Количество сгенерированных строк кода — неправильная метрика. Более правильный вопрос заключается в том, поставляет ли команда более безопасные изменения с меньшими потерями на координацию.

Темы: Codex, программирование ИИ, разработка программного обеспечения, агенты