☕️ От вайбкодинга к agentic engineering
А вот и подтверждение к мыслям из предыдущего поста. Google опубликовали интересный whitepaper — «The New SDLC With Vibe Coding» про то, как меняется разработка, когда код пишет агент, а не человек.
В доке ребята обсуждают вайбкодинг и agentic engineering — говорят, что это не две альтернативы, а два конца одного спектра. Разница между ними в том, насколько строго вы проверяете и контролируете то, что он выдаёт — сколько вокруг его работы структуры, тестов и вашего собственного мыслетоплива.
Главный различитель — как проверяется результат. В вайбкодинге проверка опциональна: запустил, вроде работает, поехали. В agentic engineering работают две проверки разом. Тесты — это про всё детерминированное: то что легко проверить кодом — чтобы одинаковый вход всегда давал одинаковый выход. Evals — проверяют то, что заранее не предскажешь: правильным ли путём агент шёл, те ли инструменты выбрал, и достаточно ли качественный получился ответ. Нет обоих — это всё ещё вайбкодинг, какими бы умными ни были промпты.
Что зацепило больше всего и что натолкнуло на мысль "вот оно подтверждение тезисов поста":
— Context engineering, а не prompt engineering. Качество кода зависит не от хитрости промпта, а от качества контекста. Модели не нужны хитрые формулировки — им нужен тот же контекст, что и новому коллеге в команде.
— Agent = Model + Harness. Около 90% поведения агента определяет не модель, а «обвязка» (тот самый harness) вокруг неё: инструкции, тулзы, песочницы, guardrails. Когда агент косячит, первый инстинкт — винить модель. Чаще это отсутствующая тула, размытое правило или контекст, забитый шумом. Большинство провалов агентов — это провалы конфигурации.
— Экономика. Вайбкодинг = низкий CapEx, высокий OpEx: жжёшь токены в бесконечных циклах «почини свою же ошибку», плюс потом налог на поддержку спагетти-кода. Agentic engineering — наоборот: вложился в систему один раз, дальше дёшево масштабируешь.
Ну и дальше ребята пишут о том, о чем мы уже говорили:
— заведите AGENTS.md для проекта: стек, конвенции, жёсткие правила. Добавляйте новое правило каждый раз, когда агент делает то, что не должен
— пишите тесты и evals до генерации кода — это и есть контракт с AI
— ревьюйте каждую строку, которая идёт в прод. Особенно ту, что выглядит «умно»
Главная мысль: генерировать агенты научились. Новое ремесло — это верификация, валидация и направление агента в нужное русло.
#ai #agents #vibecoding #thoughts
А вот и подтверждение к мыслям из предыдущего поста. Google опубликовали интересный whitepaper — «The New SDLC With Vibe Coding» про то, как меняется разработка, когда код пишет агент, а не человек.
В доке ребята обсуждают вайбкодинг и agentic engineering — говорят, что это не две альтернативы, а два конца одного спектра. Разница между ними в том, насколько строго вы проверяете и контролируете то, что он выдаёт — сколько вокруг его работы структуры, тестов и вашего собственного мыслетоплива.
Главный различитель — как проверяется результат. В вайбкодинге проверка опциональна: запустил, вроде работает, поехали. В agentic engineering работают две проверки разом. Тесты — это про всё детерминированное: то что легко проверить кодом — чтобы одинаковый вход всегда давал одинаковый выход. Evals — проверяют то, что заранее не предскажешь: правильным ли путём агент шёл, те ли инструменты выбрал, и достаточно ли качественный получился ответ. Нет обоих — это всё ещё вайбкодинг, какими бы умными ни были промпты.
Что зацепило больше всего и что натолкнуло на мысль "вот оно подтверждение тезисов поста":
— Context engineering, а не prompt engineering. Качество кода зависит не от хитрости промпта, а от качества контекста. Модели не нужны хитрые формулировки — им нужен тот же контекст, что и новому коллеге в команде.
— Agent = Model + Harness. Около 90% поведения агента определяет не модель, а «обвязка» (тот самый harness) вокруг неё: инструкции, тулзы, песочницы, guardrails. Когда агент косячит, первый инстинкт — винить модель. Чаще это отсутствующая тула, размытое правило или контекст, забитый шумом. Большинство провалов агентов — это провалы конфигурации.
— Экономика. Вайбкодинг = низкий CapEx, высокий OpEx: жжёшь токены в бесконечных циклах «почини свою же ошибку», плюс потом налог на поддержку спагетти-кода. Agentic engineering — наоборот: вложился в систему один раз, дальше дёшево масштабируешь.
Ну и дальше ребята пишут о том, о чем мы уже говорили:
— заведите AGENTS.md для проекта: стек, конвенции, жёсткие правила. Добавляйте новое правило каждый раз, когда агент делает то, что не должен
— пишите тесты и evals до генерации кода — это и есть контракт с AI
— ревьюйте каждую строку, которая идёт в прод. Особенно ту, что выглядит «умно»
Главная мысль: генерировать агенты научились. Новое ремесло — это верификация, валидация и направление агента в нужное русло.
#ai #agents #vibecoding #thoughts