Андрей Карпатый — один из основателей OpenAI, человек, который запустил автопилот Tesla и придумал термин vibe coding — дал интервью каналу Sequoia Capital. Называется оно «From Vibe Coding to Agentic Engineering». Я посмотрел его несколько раз, потому что там есть несколько мыслей, которые у меня не укладывались с первого прохода. Ниже — что говорит Карпатый, где я с ним согласен, где у меня другой угол и что из этого следует практически.
Материал выстроен как разговор со Стефани Жан из Sequoia. Карпатый говорит быстро, перескакивает между темами, и в расшифровке это немного теряется. Я постарался выловить главное и не приписать ему того, чего он не говорил.
О чём материал
Карпатый выделяет несколько ключевых тезисов — изложу их так, как они прозвучали в интервью.
Декабрь 2024-го стал переломным. По словам автора, именно тогда агентные инструменты перестали требовать постоянных правок. Модели начали выдавать большие куски кода, которые просто работали. Карпатый говорит, что перестал их исправлять — и обнаружил, что вайбкодит.
Есть три версии программного обеспечения. Software 1.0 — явный код. Software 2.0 — обученные нейросети. Software 3.0 — промпты: программирование через контекстное окно, где интерпретатором выступает LLM. Это не метафора, а смена парадигмы.
Автоматизируется то, что верифицируемо. Модели пикируют в способностях там, где результат можно проверить: код, математика. В остальных областях — неровно. Карпатый называет это «зазубренным интеллектом» и считает, что это не случайность, а следствие того, на каких задачах обучали модели через RL.
Vibe coding и agentic engineering — разные вещи. Первое поднимает уровень для всех. Второе сохраняет профессиональную планку при работе с агентами. Это инженерная дисциплина, а не просто «быстрое кодирование».
Понимание нельзя аутсорсить. Карпатый цитирует чужой твит: «Можно делегировать мышление, но не понимание». Он считает, что человек остаётся узким местом в цепочке именно там, где нужно понять, зачем и что строить.
Software 3.0: почему старые приложения становятся лишними
Карпатый рассказывает про собственный проект MenuGen — приложение, которое фотографирует меню ресторана и показывает картинки блюд. Он его построил: OCR, генератор изображений, деплой на Vercel. А потом увидел, что тот же результат достигается одним промптом к мультимодальной модели — без всякого приложения.
Его вывод: «MenuGen не должен существовать. Это работа в старой парадигме».
Мне эта история понравилась именно своей честностью. Карпатый не говорит «я построил крутую штуку». Он говорит «я построил лишнюю штуку и это важно понять». Это редкое качество — замечать, когда твоя работа стала артефактом прошлого.
Практический вывод здесь такой: прежде чем строить приложение, стоит спросить — а нет ли уже модели, которая делает это в один шаг? Не потому что строить плохо, а потому что иначе ты тратишь месяц на то, что решается промптом.
Карпатый также приводит пример с установкой OpenClaw: вместо сложного bash-скрипта — просто текст, который копируешь агенту. Агент сам разбирается с окружением. Это и есть Software 3.0 в действии: не «как написать скрипт установки», а «что скопировать агенту».
Vibe coding и agentic engineering — это не одно и то же
Карпатый чётко разводит эти два понятия, и я думаю, это одна из самых полезных вещей в интервью.
Vibe coding — это когда ты просишь модель, она делает, ты не особо проверяешь. Это поднимает уровень: теперь любой может собрать что-то работающее. Это хорошо.
Agentic engineering — другое. Это когда ты работаешь с агентами профессионально: сохраняешь качество, следишь за безопасностью, проектируешь архитектуру, остаёшься ответственным за результат. Карпатый говорит, что это инженерная дисциплина — со своими практиками, инструментами и уровнями мастерства.
Разрыв между «я попросил — оно сделало» и «я выстроил систему, которая делает правильно» — это и есть разрыв между vibe coding и agentic engineering.
Карпатый приводит пример из собственного MenuGen: агент попытался связать Stripe-аккаунт с Google-аккаунтом через email-адреса. Логика понятна, но она неправильная — у человека могут быть разные адреса в разных сервисах. Это именно та ошибка, которую нужно поймать до того, как она попала в продакшн. Агент не виноват — он делал что мог. Виноват тот, кто не проверил спецификацию.
Это не значит, что агентам нельзя доверять. Это значит, что доверие должно быть обоснованным и проверяемым.
Зазубренный интеллект: почему модель рефакторит 100 000 строк, но советует пешком идти на мойку
Карпатый рассказывает про феномен, который он называет jagged intelligence — зазубренный интеллект. Современные модели одновременно могут рефакторить огромную кодовую базу и при этом посоветовать пешком дойти до автомойки, которая в 50 метрах, потому что «близко». Это не баг, это структурное свойство.
Его объяснение: модели обучаются через RL с верификацией результата. Там, где результат легко проверить — в коде, математике, — модели получают чёткий сигнал и развиваются быстро. Там, где верификация размытая — в здравом смысле, пространственном мышлении, бытовых ситуациях, — сигнала почти нет, и модель остаётся слабой.
Дополнительный фактор: лаборатории сами решают, что добавить в обучающие данные. Карпатый упоминает, что шахматы резко улучшились между GPT-3.5 и GPT-4 не потому что модель стала умнее в целом, а потому что кто-то добавил много шахматных данных. Это значит, что мы немного заложники того, что лаборатории считают важным.
Практический вывод, который я делаю из этого: нельзя оценивать модель по одному тесту. Если она хорошо справляется с кодом — это не значит, что она хорошо справляется с чем угодно. Нужно знать, в каких «схемах» ты работаешь, и не удивляться, когда за пределами этих схем модель вдруг ведёт себя странно.
Что остаётся за человеком, когда агент делает всё остальное
Карпатый отвечает на этот вопрос конкретно: вкус, суждение, дизайн спецификации и понимание.
Агенты сейчас хорошо заполняют бланки. Плохо — проектируют бланки. Пример с email и Stripe показывает: агент не спросил «а что будет, если у пользователя разные адреса?» Он просто сделал то, что казалось логичным. Вопрос «а что вообще правильно?» остаётся за человеком.
Карпатый говорит, что он уже не помнит детали API — keep_dims или keepdim, axis или dim. Это теперь задача агента. Но он помнит, что за тензором стоит конкретное хранилище в памяти, и что view и copy — это разные вещи с разными последствиями. Это понимание, а не синтаксис. И это нельзя делегировать.
Мне кажется, это хорошая рамка для любой области. Детали синтаксиса, API, форматов — агент. Понимание того, зачем ты это делаешь и что должно получиться — человек. Пока так.
Карпатый цитирует твит, который его зацепил: «Можно аутсорсить мышление, но не понимание». Он возвращается к нему несколько раз в интервью. Я думаю, это честная формулировка текущего момента.
Моё мнение
Интервью мне понравилось именно тем, что Карпатый не строит из себя оракула. Он говорит «я не знаю» там, где не знает, и называет собственные проекты лишними, когда они таковыми оказались. Это редко.
С тезисом про Software 3.0 я согласен — и наблюдаю его в собственной работе. Когда я автоматизировал часть контент-процессов, самый большой сдвиг был именно в том, что перестал писать код и начал писать промпты. Это другое мышление, и оно требует привыкания.
С разграничением vibe coding и agentic engineering — тоже согласен, и считаю, что это важно проговорить. Многие люди думают, что если модель что-то сделала, то это сделано. Нет. Это сделан черновик. Дальше нужен человек, который понимает, правильно ли это.
Единственное, где у меня другой угол — это тезис про то, что «всё в итоге автоматизируется». Карпатый говорит это почти как само собой разумеющееся. Я не уверен. Не потому что считаю это невозможным, а потому что «верифицируемость» в гуманитарных областях — очень скользкое понятие. Что значит «правильно» написанный текст? Кто судья? Совет из LLM-судей, как он предлагает? Это интересная идея, но она заметает под ковёр вопрос о том, кто настраивает этих судей и по каким критериям.
В целом — это один из лучших публичных разговоров об агентных моделях AI, которые я видел. Карпатый говорит как практик, а не как евангелист. Это ценно.
Коротко
- Декабрь 2024-го — точка перелома: агентные инструменты начали работать без постоянных правок.
- Software 3.0 — это программирование промптами; некоторые приложения просто не должны существовать в новой парадигме.
- Vibe coding поднимает уровень для всех; agentic engineering сохраняет профессиональную планку — это разные вещи.
- Модели зазубрены: сильны там, где результат верифицируем, слабы там, где нет.
- Человек остаётся ответственным за понимание, вкус и спецификацию — агент заполняет детали, но не проектирует их.
Если тема агентной инженерии вам близка и хочется услышать её от первоисточника — интервью Карпатого в канале Sequoia Capital стоит посмотреть целиком. Там есть ещё несколько веток разговора, которые я здесь не разбирал: про образование, про то, как выглядит найм инженеров в новой реальности, и про то, каким может оказаться компьютер будущего, где нейросеть — хост-процесс, а CPU — сопроцессор.
Источник: Andrej Karpathy: From Vibe Coding to Agentic Engineering w/ Stephanie Zhan
