Вайб-кодинг и ИИ-агенты
Выпуск 2··21:07

Нейросети с нуля: как стать вайбкодером и почему не надо бояться терминала

Длинный выпуск для тех, кто ни разу не открывал чёрное окно с текстом и уверен, что это не для них Полная расшифровка выпуска — ru.arsentev.ai/podcast

СКОРОСТЬ

Расшифровка

Начну с различия, которое важнее всего остального, что я скажу дальше. Когда человек говорит «я пользуюсь нейросетью», почти всегда он имеет в виду чат. Ты открываешь окно, пишешь вопрос, получаешь текст. Текст бывает отличный. Но дальше с ним что-то должен делать ты сам. Скопировать, вставить, проверить, запустить, поправить, вернуться и переспросить. Нейросеть здесь — очень начитанный собеседник за стеклом. Он видит ровно то, что ты ему пересказал, и умеет только говорить.

Агент — это когда стекло убрали. Ему дали руки. Он открывает файлы, читает их сам, меняет их сам, запускает то, что получилось, смотрит на результат, видит ошибку, возвращается и правит. И приходит к тебе не с текстом, а с выполненной работой. Разница между этими двумя словами — вся разница вообще.

Бытовая аналогия. Чат — это консультант по телефону. Ты описываешь ему, что у тебя капает под раковиной, он говорит: скорее всего, гайка, подтяните ключом на двадцать два. Совет верный. Но лезть под раковину тебе. И если ты не знаешь, где ключ, и какая из трёх гаек та самая, такой совет ничего не даёт. Агент — это мастер, которого ты пустил в квартиру. Он сам залез, сам посмотрел, сам понял, что дело не в гайке, а в треснувшем шланге, сам заменил и сам открыл воду проверить, не капает ли. Ты в это время пил чай.

И вот тут возникает первое честное уточнение, которое я буду повторять весь выпуск. Мастера в квартиру ты пускаешь под свою ответственность. Он может починить не то. Он может починить правильно, но не то, что ты имел в виду. Поэтому вся работа с агентами — это не «я перестал работать», а «моя работа переехала». Об этом будет отдельный кусок, и он самый важный.

Что тебе нужно понять прямо сейчас: чат ты уже видел, а агента, скорее всего, нет. И когда люди говорят «я пробовал нейросети, ну так, ничего особенного», в девяноста девяти случаях из ста они пробовали чат. Это как судить об автомобиле, посидев в нём на парковке. Двигатель не заводили.

Слово «вайбкодинг», которое ты наверняка слышал, — про это же. Оно звучит несерьёзно, и меня оно поначалу раздражало. Но смысл там точный: ты описываешь, что должно получиться, человеческими словами, а превращение слов в работающую штуку берёт на себя машина. Ты задаёшь направление и оцениваешь результат. Ты не набираешь код руками. Строго говоря, ты вообще можешь не знать, как этот код выглядит.

Я сам пришёл сюда не из инженерии. У меня научная степень, и я всю жизнь занимался людьми, а не компиляторами. И это оказалось не помехой, а иногда даже преимуществом — потому что главный навык здесь не технический. Но до этого мы дойдём. Сначала — про чёрное окно.

Терминал. Чёрный прямоугольник, белые буквы, мигающая палочка. Ни одной кнопки. Ничего не подписано. Выглядит как что-то из фильма про хакеров или как экран, который появляется, когда компьютер уже сломался. Я прекрасно помню собственное ощущение: чувство, что я стою у чужой двери и не имею права её трогать.

Давай я сниму с этого мистику.

Терминал — это просто способ отдавать компьютеру команды словами вместо кликов. Всё. Когда ты двигаешь мышкой и нажимаешь на иконки, ты отдаёшь те же самые команды, просто через картинки. Картинки удобны человеку. Но у картинок есть предел: нажать можно только то, что кто-то заранее нарисовал. А словами можно сказать что угодно, в том числе то, чего никто не предусмотрел.

И вот главное, ради чего мы вообще здесь. Агенту нужны руки. Красивое окно с кнопками рук ему не даёт — там всё нарисовано под человеческий палец. А текстовая команда — даёт. Терминал для агента то же, что для тебя руль и педали: не украшение, а место, где ты реально управляешь. Поэтому вся серьёзная работа с агентами живёт именно там.

Почему он выглядит так убого? Потому что его никто не рисовал для тебя. Это служебный вход. Кухня ресторана: кафель, нержавейка, лампы дневного света, ничего для красоты. В зале — скатерти и свечи, а еда готовится тут. Интерфейс терминала не про эстетику, он про то, чтобы ничего не мешало между твоим намерением и машиной. Через неделю ты перестанешь замечать, что там чёрный фон.

Есть ещё одна причина, по которой это выглядит именно так, и она мне нравится. Текст — самый честный интерфейс из всех. В нём видно ровно то, что произошло: вот команда, вот ответ, вот ошибка целиком, без вежливого окошка «что-то пошло не так». Красивые программы прячут от тебя происходящее, чтобы не пугать. Терминал не прячет ничего. Первые дни это раздражает, а дальше начинаешь ценить: когда работаешь вместе с агентом, тебе нужно видеть, что он делает, а не догадываться.

Теперь конкретные страхи. Их три, и они у всех одинаковые.

Первый: «я нажму что-нибудь и удалю всё». Не удалишь. Чтобы снести систему, нужно осознанно набрать довольно специфическую команду и обычно ещё подтвердить её паролем. Случайно так не получается, как не получается случайно выехать на встречку, просто сев в машину. Плюс нормально настроенный агент устроен так, что перед необратимым действием он останавливается и спрашивает. Удалить, перезаписать, отправить наружу — на всё это он просит разрешения. Ты сидишь и говоришь «да» или «нет». Это, кстати, и есть твоя новая работа, но об этом позже.

Второй страх: «я не знаю команд». Тебе и не надо. В этом весь фокус нынешнего момента. Раньше терминал требовал, чтобы ты помнил десятки заклинаний с дефисами и буквами. Теперь ты пишешь в него обычными словами: посмотри, что в этой папке, и разложи файлы по датам. Команды набирает агент. Ты — тот, кто объясняет, чего хочешь. Я до сих пор помню наизусть команд пять, не больше, и это никак не мешает.

Третий: «нужно уметь программировать». Не нужно. Нужно уметь внятно объяснять и уметь смотреть на результат критически. Врач, юрист, бухгалтер, преподаватель, логист — все эти люди годами тренировали ровно то, что здесь требуется: точно описать задачу и проверить, сходится ли ответ. Программирование как ремесло набора символов — это то, что машина забирает первым.

И последнее про страх. Компьютер — не хрусталь. Худшее, что реально случается у новичка, — что-то перестало работать и надо вернуть как было. Есть простое правило, которое закрывает девяносто процентов паники: работай на копии. Сделал копию папки — и трогай что хочешь. Испортил — удалил копию, взял новую. Ребёнок, который лепит из пластилина, ничего не боится, потому что пластилин можно смять. Сделай себе пластилин.

Теперь про то, что происходит у меня каждый день, и почему я вообще решил про это говорить.

У меня в работе постоянно крутятся десятки агентов. Не как эксперимент, а как обычный производственный процесс: они делают то, что раньше делали живые люди по найму. И изменение, которое я увидел, — оно не про скорость. Скорость это следствие. Изменение — в том, какие роли вообще остались.

Раньше на любой продукт нужен был набор людей. Кто-то рисует интерфейс. Кто-то пишет код. Кто-то собирает цифры и делает отчёты. Кто-то пишет тексты. Кто-то проверяет, что всё вместе работает. И плюс человек, который держит в голове, зачем всё это и что мы вообще делаем.

Так вот, из этого списка живым остался последний. И ещё тот, кто принимает результат — часто это тот же самый человек.

Дизайн типовых вещей — экраны, карточки, формы, состояние загрузки, как выглядит ошибка — агенты делают сами и делают прилично. Не гениально. Прилично, ровно, быстро и без обид. Аналитика — то есть «принеси мне цифры и посчитай, что из этого следует» — уходит целиком: там ровно та работа, которую машина делает лучше человека, потому что не устаёт и не ленится. Разработка стандартных вещей — форма, вход, оплата, выгрузка — уходит. Всё, что уже кто-то делал тысячу раз, машина делает быстрее и аккуратнее среднего исполнителя.

Что не уходит. Не уходит вопрос «что мы вообще строим и для кого». Не уходит вкус — способность посмотреть на пять вариантов и сказать, почему третий живой, а остальные мёртвые. Не уходит ответственность за то, что мы выпустили наружу. И не уходит проверка, но про неё будет отдельно.

Я называю оставшуюся роль продукт-билдер. Человек, который формулирует задачу и принимает работу. Раньше это была одна из ролей в команде. Теперь это, по сути, единственная роль. Всё остальное — исполнение — делегируется.

И вот что мне долго не давало принять эту мысль. Кажется, что если убрать исполнителей, качество упадёт. На практике падает не качество, а разнообразие ошибок. Живой исполнитель может сделать блестяще, а может сделать плохо, потому что развёлся, потому что не понял, потому что стеснялся переспросить. Агент делает ровно. Всегда одинаково ровно. Его потолок ниже, чем у выдающегося специалиста, но его пол гораздо выше, чем у среднего. А в большинстве компаний работа делается не выдающимися. Она делается средними, уставшими и отвлечёнными.

Ещё одна вещь, которую надо проговорить честно. У меня основная часть обращений к модели — это не мои личные вопросы, а подзадачи, которые агенты раздают друг другу. То есть основная часть работы происходит вообще без моего участия в моменте. Я формулирую в начале и принимаю в конце. Середина идёт сама. Это очень непривычное ощущение — оно похоже на то, как руководитель отдела впервые понимает, что отдел работает, пока он спит.

И ещё одно наблюдение, которое меня удивило больше всего. Изменился не объём работы, а её ритм. Раньше между «придумал» и «увидел» проходили недели: поставить задачу, дождаться очереди, получить, обсудить, переделать. Сейчас между «придумал» и «смотрю на живое» проходит вечер. И это меняет мышление сильнее, чем любая экономия. Когда проверка идеи обходится дёшево, ты перестаёшь спорить и начинаешь пробовать. Половина совещаний в мире существует только потому, что попробовать было дорого.

Теперь самая неудобная часть выпуска. Я скажу её прямо и постараюсь без злорадства, потому что злорадствовать тут нечему.

Современные модели уже сейчас делают типовую работу быстрее и качественнее среднего исполнителя. Не будущим летом. Сейчас. Написать типовой текст, собрать типовой отчёт, сверстать типовой экран, разобрать таблицу, сделать стандартную функцию — всё это уже делается лучше, чем это делает средний человек на средней зарплате в средней компании.

И при этом почти нигде ничего не поменялось. Люди сидят на тех же местах, планёрки те же, сроки те же.

Разрыв не в технологии. Технология уже приехала. Разрыв в том, что руководители пока этого не поняли. И это не потому, что они глупые. Причины очень человеческие. Во-первых, чтобы увидеть разницу, надо самому попробовать — не в чате, а по-настоящему, с руками, — а у руководителя на это нет времени, у него совещания. Во-вторых, ему докладывают те самые люди, чья работа под вопросом, и докладывают ровно то, что им выгодно: «мы посмотрели, для серьёзных задач оно не годится». В-третьих, менять устройство отдела больно и страшно, а не менять — комфортно, потому что квартальные цифры пока сходятся.

Так и получается тишина. Все ходят на работу, всё как обычно, а под полом уже другая экономика.

Что происходит, когда до руководителей доходит? Не постепенно. Это как с любым отложенным решением: пока никто не двигается, не двигается никто; а когда двинулся первый заметный игрок в отрасли и показал, что можно делать то же самое втрое меньшим составом, остальные обязаны повторить, иначе их съедят по цене. Дальше решения принимаются не за годы, а за кварталы. Резко, некрасиво, с большим количеством личной боли.

Я говорю это не для того, чтобы напугать. Я говорю это, потому что тишина сейчас — это подарок, и им можно воспользоваться. У тебя есть окно времени, которого не будет через два года. Прямо сейчас человек, который умеет ставить задачу агентам и принимать результат, — редкость. Он выглядит как волшебник. Через какое-то время это будет базовым требованием в вакансии, как когда-то умение пользоваться почтой.

Поэтому мой совет очень скучный. Не жди, пока твоя компания примет решение. Не жди курсов от отдела обучения. Начни сам, на своей собственной задаче, вечером, из интереса. Тот, кто попробовал раньше, в момент перелома окажется не тем, кого сокращают, а тем, кому приносят новый отдел. Это не гарантия, гарантий я не даю. Но разница в позиции — огромная.

И отдельно, для тех, кто руководит. Проверь сам. Не спрашивай подчинённых, годится ли новое. Возьми реальную задачу своего отдела, самую типовую, и попробуй сделать её агентом за один вечер лично. Ты либо успокоишься, либо узнаешь то, что тебе не расскажут на планёрке. Оба исхода полезны.

Небольшой кусок, чтобы у тебя сложилась картинка целиком. Ты наверняка слышал новости: все скупают вычислительные мощности, строят огромные центры обработки данных, электричества не хватает, очередь за чипами расписана на годы вперёд. Звучит как какая-то отдельная непонятная история про большие деньги. На самом деле это прямое следствие того, о чём мы говорим.

Смотри. Раньше работа делалась головами. Голова потребляет бутерброд и кофе, сидит в офисе, и никакой отдельной инфраструктуры под неё строить не надо — офисы уже есть. Теперь ровно та же работа делается машинами. А машине, чтобы думать, нужно электричество и железо, и очень много.

То есть произошёл переезд. Работа физически переехала с людей на процессоры. И спрос, который раньше выражался в вакансиях и зарплатах, теперь выражается в киловаттах и стойках с оборудованием.

Аналогия простая. Представь городок, где всё возили лошадьми. Появляются грузовики. И вдруг ты видишь странное: все вокруг строят заправки, тянут трубы, спорят из-за бензина. Человек со стороны скажет: какая-то нефтяная лихорадка, пузырь. Но это не про бензин. Это про то, что перевозки перешли на другой источник силы, и теперь нужна инфраструктура под этот источник. Овёс больше не нужен в прежних объёмах, нужен бензин.

Сейчас происходит ровно это, только вместо бензина — вычисления. Отсюда очередь за железом, отсюда разговоры про электростанции рядом с дата-центрами. Никакой мистики: работа стала считаться, а считать надо где-то.

Практический вывод для тебя один, и он не про инвестиции — про инвестиции я ничего советовать не буду и не имею права. Вывод такой: раз под это строят заводы и электростанции, значит, это надолго. Люди не тянут высоковольтные линии под моду на один сезон. Если ты ещё колеблешься, тратить ли вечер на разбирательство с агентами, — вот тебе аргумент. Инфраструктура голосует деньгами, и голосует она за то, что работа будет делаться так.

Теперь то, чего почти не говорят, потому что это портит красивую историю. Но без этого куска весь выпуск был бы враньём.

По моей оценке, примерно каждая пятая задача, которую я отдаю агенту, возвращается неверной или недоделанной. Одна из пяти. Это много.

И вот главное: по виду результата этого не понять. Работа выглядит завершённой. Отчёт бодрый, всё аккуратно, «готово, проверил, работает». Модель одинаково уверена, когда права и когда ошибается. У человека есть сигналы сомнения — он мнётся, оговаривается, отводит взгляд, пишет «вроде бы». У машины этих сигналов нет вообще. Уверенный тон — не признак правоты, это просто стиль речи.

Отсюда следует вещь, которую надо принять сразу: работа не исчезает. Она переезжает. С «делать» на «проверять». Раньше ты тратил восемь часов на то, чтобы сделать. Теперь ты тратишь час на то, чтобы объяснить, и полтора на то, чтобы проверить. Это огромный выигрыш — но это не ноль, и это другой тип усталости. Проверять чужую работу целый день выматывает иначе, чем делать свою.

Второе ограничение. Есть задачи, где объяснить дольше, чем сделать. Если тебе надо переименовать три файла — переименуй три файла. Пока ты формулируешь, что именно и по какому правилу, ты бы уже закончил. Это как просить кого-то передать тебе кружку, стоящую в тридцати сантиметрах: объяснение длиннее действия. Порог примерно такой: если ты делаешь это руками дольше пятнадцати минут или делаешь регулярно — делегируй. Если это разовое движение на две минуты — сделай сам и не выпендривайся.

Третье, самое важное. Есть задачи, где девяносто процентов правильности бесполезны. Возьми медицину: дозировка, посчитанная правильно в девяти случаях из десяти, — это не «неплохо», это опасно. То же самое с деньгами, с юридическими сроками, с чем угодно, где одна ошибка не усредняется, а взрывается. В таких местах агент может быть черновиком и помощником, но не последней инстанцией. Последняя инстанция — человек, который несёт ответственность.

И четвёртое. Я не собираюсь тебе обещать, что ты станешь программистом за неделю. Не станешь. Ты за неделю станешь человеком, который может сам собрать себе небольшой рабочий инструмент вместо того, чтобы ждать три месяца, пока это кто-то сделает. Это гораздо скромнее звучит и гораздо больше меняет жизнь.

Кстати, про одну из пяти. Это не приговор технологии, это просто параметр процесса. На любом производстве есть процент брака, и производство от этого не останавливается — оно ставит контроль качества. Разница только в том, что здесь контролёр это ты, и учиться этому надо отдельно.

Практика. Если ты дослушал до этого места, у тебя должно остаться понимание, что делать конкретно, а не «как интересно».

Первое. Поставь себе агента, который работает в терминале. Не чат в браузере — именно агента с руками. Заведи для него отдельную пустую папку. Пустая папка — это твоя песочница: там нечего сломать, потому что там ничего нет. Одно это снимает половину страха.

Второе. Первая задача. Не бери свою главную боль. Возьми что-нибудь маленькое, полезное и своё. Например: у тебя в папке загрузок четыреста файлов — попроси разложить их по годам и типам. Или: возьми таблицу и попроси сделать по ней одностраничный отчёт с графиком. Или: попроси написать простой калькулятор для того, что ты сам считаешь регулярно — смету, дозировку, стоимость доставки. Критерий хорошей первой задачи такой: ты точно знаешь, как выглядит правильный ответ, и можешь проверить за минуту. Ты учишься не решать сложное — ты учишься замечать, когда тебе врут.

Третье. Смотри, что он делает. Не отворачивайся. Он будет писать, что собирается сделать, и спрашивать разрешения. Читай эти вопросы, даже если не понимаешь половину слов. Через три дня начнёшь понимать. Это как первые дни в чужой стране: сначала шум, дальше отдельные слова, дальше смысл.

Чего не делать. Не пускай его на важные файлы, пока не почувствовал, как он себя ведёт. Не отдавай задачу, которую сам не понимаешь, — тогда ты не сможешь проверить результат, и это самая частая яма. Не соглашайся на «готово» без проверки — открой, запусти, посмотри своими глазами. И не начинай с большой мечты вроде «сделай мне приложение как у больших» — ты не сможешь принять эту работу и утонешь.

И отдельно про темп. Не устраивай марафон на выходные — от него остаётся только усталость и ощущение, что не получилось. Лучше по часу вечером, но каждый день. Это навык, а навыки набираются повторениями, а не подвигами. Через две недели такого режима ты обнаружишь, что уже не думаешь «а можно ли это вообще сделать» — ты думаешь «как это сформулировать». Вот этот переключатель в голове и есть весь результат обучения. Всё остальное — детали инструмента, они поменяются, и не раз.

И теперь главный навык, ради которого стоило всё это слушать. Умение описать, что значит «готово».

Это звучит банально, пока не попробуешь. Скажи агенту «сделай красиво» — получишь непонятно что, и это будет твоя вина, а не его. Скажи «сделай страницу, на которой сверху имя, ниже список из трёх пунктов, кнопка внизу, на телефоне ничего не съезжает, и когда список пустой — написано, что пусто» — получишь то, что просил.

Проверь себя простым упражнением, оно даже без компьютера работает. Возьми задачу и опиши её так, чтобы её мог выполнить человек, который не читает твои мысли и не знает контекста. Что на входе. Что должно получиться на выходе. Как мы поймём, что получилось. Что делать, если данные кривые. Если ты можешь так — ты уже вайбкодер, вопрос только в инструменте.

И знаешь, что забавно? Это ровно тот же навык, который делает хорошим руководителем, хорошим врачом на приёме и хорошим родителем. Умение сказать точно, что ты имеешь в виду, и договориться, как мы поймём, что дело сделано. Никакая машина этого за тебя не сделает, потому что это не про машину.

Итог простой. Чат отвечает, агент делает. Терминал — не испытание для избранных, а служебная дверь, через которую агент получает руки; выглядит он неприветливо просто потому, что его никто не рисовал для красоты. Типовую работу машины уже делают лучше среднего исполнителя, и единственная причина, почему всё вокруг выглядит по-прежнему, — что решение об этом ещё не принято людьми, которые его принимают. Одна задача из пяти вернётся неправильной, и понять это можно будет только проверив. Значит, работа не исчезла, она стала другой: меньше делать, больше формулировать и принимать.

Я пришёл сюда не из инженерии, я учился этому с нуля и до сих пор учусь. И единственное, о чём я жалею, — что потратил несколько месяцев на страх перед чёрным окном, вместо того чтобы открыть его и попробовать.

Открой пустую папку и дай агенту первую маленькую задачу. На это уйдёт вечер. Дальше будет понятно.