Программирование через агентов: от микроменеджмента к роли техлида.
Многие верят в «вайб-кодинг» — возможность создать приложение, просто описывая желания. Но реальный опыт автора статьи на Хабре показывает: на проектах сложнее 500 строк это превращается в управление «бандой реактивных, но безынициативных стажеров».
Главный инсайт: ИИ генерирует техдолг со сверхзвуковой скоростью. Если не контролировать архитектуру, проект сложится как карточный домик.
Прогресс подхода автора прошел через 4 стадии рефакторинга:
- Микроменеджмент: ИИ создает имитацию структуры (папки есть, а внутри — монолит). Приходится ревьюить каждую строку и вручную чинить «галлюцинации».
- Изоляция компонентов: Автор научился предсказывать, где ИИ схалтурит. На этом этапе компоненты (UI, логика) начинают реально разделяться.
- Роль Архитектора: База кода становится чище. Команды становятся высокоуровневыми: «Вынеси парсинг в отдельный слой, сделай UI тупым».
- Автономия: Финал пути. ИИ начинает сам находить неочевидные баги (гонки данных, дыры в инкапсуляции) и предлагать решения.
Горький опыт: Ошибка в выборе инструмента (Matplotlib вместо нативного QGraphicsScene) стоила 40 часов борьбы с тормозами. ИИ не обладает «здравым смыслом» и будет до последнего латать костыли, вместо того чтобы сменить парадигму.
Вывод: В 2026 году главный навык инженера — не написание кода, а умение видеть деревья за лесом и вовремя сказать нейросети «Нет, это плохая архитектура, переделывай».
UPD: в обязательном порядке прочитайте комментарии к статье, там автор продолжаем мысль в диалоге с другими пользователями. Не менее интересно и полезно. чем сама статья.
Многие верят в «вайб-кодинг» — возможность создать приложение, просто описывая желания. Но реальный опыт автора статьи на Хабре показывает: на проектах сложнее 500 строк это превращается в управление «бандой реактивных, но безынициативных стажеров».
Главный инсайт: ИИ генерирует техдолг со сверхзвуковой скоростью. Если не контролировать архитектуру, проект сложится как карточный домик.
Прогресс подхода автора прошел через 4 стадии рефакторинга:
- Микроменеджмент: ИИ создает имитацию структуры (папки есть, а внутри — монолит). Приходится ревьюить каждую строку и вручную чинить «галлюцинации».
- Изоляция компонентов: Автор научился предсказывать, где ИИ схалтурит. На этом этапе компоненты (UI, логика) начинают реально разделяться.
- Роль Архитектора: База кода становится чище. Команды становятся высокоуровневыми: «Вынеси парсинг в отдельный слой, сделай UI тупым».
- Автономия: Финал пути. ИИ начинает сам находить неочевидные баги (гонки данных, дыры в инкапсуляции) и предлагать решения.
Горький опыт: Ошибка в выборе инструмента (Matplotlib вместо нативного QGraphicsScene) стоила 40 часов борьбы с тормозами. ИИ не обладает «здравым смыслом» и будет до последнего латать костыли, вместо того чтобы сменить парадигму.
Вывод: В 2026 году главный навык инженера — не написание кода, а умение видеть деревья за лесом и вовремя сказать нейросети «Нет, это плохая архитектура, переделывай».
UPD: в обязательном порядке прочитайте комментарии к статье, там автор продолжаем мысль в диалоге с другими пользователями. Не менее интересно и полезно. чем сама статья.
👍2
Claude не очень хорошо.
Не удивляйтесь, если у вас не проходят запросы. Похоже что-то все же случилось, даже возможно из-за ряда событий на планете.
Но в целом отличный момент протестировать minimax-m2.5 free в Opencode.
Держим кулачки, ждем когда все поднимется, труженикам вайб кодинга пожелаю терпения и нервов. Берегите себя.
Не удивляйтесь, если у вас не проходят запросы. Похоже что-то все же случилось, даже возможно из-за ряда событий на планете.
Но в целом отличный момент протестировать minimax-m2.5 free в Opencode.
Держим кулачки, ждем когда все поднимется, труженикам вайб кодинга пожелаю терпения и нервов. Берегите себя.
🙏3🕊2🔥1
Пока сервера Claude опять лежат, мы вместе с главой отдела по мурчательным вопросам, пишем роутер для использования chatGPT подписок.
Во всем нужно искать хорошее. Мой бан на аккаунте антропиков сподвигнул меня на поиск и исследования, что привело к такому проекту.
Работа будет через терминальные клиенты, пока спокойно работают Claude code cli и opencode.
Как только роутер покажет стабильную работу, то я готов взять 10 человек на тестирование за небольшую плату, что бы наполнить пул аккаунтов на роутере. Скорее всего в районе 500р – 1000р с человека. Вся сумма пойдет на оплату сервера и покупку мелких подписок.
Если вам это интересно, пишите в комментариях, обсудим.
Во всем нужно искать хорошее. Мой бан на аккаунте антропиков сподвигнул меня на поиск и исследования, что привело к такому проекту.
Работа будет через терминальные клиенты, пока спокойно работают Claude code cli и opencode.
Как только роутер покажет стабильную работу, то я готов взять 10 человек на тестирование за небольшую плату, что бы наполнить пул аккаунтов на роутере. Скорее всего в районе 500р – 1000р с человека. Вся сумма пойдет на оплату сервера и покупку мелких подписок.
Если вам это интересно, пишите в комментариях, обсудим.
⚡1
Сегодня день прошел практически мимо компьютера. Только под вечер смог спокойно сесть. Продолжаю тестировать роутер.
Из клиента используется Claude Code CLI с настроенным обращением на роутер. Модель GPT-5.3-codex.
Для теста, попросил его автономно провести оценку и рефакторинг текущей версии роутера, пусть сам себя почистит и приведет в порядок.
Сегодня хочу попробовать купить еще пачку аккаунтов и добавить на роутер, завтра будет активный день, посмотрим сколько уйдет лимитов.
Если есть вопросы или предложения, пишите в комментариях, обсудим!
Из клиента используется Claude Code CLI с настроенным обращением на роутер. Модель GPT-5.3-codex.
Для теста, попросил его автономно провести оценку и рефакторинг текущей версии роутера, пусть сам себя почистит и приведет в порядок.
Сегодня хочу попробовать купить еще пачку аккаунтов и добавить на роутер, завтра будет активный день, посмотрим сколько уйдет лимитов.
Если есть вопросы или предложения, пишите в комментариях, обсудим!
И немного философии перед сном.
"Весь топ на Vercel маркетплейсе скиллов занят скам скиллами, которые с вероятностью 99% украдут всю конфиденциальную инфу у вас. Те, кто ставит скиллы с маркетплейсов через OpenClaw / find-skills не изучая процесс установки вручную – соболезную."
Вот такой текст я прочитал сегодня в одном из каналов.
Хочется предупредить людей, которые только начинают заниматься кодингом с ИИ агентами. Вам может казаться, что если вы не поставите 100500 скиллов, плагинов и свистелок - то вы ничего не добьетесь.
Это не так, абсолютли не так. В гонке с вечным чувством FOMO вы проиграете. Это как казино - еще один скилл, еще один плагин и я выиграю джекпот, вот вот мне повезет.
Мой совет - учите лучше основы разработки приложений и сервисом. Не конкретно код, а архитектуру, структуру, стеки и так далее. Развивайте в себя создателя, с пониманием того, что происходит в процессе. Однопромтовые решения только на ютубе и в реальности они не работают.
ИИ агенты дают нам возможность убрать рутину написания конкретных букв и цифр, но во что эти буковки с циферками сложится - все же решать пока нам.
Берегите себя, пользуйтесь осторожны общедоступными ресурсами, в интернете бывают люди очень разные...
PS картинку сделал chatGPT, как он увидел этот пост %)
"Весь топ на Vercel маркетплейсе скиллов занят скам скиллами, которые с вероятностью 99% украдут всю конфиденциальную инфу у вас. Те, кто ставит скиллы с маркетплейсов через OpenClaw / find-skills не изучая процесс установки вручную – соболезную."
Вот такой текст я прочитал сегодня в одном из каналов.
Хочется предупредить людей, которые только начинают заниматься кодингом с ИИ агентами. Вам может казаться, что если вы не поставите 100500 скиллов, плагинов и свистелок - то вы ничего не добьетесь.
Это не так, абсолютли не так. В гонке с вечным чувством FOMO вы проиграете. Это как казино - еще один скилл, еще один плагин и я выиграю джекпот, вот вот мне повезет.
Мой совет - учите лучше основы разработки приложений и сервисом. Не конкретно код, а архитектуру, структуру, стеки и так далее. Развивайте в себя создателя, с пониманием того, что происходит в процессе. Однопромтовые решения только на ютубе и в реальности они не работают.
ИИ агенты дают нам возможность убрать рутину написания конкретных букв и цифр, но во что эти буковки с циферками сложится - все же решать пока нам.
Берегите себя, пользуйтесь осторожны общедоступными ресурсами, в интернете бывают люди очень разные...
PS картинку сделал chatGPT, как он увидел этот пост %)
❤3👍1
Хотел сегодня написать пост про агентов, рой и так далее, но дело уже к ночи и openAI выпускает GPT-5.4.
Без приписки Codex, т.е. модель общего назначения. Много всего добавили, особенно контекст на 1 миллион токенов. Это очень хорошая новость.
Модель ориентирована на рабочие и повседневные агентские задачи, взаимодействие с файлами и вызовом нужных инструментов.
В целом как я и говорил на стримах, год 2026 будет под эгидой агентских систем.
Завтра тогда как раз напишу свои мысли про агентов и как они меняют образ работы.
Без приписки Codex, т.е. модель общего назначения. Много всего добавили, особенно контекст на 1 миллион токенов. Это очень хорошая новость.
Модель ориентирована на рабочие и повседневные агентские задачи, взаимодействие с файлами и вызовом нужных инструментов.
В целом как я и говорил на стримах, год 2026 будет под эгидой агентских систем.
Завтра тогда как раз напишу свои мысли про агентов и как они меняют образ работы.
🔥3
Краткий утренний реакшен на новый gpt-5.4 - нравится.
Шустро шуршит.
За последние пару дней в проекте прокси роутера скопился гит мусор, по этому решил сделать чистку. Проверить актуальность веток, убрать не нужное, синхронизировать полезное.
Моделька активно проверяет, предлагает решения.
Мое утро проходит с планшетом, пока ребенок делает уроки, по этому вы не просили, но я вам принес еще одну фотографию на пледе ❤️
Шустро шуршит.
За последние пару дней в проекте прокси роутера скопился гит мусор, по этому решил сделать чистку. Проверить актуальность веток, убрать не нужное, синхронизировать полезное.
Моделька активно проверяет, предлагает решения.
Мое утро проходит с планшетом, пока ребенок делает уроки, по этому вы не просили, но я вам принес еще одну фотографию на пледе ❤️
❤5🔥1
Последние время наблюдаю интересный сдвиг вокруг AI-агентов.
Раньше почти все эксперименты крутились вокруг одного агента: один LLM, набор инструментов, немного памяти. Сейчас всё вижу проекты, где речь уже не об агенте, а о рое агентов, энное мелких специализированных процессов, которые делят между собой задачи.
Интересно, что вместе с этим начинает появляться новый слой инструментов: оркестрация таких систем. Фреймворки для управления ролями агентов, контроля задач, трекинга состояний, наблюдаемости. По сути что-то вроде DevOps, но для агентных систем.
И главное, крупные вендоры тоже начали быстро подхватывать этот тренд. Почти каждый крупный AI-стек сейчас добавляет функции для multi-agent workflow: планировщики, менеджеры задач, coordination layer.
По факту оказалось, что главный челлендж уже не в том, чтобы сделать агента. Сделать одного агента сегодня довольно просто.
Сложность начинается, когда их становится 2-5-10-20-... , и нужно понимать: кто что делает, кто сломался, кто зациклился и почему система внезапно начала жечь токены.
Моя основная мысль: следующая волна инструментов в AI-разработке будет направленна на оптимизацию и повышение эффективности взаимодействия агентов друг с другом, а для человека инфраструктура управления, заточенная именно под человека, а не агента.
Конкретно у меня пока нет "роя" из сотни агентов, даже 10 не наберется. Сегодня работал в 2 терминала, 2 отдельных процесса на разных серверах.
Но в середине лета прошлого года я писал код через веб чат... Посмотрим что будет в середине этого лета.
Раньше почти все эксперименты крутились вокруг одного агента: один LLM, набор инструментов, немного памяти. Сейчас всё вижу проекты, где речь уже не об агенте, а о рое агентов, энное мелких специализированных процессов, которые делят между собой задачи.
Интересно, что вместе с этим начинает появляться новый слой инструментов: оркестрация таких систем. Фреймворки для управления ролями агентов, контроля задач, трекинга состояний, наблюдаемости. По сути что-то вроде DevOps, но для агентных систем.
И главное, крупные вендоры тоже начали быстро подхватывать этот тренд. Почти каждый крупный AI-стек сейчас добавляет функции для multi-agent workflow: планировщики, менеджеры задач, coordination layer.
По факту оказалось, что главный челлендж уже не в том, чтобы сделать агента. Сделать одного агента сегодня довольно просто.
Сложность начинается, когда их становится 2-5-10-20-... , и нужно понимать: кто что делает, кто сломался, кто зациклился и почему система внезапно начала жечь токены.
Моя основная мысль: следующая волна инструментов в AI-разработке будет направленна на оптимизацию и повышение эффективности взаимодействия агентов друг с другом, а для человека инфраструктура управления, заточенная именно под человека, а не агента.
Конкретно у меня пока нет "роя" из сотни агентов, даже 10 не наберется. Сегодня работал в 2 терминала, 2 отдельных процесса на разных серверах.
Но в середине лета прошлого года я писал код через веб чат... Посмотрим что будет в середине этого лета.
👍4💯1
Уххх, Ребята! Красивая цифра. Спасибо за доверие и интерес к моему каналу.
Всего то ничего я отмечал, что нас 80, а теперь уже 200...
Всего то ничего я отмечал, что нас 80, а теперь уже 200...
🔥12🎉3❤2
Прочитал разбор атаки Clinejection — довольно показательная история про безопасность AI-инструментов.
Исследователь показал, что у Cline был GitHub workflow, где Claude автоматически триажил новые issues. Звучит удобно: бот читает issue и помогает команде разбирать входящие баги.
Проблема в том, что заголовок issue напрямую подставлялся в prompt. Без какой-либо фильтрации. В итоге злоумышленник мог просто написать специальный текст — и агент воспринимал его как инструкцию.
Дальше начинается цепочка: prompt injection → выполнение команды → отравление кэша CI → кража токенов публикации. Через это можно было получить доступ к релиз-пайплайну и опубликовать вредоносную версию инструмента для миллионов разработчиков.
Самый интересный инсайт — проблема вообще не в модели.
Проблема в архитектуре.
Когда агенту дают доступ к инструментам, CI и секретам, любой текст становится потенциальной точкой входа. Issue, PR, README, комментарий в коде — всё это может оказаться «инструкцией» для агента.
Поэтому мало написать функционал сервиса. Нужно сразу думать, какие текстовые входы могут управлять агентом и что он имеет право делать.
Похоже, безопасность агентных систем — это отдельная инженерная дисциплина, которая активно начинает формироваться.
PS понравилась картинка, взял у автора статьи на habr, ссылка есть, автору за статью респект и уважение.
Исследователь показал, что у Cline был GitHub workflow, где Claude автоматически триажил новые issues. Звучит удобно: бот читает issue и помогает команде разбирать входящие баги.
Проблема в том, что заголовок issue напрямую подставлялся в prompt. Без какой-либо фильтрации. В итоге злоумышленник мог просто написать специальный текст — и агент воспринимал его как инструкцию.
Дальше начинается цепочка: prompt injection → выполнение команды → отравление кэша CI → кража токенов публикации. Через это можно было получить доступ к релиз-пайплайну и опубликовать вредоносную версию инструмента для миллионов разработчиков.
Самый интересный инсайт — проблема вообще не в модели.
Проблема в архитектуре.
Когда агенту дают доступ к инструментам, CI и секретам, любой текст становится потенциальной точкой входа. Issue, PR, README, комментарий в коде — всё это может оказаться «инструкцией» для агента.
Поэтому мало написать функционал сервиса. Нужно сразу думать, какие текстовые входы могут управлять агентом и что он имеет право делать.
Похоже, безопасность агентных систем — это отдельная инженерная дисциплина, которая активно начинает формироваться.
PS понравилась картинка, взял у автора статьи на habr, ссылка есть, автору за статью респект и уважение.
👍3🤔1💯1
Последние пару дней активно гоняю gpt-5.4 в кодинге.
В основном на реальных задачах — правки в проекте, мелкие фичи, рефакторинг. Первое ощущение — модель стала работать намного спокойнее.
Раньше многие модели любили «размахиваться»: переписать полфайла, предложить новую архитектуру, поменять структуру проекта. иногда это полезно, но чаще ломает поток разработки.
С 5.4 ощущение другое. Она чаще делает локальные изменения, старается не трогать лишнее и аккуратно вписывается в существующий код. Активно использует git worktree, а затем еще пару раз все проверить, прежде чем мерджить в основную ветку.
Если даёшь чёткую инструкцию — модель реально держится в её границах. Не начинает импровизировать и не пытается «улучшить всё вокруг». По ощущениям это ближе к работе с аккуратным коллегой, чем с генератором идей.
Интересно, что некоторые разработчики отмечают, что модель стала проще управляться и лучше подходит для длинных агентных workflow. При этом прогресс на бенчмарках выглядит скорее эволюционным, а не резким скачком.
Мне кажется, что основной апгрейд 5.4 — не интеллект, а управляемость.
А для реальной разработки это, возможно, даже важнее.
В основном на реальных задачах — правки в проекте, мелкие фичи, рефакторинг. Первое ощущение — модель стала работать намного спокойнее.
Раньше многие модели любили «размахиваться»: переписать полфайла, предложить новую архитектуру, поменять структуру проекта. иногда это полезно, но чаще ломает поток разработки.
С 5.4 ощущение другое. Она чаще делает локальные изменения, старается не трогать лишнее и аккуратно вписывается в существующий код. Активно использует git worktree, а затем еще пару раз все проверить, прежде чем мерджить в основную ветку.
Если даёшь чёткую инструкцию — модель реально держится в её границах. Не начинает импровизировать и не пытается «улучшить всё вокруг». По ощущениям это ближе к работе с аккуратным коллегой, чем с генератором идей.
Интересно, что некоторые разработчики отмечают, что модель стала проще управляться и лучше подходит для длинных агентных workflow. При этом прогресс на бенчмарках выглядит скорее эволюционным, а не резким скачком.
Мне кажется, что основной апгрейд 5.4 — не интеллект, а управляемость.
А для реальной разработки это, возможно, даже важнее.
❤1👍1
Друзья, выложил стрим от 14 февраля 2026.
Всем приятного просмотра
https://youtu.be/-7gLuyQG_2k?si=XJWVKGH-RaXwyRwn
Всем приятного просмотра
https://youtu.be/-7gLuyQG_2k?si=XJWVKGH-RaXwyRwn
Потихоньку я привожу в порядок свой роутер, о котором рассказывал ранее.
Пока будем работать только с GPT-5.4 через терминальный клиент Claude Code CLI.
Кому это будет интересно - людям, кто хочет попробовать себя в вайб кодинге и не хочет заморачиваться с подпискам.
Сам я тестирую уже на реальном продакшене, но не готов гарантировать стабильность другим, по этому лучше, если пока роутер будет все же как учебный полигон, где вы можете что-то протестировать.
Хочу предоставить доступ на время теста для 5 человек, с каждого будет взят взнос по 1000 рублей (одна тысяча рублей), которые пойдут на закупки аккаунтов и оплату сервера.
Проведем анализ стабильности канала, поищем какие то баги, посмотрим сколько реально тратят 5 человек лимитов. Нужна аналитика, для аналитики нужны данные реального использования.
Пишите в лс или в комментариях. Кто уже писал, пожалуйста, напомните о себе.
Если у вас есть друзья / знакомые, кто только начинает, перешлите этот пост, может быть кому то реально поможет.
Пока будем работать только с GPT-5.4 через терминальный клиент Claude Code CLI.
Кому это будет интересно - людям, кто хочет попробовать себя в вайб кодинге и не хочет заморачиваться с подпискам.
Сам я тестирую уже на реальном продакшене, но не готов гарантировать стабильность другим, по этому лучше, если пока роутер будет все же как учебный полигон, где вы можете что-то протестировать.
Хочу предоставить доступ на время теста для 5 человек, с каждого будет взят взнос по 1000 рублей (одна тысяча рублей), которые пойдут на закупки аккаунтов и оплату сервера.
Проведем анализ стабильности канала, поищем какие то баги, посмотрим сколько реально тратят 5 человек лимитов. Нужна аналитика, для аналитики нужны данные реального использования.
Пишите в лс или в комментариях. Кто уже писал, пожалуйста, напомните о себе.
Если у вас есть друзья / знакомые, кто только начинает, перешлите этот пост, может быть кому то реально поможет.
🔥4
Сегодня наблюдал интересный момент при работе с агентом во время разработки.
Я дал довольно простую инструкцию: оформить дизайн-документ и начинать реализацию без ожидания моего подтверждения. Раньше подобные вещи обычно требовали ручного контроля — проверить план, подтвердить шаги, потом уже запускать код.
Агент отреагировал иначе.
Он сначала сохранил дизайн и план, затем автоматически переключился в режим реализации. Поднял изолированное рабочее дерево через git worktrees, подключил сабагентов и начал выполнять план в текущей сессии.
Фактически он сам собрал рабочий пайплайн:
дизайн → план → изолированная среда → выполнение.
Самый интересный момент — постепенно исчезает необходимость микроменеджмента. Раньше агентам нужно было говорить каждый следующий шаг. Теперь достаточно задать направление и границы.
По факту начинаешь больше управлять процессом, чем отдельными действиями.
Пока выглядит так, что агенты постепенно переходят из режима «инструмента» в режим «исполнителя».
Интересно посмотреть, как далеко это зайдет, когда таких агентов станет не один, а целый рой.
Ниже прикладываю цепочку действий от агента (прям да, прям скопировал из чата, только удалил пару системных строк и путей проекта):
Я дал довольно простую инструкцию: оформить дизайн-документ и начинать реализацию без ожидания моего подтверждения. Раньше подобные вещи обычно требовали ручного контроля — проверить план, подтвердить шаги, потом уже запускать код.
Агент отреагировал иначе.
Он сначала сохранил дизайн и план, затем автоматически переключился в режим реализации. Поднял изолированное рабочее дерево через git worktrees, подключил сабагентов и начал выполнять план в текущей сессии.
Фактически он сам собрал рабочий пайплайн:
дизайн → план → изолированная среда → выполнение.
Самый интересный момент — постепенно исчезает необходимость микроменеджмента. Раньше агентам нужно было говорить каждый следующий шаг. Теперь достаточно задать направление и границы.
По факту начинаешь больше управлять процессом, чем отдельными действиями.
Пока выглядит так, что агенты постепенно переходят из режима «инструмента» в режим «исполнителя».
Интересно посмотреть, как далеко это зайдет, когда таких агентов станет не один, а целый рой.
Ниже прикладываю цепочку действий от агента (прям да, прям скопировал из чата, только удалил пару системных строк и путей проекта):
● Использую writing-plans для перехода от дизайна к плану реализации после сохранения дизайна.
● Skill(superpowers:writing-plans)
⎿ Successfully loaded skill
● Сначала сохраню дизайн и план, потом перейду к реализации по этому плану в текущей сессии.
● Сохраню дизайн и план в docs/plans, затем начну реализацию по плану в этой сессии.
● Использую subagent-driven-development для выполнения плана в этой сессии и using-git-worktrees для изолированной реализации.
● Skill(superpowers:subagent-driven-development)
⎿ Successfully loaded skill
● Skill(superpowers:using-git-worktrees)
⎿ Successfully loaded skill
● Я использую using-git-worktrees skill, чтобы поднять изолированное рабочее дерево, и subagent-driven-development для выполнения плана в этой сессии.
🔥4❤1
Сегодня поймал приятный момент в работе.
Недавно пришло несколько интересных коммерческих проектов. Тот самый тип задач, где понимаешь — будет много экспериментов, архитектуры и неожиданных решений.
Отдельно ловлю себя на мысли, насколько мотивирует сам факт выбора. Когда клиент выбирает тебя из десятков, а то и сотни других людей, это автоматически повышает планку. Хочется копать глубже, пробовать новые подходы и вытаскивать из инструментов максимум.
Сегодня как раз был небольшой эксперимент: оставил агенту проект на ночь.
Перед уходом запустил ему задачу на максимальный рефакторинг. Прямо в промпте прописал: я оффлайн до утра, составь план, получи все разрешения сейчас и работай автономно.
Агент подготовился довольно системно.
Создал отдельный worktree, поднял новую ветку под рефакторинг и сразу обозначил границы — какие файлы трогать нельзя, где можно делать cleanup, где допустимы частые checkpoint-коммиты.
Интересный момент всплыл на самом старте.
Первые baseline-проверки упали не из-за кода, а из-за окружения. В backend не было pytest, а frontend тесты запускались не из правильной директории. То есть проблема инфраструктуры, а не логики проекта.
И это как раз хороший пример того, как агент рассуждает.
Он не остановился на ошибке, а сам классифицировал её как environment issue и просто скорректировал стратегию запуска проверок.
Дальше план у него довольно взрослый: baseline → sanitation конфигов и секретов → распутывание backend → разделение большого combined-сервера → зачистка legacy → затем frontend.
По факту выглядит как полноценная ночная смена разработчика.
Утром будет интересно посмотреть, насколько далеко он реально продвинется без участия человека.
Недавно пришло несколько интересных коммерческих проектов. Тот самый тип задач, где понимаешь — будет много экспериментов, архитектуры и неожиданных решений.
Отдельно ловлю себя на мысли, насколько мотивирует сам факт выбора. Когда клиент выбирает тебя из десятков, а то и сотни других людей, это автоматически повышает планку. Хочется копать глубже, пробовать новые подходы и вытаскивать из инструментов максимум.
Сегодня как раз был небольшой эксперимент: оставил агенту проект на ночь.
Перед уходом запустил ему задачу на максимальный рефакторинг. Прямо в промпте прописал: я оффлайн до утра, составь план, получи все разрешения сейчас и работай автономно.
Агент подготовился довольно системно.
Создал отдельный worktree, поднял новую ветку под рефакторинг и сразу обозначил границы — какие файлы трогать нельзя, где можно делать cleanup, где допустимы частые checkpoint-коммиты.
Интересный момент всплыл на самом старте.
Первые baseline-проверки упали не из-за кода, а из-за окружения. В backend не было pytest, а frontend тесты запускались не из правильной директории. То есть проблема инфраструктуры, а не логики проекта.
И это как раз хороший пример того, как агент рассуждает.
Он не остановился на ошибке, а сам классифицировал её как environment issue и просто скорректировал стратегию запуска проверок.
Дальше план у него довольно взрослый: baseline → sanitation конфигов и секретов → распутывание backend → разделение большого combined-сервера → зачистка legacy → затем frontend.
По факту выглядит как полноценная ночная смена разработчика.
Утром будет интересно посмотреть, насколько далеко он реально продвинется без участия человека.
👍7
Сегодня планировал провести стрим, но придётся его отменить.
Немного приболел — обычная простуда, ничего серьёзного, но голос уже начинает подводить. Поймал себя на мысли, что если всё-таки выйти в эфир, половина стрима будет состоять из шмыганья и кашля.
А стримы я всё-таки делаю ради нормального разговора, обсуждения идей и экспериментов, а не ради формального «включил камеру — и ладно».
Поэтому решил не мучить ни себя, ни вас. Иногда лучше честно отменить стрим, чем провести его на 30% энергии и с постоянными паузами.
Пока буду восстанавливаться — накидайте в комментариях идеи для следующих стримов. Что разобрать? Какие инструменты или эксперименты с агентами посмотреть?
И ещё одна мысль, которую сейчас кручу в голове. Наткнулся на plane — по сути self-host аналог linear, но с открытым кодом.
Интересно посмотреть на такие инструменты именно в контексте работы с AI-агентами. Когда проект становится сложнее, обычные заметки и markdown уже не тянут — нужна нормальная система постановки задач.
Есть ощущение, что такие штуки могут стать удобным слоем для оркестрации агентной разработки.
Буду дальше копать.
Немного приболел — обычная простуда, ничего серьёзного, но голос уже начинает подводить. Поймал себя на мысли, что если всё-таки выйти в эфир, половина стрима будет состоять из шмыганья и кашля.
А стримы я всё-таки делаю ради нормального разговора, обсуждения идей и экспериментов, а не ради формального «включил камеру — и ладно».
Поэтому решил не мучить ни себя, ни вас. Иногда лучше честно отменить стрим, чем провести его на 30% энергии и с постоянными паузами.
Пока буду восстанавливаться — накидайте в комментариях идеи для следующих стримов. Что разобрать? Какие инструменты или эксперименты с агентами посмотреть?
И ещё одна мысль, которую сейчас кручу в голове. Наткнулся на plane — по сути self-host аналог linear, но с открытым кодом.
Интересно посмотреть на такие инструменты именно в контексте работы с AI-агентами. Когда проект становится сложнее, обычные заметки и markdown уже не тянут — нужна нормальная система постановки задач.
Есть ощущение, что такие штуки могут стать удобным слоем для оркестрации агентной разработки.
Буду дальше копать.
Наткнулся на интересную статью про Cursor и текущую гонку AI-инструментов для разработки.
История любопытная: команда Cursor провела внутренний митинг с довольно прямым слайдом — “War Time”. Причина простая — рынок начал резко меняться. Anysphere построили один из самых быстрорастущих AI-редакторов, но теперь столкнулись с новой реальностью: разработчикам может вообще перестать быть нужен редактор кода.
Появляются инструменты вроде Claude Code и других агентных систем, которые работают не как IDE, а как исполнитель задач.
Ты просто описываешь задачу, а система сама пишет код, запускает команды, редактирует файлы и делает коммиты. Получается странный сдвиг. Раньше IDE была центром разработки. Теперь она постепенно становится просто одним из интерфейсов для агента.
Основная мысль из всей этой истории — конкуренция уже не между редакторами.
Она между платформами управления AI-агентами, которые пишут код.
IDE никуда не исчезнут. Но похоже, что их роль становится менее критичной, чем раньше.
Интересно посмотреть, как это будет выглядеть через год.
Как говорит в меме, каждый день мы все дальше отбога ручного написания кода.
PS GPT-5.4 именно так представляет обложку про эту статью. Возмжно Opus что-то нашептал ему об инсайдах из Пентагона.
История любопытная: команда Cursor провела внутренний митинг с довольно прямым слайдом — “War Time”. Причина простая — рынок начал резко меняться. Anysphere построили один из самых быстрорастущих AI-редакторов, но теперь столкнулись с новой реальностью: разработчикам может вообще перестать быть нужен редактор кода.
Появляются инструменты вроде Claude Code и других агентных систем, которые работают не как IDE, а как исполнитель задач.
Ты просто описываешь задачу, а система сама пишет код, запускает команды, редактирует файлы и делает коммиты. Получается странный сдвиг. Раньше IDE была центром разработки. Теперь она постепенно становится просто одним из интерфейсов для агента.
Основная мысль из всей этой истории — конкуренция уже не между редакторами.
Она между платформами управления AI-агентами, которые пишут код.
IDE никуда не исчезнут. Но похоже, что их роль становится менее критичной, чем раньше.
Интересно посмотреть, как это будет выглядеть через год.
Как говорит в меме, каждый день мы все дальше от
PS GPT-5.4 именно так представляет обложку про эту статью. Возмжно Opus что-то нашептал ему об инсайдах из Пентагона.
🔥3😁2🤝1
Сегодня беседовали с агентом о проекте.
Обычная рабочая сессия: я описываю идею, он задаёт вопросы, уточняет детали, постепенно формируем план. Всё выглядело как обычное обсуждение архитектуры.
В какой-то момент он задал свой любимый вопрос — какой вариант лучше использовать. Что-то из серии: "рекомендую такой подход, но можно и так".
Честно говоря, иногда множество таких уточнений начинают звучать как фоновый шум. Я особо не вчитывался и просто ответил: "да, ок, продолжи дальше".
Иногда все же стоит читать, что пишет агент... ибо дальше поток действий пошел БЕЗ ОСТАНОВКИ,
Агент составил план, разбил его на задачи, создал отдельный worktree, ветку, подготовил окружение… и просто начал реализовывать.
Я несколько раз возвращался в терминал проверить, что происходит — а он всё ещё работает.
В итоге процесс занял (внимание, обратите внимание) 04:27:09. Все верно, Четыре часа, двадцать семь минут и девять секунд. 29 задач в плане, 28 выполнено. Последняя задача была верификация результата и пуш на гит, для этого он все же остановился и спросил.
Самый интересный момент, Я просто ответил ему на автомате - ок, продолжи.
Похоже, именно в этот момент я случайно выпустил джина из бутылки.
Обычная рабочая сессия: я описываю идею, он задаёт вопросы, уточняет детали, постепенно формируем план. Всё выглядело как обычное обсуждение архитектуры.
В какой-то момент он задал свой любимый вопрос — какой вариант лучше использовать. Что-то из серии: "рекомендую такой подход, но можно и так".
Честно говоря, иногда множество таких уточнений начинают звучать как фоновый шум. Я особо не вчитывался и просто ответил: "да, ок, продолжи дальше".
Иногда все же стоит читать, что пишет агент... ибо дальше поток действий пошел БЕЗ ОСТАНОВКИ,
Агент составил план, разбил его на задачи, создал отдельный worktree, ветку, подготовил окружение… и просто начал реализовывать.
Я несколько раз возвращался в терминал проверить, что происходит — а он всё ещё работает.
В итоге процесс занял (внимание, обратите внимание) 04:27:09. Все верно, Четыре часа, двадцать семь минут и девять секунд. 29 задач в плане, 28 выполнено. Последняя задача была верификация результата и пуш на гит, для этого он все же остановился и спросил.
Самый интересный момент, Я просто ответил ему на автомате - ок, продолжи.
Похоже, именно в этот момент я случайно выпустил джина из бутылки.
🤔3😁2🔥1
Попробовал использовать репозиторий pinchtab для парсинга.
Изначально искал что-то попроще, без платных API и прокси-зоопарка. в итоге наткнулся на него — выглядит как легкий слой над браузерной автоматизацией, но с акцентом именно на сбор данных.
В процессе теста оказалось, что он не просто дергает HTML, а реально эмулирует поведение браузера: ждет загрузку, подгружает динамику, нормально работает с JS. для некоторых сайтов это критично.
В целом результат получился довольно стабильный. данные вытягиваются без сильных костылей, меньше проблем с "пустыми" ответами.
Сейчас уже нет смысла бороться с сайтами на уровне raw HTML. если страница живет на JS, проще сразу идти в сторону эмуляции браузера, чем пытаться обходить это вручную.
Пока выглядит как рабочий инструмент, буду работать с ним дальше.
Изначально искал что-то попроще, без платных API и прокси-зоопарка. в итоге наткнулся на него — выглядит как легкий слой над браузерной автоматизацией, но с акцентом именно на сбор данных.
В процессе теста оказалось, что он не просто дергает HTML, а реально эмулирует поведение браузера: ждет загрузку, подгружает динамику, нормально работает с JS. для некоторых сайтов это критично.
В целом результат получился довольно стабильный. данные вытягиваются без сильных костылей, меньше проблем с "пустыми" ответами.
Сейчас уже нет смысла бороться с сайтами на уровне raw HTML. если страница живет на JS, проще сразу идти в сторону эмуляции браузера, чем пытаться обходить это вручную.
Пока выглядит как рабочий инструмент, буду работать с ним дальше.
👍4