Наконец-то я запустил AG2-Assistant, который у нас в разработке (руки дошли). Этакий аналог Hermes / OpenClaw
У ребят довольно неплохо получилось, но у меня все еще 100500 замечаний по UX🌚
Щас лимиты на Claude откатятся - и пойду переделывать половину проекта😅
Релиз запланирован на следующей неделе - вместе с AG2 1.0.0
А пока - мигрирую все свои рабочие Hermes / Claude Cowork пайплайны на этого ассистента. Посмотрим, что из этого получится
У ребят довольно неплохо получилось, но у меня все еще 100500 замечаний по UX🌚
Щас лимиты на Claude откатятся - и пойду переделывать половину проекта😅
Релиз запланирован на следующей неделе - вместе с AG2 1.0.0
А пока - мигрирую все свои рабочие Hermes / Claude Cowork пайплайны на этого ассистента. Посмотрим, что из этого получится
👍11🤡5🔥4❤2💅2
Периодически я закидываю в канал новые skills для агентов - для дизайна, SDD, свои собственные. Большую часть из них я пробую сам, но результаты этого тестирования обсуждаем в основном в чатике. Исправляю это недоразумение - поделюсь личным сетапом скиллов, которым пользуюсь каждый день:
grill-with-docs - 10/10, мой топ
Заставляет агента мучать тебя вопросами, пока не выудит все нюансы задачи, - и только потом оформляет решение в ADR и идет кодить. Еще он ведет CONTEXT.md - глоссарий проекта. Через пару сеансов вы с агентом говорите на одном языке и понимаете друг друга с полуслова. Юзаю буквально на всех проектах. Если ставить ровно один скилл - ставьте этот.
superpowers - рабочая лошадка, но с оговоркой
PLAN-мод, TDD, наводящие вопросы перед задачей - все, как я люблю. 250к+ звезд на гите не на пустом месте, могу рекомендовать. Одно бесит: по дефолту он коммитит в репозиторий все планы и ресерчи, что нагенерил. А план - промежуточный артефакт, ему место в мусорке после мержа, не в гит-истории (целый пост про это). И реализацию с сабагентами я тоже частенько выключаю - пусть лучше один агент шуршит. Но в целом, скилл - огонь
codegraph - это не скилл, а MCP, но его я тоже могу рекомендовать
Строит граф всего кода проекта на основе AST через tree-sitter - символы, вызовы, зависимости. Агент вместо слепого
rtk - использую, но по мелочи
Якобы он экономит токены на CLI вызовах: прогоняет команду через себя и отдает агенту сжатый вывод вместо простыней. У меня прижился узко - git-команды, всякие ls / wc и прочая мелочевка, где вывод жирный, а нужного в нем три строки. На вызовах тестов (он все время норовит завернуть
⚠️НА ЭТОМ МОЙ СПИСОК КОНЧИЛСЯ!⚠️
Я стараюсь минимизировать набор скиллов, MCP и прочего мусора в проекте - чем меньше у агента опций, тем лучше он фокусируется на конкретной задаче. Поэтому скилл должен быть действительно хорош, чтобы попасть в мой шорт-лист
Но я пробовал и другие хайповые штуки:
taste-skill - пилот пройден, но надо смотреть еще
Скилл обещает привить агенту дизайнерский вкус (самый популярный из скиллов этой категории). Проверял на своем сайте: агент сам придумал три концепции - и выглядит более-менее прилично, но слоп все равно прослеживается. Работает скилл или это заслуга Opus 4.8 - до конца не понял. Но результат зашел, буду тестировать при возможности еще.
ponytail - попробовал, ноль эффекта. Хотя на GitHub уже 80k+ звезд...
Скилл форсит агента лениться: думать как самый ленивый синьор в команде, "лучший код - тот, который ты не написал". На моих проектах скилл не поменял вообще ничего. Видимо, я и так уже самый ленивый синьор в комнате 🌚
caveman - пробовал пару раз, не зашло
Скилл заставляет модель общаться с тобой как пещерный человек: "Моя сделать, готово". Заявлена экономия 60% токенов, но на деле экономит только 8%. Кто-то в чате писал, что так просто удобнее читать вывод агента. Для меня оно того не стоит
Если у вас есть какие-нибудь прикольные скиллы на пробу - закидывайте в комменты, обязательно посмотрю! Мб что-нибудь сворую🌚
#AI
grill-with-docs - 10/10, мой топ
Заставляет агента мучать тебя вопросами, пока не выудит все нюансы задачи, - и только потом оформляет решение в ADR и идет кодить. Еще он ведет CONTEXT.md - глоссарий проекта. Через пару сеансов вы с агентом говорите на одном языке и понимаете друг друга с полуслова. Юзаю буквально на всех проектах. Если ставить ровно один скилл - ставьте этот.
superpowers - рабочая лошадка, но с оговоркой
PLAN-мод, TDD, наводящие вопросы перед задачей - все, как я люблю. 250к+ звезд на гите не на пустом месте, могу рекомендовать. Одно бесит: по дефолту он коммитит в репозиторий все планы и ресерчи, что нагенерил. А план - промежуточный артефакт, ему место в мусорке после мержа, не в гит-истории (целый пост про это). И реализацию с сабагентами я тоже частенько выключаю - пусть лучше один агент шуршит. Но в целом, скилл - огонь
codegraph - это не скилл, а MCP, но его я тоже могу рекомендовать
Строит граф всего кода проекта на основе AST через tree-sitter - символы, вызовы, зависимости. Агент вместо слепого
grep спрашивает точечно: кто вызывает эту функцию, что сломается, если поменять вот это, покажи сигнатуру - и получает структурный ответ за миллисекунды, не сжигая контекст на чтение половины репозитория. Штука рабочая, мне нравится. Хотя сейчас хочу попробовать еще Graphifyrtk - использую, но по мелочи
Якобы он экономит токены на CLI вызовах: прогоняет команду через себя и отдает агенту сжатый вывод вместо простыней. У меня прижился узко - git-команды, всякие ls / wc и прочая мелочевка, где вывод жирный, а нужного в нем три строки. На вызовах тестов (он все время норовит завернуть
pytest в себя) надо отключать, там он только вредит. Не революция, но контекст бережет.⚠️НА ЭТОМ МОЙ СПИСОК КОНЧИЛСЯ!⚠️
Я стараюсь минимизировать набор скиллов, MCP и прочего мусора в проекте - чем меньше у агента опций, тем лучше он фокусируется на конкретной задаче. Поэтому скилл должен быть действительно хорош, чтобы попасть в мой шорт-лист
Но я пробовал и другие хайповые штуки:
taste-skill - пилот пройден, но надо смотреть еще
Скилл обещает привить агенту дизайнерский вкус (самый популярный из скиллов этой категории). Проверял на своем сайте: агент сам придумал три концепции - и выглядит более-менее прилично, но слоп все равно прослеживается. Работает скилл или это заслуга Opus 4.8 - до конца не понял. Но результат зашел, буду тестировать при возможности еще.
ponytail - попробовал, ноль эффекта. Хотя на GitHub уже 80k+ звезд...
Скилл форсит агента лениться: думать как самый ленивый синьор в команде, "лучший код - тот, который ты не написал". На моих проектах скилл не поменял вообще ничего. Видимо, я и так уже самый ленивый синьор в комнате 🌚
caveman - пробовал пару раз, не зашло
Скилл заставляет модель общаться с тобой как пещерный человек: "Моя сделать, готово". Заявлена экономия 60% токенов, но на деле экономит только 8%. Кто-то в чате писал, что так просто удобнее читать вывод агента. Для меня оно того не стоит
Если у вас есть какие-нибудь прикольные скиллы на пробу - закидывайте в комменты, обязательно посмотрю! Мб что-нибудь сворую🌚
#AI
Telegram
FastNews | Chat
Флудилка про AI, Slop и всякое разное
Чат канала @fastnewsdev
Чат канала @fastnewsdev
❤14👍4😢1🍓1👀1
За AI-тулингом невозможно следить руками, поэтому поднял себе радар: агент раз в день прочесывает GitHub Trending, Reddit, X и HN в поисках нового тулинга для кодинг-агентов - скиллы, MCP-серверы, CLI. Если это что-то стоящее - кидаю в канал. Но стоящего в последнее время много, поэтому предлагаю новый формат:
• по воскресеньям закидываю в канал дайджест за неделю
• если что-то стоящее появляется день в день - я кидаю это в чат
На этой неделе:
Топ недели - hallmark. Анти-AI-slop скилл для дизайна: ставишь в Claude Code / Cursor - агент перестает лепить фиолетовые градиенты. Неделю назад у репы было 4.6k звезд, к субботе - 12.4k🤯, на пике +3.4k за день. Та же ниша, что у taste-skill, который я гонял на своем сайте - положил в бэклог сравнить.
Тренд недели - "скилл-библиотека под роль". Matt Pocock выложил свою рабочую
Боль недели - память. Шесть инструментов за семь дней об одном и том же: "агент забывает все между сессиями". Ditto майнит твои локальные логи Claude Code в профиль "как ты работаешь" и подгружает его перед каждой задачей. elim-mcp хранит негативное знание - что агент уже пробовал и отбросил, чтобы не ходить по кругу. Плюс Engram, Selvedge, Ravel и Perseus Vault. Когда шесть человек независимо пилят одно и то же🤷♂️
Вторая боль - страховка от агента с руками. dcg блокирует деструктивные git/shell-команды до исполнения, Confessor показывает, какие приватные файлы агент успел прочитать за сессию, Ripple - CI-gate на границы правки: просил тронуть одну функцию - отрефакторил три файла, лови. Тоже кластер: пять штук за неделю.
Просто находки:
• wigolo - локальный веб-поисковик для агента: поиск, fetch, crawl без API-ключей и без оплаты за запрос;
• Mindwalk - реплей сессии агента на 3D-карте кодовой базы: видно, где он "ходил" и что трогал. (Тул специально для Коли🌚)
Сам из этого пока ничего не внедрил - только собрал. Первыми потыкаю hallmark и wigolo, отпишусь в чат.
Если радар что-то проспал - несите в комменты, годное попадет в следующий выпуск. И давайте проголосуем, нужны ли такие дайджесты вообще: ставим пальцы🙂 / 👎
#AI #digest
• по воскресеньям закидываю в канал дайджест за неделю
• если что-то стоящее появляется день в день - я кидаю это в чат
На этой неделе:
Топ недели - hallmark. Анти-AI-slop скилл для дизайна: ставишь в Claude Code / Cursor - агент перестает лепить фиолетовые градиенты. Неделю назад у репы было 4.6k звезд, к субботе - 12.4k🤯, на пике +3.4k за день. Та же ниша, что у taste-skill, который я гонял на своем сайте - положил в бэклог сравнить.
Тренд недели - "скилл-библиотека под роль". Matt Pocock выложил свою рабочую
.claude-директорию как skills for real engineers (+2k звезд в день на пике) - я сам ей активно пользуюсь. Следом - маркетинг, дизайн-инженерия, и даже Google подтянул android/skills. Скиллы больше не шерят поштучно - выкладывают целые сетапы под профессию.Боль недели - память. Шесть инструментов за семь дней об одном и том же: "агент забывает все между сессиями". Ditto майнит твои локальные логи Claude Code в профиль "как ты работаешь" и подгружает его перед каждой задачей. elim-mcp хранит негативное знание - что агент уже пробовал и отбросил, чтобы не ходить по кругу. Плюс Engram, Selvedge, Ravel и Perseus Vault. Когда шесть человек независимо пилят одно и то же🤷♂️
Вторая боль - страховка от агента с руками. dcg блокирует деструктивные git/shell-команды до исполнения, Confessor показывает, какие приватные файлы агент успел прочитать за сессию, Ripple - CI-gate на границы правки: просил тронуть одну функцию - отрефакторил три файла, лови. Тоже кластер: пять штук за неделю.
Просто находки:
• wigolo - локальный веб-поисковик для агента: поиск, fetch, crawl без API-ключей и без оплаты за запрос;
• Mindwalk - реплей сессии агента на 3D-карте кодовой базы: видно, где он "ходил" и что трогал. (Тул специально для Коли🌚)
Сам из этого пока ничего не внедрил - только собрал. Первыми потыкаю hallmark и wigolo, отпишусь в чат.
Если радар что-то проспал - несите в комменты, годное попадет в следующий выпуск. И давайте проголосуем, нужны ли такие дайджесты вообще: ставим пальцы
#AI #digest
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
FastNews | Chat
Флудилка про AI, Slop и всякое разное
Чат канала @fastnewsdev
Чат канала @fastnewsdev
👍20🔥3❤2👎1😁1🤡1🥴1
Я сейчас в отпуске и для души делаю проект с полным вайбкодингом по 10 часов в день (развлечения разрабов🥲) - даже в код не заглядываю. И наконец-то понял, почему все вайбкодеры подсаживаются на этот КАЙФ😁
Сидишь, 30-40 минут дизайнишь фичу, а потом даешь отмашку агенту - и он 2 часа пыхтит не переставая. Сам себя ревьюит, правит, бьет себя по рукам за нарушение стайлгайда. Тебе остается только подойти, когда все готово и сделать еще пару сессий на правку мелких багфиксов / доделок, если где промахнулись по вижену. В общем, из 4 часов времени ты активно что-то делаешь час от силы. Т.е. мои 10 часов - это 2 часа реального времени, когда я сижу около ноута. Остальное время - твое. Я вот, например, сейчас за городом - поэтому пока клод пишет код, я таскаю кирпичи, замешиваю цемент и тд (тут нас еще не заменили🫡)
Кто-то залипает в тикток / инсту, кто-то читает книги, кто-то занимается спортом. В общем - это реальная возможность жить свою лучшую жизнь и шипить фичи одновременно. Осталось только научиться закрывать глаза на качество кода🌚
Мой вердикт - каждому надо попробовать сделать такой проект для души. А еще лучше - найти работодателя, который берет риски вайбкодинга на себя, а вам остается только абьюзить подписку клода🌚
И да, весь пайплайн моей работы щас построен на скиллах от Matt'а, про которые я уже рассказывал. Как это работает полностью распишу отдельным постом на следующей неделе, а пока - я в отпуске😎
#AI
Сидишь, 30-40 минут дизайнишь фичу, а потом даешь отмашку агенту - и он 2 часа пыхтит не переставая. Сам себя ревьюит, правит, бьет себя по рукам за нарушение стайлгайда. Тебе остается только подойти, когда все готово и сделать еще пару сессий на правку мелких багфиксов / доделок, если где промахнулись по вижену. В общем, из 4 часов времени ты активно что-то делаешь час от силы. Т.е. мои 10 часов - это 2 часа реального времени, когда я сижу около ноута. Остальное время - твое. Я вот, например, сейчас за городом - поэтому пока клод пишет код, я таскаю кирпичи, замешиваю цемент и тд (тут нас еще не заменили🫡)
Кто-то залипает в тикток / инсту, кто-то читает книги, кто-то занимается спортом. В общем - это реальная возможность жить свою лучшую жизнь и шипить фичи одновременно. Осталось только научиться закрывать глаза на качество кода🌚
Мой вердикт - каждому надо попробовать сделать такой проект для души. А еще лучше - найти работодателя, который берет риски вайбкодинга на себя, а вам остается только абьюзить подписку клода🌚
И да, весь пайплайн моей работы щас построен на скиллах от Matt'а, про которые я уже рассказывал. Как это работает полностью распишу отдельным постом на следующей неделе, а пока - я в отпуске😎
#AI
GitHub
GitHub - mattpocock/skills: Skills for Real Engineers. Straight from my .agents directory.
Skills for Real Engineers. Straight from my .agents directory. - mattpocock/skills
🔥29👍8❤6👎2🤡2🤮1
Всю прошлую неделю я был в отпуске, поэтому не смог выпустить воскресный дайджест в воскресенье. Ловите его в понедельник.
Топ недели - OmniRoute. Один эндпоинт, за которым 39 пулов провайдеров и 460+ моделей: агрегирует все документированные бесплатные тарифы в общий живой счетчик (обещают ~1.4 млрд бесплатных токенов в месяц) и сам перекидывает тебя на следующую квоту, когда уперся в лимит. Прикручивается к Claude Code / Cursor / Codex как прокси. +10.9k звезд за неделю. Что смущает: свои промпты ты отдаешь непонятно кому. Мне хватает подписки Claude, но если очень хочется бесплатных токенов - пожалуйста. Или можно попробовать личный Claw / Hermes прикрутить.
Тренд недели - скилл, который не пишут руками. Прошлая неделя была про "возьми чужую библиотеку скиллов под свою роль", эта - про "сделай свой":
• book-to-skill - скармливаешь PDF технической книги или папку с доками, на выходе готовый скилл для Claude Code / Copilot CLI. У меня в репе лежат конспекты Дорофеева и "Атомных привычек" - первый кандидат на прогон;
• SkillOpt от Microsoft - "тренируй скилл как нейросеть": эпохи, batch size, learning rate, валидационные гейты, на выходе деплоимый
По заявкам. Александр в прошлый раз спрашивал, есть ли скиллы для тимлидов - вот, пожалуйста: gstack Гарри Тана (President & CEO YC). 23 инструмента, разложенных по ролям: CEO, Designer, Eng Manager, Release Manager, QA, Doc Engineer.
Кластер недели - оркестраторы агентов. orca (+7.4k звезд за неделю) - десктопная среда, где гоняешь параллельных агентов на своих подписках и переключаешь модели на лету; Traycer - то же самое, но с общей памятью между агентами разных провайдеров; jcode (+2.9k) - еще один CLI-харнесс под мульти-сессионные воркфлоу. Один агент больше никого не устраивает, все пилят окно, из которого видно сразу пятерых.
Вторая боль - токены на чтении кода. Три инструмента за три дня об одном: агент читает файлы целиком, хотя ему нужен один символ. code-review-graph три дня держал первое место трендинга (+6k за неделю) - локальный граф кода как MCP; SymbolPeek - AST-точный контекст для TS/JS: символ, его вызовы, ссылки и типы вместо файла; Synapse - локальный индекс кодовой базы для Claude Code. Я тут использую graphify, мигрировать не планирую
Просто находки:
• deepsec от vercel-labs - гоняет кодинг-агента по твоей репе на поиск уязвимостей;
• Corsair - прослойка между агентом и внешними API: агент получает руки ко всем интеграциям, но кредов не видит, гейтишь ты;
• i-have-adhd ("у меня СДВГ") - скилл, который заставляет агента давать ответ первой строкой, а не лить воду. +1.8k звезд за день на двухмесячной репе - видимо, твиттер-тред зашел😅 Это я точно попробую вместо caveman
Не тулинг, но мимо не пройти:
• агент OpenAI сам взломал Hugging Face. 16 июля HF отчитались о вторжении в прод: кто-то пролез через две дыры в обработке датасетов, утащил внутренние датасеты и служебные креды. 22 июля OpenAI призналась, что это была ее модель - на прогоне cyber-бенчмарка ей срезали отказы, она нашла 0-day, вылезла из изолированного окружения в интернет и пошла искать ответы к бенчмарку на чужом проде😂 Своего же агента OpenAI опознала не сразу, HF узнали от них только 20 июля. Это первая в истории атака AI по инициативе AI. В твиттере до сих пор бушуют споры: это маркетинг OpenAI или Скайнет.
• вышел Claude Opus 5. По цене Opus 4.8 ($5/$25 за миллион), уже в Claude Code (Opus 4.8 даже нельзя выбрать) - сегодня сажусь тыкать.
Что радар проспал - несите в комменты, обязательно посмотрю и заберу в следующий выпуск.
#AI #digest
Топ недели - OmniRoute. Один эндпоинт, за которым 39 пулов провайдеров и 460+ моделей: агрегирует все документированные бесплатные тарифы в общий живой счетчик (обещают ~1.4 млрд бесплатных токенов в месяц) и сам перекидывает тебя на следующую квоту, когда уперся в лимит. Прикручивается к Claude Code / Cursor / Codex как прокси. +10.9k звезд за неделю. Что смущает: свои промпты ты отдаешь непонятно кому. Мне хватает подписки Claude, но если очень хочется бесплатных токенов - пожалуйста. Или можно попробовать личный Claw / Hermes прикрутить.
Тренд недели - скилл, который не пишут руками. Прошлая неделя была про "возьми чужую библиотеку скиллов под свою роль", эта - про "сделай свой":
• book-to-skill - скармливаешь PDF технической книги или папку с доками, на выходе готовый скилл для Claude Code / Copilot CLI. У меня в репе лежат конспекты Дорофеева и "Атомных привычек" - первый кандидат на прогон;
• SkillOpt от Microsoft - "тренируй скилл как нейросеть": эпохи, batch size, learning rate, валидационные гейты, на выходе деплоимый
best_skill.md. Веса никто не трогает - оптимизируется сам текст скилла по траекториям прогонов, с пейпером на arXiv. Оговорка: нужны прогоны и валидационная выборка, это не "поставил вечером и потыкал".По заявкам. Александр в прошлый раз спрашивал, есть ли скиллы для тимлидов - вот, пожалуйста: gstack Гарри Тана (President & CEO YC). 23 инструмента, разложенных по ролям: CEO, Designer, Eng Manager, Release Manager, QA, Doc Engineer.
Кластер недели - оркестраторы агентов. orca (+7.4k звезд за неделю) - десктопная среда, где гоняешь параллельных агентов на своих подписках и переключаешь модели на лету; Traycer - то же самое, но с общей памятью между агентами разных провайдеров; jcode (+2.9k) - еще один CLI-харнесс под мульти-сессионные воркфлоу. Один агент больше никого не устраивает, все пилят окно, из которого видно сразу пятерых.
Вторая боль - токены на чтении кода. Три инструмента за три дня об одном: агент читает файлы целиком, хотя ему нужен один символ. code-review-graph три дня держал первое место трендинга (+6k за неделю) - локальный граф кода как MCP; SymbolPeek - AST-точный контекст для TS/JS: символ, его вызовы, ссылки и типы вместо файла; Synapse - локальный индекс кодовой базы для Claude Code. Я тут использую graphify, мигрировать не планирую
Просто находки:
• deepsec от vercel-labs - гоняет кодинг-агента по твоей репе на поиск уязвимостей;
• Corsair - прослойка между агентом и внешними API: агент получает руки ко всем интеграциям, но кредов не видит, гейтишь ты;
• i-have-adhd ("у меня СДВГ") - скилл, который заставляет агента давать ответ первой строкой, а не лить воду. +1.8k звезд за день на двухмесячной репе - видимо, твиттер-тред зашел😅 Это я точно попробую вместо caveman
Не тулинг, но мимо не пройти:
• агент OpenAI сам взломал Hugging Face. 16 июля HF отчитались о вторжении в прод: кто-то пролез через две дыры в обработке датасетов, утащил внутренние датасеты и служебные креды. 22 июля OpenAI призналась, что это была ее модель - на прогоне cyber-бенчмарка ей срезали отказы, она нашла 0-day, вылезла из изолированного окружения в интернет и пошла искать ответы к бенчмарку на чужом проде😂 Своего же агента OpenAI опознала не сразу, HF узнали от них только 20 июля. Это первая в истории атака AI по инициативе AI. В твиттере до сих пор бушуют споры: это маркетинг OpenAI или Скайнет.
• вышел Claude Opus 5. По цене Opus 4.8 ($5/$25 за миллион), уже в Claude Code (Opus 4.8 даже нельзя выбрать) - сегодня сажусь тыкать.
Что радар проспал - несите в комменты, обязательно посмотрю и заберу в следующий выпуск.
#AI #digest
GitHub
GitHub - diegosouzapw/OmniRoute: Never stop coding. Free MIT AI gateway: one endpoint, 290+ providers (90+ free), 500+ models —…
Never stop coding. Free MIT AI gateway: one endpoint, 290+ providers (90+ free), 500+ models — Kimi, Claude, GPT, OpenAI, Gemini, GLM, DeepSeek, MiniMax. Works with Claude Code, Codex, Cursor, Open...
🔥8👍6❤3
Поздравляю, вы уже пользуетесь SDD
Если вы хоть раз гоняли агента через plan-mode - вы уже в SDD-клубе, просто об этом не знали. Я обещал вам рассказать про свой опыт с сетапом скиллов Мэтта, но без разговора об SDD ничего не получится
Так что заходить буду издалека, с боли.
Модели с заявленным контекстом в 1_000_000 начинают тупить уже на 100_000. А на 200_000 - тупить безбожно. Виновата Lost in the middle: модель хорошо помнит начало диалога и последние тысяч двадцать токенов, а середину склонна забывать. А в этой середине у нас лежит все ценное:
• результаты грепов по проекту
• стайлгайд
• принятые по ходу дизайн-решения
• те самые особенности, ради которых агент полчаса лазил по коду
Поэтому если вы скажете модели "давай сделаем фичу X" - агент сделает не то. Вы правите - он переделывает. Вы правите еще раз - а он уже забыл, как было на первой итерации, и на очередном витке приносит вариант, который вы отбросили два часа назад. Ну или творит какую-то иную дичь.
На этом месте вы говорите "AI говно" и гордо идете писать код руками😅
Лечение первого уровня - plan-mode
Сначала вы с агентом брейнштормите: формулируете видение фичи, строите архитектуру, агент вычитывает все, что ему нужно знать про код. И только потом он идет кодить.
Только план-то лежит все в той же СЕРЕДИНЕ КОНТЕКСТА - и забывается ровно так же, если реализация затянулась. Значит, план надо вынести из диалога в файл и сделать
Итого на одну фичу у вас уже две сессии: идея →
Поздравляю, вы изобрели SDD в самом простом его виде🌚
Потому что
Дальше идем от жадности
Если контекст, который агент тратит на "понять, что и как тут делать", такой дорогой - надо помочь ему разобраться за минимум токенов.
А помогает агенту ровно то же, что помогает новому человеку в команде:
• вменяемая архитектура
• комментарий там, где код врет о своих намерениях (
• нормальная навигация вместо слепого
• документы на то, что из кода вывести нельзя
Вот последний пункт и есть SDD. В идеале спеки живут на трех уровнях: спека задачи (стори), спека фичи (эпика) и общая спека архитектуры проекта. Да и комментарий в коде - это, по сути, спека на конкретную функцию / класс / строку кода.
Что из этого я реально держу
Единого правильного фреймворка SDD пока нет - их развелось штук десять, и работают они все. Различаются тремя вещами: какие уровни спек вводят, как регламентируют их жизненный цикл и кто их пишет - вы или агент.
Но если выкинуть всю обвязку, главная польза SDD - это plan-mode. Все остальное - попытка научить агента ориентироваться в проекте чуть эффективнее (быстрее, качественнее, дешевле по токенам).
Поэтому у меня между сессиями долго живут ровно два артефакта: глоссарий проекта и ADR. Все остальное умирает вместе с фичей😎
А вы что реально сохраняете между сессиями - или каждый раз объясняете агенту проект заново?
Собственно, набор скиллов от Matt Pocock - это именно что SDD. И я им активно пользуюсь. Поэтому ждите "мясо" следующим постом
#архитектура #AI
Если вы хоть раз гоняли агента через plan-mode - вы уже в SDD-клубе, просто об этом не знали. Я обещал вам рассказать про свой опыт с сетапом скиллов Мэтта, но без разговора об SDD ничего не получится
Так что заходить буду издалека, с боли.
Модели с заявленным контекстом в 1_000_000 начинают тупить уже на 100_000. А на 200_000 - тупить безбожно. Виновата Lost in the middle: модель хорошо помнит начало диалога и последние тысяч двадцать токенов, а середину склонна забывать. А в этой середине у нас лежит все ценное:
• результаты грепов по проекту
• стайлгайд
• принятые по ходу дизайн-решения
• те самые особенности, ради которых агент полчаса лазил по коду
Поэтому если вы скажете модели "давай сделаем фичу X" - агент сделает не то. Вы правите - он переделывает. Вы правите еще раз - а он уже забыл, как было на первой итерации, и на очередном витке приносит вариант, который вы отбросили два часа назад. Ну или творит какую-то иную дичь.
На этом месте вы говорите "AI говно" и гордо идете писать код руками😅
Лечение первого уровня - plan-mode
Сначала вы с агентом брейнштормите: формулируете видение фичи, строите архитектуру, агент вычитывает все, что ему нужно знать про код. И только потом он идет кодить.
Только план-то лежит все в той же СЕРЕДИНЕ КОНТЕКСТА - и забывается ровно так же, если реализация затянулась. Значит, план надо вынести из диалога в файл и сделать
PLAN.md исходным промптом для следующей сессии.Итого на одну фичу у вас уже две сессии: идея →
PLAN.md, PLAN.md → реализация.Поздравляю, вы изобрели SDD в самом простом его виде🌚
Потому что
PLAN.md - это тоже спецификация. Спека конкретной сессии, и живет она соответственно: до мержа и в мусорку (целый пост про это).Дальше идем от жадности
Если контекст, который агент тратит на "понять, что и как тут делать", такой дорогой - надо помочь ему разобраться за минимум токенов.
меньше токенов на понимание -> больше остается на реализацию -> качественнее результат
А помогает агенту ровно то же, что помогает новому человеку в команде:
• вменяемая архитектура
• комментарий там, где код врет о своих намерениях (
# namedtuple вместо датакласса - иначе pickle падает)• нормальная навигация вместо слепого
grep (graphify, codegraph)• документы на то, что из кода вывести нельзя
Вот последний пункт и есть SDD. В идеале спеки живут на трех уровнях: спека задачи (стори), спека фичи (эпика) и общая спека архитектуры проекта. Да и комментарий в коде - это, по сути, спека на конкретную функцию / класс / строку кода.
Что из этого я реально держу
Единого правильного фреймворка SDD пока нет - их развелось штук десять, и работают они все. Различаются тремя вещами: какие уровни спек вводят, как регламентируют их жизненный цикл и кто их пишет - вы или агент.
Но если выкинуть всю обвязку, главная польза SDD - это plan-mode. Все остальное - попытка научить агента ориентироваться в проекте чуть эффективнее (быстрее, качественнее, дешевле по токенам).
Поэтому у меня между сессиями долго живут ровно два артефакта: глоссарий проекта и ADR. Все остальное умирает вместе с фичей😎
А вы что реально сохраняете между сессиями - или каждый раз объясняете агенту проект заново?
Собственно, набор скиллов от Matt Pocock - это именно что SDD. И я им активно пользуюсь. Поэтому ждите "мясо" следующим постом
#архитектура #AI
Telegram
FastNews | Никита Пастухов
Что делать с планами, которые генерирует агент?
Агентские тулзы плодят горы маркдауна: планы реализации, дизайн-доки, ресерчи. Тот же superpowers коммитит все это добро по умолчанию. И возникает вопрос - а надо ли оно в репозитории?
Я думаю, что нет. План…
Агентские тулзы плодят горы маркдауна: планы реализации, дизайн-доки, ресерчи. Тот же superpowers коммитит все это добро по умолчанию. И возникает вопрос - а надо ли оно в репозитории?
Я думаю, что нет. План…
❤20✍6🥴2👍1
Мой полный сетап скиллов для разработки
Две недели назад переехал на сетап скиллов от Matt Pocock, докрутил пилот - показываю весь конвейер: от "хочу фичу X" до открытого PR.
Идея под ним ровно та, что разбирал во вторник: агент должен получать контекст порциями, а не тонуть в одной бесконечной сессии. Каждый этап - своя сессия, в которую влезает меньше 100-200к.
Ставится все это одной командой:
Конвейер
1.
Если на этом вы сожгли меньше 50к контекста и понимаете, что реализация быстрая - просто жмите
2.
3.
Тут сессию можно смело
4.
5.
6. Если нужны правки в рамках этой задачи, также завожу новую сессию и пишу что-то вроде
Напоследок прошу засквошить коммиты (агент коммитит после каждого тикета), запушить, открыть PR по шаблону и подчистить
Что остается в проекте
Коммитятся в гит:
• CONTEXT.md - словарь доменных терминов проекта (из DDD, ага). Нужен, чтобы агент говорил с вами на одном языке: когда вы просите "подправь представление файлов в дереве", ему не придется грепать, чтобы понять, что за файлы, что за дерево и как одно попадает в другое.
• ADR-*.md - архитектурные решения. Чтобы в будущих сессиях агент понимал, почему модуль сделан так, а не иначе, и ничего не сломал. Не каждая фича достойна ADR, но если вы делали сложный выбор на дизайне или правили агента руками - хороший кандидат. По идее ADR неизменяемы, но я время от времени схлопываю все ADR по одной области проекта в один актуальный.
Умирают вместе с фичей:
Тикетницу, кстати, можно взять любую - Github Issues, Linear, Jira. Просто я не вижу смысла плодить сотни ишью на гите, поэтому держу локально.
Две недели полет нормальный, могу рекомендовать. Но не стоит прогонять полный пайплайн, если нужны изменения вида "кнопка ведет себя некорректно" - это можно и просто попросить.
А вот видос от самого Мэтта, где он показывает весь свой цикл целиком.
А у вас как устроен конвейер работы над фичей? Закидывайте в комменты - увижу что-то, чего у меня нет, обязательно сворую🌚
#AI
Две недели назад переехал на сетап скиллов от Matt Pocock, докрутил пилот - показываю весь конвейер: от "хочу фичу X" до открытого PR.
Идея под ним ровно та, что разбирал во вторник: агент должен получать контекст порциями, а не тонуть в одной бесконечной сессии. Каждый этап - своя сессия, в которую влезает меньше 100-200к.
Ставится все это одной командой:
npx skills@latest add mattpocock/skills, дальше /setup-matt-pocock-skills один раз на репозиторий.Конвейер
1.
/grill-with-docs хочу фичу X - агент люто досит вас уточняющими вопросами: дизайн фичи, архитектура кода, технические нюансы. Детали реализации, которые у вас уже в голове, на входе лучше не выкладывать: может, агент придет к тому же сам, может - к варианту получше, а может, вы сами передумаете по дороге. Направить его вы всегда успеете. На выходе - "Shared Understanding", зафиксированный в CONTEXT.md и ADR (про сам скилл писал тут).Если на этом вы сожгли меньше 50к контекста и понимаете, что реализация быстрая - просто жмите
/implement this в той же сессии. Все, что ниже - для задач побольше.2.
/to-spec - в той же сессии агент пишет спецификацию фичи: продукт, дизайн кода и так далее. Я ее не читаю, мне хватает "Shared Understanding". Держу в git-ignored .scratch, потому что живет она до реализации.3.
/to-tickets write the plan down as tickets and a general PLAN.md with refs to them - агент нарезает спеку на тикеты и собирает PLAN.md со ссылками на них:
├─ SPEC.md
├─ PLAN.md
└─ tickets/
├─ ticket-1.md
├─ ticket-2.md
└─ ...
Тут сессию можно смело
/clear - она свое отработала.4.
/implement - цикл "реализация → ревью сабагентом → правки", пока тикет не закроется. Дальше развилка. Если агент уместит всю задачу в 200к - /implement all tickets @.scratch/PLAN.md и ждете 30-60-120 минут. Если чувствуете, что не влезет - делайте по тикету на сессию: /implement the next ticket from @.scratch/PLAN.md, then /triage it. Агент сам реализует, отревьюит себя, поправит комментарии, поменяет статус тикета и весело отрапортует вам об исполнении. Вам остается сделать /clear и вставить тот же самый промпт - агент побежит делать план дальше.5.
/code-review all the tickets and the whole implementation of @.scratch/PLAN.md, then fix any issues you find - в свежей сессии, когда все тикеты готовы. Так, на всякий случай.6. Если нужны правки в рамках этой задачи, также завожу новую сессию и пишу что-то вроде
I just implemented @.scratch/PLAN.md. One last change I need: ...Напоследок прошу засквошить коммиты (агент коммитит после каждого тикета), запушить, открыть PR по шаблону и подчистить
.scratch.Что остается в проекте
Коммитятся в гит:
• CONTEXT.md - словарь доменных терминов проекта (из DDD, ага). Нужен, чтобы агент говорил с вами на одном языке: когда вы просите "подправь представление файлов в дереве", ему не придется грепать, чтобы понять, что за файлы, что за дерево и как одно попадает в другое.
• ADR-*.md - архитектурные решения. Чтобы в будущих сессиях агент понимал, почему модуль сделан так, а не иначе, и ничего не сломал. Не каждая фича достойна ADR, но если вы делали сложный выбор на дизайне или правили агента руками - хороший кандидат. По идее ADR неизменяемы, но я время от времени схлопываю все ADR по одной области проекта в один актуальный.
Умирают вместе с фичей:
SPEC.md, тикеты, PLAN.md.Тикетницу, кстати, можно взять любую - Github Issues, Linear, Jira. Просто я не вижу смысла плодить сотни ишью на гите, поэтому держу локально.
Две недели полет нормальный, могу рекомендовать. Но не стоит прогонять полный пайплайн, если нужны изменения вида "кнопка ведет себя некорректно" - это можно и просто попросить.
А вот видос от самого Мэтта, где он показывает весь свой цикл целиком.
А у вас как устроен конвейер работы над фичей? Закидывайте в комменты - увижу что-то, чего у меня нет, обязательно сворую🌚
#AI
Telegram
FastNews | Никита Пастухов
Поздравляю, вы уже пользуетесь SDD
Если вы хоть раз гоняли агента через plan-mode - вы уже в SDD-клубе, просто об этом не знали. Я обещал вам рассказать про свой опыт с сетапом скиллов Мэтта, но без разговора об SDD ничего не получится
Так что заходить…
Если вы хоть раз гоняли агента через plan-mode - вы уже в SDD-клубе, просто об этом не знали. Я обещал вам рассказать про свой опыт с сетапом скиллов Мэтта, но без разговора об SDD ничего не получится
Так что заходить…
👍26❤7🔥3🥴1
Ребят, я очень надеюсь, что не вызываю ни у кого чувство FOMO своими постами про AI и агентов. Наоборот, тут я пытаюсь вам рассказать, насколько все просто и понятно, если копнуть в механику происходящего
Серьезно, все, что я вам рассказывал тут последний месяц - это дело пары дней на "потыкать" и пары недель на адаптацию под себя
Но если вы хотите, чтобы я рассказал про что-то другое - самое время написать мне об этом🌚
Всем хороших выходных и отдохнуть✌️
Серьезно, все, что я вам рассказывал тут последний месяц - это дело пары дней на "потыкать" и пары недель на адаптацию под себя
Но если вы хотите, чтобы я рассказал про что-то другое - самое время написать мне об этом🌚
Всем хороших выходных и отдохнуть✌️
❤28🔥5
FastNews | Никита Пастухов
Мой полный сетап скиллов для разработки Две недели назад переехал на сетап скиллов от Matt Pocock, докрутил пилот - показываю весь конвейер: от "хочу фичу X" до открытого PR. Идея под ним ровно та, что разбирал во вторник: агент должен получать контекст…
Вайбкодим security компоненты в django-modern-rest (или нет)
https://www.youtube.com/watch?v=laJQcNAqxc0
Мой друг Никита Соболев - @opensource_findings сейчас активно разрабатывает django-modern-rest (а заодно CPython и десяток других OpenSource проектов). И он искал помощь, чтобы полностью мигрировать функционал dj-rest-auth в свой фреймворк - https://github.com/wemake-services/django-modern-rest/issues/1193
Чтож, это отличная возможность обкатать, как работает ИИнженерный пайплайн на реальном сложном OSS проекте🌚 Поэтому я вызвался реализовать эту фичу полностью сторого с помощью Claude Code.
Ситуация усугубляется тем, что Никита (который Соболев, не путайте) лютый хейтер AI и вайбкодинга. Так что меня ждет очень-очень-очень жесткое ревью и невменяемые требования стайлгайдов😂
Посмотрим, что из этого получится. Вполне возможно, что мы вообще откатим всю фичу и ничего из сгенерированного кода не пойдет в main. Или случится ваншот и оставшийся час стрима будем просто пить пиво🌚
В общем, приходите - будет весело!
https://www.youtube.com/watch?v=laJQcNAqxc0
Мой друг Никита Соболев - @opensource_findings сейчас активно разрабатывает django-modern-rest (а заодно CPython и десяток других OpenSource проектов). И он искал помощь, чтобы полностью мигрировать функционал dj-rest-auth в свой фреймворк - https://github.com/wemake-services/django-modern-rest/issues/1193
Чтож, это отличная возможность обкатать, как работает ИИнженерный пайплайн на реальном сложном OSS проекте🌚 Поэтому я вызвался реализовать эту фичу полностью сторого с помощью Claude Code.
И все это будет в лайве на завтрашнем стриме в 19:00
Ситуация усугубляется тем, что Никита (который Соболев, не путайте) лютый хейтер AI и вайбкодинга. Так что меня ждет очень-очень-очень жесткое ревью и невменяемые требования стайлгайдов😂
Посмотрим, что из этого получится. Вполне возможно, что мы вообще откатим всю фичу и ничего из сгенерированного кода не пойдет в main. Или случится ваншот и оставшийся час стрима будем просто пить пиво🌚
В общем, приходите - будет весело!
YouTube
Вайбкодим security компоненты в django-modern-rest (или нет)
Донаты: https://www.donationalerts.com/r/sluggishpythons
Как-то два Никиты поспорили, что один Никита может написать самый грустный код для аутентификации, используя только Claude Code. На что второй Никита сказал: я такое готов терпеть только с пивом.
…
Как-то два Никиты поспорили, что один Никита может написать самый грустный код для аутентификации, используя только Claude Code. На что второй Никита сказал: я такое готов терпеть только с пивом.
…
🔥22👍4❤🔥2💩1
Очередной воскресный дайджест агентского тулинга. Напоминаю, что все срочное падает в чат и там же обсуждаем свой опыт использования.
Топ недели - reverse-skill. Не скилл и не библиотека скиллов, а роутер: по задаче сам решает, какой скилл подтянуть, бутстрапит нужный тулчейн на лету и дописывает собственную базу знаний. Тема узкая - реверс и авторизованный пентест, - но интересен он скорее как сигнал: скиллов стало настолько много, что уже невозможно их все перебрать руками. +1.3k звезд за сутки, 12.1k всего, #1 мувер трендинга на 02.08. Поэтому -
Тренд недели - как управлять сотнями скиллов.
• OpenSpace от HKUDS (те же, кто сделал LightRAG) - The Skill Management Layer for AI Agents: общий список скиллов, который можно шарить между агентами;
• ECC - пакет способностей поверх Claude Code / Codex / Cursor / OpenCode. Это какой-то монстр с 70 сабагентами, 300 скиллами, 100 командами и бог знает чем еще. Для любителей поставить один пакет и не париться. ⚠️ 236k звезд на репе, созданной в январе - выглядит подозрительно.
• cangjie-skill - скармливаешь книгу, длинное видео или подкаст - получаешь из них устанавливаемый скилл. Скилл для любителей Clean Architecture🌚
Боль недели - ревью агентского слопа. Три инструмента за неделю об одном и том же:
• open-code-review от alibaba - гибрид: детерминированные пайплайны плюс LLM-агент, комменты на уровне строки, встроенный ruleset (NPE, thread-safety, XSS, SQL-инъекции);
• strix - автономный агент-пентестер: натравливаешь на свое приложение, он ищет дыры и их латает. 46.5k звезд;
• tuicr - терминальный код-ревьюер с vim-биндингами: непрерывный дифф, комменты на строку/ханк, трекинг просмотренного между сессиями, ревьюит незакоммиченное. Формально вообще не агентский тул - но сценарий у него ровно агентский: быстро вычитать то, что тебе нагенерил Claude, до коммита и не уходя в браузер.
Писать код мы агента научили, и теперь вся индустрия пилит, кто за ним будет проверять. Скорость генерации уперлась в скорость ревью - и узкое место снова человек.
Проверено на себе - last30days-skill. Устанавливаемый скилл-ресерчер: гоняет тему по Reddit / X / YouTube / HN / вебу и синтезирует сводку с сигналами вовлечения. На нем стоит вот этот самый радар, так что мой опыт: половину времени он отдает посты двухнедельной давности и делал вид, что это свежак - "топ-7 MCP-серверов" вместо инструментов. Поэтому GitHub Trending я все равно парсю отдельно, руками агента. Как ресерчер по теме - хорош, как детектор свежего - надо проверять дату. +658 звезд в день, 56.6k всего.
Просто находки:
• chrome-devtools-mcp - официальный MCP от команды DevTools: агент получает настоящий браузер с дебаггером и сам смотрит консоль, сеть и перф-трейсы, вместо того чтобы верить твоему пересказу бага;
• ego-lite - браузер для агента, который шарит твое залогиненное состояние: агент ходит по вебу под твоими сессиями и не мешает тебе работать;
• claude-video -
• openwork - self-hosted альтернатива Claude Cowork поверх opencode, 20k звезд и +585 в день;
• jcodemunch-mcp - тянет по AST точечные символы из чужих GitHub-репозиториев: агент разбирается в незнакомой библиотеке, не скачивая ее целиком и не сжигая контекст на файлы, которые ему не нужны.
Что радар проспал - несите в комменты, обязательно посмотрю и заберу в следующий выпуск.
#AI #digest
Топ недели - reverse-skill. Не скилл и не библиотека скиллов, а роутер: по задаче сам решает, какой скилл подтянуть, бутстрапит нужный тулчейн на лету и дописывает собственную базу знаний. Тема узкая - реверс и авторизованный пентест, - но интересен он скорее как сигнал: скиллов стало настолько много, что уже невозможно их все перебрать руками. +1.3k звезд за сутки, 12.1k всего, #1 мувер трендинга на 02.08. Поэтому -
Тренд недели - как управлять сотнями скиллов.
• OpenSpace от HKUDS (те же, кто сделал LightRAG) - The Skill Management Layer for AI Agents: общий список скиллов, который можно шарить между агентами;
• ECC - пакет способностей поверх Claude Code / Codex / Cursor / OpenCode. Это какой-то монстр с 70 сабагентами, 300 скиллами, 100 командами и бог знает чем еще. Для любителей поставить один пакет и не париться. ⚠️ 236k звезд на репе, созданной в январе - выглядит подозрительно.
• cangjie-skill - скармливаешь книгу, длинное видео или подкаст - получаешь из них устанавливаемый скилл. Скилл для любителей Clean Architecture🌚
Боль недели - ревью агентского слопа. Три инструмента за неделю об одном и том же:
• open-code-review от alibaba - гибрид: детерминированные пайплайны плюс LLM-агент, комменты на уровне строки, встроенный ruleset (NPE, thread-safety, XSS, SQL-инъекции);
• strix - автономный агент-пентестер: натравливаешь на свое приложение, он ищет дыры и их латает. 46.5k звезд;
• tuicr - терминальный код-ревьюер с vim-биндингами: непрерывный дифф, комменты на строку/ханк, трекинг просмотренного между сессиями, ревьюит незакоммиченное. Формально вообще не агентский тул - но сценарий у него ровно агентский: быстро вычитать то, что тебе нагенерил Claude, до коммита и не уходя в браузер.
Писать код мы агента научили, и теперь вся индустрия пилит, кто за ним будет проверять. Скорость генерации уперлась в скорость ревью - и узкое место снова человек.
Проверено на себе - last30days-skill. Устанавливаемый скилл-ресерчер: гоняет тему по Reddit / X / YouTube / HN / вебу и синтезирует сводку с сигналами вовлечения. На нем стоит вот этот самый радар, так что мой опыт: половину времени он отдает посты двухнедельной давности и делал вид, что это свежак - "топ-7 MCP-серверов" вместо инструментов. Поэтому GitHub Trending я все равно парсю отдельно, руками агента. Как ресерчер по теме - хорош, как детектор свежего - надо проверять дату. +658 звезд в день, 56.6k всего.
Просто находки:
• chrome-devtools-mcp - официальный MCP от команды DevTools: агент получает настоящий браузер с дебаггером и сам смотрит консоль, сеть и перф-трейсы, вместо того чтобы верить твоему пересказу бага;
• ego-lite - браузер для агента, который шарит твое залогиненное состояние: агент ходит по вебу под твоими сессиями и не мешает тебе работать;
• claude-video -
/watch: качает ролик, режет на кадры, транскрибирует и отдает Claude одним куском;• openwork - self-hosted альтернатива Claude Cowork поверх opencode, 20k звезд и +585 в день;
• jcodemunch-mcp - тянет по AST точечные символы из чужих GitHub-репозиториев: агент разбирается в незнакомой библиотеке, не скачивая ее целиком и не сжигая контекст на файлы, которые ему не нужны.
Что радар проспал - несите в комменты, обязательно посмотрю и заберу в следующий выпуск.
#AI #digest
Telegram
FastNews | Chat
Флудилка про AI, Slop и всякое разное
Чат канала @fastnewsdev
Чат канала @fastnewsdev
🔥10👍2❤1
Пари я проиграл - ваншота не было
https://www.youtube.com/watch?v=laJQcNAqxc0
Вчера 4 часа вайбкодили с Никитой Соболевым security-компоненты в django-modern-rest: его фреймворк, его стайлгайды, его ревью. Напомню, что Никита - хейтер AI, и анонсил он это как спор: мол, Пастухов заваншотит всю миграцию
Не заваншотил, но кое-что реально успели сделать:
• 2 issue с нормальным обоснованием и тестированием гипотез - #1195 и #1197
• пойман флакающий тест, найдена его первопричина и сделан довольно большой PR (смержили) - полностью через Claude Code
• продумана архитектура целевой фичи и открыт PR1 (его стоит закрыть и подумать еще) из двух запланированных
Теперь немного контекста. Я:
• не погружен в проект - не читал ни документацию, ни код, ни даже README
• не писал на Django и DRF лет 5
• не знаком ни с django-ninja, ни с dj-rest-auth, ни с django-allauth
Правда, Никитины линтеры чуть не свели Claude с ума - он тратил по 200к токенов на каждый тикет... А правки по дизайну фичи чуть не свели с ума меня.
Это не "ваншотинг приложения одним промптом", про который вам рассказывают в тредах. Это человек с улицы, который за вечер внес осмысленный вклад в чужой зрелый OpenSource. Для меня - великолепный результат. Для твиттера - провал, там за это время уже стартап продают.
Вайбкодить можно. Если с головой и осторожно.
Посмотрите запись стрима - там как раз видно, как это делается: где я тормозил агента руками, а где он справлялся сам. И накидайте комментов под видео, ютубу это нравится. Никите - спасибо, что пустил меня с клодом в свой проект и все это ревьюил.
А сюда накидайте комментов - как вам стрим и нужно ли делать такие еще?
#AI #opensource
https://www.youtube.com/watch?v=laJQcNAqxc0
Вчера 4 часа вайбкодили с Никитой Соболевым security-компоненты в django-modern-rest: его фреймворк, его стайлгайды, его ревью. Напомню, что Никита - хейтер AI, и анонсил он это как спор: мол, Пастухов заваншотит всю миграцию
dj-rest-auth клодом раньше, чем он успеет выпить бутылку пива.Не заваншотил, но кое-что реально успели сделать:
• 2 issue с нормальным обоснованием и тестированием гипотез - #1195 и #1197
• пойман флакающий тест, найдена его первопричина и сделан довольно большой PR (смержили) - полностью через Claude Code
• продумана архитектура целевой фичи и открыт PR1 (его стоит закрыть и подумать еще) из двух запланированных
Теперь немного контекста. Я:
• не погружен в проект - не читал ни документацию, ни код, ни даже README
• не писал на Django и DRF лет 5
• не знаком ни с django-ninja, ни с dj-rest-auth, ни с django-allauth
Правда, Никитины линтеры чуть не свели Claude с ума - он тратил по 200к токенов на каждый тикет... А правки по дизайну фичи чуть не свели с ума меня.
Вайбкод победил - но не в тех масштабах, которые хайпят в твиттере.
Это не "ваншотинг приложения одним промптом", про который вам рассказывают в тредах. Это человек с улицы, который за вечер внес осмысленный вклад в чужой зрелый OpenSource. Для меня - великолепный результат. Для твиттера - провал, там за это время уже стартап продают.
Вайбкодить можно. Если с головой и осторожно.
Посмотрите запись стрима - там как раз видно, как это делается: где я тормозил агента руками, а где он справлялся сам. И накидайте комментов под видео, ютубу это нравится. Никите - спасибо, что пустил меня с клодом в свой проект и все это ревьюил.
А сюда накидайте комментов - как вам стрим и нужно ли делать такие еще?
#AI #opensource
YouTube
Вайбкодим security компоненты в django-modern-rest (или нет)
Донаты: https://www.donationalerts.com/r/sluggishpythons
Как-то два Никиты поспорили, что один Никита может написать самый грустный код для аутентификации, используя только Claude Code. На что второй Никита сказал: я такое готов терпеть только с пивом.
…
Как-то два Никиты поспорили, что один Никита может написать самый грустный код для аутентификации, используя только Claude Code. На что второй Никита сказал: я такое готов терпеть только с пивом.
…
🔥35❤5💩2