FastNews | Никита Пастухов
1.5K subscribers
107 photos
4 videos
1 file
202 links
Welcome! Я - Никита Пастухов: автор FastStream, AG2 и просто разработчик

Здесь я пишу обо всем, что мне интересно

Чатик: @fastnewsdev_chat
Чатик по FastStream: @python_faststream
Мой GitHub: https://github.com/Lancetnik
Download Telegram
FastNews | Никита Пастухов
Channel photo updated
Все, теперь я признаю, что анонимный канал у меня не получился - пусть будет персональный блог

Контент не поменяется. Просто называю вещи своими именами😅
😁22👍62🍓2
Как я выбил свою фамилию в международный авард

Короткая история про то, что требовать свое - это рабочий навык.

В 2023 году FastStream попал в список 100 Best OSS Projects 2023 от BenchCouncil. Это до сих пор мое самое крутое внешнее признание проекта - реальный международный авард, а не просто звездочки на гитхабе.

Теперь могу понтоваться этой бумажкой😎

Но изначально на ней были отмечены 2 человека: CEO и CTO airt (компания, в которой проект тогда жил), а меня не было. Это при том, что код писал я, документацию писал я, маркетинг тащил я, релизы делал я. Компания была просто владельцем проекта.

Я пошел к CTO с вопросом: "а где моя фамилия?"

Ответ был классический: "ну, видимо, BenchCouncil так оформил, я не знаю"🤷‍♂️

Дальше можно было пойти двумя путями:

• расстроиться, написать в твиттер пассивно-агрессивный тред в стиле "ну вот так у нас" и забыть
• потребовать у компании написать в комитет и добавить мою фамилию

Я выбрал второй. На следующий день моя фамилия там появилась - просто потому что я попросил.

Чему меня этот случай научил:

Признание не приходит само. Награды, статусы и упоминания по дефолту раздаются тем, кто формально сверху. Если хотите, чтобы ваш вклад увидели - о нем надо сказать самому. Вслух.
За спрос не бьют. В худшем случае скажут "нет" - и вы остаетесь в той же точке. В лучшем - ваша фамилия появляется в международном аварде.
Молчание стоит дороже всего. Через 5 лет никто не вспомнит, кто "делал большую часть проекта". Запомнят только то, что зафиксировано - на сайте премии, в README, в шапке статьи.

К слову, это правило одинаково работает с зарплатой, авторством статей, упоминанием в чужих докладах и кредитом за фичу в релиз-ноутах. Спрашивать неловко 5 минут - а молчать обидно годами.

Расскажите в комментах: что вы выбили, просто попросив, - и за что обидно, что промолчали и отсиделись?

#opensource #карьера
1🔥39👍148❤‍🔥2🏆1
Наконец-то я запустил AG2-Assistant, который у нас в разработке (руки дошли). Этакий аналог Hermes / OpenClaw

У ребят довольно неплохо получилось, но у меня все еще 100500 замечаний по UX🌚

Щас лимиты на Claude откатятся - и пойду переделывать половину проекта😅

Релиз запланирован на следующей неделе - вместе с AG2 1.0.0

А пока - мигрирую все свои рабочие Hermes / Claude Cowork пайплайны на этого ассистента. Посмотрим, что из этого получится
👍11🤡5🔥42💅2
Периодически я закидываю в канал новые skills для агентов - для дизайна, SDD, свои собственные. Большую часть из них я пробую сам, но результаты этого тестирования обсуждаем в основном в чатике. Исправляю это недоразумение - поделюсь личным сетапом скиллов, которым пользуюсь каждый день:

grill-with-docs - 10/10, мой топ
​ Заставляет агента мучать тебя вопросами, пока не выудит все нюансы задачи, - и только потом оформляет решение в ADR и идет кодить. Еще он ведет CONTEXT.md - глоссарий проекта. Через пару сеансов вы с агентом говорите на одном языке и понимаете друг друга с полуслова. Юзаю буквально на всех проектах. Если ставить ровно один скилл - ставьте этот.

superpowers - рабочая лошадка, но с оговоркой
​ PLAN-мод, TDD, наводящие вопросы перед задачей - все, как я люблю. 250к+ звезд на гите не на пустом месте, могу рекомендовать. Одно бесит: по дефолту он коммитит в репозиторий все планы и ресерчи, что нагенерил. А план - промежуточный артефакт, ему место в мусорке после мержа, не в гит-истории (целый пост про это). И реализацию с сабагентами я тоже частенько выключаю - пусть лучше один агент шуршит. Но в целом, скилл - огонь

codegraph - это не скилл, а MCP, но его я тоже могу рекомендовать
​ Строит граф всего кода проекта на основе AST через tree-sitter - символы, вызовы, зависимости. Агент вместо слепого grep спрашивает точечно: кто вызывает эту функцию, что сломается, если поменять вот это, покажи сигнатуру - и получает структурный ответ за миллисекунды, не сжигая контекст на чтение половины репозитория. Штука рабочая, мне нравится. Хотя сейчас хочу попробовать еще Graphify

rtk - использую, но по мелочи
​ Якобы он экономит токены на CLI вызовах: прогоняет команду через себя и отдает агенту сжатый вывод вместо простыней. У меня прижился узко - git-команды, всякие ls / wc и прочая мелочевка, где вывод жирный, а нужного в нем три строки. На вызовах тестов (он все время норовит завернуть pytest в себя) надо отключать, там он только вредит. Не революция, но контекст бережет.

⚠️НА ЭТОМ МОЙ СПИСОК КОНЧИЛСЯ!⚠️

Я стараюсь минимизировать набор скиллов, MCP и прочего мусора в проекте - чем меньше у агента опций, тем лучше он фокусируется на конкретной задаче. Поэтому скилл должен быть действительно хорош, чтобы попасть в мой шорт-лист

Но я пробовал и другие хайповые штуки:

taste-skill - пилот пройден, но надо смотреть еще
​ Скилл обещает привить агенту дизайнерский вкус (самый популярный из скиллов этой категории). Проверял на своем сайте: агент сам придумал три концепции - и выглядит более-менее прилично, но слоп все равно прослеживается. Работает скилл или это заслуга Opus 4.8 - до конца не понял. Но результат зашел, буду тестировать при возможности еще.

ponytail - попробовал, ноль эффекта. Хотя на GitHub уже 80k+ звезд...
​ Скилл форсит агента лениться: думать как самый ленивый синьор в команде, "лучший код - тот, который ты не написал". На моих проектах скилл не поменял вообще ничего. Видимо, я и так уже самый ленивый синьор в комнате 🌚

caveman - пробовал пару раз, не зашло
​ Скилл заставляет модель общаться с тобой как пещерный человек: "Моя сделать, готово". Заявлена экономия 60% токенов, но на деле экономит только 8%. Кто-то в чате писал, что так просто удобнее читать вывод агента. Для меня оно того не стоит

Если у вас есть какие-нибудь прикольные скиллы на пробу - закидывайте в комменты, обязательно посмотрю! Мб что-нибудь сворую🌚

#AI
14👍4😢1🍓1👀1
За AI-тулингом невозможно следить руками, поэтому поднял себе радар: агент раз в день прочесывает GitHub Trending, Reddit, X и HN в поисках нового тулинга для кодинг-агентов - скиллы, MCP-серверы, CLI. Если это что-то стоящее - кидаю в канал. Но стоящего в последнее время много, поэтому предлагаю новый формат:

• по воскресеньям закидываю в канал дайджест за неделю
• если что-то стоящее появляется день в день - я кидаю это в чат

На этой неделе:

Топ недели - hallmark. Анти-AI-slop скилл для дизайна: ставишь в Claude Code / Cursor - агент перестает лепить фиолетовые градиенты. Неделю назад у репы было 4.6k звезд, к субботе - 12.4k🤯, на пике +3.4k за день. Та же ниша, что у taste-skill, который я гонял на своем сайте - положил в бэклог сравнить.

Тренд недели - "скилл-библиотека под роль". Matt Pocock выложил свою рабочую .claude-директорию как skills for real engineers (+2k звезд в день на пике) - я сам ей активно пользуюсь. Следом - маркетинг, дизайн-инженерия, и даже Google подтянул android/skills. Скиллы больше не шерят поштучно - выкладывают целые сетапы под профессию.

Боль недели - память. Шесть инструментов за семь дней об одном и том же: "агент забывает все между сессиями". Ditto майнит твои локальные логи Claude Code в профиль "как ты работаешь" и подгружает его перед каждой задачей. elim-mcp хранит негативное знание - что агент уже пробовал и отбросил, чтобы не ходить по кругу. Плюс Engram, Selvedge, Ravel и Perseus Vault. Когда шесть человек независимо пилят одно и то же🤷‍♂️

Вторая боль - страховка от агента с руками. dcg блокирует деструктивные git/shell-команды до исполнения, Confessor показывает, какие приватные файлы агент успел прочитать за сессию, Ripple - CI-gate на границы правки: просил тронуть одну функцию - отрефакторил три файла, лови. Тоже кластер: пять штук за неделю.

Просто находки:
wigolo - локальный веб-поисковик для агента: поиск, fetch, crawl без API-ключей и без оплаты за запрос;
Mindwalk - реплей сессии агента на 3D-карте кодовой базы: видно, где он "ходил" и что трогал. (Тул специально для Коли🌚)

Сам из этого пока ничего не внедрил - только собрал. Первыми потыкаю hallmark и wigolo, отпишусь в чат.

Если радар что-то проспал - несите в комменты, годное попадет в следующий выпуск. И давайте проголосуем, нужны ли такие дайджесты вообще: ставим пальцы 🙂 / 👎

#AI #digest
Please open Telegram to view this post
VIEW IN TELEGRAM
👍20🔥32👎1😁1🤡1🥴1
Я сейчас в отпуске и для души делаю проект с полным вайбкодингом по 10 часов в день (развлечения разрабов🥲) - даже в код не заглядываю. И наконец-то понял, почему все вайбкодеры подсаживаются на этот КАЙФ😁

Сидишь, 30-40 минут дизайнишь фичу, а потом даешь отмашку агенту - и он 2 часа пыхтит не переставая. Сам себя ревьюит, правит, бьет себя по рукам за нарушение стайлгайда. Тебе остается только подойти, когда все готово и сделать еще пару сессий на правку мелких багфиксов / доделок, если где промахнулись по вижену. В общем, из 4 часов времени ты активно что-то делаешь час от силы. Т.е. мои 10 часов - это 2 часа реального времени, когда я сижу около ноута. Остальное время - твое. Я вот, например, сейчас за городом - поэтому пока клод пишет код, я таскаю кирпичи, замешиваю цемент и тд (тут нас еще не заменили🫡)

Кто-то залипает в тикток / инсту, кто-то читает книги, кто-то занимается спортом. В общем - это реальная возможность жить свою лучшую жизнь и шипить фичи одновременно. Осталось только научиться закрывать глаза на качество кода🌚

Мой вердикт - каждому надо попробовать сделать такой проект для души. А еще лучше - найти работодателя, который берет риски вайбкодинга на себя, а вам остается только абьюзить подписку клода🌚

И да, весь пайплайн моей работы щас построен на скиллах от Matt'а, про которые я уже рассказывал. Как это работает полностью распишу отдельным постом на следующей неделе, а пока - я в отпуске😎

#AI
🔥29👍86👎2🤡2🤮1
Всю прошлую неделю я был в отпуске, поэтому не смог выпустить воскресный дайджест в воскресенье. Ловите его в понедельник.

Топ недели - OmniRoute. Один эндпоинт, за которым 39 пулов провайдеров и 460+ моделей: агрегирует все документированные бесплатные тарифы в общий живой счетчик (обещают ~1.4 млрд бесплатных токенов в месяц) и сам перекидывает тебя на следующую квоту, когда уперся в лимит. Прикручивается к Claude Code / Cursor / Codex как прокси. +10.9k звезд за неделю. Что смущает: свои промпты ты отдаешь непонятно кому. Мне хватает подписки Claude, но если очень хочется бесплатных токенов - пожалуйста. Или можно попробовать личный Claw / Hermes прикрутить.

Тренд недели - скилл, который не пишут руками. Прошлая неделя была про "возьми чужую библиотеку скиллов под свою роль", эта - про "сделай свой":

book-to-skill - скармливаешь PDF технической книги или папку с доками, на выходе готовый скилл для Claude Code / Copilot CLI. У меня в репе лежат конспекты Дорофеева и "Атомных привычек" - первый кандидат на прогон;
SkillOpt от Microsoft - "тренируй скилл как нейросеть": эпохи, batch size, learning rate, валидационные гейты, на выходе деплоимый best_skill.md. Веса никто не трогает - оптимизируется сам текст скилла по траекториям прогонов, с пейпером на arXiv. Оговорка: нужны прогоны и валидационная выборка, это не "поставил вечером и потыкал".

По заявкам. Александр в прошлый раз спрашивал, есть ли скиллы для тимлидов - вот, пожалуйста: gstack Гарри Тана (President & CEO YC). 23 инструмента, разложенных по ролям: CEO, Designer, Eng Manager, Release Manager, QA, Doc Engineer.

Кластер недели - оркестраторы агентов. orca (+7.4k звезд за неделю) - десктопная среда, где гоняешь параллельных агентов на своих подписках и переключаешь модели на лету; Traycer - то же самое, но с общей памятью между агентами разных провайдеров; jcode (+2.9k) - еще один CLI-харнесс под мульти-сессионные воркфлоу. Один агент больше никого не устраивает, все пилят окно, из которого видно сразу пятерых.

Вторая боль - токены на чтении кода. Три инструмента за три дня об одном: агент читает файлы целиком, хотя ему нужен один символ. code-review-graph три дня держал первое место трендинга (+6k за неделю) - локальный граф кода как MCP; SymbolPeek - AST-точный контекст для TS/JS: символ, его вызовы, ссылки и типы вместо файла; Synapse - локальный индекс кодовой базы для Claude Code. Я тут использую graphify, мигрировать не планирую

Просто находки:

deepsec от vercel-labs - гоняет кодинг-агента по твоей репе на поиск уязвимостей;
Corsair - прослойка между агентом и внешними API: агент получает руки ко всем интеграциям, но кредов не видит, гейтишь ты;
i-have-adhd ("у меня СДВГ") - скилл, который заставляет агента давать ответ первой строкой, а не лить воду. +1.8k звезд за день на двухмесячной репе - видимо, твиттер-тред зашел😅 Это я точно попробую вместо caveman

Не тулинг, но мимо не пройти:

агент OpenAI сам взломал Hugging Face. 16 июля HF отчитались о вторжении в прод: кто-то пролез через две дыры в обработке датасетов, утащил внутренние датасеты и служебные креды. 22 июля OpenAI призналась, что это была ее модель - на прогоне cyber-бенчмарка ей срезали отказы, она нашла 0-day, вылезла из изолированного окружения в интернет и пошла искать ответы к бенчмарку на чужом проде😂 Своего же агента OpenAI опознала не сразу, HF узнали от них только 20 июля. Это первая в истории атака AI по инициативе AI. В твиттере до сих пор бушуют споры: это маркетинг OpenAI или Скайнет.
вышел Claude Opus 5. По цене Opus 4.8 ($5/$25 за миллион), уже в Claude Code (Opus 4.8 даже нельзя выбрать) - сегодня сажусь тыкать.

Что радар проспал - несите в комменты, обязательно посмотрю и заберу в следующий выпуск.

#AI #digest
🔥8👍63
Поздравляю, вы уже пользуетесь SDD

Если вы хоть раз гоняли агента через plan-mode - вы уже в SDD-клубе, просто об этом не знали. Я обещал вам рассказать про свой опыт с сетапом скиллов Мэтта, но без разговора об SDD ничего не получится

Так что заходить буду издалека, с боли.

Модели с заявленным контекстом в 1_000_000 начинают тупить уже на 100_000. А на 200_000 - тупить безбожно. Виновата Lost in the middle: модель хорошо помнит начало диалога и последние тысяч двадцать токенов, а середину склонна забывать. А в этой середине у нас лежит все ценное:

• результаты грепов по проекту
• стайлгайд
• принятые по ходу дизайн-решения
• те самые особенности, ради которых агент полчаса лазил по коду

Поэтому если вы скажете модели "давай сделаем фичу X" - агент сделает не то. Вы правите - он переделывает. Вы правите еще раз - а он уже забыл, как было на первой итерации, и на очередном витке приносит вариант, который вы отбросили два часа назад. Ну или творит какую-то иную дичь.

На этом месте вы говорите "AI говно" и гордо идете писать код руками😅

Лечение первого уровня - plan-mode

Сначала вы с агентом брейнштормите: формулируете видение фичи, строите архитектуру, агент вычитывает все, что ему нужно знать про код. И только потом он идет кодить.

Только план-то лежит все в той же СЕРЕДИНЕ КОНТЕКСТА - и забывается ровно так же, если реализация затянулась. Значит, план надо вынести из диалога в файл и сделать PLAN.md исходным промптом для следующей сессии.

Итого на одну фичу у вас уже две сессии: идея → PLAN.md, PLAN.md → реализация.

Поздравляю, вы изобрели SDD в самом простом его виде🌚

Потому что PLAN.md - это тоже спецификация. Спека конкретной сессии, и живет она соответственно: до мержа и в мусорку (целый пост про это).

Дальше идем от жадности

Если контекст, который агент тратит на "понять, что и как тут делать", такой дорогой - надо помочь ему разобраться за минимум токенов.

меньше токенов на понимание -> больше остается на реализацию -> качественнее результат


А помогает агенту ровно то же, что помогает новому человеку в команде:

• вменяемая архитектура
• комментарий там, где код врет о своих намерениях (# namedtuple вместо датакласса - иначе pickle падает)
• нормальная навигация вместо слепого grep (graphify, codegraph)
• документы на то, что из кода вывести нельзя

Вот последний пункт и есть SDD. В идеале спеки живут на трех уровнях: спека задачи (стори), спека фичи (эпика) и общая спека архитектуры проекта. Да и комментарий в коде - это, по сути, спека на конкретную функцию / класс / строку кода.

Что из этого я реально держу

Единого правильного фреймворка SDD пока нет - их развелось штук десять, и работают они все. Различаются тремя вещами: какие уровни спек вводят, как регламентируют их жизненный цикл и кто их пишет - вы или агент.

Но если выкинуть всю обвязку, главная польза SDD - это plan-mode. Все остальное - попытка научить агента ориентироваться в проекте чуть эффективнее (быстрее, качественнее, дешевле по токенам).

Поэтому у меня между сессиями долго живут ровно два артефакта: глоссарий проекта и ADR. Все остальное умирает вместе с фичей😎

А вы что реально сохраняете между сессиями - или каждый раз объясняете агенту проект заново?

Собственно, набор скиллов от Matt Pocock - это именно что SDD. И я им активно пользуюсь. Поэтому ждите "мясо" следующим постом

#архитектура #AI
216🥴2👍1
Мой полный сетап скиллов для разработки

Две недели назад переехал на сетап скиллов от Matt Pocock, докрутил пилот - показываю весь конвейер: от "хочу фичу X" до открытого PR.

Идея под ним ровно та, что разбирал во вторник: агент должен получать контекст порциями, а не тонуть в одной бесконечной сессии. Каждый этап - своя сессия, в которую влезает меньше 100-200к.

Ставится все это одной командой: npx skills@latest add mattpocock/skills, дальше /setup-matt-pocock-skills один раз на репозиторий.

Конвейер

1. /grill-with-docs хочу фичу X - агент люто досит вас уточняющими вопросами: дизайн фичи, архитектура кода, технические нюансы. Детали реализации, которые у вас уже в голове, на входе лучше не выкладывать: может, агент придет к тому же сам, может - к варианту получше, а может, вы сами передумаете по дороге. Направить его вы всегда успеете. На выходе - "Shared Understanding", зафиксированный в CONTEXT.md и ADR (про сам скилл писал тут).

Если на этом вы сожгли меньше 50к контекста и понимаете, что реализация быстрая - просто жмите /implement this в той же сессии. Все, что ниже - для задач побольше.

2. /to-spec - в той же сессии агент пишет спецификацию фичи: продукт, дизайн кода и так далее. Я ее не читаю, мне хватает "Shared Understanding". Держу в git-ignored .scratch, потому что живет она до реализации.

3. /to-tickets write the plan down as tickets and a general PLAN.md with refs to them - агент нарезает спеку на тикеты и собирает PLAN.md со ссылками на них:


├─ SPEC.md
├─ PLAN.md
└─ tickets/
├─ ticket-1.md
├─ ticket-2.md
└─ ...


Тут сессию можно смело /clear - она свое отработала.

4. /implement - цикл "реализация → ревью сабагентом → правки", пока тикет не закроется. Дальше развилка. Если агент уместит всю задачу в 200к - /implement all tickets @.scratch/PLAN.md и ждете 30-60-120 минут. Если чувствуете, что не влезет - делайте по тикету на сессию: /implement the next ticket from @.scratch/PLAN.md, then /triage it. Агент сам реализует, отревьюит себя, поправит комментарии, поменяет статус тикета и весело отрапортует вам об исполнении. Вам остается сделать /clear и вставить тот же самый промпт - агент побежит делать план дальше.

5. /code-review all the tickets and the whole implementation of @.scratch/PLAN.md, then fix any issues you find - в свежей сессии, когда все тикеты готовы. Так, на всякий случай.

6. Если нужны правки в рамках этой задачи, также завожу новую сессию и пишу что-то вроде I just implemented @.scratch/PLAN.md. One last change I need: ...

Напоследок прошу засквошить коммиты (агент коммитит после каждого тикета), запушить, открыть PR по шаблону и подчистить .scratch.

Что остается в проекте

Коммитятся в гит:

CONTEXT.md - словарь доменных терминов проекта (из DDD, ага). Нужен, чтобы агент говорил с вами на одном языке: когда вы просите "подправь представление файлов в дереве", ему не придется грепать, чтобы понять, что за файлы, что за дерево и как одно попадает в другое.
ADR-*.md - архитектурные решения. Чтобы в будущих сессиях агент понимал, почему модуль сделан так, а не иначе, и ничего не сломал. Не каждая фича достойна ADR, но если вы делали сложный выбор на дизайне или правили агента руками - хороший кандидат. По идее ADR неизменяемы, но я время от времени схлопываю все ADR по одной области проекта в один актуальный.

Умирают вместе с фичей: SPEC.md, тикеты, PLAN.md.

Тикетницу, кстати, можно взять любую - Github Issues, Linear, Jira. Просто я не вижу смысла плодить сотни ишью на гите, поэтому держу локально.

Две недели полет нормальный, могу рекомендовать. Но не стоит прогонять полный пайплайн, если нужны изменения вида "кнопка ведет себя некорректно" - это можно и просто попросить.

А вот видос от самого Мэтта, где он показывает весь свой цикл целиком.

А у вас как устроен конвейер работы над фичей? Закидывайте в комменты - увижу что-то, чего у меня нет, обязательно сворую🌚

#AI
👍267🔥3🥴1
Ребят, я очень надеюсь, что не вызываю ни у кого чувство FOMO своими постами про AI и агентов. Наоборот, тут я пытаюсь вам рассказать, насколько все просто и понятно, если копнуть в механику происходящего

Серьезно, все, что я вам рассказывал тут последний месяц - это дело пары дней на "потыкать" и пары недель на адаптацию под себя

Но если вы хотите, чтобы я рассказал про что-то другое - самое время написать мне об этом🌚

Всем хороших выходных и отдохнуть✌️
28🔥5
FastNews | Никита Пастухов
Мой полный сетап скиллов для разработки Две недели назад переехал на сетап скиллов от Matt Pocock, докрутил пилот - показываю весь конвейер: от "хочу фичу X" до открытого PR. Идея под ним ровно та, что разбирал во вторник: агент должен получать контекст…
Вайбкодим security компоненты в django-modern-rest (или нет)

https://www.youtube.com/watch?v=laJQcNAqxc0

Мой друг Никита Соболев - @opensource_findings сейчас активно разрабатывает django-modern-rest (а заодно CPython и десяток других OpenSource проектов). И он искал помощь, чтобы полностью мигрировать функционал dj-rest-auth в свой фреймворк - https://github.com/wemake-services/django-modern-rest/issues/1193

Чтож, это отличная возможность обкатать, как работает ИИнженерный пайплайн на реальном сложном OSS проекте🌚 Поэтому я вызвался реализовать эту фичу полностью сторого с помощью Claude Code.

И все это будет в лайве на завтрашнем стриме в 19:00


Ситуация усугубляется тем, что Никита (который Соболев, не путайте) лютый хейтер AI и вайбкодинга. Так что меня ждет очень-очень-очень жесткое ревью и невменяемые требования стайлгайдов😂

Посмотрим, что из этого получится. Вполне возможно, что мы вообще откатим всю фичу и ничего из сгенерированного кода не пойдет в main. Или случится ваншот и оставшийся час стрима будем просто пить пиво🌚

В общем, приходите - будет весело!
🔥22👍4❤‍🔥2💩1
Очередной воскресный дайджест агентского тулинга. Напоминаю, что все срочное падает в чат и там же обсуждаем свой опыт использования.

Топ недели - reverse-skill. Не скилл и не библиотека скиллов, а роутер: по задаче сам решает, какой скилл подтянуть, бутстрапит нужный тулчейн на лету и дописывает собственную базу знаний. Тема узкая - реверс и авторизованный пентест, - но интересен он скорее как сигнал: скиллов стало настолько много, что уже невозможно их все перебрать руками. +1.3k звезд за сутки, 12.1k всего, #1 мувер трендинга на 02.08. Поэтому -

Тренд недели - как управлять сотнями скиллов.

OpenSpace от HKUDS (те же, кто сделал LightRAG) - The Skill Management Layer for AI Agents: общий список скиллов, который можно шарить между агентами;
ECC - пакет способностей поверх Claude Code / Codex / Cursor / OpenCode. Это какой-то монстр с 70 сабагентами, 300 скиллами, 100 командами и бог знает чем еще. Для любителей поставить один пакет и не париться. ⚠️ 236k звезд на репе, созданной в январе - выглядит подозрительно.
cangjie-skill - скармливаешь книгу, длинное видео или подкаст - получаешь из них устанавливаемый скилл. Скилл для любителей Clean Architecture🌚

Боль недели - ревью агентского слопа. Три инструмента за неделю об одном и том же:

open-code-review от alibaba - гибрид: детерминированные пайплайны плюс LLM-агент, комменты на уровне строки, встроенный ruleset (NPE, thread-safety, XSS, SQL-инъекции);
strix - автономный агент-пентестер: натравливаешь на свое приложение, он ищет дыры и их латает. 46.5k звезд;
tuicr - терминальный код-ревьюер с vim-биндингами: непрерывный дифф, комменты на строку/ханк, трекинг просмотренного между сессиями, ревьюит незакоммиченное. Формально вообще не агентский тул - но сценарий у него ровно агентский: быстро вычитать то, что тебе нагенерил Claude, до коммита и не уходя в браузер.

Писать код мы агента научили, и теперь вся индустрия пилит, кто за ним будет проверять. Скорость генерации уперлась в скорость ревью - и узкое место снова человек.

Проверено на себе - last30days-skill. Устанавливаемый скилл-ресерчер: гоняет тему по Reddit / X / YouTube / HN / вебу и синтезирует сводку с сигналами вовлечения. На нем стоит вот этот самый радар, так что мой опыт: половину времени он отдает посты двухнедельной давности и делал вид, что это свежак - "топ-7 MCP-серверов" вместо инструментов. Поэтому GitHub Trending я все равно парсю отдельно, руками агента. Как ресерчер по теме - хорош, как детектор свежего - надо проверять дату. +658 звезд в день, 56.6k всего.

Просто находки:

chrome-devtools-mcp - официальный MCP от команды DevTools: агент получает настоящий браузер с дебаггером и сам смотрит консоль, сеть и перф-трейсы, вместо того чтобы верить твоему пересказу бага;
ego-lite - браузер для агента, который шарит твое залогиненное состояние: агент ходит по вебу под твоими сессиями и не мешает тебе работать;
claude-video - /watch: качает ролик, режет на кадры, транскрибирует и отдает Claude одним куском;
openwork - self-hosted альтернатива Claude Cowork поверх opencode, 20k звезд и +585 в день;
jcodemunch-mcp - тянет по AST точечные символы из чужих GitHub-репозиториев: агент разбирается в незнакомой библиотеке, не скачивая ее целиком и не сжигая контекст на файлы, которые ему не нужны.

Что радар проспал - несите в комменты, обязательно посмотрю и заберу в следующий выпуск.

#AI #digest
🔥11👍21
Пари я проиграл - ваншота не было

https://www.youtube.com/watch?v=laJQcNAqxc0

Вчера 4 часа вайбкодили с Никитой Соболевым security-компоненты в django-modern-rest: его фреймворк, его стайлгайды, его ревью. Напомню, что Никита - хейтер AI, и анонсил он это как спор: мол, Пастухов заваншотит всю миграцию dj-rest-auth клодом раньше, чем он успеет выпить бутылку пива.

Не заваншотил, но кое-что реально успели сделать:

• 2 issue с нормальным обоснованием и тестированием гипотез - #1195 и #1197
• пойман флакающий тест, найдена его первопричина и сделан довольно большой PR (смержили) - полностью через Claude Code
• продумана архитектура целевой фичи и открыт PR1 (его стоит закрыть и подумать еще) из двух запланированных

Теперь немного контекста. Я:

• не погружен в проект - не читал ни документацию, ни код, ни даже README
• не писал на Django и DRF лет 5
• не знаком ни с django-ninja, ни с dj-rest-auth, ни с django-allauth

Правда, Никитины линтеры чуть не свели Claude с ума - он тратил по 200к токенов на каждый тикет... А правки по дизайну фичи чуть не свели с ума меня.

Вайбкод победил - но не в тех масштабах, которые хайпят в твиттере.


Это не "ваншотинг приложения одним промптом", про который вам рассказывают в тредах. Это человек с улицы, который за вечер внес осмысленный вклад в чужой зрелый OpenSource. Для меня - великолепный результат. Для твиттера - провал, там за это время уже стартап продают.

Вайбкодить можно. Если с головой и осторожно.

Посмотрите запись стрима - там как раз видно, как это делается: где я тормозил агента руками, а где он справлялся сам. И накидайте комментов под видео, ютубу это нравится. Никите - спасибо, что пустил меня с клодом в свой проект и все это ревьюил.

А сюда накидайте комментов - как вам стрим и нужно ли делать такие еще?

#AI #opensource
🔥375💩2