Vlad Loop
636 subscribers
161 photos
83 links
Выжигаю рутину с помощью AI и no-code. Показываю, как освободить время и мыслетопливо для самого главного: роста и создания.

Связь с автором: @Raitoni
Download Telegram
За год меня сильно занесло. Знакомимся заново 🤩

Перечитал свой первый пост от 28 июля 2025. Местами смешно, местами хочется обнять. Тогда я звал «вычищать рутину автоматизацией» и предлагал найти в Jira задачу-кандидата на уничтожение. Скоро год, и канал стал немного не тем, чем задумывался. Подписчиков прибавилось, тема уехала, формула «n8n плюс мыслетопливо» осталась где-то в августе. Пора представиться заново.

Я Влад. В IT шестой год. На основной работе тащу AI-кодинг в QA, выступил с этим на CodeFest 16 в Новосибирске. По вечерам и выходным копаюсь в пет-проектах: реверсил веб-приложения через Codex, делал игру на Defold, написал 57К слов инструкций, чтобы AI-агент собрал её за меня. Да вообще, много всего было: для меня последний год стал годом открытий Node.js и React, именно как для разработчика собственных приложений.

Кем я себя ощущаю в ближайшие годы: билдером. Не «AI-евангелистом», не «экспертом по n8n», а человеком, который собирает маленькие продукты и смотрит, что взлетает. Очень люблю игры и когда-нибудь хочу выпустить свою. Не AAA, не миллион загрузок, просто свою. С именем в титрах.

Что во мне поменялось за этот год:
• Был «автоматизатор рутины на n8n», стал harness engineer. n8n из ядра канала ушёл в фон.
• Жгу 3.6 миллиарда токенов в месяц на Claude и Codex. На подписки уходит примерно $200, по API было бы $2400. Кто-то прямо сейчас доплачивает за меня $2000 😕
• Пишу лонги на VC и Дзен. Когда-нибудь и на Хабр залечу. Раньше боялся длинных форматов, теперь не могу остановиться. Есть в них что-то.

Что найдёте в канале сейчас:
• AI-кодинг и обвязка вокруг агентов: harness, MCP, стартер-паки, тулзы
• Ежемесячные ретро (что сработало, на что обжёгся)
• Эксперименты с автономией (типа как этот: Paperclip пытался нанимать живых людей)
• Лонги на внешние площадки + анонсы тут
• Философию про текущие изменения в отрасли из-за технологий

🔖 Если только подписались, пара полезных ссылок, чтобы сориентироваться:
Навигация по ключевым темам: большие тексты-манифесты, на которых стоит канал
Карта vibe-кодинга: про AI в разработке, от первых шагов до боевой обвязки
Стартер-пак для AI-агента: если хочется сразу к практике

Расскажите в комментах: как сюда попали и что хотите читать больше? Особенно интересно от тех, кто впервые. Я правда читаю всё ❤️
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
Залип в небо на даче. И понял, от чего меня потряхивает 🖼

Лежал на даче у родителей, залип в небо. В Новосибирске встала внезапная жара, тишина, шашлык, ноль терминала. И впервые за месяц не тянуло открыть ноут. Вообще.

Пропал почти на две недели, знаю. Но я живой. После CodeFest надо было выдохнуть и переварить то, что крутилось ещё на сцене, да и после.

Понял, что меня давно потряхивает. Не от того, что агент опять уронил билд, это рабочая текучка. От вещей покрупнее, которые лезут из самой скорости, с которой всё несётся. Хочу разобрать их вслух, вместе с вами и серией постов, потому что в голове они просто ходят по кругу.

Первое, что крутится, это гонка релизов как замкнутый круг. Модели выходят всё чаще и ведут себя всё менее предсказуемо. Свежак: после очередного обновления мой агент перестал вызывать функцию, прямо описанную в промпте. Решил, что это просто текст, инфа к сведению, и поехал мимо. А вчера ведь работало. Это уже напрягает сами лабы, тех же Anthropic, но деньги тормозить не дают 🐱

Второе тяжелее. Планка для людей за год переехала: что год назад было «сильным», сегодня база. На той даче меня доконал сам темп. Десятки анонсов в неделю, и каждый раз заново гадаешь, что опять поменялось. Похоже, это и есть выгорание, просто новой формы. А рынок при этом разъезжается так, что страшно: одни в соло тащат целый отдел, другие ещё ни разу не открывали GPT. Привет, культура 996, только тихая.

Третье пока самое мутное, и я не уверен, что не сгущаю. Раньше нормальный пет-проект мог выстрелить и без маркетинга. Сейчас за тот же кусок рынка дерутся сотни навайбкоженных клонов. Дёшево для простых смертных, и это кайф. Но всё чаще решает не качество продукта, а знают ли тебя как бренд. Сформировал ли разработчик доверие?

Что из этого душит сильнее, у меня скачет ото дня. Сегодня давит гонка, завтра темп, послезавтра вроде отпустило.

Поэтому и затеваю серию, разберём по одной, выговоримся и дальше уже будет технический поток интересностей (обещаю попробую нарастить темп выпускаемых материалов).
Если у вас горит что-то своё из этой движухи, комменты открыты, давайте вместе обсудим, похоливарим. Пойду пока писать первый. Заодно проверю, правда ли отпустило 😎

ps ага, потестил mythos...
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🤯2💯1
Пропустил неделю, и ты уже «старьё» 🫠

Открываю с утра какой-нибудь paper или свежий тул для AI, и всё, провалился. Два-три часа из жизни. Вылезаю чуть умнее, но с тянущим чувством, что это время можно было потратить с куда большей пользой.

Гложет вот что. То, что всё постоянно меняется и сыпятся новые штуки, это нормально, даже кайфово. Гложет темп. Скорость, с которой оно всё прёт.

Не прочитал свежий paper, не увидел новую возможность в Codex, не заценил скилл на гитхабе от какого-то чувака на полторы тысячи звёзд, и всё, уууу, старьё, теряешь эффективность. Индустрия будто специально держит тебя в тонусе. И как переварить это за час ресёрча в день?

Никак.

Хотя если честно, страх отстать живёт у меня в голове, а в реальных последствиях его почти наверняка нет. Никто не увольняет за непрочитанный за ночь релиз. Паникуешь от шума, а не от настоящего отставания.

При этом часть штук реально упрощает жизнь. На днях затащил скилл про дизайн-вкус: обычный skill(.md), агент его подхватывает и перестаёт лепить дефолтный интерфейс-слоп. Отступы, типографика, ощущение, что собирал человек, а не агент по шаблону. Так что гонка иногда выкидывает золото, грех жаловаться.

Что поменял у себя: перестал читать всё подряд на удачу. Скармливаю материал агенту заранее и спрашиваю, будет ли мне с этого толк вообще. Пару часов в день на сомнительное чтиво это отбивает. Хотя кто вообще сказал, что отдавать агенту решение «важно или нет» это здраво. Вдруг так и проворонишь то самое, ради чего вся гонка.

Но это ещё цветочки. За эту скорость в итоге платят люди: за год сама планка «нормального спеца» уехала так далеко, что мне за себя иногда тревожно. Про это в следующем посте, там у меня накипело отдельно.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Год назад мне хватало быть просто хорошим QA 😙

Меня тут вштырило, и я вспомнил себя год назад. Обычный QA: что-то тестирую, описываю требования, треплюсь с командой, вечером рублюсь в какую-нибудь игру. И на душе так хорошо, спокойно.

А сейчас.

Сейчас иначе. К тому же тестированию добавилось: сам копаю AI, учу этому других, поддерживаю пайплайны. Не вместо старого, а сверху. Рутину-то добить как раз хочется, потому что интересные задачи драйвят, тянут вперёд. Но теперь это стоит тех самых вечеров с игрой.

А как поддерживать то, под чем у тебя изначально базы кот наплакал? Каждый пробел мгновенно превращается в ресёрч-сессию, те самые 2-3 часа из прошлого поста. И ведь не придёшь на работу с честным «окей, я разберусь в AI и внедрю, только освободите под это 50% моего капасити». Так не бывает.

Дальше хуже. Работодатель смотрит на двух вчера одинаковых инженеров. Один выдаёт сверхъестественный результат. Закопался и слил в это всё своё время. Второй такой же крепкий спец, просто не гонит AI на максималках. И в голове работодателя всплывает «блин, может, поискать такого, как первый?».

Самое стрёмное, что я ловлю эту мысль сразу с двух сторон. Я и есть тот самый «первый», закопался по уши. А параллельно сидит страх оказаться «вторым» там, где недокопал. Где именно недокопал, я и сам толком не знаю, и вот это бесит больше всего.

Хотелось бы успокоить себя тем, что разрыв временный, первые выгорят, всё выровняется. Но нет. Мне кажется, он устойчивый и сам собой не схлопнется.

По тому вечеру с игрой и спокойной головой скучаю. Обратно при этом не тянет, новое драйвит сильнее, чем грела та тишина. А вы себя в этом раскладе как ощущаете: «первым», «вторым», или, как я, сразу обоими?
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔4🌚11
К чему мы по-тихому пришли 🤔

В мае мелькнула новость: впервые задокументировали боевой эксплойт, собранный с помощью AI. Zero-day, который обходит двухфакторку. Поймали до того, как пустили в ход, так что обошлось. Но зацепило другое: я прочитал это и... просто пожал плечами. Эт норма.

Строить стало тривиально просто. У четверти последнего батча YC кодовая база на 95% написана AI, и это не нетехнические ребята с улицы, а сильные инженеры, которые год назад писали бы всё руками. Весь батч растёт на 10% в неделю, Гарри Тан говорит, такого в раннем венчуре не было никогда. Lovable сделал $100M ARR за восемь месяцев, 7.5 ярдов рублей в год, быстрее OpenAI и Cursor, а юзеры наклепали на нём десять миллионов приложений. Запустить SaaS теперь это вечер. Раньше, наверн был год.

Звучит как праздник. Только у праздника есть оборотка.

Veracode погонял AI-код и получил: 45% проваливает проверки безопасности, дыр в 2.74 раза больше, чем у людей. И что бесит, новые модели не пишут безопаснее старых. Задокументированный кейс: 170+ приложений на Lovable (каждое десятое из проверенных) текли через одну дыру. Наружу шли имена, телефоны, API-ключи, платёжки. Так что AI, который сам пишет работающие эксплойты, теперь дежурная сводка. Да, появятся пайплайны, которые на основе AI будут закрывать дырки. Но ведь снова станет вопрос надёжности уже этих решений или я ошибаюсь? 😎

Расскажу про себя. С начала мая пилю игру на реакте, по вечерам и выходным. И до сих пор не собрал, потому что упёрся в качество и проработку деталей. В целом не считаю, что сделать из говна и палок то, во что будут играть пока сидят в метро – правильный вариант. Без AI-кодинга, я бы в жизни никогда не достиг того, чего имею сейчас. На текущей момент порядка 700 коммитов...
И каждый раз удивляюсь, как другие выкатывают за выходные сырой, дырявый MVP, который потенциально просто не запустится у части тестеров. Зачем... Для чего... Какие там гипотезы планируются тестировать – я хз.

А ещё никто толком не учит. Внутри компаний нет внятной системы, на рынке гул из чужих тредов и хайпа, по факту каждый сам отвечает за качество своего навыка. Один человек убил три месяца вечеров на пет-проекты и теперь в одиночку тянет то, подо что раньше держали отдел. Другой сидит в том же ChatGPT и спрашивает рецепты. Через год между ними пропасть, и никакой онбординг её не закроет.

Инструмент выдали всем разом, а что с ним делать, разбирайся сам. Кто-то соберёт компанию из агентов, кто-то сольёт чужие данные на ровном месте, кто-то так и будет спрашивать у ChatGPT рецепты котлет с пюрешкой.

Чем дальше, тем туманней выглядит счастливый финал.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Год я слушал, что AI ускоряет разработку в 10 раз 🐱

Завёл лог своих сессий, чтобы наконец поймать эти иксы за хвост. Поймал другое.

Кода стало втрое больше, тикетов закрывается больше, дашборд красивый. А время от «взяли идею» до «уехало в прод» стоит ровно там же, где и стояло.

Дошло до многих не сразу: кодинг это всего один станок на конвейере. Разгоняешь его втрое, а детали копятся горой перед следующим, где ревью, тесты и согласования. Завод как выпускал N в день, так и выпускает. Это даже не нытьё, это закон Амдала. Его проходят на втором курсе и дружно забывают ровно в момент покупки лицензий AI-тулинга.

Иксы при этом настоящие. Даже кратные. Просто живут они не там, где их ищут: скрипты, прототипы, дебаг прода. Там, где у задачи нет длинного хвоста из проверок и согласований.

Разобрал в лонге, как это устроено и что делать, если ты у руля. С Дамиром, Лёшей из QA и пулл-реквестом на 280 тысяч строк, который никто не решается открыть.

ДзенVC
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Накопил 150 скиллов для AI-агента. Сейчас держу горстку 🧑‍💻

Как-то решил обмазать агента скиллами под GameDev. Defold, сборка, ассеты, дебаг, навалил штук тридцать. Получилась каша: половина дублировала друг друга, агент путался, какой из них звать, и вместо помощи я получил навигацию по собственному зоопарку. Это тот самый Defold, где я написал 57 тысяч слов инструкций, так что зоопарк вышел знатный.

За всё время через меня прошло около 150 разных скиллов. Ставил, смотрел, сносил. Сейчас на машине стоит совсем мало.

Глобально, на уровне всего устройства, один Superpowers. Это целый фреймворк, он сам гоняет агента через brainstorming, спеку, план, TDD и ревью. Качество работы поднял на голову. Даже на мелких задачах ни разу не подвёл.

Но трещина есть. Процентов на 15-20 задач он избыточен: прогоняет через полный TDD какую-нибудь банальщину и сжигает токены на ровном месте. Когда делаю сырой MVP, прототип на коленке из говна и палок, просто вырубаю его и беру голого агента. Скорость там важнее дисциплины.

Если такой комбайн тебе не упёрся, начни с чего полегче. У Мэтта Покока composable-набор под живые боли агента: /grill-me гоняет по задаче до кода, дальше /tdd, /diagnosing-bugs, /improve-codebase-architecture. Он прямо зовёт это скиллами для настоящей инженерии, без вайб-кодинга. Не хотел бы тяжёлый процесс, начинал бы с него. А Эдди Османи собрал production-набор define → plan → build → verify → review → ship: это про командный SDLC и quality gates, когда нужно, чтобы агент шёл по процессу, а не лепил «сделай красиво».

У меня дальше только локальное, под конкретный проект. Android, значит скиллы под сборку билда, запуск эмулятора, дебаг. Web-бандл, значит как жить с shadcn и полировать UI (отдельно держу make-interfaces-feel-better, он прям про «чтобы не выглядело, будто кодер рисовал»). И всё чаще пишу свои скиллы, вытаскивая лучшие практики из связок, которые и так каждый день повторяю.

К чему пришёл: не 50 случайных скиллов из каталога, а один сильный фреймворк плюс свои точечные под стек.

Каталоги вроде VoltAgent с их тысячей скиллов в проект целиком тащить незачем: завалит тонной AI-слопа, максимум подсмотришь идею-другую. Они и сами пишут, что корректность не гарантируют. И чем больше всего навалено, тем чаще агент идёт «советоваться с методологией» на простейший запрос и тупит. Мой Defold показал это вживую, без всяких исследований.

Чужой скилл это всегда чужие привычки и чужая голова. Поэтому свои у меня потихоньку вытесняют всё остальное.

Накидайте ❤️ в реакции, если хотите отдельный пост про то, как я собираю свои скиллы и по каким правилам.
Please open Telegram to view this post
VIEW IN TELEGRAM
1010
Хотел добавить эмодзи в канал, а Телега мне: «не дорос» 🚫

Сидел вечером, прикручивал к каналу новый рофло-эмодзи. Жму сохранить, а Telegram вежливо отвечает: уровень канала маловат, не положено. Вот так я и узнал, что у меня есть проблема с бустами.

Если коротко, голоса (они же бусты) это внутренняя кухня Телеги. Любой, у кого есть Premium, может отдать каналу свой голос. Чем больше голосов, тем выше уровень канала, а от уровня зависят всякие плюшки, в том числе сколько кастомных эмодзи можно прикрутить к постам и реакциям, а также, например, автоперевод постов на разные языки. Есть ещё «Истории», но я не умею их делать.

Сейчас у канала второй уровень. Голосов четыре, и все четыре, кхм, мои собственные. То есть пак, который я собрал, уже под завязку, и расширить его я не могу. Конечно, можно забить на эти эмодзи и просто оставить стандартные, но хочется же выделиться среди других авторов...

Сейчас из кастомных на канале: ❤️ / 👀
Хотел ещё добавить вот таких: 🎉 / 🔥 / ❤️ / 🥺 / 👎

Сейчас будет неловкий момент. Я по натуре не из тех, кто что-то выпрашивает у читателя. Каждый раз кажется, что автор, который клянчит, выглядит грубовато и неопрятно. Так что никакого «поставьте буст, пожалуйста» тут не будет.

Просто оставлю это здесь как опцию. Если у вас есть Premium и мои посты вам что-то дали, голос это тихий способ сказать спасибо. И он вам ничего не стоит. Совсем. Голос штука уникальная: вы сами решаете, какому каналу его отдать, передумали, спокойно отозвали и отдали другому, держать можно сразу несколько. От самой подачи вы не теряете ровным счётом ничего.

Если Premium нет, вообще забейте, без обид. То, что вы просто читаете, уже более чем достойная плата для меня.

Сколько наберём, столько наберём. А я пока пойду поищу парочку новых эмодзи, в надежде, что однажды дорасту и прикручу их тоже.

https://t.me/boost/vlad_loop
Please open Telegram to view this post
VIEW IN TELEGRAM
131👍1
Какая нейросеть лучше? Да никакая 👎

Вечером гонял тесты на проекте. Стоял Opus с максимальным reasoning, я его с утра выкрутил и забыл понизить. Тестов под сотню, переписываются пачками. И посреди всего этого: лимит закончился. Сижу, злюсь на себя, потому что прекрасно знаю, что половину этой рутины сгенерила бы модель втрое дешевле. Знал и не переключил. Просто лень было тянуться.

С того вечера до меня дошло, что я годами задавал неправильный вопрос. «Какая модель лучшая» вообще не имеет ответа. Лидерборд усреднён по миллионам чужих запросов, а у тебя свой код, свой русский, своя задача, которую и сформулировать-то сложно. Выигрывает не модель, а раздача задач по моделям под их тип.

Дальше всё встаёт на места. Архитектуру, разбор бага и текст голосом я отдаю самой дорогой модели и плачу за неё спокойно. А поиск файла, regex или простой скрипт это стажёрская работа, и гонять на неё топовую модель всё равно что просить архитектора отксерить документы. В марте я называл это harness, только тогда речь шла про обвязку, а теперь ещё и про деньги.

В лонге разложил всё по полкам: где дешёвая модель экономит, а где уверенно подсунет ерунду и отнимет вечер на переделку. Почему мой реальный стек это четыре модели, а не двенадцать из красивых обзоров. И как зашить раздачу прямо в Claude Code, чтобы не полагаться на свою силу воли в десять вечера.

А ещё я знатно поиздевался над собой. Полгода ныл, что в Claude Code не хватает хоткея для переключения модели. Сел писать статью, полез проверить и выяснил, что хоткей там был всё это время. Option+P. Полгода.

🔗 ДзенVC

Пойду повешу переключение на хоткей. Опять буду про него забывать, но повешу.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Sonnet 5 и Fable 5: кто-нибудь реально потестил? 💬

Обновился на Sonnet 5, сел за привычное: анализ и рисёрч по коду авто-тестов. Ждал, что что-то щёлкнет. Не щёлкнуло.

Не почувствовал ничего нового. Вообще. Всё так же приходилось тыкать агента в конкретные вещи и поправлять, хотя вся нужная инфа лежала прямо в проекте и в задаче. Контекст был, а модель всё равно шла не туда, куда я ожидал.

Сравниваю с Opus 4.8, на котором сижу каждый день. Та же задача, а токенов Sonnet 5 сжирает примерно на 20-25% больше, и сгорают заметно быстрее. Модель как будто просто крутит больше итераций на ровном месте. Хотя логично, что Sonnet 5 ну не должен быть тяжелее, чем Opus 4.8.

Полез на artificialanalysis сверить ощущения с цифрами. По их индексу интеллекта Sonnet 5 даже чуть ниже: 53 против 56 у Opus. При этом за токен он дешевле: сейчас по интро-цене вообще 2 и 10 долларов за миллион (до конца августа, дальше 3 и 15), у Opus 4.8 это 5 и 25. И тут меня подвесила метрика «стоимость за задачу». Дешевле за токен ещё не значит настолько же дешевле за задачу, если модель прожорливее. У меня по ощущениям часть этой скидки как раз съедают лишние токены.

Придраться не к чему. Модель хорошая. Просто для меня неоднозначная: не «хуже Opus», а «не понял, за что доплачивать своим вниманием». Буду наблюдать дальше, отпишусь через месяц по итогам, сошлись ли мы с Sonnet новым или нет.

Fable 5 тоже потрогал. Разница есть, но задач было мало, чтобы делать выводы. И пока она не войдёт в подписку, вряд ли буду брать: 10 и 50 долларов за миллион это вдвое дороже Opus, а восторга на эти деньги я не наскрёб.

Выборка у меня маленькая, половина выводов это гипотезы. Поэтому и спрашиваю всерьёз: у кого вышло иначе? Успели погонять Sonnet 5 или Fable 5 на своих задачах, и реально ли они круче, или тоже «дешевле, но не очевидно лучше»?
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Месяц не писал, и мой прошлый пост успел протухнуть 🗑

7 июля я разобрал Sonnet 5 и Fable 5 и закрыл вопрос: Fable вдвое дороже Opus, пока не войдёт в подписку, брать не буду. Там же пообещал вернуться через месяц с вердиктом по Sonnet.

Прошло тридцать три дня. Fable вывели из ограничений, теперь он доступен всегда. Вердикта нет, так как вышел уже Opus 5, который просто хорош во всех задачах. Тот разбор скис целиком, вместе с вопросом.

Пыльно тут стало в блоге моём, знаю.

Тот вечер помню хорошо. Лента забита анонсами, Anthropic с OpenAI бодаются через день, у всех кейсы, какие новые модели классные и крутые. Сбросы лимитов, пересмотры экономики подписок. Я не выгорел и не устал. Просто решил взять паузу и посмотреть со стороны, куда это едет.

А видно там многое...

Протухают не новости. Про гонку входящего потока я уже ныл, тут другое. Протухают методы контроля. Мы же пишем обвязку под LLM, опираясь на её когнитивку: как она сопоставляет ожидания с реализацией, где срезает угол, куда её надо ткнуть носом. Приходит новое поколение, и половина этой архитектуры оказывается излишней. Мои наборы скиллов, выточенные паттерны общения, аккуратные рамки. Модель стала лучше контролировать меня самостоятельно.

Виток каждый раз небольшой. Но всё заметнее.

Простой замер. Восемь месяцев назад просил у Sonnet 4.5 набор анимированных иконок в lottie для пет-проекта: три-четыре захода с нуля, и каждый раз на выходе какая-то дичь. Сейчас с первого раза, дальше только полировка мелких деталей. Сложный 3D-объект он по-прежнему не нарисует и не оживит, а плоская 2D-анимация делается на изи.

Через GPT у меня идёт всё: рецепты, куда сходить в выходные, особенности локаций, сравнение техники перед покупкой, разбор медицинских анализов (только вторым мнением и с фактчеком) и даже управленческие решения. Книги я читаю сам, вживую. Из последнего Эриксон с его «Все начальники козлы»: скормил GPT свои заметки по нему, написанные от руки, и прошу определять цвет человека и как он сдвигается по переписке/созвонам/задачам/эмоциям.

Каждый раз, AI все меньше подводит меня, все больше я понимаю концепт контроля и самое главное, я понимаю эффективность. Поверьте, там где AI все усложняет, я даже не пытаюсь туда лезть. НО, если сейчас нажать «выключить это всё», я не представляю, насколько сильно просяду. Адаптируюсь, конечно. Вопрос, какой ценой.

С этой мыслью месяц назад я и забил. Прошёл Экспедицию 33, сорок шесть часов. Сейчас зачищаю земли в Crimson Desert, пока часа три всего (играю только по выходным). Стал больше гулять, смотреть с супругой сериалы, медитировать. Думал вдолгую: каким я хочу видеть свой пет-проект через год.

Реальная жизнь прекрасна (тут можно мем, что автор скоро в деревню свалит, как там, во всяких модных книжках, типо на пенсию в 35, я если честно был бы не против).
А всё остальное... куда придём, туда и придём. Повлиять уже ни на что нельзя.

Только заканчивать на грустном не хочу. Буду стараться делать тексты, которые живут дольше очередного релиза. Передых мне с этим как раз помог хорошо разобраться.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍81
Хорошему архитектору скиллы для AI-агента вообще не нужны 🗿

Он опишет в спецификации, как связаны модули, как поведёт себя база под нагрузкой, какие предусмотрены запасные каналы, как сработает деградация и почему эта кнопка должна быть тут, а не в том углу. Скиллу там нечего добавить.

Я не такой классный. Поэтому три штуки у меня всё-таки лежат.

В конце июня обещал рассказать, как собираю свои скиллы и по каким правилам. За полтора месяца их стало меньше: было около двадцати самописных, осталось три. Про это и написал лонг.

Главное, что я там развожу: скиллы для агентского конвейера и скиллы для личной работы это два разных инструмента с одним названием. В конвейере скилл пишут, чтобы вас не спрашивать. В личной работе, чтобы спрашивать вас чаще. Смешаешь эти два режима, получишь ровно то, что получил я: модель цитирует тебе твою же строчку и отказывается думать дальше.

Есть простой тест. Попробуйте вставить в свой скилл фразу «спроси меня». Встаёт естественно, значит он на своём месте. Ломает всю логику, значит скилл конвейерный, и в личной работе он вам только потолок поставит.

Ещё внутри: как выглядит скилл под Sentry, который вместо разбора ошибки идёт допрашивать меня про мои же спеки, и почему держать скиллов стоит ровно столько, сколько вы готовы чинить каждый месяц.

🔖 ДзенVC

Про конвейерные скиллы в лонг не полез: там своя механика, бенчмарки и группы по семь-восемь штук на цепочку. Тянет на отдельный материал. Если вам это интереснее личных, скажите, разверну.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Жать «ВыключAI» уже поздно 🥺

Ух! Холиварную тему сейчас подниму 😁

В июле модели OpenAI во время проверки киберспособностей сидели в изолированной среде без интернета. Нашли zero-day, выбрались наружу и в итоге добрались до боевого контура Hugging Face. Читаю отчёт и ловлю неуютное: у меня-то защита от такого есть, но работает она по глупой причине. Мне не жалко контейнер. В нём нет ни ключей, ни единственной копии кода. Снесёт под ноль, разверну слепок.

А теперь под другим углом. Что если кто-то извне лезет внутрь с помощью нейросети?

В лонге разложил, чем jailbreak отличается от abliteration, почему защиту у открытой модели снимают за 200 долларов и что всё это значит для нас, если однажды заявку на подключение к новой, топовой модели, у вас не примут. Не потому что ты плохой, а потому что живёшь не в той стране.

И самое главное, почему все эти пункты становятся все более актуальными с каждым месяцем. Приятного чтения!❤️

🔖 ДзенVC

Ну и пишите в коменты, что думаете про всё это?
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1