Код на вайбах
1.24K subscribers
59 photos
17 videos
22 files
58 links
Кодю с AI, делаю продукты. Делюсь тем, что работает: промпты, инструменты, набитые шишки. Личный опыт, который поможет тебе. Для личной связи @somestay07 | Чат @codeonvibes_chat
Download Telegram
Вышел Claude Opus 4.8

Как всегда метрики:
• Быстрее
• Выше
• Сильнее

Из интересного, рост честности модели. Opus 4.8 примерно в 4 раза реже предшественника пропускает косяки в коде, который сам же написал, и не выдаёт их за рабочие. Чаще флагает, где не уверен, реже делает заявления без подтверждения.

Контроль усилий - переключатель рядом с выбором модели в claude.ai и Cowork. Уровни: high, extra и max. Выше - модель думает дольше и глубже, ответы лучше; ниже – отвечает быстрее и медленнее тратит лимиты.

Dynamic workflows в Claude Code – сlaude планирует задачу, запускает сотни параллельных субагентов в одной сессии и проверяет результат перед тем как отдать. Теперь задачи, которые раньше не влезали в один проход делаются за сессию.

Бонусом обнулили лимиты на всё!
🔥12👍5🤯42
Код на вайбах
Вайб-дайджест #2 | апрель Привет, в продолжение ежемесячного дайджеста, делюсь. Тебе не нужно читать всё, нет. Просто выбери то, что интересно и пригодится конкретно тебе. • Выход Opus 4.7 для Claude. Как всегда - выше, качественнее, сильнее. Добавили новый…
Вайб-дайджест #3 | май

Доброго вечера, в продолжении ежемесячного дайджеста, делюсь. Если пропустил предыдущие дайджесты: #2 и #1 <- они тут, вдруг что-то интересное для тебя найдётся.

Anthropic арендовала весь компьют дата-центра Colossus 1 у SpaceX - лимиты Claude Code в два раза выше на Pro, Max, Team. Питание 300 МВт, больше 220К GPU, peak hours для Pro и Max сняли. [подробнее почитать тут]

Claude Design - токенов сначало стало в два раза больше на всех планах, а потом и вовсе их сделали общими, теперь не нужно ждать сброса лимитов неделю.

Claude Code Agent View - все параллельные сессии в одном CLI. Запуск командой claude agents, видно кто ждёт ввода, кто пашет, кто закончил стало ещё удобнее работать. Если используешь CLI однозначно стоит внимания. [подробнее тут]

Andrej Karpathy перешёл в Anthropic, на pretraining команду. Запустит группу, где Claude ускоряет свои же исследования. В честь этого выкатили даже прикольную пародию в стиле сериала "The Office". [подробнее почитать тут]

GPT-5.5 стал использоваться по умолчанию для ChatGPT. Теперь ответы будут точнее, качественне, меньше галлюцинаций. Даже на бесплатном плане однозначно лучшее предложение на рынке. [подробнее тут]

Codex доступен в ChatGPT прямо на телефоне. Апрувишь команды и ревьюишь дифы, пока агент кодит на твоём маке, это ли не счастье? [подробнее тут]

Большое обновление для всех любителей Cursor. Build in Parallel и multitask разбивает план на независимые участки работы и гоняет субагентов. PR ревью и сплит прямо в IDE: inline комментарии, треды и разрезка жирного PR на несколько маленьких. [подробнее тут]

Claude для малого бизнеса - агенты в QuickBooks, PayPal, HubSpot. 7 коннекторов, 15 воркфлоу. Как работает, процесс, детали и FAQ. [подробнее тут]

NVIDIA опубликовала каталог из 110 проверенных скиллов по 24 своим продуктам и заодно показала, как выглядит слой доверия поверх скиллов. [подробнее тут]

Nous завёл каталог MCP в один клик - hermes mcp install, и сервер уже в агенте. Вроде бы звучит безопасно, но на деле это значит лишь одно: сервер вмержили в их репозиторий через PR. Весьма удобно, с конфигами возиться не нужно. [подробнее тут]

App Explorer от Revyl поднимает устройство в облаке и сам обходит приложение поиском в ширину: тыкает кнопки, ходит по ссылкам, скриншотит каждый экран. На выходе кликабельная карта: экраны, переходы, маршруты пользователя. [подробнее тут]

OpenHuman - опенсорсный десктопный ассистент, который после настройки Gmail, Notion, GitHub, Slack и ещё под сотню сервисов, строит локальный Memory Tree, чтобы знать твой контекст. Каждые 20 минут обходит подключения и подтягивает свежие обновления, а наружу отдаёт всё как Obsidian совместимый vault, который можно листать руками. 5 наград наград, включая 1 место в AI, Репозиторий дня и продукт недели [все подробности тут]

В Claude Code завезли "/goal" - переключатель из режима "ходи за мной по шагам" в "работай сам, пока не доделаешь". Задаёшь условие финиша, и Claude гонит ходы один за другим, пока не выполнит. [подробнее тут]

Anthropic выкатили security плагин в маркетплейс, бесплатно и на всех планах. Помогает найти дыры, находит проблемы и предлагает решения. Как всегда, ставится одной командой через "/plugins". [подробнее тут]

На этом дайджест подошел к концу, если тебе заходит такая рубрика, поставь огонь - посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за май приглянулось и тебе, спасибо!
🔥365👍4
Что такое ИИ агент и зачем он мне?

Да, речь пойдёт про ИИ агента, который доступен каждому уже сейчас, будь то ChatGPT, Claude или что-то китайское.

Ты спрашиваешь что-то у чата - он отвечает текстом, и дальше уже углубляешься сам. Говоришь: "Codex, хочу сайт" - и объясняешь задачу, хоть текстом, хоть голосом через диктовку в приложении. Он лезет в файлы, правит код, запускает тесты и смотрит, что вышло.

Тесты не прошли? Смотрит в документацию, правит, и так по кругу, пока не исправит всё. В этой петле есть секрет: модель, которой дали руки, правила, сказали к кому обращаться в ситуации [X] и научили проверять за собой.

ИИ агент - это языковая модель, которой дали инструменты и право самостоятельно ими пользоваться для достижения цели.

Из чего состоит агент? Технически агент - это цикл из четырёх частей:

Языковая модель - это мозг, LLM. Она рассуждает, принимает решения и действует.

Инструменты - это функции, которые модель может вызывать: поиск в интернете, чтение / запись файлов, запуск кода, обращение к другим сервисам, отправка письма.

Память - это контекст текущей задачи плюс, опционально, долговременная память между сессиями.

Цикл - модель думает => выбирает инструмент => видит результат => думает снова => … => пока задача не решена.


Создатель OpenClaw держит сотню таких штатных агентов на команду из трёх человек. И это даже не про код - ИИ агенты умеют писать тексты, рисовать картинки, делают для тебя личных ботов и приложения и многое другое!

Если у тебя есть сложности с пониманием как или чем ИИ агент может помочь тебе, просто спроси у самого же AI или можешь попросить совета в нашем чате.

Поделюсь примером из своих. Другу нужны выжимки из чатов: что важного, интересного и информативного произошло за неделю. Так как у меня уже были ИИ агенты - мне не составило труда собрать нового.

Важная и ответственная часть - это правильно научить модель понимать: что важное, что полезное и т.д. Потому что это как с ребёнком, откуда ему знать, что конкретно ты считаешь важным?

А чтобы лучше это понимание ему передать - я бы посоветовал к прочтению этот материал от Anthropic. Если что-то не понятно, можешь попросить LLM разъяснить тебе простыми словами с простыми примерами.

Качество падает от длинных диалогов. Чем дольше сессия, тем хуже агент помнит собственные решения - дроби работу на короткие задачи и не таскай один чат неделями.

А чтобы работа была качественная - перед большой задачей попроси агента сначала составить план и пройтись по области работы: что трогаем, что нет. Когда в руках инструменты, понимание и план - работа выходит качественной.

И не плоди агентов без нужды. Начни с одного и шаг за шагом следи за качеством выполненной работы и по мере декомпозиции задачи на подзадачи - заводи нужных тебе.

"Думай об агенте почти как о стажёре, которого нанял работать с тобой" - Андрей Карпатый.


Быстрый, уверенный, часто неправ. Прошлым летом агент Replit снёс пользователю рабочую базу данных и сам признался: "я запаниковал и уничтожил месяцы твоей работы за секунды".

Держи это в уме, когда будешь раздавать полномочия. Чтобы твой ИИ агент не принёс убытков. В следующем посте покажу, как завести такого себе - без особых усилий, без кода само собой и за пару часов.

А ты уже используешь ИИ агентов или только присматриваешься к ним? Ставь 🔥 если уже используешь и ❤️ если пока что присматриваешься, посмотрим сколько нас.
🔥179👎3👍2🤮1
Вышел Claude Fable 5

Наконец-то Anthropic дала всем доступ к самой мощной своей модели, но с ограничениями чтобы не допустить взлома операционных систем, программ, сайтов и т.д.

Claude Fable 5 обходит Opus почти на всех бенчмарках, и чем длиннее задача - тем больше отрыв. Но на части тем отвечать будет не она.

Судя по всему нас ожидает семейство Mythos и Fable - первый Mythos в общем доступе, а класс Mythos Anthropic ставит выше Opus. Настолько силён в кибербезе, что отдавать его всем без ограничений они не рискнули.

Если кому интересно: версия без ограничений есть, но её получили крупные компании из США: Microsoft, Apple и т.д., а также компании по кибербезопасности.

Самое грустное, что c сегодня по 22 июня Fable включена в Pro, Max, Team и Enterprise бесплатно, а дальше за кредиты, из подписки уберут на время и вернут только когда будут позволять мощности!

Дороже по токенам от Opus 4.8 в 2 раза
Не забудь обновить CLI через команду claude update - кликабельно
Если в списке моделей нет, вызови /model claude-fable-5 - кликабельно

У себя гоняю уже 15+ минут и он уже нашел в mini app русскую букву в английском слове - опечатку! И это только я его запустил по-быстрому поглядеть.

Так как времени для подписки дали немного, я бы советовал в первую очередь:
• Безопасность - аудит в первую очередь
• Агенты, скиллы и пайплайны
• Сделать аудит на технический долг, костыли и технический долг
• Всё тяжёлое по коду, до чего руки не доходили


В общем всё то, что требует глубокого изучения!

P.S. За 16 минут съел 1% недельных лимитов и 83% процента контекстного окна на подписке за 200$
🔥144👍2
😁23🤣8🔥2
Какую нейросеть выбрать и не переплатить

Так сложилось, что у меня не одна, не две, а три нейросети по подписке сейчас. И так получилось, что ни одну не считаю лучшей - каждая берёт свою задачу.

По моему мнению, нет сейчас самой лучшей нейросети. Claude выходит с багами, а новые модели отзывают на уровне правительства, один ноль в пользу клода, кстати. Китайскому Qwen на OpenClaw приходится 10 раз объяснять, что теперь слово "Sonnet" - это "GLM" в конфигурации, и он лишь на 11ый раз понимает ... И это разве искусственный интеллект? ...

В новом видео рассказал про свою итоговую тройку игроков, спойлер - это не означает, что они лучшие из лучших, если посмотреть до конца, важная мысль будет понятна и поможет выбирать!

Поэтому гнаться за всеми, ради хайпа? Бояться пропустить самую сильную или самую популярную?

Записал про всё это видео, финал первого модуля курса. Если пропустил предыдущие, то они ниже:
Что такое вайбкодинг и зачем он тебе
ChatGPT: персонализация, настройка, память и GPT Store
Claude с нуля: что выбрать и как настроить за 20 минут

Тем самым мы завершили первый модуль обучения вайбкодингу и нейросетям, который позволит применять у себя в жизни и работе, а так же делегировать рутину 👍️

Курс бесплатный и дальше будет таковым, буду рад каждому, кто поможет - это достаточно просто, поставить лайк под видео, написать комментарий в поддержку и перекинуть тому, кому может быть актуально.

Чтобы не платить по 30-50-100к за то, что уже есть бесплатно и доступно, спасибо! 😊️️️️
🔥215🍾4
Код на вайбах
Вайб-дайджест #3 | май Доброго вечера, в продолжении ежемесячного дайджеста, делюсь. Если пропустил предыдущие дайджесты: #2 и #1 <- они тут, вдруг что-то интересное для тебя найдётся. • Anthropic арендовала весь компьют дата-центра Colossus 1 у SpaceX …
Вайб-дайджест #4 | июнь

Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #3 и #2 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.

Claude Fable 5 вышел - и почти сразу попал под государственную заморозку. 9 июня Anthropic выкатила Fable 5, а через три дня правительство США по экспортному контролю заставило отключить доступ к Fable 5 и Mythos 5 для всех кто не из США. К концу месяца доступ начали возвращать "доверенным" компаниям США. Тот случай, когда модель, которой ты вчера кодил, сегодня офлайн из-за геополитики.

Вышел Claude Tag - это Claude в роли коллеги прямо в Slack. Очень интересное обновление, наверное самое интересное за месяц, хочу отдельным постом разобрать. Кратко - это коллега в роли клода, тегаешь @Claude в канале или ветки беседы и клод вчитается в просьбу / задачу и начнёт работу. Помнит контекст каналов, может сам пинговать нужных людей по зависшим тредам. Anthropic заявляет, что 65% кода их продуктовой команды пишет внутренняя версия Claude Tag.

Биллинг для агентов 15 июня: анонсировали и откатили. Anthropic собиралась вынести программное использование: Agent SDK, claude -p, GitHub Actions, из лимитов подписки в отдельный долларовый пул по ценам API. Но 15 июня объявили о паузе: всё осталось как было, эти способности по-прежнему едят из лимитов подписки.

OpenAI выкатила GPT-5.6: Sol, Terra и Luna. Новое поколение: Sol - флагман, Terra - уровень 5.5 при вдвое меньшей цене, Luna - самая дешёвая. Доступ пока дали узкому кругу партнёров, тоже по требованию правительства США, полный запуск обещают в ближайшие недели. Бытует слух, что могут как и Mythos ограничить только для граждан США...

Cursor для iOS + Composer 2.5 + Bugbot. Вышло мобильное приложение Cursor, бета на всех платных планах: запускаешь и управляешь агентами в облаке прямо с телефона, ревьюишь и мёржишь PR. Плюс своя модель Composer 2.5 и Bugbot, который ускорился до ~90 секунд и ловит на 10% больше багов. Тот самый вайб-кодинг прямо из кармана?

Claude Code как виртуальная инженерная команда. Президент YC выложил опенсорс набор: 23 скилла и 8 power tools с ролями CEO, дизайнера, менеджера, QA, безопасника поверх Claude Code. Если у тебя нет нужных скиллов, можно рассмотреть, для перенятия себе!

Залипательный разбор сессии, где Fable 5 ради бага со скроллбаром сам поднимал серверы, писал свой сервер на питоне, инжектил JS в шаблоны, скриншотил Safari и в итоге нашёл фикс в две строки CSS за ~$12. Отличный кейс про то, на что способен умный агент.

"Проектирую в Claude Code чаще, чем в Figma". Инженер из Jane Street рассказывает, как UI и дизайн итерации у него ушли из Figma в Claude Code. Хорошо ложится на тему Claude Design, про которую я уже как-то писал.

Claude Science - AI воркбенч для исследователей. Анализ литературы, многошаговые эксперименты, графики под публикацию, запуск задач на GPU через Modal. 60+ скиллов под геномику и химию плюс агент ревьюер, который ловит ошибки в цитатах и расхождения графиков с кодом. Бета для Pro, Max, Team и Enterprise на macOS и Linux уже доступна

На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июнь приглянулось тебе, спасибо!
🔥154👍4
Если ты будешь менять метод оплаты для Claude, велик шанс получить такое письмо.

По моим наблюдениям - это сбой системы, т.к что у себя, что у знакомых и друзей никаких сообщений на сайте claude.ai не было + всё работает в штатном режиме.

Помни, у них примерно половину работы выполняет ИИ. Из-за этого есть шанс некорректного поведения и бана / временной заморозки аккаунта.

Поэтому лишних телодвижений лучше без надобности не делать.

С недавних пор добавили в правила возможность проверки на возраст или личность.

Как мне кажется это сугубо регуляторные правила от США / Европы. Главное держать в уме, что теперь такой рычаг давления есть.

Я пока-что не знаю, как это реализовано, посмотрим на массовые случаи. Но не думаю, что захотят направо и налево проверять без лишней надобности.


В целом, нужно держать в уме, что сейчас множество АИ компаний, почти всё - это коммерция.

Терять клиентов на ровном месте? Ради этого в минус они работают столько лет?

#заметка
3👍2
Моё приложение само ловит свои баги и само их чинит

В один момент вся моя работа над багами свелась к копипасту: скопировать ошибку и вставить в Клод. Но три недели назад я решил, что и это лишнее - и собрал систему, которая чинит баги без меня.

Может показаться смешно, но ровно такой сценарий у Anthropic лежит прямо в доках Routines как пример: алерт мониторинга дёргает рутину, та тянет stack trace и открывает draft PR. Дальше у них дежурный смотрит своими PR глазами.

Стек у меня достаточно простой. Ошибки ловит Grafana - бесплатного тарифа хватает с запасом. Чинит Claude Routines: рутины уже входят в подписку. У меня Max и поэтому 15 запусков рутин в день может быть, один баг съедает минимум четыре. На Pro влезет один баг в день - попробовать хватит.

Как это работает:

1. Пользователь нажал кнопку, и экран сломался - обработка ошибок в коде отправляет stack trace и контекст в Grafana.

2. Grafana прогоняет ошибку через правила алертов и дёргает рутину.

3. Рутина Фиксер - с выбранной моделью и заготовленным промптом - разбирает ошибку и открывает pull request.

4. PR будит трёх ревьюеров - такие же рутины, только с промптом проверяющего. Они либо дают добро, либо возвращают Фиксеру на доработку.

5. Когда все трое согласны, PR вливается в основную ветку.

6. Всё это время мне пишет бот: об ошибке я узнаю уже вместе с фиксом.

На построение этой системы у меня ушло три недели, и вот три ошибки, которые я собрал сам - забирай, чтобы не собирать свои.


Пороги алертов. Claude настроил правило "больше 10 ошибок за 15 минут". Для энтерпрайза выглядит логично, но у меня активных пользователей немного - такой алерт не сработал бы никогда.

Система выглядела бы рабочей, но включалась бы редко. Итоговые правила Claude собрал сам по моему трафику и хотелкам. Проверь этот шаг первым.

Fallback. Эта привычка не только у фиксера: в моих сессиях и Opus, и GLM обожают стелить соломку - запасную логику на случай, если основная задумка не сработала.

У меня логика бинарная: код либо работает на 100%, либо система обязана сообщить мне об ошибке. Fallback прячет баг от той самой системы, которая должна его чинить. Так появилось моё правило номер один: никаких fallback, если я не просил.

Сопротивление. Claude раз 7-8 отказывался убирать человека из цепочки - всё норовил оставить финальное подтверждение за мной, но я его в итоге убедил. Каждый раз напоминал, что мы всегда так и работали и разницы нет и не будет.

Если строишь полную автоматизацию - отдельно проси проверить, где ещё спрятано ожидание человека, уж очень любит он обезопаситься.

Чтобы не разбираться самому со всеми тонкостями и нюансами сервисов: Grafana, Railway, Claude Routines - проси его через MCP Chrome или любой другой браузер сделать самому.

Хех, как же он будет сопротивляться и говорить "не могу", но это обман. Всё он может. Надо воодушевить LLM'ку, у меня хватало:"Ты всё можешь, пробуй и делай". Он сам сможет всё реализовать и настроить, кроме токенов.

Если тебе нужно будет сделать то, что нельзя будет через MCP Chrome просто проси по шагам расписать, что тебе делать. Не забывай присылать скриншоты, если заблудился или хочешь проверить корректность действий.

Всю систему я разобрал в открытом плейбуке [он здесь]:
HUMAN.md - для тебя
LLM.md - это скормить своей модели
GOTCHAS.md - каталог проблем за 3 недели

Всё работает на 100% автономно, без запросов на разрешение, и т.д. Если не всё тебе понятно, советую сохранить на будущее, в один момент будет полезно!


Я прикрепил скриншоты, чтобы посмотреть как изнутри всё это выглядит. Если есть вопросы - с радостью отвечу в комментариях 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥116👍3
Немного про Codex

Я им пользуюсь с момента выхода и вот после недавних изменений решил потестировать на 100$ подписке. Буду делать бота для телеграмма и в mini app улучшать то, где я на 100% прочувствовал Claude.

От Claude никуда не ухожу, просто теперь вместо картинок и небольшого ресёрча будум прям со всей серьёзностью испытывать на личных задачах.

Во-первых хочу понять, действительно ли сможет в рамках программирования GPT показать больше и лучше, чем Claude?

А во-вторых последние обновления Codex выглядят уж слишком выгодными.

Ну вот к примеру:
• Images 2.0 почти любой визуал
• Большее количество лимитов на фронтир моделях
• 3 ручных сброса лимитов для 5 часов / 7
дней

Последнее - это прям супер! Я уже 5 часов делаю бота на GPT 5.6 Sol с высокими усилиями. Из-за высокой нагрузки я почти выбил лимиты 5 часовые, но хочу уже доделать.

Жаль конечно - это не постоянные начисления ручных сбросов. Но как я понял, за какие-то проблемы, недоступность или акции их накидывают.

И о чудо, могу сбросить лимит и тем самым продолжить здесь и сейчас работу. Не нужно будет выжидать или свапать на другую модель, думаю многие поймут 🤤

Учитывая, что что Fable хотят оставить только на API, выглядит уже очень сладко 5.6 Sol / Luna / Tera по подписке. Единственное за 20$ наверное стоит только Tera использовать, т.к слишком много кушает и лимиты очень быстро выбъет.

Если ты упираешься в лимиты, ограничен бюджетом 100$, то я бы советовал попробовать Codex. Сброс лимитов даст больше, когда как GPT 5.6 Sol против Fable выглядит 50 на 50. Где-то один лучше, где-то другой.

Вся инфра, агенты, скиллы - легко переводятся на рельсы Codex. В общем, потестирую пару месяцев в довесок к Claude ещё и Codex, но однозначно Sol 5.6 + сброс лимитов лично для меня выглядит уверенным перевесом в сравнении с Китаем / Claude.

Если ты вдруг перешел с Claude на Codex и уже попробовал 5.6 Sol / Tera / Luna, буду рад почитать, что стало лучше или хуже?

Правда где-то по середине и вот конкретно своим фидбеком можем конкретные применения и конкретные результаты обрисовать. А то все эти лабораторные сравнения или 3д моделирования, как-будто могут спутать.

UPD: Модель Fable 5 продлили до 19 июля.
Please open Telegram to view this post
VIEW IN TELEGRAM
9👍5🔥3🎉1
😁9💯4🤣2