Код на вайбах
1.24K subscribers
59 photos
17 videos
22 files
58 links
Кодю с AI, делаю продукты. Делюсь тем, что работает: промпты, инструменты, набитые шишки. Личный опыт, который поможет тебе. Для личной связи @somestay07 | Чат @codeonvibes_chat
Download Telegram
Claude без хаоса и лишних трат: Projects и Artifacts

Привет и добро пожаловать на первый урок второго модуля. Собираем из окна чата постоянное рабочее место, чтобы не начинать каждый раз с пустой переписки и не объяснять заново, чем ты занимаешься.

😉 https://youtu.be/GIa6F0Qg6rE

Что внутри:

1. Проект под своё дело. Тон и контекст задаёшь один раз, нужные файлы лежат рядом, объяснять заново не нужно. Покажу разницу между бесплатным и платным проектом, какие фичи улучшат твою работу.

2. Артефакт. В первом модуле мы обзорно делали сайт, теперь же вспомним, сделаем пару примеров и разберёмся где и как могут пригодится. Спойлер: мало кто использует, хотя бесплатны и полезны.

3. MCP, Skills и Deep Research. Обзорной экскурсией посмотрим: что это такое и куда смотреть дальше. Эти умения актуальны и нужны при работе с любой AI. Именно умение работать с MCP и Skills повысят твою эффективность и рещультат на новый уровень.

4. Деньги. Где кончается бесплатное и как не влететь на счёт по API. Расскажу, как я даже выставив лимиты попал на небольшую сумму. Готов поспорить мало где про этот очень важный нюанс, про "бонусные кредиты" говорят.

5. Effort. Обзорная экскурсия, где ты поймёшь как и где можно потерять лимиты / токены за зря, поделюсь личным опытом. Крайне полезное знание, легкое для понимания и малозаметное для большинства.

Весь монтаж этого видео курировал ИИ: убирал дублирование, добавлял монтажные моменты, баннеры, звуки и многое другое!

Буду рад обратной связи от каждого, кому и что понравилось или не понравилось в рамках монтажа. Чего хотелось бы видеть от монтажа или наоборот, не хотелось бы видеть.


Парочку моментов в виде немного корявой обводки уже записал. Так вышло, что именно этот монтаж курировал Codex, и вышло косячнее и длиннее (намного), чем Claude.

Если соберём 65 огоньков, сразу сяду реализацию видео про то, как я собрал ИИ монтажора. Спойлер, много читал, изучал, да это не прямая замена монтажоров, да при помощи CSS, HTML и пр. но на этом реализация не заканчивается!

Ну и да, спасибо за внимание, желаю приятного просмотра и наконец-то можно будет ещё качественнее реализовывать бесплатный курс по ИИ и вайбкодингу 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥225👍3
Я поймал себя на мысли, что каждому из нас есть чем поделиться, ч. 1: опыт и знания.

Друг писал код с Codex, но общался с ним как с чат-ботом. Я посоветовал ему запустить Codex приложением на компьютере, чтобы тот видел весь проект, а не один вставленный кусок.

Спустя пару дней он написал: "Задачи выполняются лучше, багов почти нет, всем доволен, спасибо!".

Давай в комментариях поделимся тем, что улучшает или облегчает нашу работу.


Всё, что угодно: агент маркетолог, полезный скилл, свой подход к работе с AI или первые шаги перед стартом проекта. Иногда одна чужая строчка экономит неделю работы.

Хватит пары слов и ссылки, ну и пару строк чем оно помогает. А если ты только начинаешь, спрашивай что угодно, даже если вопрос кажется тебе глупым.

Начну с себя, погнали? 👍
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥8👍31
Видео для опроса ниже. №1 - слева, №2 - справа.

Я часто видел в интернете сравнение в визуализации между фронтир LLM: Kimi, GPT, Claude, Qwen и т.д. Когда модель берёт задачу, понимает условие и начинает реализовывать.

Конкретно здесь не совсем с 0 графика, но при помощи ИИ монтажёра две модели реализовывали сценарий и описание работы для монтажёра. В работе над каждым видео участвовали:

• скиллы
• агенты
• MCP


И теперь, я хочу поделиться своим фидбеком на конкретных примерах.

Одно из этих видео делал Claude, а другой Codex. Claude делал на Opus 5.6 high, а Codex на Gpt 5.6 sol high

Обе LLM были полностью настроены под себя и проверены дважды на корректность настройки, обе модели работали с одной папкой.

Т.е всё одинаково было кроме самих LLM. Одно видео было в работе 2.5 часа, другое видео было 25 минут.

Попробуй посмотреть оба видео (звук можно выключить, важно оценить графику) и оценить для себя, опрос ниже 👇
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7😁51
Please open Telegram to view this post
VIEW IN TELEGRAM
4
Бесплатные сбросы от Тибо видимо кончились и теперь, как неожиданно и приятно, за сбросы лимитов нужно будет платить. Думаю для стимулирования интереса на какие-то даты, события будут давать редкие, сгораемые сбросы 👋

У меня на тарифе 200$ предлагают сбросить недельные за 40$
Please open Telegram to view this post
VIEW IN TELEGRAM
😭8🙈53
Код на вайбах
Видео для опроса ниже. №1 - слева, №2 - справа. Я часто видел в интернете сравнение в визуализации между фронтир LLM: Kimi, GPT, Claude, Qwen и т.д. Когда модель берёт задачу, понимает условие и начинает реализовывать. Конкретно здесь не совсем с 0 графика…
Отвечая на опрос "Какая LLM" работала над видео

Слева 25 минут работал Claude Opus 5 в high effort reasoning. Справа работал GPT 5.6 sol в high effort reasoning и справился за 2.5 часа ...

... И между делом съел порядка 80 гб памяти вовремя работы, был сбой. При этом Opus 5 стартовал в минусе - от предыдущей LLM я не успел на 100% перенести все важные для монтажа файлы на архитектуру Claude Code. Если интересно как он сейчас делает монтаж, хороший пример.

Но для меня это не показатель, хоть я и пробовал 3 раза и в разное время. Пока-что не могу понять, почему хуже и дольше справился GPT, т.к проблем вовремя монтажа не было.

Но хочу отметить, что сейчас система справляется с задачей на отлично. Конечно не моушен монтаж "ВАУ" уровня. Но мне такой и не принципиален.

Помню свои первые постеры от ChatGPT - пиксельная каша мимо задумки. Сейчас постер от ChatGPT Images 2.0 я не отличу от работы иллюстратора за 2-3 тысячи рублей.

И тут хочу поделиться, что если одновременно работать с 2-3 AI задачами одновременно, батарейка усталости быстро стремится к 0. Происходит это из-за постоянного смена контекста:

1. Изучил ответ
2. Обдумал
3. Дал фидбек

И так по кругу. Каждый раз при получении результата от работы AI круг начинается заново. Но эта проблема присуща тем кто работает в 2+ одновременных LLM.

Хочется простого:"Ты же искуственный интеллект, почему я должен решать, отвечать на твои вопросы? Я тебе дал задачу и описал. Сделай как надо"

Решил поэтому скачать Hermes Agent и досконально в нём разобраться. Раньше он жил у меня в Telegram: десктопного приложения тогда не было, только терминал и мессенджеры.

И я несколько раз спрашивал: всё ли мы настроили из базового? Каждый раз слышал "да". И всё равно пропустил главное - долгую память, ту, что живёт между чатами.

Внутри одного длинного диалога это не мешало. Проблемы будут между чатами: помощник будет чаще повторяться, хуже помнить решения и причины прошлых договорённостей.

Держаться тем самым за короткие MEMORY.md с USER.md и переспрашивать.


Отсюда мой персональный помощник просел по качеству: больше повторов, хуже помнит решения, проекты, предпочтения и причины прошлых договорённостей.

В итоге, я нисколько не разочаровался в плохих результата монтажора, напротив, текущий GPT, с его бесплатными, хоть и редкими, сбросами можно интегрировать в другие системы и работать уже иначе.

Даже понимая работу и что где устроено, можно пропустить важный файл и тем самым просесть по качеству и получать результат хуже.


Если тебе сейчас тяжело разобраться, что-то работает не совсем так как ожидал, это нормально. Возможно стоит спросить, вдруг работает не [до конца] правильно?

Отсюда следует:
• Не гнаться за количеством задействованных MCP, Skills, Agent
• Начинать с базовых вещей и двигаться постепенно

Умение разбираться в фундаментальных вещах поможет от облачного и до локального (?), от GPT и до Codex.

А ты сталкивался с проблемой менеджмента 2-3 AI задач одновременно? Как решил? 🤐
Please open Telegram to view this post
VIEW IN TELEGRAM
5🔥51
Вот чем мне нравится Codex - за свои баги накидывают бесплатных лимитов. Последнее время лимиты могли уходить быстрее из-за бага с кешированием. Завтра он будет исправлен.

И как извинение - всем платным подпискам сбросят лимиты 25 августа в 00:00 по Москве.


Так же за 20 млн пользователей всем начислили бесплатные сброс в любое время (ограничен до 21 сентября)
🔥7👍43
Одно из лучших решений для автономности

Это добавление quality gate на нужный для тебя этап работы твоего AI. Проблема - тебе каждый раз нужно проверять результат работы AI (агента / субагентов):

Попросил нарисовать картинку? Проверяешь в конце качество изображение и корректность текста

Попросил сделать монтаж для видео? Проверяешь картинку, звук, уместность мемов, цветокор, вставки и тд

Попросил написать код? Проверяешь уместное использование паттернов программирования, договорённостей, приверженность архитектуры

Мультиагентные пайплайны - один агент пишет код, другой рефакторит, третий пишет тесты. Без явного гейта между этапами плохой промежуточный результат тащится дальше и множит переделки.

Чтобы отбросить промежуточные этапы, когда результат ещё готовится и он далёк от нужного качества - попроси своего AI реализовать quality gate. Для меня он включается в конце работы всех задействованых агентов.

К примеру, видео отдаю в монтаж ИИ агенту. Подключаются нужные субагенты. Они начинают нарезать на вставки, уместные картинки, графику и т.д. После того как все закончили - гонится гейт.

После прогона есть система оценок, к примеру:

1. ЗВУК - PASS
2. Memes - BLOCK и причина блока, чего не хватает до нужной оценки
3. ВРЕМЯ - PASS WITH FIXIES гейт даёт не критичные, но улучшающие исправления для работы
4. И т.д.

Я бы ещё порекомендовал не гнаться за 85-90-100 оценкой. Когда будешь внедрять гейт в ходе диалога с LLM попроси её саму оценить какие оценки уместные и почему. Так же попроси LLM оценить то, что будем проверять и в какой момент.

Мой монтаж ускорился X2, после того как я стал применять гейты сразу после окончания работы всех агентов. И так по кругу. Агенты берут результат ниже целевой оценки и доделывают.


Напиши своей AI и спроси, где и как можно будет внедрить систему гейтов. Пусть сходит и изучит всё необходимое для реализации. Начни с одной реализации и посмотри, как твоя работа с AI пойдёт дальше.

Так же как и у навыков и у агентов у гейтов могут быть слепые зоны, что-то забыто на оценку и ложные BLOCK / PASS.

Чтобы избежать этого попроси LLM оценить систему и сделать напоминание на ревью через 7 / 14 / 28 дней или после каждой 2-3 работы.

Надеюсь теперь твоя работа будет более качественнее и быстрее 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥94💯2
Ставь лайк, если есть сходство. Посмотрим сколько нас! 🐒
Please open Telegram to view this post
VIEW IN TELEGRAM
👍27😁6🍌4🤩1
Код на вайбах
Вайб-дайджест #5 | июль Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #4 и #3 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе. • Вышел Claude Opus 5, почти интеллект Fable 5 за полцены. Стоимость…
Вайб-дайджест #6 | август

Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #5 и #4 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.

Claude Code научился писать жалобу на себя. Когда в сессии что-то ломается или ты тычешь его носом в ошибку, он готовит отчёт, а ты читаешь и отправляешь через /feedback. [подробнее тут]

OpenClaw 2.0 вышел 30 августа, и это самый крупный апдейт за историю проекта: 933 контрибьютора, из них 569 впервые, 16 тысяч пул-реквестов - около половины всего, что вообще влили в OpenClaw. [подробнее тут]

Claude Code с 14 августа работает в auto mode по умолчанию. Большинство действий идёт без вопроса, вместо тебя их смотрит классификатор: он блокирует необратимое и то, что лезет за пределы проекта. Назад к подтверждениям - Shift+Tab, правила видно в /permissions на вкладке auto mode. [подробнее тут]

• "Почему с Opus 5 работать тяжелее". Если тезисно: 4.7 и 4.8 останавливались и переспрашивали, когда задача была непонятной. Пятый угадывает и идёт дальше, поэтому за ним приходится присматривать. [подробнее тут]

Z.ai выложила открытые веса GLM 5.3. Контекст 1M, цена 1.4 и 4.4 доллара за миллион и Coding Plan от 18 долларов в месяц. Если лимиты поджимают, может стать хорошим помощником в кодинге. Цифры по бенчмаркам, правда, снова их собственные 🤓 [подробнее тут]

Твой текст от Claude теперь помечен невидимым водяным знаком. Метка живёт в выборе слов между равнозначными вариантами, лишних символов не добавляет и на качество не влияет. А если для тебя это помеха, попробуй этот skill, он поможет! [подробнее тут]

Codex вернул пятичасовой лимит на Plus, с 25 августа, после шести недель без потолка. На Pro за 100 и 200 долларов лимит в ближайшие месяцы возвращать не будут. [подробнее тут]

Cursor учит облачных агентов держать цель: командой /goal ставишь долгую задачу, и агент идёт к ней через длинную сессию, подхватывает работу по событиям и не обрывается, когда ты пишешь ему вдогонку - правка ждёт следующего вызова инструмента. [подробнее тут]

Codex подтянул мелочи в терминале: @ упоминания задач, автоназвания, кликабельные ссылки, нормальный выбор в /copy и шорткаты режимов прав. Тем, кто ушёл на Codex из-за лимитов, работать станет чуть приятнее. [подробнее тут]

Claude in Chrome вышел из беты на все платные планы 26 августа. Боковая панель стала полноценным Cowork: твои скиллы и коннекторы на месте, начал в браузере? Продолжил на десктопе. Работает Claude сам, без подтверждения каждого шага, так-что подумай, в каком окне его запускаешь, чтобы клодик не нашкодил. [подробнее тут]

Claude Code CLI стал есть вдвое меньше процессора на пиках. Сборщик мусора внутри Bun бегал по таймеру и отнимал CPU прямо посреди хода, теперь он ждёт, когда процесс освободится. Заодно десктоп стартует вдвое быстрее, чем месяц назад, а длинные ответы на вебе перестали дёргаться. [подробнее тут]

Anthropic режет недельные лимиты Claude Code. С 14 сентября временный буст +50% снимают, вместо него дают постоянные +25% к майской базе. Против августовских лимитов это минус 17%. Касается Pro, Max, Team и Enterprise с местами. У меня неделя и так кончается раньше воскресенья 😁. [подробнее тут]

SpaceX закрыла покупку Cursor и через две недели OpenAI объявила о разрыве сотрудничества. В конце августа OpenAI сказала, что прямой доступ Cursor к её моделям выключат 12 ноября. В Cursor говорят, доля OpenAI там около 5% трафика: если ты в этих процентах, до ноября есть время переезжать. [подробнее тут]

На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо! 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥112🤓2
Вышел Claude Fable 5.1 и Claude Mythos 5.1

Anthropic выкатили уже доступное везде обновление. Что стало лучше:

Дебаггинг - модель копает до корня вместо того, чтобы костылить симптом. Red Hat прогнали её по своим сломанным сборкам: причину нашла у каждой, причём на любом уровне эффорта.

Долгая работа. Исследователи про прошлые модели пишут: чем дольше те работали, тем труднее было за ними уследить. Эта же остаётся читаемой на длинной многошаговой задаче.

Скорость - в тестах она вышла примерно вдвое быстрее Opus 5 и потратила вдвое меньше токенов.

По ценам вход и выход стоят столько же: 10 и 50 долларов за миллион токенов. Понизилась лишь одна строка прайса - чтение из кеша. Был доллар за миллион, стало 25 центов.

Как заявляют из Anthropic обычная нагрузка дешевеет примерно на четверть, тяжёлая агентная - до 45%.

Всем сбросили лимиты, можно тестировать и проверять! 🤗
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥125👍2
Мощность Fable 5.1 по цене Opus 5

Попробуй понизить режим нагрузки для своего Fable 5.1 до уровня low. В CursorBench тесте Fable 5.1 в режиме низкой нагрузки показывает результаты, сопоставимые с Fable 5 в режиме высокой нагрузки, при этом его стоимость составляет лишь треть от стоимости последнего.

К примеру, у меня за пару часов в режиме high улетает примерно 8% для недельного лимита на тарифе за 200$.
🔥9👍31💯1
This media is not supported in your browser
VIEW IN TELEGRAM
В честь выхода новой модели Astra для ChatGPT команда OpenAI будет каждый день раздавать плановый сброс (живет месяц), пока модель не выкатят на всех. За сегодня уже выдали, но потенциально ещё есть пару дней.

Astra будет первой моделью, почти решившая ARC‑AGI‑3, но называть её первой доказанной AGI пока нельзя. Текущие 98.6% не 100%. К слову у Opus 5 - это значение равное 30%.

AGI - это гипотетический искусственный общий интеллект, способный понимать, обучаться и решать любые интеллектуальные задачи наравне с человеком или превосходя.


Интересно будет глянуть и протестировать, учитывая приближенность к 100% AGI. Как-всегда OpenAI и Anthropic не перестают удивлять. А учитывая, что OpenAI даёт возможность использовать подписочную модель для сторонних интеграций без риска бана - это просто подарок какой-то.

Сейчас сняли эмбарго на отзывы от тестировщиков новой модели, крупные блогеры тестировали самые разные задачи, однозначно все оценили скачок связанный с медиа: игры, моделирование.

UPD: GPT 6 Astra доступна
🔥104👍3
🤖 Раскатили GPT 6 Astra, проверяйте и делитесь в комментарии, как в итоге, ожидания оправдались? Стало лучше или хуже? 🤔

Здесь можно изучить подробноо про промпты, миграцию и др.

P.S. Claude Code сбросил лимиты 👍
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥41🤯1
Рубрика:"А что, так можно было?"

1. GPT 6 - Astra на low effort reasoning работает сравни GPT 5.6 high effort reasoning. Что примечательно, Fable 5.1 так же себя показывает в сравнении с Opus 5. Отсюда можно проследить тенденцию, что на следующих LLM версиях стоит пробовать новое в low по отношению к прошлому high.

По лимитам может выйти так же / чуть дороже, а сам результат более качественным.

2. Co-founder и лид разработки Hermes Agent обнаружил для себя чудо синергии из Fable 5.1 как оркестратор и GPT 6 Astra как исполнитель. Внушительная связка может и другой: Fable 5.1 + GLM, DeepSeek и т.д.

К слову пару дней назад он же отрефакторил Hermes Agent и вычистил 34% и в целом провел рефакторинг по тех долг: god object почистил, баги заодного закрыл и т.д.

И что примичательно, всю дорогу прошел на Fable 5.1 в течение 17 часов и удалил по итогу 375K строк кода, тем самым кодовая база похудела с 1.04M до 650K. К слову на весь процесс понадобилось менее 50 итераций и 1320 субагентов в сумме.

Я как пользователь Hermes Agent обновился сразу и за всё время использования столкнулся лишь с парочкой багов. Не уверен, обновление повлияло или моя внутренняя работа, но как факт.

Если интересна такая рубрика - лайк и буду стараться находить такие интересные моменты ещё 🤗
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍30🔥811