Код на вайбах
1.24K subscribers
59 photos
17 videos
22 files
58 links
Кодю с AI, делаю продукты. Делюсь тем, что работает: промпты, инструменты, набитые шишки. Личный опыт, который поможет тебе. Для личной связи @somestay07 | Чат @codeonvibes_chat
Download Telegram
Рубрика:"А что, так можно было?"

1. GPT 6 - Astra на low effort reasoning работает сравни GPT 5.6 high effort reasoning. Что примечательно, Fable 5.1 так же себя показывает в сравнении с Opus 5. Отсюда можно проследить тенденцию, что на следующих LLM версиях стоит пробовать новое в low по отношению к прошлому high.

По лимитам может выйти так же / чуть дороже, а сам результат более качественным.

2. Co-founder и лид разработки Hermes Agent обнаружил для себя чудо синергии из Fable 5.1 как оркестратор и GPT 6 Astra как исполнитель. Внушительная связка может и другой: Fable 5.1 + GLM, DeepSeek и т.д.

К слову пару дней назад он же отрефакторил Hermes Agent и вычистил 34% и в целом провел рефакторинг по тех долг: god object почистил, баги заодного закрыл и т.д.

И что примичательно, всю дорогу прошел на Fable 5.1 в течение 17 часов и удалил по итогу 375K строк кода, тем самым кодовая база похудела с 1.04M до 650K. К слову на весь процесс понадобилось менее 50 итераций и 1320 субагентов в сумме.

Я как пользователь Hermes Agent обновился сразу и за всё время использования столкнулся лишь с парочкой багов. Не уверен, обновление повлияло или моя внутренняя работа, но как факт.

Если интересна такая рубрика - лайк и буду стараться находить такие интересные моменты ещё 🤗
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍30🔥811
This media is not supported in your browser
VIEW IN TELEGRAM
Вот такой ИИ монтаж мне сделал GPT-6 Astra, завтра будет видео. Про подход к разработке с применением AI, а так же наглядный замер работы:

• GPT-5.6 Sol
• Claude Code Opus 5
• Claude Code Fable 5.1
• GPT-6 Astra


Все, перечисленные выше LLM с обвязкой из агентов, пайплайнов, quality gate и т.д. и без неё! 🫢
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8🔥7🏆5
GPT-6 Astra и Claude: моя система ИИ-агентов на реальном проекте

В новом видео показываю свой ИИ-монтажёр: как устроена работа, где агенты допускают ошибки и что я менял после этих ошибок.

Что внутри:

Pipeline из 11 этапов: кто что делает и как передаёт работу дальше.
56 проверок и ошибки, которые проходят даже через них.
GPT-6 Astra, Fable 5.1, Opus 5 и GPT-5.6 Sol: примеры результатов и мои впечатления.
Что меняется с обвязкой: ролями, инструкциями и проверками.
Кроны в Claude и Codex: как запускать задачи по расписанию.
С чего начать свою систему, чтобы не потратить всё время на её улучшение.


Разбираю на примере монтажа, но подход можно и нужно применить к разработке, текстам и другим рабочим задачам. Помогаю где и как автоматизация мне помогает, где нужно моё участие.

😉 Смотреть: https://youtu.be/ffkM3WIeoRk
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥75👍2
Презентация из видео.png
18.9 MB
Комплект моей системы ИИ-монтажа, который можно адаптировать под свои задачи

Внутри: 13 ролей агентов, 5 навыков, pipeline, шаблоны и проверки. Убрал личные материалы и зависимости от моих папок, сохранил сам процесс работы.

Проще всего начать через самого ИИ. Распакуй архив, откройте папку в помощнике с доступом к файлам и напиши в духе:

Изучи README.md и устройство этого комплекта. Помоги адаптировать его под мою задачу: [опиши задачу].

Выбери полезные роли и проверки, объясни, что стоит перенять. Не подключай всё подряд. Если не хватает важной информации, задай вопросы.

Создай адаптацию в отдельной папке, сохрани существующие настройки. Проверь доступные инструменты, затем выполни небольшое пробное задание. Покажи результат и что пока не удалось проверить.


Необязательно вручную заполнять все шаблоны. Помощник может подготовить их вместе с тобой. Главное: объяснить, что ты делаешь, какой результат нужен и что важно сохранить.

Комплект пригодится и за пределами монтажа. Разделение ролей, передача работы, проверки и исправление ошибок можно перенести в разработку, тексты или исследования.

Сами задачи и критерии нужно заменить под свой проект самособой. Начни с одной небольшой задачи. Добавляйте роли там, где видите повторяющиеся ошибки или нехватку контроля.

Сам архив программы не устанавливает и ролики не рендерит, самособой без вирусов, но всегда проверяй на вирусы, когда качаешь из интернета!
🔥132👍1
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI выпустили GPT-Live-1

Доступно только по API при стоимости 0.05$ за минуту. Отличительная черта, что модель слушает и говорит.

Можно соединить со своим харнесом, настроить под свое железо, да и вообще, выглядит как дешевый call center.

Просто глянь видео, выглядит поражающе за ту цену, что предоставляют и возможности 😳

Детали прочитать можно здесь
👍6🔥31
Проверка пользы скилла в Claude Code

В Claude Code появилась claude plugin eval - проверка того, какую пользу даёт твой плагин и навыки внутри него.

Даёшь одинаковые задачи. Claude выполняет их с плагином и без, проверяет результаты по заданным критериям и показывает разницу.

К слову, хорошо дополняет тему quality gate, про которую уже писал и рассказывал выше. Можно проверить, помогают ли сами инструкции получать результат лучше или нет.

К примеру, у тебя есть скилл для ревью кода.

Ты прописал: искать баги, объяснять последствия и причины, предлагать исправления. Всё выглядит правильно, но на практике AI может пропустить ошибку и написать десять замечаний про название переменной 😩

Вот такой навык и можно проверить.

1. Обнови Claude Code. В терминале: claude update

2. Открой папку плагина и запусти. claude plugin eval init Claude изучит плагин и поможет подготовить задания и критерии. Тут нужно объяснить, что для тебя хороший результат.

Можно написать в духе:

Хочу проверить навык ревью кода. Подготовь несколько небольших примеров: с обращением к полю у null, с ошибкой на единицу в цикле и с корректным кодом без багов.

Включи сам код в задания. Проверяй, нашёл ли Claude заложенную ошибку, объяснил ли последствия и предложил ли подходящее исправление. На корректном коде проверь, не выдумывает ли проблемы. Замечания только по стилю не считай найденными багами.


Claude предложит тесты, сделает пробный прогон и оценит стоимость полного запуска.

Посмотри сами проверки. Если попросить оценивать "насколько ответ хороший", можно получить красивую оценку, которая мало что объясняет.

3. Запусти сравнение. Когда подготовка закончится, выйди через /exit и выполни: claude plugin eval . --runs 1 это короткая проверка: по одному запуску каждой задачи с плагином и без.

4. Посмотри, что получилось. В терминале будут две оценки и разница между ними. В HTML отчёте: подробности, какие проверки прошли и где ошибки.

Допустим, скилл помог найти баг, который без него Claude пропускал. Уже полезно. А если результаты одинаковые, на этих задачах дополнительная польза пока не видна.

Что это даёт тебе?

Добавил инструкции - можешь проверить, стало ли лучше?
Переписал скилл - можешь заметить, если он начал пропускать старые ошибки.
Сменил модель - можешь заново проверить свою обвязку на тех же задачах.


Начни с одного навыка и нескольких проблем, которые у тебя повторяются. Потом исправляй то, что видно в отчёте, успехов! 👍
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥8👍54
Почему с новой моделью Astra старые настройки могут работать хуже

Если ты давно работаешь с AI, наверняка накопились инструкции на каждый случай. Тут не проверил? Дописал правило. Здесь полез менять лишнее? Запретил.

В следующий раз остановился на полпути и добавил "работай до конца". Переключаешься на GPT-5.6 sol и работа идёт как-то иначе.

OpenAI разобрали этот момент. Часть инструкций, которыми мы исправляли поведение прошлых моделей, мешает новой.

Что поменялось с 5.6?

В рекомендациях для Astra отмечают: она сильнее реагирует на инструкции из файлов, сама тщательнее проверяет работу и чаще уточняет, если ответ может повлиять на результат.

Отсюда неприятный момент. Твоё старое "перед любым действием спроси" может затормозить даже обычную, небольшую, локальную правку. А "проверяй всё после каждого изменения" - запускать проверки, которые к этой задаче не относятся.

К примеру, в системе ИИ-монтажа нужно поправить субтитры. Но навык описан как "используй для любой работы с видео", а внутри уже весь процесс от разбора исходников до финального рендера.


Ты попросил исправить текст, но инструкции потянули за собой половину монтажной системы. И лимиты уходят на выполнение правил, которые ты сам когда-то добавил 😢

И ещё, если одни навыки используют разные модели, учитывай это при правках. Чтобы не разбирать всё вручную, можно дать AI такой запрос:


Хочу настроить инструкции этого проекта под GPT-6 Astra, сохранив полезные правила и требования проекта.

Прочитай:
https://developers.openai.com/blog/rethinking-skills-and-prompts-for-gpt-6-astra

Затем разбери инструкции, которые реально влияют на твою работу здесь: AGENTS.md, доступные навыки и связанные с ними документы. Пока ничего не меняй.

Найди конкретные места, из-за которых ты можешь:
• подключать навык к неподходящей задаче
• читать лишние документы
• повторять проверки без новой причины
• запрашивать подтверждение уже порученной работы
• останавливаться до получения готового результата.

Для каждого найденного места покажи файл и фразу, объясни на примере задачи, к чему она может привести, и предложи точечную замену. Отделяй наблюдаемую проблему от предположения.

Сохрани требования к качеству, ограничения доступа и важные договорённости проекта. Если инструкции нужны и другим моделям, учти это. Не сокращай текст только ради объёма.

Выбери до трёх наиболее полезных изменений и предложи небольшие задания, на которых можно сравнить поведение до и после. Подготовь правки для просмотра.


После применения посмотри, стало ли меньше лишних действий и переделок. Короткий AGENTS.md сам по себе ещё не означает, что агент работает лучше 🤫
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5👍31
This media is not supported in your browser
VIEW IN TELEGRAM
Claude теперь сам раздаёт задачи другим Claude и работает в облаке ☁️

Anthropic представили Projects в Claude Code. Ты ведёшь один общий разговор и Claude запускает отдельные сессии, распределяет между ними работу и собирает результаты.

Кто работал в нескольких AI чатах одновременно, знает: в какой-то момент сам становишься посыльным. Одному принеси контекст, другому передай решение, у третьего выясни, почему он остановился.

И здесь эту координацию берёт на себя Claude.

Чем это отличается от субагентов? 🤔


Субагенту обычно поручают отдельную часть задачи внутри основной сессии: изучить код, найти причину ошибки, проверить изменения. Он возвращает результат тому, кто его запустил.

В Projects Claude координирует несколько самостоятельных облачных сессий. У каждой свой контекст и ход работы и новые сессии получают общие инструкции и память проекта. Ты можешь постепенно добавлять задачи в один разговор и возвращаться к результатам.

Например, ты развиваешь приложение. Сегодня нужно исправить поиск и обновить зависимости, завтра прилетит новая ошибка, через неделю изменятся требования. Всё это можно вести в одном Projects, сохраняя договорённости между задачами.

Из полезного:


Общий контекст. Новые сессии получают инструкции и память проекта. Объяснил важную особенность? Попроси Claude её запомнить, чтобы следующие исполнители учитывали это в работе.

Работа в облаке. Можно закрыть приложение или выключить ноутбук: запущенные задачи продолжат выполняться. Если понадобится твой ответ или разрешение, соответствующая сессия подождёт.

Сопровождение изменений. Исполнитель может подготовить pull request и затем следить за ним: исправлять падения CI и реагировать на замечания ревью.

Все результаты в одном месте. В Overview видно, что выполняется, что готово к проверке и где нужен человек.

И не только код. Можно загрузить документы или обращения пользователей и поручать их анализ. Репозиторий для таких задач не обязателен.

Как попробовать?


1. Открой claude.ai/code или вкладку Code в Claude Desktop.

2. Нажми Projects -> New project, укажи цель и добавь репозиторий или файлы.

3. В Project settings -> Memory -> Project instructions задай правила работы и проверки результата.

4. Начни с небольшой задачи, оцени результат и расход лимитов, что самое важное.


Для работы с кодом нужен репозиторий на GitHub и доступ через Claude GitHub App. Через CLI новые Projects пока недоступны.

Сейчас это браузер и Desktop, выполнение задач облачное в обоих случаях. Локальные сценарии обещают позже.

Доступ открывают постепенно пользователям Pro и Max. Если Projects ещё нет, можно записаться в лист ожидания.

И главное: координатор и исполнители расходуют общие лимиты подписки. По умолчанию задачи запускаются на Opus с высоким уровнем усилий. Собрать себе маленький отдел разработки теперь стало проще! 👍
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥75👍2
Подписку Claude теперь можно использовать в Hermes

Если у тебя уже настроен Hermes и есть Claude Pro или Max подписка, появилась возможность использовать их вместе. Nous Research выпустили плагин Claude Subscription DirectSDK - он подключает подписку через установленный Claude Code.

Ты продолжаешь работать в Hermes со своими skills, памятью и инструментами, но запросы к модели идут через твой аккаунт Claude. Отдельный API ключ для этого подключения не нужен.

Если пропустил, про сам Hermes рассказывал здесь.

Как подключить

Нужны Hermes 0.21.4+, установленный Claude Code и подписка Pro или Max:


hermes plugins install claude-subscription-directsdk
claude auth login
hermes model


В списке провайдеров выбери Claude Subscription DirectSDK (Experimental), затем модель.

Что с лимитами?

Запросы расходуют квоту подписки. Anthropic ранее планировали отдельные SDK кредиты, но приостановили переход: Agent SDK и claude -p пока продолжают использовать лимиты тарифа.

Есть нюанс: в тесте авторов плагина сопоставимый объём токенов расходовал примерно в 1,7 раза больше лимита, чем интерактивный Claude Code.

Это не значит, что каждая задача обойдётся ровно в 1,7 раза дороже. Агенты могут делать разное количество запросов и передавать разный объём контекста. Сравнивать лучше на своих задачах.

И самое главное, как с правилами Anthropic?

Правила допускают вход со своей подпиской в неизменённый Claude Code, в том числе на сторонней платформе при соблюдении условий. Поэтому сам запуск через Hermes ещё не означает нарушение. У автора Hermes прямо спросили в комментариях - нарушает ли этот плагин Terms Of Service? Ответ был:"НЕТ"

Если важно сохранить аккаунт, можно подождать и посмотреть результаты других. Если не терпится попробовать, можно завести отдельный аккаунт и проверить. По ToS обычно отлетают очень быстро сейчас 😢



Сама новость
Плагин и документация
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6👍21