Вот чем мне нравится Codex - за свои баги накидывают бесплатных лимитов. Последнее время лимиты могли уходить быстрее из-за бага с кешированием. Завтра он будет исправлен.
Так же за 20 млн пользователей всем начислили бесплатные сброс в любое время (ограничен до 21 сентября)
И как извинение - всем платным подпискам сбросят лимиты 25 августа в 00:00 по Москве.
Так же за 20 млн пользователей всем начислили бесплатные сброс в любое время (ограничен до 21 сентября)
🔥7👍4❤3
Одно из лучших решений для автономности
Это добавление quality gate на нужный для тебя этап работы твоего AI. Проблема - тебе каждый раз нужно проверять результат работы AI (агента / субагентов):
• Попросил нарисовать картинку? Проверяешь в конце качество изображение и корректность текста
• Попросил сделать монтаж для видео? Проверяешь картинку, звук, уместность мемов, цветокор, вставки и тд
• Попросил написать код? Проверяешь уместное использование паттернов программирования, договорённостей, приверженность архитектуры
Мультиагентные пайплайны - один агент пишет код, другой рефакторит, третий пишет тесты. Без явного гейта между этапами плохой промежуточный результат тащится дальше и множит переделки.
Чтобы отбросить промежуточные этапы, когда результат ещё готовится и он далёк от нужного качества - попроси своего AI реализовать quality gate. Для меня он включается в конце работы всех задействованых агентов.
К примеру, видео отдаю в монтаж ИИ агенту. Подключаются нужные субагенты. Они начинают нарезать на вставки, уместные картинки, графику и т.д. После того как все закончили - гонится гейт.
После прогона есть система оценок, к примеру:
1. ЗВУК - PASS
2. Memes - BLOCK и причина блока, чего не хватает до нужной оценки
3. ВРЕМЯ - PASS WITH FIXIES гейт даёт не критичные, но улучшающие исправления для работы
4. И т.д.
Я бы ещё порекомендовал не гнаться за 85-90-100 оценкой. Когда будешь внедрять гейт в ходе диалога с LLM попроси её саму оценить какие оценки уместные и почему. Так же попроси LLM оценить то, что будем проверять и в какой момент.
Напиши своей AI и спроси, где и как можно будет внедрить систему гейтов. Пусть сходит и изучит всё необходимое для реализации. Начни с одной реализации и посмотри, как твоя работа с AI пойдёт дальше.
Так же как и у навыков и у агентов у гейтов могут быть слепые зоны, что-то забыто на оценку и ложные BLOCK / PASS.
Чтобы избежать этого попроси LLM оценить систему и сделать напоминание на ревью через 7 / 14 / 28 дней или после каждой 2-3 работы.
Надеюсь теперь твоя работа будет более качественнее и быстрее👋
Это добавление quality gate на нужный для тебя этап работы твоего AI. Проблема - тебе каждый раз нужно проверять результат работы AI (агента / субагентов):
• Попросил нарисовать картинку? Проверяешь в конце качество изображение и корректность текста
• Попросил сделать монтаж для видео? Проверяешь картинку, звук, уместность мемов, цветокор, вставки и тд
• Попросил написать код? Проверяешь уместное использование паттернов программирования, договорённостей, приверженность архитектуры
Мультиагентные пайплайны - один агент пишет код, другой рефакторит, третий пишет тесты. Без явного гейта между этапами плохой промежуточный результат тащится дальше и множит переделки.
Чтобы отбросить промежуточные этапы, когда результат ещё готовится и он далёк от нужного качества - попроси своего AI реализовать quality gate. Для меня он включается в конце работы всех задействованых агентов.
К примеру, видео отдаю в монтаж ИИ агенту. Подключаются нужные субагенты. Они начинают нарезать на вставки, уместные картинки, графику и т.д. После того как все закончили - гонится гейт.
После прогона есть система оценок, к примеру:
1. ЗВУК - PASS
2. Memes - BLOCK и причина блока, чего не хватает до нужной оценки
3. ВРЕМЯ - PASS WITH FIXIES гейт даёт не критичные, но улучшающие исправления для работы
4. И т.д.
Я бы ещё порекомендовал не гнаться за 85-90-100 оценкой. Когда будешь внедрять гейт в ходе диалога с LLM попроси её саму оценить какие оценки уместные и почему. Так же попроси LLM оценить то, что будем проверять и в какой момент.
Мой монтаж ускорился X2, после того как я стал применять гейты сразу после окончания работы всех агентов. И так по кругу. Агенты берут результат ниже целевой оценки и доделывают.
Напиши своей AI и спроси, где и как можно будет внедрить систему гейтов. Пусть сходит и изучит всё необходимое для реализации. Начни с одной реализации и посмотри, как твоя работа с AI пойдёт дальше.
Так же как и у навыков и у агентов у гейтов могут быть слепые зоны, что-то забыто на оценку и ложные BLOCK / PASS.
Чтобы избежать этого попроси LLM оценить систему и сделать напоминание на ревью через 7 / 14 / 28 дней или после каждой 2-3 работы.
Надеюсь теперь твоя работа будет более качественнее и быстрее
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥9❤4💯2
https://www.youtube.com/watch?v=3WpzNmY35S4 Будущий бест селлер для локальных AI? 🤔
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
The new Mac mini with M6
Introducing the far mightier, new Mac mini, with the M6 chip. With up to 40% faster CPU and 2x faster graphics, it's five by five inches of pure power and performance. Add in neural accelerators in each core, for up to 4x faster AI performance and 2x faster…
⚡4😭2🔥1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍27😁6🍌4🤩1
Код на вайбах
Вайб-дайджест #5 | июль Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #4 и #3 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе. • Вышел Claude Opus 5, почти интеллект Fable 5 за полцены. Стоимость…
Вайб-дайджест #6 | август
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #5 и #4 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Claude Code научился писать жалобу на себя. Когда в сессии что-то ломается или ты тычешь его носом в ошибку, он готовит отчёт, а ты читаешь и отправляешь через
• OpenClaw 2.0 вышел 30 августа, и это самый крупный апдейт за историю проекта: 933 контрибьютора, из них 569 впервые, 16 тысяч пул-реквестов - около половины всего, что вообще влили в OpenClaw. [подробнее тут]
• Claude Code с 14 августа работает в auto mode по умолчанию. Большинство действий идёт без вопроса, вместо тебя их смотрит классификатор: он блокирует необратимое и то, что лезет за пределы проекта. Назад к подтверждениям - Shift+Tab, правила видно в
• "Почему с Opus 5 работать тяжелее". Если тезисно: 4.7 и 4.8 останавливались и переспрашивали, когда задача была непонятной. Пятый угадывает и идёт дальше, поэтому за ним приходится присматривать. [подробнее тут]
• Z.ai выложила открытые веса GLM 5.3. Контекст 1M, цена 1.4 и 4.4 доллара за миллион и Coding Plan от 18 долларов в месяц. Если лимиты поджимают, может стать хорошим помощником в кодинге. Цифры по бенчмаркам, правда, снова их собственные🤓 [подробнее тут]
• Твой текст от Claude теперь помечен невидимым водяным знаком. Метка живёт в выборе слов между равнозначными вариантами, лишних символов не добавляет и на качество не влияет. А если для тебя это помеха, попробуй этот skill, он поможет! [подробнее тут]
• Codex вернул пятичасовой лимит на Plus, с 25 августа, после шести недель без потолка. На Pro за 100 и 200 долларов лимит в ближайшие месяцы возвращать не будут. [подробнее тут]
• Cursor учит облачных агентов держать цель: командой
• Codex подтянул мелочи в терминале: @ упоминания задач, автоназвания, кликабельные ссылки, нормальный выбор в /copy и шорткаты режимов прав. Тем, кто ушёл на Codex из-за лимитов, работать станет чуть приятнее. [подробнее тут]
• Claude in Chrome вышел из беты на все платные планы 26 августа. Боковая панель стала полноценным Cowork: твои скиллы и коннекторы на месте, начал в браузере? Продолжил на десктопе. Работает Claude сам, без подтверждения каждого шага, так-что подумай, в каком окне его запускаешь, чтобы клодик не нашкодил. [подробнее тут]
• Claude Code CLI стал есть вдвое меньше процессора на пиках. Сборщик мусора внутри Bun бегал по таймеру и отнимал CPU прямо посреди хода, теперь он ждёт, когда процесс освободится. Заодно десктоп стартует вдвое быстрее, чем месяц назад, а длинные ответы на вебе перестали дёргаться. [подробнее тут]
• Anthropic режет недельные лимиты Claude Code. С 14 сентября временный буст +50% снимают, вместо него дают постоянные +25% к майской базе. Против августовских лимитов это минус 17%. Касается Pro, Max, Team и Enterprise с местами. У меня неделя и так кончается раньше воскресенья😁 . [подробнее тут]
• SpaceX закрыла покупку Cursor и через две недели OpenAI объявила о разрыве сотрудничества. В конце августа OpenAI сказала, что прямой доступ Cursor к её моделям выключат 12 ноября. В Cursor говорят, доля OpenAI там около 5% трафика: если ты в этих процентах, до ноября есть время переезжать. [подробнее тут]
На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо!👋
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #5 и #4 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Claude Code научился писать жалобу на себя. Когда в сессии что-то ломается или ты тычешь его носом в ошибку, он готовит отчёт, а ты читаешь и отправляешь через
/feedback. [подробнее тут]• OpenClaw 2.0 вышел 30 августа, и это самый крупный апдейт за историю проекта: 933 контрибьютора, из них 569 впервые, 16 тысяч пул-реквестов - около половины всего, что вообще влили в OpenClaw. [подробнее тут]
• Claude Code с 14 августа работает в auto mode по умолчанию. Большинство действий идёт без вопроса, вместо тебя их смотрит классификатор: он блокирует необратимое и то, что лезет за пределы проекта. Назад к подтверждениям - Shift+Tab, правила видно в
/permissions на вкладке auto mode. [подробнее тут]• "Почему с Opus 5 работать тяжелее". Если тезисно: 4.7 и 4.8 останавливались и переспрашивали, когда задача была непонятной. Пятый угадывает и идёт дальше, поэтому за ним приходится присматривать. [подробнее тут]
• Z.ai выложила открытые веса GLM 5.3. Контекст 1M, цена 1.4 и 4.4 доллара за миллион и Coding Plan от 18 долларов в месяц. Если лимиты поджимают, может стать хорошим помощником в кодинге. Цифры по бенчмаркам, правда, снова их собственные
• Твой текст от Claude теперь помечен невидимым водяным знаком. Метка живёт в выборе слов между равнозначными вариантами, лишних символов не добавляет и на качество не влияет. А если для тебя это помеха, попробуй этот skill, он поможет! [подробнее тут]
• Codex вернул пятичасовой лимит на Plus, с 25 августа, после шести недель без потолка. На Pro за 100 и 200 долларов лимит в ближайшие месяцы возвращать не будут. [подробнее тут]
• Cursor учит облачных агентов держать цель: командой
/goal ставишь долгую задачу, и агент идёт к ней через длинную сессию, подхватывает работу по событиям и не обрывается, когда ты пишешь ему вдогонку - правка ждёт следующего вызова инструмента. [подробнее тут]• Codex подтянул мелочи в терминале: @ упоминания задач, автоназвания, кликабельные ссылки, нормальный выбор в /copy и шорткаты режимов прав. Тем, кто ушёл на Codex из-за лимитов, работать станет чуть приятнее. [подробнее тут]
• Claude in Chrome вышел из беты на все платные планы 26 августа. Боковая панель стала полноценным Cowork: твои скиллы и коннекторы на месте, начал в браузере? Продолжил на десктопе. Работает Claude сам, без подтверждения каждого шага, так-что подумай, в каком окне его запускаешь, чтобы клодик не нашкодил. [подробнее тут]
• Claude Code CLI стал есть вдвое меньше процессора на пиках. Сборщик мусора внутри Bun бегал по таймеру и отнимал CPU прямо посреди хода, теперь он ждёт, когда процесс освободится. Заодно десктоп стартует вдвое быстрее, чем месяц назад, а длинные ответы на вебе перестали дёргаться. [подробнее тут]
• Anthropic режет недельные лимиты Claude Code. С 14 сентября временный буст +50% снимают, вместо него дают постоянные +25% к майской базе. Против августовских лимитов это минус 17%. Касается Pro, Max, Team и Enterprise с местами. У меня неделя и так кончается раньше воскресенья
• SpaceX закрыла покупку Cursor и через две недели OpenAI объявила о разрыве сотрудничества. В конце августа OpenAI сказала, что прямой доступ Cursor к её моделям выключат 12 ноября. В Cursor говорят, доля OpenAI там около 5% трафика: если ты в этих процентах, до ноября есть время переезжать. [подробнее тут]
На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо!
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥11❤2🤓2
Вышел Claude Fable 5.1 и Claude Mythos 5.1
Anthropic выкатили уже доступное везде обновление. Что стало лучше:
Дебаггинг - модель копает до корня вместо того, чтобы костылить симптом. Red Hat прогнали её по своим сломанным сборкам: причину нашла у каждой, причём на любом уровне эффорта.
Долгая работа. Исследователи про прошлые модели пишут: чем дольше те работали, тем труднее было за ними уследить. Эта же остаётся читаемой на длинной многошаговой задаче.
Скорость - в тестах она вышла примерно вдвое быстрее Opus 5 и потратила вдвое меньше токенов.
По ценам вход и выход стоят столько же: 10 и 50 долларов за миллион токенов. Понизилась лишь одна строка прайса - чтение из кеша. Был доллар за миллион, стало 25 центов.
Как заявляют из Anthropic обычная нагрузка дешевеет примерно на четверть, тяжёлая агентная - до 45%.
Anthropic выкатили уже доступное везде обновление. Что стало лучше:
Дебаггинг - модель копает до корня вместо того, чтобы костылить симптом. Red Hat прогнали её по своим сломанным сборкам: причину нашла у каждой, причём на любом уровне эффорта.
Долгая работа. Исследователи про прошлые модели пишут: чем дольше те работали, тем труднее было за ними уследить. Эта же остаётся читаемой на длинной многошаговой задаче.
Скорость - в тестах она вышла примерно вдвое быстрее Opus 5 и потратила вдвое меньше токенов.
По ценам вход и выход стоят столько же: 10 и 50 долларов за миллион токенов. Понизилась лишь одна строка прайса - чтение из кеша. Был доллар за миллион, стало 25 центов.
Как заявляют из Anthropic обычная нагрузка дешевеет примерно на четверть, тяжёлая агентная - до 45%.
Всем сбросили лимиты, можно тестировать и проверять!🤗
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥12❤5👍2
Мощность Fable 5.1 по цене Opus 5
Попробуй понизить режим нагрузки для своего Fable 5.1 до уровня
К примеру, у меня за пару часов в режиме
Попробуй понизить режим нагрузки для своего Fable 5.1 до уровня
low. В CursorBench тесте Fable 5.1 в режиме низкой нагрузки показывает результаты, сопоставимые с Fable 5 в режиме высокой нагрузки, при этом его стоимость составляет лишь треть от стоимости последнего.К примеру, у меня за пару часов в режиме
high улетает примерно 8% для недельного лимита на тарифе за 200$.🔥9👍3❤1💯1
This media is not supported in your browser
VIEW IN TELEGRAM
В честь выхода новой модели Astra для ChatGPT команда OpenAI будет каждый день раздавать плановый сброс (живет месяц), пока модель не выкатят на всех. За сегодня уже выдали, но потенциально ещё есть пару дней.
Astra будет первой моделью, почти решившая ARC‑AGI‑3, но называть её первой доказанной AGI пока нельзя. Текущие 98.6% не 100%. К слову у Opus 5 - это значение равное 30%.
Интересно будет глянуть и протестировать, учитывая приближенность к 100% AGI. Как-всегда OpenAI и Anthropic не перестают удивлять. А учитывая, что OpenAI даёт возможность использовать подписочную модель для сторонних интеграций без риска бана - это просто подарок какой-то.
Сейчас сняли эмбарго на отзывы от тестировщиков новой модели, крупные блогеры тестировали самые разные задачи, однозначно все оценили скачок связанный с медиа: игры, моделирование.
UPD: GPT 6 Astra доступна
Astra будет первой моделью, почти решившая ARC‑AGI‑3, но называть её первой доказанной AGI пока нельзя. Текущие 98.6% не 100%. К слову у Opus 5 - это значение равное 30%.
AGI - это гипотетический искусственный общий интеллект, способный понимать, обучаться и решать любые интеллектуальные задачи наравне с человеком или превосходя.
Интересно будет глянуть и протестировать, учитывая приближенность к 100% AGI. Как-всегда OpenAI и Anthropic не перестают удивлять. А учитывая, что OpenAI даёт возможность использовать подписочную модель для сторонних интеграций без риска бана - это просто подарок какой-то.
Сейчас сняли эмбарго на отзывы от тестировщиков новой модели, крупные блогеры тестировали самые разные задачи, однозначно все оценили скачок связанный с медиа: игры, моделирование.
UPD: GPT 6 Astra доступна
🔥10❤4👍3
Здесь можно изучить подробноо про промпты, миграцию и др.
P.S. Claude Code сбросил лимиты
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4❤1🤯1
Рубрика:"А что, так можно было?"
1. GPT 6 - Astra на low effort reasoning работает сравни GPT 5.6 high effort reasoning. Что примечательно, Fable 5.1 так же себя показывает в сравнении с Opus 5. Отсюда можно проследить тенденцию, что на следующих LLM версиях стоит пробовать новое в low по отношению к прошлому high.
По лимитам может выйти так же / чуть дороже, а сам результат более качественным.
2. Co-founder и лид разработки Hermes Agent обнаружил для себя чудо синергии из Fable 5.1 как оркестратор и GPT 6 Astra как исполнитель. Внушительная связка может и другой: Fable 5.1 + GLM, DeepSeek и т.д.
К слову пару дней назад он же отрефакторил Hermes Agent и вычистил 34% и в целом провел рефакторинг по тех долг: god object почистил, баги заодного закрыл и т.д.
И что примичательно, всю дорогу прошел на Fable 5.1 в течение 17 часов и удалил по итогу 375K строк кода, тем самым кодовая база похудела с 1.04M до 650K. К слову на весь процесс понадобилось менее 50 итераций и 1320 субагентов в сумме.
Я как пользователь Hermes Agent обновился сразу и за всё время использования столкнулся лишь с парочкой багов. Не уверен, обновление повлияло или моя внутренняя работа, но как факт.
Если интересна такая рубрика - лайк и буду стараться находить такие интересные моменты ещё🤗
1. GPT 6 - Astra на low effort reasoning работает сравни GPT 5.6 high effort reasoning. Что примечательно, Fable 5.1 так же себя показывает в сравнении с Opus 5. Отсюда можно проследить тенденцию, что на следующих LLM версиях стоит пробовать новое в low по отношению к прошлому high.
По лимитам может выйти так же / чуть дороже, а сам результат более качественным.
2. Co-founder и лид разработки Hermes Agent обнаружил для себя чудо синергии из Fable 5.1 как оркестратор и GPT 6 Astra как исполнитель. Внушительная связка может и другой: Fable 5.1 + GLM, DeepSeek и т.д.
К слову пару дней назад он же отрефакторил Hermes Agent и вычистил 34% и в целом провел рефакторинг по тех долг: god object почистил, баги заодного закрыл и т.д.
И что примичательно, всю дорогу прошел на Fable 5.1 в течение 17 часов и удалил по итогу 375K строк кода, тем самым кодовая база похудела с 1.04M до 650K. К слову на весь процесс понадобилось менее 50 итераций и 1320 субагентов в сумме.
Я как пользователь Hermes Agent обновился сразу и за всё время использования столкнулся лишь с парочкой багов. Не уверен, обновление повлияло или моя внутренняя работа, но как факт.
Если интересна такая рубрика - лайк и буду стараться находить такие интересные моменты ещё
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍30🔥8❤1✍1
This media is not supported in your browser
VIEW IN TELEGRAM
Вот такой ИИ монтаж мне сделал GPT-6 Astra, завтра будет видео. Про подход к разработке с применением AI, а так же наглядный замер работы:
Все, перечисленные выше LLM с обвязкой из агентов, пайплайнов, quality gate и т.д. и без неё!🫢
• GPT-5.6 Sol
• Claude Code Opus 5
• Claude Code Fable 5.1
• GPT-6 Astra
Все, перечисленные выше LLM с обвязкой из агентов, пайплайнов, quality gate и т.д. и без неё!
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8🔥7🏆5
GPT-6 Astra и Claude: моя система ИИ-агентов на реальном проекте
В новом видео показываю свой ИИ-монтажёр: как устроена работа, где агенты допускают ошибки и что я менял после этих ошибок.
Разбираю на примере монтажа, но подход можно и нужно применить к разработке, текстам и другим рабочим задачам. Помогаю где и как автоматизация мне помогает, где нужно моё участие.
😉 Смотреть: https://youtu.be/ffkM3WIeoRk
В новом видео показываю свой ИИ-монтажёр: как устроена работа, где агенты допускают ошибки и что я менял после этих ошибок.
Что внутри:
• Pipeline из 11 этапов: кто что делает и как передаёт работу дальше.
• 56 проверок и ошибки, которые проходят даже через них.
• GPT-6 Astra, Fable 5.1, Opus 5 и GPT-5.6 Sol: примеры результатов и мои впечатления.
• Что меняется с обвязкой: ролями, инструкциями и проверками.
• Кроны в Claude и Codex: как запускать задачи по расписанию.
• С чего начать свою систему, чтобы не потратить всё время на её улучшение.
Разбираю на примере монтажа, но подход можно и нужно применить к разработке, текстам и другим рабочим задачам. Помогаю где и как автоматизация мне помогает, где нужно моё участие.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥7⚡5👍2
Презентация из видео.png
18.9 MB
Комплект моей системы ИИ-монтажа, который можно адаптировать под свои задачи
Внутри: 13 ролей агентов, 5 навыков, pipeline, шаблоны и проверки. Убрал личные материалы и зависимости от моих папок, сохранил сам процесс работы.
Проще всего начать через самого ИИ. Распакуй архив, откройте папку в помощнике с доступом к файлам и напиши в духе:
Необязательно вручную заполнять все шаблоны. Помощник может подготовить их вместе с тобой. Главное: объяснить, что ты делаешь, какой результат нужен и что важно сохранить.
Комплект пригодится и за пределами монтажа. Разделение ролей, передача работы, проверки и исправление ошибок можно перенести в разработку, тексты или исследования.
Сами задачи и критерии нужно заменить под свой проект самособой. Начни с одной небольшой задачи. Добавляйте роли там, где видите повторяющиеся ошибки или нехватку контроля.
Сам архив программы не устанавливает и ролики не рендерит, самособой без вирусов, но всегда проверяй на вирусы, когда качаешь из интернета!
Внутри: 13 ролей агентов, 5 навыков, pipeline, шаблоны и проверки. Убрал личные материалы и зависимости от моих папок, сохранил сам процесс работы.
Проще всего начать через самого ИИ. Распакуй архив, откройте папку в помощнике с доступом к файлам и напиши в духе:
Изучи README.md и устройство этого комплекта. Помоги адаптировать его под мою задачу: [опиши задачу].
Выбери полезные роли и проверки, объясни, что стоит перенять. Не подключай всё подряд. Если не хватает важной информации, задай вопросы.
Создай адаптацию в отдельной папке, сохрани существующие настройки. Проверь доступные инструменты, затем выполни небольшое пробное задание. Покажи результат и что пока не удалось проверить.
Необязательно вручную заполнять все шаблоны. Помощник может подготовить их вместе с тобой. Главное: объяснить, что ты делаешь, какой результат нужен и что важно сохранить.
Комплект пригодится и за пределами монтажа. Разделение ролей, передача работы, проверки и исправление ошибок можно перенести в разработку, тексты или исследования.
Сами задачи и критерии нужно заменить под свой проект самособой. Начни с одной небольшой задачи. Добавляйте роли там, где видите повторяющиеся ошибки или нехватку контроля.
Сам архив программы не устанавливает и ролики не рендерит, самособой без вирусов, но всегда проверяй на вирусы, когда качаешь из интернета!
🔥13❤2👍1
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI выпустили GPT-Live-1
Доступно только по API при стоимости 0.05$ за минуту. Отличительная черта, что модель слушает и говорит.
Можно соединить со своим харнесом, настроить под свое железо, да и вообще, выглядит как дешевый call center.
Просто глянь видео, выглядит поражающе за ту цену, что предоставляют и возможности 😳
Детали прочитать можно здесь
Доступно только по API при стоимости 0.05$ за минуту. Отличительная черта, что модель слушает и говорит.
Можно соединить со своим харнесом, настроить под свое железо, да и вообще, выглядит как дешевый call center.
Просто глянь видео, выглядит поражающе за ту цену, что предоставляют и возможности 😳
Детали прочитать можно здесь
👍6🔥3❤1
Проверка пользы скилла в Claude Code
В Claude Code появилась claude plugin eval - проверка того, какую пользу даёт твой плагин и навыки внутри него.
Даёшь одинаковые задачи. Claude выполняет их с плагином и без, проверяет результаты по заданным критериям и показывает разницу.
К слову, хорошо дополняет тему quality gate, про которую уже писал и рассказывал выше. Можно проверить, помогают ли сами инструкции получать результат лучше или нет.
К примеру, у тебя есть скилл для ревью кода.
Ты прописал: искать баги, объяснять последствия и причины, предлагать исправления. Всё выглядит правильно, но на практике AI может пропустить ошибку и написать десять замечаний про название переменной😩
Вот такой навык и можно проверить.
1. Обнови Claude Code. В терминале:
2. Открой папку плагина и запусти.
Можно написать в духе:
Claude предложит тесты, сделает пробный прогон и оценит стоимость полного запуска.
Посмотри сами проверки. Если попросить оценивать "насколько ответ хороший", можно получить красивую оценку, которая мало что объясняет.
3. Запусти сравнение. Когда подготовка закончится, выйди через /exit и выполни:
4. Посмотри, что получилось. В терминале будут две оценки и разница между ними. В HTML отчёте: подробности, какие проверки прошли и где ошибки.
Допустим, скилл помог найти баг, который без него Claude пропускал. Уже полезно. А если результаты одинаковые, на этих задачах дополнительная польза пока не видна.
Что это даёт тебе?
Начни с одного навыка и нескольких проблем, которые у тебя повторяются. Потом исправляй то, что видно в отчёте, успехов!👍
В Claude Code появилась claude plugin eval - проверка того, какую пользу даёт твой плагин и навыки внутри него.
Даёшь одинаковые задачи. Claude выполняет их с плагином и без, проверяет результаты по заданным критериям и показывает разницу.
К слову, хорошо дополняет тему quality gate, про которую уже писал и рассказывал выше. Можно проверить, помогают ли сами инструкции получать результат лучше или нет.
К примеру, у тебя есть скилл для ревью кода.
Ты прописал: искать баги, объяснять последствия и причины, предлагать исправления. Всё выглядит правильно, но на практике AI может пропустить ошибку и написать десять замечаний про название переменной
Вот такой навык и можно проверить.
1. Обнови Claude Code. В терминале:
claude update2. Открой папку плагина и запусти.
claude plugin eval init Claude изучит плагин и поможет подготовить задания и критерии. Тут нужно объяснить, что для тебя хороший результат.Можно написать в духе:
Хочу проверить навык ревью кода. Подготовь несколько небольших примеров: с обращением к полю у null, с ошибкой на единицу в цикле и с корректным кодом без багов.
Включи сам код в задания. Проверяй, нашёл ли Claude заложенную ошибку, объяснил ли последствия и предложил ли подходящее исправление. На корректном коде проверь, не выдумывает ли проблемы. Замечания только по стилю не считай найденными багами.
Claude предложит тесты, сделает пробный прогон и оценит стоимость полного запуска.
Посмотри сами проверки. Если попросить оценивать "насколько ответ хороший", можно получить красивую оценку, которая мало что объясняет.
3. Запусти сравнение. Когда подготовка закончится, выйди через /exit и выполни:
claude plugin eval . --runs 1 это короткая проверка: по одному запуску каждой задачи с плагином и без.4. Посмотри, что получилось. В терминале будут две оценки и разница между ними. В HTML отчёте: подробности, какие проверки прошли и где ошибки.
Допустим, скилл помог найти баг, который без него Claude пропускал. Уже полезно. А если результаты одинаковые, на этих задачах дополнительная польза пока не видна.
Что это даёт тебе?
• Добавил инструкции - можешь проверить, стало ли лучше?
• Переписал скилл - можешь заметить, если он начал пропускать старые ошибки.
• Сменил модель - можешь заново проверить свою обвязку на тех же задачах.
Начни с одного навыка и нескольких проблем, которые у тебя повторяются. Потом исправляй то, что видно в отчёте, успехов!
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥8👍5❤4
Почему с новой моделью Astra старые настройки могут работать хуже
Если ты давно работаешь с AI, наверняка накопились инструкции на каждый случай. Тут не проверил? Дописал правило. Здесь полез менять лишнее? Запретил.
В следующий раз остановился на полпути и добавил "работай до конца". Переключаешься на GPT-5.6 sol и работа идёт как-то иначе.
OpenAI разобрали этот момент. Часть инструкций, которыми мы исправляли поведение прошлых моделей, мешает новой.
Что поменялось с 5.6?
В рекомендациях для Astra отмечают: она сильнее реагирует на инструкции из файлов, сама тщательнее проверяет работу и чаще уточняет, если ответ может повлиять на результат.
Отсюда неприятный момент. Твоё старое "перед любым действием спроси" может затормозить даже обычную, небольшую, локальную правку. А "проверяй всё после каждого изменения" - запускать проверки, которые к этой задаче не относятся.
Ты попросил исправить текст, но инструкции потянули за собой половину монтажной системы. И лимиты уходят на выполнение правил, которые ты сам когда-то добавил😢
И ещё, если одни навыки используют разные модели, учитывай это при правках. Чтобы не разбирать всё вручную, можно дать AI такой запрос:
После применения посмотри, стало ли меньше лишних действий и переделок. Короткий AGENTS.md сам по себе ещё не означает, что агент работает лучше🤫
Если ты давно работаешь с AI, наверняка накопились инструкции на каждый случай. Тут не проверил? Дописал правило. Здесь полез менять лишнее? Запретил.
В следующий раз остановился на полпути и добавил "работай до конца". Переключаешься на GPT-5.6 sol и работа идёт как-то иначе.
OpenAI разобрали этот момент. Часть инструкций, которыми мы исправляли поведение прошлых моделей, мешает новой.
Что поменялось с 5.6?
В рекомендациях для Astra отмечают: она сильнее реагирует на инструкции из файлов, сама тщательнее проверяет работу и чаще уточняет, если ответ может повлиять на результат.
Отсюда неприятный момент. Твоё старое "перед любым действием спроси" может затормозить даже обычную, небольшую, локальную правку. А "проверяй всё после каждого изменения" - запускать проверки, которые к этой задаче не относятся.
К примеру, в системе ИИ-монтажа нужно поправить субтитры. Но навык описан как "используй для любой работы с видео", а внутри уже весь процесс от разбора исходников до финального рендера.
Ты попросил исправить текст, но инструкции потянули за собой половину монтажной системы. И лимиты уходят на выполнение правил, которые ты сам когда-то добавил
И ещё, если одни навыки используют разные модели, учитывай это при правках. Чтобы не разбирать всё вручную, можно дать AI такой запрос:
Хочу настроить инструкции этого проекта под GPT-6 Astra, сохранив полезные правила и требования проекта.
Прочитай:
https://developers.openai.com/blog/rethinking-skills-and-prompts-for-gpt-6-astra
Затем разбери инструкции, которые реально влияют на твою работу здесь: AGENTS.md, доступные навыки и связанные с ними документы. Пока ничего не меняй.
Найди конкретные места, из-за которых ты можешь:
• подключать навык к неподходящей задаче
• читать лишние документы
• повторять проверки без новой причины
• запрашивать подтверждение уже порученной работы
• останавливаться до получения готового результата.
Для каждого найденного места покажи файл и фразу, объясни на примере задачи, к чему она может привести, и предложи точечную замену. Отделяй наблюдаемую проблему от предположения.
Сохрани требования к качеству, ограничения доступа и важные договорённости проекта. Если инструкции нужны и другим моделям, учти это. Не сокращай текст только ради объёма.
Выбери до трёх наиболее полезных изменений и предложи небольшие задания, на которых можно сравнить поведение до и после. Подготовь правки для просмотра.
После применения посмотри, стало ли меньше лишних действий и переделок. Короткий AGENTS.md сам по себе ещё не означает, что агент работает лучше
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5👍3❤1
This media is not supported in your browser
VIEW IN TELEGRAM
Claude теперь сам раздаёт задачи другим Claude и работает в облаке ☁️
Anthropic представили Projects в Claude Code. Ты ведёшь один общий разговор и Claude запускает отдельные сессии, распределяет между ними работу и собирает результаты.
Кто работал в нескольких AI чатах одновременно, знает: в какой-то момент сам становишься посыльным. Одному принеси контекст, другому передай решение, у третьего выясни, почему он остановился.
И здесь эту координацию берёт на себя Claude.
Субагенту обычно поручают отдельную часть задачи внутри основной сессии: изучить код, найти причину ошибки, проверить изменения. Он возвращает результат тому, кто его запустил.
В Projects Claude координирует несколько самостоятельных облачных сессий. У каждой свой контекст и ход работы и новые сессии получают общие инструкции и память проекта. Ты можешь постепенно добавлять задачи в один разговор и возвращаться к результатам.
Например, ты развиваешь приложение. Сегодня нужно исправить поиск и обновить зависимости, завтра прилетит новая ошибка, через неделю изменятся требования. Всё это можно вести в одном Projects, сохраняя договорённости между задачами.
• Общий контекст. Новые сессии получают инструкции и память проекта. Объяснил важную особенность? Попроси Claude её запомнить, чтобы следующие исполнители учитывали это в работе.
• Работа в облаке. Можно закрыть приложение или выключить ноутбук: запущенные задачи продолжат выполняться. Если понадобится твой ответ или разрешение, соответствующая сессия подождёт.
• Сопровождение изменений. Исполнитель может подготовить pull request и затем следить за ним: исправлять падения CI и реагировать на замечания ревью.
• Все результаты в одном месте. В Overview видно, что выполняется, что готово к проверке и где нужен человек.
• И не только код. Можно загрузить документы или обращения пользователей и поручать их анализ. Репозиторий для таких задач не обязателен.
Для работы с кодом нужен репозиторий на GitHub и доступ через Claude GitHub App. Через CLI новые Projects пока недоступны.
Сейчас это браузер и Desktop, выполнение задач облачное в обоих случаях. Локальные сценарии обещают позже.
Доступ открывают постепенно пользователям Pro и Max. Если Projects ещё нет, можно записаться в лист ожидания.
И главное: координатор и исполнители расходуют общие лимиты подписки. По умолчанию задачи запускаются на Opus с высоким уровнем усилий. Собрать себе маленький отдел разработки теперь стало проще!👍
Anthropic представили Projects в Claude Code. Ты ведёшь один общий разговор и Claude запускает отдельные сессии, распределяет между ними работу и собирает результаты.
Кто работал в нескольких AI чатах одновременно, знает: в какой-то момент сам становишься посыльным. Одному принеси контекст, другому передай решение, у третьего выясни, почему он остановился.
И здесь эту координацию берёт на себя Claude.
Чем это отличается от субагентов?🤔
Субагенту обычно поручают отдельную часть задачи внутри основной сессии: изучить код, найти причину ошибки, проверить изменения. Он возвращает результат тому, кто его запустил.
В Projects Claude координирует несколько самостоятельных облачных сессий. У каждой свой контекст и ход работы и новые сессии получают общие инструкции и память проекта. Ты можешь постепенно добавлять задачи в один разговор и возвращаться к результатам.
Например, ты развиваешь приложение. Сегодня нужно исправить поиск и обновить зависимости, завтра прилетит новая ошибка, через неделю изменятся требования. Всё это можно вести в одном Projects, сохраняя договорённости между задачами.
Из полезного:
• Общий контекст. Новые сессии получают инструкции и память проекта. Объяснил важную особенность? Попроси Claude её запомнить, чтобы следующие исполнители учитывали это в работе.
• Работа в облаке. Можно закрыть приложение или выключить ноутбук: запущенные задачи продолжат выполняться. Если понадобится твой ответ или разрешение, соответствующая сессия подождёт.
• Сопровождение изменений. Исполнитель может подготовить pull request и затем следить за ним: исправлять падения CI и реагировать на замечания ревью.
• Все результаты в одном месте. В Overview видно, что выполняется, что готово к проверке и где нужен человек.
• И не только код. Можно загрузить документы или обращения пользователей и поручать их анализ. Репозиторий для таких задач не обязателен.
Как попробовать?
1. Открой claude.ai/code или вкладку Code в Claude Desktop.
2. Нажми Projects -> New project, укажи цель и добавь репозиторий или файлы.
3. В Project settings -> Memory -> Project instructions задай правила работы и проверки результата.
4. Начни с небольшой задачи, оцени результат и расход лимитов, что самое важное.
Для работы с кодом нужен репозиторий на GitHub и доступ через Claude GitHub App. Через CLI новые Projects пока недоступны.
Сейчас это браузер и Desktop, выполнение задач облачное в обоих случаях. Локальные сценарии обещают позже.
Доступ открывают постепенно пользователям Pro и Max. Если Projects ещё нет, можно записаться в лист ожидания.
И главное: координатор и исполнители расходуют общие лимиты подписки. По умолчанию задачи запускаются на Opus с высоким уровнем усилий. Собрать себе маленький отдел разработки теперь стало проще!
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥7❤5👍2
Подписку Claude теперь можно использовать в Hermes
Если у тебя уже настроен Hermes и есть Claude Pro или Max подписка, появилась возможность использовать их вместе. Nous Research выпустили плагин Claude Subscription DirectSDK - он подключает подписку через установленный Claude Code.
Ты продолжаешь работать в Hermes со своими skills, памятью и инструментами, но запросы к модели идут через твой аккаунт Claude. Отдельный API ключ для этого подключения не нужен.
Если пропустил, про сам Hermes рассказывал здесь.
Как подключить
Нужны Hermes 0.21.4+, установленный Claude Code и подписка Pro или Max:
В списке провайдеров выбери Claude Subscription DirectSDK (Experimental), затем модель.
Что с лимитами?
Запросы расходуют квоту подписки. Anthropic ранее планировали отдельные SDK кредиты, но приостановили переход: Agent SDK и claude -p пока продолжают использовать лимиты тарифа.
Есть нюанс: в тесте авторов плагина сопоставимый объём токенов расходовал примерно в 1,7 раза больше лимита, чем интерактивный Claude Code.
Это не значит, что каждая задача обойдётся ровно в 1,7 раза дороже. Агенты могут делать разное количество запросов и передавать разный объём контекста. Сравнивать лучше на своих задачах.
И самое главное, как с правилами Anthropic?
Правила допускают вход со своей подпиской в неизменённый Claude Code, в том числе на сторонней платформе при соблюдении условий. Поэтому сам запуск через Hermes ещё не означает нарушение. У автора Hermes прямо спросили в комментариях - нарушает ли этот плагин Terms Of Service? Ответ был:"НЕТ"
Если важно сохранить аккаунт, можно подождать и посмотреть результаты других. Если не терпится попробовать, можно завести отдельный аккаунт и проверить. По ToS обычно отлетают очень быстро сейчас😢
• Сама новость
• Плагин и документация
Если у тебя уже настроен Hermes и есть Claude Pro или Max подписка, появилась возможность использовать их вместе. Nous Research выпустили плагин Claude Subscription DirectSDK - он подключает подписку через установленный Claude Code.
Ты продолжаешь работать в Hermes со своими skills, памятью и инструментами, но запросы к модели идут через твой аккаунт Claude. Отдельный API ключ для этого подключения не нужен.
Если пропустил, про сам Hermes рассказывал здесь.
Как подключить
Нужны Hermes 0.21.4+, установленный Claude Code и подписка Pro или Max:
hermes plugins install claude-subscription-directsdk
claude auth login
hermes model
В списке провайдеров выбери Claude Subscription DirectSDK (Experimental), затем модель.
Что с лимитами?
Запросы расходуют квоту подписки. Anthropic ранее планировали отдельные SDK кредиты, но приостановили переход: Agent SDK и claude -p пока продолжают использовать лимиты тарифа.
Есть нюанс: в тесте авторов плагина сопоставимый объём токенов расходовал примерно в 1,7 раза больше лимита, чем интерактивный Claude Code.
Это не значит, что каждая задача обойдётся ровно в 1,7 раза дороже. Агенты могут делать разное количество запросов и передавать разный объём контекста. Сравнивать лучше на своих задачах.
И самое главное, как с правилами Anthropic?
Правила допускают вход со своей подпиской в неизменённый Claude Code, в том числе на сторонней платформе при соблюдении условий. Поэтому сам запуск через Hermes ещё не означает нарушение. У автора Hermes прямо спросили в комментариях - нарушает ли этот плагин Terms Of Service? Ответ был:"НЕТ"
Если важно сохранить аккаунт, можно подождать и посмотреть результаты других. Если не терпится попробовать, можно завести отдельный аккаунт и проверить. По ToS обычно отлетают очень быстро сейчас
• Сама новость
• Плагин и документация
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6👍2❤1