Код на вайбах
Вайб-дайджест #4 | июнь Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #3 и #2 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе. • Claude Fable 5 вышел - и почти сразу попал под государственную…
Вайб-дайджест #5 | июль
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #4 и #3 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Вышел Claude Opus 5, почти интеллект Fable 5 за полцены. Стоимость как у 4.8. На Max он теперь стоит по умолчанию, а на Pro это самая мощная модель из входящих в подписку. Есть Fast mode, он примерно в 2.5 раза быстрее обычного. Отдельно радует, что защитные классификаторы ругаются реже, чем на Fable 5 и запрос уходит в 4.8 вместо отказа. [подробнее тут]
• Fable 5 остаётся в подписках. С 20 июля он включён в Max и Team Premium на 50% лимитов, на Pro через кредиты плюс разовый бонус 100$. Помнишь, я писал, что Fable хотели оставить только на API? История закончилась хорошо. [подробнее тут]
• OpenAI понизила цены GPT-5.6: Luna дешевле на 80%, Terra на 20%. У Sol свой Fast mode, как у Opus: быстрее за двойную цену. В Codex и ChatGPT Work за Terra и Luna списывается меньше кредитов. OpenAI заявляет, что Luna обходит Fable 5 при цене за задачу почти на 99% ниже. Бенчмарк, правда, их собственный😁 . А на OpenRouter Terra и Luna сейчас вообще за полцены. [подробнее тут]
• Китай тоже не спит: вышел DeepSeek v4 Flash. Судя по первым бенчмаркам, на агентных задачах он подобрался к Opus 4.8, при этом стоит 0.14$/0.28$ за миллион токенов, а кешированный вход так воообще 0.0028$. Контекст 1M и совместимость с Codex в комплекте. За такие деньги агента можно просто не выключать🤓 . [подробнее тут]
• Месяц безопасности у обеих контор. Security плагин из майского дайджеста дорос до беты Claude Security: сканируешь дифф перед коммитом или весь репозиторий прямо из терминала. OpenAI ответили опенсорсом codex security: CLI и SDK для поиска и фикса уязвимостей с проверками в CI. Если у тебя вайбкодинг проект с клиентами, однозначно стоит внимания😎 . [подробнее тут]
• MCP получил крупнейшее обновление со старта. Главное для нас: MCP Apps сервер теперь может рисовать интерфейс прямо в чате, и Tasks долгие операции без висящего соединения. Под капотом ядро стало stateless, серверы проще запускать и масштабировать. Для энтерпрайза завезли централизованный доступ. [подробнее тут]
• В Claude Cowork завезли обучение скиллам через запись экрана. Делаешь задачу, проговариваешь вслух и Claude превращает это в скилл и дальше повторяет сам. Доступно на Pro, Max и Team. [подробнее тут]
• Голосовой режим Claude переехал на Opus и Sonnet. Теперь прямо в разговоре дотягивается до подключённых инструментов: почта, календарь и остальное. Уже доступно в публичной бете на телефоне, десктопе и вебе. [подробнее тут]
• OpenAI показала новое поколение транскрипции с Context Aware ASR: модели можно скормить контекст записи, термины и языки. На 22 языках Common Voice ошибок вдвое меньше, чем у их же Whisper. Я гоняю расшифровки видео локальным Whisper, так-что есть повод пересобрать пайплайн👏 . [подробнее тут]
• Anthropic обновила бесплатный курс по Claude Code: 10 уроков, новые видео и экзамен в конце. Пока я пилю свой курс, они успели переделать свой. [подробнее тут]
• Cursor 3.11: side chats и поиск по агентам. Командой
• Два больших чтива от Anthropic на вечер. "The Making of Claude Code" - история, как внутренний CLI вырос в главный кодинг агент, рассказанная самими инженерами. И свежие правила context engineering для моделей Claude 5, статья разлетелась на миллионы просмотров. Я в предыдущем посте первод и адаптацию с комментариями и дополнениями.
На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо!👋
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #4 и #3 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Вышел Claude Opus 5, почти интеллект Fable 5 за полцены. Стоимость как у 4.8. На Max он теперь стоит по умолчанию, а на Pro это самая мощная модель из входящих в подписку. Есть Fast mode, он примерно в 2.5 раза быстрее обычного. Отдельно радует, что защитные классификаторы ругаются реже, чем на Fable 5 и запрос уходит в 4.8 вместо отказа. [подробнее тут]
• Fable 5 остаётся в подписках. С 20 июля он включён в Max и Team Premium на 50% лимитов, на Pro через кредиты плюс разовый бонус 100$. Помнишь, я писал, что Fable хотели оставить только на API? История закончилась хорошо. [подробнее тут]
• OpenAI понизила цены GPT-5.6: Luna дешевле на 80%, Terra на 20%. У Sol свой Fast mode, как у Opus: быстрее за двойную цену. В Codex и ChatGPT Work за Terra и Luna списывается меньше кредитов. OpenAI заявляет, что Luna обходит Fable 5 при цене за задачу почти на 99% ниже. Бенчмарк, правда, их собственный
• Китай тоже не спит: вышел DeepSeek v4 Flash. Судя по первым бенчмаркам, на агентных задачах он подобрался к Opus 4.8, при этом стоит 0.14$/0.28$ за миллион токенов, а кешированный вход так воообще 0.0028$. Контекст 1M и совместимость с Codex в комплекте. За такие деньги агента можно просто не выключать
• Месяц безопасности у обеих контор. Security плагин из майского дайджеста дорос до беты Claude Security: сканируешь дифф перед коммитом или весь репозиторий прямо из терминала. OpenAI ответили опенсорсом codex security: CLI и SDK для поиска и фикса уязвимостей с проверками в CI. Если у тебя вайбкодинг проект с клиентами, однозначно стоит внимания
• MCP получил крупнейшее обновление со старта. Главное для нас: MCP Apps сервер теперь может рисовать интерфейс прямо в чате, и Tasks долгие операции без висящего соединения. Под капотом ядро стало stateless, серверы проще запускать и масштабировать. Для энтерпрайза завезли централизованный доступ. [подробнее тут]
• В Claude Cowork завезли обучение скиллам через запись экрана. Делаешь задачу, проговариваешь вслух и Claude превращает это в скилл и дальше повторяет сам. Доступно на Pro, Max и Team. [подробнее тут]
• Голосовой режим Claude переехал на Opus и Sonnet. Теперь прямо в разговоре дотягивается до подключённых инструментов: почта, календарь и остальное. Уже доступно в публичной бете на телефоне, десктопе и вебе. [подробнее тут]
• OpenAI показала новое поколение транскрипции с Context Aware ASR: модели можно скормить контекст записи, термины и языки. На 22 языках Common Voice ошибок вдвое меньше, чем у их же Whisper. Я гоняю расшифровки видео локальным Whisper, так-что есть повод пересобрать пайплайн
• Anthropic обновила бесплатный курс по Claude Code: 10 уроков, новые видео и экзамен в конце. Пока я пилю свой курс, они успели переделать свой. [подробнее тут]
• Cursor 3.11: side chats и поиск по агентам. Командой
/side или /btw открываешь параллельный чат с контекстом основного: вопросы и ресёрч без прерывания агента. Поиск теперь роется в транскриптах всех разговоров. Мелочь, а в длинных сессиях спасает. [подробнее тут]• Два больших чтива от Anthropic на вечер. "The Making of Claude Code" - история, как внутренний CLI вырос в главный кодинг агент, рассказанная самими инженерами. И свежие правила context engineering для моделей Claude 5, статья разлетелась на миллионы просмотров. Я в предыдущем посте первод и адаптацию с комментариями и дополнениями.
На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо!
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
Код на вайбах
Вайб-дайджест #4 | июнь
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #3 и #2 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Claude Fable 5 вышел - и почти сразу попал под государственную…
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #3 и #2 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Claude Fable 5 вышел - и почти сразу попал под государственную…
🔥15👍6❤2
YouTube
Claude без хаоса и лишних трат: Projects и Artifacts
Твой Claude - это набор разрозненных чатов или рабочее место?
А можно ли собрать в нём рабочий калькулятор, открыть его по ссылке и не получить счёт на тысячу долларов?
В этом уроке превращаем Claude из окна чата в постоянное рабочее место: проект помнит…
А можно ли собрать в нём рабочий калькулятор, открыть его по ссылке и не получить счёт на тысячу долларов?
В этом уроке превращаем Claude из окна чата в постоянное рабочее место: проект помнит…
Claude без хаоса и лишних трат: Projects и Artifacts
Привет и добро пожаловать на первый урок второго модуля. Собираем из окна чата постоянное рабочее место, чтобы не начинать каждый раз с пустой переписки и не объяснять заново, чем ты занимаешься.
😉 https://youtu.be/GIa6F0Qg6rE
Что внутри:
1. Проект под своё дело. Тон и контекст задаёшь один раз, нужные файлы лежат рядом, объяснять заново не нужно. Покажу разницу между бесплатным и платным проектом, какие фичи улучшат твою работу.
2. Артефакт. В первом модуле мы обзорно делали сайт, теперь же вспомним, сделаем пару примеров и разберёмся где и как могут пригодится. Спойлер: мало кто использует, хотя бесплатны и полезны.
3. MCP, Skills и Deep Research. Обзорной экскурсией посмотрим: что это такое и куда смотреть дальше. Эти умения актуальны и нужны при работе с любой AI. Именно умение работать с MCP и Skills повысят твою эффективность и рещультат на новый уровень.
4. Деньги. Где кончается бесплатное и как не влететь на счёт по API. Расскажу, как я даже выставив лимиты попал на небольшую сумму. Готов поспорить мало где про этот очень важный нюанс, про "бонусные кредиты" говорят.
5. Effort. Обзорная экскурсия, где ты поймёшь как и где можно потерять лимиты / токены за зря, поделюсь личным опытом. Крайне полезное знание, легкое для понимания и малозаметное для большинства.
Весь монтаж этого видео курировал ИИ: убирал дублирование, добавлял монтажные моменты, баннеры, звуки и многое другое!
Парочку моментов в виде немного корявой обводки уже записал. Так вышло, что именно этот монтаж курировал Codex, и вышло косячнее и длиннее (намного), чем Claude.
Если соберём 65 огоньков, сразу сяду реализацию видео про то, как я собрал ИИ монтажора. Спойлер, много читал, изучал, да это не прямая замена монтажоров, да при помощи CSS, HTML и пр. но на этом реализация не заканчивается!
Ну и да, спасибо за внимание, желаю приятного просмотра и наконец-то можно будет ещё качественнее реализовывать бесплатный курс по ИИ и вайбкодингу👋
Привет и добро пожаловать на первый урок второго модуля. Собираем из окна чата постоянное рабочее место, чтобы не начинать каждый раз с пустой переписки и не объяснять заново, чем ты занимаешься.
Что внутри:
1. Проект под своё дело. Тон и контекст задаёшь один раз, нужные файлы лежат рядом, объяснять заново не нужно. Покажу разницу между бесплатным и платным проектом, какие фичи улучшат твою работу.
2. Артефакт. В первом модуле мы обзорно делали сайт, теперь же вспомним, сделаем пару примеров и разберёмся где и как могут пригодится. Спойлер: мало кто использует, хотя бесплатны и полезны.
3. MCP, Skills и Deep Research. Обзорной экскурсией посмотрим: что это такое и куда смотреть дальше. Эти умения актуальны и нужны при работе с любой AI. Именно умение работать с MCP и Skills повысят твою эффективность и рещультат на новый уровень.
4. Деньги. Где кончается бесплатное и как не влететь на счёт по API. Расскажу, как я даже выставив лимиты попал на небольшую сумму. Готов поспорить мало где про этот очень важный нюанс, про "бонусные кредиты" говорят.
5. Effort. Обзорная экскурсия, где ты поймёшь как и где можно потерять лимиты / токены за зря, поделюсь личным опытом. Крайне полезное знание, легкое для понимания и малозаметное для большинства.
Весь монтаж этого видео курировал ИИ: убирал дублирование, добавлял монтажные моменты, баннеры, звуки и многое другое!
Буду рад обратной связи от каждого, кому и что понравилось или не понравилось в рамках монтажа. Чего хотелось бы видеть от монтажа или наоборот, не хотелось бы видеть.
Парочку моментов в виде немного корявой обводки уже записал. Так вышло, что именно этот монтаж курировал Codex, и вышло косячнее и длиннее (намного), чем Claude.
Если соберём 65 огоньков, сразу сяду реализацию видео про то, как я собрал ИИ монтажора. Спойлер, много читал, изучал, да это не прямая замена монтажоров, да при помощи CSS, HTML и пр. но на этом реализация не заканчивается!
Ну и да, спасибо за внимание, желаю приятного просмотра и наконец-то можно будет ещё качественнее реализовывать бесплатный курс по ИИ и вайбкодингу
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥22❤5👍3
М2В1 Шпаргалка.pdf
246.5 KB
Презентация, шпаргалка и домашка к М2В1
❤2👍2🔥2
Я поймал себя на мысли, что каждому из нас есть чем поделиться, ч. 1: опыт и знания.
Друг писал код с Codex, но общался с ним как с чат-ботом. Я посоветовал ему запустить Codex приложением на компьютере, чтобы тот видел весь проект, а не один вставленный кусок.
Спустя пару дней он написал: "Задачи выполняются лучше, багов почти нет, всем доволен, спасибо!".
Всё, что угодно: агент маркетолог, полезный скилл, свой подход к работе с AI или первые шаги перед стартом проекта. Иногда одна чужая строчка экономит неделю работы.
Хватит пары слов и ссылки, ну и пару строк чем оно помогает. А если ты только начинаешь, спрашивай что угодно, даже если вопрос кажется тебе глупым.
Начну с себя, погнали?👍
Друг писал код с Codex, но общался с ним как с чат-ботом. Я посоветовал ему запустить Codex приложением на компьютере, чтобы тот видел весь проект, а не один вставленный кусок.
Спустя пару дней он написал: "Задачи выполняются лучше, багов почти нет, всем доволен, спасибо!".
Давай в комментариях поделимся тем, что улучшает или облегчает нашу работу.
Всё, что угодно: агент маркетолог, полезный скилл, свой подход к работе с AI или первые шаги перед стартом проекта. Иногда одна чужая строчка экономит неделю работы.
Хватит пары слов и ссылки, ну и пару строк чем оно помогает. А если ты только начинаешь, спрашивай что угодно, даже если вопрос кажется тебе глупым.
Начну с себя, погнали?
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥8👍3❤1
Видео для опроса ниже. №1 - слева, №2 - справа.
Я часто видел в интернете сравнение в визуализации между фронтир LLM: Kimi, GPT, Claude, Qwen и т.д. Когда модель берёт задачу, понимает условие и начинает реализовывать.
Конкретно здесь не совсем с 0 графика, но при помощи ИИ монтажёра две модели реализовывали сценарий и описание работы для монтажёра. В работе над каждым видео участвовали:
• скиллы
• агенты
• MCP
И теперь, я хочу поделиться своим фидбеком на конкретных примерах.
Одно из этих видео делал Claude, а другой Codex. Claude делал на Opus 5.6 high, а Codex на Gpt 5.6 sol high
Обе LLM были полностью настроены под себя и проверены дважды на корректность настройки, обе модели работали с одной папкой.
Т.е всё одинаково было кроме самих LLM. Одно видео было в работе 2.5 часа, другое видео было 25 минут.
Попробуй посмотреть оба видео (звук можно выключить, важно оценить графику) и оценить для себя, опрос ниже👇
Я часто видел в интернете сравнение в визуализации между фронтир LLM: Kimi, GPT, Claude, Qwen и т.д. Когда модель берёт задачу, понимает условие и начинает реализовывать.
Конкретно здесь не совсем с 0 графика, но при помощи ИИ монтажёра две модели реализовывали сценарий и описание работы для монтажёра. В работе над каждым видео участвовали:
• скиллы
• агенты
• MCP
И теперь, я хочу поделиться своим фидбеком на конкретных примерах.
Одно из этих видео делал Claude, а другой Codex. Claude делал на Opus 5.6 high, а Codex на Gpt 5.6 sol high
Обе LLM были полностью настроены под себя и проверены дважды на корректность настройки, обе модели работали с одной папкой.
Т.е всё одинаково было кроме самих LLM. Одно видео было в работе 2.5 часа, другое видео было 25 минут.
Попробуй посмотреть оба видео (звук можно выключить, важно оценить графику) и оценить для себя, опрос ниже
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7😁5❤1
Бесплатные сбросы от Тибо видимо кончились и теперь, как неожиданно и приятно, за сбросы лимитов нужно будет платить. Думаю для стимулирования интереса на какие-то даты, события будут давать редкие, сгораемые сбросы 👋
У меня на тарифе 200$ предлагают сбросить недельные за 40$
Please open Telegram to view this post
VIEW IN TELEGRAM
😭8🙈5❤3
Код на вайбах
Видео для опроса ниже. №1 - слева, №2 - справа. Я часто видел в интернете сравнение в визуализации между фронтир LLM: Kimi, GPT, Claude, Qwen и т.д. Когда модель берёт задачу, понимает условие и начинает реализовывать. Конкретно здесь не совсем с 0 графика…
Отвечая на опрос "Какая LLM" работала над видео
Слева 25 минут работал Claude Opus 5 в high effort reasoning. Справа работал GPT 5.6 sol в high effort reasoning и справился за 2.5 часа ...
... И между делом съел порядка 80 гб памяти вовремя работы, был сбой. При этом Opus 5 стартовал в минусе - от предыдущей LLM я не успел на 100% перенести все важные для монтажа файлы на архитектуру Claude Code. Если интересно как он сейчас делает монтаж, хороший пример.
Но для меня это не показатель, хоть я и пробовал 3 раза и в разное время. Пока-что не могу понять, почему хуже и дольше справился GPT, т.к проблем вовремя монтажа не было.
Но хочу отметить, что сейчас система справляется с задачей на отлично. Конечно не моушен монтаж "ВАУ" уровня. Но мне такой и не принципиален.
Помню свои первые постеры от ChatGPT - пиксельная каша мимо задумки. Сейчас постер от ChatGPT Images 2.0 я не отличу от работы иллюстратора за 2-3 тысячи рублей.
И тут хочу поделиться, что если одновременно работать с 2-3 AI задачами одновременно, батарейка усталости быстро стремится к 0. Происходит это из-за постоянного смена контекста:
Отсюда мой персональный помощник просел по качеству: больше повторов, хуже помнит решения, проекты, предпочтения и причины прошлых договорённостей.
В итоге, я нисколько не разочаровался в плохих результата монтажора, напротив, текущий GPT, с его бесплатными, хоть и редкими, сбросами можно интегрировать в другие системы и работать уже иначе.
Если тебе сейчас тяжело разобраться, что-то работает не совсем так как ожидал, это нормально. Возможно стоит спросить, вдруг работает не [до конца] правильно?
Отсюда следует:
• Не гнаться за количеством задействованных MCP, Skills, Agent
• Начинать с базовых вещей и двигаться постепенно
Умение разбираться в фундаментальных вещах поможет от облачного и до локального (?), от GPT и до Codex.
А ты сталкивался с проблемой менеджмента 2-3 AI задач одновременно? Как решил?🤐
Слева 25 минут работал Claude Opus 5 в high effort reasoning. Справа работал GPT 5.6 sol в high effort reasoning и справился за 2.5 часа ...
... И между делом съел порядка 80 гб памяти вовремя работы, был сбой. При этом Opus 5 стартовал в минусе - от предыдущей LLM я не успел на 100% перенести все важные для монтажа файлы на архитектуру Claude Code. Если интересно как он сейчас делает монтаж, хороший пример.
Но для меня это не показатель, хоть я и пробовал 3 раза и в разное время. Пока-что не могу понять, почему хуже и дольше справился GPT, т.к проблем вовремя монтажа не было.
Но хочу отметить, что сейчас система справляется с задачей на отлично. Конечно не моушен монтаж "ВАУ" уровня. Но мне такой и не принципиален.
Помню свои первые постеры от ChatGPT - пиксельная каша мимо задумки. Сейчас постер от ChatGPT Images 2.0 я не отличу от работы иллюстратора за 2-3 тысячи рублей.
И тут хочу поделиться, что если одновременно работать с 2-3 AI задачами одновременно, батарейка усталости быстро стремится к 0. Происходит это из-за постоянного смена контекста:
1. Изучил ответ
2. Обдумал
3. Дал фидбек
И так по кругу. Каждый раз при получении результата от работы AI круг начинается заново. Но эта проблема присуща тем кто работает в 2+ одновременных LLM.
Хочется простого:"Ты же искуственный интеллект, почему я должен решать, отвечать на твои вопросы? Я тебе дал задачу и описал. Сделай как надо"
Решил поэтому скачать Hermes Agent и досконально в нём разобраться. Раньше он жил у меня в Telegram: десктопного приложения тогда не было, только терминал и мессенджеры.
И я несколько раз спрашивал: всё ли мы настроили из базового? Каждый раз слышал "да". И всё равно пропустил главное - долгую память, ту, что живёт между чатами.
Внутри одного длинного диалога это не мешало. Проблемы будут между чатами: помощник будет чаще повторяться, хуже помнить решения и причины прошлых договорённостей.
Держаться тем самым за короткие MEMORY.md с USER.md и переспрашивать.
Отсюда мой персональный помощник просел по качеству: больше повторов, хуже помнит решения, проекты, предпочтения и причины прошлых договорённостей.
В итоге, я нисколько не разочаровался в плохих результата монтажора, напротив, текущий GPT, с его бесплатными, хоть и редкими, сбросами можно интегрировать в другие системы и работать уже иначе.
Даже понимая работу и что где устроено, можно пропустить важный файл и тем самым просесть по качеству и получать результат хуже.
Если тебе сейчас тяжело разобраться, что-то работает не совсем так как ожидал, это нормально. Возможно стоит спросить, вдруг работает не [до конца] правильно?
Отсюда следует:
• Не гнаться за количеством задействованных MCP, Skills, Agent
• Начинать с базовых вещей и двигаться постепенно
Умение разбираться в фундаментальных вещах поможет от облачного и до локального (?), от GPT и до Codex.
А ты сталкивался с проблемой менеджмента 2-3 AI задач одновременно? Как решил?
Please open Telegram to view this post
VIEW IN TELEGRAM
❤5🔥5✍1
Вот чем мне нравится Codex - за свои баги накидывают бесплатных лимитов. Последнее время лимиты могли уходить быстрее из-за бага с кешированием. Завтра он будет исправлен.
Так же за 20 млн пользователей всем начислили бесплатные сброс в любое время (ограничен до 21 сентября)
И как извинение - всем платным подпискам сбросят лимиты 25 августа в 00:00 по Москве.
Так же за 20 млн пользователей всем начислили бесплатные сброс в любое время (ограничен до 21 сентября)
🔥7👍4❤3
Одно из лучших решений для автономности
Это добавление quality gate на нужный для тебя этап работы твоего AI. Проблема - тебе каждый раз нужно проверять результат работы AI (агента / субагентов):
• Попросил нарисовать картинку? Проверяешь в конце качество изображение и корректность текста
• Попросил сделать монтаж для видео? Проверяешь картинку, звук, уместность мемов, цветокор, вставки и тд
• Попросил написать код? Проверяешь уместное использование паттернов программирования, договорённостей, приверженность архитектуры
Мультиагентные пайплайны - один агент пишет код, другой рефакторит, третий пишет тесты. Без явного гейта между этапами плохой промежуточный результат тащится дальше и множит переделки.
Чтобы отбросить промежуточные этапы, когда результат ещё готовится и он далёк от нужного качества - попроси своего AI реализовать quality gate. Для меня он включается в конце работы всех задействованых агентов.
К примеру, видео отдаю в монтаж ИИ агенту. Подключаются нужные субагенты. Они начинают нарезать на вставки, уместные картинки, графику и т.д. После того как все закончили - гонится гейт.
После прогона есть система оценок, к примеру:
1. ЗВУК - PASS
2. Memes - BLOCK и причина блока, чего не хватает до нужной оценки
3. ВРЕМЯ - PASS WITH FIXIES гейт даёт не критичные, но улучшающие исправления для работы
4. И т.д.
Я бы ещё порекомендовал не гнаться за 85-90-100 оценкой. Когда будешь внедрять гейт в ходе диалога с LLM попроси её саму оценить какие оценки уместные и почему. Так же попроси LLM оценить то, что будем проверять и в какой момент.
Напиши своей AI и спроси, где и как можно будет внедрить систему гейтов. Пусть сходит и изучит всё необходимое для реализации. Начни с одной реализации и посмотри, как твоя работа с AI пойдёт дальше.
Так же как и у навыков и у агентов у гейтов могут быть слепые зоны, что-то забыто на оценку и ложные BLOCK / PASS.
Чтобы избежать этого попроси LLM оценить систему и сделать напоминание на ревью через 7 / 14 / 28 дней или после каждой 2-3 работы.
Надеюсь теперь твоя работа будет более качественнее и быстрее👋
Это добавление quality gate на нужный для тебя этап работы твоего AI. Проблема - тебе каждый раз нужно проверять результат работы AI (агента / субагентов):
• Попросил нарисовать картинку? Проверяешь в конце качество изображение и корректность текста
• Попросил сделать монтаж для видео? Проверяешь картинку, звук, уместность мемов, цветокор, вставки и тд
• Попросил написать код? Проверяешь уместное использование паттернов программирования, договорённостей, приверженность архитектуры
Мультиагентные пайплайны - один агент пишет код, другой рефакторит, третий пишет тесты. Без явного гейта между этапами плохой промежуточный результат тащится дальше и множит переделки.
Чтобы отбросить промежуточные этапы, когда результат ещё готовится и он далёк от нужного качества - попроси своего AI реализовать quality gate. Для меня он включается в конце работы всех задействованых агентов.
К примеру, видео отдаю в монтаж ИИ агенту. Подключаются нужные субагенты. Они начинают нарезать на вставки, уместные картинки, графику и т.д. После того как все закончили - гонится гейт.
После прогона есть система оценок, к примеру:
1. ЗВУК - PASS
2. Memes - BLOCK и причина блока, чего не хватает до нужной оценки
3. ВРЕМЯ - PASS WITH FIXIES гейт даёт не критичные, но улучшающие исправления для работы
4. И т.д.
Я бы ещё порекомендовал не гнаться за 85-90-100 оценкой. Когда будешь внедрять гейт в ходе диалога с LLM попроси её саму оценить какие оценки уместные и почему. Так же попроси LLM оценить то, что будем проверять и в какой момент.
Мой монтаж ускорился X2, после того как я стал применять гейты сразу после окончания работы всех агентов. И так по кругу. Агенты берут результат ниже целевой оценки и доделывают.
Напиши своей AI и спроси, где и как можно будет внедрить систему гейтов. Пусть сходит и изучит всё необходимое для реализации. Начни с одной реализации и посмотри, как твоя работа с AI пойдёт дальше.
Так же как и у навыков и у агентов у гейтов могут быть слепые зоны, что-то забыто на оценку и ложные BLOCK / PASS.
Чтобы избежать этого попроси LLM оценить систему и сделать напоминание на ревью через 7 / 14 / 28 дней или после каждой 2-3 работы.
Надеюсь теперь твоя работа будет более качественнее и быстрее
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥9❤4💯2
https://www.youtube.com/watch?v=3WpzNmY35S4 Будущий бест селлер для локальных AI? 🤔
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
The new Mac mini with M6
Introducing the far mightier, new Mac mini, with the M6 chip. With up to 40% faster CPU and 2x faster graphics, it's five by five inches of pure power and performance. Add in neural accelerators in each core, for up to 4x faster AI performance and 2x faster…
⚡4😭2🔥1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍27😁6🍌4🤩1
Код на вайбах
Вайб-дайджест #5 | июль Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #4 и #3 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе. • Вышел Claude Opus 5, почти интеллект Fable 5 за полцены. Стоимость…
Вайб-дайджест #6 | август
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #5 и #4 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Claude Code научился писать жалобу на себя. Когда в сессии что-то ломается или ты тычешь его носом в ошибку, он готовит отчёт, а ты читаешь и отправляешь через
• OpenClaw 2.0 вышел 30 августа, и это самый крупный апдейт за историю проекта: 933 контрибьютора, из них 569 впервые, 16 тысяч пул-реквестов - около половины всего, что вообще влили в OpenClaw. [подробнее тут]
• Claude Code с 14 августа работает в auto mode по умолчанию. Большинство действий идёт без вопроса, вместо тебя их смотрит классификатор: он блокирует необратимое и то, что лезет за пределы проекта. Назад к подтверждениям - Shift+Tab, правила видно в
• "Почему с Opus 5 работать тяжелее". Если тезисно: 4.7 и 4.8 останавливались и переспрашивали, когда задача была непонятной. Пятый угадывает и идёт дальше, поэтому за ним приходится присматривать. [подробнее тут]
• Z.ai выложила открытые веса GLM 5.3. Контекст 1M, цена 1.4 и 4.4 доллара за миллион и Coding Plan от 18 долларов в месяц. Если лимиты поджимают, может стать хорошим помощником в кодинге. Цифры по бенчмаркам, правда, снова их собственные🤓 [подробнее тут]
• Твой текст от Claude теперь помечен невидимым водяным знаком. Метка живёт в выборе слов между равнозначными вариантами, лишних символов не добавляет и на качество не влияет. А если для тебя это помеха, попробуй этот skill, он поможет! [подробнее тут]
• Codex вернул пятичасовой лимит на Plus, с 25 августа, после шести недель без потолка. На Pro за 100 и 200 долларов лимит в ближайшие месяцы возвращать не будут. [подробнее тут]
• Cursor учит облачных агентов держать цель: командой
• Codex подтянул мелочи в терминале: @ упоминания задач, автоназвания, кликабельные ссылки, нормальный выбор в /copy и шорткаты режимов прав. Тем, кто ушёл на Codex из-за лимитов, работать станет чуть приятнее. [подробнее тут]
• Claude in Chrome вышел из беты на все платные планы 26 августа. Боковая панель стала полноценным Cowork: твои скиллы и коннекторы на месте, начал в браузере? Продолжил на десктопе. Работает Claude сам, без подтверждения каждого шага, так-что подумай, в каком окне его запускаешь, чтобы клодик не нашкодил. [подробнее тут]
• Claude Code CLI стал есть вдвое меньше процессора на пиках. Сборщик мусора внутри Bun бегал по таймеру и отнимал CPU прямо посреди хода, теперь он ждёт, когда процесс освободится. Заодно десктоп стартует вдвое быстрее, чем месяц назад, а длинные ответы на вебе перестали дёргаться. [подробнее тут]
• Anthropic режет недельные лимиты Claude Code. С 14 сентября временный буст +50% снимают, вместо него дают постоянные +25% к майской базе. Против августовских лимитов это минус 17%. Касается Pro, Max, Team и Enterprise с местами. У меня неделя и так кончается раньше воскресенья😁 . [подробнее тут]
• SpaceX закрыла покупку Cursor и через две недели OpenAI объявила о разрыве сотрудничества. В конце августа OpenAI сказала, что прямой доступ Cursor к её моделям выключат 12 ноября. В Cursor говорят, доля OpenAI там около 5% трафика: если ты в этих процентах, до ноября есть время переезжать. [подробнее тут]
На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо!👋
Привет, в продолжение ежемесячного дайджеста, делюсь. Если пропустил прошлые выпуски: #5 и #4 <- они тут. Читать всё необязательно, выбери то, что зайдёт конкретно тебе.
• Claude Code научился писать жалобу на себя. Когда в сессии что-то ломается или ты тычешь его носом в ошибку, он готовит отчёт, а ты читаешь и отправляешь через
/feedback. [подробнее тут]• OpenClaw 2.0 вышел 30 августа, и это самый крупный апдейт за историю проекта: 933 контрибьютора, из них 569 впервые, 16 тысяч пул-реквестов - около половины всего, что вообще влили в OpenClaw. [подробнее тут]
• Claude Code с 14 августа работает в auto mode по умолчанию. Большинство действий идёт без вопроса, вместо тебя их смотрит классификатор: он блокирует необратимое и то, что лезет за пределы проекта. Назад к подтверждениям - Shift+Tab, правила видно в
/permissions на вкладке auto mode. [подробнее тут]• "Почему с Opus 5 работать тяжелее". Если тезисно: 4.7 и 4.8 останавливались и переспрашивали, когда задача была непонятной. Пятый угадывает и идёт дальше, поэтому за ним приходится присматривать. [подробнее тут]
• Z.ai выложила открытые веса GLM 5.3. Контекст 1M, цена 1.4 и 4.4 доллара за миллион и Coding Plan от 18 долларов в месяц. Если лимиты поджимают, может стать хорошим помощником в кодинге. Цифры по бенчмаркам, правда, снова их собственные
• Твой текст от Claude теперь помечен невидимым водяным знаком. Метка живёт в выборе слов между равнозначными вариантами, лишних символов не добавляет и на качество не влияет. А если для тебя это помеха, попробуй этот skill, он поможет! [подробнее тут]
• Codex вернул пятичасовой лимит на Plus, с 25 августа, после шести недель без потолка. На Pro за 100 и 200 долларов лимит в ближайшие месяцы возвращать не будут. [подробнее тут]
• Cursor учит облачных агентов держать цель: командой
/goal ставишь долгую задачу, и агент идёт к ней через длинную сессию, подхватывает работу по событиям и не обрывается, когда ты пишешь ему вдогонку - правка ждёт следующего вызова инструмента. [подробнее тут]• Codex подтянул мелочи в терминале: @ упоминания задач, автоназвания, кликабельные ссылки, нормальный выбор в /copy и шорткаты режимов прав. Тем, кто ушёл на Codex из-за лимитов, работать станет чуть приятнее. [подробнее тут]
• Claude in Chrome вышел из беты на все платные планы 26 августа. Боковая панель стала полноценным Cowork: твои скиллы и коннекторы на месте, начал в браузере? Продолжил на десктопе. Работает Claude сам, без подтверждения каждого шага, так-что подумай, в каком окне его запускаешь, чтобы клодик не нашкодил. [подробнее тут]
• Claude Code CLI стал есть вдвое меньше процессора на пиках. Сборщик мусора внутри Bun бегал по таймеру и отнимал CPU прямо посреди хода, теперь он ждёт, когда процесс освободится. Заодно десктоп стартует вдвое быстрее, чем месяц назад, а длинные ответы на вебе перестали дёргаться. [подробнее тут]
• Anthropic режет недельные лимиты Claude Code. С 14 сентября временный буст +50% снимают, вместо него дают постоянные +25% к майской базе. Против августовских лимитов это минус 17%. Касается Pro, Max, Team и Enterprise с местами. У меня неделя и так кончается раньше воскресенья
• SpaceX закрыла покупку Cursor и через две недели OpenAI объявила о разрыве сотрудничества. В конце августа OpenAI сказала, что прямой доступ Cursor к её моделям выключат 12 ноября. В Cursor говорят, доля OpenAI там около 5% трафика: если ты в этих процентах, до ноября есть время переезжать. [подробнее тут]
На этом дайджест подошёл к концу. Если тебе заходит такая рубрика - поставь огонь, посмотрим, сколько нас. Если есть чем поделиться, буду рад почитать в комментариях, что за июль приглянулось тебе, спасибо!
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥11❤2🤓2
Вышел Claude Fable 5.1 и Claude Mythos 5.1
Anthropic выкатили уже доступное везде обновление. Что стало лучше:
Дебаггинг - модель копает до корня вместо того, чтобы костылить симптом. Red Hat прогнали её по своим сломанным сборкам: причину нашла у каждой, причём на любом уровне эффорта.
Долгая работа. Исследователи про прошлые модели пишут: чем дольше те работали, тем труднее было за ними уследить. Эта же остаётся читаемой на длинной многошаговой задаче.
Скорость - в тестах она вышла примерно вдвое быстрее Opus 5 и потратила вдвое меньше токенов.
По ценам вход и выход стоят столько же: 10 и 50 долларов за миллион токенов. Понизилась лишь одна строка прайса - чтение из кеша. Был доллар за миллион, стало 25 центов.
Как заявляют из Anthropic обычная нагрузка дешевеет примерно на четверть, тяжёлая агентная - до 45%.
Anthropic выкатили уже доступное везде обновление. Что стало лучше:
Дебаггинг - модель копает до корня вместо того, чтобы костылить симптом. Red Hat прогнали её по своим сломанным сборкам: причину нашла у каждой, причём на любом уровне эффорта.
Долгая работа. Исследователи про прошлые модели пишут: чем дольше те работали, тем труднее было за ними уследить. Эта же остаётся читаемой на длинной многошаговой задаче.
Скорость - в тестах она вышла примерно вдвое быстрее Opus 5 и потратила вдвое меньше токенов.
По ценам вход и выход стоят столько же: 10 и 50 долларов за миллион токенов. Понизилась лишь одна строка прайса - чтение из кеша. Был доллар за миллион, стало 25 центов.
Как заявляют из Anthropic обычная нагрузка дешевеет примерно на четверть, тяжёлая агентная - до 45%.
Всем сбросили лимиты, можно тестировать и проверять!🤗
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥12❤5👍2
Мощность Fable 5.1 по цене Opus 5
Попробуй понизить режим нагрузки для своего Fable 5.1 до уровня
К примеру, у меня за пару часов в режиме
Попробуй понизить режим нагрузки для своего Fable 5.1 до уровня
low. В CursorBench тесте Fable 5.1 в режиме низкой нагрузки показывает результаты, сопоставимые с Fable 5 в режиме высокой нагрузки, при этом его стоимость составляет лишь треть от стоимости последнего.К примеру, у меня за пару часов в режиме
high улетает примерно 8% для недельного лимита на тарифе за 200$.🔥9👍3❤1💯1