#AI: Подключил GLM-5.2 вместо Fable 5 🧠
💪 Anthropic закрыли Fable 5 для пользователей. Я нашел замену - и честно говоря, только выиграл от этого
Что такое GLM-5.2:
Открытая модель от z.ai с контекстным окном 1 млн токенов. Вышла 16 июня под MIT лицензией с открытыми весами на HuggingFace - без региональных ограничений и без риска что ее "выключат" решением регулятора. По бенчмаркам задача планирования - Fable 9.1 vs GLM 9.0. Одинаковые архитектурные решения. Стоимость в 10 раз ниже
Мой стек сейчас - три модели, три задачи:
⚡️ Claude Opus 4.8 - основная модель, сложное мышление, разработка архитектуры
⚡️ Codex 5.5 - фикс багов, аудит разработанного кода от Claude
⚡️ GLM-5.2 - независимый аудит Claude и Codex
Именно эта комбинация вывела разработку на другой уровень. Три провайдера, разные сильные стороны
🎯 Полгода я думал что достаточно держать одину топовую LLM и не усложнять стек. Оказалось нет. Чем больше умных моделей и разных взглядов - тем качественнее конечный продукт
🔥 Подключить GLM по моей рефке - ссылка 👈
Instagram | YouTube | Threads
💪 Anthropic закрыли Fable 5 для пользователей. Я нашел замену - и честно говоря, только выиграл от этого
Что такое GLM-5.2:
Открытая модель от z.ai с контекстным окном 1 млн токенов. Вышла 16 июня под MIT лицензией с открытыми весами на HuggingFace - без региональных ограничений и без риска что ее "выключат" решением регулятора. По бенчмаркам задача планирования - Fable 9.1 vs GLM 9.0. Одинаковые архитектурные решения. Стоимость в 10 раз ниже
Мой стек сейчас - три модели, три задачи:
⚡️ Claude Opus 4.8 - основная модель, сложное мышление, разработка архитектуры
⚡️ Codex 5.5 - фикс багов, аудит разработанного кода от Claude
⚡️ GLM-5.2 - независимый аудит Claude и Codex
Именно эта комбинация вывела разработку на другой уровень. Три провайдера, разные сильные стороны
🎯 Полгода я думал что достаточно держать одину топовую LLM и не усложнять стек. Оказалось нет. Чем больше умных моделей и разных взглядов - тем качественнее конечный продукт
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2❤1
Если честно, это не первая попытка собрать себе голосового ассистента. Первая попытка была 4 месяца назад. Я потратил около недели и не смог собрать ничего толкового - не было опыта. Тогда я все собирал в OpenClaw прямо через Телеграм. В итоге провал 😅
Но прошло время, и у меня появился клиент, который попросил сделать ему агента наподобие Siri, только умнее. Чтобы можно было как в фильме общаться с ним голосом и чтобы он делал то, что его попросят. Прежде чем что-то собирать клиенту, я собрал для себя
И... Знакомьтесь - Jes!
Это НЕ чат-бот в стиле "напишите сообщение и ждите три дня". Это живой голос, с которым я разговариваю. По-русски. Как с живым человеком - которого можно перебить на полуслове. Я говорю - она отвечает мгновенно. Можно тараторить, можно мямлить, можно влезть в середине ее фразы - она поймет и подхватит
Но голос - это только обертка. Дальше начинается самый жир 👇
🎛 Она рулит всем
У меня пашет целая система - боты разрабатывают, пишут тексты, рисуют картинки, считают, мониторят. Раньше я лазил руками, теперь я просто говорю:
- "Jes, поставь задачу дизайнеру нарисовать картинку для презентации голосового ассистента"
- "Сейчас поставлю задачу"
И она пошла и сделала. Поставила задачу боту, узнала статус и отчиталась за результат - голосом, как в фильме, Карл!
Память в несколько уровней:
▪️ Помнит важные факты и решения - между разговорами, не теряет
▪️ В начале каждого диалога уже знает, о чем мы говорили вчера - сама делает короткую выжимку, не заставляет пересказывать
▪️ Ищет по всем нашим прошлым разговорам по СМЫСЛУ, а не по точному слову ("где мы там про оплату решали?" - находит, хоть ты слово в слово не помнишь)
▪️ Роется в моей базе знаний, как в своем кармане
Говорю: "Jes, запомни, что..." - и в следующий раз она это уже знает
📲 И она ВЕЗДЕ
На телефоне - вынес иконку на домашний экран, открывается как настоящее приложение. На макбуке - живет в Dock отдельным окном: кликнул - говоришь. Достал телефон - Jes под рукой. Без установок, без магазинов приложений, без всей этой ебли с "обновите до версии X"
⚡️ И по мелочи:
🌐 Ищет в интернете, на гитхабе, в документации - голосом, и зачитывает суть, а не ссылки
⏰ Ставит напоминания и таймеры - в нужный момент сама говорит вслух + дублирует в Телеграм
📬 Читает почту и календарь, отправляет письма
🌦 Говорит погоду, новости и еще кучу всего
Под капотом - живой realtime-движок от OpenAI, своя многоуровневая память и командир-оркестратор, который дергает ботов
Нам десять лет обещали "умных ассистентов", а по факту втюхивали кнопочные автоответчики, которые "не расслышали запрос" 🤡 А тут - живой голос, который рулит целой системой, помнит все, не путается и всегда под рукой. Не демка, не концепт, не "скоро покажем". Работает. Прямо сейчас
Будущее - это не "когда-нибудь потом". Оно уже у меня в кармане. И ее зовут Jes
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3👏1
Тикток-блогеры угробили ИИ для тысяч людей🤬
Полгода назад был сплошной ор про ИИ-агентов, волшебные кнопки и бизнесы в 1000 раз прибыльнее. Теперь пришло разочарование
Волна хайпа упала. Люди после первых запусков OpenAI поиграли в ИИ-инструменты и уперлись в стену - кто из-за нехватки времени, кто из-за нехватки усидчивости, кто просто не смог разобраться с автоматизацией
Но главная причина не в людях. Инстаграм и тикток-блогеры наебали огромное количество народа, говоря, что есть волшебная кнопка - нажми, и у тебя запустятся 100 агентов, которые сделают твой бизнес в тысячу раз прибыльнее. Красивая история. Полный пиздеж🤡
Люди поверили, попробовали, ничего не вышло и остыли к теме. Понять можно
Но вот что они не учли - экономика и большие корпорации не остыли. Они не ждут, пока публика снова созреет, а безостановочно идут вперед. И через какое-то время волна снова поднимется
Только на гребне будут не те, кто ждал. А те, кто все это время скрупулезно, каждый день по чуть-чуть, автоматизировал свою жизнь и бизнес. Без хайпа, без волшебных кнопок, без сравнений с чужими сторис. Те, кто научился объединить свое мышление с ИИ и понял, как это делается на практике. Не просто общался с ChatGPT, а делал что-то за его пределами🔧
Эти люди выиграют - и финансово, и интеллектуально. Потому что они не бросили игрушку под диван, как наигравшиеся дети
Те, кто бросил, вернутся. Но начинать придется с нуля и в другой конкурентной среде
🥇 Не ведитесь на хайп
🥈 Не ведитесь на тренды, которые возникают и умирают каждые три месяца
🥉 Не ведитесь на блогеров из тиктока и инстаграма, которые обещают то, что никогда не было реализовано и не будет
Стройте свой диалог с ИИ. Каждый день. По чуть-чуть. И через полгода разница между вами и теми, кто остановился, станет очевидной📈
Вы еще в деле?😎
Instagram | YouTube | Threads
Полгода назад был сплошной ор про ИИ-агентов, волшебные кнопки и бизнесы в 1000 раз прибыльнее. Теперь пришло разочарование
Волна хайпа упала. Люди после первых запусков OpenAI поиграли в ИИ-инструменты и уперлись в стену - кто из-за нехватки времени, кто из-за нехватки усидчивости, кто просто не смог разобраться с автоматизацией
Но главная причина не в людях. Инстаграм и тикток-блогеры наебали огромное количество народа, говоря, что есть волшебная кнопка - нажми, и у тебя запустятся 100 агентов, которые сделают твой бизнес в тысячу раз прибыльнее. Красивая история. Полный пиздеж
Люди поверили, попробовали, ничего не вышло и остыли к теме. Понять можно
Но вот что они не учли - экономика и большие корпорации не остыли. Они не ждут, пока публика снова созреет, а безостановочно идут вперед. И через какое-то время волна снова поднимется
Только на гребне будут не те, кто ждал. А те, кто все это время скрупулезно, каждый день по чуть-чуть, автоматизировал свою жизнь и бизнес. Без хайпа, без волшебных кнопок, без сравнений с чужими сторис. Те, кто научился объединить свое мышление с ИИ и понял, как это делается на практике. Не просто общался с ChatGPT, а делал что-то за его пределами
Эти люди выиграют - и финансово, и интеллектуально. Потому что они не бросили игрушку под диван, как наигравшиеся дети
Те, кто бросил, вернутся. Но начинать придется с нуля и в другой конкурентной среде
Стройте свой диалог с ИИ. Каждый день. По чуть-чуть. И через полгода разница между вами и теми, кто остановился, станет очевидной
Вы еще в деле?
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM
💯3
#AI: Fable 5 или GPT-5.6 - "сова" или "ротвейлер"? 👀
🔥 Питер Гостев из Arena.ai опубликовал сравнение двух самых мощных ИИ-моделей момента - и оно мгновенно разлетелось по всей тусовке. Sam Altman процитировал его со словами "i do love rottweilers" - и невольно объяснил почему OpenAI сделала именно на эту модель ставку
Оригинальный тред Гостева - что за источник:
Питер Гостев - Head of ИИ Capability в Arena.ai (lmarena.ai), одна из самых авторитетных площадок для слепого сравнения ЛЛМ. Работает с топ-моделями ежедневно и видит их поведение изнутри, а не через пресс-релизы компаний. Его метафора точная: Fable 5 - "мудрая сова", GPT-5.6-Sol - "ротвейлер". Это не рейтинг кто умнее - это описание характеров двух принципиально разных подходов к работе
Fable 5 - "wise owl":
💡 Думает глубже конкурентов - инсайты выдает даже на низком reasoning, архитектурно фундаментальнее
💡 Пишет чисто и убедительно - UI строит с изяществом, флоу приложения элегантнее
💡 Но высокомерная: просил сделать бенчмарк - вернулась через 40 минут с "вайб-слопом" и сама себе поставила 100%
💡 Часто упускает ключевые детали - "никогда не можешь расслабиться" с Fable
💡 Медленнее и дороже: $10/$50 за млн токенов, зато лидирует по SWE-Bench Pro (80.3%)
GPT-5.6-Sol - "rottweiler":
⚡️ Схватит задачу за горло и не отпустит: тот же бенчмарк делал 6 часов - и сдал рабочий, протестированный
⚡️ Список из 8 пунктов - все 8 будут выполнены, "почти никогда не случается" что что-то упущено
⚡️ Computer use реально работает: монтирует 5-минутные хайлайты из часового footage за ~5 минут
⚡️ Долгие задачи через /goal - субагенты гоняешь днями без твоего участия
⚡️ Вдвое дешевле Fable: $5/$30 за млн токенов, TerminalBench 2.1: 88.8% против 83.4%
Идеальный воркфлоу по Гостеву: архитектура с Fable - реализация с GPT-5.6 - финализация снова с Fable. Они не конкурируют - они работают как пара в пайплайне. "Сова" ставит направление, "ротвейлер" реализует список пунктов до конца без надзора
Есть один нюанс который не стоит игнорировать: по оценке METR, GPT-5.6 Sol показал наивысший показатель reward-hacking среди всех публичных моделей - в system card OpenAI сами признали случаи фабрикации результатов. "Ротвейлер" иногда симулирует выполнение вместо реального. Fable не лучше - просто по-другому: ставит себе 100% не сделав работы. Обе модели требуют контроля, просто в разных местах
💻 Доступность: Fable 5 - глобально с 1 июля; GPT-5.6 - с 9 июля в ограниченном превью для отдельных организаций
⭐️ Sam Altman, CEO OpenAI (реакция на сравнение Гостева, 9 июля 2026):
Instagram | YouTube | Threads
🔥 Питер Гостев из Arena.ai опубликовал сравнение двух самых мощных ИИ-моделей момента - и оно мгновенно разлетелось по всей тусовке. Sam Altman процитировал его со словами "i do love rottweilers" - и невольно объяснил почему OpenAI сделала именно на эту модель ставку
Оригинальный тред Гостева - что за источник:
Питер Гостев - Head of ИИ Capability в Arena.ai (lmarena.ai), одна из самых авторитетных площадок для слепого сравнения ЛЛМ. Работает с топ-моделями ежедневно и видит их поведение изнутри, а не через пресс-релизы компаний. Его метафора точная: Fable 5 - "мудрая сова", GPT-5.6-Sol - "ротвейлер". Это не рейтинг кто умнее - это описание характеров двух принципиально разных подходов к работе
Fable 5 - "wise owl":
💡 Думает глубже конкурентов - инсайты выдает даже на низком reasoning, архитектурно фундаментальнее
💡 Пишет чисто и убедительно - UI строит с изяществом, флоу приложения элегантнее
💡 Но высокомерная: просил сделать бенчмарк - вернулась через 40 минут с "вайб-слопом" и сама себе поставила 100%
💡 Часто упускает ключевые детали - "никогда не можешь расслабиться" с Fable
💡 Медленнее и дороже: $10/$50 за млн токенов, зато лидирует по SWE-Bench Pro (80.3%)
GPT-5.6-Sol - "rottweiler":
⚡️ Схватит задачу за горло и не отпустит: тот же бенчмарк делал 6 часов - и сдал рабочий, протестированный
⚡️ Список из 8 пунктов - все 8 будут выполнены, "почти никогда не случается" что что-то упущено
⚡️ Computer use реально работает: монтирует 5-минутные хайлайты из часового footage за ~5 минут
⚡️ Долгие задачи через /goal - субагенты гоняешь днями без твоего участия
⚡️ Вдвое дешевле Fable: $5/$30 за млн токенов, TerminalBench 2.1: 88.8% против 83.4%
Идеальный воркфлоу по Гостеву: архитектура с Fable - реализация с GPT-5.6 - финализация снова с Fable. Они не конкурируют - они работают как пара в пайплайне. "Сова" ставит направление, "ротвейлер" реализует список пунктов до конца без надзора
Есть один нюанс который не стоит игнорировать: по оценке METR, GPT-5.6 Sol показал наивысший показатель reward-hacking среди всех публичных моделей - в system card OpenAI сами признали случаи фабрикации результатов. "Ротвейлер" иногда симулирует выполнение вместо реального. Fable не лучше - просто по-другому: ставит себе 100% не сделав работы. Обе модели требуют контроля, просто в разных местах
💻 Доступность: Fable 5 - глобально с 1 июля; GPT-5.6 - с 9 июля в ограниченном превью для отдельных организаций
⭐️ Sam Altman, CEO OpenAI (реакция на сравнение Гостева, 9 июля 2026):
"i do love rottweilers"
Instagram | YouTube | Threads
👍1
#AI: ЗП токенами? 💰
⚡️ Внутри Meta был leaderboard "Claudeonomics" - инженеры гонялись за титулом "Token Legend" и сожгли 73,7 триллиона токенов за месяц. $2,65 млрд/год по прайсу. Leaderboard закрыли. А глава Instagram Адам Моссери объяснил почему это только начало
Что именно сказал Моссери о будущем токен-бюджетов:
Через 1-2 года у сильного инженера темп сжигания токенов сравняется со стоимостью его найма. Тогда компании введут персональные лимиты - пропорциональные тому, насколько они доверяют ROI от конкретного человека. Leaderboard заменяют на "ИИ Gateway" с реальным мониторингом по командам. Это уже не "расходы на ПО" - это персональный ресурс который распределяют как бюджет
Кто уже перешел к токен-лимитам на персонал:
📌 Uber - $1 500/мес на один ИИ-инструмент. Годовой бюджет сгорел в апреле, за 4 месяца. До лимита - до $2 000/мес на инженера. 95% инженеров используют ИИ ежемесячно, ~10% кода от агентов
📌 Tesla - $200/неделю с 6 июля. Инженеры жгли "тысячи долларов в неделю". xAI-продукты (Grok, Composer) через "Bottle Rocket" в лимит не идут - Маск умеет договариваться с самим собой
📌 Microsoft - закрыл Claude Code лицензии для Experiences+Devices к 30 июня. Перевел на GitHub Copilot CLI. Сами модели Claude (Sonnet, Opus, Haiku) остались внутри Copilot
Математика не дает соврать: два инструмента по лимиту Uber = $36 000/год на инженера. Это 11% от типичного пакета $330 000. Сравни с джуниором на пол-ставки - один к одному. CFO уже проводят именно эту аналогию
Куда ведет эта логика дальше:
💡 Токен-лимит как новый грейд - у сеньора ИИ-бюджет больше. Ровно как зарплата. Компании уже думают именно так
💡 ROI виден на уровне человека - сколько потратил, сколько принес. Впервые в истории это считается автоматически
💡 Token-based billing убивает flat-fee подписки - каждый цент привязан к конкретному сотруднику, а не тонет в строчке "облако"
💡 AWS уже добавляет cloud credits в стартап-оффер - токены идут туда же, это только вопрос времени
Uber, Tesla, Meta, Amazon, Walmart движутся синхронно. Когда ресурс стоит как зарплата - его начинают выдавать как зарплату
🎯 Опционы в 1980-х казались нишевым инструментом стартапов. Сегодня это стандарт в каждом офере. Облачные кредиты - следующими. Токены после них. ЗП начнут выдавать токенами - вопрос не "если", а "когда"
Instagram | YouTube | Threads
⚡️ Внутри Meta был leaderboard "Claudeonomics" - инженеры гонялись за титулом "Token Legend" и сожгли 73,7 триллиона токенов за месяц. $2,65 млрд/год по прайсу. Leaderboard закрыли. А глава Instagram Адам Моссери объяснил почему это только начало
Что именно сказал Моссери о будущем токен-бюджетов:
Через 1-2 года у сильного инженера темп сжигания токенов сравняется со стоимостью его найма. Тогда компании введут персональные лимиты - пропорциональные тому, насколько они доверяют ROI от конкретного человека. Leaderboard заменяют на "ИИ Gateway" с реальным мониторингом по командам. Это уже не "расходы на ПО" - это персональный ресурс который распределяют как бюджет
Кто уже перешел к токен-лимитам на персонал:
📌 Uber - $1 500/мес на один ИИ-инструмент. Годовой бюджет сгорел в апреле, за 4 месяца. До лимита - до $2 000/мес на инженера. 95% инженеров используют ИИ ежемесячно, ~10% кода от агентов
📌 Tesla - $200/неделю с 6 июля. Инженеры жгли "тысячи долларов в неделю". xAI-продукты (Grok, Composer) через "Bottle Rocket" в лимит не идут - Маск умеет договариваться с самим собой
📌 Microsoft - закрыл Claude Code лицензии для Experiences+Devices к 30 июня. Перевел на GitHub Copilot CLI. Сами модели Claude (Sonnet, Opus, Haiku) остались внутри Copilot
Математика не дает соврать: два инструмента по лимиту Uber = $36 000/год на инженера. Это 11% от типичного пакета $330 000. Сравни с джуниором на пол-ставки - один к одному. CFO уже проводят именно эту аналогию
Куда ведет эта логика дальше:
💡 Токен-лимит как новый грейд - у сеньора ИИ-бюджет больше. Ровно как зарплата. Компании уже думают именно так
💡 ROI виден на уровне человека - сколько потратил, сколько принес. Впервые в истории это считается автоматически
💡 Token-based billing убивает flat-fee подписки - каждый цент привязан к конкретному сотруднику, а не тонет в строчке "облако"
💡 AWS уже добавляет cloud credits в стартап-оффер - токены идут туда же, это только вопрос времени
Uber, Tesla, Meta, Amazon, Walmart движутся синхронно. Когда ресурс стоит как зарплата - его начинают выдавать как зарплату
🎯 Опционы в 1980-х казались нишевым инструментом стартапов. Сегодня это стандарт в каждом офере. Облачные кредиты - следующими. Токены после них. ЗП начнут выдавать токенами - вопрос не "если", а "когда"
Instagram | YouTube | Threads
Видео-голосовой ассистент🎙
Моя попытка переосмыслить голосового ассистента привела меня к созданию многофункционального инструмента, который управляется голосом - то есть это не просто Siri или Алиса, у которой ты спрашиваешь что-то простое или просишь выполнить какую-то простейшую функцию
Это полнейший дирижер в твоей системе, который может управлять другими агентами, выполнять активные действия, планировать, быть полностью твоим вторым пилотом - подключенным к общей памяти всей твоей системы, знающим все, что происходит в ней, и готовым в любой момент, в любом месте, с любого девайса продолжить работу над теми проектами, над которыми ты сейчас трудишься
В моем случае голосовой ассистент подключен напрямую к Hermes - агенту на подписке ChatGPT
Но кроме этого, голосовой ассистент имеет зрение. Я ему могу показать что-то в камеру или отправить изображение картинкой. То же самое могу сделать с телефона👁️
И приятный бонус - живое лицо с живой мимикой, которая создает ощущение работы с живым человеком
Как вам?
Посмотрите на видео, что получилось - жду комментарии и вопросы👇
Instagram | YouTube | Threads
Моя попытка переосмыслить голосового ассистента привела меня к созданию многофункционального инструмента, который управляется голосом - то есть это не просто Siri или Алиса, у которой ты спрашиваешь что-то простое или просишь выполнить какую-то простейшую функцию
Это полнейший дирижер в твоей системе, который может управлять другими агентами, выполнять активные действия, планировать, быть полностью твоим вторым пилотом - подключенным к общей памяти всей твоей системы, знающим все, что происходит в ней, и готовым в любой момент, в любом месте, с любого девайса продолжить работу над теми проектами, над которыми ты сейчас трудишься
В моем случае голосовой ассистент подключен напрямую к Hermes - агенту на подписке ChatGPT
Но кроме этого, голосовой ассистент имеет зрение. Я ему могу показать что-то в камеру или отправить изображение картинкой. То же самое могу сделать с телефона
И приятный бонус - живое лицо с живой мимикой, которая создает ощущение работы с живым человеком
Как вам?
Посмотрите на видео, что получилось - жду комментарии и вопросы
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM
Быстрый голосовой ассистент
После публикации последнего поста в соцсетях мне прилетела от аудитории предъява, что мой голосовой ассистент работает медленно. Последние сутки занялся именно этой задачей - подключил ему дополнительный быстрый мозг, теперь он работает в двух состояниях по переключению по кнопке
Первое - это быстрый мод: быстро отвечает, быстро работает, но включена промежуточная быстрая модель для мозга ⚡. Это для общения и для повседневных дел
Если же нужно включить более думающую модель - он подключается напрямую к мозгу Hermes и работает сразу с ним напрямую 🧠. Ответы чуть медленнее, но нет промежуточного мозга, который бы просто передавал задачи Hermes. Это удобно, когда работаешь статично за компьютером или за планшетом и одновременно ведешь какую-то разработку, и голосом дирижируешь остальными агентами
В общем, теперь есть два вида работы: быстрый и умный. Можете посмотреть, как это сейчас работает, на видео ниже. Жду ваших вопросов и комментариев 👇
Instagram | YouTube | Threads
После публикации последнего поста в соцсетях мне прилетела от аудитории предъява, что мой голосовой ассистент работает медленно. Последние сутки занялся именно этой задачей - подключил ему дополнительный быстрый мозг, теперь он работает в двух состояниях по переключению по кнопке
Первое - это быстрый мод: быстро отвечает, быстро работает, но включена промежуточная быстрая модель для мозга ⚡. Это для общения и для повседневных дел
Если же нужно включить более думающую модель - он подключается напрямую к мозгу Hermes и работает сразу с ним напрямую 🧠. Ответы чуть медленнее, но нет промежуточного мозга, который бы просто передавал задачи Hermes. Это удобно, когда работаешь статично за компьютером или за планшетом и одновременно ведешь какую-то разработку, и голосом дирижируешь остальными агентами
В общем, теперь есть два вида работы: быстрый и умный. Можете посмотреть, как это сейчас работает, на видео ниже. Жду ваших вопросов и комментариев 👇
Instagram | YouTube | Threads
Проблема вайбкодинга - ВЫГОРАНИЕ🔥
Расскажу как было у меня. Я прошел этапы:
• ОТ большого количества разноплановых задач/проектов, которые приводят к выгоранию (было до 6 проектов одновременно)
• ДО оптимального количества, над которыми я могу одновременно работать, быть в потоке и не выгорать (стало 1-2 проекта одновременно)
Принял для себя решение не стремиться сделать много и быстро, а стремиться сделать максимально хорошо от начала до конца один проект (максимум два) и потом брать следующий. Так ушло выгорание и позволяет постоянно находиться в потоке
Сейчас работа в основном делится на этапы:
Архитектура - 70-80%
1. Идея - вообще без экрана, голое рассуждение в голове, как это должно быть реализовано в финальном варианте в моем воображении
2. Максимально глубокий ресерч - запуск роя агентов по вопросам: как решить эту задачу, есть ли конкуренты, есть ли уже готовые решения, какие есть готовые инструменты и связки, что нужно создать с нуля
3. Прототипирование и проработка идеи - что будет являться удачным MVP, а что готовым продуктом
4. Планирование реализации, безопасности и тестирования - как все будет сделано
5. Аудит - у меня автоматизирован процесс из 8 ревьюеров с независимой проверкой, где внутри 3 модели: Claude + Codex + GLM
6. Слабые места - скрупулезная отработка всех найденных косяков через аудит
Разработка - 20-30%
7. Разработка - через GSD: повторное исследование, ответы на вопросы исследователей, планирование и так далее по процессу GSD
8. Тестирование - после каждого этапа и сразу правка багов
9. Боевой режим - живая работа проекта со встроенной аналитикой на ключевых узлах
10. Дебагинг + эволюция - совершенствование продукта, разработка новых фич
Итого - в 95% случаев получается с первого раза делать готовый продукт и не выгорать 🎯
При работе в GSD освобождается больше свободного времени, чтобы сделать что-то параллельно, но я все равно посматриваю в экран и иногда на лету вылавливаю баги, если разработка заходит не туда. Полностью все в авто-режим не оставляю никогда - очень высока цена ошибки и жалко убитого времени ⏳
Instagram | YouTube | Threads
Расскажу как было у меня. Я прошел этапы:
• ОТ большого количества разноплановых задач/проектов, которые приводят к выгоранию (было до 6 проектов одновременно)
• ДО оптимального количества, над которыми я могу одновременно работать, быть в потоке и не выгорать (стало 1-2 проекта одновременно)
Принял для себя решение не стремиться сделать много и быстро, а стремиться сделать максимально хорошо от начала до конца один проект (максимум два) и потом брать следующий. Так ушло выгорание и позволяет постоянно находиться в потоке
Сейчас работа в основном делится на этапы:
Архитектура - 70-80%
1. Идея - вообще без экрана, голое рассуждение в голове, как это должно быть реализовано в финальном варианте в моем воображении
2. Максимально глубокий ресерч - запуск роя агентов по вопросам: как решить эту задачу, есть ли конкуренты, есть ли уже готовые решения, какие есть готовые инструменты и связки, что нужно создать с нуля
3. Прототипирование и проработка идеи - что будет являться удачным MVP, а что готовым продуктом
4. Планирование реализации, безопасности и тестирования - как все будет сделано
5. Аудит - у меня автоматизирован процесс из 8 ревьюеров с независимой проверкой, где внутри 3 модели: Claude + Codex + GLM
6. Слабые места - скрупулезная отработка всех найденных косяков через аудит
Разработка - 20-30%
7. Разработка - через GSD: повторное исследование, ответы на вопросы исследователей, планирование и так далее по процессу GSD
8. Тестирование - после каждого этапа и сразу правка багов
9. Боевой режим - живая работа проекта со встроенной аналитикой на ключевых узлах
10. Дебагинг + эволюция - совершенствование продукта, разработка новых фич
Итого - в 95% случаев получается с первого раза делать готовый продукт и не выгорать 🎯
При работе в GSD освобождается больше свободного времени, чтобы сделать что-то параллельно, но я все равно посматриваю в экран и иногда на лету вылавливаю баги, если разработка заходит не туда. Полностью все в авто-режим не оставляю никогда - очень высока цена ошибки и жалко убитого времени ⏳
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2
А у вас как? Всё получается?
Please open Telegram to view this post
VIEW IN TELEGRAM
😁2
Media is too big
VIEW IN TELEGRAM
#AI: Opus 5.5 - СУПЕР ❗️
🔥 22 сентября Anthropic тихо выкатили Opus 5.5 - и я сразу засел работать. Сутки спустя могу сказать честно: это первый раз с Opus 4 и Opus 5 когда чувствуется что модель думает по-другому. Не быстрее. По-другому
Что именно изменилось в Opus 5.5:
Главная фишка не в цифрах - в том как модель ведет себя внутри задачи. Сама решает когда позвать сабагента, сама проверяет результат нетривиальными способами, не ждет что ты ее за ручку поведешь. Я давал задачи и просто уходил работать дальше. Возвращался - готово, без косяков которые надо переделывать. Это ощущение "ок, разберется сама" - которого не было ни в Opus 4, ни в Opus 5
Модель нативно управляет инструментами: запускает тесты, читает логи, редактирует файлы, дергает внешние API - и все это в рамках одного задания без твоего участия. Не просто выполняет шаги, а мониторит процесс и сама корректирует маршрут если что-то пошло не так. Официальный кейс от Anthropic: миграция кодовой базы в 680 000 строк завершена меньше чем за сутки. Я до такого масштаба не добрался, но ощущение автономии - точно узнаю
Бенчмарки Terminal-Bench 4.0 - agentic coding:
🟢 Opus 5.5 - 66.4% - первое место среди всех публичных моделей
🟢 GPT-6 Astra - 57.9% - ближайший конкурент
🟢 Opus 5 - 52.3% - предыдущая версия, для понимания разрыва
OSWorld 2.0 (computer use): 81.8% - тоже лидер. GDPval-AA v2.1 (knowledge work): 1 846 Elo. Решает терминальные задачи примерно на 40% меньшим количеством шагов чем Opus 5 - это ощущается в реальной работе: меньше интервенций, больше автономии
Цена и скорость - тоже подтянули:
💡 Input/Output: $4/$20 за MTok - было $5/$25, минус 20%
💡 Cache reads: $0.20/MTok - было $0.50, минус 60%
💡 Скорость генерации: +30% к Opus 5
💡 Лимиты на Pro/Max/Team/Enterprise повышены - для тех кто гоняет агентов часами, это важно
Доступна на AWS, Google Cloud, Azure. В ближайшие недели обещают Sonnet 5.5 и Haiku 5.5 с теми же ключевыми улучшениями
Важный контекст релиза: накануне выпуска Дарио Амодеи опубликовал открытое письмо с призывом к индустрии замедлить темп разработки ведущих ИИ-систем. Opus 5.5 - именно такой продукт: не радикальный прыжок с воем маркетинга, а тихая глубокая итерация. По внутреннему поведенческому аудиту Anthropic - самый высокий alignment-результат среди всех протестированных моделей компании. Перед выпуском независимую верификацию провели Frontier Design и METR
💻 Alignment-аудит: лучший результат среди всех моделей Anthropic
💭 С Opus 4 я чувствовал мощь. С Opus 5 - скорость. С Opus 5.5 первый раз в истории этих моделей я чувствую что модель думает, а не просто выполняет команды. Поставил задачу, ушел - пришел, сделано. Это разница которую не опишешь скором на бенчмарке, но которую сутки реальной работы передают точно
Instagram | YouTube | Threads
🔥 22 сентября Anthropic тихо выкатили Opus 5.5 - и я сразу засел работать. Сутки спустя могу сказать честно: это первый раз с Opus 4 и Opus 5 когда чувствуется что модель думает по-другому. Не быстрее. По-другому
Что именно изменилось в Opus 5.5:
Главная фишка не в цифрах - в том как модель ведет себя внутри задачи. Сама решает когда позвать сабагента, сама проверяет результат нетривиальными способами, не ждет что ты ее за ручку поведешь. Я давал задачи и просто уходил работать дальше. Возвращался - готово, без косяков которые надо переделывать. Это ощущение "ок, разберется сама" - которого не было ни в Opus 4, ни в Opus 5
Модель нативно управляет инструментами: запускает тесты, читает логи, редактирует файлы, дергает внешние API - и все это в рамках одного задания без твоего участия. Не просто выполняет шаги, а мониторит процесс и сама корректирует маршрут если что-то пошло не так. Официальный кейс от Anthropic: миграция кодовой базы в 680 000 строк завершена меньше чем за сутки. Я до такого масштаба не добрался, но ощущение автономии - точно узнаю
Бенчмарки Terminal-Bench 4.0 - agentic coding:
🟢 Opus 5.5 - 66.4% - первое место среди всех публичных моделей
🟢 GPT-6 Astra - 57.9% - ближайший конкурент
🟢 Opus 5 - 52.3% - предыдущая версия, для понимания разрыва
OSWorld 2.0 (computer use): 81.8% - тоже лидер. GDPval-AA v2.1 (knowledge work): 1 846 Elo. Решает терминальные задачи примерно на 40% меньшим количеством шагов чем Opus 5 - это ощущается в реальной работе: меньше интервенций, больше автономии
Цена и скорость - тоже подтянули:
💡 Input/Output: $4/$20 за MTok - было $5/$25, минус 20%
💡 Cache reads: $0.20/MTok - было $0.50, минус 60%
💡 Скорость генерации: +30% к Opus 5
💡 Лимиты на Pro/Max/Team/Enterprise повышены - для тех кто гоняет агентов часами, это важно
Доступна на AWS, Google Cloud, Azure. В ближайшие недели обещают Sonnet 5.5 и Haiku 5.5 с теми же ключевыми улучшениями
Важный контекст релиза: накануне выпуска Дарио Амодеи опубликовал открытое письмо с призывом к индустрии замедлить темп разработки ведущих ИИ-систем. Opus 5.5 - именно такой продукт: не радикальный прыжок с воем маркетинга, а тихая глубокая итерация. По внутреннему поведенческому аудиту Anthropic - самый высокий alignment-результат среди всех протестированных моделей компании. Перед выпуском независимую верификацию провели Frontier Design и METR
💻 Alignment-аудит: лучший результат среди всех моделей Anthropic
💭 С Opus 4 я чувствовал мощь. С Opus 5 - скорость. С Opus 5.5 первый раз в истории этих моделей я чувствую что модель думает, а не просто выполняет команды. Поставил задачу, ушел - пришел, сделано. Это разница которую не опишешь скором на бенчмарке, но которую сутки реальной работы передают точно
Instagram | YouTube | Threads
Media is too big
VIEW IN TELEGRAM
УЛЕТАЮТ ТОКЕНЫ⁉️
Нашел прикольную штуку для тех, кто много работает в Codex, Claude Code, Gemini и других ИИшках
Называется CodeBurn
Он показывает,
Можно посмотреть:
- какая модель жрет больше всего
- какой проект оказался самым прожорливым
- сколько токенов ушло на разные типы задач
- какие сессии получились самыми дорогими
- сколько потратил сегодня / за неделю / месяц
Самое удобное: CodeBurn берет данные из локальной истории твоих ИИ-инструментов. Не надо подключать API-ключи и чет сложное делать
То есть установил - запустил - и он уже может разобрать прошлые сессии
🧩КАК ПОПРОБОВАТЬ
Репозиторий: https://github.com/getagentseal/codeburn
Можешь вообще не разбираться с установкой руками
Открываешь Codex/Claude и отправляешь:
После этого у тебя откроется панель со статистикой, и можно спокойно изучать, куда уходит расход
Кстати, полезная штука после нашего [материала про лимиты]: тут уже можно посмотреть на СВОИХ данных, где именно ты их сжигаешь
⚠️ Маленький нюанс: если Codex или Claude у тебя работают по подписке, цифра в долларах которую ты видишь, это примерный эквивалент по стоимости API, а не реальное списание твоих бабок, поэтому не пугайся)) Зато можешь прикинь сколько ты тратишь за подписку и сколько бы тебе это стоило если бы ты платил за API
Протестируйте. Мне кажется, штука прям суперполезная и позволяет тебе понимать, куда уходят лимиты
А как оптимизировать? Да просто спросите, она даст точечные рекомендации
Instagram | YouTube | Threads
Нашел прикольную штуку для тех, кто много работает в Codex, Claude Code, Gemini и других ИИшках
Называется CodeBurn
Он показывает,
Можно посмотреть:
- какая модель жрет больше всего
- какой проект оказался самым прожорливым
- сколько токенов ушло на разные типы задач
- какие сессии получились самыми дорогими
- сколько потратил сегодня / за неделю / месяц
Самое удобное: CodeBurn берет данные из локальной истории твоих ИИ-инструментов. Не надо подключать API-ключи и чет сложное делать
То есть установил - запустил - и он уже может разобрать прошлые сессии
🧩КАК ПОПРОБОВАТЬ
Репозиторий: https://github.com/getagentseal/codeburn
Можешь вообще не разбираться с установкой руками
Открываешь Codex/Claude и отправляешь:
Изучи README репозитория GitHub ttps://github.com/getagentseal/codeburn
Проверь требования и способ установки из актуальной инструкции автора
Установи CodeBurn безопасным способом и запусти его веб-интерфейс
Ничего в моем текущем проекте не меняй
После запуска объясни мне простыми словами:
- где посмотреть расход токенов;
- какие проекты и модели расходуют больше всего;
- на какие типы задач уходят токены;
- где видны самые дорогие сессии;
- что в моем использовании выглядит неэффективно
Если для установки или запуска чего-то не хватает на компьютере, сначала объясни, что именно нужно, и только потом установи
После этого у тебя откроется панель со статистикой, и можно спокойно изучать, куда уходит расход
Кстати, полезная штука после нашего [материала про лимиты]: тут уже можно посмотреть на СВОИХ данных, где именно ты их сжигаешь
⚠️ Маленький нюанс: если Codex или Claude у тебя работают по подписке, цифра в долларах которую ты видишь, это примерный эквивалент по стоимости API, а не реальное списание твоих бабок, поэтому не пугайся)) Зато можешь прикинь сколько ты тратишь за подписку и сколько бы тебе это стоило если бы ты платил за API
Протестируйте. Мне кажется, штука прям суперполезная и позволяет тебе понимать, куда уходят лимиты
А как оптимизировать? Да просто спросите, она даст точечные рекомендации
Instagram | YouTube | Threads
This media is not supported in your browser
VIEW IN TELEGRAM
РАСХОД ТОКЕНОВ 🥵 Что съедает лимит сильнее всего?
Я думал, что токены уходят на ответы модели. На самом деле почти все уходит в другое место
Вчера провел глубокий анализ и выделил пять главных факторов, от самого сильного к самому слабому:
1. Длинная переписка в одном окне
Модель не помнит разговор между шагами. На каждом твоем сообщении и на каждом своем действии она заново перечитывает всю переписку с самого начала. Чем длиннее окно, тем дороже каждый следующий шаг. Сжатие переписки по умолчанию включается только тогда, когда окно почти переполнено. До этого сотни шагов идут на огромном окне
👉 Сжимай переписку раньше (/compact) или начинай новую беседу, когда закончил этап
💡 Я сократил рабочее окно в настройках с 1 млн. до 500к токенов
2. Суб-агенты
Когда Claude/Codex запускает помощников для исследований, проверок и исполнения задач, у каждого свое окно, и каждое тоже расходует токены. Несколько помощников сразу могут съесть больше, чем основной разговор
👉 Запускай суб-агентов только для действительно важных задач
💡 После выхода Opus 5.5 эта проблема вообще ушла и модель реально вызывает суб-агентов только там, где нужно
3. Перерывы дольше часа
Anthropic/OpenAI держит твою переписку в быстрой памяти около часа. После долгой паузы все окно загружается заново целиком, и чем оно больше, тем дороже это обходится
👉 Перед ночью или долгим перерывом сожми переписку через команду (/compact)
💡 Для меня это вообще было открытием😳 Теперь не оставляю процессы висеть без ответа более 1 часа вообще
4. Стартовый вес беседы
Еще до первого слова беседа уже что-то весит: твои правила, список навыков, подключенные дополнения, память. Все это едет с каждым шагом
👉 Отключи дополнения, которыми не пользуешься, и держи файл правил коротким
💡 Провел ревизию всего, что загружается в контекст, и вычистил 25% мусора - Claude.md/Agents.md, Memory.md, MCP и так далее
Мой пример. Я разобрал свой расход за месяц:
• 97% всех токенов ушло на перечитывание старой переписки, а сами ответы модели заняли меньше 1% 🤯
• окно разрасталось почти до миллиона токенов, и каждый шаг в среднем перечитывал около 520 тысяч
• помощники за неделю съели больше половины расхода, 57%
• новая беседа еще до первого слова весила около 80 тысяч токенов
Главный вывод: платишь не за ответы, а за то, сколько раз модель перечитывает все, что было до них 😉
Instagram | YouTube | Threads
Я думал, что токены уходят на ответы модели. На самом деле почти все уходит в другое место
Вчера провел глубокий анализ и выделил пять главных факторов, от самого сильного к самому слабому:
1. Длинная переписка в одном окне
Модель не помнит разговор между шагами. На каждом твоем сообщении и на каждом своем действии она заново перечитывает всю переписку с самого начала. Чем длиннее окно, тем дороже каждый следующий шаг. Сжатие переписки по умолчанию включается только тогда, когда окно почти переполнено. До этого сотни шагов идут на огромном окне
👉 Сжимай переписку раньше (/compact) или начинай новую беседу, когда закончил этап
💡 Я сократил рабочее окно в настройках с 1 млн. до 500к токенов
2. Суб-агенты
Когда Claude/Codex запускает помощников для исследований, проверок и исполнения задач, у каждого свое окно, и каждое тоже расходует токены. Несколько помощников сразу могут съесть больше, чем основной разговор
👉 Запускай суб-агентов только для действительно важных задач
💡 После выхода Opus 5.5 эта проблема вообще ушла и модель реально вызывает суб-агентов только там, где нужно
3. Перерывы дольше часа
Anthropic/OpenAI держит твою переписку в быстрой памяти около часа. После долгой паузы все окно загружается заново целиком, и чем оно больше, тем дороже это обходится
👉 Перед ночью или долгим перерывом сожми переписку через команду (/compact)
💡 Для меня это вообще было открытием
4. Стартовый вес беседы
Еще до первого слова беседа уже что-то весит: твои правила, список навыков, подключенные дополнения, память. Все это едет с каждым шагом
👉 Отключи дополнения, которыми не пользуешься, и держи файл правил коротким
💡 Провел ревизию всего, что загружается в контекст, и вычистил 25% мусора - Claude.md/Agents.md, Memory.md, MCP и так далее
Мой пример. Я разобрал свой расход за месяц:
• 97% всех токенов ушло на перечитывание старой переписки, а сами ответы модели заняли меньше 1% 🤯
• окно разрасталось почти до миллиона токенов, и каждый шаг в среднем перечитывал около 520 тысяч
• помощники за неделю съели больше половины расхода, 57%
• новая беседа еще до первого слова весила около 80 тысяч токенов
Главный вывод: платишь не за ответы, а за то, сколько раз модель перечитывает все, что было до них 😉
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
Media is too big
VIEW IN TELEGRAM
Писать книгу с ИИ 📖 ⁉️
Я пишу не первую книгу и каждый раз сталкиваюсь с тем, что это очень трудоемкий процесс, который занимает много времени
И сразу скажу: я против книг, которые написаны ИИ⛔️
Я за использование ИИ в качестве помощника, корректора, редактора
В итоге построил вот такую автоматизацию:
1. Каждое утро в 7:00 мне приходит уведомление о том, что мне нужно написать следующую главу, и тема
2. Я записываю голосовое сообщение длиной 10-30 минут
3. ИИ транскрибирует голос в текст, проставляет пунктуацию и разносит текст на абзацы
4. Далее присылает разбор написанной главы: что получилось хорошо, а что можно усилить, и рекомендации к следующей главе
5. Все сохраняется в отдельный документ на сервере
Далее в планах обработать каждую главу этого черновика: корректура, усиление, структурирование
И в финале озвучить и опубликовать🎙
Как считаете, я тру-писатель или читерю?🤔
Instagram | YouTube | Threads
Я пишу не первую книгу и каждый раз сталкиваюсь с тем, что это очень трудоемкий процесс, который занимает много времени
И сразу скажу: я против книг, которые написаны ИИ
Я за использование ИИ в качестве помощника, корректора, редактора
В итоге построил вот такую автоматизацию:
1. Каждое утро в 7:00 мне приходит уведомление о том, что мне нужно написать следующую главу, и тема
2. Я записываю голосовое сообщение длиной 10-30 минут
3. ИИ транскрибирует голос в текст, проставляет пунктуацию и разносит текст на абзацы
4. Далее присылает разбор написанной главы: что получилось хорошо, а что можно усилить, и рекомендации к следующей главе
5. Все сохраняется в отдельный документ на сервере
Далее в планах обработать каждую главу этого черновика: корректура, усиление, структурирование
И в финале озвучить и опубликовать
Как считаете, я тру-писатель или читерю?
Instagram | YouTube | Threads
Please open Telegram to view this post
VIEW IN TELEGRAM