Дрессировщик Нейросетей
8.75K subscribers
111 photos
3 videos
2 files
110 links
ИИ-агенты и автоматизация под реальные задачи.
YouTube: youtube.com/@HandlerAI
Консультации и сотрудничество: @Flytoo
Download Telegram
ВСЕ ГОВОРЯТ ПРО КОД, А GOOGLE ТИХО ЛЕЗЕТ ВАМ В ТЕЛЕФОН

Смотрю ленту за последний месяц - сплошь код. Claude Code, Codex, Cursor, кто у кого отыграл процент на бенчмарке. А Google за этим шумом без фанфар выкатил кучу бытовых штук, которыми пользуешься каждый день. Коротко о том, что нового:

Nano Banana 2 Lite - картинки за пару секунд и вдвое дешевле старшей. Для «накидать двадцать вариантов и выбрать один». У меня генерация давно на Google, так что прям в кассу.
Gemini Omni Flash - монтаж видео обычным текстом: «убери фон, сделай темнее» - и готово. То, за что раньше платили монтажёру.
Auto Browse в Chrome на Android - браузер не просто отвечает на вопросы, а сам делает: проходит оформление заказа, заполняет формы, отменяет подписки. Перед оплатой переспрашивает.
Голос в Gmail и Docs - надиктовал, а оно нашло нужные письма или собрало документ из потока мыслей. Ни буквы руками.
Проверка на AI - навёл Google Lens на картинку и видишь: настоящая или сгенерирована. Мелочь, а в эпоху фейков полезно.
Фоновые агенты в поиске - сами следят за интересной тебе темой и приносят обновления. Персональный дозорный.

Но. Многое пока в тесте и стартует с США и английского - до остального мира доезжает позже. Nano Banana тут добрее остальных: её API открыт глобально, дотянуться проще всего.

Куда это катится. Основное прилетает на Android, тут без сюрпризов. Но Apple ведь сама переезжает на Gemini - их Apple Intelligence теперь на гугловских моделях. Значит, те же фишки скоро доедут и до айфонов. Смешно выходит: спорим, чья модель лучше пишет код, а под капотом у всех потихоньку один и тот же Google.

А вы Gemini вообще открываете - или он висит иконкой, до которой руки не доходят?
👍1714
FABLE 5 - КАК СЕНЬОР, КОТОРЫЙ ТОЧНО ЗНАЕТ, ЧЕГО ТЫ ХОЧЕШЬ

Погонял Fable 5 и честно - на другие модели уже почти не смотрю. Как будто рядом сидит умный чел, который понимает тебя с полуслова.

Понимает задачу. Задаёт вопросы по делу. Сам замечает попутные мелочи и говорит о них. Держит фокус.

Минус тоже есть. Он слишком самостоятельный. Иногда сам себе задаёт вопрос, ответа не ждёт и едет дальше. Поэтому с ним работаешь не так, как с Opus или GPT-5.5 - надо сразу обозначить, где он решает сам, а где ждёт меня.

И ещё: на сложных задачах Fable быстро ест токены. Это и была одна из причин, почему я сделал плагин.

Собрал небольшой плагин для Claude Code - senior-fable. Смысл простой: дорогая модель думает, дешёвые делают.

• Fable - за главного: разбить задачу, архитектура, спорные решения, собрать всё вместе.
• Рутину (тесты, boilerplate, переименования) отдаёт дешёвому Sonnet.
• Долгие раскопки по коду и логам - Opus в режиме чтения: копается у себя, а мне отдаёт только итог.
• Рискованное (авторизация, миграции, спорная архитектура) - на второе мнение к Codex.

Из-за последнего пункта лучше поставить и Codex-плагин. Без него этот шаг просто пропустится.

Ставится в пару команд, включается через /senior-fable на сессии с Fable.

А вы Fable 5 уже пробовали - или пока на Opus/GPT?
22🔥49👍19101👌1
УСПЕЙТЕ ВЫЖАТЬ ИЗ FABLE МАКСИМУМ - ПОКА ОН ПО ПОДПИСКЕ

Сегодня последний день, когда Fable доступен по подписке. Если ещё не гоняли - потратьте его с толком. Не на очередную фичу, а на аудит того, как вы вообще работаете с агентами.

И тут смысл шире, чем сам Fable. Ваш харнес - хуки, скиллы, память, CLAUDE.md - остаётся с вами, а модель под ним меняется. Так что оптимизируете вы не «под конкретную модель», а свой рабочий контур в принципе. Он переживёт и эту модель, и следующую. А сильная модель для такого аудита - как раз повод успеть, пока она в доступе.

Fable отлично тянет эту мета-задачу. Глубины рассуждения хватает, чтобы не просто прочитать конфиги, а выцепить неочевидное: какие вопросы вы задаёте по десять раз (значит, это должно жить в CLAUDE.md или памяти), на что постоянно жмёте «разрешить» (кандидаты в allowlist), какие скиллы мертвы, где дорогая модель жжётся на мелочах.

Важный приём - пусть сначала проинтервьюирует вас, а не сразу копает. Тогда советы лягут на ваши реальные боли, а не на общий чеклист.

Вставьте этот промпт в Fable и оптимизируйте свою работу (он под Claude Code - пути и инструменты подправьте под свой харнес):

Проанализируй мою работу с Claude Code и оптимизируй её. Порядок такой:

1. Сначала проинтервьюируй меня: задай по одному вопросу - какая
главная цель (скорость / качество / автономность / экономия
лимитов), что болит сильнее всего, что точно не трогать.

2. Потом изучи мой харнес: ~/.claude/settings.json (хуки, permissions),
глобальный и проектные CLAUDE.md, скиллы, MCP-серверы, память.

3. Пройдись по истории сессий в ~/.claude/projects - не читай всё
подряд, сначала собери статистику скриптом (это бесплатно): какие
первые промпты повторяются из сессии в сессию, где я чаще всего
отклоняю permission-запросы, какие скиллы никогда не вызываются,
где длинные сессии обрывались без результата.

4. Дай мне: топ неочевидных находок, приоритизированный список
улучшений (быстрые победы отдельно) и предложи автоматизацию -
хуки, allowlist, скиллы, cron. Ничего не внедряй без моего одобрения.


Ключевой пункт - «сначала скрипт, потом чтение». История сессий может весить сотни мегабайт. Наивное «прочитай все сессии» сожжёт лимиты впустую и не факт что доедет. Статистику соберёт python за секунды и ноль токенов - а уже по ней модель решает, что открывать глазами.

Успеете прогнать, пока по подписке?
👍358🔥8👎1🤝1
СЕГОДНЯ ВСЁ ВНЕЗАПНО РАБОТАЕТ

Бывают дни, когда обновления не бесят, а радуют. Сегодня прям такой.

Grok 4.5 - свежий, по SuperGrok дают пощупать 7 дней бесплатно. Работает неожиданно хорошо, похоже, сказывается покупка Cursor. Не демо-огрызок, а полноценный режим.
Live 1, голосовой от OpenAI. Включил и сначала выпал: говоришь почти как с живым человеком. Не роботное «чем могу помочь», а нормальный диалог. Меня, честно, подзаморозило.
• На подходе GPT-5.6 - обещают сегодня.

Осталось, чтобы Anthropic в честь такого дня ещё и лимиты сбросили. Вот тогда будет совсем праздник.

А вы уже щупали Grok 4.5 или голосовой режим? Делитесь, как ощущения.
🔥211
ВЫШЛО ПРОДОЛЖЕНИЕ ГЛАВНОГО БЕСТСЕЛЛЕРА ПРО ИИ

Помните AI 2027? Тот самый сценарий с датами, который все обсуждали. Та же команда (Eli Lifland, экс-OpenAI) выкатила продолжение - AI 2040: Plan A. На этот раз не «как мы все умрём», а «как выжить».

Если кому-то лень читать целиком - вот кратко.

Суть: пять сценариев, как США могут (или не могут) ответить на приход суперинтеллекта.

Plan A - Договориться (их фаворит). США и Китай в 2029 соглашаются не гнать гонку. Всё AI-исследование открыто, десятки компаний идут вровень и медленно, взаимное сдерживание через контроль над вычислениями. Суперинтеллект откладывают аж до 2040. Сами называют это «наименее плохим планом из тех, что знаем».
Plan B - Воевать с Китаем. Вместо сделки жёсткое противостояние.
Plan C - Спустить фору. США профукивают своё технологическое преимущество.
Plan D - Гнать до сверхинтеллекта. Текущая траектория без тормозов, кто первый - тот и хозяин.
Plan S - Вырубить всё. Полная остановка разработки.

Главный посыл: индустрия убедила себя, что контроль над сверхИИ «докрутит на ходу». Авторы считают, что это дорога либо к вымиранию, либо к концентрации власти у горстки людей. И зовут договориться, пока не поздно.

Важно: это не прогноз, а рекомендация - «как надо по-нашему», а не «как будет». Читать как манифест, не как сводку фактов.

А вы в какой сценарий верите - договорятся или погонят до конца?
👍179🐳3🔥2🤔1
КАК ОТДАТЬ ЛИЧНЫЙ TELEGRAM АГЕНТУ И НЕ СЛИТЬ АККАУНТ

ИИ-агентами мы пользуемся давно - работа, код, рутина. Но личный Telegram, где лежит вся память (кто, что и кому обещал), отдать агенту боязно. И не зря.

Единственный способ был - юзербот. А он логинится в аккаунт КАК ВЫ, через session string. Это не ключ от бота, а ключ от всего аккаунта. Отсюда два страха, оба реальные:

• Бан. Telegram банит за автоматизацию через MTProto, а за что именно - не скажет никто. И тогда улетает личный аккаунт целиком: годы переписки, контакты, привязанные сервисы. Апелляция - как повезёт, чаще мимо.
• Угон. Утёк session string - и чужой уже читает вашу личку и пишет от вашего имени. Двухфакторка не спасёт: она стоит на входе, а сессия уже авторизована.

Так вот, выход есть, и я на нём живу. Официальный Business API - Telegram сам, легально, по вашему разрешению отдаёт боту ваши личные чаты. Никакого session string. Банить не за что: подключение санкционировал сам Telegram. И, что важно, работает даже на бесплатном аккаунте - Premium не нужен, проверял сам.

Под это я собрал открытый telegram-business-bridge и пользуюсь им каждый день. Демон 24/7 пишет всю мою личку в локальную базу с поиском, а агент получает к ней доступ:

• «О чём мы с Х договаривались в марте» - один запрос вместо получаса скролла.
• Ничего не теряю: даже удалённое собеседником сообщение остаётся у меня. Голосовые сразу расшифровываются в текст.
• Занят - агент сам поднимает историю и готовит черновик. Но отправляю всё равно я, одним тапом.

Так закрыта личка. Остаются группы и каналы - их Business API не отдаёт. Для них у меня второй агент: тот самый юзербот из ролика, но на отдельном аккаунте, который не жалко. Сидит в нужных группах, а по команде читает любой чат и приносит мне сводку. Забанят или угонят - потеряю пустышку, а не годы своей переписки.

А всё вместе - и личка, и группы - по ночам дистиллируется в базу знаний по методу Карпаты (как это делаю, показывал в этом ролике), и мой скилл lorebase отдаёт её агенту частями, не забивая контекст.

Итого агент видит весь мой Telegram, и безопасно. Личка - через мост, группы и каналы - через расходного наблюдателя. Схему собрал под себя, живу на ней сам, и на сегодня она закрывает все мои хотелки в мессенджере.

А вы свой личный Telegram агенту уже доверили? Или всё ещё руками? Расскажите, кто как решал.
54🔥55👍1814🙏2🤔1
БЕЗ ШУМА И ПОМПЫ GOOGLE ВЫКАТИЛ ТРИ МОДЕЛИ

Все ждали чего-то громкого. А они по-тихому обновили всю Flash-линейку.
• Gemini 3.6 Flash Лошадка под код и агентов. На выходе жрёт на 17% меньше токенов.
• Gemini 3.5 Flash-Lite Самая быстрая и дешёвая. 350 токенов в секунду.
• Gemini 3.5 Flash Cyber Ищет и чинит дыры в коде. Пока по пилоту для своих.

Честно? Куда это применять - без понятия. Я гоняю Gemini в чате. Задаю непонятные мне вопросы, получаю ответы. Плюс нанобанана на картинки. Всё, на этом применение и кончается.
Да, и ещё, забыл. По видео YouTube тоже вопросы задаю - нативно поддерживают.

А ведь даже китайцы веселее. Тот же свежий Kimi K3 смотрится интереснее, чем то, куда катится Google.

Так куда их пристраивать в реальной жизни? И ждёте ли вы вообще чего-то от новых Flash - или это уже гонка ради гонки?
🔥247👍3
ГОЛОСОМ. НА РУССКОМ. И ОНО РЕАЛЬНО ДЕЛАЕТ ДЕЛА.

Включил на телефоне голосовой режим Claude - русский уже есть. Пока в бете, голос один, зовут «Звонкий». Поговорил. И это вам не «болталка», как у остальных.
23 июля Anthropic докрутил главное: голос теперь ходит в подключённые приложения - Gmail, Календарь, Google Docs, Slack, Notion, Canva. Голосом просишь перенести встречу или набросать письмо - и он идёт и делает. Крутится уже не на быстром Haiku, а на старших Opus и Sonnet. Модель выбираете сами, отдельной кнопкой.

И вот тут фишка. Под капотом теперь умная агентская модель - та, что умеет строить цепочки действий, как Claude Code. Только голосом. Говоришь задачу, а он сам раскладывает её на шаги: сходить в почту, глянуть календарь, набросать ответ - и выполняет по порядку.
Бесплатный план - Haiku и один коннектор. Платный - все модели и все ваши подключения.

Соль - в сравнении.
ChatGPT в голосе недавно похорошел - звучит живее. Но инструменты дёргать так и не умеет. Поговорить да, сделать работу нет.
Gemini - король внутри Google. В Gmail и Docs он как дома, лишние шаги убирает, окно контекста больше. Но силён он ровно в своём огороде.
Claude - другой зверь. Ему всё равно, через что работать: Gmail, Notion, Slack. Сшивает разные системы в одном разговоре и думает между шагами. Короче так: Gemini - король внутри Google, Claude - переводчик между всеми вашими системами сразу.

И вот что зацепило меня как гика. Теоретически цепляются вообще все коннекторы - даже кастомные, которые делаешь сам. А в свой коннектор можно прикрутить что хочешь: внешний слой памяти, свои проекты, да хоть чайник. То есть рулить голосом с телефона собственной базой знаний - реально.
И без самодеятельности: каждое действие только с вашего подтверждения, а в ответах ссылки на источники - видно, какие письма и документы он трогал.

Пробовали голосом на русском? За кем будущее - за домашним огородом Google или за универсальным мостом?
🔥29👍1611💩2👏1
CLAUDE.md
9.9 KB
ВЫШЕЛ OPUS 5.
А Я ВМЕСТО ТЕСТОВ ПОЛЕЗ ПЕРЕПИСЫВАТЬ СВОЙ
CLAUDE.md.

У меня правило: вышла новая модель - сначала пересмотри свой харнес. И начинать с главного файла, глобального CLAUDE.md. Он грузится в каждой сессии, любая ошибка в нём умножается на всю работу.

Anthropic тут сам дал сигнал. Thariq из команды Claude Code показал (пост): для Opus 5 они выпилили 80%+ системного промпта - и эвалы не просели.
Старые модели надо было связывать правилами. Новые от этих правил тупеют. Главная боль - когда инструкции в одном запросе спорят между собой, и модель тратит силы на разруливание вместо задачи.

Что я сделал у себя:
• Прогнал /doctor прямо в Claude Code - команда сама проходит по скиллам, MCP и CLAUDE.md и предлагает, что выкинуть.
• Попросил модель сверить мои правила с её системным промптом - и она сама показала, где моё правило с ней спорит, а где просто дублирует. Конфликты я руками не искал, просто спросил.

Прикладываю файл CLAUDE.md. Он, само собой, не полный - я вычистил персональные данные и инструменты, которыми пользуюсь, но постарался оставить полезное для вас. Тупо копировать не стоит, возьмите то, что пригодится.

Если коротко: с новой моделью пересмотрите свой CLAUDE.md и заодно скиллы, которыми пользуетесь постоянно. Файл после чистки не обязательно станет короче. Задача другая - убрать противоречия.

А вы свой CLAUDE.md под новую модель пересматриваете - или он с прошлого года копится?
20🔥4113👍92
OPUS 5 Я ТАК И НЕ РАСКУСИЛ - НО КАК ПОМОЩНИК ОН ОГОНЬ

Наконец плотно потестил Opus 5. И честно - до конца я его так и не понял. Промтить его надо иначе, чем прошлые модели.
Он конкретнее и молчаливее. Похож на GPT: даёшь задачу - идёт до конца, не бросает на полпути. Скажет пару слов и, как Fable, молча уходит работать.

Что зацепило - доводит дело до конца. Раньше модель могла встать на середине: мол, дальше сам. Этот докручивает всё до рабочего результата, включая мелочи, которые раньше приходилось выпрашивать отдельно.
И проверяет себя сам. Настолько, что Anthropic официально советуют убрать из инструкций «проверь свою работу» - иначе он гоняет проверку по второму кругу, а платишь за это ты. Сам я держу его на high .

Так как моими основными моделями стали Fable5 и Opus 5, под них я решил переделать свой конвейер .

В прошлом посте я переписывал свой CLAUDE.md под свежие рекомендации Anthropic - те самые, где они из своего Claude Code выкинули 80% инструкций. Тогда дошёл до главного файла, теперь до самого плагина - senior-fable.

Идея та же, что и была: дорогой Fable не палит токены зря - он думает, разбивает задачу и раздаёт работу, а руками пашут модели попроще.

Новое - исполнителем я поставил Opus 5. Fable остаётся техлидом: архитектура, спорные решения, приёмка. Opus 5 пишет код. Заодно выбросил из плагина лишние правила, оставил только роли - кто думает, кто пишет, кто проверяет. Каждый делает то, что умеет лучше всех.

А вы Opus 5 уже щупали? Раскусили - или он и вам показался тёмной лошадкой?
🔥25👍1712
КАК СТАВИТЬ ЗАДАЧУ АГЕНТУ, ЕСЛИ ТЫ НЕ ПРОГРАММИСТ

Я не пишу код. Но задачи агенту ставлю каждый день - и они выполняются. Секрет не в программировании. Секрет в том, КАК сформулировать.

Есть подход из разработки - BDD (разработка на основе поведения). Звучит страшно, а суть детская: описываешь не КАК делать, а ЧТО должно получиться и КАК ты поймёшь, что готово.

Две вещи, которые ты обязан дать:
Цель - что хочу на выходе.
Критерий готовности - как я пойму, что это оно.
Всё, что между - забота агента. Не твоя. И описываешь ты это как поведение: «когда вот так - тогда вот это». Не пожелание в пустоту, а конкретный сценарий.

Бытовой пример. Ремонт в ванной. Ты же не диктуешь плиточнику, под каким углом держать шпатель. Ты говоришь: «плитка вот такая, ровно, без зазоров, чтоб вода не стояла». Это цель и критерий. КАК он это сделает - его работа.

С агентом так же. Скажешь «сделай картинку для поста» - получишь классический «ожидание vs реальность»: в голове было одно, на выходе другое. А скажешь «картинка для Telegram, 16:9, тёмный фон, крупный заголовок по центру» - выполнит с первого раза. Вся разница - в критерии.

А теперь как из «хорошо» сделать «отлично».
Сначала работаешь как с чёрным ящиком: дал цель и критерий, получил результат. Работает - не лезь внутрь. Хочешь поднять планку - погружайся: разбей на мелкие шаги, у каждого свой критерий. Попроси показать план ДО работы и что он реально менял - не пересказ «как я сделал», а сами шаги. Так понимаешь процесс и шлифуешь там, где важно.
От простого к сложному. Сначала - результат чёрным ящиком. Потом медленно внутрь, ровно настолько, насколько нужно.

Программирования тут нет. Есть умение точно сказать, чего ты хочешь.

А вы как ставите задачи агенту - сразу с критерием готовности или объясняете на ходу?
👍26104💯1