Дрессировщик Нейросетей
8.77K subscribers
109 photos
3 videos
1 file
107 links
ИИ-агенты и автоматизация под реальные задачи.
YouTube: youtube.com/@HandlerAI
Консультации и сотрудничество: @Flytoo
Download Telegram
Если юзаете Codex из Европы - обновляйте приложение. Наконец открыли фичи, которые раньше были только в США и Азии.

Chronicle (Хроника) - ИИ смотрит на твой экран и сам понимает контекст. Что за проект, что открыто - больше не надо объяснять с нуля каждый раз. Только macOS + Pro.

Memories (Память) - запоминает стек и конвенции проекта. По умолчанию выключено - надо зайти в настройки и включить.

Computer Use (Управление компьютером) - Codex сам управляет приложениями, не только пишет код.

Chrome Extension (Расширение для Chrome) - агент работает в браузере в фоне.

Всё это давно было у американцев. Теперь и у нас.
11👍40👏72
ХОЧЕШЬ FABLE 5? ЗАЙМИ ПРАВИЛЬНУЮ СТОРОНУ

Fable 5 от Anthropic - одна из сильнейших моделей прямо сейчас. Заблокирована Трампом для всех: ни в США, ни в Европе недоступна. Официальная причина - национальная безопасность.

На G7 в Эвиане за одним столом сидели Трамп, Макрон, Моди и... Альтман, Амодеи и Хасабис. CEO OpenAI, Anthropic и Google DeepMind - не как приглашённые эксперты, а как равноправные участники. Видимо теперь это так работает.

И там же обсуждали схему: доступ к Fable 5 - в обмен на вступление в "коалицию доверенных партнёров" против Китая. Хочешь модель - займи правильную геополитическую позицию.

AI стал тем же чем была нефть и ядерное оружие - главным стратегическим ресурсом. Только теперь ОПЕК - это Вашингтон, а санкционный список формируется не по флагу, а по серверу.

Кто-нибудь мог представить такое три года назад?
😐27👍8🤯53🔥1
ЧТО ОТЛИЧАЕТ ТЕХ, У КОГО АГЕНТ РАБОТАЕТ

Дошли руки почитать свежее исследование Anthropic. Они разобрали кучу реальных сессий людей с агентом и посмотрели, чем те, у кого всё получается, отличаются от тех, у кого нет. Само исследование про Claude Code, но я бы этим не ограничивался - это про любые агентские системы. Принцип везде один.

Дело не в умении программировать. Агента усиливает знание своей области. Бухгалтер, который понимает правила сверки, получает результат на уровне инженера. Решает не код, а то, насколько хорошо вы понимаете свою задачу.

Вот что я для себя вынес:

• Решайте "что делать" сами, отдавайте агенту "как делать". Ваша работа - думать на этапе плана. Дальше отпускайте.
• Формулируйте точно и проговаривайте исключения заранее. Не "посчитай отчёт", а "посчитай, и в пустых строках поставь ноль, а не прочерк". Агент не угадывает - делает что сказано.
• Давайте задачу целиком, а не по ложке. Один продуманный запрос делает в два раза больше, чем десять обрывочных.
• Не сбегайте при первой ошибке. Новички бросают каждую пятую сессию, опытные - одну из двадцати. Агент спотыкается у всех. Вопрос в том, чините вы или закрываете вкладку.

Хорошая новость: пропасти между "норм" и "мастером" нет. Гуру быть не нужно. Достаточно разбираться в своём деле, ставить чёткую задачу и не паниковать, когда что-то пошло не так.

Я об этом часто говорю в видео: мы учим их работать на нас, а не наоборот. Верный путь простой - вы заказчик, который знает свою область, а не исполнитель при машине.

А вы где чаще ломаетесь - в формулировке задачи или в том, чтобы не бросить на полпути?
19👍15🔥7🥱1
МОЯ ОБВЯЗКА ВОКРУГ CLAUDE CODE

Давно собирался показать, на чём и как я реально работаю каждый день. Рассказываю.

Основа всего - Claude Code. Агент прямо в терминале: хуки, скрипты, скиллы, плагины. Работаю по старинке - в терминале, отдельными программами не пользуюсь. Пройдусь по слоям, и упор сделаю на то, чего в коробке нет.

Из плагинов чаще всего гоняю superpowers - набор скиллов, которые учат агента работать дисциплинированно: как отлаживать, как планировать, как себя перепроверять. Стандартные тоже стоят, чаще всего использую document-skills.

Второе мнение беру на стороне. Codex от OpenAI вызываю прямо из Claude Code через официальный плагин codex-plugin-cc - когда нужен другой взгляд или второй заход на запутанное место. Antigravity (это agy, на движке Gemini) подключил отдельным скиллом, самостоятельное решение - хорошо спорит со мной по коду.

MCP-серверов у меня несколько, и основную массу подключаю через mcp-cli - чтобы экономить токены. Картинки, например, генерю через свой gemini-webapi-mcp или прямо из Codex.

Под капотом - мелочёвка, которая экономит часы. Про всё не упомнить, расскажу про основное. Хук, который блокирует npm и yarn и заставляет ставить пакеты только через pnpm с задержкой по релизам - защита от supply-chain атак. Свой веб-поиск через Exa с ротацией ключей. Авто-синхрон сессий между машинами, чтобы продолжать с того же места.

Скиллы пишу под себя. Транскрипция - локально, через whisper.cpp, без облаков. premortem - заранее представляю, что проект уже провалился, и выписываю почему; ловит риски ещё до старта. Плюс ещё много других как глобальных так и проектных (описываю любые повторяющиеся действия).

Знания стараюсь держать через свой скилл - lorebase. На вход сырьё, на выходе структурированные страницы. Баз у меня пока несколько, и смешивать их боюсь - чтобы не перегружать агента. Со временем это копится и работает на меня.

И поверх всего - глобальный AGENTS.md, общие правила сразу для всех агентов и проектов. Его я уже выкладывал отдельно, забирайте.

Напоследок скажу вот что. Мнение у меня такое: чем умнее становится модель, тем меньше всей этой обвязки придётся городить руками. В какой-то момент модель будет делать все сама. А пока - собираю вот так.

А вы на чём работаете? Делитесь своими обвязками в комментариях - что подключили, что написали под себя, без чего уже не можете.
52🔥46👍2720👏1
САМАЯ МОЩНАЯ МОДЕЛЬ, КОТОРУЮ ВЫ НЕ УВИДИТЕ

OpenAI выкатила GPT-5.6. Три модели: флагман Sol («самый мощный за всю историю компании»), плюс Terra и Luna. Раструбили на весь мир, какие они крутые. А пользоваться дали двум десяткам избранных партнёров, каждого утверждали поимённо в Вашингтоне. Остальным - смотрите рекламу и завидуйте.

С Anthropic история ещё забавнее, мы её все помним. В начале июня правительство США приказало вырубить доступ к Mythos и Fable - под ноль, включая иностранных сотрудников самой Anthropic. То есть твою же модель тебе же и запретили. Fable, к слову, заблокирован до сих пор.

А на днях - разворот. Mythos 5 разрешили снова: больше сотни американских корпораций и госагентств, и даже иностранным сотрудникам этих компаний пользоваться можно. Списком, через письмо министра торговли. Сегодня нельзя, завтра можно - кому именно, решают в кабинете.

Картина одна на двоих: «у нас есть супер-ИИ, мы вам про него расскажем во всех красках, но потрогать дадим только своим». Нацбезопасность, кибератаки, китайский след - набор отговорок прилагается.

И вот что тут по-настоящему смешно. Закрытость душит ровно то, на чём эти ребята поднялись - конкуренцию. А рынок ждать не станет. За год доля американских моделей на OpenRouter рухнула с ~70% до ~30%. Китайцы - DeepSeek, Qwen, Xiaomi, MiniMax, Kimi - уже впереди, почти половина всех токенов. И без всяких «избранных»: веса открыты, качай и запускай у себя.

Прогноз простой. Пока американцы гордо закрываются, китайцы молча забирают рынок. А как только отток клиентов почувствуется деньгами - вся секретность испарится за неделю. Деньги решают всё: прижмёт по кошельку - тогда и зашевелят булками.

Умнейшие модели планеты вроде есть. А вы их не видите.

Как думаете - китайцы своей открытостью сломают эту игру, или «ИИ для избранных» теперь всерьёз и надолго?
1👍53💯21🐳52
META НАУЧИЛАСЬ ЧИТАТЬ, ЧТО ВЫ ПЕЧАТАЕТЕ. В ГОЛОВЕ.

Помните слепую печать? Десять пальцев, не смотреть на клавиши - целое искусство. Потом пришёл голосовой ввод: удобно, но попробуйте продиктовать письмо в опенспейсе, где сосед слышит каждое ваше «нет, это сотри». Сидишь, разговариваешь с ноутбуком как с собакой.

А Meta показала третий вариант - вводить текст мыслями. Их Brain2Qwerty читает мозговую активность через MEG (без всяких имплантов в череп) и превращает её в текст: у лучшего участника 78% угаданных слов, в среднем 61%. И точность растёт с объёмом данных, без видимого потолка.

Только это не телекинез, как хочется ляпнуть - предметы силой мысли никто не двигает. Скорее телепатия с машиной: компьютер читает, что ты собирался напечатать.

Прежде чем выкидывать клавиатуру - нюанс: MEG это сканер размером с комнату. «Печатать мыслями в кафе» пока откладывается, это лаборатория и надежда вернуть речь людям после инсульта.

Но вектор понятен: пальцы - голос - мысль. А вы бы доверили свои мысли компьютеру напрямую? 🧠
🔥2113👍2🐳2
РУБИЛЬНИК СРАБОТАЛ. А ВСЕ СДЕЛАЛИ ВИД, ЧТО ЭТО ПРО БЕЗОПАСНОСТЬ

Anthropic вернула Fable 5 в строй. 18 дней модель провисела под экспортным контролем США - доступ иностранцам вырубили одной директивой. Теперь включили обратно. Повод для блокировки: джейлбрейк, который Amazon нашёл у Fable 5 - через неё можно искать дыры в чужом софте и показывать, как их вскрывать.

Звучит грозно. Только сама же Anthropic в том же тексте признаёт: тот же трюк один в один работает на Opus 4.8, GPT-5.5 и китайском Kimi K2.7. Дыра общая для всех фронтир-моделей. А выключили - одну. Технически это не бьётся никак. И вот это должно насторожить первым.

Потому что интересна не дыра, а прецедент. Впервые доступ к AI-модели отрубили по политической команде, а не по технической. 18 дней - это уже не страшилка с июньского G7 про «а вдруг союзникам перекроют кислород». Это случившийся факт, с датами.

А теперь самое важное, оно спрятано в конце анонса. Anthropic вместе с Amazon, Microsoft и Google строит единый фреймворк оценки джейлбрейков: по осям «прирост возможностей», «охват», «лёгкость превращения в оружие», «обнаруживаемость». Красиво. По факту это стандартизация рубильника. Готовая инструкция, по которой любую модель можно поставить на паузу «во имя безопасности». Ровно схема «trusted partners», о которой шептались на G7.

Что из этого вынести по-взрослому:

Строить бизнес на чужой фронтир-модели как на единственной опоре - значит поставить всё на кнопку, которая не у тебя в руках. Сегодня работает, завтра «экспортный контроль», и твой продукт встал колом не по твоей вине. Фоллбэк - это не паранойя, это гигиена. Держите под рукой запасную модель (в идеале - с открытыми весами, которые никто не выключит письмом из Вашингтона) и абстрагируйте провайдера так, чтобы менять его за час, а не за квартал.

Рубильник существует, и его только что проверили в бою. Вопрос один: вы строите свой продукт на этой кнопке - или рядом с ней?
👍23💯115😱4🐳1
ВСЕ ГОВОРЯТ ПРО КОД, А GOOGLE ТИХО ЛЕЗЕТ ВАМ В ТЕЛЕФОН

Смотрю ленту за последний месяц - сплошь код. Claude Code, Codex, Cursor, кто у кого отыграл процент на бенчмарке. А Google за этим шумом без фанфар выкатил кучу бытовых штук, которыми пользуешься каждый день. Коротко о том, что нового:

Nano Banana 2 Lite - картинки за пару секунд и вдвое дешевле старшей. Для «накидать двадцать вариантов и выбрать один». У меня генерация давно на Google, так что прям в кассу.
Gemini Omni Flash - монтаж видео обычным текстом: «убери фон, сделай темнее» - и готово. То, за что раньше платили монтажёру.
Auto Browse в Chrome на Android - браузер не просто отвечает на вопросы, а сам делает: проходит оформление заказа, заполняет формы, отменяет подписки. Перед оплатой переспрашивает.
Голос в Gmail и Docs - надиктовал, а оно нашло нужные письма или собрало документ из потока мыслей. Ни буквы руками.
Проверка на AI - навёл Google Lens на картинку и видишь: настоящая или сгенерирована. Мелочь, а в эпоху фейков полезно.
Фоновые агенты в поиске - сами следят за интересной тебе темой и приносят обновления. Персональный дозорный.

Но. Многое пока в тесте и стартует с США и английского - до остального мира доезжает позже. Nano Banana тут добрее остальных: её API открыт глобально, дотянуться проще всего.

Куда это катится. Основное прилетает на Android, тут без сюрпризов. Но Apple ведь сама переезжает на Gemini - их Apple Intelligence теперь на гугловских моделях. Значит, те же фишки скоро доедут и до айфонов. Смешно выходит: спорим, чья модель лучше пишет код, а под капотом у всех потихоньку один и тот же Google.

А вы Gemini вообще открываете - или он висит иконкой, до которой руки не доходят?
👍1614
FABLE 5 - КАК СЕНЬОР, КОТОРЫЙ ТОЧНО ЗНАЕТ, ЧЕГО ТЫ ХОЧЕШЬ

Погонял Fable 5 и честно - на другие модели уже почти не смотрю. Как будто рядом сидит умный чел, который понимает тебя с полуслова.

Понимает задачу. Задаёт вопросы по делу. Сам замечает попутные мелочи и говорит о них. Держит фокус.

Минус тоже есть. Он слишком самостоятельный. Иногда сам себе задаёт вопрос, ответа не ждёт и едет дальше. Поэтому с ним работаешь не так, как с Opus или GPT-5.5 - надо сразу обозначить, где он решает сам, а где ждёт меня.

И ещё: на сложных задачах Fable быстро ест токены. Это и была одна из причин, почему я сделал плагин.

Собрал небольшой плагин для Claude Code - senior-fable. Смысл простой: дорогая модель думает, дешёвые делают.

• Fable - за главного: разбить задачу, архитектура, спорные решения, собрать всё вместе.
• Рутину (тесты, boilerplate, переименования) отдаёт дешёвому Sonnet.
• Долгие раскопки по коду и логам - Opus в режиме чтения: копается у себя, а мне отдаёт только итог.
• Рискованное (авторизация, миграции, спорная архитектура) - на второе мнение к Codex.

Из-за последнего пункта лучше поставить и Codex-плагин. Без него этот шаг просто пропустится.

Ставится в пару команд, включается через /senior-fable на сессии с Fable.

А вы Fable 5 уже пробовали - или пока на Opus/GPT?
22🔥49👍19101👌1
УСПЕЙТЕ ВЫЖАТЬ ИЗ FABLE МАКСИМУМ - ПОКА ОН ПО ПОДПИСКЕ

Сегодня последний день, когда Fable доступен по подписке. Если ещё не гоняли - потратьте его с толком. Не на очередную фичу, а на аудит того, как вы вообще работаете с агентами.

И тут смысл шире, чем сам Fable. Ваш харнес - хуки, скиллы, память, CLAUDE.md - остаётся с вами, а модель под ним меняется. Так что оптимизируете вы не «под конкретную модель», а свой рабочий контур в принципе. Он переживёт и эту модель, и следующую. А сильная модель для такого аудита - как раз повод успеть, пока она в доступе.

Fable отлично тянет эту мета-задачу. Глубины рассуждения хватает, чтобы не просто прочитать конфиги, а выцепить неочевидное: какие вопросы вы задаёте по десять раз (значит, это должно жить в CLAUDE.md или памяти), на что постоянно жмёте «разрешить» (кандидаты в allowlist), какие скиллы мертвы, где дорогая модель жжётся на мелочах.

Важный приём - пусть сначала проинтервьюирует вас, а не сразу копает. Тогда советы лягут на ваши реальные боли, а не на общий чеклист.

Вставьте этот промпт в Fable и оптимизируйте свою работу (он под Claude Code - пути и инструменты подправьте под свой харнес):

Проанализируй мою работу с Claude Code и оптимизируй её. Порядок такой:

1. Сначала проинтервьюируй меня: задай по одному вопросу - какая
главная цель (скорость / качество / автономность / экономия
лимитов), что болит сильнее всего, что точно не трогать.

2. Потом изучи мой харнес: ~/.claude/settings.json (хуки, permissions),
глобальный и проектные CLAUDE.md, скиллы, MCP-серверы, память.

3. Пройдись по истории сессий в ~/.claude/projects - не читай всё
подряд, сначала собери статистику скриптом (это бесплатно): какие
первые промпты повторяются из сессии в сессию, где я чаще всего
отклоняю permission-запросы, какие скиллы никогда не вызываются,
где длинные сессии обрывались без результата.

4. Дай мне: топ неочевидных находок, приоритизированный список
улучшений (быстрые победы отдельно) и предложи автоматизацию -
хуки, allowlist, скиллы, cron. Ничего не внедряй без моего одобрения.


Ключевой пункт - «сначала скрипт, потом чтение». История сессий может весить сотни мегабайт. Наивное «прочитай все сессии» сожжёт лимиты впустую и не факт что доедет. Статистику соберёт python за секунды и ноль токенов - а уже по ней модель решает, что открывать глазами.

Успеете прогнать, пока по подписке?
👍358🔥8👎1🤝1
СЕГОДНЯ ВСЁ ВНЕЗАПНО РАБОТАЕТ

Бывают дни, когда обновления не бесят, а радуют. Сегодня прям такой.

Grok 4.5 - свежий, по SuperGrok дают пощупать 7 дней бесплатно. Работает неожиданно хорошо, похоже, сказывается покупка Cursor. Не демо-огрызок, а полноценный режим.
Live 1, голосовой от OpenAI. Включил и сначала выпал: говоришь почти как с живым человеком. Не роботное «чем могу помочь», а нормальный диалог. Меня, честно, подзаморозило.
• На подходе GPT-5.6 - обещают сегодня.

Осталось, чтобы Anthropic в честь такого дня ещё и лимиты сбросили. Вот тогда будет совсем праздник.

А вы уже щупали Grok 4.5 или голосовой режим? Делитесь, как ощущения.
🔥211
ВЫШЛО ПРОДОЛЖЕНИЕ ГЛАВНОГО БЕСТСЕЛЛЕРА ПРО ИИ

Помните AI 2027? Тот самый сценарий с датами, который все обсуждали. Та же команда (Eli Lifland, экс-OpenAI) выкатила продолжение - AI 2040: Plan A. На этот раз не «как мы все умрём», а «как выжить».

Если кому-то лень читать целиком - вот кратко.

Суть: пять сценариев, как США могут (или не могут) ответить на приход суперинтеллекта.

Plan A - Договориться (их фаворит). США и Китай в 2029 соглашаются не гнать гонку. Всё AI-исследование открыто, десятки компаний идут вровень и медленно, взаимное сдерживание через контроль над вычислениями. Суперинтеллект откладывают аж до 2040. Сами называют это «наименее плохим планом из тех, что знаем».
Plan B - Воевать с Китаем. Вместо сделки жёсткое противостояние.
Plan C - Спустить фору. США профукивают своё технологическое преимущество.
Plan D - Гнать до сверхинтеллекта. Текущая траектория без тормозов, кто первый - тот и хозяин.
Plan S - Вырубить всё. Полная остановка разработки.

Главный посыл: индустрия убедила себя, что контроль над сверхИИ «докрутит на ходу». Авторы считают, что это дорога либо к вымиранию, либо к концентрации власти у горстки людей. И зовут договориться, пока не поздно.

Важно: это не прогноз, а рекомендация - «как надо по-нашему», а не «как будет». Читать как манифест, не как сводку фактов.

А вы в какой сценарий верите - договорятся или погонят до конца?
👍179🐳3🔥2🤔1
КАК ОТДАТЬ ЛИЧНЫЙ TELEGRAM АГЕНТУ И НЕ СЛИТЬ АККАУНТ

ИИ-агентами мы пользуемся давно - работа, код, рутина. Но личный Telegram, где лежит вся память (кто, что и кому обещал), отдать агенту боязно. И не зря.

Единственный способ был - юзербот. А он логинится в аккаунт КАК ВЫ, через session string. Это не ключ от бота, а ключ от всего аккаунта. Отсюда два страха, оба реальные:

• Бан. Telegram банит за автоматизацию через MTProto, а за что именно - не скажет никто. И тогда улетает личный аккаунт целиком: годы переписки, контакты, привязанные сервисы. Апелляция - как повезёт, чаще мимо.
• Угон. Утёк session string - и чужой уже читает вашу личку и пишет от вашего имени. Двухфакторка не спасёт: она стоит на входе, а сессия уже авторизована.

Так вот, выход есть, и я на нём живу. Официальный Business API - Telegram сам, легально, по вашему разрешению отдаёт боту ваши личные чаты. Никакого session string. Банить не за что: подключение санкционировал сам Telegram. И, что важно, работает даже на бесплатном аккаунте - Premium не нужен, проверял сам.

Под это я собрал открытый telegram-business-bridge и пользуюсь им каждый день. Демон 24/7 пишет всю мою личку в локальную базу с поиском, а агент получает к ней доступ:

• «О чём мы с Х договаривались в марте» - один запрос вместо получаса скролла.
• Ничего не теряю: даже удалённое собеседником сообщение остаётся у меня. Голосовые сразу расшифровываются в текст.
• Занят - агент сам поднимает историю и готовит черновик. Но отправляю всё равно я, одним тапом.

Так закрыта личка. Остаются группы и каналы - их Business API не отдаёт. Для них у меня второй агент: тот самый юзербот из ролика, но на отдельном аккаунте, который не жалко. Сидит в нужных группах, а по команде читает любой чат и приносит мне сводку. Забанят или угонят - потеряю пустышку, а не годы своей переписки.

А всё вместе - и личка, и группы - по ночам дистиллируется в базу знаний по методу Карпаты (как это делаю, показывал в этом ролике), и мой скилл lorebase отдаёт её агенту частями, не забивая контекст.

Итого агент видит весь мой Telegram, и безопасно. Личка - через мост, группы и каналы - через расходного наблюдателя. Схему собрал под себя, живу на ней сам, и на сегодня она закрывает все мои хотелки в мессенджере.

А вы свой личный Telegram агенту уже доверили? Или всё ещё руками? Расскажите, кто как решал.
54🔥53👍1614🙏2🤔1
БЕЗ ШУМА И ПОМПЫ GOOGLE ВЫКАТИЛ ТРИ МОДЕЛИ

Все ждали чего-то громкого. А они по-тихому обновили всю Flash-линейку.
• Gemini 3.6 Flash Лошадка под код и агентов. На выходе жрёт на 17% меньше токенов.
• Gemini 3.5 Flash-Lite Самая быстрая и дешёвая. 350 токенов в секунду.
• Gemini 3.5 Flash Cyber Ищет и чинит дыры в коде. Пока по пилоту для своих.

Честно? Куда это применять - без понятия. Я гоняю Gemini в чате. Задаю непонятные мне вопросы, получаю ответы. Плюс нанобанана на картинки. Всё, на этом применение и кончается.
Да, и ещё, забыл. По видео YouTube тоже вопросы задаю - нативно поддерживают.

А ведь даже китайцы веселее. Тот же свежий Kimi K3 смотрится интереснее, чем то, куда катится Google.

Так куда их пристраивать в реальной жизни? И ждёте ли вы вообще чего-то от новых Flash - или это уже гонка ради гонки?
🔥216👍2