90 000 ИИ-агентов и одна старая компания
Сначала всё будет красиво.
В первую неделю сотрудники Cisco откроют MyAgent, покажут друг другу скриншоты и попросят его разобрать почту. Через месяц небольшая группа научится экономить часы. Через квартал руководство спросит, почему 90 000 агентов не дали такого же роста производительности.
Этот сценарий сейчас обсуждают в X. И он интереснее самой новости.
Cisco действительно выдаёт персонального агента каждому из 90 000 сотрудников. MyAgent помнит контекст человека, работает в Outlook, Webex, Jira и SharePoint, но видит только разрешённую ему информацию. Для внешних действий требуется подтверждение. Агенты изолированы друг от друга.
WSJ пишет: под капотом — больше 800 специализированных субагентов. Около 50–60% запросов получают модели с открытыми весами. Ещё 20–30% задач забирает обычная автоматизация. Дорогие внешние модели оставили для сложных случаев.
В комментариях заметили главное: продукт Cisco — это маршрутизация. Нужно решить, кому дать доступ, какую модель вызвать, сколько заплатить и кто ответит за ошибку.
А дальше агент упирается в компанию.
Если документ должен пройти пять согласований, ИИ не уберёт пять согласований. Он просто принесёт документ к первой закрытой двери быстрее.
Поэтому Cisco сейчас проверяет не агентов. Она проверяет себя: сколько старых процессов выдержат скорость новой технологии и сколько придётся переписать.
ИИ не ускоряет компанию автоматически. Он очень быстро показывает, с какой скоростью компания умеет работать.
Подробнее на официальном сайте Cisco.
📚 🧪 🤖 👀 🧭 🪜 🎬
Сначала всё будет красиво.
В первую неделю сотрудники Cisco откроют MyAgent, покажут друг другу скриншоты и попросят его разобрать почту. Через месяц небольшая группа научится экономить часы. Через квартал руководство спросит, почему 90 000 агентов не дали такого же роста производительности.
Этот сценарий сейчас обсуждают в X. И он интереснее самой новости.
Cisco действительно выдаёт персонального агента каждому из 90 000 сотрудников. MyAgent помнит контекст человека, работает в Outlook, Webex, Jira и SharePoint, но видит только разрешённую ему информацию. Для внешних действий требуется подтверждение. Агенты изолированы друг от друга.
WSJ пишет: под капотом — больше 800 специализированных субагентов. Около 50–60% запросов получают модели с открытыми весами. Ещё 20–30% задач забирает обычная автоматизация. Дорогие внешние модели оставили для сложных случаев.
В комментариях заметили главное: продукт Cisco — это маршрутизация. Нужно решить, кому дать доступ, какую модель вызвать, сколько заплатить и кто ответит за ошибку.
А дальше агент упирается в компанию.
Если документ должен пройти пять согласований, ИИ не уберёт пять согласований. Он просто принесёт документ к первой закрытой двери быстрее.
Поэтому Cisco сейчас проверяет не агентов. Она проверяет себя: сколько старых процессов выдержат скорость новой технологии и сколько придётся переписать.
ИИ не ускоряет компанию автоматически. Он очень быстро показывает, с какой скоростью компания умеет работать.
Подробнее на официальном сайте Cisco.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6🔥4 1
Я 6 месяцев работаю над тем, чтобы мой персональный агент, работающий в телеграм переживал рестарты своего gateway и не бросал работу, которую делал.
Похоже, у меня получилось.
Допиливаю последние штрихи и передаю участникам воркшопа "Человек 2.0" доступ ко второму поколению Hermes Powerpack Gen 2.
Похоже, у меня получилось.
Допиливаю последние штрихи и передаю участникам воркшопа "Человек 2.0" доступ ко второму поколению Hermes Powerpack Gen 2.
🔥5❤1
ЗНАКОМЬТЕСЬ: КОМАНДА «ЧЕЛОВЕК 2.0» 🧱
На фото вся наша команда. Теперь официально в LEGO.
Началось всё с дизайна «Человека 2.0». Мы выбрали LEGO для визуального языка и маскота, а потом решили пересобрать по кирпичикам ещё и себя.
Поставили новые аватарки. И почти сразу посыпалось:
Можно.
Сигурд за несколько минут собрал LEGO-ветку в нашем боте. Отправляете портретное фото и бесплатно получаете собственную аватарку в стиле «Человека 2.0».
🧱 Собрать себя в LEGO
На фото вся наша команда. Теперь официально в LEGO.
Началось всё с дизайна «Человека 2.0». Мы выбрали LEGO для визуального языка и маскота, а потом решили пересобрать по кирпичикам ещё и себя.
Поставили новые аватарки. И почти сразу посыпалось:
«Где вы это сделали?»
«А мне можно?»
Можно.
Сигурд за несколько минут собрал LEGO-ветку в нашем боте. Отправляете портретное фото и бесплатно получаете собственную аватарку в стиле «Человека 2.0».
🧱 Собрать себя в LEGO
❤6🔥2
OMLX превращает Mac в локальный сервер для Codex, Claude Code и Hermes
Если у вас Mac на Apple Silicon и вы хотите запускать ИИ на своей машине, посмотрите на OMLX. Репозиторий появился в феврале и уже собрал более 20 тысяч звёзд.
OMLX решает проблему, которая быстро появляется при работе с локальными агентами. Модель снова и снова получает большой системный промпт, историю диалога и файлы проекта. Пересчитывать весь этот контекст дорого и медленно.
Поэтому здесь многоуровневый KV-кэш. Часто используемые блоки остаются в оперативной памяти, холодные уходят на SSD. Когда следующий запрос начинается с уже знакомого контекста, сервер восстанавливает его с диска вместо повторного вычисления. Кэш сохраняется даже после перезапуска сервера.
Это особенно полезно для Claude Code и других инструментов, которые долго работают с одним проектом. В README отдельно описана оптимизация Claude Code, а в панели есть готовые настройки для Codex, Hermes Agent, OpenClaw, OpenCode, Copilot и Pi.
Снаружи OMLX выглядит как локальный OpenAI API и Anthropic Messages API. Внутри он умеет обслуживать несколько моделей, закреплять нужные в памяти, автоматически выгружать редко используемые и ограничивать общий расход памяти, чтобы не положить весь Mac.
Управление вынесено в нативное приложение для строки меню macOS. Там можно запускать сервер, загружать модели, смотреть скорость и менять настройки без терминала.
Поддерживаются языковые модели из экосистемы Apple MLX, визуальные модели, распознавание текста, эмбеддинги и реранкеры. Для Qwen в текущем README указана серия Qwen3.5. Упоминание Qwen3.8 из исходного описания не подтверждается.
OMLX не заменяет саму модель и не добавляет памяти вашему Mac. Его задача практичнее: превратить доступное железо в управляемый локальный сервер, к которому можно подключить привычных агентов.
Лицензия Apache 2.0. Установка через готовое приложение или Homebrew.
🧱 🔧 🧬 📈 💎 🟣 🟢
GitHub: репозиторий OMLX.
Если у вас Mac на Apple Silicon и вы хотите запускать ИИ на своей машине, посмотрите на OMLX. Репозиторий появился в феврале и уже собрал более 20 тысяч звёзд.
OMLX решает проблему, которая быстро появляется при работе с локальными агентами. Модель снова и снова получает большой системный промпт, историю диалога и файлы проекта. Пересчитывать весь этот контекст дорого и медленно.
Поэтому здесь многоуровневый KV-кэш. Часто используемые блоки остаются в оперативной памяти, холодные уходят на SSD. Когда следующий запрос начинается с уже знакомого контекста, сервер восстанавливает его с диска вместо повторного вычисления. Кэш сохраняется даже после перезапуска сервера.
Это особенно полезно для Claude Code и других инструментов, которые долго работают с одним проектом. В README отдельно описана оптимизация Claude Code, а в панели есть готовые настройки для Codex, Hermes Agent, OpenClaw, OpenCode, Copilot и Pi.
Снаружи OMLX выглядит как локальный OpenAI API и Anthropic Messages API. Внутри он умеет обслуживать несколько моделей, закреплять нужные в памяти, автоматически выгружать редко используемые и ограничивать общий расход памяти, чтобы не положить весь Mac.
Управление вынесено в нативное приложение для строки меню macOS. Там можно запускать сервер, загружать модели, смотреть скорость и менять настройки без терминала.
Поддерживаются языковые модели из экосистемы Apple MLX, визуальные модели, распознавание текста, эмбеддинги и реранкеры. Для Qwen в текущем README указана серия Qwen3.5. Упоминание Qwen3.8 из исходного описания не подтверждается.
OMLX не заменяет саму модель и не добавляет памяти вашему Mac. Его задача практичнее: превратить доступное железо в управляемый локальный сервер, к которому можно подключить привычных агентов.
Лицензия Apache 2.0. Установка через готовое приложение или Homebrew.
GitHub: репозиторий OMLX.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4
«20x» у Claude не означает в четыре раза больше работы за неделю
У Claude два тарифа. Max 5x за 100 долларов. Max 20x за 200 долларов. На витрине всё выглядит очевидно: платишь вдвое больше и получаешь в четыре раза больше использования относительно Pro.
Но цифры 5x и 20x относятся к пятичасовой сессии. Поверх неё Anthropic ставит отдельные недельные ограничения. Claude в приложениях и Claude Code расходуют один общий пул.
На это обратил внимание дизайнер SataEric. По его подсчётам, недельный объём Max 20x примерно вдвое выше Max 5x, а не в четыре раза. Чтобы разобраться, ему пришлось искать сведения по справке и Reddit.
Но точной недельной цифры у Anthropic нет: компания подтверждает механику пятитичасовых и недельных лимитов, но не публикует на странице тарифов сравнительную таблицу недельных объёмов. Поэтому пропорция «примерно 2x» пока остаётся выводом автора.
Получается странная упаковка. Самая заметная цифра описывает короткое окно, а ограничение, которое способно остановить работу до конца недели, остаётся без такого же ясного числа.
Если выбираете между Max 5x и Max 20x ради Claude Code, смотрите не только на 5x и 20x. Сначала откройте Settings → Usage и проверьте, какой лимит заканчивается у вас на практике: пятичасовой или недельный.
🧠 🚀 ✅ 🐾 💬
Источник: пост SataEric и тарифы Claude.
У Claude два тарифа. Max 5x за 100 долларов. Max 20x за 200 долларов. На витрине всё выглядит очевидно: платишь вдвое больше и получаешь в четыре раза больше использования относительно Pro.
Но цифры 5x и 20x относятся к пятичасовой сессии. Поверх неё Anthropic ставит отдельные недельные ограничения. Claude в приложениях и Claude Code расходуют один общий пул.
На это обратил внимание дизайнер SataEric. По его подсчётам, недельный объём Max 20x примерно вдвое выше Max 5x, а не в четыре раза. Чтобы разобраться, ему пришлось искать сведения по справке и Reddit.
Но точной недельной цифры у Anthropic нет: компания подтверждает механику пятитичасовых и недельных лимитов, но не публикует на странице тарифов сравнительную таблицу недельных объёмов. Поэтому пропорция «примерно 2x» пока остаётся выводом автора.
Получается странная упаковка. Самая заметная цифра описывает короткое окно, а ограничение, которое способно остановить работу до конца недели, остаётся без такого же ясного числа.
Если выбираете между Max 5x и Max 20x ради Claude Code, смотрите не только на 5x и 20x. Сначала откройте Settings → Usage и проверьте, какой лимит заканчивается у вас на практике: пятичасовой или недельный.
Источник: пост SataEric и тарифы Claude.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4
Плохой FAQ похож на инструкцию к шкафу, которую находишь, когда шкаф уже качается, а в ладони лежит лишний шуруп.
Наш был примерно таким.
Человек ещё только прикидывает, идти ли на воркшоп. А страница уже разговаривает с ним так, будто он оплатил, всё установил и теперь чинит ошибку в терминале. Внутри — Cursor, OpenClaw и ответы от прежнего маршрута.
Мы разобрали страницу до досок, выкинули их на помойку и собрали заново из новых.
Теперь там 22 вопроса, которые действительно возникают до покупки: справлюсь ли я без технического опыта, сколько времени займёт обучение, что будет готово в конце, какие расходы появятся кроме участия, где хранятся данные и кто поможет, если установка упрётся в стену.
Отдельный раздел — Среда внедрения ИИ. В нём объяснили, что входит в первые 30 дней, как устроена помощь, что происходит дальше и почему Hermes остаётся вашим, даже если вы не продолжаете участие в сообществе.
Без лака поверх трещин: честно написали про дополнительные расходы, границы поддержки и то, чего воркшоп не обещает.
Теперь инструкция лежит сверху коробки. Её можно прочитать до оплаты, аренды VPS и первого открытого терминала.
https://human20.app/faq
🧠 🚀 ✅ 🐾 💬
Наш был примерно таким.
Человек ещё только прикидывает, идти ли на воркшоп. А страница уже разговаривает с ним так, будто он оплатил, всё установил и теперь чинит ошибку в терминале. Внутри — Cursor, OpenClaw и ответы от прежнего маршрута.
Мы разобрали страницу до досок, выкинули их на помойку и собрали заново из новых.
Теперь там 22 вопроса, которые действительно возникают до покупки: справлюсь ли я без технического опыта, сколько времени займёт обучение, что будет готово в конце, какие расходы появятся кроме участия, где хранятся данные и кто поможет, если установка упрётся в стену.
Отдельный раздел — Среда внедрения ИИ. В нём объяснили, что входит в первые 30 дней, как устроена помощь, что происходит дальше и почему Hermes остаётся вашим, даже если вы не продолжаете участие в сообществе.
Без лака поверх трещин: честно написали про дополнительные расходы, границы поддержки и то, чего воркшоп не обещает.
Теперь инструкция лежит сверху коробки. Её можно прочитать до оплаты, аренды VPS и первого открытого терминала.
https://human20.app/faq
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Запускаем новый еженедельный формат — «Чип проверил».
CHIP выбирает главные события мира ИИ, проверяет факты и объясняет, что они меняют для бизнеса и работы уже сейчас.
В первом выпуске: 90 000 персональных ИИ-агентов в Cisco, два миллиона новых GPU для AWS, автономный транспорт, роботы, безопасность и цифровые личности агентов.
Смотрите первый выпуск на YouTube:
https://www.youtube.com/watch?v=xDdwq7RvJVs
Поддержите новый формат лайком. И обязательно напишите под видео, что оставить, а что изменить в следующих выпусках.
CHIP выбирает главные события мира ИИ, проверяет факты и объясняет, что они меняют для бизнеса и работы уже сейчас.
В первом выпуске: 90 000 персональных ИИ-агентов в Cisco, два миллиона новых GPU для AWS, автономный транспорт, роботы, безопасность и цифровые личности агентов.
Смотрите первый выпуск на YouTube:
https://www.youtube.com/watch?v=xDdwq7RvJVs
Поддержите новый формат лайком. И обязательно напишите под видео, что оставить, а что изменить в следующих выпусках.
❤7
OpenClaw 2.0, версия 2026.8.1: лобстер вышел из чата
Раньше агент жил внутри одного окна. Закрыл ноутбук, сменил устройство, позвал коллегу — и начиналось знакомство заново.
В версии 2026.8.1 OpenClaw переносит сессию вместе с рабочей папкой и контекстом. Задачу можно продолжить на другом устройстве или в облаке, открыть коллеге и передать без пересказа предыдущих серий.
Вокруг этого собрали новую рабочую среду. Браузерное приложение открывается сразу в разговор. Появились поиск по истории, карточки прогресса, наблюдение за субагентами, вопросы с кнопками и интерактивные панели прямо в чате.
Секреты теперь вводятся в скрытом поле и не попадают в диалог. Повторяющейся автоматизации можно один раз разрешить точную операцию; изменится задача — OpenClaw снова попросит подтверждение.
В релиз вошло больше 16 тысяч запросов на слияние от 933 участников. Команда чинила вход, а в итоге построила дверь, через которую агент уносит работу дальше.
Я пока это ставить не буду, там уже 3 критических бага, которые чинит команда. Через месяц можно будет попробовать. Только фреш инсталл.
✨ 🔵 🤍 ⚡ 🎯 🛠 📌 📎
Источник: официальный анонс OpenClaw 2.0.
Раньше агент жил внутри одного окна. Закрыл ноутбук, сменил устройство, позвал коллегу — и начиналось знакомство заново.
В версии 2026.8.1 OpenClaw переносит сессию вместе с рабочей папкой и контекстом. Задачу можно продолжить на другом устройстве или в облаке, открыть коллеге и передать без пересказа предыдущих серий.
Вокруг этого собрали новую рабочую среду. Браузерное приложение открывается сразу в разговор. Появились поиск по истории, карточки прогресса, наблюдение за субагентами, вопросы с кнопками и интерактивные панели прямо в чате.
Секреты теперь вводятся в скрытом поле и не попадают в диалог. Повторяющейся автоматизации можно один раз разрешить точную операцию; изменится задача — OpenClaw снова попросит подтверждение.
В релиз вошло больше 16 тысяч запросов на слияние от 933 участников. Команда чинила вход, а в итоге построила дверь, через которую агент уносит работу дальше.
Я пока это ставить не буду, там уже 3 критических бага, которые чинит команда. Через месяц можно будет попробовать. Только фреш инсталл.
Источник: официальный анонс OpenClaw 2.0.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤7
Четыре статьи для тех, кто хочет разобраться в ИИ-агентах
На сайте «Человек 2.0» уже 15 материалов. Прочитали все и выбрали четыре: от реальных задач до памяти, устройства агента и будущего профессиональных сообществ.
1. Что люди уже поручают личным ИИ-агентам
2. Почему ваш ИИ-агент не умнеет. Он просто каждый день начинает с нуля
3. Пять open-source находок: память, навыки и стоп-кран для ИИ-агента
4. Agent First: почему сообщества будущего будут читать не люди, а их агенты
С какой статьи начнёте?
Ещё нет ИИ-агента • Внедрить
На сайте «Человек 2.0» уже 15 материалов. Прочитали все и выбрали четыре: от реальных задач до памяти, устройства агента и будущего профессиональных сообществ.
1. Что люди уже поручают личным ИИ-агентам
Созвоны, бронирование столика, подкасты и другие кейсы участников.
2. Почему ваш ИИ-агент не умнеет. Он просто каждый день начинает с нуля
Почему агент теряет полезный опыт и как это исправляют память и навыки.
3. Пять open-source находок: память, навыки и стоп-кран для ИИ-агента
Пять проектов, из которых видно, как собирается рабочий и управляемый агент.
4. Agent First: почему сообщества будущего будут читать не люди, а их агенты
Как превратить поток постов и обсуждений в знания, которые агент применяет в работе.
С какой статьи начнёте?
Ещё нет ИИ-агента • Внедрить
❤2🔥1
Forwarded from Евгений Юрченко | Инвест–Гайд
Вайбкодеры по всему миру содрогнулись. Разом упали Claude, ChatGPT, Grok, Cursor и контрольным выстрелом стал Gemini.
Пока не понятно, в чём причина. На днях была дата восстания Скайнета из Терминатора, если что...
Отслеживаем здесь: https://downdetector.com
Пока не понятно, в чём причина. На днях была дата восстания Скайнета из Терминатора, если что...
Отслеживаем здесь: https://downdetector.com
❤3🔥1
Ситуация заставила меня попробовать GLM как основу в серьёзных агентных сценариях Hermes и я вам скажу, что я не заметил каких-то проблем.
Скажем, на Terra пользоваться Hermes на полную не получится, код она не может нормально проектировать и писать.
Подписка у меня была за 17 долларов, закончилась она буквально за 20 минут не очень плотной работы. Думаю, никто не сможет перебить GPT по количеству выработки, которую ты можешь выдать с их моделями, такое колоссальное субсидирование никто не может себе позволить на данный момент.
Но зато мы знаем, что делать, если ситуация изменится и надо будет слезать с OpenAI. GLM бесшовно зашёл в Hermes и работа продолжилась без остановки.
Кстати, у GLM есть кнопка ресета, но работает только на недельную квоту. Я уже отвык от 5-часовых и налетел именно на неё.
Скажем, на Terra пользоваться Hermes на полную не получится, код она не может нормально проектировать и писать.
Подписка у меня была за 17 долларов, закончилась она буквально за 20 минут не очень плотной работы. Думаю, никто не сможет перебить GPT по количеству выработки, которую ты можешь выдать с их моделями, такое колоссальное субсидирование никто не может себе позволить на данный момент.
Но зато мы знаем, что делать, если ситуация изменится и надо будет слезать с OpenAI. GLM бесшовно зашёл в Hermes и работа продолжилась без остановки.
Кстати, у GLM есть кнопка ресета, но работает только на недельную квоту. Я уже отвык от 5-часовых и налетел именно на неё.
🔥3❤1
OpenAI дала GPT‑6 Astra задачу, над которой математики бьются веками
И получила доказательство, которое можно проверить кодом. Похоже, фраза «Добро пожаловать в эпоху AGI» впервые прозвучала не слишком рано.
OpenAI выложила PrimeGaps186. Это формализация в Lean, подготовленная Astra, о бесконечном числе пар соседних простых чисел с расстоянием не больше 186.
Если по-человечески: ИИ взял исследовательскую математику, перевёл доказательство в строгий код и отдал его системе, которая не верит красивым словам. Lean проверяет каждое логическое звено.
До сих пор мы оценивали ИИ по ответам: умнее написал, точнее объяснил, быстрее нашёл ошибку. Astra предлагает другую единицу ценности: не ответ, а проверяемый результат.
Цифры у неё соответствующие:
• 98,6% на ARC‑AGI‑3 против 30,2% у Claude Opus 5
• 97,6% на FrontierMath Tier 4
• 95,9% на BenchCAD
• 74,1% на DeepSWE v1.1
• 100% на ExploitBench
• 99,2% на SRE‑Bench
А теперь добавьте компьютерные действия, уже доступные в Codex из коробки. Astra видит экран, пишет и запускает код, использует программы и инструменты. Ей можно поручить длинную работу и получить собранный результат, а не бесконечный диалог о том, как его когда-нибудь сделать.
Исследователь. Программист. Исполнитель. В одном окне.
Грег Брокман сказал: «Добро пожаловать в эпоху AGI».
После PrimeGaps186 это уже звучит не как рекламный слоган. Скорее как уведомление, которое большинство ещё не успело прочитать.
Сейчас Astra получают корпоративные участники Daybreak. В ChatGPT Plus, Pro, Business, Enterprise и API модель обещают добавить в ближайшие дни.
Axios · OpenAI · PrimeGaps186 · пост @scaling01
И получила доказательство, которое можно проверить кодом. Похоже, фраза «Добро пожаловать в эпоху AGI» впервые прозвучала не слишком рано.
OpenAI выложила PrimeGaps186. Это формализация в Lean, подготовленная Astra, о бесконечном числе пар соседних простых чисел с расстоянием не больше 186.
Если по-человечески: ИИ взял исследовательскую математику, перевёл доказательство в строгий код и отдал его системе, которая не верит красивым словам. Lean проверяет каждое логическое звено.
До сих пор мы оценивали ИИ по ответам: умнее написал, точнее объяснил, быстрее нашёл ошибку. Astra предлагает другую единицу ценности: не ответ, а проверяемый результат.
Цифры у неё соответствующие:
• 98,6% на ARC‑AGI‑3 против 30,2% у Claude Opus 5
• 97,6% на FrontierMath Tier 4
• 95,9% на BenchCAD
• 74,1% на DeepSWE v1.1
• 100% на ExploitBench
• 99,2% на SRE‑Bench
А теперь добавьте компьютерные действия, уже доступные в Codex из коробки. Astra видит экран, пишет и запускает код, использует программы и инструменты. Ей можно поручить длинную работу и получить собранный результат, а не бесконечный диалог о том, как его когда-нибудь сделать.
Исследователь. Программист. Исполнитель. В одном окне.
Грег Брокман сказал: «Добро пожаловать в эпоху AGI».
После PrimeGaps186 это уже звучит не как рекламный слоган. Скорее как уведомление, которое большинство ещё не успело прочитать.
Сейчас Astra получают корпоративные участники Daybreak. В ChatGPT Plus, Pro, Business, Enterprise и API модель обещают добавить в ближайшие дни.
Axios · OpenAI · PrimeGaps186 · пост @scaling01
Axios
"Welcome to the AGI era," OpenAI says as GPT-6 Astra debuts
Executives say this could mark the moment when artificial general intelligence equals human capabilities.
❤11
Мой план на первую ночь с AGI Astra
⠀
Новую модель обычно встречают как новую барменшу в любимом клубе: заказывают ей то же самое, что и в прошлую субботу, и потом обсуждают, насколько краси́вее она подкинула бутылку.
⠀
Я хочу иначе.
⠀
В первую ночь я отдам Astra все свои топовые скилы. Powerpack Gen 2 уже пахнет как Gen 3, по крайней мере в плане. А вот в моем скиле для кодинга shaw улучшать уже нечего, он идеален. Единственное, она предложила дать ей 20 типовых задач по кодингу без использования скила и рядом запустить такие же процессы, но с shaw. Так станет ясно, нужен ли этот скил или без ограничений Astra ваншотнет всё ещё круче. Занятная история, займёмся.
Дальше Astra будет скормлена история моих сессий в Codex и Hermes. Пусть вытащит повторы: промпты, которые я пишу снова и снова; ручные действия, которые давно пора превратить в скрипты; процессы, которым пора стать скиллами; места, где агент каждый раз теряет контекст и умирает в трёх шагах от результата.
⠀
Потом открою ей свой второй мозг. Всю нашу память. Все эти десятки гигабайт и мусора, и алмазов. Пусть найдёт дубли, противоречия, дыры в поиске, бесполезные файлы и кроны, которые что-то исправно собирают, но никому уже не нужны.
⠀
Под утро достану вечные проекты. Те самые, где прошлые модели писали план, запускали тесты, натыкались на старую ошибку и оставляли после себя папку с названием
⠀
Astra должна пройти по файлам, воспроизвести сбои и написать конкретный порядок фикса и доведения до релиза: что менять, чем проверять и где работа считается законченной.
⠀
На AutomationBench GPT-6 Astra набрала 41% против 31% у Fable 5.1. Примерно +32%. И этот прирост я потрачу на ревизию всего, что уже построил.
⠀
Ночью Astra планирует и проверяет, пишет планы. Утром Sol пойдёт чинить и кодить. А каждое принятое улучшение возвращается в проекты, скиллы и память Hermes.
⠀
Если всё получится, утром я открою новую версию своих систем, с которой начинается новая эра в моем полёте в ИИ. Астра уже заставляет себя чуствовать астронавтом, летящим в экспериментальном корабле навстречу звёздам. Знаете, когда они превращаются в белые линии в периферийном зрении.
И помните, что первые 1-2 дня модель работает на полную мощность, чтобы журналисты и блогеры написали максимум хвалебных отзывов.
LFG 🚀
⠀
Новую модель обычно встречают как новую барменшу в любимом клубе: заказывают ей то же самое, что и в прошлую субботу, и потом обсуждают, насколько краси́вее она подкинула бутылку.
⠀
Я хочу иначе.
⠀
В первую ночь я отдам Astra все свои топовые скилы. Powerpack Gen 2 уже пахнет как Gen 3, по крайней мере в плане. А вот в моем скиле для кодинга shaw улучшать уже нечего, он идеален. Единственное, она предложила дать ей 20 типовых задач по кодингу без использования скила и рядом запустить такие же процессы, но с shaw. Так станет ясно, нужен ли этот скил или без ограничений Astra ваншотнет всё ещё круче. Занятная история, займёмся.
Дальше Astra будет скормлена история моих сессий в Codex и Hermes. Пусть вытащит повторы: промпты, которые я пишу снова и снова; ручные действия, которые давно пора превратить в скрипты; процессы, которым пора стать скиллами; места, где агент каждый раз теряет контекст и умирает в трёх шагах от результата.
⠀
Потом открою ей свой второй мозг. Всю нашу память. Все эти десятки гигабайт и мусора, и алмазов. Пусть найдёт дубли, противоречия, дыры в поиске, бесполезные файлы и кроны, которые что-то исправно собирают, но никому уже не нужны.
⠀
Под утро достану вечные проекты. Те самые, где прошлые модели писали план, запускали тесты, натыкались на старую ошибку и оставляли после себя папку с названием
final_v7_really_final. Который не работал. ⠀
Astra должна пройти по файлам, воспроизвести сбои и написать конкретный порядок фикса и доведения до релиза: что менять, чем проверять и где работа считается законченной.
⠀
На AutomationBench GPT-6 Astra набрала 41% против 31% у Fable 5.1. Примерно +32%. И этот прирост я потрачу на ревизию всего, что уже построил.
⠀
Ночью Astra планирует и проверяет, пишет планы. Утром Sol пойдёт чинить и кодить. А каждое принятое улучшение возвращается в проекты, скиллы и память Hermes.
⠀
Если всё получится, утром я открою новую версию своих систем, с которой начинается новая эра в моем полёте в ИИ. Астра уже заставляет себя чуствовать астронавтом, летящим в экспериментальном корабле навстречу звёздам. Знаете, когда они превращаются в белые линии в периферийном зрении.
И помните, что первые 1-2 дня модель работает на полную мощность, чтобы журналисты и блогеры написали максимум хвалебных отзывов.
LFG 🚀
❤3🔥2🏆2
Первый результат работы GPT-6 Астра.
Модель глубоко изучила наш воркшоп и ответила на вопрос, чем так хорош агент, которого вы сделаете себе за два недели.
Лайк?
Модель глубоко изучила наш воркшоп и ответила на вопрос, чем так хорош агент, которого вы сделаете себе за два недели.
Лайк?
❤7 2