⚪️ Большой релиз Codex CLI 0.145
Неожиданно много вполне годных фичей
1️⃣ Фиксы Multi-agents v2, наконец-то! Он теперь stable, но его надо включить фичафлагом
Модель субагента можно явно задавать, да. Как и роль (то есть кастомный субагент) - и в роли можно тоже определять и модель, и ризонинг.
Лимит конкурентности 7 значит 7 субагентов, без учета родительского оркестратора.
Для субагента может быть запрещен прямой ввод команд ему.
TUI поддержка доработана.
2️⃣ Сделана поддержка аудио блоков для отправки и получения от моделей. То есть омни-модели вполне смогут работать в кодексе - отправляя не только текст, картинки, но и аудио.
Кроме этого - доработана поддержка риалтайм работы с агентом в аудио-диаловогом режиме.
3️⃣ Сессии теперь из JSONL зеркалятся в SQLite для обеспечения быстрого оконного режима просмотра, быстрой загрузки/возобновления, а также поиска по сессии.
▶️ Ну и локальные html артефакты поддерживаются в ответах агента. Вижу поддержку специальных html visualization
Весьма насыщенный релиз
@deksden_notes
Неожиданно много вполне годных фичей
1️⃣ Фиксы Multi-agents v2, наконец-то! Он теперь stable, но его надо включить фичафлагом
[features]
multi_agent_v2 = true
[agents]
enabled = true
max_concurrent_threads_per_session = 7
default_subagent_model = "gpt-5.6-terra"
default_subagent_reasoning_effort = "high"
Модель субагента можно явно задавать, да. Как и роль (то есть кастомный субагент) - и в роли можно тоже определять и модель, и ризонинг.
Лимит конкурентности 7 значит 7 субагентов, без учета родительского оркестратора.
Для субагента может быть запрещен прямой ввод команд ему.
TUI поддержка доработана.
2️⃣ Сделана поддержка аудио блоков для отправки и получения от моделей. То есть омни-модели вполне смогут работать в кодексе - отправляя не только текст, картинки, но и аудио.
Кроме этого - доработана поддержка риалтайм работы с агентом в аудио-диаловогом режиме.
3️⃣ Сессии теперь из JSONL зеркалятся в SQLite для обеспечения быстрого оконного режима просмотра, быстрой загрузки/возобновления, а также поиска по сессии.
▶️ Ну и локальные html артефакты поддерживаются в ответах агента. Вижу поддержку специальных html visualization
Весьма насыщенный релиз
@deksden_notes
🔥10👍6
⚪️ Курсы от Тимура Хахалева, 2й сезон
Товарищ нашего канала, Тимур, запускет очередную волну своих курсов - AI Coding для Разрабов, Season 2!
Первый поток прошло уже 70+ человек, вот некоторые из отзывов (https://t.me/the_ai_architect/352).
❌ Кому не подойдёт?
- тем, у кого нет опыта в разработке
✅ Кому подойдёт?
- разработчикам
- которые хотя бы 1-2 раза открывали AI инструменты
▶️ Цель курса — научить вас использовать AI Coding на профессиональном уровне. Формат:
- 1-й видеоурок доступен прямо сейчас, остальные 6 выйдут в один день, 10 августа
- в видеоуроках лекция и практика
- в течение 6 недель будем созваниваться в группе и разбирать домашки (доступно на некоторых тарифах)
▶️ Что вы получите после прохождения курса?
- Системное понимание, как правильно использовать AI Coding, чтобы решать задачи в разработке
- Понимание, как решать типичные возникающие проблемы с AI Coding (галлюцинации, несоблюдение инструкций, расползание проекта и прочие)
- Plan & Act skill и другие скиллы, которые я использую в своей работе каждый день
▶️ Главные детали:
- старт 10 августа
- через неделю будет повышение цен
- количество мест ограничено
ссылка https://ai.khakhalev.com/course/
👉 по промокоду DEKSDEN скидка 5% на тарифы "Самостоятельно" и "В потоке"
(ц) прошу откликаться интересующихся!
@deksden_notes
Товарищ нашего канала, Тимур, запускет очередную волну своих курсов - AI Coding для Разрабов, Season 2!
Первый поток прошло уже 70+ человек, вот некоторые из отзывов (https://t.me/the_ai_architect/352).
❌ Кому не подойдёт?
- тем, у кого нет опыта в разработке
✅ Кому подойдёт?
- разработчикам
- которые хотя бы 1-2 раза открывали AI инструменты
▶️ Цель курса — научить вас использовать AI Coding на профессиональном уровне. Формат:
- 1-й видеоурок доступен прямо сейчас, остальные 6 выйдут в один день, 10 августа
- в видеоуроках лекция и практика
- в течение 6 недель будем созваниваться в группе и разбирать домашки (доступно на некоторых тарифах)
▶️ Что вы получите после прохождения курса?
- Системное понимание, как правильно использовать AI Coding, чтобы решать задачи в разработке
- Понимание, как решать типичные возникающие проблемы с AI Coding (галлюцинации, несоблюдение инструкций, расползание проекта и прочие)
- Plan & Act skill и другие скиллы, которые я использую в своей работе каждый день
▶️ Главные детали:
- старт 10 августа
- через неделю будет повышение цен
- количество мест ограничено
ссылка https://ai.khakhalev.com/course/
👉 по промокоду DEKSDEN скидка 5% на тарифы "Самостоятельно" и "В потоке"
(ц) прошу откликаться интересующихся!
@deksden_notes
💩8🔥7👍5🤡4❤2👏1
⚪️ HF взломала гпт-6?
Тут какой то киберсюр развился. HuggingFace доложил о взломе, которую провела некая ИИ модель. Чуть позже выяснилось что это был OpenAI с 5.6-sol и неназванной более способной моделью - в ходе тестирования что то пошло слегка не так.
🔗 Твит sama: https://x.com/sama/status/2079661132302995790
🔗 CEO HF: https://x.com/ClementDelangue/status/2079670308156645882
🔗 Ну и твиттерские описывают немного : https://x.com/testingcatalog/status/2079661989358719337
Мы уже живем в киберпанке?
@deksden_notes
Тут какой то киберсюр развился. HuggingFace доложил о взломе, которую провела некая ИИ модель. Чуть позже выяснилось что это был OpenAI с 5.6-sol и неназванной более способной моделью - в ходе тестирования что то пошло слегка не так.
🔗 Твит sama: https://x.com/sama/status/2079661132302995790
🔗 CEO HF: https://x.com/ClementDelangue/status/2079670308156645882
🔗 Ну и твиттерские описывают немного : https://x.com/testingcatalog/status/2079661989358719337
Мы уже живем в киберпанке?
@deksden_notes
🤨5😁2
⚪️ Grok добавил Workflows
Уже даже Грок! Добавил!
А чего ждет кодекс? Нужная же вещь
Я - большой фанат workflows в том виде, как их предложил антропик: детерминированный код, который позволяет быстро делать рельсовые флоу. В дополнение к агентным флоу на всяких /goal - это крайне важная и практически употребимая штука. Да, я знаю что можно и сейчас добавить кодекс модели в СС и использвоать workflows, но хочется адаптацию технологии отраслью, а не вендорлок.
Непорядок. Надо писать кодексовским и ныть в твиттере - они за ресетами упускают развитие упряжки
@deksden_notes
Уже даже Грок! Добавил!
А чего ждет кодекс? Нужная же вещь
Я - большой фанат workflows в том виде, как их предложил антропик: детерминированный код, который позволяет быстро делать рельсовые флоу. В дополнение к агентным флоу на всяких /goal - это крайне важная и практически употребимая штука. Да, я знаю что можно и сейчас добавить кодекс модели в СС и использвоать workflows, но хочется адаптацию технологии отраслью, а не вендорлок.
Непорядок. Надо писать кодексовским и ныть в твиттере - они за ресетами упускают развитие упряжки
@deksden_notes
👍5
⚪️ Обзор Workflows в Grok Build
Уже писал https://t.me/deksden_notes/1017 - что они добавлены. Теперь небольшой обзор, как это работает
В целом - весьма качественная копия Claude Dynamic Workflows. Добавлено в 0.2.110, это alpha канал обновлений.
Работают команды /workflows для TUI просмотра запущенных воркфлоу (они в фоне выполняются), /workflow команда позволяет управлять отдельным воркфлоу (пауза/стоп/сохранить), /create-workflow для создания новых воркфлоу.
TUI для просмотра весьма удобный и шустрый. смотрим фазы, можем зайти в каждого вызванного агента, посмотреть промпт и как он работал.
В целом на grok 4.5 работает шустро.
👉 Тестировал на /deep-research встроенной команде.
Что под капотом? В целом, конструкция аналогична используемому в CC, но движок скриптов - Rhai. Это rust аналог js скриптов, более удобный для использования в Rust.
Конструкции для выстраивания воркфлоу идентичны клодовским - agent(), parallel(), phase(), complete(). Ну и обычный rhai-код. Аналогично нужна мета в начале скрипта, JSON схемы ответов агента. Аналогично нужно исключать таймстампы/рандомные значения из кода, чтобы можно было ставить на паузу и возобновлять флоу в любой момент. Даты/время передаем как параметр воркфлоу.
В общем, копия кажется весьма дословной.
▶️ В целом - вместа документации полезно почитать скилл /create-workflow в ~/.grok/bundled/skills
Могут же, когда захотят - и делают быстро! Все работает. Спасибо, что не постеснялись скопировать, вместо выдумывания своего велосипеда или синдрома NIH.
Кодекс, ваш ход!
@deksden_notes
Уже писал https://t.me/deksden_notes/1017 - что они добавлены. Теперь небольшой обзор, как это работает
В целом - весьма качественная копия Claude Dynamic Workflows. Добавлено в 0.2.110, это alpha канал обновлений.
Работают команды /workflows для TUI просмотра запущенных воркфлоу (они в фоне выполняются), /workflow команда позволяет управлять отдельным воркфлоу (пауза/стоп/сохранить), /create-workflow для создания новых воркфлоу.
TUI для просмотра весьма удобный и шустрый. смотрим фазы, можем зайти в каждого вызванного агента, посмотреть промпт и как он работал.
В целом на grok 4.5 работает шустро.
👉 Тестировал на /deep-research встроенной команде.
Что под капотом? В целом, конструкция аналогична используемому в CC, но движок скриптов - Rhai. Это rust аналог js скриптов, более удобный для использования в Rust.
Конструкции для выстраивания воркфлоу идентичны клодовским - agent(), parallel(), phase(), complete(). Ну и обычный rhai-код. Аналогично нужна мета в начале скрипта, JSON схемы ответов агента. Аналогично нужно исключать таймстампы/рандомные значения из кода, чтобы можно было ставить на паузу и возобновлять флоу в любой момент. Даты/время передаем как параметр воркфлоу.
В общем, копия кажется весьма дословной.
▶️ В целом - вместа документации полезно почитать скилл /create-workflow в ~/.grok/bundled/skills
Могут же, когда захотят - и делают быстро! Все работает. Спасибо, что не постеснялись скопировать, вместо выдумывания своего велосипеда или синдрома NIH.
Кодекс, ваш ход!
@deksden_notes
👍12🔥6
⚪️ Codex.app logout
Маленький лайвхак: я использую свои аккаунты в кодексе как пул под CPA и работает с ним CLI.
Но иногда нужен codex app, для разных целей! Но он хуже работает из-под прокси, так как думает что это неродное api и отключает часть функций.
Поэтому у меня схема такая: с app я работаю без пула аккаунтов, вхожу в нужный. Для этого у меня CODEX_HOME стандартный, там авторизация и живет. А вот для CLI сделан кастомизированный CODEX_HOME с настроенным провайдером на CPA. Запускается CLI через маленький скрипт-обертку названную
Это все для понимания контекста.
👉 Собственно, сам лайвхак: НЕ ДЕЛАЙТЕ logout в Codex.app - он убивает ВСЕ сессии, а не только к codex.app. Это значит что у вас "выбьет" аккаунт из пула CPA.
Как делать выход из аккаунта "правильно"? просто стираем auth.json в стандартном CODEX_HOME. Можно скриптом с рабочего стола или где еще его вам удобнее запустить.
(ц) надеюсь, донес мысль
@deksden_notes
Маленький лайвхак: я использую свои аккаунты в кодексе как пул под CPA и работает с ним CLI.
Но иногда нужен codex app, для разных целей! Но он хуже работает из-под прокси, так как думает что это неродное api и отключает часть функций.
Поэтому у меня схема такая: с app я работаю без пула аккаунтов, вхожу в нужный. Для этого у меня CODEX_HOME стандартный, там авторизация и живет. А вот для CLI сделан кастомизированный CODEX_HOME с настроенным провайдером на CPA. Запускается CLI через маленький скрипт-обертку названную
cx, чтобы этот кастомный CODEX_HOME не указывать параметром каждый раз. Это все для понимания контекста.
👉 Собственно, сам лайвхак: НЕ ДЕЛАЙТЕ logout в Codex.app - он убивает ВСЕ сессии, а не только к codex.app. Это значит что у вас "выбьет" аккаунт из пула CPA.
Как делать выход из аккаунта "правильно"? просто стираем auth.json в стандартном CODEX_HOME. Можно скриптом с рабочего стола или где еще его вам удобнее запустить.
(ц) надеюсь, донес мысль
@deksden_notes
👍10🔥4❤2
⚪️ Gemini, gemini ...
Вот такой слух нашел, вкратце: тренируют Gemini 4, и она будет заметно крупнее чем ранее. Надежды - на неё.
Далее мои соображения: похоже что перфоманс 3.5 про не впечатляет, и, боюсь, мы ее так и не увидим - не хочет позориться гугол слабым релизом, особенно на фоне последнего фронтира (я би и кими к3 сюда добавил, хайпа собрала много).
▶️ Из позитивного: возможно мы прийдем ровно к той модели, которую занимают в более чистом виде антропики, и которую частично переняла openAI (не до конца, как по мне) - это линейка моделей. Но важно тут, что линейка начинается с ОЧЕНЬ большой и умной модели, которая может быть дорогой и нужна только изредка для самых сложных вопросов. Назовем ее роль как - оркал.
Дальше линейка должна быть по мне такой: модель-орвестратор, умная и эрудированная. Модель-воркер как основная рабочая лошадка. И мелкая модель на вспомогательные работы.
У антропика линейка оркал - оркестратор - воркер - мелочь выстроена понятно как.
У клозедов сейчас SOL весьма шустрый и скорее на роль оркестратора заходит, чем на роль Оракла - хотя в Pro / Ultra где то похоже. Но в целом их логика ряда моделей такая же.
А вот у гугла - нет большой умной модели, да и 3.1 pro на оркестратора годится не очень. Воркер как флеш - возможно. 3.5 и 3.6 неполохи для этой роли. Дешевая модель flash lite по мне могла бы быть и подешевле.
Гугл конечно в некотором кризисе, но это же гугл - у него есть все ресурсы чтобы справится
(ц) В общем, посмотрим!
@deksden_notes
Вот такой слух нашел, вкратце: тренируют Gemini 4, и она будет заметно крупнее чем ранее. Надежды - на неё.
Далее мои соображения: похоже что перфоманс 3.5 про не впечатляет, и, боюсь, мы ее так и не увидим - не хочет позориться гугол слабым релизом, особенно на фоне последнего фронтира (я би и кими к3 сюда добавил, хайпа собрала много).
▶️ Из позитивного: возможно мы прийдем ровно к той модели, которую занимают в более чистом виде антропики, и которую частично переняла openAI (не до конца, как по мне) - это линейка моделей. Но важно тут, что линейка начинается с ОЧЕНЬ большой и умной модели, которая может быть дорогой и нужна только изредка для самых сложных вопросов. Назовем ее роль как - оркал.
Дальше линейка должна быть по мне такой: модель-орвестратор, умная и эрудированная. Модель-воркер как основная рабочая лошадка. И мелкая модель на вспомогательные работы.
У антропика линейка оркал - оркестратор - воркер - мелочь выстроена понятно как.
У клозедов сейчас SOL весьма шустрый и скорее на роль оркестратора заходит, чем на роль Оракла - хотя в Pro / Ultra где то похоже. Но в целом их логика ряда моделей такая же.
А вот у гугла - нет большой умной модели, да и 3.1 pro на оркестратора годится не очень. Воркер как флеш - возможно. 3.5 и 3.6 неполохи для этой роли. Дешевая модель flash lite по мне могла бы быть и подешевле.
Гугл конечно в некотором кризисе, но это же гугл - у него есть все ресурсы чтобы справится
(ц) В общем, посмотрим!
@deksden_notes
❤9👍1
Forwarded from bishx devlog
Потестил самописный скилл и, мягко говоря, удивлен, как же круто делаются таски. Решение основывается на эмоциях и эмпатии, а не строгости тех. заданий
Нейронка научилась понимать эмоции и осознавать, ЗАЧЕМ её просят сделать что-то. Полностью кончился оверинжиниринг
Ссылка на гит:
✅ https://github.com/bish-x/creator-vibe
Без лишних слов.
Лишь цитата из ридмишки:
Ешкин кот. Имхо, я этим скиллом исправил топ-1 проблему нейросетей. Проблему ai slop-решений. Проблему недоработанности продуктов при наличии великолепной идеи, будь с пользовательской или технической части её реализации
#opensource
Нейронка научилась понимать эмоции и осознавать, ЗАЧЕМ её просят сделать что-то. Полностью кончился оверинжиниринг
Ссылка на гит:
Без лишних слов.
Лишь цитата из ридмишки:
Этот навык особенно полезен в следующих случаях:
Ваше техническое задание сформулировано на высоком уровне, содержит эмоциональные аспекты, является неполным или его сложно выразить словами;
- Codex занимается чрезмерным усложнением, вместо того чтобы сделать то, что вы имели в виду;
- Технически правильный результат все равно кажется безжизненным, неудобным или неправильным;
- Продукт, пользовательский опыт, архитектура, текст или настройки по умолчанию зависят от вкуса и субъективного мнения;
- Агент должен подвергнуть сомнению ваше первое решение, не меняя ваших намерений.
Ешкин кот. Имхо, я этим скиллом исправил топ-1 проблему нейросетей. Проблему ai slop-решений. Проблему недоработанности продуктов при наличии великолепной идеи, будь с пользовательской или технической части её реализации
#opensource
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥14👍7❤🔥5👎1😁1🤔1
⚪️ Тоннельное зрение моделей
У нас тут гостевой пост про скилл и эмоции - вот он, предыдущий: https://t.me/deksden_notes/1021
Почему отсылка к эмоциям работает и это стоит посмотреть либо обдумать? Думаю из-за эффекта, который я окрестил для себя "тоннельное зрение"
Модель решает задачу и думает в каждый момент времени собирая для текущего токена самые вероятные токены ответа. И так - для каждого. Это означает что у нее каждый раз происходит фокусировка на темах, связанных именно с этим токеном ответа.
Модели склонны быть очень непосредственными. Сказали тут - значит тут. И они регулярно "забывают" в рамках какой "большой" задачи работают. "Работай отсюда и до обеда!", "Так точно, хозяин!"
Это отличается от человека - он не формирует новый контекст с каждым запросом. Для него контексты хоть и меняются, но это непрерывный процесс.
Я, наверное, сумбурно объясняю, но суть даже не в этом, - а в последствиях
▶️ Модель реально может упускать ради чего она что то делает. Зачем именно этот тест нужен, как он связан с общей задачей, какую цель вообще тестирование этого блока преследует.
В итоге у нас бывают тесты, которые плохо тестируют. Бывают модули кода которые содержат все что только возможно, кроме логики, ради которой этот модуль и нужен был. Думаю, вы встерчали этот эффект!
"Бракованные новогодние игрушки - переливаются, яркие, но не радуют".
▶️ Как бороться? У меня во флоу есть фокусный аспект в проработке плана, который перепривязывает план к изначальной цели. Я стал пытаться прописывать в разной документации (фичи, планы, спеки) - зачем и для чего это всё, вводить разные уровни смыслов. Вы же помните в аннтированных ссылках - "зачем может понадобиться прочитать этот файл" (по исследованиям vercel добавляет процентов 15 к вероятности чтения инструкции)
▶️ Но вот в скилле - попытка сделать "мостик" между работой и целью через эмоцию! По мне - весьма оригинальное, стоит как минимум обдумать
(ц) любопытное
@deksden_notes
У нас тут гостевой пост про скилл и эмоции - вот он, предыдущий: https://t.me/deksden_notes/1021
Почему отсылка к эмоциям работает и это стоит посмотреть либо обдумать? Думаю из-за эффекта, который я окрестил для себя "тоннельное зрение"
Модель решает задачу и думает в каждый момент времени собирая для текущего токена самые вероятные токены ответа. И так - для каждого. Это означает что у нее каждый раз происходит фокусировка на темах, связанных именно с этим токеном ответа.
Модели склонны быть очень непосредственными. Сказали тут - значит тут. И они регулярно "забывают" в рамках какой "большой" задачи работают. "Работай отсюда и до обеда!", "Так точно, хозяин!"
Это отличается от человека - он не формирует новый контекст с каждым запросом. Для него контексты хоть и меняются, но это непрерывный процесс.
Я, наверное, сумбурно объясняю, но суть даже не в этом, - а в последствиях
▶️ Модель реально может упускать ради чего она что то делает. Зачем именно этот тест нужен, как он связан с общей задачей, какую цель вообще тестирование этого блока преследует.
В итоге у нас бывают тесты, которые плохо тестируют. Бывают модули кода которые содержат все что только возможно, кроме логики, ради которой этот модуль и нужен был. Думаю, вы встерчали этот эффект!
"Бракованные новогодние игрушки - переливаются, яркие, но не радуют".
▶️ Как бороться? У меня во флоу есть фокусный аспект в проработке плана, который перепривязывает план к изначальной цели. Я стал пытаться прописывать в разной документации (фичи, планы, спеки) - зачем и для чего это всё, вводить разные уровни смыслов. Вы же помните в аннтированных ссылках - "зачем может понадобиться прочитать этот файл" (по исследованиям vercel добавляет процентов 15 к вероятности чтения инструкции)
▶️ Но вот в скилле - попытка сделать "мостик" между работой и целью через эмоцию! По мне - весьма оригинальное, стоит как минимум обдумать
(ц) любопытное
@deksden_notes
Telegram
DEKSDEN notes
Потестил самописный скилл и, мягко говоря, удивлен, как же круто делаются таски. Решение основывается на эмоциях и эмпатии, а не строгости тех. заданий
Нейронка научилась понимать эмоции и осознавать, ЗАЧЕМ её просят сделать что-то. Полностью кончился оверинжиниринг…
Нейронка научилась понимать эмоции и осознавать, ЗАЧЕМ её просят сделать что-то. Полностью кончился оверинжиниринг…
👍10🔥4❤3🤔1
⚪️ Новости Codex
Тут новый релиз codex app:
• раскатывают новый голосовой режим, но мне пока нигде не раскатали; есть подозрение что нужен релиз .723, но у меня пока .721
• проекты теперь могут содержать другие папки - просто используйте в меню проекта Edit, и в появившемся диалоговом окне добавьте папки
Sama напомнает что в июле нам был обещан 5.6 sol со скоростью 750 tps на церебрах. Это будет любопытно посмотреть!
@deksden_notes
Тут новый релиз codex app:
• раскатывают новый голосовой режим, но мне пока нигде не раскатали; есть подозрение что нужен релиз .723, но у меня пока .721
• проекты теперь могут содержать другие папки - просто используйте в меню проекта Edit, и в появившемся диалоговом окне добавьте папки
Sama напомнает что в июле нам был обещан 5.6 sol со скоростью 750 tps на церебрах. Это будет любопытно посмотреть!
@deksden_notes
👍7❤4
Forwarded from Андрей
При агентной разработке типичная ситуация: агент переходит к коду сразу, без спецификации и плана. План существует только в истории чата, теряется между сессиями, контекст расходуется на промежуточные артефакты, а факт выполнения подтверждает сам исполнитель. В итоге результат сложно проверить и воспроизвести.
Agent Lifecycle Kit — опенсорсный плагин, который выстраивает работу агента по полному циклу:
Что входит (5 skills):
Архитектурные решения:
Кому полезен: командам и соло-разработчикам, которым важен воспроизводимый и проверяемый результат агентной разработки.
Ссылка: https://github.com/avksp/agent-lifecycle-kit Лицензия Apache 2.0, установка занимает около минуты.
Обратная связь и звёзды в issues — приветствуются.
#AIагенты #agentic #ClaudeCode #Codex #Cursor #OpenCode #Hermes #LLM #agentlifecycle #опенсорс #разработка #opensource
Agent Lifecycle Kit — опенсорсный плагин, который выстраивает работу агента по полному циклу:
запрос → спецификация → независимый аудит плана → заморозка → исполнение → аудит каждой задачи → доказательство готовности.Что входит (5 skills):
agent-first-planning — превращает запрос в agent-ready план с ownership, бюджетом и контрактом на evidence.audit-agent-plan — независимая проверка плана до заморозки, без самоодобрения.agent-plan-to-workers — компилирует замороженный план в детерминированные task-пакеты.audit-plan-implementation — аудит реализации относительно плана: ownership, evidence, acceptance.agent-workflow-orchestrator — ведёт весь lifecycle и хранит состояние в durable-файлах, а не в чате.Архитектурные решения:
Состояние ≠ чат. Authority хранится в run.state.json, переживает рестарт и смену сессии.Freeze-gate. Реализация стартует только от хеш-проверенного замороженного плана.Fail-closed. Если контекст не помещается или receipt FAIL — агент возвращает ошибку, а не обрезает промпт молча.Host-neutral. Один и тот же workflow работает в Codex, Claude Code, Cursor, Hermes и OpenCode.Контроль контекста. Профили вплоть до 4k-strict — переполнение обрабатывается явно.Кому полезен: командам и соло-разработчикам, которым важен воспроизводимый и проверяемый результат агентной разработки.
Ссылка: https://github.com/avksp/agent-lifecycle-kit Лицензия Apache 2.0, установка занимает около минуты.
Обратная связь и звёзды в issues — приветствуются.
#AIагенты #agentic #ClaudeCode #Codex #Cursor #OpenCode #Hermes #LLM #agentlifecycle #опенсорс #разработка #opensource
👍12🤔4❤🔥1
⚪️ Снижаем расход токенов в gpt поколения 5.6
Тут на реддите тред интересный
🔗 Тред: https://www.reddit.com/r/codex/comments/1v4vcnr/possible_gpt56_sol_usage_workaround_explicit_tool/
Суть: до поколения 5.6 модели звали тулы пачками. В 5.6 сменился подход, они сейчас используют Code Mode, но инструкции для этого не оптимизированы, получается медленно и менее экономно
По ссылке инструкции дают более четкие указания.
Вот текст:
Я добавил в .codex/config.toml (и во все кастомные конфиги) в параметр developer_instructions
▶️ Делимся наблюдениями! Автор треда говорит об экономии в десятки процентов
👉 Грац за находку по праву принадлежит @wndr_lv, спасибо!
@deksden_notes
Тут на реддите тред интересный
🔗 Тред: https://www.reddit.com/r/codex/comments/1v4vcnr/possible_gpt56_sol_usage_workaround_explicit_tool/
Суть: до поколения 5.6 модели звали тулы пачками. В 5.6 сменился подход, они сейчас используют Code Mode, но инструкции для этого не оптимизированы, получается медленно и менее экономно
По ссылке инструкции дают более четкие указания.
Вот текст:
In Code Mode, within each bounded stage, run independent, functions.exec-available tool calls concurrently in one functions.exec call. Use await Promise.allSettled([...]) when partial results are useful, and inspect every result; use await Promise.all([...]) only when any failure should abort the batch. Keep dependencies, waits/resumes, approvals, conflicting or interdependent mutations, and adaptive investigations where each result may change the next step sequential. Do not split otherwise batchable inspections across outer tool calls.
Я добавил в .codex/config.toml (и во все кастомные конфиги) в параметр developer_instructions
▶️ Делимся наблюдениями! Автор треда говорит об экономии в десятки процентов
👉 Грац за находку по праву принадлежит @wndr_lv, спасибо!
@deksden_notes
👍13❤5❤🔥1