⚪️ LunaMaxxing
Переключил часть длинно работающих флоу на Луну в max/xhigh ризонинге - и, о чудо, лимиты перестали тратится вообще! несколько часов едет пара сессий, а лимиты на пару процентов проседают по пулу.. Раньше на sol medium все довольно стремительно сгорало.
Удивительное, конечно
Не уверен что оно со всем-всем справится норм, но тестов оно определенно заслуживает.
(ц) Кто еще не - лучше таки да.
——
Upd 1️⃣ : кстати, еще со времен deepseek-moment вывели одно следствие - цена имеет значение. Достаточно умная модель весьма дешево - это сильное предложение. Фронтир-фронтиром, но тут ИИ в экономику отправляют, а для реальных дел это важно
В общем, продолжаю накидывать)
@deksden_notes
Переключил часть длинно работающих флоу на Луну в max/xhigh ризонинге - и, о чудо, лимиты перестали тратится вообще! несколько часов едет пара сессий, а лимиты на пару процентов проседают по пулу.. Раньше на sol medium все довольно стремительно сгорало.
Удивительное, конечно
Не уверен что оно со всем-всем справится норм, но тестов оно определенно заслуживает.
(ц) Кто еще не - лучше таки да.
——
Upd 1️⃣ : кстати, еще со времен deepseek-moment вывели одно следствие - цена имеет значение. Достаточно умная модель весьма дешево - это сильное предложение. Фронтир-фронтиром, но тут ИИ в экономику отправляют, а для реальных дел это важно
В общем, продолжаю накидывать)
@deksden_notes
👍18🔥10
Forwarded from Мастер AI coding
Около пол года бьюсь над созданием удобного процесса агентной разработки софта и наконец что то интересное стало вырисовываться .
По началу набирася в Cursor опыта использования агентов по ролям. Ограниченность контекста заставляла экспериментировать с разного рода memory системами. Весной Дексден подсветил интересный memobank от Влада, там PRD-FT-TASKS, бюрократические протоколы, объем генерируемых служебных файлов кратно превышает объем генерируемого кода, зато мы получам достаточно устойчивый workflow разработки, не боящийся обрыва сессий, да еще и частичная автономность на борту. Все бы хорошо, но не хватало SDD фундамента из опорных design спецификаций, без них небольшие проекты могли бы генерироваться успешно, но доработка и поддержка приведет к slop решениям. Пару месяцев вкатывал в фреймворк лушие плюшки из Spec KIT, жирного BMAD и не упомню из чего еще.. теперь фреймворк способен начать процесс с интервьюируемого брейншторминга идеи, дальше многоходовочка с постепенной генерацией вплетаемых друг в друга технических, функциональных и некоторых других спецификаций. По умолчанию фреймворк предлагает удобную агентам архитектуру модульного монолита с вертикальными слайсами и явным графом модулей. Во время декомпозиции функциональных спеков, к карточкам тасок прирастают наборы согласованных SDD design specs, указываются критерии приемки, границы выполнения, чтобы имплементацию таски можно было поручать агентам-мартышкам. Декомпозировал сложность имплементации и верификации тасок по 4м уровням. Если повторная верификация трижды завершается провально, можно выбрать процесс углубленного дебагинга таски.
Сложные таски идут по роутингу TDD: пишем тесты, имплементируем пока тесты не сойдуся(фейкотестам привет и пока :). Если экзекьютору хватит ума увидеть, что спеки не достаточны\не согласованы, он ничего не додумывает, а отправляет нас обратно на редизайн спеков+карточки таски, потом выполнит задачу вновь.
Фреймворк получился заточен под фронтиров Codex и Claude. Допил под другие LLM простой, заключается в роутинге к набору из 30+ скиллов, остальное подтянется автоматом. В ридми на гитхабе описано как установить фреймворк, какие команды вызывать, про автопилот и пр. Если у вас есть свой `AGENTS.md` для проекта, желательно его переименовать , а после разворота фреймворка в прокт уделить внимание слиянию, ибо фреймворку важны инструкции в созданном фреймворком корневом
После запуска новой сессии( нового чата) можно даже не заглядывать в ридми а просто спрашивать: "Шо мне делать дальше?",- агент поведет за руку.
Из дополнительных плюшек, которые внедрены в фреймворк DevRails:
- для тяжелых правок или правок в тяжелом проекте: /technical-premortem;
- если агент во время работы нашел минорную проблему, делает PAPERCUT записи;
- скан на тех долг ( можно запускать на ночь)
- ели хочешь наболтать идею в свободном стиле, но чтобы агент вник глубже в суть месседжа, рекомендую к сообщению добавлять creator-vibe skill фразой: "используй мой вайб".
- на днях будет добавлен frontend better skills pack, лениво подгружаемый только в роли FRONTENDER
===
Я обкатываю функционал фреймворка на боевых проектах, параллельно занимаясь свежими внедрениями. Brownfield достался от Влада, его я пока честно не тестил.
Буду рад замечаниям, вопросам и новым идеям =)
В комментариях будет видос для самых маленьких, как пользоваться фреймворком #DevRails на примере разработки Android приложения. Хотя я его доселе обкатывал восновном на web приложениях. Всем добра!
#opensource
По началу набирася в Cursor опыта использования агентов по ролям. Ограниченность контекста заставляла экспериментировать с разного рода memory системами. Весной Дексден подсветил интересный memobank от Влада, там PRD-FT-TASKS, бюрократические протоколы, объем генерируемых служебных файлов кратно превышает объем генерируемого кода, зато мы получам достаточно устойчивый workflow разработки, не боящийся обрыва сессий, да еще и частичная автономность на борту. Все бы хорошо, но не хватало SDD фундамента из опорных design спецификаций, без них небольшие проекты могли бы генерироваться успешно, но доработка и поддержка приведет к slop решениям. Пару месяцев вкатывал в фреймворк лушие плюшки из Spec KIT, жирного BMAD и не упомню из чего еще.. теперь фреймворк способен начать процесс с интервьюируемого брейншторминга идеи, дальше многоходовочка с постепенной генерацией вплетаемых друг в друга технических, функциональных и некоторых других спецификаций. По умолчанию фреймворк предлагает удобную агентам архитектуру модульного монолита с вертикальными слайсами и явным графом модулей. Во время декомпозиции функциональных спеков, к карточкам тасок прирастают наборы согласованных SDD design specs, указываются критерии приемки, границы выполнения, чтобы имплементацию таски можно было поручать агентам-мартышкам. Декомпозировал сложность имплементации и верификации тасок по 4м уровням. Если повторная верификация трижды завершается провально, можно выбрать процесс углубленного дебагинга таски.
Сложные таски идут по роутингу TDD: пишем тесты, имплементируем пока тесты не сойдуся(фейкотестам привет и пока :). Если экзекьютору хватит ума увидеть, что спеки не достаточны\не согласованы, он ничего не додумывает, а отправляет нас обратно на редизайн спеков+карточки таски, потом выполнит задачу вновь.
Фреймворк получился заточен под фронтиров Codex и Claude. Допил под другие LLM простой, заключается в роутинге к набору из 30+ скиллов, остальное подтянется автоматом. В ридми на гитхабе описано как установить фреймворк, какие команды вызывать, про автопилот и пр. Если у вас есть свой `AGENTS.md` для проекта, желательно его переименовать , а после разворота фреймворка в прокт уделить внимание слиянию, ибо фреймворку важны инструкции в созданном фреймворком корневом
AGENTS.md. После запуска новой сессии( нового чата) можно даже не заглядывать в ридми а просто спрашивать: "Шо мне делать дальше?",- агент поведет за руку.
Из дополнительных плюшек, которые внедрены в фреймворк DevRails:
- для тяжелых правок или правок в тяжелом проекте: /technical-premortem;
- если агент во время работы нашел минорную проблему, делает PAPERCUT записи;
- скан на тех долг ( можно запускать на ночь)
- ели хочешь наболтать идею в свободном стиле, но чтобы агент вник глубже в суть месседжа, рекомендую к сообщению добавлять creator-vibe skill фразой: "используй мой вайб".
- на днях будет добавлен frontend better skills pack, лениво подгружаемый только в роли FRONTENDER
===
Я обкатываю функционал фреймворка на боевых проектах, параллельно занимаясь свежими внедрениями. Brownfield достался от Влада, его я пока честно не тестил.
Буду рад замечаниям, вопросам и новым идеям =)
В комментариях будет видос для самых маленьких, как пользоваться фреймворком #DevRails на примере разработки Android приложения. Хотя я его доселе обкатывал восновном на web приложениях. Всем добра!
#opensource
GitHub
GitHub - nicelight/DevRails-26: Agentic memory based SDD dev workflow
Agentic memory based SDD dev workflow. Contribute to nicelight/DevRails-26 development by creating an account on GitHub.
🔥21🤷♂8🤔5❤4🥰3🎄1
⚪️ Anydoc от Firecrawl
Опенсорс от Firecrawl для парсинга 14 форматов в Markdown.
🔗 Гитхаб : https://github.com/firecrawl/anydoc
В чем плюсы? больше форматов чем в markitdown (14 против 6), быстрый (на rust). Поставляются биндинги для TS и Python.
По описанию мне понравилось: структура сохраняется, картинки тоже, legacy форматы поддерживает (doc/xls), таблички обрабатывает. По качеству - надо смотреть конечно на практике. Может, заберу себе в движок базы знаний.
(ц) понравилось
@deksden_notes
Опенсорс от Firecrawl для парсинга 14 форматов в Markdown.
🔗 Гитхаб : https://github.com/firecrawl/anydoc
В чем плюсы? больше форматов чем в markitdown (14 против 6), быстрый (на rust). Поставляются биндинги для TS и Python.
По описанию мне понравилось: структура сохраняется, картинки тоже, legacy форматы поддерживает (doc/xls), таблички обрабатывает. По качеству - надо смотреть конечно на практике. Может, заберу себе в движок базы знаний.
(ц) понравилось
@deksden_notes
👍25🔥9
Forwarded from Alexey Demochko
⚡️ Portable Orchestration Flow Kit — мой флоу для агентной разработки (Codex + Opencode-go)
Это не очередной фреймворк, а переносимый контракт процесса 🤌
За последнее время я много мучился с новыми агентами (GPT 5.6 Sol High сюда-а) и собрал свой набор, который решает главные проблемы работы с LLM в коде:
🔹 Экономия токенов — исполнитель получает не всю историю, а один пакет с allowlist’ом файлов. Нет перечитывания лишнего, нет потери контекста, только нужное
🔹 Скорость — детерминированная сборка пакетов локальными скриптами (без лишних вызовов модели), параллельное выполнение независимых пакетов и жёсткие границы задач
🔹 Контроль контекста — стабильный префикс (роль, политика) отделён от динамического хвоста. Даже при сложной задаче контекст не раздувается до предела
🔹 Максимум качества за минимум — кэш-оптимизация в A/B тестах снизила uncached input на 29,4% при ретраях. Code-review пропорционально риску - 3 степени: мелочь — без оверхеда (Sol Low), по-быстрому, обычное - Sol High, критичное — Sol High + Kimi K3
🔹 Чёткие критерии «сделано» — explicit DoD: план → пакет → проверки → интеграция → review
В итоге получилось: 10 ролей, 7 skills и скрипты, которые можно адаптировать под свой runtime.
👉 Смотреть: https://github.com/Kacep91/orchestration-flow-kit
#opensource
За последнее время я много мучился с новыми агентами (GPT 5.6 Sol High сюда-а) и собрал свой набор, который решает главные проблемы работы с LLM в коде:
🔹 Экономия токенов — исполнитель получает не всю историю, а один пакет с allowlist’ом файлов. Нет перечитывания лишнего, нет потери контекста, только нужное
🔹 Скорость — детерминированная сборка пакетов локальными скриптами (без лишних вызовов модели), параллельное выполнение независимых пакетов и жёсткие границы задач
🔹 Контроль контекста — стабильный префикс (роль, политика) отделён от динамического хвоста. Даже при сложной задаче контекст не раздувается до предела
🔹 Максимум качества за минимум — кэш-оптимизация в A/B тестах снизила uncached input на 29,4% при ретраях. Code-review пропорционально риску - 3 степени: мелочь — без оверхеда (Sol Low), по-быстрому, обычное - Sol High, критичное — Sol High + Kimi K3
🔹 Чёткие критерии «сделано» — explicit DoD: план → пакет → проверки → интеграция → review
В итоге получилось: 10 ролей, 7 skills и скрипты, которые можно адаптировать под свой runtime.
👉 Смотреть: https://github.com/Kacep91/orchestration-flow-kit
#opensource
GitHub
GitHub - Kacep91/orchestration-flow-kit: Portable reference kit for evidence-led AI engineering: packet-first planning, bounded…
Portable reference kit for evidence-led AI engineering: packet-first planning, bounded Luna execution, Sol orchestration, parallel behavior packages, deterministic handoffs and diffs, failure-ledge...
👍8🔥7❤2👎1🤔1
⚪️ Google страсти и слухи
Демиc Хассабис уходит с поста генерального директора DeepMind и займет новую роль председателя, в то время как главный ученый Джефф Дин и «другой руководитель в области ИИ» уходят, чтобы основать собственный бизнес, в который Google инвестирует
Чего там происходит? Особенно на фоне истории с 3.5 про? Неужели llama4-moment?
🔗 Первоисточник : https://www.axios.com/2026/08/05/google-deepmind-demis-hassabis-ai
(ц) мы, конечно, будем наблюдать!
——
upd 1️⃣ : Демис телеграфирует: https://x.com/demishassabis/status/2085034334914769203
Всё пучком! Ну - кто бы сомневался. Еще про то что все зашибись можно почитать в блоге: https://blog.google/company-news/inside-google/message-ceo/next-chapter-ai-momentum/
——
upd 2️⃣ : Джефф Дин и товарищи делают стартап DiscoveryLoop AI
https://x.com/Sanjay_Ghemawat/status/2085033732013162909
Джефф пишет: https://x.com/JeffDean/status/2085083442669318443
@deksden_notes
Демиc Хассабис уходит с поста генерального директора DeepMind и займет новую роль председателя, в то время как главный ученый Джефф Дин и «другой руководитель в области ИИ» уходят, чтобы основать собственный бизнес, в который Google инвестирует
Чего там происходит? Особенно на фоне истории с 3.5 про? Неужели llama4-moment?
🔗 Первоисточник : https://www.axios.com/2026/08/05/google-deepmind-demis-hassabis-ai
(ц) мы, конечно, будем наблюдать!
——
upd 1️⃣ : Демис телеграфирует: https://x.com/demishassabis/status/2085034334914769203
Всё пучком! Ну - кто бы сомневался. Еще про то что все зашибись можно почитать в блоге: https://blog.google/company-news/inside-google/message-ceo/next-chapter-ai-momentum/
——
upd 2️⃣ : Джефф Дин и товарищи делают стартап DiscoveryLoop AI
https://x.com/Sanjay_Ghemawat/status/2085033732013162909
Джефф пишет: https://x.com/JeffDean/status/2085083442669318443
@deksden_notes
👀6😱3👍2🤣2
Forwarded from Циничный AI (Anton Goncharenko)
Ω_Инженерия_надёжных_фреймворков_на_AI_агентах.html
184.7 KB
Книга широко известного в узких кругах Ω
Книга - это попытка вытащить из его практики переносимую систему.
Для написания книги использованы:
Немного про Ω:
И это только то, что известно из его сообщений.
P.S. Ещё раз, как создавалась книга - я взял все диалоги Ω с 1 июля, обработал и собрал из этого единую концептуально-практическую философию
P.P.S. Приятного чтения )
#opensource #Ω
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🔥14❤5❤🔥4😁1🤔1🕊1
⚪️ Релиз Codex 0.146.1
Релиз по вторникам нынче принес нам минорный багофикс релиз в среду.
Ничего примечательного.
Для codex.app даже ченжлога нету, хотя бамп версии с 26.727 до 26.730 произошел.
В общем - "всё пропало! ИИ упёрся в стену"
(ц) утешимся смирением
@deksden_notes
Релиз по вторникам нынче принес нам минорный багофикс релиз в среду.
Ничего примечательного.
Для codex.app даже ченжлога нету, хотя бамп версии с 26.727 до 26.730 произошел.
В общем - "всё пропало! ИИ упёрся в стену"
(ц) утешимся смирением
@deksden_notes
👍2😁1
⚪️ Работа в OpenAI
Клозеды нанимают! Позиций много, разных
🔗 Писать сюда: https://x.com/vinhocent/status/2084740080166752591 (DM)
@deksden_notes
Клозеды нанимают! Позиций много, разных
🔗 Писать сюда: https://x.com/vinhocent/status/2084740080166752591 (DM)
@deksden_notes
👍6🔥6❤2👻2
⚪️ Тибо и ресеты
Тибо, кмк, открыл ящик Пандоры - написал что в DM получает запрос на ресет в среднем раз в 6 минут и иногда уступает.
Зря он это сказал! Теперь прийдется делать пайплайн на агенте для обработки шквала запросов. Все таки 10м+ пользователей
@deksden_notes
Тибо, кмк, открыл ящик Пандоры - написал что в DM получает запрос на ресет в среднем раз в 6 минут и иногда уступает.
Зря он это сказал! Теперь прийдется делать пайплайн на агенте для обработки шквала запросов. Все таки 10м+ пользователей
@deksden_notes
😁19👏6
⚪️ Google (Dream)beans
Начну разгребать пачку новостей, что скопились для разбора
Тут гугол в рамках нового эксперимента решил выпуститьgemini 3.5 pro новую приложуху. Подключаем к ней гугол приложения (gmail, историю поиска, фотки, ...) и она дает персонализированные истории о наиболее важных для вас темах. Может посоветовать места для посещения, что то попробовать, события какие то... Если история касается знакомых вам людей, как референсы для нанобанано-картинок бдет использовано фото этих людег из гугол фоток.
То есть - кормим ее нашей персональной информацией и переписками чтобы получить набор каких то картинок. Звучит заманчиво (нет)!
Но - сделали такое. В целом, как эксперимент с точки зрения персонального ассистента и формата выдачи каких то саммари, наверное, имеет место быть.
Доступно: US only, AI Pro / Ultra подписки.
🔗 Оффсайт: https://labs.google/dreambeans
В общем, есть и такое
@deksden_notes
Начну разгребать пачку новостей, что скопились для разбора
Тут гугол в рамках нового эксперимента решил выпустить
То есть - кормим ее нашей персональной информацией и переписками чтобы получить набор каких то картинок. Звучит заманчиво (нет)!
Но - сделали такое. В целом, как эксперимент с точки зрения персонального ассистента и формата выдачи каких то саммари, наверное, имеет место быть.
Доступно: US only, AI Pro / Ultra подписки.
🔗 Оффсайт: https://labs.google/dreambeans
В общем, есть и такое
@deksden_notes
🤔6😁5
⚪️ Not Diamond Router
Открыт лист ожидания на доступ к умному роутеру моделей, который для каждого запроса выбирает оптимальную модель.
Авторы в блоге показывают как добиваются заметного снижения цены (от. 25 до 60%) при аналогичном качестве или даже росте качества! Есть бенчмарки роутинга между антропиковскими моделями и в миксе с китайским опенсорсом
Выглядит все достаточно интересно. Растет скорость, снижается цена!..
Использование роутера платное - $0.05 за MTok. При этом они еще и учат модели (нету ZDR - пока? или только для enterprise тира?)
Работает как локальное прокси, которое извлекает метаданные сессии и отправляет их роутеру для выбора моделей. далее запрос идет традиционным путом к традиционным энжпоинтам - к NotDiamond ваша кодовая база напрямую не отправляется, только мета.
В общем, выглядит духоподьемно и интересно, будем наблюдать
🔗 Оффсайт : https://www.notdiamond.ai/
🔗 Блог про роутер : https://www.notdiamond.ai/blog/not-diamond-code-intelligent-model-routing-for-coding-agents
🔗 Тред анонса : https://x.com/tomas_hk/status/2084669945150062619
@deksden_notes
Открыт лист ожидания на доступ к умному роутеру моделей, который для каждого запроса выбирает оптимальную модель.
Авторы в блоге показывают как добиваются заметного снижения цены (от. 25 до 60%) при аналогичном качестве или даже росте качества! Есть бенчмарки роутинга между антропиковскими моделями и в миксе с китайским опенсорсом
Выглядит все достаточно интересно. Растет скорость, снижается цена!..
Использование роутера платное - $0.05 за MTok. При этом они еще и учат модели (нету ZDR - пока? или только для enterprise тира?)
Работает как локальное прокси, которое извлекает метаданные сессии и отправляет их роутеру для выбора моделей. далее запрос идет традиционным путом к традиционным энжпоинтам - к NotDiamond ваша кодовая база напрямую не отправляется, только мета.
В общем, выглядит духоподьемно и интересно, будем наблюдать
🔗 Оффсайт : https://www.notdiamond.ai/
🔗 Блог про роутер : https://www.notdiamond.ai/blog/not-diamond-code-intelligent-model-routing-for-coding-agents
🔗 Тред анонса : https://x.com/tomas_hk/status/2084669945150062619
@deksden_notes
🔥7👀5👍4
⚪️ Buzz
Расскажу про проект Buzz от Джека Дорси, который придумал твиттер, а теперь в Block делает squared, chashapp, и много чего еще. В общем, источник заслуживает внимания.
🔗 Оффсайт: https://buzz.xyz/
🔗 Гитхаб: https://github.com/block/buzz
Проект можно описать как рабочую среду для людей и агентов. Некий Slack на максималках - но на формате сообщений Nostr и авторизации по ключам (немного похоже на ssh авторизацию). Релей можно поднять самому на своем сервере. У релея есть "встроенный" гит, есть встроенная файловая система для хранения вложений в сообщения, есть воркфлоу (запусаются триггерами сообщений, вебхуками, расписанием). Агенты - codex/claude/goose со свооими подписками, или их упряжкап.
👉 Фишка что понравилась: очевидность организации коллаборации над проектом в обсуждении, без переключения между гитхабом, чатами агентов и людей.
Достойный и весьма самобытный, оригинальный проект. Буду за ним следить
@deksden_notes
Расскажу про проект Buzz от Джека Дорси, который придумал твиттер, а теперь в Block делает squared, chashapp, и много чего еще. В общем, источник заслуживает внимания.
🔗 Оффсайт: https://buzz.xyz/
🔗 Гитхаб: https://github.com/block/buzz
Проект можно описать как рабочую среду для людей и агентов. Некий Slack на максималках - но на формате сообщений Nostr и авторизации по ключам (немного похоже на ssh авторизацию). Релей можно поднять самому на своем сервере. У релея есть "встроенный" гит, есть встроенная файловая система для хранения вложений в сообщения, есть воркфлоу (запусаются триггерами сообщений, вебхуками, расписанием). Агенты - codex/claude/goose со свооими подписками, или их упряжкап.
👉 Фишка что понравилась: очевидность организации коллаборации над проектом в обсуждении, без переключения между гитхабом, чатами агентов и людей.
Достойный и весьма самобытный, оригинальный проект. Буду за ним следить
@deksden_notes
👍10🔥5
⚪️ Warp Agent CLI
Теперь агент отдельно от самого Warp
Фишки:
• роутинг задачи на нужную модель
• субагенты и управление облачными агентами - можно сделать перенос текущей задачи в облако (oz задействован);
• удобная работа с терминальными командами с автодополнением
Правила роутинга примерно так ставятся:
- "Send simple requests to minimax"
- "Send planning tasks to Claude"
- "Send bug fixes to Kimi k3"
В общем, надо будет посмотреть повнимательнее - роутинг заинтересовал.
Чего не понял: работает ли эта штука с существующими подписками - точно работает с подпиской самого Warp (но она вроде бы была не особо выгодной), есть BYOK, и подписка грока поддерживается (почему то). Будем разбираться.
🔗 Тред анонса: https://x.com/zachlloydtweets/status/2084724994043412690
🔗 оффсайт: https://www.warp.dev/agent-cli
🔗 гитхаб : https://github.com/warpdotdev/warp
@deksden_notes
Теперь агент отдельно от самого Warp
Фишки:
• роутинг задачи на нужную модель
• субагенты и управление облачными агентами - можно сделать перенос текущей задачи в облако (oz задействован);
• удобная работа с терминальными командами с автодополнением
Правила роутинга примерно так ставятся:
- "Send simple requests to minimax"
- "Send planning tasks to Claude"
- "Send bug fixes to Kimi k3"
В общем, надо будет посмотреть повнимательнее - роутинг заинтересовал.
Чего не понял: работает ли эта штука с существующими подписками - точно работает с подпиской самого Warp (но она вроде бы была не особо выгодной), есть BYOK, и подписка грока поддерживается (почему то). Будем разбираться.
🔗 Тред анонса: https://x.com/zachlloydtweets/status/2084724994043412690
🔗 оффсайт: https://www.warp.dev/agent-cli
🔗 гитхаб : https://github.com/warpdotdev/warp
@deksden_notes
👍8🤔4❤2
⚪️ Cloudflare OS
Тут Клаудфлёр выпустил довольно специфическую штуку - проект Cloudflare OS, причем не как сервис, а как ospe source проект. Разворачиваем в своем аккаунте сами.
🔗 Тред анонса от техлида: https://x.com/KentonVarda/status/2084990137180590572
🔗 Оффсайт : https://os.cloudflare.app/
🔗 Блог: https://blog.cloudflare.com/cloudflare-os/
🔗 Гитхаб: https://github.com/cloudflare/cloudflare-os
Я довольно долго разбирался чего это за зверь и склоняюсь к мнению, что это изх видение способа запуска вабкодинга в компании, чтобы это не вызвало катастрофы с доступом к данным.
Это построенная повер workers система, ограничивающая не только запуск агентов, что в любом сендбоксе делается. Оригинальна тут концепция Gatekeepers - адаптеров доступа к данным, которые не только позволяют прочитать что либо, но и влияют далее на судьбу конкретного сендбокса. Это некий аналог и расширение MCP. Если в него были переданы какие либо чувствительные данные, то можно запретить шеринг этого сендбокса - то есть мы управляем еще и судьбой получателя данных.
Концепция "экземпляр приложения" на каждого пользователя с его данными - вроде бы тоже довольно оригинальна, они ее назвали Gadget. То есть это собственный код и данные, без разделения кода как в SaaS
Скорее это не про кодинг, а для дашбордов с корпоративными данными или мини-приложений уровня подразделения.
@deksden_notes
Тут Клаудфлёр выпустил довольно специфическую штуку - проект Cloudflare OS, причем не как сервис, а как ospe source проект. Разворачиваем в своем аккаунте сами.
🔗 Тред анонса от техлида: https://x.com/KentonVarda/status/2084990137180590572
🔗 Оффсайт : https://os.cloudflare.app/
🔗 Блог: https://blog.cloudflare.com/cloudflare-os/
🔗 Гитхаб: https://github.com/cloudflare/cloudflare-os
Я довольно долго разбирался чего это за зверь и склоняюсь к мнению, что это изх видение способа запуска вабкодинга в компании, чтобы это не вызвало катастрофы с доступом к данным.
Это построенная повер workers система, ограничивающая не только запуск агентов, что в любом сендбоксе делается. Оригинальна тут концепция Gatekeepers - адаптеров доступа к данным, которые не только позволяют прочитать что либо, но и влияют далее на судьбу конкретного сендбокса. Это некий аналог и расширение MCP. Если в него были переданы какие либо чувствительные данные, то можно запретить шеринг этого сендбокса - то есть мы управляем еще и судьбой получателя данных.
Концепция "экземпляр приложения" на каждого пользователя с его данными - вроде бы тоже довольно оригинальна, они ее назвали Gadget. То есть это собственный код и данные, без разделения кода как в SaaS
Скорее это не про кодинг, а для дашбордов с корпоративными данными или мини-приложений уровня подразделения.
@deksden_notes
🔥5👍3❤2👎1🤯1
⚪️ Muse Code
Мета на годик выпала из большой ИИ гонки после факапа с ллама4 и полного обновления команды. Видимо, решено было использоватьновые нескучные обои новый бренд чтобы отстроиться от скандалов прощлого. Сейчас проискодит некоторый камбэк - выпуск модели Muse Spark 1.1/1.2 (примерный уровень грока 4.5, что вполне достойно), и нынче выпущен кодинговый агент Muse Code.
🔗 Блог: https://research.meta.ai/blog/introducing-muse-code-and-muse-spark-1-2
🔗 Оффсайт : https://developer.meta.com/ai/products/muse-code/
Основная фишка - помимо основного агентного цикла у агента есть фоновые агенты, которые расширяют возможности основного. Эти агенты не спавнятся как в других системах. Они остаются активными все время работы - идея в том, чтобы не тратить время на сбор контекста о проекте на каждую задачу.
Сессия позволяет возобновиться с места прерывания - тут ничего необычного не вижу, как у всех.
Встроенные скиллы /plan, /goal, /grill
Ценник: подписок нету. По токенам: $1.25/$4.25 ($0.15 кеш) или при условии отдавать на обучение свои данные - $0.10/$0.20 ($0.002 кеш). Ну - такое!..
👉 В общем, бенчи неплохие - пошли бы на воркеров во флоу, возможно. Идея долгоживущих воркеров оригинальна, хотя и требует подтверждения на практике (как там с компактом?), но без подписок смотреть как это работает по токенам при текущих ценах чего то не очень хочется.
@deksden_notes
Мета на годик выпала из большой ИИ гонки после факапа с ллама4 и полного обновления команды. Видимо, решено было использовать
🔗 Блог: https://research.meta.ai/blog/introducing-muse-code-and-muse-spark-1-2
🔗 Оффсайт : https://developer.meta.com/ai/products/muse-code/
Основная фишка - помимо основного агентного цикла у агента есть фоновые агенты, которые расширяют возможности основного. Эти агенты не спавнятся как в других системах. Они остаются активными все время работы - идея в том, чтобы не тратить время на сбор контекста о проекте на каждую задачу.
Сессия позволяет возобновиться с места прерывания - тут ничего необычного не вижу, как у всех.
Встроенные скиллы /plan, /goal, /grill
Ценник: подписок нету. По токенам: $1.25/$4.25 ($0.15 кеш) или при условии отдавать на обучение свои данные - $0.10/$0.20 ($0.002 кеш). Ну - такое!..
👉 В общем, бенчи неплохие - пошли бы на воркеров во флоу, возможно. Идея долгоживущих воркеров оригинальна, хотя и требует подтверждения на практике (как там с компактом?), но без подписок смотреть как это работает по токенам при текущих ценах чего то не очень хочется.
@deksden_notes
👍5❤1
⚪️ Agent Plugins
Новый 15й стандарт в агентном мире! Теперь - на плагины: пакуем скиллы и MCP вместе стандартным способом, который понимают несколько упряжек разных вендоров. Агентов пакануть туда все еще нельзя. Но есть Client extensions - посмотрим чего туда запихают разные упряжки, может, хуки и агентов?
🔗 Оффсайт: https://agent-plugins.org/
🔗 Гитхаб:
🔗 Анонс: https://x.com/OpenAIDevs/status/2085398373511918022
На момент старта совместимые упряжки:
• Codex
• ChatGPT
• Cursor
• Github Copilot
• Kiro
• VS Code
Vercel еще поддерживает
Конечно нет (и не будет?) антропиков. Остальные, надеюсь - подтянутся. Грок (? но он предпочитает клода копировать, не клозедов - по личным причинам). В общем, очередной стандарт
Хорошее начинание, конечно, но немного забавно
@deksden_notes
Новый 15й стандарт в агентном мире! Теперь - на плагины: пакуем скиллы и MCP вместе стандартным способом, который понимают несколько упряжек разных вендоров. Агентов пакануть туда все еще нельзя. Но есть Client extensions - посмотрим чего туда запихают разные упряжки, может, хуки и агентов?
🔗 Оффсайт: https://agent-plugins.org/
🔗 Гитхаб:
🔗 Анонс: https://x.com/OpenAIDevs/status/2085398373511918022
На момент старта совместимые упряжки:
• Codex
• ChatGPT
• Cursor
• Github Copilot
• Kiro
• VS Code
Vercel еще поддерживает
Конечно нет (и не будет?) антропиков. Остальные, надеюсь - подтянутся. Грок (? но он предпочитает клода копировать, не клозедов - по личным причинам). В общем, очередной стандарт
Хорошее начинание, конечно, но немного забавно
@deksden_notes
❤5🔥3🤔3👍2🥴2
⚪️ Grok Build Desktop
Слухи намекают, что ребята Маска скоро выпустят свойклон кодекс.апп трехпанельный десктопный ADE
Ну и хорошо! Ядро бы оставили какое у grok build, и было бы хорошо
Формат cli + app довольно удачный. cli все равно важен как ядро агента и иструмент автоматизации/headless/remote agent
Де факто, уже подходы к инстурментам нового поколения просматриваются
Я всё равно думаю линейка пока не закончена - нам нужно еще ядро для воркера на vps/vm/sandbox, и оркестратор этих удаленных облачных агентов. Но такого пока от вендоров не наблюдаю!
Ждем-с, смотрим
@deksden_notes
Слухи намекают, что ребята Маска скоро выпустят свой
Ну и хорошо! Ядро бы оставили какое у grok build, и было бы хорошо
Формат cli + app довольно удачный. cli все равно важен как ядро агента и иструмент автоматизации/headless/remote agent
Де факто, уже подходы к инстурментам нового поколения просматриваются
Я всё равно думаю линейка пока не закончена - нам нужно еще ядро для воркера на vps/vm/sandbox, и оркестратор этих удаленных облачных агентов. Но такого пока от вендоров не наблюдаю!
Ждем-с, смотрим
@deksden_notes
👍8🥴2😁1
⚪️ Kitesurf от Cloudflare
В полку агентных браузеров пополнение - Kitesurf от Cloudflare. Легче Хрома в 3-7x раз, работает на CF Worker, бесплатно пока в beta, работает в рамках сервиса Browser Run.
Сделали за 12 недель, вдохновлялись obscura, конечно написано на Rust (компилировано при запуске на воркере в wasm). Совместимо с CDP - потому на Browser Run как опция в существующем флоу идет к Puppeteer / Playwright.
Совместимость со стандартами: может запустить Doom - остальное не так важно.
🔗 Анонс: https://x.com/CloudflareDev/status/2085394318005846411
🔗 Блог: https://blog.cloudflare.com/kitesurf/
🔗 Дока: https://developers.cloudflare.com/browser-run/kitesurf/
🔗 Плейграунд: https://kitesurf.cloudflare.app/
Смотрим доку - там указано чего браузер может, как сравнить с Хромом и чего он не умеет (видео, webGL, ...).
👉 Кто какие новые браузеры последнего времени помнит? Их много)
@deksden_notes
В полку агентных браузеров пополнение - Kitesurf от Cloudflare. Легче Хрома в 3-7x раз, работает на CF Worker, бесплатно пока в beta, работает в рамках сервиса Browser Run.
Сделали за 12 недель, вдохновлялись obscura, конечно написано на Rust (компилировано при запуске на воркере в wasm). Совместимо с CDP - потому на Browser Run как опция в существующем флоу идет к Puppeteer / Playwright.
Совместимость со стандартами: может запустить Doom - остальное не так важно.
🔗 Анонс: https://x.com/CloudflareDev/status/2085394318005846411
🔗 Блог: https://blog.cloudflare.com/kitesurf/
🔗 Дока: https://developers.cloudflare.com/browser-run/kitesurf/
🔗 Плейграунд: https://kitesurf.cloudflare.app/
Смотрим доку - там указано чего браузер может, как сравнить с Хромом и чего он не умеет (видео, webGL, ...).
👉 Кто какие новые браузеры последнего времени помнит? Их много)
@deksden_notes
👍7❤2
⚪️ Codex v0.147.0
Вот и рыбный день принес новый апдейт CLI:
• поддержка нового стандарта agent plugin (логично!) - https://t.me/deksden_notes/1090
• прогрессивная загрузка сессий - должно побыстрее теперь работать
• approve-for-me флаг: но будте внимательнее, эта фича неплохо так токены тратит, хоть сейчас и на луне это экономичнее, но расход все равно считается заметным (!!!)
• улучшение взаимодействия с другими агентами - импортируем скиллы Cursor, синхронизируем сессии с Claude / Cursor;
• поддержка нового стандарта MCP 2026-07-28
• улучшения работы на Amazon Bedrock - компакт и кеширование веб поиска
Обновляемся!
@deksden_notes
Вот и рыбный день принес новый апдейт CLI:
• поддержка нового стандарта agent plugin (логично!) - https://t.me/deksden_notes/1090
• прогрессивная загрузка сессий - должно побыстрее теперь работать
• approve-for-me флаг: но будте внимательнее, эта фича неплохо так токены тратит, хоть сейчас и на луне это экономичнее, но расход все равно считается заметным (!!!)
• улучшение взаимодействия с другими агентами - импортируем скиллы Cursor, синхронизируем сессии с Claude / Cursor;
• поддержка нового стандарта MCP 2026-07-28
• улучшения работы на Amazon Bedrock - компакт и кеширование веб поиска
Обновляемся!
@deksden_notes
👍5❤3
⚪️ Grok Build 1.0.0
Вот и Grok Build дошел до условно стабильного релиза! Они его, конечно, удивительно бодро пилят, респект
Ждем-с Desktop еще для комплекта
@deksden_notes
Вот и Grok Build дошел до условно стабильного релиза! Они его, конечно, удивительно бодро пилят, респект
Ждем-с Desktop еще для комплекта
@deksden_notes
🔥3
⚪️ Бэклог новостей
Я веду себе своеобразный бэклог новостей, - когда встречаю что то достойное заметки в канал, я это фиксирую для дальнейшей проработки. Часто в итоге получается заметка в канале.
Нынче новинок вышло много, бэклог скопился такой:
• kiro crew
• CF: How Cloudflare enforces engineering standards using AI
• celld
• Open Design news + book
• role-model
• Ori Harness
• matt pockock skills v1.2 (?)
• takumi-pdf 0.2
• open-kimi-ppt-skill
• papr
• Prime Agent:
• cezar
• Playwright news
• DeepCode v2
• bb
👉 Нетерпеливые желающие могут нагуглить при необходимости самостоятельно и заценить сабжи!
Ну а я продолжу потихоньку постить заметки)
@deksden_notes
Я веду себе своеобразный бэклог новостей, - когда встречаю что то достойное заметки в канал, я это фиксирую для дальнейшей проработки. Часто в итоге получается заметка в канале.
Нынче новинок вышло много, бэклог скопился такой:
• kiro crew
• CF: How Cloudflare enforces engineering standards using AI
• celld
• Open Design news + book
• role-model
• Ori Harness
• matt pockock skills v1.2 (?)
• takumi-pdf 0.2
• open-kimi-ppt-skill
• papr
• Prime Agent:
• cezar
• Playwright news
• DeepCode v2
• bb
👉 Нетерпеливые желающие могут нагуглить при необходимости самостоятельно и заценить сабжи!
Ну а я продолжу потихоньку постить заметки)
@deksden_notes
👍7❤5🔥1🤩1👻1