Посоветовали интересную тулу в рабочем чатике. Kasetto. Если вы тоже работаете с несколькими агентами (кодекс, курсор, опенкод итд), часто пробуете новое, и конфигурация всех скилов, команд и mcp для новых приложений превращается в боль - можете попробовать. Закидываем все свои рабочие конфигурации в приватную гитхаб репу и получаем автосинк в одну команду для любого нового агента, декларативный конфиг, менеджмент всего в одном месте и актуальные апдейты.
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.
Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":
- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...
Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает🤷♂️
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.
Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":
- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...
Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает
Please open Telegram to view this post
VIEW IN TELEGRAM
Kasetto
Kasetto - Declarative AI Agent Environment Manager
Sync skills, MCP servers, slash-commands, and instructions from Git into Claude Code, Cursor, Codex, Copilot, and 18 more agents. One YAML file, lock-pinned, in Rust.
👍1
Интересный девопсовый ивент будет онлайн в июле
https://events.iacconf.com/designing-iac-interfaces-july-2026-spotlight/
https://events.iacconf.com/designing-iac-interfaces-july-2026-spotlight/
Iacconf
Designing IaC Interfaces That Work for Humans, AI Agents, and Whatever Comes Next
Most Terraform modules are designed to work, not to be consumed well. After applying interface design principles from A Philosophy of Software Design to modules used by non-infrastructure developers, Jinger saw less misuse, faster onboarding, and fewer direct…
Реальный батл GLM-5.2 vs Opus 4.7😮
Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉
❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
✅ GLM чаще валидирует результаты задачи, выполняет dual-platform валидейшн > Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)
✅ ✅ ✅ При том что GLM в пять раз дешевле Opus и опенсорс, а Anthropic - контора пидорасов , прям чистая победа Zhipu! 😁
https://x.com/RamaswmySridhar/status/2069460464371954171
Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉
❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)
https://x.com/RamaswmySridhar/status/2069460464371954171
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
sridhar (@RamaswmySridhar) on X
Early results from the @snowflake's coco team on GLM-5.2 vs Opus-4.7 on dbt-bench — what the trajectories actually show 🧵
👍2🌚1
Please open Telegram to view this post
VIEW IN TELEGRAM
В долгожданном мажорном релизе второй версии OpenCode они сделают общий бекенд для всех и консольных и десктопных клиентов. Можно будет работать над одними и теми же фичами любым удобным способом с бесшовынм переходом. Обещают минимальное использование ресурсов, наконец tool-search-tool с умной подгрузкой MCP для экономии контекста (был удивлен, что в опенкод этого еще нет). Судя по комментам - через неделю выкатят бету. ОЧЧень долгожданный для меня релиз! 🌡
https://x.com/thdxr/status/2071007637487894883
https://x.com/thdxr/status/2071007637487894883
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
dax (@thdxr) on X
in OpenCode v2 all instances of the tui and desktop and web share the same backend
so everything is synced by default and resource usaged is minimized no matter how many windows you have open
so everything is synced by default and resource usaged is minimized no matter how many windows you have open
🔥1
Антропик внедрила в клодкод spyware нацеленный на пользователей в азиатской таймзоне. Конечно они будут оправдываться про корпоративный анти-шпионаж и дистилляцию их моделей. Но вопрос доверия. Если есть не задокументированные внедрённые бекдоры - то будет такие же и от спецслужб, и корпоративные данные они будут сливать. Нет такой подлости на которую не пойдет капиталист ради иксов прибыли )
🔥1🌚1
Давно ничего не писал в блоге, переезд в новый дом, дни рождения. Со следующей недели точно начну писать регулярнее :)
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
The New Stack
“Code should be regenerated, not maintained”: Codeplain makes the case for spec-driven development
The phoenix of Greek myth burns and is reborn from its own ashes -- a metaphor this founder is applying to AI-generated code.
🔥4🌚1
А вот полезное! АИ агенты часто не могут спарсить сайты из за блока джава скрипта jina-ai ридер решает эту проблему. (а так же пдфки, картинки, другие доки) Пока бесплатно) Например
Стоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
https://r.jina.ai/https://exadel.comСтоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
GitHub
GitHub - jina-ai/reader: Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/
Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/ - jina-ai/reader
🔥1
Подключил сегодня в свой opencode GPT-5.6. Погонял Terra (high) на код ревью и фиксах. Слушайте, я первый раз в 2026 году кайфанул от модельки авторства большой тройки. Новая гопота реально классная!👍
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.😄 Отличное следование инструкциям, красивые лаконичные фиксы, скорость инфиренса как надо. Похоже я на ближайшее время перехожу на активную трату наших корпоративных OpenAI ключей 😁
Samа и команде OpenAI реальный респект за такой мощный релиз!🧠
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.
Samа и команде OpenAI реальный респект за такой мощный релиз!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Продолжаю сегодня тестить GPT-5.6. И эйфория от первого знакомства уже улетучилась... 🤨
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.
А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное
GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2
_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️
GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.
Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.
А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное
review MR https://git.***.com/r-d/exadel-***/-/merge_requests/566 summarize changes, highlight what is important from DevOps perspective GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2
_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️
GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.
Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
👍1
Kimi K3, frontier level модель от Moonshot уже в OpenCode Go. В 6 раз дороже GLM 5.2, и в 10 раз дороже прошлой Kimi K2.7.
Не очень юзабельно, модель скорее для того чтобы показать, что опенсорс может конкурировать с фронтиром.
Но потестить можно. Для ежедневной работы наверное излишне, для любых задач все равно хватает GLM+DeepSeek на любой подписке, или GPT Terra High если юзаете Codex.
Не очень юзабельно, модель скорее для того чтобы показать, что опенсорс может конкурировать с фронтиром.
Но потестить можно. Для ежедневной работы наверное излишне, для любых задач все равно хватает GLM+DeepSeek на любой подписке, или GPT Terra High если юзаете Codex.
🔥1
Запустил Kimi K3 для простейшего ресерча. Девы сделали для проекта e2e тесты, дал путь в репе, сказал сделать репорт что за тесты, как они работают, как конфигурируются, как потом лучше их интегрировать в CICD. 3 минуты работы, 60к токенов (из них половина - сис промпты и заголовки скилов, обычный контекст в начале любого чата), съело 3% месячного лимита 😆Прайсинг реально Опус-стайл 🤷♂️
Вывод приятно читается, все хорошо сттруктурированно, но в принципе как и у GLM/Kimi раньше, у них всегда была качественная подача информации. Контекст собирает правильно, смотрит файлы по всей цепочке интеграции и деплоя. Работает конечно медленно, показалось что даже медленнее GLM. Вобщем выглядит качественно - но медленно и дорого.
У нас на проекте анлим ключи на гпт, но раньше я их не использовал вообще, GPT 5.4-5.5 меня совсем не устраивали по своей работе. C выходом Сол и Терра ситуация поменялась, все чаще гоняю Терра как базовую модель и Сол если есть сложный баг и траблшутинг. Но когда нужен вдумчивый ресерч, доки или код ревью - по прежнему запускаю GLM 5.2, внимание к деталям и качественная подача без излишнего у нее все еще зе бест. Так что пока продолжу дальше использовать эту связку, Кими хоть и интересна, но мимо
Вывод: если вы интузиаст по новым моделям или у вас только подписки OpenCode или Ollama - новую Kimi K3 вполне можно иногда запускать, там где нужен интеллект фронтир модели. При цене в 3/15 - она все еще сильно дешевле Опуса и явно лучше. Где-то на уровне Терры при полной оплате за АПИ, но скорее всего лучше Терры.
Если вы максите эффективность сделанной работы к стоимости - новая Kimi выглядит излишней, как и любые фронтир модели. 95% задач можно успешно делать на последних Дипсик и GLM.
Вывод приятно читается, все хорошо сттруктурированно, но в принципе как и у GLM/Kimi раньше, у них всегда была качественная подача информации. Контекст собирает правильно, смотрит файлы по всей цепочке интеграции и деплоя. Работает конечно медленно, показалось что даже медленнее GLM. Вобщем выглядит качественно - но медленно и дорого.
У нас на проекте анлим ключи на гпт, но раньше я их не использовал вообще, GPT 5.4-5.5 меня совсем не устраивали по своей работе. C выходом Сол и Терра ситуация поменялась, все чаще гоняю Терра как базовую модель и Сол если есть сложный баг и траблшутинг. Но когда нужен вдумчивый ресерч, доки или код ревью - по прежнему запускаю GLM 5.2, внимание к деталям и качественная подача без излишнего у нее все еще зе бест. Так что пока продолжу дальше использовать эту связку, Кими хоть и интересна, но мимо
Вывод: если вы интузиаст по новым моделям или у вас только подписки OpenCode или Ollama - новую Kimi K3 вполне можно иногда запускать, там где нужен интеллект фронтир модели. При цене в 3/15 - она все еще сильно дешевле Опуса и явно лучше. Где-то на уровне Терры при полной оплате за АПИ, но скорее всего лучше Терры.
Если вы максите эффективность сделанной работы к стоимости - новая Kimi выглядит излишней, как и любые фронтир модели. 95% задач можно успешно делать на последних Дипсик и GLM.
Please open Telegram to view this post
VIEW IN TELEGRAM
Вышел Qwen 3.8, еще одна модель Fable-class. Похоже теперь модели уровня фейбл - это базовый уровень как для закрытых так и для oss моделей :) Отставание в месяц уже невелировалось, модели схожего уровня у США и Китая теперь выходят почти одновременно.
Инвесторы твиттят что-все-пропало, предрекая крах штатовскому аи-рынку, так как все пересядут на модели такого же качества но в 5 раз дешевле. Думаю лукавят, все знают что есть комплаенс, и корпораты будут вынуждены (пока) платить в Х раз больше, просто потому что штатовские компании (якобы) обещают не сливать их данные.
Так что у Альтмана с Амодеем кастомеры будут, но триллионные оценки явно под вопросом. Китай теперь настоящий конкурент (и имхо это круто, китайские инженеры реально делают крутые штуки на энтузиазме, как в старые добрые :) )
Инвесторы твиттят что-все-пропало, предрекая крах штатовскому аи-рынку, так как все пересядут на модели такого же качества но в 5 раз дешевле. Думаю лукавят, все знают что есть комплаенс, и корпораты будут вынуждены (пока) платить в Х раз больше, просто потому что штатовские компании (якобы) обещают не сливать их данные.
Так что у Альтмана с Амодеем кастомеры будут, но триллионные оценки явно под вопросом. Китай теперь настоящий конкурент (и имхо это круто, китайские инженеры реально делают крутые штуки на энтузиазме, как в старые добрые :) )
X (formerly Twitter)
Alex Finn (@AlexFinn) on X
We live in a new world. Open source has officially caught up to frontier
Qwen 3.8 is out, and it’s better than ChatGPT 5.6
6 months ago I told you to start buying hardware. Prices would explode and open source was going to catch up
Both happened.
Anthropic…
Qwen 3.8 is out, and it’s better than ChatGPT 5.6
6 months ago I told you to start buying hardware. Prices would explode and open source was going to catch up
Both happened.
Anthropic…
🔥1
Мистер "оверинженер" вернулся. Простая задача "девелоперы поменяли переменную окружения, поменяй ее в наших девопсовых конфигах и доках" причем с нормальным контекстом, скинул оригинальный запрос от девелоперов. А Гопота (причем Terra, а не Sol) решила переработать вообще все приложение и тесты, где есть какие-либо пересечения с этой переменной.
Пришлось звать на помощь GLM, чтобы он откатил изменения и сделал нормальный скоуп. Ну вот блин, вроде Sol/Terra - умные модели, можно же переспросить пользователя если есть сомнения что менять. Почему с GLM/Kimi/DeepSeek вообще никогда нет проблем что они меняют тебе весь проект не поняв твою задачу? Блин, вот есть желание нафиг выключить OpenAI провайдера после таких косяков и переделок 🤬
Пришлось звать на помощь GLM, чтобы он откатил изменения и сделал нормальный скоуп. Ну вот блин, вроде Sol/Terra - умные модели, можно же переспросить пользователя если есть сомнения что менять. Почему с GLM/Kimi/DeepSeek вообще никогда нет проблем что они меняют тебе весь проект не поняв твою задачу? Блин, вот есть желание нафиг выключить OpenAI провайдера после таких косяков и переделок 🤬
🌚1