По слухам сейчас каждая компания, у которой есть ярдные бюджеты, готовит замену GitHub для АИ-агентов 😁
Кстати, после запуска Kimi K2.7 Code вся супер быстрая скорость у Муншот провайдера пропала, и что новая модель , что прошлая Kimi K2.6 теперь работает на обычной скорости, чуть медленнее дипсика. Это очень жалко конечно, когда она летала на 100+ tps это реально было круто и моделью хотелось пользоваться. Сейчас же все стало обычно и новый релиз K2.7 меня не впечатлил. Вообще не замечаю разницу с прошлой версией. Вроде как новая должна меньше потреблять токенов, но по факту потребляет много, точно не меньше 2.6, и по факту на тех же задачах выходит раза 4 больше чем Дипсик. Замечаю что для простых задач все чаще запускаю дипсик про, чтобы сэкономить расходы лимитов.🤷♂️
А вот что меня впеатлило - это GLM 5.2 Можете кидаться тряпками, но она сейчас реально на уровне последнего Opus. Сравнивал на подгтовке спек для новых фич - GLM даже лучше ведет с вопросами по требованиям и дизайну, реально. Ну и конечно не жрет по $3-5 за одну подгтовку спек или ревью кода, как это делает Opus 4.8 в Курсор подписке.
Вобщем Zai не разочаровали и новая модель - это опять ощутимый скачок вперед🌡 А вот Moonshot получает минус вайб 😄
А вот что меня впеатлило - это GLM 5.2 Можете кидаться тряпками, но она сейчас реально на уровне последнего Opus. Сравнивал на подгтовке спек для новых фич - GLM даже лучше ведет с вопросами по требованиям и дизайну, реально. Ну и конечно не жрет по $3-5 за одну подгтовку спек или ревью кода, как это делает Opus 4.8 в Курсор подписке.
Вобщем Zai не разочаровали и новая модель - это опять ощутимый скачок вперед
Please open Telegram to view this post
VIEW IN TELEGRAM
У нас тут в компании намечается партнерка с Курсором, через 10 дней тренинг, не могу не похвастаться 😎 После тренинга - расскажу какие были интересные и полезные тейки здесь в канале обязательно 🌡
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
Теперь вы можете помогать развитию опенсорс агентов даже работая в проприетарном codex или claude code. Инициатива от Trace Commons Foundation. Ставите /donate-trace скил одной командой через npx, запускаете скил - и делаете трейсы по вашим данным достоянием общественности, а не только одной компании производителя вашего кодинг агента :) Но конечно испольуйте только если кодите какие-то свои пет проекты или опенсорс, приватные данные со своей работы отправлять не стоит, да и агент сразу не позволит. Там стоят guardrails и если в сессии есть приватный коммерческий код, агент сразу так все не отправит. Грамотно!
Trace Commons
Trace Commons · An open commons for code agent traces
An open commons for understanding how coding agents work. Donate your coding-agent sessions to one open public dataset anyone can study and build on.
👍1🔥1
Посоветовали интересную тулу в рабочем чатике. Kasetto. Если вы тоже работаете с несколькими агентами (кодекс, курсор, опенкод итд), часто пробуете новое, и конфигурация всех скилов, команд и mcp для новых приложений превращается в боль - можете попробовать. Закидываем все свои рабочие конфигурации в приватную гитхаб репу и получаем автосинк в одну команду для любого нового агента, декларативный конфиг, менеджмент всего в одном месте и актуальные апдейты.
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.
Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":
- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...
Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает🤷♂️
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.
Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":
- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...
Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает
Please open Telegram to view this post
VIEW IN TELEGRAM
Kasetto
Kasetto - Declarative AI Agent Environment Manager
Sync skills, MCP servers, slash-commands, and instructions from Git into Claude Code, Cursor, Codex, Copilot, and 18 more agents. One YAML file, lock-pinned, in Rust.
👍1
Интересный девопсовый ивент будет онлайн в июле
https://events.iacconf.com/designing-iac-interfaces-july-2026-spotlight/
https://events.iacconf.com/designing-iac-interfaces-july-2026-spotlight/
Iacconf
Designing IaC Interfaces That Work for Humans, AI Agents, and Whatever Comes Next
Most Terraform modules are designed to work, not to be consumed well. After applying interface design principles from A Philosophy of Software Design to modules used by non-infrastructure developers, Jinger saw less misuse, faster onboarding, and fewer direct…
Реальный батл GLM-5.2 vs Opus 4.7😮
Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉
❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
✅ GLM чаще валидирует результаты задачи, выполняет dual-platform валидейшн > Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)
✅ ✅ ✅ При том что GLM в пять раз дешевле Opus и опенсорс, а Anthropic - контора пидорасов , прям чистая победа Zhipu! 😁
https://x.com/RamaswmySridhar/status/2069460464371954171
Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉
❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)
https://x.com/RamaswmySridhar/status/2069460464371954171
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
sridhar (@RamaswmySridhar) on X
Early results from the @snowflake's coco team on GLM-5.2 vs Opus-4.7 on dbt-bench — what the trajectories actually show 🧵
👍2🌚1
Please open Telegram to view this post
VIEW IN TELEGRAM
В долгожданном мажорном релизе второй версии OpenCode они сделают общий бекенд для всех и консольных и десктопных клиентов. Можно будет работать над одними и теми же фичами любым удобным способом с бесшовынм переходом. Обещают минимальное использование ресурсов, наконец tool-search-tool с умной подгрузкой MCP для экономии контекста (был удивлен, что в опенкод этого еще нет). Судя по комментам - через неделю выкатят бету. ОЧЧень долгожданный для меня релиз! 🌡
https://x.com/thdxr/status/2071007637487894883
https://x.com/thdxr/status/2071007637487894883
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
dax (@thdxr) on X
in OpenCode v2 all instances of the tui and desktop and web share the same backend
so everything is synced by default and resource usaged is minimized no matter how many windows you have open
so everything is synced by default and resource usaged is minimized no matter how many windows you have open
🔥1
Антропик внедрила в клодкод spyware нацеленный на пользователей в азиатской таймзоне. Конечно они будут оправдываться про корпоративный анти-шпионаж и дистилляцию их моделей. Но вопрос доверия. Если есть не задокументированные внедрённые бекдоры - то будет такие же и от спецслужб, и корпоративные данные они будут сливать. Нет такой подлости на которую не пойдет капиталист ради иксов прибыли )
🔥1🌚1
Давно ничего не писал в блоге, переезд в новый дом, дни рождения. Со следующей недели точно начну писать регулярнее :)
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
The New Stack
“Code should be regenerated, not maintained”: Codeplain makes the case for spec-driven development
The phoenix of Greek myth burns and is reborn from its own ashes -- a metaphor this founder is applying to AI-generated code.
🔥4🌚1
А вот полезное! АИ агенты часто не могут спарсить сайты из за блока джава скрипта jina-ai ридер решает эту проблему. (а так же пдфки, картинки, другие доки) Пока бесплатно) Например
Стоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
https://r.jina.ai/https://exadel.comСтоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
GitHub
GitHub - jina-ai/reader: Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/
Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/ - jina-ai/reader
🔥1
Подключил сегодня в свой opencode GPT-5.6. Погонял Terra (high) на код ревью и фиксах. Слушайте, я первый раз в 2026 году кайфанул от модельки авторства большой тройки. Новая гопота реально классная!👍
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.😄 Отличное следование инструкциям, красивые лаконичные фиксы, скорость инфиренса как надо. Похоже я на ближайшее время перехожу на активную трату наших корпоративных OpenAI ключей 😁
Samа и команде OpenAI реальный респект за такой мощный релиз!🧠
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.
Samа и команде OpenAI реальный респект за такой мощный релиз!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Продолжаю сегодня тестить GPT-5.6. И эйфория от первого знакомства уже улетучилась... 🤨
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.
А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное
GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2
_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️
GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.
Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.
А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное
review MR https://git.***.com/r-d/exadel-***/-/merge_requests/566 summarize changes, highlight what is important from DevOps perspective GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2
_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️
GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.
Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
👍1