AI vs DevOps
138 subscribers
206 photos
1 video
119 links
DevOps и системная инженерия в эпоху AI. Новости индустрии. И немного юмора.
Download Telegram
По слухам сейчас каждая компания, у которой есть ярдные бюджеты, готовит замену GitHub для АИ-агентов 😁
Кстати, после запуска Kimi K2.7 Code вся супер быстрая скорость у Муншот провайдера пропала, и что новая модель , что прошлая Kimi K2.6 теперь работает на обычной скорости, чуть медленнее дипсика. Это очень жалко конечно, когда она летала на 100+ tps это реально было круто и моделью хотелось пользоваться. Сейчас же все стало обычно и новый релиз K2.7 меня не впечатлил. Вообще не замечаю разницу с прошлой версией. Вроде как новая должна меньше потреблять токенов, но по факту потребляет много, точно не меньше 2.6, и по факту на тех же задачах выходит раза 4 больше чем Дипсик. Замечаю что для простых задач все чаще запускаю дипсик про, чтобы сэкономить расходы лимитов.🤷‍♂️

А вот что меня впеатлило - это GLM 5.2 Можете кидаться тряпками, но она сейчас реально на уровне последнего Opus. Сравнивал на подгтовке спек для новых фич - GLM даже лучше ведет с вопросами по требованиям и дизайну, реально. Ну и конечно не жрет по $3-5 за одну подгтовку спек или ревью кода, как это делает Opus 4.8 в Курсор подписке.

Вобщем Zai не разочаровали и новая модель - это опять ощутимый скачок вперед 🌡 А вот Moonshot получает минус вайб 😄
Please open Telegram to view this post
VIEW IN TELEGRAM
У нас тут в компании намечается партнерка с Курсором, через 10 дней тренинг, не могу не похвастаться 😎 После тренинга - расскажу какие были интересные и полезные тейки здесь в канале обязательно 🌡
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
Теперь вы можете помогать развитию опенсорс агентов даже работая в проприетарном codex или claude code. Инициатива от Trace Commons Foundation. Ставите /donate-trace скил одной командой через npx, запускаете скил - и делаете трейсы по вашим данным достоянием общественности, а не только одной компании производителя вашего кодинг агента :) Но конечно испольуйте только если кодите какие-то свои пет проекты или опенсорс, приватные данные со своей работы отправлять не стоит, да и агент сразу не позволит. Там стоят guardrails и если в сессии есть приватный коммерческий код, агент сразу так все не отправит. Грамотно!
👍1🔥1
Посоветовали интересную тулу в рабочем чатике. Kasetto. Если вы тоже работаете с несколькими агентами (кодекс, курсор, опенкод итд), часто пробуете новое, и конфигурация всех скилов, команд и mcp для новых приложений превращается в боль - можете попробовать. Закидываем все свои рабочие конфигурации в приватную гитхаб репу и получаем автосинк в одну команду для любого нового агента, декларативный конфиг, менеджмент всего в одном месте и актуальные апдейты.
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.

Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":

- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...

Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает 🤷‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Новость дня
🌚3
Тео как всегда жжот 😁 кстати, максимально рекомендую его Ютуб видосы
Реальный батл GLM-5.2 vs Opus 4.7😮

Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉

❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
✅GLM чаще валидирует результаты задачи, выполняет dual-platform валидейшн > Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)


✅✅✅При том что GLM в пять раз дешевле Opus и опенсорс, а Anthropic - контора пидорасов, прям чистая победа Zhipu! 😁

https://x.com/RamaswmySridhar/status/2069460464371954171
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🌚1
Привет, коллеги, максимально продуктивного вам начала рабочей недели 🦾🧠
Please open Telegram to view this post
VIEW IN TELEGRAM
В долгожданном мажорном релизе второй версии OpenCode они сделают общий бекенд для всех и консольных и десктопных клиентов. Можно будет работать над одними и теми же фичами любым удобным способом с бесшовынм переходом. Обещают минимальное использование ресурсов, наконец tool-search-tool с умной подгрузкой MCP для экономии контекста (был удивлен, что в опенкод этого еще нет). Судя по комментам - через неделю выкатят бету. ОЧЧень долгожданный для меня релиз! 🌡

https://x.com/thdxr/status/2071007637487894883
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Интересное наблюдение по текущим трендам.

Уже даже кровавый тырпрайз начинает понимать, что скидываться альтману и итальяшке на новые датацентры платя х5 чеки за продукт дающий прирост на 5% качества - пусть и поощеряемая в "высоком обществе", но не самая выгодная для бизнеса стратегия 😄
Антропик внедрила в клодкод spyware нацеленный на пользователей в азиатской таймзоне. Конечно они будут оправдываться про корпоративный анти-шпионаж и дистилляцию их моделей. Но вопрос доверия. Если есть не задокументированные внедрённые бекдоры - то будет такие же и от спецслужб, и корпоративные данные они будут сливать. Нет такой подлости на которую не пойдет капиталист ради иксов прибыли )
🔥1🌚1
Давно ничего не писал в блоге, переезд в новый дом, дни рождения. Со следующей недели точно начну писать регулярнее :)

За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!

Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
🔥4🌚1
А вот полезное! АИ агенты часто не могут спарсить сайты из за блока джава скрипта jina-ai ридер решает эту проблему. (а так же пдфки, картинки, другие доки) Пока бесплатно) Например
https://r.jina.ai/https://exadel.com

Стоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
🔥1
У нас тут компания помимо Курсора (с кем мы уже партнеры с понедельника) вроде как думает партнерится с Антропик (бля🙈). Позвали на какой-то вебинар "Inside Anthropic partner academy". Сижу и слушаю, как они уже 25 минут рекламируют fable и sonnet 5... 🤪
🔥2
Подключил сегодня в свой opencode GPT-5.6. Погонял Terra (high) на код ревью и фиксах. Слушайте, я первый раз в 2026 году кайфанул от модельки авторства большой тройки. Новая гопота реально классная!👍
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.😄 Отличное следование инструкциям, красивые лаконичные фиксы, скорость инфиренса как надо. Похоже я на ближайшее время перехожу на активную трату наших корпоративных OpenAI ключей 😁

Samа и команде OpenAI реальный респект за такой мощный релиз! 🧠
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Продолжаю сегодня тестить GPT-5.6. И эйфория от первого знакомства уже улетучилась... 🤨
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.

А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное review MR https://git.***.com/r-d/exadel-***/-/merge_requests/566 summarize changes, highlight what is important from DevOps perspective
GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2

_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️

GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.

Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
👍1