AI vs DevOps
138 subscribers
206 photos
1 video
119 links
DevOps и системная инженерия в эпоху AI. Новости индустрии. И немного юмора.
Download Telegram
#работа ⚠️Кстати мы тут сейчас себе в команду ищем DevOps/AI падавана, помогать с кастомер интеграциями одного из наших AI продуктов, на AWS и Azure. По навыкам - базовые понимания Azure или AWS сервисов, понимание контейнеризации и CI/CD, k8s на уровне пользователя. Уровень - толковый джун с горящими глазами или мидл. Фул ремоут. ЗП - по рынку. Навыки ежедневного использования AI инструментов - мастхев.
Пишите в личку, пообщаемся - и закину напрямую на тех собес, минуя бюрократию HR отдела 👍

Оффициальная вакансия тут
Непопулярное мнение (навеяное сегодняшним хайпом в сети на тему Looping) - считаю что 90% всех этих новомодных техник и практик AI разработки от OpenAI Anthropic Google, которые со щенячим восторгом подхватывает комьюнити, на самом деле имеют лишь одну цель. Придумать сто пятьсот изящных способов рассказать хомяку, как ему с улыбочкой сжигать как можно больше токенов и выходить на все более дорогие подписки, а еще лучше подтолкнуть их компании оплачивать все больше и больше $$$ по счетам за токены.

Мултиагенты, ральфы, динамик воркфлоус, лупинги и залупинги - меньше думай, больше жги токены.😄

Ценность имеют только практики от комьюнити или сервис интеграторов - то есть от тех, чей бизнес не заинтересован впарить тебе токенмаксинг в той или иной обертке. А заинтересован в результате. Для кого АИ - инструмент и статья расходов.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2🌚1
Чуть что - сейчас начинается Gitlab Transcend конфа. Посмотрим что нового на АИ тематику в мире корпоративных SDLC тулов появилось :)
🌚1
Я даже не знаю это в юмор или в "запомнили и записали", но смекалка отлично работает у людей)
🔥2
The flood of code is here. Engineers are writing twice as much code as they did just six months ago. Cursor says PR sizes tripled since January for top users, and Jellyfish found heavy AI adopters push twice as many PRs, with 72% of their code AI-assisted. Pragmatic Engineer's Gergely Orosz then points out in his breakdown that AI coding reached every industry, including automotive, in under a year.

Technical debt is piling up. Reviewers can't keep up, so most hit "LGTM" (looks good to me) without reading, while the few who still review are burning out. OpenCode's Dax Raad says AI mutes the guilt of shipping a hack, so the instinct to clean up debt never fires. The fallout: Amazon mandated senior sign-offs after AI-assisted changes caused outages, Windows 11 updates bricked devices, and third-party trackers put GitHub's uptime below one nine as agent traffic overwhelmed its infrastructure.

The fix is boring. The 2025 DORA report found AI amplifies whatever system you already have: some companies doubled their incidents, others cut them in half. The winners run the old playbook:

* OpenCode CEO brought back heavy domain-driven design because agents need guardrails.

* Veteran engineer Kent Beck uses tests to stop agents from shipping regressions.

* Amazon put a human checkpoint before production.


Ого, инженеры начинают замечать, что все больше слопа уходит в прод? "А кто это сдееелал?.."😄 И оказывается старые добрые SDD, TDD, DDD, а так же массовые автотесты на каждый чих в свое время придумали не просто так.
Вот таким заявлениям таких инженеров мы верим. 👍 А когда продавцы токенов придумывают лупинги чтобы вы покупали у них лярды токенов и не глядя шипали миллионы строк кода в прод - не верим.🙅🏿‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Да, да, да! Главный релиз месяца (для меня😎), дождались 🥳
Жду у провайдеров, подробный обзор на следующей неделе 💯

Kimi.ai just announced the release and open-sourcing of their latest coding model, Kimi-K2.7-Code?
They are claiming some pretty substantial upgrades over their previous K2.6 version, even throwing up some benchmark charts comparing it to GPT-5.5 and Opus 4.8.
The Key Highlights:
- Big Benchmark Jumps: They are reporting +21.8% on Kimi Code Bench v2, +11.0% on Program Bench, and a massive +31.5% on MLS Bench Lite compared to K2.6.
- Better Efficiency: They claim "less overthinking" with 30% lower reasoning overhead (though they had a little typo in the tweet calling it "reasred").
- Long-Horizon Coding: Improved instruction following and higher success rates for complex, end-to-end coding tasks.
- Speed: A 6x High-Speed Mode is apparently right around the corner.

Please open Telegram to view this post
VIEW IN TELEGRAM
Я тут сейчас активно тестирую Open Code Review от Alibaba. Это их внутренний тул, который они развивали уже не один год, а сейчас выпустили в опенсорс. Обьединяет все лучшее двух миров - детерминированный код сканнер, чтобы четко проходить по всем файлам и депенденси, и АИ ревью для найденных участков.
Ставим cli приложение, подключаем LLM (есть поддержка любых провайдеров), ставим скил, пишем "make a code review for this mr/branch/commit using open-code-review skill" и погнали 👍

Впечатления вырисовываются классные. Сначала мне не сильно понравился сухой формат отчетов, но после разных тестов вижу что оно действительно находит проблемы лучше других тулов. Сейчас это все обьеденяю со стилизацией моих обычных код ревью, с severity, refactoring opportunity, learning materials ит.д. Будет классно 🌡

На следующей неделе напишу подробную статью. Пробуйте, рекомендую

https://github.com/alibaba/open-code-review
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
Тадаам! 🥳
GLM-5.2 вышла, на всех Zai кодинг планах. Миллион контекста наконец. И явно лучшая модель в опенсорсе! Вместе с Кими 2.7 считай стек обновился на новый уровень 🔥
С понедельника буду тестировать, как раз есть под это задачи😎 Через неделю добавят в опенсорс и появится у сторонних провайдеров.
Обзор ситуации с Fable от человека очень близкого ко всей внутренней кухне. Этот дядька - довольно известный тех инвестор, а нынче - глава комиссии в правительсте Трампа по науке и технологиям.

В двух словах - Антропик позиционировали себя как safety-first компания и заявляли что их mythos - это считай cyberweapon. Но когда она зарелизили Fable - возникла история с джейлбрейком. Причем это не информация из интернета от ноунеймов, а инфа от компании/институции которой очень доверяет и US Govt. и сами Anthropic, и которые принимали участие в ранних тестах Mythos. Дарио предложили - вы же за сайфети, ситуация следуя вашей логике - опасная, снимайте модель с релиза и чините проблемы. Он отказалася. "Ну а что еще могла сделать самая циничная и лживая компания на рынке?😆" Наверное фикс не такой простой и быстрый, а бабки с модели грести - важнее😄. Получил по щам, модель сняли регуляторным методом.

При этом правительство не против ее разблочить, если Антропик порешают все проблемы. Это не многоходовчка и не "попытка сделать топовые аи модели национальным достоянием отгородившись от всего мира". Такие дела 🤷‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔2
По слухам сейчас каждая компания, у которой есть ярдные бюджеты, готовит замену GitHub для АИ-агентов 😁
Кстати, после запуска Kimi K2.7 Code вся супер быстрая скорость у Муншот провайдера пропала, и что новая модель , что прошлая Kimi K2.6 теперь работает на обычной скорости, чуть медленнее дипсика. Это очень жалко конечно, когда она летала на 100+ tps это реально было круто и моделью хотелось пользоваться. Сейчас же все стало обычно и новый релиз K2.7 меня не впечатлил. Вообще не замечаю разницу с прошлой версией. Вроде как новая должна меньше потреблять токенов, но по факту потребляет много, точно не меньше 2.6, и по факту на тех же задачах выходит раза 4 больше чем Дипсик. Замечаю что для простых задач все чаще запускаю дипсик про, чтобы сэкономить расходы лимитов.🤷‍♂️

А вот что меня впеатлило - это GLM 5.2 Можете кидаться тряпками, но она сейчас реально на уровне последнего Opus. Сравнивал на подгтовке спек для новых фич - GLM даже лучше ведет с вопросами по требованиям и дизайну, реально. Ну и конечно не жрет по $3-5 за одну подгтовку спек или ревью кода, как это делает Opus 4.8 в Курсор подписке.

Вобщем Zai не разочаровали и новая модель - это опять ощутимый скачок вперед 🌡 А вот Moonshot получает минус вайб 😄
Please open Telegram to view this post
VIEW IN TELEGRAM
У нас тут в компании намечается партнерка с Курсором, через 10 дней тренинг, не могу не похвастаться 😎 После тренинга - расскажу какие были интересные и полезные тейки здесь в канале обязательно 🌡
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
Теперь вы можете помогать развитию опенсорс агентов даже работая в проприетарном codex или claude code. Инициатива от Trace Commons Foundation. Ставите /donate-trace скил одной командой через npx, запускаете скил - и делаете трейсы по вашим данным достоянием общественности, а не только одной компании производителя вашего кодинг агента :) Но конечно испольуйте только если кодите какие-то свои пет проекты или опенсорс, приватные данные со своей работы отправлять не стоит, да и агент сразу не позволит. Там стоят guardrails и если в сессии есть приватный коммерческий код, агент сразу так все не отправит. Грамотно!
👍1🔥1
Посоветовали интересную тулу в рабочем чатике. Kasetto. Если вы тоже работаете с несколькими агентами (кодекс, курсор, опенкод итд), часто пробуете новое, и конфигурация всех скилов, команд и mcp для новых приложений превращается в боль - можете попробовать. Закидываем все свои рабочие конфигурации в приватную гитхаб репу и получаем автосинк в одну команду для любого нового агента, декларативный конфиг, менеджмент всего в одном месте и актуальные апдейты.
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.

Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":

- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...

Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает 🤷‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Новость дня
🌚3
Тео как всегда жжот 😁 кстати, максимально рекомендую его Ютуб видосы
Реальный батл GLM-5.2 vs Opus 4.7😮

Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉

❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
✅GLM чаще валидирует результаты задачи, выполняет dual-platform валидейшн > Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)


✅✅✅При том что GLM в пять раз дешевле Opus и опенсорс, а Anthropic - контора пидорасов, прям чистая победа Zhipu! 😁

https://x.com/RamaswmySridhar/status/2069460464371954171
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🌚1
Привет, коллеги, максимально продуктивного вам начала рабочей недели 🦾🧠
Please open Telegram to view this post
VIEW IN TELEGRAM
В долгожданном мажорном релизе второй версии OpenCode они сделают общий бекенд для всех и консольных и десктопных клиентов. Можно будет работать над одними и теми же фичами любым удобным способом с бесшовынм переходом. Обещают минимальное использование ресурсов, наконец tool-search-tool с умной подгрузкой MCP для экономии контекста (был удивлен, что в опенкод этого еще нет). Судя по комментам - через неделю выкатят бету. ОЧЧень долгожданный для меня релиз! 🌡

https://x.com/thdxr/status/2071007637487894883
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Интересное наблюдение по текущим трендам.

Уже даже кровавый тырпрайз начинает понимать, что скидываться альтману и итальяшке на новые датацентры платя х5 чеки за продукт дающий прирост на 5% качества - пусть и поощеряемая в "высоком обществе", но не самая выгодная для бизнеса стратегия 😄