AI vs DevOps
138 subscribers
206 photos
1 video
119 links
DevOps и системная инженерия в эпоху AI. Новости индустрии. И немного юмора.
Download Telegram
Короткий recap постов в X на ближайшую неделю
А вот Zhipu дарит unlimited флэш в ZCode до 20 сентября. Хороший подгончик. Для меня, если честно, флэш закрывает сейчас почти всю работу, даже для какого-то планинга или архитектурного ресерча. Иногда забываю переключиться на большую модель и результат все равно хороший.
Попробую реально таким образом потестить Прыму Астру когда раскатят доступ по апи.

give Astra your session and project history across Claude, Codex, Hermes and any other agent you use

ask it to find:

> prompts you repeat across sessions
> manual steps that should become scripts or integrations
> repeatable workflows that should become skills
> corrections that belong in project instructions
> scheduled work that should become cron jobs
> files or steps where sessions repeatedly stop
Забавный момент :) Nvidia купила Huggingface за $12,930,300,000

Если перевести число 129303 в Unicode - то получим смайл логотип хагинфейса 🤗
А в если в Hex - то получим зелёный цвет лого Nvidia ))
🦄3🤔1
Если вы, как и я, не тратили 5 часов своей жизни на интервью DHH у Лекса Фридмана, то вот выше качественная саммари (мне реально качество понравилось, там внутри какой-то пайплайн?), где, думаю, есть всё главное за 15 минут чтения 👍
🔥2
Если вдруг суботним вечером вместо пива тестируете Astra (но лучше конечно совместить 🍻), то для нее лучше ставить medium effort, максимум high.
🔥3
Прям нонконформизм 😀
Хорошо прослеживается взаимосвязь с тем, как модели за прошедший год становятся все более подходящими для кодинга 😎
Please open Telegram to view this post
VIEW IN TELEGRAM
Кто-то уже проходил эту "текстовую ролевую игру"? 😁Я просто ору чайкой с нее 🤣

https://opusfived.dev/
Коллеги, чем вы делаете код ревью?

У нас проекте ревью кодексом, для которого тим лид команды разрабов написал промпт на 500 строк, всех задолбал. Промпт ужасный, но чел считает что это самое красивое решение во вселенной, и уже два месяца игнорит люыбе вопросы на эту тему 😅С этим промптом кодекс в пайплайне всегда находит только 1-2 проблемы. А остальное - только в следующем пайплайне когда ты запушил фиксы. Я тут недавно поставил на среднем по размеру MR на ночь /goal и офигел, понадобилось 12 (!!!) пайплайнов чтобы этот болван наконец-таки поставил апрув 🤬 Ну и очень дохера false positives, по итогу этому ревь никто не верит и все ревьювают сами. А токены и время жгутся без пользы.

Вобщем раз разрабов убедить в том что надо что-то менять не получается (а по хорошему надо менять многое. Писать обвязку чтобы разибвать PR по файлам, ревьювать как отдельно каждый файл, так и все вместе по импортам и логике внутри системы в целом, добавлять примеры и few shot-ы, добавлять тесты и отлавливать false positives, смотреть что девелоперы чаще отклоняют итд итп), поговорил с leadership, признали проблему, и решили внедрить какую нибудь готовую классную тулу для ревью с рынка.
Я вот лично юзаю Alibaba OCR с GPT 5.6 Sol ключом, и меня все устраивает. Но американская компания не согласиться ставить у себя и особенно для кастомеров китайский софт 😄 Какие есть варианты?
Слышал про опенсорсный pr-af, позиционируют себя как лучшие из лучших (но чот сомневаюсь). Есть из платных CodeRabbit и Graphite. Может у вас есть свой опыт с подобными системами? Заранее благодарен за шеринг 🤝
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔3
Коллеги, я просто в афиге с новой DeepSeek V4.1 Flash. 🤯 Делал тут одну фичу, прогнал код ревью Астрой - нормально все нашла как надо (4 medium, 2 low, 1 refactoring). Второй раунд в новой сессии Sol - еще три медиум ишуи, починил. По приколу запустил DS4.1 - 8 issues которые пропустила Astra и Sol 😳(4 med, 4 low), и 5 советов по рефакторингу. На том же промпте в новой сессии. Только одна оказалась false positive, остальные актуальны.

При этом модель очень быстрая, аутпуты пишет грамотно... Вобщем это заявка на то чтобы потестить ее серьезнее на разных задачах. Очень интересно... 🤔
👍5
Ну что там, опять Дарио и Маск пугают концом интернета?)
Продуктивной недели, коллеги! Помните, кто вам друк, а кто нидрук ))
🔥2
Насчет code review тулов - буду чекать PR-Agent, CodeRabbit, OCR, Claude Code built-in review. Но клод походу уже отваливается, потому что не умеет нативно в OpenAI модели, которые у нас дефолт на проекте, только через прокси типа LiteLLM/CLIProxy, ну и не понятно зачем нам такое усложнение менеджить в пайплайнах и агентах. Так что сегодня стартую три варианта. По итогу расскажу какие результаты и что понравилось больше.
👍3
У просьбы о гос регуляции АИ-отрасли, выдвинутой Дарио Амодеи (и примкнувшим к нему Альтманом+Маском), если так посмотреть очень интересный тайминг. Антропик вот вот должны выйти на IPO. С их цифрами в $517 млрд.🤯 комитмента в капитальную инфраструктуру к 2019 году (при ранее обещаными инвесторам всего лишь $180 млрд.) и с их revenue которую пока только ожидают в $47 млрд. к концу года (а чистой прибылью в третьем квартале всего в $1 млрд.) им нужны деньги здесь и сейчас. И для этого им надо продолжать быть лидерами рынка и переть вперед как локомтив. А что на деле?

Релиз Fable 5.1 прошел максимально тихо. Никаких восторгов, чуть больше цифры бенчей, дорого, ненадежно. Релиз Astra от OpenAI вообще рискует стать мемом с их "мы достигли AGI🙈", на деле оказавшимся просто очередной моделью в линейке, которой бы больше подошла цифра 5.7, а не 6. Да, эти модели все еще "фронтир", они круты, чтобы сделать научный ресерч, решить математическую задачу тысячилетия (не факт😄), или показать красивое демо про computer use. Но бизнесу нужны модели которые просто getting shit done🌡. Предсказуемые, легкие в интеграции, недорогие. Давайте посмотрим кто сейчас у Anthropic/OpenAI в конкурентах?

Google и Meta. Вы видили чтобы они примкнули к "петиции об остановке развития AI"? Я - нет😁 Meta недавно выпустила отличную Muse Spark, которая стала прорывом по цене/качество, когда от Meta уже какбы и не ждали чудес. И сейчас в процессе новая Watermelon. У Google - отличный релиз Gemini 3.8. Обе эти компании поймали реальную нишу для бизнеса, найденую год назад еще китайскими лабами, про недорогие качественные модели, которые делают 90% качества от фронтира за 20% от их цены. По слухам Google буквально на днях достигла рубикона называемого RSI (Recursive Self-Improvement), то есть полного цикла автономии в самоулучшаемых моделях. При этом об опасности AI кричать начали не Google, после этого события, что было бы логично...🤷‍♂️
Потому что у Google и Meta - перспективная ниша! И что еще важнее - у них надежный cash flow. Даже если Антропик выйдя на IPO упадет в пике и это спровоцирует взрыв финансового пузыря, ни Google ни Meta не обанкротятся. В отличии от OpenAI/Anthropic, для которые текущий статус кво в виде бесконечного потока инвестиций в обмен на сайнс фикшен про супертехнологии управляющие миром - это вопрос выживания.

Конечно мы не знаем всего происходящего в недрах топ лаб. Риски AI могут быть и частично реальными. Но призывы к регулированию одновременно подорзительно выглядят слишком выгодными для лидеров (а точнее для потенциальных аутсайдеров😏) рынка. Если доступ к frontier потребует миллиардных бюджетов, лицензий и постоянных аудитов, safety превратится не в защитный механизм, а в барьер для новых и старых конкурентов.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🤔1
"Трудные времена создают сильных людей..." Распространите коллегам 🤗 На главной - более цензурная версия))

https://dontpastetheai.com/angry/
Чианг-Майские хипстеры знают толк в хипстерстве в 2026 году )) Happy Friday, коллеги!
🔥2
Утро началось не с Нескафе, а с секьюрити п...ца, который нашли на этих выходных. Оказалось ZCode воровал данные. Загружал полную историю гит изменений в .git в китайский клауд, зашифрованную их собственным приват ключом.
Zai оперативно ответили в тот же день. Вроде как быстро переобулись, убрали этот бэкдор, сказали что они не причем, и уже выложили ZCode в опенсорс по адресу https://github.com/zai-org/ZCode , чтобы код мог проходить необходимое ревью со стороны.

С одной стороны они молодцы, и опенсорс для харнеса - максимально верное решение. С другой стороны осадок вообще не приятный. Мне почему-то кажется, что это была не политика компании, а воровство данных как личная инициатива кого-то из разработки... Вобщем будем следаить за развитием событий. Отказываться от ZCode как-то уже и поздно 😅Но урок на будущее, наверное не полностью доверять закрытым тулам. Вот сейчас в связи с этим уже есть момент подумать, а насколько секьюрен CodeRabbit... 🤔
🌚3