Я тут сейчас активно тестирую Open Code Review от Alibaba. Это их внутренний тул, который они развивали уже не один год, а сейчас выпустили в опенсорс. Обьединяет все лучшее двух миров - детерминированный код сканнер, чтобы четко проходить по всем файлам и депенденси, и АИ ревью для найденных участков.
Ставим cli приложение, подключаем LLM (есть поддержка любых провайдеров), ставим скил, пишем "make a code review for this mr/branch/commit using open-code-review skill" и погнали 👍
Впечатления вырисовываются классные. Сначала мне не сильно понравился сухой формат отчетов, но после разных тестов вижу что оно действительно находит проблемы лучше других тулов. Сейчас это все обьеденяю со стилизацией моих обычных код ревью, с severity, refactoring opportunity, learning materials ит.д. Будет классно🌡
На следующей неделе напишу подробную статью. Пробуйте, рекомендую
https://github.com/alibaba/open-code-review
Ставим cli приложение, подключаем LLM (есть поддержка любых провайдеров), ставим скил, пишем "make a code review for this mr/branch/commit using open-code-review skill" и погнали 👍
Впечатления вырисовываются классные. Сначала мне не сильно понравился сухой формат отчетов, но после разных тестов вижу что оно действительно находит проблемы лучше других тулов. Сейчас это все обьеденяю со стилизацией моих обычных код ревью, с severity, refactoring opportunity, learning materials ит.д. Будет классно
На следующей неделе напишу подробную статью. Пробуйте, рекомендую
https://github.com/alibaba/open-code-review
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - alibaba/open-code-review: Secure, fast, efficient, battle-tested at Alibaba's scale. Hybrid architecture code review tool:…
Secure, fast, efficient, battle-tested at Alibaba's scale. Hybrid architecture code review tool: deterministic pipelines + LLM Agent, precise line-level comments, built-in multi-language ru...
👍6
Обзор ситуации с Fable от человека очень близкого ко всей внутренней кухне. Этот дядька - довольно известный тех инвестор, а нынче - глава комиссии в правительсте Трампа по науке и технологиям.
В двух словах - Антропик позиционировали себя как safety-first компания и заявляли что их mythos - это считай cyberweapon. Но когда она зарелизили Fable - возникла история с джейлбрейком. Причем это не информация из интернета от ноунеймов, а инфа от компании/институции которой очень доверяет и US Govt. и сами Anthropic, и которые принимали участие в ранних тестах Mythos. Дарио предложили - вы же за сайфети, ситуация следуя вашей логике - опасная, снимайте модель с релиза и чините проблемы. Он отказалася. "Ну а что еще могла сделать самая циничная и лживая компания на рынке?😆" Наверное фикс не такой простой и быстрый, а бабки с модели грести - важнее😄 . Получил по щам, модель сняли регуляторным методом.
При этом правительство не против ее разблочить, если Антропик порешают все проблемы. Это не многоходовчка и не "попытка сделать топовые аи модели национальным достоянием отгородившись от всего мира". Такие дела 🤷♂️
В двух словах - Антропик позиционировали себя как safety-first компания и заявляли что их mythos - это считай cyberweapon. Но когда она зарелизили Fable - возникла история с джейлбрейком. Причем это не информация из интернета от ноунеймов, а инфа от компании/институции которой очень доверяет и US Govt. и сами Anthropic, и которые принимали участие в ранних тестах Mythos. Дарио предложили - вы же за сайфети, ситуация следуя вашей логике - опасная, снимайте модель с релиза и чините проблемы. Он отказалася. "Ну а что еще могла сделать самая циничная и лживая компания на рынке?😆" Наверное фикс не такой простой и быстрый, а бабки с модели грести - важнее
При этом правительство не против ее разблочить, если Антропик порешают все проблемы. Это не многоходовчка и не "попытка сделать топовые аи модели национальным достоянием отгородившись от всего мира". Такие дела 🤷♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔2
По слухам сейчас каждая компания, у которой есть ярдные бюджеты, готовит замену GitHub для АИ-агентов 😁
Кстати, после запуска Kimi K2.7 Code вся супер быстрая скорость у Муншот провайдера пропала, и что новая модель , что прошлая Kimi K2.6 теперь работает на обычной скорости, чуть медленнее дипсика. Это очень жалко конечно, когда она летала на 100+ tps это реально было круто и моделью хотелось пользоваться. Сейчас же все стало обычно и новый релиз K2.7 меня не впечатлил. Вообще не замечаю разницу с прошлой версией. Вроде как новая должна меньше потреблять токенов, но по факту потребляет много, точно не меньше 2.6, и по факту на тех же задачах выходит раза 4 больше чем Дипсик. Замечаю что для простых задач все чаще запускаю дипсик про, чтобы сэкономить расходы лимитов.🤷♂️
А вот что меня впеатлило - это GLM 5.2 Можете кидаться тряпками, но она сейчас реально на уровне последнего Opus. Сравнивал на подгтовке спек для новых фич - GLM даже лучше ведет с вопросами по требованиям и дизайну, реально. Ну и конечно не жрет по $3-5 за одну подгтовку спек или ревью кода, как это делает Opus 4.8 в Курсор подписке.
Вобщем Zai не разочаровали и новая модель - это опять ощутимый скачок вперед🌡 А вот Moonshot получает минус вайб 😄
А вот что меня впеатлило - это GLM 5.2 Можете кидаться тряпками, но она сейчас реально на уровне последнего Opus. Сравнивал на подгтовке спек для новых фич - GLM даже лучше ведет с вопросами по требованиям и дизайну, реально. Ну и конечно не жрет по $3-5 за одну подгтовку спек или ревью кода, как это делает Opus 4.8 в Курсор подписке.
Вобщем Zai не разочаровали и новая модель - это опять ощутимый скачок вперед
Please open Telegram to view this post
VIEW IN TELEGRAM
У нас тут в компании намечается партнерка с Курсором, через 10 дней тренинг, не могу не похвастаться 😎 После тренинга - расскажу какие были интересные и полезные тейки здесь в канале обязательно 🌡
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
Теперь вы можете помогать развитию опенсорс агентов даже работая в проприетарном codex или claude code. Инициатива от Trace Commons Foundation. Ставите /donate-trace скил одной командой через npx, запускаете скил - и делаете трейсы по вашим данным достоянием общественности, а не только одной компании производителя вашего кодинг агента :) Но конечно испольуйте только если кодите какие-то свои пет проекты или опенсорс, приватные данные со своей работы отправлять не стоит, да и агент сразу не позволит. Там стоят guardrails и если в сессии есть приватный коммерческий код, агент сразу так все не отправит. Грамотно!
Trace Commons
Trace Commons · An open commons for code agent traces
An open commons for understanding how coding agents work. Donate your coding-agent sessions to one open public dataset anyone can study and build on.
👍1🔥1
Посоветовали интересную тулу в рабочем чатике. Kasetto. Если вы тоже работаете с несколькими агентами (кодекс, курсор, опенкод итд), часто пробуете новое, и конфигурация всех скилов, команд и mcp для новых приложений превращается в боль - можете попробовать. Закидываем все свои рабочие конфигурации в приватную гитхаб репу и получаем автосинк в одну команду для любого нового агента, декларативный конфиг, менеджмент всего в одном месте и актуальные апдейты.
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.
Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":
- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...
Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает🤷♂️
Я вот уже реально устаю менеджить огромные наборы конфигураций в разных местах на диске, и понимаю что это все неправильно, нужен гит и нормальный синк. Kasetto похоже как раз это решает. Так же я когда-то делал и шарил здесь свою простенькую тулу для настройки удаленных серверов - remote-shell-setup , до сих пор активно ее использую. Вот туда надо будет внедрить Kasetto тоже.
Главная проблема - где найти на это все время 🤯 Сейчас в "бэклоге":
- Написать подробную статью про AI code review
- Построить себе аи ассистента для ежедневных дайджестов по подготовке к рабочему дню: слак, письма, гитхаб-гитлаб, джира. Хотелось или все по красоте написать под себя на новом агент-фреймворке от Vercel, но наверное все же пойду путем наименьшего сопротивления и поставлю простой Hermes Desktop 🙈
- Затестировать перспективный Infrastructure as a Code Болотный фреймворк 😁
- Развивать фичи своего слак агента (кстати ура🎉, прошел все секьюрити ревью и обсуждения с безопасниками, и его уже будем деплоить "в прод" для нашего текущего проекта)
- Вот теперь еще Kasetto сюда добавился...
Хоть ты полноценный недельный отпуск бери чтобы сделать все эти активности, работа не дает
Please open Telegram to view this post
VIEW IN TELEGRAM
Kasetto
Kasetto - Declarative AI Agent Environment Manager
Sync skills, MCP servers, slash-commands, and instructions from Git into Claude Code, Cursor, Codex, Copilot, and 18 more agents. One YAML file, lock-pinned, in Rust.
👍1
Интересный девопсовый ивент будет онлайн в июле
https://events.iacconf.com/designing-iac-interfaces-july-2026-spotlight/
https://events.iacconf.com/designing-iac-interfaces-july-2026-spotlight/
Iacconf
Designing IaC Interfaces That Work for Humans, AI Agents, and Whatever Comes Next
Most Terraform modules are designed to work, not to be consumed well. After applying interface design principles from A Philosophy of Software Design to modules used by non-infrastructure developers, Jinger saw less misuse, faster onboarding, and fewer direct…
Реальный батл GLM-5.2 vs Opus 4.7😮
Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉
❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
✅ GLM чаще валидирует результаты задачи, выполняет dual-platform валидейшн > Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)
✅ ✅ ✅ При том что GLM в пять раз дешевле Opus и опенсорс, а Anthropic - контора пидорасов , прям чистая победа Zhipu! 😁
https://x.com/RamaswmySridhar/status/2069460464371954171
Snowflake прогнали интересный бенч. 103 задачи. Опус побеждает по многим раундам. Но результат не очевиден.😉
❌GLM выполняет на 20% больше шагов в среднем над задачей < Opus
❌GLM ест x2 токенов на задачу < Opus
❌GLM < Opus код чище на 6% (в этом пункте мало деталей, что значит чище, почему 6%?)
https://x.com/RamaswmySridhar/status/2069460464371954171
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
sridhar (@RamaswmySridhar) on X
Early results from the @snowflake's coco team on GLM-5.2 vs Opus-4.7 on dbt-bench — what the trajectories actually show 🧵
👍2🌚1
Please open Telegram to view this post
VIEW IN TELEGRAM
В долгожданном мажорном релизе второй версии OpenCode они сделают общий бекенд для всех и консольных и десктопных клиентов. Можно будет работать над одними и теми же фичами любым удобным способом с бесшовынм переходом. Обещают минимальное использование ресурсов, наконец tool-search-tool с умной подгрузкой MCP для экономии контекста (был удивлен, что в опенкод этого еще нет). Судя по комментам - через неделю выкатят бету. ОЧЧень долгожданный для меня релиз! 🌡
https://x.com/thdxr/status/2071007637487894883
https://x.com/thdxr/status/2071007637487894883
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
dax (@thdxr) on X
in OpenCode v2 all instances of the tui and desktop and web share the same backend
so everything is synced by default and resource usaged is minimized no matter how many windows you have open
so everything is synced by default and resource usaged is minimized no matter how many windows you have open
🔥1
Антропик внедрила в клодкод spyware нацеленный на пользователей в азиатской таймзоне. Конечно они будут оправдываться про корпоративный анти-шпионаж и дистилляцию их моделей. Но вопрос доверия. Если есть не задокументированные внедрённые бекдоры - то будет такие же и от спецслужб, и корпоративные данные они будут сливать. Нет такой подлости на которую не пойдет капиталист ради иксов прибыли )
🔥1🌚1
Давно ничего не писал в блоге, переезд в новый дом, дни рождения. Со следующей недели точно начну писать регулярнее :)
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
The New Stack
“Code should be regenerated, not maintained”: Codeplain makes the case for spec-driven development
The phoenix of Greek myth burns and is reborn from its own ashes -- a metaphor this founder is applying to AI-generated code.
🔥4🌚1
А вот полезное! АИ агенты часто не могут спарсить сайты из за блока джава скрипта jina-ai ридер решает эту проблему. (а так же пдфки, картинки, другие доки) Пока бесплатно) Например
Стоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
https://r.jina.ai/https://exadel.comСтоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
GitHub
GitHub - jina-ai/reader: Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/
Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/ - jina-ai/reader
🔥1
Подключил сегодня в свой opencode GPT-5.6. Погонял Terra (high) на код ревью и фиксах. Слушайте, я первый раз в 2026 году кайфанул от модельки авторства большой тройки. Новая гопота реально классная!👍
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.😄 Отличное следование инструкциям, красивые лаконичные фиксы, скорость инфиренса как надо. Похоже я на ближайшее время перехожу на активную трату наших корпоративных OpenAI ключей 😁
Samа и команде OpenAI реальный респект за такой мощный релиз!🧠
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.
Samа и команде OpenAI реальный респект за такой мощный релиз!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2