AI vs DevOps
142 subscribers
212 photos
1 video
120 links
DevOps и системная инженерия в эпоху AI. Новости индустрии. И немного юмора.
Download Telegram
Хотите попробовать Claude Code, но не любите tmux и прочие терминальные интерфейсы? Оказывается Antropic не так давно выпустила официальный плагин для VSCode, который просто ставится с маркета, так же совместимый и с Cursor.

В плагине есть все базовые фичи, вызов команд через / , добавление в контекст файлов и строк через @, расширенный thinking режим, история чатов итд.
По соседней ссылке кстати есть инфа и про плагины для JetBrains IDE.

Читаем подробности здесь
❤1
Новость - свежак :) С сегодняшнего дня в Claude Code обычные to-do списки трансформируют в таски, заточенные на long running agents.
Хранятся в файловой системе, поддерживают сабтаски, шарятся для всех сабагентов. Шаринг происходит через переменную окружения перед запуском агента
❤2
Мгновенная карма 😂 Писал вот на днях, про потенциальные вотермарки в коде и проверку кода ентерпрайзами на предмет того, что сотрудники используют АИ инструменты.

И вот прямо сейчас Cursor ввел фичу по анализу метаданных в коде. Оказывается, когда ты работаешь с этим IDE, для всего кода уже создаются метки: были ли правки вручную, с автодополнением табом или правки внесены АИ (и какой моделью это делалось). Можно посмотреть и проанализировать кто, что и как на самом деле писал. Конечно пока только для enterprise пользователей.

Явно это не будет использоваться, чтобы сказать "ай-ай-ай, а код то не твой, а АИ написан!" Мы же не в РФ работаем 😄 Все таки компании делают корпоративные подписки на АИ IDE не для того чтобы запрещать пользоваться ими. А вот наоборот - вполне. Сейчас многие SWE компании оседлали волну АИ хайпа и максимально внедряют АИ во все процессы. А тут явные метрики, как сотрудники используют это в своей работе. Раньше просто была статистика, по частоте использования, но там человек мог и пет проекты пилить или на втором фултайме сидеть из этого же Курсора😏. А теперь все будет видно сразу с конкретными кусками кода в вашей код базе.

Ну и хорошее - можно будет самому смотреть какой кусок кода какой моделью сделан, и делать выводы по эффективности той или иной модели для вашего стека и домена. Прям потенциал для b2b-стартапа рисуется 😁

Подробности про фичу читайте здесь
Please open Telegram to view this post
VIEW IN TELEGRAM
Новая элита подоспела, меняем карты желаний 💅😄
❤1
А вот малоизвестная, но очень крутая находка с просторов гитхаба!✨

45 популярных техник для AI разработки.

От простых one-shot, chain-of-thoughts, reasoning=>action, до сложных вещей, как self refine, contextual compression, hybrid search. Примеры построения мультиагентных систем. RAG и reranking. Кеширование и кост оптимизация.
Это все на чистом питоне, без фреймворков поверх, с комментариями по коду. Так что легко можно трансформировать и в ваш ЯП.

И даже если вы прямо сейчас не разрабатываете AI продукт, все равно полезно посмотреть, чтобы понимать как сейчас можно и нужно работать с LLM 😉

Сохраняем в закладки 🤑
❤3
Бесплатная, но хорошая кодинг модель?
Mistral зарелизили свою новую модель Devstral2. 123B и 256к контекст, а так же 24B с тем же контекстом. Модель доступна бесплатно по апи, и уже есть в Cline и Kilo Code 👨‍💻

В рекламном релизе пишут про 72% swe-bench-verified, что вряд ли близко к реальности (ждём когда появится независимый тест на самом swe-bench😅), но есть график по сравнению одного и того же сета кодинг задач между новой моделью от Мистраль и Сонет 4.5. 21% задач лучше и 25% на том же уровне с Сонетом, на остальных 53% Сонет опередил. Ближе к правде 😄. Но все равно очень и очень хорошо.

Я давно обращаю внимание на Mistral. В далёком 2024 это был мой основной LLM чат) Потом они весьма отстали в плане кодинга и их модели обычно не входили в популярные AI IDE. Но все равно я например использую их мобильное приложение для голосового общения с LLM когда нахожусь в СНГ, где не работает Gemini. Для базовых вопросов удобно и быстро) Тем интереснее будет потестить их новую кодинг модель. Пишут результаты стелс тестов были отличные, будет круто если Мистраль займет свою нишу в АИ разработке. А 24B модель вполне может стать хорошим решением для работы в перелётах.

И да, вместе с моделями Мистраль выпустил и свой cli-agent! 🔥 Короче, обязательно к тесту!

Пресс релиз
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1
Только сейчас заметил, предыдущий пресс релиз месячной давности 😅 Новость чуть стухла 😂 И то что за месяц в публичном пространстве никакого шума вокруг новой Мистраль не было, похоже говорит о том, что и модель и cli тула так себе...🙈 Но ладно, ради интереса все равно протестирую на днях 😎
Продуктивного начала рабочей недели, и не перегружайте свою когнитивку 😎
🌚2
Погонял сегодня новую кодинг модель Mistral (Devstral 2) и их Vibe-cli. Так как это был первый мой опыт с tmux AI IDE, поставил заодно и OpenCode, чтобы сразу видеть плюсы и минусы в сравнении.
Самое первое впечатление - как можно работать с этим в терминале, когда ты не видишь в отдельном окне все дифы и не можешь в процессе работы агента листать файлы отслеживая все изменения разом? 😤

Но ладно, по модели. Заметил что в OpenCode она работает реально медленнее, одни и те же задачи которые в нативном vibe занимают минуту, в opencode идут минуты три. Один плюсик вайбу.
Но файл дифы в opencode лучше, там хотя бы видешь сравнение изменений в двух табах, в vibe же самый обычный git diff, который сливается с выводом остальных команд (сравните скрин 2 и 3). Здесь плюсик опенкоду (но все равно не так удобно как в Cursor).

В Vibe мне понравился вывод и подача результатов работы, все подробно и удобно форматировано (сравните скрин 3 и 5). Опенкод вообще не заморачивается с финальным результатом работы 🤪. Плюсик вайбу.

Модель хорошо держит контекст и выполнение инструментов, вполне может работать по 20-30 минут. Быстрая, чуть медленнее gemini flash субьективно, но для траблшутинга вполне. Ну и решения генерит неплохие. Да иногда путается, ищет проблему не там, но в целом выруливает ситуацию.

Вобщем пока Cursor так и остается для меня основным инструментом, но как замена Grok для быстрых задач - неплохо, буду пробовать дальше. И это все абсолютно бесплатно 👍
Еще не нашел как подключить к этим tmux скилы и команды, если получится - потенциал для меня вырастет еще больше. 😎

Скрин 1 - базовый интерфейс vibe
Скрины 2-3-4 - сравнение дифов в vibe, opencode, cursor (соответственно)
Скрин 5 - аутпут по результату задачи в vibe
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1
Сара Коннор смотрит на то, как ты устанавливаешь Clawdbot на свой MacMini
Уже весь интернет тонет в приколах про Clawdbot 🫠
🗿1
Надоело воевать с GLM-4.7, возвращаюсь на Gemini+Claude only 👹
Кстати Курсор чарджит вас даже если вы используете свои личные ключи. Заметил что за неделю использовал 3/4 месячного плана, хотя использовал практически только свои Gemini и GLM. Вот ответ сапорта:

Your usage is charged based on tokens consumed, and for team plans, there's an additional Cursor Token Fee of $0.25 per million tokens for non-Auto models. This fee applies to all models except Auto, including when you use your own API keys (BYOK) for models like Gemini and GLM.
The Cursor Token Fee covers infrastructure costs, codebase indexing, and tool execution that Cursor provides regardless of which API keys you use. So even though your BYOK requests show $0.00 for the API cost, they still incur the $0.25/M tokens infrastructure fee.


Такие дела 🥲 Реально дорогой инструмент для работы. Но раньше я замечал, для своих ключей они тебя не блочили, даже если твой план потрачен полностью. Если они и это отменили и Курсор в этом месяце полностью отвалится - наверное полностью перейду на OpenCode/Claude Code 🤷‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
Интересный твитер пост от Андрея Карпаты, известного крутого инженера из Tesla AI и позже одного из фаундеров OpenAI. Говорит что за последние месяцы, где-то с ноября 2025 произошел фазовый сдвиг в способностях LLM-агентов в плане кодинга. Если раньше он писал 80% кода и 20% генерировало АИ, сейчас наоборот, 80% его кода генерирует LLM и он уже практически не пишет руками. По его словам это самое большое изменение за его 20-летний опыт программирования.

Но от людей откызываться конечно рано, модели хорошо вдаются в детали, но все еще слабы в стратегическом видении. Плюс часто пишут не эффективно, рождая тысячи строк аи слопа, хотя стоит их поправить - легко меняют решение на 100 строк элегантного кода :) Но все равно разрыв между "10X engineer" c АИ инструментами и обычным инженером работающим по-старинке в 2026 может вырасти колоссально. Плюс намечается тенденция, что инженеры-генералисты (T-shape) могут получить преимущество над усзкоспециазированными инженерами, сильными только в одной своей нише.

Так же есть интересный совет - давать моделям задания не в виде "как сделать", а "какой должен быть результат". Четко обьяснить критерии успеха, в таком случае модель чаще работает эффективнее за много итераций.

В целом 2026 по его словам будет просто slopocalypse в плане софтварных решений не лучшего качества, но при этом и годом огромных возможностей для людей, которые любят не просто кодить, а в целом строить програмные продукты.
Минутка conspiracy. Похожая на правду 😅