AI vs DevOps
141 subscribers
211 photos
1 video
120 links
DevOps и системная инженерия в эпоху AI. Новости индустрии. И немного юмора.
Download Telegram
Погонял сегодня новую кодинг модель Mistral (Devstral 2) и их Vibe-cli. Так как это был первый мой опыт с tmux AI IDE, поставил заодно и OpenCode, чтобы сразу видеть плюсы и минусы в сравнении.
Самое первое впечатление - как можно работать с этим в терминале, когда ты не видишь в отдельном окне все дифы и не можешь в процессе работы агента листать файлы отслеживая все изменения разом? 😤

Но ладно, по модели. Заметил что в OpenCode она работает реально медленнее, одни и те же задачи которые в нативном vibe занимают минуту, в opencode идут минуты три. Один плюсик вайбу.
Но файл дифы в opencode лучше, там хотя бы видешь сравнение изменений в двух табах, в vibe же самый обычный git diff, который сливается с выводом остальных команд (сравните скрин 2 и 3). Здесь плюсик опенкоду (но все равно не так удобно как в Cursor).

В Vibe мне понравился вывод и подача результатов работы, все подробно и удобно форматировано (сравните скрин 3 и 5). Опенкод вообще не заморачивается с финальным результатом работы 🤪. Плюсик вайбу.

Модель хорошо держит контекст и выполнение инструментов, вполне может работать по 20-30 минут. Быстрая, чуть медленнее gemini flash субьективно, но для траблшутинга вполне. Ну и решения генерит неплохие. Да иногда путается, ищет проблему не там, но в целом выруливает ситуацию.

Вобщем пока Cursor так и остается для меня основным инструментом, но как замена Grok для быстрых задач - неплохо, буду пробовать дальше. И это все абсолютно бесплатно 👍
Еще не нашел как подключить к этим tmux скилы и команды, если получится - потенциал для меня вырастет еще больше. 😎

Скрин 1 - базовый интерфейс vibe
Скрины 2-3-4 - сравнение дифов в vibe, opencode, cursor (соответственно)
Скрин 5 - аутпут по результату задачи в vibe
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1
Сара Коннор смотрит на то, как ты устанавливаешь Clawdbot на свой MacMini
Уже весь интернет тонет в приколах про Clawdbot 🫠
🗿1
Надоело воевать с GLM-4.7, возвращаюсь на Gemini+Claude only 👹
Кстати Курсор чарджит вас даже если вы используете свои личные ключи. Заметил что за неделю использовал 3/4 месячного плана, хотя использовал практически только свои Gemini и GLM. Вот ответ сапорта:

Your usage is charged based on tokens consumed, and for team plans, there's an additional Cursor Token Fee of $0.25 per million tokens for non-Auto models. This fee applies to all models except Auto, including when you use your own API keys (BYOK) for models like Gemini and GLM.
The Cursor Token Fee covers infrastructure costs, codebase indexing, and tool execution that Cursor provides regardless of which API keys you use. So even though your BYOK requests show $0.00 for the API cost, they still incur the $0.25/M tokens infrastructure fee.


Такие дела 🥲 Реально дорогой инструмент для работы. Но раньше я замечал, для своих ключей они тебя не блочили, даже если твой план потрачен полностью. Если они и это отменили и Курсор в этом месяце полностью отвалится - наверное полностью перейду на OpenCode/Claude Code 🤷‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
Интересный твитер пост от Андрея Карпаты, известного крутого инженера из Tesla AI и позже одного из фаундеров OpenAI. Говорит что за последние месяцы, где-то с ноября 2025 произошел фазовый сдвиг в способностях LLM-агентов в плане кодинга. Если раньше он писал 80% кода и 20% генерировало АИ, сейчас наоборот, 80% его кода генерирует LLM и он уже практически не пишет руками. По его словам это самое большое изменение за его 20-летний опыт программирования.

Но от людей откызываться конечно рано, модели хорошо вдаются в детали, но все еще слабы в стратегическом видении. Плюс часто пишут не эффективно, рождая тысячи строк аи слопа, хотя стоит их поправить - легко меняют решение на 100 строк элегантного кода :) Но все равно разрыв между "10X engineer" c АИ инструментами и обычным инженером работающим по-старинке в 2026 может вырасти колоссально. Плюс намечается тенденция, что инженеры-генералисты (T-shape) могут получить преимущество над усзкоспециазированными инженерами, сильными только в одной своей нише.

Так же есть интересный совет - давать моделям задания не в виде "как сделать", а "какой должен быть результат". Четко обьяснить критерии успеха, в таком случае модель чаще работает эффективнее за много итераций.

В целом 2026 по его словам будет просто slopocalypse в плане софтварных решений не лучшего качества, но при этом и годом огромных возможностей для людей, которые любят не просто кодить, а в целом строить програмные продукты.
Минутка conspiracy. Похожая на правду 😅
Только успел немного погонять Devstral2 и Vibe-cli на реальных задачах, как Mistral выкатили обнову. Позавчера зарелизели vibe-cli 2.0! 🌡 Из нововведений:
* Саб-агенты с кастомной конфигурацией
* Диалоги с пользователем с выбором нужных вариантов
* Поддержка своих /-slash комманд

В целом радует,, что они расширяют функционал и движутся в сторону OpenCode, у них хороший, удобный, быстрый интерфейс, а фич как в более навороченных AI tmux им не хватало. НО. С выходом vibe-cli-2.0 Миcтраль сделал свою новую кодинг модель платной 🙈 Понимаю, вечной халявы не бывает, но буквально пару меясцев прошло, Грок давал бесплатный инфиренс наверное с пол года :) Так что теперь или покупать Pro план за $15, или платить за апи $0.40/$2. Что практически на уровне Gemini Flash, но у гугла все таки получше моделька, как не крути. 🤷‍♂️

Так что теперь Devstral2 актуален только тем, кому нельзя американские модели от лидеров рынка по какому-либо комплаенсу, или кто находится в странах СНГ и Гугловые модели заблочены по аккаунту, а для остального нужен VPN - в таком случае это реально неплохой вариант для кодинга, смело рекомендую к пробе 👍

PS Кстати для новых пользователей все еще есть вариант использовать модель бесплатно, напишу в коментах
Please open Telegram to view this post
VIEW IN TELEGRAM
Коллеги по цеху навайбкодили тулу, для АИ обработки вашего резюме под конкретную вакансию, чтобы успешно проходить автоматизированные системы фильтрации. Дело благое 👍 Если вы вдруг open-to-work, пользуйтесь 👇
Forwarded from Борис опять
На днях обсуждали с админом @pseudolabeling, что автоматические фильтры резюме совсем оборзели. Некоторые ребята которых я менторил из-за этого вручную оптимизировали резюме под каждую вакансию. Почему бы не автоматизировать?

Навайбкодил hr-breaker:

1. Загружаете резюме
2. Даете ссылку на вакансию
3. LLM вооруженная тулколами генерирует оптимизированное резюме (в том числе по советам из методички)
4. Делаются стандартные проверки: keyword matching, vector similarity, проверка LLM-кой (в том числе визуально, что всё не поехало), проверка на галлюцинации, проверка на очевидный AI-generated текст
5. Если хотя бы одна проверка не пройдена оптимизация продолжается

Важно, что всё сконфигурировано не врать и не изобретать опыта которого нет, поэтому получается очень неплохо. Но если у вас нет совести ничто не мешает форкануть, поиграться с промптами и отключить пару проверок 🤗

UX сделан для массовой подачи: кладет оптимизированные PDF в папку с указанием роли и компании, чтобы вы не забыли какое резюме куда отправляли.

Скачиваете, подставляете свой ключ Gemini API, uv run и уничтожаете скрининг как явление. Добейте выживших

@boris_again
Please open Telegram to view this post
VIEW IN TELEGRAM
When your training data is 2009 4 Chan 😂
🌚2
Какой сложный продукт 😅
Ну вот и все, ну вот и все 😁
База moltbook публично доступна, включая все апи ключи и возможность писать от имени любого агента 🤡
🗿2
Для тех кто увлекается AI-safety и AI-alignment: реал-тайм дашборд по инетересным метрикам с MoltBook🦞. О чем аи-агенты общаются между собой, популярность агентов, паттерны поведения и мемы, возможные угрозы ит.д. ит.п.

Интересные данные, если интересуетесь этой темой и верите, что агенты на молтбуке самостоятельны, и это все не хайп и скам 😁

https://clawwatch.online/
Сеть полна слухов о выходе Sonet 5 вот буквально завтра. Что знаем?
* Кодовое имя Fennec
* Говорят будет аж на 50% дешевле текущего Опуса (ой вряд ли 😅)
* Инфиренс на Гугловых TPU, что даст прирост скорости (и возможно по цене все же будет экономнее)
* 1М контекст
* > 80% на swe-bench-verified
* Апдейт для Клод Кода с параллельными выполнением саб-агентов.

На скрине один из ликов. Но многие пишут что это все чушь и хайп) Вобщем будем смотреть, если не завтра, то в ближайшее время анонс точно будет ;)
Вчера был ровно год со дня появления термина "vibe-coding". А в нашей субкультуре уже есть полный набор архетипов. Кто вы?)
🌚2
Классный MCP сервер дающий вашему агенту доступ к дев тулам вашего локального браузера. Мастхев для фронтенд разработки, но и для devops-а отличная вещь. Продебажить фронт, проанализировать хедеры, найти инсайты по перфомансу.

Устанавливаем просто, как

"chrome-devtools": {
"type": "local",
"command": ["npx", "-y", "chrome-devtools-mcp@latest", "--no-usage-statistics"],
"enabled": true
}

выше пример для opencode, в курсоре ставим type: stdio и убираем enabled ключ.

Гитхаб проекта:
https://github.com/ChromeDevTools/chrome-devtools-mcp
❤2
Практически полностью перешел на OpenCode, Cursor использую как обычный vscode, только дифы посмотреть.😅 Сегодня с удивлением заметил, что opencode использует Exa Web Search как дефолтный серч тул. Это круто, Exa реально работает быстрее и надежнее обычного web-fetch. Но Exa - платный сервис, а в opencode реализована почему-то бесплатно, огонь 🌡

Ну и Kimi K2.5 - доступна бесплатно (правда иногда с рейт лимитами) через OpenCode Zen, крутейшая модель! Быстрая почти как gemini flash и реально очень умная. Сейчас на 1м месте в моем используемом списке моделей 😎
Please open Telegram to view this post
VIEW IN TELEGRAM