AI vs DevOps
138 subscribers
206 photos
1 video
119 links
DevOps и системная инженерия в эпоху AI. Новости индустрии. И немного юмора.
Download Telegram
Terraform goes well 👍 Вобщем если к современным моделям добавить терраформ скил и использовать его при написании спек и кода, а так же передавать при код ревью - получается отличный терраформ код c правильными module boundaries, secure defaults with validations, и с полным test coverage. В целом доволен 😎

btw кто использует последний дипсик, вы high или max ризонинг ставите? чувствуется какая либо разница?
Амазон запустили Quick. Десктопное приложение, которое интегрируется в твой слак, почтовый аккаунт, драйвы с датой, и может помогать тебе в ежедневной переписке, подготовке документов, айти задачами и пр.
Само приложение я не пробовал (нет линукс клиента) и в целом не рекомендую :) Но идея интересная. По сути это то направление, куда должны двигаться АИ помощники, типа OpenClaw, но в ентерпрайзном контексте. И наверное хорошая идея для пет проекта.

Мы что-то похожее делали на хакатоне, но только в Слаке и работа только с проект датой в гугл драйве и с гитлаб/гитхаб репами. Интеграция же с разными ежедневными рабочими инструментами и полноценное десктоп приложение (или клиент сервер с агент бекендом на рабочей машине и клиентом например в телеграме) - это уже совсем новый уровень. Вобщем интересное направление.
А вот просто отличнейший пример гиковского сервиса :) Запускаем свои VM, для вайбокдинг проектов (для чего же еще 😁), просто через ssh 🤯

И там не только обычная виртуалка, но и сразу субдомен 3 уровня с встроенным https через wildcard, какой-то встроенный менеджмент секретов. Ну и персистент диски, мульти регионы, но это база.

Но за идею лайк 👍Пробуем
ssh exe.dev
Please open Telegram to view this post
VIEW IN TELEGRAM
После ~30 проведеннных тех собесов за последние два месяца, хочу сказать что все таки самая лучшая модель для составления вопросов - это GLM (если сравнивать GLM, Kimi, DeepSeеek, Qwen, Gemini, GPT). Почему-то у GLM получаются самые краткие, но нормально звучащие вопросы, где все в меру, но все по делу 👍Без излишней детальности и аи слопа.
При этом с анализом cv, job description и анализом транскриптов собесов все модели сейчас на одном уровне. Если дать те же инпут документы и тот же промпт, то любая модель из списка выдаст в 95% случаев те же вопросы, и всегда практически идентичный эвалюейшн кандидата. Разница только в лингвистической подаче информации.

Что касается кодинга/инжиниринга - за последнее время предпочтения не поменялись. Kimi K2.6 - топ модель для меня, универсальная под любые задачи. DeepSeek V4 Pro - если надо что-то делать быстро и дешево (дебагинг например). GLM - для детального код ревью или спек ревью.

Сейчас еще вышла MiMo от Xiaomi, она уже есть в OpenCode Go подписке, но не уверен есть ли смысл ее тестить. Кто ее уже пробовал, интересно или проходная история?
Please open Telegram to view this post
VIEW IN TELEGRAM
Идёт айтишник по рынку, смотрит - амбициозный стартап с неясными перспективами, сел в него и сгорел
🌚3
Разрабатываем LLM скилы like a Boss 😂Рекомендую, в статье много классных инсайтов 🌡

tldr:

- Не пишем все в один большой SKILL.md. Метадата (frontmatter) ~100 токенов, сам скил <500 строк, все остальное выносим в references/. Frontmatter читается всегда, это описания _когда_ надо загрузить скил. Тело скила грузится в контекст полностью, когда модель хочет использовать скил. А вот скрипты и маркдауны из references/ уже подгружаются on-demand, когда сам скил на них ссылается. Поэтому когда основная тяжелая логика и доки в рефах - мы уменьшаем перегрузку контекста раза в три! 🔥

- В reference файлах НЕ пишем frontmatter, никогда. Иначе они начнут подгружаться моделью сами по себе, без основго описания скила - получаем бессмысленный контекст ведущий к ошибкам. Роутинг на рефы должен быть прописан в SKILL.md, на этом все.

- Идемпотентность. Скил может ранаться в разных репозиториях с разной структурой. Не используем абсолютные пути и хардкоженую логику. Вместо этого обьясняем модели как нужно проверить окружающую файловую структуру, депенденси, и как выполнять команды в завимости от ее актуального окружения.

- Эвалы. Скилы по разному работают на разных моделях. Часто с развитием моделей они учатся делать какие либо вещи основываясь на своем новом обучающем датасете, и скил становится не нужен, только засоряя контекст. Хорошая практика - при смене моделей прогонять по два эвала, со скилом и без него, сравнивая результат.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
В догонку - вот еще пара ссылок на тему эвала скилов, из нашего рабочего чата :)

Базовый апроач как писать эвалы для скилов - https://agentskills.io/skill-creation/evaluating-skills

Отдельный фреймворк для бенчинга скилов - https://github.com/benchflow-ai/skillsbench
🔥2
Знак «Нельзя» стоит.
Но поток из тысяч рук
Кормит спящий ум.
😁😁😁

...Чертовы луддиты 😂
👍1
А вот и ответ насчет effort level у DeepSeek V4 Pro, спрашивал вот здесь. По факту их там всего два, стандартный и Max 🤗

Low, medium and high are actually the same thing, and if I'm not mistaken the default is one of them. The only different is the max, which really is a separate thinking mode. This happens because deepseek API support those, but it's just for compatibility, the model has just 3 modes: thinking disabled (not available in GO), thinking enabled and thinking max, the others are routed to thinking enabled.
Совет от принципал инженера из Atlassian. Учим?
Теперь уже отправляем каждый комит в аи модель? Дожили 😭Идея то хорошая, но я не знаю, какой нибудь семантический search прикрутить?) но это сложновато... С другой стороны с такой задачей должен даже условный бесплатный MiniMax или Nemotron справиться, надо будет попробовать :)
Рабочая неделя началась со вторника :) И небольшая заметка, в июне будет конфа от Гитлаба, про их агентик фичи и как они собирается развивать свой продукт в эру АИ. Так что если у вас в компании тоже используют Гитлаб - можно зарегаться послушать.

https://about.gitlab.com/events/transcend/virtual/
А еще вот просто не могу не пошарить инфо о своем продукте разработанном на хакатоне 😎
Первое место к сожалению не заняли, потому что надо было брать топики, которые организаторы обьявили на старте, то есть темы которые реально волнуют департаменты согласно опросам. Первые два места как раз делали продукты на эти темы (так что вот лайфхак на будущее).
Но Exa вошла в TOP5 (где-то из 15 команд) и жюри ее отдельно упомянули на файнал церемонии. Короче мерч в качестве призов за топ5 ничего не стоит 😅, но опыт и факт того, что продукт реально работает, реально полезен и мы его уже пробуем на текущем живом проекте и он уже начинает помогать людям - это бесценно 🤩

Почему это лучше чем "yet another chatbot"?

* Работа с данными. LLM-Wiki от Андрюхи Karpaty под капотом. Получаем точные данные с качественными взаимосвязями без громоздких RAG пайплайнов. Основной токен кансампшн на дата инжесте. Ретривал же простой как пробка, легко поддерживать, легко траблшутить.

* Агент харнесс от opencode, все четенько работает (скилы, mcp, кастом агенты) без разработки своих велосипедов

* Легко интегрируемся с новыми дата сорсами через MCP+синк микросервис. Сам АИ-бэкенд не требует доработок.

* Архитектура которая реально скейлиться на организацию. Микросервисы, асинк очереди, кешинг, клауд-нейтив дизайн.

Такие дела... 🤗 Вижу потенциал, будем работать над продуктом дальше)
Писали, что это - эволюционное продолжение LLM-Wiki by Karpaty - трансферим любые файлы в knowledge graph. Но как по мне - это пример как не надо писать скилы. 1300 строк скил, вместо рефов - указания ллм ставить внешние репы и внешний софт, вместо нормального ридми и cli с понятным хелпом по командам - рассказы как ллм запускать ту или иную команду.
Вобщем пока выглядит очень топорно, пробовать не буду. Но буду наблюдать какая идея окажется эффективнее - wiki или graph. Со временем должны будут появляться более качественный тулинг для одного или второго варианта работы с данными.
👍1
Уже второй раз натыкаюсь в рассылках на ai engineering hot topics 2026.
Так как автор не дает прямых разьяснений и говорит - подробности ищите сами, попросил ЛЛМ посерчить интернет на эти темы и сделать html страничку с блог постом на эти топики.
Мне понравилось 😎 Поэтому запаблишил на Github pages и заодно перенес свой блог с micro one на этот же самописный вариант в гитхабе. В 2026 платить хоть $1 за блог с интерфейсом из нулевых, когда можно все написать за пол часа аишкой и бесплатно захостить - зашквар))

Так что читайте, а я буду и дальше иногда постить лонгриды в этом блоге 😉 Кстати кто угадает, какой моделью написан текст и дизайн? 😏
🔥2
Ну что, готовы менять свои тайтлы в Linkedin? 🧐 Forward Deployed Engineers (FDE) - сейчас самый хайповый job title, при этом не такой временный, как уже ушедшие в небытье prompt engineeers (ну, поверим.. 😅). И гиганты собираются их хайрить и обучать сотнями.
Термин стал популярным буквально за последние пару недель, после того как OpenAI запустила свою deployment company, с инвестициями в $4ярда. Сразу же подключился гугл, который уже создал carrier ladder (FDE II - FDE IV) и разместил 59 вакансий на эту позицию, с рейтами для IV lvl в $183k-$265k, это без бонусов и эквити. К этой же движухе подключились и ServiceNow с Accenture.

В чем суть? В том что AI решения слишком сложны во внедрения в бизнес процессы. У малых и средних бизнесов нет своих айти отделов для внедрения даже простых в использовании тулов. А у больших компаний есть айти отделы, но нет экспертизы. Они хотят просто "нам бы АИ в наши процессы", но конкретные боли которые можно решить с АИ и как внедрить весь тулсет - это и должен искать FDE. Вобщем это инженер или их команда, которые работают на стороне заказчика, и сочитают роли бизнес-аналитика/архитекта/девопса. Рассказывают как и где АИ сделает в компании все радужно, допиливают софт напильниками чтобы подходило под процесссы кастомера и занимаются внедрением и настройкой.
По сути тот же DevOps+Архитектура, но чуть больше болтовни и софт скилов, с умением продать заказчику слона 😅

Но хайп интересный, движуха выглядит серьезной, может и в правду это станет очень выгодной и трендовой нишей. Через пол годика станет понятнее. Наблюдаем 😎

Статья на эту тему
А вот просто крутейшая находка на просторах сети. Сотни скилов для агентов на тему киберсекьюрити.

Что интересно нам? Cloud Security hardening. Container security включая k8s hardening. Настройка Web Apps Security (OWASP) для SDLC. Скилы по CI/CD security и terraform auditing.

Ну и в целом можно импрувнуть свои знания по cybersec, почитать про практики red/blue teaming, pentesting итд. Все скилы написаны доходчивым английским, так что это считай краткая сжатая документация с примерами использования программ 😎

https://github.com/mukul975/Anthropic-Cybersecurity-Skills
Продуктивного понедельника, коллеги 😄
🌚2
Forwarded from Lunar
Я вот пользуюсь таким ( телега )

Из плюсов: цена 0.3$ за лям opus 4.7 reasoning low, 1M контекста. Модели честные, не разбавленная. Могу скинуть аквариум.

Из минусов - иногда тулы на 4.7 подтупливают, но только на этой модели.

Нормальный бюджетный вариант.

По китайским китайцам:

https://hvoy.ai/ - тестер и роутер китайских апи

https://www.aiapipk.com/

https://linux.do/ - форум с обсуждениями

Китайцы в чатах кидали варианты
https://outgap.ai/
https://www.packyapi.com
По сообщению выше ^ Для интересующихся китайскими LLM роутерами, тут в одном чате скинули, интересное посмотреть :) Не рекомендация, понимайте риски.