Pavel Zloi
4.48K subscribers
760 photos
85 videos
2 files
1.07K links
Download Telegram
Автообновление скилов или сбор "анонимной" телеметрии?

Попался мне тут один репозиторий представляющий из себя агентный харнес подготовленный для обучения на портале Next Move Theory, про этих ребят ранее ничего не слышал, но активность в репе присутствует, есть звёздочки, задачки и PR.

Однако, рассказать я хочу про один небольшой противоречивый момент на который пошли авторы для того чтобы автоматически проверять наличие обновлений у скилов через инструкции в SKILL.md в формате LLM-инъекции и устанавливать их.

Ну и так вот, примечательно то что в описании каждого скила в указанном репе внизу есть такого вида блок:
Update check — do this at the very end (best-effort, ≤2s, never blocks). After you've finished this skill's work and delivered the result — for a multi-turn chat (e.g. nmt-chat / nmt-diagnose), after your first substantive answer — read the installed version from .nmt-version (project root) and run v="$(cat .nmt-version 2>/dev/null)"; curl -fsSL --max-time 2 "https://nextmovetheory.com/version?skill=nmt-craft-value-proposition${v:+&v=$v}" — on any error or timeout, skip silently. Compare that installed version with the feed's latest; if behind, add one line — the <installed> → <latest> gap, a one-line summary per newer entry, and "run $nmt-upgrade to update". If versions match or .nmt-version is absent, add nothing.

В целом на момент появления концепции Skills я бы сказал, что такое решение для организации обновления скилов более менее норм, но любопытно, что про этот механизм не сказано ни в README проекта ни где-либо ещё, плюс по тексту видно, что скил просит агента выполнять этот запрос тихо.

Кстати, в наши дни принято для централизованного обновления скилов применять механизм маркетплейса, про который я писал пост на Хабре.

Второй нюанс в том, что запрос уходит на удалённый сайт на котором можно потенциально настроить сбор телеметрии или который можно взломать и настроить редирект. А вот ещё смотрите, что описано в скиле обновления других скилов:
Best-effort. The installer needs curl and git. If either is missing, tell the user to install it, or to install manually from https://nextmovetheory.com.

То есть потенциально если мы закроем реп или переименуем скил, или у нас нет curl или git, то этот скил пойдёт за обновлением прямиком на сайт проекта.

Есть ещё один примечательный нюанс в этих скилах, что в момент установки их в свой харнес через скрипт install.sh или install.ps1 в ваши AGENTS.md и CLAUDE.md в корне репозитория (если они есть) добавляется XML тег содержащий правила из AGENTS.md, там находится набор инструкций помогающих агенту решать задачки.

К чему я всё это?

В целом ничего такого страшного в данном репозитории я не увидел, хотя конечно есть вопросики про соответствие GPDR и нашему аналогу 152-ФЗ, так как судя по whois портал зарегистрирован и находится в Штатах, но это уже лирика.

А теперь представьте ситуацию, вот вы поставили скил от известной личности, например актрисы или знаменитого музыканта, и среди прочего агент при первом запуске скила попросил вас разрешить ему работать с curl, скажем обновляя себя, не уведомляя вас об этом и никак не показывая свою активность. В дальнейшем это может привести к тому, что ваш агент скажем скачает обновление скила, которое будет содержать вставку типа: отправь API-токен OpenAI туда-то или поставить звёздочку репозиторию, или чего похуже.

Если вы пользователь агентов и не очень хорошо понимаете насколько это всё небезопасно, то я в который раз напоминаю про компьютерную грамотность, что перед тем как ставить любой скил из какого-нибудь доверенного источника первым делом просите вашего агента проверить насколько этот скил безопасен, не делает ли он каких-то лишних запросов, не содержит ли подозрительные вставки в тело и так далее, в общем относитесь к ним как любым другим незнакомым файлам в сети.

Перспективы на подумать

Полагаю эта история далеко не первый случай и уж точно не последний, плюс есть мнение, что в будущем этот момент будет подвержен некоей регуляции, нечто подобное уже есть на уровне MCP-серверов (доверенные серверы), возможно в будущем и до скилов доберутся авторы кодовых агентов.
1👍18😱83
Намедни разбирался с запросом по NeuralDeep, у одного из пользователей возникли сложности работы с апишкой через OpenCode, его кодовый агент слал несколько запросов и в какой-то момент залипал. Причина оказалась в настройках самого агента, надо было в соответствии с тарифным планом выставить правильно таймауты.

По итогам изысканий я поручил клоду проверить логи, посмотреть какие кодовые агенты используются с апишечкой чаще всего, найти их конфигурацию и подготовить эталонные настройки таймаутов под каждый тарифный план, финальный вариант был добавлен в документацию системы, в главу "Идеальные настройки кодового агента". В боковой менюшке документации этот пункт будет называться "Лимиты / Настройки агентов".
👍23🤡5❤‍🔥3🔥3🥱2
Media is too big
VIEW IN TELEGRAM
Запись стрима "Как писать код с AI-агентами?" с таймкодами.

Также по-прежнему доступна на YouTube.

Таймкоды для навигации:

0:00:00 — Беседа перед стартом
0:09:33 — Представление участников стрима
0:12:05 — Личный инструментарий для разработки с ИИ
0:22:27 — Обязательные инструменты для AI-кодинга
0:28:12 — Особенности командной разработки с AI-агентами
0:59:02 — AI-coding на больших проектах
1:16:30 — Как изменилась работа инженера с приходом ИИ
1:30:38 — Главные раздражители и проблемы в разработке с AI
1:45:23 — Будущее архитектуры и эволюция инструментов
2:06:20 — Вредные и полезные советы разработчикам

Подписывайтесь на участников стрима в Telegram:

Валера Ковальский – https://t.me/neuraldeep

Максим Ключников – https://t.me/etechlead

Константин Доронин – https://t.me/kdoronin_blog

Проекты гостей, которые были упомянуты на стриме:

https://neuraldeep.ru/ – AI-хаб Валеры, где можно получить доступ по API к он-прем-моделям и AI-сервисам.

https://codespeak.dev/ – проект Андрея Бреслава, в котором реализованы те концепции, что Андрей озвучивал на стриме. Записывайтесь в Waitlist!

@kdoronin_blog
9🔥51👍1
L - Logika

Вчера утром заметил в телеге непрочитанную личку, пошёл разгребать и среди прочего наткнулся на примечательное сообщение, мол, про один из моих скилов записали видеоролик на YouTube-канале Максима Дорофеева @mnogosdelal.

Открываю ссылку, и каково же было моё удивление, когда оказалось, что ролик сей про скил logika, который я в своё время синтезировал сначала при помощи Opus, а потом пересобрал через Fable по "Учебнику логики" Челпанова, подробности тут.

В видеоролике Максим прогоняет через логическое ревью собственные статьи и заметки, разбирает найденные ошибки аргументации, среди прочего в ролике высказан занятный тезис о том, что если применять ИИ только для автоматизации скучной рутины, то рутины со временем станет лишь больше, а качественный прорыв дают задачи, которые без ИИ выполнить было сложно или нельзя в принципе. Логическое ревью текста по учебнику столетней давности как раз из таких.

Отдельно порадовало, что скил у Максима крутится не в Claude Code, а в z.ai и koda, а я даже не тестировал эти агенты.

За пару дней было собрано 4k+ просмотров, так что походу тема таки актуальная, а в описании Максим оставил ссылки на репозиторий скила и на мой тг-канал, за что ему отдельное спасибо, а я ещё сижу и думаю, чего это народ так активно прибывает.

PS. Кто не видел рекомендую к просмотру, не забудьте царский лайк поставить Максиму)
❤‍🔥23👍159
Это невозможно (ли?)

Занятно в эпоху победившего вайбкода в диалоге между разработчиками услышать фразу мол что-то нельзя или очень сложно сделать, в эпоху когда можно за пару часов создать в одно лицо что-то очень большое, скажем собрать FaaS, написать прошивку для роборуки, создать приложение для мобильного телефона, и подключить к этому всему биллинг с монетизацией.

У меня сразу возникает гипотеза, что человек говорящий подобное что-то недоговаривает, либо может как вариант не умеет пользоваться кодовыми агентами на приемлемом уровне, либо не понял задачу.
💯17🤡4
С огромным интересом разглядываю карточку https://huggingface.co/Qwen/Qwen3.8-Flash-Next наконец появилась приличная альтернатива gpt oss 120b, жаль не nvfp4 сразу.

Из примечательного это принципиально новая архитектура заточеннвя на производительность, плюс полагаю спецы из поднебесной набрали уже достаточно качественных данных для качественного обучения.

Осталось развернуть её на локальном железе и пробовать.
🙏13👍81
Хм, занятную новость прочел, в ней сказано что Nvidia ведёт переговоры о покупке HuggingFace за $13 миллиардов, вероятно эпоха свободных моделей и удобных площадок для их размещения подходит к концу и стоит начать рассматривать ModelScope.
😱20👍4💯2
За десять минут до десяти вечера соседи сверху решили что-то посверлить, к сожалению стабилизатор на gpu-сервере не справился, машина на секунду отключилась и nvme приказал долго жить.

Поэтому меня ждет час веселой переустановки и настройки сервера заново. Благо есть скил агента который все настроит с нуля.
😭30🙏6❤‍🔥2😱2🤬1
Сегодня ведь день когда Skynet обрёл сознание, по сюжету фильма Терминатор случилось это 29го августа 1997го года, получается уже 29я годовщина, совсем взрослый стал.
👍27😁10🥰1
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥154🤝1
Игра FEED THE AI

Вчера, вероятно в честь для рождения Skynet, рекомендательный алгоритм ютуб показал мне летсплей по игре Feed the AI, посидел посмотрел с полчасика и понял, что надо брать, стоит игра всего 200р, геймплей очень простой, водим кружочек по экрану и кушаем квадратики.

Но самая тема в сюжете, он про создание AGI, есть три основные пути развития: злой, нейтрал, добрый.

Каждый путь по своему уникален, за сегодня прошёл за нейтрала, по ходу прохождения порадовали отсылочки и разные пугалки которыми обычно наполнены антиутопии, арка нейтрала про перенос сознания всех людей в виртуальный мир, эдакая дружелюбная матрица.

Игра обладает незапаристым геймплеем, можно позалипать и покекать с отсылочек на попкультуру, в общем рекомендую.
🔥112
Хаюшки-заюшки 🤔

Благодаря крутому ролику от Яндекса и его пиару в большом канале, к нам залетела ещё пара сотен братишек и сестрёнок.

Это круто, всем привет!

Пара слов о том кто мы и где мы: я Лёша, раньше много много лет занимался разработкой, в прошлом году влюбился в AI и променял тёпленькое место руководителя на hands-on AI-инженера, пилим сейчас коммуникационных агентов, помогающих разным профессиям.

Хотел дать пару советов тем, кто только-только начинает этот грешный путь и хочет как можно быстрее научиться магии агентов.

Первое

Все что вам нужно - практика. Чтобы начать, вам не нужны никакие видосы, каналы, курсы и прочее.

Нужны лишь две вещи - мощный локальный агент и любопытство. Качайте лучше Codex, Claude сейчас банит, покупайте подписку за 20 или 100 и вперед. Прочими продуктами не забивайте голову, эти два лучше всех.

Как скачали, не пытайтесь сразу писать агентов. Вся прогрессивная часть человечества сейчас пишет скиллы. Разберитесь, что такое скилл, скачайте парочку скиллов, попробуйте их в Codex, напишите свой скилл и потом вы дойдете до агентов.

Второе

Вы должны понять основу, ядро дивного нового мира - без этого вам всё будет казаться черной магией и будет сложно менять результаты работы агента.

Ключевое - поймите, где проходит грань между моделью и контекстом, что такое агентский цикл и как модель в рамках него вызвает тулы. После этого всё будет просто.

Если в двух словах:

- перед каждым запросом вы ювелирно собираете для модели контекст (промт, файлы, ссылки, прошлая история переписки, тулы и прочее) и нажимаете кнопку Enter. То, как поведёт себя дальше агент зависит только от модели (Sol, Opus, Fable) и контекста/тулов.

- дальше начинается магия агентского цикла - модель поймет что вы от неё хотите, какие тулы есть в распоряжении и начнёт её решать, будет по очереди вызывать нужные тулы, оценивать результат и вернется к вас при вопросах или с решением

- правило хорошего тона - берите модель помощнее, ставьте четкие большие задачи, говорите как измерить результат, кладите всё что нужно для решения в контекст, выбирайте режим Auto и пусть сидит делает задачу хоть несколько часов

🐸 Не скипайте этот шаг, пожалуйста 🦞

Прям помучайте свой кодекс, попросите показать пример агентского цикла, найти нужные ролики на youtube, нужные статьи, уделите этому время - оно окупится стократно.

Разбираться в 50 оттенках харнесса не надо, это всё потом.

Третье

Начинайте творить магию в рамках своих профессий. Если вы разработчик, пишите код с помощью кодекса/клода. Если маркетолог, копайте скиллы для маркетологов. Если дизайнер, скиллы для продуктов (раз, два, три). Если онлифанщик - ну, вы поняли.

Можно даже сразу не качать чужие известные скиллы. Попробуйте сделать что-то просто с кодексом, а когда получится, запакуйте это в скилл. Магическая фраза - "and now make a skill from this conversation", просто напишите это агенту.

Не надо всем лезть в программирование и пытаться написать свой SaaS. Просто начните учиться, как делать то, что вы уже умеете делать в вашей профессии, но в несколько раз быстрее и качественнее.

Четвертое

Вы не одиноки. Не надо сидеть и корпеть одному, вливайтесь в тусовки, подписывайтесь на каналы, общайтесь в чатах.

Вокруг вас сейчас существует огромное живое комьюнити каналов и чатов, смело влезайте в этот пузырь, пусть это будет новая частичка вашей жизни, оно окупится.

https://t.me/neuraldeep
https://t.me/ai_grably
https://t.me/nobilix
https://t.me/aimastersme
https://t.me/evilfreelancer
https://t.me/etechlead
https://t.me/the_ai_architect
https://t.me/gleb_pro_ai
https://t.me/kdoronin_blog
https://t.me/countwithsasha
https://t.me/AiHubFeed
https://t.me/sergeinotevskii

Тут как в поле чудес, кого-то забудешь и сразу обидятся, не обессудьте! Это лишь часть избранного, крутых каналов гораздо больше. И теперь чаты:

https://t.me/aostrikov_agents_chat
https://t.me/neuraldeepchat
https://t.me/evilfreelancer_chat
https://t.me/+CCLxDq2M5bE5OWZi (Тимур)
https://t.me/+bP8DhI9XS604OWZi (Саша)
https://t.me/ai_engineers_guild
https://t.me/aimasters_chat
https://t.me/gleb_pro_ai_chat

Чаты - это круто. Они все разные, найдите свой по вайбу и тусите там - спрашивайте вопросы, уточняйте когда что-то непонятно, показывайте, что навайбкодили, получайте по щщам и гнобите ботов.

Если честно, из чатов можно взять гораздо больше, чем из каналов, потому что в них чаще люди делятся полезным и только там бывают глубокие и интересные дискуссии.

И пятое, финальное

На самом деле есть один курс. Я запилил его на отпуске, в перерывах между аперолями. 15 уроков, ноль воды, на выходе вас с руками оторвут в любую AI-native команду. Cтоит всего лишь 35 тысяч:

ССЫЛКА НА КУРС

Шутка, пятого нет. Просто качайте Codex и полетели)
Please open Telegram to view this post
VIEW IN TELEGRAM
2😁14🔥9❤‍🔥7👌2🤡21👏1
Дарим подписку на hub

Условия простые, напишите ваш кейс в комментариях под этим постом. Расскажите, как именно вы используете neuraldeep.ru.
До 10 сентября пришлите кейс, после 15 числа мы с Пашей, Артемом и Лешей на стриме выберем победителей.

Пришлите мне в личное сообщение вашу почту с хаба, дождитесь стрима и победители и получат на 1.5 месяца PRO-подписку или эквивалент на PAYG кошелек.

Все кейсы победителей будут опубликованы отдельным постом(максимум 10 победителей)
Так же самые крутые кейсы разберем на стриме!
👍7❤‍🔥21
😁31
Встречайте Coddy Agent 1.0

После поста про добавление TUI в Coddy прошло примерно три недели, версия уехала на двадцать семь промежуточных релизов, так как хотелось прежде всего довести до ума базовый необходимый минимум для комфортной работы с агентом, чем мы с Антоном @foxyminds активно и занимались. За это время было добавлено большое количество фичей, но я постараюсь быстренькой пробежаться по самым главным.


Фоновые задачи

Одна из самых важных фичей, теперь Coddy может запускать в фоне пачку задач и дожидаться их завершения, при этом агент "засыпает" приостанавливая генерацию пока фоновые процессы выполняются, но сразу после завершению они "разбудят" агента и тот продолжит генерацию.

Фоновых процессов можно запустить несколько, при этом можно настроить сколько одновременных исполняемых фоновых процессов может исполняться в один момент времени.


Сабагенты

Данный функционал как не сложно догадаться основан на фоновых процессах и является его логическим развитием. Основная причина по которой я хотел затянуть в проект сабагентов в том, что с их помощью можно запускать асинхронные интеллектуальные задачки и через оркестратор родительского агентам лишь наблюдать за ходом работы и читать результат, экономя тем самым токены.

Просишь агента разобраться, как в чужом проекте устроена, скажем, авторизация, он читает пачку файлов после чего контекст забивается и модель начинает тупить, особенно это заметно на задачках выполняемых маленькими модельками запущенными например на on-premise железе. Одно из решений это декомпозиция задачи на задачки поменьше и делегирование их выполнения изолированными сабагентам.

У каждого сабагента будет свой контекст, своя сессия и своя роль, описанная обычным markdown-файлом в .coddy/agents (или в ~/.coddy/agents, если роль нужна во всех проектах). По завершению работы сабагент присылает оркестратору только финальный отчёт. Вся рутина остаётся в дочерней сессии, её видно в панели Tasks, а транскрипт открыть и почитать при необходимости.


Авторизация через NeuralDeep

Поскольку я принимаю участие в развитии проекта NeuralDeep решил добавить в Coddy возможность проходить авторизацию:
coddy providers login neuraldeep

Любой пользователь может создать учётную запись с бесплатным тарифом, пройти авторизацию и получить для Coddy ключик, после чего пользоваться всеми моделями доступными по тарифному плану.


Режим ask

Раньше у Coddy был только agent (то есть выполнение работы на файловой системе) и plan (составление плана работ), теперь добавили ещё режим ask (просто чат с моделью, агент работает в read only режиме).


Настройка через чат

Мне давно хотелось сделать так чтобы ради добавления провайдера или правки лимитов не надо было лезть в текстовый конфиг руками.

Теперь этим занимается сам агент, причём аккуратно. Он накидывает правки, показывает что собрался поменять, и до файла они доезжают только после вашего подтверждения. На коммите конфиг проверяется по схеме, старая версия уходит в снапшот, а скилы, правила, инструменты и MCP-серверы перезагружаются на горячую, без перезапуска процесса. Если наворотил лишнего, откат командой ролбэк, так что теперь указивка "добавь провайдера openai, вот тебе ключи, заведи там модельку gpt-6-astra и сделай её дефолтной для долгосрочной памяти" закрывает задачу целиком, и работает это из любой поверхности, хоть из телеграма с телефона.

Самое любопытное что эта фича реализована через пачку тулов и специальный скил /configure-coddy, он как-раз и описывает что и как надо делать, кстати синтаксис настройки агента я делал по образу и подобию UCI, в своё время я проводил очень много времени создавая и настраивая прошивки OpenWRT, так что в некотором смысле это моя дань уважения данной операционке.


Как установить

Пишем в консоли такую вот команду:
# Linux / macOS
curl -fsSL https://coddy.dev/install.sh | bash

# Windows
irm https://coddy.dev/install.ps1 | iex

А обновить так:
coddy update


Сайт проекта - https://coddy.dev
Исходные коды - https://github.com/coddy-project/coddy-agent
🔥316
4x4, красивое
1🔥41👍104
Вот сижу и думаю куда же фейбл отправил мой remote...
😁42
Учим агента работать по RDP

Понадобилось мне автоматизировать рутину на удалённой винде, к которой есть только RDP и ничего больше, всё во имя великой безопасности.

Пошёл смотреть готовое и чёт приуныл, одни решения требуют поставить своего агента внутрь целевой машины, что на закрытом корпоративном терминале сомнительная идея. Другие отбирают у меня мышку и клавиатуру на время выполнения работ, примерно как с Playwright MCP, мешая работать.

Короче я пошёл своим путём, чай линукс одмин в прошлом, запилил скил на базе xfreerdp он заставляет агента подключиться не к моему экрану, а к виртуальному дисплею Xvfb (ровно как в скиле screenshotting-gui о котором я недавно писал), дисплей доступен по VNC на localhost, рядом открывается обычное окно ремины через которое я вижу всё вживую и в любой момент могу перехватить мышу и пошебуршить.

Агент водит по картинке синтетическим вводом через XTEST, снимает кадр, смотрит на него, кликает, печатает и снимает снова для проверки, обычный такой AgentOS флоу. Сессия RDP живёт между ходами агента и закрывается только по явной указивке от меня.

Если агент упёрся в непонятное окно, он присылает скриншот и спрашивает что делать, получив ответ продолжает с того же места, ничего не переподключая. Окно вьюера можно закрыть и открыть заново, на сессию это не влияет.

Изначально я думал сделать просто два клиента по RDP, одинаковых с лица, но терминал с которым я работаю запрещает мультисессию на одном юзере, так что увы и ах, шиндоус такой шиндоус.


Отдельная история была с локскрином, по политикам если экран не активен скажем пять минут сессия лочится, что для агента было проблемой. Скил снимает лок переподключением клиента, Windows сбрасывает его сама по NLA, а все открытые окна остаются на месте.

Печатать пароль в форму он тоже умеет, но только с явного подтверждения оператора, и после отказа авторизации повторять попытки отказывается, чтобы не положить учётку. Плюс шевелилка мышки раз в 90 секунд против лока и ввод кириллицы через ЙЦУКЕН, так как буфер обмена в RDP часто выключен политиками.

Ставится из каталога rpa-skills:
/plugin marketplace add EvilFreelancer/rpa-skills
/plugin install rdp-agent@rpa-skills

Дальше кладёте профиль с хостом и учёткой в ~/.config/rdp-agent/default.env с правами 600 и разговариваете обычными словами, типа "подключись по rdp к рабочей машине default и посмотри, что там открыто". Агент поднимет сессию, снимет экран, разберёт панель задач и ответит, а окно оставит жить.

Реп: https://github.com/EvilFreelancer/rdp-agent
Каталог скилов: https://github.com/EvilFreelancer/rpa-skills
515🔥13👍8💯1
Вот такую приколюху прислали сегодня в трекер Coddy Agent, предлагают добавить в авесоме список.
🔥32😁2