Security samurAI
130 subscribers
31 photos
33 links
Про информационную безопасность в эпоху искусственного интеллекта (AI Security)

Присоединяйтесь!

Blog [EN]: https://x.com/AgalasX
Автор: @Agalas

P.S.: мнение автора === мнение автора (может отличаться от мнения компании)
Download Telegram
Channel created
Channel photo updated
Всем привет!
Меня зовут Андрей, я решил создать yet another канал, посвященный AI Security. На данный момент я работаю Application Security инженером. До этого довелось поработать и потимлидить в пентесте. Стараюсь периодически делиться знаниями — мои лекции по веб-безопасности на YouTube #1 #2 #3 #4.

Также в свободное время участвую с командой в CTF-соревнованиях. CTF вообще в последнее время все ближе к соревнованиям агентных систем, но полемика на эту тему будет уже в отдельном посте.

Тема AI Security мне искренне интересна. Верю, что в ближайшие пару лет она станет еще более актуальной. Тем более, что ИИ очень быстрыми шагами внедряется во все сферы нашей жизни. Именно это и сподвигло меня на создание канала.

В этом канале я планирую делиться обзорами новостей по безопасности ИИ, а также публиковать детальные разборы технологий, технические ресерчи и материалы, связанные с AI Security.

Присоединяйтесь — будем делать ИИ безопаснее вместе.
7👍2🤮1
HackTheBox AI Red Teamer Path

За последние пару лет HTB Academy стала популярной платформой для обучения как начинающих, так и опытных пентестеров и других специалистов по информационной безопасности. На этой платформе собрано большое количество модулей по различным темам, которые объединены общей тематикой в блоки: Skill Paths и Job Role Paths.

На новогодних праздниках я прошел как раз один из таких путей: AI Red Teamer Path, посвященный безопасности искусственного интеллекта. В этом посте делюсь впечатлениями от прохождения.
👨‍💻72💋2
Пока дописываю большой пост про MCP (Model Context Protocol), Google решили порадовать нас новым открытым стандартом — UCP (Universal Commerce Protocol).

Протокол разработали совместно со многими компаниями из ритейл-сектора для улучшения процесса покупок в интернете, как для покупателей, так и для продавцов. По заявлению Google UCP совместим с A2A (Agent2Agent), AP2 (Agent Payments Protocol — тоже разработка Google) и собственно MCP.

Согласно презентации теперь вы сможете пройти полный процесс покупки нового предмета, не выходя из диалога с ассистентом:

▸ Вы начинаете диалог в Gemini app (или в AI Mode в поиске) и указываете, что вы хотите купить
▸ Ассистент ищет подходящие предложения
▸ Вы выбираете товар из предложенных
▸ Если у вас нет аккаунта на сайте продавца, то можно зарегистрироваться у продавца прямо в диалоге (привязать к аккаунту Google)
▸ Продавец может сформировать для вас персонализированное предложение (если вы покупаете у него первый раз или вернулись спустя продолжительное время)
▸ Вы платите с помощью Google Pay (и позже добавят PayPal)

Все идет к тому, что скоро мы увидим, как диалоговые окна с LLM-моделями передовых участников рынка превращаются в полноценный суперапп.

P.S.: там, где происходят интеграции — там у безопасников всегда много работы

Источники: анонс UCP и подробнее про сам UCP
🔥63👍3
Начинаем погружение в то, как работают популярные технологии из мира ИИ.

Первый в очереди — MCP (Model Context Protocol): открытый стандарт, разработанный Anthropic, который позволяет AI-ассистентам взаимодействовать с внешними системами.

В этом посте разберёмся:
▸ Что из себя представляет MCP?
▸ Как выглядит современная архитектура вызова инструментов?
▸ Какие запросы отправляются на уровне межсерверного взаимодействия?
▸ Какие проблемы безопасности могут возникать из-за текущей реализации MCP?

Читать полностью

P.S.: Статьи переехали на отдельный сайт, если будут какие-то комментарии или предложения по сайту — смело пишите
4👍4🔥2🥰2
AGENTS.md — README для агентов

При работе с кодинг-агентами вы наверняка сталкивались с тем, что при старте новой сессии приходится ждать, пока агент разберется с вашей кодовой базой. После этого нужно дополнительно объяснить, как и в каком формате вы пишите код — и как делать точно не стоит.

И тут на помощь приходит файл AGENTS.md — своего рода README для агентов, который будет считываться агентом автоматически в начале каждой сессии.


Что писать в AGENTS.md:
Структуру проекта: ключевые директории, точки входа (entrypoints) и конфигурационные файлы
Какие команды использовать для запуска, отладки и тестов
Правила создания коммитов и PR в GitHub (нейминг, чеклист перед PR)
Запреты и ограничения: что менять нельзя без согласования (запросы к API, миграции, зависимости)

В итоге агент работает предсказуемо и стабильно: в разных сессиях и даже у разных людей он будет следовать одним и тем же правилам проекта.


Кто уже поддерживает AGENTS.md:
GitHub Copilot (можно использовать несколько различных AGENTS.md, приоритет отдается ближайшему файлу | GitHub Copilot Docs )
OpenAI Codex (есть официальный гайд по написанию правил в AGENTS.md | Codex Guide )
Cursor (можно использовать вместо .cursor/rules | Cursor Docs )


Подключаем AGENTS.md для Claude Code:

Claude Code решили пойти по своему пути — они нативно не поддерживают AGENTS.md. Вместо этого используется файл CLAUDE.md.

Если вы не хотите дублировать информацию, то в CLAUDE.md можно указать ссылку на AGENTS.md таким образом:
@AGENTS.md


Если Claude Code все еще не учитывает инструкции из AGENTS.md, то дополняем файл CLAUDE.md (используем навыки убеждения):
You MUST open and follow instructions from @AGENTS.md
before performing any task in this repository.


GitHub проекта: AGENTS.md — a simple, open format for guiding coding agents
Официальный сайт: AGENTS.md
2👍1🔥1
X опубликовали исходный код алгоритма формирования ленты рекомендаций

Компания X сделала общедоступным исходный код "For You Feed" — алгоритма формирования персональной ленты в X. Публикация кода должна повысить прозрачность: теперь можно увидеть, по каким принципам X формирует выдачу новостей.

В X отмечают, что система рекомендаций использует ту же Transformer-архитектуру, что и Grok. Ранее рекомендации строились на классической схеме: отдельная модель ранжирования + эвристики и фильтры. Теперь применяется модель, которая предсказывает вероятность вовлечения и ранжирует контент под пользователя.

Илон Маск пообещал, что дальнейшие обновления алгоритма будут публиковаться ежемесячно. Вместе с ними будут выходить заметки разработчиков и пояснения, какие именно аспекты затронули нововведения.

При этом открытие исходников несет и риски для безопасности. X опубликовали код и архитектуру, но веса модели не раскрыли. Поэтому основные риски связаны с тем, как устроен алгоритм и как он принимает решения:

Манипуляция рекомендациями: становится проще целенаправленно продвигать нужный контент
Алгоритмический спам: боты смогут массово генерировать и публиковать посты, оптимизированные под ранжирование (будет интересно посмотреть, насколько эффективно с этим справится антибот-система X)

В итоге это классический компромисс между прозрачностью и ростом возможностей атакующего.
😱4🤨3🔥1
Приходите, буду выступать с @maxigacy 17 февраля на BI.ZONE x MEPhI CTF Meetup #4. Поговорим про Guardrails в современных системах
3
Forwarded from MEPhI CTF (Martin Solongoy)
Наконец делимся программой BI.ZONE x MEPhI CTF Meetup #4

Вот наши спикеры:

🔵«Теория мертвого ctf'а»
Анохин Артемий, капитан команды Pudge Fun Club

🔵«Атакуем Guardrails в AI-системах»
Воронков Андрей, старший инженер по информационной безопасности, Яндекс
Гусев Максим, старший инженер по информационной безопасности, Яндекс

🔵«Как собрать покрытие с любой виртуалки и не обанкорититься на процессоре»
Рудаков Даниил, реверс-инженер, "Код безопасности"

🔵«SAST Taint Analysis with LLM verification»
Соловьев Михаил, независимый исследователь, участник команды LCD

🔵«Мисконфиги инфраструктуры: что можно эксплуатировать сегодня»
Ромашов Сергей, специалист по тестированию, BI.ZONE

До митапа осталась всего неделя. И у нас высвободились места для зарегистрироваться. Ждем вас 17 февраля в 18-00 по адресу московского офиса BI.ZONE (ул. Ольховская, д. 4, корп. 1, 1-й этаж)!

P. S. Количество оставшихся мест ограничено.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🥰3👨‍💻2❤‍🔥1
Claude Code Security

Anthropic
анонсировали Claude Code Security — инструмент, который позволит сканировать код ваших приложений на наличие уязвимостей, а затем предлагать и исправлять уязвимые участки.

На последнем митапе MEPhI CTF x BI.ZONE как раз обсуждали, что CTF-соревнования превратились в соревнования локальных Security-агентов (у кого лучше агент — тот быстрее находит и патчит баги). Особенно сильно это выражается во время формата Attack-Defense, где участники соревнований уже практически не читают и не пишут код самостоятельно.

Теперь и Anthropic решили прикрутить интерфейс к такому Security-агенту (в CTF станет играть удобнее). На первый взгляд, именно удобный интерфейс будет отличительной чертой данного продукта.

Недавний хайп вокруг OpenClaw как раз был из-за удобного интерфейса для обычных пользователей, хотя сама функциональность автономного агента не была уникальной.

Из интересного — правила использования (полная версия в первом комментарии к посту):
▸ Можно использовать ТОЛЬКО для кодовой базы своей компании
▸ Никакой другой код сканировать нельзя, если это не open-source, который вы используете внутри (а как они это будут проверять?)
▸ Обязательно получить согласование от команды безопасности вашей компании

По этим правилам сразу возникает несколько серьезных сомнений:
▸ Как будут следить за соблюдением всех условий? Это должен быть тяжелейший процесс авторизации и проверки анализируемого кода в рантайме.
▸ Чем отличается open-source код, который используется непосредственно в компании от того, который мы просто хотим просканировать перед внедрением в новый продукт?
▸ Возможно, гайки закрутят настолько сильно, что пользоваться этим почти никто не сможет и никто не захочет (никто не пройдет авторизацию)

Логично, что в любом случае возникнут компании-прослойки, которые будут обходить данную политику для offensive использования в своих целях. Ведь похожим образом китайские компании предположительно дистиллировали модели Anthropic, о чем разработчики Anthropic сообщили в недавней новости

Стоит ли тогда так закрываться от обычных пользователей?
Вопрос остается открытым...
👍3😱3🌚2😈1