ML&|Sec Feed
1.36K subscribers
1.29K photos
87 videos
293 files
2K links
Feed for @borismlsec channel

author: @ivolake
Download Telegram
Forwarded from Russian OSINT
🈁 Anthropic делает автоматический режим в Claude Code стандартом для повышения безопасности и продуктивности

Компания Anthropic анонсировала переход на автоматический режим (auto mode) по умолчанию в инструменте Claude Code. С 14 августа 2026 года новые сессии для подписчиков тарифных планов Pro, Max и Team будут автоматически запускаться в этом режиме. Разработчики больше не списывают плату за токены, необходимые для работы классификатора безопасности, поэтому накладные расходы полностью берут на себя создатели сервиса.

Главной причиной этого шага стало то, что пользователи привыкают и рефлекторно одобряют 97% запросов разрешений, превращая ручной контроль в формальность. В отличие от ручного подтверждения, автоматический режим пропускает каждый вызов инструмента через специализированный классификатор, который выявляет и блокирует деструктивные, необратимые или выходящие за границы рабочей среды действия.

Анализ эмпирических данных показывает явное превосходство алгоритмического фильтра над человеческим фактором. В контролируемом эксперименте, проведённом с участием 1 053 профессиональных тестировщиков, люди смогли распознать только 13,6% опасных команд, тогда как классификатор предотвратил 89% угроз. В рамках независимых испытаний компании Trajectory Labs на 72 сценариях косвенных промпт-инъекций ИИ-модели Claude Fable 5, Claude Opus 5 и Claude Sonnet 5 под управлением автоматического режима отразили 100% атак, пока ИИ-модель GPT-5.6 Sol в среде Codex допустила 5,83% успешных атак.

✋ @Russian_OSINT
Please open Telegram to view this post
VIEW IN TELEGRAM
Опять в СМИ громкий заголовок: «ИИ впервые атаковал сам». Сначала FT, дальше все остальные, дальше русские агрегаторы, где из формулировки «почти автономная» аккуратно выпало слово «почти».

Открываем первоисточник. Израильская Dream нашла выложенный в открытый доступ рабочий каталог атакующего: 160 мегабайт, 1395 файлов, четыре дня июля, до восьми субагентов параллельно, 12 волн, госсистемы в Азии. Всё правда. Находка отличная.

Только читать её надо до конца.

Ни одного 0-day в атаке нет. Зашли через незакрытый API, отдающий базу сотрудников вообще без авторизации. Через отладочные эндпойнты, забытые в проде и выдающие валидную сессию на любой запрос. Через пароли, угаданные по шаблону из логина сотрудника.Через SSO, который доверяет сессии портала без MFA. 84 из 85 взломанных аккаунтов прошли внутрь.

Отдельно любопытна единственная попытка применить ИИ к поиску новых уязвимостей в коде. Фреймворк выкачал из документации учебные проекты интеграции с национальным SSO и прогнал по ним собственный статический анализатор на локальной модели. Нашёл пару потенциальных проблем — и ни одна не подтвердилась на живой системе. Ноль пересечений с финальным списком. Всё, что реально сработало, ищется обычным блэк-бокс-тестом за день.

Гардрейлы модели, кстати, обошли одной фразой: активность подавалась как «авторизованный пентест». Модель отказывалась ровно до тех пор, пока ей не сказали, что можно. Какая это была модель — Dream установить не смогла и пишет об этом прямо. Что не мешает заголовкам объяснять произошедшее опасностью открытых весов.

Теперь про то, кто публикует. Dream основал в 2023 году Шалев Хулио — сооснователь и бывший гендиректор NSO Group, той самой, с шпионским Pegasus и Entity List Минторга США. Вместе с Себастьяном Курцем, ушедшим с поста канцлера Австрии на фоне коррупционного расследования. Следом в Dream перешла дюжина людей из NSO. В июне компания подняла $260 млн при оценке $3 млрд — продаёт правительствам «суверенный ИИ» для защиты.

29 июля Dream публикует колонку «Правительства не готовы к автономным ИИ-атакам». 12 августа выходит отчёт, доказывающий колонку, — с эксклюзивом в FT. Вывод отчёта: защита должна стать AI-native и вероятностно рассуждать о вероятных путях атаки. То есть купите то, что мы продаём.

Вот только по их же собственным артефактам госконтур вскрыли не машиной. Его вскрыли тем, что в продакшене остались отладочные ручки. От этого не спасает суверенный ИИ за три миллиарда. От этого спасает код-ревью.

Продавали, естественно, заголовок.

@gostev_future
🔥 Нашёл отличный бесплатный ресурс по Harness Engineering - тому, что делает coding agents реально надёжными

Курс посвящён не очередному «как написать хороший промпт», а инженерии окружения вокруг Codex, Claude Code и других AI-агентов.

Разбирают:

* почему сильные агенты всё равно проваливают задачи;
* как сохранять контекст между длинными сессиями;
* зачем нужны AGENTS.md, feature_list.json и progress-файлы;
* как не дать агенту объявить задачу завершённой слишком рано;
* как встроить тестирование, observability и контроль в сам harness.

Есть теория, практические проекты и готовые шаблоны для репозиториев. Причём среди базовых материалов авторы прямо ссылаются на подходы OpenAI и Anthropic.

Главная идея очень правильная:

не пытаться бесконечно делать модель умнее промптами, а построить вокруг неё систему, в которой ошибаться сложнее.

И да - есть русская версия.

https://walkinglabs.github.io/learn-harness-engineering/ru/
Forwarded from Russian OSINT
💻 Материалы для ознакомления:
▪️DEF CON 34 presentations
▪️Black Hat USA 2026 Slides

✋ @Russian_OSINT
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from GitHub Community
Mysti — команда мечты агентов по программированию ИИ для VS Code.

Claude Code + openai Codex сотрудничают в режиме мозгового штурма, обсуждают решения и синтезируют лучший подход для вашего кода.

🐱 GitHub
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from эйай ньюз
DeepSeek выпустили собственный харнес и V4 Pro из превью

Основная фишка DeepSeek Harness — экстремальная модульность. Практически всё является модулем с возможностью хот релоада, динамически можно поменять и коннекторы моделей и сам агентный луп. О том как это работает выпустили детальнейший пейпер.

Вместе с этим выпустили V4 Pro из превью, традиционно выпустив веса под лицензией MIT.

Ну и ещё компания, как и обещала, поднимает цены с 16 августа. Инпут токены будут теперь дороже в 1.5x, аутпут более чем в 2x. Кроме этого в пиковые часы цена будет ещё удваиваться.

Веса V4 Pro 0813
DeepSeek Harness

@ai_newz
Forwarded from GitHub Community
SecureML — это библиотека Python с открытым исходным кодом, которая интегрируется с популярными фреймворками машинного обучения, такими как TensorFlow и PyTorch.

Он предоставляет разработчикам простые в использовании утилиты, чтобы гарантировать, что агенты ИИ работают с конфиденциальными данными в соответствии с требованиями по защите данных.

🐱 GitHub
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Forwarded from GitHub Community
Robin — это инструмент на базе искусственного интеллекта для проведения расследований OSINT в даркнете.

Он использует LLM для уточнения запросов, фильтрации результатов поиска в даркнете и предоставления сводки расследования.

🐱 GitHub
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from AISecHub
Leandro: AI SRE Agent with Prompt Injection Sandbox

Leandro is an open-source AI SRE agent that watches Kubernetes clusters, diagnoses pod incidents autonomously, and communicates findings over Google Chat. Built with a security-first architecture, it runs inside a NixOS VM on libvirt/KVM with default-deny egress via nftables, a tinyproxy allowlist for outbound HTTP, and a hard tool denylist specifically designed to block prompt injection attacks. Since the agent reads attacker-influenceable text like pod logs and cluster events by design, every capability is fenced by an explicit, auditable boundary, making it a practical reference implementation for secure AI agent deployment in production infrastructure.

#AISecurity #Kubernetes #PromptInjection #SRE #ApplicationSecurity

https://github.com/SoulKyu/leandro
Forwarded from GitHub Community
GHOSTCREW — универсальный набор для наступательной безопасности с архитектурой AI-агентов и MCP.

Интегрирует такие инструменты, как Nmap, Metasploit, FFUF, SQLMap. Позволяет пентестировать, охотиться за багами, охотиться за угрозами и отчётывать. Ответы на основе RAG с поддержкой локальной базы знаний.

🐱 GitHub
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from в IT и выйти
Гений обклеил автомобиль пленкой с капчей, чтобы обманывать ИИ-камеры на дороге — это сработало.

Для теста он взял Toyota Yaris 2009 года, сгенерировал пленку с хаотичным узором и проехал перед камерой с нарушениями.

В итоге система не смогла распознать автомобиль, потому что у ИИ не получилось его идентифицировать.

На проект парень потратил целый год, но одержал победу. Шах и мат, железяки.

@techmedia
Даже гууглу пришлось адаптироваться, когда вышел закон о русификации надписей............
Forwarded from InfoSec VK Hub
Сегодня расскажем, как мы упростили проверку заявок на доступ и какую часть этого процесса автоматизировали с помощью нового инструмента.

Ежедневно на согласование специалистам ИБ поступает не менее 2 тысяч заявок — и это только в IDM. Чтобы оценить каждую, недостаточно знать, кто и какую роль запрашивает. Важно понять, для какой задачи нужен доступ, какие полномочия у человека уже есть и как они сочетаются с новой ролью. Раньше специалистам приходилось искать эту информацию вручную в нескольких системах. При большом потоке именно сбор недостающих данных занимал значительную часть времени.

Так появилась «Эгида» — наш внутренний инструмент для оценки и ранжирования заявок на доступ. Она объединяет формальные признаки и анализ обоснования, рассчитывает оценку риска и показывает, какие факторы на неё повлияли. Благодаря этому специалист видит, какие заявки требуют повышенного внимания.

В карточках разбираем, как устроена оценка и какой путь проходит заявка внутри системы.

🔹В следующей части расскажем, что происходит, если данных недостаточно, сигналы противоречат друг другу или модель не уверена в оценке.

#разбор #IDM #автоматизация

VK Security | Буст этому каналу
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM