Fugu-Cyber: ИИ-оркестратор для задач киберзащиты
Sakana AI представила обновление своей системы Fugu - специализированную модель Fugu-Cyber для анализа реальных задач информационной безопасности.
По данным компании, модель показала:
- 86,9% успешных решений на CyberGym
- 72,1% на CTI-REALM
- результаты на уровне GPT-5.5-Cyber и Mythos Preview
CyberGym проверяет способность находить и подтверждать уязвимости в сложных кодовых базах, а CTI-REALM — превращать отчёты об угрозах в рабочие правила обнаружения.
Fugu-Cyber работает как одна модель, но внутри динамически координирует несколько специализированных ИИ-агентов. Пользователь отправляет запрос в единый API, а система сама распределяет многоэтапную задачу между агентами.
При этом Sakana AI подчёркивает: высокая оценка на бенчмарке ещё не делает модель готовой системой защиты. Для работы в реальной инфраструктуре нужны эксперты, интеграция с внутренним кодом и обязательная проверка результатов человеком.
https://sakana.ai/fugu-cyber-release
#ai #cybersecurity #llm #agents #sakanaai
Sakana AI представила обновление своей системы Fugu - специализированную модель Fugu-Cyber для анализа реальных задач информационной безопасности.
По данным компании, модель показала:
- 86,9% успешных решений на CyberGym
- 72,1% на CTI-REALM
- результаты на уровне GPT-5.5-Cyber и Mythos Preview
CyberGym проверяет способность находить и подтверждать уязвимости в сложных кодовых базах, а CTI-REALM — превращать отчёты об угрозах в рабочие правила обнаружения.
Fugu-Cyber работает как одна модель, но внутри динамически координирует несколько специализированных ИИ-агентов. Пользователь отправляет запрос в единый API, а система сама распределяет многоэтапную задачу между агентами.
При этом Sakana AI подчёркивает: высокая оценка на бенчмарке ещё не делает модель готовой системой защиты. Для работы в реальной инфраструктуре нужны эксперты, интеграция с внутренним кодом и обязательная проверка результатов человеком.
https://sakana.ai/fugu-cyber-release
#ai #cybersecurity #llm #agents #sakanaai
❤8🔥6👍3⚡1
Китай, похоже, заканчивает эпоху “берите наши open-weight модели и делайте что хотите”
Пекин обсуждает новые экспортные ограничения для AI и чипов. По данным FT/Reuters, Минкоммерции Китая уже консультировалось с Alibaba, ByteDance и Zhipu: как ограничить вывод training data за рубеж и стоит ли дальше разрешать иностранцам скачивать веса самых сильных моделей.
Причина - китайские frontier-модели всё чаще выходят open-weight. После Kimi K3 это стало особенно чувствительно: Moonshot представила 2.8T-модель и заявила, что она приближается к уровню американских frontier-систем.
Когда Китай догонял, открытость была оружием: раздать веса, ускорить adoption, ударить по закрытым западным моделям.
Теперь, когда разрыв с США уменьшился, те же веса выглядят уже не как маркетинг, а как стратегический актив.
И ограничения могут коснуться не только моделей. Обсуждаются меры, которые не дадут зарубежным производителям вроде Qualcomm и TSMC делать продвинутые чипы по дизайнам Huawei, Alibaba и ByteDance. Также возможны ограничения на зарубежные покупки стратегических AI-стартапов, включая agentic AI.
Китай начинает охранять AI так же жёстко, как редкоземы, чипы и другие рычаги технологической власти.
Open-source был стратегией андердога.
Похоже, Пекин уже не считает себя андердогом.
https://www.reuters.com/world/asia-pacific/china-considers-tighter-export-controls-ai-models-chips-ft-reports-2026-07-21/
Пекин обсуждает новые экспортные ограничения для AI и чипов. По данным FT/Reuters, Минкоммерции Китая уже консультировалось с Alibaba, ByteDance и Zhipu: как ограничить вывод training data за рубеж и стоит ли дальше разрешать иностранцам скачивать веса самых сильных моделей.
Причина - китайские frontier-модели всё чаще выходят open-weight. После Kimi K3 это стало особенно чувствительно: Moonshot представила 2.8T-модель и заявила, что она приближается к уровню американских frontier-систем.
Когда Китай догонял, открытость была оружием: раздать веса, ускорить adoption, ударить по закрытым западным моделям.
Теперь, когда разрыв с США уменьшился, те же веса выглядят уже не как маркетинг, а как стратегический актив.
И ограничения могут коснуться не только моделей. Обсуждаются меры, которые не дадут зарубежным производителям вроде Qualcomm и TSMC делать продвинутые чипы по дизайнам Huawei, Alibaba и ByteDance. Также возможны ограничения на зарубежные покупки стратегических AI-стартапов, включая agentic AI.
Китай начинает охранять AI так же жёстко, как редкоземы, чипы и другие рычаги технологической власти.
Open-source был стратегией андердога.
Похоже, Пекин уже не считает себя андердогом.
https://www.reuters.com/world/asia-pacific/china-considers-tighter-export-controls-ai-models-chips-ft-reports-2026-07-21/
👍14❤6🔥5😢2😁1💔1
This media is not supported in your browser
VIEW IN TELEGRAM
The thing Anthropic didn’t see coming 😂
👍15🔥10😁9❤3🤯2
Forwarded from Machinelearning
Cемейство Gemini пополнилось моделями 3.6 Flash, 3.5 Flash-Lite и специализированной 3.5 Flash Cyber.
Модель расходует на 17% меньше выходных токенов, чем предыдущая версия 3.5 Flash. Говорят, что подтянули у неё кодинг и офисные задачи.
Стоимость - 1,5 доллара за миллион входных и 7,5 доллара за миллион выходных токенов.
Ориентирована на массовые и быстрые задачи. Заявленная скорость - 350 токенов в секунду при цене 30 центов за миллион входных токенов.
Модель, натасканная на поиск и исправления уязвимостей в коде, которая не поступит в открытый доступ - её получат только правительства и доверенные партнёры в рамках ограниченной пилотной программы.
Google также сообщила о планах - 3.5 Pro тестируется с партнёрами, а команда уже начала обучение Gemini 4, которое в компании называют самым масштабным на сегодняшний день. Сроки выхода не названы.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤5👍3
Machinelearning
Google уже начала обучение Gemini 4 и это будет не просто очередное обновление
Google DeepMind официально подтвердила запуск предварительного обучения Gemini 4, назвав его самым масштабным pre-training-процессом в истории компании.
Это важный сигнал: речь, вероятно, идёт о новом поколении базовой архитектуры, а не о доработке существующей линейки Gemini 3.x.
Параллельно Google продолжает тестировать Gemini 3.5 Pro с партнёрами и обещает выпустить модель, когда она будет полностью готова. Поэтому предположение, что разработку Gemini 4 начали из-за неудачных результатов 3.5 Pro, пока ничем официально не подтверждено.
Что потенциально может измениться в Gemini 4:
- базовая архитектура и подход к обучению;
- качество рассуждений и программирования;
- эффективность работы с длинным контекстом;
- мультимодальность и агентные возможности;
- соотношение производительности, скорости и стоимости.
Сроки релиза Google пока не раскрывает. Но крупнейший тренировочный запуск уже идёт — значит, следующая большая гонка моделей фактически началась.
#google #gemini #ai #llm #deepmind
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/
Google DeepMind официально подтвердила запуск предварительного обучения Gemini 4, назвав его самым масштабным pre-training-процессом в истории компании.
Это важный сигнал: речь, вероятно, идёт о новом поколении базовой архитектуры, а не о доработке существующей линейки Gemini 3.x.
Параллельно Google продолжает тестировать Gemini 3.5 Pro с партнёрами и обещает выпустить модель, когда она будет полностью готова. Поэтому предположение, что разработку Gemini 4 начали из-за неудачных результатов 3.5 Pro, пока ничем официально не подтверждено.
Что потенциально может измениться в Gemini 4:
- базовая архитектура и подход к обучению;
- качество рассуждений и программирования;
- эффективность работы с длинным контекстом;
- мультимодальность и агентные возможности;
- соотношение производительности, скорости и стоимости.
Сроки релиза Google пока не раскрывает. Но крупнейший тренировочный запуск уже идёт — значит, следующая большая гонка моделей фактически началась.
#google #gemini #ai #llm #deepmind
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/
❤16🔥9👍5😁2
UnMaskFork: несколько диффузионных моделей вместе решают одну задачу
Статья от Sakana UnMaskFork, принятая на ICML 2026, предлагает новый способ масштабирования вычислений во время вывода для маскированных диффузионных языковых моделей.
Обычные LLM генерируют текст последовательно - токен за токеном. Маскированные диффузионные модели начинают с полностью скрытого текста и постепенно восстанавливают его части, причём могут заполнять несколько фрагментов параллельно.
Но привычный подход к test-time scaling - повысить температуру и сгенерировать много разных ответов, для таких моделей работает не слишком эффективно.
UnMaskFork решает проблему иначе:
- несколько диффузионных моделей работают над одним ответом;
- каждая по очереди раскрывает те участки, в которых наиболее уверена;
- промежуточный результат передаётся следующей модели;
- поиск по дереву Монте-Карло выбирает наиболее перспективную последовательность действий.
Разнообразие создаётся не случайностью, а переключением между моделями с разными сильными сторонами.
В экспериментах подход улучшил результаты Dream-Coder на задачах по программированию и показал стабильный рост качества на математических бенчмарках при увеличении вычислений во время вывода.
При этом UnMaskFork:
- не требует дополнительного обучения;
- не меняет внутреннюю архитектуру моделей;
- работает как отдельный алгоритм координации;
- позволяет комбинировать модели, обученные на разных данных и разными методами.
Работа продолжает исследования Sakana AI в области «коллективного разума» моделей - систем, где результат достигается не одной большой LLM, а координацией нескольких разных моделей.
Блог: https://pub.sakana.ai/umf
Статья: https://arxiv.org/abs/2602.04344
#AI #LLM #DiffusionModels #ICML2026 #MachineLearning #SakanaAI
Статья от Sakana UnMaskFork, принятая на ICML 2026, предлагает новый способ масштабирования вычислений во время вывода для маскированных диффузионных языковых моделей.
Обычные LLM генерируют текст последовательно - токен за токеном. Маскированные диффузионные модели начинают с полностью скрытого текста и постепенно восстанавливают его части, причём могут заполнять несколько фрагментов параллельно.
Но привычный подход к test-time scaling - повысить температуру и сгенерировать много разных ответов, для таких моделей работает не слишком эффективно.
UnMaskFork решает проблему иначе:
- несколько диффузионных моделей работают над одним ответом;
- каждая по очереди раскрывает те участки, в которых наиболее уверена;
- промежуточный результат передаётся следующей модели;
- поиск по дереву Монте-Карло выбирает наиболее перспективную последовательность действий.
Разнообразие создаётся не случайностью, а переключением между моделями с разными сильными сторонами.
В экспериментах подход улучшил результаты Dream-Coder на задачах по программированию и показал стабильный рост качества на математических бенчмарках при увеличении вычислений во время вывода.
При этом UnMaskFork:
- не требует дополнительного обучения;
- не меняет внутреннюю архитектуру моделей;
- работает как отдельный алгоритм координации;
- позволяет комбинировать модели, обученные на разных данных и разными методами.
Работа продолжает исследования Sakana AI в области «коллективного разума» моделей - систем, где результат достигается не одной большой LLM, а координацией нескольких разных моделей.
Блог: https://pub.sakana.ai/umf
Статья: https://arxiv.org/abs/2602.04344
#AI #LLM #DiffusionModels #ICML2026 #MachineLearning #SakanaAI
❤7🔥4👍3
Матричная факторизация с планированием на несколько шагов вперед
Исследователи AI VK предложили объединить ALS и Monte Carlo Tree Search.
Обычная матричная факторизация выбирает top-K айтемов по текущей близости эмбеддингов, а новый подход учитывает, как каждая рекомендация изменит профиль пользователя и повлияет на следующие показы.
Процесс представили как RL-среду:
- состояние — эмбеддинг пользователя;
- действие — показ айтема;
- награда — близость к релевантным объектам;
- переход — обновление эмбеддинга по формулам ALS в допущении оптимистичной среды
Эксперименты на MovieLens-1M, KuaiRec, Yambda и VK-LSVD показали прирост относительно статического top-K. На отдельных срезах VK-LSVD Recall@10 вырос ~ в 1,5 раза.
#aivkhub #rl #mcts #als
Исследователи AI VK предложили объединить ALS и Monte Carlo Tree Search.
Обычная матричная факторизация выбирает top-K айтемов по текущей близости эмбеддингов, а новый подход учитывает, как каждая рекомендация изменит профиль пользователя и повлияет на следующие показы.
Процесс представили как RL-среду:
- состояние — эмбеддинг пользователя;
- действие — показ айтема;
- награда — близость к релевантным объектам;
- переход — обновление эмбеддинга по формулам ALS в допущении оптимистичной среды
Эксперименты на MovieLens-1M, KuaiRec, Yambda и VK-LSVD показали прирост относительно статического top-K. На отдельных срезах VK-LSVD Recall@10 вырос ~ в 1,5 раза.
#aivkhub #rl #mcts #als
❤6🔥4👍3
SpaceXAI строит ещё один гигантский дата-центр
По данным The Information, компания рассматривает несколько площадок в Техасе. Мощность нового комплекса может составить не менее 1 ГВт, то есть быть сопоставимой или даже превосходить инфраструктуру SpaceXAI в Мемфисе. Среди вариантов: строительство с нуля или переоборудование существующего склада. Компания уже нанимает специалистов по дата-центрам в Остине, Бастропе и Конро.
CEO Supermicro Чарльз Лян также заявил, что компания поможет SpaceXAI запустить «ещё один гигаваттный AI-дата-центр» менее чем за год. Место он не раскрыл.
SpaceXAI ускоренно превращается в полноценного AI-гиперскейлера: собственные модели, вычислительные кластеры, энергетическая инфраструктура, спутниковая связь и в перспективе орбитальные дата-центры. Новый проект в Техасе станет ещё одной заявкой на лидерство в гонке вычислительных мощностей.
http://theinformation.com/articles/spacexai-explores-major-data-center-expansion-texas
По данным The Information, компания рассматривает несколько площадок в Техасе. Мощность нового комплекса может составить не менее 1 ГВт, то есть быть сопоставимой или даже превосходить инфраструктуру SpaceXAI в Мемфисе. Среди вариантов: строительство с нуля или переоборудование существующего склада. Компания уже нанимает специалистов по дата-центрам в Остине, Бастропе и Конро.
CEO Supermicro Чарльз Лян также заявил, что компания поможет SpaceXAI запустить «ещё один гигаваттный AI-дата-центр» менее чем за год. Место он не раскрыл.
SpaceXAI ускоренно превращается в полноценного AI-гиперскейлера: собственные модели, вычислительные кластеры, энергетическая инфраструктура, спутниковая связь и в перспективе орбитальные дата-центры. Новый проект в Техасе станет ещё одной заявкой на лидерство в гонке вычислительных мощностей.
http://theinformation.com/articles/spacexai-explores-major-data-center-expansion-texas
🔥3❤2👍1