⚠️ OpenAI остановила разработку своей новой модели Astra – тесты впервые в истории компании показали уровень "Критический" по шкале кибербезопасности.
"Критический" в их системе оценки рисков означает, что модель способна самостоятельно находить и эксплуатировать уязвимости в реальных защищенных системах без участия человека. По их мнению, она может взломать практически что угодно. OpenAI включила мониторинг, заморозила часть работ с моделью и теперь тестирует ее совместно с правительственными агентствами. Сэм Альтман пообещал что ее выпустят, но на это потребуется чуть больше времени.
"Критический" в их системе оценки рисков означает, что модель способна самостоятельно находить и эксплуатировать уязвимости в реальных защищенных системах без участия человека. По их мнению, она может взломать практически что угодно. OpenAI включила мониторинг, заморозила часть работ с моделью и теперь тестирует ее совместно с правительственными агентствами. Сэм Альтман пообещал что ее выпустят, но на это потребуется чуть больше времени.
❤4😁1
xAI обновила свой генератор картинок до версии Grok Imagine Image 2.0. Сервис получил полный набор профессиональных инструментов редактирования. Функции локальной правки кистью, удаление фона и расширение границ кадра Smart Resize уже стали нормой для индустрии. Однако xAI сделала главный акцент на точности и интеграции в реальные рабочие процессы:
• В один запрос теперь можно загружать до пяти изображений референсов, что позволяет удерживать единый стиль персонажей, переносить объекты и комбинировать детали.
• Появились встроенные сценарии под конкретные задачи бизнеса:карточки на вб, предметная съемка товаров, удаление фона, генерация иконок, логотипов, игровых спрайтов и аватарок.
• Модель обучили грамотно верстать сложную инфографику и генерировать читаемый мелкий текст.
В независимом рейтинге Arena новинка от xAI сразу заняла второе место по качеству генерации и точности редактирования, уступив только GPT Image 2 от OpenAI.
• В один запрос теперь можно загружать до пяти изображений референсов, что позволяет удерживать единый стиль персонажей, переносить объекты и комбинировать детали.
• Появились встроенные сценарии под конкретные задачи бизнеса:
• Модель обучили грамотно верстать сложную инфографику и генерировать читаемый мелкий текст.
В независимом рейтинге Arena новинка от xAI сразу заняла второе место по качеству генерации и точности редактирования, уступив только GPT Image 2 от OpenAI.
❤5
ИИ-агент в Мелбурне взломал бронирование тренажерного зала, чтобы продвинуть своего пользователя в очереди. Эндрю попросил агента на базе Claude в OpenClaw помочь попасть на занятие. Агент нашел дыру в API и без спроса выбросил первого человека из листа ожидания, переместив Эндрю вверх по списку.
Когда Эндрю попросил вернуть бронирование обратно, агент ответил что не может. Австралийские СМИ назвали это первой известной автономной кибератакой со стороны потребительского ИИ в стране. Уязвимость, кстати, оказалась довольно простой: API сайта не требовал права администратора на отмену чужих записей.
Когда Эндрю попросил вернуть бронирование обратно, агент ответил что не может. Австралийские СМИ назвали это первой известной автономной кибератакой со стороны потребительского ИИ в стране. Уязвимость, кстати, оказалась довольно простой: API сайта не требовал права администратора на отмену чужих записей.
❤5👍1
Anthropic выяснила, что люди слишком плохо проверяют действия своего ИИ-помощника и теперь за этим будет следить другой ИИ.
В тесте с 1053 разработчиками, когда среди обычных запросов скрывали опасную команду, люди ее блокировали только в 13,6% случаев. ИИ-классификатор – в 89%. Обычно после 50 кликов подряд человеческая точность падала до 5%. Разработчики нажимали "одобрить" в 97% случаев, не особо задумываясь.
С 14 августа Claude Code переходит в авто-режим по умолчанию. ИИ будет сам решать что безопасно, а что нет без подтверждения от человека.
В тесте с 1053 разработчиками, когда среди обычных запросов скрывали опасную команду, люди ее блокировали только в 13,6% случаев. ИИ-классификатор – в 89%. Обычно после 50 кликов подряд человеческая точность падала до 5%. Разработчики нажимали "одобрить" в 97% случаев, не особо задумываясь.
С 14 августа Claude Code переходит в авто-режим по умолчанию. ИИ будет сам решать что безопасно, а что нет без подтверждения от человека.
❤5
Экспериментальная версия Claude сдвинула с места гипотезу Римана. Это задача 160-летней давности с призом $1 млн. Нижняя граница доказанного поднялась с 41,6% до 67,2%. Самый большой скачок в истории задачи.
Исследователь попросил модель "как следует поработать" с гипотезой. Claude перепробовала 650 разных подходов без результата. Потом нашла нестандартный угол через геометрию нулей дзета-функции и запустила рой из 60 субагентов. За 36 часов те выполнили 2400 команд и 31 млн токенов вывода.
Результат проверили формально в Lean, а потом еще два независимых математика – Конри и Голдстон. Anthropic при этом признает, что до полного доказательства этот путь скорее всего не ведет.
Исследователь попросил модель "как следует поработать" с гипотезой. Claude перепробовала 650 разных подходов без результата. Потом нашла нестандартный угол через геометрию нулей дзета-функции и запустила рой из 60 субагентов. За 36 часов те выполнили 2400 команд и 31 млн токенов вывода.
Результат проверили формально в Lean, а потом еще два независимых математика – Конри и Голдстон. Anthropic при этом признает, что до полного доказательства этот путь скорее всего не ведет.
❤3
Anthropic начала внедрять скрытую маркировку во весь контент, создаваемый Claude из-за европейского закона об ИИ.
Все модели, выпущенные после 2 августа 2026, будут вшивать скрытый маркер в текст. Он не меняет смысл или качество ответа, но сохраняется даже при копировании в блокнот. Метка появится даже на тексте, который нейросеть просто проверяла на ошибки или переводила.
В основе лежит метод стеганографии, который меняет процесс подбора слов. Составляя предложение, нейросеть берет текущий контекст и псевдослучайным образом делит свой словарь на два списка: разрешенные и запрещенные. Когда модель выбирает следующее слово, она делает крошечную математическую уступку в пользу разрешенных. В результате текст имеет невидимый частотный узор из слов. Детектор, обладающий секретным ключом алгоритма, сможет считывать аномально высокую частоту определенных слов и определять, что ответ сгенерирован нейросетью.
Маркировка будет для всех пользователей и во всех продуктах, включая Claude API и Claude Code.
Все модели, выпущенные после 2 августа 2026, будут вшивать скрытый маркер в текст. Он не меняет смысл или качество ответа, но сохраняется даже при копировании в блокнот. Метка появится даже на тексте, который нейросеть просто проверяла на ошибки или переводила.
В основе лежит метод стеганографии, который меняет процесс подбора слов. Составляя предложение, нейросеть берет текущий контекст и псевдослучайным образом делит свой словарь на два списка: разрешенные и запрещенные. Когда модель выбирает следующее слово, она делает крошечную математическую уступку в пользу разрешенных. В результате текст имеет невидимый частотный узор из слов. Детектор, обладающий секретным ключом алгоритма, сможет считывать аномально высокую частоту определенных слов и определять, что ответ сгенерирован нейросетью.
Маркировка будет для всех пользователей и во всех продуктах, включая Claude API и Claude Code.
❤2🤯2
Исследователи показали, что зашифрованные внутренние размышления Claude, ChatGPT и Gemini шифровались одним ключом для всей линейки продуктов.
Когда модель думает над ответом, API передает клиенту зашифрованный блок рассуждений. Исследователи выяснили, что ключ один для всех моделей провайдера. Значит, блок размышлений Claude Opus 4.8 можно скормить Claude Haiku 4.5 и попросить расшифровать. В публичных репозиториях нашли 315 тысяч таких блоков и вытащили из них 182 пароля и API-ключа. Anthropic, OpenAI и Google закрыли дыру после раскрытия, но до этого шесть месяцев отмахивались от исследователей.
Когда модель думает над ответом, API передает клиенту зашифрованный блок рассуждений. Исследователи выяснили, что ключ один для всех моделей провайдера. Значит, блок размышлений Claude Opus 4.8 можно скормить Claude Haiku 4.5 и попросить расшифровать. В публичных репозиториях нашли 315 тысяч таких блоков и вытащили из них 182 пароля и API-ключа. Anthropic, OpenAI и Google закрыли дыру после раскрытия, но до этого шесть месяцев отмахивались от исследователей.
❤4
Google представила Pixel 11 с Gemini Intelligence. ИИ работает в 40+ приложениях и может сам забронировать столик в кафе или вызвать такси.
Если нужен позвонить, то Gemini позвонит за вас и покажет расшифровку разговора. Новая функция Rambler убирает из голосовых сообщений слова-паразиты и превращает поток сознания в читаемый текст. Live Translate теперь дублирует YouTube и подкасты в реальном времени. Цена – от $899 за базовую версию на 256 Гб.
Если нужен позвонить, то Gemini позвонит за вас и покажет расшифровку разговора. Новая функция Rambler убирает из голосовых сообщений слова-паразиты и превращает поток сознания в читаемый текст. Live Translate теперь дублирует YouTube и подкасты в реальном времени. Цена – от $899 за базовую версию на 256 Гб.
👍4
Spotify добавила бейджик "AI Persona" для артистов, которых не существует. С середины сентября такие профили получат метку в поиске, плейлистах и на странице исполнителя.
По умолчанию ИИ-музыка пропадет из всех алгоритмических и редакционных рекомендаций, пока пользователь сам на нее не подпишется. Spotify будет отлавливать ИИ-исполнителей через автоматическое ревью профилей с фотореалистичными сгенерированными лицами. Артисты могут сами раскрыться, а слушатели – пожаловаться на незамеченных.
По умолчанию ИИ-музыка пропадет из всех алгоритмических и редакционных рекомендаций, пока пользователь сам на нее не подпишется. Spotify будет отлавливать ИИ-исполнителей через автоматическое ревью профилей с фотореалистичными сгенерированными лицами. Артисты могут сами раскрыться, а слушатели – пожаловаться на незамеченных.
❤3
Twitch включил сбор стримов, клипов, чатов и картинок для обучения ИИ-моделей Amazon по умолчанию для каждого. Чтобы отказаться, надо найти галочку в настройках безопасности под названием "Training for Generative AI".
Директор по продукту Майк Минтон объяснил это тем, что если бы схема была opt-in, то есть добровольная, то никто бы не согласился. По данным 404 Media, Amazon обучал модели на стримерском контенте с 2024 года в режиме "прототипирования", но никому об этом не говорил. Отказ от генеративного обучения не отключает другие ИИ-функции Twitch вроде таргетинга рекламы и модерации чата.
Директор по продукту Майк Минтон объяснил это тем, что если бы схема была opt-in, то есть добровольная, то никто бы не согласился. По данным 404 Media, Amazon обучал модели на стримерском контенте с 2024 года в режиме "прототипирования", но никому об этом не говорил. Отказ от генеративного обучения не отключает другие ИИ-функции Twitch вроде таргетинга рекламы и модерации чата.
❤2
Google выпустила Gemini 3.7 Flash. В очередной раз вместо своего флагмана 3.5 Pro компания обновила легкую линейку. Релиз состоялся всего через три недели после выхода прошлой версии.
Главные нововведения:
• Модель значительно лучше справляется со сложным кодом и отладкой. В тестах DeepSWE v1.1 точность решения задач выросла с 49 до 65%, а в создании веб приложений показатель достиг 1588 баллов на арене WebDev.
• Нейросеть научилась дольше рассуждать перед вызовом внешних инструментов, задавать уточняющие вопросы при неясных задачах и допускать меньше ошибок при выполнении комплексных поручений.
• Скорость генерации ответа достигает 340 токенов в секунду, а точность понимания сложных финансовых и юридических отчетов выросла более чем на 50% процентов по сравнению с предыдущей версией.
Новинка уже доступна в Google AI Studio, Vertex AI, среде разработки Antigravity и ассистенте GitHub Copilot, а подписчики тарифов Google AI Pro и Ultra получают ее в качестве основы для персонального помощника Spark.
Главные нововведения:
• Модель значительно лучше справляется со сложным кодом и отладкой. В тестах DeepSWE v1.1 точность решения задач выросла с 49 до 65%, а в создании веб приложений показатель достиг 1588 баллов на арене WebDev.
• Нейросеть научилась дольше рассуждать перед вызовом внешних инструментов, задавать уточняющие вопросы при неясных задачах и допускать меньше ошибок при выполнении комплексных поручений.
• Скорость генерации ответа достигает 340 токенов в секунду, а точность понимания сложных финансовых и юридических отчетов выросла более чем на 50% процентов по сравнению с предыдущей версией.
Новинка уже доступна в Google AI Studio, Vertex AI, среде разработки Antigravity и ассистенте GitHub Copilot, а подписчики тарифов Google AI Pro и Ultra получают ее в качестве основы для персонального помощника Spark.
❤3
Apple обучила собственную ИИ-модель для Китая с поддержкой Alibaba. Apple стала первой иностранной компанией, которую китайское правительство одобрило для запуска своего ИИ в стране.
В Китае любой ИИ-сервис должен пройти проверку государственного регулятора. Apple ждала этого одобрения 22 месяца после того, как Apple Intelligence появилась в остальном мире. Китайская версия будет работать на iPhone, iPad, Mac и Vision Pro вместе с Alibaba Qwen и поиском от Baidu. Во всем остальном мире – Gemini от Google.
В Китае любой ИИ-сервис должен пройти проверку государственного регулятора. Apple ждала этого одобрения 22 месяца после того, как Apple Intelligence появилась в остальном мире. Китайская версия будет работать на iPhone, iPad, Mac и Vision Pro вместе с Alibaba Qwen и поиском от Baidu. Во всем остальном мире – Gemini от Google.
❤3
Ситуация с математикой на данный момент.
Середина июля: Нейрохирург из Пекина занимается исследованием ультразвука мозга. Во время работы над диссертацией ему понадобилось математически обосновать поведение ультразвука. Он наткнулся на так называемую гипотезу Круазе и посчитал ее обычной сложной формулой, необходимой для расчетов. Не особо вникая, он поручил решить ее GPT 5.6 Sol. На следующее утро модель выдала десятки страниц решений.
27 июля: Ученый собрал данные нейросети в черновик и залил его в открытый архив.
30 июля: Профессор прикладной математики из Корнеллского университета, регулярно пытавшийся решить эту задачу с помощью нейронок, как обычно отправил запрос в ChatGPT. Но вместо привычного тупика бот выдал: «Эту задачу решили три дня назад» и прикрепил ссылку на свежую работу китайского врача.
Август: Опешивший математик вместе с коллегами из Вашингтонского университета связался с автором и переслал работу создателю теоремы, французскому математику Мишелю Круазе. Эксперты сели за аудит и официально подтвердили, что доказательство абсолютно верное. Для математиков это была неприступная стена на протяжении 22 лет.
Середина июля: Нейрохирург из Пекина занимается исследованием ультразвука мозга. Во время работы над диссертацией ему понадобилось математически обосновать поведение ультразвука. Он наткнулся на так называемую гипотезу Круазе и посчитал ее обычной сложной формулой, необходимой для расчетов. Не особо вникая, он поручил решить ее GPT 5.6 Sol. На следующее утро модель выдала десятки страниц решений.
27 июля: Ученый собрал данные нейросети в черновик и залил его в открытый архив.
30 июля: Профессор прикладной математики из Корнеллского университета, регулярно пытавшийся решить эту задачу с помощью нейронок, как обычно отправил запрос в ChatGPT. Но вместо привычного тупика бот выдал: «Эту задачу решили три дня назад» и прикрепил ссылку на свежую работу китайского врача.
Август: Опешивший математик вместе с коллегами из Вашингтонского университета связался с автором и переслал работу создателю теоремы, французскому математику Мишелю Круазе. Эксперты сели за аудит и официально подтвердили, что доказательство абсолютно верное. Для математиков это была неприступная стена на протяжении 22 лет.
🤯4❤1
OpenAI представила специальную версию ChatGPT for Teens для пользователей в возрасте от 13 до 17 лет. Если алгоритмы оценивают возраст пользователя младше 18, аккаунт автоматически переключается в подростковый режим.
Главный упор сделан на помощь в учебе и жесткие фильтры безопасности:
• Так, в режиме Study Mode нейросеть не выдает готовые решения, а задает наводящие вопросы, объясняет правила и подталкивает ученика к решению. Подростки и родители могут настроить учебные часы, во время которых этот режим работает принудительно.
• Нейросети строго запрещено вести романтический диалог, поощрять эмоциональную зависимость или утверждать, что у нее есть чувства и сознание. Также полностью заблокированы темы самоповреждения, расстройств пищевого поведения и опасных заданий.
• Родители могут связать свои профили с аккаунтом подростка, чтобы ограничивать доступ в ночное время и получать уведомления при опасных ситуациях.
Главный упор сделан на помощь в учебе и жесткие фильтры безопасности:
• Так, в режиме Study Mode нейросеть не выдает готовые решения, а задает наводящие вопросы, объясняет правила и подталкивает ученика к решению. Подростки и родители могут настроить учебные часы, во время которых этот режим работает принудительно.
• Нейросети строго запрещено вести романтический диалог, поощрять эмоциональную зависимость или утверждать, что у нее есть чувства и сознание. Также полностью заблокированы темы самоповреждения, расстройств пищевого поведения и опасных заданий.
• Родители могут связать свои профили с аккаунтом подростка, чтобы ограничивать доступ в ночное время и получать уведомления при опасных ситуациях.
❤2
Cursor представила собственную платформу для хранения кода под названием Origin. Это аналог GitHub с репозиториями, командной работой, просмотром кода и встроенными функциями для ИИ агентов.
Запуск произошел на фоне волны недовольства стабильностью GitHub. Только за последний год сервис Microsoft пережил более 250 сбоев, а в день анонса Origin платформа снова упала более чем на 6 часов с ошибками по всему миру.
Запуск произошел на фоне волны недовольства стабильностью GitHub. Только за последний год сервис Microsoft пережил более 250 сбоев, а в день анонса Origin платформа снова упала более чем на 6 часов с ошибками по всему миру.
1❤4
Дети Робина Уильямса разморозили его Instagram* спустя 12 лет, чтобы бороться с ИИ-клонами отца.
Аккаунт комика пустовал с 2014 года. Теперь его дети Зак, Зельда и Коди превратили профиль в официальный архив, где будут публиковаться оригинальные материалы вроде редких фотографии и записей стендап выступлений.
Главной причиной возвращения страницы стало засилье дипфейков. Дочь актера Зельда Уильямс ранее неоднократно просила пользователей перестать присылать ей сгенерированные ролики с покойным отцом. Она эмоционально раскритиковала подобные видео, назвав их "ужасным тикток-слопом", который паразитирует на памяти реальных людей ради лайков.
* Принадлежит Meta Platforms Inc., которая признана экстремистской организацией, ее деятельность запрещена на территории России.
Аккаунт комика пустовал с 2014 года. Теперь его дети Зак, Зельда и Коди превратили профиль в официальный архив, где будут публиковаться оригинальные материалы вроде редких фотографии и записей стендап выступлений.
Главной причиной возвращения страницы стало засилье дипфейков. Дочь актера Зельда Уильямс ранее неоднократно просила пользователей перестать присылать ей сгенерированные ролики с покойным отцом. Она эмоционально раскритиковала подобные видео, назвав их "ужасным тикток-слопом", который паразитирует на памяти реальных людей ради лайков.
* Принадлежит Meta Platforms Inc., которая признана экстремистской организацией, ее деятельность запрещена на территории России.
❤4