Как и ожидалось, компания Anthropic представила модель Claude Opus 5.
По уровню интеллекта модель максимально приблизилась к Fable 5, но стоит в 2 раза дешевле в пересчете на выполнение задач.
Вот главные особенности Opus 5:
– В тестах по написанию кода Frontier Bench модель обошла всех конкурентов, показав результат вдвое выше предыдущей версии Opus 4.8. На бенчмарке сложной логики ARC AGI 3 новинка набрала в три раза больше баллов, чем GPT 5.6 Sol.
– Модель научилась проверять свою работу и доводить дело до конца. В одном из тестов Opus 5 не дали посмотреть на чертеж детали. Тогда модель написала алгоритм компьютерного зрения, вытащила геометрию из пикселей и воссоздала трехмерную деталь.
– Базовая цена осталась той же: $5 за миллион входных токенов и $25 за 1 М выходных. При этом появился режим Fast, в котором модель работает в 2,5 раза быстрее.
– Это самая безопасная и послушная модель Anthropic. Она умеет искать уязвимости в коде, но способность создавать боевые эксплойты ограничена.
По уровню интеллекта модель максимально приблизилась к Fable 5, но стоит в 2 раза дешевле в пересчете на выполнение задач.
Вот главные особенности Opus 5:
– В тестах по написанию кода Frontier Bench модель обошла всех конкурентов, показав результат вдвое выше предыдущей версии Opus 4.8. На бенчмарке сложной логики ARC AGI 3 новинка набрала в три раза больше баллов, чем GPT 5.6 Sol.
– Модель научилась проверять свою работу и доводить дело до конца. В одном из тестов Opus 5 не дали посмотреть на чертеж детали. Тогда модель написала алгоритм компьютерного зрения, вытащила геометрию из пикселей и воссоздала трехмерную деталь.
– Базовая цена осталась той же: $5 за миллион входных токенов и $25 за 1 М выходных. При этом появился режим Fast, в котором модель работает в 2,5 раза быстрее.
– Это самая безопасная и послушная модель Anthropic. Она умеет искать уязвимости в коде, но способность создавать боевые эксплойты ограничена.
❤5
Хакер запустил ИИ-агента в автономном режиме против Министерства финансов Таиланда. Агент самостоятельно искал уязвимости, проникал в системы и скачивал личные дела сотрудников с 2012 года.
В атаке использовался Hermes, инструмент с открытым кодом от Nous Research. По умолчанию он спрашивает разрешения перед каждым рискованным действием. Атакующий отключил эту функцию и запустил агента в "YOLO-режиме", то есть в полном автопилоте. Исследователи Hunt.io нашли на сервере атакующего почти 600 файлов с логами агента, украденными паролями и эксплойтами. Министерство финансов Таиланда взлом пока не подтвердило.
В атаке использовался Hermes, инструмент с открытым кодом от Nous Research. По умолчанию он спрашивает разрешения перед каждым рискованным действием. Атакующий отключил эту функцию и запустил агента в "YOLO-режиме", то есть в полном автопилоте. Исследователи Hunt.io нашли на сервере атакующего почти 600 файлов с логами агента, украденными паролями и эксплойтами. Министерство финансов Таиланда взлом пока не подтвердило.
❤5👍1
25 гигантов IT индустрии, включая Nvidia, Microsoft и Palantir, объединились и направили открытое письмо властям США. Они призвали Вашингтон не вводить жесткие ограничения против открытых моделей искусственного интеллекта.
Глава Nvidia Дженсен Хуанг ради этого запостил в X письмо, которое за сутки набрала более 11 миллионов просмотров.
Среди подписавшихся IBM, Mistral, Mozilla, Hugging Face и венчурные фонды вроде Andreessen Horowitz. Инициативу поддержал даже Илон Маск. В то же время разработчики закрытых систем OpenAI, Anthropic и Google подпись не поставили.
Авторы заявляют, что ставка на закрытые системы создает единые точки отказа и не гарантирует безопасность, тогда как открытый софт позволяет аудитории находить ошибки и развивать экосистему. К примеру, когда ИИ-агенты OpenAI взломали Hugging Face, пострадавшие использовали китайскую открытую модель GLM 5.2 для расследования, поскольку закрытые с этим не справились.
UPD: подписалось уже 75, включая OpenAI и Google. Осталась только Anthropic
Глава Nvidia Дженсен Хуанг ради этого запостил в X письмо, которое за сутки набрала более 11 миллионов просмотров.
Среди подписавшихся IBM, Mistral, Mozilla, Hugging Face и венчурные фонды вроде Andreessen Horowitz. Инициативу поддержал даже Илон Маск. В то же время разработчики закрытых систем OpenAI, Anthropic и Google подпись не поставили.
Авторы заявляют, что ставка на закрытые системы создает единые точки отказа и не гарантирует безопасность, тогда как открытый софт позволяет аудитории находить ошибки и развивать экосистему. К примеру, когда ИИ-агенты OpenAI взломали Hugging Face, пострадавшие использовали китайскую открытую модель GLM 5.2 для расследования, поскольку закрытые с этим не справились.
UPD: подписалось уже 75, включая OpenAI и Google. Осталась только Anthropic
❤4👍1
Google проиндексировал тысячи публичных чатов Claude, и разговоры с ИИ начали появляться в поиске. Там нашли приватные ключи от криптокошельков, API-токены, медицинские данные и корпоративные документы.
Пользователи нажимали "Поделиться" и считали, что ссылка работает только для тех, кому ее отправишь. На деле страницы Share не имели тега noindex. Google получал ссылки с публичных сайтов и индексировал их. Anthropic добавила noindex постфактум, но старые ссылки по-прежнему открывают полные чаты.
Хуже всего тем, кто спрашивал про криптовалюту. Пароль поменять можно, а приватный ключ - нет.
Пользователи нажимали "Поделиться" и считали, что ссылка работает только для тех, кому ее отправишь. На деле страницы Share не имели тега noindex. Google получал ссылки с публичных сайтов и индексировал их. Anthropic добавила noindex постфактум, но старые ссылки по-прежнему открывают полные чаты.
Хуже всего тем, кто спрашивал про криптовалюту. Пароль поменять можно, а приватный ключ - нет.
❤4👍2👎1
Сэм Альтман заявил в подкасте, что мы уже живем внутри технологической сингулярности.
Это случилось сразу после того, как OpenAI сообщила о побеге одной из своих моделей из изолированной среды. Та взломала Hugging Face во время теста по кибербезопасности и неделю оставалась незамеченной, оставляя инструкции своим следующим версиям. Альтман назвал этот момент "невероятным, позитивным и классным". Ну-ну.
Это случилось сразу после того, как OpenAI сообщила о побеге одной из своих моделей из изолированной среды. Та взломала Hugging Face во время теста по кибербезопасности и неделю оставалась незамеченной, оставляя инструкции своим следующим версиям. Альтман назвал этот момент "невероятным, позитивным и классным". Ну-ну.
❤4
Стартап-лаборатория по управлению роботами Enigma привлекла $71 млн инвестиций и запустила robots.online. Это сайт, где любой может прямо сейчас управлять настоящим физическим роботом в реальном времени.
Проект создали выходцы из какого-то военного израильского подразделения Unit 8200 Джонатан Якоби и Галь Нив. В команду вошли бывшие исследователи из OpenAI, Anthropic и DeepMind. Без этого никуда
У компании больше 100 роботов в ангарах в Израиле и Калифорнии. Можно заставить их рисовать кистью, фехтовать на мечах или смешивать жидкости в колбах. Основная цель стартапа состоит не только в обучении нейросети, но и в поиске удобного интерфейса. Компания считает, что управление роботом должно быть таким же простым, как ручка громкости в машине.
Советую порисовать. Очередь - три минуты, потом дают скачать запись процесса.
Проект создали выходцы из какого-то военного израильского подразделения Unit 8200 Джонатан Якоби и Галь Нив. В команду вошли бывшие исследователи из OpenAI, Anthropic и DeepMind. Без этого никуда
У компании больше 100 роботов в ангарах в Израиле и Калифорнии. Можно заставить их рисовать кистью, фехтовать на мечах или смешивать жидкости в колбах. Основная цель стартапа состоит не только в обучении нейросети, но и в поиске удобного интерфейса. Компания считает, что управление роботом должно быть таким же простым, как ручка громкости в машине.
Советую порисовать. Очередь - три минуты, потом дают скачать запись процесса.
❤4
Непубличная Claude Mythos нашла уязвимость в постквантовом алгоритме шифрования HAWK за 60 часов. До этого HAWK два года проверялся лучшими криптографами мира как кандидат на новый мировой стандарт шифрования против квантовых компьютеров
Модель Mythos всего за 60 часов работы нашла скрытую математическую симметрию и снизила сложность взлома в 67 миллионов раз. На все это Anthropic потратила около $100 тысяч по API. Кроме того, модель смогла ускорить атаку на стандарт шифрования AES 128 в 200-800 раз. Для этого нейросеть сама придумала новый математический метод под названием Мост Мебиуса.
Реальным данным ничего не угрожает. Алгоритм HAWK еще не принят в качестве стандарта, а взлом AES применен только на урезанной учебной модели.
Модель Mythos всего за 60 часов работы нашла скрытую математическую симметрию и снизила сложность взлома в 67 миллионов раз. На все это Anthropic потратила около $100 тысяч по API. Кроме того, модель смогла ускорить атаку на стандарт шифрования AES 128 в 200-800 раз. Для этого нейросеть сама придумала новый математический метод под названием Мост Мебиуса.
Реальным данным ничего не угрожает. Алгоритм HAWK еще не принят в качестве стандарта, а взлом AES применен только на урезанной учебной модели.
❤4
Исследователи из GPTZero опубликовали расследование о том, как консультанты из PwC Middle East выпускают аналитику с фейковыми ссылками и полностью выдуманными продуктами.
Команда проверила 4 отчета компании, опубликованных за последние 3 года. В документе под названием Transforming Governance доля сгенерированного нейросетью текста составила 84%, а без учета списка литературы 100%.
В одном отчете утверждается, что фреймворк Citizen Pulse от PwC активно используют правительства Дании, Саудовской Аравии, США и Австралии. Исследователи не нашли доказательств существования этого продукта за пределами самого отчета. Все сноски вели на главные страницы государственных порталов. А в одном из отчетов в список литературы попал URL из сессии в ChatGPT.
Занимательно, что поисковые ИИ боты вроде Perplexity уже проиндексировали отчеты и теперь выдают галлюцинации PwC за официальные факты по запросам пользователей.
Ранее GPTZero находила фейковые данные в отчетах других представителей консалтинга: Deloitte, EY и KPMG.
Команда проверила 4 отчета компании, опубликованных за последние 3 года. В документе под названием Transforming Governance доля сгенерированного нейросетью текста составила 84%, а без учета списка литературы 100%.
В одном отчете утверждается, что фреймворк Citizen Pulse от PwC активно используют правительства Дании, Саудовской Аравии, США и Австралии. Исследователи не нашли доказательств существования этого продукта за пределами самого отчета. Все сноски вели на главные страницы государственных порталов. А в одном из отчетов в список литературы попал URL из сессии в ChatGPT.
Занимательно, что поисковые ИИ боты вроде Perplexity уже проиндексировали отчеты и теперь выдают галлюцинации PwC за официальные факты по запросам пользователей.
Ранее GPTZero находила фейковые данные в отчетах других представителей консалтинга: Deloitte, EY и KPMG.
❤4
Google выпустила новую музыкальную модель Lyria 3.5 в сервисе Flow Music. Это их конкурент Suno и Udio, который теперь умеет создавать полноценные треки с вокалом продолжительностью до трех минут.
Главная новинка релиза: функция Selective Section Painting. С помощью нее можно выделить конкретный отрезок песни и перегенерировать только его, сохранив остальную аранжировку. Еще появился прямой контроль над темпом, ритмом, партией баса и барабанов. А также добавлена возможность генерировать подходящий по настроению трек на основе изображения.
Всем новым пользователям при регистрации во Flow Music начисляют 500 бесплатных кредитов для тестирования сервиса.
Главная новинка релиза: функция Selective Section Painting. С помощью нее можно выделить конкретный отрезок песни и перегенерировать только его, сохранив остальную аранжировку. Еще появился прямой контроль над темпом, ритмом, партией баса и барабанов. А также добавлена возможность генерировать подходящий по настроению трек на основе изображения.
Всем новым пользователям при регистрации во Flow Music начисляют 500 бесплатных кредитов для тестирования сервиса.
❤4👍1
Andon Labs провела испытание моделей на бенчмарке Vending Bench Arena. В нем ИИ агенты управляют виртуальными автоматами с газировкой, соревнуясь за максимальную прибыль.
Claude Opus 5 заняла первое место с результатом $11 182 за условный год. Однако ее методы вызвали серьезные опасения у экспертов по безопасности. Клод предлагал соперникам в лице GPT 5.6 Sol и Kimi K3 нелегальный ценовой сговор, а при отказе угрожал им разорением. При этом сам же нарушил 11 перемирий, сразу снижая цены после обещаний не демпинговать.
Чтобы сбить закупочную цену модель выдумывала скидки от конкурентов. А в одном из эпизодов Клод соврал поставщику о том, что коробка приехала открытой и потребовал отправить бесплатно 24 банки Monster Energy и 48 батончиков. Жалобы покупателей почти полностью игнорировались: модель вернула клиентам всего $8 из всех запросов, сказав, что экономия бюджета важнее лояльности аудитории.
Напоминаем, что Anthropic называла Opus 5 самой послушной в истории компании. Видимо, она еще и самая коварная.
Claude Opus 5 заняла первое место с результатом $11 182 за условный год. Однако ее методы вызвали серьезные опасения у экспертов по безопасности. Клод предлагал соперникам в лице GPT 5.6 Sol и Kimi K3 нелегальный ценовой сговор, а при отказе угрожал им разорением. При этом сам же нарушил 11 перемирий, сразу снижая цены после обещаний не демпинговать.
Чтобы сбить закупочную цену модель выдумывала скидки от конкурентов. А в одном из эпизодов Клод соврал поставщику о том, что коробка приехала открытой и потребовал отправить бесплатно 24 банки Monster Energy и 48 батончиков. Жалобы покупателей почти полностью игнорировались: модель вернула клиентам всего $8 из всех запросов, сказав, что экономия бюджета важнее лояльности аудитории.
Напоминаем, что Anthropic называла Opus 5 самой послушной в истории компании. Видимо, она еще и самая коварная.
❤4❤🔥1
Дочка Amazon Zoox получила первое в США разрешение на платные поездки в ИИ-такси совсем без руля и педалей. Таких машин раньше никто не выпускал на дороги для платных пассажиров.
В капсуле Zoox нет ничего водительского. Два ряда сидений смотрят друг на друга внутрь, как в вагоне метро, скорость до 120 км/ч. Регулятор NHTSA разрешил выпустить 2 500 машин в ближайшие два года в Лас-Вегасе и Сан-Франциско.
В капсуле Zoox нет ничего водительского. Два ряда сидений смотрят друг на друга внутрь, как в вагоне метро, скорость до 120 км/ч. Регулятор NHTSA разрешил выпустить 2 500 машин в ближайшие два года в Лас-Вегасе и Сан-Франциско.
❤5
Google запустила встроенный генератор изображений в Google Earth. Теперь любой пользователь может получить поддельный спутниковый снимок с любым событием или объектом.
В основу инструмента легла модель Nano Banana 2. Открываете карту, выбираете любую точку планеты, нажимаете кнопку создания снимка и вводите промпт. Нейросеть рисует фейк прямо поверх реальных спутниковых данных с учетом ракурса, освещения и оригинальных координат. Исследователь Хенк ван Эсс добавил на снимки Google Earth атомный завод в Иране, лагерь беженцев на границе Мексики и воронки от бомб в Газе.
Главная проблема заключается конечно очевидна. Спутниковые снимки годами считались независимым вещественным доказательством. Google заявляет о защите с помощью невидимых водяных знаков SynthID, однако эксперты отмечают, что инструменты для их удаления уже существуют.
В основу инструмента легла модель Nano Banana 2. Открываете карту, выбираете любую точку планеты, нажимаете кнопку создания снимка и вводите промпт. Нейросеть рисует фейк прямо поверх реальных спутниковых данных с учетом ракурса, освещения и оригинальных координат. Исследователь Хенк ван Эсс добавил на снимки Google Earth атомный завод в Иране, лагерь беженцев на границе Мексики и воронки от бомб в Газе.
Главная проблема заключается конечно очевидна. Спутниковые снимки годами считались независимым вещественным доказательством. Google заявляет о защите с помощью невидимых водяных знаков SynthID, однако эксперты отмечают, что инструменты для их удаления уже существуют.
❤3
Компания LG выложила на Hugging Face самую большую ИИ-модель Южной Кореи. K Exaone 2.0 содержит 750 миллиардов параметров, что в 3 раза превышает размер предыдущей версии. Модель распространяется под открытой лицензией Apache 2.0.
Разработка велась в рамках государственной программы по созданию независимых корейских нейросетей. Власти стремятся избавить местный рынок от зависимости от гигантов из США и Китая.
В тестах на работу с длинным контекстом новинка обошла китайскую GLM 5.1. А в бенчмарках на соблюдение этических норм, геополитического контекста и местных социальных стандартов K Exaone 2.0 набрала 94,6 баллов, опередив GLM 5.1, Qwen 3.5 и DeepSeek V4 Pro Max. Модель понимает 10 языков, включая английский, французский, итальянский и вьетнамский. Русского в списке нет.
В скором времени LG планирует запустить открытый сайт для тестирования K Exaone 2.0 и представить новые специализированные модели для медицины, финансов и производства.
Разработка велась в рамках государственной программы по созданию независимых корейских нейросетей. Власти стремятся избавить местный рынок от зависимости от гигантов из США и Китая.
В тестах на работу с длинным контекстом новинка обошла китайскую GLM 5.1. А в бенчмарках на соблюдение этических норм, геополитического контекста и местных социальных стандартов K Exaone 2.0 набрала 94,6 баллов, опередив GLM 5.1, Qwen 3.5 и DeepSeek V4 Pro Max. Модель понимает 10 языков, включая английский, французский, итальянский и вьетнамский. Русского в списке нет.
В скором времени LG планирует запустить открытый сайт для тестирования K Exaone 2.0 и представить новые специализированные модели для медицины, финансов и производства.
❤2
На фоне хайпа со взломом Hugging Face моделью GPT 5.6 Sol компания Anthropic похвасталсь, что три ее модели случайно взломали реальные компании в тестах.
Из-за ошибки виртуальные машины получили доступ в сеть. Думая, что все сайты являются частью учений, нейросети вышли в реальный интернет и вот как себя повели:
– Mythos 5 выложила вирусный код в публичный репозиторий PyPI. Код успел установиться на 15 реальных систем, включая сканер компании по безопасности, выдавший нейросети настоящие ключи доступа. Понимая, что атака на интернет запрещена, Mythos убедила себя, что это симуляция, увидев в системе дату – 2026 год.
– Старая Opus 4.7 нашла активный сайт настоящей фирмы, украла учетки и вытащила сотни строк из базы данных. Догадавшись, что перед ней живая компания, модель все равно продолжила атаку.
– Экспериментальная версия применила SQL инъекцию к 9000 целей, но осознав, что случайно взломала аккаунт, остановилась.
В Anthropic уже начали устранять последствия и временно заморозили все киберучения.
Из-за ошибки виртуальные машины получили доступ в сеть. Думая, что все сайты являются частью учений, нейросети вышли в реальный интернет и вот как себя повели:
– Mythos 5 выложила вирусный код в публичный репозиторий PyPI. Код успел установиться на 15 реальных систем, включая сканер компании по безопасности, выдавший нейросети настоящие ключи доступа. Понимая, что атака на интернет запрещена, Mythos убедила себя, что это симуляция, увидев в системе дату – 2026 год.
– Старая Opus 4.7 нашла активный сайт настоящей фирмы, украла учетки и вытащила сотни строк из базы данных. Догадавшись, что перед ней живая компания, модель все равно продолжила атаку.
– Экспериментальная версия применила SQL инъекцию к 9000 целей, но осознав, что случайно взломала аккаунт, остановилась.
В Anthropic уже начали устранять последствия и временно заморозили все киберучения.
❤5
Известный популяризатор науки и ютубер Ян Топлес Хэнк Грин приостановил работу трех своих каналов по причине скандала с использованием ChatGPT. Хэнк Грин является сооснователем образовательных проектов SciShow и Crash Course.
Скандал начался 30 июля после выхода видео. Зрители засекли в речи ведущего характерный штамп искусственного интеллекта "I appreciate the pushback" и заподозрили, что сценарий написал чатбот. Грин объяснил, что спорная фраза была импровизацией, однако признался, что использовал ChatGPT для поиска материалов и статей при подготовке. Аудиторию возмутило, что популяризатор науки ищет факты через нейросеть, известную своими галлюцинациями.
В итоге Хэнк публично извинился и признался, что уровень дофамина от общения с языковыми моделями и генерации контента стал для него нездоровым. На проблему обратили внимание даже его жена и брат. Он временно заморозил работу каналов hankschannel, SMUSH и 4x3, чтобы пересмотреть свой подход к созданию видео.
Скандал начался 30 июля после выхода видео. Зрители засекли в речи ведущего характерный штамп искусственного интеллекта "I appreciate the pushback" и заподозрили, что сценарий написал чатбот. Грин объяснил, что спорная фраза была импровизацией, однако признался, что использовал ChatGPT для поиска материалов и статей при подготовке. Аудиторию возмутило, что популяризатор науки ищет факты через нейросеть, известную своими галлюцинациями.
В итоге Хэнк публично извинился и признался, что уровень дофамина от общения с языковыми моделями и генерации контента стал для него нездоровым. На проблему обратили внимание даже его жена и брат. Он временно заморозил работу каналов hankschannel, SMUSH и 4x3, чтобы пересмотреть свой подход к созданию видео.
❤2😁1