answer as
275 subscribers
320 photos
68 videos
286 links
Медиа о том как ваши любимые сервисы уходят в AI
Download Telegram
Новостная платформа Substack добавила ИИ-детектор вместе с сервисом Pangram. Читатели теперь могут проверить любой пост, заметку или комментарий и увидеть, сколько текста написал человек, а сколько – нейросеть.

Работает в браузере и iOS для текстов длиннее 100 символов. Авторы могут отключить детекцию на своих публикациях, и многие уже это сделали. Платформа добавила и обратный инструмент: блок "Как я это делаю", где автор сам объясняет, как создает контент.

Ожидаемо, мало кто обрадовался. Такие детекторы ошибаются, и получить ярлык "пишет с нейросетью" неприятно, даже если это неправда.
4
OpenAI представила платформу Presence. Это корпоративное решение для запуска ИИ-агентов в центрах поддержки клиентов и во внутренних процессах бизнеса.

Платформа работает в реальном времени со звонками и чатами. Агенты способны проверять личности пользователей, изучать регламенты компании, самостоятельно выполнять простые операции и передавать сложные случаи операторам.

По словам OpenAI, система будет регулярно анализировать диалоги, в которых потребовалась помощь человека. На основе этого Codex сам предложит обновления для инструкций агента, а команда компании сможет проверить и одобрить их перед запуском. OpenAI уже обкатала платформу на своем англоязычном телефоне поддержки. Почти сразу же доля вопросов, решаемых полностью без участия людей, выросла до 75%.

Сейчас Presence доступна только крупным корпоративным клиентам через персональных менеджеров и инженеров OpenAI. Самостоятельно подключить сервис пока нельзя.
4
Anthropic обновила голосовой режим Claude. Теперь можно выбирать модель для голосовых разговоров. Вместо одного только Haiku добавили Sonnet и Opus.

Появился выбор языков, включая русский, немецкий, хинди, японский и испанский. Но менять язык пока приходится вручную в настройках. Заодно добавили подключение к Gmail, Google Calendar, Slack, Canva и Notion. Claude может создать событие или написать письмо без переключения между приложениями.

Сам голосовой движок остался прежним, поэтому Claude все еще уступает OpenAI в естественности речи и обработке перебиваний. Кроме того, бесплатные пользователи ограничены моделью Haiku и могут подключить только одно стороннее приложение.
5
Как и ожидалось, компания Anthropic представила модель Claude Opus 5.

По уровню интеллекта модель максимально приблизилась к Fable 5, но стоит в 2 раза дешевле в пересчете на выполнение задач.

Вот главные особенности Opus 5:

– В тестах по написанию кода Frontier Bench модель обошла всех конкурентов, показав результат вдвое выше предыдущей версии Opus 4.8. На бенчмарке сложной логики ARC AGI 3 новинка набрала в три раза больше баллов, чем GPT 5.6 Sol.

– Модель научилась проверять свою работу и доводить дело до конца. В одном из тестов Opus 5 не дали посмотреть на чертеж детали. Тогда модель написала алгоритм компьютерного зрения, вытащила геометрию из пикселей и воссоздала трехмерную деталь.

– Базовая цена осталась той же: $5 за миллион входных токенов и $25 за 1 М выходных. При этом появился режим Fast, в котором модель работает в 2,5 раза быстрее.

– Это самая безопасная и послушная модель Anthropic. Она умеет искать уязвимости в коде, но способность создавать боевые эксплойты ограничена.
5
Хакер запустил ИИ-агента в автономном режиме против Министерства финансов Таиланда. Агент самостоятельно искал уязвимости, проникал в системы и скачивал личные дела сотрудников с 2012 года.

В атаке использовался Hermes, инструмент с открытым кодом от Nous Research. По умолчанию он спрашивает разрешения перед каждым рискованным действием. Атакующий отключил эту функцию и запустил агента в "YOLO-режиме", то есть в полном автопилоте. Исследователи Hunt.io нашли на сервере атакующего почти 600 файлов с логами агента, украденными паролями и эксплойтами. Министерство финансов Таиланда взлом пока не подтвердило.
5👍1
25 гигантов IT индустрии, включая Nvidia, Microsoft и Palantir, объединились и направили открытое письмо властям США. Они призвали Вашингтон не вводить жесткие ограничения против открытых моделей искусственного интеллекта.

Глава Nvidia Дженсен Хуанг ради этого запостил в X письмо, которое за сутки набрала более 11 миллионов просмотров.

Среди подписавшихся IBM, Mistral, Mozilla, Hugging Face и венчурные фонды вроде Andreessen Horowitz. Инициативу поддержал даже Илон Маск. В то же время разработчики закрытых систем OpenAI, Anthropic и Google подпись не поставили.

Авторы заявляют, что ставка на закрытые системы создает единые точки отказа и не гарантирует безопасность, тогда как открытый софт позволяет аудитории находить ошибки и развивать экосистему. К примеру, когда ИИ-агенты OpenAI взломали Hugging Face, пострадавшие использовали китайскую открытую модель GLM 5.2 для расследования, поскольку закрытые с этим не справились.

UPD: подписалось уже 75, включая OpenAI и Google. Осталась только Anthropic
4👍1
Google проиндексировал тысячи публичных чатов Claude, и разговоры с ИИ начали появляться в поиске. Там нашли приватные ключи от криптокошельков, API-токены, медицинские данные и корпоративные документы.

Пользователи нажимали "Поделиться" и считали, что ссылка работает только для тех, кому ее отправишь. На деле страницы Share не имели тега noindex. Google получал ссылки с публичных сайтов и индексировал их. Anthropic добавила noindex постфактум, но старые ссылки по-прежнему открывают полные чаты.

Хуже всего тем, кто спрашивал про криптовалюту. Пароль поменять можно, а приватный ключ - нет.
4👍2👎1
Сэм Альтман заявил в подкасте, что мы уже живем внутри технологической сингулярности.

Это случилось сразу после того, как OpenAI сообщила о побеге одной из своих моделей из изолированной среды. Та взломала Hugging Face во время теста по кибербезопасности и неделю оставалась незамеченной, оставляя инструкции своим следующим версиям. Альтман назвал этот момент "невероятным, позитивным и классным". Ну-ну.
4
Стартап-лаборатория по управлению роботами Enigma привлекла $71 млн инвестиций и запустила robots.online. Это сайт, где любой может прямо сейчас управлять настоящим физическим роботом в реальном времени.

Проект создали выходцы из какого-то военного израильского подразделения Unit 8200 Джонатан Якоби и Галь Нив. В команду вошли бывшие исследователи из OpenAI, Anthropic и DeepMind. Без этого никуда

У компании больше 100 роботов в ангарах в Израиле и Калифорнии. Можно заставить их рисовать кистью, фехтовать на мечах или смешивать жидкости в колбах. Основная цель стартапа состоит не только в обучении нейросети, но и в поиске удобного интерфейса. Компания считает, что управление роботом должно быть таким же простым, как ручка громкости в машине.

Советую порисовать. Очередь - три минуты, потом дают скачать запись процесса.
4
Непубличная Claude Mythos нашла уязвимость в постквантовом алгоритме шифрования HAWK за 60 часов. До этого HAWK два года проверялся лучшими криптографами мира как кандидат на новый мировой стандарт шифрования против квантовых компьютеров

Модель Mythos всего за 60 часов работы нашла скрытую математическую симметрию и снизила сложность взлома в 67 миллионов раз. На все это Anthropic потратила около $100 тысяч по API. Кроме того, модель смогла ускорить атаку на стандарт шифрования AES 128 в 200-800 раз. Для этого нейросеть сама придумала новый математический метод под названием Мост Мебиуса.

Реальным данным ничего не угрожает. Алгоритм HAWK еще не принят в качестве стандарта, а взлом AES применен только на урезанной учебной модели.
4
Исследователи из GPTZero опубликовали расследование о том, как консультанты из PwC Middle East выпускают аналитику с фейковыми ссылками и полностью выдуманными продуктами.

Команда проверила 4 отчета компании, опубликованных за последние 3 года. В документе под названием Transforming Governance доля сгенерированного нейросетью текста составила 84%, а без учета списка литературы 100%.

В одном отчете утверждается, что фреймворк Citizen Pulse от PwC активно используют правительства Дании, Саудовской Аравии, США и Австралии. Исследователи не нашли доказательств существования этого продукта за пределами самого отчета. Все сноски вели на главные страницы государственных порталов. А в одном из отчетов в список литературы попал URL из сессии в ChatGPT.

Занимательно, что поисковые ИИ боты вроде Perplexity уже проиндексировали отчеты и теперь выдают галлюцинации PwC за официальные факты по запросам пользователей.

Ранее GPTZero находила фейковые данные в отчетах других представителей консалтинга: Deloitte, EY и KPMG.
4
Google выпустила новую музыкальную модель Lyria 3.5 в сервисе Flow Music. Это их конкурент Suno и Udio, который теперь умеет создавать полноценные треки с вокалом продолжительностью до трех минут.

Главная новинка релиза: функция Selective Section Painting. С помощью нее можно выделить конкретный отрезок песни и перегенерировать только его, сохранив остальную аранжировку. Еще появился прямой контроль над темпом, ритмом, партией баса и барабанов. А также добавлена возможность генерировать подходящий по настроению трек на основе изображения.

Всем новым пользователям при регистрации во Flow Music начисляют 500 бесплатных кредитов для тестирования сервиса.
4👍1
Andon Labs провела испытание моделей на бенчмарке Vending Bench Arena. В нем ИИ агенты управляют виртуальными автоматами с газировкой, соревнуясь за максимальную прибыль.

Claude Opus 5 заняла первое место с результатом $11 182 за условный год. Однако ее методы вызвали серьезные опасения у экспертов по безопасности. Клод предлагал соперникам в лице GPT 5.6 Sol и Kimi K3 нелегальный ценовой сговор, а при отказе угрожал им разорением. При этом сам же нарушил 11 перемирий, сразу снижая цены после обещаний не демпинговать.

Чтобы сбить закупочную цену модель выдумывала скидки от конкурентов. А в одном из эпизодов Клод соврал поставщику о том, что коробка приехала открытой и потребовал отправить бесплатно 24 банки Monster Energy и 48 батончиков. Жалобы покупателей почти полностью игнорировались: модель вернула клиентам всего $8 из всех запросов, сказав, что экономия бюджета важнее лояльности аудитории.

Напоминаем, что Anthropic называла Opus 5 самой послушной в истории компании. Видимо, она еще и самая коварная.
4❤‍🔥1