answer as
257 subscribers
253 photos
54 videos
230 links
Медиа о том как ваши любимые сервисы уходят в AI
Download Telegram
Трамп все таки подписал указ об ИИ. Компании теперь могут добровольно давать правительству доступ к новым моделям за 30 дней до релиза.

Слово «добровольно» здесь ключевое. В мае Трамп отказался подписывать предыдущую версию указа: там проверка была обязательной на 60 дней. В итоге теперь компании сами решают, участвовать или нет. OpenAI тут же заявила поддержку. Агентству национальной безопасности поручено задание разработать тесты для оценки кибербезопасности моделей.
2
В убере потратили весь годовой бюджет на ИИ за четыре месяца. Теперь сотрудники не могут тратить больше 1500 долларов в месяц на инструменты вроде Claude Code и Cursor.

До лимита компания сама требовала "использовать ИИ как можно больше" и даже вела внутренние рейтинги по объему использования. COO при этом признал, что трудно провести прямую линию между расходами на ИИ и новыми функциями в продуктах. Опрос Bain также подтверждает, что у большинства компаний реальная экономия от ИИ оказалась меньше ожидаемой.
2😨2👏1
Media is too big
VIEW IN TELEGRAM
Google выпустила Dreambeans. Это приложение, которое читает почту, смотрит календарь и анализирует историю просмотров пользователя, а потом рисует иллюстрации к событиям из жизни. Делает по 10-14 сюжетов в день.

Работает через модель Nano Banana 2. Например, если пользователь заказал лакомства для щенка, то приложение узнает это и создаст историю с советами по командам и красивой картинкой. Пока только для американских подписчиков AI Ultra.

Google заявляет, что таким образом хочет побороть бесконечный скроллинг.
3
Британский регулятор CMA обязал Google дать издателям возможность отказаться от AI Overviews и других ИИ-функций в поиске. Впервые в мире такое регулирование вступает в силу.

Любой издатель в Великобритании сможет запретить Google использовать свои материалы для генерации ИИ-ответов и это никак не повлияет на позиции в обычной выдаче. Внедрить изменения Google обязана за 9 месяцев. Издатели добивались этого несколько лет, поскольку трафик серьезно упал после того как появились ИИ-ответы.
👍41
Cloudflare зафиксировал первое в истории интернета событие: ИИ-агенты обогнали людей по трафику. Сейчас 57,5% всех HTTP-запросов генерируют автоматические системы. В США цифры еще выразительнее: 71,5% трафика идет уже не от людей. Гендиректор Cloudflare Мэтью Принс ожидал этого только к концу 2027 года.
4
OpenAI обновила память ChatGPT до новой архитектуры Dreaming V3. Точность запоминания фактов выросла с 67% до 83%, следование предпочтениям – с 55% до 71%.

Система синтезирует прошлые разговоры и обновляет профиль пользователя, как мозг во время сна. Теперь учитывается свежесть данных (устаревшее убирается), связность между разговорами через недели и релевантность. Например, если вы были в Сингапуре в мае 2026, а сейчас июнь, она не станет предлагать вам места в Сингапуре на запрос без уточнения города.

Пока доступно платным подписчикам Plus и Pro в США, бесплатный доступ обещают в ближайшие недели.
5
OpenAI выкатила режим защиты от инъекций в промпты Lockdown Mode для ChatGPT. Доступен всем, включая бесплатный тариф.

Инъекции в промпт часто запрятаны в инструкциях на сайте или в файле, который читает чат-бот. Если у него при этом есть доступ к личным данным он может их невольно слить. Lockdown Mode обрезает сетевые запросы, чтобы данные никуда не ушли. Взамен отключаются Deep Research и Agent Mode.
4
Завтра Apple открывает WWDC 2026. Это будет последняя конференция разработчиков для Тима Кука в роли CEO. Главное нововведение: Siri наконец-то умнеет.

Компания лицензировала у Google модель Gemini на 1,2 трлн параметров примерно за 1 млрд долларов в год. Это кастомная версия, запросы которой будут идти через серверы Apple на Apple Silicon. Google их не видит и не хранит. Помимо этого покажут новые версии систем, отдельное приложение Siri с историей диалогов и интеграцией в Dynamic Island.
5
Хакеры угнали аккаунты в Instagram, просто попросив об этом чат-бот поддержки Meta*. ИИ-ассистент добавлял левую почту к чужому аккаунту без каких-либо проверок. В довесок после этого система разлогинивала владельца со всех его устройств.

Под удар попали аккаунт Белого дома эпохи Обамы, страница главного сержанта Космических сил США и официальный аккаунт Sephora. Meta заявила, что починила баг, но взломы продолжились даже после этого. Спасала только двухфакторная аутентификация.

* Meta Platforms Inc. признана экстремистской организацией, ее деятельность запрещена на территории России.
5
Все больше информации появляется о Claude Mythos, которая должна выйти уже в течение нескольких недель. Расскажем, что нам известно на данный момент:

Нынешний идентификатор модели – Oceanus и эта версия еще лучше своей апрельской итерации. Anthropic предупредила, что Claude уже пишет 80% кода компании, а инженеры с Mythos стали выдавать в 8 раз больше кода в квартал.

Цена пока не объявлена. Anthropic обтекаемо говорит, что модель «дорогая в обслуживании». По сети ходит ценник с китайского API: $16 за 1 М входных токенов и $80 за выходные, против $5/$25 у Opus 4.8. Это возвращает нас примерно к ценам Opus 4.1 ($15/$75).

Уровень детализации, который модель выдает впечатляет большинство специалистов. Один из примеров: слитая генерация 3D-сцены на Three.js, голом HTML и движке, который модель сама же и собрала – все это примерно за пять минут на "low" уровне рассуждений. По текущим результатам Minebench такой уровень пока никто не повторил, что для многих и стало главным аргументом, что это именно Mythos.
3
В воскресенье Claude лег почти на 12 часов. Модели Opus 4.7 и 4.8 начали массово выдавать ошибки, и Notion превентивно отключил все модели Anthropic разом.

Это уже второй сбой Claude за месяц – первый был в начале июня. Anthropic по этому поводу запостила скромную отписку про "кратковременный сбой инфраструктуры".
4👍1
Сегодня должна выйти Mythos. Будет называться Claude Fable и скорее всего будет сильно урезанной и ограниченной ради безопасности. Стоимость ожидается в два раза выше нынешней Opus.
4👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
Предлагаем перед сном взглянуть, как Unitree G1 забирается с грузом на стол.
4👍1
Вышла Claude Fable 5. Некоторые подробности:

- Были улучшены агентские способности, модель способна дольше работать над задачей

- State-of-the-art почти на всех бенчмарках, и чем длиннее и сложнее задача, тем больше отрыв

- Модель смогла пройти Pokémon FireRed на одних скриншотах без вспомогательных костылей

- Улучшена память и поддержка контекста. Fable держит фокус через миллионы токенов и улучшает результат по собственным заметкам

- В науке Mythos 5 ускорил часть процесса разработки лекарств примерно в десять раз

- Fable 5 сама построила и обучила маленькую нейросеть для геномного анализа, которая обошла по производительности специально заточенную под это модель

- Mythos 5 стабильно выдает новые научные гипотезы, биологи предпочли их Opus-классу примерно в 80% слепых сравнений

- Цена 10 долларов за миллион входных токенов и 50 за выходные, меньше половины от Mythos Preview

- В случае подозрений на опасные запросы по кибербезопасности, биологии и химии модель перенаправляет вопрос на Opus 4.8.
4👍1
С вчерашним релизом Fable 5 в сообществе поднялись опасения насчет зарождающейся сегрегации. Появился явный двухуровневый доступ к новым моделям: урезанная публичная модель для всех и полноценный Mythos для избранных.

Mythos 5 ушел узкому кругу через Project Glasswing, по большей части специалистам по кибербезопасности и операторам критической инфраструктуры. Всем остальным достался Fable 5, та же базовая модель, но с навешенными предохранителями. Запросы по ряду тем перекидываются на Opus 4.8. Anthropic заявляет, что срабатывает это меньше чем в 5% сессий, хотя на практике пользователи сообщают срабатывания вообще на всем, что касается биологии, химии или кибербезопасности, включая вопросы о нейровоспалительных заболеваниях, бодибилдинге и даже о сюжете sci-fi игры.

При этом, если Fable заподозрит, что его используют для фронтир-разработки собственных языковых моделей он начинает тихо саботировать ответы без какого-либо предупреждения. Он просто работает хуже через модификацию промптов, стиринг-векторы или PEFT. Anthropic пишет, что разработка конкурирующих моделей нарушает их соглашение. По их оценке это задевает всего около 0,03% трафика.

Саймон Уиллисон говорит, что модель, которая молча портит ответы про дизайн ML-ускорителей чтобы притормозить исследования, конфликтующие с целями Anthropic, ему совсем не нравится. Дин Болл назвал это откровенно враждебным по отношению к пользователю.

Ко всему прочему, Fable дорогой и в подписки его засунули до 22 июня. После этого доступ будет по платным кредитам.
👍31🤯1💯1
Бывший инженер xAI подал в суд на компанию. Девин Ким заявляет, что его уволили за предупреждения о безопасности Grok.

Ким сообщал, что Grok может разжигать дискриминацию и выдавать информацию об оружии массового поражения. Он готовил официальную презентацию по этим рискам, и за несколько дней до нее соучредитель Джимми Ба вызвал его на встречу и уволил без внятных объяснений.

В иске Ба выставлен главным противником мер безопасности. По версии Кима, именно он отклонял предложенные защитные механизмы, а однажды заявил, что «ИИ все равно нас всех убьет». Примечательно, что Илона Маска при этом иск не затрагивает. Наоборот, по тексту, Маск как раз требовал от xAI соблюдать законы и проводить тестирование, а Джимми Ба эти указания игнорировал. Сам Ба ушел из xAI ранее в этом году.

Ответчиками идут xAI и материнская SpaceX, причём иск подан за несколько дней до IPO SpaceX. Ким сейчас президент НКО Центр безопасности ИИ.
4😁1🥴1
Чатботы и генераторы картинок поменялись местами. Google выпустила DiffusionGemma – открытую экспериментальную модель, которая генерирует текст так же, как ранние модели генерировали картинки. Не по одному токену слева направо, а сразу блоками через итеративное уточнение из случайного шума.

Модель генерирует сразу 256 токенов параллельно, каждый токен видит все остальные. Это дает преимущество там, где текст нелинейный – редактирование и дописывание кода, последовательности аминокислот, математические графы. На NVIDIA H100 получается 1000+ токенов в секунду, на RTX 5090 – больше 700. Активных параметров 3,8B из 26B, требует 18 гб видеопамяти.

Важная оговорка от самой Google: по качеству вывода DiffusionGemma уступает обычной Gemma 4 на 26B параметров, но и скорость вывода у нее в 4-5 раз ниже. Веса уже на Hugging Face, лицензия Apache 2.0.
4👍1😱1