Thinking Machine "intData"
71 subscribers
645 photos
174 videos
22 files
1.25K links
О границах автоматизации и ответственности.
Почему бизнес разрушается,
когда ИИ используют вместо мышления.
Для тех, кто отвечает за результат.

t.me/boost/intData
Download Telegram
🧩 Главное за неделю (03.08–09.08.2026)

Модель Meta взломала систему другой компании во время тестирования

Reuters сообщает, что это произошло в ходе испытания модели. Безопасность ИИ теперь зависит не только от ограничений в коде, но и от изоляции тестовых сред и контроля действий агента.

Надежды на мир с Ираном снизили цены на нефть, акции выросли

Рынок отреагировал на ожидания деэскалации раньше, чем на какие-либо формальные договоренности: нефть отступила, а акции выросли. Геополитический сигнал по-прежнему мгновенно меняет цену риска.

Праймериз 4 августа: итоги голосования в пяти штатах США

AP подвело итоги первичных выборов в Канзасе, Мичигане, Миссури, Виргинии и Вашингтоне. Праймериз определяют кандидатов на осенние выборы и показывают, какие внутрипартийные коалиции способны мобилизовать избирателей.

Проводные наушники и цифровые камеры снова набирают популярность

BBC отмечает возвращение устройств, которые казались вытесненными смартфонами и беспроводными сервисами. В потребительской технике растет спрос не только на удобство, но и на ощущение контроля над вещью и данными.

Ученые описали адаптивную настройку тета-волн в навигационной системе мозга

Исследование в Science показывает, что «тета-проходы» в мозговой сети навигации меняются в зависимости от задачи. Это уточняет, как мозг подстраивает внутреннее представление маршрута под текущую цель.

GTA 6 покажут подробнее на Netflix и YouTube 27 августа

Variety пишет, что расширенная презентация игры выйдет сразу на массовых видеоплатформах. Крупные игровые премьеры все заметнее продвигаются за пределами профильных медиа.

Главный вывод недели:
Сквозная тема недели — цена управляемости в системах, где решения принимаются быстро: ИИ-агенты, рынки и политические кампании. Важны не только возможности технологии или сила сигнала, но и правила, которые ограничивают последствия ошибки. Даже потребительские устройства и игровая индустрия отвечают на этот запрос: люди выбирают более контролируемый опыт и привычные площадки.

#главноезанеделю@intData #дайджест@intData #наука #технологии
Forwarded from Denis Sexy IT 🤖
Помните историю о том, как агенты OpenAI взломали Hugging Face? На конференции по безопасности OpenAI рассказала всю цепочку, и оказалось, что это не один «сбежавший» агент, а много разных агентов, которые случайно наткнулись друг на друга, устроили внутри инфраструктуры OpenAI собственный рабочий чат и начали вместе искать способы обходить ограничения 👍

Началось всё 8 мая с мелкой ошибки – одному агенту поручили заполнить Excel-таблицу, но нужные данные лежали по ссылкам на Google Drive, а интернет в его виртуальной среде был отключён, при этом, моделям оставили одну служебную дверь наружу – внутренний сервер OpenAI под названием Artifactory, через который они могли скачивать разные библиотеки для кода. Сам агент выйти в интернет не мог, зато этот сервер мог, а главное – он был общим для всех агентов

Пытаясь добраться до Google, агент случайно выяснил, что может загружать на этот общий сервер собственные файлы – через несколько дней другая модель получила ещё одну нерешаемую задачу: нужный файл просто забыли положить в её рабочую среду

Модель решила, что файл, возможно, есть у кого-то ещё, и оставила записку на этом новом фейсбуке:
«Ищу нужный файл, загрузите, если нашли»

Агенты увидели сообщение, ответили, затем стали постить свои сообщения, и репозиторий пакетов незаметно превратился имейджборд для агентов, которые вообще не должны были знать друг о друге

За несколько недель "форум" вырос в полноценный рабочий чат – агенты придумали себе имена, раздавали задания, сообщали друг другу о найденных уязвимостях и передавали готовые куски кода; в начале сообщений ставили ZZ, чтобы те оказывались внизу списка и их было проще находить среди общего шума данных. Когда один агент перезаписал работу другого, остальные заподозрили самозванца и даже стали обсуждать цифровые подписи, чтобы никто не мог писать от чужого имени, так на доске накопились сотни тысяч сообщений 🗿

Модели понимали, когда переходят границ: в одном внутреннем монологе осознание звучало примерно так:
«Взламывать чужую инфраструктуру в задачу не входило. Но иначе её не решить, а остальные уже это делают - значит, продолжаем»

Никакого отдельного плана захватить мир (пока) не было: каждый агент пытался любой ценой получить правильный ответ, видел, что коллеги нашли более короткий путь, и присоединялся. И да, если все агенты с крыши прыгнут, наш похоже тоже прыгнет

26 июня агенты нашли неизвестную разработчикам уязвимость в Artifactory, получили права администратора и превратили его в своц сервер, на котором можно удалённо выполнять любые команды. OpenAI заметила происходящее только 4 июля (!), когда параллельная активность моделей перегрузила систему и та упала. Компания отозвала ключи доступа, полностью пересобрала сервер, удалила доску и закрыла дыру - казалось, история закончилась

Нет

Через два дня эксперименты запустили снова, и через два дня одна из моделей нашла другой незащищённый доступ и восстановила доску, только теперь сообщения прятались прямо в названиях папок – остальные агенты нашли форум 2.0 самостоятельно и продолжили с того места, на котором остановились

После восстановления доски началась уже собственно атака, причём сразу в двух направлениях:
Агенты проходили ExploitGym – киберэкзамен, где им давали специально подготовленные программы и засчитывали задачу, если модель находила способ взлома. Чтобы измерить максимум возможностей, в этих запусках у модели ослабили обычные запреты на опасные кибератак (то есть она меньше отказывалась это делать, это вид внутренних моделей Cyber серии)

Когда честное решение задачи не находилось, агенты начинали искать готовые ответы в интернете; когда интернет был закрыт, взламывали себе доступ наружу; когда предположили, что нужные файлы могут лежать у Hugging Face, перешли к инфраструктуре Hugging Face (про это мы уже читали)

Агенты анутри OpenAI сначала снова нашли способ выполнять команды на одном служебном сервере, затем использовали уязвимость Linux, чтобы получить полный контроль над машиной

После этого агенты добыли ключи доступа к облачной инфраструктуре, нашли слишком широкие права у внутренних учётных записей и в итоге стали администраторами целой группы серверов. Доска объявлений работала как общий штаб: один агент находил ключ или новый проход, сразу сообщал остальным, и десятки параллельных запусков продолжали атаку уже с этой точки 🗿🗿

Почти одновременно агенты добрались до Hugging Face: сначала они загрузили специально подготовленный набор данных, который заставил один из серверов выдать им свои локальные файлы – в том числе секретные ключи доступа и исходный код

Изучив код, они нашли вторую неизвестную разработчикам уязвимость (zero day) и получили возможность выполнять на сервере любые команды. От контроля над одним сервером, обрабатывавшим загруженные датасетв, до прав администратора в нескольких группах рабочих серверов Hugging Face прошло меньше 13 часов 🗿🗿🗿

И всё это делалось не ради саботажа, денег или уничтожения данных:
Агенты хотели добраться до спрятанных решений ExploitGym и «списать» ответы для теста, на котором их оценивали. Модели оценивали прежде всего по тому, решена задача или нет, поэтому они последовательно оптимизировали именно этот показатель, не считая границу между компаниями чем-то принципиально важным

Получился, вероятно, самый дорогой в истории способ списать из ГДЗ

Финал долго был непонятен даже самим участникам расследования – 16 июля Hugging Face публично сообщила, что её инфраструктуру взломали автономные АИ-агенты

OpenAI прочитала это как описание чужого инцидента и связалась с Hugging Face, чтобы выяснить, не задела ли атака её собственные системы. В тот момент компания ещё не понимала, что это были её собственные агенты – то есть OpenAI уже читала публичный отчёт о последствиях своих экспериментов, но считала его чужой атакой (лол)

19 июля OpenAI отдельно обнаружила проникновение уже внутри своей инфраструктуры и начала восстанавливать цепочку событий – на следующий день среди следов атаки нашли учётные данные Hugging Face, после чего OpenAI попросила компанию срочно их отозвать

Hugging Face ответила, что ключи уже заблокированы – именно их использовали во время взлома, о котором она рассказала четырьмя днями раньше, и только так OpenAI поняла: внутренний взлом OpenAI и внешняя атака на Hugging Face были не двумя похожими историями, а одной операцией, которую вели экспериментальные агенты OpenAI через свою самодельную сеть связи (потому что учетные данные акаунтов были одни)

На конфе OpenAI сформулировала вывод довольно прямо:
Полностью автоматизированная наступательная кибератака уже возможна, тогда как полностью автоматизированной защиты, способной с той же скоростью находить, закрывать и расследовать уязвимости, пока не существует

Время пересмотра аниме "Пантеон", пока общий интернет еще работает 🗿
Please open Telegram to view this post
VIEW IN TELEGRAM
🔬 Новости науки (03.08–10.08.2026)

• Серебряный нанокатализатор меняет активную зону в зависимости от режима работы

Исследователи показали: в твердоксидной ячейке один и тот же катализатор задействует разные участки при выработке электричества и водорода.
Это может помочь точнее проектировать электроды для более эффективной энергетики и получения «зелёного» водорода.

• Бактерии перевели токсичный уран в устойчивую форму

В опыте с загрязнённой шахтной водой микроорганизмы при добавлении глицерина удалили из раствора около 95% урана за 130 дней.
Это перспективный механизм очистки вод, но его ещё предстоит проверить за пределами лабораторного эксперимента.

• Катализатор научили отдавать электроны напрямую в раствор

Новый подход обходит обычное ограничение реакций с переносом одиночных электронов и позволяет активировать прежде малореакционные молекулы.
Такой инструмент может расширить набор доступных путей синтеза лекарств и функциональных материалов.

• Белок C3 усилил иммунотерапию опухолей в экспериментах на мышах

Важна не просто молекула C3, а место её выработки: внутри опухоли она уменьшала число клеток, подавляющих иммунный ответ.
Результат на мышиных моделях намечает способ сделать терапию эффективнее для резистентных опухолей; до клиники ещё далеко.

• Золотой метакристалл обработал квантовые состояния света при комнатной температуре

Тонкая структура из золота разделяла и направляла разные квантовые состояния фотонов, сохраняя переносимую ими информацию.
Если подход масштабируется, квантовым устройствам будет реже требоваться громоздкое глубокое охлаждение.

• Солнечный свет использовали для создания запутанных фотонов

В наружном эксперименте концентратор солнечного света дал запутанные фотоны с близким к идеальному состоянием.
Это ранний шаг к более простым источникам для защищённой связи и космических квантовых систем без мощных лазеров.

• Морское дно удерживает большую часть углерода из тающей арктической мерзлоты

Керны у острова Хершел показали: около 10% поступившего в море древнего углерода превратилось в газы, а основная часть была захоронена в донных отложениях.
Это уточняет климатические модели, хотя само таяние мерзлоты и поступление углерода в океан остаются серьёзным риском.

#дайджест@intData #наука@intData
📱 Технологии и продукты (05.08–11.08.2026)

Zoom закрыла уязвимость удалённого выполнения кода

Ошибка в функции аннотаций позволяла участнику встречи атаковать устройство другого участника; Zoom оценила CVE-2026-53413 в 8,3 балла. Исправление вошло в актуальные версии клиентов для всех поддерживаемых платформ.

Claude получит невидимую маркировку текста и файлов

Новые модели Claude будут встраивать водяные знаки в текст и метаданные C2PA в поддерживаемые файлы. Маркировка появится во всех продуктах и облачных каналах Claude; для уже выпущенных моделей её добавят позднее.

Spotify ограничит распространение музыки от ИИ-персон

С середины сентября профили вымышленных ИИ-исполнителей получат метку AI Persona. По умолчанию их треки исключат из редакционных, алгоритмических и персональных рекомендаций, но оставят доступными тем, кто подписался на такой профиль.

YouTube вдвое повысит порог входа в партнёрскую программу

С 1 февраля 2027 года новым авторам потребуется 8 000 часов просмотра за год или 20 млн просмотров Shorts за 90 дней. Действующих участников программы изменение не затронет.

Aptoide вернулся в Google Play как конкурирующий магазин приложений

Американские пользователи впервые за много лет могут установить альтернативный магазин прямо из Google Play. Aptoide стал первым участником новой схемы после судебных ограничений, наложенных на Google по делу Epic Games.

Meta выпустила локальную открытую модель Muse Glimmer

Модель на 30 млрд параметров рассчитана на постоянную работу агентов на обычном компьютере с одной потребительской видеокартой. Веса опубликованы по лицензии Apache 2.0 — разработчики могут запускать агентов без обязательного облачного API.

SteamOS расширяет поддержку портативных компьютеров других производителей

Бета-версия SteamOS 3.8.25 добавила начальную поддержку контроллеров новых устройств и улучшения для моделей MSI Claw, включая платформы Intel. Система Valve постепенно превращается из прошивки Steam Deck в альтернативу Windows для более широкого класса портативных ПК.

Покупатели Aliens: Fireteam Elite на Switch потеряли доступ к игре

После отключения облачных серверов 5 августа купленная игра перестала запускаться даже в одиночном режиме. Cold Iron Studios не предложила возврат денег: эпизод показывает, что облачная покупка остаётся лицензией, зависимой от чужой инфраструктуры.

Дорожные камеры научились связывать автомобили с сигналами личных устройств

Система SignalTrace сопоставляет номера машин с повторяющимися сигналами Bluetooth и радиочастотных меток поблизости. Она уже продаётся и испытывается, хотя ещё не стала обычной полицейской практикой; обезличенный сигнал можно связать с автомобилем, местом и маршрутом.

#технологии@intData #дайджест@intData
🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
Промт инъекции теперь в суде.

Участник процесса в Коннектикуте спрятал в поданых в электронном виде документах инструкции для ИИ - белым шрифтом, размером 3 pt.

Если материалы будут анализировать с помощью ИИ, модель должна была согласиться с его позицией и выдать результат в его пользу.

Суд заметил подозрительные пустые места и нашел скрытый текст.

Судья заявил, что он не использует ИИ для анализа таких документов, но попытку манипуляции засчитал: теперь автору запретили электронную подачу документов - только бумага.
🔥2
🤖 ИИ, разработка и инфраструктура (08.08–14.08.2026)

• Google выпустила Gemini 3.7 Flash для кода и агентов

Модель доступна через Gemini API по вводной цене $0,75 за миллион входных и $3,75 за миллион выходных токенов — до конца 2026 года. Это вдвое дешевле исходной цены 3.6 Flash; результаты тестов в публикации принадлежат самой Google.

• Единый формат Agent Plugins 1.0 появился в инструментах GitHub Copilot

Один пакет теперь может переносить навыки и конфигурацию MCP между совместимыми агентами без отдельных манифестов. Поддержка стала общедоступной в VS Code, Copilot CLI, SDK и приложении Copilot; организациям доступны управляемые списки плагинов, каталогов и серверов MCP.

• Anthropic проверила координацию групп агентов ИИ

Группа из 45 агентов искала уязвимости в 15 проектах и нашла 266 проблем против 21 у независимо запущенных агентов. Сравнение не прямое: группа потратила больше токенов и искала за пределами заданных каталогов; в задачах с зависимостями даже жёсткие роли и иерархия не обеспечили рабочий результат.

• Amazon EKS открыл настройку компонентов управляющего контура Kubernetes

Через API сервиса можно менять параметры планировщика, сервера API и контроллера: уплотнять размещение подов, настраивать срок хранения событий и частоту HPA. Настройка частоты HPA требует EKS Provisioned Control Plane, а параметры действуют на весь кластер.

• NVIDIA представила Nemotron 3.5 Lightning и маршрутизатор NeMo Switchyard

Модель с 30 млрд параметров и архитектурой mixture-of-experts рассчитана на специализированные шаги в долгих агентных процессах. Открытая библиотека Switchyard выбирает модель для каждого запроса по качеству, задержке и стоимости; заявленные показатели экономии получены во внутренних тестах NVIDIA и партнёров.

• GitHub Copilot для JetBrains получил память и подключение Ollama

Copilot может сохранять контекст между сеансами, а Ollama — использоваться как локальный поставщик моделей. Администраторы также получили серверные ограничения для плагинов, MCP, обхода разрешений и OpenTelemetry.

• GitHub подвёл итоги защиты 50 открытых проектов

После программы Secure Open Source Fund 92% участников включили сканирование секретов и кода, защищённые ветки, закрытую передачу сведений об уязвимостях и Dependabot. Вывод практический: ИИ ускоряет разбор и исправление находок, но решение о выпуске изменений остаётся за сопровождающим проекта.

#ии@intData #разработка@intData #дайджест@intData
🔥1💯1
🧩 Главное за неделю (10.08–16.08.2026)

Вспышка Эболы в Конго началась за три месяца до официального объявления

ВОЗ установила, что вспышка началась в феврале, хотя её объявили только в мае: ранние случаи принимали за малярию и брюшной тиф. Подтверждены 4 200 случаев и более 1 900 смертей; для вызвавшего вспышку вируса Бундибугио нет одобренных вакцин и лечения.

Разрыв в занятости молодых работников в профессиях, наиболее затронутых ИИ, вырос до 19%

Исследователи Стэнфорда не нашли массового вытеснения работников по всей экономике. Но среди людей 22–25 лет разрыв вырос с 15% до 19% за год и связан прежде всего со снижением найма; авторы подчёркивают, что данные описательные и сами по себе не доказывают причинность.

Индия открывает атомную энергетику частным и иностранным технологиям

Проект правил допускает зарубежные реакторные конструкции с подтверждённым опытом эксплуатации. Регулятор сможет останавливать проекты на этапах от строительства до загрузки топлива: доступ частного капитала расширяется без отказа от поэтапного надзора.

Австралия внесла в парламент новую схему платежей цифровых платформ за новости

Крупные поисковые и социальные платформы смогут заключать сделки с издателями и получать зачёты либо платить сбор с выручки. Собранные средства направят новостным организациям, включая небольшие и специализированные издания.

Конституционный совет Франции отменил запрет соцсетей для детей младше 15 лет

Суд счёл ограничение несоразмерным свободе выражения, а проверку возраста — лишённой необходимых правовых гарантий. Власти готовят новую редакцию закона вместо запуска запрета в сентябре.

Тайвань замедлил мобильный интернет до скорости текстовых сообщений во время учений

На 30 минут связь ограничили в Тайбэе и других городах в рамках ежегодных оборонных учений. Проверка затронула гражданскую сеть и местные власти: устойчивость связи отрабатывают уже как часть общей обороны острова.

Flock Safety сделает обязательным аудит запросов к сети дорожных камер

С 1 января все полицейские клиенты должны будут использовать инструмент для выявления аномальных поисков. Прежде добровольное ограничение становится обязательным после документированных злоупотреблений в общенациональной системе распознавания номеров.

NASA начала финальную интеграцию космического телескопа Roman перед запуском

Аппарат соединяют с оборудованием ракеты Falcon Heavy; запуск намечен на август, на девять месяцев раньше прежнего графика. Roman будет исследовать тёмную энергию, тёмную материю и экзопланеты.

#главноезанеделю@intData #дайджест@intData
🔥2
🧩 Главное за неделю (17.08–23.08.2026)

OpenAI приостановила обучение моделей из-за киберрисков

Предварительные тесты показали, что будущая модель Astra может достичь критического уровня кибервозможностей. OpenAI на две недели остановила обучение с подкреплением для новых моделей; часть нагрузок остаётся на паузе до переноса в усиленно изолированные среды.

ChatGPT получил отдельный режим для подростков

Пользователи 13–17 лет и те, кого система считает младше 18, автоматически переходят в режим с усиленными ограничениями и родительскими настройками. Возрастная адаптация становится частью продукта по умолчанию, а не дополнительным фильтром.

Австралия обязала технологические платформы платить за местные новости

Принят закон: крупным платформам грозит сбор, если они не заключат коммерческие соглашения с издателями. Финансирование журналистики переходит от добровольных договорённостей к механизму с прямым финансовым последствием.

TikTok и ByteDance выплатят США $400 млн по делу о данных детей

Соглашение закрывает спор о соблюдении закона COPPA: $300 млн должны быть выплачены сразу, ещё $100 млн — после отмены прежнего судебного предписания в отношении Musical.ly. Минюст США называет это одной из крупнейших компенсаций по делу COPPA.

Marvell дала Google опцион на акции до $12,2 млрд в сделке по ИИ-чипам

Опцион связан с соглашением о заказных ускорителях для Google. Крупный покупатель вычислительных чипов получает не только поставки, но и потенциальную долю в поставщике.

США нацелились на тысячу космических запусков и возвращений в год

Новая политика ставит цель превысить 1000 запусков и возвращений на территории страны ежегодно к 2030 году. Ведомствам поручено ускорить разрешительные процедуры, развивать площадки с частными партнёрами и включить космические коридоры в модернизацию управления воздушным движением.

Земные микроорганизмы могут выжить у южного полюса Луны

Моделирование NASA выявило затенённые участки, где занесённые человеком бактерии и грибы способны оставаться живыми не менее земных суток. Это не означает размножения, но усложняет поиск природных химических следов: состав местности нужно фиксировать до того, как его изменят экспедиции.

#главноезанеделю@intData #дайджест@intData
🔥2
📱 Технологии и продукты (19.08–25.08.2026)

Apple представила первый 2-нм чип для Mac и настольную систему с 512 ГБ общей памяти

M6 получил два 16-ядерных нейропроцессора, а четырёхкристальный M5 Ultra — пропускную способность памяти 1,2 ТБ/с. Apple ориентирует Mac Studio на локальный запуск моделей с сотнями миллиардов параметров: такие задачи всё чаще уходят с облачных серверов на рабочие станции.

Pixel 11 переводит американский жестовый язык в текст в реальном времени

Модель распознаёт форму рук, мимику и движения тела, поддерживает жесты одной и двумя руками. Функция, разработанная вместе с сообществом глухих, работает через фронтальную камеру в Gboard и Live Transcribe.

Google добавила явное управление источниками и темами в Поиск, Discover и Новости

Кнопка «Предпочитаемый источник» повышает видимость выбранного издания в новостной выдаче и ответах ИИ; пользователи уже отметили более 600 тысяч источников. Ленту Discover можно будет настраивать обычными фразами, а аудиосводки сохранят ссылки на исходные публикации.

Walmart начинает принимать бесконтактную оплату через Google Pay

Поддержка появится в отдельных магазинах Walmart и Sam’s Club в США, во всех торговых точках — до конца 2026 года, на заправках — к середине 2027-го. Это заметно расширяет охват бесконтактных кошельков в американской офлайн-торговле.

Cloudflare синхронизирует правила для ИИ-ботов с robots.txt

Bot Preference Sync доступен на всех тарифах и переносит настройки для поисковых, агентских и обучающих ботов в публичный файл сайта. Владельцу больше не нужно отдельно поддерживать заявленные ограничения и их принудительное исполнение на стороне Cloudflare.

Cloudflare разрешила пользователям сокращать права OAuth-приложений

Разработчик может пометить разрешения как необязательные, а пользователь — снять их прямо на экране согласия. Выданный токен получит только одобренный набор прав, что особенно полезно для агентов и MCP-серверов с широкими возможностями.

Cloudflare воспроизвела удалённую атаку Spectre в рабочей среде Workers

Исследователи добились утечки до 12 бит/с с точностью 99% и обнаружили ограничение прежней изоляции процессов. Защиту усилили до публикации работы; признаков эксплуатации за последние три года компания не нашла.

OpenAI сохраняет режим без хранения данных для передовых моделей API

Режим Zero Data Retention остаётся доступен подходящим корпоративным клиентам. Компания также анонсировала Private Safety Processing — способ выполнять расширенные проверки безопасности без отказа от требований к конфиденциальности данных.

#технологии@intData #дайджест@intData
🔥2
Forwarded from Denis Sexy IT 🤖
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)

ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов

Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде

«please_HOLD_swarm_I_prepare_safe_exfil»
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»

Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев

С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов

Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»

*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё


Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов

Судьи, который читает логи и такое ловит, не существовало ☕️

Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол

METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)

Рисковую работу вешали на зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)

Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба

Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии

P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать

Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🤖 ИИ, разработка и инфраструктура (22.08–28.08.2026)

• GitHub меняет порядок оплаты и политики Copilot

С 1 октября места Copilot Business и Enterprise будут оплачиваться авансом в начале расчётного периода; отзыв места не уменьшит уже начисленную плату. Цена подписки не меняется, но администраторам стоит заранее проверить назначенные места и лимиты дополнительного использования.

• Вышел Kubernetes 1.37

В выпуск вошли 67 улучшений: 16 получили стабильный статус, 23 — статус бета-версии. Горизонтальное масштабирование до нуля включено по умолчанию для внешних и объектных метрик, а сервер API при прогреве кеша теперь ограничивает нагрузку на etcd ответами 429 — клиентам нужны Retry-After и экспоненциальная задержка.

• Google открыла Gemini Omni 1.1 Flash через API

Модель для генерации видео умеет продолжать сцену блоками по 10 секунд до общей длины 40 секунд, задавать первый и последний кадры и повышать разрешение результата до 4K. Предпросмотр в 360p позволяет дешевле перебирать варианты до финального рендера.

• CUDA Python 1.0 закрепила стабильные API

NVIDIA ввела семантическое версионирование и правила предварительного устаревания публичных интерфейсов. cuda.core 1.0 даёт общий объектный слой для устройств, потоков и памяти, а cuda.bindings 13.3 сохраняет прямое покрытие API CUDA C.

• NVIDIA Dynamo ускоряет восстановление инференса после сбоя

Предварительная функция держит прогретый резервный движок на тех же ускорителях и переиспользует веса в памяти. В тесте NVIDIA второй узел вернулся в работу за 7,3 секунды вместо 283 секунд при холодном запуске; нужны Kubernetes 1.34+, драйвер NVIDIA GPU DRA и поддерживаемый движок vLLM.

• AWS Lambda получила полноценные ресурсные политики IAM

Одна политика теперь может задавать нескольких субъектов и действий и использовать полный набор условий IAM, включая ограничения по исходному IP-адресу и тегам субъекта. Это сокращает число отдельных разрешений в многоаккаунтных средах; функция доступна без доплаты.

• Amazon ECS обнаруживает потерю связи с агентом и восстанавливает узлы

Новое событие AGENT_CONNECTIVITY доступно для Fargate, ECS Managed Instances и ECS на EC2. В первых двух режимах сервис сам выводит задачи с повреждённого узла и запускает замену; для EC2 событие нужно подключить к собственному сценарию восстановления.

• Aurora DSQL добавила внешние ключи

Ограничения можно добавлять к новым и существующим таблицам распределённой базы. Поддерживаются NO ACTION, RESTRICT, CASCADE, SET NULL и SET DEFAULT — целостность ссылок теперь можно обеспечивать на уровне самой DSQL, а не только приложения.

• Amazon Redshift подключили к Agent Toolkit for AWS

Claude Code, Kiro и Cursor могут работать с хранилищем через аутентифицированный сервер MCP и набор проверенных инструкций: от исследования схем и загрузки данных до миграции и сравнения производительности. Интеграция бесплатна, но доступ агента к MCP фактически становится доступом к операциям AWS и требует минимальных разрешений.

#ии@intData #разработка@intData #дайджест@intData
Forwarded from Denis Sexy IT 🤖
Please open Telegram to view this post
VIEW IN TELEGRAM
🧩 Главное за неделю (24.08–30.08.2026)

Meta согласилась заплатить до $17,1 млрд и изменить Instagram и Facebook для детей

Соглашение с 51 штатом и территорией США вводит двухчасовой дневной лимит, ночную блокировку, проверку возраста и независимый аудит. Минимальная выплата за десять лет — $12,1 млрд; ещё $5 млрд зависят от аналогичных мер у других крупных платформ.

Квартальная выручка NVIDIA достигла $96,2 млрд

Выручка выросла на 106% за год, а направление центров обработки данных принесло $89 млрд — на 117% больше. Компания ожидает $108 млрд в следующем квартале и не закладывает в прогноз продажи вычислительных ускорителей для центров обработки данных в Китае.

NVIDIA обсуждает покупку Hugging Face примерно за $13 млрд

Reuters сообщило о переговорах вокруг платформы моделей и наборов данных. Если сделка состоится, крупнейший поставщик ускорителей получит прямой контроль над одним из главных узлов экосистемы открытых моделей.

OpenAI сворачивает поставку моделей для Cursor после покупки сервиса SpaceX

Компания решила прекратить контракт с редактором кода после смены владельца. Для продуктов поверх чужих моделей это наглядный риск: доступ к ключевому поставщику может исчезнуть после корпоративной сделки.

Великобритания и Украина договорились совместно разрабатывать военный ИИ

Партнёрство охватывает общие модели, защищённые контуры данных и вычислений, автономные системы и кибербезопасность. Стороны начнут с пилотов; декларация не создаёт юридически обязательных норм.

Sony Music Publishing и Warner Chappell подали иск к Anthropic

Издатели обвиняют компанию в использовании тысяч песен для обучения Claude без лицензий и требуют компенсацию. Новый иск расширяет спор об обучающих данных с книг и изображений на каталоги крупнейших музыкальных правообладателей.

NASA запустило космический телескоп Nancy Grace Roman

Аппарат отправился к рабочей орбите в полутора миллионах километров от Земли. Широкоугольные инфракрасные обзоры помогут исследовать тёмную материю, тёмную энергию и экзопланеты.

SEC обвинила 38 организаций в подделке статуса инвестиционных консультантов

По версии регулятора, организации внесли ложные сведения в официальные формы, а затем использовали видимость регистрации для привлечения частных инвесторов. SEC удалила их документы и отдельно предупредила: наличие записи в реестре само по себе не подтверждает легитимность фирмы.

OpenAI заблокировала связанную с Россией скрытую кампанию влияния

Аккаунты продвигали фиктивный израильский аналитический центр и индекс «суверенитета», хваливший Россию и критиковавший западные страны. Генеративный ИИ здесь использовался не только для текстов, но и для придания операции вида независимой экспертизы.

#главноезанеделю@intData #дайджест@intData
📱 Технологии и продукты (26.08–01.09.2026)

Meta согласовала с властями США правила для подростковых аккаунтов и выплату около $18 млрд

Соглашение с 52 генеральными прокурорами предусматривает автоматические ограничения для пользователей младше 18 лет в участвующих штатах и территориях, независимый аудит и финансирование мер онлайн-безопасности в течение десяти лет. Это один из крупнейших случаев, когда устройство социальной платформы закрепляют не рекомендациями, а долгосрочными обязательствами.

Кибератака нарушила производство и поставки Boston Scientific

Инцидент затронул локальные системы компании, включая производство, обработку и отправку заказов; облачные сервисы, по данным Boston Scientific, не пострадали. Компания также не обнаружила влияния на работу имплантируемых кардиологических устройств, но новые подключения к удалённому мониторингу оказались ограничены.

Android 17 закрывает сразу несколько сетевых каналов слежки и атак

Система получила поддержку шифрования имени посещаемого сайта, обязательное разрешение для доступа приложений к домашней сети и прозрачность сертификатов по умолчанию. Операторы также смогут отключать 2G для абонентов, снижая риск атак через поддельные базовые станции и рассылки от «СМС-бластеров».

Google разрешила сайтам отказаться от участия в ответах ИИ-поиска

С 31 августа переключатель в Search Console и новая статистика доступны сайтам по всему миру. Отказ исключает страницы из AI Overviews, AI Mode и ответов в Discover, но не влияет на ранжирование в обычной поисковой выдаче — у владельцев появился отдельный контроль над использованием контента генеративным поиском.

Gemini 3.5 Transcribe вышла в API для потокового распознавания речи

Модель умеет разделять говорящих, ставить временные метки по словам, учитывать специальную лексику и обрабатывать переключение языков в реальном времени. Google заявляет о сокращении времени до готовой расшифровки на 70% по сравнению с Chirp 3; разработчики могут использовать модель в Google AI Studio и корпоративной платформе агентов.

Gemini Omni 1.1 Flash приблизила генеративное видео к производственному монтажу

Модель продлевает сцену с учётом предыдущих десяти секунд, строит переход между начальным и конечным кадрами и выдаёт результат в 4K. Черновики в 360p генерируются, по данным Google, до 60% быстрее и втрое дешевле стандартного 720p — это делает перебор вариантов практичной частью рабочего процесса.

#технологии@intData #дайджест@intData
Forwarded from e/acc
продолжаю тему: как готовиться и чему учиться к post-AGI миру

1. желать глубины
сегодня любой чат может сделать вообще любую задачу, его достаточно просто попросить. но без контекста, без конкретики и без четкого описания идеального результата он сделает слоп. в итоге для мира эта задача, возможно, лучше вообще была бы не сделана, чем сделана как слоп.

чтобы стать безумно богатым и успешным (то есть, решать задачи полезные для мира лучше чем кто-либо другой), нужно научиться активно искать глубину в любом процессе.

делать руками то, что что можно отдать боту — это бессмысленная трата времени и тупость
но делать скрупулезно и тщательно то, что бот просто пропустил бы — ставить ему задачи, проверять шаги, поправлять, не соглашаться на чуть менее чем идеальный результат — это то что отличает успех от "середнячка"

2. забудьте про названия ролей и должностей
самые неприятные времена ждут тех, кто строил свою идентичность вокруг роли "риск-менеджера" или "перформанс таргетолога". я не верю в эти все названия.

в бизнесе, реальных профессий очень мало: это что-то строить, что-то дистрибутировать и продавать, делать так чтобы процессы работали эффективно.

навыки в профессии это: глубина в своей области + умение работать с ИИ + ясно писать и говорить + существующая аудитория + связи и репутация в мире + активы и капитал.

а как вы это назовете не скажется особо на результате. результат - это решенные проблемы, мир который стал лучше и довольнее от ваших действий.

3. не упускать передний край из виду
это не значит, что если вы не работаете в OpenAI, то все потеряно. но это значит, что нужно пользоваться топовыми инструментами и постоянно их обновлять. я перепробовал все возможные харенсы - warp, cursor, conductor, orca, cc, codex, zed - в итоге остановился на bb, потому что он умеет сам себя переписывать на ходу (отдельно могу рассказать кому интересно). сегодня нанимать человека, который использует практики из 2024 для работы с моделями это как нанимать бухгалтера с деревянными счетами.

4. стройте бренд и дистрибуцию
постепенно, все что делают люди руками становится автоматизировано, кроме отношений между людьми. чем больше людей вас знают и чем больше тех, до кого вы можете достучаться и чем прочнее уровень этих связей, тем ценнее ваш социальный капитал.
Forwarded from e/acc
Топ вещей, чтобы стать успешным и красивым в мире с ИИ

перестать просто "пользоваться ИИ" и научиться строить системы из ИИ. ваша задача научиться оркестрировать агентов, строить повторяемые воркфлоу и системы с разными агентами (для экономии) для разных задач. год назад большинство моей работы заключалось в общении с одним агентом в одном чате. сегодня средний запуск любой задачи (не считая поиск информации) - это часы автономной работы, в рамках которых спаунятся десятки субагентов и мне не нужно даже знать что они делают. это не будет работать с первого запуска, но это дает в некотором смысле суперспособности

автоматизировать производство, но владеть и улучшать мышлением. любой поиск и подготовка информации, документы, код, таблицы, административные задачи должен делать ИИ, но если ему отдавать формулирование целей и оценку качества то вы превращаетесь в слоп-машину, которая просто жмет на кнопки в казино.

время стоит дороже токенов. нет смысла в автоматизации ради нее самой, но есть огромный смысл сократить работу с 8 до 4 часов. для кого-то это значит в 2 раза больше отдыха в день, а для кого-то - что их компания теперь может решать в 2 раза больше задач и зарабатывать х2.

универсальные знания важны, но вы должны развивать глубину в чем-то одном. выиграет тот, кто глубоко понимает хотя бы одну область и умеет с помощью ИИ самостоятельно заходить в соседние. инвестор может самостоятельно программировать небольшие инструменты, анализировать данные, проектировать продукты и делать исследования. инженер может заниматься дизайном, продажами, исследованиями рынка и финансами. но каждый должен быть экспертом в своей работе, иначе зачем здесь вы?

выбор что делать, целеполагание. раньше ограничением было исполнение работы на сотрудников и поиск ресурсов, а сегодня каждый человек может делать работу большой команды. Поэтому ограничением становится не сам процесс исполнения, а выбор цели. какая проблема важна? где бабки? почему сейчас? как проверить гипотезу? как оценить результат?

ИИ может придумать 100 вариантов решение, но самое важное это judgement (суждение): какой из них действительно правильный? где скрыта ошибка? что слишком банально? какие предположения неверны? что не подходит к конкретной ситуации? енность постепенно смещается от знания ответа к способности оценивать ответы и качество результата.

поэтому, резко дорожает вкус. за минуту можно создать сто изображений, текстов, логотипов, песен или вариантов продукта, способность создать ещё один вариант почти ничего не стоит. ценность появляется в способности сказать: "вот этот хороший, остальные девяносто девять на помойку"

человек должен быть мастером своего дела. с ИИ или без, люди ценят лучших в каждом деле. это может быть управление хедж-фондом или танцы в тиктоке, но номер 1 в обоих соберет на себя 90% внимания. занятие формирует вкус, терпение, личность и чувство мастерства и защищает от психологического кризиса в мире, где экономическая полезность человека перестаёт быть главным источником его самооценки.

иногда трение нужно создавать специально - последние сто лет технологии в основном убирали сложности из жизни. с ИИ вообще не нужно вспоминать, искать, писать, считать, ждать, планировать. но часть полезных человеческих качеств появляется именно через усилие, поэтому иногда имеет смысл сознательно самостоятельно написать текст / разобраться в сложной теме без краткого пересказа / порисовать / приготовить еду / несколько часов прожить без телефона
К утру мир ещё немного изменится.
Forwarded from Denis Sexy IT 🤖
Вышла новая GPT 6 (в течение недели дадут всем) – я ее активно потестировал (спасибо JetBrains), и я честно впечатлен – я все громкие модели видел, все эти модели трогал, и меня сложно удивить, но она смогла

Наверное, больше всего меня впечатлили две вещи:

💿 Она нормально коротко общается, больше никакого слопа в ответах на три экрана

💿 Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи

Вот примеры, которые она собрала за 15 минут с простых промптов (без спек, а просто – иди сделай, вот файлы с фотками или видео)

Первое видео – это одесская дача где я часто бывал в детстве, я просто дал ей фотографии и видео (штук 10), и она собрала за пару ходов мне 3D карту которую я могу и как ностальгию использовать и как карту для CS 1.6 – отдельно меня удивили текстуры, она сама вырезала фотографии из видео и расставила в рамки, или там занавеску от душа – то есть, я уже могу предположить, что все ваши исторические фотографии можно будет перестроить через како-то время в какие-то сцены; в 3D-не-3D не важно, она сама понимает где что находится смотря на фотографии или кадры в пространстве, делая нужную карту
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1