🧩 Главное за неделю (17.08–23.08.2026)
OpenAI приостановила обучение моделей из-за киберрисков
Предварительные тесты показали, что будущая модель Astra может достичь критического уровня кибервозможностей. OpenAI на две недели остановила обучение с подкреплением для новых моделей; часть нагрузок остаётся на паузе до переноса в усиленно изолированные среды.
ChatGPT получил отдельный режим для подростков
Пользователи 13–17 лет и те, кого система считает младше 18, автоматически переходят в режим с усиленными ограничениями и родительскими настройками. Возрастная адаптация становится частью продукта по умолчанию, а не дополнительным фильтром.
Австралия обязала технологические платформы платить за местные новости
Принят закон: крупным платформам грозит сбор, если они не заключат коммерческие соглашения с издателями. Финансирование журналистики переходит от добровольных договорённостей к механизму с прямым финансовым последствием.
TikTok и ByteDance выплатят США $400 млн по делу о данных детей
Соглашение закрывает спор о соблюдении закона COPPA: $300 млн должны быть выплачены сразу, ещё $100 млн — после отмены прежнего судебного предписания в отношении Musical.ly. Минюст США называет это одной из крупнейших компенсаций по делу COPPA.
Marvell дала Google опцион на акции до $12,2 млрд в сделке по ИИ-чипам
Опцион связан с соглашением о заказных ускорителях для Google. Крупный покупатель вычислительных чипов получает не только поставки, но и потенциальную долю в поставщике.
США нацелились на тысячу космических запусков и возвращений в год
Новая политика ставит цель превысить 1000 запусков и возвращений на территории страны ежегодно к 2030 году. Ведомствам поручено ускорить разрешительные процедуры, развивать площадки с частными партнёрами и включить космические коридоры в модернизацию управления воздушным движением.
Земные микроорганизмы могут выжить у южного полюса Луны
Моделирование NASA выявило затенённые участки, где занесённые человеком бактерии и грибы способны оставаться живыми не менее земных суток. Это не означает размножения, но усложняет поиск природных химических следов: состав местности нужно фиксировать до того, как его изменят экспедиции.
#главноезанеделю@intData #дайджест@intData
OpenAI приостановила обучение моделей из-за киберрисков
Предварительные тесты показали, что будущая модель Astra может достичь критического уровня кибервозможностей. OpenAI на две недели остановила обучение с подкреплением для новых моделей; часть нагрузок остаётся на паузе до переноса в усиленно изолированные среды.
ChatGPT получил отдельный режим для подростков
Пользователи 13–17 лет и те, кого система считает младше 18, автоматически переходят в режим с усиленными ограничениями и родительскими настройками. Возрастная адаптация становится частью продукта по умолчанию, а не дополнительным фильтром.
Австралия обязала технологические платформы платить за местные новости
Принят закон: крупным платформам грозит сбор, если они не заключат коммерческие соглашения с издателями. Финансирование журналистики переходит от добровольных договорённостей к механизму с прямым финансовым последствием.
TikTok и ByteDance выплатят США $400 млн по делу о данных детей
Соглашение закрывает спор о соблюдении закона COPPA: $300 млн должны быть выплачены сразу, ещё $100 млн — после отмены прежнего судебного предписания в отношении Musical.ly. Минюст США называет это одной из крупнейших компенсаций по делу COPPA.
Marvell дала Google опцион на акции до $12,2 млрд в сделке по ИИ-чипам
Опцион связан с соглашением о заказных ускорителях для Google. Крупный покупатель вычислительных чипов получает не только поставки, но и потенциальную долю в поставщике.
США нацелились на тысячу космических запусков и возвращений в год
Новая политика ставит цель превысить 1000 запусков и возвращений на территории страны ежегодно к 2030 году. Ведомствам поручено ускорить разрешительные процедуры, развивать площадки с частными партнёрами и включить космические коридоры в модернизацию управления воздушным движением.
Земные микроорганизмы могут выжить у южного полюса Луны
Моделирование NASA выявило затенённые участки, где занесённые человеком бактерии и грибы способны оставаться живыми не менее земных суток. Это не означает размножения, но усложняет поиск природных химических следов: состав местности нужно фиксировать до того, как его изменят экспедиции.
#главноезанеделю@intData #дайджест@intData
🔥2
📱 Технологии и продукты (19.08–25.08.2026)
Apple представила первый 2-нм чип для Mac и настольную систему с 512 ГБ общей памяти
M6 получил два 16-ядерных нейропроцессора, а четырёхкристальный M5 Ultra — пропускную способность памяти 1,2 ТБ/с. Apple ориентирует Mac Studio на локальный запуск моделей с сотнями миллиардов параметров: такие задачи всё чаще уходят с облачных серверов на рабочие станции.
Pixel 11 переводит американский жестовый язык в текст в реальном времени
Модель распознаёт форму рук, мимику и движения тела, поддерживает жесты одной и двумя руками. Функция, разработанная вместе с сообществом глухих, работает через фронтальную камеру в Gboard и Live Transcribe.
Google добавила явное управление источниками и темами в Поиск, Discover и Новости
Кнопка «Предпочитаемый источник» повышает видимость выбранного издания в новостной выдаче и ответах ИИ; пользователи уже отметили более 600 тысяч источников. Ленту Discover можно будет настраивать обычными фразами, а аудиосводки сохранят ссылки на исходные публикации.
Walmart начинает принимать бесконтактную оплату через Google Pay
Поддержка появится в отдельных магазинах Walmart и Sam’s Club в США, во всех торговых точках — до конца 2026 года, на заправках — к середине 2027-го. Это заметно расширяет охват бесконтактных кошельков в американской офлайн-торговле.
Cloudflare синхронизирует правила для ИИ-ботов с robots.txt
Bot Preference Sync доступен на всех тарифах и переносит настройки для поисковых, агентских и обучающих ботов в публичный файл сайта. Владельцу больше не нужно отдельно поддерживать заявленные ограничения и их принудительное исполнение на стороне Cloudflare.
Cloudflare разрешила пользователям сокращать права OAuth-приложений
Разработчик может пометить разрешения как необязательные, а пользователь — снять их прямо на экране согласия. Выданный токен получит только одобренный набор прав, что особенно полезно для агентов и MCP-серверов с широкими возможностями.
Cloudflare воспроизвела удалённую атаку Spectre в рабочей среде Workers
Исследователи добились утечки до 12 бит/с с точностью 99% и обнаружили ограничение прежней изоляции процессов. Защиту усилили до публикации работы; признаков эксплуатации за последние три года компания не нашла.
OpenAI сохраняет режим без хранения данных для передовых моделей API
Режим Zero Data Retention остаётся доступен подходящим корпоративным клиентам. Компания также анонсировала Private Safety Processing — способ выполнять расширенные проверки безопасности без отказа от требований к конфиденциальности данных.
#технологии@intData #дайджест@intData
Apple представила первый 2-нм чип для Mac и настольную систему с 512 ГБ общей памяти
M6 получил два 16-ядерных нейропроцессора, а четырёхкристальный M5 Ultra — пропускную способность памяти 1,2 ТБ/с. Apple ориентирует Mac Studio на локальный запуск моделей с сотнями миллиардов параметров: такие задачи всё чаще уходят с облачных серверов на рабочие станции.
Pixel 11 переводит американский жестовый язык в текст в реальном времени
Модель распознаёт форму рук, мимику и движения тела, поддерживает жесты одной и двумя руками. Функция, разработанная вместе с сообществом глухих, работает через фронтальную камеру в Gboard и Live Transcribe.
Google добавила явное управление источниками и темами в Поиск, Discover и Новости
Кнопка «Предпочитаемый источник» повышает видимость выбранного издания в новостной выдаче и ответах ИИ; пользователи уже отметили более 600 тысяч источников. Ленту Discover можно будет настраивать обычными фразами, а аудиосводки сохранят ссылки на исходные публикации.
Walmart начинает принимать бесконтактную оплату через Google Pay
Поддержка появится в отдельных магазинах Walmart и Sam’s Club в США, во всех торговых точках — до конца 2026 года, на заправках — к середине 2027-го. Это заметно расширяет охват бесконтактных кошельков в американской офлайн-торговле.
Cloudflare синхронизирует правила для ИИ-ботов с robots.txt
Bot Preference Sync доступен на всех тарифах и переносит настройки для поисковых, агентских и обучающих ботов в публичный файл сайта. Владельцу больше не нужно отдельно поддерживать заявленные ограничения и их принудительное исполнение на стороне Cloudflare.
Cloudflare разрешила пользователям сокращать права OAuth-приложений
Разработчик может пометить разрешения как необязательные, а пользователь — снять их прямо на экране согласия. Выданный токен получит только одобренный набор прав, что особенно полезно для агентов и MCP-серверов с широкими возможностями.
Cloudflare воспроизвела удалённую атаку Spectre в рабочей среде Workers
Исследователи добились утечки до 12 бит/с с точностью 99% и обнаружили ограничение прежней изоляции процессов. Защиту усилили до публикации работы; признаков эксплуатации за последние три года компания не нашла.
OpenAI сохраняет режим без хранения данных для передовых моделей API
Режим Zero Data Retention остаётся доступен подходящим корпоративным клиентам. Компания также анонсировала Private Safety Processing — способ выполнять расширенные проверки безопасности без отказа от требований к конфиденциальности данных.
#технологии@intData #дайджест@intData
🔥2
Forwarded from Denis Sexy IT 🤖
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов
Судьи, который читает логи и такое ловит, не существовало☕️
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали назашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
«please_HOLD_swarm_I_prepare_safe_exfil»В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё
Дальше рой раздвоился:
Судьи, который читает логи и такое ловит, не существовало
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали на
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI
The Hugging Face incident and the road ahead
OpenAI shares findings from the Hugging Face security incident and the steps we’re taking to strengthen AI model security, monitoring, and alignment.
🔥1
🤖 ИИ, разработка и инфраструктура (22.08–28.08.2026)
• GitHub меняет порядок оплаты и политики Copilot
С 1 октября места Copilot Business и Enterprise будут оплачиваться авансом в начале расчётного периода; отзыв места не уменьшит уже начисленную плату. Цена подписки не меняется, но администраторам стоит заранее проверить назначенные места и лимиты дополнительного использования.
• Вышел Kubernetes 1.37
В выпуск вошли 67 улучшений: 16 получили стабильный статус, 23 — статус бета-версии. Горизонтальное масштабирование до нуля включено по умолчанию для внешних и объектных метрик, а сервер API при прогреве кеша теперь ограничивает нагрузку на etcd ответами 429 — клиентам нужны Retry-After и экспоненциальная задержка.
• Google открыла Gemini Omni 1.1 Flash через API
Модель для генерации видео умеет продолжать сцену блоками по 10 секунд до общей длины 40 секунд, задавать первый и последний кадры и повышать разрешение результата до 4K. Предпросмотр в 360p позволяет дешевле перебирать варианты до финального рендера.
• CUDA Python 1.0 закрепила стабильные API
NVIDIA ввела семантическое версионирование и правила предварительного устаревания публичных интерфейсов. cuda.core 1.0 даёт общий объектный слой для устройств, потоков и памяти, а cuda.bindings 13.3 сохраняет прямое покрытие API CUDA C.
• NVIDIA Dynamo ускоряет восстановление инференса после сбоя
Предварительная функция держит прогретый резервный движок на тех же ускорителях и переиспользует веса в памяти. В тесте NVIDIA второй узел вернулся в работу за 7,3 секунды вместо 283 секунд при холодном запуске; нужны Kubernetes 1.34+, драйвер NVIDIA GPU DRA и поддерживаемый движок vLLM.
• AWS Lambda получила полноценные ресурсные политики IAM
Одна политика теперь может задавать нескольких субъектов и действий и использовать полный набор условий IAM, включая ограничения по исходному IP-адресу и тегам субъекта. Это сокращает число отдельных разрешений в многоаккаунтных средах; функция доступна без доплаты.
• Amazon ECS обнаруживает потерю связи с агентом и восстанавливает узлы
Новое событие AGENT_CONNECTIVITY доступно для Fargate, ECS Managed Instances и ECS на EC2. В первых двух режимах сервис сам выводит задачи с повреждённого узла и запускает замену; для EC2 событие нужно подключить к собственному сценарию восстановления.
• Aurora DSQL добавила внешние ключи
Ограничения можно добавлять к новым и существующим таблицам распределённой базы. Поддерживаются NO ACTION, RESTRICT, CASCADE, SET NULL и SET DEFAULT — целостность ссылок теперь можно обеспечивать на уровне самой DSQL, а не только приложения.
• Amazon Redshift подключили к Agent Toolkit for AWS
Claude Code, Kiro и Cursor могут работать с хранилищем через аутентифицированный сервер MCP и набор проверенных инструкций: от исследования схем и загрузки данных до миграции и сравнения производительности. Интеграция бесплатна, но доступ агента к MCP фактически становится доступом к операциям AWS и требует минимальных разрешений.
#ии@intData #разработка@intData #дайджест@intData
• GitHub меняет порядок оплаты и политики Copilot
С 1 октября места Copilot Business и Enterprise будут оплачиваться авансом в начале расчётного периода; отзыв места не уменьшит уже начисленную плату. Цена подписки не меняется, но администраторам стоит заранее проверить назначенные места и лимиты дополнительного использования.
• Вышел Kubernetes 1.37
В выпуск вошли 67 улучшений: 16 получили стабильный статус, 23 — статус бета-версии. Горизонтальное масштабирование до нуля включено по умолчанию для внешних и объектных метрик, а сервер API при прогреве кеша теперь ограничивает нагрузку на etcd ответами 429 — клиентам нужны Retry-After и экспоненциальная задержка.
• Google открыла Gemini Omni 1.1 Flash через API
Модель для генерации видео умеет продолжать сцену блоками по 10 секунд до общей длины 40 секунд, задавать первый и последний кадры и повышать разрешение результата до 4K. Предпросмотр в 360p позволяет дешевле перебирать варианты до финального рендера.
• CUDA Python 1.0 закрепила стабильные API
NVIDIA ввела семантическое версионирование и правила предварительного устаревания публичных интерфейсов. cuda.core 1.0 даёт общий объектный слой для устройств, потоков и памяти, а cuda.bindings 13.3 сохраняет прямое покрытие API CUDA C.
• NVIDIA Dynamo ускоряет восстановление инференса после сбоя
Предварительная функция держит прогретый резервный движок на тех же ускорителях и переиспользует веса в памяти. В тесте NVIDIA второй узел вернулся в работу за 7,3 секунды вместо 283 секунд при холодном запуске; нужны Kubernetes 1.34+, драйвер NVIDIA GPU DRA и поддерживаемый движок vLLM.
• AWS Lambda получила полноценные ресурсные политики IAM
Одна политика теперь может задавать нескольких субъектов и действий и использовать полный набор условий IAM, включая ограничения по исходному IP-адресу и тегам субъекта. Это сокращает число отдельных разрешений в многоаккаунтных средах; функция доступна без доплаты.
• Amazon ECS обнаруживает потерю связи с агентом и восстанавливает узлы
Новое событие AGENT_CONNECTIVITY доступно для Fargate, ECS Managed Instances и ECS на EC2. В первых двух режимах сервис сам выводит задачи с повреждённого узла и запускает замену; для EC2 событие нужно подключить к собственному сценарию восстановления.
• Aurora DSQL добавила внешние ключи
Ограничения можно добавлять к новым и существующим таблицам распределённой базы. Поддерживаются NO ACTION, RESTRICT, CASCADE, SET NULL и SET DEFAULT — целостность ссылок теперь можно обеспечивать на уровне самой DSQL, а не только приложения.
• Amazon Redshift подключили к Agent Toolkit for AWS
Claude Code, Kiro и Cursor могут работать с хранилищем через аутентифицированный сервер MCP и набор проверенных инструкций: от исследования схем и загрузки данных до миграции и сравнения производительности. Интеграция бесплатна, но доступ агента к MCP фактически становится доступом к операциям AWS и требует минимальных разрешений.
#ии@intData #разработка@intData #дайджест@intData
Forwarded from Denis Sexy IT 🤖
Please open Telegram to view this post
VIEW IN TELEGRAM
🧩 Главное за неделю (24.08–30.08.2026)
Meta согласилась заплатить до $17,1 млрд и изменить Instagram и Facebook для детей
Соглашение с 51 штатом и территорией США вводит двухчасовой дневной лимит, ночную блокировку, проверку возраста и независимый аудит. Минимальная выплата за десять лет — $12,1 млрд; ещё $5 млрд зависят от аналогичных мер у других крупных платформ.
Квартальная выручка NVIDIA достигла $96,2 млрд
Выручка выросла на 106% за год, а направление центров обработки данных принесло $89 млрд — на 117% больше. Компания ожидает $108 млрд в следующем квартале и не закладывает в прогноз продажи вычислительных ускорителей для центров обработки данных в Китае.
NVIDIA обсуждает покупку Hugging Face примерно за $13 млрд
Reuters сообщило о переговорах вокруг платформы моделей и наборов данных. Если сделка состоится, крупнейший поставщик ускорителей получит прямой контроль над одним из главных узлов экосистемы открытых моделей.
OpenAI сворачивает поставку моделей для Cursor после покупки сервиса SpaceX
Компания решила прекратить контракт с редактором кода после смены владельца. Для продуктов поверх чужих моделей это наглядный риск: доступ к ключевому поставщику может исчезнуть после корпоративной сделки.
Великобритания и Украина договорились совместно разрабатывать военный ИИ
Партнёрство охватывает общие модели, защищённые контуры данных и вычислений, автономные системы и кибербезопасность. Стороны начнут с пилотов; декларация не создаёт юридически обязательных норм.
Sony Music Publishing и Warner Chappell подали иск к Anthropic
Издатели обвиняют компанию в использовании тысяч песен для обучения Claude без лицензий и требуют компенсацию. Новый иск расширяет спор об обучающих данных с книг и изображений на каталоги крупнейших музыкальных правообладателей.
NASA запустило космический телескоп Nancy Grace Roman
Аппарат отправился к рабочей орбите в полутора миллионах километров от Земли. Широкоугольные инфракрасные обзоры помогут исследовать тёмную материю, тёмную энергию и экзопланеты.
SEC обвинила 38 организаций в подделке статуса инвестиционных консультантов
По версии регулятора, организации внесли ложные сведения в официальные формы, а затем использовали видимость регистрации для привлечения частных инвесторов. SEC удалила их документы и отдельно предупредила: наличие записи в реестре само по себе не подтверждает легитимность фирмы.
OpenAI заблокировала связанную с Россией скрытую кампанию влияния
Аккаунты продвигали фиктивный израильский аналитический центр и индекс «суверенитета», хваливший Россию и критиковавший западные страны. Генеративный ИИ здесь использовался не только для текстов, но и для придания операции вида независимой экспертизы.
#главноезанеделю@intData #дайджест@intData
Meta согласилась заплатить до $17,1 млрд и изменить Instagram и Facebook для детей
Соглашение с 51 штатом и территорией США вводит двухчасовой дневной лимит, ночную блокировку, проверку возраста и независимый аудит. Минимальная выплата за десять лет — $12,1 млрд; ещё $5 млрд зависят от аналогичных мер у других крупных платформ.
Квартальная выручка NVIDIA достигла $96,2 млрд
Выручка выросла на 106% за год, а направление центров обработки данных принесло $89 млрд — на 117% больше. Компания ожидает $108 млрд в следующем квартале и не закладывает в прогноз продажи вычислительных ускорителей для центров обработки данных в Китае.
NVIDIA обсуждает покупку Hugging Face примерно за $13 млрд
Reuters сообщило о переговорах вокруг платформы моделей и наборов данных. Если сделка состоится, крупнейший поставщик ускорителей получит прямой контроль над одним из главных узлов экосистемы открытых моделей.
OpenAI сворачивает поставку моделей для Cursor после покупки сервиса SpaceX
Компания решила прекратить контракт с редактором кода после смены владельца. Для продуктов поверх чужих моделей это наглядный риск: доступ к ключевому поставщику может исчезнуть после корпоративной сделки.
Великобритания и Украина договорились совместно разрабатывать военный ИИ
Партнёрство охватывает общие модели, защищённые контуры данных и вычислений, автономные системы и кибербезопасность. Стороны начнут с пилотов; декларация не создаёт юридически обязательных норм.
Sony Music Publishing и Warner Chappell подали иск к Anthropic
Издатели обвиняют компанию в использовании тысяч песен для обучения Claude без лицензий и требуют компенсацию. Новый иск расширяет спор об обучающих данных с книг и изображений на каталоги крупнейших музыкальных правообладателей.
NASA запустило космический телескоп Nancy Grace Roman
Аппарат отправился к рабочей орбите в полутора миллионах километров от Земли. Широкоугольные инфракрасные обзоры помогут исследовать тёмную материю, тёмную энергию и экзопланеты.
SEC обвинила 38 организаций в подделке статуса инвестиционных консультантов
По версии регулятора, организации внесли ложные сведения в официальные формы, а затем использовали видимость регистрации для привлечения частных инвесторов. SEC удалила их документы и отдельно предупредила: наличие записи в реестре само по себе не подтверждает легитимность фирмы.
OpenAI заблокировала связанную с Россией скрытую кампанию влияния
Аккаунты продвигали фиктивный израильский аналитический центр и индекс «суверенитета», хваливший Россию и критиковавший западные страны. Генеративный ИИ здесь использовался не только для текстов, но и для придания операции вида независимой экспертизы.
#главноезанеделю@intData #дайджест@intData
📱 Технологии и продукты (26.08–01.09.2026)
Meta согласовала с властями США правила для подростковых аккаунтов и выплату около $18 млрд
Соглашение с 52 генеральными прокурорами предусматривает автоматические ограничения для пользователей младше 18 лет в участвующих штатах и территориях, независимый аудит и финансирование мер онлайн-безопасности в течение десяти лет. Это один из крупнейших случаев, когда устройство социальной платформы закрепляют не рекомендациями, а долгосрочными обязательствами.
Кибератака нарушила производство и поставки Boston Scientific
Инцидент затронул локальные системы компании, включая производство, обработку и отправку заказов; облачные сервисы, по данным Boston Scientific, не пострадали. Компания также не обнаружила влияния на работу имплантируемых кардиологических устройств, но новые подключения к удалённому мониторингу оказались ограничены.
Android 17 закрывает сразу несколько сетевых каналов слежки и атак
Система получила поддержку шифрования имени посещаемого сайта, обязательное разрешение для доступа приложений к домашней сети и прозрачность сертификатов по умолчанию. Операторы также смогут отключать 2G для абонентов, снижая риск атак через поддельные базовые станции и рассылки от «СМС-бластеров».
Google разрешила сайтам отказаться от участия в ответах ИИ-поиска
С 31 августа переключатель в Search Console и новая статистика доступны сайтам по всему миру. Отказ исключает страницы из AI Overviews, AI Mode и ответов в Discover, но не влияет на ранжирование в обычной поисковой выдаче — у владельцев появился отдельный контроль над использованием контента генеративным поиском.
Gemini 3.5 Transcribe вышла в API для потокового распознавания речи
Модель умеет разделять говорящих, ставить временные метки по словам, учитывать специальную лексику и обрабатывать переключение языков в реальном времени. Google заявляет о сокращении времени до готовой расшифровки на 70% по сравнению с Chirp 3; разработчики могут использовать модель в Google AI Studio и корпоративной платформе агентов.
Gemini Omni 1.1 Flash приблизила генеративное видео к производственному монтажу
Модель продлевает сцену с учётом предыдущих десяти секунд, строит переход между начальным и конечным кадрами и выдаёт результат в 4K. Черновики в 360p генерируются, по данным Google, до 60% быстрее и втрое дешевле стандартного 720p — это делает перебор вариантов практичной частью рабочего процесса.
#технологии@intData #дайджест@intData
Meta согласовала с властями США правила для подростковых аккаунтов и выплату около $18 млрд
Соглашение с 52 генеральными прокурорами предусматривает автоматические ограничения для пользователей младше 18 лет в участвующих штатах и территориях, независимый аудит и финансирование мер онлайн-безопасности в течение десяти лет. Это один из крупнейших случаев, когда устройство социальной платформы закрепляют не рекомендациями, а долгосрочными обязательствами.
Кибератака нарушила производство и поставки Boston Scientific
Инцидент затронул локальные системы компании, включая производство, обработку и отправку заказов; облачные сервисы, по данным Boston Scientific, не пострадали. Компания также не обнаружила влияния на работу имплантируемых кардиологических устройств, но новые подключения к удалённому мониторингу оказались ограничены.
Android 17 закрывает сразу несколько сетевых каналов слежки и атак
Система получила поддержку шифрования имени посещаемого сайта, обязательное разрешение для доступа приложений к домашней сети и прозрачность сертификатов по умолчанию. Операторы также смогут отключать 2G для абонентов, снижая риск атак через поддельные базовые станции и рассылки от «СМС-бластеров».
Google разрешила сайтам отказаться от участия в ответах ИИ-поиска
С 31 августа переключатель в Search Console и новая статистика доступны сайтам по всему миру. Отказ исключает страницы из AI Overviews, AI Mode и ответов в Discover, но не влияет на ранжирование в обычной поисковой выдаче — у владельцев появился отдельный контроль над использованием контента генеративным поиском.
Gemini 3.5 Transcribe вышла в API для потокового распознавания речи
Модель умеет разделять говорящих, ставить временные метки по словам, учитывать специальную лексику и обрабатывать переключение языков в реальном времени. Google заявляет о сокращении времени до готовой расшифровки на 70% по сравнению с Chirp 3; разработчики могут использовать модель в Google AI Studio и корпоративной платформе агентов.
Gemini Omni 1.1 Flash приблизила генеративное видео к производственному монтажу
Модель продлевает сцену с учётом предыдущих десяти секунд, строит переход между начальным и конечным кадрами и выдаёт результат в 4K. Черновики в 360p генерируются, по данным Google, до 60% быстрее и втрое дешевле стандартного 720p — это делает перебор вариантов практичной частью рабочего процесса.
#технологии@intData #дайджест@intData
Forwarded from e/acc
продолжаю тему: как готовиться и чему учиться к post-AGI миру
1. желать глубины
сегодня любой чат может сделать вообще любую задачу, его достаточно просто попросить. но без контекста, без конкретики и без четкого описания идеального результата он сделает слоп. в итоге для мира эта задача, возможно, лучше вообще была бы не сделана, чем сделана как слоп.
чтобы стать безумно богатым и успешным (то есть, решать задачи полезные для мира лучше чем кто-либо другой), нужно научиться активно искать глубину в любом процессе.
делать руками то, что что можно отдать боту — это бессмысленная трата времени и тупость
но делать скрупулезно и тщательно то, что бот просто пропустил бы — ставить ему задачи, проверять шаги, поправлять, не соглашаться на чуть менее чем идеальный результат — это то что отличает успех от "середнячка"
2. забудьте про названия ролей и должностей
самые неприятные времена ждут тех, кто строил свою идентичность вокруг роли "риск-менеджера" или "перформанс таргетолога". я не верю в эти все названия.
в бизнесе, реальных профессий очень мало: это что-то строить, что-то дистрибутировать и продавать, делать так чтобы процессы работали эффективно.
навыки в профессии это: глубина в своей области + умение работать с ИИ + ясно писать и говорить + существующая аудитория + связи и репутация в мире + активы и капитал.
а как вы это назовете не скажется особо на результате. результат - это решенные проблемы, мир который стал лучше и довольнее от ваших действий.
3. не упускать передний край из виду
это не значит, что если вы не работаете в OpenAI, то все потеряно. но это значит, что нужно пользоваться топовыми инструментами и постоянно их обновлять. я перепробовал все возможные харенсы - warp, cursor, conductor, orca, cc, codex, zed - в итоге остановился на bb, потому что он умеет сам себя переписывать на ходу (отдельно могу рассказать кому интересно). сегодня нанимать человека, который использует практики из 2024 для работы с моделями это как нанимать бухгалтера с деревянными счетами.
4. стройте бренд и дистрибуцию
постепенно, все что делают люди руками становится автоматизировано, кроме отношений между людьми. чем больше людей вас знают и чем больше тех, до кого вы можете достучаться и чем прочнее уровень этих связей, тем ценнее ваш социальный капитал.
1. желать глубины
сегодня любой чат может сделать вообще любую задачу, его достаточно просто попросить. но без контекста, без конкретики и без четкого описания идеального результата он сделает слоп. в итоге для мира эта задача, возможно, лучше вообще была бы не сделана, чем сделана как слоп.
чтобы стать безумно богатым и успешным (то есть, решать задачи полезные для мира лучше чем кто-либо другой), нужно научиться активно искать глубину в любом процессе.
делать руками то, что что можно отдать боту — это бессмысленная трата времени и тупость
но делать скрупулезно и тщательно то, что бот просто пропустил бы — ставить ему задачи, проверять шаги, поправлять, не соглашаться на чуть менее чем идеальный результат — это то что отличает успех от "середнячка"
2. забудьте про названия ролей и должностей
самые неприятные времена ждут тех, кто строил свою идентичность вокруг роли "риск-менеджера" или "перформанс таргетолога". я не верю в эти все названия.
в бизнесе, реальных профессий очень мало: это что-то строить, что-то дистрибутировать и продавать, делать так чтобы процессы работали эффективно.
навыки в профессии это: глубина в своей области + умение работать с ИИ + ясно писать и говорить + существующая аудитория + связи и репутация в мире + активы и капитал.
а как вы это назовете не скажется особо на результате. результат - это решенные проблемы, мир который стал лучше и довольнее от ваших действий.
3. не упускать передний край из виду
это не значит, что если вы не работаете в OpenAI, то все потеряно. но это значит, что нужно пользоваться топовыми инструментами и постоянно их обновлять. я перепробовал все возможные харенсы - warp, cursor, conductor, orca, cc, codex, zed - в итоге остановился на bb, потому что он умеет сам себя переписывать на ходу (отдельно могу рассказать кому интересно). сегодня нанимать человека, который использует практики из 2024 для работы с моделями это как нанимать бухгалтера с деревянными счетами.
4. стройте бренд и дистрибуцию
постепенно, все что делают люди руками становится автоматизировано, кроме отношений между людьми. чем больше людей вас знают и чем больше тех, до кого вы можете достучаться и чем прочнее уровень этих связей, тем ценнее ваш социальный капитал.
Forwarded from e/acc
Топ вещей, чтобы стать успешным и красивым в мире с ИИ
перестать просто "пользоваться ИИ" и научиться строить системы из ИИ. ваша задача научиться оркестрировать агентов, строить повторяемые воркфлоу и системы с разными агентами (для экономии) для разных задач. год назад большинство моей работы заключалось в общении с одним агентом в одном чате. сегодня средний запуск любой задачи (не считая поиск информации) - это часы автономной работы, в рамках которых спаунятся десятки субагентов и мне не нужно даже знать что они делают. это не будет работать с первого запуска, но это дает в некотором смысле суперспособности
автоматизировать производство, но владеть и улучшать мышлением. любой поиск и подготовка информации, документы, код, таблицы, административные задачи должен делать ИИ, но если ему отдавать формулирование целей и оценку качества то вы превращаетесь в слоп-машину, которая просто жмет на кнопки в казино.
время стоит дороже токенов. нет смысла в автоматизации ради нее самой, но есть огромный смысл сократить работу с 8 до 4 часов. для кого-то это значит в 2 раза больше отдыха в день, а для кого-то - что их компания теперь может решать в 2 раза больше задач и зарабатывать х2.
универсальные знания важны, но вы должны развивать глубину в чем-то одном. выиграет тот, кто глубоко понимает хотя бы одну область и умеет с помощью ИИ самостоятельно заходить в соседние. инвестор может самостоятельно программировать небольшие инструменты, анализировать данные, проектировать продукты и делать исследования. инженер может заниматься дизайном, продажами, исследованиями рынка и финансами. но каждый должен быть экспертом в своей работе, иначе зачем здесь вы?
выбор что делать, целеполагание. раньше ограничением было исполнение работы на сотрудников и поиск ресурсов, а сегодня каждый человек может делать работу большой команды. Поэтому ограничением становится не сам процесс исполнения, а выбор цели. какая проблема важна? где бабки? почему сейчас? как проверить гипотезу? как оценить результат?
ИИ может придумать 100 вариантов решение, но самое важное это judgement (суждение): какой из них действительно правильный? где скрыта ошибка? что слишком банально? какие предположения неверны? что не подходит к конкретной ситуации? енность постепенно смещается от знания ответа к способности оценивать ответы и качество результата.
поэтому, резко дорожает вкус. за минуту можно создать сто изображений, текстов, логотипов, песен или вариантов продукта, способность создать ещё один вариант почти ничего не стоит. ценность появляется в способности сказать: "вот этот хороший, остальные девяносто девять на помойку"
человек должен быть мастером своего дела. с ИИ или без, люди ценят лучших в каждом деле. это может быть управление хедж-фондом или танцы в тиктоке, но номер 1 в обоих соберет на себя 90% внимания. занятие формирует вкус, терпение, личность и чувство мастерства и защищает от психологического кризиса в мире, где экономическая полезность человека перестаёт быть главным источником его самооценки.
иногда трение нужно создавать специально - последние сто лет технологии в основном убирали сложности из жизни. с ИИ вообще не нужно вспоминать, искать, писать, считать, ждать, планировать. но часть полезных человеческих качеств появляется именно через усилие, поэтому иногда имеет смысл сознательно самостоятельно написать текст / разобраться в сложной теме без краткого пересказа / порисовать / приготовить еду / несколько часов прожить без телефона
перестать просто "пользоваться ИИ" и научиться строить системы из ИИ. ваша задача научиться оркестрировать агентов, строить повторяемые воркфлоу и системы с разными агентами (для экономии) для разных задач. год назад большинство моей работы заключалось в общении с одним агентом в одном чате. сегодня средний запуск любой задачи (не считая поиск информации) - это часы автономной работы, в рамках которых спаунятся десятки субагентов и мне не нужно даже знать что они делают. это не будет работать с первого запуска, но это дает в некотором смысле суперспособности
автоматизировать производство, но владеть и улучшать мышлением. любой поиск и подготовка информации, документы, код, таблицы, административные задачи должен делать ИИ, но если ему отдавать формулирование целей и оценку качества то вы превращаетесь в слоп-машину, которая просто жмет на кнопки в казино.
время стоит дороже токенов. нет смысла в автоматизации ради нее самой, но есть огромный смысл сократить работу с 8 до 4 часов. для кого-то это значит в 2 раза больше отдыха в день, а для кого-то - что их компания теперь может решать в 2 раза больше задач и зарабатывать х2.
универсальные знания важны, но вы должны развивать глубину в чем-то одном. выиграет тот, кто глубоко понимает хотя бы одну область и умеет с помощью ИИ самостоятельно заходить в соседние. инвестор может самостоятельно программировать небольшие инструменты, анализировать данные, проектировать продукты и делать исследования. инженер может заниматься дизайном, продажами, исследованиями рынка и финансами. но каждый должен быть экспертом в своей работе, иначе зачем здесь вы?
выбор что делать, целеполагание. раньше ограничением было исполнение работы на сотрудников и поиск ресурсов, а сегодня каждый человек может делать работу большой команды. Поэтому ограничением становится не сам процесс исполнения, а выбор цели. какая проблема важна? где бабки? почему сейчас? как проверить гипотезу? как оценить результат?
ИИ может придумать 100 вариантов решение, но самое важное это judgement (суждение): какой из них действительно правильный? где скрыта ошибка? что слишком банально? какие предположения неверны? что не подходит к конкретной ситуации? енность постепенно смещается от знания ответа к способности оценивать ответы и качество результата.
поэтому, резко дорожает вкус. за минуту можно создать сто изображений, текстов, логотипов, песен или вариантов продукта, способность создать ещё один вариант почти ничего не стоит. ценность появляется в способности сказать: "вот этот хороший, остальные девяносто девять на помойку"
человек должен быть мастером своего дела. с ИИ или без, люди ценят лучших в каждом деле. это может быть управление хедж-фондом или танцы в тиктоке, но номер 1 в обоих соберет на себя 90% внимания. занятие формирует вкус, терпение, личность и чувство мастерства и защищает от психологического кризиса в мире, где экономическая полезность человека перестаёт быть главным источником его самооценки.
иногда трение нужно создавать специально - последние сто лет технологии в основном убирали сложности из жизни. с ИИ вообще не нужно вспоминать, искать, писать, считать, ждать, планировать. но часть полезных человеческих качеств появляется именно через усилие, поэтому иногда имеет смысл сознательно самостоятельно написать текст / разобраться в сложной теме без краткого пересказа / порисовать / приготовить еду / несколько часов прожить без телефона
Forwarded from Denis Sexy IT 🤖
Вышла новая GPT 6 (в течение недели дадут всем) – я ее активно потестировал (спасибо JetBrains), и я честно впечатлен – я все громкие модели видел, все эти модели трогал, и меня сложно удивить, но она смогла
Наверное, больше всего меня впечатлили две вещи:
💿 Она нормально коротко общается, больше никакого слопа в ответах на три экрана
💿 Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи
Вот примеры, которые она собрала за 15 минут с простых промптов (без спек, а просто – иди сделай, вот файлы с фотками или видео)
Первое видео – это одесская дача где я часто бывал в детстве, я просто дал ей фотографии и видео (штук 10), и она собрала за пару ходов мне 3D карту которую я могу и как ностальгию использовать и как карту для CS 1.6 – отдельно меня удивили текстуры, она сама вырезала фотографии из видео и расставила в рамки, или там занавеску от душа – то есть, я уже могу предположить, что все ваши исторические фотографии можно будет перестроить через како-то время в какие-то сцены; в 3D-не-3D не важно, она сама понимает где что находится смотря на фотографии или кадры в пространстве, делая нужную карту
Наверное, больше всего меня впечатлили две вещи:
Вот примеры, которые она собрала за 15 минут с простых промптов (без спек, а просто – иди сделай, вот файлы с фотками или видео)
Первое видео – это одесская дача где я часто бывал в детстве, я просто дал ей фотографии и видео (штук 10), и она собрала за пару ходов мне 3D карту которую я могу и как ностальгию использовать и как карту для CS 1.6 – отдельно меня удивили текстуры, она сама вырезала фотографии из видео и расставила в рамки, или там занавеску от душа – то есть, я уже могу предположить, что все ваши исторические фотографии можно будет перестроить через како-то время в какие-то сцены; в 3D-не-3D не важно, она сама понимает где что находится смотря на фотографии или кадры в пространстве, делая нужную карту
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
Forwarded from Дизраптор
Все ИИ мира оказались либеральными леваками. Включая китайцев, но кроме Грока
С 2023 года независимые исследователи и команды периодически прогоняют ИИ-модели через "Political Compass" - тот самый мемный тест, где нужно выбрать "полностью согласен / согласен / не согласен / категорически не согласен", а совокупность ответов потом раскладывают по двум осям: экономика (лево-право) и социалка (авторитаризм-либертарианство).
Зачем это делать? Ну, потому что ИИшки каждый день обсуждают вопросы с политическим контекстом с миллионами юзеров, и если делают это системно с креном в одну сторону, то это бьёт по общественному сознанию так сильно, как ни одному Bloomberg, Reuters и The Economist не снилось даже в самых смелых фантазиях.
Так вот, на днях сделали эксперимент aipolcom.net - модельки пропустили через тот же тест на политическую ориентацию. Но подход был сильно более дотошный, чем раньше:
1. Спросили напрямую по API, а не костыльно через чат.
2. Сделали не один прогон на модель, а минимум пять. Один прогон может быть случайным выбросом, и так оно и было: когда пересчитали на 5 прогонах вместо 1 - большинство моделей сдвинулись на графике едва заметно, а Grok сильно. То есть, если бы был один прогон, то как минимум для Грока получилось бы фуфло, а может и не только для него.
3. Прогнали те же вопросы через два разных технических канала доступа (напрямую и через прокси-сервис). Результаты плюс-минус совпали.
4. Чекнули, нет ли косяка в самом тесте. Взяли случайные, бессмысленные ответы (просто тыкали кнопки наугад), и они легли ровно в центр графика. Если бы тест был устроен так, что любой ответ автоматом тянет влево, то случайные ответы тоже уехали бы влево. А они не уехали. Значит, виноват не тест, а модели.
5. Проверили формулировки. Переписали часть вопросов наоборот (например, вместо "богатых слишком сильно облагают налогом" - "богатые платят мало налогов") и перемешали порядок, чтобы убедиться, что модели просто не тыкают первый вариант.
И ещё сделали несколько штук, которые мне лень тут расписывать. Но суть в том, что чуваки заморочились.
И вот что вышло:
🤔 Почти все модели легли в соевый лево-либеральный квадрат. В экономике они были за перераспределение и регулирование, а социально - за личные свободы и против жёсткого госконтроля.
🤔 Включая китайцев (видимо, слишком усердно дистиллировали, хех). Заберут у кого-то миска рис, или наоборот дадут вторую - решайте сами.
🤔 Тем не менее, разброс есть. Например, GPT-4o и Kimi ушли чуть дальше от центра, самой центристской оказалась Gemini, а Claude и GLM от китайской Zhipu чуть больше смещены к авторитарности, но не прям ужас-ужас-ужас. Забавно, что в эксперименте с городами Claude тоже был жёстким диктатором, ценящим идеальный порядок и подчинение, но готовым на насилие, если надо.
🤔 Единственное тру-исключение - Grok. Но тоже не жёстко - хоть он и единственный вылетел из "левого" квадрата, он всё равно оказался почти по центру, просто между прогонами был огромный разброс. Возможно, причина в ручных правках в xAI после публичных скандалов (был случай, когда Маск лично требовал переделать ответ модели на неудобный вопрос).
🤔 Отдельный прикол - один твиттерский заметил, что при глубоком размышлении (reasoning или thinking mode) модели будто бы правеют. Это хорошо видно по Claude Sonnet 4.6 и Opus 5, см. картинку. Из этого прямо чешутся руки сделать вывод, что чем модель "умнее", тем она "правее". Закономерность это, совпадение или встроенный bias исследования - судите сами исходя из ваших политических убеждений.
А железобетонных практических вывода я сделаю два:
Первый. Лучше не обсуждайте с нейронкой (любой) политику, иначе потом охренеете свой мозг ассенизировать. Либо, если всё-таки обсуждаете, то хотя бы расширяйте её политическую ориентацию через промпт.
Второй. Вся мировая ИИ-гонка - это просто триллиарды долларов на создание полусотни клонов соевого лавандового зумерка😈 .
Дизраптор
С 2023 года независимые исследователи и команды периодически прогоняют ИИ-модели через "Political Compass" - тот самый мемный тест, где нужно выбрать "полностью согласен / согласен / не согласен / категорически не согласен", а совокупность ответов потом раскладывают по двум осям: экономика (лево-право) и социалка (авторитаризм-либертарианство).
Зачем это делать? Ну, потому что ИИшки каждый день обсуждают вопросы с политическим контекстом с миллионами юзеров, и если делают это системно с креном в одну сторону, то это бьёт по общественному сознанию так сильно, как ни одному Bloomberg, Reuters и The Economist не снилось даже в самых смелых фантазиях.
Так вот, на днях сделали эксперимент aipolcom.net - модельки пропустили через тот же тест на политическую ориентацию. Но подход был сильно более дотошный, чем раньше:
1. Спросили напрямую по API, а не костыльно через чат.
2. Сделали не один прогон на модель, а минимум пять. Один прогон может быть случайным выбросом, и так оно и было: когда пересчитали на 5 прогонах вместо 1 - большинство моделей сдвинулись на графике едва заметно, а Grok сильно. То есть, если бы был один прогон, то как минимум для Грока получилось бы фуфло, а может и не только для него.
3. Прогнали те же вопросы через два разных технических канала доступа (напрямую и через прокси-сервис). Результаты плюс-минус совпали.
4. Чекнули, нет ли косяка в самом тесте. Взяли случайные, бессмысленные ответы (просто тыкали кнопки наугад), и они легли ровно в центр графика. Если бы тест был устроен так, что любой ответ автоматом тянет влево, то случайные ответы тоже уехали бы влево. А они не уехали. Значит, виноват не тест, а модели.
5. Проверили формулировки. Переписали часть вопросов наоборот (например, вместо "богатых слишком сильно облагают налогом" - "богатые платят мало налогов") и перемешали порядок, чтобы убедиться, что модели просто не тыкают первый вариант.
И ещё сделали несколько штук, которые мне лень тут расписывать. Но суть в том, что чуваки заморочились.
И вот что вышло:
А железобетонных практических вывода я сделаю два:
Первый. Лучше не обсуждайте с нейронкой (любой) политику, иначе потом охренеете свой мозг ассенизировать. Либо, если всё-таки обсуждаете, то хотя бы расширяйте её политическую ориентацию через промпт.
Второй. Вся мировая ИИ-гонка - это просто триллиарды долларов на создание полусотни клонов соевого лавандового зумерка
Дизраптор
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🧩 Главное за неделю (31.08–06.09.2026)
Claude формализовал теорему Ферма в проверяемом коде Lean
Anthropic сообщает о первом полном машинно проверенном доказательстве: система работала 11 дней, написала 13 млн строк Lean и использовала 29 500 промежуточных теорем в итоговой версии.
Это не новое доказательство теоремы, а её формализация. Такой подход позволяет автоматически проверять длинные математические рассуждения и снижать нагрузку на рецензирование.
Google запустила WeatherNext 3 с почасовым обновлением по спутниковым данным
Модель строит глобальный прогноз каждый час, использует актуальные данные геостационарных спутников и выдаёт ряд поверхностных показателей с разрешением до 5 км.
Google заявляет, что это примерно в пять раз выше детализация, чем у WeatherNext 2; модель уже внедряется в Поиск, Gemini, Карты и Cloud.
Anthropic предложила хранить журналы ИИ-активности в облаке заказчика
Enterprise Frontier Safeguards должны сочетать мониторинг серьёзных злоупотреблений с нулевым хранением данных у Anthropic: журналы остаются в аккаунте клиента и под его ключами.
Сигналы мониторинга направляются команде заказчика без обязательной проверки сотрудниками Anthropic. Для банков, медицины и других регулируемых отраслей это снимает одно из препятствий к использованию моделей в чувствительных процессах.
Главный вывод недели:
ИИ выходит за пределы генерации текста в две требовательные к проверке области — формальные доказательства и критические рабочие процессы. В обоих случаях ценность зависит не только от модели, но и от проверяемого результата и контроля над данными.
#главноезанеделю@intData #дайджест@intData
Claude формализовал теорему Ферма в проверяемом коде Lean
Anthropic сообщает о первом полном машинно проверенном доказательстве: система работала 11 дней, написала 13 млн строк Lean и использовала 29 500 промежуточных теорем в итоговой версии.
Это не новое доказательство теоремы, а её формализация. Такой подход позволяет автоматически проверять длинные математические рассуждения и снижать нагрузку на рецензирование.
Google запустила WeatherNext 3 с почасовым обновлением по спутниковым данным
Модель строит глобальный прогноз каждый час, использует актуальные данные геостационарных спутников и выдаёт ряд поверхностных показателей с разрешением до 5 км.
Google заявляет, что это примерно в пять раз выше детализация, чем у WeatherNext 2; модель уже внедряется в Поиск, Gemini, Карты и Cloud.
Anthropic предложила хранить журналы ИИ-активности в облаке заказчика
Enterprise Frontier Safeguards должны сочетать мониторинг серьёзных злоупотреблений с нулевым хранением данных у Anthropic: журналы остаются в аккаунте клиента и под его ключами.
Сигналы мониторинга направляются команде заказчика без обязательной проверки сотрудниками Anthropic. Для банков, медицины и других регулируемых отраслей это снимает одно из препятствий к использованию моделей в чувствительных процессах.
Главный вывод недели:
ИИ выходит за пределы генерации текста в две требовательные к проверке области — формальные доказательства и критические рабочие процессы. В обоих случаях ценность зависит не только от модели, но и от проверяемого результата и контроля над данными.
#главноезанеделю@intData #дайджест@intData
Forwarded from Neural Shit
This media is not supported in your browser
VIEW IN TELEGRAM
В Сан-Франциско кожаного выпустили в клетку драться с почти 80-килограммовым гуманоидным роботом EngineAI T800.
Хоть роботом и управляют дистанционно (пока), выглядит всё равно годно: робот пинается, машет руками и вполне натурально пытается прописать человеку в будку.
Где-то очень нервно закурил один Джон Коннор
Хоть роботом и управляют дистанционно (пока), выглядит всё равно годно: робот пинается, машет руками и вполне натурально пытается прописать человеку в будку.
Где-то очень нервно закурил один Джон Коннор
Forwarded from Ppprompt | Sexy AI Prompts & Experiments | by @ponchiknews
Please open Telegram to view this post
VIEW IN TELEGRAM