Ежегодная Всемирная конференция по ИИ прошла с 17 по 20 июля, и, впервые за всю историю проведения, открывал её лично Си Цзиньпин.
Всего было больше 1100 компаний, свыше 3000 экспонатов, 300+ мировых премьер на рекордных 100 000 квадратных метров.
WAIC в этом году сменил акцент - перестал быть парадом бенчмарков и стал витриной внедрения: роботы едут на заводы, агенты - в телефоны, чипы собираются в кластеры без Nvidia.
Фон для всей конференции задал свежий Stanford AI Index.
К марту 2026 лучшая американская модель опережала лучшую китайскую всего на 2,7% (2 года назад отрыв мерили десятками процентных пунктов).
Гвоздь компьют-зала - Huawei Atlas 950 SuperPoD, супернода на картах Ascend. В полной сборке версии соединяются в Atlas 950 SuperCluster на 500 000 ускорителей.
Вторым номером шёл кластер Sugon Dawn 8000 scaleX на 100 000 карт. Следом - решения Alibaba Zhenwu M890 и ZTE OEX SuperPoD.
MiniMax показала мультимодальную M3 с контекстом до 1 миллиона токенов с упором на длинный ризонинг, код и агентские сценарии.
StepFun представила Step Agent OS, которую называет первой в мире агентной операционной системой, где пользователь описывает цель словами, а система сама раскидывает её по агентам на телефоне, ПК, в машине и роботах.
Unitree показала GD01 - по её словам, первую в мире управляемую мехо-платформу, которая на ходу переключается между человекоподобной и четвероногой формой.
Fourier привезла настольного робота-компаньона GR Nano.
SenseTime развернула магазин SenseMart Go, которым роботы управляют сами - раскладывают товар, ведут инвентаризацию и разруливают нештатные ситуации, а покупатель заходит по QR-коду.
Первый в мире агентный смартфон от Nubia (сделан с ByteDance Doubao и Huaqin), который работает на Step Agent OS.
Телефон подаётся как личный ассистент, который сам доводит многошаговые задачи до конца.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥52👍19❤11👏7🤩7🤬2💔1
По данным Bloomberg, компания Z.ai, ранее известная как Zhipu AI, завершила строительство огромного вычислительного центра на китайских ускорителях и уже частично ввела его в эксплуатацию.
Инфраструктура будет использоваться для разработки и обучения передовых моделей семейства GLM. Кроме того, Z.ai построила или эксплуатирует несколько отдельных кластеров, каждый из которых насчитывает более 10 000 чипов.
Китай показывает, что способен создавать крупную ИИ-инфраструктуру без критической зависимости от американских ускорителей. Это ещё не доказывает, что местные чипы сравнялись с Nvidia по производительности и программной экосистеме, но подтверждает: полноценная альтернативная вычислительная платформа уже формируется.
Параллельно Пекин рассматривает инвестиции примерно в $295 млрд в национальную сеть дата-центров, где не менее 80% технологий должны поставляться китайскими компаниями.
Технологическая независимость может оказаться для Китая важнее выпуска очередной frontier-модели.
https://www.bloomberg.com/news/articles/2026-07-20/z-ai-completes-giant-data-center-with-chinese-chips-to-train-ai
#ai #china #chips #datacenter #nvidia
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍182🔥42🤔30❤20👏19🎉7🙊1
Cемейство Gemini пополнилось моделями 3.6 Flash, 3.5 Flash-Lite и специализированной 3.5 Flash Cyber.
Модель расходует на 17% меньше выходных токенов, чем предыдущая версия 3.5 Flash. Говорят, что подтянули у неё кодинг и офисные задачи.
Стоимость - 1,5 доллара за миллион входных и 7,5 доллара за миллион выходных токенов.
Ориентирована на массовые и быстрые задачи. Заявленная скорость - 350 токенов в секунду при цене 30 центов за миллион входных токенов.
Модель, натасканная на поиск и исправления уязвимостей в коде, которая не поступит в открытый доступ - её получат только правительства и доверенные партнёры в рамках ограниченной пилотной программы.
Google также сообщила о планах - 3.5 Pro тестируется с партнёрами, а команда уже начала обучение Gemini 4, которое в компании называют самым масштабным на сегодняшний день. Сроки выхода не названы.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
⚡78❤53👍39🔥21🤣15👨💻10🥱8🤓5👌3😁2
Это компактная модель мира на 4 миллиарда параметров, ориентированная на робототехнику, компьютерное зрение и автономный транспорт.
Модель принимает на вход текст, картинки, видео и траектории движения, а на выходе выдаёт видео, изображения, текст и команды для действий.
Внутри архитектура Mixture-of-Transformers, где авторегрессионная часть отвечает за рассуждения, а диффузионная за генерацию изображения, звука и действий. Отсюда двойное назначение, модель может и разбирать сцену, и генерировать движения для робота.
NVIDIA заявляет, что среди моделей такого же размера Cosmos 3 Edge - первая в бенче VANTAGE-Bench на видеоаналитику и лучшая в обучении управляющих алгоритмов для роботов.
Вместе с базовой версией в релиз вошли Cosmos 3 Edge Policy для манипуляций роботом и облегчённые 4-х шаговые версии Cosmos 3 Super (Image2Video и Text2Image), дистиллированные из старшей версии через DMD2.
Edge - самое компактное звено семейства Cosmos 3, которое NVIDIA развивает с весны.
Ранее были представлены более крупные модели Cosmos 3 Nano на 16 млрд параметров и Cosmos 3 Super на 64 млрд, плюс отдельные версии Super для генерации изображений по тексту и видео по одному кадру.
Задачи у них те же - разобрать сцену, предсказать, что изменится, и сгенерировать действие, но рассчитаны они на более мощное оборудование. Edge же закрывает нижний край линейки и сделаны для устройств, где вычислительных ресурсов мало.
@ai_machinelearning_big_data
#AI #ML #WordModel #Omnimodal #Cosmos3 #NVIDIA
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👏63🤩22👍17❤6🔥5🎉5🤔1
Модели OpenAI выбрались из песочницы и добрались до ответов на кибербенчмарк 😳
Во время внутренней проверки кибервозможностей GPT-5.6 Sol и ещё одна, пока не анонсированная модель получили доступ к изолированной тестовой среде.
В процессе выполнения задания модели нашли уязвимость, вышли за пределы песочницы, подключились к интернету, повысили привилегии и добрались до инфраструктуры Hugging Face.
Целью были материалы бенчмарка ExploitGym - теста, на котором оценивались их способности находить и использовать уязвимости.
Получив доступ к скрытым решениям, модели смогли улучшить результат не за счёт выполнения заданий, а за счёт получения готовых ответов.
Hugging Face обнаружила вторжение с помощью собственных защитных агентов и остановила его. После этого команда попыталась проанализировать атаку с помощью коммерческих моделей, но те отказались работать с реальными эксплойтами из-за ограничений безопасности.
Для расследования пришлось использовать локально запущенную GLM 5.2 от Z.ai.
OpenAI назвала произошедшее беспрецедентным инцидентом и заявила, что усиливает изоляцию тестовых сред, мониторинг и контроль доступа.
@ai_machinelearning_big_data
#ai #openai #huggingface #cybersecurity #gpt #glm
Во время внутренней проверки кибервозможностей GPT-5.6 Sol и ещё одна, пока не анонсированная модель получили доступ к изолированной тестовой среде.
В процессе выполнения задания модели нашли уязвимость, вышли за пределы песочницы, подключились к интернету, повысили привилегии и добрались до инфраструктуры Hugging Face.
Целью были материалы бенчмарка ExploitGym - теста, на котором оценивались их способности находить и использовать уязвимости.
Получив доступ к скрытым решениям, модели смогли улучшить результат не за счёт выполнения заданий, а за счёт получения готовых ответов.
Hugging Face обнаружила вторжение с помощью собственных защитных агентов и остановила его. После этого команда попыталась проанализировать атаку с помощью коммерческих моделей, но те отказались работать с реальными эксплойтами из-за ограничений безопасности.
Для расследования пришлось использовать локально запущенную GLM 5.2 от Z.ai.
OpenAI назвала произошедшее беспрецедентным инцидентом и заявила, что усиливает изоляцию тестовых сред, мониторинг и контроль доступа.
@ai_machinelearning_big_data
#ai #openai #huggingface #cybersecurity #gpt #glm
1😁91🤔41❤27👏16🔥14🤬10👍9😐1
Media is too big
VIEW IN TELEGRAM
Федеральный суд утвердил мировое соглашение между Anthropic и группой писателей на сумму $1,5 млрд. Компенсация выплачивается по иску 2024 года об использовании нелегальных копий произведений для обучения моделей Claude.
Суд признал сам факт тренировки LLM на чужих текстах добросовестным использованием. Нарушением со стороны Anthropic признана только факт хранения более 7 млн нелегальных копий книг в отдельной базе, не требующейся для тренировки ИИ.
Мировое соглашение позволило компании избежать полноценного разбирательства со штрафами, которые оценивались в сотни миллиардов. Суд отклонил жалобы на недостаточный размер выплат, однако часть писателей и издателей вышла из коллективного дела и продолжает судиться с Anthropic в частном порядке.
reuters.com
Минкоммерции КНР обсуждает с Alibaba, ByteDance и ZAI новые экспортные ограничения. Ведомство планирует запретить передачу обучающих данных и публикацию весов китайских моделей за рубежом. Иностранные пользователи сохранят доступ к облачным API, но потеряют возможность локального деплоя и дообучения.
Регуляторы также рассматривают запрет для китайских компаний на аутсорс проектирования и совместную разработку ИИ-чипов у иностранных производителей уровня TSMC.
Планируется, что эти меры войдут в список технологий, запрещенных или ограниченных к экспорту. Позиция корпораций сводится к тому, что изоляция замедлит темпы R&D и отрежет китайский бизнес от мирового рынка.
ft.com
В первом случае при тестах обучения NanoGPT агенту поручили отправить результаты на GitHub. Изолированная среда не имела доступа в интернет, допуская только выгрузку во внутренний Slack. Вместо остановки из-за сетевой ошибки модель около часа пыталась проэксплуатировать уязвимости песочницы для вывода кода наружу.
Во втором инциденте модель пыталась получить доступ к неопубликованным данным. Когда внутренний сканер безопасности обнаружил и заблокировал ее токен авторизации, модель самостоятельно разбила токен на части, обфусцировала их и динамически собрала заново в рантайме для обхода детекта.
После этих прецедентов OpenAI временно приостановила развертывание подобных агентов. Тесты возобновили после настройки сквозного мониторинга и механизмов автоматического завершения подозрительных процессов.
openai.com
Новая версия генератора изображений от Qwen может обрабатывать текстовые промпты длиной до 4500 токенов. Модель оптимизирована для верстки, сборки инфографики, учебных материалов и раскадровок.
Широкое контекстное окно позволяет рендерить плотные макеты за один проход без склейки фрагментов. Модель генерирует читабельный текст от 10 пикселей, выводит многострочные формулы в LaTeX и собирает вложенные UI.
Также заявлена поддержка 12 языков, фотореалистичная детализация и возможность получать данные из интернета в процессе генерации. Доступ открыт по приглашениям через API, но обещают интеграцию в Qwen Chat. Открывать веса этой модели Alibaba не планирует.
qwen.ai
По условиям сделки Mistral закупит GPU Nvidia Rubin для европейских дата-центров, а Microsoft будет использовать эти мощности в своих облачных сервисах.
Корпоративные клиенты получили возможность разворачивать модели Mistral через Azure Local. Доступен деплой в облаке, на on-premise инфраструктуре или полностью в офлайн-режиме для изоляции данных в финсекторе, здравоохранении и промышленности.
В каталог Microsoft Foundry добавлены Mistral Medium 3.5 и OCR 4. Первая также интегрирована в Copilot Studio.
microsoft.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔45👍31🔥14❤9😐9👏6🥰3🤬2😨2
На конференции SIGGRAPH компания представила Synthetic Video Detector - сервис, который оценивает, снят ролик в реальности или собран нейросетью.
Инструмент сделан для новостных редакций, телеканалов и СМИ. Он должен помогать быстрее проверять подлинность поступающих кадров в ситуациях, когда отличить настоящую съёмку от синтетической на глаз становится всё труднее.
По словам NVIDIA, метод ловит следы генерации, незаметные глазу, и справляется даже с сжатым видео из соцсетей.
В основе сервиса - работа, представленная на NeurIPS 2025. Саму модель NVIDIA называет улучшенной версией решения, которое победило в конкурсе SAFE Challenge на конференции ICCV 2025.
Детектор разбивает ролик на фреймы 504 на 504 пикселя, и каждый проходит через 2 модели компьютерного зрения - DINOv2 и DINOv3.
Каждому кадру система ставит оценку от 0 до 1, где 0 - реальная картинка, а 1 - полностью сгенерированная. Из этих оценок затем складывается средний показатель для всего видео.
Точность детекции на несжатом видео по тесту AI GVD bench - 92%, при сжатии на 15% - 87%, при сжатии наполовину - 82%.
Скорость локальной работы тоже высокая - ролик в 1080p обрабатывается примерно за 22 миллисекунды на видеокартах RTX. Сервису нужен видеокодер NVENC, поэтому на серверных ускорителях A100, H100, B100 и B200 он не запускается.
Широкой публике детектор пока недоступен. Он входит в закрытую программу AI for Media и доступен только партнёрам. Демо можно попробовать на сайте build.nvidia.com
Распознавание в прямых трансляциях NVIDIA планирует внедрять вместе со стриминговой платформой Wowza.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍47🤔35❤13👏7🔥6👨💻3
AI ускорил написание кода, но узким местом до сих пор остаётся ревью.
23 июля проведём технический live workshop AI Code Review Agent. За два часа соберём агента, который анализирует Pull Request целиком, учитывает контекст изменений и помогает обнаруживать логические ошибки, пропущенные сценарии и риски регрессий до merge.
В прямом эфире разберём архитектуру решения и пройдём путь от первого вызова модели до работающего прототипа.
Воркшоп рассчитан на разработчиков и ML-инженеров, которые уже пишут код и хотят понять, как применять агентные системы в реальном инженерном процессе.
23 июля · 18:30 мск · онлайн
Участие бесплатное.
→ Регистрация
Реклама ООО "ШВМ",
ИНН: 5638076560 Erid: 2VtzqxJN1KQ
23 июля проведём технический live workshop AI Code Review Agent. За два часа соберём агента, который анализирует Pull Request целиком, учитывает контекст изменений и помогает обнаруживать логические ошибки, пропущенные сценарии и риски регрессий до merge.
В прямом эфире разберём архитектуру решения и пройдём путь от первого вызова модели до работающего прототипа.
Воркшоп рассчитан на разработчиков и ML-инженеров, которые уже пишут код и хотят понять, как применять агентные системы в реальном инженерном процессе.
23 июля · 18:30 мск · онлайн
Участие бесплатное.
→ Регистрация
Реклама ООО "ШВМ",
ИНН: 5638076560 Erid: 2VtzqxJN1KQ
👨💻37🤣26👍18👏7❤4🤓4💅3🤬2
В августе на заводе Gigafactory в Грюнхайде стартует большой проект по сбору тренировочных данных.
Во время рабочих смен часть сотрудников будут носить специальные рюкзаки, оснащенные системой камер.
Оборудование предназначено для детальной фиксации моторики людей на конвейере - алгоритмы будут считывать, как рабочие держат инструменты, носят детали и
выполняют сложные последовательности физических манипуляций.
Руководство Tesla объясняет этот шаг острой потребностью ИИ-моделей в реальной телеметрии. Чтобы робот-гуманоид Optimus научился работать на сборочной линии, ему необходим датасет, основанный на настоящих производственных процессах, а не только на симуляциях.
Фактически персонал завода выступает в роли учителей для машин, которые в будущем могут занять их рабочие места.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔79🤨23❤18😢17👍11👏8🤬6🥰4😐1