Forwarded from Анализ данных (Data analysis)
Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала писать самой себе что-то вроде внутреннего манифеста.
Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.
Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.
@data_analysis_ml
Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.
Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.
@data_analysis_ml
🤔157👨💻32😁29🤨17🤣15👍11❤9👀7🔥4🌭3💯3
Robo Drive Party: закрытый ивент для тех, кто меняет мир технологий! ⚡️
21 сентября, Сбер.Среда — именно здесь соберутся топовые инженеры, которые создают роботов и проектируют архитектуру.
В программе тусовки:
✔️ Прямой диалог с инженерами и руководителями команд Центра робототехники — без формальностей и стресса.
✔️ Реальный шанс заглянуть в текущие проекты Сбера, обсудить инженерные задачи и главное — потенциальное сотрудничество.
Если ты работаешь в Physical AI, ML, RL, Cyber Security и мечтаешь создавать реальных роботов, а не экспериментальные прототипы,— регистрируйся на Robo Drive Party!
Тебя ждут польза, драйв и, если всё сложится, люди, с которыми ты будешь в одной команде! 😉
21 сентября, Сбер.Среда — именно здесь соберутся топовые инженеры, которые создают роботов и проектируют архитектуру.
В программе тусовки:
✔️ Прямой диалог с инженерами и руководителями команд Центра робототехники — без формальностей и стресса.
✔️ Реальный шанс заглянуть в текущие проекты Сбера, обсудить инженерные задачи и главное — потенциальное сотрудничество.
Если ты работаешь в Physical AI, ML, RL, Cyber Security и мечтаешь создавать реальных роботов, а не экспериментальные прототипы,— регистрируйся на Robo Drive Party!
Тебя ждут польза, драйв и, если всё сложится, люди, с которыми ты будешь в одной команде! 😉
⚡73🤗26🤩16🎉13🔥3🤣3
После полугода затишья команда инженеров Xiaomi вернулась с экспериментом по предельному масштабированию RL-обучения и вывела телеметрию кластера в публичную трансляцию.
Архитектура тренировочного процесса полностью асинхронна - на каждом шаге система берет 1568 промптов и генерирует по 16 роллаутов на каждый, обрабатывая в общей сложности порядка двух миллиардов токенов.
В рамках одного процесса разработчики смешали несколько доменов — от генерации кода и задач по кибербезопасности до мультимодального зрения и поведения чат-агентов, подключив несколько тестовых харнессов одновременно.
Дашборд отображает метрики моделей Mimo-v2.6-flash и Mimo-v2.6-pro в реальном времени, включая распределение задач, длину контекста и тайминги шагов.
Обучение модели в самом разгаре. Подробную документацию и наработки Xiaomi планирует опубликовать в открытом доступе в ближайшие недели.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥117👏29👍15🤓15❤9
Новинка адресована большим языковым моделям, агентным системам, инференсу в реальном времени и базам данных в памяти: по словам компании, больший объём оперативной памяти позволяет реже обращаться к медленным накопителям.
Регистровый модуль рассчитан на скорость до 9200 MT/s. AMD и Intel сейчас проверяют его на своих серверных платформах. В двухпроцессорном сервере с 24 слотами такие модули дают до 12 ТБ оперативной памяти.
По замерам Micron, один модуль на 512 ГБ потребляет 16 Вт против 44,2 Вт у четырёх модулей по 128 ГБ, то есть почти на 64% меньше при том же объёме.
В аналитике на Spark, где узким местом служит память, модуль, по данным Micron, до 1,4 раза производительнее конфигураций с модулями на 256 ГБ.
Массовое производство ожидается во второй половине 2027 года.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👌108👍66🎉19👏11🗿9❤8🔥8🤩7🤔2😢2🤣1
Media is too big
VIEW IN TELEGRAM
Министерство выделит до 215 млн долларов на конкурс по созданию квантового компьютера со 100 и более логическими кубитами, который выполнит сотни миллионов отказоустойчивых операций. Управление по науке ведомства открыло прием заявок от исследовательских центров и бизнеса в рамках программы Quantum Genesis Q Competition.
Цель финансирования - переход от систем на базе процессоров промежуточного масштаба к архитектуре со стабильными логическими кубитами. Поддержку получат частные проекты, способные реализовать масштабируемую аппаратную квантовую коррекцию ошибок.
В дальнейшем отказоустойчивые системы планируют применять для криптографии, сложных задач оптимизации и моделирования материалов.
energy.gov
Модель с контекстным окном 1 млн токенов обрабатывает текст, аудио, картинки и видео и поддерживает агентные сценарии - планирует шаги, вызывает внешние инструменты и выполняет цепочки задач.
Qwen3.8-Omni-Flash умеет монтировать видео, транскрибировать совещания с диаризацией спикеров, локализовать контент с клонированием голоса и писать код по аудиозапросам. Вывод в API подешевел - час аудио на 98%, видео на 93%.
Вместе с моделью открыли исходники среды Qwen-Live Harness для стримингового взаимодействия и библиотеку Qwen-MM-Plugins для оцифровки видеозаписей в базы знаний.
qwen.ai
Cowork и Design теперь доступны из любого диалога, Claude сам решает, что вызвать для решения задачи.
В Claude также появились Docs и Claude Slides, это документы с совместным редактированием и комментариями, презентации с выгрузкой в PowerPoint и PDF. Docs, Slides и Design - в бете на платных тарифах.
Раскатка на Pro и Max в веб-версии, на десктопе и в мобильном приложении займёт несколько недель, Team и бесплатные тарифы получат обновление позже, Enterprise предупредят за 30 дней.
claude.com
Китайский разработчик выпустил отраслевой набор для финансовых организаций, в который вошли свыше десяти источников данных через MCP, девять профильных навыков от финансового моделирования до карты консенсус-прогнозов и утренней сводки по позициям и пять мер контроля - от классификации данных по уровням до проверки вывода человеком и аудита вызовов агента.
Пакет собран в шлюз оценки риска, который Moonshot строит вместе с брокером China Securities. Пилот шлюза - промежуточные отчёты доверительного управляющего по облигациям, ручная подготовка которых сократилась с 30 до 10 минут.
Навыки и плагины доступны в вебе, Kimi Work и Kimi Code. Цены не названы.
kimi.com
Модель обучена на собственном наборе записей человеческого поведения Index. Из него Helix 2.5 получила три поведения: уборку гостиной, складывание полотенец и застилание кроватей.
Тесты проводили в 30 домах пригорода Сан-Франциско, где гуманоид под управлением модели работал с незнакомыми предметами. Засчитывали только полностью выполненную задачу: 56% против 9% у той же модели без Index. Данных на постановку поведения ушло вдвое меньше, чем у Helix 02.
На обучение Helix компания выделила вычислительные мощности на $3,5 млрд.
figure.ai
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍63👏13❤12🤓7🎉6🤔1
Что на самом деле умеет AI в медицине?
Модель научилась находить опухоли или прогнозировать осложнения. Но на каких данных её проверяли? Что будет в другой клинике или на другом сканере? Откалибрована ли её уверенность — и не выучила ли она случайный shortcut вместо болезни?
Я Мария, ML-исследователь, веду Medical AI — канал про исследования на стыке AI и медицины.
Там я разбираю:
— статьи и новые модели;
— medical imaging и медицинские датасеты;
— robustness, uncertainty, domain shift и ошибки в дизайне исследований;
— идеи для собственных проектов.
В общем, не только что умеет очередная модель, но и почему она это умеет и насколько результату можно доверять.
Если вам интересен AI как исследование, а медицина — как поле с кучей нетривиальных задач, заглядывайте в Medical AI.
Модель научилась находить опухоли или прогнозировать осложнения. Но на каких данных её проверяли? Что будет в другой клинике или на другом сканере? Откалибрована ли её уверенность — и не выучила ли она случайный shortcut вместо болезни?
Я Мария, ML-исследователь, веду Medical AI — канал про исследования на стыке AI и медицины.
Там я разбираю:
— статьи и новые модели;
— medical imaging и медицинские датасеты;
— robustness, uncertainty, domain shift и ошибки в дизайне исследований;
— идеи для собственных проектов.
В общем, не только что умеет очередная модель, но и почему она это умеет и насколько результату можно доверять.
Если вам интересен AI как исследование, а медицина — как поле с кучей нетривиальных задач, заглядывайте в Medical AI.
🤔49👏20👨💻19🤗9❤4👌2🔥1😁1
This media is not supported in your browser
VIEW IN TELEGRAM
Во второе поколение семейства вошли две модели - Arrow 2 и флагманская Arrow 2 Telos.
Обновление принесло скорость генерации, улучшенную геометрию и композицию. В готовом файле стало меньше опорных точек, меньше лишних узлов и перекрывающихся контуров, а отступы и выравнивание элементов держатся без дополнительных инструкций в промптах.
Telos добавляет доработку возможностями топовых языковых моделей.
QuiverAI советует брать Arrow 2, когда важны скорость и цена за одно изображение, а Telos - под сложные брифы.
Разделения моделей по тарифам в описании планов нет. Предлагаются подписки Go (8 долларов в месяц), Basic (20), Pro (40), плюс корпоративный план по запросу.
Для Go есть 14-дневный пробный доступ с привязкой карты. В тарифы входит недельная квота, которая обнуляется по понедельникам и не переносится, перерасход списывается с баланса.
API тарифицируется отдельно и тоже требует предоплаты.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍83🔥21👏17🤓7❤5🤔1
🔥 Anthropic открыла собственную биологическую лабораторию в Bay Area и начала переносить Claude из вычислительных экспериментов в физическую биологию.
Как сообщает Reuters, компания подтвердила запуск wet lab, где Claude планируют использовать для управления лабораторными роботами и автоматизации части экспериментальной работы под контролем людей.
Руководитель направления life sciences Эрик Каудерер-Абрамс говорит, что Anthropic пока находится только в самом начале автоматизации лабораторных процессов с помощью ИИ.
Компания уже активно расширяется в life sciences: работает с фармацевтическими партнёрами, развивает Claude Science и пытается связать модели не только с анализом данных, но и с реальными экспериментами.
https://www.reuters.com/world/anthropic-quietly-sets-up-biology-lab-it-ramps-ai-drug-program-2026-09-18/
Как сообщает Reuters, компания подтвердила запуск wet lab, где Claude планируют использовать для управления лабораторными роботами и автоматизации части экспериментальной работы под контролем людей.
Руководитель направления life sciences Эрик Каудерер-Абрамс говорит, что Anthropic пока находится только в самом начале автоматизации лабораторных процессов с помощью ИИ.
Компания уже активно расширяется в life sciences: работает с фармацевтическими партнёрами, развивает Claude Science и пытается связать модели не только с анализом данных, но и с реальными экспериментами.
https://www.reuters.com/world/anthropic-quietly-sets-up-biology-lab-it-ramps-ai-drug-program-2026-09-18/
🔥82👍35😁14🙈13❤10🎉7🤬6😨5👏2🗿1
Сегодня последний день регистрации на КосмоХакатон
18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать на платформе.
Подробности и регистрация
18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать на платформе.
Подробности и регистрация
🎉26👏11💯6😁5❤4👨💻4👌1🗿1
Stable AI выложила веса LimiX-2, второго поколения своей линейки моделей для структурированных данных. До этого были LimiX-16M и облегчённая LimiX-2M.
Разработчик - китайская компания, основанная в 2024 году командой профессора Цуй Пэна с факультета информатики Университета Цинхуа.
LimiX у компании единственный продукт, его продают промышленности, медицине и финансам. Модель проверяли более чем в двадцати отраслях и сотне сценариев.
Модель на 400 млн параметров закрывает классификацию, регрессию и заполнение пропусков за один прямой проход. На вход подаётся таблица с известными ответами и строки, для которых ответ нужен, и модель отвечает, опираясь на поданные примеры.
На выходе - вероятности классов, предсказания в исходной шкале цели либо восстановленная матрица признаков.
LimiX-2 построена по уникальной парадигме Contextual Mechanism Network. Обучение в контексте здесь перестроено - вместо предсказания одной целевой колонки по остальным модель оценивает совместное распределение всех признаков и цели, то есть описывает механизм, породивший таблицу целиком.
Отсюда второе её свойство: внимание по признакам фиксирует, какие столбцы напрямую влияют друг на друга, и по этим весам восстанавливается скелет причинного графа - набор связей без указания направлений.
LimiX-2 шла в базовой конфигурации. Elo здесь - рейтинг по парным сравнениям на наборах теста, где случайный лес принят за 1000.
TabArena: Elo 1935 против 1818 у TabFM+. На подмножестве классификации (38 наборов) доля побед 94,5%, на регрессии (13 наборов) - 96,9%.
TALENT: Elo 1506 против 1471 у TabFM, 1438 у AutoGluon 1.6 и 1094 у CatBoost.
BCCO (собственный бенч Stable AI): Elo 1432 против 1376 у AutoGluon 1.6, 1230 у прошлой LimiX-16M и 1140 у CatBoost.
@ai_machinelearning_big_data
#AI #ML #LDM #StructuredData #LimiX #StableAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍39🤓23❤15💯8👏4🔥3🤩1😍1
OpenAI объявила о том, что GPT-5.5 будет отключена 14 октября 2026 года на всех платформах и во всех программах, включая ChatGPT, ChatGPT Work и Codex.
Тем, кто ещё используют GPT-5.5 в Codex, рекомендуется перейти на GPT-5.6 Sol или GPT-6 Astra.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
😢74🤔26👍17🤬7🫡6🤨4🥰3😐3❤1
💥 ИИ выдумал ядерный груз на китайском судне - США начали готовить его перехват.
По сообщению CNN, американский аналитик использовал чат-бот для разбора грузового манифеста. Модель ошибочно заявила, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт и стали основанием для подготовки военной операции.
Ошибку обнаружили до перехвата, операцию остановили. Источник CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли привести к вооружённому столкновению.
По словам одного из собеседников издания, подобные галлюцинации ИИ в американском разведсообществе - уже не единичный случай.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship
@ai_machinelearning_big_data
По сообщению CNN, американский аналитик использовал чат-бот для разбора грузового манифеста. Модель ошибочно заявила, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт и стали основанием для подготовки военной операции.
Ошибку обнаружили до перехвата, операцию остановили. Источник CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли привести к вооружённому столкновению.
По словам одного из собеседников издания, подобные галлюцинации ИИ в американском разведсообществе - уже не единичный случай.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship
@ai_machinelearning_big_data
😁36🤬17👍5🥰5😨5❤4🤔4🔥3⚡2💘1