280K subscribers
5.46K photos
1.27K videos
17 files
5.8K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала писать самой себе что-то вроде внутреннего манифеста.

Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.

Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.

@data_analysis_ml
🤔157👨‍💻32😁29🤨17🤣15👍119👀7🔥4🌭3💯3
Robo Drive Party: закрытый ивент для тех, кто меняет мир технологий! ⚡️

21 сентября, Сбер.Среда — именно здесь соберутся топовые инженеры, которые создают роботов и проектируют архитектуру.

В программе тусовки:

✔️ Прямой диалог с инженерами и руководителями команд Центра робототехники — без формальностей и стресса.

✔️ Реальный шанс заглянуть в текущие проекты Сбера, обсудить инженерные задачи и главное — потенциальное сотрудничество.

Если ты работаешь в Physical AI, ML, RL, Cyber Security и мечтаешь создавать реальных роботов, а не экспериментальные прототипы,— регистрируйся на Robo Drive Party!

Тебя ждут польза, драйв и, если всё сложится, люди, с которыми ты будешь в одной команде! 😉
73🤗26🤩16🎉13🔥3🤣3
📌 Xiaomi стримит процесс RL-обучения моделей MiMo-V2.6

После полугода затишья команда инженеров Xiaomi вернулась с экспериментом по предельному масштабированию RL-обучения и вывела телеметрию кластера в публичную трансляцию.

Архитектура тренировочного процесса полностью асинхронна - на каждом шаге система берет 1568 промптов и генерирует по 16 роллаутов на каждый, обрабатывая в общей сложности порядка двух миллиардов токенов.

В рамках одного процесса разработчики смешали несколько доменов — от генерации кода и задач по кибербезопасности до мультимодального зрения и поведения чат-агентов, подключив несколько тестовых харнессов одновременно.

Дашборд отображает метрики моделей Mimo-v2.6-flash и Mimo-v2.6-pro в реальном времени, включая распределение задач, длину контекста и тайминги шагов.

Обучение модели в самом разгаре. Подробную документацию и наработки Xiaomi планирует опубликовать в открытом доступе в ближайшие недели.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥117👏29👍15🤓159
Please open Telegram to view this post
VIEW IN TELEGRAM
👍18🔥95🤣5🙉3🗿1
✔️ Micron показала серверный модуль DDR5 на 512 ГБ

Новинка адресована большим языковым моделям, агентным системам, инференсу в реальном времени и базам данных в памяти: по словам компании, больший объём оперативной памяти позволяет реже обращаться к медленным накопителям.

Регистровый модуль рассчитан на скорость до 9200 MT/s. AMD и Intel сейчас проверяют его на своих серверных платформах. В двухпроцессорном сервере с 24 слотами такие модули дают до 12 ТБ оперативной памяти.

По замерам Micron, один модуль на 512 ГБ потребляет 16 Вт против 44,2 Вт у четырёх модулей по 128 ГБ, то есть почти на 64% меньше при том же объёме.

В аналитике на Spark, где узким местом служит память, модуль, по данным Micron, до 1,4 раза производительнее конфигураций с модулями на 256 ГБ.

Массовое производство ожидается во второй половине 2027 года.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👌108👍66🎉19👏11🗿98🔥8🤩7🤔2😢2🤣1
Media is too big
VIEW IN TELEGRAM
✔️ Минэнерго США профинансирует разработку систем квантовой коррекции ошибок

Министерство выделит до 215 млн долларов на конкурс по созданию квантового компьютера со 100 и более логическими кубитами, который выполнит сотни миллионов отказоустойчивых операций. Управление по науке ведомства открыло прием заявок от исследовательских центров и бизнеса в рамках программы Quantum Genesis Q Competition.

Цель финансирования - переход от систем на базе процессоров промежуточного масштаба к архитектуре со стабильными логическими кубитами. Поддержку получат частные проекты, способные реализовать масштабируемую аппаратную квантовую коррекцию ошибок.

В дальнейшем отказоустойчивые системы планируют применять для криптографии, сложных задач оптимизации и моделирования материалов.
energy.gov

✔️ Alibaba выпустила Qwen3.8-Omni-Flash

Модель с контекстным окном 1 млн токенов обрабатывает текст, аудио, картинки и видео и поддерживает агентные сценарии - планирует шаги, вызывает внешние инструменты и выполняет цепочки задач.

Qwen3.8-Omni-Flash умеет монтировать видео, транскрибировать совещания с диаризацией спикеров, локализовать контент с клонированием голоса и писать код по аудиозапросам. Вывод в API подешевел - час аудио на 98%, видео на 93%.

Вместе с моделью открыли исходники среды Qwen-Live Harness для стримингового взаимодействия и библиотеку Qwen-MM-Plugins для оцифровки видеозаписей в базы знаний.
qwen.ai

✔️ Anthropic объединила чат Claude и Cowork в одно пространство

Cowork и Design теперь доступны из любого диалога, Claude сам решает, что вызвать для решения задачи.

В Claude также появились Docs и Claude Slides, это документы с совместным редактированием и комментариями, презентации с выгрузкой в PowerPoint и PDF. Docs, Slides и Design - в бете на платных тарифах.

Раскатка на Pro и Max в веб-версии, на десктопе и в мобильном приложении займёт несколько недель, Team и бесплатные тарифы получат обновление позже, Enterprise предупредят за 30 дней.
claude.com

✔️ Moonshot собрала для Kimi финансовый пакет

Китайский разработчик выпустил отраслевой набор для финансовых организаций, в который вошли свыше десяти источников данных через MCP, девять профильных навыков от финансового моделирования до карты консенсус-прогнозов и утренней сводки по позициям и пять мер контроля - от классификации данных по уровням до проверки вывода человеком и аудита вызовов агента.

Пакет собран в шлюз оценки риска, который Moonshot строит вместе с брокером China Securities. Пилот шлюза - промежуточные отчёты доверительного управляющего по облигациям, ручная подготовка которых сократилась с 30 до 10 минут.

Навыки и плагины доступны в вебе, Kimi Work и Kimi Code. Цены не названы.
kimi.com

✔️ Figure показала Helix 2.5

Модель обучена на собственном наборе записей человеческого поведения Index. Из него Helix 2.5 получила три поведения: уборку гостиной, складывание полотенец и застилание кроватей.

Тесты проводили в 30 домах пригорода Сан-Франциско, где гуманоид под управлением модели работал с незнакомыми предметами. Засчитывали только полностью выполненную задачу: 56% против 9% у той же модели без Index. Данных на постановку поведения ушло вдвое меньше, чем у Helix 02.

На обучение Helix компания выделила вычислительные мощности на $3,5 млрд.
figure.ai


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍63👏1312🤓7🎉6🤔1
Что на самом деле умеет AI в медицине?
Модель научилась находить опухоли или прогнозировать осложнения. Но на каких данных её проверяли? Что будет в другой клинике или на другом сканере? Откалибрована ли её уверенность — и не выучила ли она случайный shortcut вместо болезни?
Я Мария, ML-исследователь, веду Medical AI — канал про исследования на стыке AI и медицины.
Там я разбираю:
— статьи и новые модели;
— medical imaging и медицинские датасеты;
— robustness, uncertainty, domain shift и ошибки в дизайне исследований;
— идеи для собственных проектов.
В общем, не только что умеет очередная модель, но и почему она это умеет и насколько результату можно доверять.
Если вам интересен AI как исследование, а медицина — как поле с кучей нетривиальных задач, заглядывайте в Medical AI.
🤔49👏20👨‍💻19🤗94👌2🔥1😁1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ QuiverAI выпустила обновление генератора векторной графики

Во второе поколение семейства вошли две модели - Arrow 2 и флагманская Arrow 2 Telos.

Обновление принесло скорость генерации, улучшенную геометрию и композицию. В готовом файле стало меньше опорных точек, меньше лишних узлов и перекрывающихся контуров, а отступы и выравнивание элементов держатся без дополнительных инструкций в промптах.

🟡Сценарии применения

🟢серии иллюстраций в одном стиле по образцу с сохранением палитры и пластики форм;

🟢схемы с выделением нужных элементов;

🟢технические чертежи с удержанием консистентности;

🟢векторизация растровых эскизов в редактируемый SVG;

🟢анимация интерфейсной моторики и плоская структурированная графика (раскрытие логотипов, состояния загрузки, анимированные иконки).

Telos добавляет доработку возможностями топовых языковых моделей.

QuiverAI советует брать Arrow 2, когда важны скорость и цена за одно изображение, а Telos - под сложные брифы.


🟡Стоимость

Разделения моделей по тарифам в описании планов нет. Предлагаются подписки Go (8 долларов в месяц), Basic (20), Pro (40), плюс корпоративный план по запросу.

Для Go есть 14-дневный пробный доступ с привязкой карты. В тарифы входит недельная квота, которая обнуляется по понедельникам и не переносится, перерасход списывается с баланса.

API тарифицируется отдельно и тоже требует предоплаты.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍83🔥21👏17🤓75🤔1
🔥 Anthropic открыла собственную биологическую лабораторию в Bay Area и начала переносить Claude из вычислительных экспериментов в физическую биологию.

Как сообщает Reuters, компания подтвердила запуск wet lab, где Claude планируют использовать для управления лабораторными роботами и автоматизации части экспериментальной работы под контролем людей.

Руководитель направления life sciences Эрик Каудерер-Абрамс говорит, что Anthropic пока находится только в самом начале автоматизации лабораторных процессов с помощью ИИ.

Компания уже активно расширяется в life sciences: работает с фармацевтическими партнёрами, развивает Claude Science и пытается связать модели не только с анализом данных, но и с реальными экспериментами.

https://www.reuters.com/world/anthropic-quietly-sets-up-biology-lab-it-ramps-ai-drug-program-2026-09-18/
🔥82👍35😁14🙈1310🎉7🤬6😨5👏2🗿1
Сегодня последний день регистрации на КосмоХакатон

18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.

Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.

Команду можно собрать на платформе.

Подробности и регистрация
🎉26👏11💯6😁54👨‍💻4👌1🗿1
🌟 LimiX-2: базовая модель для табличных данных

Stable AI выложила веса LimiX-2, второго поколения своей линейки моделей для структурированных данных. До этого были LimiX-16M и облегчённая LimiX-2M.

Разработчик - китайская компания, основанная в 2024 году командой профессора Цуй Пэна с факультета информатики Университета Цинхуа.

LimiX у компании единственный продукт, его продают промышленности, медицине и финансам. Модель проверяли более чем в двадцати отраслях и сотне сценариев.


Модель на 400 млн параметров закрывает классификацию, регрессию и заполнение пропусков за один прямой проход. На вход подаётся таблица с известными ответами и строки, для которых ответ нужен, и модель отвечает, опираясь на поданные примеры.

На выходе - вероятности классов, предсказания в исходной шкале цели либо восстановленная матрица признаков.

LimiX-2 построена по уникальной парадигме Contextual Mechanism Network. Обучение в контексте здесь перестроено - вместо предсказания одной целевой колонки по остальным модель оценивает совместное распределение всех признаков и цели, то есть описывает механизм, породивший таблицу целиком.

Отсюда второе её свойство: внимание по признакам фиксирует, какие столбцы напрямую влияют друг на друга, и по этим весам восстанавливается скелет причинного графа - набор связей без указания направлений.

🟡Бенчмарки

LimiX-2 шла в базовой конфигурации. Elo здесь - рейтинг по парным сравнениям на наборах теста, где случайный лес принят за 1000.


TabArena: Elo 1935 против 1818 у TabFM+. На подмножестве классификации (38 наборов) доля побед 94,5%, на регрессии (13 наборов) - 96,9%.

TALENT: Elo 1506 против 1471 у TabFM, 1438 у AutoGluon 1.6 и 1094 у CatBoost.

BCCO (собственный бенч Stable AI): Elo 1432 против 1376 у AutoGluon 1.6, 1230 у прошлой LimiX-16M и 1140 у CatBoost.


📌Лицензирование: исследования, обучение, замеры и некоммерческие соревнования - бесплатно, всё остальное - только по отдельному договору со Stable AI.


🟡Страница проекта
🟡Веса
🟡Arxiv
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #LDM #StructuredData #LimiX #StableAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍39🤓2315💯8👏4🔥3🤩1😍1
✔️ GPT-5.5 будет отключена 14 октября

OpenAI объявила о том, что GPT-5.5 будет отключена 14 октября 2026 года на всех платформах и во всех программах, включая ChatGPT, ChatGPT Work и Codex.

Тем, кто ещё используют GPT-5.5 в Codex, рекомендуется перейти на GPT-5.6 Sol или GPT-6 Astra.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
😢74🤔26👍17🤬7🫡6🤨4🥰3😐31
💥 ИИ выдумал ядерный груз на китайском судне - США начали готовить его перехват.

По сообщению CNN, американский аналитик использовал чат-бот для разбора грузового манифеста. Модель ошибочно заявила, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт и стали основанием для подготовки военной операции.

Ошибку обнаружили до перехвата, операцию остановили. Источник CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли привести к вооружённому столкновению.

По словам одного из собеседников издания, подобные галлюцинации ИИ в американском разведсообществе - уже не единичный случай.

https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship

@ai_machinelearning_big_data
😁36🤬17👍5🥰5😨54🤔4🔥32💘1