288K subscribers
5.25K photos
1.21K videos
17 files
5.6K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
⚡️ Qwen представила Qwen3.8-Max - модель на 2,4 трлн параметров для автономной разработки и рабочих агентов

По заявлению команды, модель способна вести длинные проекты почти без вмешательства человека: планировать работу, писать код, запускать инструменты, анализировать результат и исправлять ошибки по обратной связи.

Пример - oh-my-cli. Агент начал с пустой папки и развивал проект больше десяти дней, оставив полный журнал изменений в открытом GitHub-репозитории.

Qwen также заявляет о сотнях последовательных итераций при оптимизации чипов, долгосрочном планировании бизнес-стратегий и нативной работе с изображениями. Визуальные данные используются внутри цикла «планирование - выполнение - проверка», а не только как входной контекст.

Цена API:

- ввод - $2 за 1 млн токенов;
- вывод - $6;
- закешированный ввод - $0,25.

На следующей неделе компания обещает открыть веса Qwen3.8-Max и более компактной Qwen3.8-27B.

Если заявленные возможности подтвердятся на независимых тестах, Qwen получит редкую комбинацию: огромную агентную модель, мультимодальность и открытые веса.

Блог:
https://qwen.ai/blog?id=qwen3.8

Qwen Studio:
https://chat.qwen.ai/?models=qwen3.8-max

API:
https://qwencloud.com/models/qwen3.8-max

Автономный проект:
https://github.com/qwen-code-dev-bot/oh-my-cli

@ai_machinelearning_big_data

#qwen
🔥11641👍2816🤔16👏6🎉2😁1🤝1
✔️Компании переходят от экспериментов с GenAI к промышленному внедрению

Генеративный ИИ перестал быть исключительно инструментом для прототипов. Все больше компаний интегрируют LLM в разработку, аналитику и внутренние бизнес-процессы. Одновременно растет вопрос: какие направления действительно изменят индустрию, а какие окажутся очередной волной хайпа.

Эти вопросы на ИТ-Пикнике, который пройдет уже в субботу, обсудят руководители AI-направлений крупнейших российских технологических компаний — специалисты, которые сегодня отвечают за развитие и внедрение генеративного ИИ в реальные продукты.

✔️Артём Бондарь, руководитель направления обработки естественного языка Т-Банка, разберет экономику GenAI, противостояние между сторонниками и скептиками LLM, а также критерии, по которым уже сегодня можно оценить перспективность AI-проектов и технологий.

✔️Роман Халкечев, CDO Яндекс Поиска и AI, расскажет, как AI меняет аналитику, процесс принятия решений и требования к специалистам по работе с данными.

✔️Антон Логинов, руководитель направления AI-агентов Т-Банка, расскажет, о том, как ИИ-сотрудники обучались всем тонкостям клиентской поддержки и как удалось масштабировать AI-напарников на более широкие домены.

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍97🔥30🤔2221👏12🤣7💯5💅2
📌 ИИ-агент Tencent помог решить комбинаторную задачу полувековой давности.

Исследовательский агент Hyra на базе открытой модели Hy3, помог ученым разгадать математическую проблему, которая оставалась нерешенной более 50 лет.

Задача из области комбинаторной математики касалась того, насколько размер множества сумм целых чисел может превышать размер его множества разностей.

Научное сообщество давно доказало, что соответствующий показатель степени не превышает двух, но оставалось неизвестным, является ли эта верхняя граница оптимальной.


Агент использовал модель Hy3 для поиска специфических множеств и вывода общей конструкции. За 24 часа вычислений ИИ нашел ядро решения, которое в итоге легло в основу научного открытия. Ученым оставалось лишь проверить логику, внести корректировки и структурировать доказательство.

Для финальной верификации результата использовали GPT-5.6 Sol, которая помогла корректно перевести расчеты на язык Lean 4.

Итоговая статья подтвердила, что искомый показатель действительно может бесконечно приближаться к 2, делая эту границу оптимальным ответом.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤓96👍2722👏20🎉13💯7🔥5😁1
⚡️ Alibaba в презентации Qwen3.8 открыто троллит США и бросает им вызов?

В проморолике модель часами работает над проектированием чипов, а затем переходит к задачам из биологии.

Выбор выглядит намеренным: полупроводники остаются одним из самых болезненных направлений для Китая, а США продолжают ограничивать поставки передовых ускорителей и оборудования для их производства.

Китай намерен закрывать критические технологические пробелы собственными моделями, вычислительной инфраструктурой и чипами.

Сцены с белками можно воспринимать как намёк на AlphaFold и амбицию конкурировать с американскими компаниями уже на уровне научных открытий.

@ai_machinelearning_big_data

#qwen
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍129🤔55🔥29🤬1713🤨7🎉4🥰2😁1
This media is not supported in your browser
VIEW IN TELEGRAM
В интерфейсе Yandex AI Studio появился инструмент для анализа поведения ИИ-агентов с Monium Traces

Трейсы — ключевой сигнал для observability агентных систем, который позволяет посмотреть весь путь выполнения агента и разобраться, почему он принял то или иное решение.

В отличие от обычных приложений, для ИИ-агентов классического мониторинга уже недостаточно. Даже если инфраструктура работает без ошибок, агент может потерять контекст, выбрать неподходящий инструмент или уйти в бесконечный цикл. Стандартные метрики этого не покажут.

Используя трейсы для мониторинга ИИ-агентов вы сможете:

• увидеть полную цепочку работы агента в виде трейса;
• видеть контекст каждого шага — системные и пользовательские промпты, ответы модели и вызовы инструментов;
• быстро отслеживать момент, на котором агент начал работать некорректно.

Обновление уже доступно — тестируйте Monium Traces в AI Studio!
🤣38👍27🔥109😁2
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Qwen 3.8 Max обошла Fable 5 в жёстком тесте на генерацию 3D-физики и стоила почти в 7 раз дешевле

Команда Atomic Chat дала обеим моделям одинаковое задание: создать три автономных HTML-файла с интерактивными сценами.

В первой мраморные шарики поднимаются на колесо и проходят петлю. Во второй работает автомобильный конвейер. В третьей лесопилка превращает брёвна в доски.

Модель должна сохранять состояние объектов, рассчитывать столкновения, соблюдать геометрию механизмов и синхронизировать всю сцену во времени.

Результаты:


• Qwen 3.8 Max сгенерировала 46,6 тысячи токенов за $0,28.

• Fable 5 использовала 38,7 тысячи токенов за $1,93.

Qwen потратила больше токенов, но запуск обошёлся примерно в 6,9 раза дешевле. По оценке авторов теста, её физические сцены также получились качественнее и стабильнее.

https://x.com/atomic_chat_hq/status/2084231644597162201

@ai_machinelearning_big_data

#qwen
107👍54🔥30🤔5😁2
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Андрей Карпати предложил новый бенчмарк для ИИ

Он использовал модель Opus 5, чтобы превратить абзац из книги "Властелин колец" в 5500 строк кода браузерной графической библиотеки Three.js.

Генерация сцены заняла около 2-х часов, потребовала миллион токенов и обошлась примерно в 10 долларов. Звук был сгенерирован через ElevenLabs.

По мнению Карпати, привычные тесты на пространственное мышление вроде рисования пеликана на велосипеде в SVG окончательно устарели. Современные мультимодальные модели справляются с ними без труда.

Генерация целых интерактивных миров с помощью кода, по мнению Андрея, может стать новым стандартом оценки возможностей ИИ.

Пока главным препятствием для идеального результата остается отсутствие у модели возможности анализировать собственный видеовыход - сейчас она вынуждена опираться на скриншоты, из-за чего в рендере возникают ошибки.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣60👍35❤‍🔥198🔥7🥰2🌭2🤨1💋1💅1
До закрытия подачи документов в магистратуру ФКН НИУ ВШЭхМТС осталось 4 дня!

Исследования и предпринимательство в ИИ — магистерская программа для будущих исследователей и разработчиков AI-решений.

В программе: классический ML, AI-агенты и LLM, генеративные нейросети, компьютерное зрение, NLP, обучение с подкреплением и многое другое

Самое важное о программе:
➡️ 30 студентов учатся бесплатно — МТС финансирует обучение
➡️ Преподаватели — действующие эксперты MWS, MWS AI и НИУ ВШЭ, практика на реальной инфраструктуре компании
➡️ Занятия вечером и в субботу — удобно совмещать с работой
➡️ Возможность получить оффер в МТС во время или после обучения
➡️ Соревнование на Kaggle: возможность получить доп. баллы в конкурс портфолио
➡️ Новости о программе в канале магистратуры

Подробная информация о программе и документах на сайте! Ждем тебя!
👍125🔥5😁5🤣4🌭3
Media is too big
VIEW IN TELEGRAM
✔️ Белый дом разработал регламент оценки новых моделей

Власти США отчитались о создании добровольного регламента тестирования новых моделей. Документ дает правительству и доверенным партнерам 30-дневный доступ к системам до их публичного релиза.

Содержание регламента, сроки внедрения и список допущенных к аудиту лиц не опубликованы. Эксперты рассчитывали, что администрация представит прозрачную структуру взаимодействия разработчиков с государством, включая требования к кибербезопасности, защите интеллектуальной собственности и конфиденциальности на время проверок.

По данным источников, на ближайшей закрытой встрече Белый дом обсудит новые стандарты с представителями ИИ-компаний.
axios.com

✔️ Apple ввела 30-дневный кулдаун на баг-репорты из-за ИИ-спама

Компания ограничила прием баг-репортов из-за спама, сгенерированного языковыми моделями. С июня компания лимитировала количество одновременных отчетов и ввела месячную паузу для ИБ-исследователей.

Ограничения затронули легитимных специалистов. Итальянский стартап Bynario заявил, что за 3 недели нашел более 50 уязвимостей в macOS с помощью ChatGPT, включая цепочку повышения привилегий до полного контроля над устройством. Из-за ограничений команда не смогла передать все данные.

Сама Apple активно использует LLM для аудита безопасности. В последних патчах компания закрыла в 5 раз больше уязвимостей по сравнению с предыдущими релизами.
ft.com

✔️ Google отменила релиз мобильного приложения AI Studio

Компания отказалась от планов по выпуску отдельного клиента для iOS и Android, несмотря на 800 тысяч предварительных регистраций. В Google пришли к выводу, что заставлять аудиторию скачивать еще одно приложение нецелесообразно.

Вместо этого кодинг-инструменты Studio интегрируют в базовую версию Gemini. Пользователи смогут описать нужный функционал в формате обычного диалога, после чего чат-бот самостоятельно напишет приложение. Ожидается, что эта опция станет доступна как на мобильных устройствах, так и на десктопах, хотя точные сроки запуска пока не раскрываются.

Веб-версия Google AI Studio продолжит работу и развитие.
Google AI Studio в сети Х

✔️ Microsoft выпустит единый суперапп для всех сервисов Copilot

CEO компании Сатья Наделла подтвердил разработку универсального приложения, релиз которого запланирован в этом году. Новая платформа соберет под одной крышей диалоговые интерфейсы, кодинг-ассистентов и автономных агентов. Ожидается, что решение покроет задачи как обычных пользователей, так и корпоративного сектора.

По словам Наделлы, концепция Copilot стремительно эволюционирует из обычного чат-бота в цифрового коллегу и уже близка к формату полноценного автопилота. Интеграция всех этих сценариев в единый продукт должна начаться уже в текущем квартале.

Этот анонс официально подтверждает недавний инсайд, в котором сообщалось, что Microsoft готовит масштабный хаб, связывающий базовый чат-бот, GitHub Copilot, Copilot Cowork и Autopilot.
theverge.com

✔️ Sakana AI представила модель для японского рынка

Модель под названием Namazu на базе Kimi K2.6 дообучена на закрытых данных под локальные бизнес-задачи с фокусом на японский контекст. В бенчмарке FairPoliticsQA файнтюн поднял результат с 34,10% (Kimi) до 56,30% (Namazu) при сохранении показателей родительской модели в логике и кодинге.

Стоимость токенов составляет $0,95 за 1 млн на входе и $4 на выходе. Внешние инструменты тарифицируются отдельно: вызов веб-поиска обойдется в $7 за 1000 обращений, среда выполнения кода - в $0,12 за час. API Namazu полностью совместим со стандартом OpenAI.

Из-за необходимости соблюдать GDPR модель недоступна в ЕС, Великобритании и Швейцарии.
sakana.ai


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍38🔥36🤔1312👏8😁32🎅1🎄1🦄1
🔥 Российские разрабы выкатили бесплатную нейросеть для обучения роботов и беспилотных авто

В мире существуют лишь единицы систем, способных синтезировать физически точные данные для ИИ. Сбер выложил под открытой лицензией MIT семейство моделей Kandinsky WM 1.0, сделав технологию бесплатно доступной для всех разработчиков.

Системы генерируют физически достоверные видео и решают ключевую проблему — невозможность безопасно и дёшево снять вживую редкие или опасные сценарии вроде ДТП, экстремальной погоды или отказов оборудования.

Что внутри:

• Обучение на реальности: Kandinsky 5.0 Video Lite дообучили на нескольких миллионах видеозаписей реальных дорожных процессов и заводских линий;

• Контроль физики: Специальные алгоритмы через RL оценивают сохранение геометрии и естественность кинематики, избавляя ролики от деформации объектов;

• Модульные сценарии: Генерация 5-секундных блоков видео, из которых складывается обучение автономных систем и систем компьютерного зрения.

Модели становятся фундаментом для создания «моделей мира» — систем, способных предсказывать развитие событий в реальности. Решение уже применяют Центр робототехники Сбера и институт AIRI в своём дорожном симуляторе, а полный технический разбор опубликован в статье на Habr.

@ai_machinelearning_big_data

#ai #opensource #sber
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6036🔥34🤣18🗿5😁3🤬2
🌟 MiniMax открыла веса видеомодели H3

Как и было обещано на релизе в пятницу, китайская компания опубликовала модель H3, которая делает короткие ролики со звуком по текстовому описанию, картинкам, видео и аудио на входе.

Модель на 33 миллиарда параметров генерирует клипы длиной от 4 до 15 секунд, 24 кадра в секунду, со стереозвуком 32 килогерца, в пропорциях от широких 21:9 до вертикальных 9:16. Реплики персонажей поддерживаются на 11 языках, включая русский.

Полный конвейер H3 состоит из трёх частей:

🟠H3-Context-IR разбирает запрос пользователя со всем инпутом (картинки, видео, аудио) и переводит его во внутренний формат, с которым дальше работает модель.

🟢H3-Base по этому формату генерирует видео в разрешении 768p.

🟠H3-Regenerate-2K затем пересобирает сгенерированный ролик в 2K.

Но открыли не всю систему - только модуль, который отвечает непосредственно за генерацию. Закрытыми остались H3-Context-IR и H3-Regenerate-2K.


🟡H3-Base опубликована в 2-х вариантах

H3-Base-FL2VA работает с первым и последним кадром. Без картинок на входе это генерация по тексту, с одной или двумя - достройка ролика от заданного кадра или между двумя кадрами.

H3-Base-Ref2VA принимает смешанный ввод - до 9 изображений, до 3 видео и до 3 аудиодорожек, но суммарно не больше 12 файлов. Звук без картинки или видео система не примет.

По рейтингу Artificial Analysis, H3 занимает 1 место в редактировании видео, второе в генерации видео по тексту и третье - по изображению.


СomfyUI подготовили детальную инструкцию по использованию в своей среде и опубликовали базовые воркфлоу для генерации по тексту и референсу.

Помимо СomfyUI есть кукбуки под SGLangvLLM и diffusers, а так же промпт-гайды под базу и фулл-реф мод.

Лицензия разрешает дообучать модель на своих видео, персонажах или визуальном стиле. Официального кода для трейна пока нет.


⚠️ Коммерческое использование допускается только для компаний с выручкой ниже 20 миллионов долларов.


📌Лицензирование: MiniMax H3 Community License


🟡Модель


@ai_machinelearning_big_data

#AI #ML #Video #H3 #Minimax
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍66🔥3014👏12🤩8💯5
⚡️2 августа в Москве прошло событие «Урбан ML» от МТС True Tech и ВТБ

547 участников, 17 выступлений и мастер-классов, три зала и целый день Data Science: от RecSys и антифрода до NLP, LLM и агентных систем.

Главная фишка — максимум практики и общения. Топовые спикеры из российского бигтеха и международных компаний делились не только подходами, но и реальными историями из разработки.

А после технической части гости продолжили общение на нетворкинге, играли в ИИ-шахматы, настольный теннис и баскетбол. А завершился день афтепати во дворе московского лофта.

Получился отличный день про ML — с сильными кейсами, живым общением и людьми, которые двигают индустрию вперед

@ai_machinelearning_big_data
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥55👏19🎉12👍11👌114😁3
✔️ Liquid AI выпустила локального агента, который работает на телефоне

LFM2.5-2.6B - компактная агентная модель на 2,6 млрд параметров. Она умеет планировать действия, вызывать инструменты и выполнять многошаговые задачи полностью на устройстве, без облачного API.

Модель обучили примерно на 34 трлн токенов, расширили словарь до 128 тысяч токенов и добавили контекст 128K.

Особенно интересно устроено дообучение:

- отдельные модели-эксперты усиливали математику, код, tool use и длинный контекст;
- затем их навыки перенесли в одну модель через on-policy distillation;
- финальный этап прошёл внутри реальных агентных сред, включая Hermes Agent и OpenClaw.

По тестам Liquid AI, модель выдаёт:

- до 220 токенов/с на Apple M5 Max;
- до 113 токенов/с на Ryzen AI Max+ 395;
- около 30 токенов/с на смартфоне;
- почти 15 000 выходных токенов/с на одной H100 при высокой параллельной нагрузке.

При этом потребление памяти на CPU остаётся ниже 2,5 ГБ.

В бенчмарках LFM2.5-2.6B обходит более крупные Gemma и Qwen в ряде задач на следование инструкциям и использование инструментов. В сложном программировании большие модели пока сохраняют преимущество.

Есть поддержка llama.cpp, MLX, vLLM, SGLang и ONNX. Доступны базовая и дообученная open-weight версии.

Источник:
https://www.liquid.ai/blog/lfm2-5-2-6b

#LiquidAI #opensource

@ai_machinelearning_big_data
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
42👍39🔥17👏11🤓2