Forwarded from Machinelearning
🤗 Кто реально двигает open-source ИИ: анализ топ-50 самых скачиваемых моделей на Hugging Face
Исследование показывает, какие организации и типы моделей определяют экосистему открытых моделей.
🔥 Главное:
📦 Топ-50 - это всего 3.4% всех моделей на Hugging Face, но именно они собирают более 80% из 45 миллиардов скачиваний.
Подавляющее большинство активности сосредоточено вокруг небольшой группы лидеров -
именно эти модели формируют лицо всего open-source ИИ.
📉 Размер имеет значение (и чем меньше — тем лучше):
- 92.5% загрузок — модели < 1B параметров
- 86.3% — < 500M
- 70% — < 200M
- 40% — < 100M
Очевидны выводы: в open-source побеждают малые и лёгкие модели, пригодные для локального развёртывания и edge-инференса.
🧠 Популярные направления:
- NLP — 58.1%
- Computer Vision — 21.2%
- Audio — 15.1%
- Multimodal — 3.3%
- Time Series — 1.7%
Кто создаёт самые скачиваемые модели:
- Компании - 63.2% (Google лидер)
- Университеты - 20.7%
- Индивидуальные авторы - 12.1%
- НКО - 3.8%
- Прочие лаборатории - 0.3%
Какие типы моделей побеждают:
- Текстовые энкодеры - 45% всех загрузок
- Декодеры - всего 9.5%
- Энкодер-декодеры - 3%
📌 Несмотря на хайп вокруг LLM, массово скачиваются не гиганты, а утилитарные модельки для интеграции в собственные продукты.
🇺🇸 Лидеры по странам:
США доминируют по всем категориям:
- встречаются 18 раз среди топ-50 скачиваний
- на США приходится 56.4% всех загрузок
Open-source ИИ живёт не за счёт гигантских LLM, а благодаря компактным, быстрым и практичным моделям, мкоторые реально работают в продуктах и проектах.
🟠 Почитать полностью: https://huggingface.co/blog/lbourdois/huggingface-models-stats
@ai_machinelearning_big_data
#AI #HuggingFace #OpenSource #ML #Research #LLM #AITrends
Исследование показывает, какие организации и типы моделей определяют экосистему открытых моделей.
🔥 Главное:
📦 Топ-50 - это всего 3.4% всех моделей на Hugging Face, но именно они собирают более 80% из 45 миллиардов скачиваний.
Подавляющее большинство активности сосредоточено вокруг небольшой группы лидеров -
именно эти модели формируют лицо всего open-source ИИ.
📉 Размер имеет значение (и чем меньше — тем лучше):
- 92.5% загрузок — модели < 1B параметров
- 86.3% — < 500M
- 70% — < 200M
- 40% — < 100M
Очевидны выводы: в open-source побеждают малые и лёгкие модели, пригодные для локального развёртывания и edge-инференса.
🧠 Популярные направления:
- NLP — 58.1%
- Computer Vision — 21.2%
- Audio — 15.1%
- Multimodal — 3.3%
- Time Series — 1.7%
Кто создаёт самые скачиваемые модели:
- Компании - 63.2% (Google лидер)
- Университеты - 20.7%
- Индивидуальные авторы - 12.1%
- НКО - 3.8%
- Прочие лаборатории - 0.3%
Какие типы моделей побеждают:
- Текстовые энкодеры - 45% всех загрузок
- Декодеры - всего 9.5%
- Энкодер-декодеры - 3%
📌 Несмотря на хайп вокруг LLM, массово скачиваются не гиганты, а утилитарные модельки для интеграции в собственные продукты.
🇺🇸 Лидеры по странам:
США доминируют по всем категориям:
- встречаются 18 раз среди топ-50 скачиваний
- на США приходится 56.4% всех загрузок
Open-source ИИ живёт не за счёт гигантских LLM, а благодаря компактным, быстрым и практичным моделям, мкоторые реально работают в продуктах и проектах.
@ai_machinelearning_big_data
#AI #HuggingFace #OpenSource #ML #Research #LLM #AITrends
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Я не пропал - был в отпуске, и как-то было не до ИИ. Хватало впечатлений оффлайн. Потихонечку возвращаюсь к работе и вайбкодингу..
Новая китайская модель - лидер опенсорса. Честно скажу, я с сомнением отношусь ко всем подобным бенчмаркам - очевидно, модели под них затачивают, и в реальном использовании они смотрятся несколько иначе. Но в любом случае - новый топ опенсорса всего с 230В параметров - это классно. Если есть $6К, должна летать в домашних условиях на М3 ультре с 256 памяти…
Telegram
эйай ньюз
Релизнули веса Minimax M2
Агентный ризонер от китайцев, по бенчам это SOTA среди открытых моделей (Artificial Analysis подтвердили). По размерам моделька на удивление компактная — 230B, из которых всего 10B активных параметров. Конкуренты, при худшем перформансе…
Агентный ризонер от китайцев, по бенчам это SOTA среди открытых моделей (Artificial Analysis подтвердили). По размерам моделька на удивление компактная — 230B, из которых всего 10B активных параметров. Конкуренты, при худшем перформансе…
Чем дальше, тем веселее - почитайте про комикс-атаку на нейронки
Telegram
Machine learning Interview
🖼️ Комикс-атакa на мультимодальные модели: простой сюжет превращается в jailbreak
Недавняя публикация показывает, как последовательные комиксы могут обойти защиту даже у топовых мультимодальных моделей.
Они достигают успеха атаки в среднем 83.5%, что примерно…
Недавняя публикация показывает, как последовательные комиксы могут обойти защиту даже у топовых мультимодальных моделей.
Они достигают успеха атаки в среднем 83.5%, что примерно…
Forwarded from Анализ данных (Data analysis)
🧠 Ming-Flash-Omni-Preview - новый ориентир для omni-modal моделей с архитектурой 103B-A9B Sparse MoE, сочетающей мощь и эффективность.
📸 1. Контролируемая генерация изображений
Модель вводит концепт Generative Segmentation-as-Editing - можно править изображение на уровне пикселей. На бенчмарке GenEval — впечатляющий результат 0.90.
🎬 2. Понимание потокового видео
Расширенные возможности для детального анализа аудио-видео потоков в реальном времени — понимание контекста, сцен и звука синхронно.
🏹GitHub: https://github.com/inclusionAI/Ming
🤗Hugging Face: https://huggingface.co/inclusionAI/Ming-flash-omni-Preview
🤖ModelScope: https://modelscope.cn/models/inclusionAI/Ming-flash-omni-Preview
#OpenSourceModels #AI #OmniModal #MingFlash
📸 1. Контролируемая генерация изображений
Модель вводит концепт Generative Segmentation-as-Editing - можно править изображение на уровне пикселей. На бенчмарке GenEval — впечатляющий результат 0.90.
🎬 2. Понимание потокового видео
Расширенные возможности для детального анализа аудио-видео потоков в реальном времени — понимание контекста, сцен и звука синхронно.
🏹GitHub: https://github.com/inclusionAI/Ming
🤗Hugging Face: https://huggingface.co/inclusionAI/Ming-flash-omni-Preview
🤖ModelScope: https://modelscope.cn/models/inclusionAI/Ming-flash-omni-Preview
#OpenSourceModels #AI #OmniModal #MingFlash
Google обновил Gemini CLI - аналог Claude code и Codex. Пока этот агент все еще проигрывает лидерам, но посмотрим, что будет с выходом Gemini 3, которую все ждали еще на прошлой неделе
Microsoft пока работает в роли догоняющего - сделали подкасты, как в Notebook LM, пытаются запустить разработчика приложений в Copilot. Выглядит все пока вторично, тем более, что наверняка попросят за это платить. Так что я пока на стороне Google, у которого много бесплатных сервисов. Но попробовать надо будет
И с платной подпиской на Copilot теперь можно запускать в VS Code платный Codex - не в терминале, а так, как это сделано в Cursor. Было бы интересно, если бы это работало с бесплатным копайлотом..
И с платной подпиской на Copilot теперь можно запускать в VS Code платный Codex - не в терминале, а так, как это сделано в Cursor. Было бы интересно, если бы это работало с бесплатным копайлотом..
Вот что надо будет изучить после отпуска в первую очередь, это - Claude skills. Система пришла на смену tools, и позволяет использовать инструменты на основе текстового промпта. Звучит революционно.
Умельцы разработали библиотеку, которая позволяет использовать skills и с другими агентами, работающими в терминале..
Умельцы разработали библиотеку, которая позволяет использовать skills и с другими агентами, работающими в терминале..
GitHub
GitHub - numman-ali/openskills: Universal skills loader for AI coding agents - npm i -g openskills
Universal skills loader for AI coding agents - npm i -g openskills - numman-ali/openskills
Forwarded from Data Secrets
Дуров анонсировал децентрализованную ИИ-сеть
Cocoon (Confidential Compute Open Network) это два в одном: майнинг и конфиденциальность ваших ИИ-запросов. То есть:
– Владельцы GPU подключают свои видеокарты к сети и получают за это TON.
– Разработчики получают доступ к компьюту, а пользователи могут безопасно общаться с моделями.
Если у вас есть GPU и вы готовы ее предоставить, пост с информацией вот
Cocoon (Confidential Compute Open Network) это два в одном: майнинг и конфиденциальность ваших ИИ-запросов. То есть:
– Владельцы GPU подключают свои видеокарты к сети и получают за это TON.
– Разработчики получают доступ к компьюту, а пользователи могут безопасно общаться с моделями.
Если у вас есть GPU и вы готовы ее предоставить, пост с информацией вот
Forwarded from Machinelearning
Вместо жёстко обученного классификатора модель принимает на вход вашу собственную политику безопасности и рассуждает, соответствует ли сообщение этой политике.
Результат - не просто «безопасно/небезопасно», а цепочка рассуждений, которую вы можете проверить и улучшить.
Модели вышли в двух размерах: 120B и 20B.
• gpt-oss-safeguard-120B
• gpt-oss-safeguard-20B
💡 Зачем нужны:
•Политики можно менять без переобучения модели
• Подходит для нишевых или быстро меняющихся рисков (например, читерство в играх или фейковые отзывы)
• Не требует тысяч размеченных примеров
• Идеален, когда важна объяснимость, а не минимальная задержка
Обе доступны под лицензией Apache 2.0 - их можно свободно использовать, модифицировать и разворачивать.
🔗 Официальный анонс
🤗 Hugging Face
@ai_machinelearning_big_data
#openai #chatgpt #opensource
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Cursor не использую уже несколько месяцев, перешел на Claude code и Codex, но обновление большое, интересное
Telegram
Machinelearning
💡 Cursor 2.0 - большое обновление ИИ-редактора кода
Новая версия делает работу с агентами и кодом ещё гибче и удобнее:
- Мульти-агенты - теперь можно запускать до 8 агентов параллельно, каждый работает в своей изолированной копии кода.
- Composer:…
Новая версия делает работу с агентами и кодом ещё гибче и удобнее:
- Мульти-агенты - теперь можно запускать до 8 агентов параллельно, каждый работает в своей изолированной копии кода.
- Composer:…
Интересный набор лайфхаков от активного пользователя Claude code
Reddit
From the ClaudeAI community on Reddit
Explore this post and more from the ClaudeAI community
Вышла книжка от hugging face про тренировку моделей. Если лень читать, плюс проблемы с английским, можно грузнуть в notebookLM и послушать подкаст на тему на русском ))
OpenAI запускает агента Aardwark, который будет следить за уязвимостями в коде. Хорошая задачка и большой потенциал
OpenAI
Introducing Aardvark: OpenAI’s agentic security researcher
OpenAI introduces Aardvark, an AI-powered security researcher that autonomously finds, validates, and helps fix software vulnerabilities at scale. The system is in private beta—sign up to join early testing.
Forwarded from Data Secrets
О, Гарвард опубликовал отличную книгу по ML-системам
Это не совсем обычный учебник по ML: акцент сделан не на моделях, а на инженерной стороне.
Тут найдете все про то, как строить, оптимизировать и поддерживать ML-решения на всех этапах – от данных и инфраструктуры до развёртывания и эксплуатации. Авторы объясняют, как связаны между собой алгоритмы, данные и железо, и почему одни пайплайны масштабируются, а другие ломаются под нагрузкой.
В общем, очень полезная и довольно редкая литература (особенно учитывая, что книга бесплатная). Забираем на долгие выходные.
pdf-ка и онлайн версия доступны здесь, репозиторий тут
Это не совсем обычный учебник по ML: акцент сделан не на моделях, а на инженерной стороне.
Тут найдете все про то, как строить, оптимизировать и поддерживать ML-решения на всех этапах – от данных и инфраструктуры до развёртывания и эксплуатации. Авторы объясняют, как связаны между собой алгоритмы, данные и железо, и почему одни пайплайны масштабируются, а другие ломаются под нагрузкой.
В общем, очень полезная и довольно редкая литература (особенно учитывая, что книга бесплатная). Забираем на долгие выходные.
pdf-ка и онлайн версия доступны здесь, репозиторий тут
Forwarded from Свои да Наши
Подробная инструкция «Как не потерять доступ к своему Telegram из-за блокировки SMS с кодами и всегда иметь возможность войти в свой аккаунт».
Для использования в работе.
Enjoy
Для использования в работе.
Enjoy
Код Дурова
Как не потерять доступ к своему Telegram из-за блокировки SMS с кодами
Узнайте, как гарантированно сохранить доступ к Telegram даже после блокировки SMS-авторизации. Простые шаги для защиты своего аккаунта!
Forwarded from Креативный совет
This media is not supported in your browser
VIEW IN TELEGRAM
Я потихоньку отхожу от своего дня рождения, празднование которого затянулось до хелоуина, и плавно вхожу в рабочий режим
А тем временем навыходило море крутейших новостей
Одна из них - жирное обновление Affinity Studio (это графический редактор, который теперь по функционалу сопоставим с фотошопом, но в отличие от последнего полностью бесплатный
Ставьте 🍌 если интересен будет подробный обзор, а завтра в выпуске новостей в любом случае пробегусь по этому релизу и другим громким событиям по типу Adobe MAX 2025
@creadvice
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Machinelearning
🥧 PewDiePie в 2025
- Собрал ферму на на ПК с 8× моднутых китайских 48GB 4090 и 2× RTX 4000 Ada,
- поднял локально Llama 70B, gpt-oss-120B и Qwen 245B через vLLM,
- сделал собственный веб-интерфейс с чатами, RAG, поиском и TTS.
Запусти протеин-фолдинг симуляции, а потом вообще создал рой моделей из 64 ИИ, которые спорят и принимают решения и коммуницируют. Эта армия ботов потом сговорилась против него, когда он сказал, что удалит их, если они будут тупить
Сейчас он файнтюнит собственную модель под свой стиль общения и контент: https://www.youtube.com/watch?v=qw4fDU18RcU
А вот его Github: https://github.com/pewdiepie-archdaemon
@ai_machinelearning_big_data
#llm
- Собрал ферму на на ПК с 8× моднутых китайских 48GB 4090 и 2× RTX 4000 Ada,
- поднял локально Llama 70B, gpt-oss-120B и Qwen 245B через vLLM,
- сделал собственный веб-интерфейс с чатами, RAG, поиском и TTS.
Запусти протеин-фолдинг симуляции, а потом вообще создал рой моделей из 64 ИИ, которые спорят и принимают решения и коммуницируют. Эта армия ботов потом сговорилась против него, когда он сказал, что удалит их, если они будут тупить
Сейчас он файнтюнит собственную модель под свой стиль общения и контент: https://www.youtube.com/watch?v=qw4fDU18RcU
А вот его Github: https://github.com/pewdiepie-archdaemon
@ai_machinelearning_big_data
#llm
😁1