Коллеги из ICT Moscow совместно с МосХабом опубликовали обзор - "Что представляет собой отечественный Open Source в 2026 году".
Основные выводы от авторов:
• индивидуальные разработчики, команды компаний, а также научных и образовательных учреждений и контрибьюторы образуют ядро отечественного Open Source;
• большинство участников инициатив Open Source занимаются этим бескорыстно;
• после 2022 года снижается число новых проектов от российских авторов на GitHub, однако растет их количество на площадке для ИИ — Hugging Face;
• средняя продолжительность развития самых первых репозиториев Open Source составляет 13 лет;
• в настоящее время доступно более пяти отечественных репозиториев для размещения кода;
• по некоторым оценкам, в 2026 году уровень использования компаниями открытого кода приблизился к 90%;
• абсолютным лидером среди регионов по числу проектов в открытом доступе является Москва;
• фрагментарность внутренних сообществ, отсутствие системности и культуры совместной разработки создают естественные барьеры для российского Open Source;
• одно из возможных направлений, в котором ожидается наибольшая активность в развитии Open Source в ближайшие годы, — это искусственный интеллект.
Радует, что в отчете многократно упоминается наше исследование про ML/Data-опенсорс, а также опыт сообщества ITMO Opensource в целом.
Основные выводы от авторов:
• индивидуальные разработчики, команды компаний, а также научных и образовательных учреждений и контрибьюторы образуют ядро отечественного Open Source;
• большинство участников инициатив Open Source занимаются этим бескорыстно;
• после 2022 года снижается число новых проектов от российских авторов на GitHub, однако растет их количество на площадке для ИИ — Hugging Face;
• средняя продолжительность развития самых первых репозиториев Open Source составляет 13 лет;
• в настоящее время доступно более пяти отечественных репозиториев для размещения кода;
• по некоторым оценкам, в 2026 году уровень использования компаниями открытого кода приблизился к 90%;
• абсолютным лидером среди регионов по числу проектов в открытом доступе является Москва;
• фрагментарность внутренних сообществ, отсутствие системности и культуры совместной разработки создают естественные барьеры для российского Open Source;
• одно из возможных направлений, в котором ожидается наибольшая активность в развитии Open Source в ближайшие годы, — это искусственный интеллект.
Радует, что в отчете многократно упоминается наше исследование про ML/Data-опенсорс, а также опыт сообщества ITMO Opensource в целом.
🔥8👍2
Коллеги из AIRI выложили в открытый доступ модель OCC-RAG.
Описание дают такое:
Она обучена отвечать на вопросы по внешним источникам, связывать факты из нескольких независимых частей текста, опираться только на предоставленный контекст и отказываться предоставлять ответ, если данных в источнике не хватает. Благодаря компактному размеру модель обрабатывает запросы в 1,5–2 раза быстрее решений на базе больших языковых моделей, тратя при этом на генерацию ответа в среднем в 1,5 раза меньше токенов.
Ссылки:
Технический репорт | GitHub | GitVerse | HuggingFace | Forbes
Подробности реализации от Ивана Оселедца закинул в наш чат. Кстати, на HF статью можно поддержать апвоутом - сейчас она уже в Paper of the Day.
Описание дают такое:
Она обучена отвечать на вопросы по внешним источникам, связывать факты из нескольких независимых частей текста, опираться только на предоставленный контекст и отказываться предоставлять ответ, если данных в источнике не хватает. Благодаря компактному размеру модель обрабатывает запросы в 1,5–2 раза быстрее решений на базе больших языковых моделей, тратя при этом на генерацию ответа в среднем в 1,5 раза меньше токенов.
Ссылки:
Технический репорт | GitHub | GitVerse | HuggingFace | Forbes
Подробности реализации от Ивана Оселедца закинул в наш чат. Кстати, на HF статью можно поддержать апвоутом - сейчас она уже в Paper of the Day.
🔥12❤3
В GitVerse сообщают, что развернули актуальное зеркало PyPI:
https://t.me/gitversenews/912
Всячески надеюсь, что с доступом к оригинальному PyPI из наших сетей никогда не будет никаких проблем, но недавно были случаи перебоев - так что для внутренних серверов может и пригодится. Также представлены зеркала Docker Hub, Maven Central и NPM.
P.S. Ещё есть аналогичное зеркало от Яндекса.
https://t.me/gitversenews/912
Всячески надеюсь, что с доступом к оригинальному PyPI из наших сетей никогда не будет никаких проблем, но недавно были случаи перебоев - так что для внутренних серверов может и пригодится. Также представлены зеркала Docker Hub, Maven Central и NPM.
P.S. Ещё есть аналогичное зеркало от Яндекса.
👏8❤3👎1🤬1🖕1
Традиционный анонс:
XXII конференция разработчиков свободного ПО (OSSDEVCONF) состоится в октябре 2026 года в Переславле-Залесском.
Дедлайн для заявления докладов - 6 сентября. От нашего сообщества уже дважды были выступления (2024, 2025), надеюсь продолжим традицию.
Подробности - на сайте конференции https://www.basealt.ru/22dev-conf
XXII конференция разработчиков свободного ПО (OSSDEVCONF) состоится в октябре 2026 года в Переславле-Залесском.
Дедлайн для заявления докладов - 6 сентября. От нашего сообщества уже дважды были выступления (2024, 2025), надеюсь продолжим традицию.
Подробности - на сайте конференции https://www.basealt.ru/22dev-conf
🔥7🆒2
Объявлен новый опенсорс-конкурс: «Код логики» от «Института логики».
Кто может участвовать: физические лица - разработчики свободного ПО.
Что нужно сделать: предоставить значимый вклад в существующий Open-Source-проект, опубликованный в публичном репозитории под свободной лицензией. Вклад может быть сделан в свой или сторонний проект.
Призовой фонд: 3 призовых места, максимальное количество победителей — до 6 человек. Победитель получит 1 000 000 рублей.
Сроки: заявки принимаются до 15 августа 2026 года на сайте института.
Награждение победителей состоится 2–4 октября на XXII ежегодной конференции разработчиков свободных программ (писали про неё недавно как раз).
Организатор конкурса - АНО «Институт логики», финансовую поддержку обеспечивает «Базальт СПО» и частные спонсоры.
Подробности - на сайте (конкретные критерии оценивания и проч. - в Положении).
Кто может участвовать: физические лица - разработчики свободного ПО.
Что нужно сделать: предоставить значимый вклад в существующий Open-Source-проект, опубликованный в публичном репозитории под свободной лицензией. Вклад может быть сделан в свой или сторонний проект.
Призовой фонд: 3 призовых места, максимальное количество победителей — до 6 человек. Победитель получит 1 000 000 рублей.
Сроки: заявки принимаются до 15 августа 2026 года на сайте института.
Награждение победителей состоится 2–4 октября на XXII ежегодной конференции разработчиков свободных программ (писали про неё недавно как раз).
Организатор конкурса - АНО «Институт логики», финансовую поддержку обеспечивает «Базальт СПО» и частные спонсоры.
Подробности - на сайте (конкретные критерии оценивания и проч. - в Положении).
👍4🔥1
Коллеги из МосХаб анонсируют митап «День открытого кода», который пройдет 30 июня в Москве.
Обещают обсуждение связанных с открытым кодом вопросов в формате интеративной дискуссии:
В МосХаб.Сколково соберутся разработчики, продуктовые и ИТ-команды, стартапы и профильные медиа, чтобы обсудить последние тренды отрасли в России, завести полезные знакомства и наметить совместные проекты.
На митапе участники узнают, как столица видит развитие опенсорс, какие результаты уже есть и почему открытый код стал важной частью городской цифровой стратегии.
Подробности - на сайте.
Кто выступит:
- Владимир Нелюб — директор по науке и ИИ «Группы Астра», управляющий партнёр ASTRA AI, д.т.н., профессор
- Андрей Иванов — директор по развитию бизнеса Swordfish Security
- Анна Романова — управляющий партнёр AG Legal
- Алексей Анисимов — заместитель руководителя ДИТ Москвы
- Роман Аляутдин — директор по разработке ОС Аврора
- Руслан Ахтямов — основатель Napoleon IT и НИИСТРОМ
Алексей Анисимов кстати уже участвовал в нашей опенсорс-дискуссии на РИФ 2025.
Обещают обсуждение связанных с открытым кодом вопросов в формате интеративной дискуссии:
В МосХаб.Сколково соберутся разработчики, продуктовые и ИТ-команды, стартапы и профильные медиа, чтобы обсудить последние тренды отрасли в России, завести полезные знакомства и наметить совместные проекты.
На митапе участники узнают, как столица видит развитие опенсорс, какие результаты уже есть и почему открытый код стал важной частью городской цифровой стратегии.
Подробности - на сайте.
Кто выступит:
- Владимир Нелюб — директор по науке и ИИ «Группы Астра», управляющий партнёр ASTRA AI, д.т.н., профессор
- Андрей Иванов — директор по развитию бизнеса Swordfish Security
- Анна Романова — управляющий партнёр AG Legal
- Алексей Анисимов — заместитель руководителя ДИТ Москвы
- Роман Аляутдин — директор по разработке ОС Аврора
- Руслан Ахтямов — основатель Napoleon IT и НИИСТРОМ
Алексей Анисимов кстати уже участвовал в нашей опенсорс-дискуссии на РИФ 2025.
🔥4❤1
Вчера посетили церемонию вручения премии Generation AI Awards:
В номинации "За вклад в развитие GenAI-сообщества" победила платформа бенчмаркинга LLM Arena. Мы вошли в шорт-лист финалистов, но до первого места не хватило.
Также можно посмотреть интересные проекты в других номинациях. Например, мне понравился стартап НейроДВС (AI-система диагностики двигателей транспорта с использованием LLM+RAG). Какое-то разнообразие среди повышения видимости брендов и автоматизации продаж)
P.S. Коллег из AI Talent Hub ИТМО можно поздравить с победой в соседней номинации.
В номинации "За вклад в развитие GenAI-сообщества" победила платформа бенчмаркинга LLM Arena. Мы вошли в шорт-лист финалистов, но до первого места не хватило.
Также можно посмотреть интересные проекты в других номинациях. Например, мне понравился стартап НейроДВС (AI-система диагностики двигателей транспорта с использованием LLM+RAG). Какое-то разнообразие среди повышения видимости брендов и автоматизации продаж)
P.S. Коллег из AI Talent Hub ИТМО можно поздравить с победой в соседней номинации.
🔥6
Сегодня - рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО":
У коллег из Industrial AI Research Lab Института ИИ ИТМО вышла новая статья на демо-треке A*-конференции ACL 2026:
SlideGuard: AI-Driven Evaluation of Graduate Student Presentation Materials
SlideGuard - это агентная система, анализирующая презентации на основе множества критериев с поддержкой фильтрации и категоризации по типам слайдов. Её уже внедрили на ФТИИ ИТМО (наравне с нашим инструментом OSA - про его применение для ВКР cм. тут)
Код SlideGuard - полностью открыт:
https://github.com/Industrial-AI-Research-Lab/SlideGuard
У коллег из Industrial AI Research Lab Института ИИ ИТМО вышла новая статья на демо-треке A*-конференции ACL 2026:
SlideGuard: AI-Driven Evaluation of Graduate Student Presentation Materials
SlideGuard - это агентная система, анализирующая презентации на основе множества критериев с поддержкой фильтрации и категоризации по типам слайдов. Её уже внедрили на ФТИИ ИТМО (наравне с нашим инструментом OSA - про его применение для ВКР cм. тут)
Код SlideGuard - полностью открыт:
https://github.com/Industrial-AI-Research-Lab/SlideGuard
🔥10
И снова рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО". Сегодня - про AI4Physics.
Андрей Богданов из Нового физтеха ИТМО совместно с Харбинским инженерными университетом:
(1) разработали ИИ-модель MetaDiT для автоматического проектирования сверхтонкой оптики.
(2) опубликовали статью "MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface Design" на А*-конференции AAAI 2026.
(3) выложили открытый код;
(4) на днях выпустили пресс релиз.
Правда, для полноценной открытости кода в репозитории не хватает лицензии) Попробуем его обработать Осой, чтобы исправить это и поискать что ещё можно улучшить.
Статья: https://ojs.aaai.org/index.php/AAAI/article/view/37025
Код: https://github.com/JessePrince/metadit
СМИ: https://tass.ru/nauka/27872435
Андрей Богданов из Нового физтеха ИТМО совместно с Харбинским инженерными университетом:
(1) разработали ИИ-модель MetaDiT для автоматического проектирования сверхтонкой оптики.
(2) опубликовали статью "MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface Design" на А*-конференции AAAI 2026.
(3) выложили открытый код;
(4) на днях выпустили пресс релиз.
Правда, для полноценной открытости кода в репозитории не хватает лицензии) Попробуем его обработать Осой, чтобы исправить это и поискать что ещё можно улучшить.
Статья: https://ojs.aaai.org/index.php/AAAI/article/view/37025
Код: https://github.com/JessePrince/metadit
СМИ: https://tass.ru/nauka/27872435
🔥12
Сбер выкатил новые опенсорс-модели - теперь со звуком:
1) Новая GigaChat Audio.
Audio-native LLM на базе GigaAM Multilingual и GigaChat3.1-10B-A1.8B. Поддерживает multi-turn диалог, классификацию аудио, перевод и распознавание речи, и temporal grounding (локализацию событий во времени), описание интервала аудио и суммаризацию с временными метками.
В комплекте идет датасет TimeGround-1M — для обучения LLM привязке событий ко времени.
📖 arXiv
🤗 ai-sage/GigaChat3.1-Audio-10B-A1.8B
🤗 ai-sage/TimeGround-1M
2) Обновление GigaAM Multilingual.
Расширение модели распознавания речи на казахский, киргизский, узбекский и английский.
📖 arXiv
🤗 ai-sage/GigaAM-Multilingual
👩💻 salute-developers/GigaAM
1) Новая GigaChat Audio.
Audio-native LLM на базе GigaAM Multilingual и GigaChat3.1-10B-A1.8B. Поддерживает multi-turn диалог, классификацию аудио, перевод и распознавание речи, и temporal grounding (локализацию событий во времени), описание интервала аудио и суммаризацию с временными метками.
В комплекте идет датасет TimeGround-1M — для обучения LLM привязке событий ко времени.
🤗 ai-sage/GigaChat3.1-Audio-10B-A1.8B
🤗 ai-sage/TimeGround-1M
2) Обновление GigaAM Multilingual.
Расширение модели распознавания речи на казахский, киргизский, узбекский и английский.
🤗 ai-sage/GigaAM-Multilingual
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3❤1
Объявлены репозитории-победители очередного опенсорс-конкурса KaiCode:
1) raprogramm/yew-nav-link 6★ - Вьетнам - Perfect $2048
А navigation-link library for the Yew framework in Rust with automatic active-state detection, demonstrated perfect software development practices: clean and idiomatic code, requirements captured as formal specifications and architecture decision records, strict static analysis (clippy, CodeQL, Scorecard, zizmor), mutation, fuzz, and property testing with enforced 95% coverage, an mdBook documentation site, semantic-versioned releases with a maintained changelog, protected branching, and exemplary REUSE-compliant licensing. Source files are small, meticulously documented, and every file carries SPDX headers.
2) ahoo-wang/wow 296★ - Китай - Excellent $1024
А reactive CQRS and Event-Sourcing microservice framework built on Domain-Driven Design, written in Kotlin, showed us an excellent codebase: clean, modular DDD/CQRS design, genuine multi-reviewer code review, Testcontainers-backed integration testing, enforced coverage thresholds and detekt static analysis, a bilingual documentation site, and a long history of semantic-versioned releases on Maven Central. However, issue labeling is inconsistent across recent tickets.
3) choplogic/chop-logic-components 5★ - Сербия - Awesome $512
A library of reusable React components and hooks written in TypeScript, showed us awesome coding practices: conventions enforced by Biome, Prettier, commitlint, and Husky git hooks, mutation testing with Stryker on top of Codecov-tracked coverage, a Storybook gallery published as a documentation site, and semantic-versioned releases to npm with a maintained changelog. However, pull requests are self-merged by the sole author without review, and licensing stops at a single MIT file, with no SPDX headers in the sources
Всего принимало участие 153 проекта.
От нас тоже подавали, но не вышло.
Подача на следующий конкурс уже открыта.
1) raprogramm/yew-nav-link 6★ - Вьетнам - Perfect $2048
А navigation-link library for the Yew framework in Rust with automatic active-state detection, demonstrated perfect software development practices: clean and idiomatic code, requirements captured as formal specifications and architecture decision records, strict static analysis (clippy, CodeQL, Scorecard, zizmor), mutation, fuzz, and property testing with enforced 95% coverage, an mdBook documentation site, semantic-versioned releases with a maintained changelog, protected branching, and exemplary REUSE-compliant licensing. Source files are small, meticulously documented, and every file carries SPDX headers.
2) ahoo-wang/wow 296★ - Китай - Excellent $1024
А reactive CQRS and Event-Sourcing microservice framework built on Domain-Driven Design, written in Kotlin, showed us an excellent codebase: clean, modular DDD/CQRS design, genuine multi-reviewer code review, Testcontainers-backed integration testing, enforced coverage thresholds and detekt static analysis, a bilingual documentation site, and a long history of semantic-versioned releases on Maven Central. However, issue labeling is inconsistent across recent tickets.
3) choplogic/chop-logic-components 5★ - Сербия - Awesome $512
A library of reusable React components and hooks written in TypeScript, showed us awesome coding practices: conventions enforced by Biome, Prettier, commitlint, and Husky git hooks, mutation testing with Stryker on top of Codecov-tracked coverage, a Storybook gallery published as a documentation site, and semantic-versioned releases to npm with a maintained changelog. However, pull requests are self-merged by the sole author without review, and licensing stops at a single MIT file, with no SPDX headers in the sources
Всего принимало участие 153 проекта.
От нас тоже подавали, но не вышло.
Подача на следующий конкурс уже открыта.
👀2
Hugging Face и alphaXiv объявили соревнование по воспроизведению результатов научных статей с ICML 2026 - тема, на которую периодически пишем.
Из каждой статьи выделено несколько claims, корректность которых и нужно проверить.
Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми.
За участие организаторы предлагают GPU-кредиты на каждую статью (но их быстро разбирают) + отдельные призы от OpenResearch. Дедлайн - 2 августа.
P.S. Спс каналу Навука и моя жизнб за информирование, а то как-то мимо прошло)
Из каждой статьи выделено несколько claims, корректность которых и нужно проверить.
Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми.
За участие организаторы предлагают GPU-кредиты на каждую статью (но их быстро разбирают) + отдельные призы от OpenResearch. Дедлайн - 2 августа.
P.S. Спс каналу Навука и моя жизнб за информирование, а то как-то мимо прошло)
🔥8❤3
RAGU - на HuggingFace!
Сегодня мы выложили на HuggingFace препринт про открытый GraphRAG-фреймворк RAGU.
RAGU - это модульный GraphRAG-движок, который превращает сырой текст в граф знаний: извлекает сущности и связи, строит и чистит граф, а затем ищет ответы через локальные, глобальные или гибридные стратегии.
Этот проект сейчас разрабатывается совместно Лабораторией прикладных цифровых технологий НГУ (Иван Бондаренко) и Лабораторией автоматизированного мульти-агентного ИИ ИТМО (Николай Никитин). В разработке активно участвуют студенты обоих университетов.
В комплект фреймворка входит также новая компактная модель Meno-Lite-0.1 на 7B параметров (первое место на SemEval-2026 Task 8 MTRAG). В препринте, (сейчас он на рецензии на одной из A*-конференций), мы показали, что для построения качественного графа знаний не обязательно задействовать большие модели: наш 7B-экстрактор показывает результат лучше, чем Qwen2.5-32B на построении графов. Также, фреймворк недавно ставил одним из победителей конкурса Yandex Open Source.
Если говорить о конкретных цифрах:
RAGU достает до 84% релевантного контекста в медицинских бенчмарках (у конкурентов ≤76%). Мы обходим HippoRAG 2 на креативных задачах (59.0 против 56.9). При этом стоимость обработки — $0.001 за документ в сравнии с $0.10 у API-решений.
Как пользоваться RAGU:
Ставится одной командой
Как поддержать:
Если разработка заинтересовала, то ее можно поддержать в Daily Papers на Huggingface, поставив upvote тут: https://huggingface.co/papers/2607.11683
Также, будет рады звездочкам на репозиторий: https://github.com/RaguTeam/RAGU
Если есть вопросы - пишите в комментариях или в Issues на GitHub.
P.S. Если хотите посмотреть, как всё работает:
- 2 минуты: базовая настройка и первый запуск
- 11 минут: глубокое погружение в конфигурации пайплайна
Сегодня мы выложили на HuggingFace препринт про открытый GraphRAG-фреймворк RAGU.
RAGU - это модульный GraphRAG-движок, который превращает сырой текст в граф знаний: извлекает сущности и связи, строит и чистит граф, а затем ищет ответы через локальные, глобальные или гибридные стратегии.
Этот проект сейчас разрабатывается совместно Лабораторией прикладных цифровых технологий НГУ (Иван Бондаренко) и Лабораторией автоматизированного мульти-агентного ИИ ИТМО (Николай Никитин). В разработке активно участвуют студенты обоих университетов.
В комплект фреймворка входит также новая компактная модель Meno-Lite-0.1 на 7B параметров (первое место на SemEval-2026 Task 8 MTRAG). В препринте, (сейчас он на рецензии на одной из A*-конференций), мы показали, что для построения качественного графа знаний не обязательно задействовать большие модели: наш 7B-экстрактор показывает результат лучше, чем Qwen2.5-32B на построении графов. Также, фреймворк недавно ставил одним из победителей конкурса Yandex Open Source.
Если говорить о конкретных цифрах:
RAGU достает до 84% релевантного контекста в медицинских бенчмарках (у конкурентов ≤76%). Мы обходим HippoRAG 2 на креативных задачах (59.0 против 56.9). При этом стоимость обработки — $0.001 за документ в сравнии с $0.10 у API-решений.
Как пользоваться RAGU:
Ставится одной командой
pip install graph_ragu, работает на обычной потребительской видеокарте. Код открыт (MIT), веса — Apache 2.0.Как поддержать:
Если разработка заинтересовала, то ее можно поддержать в Daily Papers на Huggingface, поставив upvote тут: https://huggingface.co/papers/2607.11683
Также, будет рады звездочкам на репозиторий: https://github.com/RaguTeam/RAGU
Если есть вопросы - пишите в комментариях или в Issues на GitHub.
P.S. Если хотите посмотреть, как всё работает:
- 2 минуты: базовая настройка и первый запуск
- 11 минут: глубокое погружение в конфигурации пайплайна
👍8❤4💯1