Научный опенсорс
950 subscribers
109 photos
1 video
1 file
179 links
Канал сообщества ITMO OpenSource, посвященного созданию и использованию наукоёмких open-source проектов, в том числе в области AI/ML.

Чат: https://t.me/itmo_opensource

По всем вопросам - @nicl_nno
Download Telegram
Коллеги из ICT Moscow совместно с МосХабом опубликовали обзор - "Что представляет собой отечественный Open Source в 2026 году".

Основные выводы от авторов:

индивидуальные разработчики, команды компаний, а также научных и образовательных учреждений и контрибьюторы образуют ядро отечественного Open Source;
• большинство участников инициатив Open Source занимаются этим бескорыстно;
• после 2022 года снижается число новых проектов от российских авторов на GitHub, однако растет их количество на площадке для ИИ — Hugging Face;
• средняя продолжительность развития самых первых репозиториев Open Source составляет 13 лет;
• в настоящее время доступно более пяти отечественных репозиториев для размещения кода;
• по некоторым оценкам, в 2026 году уровень использования компаниями открытого кода приблизился к 90%;
• абсолютным лидером среди регионов по числу проектов в открытом доступе является Москва;
• фрагментарность внутренних сообществ, отсутствие системности и культуры совместной разработки создают естественные барьеры для российского Open Source;
• одно из возможных направлений, в котором ожидается наибольшая активность в развитии Open Source в ближайшие годы, — это искусственный интеллект.


Радует, что в отчете многократно упоминается наше исследование про ML/Data-опенсорс, а также опыт сообщества ITMO Opensource в целом.
🔥8👍2
Коллеги из AIRI выложили в открытый доступ модель OCC-RAG.

Описание дают такое:
Она обучена отвечать на вопросы по внешним источникам, связывать факты из нескольких независимых частей текста, опираться только на предоставленный контекст и отказываться предоставлять ответ, если данных в источнике не хватает. Благодаря компактному размеру модель обрабатывает запросы в 1,5–2 раза быстрее решений на базе больших языковых моделей, тратя при этом на генерацию ответа в среднем в 1,5 раза меньше токенов.

Ссылки:
Технический репорт | GitHub | GitVerse | HuggingFace | Forbes

Подробности реализации от Ивана Оселедца закинул в наш чат. Кстати, на HF статью можно поддержать апвоутом - сейчас она уже в Paper of the Day.
🔥123
В GitVerse сообщают, что развернули актуальное зеркало PyPI:

https://t.me/gitversenews/912

Всячески надеюсь, что с доступом к оригинальному PyPI из наших сетей никогда не будет никаких проблем, но недавно были случаи перебоев - так что для внутренних серверов может и пригодится. Также представлены зеркала Docker Hub, Maven Central и NPM.

P.S. Ещё есть аналогичное зеркало от Яндекса.
👏83👎1🤬1🖕1
Традиционный анонс:

XXII конференция разработчиков свободного ПО (OSSDEVCONF) состоится в октябре 2026 года в Переславле-Залесском.

Дедлайн для заявления докладов - 6 сентября. От нашего сообщества уже дважды были выступления (2024, 2025), надеюсь продолжим традицию.

Подробности - на сайте конференции https://www.basealt.ru/22dev-conf
🔥7🆒2
Объявлен новый опенсорс-конкурс: «Код логики» от «Института логики».

Кто может участвовать: физические лица - разработчики свободного ПО.

Что нужно сделать: предоставить значимый вклад в существующий Open-Source-проект, опубликованный в публичном репозитории под свободной лицензией. Вклад может быть сделан в свой или сторонний проект.

Призовой фонд: 3 призовых места, максимальное количество победителей — до 6 человек. Победитель получит 1 000 000 рублей.
Сроки: заявки принимаются до 15 августа 2026 года на сайте института.

Награждение победителей состоится 2–4 октября на XXII ежегодной конференции разработчиков свободных программ (писали про неё недавно как раз).

Организатор конкурса - АНО «Институт логики», финансовую поддержку обеспечивает «Базальт СПО» и частные спонсоры.

Подробности - на сайте (конкретные критерии оценивания и проч. - в Положении).
👍4🔥1
Коллеги из МосХаб анонсируют митап «День открытого кода», который пройдет 30 июня в Москве.

Обещают обсуждение связанных с открытым кодом вопросов в формате интеративной дискуссии:

В МосХаб.Сколково соберутся разработчики, продуктовые и ИТ-команды, стартапы и профильные медиа, чтобы обсудить последние тренды отрасли в России, завести полезные знакомства и наметить совместные проекты. 

На митапе участники узнают, как столица видит развитие опенсорс, какие результаты уже есть и почему открытый код стал важной частью городской цифровой стратегии.


Подробности - на сайте.

Кто выступит:

- Владимир Нелюб — директор по науке и ИИ «Группы Астра», управляющий партнёр ASTRA AI, д.т.н., профессор
- Андрей Иванов — директор по развитию бизнеса Swordfish Security
- Анна Романова — управляющий партнёр AG Legal
- Алексей Анисимов — заместитель руководителя ДИТ Москвы
- Роман Аляутдин — директор по разработке ОС Аврора
- Руслан Ахтямов — основатель Napoleon IT и НИИСТРОМ

Алексей Анисимов кстати уже участвовал в нашей опенсорс-дискуссии на РИФ 2025.
🔥41
Вчера посетили церемонию вручения премии Generation AI Awards:

В номинации "За вклад в развитие GenAI-сообщества" победила платформа бенчмаркинга LLM Arena. Мы вошли в шорт-лист финалистов, но до первого места не хватило.

Также можно посмотреть интересные проекты в других номинациях. Например, мне понравился стартап НейроДВС (AI-система диагностики двигателей транспорта с использованием LLM+RAG). Какое-то разнообразие среди повышения видимости брендов и автоматизации продаж)

P.S. Коллег из AI Talent Hub ИТМО можно поздравить с победой в соседней номинации.
🔥6
Сегодня - рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО":

У коллег из Industrial AI Research Lab Института ИИ ИТМО вышла новая статья на демо-треке A*-конференции ACL 2026:

SlideGuard: AI-Driven Evaluation of Graduate Student Presentation Materials

SlideGuard - это агентная система, анализирующая презентации на основе множества критериев с поддержкой фильтрации и категоризации по типам слайдов. Её уже внедрили на ФТИИ ИТМО (наравне с нашим инструментом OSA - про его применение для ВКР cм. тут)

Код SlideGuard - полностью открыт:
https://github.com/Industrial-AI-Research-Lab/SlideGuard
🔥10
И снова рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО". Сегодня - про AI4Physics.

Андрей Богданов из Нового физтеха ИТМО совместно с Харбинским инженерными университетом:

(1) разработали ИИ-модель MetaDiT для автоматического проектирования сверхтонкой оптики.
(2) опубликовали статью "MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface Design" на А*-конференции AAAI 2026.
(3) выложили открытый код;
(4) на днях выпустили пресс релиз.

Правда, для полноценной открытости кода в репозитории не хватает лицензии) Попробуем его обработать Осой, чтобы исправить это и поискать что ещё можно улучшить.

Статья: https://ojs.aaai.org/index.php/AAAI/article/view/37025
Код: https://github.com/JessePrince/metadit
СМИ: https://tass.ru/nauka/27872435
🔥12
Сбер выкатил новые опенсорс-модели - теперь со звуком:

1) Новая GigaChat Audio.
Audio-native LLM на базе GigaAM Multilingual и GigaChat3.1-10B-A1.8B. Поддерживает multi-turn диалог, классификацию аудио, перевод и распознавание речи, и temporal grounding (локализацию событий во времени), описание интервала аудио и суммаризацию с временными метками.

В комплекте идет датасет TimeGround-1M — для обучения LLM привязке событий ко времени.

📖 arXiv
🤗
ai-sage/GigaChat3.1-Audio-10B-A1.8B
🤗
ai-sage/TimeGround-1M

2) Обновление GigaAM Multilingual.
Расширение модели распознавания речи на казахский, киргизский, узбекский и английский.

📖 arXiv
🤗
ai-sage/GigaAM-Multilingual
👩‍💻 salute-developers/GigaAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥31
Объявлены репозитории-победители очередного опенсорс-конкурса KaiCode:

1) raprogramm/yew-nav-link 6★ - Вьетнам - Perfect $2048

А navigation-link library for the Yew framework in Rust with automatic active-state detection, demonstrated perfect software development practices: clean and idiomatic code, requirements captured as formal specifications and architecture decision records, strict static analysis (clippy, CodeQL, Scorecard, zizmor), mutation, fuzz, and property testing with enforced 95% coverage, an mdBook documentation site, semantic-versioned releases with a maintained changelog, protected branching, and exemplary REUSE-compliant licensing. Source files are small, meticulously documented, and every file carries SPDX headers.

2) ahoo-wang/wow 296★ - Китай - Excellent $1024

А reactive CQRS and Event-Sourcing microservice framework built on Domain-Driven Design, written in Kotlin, showed us an excellent codebase: clean, modular DDD/CQRS design, genuine multi-reviewer code review, Testcontainers-backed integration testing, enforced coverage thresholds and detekt static analysis, a bilingual documentation site, and a long history of semantic-versioned releases on Maven Central. However, issue labeling is inconsistent across recent tickets. 

3) choplogic/chop-logic-components 5★ - Сербия - Awesome $512

A library of reusable React components and hooks written in TypeScript, showed us awesome coding practices: conventions enforced by Biome, Prettier, commitlint, and Husky git hooks, mutation testing with Stryker on top of Codecov-tracked coverage, a Storybook gallery published as a documentation site, and semantic-versioned releases to npm with a maintained changelog. However, pull requests are self-merged by the sole author without review, and licensing stops at a single MIT file, with no SPDX headers in the sources

Всего принимало участие 153 проекта.
От нас тоже подавали, но не вышло.

Подача на следующий конкурс уже открыта.
👀2
Hugging Face и alphaXiv объявили соревнование по воспроизведению результатов научных статей с ICML 2026 - тема, на которую периодически пишем.

Из каждой статьи выделено несколько claims, корректность которых и нужно проверить.

Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми.

За участие организаторы предлагают GPU-кредиты на каждую статью (но их быстро разбирают) + отдельные призы от OpenResearch. Дедлайн - 2 августа.

P.S. Спс каналу Навука и моя жизнб за информирование, а то как-то мимо прошло)
🔥83
RAGU - на HuggingFace!

Сегодня мы выложили на HuggingFace препринт про открытый GraphRAG-фреймворк RAGU.

RAGU - это модульный GraphRAG-движок, который превращает сырой текст в граф знаний: извлекает сущности и связи, строит и чистит граф, а затем ищет ответы через локальные, глобальные или гибридные стратегии.

Этот проект сейчас разрабатывается совместно Лабораторией прикладных цифровых технологий НГУ (Иван Бондаренко) и Лабораторией автоматизированного мульти-агентного ИИ ИТМО (Николай Никитин). В разработке активно участвуют студенты обоих университетов.

В комплект фреймворка входит также новая компактная модель Meno-Lite-0.1 на 7B параметров (первое место на SemEval-2026 Task 8 MTRAG). В препринте, (сейчас он на рецензии на одной из A*-конференций), мы показали, что для построения качественного графа знаний не обязательно задействовать большие модели: наш 7B-экстрактор показывает результат лучше, чем Qwen2.5-32B на построении графов. Также, фреймворк недавно ставил одним из победителей конкурса Yandex Open Source.

Если говорить о конкретных цифрах:
RAGU достает до 84% релевантного контекста в медицинских бенчмарках (у конкурентов ≤76%). Мы обходим HippoRAG 2 на креативных задачах (59.0 против 56.9). При этом стоимость обработки — $0.001 за документ в сравнии с $0.10 у API-решений.

Как пользоваться RAGU:
Ставится одной командой pip install graph_ragu, работает на обычной потребительской видеокарте. Код открыт (MIT), веса — Apache 2.0.

Как поддержать:

Если разработка заинтересовала, то ее можно поддержать в Daily Papers на Huggingface, поставив upvote тут: https://huggingface.co/papers/2607.11683

Также, будет рады звездочкам на репозиторий: https://github.com/RaguTeam/RAGU

Если есть вопросы - пишите в комментариях или в Issues на GitHub.

P.S. Если хотите посмотреть, как всё работает:
2 минуты: базовая настройка и первый запуск
11 минут: глубокое погружение в конфигурации пайплайна
👍84💯1