И продолжение:
• Task-Aware Bimanual Affordance Prediction via VLM-Guided Semantic-Geometric Reasoning (https://openreview.net/attachment?id=05Zf4KJrRn&name=pdf)
• Semantic–Geometric Task Representations for Bimanual Manipulation from Human Demonstrations to Robot Action Planning (https://openreview.net/attachment?id=R2I0asfyZT&name=pdf)
• Towards Task Planning for Proactive Safety in Home Service Robots: A Scene Graph-Augmented LLM Approach (https://openreview.net/attachment?id=juTZvTVQvT&name=pdf)
• PEACE: A Planner–Executor Agent with Constraint Enforcement for UAVs (https://openreview.net/attachment?id=inQPnS3D75&name=pdf)
• Energy-Based Action Heads Know When They Don’t Know (https://openreview.net/attachment?id=PF9lhBseXQ&name=pdf)
• M2H-MX: Multi-Task Semantic and Geometric Perception for Real-Time Monocular 3D Scene Graph Construction (https://openreview.net/attachment?id=KG9QYhLIBV&name=pdf)
• Uncertainty-Aware Symbolic State Monitoring with Vision-Language Models and Gaussian Naive Bayes (https://openreview.net/attachment?id=9vqwDyFhDX&name=pdf)
• From Obstacles to Etiquette: Robot Social Navigation with VLM-Informed Path Selection (https://openreview.net/attachment?id=gnpxmJ3S2j&name=pdf)
• LiftNav: Path Planning via Semantic Lifting in TSDF-Guided Gaussian Splatting (https://openreview.net/attachment?id=s6rxtvo20o&name=pdf)
• R5DGS: Semantic-Aware 4D Gaussian Splatting with Rigid Body Constraints for Efficient Dynamic Scene Reconstruction (https://openreview.net/attachment?id=LFHg6tcn7e&name=pdf)
• Tool-Augmented VLM Agents for Zero-Shot 3D Visual Grounding on Point Clouds (https://openreview.net/attachment?id=Ft2t57khSZ&name=pdf)
• LLM Tool Workflows for Robot Explainability and Natural Language Commanding (https://openreview.net/attachment?id=NUu9P1LwbT&name=pdf)
• Unified Point Cloud Corruption-Aware Reasoning Engine (https://openreview.net/attachment?id=63dSwa83gC&name=pdf)
• Where Did I Leave My Glasses? Open-Vocabulary Semantic Exploration in Real-World Semi-Static Environments (https://openreview.net/attachment?id=4SSJXzXnxM&name=pdf)
• Task-Aware Bimanual Affordance Prediction via VLM-Guided Semantic-Geometric Reasoning (https://openreview.net/attachment?id=05Zf4KJrRn&name=pdf)
• Semantic–Geometric Task Representations for Bimanual Manipulation from Human Demonstrations to Robot Action Planning (https://openreview.net/attachment?id=R2I0asfyZT&name=pdf)
• Towards Task Planning for Proactive Safety in Home Service Robots: A Scene Graph-Augmented LLM Approach (https://openreview.net/attachment?id=juTZvTVQvT&name=pdf)
• PEACE: A Planner–Executor Agent with Constraint Enforcement for UAVs (https://openreview.net/attachment?id=inQPnS3D75&name=pdf)
• Energy-Based Action Heads Know When They Don’t Know (https://openreview.net/attachment?id=PF9lhBseXQ&name=pdf)
• M2H-MX: Multi-Task Semantic and Geometric Perception for Real-Time Monocular 3D Scene Graph Construction (https://openreview.net/attachment?id=KG9QYhLIBV&name=pdf)
• Uncertainty-Aware Symbolic State Monitoring with Vision-Language Models and Gaussian Naive Bayes (https://openreview.net/attachment?id=9vqwDyFhDX&name=pdf)
• From Obstacles to Etiquette: Robot Social Navigation with VLM-Informed Path Selection (https://openreview.net/attachment?id=gnpxmJ3S2j&name=pdf)
• LiftNav: Path Planning via Semantic Lifting in TSDF-Guided Gaussian Splatting (https://openreview.net/attachment?id=s6rxtvo20o&name=pdf)
• R5DGS: Semantic-Aware 4D Gaussian Splatting with Rigid Body Constraints for Efficient Dynamic Scene Reconstruction (https://openreview.net/attachment?id=LFHg6tcn7e&name=pdf)
• Tool-Augmented VLM Agents for Zero-Shot 3D Visual Grounding on Point Clouds (https://openreview.net/attachment?id=Ft2t57khSZ&name=pdf)
• LLM Tool Workflows for Robot Explainability and Natural Language Commanding (https://openreview.net/attachment?id=NUu9P1LwbT&name=pdf)
• Unified Point Cloud Corruption-Aware Reasoning Engine (https://openreview.net/attachment?id=63dSwa83gC&name=pdf)
• Where Did I Leave My Glasses? Open-Vocabulary Semantic Exploration in Real-World Semi-Static Environments (https://openreview.net/attachment?id=4SSJXzXnxM&name=pdf)
🔥1
У нас радостная новость: +1 accept на IROS 🎉
На IROS 2026 приняли нашу статью с Чжаном, который сейчас работает в Shanghai AI Lab и собирается на повторную предзащиту кандидатской диссертации. Статья про бенчмаркинг различных симуляторов, в которых требуется работать с фотореалистичными и физически-правдоподобными средами с использованием GPU:
Huzhenyu Zhang, Shenghai Yuan, Wenrui Yan, LI MA, HengJie Li, Jing-Cheng Pang, Dmitry Yudin
GPUSimBench: Towards Scalable and Reliable GPU-Accelerated Simulators in Embodied AI
Немного подробностей об отборе статей из письма от организаторов:
#Papers #IROS
На IROS 2026 приняли нашу статью с Чжаном, который сейчас работает в Shanghai AI Lab и собирается на повторную предзащиту кандидатской диссертации. Статья про бенчмаркинг различных симуляторов, в которых требуется работать с фотореалистичными и физически-правдоподобными средами с использованием GPU:
Huzhenyu Zhang, Shenghai Yuan, Wenrui Yan, LI MA, HengJie Li, Jing-Cheng Pang, Dmitry Yudin
GPUSimBench: Towards Scalable and Reliable GPU-Accelerated Simulators in Embodied AI
Немного подробностей об отборе статей из письма от организаторов:
This year the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026) received 4,348 contributed paper submissions. From these papers, we accepted 1,585, which represents an acceptance rate of 36%.
Managed by the IROS Conference Paper Review Board, each contributed paper submission was reviewed by at least two reviewers before receiving a summary report from an Associate Editor and a final report from an Editor. Based on these reviews and reports, the Senior Program Committee made the final decisions.
#Papers #IROS
🔥8😁1
Команда Qwen представила набор фундаментальных моделей для управления роботами и их моделирования Qwen-Robot Suite .
Модели RobotNav, RobotManip и RobotWorld отвечают соответственно за навигацию, манипуляцию и моделирование физического мира.
Давайте пробовать!
#News
Модели RobotNav, RobotManip и RobotWorld отвечают соответственно за навигацию, манипуляцию и моделирование физического мира.
Давайте пробовать!
#News
❤3
Рассказали сегодня на семинаре про участие в конференции ICRA’2026, можно послушать и посмотреть в записи
Forwarded from Center for Cognitive Modeling
🎓 — Семинар 20. Обзор конференции ICRA 2026 | Александр Панов, Дмитрий Юдин, Дмитрий Макаров, Юлия Даник
В начале июня наша команда выезжала в Вену на ICRA 2026. Это крупнейшая в мире конференция по робототехнике и автоматизации.
На конференцию прошло 3 наших статьи:
Приходите послушать об этом мероприятии от первых лиц! Участники расскажут об интересных статьях, новых трендах и своих впечатлениях от поездки.
👉🏻 Дата: 18.06.26, пятница в 17:00
📹 Трансляция: YouTube или ВКонтакте
Подключайтесь к живому обсуждению и задавайте вопросы в прямом эфире! Ждем всех!
#семинары #robotics
В начале июня наша команда выезжала в Вену на ICRA 2026. Это крупнейшая в мире конференция по робототехнике и автоматизации.
На конференцию прошло 3 наших статьи:
1) Dynamic Neural Potential Field: Online Trajectory Optimization in Presence of Moving Obstacles — представляет метод нейросетевой генерации траекторий для объезда динамических препятствий в реальном времени
2) Knowledge-Guided Manipulation Using Multi-Task Reinforcement Learning — представляет метод, объединяющий 3D-сцену, граф знаний и обучение с подкреплением для управления манипуляциями робота
3) TOCALib: Optimal control library with interpolation for bimanual manipulation and obstacles avoidance — представляет библиотеку оптимального управления с интерполяцией для бимануальных манипуляторов и избегания препятствий
Приходите послушать об этом мероприятии от первых лиц! Участники расскажут об интересных статьях, новых трендах и своих впечатлениях от поездки.
👉🏻 Дата: 18.06.26, пятница в 17:00
📹 Трансляция: YouTube или ВКонтакте
Подключайтесь к живому обсуждению и задавайте вопросы в прямом эфире! Ждем всех!
#семинары #robotics
❤1
Про нашу работу DyGenc вышла новость на Cnews https://www.cnews.ru/news/line/2026-06-19_uchenye_nauchili_nejroset
#News
#News
❤1🔥1
Незаметно в этом месяце вышла SOTA модель детекции объектов на изображениях, работающая в реальном времени, YOLO26 от Ultralytics.
Статья: https://arxiv.org/abs/2606.03748
Код: https://github.com/ultralytics/ultralytics
Статья: https://arxiv.org/abs/2606.03748
Код: https://github.com/ultralytics/ultralytics
🔥2🤔1
Поучаствовал сегодня вместе с Дмитрием Ватолиным и Владиславом Шахуро в комиссии по защите магистерских дипломов в AI Talent Hub ИТМО по темам, связанным с индустриальным компьютерным зрением.
У меня такой вывод, что защищавшимся ребятам, работающим в ведущих российских IT-компаниях, совсем не хватило времени написать нормальные дипломные работы!
#Activities
У меня такой вывод, что защищавшимся ребятам, работающим в ведущих российских IT-компаниях, совсем не хватило времени написать нормальные дипломные работы!
#Activities
😁20💯2🤡1💔1
Forwarded from Physical AI & Robotics
MIT Press выпустило учебник Introduction to Autonomous Robots — и авторы выложили его бесплатно на GitHub под лицензией Creative Commons.
Книга рассчитана на студентов и разбирает автономных роботов «с земли»: кинематику, сенсоры, приводы, планирование движения, локализацию, компьютерное зрение и нейросети. Материал вырос из лекций четырёх профессоров Университета Колорадо в Боулдере.
Ссылка на книгу
#news #robots #ai #engineering #blippost
Книга рассчитана на студентов и разбирает автономных роботов «с земли»: кинематику, сенсоры, приводы, планирование движения, локализацию, компьютерное зрение и нейросети. Материал вырос из лекций четырёх профессоров Университета Колорадо в Боулдере.
Ссылка на книгу
#news #robots #ai #engineering #blippost
🔥6
Forwarded from Center for Cognitive Modeling
🎓 — Семинар 21. Защита магистерских диссертаций выпускников ЦКМ 2026
Ещё одна группа морских котиков ИИ готова к финальной миссии своего обучения — защите магистерской работы🏆
За два года мы постарались передать студентам самые актуальные и прикладные знания в области ИИ и робототехники, а ребята достигли больших успехов. Приглашаем всех присоединиться и послушать выступления!
📹 Трансляция ВК
#семинары #магистратура
Ещё одна группа морских котиков ИИ готова к финальной миссии своего обучения — защите магистерской работы
За два года мы постарались передать студентам самые актуальные и прикладные знания в области ИИ и робототехники, а ребята достигли больших успехов. Приглашаем всех присоединиться и послушать выступления!
📹 Трансляция ВК
#семинары #магистратура
Please open Telegram to view this post
VIEW IN TELEGRAM
Вышла VGGT Omega от Visual Geometry Group, University of Oxford и Meta AI - новая SOTA оценки карт глубин и поз камер по видео (CVPR 2026 Best Paper Finalist). Ну и это одно из самых кратких названий статей, которые я видел
Проект: https://vggt-omega.github.io/
Статья: VGGT-Ω https://arxiv.org/abs/2605.15195
Код: https://github.com/facebookresearch/vggt-omega
#Papers
Проект: https://vggt-omega.github.io/
Статья: VGGT-Ω https://arxiv.org/abs/2605.15195
Код: https://github.com/facebookresearch/vggt-omega
#Papers
🔥2
Про нашу работу MSSPlace и библиотеку OpenPlaceRecognition написали на портале Научная Россия https://scientificrussia.ru/articles/razrabotka-ucenyh-mfti-pozvolit-robotam-orientirovatsa-v-temnote-i-bez-sputnikovogo-signala
Сегодня целый день провел в Рязани - я приезжал туда чтобы поучаствовать в защите кандидатской диссертации Валентины Тарасовой в Рязанском государственном радио-техническом университете. Работа эта была про локализацию летательных аппаратов по спутниковым и аэрофотоснимкам. Нейросетевые модели помимо аналитических алгоритмов тоже использовались, что радует! Порадовала и реализация метода на встраиваемом бортовом вычислителе.
Также побывал в штаб-квартире компании Квантрон, которая в числе прочего делает собственные камеры и интегрирует нейросетевые модули на ПЛИС. Они и навыки антропоморфных роботов программируют, ну и собственных ИИ-агентов разрабатывают.
#Activities
Также побывал в штаб-квартире компании Квантрон, которая в числе прочего делает собственные камеры и интегрирует нейросетевые модули на ПЛИС. Они и навыки антропоморфных роботов программируют, ну и собственных ИИ-агентов разрабатывают.
#Activities
🔥8❤2
Исследователи из PKU, Thinghua, Astribot представлили на ICML 2026 модель управления роботами StableVLA, которая существенно менее чувствительна к шуму во входных изображениях за счет предложенного Information Bottleneck Adapter (IB-Adapter).
Статья: StableVLA: Towards Robust Vision-Language-Action Models without Extra Data https://arxiv.org/abs/2605.18287
Проект: https://dagroup-pku.github.io/StableVLA/
Код: https://github.com/DAGroup-PKU/HumanNet
Модель: https://huggingface.co/beikui12345/stablevla/tree/main
#References
Статья: StableVLA: Towards Robust Vision-Language-Action Models without Extra Data https://arxiv.org/abs/2605.18287
Проект: https://dagroup-pku.github.io/StableVLA/
Код: https://github.com/DAGroup-PKU/HumanNet
Модель: https://huggingface.co/beikui12345/stablevla/tree/main
#References
❤3