Лаборатория Датаиста
168 subscribers
194 links
🤖 Обзор новых исследований в области искусственного интеллекта

👉 Основной канал: @andre_dataist
Download Telegram
Что происходит когда у ИИ-агента несколько пользователей

Что происходит, когда один ИИ-агент должен угодить сразу нескольким людям, у каждого — свои цели, права и запреты?

Исследователи показывают, что в командной среде модели путаются в приоритетах и нарушают приватность. Авторы предлагают системный взгляд на многопользовательских ИИ-агентов и проверяют современные LLM в стрессовых сценариях, где конфликт интересов неизбежен.

В этом обзоре разбираем, почему это уже не нишевая проблема, а один из главных вызовов для ИИ-агентов, и почему даже передовые модели плохо справляются с этой задачей.

📜 Полный обзор
👍3
Как ИИ-агенты учатся помнить через окружающий мир

Память ИИ, возможно, живёт не только внутри модели, но и буквально разбросана по окружающему миру.

Исследователи показывают, что агент может «запоминать» информацию через среду: некоторые наблюдаемые следы и артефакты снижают потребность во внутренней памяти и помогают принимать решения эффективнее.

В этом обзоре разбираем, как среда становится внешней памятью для ИИ-агентов и почему это может изменить подход к обучению с подкреплением.

📜 Полный обзор
Архитектура общей памяти агентов для программирования

Почему одни ИИ-агенты для программирования умнеют на опыте, а другие застревают на одной узкой задачи?

Исследователи предлагают смотреть на память не как на локальный архив под конкретный бенчмарк, а как на общий ресурс, который можно переносить между разными доменами, моделями и типами задач. Главное открытие в том, что лучше всего переносится не сырой код и не детальные трейсы, а абстрактные инсайты и метазнание — именно они реально прибавляют качество.

В этом обзоре разбираем, как устроена общая память агентов и почему уровень абстракции становится ключевым фактором переноса.

📜 Полный обзор
Разработка игр стала новым бенчмарком для ИИ-агентов

Писать код ИИ уже умеет довольно неплохо, но как только дело доходит до картинок, анимаций и игровой сцены, его способности дают слабину.

Именно поэтому разработка игр неожиданно становится новым полигоном для проверки агентов: здесь нужно не только разбираться в большом коде, но и понимать визуальный мир проекта. Авторы предлагают GameDevBench — первый бенчмарк для игровых задач, который показывает, насколько слабы сегодняшние мультимодальные агенты и как даже простая обратная связь через изображения и видео заметно поднимает результат.

В этом обзоре разбираем, почему именно геймдев может стать главным экзаменом для следующего поколения ИИ-агентов.

📜 Полный обзор
Модели мира для агентов нового поколения

От ИИ сегодня ждут, что он будет действовать, принимать решения и не разваливаться при столкновении с реальным миром.

Исследователи предлагают удобную карту «уровней и законов», которая показывает, чем отличается модель, умеющая предсказывать следующий шаг, от той, что способна симулировать целые миры и даже пересобирать собственное понимание мира, если оно дало сбой. Это важно, потому что без таких моделей агенты не смогут надежно работать ни в вебе, ни в науке, ни в среде с людьми и правилами.

В этом обзоре разбираем, как устроены модели мира, где они чаще всего ошибаются и почему именно сейчас это становится ключевой темой для ИИ нового поколения.

📜 Полный обзор
👍1
Как построить компанию из одного человека и ИИ-агентов

Мы привыкли думать об ИИ-агентах как о наборе полезных ассистентов, но настоящий предел их возможностей сегодня — не в их навыках, а в том, как они организованы в «компанию».

Авторы предлагают OneManCompany — модель, где один человек собирает вокруг себя команду ИИ-агентов, нанимает нужные роли по ходу работы, а сама система умеет планировать, выполнять задачи и пересматривать свои решения. Это важно, потому что речь уже не о статичном пайплайне, а о самоорганизующейся системе, которая может адаптироваться к новым задачам почти как живой бизнес.

В этом обзоре разбираем, как устроена компания из одного человека и ИИ-агентов — и почему именно такая архитектура может стать следующим шагом для мультиагентных систем.

📜 Полный обзор
2👍2
Для чего нужна рекурсивная мультиагентная система

Обычные мультиагентные системы быстро упираются в потолок: слишком много контекста, слишком медленная координация или слишком дорогие вычисления.

Авторы предлагают RecursiveMAS — подход, в котором агенты взаимодействуют не только через сообщения, а через общую рекурсивную «петлю» латентных состояний, что делает совместное рассуждение быстрее, дешевле и точнее. На практике это дает заметный прирост качества, ускорение инференса и резкое снижение расхода токенов на задачах от математики до генерации кода.

В этом обзоре разбираемся, зачем мультиагентным системам рекурсия и может ли именно она стать новой точкой масштабирования ИИ.

📜 Полный обзор
👍3🔥1
Почему агенты хуже учатся на длинных задачах

Чем длиннее задача для ИИ-агента, тем чаще он начинает сыпаться — и дело не только в слабых алгоритмах, а в самой длине цепочки действий.

Авторы показывают, что даже при одинаковой логике и правилах именно большой горизонт задачи становится узким местом обучения: ломает исследование среды, мешает связать действия с результатом и делает тренировку нестабильной. Выход, как ни странно, в сокращении горизонта: это не только улучшает обучение, но и помогает моделям потом лучше справляться с более длинными сценариями.

В этом обзоре разбираем, почему длинные задачи так сложны для агентов и что с этим можно сделать.

📜 Полный обзор
👍2
Что на самом деле делает мультиагентные системы умнее

Мультиагентные системы кажутся умнее просто потому, что вокруг модели навесили сложную оркестрацию, — но что, если дело совсем не в этом?

Исследователи утверждают: настоящий прирост даёт не внешняя обвязка над моделью, а внутренняя «тяжёлая мыслительная» способность модели — сначала параллельное рассуждение, затем сжатое обобщение. Это важно, потому что такой навык оказывается сильнее привычных подходов и даже может масштабироваться через обучение с подкрепление.

В этом обзоре разбираемся, что на самом деле делает мультиагентные системы умнее.

📜 Полный обзор
👍3🔥1
Синтетические компьютеры учат агентов работать неделями

Проблема ИИ-агентов уже не в том, чтобы нажать кнопку, а в том, чтобы неделями не терять контекст в чужом рабочем компьютере с папками, файлами и бесконечными задачами.

Исследователи предлагают строить масштабные синтетические компьютеры — с реалистичной структурой директорий, документами, таблицами и презентациями — и запускать в них длинные симуляции, где агенты месяцами по человеческим меркам учатся доводить сложную офисную работу до результата. Это важно, потому что именно такая среда приближает обучение ИИ к реальной продуктивности, а не к лабораторным прототипам.

В этом обзоре разбираем, как цифровые рабочие миры могут стать полигоном для следующего поколения агентных систем.

📜 Полный обзор
👍2🔥1
Как агентам делегировать задачи без потери контроля

Чем умнее ИИ-агенты, тем опаснее становится простая передача задач «на авось» — без ясных ролей, границ и ответственности контроль теряется в самый неудобный момент.

Исследователи предлагают адаптивную модель делегирования, где важны не только распределение работы, но и передача полномочий, доверие, подотчётность и способность перестраиваться при сбоях и изменениях среды. Это особенно важно для мира, где задачи будут выполнять цепочки из ИИ-агентов и людей, а ошибки одной операции могут стоить слишком дорого.

В этом обзоре разбираем, как делегировать агентам задачи без потери контроля.

📜 Полный обзор
👍2
Как ИИ-соавтор для математиков решает открытые задачи

Математика долго считалась последней территорией, где ИИ может лишь помогать по мелочи, но не думать рядом с человеком.

Теперь появляется формат ИИ-соавтора: он не просто считает и ищет статьи, а участвует в исследовательском процессе целиком — от гипотез и тупиков до доказательств и новых направлений. Это важно, потому что речь уже не о «умном калькуляторе», а о рабочей среде, которая помогает продвигаться в открытых задачах и даже находит упущенные идеи в литературе.

В этом обзоре разбираем, как устроен такой союз математика и машины и что он меняет в самой логике научного поиска.

📜 Полный обзор
2🔥1
Как графы знаний учат LLM меньше галлюцинировать

LLM до сих пор уверенно выдумывают факты — особенно там, где нужна точность, а не красивая формулировка.

Исследователи из Сбера предлагают лечить эту проблему не просто поиском по базе, а связкой модели с графом знаний и многошаговым, адаптивным поиском, который уточняет запрос на ходу и лучше держится за реальные сущности и связи. Такой подход заметно снижает галлюцинации и повышает точность ответов, причём даже на сравнительно компактных моделях.

В этом обзоре разбираем, как графы знаний становятся внешней опорой для LLM.

📜 Полный обзор
👍1
Как ИИ-агенты собирают презентации нового поколения с голосом, видео и интерактивом

Презентации больше не обязаны быть скучным набором слайдов — теперь ИИ собирает из запроса почти готовое выступление с голосом, видео и даже диалогом.

Разработчики показывают PresentAgent-2: систему, которая сама исследует тему, подбирает текст, изображения, GIF и видео, пишет сценарий и превращает всё это в полноценную мультимедийную презентацию. Особенно важно, что она умеет вести обсуждение и отвечать на вопросы по ходу, приближая формат к живому выступлению.

В этом обзоре разбираем, как презентации превращаются из статичных документов в интерактивный медиапродукт.

📜 Полный обзор
👍3
Почему код стал операционной системой для агентов

Код для ИИ-агентов стал их рабочей средой, памятью, инструментом и даже способом проверять самих себя.

Исследователи предлагают смотреть на код как на «операционную систему» агентных систем: через него агенты планируют, действуют, координируются и масштабируются от одиночных сценариев до команд из нескольких агентов. Это важно, потому что именно такой подход делает ИИ не только умнее, но и надежнее, проверяемее и полезнее в реальных задачах — от DevOps до научных исследований.

В этом обзоре разбираем, почему код становится главным каркасом новой агентной эпохи.

📜 Полный обзор
🔥1
Улучшать нужно не модель, а интерфейс агента

Когда LLM-агент плохо справляется с задачей, первая реакция обычно очевидна: дообучить модель, поменять промпт, взять LLM помощнее.

Но в детерминированных средах проблема часто находится не внутри модели, а между моделью и окружением — в runtime-интерфейсе, через который агент наблюдает, принимает решения и действует.

Авторы предлагают Life-Harness — обёртку над моделью, которая анализирует тренировочные траектории, находит повторяющиеся сбои и превращает их в переиспользуемые паттерны управления агентом. В результате метод дал в среднем +88,5% относительного прироста.

В обзоре разбираю, как устроен Life-Harness и почему для агентов иногда важнее проектировать обвязку вокруг модели, чем бесконечно улучшать саму модель.

📜 Полный обзор
👍1
Как улучшить ИИ-агента без новых данных

Когда ИИ-агент работает плохо, первое желание — собрать больше данных и дообучить модель. Но часто проблема не в самой модели, а в том, как организована её работа: как агент понимает задачу, выбирает инструменты, строит пайплайн, проверяет результат и принимает решения.

Исследователи показывают, что заметный прирост качества можно получить без нового датасета — за счёт перепроектирования структуры агента, маршрутизации задач и добавления проверяющих модулей. Таким образом слабые места агента часто находятся не в модели, а в архитектуре системы вокруг неё.

В обзоре разберём, какие изменения действительно дают эффект и как понять, что стоит править в агенте в первую очередь.

📜 Полный обзор
👍2
Проверять код ИИ стало труднее, чем писать

Проверять код, который пишет ИИ, внезапно стало сложнее, чем писать его самому.

Авторы показывают простую, но неприятную вещь: ИИ уже легко выдаёт много правдоподобных решений, а вот понять, сделал ли он именно то, что было нужно человеку, намного труднее. Обычные способы проверки часто смотрят лишь на внешние признаки и потому могут пропустить ошибку или засчитать удачным то, что просто хорошо выглядит. Поэтому главная задача теперь не только в том, чтобы ИИ писал код, а в том, чтобы проверка росла вместе с его возможностями.

В этом обзоре разбираем, почему любая проверка лишь приблизительно отражает замысел человека, как ИИ учится обходить слабые правила оценки и что поможет сделать проверку кода надёжнее.

📜 Полный обзор
4
Почему даже лучшие ИИ-агенты сильно отстают от людей

Почему даже сильные ИИ-агенты теряются там, где человеку нужно просто немного освоиться, запомнить важное и додумать план до конца?

Авторы предлагают новый способ проверки ИИ-агентов: их помещают в большие текстовые миры, где нужно не просто отвечать, а исследовать, учиться по ходу дела, запоминать прошлые события и идти к цели через длинную цепочку шагов. Это важно, потому что в жизни полезный ИИ должен уметь не только решать задачу в один момент, но и становиться лучше по мере опыта. Оказалось, что даже лучшие системы пока сильно уступают людям, хотя им заметно помогает умение держать в уме недавние события.

В этом обзоре разбираем, как именно проверяли ИИ-агентов, на каких задачах они чаще всего сыплются и почему до человеческой гибкости им ещё очень далеко.

📜 Полный обзор
👍2🔥1
Как ИИ научился читать мысли без имплантов

Оказывается, ИИ уже может довольно точно восстанавливать фразы по сигналам мозга — и для этого не нужно ничего вживлять в голову.

Авторы показали способ, который пытается понять, что человек собирается написать, по активности мозга, пока он набирает запомненную фразу на клавиатуре. Для этого они использовали безопасные методы считывания сигналов снаружи головы и обучили модель переводить эти сигналы в текст. Это важно, потому что такой подход может помочь людям, которые не могут говорить или двигаться, общаться без тяжёлой операции.

В этом обзоре разбираем, как именно ИИ превращает сигналы мозга в предложения, почему одни способы считывания работают лучше других и насколько близко мы подошли к безопасной связи между мозгом и компьютером.

📜 Полный обзор
🔥2
Путь к более общему ИИ лежит через модель мира

Похоже, путь к более общему ИИ лежит не в умении продолжать текст или картинку, а в попытке понять, как устроен сам мир.

Авторы предлагают модель, которая учится не отдельным задачам по кускам, а общему представлению о том, что происходит вокруг и как одно состояние мира переходит в другое. Для этого ей показывают и видео, и текстовые описания событий, чтобы она училась связывать увиденное, сказанное и возможные действия. Это важно, потому что такой подход может приблизить ИИ не просто к ответам по шаблону, а к более цельному пониманию происходящего.

В этом обзоре разбираем, как устроена такая модель мира, чему именно её учат и почему единое представление о мире может стать важным шагом к более общему ИИ.

📜 Читать полный обзор
3👍1