Лаборатория Датаиста
168 subscribers
193 links
🤖 Обзор новых исследований в области искусственного интеллекта

👉 Основной канал: @andre_dataist
Download Telegram
Как графы знаний учат LLM меньше галлюцинировать

LLM до сих пор уверенно выдумывают факты — особенно там, где нужна точность, а не красивая формулировка.

Исследователи из Сбера предлагают лечить эту проблему не просто поиском по базе, а связкой модели с графом знаний и многошаговым, адаптивным поиском, который уточняет запрос на ходу и лучше держится за реальные сущности и связи. Такой подход заметно снижает галлюцинации и повышает точность ответов, причём даже на сравнительно компактных моделях.

В этом обзоре разбираем, как графы знаний становятся внешней опорой для LLM.

📜 Полный обзор
👍1
Как ИИ-агенты собирают презентации нового поколения с голосом, видео и интерактивом

Презентации больше не обязаны быть скучным набором слайдов — теперь ИИ собирает из запроса почти готовое выступление с голосом, видео и даже диалогом.

Разработчики показывают PresentAgent-2: систему, которая сама исследует тему, подбирает текст, изображения, GIF и видео, пишет сценарий и превращает всё это в полноценную мультимедийную презентацию. Особенно важно, что она умеет вести обсуждение и отвечать на вопросы по ходу, приближая формат к живому выступлению.

В этом обзоре разбираем, как презентации превращаются из статичных документов в интерактивный медиапродукт.

📜 Полный обзор
👍3
Почему код стал операционной системой для агентов

Код для ИИ-агентов стал их рабочей средой, памятью, инструментом и даже способом проверять самих себя.

Исследователи предлагают смотреть на код как на «операционную систему» агентных систем: через него агенты планируют, действуют, координируются и масштабируются от одиночных сценариев до команд из нескольких агентов. Это важно, потому что именно такой подход делает ИИ не только умнее, но и надежнее, проверяемее и полезнее в реальных задачах — от DevOps до научных исследований.

В этом обзоре разбираем, почему код становится главным каркасом новой агентной эпохи.

📜 Полный обзор
🔥1
Улучшать нужно не модель, а интерфейс агента

Когда LLM-агент плохо справляется с задачей, первая реакция обычно очевидна: дообучить модель, поменять промпт, взять LLM помощнее.

Но в детерминированных средах проблема часто находится не внутри модели, а между моделью и окружением — в runtime-интерфейсе, через который агент наблюдает, принимает решения и действует.

Авторы предлагают Life-Harness — обёртку над моделью, которая анализирует тренировочные траектории, находит повторяющиеся сбои и превращает их в переиспользуемые паттерны управления агентом. В результате метод дал в среднем +88,5% относительного прироста.

В обзоре разбираю, как устроен Life-Harness и почему для агентов иногда важнее проектировать обвязку вокруг модели, чем бесконечно улучшать саму модель.

📜 Полный обзор
👍1
Как улучшить ИИ-агента без новых данных

Когда ИИ-агент работает плохо, первое желание — собрать больше данных и дообучить модель. Но часто проблема не в самой модели, а в том, как организована её работа: как агент понимает задачу, выбирает инструменты, строит пайплайн, проверяет результат и принимает решения.

Исследователи показывают, что заметный прирост качества можно получить без нового датасета — за счёт перепроектирования структуры агента, маршрутизации задач и добавления проверяющих модулей. Таким образом слабые места агента часто находятся не в модели, а в архитектуре системы вокруг неё.

В обзоре разберём, какие изменения действительно дают эффект и как понять, что стоит править в агенте в первую очередь.

📜 Полный обзор
👍2
Проверять код ИИ стало труднее, чем писать

Проверять код, который пишет ИИ, внезапно стало сложнее, чем писать его самому.

Авторы показывают простую, но неприятную вещь: ИИ уже легко выдаёт много правдоподобных решений, а вот понять, сделал ли он именно то, что было нужно человеку, намного труднее. Обычные способы проверки часто смотрят лишь на внешние признаки и потому могут пропустить ошибку или засчитать удачным то, что просто хорошо выглядит. Поэтому главная задача теперь не только в том, чтобы ИИ писал код, а в том, чтобы проверка росла вместе с его возможностями.

В этом обзоре разбираем, почему любая проверка лишь приблизительно отражает замысел человека, как ИИ учится обходить слабые правила оценки и что поможет сделать проверку кода надёжнее.

📜 Полный обзор
4
Почему даже лучшие ИИ-агенты сильно отстают от людей

Почему даже сильные ИИ-агенты теряются там, где человеку нужно просто немного освоиться, запомнить важное и додумать план до конца?

Авторы предлагают новый способ проверки ИИ-агентов: их помещают в большие текстовые миры, где нужно не просто отвечать, а исследовать, учиться по ходу дела, запоминать прошлые события и идти к цели через длинную цепочку шагов. Это важно, потому что в жизни полезный ИИ должен уметь не только решать задачу в один момент, но и становиться лучше по мере опыта. Оказалось, что даже лучшие системы пока сильно уступают людям, хотя им заметно помогает умение держать в уме недавние события.

В этом обзоре разбираем, как именно проверяли ИИ-агентов, на каких задачах они чаще всего сыплются и почему до человеческой гибкости им ещё очень далеко.

📜 Полный обзор
👍2🔥1
Как ИИ научился читать мысли без имплантов

Оказывается, ИИ уже может довольно точно восстанавливать фразы по сигналам мозга — и для этого не нужно ничего вживлять в голову.

Авторы показали способ, который пытается понять, что человек собирается написать, по активности мозга, пока он набирает запомненную фразу на клавиатуре. Для этого они использовали безопасные методы считывания сигналов снаружи головы и обучили модель переводить эти сигналы в текст. Это важно, потому что такой подход может помочь людям, которые не могут говорить или двигаться, общаться без тяжёлой операции.

В этом обзоре разбираем, как именно ИИ превращает сигналы мозга в предложения, почему одни способы считывания работают лучше других и насколько близко мы подошли к безопасной связи между мозгом и компьютером.

📜 Полный обзор
🔥2
Путь к более общему ИИ лежит через модель мира

Похоже, путь к более общему ИИ лежит не в умении продолжать текст или картинку, а в попытке понять, как устроен сам мир.

Авторы предлагают модель, которая учится не отдельным задачам по кускам, а общему представлению о том, что происходит вокруг и как одно состояние мира переходит в другое. Для этого ей показывают и видео, и текстовые описания событий, чтобы она училась связывать увиденное, сказанное и возможные действия. Это важно, потому что такой подход может приблизить ИИ не просто к ответам по шаблону, а к более цельному пониманию происходящего.

В этом обзоре разбираем, как устроена такая модель мира, чему именно её учат и почему единое представление о мире может стать важным шагом к более общему ИИ.

📜 Читать полный обзор
3👍1
Люди не узнают перевод ИИ, но доверяют человеку больше

ИИ уже переводит книги так хорошо, что читатель часто не может понять, кто сделал перевод — машина или человек.

Авторы сравнили отрывки из современных романов в двух версиях: одну переводил человек, другую делала модель, и дали их внимательным читателям. Оказалось, что перевод ИИ многим кажется вполне нормальным, но чаще люди всё же выбирают человеческий текст — он легче читается, звучит яснее и лучше затягивает в историю. При этом самое любопытное в том, что на глаз отличить один вариант от другого читателям очень трудно, а доверять они всё равно больше тому, что считают работой человека.

В этом обзоре разбираем, почему даже хороший перевод ИИ пока проигрывает по читательскому ощущению, как люди на самом деле оценивают литературный текст и что это говорит о будущем перевода книг.

📜 Читать полный обзор
Почему ИИ-агентам вредно давать слишком много инструментов сразу

Иногда ИИ-агенту мешает не нехватка возможностей, а их избыток.

Исследователи посмотрели, как на деле устроены связки между моделью и внешними сервисами, и выделили несколько повторяющихся способов сборки таких систем. Они также показали простую, но важную вещь: когда в одном окне у модели слишком много доступных действий, она начинает чаще ошибаться и хуже выбирает, что делать. Это важно, потому что сегодня многие стараются дать ИИ-агенту всё сразу, хотя для пользы ему часто нужен не максимум, а порядок и ясные границы.

В обзоре разберём, какие подходы к устройству таких систем уже сложились, какие типичные ошибки делают команды и почему слишком большой набор инструментов может вредить качеству работы.

📜 Читать полный обзор
👍1
Оказалось, память может быть важнее самого мышления

Для ИИ иногда важнее не лучше думать, а лучше помнить.

Исследователи предлагают учить модель не только решать задачу, но и самой разбираться со своей памятью: что сохранить, когда к этому вернуться и как разложить знания так, чтобы потом не потеряться. Для этого учёные дали ИИ возможность управлять своими записями и отдельно улучшали две вещи: как устроена сама память и насколько умело модель ею пользуется. В итоге даже без изменений в самом способе рассуждать ИИ начинает заметно лучше справляться с длинными и запутанными задачами.

В этом обзоре разбираем, почему умение обращаться с памятью можно развивать отдельно, как команда учит ИИ на его собственных удачных решениях и что это меняет для сложных задач, где ошибка может отозваться намного позже.

📜 Читать полный обзор
Как заставить ИИ-судью меньше ошибаться в сложных агентных задачах

Когда ИИ должен выбрать лучший ответ из нескольких, он нередко ошибается не потому, что плохо решает задачу, а потому, что плохо умеет проверять себя.

Исследователи предлагают смотреть на проверку ответа как на отдельную задачу и делать её не грубой, а более тонкой и внимательной. Вместо простого вердикта вроде «хорошо» или «плохо» модель даёт более плавную оценку, смотрит на ответ несколько раз и разбирает его по частям. За счёт этого ей проще отличать действительно сильные решения от тех, что только выглядят убедительно.

В обзоре разберём, как устроен такой способ проверки, почему он помогает ИИ-судье меньше промахиваться в сложных задачах и как его можно использовать для отбора лучших решений и отслеживания хода работы ИИ-агента.

📜 Полный обзор
🔥3👍1
Как сократить расходы на ИИ без потери качества

Мы привыкли думать, что сильные ИИ-агенты всегда стоят дороже, но часто деньги уходят не на саму модель, а на плохо устроенный процесс вокруг неё.

Оказывается, экономить можно не за счёт более слабой модели, а за счёт того, как именно ей дают задачу, какие данные подсовывают, когда подключают инструменты и сколько лишних шагов заставляют делать. Исследователи сравнили один и тот же набор задач на одних и тех же моделях, меняя только этот управляющий слой вокруг ИИ, и получили меньше расходов и более быструю работу без заметной потери качества.

В этом обзоре разбираем, как сэкономить на ИИ-агентах, не меняя саму модель, а только обвязку вокруг неё.

📜 Полный обзор
👍3
Почему ИИ-агенты пока не так автономны как кажутся

Мы всё чаще слышим про «автономных» ИИ-агентов, но на деле многие из них гораздо меньше похожи на самостоятельных помощников, чем кажется.

Исследователи предлагают честно разделить две вещи: системы, которые просто собраны из набора внешних шагов, и системы, которые действительно умеют сами выбирать ход мысли, держать цель, следить за своим поведением и учиться на опыте. Они объясняют, что настоящая самостоятельность не там, где ИИ красиво имитирует работу, а там, где ключевые части управления живут внутри самой модели, а не снаружи в виде заранее настроенной обвязки.

В этом обзоре разбираем, где проходит граница между автоматизацией и реальной самостоятельностью ИИ, из каких частей должен состоять по-настоящему автономный ИИ-агент и почему это меняет разговор о контроле и безопасности.

📜 Читать полный обзор
🔥4
Метапознание как следующий рубеж для LLM

Может ли ИИ не только отвечать, но и понимать, где он ошибается, чего не знает и как ему лучше думать дальше?

Авторы собрали большой обзор о том, что происходит, когда модель учат следить за собственными мыслями и шагами. Речь о способности не просто выдавать ответ, а замечать сомнения, проверять себя, выбирать более удачный путь решения и понятнее объяснять ход рассуждений. Такой подход помогает лучше понять, насколько ИИ надёжен в реальных задачах и где его уверенность может быть ложной.

В этом обзоре разбираем, как ИИ учат оценивать себя, проверять свои ответы, видеть пробелы в знаниях и зачем всё это нужно для более разумных и предсказуемых систем.

📜 Полная статья
🔥1
ИИ для смартфона и очков учится помнить жизнь

Что, если телефон или умные очки смогут не просто слушать и смотреть, а по-настоящему помнить куски вашей жизни?

Исследователи предлагают лёгкую систему памяти для ИИ-помощника, который живёт в смартфоне или очках и постепенно собирает то, что человек видел и слышал. Она раскладывает события по разным слоям памяти — что происходит сейчас, что было недавно и что случилось давно, — а потом достаёт нужное, когда вы спрашиваете, где лежит вещь, о чём был разговор или как обычно проходит ваш день.

В этом обзоре разбираем, как такой помощник учится помнить повседневную жизнь и как он находит нужный момент среди множества увиденного и услышанного.

📜 Полная статья
👍2🔥1
ИИ чинит код лучше, если сначала задаёт вопросы

ИИ лучше чинит чужой код, когда сначала не спешит с ответом, а задаёт правильные вопросы.

Исследователи предложили подход, в котором модель сначала разбирается в незнакомом проекте, а уже потом пытается исправить ошибку. Для этого одна часть системы задаёт точные вопросы о том, как устроен код, другая сама ищет ответы в файлах и собирает понятную картину, и только после этого модель пишет исправление. Так она реже додумывает наугад и чаще опирается на то, что действительно есть в проекте.

В обзоре разберём, как работает такой способ починки кода через вопросы и ответы и почему он помогает находить более точные исправления.

📜 Полный обзор
👍2
Что меняется, когда ИИ учится на собственном опыте

Обычно ИИ-агенту дают одну и ту же схему работы на все случаи, но новая идея в том, чтобы он учился перестраивать её по ходу дела.

Исследователи предлагают способ, при котором система запоминает, что у неё сработало, а что нет, и потом использует этот опыт в похожих задачах. Она может менять не только слова в запросе, но и сам порядок действий: что показать модели, когда дать ей доступ к инструментам, как хранить полезные выводы и как оформить ответ. Получается не жёсткая настройка на все времена, а более живая схема, которая подстраивается под конкретный случай.

В этом обзоре разбираем, как ИИ учится на собственных запусках, что именно он меняет в своей работе и почему такой подход может дать агентам больше гибкости без лишних подсказок извне.

📜 Полный обзор
👍2🔥1
Карта поведения помогает быстрее менять ИИ-агентов

Менять поведение ИИ-агента часто трудно не потому, что неясно как, а потому что непонятно где именно в коде это спрятано.

Исследователи предлагают карту поведения системы, которая автоматически показывает, какая часть кода за что отвечает. Вместо долгих поисков по файлам разработчик или другой ИИ-агент получает путь от общего описания нужного действия к тем местам, где это действие реально собрано из подсказок, состояний, инструментов и шагов работы. Это особенно помогает, когда нужная логика разбросана по разным частям проекта и не лежит в одном очевидном месте.

В обзоре разберём, как такая карта поведения помогает быстрее и точнее менять ИИ-агентов и почему главная проблема часто не в правке кода, а в поиске нужной точки для изменений.

📜 Полная статья
👍31
Что мешает ИИ нормально искать ответы в интернете

Почему ИИ так часто ходит по кругу, когда ищет ответ в интернете, и в итоге приносит не то, что нужно?

Исследователи предлагают устроить поиск так, чтобы ИИ не держал весь ход работы у себя «в голове», а записывал, что уже найдено, чего ещё не хватает и какие ходы уже ни к чему не привели. Тогда несколько ИИ-агентов могут работать как команда: один ищет факты, другой следит за пробелами, третий не даёт снова повторять бесполезные попытки. В итоге поиск становится не хаотичным набором запросов, а более собранной работой с понятным планом.

В обзоре разберём, почему ИИ застревает в веб-поиске, как ему предлагают дать общую «память» о ходе работы и за счёт чего такой подход помогает находить ответы полнее и аккуратнее.

📜 Полный обзор
3👍1