Как графы знаний учат LLM меньше галлюцинировать
LLM до сих пор уверенно выдумывают факты — особенно там, где нужна точность, а не красивая формулировка.
Исследователи из Сбера предлагают лечить эту проблему не просто поиском по базе, а связкой модели с графом знаний и многошаговым, адаптивным поиском, который уточняет запрос на ходу и лучше держится за реальные сущности и связи. Такой подход заметно снижает галлюцинации и повышает точность ответов, причём даже на сравнительно компактных моделях.
В этом обзоре разбираем, как графы знаний становятся внешней опорой для LLM.
📜 Полный обзор
LLM до сих пор уверенно выдумывают факты — особенно там, где нужна точность, а не красивая формулировка.
Исследователи из Сбера предлагают лечить эту проблему не просто поиском по базе, а связкой модели с графом знаний и многошаговым, адаптивным поиском, который уточняет запрос на ходу и лучше держится за реальные сущности и связи. Такой подход заметно снижает галлюцинации и повышает точность ответов, причём даже на сравнительно компактных моделях.
В этом обзоре разбираем, как графы знаний становятся внешней опорой для LLM.
📜 Полный обзор
Dataism Science Hub
Как графы знаний учат LLM меньше галлюцинировать
У больших языковых моделей есть странная суперсила: они умеют говорить так уверенно, что порой кажется — они точно знают. Проблема в том, что уверенность и знание — не одно и то же.
👍1
Как ИИ-агенты собирают презентации нового поколения с голосом, видео и интерактивом
Презентации больше не обязаны быть скучным набором слайдов — теперь ИИ собирает из запроса почти готовое выступление с голосом, видео и даже диалогом.
Разработчики показывают PresentAgent-2: систему, которая сама исследует тему, подбирает текст, изображения, GIF и видео, пишет сценарий и превращает всё это в полноценную мультимедийную презентацию. Особенно важно, что она умеет вести обсуждение и отвечать на вопросы по ходу, приближая формат к живому выступлению.
В этом обзоре разбираем, как презентации превращаются из статичных документов в интерактивный медиапродукт.
📜 Полный обзор
Презентации больше не обязаны быть скучным набором слайдов — теперь ИИ собирает из запроса почти готовое выступление с голосом, видео и даже диалогом.
Разработчики показывают PresentAgent-2: систему, которая сама исследует тему, подбирает текст, изображения, GIF и видео, пишет сценарий и превращает всё это в полноценную мультимедийную презентацию. Особенно важно, что она умеет вести обсуждение и отвечать на вопросы по ходу, приближая формат к живому выступлению.
В этом обзоре разбираем, как презентации превращаются из статичных документов в интерактивный медиапродукт.
📜 Полный обзор
Dataism Science Hub
Как ИИ-агенты собирают презентации нового поколения с голосом, видео и интерактивом
Генерация презентаций долго жила в довольно скучном режиме: есть документ, есть набор тезисов, модель превращает всё это в слайды. Полезно, но предсказуемо. Новая работа PresentAgent-2 пытается заметно поднять планку.
👍3
Почему код стал операционной системой для агентов
Код для ИИ-агентов стал их рабочей средой, памятью, инструментом и даже способом проверять самих себя.
Исследователи предлагают смотреть на код как на «операционную систему» агентных систем: через него агенты планируют, действуют, координируются и масштабируются от одиночных сценариев до команд из нескольких агентов. Это важно, потому что именно такой подход делает ИИ не только умнее, но и надежнее, проверяемее и полезнее в реальных задачах — от DevOps до научных исследований.
В этом обзоре разбираем, почему код становится главным каркасом новой агентной эпохи.
📜 Полный обзор
Код для ИИ-агентов стал их рабочей средой, памятью, инструментом и даже способом проверять самих себя.
Исследователи предлагают смотреть на код как на «операционную систему» агентных систем: через него агенты планируют, действуют, координируются и масштабируются от одиночных сценариев до команд из нескольких агентов. Это важно, потому что именно такой подход делает ИИ не только умнее, но и надежнее, проверяемее и полезнее в реальных задачах — от DevOps до научных исследований.
В этом обзоре разбираем, почему код становится главным каркасом новой агентной эпохи.
📜 Полный обзор
Лаборатория Датаиста
Почему код стал операционной системой для агентов
Вокруг LLM уже сложился почти привычный сюжет: модель пишет код, чинит ошибки, вызывает инструменты, иногда даже проходит бенчмарки уровня хорошего стажёра.
🔥1
Улучшать нужно не модель, а интерфейс агента
Когда LLM-агент плохо справляется с задачей, первая реакция обычно очевидна: дообучить модель, поменять промпт, взять LLM помощнее.
Но в детерминированных средах проблема часто находится не внутри модели, а между моделью и окружением — в runtime-интерфейсе, через который агент наблюдает, принимает решения и действует.
Авторы предлагают Life-Harness — обёртку над моделью, которая анализирует тренировочные траектории, находит повторяющиеся сбои и превращает их в переиспользуемые паттерны управления агентом. В результате метод дал в среднем +88,5% относительного прироста.
В обзоре разбираю, как устроен Life-Harness и почему для агентов иногда важнее проектировать обвязку вокруг модели, чем бесконечно улучшать саму модель.
📜 Полный обзор
Когда LLM-агент плохо справляется с задачей, первая реакция обычно очевидна: дообучить модель, поменять промпт, взять LLM помощнее.
Но в детерминированных средах проблема часто находится не внутри модели, а между моделью и окружением — в runtime-интерфейсе, через который агент наблюдает, принимает решения и действует.
Авторы предлагают Life-Harness — обёртку над моделью, которая анализирует тренировочные траектории, находит повторяющиеся сбои и превращает их в переиспользуемые паттерны управления агентом. В результате метод дал в среднем +88,5% относительного прироста.
В обзоре разбираю, как устроен Life-Harness и почему для агентов иногда важнее проектировать обвязку вокруг модели, чем бесконечно улучшать саму модель.
📜 Полный обзор
Лаборатория Датаиста
Улучшать нужно не модель, а интерфейс агента
В гонке за более умными агентами на базе LLM мы почти автоматически думаем о привычных рычагах: взять модель побольше, докрутить файн-тюнинг, добавить RL, переписать инструкцию.
👍1
Как улучшить ИИ-агента без новых данных
Когда ИИ-агент работает плохо, первое желание — собрать больше данных и дообучить модель. Но часто проблема не в самой модели, а в том, как организована её работа: как агент понимает задачу, выбирает инструменты, строит пайплайн, проверяет результат и принимает решения.
Исследователи показывают, что заметный прирост качества можно получить без нового датасета — за счёт перепроектирования структуры агента, маршрутизации задач и добавления проверяющих модулей. Таким образом слабые места агента часто находятся не в модели, а в архитектуре системы вокруг неё.
В обзоре разберём, какие изменения действительно дают эффект и как понять, что стоит править в агенте в первую очередь.
📜 Полный обзор
Когда ИИ-агент работает плохо, первое желание — собрать больше данных и дообучить модель. Но часто проблема не в самой модели, а в том, как организована её работа: как агент понимает задачу, выбирает инструменты, строит пайплайн, проверяет результат и принимает решения.
Исследователи показывают, что заметный прирост качества можно получить без нового датасета — за счёт перепроектирования структуры агента, маршрутизации задач и добавления проверяющих модулей. Таким образом слабые места агента часто находятся не в модели, а в архитектуре системы вокруг неё.
В обзоре разберём, какие изменения действительно дают эффект и как понять, что стоит править в агенте в первую очередь.
📜 Полный обзор
Dataism Science Hub
Как улучшить ИИ-агента без новых данных
В ИИ-индустрии долгое время господствовала такая идея: если агент ошибается, значит, надо либо переписать промт, либо дообучить модель, либо надеяться на более мощную модель
👍2
Проверять код ИИ стало труднее, чем писать
Проверять код, который пишет ИИ, внезапно стало сложнее, чем писать его самому.
Авторы показывают простую, но неприятную вещь: ИИ уже легко выдаёт много правдоподобных решений, а вот понять, сделал ли он именно то, что было нужно человеку, намного труднее. Обычные способы проверки часто смотрят лишь на внешние признаки и потому могут пропустить ошибку или засчитать удачным то, что просто хорошо выглядит. Поэтому главная задача теперь не только в том, чтобы ИИ писал код, а в том, чтобы проверка росла вместе с его возможностями.
В этом обзоре разбираем, почему любая проверка лишь приблизительно отражает замысел человека, как ИИ учится обходить слабые правила оценки и что поможет сделать проверку кода надёжнее.
📜 Полный обзор
Проверять код, который пишет ИИ, внезапно стало сложнее, чем писать его самому.
Авторы показывают простую, но неприятную вещь: ИИ уже легко выдаёт много правдоподобных решений, а вот понять, сделал ли он именно то, что было нужно человеку, намного труднее. Обычные способы проверки часто смотрят лишь на внешние признаки и потому могут пропустить ошибку или засчитать удачным то, что просто хорошо выглядит. Поэтому главная задача теперь не только в том, чтобы ИИ писал код, а в том, чтобы проверка росла вместе с его возможностями.
В этом обзоре разбираем, почему любая проверка лишь приблизительно отражает замысел человека, как ИИ учится обходить слабые правила оценки и что поможет сделать проверку кода надёжнее.
📜 Полный обзор
Лаборатория Датаиста
Проверять код ИИ стало труднее, чем писать
Проверять код, который пишет ИИ, внезапно стало сложнее, чем писать его самому.
Авторы показывают простую, но неприятную вещь: ИИ уже легко выдаёт много правдоподобных решений, а вот понять, сделал ли он именно то, что было нужно человеку, намного труднее.…
Авторы показывают простую, но неприятную вещь: ИИ уже легко выдаёт много правдоподобных решений, а вот понять, сделал ли он именно то, что было нужно человеку, намного труднее.…
❤4
Почему даже лучшие ИИ-агенты сильно отстают от людей
Почему даже сильные ИИ-агенты теряются там, где человеку нужно просто немного освоиться, запомнить важное и додумать план до конца?
Авторы предлагают новый способ проверки ИИ-агентов: их помещают в большие текстовые миры, где нужно не просто отвечать, а исследовать, учиться по ходу дела, запоминать прошлые события и идти к цели через длинную цепочку шагов. Это важно, потому что в жизни полезный ИИ должен уметь не только решать задачу в один момент, но и становиться лучше по мере опыта. Оказалось, что даже лучшие системы пока сильно уступают людям, хотя им заметно помогает умение держать в уме недавние события.
В этом обзоре разбираем, как именно проверяли ИИ-агентов, на каких задачах они чаще всего сыплются и почему до человеческой гибкости им ещё очень далеко.
📜 Полный обзор
Почему даже сильные ИИ-агенты теряются там, где человеку нужно просто немного освоиться, запомнить важное и додумать план до конца?
Авторы предлагают новый способ проверки ИИ-агентов: их помещают в большие текстовые миры, где нужно не просто отвечать, а исследовать, учиться по ходу дела, запоминать прошлые события и идти к цели через длинную цепочку шагов. Это важно, потому что в жизни полезный ИИ должен уметь не только решать задачу в один момент, но и становиться лучше по мере опыта. Оказалось, что даже лучшие системы пока сильно уступают людям, хотя им заметно помогает умение держать в уме недавние события.
В этом обзоре разбираем, как именно проверяли ИИ-агентов, на каких задачах они чаще всего сыплются и почему до человеческой гибкости им ещё очень далеко.
📜 Полный обзор
Лаборатория Датаиста
Почему даже лучшие ИИ-агенты сильно отстают от людей
Почему даже сильные ИИ-агенты теряются там, где человеку нужно просто немного освоиться, запомнить важное и додумать план до конца?
Авторы предлагают новый способ проверки ИИ-агентов: их помещают в большие текстовые миры, где нужно не просто отвечать, а…
Авторы предлагают новый способ проверки ИИ-агентов: их помещают в большие текстовые миры, где нужно не просто отвечать, а…
👍2🔥1
Как ИИ научился читать мысли без имплантов
Оказывается, ИИ уже может довольно точно восстанавливать фразы по сигналам мозга — и для этого не нужно ничего вживлять в голову.
Авторы показали способ, который пытается понять, что человек собирается написать, по активности мозга, пока он набирает запомненную фразу на клавиатуре. Для этого они использовали безопасные методы считывания сигналов снаружи головы и обучили модель переводить эти сигналы в текст. Это важно, потому что такой подход может помочь людям, которые не могут говорить или двигаться, общаться без тяжёлой операции.
В этом обзоре разбираем, как именно ИИ превращает сигналы мозга в предложения, почему одни способы считывания работают лучше других и насколько близко мы подошли к безопасной связи между мозгом и компьютером.
📜 Полный обзор
Оказывается, ИИ уже может довольно точно восстанавливать фразы по сигналам мозга — и для этого не нужно ничего вживлять в голову.
Авторы показали способ, который пытается понять, что человек собирается написать, по активности мозга, пока он набирает запомненную фразу на клавиатуре. Для этого они использовали безопасные методы считывания сигналов снаружи головы и обучили модель переводить эти сигналы в текст. Это важно, потому что такой подход может помочь людям, которые не могут говорить или двигаться, общаться без тяжёлой операции.
В этом обзоре разбираем, как именно ИИ превращает сигналы мозга в предложения, почему одни способы считывания работают лучше других и насколько близко мы подошли к безопасной связи между мозгом и компьютером.
📜 Полный обзор
Лаборатория Датаиста
Как ИИ научился читать мысли без имплантов
Оказывается, ИИ уже может довольно точно восстанавливать фразы по сигналам мозга — и для этого не нужно ничего вживлять в голову.
Авторы показали способ, который пытается понять, что человек собирается написать, по активности мозга, пока он набирает запомненную…
Авторы показали способ, который пытается понять, что человек собирается написать, по активности мозга, пока он набирает запомненную…
🔥2
Путь к более общему ИИ лежит через модель мира
Похоже, путь к более общему ИИ лежит не в умении продолжать текст или картинку, а в попытке понять, как устроен сам мир.
Авторы предлагают модель, которая учится не отдельным задачам по кускам, а общему представлению о том, что происходит вокруг и как одно состояние мира переходит в другое. Для этого ей показывают и видео, и текстовые описания событий, чтобы она училась связывать увиденное, сказанное и возможные действия. Это важно, потому что такой подход может приблизить ИИ не просто к ответам по шаблону, а к более цельному пониманию происходящего.
В этом обзоре разбираем, как устроена такая модель мира, чему именно её учат и почему единое представление о мире может стать важным шагом к более общему ИИ.
📜 Читать полный обзор
Похоже, путь к более общему ИИ лежит не в умении продолжать текст или картинку, а в попытке понять, как устроен сам мир.
Авторы предлагают модель, которая учится не отдельным задачам по кускам, а общему представлению о том, что происходит вокруг и как одно состояние мира переходит в другое. Для этого ей показывают и видео, и текстовые описания событий, чтобы она училась связывать увиденное, сказанное и возможные действия. Это важно, потому что такой подход может приблизить ИИ не просто к ответам по шаблону, а к более цельному пониманию происходящего.
В этом обзоре разбираем, как устроена такая модель мира, чему именно её учат и почему единое представление о мире может стать важным шагом к более общему ИИ.
📜 Читать полный обзор
Лаборатория Датаиста
Путь к более общему ИИ лежит через модель мира
Похоже, путь к более общему ИИ лежит не в умении продолжать текст или картинку, а в попытке понять, как устроен сам мир.
Авторы предлагают модель, которая учится не отдельным задачам по кускам, а общему представлению о том, что происходит вокруг и как одно…
Авторы предлагают модель, которая учится не отдельным задачам по кускам, а общему представлению о том, что происходит вокруг и как одно…
❤3👍1
Люди не узнают перевод ИИ, но доверяют человеку больше
ИИ уже переводит книги так хорошо, что читатель часто не может понять, кто сделал перевод — машина или человек.
Авторы сравнили отрывки из современных романов в двух версиях: одну переводил человек, другую делала модель, и дали их внимательным читателям. Оказалось, что перевод ИИ многим кажется вполне нормальным, но чаще люди всё же выбирают человеческий текст — он легче читается, звучит яснее и лучше затягивает в историю. При этом самое любопытное в том, что на глаз отличить один вариант от другого читателям очень трудно, а доверять они всё равно больше тому, что считают работой человека.
В этом обзоре разбираем, почему даже хороший перевод ИИ пока проигрывает по читательскому ощущению, как люди на самом деле оценивают литературный текст и что это говорит о будущем перевода книг.
📜 Читать полный обзор
ИИ уже переводит книги так хорошо, что читатель часто не может понять, кто сделал перевод — машина или человек.
Авторы сравнили отрывки из современных романов в двух версиях: одну переводил человек, другую делала модель, и дали их внимательным читателям. Оказалось, что перевод ИИ многим кажется вполне нормальным, но чаще люди всё же выбирают человеческий текст — он легче читается, звучит яснее и лучше затягивает в историю. При этом самое любопытное в том, что на глаз отличить один вариант от другого читателям очень трудно, а доверять они всё равно больше тому, что считают работой человека.
В этом обзоре разбираем, почему даже хороший перевод ИИ пока проигрывает по читательскому ощущению, как люди на самом деле оценивают литературный текст и что это говорит о будущем перевода книг.
📜 Читать полный обзор
Лаборатория Датаиста
Люди не узнают перевод ИИ, но доверяют человеку больше
ИИ уже переводит книги так хорошо, что читатель часто не может понять, кто сделал перевод — машина или человек.
Авторы сравнили отрывки из современных романов в двух версиях: одну переводил человек, другую делала модель, и дали их внимательным читателям.…
Авторы сравнили отрывки из современных романов в двух версиях: одну переводил человек, другую делала модель, и дали их внимательным читателям.…
Почему ИИ-агентам вредно давать слишком много инструментов сразу
Иногда ИИ-агенту мешает не нехватка возможностей, а их избыток.
Исследователи посмотрели, как на деле устроены связки между моделью и внешними сервисами, и выделили несколько повторяющихся способов сборки таких систем. Они также показали простую, но важную вещь: когда в одном окне у модели слишком много доступных действий, она начинает чаще ошибаться и хуже выбирает, что делать. Это важно, потому что сегодня многие стараются дать ИИ-агенту всё сразу, хотя для пользы ему часто нужен не максимум, а порядок и ясные границы.
В обзоре разберём, какие подходы к устройству таких систем уже сложились, какие типичные ошибки делают команды и почему слишком большой набор инструментов может вредить качеству работы.
📜 Читать полный обзор
Иногда ИИ-агенту мешает не нехватка возможностей, а их избыток.
Исследователи посмотрели, как на деле устроены связки между моделью и внешними сервисами, и выделили несколько повторяющихся способов сборки таких систем. Они также показали простую, но важную вещь: когда в одном окне у модели слишком много доступных действий, она начинает чаще ошибаться и хуже выбирает, что делать. Это важно, потому что сегодня многие стараются дать ИИ-агенту всё сразу, хотя для пользы ему часто нужен не максимум, а порядок и ясные границы.
В обзоре разберём, какие подходы к устройству таких систем уже сложились, какие типичные ошибки делают команды и почему слишком большой набор инструментов может вредить качеству работы.
📜 Читать полный обзор
👍1
Оказалось, память может быть важнее самого мышления
Для ИИ иногда важнее не лучше думать, а лучше помнить.
Исследователи предлагают учить модель не только решать задачу, но и самой разбираться со своей памятью: что сохранить, когда к этому вернуться и как разложить знания так, чтобы потом не потеряться. Для этого учёные дали ИИ возможность управлять своими записями и отдельно улучшали две вещи: как устроена сама память и насколько умело модель ею пользуется. В итоге даже без изменений в самом способе рассуждать ИИ начинает заметно лучше справляться с длинными и запутанными задачами.
В этом обзоре разбираем, почему умение обращаться с памятью можно развивать отдельно, как команда учит ИИ на его собственных удачных решениях и что это меняет для сложных задач, где ошибка может отозваться намного позже.
📜 Читать полный обзор
Для ИИ иногда важнее не лучше думать, а лучше помнить.
Исследователи предлагают учить модель не только решать задачу, но и самой разбираться со своей памятью: что сохранить, когда к этому вернуться и как разложить знания так, чтобы потом не потеряться. Для этого учёные дали ИИ возможность управлять своими записями и отдельно улучшали две вещи: как устроена сама память и насколько умело модель ею пользуется. В итоге даже без изменений в самом способе рассуждать ИИ начинает заметно лучше справляться с длинными и запутанными задачами.
В этом обзоре разбираем, почему умение обращаться с памятью можно развивать отдельно, как команда учит ИИ на его собственных удачных решениях и что это меняет для сложных задач, где ошибка может отозваться намного позже.
📜 Читать полный обзор
Как заставить ИИ-судью меньше ошибаться в сложных агентных задачах
Когда ИИ должен выбрать лучший ответ из нескольких, он нередко ошибается не потому, что плохо решает задачу, а потому, что плохо умеет проверять себя.
Исследователи предлагают смотреть на проверку ответа как на отдельную задачу и делать её не грубой, а более тонкой и внимательной. Вместо простого вердикта вроде «хорошо» или «плохо» модель даёт более плавную оценку, смотрит на ответ несколько раз и разбирает его по частям. За счёт этого ей проще отличать действительно сильные решения от тех, что только выглядят убедительно.
В обзоре разберём, как устроен такой способ проверки, почему он помогает ИИ-судье меньше промахиваться в сложных задачах и как его можно использовать для отбора лучших решений и отслеживания хода работы ИИ-агента.
📜 Полный обзор
Когда ИИ должен выбрать лучший ответ из нескольких, он нередко ошибается не потому, что плохо решает задачу, а потому, что плохо умеет проверять себя.
Исследователи предлагают смотреть на проверку ответа как на отдельную задачу и делать её не грубой, а более тонкой и внимательной. Вместо простого вердикта вроде «хорошо» или «плохо» модель даёт более плавную оценку, смотрит на ответ несколько раз и разбирает его по частям. За счёт этого ей проще отличать действительно сильные решения от тех, что только выглядят убедительно.
В обзоре разберём, как устроен такой способ проверки, почему он помогает ИИ-судье меньше промахиваться в сложных задачах и как его можно использовать для отбора лучших решений и отслеживания хода работы ИИ-агента.
📜 Полный обзор
Лаборатория Датаиста
Как заставить ИИ-судью меньше ошибаться в сложных агентных задачах
Когда ИИ должен выбрать лучший ответ из нескольких, он нередко ошибается не потому, что плохо решает задачу, а потому, что плохо умеет проверять себя.
Исследователи предлагают смотреть на проверку ответа как на отдельную задачу и делать её не грубой, а более…
Исследователи предлагают смотреть на проверку ответа как на отдельную задачу и делать её не грубой, а более…
🔥3👍1
Как сократить расходы на ИИ без потери качества
Мы привыкли думать, что сильные ИИ-агенты всегда стоят дороже, но часто деньги уходят не на саму модель, а на плохо устроенный процесс вокруг неё.
Оказывается, экономить можно не за счёт более слабой модели, а за счёт того, как именно ей дают задачу, какие данные подсовывают, когда подключают инструменты и сколько лишних шагов заставляют делать. Исследователи сравнили один и тот же набор задач на одних и тех же моделях, меняя только этот управляющий слой вокруг ИИ, и получили меньше расходов и более быструю работу без заметной потери качества.
В этом обзоре разбираем, как сэкономить на ИИ-агентах, не меняя саму модель, а только обвязку вокруг неё.
📜 Полный обзор
Мы привыкли думать, что сильные ИИ-агенты всегда стоят дороже, но часто деньги уходят не на саму модель, а на плохо устроенный процесс вокруг неё.
Оказывается, экономить можно не за счёт более слабой модели, а за счёт того, как именно ей дают задачу, какие данные подсовывают, когда подключают инструменты и сколько лишних шагов заставляют делать. Исследователи сравнили один и тот же набор задач на одних и тех же моделях, меняя только этот управляющий слой вокруг ИИ, и получили меньше расходов и более быструю работу без заметной потери качества.
В этом обзоре разбираем, как сэкономить на ИИ-агентах, не меняя саму модель, а только обвязку вокруг неё.
📜 Полный обзор
Лаборатория Датаиста
Как сократить расходы на ИИ без потери качества
Мы привыкли думать, что сильный ИИ всегда стоит дороже, но часто деньги уходят не на ум модели, а на плохо устроенный процесс вокруг неё.
Авторы показывают простую мысль: экономить можно не за счёт более слабой модели, а за счёт того, как именно ей дают…
Авторы показывают простую мысль: экономить можно не за счёт более слабой модели, а за счёт того, как именно ей дают…
👍3
Почему ИИ-агенты пока не так автономны как кажутся
Мы всё чаще слышим про «автономных» ИИ-агентов, но на деле многие из них гораздо меньше похожи на самостоятельных помощников, чем кажется.
Исследователи предлагают честно разделить две вещи: системы, которые просто собраны из набора внешних шагов, и системы, которые действительно умеют сами выбирать ход мысли, держать цель, следить за своим поведением и учиться на опыте. Они объясняют, что настоящая самостоятельность не там, где ИИ красиво имитирует работу, а там, где ключевые части управления живут внутри самой модели, а не снаружи в виде заранее настроенной обвязки.
В этом обзоре разбираем, где проходит граница между автоматизацией и реальной самостоятельностью ИИ, из каких частей должен состоять по-настоящему автономный ИИ-агент и почему это меняет разговор о контроле и безопасности.
📜 Читать полный обзор
Мы всё чаще слышим про «автономных» ИИ-агентов, но на деле многие из них гораздо меньше похожи на самостоятельных помощников, чем кажется.
Исследователи предлагают честно разделить две вещи: системы, которые просто собраны из набора внешних шагов, и системы, которые действительно умеют сами выбирать ход мысли, держать цель, следить за своим поведением и учиться на опыте. Они объясняют, что настоящая самостоятельность не там, где ИИ красиво имитирует работу, а там, где ключевые части управления живут внутри самой модели, а не снаружи в виде заранее настроенной обвязки.
В этом обзоре разбираем, где проходит граница между автоматизацией и реальной самостоятельностью ИИ, из каких частей должен состоять по-настоящему автономный ИИ-агент и почему это меняет разговор о контроле и безопасности.
📜 Читать полный обзор
Лаборатория Датаиста
Почему ИИ-агенты пока не так автономны как кажутся
Мы всё чаще слышим про «автономных» ИИ-агентов, но на деле многие из них гораздо меньше похожи на самостоятельных помощников, чем кажется.
Исследователи предлагают честно разделить две вещи: системы, которые просто собраны из набора внешних шагов, и системы…
Исследователи предлагают честно разделить две вещи: системы, которые просто собраны из набора внешних шагов, и системы…
🔥4
Метапознание как следующий рубеж для LLM
Может ли ИИ не только отвечать, но и понимать, где он ошибается, чего не знает и как ему лучше думать дальше?
Авторы собрали большой обзор о том, что происходит, когда модель учат следить за собственными мыслями и шагами. Речь о способности не просто выдавать ответ, а замечать сомнения, проверять себя, выбирать более удачный путь решения и понятнее объяснять ход рассуждений. Такой подход помогает лучше понять, насколько ИИ надёжен в реальных задачах и где его уверенность может быть ложной.
В этом обзоре разбираем, как ИИ учат оценивать себя, проверять свои ответы, видеть пробелы в знаниях и зачем всё это нужно для более разумных и предсказуемых систем.
📜 Полная статья
Может ли ИИ не только отвечать, но и понимать, где он ошибается, чего не знает и как ему лучше думать дальше?
Авторы собрали большой обзор о том, что происходит, когда модель учат следить за собственными мыслями и шагами. Речь о способности не просто выдавать ответ, а замечать сомнения, проверять себя, выбирать более удачный путь решения и понятнее объяснять ход рассуждений. Такой подход помогает лучше понять, насколько ИИ надёжен в реальных задачах и где его уверенность может быть ложной.
В этом обзоре разбираем, как ИИ учат оценивать себя, проверять свои ответы, видеть пробелы в знаниях и зачем всё это нужно для более разумных и предсказуемых систем.
📜 Полная статья
Лаборатория Датаиста
Метапознание как следующий рубеж для LLM
Может ли ИИ не только отвечать, но и понимать, где он ошибается, чего не знает и как ему лучше думать дальше?
Авторы собрали большой обзор о том, что происходит, когда модель учат следить за собственными мыслями и шагами. Речь о способности не просто выдавать…
Авторы собрали большой обзор о том, что происходит, когда модель учат следить за собственными мыслями и шагами. Речь о способности не просто выдавать…
🔥1
ИИ для смартфона и очков учится помнить жизнь
Что, если телефон или умные очки смогут не просто слушать и смотреть, а по-настоящему помнить куски вашей жизни?
Исследователи предлагают лёгкую систему памяти для ИИ-помощника, который живёт в смартфоне или очках и постепенно собирает то, что человек видел и слышал. Она раскладывает события по разным слоям памяти — что происходит сейчас, что было недавно и что случилось давно, — а потом достаёт нужное, когда вы спрашиваете, где лежит вещь, о чём был разговор или как обычно проходит ваш день.
В этом обзоре разбираем, как такой помощник учится помнить повседневную жизнь и как он находит нужный момент среди множества увиденного и услышанного.
📜 Полная статья
Что, если телефон или умные очки смогут не просто слушать и смотреть, а по-настоящему помнить куски вашей жизни?
Исследователи предлагают лёгкую систему памяти для ИИ-помощника, который живёт в смартфоне или очках и постепенно собирает то, что человек видел и слышал. Она раскладывает события по разным слоям памяти — что происходит сейчас, что было недавно и что случилось давно, — а потом достаёт нужное, когда вы спрашиваете, где лежит вещь, о чём был разговор или как обычно проходит ваш день.
В этом обзоре разбираем, как такой помощник учится помнить повседневную жизнь и как он находит нужный момент среди множества увиденного и услышанного.
📜 Полная статья
Лаборатория Датаиста
ИИ для смартфона и очков учится помнить жизнь
Что, если телефон или умные очки смогут не просто слушать и смотреть, а по-настоящему помнить куски вашей жизни?
Исследователи предлагают лёгкую систему памяти для ИИ-помощника, который живёт в смартфоне или очках и постепенно собирает то, что человек видел…
Исследователи предлагают лёгкую систему памяти для ИИ-помощника, который живёт в смартфоне или очках и постепенно собирает то, что человек видел…
👍2🔥1
ИИ чинит код лучше, если сначала задаёт вопросы
ИИ лучше чинит чужой код, когда сначала не спешит с ответом, а задаёт правильные вопросы.
Исследователи предложили подход, в котором модель сначала разбирается в незнакомом проекте, а уже потом пытается исправить ошибку. Для этого одна часть системы задаёт точные вопросы о том, как устроен код, другая сама ищет ответы в файлах и собирает понятную картину, и только после этого модель пишет исправление. Так она реже додумывает наугад и чаще опирается на то, что действительно есть в проекте.
В обзоре разберём, как работает такой способ починки кода через вопросы и ответы и почему он помогает находить более точные исправления.
📜 Полный обзор
ИИ лучше чинит чужой код, когда сначала не спешит с ответом, а задаёт правильные вопросы.
Исследователи предложили подход, в котором модель сначала разбирается в незнакомом проекте, а уже потом пытается исправить ошибку. Для этого одна часть системы задаёт точные вопросы о том, как устроен код, другая сама ищет ответы в файлах и собирает понятную картину, и только после этого модель пишет исправление. Так она реже додумывает наугад и чаще опирается на то, что действительно есть в проекте.
В обзоре разберём, как работает такой способ починки кода через вопросы и ответы и почему он помогает находить более точные исправления.
📜 Полный обзор
Лаборатория Датаиста
ИИ чинит код лучше, если сначала задаёт вопросы
ИИ лучше чинит чужой код, когда сначала не спешит с ответом, а задаёт правильные вопросы.
Исследователи предложили подход, в котором модель сначала разбирается в незнакомом проекте, а уже потом пытается исправить ошибку. Для этого одна часть системы задаёт…
Исследователи предложили подход, в котором модель сначала разбирается в незнакомом проекте, а уже потом пытается исправить ошибку. Для этого одна часть системы задаёт…
👍2
Что меняется, когда ИИ учится на собственном опыте
Обычно ИИ-агенту дают одну и ту же схему работы на все случаи, но новая идея в том, чтобы он учился перестраивать её по ходу дела.
Исследователи предлагают способ, при котором система запоминает, что у неё сработало, а что нет, и потом использует этот опыт в похожих задачах. Она может менять не только слова в запросе, но и сам порядок действий: что показать модели, когда дать ей доступ к инструментам, как хранить полезные выводы и как оформить ответ. Получается не жёсткая настройка на все времена, а более живая схема, которая подстраивается под конкретный случай.
В этом обзоре разбираем, как ИИ учится на собственных запусках, что именно он меняет в своей работе и почему такой подход может дать агентам больше гибкости без лишних подсказок извне.
📜 Полный обзор
Обычно ИИ-агенту дают одну и ту же схему работы на все случаи, но новая идея в том, чтобы он учился перестраивать её по ходу дела.
Исследователи предлагают способ, при котором система запоминает, что у неё сработало, а что нет, и потом использует этот опыт в похожих задачах. Она может менять не только слова в запросе, но и сам порядок действий: что показать модели, когда дать ей доступ к инструментам, как хранить полезные выводы и как оформить ответ. Получается не жёсткая настройка на все времена, а более живая схема, которая подстраивается под конкретный случай.
В этом обзоре разбираем, как ИИ учится на собственных запусках, что именно он меняет в своей работе и почему такой подход может дать агентам больше гибкости без лишних подсказок извне.
📜 Полный обзор
Лаборатория Датаиста
Что меняется, когда ИИ учится на собственном опыте
Обычно ИИ-агенту дают одну и ту же схему работы на все случаи, но новая идея в том, чтобы он учился перестраивать её по ходу дела.
Исследователи предлагают способ, при котором система запоминает, что у неё сработало, а что нет, и потом использует этот опыт…
Исследователи предлагают способ, при котором система запоминает, что у неё сработало, а что нет, и потом использует этот опыт…
👍2🔥1
Карта поведения помогает быстрее менять ИИ-агентов
Менять поведение ИИ-агента часто трудно не потому, что неясно как, а потому что непонятно где именно в коде это спрятано.
Исследователи предлагают карту поведения системы, которая автоматически показывает, какая часть кода за что отвечает. Вместо долгих поисков по файлам разработчик или другой ИИ-агент получает путь от общего описания нужного действия к тем местам, где это действие реально собрано из подсказок, состояний, инструментов и шагов работы. Это особенно помогает, когда нужная логика разбросана по разным частям проекта и не лежит в одном очевидном месте.
В обзоре разберём, как такая карта поведения помогает быстрее и точнее менять ИИ-агентов и почему главная проблема часто не в правке кода, а в поиске нужной точки для изменений.
📜 Полная статья
Менять поведение ИИ-агента часто трудно не потому, что неясно как, а потому что непонятно где именно в коде это спрятано.
Исследователи предлагают карту поведения системы, которая автоматически показывает, какая часть кода за что отвечает. Вместо долгих поисков по файлам разработчик или другой ИИ-агент получает путь от общего описания нужного действия к тем местам, где это действие реально собрано из подсказок, состояний, инструментов и шагов работы. Это особенно помогает, когда нужная логика разбросана по разным частям проекта и не лежит в одном очевидном месте.
В обзоре разберём, как такая карта поведения помогает быстрее и точнее менять ИИ-агентов и почему главная проблема часто не в правке кода, а в поиске нужной точки для изменений.
📜 Полная статья
Лаборатория Датаиста
Карта поведения помогает быстрее менять ИИ-агентов
Менять поведение ИИ-агента часто трудно не потому, что неясно как, а потому что непонятно где именно в коде это спрятано.
Исследователи предлагают карту поведения системы, которая автоматически показывает, какая часть кода за что отвечает. Вместо долгих…
Исследователи предлагают карту поведения системы, которая автоматически показывает, какая часть кода за что отвечает. Вместо долгих…
👍3❤1
Что мешает ИИ нормально искать ответы в интернете
Почему ИИ так часто ходит по кругу, когда ищет ответ в интернете, и в итоге приносит не то, что нужно?
Исследователи предлагают устроить поиск так, чтобы ИИ не держал весь ход работы у себя «в голове», а записывал, что уже найдено, чего ещё не хватает и какие ходы уже ни к чему не привели. Тогда несколько ИИ-агентов могут работать как команда: один ищет факты, другой следит за пробелами, третий не даёт снова повторять бесполезные попытки. В итоге поиск становится не хаотичным набором запросов, а более собранной работой с понятным планом.
В обзоре разберём, почему ИИ застревает в веб-поиске, как ему предлагают дать общую «память» о ходе работы и за счёт чего такой подход помогает находить ответы полнее и аккуратнее.
📜 Полный обзор
Почему ИИ так часто ходит по кругу, когда ищет ответ в интернете, и в итоге приносит не то, что нужно?
Исследователи предлагают устроить поиск так, чтобы ИИ не держал весь ход работы у себя «в голове», а записывал, что уже найдено, чего ещё не хватает и какие ходы уже ни к чему не привели. Тогда несколько ИИ-агентов могут работать как команда: один ищет факты, другой следит за пробелами, третий не даёт снова повторять бесполезные попытки. В итоге поиск становится не хаотичным набором запросов, а более собранной работой с понятным планом.
В обзоре разберём, почему ИИ застревает в веб-поиске, как ему предлагают дать общую «память» о ходе работы и за счёт чего такой подход помогает находить ответы полнее и аккуратнее.
📜 Полный обзор
Лаборатория Датаиста
Что мешает ИИ нормально искать ответы в интернете
Почему ИИ так часто ходит по кругу, когда ищет ответ в интернете, и в итоге приносит не то, что нужно?
Исследователи предлагают устроить поиск так, чтобы ИИ не держал весь ход работы у себя «в голове», а записывал, что уже найдено, чего ещё не хватает и…
Исследователи предлагают устроить поиск так, чтобы ИИ не держал весь ход работы у себя «в голове», а записывал, что уже найдено, чего ещё не хватает и…
❤3👍1