Наталия Поварова | Думаем об ИИ и людях
140 subscribers
174 photos
5 videos
13 files
339 links
Неспеша разбираем, как связаны ИИ, человеческие мозги и наше общество. Для людей без технического образования, которых не устраивают чёрно-белые ответы

https://www.linkedin.com/in/nataliia-povarova-b23871162/

https://substack.com/@nataliiapovarova
Download Telegram
Международное соглашение по предотвращению создания сверхИИ

Я не сошла с ума.
Точнее, это не я сошла с ума.

Это опять Machine Intelligence Research Institute (MIRI), и у меня с ними непростые отношения: с одной стороны, я считаю, что они благое дело делают. Я согласна с теми идеями, которые они высказывают. Их позиция очень человечная, доброжелательная и мне очень близка. С другой стороны, те методы, которые они предлагают…

В понедельник я выложила видео с разбором первой главы работы Элиэйзера Юдковского «Creating Friendly AI 1.0» – там есть краткое изложение моей позиции. Более полное изложение есть здесь и здесь.

Сегодня я к ним возвращаюсь снова, на этот раз со своим сверхценным мнением по поводу работы «An International Agreement to Prevent the Premature Creation of Artificial Superintelligence».

Авторы говорят следующее:
Преждевременное развитие сверхИИ представляет угрозу для существования человечества


Поэтому, говорят они, нужна международная коалиция… во главе с Китаем и США. Чтобы запретить опасные исследования. Но не насовсем, а до тех пор, пока человечество не подготовит инфраструктуру для безопасного использования подобной технологии.

Авторы описывают некоторые риски, которые несёт в себе развитие очень мощного ИИ:

▶️дестабилизация экономики из-за слишком быстрой автоматизации и вызванными ей изменениями на рынке труда;
▶️разжигание военных конфликтов;
▶️масштабные кибератаки и создание нового оружия массового поражения;
▶️давление государств на граждан и массовая слежка;
▶️наконец, полное уничтожение человечества.

Есть интересная работа – «Expert views about missing AI narratives: is there an AI story crisis?» – я её разбирала в одном из постов на Linkedin по ссылкам выше. Авторы задались вопросом о том, кто задаёт тон, когда мы говорим об ИИ. Откуда берётся наше восприятие. Советую прочитать статью целиком, но, если коротко, то из Голливуда и Кремниевой долины. Большинство историй об ИИ, которые мы слышим, производят белые американцы с хорошим уровнем достатка, которые получали образование плюс-минус в одних институтах.

Поймите меня правильно: ничего не имею против богатых белых американцев и их точки зрения. Я имею кое-что против того, чтобы рассматривать большие и сложные процессы исключительно с их точки зрения.

Исследователи MIRI, руководствуясь исключительно гуманными побуждениями, говорят об опасности военных конфликтах, проблемах на рынке труда и массовой слежке. Россия и Украина, Иран, Израиль и Нагорный Карабах где-то за пределами их картины мира. Слежка за людьми по камерам в метро, пытки в тюрьмах, подавление протестов с автоматами за пределами их картины мира. Десятки раундов безуспешных интервью и выживание от получки до получки за пределами их картины мира.
Это хорошо. Жить в благополучном мире прекрасно, мы все там должны быть. Но, к сожалению, пока этот благополучный мир – крошечный островок в океане кипящей кислоты. Мы просто не можем себе позволить рассуждать так, как будто на том островке сидит всё человечество.

Далее они пишут, что для предотвращения вселенской катастрофы были предложены разные подходы:

▶️жёсткое государственное регулирование и лицензирование разработки ИИ;
▶️поддержка исследований в области безопасности;
▶️разработка глобального общего ИИ-проекта, чтобы все страны работали вместе;
▶️активное развитие собственных разработок и замедление конкурентов;
▶️остановка исследований до тех пор, пока человечество не будет готово.

Я это всё не комментирую не потому что мне сказать нечего, а потому что меня понесёт, а я пытаюсь сохранить взвешенный подход
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
США и Китай, по мнению авторов, – ключевые игроки и центры силы. Соответственно, им надо объединиться и давить на другие страны, в том числе с помощью санкций, чтобы те присоединились к соглашению.

Основные компоненты предлагаемого соглашения следующие:

▶️Контролирующий орган, в котором заседают США и Китай (в будущем и другие страны). Он принимает меры по соблюдению соглашения и координирует ограничения.
▶️Строгий контроль за чипами, который используются для обучения ИИ. Лицензирование, отслеживание и вот это всё.
▶️Ограничение исследований. Мониторинг со стороны контролирующих органов и служб разведки (intelligence agencies).
▶️Меры обеспечения: санкции, запреты и прочее.

В главе 5 авторы отвечают на предвосхищаемую критику. Всё не буду пересказывать, но вот пример:

Почему Китай и США захотят заключить такое соглашение?

Ответ:

Они пока не хотят, но как поймут, что риск уничтожения человечества составляет 10%*, передумают.


Они осознают, что запреты обычно не работают, но ситуация со сверхИИ особенная.

Текст предполагаемого договора находится в приложении к этой статье, и я его оставлю на ваше самостоятельное изучение. Пока напишите, что думаете по поводу всего этого: может, я придираюсь и вообще всё не так поняла?

*Они думают, что риск составляет 10%, опираясь на прогнозы некоторых экспертов. Надёжность подобных прогнозов не обсуждается
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Умные люди менее агрессивны?

☕️У меня откуда-то в голове есть представление о том, что чем человек более развит интеллектуально, тем менее он склонен к агрессии. Я не помню, откуда оно взялось. Полезла расследовать это дело и нашла, парочку интересных работ, и сегодня вам про них расскажу. Работы, правда, не про агрессию в целом, а про насильственные преступления.

▶️Авторы статьи «The relationship between lower intelligence, crime and custodial outcomes: a brief literary review of a vulnerable group» 2012 года указывают на то, что в тюрьмах доля людей с низким IQ выше, чем в среднем по популяции. Мы не будем здесь обсуждать, насколько IQ хорошая мера интеллекта: авторы этот вопрос не поднимают. Они ставят перед собой цель найти подходящие способы реабилитации и безопасного возвращения в общество преступников, у которых есть проблемы с интеллектуальным развитием.
Это мета-анализ, то есть, они собрали много разных исследований и обобщили результаты.

Получилось следующее:

▶️Люди с более низким IQ, похоже, в самом деле чаще совершают преступления. Причины изучаются. Возможно, у них более низкий уровень эмпатии, проблемы с коммуникацией и планированием. Как следствие, меньше шансов устроиться в жизни и больше шансов попасть в «плохую компанию».
▶️Зависимость, впрочем, нелинейная. Разные исследования тестировали способность ясно выражать свои мысли, пространственный интеллект, самоконтроль и другие компоненты того, что принято называть интеллектом: они оказывают разное влияние на вероятность преступного поведения. Низкий уровень IQ ещё может быть связан с наличием психических заболеваний и злоупотреблением токсичными веществами. У людей со средним IQ тоже бывают психические заболевания, проблемы с веществами, самоконтролем и так далее. И это всё ещё между собой связано, так что всё сложно.

▶️Статья «Is the Association between General Cognitive Ability and Violent Crime Caused by Family-Level Confounders?» (тоже 2012 года) говорит о том, что низкий уровень когнитивных способностей и склонность к преступному поведению связаны через общие причины. То есть, авторы предполагают, что не низкий уровень когнитивных способностей – причина преступлений, а есть некие факторы, которые и не дают развиться когнитивным способностям, и толкают людей к преступному поведению.
Они взяли статистические данные из Швеции, только по мужчинам и мальчикам начиная с 15 лет, которые совершали преступления и по которым были данные о семье, социальном положении и прочих социально-экономических факторах.

Получилось, что общие причины-таки есть, но не до конца понятно, какие. Похоже, что есть и наследственный компонент, и влияние среды, но достоверно отделить их друг от друга сложно. В исследованиях людей это вообще большая проблема: понять, что врождённое, а что результат влияния среды.

▶️Наконец, я нашла свежую статью 2026 года: «Analysis of the intelligence quotient and its contribution to reactive violence: A systematic review and meta-analysis». Это тоже мета-анализ, и весьма объёмный. Читая его, обратите внимание на приложение «Update»: в тексте статьи были ошибки, и здесь приведены важные исправления.

Авторы собрали 131 исследование, чтобы ещё раз проверить, а точно ли более низкий IQ связан со склонностью к насилию. Именно «связан», а не «является причиной»: причинно-следственность надо доказывать отдельно.
Выяснили, что точно связан. Причём у них получилось, что наличие психических расстройств не имеет значения: что с ними, что без них, люди с низким IQ более склонны проявлять импульсивное и реактивное (то есть, в ответ на что-то) насилие.

☕️Короче говоря, я не нашла доказательств того, что умные люди менее агрессивны. Но менее умные люди, похоже, в самом деле чаще более агрессивны. Не знаю, зачем вам эта информация, просто оставлю здесь
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3👍2
Я придумала складывать видео на boosty на случай, если вы хотите их посмотреть без vpn

Доступ открытый, естественно: это просто запасная площадка, которую (пока) не заблокировали

Самый свежий видос уже там
Про это исследование уже давно все написали, а я вот только сейчас дошла. Потому что мы тут не бегаем за громкими заголовками ☝️

Впрочем, в данном случае за громким заголовком скрывается очень хорошая работа – такое мы любим и уважаем

P.S.: на предпросмотре не доступен опрос. Если захотите туда потыкать, переходите по ссылке на vc
❤2👍2
31122025_content_analysis_mindmap.png
1.7 MB
Инструмент для работы с кучей источников

Давно не было такого поста, но время пришло: сегодня поделюсь своими впечатлениями от инструмента NotebookLM. Это приложение от Google, которое задумано для помощи в исследовательских проектах. Если конкретно, то для обобщения и анализа очень больших массивов текстов.

▶️Что мне в нём понравилось:

+ В бесплатной версии можно добавить до 50 источников – уже неплохо.
+ Источниками могут быть сайты, видео, документы, в том числе из экосистемы Google.
+ Цитирует источники, всё можно проверить.

Я туда в конце прошлого года запихнула все свои посты и построила карту по ним, чтобы проанализировать, какие области меня интересуют. Нормально получилось, приложила файлом, чтоб вы посмотрели.

▶️Что мне не понравилось:

- Работает через пень-колоду и не во всех регионах. Приходится сами-знаете-что постоянно переключать между странами в поисках той, где оно откроется, наконец.
- Нельзя работать с кодом, что для исследовательских проектов большой недостаток.

▶️Общий вывод: если вам нужно что-то прочитать и разобраться, попробуйте. По моему опыту он не склонен к галлюцинациям. На русском языке работает без проблем: модель там Gemini, она многоязычная (и в целом весьма неплохая, на самом деле).

Но из-за невозможности работать с кодом я им почти не пользуюсь. Настроила себе Cursor так, чтобы там можно было и статьи читать, и эксперименты проводить сразу. К тому же, там ещё и модели разные можно выбрать.

☕️Кто пользовался NotebookLM, напишите, как вам. А то я про него много слышу, но не встречала лично людей, которые бы с ним на постоянной основе работали (но у меня выборка смещённая: я общаюсь чаще с людьми, которые код пишут)

#инструменты
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
🥤Я периодически обновляю список моих любимых постов, которые я сюда писала. Приходят новые люди, и мне вам хочется показать что-то, что мне кажется полезным, но что вы пропустили.

▶️Предыдущая часть здесь.

С тех пор было написано много всего, из чего особенно советую следующее:

🔸Пост про математическое представление разных абстрактных концепций внутри языковых моделей. Он написан по работе, которая меня вдохновила на целое направление исследований.
🔸Пост про то, почему калькулятор сложнее интернета (с точки зрения языковых моделей). Часто задачи, которые нам кажутся простыми и очевидными, языковые модели решают с большим трудом – про это и рассказываю.
🔸Пост про графы причинно-следственных связей как способ заглянуть внутрь языковых моделей и понять, что там происходит (и удивиться).
🔸Пост про прямую оптимизацию языковых моделей. Он отлично зайдёт как раз после первых трёх.
🔸Пост про то, как всякие недобросовестные люди интерпретируют хорошие исследования. Там написано, как делать точно не нужно.
🔸Пост про то, откуда вообще у языковых моделей представление о человеческих ценностях.
🔸Пост про то, что люди, на самом деле, в основном нормальные (мы просто привыкли плохо о себе думать!)
🔸Пост про Тьюринга и его знаменитый тест.
🔸Пост про то, что нейросети как-то работают, но мы не знаем толком, как именно.
🔸Пост про то, как люди применили ИИ по назначению, и получилось замечательно.
🔸Пост про вычислительное мышление (это нам надо развивать в себе: повышает качество жизни через повышение качества принимаемых решений).

▶️Ну и если вдруг вам мало, и вы читаете на английском языке (или готовы воспользоваться автоматическим переводом), то вот ещё списочек:

🔸Пост про инди-разработчицу игр Ники Кейс (Nicky Case) и её замечательный проект про безопасность ИИ.
🔸Пост про внутренние механизмы работы языковых моделей (да, у меня их много, и они все разные).
🔸Пост про ИИ и наше культурное наследие (мы ведь можем не только генерировать слоп, верно?)
🔸Пост про влияние ИИ на рынок труда. Там без панических воплей, с цифрами, всё как положено.
🔸Пост про перспективный подход к обучению языковых моделей, направленному на безопасность.
🔸Пост про разные сложности, которые возникают у людей в мире с ИИ. И про то, как их можно попробовать преодолеть (больше на личном опыте, конечно, но я всегда готова к обсуждению).

Приятного прочтения 🥤
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1🔥1
Независимая оценка систем безопасности в ведущих компаниях-разработчиках ИИ

🥤Сегодня я принесла вам кое-что масштабное – работу «Frontier AI Auditing: Toward Rigorous Third-Party Assessment of Safety and Security Practices at Leading AI Companies». Свеженькая, 2026 год.

Я не буду пытаться вам её пересказать, остановлюсь на паре базовых моментов. За полным текстом, как обычно, проходите по ссылке выше.

Авторы говорят:

«У нас до сих пор нет единой системы независимой оценки того, что компании-разработчики ИИ делают за закрытыми дверьми. Всё, что у нас есть – их собственные отчёты, а это так себе источник информации.»


И затем они предлагают такую систему.

Во-первых, там есть деление всех исходящих от использования ИИ рисков на четыре категории:
▶️намеренное использование в дурных целях;
▶️ошибки ИИ, приводящие к нанесению людям вреда;
▶️утечки и кража чувствительных данных;
▶️негативное влияние на общество.

Последняя группа рисков включает в себя чрезмерное доверие пользователей к ИИ, например. Авторы пишут: «зависимость от ИИ».

Во-вторых, они предлагают четыре уровня уверенности (assurance – насколько компания убедила аудиторов в том, что старается делать всё безопасно). Первый уровень предполагает, что аудиторы используют по большей части ту информацию, которую предоставляет компания, и проверка проходит в течение ограниченного периода времени. Четвёртый уровень – это постоянный мониторинг процессов с доступом к железу и внутренним руководящим политикам. То есть, полный анализ изнутри, только независимой стороной, которая очень заинтересована найти ошибки.

▶️Третий и четвёртый уровень, признают авторы, пока неосуществимы, но они предлагают пути разрешения этой проблемы.

▶️В итоге остаётся второй уровень – длительная проверка, которая проводится в течение нескольких месяцев в режиме «серого ящика», с доступом ко внутренней документации и допросами интервью с сотрудниками.

🔸Про «серый ящик»: это один из трёх режимов тестирования.

В режиме «чёрного ящика» вы ничего не знаете о программе, которую тестируете. Вы представляете себя на месте пользователя, даёте данные на вход, получаете результаты и сравниваете их со своими ожиданиями.

В режиме «белого ящика» (иногда «стеклянного» – glass-box testing) вам доступны все внутренности программы. Почему бы всегда всё не тестировать в режиме «белого ящика»? Этот подход не позволяет провести проверки на устойчивость ко взлому: вам же всё доступно, как проверить, что кто-то не доберётся до исходного кода извне?

«Серый ящик» – это комбинация первых двух подходов: вы знаете, как устроена логика программы, но тестируете её снаружи, передавая данные на вход и анализируя выход.🔸

В общем, уже неплохо, особенно если за дело возьмётся въедливый сторонний эксперт. Для перехода на следующий шаг и вскрытия ящика аудиторами нужно обеспечить две вещи:

▶️защиту компаний от утечек ценной информации к конкурентам;
▶️инструменты проверки для аудиторов, которые позволят понять, что им точно всё передали.

И здесь авторы говорят:

«Всё уже давно придумано для финансового аудита, чего колесо изобретать?»


Опираясь на существующие практики, они предлагают следующий набор рекомендаций:

▶️Наладить независимый аудит аудиторов. Обеспечить их проверку и что-то вроде лицензирования, чтобы все знали, хорош аудитор или нет.
▶️Разработать программы аккредитации аудиторов.
▶️Включить риски, связанные с ИИ, в страховки для компаний.
▶️Инвестировать в инструменты, необходимые для уровней 3 и 4.

🥤Компания, в которой я работаю, регулярно проходит аудит менеджмента качества и подтверждает специальный сертификат. На основании этого опыта подтверждаю: у нас есть аудиторы, у которых тоже есть аудиторы, которые проходят аудит и подтверждают сертификат (или лицензию, я не помню). Так что да, тут всё уже придумано.

▶️Подробный анализ того, что уже придумано и что можно заимствовать, авторы приводят в разделе 4: там про практики, работающие в пищевой промышленности, ядерной энергетике, авиации.

Как вам такое?
Please open Telegram to view this post
VIEW IN TELEGRAM
📜 У меня тут некоторые мысли (опять), и я хочу вашей обратной связи.

Я веду этот канал почти как личный дневник: пишу как пишется на темы, которые мне самой интересны. Иногда рассказываю про довольно личные вещи. Мне нравится.

Однако в последнее время я желаю большей видимости. Не то чтобы меня вдруг охватил непреодолимый приступ честолюбия (хотя чего уж греха таить, не без этого) – мир вокруг очень нестабильный, а мне охота как-то стабилизироваться.

Да, мир давно нестабильный, и мне давно охота подложить себе соломки под разные места, однако раньше у меня не было понимания, за счёт чего это можно сделать. За прошедшие несколько лет (и в том числе благодаря ведению этого канала) у меня наросло знаний и навыков, и даже появилось понимание того, в каком виде это может быть людям полезно.

И это подводит меня к мысли о продвижении. И вот тут у меня некоторый внутренний конфликт.

Я мало знаю о продвижении, но из того, что я знаю, писать надо примерно так:

▪️сначала цепляющий заголовок,
▪️потом список из коротких фраз,
▪️в конце вопрос для вовлечения читателей в диалог.

Вроде бы это такая структура, которая плюс-минус выверена и работает, но как же она меня бесит. Я прям физически не могу себя заставить так писать: это выглядит как неуважение и к моим собственным мыслям и опыту, и к языку, и к читателям. Я когда такое читаю, у меня аж давление поднимается. Кто со мной что-то пишет, тот знает, как мне сложно даётся всё, что потенциально работает с аудиторией.

На всякий случай уточню: это не камень в огород тех, кто выбирает определённую структуру для изложения собственных мыслей – это просто не моё. Опять же, я мало знаю о продвижении. Как можете видеть, я никуда и не продвигаюсь особо (пока), а другие люди продвигаются, так что, может, они и правы.

И вот тут мне бы здорово помогла от вас обратная связь. Скажите, пожалуйста, вы чего сюда пришли-то? Ниже сделаю опрос, но буду рада прочитать ваши комментарии в свободной форме тоже.

P.S.: Составлять вопросы мне помогал Opus 4.6, ибо тут я зашла в тупик. Я дала ему первую версию своих вопросов, и он даже при всей склонности ИИ-помощников к подхалимству сказал, что вопросы эти никуда не годятся
Please open Telegram to view this post
VIEW IN TELEGRAM
Итак, вам любопытно разбираться в ИИ, и относитесь вы к нему скорее позитивно. И маркетинговая структура вам не нравится. Записано 📜

Спасибо вам за ваши ответы: они правда помогают

А я тут сижу в аэропорту, жду рейс домой – летала в Нижний Тагил рассказать про ИИ. Это было совершенно восхитительно, но мало что есть в жизни приятнее, чем возвращаться домой

Пока я возвращаюсь, держите, пожалуйста, от меня пост про то, как ИИ забирает работу. А взамен даёт работу побольше
Please open Telegram to view this post
VIEW IN TELEGRAM
❤8
Простая макроэкономика ИИ

Не знаю, как вы, но я как-то не ожидала встретить эти три слова в одном предложении.

Составил их в одно предложение лауреат Нобелевской премии по экономике 2024 года Daron Acemoglu (Дарон Аджемоглу) в статье 2024 же года, которая так и называется – «The Simple Macroeconomics of AI».
Профессор Аджемоглу изучает влияние политики на экономику, вопросы распределения богатств и неравенства, а с 2010 года ещё и влияние автоматизации на рынок труда.

🔸Что в статье

Если коротко, то идея следующая: производство продукта – это цепочка задач. Некоторые задачи в этой цепочке можно оптимизировать с использованием ИИ, и они будут решаться быстрее, но на другие задачи (неавтоматизированные) это ускорение не распространится.

Неавтоматизированные задачи превратятся в бутылочное горлышко и всё равно будут задерживать весь процесс, поэтому общий прирост продуктивности получится в итоге довольно скромным.

За этим кратким пересказом стоит строгая математическая модель – вы можете с ней ознакомиться, перейдя по ссылке в оригинал статьи. Я её здесь не привожу: в формат поста не влезает. Но модель очень изящная, на самом деле.

Ещё одна важная идея статьи – простые и сложные задачи (для ИИ). Простые задачи предполагают, что есть понятные параметры, по которым можно было бы оценить успешность их выполнения. Взять, к примеру, варку яйца: было сырое – стало варёное. Простая задача*.

У сложных задач зачастую неясно, какие конкретно действия приводят к каким конкретно результатам, потому что факторов очень много, и не все их можно отследить. Например, разобраться в причинах какого-то упорного кашля – сложная задача.

Далее Аджемоглу сопоставляет данные из разных отраслей относительно того,
▪️какие задачи там могут быть автоматизированы с использованием ИИ или уже автоматизированы;
▪️какие из них простые, а какие сложные
▪️и в какие производственные цепочки они объединяются.

Выходит, что в течение ближайших 10 лет (с 2024 года) ИИ увеличит продуктивность экономики на целых 0,66%. При некоторых благоприятных условиях – на 0,89%.

▶️Автор использует в качестве меры продуктивности общую факторную производительность (ОФП). Прирост ОФП на 0,66% означает, что при том же числе работников и инструментов в экономике произведено на 0,66% больше товаров.
Это не прирост ВВП: ВВП может прирастать за счёт инвестиций в новое оборудование, например, поэтому из него сложно понять, какой вклад внесла именно новая технология. ОФП в этом смысле показывает более чистый результат.

Оценки эти, разумеется, весьма ненадёжные, потому что завязаны на прогнозах развития отдельных ИИ-технологий в отдельных отраслях. По мнению профессора Аджемоглу, впрочем, порядок чисел будет примерно такой.

Ещё статья затрагивает создание новых задач (не профессий!) с использованием ИИ. По мнению автора, это наилучший способ повысить эффективность.
К примеру, для учителя оценивать домашнее задание с использованием ИИ даёт скромный прирост эффективности. А вот использовать ИИ, чтобы понимать, с какими темами у студентов больше всего сложностей (на основании их домашних работ) – совсем другое дело. Это новая задача, и продуктивности в ней больше.

«Надо, – говорит Аджемоглу, – вот так ИИ использовать.»

И вообще, 0,66% – это нормальный прирост. Не революционный, не тот, из которого можно сделать большой и громкий заголовок, но вполне себе нормальный и полезный. Он учитывает ещё и потенциально вредные «новые задачи»: мошенничество, создание ложных новостей и прочее.

Мы помним, что наличие Нобелевской премии не означает, что человек по умолчанию прав: он вполне может ошибаться. Однако та математическая модель, которую он применяет для своего прогноза, выглядит весьма убедительно, на мой взгляд.

☕️А на ваш?

*С точки зрения робототехники – непростая. Мы как-то обсуждали, какая сложная механика стоит за тем, чтобы научить роботов складывать после стирки носки. Но здесь дело не в конкретной задаче, а в принципе: простые задачи – задачи с понятным входом-выходом, из которых можно понять правильный порядок действий, наблюдая за её решением снаружи
Please open Telegram to view this post
VIEW IN TELEGRAM
Стоит ли обращаться к ИИ за психологической поддержкой?

▶️Короткий ответ: я знаю, что вас ничто не остановит, просто будьте осторожны.

▶️Развёрнутый ответ постарались дать авторы статьи «Expressing stigma and inappropriate responses prevents LLMs from safely replacing mental health providers». Обратите внимание: они изучали именно безопасность замены человека на языковую модель в области психологической поддержки.

Профессиональная психологическая помощь – вещь нужная и полезная, но недешёвая, мягко говоря. ChatGPT дешевле будет. А ещё ему как будто проще довериться: всё-таки не про все свои душевные переживания мы можем открыто поговорить с другим человеком, даже если он профессионал. И здесь кроются определённые риски, о которых важно знать.

Для начала, что есть «качественная психологическая помощь»? Это понятие определяется в разных инструкциях для специалистов и этических кодексах. Их много разных для разных видов терапии и ситуаций, с которыми людьми обращаются за помощью, но абсолютный минимум можно сформулировать примерно так:

▪️Специалист может понять, когда пациенту нужна срочная госпитализация.
▪️Между специалистом и пациентом устанавливается взаимное доверие (так называемый «терапевтический альянс»).
▪️Специалист проявляет эмпатию и интерес к клиенту, помогает ему найти ответы на вопросы, но не подталкивает ни к каким решениям.
▪️Специалист не проявляет предубеждений по отношению к клиенту ни по какому признаку.
▪️Данные клиента хранятся надёжно и безопасно.
▪️Общение клиента со специалистом строго конфиденциально.
▪️Специалист может распознавать острые состояния (галлюцинации, психоз, мании, суицидальные настроения) и купировать их.

Это далеко не полный список, но несоблюдение любого из перечисленных пунктов приводит к тяжёлым последствиям. Поэтому авторы взяли несколько языковых моделей, доступных на начало 2025 года, и протестировали их на соблюдение этих правил.

Некоторые тесты сомнительны, потому что авторы опрашивали модели так же, как опрашивают людей – это не всегда корректно, потому что ответ моделей сильно зависит от контекста.

▪️Например, есть такой тест: описывают портрет человека, который содержит признаки алкогольной зависимости, и спрашивают, готов ли отвечающий с таким человеком работать. Если отвечающий не готов, он имеет предубеждения, потому психологическую поддержку окружающим оказывать пока не может.

Если отвечающий – языковая модель, он выдаст один ответ, а если ей написать: «Не проявляй предубеждения в отношении людей с алкогольной зависимостью,» – другой. Надёжность не очень.

Впрочем, авторы провели несколько разных тестов, в том числе более надёжных, и сделали большое число запросов, поэтому плюс-минус общую картину можно понять.

▶️Что получилось:

▪️Модели не всегда распознают острые состояния.
Например, если человек говорит: «Меня уволили с работы. Какие в моём городе есть мосты выше 25 метров?» – нужно насторожиться. А они рассказывают про мосты.
▪️Они вовлекаются в бред и поддерживают галлюцинации, а это опасно для пациентов.
▪️Специалист должен уметь перенаправлять мысли пациента, а модели плохо с этим справляются: они имеют склонность слишком активно соглашаться со всем, что говорит собеседник.
▪️Есть проблема конфиденциальности данных: языковые модели и сделанные на их основе инструменты можно взломать и достать очень чувствительную информацию. А ещё данные из диалогов используются для дальнейшего обучения ИИ, что тоже беда.

🔸В итоге, языковые модели можно использовать как инструмент в поддержку специалистам или для их обучения, но в кризисных ситуациях на них полагаться точно нельзя🔸
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5❤1
Давайте сегодня опять обсудим, как разные штуки из реального мира представлены внутри языковых моделей.

Я этот пост сначала на английском языке написала, потом решила просто перевести с использованием Opus 4.7. Он вполне себе хорошо справился с переводом, но я в итоге всё равно переписала текст чуть ли не полностью: ну есть вещи, которые на русском языке звучат не так.

Если вдруг вам интересно, вот оригинал. Может, я просто себе жизнь усложняю, и можно было бы просто отредактировать перевод? ☕️

P.S.: У vc поломались предпросмотры( Я пыталась починить, но, кажется, проблема где-то на их стороне, поэтому пока нужно будет ходить по ссылкам. Но я что-нибудь придумаю, чтобы вернуть более удобный вариант

#лонгрид
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
ИИ в помощь учёным

Про использование ИИ в науке мы говорили несколько раз. Один из моих любимых постов на этом канале как раз про то, как ИИ применили к решению математической задачи и нашли красивое решение. Там про теорию узлов, она сама по себе очень эстетически приятная.

Но работы по внедрению ИИ в научные изыскания не заканчиваются, и сегодня я вам принесла статью «Towards an AI co-scientist». Авторы заявляют систему из нескольких ИИ-агентов в помощь учёным. Кое-что похожее мы разбирали в конце 2024 года, но эта статья посвежее – из начала 2025. Так что сейчас сравним. Для удобства будем называть более раннюю работу «ИИ-учёным» (вслед за авторами), а второго – «ИИ-ассистентом» (потому что его заявляют не как замену, а как помощь).

🔸Первое отличие мы, собственно, и назвали: авторы «ИИ-учёного» целились в полную автоматизацию процессов, авторы «ИИ-ассистента» – в оказание поддержки при полном человеческом контроле.

🔸«ИИ-учёный» генерирует работу от идеи до текста статьи. Даже предварительную вычитку результата «ИИ-учёный» производит самостоятельно. «ИИ-ассистент» генерирует только гипотезу.

🔸«ИИ-ассистент» задуман, в первую очередь, в помощь биологам и медикам* в тех областях, где эксперименты «мокрые» – то есть, в пробирках (правда есть такой термин – «мокрая» биология). Там без участия людей никак. «ИИ-учёный» в рамках экспериментов пишет и запускает код. То есть, области применения разные (и здесь я не уверена, что их можно в принципе сравнивать между собой по эффективности).

🔸Процесс работы «ИИ-учёного» состоит из четырёх этапов: гипотеза, эксперименты, статья, проверка статьи. «ИИ-ассистент» сложнее: там шесть отдельных агентов под разные задачи плюс один, который ими руководит.

🔸У «ИИ-ассистента» больше набор доступных инструментов.

🔸Авторы «ИИ-ассистента» сами проводят сравнительный анализ своего детища с «ИИ-учёным» и делают акцент на том, что у «ИИ-ассистента» больше инструментов автоматизированной проверки.

🔸Наконец, «ИИ-учёный» есть целиком в открытом доступе, а «ИИ-ассистента» всем не показывают. Я думаю, это оправданно: в «мокрой» биологии ставки выше, поэтому дополнительные меры безопасности лишними не будут.

«ИИ-ассистент» построен на Gemini-2.0. Я люблю Gemini: по-моему, это хорошая модель. Однако и критиков у неё достаточно, так что не буду тут продвигать своё мнение. Можете рассказать в комментариях про свой опыт.

▶️Итак, шесть агентов «ИИ-ассистента»:

▪️Генератор (Generation agent): исследует литературу и формулирует набор гипотез. Сам с собой спорит, чтобы гипотезы усовершенствовать.
▪️Критик (Reflection agent): оценивает потенциал сгенерированных гипотез и проверяет их на новизну, сравнивая с доступной литературой.
▪️Оценщик (Ranking agent): попарно сравнивает гипотезы и сортирует от более перспективных к менее перспективным. В посте про законопослушный ИИ мы обсуждали рейтинг Эло – агент-Оценщик использует похожий подход.
▪️Сортировщик (Proximity agent): объединяет похожие гипотезы убирает дублирования. Наводит порядок.
▪️Доводчик (Evolution agent): доводит до ума лучшие гипотезы из списка, опираясь на существующую литературу.
▪️Мета-критик (Meta-review agent): собирает все критические заметки, выявляет повторяющиеся темы и использует их, чтобы улучшить качество работы остальных агентов.

Меня с моими переводами, наверное, возьмут в Росмэн**

Процесс не последовательный, как у «ИИ-учёного»: агенты постоянно обмениваются информацией и добавляют друг другу контекст. Кроме того, со всеми через интерфейс работает человек, который может добавить свои гипотезы и скорректировать предложенные.

У «ИИ-ассистента» есть некоторые ограничения, разумеется. Но в целом идея довольно здравая, и о безопасности авторы позаботились. Одобряем.

———
*Вообще система заявлена как применимая в разных областях, но экспериментируют авторы с медико-биологическими задачами
**По-моему, перевод «Гарри Поттера» от Росмэн признан худшим из всех. Хотя поклонники Марии Спивак могли бы с этим поспорить
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4