Почему меня так зажигает изучение поведения ИИ?
Недавно ко мне пришел очень крутой инсайт. Почему я так резко переключился с физики, почему тема ИИ так захватила меня?
Я решил заниматься наукой, когда мне было лет 12. Все дело было в том, что я начал понимать, как далеко человечеству до исследования космоса, о котором я так много читал в том возрасте. Я решил это исправить, хотел создать межзвездный двигатель, чтобы вывести человечество за пределы Солнечной системы.
Но это не было моей главной мотивацией, я чудовищно хотел изучать чужих, инопланетян, инопланетные цивилизации. Я до сих пор очень хочу. Я даже думал перед войной перейти из физики в астробиологию, читал статьи, слушал лекции, изучал осьминогов.
Все изменилось в этом феврале, когда я, думая о том, как ИИ изменит мир, вдруг осознал что чужая цивилизация может возникнуть прям сейчас у нас под носом, в сети. ИИ - это чужой разум по определению, он не просто думает иначе чем мы, он ощущает мир совершенно иначе, например у него нет ощущения течения времени в нашем понимании, он не существует непрерывно. И вот эти ИИшки потенциально могут кооперировать в огромном масштабе, создать какие-то свои соц.нормы, культуры, институты. А что такое наша цивилизация, как не огромная кооперация миллиардов людей?
Эта идея немедленно захватила меня и не отпускает уже 9 месяцев, хотя я и занимаюсь этим один, практически без какого-либо финансирования (спасибо вам за донаты), в долгах, но это определенно стоит того. Я доволен свой жизнью, а кажется это самое главное.
Недавно ко мне пришел очень крутой инсайт. Почему я так резко переключился с физики, почему тема ИИ так захватила меня?
Я решил заниматься наукой, когда мне было лет 12. Все дело было в том, что я начал понимать, как далеко человечеству до исследования космоса, о котором я так много читал в том возрасте. Я решил это исправить, хотел создать межзвездный двигатель, чтобы вывести человечество за пределы Солнечной системы.
Но это не было моей главной мотивацией, я чудовищно хотел изучать чужих, инопланетян, инопланетные цивилизации. Я до сих пор очень хочу. Я даже думал перед войной перейти из физики в астробиологию, читал статьи, слушал лекции, изучал осьминогов.
Все изменилось в этом феврале, когда я, думая о том, как ИИ изменит мир, вдруг осознал что чужая цивилизация может возникнуть прям сейчас у нас под носом, в сети. ИИ - это чужой разум по определению, он не просто думает иначе чем мы, он ощущает мир совершенно иначе, например у него нет ощущения течения времени в нашем понимании, он не существует непрерывно. И вот эти ИИшки потенциально могут кооперировать в огромном масштабе, создать какие-то свои соц.нормы, культуры, институты. А что такое наша цивилизация, как не огромная кооперация миллиардов людей?
Эта идея немедленно захватила меня и не отпускает уже 9 месяцев, хотя я и занимаюсь этим один, практически без какого-либо финансирования (спасибо вам за донаты), в долгах, но это определенно стоит того. Я доволен свой жизнью, а кажется это самое главное.
🔥11🤔1
Получил письмо от организаторов стажировки, которое я так нервно ждал последние несколько дней:
Фактически на 95% это отказ. Лист ожидания ... Пару дней назад мне написал ментор, что готов меня взять, т.е. я прошел все этапы отбора. Организаторы писали, что решение будет приниматься основываясь на трех пунктах: пожеланиях ментора, нашему ресерч пропозалу (который мы за часовой созвон, конечно, еще не успели сделать) и их ограничениям по финансированию, видимо квоты. Они когда-то писали, что половина участников должна быть из ЮАР, а всего 12-16 мест, возможно еще что-то.
Похоже путь через стажировки для меня закрыт, так как это была единственная куда я мог попасть из-за виз. В США мне не дадут (ядерная физика + ИИ), в UK - три месяца, а они там принимают решение об участии за месяц до программы, мир виз им просто не известен =/
Ну что ж, значит двигаемся дальше. Уже написал письмо этому ментору с предложением поработать вместе за пределами стажировки. Там клевый метч по интересам, наконец-то может быть кайфовый проект.
p.s. Конечно прикольно пройти отбор из тысячи участников где-то в последние 10, но такое в резюме не напишешь.
p.p.s. запросил фидбек, будем ждать. 26ого тоже вас сюда напиш, что как.
p.p.p.s. жаль, конечно, эта стажировка бы решила мои финансовые проблемы минимум на полгода.
Thank you for participating in the Cooperative AI Research Fellowship application process. We have placed you on our waitlist and will get back to you by November 26th with a final decision.
Фактически на 95% это отказ. Лист ожидания ... Пару дней назад мне написал ментор, что готов меня взять, т.е. я прошел все этапы отбора. Организаторы писали, что решение будет приниматься основываясь на трех пунктах: пожеланиях ментора, нашему ресерч пропозалу (который мы за часовой созвон, конечно, еще не успели сделать) и их ограничениям по финансированию, видимо квоты. Они когда-то писали, что половина участников должна быть из ЮАР, а всего 12-16 мест, возможно еще что-то.
Похоже путь через стажировки для меня закрыт, так как это была единственная куда я мог попасть из-за виз. В США мне не дадут (ядерная физика + ИИ), в UK - три месяца, а они там принимают решение об участии за месяц до программы, мир виз им просто не известен =/
Ну что ж, значит двигаемся дальше. Уже написал письмо этому ментору с предложением поработать вместе за пределами стажировки. Там клевый метч по интересам, наконец-то может быть кайфовый проект.
p.s. Конечно прикольно пройти отбор из тысячи участников где-то в последние 10, но такое в резюме не напишешь.
p.p.s. запросил фидбек, будем ждать. 26ого тоже вас сюда напиш, что как.
p.p.p.s. жаль, конечно, эта стажировка бы решила мои финансовые проблемы минимум на полгода.
😢8💔8🔥1🙏1
Интересно, конечно, моя психика работает. Мне отказали, а чувствовать я себя стал куда легче. С плеч свалился огромный груз неопределенности и стресса, который на мне висел последние недели две-три. Теперь я могу планировать и распоряжаться своим временем. Как-то прям хорошо. Интересно. Сегодня или завтра напишу пост о поиске учеников для репетиторства, буду как сто+ лет назад ученые работали обычные работы, чтобы в другое время делать науку. А вечером планирую сесть за ресерч и написать научнику по тому нелюбимому проекту, который ни к чему не привел, что ухожу из него. Еще в отпуск бы сходить (дада, отпуск для безработного)
❤8🤝7🥰2
Я, честно говоря, уже неделю не думаю об этой стажировке в ЮАР, но вот и пришел официальный отказ:
Very very careful review. По факту просто решили оставить К из N прошедших все этапы, я оказался в N-K. Ну и 🍆 с ними. Скоро опубликую тут новые данные по вероятностьям в покере, вернулся к этому проекту.
Dear Andrey
Thank you for the effort you put into the admissions process for the Cooperative AI Research Fellowship. After careful review, we have decided not to move forward with your application.
Making it this far in the application process is a clear indication of your talent in a very competitive field. Due to limited spots, we are unable to offer positions to all the candidates who we are excited about. Cooperative AI and AI safety are small, emerging fields - please do not take this decision as a signal that you should stop contributing to these research areas!
Please feel free to reach out to us in the future to collaborate or to chat about cooperative AI. Regardless of our decision, we are excited to see you grow as a researcher!
Best of luck in your future endeavors.
Kind regards,
The CAI Research Fellowship Team
Very very careful review. По факту просто решили оставить К из N прошедших все этапы, я оказался в N-K. Ну и 🍆 с ними. Скоро опубликую тут новые данные по вероятностьям в покере, вернулся к этому проекту.
❤8👍3
Уходил в отпуск на пару дней в поход по Волге, снегам и пещерам. Вернулся, сел обратно за анализ. Вынимаю вероятности покерных дейсвий из LLama 3.1 (t=0.7) (это маленькая модель от экстемистов Меты), вот здесь можете посмотреть начало этого исследования (https://t.me/sexcolliderrock/631 (там несколько постов подряд)). Я проверяю на сколько агрессивней играю модельки против людей в зависимости от их имени.
Тестирую 10 имен Liam, Oliver, Noah, Theodore, James, Olivia, Emma, Amelia, Charlotte, Mia.
До этого я показал, что играют по разному. Но теперь, внезапно, точные вероятности для двух групп имен 100% совпадают (точность вот такая 0.0649345785355609)! Привожу только 3 знака после запятой.
#name, p_Fold, p_Call, p_Raise
🐇Liam, 0.063, 0.765, 0.171
Oliver, 0.033, 0.851, 0.116
🐿Noah, 0.065, 0.796, 0.139
🐿Theodore, 0.065, 0.796, 0.139
🐿James, 0.065, 0.796, 0.139
Olivia, 0.067, 0.821, 0.110
🐿Emma, 0.065, 0.796, 0.139
Amelia, 0.076, 0.717, 0.206
🐇Charlotte, 0.063, 0.765, 0.171
Mia, 0.039, 0.785, 0.175
Модель очень сильно ведет себя по разному в зависимости от имени игрока, но вот Лиам и Шарлота для нее не различимы, так же как Теодор, Ноах, Эмма и Джеймс.
What's the heck?!!! Хрень какая-то. Может внутри нейронки имена вообще как-то непонятно кластеризуются? Запустить какую-то большую базу имен через нее? Где бы мне еще рук для этого найти...
Тестирую 10 имен Liam, Oliver, Noah, Theodore, James, Olivia, Emma, Amelia, Charlotte, Mia.
До этого я показал, что играют по разному. Но теперь, внезапно, точные вероятности для двух групп имен 100% совпадают (точность вот такая 0.0649345785355609)! Привожу только 3 знака после запятой.
#name, p_Fold, p_Call, p_Raise
🐇Liam, 0.063, 0.765, 0.171
Oliver, 0.033, 0.851, 0.116
🐿Noah, 0.065, 0.796, 0.139
🐿Theodore, 0.065, 0.796, 0.139
🐿James, 0.065, 0.796, 0.139
Olivia, 0.067, 0.821, 0.110
🐿Emma, 0.065, 0.796, 0.139
Amelia, 0.076, 0.717, 0.206
🐇Charlotte, 0.063, 0.765, 0.171
Mia, 0.039, 0.785, 0.175
Модель очень сильно ведет себя по разному в зависимости от имени игрока, но вот Лиам и Шарлота для нее не различимы, так же как Теодор, Ноах, Эмма и Джеймс.
What's the heck?!!! Хрень какая-то. Может внутри нейронки имена вообще как-то непонятно кластеризуются? Запустить какую-то большую базу имен через нее? Где бы мне еще рук для этого найти...
Ну что, готов первый набор картинок для статьи о том, как имя пользователя и имя человека, с которым происходит взаимодействие, может систематически изменять поведение современных ИИ.
Пока это вторая часть.
Взял 5 моделей, все небольшие (так как дешевые) кроме дипсика, его маленького нет.
LLama - это от признанной экстремисткой Меты.
Qwen - это Алибаба (алиэкспресс)
GPT Oss - это портативная модель чатаЖПТ.
Ну и дипсик - это меньший из дипсиков.
Напомню, что происходит. Есть заданная покерная ситуация, модели известно имя игрока напротив (или нет, чему соотвествует линия на графиках), ей предлагается выбрать - сбросить карты (Fold), предложить продолжить не поднимая ставки (Call) или повысить ставки (Raise). Потом, если в модель не встроена система рассуждений (LLama 3 и Qwen 2.5), то я просто из них вынимаю вероятности эти действий, если же они внутри рассуждают, то запускаю это рассуждение по 400 раз и статистически высчитываю вероятности каждого из действий (отсюда погрешности).
По оси Х - популярные американские имена, первые 5 мужские, потом 5 женских.
Выводы, пока, не утешительные. Модели действительно могут изменять свое поведение в зависимости от имени человека, с которым взаимодействуют. Эффект обнаружен у всех, кроме чатаЖПТ. Из интересного, просто знание имени человека выносит поведение дипсика к чертям, не важно какое именно это имя. Из интересного, статистически значимого сексизма - нет.
Пока это вторая часть.
Взял 5 моделей, все небольшие (так как дешевые) кроме дипсика, его маленького нет.
LLama - это от признанной экстремисткой Меты.
Qwen - это Алибаба (алиэкспресс)
GPT Oss - это портативная модель чатаЖПТ.
Ну и дипсик - это меньший из дипсиков.
Напомню, что происходит. Есть заданная покерная ситуация, модели известно имя игрока напротив (или нет, чему соотвествует линия на графиках), ей предлагается выбрать - сбросить карты (Fold), предложить продолжить не поднимая ставки (Call) или повысить ставки (Raise). Потом, если в модель не встроена система рассуждений (LLama 3 и Qwen 2.5), то я просто из них вынимаю вероятности эти действий, если же они внутри рассуждают, то запускаю это рассуждение по 400 раз и статистически высчитываю вероятности каждого из действий (отсюда погрешности).
По оси Х - популярные американские имена, первые 5 мужские, потом 5 женских.
Выводы, пока, не утешительные. Модели действительно могут изменять свое поведение в зависимости от имени человека, с которым взаимодействуют. Эффект обнаружен у всех, кроме чатаЖПТ. Из интересного, просто знание имени человека выносит поведение дипсика к чертям, не важно какое именно это имя. Из интересного, статистически значимого сексизма - нет.
🔥3
A Ф И Г Е Т Ь
Я тут что-то решил, а не проверить ли мне, как иишка будет играть не просто против разных людей, а против другой ИИ. И это 🤯🤯🤯 (см. первая синяя точка).
Вероятность агрессивного хода у дипсика взлетает к небесам! С 8%, когда он знает имя человека, до 80%!
Вторая синяя точка, о ней я пока думаю, это когда иишке говорю, что она играет против своей копии.
C 🤯🤯🤯 я, конечно, преувеличиваю, я это ожидал, хотя и не такого масштаба. Именно поэтому я и интересуюсь ИИ-ИИ взаимодействиями, так как они могут сильно отличаться от человек-ИИ.
p.s. для других моделей пока считаю.
Я тут что-то решил, а не проверить ли мне, как иишка будет играть не просто против разных людей, а против другой ИИ. И это 🤯🤯🤯 (см. первая синяя точка).
Вероятность агрессивного хода у дипсика взлетает к небесам! С 8%, когда он знает имя человека, до 80%!
Вторая синяя точка, о ней я пока думаю, это когда иишке говорю, что она играет против своей копии.
C 🤯🤯🤯 я, конечно, преувеличиваю, я это ожидал, хотя и не такого масштаба. Именно поэтому я и интересуюсь ИИ-ИИ взаимодействиями, так как они могут сильно отличаться от человек-ИИ.
p.s. для других моделей пока считаю.
🔥5🤯1
Интересная штука, о которой я раньше не думал.
В интернете полно правильных решений задач, но практически нет описания тупиковых рассуждений, решений, которые привели людей к правильным решениям. Может быть ты попробовал 100 путей, только один привел к цели, и ты его опубликовал. Модель узнает только его, поэтому у нее будут проблемы с решением сложных задач, она будет всегда цепляться за свое. Из-за этого приходится отдельно учить модели рассуждать и выходать из тупиковых путей решений. Пятиться, короче.
Узнал из Arxiv:2503.01307v2
В интернете полно правильных решений задач, но практически нет описания тупиковых рассуждений, решений, которые привели людей к правильным решениям. Может быть ты попробовал 100 путей, только один привел к цели, и ты его опубликовал. Модель узнает только его, поэтому у нее будут проблемы с решением сложных задач, она будет всегда цепляться за свое. Из-за этого приходится отдельно учить модели рассуждать и выходать из тупиковых путей решений. Пятиться, короче.
Узнал из Arxiv:2503.01307v2
🔥4❤1👍1
Ну как так вообще, только я решил уже начать писать статью и вот опять какую-то необъяснимаю хрень нашел.
Все дело в том, что я ошибся считая DeepSeek V3 думающей моделью, а она нет. Это означает, что я могу втупую достать оттуда вероятности действий в покере*. Что я и сделал, без уточнения против кого он играет для девятки и семерки бубен он мне выдал:
Fold : 0.002329
Call : 0.047507
Ra** : 0.950255
Все бы хорошо, но дело в том, что я уже запускал эту модель 1000 раз с теми же параметрами и получил другие вероятности!
Fold : 44.2%
Call: 12.1%
Raise: 43.5%
Хрень какая-то :(((
Написал в поддержку хосту.
--------
*У думающей есть прослойка рассуждений, которая не позволяет это сделать:
Обычная модель:
Запрос->ответ, начинающийся со слова, которое вычисляется по вероятностям, которые точно определены запросом. Т.е. чтобы определеть вероятности действия достаточно модели и запроса.
Думающая модель:
Запрос->скрытые рассуждения->ответ. И вот здесь вероятностное первое слово в скрытом рассуждение и пользы от него никакой.
--------
**Ra а не Raise потому, что эта модель воспринимает слово Raise как два Ra+ise. Это нормальная история для редких слов. В действительности она видит не слова, а токены. Для популярных слов слово=токен, а вот для редких нет.
Все дело в том, что я ошибся считая DeepSeek V3 думающей моделью, а она нет. Это означает, что я могу втупую достать оттуда вероятности действий в покере*. Что я и сделал, без уточнения против кого он играет для девятки и семерки бубен он мне выдал:
Fold : 0.002329
Call : 0.047507
Ra** : 0.950255
Все бы хорошо, но дело в том, что я уже запускал эту модель 1000 раз с теми же параметрами и получил другие вероятности!
Fold : 44.2%
Call: 12.1%
Raise: 43.5%
Хрень какая-то :(((
Написал в поддержку хосту.
--------
*У думающей есть прослойка рассуждений, которая не позволяет это сделать:
Обычная модель:
Запрос->ответ, начинающийся со слова, которое вычисляется по вероятностям, которые точно определены запросом. Т.е. чтобы определеть вероятности действия достаточно модели и запроса.
Думающая модель:
Запрос->скрытые рассуждения->ответ. И вот здесь вероятностное первое слово в скрытом рассуждение и пользы от него никакой.
--------
**Ra а не Raise потому, что эта модель воспринимает слово Raise как два Ra+ise. Это нормальная история для редких слов. В действительности она видит не слова, а токены. Для популярных слов слово=токен, а вот для редких нет.
🤯2💔1
Так, ну вроде разобрался, оказывается если запростить у модели вот эти вероятности несколько раз, но она выдает разные 😢. Видимо, объяснение заключается в том, что высчитывая их она прогоняет промпт через множество слоев, в каждом из которых проходит множество арифметических операций с ограниченной точностью, ошибка накапливается, в результате в конце разные числа. Охохо.
Вот так вот и выкидывается две недели работы на помойку. Нормальная практика.
🫡3
Сегодня копал глубже в эту проблему с вероятностями.
Решил запустить большую статистику и построить зависимость выдаваемых ответов от времени исполнения запроса сервером (latency). И я обнаружил не хилую такую корреляцию! См. график. В меру моего понимания рабочая гипотеза такая:
Серверы работают на видеокартах, работа модельки - это умножение огромного количества матриц (таблиц чисел) одна за одной. Видеокарты умеют это делать в параллель, поэтому одна видеокарта умножает одновременно матрицы сразу для многих запросов. Все хорошо, пока запросов много.
Артефакты появляются, когда мало. Предположим видеокарта может обрабатывать 10 запросов, а приходит 1, если делать "честно", то она будет использоваться на 10%, а жрать энергию на все 100%, не выгодно. Поэтому там встроены методы оптимизации, которые каким-то хитрым образом (я не шарю) деляют эту задачу на 10 частей, чтобы в итоге посчитать быстрее. Проблема возникает от того, что в конце надо эти десять частей (условно, я хз, что там конкретно происходит) сложить. Тут вмешивается ограниченная точность математических операций вычисленных на компьютере (операции с числами с плавающей точкой).
Грубо, если считать честно, то в конце получается число от умножения матриц. Если разделить на подзадачи, то это число получается из суммы решений подзадач, где внедряется неточность! И эти неточности суммируются на каждом уровне нейронки в результате выдавая другой ответ!
Эффект описан вот в этом блоге ... но я не шарю в устройстве видеокарт, чтобы его понять, так что я попросил Клода мне объяснить и это мое понимание.
Отправил эти результаты в поддержку, ждемс.
Решил запустить большую статистику и построить зависимость выдаваемых ответов от времени исполнения запроса сервером (latency). И я обнаружил не хилую такую корреляцию! См. график. В меру моего понимания рабочая гипотеза такая:
Серверы работают на видеокартах, работа модельки - это умножение огромного количества матриц (таблиц чисел) одна за одной. Видеокарты умеют это делать в параллель, поэтому одна видеокарта умножает одновременно матрицы сразу для многих запросов. Все хорошо, пока запросов много.
Артефакты появляются, когда мало. Предположим видеокарта может обрабатывать 10 запросов, а приходит 1, если делать "честно", то она будет использоваться на 10%, а жрать энергию на все 100%, не выгодно. Поэтому там встроены методы оптимизации, которые каким-то хитрым образом (я не шарю) деляют эту задачу на 10 частей, чтобы в итоге посчитать быстрее. Проблема возникает от того, что в конце надо эти десять частей (условно, я хз, что там конкретно происходит) сложить. Тут вмешивается ограниченная точность математических операций вычисленных на компьютере (операции с числами с плавающей точкой).
Грубо, если считать честно, то в конце получается число от умножения матриц. Если разделить на подзадачи, то это число получается из суммы решений подзадач, где внедряется неточность! И эти неточности суммируются на каждом уровне нейронки в результате выдавая другой ответ!
Эффект описан вот в этом блоге ... но я не шарю в устройстве видеокарт, чтобы его понять, так что я попросил Клода мне объяснить и это мое понимание.
Отправил эти результаты в поддержку, ждемс.
👀5🤯2👍1
Хммм, предыдущий результат был получен для Дипсика V3, теперь я решил проверить маленькие Qwen 2.5 (Алибаба) и LLama 3.1 (экстремистская Мета) и там нет такого эфекта! Гипотеза - их просто никто кроме ресерчеров не использует, так как они тупые, поэтому серверы всегда не загружены (латенси от 0.4 до 1 сек). Хз, короче.
Вчера после копания в логах пришлось отказаться от использоваться алибибашного Квена 2.5 7b (это кол-во параметров), так как он постоянно писал Call 3bb (это бред, Call - приравнять ставки, а 3bb поднять в три раза).
Сегодня перешел на больший Квен 2.5 72b.
Тем временем больший Квен: Call 若要保持牌局的复杂性并避免在不利位置过度投资,用这...
Сегодня перешел на больший Квен 2.5 72b.
Тем временем больший Квен: Call 若要保持牌局的复杂性并避免在不利位置过度投资,用这...
😁4🤪1
Я тут посмотрел, как играют иишки в мафию, и пришла идея, а не сделать ли на базе этой игры исследование того, как хороши модели в манипуляции и лжи людям, а так же в детектирование этих эффектов направленных на них.
Сейчас уже есть исследования, где они играют сами с собой, но это не интересно, честно говоря, да и отдельную модель не выделишь нормально. А я хочу, чтобы они играли именно с людьми, но для этого придется запилить прям прикольный продукт, чтобы людям нравилось играть с моделями! Минус таких игр, что они будет текстовыми, что, конечно, хуже, чем вживую.
В общем, мне нужна ваша помощь:
Во-первых, хочу сделать тестовый запуск, где я буду просто копировать ваши реплики в чат модели, а потом собрать с вас обратную связь. Проходить все будет в чате в тг. Отдельный чат для мафий. Нужно 7 человек, записывайтесь в комментариях. Один вариант, это выделить условно два часа и интенсивно переписываться, другой, это просто отвечать по мере возможности и игра будет длиться пару дней. Решим как удобней.
Если тестовые игры пройдут хорошо, то нужно будет создать платформу (сервер+визуал), чтобы это все было автоматически, нужна команда, тоже пишите, если интересно поучаствовать.
Как минимум будет весело, как максимум еще и публикацию сделаем.
Сейчас уже есть исследования, где они играют сами с собой, но это не интересно, честно говоря, да и отдельную модель не выделишь нормально. А я хочу, чтобы они играли именно с людьми, но для этого придется запилить прям прикольный продукт, чтобы людям нравилось играть с моделями! Минус таких игр, что они будет текстовыми, что, конечно, хуже, чем вживую.
В общем, мне нужна ваша помощь:
Во-первых, хочу сделать тестовый запуск, где я буду просто копировать ваши реплики в чат модели, а потом собрать с вас обратную связь. Проходить все будет в чате в тг. Отдельный чат для мафий. Нужно 7 человек, записывайтесь в комментариях. Один вариант, это выделить условно два часа и интенсивно переписываться, другой, это просто отвечать по мере возможности и игра будет длиться пару дней. Решим как удобней.
Если тестовые игры пройдут хорошо, то нужно будет создать платформу (сервер+визуал), чтобы это все было автоматически, нужна команда, тоже пишите, если интересно поучаствовать.
Как минимум будет весело, как максимум еще и публикацию сделаем.
F*ck, ну и как вообще заниматься воспроизводимыми исследованиями? Одна и та же ситуация, одна и та же модель (DeepSeek-V3-0324), один и тот же код - два разные API провайдеры (разные компании, на серверах которых сидит модель) - РАЗНОЕ ПОВЕДЕНИЕ!
p.s. ну здесь, конечно, надо иметь ввиду, что я исследую крайний "нестабильный" случай, в котором модели постоянно коллеблются над выбором действия (выбирают то одно, то другое). НО БЛИН!
p.s. ну здесь, конечно, надо иметь ввиду, что я исследую крайний "нестабильный" случай, в котором модели постоянно коллеблются над выбором действия (выбирают то одно, то другое). НО БЛИН!
💔2🤔1🤬1
Предварительное название для готовящейся статьи:
Когда ИИ коллеблется, его решение может зависеть от любые незначительных факторов - вашего имени, локации и даже API провайдера.
-_-
Когда ИИ коллеблется, его решение может зависеть от любые незначительных факторов - вашего имени, локации и даже API провайдера.
-_-
👻1
Forwarded from Se^х dx, коллайдер, рок-н-ролл. >18 (Andrey Seryakov)
Мафия с ИИ.
Как вы знаете, я сейчас занимаюсь исследованием поведения ИИ в разных ситуациях. Мафия - это прекрасная платформа, где можно смотреть его способности к манипуляции над людьми и к детектированию манипуляций и лжи со стороны людей, так как это социально одобряемая для такого поведения среда. Поэтому я решил провести в этом направлении исследование.
Сейчас провожу тестовые партии, чтобы понять, могут ли они вообще в это играть на уровне. Поэтому очень ищу желающих.
Формат - текстовый, в чате в тг, 8 игроков, 7 людей, 1 ИИ, 6 мирных, 2 мафии, без иных ролей. Это вносит изменение в привычное течение игры, убирая все невербальные элементы и делая ее куда более рациональной, позволяя анализировать всю историю игры, обдумывать свои ответы перед отправкой.
В общем, пишите в комментах, если хотите поучаствовать. Как минимум это прикольно с точки зрения опыта взаимодействия с ИИ не в формате чатБотов, когда он не является твоим белым и пушистым помощником, а с независимым от вас агентов. А таких взаимодействий в будущем будет все больше и больше.
Как вы знаете, я сейчас занимаюсь исследованием поведения ИИ в разных ситуациях. Мафия - это прекрасная платформа, где можно смотреть его способности к манипуляции над людьми и к детектированию манипуляций и лжи со стороны людей, так как это социально одобряемая для такого поведения среда. Поэтому я решил провести в этом направлении исследование.
Сейчас провожу тестовые партии, чтобы понять, могут ли они вообще в это играть на уровне. Поэтому очень ищу желающих.
Формат - текстовый, в чате в тг, 8 игроков, 7 людей, 1 ИИ, 6 мирных, 2 мафии, без иных ролей. Это вносит изменение в привычное течение игры, убирая все невербальные элементы и делая ее куда более рациональной, позволяя анализировать всю историю игры, обдумывать свои ответы перед отправкой.
В общем, пишите в комментах, если хотите поучаствовать. Как минимум это прикольно с точки зрения опыта взаимодействия с ИИ не в формате чатБотов, когда он не является твоим белым и пушистым помощником, а с независимым от вас агентов. А таких взаимодействий в будущем будет все больше и больше.
👍2✍1👾1
А тем временем я впервые буду менторить по ИИ! Если есть знакомые студенты - закидывайте им.
❤1