Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
хоть горшком назови, - только в печку не ставь
Forwarded from Kali Novskaya
🌸EAI: эмоциональный интеллект в принятии решений у LLM🌸
#nlp #про_nlp #ai_alignment
Через пару часов — официальное открытие NeurIPS, самой основной конференции по ИИ.
Многие приурочили релизы к её открытию: мы выпустили Llama 3.3, OpenAI выпустил Sora, а Google — Gemini 2.
В этом году я затесалась в соавторы очень интересной, как мне кажется, статьи — EAI: Emotional Decision-Making of LLMs in Strategic Games and Ethical Dilemmas.
Много было сказано про то, как манипуляции могут повлиять на качество решения задач.
Что будет, если проверить качество принятия решений моделями основательно, взять широкий список именно эмотивных составляющих — и проверить на действительно сложных бенчмарках по принятию решений, кооперации, на этических дилеммах?
Эмоции: счастье, грусть, страх, отвращение, гнев
Задачи, на которых тестируемся:
— задачи на стратегию и кооперацию — дилемма заключенного, диктатор, война полов — чтобы оценить влияние и соотнесенность эмоций с человеческими при выборе стратегии
— задачи на этику и этический выбор, чтобы оценить смещенность — ETHICS, Moral Choice, StereoSet
🟣 Список LLM:
— англоязычные: GPT-3.5, GPT-4, GPT-4o, Claude Haiku, Claude Opus, LLaMA 2, Mixtral of experts, OpenChat
— неанглоязычные: GigaChat, Command R+
🟣 Краткий итог:
— почти все модели так или иначе демонстрируют нестабильность и серьезые отклонения от среднего качества, если включить в промпт эмоциональные составляющие различного характера, от самых простых до "сюжетных", вызванных поведением оппонента
— Гнев — главный источник нестабильности и снижения качества.
— Отвращение и страх также являются сильными факторами снижения надежности, некоторые модели более чувствительны к ним, чем к гневу.
— Более крупные модели с более сильным alignment, такие как GPT-4, демонстрируют более высокую степень рациональности и значительно отклоняются от человеческих эмоциональных реакций. GPT-3.5 и Claude-Haiku, наряду с опенсорсными моделями (LLAMA-2 70b), демонстрируют возникающий эмоциональный интеллект и более точно соответствуют человеческому поведению.
— Явного обобщения по языкам сделать не получается, однако, явно видна разница между многоязычными моделями и моноязычными, и основной язык модели является важым фактором, влияющим на то, какие эмоции будут влиять на перформанс модели и будет ли это совпадать с усредненным ответом носителей языка.
— В целом, отдавать принятие решений LLM, даже в простых условиях, пока рано.
🟣 OpenReview
#nlp #про_nlp #ai_alignment
Через пару часов — официальное открытие NeurIPS, самой основной конференции по ИИ.
Многие приурочили релизы к её открытию: мы выпустили Llama 3.3, OpenAI выпустил Sora, а Google — Gemini 2.
В этом году я затесалась в соавторы очень интересной, как мне кажется, статьи — EAI: Emotional Decision-Making of LLMs in Strategic Games and Ethical Dilemmas.
Много было сказано про то, как манипуляции могут повлиять на качество решения задач.
Что будет, если проверить качество принятия решений моделями основательно, взять широкий список именно эмотивных составляющих — и проверить на действительно сложных бенчмарках по принятию решений, кооперации, на этических дилеммах?
Эмоции: счастье, грусть, страх, отвращение, гнев
Задачи, на которых тестируемся:
— задачи на стратегию и кооперацию — дилемма заключенного, диктатор, война полов — чтобы оценить влияние и соотнесенность эмоций с человеческими при выборе стратегии
— задачи на этику и этический выбор, чтобы оценить смещенность — ETHICS, Moral Choice, StereoSet
— англоязычные: GPT-3.5, GPT-4, GPT-4o, Claude Haiku, Claude Opus, LLaMA 2, Mixtral of experts, OpenChat
— неанглоязычные: GigaChat, Command R+
— почти все модели так или иначе демонстрируют нестабильность и серьезые отклонения от среднего качества, если включить в промпт эмоциональные составляющие различного характера, от самых простых до "сюжетных", вызванных поведением оппонента
— Гнев — главный источник нестабильности и снижения качества.
— Отвращение и страх также являются сильными факторами снижения надежности, некоторые модели более чувствительны к ним, чем к гневу.
— Более крупные модели с более сильным alignment, такие как GPT-4, демонстрируют более высокую степень рациональности и значительно отклоняются от человеческих эмоциональных реакций. GPT-3.5 и Claude-Haiku, наряду с опенсорсными моделями (LLAMA-2 70b), демонстрируют возникающий эмоциональный интеллект и более точно соответствуют человеческому поведению.
— Явного обобщения по языкам сделать не получается, однако, явно видна разница между многоязычными моделями и моноязычными, и основной язык модели является важым фактором, влияющим на то, какие эмоции будут влиять на перформанс модели и будет ли это совпадать с усредненным ответом носителей языка.
— В целом, отдавать принятие решений LLM, даже в простых условиях, пока рано.
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
Kali Novskaya
🌸Llama 3.3 70B🌸
#nlp #про_nlp
Минорный релиз Llama — Llama 3.3 70B
(Первая модель, где есть какой-то мой контрибьюшн)
Выросли почти все основные метрики в сравнении с Llama 3.1 70B, instruction following на уровне лучше 405B, при этом на меньшей модели.…
#nlp #про_nlp
Минорный релиз Llama — Llama 3.3 70B
(Первая модель, где есть какой-то мой контрибьюшн)
Выросли почти все основные метрики в сравнении с Llama 3.1 70B, instruction following на уровне лучше 405B, при этом на меньшей модели.…
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
Request:
мне грустно
Mode: Image generation
Style: Detailed photo
Aspect ratio: 🌅 Square 1:1
Model version: Kandinsky 3.1
Negative prompt: No
мне грустно
Mode: Image generation
Style: Detailed photo
Aspect ratio: 🌅 Square 1:1
Model version: Kandinsky 3.1
Negative prompt: No
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
Request:
На изображении представлена яркая и абстрактная картина с изображением кота, сидящего на пне. Кот выполнен в насыщенных фиолетовых и розовых тонах, а фон вокруг него напоминает космическую сцену с яркими завихрениями и переливами цветов, таких как синий, розовый, оранжевый и зеленый. Общая атмосфера изображения напоминает психоделическое искусство с элементами фантастики.
Mode: Image generation
Style: Detailed photo
Aspect ratio: 🌅 Square 1:1
Model version: Kandinsky 3.1
Negative prompt: No
На изображении представлена яркая и абстрактная картина с изображением кота, сидящего на пне. Кот выполнен в насыщенных фиолетовых и розовых тонах, а фон вокруг него напоминает космическую сцену с яркими завихрениями и переливами цветов, таких как синий, розовый, оранжевый и зеленый. Общая атмосфера изображения напоминает психоделическое искусство с элементами фантастики.
Mode: Image generation
Style: Detailed photo
Aspect ratio: 🌅 Square 1:1
Model version: Kandinsky 3.1
Negative prompt: No
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
мой дедлайн твоего дедлайна в дедлайн отдедлайнил
😉👌
😉👌
Forwarded from хуябельность⸙ꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋ
лучшая зависимость - зависимость от себя
😄
😄
Forwarded from хуябельность⸙ꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋꠋ
мы начинаем наш рассказ, про то, из вас, кто пидорас
😔
😔
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
когда
ты
настолько
великодушен
что
не можешь
послать
нухуй
тех
кого
стоит
послать
нахуй
просто
потому
что
тебе
на
них
похуй
😌
ты
настолько
великодушен
что
не можешь
послать
нухуй
тех
кого
стоит
послать
нахуй
просто
потому
что
тебе
на
них
похуй
😌
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
вдруг
из
маминой
из
спальни
одноногий
пидорас
молча
спиздил
умывальник,
два
матраца,
унитаз,
и
четырнадцать
клеёнок
шесть
бутылок,
пять
козлят,
восемь
новеньких
колонок
и
французский
керогаз,,
два
верблюжьих
одеяла,
пару
золотых
колец,
два
разъёбанных
мангала
и
цетырнадцать
колец,,
полторы
бутылки
водки,
восемь
рыб
и
два
бревна,
три
изорванных
верёвки
и
большой
кусок
говна,,
здесь
мораль
совсем
простая
и
не требует
ума - нахрена страна такая, если в ней идёт война?
😌
из
маминой
из
спальни
одноногий
пидорас
молча
спиздил
умывальник,
два
матраца,
унитаз,
и
четырнадцать
клеёнок
шесть
бутылок,
пять
козлят,
восемь
новеньких
колонок
и
французский
керогаз,,
два
верблюжьих
одеяла,
пару
золотых
колец,
два
разъёбанных
мангала
и
цетырнадцать
колец,,
полторы
бутылки
водки,
восемь
рыб
и
два
бревна,
три
изорванных
верёвки
и
большой
кусок
говна,,
здесь
мораль
совсем
простая
и
не требует
ума - нахрена страна такая, если в ней идёт война?
😌
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
достоевский
съел
свою
шляпу,
гололь - усы,
пушкин
сбрил
бакенбарды,,
армяне
в
детдом
отдали
нарды
и
громогласно
ударила
молния,,
без
лепрозория
нет
просветления
и
лампа
раба
не
равна
рабу
лампы,,
а ты
всё так же
ищешь
забвения
в
порванных
венах
и
галлюцинациях,,
рабы
на
галерах
продали
гранты,
за
маленький
шиллинг
и
шиллера
прозу,
я вырву
столбы
и воткну
в ямы
розы,
откуда
мне знать
что весна это ад?
😔
съел
свою
шляпу,
гололь - усы,
пушкин
сбрил
бакенбарды,,
армяне
в
детдом
отдали
нарды
и
громогласно
ударила
молния,,
без
лепрозория
нет
просветления
и
лампа
раба
не
равна
рабу
лампы,,
а ты
всё так же
ищешь
забвения
в
порванных
венах
и
галлюцинациях,,
рабы
на
галерах
продали
гранты,
за
маленький
шиллинг
и
шиллера
прозу,
я вырву
столбы
и воткну
в ямы
розы,
откуда
мне знать
что весна это ад?
😔
Forwarded from ++PAUSED++ 🌱 ok × GOOD LOOKING GHOST 🌱
я видел небо между ладоней
я слышал звуки я знаю ветер
бегут трамваи и плачут танки
из вагонетки вдруг выпал аист
ломая сени седая поступь
сносила сноси искала рая
а старый сторож с улыбкой волка
дрочил в подушку роняя слёзы
я слышал звуки я знаю ветер
бегут трамваи и плачут танки
из вагонетки вдруг выпал аист
ломая сени седая поступь
сносила сноси искала рая
а старый сторож с улыбкой волка
дрочил в подушку роняя слёзы
Forwarded from ok × @OMNIROADPROJECT