Про внедрение этических принципов.
Мы всё думаем о том, чтобы сделать небольшой практичный гайд по дата-этике для компаний. Вот с чего можно начать, например? Если возвращаться к основам, то можно обратиться к пяти принципам дата-этики от Гарвардской бизнес школы:
1. Владение данными (Ownership)
Спрашивайте владельца данных о возможности собирать и использовать его данные/данные о нем.
2. Прозрачность (Transparency)
Рассказывайте, как и зачем вы собираете, храните и используете данные.
3. Конфиденциальность (Privacy)
Даже если вам разрешили собирать перс.данные, это не значит, что их можно опубличить. Делайте все, чтобы защитить данные.
4. Намерения (Intention)
Убедитесь, что ваши намерения работы с данными - ради блага. (Этот пункт, думаю, как раз об этике в целом, а не только о дата-этике)
5. Последствия (Outcomes)
Даже если вы работаете с данными ради блага, это не значит, что последствия ваших решений будут положительными. Думайте о том, как результат вашей работы может отразится на отдельном человеке и на обществе в целом.
#переходкэтичному
Мы всё думаем о том, чтобы сделать небольшой практичный гайд по дата-этике для компаний. Вот с чего можно начать, например? Если возвращаться к основам, то можно обратиться к пяти принципам дата-этики от Гарвардской бизнес школы:
1. Владение данными (Ownership)
Спрашивайте владельца данных о возможности собирать и использовать его данные/данные о нем.
2. Прозрачность (Transparency)
Рассказывайте, как и зачем вы собираете, храните и используете данные.
3. Конфиденциальность (Privacy)
Даже если вам разрешили собирать перс.данные, это не значит, что их можно опубличить. Делайте все, чтобы защитить данные.
4. Намерения (Intention)
Убедитесь, что ваши намерения работы с данными - ради блага. (Этот пункт, думаю, как раз об этике в целом, а не только о дата-этике)
5. Последствия (Outcomes)
Даже если вы работаете с данными ради блага, это не значит, что последствия ваших решений будут положительными. Думайте о том, как результат вашей работы может отразится на отдельном человеке и на обществе в целом.
#переходкэтичному
Harvard Business School
5 Principles of Data Ethics for Business
Data ethics encompasses the moral obligations of gathering, protecting, and using personally identifiable information and how it affects individuals.
👍3
#короткиезаметки
В ФБ небольшой скандал. В галерее Гельмана открылась выставка Владимира Сорокина «Голубое сало». Там иллюстрации, созданные ИИ. Сорокин был автором идей. Но вот промт-инженером был другой человек - Евгений Никитин. И его имя нигде не упомянуто. Он возмущен, потому что считает себя со-автором. Если отвечать на вопрос «Кто является автором?», то какой был бы с вашей точки зрения ответ? Вот навскидку:
- ИИ
- промт-инженер
- автор идеи
- авторы, на основе которых тренировался ИИ
Может кто-то еще? Или кто-то лишний?
В ФБ небольшой скандал. В галерее Гельмана открылась выставка Владимира Сорокина «Голубое сало». Там иллюстрации, созданные ИИ. Сорокин был автором идей. Но вот промт-инженером был другой человек - Евгений Никитин. И его имя нигде не упомянуто. Он возмущен, потому что считает себя со-автором. Если отвечать на вопрос «Кто является автором?», то какой был бы с вашей точки зрения ответ? Вот навскидку:
- ИИ
- промт-инженер
- автор идеи
- авторы, на основе которых тренировался ИИ
Может кто-то еще? Или кто-то лишний?
Про этичность VR-очков и рост неравенства.
Интересное наблюдение о том, что в отрасли VR тоже возникают свои этические проблемы, хоть и не такого размаха, как в отрасли ИИ. Интересно, со временем мы наверное тоже придем к каким-то этичным решениям, которые закрепятся в этикете, как снять перчатку при рукопожатии или наушники при встрече.
#кейсцифровойэтики
⬇️⬇️⬇️
Интересное наблюдение о том, что в отрасли VR тоже возникают свои этические проблемы, хоть и не такого размаха, как в отрасли ИИ. Интересно, со временем мы наверное тоже придем к каким-то этичным решениям, которые закрепятся в этикете, как снять перчатку при рукопожатии или наушники при встрече.
#кейсцифровойэтики
⬇️⬇️⬇️
Forwarded from TechSparks
Как только появляется очередная технологическая новинка, возникает масса предположений о ее воздействии на людей по отдельности и общество в целом. В случае с ИИ недостатка в в самых экзотических и панических гипотезах нет, а вот вокруг технологий смешанной реальности оригинальных причин для тревог я давно не видел. Пока не прочитал эту статью, где рассматривается неожиданное на первый взгляд преимущество, которое получают люди, которые в процессе общения носят очки дополненной реальности.
В таких очках можно реализовать привычную по соцсеточкам функцию фильтров, накладываемых на реальное изображение; в данном случае — на лицо собеседника (без его ведома).
Вот, предположим, фильтр добавит вашему собеседнику видимые только вам кошачьи ушки и усы — что изменится?
И дотошные социологи поставили такой эксперимент. Оказалось, эффект присутствует: добавление шуточных фильтров снижает тревогу при общении с незнакомцами, и вообще действует расслабляющее. Но все не так просто — те, кто без очков, начинают как раз дополнительно тревожиться, не зная, в каком обличии их сейчас наблюдает собеседник (а вдруг вообще голыми??).
В итоге, утверждают исследователи, люди без очков оказываются в уязвимом положении, и технология опять дает преимущества пользователям перед непользователями, усиливая неравенство.
Кажется, после недавнего анонса Цукербергу и от этого придется отбиваться:)
https://spectrum.ieee.org/ar-glasses
В таких очках можно реализовать привычную по соцсеточкам функцию фильтров, накладываемых на реальное изображение; в данном случае — на лицо собеседника (без его ведома).
Вот, предположим, фильтр добавит вашему собеседнику видимые только вам кошачьи ушки и усы — что изменится?
И дотошные социологи поставили такой эксперимент. Оказалось, эффект присутствует: добавление шуточных фильтров снижает тревогу при общении с незнакомцами, и вообще действует расслабляющее. Но все не так просто — те, кто без очков, начинают как раз дополнительно тревожиться, не зная, в каком обличии их сейчас наблюдает собеседник (а вдруг вообще голыми??).
В итоге, утверждают исследователи, люди без очков оказываются в уязвимом положении, и технология опять дает преимущества пользователям перед непользователями, усиливая неравенство.
Кажется, после недавнего анонса Цукербергу и от этого придется отбиваться:)
https://spectrum.ieee.org/ar-glasses
IEEE Spectrum
AR Glasses Spawn a Whole New Social Dynamic
Is there a power imbalance between wearers and nonwearers in mixed company?
👍1
#короткиезаметки
Скарлетт Йохансон подала в суд на разработчиков ИИ-приложения, которое использовало ее внешность в рекламных целях без ее разрешения. Начинают копится преценденты и скоро появится юридическая практика. Конечно, тут вопрос не в том, кто прав, а сколько это будет стоить.
Скарлетт Йохансон подала в суд на разработчиков ИИ-приложения, которое использовало ее внешность в рекламных целях без ее разрешения. Начинают копится преценденты и скоро появится юридическая практика. Конечно, тут вопрос не в том, кто прав, а сколько это будет стоить.
Variety
Scarlett Johansson Takes Legal Action Against AI App That Ripped Off Her Likeness in Advertisement
Scarlett Johansson is taking legal action against an AI app that used her likeness in an online advertisement without permission.
Про новые законы и практики.
Что-то за осень накопилось много новой нормативки. Спасибо, коллеги, что делитесь. Особое внимание, конечно, вот у этих инициатив:
1️⃣ Лидеры G7 подписали «Соглашение о международных руководящих принципах ИИ» и «Добровольный кодекс поведения разработчиков ИИ» в рамках «Хиросимского процесса ИИ» — форума, посвящённого перспективам и проблемам развития искусственного интеллекта. Эти документы дополнят на международном уровне юридически обязательные правила, которые в настоящее время дорабатываются законодателями ЕС в соответствии с «Законом об ИИ» (AI Act).
Немного про принципы. Многие страны в ситуации отсутствия нормативки обращаются к таким утвержденным принципам, поэтому это не просто декларация о намерениях, но и законодательная основа.
В новых принципах мне особенно отзывается принцип о приоритезации разработок тех ИИ систем, которые направлены на решение мировых проблем, таких как климатический кризис, всемирное здравоохранение и образование.
2️⃣ США опубликовали указ в области доверия в работе с ИИ
3️⃣ Великобритания опубликовала «Декларацию Блетчли», направленную на активизацию глобальных усилий по сотрудничеству в области безопасности искусственного интеллекта, подписанную 28 странами и ЕС.
В документе изложена программа, направленная на выявление рисков, вызывающих общую обеспокоенность, и формирование их научного понимания, а также на разработку международной политики по их смягчению. Декларация поощряет прозрачность и подотчётность участников, разрабатывающих передовые технологии ИИ, призывая к мониторингу и смягчению потенциально вредных возможностей.
4️⃣ Китай принял первый в мире закон в сфере генеративного ИИ. Этот закон - последний в серии регуляций, нацеленных на разные аспекты ИИ. Он вводит новые ограничения для компаний, предоставляющих такие услуги потребителям, как в отношении данных, используемых для обучения, так и в отношении результатов.
#почитатьнатему #переходкэтичному
Что-то за осень накопилось много новой нормативки. Спасибо, коллеги, что делитесь. Особое внимание, конечно, вот у этих инициатив:
1️⃣ Лидеры G7 подписали «Соглашение о международных руководящих принципах ИИ» и «Добровольный кодекс поведения разработчиков ИИ» в рамках «Хиросимского процесса ИИ» — форума, посвящённого перспективам и проблемам развития искусственного интеллекта. Эти документы дополнят на международном уровне юридически обязательные правила, которые в настоящее время дорабатываются законодателями ЕС в соответствии с «Законом об ИИ» (AI Act).
Немного про принципы. Многие страны в ситуации отсутствия нормативки обращаются к таким утвержденным принципам, поэтому это не просто декларация о намерениях, но и законодательная основа.
В новых принципах мне особенно отзывается принцип о приоритезации разработок тех ИИ систем, которые направлены на решение мировых проблем, таких как климатический кризис, всемирное здравоохранение и образование.
2️⃣ США опубликовали указ в области доверия в работе с ИИ
3️⃣ Великобритания опубликовала «Декларацию Блетчли», направленную на активизацию глобальных усилий по сотрудничеству в области безопасности искусственного интеллекта, подписанную 28 странами и ЕС.
В документе изложена программа, направленная на выявление рисков, вызывающих общую обеспокоенность, и формирование их научного понимания, а также на разработку международной политики по их смягчению. Декларация поощряет прозрачность и подотчётность участников, разрабатывающих передовые технологии ИИ, призывая к мониторингу и смягчению потенциально вредных возможностей.
4️⃣ Китай принял первый в мире закон в сфере генеративного ИИ. Этот закон - последний в серии регуляций, нацеленных на разные аспекты ИИ. Он вводит новые ограничения для компаний, предоставляющих такие услуги потребителям, как в отношении данных, используемых для обучения, так и в отношении результатов.
#почитатьнатему #переходкэтичному
Shaping Europe’s digital future
Hiroshima Process International Guiding Principles for Advanced AI system
The International Guiding Principles for Organizations Developing Advanced AI Systems aims to promote safe, secure, and trustworthy AI worldwide and will provide guidance for organizations developing and using the most advanced AI systems, including the most…
👍3
#короткиезаметки
Слово «hallucinate» (галлюцинировать) было выбрано Кембриджским словарем словом года. В этом году оно получило новое значение в контексте ИИ: если ИИ галлюцинирует - значит он выдает ложную информацию.
Хочется добавить тут остроумный комментарий, но я не буду :)
Слово «hallucinate» (галлюцинировать) было выбрано Кембриджским словарем словом года. В этом году оно получило новое значение в контексте ИИ: если ИИ галлюцинирует - значит он выдает ложную информацию.
Хочется добавить тут остроумный комментарий, но я не буду :)
😁2
Про использование данных в урбанистике.
Очень люблю примеры этичного использования данных. Вот, кстати, интересный пример использования данных для реализации принципов про которые я писала в прошлом посте.
Автотранспорт является значительным источником выбросов парниковых газов как на мировом уровне, так и в городах. Эта проблема особенно актуальна на перекрестках в городах, где загрязнение воздуха может быть намного выше, чем на открытых участках дорог. На перекрестках половина выбросов происходит из-за того, что автомобили ускоряются после остановки на светофоре. Хотя некоторое количество stop-go движения нельзя избежать, часть его можно предотвратить, оптимизируя работу светофоров. Для улучшения этой ситуации города должны либо устанавливать дорогостоящее оборудование, либо проводить ручной учет движения автомобилей. Оба эти способа дороги и не дают всей необходимой информации.
Green Light использует ИИ и данные о движении на основе Google Maps, чтобы анализировать трафик и разрабатывать рекомендации для городских инженеров, как улучшить поток движения. Первые результаты показывают, что это может сократить число остановок на 30% и выбросы парниковых газов на 10%. Путем оптимизации работы каждого перекрестка и их согласования друг с другом, можно создавать "зеленые волны" и помогать городам снижать stop-go движение. Green Light уже работает на 70 перекрестках в 12 городах на 4 континентах, от Хайфы в Израиле до Бангалора в Индии и Гамбурга в Германии.
Green Light - это часть усилий Google Research в борьбе с изменением климата и улучшении жизни в городах по всему миру с помощью искусственного интеллекта.
#кейсдатаэтики
Очень люблю примеры этичного использования данных. Вот, кстати, интересный пример использования данных для реализации принципов про которые я писала в прошлом посте.
Автотранспорт является значительным источником выбросов парниковых газов как на мировом уровне, так и в городах. Эта проблема особенно актуальна на перекрестках в городах, где загрязнение воздуха может быть намного выше, чем на открытых участках дорог. На перекрестках половина выбросов происходит из-за того, что автомобили ускоряются после остановки на светофоре. Хотя некоторое количество stop-go движения нельзя избежать, часть его можно предотвратить, оптимизируя работу светофоров. Для улучшения этой ситуации города должны либо устанавливать дорогостоящее оборудование, либо проводить ручной учет движения автомобилей. Оба эти способа дороги и не дают всей необходимой информации.
Green Light использует ИИ и данные о движении на основе Google Maps, чтобы анализировать трафик и разрабатывать рекомендации для городских инженеров, как улучшить поток движения. Первые результаты показывают, что это может сократить число остановок на 30% и выбросы парниковых газов на 10%. Путем оптимизации работы каждого перекрестка и их согласования друг с другом, можно создавать "зеленые волны" и помогать городам снижать stop-go движение. Green Light уже работает на 70 перекрестках в 12 городах на 4 континентах, от Хайфы в Израиле до Бангалора в Индии и Гамбурга в Германии.
Green Light - это часть усилий Google Research в борьбе с изменением климата и улучшении жизни в городах по всему миру с помощью искусственного интеллекта.
#кейсдатаэтики
Green Light: Reduce Traffic Emissions with AI - Google Research
Discover how Green Light utilizes AI to optimize traffic light timing, reduce vehicle emissions in cities, and improve traffic flow.
🔥2
Про важность больших данных.
Судя по тому, что думают сами разработчики об ИИ, и сколько скандалов возникает из-за использования данных для обучения моделей, вполне возможно, что скоро обладание большими и качественными датасетами станет настоящим конкурентным преимуществом.
Довольно очевидно, у кого такие датасеты есть:
1. Google - поисковое поведение, пользовательские видео-предпочтения (YouTube)
2. Meta - предпочтения реальных людей и поведенческие паттерны
3. Amazon - покупательские предпочтения.
Из неочевидных:
а) Tesla - знание об окружающем мире
б) Apple, Google - маршруты людей
Кто-то еще? И скоро ли появятся инициативы о том, что большие данные, которые многие уже давно называют "новой нефтью", начнут регулироваться как ресурс (государственный)?
#подуматьнатему
Судя по тому, что думают сами разработчики об ИИ, и сколько скандалов возникает из-за использования данных для обучения моделей, вполне возможно, что скоро обладание большими и качественными датасетами станет настоящим конкурентным преимуществом.
Довольно очевидно, у кого такие датасеты есть:
1. Google - поисковое поведение, пользовательские видео-предпочтения (YouTube)
2. Meta - предпочтения реальных людей и поведенческие паттерны
3. Amazon - покупательские предпочтения.
Из неочевидных:
а) Tesla - знание об окружающем мире
б) Apple, Google - маршруты людей
Кто-то еще? И скоро ли появятся инициативы о том, что большие данные, которые многие уже давно называют "новой нефтью", начнут регулироваться как ресурс (государственный)?
#подуматьнатему
🔥1
#короткиезаметки
Stability AI презентовали модель для генерации видео. Скоро-скоро - фильмы, созданные за пять минут.
Stability AI презентовали модель для генерации видео. Скоро-скоро - фильмы, созданные за пять минут.
Stability AI
Introducing Stable Video Diffusion — Stability AI
Stable Video Diffusion is a proud addition to our diverse range of open-source models. Spanning across modalities including image, language, audio, 3D, and code, our portfolio is a testament to Stability AI’s dedication to amplifying human intelligence.
🔥1
#короткиезаметки
Была вчера на мероприятии, посвященном внедрению ИИ в организациях. Один из участников озвучил мысль, про которую я уже читала, но не помню где. Мы массово и быстро начнем использовать GenAI везде, потому что это pull технология, а не push. Никто ее не внедрят, люди сами хотят использовать. Как в свое время смартфоны и онлайн поиск.
Была вчера на мероприятии, посвященном внедрению ИИ в организациях. Один из участников озвучил мысль, про которую я уже читала, но не помню где. Мы массово и быстро начнем использовать GenAI везде, потому что это pull технология, а не push. Никто ее не внедрят, люди сами хотят использовать. Как в свое время смартфоны и онлайн поиск.
🔥2🤔1
#короткиезаметки
В качестве итогов года скажу, что очень много в этом году пользовалась ChatGPT - и для работы, и для развития, и для развлечения. Умение пользоваться поиском Google в итоге вылилось в отдельный навык и слово "гуглить". Умение пользоваться ИИ-чатами тоже скоро не будет чем-то особенным. А прокачать умение можно здесь (гайд от OpenAI) - отличное занятие на каникулы.
PS: Спасибо, что были тут со мной в этом году, очень ценю!
В качестве итогов года скажу, что очень много в этом году пользовалась ChatGPT - и для работы, и для развития, и для развлечения. Умение пользоваться поиском Google в итоге вылилось в отдельный навык и слово "гуглить". Умение пользоваться ИИ-чатами тоже скоро не будет чем-то особенным. А прокачать умение можно здесь (гайд от OpenAI) - отличное занятие на каникулы.
PS: Спасибо, что были тут со мной в этом году, очень ценю!
🔥4
Про ИИ и экологию.
Тренировка и разработка крупных языковых моделей, таких как ChatGPT, требуют значительного количества энергии, что приводит к серьезным экологическим последствиям. Например, ChatGPT в год выделяет около 8.4 тонн углекислого газа. Однако, некоторые инициативы разработчиков ИИ направлены на снижение влияния человека на экологию. Я уже писала про автоматизацию светофоров. Еще тот же Google и American Airlines использовали ИИ для снижения количества конденсационных следов самолетов, способствующих глобальному потеплению. Кроме того, Google применяет ИИ для прогнозирования наводнений на реках и предложения экологически чистых маршрутов в своем картографическом сервисе.
Интересно, приведут ли эти инициативы в совокупности с генерируемыми выбросами к NetZeroWorld?
#кейсдатаэтики
Тренировка и разработка крупных языковых моделей, таких как ChatGPT, требуют значительного количества энергии, что приводит к серьезным экологическим последствиям. Например, ChatGPT в год выделяет около 8.4 тонн углекислого газа. Однако, некоторые инициативы разработчиков ИИ направлены на снижение влияния человека на экологию. Я уже писала про автоматизацию светофоров. Еще тот же Google и American Airlines использовали ИИ для снижения количества конденсационных следов самолетов, способствующих глобальному потеплению. Кроме того, Google применяет ИИ для прогнозирования наводнений на реках и предложения экологически чистых маршрутов в своем картографическом сервисе.
Интересно, приведут ли эти инициативы в совокупности с генерируемыми выбросами к NetZeroWorld?
#кейсдатаэтики
Earth.Org
The Environmental Impact of ChatGPT | Earth.Org
Training and developing AI systems like ChatGPT requires a tremendous amount of energy, resulting in significant environmental costs.
👍2
Про скорость внедрения новых технологий.
На международном экономическом форуме в Давосе основным из основных вопросов в повестке стал ИИ.
Итоги интересного исследования были рассказаны PwC. В своем последнем годовом опросе глав компаний было выявлено, что около половины (42%) британских руководителей внедрили новейшие технологии в прошедшем году. Это существенно превышает мировой показатель, который составил 32%.
Исследование, охватившее 4702 генеральных директоров из 105 стран, показало, что Великобритания является одним из лидеров в применении генеративного ИИ, который управляет такими чат-ботами, как ChatGPT, и создателями изображений, например, Midjourney. В сравнении, только 9% немецких и 20% французских глав компаний начали использовать GenAI. Среди американских и китайских руководителей этот показатель составил 38% и 25% соответственно. Более высокие темпы внедрения показали только Норвегия (53%), Япония (50%) и Финляндия (49%).
Кевин Эллис, ведущий партнер в PwC UK, отметил: «Преодолевая экономические трудности, британские руководители ищут новые решения для прорыва. GenAI открывает критически важный момент: если его правильно использовать, он может значительно повысить эффективность, конкурентоспособность и, в конечном счете, прибыльность компаний».
Вот у вас в компании внедряют GenAI?
#почитатьнатему
На международном экономическом форуме в Давосе основным из основных вопросов в повестке стал ИИ.
Итоги интересного исследования были рассказаны PwC. В своем последнем годовом опросе глав компаний было выявлено, что около половины (42%) британских руководителей внедрили новейшие технологии в прошедшем году. Это существенно превышает мировой показатель, который составил 32%.
Исследование, охватившее 4702 генеральных директоров из 105 стран, показало, что Великобритания является одним из лидеров в применении генеративного ИИ, который управляет такими чат-ботами, как ChatGPT, и создателями изображений, например, Midjourney. В сравнении, только 9% немецких и 20% французских глав компаний начали использовать GenAI. Среди американских и китайских руководителей этот показатель составил 38% и 25% соответственно. Более высокие темпы внедрения показали только Норвегия (53%), Япония (50%) и Финляндия (49%).
Кевин Эллис, ведущий партнер в PwC UK, отметил: «Преодолевая экономические трудности, британские руководители ищут новые решения для прорыва. GenAI открывает критически важный момент: если его правильно использовать, он может значительно повысить эффективность, конкурентоспособность и, в конечном счете, прибыльность компаний».
Вот у вас в компании внедряют GenAI?
#почитатьнатему
the Guardian
Geopolitical tensions and AI dominate start of World Economic Forum
Ukraine, Middle East and Taiwan overshadow annual meeting at Davos, with artificial intelligence also high on agenda
Про обучение ИИ и интеллектуальные права.
Не первая попытка СМИ заставить платить за свой контент может окончиться провалом. Вообще тут я на стороне СМИ в части оплаты их труда, но хорошее решение все еще не найдено, как мне кажется.
#кейсдатаэтики
⬇️⬇️⬇️
Не первая попытка СМИ заставить платить за свой контент может окончиться провалом. Вообще тут я на стороне СМИ в части оплаты их труда, но хорошее решение все еще не найдено, как мне кажется.
#кейсдатаэтики
⬇️⬇️⬇️
👍1
Forwarded from Denis Sexy IT 🤖
Если вы помните, издание NY Times, в конце того года, подало в суд на OpenAI – якобы, в моделях OpenAI находится множество их статей, поэтому NY Times требуют уничтожить все модели натренированные с применением их данных (а это и GPT 3.5, GPT 4 и все эти тысячи опенсорсных моделей которые натренированы на ответах GPT 4).
Юристы которых я читал, говорят, что NY Times просто добивается лицензирования своего контента, так как это денюжки, а у OpenAI они есть, и что закончится все соглашением сторон – обычное дело в мире юристов.
Но интернету не понравилось как NY Times сформулировала свою угрозу, так как если «в теории» они выиграют, то сильно пострадает мир опенсорса.
Чувак с реддита, с помощью языковой модели, проанализировал в деталях стиль написания статей NYC Times и сделал на этой основе открытый датасет для включения в будущие тренировки.
У датасета хорошая лицензия MIT и он по сути учит языковую модель писать статьи в стиле NY Times, но не нарушает копирайты:
https://huggingface.co/datasets/TuringsSolutions/NYTWritingStyleGuide
Стрейзант эффект на уровне датасетов🍿
Юристы которых я читал, говорят, что NY Times просто добивается лицензирования своего контента, так как это денюжки, а у OpenAI они есть, и что закончится все соглашением сторон – обычное дело в мире юристов.
Но интернету не понравилось как NY Times сформулировала свою угрозу, так как если «в теории» они выиграют, то сильно пострадает мир опенсорса.
Чувак с реддита, с помощью языковой модели, проанализировал в деталях стиль написания статей NYC Times и сделал на этой основе открытый датасет для включения в будущие тренировки.
У датасета хорошая лицензия MIT и он по сути учит языковую модель писать статьи в стиле NY Times, но не нарушает копирайты:
https://huggingface.co/datasets/TuringsSolutions/NYTWritingStyleGuide
Стрейзант эффект на уровне датасетов
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Про ИИ и Олимпийские игры.
Давно я тут не писала, но тема дата-этики не перестала быть мне интересной. Я все еще раскачиваю навык видеть данные в любом событии. В том числе потому что последнее время (по работе) проповедую мысль, что данные есть под любым процессом. Вот например, мне тут на днях подарили бейсболку с олимпийским мерчом и я вспомнила про эту новость.
Понятно, что Олимпийские игры сами по себе очень напряженное мероприятие, но в этот раз организаторы обеспокоены еще и тем, что летние игры могут быть особенно жестокими из-за политических столкновений и конфликтов на Ближнем Востоке и в Европе.
МОК прогнозирует около 500 миллионов постов в соцсетях, связанных с Олимпиадой в этом году — и не все из них будут дружелюбными. "Если бы кто-то тратил одну секунду на прочтение каждого поста, это заняло бы 16 лет," — заявил президент МОК Томас Бах на прошлой неделе.
И вот тут в игру вступает ИИ и этика данных: МОК планирует использовать ИИ-инструмент, который будет отмечать и удалять оскорбительные посты на более чем 35 языках, чтобы защитить 15 000 спортсменов и организаторов от травли.
К тому же, эта инициатива также поможет исследователям понять масштаб проблемы — и как оскорбления могут влиять на благополучие спортсменов. Это будет первый случай использования ИИ для защиты такого большого числа спортсменов одновременно.
#кейсдатаэтики
Давно я тут не писала, но тема дата-этики не перестала быть мне интересной. Я все еще раскачиваю навык видеть данные в любом событии. В том числе потому что последнее время (по работе) проповедую мысль, что данные есть под любым процессом. Вот например, мне тут на днях подарили бейсболку с олимпийским мерчом и я вспомнила про эту новость.
Понятно, что Олимпийские игры сами по себе очень напряженное мероприятие, но в этот раз организаторы обеспокоены еще и тем, что летние игры могут быть особенно жестокими из-за политических столкновений и конфликтов на Ближнем Востоке и в Европе.
МОК прогнозирует около 500 миллионов постов в соцсетях, связанных с Олимпиадой в этом году — и не все из них будут дружелюбными. "Если бы кто-то тратил одну секунду на прочтение каждого поста, это заняло бы 16 лет," — заявил президент МОК Томас Бах на прошлой неделе.
И вот тут в игру вступает ИИ и этика данных: МОК планирует использовать ИИ-инструмент, который будет отмечать и удалять оскорбительные посты на более чем 35 языках, чтобы защитить 15 000 спортсменов и организаторов от травли.
К тому же, эта инициатива также поможет исследователям понять масштаб проблемы — и как оскорбления могут влиять на благополучие спортсменов. Это будет первый случай использования ИИ для защиты такого большого числа спортсменов одновременно.
#кейсдатаэтики
Reuters
AI to erase abusive posts to athletes at Paris Olympics-IOC
The International Olympic Committee will deploy AI in order to block any abuse on social media directed at 15,000 athletes and officials at the Paris Olympics next month, President Thomas Bach said on Friday.
👍5
Привет! У нас тут внезапно прибавилось подписчиков, поэтому это отличный момент, чтобы познакомиться и обновить название канала :)
Меня зовут Ольга Саваровская. Я уже давно работаю с данными. Раньше я работала с госданными, например, участвовала в большом проекте по улучшению качества данных и разрабатывала концепцию управления госданными. Сейчас я работаю менеджером по управлению данными в крупной ритейл-компании и одновременно являюсь амбассадором по безопасности и конфиденциальности данных в компании. В сферу моих интересов входят управление данными, конфиденциальность и защита данных, этика и использование данных, анализ и аналитика, а теперь ещё и искусственный интеллект, как логичное продолжение всех этих тем. Мне интересно рассматривать эти вопросы через призму их социально-экономического влияния. В этом канале я делюсь интересными кейсами из этих сфер. Раньше я больше фокусировалась на дата-этике, но со временем круг моих интересов расширился, хотя изначальная тема всё равно остаётся приоритетной.
Буду рада, если вы тоже будете делиться со мной соответствующими новостями и кейсами.
Меня зовут Ольга Саваровская. Я уже давно работаю с данными. Раньше я работала с госданными, например, участвовала в большом проекте по улучшению качества данных и разрабатывала концепцию управления госданными. Сейчас я работаю менеджером по управлению данными в крупной ритейл-компании и одновременно являюсь амбассадором по безопасности и конфиденциальности данных в компании. В сферу моих интересов входят управление данными, конфиденциальность и защита данных, этика и использование данных, анализ и аналитика, а теперь ещё и искусственный интеллект, как логичное продолжение всех этих тем. Мне интересно рассматривать эти вопросы через призму их социально-экономического влияния. В этом канале я делюсь интересными кейсами из этих сфер. Раньше я больше фокусировалась на дата-этике, но со временем круг моих интересов расширился, хотя изначальная тема всё равно остаётся приоритетной.
Буду рада, если вы тоже будете делиться со мной соответствующими новостями и кейсами.
👍5🔥4
Саваровская | Интересное о данных pinned «Привет! У нас тут внезапно прибавилось подписчиков, поэтому это отличный момент, чтобы познакомиться и обновить название канала :) Меня зовут Ольга Саваровская. Я уже давно работаю с данными. Раньше я работала с госданными, например, участвовала в большом…»
Про устойчивый ИИ и энергопотребление.
Я тут недавно была на корпоративном тренинге, и там мы в том числе обсуждали интересную тему — устойчивый ИИ (Sustainable AI).
Одним из вопросов была энергопотребляемость современных языковых моделей, таких как ChatGPT. Оказывается, один запрос может потреблять около 0,0003 кВт⋅ч энергии. Получается, что миллионы пользовательских запросов ежедневно могут потреблять до 1 ГВт⋅ч энергии, что эквивалентно потреблению электроэнергии 33 тысяч домохозяйств. Углеродный след, который может достигать 7-15 тонн CO2 в день, что эквивалентно углеродному следу от примерно 1000 автомобилей в день. Интересно, что придумают завтра, чтобы минимизировать этот эффект? Думаю, научатся оптимизировать. Сложно представить, какую новую технологию тут можно придумать.
#подуматьнатему
Я тут недавно была на корпоративном тренинге, и там мы в том числе обсуждали интересную тему — устойчивый ИИ (Sustainable AI).
Одним из вопросов была энергопотребляемость современных языковых моделей, таких как ChatGPT. Оказывается, один запрос может потреблять около 0,0003 кВт⋅ч энергии. Получается, что миллионы пользовательских запросов ежедневно могут потреблять до 1 ГВт⋅ч энергии, что эквивалентно потреблению электроэнергии 33 тысяч домохозяйств. Углеродный след, который может достигать 7-15 тонн CO2 в день, что эквивалентно углеродному следу от примерно 1000 автомобилей в день. Интересно, что придумают завтра, чтобы минимизировать этот эффект? Думаю, научатся оптимизировать. Сложно представить, какую новую технологию тут можно придумать.
#подуматьнатему
University of Washington
Q&A: UW researcher discusses just how much energy ChatGPT uses
Training a large language model, such as ChatGPT, uses on average roughly equivalent to the yearly electricity consumption of over 1,000 U.S. households, according to Sajjad Moazeni, UW assistant...
👍2😱2