Саваровская | Интересное о данных
87 subscribers
12 photos
116 links
Про то, как данные влияют на людей — и наоборот. О честности, культуре и здравом смысле в эпоху ИИ.

Для связи (прислать мне что-то интересное, например) - @savarovskaya
Download Telegram
Про то, что вопрос этики данных - вопрос не только ИТ-отрасли.

74% директоров по маркетингу крупнейших брендов заявляют, что этика данных станет для них еще более важным вопросом в ближайшие пять лет. Об этом говорят результаты исследования WFA (Всемирной Федерации рекламодателей) весны 2020 года. 82% - подумали бы об уходе от своего работодателя, если бы сочли подход к данным неэтичным. 26% - уже испытывали дискомфорт по поводу использования данных в какой-то момент своей карьеры. Все эти цифры показывают, что вопросы этичной практики работы с данными беспокоят не только ИТ-индустрию, но и другие отрасли экономики. Например, digital advertising.

В июне 2020 года WFA выпустила первое в мире руководство по этике данных для брендов. Совет директоров, в состав которого входят эксперты из 19 крупнейших мировых компаний, включая Ferrero, Ikea, L'Oréal, Mars, Mastercard, P&G, Shell, Unilever и Visa, подробно рассмотрел вопросы влияния этического подхода к данным на компании и людей. Итогом стал отчет "Этика данных: проявление морали в технологиях" - как способ сказать отрасли, что этика данных - это шаг к здоровому цифровому обществу.

Отчет состоит из пяти частей: описывает случаи необходимости его применения и культурную трансформацию, устанавливает ключевые принципы, приводит конкретные кейсы и предлагает руководство к действию.

Основные эффекты, к которым должно привести внедрение этики данных:
🔹 Изменение культурного кода (Чтобы построить здоровую систему, нам нужно вмешиваться в решение этических дилемм до того, как они станут настоящими проблемами, и действовать совместно);
🔹 Разнообразие и инклюзивность (Мы устраняем предвзятость, включаем исключенных и радуемся своему многообразию);
🔹 Доверие (Если люди считают, что в компании обращаются с их данными неэтично, то демонстрация соблюдения законодательства не поможет сохранить ее репутацию).

Последний эффект заслуживает особого внимания. Разработчик руководства заявляет, что "оригинальные решения приходят тогда, когда ты разрешаешь напряженность между информационными инновациями и людьми, ожидающими защиту данных. Хороший выход — когда ты идешь на пределе технических возможностей и при этом не жертвуешь своей приверженностью безопасности." Получается, в конечном итоге этика данных влияет на решения задач отрасли - привлечение клиентов.

И снова тут можно подвести итог, что этика данных в современном мире нужна везде. В том числе ради достижения бизнес-целей.

#переходкэтичному #почитатьнатему
Про предвзятость алгоритмов.

Посмотрела ещё один фильм Netflix о предвзятости алгоритмов Coded bias.
Есть несколько идей, которые подсвечивают в фильме, и на которые мне тоже хотелось бы обратить внимание. Начну с главной.

Предвзятость алгоритмов - это предвзятость людей. Алгоритмы разрабатываются на основании сведений, которыми уже обладает человечество. И если алгоритм разработан людьми с дискриминирующими стереотипами на основании данных, созданных людьми с дискриминирующими стереотипами, - то и сам алгоритм будет дискриминирующим.

Примером того, что алгоритм - это отражение поведения людей, служит кейс с чат-ботом Microsoft. В 2016 году в Twitter был запущен чат-бот Tay.ai. Предполагалось, что он будет общаться с молодыми людьми на «их языке» и обучаться в процессе общения. К сожалению, уже через сутки бот начал возвращать расистские и оскорбительные высказывания, отвечая пользователям. Он повторял за пользователями, что Джордж Буш устроил теракты 9/11, а Гитлер всяко лучше Барака Обамы, и вскоре начал писать неонацистские высказывания. Работу Tay.ai пришлось остановить.

Важно учитывать предвзятость нашего восприятия действительности как при разработке алгоритмов, так и при разработке законодательства.

#кейсдатаэтики
Про несимметричные отношения с алгоритмами.

Ещё одна одна мысль, которая подсвечивается в фильме Coded Bias (Netflix, 2020), это невозможность аппелировать к алгоритмически полученным решениям.

Принятие решений уже перекладывается на алгоритмы, тогда как их фактическая зрелость вызывает вопросы.

Очередной кейс от Amazon. Компания оснастила автомобили доставщиков умными камерами, которые следят за поведением водителей. Любой промах (забыл пристегнуться, резко затормозил, слишком долго смотрел в боковое зеркало, а не вперёд) - штраф. Водители страдают и получают штрафы ни за что, но общая эффективность доставки растёт.

Как и в ситуации с опозданиями, (учитываемыми алгоритмами и являющимися основанием для увольнения) прав у работников почти никаких - доказать отсутствие вины практически невозможно.

И вот этот момент - ключевой. Как аппелировать к алгоритмическому решению в отношении человека, если такой процесс изначально не закладывался?

Ну и нужно понимать, что эта этическая проблема в итоге преобразуется в проблему экономическую.

#кейсдатаэтики
Про кодексы этики.

Логичным продолжением работы с данными является развитие искусственного интеллекта. Во многих странах начали активно заниматься этим вопросом, в том числе не пропуская этап разработки этического кодекса.

В России прямо сейчас идёт активное обсуждение проекта такого кодекса.

В мире также есть примеры уже принятых кодексов этики в сфере ИИ, такие как:
️ Австралийские этические принципы ИИ
️ Южнокорейское этическое руководство в сфере ИИ
️ Итальянское правительственное заявление о службе ИИ на благо общества
и ещё с десяток других.

Тут большой объём разных идей, даже можно провести исследование на тему того, какой фокус этики в разных странах.

Но обратить внимание я хотела на последнюю новость. Недавно и в Китае опубликовали правила этики искусственного интеллекта. Самым интересным правилом мне кажется вот это: люди должны иметь возможность выбора, взаимодействовать с ИИ или нет, и отказаться от услуг ИИ по своему желанию.

Институт апелляции к результатам работы алгоритмов, возможность сохранения решения за человеком - залог этичного подхода к работе с данными.

А принятие кодексов этики в целом мне кажутся важной вехой в переходе к этичной практике.

#почитатьнатему
Про тренды 2022 года.

Gartner назвал хайповые технологии следующего года. Не у всех ещё есть русскоязычные названия, так что у нас впереди новые красивые слова в стратегиях и публичных выступлениях. Вот эти тренды:

1. Generative Artificial Intelligence (AI)
2. Data Fabric
3. Distributed Enterprise
4. Cloud-Native Platforms (CNPs)
5. Autonomic Systems
6. Decision Intelligence (DI)
7. Composable Applications
8. Hyperautomation
9. Privacy-Enhancing Computation (PEC)
10. Cybersecurity Mesh
11. AI Engineering
12. Total Experience (TX)

Самые интересные с точки зрения новых сфер, в которых будут всплывать вопросы этической работы с данными, - это первые два.

Generative AI - методы машинного обучения, которые изучают данные и описанные в них объекты и используют их для создания совершенно новых, полностью оригинальных и реалистичных артефактов.

Generative AI может использоваться для ряда действий, таких как создание программного кода, содействие разработке лекарств и целевой маркетинг, но также может использоваться для мошенничества, политической дезинформации, подделки личности и многого другого. К 2025 году Gartner ожидает, что на Generative AI будет приходиться 10% всех производимых данных, по сравнению с менее чем 1% сегодня.

Data fabric - гибкая, устойчивая интеграция данных между платформами и бизнес-пользователями.

Настоящая ценность Data fabric заключается в ее способности динамически улучшать использование данных с помощью встроенной аналитики, сокращая усилия по управлению данными до 70% и ускоряя время окупаемости.

Эти новые решения приведут к появлению новых «узких мест» - зон, где мы ещё не успели подумать об этике.

#переходкэтичному
Про распознавание лиц.

В то время как Meta сворачивает программу распознавания лиц в Facebook, Московские власти активно продолжают внедрять технологии распознавания лиц в метро.

Обе инициативы вызывают вопросы.

1. Одним из основных этических принципов сбора информации является недопущение излишнего сбора. И в случае Московского метро технология распознавания лиц - это пример неоправданно лишнего получения информации. Пройти в метро по карточке также легко, как и по технологии FacePay, но сбор биометрии влечет за собой понятные риски (по ИБ в частности).

2. Отказ от применения новых технологий фактически нереален. Даже если свернуть какую-то программу, как делает Meta, это не сможет остановить внедрение такой технологии повсеместно.

И тут мы приходим в выводу, что новые технологии нужно использовать, но делать это разумно и этично. Необходимо создать правовое регулирование, необходимо следовать кодексам этики со стороны государства, необходимо повышать грамотность и осознанность населения в работе и жизни с новыми технологиями.

#кейсдатаэтики #переходкэтичному
Завтра выступаю с докладом на тему актуальности Кодекса этики использования данных спустя два года с момента его подписания на форуме "Всемирный день качества - 2021".

Расскажу про сам кодекс, что он дает участникам и почему важно придерживаться принципов, в нем изложенных.

Вот тут: https://kachestvo.pro/vdk2021/program/11663/ Обещают онлайн-трансляцию.
Про обучение дата-этике.

Вопросы этичных практик в новых технологиях все чаще поднимаются в СМИ и общественных дискуссиях, в следствии чего растет интерес к тому, какую роль этика должна играть в компьютерном образовании.

В университетах все чаще появляются отдельные курсы по этике, что неизбежно ведет к тому, что и в отдельных он-лайн курсах, доп.образовании и т.д. появляются модули, посвященные этичным вопросам применения современных технологий.

Но в зависимости от экспертизы преподавателей и основной идеи курса (курс это о данных, или о праве, или о маркетинге, и т.д.) акценты и тематики модулей про этику применения технологий могут отличаться. Например, дата-этика может рассматриваться со следующих сторон:

1. Право и политика (law and policy)
2. Приватность и слежка (privacy & surveillance)
3. Философия (philosophy)
4. Правосудие и права человека (justice & human rights)
5. Социальные последствия (civic responsibility)
6. Роботы и ИИ (robots & AI)
7. Дезинформация (disinformation)
8. Трудовые отношения (work & labor)
и т.д.

Сasey Fiesler (доцент в University of Colorado Boulder) запостила в Твиттере ссылку на редактируемый гугл-док, где она вела перечень таких курсов - о tech-ethics. Сейчас там список из более 300 курсов на заданную тему. В 2020 году (когда записей было 115) она с коллегами провела анализ учебных программ этих курсов. Их анализ дает представление о содержании и целях занятий по этике в технологиях, а также рекомендации о том, как они могут быть интегрированы в учебную программу по вычислительной технике.

Я уже говорила, что про дата-этику должны думать не специально обученные люди, а все. И вот это исследование можно использовать как мини-путеводитель для выбора.

#переходкэтичному #почитатьнатему
Про таргетинг.

В Кодексе этики использования данных есть пара принципов, касающихся использования данных в маркетинге. Один из них звучит так: Признается добросовестной практикой использование данных для прямого (таргетированного) маркетинга, если персонифицированные предложения позволяют потенциальному приобретателю обеспечить оптимальный выбор товаров (работ, услуг), а также при условии предоставлении потенциальному приобретателю возможности отказаться от получения таких персонифицированных предложений.

Однако, как обеспечить оптимальный выбор товаров? Мы постоянно сталкиваемся с ситуацией, когда что-то поискали в интернете, а потом на каждой страничке это что-то нам предлагается.

Эти предложения могут быть очень чувствительными для пользователей, если вдруг они касаются каких-то личных проблем или дискриминирующего фактора. У пользователей к бигтеху возникает много этических вопросов по поводу такой рекламы.

Например, Gillian Brockell (авторке статей Washington Post) долго показывали рекламу для беременных, даже после того, как она потеряла ребёнка.

Так что давно ожидаемый шаг в этом направлении делает Meta. С января в Facebook и Instagram нельзя будет таргетировать рекламу по "чувствительным" категориям аудитории, таким как раса, политические предпочтения, религиозные взгляды, сексуальная ориентация, здоровье и другие.

#переходкэтичному #кейсдатаэтики
(история взята отсюда: https://t.me/brodetsky)
Про темные паттерны.

Еще одним недавним примером темных паттернов стал кейс, как App Store за период чуть более месяца поднял рейтинг своего приложения Apple Podcasts с 1,8 до 4,7 звёзд. Судя по тому, что пишет The Verge, приложение предлагало поставить пользователю оценку таким образом, что пользователь думал, что ставит оценку конкретному подкасту (судя по новым отзывам).

Желание повысить рейтинг приложению понятно. Оно предустановлено и мало кто пойдёт его оценивать положительно специально. Но, учитывая роль, какую играет эта оценка (повышение продаж), доминирующее положение в App Store для приложения от Apple, полученное такими методами - плохая практика. Минус десять очков Слизерину Ещё один довод отказаться от App Store со всеми вытекающими.

Я уже писала, что темные паттерны - одна из самых неэтичных практик. И они могут возникать там, где мы их совсем не ждём.

#кейсдатаэтики
Про этичность сбора данных.

Сейчас данные собираются просто со всего, с чего можно их собрать. И конечно, данные собираются при любом использовании современных ИТ-решений. Например, смарт-телевизоров.

Не так давно эксперты в отрасли заметили, что в квартальном отчете компании Vizio (она производит популярные дешевые телевизоры для рынка США в первую очередь) указана прибыль с продажи смарт-ТВ в размере $25,6 млн и в размере $57,3 млн с продажи данных о пользователях. Сведения обезличены и продаются маркетологам и рекламщикам. Но уверенности, что пользователи об этом знают, конечно нет.

Тут действует простое правило: когда вы получаете что-то даром или дешево - скорее всего вы просто не понимаете как перепродают вас самих.

#кейсдатаэтики
(история взята отсюда: https://t.me/addmeto)
Про понятие «дата-этика».

Сегодня немного ликбеза. Что такое дата-этика? Оксфордские профессоры и философы Luciano Floridi и Mariarosaria Taddeo в своей статье «What is data ethics?» дают следующее определение (мой вольный перевод):

«Дата этика - это новое направление этики, которое изучает и описывает моральные проблемы, связанные с использованием данных (включая создание, управление, использование, передачу и получение), алгоритмов, основанных на данных (включая искусственный интеллект, машинное обучение и роботов), а так же сопутствующих практик (включая программирование, хакерство, социально-ответственные инновации и профессиональные кодексы) для того чтобы сформулировать и поддержать хорошие (с моральной точки зрения) решения.»

Т.е. дата-этика касается и данных, как таковых, и технологий, необходимых для их обработки, и людей, этим занимающихся.

Добавлю тут, вопросы дата-этики можно условно разделить на три категории:
⁃ Моральные проблемы, которые уже существовали (и использование современных технологий их только усугубляет);
⁃ Моральные проблемы, которые возникли при внедрении новых технологий;
⁃ Моральные проблемы, которые возникнут в будущем.

И в зависимости от классификации такие проблемы будут требовать разных решений и подходов.

#почитатьнатему
Про новогодние шоу.

У The Guardian интересная статья-рассуждение о том, не вытеснят ли шоу дронов фейерверки.

Учитывая то, как в последнее время активно обсуждают в медиа страдания домашних животных от грохота фейерверков, а дроны могут показывать сюжеты гораздо зрелищнее, - это была бы отличная, в том числе этичная по отношению к животным, современная технологическая практика.

#кейсэтикитехнологий
(история взята отсюда: https://t.me/techsparks)
Forwarded from WrongTech (Nikolay Rudenko)
Маск, Илон Маск.

Вы, наверное, уже слышали, что журнал "Times" назвал Илона Маска человеком года. Не удивительно - Times в основном любит объявлять людьми года техномиллиардеров. Но все равно это хороший повод поразмышлять о Маске.

В статье Times обстоятельно описана многогранная личность Маска: его травматическое детство, талант инженера, эпическое видение будущего, мелочность и жесткость. Но одно качество явно импонирует Times: это либертарианство Маска. Стремление вырваться из-под регулирования и правил самого разного рода. Особенно государственных. Построить на Марсе колонию, свободную от традиционных социальных и политических оков. Дать возможность каждому человеку заниматься, чем он захочет, пока роботы делают всю грязную и опасную работу. Исследователи называют такое видение "калифорнийской идеологией".

Интересно, как это либертарианство работает в случае с Tesla. В отличие от других беспилотных проектов, Маск не тратил десятки лет на разработку и тестирование. Он сначала продал "глупые" машины покупателям, а потом стал превращать их в умные. При таком подходе ему не нужно сертифицировать свои беспилотные машины, тестировать согласно правилам того или иного штата. И при этом его машины уже не дорогах, проехали миллиарды км и собрали данных больше, чем Waymo и Яндекс вместе взятые.

Но есть и обратная сторона: Tesla попадают в аварии чаще других беспилотников; чтобы продаться, они завышают свой уровень автономии; обещания не сдерживаются; а машины все еще не стали достаточно умными. Особенно проблематично то, что водители убирают руки с руля или вешают туда банан, хотя Tesla им напоминает, что так делать не нужно. Поэтому Tesla изобретает все более жесткие меры, чтобы дисциплинировать людей: например, вводят систему рейтинга водителей.

И здесь либертарианство Маска сталкивается со своей противоположностью: желая дать людям больше свободы, оно в итоге их больше контролирует. Уходя от регуляторных ограничений, оно приводит к бóльшему количеству аварий, и как следствие, к большему регулированию, а не меньшему. Такая диалектика Маска получается. Хотя есть и положительная для Маска сторона диалектики: несмотря на все проблемы, Маск сегодня - самый богатый человек в мире, Tesla стоит дороже, чем старые автогиганты типа Форда, а сам Маск - человек года.
Саваровская | Интересное о данных
Про предвзятость алгоритмов. Посмотрела ещё один фильм Netflix о предвзятости алгоритмов Coded bias. Есть несколько идей, которые подсвечивают в фильме, и на которые мне тоже хотелось бы обратить внимание. Начну с главной. Предвзятость алгоритмов - это…
Поведение людей в отношениях с чат-ботами все ещё может вызывать этические вопросы.

В сообществе пользователей Replika (приложение, которое позволяет создать персонального чат-бота, подстраивающегося под ваш стил общения) на Reddit появился тренд — мужчины создают чатбота-девушку, а затем начинают её абьюзить. С одной стороны — лучше так, чем абьюзить реального человека. Но одно другому не мешает — можно использовать приложение как тренажер для оттачивания токсичного общения и манипуляций в реале.

Знание, которое люди передают машинам, и форма его использования - это все этические вопросы будущего. Может накопленные примеры потом помогут вылавливать реальный кибер-буллинг и блокировать его. Так что в каждой истории может быть несколько точек, когда можно свернуть «не туда» и вернуться обратно.

#кейсдатаэтики
(история взята отсюда: https://t.me/brodetsky)
Forwarded from addmeto (Grigory Bakunov 🧪)
В обновленном Телеграм есть кнопока “перевести текст” и выбор того, с какого языка переводить не надо. На iOS эта кнопка вызывает системный интерфейс для перевода, а вот на андроиде свой собственный интерфейс, довольно удобный но вызывающий вопрос: а кто платит? Дело в том, что на iOS система перевода работает прямо на устройстве, а на Android вызывается гугл-переводчик, он платный если использовать его в вашем приложении. Слава богу, клиент телеграм открытый и люди уже посмотрели в код а там, вместо использования официального API гуглтранслейта, явно используется совершенно нестандартный API, который не требует оплаты потому, что прикидывается встроенным переводчиком Google Chrome 🙂

При этом это место довольно хитро спрятано и в коде самого телеграма, и чтобы не вызывало вопросов - устроена подмена юзер-агента в запросе. Короче красиво все и хитро. Жаль, что довольно быстро этот фокус придется убирать - гугл будет очень недоволен https://danpetrov.xyz/programming/2021/12/30/telegram-google-translate.html
Forwarded from One Big Union (Ян Веселов)
Интересная история в Wall Street Journal на стыке религии, интернета и цифрового капитализма.

Частный бизнес и политические кампании регулярно используют персональную информацию интернет-пользователей для таргетирования потенциальных клиентов, спонсоров или сторонников. Но теперь в этот "цифровой вагон" решили запрыгнуть и религиозные организации, которые обычно опираются на более традиционные методы рекрутинга прихожан.

Стартап под названием Gloo анализирует персональные данные американцев, предлагая церквям профили людей и групп, которые могут быть наиболее восприимчивы к их проповедям. Согласно полученным WSJ документам, у Gloo есть профили на 245 млн. жителей США. Среди них компания отбирает потенциальных прихожан: людей, страдающих от депрессии и наркозависимости, проблем в семье или переживающих развод, либо потерю близких.

Алгоритмы Gloo даже вычисляют тех, кто потенциально может столкнуться с такими проблемами, а потому может быть открыт к религиозной рекламе. Например, они приобрели базу данных 30 тыс. разведенных пар американцев, проанализировали их данные (кредитную историю, данные по передвижениям и здоровью) и на основе этого выделили еще 33 млн замужних людей, которым грозит развод.

Выделив профили людей, находящихся в группах риска, Gloo затем продвигает им рекламные объявления различных религиозных организаций в соцсетях или поисковых выдачах Google. Сейчас клиентами Gloo является около 30 тыс. церквей или почти 10% от всех существующих в США.

Подобное во многом возможно благодаря тому, что в США по сути отсутствуют нормальные законы о защите данных в интернете. Ну а со стороны церквей интерес тоже понятен: c 2009 года количество людей, относящих себе к той или иной религиозной организации снизилось с 63% до 51%, а регулярных прихожан (посещающих службы раз в месяц и чаще) - c 52% до 45%. Особенно сильное снижение наблюдается среди молодежи, а во время пандемии посещение церквей упало на 30-50%.
Все думала о том, какой бы привести пример именно этичной практики использования данных, и думаю вот этот самый насущный вполне подойдет.

На карантин, как вы знаете, отправляют не только заболевших Covid-19, но и контактных. При этом, сам процесс выявления контактных совсем не прозрачен. Понятно, когда речь идет о коллегах / однокурсниках / одноклассниках или людях, проживающих совместно с заболевшими. Но также есть случаи, когда человек получает сообщение, что у него был контакт, но ситуации, описанной выше, не было. В этом случае речь идет о передаче перс.данных о контактном, очевидно без согласия. Скорее всего, с правовой точки зрения, эта ситуация находится в т.н. "серой зоне", т.е. не отрегулирована достаточно конкретно. Однако с этической точки зрения, это вполне приемлемая ситуация и именно так и должны действовать обладатели этой информации.

#кейсдатаэтики
Вот, кстати, очередной отличный пример о том, что вроде бы неперсональная информация может быть вполне персональной. И ее использование не выдерживает этических рамок.

#кейсдатаэтики
⬇️⬇️⬇️
Forwarded from addmeto (Grigory Bakunov 🧪)
Новости авиации: Илон Маск пытается добиться, чтобы автор твиттер бота, рассказывающего, куда летает самолет Маска, прекратил это делать. Мальчик написал бота, который забирает данные по полетам известного борта Илона Маска из готовых флайт-трекеров (наверное, самые популярные — это flightradar24 и adsbexchange) и пушит в обычный твиттер-аккаунт сообщение “приземлился в Остине, Техас” с картинкой, показывающей окончание маршрута.

У аккаунта почти 120к подписчиков, однако Илон пока не смог добиться его выключения. Все это наводит на простые мысли: доступность информации иногда приводит к сложным для безопасности последствиям, веб2.0, мягко говоря, тоже не без проблем, адекватных людей в мире не так уж и много.

https://www.protocol.com/elon-musk-flight-tracker
Иногда этичность действия зависит не от самого действия, а от субъекта.

Например, когда данные о геолокации продают какие-то "мусорные" приложения, мы к этому относимся совершенно спокойно. Но вот в ситуации, когда геолокационные данные продает приложение, функция которого - обеспечивать семейную безопасность, а именно, отслеживать перемещения детей, то такое действие вызывает вопросы.

#кейсдатаэтики