Forwarded from Гуманитарии в цифре
За последние десятилетия масштабная цифровизация исторических источников – архивами, библиотеками, музеями и международными исследовательскими консорциумами – радикально изменила поле гуманитарных исследований.
Цифровая доступность материалов не только упростила доступ к источникам, но и повлияла на сами исследовательские вопросы. Сегодня ученые все чаще работают с большими массивами данных, используя подходы distant reading/distant viewing, thick mapping/deep mapping.
Цифровой поворот привел к пространственному: карты, планы и другие картографические источники стали доступнее, а инструменты ГИС – привычной частью исследовательской практики. С их помощью можно визуализировать данные, анализировать пространственные закономерности, сопоставлять источники и реконструировать исторические среды.
Материал Open Maps – вводный обзор, предназначенный для широкой научной аудитории, интересующейся тем, как меняются подходы исследователей-гуманитариев к работе с картами. Рассматриваются, в частности:
• инструменты автоматического анализа карт, такие как MapReader, позволяющий разбивать карты на фрагменты и обучать модели для распознавания объектов
• подходы к извлечению данных из карт с помощью нейросетей
практики векторизации и послойной работы с данными в ГИС
• интеграция разнородных данных (адресных книг, кадастров, атласов) и их привязка
• инициативы, связанные с реконструкцией прошлого.
Иллюстрация: Аннотированная карта южного побережья Индии (ок. 1752–1757) (Национальный архив Нидерландов)
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6❤2👍2
Владимир Определенов: Создание музея в цифровую эпоху: почему "цифра" — это не стратегия, а условие
Приглашаем на четвертый семинар серии "Цифровая история Центральной Азии и Южного Кавказа". Доклад посвящен созданию музея через призму цифровой трансформации — на основе практического опыта запуска Almaty Museum of Arts. Владимир Определенов расскажет, как цифровые технологии интегрируются в миссию, архитектуру и операционную деятельность институции, формируя музей нового типа, спроектированный "digital by default".
⏰ 13 мая, 15:00 CET | 17:00 Ереван и Тбилиси | 18:00 Ташкент и Алматы | 19:00 Бишкек
Больше информации.
Регистрация.
Приглашаем на четвертый семинар серии "Цифровая история Центральной Азии и Южного Кавказа". Доклад посвящен созданию музея через призму цифровой трансформации — на основе практического опыта запуска Almaty Museum of Arts. Владимир Определенов расскажет, как цифровые технологии интегрируются в миссию, архитектуру и операционную деятельность институции, формируя музей нового типа, спроектированный "digital by default".
⏰ 13 мая, 15:00 CET | 17:00 Ереван и Тбилиси | 18:00 Ташкент и Алматы | 19:00 Бишкек
Больше информации.
Регистрация.
👍4❤3
DH CLOUD
Владимир Определенов: Создание музея в цифровую эпоху: почему "цифра" — это не стратегия, а условие Приглашаем на четвертый семинар серии "Цифровая история Центральной Азии и Южного Кавказа". Доклад посвящен созданию музея через призму цифровой трансформации…
Это уже сегодня - и еще не поздно зарегистрироваться!
❤1
📢 Вышел новый номер «Цифровых гуманитарных исследований» (2026 №1)! 🧙
Еще глубже погружаемся в мир DH — от поэзии Вознесенского до уличного искусства в метавселенных и искусственного интеллекта в науке.
🔍 Что внутри:
📌 ИССЛЕДОВАНИЯ
🧙 Дарья Тюрякова-Матвеева проанализировала 1678 произведений Андрея Вознесенского с помощью NER, LLM и сетевого анализа. Кого поэт упоминал чаще всего? Пастернака, Пушкина, Маяковского… и самого себя.
🧙 Мария Акимова и Полина Кныш — о том, переезжает ли аура стрит-арта в цифру: от архивов RAAN до метавселенных Spatial. Бетон и бит, оригинал и копия.
🧙 Мария Богданович — обзор провенанс-исследований в библиотеках Германии: MARC, T-PRO, CIDOC-CRM и как цифра помогает искать «следы» книг.
🧙 Василий Глущенко — как в 1990–2000‑х герменевтика античного текста превратилась из «книги на экране» в «универсум в базе данных» (TEI, EpiDoc, Homer Multitext).
📌 ХРОНИКА
🧙 Мария Романюк — острый репортаж с семинара «Гуманитарное знание + Алгоритмическая рациональность = ?!.» (ИИ в DH: текстогенерация, распознавание рукописей, 3D-реконструкции).
📌 IN MEMORIAM
🧙 Андрей Володин — об Александре Борисовиче Антопольском (1943–2026), пионере отечественной информатики, создателе справочных систем по DH.
📌 РЕЦЕНЗИИ
🧙 Андрей Володин — на книгу Юлии Юмашевой «Источниковедение информационной эпохи».
🧙 Полина Колозариди — на книгу Лейфа Визерби «Language Machines: Cultural AI and the End of Remainder Humanism».
🧙 Борис Орехов — на книгу Марка Марино «Critical Code Studies».
Еще глубже погружаемся в мир DH — от поэзии Вознесенского до уличного искусства в метавселенных и искусственного интеллекта в науке.
🔍 Что внутри:
📌 ИССЛЕДОВАНИЯ
📌 ХРОНИКА
📌 IN MEMORIAM
📌 РЕЦЕНЗИИ
Please open Telegram to view this post
VIEW IN TELEGRAM
❤12👏2
Forwarded from Центр «Сэфер»
Ведущая специалистка по еврейским рукописям расскажет о цифровом перевороте последних 20 лет в изучении рукописей и подробно остановится на новом онлайн-ресурсе по еврейской палеографии HebrewPal.
Вебинар пройдет на английском языке.
Лектор: Judith Olszowy-Schlanger
Professor of Hebrew and Judeo-Arabic Manuscript Studies at the École Pratique des Hautes Études, Paris Sciences Lettres, Professor of Hebrew and Jewish Studies at the University of Oxford, President of the Oxford Centre for Hebrew and Jewish Studies and Fellow of Corpus Christi College, Oxford.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4
Центр современной культуры «Целинный» (Алматы) приглашает на стажировку в проект DOCUMENTATION.
DOCUMENTATION — это цифровая база данных о современном искусстве Центральной Азии. Миссия проекта — сохранение и изучение данных об искусстве с 1985 г. с целью восстановления культурной памяти региона и формирования его идентичности. Сегодня в процессе оцифровки, атрибуции и описания находятся digital, фото- и видеоработы Шай-Зии, Елены и Виктора Воробьевых, арт-группы Kyzyl Tractor и ЦСИ Фонда Сорос.
Присылайте резюме на почту documentation@tselinny.org с темой «Стажировка в DOCUMENTATION», если вам интересны:
• исследования в области современной культуры и искусства
• особенности создания и хранения цифровых коллекций
• атрибуция и описание художественных работ.
Будет здорово, если у вас есть:
• гуманитарное образование
• знание английского языка
• опыт проведения исследований (научных, академических), создания и ведения проектов в сфере культуры/искусства.
Текст взят из инстаграм-канала Целинного.
DOCUMENTATION — это цифровая база данных о современном искусстве Центральной Азии. Миссия проекта — сохранение и изучение данных об искусстве с 1985 г. с целью восстановления культурной памяти региона и формирования его идентичности. Сегодня в процессе оцифровки, атрибуции и описания находятся digital, фото- и видеоработы Шай-Зии, Елены и Виктора Воробьевых, арт-группы Kyzyl Tractor и ЦСИ Фонда Сорос.
Присылайте резюме на почту documentation@tselinny.org с темой «Стажировка в DOCUMENTATION», если вам интересны:
• исследования в области современной культуры и искусства
• особенности создания и хранения цифровых коллекций
• атрибуция и описание художественных работ.
Будет здорово, если у вас есть:
• гуманитарное образование
• знание английского языка
• опыт проведения исследований (научных, академических), создания и ведения проектов в сфере культуры/искусства.
Текст взят из инстаграм-канала Целинного.
❤8
Выпущен язык разметки стихов: VML (неофициальное название: "веймелка") https://github.com/nevmenandr/VML
Язык предназначен для структурированного представления стихотворных текстов в процессе их подготовки для последующего компьютерного анализа. Он спроектирован как минималистичный и дружественный к гуманитариям:
Большинство тегов одинарные, то есть в отличие от языков на основе XML не требуют закрывающей пары. Пример минимально валидного VML-документа:
Язык предназначен для структурированного представления стихотворных текстов в процессе их подготовки для последующего компьютерного анализа. Он спроектирован как минималистичный и дружественный к гуманитариям:
Синтаксис стремится к ненавязчивости: теги по возможности короткие, а разметка не загромождает поэтический текст, сохраняя его удобочитаемость для человека. Обязательные теги сведены к двум (<a>, <&>), остальные опциональны.
Большинство тегов одинарные, то есть в отличие от языков на основе XML не требуют закрывающей пары. Пример минимально валидного VML-документа:
<a> Мацуо Басё
<&> «Осень уже пришла!» —
Шепнул мне на ухо ветер,
Подкравшись к постели моей.
Основная цель VML — обеспечить однозначное разграничение функционально различных частей стихотворного текста при его цифровой фиксации. В отличие от универсальных языков разметки (HTML, XML, Markdown) или форматов простого текста, VML фокусируется на специфических элементах поэтического произведения, значимых для формального и квантитативного анализа.
❤8🔥3
Аксана Исмаилбекова и Фредерик Мадор: «Периферии» ислама: Digital Humanities, алгоритмический анализ и AI в Западной Африке и Центральной Азии
Приглашаем на пятый семинар серии "Цифровая история Центральной Азии и Южного Кавказа". В докладе представлен проект, который с помощью ИИ оцифрует и сделает доступными две крупные многозычные коллекции Leibniz-Zentrum Moderner Orient (ZMO).
С помощью мультимодальных моделей для извлечения текста, транскрипции и семантического поиска будут обработаны Исламская коллекция Западной Африки (более 14 500 документов) и коллекция Райнхарда Айзенера (1546 документов), а также создан кросс-региональный чат-бот.
⏰ 29 июня, 14:00 CET | 16:00 Ереван и Тбилиси | 17:00 Ташкент и Алматы | 18:00 Бишкек
Больше информации.
Регистрация.
Приглашаем на пятый семинар серии "Цифровая история Центральной Азии и Южного Кавказа". В докладе представлен проект, который с помощью ИИ оцифрует и сделает доступными две крупные многозычные коллекции Leibniz-Zentrum Moderner Orient (ZMO).
С помощью мультимодальных моделей для извлечения текста, транскрипции и семантического поиска будут обработаны Исламская коллекция Западной Африки (более 14 500 документов) и коллекция Райнхарда Айзенера (1546 документов), а также создан кросс-региональный чат-бот.
⏰ 29 июня, 14:00 CET | 16:00 Ереван и Тбилиси | 17:00 Ташкент и Алматы | 18:00 Бишкек
Больше информации.
Регистрация.
❤3
«Электронная лира»: Ваш гид по миру, где нейросети пишут стихи
Вышла первая в России книга, которая серьезно и увлекательно отвечает на вопрос, что происходит, когда примитивная железяка (или, если хотите, сложный алгоритм) пытается создавать лирику.
💡 Для гуманитариев: Не стоит бояться. И не нужно думать, что нейростихи — это та же комбинаторика, что и 50 лет назад. Книга филолога и специалиста по цифровым методам демистифицирует ИИ. Вы узнаете, почему компьютерный верлибр долгое время был невозможен в России, как нейросети «косплеят» стиль Пастернака и почему тест Тьюринга в поэзии — это скучно и бесполезно. Книга предлагает не угадывать «человек или машина?», а научиться нейрочтению — видеть в генеративных текстах ключ к пониманию того, как вообще устроена поэзия: от гекзаметра до зауми.
💻 Для программистов: Отложите скучные статьи о точности и функции потерь. Это разговор о том, что вы делаете, на языке гуманитарной науки (и это гораздо интереснее, чем кажется!). Вы проследите эволюцию от «Стихоплюя» и «Кибер-Пушкина» до трансформеров внутри ChatGPT, поймете, почему LSTM выучивают морфемы раньше, чем слова, и как параметр «температура» превращает нейросеть из графомана в авангардиста. А главное — увидите, что ваш код способен не только генерировать тексты, но и ставить глубокие философские вопросы о природе творчества и авторства.
О чем еще эта книга:
📚 Почему рифма и ритм — не главное (и что тогда главное?).
📚 Как стихи ИИ оказались неотличимы от бреда душевнобольного и почему это нормально.
📚 Зачем вообще нужна поэзия, если она не приносит пользы (ответ Карла Маркса, Макса Вебера и ChatGPT).
📚 И главное: заменит ли нейросеть живого поэта? Спойлер: нет, но может стать соавтором.
Это не технический мануал и не учебник по стиховедению. Это интеллектуальный детектив, в котором нет преступлений, зато есть расследование: феномен машинной поэзии оказывается ветвью истории культуры, попутно заставляя нас по-новому взглянуть на стихи, которые мы читаем и, возможно, пишем сами.
🔥 Для кого: Для всех, кому интересна «магия», скрытая за строчками кода и поэтическими строками. От студентов-филологов до ML-инженеров с гуманитарным любопытством.
📖 Купить и изучить: Книга уже в продаже. Забрать свой экземпляр «Электронной лиры» можно на сайте издательства
P.S. Автор обещает: почти никакой линейной регрессии, зато много разговоров о центоне, пародии и воображаемой поэзии.
Вышла первая в России книга, которая серьезно и увлекательно отвечает на вопрос, что происходит, когда примитивная железяка (или, если хотите, сложный алгоритм) пытается создавать лирику.
💡 Для гуманитариев: Не стоит бояться. И не нужно думать, что нейростихи — это та же комбинаторика, что и 50 лет назад. Книга филолога и специалиста по цифровым методам демистифицирует ИИ. Вы узнаете, почему компьютерный верлибр долгое время был невозможен в России, как нейросети «косплеят» стиль Пастернака и почему тест Тьюринга в поэзии — это скучно и бесполезно. Книга предлагает не угадывать «человек или машина?», а научиться нейрочтению — видеть в генеративных текстах ключ к пониманию того, как вообще устроена поэзия: от гекзаметра до зауми.
💻 Для программистов: Отложите скучные статьи о точности и функции потерь. Это разговор о том, что вы делаете, на языке гуманитарной науки (и это гораздо интереснее, чем кажется!). Вы проследите эволюцию от «Стихоплюя» и «Кибер-Пушкина» до трансформеров внутри ChatGPT, поймете, почему LSTM выучивают морфемы раньше, чем слова, и как параметр «температура» превращает нейросеть из графомана в авангардиста. А главное — увидите, что ваш код способен не только генерировать тексты, но и ставить глубокие философские вопросы о природе творчества и авторства.
О чем еще эта книга:
Это не технический мануал и не учебник по стиховедению. Это интеллектуальный детектив, в котором нет преступлений, зато есть расследование: феномен машинной поэзии оказывается ветвью истории культуры, попутно заставляя нас по-новому взглянуть на стихи, которые мы читаем и, возможно, пишем сами.
🔥 Для кого: Для всех, кому интересна «магия», скрытая за строчками кода и поэтическими строками. От студентов-филологов до ML-инженеров с гуманитарным любопытством.
📖 Купить и изучить: Книга уже в продаже. Забрать свой экземпляр «Электронной лиры» можно на сайте издательства
P.S. Автор обещает: почти никакой линейной регрессии, зато много разговоров о центоне, пародии и воображаемой поэзии.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤8🔥2👏2
Опубликован Русский стилеметрический датасет. Это собрание готовых наборов текстов для исследований и учебных занятий. Датасет позволяет ученым и педагогам не тратить время и силы на подбор текстов для тестирования своих методик или для подготовки к работе над темой стилеметрии в классе.
Все включенные в датасет тексты находятся в общественном достоянии и распределены по подкорпусам, ориентированным на специфические задачи:
↪️ Художественная проза по периодам (XVIII, XIX – первая/вторая половина, рубеж XIX–XX вв.)
↪️ Тексты по полу, возрасту и поколению авторов
↪️ Публицистика и научные тексты (история, богословие, психофизиология, философия)
↪️ Жанровая классификация
↪️ Литературные и идеологические направления (романтизм vs реализм, западники vs славянофилы)
↪️ Стих и проза (включая стихотворные размеры)
↪️ Речь персонажей (из прозы и драматургии)
↪️ Сгенерированные тексты (LSTM и GPT)
(всего 25 подкорпусов)
Объем датасета: 322 документа, ~16 млн слов, 94 автора.
Тексты оптимизированы для работы в
Формат файлов:
Схема именования:
Каждый подкорпус содержит сопроводительный файл
Для проверки консистентности данных и отсутствия дубликатов в состав включен набор автоматических тестов (
DOI: 10.5281/zenodo.20701309
Все включенные в датасет тексты находятся в общественном достоянии и распределены по подкорпусам, ориентированным на специфические задачи:
(всего 25 подкорпусов)
Объем датасета: 322 документа, ~16 млн слов, 94 автора.
Тексты оптимизированы для работы в
stylo, что не ограничивает в работе с другими инструментами.Формат файлов:
plain text, кодировка UTF-8.Схема именования:
автор_название.txt, что позволяет пакету stylo автоматически выделять одним цветом тексты, принадлежащие одному классу (например, одному автору).Каждый подкорпус содержит сопроводительный файл
README.md с описанием кодировки названий и указанием источников, а также файл corpus.tsv с метаданными в машиночитаемой форме.Для проверки консистентности данных и отсутствия дубликатов в состав включен набор автоматических тестов (
tests/).DOI: 10.5281/zenodo.20701309
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥11❤5👎1👏1
Forwarded from Демонтаж красноречия
Media is too big
VIEW IN TELEGRAM
⚠️ ОСТОРОЖНО: ЗАКОН ОБ ИИ
👍 Новый выпуск — о юридическом событии года, которое касается всех. Обсуждаем закон об искусственном интеллекте с доктором юридических наук, руководителем проекта «Сохраненная культура» Виктором Борисовичем Наумовым. Закон принят, но всё ли в нём так хорошо?
⚡️ Законопроект Минцифры — о поддержке технологий. Но поддержка эта адресована всего нескольким игрокам.
⚡️ Определение ИИ через «превосходство над человеком» — философски и юридически сомнительно.
⚡️ Маркировка контента, право на отказ и обжалование решений ИИ — исчезли из финальной версии. Это проблема.
Смотреть:
На📺 Ютубе, в 🌍 ВК Видео, на 🗣 Рутубе, в 🌐 Дзене.
0:00 Приветствие и знакомство с гостем
0:20 Можно ли менять жизненные принципы? (начало ответа гостя)
1:36 Почему закон лучше, чем его отсутствие?
2:53 Целеполагание в законах и качество нормативных актов
4:05 Как давно в мире начали регулировать ИИ?
5:04 Указ президента 2019 года и концепция 2020 года
6:09 Гонка за ИИ в России: две линии разработки
7:43 Конкуренция двух моделей регулирования
9:00 Какие сферы регулируются, а какие выведены
9:38 Декларации в законе: ритуал или реальная сила?
11:03 «Орнаментальные конструкции» и нормы прямого действия
12:14 Определение ИИ в книге vs определение в законе
13:59 Имитация когнитивных способностей человека
15:06 Почему определение в законе Минцифры узкое и ошибочное
16:30 Технологии vs развитие человека
17:47 Определение через превосходство над человеком
18:33 Почему сравнение машин с человеком — философская ошибка
19:35 Трансгуманизм и противоречие с духовно-нравственными ценностями
20:50 Испуг или долгоиграющие идеи?
21:54 Опасность закладки трансгуманистических идей на уровне закона
23:26 Примут ли закон быстро ради «флага»?
24:00 Два закона: поддержка технологий и безопасное использование
25:06 Категория «информационная система» как альтернатива
26:02 Разногласия на согласительных встречах
27:17 Модерн, трансгуманизм и исторический контекст
28:32 Требования к обучению: только на территории России
29:33 Кому выгоден закон? Поддержка узкого круга гигантов
31:13 Российские компании не входят в мировой топ-10
32:33 Цифровой феодализм и закрытие технологий в мире
34:01 Кому выгоднее — нескольким феодалам или всей стране?
35:10 Нужен ли государственный искусственный интеллект?
36:35 Атомный проект как пример мобилизации
38:15 Можно ли проверить, на каких данных обучалась модель?
39:37 Национальная и суверенная модели — для двух компаний
41:04 Как проверять трансграничные данные?
42:05 Регулировать не технологии, а безопасное использование
43:30 Чувствительные сферы: соцсфера, госуправление, обслуживание
44:51 Как стать доверенной системой
46:14 Серая зона для органов власти
47:04 Филологический взгляд: ошибки нумерации в законе
48:01 Как часто встречаются юридико-технические ошибки?
49:27 Может ли ИИ помогать находить ошибки в законах?
50:39 Маркировка контента: проблема различия
51:33 Почему обязанность маркировать контент исчезла
52:41 Отсутствие маркировки подрывает творчество
54:06 Идентификация системы: робот должен представляться
55:00 Право на отказ от использования ИИ
56:19 Право обжаловать решения ИИ человеку
57:37 Запрет на использование ИИ при написании законов
59:07 Люди пишут и читают всё меньше
1:00:35 Внутренняя цензура больших языковых моделей
1:02:05 Требования к достоверности данных и результатов
1:03:38 Интеллектуальная собственность и обучение нейросетей
1:06:04 Скандал со сканированием букинистических книг
1:07:30 Ответственность: отсылка к общему законодательству
1:09:17 Как быть с плагиатом?
1:10:25 Можно ли маркировать текст?
1:11:50 Самоцензура моделей и традиционные ценности
1:12:55 Что делать? Закон примут, но его могут переписать
1:13:56 Два закона вместо одного — плохо ли это?
1:15:47 Финальная маркировка: никакая часть подкаста не создана с помощью ИИ
#видео
⚡️ Законопроект Минцифры — о поддержке технологий. Но поддержка эта адресована всего нескольким игрокам.
⚡️ Определение ИИ через «превосходство над человеком» — философски и юридически сомнительно.
⚡️ Маркировка контента, право на отказ и обжалование решений ИИ — исчезли из финальной версии. Это проблема.
Смотреть:
На
0:00 Приветствие и знакомство с гостем
0:20 Можно ли менять жизненные принципы? (начало ответа гостя)
1:36 Почему закон лучше, чем его отсутствие?
2:53 Целеполагание в законах и качество нормативных актов
4:05 Как давно в мире начали регулировать ИИ?
5:04 Указ президента 2019 года и концепция 2020 года
6:09 Гонка за ИИ в России: две линии разработки
7:43 Конкуренция двух моделей регулирования
9:00 Какие сферы регулируются, а какие выведены
9:38 Декларации в законе: ритуал или реальная сила?
11:03 «Орнаментальные конструкции» и нормы прямого действия
12:14 Определение ИИ в книге vs определение в законе
13:59 Имитация когнитивных способностей человека
15:06 Почему определение в законе Минцифры узкое и ошибочное
16:30 Технологии vs развитие человека
17:47 Определение через превосходство над человеком
18:33 Почему сравнение машин с человеком — философская ошибка
19:35 Трансгуманизм и противоречие с духовно-нравственными ценностями
20:50 Испуг или долгоиграющие идеи?
21:54 Опасность закладки трансгуманистических идей на уровне закона
23:26 Примут ли закон быстро ради «флага»?
24:00 Два закона: поддержка технологий и безопасное использование
25:06 Категория «информационная система» как альтернатива
26:02 Разногласия на согласительных встречах
27:17 Модерн, трансгуманизм и исторический контекст
28:32 Требования к обучению: только на территории России
29:33 Кому выгоден закон? Поддержка узкого круга гигантов
31:13 Российские компании не входят в мировой топ-10
32:33 Цифровой феодализм и закрытие технологий в мире
34:01 Кому выгоднее — нескольким феодалам или всей стране?
35:10 Нужен ли государственный искусственный интеллект?
36:35 Атомный проект как пример мобилизации
38:15 Можно ли проверить, на каких данных обучалась модель?
39:37 Национальная и суверенная модели — для двух компаний
41:04 Как проверять трансграничные данные?
42:05 Регулировать не технологии, а безопасное использование
43:30 Чувствительные сферы: соцсфера, госуправление, обслуживание
44:51 Как стать доверенной системой
46:14 Серая зона для органов власти
47:04 Филологический взгляд: ошибки нумерации в законе
48:01 Как часто встречаются юридико-технические ошибки?
49:27 Может ли ИИ помогать находить ошибки в законах?
50:39 Маркировка контента: проблема различия
51:33 Почему обязанность маркировать контент исчезла
52:41 Отсутствие маркировки подрывает творчество
54:06 Идентификация системы: робот должен представляться
55:00 Право на отказ от использования ИИ
56:19 Право обжаловать решения ИИ человеку
57:37 Запрет на использование ИИ при написании законов
59:07 Люди пишут и читают всё меньше
1:00:35 Внутренняя цензура больших языковых моделей
1:02:05 Требования к достоверности данных и результатов
1:03:38 Интеллектуальная собственность и обучение нейросетей
1:06:04 Скандал со сканированием букинистических книг
1:07:30 Ответственность: отсылка к общему законодательству
1:09:17 Как быть с плагиатом?
1:10:25 Можно ли маркировать текст?
1:11:50 Самоцензура моделей и традиционные ценности
1:12:55 Что делать? Закон примут, но его могут переписать
1:13:56 Два закона вместо одного — плохо ли это?
1:15:47 Финальная маркировка: никакая часть подкаста не создана с помощью ИИ
#видео
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4🔥3👏2
Forwarded from Системный Блокъ
Муза с перфокартами: читаем главу из новой книги Бориса Орехова
Генеративная поэзия появилась задолго до ChatGPT. Более того, идея машины, которая сама пишет стихи, возникла за столетия до компьютеров. Ее можно встретить не только в фантастических произведениях, но и в научных и философских сочинениях. С разрешения автора мы публикуем на сайте главу из новой книги филолога Бориса Орехова «Электронная лира», а здесь — собрали пять самых любопытных фактов из нее.
Машину для сочинения стихов высмеял Джонатан Свифт еще в XVIII веке
В «Путешествиях Гулливера» Джонатан Свифт описал устройство, которое случайным образом переставляло слова и позволяло любому человеку «писать книги по философии, поэзии и праву». Это была сатира, но принцип оказался удивительно похож на то, как позже работали первые генераторы текста.
В XIX веке существовал механический «поэт»
В 1845 году англичанин Джон Кларк представил устройство «Эврика», которое составляло латинские гекзаметры со скоростью одна строка в минуту. Современники признали машину грамматически безупречной, но практически бесполезной — разве что для развлечения школьников.
Первые «компьютерные стихи» были газетной шуткой
В 1956 году американский журнал опубликовал юмористический рассказ о вымышленной машине, сочиняющей стихи. В СССР попал вольный перевод этого текста без пояснений. Пионеры отечественной кибернетики приняли его за настоящий эксперимент и много лет цитировали как пример машинной поэзии, хотя компьютеры тогда еще стихов не писали.
Первым настоящим компьютерным поэтом стал немецкий математик
В 1959 году Тео Лутц загрузил в компьютер словарь, составленный по роману Кафки «Замок», и заставил программу случайным образом строить предложения. Получались строки вроде: «Не каждый взгляд близок. Ни одна деревня не запоздала. Замок свободен, и каждый крестьянин далек». Лутца интересовала не поэзия сама по себе, а возможность показать, что компьютер способен работать не только с числами.
У истоков компьютерной поэзии стояли европейские художники
Румыно-французский художник Брайон Гайсин, итальянец Нанни Балестрини и немец Руль Гунзенхаузер использовали компьютер как соавтора еще в начале 1960-х. Их программы либо случайно переставляли слова и фразы, либо заполняли грамматические шаблоны словами из заранее подготовленного словаря. Именно эти два подхода стали основой большинства ранних генераторов стихов.
Компьютеры начали писать стихи не потому, что научились понимать язык, а потому, что научились комбинировать слова по правилам. До современных нейросетей оставались десятилетия, но многие идеи, лежащие в основе генерации текста, появились именно тогда.
Полный текст главы из книги «Электронная лира» и стихи, сочиненные компьютером, уже на сайте.
Время чтения: 12 минут
🤖 «Системный Блокъ» @sysblok
Генеративная поэзия появилась задолго до ChatGPT. Более того, идея машины, которая сама пишет стихи, возникла за столетия до компьютеров. Ее можно встретить не только в фантастических произведениях, но и в научных и философских сочинениях. С разрешения автора мы публикуем на сайте главу из новой книги филолога Бориса Орехова «Электронная лира», а здесь — собрали пять самых любопытных фактов из нее.
Машину для сочинения стихов высмеял Джонатан Свифт еще в XVIII веке
В «Путешествиях Гулливера» Джонатан Свифт описал устройство, которое случайным образом переставляло слова и позволяло любому человеку «писать книги по философии, поэзии и праву». Это была сатира, но принцип оказался удивительно похож на то, как позже работали первые генераторы текста.
В XIX веке существовал механический «поэт»
В 1845 году англичанин Джон Кларк представил устройство «Эврика», которое составляло латинские гекзаметры со скоростью одна строка в минуту. Современники признали машину грамматически безупречной, но практически бесполезной — разве что для развлечения школьников.
Первые «компьютерные стихи» были газетной шуткой
В 1956 году американский журнал опубликовал юмористический рассказ о вымышленной машине, сочиняющей стихи. В СССР попал вольный перевод этого текста без пояснений. Пионеры отечественной кибернетики приняли его за настоящий эксперимент и много лет цитировали как пример машинной поэзии, хотя компьютеры тогда еще стихов не писали.
Первым настоящим компьютерным поэтом стал немецкий математик
В 1959 году Тео Лутц загрузил в компьютер словарь, составленный по роману Кафки «Замок», и заставил программу случайным образом строить предложения. Получались строки вроде: «Не каждый взгляд близок. Ни одна деревня не запоздала. Замок свободен, и каждый крестьянин далек». Лутца интересовала не поэзия сама по себе, а возможность показать, что компьютер способен работать не только с числами.
У истоков компьютерной поэзии стояли европейские художники
Румыно-французский художник Брайон Гайсин, итальянец Нанни Балестрини и немец Руль Гунзенхаузер использовали компьютер как соавтора еще в начале 1960-х. Их программы либо случайно переставляли слова и фразы, либо заполняли грамматические шаблоны словами из заранее подготовленного словаря. Именно эти два подхода стали основой большинства ранних генераторов стихов.
Компьютеры начали писать стихи не потому, что научились понимать язык, а потому, что научились комбинировать слова по правилам. До современных нейросетей оставались десятилетия, но многие идеи, лежащие в основе генерации текста, появились именно тогда.
Полный текст главы из книги «Электронная лира» и стихи, сочиненные компьютером, уже на сайте.
Время чтения: 12 минут
Please open Telegram to view this post
VIEW IN TELEGRAM
Системный Блокъ
Муза с перфокартами: как компьютеры учились писать стихи за полвека до нейросетей - Системный Блокъ
Генеративная поэзия появилась задолго до ChatGPT. Идея машины, которая сама пишет стихи, возникла за столетия до компьютеров, в середине XIX веке в Англии уже действовал механический автомат по сборке стихов, а в 1960-е европейские художники генерировали…
❤3