Цифровой филолог👩‍💻
967 subscribers
322 photos
18 videos
28 files
538 links
Канал об электронных филологических ресурсах: словарях, проектах, текстовых корпусах,базах данных, лингвистических программах.

Автор канала — Рогожина Елена Игоревна (@Elena_Rechnaya), канд.филол. наук

Чат: t.me/digital_philologist_chat
Download Telegram
Тестирую новую функцию в Алисе AI – возможность создания своего персонажа. Создала Цифрового филолога. Вы сами сможете с ним поболтать здесь.

Из диалога узнала о проекте Digital Dickens (расскажу в следующий раз). Как вы могли догадаться, это ещё одно семантическое издание. Искать в обычном поиске их довольно затруднительно, а мой новый компаньон сам предложил рассказать о таком сайте.

Можно просить объяснить, как решить разные конкретные задачи. Буду изучать дальше.

#ии@digital_philologist
...

Цифровой филолог вконтакте
✍5❤3😁1
На мой взгляд, Синтаксический корпус – это самый сложный корпус в НКРЯ. Синтаксическая разметка включает множество отношений, выходящих далеко за пределы школьной (да и вузовской) программы.

К счастью, есть инструкция со старой версии сайта, где подробно рассказывается о каждом теге с примерами.

Сохранить эту шпаргалку себе можно при помощи комбинации клавиш Ctrl + P >> сохранить PDF.

Инструкцию нашла благодаря виджету Wayback Machine портала Internet Archive (см. подробнее).


#НКРЯ@digital_philologist
❤6
Конструктор индивидуальных заданий по русскому языку

В чате поделились ссылкой на полезный сайт, где собраны карточки, самостоятельные и контрольные работы для 5–11-х классов. Материалы сгруппированы по темам и классам, их бесплатно можно скачать в PDF.

Сайт можно использовать как конструктор (платно): выбрать задания и собрать свои варианты работы для класса (ответы будут только у вас).

Благодарю Кирилла за проект и рекомендацию.

#проекты@digital_philologist
🔥8👏3⚡1💯1
Большие языковые модели уже давно умеют переводить, писать тексты и выполнять множество задач, которые принято рассматривать как интеллектуальную «рутину». Но сегодня они постепенно входят в области, которые ещё недавно считались специфически человеческими: создают художественные тексты, демонстрируют способность к метаязыковым суждениям, а с появлением мультимодальных моделей получают возможность работать не только с текстом, но и с визуальной информацией.

О том, как эти изменения заставляют заново задавать вопросы о языке и культуре, — в главе Анастасии Владимировны Колмогоровой, заведующей Лабораторией языковой конвергенции НИУ ВШЭ — Санкт-Петербург, в коллективной междисциплинарной монографии «Генеративные агенты — новые участники социальных коммуникаций: как “голоса без тел” трансформируют коммуникативный порядок?», которая публикуется по итогам Всероссийского онлайн-форума «Connect Universum — 2026», организованного кафедрой социальных коммуникаций факультета психологии ТГУ.

В главе описываются результаты уникального эксперимента, направленного на сопоставление описаний произведений искусства, созданных 100 информантами, и описаний, полученных с помощью мультимодальной языковой модели. Такой материал позволяет по-новому посмотреть на то, что именно человек делает, когда «просто описывает то, что видит», и что происходит, когда эту задачу получает модель.

📚 24 сентября в 16:00 (МСК) состоится онлайн-презентация монографии.

📍 Подключиться можно по ссылке.

Приглашаем всех, кому интересно, как появление генеративных агентов меняет наши представления о языке, восприятии и коммуникации. Все участники презентации получат доступ к бесплатному скачиванию монографии в день мероприятия.
❤4
♾️
Александр Гусев, ведущий ютуб-канала «Спокойно о технологиях», позвал меня побеседовать в формате подкаста о том, что же будет с корректурой в эпоху нейросетей.

Ну а я что? Я и пошел! 🤩

Обсудили, кто вообще такой корректор и зачем нужно наше ремесло сейчас, когда кругом ИИ и агенты. Размышляли над тем, как изменился подход к работе в целом в эпоху нейронок (спойлер: ее стало отнюдь не меньше, а даже больше, чем раньше, но качество выросло). И конечно, я принес несколько прикольчиков из практики.

Несмотря на то что формат разговора в новинку и для меня, и для ведущего, получилось все равно насыщенно и интересно. Первый блин совсем не комом.

📱 Смотрите подкаст и подписывайтесь на канал, там много любопытных видео.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4
Друзья! Я посетила совершенно потрясающий интенсив [ кем даны данные? ] в Цифровом гуманитарном центре ИТМО.


Наконец встретилась с Полиной Колозариди, получила совет по проекту от Бориса Орехова, познакомилась с интереснейшими исследователями из разных университетов и нашла много точек пересечения.

Не удивляйтесь, что впереди будет много постов, потому что мне не терпится поделиться цифровыми проектами, о которых я узнала на интенсиве.

Спасибо всем, кто был частью этого события, вы вдохновляете!✨
🔥15⚡5
Блокадная карта

На интенсиве нам представили проект, посвящённый блокадным дневникам.

Интерактивная карта, рассказывающая о блокаде Ленинграда 1941–1944 гг. от первого лица. На неё нанесены цитаты из дневников ленинградцев. Каждая точка на карте — геометка на основе цитаты из блокадного дневника.
Материал – 620 дневников из блокадной серии «Прожито» (посты о корпусе «Прожито»: 1, 2, 3, 4).

Параметры и фильтры:

📆ВРЕМЯ. «Дата события» и «дата записи о событии».

📍МЕСТО. «Ареал» автора (дом, работа, учёба, места питания) и «общегородские пространства» (куда автор попадает случайно или знает с чужих слов).

📝СОБЫТИЕ. Три типа: общегородское («историческое»), военное (бомбардировки, налёты) и микрособытие / повседневная практика.

📃ТИП СВИДЕТЕЛЬСТВА. Личное, с чужих слов / слухи, медиатизированное (из радио, газеты, на собрании). Прямое свидетельство (записано в день события) или ретроспективное (воспоминание).

🔖ТЕМАТИЧЕСКИЕ ТЕГИ (см. скрин).

📕"Вы, наверное, из Ленинграда?"

#проекты@digital_philologist
🔥6💯4⚡3
Продолжаем рассказывать о новых публикациях сотрудников Лаборатории языковой конвергенции!

В журнале Herald of the Russian Academy of Sciences опубликовали работу заведующей лаборатории, д.ф.н., Анастасии Колмогоровой и стажера-исследователя Дарьи Серединой!

Статья посвящена цифровому помощнику «Эльфо», который помогает превратить изучение русской классики в интерактивный процесс.

В карточках рассказываем, как устроен «Эльфо», что он умеет и какие результаты показало первое тестирование.

📖 Читать полную статью
❤‍🔥3⚡1❤1✍1🔥1👏1💯1
{ cумма технологии»: инструмент или вдохновение? }

Уже на следующей неделе, 8 октября, в 15:00 по Москве пройдёт первая встреча дискуссионной онлайн-гостиной журнала «Цифровые гуманитарные исследования».

Тема первого обсуждения — насколько наши исследования определяются наличием готовых цифровых инструментов? Что первично — научный вопрос или техническая возможность?

гости семинара:
>> Ольга Валерьевна Алиева (НИУ ВШЭ),
>> Роман Борисович Кончаков (Президентская академия).

ведущий:
главный редактор журнала «Цифровые гуманитарные исследования» Борис Валерьевич Орехов (НИУ ВШЭ, ИРЛИ РАН, МГУ).

{ подробности и форма регистрации участников }

увидимся в онлайне!

🤍 🤍 🤍 🤍 🤍 🤍 🤍
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2⚡1❤1💯1
ИИ уже умеет искать информацию, анализировать данные, писать тексты и формулировать рекомендации. Иногда он делает это быстрее человека, иногда убедительнее, чем хотелось бы признать.

Поэтому для консультантов, аналитиков и руководителей возникает практический вопрос: какая часть экспертной деятельности действительно сохраняет человеческую ценность?

1 октября НИИ «Устроение» проводит онлайн-круглый стол «Экспертный сервис в эпоху ИИ».

Мы собрали шесть разных профессиональных взглядов на одну проблему.

Сергей Трушкин поговорит о трансформации экспертного сервиса в управлении. Андрей Яковлев, о том, как «разговоры с неживым» влияют на наш язык и мышление. Наталья Луковникова рассмотрит соотношение языка, знания и информации и возможности ИИ в аналитике. Константин Тютюнов разберёт ИИ-поддержку анализа инвестиционных проектов. Оксана Езерская, цифровую восприимчивость руководителя и использование ИИ в финансах. Тимур Гафитулин, трансформацию экспертной деятельности в новой технологической среде.

Нас интересует не соревнование «человек против машины», а устройство новой профессиональной реальности: что разумно передать ИИ, где необходимо человеческое суждение и за что в этой системе будет платить клиент.

Формат: короткие выступления и общая дискуссия.

1 октября, 19:00. Онлайн.

Программа и регистрация:
https://nii-organizatsionnoy-psik.timepad.ru/event/4178490/

#искусственныйинтеллект #ИИ #управление #аналитика #консалтинг #экспертность
⚡2🔥1💯1
Folklore Database

Это бесплатный исследовательский ресурс для сравнительного изучения фольклорных сюжетов со всего мира. Автор проекта — Джонатан Филдер‑Уайт, независимый исследователь, специалист в области индоевропейской мифологии и истории религий.

Опираясь на сотни источников, база данных предоставляет возможность искать различными способами, просматривать карты мира распространения сюжетов и читать тексты, переведённые на английский язык.

Корпус фольклорных нарративов включает почти 350 000 мифов, легенд и сказок, более 286 000 отдельных сюжетов и 3 500 мотивов из 1 200 культур.

Как можно пользоваться базой?
1. Искать по мотиву или структурному элементу.

2. Поиск по метаданным. К каждому сюжету привязаны сведения о культурном происхождении, географии, библиографические ссылки, а также структурные единицы — митемы (они помогают разбирать внутреннюю организацию мифа).

3. Смотреть, как сюжеты распространялись по миру. По каждому запросу строится карта, где видно географию распространения мотивов — это помогает отслеживать культурные связи и миграции традиций.

4. Сравнивать близость сюжетов.

5. Читать тексты. Многие нарративы переведены на английский язык.


Какие базы данных и классификации есть на портале?


*Индекс Аарне — Томпсона — Утера (ATU) — классификация типов сказок.
*Каталог мотивов Стита Томпсона — классика фольклористики по мотивам.
*Аналитический каталог Ю. Е. Березкина и Е. Н. Дувакина
— тематическая классификация мотивов с привязкой к ареалам. У этой базы есть отдельный сайт: https://www.ruthenia.ru/folklore/berezkin.

Митемы в базе формируются с помощью особого метода на базе открытой языковой модели (Qwen3.6‑35B‑A3B).

Для работы с базой нужна бесплатная регистрация.

Видеоинструкция для использования базы (на немецком языке). Перевод текста видеоинструкции (от Алисы AI) оставляю в комментариях.

#проекты@digital_philologist
#фольклор@digital_philologist
🔥7⚡1👏1💯1
Друзья, вышла долгожданная запись эфира о Владимире Ивановиче Дале!

Спасибо Олегу Юрьевичу Клишину за приглашение
🔥10👏2✍1⚡1💯1
В «Словаре обиходного русского языка Московской Руси XVI–XVII веков» реализовали расширенный поиск на материале Вып. 10: Казывать—Киевцы. СПб.: Наука, 2025.

Теперь можно
✅сортировать результаты;
✅ искать по тексту словарных статей или по вокабуле (заголовочному слову / названию словарной статьи);
✅искать с учётом частотности слова;
✅искать по части речи и морфологическим и синтаксическим признакам*;

*Особенно меня удивили расширенные фильтры синтаксических параметров: функционально-грамматические особенности, семантико-грамматические особенности, синтагматика и управление. Например, можно найти лексемы, после которых могут использоваться слова в определённом падеже и с определённым предлогом.

✅искать по семантическим, стилистическим параметрам;

✅искать фразеологизмы;

✅искать антропонимы (в том числе некалендарные имена, прозвища) и топонимы;

✅искать с учётом этимологии;

✅с учётом источника.


#словари@digital_philologist
🔥6⚡3✍1❤1💯1
Персонотекст или нейротекст?
Опубликован новый номер журнала «Юрислингвистика», где я приметила две интереснейшие статьи, посвященные судебному авторведению : статья Я. Дударевой и А. Воронько «Персонотекст и нейротекст: критерии разграничения естественно-языковых и сгенерированных текстов на основе сопоставительного профилирования» и статья И. Огорелкова «Лингвистические аспекты автороведческой диагностики».

Каким будет судебное автороведение в эпоху сгенерированных текстов? Это большой вопрос. Сохранятся ли в СМИ персонотексты, если в той или иной степени все журналисты начинают использовать нейросети как вспомогательный инструмент? Мне кажется, что трудно сейчас дать однозначные ответы на вопросы, но хорошо, что эта проблематика оказывается в исследовательском поле судебных лингвистов.

Сбербанк анонсировал второй том «Мертвых душ», написанный при помощи искусственного интеллекта. Над романом «Мертвые души. Второй том. Возрождение» больше года работали специалисты банка вместе с историками, литературоведами, лингвистами и инженерами. Как отмечает банк, для обучения ИИ-модели использовали полное собрание сочинений Гоголя, его письма, черновики и записные книжки, а также произведения его современников и библейские тексты. Получившийся текст оценивали, как пишет РБК, по 11 параметрам, включая лексику, синтаксис, гротеск, построение диалогов и присутствие автора-рассказчика. Каждый сгенерированный эпизод также проверяли на уникальность. И если кто-то уже заранее не хочет читать такой текст, то прочитайте сначала интервью с соавтором книги – писателем Владиславом Отрошенко.

Второй том «Мертвых душ. Возрождение» читать буду. Проверим, нейротекст это или персонотекст. И ждать ли нам за «Возрождением» «Целину» и «Малую землю»? Это части трилогии генерального секретаря ЦК КПСС Л.И. Брежнева, которые за него писали гострайтеры, но ни этого слова, ни нейросетей тогда не было, а вот персонотекста не случилось.
❤4⚡1🔥1💯1
Со мной поделились свежим материалом по стилометрии: статьей на Habr Дмитрия Пронина "Что скрывают в себе меры расстояния: от kNN и k‑means до стилометрии".

Как пишет Дмитрий, "одна из проблем количественного анализа текста состоит в том, что алгоритм легко говорит нам, что два текста находятся на расстоянии X, но гораздо сложнее объяснить, из каких конкретно языковых различий это число получилось. Я показываю довольно простой способ разложить метрическое расстояние на вклады отдельных слов и разбираю пример Достоевского и Толстого из статьи".

Оказалось, что Дмитрий Пронин вместе с Евгением Казарцевом написали учебник
"Основы цифровой филологии: методы и принципы компьютерного анализа текста" (учебник доступен на сайте ВШЭ).

А также Дмитрий является автором следующих работ (все их можно прочитать на Elibrary):

Пронина, Е. В. Метод анализа эмоциональной тональности текста как цифровой инструмент изучения текста произведения литературы (на примере романа М.Ю. Лермонтова "Герой нашего времени") / Е. В. Пронина, Д. Д. Пронин // Современный ученый. – 2022. – № 6. – С. 8-15.

Пронин, Д. Д. Анализ эмоциональной тональности рассказа Л. Н. Толстого «После бала» цифровыми методами / Д. Д. Пронин // Л.Н. Толстой в сознании человека цифровой эпохи : Материалы XXXVIII Международных Толстовских чтений, посвященных 194-летию со дня рождения писателя, Тула, 09 сентября 2022 года / Под редакцией Д.А. Романова. – Тула: Тульский государственный педагогический университет им. Л.Н. Толстого, 2022. – С. 145-150.

Пронина, Е. В. Исследовательский потенциал изучения корпуса произведений русской литературы с помощью цифровых лингвистических методов и технологий искусственного интеллекта (проект Lensky) / Е. В. Пронина, Д. Д. Пронин // Современный ученый. – 2023. – № 3. – С. 92-105.

Пронина, Е. В. Исследование неологических тенденций развития русского литературного языка середины XIX века в творчестве Л. Н. Толстого методами компьютерной лингвистики / Е. В. Пронина, Д. Д. Пронин // Тульский научный вестник. Серия История. Языкознание. – 2024. – № 4(20). – С. 172-182. – DOI 10.22405/2712-8407-2024-4-172-182.




В следующем посте подробнее поговорим о стилометрии.

#рекомендации@digital_philologist
🔥3✍2👏2❤1⚡1💯1
Forwarded from Алена Л.
Всем привет!
Центр технологий для общества Yandex Cloud приглашает студентов присоединиться к новому потоку курса по облачным технологиям

🔄72 академических часа и 10 учебных блоков — от основ виртуализации и облачной инфраструктуры до баз данных, AI Studio и serverless-разработки
🔄 Обучение проходит онлайн и сочетает учебные материалы в интерактивном учебнике Яндекс Практикума, практические задания на ресурсах Yandex Cloud и вебинары с экспертами
🔄Курс начинается с базовых тем, поэтому подходит в том числе студентам без опыта работы с облачными технологиями
🔄Новый поток стартует 20 октября, участие в программе бесплатное

➡️Подать заявку:
https://academy-cloud.ru/?utm_source=sender&utm_medium=mailing&utm_campaign=t:promo;gl:lgen;ac:land;a:academy_forvuz
Please open Telegram to view this post
VIEW IN TELEGRAM