data.csv
13.8K subscribers
1.45K photos
86 videos
6 files
1.01K links
Блог о журналистике данных и дата-сторителлинге
Ведёт @BlackPineapple — аналитик в службе дата-журналистики Яндекса
Download Telegram
Анонсировал конкурс по визуализации данных в своём втором канале. Отличный повод себя показать, на других посмотреть, послушать мой фидбек. Ну и выиграть место на курсе бесплатно 👇
ДАТАВИЗ-ЧЕЛЛЕНДЖ: НОВЫЙ СЕЗОН
(и возможность пройти курс бесплатно)

Год назад я уже проводил конкурс по визуализации данных: тогда эта идея многим понравилась, и вот у вас снова есть шанс попрактиковаться, получить от меня персональный фидбек и на других участников посмотреть.

На этот раз я выгрузил с Кинопоиска данные о кассовых сборах фильмов — с 2019 года по настоящее время. А также добавил к ним информацию о фильмах: страну производства, жанры, длительность, дату премьеры.

Какие истории тут искать — решать вам. Изучите данные, найдите в них интересные инсайты и визуализируйте любым доступным вам способом: от Google Таблиц до d3.js.

Работы принимаются до воскресенья (19 июня) включительно. Присылать в форму — комментарии отключаю намеренно 😈, чтобы вы не палили свои решения другим.

По вопросам можно писать мне — @BlackPineapple

🙋А что мне за это будет?
На следующей неделе я проведу эфир, где дам честную обратную связь. Похвалю крутышей, разберу ошибки, обращу внимание на приёмы, которые можно было использовать.

А ЕЩЁ: среди всех участников мы разыгаем одно бесплатное место на новый поток курса «Эстетика в графиках»

🙋Я совсем-совсем не умею в графики. Как мне поучаствовать?
На уроках информатики эксель открывали почти все — можно попробовать снова вспомнить этот опыт. Или нарисовать решение на бумаге.

А если вообще ничего не получается — прийти на разборы и посмотреть, как эту задачку решили другие участники.

Скачать датасеты можно тут. В папке три файла:

kinopoisk_films_simple.csv — для тех, кто не умеет писать код или хочет поменьше заморачиваться. Один фильм = одна строка: название, страна, жанр, премьеры (Россия/мир), хронометраж, возраст, сборы за первую неделю, суммарные сборы (₽ и $), недель в прокате.

или исходные данные:
kinopoisk_box_office_rus.csv — понедельные сборы: место в топе, сборы/зрители за уик-энд и накопительно, копии, прокатчик. Для тех, кому нужна динамика по неделям.

kinopoisk_films.csv — полные карточки фильмов: название (ru/ориг), год, страна, жанр, обе премьеры, зрители в России, хронометраж, возраст, сборы в $.

Удачи! 🔥
🔥174
This media is not supported in your browser
VIEW IN TELEGRAM
Сегодня в финале ЧМ-2026 сходятся Аргентина и Испания. Покажу вам по этому поводу новый проект Александра Богачёва: он анимирует статистику каждого матча в живую ткань, натянутую на поле.

Два цвета — две команды. Шов между ними визуализирует инициативу: кто давит и наступает. Острые пики вырастают прямо из ткани в момент удара — чем выше, тем опаснее момент. Гол — и всё поле заливает цветом забившей команды.

На видео — кусок полуфинала Англия-Аргентина, где это всё в движении. Кайф в том, что тут нет ничего для красоты — в основе лежат данные профессиональных поставщиков спортивной статистики, которые вручную размечают каждое событие матча: удары, голы, владение по минутам.

Смотреть все матчи: wc26.bogachev.fr

А вы сегодня будете болеть?

🏆 — я за Аргентину
⚡️ — за Испанию
🎉 — за хорошую игру
👀 — я не по футболу
73🏆44🎉36👀358
Как устроена империя шотландского виски

#работы_студентов@data_csv

Большой выпускной труд моей студентки Миланы Глебовой! За крутым визуалом тут лежит большая и очень интересная работа с данными:

Мне не встретилось готового датасета с отраслевой статистикой (вернее, встретился, но жадные авторы The Scotch Whisky Industry Review продают его за очень дорого), поэтому я комбинировала материалы из разных источников. Здорово помогли ChatGPT и Deepseek — особенно когда нужно было написать парсер или пересобрать гигантские таблицы. Кроме того, данные редко были с ходу пригодны для визуализации: в записях о прошлых компаниях-владельцах, например, пришлось погрузиться в историю их слияний и поглощений, чтобы понять где речь идет об одних и тех же ребятах под разными вывесками.

В результате я (не)много закопалась: чаще чем однажды шла проверять какую-нибудь цифру и застревала в историях, как например про Хелен Камминг — чьей семейной обязанностью было управляться с вискокурней в Спейсайде, а общественной — предупреждать соседей о приближении офицеров с проверкой не варит ли тут кто чего незаконного, вывешивая на крыше красный флаг.

Кстати, это косвенно подсвечивает еще одну боль с историческими данными: дистиллерии далеко не всегда были легальными, и сколько их появлялось и закрывалось, сказать и посчитать непросто. Я собирала записи о закрытых производствах из справочников типа scotchwhisky.com, из списков на википедии и из частных обзоров: например, на сайте Kilchoman неплохой рассказ местного краеведа об истории виски на всей Айле. Это материалы заведомо неполные, но тренд в них все равно просматривается.


Работа над дипломным проектом — это не просто возможность сделать залипательную визуализацию. Это ещё и повод погрузиться в тему, которая тебе по-настоящему нравится и украсить своё портфолио.

Cегодня последний день, когда можно присоединиться к обновленному курсу по лучшей цене: тариф с обратной связью — 33900 вместо 45000 руб, если вы не проходили курс; 12900 — если вы уже учились у нас.

Забронировать место.
🔥24🍾64😎3🤔1
Раньше было лучше? Или портят ли ремейки славу оригинальных фильмов

Это дипломный проект моей студентки Кристины Емельяновой. Она изучила данные о 200 лучших ремейках по версии платформы IMDb и сравнила оценки, жанры, количество наград и возрастные рейтинги — с оригинальными версиями фильмов.

Последнее время кажется, что кинотеатры заполонили сплошные ремейки. Почему-то режиссеры решают пересказать уже известную историю, а не придумать новую. Порой это кажется оправданным: например, если оригинал провалился в прокате, то ремейк, используя лучшие достижения современной техники, может дать ему фору. Но всегда ли у него это получается?

Глобальный вывод не удивил: ремейки редко держат планку, а зачастую уступают оригиналам по уровню рейтинга. Однако во время анализа обнаружились и другие факты, которые я попыталась интересно и понятно визуализировать :)


От себя хочу заметить, что хотя и метод исследования тут имеет сильные ограничения (можем ли мы говорить про все ремейки, если взяли только 200 лучших?), в визуальной части работы есть много очень интересных решений — и виды графиков, и приёмы дата-сторителлинга, и совмещение разных необычных и привлекательных форм для визуализации выводов.

——

Новый поток «Эстетики в графиках» — 1 августа. Займите одно из трёх последних мест с обратной связью здесь.
21🔥17🤝2
Boeing vs Airbus

#работы_студентов

Перед вами дипломный проект Андрея Караваева, который решил углубиться в противостояние между двумя авиагигантами. Андрей не только сравнил актуальную структуру авиапарков, но и изучил динамику поставок самолётов. Особенно зрелищно выглядит отрыв Airbus, случившийся в 2019 году впервые за 50 лет конкуренции (причина такой перемены — на графике).

А вот, что говорит сам Андрей о своих поисках:

Я работаю в компании, где долгие годы основными клиентами являлись Airbus и Boeing. В заметках пылился пунктик «разобраться» на цифрах, какие есть основные модели самолетов, как устроена статистика по этим компаниям. Так и родилась основная идея диплома.


Самым сложным, даже скорее трудоемким, было выбрать фокус исследования, найти интересные показатели для сравнения, ну и конечно собрать и агрегировать данные, т.к. на просторах интернета нет единого датасета.


Это исследование показывает, что хорошая визуализация рождается в первую очередь из хорошей идеи. Она и помогает превратить цифры и графики в интересные истории.

Именно этому мы будем учиться на курсе «Эстетика в графиках». Седьмой поток стартует уже завтра. Мест с обратной связью осталось всего 2.

Подробности и программа — тут
13🔥10💊3👍1🤔1