yet another dev
364 subscribers
244 photos
2 videos
161 links
Пишу про работу в IT, жизнь в Сербии и всё, что кажется важным.

Telegram: @alexeyfv
Сайт: alexeyfv.xyz/ru
LinkedIn: linkedin.com/in/alexeyfv
GitHub: github.com/alexeyfv
Habr: habr.com/ru/users/alexeyfv
Download Telegram
Я полностью проверил майские релизы. Да, все 695К релизов.

Какая в итоге сложилась картина:

- Изменилось распределение ИИ / не-ИИ. 36.6% майских релизов — это ИИ. Получилось близко к цифрам, которые я называл в своей предыдущей статье (около 40%). И ситуация схожа с тем, что происходит в Deezer — в апреле они заявили, что около 44% всех новых загрузок на их платформу сгенерированы. Смею предположить, что сейчас ситуация плюс-минус одна и та же на всех стримингах: не важно, российский ли это сервис или зарубежный.

- Гипотеза о том, что релизы без лайков будут по большей части сгенерированы не подтвердилась. Там сгенерированных треков оказалось ровно треть.

- Немного изменилось распределение по жанрам. Интересно, что 88% K-pop релизов сгенерированы.

- Лейблы-лидеры по количеству сгенерированного контента — Context Collapse и SFEROOM DISTRIBUTION.

Тем временем, я начал проверку релизов за июнь, почти дописал вторую статью и подготовил классификатор к релизу. На следующей неделе будет много интересного. Ждите :)
🔥12
На днях пообщался с изданием The Bell (иностранный агент). Они выпустили большой материал об ИИ-музыке в России. К сожалению, статья платная, поэтому тезисно о самом интересном.

- Там есть крупный блок, посвященный моей аналитике. Тут ничего нового для вас нет, поэтому повторяться не буду.

- Есть дистрибьюторы, которые встроили генерацию музыки в процесс публикации. Теперь можно за несколько минут создать трек и сразу отправить его на стриминги. Дистрибьютор сперва получит деньги за использование ИИ для генерации трека, а если он залетит, то удержит ещё и % с роялти.

- Раньше производство песни требовало команды и бюджета. Теперь стратегия некоторых авторов — это выпускать огромное количество треков в надежде, что один из них выстрелит. Но заработать на ИИ-музыке не так просто, как обещает реклама. Большинство релизов, как мы знаем, остаются незамеченными. Но, видимо, стоимость их генерации настолько низкая, что такая модель производства контента всё равно оказывается жизнеспособной.

- Один из собеседников издания отметил, что, по его ощущениям, системы рекомендаций "охотнее" продвигают ИИ-музыку. Но не потому что это сделано специально разработчиками системы рекомендаций, а просто ИИ-музыка максимально соответствует шаблонам популярных треков и поэтому лучше продвигается.

- Ещё один собеседник тревожится за культурное будущее. Он считает, что новым музыкантам будет всё сложнее бороться за внимание, так как нейросеть делает песню за минуты, а человеку нужны недели или месяцы. В целом, ситуация схожа с IT и наймом джунов: в нынешнюю эпоху, дать сеньору фару на лоб ИИ выходит дешевле и быстрее, чем обучить молодого специалиста.
👍3🤮21🔥1🌚1
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯2👍1
yet another dev
Всё кто голосовал за трек 1 оказались правы. Для наглядности, на втором графике первая производная спектра (скорость измерения сигнала). Пики в спектре - основной отличительный артефакт в ИИ-музыке.

Завтра опубликую статью на Хабре с техническими подробностями, кодом и полной аналитикой.
👍9
Под моим последним рилсом*, где я объясню принцип определения ИИ музыки, один музыкант рассказал, что ИИ-музыка не может генерировать стабильный BPM.

Интересное наблюдение. Надо бы поисследовать...

* Instagram принадлежит Meta Platforms Inc., признанной экстремистской организацией, деятельность которой запрещена на территории РФ.
🔥4🤔3🤓2
Треть новых релизов на Яндекс Музыке – ИИ. Теперь точно

Прошло полтора месяца с публикации предыдущей моей статьи. Всё это время я продолжал исследовать тему определения ИИ в музыке. Итогом изысканий стал алгоритм, позволяющий определять сгенерированные треки с точностью, близкой к 100%.

Кроме того, я проанализировал релизы в Яндекс Музыке за первое полугодие 2026 года и выяснил, что 37% всех новых релизов имеют признаки ИИ-музыки. А если учитывать только релизы с лайками, то количество нейромузыки достигает 50%.

В новой статье я подробно расскажу, как работает алгоритм детекта ИИ-музыки, почему для него не требуется GPU, а также покажу аналитику по Яндекс Музыке.



Поддержите публикацию плюсами 👉
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10🔥52
Люблю читать старые новости. Что политические, что бытовые. Очень интересно наблюдать за тем, что мудрое начальство говорит, и что потом получается на деле.

Певица Аманиэль тут напомнила, что представители Яндекса в марте заявляли, что не могут определить самостоятельно, создана ли музыка с помощью ИИ или нет.

Видимо, им моя помощь требовалась?

Ну вот, я помог. Теперь ведь появится маркировка? Появится же, да? *мем с Падме*
6😁5
В комментариях на Хабре посоветовали обратить внимание на бенчмарк Echoes

Все эти классификаторы сильно зависят от датасетов и, в частности, от модели генератора музыки.

Представьте, что ваш классификатор обучен находить шарики с синими полосками из кучи разноцветных шариков. В какой-то момент, в куче появляются шарики с красными полосками и всё, приехали. Ваш классификатор их не видит. Вам нужно собрать датасет из новых шариков и дообучить модель.

То же самое с музыкой. У разных генераторов артефакты могут отличаться. И классификатор обученный на треках одного генератора, может ошибаться на треках другого.

Как заявляют авторы статьи и бенчмарка:

Echoes - самый сложный датасет. Классификаторы, обученные на существующих датасетах (например, SONICS), хуже определяют ИИ-музку из Echoes. И наоборот, обучив классификатор на Echoes, результаты становятся точнее.

Echoes содержит в себе 3577 треков от 10 генераторов музыки: Suno, Udio, DiffRhythm, Stable Audio, AudioLDM, SongGen, Brev, Mubert, AceStep, Riffusion. А тот же SONICS, о котором я рассказывал в статье, содержит треки всего от 2 генераторов: Suno и Udio.

Я проверил свой алгоритм на Echoes. Методология следующая:

- ИИ-музыка из датасета Echoes (3577 треков).
- Обычная музыка из датасета FMA Small (8000 треков).
- Балансировка классов из-за неравного количества треков в датасетах.
- Тестовый сплит 80:20.

Результаты на диаграмме. Хуже всего классификатор определяет Mubert — всего 26%. По-сути, он не способен определить треки от этого генератора. Почему так — это тема для отдельного исследования. Скорее всего, там нет checkerboard artifacts. Но наверняка есть что-то другое.

В остальном, результаты хорошие. Общая точность составляет 98.44%.
🔥82🖕2
Хотите короткую шутку? Microsoft Linux.
😁112🖕1🙈1
Пообщался на днях с журналистом канала Hi, AI по поводу ИИ-музыки.

Уже второе издание просит дать комментарии. Тема явно злободневная.

Также сегодня был принят в первом чтении законопроект о «регулировании ИИ».

Не будем заострять внимание на том, что по законопроекту ИИ должен соответствовать «традиционным духовно-нравственным ценностям».

Интересно в нём ещё вот это:

«Не будет считаться нарушением авторских прав обработка информации, содержащейся в объектах авторского права, для обучения суверенных и национальных моделей. При условии, что разработчик правомерно получил экземпляр произведения или оно находилось в открытом доступе.»

Помните, я писал про пользовательское соглашение Яндекс Музыки? Что-то мне подсказывает, что если законопроект примут, то это сильно развяжет руки бигтехам.

Получится классическая приватизация прибыли: трудились и создавали контент все, но прибыль от ИИ достанется 🤴

Про маркировку ИИ-контента, кстати, там тоже есть. Она будет добровольной и определяться «пользовательским соглашением». Что из этого получится – посмотрим. Мне почему-то кажется, что стримингов это не коснется.

В законе говорится о предоставлении пользователям возможности маркировать сгенерированный контент. А не о выявлении ИИ-контента в соцсетях и сервисах.

Иначе говоря, генерируешь картинку в Гигачате и по твоей просьбе на картинку добавится водяной знак. Тоже маркировка ведь?
Please open Telegram to view this post
VIEW IN TELEGRAM
👍52🤬1🖕1
Спасибо за поддержку 😸
Please open Telegram to view this post
VIEW IN TELEGRAM
👍17
Увидел забавную штуку в репозитории Meta*

Для защиты от вайбкодеров, они прописали в AGENTS[.]md несколько инструкций.

Мейнтейнеры опен-сорс проектов, берите на заметку.

* Meta Platforms Inc., признана экстремистской организацией, деятельность которой запрещена на территории РФ.
👍4😁3👏1
yet another dev
Я в последнее время много рассказываю про ИИ в музыке. Думаю разбавлять контент чем-то другим пару раз в месяц. Вот вам на выбор.
Аудитория высказалась, что интересно читать про программирование и жизнь в Сербии. Поэтому я буду выделять посты на разную тематику тегами после заголовка. Пока будет 3 тега:

#программирование@yet_another_dev
#сербия@yet_another_dev
#нейромузыка@yet_another_dev

Буду стараться уделять время всему.
👍5🔥2
Закон о развитии ИИ и маркировке ИИ-контента

Музыкальное сообщество воодушевилось после принятия закона «О поддержке развития ИИ» и, в частности, о маркировке ИИ-контента (статья 9).

На мой взгляд, радоваться рано, потому что маркировка из законопроекта – это не то, что просили пользователи и музыканты.

TL;DR Маркировка ИИ-музыки – это не то же самое, что выявление ИИ-музыки. Никто не собирается выявлять ИИ-музыку. Авторам музыки дадут возможность указывать, использовался ли ИИ при создании трека. Но никто не обязывает это делать, как и не обязывают указывать достоверные данные.

Разберём статью 9 законопроекта по частям:

Часть 1. Провайдеры ИИ (такие как Сбер с Гигачатом) должны дать пользователям возможность промаркировать сгенерированный контент. Например, сгенерировали вы картинку и, если вы попросите, Гигачат может добавить вотермарку на неё.

В случае с музыкой это может быть, к примеру, трёхсекундное предупреждение в начале сгенерированного трека. Но, как вы понимаете, в России пока нет таких компаний, как Suno. А западным компаниям плевать на российские законы.

Часть 2. Закон не устанавливает технические требования к маркировке. Способ маркировки устанавливается пользовательским соглашением между провайдером и пользователем. Поэтому маркировка может быть какой угодно. Она не обязана быть криптографически проверяемой.

Часть 3. Социальные сети и UGC-платформы с количеством пользователей в сутки >500 тысяч человек обязаны дать возможность пометить контент как созданный с помощью ИИ. То есть, загружаете вы свой ИИ-трек в Яндекс Музыку, и Яндекс должен вам дать возможность поставить галочку «Создано с помощью ИИ». Но вы вправе не ставить – закон вас не обязывает. А Яндекс не обязан проверять достоверность указанных вами данных.

#нейромузыка@yet_another_dev
👍2🤣1🤨1