yet another dev
Всё кто голосовал за трек 1 оказались правы. Для наглядности, на втором графике первая производная спектра (скорость измерения сигнала). Пики в спектре - основной отличительный артефакт в ИИ-музыке.
Завтра опубликую статью на Хабре с техническими подробностями, кодом и полной аналитикой.
Завтра опубликую статью на Хабре с техническими подробностями, кодом и полной аналитикой.
👍9
Под моим последним рилсом*, где я объясню принцип определения ИИ музыки, один музыкант рассказал, что ИИ-музыка не может генерировать стабильный BPM.
Интересное наблюдение. Надо бы поисследовать...
* Instagram принадлежит Meta Platforms Inc., признанной экстремистской организацией, деятельность которой запрещена на территории РФ.
Интересное наблюдение. Надо бы поисследовать...
* Instagram принадлежит Meta Platforms Inc., признанной экстремистской организацией, деятельность которой запрещена на территории РФ.
🔥4🤔3🤓2
Треть новых релизов на Яндекс Музыке – ИИ. Теперь точно
Прошло полтора месяца с публикации предыдущей моей статьи. Всё это время я продолжал исследовать тему определения ИИ в музыке. Итогом изысканий стал алгоритм, позволяющий определять сгенерированные треки с точностью, близкой к 100%.
Кроме того, я проанализировал релизы в Яндекс Музыке за первое полугодие 2026 года и выяснил, что 37% всех новых релизов имеют признаки ИИ-музыки. А если учитывать только релизы с лайками, то количество нейромузыки достигает 50%.
В новой статье я подробно расскажу, как работает алгоритм детекта ИИ-музыки, почему для него не требуется GPU, а также покажу аналитику по Яндекс Музыке.
—
Поддержите публикацию плюсами👉
Прошло полтора месяца с публикации предыдущей моей статьи. Всё это время я продолжал исследовать тему определения ИИ в музыке. Итогом изысканий стал алгоритм, позволяющий определять сгенерированные треки с точностью, близкой к 100%.
Кроме того, я проанализировал релизы в Яндекс Музыке за первое полугодие 2026 года и выяснил, что 37% всех новых релизов имеют признаки ИИ-музыки. А если учитывать только релизы с лайками, то количество нейромузыки достигает 50%.
В новой статье я подробно расскажу, как работает алгоритм детекта ИИ-музыки, почему для него не требуется GPU, а также покажу аналитику по Яндекс Музыке.
—
Поддержите публикацию плюсами
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10🔥5❤2
Люблю читать старые новости. Что политические, что бытовые. Очень интересно наблюдать за тем, что мудрое начальство говорит, и что потом получается на деле.
Певица Аманиэль тут напомнила, что представители Яндекса в марте заявляли, что не могут определить самостоятельно, создана ли музыка с помощью ИИ или нет.
Видимо, им моя помощь требовалась?
Ну вот, я помог. Теперь ведь появится маркировка? Появится же, да? *мем с Падме*
Певица Аманиэль тут напомнила, что представители Яндекса в марте заявляли, что не могут определить самостоятельно, создана ли музыка с помощью ИИ или нет.
Видимо, им моя помощь требовалась?
Ну вот, я помог. Теперь ведь появится маркировка? Появится же, да? *мем с Падме*
❤6😁5
В комментариях на Хабре посоветовали обратить внимание на бенчмарк Echoes
Все эти классификаторы сильно зависят от датасетов и, в частности, от модели генератора музыки.
Представьте, что ваш классификатор обучен находить шарики с синими полосками из кучи разноцветных шариков. В какой-то момент, в куче появляются шарики с красными полосками и всё, приехали. Ваш классификатор их не видит. Вам нужно собрать датасет из новых шариков и дообучить модель.
То же самое с музыкой. У разных генераторов артефакты могут отличаться. И классификатор обученный на треках одного генератора, может ошибаться на треках другого.
Как заявляют авторы статьи и бенчмарка:
Echoes - самый сложный датасет. Классификаторы, обученные на существующих датасетах (например, SONICS), хуже определяют ИИ-музку из Echoes. И наоборот, обучив классификатор на Echoes, результаты становятся точнее.
Echoes содержит в себе 3577 треков от 10 генераторов музыки: Suno, Udio, DiffRhythm, Stable Audio, AudioLDM, SongGen, Brev, Mubert, AceStep, Riffusion. А тот же SONICS, о котором я рассказывал в статье, содержит треки всего от 2 генераторов: Suno и Udio.
Я проверил свой алгоритм на Echoes. Методология следующая:
- ИИ-музыка из датасета Echoes (3577 треков).
- Обычная музыка из датасета FMA Small (8000 треков).
- Балансировка классов из-за неравного количества треков в датасетах.
- Тестовый сплит 80:20.
Результаты на диаграмме. Хуже всего классификатор определяет Mubert — всего 26%. По-сути, он не способен определить треки от этого генератора. Почему так — это тема для отдельного исследования. Скорее всего, там нет checkerboard artifacts. Но наверняка есть что-то другое.
В остальном, результаты хорошие. Общая точность составляет 98.44%.
Все эти классификаторы сильно зависят от датасетов и, в частности, от модели генератора музыки.
Представьте, что ваш классификатор обучен находить шарики с синими полосками из кучи разноцветных шариков. В какой-то момент, в куче появляются шарики с красными полосками и всё, приехали. Ваш классификатор их не видит. Вам нужно собрать датасет из новых шариков и дообучить модель.
То же самое с музыкой. У разных генераторов артефакты могут отличаться. И классификатор обученный на треках одного генератора, может ошибаться на треках другого.
Как заявляют авторы статьи и бенчмарка:
Echoes - самый сложный датасет. Классификаторы, обученные на существующих датасетах (например, SONICS), хуже определяют ИИ-музку из Echoes. И наоборот, обучив классификатор на Echoes, результаты становятся точнее.
Echoes содержит в себе 3577 треков от 10 генераторов музыки: Suno, Udio, DiffRhythm, Stable Audio, AudioLDM, SongGen, Brev, Mubert, AceStep, Riffusion. А тот же SONICS, о котором я рассказывал в статье, содержит треки всего от 2 генераторов: Suno и Udio.
Я проверил свой алгоритм на Echoes. Методология следующая:
- ИИ-музыка из датасета Echoes (3577 треков).
- Обычная музыка из датасета FMA Small (8000 треков).
- Балансировка классов из-за неравного количества треков в датасетах.
- Тестовый сплит 80:20.
Результаты на диаграмме. Хуже всего классификатор определяет Mubert — всего 26%. По-сути, он не способен определить треки от этого генератора. Почему так — это тема для отдельного исследования. Скорее всего, там нет checkerboard artifacts. Но наверняка есть что-то другое.
В остальном, результаты хорошие. Общая точность составляет 98.44%.
🔥8❤2🖕2
Я в последнее время много рассказываю про ИИ в музыке. Думаю разбавлять контент чем-то другим пару раз в месяц. Вот вам на выбор.
Final Results
62%
Заметки про программирование (олды помнят, что канал изначально был про C#).
55%
Жизнь в эмиграции в Сербии.
31%
Образ жизни (спорт, питание, ЗОЖ). Я в прошлом спортсмен, поэтому есть что рассказать.
4%
Что-то другое (напишу в комментариях).
Пообщался на днях с журналистом канала Hi, AI по поводу ИИ-музыки.
Уже второе издание просит дать комментарии. Тема явно злободневная.
Также сегодня был принят в первом чтении законопроект о «регулировании ИИ».
Не будем заострять внимание на том, что по законопроекту ИИ должен соответствовать «традиционным духовно-нравственным ценностям».
Интересно в нём ещё вот это:
«Не будет считаться нарушением авторских прав обработка информации, содержащейся в объектах авторского права, для обучения суверенных и национальных моделей. При условии, что разработчик правомерно получил экземпляр произведения или оно находилось в открытом доступе.»
Помните, я писал про пользовательское соглашение Яндекс Музыки? Что-то мне подсказывает, что если законопроект примут, то это сильно развяжет руки бигтехам.
Получится классическая приватизация прибыли: трудились и создавали контент все, но прибыль от ИИ достанется🤴
Про маркировку ИИ-контента, кстати, там тоже есть. Она будет добровольной и определяться «пользовательским соглашением». Что из этого получится – посмотрим. Мне почему-то кажется, что стримингов это не коснется.
В законе говорится о предоставлении пользователям возможности маркировать сгенерированный контент. А не о выявлении ИИ-контента в соцсетях и сервисах.
Иначе говоря, генерируешь картинку в Гигачате и по твоей просьбе на картинку добавится водяной знак. Тоже маркировка ведь?
Уже второе издание просит дать комментарии. Тема явно злободневная.
Также сегодня был принят в первом чтении законопроект о «регулировании ИИ».
Не будем заострять внимание на том, что по законопроекту ИИ должен соответствовать «традиционным духовно-нравственным ценностям».
Интересно в нём ещё вот это:
«Не будет считаться нарушением авторских прав обработка информации, содержащейся в объектах авторского права, для обучения суверенных и национальных моделей. При условии, что разработчик правомерно получил экземпляр произведения или оно находилось в открытом доступе.»
Помните, я писал про пользовательское соглашение Яндекс Музыки? Что-то мне подсказывает, что если законопроект примут, то это сильно развяжет руки бигтехам.
Получится классическая приватизация прибыли: трудились и создавали контент все, но прибыль от ИИ достанется
Про маркировку ИИ-контента, кстати, там тоже есть. Она будет добровольной и определяться «пользовательским соглашением». Что из этого получится – посмотрим. Мне почему-то кажется, что стримингов это не коснется.
В законе говорится о предоставлении пользователям возможности маркировать сгенерированный контент. А не о выявлении ИИ-контента в соцсетях и сервисах.
Иначе говоря, генерируешь картинку в Гигачате и по твоей просьбе на картинку добавится водяной знак. Тоже маркировка ведь?
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
Hi, AI • Новости технологий
🎧 Треть новых релизов в «Яндекс Музыке» создана с помощью ИИ
Из почти 711 тыс. майских релизов в «Яндекс Музыке» около 260 тыс. (36,6%) созданы с помощью ИИ, считает независимый исследователь Алексей Федоров, проверивший треки собственным детектором.
Всего…
Из почти 711 тыс. майских релизов в «Яндекс Музыке» около 260 тыс. (36,6%) созданы с помощью ИИ, считает независимый исследователь Алексей Федоров, проверивший треки собственным детектором.
Всего…
👍5❤2🤬1🖕1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍17
Увидел забавную штуку в репозитории Meta*
Для защиты от вайбкодеров, они прописали в AGENTS[.]md несколько инструкций.
Мейнтейнеры опен-сорс проектов, берите на заметку.
* Meta Platforms Inc., признана экстремистской организацией, деятельность которой запрещена на территории РФ.
Для защиты от вайбкодеров, они прописали в AGENTS[.]md несколько инструкций.
Мейнтейнеры опен-сорс проектов, берите на заметку.
* Meta Platforms Inc., признана экстремистской организацией, деятельность которой запрещена на территории РФ.
👍4😁3👏1
yet another dev
Я в последнее время много рассказываю про ИИ в музыке. Думаю разбавлять контент чем-то другим пару раз в месяц. Вот вам на выбор.
Аудитория высказалась, что интересно читать про программирование и жизнь в Сербии. Поэтому я буду выделять посты на разную тематику тегами после заголовка. Пока будет 3 тега:
#программирование@yet_another_dev
#сербия@yet_another_dev
#нейромузыка@yet_another_dev
Буду стараться уделять время всему.
#программирование@yet_another_dev
#сербия@yet_another_dev
#нейромузыка@yet_another_dev
Буду стараться уделять время всему.
👍5🔥2
Закон о развитии ИИ и маркировке ИИ-контента
Музыкальное сообщество воодушевилось после принятия закона «О поддержке развития ИИ» и, в частности, о маркировке ИИ-контента (статья 9).
На мой взгляд, радоваться рано, потому что маркировка из законопроекта – это не то, что просили пользователи и музыканты.
TL;DR Маркировка ИИ-музыки – это не то же самое, что выявление ИИ-музыки. Никто не собирается выявлять ИИ-музыку. Авторам музыки дадут возможность указывать, использовался ли ИИ при создании трека. Но никто не обязывает это делать, как и не обязывают указывать достоверные данные.
Разберём статью 9 законопроекта по частям:
Часть 1. Провайдеры ИИ (такие как Сбер с Гигачатом) должны дать пользователям возможность промаркировать сгенерированный контент. Например, сгенерировали вы картинку и, если вы попросите, Гигачат может добавить вотермарку на неё.
В случае с музыкой это может быть, к примеру, трёхсекундное предупреждение в начале сгенерированного трека. Но, как вы понимаете, в России пока нет таких компаний, как Suno. А западным компаниям плевать на российские законы.
Часть 2. Закон не устанавливает технические требования к маркировке. Способ маркировки устанавливается пользовательским соглашением между провайдером и пользователем. Поэтому маркировка может быть какой угодно. Она не обязана быть криптографически проверяемой.
Часть 3. Социальные сети и UGC-платформы с количеством пользователей в сутки >500 тысяч человек обязаны дать возможность пометить контент как созданный с помощью ИИ. То есть, загружаете вы свой ИИ-трек в Яндекс Музыку, и Яндекс должен вам дать возможность поставить галочку «Создано с помощью ИИ». Но вы вправе не ставить – закон вас не обязывает. А Яндекс не обязан проверять достоверность указанных вами данных.
#нейромузыка@yet_another_dev
Музыкальное сообщество воодушевилось после принятия закона «О поддержке развития ИИ» и, в частности, о маркировке ИИ-контента (статья 9).
На мой взгляд, радоваться рано, потому что маркировка из законопроекта – это не то, что просили пользователи и музыканты.
TL;DR Маркировка ИИ-музыки – это не то же самое, что выявление ИИ-музыки. Никто не собирается выявлять ИИ-музыку. Авторам музыки дадут возможность указывать, использовался ли ИИ при создании трека. Но никто не обязывает это делать, как и не обязывают указывать достоверные данные.
Разберём статью 9 законопроекта по частям:
Часть 1. Провайдеры ИИ (такие как Сбер с Гигачатом) должны дать пользователям возможность промаркировать сгенерированный контент. Например, сгенерировали вы картинку и, если вы попросите, Гигачат может добавить вотермарку на неё.
В случае с музыкой это может быть, к примеру, трёхсекундное предупреждение в начале сгенерированного трека. Но, как вы понимаете, в России пока нет таких компаний, как Suno. А западным компаниям плевать на российские законы.
Часть 2. Закон не устанавливает технические требования к маркировке. Способ маркировки устанавливается пользовательским соглашением между провайдером и пользователем. Поэтому маркировка может быть какой угодно. Она не обязана быть криптографически проверяемой.
Часть 3. Социальные сети и UGC-платформы с количеством пользователей в сутки >500 тысяч человек обязаны дать возможность пометить контент как созданный с помощью ИИ. То есть, загружаете вы свой ИИ-трек в Яндекс Музыку, и Яндекс должен вам дать возможность поставить галочку «Создано с помощью ИИ». Но вы вправе не ставить – закон вас не обязывает. А Яндекс не обязан проверять достоверность указанных вами данных.
#нейромузыка@yet_another_dev
👍2🤣1🤨1
Представьте, сколько ресурсов было потрачено на этот слоп, который в итоге был удалён. Воистину, капитализм - самый эффективный общественно-экономический строй.
#нейромузыка@yet_another_dev
#нейромузыка@yet_another_dev
👏5💯5🌚2❤1👍1😢1
Discriminated Unions в C#
#программирование@yet_another_dev
Сегодня про Discriminated Unions (DU) в C#, который вроде как должен появиться в .NET 11. Этот функционал уже доступен в Preview-версии SDK – можете установить и попробовать сами. Я попробовал и вот что я вам скажу.
1. Выглядит прикольно. Можно объединять типы.
2. Это синтаксический сахар. Под капотом у DU находятся структуры со всеми их типичными свойствами.
3. При компиляции структура реализует интерфейс IUnion.
4. Поскольку это обычная структура, то можно делать объединения объединений.
5. Я пока не знаю зачем этот функционал нужен и где бы лично я смог его применить. Возможно, он улучшит читаемость кода там, где разработчики применяют функциональный подход к написанию кода и Railway Oriented Programming. Плюс можно будет выкинуть на свалку все 3rd-party библиотеки, которые пытались реализовать тип Option/Maybe.
6. Ждите теперь больше дурацких вопросов на собеседованиях про типы и полиморфизм.
Пишите свои мысли в комментариях об этом синтаксисе.
#программирование@yet_another_dev
Сегодня про Discriminated Unions (DU) в C#, который вроде как должен появиться в .NET 11. Этот функционал уже доступен в Preview-версии SDK – можете установить и попробовать сами. Я попробовал и вот что я вам скажу.
1. Выглядит прикольно. Можно объединять типы.
var value = Random.Shared.Next() % 2 == 0 ?
new IsNumberOrString(int.MaxValue) :
new IsNumberOrString("Hello, World!");
var result = value switch
{
int x => $"Number: {x}",
string y => $"String: {y}",
};
Console.WriteLine(result);
public union IsNumberOrString(int, string);
2. Это синтаксический сахар. Под капотом у DU находятся структуры со всеми их типичными свойствами.
3. При компиляции структура реализует интерфейс IUnion.
public struct IsNumberOrString : IUnion
{
private readonly object <Value>k__BackingField;
public readonly object Value => this.<Value>k__BackingField;
public IsNumberOrString(int value)
{
this.<Value>k__BackingField = (object) value;
}
public IsNumberOrString(string value)
{
this.<Value>k__BackingField = (object) value;
}
}
4. Поскольку это обычная структура, то можно делать объединения объединений.
public union SmallNumbers(short, ushort);
public union BigNumbers(long, ulong);
public union Numbers(SmallNumbers, BigNumbers);
5. Я пока не знаю зачем этот функционал нужен и где бы лично я смог его применить. Возможно, он улучшит читаемость кода там, где разработчики применяют функциональный подход к написанию кода и Railway Oriented Programming. Плюс можно будет выкинуть на свалку все 3rd-party библиотеки, которые пытались реализовать тип Option/Maybe.
6. Ждите теперь больше дурацких вопросов на собеседованиях про типы и полиморфизм.
Пишите свои мысли в комментариях об этом синтаксисе.
❤1👍1