вообще, идея «представить что-то в виде суммы его частей, уравнять похожие части и выкинуть лишние» - очень вкусная для сжатия чего угодно, не только аудио, но и видео, и картинок. великий и ужасный JPEG эксплуатирует ту же идею, и буквально то же самое косинусное преобразование, только использует другой базис
❤2
и наверно, это все, что делает енкодер! вот так просто и непринужденно мы все поняли.
последний момент - как кодировать стерео-сигнал? авторами формата было решено, что сайд не так сильно нужен, чтобы воссоздать ощущение стерео - и они предложили кодировать отдельно мид (сумму двух каналов) и сайд (их разницу), а потом сайд сжимать более агрессивно. это все называется joint stereo, и вообще необязательно в mp3, и сейчас не особо в ходу, но раньше, когда в ходу были mp3 с битрейтом 128 кбит/с и ниже - это помогало улучшить качество кодирования моно-составляющей сигнала, да и панорама в те годы будто бы в среднем была поуже
последний момент - как кодировать стерео-сигнал? авторами формата было решено, что сайд не так сильно нужен, чтобы воссоздать ощущение стерео - и они предложили кодировать отдельно мид (сумму двух каналов) и сайд (их разницу), а потом сайд сжимать более агрессивно. это все называется joint stereo, и вообще необязательно в mp3, и сейчас не особо в ходу, но раньше, когда в ходу были mp3 с битрейтом 128 кбит/с и ниже - это помогало улучшить качество кодирования моно-составляющей сигнала, да и панорама в те годы будто бы в среднем была поуже
❤2⚡1🗿1
когда мы декодируем mp3, мы инвертируем все то, что наделали при кодировании:
- bitstream был закодирован кодом Хаффмана? раскодируем
- спектр полос фрейма был квантирован? восстанавливаем коэффициенты спектра и зануляем те, что не были заданы
- аудио описано спектром в базисе косинусных функций? применяем инвертированное модифицированное дискретное косинусное преобразование (IMDCT) и получаем аудио для каждой из 32 полос аудио
- полосы аудио в низком частотном диапазоне? шифтим их туда, где они должны быть
- у нас 32 полосы, а мы хотим получить одну? суммируем полосы
- фреймы теперь пересекаются по времени? используем OLA, чтобы бесшовно склеить переходы между фреймами
забавно, что декодировать в реальном времени научились не сразу - например, топовый в 1989 году 486 процессор задыхался от вычислительной сложности. сейчас, впрочем, декодировать можно чуть ли не на ардуинах, есть и аппаратные реализации на FPGA
- bitstream был закодирован кодом Хаффмана? раскодируем
- спектр полос фрейма был квантирован? восстанавливаем коэффициенты спектра и зануляем те, что не были заданы
- аудио описано спектром в базисе косинусных функций? применяем инвертированное модифицированное дискретное косинусное преобразование (IMDCT) и получаем аудио для каждой из 32 полос аудио
- полосы аудио в низком частотном диапазоне? шифтим их туда, где они должны быть
- у нас 32 полосы, а мы хотим получить одну? суммируем полосы
- фреймы теперь пересекаются по времени? используем OLA, чтобы бесшовно склеить переходы между фреймами
забавно, что декодировать в реальном времени научились не сразу - например, топовый в 1989 году 486 процессор задыхался от вычислительной сложности. сейчас, впрочем, декодировать можно чуть ли не на ардуинах, есть и аппаратные реализации на FPGA
❤3🤓3
ну че, мы молодцы? давайте к изначальному вопросу - почему mp3 громче нуля играет?
современные треки жмут будь здоров, превращая волноформу в кирпич, который так и норовит вылезти выше 0, но никогда этого не делает. если такой трек перевести в спектральное представление - малейшее изменение любой части этого спектра приведет к тому, что при обратном преобразовании сигнал будет превышать 0 в какие-то моменты времени.
mp3 - это не архив и не та же вавка только в хуевом качестве. mp3 - это по сути партитура для аддитивного синтезатора из 576 синусоид.
на этой поэтичной ноте завершаю рассказ, всем спасибо кто осилил или хотя бы попытался ❤️🩹
современные треки жмут будь здоров, превращая волноформу в кирпич, который так и норовит вылезти выше 0, но никогда этого не делает. если такой трек перевести в спектральное представление - малейшее изменение любой части этого спектра приведет к тому, что при обратном преобразовании сигнал будет превышать 0 в какие-то моменты времени.
mp3 - это не архив и не та же вавка только в хуевом качестве. mp3 - это по сути партитура для аддитивного синтезатора из 576 синусоид.
на этой поэтичной ноте завершаю рассказ, всем спасибо кто осилил или хотя бы попытался ❤️🩹
❤7🤓1
рекап:
mp3 это такой формат аудио, который при кодировании:
- делит входящий сигнал на фреймы и полосы частот,
- потом преобразует в спектр,
- при этом учитывает непрерывную природу аудиосигнала,
- затем оставляет наиболее важные части спектра
- и выбрасывает лишнее,
- а опционально - оптимизирует стерео.
а при декодировании делает все наоборот
mp3 это такой формат аудио, который при кодировании:
- делит входящий сигнал на фреймы и полосы частот,
- потом преобразует в спектр,
- при этом учитывает непрерывную природу аудиосигнала,
- затем оставляет наиболее важные части спектра
- и выбрасывает лишнее,
- а опционально - оптимизирует стерео.
а при декодировании делает все наоборот
❤1⚡1
я вижу тема с лекциями не заходит, теперь посты будут следующего содержания:
- всем доброе утро я посрал!
- кружочек где крутится обложка трека
- стикер из нижнего телеграма
- ЗАПИШИСЬ НА МОЙ КУРС СЕГОДНЯ
- всем доброе утро я посрал!
- кружочек где крутится обложка трека
- стикер из нижнего телеграма
- ЗАПИШИСЬ НА МОЙ КУРС СЕГОДНЯ
⚡14😁6🤓3
Bad Zu
В мире, где продюсер — никто, оператор сэмплов из сплайса
охуенно сказано кстати
недавно пару чужих проектов довелось посмотреть, и очень печально смотреть как искусство продакшена постепенно возвращается к уровню ejay, также известный как «собери из заранее предоставленных квадратиков трек мечты»
музыку писать - это должно больше быть похоже на рисование маслом, а не на игру в конструктор. ну вы артисты, художники, новаторы, или что? 🙁
недавно пару чужих проектов довелось посмотреть, и очень печально смотреть как искусство продакшена постепенно возвращается к уровню ejay, также известный как «собери из заранее предоставленных квадратиков трек мечты»
музыку писать - это должно больше быть похоже на рисование маслом, а не на игру в конструктор. ну вы артисты, художники, новаторы, или что? 🙁
❤5
вспоминаем, как Стив Дуда изменил облик современной музыки:
2006 - Native Instruments выпускают FM8 взамен ушедшему FM7, оба - внебрачные наследники эпохального Yamaha DX-7. потребность в FM-синтезаторе закрыта с лихвой, но в линейке NI не хватает таблично-волнового синта - и в том же году
вышел Massive. сейчас происходит закат электро-хауса и зарождается бигрум, синты сразу идут в ход как мейнстримными продюсерами, так и в авангарде драм н бейса. дорвался до Massive и Сони Мур, который начинает абузить синт, и в
2007-2009 выпускает свои первые треки (они звучат как говно). тут красивая история, как Сони передает флешку Дедмаусу на концерте, Дедмаус ее открывает и говорит - надо делать. собирает в охапку весь цвет электронной музыки и в
2010 выпускает первый сингл Scary Monsters…, а в
2011 - знаковую одноименную епиху, моментально создавшую новую нишу в музыке. все начали упражняться в кручении воббл-баса (у них не было такой команды как у Дедмауса - так что поначалу получалось такое же говно, как и у самого Сони поначалу) - отчасти от отсутствия информации, отчасти от того, что инструмента, заточенного под звуки ебли роботов, еще не было.
2006 - Native Instruments выпускают FM8 взамен ушедшему FM7, оба - внебрачные наследники эпохального Yamaha DX-7. потребность в FM-синтезаторе закрыта с лихвой, но в линейке NI не хватает таблично-волнового синта - и в том же году
вышел Massive. сейчас происходит закат электро-хауса и зарождается бигрум, синты сразу идут в ход как мейнстримными продюсерами, так и в авангарде драм н бейса. дорвался до Massive и Сони Мур, который начинает абузить синт, и в
2007-2009 выпускает свои первые треки (они звучат как говно). тут красивая история, как Сони передает флешку Дедмаусу на концерте, Дедмаус ее открывает и говорит - надо делать. собирает в охапку весь цвет электронной музыки и в
2010 выпускает первый сингл Scary Monsters…, а в
2011 - знаковую одноименную епиху, моментально создавшую новую нишу в музыке. все начали упражняться в кручении воббл-баса (у них не было такой команды как у Дедмауса - так что поначалу получалось такое же говно, как и у самого Сони поначалу) - отчасти от отсутствия информации, отчасти от того, что инструмента, заточенного под звуки ебли роботов, еще не было.
❤4
он появится в 2014 году, и был выпущен Стивом Дуда - который кто? правильно, друг и коллега по музону Дедмауса. в синте было все в коробке - злые вейвтейблы и их редактор, MSEG LFO, OTT-компрессор… тема взлетела, и 4 года спустя Стив отчитался в интервью, что поднял на серуме 10 миллионов долларов - даже несмотря на непрекращающееся пиратство.
в 2019 выходит Phase Plant, решающий некоторую топорность серума - у него модульная архитектура, и нет внутренних ограничений на роутинг или количество эффектов. на РР переходят все DNB-продюсеры, но многие (и ваш покорный) продолжают любить серум и вытягивать тембры из него.
наконец, в 2025 старичок получает обновление (даже Massive обзавелся потомком с литерой X в названии). это не революция в синтостроении, а симпатичный гифт-бокс для поклонников. посмотрим что внутри?
в 2019 выходит Phase Plant, решающий некоторую топорность серума - у него модульная архитектура, и нет внутренних ограничений на роутинг или количество эффектов. на РР переходят все DNB-продюсеры, но многие (и ваш покорный) продолжают любить серум и вытягивать тембры из него.
наконец, в 2025 старичок получает обновление (даже Massive обзавелся потомком с литерой X в названии). это не революция в синтостроении, а симпатичный гифт-бокс для поклонников. посмотрим что внутри?
⚡4
🌊 третий осциллятор + по две крутилки Warp
удобно! я раньше встречал интересные хаки в духе «запишем семпл с синусоидой и закинем в нойз-осциллятор» - осков не хватало.
кстати, теперь можно кросс-модулировать оски: знаменитый FM FROM B можно использовать одновременно с FM FROM A (и очень быстро засрать весь патч)
удобно! я раньше встречал интересные хаки в духе «запишем семпл с синусоидой и закинем в нойз-осциллятор» - осков не хватало.
кстати, теперь можно кросс-модулировать оски: знаменитый FM FROM B можно использовать одновременно с FM FROM A (и очень быстро засрать весь патч)
⚡5