Forwarded from GitHub Community
pyAudioAnalysis – Библиотека Python для извлечения звуковых функций, классификации, сегментации звуковых данных
С помощью pyAudioAnalysis вы можете классифицировать неизвестные звуки, распознавать звуки с помощью машинного обучения и многое другое..
GitHub | #Python #Audio #Analyzer #Interesting
С помощью pyAudioAnalysis вы можете классифицировать неизвестные звуки, распознавать звуки с помощью машинного обучения и многое другое..
GitHub | #Python #Audio #Analyzer #Interesting
Forwarded from Senior Python Developer
Преобразование текста в речь
Рассмотрим модуль pyttsx3, позволяющий озвучивать текст прямо во время выполнения программы. Для запуска кода с картинки необходимо установить модуль при помощи
Модуль позволяет менять настройки произношения. Полная документация доступна по ссылке: https://pypi.org/project/pyttsx3/
Рассмотрим модуль pyttsx3, позволяющий озвучивать текст прямо во время выполнения программы. Для запуска кода с картинки необходимо установить модуль при помощи
pip install pyttsx3. Запущенная программа спросит, как у вас дела, и скажет, что любит макароны.Модуль позволяет менять настройки произношения. Полная документация доступна по ссылке: https://pypi.org/project/pyttsx3/
Forwarded from эйай ньюз
StyleHEAT: One-Shot High-Resolution Editable Talking Face Generation via Pretrained StyleGAN
Статья с SIGGRAPH о манипуляциях с лицом. К журналу/конференции SIGGRAPH есть очень большое доверие, так как там фокус именно на качество картинок и видео, и туда отбираются работы с очень впечатляющими результатами.
StyleHEAT меняет и синтезирует лица в разрешении 1024x1024, даже если исходное изобраджение было худшего качества. Драйвить синтезис нового видео можно как с помощью другого видео, так и с помошью аудио (запись разговора человека).
Подробности читайте в статье.
>> Статья >> Кода нет 😢
Статья с SIGGRAPH о манипуляциях с лицом. К журналу/конференции SIGGRAPH есть очень большое доверие, так как там фокус именно на качество картинок и видео, и туда отбираются работы с очень впечатляющими результатами.
StyleHEAT меняет и синтезирует лица в разрешении 1024x1024, даже если исходное изобраджение было худшего качества. Драйвить синтезис нового видео можно как с помощью другого видео, так и с помошью аудио (запись разговора человека).
Подробности читайте в статье.
>> Статья >> Кода нет 😢
Forwarded from Технологии | Нейросети | Боты
Из интересного на мой взгляд:
Animegan различных версий.
Пример на фото:
https://huggingface.co/spaces/PaddlePaddle/animegan_v1_hayao_60
Animegan различных версий.
Пример на фото:
https://huggingface.co/spaces/PaddlePaddle/animegan_v1_hayao_60
Forwarded from Технологии | Нейросети | Боты
This media is not supported in your browser
VIEW IN TELEGRAM
Довольно годный липсинк, но не очень комфортные ограничения:
https://huggingface.co/spaces/PaddlePaddle/wav2lip
https://huggingface.co/spaces/PaddlePaddle/wav2lip
Forwarded from Senior Python Developer
Первые шаги в Matplotlib
Matplotlib служит для построения графиков и визуализации данных, часто применяется в Data Science. В примере рисуем простейший график для знакомства с библиотекой, а также задаём собственные названия для осей координат с помощью методов
Matplotlib служит для построения графиков и визуализации данных, часто применяется в Data Science. В примере рисуем простейший график для знакомства с библиотекой, а также задаём собственные названия для осей координат с помощью методов
plt.ylabel() и plt.xlabel().Forwarded from Заметки
Вышло обновление GPEN!
Добавлена модель разрешением 2048.
Скачать версию для Windows можно тут https://drive.google.com/file/d/1YJJVnPGq90e_mWZxSGGTptNQilZNfOEO/view
Официальный GitHub https://github.com/yangxy/GPEN
Если GPEN для Win уже установлен, то просто запустите misc) Install or update GPEN.bat, чтобы скачалось обновление.
Прикрепляю тесты новой модели.
Original -> 512 res -> 2048 res
Добавлена модель разрешением 2048.
Скачать версию для Windows можно тут https://drive.google.com/file/d/1YJJVnPGq90e_mWZxSGGTptNQilZNfOEO/view
Официальный GitHub https://github.com/yangxy/GPEN
Если GPEN для Win уже установлен, то просто запустите misc) Install or update GPEN.bat, чтобы скачалось обновление.
Прикрепляю тесты новой модели.
Original -> 512 res -> 2048 res
Forwarded from эйай ньюз
This media is not supported in your browser
VIEW IN TELEGRAM
Kubric: a scalable dataset generator
[Google Research]
Появился код для Kubric! Kubric - это пайплайн для генерации синтетических 3D данных, который вы можете использовать в своих проектах для 3D алгоритмов, например для Нейронного Рендеринга. Kubric позволяет программно создавать полуреалистичные синтетическихе многообъектные видео с подробными аннотациями, такими как маски сегментации, карты глубины и оптический поток.
Kubric в основном построен на основе pyBullet (для моделирования физики) и Blender (для рендеринга); однако код является модульным, чтобы потенциально поддерживать различныеи бекэнды для рендеринга.
>> Статья >> Код
[Google Research]
Появился код для Kubric! Kubric - это пайплайн для генерации синтетических 3D данных, который вы можете использовать в своих проектах для 3D алгоритмов, например для Нейронного Рендеринга. Kubric позволяет программно создавать полуреалистичные синтетическихе многообъектные видео с подробными аннотациями, такими как маски сегментации, карты глубины и оптический поток.
Kubric в основном построен на основе pyBullet (для моделирования физики) и Blender (для рендеринга); однако код является модульным, чтобы потенциально поддерживать различныеи бекэнды для рендеринга.
>> Статья >> Код
Forwarded from Технологии | Нейросети | Боты
This media is not supported in your browser
VIEW IN TELEGRAM
InsetGAN for Full-Body Image Generation.
InsetGAN для создания изображений всего тела!
"В то время как GAN могут создавать фотореалистичные изображения в идеальных условиях для определенных областей, генерация изображений человека в полный рост остается сложной из-за разнообразия личностей, причесок, одежды и различий в позах. Вместо моделирования этой сложной области с помощью одного GAN мы предлагаем новый метод объединения нескольких предварительно обученных GAN, где один GAN генерирует глобальный холст (например, человеческое тело) и набор специализированных GAN или вставок., сфокусируйтесь на разных частях (например, лицах, руках), которые можно легко вставить на глобальный холст."
abs: https://arxiv.org/abs/2203.07293
project page: http://afruehstueck.github.io/insetgan
Смотрится очень годно, кода нет..
Добро пожаловать в новый мир 👾
InsetGAN для создания изображений всего тела!
"В то время как GAN могут создавать фотореалистичные изображения в идеальных условиях для определенных областей, генерация изображений человека в полный рост остается сложной из-за разнообразия личностей, причесок, одежды и различий в позах. Вместо моделирования этой сложной области с помощью одного GAN мы предлагаем новый метод объединения нескольких предварительно обученных GAN, где один GAN генерирует глобальный холст (например, человеческое тело) и набор специализированных GAN или вставок., сфокусируйтесь на разных частях (например, лицах, руках), которые можно легко вставить на глобальный холст."
abs: https://arxiv.org/abs/2203.07293
project page: http://afruehstueck.github.io/insetgan
Смотрится очень годно, кода нет..
Добро пожаловать в новый мир 👾
👍2
Forwarded from GitHub Community
SkinDeep – нейронная сеть, что позволяет убирать татуировки с любой части тела на фотографиях
Ограничения:
⤷ Дизайн каждой татуировки уникален, он отличается от человека к человеку, поэтому модель может не работать в некоторых случаях.
⤷ Не работает с цветными татуировками, в наборе данных их нету
⤷ Требуется минимум 3,7 ГБ свободной памяти графического процессора
GitHub | #Jupyter #Interesting
Ограничения:
⤷ Дизайн каждой татуировки уникален, он отличается от человека к человеку, поэтому модель может не работать в некоторых случаях.
⤷ Не работает с цветными татуировками, в наборе данных их нету
⤷ Требуется минимум 3,7 ГБ свободной памяти графического процессора
GitHub | #Jupyter #Interesting
Forwarded from Эксплойт
This media is not supported in your browser
VIEW IN TELEGRAM
ИИ научился озвучивать фотографии
На известном сайте MyHeritage, где с помощью технологии Deep Nostalgia можно возвращать к жизни старые фотографии и «оживлять» их, появилась новая функция LiveStory. Она позволяет добавить голос, которым человек на фотографии может рассказать историю из своей жизни.
LiveStory позволяет выбрать голос из каталога, в котором более 140 вариантов с поддержку 31 языка. Разработчики говорят, что в дальнейшем каталог и количество поддерживаемых языков расширится.
Бонус — герой на фото может рассказать историю вашего генеалогического дерева или озвучит написанный вами текст. Время, когда можно будет поговорить с дедом в виде голограммы не за горами.
*если решите попробовать сервис, не забудьте выключить автопродление подписки после бесплатных 14 дней
@exploitex
На известном сайте MyHeritage, где с помощью технологии Deep Nostalgia можно возвращать к жизни старые фотографии и «оживлять» их, появилась новая функция LiveStory. Она позволяет добавить голос, которым человек на фотографии может рассказать историю из своей жизни.
LiveStory позволяет выбрать голос из каталога, в котором более 140 вариантов с поддержку 31 языка. Разработчики говорят, что в дальнейшем каталог и количество поддерживаемых языков расширится.
Бонус — герой на фото может рассказать историю вашего генеалогического дерева или озвучит написанный вами текст. Время, когда можно будет поговорить с дедом в виде голограммы не за горами.
*если решите попробовать сервис, не забудьте выключить автопродление подписки после бесплатных 14 дней
@exploitex
👍1
Forwarded from Технологии | Нейросети | Боты
Media is too big
VIEW IN TELEGRAM
Никогда, никогда, никогда не используйте пикселизацию для редактирования текста.
Это не безопасно, любой такой текст можно декодировать нейросетью.
Единственным безопасным способом является использование черных полос. Иногда людям нравится быть умными и пробовать некоторые другие методы редактирования, такие как размытие, завихрение или пикселизация, но это ошибка..
Оригинальная статья:
https://bishopfox.com/blog/unredacter-tool-never-pixelation
• Github:
https://github.com/bishopfox/unredacter
Это не безопасно, любой такой текст можно декодировать нейросетью.
Единственным безопасным способом является использование черных полос. Иногда людям нравится быть умными и пробовать некоторые другие методы редактирования, такие как размытие, завихрение или пикселизация, но это ошибка..
Оригинальная статья:
https://bishopfox.com/blog/unredacter-tool-never-pixelation
• Github:
https://github.com/bishopfox/unredacter
👍1
Forwarded from эйай ньюз
🔥Вау! Full-body генерация фотографий человека!
Ранее только лица людей получалось хорошо генерировать с помощью нейронных сетей . Теперь, Adobe вместе с учёными из KAUST собрали модель для генерации всего тела человека. И результаты просто вау!
Модель состоит из трёх GAN-ов, хитро склеенных воедино. Один фокусируется на всем теле в целом, второй на генерации головы, а третий на ступнях ног.
Как сказал бы один парень: "Вот э тайм ту би элайв"!
Подробности на сайте проекта и в статье. Но кода нет.
Ранее только лица людей получалось хорошо генерировать с помощью нейронных сетей . Теперь, Adobe вместе с учёными из KAUST собрали модель для генерации всего тела человека. И результаты просто вау!
Модель состоит из трёх GAN-ов, хитро склеенных воедино. Один фокусируется на всем теле в целом, второй на генерации головы, а третий на ступнях ног.
Как сказал бы один парень: "Вот э тайм ту би элайв"!
Подробности на сайте проекта и в статье. Но кода нет.
👍1
Forwarded from эйай ньюз
Вот ещё результаты full-body генерации. Тут показано, как отдельно улучшаются ноги и лицо.
Forwarded from Технологии | Нейросети | Боты
Media is too big
VIEW IN TELEGRAM
Классная генерация "нордический узор":
- сгенерил в DiscoDiffusionTurbo
- добавил кадров в FILM
- обрезал только басы с помощью pydub (пример использования тут)
- подогнал под басовый трек через audio reactive video
• Автор творения
- сгенерил в DiscoDiffusionTurbo
- добавил кадров в FILM
- обрезал только басы с помощью pydub (пример использования тут)
- подогнал под басовый трек через audio reactive video
• Автор творения
Forwarded from Технологии | Нейросети | Боты
Media is too big
VIEW IN TELEGRAM