Forwarded from эйай ньюз
🔥Ахтунг! Google разбил DALLE-2, выпустив свою text-2-image дифузионную модель Imagen
Основная идея: Large Pretrained Language Model × Cascaded Diffusion Model. То есть, мощная большая предобученная текстовая модель это залог успеха в генерации фотореалистичных картинок по описанию.
В статье есть куча подробного анализа и сравнений.
https://gweb-research-imagen.appspot.com/
@Artem Gradient
Основная идея: Large Pretrained Language Model × Cascaded Diffusion Model. То есть, мощная большая предобученная текстовая модель это залог успеха в генерации фотореалистичных картинок по описанию.
В статье есть куча подробного анализа и сравнений.
https://gweb-research-imagen.appspot.com/
@Artem Gradient
Forwarded from [PYTHON:TODAY]
Forwarded from Open Source
FILM: Frame Interpolation for Large Motion
Нейросетевая модель для интерполяции кадров.
FILM превращает 2 или более фотографий в кадры с замедленным движением, которые выглядят так, как будто они сняты видеокамерой.
https://github.com/google-research/frame-interpolation
YouTube демонстрация: https://www.youtube.com/watch?v=OAD-BieIjH4
Нейросетевая модель для интерполяции кадров.
FILM превращает 2 или более фотографий в кадры с замедленным движением, которые выглядят так, как будто они сняты видеокамерой.
https://github.com/google-research/frame-interpolation
YouTube демонстрация: https://www.youtube.com/watch?v=OAD-BieIjH4
Forwarded from GitHub Community
Best-of-ML-Python – проект, который содержит список «потрясающих» библиотек для машинного обучения на Python
Все библиотеки ранжируются по рейтингу качества проекта и по звёздам GitHub, также списки обновляются не меньше раза в неделю.
GitHub | #Python #Interesting #ML #Archive #Useful
Все библиотеки ранжируются по рейтингу качества проекта и по звёздам GitHub, также списки обновляются не меньше раза в неделю.
GitHub | #Python #Interesting #ML #Archive #Useful
Forwarded from Open Source
DeepFaceLive
От создателей DeepFaceLab
Замена лица в режиме реального времени для потоковой передачи на ПК или видеозвонков.
Вы можете поменять свое лицо с веб-камеры или лицо в видео, используя обученные модели лица.
В приложении DeepFaceLive также есть модуль Face Animator. Вы можете управлять статическим изображением лица с помощью видео или собственного лица с камеры.
https://github.com/iperov/DeepFaceLive
От создателей DeepFaceLab
Замена лица в режиме реального времени для потоковой передачи на ПК или видеозвонков.
Вы можете поменять свое лицо с веб-камеры или лицо в видео, используя обученные модели лица.
В приложении DeepFaceLive также есть модуль Face Animator. Вы можете управлять статическим изображением лица с помощью видео или собственного лица с камеры.
https://github.com/iperov/DeepFaceLive
Forwarded from T.Hunter
#news Гугл втихаря запретил использовать вычислительные мощности своего Colab’a для создания дипфейков.
На этом облачном сервисе для работы с Python-кодом теперь не сделать ни обещающего крипту Маска, ни видео с бывшей подружкой. За счёт многоядерных процессоров Colab ещё недавно отлично подходил для натаскивания машинного интеллекта под дипфейки. Теперь же они на сервисе в одном ряду с майнингом крипты, взлом паролей, торрентами и прочей крамолой.
На фоне мошеннических схем и использования дипфейков в инфовойнах, новость неплохая. Алармисты-то и вовсе грозят, что через несколько лет они совсем поломают реальность и доверие в обществе. Ну, теперь с серверов Гугла дипфейки если и будут, то только одобренные сверху! Что может пойти не так…
@tomhunter
На этом облачном сервисе для работы с Python-кодом теперь не сделать ни обещающего крипту Маска, ни видео с бывшей подружкой. За счёт многоядерных процессоров Colab ещё недавно отлично подходил для натаскивания машинного интеллекта под дипфейки. Теперь же они на сервисе в одном ряду с майнингом крипты, взлом паролей, торрентами и прочей крамолой.
На фоне мошеннических схем и использования дипфейков в инфовойнах, новость неплохая. Алармисты-то и вовсе грозят, что через несколько лет они совсем поломают реальность и доверие в обществе. Ну, теперь с серверов Гугла дипфейки если и будут, то только одобренные сверху! Что может пойти не так…
@tomhunter
Forwarded from Мишин Лернинг
🌊 Лайфхак для промт-инжиниринга DALL•E и Imagen. Баба Люба получает отличные картинки, для этого достаточно при каждой генерации писать..
Дикий промт-инжиниринговый трюк, можно описать следующей формулой:
👉 “A ” + “very “*n + “beautiful painting of “ + your_prompt, где int n >= 0
Автор идеи решил сгенерировать водопад в горах, воспользовавшись формулой.
🐥 Первая картинка, n = 0: "A beautiful painting of a mountain next to a waterfall." Сеть прекрасно понимает описанное, но генерит скучное изображение без деталей.
🐱 Вторая картинка, n = 1: "A very beautiful painting of a mountain next to a waterfall." Сеть генерирует более насыщенное изображение и главное, что проявляются меткие детали гор, зелени, деревьев.
🧠 Третья картинка, n = 6: “A very very very very very very beautiful painting of a mountain next to a waterfall." Генерации очень красивы. Множество мелких деталей, объектов, отражений, эффектов погоды.
🤖 Четвертая картинка, n = 22: Ощущение такое, что выставили все настройки графики на ultra!
Дикий промт-инжиниринговый трюк, можно описать следующей формулой:
👉 “A ” + “very “*n + “beautiful painting of “ + your_prompt, где int n >= 0
Автор идеи решил сгенерировать водопад в горах, воспользовавшись формулой.
🐥 Первая картинка, n = 0: "A beautiful painting of a mountain next to a waterfall." Сеть прекрасно понимает описанное, но генерит скучное изображение без деталей.
🐱 Вторая картинка, n = 1: "A very beautiful painting of a mountain next to a waterfall." Сеть генерирует более насыщенное изображение и главное, что проявляются меткие детали гор, зелени, деревьев.
🧠 Третья картинка, n = 6: “A very very very very very very beautiful painting of a mountain next to a waterfall." Генерации очень красивы. Множество мелких деталей, объектов, отражений, эффектов погоды.
🤖 Четвертая картинка, n = 22: Ощущение такое, что выставили все настройки графики на ultra!
Forwarded from Мишин Лернинг
🌌 DALL•E 2 расширил «Звёздную ночь» Ван Гога
Режим Inpainting, вместе с возможностью получать вариации исходного изображения выгодно отличают DALL•E 2 от более качественного Imagen. Хотя по факту, оба эти метода могут быть добавлены в Imagen путем нетривиального файнтюна. Но пока в Imagen этой фичи нет (или нет его файнтюн-потомка), насладимся расширением классики от DALL•E 2.
Оригинальное изображение — лишь небольшой прямоугольник внизу. Забавно, как DALL•E 2 продолжил странное завихрение в центре оригинальной картины.
По мнению некоторых искусствоведов, Ван Гог был знаком с популярными публикациями Фламмариона с рисунками спиральных галактик. И что в подобных нереалистичные завихрениях Ван Гог выражал свое ощущение динамичного и живого космоса.
Режим Inpainting, вместе с возможностью получать вариации исходного изображения выгодно отличают DALL•E 2 от более качественного Imagen. Хотя по факту, оба эти метода могут быть добавлены в Imagen путем нетривиального файнтюна. Но пока в Imagen этой фичи нет (или нет его файнтюн-потомка), насладимся расширением классики от DALL•E 2.
Оригинальное изображение — лишь небольшой прямоугольник внизу. Забавно, как DALL•E 2 продолжил странное завихрение в центре оригинальной картины.
По мнению некоторых искусствоведов, Ван Гог был знаком с популярными публикациями Фламмариона с рисунками спиральных галактик. И что в подобных нереалистичные завихрениях Ван Гог выражал свое ощущение динамичного и живого космоса.
Forwarded from Мишин Лернинг
🤺 DALL•E 2 vs IMAGEN пришло время показать на чьей стороне ты!
Генерации DALL•E 2 и Imagen по запросу: «Профессиональная фотография полярного медведь, держащего леденец на крыше в Гонконге, и смотрящего на НЛО в ночном небе» от hardmaru.
Я думаю, что все мы достаточно насмотрелись и на другие на генерации от DALL•E 2 и от Imagen.
Узнаем статистику по 5ти вопросам вместе:
🧠 Какая сеть лучше понимает текст? Чьи результаты больше соответствуют текстовому описанию?
👨🎨 Какая сеть лучше рисует? Чьи результаты выглядят красивее, эстетичнее?
👾 Какая сеть генерирует более целостные и реалистичные изображения? Чьи результаты проще спутать с реальными фото/картинами, где меньше артефактов?
🏆 Какой сети отдаете предпочтение именно Вы?
🤪 Какая сеть популярнее в соцсетях?
Генерации DALL•E 2 и Imagen по запросу: «Профессиональная фотография полярного медведь, держащего леденец на крыше в Гонконге, и смотрящего на НЛО в ночном небе» от hardmaru.
Я думаю, что все мы достаточно насмотрелись и на другие на генерации от DALL•E 2 и от Imagen.
Узнаем статистику по 5ти вопросам вместе:
🧠 Какая сеть лучше понимает текст? Чьи результаты больше соответствуют текстовому описанию?
👨🎨 Какая сеть лучше рисует? Чьи результаты выглядят красивее, эстетичнее?
👾 Какая сеть генерирует более целостные и реалистичные изображения? Чьи результаты проще спутать с реальными фото/картинами, где меньше артефактов?
🏆 Какой сети отдаете предпочтение именно Вы?
🤪 Какая сеть популярнее в соцсетях?