DS & ML
589 subscribers
1.17K photos
238 videos
240 files
1.41K links
Download Telegram
Forwarded from Neural Shit
Еще один годный ноутбук Pixel Art Diffusion — для генерации пиксель арта по текстовому запросу.

Ссылка
Forwarded from Neural Shit
Недавно в твитторе завирусился твит с просьбой дорисовать кота (первое изображение)

Товарищ Hardmaru попробовал сделать это с помощью нейросети Dalle 2. Получается достаточно забавно

Больше вариантов в твиттер-треде
Forwarded from эйай ньюз
This media is not supported in your browser
VIEW IN TELEGRAM
Привет, друзья! Каждому в хозяйстве метаверсе нужна хорошая сетка для удаления бэкграунда.

U-2-Net, кажется, одна из расхайпованых* сетей, которая удаляет фон, и ещё в неплохой image-2-image транслейшен умеет. Эта моделька разлетелась по куче приложений не просто так.

Есть код и веса на гитабе. Там же куча ссылок на всевозможные приложения, использующие U-2-NET.

* 5.7к звёзд на гитабе.

@Artem Gradient
Forwarded from Cyber Detective
Deep Face Live

Real-time face swap for streaming and video calls

(use and set-up requires considerable effort as well as a lot of free time)

https://github.com/iperov/DeepFaceLive

#python #deepfake #onnx #opensource
Год назад я выложил пост про rubert-tiny, миниатюрный энкодер предложений для русского языка.
В комменты пришёл @snakers4 и справедливо придрался, что я не сравнил свою модель с очевидными бейзлайнами: FastText, USE, Laser.

Спустя полгода я прокачал модель до rubert-tiny2 и сравнил ещё с кучей бейзлайнов.
А сейчас у меня наконец дошли руки накатать про это пост: Рейтинг русскоязычных энкодеров предложений.

TL;DR: если в вашем sentence encoder'е важно только качество на разнообразных задачах, юзайте USE, если очень важна скорость – FastText. Моя rubert-tiny2 – между ними; остальные модели проигрывают по качеству или скорости этим трём.
Forwarded from Derp Learning
Удобный интерфейс к text-image датасетам LAION 400m и 5B (400млн и 5млрд картинок соответственно)

Вводите текстовый запрос, CLIP находит нужные картинки, качаете табличку со ссылками, скачиваете и вуаля - датасет готов.

Тык
Forwarded from Open Source
​​DALL·E Mini

Это модель искусственного интеллекта, которая генерирует изображения по любому вашему запросу

https://github.com/borisdayma/dalle-mini

Тестировать онлайн: https://huggingface.co/spaces/dalle-mini/dalle-mini
This media is not supported in your browser
VIEW IN TELEGRAM
🗽 NVIDIA Создала 3D StyleGAN — EG3D: Efficient Geometry-aware 3D Generative Adversarial Networks

EG3D — нестоящее инженерное чудо. Ресерчеры взяли за основу StyleGAN 2 бэкбон, и вставили в середину графа гибридный neural rendering.

Nvidia создала новый tri-plane-based 3D GAN framework. Ресерчеры показали, что NeRF в их случае медленный, а воксели не очень масштабируются по памяти с повышением разрешения.

После нейронного рендеринга в 128х128 следует каскад супер-резолюшена в 512х512. Затем low-res ещё раз апскейлится интерполяцией и после конкатенации с mid-res картинкой, единым тензором подается на двойной дискриминатор.

StyleGAN’ы интересны тем, что способны за относительно небольшой компьют (тут 8 Tesla V100 GPUs и 8.5 дней) построить реалистичную генеративную модель в одном домене.

EG3D позволяет сразу генерировать качественную 3D геометрию, которую сеть выучивает самостоятельно!

Как же чудесно будущее 3D графики!

💻 Code
🖥 Project
📄 Paper
🎥 YouTube

@мишин_лернинг