DS & ML
588 subscribers
1.17K photos
238 videos
240 files
1.41K links
Download Telegram
🔘 Спустя год хайпа подхода вышел пейпер VQGAN-CLIP от EleutherAI

Когда в голове у всех DALL-E 2 и Latent Diffusion, Katherine Crowson и Stella Biderman и другие крутые ребята из EleutherAI выкатывают папир по VQGAN-CLIP.

Спрашивается зачем? А я сейчас покажу, откуда на Беларусь готовилось нападение, и если бы за шесть часов не был нанесен ноги у этого растут и зачем это все.

То что сейчас происходит, я бы назвал, демократизацией искусственного интеллекта! Ведь давайте будем честны, DALL-E 2 — огонь, но светит он через закрытые шторы. А вот ресерчеры из EleutherAI, делают современный AI, который сейчас считается привилегией ограниченного круга избранных, доступным для всех.

К чему это я? VQGAN-CLIP — хит прошлого лета, был доступен сразу всем и каждому, и развивался благодоря коммьюнити! Я тоже делал очень крутые штуки своей версией CLIP-VQGAN.

И в этом году мы видим, сначала код GPT-NeoX с открытыми весами, а потом формализацию — пейпер, который полезен, в котором есть детали!

💻 Code
📄
VQGAN-CLIP paper
Forwarded from AI для Всех
HuggingFace запустили свой курс по RL! Судя по скриншотам - это бомба 💣

Курс бесплатный, регистрируют тут
Forwarded from эйай ньюз
GPT-3 модель для 60 языков от Сбера
mGPT: Few-Shot Learners Go Multilingual

Сбер выкатил в опенсоурс новую модель на 1,3 миллиарда параметров, обученных на 60 языках из 25 языковых семей с использованием Википедии и Colossal Clean Crawled Corpus.

В препринте на архиве, авторы заявляют, что модель показывает производительность наравне с недавно выпущенными моделями XGLM от Facebook (disclaimer: я хз, сам модель не тестил ещё), охватывая больше языков, включая малоресурсные языки (с маленьким набором текстов в датасетах) стран СНГ и малых народов России.

На скрине пример использования модели. Код и веса есть на гитхабе.
DS & ML pinned a photo
Media is too big
VIEW IN TELEGRAM
🥻StyleGAN-Human: A Data-Centric Odyssey of Human Generation

Тут ребята генерируют людей целиком, а не только лица. Вроде ничего нового, но результат неплохой. Даже в эпоху DALL-E 2, подобная технология может быть полезна, так как позволяет генерировать реалистичные «стоковые души» для разных коммерческих задач.

🔮 Colab | сгенерировать стоковую душу

Ребята уже выложили веса StyleGAN (1024x512), StyleGAN 2 (1024x512) и даже StyleGAN 3, но пока только в 512х256, но обещают скоро выложить и 1024x512 веса.

🖥 project 💻 git 🎥 youtube

p.s.: На ютуб ролике с объяснением, пока всего 90 просторов
Forwarded from Эксплойт
This media is not supported in your browser
VIEW IN TELEGRAM
Нейросеть меняет время суток на фотографии

Нейросеть OutCast способна менять освещение снимка в зависимости от выбранного времени суток. За разработку отвечают инженеры Университетского колледжа Лондона совместно с коллегами из Adobe и Apple.

Искусственный интеллект определяет объекты на снимке и источник света за счет отбрасываемых теней, после чего с помощью ползунка позволяет регулировать положение солнца.

Когда нейросеть станет общедоступной пока неизвестно, но уже сейчас желающие могут протестировать несколько готовых изображений на странице разработки.

@exploitex
🚀 Сегодня OpenAI выкатил в открытый доступ все веса известной нейросети CLIP | Привет, ViT-L/14@336px

Случилось! Спустя 16 месяцев OpenAI выложили веса топового CLIP ViT-L/14 в разрешении 336px. Напомню, что в начале февраля OpenAI выложили веса CLIP ViT-L14 в разрешении 224px.

Заменить ViT-L/14 на ViT-L/14@336px можно легко одной строчкой:

вместо:
model, preprocess = clip.load('ViT-L/14', device)
пишем:
model, preprocess = clip.load('ViT-L/14@336px', device)

Почему это важно?

ViT CLIP стал стандартом. И уже понятно, что более серьезным, чем когда-то были VGG и RN50 на ImageNet. Его используют для генерации и изменения картинок, поиска по фото, нейронного ранжирования, метрики схожести, zero-shot классификации и linear probe и т.д.

А теперь нам стала доступна самая топовая модель! Да, есть интересные конкуренты, но CLIP останется стандартом на долгие годы. Как это было с RN50 на ImageNet, и не потому что ResNet особенный, он просто был важной вехой в истории DL.

ссылка на веса CLIP ViT-L/14@336px
Forwarded from эйай ньюз
OpenAI наконец выложили веса CLIP с топовой архитектурой ViT-L/14@336px

Самое крутое -
это простота использования CLIP. Это почти как «импорт керас, фит-предикт», если понимаете о чем я. А ещё это MIT лицензия, позволяющая коммерческое использование.

Спасибо @mischin_learning за наводку.

🛠https://github.com/openai/CLIP
⚙️Ссылка на диф
Forwarded from эйай ньюз
🧔‍♀Новая модель по восстановлению лиц

Panini-Net: GAN Prior based Degradation-Aware Feature Interpolation for Face Restoration

Отличие этой модели в том, что декодер использует скрытое пространство StyleGAN2, натренированного на портретах, как источник априорной информации о лице (см. схему архитектуры на картинке).

📝ArXiv
🛠GitHub
🔮Colab
Forwarded from [PYTHON:TODAY]
💾 Гайд по Pandas - высокоуровневой Python библиотеке для анализа данных.

#doc #pandas
Forwarded from Codeby
​Обзор и Оценка GPT-3

OpenAI открыла доступ к GPT-3: достаточно зарегистрироваться, получить API-ключ и начать изучать генерацию. GPT-3 является алгоритмом обработки естественного языка, это так-же самая большая модель в мире. Важно понять, что GPT-3 не пишет текст, она его генерирует, это важное замечание. При написании текста, человек его осознает и обдумывает, в отличии от GPT-3, которая генерирует текст на основе определенного алгоритма, не понимая смысла. Главная задача GPT-3 - понимать текст.

📌 Читать статью: https://codeby.net/threads/obzor-i-ocenka-gpt-3.79034/

📝 Академия Кодебай |🍿 YouTube |🌀 ВКонтакте

#python #neuronet #ai
Forwarded from эйай ньюз
OpenAI наконец выложили веса CLIP с топовой архитектурой ViT-L/14@336px

Самое крутое -
это простота использования CLIP. Это почти как «импорт керас, фит-предикт», если понимаете о чем я. А ещё это MIT лицензия, позволяющая коммерческое использование.

Спасибо @mishin_learning за наводку.

🛠https://github.com/openai/CLIP
⚙️Ссылка на диф
🥑 Вчера OpenAI сделали DALL•E 2 флешмоб под названием «Давайте сделаем 3D-рендер»

Как мы знаем OpenAI — самые настоящие OpenAI. Веса DALL•E 2 закрыты, код закрыт. Зато открыт пиар и медиа маркетинг. Вот вчера открытые к своему комьюнити OpenAI принимали в своем инстаграмме запросы от юзеров user_text и после конкатенации “3D render of “ + user_text постили результаты.

И да, user_text’ы проходили через жесткий cherry-pick, как и генерации. Было сгенерировано меньше десяти картинок, а запросов были сотни.

Но, недолго вам упиваться своей уникальностью. Так было с GPT, так будет и с DALL•E 2. Это лишь вопрос полугода.

А вопросов к самому DALL•E 2 — нет, тут все на высшем уровне, вот результаты:
▪️Авокадо танцуют, бухают и поют на гавайском луау
▪️Молекула ДНК
▪️Песочные часы
▪️Пушистая альпака в солнцезащитных очках
▪️Львенок астронавт
▪️Снежный шар

p.s.: Ситуация с монополией OpenAI имеет свои плюсы, это побуждает рынок и сильных ресерчеров заполнять конкурентную нишу, но с blackjack’ом и open-source’ом