Forwarded from Habr For Dev
#yandex-research #нейронные-сети
Самая большая BERT-подобная модель на русском, которая поместится на ваш компьютер
Рейтинг: 43
Читать
Самая большая BERT-подобная модель на русском, которая поместится на ваш компьютер
Рейтинг: 43
Читать
👍1
Forwarded from RU Dataset | Датасеты
↕️↘️ Содержание
0️⃣1️⃣ Адреса
0️⃣2️⃣ Анализ сцен
0️⃣3️⃣ Видеозаписи
0️⃣4️⃣ Выборы
0️⃣5️⃣ Еда | Продукты питания
0️⃣6️⃣ Здравоохранение
0️⃣7️⃣ Лингвистические датасеты
0️⃣8️⃣ Литература
0️⃣9️⃣ Мода
1️⃣0️⃣ Музыка
1️⃣1️⃣ Муниципальные порталы открытых данных
1️⃣2️⃣ Недвижимость
1️⃣3️⃣ Образование
1️⃣4️⃣ Региональные порталы открытых данных
1️⃣5️⃣ Рецензии | Отзывы
1️⃣6️⃣ Рынок труда и занятость
1️⃣7️⃣ Социальные сети
1️⃣8️⃣ Токсичность, троллинг, эмоции
1️⃣9️⃣ Текстовые данные
2️⃣0️⃣ Устная речь
2️⃣1️⃣ Федеральные порталы открытых данных
2️⃣2️⃣ Финансы
2️⃣3️⃣ Фотографии людей
2️⃣4️⃣ Фотографии с высоты
2️⃣5️⃣ Экология
Не нашли, что искали, а нужно очень срочно?
datacatalogs.ru
datasetsearch.research.google.com
0️⃣1️⃣ Адреса
0️⃣2️⃣ Анализ сцен
0️⃣3️⃣ Видеозаписи
0️⃣4️⃣ Выборы
0️⃣5️⃣ Еда | Продукты питания
0️⃣6️⃣ Здравоохранение
0️⃣7️⃣ Лингвистические датасеты
0️⃣8️⃣ Литература
0️⃣9️⃣ Мода
1️⃣0️⃣ Музыка
1️⃣1️⃣ Муниципальные порталы открытых данных
1️⃣2️⃣ Недвижимость
1️⃣3️⃣ Образование
1️⃣4️⃣ Региональные порталы открытых данных
1️⃣5️⃣ Рецензии | Отзывы
1️⃣6️⃣ Рынок труда и занятость
1️⃣7️⃣ Социальные сети
1️⃣8️⃣ Токсичность, троллинг, эмоции
1️⃣9️⃣ Текстовые данные
2️⃣0️⃣ Устная речь
2️⃣1️⃣ Федеральные порталы открытых данных
2️⃣2️⃣ Финансы
2️⃣3️⃣ Фотографии людей
2️⃣4️⃣ Фотографии с высоты
2️⃣5️⃣ Экология
Не нашли, что искали, а нужно очень срочно?
datacatalogs.ru
datasetsearch.research.google.com
Forwarded from Мишин Лернинг
В рамках нашей работы по демократизации и расширению доступа к языковым моделям во всем мире сформировалась команда Polyglot, лаба в EleutherAI, исследования которых сосредоточены вокруг многоязычного и неанглоязычного НЛП.
Мы (да да) рады объявить об их первых моделях: корейских LLM с параметрами 1.3B и 3.8B
Так что ждите и другие языки натрененные нормально 😅
🗣 Polyglot от Eleuther
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Python - Советы, библиотеки, гайды
This media is not supported in your browser
VIEW IN TELEGRAM
Один чел сделал на Python детектор куриц, чтобы когда они заходят во двор - автоматически включался полив воды и отпугивал их.
Как написал автор этого изобретения в своем блоге:
«У меня был старый китайский телефон, старый raspberry pi 3b+, python, opencv и немножко deep learning. А еще у меня были соседские курицы, которые меня з@#б@ли.»
Python, который мы заслужили 🌚
Как написал автор этого изобретения в своем блоге:
«У меня был старый китайский телефон, старый raspberry pi 3b+, python, opencv и немножко deep learning. А еще у меня были соседские курицы, которые меня з@#б@ли.»
Python, который мы заслужили 🌚
Forwarded from Denis Sexy IT 🤖
Нейронка для генерации арта Dalle 2 доступна теперь для всех, просто регаетесь и го генерить:
https://labs.openai.com/auth/signup
https://labs.openai.com/auth/signup
Forwarded from Neural Shit
Но в целом, считаю, что OpenAI проебались и открыли регистрацию слишком поздно, ибо Stable Diffusion генерит плюс-минус так же, свой веб интерфейс для генераций бесплатно поднимается в 5 кликов в колабе, и самое главное, стебель можно файтюнить (тоже бесплатно и в колабе).
Ну и сейчас все ломанулись регаться в dalle-2, отчего очередь там будет как в советский магазин, в который завезли дефицитные сапоги набитые сырокопченой колбасой (уже при попытке зарегаться кидает ошибку о том, что что-то пошло не так)
Ну и сейчас все ломанулись регаться в dalle-2, отчего очередь там будет как в советский магазин, в который завезли дефицитные сапоги набитые сырокопченой колбасой (уже при попытке зарегаться кидает ошибку о том, что что-то пошло не так)
Forwarded from Мишин Лернинг
🦊 OpenAI открыло DALL•E 2 для всех желающих.
Смотрите, что стебель живогенерящий с людьми творит. Не без регистрации и смс конечно. Но зато бесплатно с пару десятков можно генернуть.
🥁 регаться тут https://openai.com/dall-e-2/
Смотрите, что стебель живогенерящий с людьми творит. Не без регистрации и смс конечно. Но зато бесплатно с пару десятков можно генернуть.
🥁 регаться тут https://openai.com/dall-e-2/
Forwarded from Чёрный Треугольник
ИИ способный разоблачать анонимных писателей🤔
Разведка США запустила программу по разработке искусственного интеллекта, который может определять авторство анонимных писем, а также маскировать личность автора, слегка изменяя его слова.
Программа Human Interpretable Attribution of Text Using Underlying Structure (HIATUS) от Intelligence Advanced Research Projects Activity (IARPA) направлена на создание программного обеспечения, которое может выполнять «лингвистическое снятие отпечатков пальцев» и изменять его при необходимости.
«Люди и машины ежедневно производят огромное количество текстового контента. Текст содержит лингвистические особенности, которые могут раскрыть личность автора» — говорится в сообщении ведомства.
☝🏻Об этом также был один из моих роликов.
IARPA полагает, что с правильной моделью она может определить согласованность стиля писателя в разных образцах, изменить эти языковые шаблоны, чтобы сделать письмо анонимным, и сделать все это так, чтобы это было понятно начинающим пользователям.
ИИ HIATUS сможет работать независимо от языка.🤖
Разведка США запустила программу по разработке искусственного интеллекта, который может определять авторство анонимных писем, а также маскировать личность автора, слегка изменяя его слова.
Программа Human Interpretable Attribution of Text Using Underlying Structure (HIATUS) от Intelligence Advanced Research Projects Activity (IARPA) направлена на создание программного обеспечения, которое может выполнять «лингвистическое снятие отпечатков пальцев» и изменять его при необходимости.
«Люди и машины ежедневно производят огромное количество текстового контента. Текст содержит лингвистические особенности, которые могут раскрыть личность автора» — говорится в сообщении ведомства.
☝🏻Об этом также был один из моих роликов.
IARPA полагает, что с правильной моделью она может определить согласованность стиля писателя в разных образцах, изменить эти языковые шаблоны, чтобы сделать письмо анонимным, и сделать все это так, чтобы это было понятно начинающим пользователям.
ИИ HIATUS сможет работать независимо от языка.🤖
Forwarded from Habr For Dev
Forwarded from Python - Советы, библиотеки, гайды
SReC — нейронная сеть для сжатия изображения без потери качества.
SReC рассматривает сжатие без потерь как проблему сверхвысокого разрешения и применяет нейронные сети для сжатия изображений. SReC может достичь самых современныхq коэффициентов сжатия больших наборов данных с практичным временем выполнения.
* Обучение, сжатие и распаковка полностью поддерживаются и имеют открытый исходный код :0
Фотография сверху - пример сжатия изображения без потери качества(тг съел качество, поэтому я оставил ссылку).
Документация и примеры кода здесь :3
SReC рассматривает сжатие без потерь как проблему сверхвысокого разрешения и применяет нейронные сети для сжатия изображений. SReC может достичь самых современныхq коэффициентов сжатия больших наборов данных с практичным временем выполнения.
* Обучение, сжатие и распаковка полностью поддерживаются и имеют открытый исходный код :0
Фотография сверху - пример сжатия изображения без потери качества(тг съел качество, поэтому я оставил ссылку).
Документация и примеры кода здесь :3
Forwarded from Neural Shit
Иногда (особенно сейчас) надо прекращать думать о хуёвом и давать мозгу расслабиться и отдохнуть.
Лучший способ — это залипнуть в психоделический видос сгенеренный нейронкой. Вот, я вам принёс 40 минут такого залипалова: https://www.youtube.com/watch?v=HxRgAMt4-nw
Лучший способ — это залипнуть в психоделический видос сгенеренный нейронкой. Вот, я вам принёс 40 минут такого залипалова: https://www.youtube.com/watch?v=HxRgAMt4-nw
YouTube
AI Dream 70 - The Most Amazing AI Galaxy Nebula
Hi guys,
For today's video I prepared another long AI generated Galaxy Nebula Trip!
I guess this topic never gets old, and OMG does this animation have some
impressive frames in them! The thumbnail looks amazing, right? lol
The animation took a while to…
For today's video I prepared another long AI generated Galaxy Nebula Trip!
I guess this topic never gets old, and OMG does this animation have some
impressive frames in them! The thumbnail looks amazing, right? lol
The animation took a while to…
Forwarded from Мишин Лернинг
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 WoW! DALL-E 2 для генерации видео! MAKE-A-VIDEO от MetaAI
📄 tl;dr
Ресерчеры из MetaAI обучили диффузионную нейросеть (типа DALL-E 2, Imagen, Стебель) MAKE-A-VIDEO, способную генерировать короткие видео-ролики по текстовому описанию!
А самое крутое то, что для этого им не потребовался датасет, содержащий пары видео - текст!
🚬 Что же за заверь MAKE-A-VIDEO?
Начнем с того, что название MAKE-A-VIDEO, отсылает нас к Make-A-Scene от тех же MetaAI — DALL-E поколения, которая имела кондишн не только в тексте, но и в семантической маске. Название имхо не очень удачное, так как тут ничего подобного нет. НО это DALL-E-like 2-го поколения и, видно, они просто решили двигать свой бренд MAKE-A- ... Ок, их дело.
Основной фишкой этой работы является развитие мысли: "Картинка это видео с одним кадром". Но как это реализовано? И главное, как можно сделать Text-To-Video без Text-To-Video данных?!
Подход напоминает DALL-E 2 —разделяй и властвуй декомпозируй и генерь,с его CLIP_text_emb -> CLIP_image_emb Prior!
Генрация видео Y может быть представлена как композиция Модулей:
🗒 Y = SR(th) ◦ SR(tl) ◦ ↑F ◦ Dt ◦ P ◦ (X_t, C(X_i))
Идея очень простая и изящная давайте прост разберем ее элементы:
0. X_i — картинка, X_t — текст. {X_i, X_t} — пара картинка-текст.
1. C(X_i) — CLIP embedding изображения X_i. N-мерный вектор, содержащий в себе необходимые фичи для описания картинки.
2. P — Prior, диффузионная нейронная сеть, отображающая X_t текстовые CLIP embedding'и в CLIP image embedding'и
Теперь понятно, что имея текст, можно получить | P (X_t) —> C(X_i) | варианты визуальных эмбеддингов возможных изображений.
3. Дальше вступает модуль Dt, который готовит 16 RGB фреймов по 64 × 64 на основе CLIP эмбеддинга первого кадра!
И на этот этапе становится понятно, что не нужны пары текст-видео!
4. Модуль ↑F делает интерполяции между кадрами и SR(th) ◦ SR(tl) делают пространственно-временной апскейл из 64х в 256 и 768
👾 Сайт Проект (тыкать обязательно!)
📄 Paper
🤖 м и ш и н л е р н и н г
Ресерчеры из MetaAI обучили диффузионную нейросеть (типа DALL-E 2, Imagen, Стебель) MAKE-A-VIDEO, способную генерировать короткие видео-ролики по текстовому описанию!
А самое крутое то, что для этого им не потребовался датасет, содержащий пары видео - текст!
Начнем с того, что название MAKE-A-VIDEO, отсылает нас к Make-A-Scene от тех же MetaAI — DALL-E поколения, которая имела кондишн не только в тексте, но и в семантической маске. Название имхо не очень удачное, так как тут ничего подобного нет. НО это DALL-E-like 2-го поколения и, видно, они просто решили двигать свой бренд MAKE-A- ... Ок, их дело.
Основной фишкой этой работы является развитие мысли: "Картинка это видео с одним кадром". Но как это реализовано? И главное, как можно сделать Text-To-Video без Text-To-Video данных?!
Подход напоминает DALL-E 2 —
Генрация видео Y может быть представлена как композиция Модулей:
Идея очень простая и изящная давайте прост разберем ее элементы:
0. X_i — картинка, X_t — текст. {X_i, X_t} — пара картинка-текст.
1. C(X_i) — CLIP embedding изображения X_i. N-мерный вектор, содержащий в себе необходимые фичи для описания картинки.
2. P — Prior, диффузионная нейронная сеть, отображающая X_t текстовые CLIP embedding'и в CLIP image embedding'и
Теперь понятно, что имея текст, можно получить | P (X_t) —> C(X_i) | варианты визуальных эмбеддингов возможных изображений.
3. Дальше вступает модуль Dt, который готовит 16 RGB фреймов по 64 × 64 на основе CLIP эмбеддинга первого кадра!
И на этот этапе становится понятно, что не нужны пары текст-видео!
4. Модуль ↑F делает интерполяции между кадрами и SR(th) ◦ SR(tl) делают пространственно-временной апскейл из 64х в 256 и 768
👾 Сайт Проект (тыкать обязательно!)
📄 Paper
🤖 м и ш и н л е р н и н г
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Мишин Лернинг
This media is not supported in your browser
VIEW IN TELEGRAM
🦚 DreamFusion: Text-to-3D using 2D Diffusion от ?Google
Не успели мы насладиться Text2Video от MetaAI как выходит Text-To-3D диффузия.. Что за день..
🚀 Как работает? Идея супер изящная!
Это градиентный метод, основанный на Loss-функции, такой как DeepDream. По факту происходит оптимизация рандомно инициализированной 3D модельки (a Neural Radiance Field, or NeRF) через градиенты 2D диффузионных генераций.
То есть по факту, проворачивая такой трюк, не нужно иметь 3D данных вообще!
Подробнее:
1) Рандомная фигура рендерится через NERF (плотность, освещение, цвет)
2) Этот изначальный бред (так как это начало) рендерится в 2D проекцию
3) Затем к картинке подмешивают шум, и все это подается на!!! внимание!! ИМАГЕН
4) После чего Имаген предсказывает необходимый денойз
5) Затем из пересказанного денойза вычитается подмешанный шум. и ВУАЛЯ! Дальше все дифференцируемо! Можно пускать градиенты обратно на 3D-модель
А то что у ребят был доступ к IMAGEN мне на 99.9999999% кажется, что это Google. Ну, а так, чем Тьюринг не шутит..
👁 gallery
📄 paper
📇 project
🤖 м и ш и н л е р н и н г
Не успели мы насладиться Text2Video от MetaAI как выходит Text-To-3D диффузия.. Что за день..
🚀 Как работает? Идея супер изящная!
Это градиентный метод, основанный на Loss-функции, такой как DeepDream. По факту происходит оптимизация рандомно инициализированной 3D модельки (a Neural Radiance Field, or NeRF) через градиенты 2D диффузионных генераций.
То есть по факту, проворачивая такой трюк, не нужно иметь 3D данных вообще!
Подробнее:
1) Рандомная фигура рендерится через NERF (плотность, освещение, цвет)
2) Этот изначальный бред (так как это начало) рендерится в 2D проекцию
3) Затем к картинке подмешивают шум, и все это подается на!!! внимание!! ИМАГЕН
4) После чего Имаген предсказывает необходимый денойз
5) Затем из пересказанного денойза вычитается подмешанный шум. и ВУАЛЯ! Дальше все дифференцируемо! Можно пускать градиенты обратно на 3D-модель
А то что у ребят был доступ к IMAGEN мне на 99.9999999% кажется, что это Google. Ну, а так, чем Тьюринг не шутит..
👁 gallery
📄 paper
📇 project
🤖 м и ш и н л е р н и н г
Forwarded from Мишин Лернинг
☠️ Colab — Все!
Все мы любили колаб. Но увы, ничто не вечно под луной. И теперь можно купить или 100 или 500 compute units, что в переводе на бытовой означает, что колаб сдулся.
🪦 Царство небесное, вечн Йисгадал вэйискадаш шмэй рабо..
🤖 м и ш и н л е р н и н г
Все мы любили колаб. Но увы, ничто не вечно под луной. И теперь можно купить или 100 или 500 compute units, что в переводе на бытовой означает, что колаб сдулся.
🤖 м и ш и н л е р н и н г
Forwarded from эйай ньюз
Вот вам блог-постик c объяснением Variational Lower Bound или Evidence Lower Bound (ELBO). Никогда не поздно поднимать базу #fundamentals, да и на
ML собесах пригодится.
❱❱ Ссылка
@ai_newz
ML собесах пригодится.
❱❱ Ссылка
@ai_newz
Forwarded from GitHub Community
DeepFaceDrawing – нейросеть, которая позволяет создавать реалистичные изображения лиц из набросков от руки
Метод отрисовки по существу использует входные эскизы в качестве «мягких» ограничений и, таким образом, способен создавать высококачественные изображения лиц даже из грубых и/или неполных эскизов
Данный инструмент прост в использовании даже для тех кто не рисует, сохраняя при этом тонкое управление деталями формы
⤷ Демо
⤷ Ссылка на проект
GitHub | #Python #Interesting
Метод отрисовки по существу использует входные эскизы в качестве «мягких» ограничений и, таким образом, способен создавать высококачественные изображения лиц даже из грубых и/или неполных эскизов
Данный инструмент прост в использовании даже для тех кто не рисует, сохраняя при этом тонкое управление деталями формы
⤷ Демо
⤷ Ссылка на проект
GitHub | #Python #Interesting
Forwarded from Open Source
FADA
Этот инструмент предназначенный для надежного обнаружения лиц не настоящих людей, а сгенерированных ИИ, с сайта https://thispersondoesnotexist.com/
https://github.com/MathisHammel/FADA
Этот инструмент предназначенный для надежного обнаружения лиц не настоящих людей, а сгенерированных ИИ, с сайта https://thispersondoesnotexist.com/
https://github.com/MathisHammel/FADA
Forwarded from [PYTHON:TODAY]
🔥 Полезные библиотеки Python
DALL·E Mini - интересный проект в основе которого лежит модель искусственного интеллекта, которая генерирует изображения по любому вашему запросу.
🕸 Попробовать в режиме реального времени
⚙️ GitHub/Инструкция
#ai #github #soft #python
DALL·E Mini - интересный проект в основе которого лежит модель искусственного интеллекта, которая генерирует изображения по любому вашему запросу.
🕸 Попробовать в режиме реального времени
⚙️ GitHub/Инструкция
#ai #github #soft #python
Forwarded from Мишин Лернинг
❤️🔥 AudioGen: нейросеть для генерации аудио по текстовому описанию
Очень много работы по визуальным диффузам, так что буду краток. Мета сделал то, что все мы ждали!
Как отметил Александр Шульгин,альфа-метилированные триптамины AudioGEN можно рассматривать как триптаминовые гомологи амфетамина аудиальный гомолог визуального DALL-E 1. И действительно, Александр Шульгин тут очень точно подметил!
Дело тут именно в том, что АудиоГена не гомологичен Имагену. Работа ведется не в пространстве пикселей — звуковой волны, и не в пространстве интегрального преобразования (фурье, вейвлет), а в VAE, в данном случае RVQ*
1) Сначала аудио конвертируется при помощи VAE в латент.
2) Затем трансформер авторегрессионно предсказывает дискретные токены RVQ, через кроссаттеншен с текстового энкодинга, которые потом превращаются обратно в звук при помощи RVQ-декодера.
Результаты — WOW, писать можно долго, но это надо слушать.
📯 Примеры слушать обязательно: тут
📰 Пейпер Аудиогены
💻 код / будет тут?
🤖 м и ш и н л е р н и н г
Очень много работы по визуальным диффузам, так что буду краток. Мета сделал то, что все мы ждали!
Как отметил Александр Шульгин,
Дело тут именно в том, что АудиоГена не гомологичен Имагену. Работа ведется не в пространстве пикселей — звуковой волны, и не в пространстве интегрального преобразования (фурье, вейвлет), а в VAE, в данном случае RVQ*
1) Сначала аудио конвертируется при помощи VAE в латент.
2) Затем трансформер авторегрессионно предсказывает дискретные токены RVQ, через кроссаттеншен с текстового энкодинга, которые потом превращаются обратно в звук при помощи RVQ-декодера.
Результаты — WOW, писать можно долго, но это надо слушать.
📯 Примеры слушать обязательно: тут
📰 Пейпер Аудиогены
💻 код / будет тут?
🤖 м и ш и н л е р н и н г