Forwarded from GitHub Community
CodeFormer – нейросетевая модель для восстановления размытых, поврежденных, не качественных фотографий лиц людей
⤷ Ссылка на проект
GitHub | #Interesting #AI #Useful #Photo
⤷ Ссылка на проект
GitHub | #Interesting #AI #Useful #Photo
Forwarded from Python - Советы, библиотеки, гайды
Делаем искуственный интеллект, который будет играть в Counter Strike: Global Offensive.
На Python + PyTorch (YOLOv8) :3
https://youtu.be/XOxNHqS-1Pc
На Python + PyTorch (YOLOv8) :3
https://youtu.be/XOxNHqS-1Pc
YouTube
Я сделал ИИ для Counter Strike: Global Offensive :D | Часть 4
Делаем искуственный интеллект, который будет играть в Counter Strike: Global Offensive.
На Python + PyTorch (YOLOv8) :3
🔥Научись создавать нейросети: https://go.skillfactory.ru/9a9ooA
Скидка на обучение -45% по промокоду ХАУДИ
🆇 Скачать Нейросеть можно…
На Python + PyTorch (YOLOv8) :3
🔥Научись создавать нейросети: https://go.skillfactory.ru/9a9ooA
Скидка на обучение -45% по промокоду ХАУДИ
🆇 Скачать Нейросеть можно…
Forwarded from Habr For Dev
Forwarded from эйай ньюз
🔥 Lion: EvoLved Sign Momentum - новый оптимайзер от Гугла
Google нашел новый алгоритм оптимизации при помощи Symbolic Search (завтра объясню, что это такое). Новый оптимайзер тупо мониторит momentum, а размер финального апдейта весов считается как
Чем больше батч, тем лучше работает Lion. Еще он более устойчив к различным выборам гиперпараметров по сравнению с AdamW.
Уже попробовал на свои задачах, вроде работает!
❱❱ Код на PyTorch, JAX и TF
@ai_newz
Google нашел новый алгоритм оптимизации при помощи Symbolic Search (завтра объясню, что это такое). Новый оптимайзер тупо мониторит momentum, а размер финального апдейта весов считается как
sign(grad (1-β1) + β1 momentum). То есть апдейт для каждого элемента весов равен либо -1 * LR либо +1 * LR! train(weight, gradient, momentum, lr):
update = interp(gradient, momentum, β1)
update = sign(update)
momentum = interp(gradient, momentum, β2)
// Тут я пропустил weight decay для простоты
update = update * lr
return update, momentum
Просто волосы дыбом от тупости Lion, но он дает серьезные улучшения в скорости сходимости, да и в найденных локальных минимумах. Рвет и обычную классификацию и языковые модели и диффузионные.Чем больше батч, тем лучше работает Lion. Еще он более устойчив к различным выборам гиперпараметров по сравнению с AdamW.
Уже попробовал на свои задачах, вроде работает!
❱❱ Код на PyTorch, JAX и TF
@ai_newz
Forwarded from Библиотека программиста
Forwarded from "Cyber detective" & "Irina Daily Tech Tips" твиты на русском
Полезные Spaces (приложения для тестирования возможностей нейросетей) на HuggingFace.co
Редактирование изображений в соответствии с текстовым описанием
https://huggingface.co/spaces/timbrooks/instruct-pix2pix
Редактирование видео в соответствии с текстовым описанием
https://huggingface.co/spaces/fffiloni/Pix2Pix-Video
Качественное преобразование речи из YouTube видео в текст
https://huggingface.co/spaces/jeffistyping/Youtube-Whisperer
Сервис для создания аудиокниг из PDF-документов
https://huggingface.co/spaces/mkutarna/audiobook_gen
Генерация длинных и подробных промптов для создания изображений с помощью нейросетей на основе одного или нескольких слов
https://huggingface.co/spaces/daspartho/prompt-extend
Редактирование изображений в соответствии с текстовым описанием
https://huggingface.co/spaces/timbrooks/instruct-pix2pix
Редактирование видео в соответствии с текстовым описанием
https://huggingface.co/spaces/fffiloni/Pix2Pix-Video
Качественное преобразование речи из YouTube видео в текст
https://huggingface.co/spaces/jeffistyping/Youtube-Whisperer
Сервис для создания аудиокниг из PDF-документов
https://huggingface.co/spaces/mkutarna/audiobook_gen
Генерация длинных и подробных промптов для создания изображений с помощью нейросетей на основе одного или нескольких слов
https://huggingface.co/spaces/daspartho/prompt-extend
huggingface.co
InstructPix2Pix - a Hugging Face Space by timbrooks
Upload any picture and write a short instruction describing how you want it changed—like “make it look like a painting” or “add a beach background.” The app processes your request and returns a new...
Forwarded from Вулкан Динамитович
Распознаем речь AI
На данный момент мой способ распознания – это ознакомление с AI голосом, сопоставление его с настоящим.
Все возвращается к тому, что «компьютер не умеет рандомить». В разговорных узорах человека всегда имеются вводные конструкции/слова, междометия и паузы. Мимикрировать данный элемент AI не может.
Лучшим примером такого сопоставления будет AI голос Байдена против его живой речи. Нейросетка «омолаживает» его путем того, что минует многочисленные паузы и междометия, которые применяются им в силу возраста.
Бонусом небольшой список сайтов по генерированию. Ресурсы не проверял, простостырил позаимствовал из статьи:
- murf.ai
- speechify.com
- speechelo-offer.com
- synthesys.io
- bigspeak.ai
- Play.ht
- Spik.ai
- resemble.ai
- Lovo.ai
Если найдете онлайн обсуждение по идентификации AI голосов, буду рад почитать.
#кибермысли
На данный момент мой способ распознания – это ознакомление с AI голосом, сопоставление его с настоящим.
Все возвращается к тому, что «компьютер не умеет рандомить». В разговорных узорах человека всегда имеются вводные конструкции/слова, междометия и паузы. Мимикрировать данный элемент AI не может.
Лучшим примером такого сопоставления будет AI голос Байдена против его живой речи. Нейросетка «омолаживает» его путем того, что минует многочисленные паузы и междометия, которые применяются им в силу возраста.
Бонусом небольшой список сайтов по генерированию. Ресурсы не проверял, просто
- murf.ai
- speechify.com
- speechelo-offer.com
- synthesys.io
- bigspeak.ai
- Play.ht
- Spik.ai
- resemble.ai
- Lovo.ai
Если найдете онлайн обсуждение по идентификации AI голосов, буду рад почитать.
#кибермысли
Forwarded from Python - Советы, библиотеки, гайды
pytesseract - одна из лучших библиотек для распознавания текста в Python.
Является обёрткой над Google’s Tesseract-OCR Engine.
Я её лично применял, когда делал бота-авторыбалку для Terraria.
Из особенностей:
— Легко использовать
— Работает с разными языками
— Можно распознавать кастомные шрифты
— Нативная поддержка OpenCV
— Куча полезных параметров и настроек
Ставится командой ⚙️
Документация и примеры кода здесь.
Является обёрткой над Google’s Tesseract-OCR Engine.
Я её лично применял, когда делал бота-авторыбалку для Terraria.
Из особенностей:
— Легко использовать
— Работает с разными языками
— Можно распознавать кастомные шрифты
— Нативная поддержка OpenCV
— Куча полезных параметров и настроек
Ставится командой ⚙️
pip install pytesseractДокументация и примеры кода здесь.
Forwarded from Не баг, а фича
Получаем выжимку ролика на YouTube с помощью ChatGPT
На YouTube загружают контент, поглощать который легко. Но смотреть видео – долго. Даже смотреть ускоренное видео – дольше, чем прочитать короткий тезисный текст.
Eightify – расширение, которое создает саммари длинных видео с YouTube и выводит их текстом с отмеченными тайм-кодами. Превращает любое длинное видео на YouTube в резюме с 8 ключевыми идеями. Экономит ваше время, чтобы вы быстрее добирались до самой сути.
Инструмент идеально подходит для бизнес-образования, подкастов, интервью, новостей и лекций. Eightify работает на алгоритме обработки естественного языка GPT-3 от OpenAI и еще нескольких готовых моделях.
Чтобы получить саммари, откройте нужный ролик на YouTube, нажмите кнопку «Summarize» и через 10-20 секунд получите основные тезисы видео. Длительность анализируемого ролика ограничена тремя часами.
#расширение #chrome
На YouTube загружают контент, поглощать который легко. Но смотреть видео – долго. Даже смотреть ускоренное видео – дольше, чем прочитать короткий тезисный текст.
Eightify – расширение, которое создает саммари длинных видео с YouTube и выводит их текстом с отмеченными тайм-кодами. Превращает любое длинное видео на YouTube в резюме с 8 ключевыми идеями. Экономит ваше время, чтобы вы быстрее добирались до самой сути.
Инструмент идеально подходит для бизнес-образования, подкастов, интервью, новостей и лекций. Eightify работает на алгоритме обработки естественного языка GPT-3 от OpenAI и еще нескольких готовых моделях.
Чтобы получить саммари, откройте нужный ролик на YouTube, нажмите кнопку «Summarize» и через 10-20 секунд получите основные тезисы видео. Длительность анализируемого ролика ограничена тремя часами.
#расширение #chrome
Forwarded from эйай ньюз
Как я уже упоминал, OpenAI пытается позиционировать себя как продавец API к своим жирным SOTA моделям, ведь продукта то у них никакого нет.
Так вот сегодня они наконец сделали публичный API к своим ChatGPT и Whisper (распознавалка речи) .
@ai_newz
Так вот сегодня они наконец сделали публичный API к своим ChatGPT и Whisper (распознавалка речи) .
@ai_newz
Telegram
эйай ньюз
🔥OpenAI выпустили новую улучшенную Text Embedding Model: text-embedding-ada-002
1. Во первых, эта модель объединяет в себе возможности 5 старых моделей. Умеет искать текст, код, вычислять похожесть предложений и классифицировать текст:
✔️ text-similarity…
1. Во первых, эта модель объединяет в себе возможности 5 старых моделей. Умеет искать текст, код, вычислять похожесть предложений и классифицировать текст:
✔️ text-similarity…