Forwarded from Yehor Smoliakov
Що ж, підготовка до інференсу великих датасетів готова.
Далі сам інференс та вирівнювання даних для створення якісного speech to text датасету.
Якщо бажаєте зробити донат на хмарні GPU, ось банка:
🔗Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳Номер картки банки
5375 4112 0249 3776
—
Результати будуть опубліковані під відкритими ліцензіями 😎
Далі сам інференс та вирівнювання даних для створення якісного speech to text датасету.
Якщо бажаєте зробити донат на хмарні GPU, ось банка:
🔗Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳Номер картки банки
5375 4112 0249 3776
—
Результати будуть опубліковані під відкритими ліцензіями 😎
send.monobank.ua
Безпечний переказ коштів
Надсилайте безкоштовно та безпечно кошти
👍2
Hugging Face makes not only parquet files to datasets, but DuckDB too
So, we can use them to analyze using SQL
#ai
So, we can use them to analyze using SQL
#ai
Forwarded from Yehor Smoliakov
👋🏻 Вітаю, шановне товариство!
Багато людей знає, що я займаюся в ШІ направленням розпізнавання та синтезу мови.
Зараз я організував ініціативу Speech-UK (підписуйтесь на Hugging Face) в яку вже опублікував дві колекції з датасетами по українській та кримськотатарській мовах (їх можна використати для синтезу). Ми раніше їх створювали у товариствах.
Зараз на столі задача по створенню великого якісного датасету для розпізнавання української мови.
Останній тиждень займався підготовкою всього необхідного для цієї задачі.
Зараз хочу поширити банку для збору донатів щоб я зміг використати хмарні відеокарти для збору даних та створення моделей розпізнавання на цих даних.
Якщо бажаєте зробити донат:
🔗 Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳 Номер картки банки
5375 4112 0249 3776
Результати будуть опубліковані під відкритими ліцензіями (особисте або комерційне використання).
Також, прошу поділитися цим повідомленням.
Якщо залишились питання, мій контакт — https://t.me/smlkw
Давайте робити відкриті технології разом 🤝
Багато людей знає, що я займаюся в ШІ направленням розпізнавання та синтезу мови.
Зараз я організував ініціативу Speech-UK (підписуйтесь на Hugging Face) в яку вже опублікував дві колекції з датасетами по українській та кримськотатарській мовах (їх можна використати для синтезу). Ми раніше їх створювали у товариствах.
Зараз на столі задача по створенню великого якісного датасету для розпізнавання української мови.
Останній тиждень займався підготовкою всього необхідного для цієї задачі.
Зараз хочу поширити банку для збору донатів щоб я зміг використати хмарні відеокарти для збору даних та створення моделей розпізнавання на цих даних.
Якщо бажаєте зробити донат:
🔗 Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳 Номер картки банки
5375 4112 0249 3776
Результати будуть опубліковані під відкритими ліцензіями (особисте або комерційне використання).
Також, прошу поділитися цим повідомленням.
Якщо залишились питання, мій контакт — https://t.me/smlkw
Давайте робити відкриті технології разом 🤝
send.monobank.ua
Безпечний переказ коштів
Надсилайте безкоштовно та безпечно кошти
👍1
Published different RAD-TTS models I've made years ago for Ukrainian to Hugging Face:
https://huggingface.co/Yehor/radtts-uk
https://huggingface.co/Yehor/radtts-uk
huggingface.co
Yehor/radtts-uk · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Media is too big
VIEW IN TELEGRAM
Now my space for Ukrainian Text-to-Speech uses GPU, so the generation is fast.
Use here: https://huggingface.co/spaces/Yehor/radtts-uk-demo
#ai #speech #tts
Use here: https://huggingface.co/spaces/Yehor/radtts-uk-demo
#ai #speech #tts
doing something
Now my space for Ukrainian Text-to-Speech uses GPU, so the generation is fast. Use here: https://huggingface.co/spaces/Yehor/radtts-uk-demo #ai #speech #tts
huggingface.co
RAD-TTS++ Ukrainian (BigVGAN v2) - a Hugging Face Space by Yehor
Enter text in Ukrainian and select a voice to synthesize natural-sounding speech using advanced models. The app converts your text into spoken words in three different Ukrainian voices.
Forwarded from Serhiy Stetskovych
Коротше я протестував той елевенлабс ASR. Він дуже дуже гарно розпізнає, якщо брати якісну аудіокнигу то там 100% все правильно, але є одна велика проблема. Він не розпізніє літеру Ґ і замість неї постійно пише Г. Також там тейм стемпи тоже дуже добрі але не такі ідеальні і деколи не попападають. На музиці він працює також добре, але слова які не є літературні може не вгадати і таймінги гірші на музиці.
Now I am working on refactoring of RAD-TTS++ inference code to latest torch here:
https://huggingface.co/spaces/Yehor/radtts-uk-vocos-demo
Code is about 2 years old and I wanted to test how it works on MPS device (Apple M cores).
Inference works on MPS, but not all ops are supported:
By the way, RAD-TTS++ and Vocos are super fast on CPU in MacOS.
#ai #torch #ml
https://huggingface.co/spaces/Yehor/radtts-uk-vocos-demo
Code is about 2 years old and I wanted to test how it works on MPS device (Apple M cores).
Inference works on MPS, but not all ops are supported:
.../torch/nn/functional.py:5561: UserWarning: The operator 'aten::col2im' is not currently supported on the MPS backend and will fall back to run on the CPU. This may have performance implications. (Triggered internally at /Users/runner/work/pytorch/pytorch/pytorch/aten/src/ATen/mps/MPSFallback.mm:14.)
By the way, RAD-TTS++ and Vocos are super fast on CPU in MacOS.
#ai #torch #ml
huggingface.co
RAD-TTS++ Ukrainian (Vocos) - a Hugging Face Space by Yehor
Paste Ukrainian text and select a voice to hear the synthesized speech. Get high-quality audio output with customizable settings for voice, speed, and more.