vllm + A100 (40 GB in Google Colab) + https://huggingface.co/Yehor/whisper-large-v3-turbo-quantized-uk using batch_size=128
#ai #speech #whisper
#ai #speech #whisper
🔥2
Forwarded from Yehor Smoliakov
Що ж, підготовка до інференсу великих датасетів готова.
Далі сам інференс та вирівнювання даних для створення якісного speech to text датасету.
Якщо бажаєте зробити донат на хмарні GPU, ось банка:
🔗Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳Номер картки банки
5375 4112 0249 3776
—
Результати будуть опубліковані під відкритими ліцензіями 😎
Далі сам інференс та вирівнювання даних для створення якісного speech to text датасету.
Якщо бажаєте зробити донат на хмарні GPU, ось банка:
🔗Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳Номер картки банки
5375 4112 0249 3776
—
Результати будуть опубліковані під відкритими ліцензіями 😎
send.monobank.ua
Безпечний переказ коштів
Надсилайте безкоштовно та безпечно кошти
👍2
Hugging Face makes not only parquet files to datasets, but DuckDB too
So, we can use them to analyze using SQL
#ai
So, we can use them to analyze using SQL
#ai
Forwarded from Yehor Smoliakov
👋🏻 Вітаю, шановне товариство!
Багато людей знає, що я займаюся в ШІ направленням розпізнавання та синтезу мови.
Зараз я організував ініціативу Speech-UK (підписуйтесь на Hugging Face) в яку вже опублікував дві колекції з датасетами по українській та кримськотатарській мовах (їх можна використати для синтезу). Ми раніше їх створювали у товариствах.
Зараз на столі задача по створенню великого якісного датасету для розпізнавання української мови.
Останній тиждень займався підготовкою всього необхідного для цієї задачі.
Зараз хочу поширити банку для збору донатів щоб я зміг використати хмарні відеокарти для збору даних та створення моделей розпізнавання на цих даних.
Якщо бажаєте зробити донат:
🔗 Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳 Номер картки банки
5375 4112 0249 3776
Результати будуть опубліковані під відкритими ліцензіями (особисте або комерційне використання).
Також, прошу поділитися цим повідомленням.
Якщо залишились питання, мій контакт — https://t.me/smlkw
Давайте робити відкриті технології разом 🤝
Багато людей знає, що я займаюся в ШІ направленням розпізнавання та синтезу мови.
Зараз я організував ініціативу Speech-UK (підписуйтесь на Hugging Face) в яку вже опублікував дві колекції з датасетами по українській та кримськотатарській мовах (їх можна використати для синтезу). Ми раніше їх створювали у товариствах.
Зараз на столі задача по створенню великого якісного датасету для розпізнавання української мови.
Останній тиждень займався підготовкою всього необхідного для цієї задачі.
Зараз хочу поширити банку для збору донатів щоб я зміг використати хмарні відеокарти для збору даних та створення моделей розпізнавання на цих даних.
Якщо бажаєте зробити донат:
🔗 Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳 Номер картки банки
5375 4112 0249 3776
Результати будуть опубліковані під відкритими ліцензіями (особисте або комерційне використання).
Також, прошу поділитися цим повідомленням.
Якщо залишились питання, мій контакт — https://t.me/smlkw
Давайте робити відкриті технології разом 🤝
send.monobank.ua
Безпечний переказ коштів
Надсилайте безкоштовно та безпечно кошти
👍1
Published different RAD-TTS models I've made years ago for Ukrainian to Hugging Face:
https://huggingface.co/Yehor/radtts-uk
https://huggingface.co/Yehor/radtts-uk
huggingface.co
Yehor/radtts-uk · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Media is too big
VIEW IN TELEGRAM
Now my space for Ukrainian Text-to-Speech uses GPU, so the generation is fast.
Use here: https://huggingface.co/spaces/Yehor/radtts-uk-demo
#ai #speech #tts
Use here: https://huggingface.co/spaces/Yehor/radtts-uk-demo
#ai #speech #tts
doing something
Now my space for Ukrainian Text-to-Speech uses GPU, so the generation is fast. Use here: https://huggingface.co/spaces/Yehor/radtts-uk-demo #ai #speech #tts
huggingface.co
RAD-TTS++ Ukrainian (BigVGAN v2) - a Hugging Face Space by Yehor
Enter text in Ukrainian and select a voice to synthesize natural-sounding speech using advanced models. The app converts your text into spoken words in three different Ukrainian voices.