Ukrainian voices for Text-to-Speech now in separated datasets:
https://huggingface.co/collections/speech-uk/ukrainian-text-to-speech-67bd059d61b2598f3a2a7969
#ai #speech
https://huggingface.co/collections/speech-uk/ukrainian-text-to-speech-67bd059d61b2598f3a2a7969
#ai #speech
huggingface.co
Ukrainian Text-to-Speech datasets - a speech-uk Collection
Five voices: Mykyta, Oleksa, Lada, Kateryna or Tetiana
🔥2
Added a section with phonemizers to https://github.com/egorsmkv/speech-recognition-uk
https://github.com/egorsmkv/speech-recognition-uk/issues/57
#ai #speech
https://github.com/egorsmkv/speech-recognition-uk/issues/57
#ai #speech
GitHub
GitHub - egorsmkv/speech-recognition-uk: 🇺🇦 Speech Recognition & Synthesis for Ukrainian
🇺🇦 Speech Recognition & Synthesis for Ukrainian. Contribute to egorsmkv/speech-recognition-uk development by creating an account on GitHub.
Made a space to simplify my ASR research:
https://huggingface.co/spaces/Yehor/evaluate-asr-outputs
#ai #speech
https://huggingface.co/spaces/Yehor/evaluate-asr-outputs
#ai #speech
👍1🔥1
https://huggingface.co/spaces/fastrtc/object-detection
https://huggingface.co/spaces/fastrtc/object-detection/blob/main/app.py
#cv #ai
https://huggingface.co/spaces/fastrtc/object-detection/blob/main/app.py
#cv #ai
huggingface.co
Object Detection - a Hugging Face Space by fastrtc
This app detects objects in real-time video streams. Users provide a live video feed, and the app highlights detected objects with confidence scores.
doing something
Batch inference using vllm #ai #vllm #speech
Added batch mode calculation to https://huggingface.co/spaces/Yehor/evaluate-asr-outputs
Btw, batched vllm inference gives better RTF for Whisper
#asr #ai #speech
Btw, batched vllm inference gives better RTF for Whisper
#asr #ai #speech
vllm + A100 (40 GB in Google Colab) + https://huggingface.co/Yehor/whisper-large-v3-turbo-quantized-uk using batch_size=128
#ai #speech #whisper
#ai #speech #whisper
🔥2
Forwarded from Yehor Smoliakov
Що ж, підготовка до інференсу великих датасетів готова.
Далі сам інференс та вирівнювання даних для створення якісного speech to text датасету.
Якщо бажаєте зробити донат на хмарні GPU, ось банка:
🔗Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳Номер картки банки
5375 4112 0249 3776
—
Результати будуть опубліковані під відкритими ліцензіями 😎
Далі сам інференс та вирівнювання даних для створення якісного speech to text датасету.
Якщо бажаєте зробити донат на хмарні GPU, ось банка:
🔗Посилання на банку
https://send.monobank.ua/jar/3Saxixsdua
💳Номер картки банки
5375 4112 0249 3776
—
Результати будуть опубліковані під відкритими ліцензіями 😎
send.monobank.ua
Безпечний переказ коштів
Надсилайте безкоштовно та безпечно кошти
👍2