This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Qwen-Image за 6 шагов: Viggle ускорили генерацию и редактирование в 5 раз
Viggle выложили Qwen-Image-2.1-viggle-turbo v0.2, дистиллированную версию Qwen-Image-2.1. Вместо 40 шагов модели хватает 6 проходов, и end-to-end это примерно в 5 раз быстрее. Умеет text-to-image и редактирование по инструкции с 1–3 референсами, причём без CFG.
Дистиллировали через DMD2 с distribution matching в стиле SenseFlow. Распространяется как LoRA поверх базовой модели: rank 256 на 1,3 ГБ или rank 128 на 680 МБ.
По качеству на 96 пользовательских запросах разнообразие держится на 0,98 от базы, а композиция ни разу не разошлась с оригиналом. Пик памяти в ComfyUI около 26 ГБ VRAM на 1248×832.
https://huggingface.co/Viggle/Qwen-Image-2.1-viggle-turbo
Viggle выложили Qwen-Image-2.1-viggle-turbo v0.2, дистиллированную версию Qwen-Image-2.1. Вместо 40 шагов модели хватает 6 проходов, и end-to-end это примерно в 5 раз быстрее. Умеет text-to-image и редактирование по инструкции с 1–3 референсами, причём без CFG.
Дистиллировали через DMD2 с distribution matching в стиле SenseFlow. Распространяется как LoRA поверх базовой модели: rank 256 на 1,3 ГБ или rank 128 на 680 МБ.
По качеству на 96 пользовательских запросах разнообразие держится на 0,98 от базы, а композиция ни разу не разошлась с оригиналом. Пик памяти в ComfyUI около 26 ГБ VRAM на 1248×832.
https://huggingface.co/Viggle/Qwen-Image-2.1-viggle-turbo
👍4❤3🔥3