Qwen 3.8 27b - Первый тест
Смотреть: https://youtu.be/Qqpc934SdNw
Все промты в НАШЕМ ЧАТЕ
Всем быстрых токенов и приятного просмотра!
Смотреть: https://youtu.be/Qqpc934SdNw
Все промты в НАШЕМ ЧАТЕ
Всем быстрых токенов и приятного просмотра!
YouTube
Qwen 3.8 27B - первый тест на RTX 5090. Точно ли это король?
Батя локальных LLM - Qwen, вернулся с новой версией 3.8! Я сделал пару тестов на горячую. Приятного просмотра!
👍12
super-mario.html
42.3 KB
А ведь Qwen 3.8 27b хорош, чертяка!
Только посмотрите что он сделал мне за 45 минут в OpenCode, потратив 166 910 токенов, и это Q5_K_XL квант. Достойно.
Промт был такой:
И всё, я закинул ему задание и пошел смотреть новую серию Укрытия (2023).
Я прилепил html файл, чтобы вы сами попробовали.
Всем быстрых токенов. А я всё, выключаю.
Только посмотрите что он сделал мне за 45 минут в OpenCode, потратив 166 910 токенов, и это Q5_K_XL квант. Достойно.
Промт был такой:
Create a Super Mario clone in JavaScript as a single HTML page. Make the game engaging and the graphics as beautiful as possible.
И всё, я закинул ему задание и пошел смотреть новую серию Укрытия (2023).
Я прилепил html файл, чтобы вы сами попробовали.
Всем быстрых токенов. А я всё, выключаю.
🔥24👍8❤1😁1
Результат Qwen 3.8 27b в кванте BF16 от участника НАШЕГО ЧАТА. Это прям реально мощь!
Промт здесь.
Результат здесь, можете покрутить на своем ПК.
Присоединяйтесь к тестированию и кидайте свои результаты в раздел Тесты LLM.
Приятной генерации и быстрых токенов!
Промт здесь.
Результат здесь, можете покрутить на своем ПК.
Присоединяйтесь к тестированию и кидайте свои результаты в раздел Тесты LLM.
Приятной генерации и быстрых токенов!
🔥9👍2
Qwen 3.8 27B - это параноик из мира LLM
Я просматривал reasoning Qwen 3.8 27B и заметил, что она постоянно сомневается в себе.
Она приходит к решению, затем начинает его перепроверять, рассматривает другие варианты, возвращается назад и снова всё проверяет.
Похоже, именно поэтому относительно небольшая 27B-модель способна показывать настолько хорошие результаты.
На xhigh reasoning effort это особенно заметно. Иногда кажется, что модель уже закончила рассуждать и сейчас даст финальный ответ, но затем она снова начинает всё перепроверять.
Это делает её медленнее и заставляет расходовать намного больше thinking-токенов, но для сложных задач такой подход может быть преимуществом.
Взял из реддита, ибо мне зашел такой вариант описания поведения модели 🙂
А вы что думаете?
Я просматривал reasoning Qwen 3.8 27B и заметил, что она постоянно сомневается в себе.
Она приходит к решению, затем начинает его перепроверять, рассматривает другие варианты, возвращается назад и снова всё проверяет.
Похоже, именно поэтому относительно небольшая 27B-модель способна показывать настолько хорошие результаты.
На xhigh reasoning effort это особенно заметно. Иногда кажется, что модель уже закончила рассуждать и сейчас даст финальный ответ, но затем она снова начинает всё перепроверять.
Это делает её медленнее и заставляет расходовать намного больше thinking-токенов, но для сложных задач такой подход может быть преимуществом.
Взял из реддита, ибо мне зашел такой вариант описания поведения модели 🙂
А вы что думаете?
👍21❤6
Media is too big
VIEW IN TELEGRAM
Как Qwen 3.8 27b делал мне игру в OpenCode всю ночь!
Черт дернул меня на ночь глядя попробовать этот промт, думал за полчасика сделает. Ага. Запустил в Opencode в 23:00, утром проснулся, а он оборвался на пол пути своих рассуждений где-то в середине ночи. Пнул его чтобы продолжал, закончил в 13:00.
Запуская, я думал сейчас будет Forza Horizont новая часть, а получилось это. Управление не работает, сам ездит по заранее записанной траектории, и уже со старту дает боком.
Я не рискнул сказать ему чтобы он починил, потому что ждать еще сутки, пока он выдавит результат я не готов. Его длинные рассуждения уже раздражают. Это на уровне шуток про клода, когда пишешь ему "привет", а он в рассуждениях спалил весь 5 часовой лимит. Не думал что господин Квен перехватит эстефету.
У вас получилось решить проблему длинных рассуждений? Или вас это не напрягает?
Подписывайтесь на НАШ ЧАТ. А я всё, выключаю.
Черт дернул меня на ночь глядя попробовать этот промт, думал за полчасика сделает. Ага. Запустил в Opencode в 23:00, утром проснулся, а он оборвался на пол пути своих рассуждений где-то в середине ночи. Пнул его чтобы продолжал, закончил в 13:00.
Запуская, я думал сейчас будет Forza Horizont новая часть, а получилось это. Управление не работает, сам ездит по заранее записанной траектории, и уже со старту дает боком.
Я не рискнул сказать ему чтобы он починил, потому что ждать еще сутки, пока он выдавит результат я не готов. Его длинные рассуждения уже раздражают. Это на уровне шуток про клода, когда пишешь ему "привет", а он в рассуждениях спалил весь 5 часовой лимит. Не думал что господин Квен перехватит эстефету.
У вас получилось решить проблему длинных рассуждений? Или вас это не напрягает?
Подписывайтесь на НАШ ЧАТ. А я всё, выключаю.
😁18👍1
Как же я недооценивал NVFP4
Сегодня шарился по реддиту и наткнулся на пост, где кто-то выдавил из 5090 почти 200 т/с (там есть нюанс - Linux).
Я тоже попробовал Qwen 3.8 27b в формате NVFP4, вместо стандартных Q4/Q5/Q6, которые я обычно использовал, и был приятно удивлен.
Но так как у меня Windows, скорость генерации на 5090 при полном контексте (262к!) достигала 137 токенов в секунду. А качество модели на уровне Q5 (если что, это утверждает GPT, не я). К слову, на Q5_K_XL при 130к контекста у меня 80-90 токенов в секунду. Как бы чувствуется разница слегка.
В НАШЕМ ЧАТЕ в разделе Тесты LLM, я успел немного погонять модельку. Продолжу дальше тестировать, что за зверь этот ваш NVFP4.
А вы пробовали? Что думаете?
Приятной генерации и быстрых токенов! А я всё, выключаю.
Сегодня шарился по реддиту и наткнулся на пост, где кто-то выдавил из 5090 почти 200 т/с (там есть нюанс - Linux).
Я тоже попробовал Qwen 3.8 27b в формате NVFP4, вместо стандартных Q4/Q5/Q6, которые я обычно использовал, и был приятно удивлен.
Но так как у меня Windows, скорость генерации на 5090 при полном контексте (262к!) достигала 137 токенов в секунду. А качество модели на уровне Q5 (если что, это утверждает GPT, не я). К слову, на Q5_K_XL при 130к контекста у меня 80-90 токенов в секунду. Как бы чувствуется разница слегка.
В НАШЕМ ЧАТЕ в разделе Тесты LLM, я успел немного погонять модельку. Продолжу дальше тестировать, что за зверь этот ваш NVFP4.
А вы пробовали? Что думаете?
Приятной генерации и быстрых токенов! А я всё, выключаю.
🔥12❤1👍1
Qwen 3.8 27b Dynamic V3
Unsloth-овцы выпустили обновление для легендарного квена, где улучшили точность на 10% с помощью новой Dynamic V3. Что бы это не значило.
Забираем тут: https://huggingface.co/unsloth/Qwen3.8-27B-GGUF
Скачивайте, тестируйте и выкладывайте результаты в НАШ ЧАТ.
Всем быстрых токенов!
Unsloth-овцы выпустили обновление для легендарного квена, где улучшили точность на 10% с помощью новой Dynamic V3. Что бы это не значило.
Забираем тут: https://huggingface.co/unsloth/Qwen3.8-27B-GGUF
Скачивайте, тестируйте и выкладывайте результаты в НАШ ЧАТ.
Всем быстрых токенов!
huggingface.co
unsloth/Qwen3.8-27B-GGUF · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
🔥13❤6
Aurora-80K - Крошечная LLM на 80 000 параметров
Не знаю зачем она нужна, но прикольно. И что самое интересное: обучали ее около 6 часов на смартфоне Xiaomi 14T Pro, используя 4 ядра Cortex-X4.
https://huggingface.co/AuroraAI-Research/Aurora-80K
Ссылку прикрепляю, но можете не качать, просто знайте.
Всем тяжелых моделей с быстрыми токенами!
Не знаю зачем она нужна, но прикольно. И что самое интересное: обучали ее около 6 часов на смартфоне Xiaomi 14T Pro, используя 4 ядра Cortex-X4.
https://huggingface.co/AuroraAI-Research/Aurora-80K
Ссылку прикрепляю, но можете не качать, просто знайте.
Всем тяжелых моделей с быстрыми токенами!
huggingface.co
AuroraAI-Research/Aurora-80K · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
👍7🔥3😁2🤔1
Qwen, спасибо за насыщенный август!
Надеюсь сентябрь будет таким же, октябрь и … подписывайтесь на НАШ ЧАТ!
Всем быстрых токенов!
Надеюсь сентябрь будет таким же, октябрь и … подписывайтесь на НАШ ЧАТ!
Всем быстрых токенов!
👍9❤5😁4🤗1
This media is not supported in your browser
VIEW IN TELEGRAM
NKD Face Rig - управление лицом в реальном времени для ComfyUI
На самом деле тут много всего интересного. Можно вручную управлять бровями, веками, направлением взгляда, ртом, челюстью и положением головы, перетаскивая контролы прямо на лице. Результат перерендеривается при изменениях.
Я еще не тестил, но схоронил и вам советую. Выкладывайте свои результаты в НАШ ЧАТ в раздел ComfyUI
Приятной генерации!
На самом деле тут много всего интересного. Можно вручную управлять бровями, веками, направлением взгляда, ртом, челюстью и положением головы, перетаскивая контролы прямо на лице. Результат перерендеривается при изменениях.
Я еще не тестил, но схоронил и вам советую. Выкладывайте свои результаты в НАШ ЧАТ в раздел ComfyUI
Приятной генерации!
👍10
Несколько месяцев назад я случайно заметил этот лаунчер для llama.cpp и показал его в своем видео. И понеслось!
Видео для освежения памяти: https://youtu.be/vcPGTI_VA4k
Это была простенькая, но удобная программка, которая упрощает запуск ЛЛМок.
С того момента это уже не просто программка, а блин, уже целый комбайн, MCP серверами,блекджеком, мощными бенчмарками, доступом к ComfyUI, и десятками настраиваемыми параметрами из удобного интерфейса.
Как говорил автор, мое видео подтолкнуло к дальнейшему развитию проекта. И это заметно - обновления появляются чуть ли не каждый день. Я рад, что это стечение обстоятельств, дало толчок полезному продукту, которым пользуется все больше ЛЛМ энтузиастов. И теперь ссылка на мой канал красуется в репозитории лаунчера.💪
Скачивать тут: https://github.com/pytraveler/LlamaServerLauncherAvalonia
Подписывайтесь на НАШ ЧАТ
Приятной генерации и быстрых токенов!
Видео для освежения памяти: https://youtu.be/vcPGTI_VA4k
Это была простенькая, но удобная программка, которая упрощает запуск ЛЛМок.
С того момента это уже не просто программка, а блин, уже целый комбайн, MCP серверами,
Как говорил автор, мое видео подтолкнуло к дальнейшему развитию проекта. И это заметно - обновления появляются чуть ли не каждый день. Я рад, что это стечение обстоятельств, дало толчок полезному продукту, которым пользуется все больше ЛЛМ энтузиастов. И теперь ссылка на мой канал красуется в репозитории лаунчера.💪
Скачивать тут: https://github.com/pytraveler/LlamaServerLauncherAvalonia
Подписывайтесь на НАШ ЧАТ
Приятной генерации и быстрых токенов!
YouTube
Удобный запуск локальных LLM в llama.cpp (Llama Launcher)
В этом видео я протестировал удобный запуск локальных LLM через Llama Launcher.
https://github.com/pytraveler/LlamaServerLauncherAvalonia
https://github.com/pytraveler/LlamaServerLauncherAvalonia
👍22❤1
Август еще не закончился, а Qwen завтра нас порадует новинкой - Qwen 3.8 Flash Next
Ух ждем. Я сам пока не понимаю что это будет. Потом почитаю подробнее и выдам пост.
https://modelscope.cn/models/Qwen/Qwen3.8-Flash-Next/summary
Можете тут почитать☝️
А я всё, пока что выключаю.
Ух ждем. Я сам пока не понимаю что это будет. Потом почитаю подробнее и выдам пост.
https://modelscope.cn/models/Qwen/Qwen3.8-Flash-Next/summary
Можете тут почитать☝️
А я всё, пока что выключаю.
🔥18❤2
Qwen 3.8 Flash Next GGUF - свежак от Unsloth.
https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
Если файлов еще нет, значит пацаны грузят. Прогреваем свои аппараты и готовимся тестить!
Обсуждаем релиз в НАШЕМ ЧАТЕ
Всем быстрых токенов!
https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
Если файлов еще нет, значит пацаны грузят. Прогреваем свои аппараты и готовимся тестить!
Обсуждаем релиз в НАШЕМ ЧАТЕ
Всем быстрых токенов!
huggingface.co
unsloth/Qwen3.8-Flash-Next-GGUF · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
👍2👏2
🔥 NVIDIA собирается купить Hugging Face за $12,9 млрд
По данным Reuters, NVIDIA согласилась приобрести Hugging Face - одну из главных площадок опенсорсных моделей.
Ну что, затариваемся всякими uncensored модельками, пока их не вычистили из обнимающегося лица.
И переходим на китайский аналог - ModelScope
А пока, приятной генерации!
По данным Reuters, NVIDIA согласилась приобрести Hugging Face - одну из главных площадок опенсорсных моделей.
Ну что, затариваемся всякими uncensored модельками, пока их не вычистили из обнимающегося лица.
И переходим на китайский аналог - ModelScope
А пока, приятной генерации!
💯16😱9👎1
Сегодня нашел время протестировать Unsloth Desktop. Это LM Studio на максималках. Кажется, это претендент в мой личный топ софтов для запуска ллм. Но не суть.
Провел я тест Qwen 3.8 27b в разных режимах thinking (да, в usloth desktop можно одним кликом менять думалку).
Промт:
Без референсного изображения, но с использованием тулов.
Подписывайтесь на НАШ ЧАТ чтобы присоединиться к тестированию.
Держу в курсе. Приятной генерации!
Провел я тест Qwen 3.8 27b в разных режимах thinking (да, в usloth desktop можно одним кликом менять думалку).
Промт:
I need a topdown view of a Playstation 5 controller in SVG.
It needs to be so well done that a photo from topdown looks identical in color, grading, positioning, subtle details, shadows, shape etc.
Без референсного изображения, но с использованием тулов.
Подписывайтесь на НАШ ЧАТ чтобы присоединиться к тестированию.
Держу в курсе. Приятной генерации!
❤7👏4👍1
Apple Watch в одном html файле.
Накатил Deepseek Harness и подключил к нему Unsloth Desktop в режиме api с моделью Qwen 3.8 27b с думалкой xhigh.
Короткий промт: Сделай интерфейс Apple Watch в одном html
И через 6 минут вполне рабочие часы. Блин, квен красава, радует. Пробуйте тоже и выкладывайте свои результаты в НАШ ЧАТ
А я выложу свои часы в коменты под постом.
Накатил Deepseek Harness и подключил к нему Unsloth Desktop в режиме api с моделью Qwen 3.8 27b с думалкой xhigh.
Короткий промт: Сделай интерфейс Apple Watch в одном html
И через 6 минут вполне рабочие часы. Блин, квен красава, радует. Пробуйте тоже и выкладывайте свои результаты в НАШ ЧАТ
А я выложу свои часы в коменты под постом.
🔥9👏3👍2❤1