Всем привет. Это видео-эксперимент. Долго думал выпускать или нет. Многим может быть неинтересно. Но как говорится на безрыбье и это видео - рыба.
Видео: https://www.youtube.com/watch?v=M-gKlgGcWYc
Кстати, не забывайте подписываться на НАШ ЧАТ
Всем быстрых токенов!
Видео: https://www.youtube.com/watch?v=M-gKlgGcWYc
Кстати, не забывайте подписываться на НАШ ЧАТ
Всем быстрых токенов!
👍17🔥6❤1
Покажу один из рабочих процессов, который я сделал себе с помощью GPT 5.6 Sol.
Да да, не удивляйтесь. Ради этого (и не только) я оформил подписку на облачную LLM.
Но ведь не всё крутится вокруг кодинга. Есть задачи, где очень хорошо показывают себя и локальные модели. Например Gemma 4 26B для перевода текста.
В этом видео, я показал софт, который производит дубляж видео на другие языки.
https://youtu.be/ylwJ_uO-vP0
Подписывайтесь также на НАШ ЧАТ.
А я всё, выключаю!
Да да, не удивляйтесь. Ради этого (и не только) я оформил подписку на облачную LLM.
Но ведь не всё крутится вокруг кодинга. Есть задачи, где очень хорошо показывают себя и локальные модели. Например Gemma 4 26B для перевода текста.
В этом видео, я показал софт, который производит дубляж видео на другие языки.
https://youtu.be/ylwJ_uO-vP0
Подписывайтесь также на НАШ ЧАТ.
А я всё, выключаю!
YouTube
Дубляж видео - Для чего я использую LM Studio + Gemma 4 26B?
Мне часто писали комментарии, якобы нужно тестировать локальные модели на реальных задачах. Вот, настало время поделиться закулисьем своей работы с локальными моделями. Для чего мне LM Studio, Gemma 4 и GPT 5.6 Sol?
👍17❤4👨💻1
Я попытался сделать софт для автоматизации создания контента на YouTube, который работает чисто локально и вот что получилось…
Видео: https://youtu.be/cKx3t1oJmiY
Подписывайтесь на НАШ ЧАТ
Всем приятного и быстрых токенов.
Видео: https://youtu.be/cKx3t1oJmiY
Подписывайтесь на НАШ ЧАТ
Всем приятного и быстрых токенов.
🔥15👍3❤1
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Ну что, видели уже новую модель для видеогенераций MiniMax H3? Как вам?
Я уже затестил и хочу сказать что это просто пушка. Практически уровень Seedance, только на своем ПК.
Вот несколько результатов.
Если вы тоже протестировали, скидывайте свои результаты в НАШ ЧАТ.
Приятной генерации!
Я уже затестил и хочу сказать что это просто пушка. Практически уровень Seedance, только на своем ПК.
Вот несколько результатов.
Если вы тоже протестировали, скидывайте свои результаты в НАШ ЧАТ.
Приятной генерации!
👍16🔥8❤2
This media is not supported in your browser
VIEW IN TELEGRAM
Этот август полон релизов и мне это нравится.
Это я к чему. Только что вышел LTX 2.5:
https://huggingface.co/Lightricks/LTX-2.5
Неделю назад вышел MiniMax H3:
https://huggingface.co/Comfy-Org/MiniMax-H3
Еще обещают дропнуть веса видеогенератора FLUX 3.
И вишенка на торте. Завтра, 12-го августа, долгожданный Qwen 3.8
Ух, жаркий август.
А пока, подписывайтесь на НАШ ЧАТ, чтобы следить за новостями сообщества, а также делитесь результатами LTX 2.5.
Приятной генерации!
Это я к чему. Только что вышел LTX 2.5:
https://huggingface.co/Lightricks/LTX-2.5
Неделю назад вышел MiniMax H3:
https://huggingface.co/Comfy-Org/MiniMax-H3
Еще обещают дропнуть веса видеогенератора FLUX 3.
И вишенка на торте. Завтра, 12-го августа, долгожданный Qwen 3.8
Ух, жаркий август.
А пока, подписывайтесь на НАШ ЧАТ, чтобы следить за новостями сообщества, а также делитесь результатами LTX 2.5.
Приятной генерации!
🔥20👍7❤2
Наконец-то вышел Qwen 3.8, но 2.4 триллионов параметров.
💪 https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B
Кто миллиардер и имеет свой дата-центр, налетайте тестировать и скидывайте свои результаты в НАШ ЧАТ
А мы, простые ребята с видеокартами RTX 3000/4000/5000, подождем пока выйдет тот самый Qwen 3.8 27b.
И релиз состоится 14 августа, вечерком.
Здесь будем проверять вышла чи не:
https://modelscope.cn/models/Qwen/Qwen3.8-27B/summary
Приятной генерации!
💪 https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B
Кто миллиардер и имеет свой дата-центр, налетайте тестировать и скидывайте свои результаты в НАШ ЧАТ
А мы, простые ребята с видеокартами RTX 3000/4000/5000, подождем пока выйдет тот самый Qwen 3.8 27b.
И релиз состоится 14 августа, вечерком.
Здесь будем проверять вышла чи не:
https://modelscope.cn/models/Qwen/Qwen3.8-27B/summary
Приятной генерации!
🔥15👍14❤3
🎵 MiniMax релизнули Music 3 - мощную модель для локальной генерации музыки
Вслед за видеогенератором, минимаксовцы дропнули веса для генератора музыки. Этого я точно не ожидал.
Для обычного запуска рекомендуется GPU примерно с 24+ ГБ VRAM. При меньшем объёме памяти предусмотрен CPU offload, а специальный режим позволяет запускать модель даже примерно на 8 ГБ VRAM, хотя скорость в таком случае будет заметно ниже.
Будет ли это достойная конкуренция для Ace Step 1.5?
Проверяйте и кидайте свои результаты в НАШ ЧАТ
Веса HF: https://huggingface.co/Comfy-Org/MiniMax-Music-3
Приятной генерации!
Вслед за видеогенератором, минимаксовцы дропнули веса для генератора музыки. Этого я точно не ожидал.
Для обычного запуска рекомендуется GPU примерно с 24+ ГБ VRAM. При меньшем объёме памяти предусмотрен CPU offload, а специальный режим позволяет запускать модель даже примерно на 8 ГБ VRAM, хотя скорость в таком случае будет заметно ниже.
Будет ли это достойная конкуренция для Ace Step 1.5?
Проверяйте и кидайте свои результаты в НАШ ЧАТ
Веса HF: https://huggingface.co/Comfy-Org/MiniMax-Music-3
Приятной генерации!
🔥16
Ну что, король в здании - Qwen 3.8 27b
Держите сразу GGUF от Unsloth:
https://huggingface.co/unsloth/Qwen3.8-27B-GGUF
Тестируйте и делитесь результатами в НАШ ЧАТ
Всем быстрых токенов и рабочих результатов!
Держите сразу GGUF от Unsloth:
https://huggingface.co/unsloth/Qwen3.8-27B-GGUF
Тестируйте и делитесь результатами в НАШ ЧАТ
Всем быстрых токенов и рабочих результатов!
huggingface.co
unsloth/Qwen3.8-27B-GGUF · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
🔥18👏10❤3
Qwen 3.8 27b - Первый тест
Смотреть: https://youtu.be/Qqpc934SdNw
Все промты в НАШЕМ ЧАТЕ
Всем быстрых токенов и приятного просмотра!
Смотреть: https://youtu.be/Qqpc934SdNw
Все промты в НАШЕМ ЧАТЕ
Всем быстрых токенов и приятного просмотра!
YouTube
Qwen 3.8 27B - первый тест на RTX 5090. Точно ли это король?
Батя локальных LLM - Qwen, вернулся с новой версией 3.8! Я сделал пару тестов на горячую. Приятного просмотра!
👍12
super-mario.html
42.3 KB
А ведь Qwen 3.8 27b хорош, чертяка!
Только посмотрите что он сделал мне за 45 минут в OpenCode, потратив 166 910 токенов, и это Q5_K_XL квант. Достойно.
Промт был такой:
И всё, я закинул ему задание и пошел смотреть новую серию Укрытия (2023).
Я прилепил html файл, чтобы вы сами попробовали.
Всем быстрых токенов. А я всё, выключаю.
Только посмотрите что он сделал мне за 45 минут в OpenCode, потратив 166 910 токенов, и это Q5_K_XL квант. Достойно.
Промт был такой:
Create a Super Mario clone in JavaScript as a single HTML page. Make the game engaging and the graphics as beautiful as possible.
И всё, я закинул ему задание и пошел смотреть новую серию Укрытия (2023).
Я прилепил html файл, чтобы вы сами попробовали.
Всем быстрых токенов. А я всё, выключаю.
🔥24👍8❤1😁1
Результат Qwen 3.8 27b в кванте BF16 от участника НАШЕГО ЧАТА. Это прям реально мощь!
Промт здесь.
Результат здесь, можете покрутить на своем ПК.
Присоединяйтесь к тестированию и кидайте свои результаты в раздел Тесты LLM.
Приятной генерации и быстрых токенов!
Промт здесь.
Результат здесь, можете покрутить на своем ПК.
Присоединяйтесь к тестированию и кидайте свои результаты в раздел Тесты LLM.
Приятной генерации и быстрых токенов!
🔥9👍2
Qwen 3.8 27B - это параноик из мира LLM
Я просматривал reasoning Qwen 3.8 27B и заметил, что она постоянно сомневается в себе.
Она приходит к решению, затем начинает его перепроверять, рассматривает другие варианты, возвращается назад и снова всё проверяет.
Похоже, именно поэтому относительно небольшая 27B-модель способна показывать настолько хорошие результаты.
На xhigh reasoning effort это особенно заметно. Иногда кажется, что модель уже закончила рассуждать и сейчас даст финальный ответ, но затем она снова начинает всё перепроверять.
Это делает её медленнее и заставляет расходовать намного больше thinking-токенов, но для сложных задач такой подход может быть преимуществом.
Взял из реддита, ибо мне зашел такой вариант описания поведения модели 🙂
А вы что думаете?
Я просматривал reasoning Qwen 3.8 27B и заметил, что она постоянно сомневается в себе.
Она приходит к решению, затем начинает его перепроверять, рассматривает другие варианты, возвращается назад и снова всё проверяет.
Похоже, именно поэтому относительно небольшая 27B-модель способна показывать настолько хорошие результаты.
На xhigh reasoning effort это особенно заметно. Иногда кажется, что модель уже закончила рассуждать и сейчас даст финальный ответ, но затем она снова начинает всё перепроверять.
Это делает её медленнее и заставляет расходовать намного больше thinking-токенов, но для сложных задач такой подход может быть преимуществом.
Взял из реддита, ибо мне зашел такой вариант описания поведения модели 🙂
А вы что думаете?
👍21❤6
Media is too big
VIEW IN TELEGRAM
Как Qwen 3.8 27b делал мне игру в OpenCode всю ночь!
Черт дернул меня на ночь глядя попробовать этот промт, думал за полчасика сделает. Ага. Запустил в Opencode в 23:00, утром проснулся, а он оборвался на пол пути своих рассуждений где-то в середине ночи. Пнул его чтобы продолжал, закончил в 13:00.
Запуская, я думал сейчас будет Forza Horizont новая часть, а получилось это. Управление не работает, сам ездит по заранее записанной траектории, и уже со старту дает боком.
Я не рискнул сказать ему чтобы он починил, потому что ждать еще сутки, пока он выдавит результат я не готов. Его длинные рассуждения уже раздражают. Это на уровне шуток про клода, когда пишешь ему "привет", а он в рассуждениях спалил весь 5 часовой лимит. Не думал что господин Квен перехватит эстефету.
У вас получилось решить проблему длинных рассуждений? Или вас это не напрягает?
Подписывайтесь на НАШ ЧАТ. А я всё, выключаю.
Черт дернул меня на ночь глядя попробовать этот промт, думал за полчасика сделает. Ага. Запустил в Opencode в 23:00, утром проснулся, а он оборвался на пол пути своих рассуждений где-то в середине ночи. Пнул его чтобы продолжал, закончил в 13:00.
Запуская, я думал сейчас будет Forza Horizont новая часть, а получилось это. Управление не работает, сам ездит по заранее записанной траектории, и уже со старту дает боком.
Я не рискнул сказать ему чтобы он починил, потому что ждать еще сутки, пока он выдавит результат я не готов. Его длинные рассуждения уже раздражают. Это на уровне шуток про клода, когда пишешь ему "привет", а он в рассуждениях спалил весь 5 часовой лимит. Не думал что господин Квен перехватит эстефету.
У вас получилось решить проблему длинных рассуждений? Или вас это не напрягает?
Подписывайтесь на НАШ ЧАТ. А я всё, выключаю.
😁18👍1
Как же я недооценивал NVFP4
Сегодня шарился по реддиту и наткнулся на пост, где кто-то выдавил из 5090 почти 200 т/с (там есть нюанс - Linux).
Я тоже попробовал Qwen 3.8 27b в формате NVFP4, вместо стандартных Q4/Q5/Q6, которые я обычно использовал, и был приятно удивлен.
Но так как у меня Windows, скорость генерации на 5090 при полном контексте (262к!) достигала 137 токенов в секунду. А качество модели на уровне Q5 (если что, это утверждает GPT, не я). К слову, на Q5_K_XL при 130к контекста у меня 80-90 токенов в секунду. Как бы чувствуется разница слегка.
В НАШЕМ ЧАТЕ в разделе Тесты LLM, я успел немного погонять модельку. Продолжу дальше тестировать, что за зверь этот ваш NVFP4.
А вы пробовали? Что думаете?
Приятной генерации и быстрых токенов! А я всё, выключаю.
Сегодня шарился по реддиту и наткнулся на пост, где кто-то выдавил из 5090 почти 200 т/с (там есть нюанс - Linux).
Я тоже попробовал Qwen 3.8 27b в формате NVFP4, вместо стандартных Q4/Q5/Q6, которые я обычно использовал, и был приятно удивлен.
Но так как у меня Windows, скорость генерации на 5090 при полном контексте (262к!) достигала 137 токенов в секунду. А качество модели на уровне Q5 (если что, это утверждает GPT, не я). К слову, на Q5_K_XL при 130к контекста у меня 80-90 токенов в секунду. Как бы чувствуется разница слегка.
В НАШЕМ ЧАТЕ в разделе Тесты LLM, я успел немного погонять модельку. Продолжу дальше тестировать, что за зверь этот ваш NVFP4.
А вы пробовали? Что думаете?
Приятной генерации и быстрых токенов! А я всё, выключаю.
🔥12❤1👍1