Alibaba анонсировала Qwen 4
На конференции Apsara алибабаевцы анонсировали Qwen 4.
Пока это именно анонс: открытые веса Qwen 4 ещё не опубликованы, но мы потираем ручки.
Интерес к релизу особенно большой на фоне недавней Qwen 3.8. Её 27B-версия уже показала себя как просто как пушка. Так же в ожидании долгожданного MoE 35B. Ну а вдруг.
Ждем?
MrGips • Про LLM / НАШ ЧАТ
На конференции Apsara алибабаевцы анонсировали Qwen 4.
Пока это именно анонс: открытые веса Qwen 4 ещё не опубликованы, но мы потираем ручки.
Интерес к релизу особенно большой на фоне недавней Qwen 3.8. Её 27B-версия уже показала себя как просто как пушка. Так же в ожидании долгожданного MoE 35B. Ну а вдруг.
Ждем?
MrGips • Про LLM / НАШ ЧАТ
🔥30👍5😁4🤔1
This media is not supported in your browser
VIEW IN TELEGRAM
Тест с пеликаном на велосипеде вышел на новый уровень
На реддит увидел эксперимент, где парень решил усложнить старый добрый бенч с пеликаном на велеке.
Вместо обычной SVG картинки он поручил двум ИИ-шницам создать полноценную 3D-сцену с анимацией в Blender.
У кого круче?
MrGips • Про LLM / НАШ ЧАТ
На реддит увидел эксперимент, где парень решил усложнить старый добрый бенч с пеликаном на велеке.
Вместо обычной SVG картинки он поручил двум ИИ-шницам создать полноценную 3D-сцену с анимацией в Blender.
У кого круче?
MrGips • Про LLM / НАШ ЧАТ
😁13🔥9😱2
Media is too big
VIEW IN TELEGRAM
Зачем платить за Photoshop, когда его можно просто навайбкодить?
Увидел на реддите пост, где разработчик представил Photon Studio - бесплатный графический редактор для Windows и macOS, который он создал с помощью GPT-6 Astra.
Изначально автор просто хотел избавиться от подписки Adobe и сделать собственную альтернативу Photoshop. Но проект быстро вырос в полноценное приложение.
💰 Первоначальные расходы на ИИ составили около $2000. Позже сумма значительно выросла, но проект уже преодолел отметку в 20 000 пользователей!
Разработчик утверждает, что реализовал около 99% функциональности Photoshop. Впрочем, пользователи пока находят ошибки, а полная совместимость с Photoshop ещё не подтверждена.
🚀 И на этом автор останавливаться не собирается!
В планах создание собственных аналогов Illustrator, After Effects, Premiere Pro и Lightroom.
Плохо что он не опубликовал исходники на github. Мы бы оценили. А так понаблюдаем просто.
MrGips • Про LLM / НАШ ЧАТ
Увидел на реддите пост, где разработчик представил Photon Studio - бесплатный графический редактор для Windows и macOS, который он создал с помощью GPT-6 Astra.
Изначально автор просто хотел избавиться от подписки Adobe и сделать собственную альтернативу Photoshop. Но проект быстро вырос в полноценное приложение.
💰 Первоначальные расходы на ИИ составили около $2000. Позже сумма значительно выросла, но проект уже преодолел отметку в 20 000 пользователей!
Разработчик утверждает, что реализовал около 99% функциональности Photoshop. Впрочем, пользователи пока находят ошибки, а полная совместимость с Photoshop ещё не подтверждена.
🚀 И на этом автор останавливаться не собирается!
В планах создание собственных аналогов Illustrator, After Effects, Premiere Pro и Lightroom.
Плохо что он не опубликовал исходники на github. Мы бы оценили. А так понаблюдаем просто.
MrGips • Про LLM / НАШ ЧАТ
👍10🔥10✍5❤3
НОВОЕ ВИДЕО! Claude Opus 5.5 VS GPT-6 Sol - Тест в Blender с реф. изображениями и чертежами
Смотреть: https://www.youtube.com/watch?v=2aKTVII_3Tc
Опус конечно неплох, достойный конкурент GPT-6 Astra.
Приятного просмотра!
MrGips • Про LLM / НАШ ЧАТ
Смотреть: https://www.youtube.com/watch?v=2aKTVII_3Tc
Опус конечно неплох, достойный конкурент GPT-6 Astra.
Приятного просмотра!
MrGips • Про LLM / НАШ ЧАТ
YouTube
Claude Opus 5.5 VS GPT-6 Sol - Тест в Blender с референсными изображениями и чертежами
Всем привет! В этом видео я хочу протестировать хайповый Claude Opus 5.5 и новый GPT-6 Sol в blender тесте, где обе модели будут моделировать Honda Accord по нескольким референсным изображениям и чертежам. Приятного просмотра!
Zarub - Виртуальная карта для…
Zarub - Виртуальная карта для…
🔥5❤1🤯1
Honda_Accord_CL.blend
21.1 MB
Honda Accord созданный Opus 5.5
В комментариях под последним видео люди просили посмотреть сетку творения от Opus'а.
Если не лень, пишите отзыв в комментарии.
MrGips • Про LLM / НАШ ЧАТ
В комментариях под последним видео люди просили посмотреть сетку творения от Opus'а.
Если не лень, пишите отзыв в комментарии.
MrGips • Про LLM / НАШ ЧАТ
🔥12🤯1
This media is not supported in your browser
VIEW IN TELEGRAM
Qwen 3.8 27B NVFP4 (Ninfer) тоже может в геймдев
Не без косяков конечно.
🔥 Запускал я это в DeepSeek Harness, который обработал 27,9 млн токенов. Сделал одну правку. Молотил около часа.
• 26,6 млн - контекст из KV/prefix cache
• 980 тыс. - новый вход
• 290 тыс. - output модели
• Cache Hit - 96%
• скорость генерации - около 125 tok/s
Промт на создание этого шедевра будет в комментариях.
MrGips • Про LLM / НАШ ЧАТ
Не без косяков конечно.
🔥 Запускал я это в DeepSeek Harness, который обработал 27,9 млн токенов. Сделал одну правку. Молотил около часа.
• 26,6 млн - контекст из KV/prefix cache
• 980 тыс. - новый вход
• 290 тыс. - output модели
• Cache Hit - 96%
• скорость генерации - около 125 tok/s
Промт на создание этого шедевра будет в комментариях.
MrGips • Про LLM / НАШ ЧАТ
🤣18🔥7😁3🤯1
This media is not supported in your browser
VIEW IN TELEGRAM
Opus 5.5 + Blender + Unreal Engine
У меня нет идей на игры, поэтому делаю прототип разборки ходовки с реальными каталожными номерами и 3D запчастями. Зачем? Не могу остановиться 🤷♂️
Все это добро засунул в Unreal Engine и прикрепил примитивную анимацию и вращение.
3D модели запчастей делал (только передняя ходовка готова) Opus 5.5, пока у него лимит, GPT-6 Astra засунула это всё в анрил.
Может будет видео про это, а может нет.
MrGips • Про LLM / НАШ ЧАТ
У меня нет идей на игры, поэтому делаю прототип разборки ходовки с реальными каталожными номерами и 3D запчастями. Зачем? Не могу остановиться 🤷♂️
Все это добро засунул в Unreal Engine и прикрепил примитивную анимацию и вращение.
3D модели запчастей делал (только передняя ходовка готова) Opus 5.5, пока у него лимит, GPT-6 Astra засунула это всё в анрил.
Может будет видео про это, а может нет.
MrGips • Про LLM / НАШ ЧАТ
👍14😁2👎1🔥1😍1
Qwen Image 2.1 - несколько примеров как работает режим редактирования
Промты:
Утащил с реддита для вас.
MrGips • Про LLM / НАШ ЧАТ
Промты:
Change all Coca Cola cans of <image1> by the can of <image2>. Keep then cans crushed as in <image1>. Make the white surface reflects the blue and pink colors of <image2>Keep the character and pose in <image1> unchanged, put this Rolex wristwatch from <image2> on the character, preserve the original body shape and pose, the wristwatch fits naturally on wrist, keep the original background and original lighting, high fashion editorial photography, sharp detailsУтащил с реддита для вас.
MrGips • Про LLM / НАШ ЧАТ
🔥14👍3
This media is not supported in your browser
VIEW IN TELEGRAM
Попробовал повторить тренд из инстаграма
Делал в Minimax H3, стандартный ворк Ref2V. Руки еще помнят ComfyUI.
Как же приятно, когда можно сделать локально не хуже, чем в распиаренном сидансе.
MrGips • Про LLM / НАШ ЧАТ
Делал в Minimax H3, стандартный ворк Ref2V. Руки еще помнят ComfyUI.
Как же приятно, когда можно сделать локально не хуже, чем в распиаренном сидансе.
MrGips • Про LLM / НАШ ЧАТ
😁18🔥7👍2🤣1
🚀 Появился новый движок Strata, который запускает огромную Qwen3.8 Flash Next даже на видеокартах с 12 GB VRAM
Думаю вы уже знаете что Qwen3.8 Flash Next большая MoE-модель, которая требует очень много памяти. Но разработчик нового inference-движка Strata смог распределить её между GPU, оперативной памятью и SSD.
В результате модель уже запускают даже на обычных игровых видеокартах.
На RTX 5070 12 GB при контексте 128K разработчик получил:
• Q2_0 - около 65 tok/s
• IQ2_XS - около 52 tok/s
• IQ3_XXS - около 45 tok/s
• IQ3_S - около 42 tok/s
На коротком контексте скорость ещё выше.
Появились и тесты от других пользователей:
• RTX 5070 Ti - около 86 tok/s на IQ3_XXS при 64K
• RTX 4090 - примерно 58–70 tok/s на IQ3_S при 262K
• даже RTX 2070 8 GB удалось запустить примерно на 20 tok/s
Как это работает?
Strata не пытается полностью загрузить огромную модель в видеопамять.
Самые востребованные части модели находятся на GPU, остальные MoE-эксперты - в RAM, а большая PLE/n-gram память может храниться на SSD.
Таким образом, Flash Next можно запускать даже при относительно небольшом объёме VRAM.
Ещё одна важная функция — кеширование диалога. После первого запроса Strata сохраняет состояние и при следующих обращениях обрабатывает только новый контекст, что особенно важно для AI-агентов и программирования.
Пока у проекта есть ограничения: нет полноценного multi-GPU.
Но сам факт уже интересный: Qwen3.8 Flash Next постепенно превращается из огромной модели для дорогих серверов в LLM, которую можно запускать на обычном домашнем ПК.
Я сам еще не пробовал, но в НАШЕМ ЧАТЕ люди потихоньку запускают, скорость реально повыше.
Линк на движок: https://github.com/Niko1221/Strata
Модели, которые нужны Страте: https://huggingface.co/ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF
Пробовали уже?
MrGips • Про LLM / НАШ ЧАТ
Думаю вы уже знаете что Qwen3.8 Flash Next большая MoE-модель, которая требует очень много памяти. Но разработчик нового inference-движка Strata смог распределить её между GPU, оперативной памятью и SSD.
В результате модель уже запускают даже на обычных игровых видеокартах.
На RTX 5070 12 GB при контексте 128K разработчик получил:
• Q2_0 - около 65 tok/s
• IQ2_XS - около 52 tok/s
• IQ3_XXS - около 45 tok/s
• IQ3_S - около 42 tok/s
На коротком контексте скорость ещё выше.
Появились и тесты от других пользователей:
• RTX 5070 Ti - около 86 tok/s на IQ3_XXS при 64K
• RTX 4090 - примерно 58–70 tok/s на IQ3_S при 262K
• даже RTX 2070 8 GB удалось запустить примерно на 20 tok/s
Как это работает?
Strata не пытается полностью загрузить огромную модель в видеопамять.
Самые востребованные части модели находятся на GPU, остальные MoE-эксперты - в RAM, а большая PLE/n-gram память может храниться на SSD.
Таким образом, Flash Next можно запускать даже при относительно небольшом объёме VRAM.
Ещё одна важная функция — кеширование диалога. После первого запроса Strata сохраняет состояние и при следующих обращениях обрабатывает только новый контекст, что особенно важно для AI-агентов и программирования.
Пока у проекта есть ограничения: нет полноценного multi-GPU.
Но сам факт уже интересный: Qwen3.8 Flash Next постепенно превращается из огромной модели для дорогих серверов в LLM, которую можно запускать на обычном домашнем ПК.
Я сам еще не пробовал, но в НАШЕМ ЧАТЕ люди потихоньку запускают, скорость реально повыше.
Линк на движок: https://github.com/Niko1221/Strata
Модели, которые нужны Страте: https://huggingface.co/ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF
Пробовали уже?
MrGips • Про LLM / НАШ ЧАТ
GitHub
GitHub - Niko1221/Strata: Qwen3.8-Flash-Next (125B MoE) on a 8GB+ NVIDIA GPU: one-click install for Windows / Linux. Strata inference…
Qwen3.8-Flash-Next (125B MoE) on a 8GB+ NVIDIA GPU: one-click install for Windows / Linux. Strata inference engine, OpenAI/Anthropic API on localhost, optional image input. - Niko1221/Strata
🔥19🤔5
MrGips • Про LLM
🚀 Появился новый движок Strata, который запускает огромную Qwen3.8 Flash Next даже на видеокартах с 12 GB VRAM Думаю вы уже знаете что Qwen3.8 Flash Next большая MoE-модель, которая требует очень много памяти. Но разработчик нового inference-движка Strata…
Qwen 3.8 Flash Next со скоростью 50+ ток/с в новом движке STRATA
Только сегодня делал пост про новый движок для запуска тяжелой MoE модели, как уже подоспели тесты.
Смотреть: https://www.youtube.com/watch?v=M0mMmUrHhP0
Приятного просмотра!
MrGips • Про LLM / НАШ ЧАТ
Только сегодня делал пост про новый движок для запуска тяжелой MoE модели, как уже подоспели тесты.
Смотреть: https://www.youtube.com/watch?v=M0mMmUrHhP0
Приятного просмотра!
MrGips • Про LLM / НАШ ЧАТ
YouTube
Qwen 3.8 Flash Next на новом движке Strata выдает 50+ ток/с на RTX 5090 - Установка, запуск и тесты
В этом видео я протестировал новый движок для запуска Qwen 3.8 Flash Next - Strata. И хочу сказать - это просто пушка!
Движок https://github.com/Niko1221/Strata
Подписывайтесь на телеграм-канал:
https://t.me/ProComfy
Движок https://github.com/Niko1221/Strata
Подписывайтесь на телеграм-канал:
https://t.me/ProComfy
🔥14❤4