MrGips • Про LLM
2.22K subscribers
71 photos
26 videos
3 files
111 links
Все про локальные LLM и не только.

Для связи: @MisterGips

НАШ ЧАТ https://t.me/+ZV1ymPoTNzlkYmE6
Download Telegram
Alibaba анонсировала Qwen 4

На конференции Apsara алибабаевцы анонсировали Qwen 4.

Пока это именно анонс: открытые веса Qwen 4 ещё не опубликованы, но мы потираем ручки.

Интерес к релизу особенно большой на фоне недавней Qwen 3.8. Её 27B-версия уже показала себя как просто как пушка. Так же в ожидании долгожданного MoE 35B. Ну а вдруг.

Ждем?

MrGips • Про LLM / НАШ ЧАТ
🔥30👍5😁4🤔1
This media is not supported in your browser
VIEW IN TELEGRAM
Тест с пеликаном на велосипеде вышел на новый уровень

На реддит увидел эксперимент, где парень решил усложнить старый добрый бенч с пеликаном на велеке.

Вместо обычной SVG картинки он поручил двум ИИ-шницам создать полноценную 3D-сцену с анимацией в Blender.

У кого круче?

MrGips • Про LLM / НАШ ЧАТ
😁13🔥9😱2
Media is too big
VIEW IN TELEGRAM
Зачем платить за Photoshop, когда его можно просто навайбкодить?

Увидел на реддите пост, где разработчик представил Photon Studio - бесплатный графический редактор для Windows и macOS, который он создал с помощью GPT-6 Astra.

Изначально автор просто хотел избавиться от подписки Adobe и сделать собственную альтернативу Photoshop. Но проект быстро вырос в полноценное приложение.

💰 Первоначальные расходы на ИИ составили около $2000. Позже сумма значительно выросла, но проект уже преодолел отметку в 20 000 пользователей!

Разработчик утверждает, что реализовал около 99% функциональности Photoshop. Впрочем, пользователи пока находят ошибки, а полная совместимость с Photoshop ещё не подтверждена.

🚀 И на этом автор останавливаться не собирается!
В планах создание собственных аналогов Illustrator, After Effects, Premiere Pro и Lightroom.

Плохо что он не опубликовал исходники на github. Мы бы оценили. А так понаблюдаем просто.

MrGips • Про LLM / НАШ ЧАТ
👍10🔥10✍5❤3
Honda_Accord_CL.blend
21.1 MB
Honda Accord созданный Opus 5.5

В комментариях под последним видео люди просили посмотреть сетку творения от Opus'а.

Если не лень, пишите отзыв в комментарии.

MrGips • Про LLM / НАШ ЧАТ
🔥12🤯1
Немного увлекся в Блендере с Opus'ом 5.5

А как вы проводите выходные?

MrGips • Про LLM / НАШ ЧАТ
🔥9👀5😨2❤1🤔1🤮1
This media is not supported in your browser
VIEW IN TELEGRAM
Qwen 3.8 27B NVFP4 (Ninfer) тоже может в геймдев

Не без косяков конечно.

🔥 Запускал я это в DeepSeek Harness, который обработал 27,9 млн токенов. Сделал одну правку. Молотил около часа.
• 26,6 млн - контекст из KV/prefix cache
• 980 тыс. - новый вход
• 290 тыс. - output модели
• Cache Hit - 96%
• скорость генерации - около 125 tok/s

Промт на создание этого шедевра будет в комментариях.

MrGips • Про LLM / НАШ ЧАТ
🤣18🔥7😁3🤯1
This media is not supported in your browser
VIEW IN TELEGRAM
Opus 5.5 + Blender + Unreal Engine

У меня нет идей на игры, поэтому делаю прототип разборки ходовки с реальными каталожными номерами и 3D запчастями. Зачем? Не могу остановиться 🤷‍♂️

Все это добро засунул в Unreal Engine и прикрепил примитивную анимацию и вращение.

3D модели запчастей делал (только передняя ходовка готова) Opus 5.5, пока у него лимит, GPT-6 Astra засунула это всё в анрил.

Может будет видео про это, а может нет.

MrGips • Про LLM / НАШ ЧАТ
👍14😁2👎1🔥1😍1
Qwen Image 2.1 - несколько примеров как работает режим редактирования

Промты:
Change all Coca Cola cans of <image1> by the can of <image2>. Keep then cans crushed as in <image1>. Make the white surface reflects the blue and pink colors of <image2>

Keep the character and pose in <image1> unchanged, put this Rolex wristwatch from <image2> on the character, preserve the original body shape and pose, the wristwatch fits naturally on wrist, keep the original background and original lighting, high fashion editorial photography, sharp details

Утащил с реддита для вас.

MrGips • Про LLM / НАШ ЧАТ
🔥14👍3
This media is not supported in your browser
VIEW IN TELEGRAM
Попробовал повторить тренд из инстаграма

Делал в Minimax H3, стандартный ворк Ref2V. Руки еще помнят ComfyUI.

Как же приятно, когда можно сделать локально не хуже, чем в распиаренном сидансе.

MrGips • Про LLM / НАШ ЧАТ
😁18🔥7👍2🤣1
🚀 Появился новый движок Strata, который запускает огромную Qwen3.8 Flash Next даже на видеокартах с 12 GB VRAM

Думаю вы уже знаете что Qwen3.8 Flash Next большая MoE-модель, которая требует очень много памяти. Но разработчик нового inference-движка Strata смог распределить её между GPU, оперативной памятью и SSD.

В результате модель уже запускают даже на обычных игровых видеокартах.

На RTX 5070 12 GB при контексте 128K разработчик получил:

• Q2_0 - около 65 tok/s
• IQ2_XS - около 52 tok/s
• IQ3_XXS - около 45 tok/s
• IQ3_S - около 42 tok/s

На коротком контексте скорость ещё выше.

Появились и тесты от других пользователей:

• RTX 5070 Ti - около 86 tok/s на IQ3_XXS при 64K
• RTX 4090 - примерно 58–70 tok/s на IQ3_S при 262K
• даже RTX 2070 8 GB удалось запустить примерно на 20 tok/s

Как это работает?

Strata не пытается полностью загрузить огромную модель в видеопамять.

Самые востребованные части модели находятся на GPU, остальные MoE-эксперты - в RAM, а большая PLE/n-gram память может храниться на SSD.

Таким образом, Flash Next можно запускать даже при относительно небольшом объёме VRAM.

Ещё одна важная функция — кеширование диалога. После первого запроса Strata сохраняет состояние и при следующих обращениях обрабатывает только новый контекст, что особенно важно для AI-агентов и программирования.

Пока у проекта есть ограничения: нет полноценного multi-GPU.

Но сам факт уже интересный: Qwen3.8 Flash Next постепенно превращается из огромной модели для дорогих серверов в LLM, которую можно запускать на обычном домашнем ПК.

Я сам еще не пробовал, но в НАШЕМ ЧАТЕ люди потихоньку запускают, скорость реально повыше.

Линк на движок: https://github.com/Niko1221/Strata

Модели, которые нужны Страте: https://huggingface.co/ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF

Пробовали уже?

MrGips • Про LLM / НАШ ЧАТ
🔥19🤔5