Это 125B-A6B модель с 51B Engram параметров на архитектуре Qwen 4. Обходит по всем бенчам Qwen 3.8 27B, очень хорошо соревнуется с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang.
Очень интересный форм-фактор для моделей, позволяющий эффективно их запускать на локальных машинах с 128gb памяти — DGX Spark, Mac, Strix Halo. В такой весовой категории в последнее время никого не было, ~30B модели запускались и на сильно более слабом железе, а DeepSeek V4 Flash и модели в подобной весовой категории уже не влезали.
Блогпост
Техрепорт
Веса https://huggingface.co/Qwen/Qwen3.8-Flash-Next
1-бит версия = 72.5 GB https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
(Обсуждение)
#Qwen38FlashNext #Qwen4 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
- Granite-4.2-30B — флагманская модель логического вывода в семействе Granite 4.2.
Она обеспечивает максимальную производительность при выполнении задач, требующих логического вывода, благодаря встроенной <think>...</think> цепочке рассуждений. Она поддерживает гибкие режимы логического вывода — полный (по умолчанию), без логического вывода и с минимальными усилиями, — что позволяет пользователям выбирать баланс между глубиной и задержкой для каждого запроса.
Ключевые возможности:
- Встроенные рассуждения: собственная цепочка рассуждений, которая значительно повышает эффективность решения математических задач, задач по программированию и сложных многоэтапных задач.
- Гибкие режимы мышления: плавное переключение между режимами полного мышления, бездумным режимом и режимом с минимальными усилиями в рамках одной модели.
- Вызов инструментов с учетом рассуждений: модель рассуждает о том, какие инструменты вызывать и почему, что позволяет делать более точные вызовы функций.
- Контекстное окно 512K: поддерживает длинные документы, многоэтапные диалоги и сложные агентные рабочие процессы.
- Лицензия Apache 2.0: полностью открыта для коммерческого и исследовательского использования.
- Granite-4.2-8B — это модель логического вывода среднего размера из семейства Granite 4.2.
Она обеспечивает высокую производительность при выполнении задач, требующих логического вывода, благодаря встроенной <think>...</think> цепочке рассуждений. Он поддерживает гибкие режимы мышления — полное мышление (по умолчанию), отсутствие мышления и минимальное усилие — что позволяет пользователям балансировать между глубиной и задержкой на основе каждого запроса.
- Granite-4.2-3B — это компактная модель логического вывода в семействе Granite 4.2.
Несмотря на небольшое количество параметров, она обеспечивает высокую производительность при выполнении задач, требующих логического вывода, благодаря встроенной <think>...</think> цепочке рассуждений. Она поддерживает гибкие режимы логического вывода — полный (по умолчанию), без логического вывода и с минимальными усилиями, — что позволяет пользователям выбирать баланс между глубиной и задержкой для каждого запроса.
Блог: https://huggingface.co/blog/ibm-granite/granite-4-2
https://github.com/ibm-granite/granite-4.2-language-models
(Обсуждение)
#Granite42 #Granite428B #Granite4230B #Granite423B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
(Обсуждение)
#Qwen38FlashNext #Qwen4 #DeepSeekV4 #DSV4 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
320B-A18B мультимодальная модель, веса которой уже доступны. По бенчам сильнее GLM 5.2, но слабее полноценной GLM 5.3.
⚡️ Z.ai выпустили GLM-5.3-Flash — ту самую Ox Alpha, которая за неделю стала топ-1 в OpenRouter!
Модель доступна в API по цене $0,15/$0,5 за миллион токенов, за пределами пиковых часов и по выходным на модель делают скидку в 50%.
Блогпост
Веса https://huggingface.co/zai-org/GLM-5.3-Flash
Квант: UD-IQ1_M = 97.6 GB https://huggingface.co/unsloth/GLM-5.3-Flash-GGUF - можно запустить на 128Гб.
Запуск в Unsloth — see guide
(Обсуждение)
#GLM53Flash #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Генератор презентаций ИИ с открытым исходным кодом и API (Альтернатива ИИ Gamma, Canva, Beautiful AI, Decktopus для презентаций)
✨ Почему Presenton:
Отсутствие привязки к SaaS · Отсутствие принудительных подписок · Полный контроль над моделями и данными (Локальная работа!)
Чем Presenton отличается от других?:
- Используйте полностью самостоятельный веб-сервис через пакет Docker
- Или скачайте настольное приложение (для Mac (Apple Silicon / Intel), Windows и Linux)
- Работает с Ollama, LM Studio, OpenAI, Gemini, Vertex AI, Azure OpenAI, Amazon Bedrock, Fireworks, Together AI, Anthropic и любыми другими провайдерами, совместимыми с OpenAI
- Поставляется с API для создания презентаций с помощью ИИ
- Полностью открытый исходный код (Apache 2.0)
- Работает с вашим собственным дизайном/шаблонами
- Полностью редактируемый экспорт в формате PPTX
Статья. / Статья-2
#Presenton #Презентация #MacOS #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🍋 Lemonade: освежающе быстрый локальный ИИ
Lemonade — это локальный ИИ-сервер, который предоставляет те же возможности, что и облачные API, но при этом является на 100 % бесплатным и приватным. Используйте новейшие модели для общения, написания кода, генерации речи и изображений на собственном нейронном процессоре и графическом процессоре.
🔗 https://lemonade-server.ai
🔗 https://github.com/lemonade-sdk/lemonade
#Lemonade #AiServer #MacOS #Windows #Linux #LocalAi #AiLocal
Lemonade — это локальный ИИ-сервер, который предоставляет те же возможности, что и облачные API, но при этом является на 100 % бесплатным и приватным. Используйте новейшие модели для общения, написания кода, генерации речи и изображений на собственном нейронном процессоре и графическом процессоре.
Lemonade доступен в двух вариантах:
- Lemonade Server — это сервис, к которому можно подключиться через сотни отличных приложений, использующих стандартные API OpenAI, Anthropic и Ollama.
- Встраиваемый Lemonade — это портативный бинарный файл, который можно упаковать в собственное приложение, чтобы добавить в него мультимодальный локальный ИИ, автоматически оптимизирующийся под компьютер пользователя.
Этот проект создан сообществом для всех ПК с оптимизацией от инженеров AMD, чтобы максимально эффективно использовать возможности Ryzen AI, Radeon и ПК Strix Halo.
Приступая к работе:
- Установить: Windows · Linux · macOS · Docker · Исходный код
- Получение моделей: просматривайте и загружайте с помощью менеджера моделей
- Генерировать: Попробуйте модели со встроенными интерфейсами для общения в чате, генерации изображений, генерации речи и многого другого
- Мобильный: Возьмите с собой лимонад: iOS · Android · Исходный код
- Подключайся: используй Lemonade со своими любимыми приложениями:
( теперь доступно на 15 движках!)
#Lemonade #AiServer #MacOS #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Простой способ создания красивых изображений на ПК с помощью ИИ в один клик, без технических знаний. Предоставляет браузерный интерфейс для создания изображений на основе текстовых подсказок и изображений. Просто введите текстовую подсказку и посмотрите сгенерированное изображение.
Не требует технических знаний, не требует предустановленного программного обеспечения. Установка в один клик, мощные функции.
️🔥🎉 Новое! В движок v4 добавлена поддержка Ernie, Z-Image, Flux 1 и 2, Lumina, Anima и квантованных моделей!
💡 И есть: stable-diffusion.cpp - Вывод диффузионной модели (SD, Flux, Wan, Qwen Image, Z-Image, ...)
#EasyDiffusion3 #EasyDiffusion #StableDiffusion #SD #Ernie #ZImage #Flux #Lumina #Anima #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Zeno — это бесплатный инструмент на основе агентного ИИ, который полностью работает на вашем Mac. Он похож на Claude Cowork, но, очевидно, имеет меньшую модель, поэтому может работать локально. Он работает с вашими файлами, обеспечивает конфиденциальность ваших данных, не требует оплаты за использование и не содержит водяных знаков. Он поставляется с 4-битной версией Qwen3.6-35B-A3B. Полная модель не помещается в объединенную память Mac с 16 ГБ, поэтому вместо того, чтобы уменьшать или обрезать ее, мы создали систему разгрузки.
(Обсуждение)
#Zeno #AiAgent #AgentAi #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
TinySearch выполняет локальный поиск, сканирование и переранжировку веб-страниц, а затем предоставляет вашему агенту только те доказательства, которые стоит включить в контекст.
TinySearch версии 0.6.1 - по-прежнему легкий инструмент веб-исследований для локальных LLM, теперь с поддержкой собственного браузера
Сжимайте веб для своих агентов! Эффективный с точки зрения использования токенов, быстрый и полностью локальный веб-поиск и исследования.
TinySearch — это инструмент для веб-исследований, который можно разместить на собственном сервере. Он выполняет поиск в интернете, читает лучшие страницы, удаляет малоценный контент и возвращает компактные доказательства с исходными URL-адресами.
Ваша модель получает полезные фрагменты, а не платит за обработку целых веб-страниц.
TinySearch является частью TinySuite — набора специализированных инструментов, призванных удешевить агентные операции за счет минимизации использования токенов с помощью интеллектуальных методов поиска, выбора и управления контекстом.
(Обсуждение)
#TinySearch #AiSearch #MCP #Парсинг #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Нативное приложение macOS для работы с ChromaDB без терминала: установка и обновление движка, подключение к локальной базе данных или серверу, просмотр и редактирование ее содержимого, а также выполнение встраиваний через локальную LM Studio.
Статья: https://habr.com/ru/articles/1074938/
#ChromaDBManager #ChromaDB #RAG #MacOS #MCP #LMStudio #Hermes #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM