This media is not supported in your browser
VIEW IN TELEGRAM
Создает песни до пяти минут, поддерживает русский и запускается локально даже на домашнем железе. Полная модель помещается в GPU с 24 ГБ VRAM, но запустится даже с 8 ГБ.
(Обсуждение)
#MinMaxMusic3 #MinMax #Music3 #AiSong #SongAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
Статья: Сколько VRAM нужно для Llama 70B и DeepSeek локально
https://digital-razor.ru/media/articles/hardware/vram-llama-70b-deepseek-local/
https://digital-razor.ru/media/articles/hardware/vram-llama-70b-deepseek-local/
DigitalRazor
Сколько VRAM нужно для Llama 70B и DeepSeek локально
Практическое руководство: сколько VRAM нужно для запуска Llama 70B и DeepSeek локально при разном квантовании. Карта VRAM от 8 до 192 ГБ, сравнение Q4/Q8/FP16, Multi-GPU, Unified Memory, offloading и рекомендации по железу.
❤1
Сильно улучшили работу с инструментами и визуальное мышление. По некоторым бенчмаркам, особенно в части агентности, сравнима с Claude Opus 4.6.
В одном из тестов на агентное программирование результат вырос более чем втрое по сравнению с Qwen3.6-27B.
По совокупности тестов новинка оказалась сильнее даже предыдущей облачной Qwen3.7-Plus.
В отдельных задачах по программированию она показывает результаты выше Opus 4.6, хотя всё ещё уступает некогда флагману в сложных рассуждениях и работе с терминалом.
(Обсуждение)
Облегчённая версия от Unsloth занимает около 17 ГБ: её можно запустить на Mac с Apple Silicon или видеокарте с 24 ГБ памяти.
(Обсуждение)
Base model: https://huggingface.co/mlx-community/Qwen3.8-27B-8bit
MTP head 4-bit: https://huggingface.co/mlx-community/Qwen3.8-27B-MTP-4bit
MTP head 8-bit: https://huggingface.co/mlx-community/Qwen3.8-27B-MTP-8bit
(Обсуждение)
#Qwen3827B #Qwen38 #heretic #uncensored #БезЦензуры #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
💡 Qwen3.8-27B теперь работает в ~ 3 раза быстрее на Apple Silicon с mlx-dspark
mlx-dspark - это MLX-порт составителей спекулятивного декодирования DSpark от DeepSeek (выпуск DeepSpec), а также DFlash от z-lab с одним циклом проверки без потерь.
Подробнее и Обсуждение
Репозиторий: github.com/ARahim3/mlx-dspark
(для Gemma-4, Qwen3, Muse-Glimmer, Ornith-1.0, Qwen3.6, Qwen3.8, Nemotron и Bonsai )
✔️ Meta's Muse Glimmer 30B теперь работает в ~ 3,3 раза быстрее на Mac с mlx-dspark
⬇️ Скачать для MacOS: mlx-dspark-0.3.0.dmg
#Qwen3827B #Qwen38 #MLX #DSpark #mlxdspark #MacOS #AiModel #ModelAi #LocalAi #AiLocal
mlx-dspark - это MLX-порт составителей спекулятивного декодирования DSpark от DeepSeek (выпуск DeepSpec), а также DFlash от z-lab с одним циклом проверки без потерь.
Подробнее и Обсуждение
Репозиторий: github.com/ARahim3/mlx-dspark
(для Gemma-4, Qwen3, Muse-Glimmer, Ornith-1.0, Qwen3.6, Qwen3.8, Nemotron и Bonsai )
#Qwen3827B #Qwen38 #MLX #DSpark #mlxdspark #MacOS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
Pestle-27B-Ternary — это компактная модель 27B медицинского назначения и общего применения для локального логического вывода. В этом релизе частные медицинские системы контроля качества, работы с биомедицинскими доказательствами, поиска фармацевтической информации, кодирования и общей поддержки объединены в одну работающую модель GGUF. (Базовая модель
Qwen/Qwen3.6-27B)
Основные возможности:
- Полная модель класса 27B в одном 8,48 ГБ GGUF.
- Высокая эффективность в области медицинских знаний, биомедицинского контроля качества и поиска фармацевтической информации.
- Работает локально с Mortar на Apple Silicon, NVIDIA CUDA и с резервным процессором.
- Генерация текста, шаблоны чатов с поддержкой инструментов и опциональный визуальный ввод.
- Лицензия Apache 2.0.
(Обсуждение)
#Pestle27BTernary #Qwen3627B #AiMedical #MedicalAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
NVIDIA выпустила открытую модель на 30 млрд параметров, из которых активно работают только 3 млрд. Благодаря этому генерация текста идёт в четыре раза быстрее, чем у моделей похожего размера.
В бенчмарке PinchBench модель показала точность 86% и выполнила 10 000 задач на 35% быстрее Qwen3.6 35B при сопоставимой точности. Модель можно дообучить на своих данных и инструментах, она достаточно компактна для запуска на DGX Spark.
Вместе с моделью NVIDIA открыла библиотеку NeMo Switchyard — она распределяет задачи агента между разными моделями. Сложные рассуждения можно отдать продвинутым моделям, а массовое выполнение — быстрой Lightning.
NVIDIA опубликовала веса, данные и рецепты обучения.
В тестах самой NVIDIA новинка уступила Qwen3.6 и Gemma 4. Недавно представленная Muse Glimmer, которая идёт примерно на уровне Qwen, тоже выглядит сильнее.
Зато козырь Lightning это скорость: на большой очереди типовых задач она справилась с работой на 30% быстрее Qwen при сопоставимом качестве.
Веса модели занимают около 20 ГБ. В OpenCode модель сейчас доступна бесплатно.
#Nemotron35Lightning #Nemotron35 #Nemotron #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Работает локально, прямо в терминале. Подключаешь любую модель: OpenAI, Anthropic, Gemini, DeepSeek, OpenRouter или локальную через Ollama.
💻 Агент анализирует репозиторий, редактирует файлы, выполняет команды и управляет браузером. Опасные действия требуют подтверждения и выполняются в песочнице. История сессий хранится локально.
Поддерживает MCP, плагины и кастомные скиллы.
#Zero #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
#AppleSilicon #vllmmetal #vllm #mlxlm #MTP #DFlash #MLX #oMLX #MTPLX #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Orchestris состоит из двух частей:
1) Клиент
- Клиент — это быстрая нативная программа, доступная на всех платформах, включая веб. По сути, она мало чем отличается от других чат-клиентов, но при подключении к серверу вам автоматически предоставляется доступ ко всем настроенным для вас моделям, в том числе с открытым или закрытым весом. При подключении к серверу она поддерживает поиск и позволяет создавать API-ключи для ваших агентов. Клиент также поддерживает прямое подключение к моделям через API, подключение к серверу не требуется.
- Версии клиента для Apple App Store и Google Play были отправлены на одобрение в прошлую пятницу, так что, надеюсь, они скоро станут доступны. На данный момент доступны настольные версии, а сервер CE включает в себя веб-клиент.
2) Сервер
По сути, это очень быстрый прокси-сервер, написанный на языке Rust. Однако это не просто прокси-сервер: он позволяет организациям настраивать доступ к моделям для пользователей, отслеживать использование, контролировать расходы и работать с агентами.
(Обсуждение)
#Orchestris #AiChat #AiServer #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
OpenVox только что обновился и теперь включает в себя совершенно новые функции Al Transcription и Al Dubbing, которые позволяют использовать мощные локальные системы преобразования речи в текст и многоязычного дубляжа прямо на вашем Mac.
- Добавлена функция Al Transcription с поддержкой аудио, видео и прямой записи с использованием нескольких локальных моделей распознавания речи.
- Добавлена функция Al Dubbing с синхронизированными скриптами, локальным или внешним переводом с помощью Al, возможностью выбора голоса и экспорта аудио/видео.
- Добавлен прямой импорт SRT-файлов и возможность использования переведенных SRT-файлов для дубляжа.
- Voice Clone теперь может транскрибировать эталонный аудиофайл с помощью Apple Speech или загруженных моделей транскрипции.
- Voice Changer теперь принимает видео на вход и экспортирует видео с преобразованной голосовой дорожкой.
- Добавлены последовательные имена файлов для пакетного экспорта, постоянный текст на всех страницах и элементы управления для быстрой паузы.
- Повышена надежность, производительность, совместимость с медиафайлами и улучшен пользовательский интерфейс.
#OpenVox #Kokoro #Qwen3TTS #Qwen3 #TTS #Chatterbox #Book #AiAudioBook #AiSpeech #AiVoice #MacOS #App #AlDubbing #Parakeet #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM