Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
Модель: Qwopus-3.6-27B-Coder с MTP!
Ускорение MTP: ~2,07 раза (60,9 → 119,0 т/с). Соответствует заявленному диапазону ~1,66–2 раза для этой модели.
🪐 Qwopus-3.6-27B-Coder — это агентная модель кодирования с расширенными возможностями логического вывода, созданная на основе Qwopus3.6-27B-v2. Модель унаследовала мощную основу для логических рассуждений от версии 2, которая показала результаты 87,43 % на MMLU-Pro (300 примеров) и 75,25 % на SWE-bench Verified, и была доработана для генерации агентного кода, структурированного вызова инструментов, отладки и выполнения инструкций в рабочих процессах разработчиков. Модель предназначена для решения задач кодирования на уровне репозитория, многопоточной оркестровки инструментов и сложных логических рассуждений в реалистичных средах с участием агентов.

🔗 https://huggingface.co/Jackrong/Qwopus3.6-27B-Coder-MTP-GGUF
(Обсуждение)
#Qwopus #Qwopus3627BCoder #MTP #Coder #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Gemma 4, 12B, 12B QAT, 26B-A4B QAT и 31B QAT. Еретики без цензуры!

👉 gemma-4-31B-it-qat-q4_0-unquantized-uncensored-heretic:
- Safetensors: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-unquantized-uncensored-heretic
- GGUF: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-NVFP4-GGUF
- GPTQ-Int4: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-GPTQ-Int4

👉 gemma-4-26B-A4B-it-qat-q4_0-unquantized-uncensored-heretic:
- Safetensors
: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-unquantized-uncensored-heretic
- GGUF: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-NVFP4-GGUF
- GPTQ-Int4: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-GPTQ-Int4

👉 gemma-4-12B-it-qat-q4_0-unquantized-uncensored-heretic:
- Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-unquantized-uncensored-heretic
- GGUF: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-uncensored-heretic-NVFP4-GGUF

👉 gemma-4-12B-it-uncensored-heretic:
- Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic
- GGUFs: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic-NVFP4-GGUF

Автор даже сделал несколько NVFP4 Safetensors и NVFP4 GGUF на базе стандартной Gemma 4 31B, потому что кто-то их заказал::
👉 gemma-4-31B-it-uncensored-heretic:
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-31B-it-uncensored-heretic-NVFP4
- NVFP4 GGUFs: https://huggingface.co/llmfan46/gemma-4-31B-it-uncensored-heretic-NVFP4-GGUF

Все модели этого автора: https://huggingface.co/llmfan46/models
(Обсуждение)
============
Есть еще версии в виде нафайнтюненых на кодинге, типа:
- yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
- llmfan46/gemma-4-12B-coder-fable5-composer2.5-v1-uncensored-heretic-GGUF

#Gemma4 #Heretic #БезЦензуры #Uncensored #QAT #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Nex-N2-mini - на базе Qwen3.5-35B-A3B-Base
Nex-N2 с открытым исходным кодом — агентная модель, созданная для решения реальных задач, связанных с производительностью. Благодаря первоклассной кодировке и агентным возможностям Nex-N2 продолжает выполнять сложные задачи с долгосрочными целями в реальных условиях, обеспечивая стабильные комплексные результаты.
Nex-N2 выпускается в двух вариантах, оба прошли постобработку на базе серии Qwen3.5: Nex-N2-Pro (на базе Qwen3.5-397B-A17B) и Nex-N2-mini (на базе Qwen3.5-35B-A3B-Base), с разными компромиссами в отношении задержки и качества. В таблице (на снимке) приведены их оценки в сравнении с ведущими проприетарными и открытыми моделями по результатам нашего комплексного тестирования.
🔗 https://huggingface.co/nex-agi/Nex-N2-mini
(Обсуждение)
#NexN2 #NexN2mini #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💻 Ironsmith - Мгновенно создавайте персональные приложения для Mac с помощью локальных и облачных языковых моделей!

Ironsmith живет в вашей строке меню. Опишите, что вам нужно, и оно создаст для вас нативное приложение для Mac. Бесплатно, с открытым исходным кодом.
Ironsmith — это бесплатное приложение с открытым исходным кодом для macOS, которое позволяет создавать небольшие персональные приложения для Mac с помощью ИИ. Опишите, что вам нужно, и Ironsmith сгенерирует, соберет и сохранит нативное приложение SwiftUI, которое вы сможете запускать, редактировать и экспортировать в папку «Программы».

Что он Делает:
- Создает настоящие приложения для Mac. Сгенерированные приложения написаны на Swift и SwiftUI, в них нет Electron.

- Отображается в строке меню. С его помощью очень удобно создавать новые приложения, запускать сохраненные приложения, редактировать существующие, восстанавливать предыдущие версии, просматривать код или экспортировать готовый пакет приложения.

- Работает с локальным ИИ. Ironsmith разрабатывался с учетом поддержки локального ИИ и изначально поддерживает Ollama. Вы также можете подключить любой API, совместимый с OpenAI, поэтому LM Studio и Llama.cpp тоже отлично работают. Вы даже можете создавать очень простые приложения с помощью встроенной в Apple модели Foundation.

- Поддерживаются и размещенные модели. Используйте свои API-ключи для OpenAI, Anthropic и Gemini или не используйте их, а войдите в Ironsmith, чтобы получить к ним мгновенный доступ.

- Не требует Xcode. Каждое сгенерированное приложение представляет собой пакет Swift и полностью собирается с помощью облегченных инструментов командной строки Xcode, а не полноценного Xcode. На самом деле сам Ironsmith даже не использует Xcode!

- По умолчанию все приложения изолированы в «песочнице». Создаваемые приложения представляют собой подписанные пакеты с включенной «песочницей» и усиленной средой выполнения, что значительно снижает вероятность возникновения ошибок, сбоев или вредоносных действий. Также необходимо явно разрешить доступ к конфиденциальным данным, таким как камера и микрофон. Однако вы можете отключить эти средства защиты, но в этом случае настоятельно рекомендуется проверить код перед запуском.

🔗 https://ironsmith.app
Проект: https://github.com/Jeidoban/Ironsmith/
(Подробнее и Обсуждение)
#Ironsmith #MacOS #AiSoft #SoftAI #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
✈️ Deepseek 4 можно запустить на Mac (M3 Max, 96 ГБ)

Такое возможно с помощью https://github.com/antirez/ds4#running-models-larger-than-ram специального движка от Antirez и его специальной ds4 gguf это буквально работает само собой.
(Подробнее и Обсуждение)
#Deepseek4 #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📖 Статья: Локальные модели в середине 2026 года: разработка, которая устранила отставание
🔗 https://coles.codes/posts/local-models-mid-2026/
(Обсуждение) #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Модель: ZONOS2: синтез речи в реальном времени с 8 миллиардами параметров, 900 миллионами активных элементов и высокоточным клонированием голоса!
Компания Zyphra выпустила ZONOS2, модель преобразования текста в речь в режиме реального времени нового поколения, ориентированную на выразительное и точное клонирование голоса. Она распространяется с открытым исходным кодом по лицензии Apache 2.0, а также доступна в Zyphra Cloud на оборудовании AMD.

Модель призвана решить проблему, связанную с обычным компромиссом между качеством и скоростью преобразования текста в речь. По словам представителей Zyphra, ZONOS2 — это первая разреженная модель преобразования текста в речь с открытым исходным кодом, с 8 миллиардами общих параметров и 900 миллионами активных параметров при выводе. Цель проста: быстрый, эффективный и выразительный синтез речи без обычного наложения звуков.

Основное внимание уделяется клонированию голоса. Компания Zyphra утверждает, что ZONOS2 особенно хорошо улавливает отличительные черты говорящего, создавая более естественные клоны самых разных голосов. Клонирование происходит без предварительного обучения, поэтому не требует тонкой настройки.

Что касается звука, ZONOS2 прогнозирует токены Descript Audio Codec (DAC) для звука студийного качества с частотой 44,1 кГц. Это обеспечивает более высокое качество воспроизведения, но его сложнее смоделировать, чем кодеки более низкого качества. В Zyphra утверждают, что устраняют этот недостаток за счет более масштабной модели и обучения на больших массивах данных.

Для обработки текста ZONOS2 не использует фонематический анализатор. Вместо этого он считывает необработанные байты в кодировке UTF-8, что, по словам разработчиков Zyphra, улучшает охват языков с ограниченными ресурсами, повышает производительность при работе с китайским, корейским и японским языками, а также поддерживает переключение между языками в середине предложения.

Кроме того, значительно увеличилось время обучения — примерно с 200 000 часов до 6 миллионов с лишним часов аудио. По словам представителей Zyphra, они использовали поэтапную фильтрацию данных с постепенным ужесточением требований к согласованности транскриптов на этапах предварительного обучения, среднего обучения и отжига. Предполагаемый результат — уменьшение количества галлюцинаций, неправильного произношения и повторов.

Zyphra также представляет ZTTS1-Eval, новый эталон для оценки систем преобразования речи в текст. Он включает в себя чистые и реальные наборы данных на 17 языках, а также новые модели оценки, такие как Qwen3-ASR, ReDimNet и MSR-UTMOS, и метрики просодии.

В этом вся суть. Большая модель, открытые веса, лицензия Apache 2.0, клонирование голоса и достаточная инфраструктура, на фоне которой старая базовая модель преобразования текста в речь выглядит как металлолом.

Блог: https://zyphra.com/our-work/zonos2
Веса: https://huggingface.co/Zyphra/ZONOS2
Код для логического вывода: https://github.com/Zyphra/ZONOS2
Код для оценки: https://github.com/Zyphra/ZTTS1-Eval
(Обсуждение)
#ZONOS2 #TTS #AiVoice #VoiceAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Статья: Как за один вечер разгрести 36 000 фотографий и почту с 2005 года, руками AI-агента и локальных моделей
https://habr.com/ru/articles/1047274/
Модель: SIQ-1-35B
На основе Qwen-35B-A3
Пост про нее: https://t.me/lovedeathtransformers/10758
На karpathy/autoresearch для parameter-golf → превосходит GLM-5.2 и Qwen-350B, а идеи, которые он выдает, напоминают Opus4.8
На bullshit-bench превосходит NEX и GPT-5.5

Модель + GGUF: https://huggingface.co/AlexWortega/SIQ-1-35B
Агент и демонстрация работы на ZeroGPU: https://huggingface.co/spaces/AlexWortega/hermes-agent-zerogpu
(Обсуждение)
#SIQ135B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📺 AeroLLM - Локальное приложение для чата с большими языковыми моделями для компьютеров Apple Silicon Mac.

В отличии от LM Studio он поддерживает модели синтеза речи и распознавания речи.
Локальное приложение для чата с большими языковыми моделями для компьютеров Apple Silicon Mac. Оно просматривает и загружает модели с сайта Hugging Face, запускает их на устройстве с помощью MLX и может предоставлять API, совместимый с OpenAI, для других приложений. Вычисления выполняются локально. Приложение использует только сеть Hugging Face для поиска и загрузки моделей, а также дополнительную функцию распознавания речи, которая загружается при установке.

Характеристики:
- Чат с потоковой передачей ответов. Markdown, математические формулы в KaTeX, диаграммы Mermaid и код с подсветкой синтаксиса. Выбор модели для каждого чата, редактирование сообщений, навигация по веткам и история переписки с поиском.
- Модели. Поиск моделей MLX на Hugging Face и их загрузка. Загрузка возобновляется после прерывания и отображается в док-панели.
- Библиотека. Управление загруженными моделями: загрузка, выгрузка, установка по умолчанию или удаление.
- Сервер. Дополнительная конечная точка, совместимая с OpenAI (/v1/chat/completions, /v1/models). По умолчанию отключена. Привязывается к локальному хосту, если только вы не включите доступ по локальной сети и не укажете ключ API.
- Речь. Дополнительная функция преобразования текста в речь и речи в текст. Требуется установка среды выполнения mlx-audio. Для записи требуется доступ к микрофону.

Приложение подписано вручную, поэтому при первом запуске macOS Gatekeeper блокирует его. Чтобы открыть его, щелкните правой кнопкой мыши по приложению и выберите «Открыть», затем нажмите «Открыть» в диалоговом окне или выполните следующую команду в Терминале:
xattr -dr com.apple.quarantine /Applications/AeroLLM.app
После этого он открывается как обычно.

🔗 Проект: https://github.com/mahiatlinux/aerollm
⬇️ Скачать: https://github.com/mahiatlinux/aerollm/releases (AeroLLM-0.1.0-arm64.dmg)
(Обсуждение)
#AeroLLM #MLX #MacOS #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Keye-VL-2.0-30B-A3B -распознавание длинных видео

Познакомьтесь с Keye-VL-2.0-30B-A3B — новейшей флагманской базовой моделью класса 30B в серии Keye, специально разработанной для решения задач, связанных с распознаванием длинных видео, и реализации возможностей первого поколения агентов семейства Keye.

Основные моменты:
Превосходное понимание видео и временная локализация: по пяти видеотестам Keye-VL-2.0-30B-A3B опережает конкурентов с открытым исходным кодом и не уступает или даже превосходит Gemini-3-Flash по временной локализации.

Архитектура с поддержкой длинных контекстов на основе DSA: разреженное внимание и целенаправленная агрегация признаков обеспечивают точное понимание видео продолжительностью в час при сохранении эффективности вычислений.

Высокоэффективный стек для логического вывода и обучения: DSA (DeepSeek Sparse Attention), ExtraIO, гетерогенный параллелизм ViT-LM, оптимизация активации и пользовательские ядра снижают затраты на предварительное заполнение длинных последовательностей и повышают производительность обучения.

Мультимодальное предварительное обучение с ориентацией на данные: тщательно отобранный набор данных, визуальный кодировщик Keye-VL-1.5 и синтетические данные CoT улучшают восприятие, распознавание текста, понимание диаграмм и таблиц, а также логическую последовательность.

Надежная пост-обработка для достоверного логического вывода: MOPD, масштабирование с учетом преимуществ сегментирования, Context-RL и фильтрация данных с высоким соотношением сигнал/шум улучшают межмодальное объединение экспертных знаний, уменьшают количество ложных срабатываний и стабилизируют принятие решений с учетом контекста.

Мультимодальные возможности для агентов: встроенные функции агента для работы с кодом, инструментами и поиском поддерживают задачи, связанные с репозиториями, использование инструментов в стиле API, веб-поиск и визуальные рабочие процессы самокоррекции.

Keye-VL-2.0-30B-A3B — первая мультимодальная модель, в которой технология DSA внедрена в производственный процесс. Она обеспечивает практически безошибочное распознавание сверхдлинного контекста длиной до 256 тысяч символов. Она превосходит другие модели по скорости обработки видео и не уступает — а то и превосходит — топовые модели с закрытым исходным кодом в области детализированного восприятия временных последовательностей. Что еще важнее, это первая базовая модель Keye со встроенным механизмом взаимодействия агентов, демонстрирующая надежную системную оркестровку в сценариях поиска, инструментов и кода.

🔗 https://huggingface.co/Kwai-Keye/Keye-VL-2.0-30B-A3B-GGUF
(Обсуждение)
#Keye #KeyeVL #KeyeVL2030BA3B #AiVideo #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💬 Gemma 4 E2B работает в браузере со скоростью 255 токенов в секунду (на M4 Max), используя ядра WebGPU, написанные на Fable 5

Gemma 4 E2B (QAT Mobile) — мощная модель с открытым исходным кодом — полностью работает на устройстве с использованием WebGPU. После первой загрузки веса кэшируются локально, и введенные вами данные никогда не покидают ваш компьютер.
🔗 Demo (+ kernels): https://huggingface.co/spaces/webml-community/gemma-4-webgpu-kernels
🔗 Model: https://huggingface.co/google/gemma-4-E2B-it-qat-mobile-transformers
Файлы: https://huggingface.co/spaces/webml-community/gemma-4-webgpu-kernels/tree/main
(Обсуждение)
#Gemma4 #Gemma4E2B #WebGPU #QAT #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Обсуждение: На M5 Max MacBook Pro с 128gb RAM какие модели можно запускать?
https://www.reddit.com/r/LocalLLaMA/comments/1u8y7yz/i_have_a_m5_max_macbook_pro_with_128gb_of_ram/
В рекомендациях:
- Deepseek 4 Flash https://github.com/antirez/ds4
- MiniMax-M3 на https://vmlx.net
- Qwen 3.6 27B и 35B с MTP
- Gemma4 и другие...
#MacOS #MiniMaxM3 #Deepseek4Flash #AiModel #ModelAi #LocalAi #AiLocal
Модель: Qwen3.6-27B-MTP-pi-tune
4-битная модель QLoRA SFT Multi-Token Prediction на основе Qwen3.6-27B, доработанная для не требующего размышлений агентного программирования с помощью платформы PI. Упакована в GGUF, совместимый с llama.cpp, для локальных агентных циклов.
🔗 https://huggingface.co/bytkim/Qwen3.6-27B-MTP-pi-tune-GGUF
(Обсуждение)
#Qwen36 #Qwen3627B #Qwen3627BMTPpitune #MTP #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📹 Локальный поиск по видеоархиву с помощью ИИ

Edit Mind: локальная база знаний о видео!
Edit Mind позволяет индексировать ваши видео (включая расшифровку, анализ кадров и мультимодельное встраивание), а также искать видео (или отдельные сцены) с помощью естественного языка.

Разработчик выпустил Edit Mind — опенсорс-инструмент, который индексирует видео и позволяет искать нужные кадры через текстовый запрос.

Как работает: загружаешь ролики, ИИ автоматически описывает каждую сцену. После этого можно найти момент по запросу вроде «человек едет на велосипеде по лесу» и сразу перенести его в монтаж.

Всё работает локально — автор прогнал 628 GoPro-роликов (669 ГБ) на MacBook M1 Max. Индексация заняла время, но результат того стоил.

🔗 https://github.com/iliashad/edit-mind
🎞 Демо: https://www.youtube.com/watch?v=YrVaJ33qmtg
🔗 https://iliashaddad.com/blog/i-indexed-669-gb-of-my-gopro-videos-using-my-m1-max-computer
🎞 Настройка: https://www.youtube.com/watch?v=WVNuP8ic3uY
🔗 Готовое для ПК: https://edit-mind.com (Оптимизирован для Apple Silicon и Windows с поддержкой графического процессора NVIDIA)
#EditMind #AiVideo #AiSoft #MacOS #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Статья: OCC-RAG: компактные модели, которые отвечают только по источникам
https://habr.com/ru/companies/airi/articles/1047624/