Local Ai
445 subscribers
914 photos
254 videos
4 files
817 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
Модель: Qwythos-9B: reasoning-модель на данных Claude

Компания Empero выпустила Qwythos-9B-Claude-Mythos-5 — reasoning-модель с окном контекста до 1 млн токенов.

За основу взяли глубоко разцензуренную версию Qwen3.5-9B. Провели полный fine-tune всех параметров и дообучили модель на 500+ млн токенов из датасетов Claude Mythos и Claude Fable.

💻 Для обучения использовали синтетические Chain of Thought, собранные из логов сессий Fable 5 и Mythos 5.
🔗 https://huggingface.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M
=====
Еще: Qwythos-9B-Claude-Mythos-5-1M-uncensored-heretic-GGUF - «Еретик» без цензуры — модель, которая сейчас занимает 3-е место в рейтинге Hugging Face. Согласно эталонным показателям, версия без цензуры набрала немного больше баллов, чем оригинальная модель: 11/100 отказов при 0,00123 KLD.
🔗 https://huggingface.co/llmfan46/Qwythos-9B-Claude-Mythos-5-1M-uncensored-heretic-GGUF
Safetensors: https://huggingface.co/llmfan46/Qwythos-9B-Claude-Mythos-5-1M-uncensored-heretic
(Обсуждение)
#Qwen359B #Qwythos9B #Qwythos9BClaudeMythos5 #uncensored #heretic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👎2
💡 Студия ИИ без Цензуры
Локальная студия искусственного интеллекта без цензуры для Windows, Linux и macOS. Графический интерфейс без настройки для генерации изображений, больших языковых моделей GGUF, преобразования текста в речь и речи в текст!
Локальная студия искусственного интеллекта премиум-класса с нулевой конфигурацией и автономным графическим интерфейсом для Stable Diffusion (генерация изображений), больших языковых моделей (чат), Whisper (преобразование речи в текст) и Kokoro (преобразование текста в речь). Работает на графических и нейронных процессорах с аппаратным ускорением в Windows, Linux и macOS.

Он объединяет четыре основные локальные возможности искусственного интеллекта в один высокопроизводительный настольный интерфейс:

🎨 Генерация изображений (Stable Diffusion): создавайте и редактируйте высококачественные изображения в автономном режиме, используя веса моделей .safetensors, .gguf, или .ckpt .
💬 Текстовый чат (LLM): общайтесь в приватном режиме с языковыми моделями с открытым исходным кодом (формат GGUF), работающими на официальных высокопроизводительных llama.cpp бэкендах.
🎙 Преобразование речи в текст (Whisper): транскрибируйте голосовые записи и речь в текст в режиме реального времени с помощью встроенного whisper.cpp движка.
🗣 Преобразование текста в речь (Kokoro TTS): преобразование текстового вывода в максимально естественный и реалистичный голосовой звук в автономном режиме с помощью модели Kokoro-82M ONNX.
(Настройка)

🔗 https://github.com/techjarves/Uncensored-Local-Studio
🎞 Инструкция https://www.youtube.com/watch?v=qvamkqmLPn8
#Uncensored #LocalStudio #AiStudio #StableDiffusion #Whisper #Kokoro #Windows #MacOS #Linux #БезЦензуры #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
На Reddit уже вовсю обсуждают альтернативу Hugging Face для моделей без цензуры и других модификаций... Которые могут и поудалять с серьезного портала по требованию создателей моделей и/или других сил!
⬇️ https://huggingbay.xyz
Посты в Х:
🔗 https://x.com/Kostoglodov/status/2071144065857679631
🔗 https://x.com/shawmakesmagic/status/2070918006033817867
=============
⬇️ Реестр моделей: https://modelregistry.io
Децентрализованное распространение моделей ИИ с открытым исходным кодом.
Проект: https://github.com/marella/modelregistry
(Обсуждение)
=======
⬇️ https://llama.garden
Проект: https://github.com/etemiz/llama.garden
(Обсуждение)
=======
🏴‍☠️ Нейросети теперь можно качать с торрентов
Появился сайт Pirate Face, который индексирует модели с Hugging Face и создаёт для них magnet-ссылки. В каталоге уже 669 тысяч моделей для текста, кода, изображений, видео и аудио. Есть даже гиганты вроде DeepSeek-V4.1-Flash весом 765 ГБ.
Главная фишка: если модель удалят с Hugging Face, её всё ещё можно будет скачать через торрент — при условии, что кто-то продолжит раздачу.

🔗 https://pirateface.co

#ModelRegistry #Torrent #БезЦензуры #pirateface #modelregistry #huggingbay #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🚀 DeepSeek выпустила DSpark — метод ускорения инференса на 51–400%

DeepSeek представила DSpark — новый подход к спекулятивному декодированию для моделей DeepSeek V4 Flash и V4 Pro. Метод разгоняет пропускную способность инференса от полутора до четырёх раз.

DSpark работает не только с моделями DeepSeek, но и с другими открытыми LLM — например, Gemma и Qwen. Компания опубликовала исходный код, научную статью с описанием и готовую модель на Hugging Face.
🔗 https://github.com/deepseek-ai/DeepSpec
🔗 https://github.com/deepseek-ai/DeepSpec/blob/main/DSpark_paper.pdf
🔗 https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro-DSpark
🎞 Наглядно: https://www.youtube.com/watch?v=J0D7qV3nl7w
#DSpark #DeepSeek #huggingface #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌟 В локального ИИ-ассистента OpenHuman завезли новый режим Super Context — теперь он улавливает контекст при открытии каждого чата, чтобы вам не приходилось объяснять всё каждый раз.
→ Изучает документацию, смотрит ваш экран, проверяет почту и читает логи.
→ Ставит цели, задачи и план для любой задачи.
→ Работает на уровне ОС и интегрируется со 118 приложениями.
→ Запускается 100% локально, данные никогда не покидают ваш ПК.
→ Со временем адаптируется к вашему стилю работы и экономит токены.

Ваш личный ИИ-ассистент, которой помнит всё https://tinyhumans.ai/openhuman
Проект: https://github.com/tinyhumansai/OpenHuman
#OpenHuman #AiAgent #AgentAi #LocalAi #AiLocal
✈️ TurboLLM - Запускайте любую локальную модель LLM, автоматически настроенную под ваш графический процессор, с удобным веб-интерфейсом и API, совместимым с OpenAI/Anthropic.
Используйте свой форк llama.cpp. Без компиляции. Без Electron. Без Python. Укажите Claude Code на свой компьютер с помощью одной команды — полностью в автономном режиме. Быстрее LM Studio!
🔗 https://github.com/mohitsoni48/TurboLLM
#TurboLLM #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Ornith-1.0 — это семейство языковых моделей с открытым исходным кодом, предназначенных для агентного программирования.
Вышли: 9B Dense, 31B Dense, 35B MoE, и 397B MoE
Особенности:
- Современные агенты для написания кода: доступны в версиях 9B-Dense, 31B-Dense, 35B-MoE и 397B-MoE (дообучена на основе Gemma 4 и Qwen 3.5). По сравнению с моделями открытого исходного кода сопоставимого размера демонстрируют лучшую производительность в таких бенчмарках, как Terminal-Bench 2.1, SWE-Bench, NL2Repo и OpenClaw.
- Самосовершенствующаяся обучающая система: Ornith-1.0 использует метод обучения с подкреплением, чтобы научиться генерировать не только развертки решений, но и структуру, которая управляет этими развертками. Благодаря совместной оптимизации структуры и получаемого решения модель находит более эффективные траектории поиска и генерирует решения более высокого качества.
- Лицензия: лицензия MIT, глобальный доступ и отсутствие региональных ограничений.

Все тут: https://huggingface.co/collections/deepreinforce-ai/ornith-10
- Ornith-1.0-9B https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF
- Ornith-1.0-35B https://huggingface.co/deepreinforce-ai/Ornith-1.0-35B-GGUF
(Обсуждение) и Ornith-1.0 9B превосходит Qwen 3.6 35B по различным показателям!
#Ornith #Ornith10 #AiAgent #AgentAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
📊 ModelFit — набор данных о совместимости локального оборудования с большими языковыми моделями

Набор данных о совместимости локальных больших языковых моделей

Карта, на которой видно, какие локальные языковые модели подходят для каждого уровня оперативной памяти — от 8 до 128 ГБ!
93 модели с разбивкой по параметрам, квантованию и нагрузке на память. Работают локально на Apple Silicon и графических процессорах NVIDIA. Бесплатно по лицензии CC BY 4.0. Обновлено 26 июня 2026 года.
🔗 https://modelfit.io/data/
Проект: https://github.com/Wecko-ai/modelfit-hardware-dataset
(Обсуждение)
#ModelFit #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Вышла nvidia/ Qwen3.6-27B-NVFP4
🔗 https://huggingface.co/nvidia/Qwen3.6-27B-NVFP4
Input Type(s): Text, Image, Video
Input Format(s): String, Red, Green, Blue (RGB), Video (MP4/WebM)
Context length up to 262K
(Обсуждение)
#Qwen36 #Qwen3627BNVFP4 #NVFP4 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 LokalBot - помощник для ведения заметок на совещаниях, учета рабочего времени и копирования.

Записывайте совещания, дополняйте текст и следите за тем, как прошел ваш день, — и все это на устройстве. Без аккаунта, без API-ключей, без облака.
LokalBot — это локальное рабочее пространство с искусственным интеллектом для macOS. Оно записывает обе стороны разговора, расшифровывает и обобщает его, индексирует все данные для поиска, отслеживает, как вы проводите свой день, и — с помощью Cotyping — предлагает варианты текста по мере его ввода в любом приложении. Все модели работают на устройстве на Apple Silicon, поэтому ваши аудиозаписи, расшифровки и заметки никогда не попадают на сервер.

Стек моделей:
- Summaries, чат и котинг работают на объединенном llama.cpp — внутрипроцессном libllama для обеспечения низкой задержки котинга, llama-server в остальных случаях. Настройте любой из них на свой собственный GGUF, Ollama или OpenAI-совместимую конечную точку или Apple Intelligence.

- Транскрипция: Granite Speech 4.1 / Parakeet / Whisper / Qwen3-ASR через CoreML/MLX на Neural Engine. Производительность Parakeet ~190× от реального времени.

- Семантический поиск: Qwen3-Embedding 0,6 млрд GGUF в секунду llama-server (--embeddings), векторы в SQLite, косинусное сходство методом полного перебора. В личном масштабе «метод полного перебора» — это просто «мгновенно», и он не требует дополнительных зависимостей.

- Диарризация: дополнительная пианнота (через FluidAudio) для разделения "Them" на "Them 1" и "Them 2".

- Встроенный в приложение браузер Hugging Face для поиска и загрузки GGUF с рекомендациями по совместимости с аппаратным обеспечением для каждой модели.

Настройки, которые автор считает оптимальными для реального использования (может ошибаться):
- Транскрипция: IBM Granite Speech 4.1 (2B) Q4
- Обобщение: Qwen 3.6 35B-A3B Q4_K_M
- Копирование: Gemma 4 E4B Q5 XL

Конфиденциальность — вот в чем суть. Единственный сетевой вызов — это однократная загрузка модели; после этого она работает полностью в автономном режиме. Покажите ее Little Snitch во время совещания и насладитесь самым плоским сетевым графиком, который вы когда-либо видели. Дополнительные скриншоты защищены алгоритмом AES-GCM и автоматически удаляются.
Только Apple Silicon / macOS 15+. Он интегрирован с Neural Engine, MLX и Core Audio, поэтому не работает на Linux/NVIDIA.

🔗 https://www.lokalbot.com
🔗 https://github.com/stevyhacker/lokalbot
(Обсуждение)
#LokalBot #MacOS #Gemma4 #GraniteSpeech #Parakeet #Whisper #Транскрибация #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: 📖 PageStorm: модель, созданная для написания художественных книг!
LongPage для творческого письма в масштабах книги.
Статья: https://arxiv.org/abs/2605.17064
Модели: https://huggingface.co/collections/Pageshift-Entertainment/pagestorm-research-preview
(Обсуждение)
#PageStorm #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: SenseNova-U1-8b-MoT-Infographic-V2 — лучший в своем классе инструмент с открытым исходным кодом для создания инфографики и редактирования изображений.
Ниже перевод поста с Reddit:
Я довольно пресыщен, как и большинство из вас. Меня уже не особо впечатляют новые модели. Последние несколько недель были так себе, если честно. В понедельник я наткнулся на модели Mixture of Transformers от SenseNova, и они кажутся чем-то особенным по сравнению с другими типичными моделями для генерации изображений.
Мне удалось запустить пару из них, и должен сказать, что эта серия моделей впечатляет меня, когда дело касается создания и редактирования плотной инфографики.

Я не видел ничего, кроме Ideogram 4, что могло бы сравниться с ними по качеству инфографики. Ideogram 4 — отличный инструмент, но у Ideogram ужасная лицензия, а у SenseNova — лицензия Apache 2, так что в моем рейтинге они вне конкуренции.

Я знаю, знаю, что последняя версия SenseNova-u1, версия 2, еще не в формате GGUF, но это не проблема. Вот что я сделал и что можете сделать вы: скажите своей любимой среде разработки, чтобы она «взяла модель SenseNova, обернула ее в FastAPI и использовала как конечную точку для генерации изображений, совместимую с OpenAi, и конечную точку для редактирования изображений в одном Docker-контейнере». Дайте этому немного времени, и вуаля — дело в шляпе. Через некоторое время у вас появится конечная точка API для генерации изображений, которую вы сможете использовать в своем любимом чат-клиенте в качестве генератора/редактора изображений. Это позволит вам обойтись без всего этого спагетти-интерфейса ComfyUI. Я никогда не был фанатом ComfyUI и вряд ли когда-нибудь стану. Передумал.

Вы можете попробовать несколько разных версий моделей SendeNova U1. Если захотите.

Модель Infographic V2 вышла всего пару дней назад и представляет собой базовую модель 50 Step. Кстати, она может создать практически любое изображение, просто она обучена делать инфографику очень хорошо.

https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic-V2

Инфографика V1 8-шаговая LORA — это модель слияния «флеш-типа» более низкого качества, которая работает очень быстро, но, очевидно, не так качественно, потому что 8 шагов — это меньше, чем 50 (ну конечно).

https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-LoRAs/blob/main/SenseNova-U1-8B-MoT-Infographic-LoRA-8step-V1.0.safetensors

Также доступна база Infographic V1 50 Step, но нет смысла ее использовать, если только вы не хотите использовать ее с 8 Step LoRA для высокоскоростной генерации.

https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic

Недавно они также выпустили очень интересную модель «Перекрестных изображений».

https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Interleaved

Версия с чередованием позволит вам сгенерировать серию связанных изображений с одинаковыми персонажами, шрифтами, цветами и т. д. С ее помощью можно создавать презентации с единой темой, сборники рассказов и т. д. Версию с чередованием нужно обрабатывать по-другому, потому что стандартная конечная точка генератора изображений, совместимая с OpenAI, пока не поддерживает несколько изображений. Поэтому вам нужно создать конвейер инструментов с событиями-эмиттерами, чтобы генерировать несколько изображений в одном чате. Я уверен, что ваша система сможет разобраться, как это сделать, — моя смогла.

В любом случае, мне показалось, что эти модели интересны и их приятно запускать. Для полной версии bf16 вам, вероятно, понадобится около 36 ГБ видеопамяти, но есть и другие варианты. Думаю, самому маленькому из тех, что я видел, требовалось около 16 ГБ.

#SenseNovaU1 #Infographic #Инфографика #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Gemma4-26B-A4B и 31B-QAT без цензуры, сбалансированные, с MTP (увеличение скорости на 35% и 53%)!

Сбалансированный = легкая вводная часть с рассуждениями о самых острых темах перед тем, как дать полный ответ. Никаких изменений в характере и тому подобного. Это ОРИГИНАЛЬНЫЕ версии Gemma4-26B-A4B-QAT и Gemma4-31B-QAT без цензуры. Для этих выпусков агрессивный вариант не требуется.

НОВОЕMTP на обеих (многотокеновая предварительная головка для спекулятивного декодирования): примерно на 35 % быстрее на 26B-A4B и на 53 % быстрее на 31B, с идентичным результатом (модель проверяет каждый подготовленный токен, что обеспечивает высокую скорость без ущерба для качества). (Черновики MTP предоставлены командой Unsloth — спасибо!)

🔗 https://huggingface.co/HauhauCS/Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-MTP

🔗 https://huggingface.co/HauhauCS/Gemma4-31B-QAT-Uncensored-HauhauCS-Balanced-MTP
(Подробнее и Обсуждение)
#Gemma4 #Gemma426B #Gemma431B #QAT #Uncensored #MTP #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM