Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
🎬 NexVid — расширение для апскейла видео прямо в браузере

🌐 Работает в Chrome и Firefox, улучшает качество видео на лету с помощью GPU. В арсенале — больше 15 профилей апскейла и 30+ WebGL-шейдеров.

💻 Можно настроить FPS, выставить порог разрешения для обработки и использовать встроенный видеоплеер. Всё локально, без отправки данных куда-то вовне.
NexVid — это лёгкое браузерное расширение для масштабирования и улучшения качества видео в реальном времени. Оно использует обработку Anime4K с ускорением на графическом процессоре, продвинутые фильтры и большую библиотеку шейдеров WebGL для улучшения качества аниме, мультфильмов, фильмов, музыкальных клипов и других веб-видео прямо в вашем браузере. Выбирайте из более чем 15 профилей качества масштабирования Anime4K, настраивайте целевой показатель FPS в соответствии с возможностями вашего оборудования, устанавливайте порог разрешения, чтобы не обрабатывать видео с высоким разрешением, и создавайте собственный набор улучшений, не загружая медиафайлы.

Особенности:
- Масштабирование в реальном времени с профилями от самого быстрого до максимально качественного.
- Управление производительностью, в том числе настройка целевого количества кадров в секунду и автоматическая обработка пороговых значений разрешения.
- Более 30 шейдеров WebGL в категориях ретро, свечения, глитча, хроматизма, художественных эффектов, аниме и экспериментальных категорий сверхвысокого разрешения.
- Расширенные фильтры и элементы управления изображением, в том числе яркость, насыщенность, контрастность, оттенки серого, сепия, поворот оттенка, размытие, гамма, тиснение, морфология, нерезкая маска и повышение резкости.
- Настраиваемые параметры шейдера, а также сохранение и загрузка предустановок для создания полноценных цепочек эффектов.
- Встроенный локальный видеоплеер для применения масштабирования, фильтров и шейдеров к локальным видеофайлам.
- Интерфейс доступен на английском, французском, испанском и упрощенном китайском языках.
- Обработка данных выполняется локально в браузере, что обеспечивает конфиденциальность.

Идеально подходит для пользователей, которым нужны более четкие линии, детализация и стилизованное воспроизведение без выхода из браузера.

🔗 https://chromewebstore.google.com/detail/nexvid-real-time-video-up/hiocbajaikpcckgeagcngaeoioncmbim
🔗 https://addons.mozilla.org/fr/firefox/addon/nexvid-realtime-video-upscaler/
🎞 https://www.youtube.com/watch?v=BNfx5D6811g
#NexVid #Anime4K #Chrome #Firefox #AiVideo #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Хорошие статьи:
Как я запускал Qwen 3.5 на Mac: бенчмарк 8 локальных LLM-серверов. Кто быстрее?
https://habr.com/ru/articles/1024880/

Пробуем использовать локальные LLM для написания кода
https://habr.com/ru/articles/1024884/
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Web Bro - полностью браузерный агент Gemma 4 с реальным доступом к файловой системе (WebGPU + ONNX, без установки, без сервера)

Web Bro — локального агента для кодирования и исследований в области ИИ, который работает локально в вашем браузере.

Что это такое:
- Запускает Gemma 4 E2B-it ONNX квантованную модель прямо в браузере с помощью WebGPU
- Не требует установки, не требует серверной части, не требует API-ключей — все остается на вашем компьютере
- Вы можете выбрать любую локальную папку в качестве рабочей области с помощью API доступа к файловой системе
- Агент может выводить список файлов, искать текст, читать, редактировать и записывать файлы прямо в вашу реальную файловую систему
- Перед каждой записью автоматически создаются снимки предыдущих версий файлов в IndexedDB → можно легко отменить изменения
- Все чаты, сеансы и настройки сохраняются локально

По сути, это полностью клиентский ИИ-агент, ориентированный на конфиденциальность, который можно использовать для написания кода, исследований, ведения заметок и т. д. без передачи данных с вашего компьютера.

Демо:https://aeroxy.github.io/web-bro
GitHub: https://github.com/aeroxy/web-bro
(Обсуждение)
#WebBro #WebGPU #ONNX #Gemma4 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
⚛️ Вышел Open WebUI для настольных компьютеров!

Ваш ИИ прямо на вашем рабочем столе. Откройте веб-интерфейс в виде нативного приложения. Запускайте модели локально или подключайтесь к любому серверу. Никакого Docker, терминала и настроек. Скачайте, запустите, общайтесь.
Основные моменты:
⚡️ Spotlight. Нажмите Shift+Cmd+I (macOS) или Shift+Ctrl+I (Windows/Linux), чтобы вызвать плавающую панель чата поверх того, что вы делаете. Перетащите ее, чтобы сделать снимок экрана с любой частью экрана.
🎙 Голосовой ввод. Системная функция «нажми и говори». Нажмите сочетание клавиш в любом приложении, чтобы начать запись. Ваша речь будет автоматически расшифрована и отправлена в чат.
🧠 Локальный вывод. Загружайте и запускайте модели на своем устройстве. Ваши данные никогда не покинут ваш компьютер.
🎯 Настройка в один клик. Все устанавливается автоматически. Просто нажмите «Начать».
🔌 Несколько подключений. Легко переключайтесь между серверами.
🔄 Автоматические обновления. Новые версии устанавливаются в фоновом режиме.
📡 Возможность работы в автономном режиме. После первоначальной настройки подключение к интернету не требуется.
💻 Кроссплатформенное решение. macOS, Windows и Linux.

Распознавание речи, изображений, извлечение данных, генерация, поиск. Расширяйте возможности с помощью Python. Готово к использованию с первого дня.
Инструменты: RAG, поиск, исполнение.
Модели: https://openwebui.com/models

🔗 https://openwebui.com
🔗 https://github.com/open-webui/desktop
🔗 https://github.com/open-webui/open-webui
(Обсуждение)
Очень много всего устанавливается при 1 запуске...
#OpenWebUI #WebUI #macOS #Windows #Linux #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Модель: Новые модели - новые рейтинги!

🇨🇳 Kimi 2.6 стремительно всех подвинула! Но что удивительно и восхитительно - локальные модели все равно на 7 месте и ниже... Из топа 14 - 5 локальных, которые можно запускать дома! А если иметь Mac Studio 512 Gb - то этот список будет еще больше!
А если все таки выйдет Mac Studio M5 Ultra 1Tb. - то вообще на нем можно будет запустить эту новую Kimi 2.6 на 1.1 Т параметров! А к тому моменту (конец 26, начало 27 года) и модели выйдут еще покруче! Тренд радует!
(Обсуждение)
#AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Chaperone-Thinking-LQ-1.0 - Медицинская

Открыли исходный код Chaperone-Thinking-LQ-1.0 — 4-битной модели GPTQ + QLoRA, доработанной DeepSeek-R1-32B, которая показывает результат 84 % на MedQA при размере модели ~20 ГБ.
Она основана на DeepSeek-R1-Distill-Qwen-32B, но выходит далеко за рамки простого квантования.
Целевое использование:
- Задачи, связанные с медицинскими и клиническими рассуждениями
- Научные вопросы и ответы, а также исследовательские процессы
- Корпоративные развертывания, требующие суверенитета данных (локальные системы, частное облако)
- Анализ текста и извлечение полезной информации с учетом предметной области
Вот что сделали:
- 4-битное квантование GPTQ — сжатие модели с ~60 ГБ до ~20 ГБ
- Обучение с учетом квантования (Quantization-aware training, QAT) с помощью GPTQ и калибровкой для минимизации потери точности
- Тонкая настройка QLoRA на медицинских и научных корпусах
- Убран адаптивный слой идентификации для обеспечения прозрачности — модель корректно приписывает свою архитектуру оригинальной работе DeepSeek

MedQA — это то, что нужно: точность 84 %, что на 4 % меньше, чем у GPT-4o (~88 %), при этом модель работает на одном графическом процессоре L40/L40s.

Скорость: 36,86 токенов в секунду против 22,84 токенов в секунду у базовой модели DeepSeek-R1-32B — примерно в 1,6 раза быстрее и со средней задержкой на ~43 % ниже.

Зачем это сделали: нужна была модель логического вывода, которую можно было бы использовать локально для корпоративных клиентов в сфере здравоохранения со строгими требованиями к суверенитету данных. Никаких вызовов API в OpenAI, никаких данных, покидающих пределы здания. Оказывается, при правильной оптимизации можно добиться практически максимальной производительности за небольшую часть стоимости.

🔗 https://huggingface.co/empirischtech/DeepSeek-R1-Distill-Qwen-32B-gptq-4bit
Подробно: https://chaperoneai.net/benchmark
(Обсуждение)
#MedQA #Chaperone #chaperoneAi #DeepSeek #MedAi #AiMed #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Lekh AI - Local AI Studio

Lekh AI локальный ИИ на iPhone и iPad - полностью конфиденциально и в автономном режиме. Интернет не требуется, подписки не нужны, и ваши разговоры никогда не покидают ваше устройство. Теперь на 27 языках!
МОЩНЫЙ ЧАТ ИИ
- Общайтесь с языковыми моделями, включая Gemma, Qwen, Llama и другие
- Получите помощь с написанием, кодированием, обучением, мозговым штурмом и повседневными вопросами
- Прикрепляйте документы и изображения для анализа ИИ (с моделями зрения)
- Экспортируйте разговоры в формате PDF, текст

ПАМЯТЬ ИИ
- Ваш ИИ запоминает вас во время разговоров
- Поделитесь своим именем, предпочтениями или любой информацией - он вызовет их позже
- Спросите "Что мне больше всего нравится...?" В любом чате и получите правильный ответ
- Полный контроль: включение/выключение, очистка в любое время

AI IMAGE TOOLS
- AI Image Editing
- Удалить или заменить что-либо на фотографиях с помощью inpainting
- Object Remover - Удаление нежелательных объектов одним нажатием
- Фото в 3D - Генерировать карты глубины с любой фотографии
- Черно-белая раскраска - Воплотите старые черно-белые фотографии в жизнь с помощью AI
- 3D Splat Generation - Создание захватывающих 3D-моделей из одной фотографии
- 3D-галерея - Сохраняйте, просматривайте и делитесь своими 3D-творениями

БИБЛИОТЕКА EBOOK
- Импорт и читайте книги ePub и PDF
- Общайтесь с ИИ о содержании книги
- Выделите отрывки и задавайте вопросы
- Краткое изложения книг на основе ИИ

ГЕНЕРАЦИЯ ИЗОБРАЖЕНИЙ
- Создавайте потрясающие изображения из текстовых описаний
- Несколько моделей: SD 1.5, SDXL и специализированные модели Lekh AI
- Точно настроенные модели: Фотореализм, Interstellar, Детские истории, Фэнтези
- Стиль Предустановки для быстрых творческих результатов
- 4x AI Upscaling - Улучшите любое изображение с помощью нейронного upscaler RealESRGAN
- Все генерации происходят на устройстве

ЛОКАЛЬНЫЙ СЕРВЕР AI
- Превратите свой iPhone в сервер AI API
- REST API - работает с Python, curl и любым приложением
- Доступ к AI с любого устройства в вашей локальной сети

ЕСТЕСТВЕННЫЙ ГОЛОСОВОЙ ЧАТ

- Говорите естественно с высококачественными нейронными голосовыми ответами - Режим разговора без помощи рук
- Несколько голосовых опций, включая ФУНКЦИИ Kokoro TTS

VISION
- Направьте камеру и задавайте вопросы о том, что вы видите
- Извлечение текста из документов, знаков и квитанций (OCR)
- Получайте описания сцен в режиме реального времени
- Анализируйте изображения и фотографии с помощью AI

AI PERSONAS

- Общайтесь с уникальными персонажами - волшебниками, пиратами, детективами и многим другим
- Каждая персона имеет уникальную индивидуальность и стиль речи,

МОДЕЛИ ВКЛЮЧЕНЫ
- Загрузите только то, что вам нужно:
- Bonsai 8B и Gemma 4 - В новой версии!
- Gemma 3 QAT (1B - 4B) - Последняя, высокофункциональная версия Google
- Qwen 2.5/3.5 (1.5B - 4B) - Отлично подходит для кодирования и рассуждений
- Llama 3.2 (1B - 3B) - Мощные открытые модели Meta
- OpenELM (270M) - Сверхэффективная модель Apple
- Модели Vision для понимания изображений
- Генерация изображений: SD 1.5, SDXL

⬇️ https://apps.apple.com/ru/app/lekh-ai-local-ai-studio/id6757496953
#Lekh #LekhAI #LocalAIStudio #App #iPhone #iOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 LLM Hub - Local AI Assistant

Есть поддержка Gemma 4 E2B/E4B
LLM Hub — для чата и создания изображений на Android и iOS. Поддерживает несколько форматов моделей, что позволяет запускать мощные модели локально.
8 МОЩНЫХ ИНСТРУМЕНТОВ ИИ

📝 УМНЫЙ ЧАТ
Многоходовые диалоги с учетом контекста, память RAG, дополнительный веб-поиск, вывод речи с автоматическим озвучиванием и поддержка ввода текста, изображений и аудио. Создавайте собственные ИИ-персоны с персонализированными инструкциями.

✍️ ПОМОЩЬ В ПИСЬМЕННОЙ РАБОТЕ
Составляйте резюме документов, расширяйте идеи, переписывайте контент, улучшайте грамматику и генерируйте код на основе описаний на естественном языке.

🎨 ГЕНЕРАТОР ИЗОБРАЖЕНИЙ
Создавайте потрясающие изображения из текстовых подсказок с помощью Stable Diffusion 1.5. Генерируйте множество вариантов с помощью галереи, пролистывая изображения. Вся обработка происходит на устройстве.


🌍 ПЕРЕВОДЧИК (более 50 языков)
Переводит текст, изображения (OCR) и аудио в режиме реального времени. Работает полностью в автономном режиме с двусторонней поддержкой.

🎙 ТРАНСКРИПТОР
Преобразует аудио в текст с высокой точностью. Поддерживает WAV. Вся обработка выполняется на устройстве.

🎵 VIBECODE Creator
Создавайте, настраивайте и делитесь закодированными ИИ-персонами. Создавайте персонализированные наборы инструкций, которые управляют поведением ИИ во всех чат-сессиях. Разработайте своего идеального ИИ-помощника с помощью системных подсказок и описаний.

💻 ПОМОЩНИК ПО КОДУ
Генерируйте, отлаживайте и объясняйте код с помощью моделей ИИ, улучшенных VibeCode. Дополнительный веб-поиск документации и лучших практик.

🛡 ДЕТЕКТОР МОШЕННИЧЕСТВА
Анализируйте подозрительные сообщения и изображения на предмет попыток фишинга. Получайте четкие оценки рисков и подробные объяснения.

🚀 ПЕРЕДОВЫЕ МОДЕЛИ ИИ
Поддерживаемые форматы моделей: GGUF, ONNX, LiteRT, MediaPipe (бэкенды вывода MediaPipe, ONNX Runtime и Nexa SDK)

Рекомендуемые модели:
• Gemma-4 E2B/E4B (Google) - Мультимодальная: текст, изображение, аудио
• Llama-3.2 1B/3B (Meta) - Мощный открытый исходный код
• Phi-4 Mini (Microsoft) - Оптимизирована для мобильных устройств
• Ministral 3B/8B (Mistral AI) - Высокопроизводительная многоязычная модель с поддержкой изображения
• Семейство GPT-OSS - Быстрые и эффективные модели с оптимизацией ONNX
• LFM-2.5 Thinking (Thinking) - Рассуждения и генерация длинных текстов
• Granite Models (IBM) - Язык, готовый для корпоративного использования модели
Stable Diffusion 1.5 — генерация изображений на устройстве

Все модели работают на 100% на устройстве с ускорением GPU/NPU.

⚡️ РАСШИРЕННЫЕ ВОЗМОЖНОСТИ:
• Преобразование текста в речь с автоматическим озвучиванием для прослушивания без помощи рук
• Ускорение GPU/NPU для высокой производительности
• Мультимодальный: текст, изображения и аудио
• RAG с глобальной памятью для улучшения ответов
• Создание пользовательских ИИ-персон с персонализированными инструкциями
• Vibecode, аналогичный использованию курсора/кода Клода
• Импорт пользовательских моделей (.gguf, .onnx, .task, .litertlm, .qnn, .mnn)
• 17 языков интерфейса

💡 КАК ЭТО РАБОТАЕТ:
1. Загрузите модели ИИ в приложении (однократно) — поддерживаются форматы GGUF, ONNX, LiteRT и MediaPipe
2. Создайте собственные персоны ИИ с помощью VibeCode для персонализированного поведения
3. Выберите инструмент: Чат (с персонами), Помощь в написании, Генератор изображений, Переводчик, Транскриптор, Помощник по коду или Детектор мошенничества
4. Используйте ИИ полностью в автономном режиме с полной конфиденциальностью

📖 ОТКРЫТЫЙ ИСХОДНЫЙ КОД (Лицензия MIT)

🔗 https://www.llm-hub.app
⬇️ https://play.google.com/store/apps/details?id=com.llmhub.llmhub
iOS: https://apps.apple.com/au/app/llm-hub/id6762511820
🔗 https://github.com/timmyy123/LLM-Hub
#LLMHub #LocalAIAssistant #LiteRT #App #iOS #iPhone #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Qwen3.6-27B: кодирование флагманского уровня в модели 27B Dense

Qwen3.6-27B — это плотная модель с полностью открытым исходным кодом (27 миллиардов параметров), обладающая следующими характеристиками:
- агентное кодирование флагманского уровня, превосходящее Qwen3.5-397B-A17B
- мощные текстовые и мультимодальные возможности
Qwen3.6-27B совершает прорыв в агентном кодировании для плотных моделей. Имея всего 27 миллиардов параметров, он превосходит Qwen3.5-397B-A17B (всего 397 миллиардов параметров / 17 миллиардов активных) по всем основным тестам на кодирование, включая SWE-bench Verified (77,2 против 76,2), SWE-bench Pro (53,5 против 50,9), Terminal-Bench 2.0 (59,3 против 52,5) и SkillsBench (48,2 против 30,0). Кроме того, она значительно превосходит все модели того же масштаба. В задачах на логическое мышление Qwen3.6-27B набирает 87,8 балла на GPQA Diamond, что сопоставимо с результатами моделей, размер которых в несколько раз больше.

Блог: https://qwen.ai/blog?id=qwen3.6-27b
🔗 https://huggingface.co/Qwen/Qwen3.6-27B
(Обсуждение)
У нее другие настройки:
Thinking mode for general tasks: temperature=1.0, top_p=0.95, top_k=20, min_p=0.0, presence_penalty=0.0, repetition_penalty=1.0
Thinking mode for precise coding tasks (e.g. WebDev): temperature=0.6, top_p=0.95, top_k=20, min_p=0.0, presence_penalty=0.0, repetition_penalty=1.0
Instruct (or non-thinking) mode: temperature=0.7, top_p=0.80, top_k=20, min_p=0.0, presence_penalty=1.5, repetition_penalty=1.0

(Обсуждение)
#Qwen3627B #Qwen36 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
🔈 Persona Engine - Голос, анимация и характер вашего персонажа в Live2D на основе ИИ

Persona Engine слушает вас через микрофон, генерирует мысли с помощью большой языковой модели, ориентируясь на файл с описанием личности, озвучивает их с помощью технологии преобразования текста в речь в реальном времени (при желании с клонированием голоса) и управляет аватаром Live2D в режиме синхронизации. Вы можете наблюдать за персонажем через встроенное прозрачное наложение или транслировать его в OBS через Spout.

Входящая в комплект модель Aria уже настроена для работы с функцией синхронизации губ и мимики в движке. Вы также можете использовать свою собственную модель! Стандартные модели, совместимые с OpenAI (Groq, OpenAI, Ollama и т. д.), тоже работают!
Важно: Требуется графический процессор NVIDIA с CUDA (Windows x64). ASR, TTS и RVC работают на CUDA через среду выполнения ONNX — процессоры CPU/AMD/Intel не поддерживаются.

🔗 https://github.com/fagenorn/handcrafted-persona-engine
🎞 Демо: https://www.youtube.com/watch?v=4V2DgI7OtHE
(Обсуждение)
#PersonaEngine #Windows #ASR #TTS #Qwen3TTS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📖 Полный список: лучшие открытые модели для программирования, общения, обработки изображений, аудио и многого другого

Вот содержимое этого поста:
Лучшие модели с открытым исходным кодом для генерации звука

Преобразование текста в речь (TTS)
Qwen3-TTS → Лучший баланс (качество + скорость)
Kimi-Audio → Сильные мультимодальные + выразительные голоса
Fish Speech / Fish Audio S2 → Отлично подходит для реалистичного клонирования голоса
CosyVoice 3.0 → Очень надежный многоязычный + потоковая передача
VibeVoice Realtime → Лучше всего подходит для приложений реального времени

Клонирование голоса
VoxCPM2 → Высококачественное клонирование + поддержка многих языков
IndexTTS2 → Чистый звук + хорошая стабильность
Kokoro / KokoClone → Легкое и быстрое клонирование

Генерация музыки
ACE-Step 1.5 → Лучший музыкальный генератор с открытым исходным кодом на данный момент
Magenta Realtime → Музыкальные эксперименты в реальном времени
Uni-MoE (аудио) → Многоцелевой генератор аудио

Мультимодальный звук (Anything → Audio)
AudioX / Audio-Omni → Самый полный мультимодальный аудиостек
MMAudio → Поддерживает преобразование текста, изображений и видео в аудио
Woosh / ThinkSound → Хорошие экспериментальные модели

Улучшение звука
NVIDIA A2SB → Лучше всего подходит для восстановления и ретуширования
AudioSR / NovaSR → Качественное масштабирование и улучшение звука

Распознавание речи (ASR)
FunASR → мощная многоязычная система + потоковая передача
VibeVoice-ASR → хорошая производительность в режиме реального времени
Cohere Transcribe (ОС) → чистая и надежная система

Лучшие модели с открытым исходным кодом для создания изображений

FLUX.1 [schnell]
Самая быстрая модель с открытым исходным кодом, обеспечивающая баланс качества и скорости для потребительских графических процессоров.

FLUX.1 [dev]
Лидер по результатам тестов для высокоточных сложных сцен от Black Forest Labs.

Stable Diffusion 3.5 Large
Универсальная экосистема для тонкой настройки и редактирования.

GLM-Image
Специалист по типографике для двуязычной инфографики под лицензией Apache 2.0.

Qwen-Image-2512
Мощный инструмент для многоязычного редактирования и переноса креативных стилей.

Z-Image-Turbo
Легкий генератор 6B в режиме реального времени для периферийных вычислений и пакетной обработки.

HiDream-I1-Full
Эксперт по необработанному фотореализму для высококачественных изображений.

SANA-Sprint 1.6B
Сверхэффективный вариант с низким объемом видеопамяти для быстрых экспериментов.

HunyuanImage-3.0
Исследовательский вариант для повышения согласованности и разнообразия.

Лучшие модели с открытым исходным кодом для преобразования изображений в видео

LTX-2.3
Ведущая модель с открытым исходным кодом для преобразования изображений в видео с поддержкой 4K, 50 кадров в секунду и синхронизированным звуком https://huggingface.co/Lightricks/LTX-2.3.

LTX-2.3-GGUF
Квантованный вариант LTX-2.3 с 21 миллиардом параметров для эффективного логического вывода на потребительском оборудовании https://huggingface.co/unsloth/LTX-2.3-GGUF.

LTX-2.3-Workflows
Рабочие процессы ComfyUI, оптимизированные для конвейеров создания видео LTX-2.https://huggingface.co/RuneXX/LTX-2.3-Workflowshttps://huggingface.co/RuneXX/LTX-2.3-Workflows.

WAN2.2-14B-Rapid-AllInOne
Универсальная модель 14B для преобразования изображений в видео с архитектурой MoE для быстрого локального запуска https://huggingface.co/Phr00t/WAN2.2-14B-Rapid-AllInOne.

VBVR-LTX2.3-diffsynth
Интеграция Diffsynth для LTX-2.3, обеспечивающая расширенные возможности синтеза видео https://huggingface.co/Video-Reason/VBVR-LTX2.3-diffsynth.

BFS-Best-Face-Swap-Video
Специализированная модель LTX для замены лиц в видео для реалистичной замены персонажей https://huggingface.co/Alissonerdx/BFS-Best-Face-Swap-Video.

Wan2.2-I2V-A14B-GGUF
Квантованная модель Wan2.2 для преобразования изображений в видео с разрешением 480p/720p на графических процессорах среднего уровня https://huggingface.co/QuantStack/Wan2.2-I2V-A14B-GGUF.
Please open Telegram to view this post
VIEW IN TELEGRAM
LTX-2
Предыдущая версия LTX, получившая широкое распространение в сообществе для коммерческого создания видео https://huggingface.co/Lightricks/LTX-2.

LTX-2.3-Transition-LORA
Точная настройка LoRA для плавных переходов между сценами в видео LTX-2.3 https://huggingface.co/valiantcat/LTX-2.3-Transition-LORA.

HY-OmniWeaving
Мультимодальная технология Tencent для преобразования изображений в видео с возможностью создания многослойных композиций https://huggingface.co/tencent/HY-OmniWeaving.

Лучшие модели преобразования изображения в текст с открытым исходным кодом

GLM-OCR
Лучшая модель оптического распознавания символов с открытым исходным кодом в 2026 году по скорости и точности распознавания сложных документов https://huggingface.co/zai-org/GLM-OCR.

nemotron-ocr-v2
Высокоточная система оптического распознавания символов от NVIDIA отлично справляется с распознаванием текста на изображениях и многоязычным распознаванием https://huggingface.co/nvidia/nemotron-ocr-v2.

Falcon-OCR
Эффективная система оптического распознавания символов от TII UAE для извлечения текста в реальных условиях при различных обстоятельствах https://huggingface.co/tiiuae/Falcon-OCR.

RationalRewards-8B-T2I
Модель вознаграждения 9B, специализированная для оценки преобразования текста в изображение и создания субтитров https://huggingface.co/TIGER-Lab/RationalRewards-8B-T2I.

RationalRewards-8B-Edit
Вариант 9B, оптимизированный для обратной связи при редактировании изображений и описательных задач https://huggingface.co/TIGER-Lab/RationalRewards-8B-Edit.

HiVG-3B-Base
4-битная визуальная модель для точного совмещения и описания изображений и текста https://huggingface.co/xingxm/HiVG-3B-Base.

trocr-base-handwritten
База TrOCR от Microsoft для точной расшифровки рукописного текста https://huggingface.co/microsoft/trocr-base-handwritten.

blip-image-captioning-large
Salesforce BLIP large для подробного и качественного описания изображений https://huggingface.co/Salesforce/blip-image-captioning-large.

manga-ocr-base
Специализированное оптическое распознавание символов для извлечения текста из японской манги и комиксов https://huggingface.co/kha-white/manga-ocr-base.

blip-image-captioning-base
Эффективная базовая модель BLIP для преобразования изображений в текст общего назначения https://huggingface.co/Salesforce/blip-image-captioning-base.

Модели с открытым исходным кодом для генерации текста

GLM-5.1
Флагманский модуль 744B MoE (40B в рабочем состоянии) от Zhipu AI, ведущий специалист в области агентирования и задач долгосрочного кодирования https://huggingface.co/zai-org/GLM-5.1

Qwen3.5-397B-A17B
MoE от Alibaba 397B (17B активен) с мультимодальным анализом и контекстом более 1 МЛН токенов для универсальных агентов https://huggingface.co/Qwen/Qwen3.5-397B-A17B

Gemma 4
Гибридное семейство приложений Google attention (2B-31B), превосходящее в рассуждениях, программировании и мультимодальном использовании на устройстве https://huggingface.co/google/gemma-4-31b-it

DeepSeek-V3.2
MOE, ориентированный на рассуждения, с ограниченным вниманием для эффективных агентов с большим контекстом и математикой уровня GPT-5 https://huggingface.co/deepseek-ai/DeepSeek-V3.2

Kimi-K2.5
Мультимодальная модель Moonshot 1T MoE (32B активная) для визуального кодирования и роения агентов до 100 субагентов https://huggingface.co/moonshotai/Kimi-K2.5

Минимакс-М2.7
Самосовершенствующийся agentic LLM, превосходящий тесты SWE-Pro для реальных рабочих процессов разработки программного обеспечения https://huggingface.co/MiniMaxAI/MiniMax-M2.7

MiMo-V2-Flash
Высокопроизводительный модуль MoE 309B от Xiaomi (15B активный) с пропускной способностью 150 т / с для кодирования большого объема https://huggingface.co/XiaomiMiMo/MiMo-V2-Flash

#AiModel #ModelAi #LocalAi #AiLocal
Модель: Artemis-31B-v1h

Основана на gemma 4 31b от TheDrummer
supports thinking in two modes:
- standard thinking gemma template or
- <thinking></thinking> blocks on non-thinking gemma template
- <think></think> should work too, along with tricks like <evil_think></evil_think> etc.
- custom thinking can be described in the system prompt

🔗 https://huggingface.co/BeaverAI/Artemis-31B-v1h-GGUF

Artemis-31B-v1.1
🔗 https://huggingface.co/TheDrummer/Artemis-31B-v1.1
Разница между версиями 1 и 1.1 довольно проста: версия 1 была первой попыткой, запоздалым релизом, который отличался проработанной прозой и стилем, но требовал некоторой доработки, чтобы избавиться от таких особенностей, как заикание. Версия 1.1 — это более совершенный подход, в котором стабильность сочетается с качеством. (Обсуждение)


И есть еще такая Еретик версия: (на Heretic v1.2.0)
🔗 https://huggingface.co/coder3101/gemma-4-31B-it-heretic
#Artemis31B #gemma431b #TheDrummer #Heretic #БезЦензуры #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM