Local Ai
449 subscribers
929 photos
262 videos
4 files
824 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
📱 Модель Bonsai 27B появилась и в приложении Atomic Chat

Bonsai 27B работает локально на iPhone — модель 27B размером: 3,9 ГБ!
Версия Atomic Chat для iPhone/iPad: https://apps.apple.com/de/app/atomic-chat-private-local-ai/id6761720226?l=en-GB
Работает и с 8 ГБ ОЗУ!
Для Android https://play.google.com/store/apps/details?id=chat.atomic.app
(Обсуждение)
#atomicchat #atomic #Bonsai #Bonsai27B #Qwen36 #iPad #iPhone #App #AiModel #ModelAi #LocalAi #AiLocal
This media is not supported in your browser
VIEW IN TELEGRAM
✈️ Ghost - Премиальное рабочее пространство с ИИ в строке меню.
Ghost направляет запросы к локальным и размещенным моделям, выполняет поиск в вашей личной базе знаний, запускает локальные таймеры и проверенные действия на Mac — и все это из одной тихой встроенной панели, которая появляется, когда она вам нужна, и исчезает, когда не нужна.
Ghost — это нативное приложение с панелью меню SwiftUI для macOS, которое объединяет локальные модели, размещенные API, дополнительные клиентские интерфейсы агентов, функции извлечения документов, таймеры и проверенные действия для Mac в одном удобном интерфейсе.

Он работает как вспомогательное приложение — без значка в Dock и без полноэкранного режима. Он появляется по нажатию клавиши, выполняет свою работу и сворачивается. Ваш Mac остается вашим Mac.

Все возможности доступны по умолчанию. Вы подключаете каждую из них — буфер обмена, веб-интерфейс, файлы, автоматизацию, экран, командную строку — в шесть этапов. По умолчанию ничего не включено. Ничто не работает в фоновом режиме без вашего запроса.
Ghost подключается к Ollama (localhost:11434) и LM Studio (localhost:1234) как к первоклассным провайдерам наряду с Claude, Gemini, DeepSeek, OpenCode Go и OpenCode Zen. Вы сами выбираете, какая модель отвечает на тот или иной вопрос.

При первом запуске Ghost проверяет каждую локальную модель, чтобы выяснить, что она на самом деле может делать: поддерживает ли она вызов встроенного инструмента? Режим JSON? Насколько точны ее структурированные выходные данные? Основываясь на результатах, Ghost присваивает каждой модели соглашение о вызове — native_tool_calls, json_action_mode, harness_first или answer_only — таким образом, локальные модели, которые не могут выполнять вызовы функций, по-прежнему получают доступ к инструментам по структурированному пути JSON, а модели, которые производят ненадежные вызовы инструментов, корректно откатываются, вместо того чтобы беззвучно прерываться.

Конфиденциальность: Ключи API хранятся в связке ключей macOS. Локальные провайдеры не могут запускать агентский режим. Когда вы используете Ollama или LM Studio, данные не покидают ваш компьютер.

Цены: 2-дневная бесплатная пробная версия, пожизненная лицензия за 10 долларов. Используйте локальные модели бесплатно навсегда. Для хостинговых моделей нужны собственные ключи API.

🔗 https://integratedagentics.com/ghost
🔗 https://github.com/ryuhemingway/Ghost-App
(Обсуждение)
#Ghost #macOS #Ollama #LMStudio #SoftAi #AiSoft #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 Bionic Agent — ИИ-помощник для локальных моделей

LM Studio выпустила агента, который работает с документами, кодом и аудио прямо на твоём компьютере. Данные не улетают в облако — всё остаётся локально.

Что умеет: создаёт и редактирует документы, презентации, PDF; пишет код с автосохранением; расшифровывает речь в реальном времени. Запускается через LM Studio на движках MLX и llama.cpp. Можно подключить облачные модели вроде GLM или Kimi, если задача требует больше мощности.

Поддерживает Windows и macOS. Есть бесплатный тариф.
🔗 https://lmstudio.ai/pricing
#LMStudio #BionicAgent #MLX #llamacpp #Windows #MacOS #SoftAi #AiSoft #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🖼 SenseNova U1 Pro: китайская модель для генерации картинок обновилась до V3

Китайская модель SenseNova U1 Pro получила 3-ю версию. Теперь она генерирует картинки в разрешении до 8K, умеет создавать ультраширокие и ультравысокие изображения, а ещё — редактировать их.
Вышла специальная версия для текстов и инфографики.

Модель открытая, есть GGUF-версии для 10-12 Гб видеопамяти. Разработчики честно признают: с анатомией пока не всё гладко, работают над этим.

💻 Ещё у них есть SenseNova Vision — модель для распознавания объектов, OCR, работы с интерфейсами, определения глубины и сегментации. Поддерживает мультиракурсный анализ.

🔗 https://github.com/OpenSenseNova/SenseNova-U1
🔗 https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic-V3
🔗 https://modelscope.cn/models/SenseNova/SenseNova-U1-8B-MoT-Infographic-V3
🔗 https://huggingface.co/spaces/sensenova/sensenova-u1-infographic-v3
🔗 https://github.com/OpenSenseNova/SenseNova-Vision
#SenseNova #SenseNovaU1 #Infographic #SenseNovaVision #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💡 DFlash ускоряет Qwen3.6 27B в 2,2 раза без потери качества

Команда : Atomic.Chat локально протестировала Qwen3.6-27B тремя способами на одной RTX 6000: базовый режим, MTP, DFlash. Задачи были следующие: быстрая сортировка, создание библиотеки Steam в формате JSON, решение логической головоломки и написание научно-фантастического рассказа.

Результаты:
- Базовый уровень: 44 токена в секунду · 1,00x
- MTP: 65 токенов в секунду · 1,45x · 71% принято
- DFlash: 98 токенов в секунду · 2,20x · 30% принято

DFlash генерирует 15 токенов подряд, поэтому он справляется с повторяющимися или структурированными фрагментами, в которых длинные последовательности действительно работают, например с JSON (152 токена в секунду, в 3,4 раза быстрее). В креативном тексте большинство догадок оказываются неверными, поэтому работа тратится впустую, и скорость может упасть ниже базового уровня — 42 против 44.
MTP генерирует только 3 варианта параллельно внутри модели, поэтому неверная догадка почти ничего не стоит, и скорость никогда не падает ниже базового уровня.

Все три модели выдают одинаковый результат. Поэтому DFlash отлично подходит для программирования, а MTP — для общения или литературного творчества.

Модель Qwen 3.6 27B: https://huggingface.co/Qwen/Qwen3.6-27B
(Обсуждение)
#DFlash #MTP #Qwen36 #AtomicChat #LocalAi #AiLocal
✨ Arandu — приложение, помогающее использовать Llama.cpp.

Arandu — приложение с открытым исходным кодом для простого запуска моделей с помощью llama.cpp. Оно объединяет все в одном месте, предлагая простое управление несколькими версиями llama.cpp, поиск и загрузку моделей HuggingFace, интуитивно понятные аргументы с предустановками и многое другое.
Идея состоит в том, чтобы создать небольшую систему вокруг llama-server без необходимости подключаться к DLL-файлам.

- Управление моделями
- Интеграция с HuggingFace
- Интеграция Llama.cpp с GitHub и управление релизами
- Запуск терминала Llama-server с простой настройкой аргументов и предустановками, внутренними и внешними
- Встроенный интерфейс чата Llama-server
- Аппаратный монитор
- Цветовые темы
🔗 https://github.com/fredconex/Arandu
(Обсуждение)
#Arandu #llamacpp #SoftAi #AiSoft #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ Модель: Laguna S 2.1 — открытая ИИ-модель для программирования.

Модель содержит 118 млрд параметров, из которых 8 млрд активны, поддерживает контекст до 262 тысяч токенов. В Terminal-Bench 2.1 набрала 70,2%, показав результат на уровне сильных коммерческих моделей. Laguna S 2.1 уже доступна бесплатно через OpenRouter: Poolside: Laguna S 2.1 (бесплатно)
🔗 https://openrouter.ai/poolside/laguna-s-2.1:free
Laguna S 2.1 — это новейшая модель кодирующего агента от Poolside. Laguna S 2.1 — это модель с общим количеством параметров 118 млрд и 8 млрд активных параметров, набравшая 70,2 % баллов на Terminal-Bench 2.1 и 40,4 % баллов на DeepSWE, что делает ее одной из самых сильных кодирующих моделей в своей категории. Модель с открытым исходным кодом под лицензией OpenMDW-1.1.

Laguna S 2.1 предназначена для разработки программного обеспечения и агентного программирования, и вы несете ответственность за то, чтобы убедиться, что она подходит для ваших целей.
Скачать: https://poolside.ai/get-started

Пишут: Laguna S 2.1 Released: Cheaper than Deepseek v4 Flash, Better than V4 Pro! (Перебила результаты DeepSeek v4 Pro, Gemini 3.6 Flash, Inkling при своём втрое меньшем объёме. Может работать на DGX Spark.)
⬇️ Скачать квант: https://huggingface.co/unsloth/Laguna-S-2.1-GGUF
(Обсуждение)
HF: https://huggingface.co/poolside/Laguna-S-2.1
GGUFs available for use with llama.cpp custom fork: https://huggingface.co/poolside/Laguna-S-2.1-GGUF
Posted on X: https://x.com/poolsideai/status/2079613777343848465?s=20
(Обсуждение)
#Laguna #LagunaS #LagunaS21 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📊 Kimi-K3 пока не лучше Fable, но определенно приближается к этому.

Релиз Kimi-K3, хоть и впечатляет, все же на несколько месяцев отстает от разработок с закрытым исходным кодом, так что разговоры о том, что «Anthropic обречен», кажутся преувеличенными. Однако, по данным Artificial Analysis, Kimi-K3 всего на 1,5 месяца отстает от моделей с закрытым исходным кодом, следуя сразу за OpenAI и Anthropic.

Также стоит обратить внимание на график: где была компания Google с момента выхода Gemini 3 Pro в ноябре прошлого года? Лучшие модели с открытым исходным кодом продолжают расти, доказывая, что законы масштабирования по-прежнему работают. А учитывая, что Kimi-K3 приближается к 3 триллионам параметров, она точно не работает на вашем MacBook, но уж очень интересный график!

(Обсуждение)
#ArtificialAnalysis #Kimi #KimiK3 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
⚡️ Sentient OS делает из Mac персонального ассистента

LLM на вашем устройстве знает о вас все и предлагает выполнять работу с помощью ПК.
Приложение для macOS, которое собирает контекст из файлов, скриншотов и переписок, формирует локальную базу знаний и каждый день готовит подборку заметок с напоминаниями.

Ассистента можно вызвать в любой момент — он поможет с текущими задачами. Персональные данные не покидают устройство: ИИ работает только с обезличенными сводками.
У любого искусственного интеллекта, которым вы пользуетесь сегодня, есть две проблемы: он ничего не знает о вас (никто не может выложить всю свою жизнь в чат) и помогает только тогда, когда его об этом просят. Чтобы решить обе проблемы, нужно каждый день читать всю вашу жизнь. В облаке такой объем данных — это целое состояние и кошмар с точки зрения конфиденциальности. На вашем собственном чипе это бесплатно и никого не касается.

Таким образом, каждую ночь локальная языковая модель Sentient на вашем устройстве считывает все новое (ваши файлы, скриншоты, сообщения в WhatsApp, iMessage, «Заметках», электронную почту) и преобразует их в базу знаний в формате чистого маркера — самую глубокую память о вас, которая когда-либо была у искусственного интеллекта. Последние 10% вычислений выполняются на передовой модели через вашу собственную подписку на ChatGPT. Ничто не обращается к ключу API Sentient, потому что его нет.

К утру Sentient предлагает вам выполнить рутинную работу в один клик: тот самый ответ, который вы забыли, составлен с учетом вашего богатого личного опыта. Подписка, которую вы хотели отменить, продлена накануне.

И в любом месте на вашем Mac нажмите на выемку и скажите Sidekick: «Закончи это за меня». Он использует ваши приложения так же, как и вы, даже в фоновом режиме, пока вы занимаетесь своими делами.

Никаких учетных записей, а ваши личные данные никогда не покидают ваш Mac. Бесплатно навсегда.
🔗 https://sentient-os.ai
🔗 https://github.com/Sentient-OS-Labs/sentient-os - тут подробно!
#SentientOS #MacOS #SoftAi #AiSoft #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
ℹ Модель: MobileWan WAN2.2 5B адаптировали для генерации видео на смартфоне

📱 Модель создаёт 5-секундные ролики в разрешении 480×832 px с частотой 16 кадров в секунду. Генерация занимает 20 секунд.

По бенчмарку VBench модель набрала 83.79 балла — лучший результат среди мобильных решений. Это означает, что качество видео приближается к десктопным генераторам, но работает всё локально на телефоне.
🔗 https://github.com/Qualcomm-AI-research/mobilewan
🔗 https://huggingface.co/Qualcomm-AI-Research/mobilewan
#MobileWan #WAN225B #AiVideo #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM