🍋 Lemonade: освежающе быстрый локальный ИИ
Lemonade — это локальный ИИ-сервер, который предоставляет те же возможности, что и облачные API, но при этом является на 100 % бесплатным и приватным. Используйте новейшие модели для общения, написания кода, генерации речи и изображений на собственном нейронном процессоре и графическом процессоре.
🔗 https://lemonade-server.ai
🔗 https://github.com/lemonade-sdk/lemonade
#Lemonade #AiServer #MacOS #Windows #Linux #LocalAi #AiLocal
Lemonade — это локальный ИИ-сервер, который предоставляет те же возможности, что и облачные API, но при этом является на 100 % бесплатным и приватным. Используйте новейшие модели для общения, написания кода, генерации речи и изображений на собственном нейронном процессоре и графическом процессоре.
Lemonade доступен в двух вариантах:
- Lemonade Server — это сервис, к которому можно подключиться через сотни отличных приложений, использующих стандартные API OpenAI, Anthropic и Ollama.
- Встраиваемый Lemonade — это портативный бинарный файл, который можно упаковать в собственное приложение, чтобы добавить в него мультимодальный локальный ИИ, автоматически оптимизирующийся под компьютер пользователя.
Этот проект создан сообществом для всех ПК с оптимизацией от инженеров AMD, чтобы максимально эффективно использовать возможности Ryzen AI, Radeon и ПК Strix Halo.
Приступая к работе:
- Установить: Windows · Linux · macOS · Docker · Исходный код
- Получение моделей: просматривайте и загружайте с помощью менеджера моделей
- Генерировать: Попробуйте модели со встроенными интерфейсами для общения в чате, генерации изображений, генерации речи и многого другого
- Мобильный: Возьмите с собой лимонад: iOS · Android · Исходный код
- Подключайся: используй Lemonade со своими любимыми приложениями:
( теперь доступно на 15 движках!)
#Lemonade #AiServer #MacOS #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Простой способ создания красивых изображений на ПК с помощью ИИ в один клик, без технических знаний. Предоставляет браузерный интерфейс для создания изображений на основе текстовых подсказок и изображений. Просто введите текстовую подсказку и посмотрите сгенерированное изображение.
Не требует технических знаний, не требует предустановленного программного обеспечения. Установка в один клик, мощные функции.
️🔥🎉 Новое! В движок v4 добавлена поддержка Ernie, Z-Image, Flux 1 и 2, Lumina, Anima и квантованных моделей!
💡 И есть: stable-diffusion.cpp - Вывод диффузионной модели (SD, Flux, Wan, Qwen Image, Z-Image, ...)
#EasyDiffusion3 #EasyDiffusion #StableDiffusion #SD #Ernie #ZImage #Flux #Lumina #Anima #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Zeno — это бесплатный инструмент на основе агентного ИИ, который полностью работает на вашем Mac. Он похож на Claude Cowork, но, очевидно, имеет меньшую модель, поэтому может работать локально. Он работает с вашими файлами, обеспечивает конфиденциальность ваших данных, не требует оплаты за использование и не содержит водяных знаков. Он поставляется с 4-битной версией Qwen3.6-35B-A3B. Полная модель не помещается в объединенную память Mac с 16 ГБ, поэтому вместо того, чтобы уменьшать или обрезать ее, мы создали систему разгрузки.
(Обсуждение)
#Zeno #AiAgent #AgentAi #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
TinySearch выполняет локальный поиск, сканирование и переранжировку веб-страниц, а затем предоставляет вашему агенту только те доказательства, которые стоит включить в контекст.
TinySearch версии 0.6.1 - по-прежнему легкий инструмент веб-исследований для локальных LLM, теперь с поддержкой собственного браузера
Сжимайте веб для своих агентов! Эффективный с точки зрения использования токенов, быстрый и полностью локальный веб-поиск и исследования.
TinySearch — это инструмент для веб-исследований, который можно разместить на собственном сервере. Он выполняет поиск в интернете, читает лучшие страницы, удаляет малоценный контент и возвращает компактные доказательства с исходными URL-адресами.
Ваша модель получает полезные фрагменты, а не платит за обработку целых веб-страниц.
TinySearch является частью TinySuite — набора специализированных инструментов, призванных удешевить агентные операции за счет минимизации использования токенов с помощью интеллектуальных методов поиска, выбора и управления контекстом.
(Обсуждение)
#TinySearch #AiSearch #MCP #Парсинг #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Нативное приложение macOS для работы с ChromaDB без терминала: установка и обновление движка, подключение к локальной базе данных или серверу, просмотр и редактирование ее содержимого, а также выполнение встраиваний через локальную LM Studio.
Статья: https://habr.com/ru/articles/1074938/
#ChromaDBManager #ChromaDB #RAG #MacOS #MCP #LMStudio #Hermes #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
В Audio.cpp теперь 62 семейства моделей и 85+ вариантов моделей. И их количество продолжает расти!
Самое заметное изменение для пользователей — это новый интерфейс Arena. Теперь вместо того, чтобы тестировать одну модель за раз, вы можете использовать один общий входной файл и поставить в очередь несколько локальных моделей или вариантов GGUF, а затем сравнить сгенерированные результаты. Это удобно, если нужно выбрать одну из моделей, не тратя время на написание множества скриптов.
Добавлено в версии 0.7:
- TTS / Озвучивание: FireRedTTS3, MagpieTTS, PersonaPlex, F5-TTS / Хабиби, Генератор голоса МОССА, Доттс Правка
- ASR / понимание речи: FireRedAudio, IBM Granite Speech 5.0 TurboCTC, функция принудительного выравнивания MMS
- Преобразование голоса: MeanVC2
- Генерация музыки / аудио: MiniMax Music 3, MiDashengLM-Gen, ControlFoley (экспериментальный), варианты ACE-Step 1.5 XL
- Аудиоинструменты: AudioSR
(Работает на: Windows CPU, Windows Vulkan, Windows CUDA 12.4, Windows CUDA 13.3, Ubuntu x64 CPU, Ubuntu x64 Vulkan, macOS arm64 Metal, macOS x64 CPU.)
(Обсуждение и Подробнее)
#audiocpp #audio #AiAudio #Supertonic #TTS #MOSSTTS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 BigMoeOnEdge - Запускайте модели MoE, размер которых превышает объем вашей оперативной памяти. MoE размером с Frontier на телефоне с 12 ГБ памяти, только на процессоре, без потерь, на стандартной версии llama.cpp
🔗 https://github.com/Helldez/BigMoeOnEdge
⬇️ Скачать: https://github.com/Helldez/BigMoeOnEdge/releases/latest
(Обсуждение) - Qwen 3.6 35B Q4, 7–8 токенов в секунду на телефоне Android с 12 ГБ памяти (и рекорд — 397B на мобильном устройстве).
- Qwen3.8-Flash-Next: 125B параметров, ~82 ГБ на диске, на телефоне с 12 ГБ памяти. 2,03 ток/с !
#BigMoeOnEdge #Android #Windows #MacOS #Linux #llamacpp #LocalAi #AiLocal
Модель Mixture-of-Experts состоит из множества небольших «экспертов», и в каждом сгенерированном токене используются лишь некоторые из них. BigMoeOnEdge делает это буквально: он держит под рукой небольшую часть модели, которая всегда нужна, и считывает только тех экспертов, которые запрашивает каждый токен, прямо из флэш-памяти в момент, когда они нужны. Остальная часть модели остается на диске. Именно это позволяет модели, размер которой в несколько раз превышает объем оперативной памяти, генерировать текст на обычном телефоне без потерь: результат идентичен байтам при работе с той же моделью в оперативной памяти.
Он создан на основе публичного API llama.cpp, а не как форк. Все форматы квантования, токенизаторы и шаблоны чатов, которые поддерживает llama.cpp, работают «из коробки», потому что эту часть выполняет сам llama.cpp: MXFP4 и Q4_K_M проходят через один и тот же код. Поддержка новой архитектуры MoE — это одна строка в реестре, а обновление llama.cpp после выхода новой версии — это обычное обновление подмодуля.
DeepSeek V4 Flash 0731 — самая большая модель, которую удалось запустить таким образом. Она генерируется на телефоне с 12 ГБ оперативной памяти, с потоковой передачей данных с флеш-накопителя в виде трех файлов фрагментов, поставляемых Hugging Face, без этапа слияния и без использования ПК.
(На широком видео: Слева направо: gpt-oss-120b (~60 ГБ), Qwen3-30B-A3B (18,5 ГБ), Gemma-4-26B-A4B (17 ГБ), записано в демонстрационном приложении на телефоне с 12 ГБ памяти, в реальном времени, без ускорения.)
(Обсуждение) - Qwen 3.6 35B Q4, 7–8 токенов в секунду на телефоне Android с 12 ГБ памяти (и рекорд — 397B на мобильном устройстве).
- Qwen3.8-Flash-Next: 125B параметров, ~82 ГБ на диске, на телефоне с 12 ГБ памяти. 2,03 ток/с !
#BigMoeOnEdge #Android #Windows #MacOS #Linux #llamacpp #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
💬 ToshLLM — локальный ИИ именно для Intel Mac + AMD GPU.
Запускайте современные открытые модели на уже имеющемся у вас Mac с процессором Intel. Собственное ускорение Metal, без облачных технологий и платы за токены.
(Последние версии Jan.ai и Atomic.chat перестали поддерживать Mac Intel и теперь они только для Apple Silicon (M1-M6), но MSTY еще работает на Intel!)
В разделе "Аудио" есть #Транскрибация моделью #Whisper и есть разделы "Изображение" и "Видео"!
🔗 https://toshllm.com
🔗 https://github.com/engeldlgado/toshllm
⬇️ Скачать: https://github.com/engeldlgado/toshllm/releases/latest
#ToshLLM #MacIntel #Intel #IntelMac #AMD #MacOS #LocalAi #AiLocal #СтавитьВсем
Запускайте современные открытые модели на уже имеющемся у вас Mac с процессором Intel. Собственное ускорение Metal, без облачных технологий и платы за токены.
(Последние версии Jan.ai и Atomic.chat перестали поддерживать Mac Intel и теперь они только для Apple Silicon (M1-M6), но MSTY еще работает на Intel!)
Большинство локальных инструментов для больших языковых моделей в macOS ориентированы только на Apple Silicon. Компьютеры Intel Mac с дискретными графическими процессорами AMD, в том числе сборки Hackintosh, отстают: стандартные движки выдают поврежденный результат на дискретных графических процессорах AMD и считывают веса моделей через PCIe с гораздо меньшей скоростью, чем возможно.
✔️ ToshLLM решает эту проблему. Он объединяет llama.cpp встроенные исправления для AMD и оборачивает их в усовершенствованное родное приложение SwiftUI — так что карта, подобная RX 6700 XT, превращается из непригодной в действительно быструю.
👉 Первый запуск (Gatekeeper): релизы еще не заверены Apple Developer ID, поэтому macOS блокирует первое открытие. Перейдите в «Системные настройки» → «Конфиденциальность и безопасность» и нажмите «Открыть в любом случае», либо выполните команду:
xattr -dr com.apple.quarantine /Applications/ToshLLM.app
В разделе "Аудио" есть #Транскрибация моделью #Whisper и есть разделы "Изображение" и "Видео"!
#ToshLLM #MacIntel #Intel #IntelMac #AMD #MacOS #LocalAi #AiLocal #СтавитьВсем
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM