Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
🎙 Spellar AI – Smart meeting notes

Spellar AI — это инструмент для автоматического создания структурированных заметок со встреч с помощью искусственного интеллекта. Он записывает аудио, транскрибирует его, анализирует разговор и генерирует резюме с пунктами действий. Ключевое преимущество — приложение работает локально на вашем устройстве (macOS, iOS, iPadOS), не присоединяя бота к звонку, что обеспечивает конфиденциальность.
Как это работает:
- Локальная запись. Приложение захватывает аудио с вашего микрофона или системного звука, не требуя участия бота в конференции. Это позволяет работать с Zoom, Google Meet, Microsoft Teams и другими платформами. 
- Многоязычная транскрипция. Поддерживается более 100 языков с автоматическим определением языка. 
- ИИ-анализ. На основе транскрибации сервис создаёт резюме, выделяет ключевые моменты, решения и пункты действий. 
- ИИ-ассистент (Copilot). Во время встречи можно задавать вопросы ассистенту, чтобы уточнить детали или получить контекст. Есть специализированные режимы (например, для мозгового штурма или перевода). 
- Подготовка к встрече. Можно заранее подготовить повестку и тезисы прямо в событии календаря, и они появятся в интерфейсе при начале записи. 
- Интеграции. Готовые заметки и пункты действий можно автоматически экспортировать в Notion, Google Docs, Linear, Jira, Confluence и другие инструменты. 

Ключевые особенности:
- Мультимодельный ИИ. Можно выбрать одну из ведущих моделей (Claude, GPT, Gemini, Perplexity) или использовать собственный API-ключ. 
- Шаблоны встреч. Встроенные форматы для ежедневных стендапов, ретроспектив, продаж и других типов встреч, а также возможность создавать свои. 
- Поиск по истории. ИИ запоминает контекст прошлых встреч, что позволяет задавать вопросы о деталях, о которых договаривались несколько недель назад. 
- Тренер по речи. Помимо заметок, Spellar анализирует вашу речь: отслеживает слова-паразиты, даёт обратную связь по произношению, грамматике и чёткости. 

🔗 https://www.spellar.ai
⬇️ https://apps.apple.com/ru/app/spellar-ai-meeting-note-taker/id6473629578
Есть бесплатно, но крестик "закрыть" еле видно на странице тарифов! Из локальных моделей только #Whisper Medium! А вот Large и Turbo нет!
#SpellarAI #Spellar #Диктовка #Транскрибация #MacOS #iPad #iPhone #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💬 Jenny - Настольный ИИ-помощник с приоритетом локальных моделей — чат, инструменты для написания кода и артефакты с локальными моделями на вашем компьютере

Она может помочь вам писать код, редактировать файлы, выполнять команды, а также создавать графики и диаграммы. Вы выбираете модель, папку проекта и права доступа для ее инструментов. Вы также можете изменить ее имя и характер.
При использовании локальной модели Jenny обрабатывает ваши запросы на вашем компьютере и сохраняет там диалоги. Для локального чата вам не нужна учетная запись или ключ API. Ollama запускает модель; vLLM — еще один поддерживаемый вариант.
Jenny построена на основе моделей меньшего размера, примерно с 9–35 миллиардами параметров. Насколько хорошо она справится с задачей, зависит от выбранной вами модели и вашего оборудования. Ожидайте ошибок, особенно при выполнении сложных задач, и проверяйте код и команды, прежде чем полагаться на них.
Установка на Windows:
Скачайте Jenny-Setup-x64.exe и запустите его. Никаких страниц мастера не требуется. Установщик создает ярлык Jenny на рабочем столе.

🔗 https://github.com/SaltyPretz3l/jenny
(Обсуждение)
#Jenny #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: MiniCPM5-2B
OpenBMB выпустила MiniCPM5-2B — компактную модель на 2,5 млрд параметров

Новая версия после майской MiniCPM5-1B рассчитана на локальный запуск. По индексу Artificial Analysis модель лидирует среди открытых моделей до 4 млрд параметров. В обновлённой версии индекса v4.2 балл чуть ниже, но MiniCPM5-2B всё равно первая в своём классе — вровень с Qwen3.5 9B, которая в четыре раза больше.

💼 Главная сила — агентные задачи: на τ³-Banking делит первое место среди малых моделей, на GDPval-AA опережает всех. Слабее в знаниях, терминальном программировании и длинном контексте. Расход токенов на задачу втрое меньше, чем у Ling 3.0 Tiny.

Контекст 128K, вызов инструментов, цепочки рассуждений. После SFT на 400 млрд токенов и RL в модель дистиллировали 16 экспертных моделей, включая 5 агентных (OPD). Вместе с весами авторы открыли данные, рецепт и RL-стек.

Веса под Apache 2.0, доступны форматы GGUF, MLX, GPTQ и черновая DSpark для ускорения. Есть демо.

🔗 https://huggingface.co/openbmb/MiniCPM5-2B
🔗 https://artificialanalysis.ai/articles/openbmb-releases-minicpm5-2b
🔗 https://github.com/OpenBMB/MiniCPM
🔗 https://huggingface.co/spaces/openbmb/MiniCPM5-2B-Demo
Пост: https://x.com/OpenBMB/status/2096970974247956501
(Обсуждение)
#MiniCPM #MiniCPM52B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 5 лучших локальных приложений для преобразования текста в речь для Mac в 2026 году

📖 https://openvoxai.com/blog/top-5-local-tts-apps-for-mac-2026
1) OpenVox - https://t.me/Ai2Local/515
2) Voicebox - https://t.me/Ai2Local/222
3) Kokori
4) Murmur TTS
5) Bantr - https://t.me/Ai2Local/97

А еще есть:
- MimikaStudio https://t.me/Ai2Local/205
- Spokio https://spokio.pro - MacOS
- VoiceNPC https://www.voicenpc.com/ru - для iPhone · iPad · Mac · Apple Silicon
#OpenVox #Voicebox #Kokori #MurmurTTS #VoiceNPC #Spokio #TTS #MacOS #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Ling-3.0-flash-VL на 124B-6A

Ling-3.0-flash-VL - нативная мультимодальная модель нового поколения. Она создана на основе Ling-3.0-flash и включает визуальную информацию в полный процесс понимания, логического мышления, действий и проверки, выходя за рамки восприятия изображений и видео и решая реальные задачи с помощью зрения. 
Ling-3.0-flash-VL с общим количеством параметров 124 млрд, активированными параметрами всего 5,5 млрд на токен, поддержкой изображений и видео и контекстным окном до 1 млн токенов обеспечивает мощные мультимодальные логические и агентные возможности с исключительной эффективностью.

Обзор модели:
Ling-3.0-flash-VL унаследовала языковые, логические и контекстные возможности Ling-3.0-flash, дополнив их собственным пониманием изображений и видео. Модель имеет 124 миллиарда параметров, из которых только 5,5 миллиарда активируются для каждого токена, и поддерживает контекстное окно до 1 миллиона токенов.

Архитектура Ling-3.0-flash-VL предназначена для интеграции визуальной информации в логические и агентные рабочие процессы.

- Визуальный кодировщик ViT извлекает элементы из изображений и видео, в то время как двухслойный MLP-проектор выравнивает визуальные элементы с текстовыми представлениями для унифицированного мультимодального понимания и рассуждений;
- VideoRoPE кодирует как пространственные положения, так и временной порядок, позволяя модели понимать визуальные изменения с течением времени и поддерживая такие задачи, как локализация событий, ответы на вопросы в виде длинного видео и редактирование видеоклипов.;
- 42-Слойная гибридная магистраль чередует уровни KDA и Gated MLA в соотношении 5: 1, обеспечивая эффективную долговременную контекстную обработку текста, изображений, видео и расширенных историй задач агента.;
- Разреженная архитектура MoE поддерживает общую емкость модели в 124B параметров при активации только 5,5B параметров на токен, балансируя сильные мультимодальные возможности с эффективностью вывода.

В целом, эти проекты делают видение чем-то большим, чем просто входные данные, интегрируя его в целостный процесс понимания, рассуждений, планирования, действий и проверки.

🔗 https://huggingface.co/inclusionAI/Ling-3.0-flash-VL
(Обсуждение)
#Ling30flashVL #Ling #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Семейство Nex-N2.5
Nex-N2.5-Mini - 35B (A3B) - попробовать Free
Nex-N2.5-Pro - 397B (A17B) - попробовать Free
Nex-N2.5-Max - 1.6T (A49B)
Nex-N2.5 - Семейство агентных моделей нового поколения, созданных для решения долгосрочных задач в реальных условиях.
Nex-AGI официально представляет Nex-N2.5, семейство агентных моделей нового поколения.
Nex-N2.5 доступен в трех размерах: miniPro и Max.
Nex-N2.5-mini и Nex-N2.5-Pro продолжают развивать мультимодальные возможности Nex-N2, уделяя особое внимание использованию компьютера, просмотру веб-страниц и визуально ориентированным агентным возможностям.
Nex-N2.5-Max построена на базовой модели Mixture-of-Experts (MoE) с 1,6 триллионами параметров, работающей только с текстовыми данными. Это наша первая полноценная работа после обучения модели с триллионами параметров.
Для решения долгосрочных задач в реальных условиях Nex-N2.5 еще больше расширяет свои возможности непрерывного действия и самокоррекции с помощью визуальной обратной связи. Модели могут управлять компьютерами и браузерами, а также автономно выполнять и тестировать программы. Таким образом, зрение перестало быть просто способом ввода данных и превратилось в важнейший интерфейс, с помощью которого агент воспринимает окружающую среду, проверяет результаты и продвигается к выполнению задачи.
Опираясь на этот фундамент, мы расширили спектр сред для обучения агентов, типов задач и сценариев повышения производительности, а также впервые провели систематическое пост-обучение на триллионном масштабе параметров. Благодаря более широкому охвату задач и более качественной обратной связи с окружающей средой Nex-N2.5 обеспечивает дальнейший прогресс в научных исследованиях, интеллектуальной работе и решении сложных задач, связанных с повышением производительности. 

🔗 https://nex-agi.com
🔗 https://huggingface.co/nex-agi/Nex-N2.5-mini - 35B (A3B)
(Обсуждение)
🔗 https://huggingface.co/nex-agi/Nex-N2.5-Pro - 397B (A17B)
(Обсуждение)
#NexN25 #NexAGI #NexN25mini #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
⌨️ Uncensored AI Studio - Локальная AI-студия без цензуры для Windows, Linux и macOS. Графический интерфейс без настройки для генерации изображений, больших языковых моделей GGUF, преобразования текста в речь и речи в текст!

⚡️ ИИ "без цензуры" теперь умещается на флешке!

Разработчик выложил на GitHub инструменты для запуска нейросетей прямо с USB-накопителя — без интернета и установки на компьютер.

Что можно запустить: текстовые модели, генерацию изображений, распознавание и синтез речи. На флешку на 8 ГБ влезает несколько моделей, на 32 ГБ — уже приличный набор.
Тот же автор сделал портативную версию Claude-агента. Всё работает на Windows, macOS и Linux, API-ключи и настройки хранятся локально.
Uncensored AI Studio — это автономная студия искусственного интеллекта для Windows, Linux и macOS, не требующая установки. В отличие от облачных систем искусственного интеллекта, она работает исключительно на вашем собственном оборудовании без цензуры, отслеживания, подписок и необходимости входа в систему.
Он объединяет четыре основные локальные возможности искусственного интеллекта в один высокопроизводительный настольный интерфейс:
🎨 Генерация изображений (Stable Diffusion): создавайте и редактируйте высококачественные изображения в автономном режиме, используя веса моделей .safetensors, .gguf, или .ckpt .
💬 Текстовый чат (LLM): общайтесь в приватном режиме с языковыми моделями с открытым исходным кодом (формат GGUF), работающими на официальных высокопроизводительных llama.cpp бэкендах.
🎙 Преобразование речи в текст (Whisper): транскрибируйте голосовые записи и речь в текст в режиме реального времени с помощью встроенного whisper.cpp движка.
🗣 Преобразование текста в речь (Kokoro TTS): преобразование текстового вывода в максимально естественный и реалистичный голосовой звук в автономном режиме с использованием модели Kokoro-82M ONNX.

🔗 https://github.com/techjarves/OpenClaude-Portable
🔗 https://github.com/techjarves/Uncensored-Local-Studio
🎞 Посмотрите видео с настройкой и демонстрацией: https://youtu.be/yeFvP3SWMak
#UncensoredAIStudio #Uncensored #БезЦензуры #AIStudio #USBAI #AIUSB #Windows #Linux #MacOS #OpenClaudePortable #OpenClaude #AiPortable #Portable #StableDiffusion #SD #Whisper #Kokoro #TTS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🧠 GigaChat 3.5 Reasoning — первая в России открытая модель с рассуждениями

Выкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE.
🔗 https://t.me/gigadev_channel/75
Подробно: По бенчам сопоставима с DeepSeek V4 Flash при меньшем расходе токенов. Код и веса открыты.
⬇️ Скачать: https://huggingface.co/ai-sage/GigaChat3.5-432B-A28B-Reasoning-GGUF - Q4_K_M=262 GB
(Осталось под нее в октябре купить Mac Ultra M5-512Gb)
#GigaChat35Reasoning #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤡1