Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
🎙 Dictate — приложение для диктовки на Windows с открытым исходным кодом.

- Локальная транскрипция на устройстве
- Опциональная облачная транскрипция Groq, Deepgram, AssemblyAI и OpenRouter с сохраненной конфигурацией локального ключа API
Многие приложения для диктовки вынуждают вас оформлять подписку.
Но если ваша главная цель — преобразование речи в текст в разных приложениях, возможно, вам не придется платить каждый месяц.

Dictate:
- локальные модели Moonshine
- локальные модели NVIDIA Parakeet и Canary
- BYOK Groq (бесплатный уровень)
- BYOK Deepgram (200 бесплатных кредитов)
- BYOK AssemblyAI (50 бесплатных кредитов)
- BYOK OpenRouter

Для сравнения:
- Superwhisper Pro стоит 8,49 долларов в месяц или 84,99 долларов в год
- Ежегодный счет за Wispr Flow Pro составляет 15 долларов в месяц или 12 долларов в месяц.

Таким образом, вместо того, чтобы привязывать себя к другой подписке dictation, вы можете использовать местные модели или начать с бесплатных уровней провайдера / бесплатных кредитов.
Пока приоритет у Windows.
Следующей будет Linux.
С macOS придется подождать.

🔗 https://github.com/siddhantparadox/dictate
Скачать Бета-версия 0.1.0 canary-win-x64-dictate-Setup-canary.exe
(Обсуждение)
#Dictate #Moonshine #Parakeet #Canary #STT #Транскрибация #Диктовка #SoftAi #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😮 Apple спрятала LLM в каждом Mac — теперь к ней можно подключиться!

Бесплатный ИИ уже на вашем Mac. Инструмент командной строки, сервер, совместимый с OpenAI, и интерактивный чат — все это на устройстве с помощью Apple Intelligence. Никаких API-ключей, никаких облачных сервисов, никаких загрузок.

На каждом современном Mac уже лежит локальная языковая модель. Apple встроила её для Siri, но доступа к ней не давала.

Проект apfel открывает этот доступ. Модель 3B работает локально, без облаков и подписок. Поддерживает контекст до 4k токенов, умеет вызывать инструменты (tool calling) и совместима с OpenAI API.

💻 Можно использовать для автоматизации, экспериментов и тестов — все данные остаются на диске. Установка через Homebrew одной командой: brew install Arthur-Ficial/tap/apfel
Требования для установки:
macOS 26 Tahoe+, Apple Silicon (M1+), с поддержкой Apple Intelligence.
🔗 https://apfel.franzai.com
🔗 https://github.com/Arthur-Ficial/apfel
#apfel #MacOS #MCP #AppleSilicon #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Google запустил AI Edge Eloquent, бесплатное приложение для диктовки на iOS, которое обрабатывает голосовые команды локально.

Google AI Edge Eloquent. Это инструмент для голосовой диктовки, который работает в автономном режиме, транскрибирует вашу речь в режиме реального времени, автоматически удаляет лишние слова и выдает чистый, выверенный текст. Google Eloquent — полностью бесплатное приложение без подписки и ограничений по использованию.
Вам нужно просто открыть приложение, нажать на кнопку записи и начать говорить. На экране в режиме реального времени отображается осциллограмма вашего голоса и его расшифровка. Когда вы закончите, приложение автоматически обработает запись.

Слова-паразиты, такие как «э-э» и «а-а», исчезают, исправления в середине предложения сглаживаются, и остается чистый, легко читаемый текст, который можно скопировать прямо в буфер обмена. Четыре инструмента для преобразования текста обеспечивают дополнительный контроль.

Ключевые моменты: резюмирует ваш диктант, выделяя основные идеи в виде маркированного списка.
Формальный стиль: переписывает расшифровку в более профессиональном тоне.
Краткий вариант: оставляет только самое важное.
Расширенный вариант: добавляет подробности, если они нужны.

Также есть вкладка История, на которой хранятся все предыдущие расшифровки, а также статистика использования, например общее количество слов и скорость набора слов в минуту.

В отличие от большинства бесплатных приложений для диктовки, Google AI Edge Eloquent позволяет сохранять голосовые данные в полной конфиденциальности. С помощью переключателя в верхнем углу можно переключаться между двумя режимами. В полностью автономном режиме весь звук остается на вашем устройстве и обрабатывается с помощью моделей распознавания речи на основе Gemma локально. Данные не отправляются на сервер.

В облачном режиме распознавание речи по-прежнему происходит на устройстве, но модели Gemini обрабатывают очистку текста в облаке. Для тех, кому важна конфиденциальность или кто просто не хочет загружать голосовые данные удаленно, вполне подойдет полностью локальный вариант.

В приложении также есть персональный словарь, в который можно добавлять имена, технические термины и профессиональную лексику для повышения точности перевода. Вы также можете войти в систему, используя свою учетную запись Google, чтобы приложение автоматически подбирало часто используемые слова из ваших последних сообщений в Gmail.

Google AI Edge Eloquent — одна из лучших бесплатных альтернатив платным приложениям для диктовки в 2026 году.

Два самых популярных конкурента, Wispr Flow и Willow, стоят 15 долларов в месяц. Оба сервиса облачные и передают ваш аудиосигнал через удаленные серверы. SuperWhisper работает локально, обеспечивая более высокий уровень конфиденциальности, но стоит 85 долларов в год. Eloquent превосходит все три сервиса по цене, предоставляя то, что пользователи ценят больше всего, — чистый автоматический вывод текста без необходимости ручной очистки.

🔗 https://ai.google.dev/edge/eloquent?hl=ru
⬇️ https://apps.apple.com/us/app/google-ai-edge-eloquent/id6756505519
#Google #AIEdge #Eloquent #Диктовка #Транскрибация #App #iPhone #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 AgentWFY - Локальная среда выполнения для ИИ-агентов.

AgentWFY — это ПК приложение с открытым исходным кодом, которое позволяет агентам ИИ работать на вашем компьютере. Это не просто оболочка для чат-бота — у каждого агента есть собственная база данных SQLite, файловая система, выполнение JavaScript, управление браузером и триггеры автоматизации.
Расскажите агенту, что вам нужно, на простом английском языке. Он пишет код, создает базы данных, динамические информационные панели, настраивает задания cron и предоставляет конечные точки HTTP — и все это локально, на вашем компьютере.

Каждый агент представляет собой портативный каталог. Скопируйте его на другой компьютер, откройте — и все заработает.

🔗 https://github.com/AgentWFY/AgentWFY
Скачать для: macOS, Windows, Linux
(Обсуждение)
#AgentWFY #Windows #macOS #Linux #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Clawd Phone — это приложение для Android для совершения вызовов инструментов.

Clawd Phone — приложение для Android, которое позволяет вызывать нативные инструменты, перенимая рабочий процесс агента с настольного компьютера на мобильное устройство, и выполнять агентский поиск прямо на телефоне.
Он напрямую взаимодействует с Claude, запускает локальные инструменты на устройстве, может выполнять поиск по сотням файлов в телефоне, читать PDF-файлы и документы, получать данные из интернета, а также создавать и редактировать файлы в своем рабочем пространстве.

Он переносит на Android привычный для пользователей настольных компьютеров рабочий процесс с использованием агентов, при этом инструмент работает на телефоне. Он может выполнять поиск, читать файлы, искать в них информацию и напрямую использовать API Android.

Промежуточного сервера нет. Приложение напрямую взаимодействует с конечной точкой Anthropic. Все, что вам нужно, — это ваш собственный ключ API Claude.

Приложение может проверять состояние вашего устройства и создавать или редактировать текстовые файлы внутри Download/Clawd-Phone/ с помощью инструментов FileWrite и FileEdit.

Переписка сохраняется локально, и ее можно продолжить позже.

Что вы можете сделать
Задавайте такие вопросы, как:
"Найти все PDF-файлы на моем телефоне"
"Опишите несколько фотографий, которые я сделал на прошлой неделе"
"На что тратится все мое хранилище?"
"Прочитайте этот PDF-файл и обобщите его"
"Напишите подробный отчет об этом в формате PDF в report.md"
"Создайте HTML-слайд-деку, которую я могу использовать как PPT"
"Сделайте summary.csv из этих счетов-фактур"
"На этом телефоне есть какие-нибудь документы, связанные с налогами?"
"Отчет о времени показа"
"Какие последние мировые новости?"

21 инструмент для работы с файлами, контактами, календарем, местоположением, приложениями, информацией об устройстве и веб-поиском.

🔗 https://github.com/saadi297/clawd-phone
(Обсуждение)
#ClawdPhone #Clawd #App #Android #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 MobileClaw — Android-версия OpenClaw — встроенного в устройство ИИ-агента, который управляет вашим телефоном с помощью естественного языка. Сервер не требуется.

29 встроенных инструментов для Android, 21 готовое приложение, 10 облачных ИИ-сервисов и Gemma 4 на вашем устройстве — и все это на вашем телефоне.
MobileClaw — это версия OpenClaw для Android. Она превращает ваш телефон в ИИ-помощника: говорите ему, что делать, на своем родном языке, и он будет нажимать на экран, печатать, читать, звонить и прокладывать маршруты за вас. Работает с облачным ИИ (Claude, GPT, Gemini, 10 провайдеров) или полностью автономно с помощью Gemma 4 на устройстве.
Никакого сервера. Никакой подписки. Все делает ваш телефон.

🔗 https://chenkuansun.github.io/MobileClaw/
🔗 https://github.com/ChenKuanSun/mobileClaw
Скачать .APK
(Обсуждение)
#MobileClaw #OpenClaw #App #Android #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Horus-1.0-4B - 🇪🇬 Первая в Египте!

Серия Horus-1.0 состоит из моделей генерации текста, полностью обученных с нуля на триллионах чистых обучающих токенов.
Модель Horus: Horus-1.0-4B, с контекстной длиной 8K.
Модель доступна в 7 различных вариантах:
Полная версия с исходными весами!
6 сжатых вариантов, разработанных с учетом особенностей различных аппаратных средств и требований к развертыванию
Это обеспечивает исключительную гибкость для разработчиков и исследователей в зависимости от имеющихся у них вычислительных ресурсов.

Horus доступен как модель с открытым исходным кодом под лицензией TokenAI. Все доступные версии и подробные инструкции по использованию можно найти на официальном сайте:
🔗 https://tokenai.cloud/horus

Поскольку в Египте почти нет официально представленных моделей ИИ, которые полностью созданы и обучены с нуля как модели с открытым исходным кодом, Horus представляет собой важную веху в развитии отрасли.

- Horus — одна из самых мощных языковых моделей в арабском мире
- Horus — одна из самых мощных моделей в мире в своём классе
И все это подкреплено цифрами и результатами тестов.

Семейство моделей Horus:
- С открытым исходным кодом
- Полностью обучен с нуля
- Многоязычный
- Отлично справляется с последовательностью рассуждений
- Поддерживает мыслительные способности

Модель Horus-1.0-4B превзошла несколько бенчмарков, в том числе MMLU, показав результаты выше, чем у известных более крупных моделей, таких как Qwen 3.5-4B и Gemma 2 9B.

Он также превзошел те же модели в более сложных тестах MMLU Pro и даже обошел Llama 3.1 8B, несмотря на то, что эта модель более чем в два раза превосходит Horus по размеру.

Horus - не первая модель искусственного интеллекта из Египта, но это первая официально анонсированная модель с полностью открытым исходным кодом, полностью обученная с нуля из Египта.

🔗 https://huggingface.co/tokenaii/horus
🔗 https://huggingface.co/tokenaii/Hours-1.0-4B-GGUF
🔗 https://huggingface.co/tokenaii/Horus-1.0-4B-MLX
(Обсуждение)
============
Но еще есть более крупная (~40B) модель: Karnak: Enhanced Arabic–English Large Language Mode (это дообученная Qwen3-30B-A3B-Instruct-2507)
🔗 https://huggingface.co/Applied-Innovation-Center/Karnak
На данный момент она лидирует в OALL среди арабских моделей!

#Horus104B #Horus #HorusAI #Llama #Египет #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💡Теперь вы можете самостоятельно дообучить Gemma 4 с 8 ГБ видеопамяти!
Теперь вы можете дорабатывать Gemma 4 E2B и E4B в бесплатных блокнотах Unsloth! Для локального обучения Gemma-4-E2B вам понадобится 8 ГБ видеопамяти. Unsloth обучает Gemma 4 примерно в 1,5 раза быстрее, используя на 60 % меньше видеопамяти, чем FA2: https://github.com/unslothai/unsloth

Также нашли и исправили ошибки в обучающем курсе Gemma 4:

Из-за накопления града потери больше не будут такими огромными — раньше они могли составлять от 300 до 400, а теперь — от 10 до 15. В Unsloth это исправлено.

Ошибка индекса для 26B и 31B при логическом выводе — при использовании трансформеров логический вывод для 26B и 31B будет невозможен — мы это исправили.

use_cache=False Для E2B и E4B была абракадабра — см. https://github.com/huggingface/transformers/issues/45242

Аудио в формате float16 — переполнение при -1e9

Вы также можете обучить модели 26B-A4B и 31B или провести обучение через пользовательский интерфейс с помощью Unsloth Studio. Studio и блокноты подходят для работы с Vision, Text, Audio и логическим выводом.

Подробнее об исправлении ошибок, а также полезные советы и рекомендации читайте в нашем блоге/руководстве:
https://unsloth.ai/docs/models/gemma-4/train
(Обсуждение)
🔥 Дообучение Gemma 4 и 500+ опенсорс-моделей прямо в Google Colab
Unsloth запустили бесплатный инструмент для файнтюнинга моделей через браузер. Работает просто: открываешь ноутбук в Colab, запускаешь ячейки для развёртывания Unsloth Studio, выбираешь модель и датасет, жмёшь «Start Training».

Всё опенсорс, доступно более 500 моделей, включая свежую Gemma 4. Есть пошаговый туториал по дообучению — для тех, кто хочет разобраться в деталях.

🔗 https://colab.research.google.com/github/unslothai/unsloth/blob/main/studio/Unsloth_Studio_Colab.ipynb
🔗 https://github.com/unslothai/unsloth
🔗 https://unsloth.ai/docs/models/gemma-4/train

=========
И еще есть: Мультимодальный Fine-Tuner Gemma
Точная настройка Gemma 4 и 3n с использованием аудио, изображений и текста на Apple Silicon с помощью PyTorch и шейдеров Metal Performance.
🔗 https://github.com/mattmireles/gemma-tuner-multimodal

#Gemma4 #Unsloth #finetune #train #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 Stavrobot - Ваш персональный помощник на основе ИИ.

Stavrobot — это персональный ИИ-помощник, созданный по принципу «только тот доступ, который нужен ИИ-помощнику, и не более того».
Он обладает всеми преимуществами ИИ-помощника, но при этом ориентирован на «песочницу», изоляцию и минимальные разрешения.

Безопасно. Легко. Расширяемо.
Работает в контейнерах, взаимодействует с вашими приложениями для обмена сообщениями, запоминает самое важное. Развертывается с помощью docker compose up.

Вы целый день общаетесь с ИИ, но он все забывает, ничего не может сделать сам и живет на чужом сервере.
Stavrobot — это ИИ-помощник, который действительно работает на вас: он запоминает ваши разговоры, выполняет задачи, пока вы спите, отправляет сообщения от вашего имени и полностью находится под вашим контролем. Никакой привязки к облаку, сбора данных и ограничений.

Характеристики:
- Безопасно. Все работает в контейнере, ваша операционная система полностью скрыта от ИИ. ИИ не видит никаких секретов, если только вы сами этого не захотите.
- Легко. Не нужно запускать по одному контейнеру для каждого компонента. Все плагины работают в одном контейнере, разделенном с помощью Unix-разрешений.
- Используйте любую модель. nRouter, Anthropic/OpenAI. Бот может использовать все, что поддерживает Pi.
- Интеграция с Signal/Telegram/WhatsApp/электронной почтой. Обмен сообщениями с форматированием, вложениями и т. д.
- Трехуровневая система знаний. Все без потери контекста. Интеллектуальнаясистема, которая прозрачно извлекает данные из своей памяти.
- Низкое потребление токенов. Оптимизация для снижения потребления токенов. Она даже использует TOON внутри себя.
- Плагины. Плагины расширяют возможности Stavrobot, достаточно указать URL репозитория git. Плагины изолированыдруг от друга — каждый из них работает как отдельный пользователь системы, не имеющий доступа к файлам и настройкам других плагинов.
- Субагенты. Создавайте субагентов с собственным контекстом диалога, системным запросом и ограниченным доступом к инструментам. Это удобно для общенияс внешними пользователями с целью выполнения задач или организации процессов, при этом между внешним пользователем и основным агентом есть буфер.
- Самопрограммирование. Самостоятельное развитие.
Выполнение Python в изолированной среде. Произвольный Python с зависимостями pip через uv, изолированный от среды хоста.
- Планирование. Агент может планировать собственные повторяющиеся или разовые задачи.

🔗 https://stavrobot.stavros.io
🔗 https://github.com/skorokithakis/stavrobot
(Обсуждение)
#Stavrobot #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
Модель: ACE-Step 1.5 - Наконец-то вышла альтернатива Suno с открытым исходным кодом! Самая мощная локальная модель для создания музыки, которая превосходит большинство коммерческих альтернатив! ACE-Step 1.5 — это музыкальная модель с открытым исходным кодом…
🎵 ACE-Step 1.5 XL: генератор музыки с улучшенным звуком

Вышла старшая версия генератора музыки ACE-Step. В линейке три модели: xl-base, xl-sft и xl-turbo.
Для запуска нужно минимум 12 ГБ VRAM (с оффлоадом), но лучше от 20 ГБ. Все языковые модели совместимы между собой.

На сайте есть примеры работы XL-версии. Звук стал чище, но «песочек» и характерная нейросетевая окраска всё ещё слышны.

🔗 https://ace-step.github.io/ace-step-v1.5.github.io/
🔗 https://huggingface.co/ACE-Step/acestep-v15-xl-base
🔗 https://huggingface.co/ACE-Step/acestep-v15-xl-sft
🔗 https://huggingface.co/ACE-Step/acestep-v15-xl-turbo
🔗 https://github.com/ace-step/ACE-Step-1.5?tab=readme-ov-file#-model-zoo
🔗 https://huggingface.co/spaces/ACE-Step/Ace-Step-v1.5

📖 Статья: Бесплатная нейросеть для генерации музыки локально: ACE-Step 1.5 обходит Suno на бенчмарках
#ACEStep15 #ACEStep #Suno #AiMusic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Попался пост про локальный переводчик видео:
Берем ставим Subtitle Edit - только ставьте версию 4.х, 5-е еще сырые.
Там под капотом есть Faster-Wisper XXL через него можно получить субтитры (укажите параметр --sentence чтобы сохранить предложения).
Модель используйте large-v2 или large-v3-turbo.

Подготавливаем субтитры склеивая предложения которые всё же разбились.
Далее всё в том же Subtitle Edit делаем перевод субтитров подключив раз вам нужно локально - модель gemma 4 .

Далее полученные субтитры озвучиваем через Балаболка + NaturalVoiceSAPIAdapter + при желании оффлайн голоса.
Обязательно поставьте флажок - Автоматически увеличивать скорость.

Если готовы заморочиться можете использовать словари для Edge, можете вместо голосов Edge использовать F5-TTS. Об этом читайте в этой ветке.

Накладываем аудио с переводом на видео.
Готово - вы получили перевод видео 100% локально и бесплатно

Подробнее про #перевод видео автор писал тут.
#AiTranslate #LocalAi #AiLocal
ℹ️ Чтобы в моделях gemma 4 отключить размышления нужно в системный промт добавить фразу:
disalble reasoning and thought. </thought off>

Успешно протестировано с моделью 31b по API из Google Studio.
Кстати OpenAI совместимое API для Google Studio - если кто не знает:
https://generativelanguage.googleapis.com/v1beta/openai/v1/chat/completions

модели соответственно:
models/gemma-4-31b-it
models/gemma-4-26b-a4b-it
В день доступно 1500 запросов, с лимитом 15 запросов в минуту.
#gemma4 #Prompt #Промт #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📖 Наглядное руководство по Gemma 4

Эта визуальная книга создана на основе «Визуального руководства по Gemma 4» Маартена Гротендорста.
Полную версию книги можно найти по ссылке:
🔗 https://www.visualbook.app/books/public/v7qureynd8ie/a_more_visual_guide_to_gemma_4
На каждом слайде есть раздел для комментариев, где вы можете задавать вопросы.

📖 А еще есть: "Наглядное руководство по Gemma 4"
🔗 https://newsletter.maartengrootendorst.com/p/a-visual-guide-to-gemma-4?hide_intro_popup=true

📖 Gemma 4 от Google меняет все в сфере искусственного интеллекта с открытым исходным кодом
🔗 https://freedium-mirror.cfd/https://www.towardsdeeplearning.com/googles-gemma-4-changes-everything-for-open-source-ai-ecd91934458f
#Gemma4 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM