✨ Обновленные плагины для LM Studio уже доступны.
Веб-исследование Plug'n'Play, полностью локально!
- DuckDuckGo Переработанная версия https://lmstudio.ai/vadimfedenko/duck-duck-go-reworked
Переработанный плагин DuckDuckGo.
- visit-website-reworked https://lmstudio.ai/vadimfedenko/visit-website-reworked
Переработанный плагин с функцией прокси, который позволяет языковым моделям «посещать» веб-сайты, предоставляя им ссылки, URL-адреса изображений и текстовое содержимое любой веб-страницы.
(Обсуждение)
#LMStudio #DuckDuckGo #LocalAi #AiLocal
Веб-исследование Plug'n'Play, полностью локально!
- DuckDuckGo Переработанная версия https://lmstudio.ai/vadimfedenko/duck-duck-go-reworked
Переработанный плагин DuckDuckGo.
- visit-website-reworked https://lmstudio.ai/vadimfedenko/visit-website-reworked
Переработанный плагин с функцией прокси, который позволяет языковым моделям «посещать» веб-сайты, предоставляя им ссылки, URL-адреса изображений и текстовое содержимое любой веб-страницы.
Автору нравится использовать его с Qwen 3.5 27B в качестве замены Perplexity!
Кстати, в LM Studio с Qwen постоянно происходил сбой при вызовах инструментов. Автор исправил это, создав собственный шаблон Jinja Prompt. С тех пор все работает идеально. Даже версия 9b отлично подходит для исследований. Он выложил шаблон Jinja на Pastebin, если кому-то понадобится...
(Обсуждение)
#LMStudio #DuckDuckGo #LocalAi #AiLocal
👍2
Распознавание речи происходит полностью в автономном режиме.
При первом запуске необходимо загрузить модели Whisper с Hugging Face. Это единственное использование разрешения на доступ в Интернет.
В приложении Whisper также может переводить все поддерживаемые языки на английский.
Как получить максимальную отдачу от Whisper:
- Удерживайте кнопку нажатой во время разговора
- Сделайте небольшой перерыв перед началом работы
- Говорите четко, громко и в умеренном темпе
- Обратите внимание на ограничение в 30 секунд на запись
(Обсуждение)
===========
Это плавающая кнопка для голосового ввода, которая работает поверх любого приложения. Нажмите, чтобы записать, нажмите еще раз, чтобы расшифровать, — текст будет вставлен в выделенное поле.
Также поддерживается дополнительная постобработка (удаление знаков препинания, форматирование, командный режим для использования в терминале).
(Обсуждение)
Аналоги по тегу: #Диктовка
#Whisper #App #Android #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Модель выдаёт аудио в 48 кГц вместо стандартных для TTS 24 кГц. Звучит чище, детальнее — особенно заметно на голосовых нюансах.
Работает на 1 ГБ видеопамяти. Можно запустить даже на слабой видеокарте или в бесплатном Colab.
Доступны готовые варианты для быстрого старта: демо на Hugging Face, Colab-ноутбук и установка через Pinokio.
и https://huggingface.co/YatharthS/LuxTTS
и https://huggingface.co/spaces/YatharthS/LuxTTS
или https://colab.research.google.com/drive/1cDaxtbSDLRmu6tRV_781Of_GSjHSo1Cu?usp=sharing
или https://pinokio.co/item.html?uri=https%3A%2F%2Fgithub.com%2FTeletambe%2FLuxTTS&parent_frame=https://yandex.ru/
#LuxTTS #TTS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Ассистент научился искать информацию в сети прямо во время диалога, а также получил долгосрочную память — теперь ИИ-помощник запоминает все важные для пользователя факты и использует их в диалогах.
По цифрам: Ultra обходит DeepSeek-V3-0324 и Qwen3-235B в математике и reasoning. Lightning — на бенчах сравним с сопоставимыми по размеру Qwen, а на аренах уровень GPT-4o.
Обучающие данные:
Базовый обучающий корпус GigaChat 3 охватывает 10 языков и включает в себя книги, научные материалы, наборы данных с кодом и математические наборы данных. Все данные проходят дедупликацию, языковую фильтрацию и автоматическую проверку качества с использованием эвристических методов и классификаторов.
Синтетические данные по-прежнему играют важную роль в обеспечении качества. В более широком обучающем корпусе мы использовали около 5,5 триллионов синтетических токенов, в том числе:
- данные о вопросах и ответах, сгенерированные на основе исходных текстов,
- обратные цепочки подсказок для генерации структурированных данных,
- заметки, созданные с помощью модели и встроенные в тексты,
- миллионы синтетических задач с решениями по математике и программированию в стиле олимпиад,
- синтетические тесты для задач, связанных с написанием кода и логическими рассуждениями.
и https://huggingface.co/ai-sage/GigaChat3.1-702B-A36B-GGUF
================
#GigaChat31 #GigaChat #GGUF #aisage #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Веса стримятся с диска, так что скорость всего полтокена в секунду. Но инференс код навайбкодили и модель не супер агрессивно квантизировали, так что тут можно ускорить как минимум в несколько раз.
(Обычно такая модель занимает под 400 Гб. и для ее запуска надо как минимум Mac Studio 512Gb, а тут всего iPhone 17 Pro!)
#iPhone #Qwen35 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Airi — ИИ-компаньон с голосом и аватаром в стиле VTuber
На GitHub выложили открытый проект Airi — локальный ИИ-ассистент с анимированным аватаром и голосовым общением. Работает на вашем компьютере, подключается к разным языковым моделям через API или Ollama.
Что умеет:
• Общается голосом через ElevenLabs
• Поддерживает большинство провайдеров LLM, включая локальные модели
• Играет в Minecraft и Factorio
• Интегрируется с Discord и Telegram
• Запоминает контекст диалогов
Проект заточен под персонализированное общение — модель запоминает переписку и подстраивается под стиль взаимодействия.
🔗 https://github.com/moeru-ai/airi
#Airi #AiAgent #AgentAi #LocalAi #AiLocal
На GitHub выложили открытый проект Airi — локальный ИИ-ассистент с анимированным аватаром и голосовым общением. Работает на вашем компьютере, подключается к разным языковым моделям через API или Ollama.
Что умеет:
• Общается голосом через ElevenLabs
• Поддерживает большинство провайдеров LLM, включая локальные модели
• Играет в Minecraft и Factorio
• Интегрируется с Discord и Telegram
• Запоминает контекст диалогов
Проект заточен под персонализированное общение — модель запоминает переписку и подстраивается под стиль взаимодействия.
#Airi #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Новая модель на 3 млрд параметров умеет не только распознавать текст с изображений и документов, но и конвертировать структурированные элементы в SVG-код. Работает с диаграммами, UI-макетами и научными графиками.
Доступны две версии: базовая для OCR и специализированная для генерации SVG. Есть демо для быстрого тестирования.
Модель: https://huggingface.co/rednote-hilab/dots.mocr
и https://huggingface.co/rednote-hilab/dots.mocr-svg
#dotsmocr #OCR #SVG #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
MolmoWeb - это семейство полностью открытых мультимодальных веб-агентов. Агенты MolmoWeb достигают самых современных результатов, превосходящих аналогичные модели с открытым весом, такие как Fara-7B, UI-Tars-1.5-7B и Holo1-7B.
MolmoWeb-8B также превосходит агенты set-of-marks (SoM), построенные на гораздо более крупных моделях closed frontier, таких как GPT-4o. Кроме того, авторы продемонстрировали стабильный прирост результатов за счет масштабирования времени тестирования с помощью параллельного развертывания с отбором лучших из N вариантов, достигнув показателей 94,7 % и 60,5 % pass@4 (по сравнению с 78,2 % и 35,3 % pass@1) на WebVoyager и Online-Mind2Web соответственно.
MolmoWeb-4B основан на архитектуре Molmo2, в которой в качестве системы технического зрения используются Qwen3-8B и SigLIP 2.
Узнайте больше о семействе MolmoWeb из анонса в блоге и технического отчета.
(Обсуждение)
#MolmoWeb #MolmoWeb4B #MolmoWeb8B #Molmo2 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
✨ Text-Generation-WebUi - локальный интерфейс LLM. Работа с текстом, визуализация, вызов инструментов, обучение и многое другое. 100 % автономная работа. Выпущена версия text-generation-webui 4.1 с поддержкой вызова инструментов в пользовательском интерфейсе!…
Что нового: https://github.com/oobabooga/text-generation-webui/releases
#TextGenerationWebUi #DeepReason #Windows #Linux #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Две новые доработанные версии Qwen3.5 «Neo» ориентированы на быстрое и эффективное принятие решений!
👉 Qwen3.5‑4B‑Neo
Оптимизированная для логического вывода доработка Qwen3.5‑4B. Основное внимание уделяется эффективной последовательности рассуждений: более коротким внутренним цепочкам рассуждений, снижению стоимости токенов и повышению точности.
👉 Qwen3.5‑9B‑Neo
Более крупный вариант, доработанный на основе Qwen3.5‑9B.
Версии GGUF также доступны в коллекции здесь: https://huggingface.co/collections/Jackrong/qwen35-neo
(Обсуждение)
#Qwen354BNeo #Qwen359BNeo #GGUF #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
📱 InferrLM - Локальный ИИ на iOS и Android
InferrLM - это мобильное приложение, которое переносит LLMs и SLMs непосредственно на ваше устройство Android и iOS и позволяет вашему устройству действовать как локальный сервер. Также поддерживаются облачные модели, такие как Claude, Gemini и ChatGPT. Вложения файлов с RAG также хорошо поддерживаются для локальных моделей. В InferrLM теперь есть поддержка MLX.
🔗 https://www.inferrlm.app
Проект: https://github.com/sbhjt-gr/InferrLM
📱 Android: InferrLM: On-device AI https://play.google.com/store/apps/details?id=com.gorai.ragionare
iOS: https://apps.apple.com/us/app/inferrlm/id6754396856
(Обсуждение)
Все аналоги для Android https://t.me/Ai2Local/22
Все аналоги для iPhone https://t.me/Ai2Local/21
#InferrLM #Android #iOS #iPhone #App #LLM #RAG #MLX #LocalAi #AiLocal
InferrLM - это мобильное приложение, которое переносит LLMs и SLMs непосредственно на ваше устройство Android и iOS и позволяет вашему устройству действовать как локальный сервер. Также поддерживаются облачные модели, такие как Claude, Gemini и ChatGPT. Вложения файлов с RAG также хорошо поддерживаются для локальных моделей. В InferrLM теперь есть поддержка MLX.
Проект: https://github.com/sbhjt-gr/InferrLM
📱 Android: InferrLM: On-device AI https://play.google.com/store/apps/details?id=com.gorai.ragionare
iOS: https://apps.apple.com/us/app/inferrlm/id6754396856
(Обсуждение)
Все аналоги для Android https://t.me/Ai2Local/22
Все аналоги для iPhone https://t.me/Ai2Local/21
#InferrLM #Android #iOS #iPhone #App #LLM #RAG #MLX #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💡 NoobScribe — это API для расшифровки, совместимый с Whisper, и веб-интерфейс для записи совещаний, расшифровки аудио и сохранения информации о выступающих на разных сессиях с помощью дневниковых записей и функции памяти выступающих.
🔗 https://github.com/meganoob1337/NoobScribe
(Обсуждение)
#NoobScribe #Whisper #Транскрибация #LocalAi #AiLocal
База была создана parakeet-diarized, ссылка в разделе ATTRIBUTIONS(.)md в репозитории
NoobScribe предоставляет совместимый с Whisper API для расшифровки аудио, хотя моими основными дополнениями являются веб-интерфейс и конечные точки для управления записями, расшифровками и спикерами.
Он работает в Docker (на центральном процессоре или с помощью nvidia docker toolkit на графическом процессоре), использует аудиосистему Pyannote для диаризации и nvidia/canary-1b-v2 для расшифровки.
Добавить записи можно двумя способами: загрузить аудиофайл или записать звук с рабочего стола (через функцию демонстрации экрана в браузере) и/или с микрофона.
Затем эти аудиозаписи транскрибируются с помощью Canary-1b-v2 и диаризуются с помощью pyannote audio
После завершения транскрибирования и диаризации можно сохранить обнаруженные голоса (их эмбеддинги из pyannote) в векторной базе данных (Chroma) и заменить общие названия голосов (SPEAKER_00 и т. д.) на имена, которые вы указали.
Кроме того, программа проверяет существующие расшифровки на наличие совпадающих эмбеддингов для новых голосов или новых эмбеддингов для одного голоса, чтобы обновить их задним числом.
У диктора может быть несколько эмбеддингов (например, при использовании разных микрофонов эмбеддинги иногда не совпадают — так можно повысить точность распознавания диктора).
Все данные хранятся локально на вашем компьютере, и вам нужен только Docker и токен HF_TOKEN (если вы хотите использовать функцию ведения дневника, так как модель Pyannote является закрытой.
Создали это, чтобы лучше транскрибировать записи совещаний и т. д. и потом обобщать их с помощью большой языковой модели. В этом плане диаризация речи спикера очень помогает по сравнению с обычной транскрипцией.
(Обсуждение)
#NoobScribe #Whisper #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - meganoob1337/NoobScribe: NoobScribe is a Whisper-compatible transcription API and Web UI for recording meetings, transcribing…
NoobScribe is a Whisper-compatible transcription API and Web UI for recording meetings, transcribing audio, and remembering speakers across sessions with diarization and speaker memory. - meganoob1...
Оказывается есть небольшая модель, обученная для извлечения персональных данных!
Модель GLiNER-PII создана на основе моделей Gretel GLiNER PII/PHI. Она построена на базе GLiNER large-v2.1 и обнаруживает и классифицирует широкий спектр персональных данных (PII) и защищенной медицинской информации (PHI) в структурированном и неструктурированном тексте. Модель не генерирует данные, а создает аннотации сущностей на уровне фрагментов с оценкой достоверности по более чем 55 категориям. Модель разработана компанией NVIDIA.
Еще рекомендуют использовать: Llama 3.3 70B или Mistral Large.
#GLiNERPII #NVIDIA #PHI #PII #ПерсональныеДанные #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
huggingface.co
nvidia/gliner-PII · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Whisperian — это инструмент голосового ввода, созданный для писателей и всех, кто не любит печатать и хочет перенести свои сложные рабочие процессы преобразования речи в текст на свои устройства Android.
Приложение интегрируется с системой Android либо как голосовая клавиатура, либо как компактное системное наложение, которое не мешает, когда оно не нужно...
Whisperian — простой инструмент/приложение для запуска локальных моделей преобразования текста в речь на Android, которые можно использовать вместо диктовки в Gboard, параллельно с обычной клавиатурой.
Можно сказать, что это уже довольно проработанное приложение, по функциональности сравнимое с VoiceInk / Handy для MacOS.
В настоящее время приложение поддерживает 21 локальную модель. Среди дополнительных функций — пользовательские подсказки/режимы постобработки и история расшифровки. Однако локальная постобработка пока не интегрирована и доступна только у облачных провайдеров.
(Обсуждение)
#Whisperian #Android #STT #App #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM