Local Ai
🤖 Ai2 выпустил открытого браузерного агента MolmoWeb
Команда Molmo запустила open-source агента для браузера. Работает на моделях Molmo 2 (4B и 8B параметров).
Агент анализирует страницу через скриншот и сам решает, куда кликнуть, что ввести и где проскроллить. Для безопасности доступа к паролям и финансам у него нет.
По результатам четырёх бенчмарков — лучший среди открытых решений. Обходит агентов на GPT-4o и побеждает OpenAI CUA в трёх из четырёх тестов.
🔗 https://allenai.org/blog/molmoweb
🔗 https://github.com/allenai/molmoweb
🔗 https://huggingface.co/collections/allenai/molmoweb
🔗 https://playground.allenai.org
#MolmoWeb #MolmoWeb4B #MolmoWeb8B #Molmo2 #LocalAi #AiLocal
Команда Molmo запустила open-source агента для браузера. Работает на моделях Molmo 2 (4B и 8B параметров).
Агент анализирует страницу через скриншот и сам решает, куда кликнуть, что ввести и где проскроллить. Для безопасности доступа к паролям и финансам у него нет.
По результатам четырёх бенчмарков — лучший среди открытых решений. Обходит агентов на GPT-4o и побеждает OpenAI CUA в трёх из четырёх тестов.
#MolmoWeb #MolmoWeb4B #MolmoWeb8B #Molmo2 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Найди цену, прочитай статью, разберись с сайтом — и всё это локально без VPN, без подписки и без слежки. Модель работает прямо на твоём компьютере Windows или Mac.
Возможности:
Делает реальные задачи, не просто отвечает!
- Поиск в интернете
Находит актуальную информацию, читает страницы, собирает данные из нескольких источников.
- Работа в браузере
Открывает сайты, заполняет формы, взаимодействует со страницами как человек.
- Модель на твоём ПК
AI-модель запускается прямо на твоём компьютере — даже при плохом интернете. Никаких чужих серверов, никакой зависимости от зарубежных сервисов.
- Выбор модели
Три режима: быстрый (1.7B), сбалансированный (4B) и мощный (8B). Выбирай под задачу — прямо в интерфейсе.
- История чатов
Все разговоры сохраняются на твоём компьютере. Переключайся, переименовывай, возвращайся к старым диалогам.
- Загрузка файлов
Загружай PDF и TXT прямо в чат. Дока прочитает документ и ответит на вопросы по его содержимому — без облака, без утечек.
- Бесплатно навсегда
Базовые возможности бесплатны без ограничений по времени. Никаких подписок.
Примеры задач:
Что можно попросить прямо сейчас:
◎ Найди последние новости про санкции и кратко объясни что изменилось
Ищет по нескольким открытым источникам, собирает в понятный ответ
◈ Открой эту статью и перескажи главное за минуту
Читает страницу по ссылке и выдаёт краткое резюме без лишней воды
◇ Переведи этот английский текст и выдели три главные мысли
Переводит и структурирует — без копипасты в переводчик и обратно
◉ Как получить загранпаспорт через Госуслуги? Какие документы нужны?
Читает актуальные инструкции прямо с официального сайта — никаких устаревших данных
○ Что пишут в открытых источниках об этой компании? Ищу туда работу
Ищет отзывы, новости и упоминания — даёт честную картину до собеседования
◌ Объясни простыми словами что означают эти пункты в договоре аренды
Разбирает юридический текст на человеческий язык, указывает на подводные камни
◫ Напиши вежливый ответ на негативный отзыв о моём магазине
Составит корректный ответ в нужном тоне — хоть для Wildberries, хоть для 2ГИС
◆ «Помоги написать претензию в магазин на русском, по закону о защите прав потребителей»
Составляет документ на понятном русском — без юридического птичьего языка
◪ Вот PDF договора — есть там подводные камни? На что обратить внимание?
Читает загруженный документ и выделяет спорные пункты. Файл остаётся только на твоём компьютере
◫ Возобновим вчерашний разговор — что мы решили про бюджет?
История чатов сохраняется локально — можно вернуться к любому диалогу в любой момент
(Подробный пост Автора)
https://github.com/babikov/doka-site
#dokaai #doka #Windows #MacOS #SoftAi #AiSoft #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1👎1
This media is not supported in your browser
VIEW IN TELEGRAM
Это версия #Jan с встроенным Google TurboQuant для тех, у кого мало ОЗУ! (На 1-м запуске модель можно не скачивать, а потом ее импортировать, если есть скачанные ранее!)
Первый с Встроенный Google TurboQuant!
- В 8 раз быстрее
TurboQuant вычисляет внимание в 8 раз быстрее, чем стандартные 32-битные модели на графических процессорах H100, поэтому вы получаете ответы в режиме реального времени при любом масштабе.
- В 6 раз Меньше памяти
Кэш KV сжимается как минимум в 6 раз без потери качества, что значительно снижает затраты на инфраструктуру.
- Нулевая Потеря Точности
Сжато до 3 бит — без переобучения, тонкой настройки и снижения производительности модели.
Разработчики исправили llama.cpp с помощью нового метода сжатия TurboQuant от Google, а затем запустили Qwen 3.5–9B на обычном MacBook Air (M4, 16 ГБ) с контекстом из 20 000 токенов.
Раньше на этом устройстве практически невозможно было обрабатывать большие контекстные запросы. Но с новым алгоритмом это стало возможным. Представьте, что вы можете бесплатно использовать OpenClaw на обычном устройстве! Для этого нужен всего лишь MacBook Air или Mac Mini, даже не самая дорогая модель Pro. Он все еще немного тормозит, но новые чипы ускоряют работу.
Графический интерфейс создан на основе Jan, лицензия MIT это позволяет. Однако в llama.cpp добавлен алгоритм Google, который работает вместе с графическим интерфейсом.
(Обсуждение)
Для iPhone/iPad: https://apps.apple.com/de/app/atomic-chat-private-local-ai/id6761720226?l=en-GB
Для Android https://play.google.com/store/apps/details?id=chat.atomic.app
#atomicchat #atomic #GoogleTurboQuant #TurboQuant #MacOS #iPhone #iPad #Android #SoftAi #AiSoft #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
Yagami предлагает вам:
- Агентный веб-поиск: search, search-advanced, code, company, similar
- Детерминированная экстракция: fetch (browse & present)
- Асинхронный глубокий агентный веб-поиск: deep start / deep check
В этом демонстрационном видео используется Yagami MCP, управляемый qwen3.5-9b через vLLM.
Есть расширение pi-yagami-search, которое заменяет Exa!
(Обсуждение)
#Yagmi #Exa #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔍 OpenResearcher — опенсорсный агент на 30B параметров для глубоких исследований
OpenResearcher — это полностью открытая агентная языковая модель (30B-A3B), предназначенная для долгосрочных глубоких исследований. Она демонстрирует впечатляющую точность 54,8% на BrowseComp-Plus, превосходя по этому показателю GPT-4.1, Claude-Opus-4, Gemini-2.5-Pro, DeepSeek-R1 и Tongyi-DeepResearch. Полностью открыли исходный код для обучения и оценки, включая данные, модель, методологию обучения и систему оценки, чтобы каждый мог заниматься глубокими исследованиями.
Модель заточена под анализ больших объёмов информации и построение структурированных выводов.
Nvidia Nemotron интегрировал OpenResearcher в свои инструменты. Модель доступна на GitHub и Hugging Face — можно запустить локально или потестить в демо.
🔗 https://github.com/TIGER-AI-Lab/OpenResearcher
🔗 https://huggingface.co/OpenResearcher/OpenResearcher-30B-A3B
🔗 https://huggingface.co/spaces/OpenResearcher/OpenResearcher
#OpenResearcher #DeepResearch #AiModel #ModelAi #LocalAi #AiLocal
OpenResearcher — это полностью открытая агентная языковая модель (30B-A3B), предназначенная для долгосрочных глубоких исследований. Она демонстрирует впечатляющую точность 54,8% на BrowseComp-Plus, превосходя по этому показателю GPT-4.1, Claude-Opus-4, Gemini-2.5-Pro, DeepSeek-R1 и Tongyi-DeepResearch. Полностью открыли исходный код для обучения и оценки, включая данные, модель, методологию обучения и систему оценки, чтобы каждый мог заниматься глубокими исследованиями.
Модель заточена под анализ больших объёмов информации и построение структурированных выводов.
Nvidia Nemotron интегрировал OpenResearcher в свои инструменты. Модель доступна на GitHub и Hugging Face — можно запустить локально или потестить в демо.
#OpenResearcher #DeepResearch #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Список программ, позволяющих осуществлять поиск в интернете с помощью искусственного интеллекта:
Список организован в виде временной шкалы и содержит программы, поддерживающие следующие сценарии использования:
- Веб-поиск с обобщением результатов с помощью больших языковых моделей и уточняющими вопросами.
- Чат с большими языковыми моделями с поддержкой веб-поиска через вызов функций.
- Веб-исследования с помощью агентов для создания отчетов.
#awesomeaiwebsearch #aiwebsearch
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - felladrin/awesome-ai-web-search: List of software that allows searching the web with the assistance of AI: https://hf…
List of software that allows searching the web with the assistance of AI: https://hf.co/spaces/felladrin/awesome-ai-web-search - felladrin/awesome-ai-web-search
Собственная функция преобразования речи в текст для вашего Mac с возможностью диктовки на уровне всей системы, расшифровкой файлов, подсказками, профилями, историей, словарем и фрагментами.
Транскрибируйте аудио с помощью встроенных в устройство моделей искусственного интеллекта или облачных API (Groq, OpenAI), а затем обрабатывайте результат с помощью пользовательских подсказок для больших языковых моделей. Ваши голосовые данные остаются на вашем Mac с локальными моделями — или вы можете использовать облачные API для более быстрой обработки.
Транскрипция:
- Восемь движков — WhisperKit (более 99 языков, потоковая передача, перевод), Parakeet TDT v3 (25 европейских языков, очень быстрая), Apple SpeechAnalyzer (macOS 26+, загрузка модели не требуется), Qwen3 ASR (на основе MLX), Voxtral (локальный Voxtral Mini 4B, на основе MLX), Groq Whisper, OpenAI Whisper и OpenAI Compatible (любой API, совместимый с OpenAI)
- На устройстве или в облаке — вся обработка выполняется локально на вашем Mac или с использованием API Groq/OpenAI Whisper для более быстрой обработки.
- Предварительный просмотр трансляции — частичная расшифровка в режиме реального времени во время разговора (WhisperKit)
- Транскрипция файла — пакетная обработка нескольких аудио- и видеофайлов с помощью перетаскивания
- Экспорт субтитров — экспорт расшифровок в формате SRT или WebVTT с указанием временных меток.
- Словарь — термины повышают точность распознавания речи. Функция исправления автоматически устраняет распространенные ошибки при расшифровке. Автоматическое обучение на основе исправлений, внесенных вручную. Включает импортируемые наборы терминов!
(Windows Beta и iOS Alpha доступны для предварительного тестирования.)
Список Дополнений: https://www.typewhisper.com/en/addons/ (Движки скачиваются в этом разделе)
(Обсуждение)
#TypeWhisper #Траснкрибация #Диктовка #WhisperKit #Whisper #Parakeet #Voxtral #Qwen3ASR #ASR #MacOS #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Больше не нужно ждать, пока ваш Mac загрузится.
Встроенный в macOS сервер MLX с интеллектуальным кэшированием. Claude Code, OpenClaw и Cursor отвечают за 5 секунд, а не за 90.
Создано с учетом того, как на самом деле работают агенты.
Агенты кодирования аннулируют кэш KV десятки раз за сеанс. oMLX сохраняет каждый блок кэша на твердотельном накопителе, поэтому, когда агент возвращается к предыдущему префиксу, он восстанавливается с диска за миллисекунды, а не пересчитывается с нуля.
«Модели Qwen3.5, работающие на oMLX, настолько быстрые, что запускать локальный ИИ на Mac имеет смысл. Он намного быстрее, чем LMStudio, а вызовы инструмента гораздо надежнее».
❓ Чем oMLX отличается от Ollama или LM Studio?
Ollama и LM Studio кэшируют состояние KV в памяти, но при смене контекста в середине сеанса — что постоянно происходит при использовании агентов для написания кода — весь кэш становится недействительным и пересчитывается с нуля. oMLX сохраняет каждый блок кэша KV на SSD, поэтому ранее кэшированные фрагменты всегда можно восстановить. Время до первого результата сокращается с 30–90 секунд до менее чем 5 секунд при работе с длинными контекстами.
❓ Какие модели поддерживаются?
Любая модель в формате MLX от HuggingFace. К ним относятся Qwen, LLaMA, Mistral, Gemma, DeepSeek, MiniMax, GLM и другие. Модели логического вывода (DeepSeek, MiniMax, Qwen) автоматически обрабатывают тег <think>. С версии 0.2.0 поддерживаются визуально-языковые модели с тем же постраничным кэшированием на твердотельных накопителях.
#omlxai #oMLX #Ollama #LMStudio #MLX #MacOS #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Детерминированный эталонный монитор с функцией изоляции для локальных рабочих процессов с использованием ИИ-агентов. Его цель — обеспечить безопасную среду для работы вашего агента без риска повреждения ваших данных и личной информации.
У вашего агента есть реальное рабочее пространство для реальной работы, рискованные пересечения границ блокируются или требуют согласования, а каждое важное решение сопровождается квитанцией, чтобы вы могли видеть, что произошло, и не нависать над ним весь день, как встревоженный спасатель.
В настоящее время он поддерживает Openclaw, Claude Code и OpenCode, а также сеть TailScale и телеграм-канал (для OpenClaw используется встроенный телеграм-канал).
(Обсуждение)
#AgentRuler #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Компания Cohere выпустила свою первую модель преобразования речи в текст, которая теперь возглавляет рейтинг OpenASR (для английского языка, но модель поддерживает 14 различных языков).
Есть демонстрационная версия на WebGPU: запустить модель полностью локально прямо в браузере!
Ссылка на демонстрационную версию (+ исходный код):
(Обсуждение)
#CohereTranscribe #Transcribe #Транскрибация #STT #WebGPU #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Этот сайт поможет вам узнать, какие языковые модели можно запустить на вашем оборудовании или какое оборудование надо под модель ИИ?! (Модели сгруппированы под задачи!)
🔗 https://runthisllm.com
или аналог: https://www.vram.top
#runthisllm #LLM #AiModel #ModelAi #LocalAi #AiLocal
или аналог: https://www.vram.top
#runthisllm #LLM #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Интерактивная студия анонимизации видео. Браузерный инструмент для обнаружения, отслеживания и размытия объектов на видео — от 720p до 4K и 360° равнопромежуточных панорам.
Основные моменты:
- Встроенная обработка 4K — изначально поддерживает видео с разрешением 3840×2160. С RF-DETR Nano + skip=4 обеспечивает 76 эффективных кадров в секунду при разрешении 4K (в 2,5 раза выше, чем в реальном времени). Даже при skip=2 частота кадров RF-DETR Nano Det превышает 30 кадров в секунду при разрешении 4K.
- Поддержка панорамы 360° — встроенный конвейер равнопромежуточной проекции. Обрабатывает видео с камеры Insta360 X5 (до 8K: 7680×3840), извлекая перспективные субпроекции, выполняя обнаружение и повторно проецируя маски в равноугловое пространство.
- 8 моделей обнаружения — от быстрых детекторов (RF-DETR Nano: 15,7 кадров в секунду при разрешении 4K) до сегментации с точностью до пикселя (RF-DETR Medium Seg) и обнаружения по текстовым подсказкам (Grounding DINO: «размыть человека в красном»)..
- Возможность работы в режиме реального времени — отслеживание пропущенных кадров с помощью ByteTrack обеспечивает линейное ускорение: skip=4 → в 4 раза быстрее. RF-DETR Nano Det + skip=4 при разрешении 720p обеспечивает 305 эффективных кадров в секунду.
Работает полностью локально. В репозитории есть гифки, на которых сравниваются все подходы к моделированию на одном и том же кадре 4K.
(Обсуждение)
#privacyblur #размытие #анонимизация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Новый Qwen3.5-9b (полная версия и версия с квантованием GGUF), доработанный для агентной платформы (OpenClaw, AgentScope) на основе Copaw-9B (официальная агентная платформа Qwen) + Opus 4.6 Reasoning.
(используйте рекомендуемые параметры генерации)
Qwen3.5-9B-Opus-OpenClaw-Distilled — это усовершенствованная версия Qwen3.5-9b, в которой приоритет отдается логическому мышлению и агентной настройке. Она создана для того, чтобы объединить две сильные стороны в одной модели.
- Операционные / агентские инстинкты OpenClaw и CoPaw
- Структурированное мышление в стиле Клода Опуса
Цель проста: используйте строгий базовый режим -> настройте на агентурное использование, такое как openclaw и agentscope -> используйте рассуждения уровня opus-4.6 -> лучшее из обоих миров
Вкратце:
Он предназначен для пользователей, которые хотят:
- сохраненный чат + высокая агентская полезность в духе Openclaw / CoPaw
- модель, которая больше похожа на «планировщик + оператор», чем на «чат-бота»
Вдохновлено популярным Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled
ykarout/Qwen3.5-9b-Opus-Openclaw-Distilled
(Обсуждение)
#Qwen359B #GGUF #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Квантованные модели APEX MoE ускоряют вывод данных на 33 % и поддерживают TurboQuant (ускорение обработки подсказок на 14 %)
Только что выпустили APEX (Adaptive Precision for EXpert Models) — новую технологию квантования MoE, которая превосходит Unsloth Dynamic 2.0 по точности и при этом в два раза меньше по размеру для архитектур MoE.
Протестировано на Qwen3.5-35B-A3B, но этот метод применим к любой модели MoE. Размер в два раза меньше, чем у Q8. Уровень сложности сопоставим с F16.
Благодаря TurboQuant при использовании контекста 8K каждый уровень APEX обрабатывает запросы примерно на 14 % быстрее!
Работает со стандартным llama.cpp без каких-либо патчей.
С открытым исходным кодом: http://github.com/mudler/LocalAI
- I-Quality: 21,3 ГБ — максимальная точность
- I-Balanced: 23,6 ГБ — оптимальный баланс
- I-Compact: 16,1 ГБ — подходит для графических процессоров с 24 ГБ видеопамяти
- Mini: 12,2 ГБ — подходит для графических процессоров с 16 ГБ видеопамяти
Модели: http://huggingface.co/mudler/Qwen3.5-35B-A3B-APEX-GGUF
Метод + техническая статья: http://github.com/mudler/apex-quant
Локальная установка: http://github.com/mudler/LocalAI
(Обсуждение)
#APEX #MoE #TurboQuant #apexquant #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
Please open Telegram to view this post
VIEW IN TELEGRAM
У этого Канала теперь есть "Зеркало" в Макс: https://max.ru/join/m9_yt1fhcVwQS9_oHxUCBSialkmNopz_CA8UhPD2v2Q - все посты будут дублироваться и туда.
💩4👍3🤮1