Gemma 4 Multi-Token Prediction (MTP), Поддержка Pixel TPU, экспериментальный MCP, новые навыки, теперь сохраняется история чатов!
Все подробности ТУТ.
Если скачивали модель Gemma 4 и теперь появилась кнопка "Update", то надо обновить модель... Multi-Token Prediction (MTP) включается в настройке самого чата.
Скачать: 1.0.14/ai-edge-gallery.apk
(Обсуждение)
#Android #iPhone #App #GoogleAIEdgeGallery #AIEdgeGallery #EdgeGallery #AiAgent #AgentAi #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Safetensors: https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-V2-FP8-Safetensors
MTP-Safetensors: https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-V2-FP8-MTP-Safetensors
Результаты тестирования в открытом коде на аппаратном обеспечении (Beelink gtr9 pro + Strix Halo) на Q8_K_P - MTP quant:
- 5 сессий с 200 тыс. контекстов, ни одного сбоя, никаких зацикливаний, никаких повторных вызовов инструментов.
- Без цензуры, с поддержкой MTP, квантованием APEX и APEX Compact.
- Поддержка Safetensors для преобразования Apple MLX для пользователей Mac.
Рекомендуемый квант: APEX, MTP-APEX
Рекомендуемые настройки для LM Studio:
Системная подсказка:
Шаблон чата
Шаблон чата Thinking
Или используйте эту минимальную строку в качестве первой строки:
You are Qwen, created by Alibaba Cloud. You are a helpful assistant.
Затем добавьте все, что хотите. Без этой первой строки модель может работать некорректно.
Настройки:
Temperature 0.7
Top K Sampling 20
Presence Penalty 1.5
Repeat Penalty 1.0
Top P Sampling 0.8
Min P Sampling 0
Seed 42
(Обсуждение)
#Qwen36 #Uncensored #MTP #APEX #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
MinerU — open-source модель для извлечения и структурирования контента из документов. MinerU автоматизирует извлечение текста, формул, таблиц и изображений из документов, таких как научные статьи, учебные пособия и финансовые отчеты, преобразуя их в форматы Markdown и JSON. Это решение облегчает интеграцию данных в NLP-модели и базы знаний.
Преобразует сложные документы, такие как PDF и офисные файлы, в формат Markdown/JSON, готовый для использования с большими языковыми моделями, для ваших агентных рабочих процессов.
MinerU - это инструмент для синтаксического анализа документов, который преобразует PDF, изображения, DOCX, PPTX и XLSX входные данные в машиночитаемые форматы, такие как Markdown и JSON, для последующего поиска, извлечения и обработки.
Ключевые особенности:
Поддерживайте PDF, изображения, DOCX, PPTX и XLSX входные данные.
Удалите верхние и нижние колонтитулы, сноски, номера страниц и т.д. Для обеспечения семантической согласованности.
Выводите текст в удобочитаемом порядке, подходящем для одностолбцовых, многостолбцовых и сложных макетов.
Сохраните структуру исходного документа, включая заголовки, абзацы, списки и т.д.
Извлекайте изображения, описания изображений, таблицы, заголовки таблиц и сноски.
Автоматическое распознавание и преобразование формул в документе в формат LaTeX.
Автоматическое распознавание и преобразование таблиц в документе в формат HTML.
Автоматическое обнаружение отсканированных и поврежденных PDF-файлов и включение функции оптического распознавания символов.
OCR поддерживает обнаружение и распознавание 109 языков.
Поддерживает несколько форматов вывода, таких как мультимодальный и NLP-формат Markdown, JSON, отсортированный по порядку чтения, и расширенные промежуточные форматы.
Поддерживает различные результаты визуализации, в том числе визуализацию макета и фрагментов, для эффективного контроля качества вывода.
Встроенный интерфейс командной строки, FastAPI, веб-интерфейс Gradio для локальной оркестровки и развертывания нескольких сервисов.
Поддерживается работа на центральном процессоре, а также ускорение с помощью графического процессора/многопроцессорной системы
Совместимо с платформами Windows, Linux и Mac.
#MinerU #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Equinox получила свое название благодаря балансу между крайностями. Благодаря сочетанию суровых темных приключений Wayfarer 2 и спокойного повествования Hearthfire о повседневной жизни, Equinox одинаково хорошо чувствует себя как в опасных подземельях, так и за беседой при свечах.
Если вы хотите легко опробовать эту модель, вы можете сделать это на https://aidungeon.com. Обратите внимание, что для использования Equinox требуется подписка.
(Обсуждение)
#Equinox #Gemma4 #RP #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎨 IOPaintAI — редактор фото с ИИ для быстрых правок
Инструмент для ретуширования изображений на основе модели ИИ SOTA. Удалите с фотографий любые нежелательные объекты, дефекты, людей или сотрите и замените (с помощью Stable Diffusion) все, что вам не нравится.
Нейросеть исправляет неудачные кадры за пару секунд. Случайный прохожий попал в кадр? Можно стереть его с фотографии, и алгоритм автоматически заполнит пустое место так, будто там никого не было.
По сути — открытая альтернатива инструментам вроде Content-Aware Fill в Photoshop, только без подписки и с возможностью запустить локально.
Полностью бесплатное решение с открытым исходным кодом, полностью автономное, с поддержкой центрального и графического процессоров, а также Apple Silicon!
🔗 https://www.iopaint.com - тут примеры на YouTube.
🔗 https://github.com/Sanster/IOPaint - тут видео примеры!
Установщик для Windows в один клик!
OptiClean: приложение для macOS и iOS для удаления объектов!
#IOPaint #OptiClean #Windows #MacOS #iOS #LocalAi #AiLocal
Инструмент для ретуширования изображений на основе модели ИИ SOTA. Удалите с фотографий любые нежелательные объекты, дефекты, людей или сотрите и замените (с помощью Stable Diffusion) все, что вам не нравится.
Нейросеть исправляет неудачные кадры за пару секунд. Случайный прохожий попал в кадр? Можно стереть его с фотографии, и алгоритм автоматически заполнит пустое место так, будто там никого не было.
По сути — открытая альтернатива инструментам вроде Content-Aware Fill в Photoshop, только без подписки и с возможностью запустить локально.
Полностью бесплатное решение с открытым исходным кодом, полностью автономное, с поддержкой центрального и графического процессоров, а также Apple Silicon!
Установщик для Windows в один клик!
OptiClean: приложение для macOS и iOS для удаления объектов!
#IOPaint #OptiClean #Windows #MacOS #iOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👉 Qwen3.5 35B A3B
uncensored heretic Native MTP Preserved is Out Now With the Full 785 MTPs Preserved and Retained, Available in Safetensors, GGUFs. NVFP4, NVFP4 GGUFs and GPTQ-Int4 Formats
Safetensors: Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved: https://huggingface.co/llmfan46/Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved
GGUF: Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-GGUF https://huggingface.co/llmfan46/Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-GGUF
NVFP4: Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4: https://huggingface.co/llmfan46/Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4
NVFP4 GGUF: Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4-GGUF: https://huggingface.co/llmfan46/Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4-GGUF
GPTQ-Int4: Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-GPTQ-Int4: https://huggingface.co/llmfan46/Qwen3.5-35B-A3B-uncensored-heretic-v2-Native-MTP-Preserved-GPTQ-Int4
(Обсуждение)
👉 Qwen3.5 27B
Uncensored Heretic Native MTP Preserved уже доступен в полном составе из 15 MTP, сохраненных и сохраненных в форматах Safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4!
Safetensors: Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved: https://huggingface.co/llmfan46/Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved
GGUF: Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-GGUF: https://huggingface.co/llmfan46/Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-GGUF
NVFP4: Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4: https://huggingface.co/llmfan46/Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4
NVFP4 GGUF: Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4-GGUF: https://huggingface.co/llmfan46/Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-NVFP4-GGUF
GPTQ-Int4: Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-GPTQ-Int4: https://huggingface.co/llmfan46/Qwen3.5-27B-uncensored-heretic-v2-Native-MTP-Preserved-GPTQ-Int4
(Обсуждение)
#Qwen35 #Uncensored #MTP #Heretic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Использование локальных языковых моделей для создания пользовательских интерактивных рекурсивных учебников на лету!
Создает динамические интерактивные учебные материалы на основе интересов пользователя и его вопросов. Отображает процесс обучения в виде древовидной структуры, позволяя пользователям легко возвращаться к предыдущим подтемам и изучать параллельные направления.
GenLearn — это интерактивное образовательное веб-приложение, которое с помощью Gemini API генерирует настраиваемые рекурсивные уроки. Эта версия включает в себя полноценное постоянное хранилище на базе локальной базы данных PostgreSQL, структурированной в виде иерархического графа.
(Видео ускорено. Gemma4-27B генерирует их в фоновом режиме. Вы можете создавать ответвления от любого компонента в любой точке, чтобы рекурсивно исследовать заданную тему, возвращаться на любую высоту в дереве и начинать ветвление оттуда, если хотите.
доступно в ветке "Recursive-Education-Only".
Кстати, каждый запуск и все уроки, созданные в рамках этого запуска, автоматически сохраняются в вашей локальной базе данных, чтобы вы могли вернуться к ним позже и продолжить с того места, на котором остановились.)
(Обсуждение)
#GenLearn #AiОбучение #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Anubis - это нативное приложение для macOS для бенчмаркинга, сравнения локальных моделей большого языка и управления ими с использованием любой OpenAI-совместимой конечной точки - Ollama, MLX, oMLX, LM Studio Server, OpenWebUI, моделей Docker и т.д. Созданный с использованием SwiftUI для Apple Silicon, он обеспечивает аппаратную телеметрию в режиме реального времени в сочетании с полной производительностью логического вывода, сохраняемой в истории, чего не предлагает ни один инструмент командной строки или оболочка чата. Экспортируйте бенчмарки напрямую, без необходимости делать скриншоты, и экспортируйте необработанные данные в формате .MD или .CSV из истории. Вы даже можете OLLAMA PULL создавать модели прямо в приложении.
(Обсуждение)
#AnubisOSS #Anubis #MacOS #бенчмарк #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🖥 У Hermes Agent появился десктопный клиент с GUI
Hermes-desktop упрощает работу с агентом через графический интерфейс. При первом запуске мастер автоматически разворачивает Hermes в ~/.hermes и помогает настроить 11 LLM-провайдеров и 16 платформ для обмена сообщениями.
Установка элементарная: скачиваешь файл под свою систему (.dmg для macOS, .exe для Windows, AppImage для Linux), запускаешь — и готово. Всё через визуальный интерфейс, без копания в терминале.
🔗 https://github.com/fathah/hermes-desktop
#Hermes #HermesAgent #HermesDesktop #MacOS #Windows #Linux #AiAgent #AgentAi #LocalAi #AiLocal
Hermes-desktop упрощает работу с агентом через графический интерфейс. При первом запуске мастер автоматически разворачивает Hermes в ~/.hermes и помогает настроить 11 LLM-провайдеров и 16 платформ для обмена сообщениями.
Установка элементарная: скачиваешь файл под свою систему (.dmg для macOS, .exe для Windows, AppImage для Linux), запускаешь — и готово. Всё через визуальный интерфейс, без копания в терминале.
#Hermes #HermesAgent #HermesDesktop #MacOS #Windows #Linux #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Команда PrismML отлично поработала над этими моделями. Их размер составляет всего ~3 ГБ (по сравнению с FLUX.2 Klein 4B, который весит ~16 ГБ). Apache-2.0!
Официальная коллекция на Hugging Face: https://huggingface.co/collections/prism-ml/bonsai-image
Ссылка на демонстрацию: https://huggingface.co/spaces/webml-community/bonsai-image-webgpu
(Обсуждение)
=============
✨ Bonsai Image 4B — чудеса квантизации
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
#PrismML #BonsaiImage4B #BonsaiImage #WebGPU #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
⚡️ Локальный механизм логического вывода DeepSeek 4 Flash для Metal и CUDA
DwarfStar — это небольшой собственный механизм логического вывода, изначально оптимизированный для DeepSeek V4 Flash, с поддержкой DeepSeek V4 PRO на компьютерах с большим объемом оперативной памяти.
🔗 https://github.com/antirez/ds4
#DwarfStar #DS4 #DeepSeek #DeepSeekV4 #LocalAi #AiLocal
DwarfStar — это небольшой собственный механизм логического вывода, изначально оптимизированный для DeepSeek V4 Flash, с поддержкой DeepSeek V4 PRO на компьютерах с большим объемом оперативной памяти.
Он намеренно узкоспециализированный: это не универсальный исполнитель GGUF и не оболочка для другой среды выполнения, а полностью автономная система. Помимо корректной и быстрой работы с моделью, цель проекта — обеспечить специфичную для DS4 загрузку, мгновенный рендеринг, вызов инструментов, обработку KV-состояний (в оперативной памяти и на диске), серверный API и интегрированный агент кодирования, готовый к работе с агентами кодирования или с помощью предоставленного интерфейса командной строки. Также доступны инструменты для генерации GGUF и imatrix, а также для тестирования качества и скорости.
На форуме пишут: Mac Studio M4 Max с 128 ГБ памяти. DeepSeek 4 Flash стабильно работает со скоростью 25 транзакций в секунду.
И еще: Если вы покупаете Macbook Pro M5 на 128 ГБ, вам стоит обратить внимание на https://github.com/antirez/ds4 . На мой взгляд, это самая современная система для агентских рабочих процессов на вашем устройстве. Она работает на базе Deep Seek v4 Flash, которая превосходит Qwen.
#DwarfStar #DS4 #DeepSeek #DeepSeekV4 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Dobby - Расширение Chrome для Gemini Nano
Запускайте крошечный ИИ Gemma4 (он же Gemini Nano) прямо в Chrome на ПК без графического процессора!
Расширение: https://chromewebstore.google.com/detail/dobby/ehinjcinljpggpokocmkbcaedpjdbbbe
Проект: https://github.com/herryupmay/Dobby
(Обсуждение)
#Dobby #Chrome #GeminiNano #Gemma4 #AiModel #ModelAi #LocalAi #AiLocal
Запускайте крошечный ИИ Gemma4 (он же Gemini Nano) прямо в Chrome на ПК без графического процессора!
Расширение для Chrome, которое добавляет на боковую панель небольшого чат-помощника. Dobby полностью работает на вашем компьютере, используя встроенную в Chrome модель Gemini Nano — никаких серверов, никаких API-ключей, никаких сетевых запросов для самого чата.
Ничего особенного не требуется, кроме Google Chrome, 16 ГБ оперативной памяти и немного свободного места на диске. Никаких llama.cpp, vllm и т. д.
Расширение: https://chromewebstore.google.com/detail/dobby/ehinjcinljpggpokocmkbcaedpjdbbbe
Проект: https://github.com/herryupmay/Dobby
(Обсуждение)
#Dobby #Chrome #GeminiNano #Gemma4 #AiModel #ModelAi #LocalAi #AiLocal
🥴1
Это слияние нескольких доработок gemma-4-31B-it, разработанных для целенаправленного подхода к глубокой нейронной консолидации, минимизации регрессии и расширению уникальных возможностей. KLD 0,0047 и 9/100 отказов!
Доступны как в Safetensors, так и в GGUF.
Safetensors: https://huggingface.co/llmfan46/Gemma-4-Harmonia-31B-uncensored-heretic
GGUF: https://huggingface.co/llmfan46/Gemma-4-Harmonia-31B-uncensored-heretic-GGUF
(Обсуждение)
#Gemma4 #Harmonia #Uncensored #Heretic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
LFM2.5 — это новое семейство гибридных моделей, разработанных для использования на устройствах. Оно основано на архитектуре LFM2 с расширенным предварительным обучением и обучением с подкреплением.
Персональный помощник на устройстве: разработан для поддержки реальных приложений, цепочек вызовов инструментов и выполнения сложных инструкций на всех устройствах.
Высокая производительность при сжатии: не уступает гораздо более крупным моделям с высокой плотностью данных и моделями с механизмом обучения на основе примеров в выполнении инструкций и агентных задач.
Непревзойденная пропускная способность: самая быстрая в своем классе модель для логического вывода на процессоре и графическом процессоре, с поддержкой llama.cpp, MLX, vLLM и SGLang с первого дня.
Блог: https://www.liquid.ai/blog/lfm2-5-8b-a1b
(Обсуждение) (И еще тут)
#LFM25 #LFM258BA1B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 GhostPen — бесплатный локальный помощник для текстов
Пишите быстрее с помощью автозаполнения на основе локального ИИ!
GhostPen дописывает мысли, меняет тон и перефразирует в нужном стиле. Подходит для заметок и писем.
Бот работает на локальных моделях Gemma и Qwen. Со временем адаптируется под вашу манеру письма.
(Бесплатно для Mac · Apple Silicon)
🔗 https://ghostpen.emanuele.click
#GhostPen #Gemma #Qwen #MacOS #LocalAi #AiLocal
Пишите быстрее с помощью автозаполнения на основе локального ИИ!
GhostPen дописывает мысли, меняет тон и перефразирует в нужном стиле. Подходит для заметок и писем.
Бот работает на локальных моделях Gemma и Qwen. Со временем адаптируется под вашу манеру письма.
(Бесплатно для Mac · Apple Silicon)
#GhostPen #Gemma #Qwen #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
✨ PewDiePie выложил свой ИИ Odysseus в открытый доступ — это его личная замена Claude и ChatGPT.
Odysseus работает локально, умеет выполнять задачи за пользователя, искать инфу в сети, подключаться к почте, заметкам и другим приложениям.
Даже есть поддержка Deep Research!
➡️ https://github.com/pewdiepie-archdaemon/odysseus
Статья: https://habr.com/ru/companies/first/articles/1041970/
(Обсуждение) (И еще) (RCE, который запускается в один клик)
#Odysseus #AiAgent #AgentAi #AiLocal #LocalAi
Odysseus работает локально, умеет выполнять задачи за пользователя, искать инфу в сети, подключаться к почте, заметкам и другим приложениям.
Даже есть поддержка Deep Research!
Статья: https://habr.com/ru/companies/first/articles/1041970/
(Обсуждение) (И еще) (RCE, который запускается в один клик)
#Odysseus #AiAgent #AgentAi #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Step 3.7 Flash — это разреженная визуально-языковая модель Mixture-of-Experts (MoE) с 198 миллиардами параметров, которая сочетает в себе языковую основу с 196 миллиардами параметров и визуальный кодировщик с 1,8 миллиардами параметров для естественного понимания изображений. Модель разработана для высокочастотных производственных задач и активирует около 11 миллиардов параметров на токен, обеспечивая пропускную способность до 400 токенов в секунду. Step 3.7 Flash поддерживает контекстное окно размером 256К и предлагает три уровня логического вывода на выбор (низкий, средний и высокий), чтобы разработчики могли легко сбалансировать скорость, стоимость и глубину анализа.
Работает локально на 128 ГБ ОЗУ!
Step 3.7 Flash is available via our API platform (中文/EN), and you can chat with it on the Web (中文/EN) or in our App (iOS/Android).
Если у вас есть возможность установить Stepfun 3.7 Flash в оперативную память, попробуйте! По качеству изображения он близок к GLM 5.1, а по восприятию трехмерного мира — примерно на 80 % к нему.
Однако, учитывая, что его параметры составляют всего 25 % от параметров GLM 5.1 и у него есть встроенная система технического зрения, можно сказать, что на данный момент ему нет равных. (Пример генерации симулятора) и (Sonic-like platformer)
(Обсуждение)
#Step37Flash #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM