Новая модель ZAYA1-8B появилась несколько дней назад и сразу привлекла внимание. При 760 миллионах активных параметров (8.4B всего) она показывает результаты, сопоставимые с моделями в десятки раз крупнее: AIME 2026 — 89,1%, HMMT — 71,6%. Для сравнения: обходит Mistral-Small-4 со 119 миллиардами параметров.
(Превосходит гораздо более крупные модели с открытым исходным кодом по некоторым показателям в области математики и кодирования.)
Это первая крупная модель-смесь экспертов, обученная целиком на видеокартах AMD. Архитектура сжимает кэш ключ-значение в 8 раз, использует маршрутизатор на многослойном перцептроне и обучаемое масштабирование остатков. Рассуждения встроены на этапе предобучения — модель агрегирует варианты через Markovian RSA.
Доступна под лицензией Apache 2.0, веса выложены на HuggingFace, есть бесплатный сервер на Zyphra Cloud.
Отчет: https://arxiv.org/abs/2605.05365
#ZAYA18B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
🎬 Видеоредактор, который режет через субтитры
Вышел CutScript — редактор, где монтаж делается через текст. Удаляешь слово или предложение из субтитров, и этот кусок автоматически вырезается из видео.
Можно чистить вручную или попросить ИИ убрать мусорные слова. Работает локально, бесплатно, данные не уходят с компьютера.
💬 Удобно для подкастов, интервью и обучающих роликов — когда нужно быстро убрать лишнее без классического монтажа.
🔗 https://github.com/DataAnts-AI/CutScript
#CutScript #AiVideo #LocalAi #AiLocal
Вышел CutScript — редактор, где монтаж делается через текст. Удаляешь слово или предложение из субтитров, и этот кусок автоматически вырезается из видео.
Можно чистить вручную или попросить ИИ убрать мусорные слова. Работает локально, бесплатно, данные не уходят с компьютера.
💬 Удобно для подкастов, интервью и обучающих роликов — когда нужно быстро убрать лишнее без классического монтажа.
#CutScript #AiVideo #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
🦞 SlopLobster — AI-ассистент для кодинга прямо в браузере
Работает локально через LM Studio, без API-ключей и облачных сервисов. Использует File System Access API для доступа к файловой системе.
Умеет читать и записывать файлы, выполнять shell-команды, искать в интернете через DuckDuckGo. Поддерживает работу с Git, итеративную разработку, просмотр изображений (SVG и растровые), показывает diff файлов и терминал в реальном времени.
🔗 https://github.com/PasiKoodaa/SlopLobster
#SlopLobster #LMStudio #AiAgent #AgentAi #LocalAi #AiLocal
Работает локально через LM Studio, без API-ключей и облачных сервисов. Использует File System Access API для доступа к файловой системе.
Умеет читать и записывать файлы, выполнять shell-команды, искать в интернете через DuckDuckGo. Поддерживает работу с Git, итеративную разработку, просмотр изображений (SVG и растровые), показывает diff файлов и терминал в реальном времени.
#SlopLobster #LMStudio #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💾 Нейросети запускаются с флешки — локально!
Проект USB-Uncensored-LLM: превращает обычную флешку или SSD в автономный ИИ-хаб с локальными моделями.
Что внутри:
· Кастомная сборка Ollama уже встроена
· Поддержка Gemma 2, Gemma 4, Qwen 3.5 и других локальных моделей
· Модели работают без цензуры и ограничений
· Доступ можно открыть даже с телефона по локальной сети
Установка элементарная: скачал, закинул модели, запустил — браузер откроется сам. Всё бесплатно, без лимитов и подписок.
🔗 https://github.com/techjarves/USB-Uncensored-LLM
#USBUncensoredLLM #LocalAi #AiLocal
Проект USB-Uncensored-LLM: превращает обычную флешку или SSD в автономный ИИ-хаб с локальными моделями.
Что внутри:
· Кастомная сборка Ollama уже встроена
· Поддержка Gemma 2, Gemma 4, Qwen 3.5 и других локальных моделей
· Модели работают без цензуры и ограничений
· Доступ можно открыть даже с телефона по локальной сети
Установка элементарная: скачал, закинул модели, запустил — браузер откроется сам. Всё бесплатно, без лимитов и подписок.
#USBUncensoredLLM #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Статья: Локальные LLM в реальной работе: Gemma 4, Qwen 3.6 и Qwen Coder / Хабр https://habr.com/ru/articles/1033808/
Статья: Hugging Face: что это и как пользоваться
https://thecode.media/hugging-face-kak-polzovatsya/
https://thecode.media/hugging-face-kak-polzovatsya/
✨ LlamaServer - Графический интерфейс LlamaServer
Если надоело хранить команды запуска llamacpp отдельно, то есть более удобная программа.
🔗 https://github.com/arnyigor/LlamaServer
(Источник)
#LlamaServer #LocalAi #AiLocal
Если надоело хранить команды запуска llamacpp отдельно, то есть более удобная программа.
В чем отличие от lmstudio:
- Более гибкая настройка параметров запуска.Выгрузка слоев,автоматическая,настраиваемая,подсказки.
- Сохранение\загрузка параметров в зависимости от модели и контекста.Например для разного контекста нужна разная выгрузка слоев экспертов на CPU для MoE моделей.
- Логи
- Отображение памяти,за основу взял недавний пост.
- Обновление llamacpp одной кнопкой.
Windows-менеджер с графическим интерфейсом для локального запуска llama-server.exe из llama.cpp. Приложение помогает выбрать GGUF-модель, подобрать параметры контекста/памяти, запустить сервер и бенчмарк, обновить локальную сборку llama.cpp, просмотреть логи и добавить локальные модели в конфиги OpenCode/PI.
Что умеет приложение:
- Модели и GGUF
- Рекурсивно сканирует папку с .gguf моделями.
- Исключает файлы-проекторы (mmproj, projector) из основного списка моделей.
- Кэширует найденные модели в settings.json, чтобы следующий запуск был быстрее.
- Считывает ключевые метаданные GGUF без полной загрузки модели:
- general.architecture;
- general.file_type / квантование;
- длина исходного контекста;
- количество блоков/слоев;
- количество блоков внимания;
- длина эмбеддинга;
- метаданные MoE: эксперты / использованные эксперты.
- Определяет квантование по метаданным или имени файла.
- Автоматически ищет mmproj / projector рядом с моделью.
(Источник)
#LlamaServer #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - arnyigor/LlamaServer
Contribute to arnyigor/LlamaServer development by creating an account on GitHub.
Модель создает контент без ограничений: работает по текстовым промптам или загруженной картинке. Можно запустить локально — никаких серверов и утечек данных.
Интегрируется с ComfyUI, качество роликов на уровне топовых моделей. Доступна бесплатно.
#Sulphur2 #ComfyUI #AiVideo #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
huggingface.co
SulphurAI/Sulphur-2-base · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Collate AI — это продвинутый локальный помощник для работы с PDF-файлами. Задавайте любые вопросы о ваших документах. Получайте мгновенные и точные ответы на любом языке.
Задавайте вопросы, получайте мгновенные краткие обзоры и извлекайте ключевую информацию из любого документа — и все это на вашем Mac без подключения к интернету.
Все происходит на вашем Mac. Никаких облачных хранилищ. Никаких загрузок. Полная конфиденциальность.
Ключевые особенности и преимущества:
- Интерактивный PDF-чат для вопросов и ответов с учетом контекста.
- Подробные резюме или краткие выдержки из основных моментов одним щелчком мыши.
- Поддержка нескольких PDF-файлов для анализа данных из разных документов.
- Выделите и организуйте ключевые отрывки.
- Экспортируйте сводки, заметки или журналы чатов в форматах Markdown, PDF или HTML.
- Полная автономная обработка данных для обеспечения конфиденциальности и безопасности.
- Неограниченное использование без ограничений по размеру файлов или документов.
Как это работает:
- Добавьте свои PDF-файлы
Перетащите файлы в Collate или импортируйте папки. Мы храним все файлы в защищенном режиме на устройстве.
- Задавайте вопросы и подводите итоги
Общайтесь со своими документами и мгновенно создавайте краткие обзоры.
- Собирайте полезную информацию
Сохраняйте ответы и краткие обзоры в своих заметках и экспортируйте их в любое время.
Варианты использования:
- Академическое исследование: обобщение статей и извлечение ключевых идей.
- Профессиональная работа: рассмотрение отчетов, контрактов и деловых документов.
- Управление знаниями: организация и выполнение запросов к большим библиотекам PDF-файлов.
- Создание контента: создание резюме для статей, блогов или презентаций.
- Работа, требующая конфиденциальности: локальный анализ конфиденциальных документов.
#CollateAI #PDF #MacOS #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
AntAngelMed, разработанная совместно Информационным центром здравоохранения провинции Чжэцзян, компанией Ant Healthcare и компанией Zhejiang Anzhen'er Medical Artificial Intelligence Technology Co., Ltd., является крупнейшей и самой мощной на сегодняшний день медицинской языковой моделью с открытым исходным кодом.
🏆Лучшие в мире результаты по авторитетным тестам: AntAngelMed превосходит все модели с открытым исходным кодом и ряд ведущих проприетарных моделей по результатам теста HealthBench от OpenAI и занимает первое место по результатам китайского авторитетного теста MedAIBench.
Чат и API: https://antangelmed.tbox.cn/chat
GGUF: https://huggingface.co/mradermacher/AntAngelMed-GGUF
(Обсудить)
#AntAngelMed #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Экспериментальное слияние Franken с использованием слоев Qwopus и MTP без цензуры:
GGUF quants with MTP suffix have Multi-Token prediction layers baked in.
Пару дней назад Jacкrong выпустил действительно классную Qwopus-настройку: https://huggingface.co/Jackrong/Qwopus3.6-35B-A3B-v1-GGUF - из нее убрали цензуру и исправили drift.
Recommended Settings (LM Studio):
Chat template https://pastebin.com/Dy2fmmpN
System prompt: pastebin.com/pU25DVnB
(Обсуждение)
#Qwen36 #Qwopus #Uncensored #БезЦензуры #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
💥 AI-Doomsday-ToolboxPublic - Набор инструментов для ИИ «Судный день»
Автономный набор инструментов для работы с ИИ для Android, который превращает один телефон или несколько старых телефонов в локальную рабочую станцию с ИИ.
🔗 https://github.com/ManuXD32/AI-Doomsday-Toolbox
⬇️ https://play.google.com/store/apps/details?id=com.manuxd32.aidoomsdaytoolbox
(Обсуждение)
============
А еще есть проект: https://www.projectnomad.us
Знания, которые никогда не устареют!
Википедия, искусственный интеллект, карты и образовательные инструменты, работающие на вашем собственном оборудовании, — совершенно бесплатно. Интернет не требуется.
#AIDoomsday #AIDoomsdayToolbox #App #Android #LocalAi #AiLocal
Автономный набор инструментов для работы с ИИ для Android, который превращает один телефон или несколько старых телефонов в локальную рабочую станцию с ИИ.
Зайдите в эту новую вики и узнайте все о приложении https://adt.manube.org
Запускайте локальные языковые модели, Whisper для расшифровки, генерацию изображений, распределенный логический вывод, создание наборов данных, офлайн-инструменты для работы с информацией и утилиты на основе искусственного интеллекта прямо на Android. Этот проект создан для тех, кому важны конфиденциальность, периферийный ИИ, ИИ на устройстве, распределенные вычисления и возможность использовать старые телефоны с пользой, а не просто выбросить их.✔️ Чтобы принять участие в закрытом тесте в Play Store, сначала нужно присоединиться к группе Google по этой ссылке.
После регистрации вы сможете принять участие в тестировании и установить приложение отсюда (Или скачать файл ниже)
Следуйте инструкциям в вики, чтобы научиться правильно пользоваться приложением.
(Обсуждение)
============
А еще есть проект: https://www.projectnomad.us
Знания, которые никогда не устареют!
Википедия, искусственный интеллект, карты и образовательные инструменты, работающие на вашем собственном оборудовании, — совершенно бесплатно. Интернет не требуется.
#AIDoomsday #AIDoomsdayToolbox #App #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
AI-Doomsday-Toolbox-fat.apk
491.3 MB
Установочный файл: AI-Doomsday-ToolboxPublic - Набор инструментов для ИИ «Судный день»
Описание: https://t.me/Ai2Local/717
#AIDoomsday #AIDoomsdayToolbox #App #Android #LocalAi #AiLocal
Описание: https://t.me/Ai2Local/717
#AIDoomsday #AIDoomsdayToolbox #App #Android #LocalAi #AiLocal
This media is not supported in your browser
VIEW IN TELEGRAM
🔊 Realtime TTS-2 стал доступен для запуска локально на устройствах — это лучший генератор речи, которой сразу занял первое место в чарте Artificial Analysis.
Теперь замена ElevenLabs доступна даже без интернета:
• Клонирует голос по образцу 15 секунд речи;
• Создаёт новый уникальный голос по описанию;
• Контролирует эмоции через подробные запросы;
• Анализирует тон, темп голоса и паузы в реальном времени;
• Подстраивает манеру речи под историю переписки;
• Переключается между 100+ языками в одном сеансе, включая русский;
• Задержка составляет всего 120-200 мс.
Попробовать онлайн можно здесь, а податься на локальную версию — тут.
#RealtimeTTS2 #TTS #ElevenLabs #AiVoice #AiModel #ModelAi #LocalAi #AiLocal
Теперь замена ElevenLabs доступна даже без интернета:
• Клонирует голос по образцу 15 секунд речи;
• Создаёт новый уникальный голос по описанию;
• Контролирует эмоции через подробные запросы;
• Анализирует тон, темп голоса и паузы в реальном времени;
• Подстраивает манеру речи под историю переписки;
• Переключается между 100+ языками в одном сеансе, включая русский;
• Задержка составляет всего 120-200 мс.
Попробовать онлайн можно здесь, а податься на локальную версию — тут.
#RealtimeTTS2 #TTS #ElevenLabs #AiVoice #AiModel #ModelAi #LocalAi #AiLocal
Статья: Qwen3.6 27B MTP весит на +0.3 Гб больше, а даёт ускорение в ~2 раза. С 60 t/s до 130 t/s без потерь. Что такое MTP
https://habr.com/ru/articles/1036120/
https://habr.com/ru/articles/1036120/
🎙 Supertonic 3 локально генерирует речь на 31 языке!
Новая модель синтеза речи умеет передавать эмоции, вздохи и даже кашель. Поддерживает русский и ещё 30 языков.
Работает локально — без интернета и облачных сервисов. Запускается на обычных компьютерах и смартфонах, не требует мощного железа. Она работает на базе ONNX Runtime.
🔗 https://github.com/supertone-inc/supertonic
#Supertonic #TTS #AiVoice #AiModel #ModelAi #LocalAi #AiLocal
Новая модель синтеза речи умеет передавать эмоции, вздохи и даже кашель. Поддерживает русский и ещё 30 языков.
Работает локально — без интернета и облачных сервисов. Запускается на обычных компьютерах и смартфонах, не требует мощного железа. Она работает на базе ONNX Runtime.
✨ Моменты:
⚡️ Невероятно быстрый синтез с низкой задержкой в режиме реального времени на настольных компьютерах, браузерах, мобильных устройствах и edge — достаточно быстрый, чтобы превратить всю веб-страницу в аудио менее чем за секунду
🌍 31-Language Многоязычный — Синтезируйте непосредственно из текста на 31 языке или передайте lang="na", чтобы позволить Supertonic обрабатывать язык текста - независимо, если вы не знаете язык ввода — никаких отдельных языковых адаптеров не требуется
🪶 Модель с открытым весом с 99 миллиметровыми параметрами — Компактная, полностью открытая контрольная точка — это лишь малая часть размеров открытых систем TTS класса 0.7B–2B — для меньших загрузок, более быстрых холодных запусков и меньшего объема памяти.
📱 Готовность к работе с Edge-устройствами — Работает локально на настольных компьютерах, мобильных устройствах, браузерах и оборудовании с ограниченными ресурсами, таком как Raspberry Pi или электронные ридеры, с нулевой зависимостью от сети, полной конфиденциальностью и без необходимости использования графического процессора
🔊 Высококачественный звук с частотой 44,1 кГц — выводит 16-битный формат WAV студийного уровня с частотой 44,1 кГц напрямую, готовый к серийному воспроизведению без какого-либо внешнего усилителя
🎭 Теги выражений — 10 встроенных тегов (например, <laugh>, <breath>, <sigh>) привносят естественные человеческие нюансы в сгенерированную речь без быстрой настройки или эталонного звука
🛠 Мультиплатформенные SDK — готовые к использованию примеры с поддержкой ONNX Runtime для Python и Node.js, браузер (WebGPU), Java, C++, C#, Go, Swift, iOS, Rust и Flutter
🌍 Поддерживаемые языки (31)
Арабский (ar), Болгарский (bg), Хорватский (hr), Чешский (cs), Датский (da), Голландский (nl), Английский (en), Эстонский (et), Финский (fi), Французский (fr), Немецкий (de), Греческий (el), хинди (hi), Венгерский (hu), Индонезийский (id), Итальянский (it), Японский (ja), Корейский (ko), латышский (lv), Литовский (lt), Польский (pl), Португальский (pt), Румынский (ro), Русский (ru), Словацкий (sk), Словенский (sl), Испанский (es), Шведский (sv), Турецкий (tr), Украинский (uk), Вьетнамский (vi)
Модель открытая и бесплатная.
#Supertonic #TTS #AiVoice #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📚 Audiblez - превращает любые книги в аудиокниги в один клик!
Audiblez генерирует озвучку локально на вашем ПК за считанные минуты.
🔗 https://github.com/santinic/audiblez
#Audiblez #EPUB #Kokoro #AiVoice #AiBook #LocalAi #AiLocal
Audiblez генерирует озвучку локально на вашем ПК за считанные минуты.
• Загружаете EPUB-файл и получаете готовую M4B аудиокнигу на выходе.
• В Google Colab на T4 GPU «Скотный двор» Оруэлла обрабатывается всего за 5 минут.
• Локально на CPU M2 MacBook Pro это же занимает около часа.
• Результат очень качественный: под капотом лежит модель Kokoro с 80М параметров.
• Официальной поддержки русского нет, но его можно вшить самому через форк. (Языки: 🇺🇸 Американский английский, 🇬🇧 Британский английский, 🇪🇸 Испанский, 🇫🇷 Французский, 🇮🇹 Итальянский, 🇮🇳 Hindi, 🇯🇵 Японский, 🇧🇷 Бразильский Португальский, 🇨🇳 Китайский мандарин)
#Audiblez #EPUB #Kokoro #AiVoice #AiBook #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Gemma-4-Gembrain-31B-it-без цензуры-heretic -, слияние нескольких настроек Gemma 4 31B it Finetunes, разработанных для развития логического и нестандартного мышления для улучшения приверженности, увеличения разнообразия свайпов и улучшения творческой прозы, с KLD 0,0186 и 13/100 отказов! (Обсуждение)
G4-Meromero-31B-Uncensored-Heretic - Это улучшенная версия Gemma 4 31B, предназначенная для творческих задач, с коэффициентом Kld 0,0100 и 15 отказами из 100! (Обсуждение)
gemma-4-Ortenzya-The-Creative-Wordsmith-31B-it-uncensored-heretic — это новая настройка для письма, призванная улучшить качество текста Gemma 4 31B it за счет более естественного английского языка и улучшенной прозы. Подходит для творческих работ, переводов и ролевых игр! (Обсуждение)
Gemma4-26B-A4B Uncensored Balanced - Это ОРИГИНАЛЬНАЯ версия Gemma4-26B-A4B-it, только без цензуры. 0/465 отказов!
Сбалансированный: анализирует сложные запросы, иногда добавляет краткие пояснения, а затем выдает полный ответ. Ответ полный, ничего не упущено, но сначала он может сам себя уговорить. Рекомендуемый вариант по умолчанию — 99 % пользователей будут довольны. Лучше всего подходит для творческого письма, ролевых игр, развития эмоционального интеллекта. (Чтобы отключить «мышление», отредактируйте шаблон jinja или передайте {"enable_thinking": false} в качестве параметра kwarg для шаблона чата.) temp=1.0, top_p=0.95, top_k=64
(Обсуждение)
#Gemma4 #uncensored #heretic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM