Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
Модель: Higgs Audio v3 TTS
Система преобразования текста в речь Higgs Audio v3 предназначена для голосового чата: она не просто читает, а говорит. Она преобразует ответы модели в выразительную разговорную речь на более чем 100 языках, с клонированием голоса без обучения и встроенным контролем эмоций, стиля, просодии, пауз и звуковых эффектов.
🎞 Подробно: https://www.boson.ai/blog/higgs-audio-v3-tts
🔗 https://huggingface.co/bosonai/higgs-audio-v3-tts-4b
(Обсуждение)
#HiggsAudio #HiggsAudiov3TTS #TTS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Модель: Magenta RealTime 2

🎵 Google выпустил опенсорсную модель для генерации музыки в реальном времени

Magenta RealTime 2 работает локально на устройстве и генерирует музыку непрерывно, без остановок.

Модель реагирует на команды с задержкой около 200 мс. Управлять можно через текст, аудио или MIDI — выбирай удобный формат и экспериментируй с созданием треков прямо на лету.
🎵 Google выпустил бесплатную модель для создания музыки в реальном времени

Magenta RealTime 2 превращает MacBook в полноценный музыкальный инструмент. Модель поддерживает десятки жанров и умеет имитировать разные звуки — управлять можно через текстовые команды, жесты или виртуальное пианино.

Порог входа низкий: даже новичок соберёт мелодию из одной ноты. Запускается на MacBook Air без танцев с бубном.

🔗 https://magenta.withgoogle.com/mrt2
🔗 https://github.com/magenta/magenta-realtime
🔗 https://huggingface.co/google/magenta-realtime-2
#MagentaRealTime #MagentaRealTime2 #AiMusic #MusicAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🖥 AI Edge Gallery и AI Edge Eloquent для MacOS

Google запустила утилиту AI Edge Gallery для macOS, которая позволяет владельцам Mac запускать ИИ-модели непосредственно на устройстве без подключения к интернету. Такое решение повышает конфиденциальность данных, снижает зависимость от облачных сервисов и позволяет работать с нейросетями даже офлайн.

В отличие от популярных решений вроде Ollama или LM Studio, платформа Google пока поддерживает только собственные модели компании. Пользователям доступны Gemma-4-12B-it, Gemma-4-E2B-it, Gemma-4-E4B-it, Gemma-3n-E2B-it и Gemma-3n-E4B-it. Самой интересной пока считается Gemma 4 12B — мультимодальная модель с 12 млрд параметров, способная работать с текстом, изображениями и аудио.

По заявлению Google, производительность локальной модели Gemma 4 12B сопоставима с более крупными моделями класса 26B, но при этом способна запускаться на ноутбуках с 16 ГБ оперативной памяти.

🎙 Вместе с этим компания представила приложение Google AI Edge Eloquent для macOS. Это инструмент для локальной диктовки, который преобразует речь в текст прямо на устройстве без отправки данных в облако. Утилита умеет автоматически улучшать формулировки, исправлять оговорки и адаптировать текст под выбранный стиль письма. Также можно добавлять собственные слова, имена и профессиональные термины для повышения точности распознавания.
⬇️ Скачать:
- AI Edge Eloquent - #iOS и #MacOS
- AI Edge Gallery - #Android и #iOS и #MacOS
#Google #AIEdgeEloquent #AIEdgeGallery #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔍 Vane — это система ответов на основе ИИ. (локальный Perplexity)

Vane: «спросил — получил ответ с источниками», только крутится у вас на машине и не просит $20/мес. Лицензия MIT, код на GitHub.
Она объединяет знания из огромного интернета с поддержкой локальных больших языковых моделей (Ollama) и облачных сервисов (OpenAI, Claude, Groq), предоставляя точные ответы с указанием источников и сохраняя полную конфиденциальность ваших запросов.

Особенности:
• веб-поиск с ссылками на источники
• ответы по PDF и своим файлам
• поиск по статьям и обсуждениям
• режимы Speed / Balanced / Quality — от «по-быстрому» до «копаем глубоко»

Модели подключаются как захотите: локальная Ollama или облачные OpenAI, Claude, Gemini, Groq. Хочешь — всё локально, и тогда ни байта не улетает в облако.

Подробнее:
🤖 Поддержка всех основных поставщиков ИИ — используйте локальные языковые модели через Ollama или подключайтесь к OpenAI, Anthropic Claude, Google Gemini, Groq и другим. Комбинируйте модели в зависимости от своих потребностей.

⚡️ Режимы интеллектуального поиска — выбирайте скоростной режим, когда вам нужны быстрые ответы, сбалансированный режим для повседневных поисков или качественный режим для углубленного изучения темы.

🧭 Выбирайте источники — ищите информацию в интернете, обсуждениях или научных статьях. Мы работаем над добавлением новых источников и интеграций.

🧩 Виджеты — полезные карточки с информацией, которые появляются в нужный момент, например о погоде, расчетах, ценах на акции и других быстрых результатах поиска.

🔍 Веб-поиск на базе SearxNG — доступ к нескольким поисковым системам с сохранением конфиденциальности. Скоро появится поддержка Tavily и Exa для еще более точных результатов.

📷 Поиск по изображениям и видео — находите визуальный контент вместе с текстовыми результатами. Поиск больше не ограничивается только статьями.

📄 Загрузка файлов — загружайте документы и задавайте вопросы о них. PDF-файлы, текстовые файлы, изображения — Vane понимает все.

🌐 Поиск по определенным доменам — ограничьте поиск конкретными сайтами, если знаете, где искать. Идеально подходит для поиска технической документации или научных статей.

💡 Умные подсказки — получайте интеллектуальные подсказки по мере ввода, которые помогут вам сформулировать более точный запрос.

📚 Интересное — просматривайте интересные статьи и актуальные материалы в течение дня. Будьте в курсе событий, даже не выполняя поиск.

🕒 История поиска — все поисковые запросы сохраняются локально, так что вы можете в любой момент вернуться к своим находкам. Ваши исследования никогда не пропадут.

Скоро появятся новые функции — мы активно разрабатываем новые функции на основе отзывов сообщества. Присоединяйтесь к нашему Discord, чтобы помочь сформировать будущее Vane!

Короче, приватный поиск, свои модели и свои документы — всё под контролем. Идеально для тех, кто не любит делиться запросами с чужим сервером.

🔗 https://github.com/ItzCrazyKns/Vane
#Vane #Perplexity #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Gemma 4 QAT
🗜 Google выпустил Gemma 4 QAT — квантованные чекпоинты с минимальной потерей качества!
Вышли новые сжатые версии Gemma 4. Отличие QAT (Quantization-Aware Training) в том, что модель квантуют не после обучения, а в процессе — она меньше весит и почти не проседает по качеству.

Gemma 4 E2B в текстовом режиме занимает меньше 1 ГБ. Модель легче для мобильных чипов, экономит память в длинных диалогах и поддерживает ускоренный вывод через MTP.

Веса доступны на Hugging Face: есть GGUF для llama.cpp, тензоры для vLLM и исходники для конвертации. Работает в Ollama, LM Studio, Transformers.js и MLX.

🔗 Блог: https://blog.google/innovation-and-ai/technology/developers-tools/quantization-aware-training-gemma-4/
🔗 https://huggingface.co/collections/google/gemma-4-qat-q4-0
🔗 https://huggingface.co/collections/google/gemma-4-qat-mobile

Official Google Gemma 4 QAT GGUFs:
E2B https://huggingface.co/google/gemma-4-E2B-it-qat-q4_0-gguf
E4B https://huggingface.co/google/gemma-4-E4B-it-qat-q4_0-gguf
12B https://huggingface.co/google/gemma-4-12B-it-qat-q4_0-gguf
26B-A4B https://huggingface.co/google/gemma-4-26B-A4B-it-qat-q4_0-gguf
31B https://huggingface.co/google/gemma-4-31B-it-qat-q4_0-gguf

⬇️ Gemma 4 QAT GGUFs от Unsloth https://huggingface.co/collections/unsloth/gemma-4-qat
И их путеводитель — всегда очень интересное чтиво: https://unsloth.ai/docs/models/gemma-4/qat
Unsloth's анализ (KLD и т.п.): https://unsloth.ai/docs/models/gemma-4/qat#qat-analysis
(Обсуждение) (И еще)
- QATs Q4_0 от Google точнее, чем Q4_K_XL от Unsloth
======
⚡️ Ну и Gemma 4 12B от Huihui — без цензуры!
🔗 https://huggingface.co/huihui-ai/Huihui-gemma-4-12B-it-abliterated

#Gemma4 #Gemma4QAT #QAT #Huihui #Abliterated #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Meddies PII: открытая многоязычная модель деидентификации клинических текстов
Клинической модели искусственного интеллекта не нужно знать, кто является пациентом, чтобы принимать клинические решения.

Для этого нужны симптомы, названия лекарств, результаты анализов, история болезни и курс лечения.

Проблема в том, что в реальных медицинских картах эти факты обычно указываются рядом с идентификаторами: именами, регистрационными номерами, страховыми номерами, адресами, номерами телефонов, датами поступления, названиями отделений.

Таким образом, клиническая деидентификация имеет двойную цель:
- Не допускайте утечки идентификаторов пациентов.
- Не уничтожайте клинические факты, которые еще можно использовать.
Эту вторую часть легко недооценить.

Если в модели отсутствует дата рождения, это нарушает конфиденциальность. Если она удаляет «креатинин 86 мкмоль/л» или «метформин 500 мг», то дальнейшая клиническая информация теряет смысл. И то, и другое — ошибки, но с разными последствиями.

Для решения этой проблемы создали Meddies PII. Это открытая исследовательская модель и набор данных для многоязычной клинической деидентификации. Набор данных является синтетическим и создан с использованием динамических подсказок, учитывающих различные языки, типы документов, их названия, длину заметок, формат текста, пограничные случаи и семейства идентификаторов в разных поколениях.

Цель — не в том, чтобы создать один красивый шаблон. Цель — обеспечить стабильное извлечение данных из самых разных источников, в которых они на самом деле представлены в больницах: торопливых заметок, медицинских карт, файлов в формате JSON/XML, многоязычных текстов, административных записей и подсказок в стиле чата.

Meddies PII не является полноценным продуктом для деидентификации. Больницам по-прежнему нужны регламенты, журналы аудита, локальная проверка, возможность обращения к сотрудникам и контроль развертывания.

Пост: https://meddies.ai/research/meddies-pii
Демо: https://huggingface.co/spaces/Meddies/meddies-pii-extractor
Модель: https://huggingface.co/Meddies/meddies-pii
Dataset: https://huggingface.co/datasets/Meddies/meddies-pii
(Обсуждение)
(Еще были: Shield 82M и GLiNER-PII)
#MeddiesPII #PII #ПерсональныеДанные #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Модель: Gemma 4 QAT с MTP от Unsloth

Обе модели доступны в виде q8_0 с именем mtp-gemma-4-*.gguf в корневом каталоге, а также в виде q8_0 и более крупных квантов в папке MTP .
🔗 https://huggingface.co/unsloth/gemma-4-12B-it-qat-GGUF/tree/main
🔗 https://huggingface.co/unsloth/gemma-4-26B-A4B-it-qat-GGUF/tree/main
🔗 https://huggingface.co/unsloth/gemma-4-31B-it-qat-GGUF/tree/main
🔗 https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/tree/main
🔗 https://huggingface.co/unsloth/gemma-4-E2B-it-qat-mobile-GGUF/tree/main
🔗 https://huggingface.co/unsloth/gemma-4-E4B-it-qat-GGUF/tree/main
🔗 https://huggingface.co/unsloth/gemma-4-E4B-it-qat-mobile-GGUF/tree/main
(Обсуждение)
Уже пишут про: 120 ток./сек на 12 ГБ видеопамяти с Gemma 4 12B QAT MTP
#Gemma4 #Gemma4QAT #QAT #MTP #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
📖 Статья: Google выпустила DiffusionGemma — открытую языковую модель, которая генерирует текст как картинку
https://habr.com/ru/news/1046273/
Блог: DiffusionGemma: генерация текста в 4 раза быстрее! https://blog.google/innovation-and-ai/technology/developers-tools/diffusion-gemma-faster-text-generation/
Веса: https://huggingface.co/google/diffusiongemma-26B-A4B-it
(Обсуждение) (И еще)
#DiffusionGemma #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: 🔈 Supertonic — сверхбыстрая нейросеть для озвучки текста прямо на устройстве
Разработчики из Supertone выпустили open-source движок Supertonic 3 — новое поколение Text-to-Speech (TTS), которому вообще не нужен интернет или мощная видеокарта. Вся генерация происходит локально на процессоре твоего ПК, смартфона или прямо в браузере, обеспечивая абсолютную приватность.

Что умеет:
1️⃣ Космическая скорость: Генерирует речь до 167 раз быстрее реального времени (обработка целой веб-страницы занимает меньше секунды).
2️⃣ Огромная база языков: Третья версия поддерживает 31 язык (включая русский) и содержит сотни готовых голосов с разными эмоциями.
3️⃣ Клонирование голоса (Voice Cloning): Можно загрузить короткую аудиозапись своего голоса, и ИИ мгновенно заговорит твоим тембром на любом из доступных языков.
4️⃣ Умный разбор текста: Нейросеть «из коробки» понимает и правильно озвучивает даты, сокращения, валюту, формулы и аббревиатуры без предварительной подготовки текста.
5️⃣ Для любых платформ: Легко встраивается в проекты на Python, JavaScript/Node.js, C++, Rust, Swift, iOS и Android.
🔥 Бесплатно:
• Модель полностью open-source с открытыми весами (OpenRAIL-M). Её можно скачать и использовать полностью бесплатно и без ограничений.
• В браузере доступно бесплатное веб-демо, где можно тестировать пресеты голосов, менять скорость и скачивать готовые файлы .wav. • Платная подписка (Pro Play Desktop) нужна только в том случае, если вам требуются коммерческие лицензии на предустановленные голоса и облачный софт от разработчиков. Для личного использования и разработки всё бесплатно.
🔗 Попробовать: https://github.com/supertone-inc/supertonic
#Supertonic3 #AiVoice #VoiceAI #TTS #AiAudio #AiModel #ModelAi #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
1
⚡️ Представляем вам «Еретический гримуар» — устойчивую к удалениям локальную систему резервного копирования, которая обеспечивает постоянную доступность моделей без цензуры.

Теперь у Heretic есть официальный сайт по адресу https://heretic-project.org
Этот веб-сайт содержит:
- Ссылки на все официальные ресурсы, связанные с проектом Heretic
- Полное руководство по использованию Heretic
- Подробные инструкции по установке с несколькими резервными источниками
- Документация с возможностью поиска по каждому параметру конфигурации

Нет никакой гарантии, что такие платформы, как GitHub и Hugging Face, и в будущем будут размещать ресурсы Heretic, поэтому я рекомендую добавить этот сайт в закладки, так как он всегда будет указывать на то место, где в данный момент находятся ресурсы отдельных проектов.

Но теперь перейдем к главному. Как вы, возможно, заметили, враждебность по отношению к локальным языковым моделям растет повсеместно, особенно это касается моделей без цензуры, таких как Heretic. Проект уже получил официальное уведомление от Meta и подвергся нападкам в ведущих СМИ. К сожалению, мир ИИ по-прежнему зависит от одной крупной точки отказа в сфере хостинга моделей, которую очень сложно заменить, поскольку языковые модели огромны.

Что, если однажды эта единственная точка отказа действительно выйдет из строя по той или иной причине? Что, если для получения моделей Heretic вам больше не удастся просто зайти на Hugging Face? Что, если десятки тысяч часов, потраченных сообществом на создание этих моделей, просто исчезнут?

Этот экзистенциальный риск беспокоил меня уже некоторое время, и после нескольких месяцев кропотливой работы я рад сообщить, что у нас есть решение: все просто скачивают все модели Heretic на свои компьютеры! Таким образом, если исходная модель будет удалена, у вас останется локальная копия. Легко, правда?

Теперь вы, наверное, думаете, что это глупая шутка. Что ж, вот вам кульминация: Размер этих моделей — всего 9 килобайт, так что вы можете хранить их тысячи на своем телефоне и даже не заметить.

🔗 Продолжение и обсуждение: https://www.reddit.com/r/LocalLLaMA/comments/1u5lmge/introducing_the_heretic_grimoire_the/
#Heretic #БезЦензуры #Uncensored #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Qwopus-3.6-27B-Coder с MTP!
Ускорение MTP: ~2,07 раза (60,9 → 119,0 т/с). Соответствует заявленному диапазону ~1,66–2 раза для этой модели.
🪐 Qwopus-3.6-27B-Coder — это агентная модель кодирования с расширенными возможностями логического вывода, созданная на основе Qwopus3.6-27B-v2. Модель унаследовала мощную основу для логических рассуждений от версии 2, которая показала результаты 87,43 % на MMLU-Pro (300 примеров) и 75,25 % на SWE-bench Verified, и была доработана для генерации агентного кода, структурированного вызова инструментов, отладки и выполнения инструкций в рабочих процессах разработчиков. Модель предназначена для решения задач кодирования на уровне репозитория, многопоточной оркестровки инструментов и сложных логических рассуждений в реалистичных средах с участием агентов.

🔗 https://huggingface.co/Jackrong/Qwopus3.6-27B-Coder-MTP-GGUF
(Обсуждение)
#Qwopus #Qwopus3627BCoder #MTP #Coder #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Gemma 4, 12B, 12B QAT, 26B-A4B QAT и 31B QAT. Еретики без цензуры!

👉 gemma-4-31B-it-qat-q4_0-unquantized-uncensored-heretic:
- Safetensors: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-unquantized-uncensored-heretic
- GGUF: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-NVFP4-GGUF
- GPTQ-Int4: https://huggingface.co/llmfan46/gemma-4-31B-it-qat-q4_0-uncensored-heretic-GPTQ-Int4

👉 gemma-4-26B-A4B-it-qat-q4_0-unquantized-uncensored-heretic:
- Safetensors
: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-unquantized-uncensored-heretic
- GGUF: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-NVFP4-GGUF
- GPTQ-Int4: https://huggingface.co/llmfan46/gemma-4-26B-A4B-it-qat-q4_0-uncensored-heretic-GPTQ-Int4

👉 gemma-4-12B-it-qat-q4_0-unquantized-uncensored-heretic:
- Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-unquantized-uncensored-heretic
- GGUF: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-12B-it-qat-q4_0-uncensored-heretic-NVFP4-GGUF

👉 gemma-4-12B-it-uncensored-heretic:
- Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic
- GGUFs: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic-GGUF
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic-NVFP4
- NVFP4 GGUF: https://huggingface.co/llmfan46/gemma-4-12B-it-uncensored-heretic-NVFP4-GGUF

Автор даже сделал несколько NVFP4 Safetensors и NVFP4 GGUF на базе стандартной Gemma 4 31B, потому что кто-то их заказал::
👉 gemma-4-31B-it-uncensored-heretic:
- NVFP4 Safetensors: https://huggingface.co/llmfan46/gemma-4-31B-it-uncensored-heretic-NVFP4
- NVFP4 GGUFs: https://huggingface.co/llmfan46/gemma-4-31B-it-uncensored-heretic-NVFP4-GGUF

Все модели этого автора: https://huggingface.co/llmfan46/models
(Обсуждение)
============
Есть еще версии в виде нафайнтюненых на кодинге, типа:
- yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
- llmfan46/gemma-4-12B-coder-fable5-composer2.5-v1-uncensored-heretic-GGUF

#Gemma4 #Heretic #БезЦензуры #Uncensored #QAT #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Nex-N2-mini - на базе Qwen3.5-35B-A3B-Base
Nex-N2 с открытым исходным кодом — агентная модель, созданная для решения реальных задач, связанных с производительностью. Благодаря первоклассной кодировке и агентным возможностям Nex-N2 продолжает выполнять сложные задачи с долгосрочными целями в реальных условиях, обеспечивая стабильные комплексные результаты.
Nex-N2 выпускается в двух вариантах, оба прошли постобработку на базе серии Qwen3.5: Nex-N2-Pro (на базе Qwen3.5-397B-A17B) и Nex-N2-mini (на базе Qwen3.5-35B-A3B-Base), с разными компромиссами в отношении задержки и качества. В таблице (на снимке) приведены их оценки в сравнении с ведущими проприетарными и открытыми моделями по результатам нашего комплексного тестирования.
🔗 https://huggingface.co/nex-agi/Nex-N2-mini
(Обсуждение)
#NexN2 #NexN2mini #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💻 Ironsmith - Мгновенно создавайте персональные приложения для Mac с помощью локальных и облачных языковых моделей!

Ironsmith живет в вашей строке меню. Опишите, что вам нужно, и оно создаст для вас нативное приложение для Mac. Бесплатно, с открытым исходным кодом.
Ironsmith — это бесплатное приложение с открытым исходным кодом для macOS, которое позволяет создавать небольшие персональные приложения для Mac с помощью ИИ. Опишите, что вам нужно, и Ironsmith сгенерирует, соберет и сохранит нативное приложение SwiftUI, которое вы сможете запускать, редактировать и экспортировать в папку «Программы».

Что он Делает:
- Создает настоящие приложения для Mac. Сгенерированные приложения написаны на Swift и SwiftUI, в них нет Electron.

- Отображается в строке меню. С его помощью очень удобно создавать новые приложения, запускать сохраненные приложения, редактировать существующие, восстанавливать предыдущие версии, просматривать код или экспортировать готовый пакет приложения.

- Работает с локальным ИИ. Ironsmith разрабатывался с учетом поддержки локального ИИ и изначально поддерживает Ollama. Вы также можете подключить любой API, совместимый с OpenAI, поэтому LM Studio и Llama.cpp тоже отлично работают. Вы даже можете создавать очень простые приложения с помощью встроенной в Apple модели Foundation.

- Поддерживаются и размещенные модели. Используйте свои API-ключи для OpenAI, Anthropic и Gemini или не используйте их, а войдите в Ironsmith, чтобы получить к ним мгновенный доступ.

- Не требует Xcode. Каждое сгенерированное приложение представляет собой пакет Swift и полностью собирается с помощью облегченных инструментов командной строки Xcode, а не полноценного Xcode. На самом деле сам Ironsmith даже не использует Xcode!

- По умолчанию все приложения изолированы в «песочнице». Создаваемые приложения представляют собой подписанные пакеты с включенной «песочницей» и усиленной средой выполнения, что значительно снижает вероятность возникновения ошибок, сбоев или вредоносных действий. Также необходимо явно разрешить доступ к конфиденциальным данным, таким как камера и микрофон. Однако вы можете отключить эти средства защиты, но в этом случае настоятельно рекомендуется проверить код перед запуском.

🔗 https://ironsmith.app
Проект: https://github.com/Jeidoban/Ironsmith/
(Подробнее и Обсуждение)
#Ironsmith #MacOS #AiSoft #SoftAI #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
✈️ Deepseek 4 можно запустить на Mac (M3 Max, 96 ГБ)

Такое возможно с помощью https://github.com/antirez/ds4#running-models-larger-than-ram специального движка от Antirez и его специальной ds4 gguf это буквально работает само собой.
(Подробнее и Обсуждение)
#Deepseek4 #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📖 Статья: Локальные модели в середине 2026 года: разработка, которая устранила отставание
🔗 https://coles.codes/posts/local-models-mid-2026/
(Обсуждение) #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Модель: ZONOS2: синтез речи в реальном времени с 8 миллиардами параметров, 900 миллионами активных элементов и высокоточным клонированием голоса!
Компания Zyphra выпустила ZONOS2, модель преобразования текста в речь в режиме реального времени нового поколения, ориентированную на выразительное и точное клонирование голоса. Она распространяется с открытым исходным кодом по лицензии Apache 2.0, а также доступна в Zyphra Cloud на оборудовании AMD.

Модель призвана решить проблему, связанную с обычным компромиссом между качеством и скоростью преобразования текста в речь. По словам представителей Zyphra, ZONOS2 — это первая разреженная модель преобразования текста в речь с открытым исходным кодом, с 8 миллиардами общих параметров и 900 миллионами активных параметров при выводе. Цель проста: быстрый, эффективный и выразительный синтез речи без обычного наложения звуков.

Основное внимание уделяется клонированию голоса. Компания Zyphra утверждает, что ZONOS2 особенно хорошо улавливает отличительные черты говорящего, создавая более естественные клоны самых разных голосов. Клонирование происходит без предварительного обучения, поэтому не требует тонкой настройки.

Что касается звука, ZONOS2 прогнозирует токены Descript Audio Codec (DAC) для звука студийного качества с частотой 44,1 кГц. Это обеспечивает более высокое качество воспроизведения, но его сложнее смоделировать, чем кодеки более низкого качества. В Zyphra утверждают, что устраняют этот недостаток за счет более масштабной модели и обучения на больших массивах данных.

Для обработки текста ZONOS2 не использует фонематический анализатор. Вместо этого он считывает необработанные байты в кодировке UTF-8, что, по словам разработчиков Zyphra, улучшает охват языков с ограниченными ресурсами, повышает производительность при работе с китайским, корейским и японским языками, а также поддерживает переключение между языками в середине предложения.

Кроме того, значительно увеличилось время обучения — примерно с 200 000 часов до 6 миллионов с лишним часов аудио. По словам представителей Zyphra, они использовали поэтапную фильтрацию данных с постепенным ужесточением требований к согласованности транскриптов на этапах предварительного обучения, среднего обучения и отжига. Предполагаемый результат — уменьшение количества галлюцинаций, неправильного произношения и повторов.

Zyphra также представляет ZTTS1-Eval, новый эталон для оценки систем преобразования речи в текст. Он включает в себя чистые и реальные наборы данных на 17 языках, а также новые модели оценки, такие как Qwen3-ASR, ReDimNet и MSR-UTMOS, и метрики просодии.

В этом вся суть. Большая модель, открытые веса, лицензия Apache 2.0, клонирование голоса и достаточная инфраструктура, на фоне которой старая базовая модель преобразования текста в речь выглядит как металлолом.

Блог: https://zyphra.com/our-work/zonos2
Веса: https://huggingface.co/Zyphra/ZONOS2
Код для логического вывода: https://github.com/Zyphra/ZONOS2
Код для оценки: https://github.com/Zyphra/ZTTS1-Eval
(Обсуждение)
#ZONOS2 #TTS #AiVoice #VoiceAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM