Почти месяц назад был представлен новый бенчмарк для встраиваемых аудио embeddings (audio embeddings) — MAEB. Согласно их статье, одна из моделей значительно превзошла остальные.
Вот несколько моментов: занять первое место в бенчмарке в первый же день — действительно впечатляющий результат, потому что невозможно целенаправленно оптимизировать модель для бенчмарка, которого еще не существует. И это неожиданно, что модель, работающая с аудио, текстом и ВИЗУАЛЬНЫМИ ДАННЫМИ, окажется лучшей.
Статья о встраивании LCO была принята к публикации в NeurIPS в прошлом году, но, судя по количеству загрузок и лайков в репозитории HF, она почти не привлекла внимания.
Модели основаны на Qwen2.5 omni, а также имеют варианты с размерами 3B и 7B.
(Обсуждение)
#LCOEmbedding #Omni3B #Omni7B #LCOEmbeddingOmni3B #LCOEmbeddingOmni7B #Embedding #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 MLX Studio: Local AI Chat - Локальный ИИ
MLX Studio предоставляет мощный чат с ИИ на ваши устройства Apple, полностью работая на устройстве для полной конфиденциальности. Никакие данные никогда не покидают ваше устройство.
Выберите из 15+ предварительно настроенных моделей MLX или импортируйте любую совместимую модель из HuggingFace. Храните модели на внешних дисках, чтобы сэкономить место.
⬇️ https://apps.apple.com/ru/app/mlx-studio-local-ai-chat/id6757399038
💡 Другие для iOS: https://t.me/Ai2Local/21
#iPhone #iPad #MacOS #MLXStudio #LocalAi #AiLocal
MLX Studio предоставляет мощный чат с ИИ на ваши устройства Apple, полностью работая на устройстве для полной конфиденциальности. Никакие данные никогда не покидают ваше устройство.
Выберите из 15+ предварительно настроенных моделей MLX или импортируйте любую совместимую модель из HuggingFace. Храните модели на внешних дисках, чтобы сэкономить место.
APPLE INTELLIGENCE (iOS 26+ / macOS 26+).
- Встроенный ИИ: Используйте Apple Intelligence без загрузки
- Мгновенный доступ: Начните общаться немедленно, не дожидаясь загрузки модели
- Плавное переключение: Легко переключайтесь между Apple Intelligence и пользовательскими моделями MLX
- Поддержка контекста 4K для быстрых разговоров
КЛЮЧЕВЫЕ ОСОБЕННОСТИ:
- 100% Конфиденциально: Вся обработка ИИ происходит локально на вашем устройстве
- Несколько моделей ИИ: Выберите из кураторских современных языковых моделей, оптимизированных для Apple Silicon
- Понимание зрения (Mac): Анализ изображений с помощью Vision Language Models
- Генерация изображений (Mac): Создание изображений Использование моделей Stable Diffusion и FLUX!
- Smart Memory: AI запоминает важные детали разговора
- Smart RAM Management: Модели автоматически загружаются в режиме ожидания
- Работает в автономном режиме: Используйте где угодно без интернета после загрузки
- Включает Qwen3, Llama 3.2, Gemma 2, модели зрения и FLUX/Stable Diffusion.
Никаких подписок, учетных записей или облака не требуется.
💡 Другие для iOS: https://t.me/Ai2Local/21
#iPhone #iPad #MacOS #MLXStudio #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 LocalMind AI - Локальный ИИ
LocalMind Al превращает ваш iPhone, iPad или Мас в мощный персональный ИИ, который работает исключительно на вашем устройстве - без облачных хранилищ, учетных записей и передачи данных третьим лицам.
⬇️ https://apps.apple.com/ru/app/localmind-ai/id6757136468
💡 Другие для iOS: https://t.me/Ai2Local/21
#LocalMind #LocalMindAI #iPhone #iPad #MacOS #App #LocalAi #AiLocal
LocalMind Al превращает ваш iPhone, iPad или Мас в мощный персональный ИИ, который работает исключительно на вашем устройстве - без облачных хранилищ, учетных записей и передачи данных третьим лицам.
В мире подписок и слежки LocalMind Al создан для того, чтобы быть независимым.
Ваши разговоры, идеи и работа никогда не попадут на сервер.
Все остается там, где и должно быть: на вашем устройстве.
По-настоящему персональный ИИ LocalMind Al — это не просто очередной чат-бот.
Это ваш доступ к экосистеме ИИ с открытым исходным кодом, который открывает вам доступ к широкому спектру продвинутых моделей, работающих локально.
Выберите своего эксперта: загружайте и переключайтесь между ведущими моделями ИИ, такими как Llama, Qwen, Gemma и другими.
Подстраивайте под свои нужды: используйте легковесные модели для выполнения повседневных задач или мощные модели логического вывода для написания кода, анализа и глубокого решения проблем.
Почему стоит выбрать LocalMind Al?
100 % конфиденциальность. Никаких облачных серверов.
История сообщений не хранится удаленно.
Никакого отслеживания.
Ваш ИИ работает исключительно на вашем устройстве.
Работает в автономном режиме. После загрузки модели вы можете общаться в любое время - даже без подключения к интернету.
Мгновенные ответы. Поскольку модель работает непосредственно на вашем устройстве, ответы приходят быстро и без задержек, связанных с сетью.
Что вы можете делать
• Проводить мозговые штурмы
• Писать и редактировать текст
• Получать помощь в написании кода
• Обобщать документы
• Обсуждать изображения
• Размышлять над проблемами
• Вести личный дневник
Все это без отправки данных куда бы то ни было.
Основные функции:
- Загрузка моделей в одно касание
- Просматривайте и загружайте тщательно отобранные и постоянно пополняющиеся коллекции моделей ИИ прямо в приложении.
- Простой и лаконичный интерфейс
- Разработан для удобства использования на iPhone, iPad и Мас.
LocalMind Al — для всех, кто хочет использовать возможности современного ИИ, не теряя контроля.
💡 Другие для iOS: https://t.me/Ai2Local/21
#LocalMind #LocalMindAI #iPhone #iPad #MacOS #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
✨ MLX Studio - Общайтесь в чате. Пишите код. Локально!
MLX Studio — самый простой способ запускать большие языковые модели на вашем Mac. Все в одном движке.
🔗 https://mlx.studio
Проект: https://github.com/vmlxllm
🔗 https://github.com/jjang-ai/mlxstudio
Модели MLX: https://huggingface.co/collections/jangq/jang-quantized-gguf-for-mlx
💡 Это №3 после gmlx и Rapid-MLX.
#MLXStudio #MLX #vMLX #MacOS #SoftAi #AiSoft #LocalAi #AiLocal
MLX Studio — самый простой способ запускать большие языковые модели на вашем Mac. Все в одном движке.
Единственное приложение Mac AI с собственным кэшированием префиксов, постраничным кэшированием KV, квантованием KV, непрерывным пакетным обучением, гибридной поддержкой SSM/Mamba и полной интеграцией с VLM, а также более чем 20 инструментами для агентного программирования, обработки речи, зрения и логического вывода. Работает на движке vMLX.
MLX Studio объединяет LLM, VLM, локальную генерацию и редактирование изображений, coding agent, OpenAI + Anthropic API, Hugging Face browser и собственный inference engine vMLX.
Но самое любопытное — JANG adaptive mixed-precision quantization. Разные части модели получают различную разрядность вместо тупого одинакового 2/3/4-bit для всей сети. Проект, например, публикует MiniMax M2.5 JANG 2-bit размером около 89 GB. Есть и режим Smelt, который позволяет держать backbone в памяти, а часть MoE-experts подгружать с SSD.
- Бесплатно навсегда
- Apple Silicon
- Не требует подключения к облаку
- Более 20 инструментов
Возможности:
Полноценное рабочее пространство для работы с искусственным интеллектом — чат, код, поиск и автоматизация. Все локально и бесплатно.
Единственное локальное приложение для работы с ИИ с полным стеком логического вывода!
Самое функциональное локальное приложение для работы с искусственным интеллектом на Mac!
— кэширование префиксов, постраничная система хранения данных, квантование кэша, непрерывная пакетная обработка, поддержка VLM, гибридная система управления состоянием и более 20 агентских инструментов. Ни в одном другом приложении нет даже двух таких инструментов.
👉 Пользовательский интерфейс потокового чата
Многопоточные диалоги с встроенными кнопками вызова инструментов, сворачиваемыми блоками с пояснениями, предварительным просмотром изображений и индикаторами состояния в реальном времени. Каждая деталь продумана для удобства использования.
👉 Голосовой чат
Встроенный преобразователь текста в речь в каждом ответе. Слушайте ответы ИИ без помощи рук, используя встроенный в Mac синтез речи.
👉 Vision & Мультимодальность
Перетаскивайте изображения в чат. Модели машинного зрения, такие как Qwen VL, анализируют визуальный контент локально с возможностью предварительного просмотра с функцией масштабирования.
👉 Блоки рассуждений
Сворачиваемые разделы для таких моделей, как DeepSeek R1, Qwen 3 и GLM. См. цепочку рассуждений модели.
👉 Удаленные конечные точки
Подключайтесь к OpenAI, Anthropic или любому другому совместимому API. Используйте агентские инструменты Studio и облачные модели.
👉 Браузер HuggingFace
Ищите, просматривайте и загружайте модели MLX прямо в приложении. Один клик — и вы можете начать общение с любой моделью.
👉 Более 20 встроенных инструментов. Не требует настройки.
Единственное локальное приложение с ИИ, поддерживающее вызов встроенных инструментов MCP. Модели могут читать, записывать, искать и выполнять команды — и все это локально.
Проект: https://github.com/vmlxllm
Модели MLX: https://huggingface.co/collections/jangq/jang-quantized-gguf-for-mlx
#MLXStudio #MLX #vMLX #MacOS #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Media is too big
VIEW IN TELEGRAM
✨ Thoth — персональный ИИ-помощник.
Локальный ИИ-помощник с 20 интегрированными инструментами, долговременной памятью, голосовым управлением, функцией распознавания изображений, отслеживанием состояния здоровья и каналами обмена сообщениями — и все это работает на вашем устройстве. Ваши модели, ваши данные, ваши правила.
🔗 https://siddsachar.github.io/Thoth/
https://github.com/siddsachar/Thoth
(Обсудить)
#Thoth #Windows #SoftAi #AiSoft #LocalAi #AiLocal
Локальный ИИ-помощник с 20 интегрированными инструментами, долговременной памятью, голосовым управлением, функцией распознавания изображений, отслеживанием состояния здоровья и каналами обмена сообщениями — и все это работает на вашем устройстве. Ваши модели, ваши данные, ваши правила.
В настоящее время Thoth работает на Windows.
🍎 Поддержка macOS на подходе.
Нативная версия для macOS находится в активной разработке — следите за новостями.
Thoth — это локальный ИИ-помощник, созданный для обеспечения независимости от внешних ИИ — ваши модели, ваши данные, ваши правила. Он работает исключительно на вашем устройстве, сочетая в себе мощный агент ReAct и 20 интегрированных инструментов — веб-поиск, электронную почту, календарь, управление файлами, распознавание изображений, долговременную память, отслеживание привычек и многое другое, а также каналы обмена сообщениями в Telegram и электронной почте. Все это работает на основе локальной большой языковой модели Ollama. Данные не покидают ваше устройство, если только вы не используете онлайн-инструмент.❓ Чем Thoth отличается от OpenClaw?
- OpenClaw — фантастический проект с открытым исходным кодом, но он решает другую задачу. OpenClaw — это инфраструктурная платформа для обмена сообщениями: она перенаправляет вызовы облачных языковых моделей (OpenAI, Anthropic, Google) в более чем 25 чатов, таких как WhatsApp, Slack и Discord. Языковая модель работает в облаке, а шлюз — на вашем компьютере.
- Thoth — это локальный помощник для настольных компьютеров: языковая модель, голосовой конвейер и память работают на вашем оборудовании. Ничто не покидает ваш компьютер, пока вы не подключитесь к онлайн-инструменту.
- Выберите Thoth, если вам нужно, чтобы все — модель, голосовой помощник, память, данные — работало на вашем собственном компьютере без привязки к облаку и без регулярных платежей.
- Выберите OpenClaw, если вам нужен облачный помощник, который будет доступен на всех платформах для общения, которыми вы уже пользуетесь.
https://github.com/siddsachar/Thoth
(Обсудить)
#Thoth #Windows #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
✨ Jan https://jan.ai — новый опенсорсный конкурент Perplexity, который работает полностью локально и запускается даже на слабых ПК. Их собственная модель Jan основана на Qwen3-4B и дообучена для сложных рассуждений и интернет-поиска. В бенчмарке SimpleQA…
Подробнее: https://www.jan.ai/changelog/2026-03-11-jan-openclaw-cli-context
#Jan #JanAi #App #Windows #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
✨ AnythingLLM.com локальный ИИ на ПК и Смартфон Клиент: есть и десктоп (Windos, Linux, macOS (Intel & Arm M)) и веб-клиент (docker) и для Android (ниже). Для браузера Chrome есть расширение: AnythingLLM Browser Companion Для скачивания на ПК нужен VPN!…
Наконец-то: Главная страница AnythingLLM была полностью переработана, чтобы стать более современной и удобной для пользователей. Теперь вы можете начать общение сразу после запуска приложения.
Подробнее: https://github.com/Mintplex-Labs/anything-llm/releases/tag/v1.11.1
#AnythingLLM #LocalAi #AiLocal #App #Windows #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
Расшифровка YouTube, рендеринг Playwright JS, FTS5 RAG, поиск DDG, потоковая передача SSE.
Инструмент RAG для локального поиска с использованием Nemotron-Nano-9B-v2-Japanese через vLLM. (без использования облачного API)
Что он делает:
Загружайте документы, URL-адреса или видео с YouTube в качестве источников. SoyLM анализирует их с помощью локальной языковой модели, сохраняет структурированные сводки в SQLite и позволяет общаться с вашими источниками с помощью RAG (FTS5 + BM25) и дополнительного веб-поиска (DuckDuckGo).
(Обсуждение)
#SoyLM #NotebookLM #Nemotron #RAG #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Echovo - Local TTS & Voice Cloning
Echovo (App Store, платное 6 Euro) — единственное мобильное приложение, где Qwen3-TTS работает нативно и полностью on-device (через MLX + Neural Engine на iPhone A17 Pro и выше). Никакого облака, модель скачивается в приложение (~2 ГБ), клонирует голос с 3 секунд аудио.
⬇️ https://apps.apple.com/ru/app/echovo-tts-voice-cloning/id6758773035
#Echovo #Qwen3TTS #TTS #iPhone #AiLocal #LocalAi
Echovo (App Store, платное 6 Euro) — единственное мобильное приложение, где Qwen3-TTS работает нативно и полностью on-device (через MLX + Neural Engine на iPhone A17 Pro и выше). Никакого облака, модель скачивается в приложение (~2 ГБ), клонирует голос с 3 секунд аудио.
Echovo - Лучший TTS и клонирование голоса Echovo обеспечивает совое современные преобразования текста в речь прямо на ваш iPhone, на базе Qwen3-TTS, полностью работающий на устройстве с ускорением кремния Apple. Ваше сообщение никогда не покидает ваш телефон.
Два мощных режима
- **Text-to-Speech**: Введите или вставьте любой текст и создайте естественную, выразительную речь. Выберите один из нескольких динамиков, настройте параметры качества и управляйте стиль речи с помощью пользовательских инструкций.
- **Voice Clone**: Запишите короткий аудиоклип или загрузите справочный файл, и Echovo сгенерирует речь, соответствующую характеристикам голоса. Клонировать любой голос за считанные секунды.💬 11 языков! Создавайте речь на английском, китайском, японском, корейском, немецком, французском, испанском, русском, португальском, итальянском языках — или позвольте автоматическому обнаружению справиться с этим за вас.
👉 Полностью приватно
Вся обработка происходит на вашем устройстве с использованием фреймворка Apple MLX. Никакие аудиоданные, текст и голосовые образцы никогда не отправляются на внешние серверы. Ваши разговоры остаются вашими.
👉 Основные функции:
- Вывод ИИ на устройстве
- Интернет не требуется после загрузки модели
- Два варианта модели: Base (TTS + голосовое клонирование) и CustomVoice (управление стилем на основе инструкций)
- Показатели производительности в режиме реального времени: RTF, время синтеза, использование памяти, количество токенов и тепловое состояние
- Регулируемые предустановки качества: Fast, Balanced и High - История генерации со встроенным воспроизведением аудио
- Запись справочного звука напрямую или импорт из файлов
- Сохранение и управление эталонной аудиобиблиотекой для быстрого повторного использования
- Темная и светлая тема с элегантным, минимальным интерфейсом
- Обмен сгенерированными аудиофайлами
👉 Как это работает:
1. Скачайте модель (~1,9 ГБ каждая, один раз)
2. Введите текст и нажмите «Сгенерировать»
3. Прослушайте, поделитесь или сохраните результат
👉 Требования:
- iPhone с Apple Silicon (A17 Pro или более поздней версии рекомендуется для лучшей производительности)
- ~2 ГБ бесплатного хранилища на модель
#Echovo #Qwen3TTS #TTS #iPhone #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Приложении для Mac, которое работает в строке меню и позволяет записывать голосовые заметки. ИИ, работающий исключительно локально. Оптимизировано для Apple Silicon.
Создали его, потому что большинство инструментов для диктовки и написания текстов с помощью ИИ были слишком громоздкими для быстрого набора текста, а нужно было что-то быстрое, приватное и простое в использовании, чтобы записывать свои мысли в любое текстовое поле.
Основная идея заключается в том, что вы можете просто говорить как обычно и запрашивать нужный черновик, вместо того чтобы переключаться между режимами или заранее выбирать, что вы пишете: электронное письмо, заметки или что-то еще.
(Обсуждение)
Аналоги по тегу: #Диктовка
#HITOKU #MacOS #ASR #STT #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🎯 Мультипровайдерская система преобразования текста в речь с конечными точками, совместимыми с OpenAI (OpenAI, DeepInfra, Kokoro, KittenTTS-FastAPI, Orpheus, пользовательские).
📖 Воспроизведение с чтением вслух для PDF/EPUB с озвучиванием с учетом структуры предложения.
⏱️ Выделение послов с помощью дополнительных whisper.cpp временных меток.
🛜 Синхронизация + импорт из библиотеки для переноса документов между устройствами и из папок на сервере.
🗂 Гибкое хранилище со встроенным файловым хранилищем SeaweedFS или внешними бэкендами, совместимыми с S3.
🎧 Экспорт аудиокниг в m4b/mp3 с возможностью возобновления чтения по главам.
🐳 Возможность самостоятельного хостинга с помощью Docker, опциональной аутентификации и автоматической миграции при запуске.
#OpenReader #TTS #EPUB
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - richardr1126/openreader: An open-source read-along document reader server with high-quality TTS options, synchronized…
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD. - richardr1126/openreader
Local Diffusion — это приложение на Flutter, которое переносит модели Diffusion на Android с помощью потрясающего stable-diffusion.cpp
📱 По-настоящему локальный вывод: генерируйте изображения прямо на своем Android-устройстве.
🚀 Широкая совместимость с моделями:
Поддерживает широкий спектр архитектур: SD1.x, SD2.x, SDXL, SD3/SD3.5, Flux/Flux-schnell, SD-Turbo, SDXL-Turbo и другие.⬇️ Загружайте модели напрямую из популярных источников, таких как Hugging Face и Civitai.
⚡️ Квантование на лету: автоматическое квантование полноточных моделей при загрузке для экономии памяти и потенциального повышения скорости. Поддерживаемые форматы: q8_0, q6_k, q5_0, q5_1, q5_1k, q4_0, q4_1, q4_k, q3_k, q2_k.
Скорость на флагмане: 10–30 сек
Плюсы: Самый мощный, ControlNet, LoRA, полностью локально!
Скачать v0.3 (.APK)
Альтернативы:
- Local Dream - Только SD 1.5 (но с NPU-ускорением) - Лучшая скорость на Snapdragon!
- Off Grid - Улучшенные SDXL-варианты (DreamShaper, Absolute Reality и т.д.) - 5–10 сек (с NPU) - Удобный UI, + LLM в одном приложении, 100% оффлайн!
#LocalDiffusion #App #Android #StableDiffusion #SDXL #SD #Flux #AiImage #text2image #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - rmatif/Local-Diffusion: Run SD1.x/2.x/3.x, SDXL, and FLUX.1 on your phone device
Run SD1.x/2.x/3.x, SDXL, and FLUX.1 on your phone device - rmatif/Local-Diffusion
❤1
Запускайте Stable Diffusion на устройствах Android с ускорением на базе процессора Snapdragon NPU. Также поддерживается вывод на центральном и графическом процессорах.
С NPU-ускорением! - Лучшая скорость на Snapdragon!
Android Stable Diffusion с ускорением на базе процессора Snapdragon NPU Также поддерживает логический вывод на центральном и графическом процессорах!
✨ Особенности:
🎨 txt2img — создавайте изображения на основе текстовых описаний
🖼 img2img — преобразуйте существующие изображения
🎭 inpaint — перерисовывайте выбранные области изображений
- пользовательские модели — импортируйте собственные модели SD1.5 для центрального процессора (в приложении) или нейронного процессора (следуйте руководству по конвертации). Вы можете получить несколько предварительно преобразованных моделей от xororz/sd-qnn или Mr-J-369
- поддержка LoRA — поддержка добавления весов LoRA в пользовательские модели для процессора при импорте.
- веса подсказок — выделение определенных слов в подсказках. Например, (masterpiece:1.5). Тот же формат, что и Automatic1111
- эмбеддинги — поддержка пользовательских эмбеддингов, таких как EasyNegative. Требуется формат SafeTensor. Преобразуйте pt в safetensors с помощью этого
- апскейлеров — 4-кратное увеличение с помощью realesrgan_x4plus_anime_6b и 4x-UltraSharpV2_Lite
📱 https://play.google.com/store/apps/details?id=io.github.xororz.localdream (отфильтровано по NSFW)
(Скачать .APK без цензуры)
Альтернативы:
- Local Diffusion https://t.me/Ai2Local/363
- Off Grid - Улучшенные SDXL-варианты (DreamShaper, Absolute Reality и т.д.) - 5–10 сек (с NPU) - Удобный UI, + LLM в одном приложении, 100% оффлайн!
#LocalDream #App #Android #StableDiffusion #NPU #LoRA #AiImage #text2image #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель генерирует треки до 4,5 минут, работает с текстом и аудио, ошибается в передаче слов песен в 8,55% случаев — это лучше многих коммерческих решений.
Что умеет: создаёт музыку по текстовому описанию или аудиофрагменту, выдаёт отдельно вокал и инструменталы или вместе, запускается на GPU с 10 ГБ VRAM.
Есть быстрая версия — генерация за минуту.
Обновился плагин для ComfyUI.
Интересно сравнить с AceStep 1.5.
🔗 https://levo-demo.github.io/levo_v2_demo/
#LeVo2 #Suno #AiMusic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🦥 Unsloth Studio - крутая альтернатива LM Studio!
Unsloth представила Unsloth Studio — open-source веб-интерфейс для запуска, обучения и экспорта моделей локально. Публичный запуск состоялся сейчас, хотя сам проект разрабатывался около года.
Это даёт простой единый инструмент вместо набора утилит: можно запускать GGUF и safetensors, собирать датасеты из файлов, дообучать модели и сравнивать их между собой. Есть поддержка text, vision, audio, TTS и embedding, а также экспорт в нужные форматы.
Обзор основных функций Unsloth Studio.
- Запускайте модели локально на Mac, Windows и Linux
- Обучайте более 500 моделей в 2 раза быстрее с уменьшением объема видеопамяти на 70%.
- Поддерживает GGUF, визуальные, звуковые и встраиваемые модели
- Сравнивайте и сражайтесь с моделями бок о бок
- Вызов инструмента для самовосстановления и веб-поиск
- Автоматическое создание наборов данных из PDF, CSV и DOCX
- Выполнение кода позволяет LLMs тестировать код для получения более точных выходных данных
- Экспортировать модели в GGUF, Safetensors и другие!
- Настройка параметров автоматического вывода (temp, top-p и т.д.) + редактирование шаблонов чатов
Обучение работает на NVIDIA GPU, на CPU и Mac доступен в основном режим чата, поддержка MLX, AMD и Intel заявлена позже.
GitHub: https://github.com/unslothai/unsloth
Блог + все, что нужно знать: https://unsloth.ai/docs/new/studio
(Обсуждение-1, Обсуждение-2)
#Unsloth #UnslothStudio #LLM #OpenSource #LocalAI #AI #AiLocal #MachineLearning #GGUF
Unsloth представила Unsloth Studio — open-source веб-интерфейс для запуска, обучения и экспорта моделей локально. Публичный запуск состоялся сейчас, хотя сам проект разрабатывался около года.
Это даёт простой единый инструмент вместо набора утилит: можно запускать GGUF и safetensors, собирать датасеты из файлов, дообучать модели и сравнивать их между собой. Есть поддержка text, vision, audio, TTS и embedding, а также экспорт в нужные форматы.
Обзор основных функций Unsloth Studio.
- Запускайте модели локально на Mac, Windows и Linux
- Обучайте более 500 моделей в 2 раза быстрее с уменьшением объема видеопамяти на 70%.
- Поддерживает GGUF, визуальные, звуковые и встраиваемые модели
- Сравнивайте и сражайтесь с моделями бок о бок
- Вызов инструмента для самовосстановления и веб-поиск
- Автоматическое создание наборов данных из PDF, CSV и DOCX
- Выполнение кода позволяет LLMs тестировать код для получения более точных выходных данных
- Экспортировать модели в GGUF, Safetensors и другие!
- Настройка параметров автоматического вывода (temp, top-p и т.д.) + редактирование шаблонов чатов
Обучение работает на NVIDIA GPU, на CPU и Mac доступен в основном режим чата, поддержка MLX, AMD и Intel заявлена позже.
GitHub: https://github.com/unslothai/unsloth
Блог + все, что нужно знать: https://unsloth.ai/docs/new/studio
(Обсуждение-1, Обсуждение-2)
#Unsloth #UnslothStudio #LLM #OpenSource #LocalAI #AI #AiLocal #MachineLearning #GGUF
Если вы не следили за сообществом Beaver, то могли пропустить эти четыре тихих релиза.
Это значительные улучшения по сравнению с предыдущими версиями, и они звучат так же, как другие модели поколения 4.0 (например, Cydonia 24B 4.3, Rocinante X 12B v1, если вам нравятся эти модели).
(Обсуждение)
#Beaver #Drummer #Skyfall31B #Valkyrie49B #Anubis70B #AnubisMini8B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
This media is not supported in your browser
VIEW IN TELEGRAM
Уже было о LoopMaker — нативном приложении для Mac, которое генерирует музыку локально на устройстве с помощью фреймворка Apple MLX. Вот что изменилось с тех пор.
Что улучшилось:
Самое большое изменение — переход на ACE-Step 1.5, новейшую музыкальную модель с открытым исходным кодом от ACE Studio. Эта модель по результатам тестирования на SongEval показала результаты между Suno v4.5 и v5, что является огромным скачком по сравнению с тем, на каком уровне находилась генерация локальной музыки еще месяц назад.
Конкретные улучшения качества:
- Разделение инструментов стало намного чище. Треки больше не звучат размыто или сжато
- Значительно улучшилась четкость и естественность вокала. Все еще не на уровне Suno v5, но теперь действительно приятно слушать
- Бас стал более плотным. 808-е и низкие частоты звучат как надо
- Высокочастотные детали (хай-хэты, тарелки, обертоны струнных) звучат более реалистично
- Структура песни на более длинных сессиях стала более целостной. Меньше случайных отклонений
Чем отличается архитектура новой модели:
В ACE-Step 1.5 используется гибридный подход, который отделяет планирование от рендеринга:
1) Языковая модель (на основе Qwen, 0,6–4 млрд параметров) отвечает за планирование песни с помощью метода Chain-of-Thought. Она принимает текстовое описание и создает полный план: темп, тональность, аранжировку, текст, стилистические характеристики.
2) Diffusion Transformer отвечает за синтез звука на основе этого шаблона
Такое разделение означает, что DiT не пытается одновременно понять ваш запрос и сгенерировать звук. Каждый компонент фокусируется на том, что у него получается лучше всего. Аналогичным образом разделение кодировщика текста и декодировщика изображений повысило качество SD-изображений.
Модель также использует внутреннее обучение с подкреплением для выравнивания, а не внешние модели вознаграждения. Без предвзятости в пользу RLHF. Это помогает обеспечить единообразие подсказок на более чем 50 языках.
Технические детали, которые важны для этого сабреддита:
- Модель работает через Apple MLX + графический процессор через Metal
- Требуется менее 8 ГБ памяти. Работает на базе M1/M2 с 16 ГБ памяти
- В модели реализована поддержка тонкой настройки LoRA (пока не в приложении, но в планах)
- Лицензия MIT, обучение на лицензионных и бесплатных данных
Над чем еще нужно поработать:
- Скорость генерации на MLX ниже, чем на CUDA. Минуты, а не секунды. Компромисс ради нативного интерфейса Mac
- Согласованность вокала может варьироваться в зависимости от поколения. Чувствительность к начальным данным по-прежнему высока (проблема «гача»)
- В приложении пока нет обучения с учителем. Если вы хотите провести тонкую настройку, вам нужно будет запустить необработанную модель через Python
- Некоторые жанры (особенно китайский рэп) проигрывают по сравнению с другими
(Обсуждение)
#LoopMaker #ACEStep15 #ACEStep #Suno #AiMusic #AiSong #AiAudio #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Это высокопроизводительная мультимодальная модель с открытым исходным кодом, разработанная совместно с NVIDIA специально для эпохи компьютерных агентов. (По производительности не уступает Holo2/Qwen, но в два раза превосходит их по пропускной способности)
Holotron-12B, обученная на основе открытой модели NVIDIA Nemotron-Nano-2 VL на собственной смеси данных H Company, является результатом тесного сотрудничества исследовательских лабораторий в разработке нового типа модели, оптимизированной в первую очередь для масштабирования и производительности в производственных условиях.
Почему создали Holotron-12B?:
Большинство современных мультимодальных моделей оптимизированы в первую очередь для статического зрения или выполнения инструкций. Однако у Holotron-12B, как и у модели Holo2, другая цель: служить в качестве модели принятия решений для компьютерных агентов, которые должны эффективно воспринимать, анализировать и действовать в интерактивных средах.
При разработке Holotron-12B стремились создать модель, которая могла бы эффективно масштабироваться в производственной среде, обрабатывая длинные контексты с несколькими изображениями, и при этом показывать хорошие результаты в тестах.
🤗Hugging Face: https://huggingface.co/Hcompany/Holotron-12B
📖Подробное техническое описание: https://hcompany.ai/holotron-12b
Пост: https://x.com/hcompany_ai/status/2033851052714320083
(Обсуждение)
#Holotron12B #NVIDIA #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM