Ling-3.0-flash-VL - нативная мультимодальная модель нового поколения. Она создана на основе Ling-3.0-flash и включает визуальную информацию в полный процесс понимания, логического мышления, действий и проверки, выходя за рамки восприятия изображений и видео и решая реальные задачи с помощью зрения.
Ling-3.0-flash-VL с общим количеством параметров 124 млрд, активированными параметрами всего 5,5 млрд на токен, поддержкой изображений и видео и контекстным окном до 1 млн токенов обеспечивает мощные мультимодальные логические и агентные возможности с исключительной эффективностью.
Обзор модели:
Ling-3.0-flash-VL унаследовала языковые, логические и контекстные возможности Ling-3.0-flash, дополнив их собственным пониманием изображений и видео. Модель имеет 124 миллиарда параметров, из которых только 5,5 миллиарда активируются для каждого токена, и поддерживает контекстное окно до 1 миллиона токенов.
Архитектура Ling-3.0-flash-VL предназначена для интеграции визуальной информации в логические и агентные рабочие процессы.
- Визуальный кодировщик ViT извлекает элементы из изображений и видео, в то время как двухслойный MLP-проектор выравнивает визуальные элементы с текстовыми представлениями для унифицированного мультимодального понимания и рассуждений;
- VideoRoPE кодирует как пространственные положения, так и временной порядок, позволяя модели понимать визуальные изменения с течением времени и поддерживая такие задачи, как локализация событий, ответы на вопросы в виде длинного видео и редактирование видеоклипов.;
- 42-Слойная гибридная магистраль чередует уровни KDA и Gated MLA в соотношении 5: 1, обеспечивая эффективную долговременную контекстную обработку текста, изображений, видео и расширенных историй задач агента.;
- Разреженная архитектура MoE поддерживает общую емкость модели в 124B параметров при активации только 5,5B параметров на токен, балансируя сильные мультимодальные возможности с эффективностью вывода.
В целом, эти проекты делают видение чем-то большим, чем просто входные данные, интегрируя его в целостный процесс понимания, рассуждений, планирования, действий и проверки.
(Обсуждение)
#Ling30flashVL #Ling #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Nex-N2.5-Mini - 35B (A3B) - попробовать Free
Nex-N2.5-Pro - 397B (A17B) - попробовать Free
Nex-N2.5-Max - 1.6T (A49B)
Nex-N2.5 - Семейство агентных моделей нового поколения, созданных для решения долгосрочных задач в реальных условиях.
Nex-AGI официально представляет Nex-N2.5, семейство агентных моделей нового поколения.
Nex-N2.5 доступен в трех размерах: mini, Pro и Max.
Nex-N2.5-mini и Nex-N2.5-Pro продолжают развивать мультимодальные возможности Nex-N2, уделяя особое внимание использованию компьютера, просмотру веб-страниц и визуально ориентированным агентным возможностям.
Nex-N2.5-Max построена на базовой модели Mixture-of-Experts (MoE) с 1,6 триллионами параметров, работающей только с текстовыми данными. Это наша первая полноценная работа после обучения модели с триллионами параметров.
Для решения долгосрочных задач в реальных условиях Nex-N2.5 еще больше расширяет свои возможности непрерывного действия и самокоррекции с помощью визуальной обратной связи. Модели могут управлять компьютерами и браузерами, а также автономно выполнять и тестировать программы. Таким образом, зрение перестало быть просто способом ввода данных и превратилось в важнейший интерфейс, с помощью которого агент воспринимает окружающую среду, проверяет результаты и продвигается к выполнению задачи.
Опираясь на этот фундамент, мы расширили спектр сред для обучения агентов, типов задач и сценариев повышения производительности, а также впервые провели систематическое пост-обучение на триллионном масштабе параметров. Благодаря более широкому охвату задач и более качественной обратной связи с окружающей средой Nex-N2.5 обеспечивает дальнейший прогресс в научных исследованиях, интеллектуальной работе и решении сложных задач, связанных с повышением производительности.
(Обсуждение)
(Обсуждение)
#NexN25 #NexAGI #NexN25mini #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Разработчик выложил на GitHub инструменты для запуска нейросетей прямо с USB-накопителя — без интернета и установки на компьютер.
Что можно запустить: текстовые модели, генерацию изображений, распознавание и синтез речи. На флешку на 8 ГБ влезает несколько моделей, на 32 ГБ — уже приличный набор.
Тот же автор сделал портативную версию Claude-агента. Всё работает на Windows, macOS и Linux, API-ключи и настройки хранятся локально.
Uncensored AI Studio — это автономная студия искусственного интеллекта для Windows, Linux и macOS, не требующая установки. В отличие от облачных систем искусственного интеллекта, она работает исключительно на вашем собственном оборудовании без цензуры, отслеживания, подписок и необходимости входа в систему.
Он объединяет четыре основные локальные возможности искусственного интеллекта в один высокопроизводительный настольный интерфейс:
🎨 Генерация изображений (Stable Diffusion): создавайте и редактируйте высококачественные изображения в автономном режиме, используя веса моделей .safetensors, .gguf, или .ckpt .
💬 Текстовый чат (LLM): общайтесь в приватном режиме с языковыми моделями с открытым исходным кодом (формат GGUF), работающими на официальных высокопроизводительных llama.cpp бэкендах.
🎙 Преобразование речи в текст (Whisper): транскрибируйте голосовые записи и речь в текст в режиме реального времени с помощью встроенного whisper.cpp движка.
🗣 Преобразование текста в речь (Kokoro TTS): преобразование текстового вывода в максимально естественный и реалистичный голосовой звук в автономном режиме с использованием модели Kokoro-82M ONNX.
#UncensoredAIStudio #Uncensored #БезЦензуры #AIStudio #USBAI #AIUSB #Windows #Linux #MacOS #OpenClaudePortable #OpenClaude #AiPortable #Portable #StableDiffusion #SD #Whisper #Kokoro #TTS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🧠 GigaChat 3.5 Reasoning — первая в России открытая модель с рассуждениями
Выкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE.
🔗 https://t.me/gigadev_channel/75
Подробно: По бенчам сопоставима с DeepSeek V4 Flash при меньшем расходе токенов. Код и веса открыты.
⬇️ Скачать: https://huggingface.co/ai-sage/GigaChat3.5-432B-A28B-Reasoning-GGUF - Q4_K_M=262 GB
(Осталось под нее в октябре купить Mac Ultra M5-512Gb)
#GigaChat35Reasoning #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Выкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE.
Подробно: По бенчам сопоставима с DeepSeek V4 Flash при меньшем расходе токенов. Код и веса открыты.
(Осталось под нее в октябре купить Mac Ultra M5-512Gb)
#GigaChat35Reasoning #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤡1
📎 GenOffice — бесплатный офисный пакет с поддержкой ИИ
GenOffice — опенсорсная альтернатива MS Office, которая работает с форматами .docx, .xlsx и .pptx. Запускается локально на Windows, MacOS и Linux. Умеет показывать диффы и откатывать изменения.
Встроенная интеграция с языковыми моделями (список ниже) — можно редактировать тексты, таблицы и презентации прямо в интерфейсе. Всё бесплатно и с открытым исходным кодом.
🔗 https://genoffice.ai/ru/
🔗 https://github.com/genspark-ai/genoffice
#GenOffice #MSOffice #Windows #MacOS #Linux #LocalAi #AiLocal
GenOffice — опенсорсная альтернатива MS Office, которая работает с форматами .docx, .xlsx и .pptx. Запускается локально на Windows, MacOS и Linux. Умеет показывать диффы и откатывать изменения.
Встроенная интеграция с языковыми моделями (список ниже) — можно редактировать тексты, таблицы и презентации прямо в интерфейсе. Всё бесплатно и с открытым исходным кодом.
Бэкенды ИИ — вход в Genspark или использование собственного ключа. По умолчанию приложения входят в учетную запись Genspark с помощью кода устройства — вводить ключ API модели не нужно — и вызовы моделей проходят через прокси Genspark (семейства Claude, GPT и Gemini). Или используйте свой ключ (BYOK) в настройках ИИ: Claude, OpenAI, Gemini, DeepSeek, Kimi, GLM, Qwen, Doubao, MiniMax, Grok, Mistral, OpenRouter и OpenCode Zen/Go уже встроены, плюс есть слот для пользовательского провайдера для любой конечной точки, совместимой с OpenAI (базовый URL + ключ), включая локальные серверы.
Генерация изображений и анализ изображений/видео имеют собственный каталог провайдеров (настройки AI Media & Search): OpenAI, Gemini, Doubao/Seedream, GLM CogView, Grok Imagine, Qwen-Image, MiniMax или любая конечная точка изображений, совместимая с OpenAI, каждая со своим ключом, который можно назначить для каждой возможности.
Веб-поиск также может выполняться с использованием вашего собственного ключа Serper или Tavily.
Учетная запись Genspark также открывает доступ к конечным точкам инструментов Genspark ("gsk") — веб-поиску и поиску изображений, генерации и редактированию изображений, анализу изображений/аудио/видео и расшифровке аудио. Все это доступно через packages/ai-search для всех, кто расширяет возможности агентов.
#GenOffice #MSOffice #Windows #MacOS #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Apodex-1.1 - это модель, основанная на рассуждениях, для решения сложных исследовательских задач на длительный период. Помимо поиска и написания отчетов, он работает непосредственно с файлами, данными, кодом и инструментами для выполнения задач от ввода данных до поддающихся проверке результатов. Поддерживаемый AgentOS и командой асинхронных агентов, он может поддерживать состояние задачи, адаптировать ее план, координировать параллельную работу и учитывать отзывы пользователей на протяжении всего выполнения.
Основные характеристики:
- Комплексное выполнение в реальных условиях. Apodex 1.1 работает напрямую с научными статьями, наборами данных, электронными таблицами, изображениями и кодом. Он может очищать данные, выбирать методы, проводить анализ, проверять промежуточные результаты, устранять ошибки и преобразовывать исходные данные в верифицируемые результаты в рамках одной непрерывной задачи.
- Адаптивная и управляемая пользователем команда агентов. Модель динамически разбивает сложные задачи на подзадачи и координирует работу нескольких субагентов, выполняющих их параллельно. Результаты непрерывно передаются в общее состояние задачи, что позволяет Apodex пересматривать приоритеты, сохранять выполненную работу и реагировать на новые файлы, требования или отзывы пользователей без перезапуска всей задачи.
- Проверка, встроенная в доставку. Проверка заявлений независимо проверяет ключевые утверждения на соответствие их подтверждающим источникам, данным и расчетам перед отправкой. Когда доказательств недостаточно, цитаты не совпадают или результаты противоречат ожиданиям, система отмечает проблему, исправляет ошибочное заключение и сохраняет процесс проверки доступным для проверки.
Попробуйте Apodex на apodex.ai.
(Обсуждение)
#Apodex11 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
📱 LmLinky — это Android-приложение, которое позволяет пользователям легко взаимодействовать с локально размещенными языковыми моделями и сервисами искусственного интеллекта. Оно предоставляет удобный интерфейс для отправки запросов и получения ответов от моделей, работающих на вашем локальном компьютере или в сети.
🔗 https://github.com/Dewpg/LmLinky
⬇️ Скачать: https://github.com/Dewpg/LmLinky/releases/
Установочный: v1LmLinky.apk (v1.0.0)
(Обсуждение)
#LmLinky #Android #LocalAi #AiLocal
Возможности:
🔗 Интеграция с локальной моделью — подключение к локальным моделям ИИ
💬 Простая коммуникация — простой интерфейс для отправки запросов и получения ответов
🚀 Ответы в реальном времени — быстрая коммуникация с локальными моделями
📱 Android Native — оптимизация для устройств Android
🎯 Удобный пользовательский интерфейс — интуитивно понятный дизайн для комфортного взаимодействия
Настройка локальной модели с использованием:
Ollama — рекомендуется для удобства использования
LM Studio
GPT4All
Любой API-интерфейс, совместимый с OpenAI
Настройте подключение в LmLinky:
Введите адрес сервера вашей локальной модели (например, http://192.168.1.100:11434)
Выберите или укажите название модели
Сохранить конфигурацию
Установочный: v1LmLinky.apk (v1.0.0)
(Обсуждение)
#LmLinky #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
✨ Bonsai-27B 1-bit 27B в браузере на WebGPU, без установки!
(25–30 tok/s on a 6 GB RTX 3060 Laptop)
mentria.ai - это браузерный движок для вывода данных на WebGPU / WGSL.
Также в движке: младшие версии (Qwen3.5 0.8B, 2B, 4B) поддерживают телефоны и бюджетные устройства, адаптеры LoRA с горячей заменой нескольких МБ на matmul менее чем за секунду, а также есть модуль Vision Tower для ввода изображений.
🔗 https://mentria.ai/tools/ai-chat/
(Обсуждение)
#WebGPU #mentriaai #mentria #Bonsai27B #LocalAi #AiLocal
(25–30 tok/s on a 6 GB RTX 3060 Laptop)
mentria.ai - это браузерный движок для вывода данных на WebGPU / WGSL.
Также в движке: младшие версии (Qwen3.5 0.8B, 2B, 4B) поддерживают телефоны и бюджетные устройства, адаптеры LoRA с горячей заменой нескольких МБ на matmul менее чем за секунду, а также есть модуль Vision Tower для ввода изображений.
Исходный код, результаты тестов и способы измерения представлены в репозитории: https://github.com/mentria-ai/website.
Страница с фактами о движке, на которой рассказывается о том, как на самом деле работают движок и модель: https://mentria.ai/assets/learn/engine-facts.html
(уровень 27B появится, когда ваш графический процессор будет соответствовать требованиям).
(Обсуждение)
#WebGPU #mentriaai #mentria #Bonsai27B #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
meetas - Ваши собрания остаются на вашем компьютере.
🎙 meetas записывает совещания с вашего микрофона (или импортирует существующие записи), расшифровывает их в автономном режиме с помощью локального распознавания речи, отвечает на вопросы, выделяет задачи и анализирует все с помощью ваших собственных локальных языковых моделей — без облачных сервисов, учетных записей и внешних ИИ-сервисов.
✨ Функции:
Запись
🎙 Запись совещаний — запуск, пауза, возобновление, остановка; все данные сохраняются даже в случае сбоя
📥 Импорт существующих записей — WAV, MP3, M4A, FLAC, OGG, OPUS, AAC и видеофайлы (MP4, MKV, WEBM, MOV, AVI — аудиодорожка транскрибируется, например, из записей экрана во время совещания) — возобновляемые загрузки, импортируются как обычные совещания
⚡️ Транскрипция в реальном времени — непрерывная транскрипция во время совещания (по желанию)
🔊 Улучшение звука — опциональное локальное шумоподавление с настраиваемыми профилями; улучшенная и оригинальная версии всегда доступны одновременно
Транскрипция
📝 Offline ASR — локальные модели от tiny до large-v3-turbo (faster-whisper) плюс Parakeet для работы в реальном времени; язык определяется автоматически для любого языка, который поддерживает выбранная вами модель — в том числе для совещаний с переключением языков, по сегментам
ИИ (все локальные)
🤖 Анализ совещаний — структурированный анализ по 9 разделам (краткое содержание, темы, решения, задачи и т. д.), где каждое утверждение подкреплено цитатами из протокола — ничего не выдумано
� Вопросы и чат — обоснованные вопросы с реальными цитатами из протокола (и уровнем доказательности, чтобы вы всегда видели, насколько убедителен ответ), относящиеся к одному совещанию, проекту или нескольким совещаниям; а также общий чат, который никогда не затрагивает данные ваших совещаний
✨ Автоматическое добавление заголовка и тегов — пусть локальная языковая модель предложит вам заголовок и теги
👥 Распознавание говорящего — локальная диаризация говорящего, возможность переименовать говорящего (по желанию)
Организуйте и действуйте
📂 Проекты — групповые совещания и документы (PDF, DOCX, ODT, XLSX, PPTX, TXT, MD, CSV); документы индексируются и становятся доступными для поиска и обсуждения
🔎 Поиск — мгновенный полнотекстовый + локальный гибридный (векторный) поиск по стенограммам и документам проекта
✅ Задачи — извлечение задач из совещания, общий обзор, история, архив
📊 Аналитика по нескольким встречам — сравнение встреч, дайджест нескольких встреч (полностью в автономном режиме), повторяющиеся темы и хронология вашей активности
🏷 Теги и маркеры — организация встреч, пометка важных моментов, редактирование расшифровок с полной историей версий
🗑 Корзина — временное удаление с возможностью восстановления; окончательное удаление только по вашему желанию
Вывод
📤 Экспорт — Markdown, TXT, JSON, HTML (PDF/DOCX с чистым резервным вариантом), с возможностью выбора разделов
💾 Резервные копии — согласованное локальное резервное копирование и восстановление с предварительным просмотром
🔒 Данные остаются локальными — по умолчанию без облачных сервисов, телеметрии и подключения к сети
(Обсуждение)
#meetas #Parakeet #Linux #Whisper #Диктовка #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
Быстрое создание изображений локально и в автономном режиме.
Это уже гораздо больше, чем старый Stable Diffusion GUI. На сентябрь 2026 года приложение умеет современные image/video-модели, локальное обучение LoRA, ControlNet, inpainting/outpainting, Infinite Canvas. В актуальных релизах фигурируют FLUX.2, Qwen Image, Z-Image, LTX-2.3, Ideogram 4, Krea 2 и другие модели. Локальный режим бесплатен.
Собственный движок Metal (не оболочка Python), загрузка моделей в один клик и поддержка всего — от SD 1.5 до FLUX.2, Qwen Image и обучения LoRA на устройстве. Локальная генерация не ограничена и бесплатна; дополнительная подписка распространяется только на облачные вычисления.
Бесплатно из App Store, нативный движок на Metal FlashAttention + Neural Engine. SD 1.5 / SDXL / FLUX / ControlNet / LoRA, даже обучение LoRA и куски видео (Wan). Для большинства Mac это лучший локальный генератор картинок: проще DiffusionBee и обычно быстрее ComfyUI на Apple Silicon.
❓Насколько быстро генерируются изображения на Apple Silicon?
Все приведенные ниже цифры взяты из опубликованных сообществом измерений с указанием источника. ModelFit не проводит собственные тесты.
→SD 1.5, 512 × 512: ~ 5-10 секунд на Mac mini M4 Pro (для heyuan110); ~ 8-15 секунд на M2 Pro для рисования (для rentamac.io )
→SDXL, 1024 × 1024: ~ 20-40 секунд на M4 Pro, 25 шагов (на heyuan110)
→FLUX.1 dev Q6, 1024 × 1024, 20 шагов: ~ 50-90 на M4 Pro в ComfyUI (согласно heyuan110)
→FLUX.1 schnell (2 шага): менее 15 секунд на M2 Ultra, ~ 80 секунд на M3 Pro без квантования (согласно таблице тестов mflux)
Схема такая: модели класса schnell можно использовать на любом современном чипе Pro/Max, модели класса dev можно использовать с небольшой задержкой, а машины с чипом base-M и 8 ГБ памяти должны оставаться на SD 1.5.
Из статьи: Локальная генерация изображений на Mac: что подходит для вашей оперативной памяти (2026)
#DrawThings #SD15 #SD #SDXL #FLUX #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Нативная поддержка Stable Diffusion на Mac!
Mochi Diffusion — это вариант, ориентированный на Core ML: меньше занимает памяти, медленнее работает при первом запуске, но быстрее при последующих, после того как модель будет скомпилирована в .mlmodelc. Используйте его, если вам нужны только варианты Stable Diffusion и вы хотите максимально компактную настройку.
Сейчас заявлены Stable Diffusion и FLUX.2 Klein, Image2Image, ControlNet, галерея и собственные Core ML-модели. Всё нативно на SwiftUI и полностью offline.
Но между Mochi Diffusion и Draw Things я бы однозначно сначала ставил Draw Things. Mochi интересен своей простотой и использованием Core ML/Neural Engine.
#MochiDiffusion #StableDiffusion #SD #FLUX2Klein #FLUX2 #FLUX #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM