Spellar AI — это инструмент для автоматического создания структурированных заметок со встреч с помощью искусственного интеллекта. Он записывает аудио, транскрибирует его, анализирует разговор и генерирует резюме с пунктами действий. Ключевое преимущество — приложение работает локально на вашем устройстве (macOS, iOS, iPadOS), не присоединяя бота к звонку, что обеспечивает конфиденциальность.
Как это работает:
- Локальная запись. Приложение захватывает аудио с вашего микрофона или системного звука, не требуя участия бота в конференции. Это позволяет работать с Zoom, Google Meet, Microsoft Teams и другими платформами.
- Многоязычная транскрипция. Поддерживается более 100 языков с автоматическим определением языка.
- ИИ-анализ. На основе транскрибации сервис создаёт резюме, выделяет ключевые моменты, решения и пункты действий.
- ИИ-ассистент (Copilot). Во время встречи можно задавать вопросы ассистенту, чтобы уточнить детали или получить контекст. Есть специализированные режимы (например, для мозгового штурма или перевода).
- Подготовка к встрече. Можно заранее подготовить повестку и тезисы прямо в событии календаря, и они появятся в интерфейсе при начале записи.
- Интеграции. Готовые заметки и пункты действий можно автоматически экспортировать в Notion, Google Docs, Linear, Jira, Confluence и другие инструменты.
Ключевые особенности:
- Мультимодельный ИИ. Можно выбрать одну из ведущих моделей (Claude, GPT, Gemini, Perplexity) или использовать собственный API-ключ.
- Шаблоны встреч. Встроенные форматы для ежедневных стендапов, ретроспектив, продаж и других типов встреч, а также возможность создавать свои.
- Поиск по истории. ИИ запоминает контекст прошлых встреч, что позволяет задавать вопросы о деталях, о которых договаривались несколько недель назад.
- Тренер по речи. Помимо заметок, Spellar анализирует вашу речь: отслеживает слова-паразиты, даёт обратную связь по произношению, грамматике и чёткости.
Есть бесплатно, но крестик "закрыть" еле видно на странице тарифов! Из локальных моделей только #Whisper Medium! А вот Large и Turbo нет!
#SpellarAI #Spellar #Диктовка #Транскрибация #MacOS #iPad #iPhone #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Она может помочь вам писать код, редактировать файлы, выполнять команды, а также создавать графики и диаграммы. Вы выбираете модель, папку проекта и права доступа для ее инструментов. Вы также можете изменить ее имя и характер.
При использовании локальной модели Jenny обрабатывает ваши запросы на вашем компьютере и сохраняет там диалоги. Для локального чата вам не нужна учетная запись или ключ API. Ollama запускает модель; vLLM — еще один поддерживаемый вариант.
Jenny построена на основе моделей меньшего размера, примерно с 9–35 миллиардами параметров. Насколько хорошо она справится с задачей, зависит от выбранной вами модели и вашего оборудования. Ожидайте ошибок, особенно при выполнении сложных задач, и проверяйте код и команды, прежде чем полагаться на них.
Установка на Windows:
Скачайте Jenny-Setup-x64.exe и запустите его. Никаких страниц мастера не требуется. Установщик создает ярлык Jenny на рабочем столе.
(Обсуждение)
#Jenny #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenBMB выпустила MiniCPM5-2B — компактную модель на 2,5 млрд параметров
Новая версия после майской MiniCPM5-1B рассчитана на локальный запуск. По индексу Artificial Analysis модель лидирует среди открытых моделей до 4 млрд параметров. В обновлённой версии индекса v4.2 балл чуть ниже, но MiniCPM5-2B всё равно первая в своём классе — вровень с Qwen3.5 9B, которая в четыре раза больше.
💼 Главная сила — агентные задачи: на τ³-Banking делит первое место среди малых моделей, на GDPval-AA опережает всех. Слабее в знаниях, терминальном программировании и длинном контексте. Расход токенов на задачу втрое меньше, чем у Ling 3.0 Tiny.
Контекст 128K, вызов инструментов, цепочки рассуждений. После SFT на 400 млрд токенов и RL в модель дистиллировали 16 экспертных моделей, включая 5 агентных (OPD). Вместе с весами авторы открыли данные, рецепт и RL-стек.
Веса под Apache 2.0, доступны форматы GGUF, MLX, GPTQ и черновая DSpark для ускорения. Есть демо.
Пост: https://x.com/OpenBMB/status/2096970974247956501
(Обсуждение)
#MiniCPM #MiniCPM52B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1) OpenVox - https://t.me/Ai2Local/515
2) Voicebox - https://t.me/Ai2Local/222
3) Kokori
4) Murmur TTS
5) Bantr - https://t.me/Ai2Local/97
А еще есть:
- MimikaStudio https://t.me/Ai2Local/205
- Spokio https://spokio.pro - MacOS
- VoiceNPC https://www.voicenpc.com/ru - для iPhone · iPad · Mac · Apple Silicon
#OpenVox #Voicebox #Kokori #MurmurTTS #VoiceNPC #Spokio #TTS #MacOS #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Статья: Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM / https://habr.com/ru/articles/1079902/
Хабр
Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM
Qwen3.8-Flash-Next - открытая 125B-модель на архитектуре, которая станет основой Qwen4. По опубликованным Qwen результатам она конкурирует с закрытыми frontier-моделями в задачах программирования,...
😁1
Ling-3.0-flash-VL - нативная мультимодальная модель нового поколения. Она создана на основе Ling-3.0-flash и включает визуальную информацию в полный процесс понимания, логического мышления, действий и проверки, выходя за рамки восприятия изображений и видео и решая реальные задачи с помощью зрения.
Ling-3.0-flash-VL с общим количеством параметров 124 млрд, активированными параметрами всего 5,5 млрд на токен, поддержкой изображений и видео и контекстным окном до 1 млн токенов обеспечивает мощные мультимодальные логические и агентные возможности с исключительной эффективностью.
Обзор модели:
Ling-3.0-flash-VL унаследовала языковые, логические и контекстные возможности Ling-3.0-flash, дополнив их собственным пониманием изображений и видео. Модель имеет 124 миллиарда параметров, из которых только 5,5 миллиарда активируются для каждого токена, и поддерживает контекстное окно до 1 миллиона токенов.
Архитектура Ling-3.0-flash-VL предназначена для интеграции визуальной информации в логические и агентные рабочие процессы.
- Визуальный кодировщик ViT извлекает элементы из изображений и видео, в то время как двухслойный MLP-проектор выравнивает визуальные элементы с текстовыми представлениями для унифицированного мультимодального понимания и рассуждений;
- VideoRoPE кодирует как пространственные положения, так и временной порядок, позволяя модели понимать визуальные изменения с течением времени и поддерживая такие задачи, как локализация событий, ответы на вопросы в виде длинного видео и редактирование видеоклипов.;
- 42-Слойная гибридная магистраль чередует уровни KDA и Gated MLA в соотношении 5: 1, обеспечивая эффективную долговременную контекстную обработку текста, изображений, видео и расширенных историй задач агента.;
- Разреженная архитектура MoE поддерживает общую емкость модели в 124B параметров при активации только 5,5B параметров на токен, балансируя сильные мультимодальные возможности с эффективностью вывода.
В целом, эти проекты делают видение чем-то большим, чем просто входные данные, интегрируя его в целостный процесс понимания, рассуждений, планирования, действий и проверки.
(Обсуждение)
#Ling30flashVL #Ling #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Nex-N2.5-Mini - 35B (A3B) - попробовать Free
Nex-N2.5-Pro - 397B (A17B) - попробовать Free
Nex-N2.5-Max - 1.6T (A49B)
Nex-N2.5 - Семейство агентных моделей нового поколения, созданных для решения долгосрочных задач в реальных условиях.
Nex-AGI официально представляет Nex-N2.5, семейство агентных моделей нового поколения.
Nex-N2.5 доступен в трех размерах: mini, Pro и Max.
Nex-N2.5-mini и Nex-N2.5-Pro продолжают развивать мультимодальные возможности Nex-N2, уделяя особое внимание использованию компьютера, просмотру веб-страниц и визуально ориентированным агентным возможностям.
Nex-N2.5-Max построена на базовой модели Mixture-of-Experts (MoE) с 1,6 триллионами параметров, работающей только с текстовыми данными. Это наша первая полноценная работа после обучения модели с триллионами параметров.
Для решения долгосрочных задач в реальных условиях Nex-N2.5 еще больше расширяет свои возможности непрерывного действия и самокоррекции с помощью визуальной обратной связи. Модели могут управлять компьютерами и браузерами, а также автономно выполнять и тестировать программы. Таким образом, зрение перестало быть просто способом ввода данных и превратилось в важнейший интерфейс, с помощью которого агент воспринимает окружающую среду, проверяет результаты и продвигается к выполнению задачи.
Опираясь на этот фундамент, мы расширили спектр сред для обучения агентов, типов задач и сценариев повышения производительности, а также впервые провели систематическое пост-обучение на триллионном масштабе параметров. Благодаря более широкому охвату задач и более качественной обратной связи с окружающей средой Nex-N2.5 обеспечивает дальнейший прогресс в научных исследованиях, интеллектуальной работе и решении сложных задач, связанных с повышением производительности.
(Обсуждение)
(Обсуждение)
#NexN25 #NexAGI #NexN25mini #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Разработчик выложил на GitHub инструменты для запуска нейросетей прямо с USB-накопителя — без интернета и установки на компьютер.
Что можно запустить: текстовые модели, генерацию изображений, распознавание и синтез речи. На флешку на 8 ГБ влезает несколько моделей, на 32 ГБ — уже приличный набор.
Тот же автор сделал портативную версию Claude-агента. Всё работает на Windows, macOS и Linux, API-ключи и настройки хранятся локально.
Uncensored AI Studio — это автономная студия искусственного интеллекта для Windows, Linux и macOS, не требующая установки. В отличие от облачных систем искусственного интеллекта, она работает исключительно на вашем собственном оборудовании без цензуры, отслеживания, подписок и необходимости входа в систему.
Он объединяет четыре основные локальные возможности искусственного интеллекта в один высокопроизводительный настольный интерфейс:
🎨 Генерация изображений (Stable Diffusion): создавайте и редактируйте высококачественные изображения в автономном режиме, используя веса моделей .safetensors, .gguf, или .ckpt .
💬 Текстовый чат (LLM): общайтесь в приватном режиме с языковыми моделями с открытым исходным кодом (формат GGUF), работающими на официальных высокопроизводительных llama.cpp бэкендах.
🎙 Преобразование речи в текст (Whisper): транскрибируйте голосовые записи и речь в текст в режиме реального времени с помощью встроенного whisper.cpp движка.
🗣 Преобразование текста в речь (Kokoro TTS): преобразование текстового вывода в максимально естественный и реалистичный голосовой звук в автономном режиме с использованием модели Kokoro-82M ONNX.
#UncensoredAIStudio #Uncensored #БезЦензуры #AIStudio #USBAI #AIUSB #Windows #Linux #MacOS #OpenClaudePortable #OpenClaude #AiPortable #Portable #StableDiffusion #SD #Whisper #Kokoro #TTS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🧠 GigaChat 3.5 Reasoning — первая в России открытая модель с рассуждениями
Выкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE.
🔗 https://t.me/gigadev_channel/75
Подробно: По бенчам сопоставима с DeepSeek V4 Flash при меньшем расходе токенов. Код и веса открыты.
⬇️ Скачать: https://huggingface.co/ai-sage/GigaChat3.5-432B-A28B-Reasoning-GGUF - Q4_K_M=262 GB
(Осталось под нее в октябре купить Mac Ultra M5-512Gb)
#GigaChat35Reasoning #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Выкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE.
Подробно: По бенчам сопоставима с DeepSeek V4 Flash при меньшем расходе токенов. Код и веса открыты.
(Осталось под нее в октябре купить Mac Ultra M5-512Gb)
#GigaChat35Reasoning #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤡1