Нужен был быстрый счетчик калорий для себя, который с помощью больших языковых моделей оценивал бы калорийность блюд по фотографиям и описаниям.
Мне нужно было выбрать модель, поэтому я провел быстрый сравнительный анализ.
Условия были следующими:
- Фотографии Nutrition5k для фото + калорийность: https://github.com/google-research-datasets/Nutrition5k
- Инструмент с доступом к информации о калорийности из USDA FoodData Central + MEXT
- Я оценивал модели по тому, в скольких случаях погрешность не превышала 20%
- Все модели тестировались на одних и тех же 25 случайно выбранных блюдах.
Модели, которые были слишком большими для моего компьютера, были запущены через OpenCode Go/OpenRouter. Я также подключил Spark 1.3, так как предполагается, что его веса будут открытыми.
Самое интересное — это то, как Muse Glimmer 30b обходит Qwen 3.8 27b. Думаю, это показывает, что «лучшая» модель для потребительского оборудования (~32 ГБ видеопамяти) на самом деле зависит от задачи.
Ранее было:
#AiFood #AiTracker #calories #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Частный ИИ-помощник для Mac. 💯Автономный режим.
Fluid — это приватный офлайн-ассистент на базе большой языковой модели Llama 3 от Meta, созданный специально для компьютеров Mac с чипом Apple Silicon и операционной системой macOS 14 и новее. Его ключевое преимущество — полная обработка данных непосредственно на вашем устройстве без отправки информации на внешние серверы, что обеспечивает высокий уровень конфиденциальности.
Основные возможности:
- Полностью офлайн. Все запросы и ответы генерируются локально, что делает Fluid отличным выбором для работы с чувствительными данными, например, корпоративными документами или личной информацией.
- Голосовое управление. Можно диктовать запросы, и аудиоданные остаются на устройстве.
- Быстрый доступ. Для вызова помощника используется сочетание клавиш ⌃ (Ctrl) + Space.
- История чатов. Позволяет легко возвращаться к предыдущим диалогам.
- Автоматические обновления. Приложение само обновляется до последней версии с шифрованием.
- Безопасность. Программа работает в изолированной среде (песочнице), прошла проверку и укрепление со стороны Apple, не требует прав администратора.
Технические требования:
Для работы Fluid требуется значительное место на диске:
- Около 4,9 ГБ для Mac с 8 ГБ ОЗУ.
- Около 8,6 ГБ для Mac с 16 ГБ ОЗУ и более.
Для компьютеров Mac с Apple Silicon и macOS 14 или более поздней версии.
Создано с помощью Meta Llama 3
#Fluid #MacOS #Meta #Llama3 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Хватит тратить часы на чтение PDF
Мгновенно общайтесь с любым PDF-файлом на своем Mac.
PDF Pals — это приложение для macOS, которое позволяет взаимодействовать с PDF-документами через чат с использованием искусственного интеллекта. Оно действительно хорошо подходит для резюмирования и анализа содержимого, при этом все операции выполняются локально на вашем устройстве, без выгрузки файлов в облако, что обеспечивает конфиденциальность.
Как это работает:
Вы открываете в приложении один или несколько PDF-файлов, задаёте вопросы на естественном языке, и ИИ отвечает, опираясь на содержание документов. Ответы сопровождаются цитатами с указанием конкретных страниц или фрагментов текста. Это особенно ценно для юридических и научных задач, где важна проверяемость.
Ключевые особенности:
- Локальная обработка. Файлы остаются на вашем Mac, не передаются внешним серверам.
- Мощный OCR-движок. Способен распознавать текст даже в отсканированных PDF-документах и сложных формах.
- Поддержка нескольких API. Можно использовать собственный ключ от OpenAI, Azure OpenAI или OpenRouter либо арендовать его прямо в приложении.
- Настраиваемый ИИ. Можно менять параметры модели (температуру, лимит контекста), язык ответов, использовать Markdown.
- Работа с несколькими файлами. Можно выделить несколько PDF в Finder, открыть их вместе и вести диалог по всей выборке.
- Защита данных. Приложение автоматически маскирует (редектит) в документах такую конфиденциальную информацию, как номера карт или денежные суммы.
#PDFPals #PDF #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Spellar AI — это инструмент для автоматического создания структурированных заметок со встреч с помощью искусственного интеллекта. Он записывает аудио, транскрибирует его, анализирует разговор и генерирует резюме с пунктами действий. Ключевое преимущество — приложение работает локально на вашем устройстве (macOS, iOS, iPadOS), не присоединяя бота к звонку, что обеспечивает конфиденциальность.
Как это работает:
- Локальная запись. Приложение захватывает аудио с вашего микрофона или системного звука, не требуя участия бота в конференции. Это позволяет работать с Zoom, Google Meet, Microsoft Teams и другими платформами.
- Многоязычная транскрипция. Поддерживается более 100 языков с автоматическим определением языка.
- ИИ-анализ. На основе транскрибации сервис создаёт резюме, выделяет ключевые моменты, решения и пункты действий.
- ИИ-ассистент (Copilot). Во время встречи можно задавать вопросы ассистенту, чтобы уточнить детали или получить контекст. Есть специализированные режимы (например, для мозгового штурма или перевода).
- Подготовка к встрече. Можно заранее подготовить повестку и тезисы прямо в событии календаря, и они появятся в интерфейсе при начале записи.
- Интеграции. Готовые заметки и пункты действий можно автоматически экспортировать в Notion, Google Docs, Linear, Jira, Confluence и другие инструменты.
Ключевые особенности:
- Мультимодельный ИИ. Можно выбрать одну из ведущих моделей (Claude, GPT, Gemini, Perplexity) или использовать собственный API-ключ.
- Шаблоны встреч. Встроенные форматы для ежедневных стендапов, ретроспектив, продаж и других типов встреч, а также возможность создавать свои.
- Поиск по истории. ИИ запоминает контекст прошлых встреч, что позволяет задавать вопросы о деталях, о которых договаривались несколько недель назад.
- Тренер по речи. Помимо заметок, Spellar анализирует вашу речь: отслеживает слова-паразиты, даёт обратную связь по произношению, грамматике и чёткости.
Есть бесплатно, но крестик "закрыть" еле видно на странице тарифов! Из локальных моделей только #Whisper Medium! А вот Large и Turbo нет!
#SpellarAI #Spellar #Диктовка #Транскрибация #MacOS #iPad #iPhone #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Она может помочь вам писать код, редактировать файлы, выполнять команды, а также создавать графики и диаграммы. Вы выбираете модель, папку проекта и права доступа для ее инструментов. Вы также можете изменить ее имя и характер.
При использовании локальной модели Jenny обрабатывает ваши запросы на вашем компьютере и сохраняет там диалоги. Для локального чата вам не нужна учетная запись или ключ API. Ollama запускает модель; vLLM — еще один поддерживаемый вариант.
Jenny построена на основе моделей меньшего размера, примерно с 9–35 миллиардами параметров. Насколько хорошо она справится с задачей, зависит от выбранной вами модели и вашего оборудования. Ожидайте ошибок, особенно при выполнении сложных задач, и проверяйте код и команды, прежде чем полагаться на них.
Установка на Windows:
Скачайте Jenny-Setup-x64.exe и запустите его. Никаких страниц мастера не требуется. Установщик создает ярлык Jenny на рабочем столе.
(Обсуждение)
#Jenny #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenBMB выпустила MiniCPM5-2B — компактную модель на 2,5 млрд параметров
Новая версия после майской MiniCPM5-1B рассчитана на локальный запуск. По индексу Artificial Analysis модель лидирует среди открытых моделей до 4 млрд параметров. В обновлённой версии индекса v4.2 балл чуть ниже, но MiniCPM5-2B всё равно первая в своём классе — вровень с Qwen3.5 9B, которая в четыре раза больше.
💼 Главная сила — агентные задачи: на τ³-Banking делит первое место среди малых моделей, на GDPval-AA опережает всех. Слабее в знаниях, терминальном программировании и длинном контексте. Расход токенов на задачу втрое меньше, чем у Ling 3.0 Tiny.
Контекст 128K, вызов инструментов, цепочки рассуждений. После SFT на 400 млрд токенов и RL в модель дистиллировали 16 экспертных моделей, включая 5 агентных (OPD). Вместе с весами авторы открыли данные, рецепт и RL-стек.
Веса под Apache 2.0, доступны форматы GGUF, MLX, GPTQ и черновая DSpark для ускорения. Есть демо.
Пост: https://x.com/OpenBMB/status/2096970974247956501
(Обсуждение)
#MiniCPM #MiniCPM52B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1) OpenVox - https://t.me/Ai2Local/515
2) Voicebox - https://t.me/Ai2Local/222
3) Kokori
4) Murmur TTS
5) Bantr - https://t.me/Ai2Local/97
А еще есть:
- MimikaStudio https://t.me/Ai2Local/205
- Spokio https://spokio.pro - MacOS
- VoiceNPC https://www.voicenpc.com/ru - для iPhone · iPad · Mac · Apple Silicon
#OpenVox #Voicebox #Kokori #MurmurTTS #VoiceNPC #Spokio #TTS #MacOS #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM