Статья: OCC-RAG: компактные модели, которые отвечают только по источникам
https://habr.com/ru/companies/airi/articles/1047624/
https://habr.com/ru/companies/airi/articles/1047624/
📑 В опенсорс вышла самая точная нейронка для извлечения данных из любых документов — Lift от Datalab работает на уровне Gemini 3.5 Flash и опережает все открытые аналоги.
• Выдаёт структурированный JSON из PDF и изображений.
• Обрабатывает десятки страниц за около 9,5 секунд.
• Все поля остаются так же, как в оригинале.
Тест: https://www.datalab.to/playground
#Lift #OCR #JSON #PDF #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
Инструмент работает с файлами .fig от Figma, поддерживает любые модели через API или локальные нейросети. Интегрируется с Claude Code и Cursor.
💻 OpenPencil крутится на вашем компьютере и не требует подписок — полностью бесплатный.
#OpenPencil #Figma #AiDesign #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
🔖 Вышел ультимативный гайд по локальному запуску LLM — посвящается всем, кто хочет максимально ускорить модели на своём компе через llama.cpp.
Внутри — как выбрать железо, настроить ОС, управлять VRAM/RAM, работать с KV-кэшем, повысить скорость инференса на обычных ПК и многое другое.
🔗 https://carteakey.dev/blog/local-inference/local-llm-optimization/
#LocalLLM #Localinference #LLM #LocalAi #AiLocal
Внутри — как выбрать железо, настроить ОС, управлять VRAM/RAM, работать с KV-кэшем, повысить скорость инференса на обычных ПК и многое другое.
#LocalLLM #Localinference #LLM #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Компания Qwen выпустила Qwen-AgentWorld-35B-A3B — модель с 35 миллиардами параметров и всего ~3 миллиардами активных параметров на токен.
Самое интересное: это не стандартная модель для чата или инструкций и не полноценный автономный агент. Это языковая модель, обученная предсказывать, что произойдет в среде после того, как агент выполнит какое-либо действие.
Он охватывает семь областей взаимодействия агентов:
- Вызов MCP / инструмента
- Поиск
- Терминал
- Разработка программного обеспечения
- Android
- Web
- Взаимодействие с графическим интерфейсом операционной системы
Судя по всему, это предназначено для имитации взаимодействия агента с окружением: на основе истории действий и нового инструмента/действия в графическом интерфейсе предсказывается следующее наблюдение/состояние. Это может быть полезно для обучения агентов, автономной оценки, создания синтетических траекторий, тестирования рабочих процессов с использованием инструментов или создания изолированных сред без постоянного использования реальных инструментов.
Demo: https://qwen.ai/blog?id=qwen-agentworld#interactive-demo-interactive-demo
Блог: https://qwen.ai/blog?id=qwen-agentworld
Подробно: http://arxiv.org/abs/2606.24597
(Обсуждение)
#Qwen #QwenAgentWorld35BA3B #AiAgent #AgentAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Компания Empero выпустила Qwythos-9B-Claude-Mythos-5 — reasoning-модель с окном контекста до 1 млн токенов.
За основу взяли глубоко разцензуренную версию Qwen3.5-9B. Провели полный fine-tune всех параметров и дообучили модель на 500+ млн токенов из датасетов Claude Mythos и Claude Fable.
💻 Для обучения использовали синтетические Chain of Thought, собранные из логов сессий Fable 5 и Mythos 5.
=====
Еще: Qwythos-9B-Claude-Mythos-5-1M-uncensored-heretic-GGUF - «Еретик» без цензуры — модель, которая сейчас занимает 3-е место в рейтинге Hugging Face. Согласно эталонным показателям, версия без цензуры набрала немного больше баллов, чем оригинальная модель: 11/100 отказов при 0,00123 KLD.
Safetensors: https://huggingface.co/llmfan46/Qwythos-9B-Claude-Mythos-5-1M-uncensored-heretic
(Обсуждение)
#Qwen359B #Qwythos9B #Qwythos9BClaudeMythos5 #uncensored #heretic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👎2
💡 Студия ИИ без Цензуры
Локальная студия искусственного интеллекта без цензуры для Windows, Linux и macOS. Графический интерфейс без настройки для генерации изображений, больших языковых моделей GGUF, преобразования текста в речь и речи в текст!
🔗 https://github.com/techjarves/Uncensored-Local-Studio
🎞 Инструкция https://www.youtube.com/watch?v=qvamkqmLPn8
#Uncensored #LocalStudio #AiStudio #StableDiffusion #Whisper #Kokoro #Windows #MacOS #Linux #БезЦензуры #LocalAi #AiLocal
Локальная студия искусственного интеллекта без цензуры для Windows, Linux и macOS. Графический интерфейс без настройки для генерации изображений, больших языковых моделей GGUF, преобразования текста в речь и речи в текст!
Локальная студия искусственного интеллекта премиум-класса с нулевой конфигурацией и автономным графическим интерфейсом для Stable Diffusion (генерация изображений), больших языковых моделей (чат), Whisper (преобразование речи в текст) и Kokoro (преобразование текста в речь). Работает на графических и нейронных процессорах с аппаратным ускорением в Windows, Linux и macOS.
Он объединяет четыре основные локальные возможности искусственного интеллекта в один высокопроизводительный настольный интерфейс:
🎨 Генерация изображений (Stable Diffusion): создавайте и редактируйте высококачественные изображения в автономном режиме, используя веса моделей .safetensors, .gguf, или .ckpt .
💬 Текстовый чат (LLM): общайтесь в приватном режиме с языковыми моделями с открытым исходным кодом (формат GGUF), работающими на официальных высокопроизводительных llama.cpp бэкендах.
🎙 Преобразование речи в текст (Whisper): транскрибируйте голосовые записи и речь в текст в режиме реального времени с помощью встроенного whisper.cpp движка.
🗣 Преобразование текста в речь (Kokoro TTS): преобразование текстового вывода в максимально естественный и реалистичный голосовой звук в автономном режиме с помощью модели Kokoro-82M ONNX.
(Настройка)
#Uncensored #LocalStudio #AiStudio #StableDiffusion #Whisper #Kokoro #Windows #MacOS #Linux #БезЦензуры #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
На Reddit уже вовсю обсуждают альтернативу Hugging Face для моделей без цензуры и других модификаций... Которые могут и поудалять с серьезного портала по требованию создателей моделей и/или других сил!
⬇️ https://huggingbay.xyz
Посты в Х:
🔗 https://x.com/Kostoglodov/status/2071144065857679631
🔗 https://x.com/shawmakesmagic/status/2070918006033817867
=============
⬇️ Реестр моделей: https://modelregistry.io
Децентрализованное распространение моделей ИИ с открытым исходным кодом.
Проект: https://github.com/marella/modelregistry
(Обсуждение)
=======
⬇️ https://llama.garden
Проект: https://github.com/etemiz/llama.garden
(Обсуждение)
#ModelRegistry #Torrent #БезЦензуры #LocalAi #AiLocal
Посты в Х:
=============
Децентрализованное распространение моделей ИИ с открытым исходным кодом.
Проект: https://github.com/marella/modelregistry
(Обсуждение)
=======
Проект: https://github.com/etemiz/llama.garden
(Обсуждение)
#ModelRegistry #Torrent #БезЦензуры #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🚀 DeepSeek выпустила DSpark — метод ускорения инференса на 51–400%
DeepSeek представила DSpark — новый подход к спекулятивному декодированию для моделей DeepSeek V4 Flash и V4 Pro. Метод разгоняет пропускную способность инференса от полутора до четырёх раз.
DSpark работает не только с моделями DeepSeek, но и с другими открытыми LLM — например, Gemma и Qwen. Компания опубликовала исходный код, научную статью с описанием и готовую модель на Hugging Face.
🔗 https://github.com/deepseek-ai/DeepSpec
🔗 https://github.com/deepseek-ai/DeepSpec/blob/main/DSpark_paper.pdf
🔗 https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro-DSpark
🎞 Наглядно: https://www.youtube.com/watch?v=J0D7qV3nl7w
#DSpark #DeepSeek #huggingface #LocalAi #AiLocal
DeepSeek представила DSpark — новый подход к спекулятивному декодированию для моделей DeepSeek V4 Flash и V4 Pro. Метод разгоняет пропускную способность инференса от полутора до четырёх раз.
DSpark работает не только с моделями DeepSeek, но и с другими открытыми LLM — например, Gemma и Qwen. Компания опубликовала исходный код, научную статью с описанием и готовую модель на Hugging Face.
#DSpark #DeepSeek #huggingface #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌟 В локального ИИ-ассистента OpenHuman завезли новый режим Super Context — теперь он улавливает контекст при открытии каждого чата, чтобы вам не приходилось объяснять всё каждый раз.
Ваш личный ИИ-ассистент, которой помнит всё https://tinyhumans.ai/openhuman
Проект: https://github.com/tinyhumansai/OpenHuman
#OpenHuman #AiAgent #AgentAi #LocalAi #AiLocal
→ Изучает документацию, смотрит ваш экран, проверяет почту и читает логи.
→ Ставит цели, задачи и план для любой задачи.
→ Работает на уровне ОС и интегрируется со 118 приложениями.
→ Запускается 100% локально, данные никогда не покидают ваш ПК.
→ Со временем адаптируется к вашему стилю работы и экономит токены.
Ваш личный ИИ-ассистент, которой помнит всё https://tinyhumans.ai/openhuman
Проект: https://github.com/tinyhumansai/OpenHuman
#OpenHuman #AiAgent #AgentAi #LocalAi #AiLocal
Используйте свой форк llama.cpp. Без компиляции. Без Electron. Без Python. Укажите Claude Code на свой компьютер с помощью одной команды — полностью в автономном режиме. Быстрее LM Studio!
#TurboLLM #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Вышли: 9B Dense, 31B Dense, 35B MoE, и 397B MoE
Особенности:
- Современные агенты для написания кода: доступны в версиях 9B-Dense, 31B-Dense, 35B-MoE и 397B-MoE (дообучена на основе Gemma 4 и Qwen 3.5). По сравнению с моделями открытого исходного кода сопоставимого размера демонстрируют лучшую производительность в таких бенчмарках, как Terminal-Bench 2.1, SWE-Bench, NL2Repo и OpenClaw.
- Самосовершенствующаяся обучающая система: Ornith-1.0 использует метод обучения с подкреплением, чтобы научиться генерировать не только развертки решений, но и структуру, которая управляет этими развертками. Благодаря совместной оптимизации структуры и получаемого решения модель находит более эффективные траектории поиска и генерирует решения более высокого качества.
- Лицензия: лицензия MIT, глобальный доступ и отсутствие региональных ограничений.
Все тут: https://huggingface.co/collections/deepreinforce-ai/ornith-10
- Ornith-1.0-9B https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF
- Ornith-1.0-35B https://huggingface.co/deepreinforce-ai/Ornith-1.0-35B-GGUF
(Обсуждение) и Ornith-1.0 9B превосходит Qwen 3.6 35B по различным показателям!
#Ornith #Ornith10 #AiAgent #AgentAi #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Набор данных о совместимости локальных больших языковых моделей
Карта, на которой видно, какие локальные языковые модели подходят для каждого уровня оперативной памяти — от 8 до 128 ГБ!
93 модели с разбивкой по параметрам, квантованию и нагрузке на память. Работают локально на Apple Silicon и графических процессорах NVIDIA. Бесплатно по лицензии CC BY 4.0. Обновлено 26 июня 2026 года.
Проект: https://github.com/Wecko-ai/modelfit-hardware-dataset
(Обсуждение)
#ModelFit #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
ModelFit
Local LLM Compatibility Dataset (2026): Models × Hardware | ModelFit
Open dataset: 107 AI models by params, quantization, and memory load. Which run locally on Apple Silicon and NVIDIA GPUs. Free under CC BY 4.0, with JSON export.