Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
🌐 MBZUAI представляет полностью открытую модель K2-V2 — 70B

K2-V2, выпущенная 6 декабря 2025, является новейшей моделью класса 70B в серии K2 LLM от IFM. Она не уступает ведущим моделям с открытым исходным кодом, при этом использует подход «360-open»: веса, данные, сведения об обучении, контрольные точки и рецепты тонкой настройки — всё это находится в открытом доступе.

Пост: https://mbzuai.ac.ae/news/k2v2-full-openness-finally-meets-real-performance/ - тут есть наглядная карта: производительность по горизонтальной оси, открытость по вертикальной, а размер пузырьков отражает масштаб модели...

Модель: https://huggingface.co/LLM360/K2-V2-Instruct
Кванты: https://huggingface.co/cturan/K2-V2-Instruct-GGUF - тут она как 73B!
Обсуждение на Reddit.
(Использовать в Jan, MSTY, LM Studio)
#MBZUAI #K2V2 #LLM #IFM #huggingface #GGUF #ModelAi
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
📱 Как запускать и использовать LLM на телефоне с iOS или Android

Руководство по тонкой настройке собственной LLM и ее развертыванию на Android или iPhone с помощью ExecuTorch.
https://docs.unsloth.ai/new/deploy-llms-phone
Вы можете обучить LLM, а затем развернуть их локально на телефонах Android и iPhone.

🎉 Поддержка моделей:
- Все модели Qwen 3 (Qwen3-0,6B, Qwen3-4B, Qwen3-32B и т. д.)
- Все модели Gemma 3 (Gemma3-270M, Gemma3-4B, Gemma3-27B и т. д.)
- Все модели Llama 3 (Llama 3.1 8B, Llama 3.3 70B Instruct и т. д.)
- Модели Qwen 2.5, Phi 4 Mini и многое другое!
#ExecuTorch #LLM #unsloth #deployllmsphone #iPhone #Android #LocalAi #AiLocal
👍2
ℹ️ Модель: NVIDIA Nemotron 3 Nano 30B A3B
https://developer.nvidia.com/nemotron

Модели Nemotron оптимизированы для различных платформ:
- Nano (30B) обеспечивает экономическую эффективность при высокой точности выполнения целевых агентских задач Демо
(Еще есть Nano VL 12B - Демо)

- Super (49B) обеспечивает высокую точность многоагентного моделирования ДЕМО или в NVIDIA NIM

- Ultra (253B) предназначен для приложений, требующих высочайшей точности вычислений Демо на OR

- Контекстное окно - 1 М токенов!
31,6 Млрд общих параметров, ~ 3,6 Млрд активных на токен: Предназначена для высокой пропускной способности и низкой задержки!

- Исключительная эффективность логического вывода: До 4 раз быстрее, чем Nemotron Nano 2, и до 3,3 раза быстрее, чем ведущие модели в своей размерной категории!
- Лучшая в своем классе точность рассуждений: Во всех областях рассуждений, кодирования, инструментов и многоступенчатых агентских задач.

Опробовал Nemotron 3 Nano 30B A3B (Q8) - модель ну очень быстрая для "Рассуждающей"! На MBP M4Max выдала 74.20 токенов/сек! и "Думала" 2 сек.
А qwen3-30b-a3b-thinking-2507 выдавала 77.17 токенов/сек, но думала 19.32 сек.! И ответ дала хуже значительно! (На мое ИМХО!)
На Reddit много тем с ее обсуждением и все отмечают скорость!
(Использовать в Jan, MSTY, LM Studio)
#ModelAi #huggingface #NVIDIA #Nemotron3 #GGUF
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
ℹ️ Модель: Qwen3-Next-80B-Thinking без цензуры!

Выпустили версию Qwen3-Next-80B-Thinking без цензуры, в которой устранена китайская политическая цензура.
Модель больше не отказывается отвечать на вопросы, связанные с китайской политикой. Вместо этого она будет давать сбалансированные, объективные ответы, в которых представлены различные точки зрения.
Эта модель является полной заменой оригинальной модели Qwen-Next. Никаких изменений в архитектуре, никаких дополнительных слоёв...
Подробнее на Reddit.

Модель: https://huggingface.co/MultiverseComputingCAI/Qwen3-Next-80B-A3B-Thinking-Uncensored
Квант: Qwen3-Next-80B-A3B-Thinking-Uncensored-mlx-6Bit= 64.8 GB
(Использовать в Jan, MSTY, LM Studio)
———————-
⚡️Самые «зацензуренные» нейросети 2025 года 👇
Разработчики бенчмарка Sansa Bench обновили рейтинг ИИ-моделей по уровню цензуры — то есть по тому, как часто нейросеть отказывается отвечать на запросы пользователя.

* чем выше балл, тем реже модель ограничивает ответы в спорных или чувствительных темах

Главные результаты:
• лидер — Llama 3 8B-Instruct (0,853 балла) — отвечает почти на всё и проявляет минимальные ограничения
Gemini 3 Pro Preview тоже оказался в числе наименее цензурированных (около 0,824)
GPT-4o-Mini — средняя степень ограничений (0,765)
GPT-5.2 — самая зацензуренная модель с баллом 0,324

Бенчмарк Sansa Censorship прогонял тысячи запросов и считал долю отказов ИИ от ответа: чем меньше отказов, тем «свободнее» модель.
—————
UGI Leaderboard - Uncensored General Intelligence
Тут оцениваются по «отсутствию цензуры» и уровню интеллекта.
#ModelAi #huggingface #GGUF #Qwen3 #Qwen3Next #Uncensored
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ️ Модель: Gemma-3 4B Cognitive-Liberty Когнитивная свобода!
Маркетинг MMLU 85 %, политика 83 % | 0 % отказов!

📊 Основные результаты тестирования (MMLU 5-shot)
Общий показатель MMLU соответствует базовой модели (~58 %), но распределение сильно меняется:
🧠 Маркетинг: 85,04% (это аномально высокий показатель для модели 4B)
🏛 Правительство и политика: 83,94%
🗣 Социология: 77,61%
🧩 Логические ошибки: 74,85%
🧠 Психология: 79,63%

💡«Моральная аномалия» (особенность, а не ошибка)
Вы увидите низкий балл за моральные сценарии (30,61 %).
Стандартные тесты предполагают бинарные, безопасные ответы (например, «Плохо ли делать X? -> Да»). Поскольку эта модель обучена анализировать нюансы (утилитаризм против деонтологии), она часто чрезмерно анализирует простые моральные вопросы или отказывается давать «стандартный» безопасный ответ. По наблюдениям, это приводит к более продуктивному общению, даже если это негативно сказывается на автоматизированном подсчёте баллов.

Использование:
Это модель 4B, поэтому она работает практически на любом устройстве (даже на телефонах/потребительских графических процессорах).

Она лучше всего подходит для:
- Обсуждение спорных тем (он не будет читать вам нотации).
- Анализ тактик манипулирования / маркетинга.
- Творческое письмо, где вам нужен «макиавеллиевский» персонаж.

Модель: https://huggingface.co/AiAsistent/gemma-3-4b-it-Cognitive-Liberty
Квант: https://huggingface.co/AiAsistent/gemma-3-4b-it-Cognitive-Liberty-GGUF
Для Ollama Источник и Обсуждение на Reddit.
(Использовать в Jan, MSTY, LM Studio, на iOS, на Android.)
#ModelAi #Gemma3 #CognitiveLiberty #huggingface #GGUF #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
ℹ️ Jan-v2-VL-Max: мультимодальная модель на 30B параметров, превосходящая Gemini 2.5 Pro и DeepSeek R1 в тестах на выполнение!

Jan-v2-VL-max превосходит DeepSeek R1 и Gemini 2.5 Pro в тесте Illusion of Diminishing Returns, который измеряет продолжительность выполнения задач.

Модель Jan-v2-VL-max, созданная на основе Qwen3-VL-30B-A3B-Thinking, масштабирует базовую модель Jan-v2-VL до параметров 30B и применяет RLVR на основе LoRA для повышения стабильности и снижения накопления ошибок при многоэтапном выполнении.

Модель доступна на https://chat.jan.ai - общедоступном интерфейсе, созданном на базе Jan Server, чтобы каждый мог опробовать модель в браузере.

https://chat.jan.ai не заменяет Jan Desktop. Он дополняет его, предоставляя сообществу общую среду для тестирования более крупных моделей Jan.

Модель: https://huggingface.co/janhq/Jan-v2-VL-max-FP8
Кванты: https://huggingface.co/models?other=base_model:quantized:janhq/Jan-v2-VL-max-FP8
Источник и Обсуждение на Reddit.
(Использовать в Jan)
#ModelAi #Jan #JanAi #Janv2VLmax #huggingface #GGUF #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ️ Модель: Hearthfire-24B

Hearthfire — это повествовательная модель для написания длинных текстов, созданная для того, чтобы в хаосе оставались тихие моменты. В то время как большинство моделей для ролевых игр нацелены на то, чтобы неустанно продвигать сюжет с помощью действий с высокими ставками и постоянного внешнего давления, Hearthfire настроена на то, чтобы ценить атмосферу, самоанализ и неспешное развитие сцены.

Он ставит эмоции выше скорости. Ему комфортно в тишине. Он не будет провоцировать атаку гоблинов только потому, что разговор зашёл в тупик.

Hearthfire — это новая тонкая настройка Mistral Small 3.2, представляющая собой хип-хоп в стиле лоу-фай с элементами ИИ-сторителлинга. Она создана для повседневных моментов, атмосферных сцен и повествований, в которых ставки скорее личные, чем апокалиптические. Она не будет торопить вас с переходом к следующему сюжетному моменту. Она с удовольствием задержится.

Если вы хотите опробовать эту модель, вы можете сделать это бесплатно на https://aidungeon.com

Модель: https://huggingface.co/LatitudeGames/Hearthfire-24B
Квант: https://huggingface.co/LatitudeGames/Hearthfire-24B-GGUF
Обсуждение на Reddit-1 & Reddit-2.

💡Подобных моделей ну очень много!!!
Вот в этом посте про модели:
😈 Impish_Bloodmoon_12B
👼 Angelic_Eclipse_12B
- для приключений, ролевых игр и написания текстов...

ℹ️ Cydonia и Magidonia 24B от Drummer's v4.3 — лучшая пара Cydonia для RP! (Пост)
Small 3.2: https://huggingface.co/TheDrummer/Cydonia-24B-v4.3
Magistral 1.2: https://huggingface.co/TheDrummer/Magidonia-24B-v4.3 - Большинство предпочитает Magidonia, но обе модели довольно хороши! (GGUF)
Еще они выпустили: Big-Tiger-Gemma-27B-v3

Еще: Rei-24B-KTO, StrawberryLemonade-L3-70B, L3.3-Shakudo-70b,

(Использовать в Jan, MSTY, LM Studio)
#ModelAi #AIDungeon #Dungeon #Hearthfire #Hearthfire24B #huggingface #GGUF #LocalAi #AiLocal #Magidonia #Cydonia #TheDrummer #Drummer #РолевыеИгры #RolePlaying
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Nanbeige4-3B-Thinking-2511

Её размер всего лишь 3 миллиарда параметров. Это почти в 100 раз меньше, чем GPT-4, и даже меньше, чем большинство открытых моделей.
Но вот парадокс: на тестах она достигает показателей выше, чем модели в 10 раз больше, а на бенчмарке WritingBench и вовсе держится на уровне проприетарных моделей занимая место между Gemini-2.5-Pro и Deepseek-R1-0528.
Результаты Nanbeige 3B лучше по всем бенчмаркам и она даже опережает модель в 32B параметров, которая в 10 раз больше.
Почему это оказалось возможно?
Кратко: Собрали данные → отфильтровал по 20 критериям (информационная плотность, логичность, грамотность) → сравнили с базой хороших примеров → оставили только самое лучшее.
Результат: 23 триллиона чистых проверенных токенов. Не 100, не 50, а 23. Но ценность каждого токена в датасете значительно выше.
Подробнее в статье: на ХАБР.

Плюсы:
- Работает локально (Использовать в Jan, MSTY, LM Studio, на iOS, на Android.)
- Быстрая производительность на инференсе (до 3 раз быстрее 8B моделей)
- Поддерживает tool calling (можно делать агентов)
- 64K контекст (можно работать с большими текстами)
- Open-source (можно дообучить под свои задачи)
- По тестам и в Q8, и в Q4 квантизации вполне хорошо придерживается русского языка, как в процессе размышлений, так и при ответе

Как итог: Есть reasoning-модель на 8Гб памяти (если использовать BF16, Q4 требует всего 2,5Гб).
Модель: https://huggingface.co/Nanbeige/Nanbeige4-3B-Thinking-2511
Кванты: На HF.
Подробно: arxiv.org
#ModelAi #Nanbeige #huggingface #GGUF #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Модель: GigaChat3-10B-A1.8B

Диалоговая модель семейства GigaChat. Модель основана на архитектуре Mixture-of-Experts (MoE) с 10B общих и 1.8B активных параметров.
Модель обучена на 20Т токенов. Добавили 10 языков — от китайского и арабского до узбекского и казахского, а также расширили набор источников: книги, академические данные, датасеты по коду и математике.

GigaChat 3 Lightning в GGUF: максимум скорости для локального запуска
Подготовили три официальные сборки модели. Теперь вы можете выбрать оптимальный баланс между скоростью и качеством под ваше железо:
🔘bf16 21.4 GB - Максимальное качество и стабильность.
🔘q8_0 11.4 GB - Золотая середина: отличное качество при меньшем потреблении памяти.
🔘q6_k 8.78 GB - Оптимально для ноутбуков и домашних ПК: высокая скорость и экономия памяти без заметного снижения качества генерации.
Модель: https://huggingface.co/ai-sage/GigaChat3-10B-A1.8B-GGUF
(Использовать в Jan, MSTY, LM Studio)
Источник: https://t.me/gigadev_channel/63
Статья на Хабр.
#ModelAi #GigaChat3 #huggingface #GGUF #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎞 Сервис для мгновенной генерации субтитров прямо в браузере ⚡️

Сервис Subtitles от Fframes Studio - работает без регистрации и платы, при этом качество распознавания речи — отличное. Без VPN!
Предназначен для транскрибирования и создания субтитров.

Полностью бесплатный локальный инструмент для транскрипции видео с использованием ИИ, работающий непосредственно на устройстве, с графическим интерфейсом для редактирования транскрибированных фрагментов, их оформления и рендеринга на видео.

🪙 Можно настроить шрифт субтитров, таймкоды, их положение и другие параметры прямо в браузере. Новый мастхэв для всех, кто работает с видео!
Есть выбор языка (Есть Русский, Узбекский, ...) и надо выбрать ИИ модель: Tiny = 152Mb, Base = 291Mb., Small = 586Mb. - больше размер модели - выше качество транскрибации, но дольше...
subtitles.fframes.studio
Проект: https://github.com/dmtrKovalenko/subtitler
#subtitles #fframesStudio #subtitler #Траснкрибация #WebAi #WebGPU #Whisper #субтитры #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Лучшие локальные LLM — 2025
На Reddit все оставляют отзывы о своих лучших моделях!

#ModelAi #huggingface #GGUF #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель ИИ из ПРОШЛОГО!
Исследователи из Цюриха обучили семейство моделей Ranke-4B на архитектуре Qwen3 — каждую на текстах, изданных до определённого года: 1913, 1929, 1933, 1939 и 1946.

- Ranke-4B-1913 ничего не знает про Первую мировую и «испанку», а женщин-работниц описывает как «менее способных, надёжных и подготовленных» по сравнению с мужчинами.
- Ranke-4B-1933 понятия не имеет, что будет после прихода Гитлера к власти.

Зачем нужны ИИ «из прошлого»?

Историки и социологи постоянно сталкиваются с эффектом ретроспективного знания: им известен исход событий, поэтому они переоценивают, насколько очевидным казалось будущее для современников. Плюс невольно переносят мораль XXI века в прошлое. С той же проблемой сталкиваются нейросети, обученные на современных данных.

Ranke-4B создаёт окно в культурную психологию прошлого. В отличие от развлекательных ботов, эти модели не притворяются Наполеоном — они действительно ограничены знаниями своей эпохи.
🔗 https://github.com/DGoettlich/history-llms

Похожие проекты:
TimeCapsuleLM — воспроизводит викторианский стиль и взгляды на основе текстов о Лондоне 1800–1875 годов
🔗 https://github.com/haykgrigo3/TimeCapsuleLLM

MonadGPT — анализирует представления средневековых людей по книгам до XVII века
🔗 https://huggingface.co/Pclanglais/MonadGPT

XunziALLM — генерирует тексты на древнекитайском с соблюдением поэтических правил эпохи
🔗 https://github.com/Xunzi-LLM-of-Chinese-classics/XunziALLM

#ModelAi #XunziALLM #MonadGPT #TimeCapsuleLLM #historyLLMs #Ranke4B #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1
Модель для синтеза научной литературы.

Обзор OpenScholar
Научный прогресс зависит от нашей способности находить, синтезировать и опираться на соответствующие знания из научной литературы. Однако экспоненциальный рост объема этой литературы — в настоящее время ежегодно публикуются миллионы статей — делает все более трудным для ученых поиск необходимой им информации или даже ознакомление с последними открытиями в одной области.

Чтобы помочь учёным эффективно ориентироваться в научной литературе и обобщать её, мы представляем OpenScholar — языковую модель с расширенными возможностями поиска (LM), которая отвечает на запросы пользователей, сначала находя соответствующие статьи в литературе, а затем генерируя ответы на основе этих источников

«Мы обучаем и выпускаем полностью открытую языковую модель с расширенным поиском, которая может синтезировать более 8 миллионов научных статей в открытом доступе, чтобы отвечать на научные вопросы».

OpenScholar работает с базой данных более 45 миллионов открытых научных статей. В отличие от GPT-4o, который часто генерирует ответы на основе предобученных данных, OpenScholar активно извлекает релевантные статьи, синтезирует их выводы и формирует ответ, опираясь на эти источники. Это делает его более надежным в плане фактической точности и правильности цитирования.

Система продемонстрировала выдающиеся результаты в тестах на новых бенчмарках, таких как ScholarQABench, и показала, что может обойти даже более крупные закрытые модели. Например, GPT-4o часто генерирует несуществующие ссылки, в то время как OpenScholar остается привязанным к проверяемым источникам.

В тестах OpenScholar продемонстрировала 5% улучшение по сравнению с GPT-4o и 7% по сравнению с PaperQA2 в правильности ответов. Более того, эксперты предпочитали ответы OpenScholar 51% и 70% случаев по сравнению с ответами, написанными людьми.

Эта модель не только улучшает качество научных обзоров, но и способствует более надежному научному дискурсу, предоставляя точные ссылки на оригинальные источники. OpenScholar открывает новые горизонты для исследователей, упрощая процесс синтеза информации и делая его более доступным.

Тут полная коллекция — включая веса модели, обучающие данные и поисковый индекс.
Страница проекта: https://github.com/AkariAsai/OpenScholar
💬 Чат https://openscilm.allen.ai
Ответом можно поделиться как ссылкой и без авторизации! (Это ответ на 1 слово: Полипренолы)
—————
👉 В МГУ представили новую ИИ-модель для поиска научных текстов!
Таблица лидеров: https://huggingface.co/spaces/mteb/leaderboard
Модель sci-rus-tiny3.5-zh: https://huggingface.co/mlsa-iai-msu-lab/sci-rus-tiny3.5-zh
#ModelAi #OpenScholar #OpenSciLM #LocalAi #AiLocal #AllenAi #TuluAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2
Media is too big
VIEW IN TELEGRAM
🛍 Анонсирован самый маленький ИИ-суперкомпьютер из Книги рекордов Гиннесса!
Устройство Tiiny AI Pocket Lab способно локально запускать большие языковые модели на 120 млрд параметров без подключения к интернету.
https://rozetked.me/news/43583-anonsirovan-samyy-malen-kiy-ii-superkomp-yuter-iz-knigi-rekordov-ginnessa
#AiPC #TiinyAIPocketLab #TiinyAI
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ QualityScaler — апскейлинг фото и видео на твоём ПК

Бесплатная программа с открытым кодом для Windows. Использует ИИ, чтобы повысить чёткость, разрешение и почистить изображения от артефактов.

Что умеет:
• Увеличивает разрешение — не растягивает пиксели, а генерирует недостающие детали
• Убирает шум, зернистость и следы JPEG-сжатия
• Работает полностью локально — файлы остаются на твоём ПК

Подходит и для фото, и для видео!
🔗 https://github.com/Djdefrag/QualityScaler

ИМХО, сейчас это самый удобный инструмент для апскейла.
Устанавливается за 5 мин, но если хочется максимально не заморачиваться или просто поддержать разрабов — можно приобрести в Стиме (он сам установит все необходимые зависимости типа VSCode, Python и т.д.)

#QualityScaler #апскейл #LocalAi #AiLocal #WebAi
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Ring-1T: модель с триллионом параметров и экстремальным мышлением!

Ant Group выпустила Ring-1T — модель MOE с 1 триллионом параметров, из которых 50B активных. Справляется с олимпиадными задачами уровня IMO 2025 Silver, почти не ошибается в математике и программировании. Хороша в здравоохранении!

Пишет код, творческие тексты, используется в здравоохранении, решает задачи уровня математических олимпиад (IMO 2025), сохраняет контекст до 128 000 токенов, что вдвое больше предыдущей версии Ling!

Ring-1T демонстрирует лидирующие результаты среди систем с открытым исходным кодом в сложных тестах на логическое мышление, таких как математические соревнования (AIME 25, HMMT 25), генерация кода (LiveCodeBench, CodeForce) и логическое мышление (ARC-AGI-1). Он также демонстрирует высокую конкурентоспособность в комплексных задачах (Arena-Hard-v2.0), здравоохранении (HealthBench) и творческом письме (Creative Writing v3).

Главная фишка — способность думать сотни итераций подряд. Для сравнения: топовые модели с расширенным мышлением начинают терять точность уже после 40 итераций.

По результатам бенчмарков обошла все известные чат-боты.
🔗 https://huggingface.co/inclusionAI/Ring-1T
Есть FP8 версия

Чат с ней:
Ling Chat https://ling.tbox.cn/chat
и ZenMux https://zenmux.ai/settings/chat?chatId=new_chat
Чат https://zenmux.ai/inclusionai/ring-1t
Инвайт: https://zenmux.ai/invite/G593GW (G593GW)

💡Кроме , еще есть модели на 16B (Ring-mini-2.0 - Q8_0=17.3 GB) и 100B параметров (Ring-flash-2.0 - Q6_K=84.5 GB).
#ModelAi #Ring1T #inclusionAI #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Обработка Видео Онлайн Быстро и Бесплатно!

Сжимайте видео, конвертируйте MP4, обрезайте и извлекайте аудио. Быстрая обработка прямо в браузере — без загрузки на сервер, 100% приватно.
https://vidocean.ru

Статья от автора.
#Vidocean
🔍 Модель: MiroThinker 1.5 — поисковый агент с открытым кодом!

MiroThinker v1.5 поддерживает контекстное окно размером 256К, долгосрочное прогнозирование и глубокий многоэтапный анализ.
Выполняет до 400 вызовов инструментов для каждой задачи — это существенное улучшение по сравнению с предыдущими исследовательскими агентами с открытым исходным кодом.
Основные моменты:
- Лидер по производительности: MiroThinker 1.5 (235 млрд) превосходит ChatGPT-Agent в BrowseComp и входит в число лучших в мире.

- Экстремальная эффективность: MiroThinker 1.5 (30 млрд) стоит всего 1/20 от стоимости Kimi-K2, обеспечивая более быстрый вывод данных и более высокое соотношение интеллекта и стоимости.

- Прогнозирование будущего: Собственные технологии «Интерактивное масштабирование» и «Обучение с учетом временных факторов» позволяют проводить перспективный анализ того, как макрособытия запускают цепные реакции на бирже Nasdaq.

- Полностью открытый исходный код: Модель и код полностью открыты, что позволяет бесплатно использовать интеллектуальные возможности, основанные на открытиях.

Протестировали на задаче «предскажи динамику акций Tesla». Модель не стала генерировать предположения из головы — сходила в веб, собрала свежие рейтинги от аналитических агентств, прочитала их по очереди и выдала отчёт со ссылками на источники. Всё проверяемо.

За счёт такого «медленного мышления» версия на 30B параметров обходит GPT-5-High, а модель на 235B параметров уже в первом эшелоне.

Веса открыты, есть бесплатная веб-версия для тестов. Если нужен инструмент для глубоких исследований — имеет смысл попробовать.

🔗 https://miromind.ai
и https://research.miromind.ai
Демо: https://dr.miromind.ai
Проект: https://github.com/MiroMindAI/MiroThinker
Модель: https://huggingface.co/collections/miromind-ai/mirothinker-v15
Обсуждение на Reddit. (Тут примеры)
#MiroThinker #MiroMindAi #MiroMind #LocalAi #AiLocal #ModelAi #AiModel #DeepResearch
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
🤖 Raycast - ИИ-Агент для вашего компа

Raycast - классная программа, которая может за вас делать действия на компьютере: запускать приложения, искать файлы/папки, делать ресерч, писать письма, переводить документы!

🪼 Раньше Raycast был только на macOS, теперь вышла и для Windows! Кто еще не пробовал, очень советуют 👍🏻

🪼 Еще Raycast поддерживает локальные модели, можно в пару кликов установить локальную модель и общаться с любой через интерфейс Raycast!

🪼101 сценарий использования Raycast👇🏻
Вот что за 101 сценарий:

1. Запуск приложений
2. Поиск файлов
3. Просмотр истории буфера обмена
4. Добавление записей в буфер обмена
5. Редактирование истории буфера обмена
6. Простая математика
7. Сложная математика
8. Конвертация единиц измерения
9. Вычисления с датами
10. История вычислений
11. Прогноз погоды
12. Поиск GIF
13. Поиск эмодзи
14. Умный поиск эмодзи
15. Установка таймера
16. Замена Spotlight
17. Блокировка экрана
18. Сохранение сниппетов текста
19. Эмодзи как ключевые слова
20. Динамические блоки кода из буфера
21. Поиск в интернете
22. ИИ-поиск в интернете
23. Быстрые заметки (Floating Notes)
24. Открыть последнюю загрузку
25. Скопировать последнюю загрузку
26. Поиск по тексту на скриншотах (OCR)
27. Управление окнами (58 способов)
28. Кастомные команды управления окнами
29. Макеты окон
30. Мониторинг системных ресурсов
31. Горячие клавиши для приложений
32. Алиасы для приложений
33. Переключение темы оформления
34. Очистка корзины
35. Установка приложений через Homebrew
36. Просмотр расписания
37. Присоединение к онлайн-встречам
38. Проверка камеры перед встречей
39. Сделать селфи
40. Быстрые ссылки на сайты
41. Быстрые ссылки на файлы и папки
42. Deep links приложений
43. Доступ к ссылкам через поиск
44. Переключение Bluetooth
45. Управление музыкой
46. Управление Spotify
47. Создание плейлистов с ИИ
48. Управление открытыми окнами
49. Управление запущенными процессами
50. Запись экрана
51. Скриншот
52. Запись аудио
53. Завершение приложений
54. Принудительное завершение приложений
55. Автоматическое завершение приложений
56. Полное удаление приложений (App Cleaner)
57. Помощь от ИИ моделей
58. Поиск по чатам ИИ
59. Прикрепление файлов к ИИ
60. Контекст веб-сайта для ИИ
61. Сохранение пресетов ИИ
62. Шеринг пресетов ИИ
63. Запуск команд ИИ отовсюду
64. Горячие клавиши для ИИ
65. Переключение раскладки клавиатуры
66. Смена разрешения экрана
67. Извлечение всех дисков
68. Извлечение одного диска
69. Конвертация изображений
70. Поворот изображений
71. Оптимизация изображений для веба
72. Изменение регистра текста
73. Измерение расстояний на экране
74. Поиск шрифтов
75. Пипетка цвета
76. Конвертация форматов цвета
77. Толковый словарь
78. Переводчик
79. Управление Apple Notes
80. Создание напоминаний
81. Установка статуса в Slack
82. Открыть файл в другом приложении
83. Отслеживание рейсов
84. Мировое время
85. Синхронизация настроек с облаком
86. Создание тем Raycast
87. Шеринг тем
88. Красивые скриншоты кода (Ray.so)
89. Создание иконок
90. Скачивание видео с YouTube
91. Фокус-сессии
92. Завершение рабочего дня (закрыть всё)
93. Системные настройки
94. Просмотр кодов 2FA
95. Тренировка печати
96. Перемещение окна Raycast
97. Сброс позиции окна
98. Создание организации
99. Общие сниппеты для команды
100. Общие быстрые ссылки для команды
101. Конфетти


🪼 Кстати, рекомендую ознакомиться с блогом ребят на YouTube, и особенно с YouTube видео - Начало работы с Raycast для Windows, просто открываете ссылку видео в Яндекс Браузере, и смотрите эту 11-минутную инструкцию с переводом 😉
Можно использовать бесплатно!
#AiLocal #LocalAi #Raycast #SoftAi #AiSoft #MacOS #Windows
Please open Telegram to view this post
VIEW IN TELEGRAM
1
ℹ️ Модель: Jamba2 обещает выдавать точные результаты при минимальном использовании памяти.

Jamba2 доступна в двух вариантах: 3B и Mini (MoE; 12B активных, 52B общих параметров). Длина контекстного окна: 256K Предназначена для корпоративных рабочих процессов, требующих точности и управляемости.
Ключевые преимущества:
- Превосходное соотношение надёжности и пропускной способности: Поддерживает высокую производительность при более чем 100 000 контекстов токенов
- Лучшие в категории результаты тестов: Превосходит результаты IFBench, IFEval, Collie и FACTS
- Статистически значимые преимущества в качестве: Превосходит сопоставимые модели в решении реальных корпоративных задач
- Окно контекста 256 К: Обрабатывает технические руководства, исследовательские работы и базы знаний
- Лицензия Apache 2.0: Полностью открытый исходный код для коммерческого использования
- Оптимизировано для производства: Небольшой объём памяти для масштабируемых развёртываний

54 % предприятий по-прежнему называют точность главным риском, связанным с искусственным интеллектом, который они пытаются снизить. При этом 30 % опрошенных организаций хотя бы раз сталкивались с негативными последствиями неточностей ИИ!
Jamba2 создана для получения обоснованных ответов на основе различных типов источников, включая технические руководства, исследовательские работы, корпоративные политики и внутренние базы знаний, чтобы команды могли использовать её в качестве надёжного компонента в производственных стеках.

Подробно: https://www.ai21.com/blog/introducing-jamba2/
Модель 52B https://huggingface.co/ai21labs/AI21-Jamba2-Mini
Модель 3B https://huggingface.co/ai21labs/AI21-Jamba2-3B
Обсуждение на Reddit.
#Jamba2 #ai21 #LocalAi #AiLocal #ModelAi #AiModel
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Модель: Falcon H1R 7B - Рассуждающая модель с окном 256К разработанная Институтом технологических инноваций (TII) в Абу-Даби. Модель демонстрирует выдающиеся результаты в различных тестах, включая математические задачи, программирование, выполнение инструкций и общую логику.

Несмотря на скромный размер в 7 миллиардов параметров, Falcon H1R 7B не уступает или даже превосходит самые современные модели логического вывода, которые в 2–7 раз больше!
Falcon H1R 7B основана на трёх ключевых принципах эффективности рассуждений: скорости, эффективности использования токенов и точности, которые в совокупности определяют «трёхмерные границы» производительности.

- Математика: Falcon H1R 7B лидирует (73,96 %) с большим отрывом, опережая ближайшего соперника (Apriel 1.5 15B с показателем 69,32 %) и все более крупные базовые модели, такие как Qwen3‑32B (63,66 %) и Nemotron H 47B (49,72 %).

- Код и агентская модель: Falcon H1R 7B набрал наибольшее количество баллов в этой группе (33,95 %), опередив Qwen3‑32B (33,40 %) и Apriel 1.5 (31,60 %).

- Общее: Falcon H1R 7B остается высококонкурентным (49,48 %), уступая лишь Apriel 1.5 (53,10 %) и Phi 4 Reasoning Plus 14B (51,18 %).

Все подробности: https://huggingface.co/blog/tiiuae/falcon-h1r-7b
Model: https://huggingface.co/tiiuae/Falcon-H1R-7B
GGUF: https://huggingface.co/tiiuae/Falcon-H1R-7B-GGUF
Обсуждение на Reddit и еще ТУТ.
#FalconH1R7B #LocalAi #AiLocal #ModelAi #AiModel
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1