Gemini CLI v0.40.0 добавил экспериментальную поддержку локальных моделей Gemma через LiteRT-LM сервер
Пока Gemma используется только для роутинга запросов между моделями, полноценный локальный инференс заявлен в следующих версиях.
Параллельно переработана система памяти: вместо save_memory агент редактирует Markdown-файлы на четырех уровнях (Project, Subdirectory, Private, Global). Экспериментальный Auto Memory в фоне анализирует сессии от 10 сообщений и сохраняет повторяющиеся паттерны как SKILL.md файлы. Обновление содержит более 150 изменений
https://github.com/google-gemini/gemini-cli/discussions/26216
Пока Gemma используется только для роутинга запросов между моделями, полноценный локальный инференс заявлен в следующих версиях.
Параллельно переработана система памяти: вместо save_memory агент редактирует Markdown-файлы на четырех уровнях (Project, Subdirectory, Private, Global). Экспериментальный Auto Memory в фоне анализирует сессии от 10 сообщений и сохраняет повторяющиеся паттерны как SKILL.md файлы. Обновление содержит более 150 изменений
https://github.com/google-gemini/gemini-cli/discussions/26216
🤔5
Meta выпустила официальный MCP-сервер для рекламного кабинета, который позволяет управлять кампаниями в Facebook и Instagram через ИИ-ассистента на естественном языке.
Вместо ручной работы в Ads Manager можно создавать кампании, настраивать аудитории, редактировать креативы и читать отчеты в реальном времени через Claude или ChatGPT. Это официальный продукт Meta, прошедший проверку через Marketing API
https://www.facebook.com/business/help/1456422242197840
https://developers.facebook.com/blog/post/2026/04/29/introducing-ads-cli
https://developers.facebook.com/documentation/ads-commerce/ads-ai-connectors/ads-cli/setup/get-started
Вместо ручной работы в Ads Manager можно создавать кампании, настраивать аудитории, редактировать креативы и читать отчеты в реальном времени через Claude или ChatGPT. Это официальный продукт Meta, прошедший проверку через Marketing API
https://www.facebook.com/business/help/1456422242197840
https://developers.facebook.com/blog/post/2026/04/29/introducing-ads-cli
https://developers.facebook.com/documentation/ads-commerce/ads-ai-connectors/ads-cli/setup/get-started
👍8🔥1🤔1
В сеть утекли скриншоты внутреннего приложения Apple для тестирования собственных языковых моделей. Приложение называется AFM Playground, и в нем уже доступна модель AFM Plus 150B Instruct с 150 миллиардами параметров. Сотрудники Apple используют его для оценки качества модели перед публичным релизом. Судя по всему, анонс ожидается на WWDC 2026
Источник
Источник
🔥2
AI Secrets
Google опубликовала Gemini Embedding 2 первую мультимодальную embedding-модель на базе архитектуры Gemini Модель принимает текст до 8192 токенов, до шести изображений, видео до 120 секунд, аудио и PDF до шести страниц и помещает всё это в единое векторное…
Gemini Embedding 2 перешла из публичного превью в статус General Availability. Модель доступна для продакшн-использования через Gemini API и Gemini Enterprise Agent Platform
Напомню, модель принимает текст до 8192 токенов, до 6 изображений, видео до 120 секунд, аудио и PDF до 6 страниц, помещая все в единое векторное пространство размерностью 3072
Напомню, модель принимает текст до 8192 токенов, до 6 изображений, видео до 120 секунд, аудио и PDF до 6 страниц, помещая все в единое векторное пространство размерностью 3072
❤4🔥1
Расширение для Chrome сканирует любой сайт и превращает его визуальный стиль в текстовый файл для ИИ агента
Называется design-md-chrome, открытый исходный код. Открываешь страницу с понравившимся дизайном, нажимаешь кнопку, расширение вытягивает цвета, шрифты, отступы, тени и радиусы скруглений. На выходе получаешь готовый файл, который подаешь в Claude Code или Codex, и агент строит интерфейсы в том же стиле
https://github.com/bergside/design-md-chrome
Называется design-md-chrome, открытый исходный код. Открываешь страницу с понравившимся дизайном, нажимаешь кнопку, расширение вытягивает цвета, шрифты, отступы, тени и радиусы скруглений. На выходе получаешь готовый файл, который подаешь в Claude Code или Codex, и агент строит интерфейсы в том же стиле
https://github.com/bergside/design-md-chrome
❤5👍3
This media is not supported in your browser
VIEW IN TELEGRAM
Hermes Agent от Nous Research теперь запускается нативно внутри LM Studio без дополнительной конфигурации
Агент автоматически обнаруживает все модели, уже загруженные в приложение, подгружает их по запросу с правильным размером контекстного окна и выбирает подходящий уровень рассуждения для каждой конкретной модели
https://hermes-agent.nousresearch.com/
Агент автоматически обнаруживает все модели, уже загруженные в приложение, подгружает их по запросу с правильным размером контекстного окна и выбирает подходящий уровень рассуждения для каждой конкретной модели
Nous Research специализируется на дообучении открытых моделей (Llama, Mistral) с упором на следование инструкциям и function calling, что делает их модели хорошей основой для агентных сценариев. LM Studio при этом выступает как локальная инфраструктура: встроенный OpenAI-совместимый сервер и GUI избавляют от ручной настройки окружения
Hermes Agent позиционируется как самообучающийся агент с встроенным циклом обучения: он создаёт навыки из опыта, улучшает их в процессе работы, ищет в своих прошлых разговорах и строит модель пользователя со временем. По сути это терминальный агент, аналог Claude Code, но под локальные модели
https://hermes-agent.nousresearch.com/
👍6
This media is not supported in your browser
VIEW IN TELEGRAM
Двое разработчиков адаптировали нейронаучную модель Meta TRIBE2 для анализа вирусного потенциала видео до его выхода
TRIBE2 изначально создавалась для предсказания активности мозга: модель обучена на фМРТ-сканах 720 человек, смотревших видео, слушавших подкасты и читавших тексты
Инструмент принимает видео на вход, строит график вовлеченности, выделяет зоны внимания, дает правки по монтажу и поддерживает сравнение нескольких версий для A/B-тестирования.
Запускается локально, исходный код обещали опубликовать сегодня, но пока не выложили, жду 👀
TRIBE2 изначально создавалась для предсказания активности мозга: модель обучена на фМРТ-сканах 720 человек, смотревших видео, слушавших подкасты и читавших тексты
Инструмент принимает видео на вход, строит график вовлеченности, выделяет зоны внимания, дает правки по монтажу и поддерживает сравнение нескольких версий для A/B-тестирования.
Под капотом: tri-modal encoding через V-JEPA 2 для видео, wav2vec 2.0 для аудио и Llama 3.2 для текста, результат маппится на воксели фМРТ.
Запускается локально, исходный код обещали опубликовать сегодня, но пока не выложили, жду 👀
2🔥10👍1
AI Secrets
Двое разработчиков адаптировали нейронаучную модель Meta TRIBE2 для анализа вирусного потенциала видео до его выхода TRIBE2 изначально создавалась для предсказания активности мозга: модель обучена на фМРТ-сканах 720 человек, смотревших видео, слушавших подкасты…
Выложили код: https://github.com/amirmushichge/tribeV2_ViralAnalyser
This media is not supported in your browser
VIEW IN TELEGRAM
ElevenLabs запустил платформу для голосовых ИИ агентов, которые ведут звонки вместо живых операторов
Агент говорит, слушает и одновременно совершает действия: бронирует встречи, обновляет заказы, закрывает тикеты в CRM. Поддерживается 70 языков, подключается к GPT, Claude, Gemini и другим моделям.
Стоимость от $0.08 за минуту разговора.
Агент говорит, слушает и одновременно совершает действия: бронирует встречи, обновляет заказы, закрывает тикеты в CRM. Поддерживается 70 языков, подключается к GPT, Claude, Gemini и другим моделям.
Стоимость от $0.08 за минуту разговора.
🙏6❤1
AI Secrets
Двое разработчиков адаптировали нейронаучную модель Meta TRIBE2 для анализа вирусного потенциала видео до его выхода TRIBE2 изначально создавалась для предсказания активности мозга: модель обучена на фМРТ-сканах 720 человек, смотревших видео, слушавших подкасты…
Авторы tribeV2_ViralAnalyser провели первые тесты на видео с реальными данными. Ролик из TikTok с 2.4 млн просмотров показал высокий predicted brain response в первые секунды, с активацией визуальной и речевой зон
YouTube Shorts с собакой на батуте дал похожий результат от модели, а реальная статистика из YouTube Studio подтвердила: удержание 81.5%, средний процент просмотра 130% оба показателя сигнализируют алгоритму о качестве контента
Авторы формулируют осторожно: гипотеза “выше мозговая реакция, лучше удержание” пока выглядит правдоподобно на двух примерах. Это MVP, выборка минимальна, но направление рабочее
Репозиторий: github.com/amirmushichge/tribeV2_ViralAnalyser.
YouTube Shorts с собакой на батуте дал похожий результат от модели, а реальная статистика из YouTube Studio подтвердила: удержание 81.5%, средний процент просмотра 130% оба показателя сигнализируют алгоритму о качестве контента
Авторы формулируют осторожно: гипотеза “выше мозговая реакция, лучше удержание” пока выглядит правдоподобно на двух примерах. Это MVP, выборка минимальна, но направление рабочее
Репозиторий: github.com/amirmushichge/tribeV2_ViralAnalyser.
👍6🔥1
Rapid-MLX запускает локальные LLM на Apple Silicon в 2-4 раза быстрее Ollama и при этом поддерживает вызов инструментов на уровне 100%
Это OpenAI-совместимый сервер: одна переменная окружения, и Claude Code, Cursor или Aider начинают работать через локальную модель. Кешированное время до первого токена составляет 0.08 секунды за счет KV-кеша и снапшотов состояния для гибридных архитектур
https://github.com/raullenchai/Rapid-MLX
Это OpenAI-совместимый сервер: одна переменная окружения, и Claude Code, Cursor или Aider начинают работать через локальную модель. Кешированное время до первого токена составляет 0.08 секунды за счет KV-кеша и снапшотов состояния для гибридных архитектур
На Mac Studio M3 Ultra бенчмарки показывают 57 tok/s для Qwen3.5-122B против 43 у vllm-mlx, и 108 tok/s для Qwen3.5-9B против 46 у Ollama
https://github.com/raullenchai/Rapid-MLX
🔥6
Caveman это скил для Claude Code, который переключает модель в “пещерный” режим общения, убирая весь словесный мусор из ответов
Скил основан на наблюдении, что “пещерная речь” резко сокращает расход токенов (без потери качество по коду) на примерно 75%
https://github.com/JuliusBrussee/caveman
Скил основан на наблюдении, что “пещерная речь” резко сокращает расход токенов (без потери качество по коду) на примерно 75%
Технические термины без изменений. Сообщения об ошибках точное цитирование. Git-коммиты и PR нормальный язык
https://github.com/JuliusBrussee/caveman
🔥7
TinyFish перевел два своих базовых инструмента, Search и Fetch, в свободный доступ без оплаты для всех разработчиков и агентов
Search предназначен для веб-поиска с выдачей структурированного JSON, Fetch рендерит страницу в реальном браузере с поддержкой JavaScript и возвращает чистый Markdown или HTML без навигации, скриптов и баннеров
Оба инструмента работают через одну точку подключения и один API-ключ. Доступны через REST API, MCP-сервер, Python и TypeScript SDK, CLI.
Бесплатный уровень 5 поисковых запросов в минуту и 25 URL в минуту для Fetch. Неудачные запросы к Fetch в квоту не засчитываются
https://www.tinyfish.ai/blog/search-and-fetch-are-now-free-for-every-agent-everywhere
Search предназначен для веб-поиска с выдачей структурированного JSON, Fetch рендерит страницу в реальном браузере с поддержкой JavaScript и возвращает чистый Markdown или HTML без навигации, скриптов и баннеров
Оба инструмента работают через одну точку подключения и один API-ключ. Доступны через REST API, MCP-сервер, Python и TypeScript SDK, CLI.
Бесплатный уровень 5 поисковых запросов в минуту и 25 URL в минуту для Fetch. Неудачные запросы к Fetch в квоту не засчитываются
https://www.tinyfish.ai/blog/search-and-fetch-are-now-free-for-every-agent-everywhere
🔥1
Ollama анонсировала интеграцию своего облачного сервиса (Ollama Cloud) с Claude Desktop. Это означает, что теперь приложение Claude Desktop можно переключить с нативных моделей Anthropic на любую модель из каталога Ollama Cloud одной командой
Модели доступны как в Claude Cowork, так и в Claude Code внутри того же приложения. Веб-поиск и расширения пока не поддерживаются
А ведь тут 20$ и без лимитов 👀
https://docs.ollama.com/integrations/claude-desktop
Модели доступны как в Claude Cowork, так и в Claude Code внутри того же приложения. Веб-поиск и расширения пока не поддерживаются
А ведь тут 20$ и без лимитов 👀
Модели kimi-k2.6, kimi-k2-thinking, gpt-oss:120b, devstral-2:123b, qwen3.5:397b, nemotron-3-super, qwen3-vl:235b и другие
https://docs.ollama.com/integrations/claude-desktop
🔥4👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic выпустила пять открытых агентных плагинов для финансового сектора
Каждый шаблон закрывает конкретную функцию:
Шаблоны устанавливаются как плагины в Cowork или Claude
https://github.com/anthropics/financial-services-plugins
https://claude.com/blog/cowork-plugins-finance
Каждый шаблон закрывает конкретную функцию:
1. Financial Analysis базовые задачи для всех финаналитиков: рыночное и конкурентное исследование, финансовое моделирование, создание и проверка шаблонов PowerPoint
2. Investment Banking работа со сделками: анализ транзакционных документов, построение таблиц сопоставимых компаний (comps), подготовка питч-материалов
3. Equity Research разбор транскриптов отчетности, обновление финансовых моделей по новым прогнозам, написание ресерч-нот
4. Private Equity поиск сделок и due diligence: анализ больших пакетов документов, извлечение стандартизированных финансовых данных, сценарное моделирование, скоринг по инвестиционным критериям
5. Wealth Management анализ портфелей, выявление дрейфа и налоговой нагрузки
Шаблоны устанавливаются как плагины в Cowork или Claude
https://github.com/anthropics/financial-services-plugins
https://claude.com/blog/cowork-plugins-finance
👍7
This media is not supported in your browser
VIEW IN TELEGRAM
Gemma 4 стала до трёх раз быстрее при том же качестве ответов.
Google выпустила MTP-черновики (Multi-Token Prediction drafters) для семейства Gemma 4
Технически это speculative decoding: небольшая модель-черновик предсказывает несколько токенов вперёд, используя активации и KV-кеш основной модели. Основная модель затем верифицирует весь набор за один прямой проход и добавляет ещё один токен. Итог: приложение получает полную последовательность там, где раньше успевал генерироваться один токен
Несколько конкретных цифр из тестов Google: на NVIDIA RTX PRO 6000 модель 26B с MTP работает примерно вдвое быстрее стандартного инференса. На Apple Silicon при батче 4–8 ускорение составляет до 2.2x. Схожая картина на NVIDIA A100
Веса доступны на Hugging Face и Kaggle, лицензия Apache 2.0. Поддержка реализована в MLX, vLLM, SGLang, Ollama и Hugging Face Transformers, а также в Google AI Edge Gallery для Android и iOS
Почитать
Google выпустила MTP-черновики (Multi-Token Prediction drafters) для семейства Gemma 4
Технически это speculative decoding: небольшая модель-черновик предсказывает несколько токенов вперёд, используя активации и KV-кеш основной модели. Основная модель затем верифицирует весь набор за один прямой проход и добавляет ещё один токен. Итог: приложение получает полную последовательность там, где раньше успевал генерироваться один токен
Несколько конкретных цифр из тестов Google: на NVIDIA RTX PRO 6000 модель 26B с MTP работает примерно вдвое быстрее стандартного инференса. На Apple Silicon при батче 4–8 ускорение составляет до 2.2x. Схожая картина на NVIDIA A100
Веса доступны на Hugging Face и Kaggle, лицензия Apache 2.0. Поддержка реализована в MLX, vLLM, SGLang, Ollama и Hugging Face Transformers, а также в Google AI Edge Gallery для Android и iOS
Почитать
🔥6🙏1
Media is too big
VIEW IN TELEGRAM
Компания Subquadratic выпустила языковую модель SubQ с контекстным окном в 12 миллионов токенов, при этом стоимость обработки в пять раз ниже, чем у ведущих моделей.
В основе лежит архитектура разреженного внимания: вместо сравнения каждого токена с каждым другим модель выбирает только значимые связи. По заявлению разработчиков, на контексте в 12 млн токенов это снижает вычисления механизма внимания почти в тысячу раз.
Ранний доступ открыт, модель доступна через API
https://subq.ai/
В основе лежит архитектура разреженного внимания: вместо сравнения каждого токена с каждым другим модель выбирает только значимые связи. По заявлению разработчиков, на контексте в 12 млн токенов это снижает вычисления механизма внимания почти в тысячу раз.
Ранний доступ открыт, модель доступна через API
https://subq.ai/
🔥6❤1
Media is too big
VIEW IN TELEGRAM
Автоматизация создания и публикации контента с помощью Higgsfield CLI
Higgsfield представила интерфейс командной строки (CLI) для автоматизации работы с контентом. Инструмент позволяет генерировать серии фотографий и видеороликов на основе одного загруженного изображения и текстового описания. Система самостоятельно распределяет готовые файлы по папкам, создает подписи и планирует публикации в социальных сетях.
Для начала работы требуется установка пакета через терминал и авторизация в сервисе.
Higgsfield представила интерфейс командной строки (CLI) для автоматизации работы с контентом. Инструмент позволяет генерировать серии фотографий и видеороликов на основе одного загруженного изображения и текстового описания. Система самостоятельно распределяет готовые файлы по папкам, создает подписи и планирует публикации в социальных сетях.
Для начала работы требуется установка пакета через терминал и авторизация в сервисе.
1🔥6