Forwarded from эйай ньюз
Moonshot обновили Kimi до версии 2.6
Модель теперь куда сильнее в длинных кодинг задачах, а на бенчах обгоняет Composer 2 от Cursor (который основан на K2.5). Кроме этого компания продолжает инвестировать в рои агентов — K2.6 тренировали использовать вплоть до 300 субагентов параллельно, другие команды не фокусируются на этом настолько сильно (а зря). Ну и говорят что модель теперь лучше работает с OpenClaw и прочими подобными агентами.
Веса
Блогпост
@ai_newz
Модель теперь куда сильнее в длинных кодинг задачах, а на бенчах обгоняет Composer 2 от Cursor (который основан на K2.5). Кроме этого компания продолжает инвестировать в рои агентов — K2.6 тренировали использовать вплоть до 300 субагентов параллельно, другие команды не фокусируются на этом настолько сильно (а зря). Ну и говорят что модель теперь лучше работает с OpenClaw и прочими подобными агентами.
Веса
Блогпост
@ai_newz
Forwarded from Machinelearning
Компания представила 2 новых автономных агента в Gemini API - Deep Research и Deep Research Max. Оба построены на Gemini 3.1 Pro и доступны через Interactions API.
Главное изменение по сравнению с декабрьским превью - поддержка MCP: теперь агент умеет выходить за пределы открытого веба и работать с закрытыми корпоративными источниками данных.
Типичный сценарий: асинхронные фоновые процессы, например ночной cron-job, готовящий аналитикам к утру набор подробных аналитических отчётов.
По внутренним замерам Google, Max консультируется с заметно большим числом источников и точнее взвешивает противоречивые свидетельства, чем декабрьская версия. Все отчёты полностью сопровождаются ссылками (от документов SEC до открытых рецензируемых журналов).
Инструменты агента можно включать одновременно: Google Search, URL Context, Code Execution, File Search и произвольные удалённые MCP-серверы. Веб при желании отключается (тогда поиск идёт только по пользовательским данным). В качестве опорных данных принимаются PDF, CSV, изображения, аудио и видео.
Отдельное новшество - нативная генерация графиков и инфографики прямо в теле отчёта через HTML или Nano Banana, без внешних библиотек.
Для интерактивных интерфейсов предусмотрен стриминг промежуточных рассуждений и результатов в реальном времени.
Появился и режим совместного планирования: план исследования можно просмотреть и скорректировать до того, как агент начнёт его выполнять.
Deep Research и Deep Research Max доступны в режиме public preview на платных тарифах Gemini API.
В ближайшее время оба агента появятся в Google Cloud для корпоративных клиентов.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
С генерацией картинок у OpenAI случился прорыв. Google с Nano Banana нервно курит в сторонке
https://t.me/machinelearning_interview/2712
https://t.me/machinelearning_interview/2712
Telegram
Machine learning Interview
Сделано с помощью GPT Image 2)
Антропик не прекращает зверствовать. Claude code теперь доступен только на МАХ тарифе от 100 баксов. Ну что ж, используйте Codex - то же самое, только в профиль. Да и лимитов больше
Forwarded from дядя_д
На заметку:
В предыдущих версиях генераторов изображений это было не так, но выбранный вами LLM оказывает огромное влияние на результат работы GPT-imagegen-2. GPT-5.4 Thinking и GPT-5.4 Pro будут создавать гораздо лучшие изображения, особенно для сложных объектов.
Конечно, это не интуитивно понятно и нигде не объясняется.
дядь_д
В предыдущих версиях генераторов изображений это было не так, но выбранный вами LLM оказывает огромное влияние на результат работы GPT-imagegen-2. GPT-5.4 Thinking и GPT-5.4 Pro будут создавать гораздо лучшие изображения, особенно для сложных объектов.
Конечно, это не интуитивно понятно и нигде не объясняется.
дядь_д
Тестам я не верю, но судя по всему, сейчас в размере около 30В нужно смотреть на Qwen 3.6 и Gemma 4. Новую dense модель можно развернуть на двух моих мак мини - попробую на выходных.
https://x.com/alibaba_qwen/status/2046939764428009914?s=46
https://x.com/alibaba_qwen/status/2046939764428009914?s=46
X (formerly Twitter)
Qwen (@Alibaba_Qwen) on X
🚀 Meet Qwen3.6-27B, our latest dense, open-source model, packing flagship-level coding power!
Yes, 27B, and Qwen3.6-27B punches way above its weight. 👇
What's new:
🧠 Outstanding agentic codin…
Yes, 27B, and Qwen3.6-27B punches way above its weight. 👇
What's new:
🧠 Outstanding agentic codin…
Перешел с Opus 4.7 обратно на Opus 4.6 - понаблюдаю, будут ли токены тратиться с так же быстро. Жду сегодня GPT - 5.5. Честно говоря, у OpenAI и 20 баксов подписки тратятся достаточно экономно - все чаще использую именно их модель
Если вы хотите скормить нейронке много документов, то не стоит ей пихать word и pdf - лучше перевести их в любимый текстовый формат нейронок md.
Именно поэтому слежу за подобными обновлениями
Именно поэтому слежу за подобными обновлениями
X (formerly Twitter)
PaddlePaddle (@PaddlePaddle) on X
🚀 PaddleOCR 3.5 is here!
Introducing PaddleOCR 3.5 — now with browser-based OCR, document-to-Markdown conversion, and Transformers backend integration.
📊 Key Highlights:
🔸 PaddleOCR.js for direct browser deployment
🔸One-click conversion: Word/Excel/PPT…
Introducing PaddleOCR 3.5 — now with browser-based OCR, document-to-Markdown conversion, and Transformers backend integration.
📊 Key Highlights:
🔸 PaddleOCR.js for direct browser deployment
🔸One-click conversion: Word/Excel/PPT…
Forwarded from Machine learning Interview
🚀 50+ команд Claude Code, которые реально ускоряют разработку
Если ты используешь Claude Code как обычный чат - ты теряешь 80% его мощности.
Это не просто AI. Это полноценная система разработки внутри терминала.
Вот как его правильно использовать:
База, без которой никуда:
-
-
-
-
Работа с кодом:
-
-
-
-
Контроль процесса:
-
-
-
Продвинутые фичи:
-
-
-
-
Модели и режимы:
-
-
-
Что важно знать:
- Claude Code = не чат, а инженер внутри проекта
- память (CLAUDE.md) решает больше, чем промпты
- агенты дают x2-x5 ускорение на сложных задачах
Если ты используешь Claude Code как обычный чат - ты теряешь 80% его мощности.
Это не просто AI. Это полноценная система разработки внутри терминала.
Вот как его правильно использовать:
База, без которой никуда:
-
/init - создаёт CLAUDE.md и память проекта -
/memory - открывает контекст проекта -
/add-dir - подключает новые директории -
/compact - чистит контекст и экономит токены Работа с кодом:
-
/diff - показывает изменения -
/review - ревью кода -
/simplify - 3 агента анализируют код -
/debug - системный дебаг Контроль процесса:
-
/plan - сначала думает, потом пишет код -
/permissions - контроль действий -
--dangerously-skip-permissions - полный автопилот Продвинутые фичи:
-
/agents - параллельные агенты -
/loop - повтор задач -
/bash - выполнение команд -
/remote-control - управление через браузер Модели и режимы:
-
/model - переключение моделей -
/effort - глубина мышления -
/fast - быстрый режим Что важно знать:
- Claude Code = не чат, а инженер внутри проекта
- память (CLAUDE.md) решает больше, чем промпты
- агенты дают x2-x5 ускорение на сложных задачах
А я сегодня впервые попробовал Claude design для доработки презентации. Потенциал есть, не лажа, как раньше, но все-равно надо много возиться - формировать стиль, писать промпты. На все нужно время…
https://t.me/tips_ai/4667
https://t.me/tips_ai/4667
Telegram
Tips AI | IT & AI
Google вчера выложил на GitHub свою спецификацию DESIGN.md
Формат придумали как раз таки они, но каждый делал свою интерпретацию в IDE, агентских тулах, + создавались коллекции готовых дизайн-систем.
Теперь доступна их версия, чтобы все работали по единым…
Формат придумали как раз таки они, но каждый делал свою интерпретацию в IDE, агентских тулах, + создавались коллекции готовых дизайн-систем.
Теперь доступна их версия, чтобы все работали по единым…
Forwarded from Machinelearning
🚀 OpenAI представила GPT-5.5 -
Она заметно сильнее в самом главном: код, ресёрч, аналитика и работа с документами. И почти во всём обходит конкурентов - например, на Terminal-Bench выбивает 82,7% против 69% у свежей Claude.
GPT-5.5 уже доступна пользователям Plus, Pro, Business и Enterprise - в ChatGPT и Codex.
Тестим! 🔥
https://openai.com/index/introducing-gpt-5-5/
Она заметно сильнее в самом главном: код, ресёрч, аналитика и работа с документами. И почти во всём обходит конкурентов - например, на Terminal-Bench выбивает 82,7% против 69% у свежей Claude.
GPT-5.5 уже доступна пользователям Plus, Pro, Business и Enterprise - в ChatGPT и Codex.
Тестим! 🔥
https://openai.com/index/introducing-gpt-5-5/
О, ну наконец. И DeepSeek V4 тоже вышел )) большой и маленький - на 1.6Т и 284В параметров..
Ну что можно сказать.. Программировать будем, как и раньше, с Клодом да Джипити (больше с последним), а для остального появилась умная и недорогая модель.
Это для тех, кому нужен API..
Ну что можно сказать.. Программировать будем, как и раньше, с Клодом да Джипити (больше с последним), а для остального появилась умная и недорогая модель.
Это для тех, кому нужен API..
🔥1
Не дипсиком единым.. У Xiaomi тоже вышла интересная опенсорсная модель MiMo V2.5 Pro уровня DeepSeek V4. Если не ошибаюсь, они как раз переманили крутых ребят из самого дипсика..
X (formerly Twitter)
Artificial Analysis (@ArtificialAnlys) on X
Xiaomi’s MiMo V2.5 Pro has landed at 54 in the Artificial Analysis Intelligence Index, tied with Moonshot’s Kimi K2.6 - the current top open weights model. MiMo V2.5 Pro’s weights are expected to be released soon, which would make MiMo V2.5 Pro the first…
Forwarded from Machine learning Interview
Claude 101:
http://claude101.com
→ Уровень 1 - 24 минуты: база
Claude для новичков:
https://ruben.substack.com/p/claude-for-dummies
Настройка Claude:
http://how-to-claude.ai
→ Уровень 2 - 1 час: реальные workflows
Claude Cowork:
http://claude-co.work
Claude для команд:
http://how-claude.team
Claude Design:
http://claudedesign.free
Cowork + Projects:
https://ruben.substack.com/p/claude-cowork-project
Claude для слайдов:
http://how-to-gamma.ai
Claude Skills:
http://claude-skills.free
→ Уровень 3 - 3,5 часа: pro-приемы
Как избегать подхалимства модели:
https://ruben.substack.com/p/i-love-to-be-right
Claude Code:
http://claudecode.free
Claude 101:
https://anthropic.skilljar.com/claude-101
Как не упираться в лимиты Claude:
https://ruben.substack.com/p/how-to-stop-hitting-claude-usage
Хватит просто промптить:
https://ruben.substack.com/p/stop-prompting-claude
→ Уровень 4 - 8 часов: экспертный режим
Claude Computer:
https://ruben.substack.com/p/claude-computer
Разработка с Claude API:
https://anthropic.skilljar.com/claude-with-the-anthropic-api
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
Qwen Image 2 вышел. Если это кого-то интересует, после выхода рисовалки в GPT
https://t.me/data_analysis_ml/5045
https://t.me/data_analysis_ml/5045
Telegram
Анализ данных (Data analysis)
🎨 Qwen выпустили Qwen-Image-2.0-Pro - новую версию генератора изображений с заметным упором на качество, стабильность стилей, мультиязычный текст на картинках и точное следование инструкциям.
Заявлено, что модель стала лучше понимать промпты, аккуратнее…
Заявлено, что модель стала лучше понимать промпты, аккуратнее…