very vibe coding
121 subscribers
463 photos
126 videos
13 files
991 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Forwarded from Machinelearning
🌟 Google выпустила Deep Research и Deep Research Max

Компания представила 2 новых автономных агента в Gemini API - Deep Research и Deep Research Max. Оба построены на Gemini 3.1 Pro и доступны через Interactions API.

Главное изменение по сравнению с декабрьским превью - поддержка MCP: теперь агент умеет выходить за пределы открытого веба и работать с закрытыми корпоративными источниками данных.

🟢Deep Research оптимизирован под скорость и низкую стоимость. Он заменяет декабрьскую preview-версию и предназначен для интерактивных сценариев, где ответ нужен быстро.

🟠Deep Research Max использует расширенный test-time compute, итеративно рассуждает, ищет и уточняет финальный отчёт.

Типичный сценарий: асинхронные фоновые процессы, например ночной cron-job, готовящий аналитикам к утру набор подробных аналитических отчётов.


По внутренним замерам Google, Max консультируется с заметно большим числом источников и точнее взвешивает противоречивые свидетельства, чем декабрьская версия. Все отчёты полностью сопровождаются ссылками (от документов SEC до открытых рецензируемых журналов).

Инструменты агента можно включать одновременно: Google Search, URL Context, Code Execution, File Search и произвольные удалённые MCP-серверы. Веб при желании отключается (тогда поиск идёт только по пользовательским данным). В качестве опорных данных принимаются PDF, CSV, изображения, аудио и видео.

Отдельное новшество - нативная генерация графиков и инфографики прямо в теле отчёта через HTML или Nano Banana, без внешних библиотек.

Для интерактивных интерфейсов предусмотрен стриминг промежуточных рассуждений и результатов в реальном времени.

Появился и режим совместного планирования: план исследования можно просмотреть и скорректировать до того, как агент начнёт его выполнять.

Deep Research и Deep Research Max доступны в режиме public preview на платных тарифах Gemini API.

В ближайшее время оба агента появятся в Google Cloud для корпоративных клиентов.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
С генерацией картинок у OpenAI случился прорыв. Google с Nano Banana нервно курит в сторонке

https://t.me/machinelearning_interview/2712
Антропик не прекращает зверствовать. Claude code теперь доступен только на МАХ тарифе от 100 баксов. Ну что ж, используйте Codex - то же самое, только в профиль. Да и лимитов больше
Forwarded from дядя_д
На заметку:

В предыдущих версиях генераторов изображений это было не так, но выбранный вами LLM оказывает огромное влияние на результат работы GPT-imagegen-2. GPT-5.4 Thinking и GPT-5.4 Pro будут создавать гораздо лучшие изображения, особенно для сложных объектов.

Конечно, это не интуитивно понятно и нигде не объясняется.


дядь_д
Тестам я не верю, но судя по всему, сейчас в размере около 30В нужно смотреть на Qwen 3.6 и Gemma 4. Новую dense модель можно развернуть на двух моих мак мини - попробую на выходных.

https://x.com/alibaba_qwen/status/2046939764428009914?s=46
Перешел с Opus 4.7 обратно на Opus 4.6 - понаблюдаю, будут ли токены тратиться с так же быстро. Жду сегодня GPT - 5.5. Честно говоря, у OpenAI и 20 баксов подписки тратятся достаточно экономно - все чаще использую именно их модель
Если вы хотите скормить нейронке много документов, то не стоит ей пихать word и pdf - лучше перевести их в любимый текстовый формат нейронок md.

Именно поэтому слежу за подобными обновлениями
🚀 50+ команд Claude Code, которые реально ускоряют разработку

Если ты используешь Claude Code как обычный чат - ты теряешь 80% его мощности.

Это не просто AI. Это полноценная система разработки внутри терминала.

Вот как его правильно использовать:


База, без которой никуда:

- /init - создаёт CLAUDE.md и память проекта
- /memory - открывает контекст проекта
- /add-dir - подключает новые директории
- /compact - чистит контекст и экономит токены

Работа с кодом:

- /diff - показывает изменения
- /review - ревью кода
- /simplify - 3 агента анализируют код
- /debug - системный дебаг

Контроль процесса:

- /plan - сначала думает, потом пишет код
- /permissions - контроль действий
- --dangerously-skip-permissions - полный автопилот

Продвинутые фичи:

- /agents - параллельные агенты
- /loop - повтор задач
- /bash - выполнение команд
- /remote-control - управление через браузер

Модели и режимы:

- /model - переключение моделей
- /effort - глубина мышления
- /fast - быстрый режим

Что важно знать:

- Claude Code = не чат, а инженер внутри проекта
- память (CLAUDE.md) решает больше, чем промпты
- агенты дают x2-x5 ускорение на сложных задачах
А я сегодня впервые попробовал Claude design для доработки презентации. Потенциал есть, не лажа, как раньше, но все-равно надо много возиться - формировать стиль, писать промпты. На все нужно время…

https://t.me/tips_ai/4667
Forwarded from Machinelearning
🚀 OpenAI представила GPT-5.5 -

Она заметно сильнее в самом главном: код, ресёрч, аналитика и работа с документами. И почти во всём обходит конкурентов - например, на Terminal-Bench выбивает 82,7% против 69% у свежей Claude.
GPT-5.5 уже доступна пользователям Plus, Pro, Business и Enterprise - в ChatGPT и Codex.

Тестим! 🔥

https://openai.com/index/introducing-gpt-5-5/
О, ну наконец. И DeepSeek V4 тоже вышел )) большой и маленький - на 1.6Т и 284В параметров..

Ну что можно сказать.. Программировать будем, как и раньше, с Клодом да Джипити (больше с последним), а для остального появилась умная и недорогая модель.

Это для тех, кому нужен API..
🔥1
Не дипсиком единым.. У Xiaomi тоже вышла интересная опенсорсная модель MiMo V2.5 Pro уровня DeepSeek V4. Если не ошибаюсь, они как раз переманили крутых ребят из самого дипсика..
⚡️ Вместо того чтобы сегодня вечером смотреть сериалы, потрать день на прокачку Claude.

Claude 101:
http://claude101.com

→ Уровень 1 - 24 минуты: база

Claude для новичков:
https://ruben.substack.com/p/claude-for-dummies

Настройка Claude:
http://how-to-claude.ai

→ Уровень 2 - 1 час: реальные workflows

Claude Cowork:
http://claude-co.work

Claude для команд:
http://how-claude.team

Claude Design:
http://claudedesign.free

Cowork + Projects:
https://ruben.substack.com/p/claude-cowork-project

Claude для слайдов:
http://how-to-gamma.ai

Claude Skills:
http://claude-skills.free

→ Уровень 3 - 3,5 часа: pro-приемы

Как избегать подхалимства модели:
https://ruben.substack.com/p/i-love-to-be-right

Claude Code:
http://claudecode.free

Claude 101:
https://anthropic.skilljar.com/claude-101

Как не упираться в лимиты Claude:
https://ruben.substack.com/p/how-to-stop-hitting-claude-usage

Хватит просто промптить:
https://ruben.substack.com/p/stop-prompting-claude

→ Уровень 4 - 8 часов: экспертный режим

Claude Computer:
https://ruben.substack.com/p/claude-computer

Разработка с Claude API:
https://anthropic.skilljar.com/claude-with-the-anthropic-api
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
В начале года кассу сорвал OpenClaw, теперь вирусится другой агент - Hermes. Фишка в том, что в него встроен цикл самоулучшения. Народ хвалит при локальном использовании с Qwen 3.6 27B

https://github.com/NousResearch/hermes-agent