Claude вчера выкатил в публичный релиз Computer Use - функционал в Claude Code / Claude Desktop для полноценного управления компьютером. Правда, пока только на Mac и доступен подписчикам Pro и Max (ранее это уже было доступно через api, а также через сторонние плагины и скиллы - но теперь доступно нативно и официально).
С включенным Computer Use можно просить запускать любые приложения и автоматизировать практически любые действия с ними - от работы с документами и таблицами до серфинга в браузере (например, чтобы агент автоматически заказывал вам регулярные товары на Ozon/WB или искал авиабилеты). Если вы занимаетесь монтажом видео / блогингом - попросить обрезать или перемонтировать видео и залить его на YouTube / в Instagram.
А в сочетании с функцией Dispatch можно накидывать задачи и следить за прогрессом прямо с телефона удаленно.
Может возникнуть вопрос - является ли это заменой OpenClaw и подобным opensource агентам? Я думаю, что нет, потому что ту степень свободы и интеграций, которую можно настроить в OpenClaw, вы вряд ли позволите себе на основной машине с личными / рабочими документами и файлами :) А вот в параллель они без проблем могут существовать и закрывать разный класс задач.
К тому же, OpenClaw обычно ставят на отдельный виртуальный сервер (VPS) для изоляции, а они, как правило, идут без видеокарты и со слабым процессором. На локальном компьютере у вас, скорее всего, более мощная конфигурация с видеочипом/картой, благодаря чему вы можете запускать более высоконагруженные процессы (работа с большими файлами / рендеринг видео / работа с изображениями), а также локальные LLM модели для работы с чувствительными данными.
А еще локальный компьютер, скорее всего, работает у вас через домашнего / мобильного провайдера, у которого т.н. "резидентский" IP (то есть не серверный) - и это позволяет автоматизировать работу с веб-сайтами и реже сталкиваться с блокировками антибот систем, капчей и т.п. Что открывает дорогу к автоматизации сбора данных и работы с сайтами, не имеющими API, т.е. имитируя работу обычного человека, но через своего AI агента.
Поэтому считаю это хорошей новостью и всем рекомендую попробовать. Но стоит помнить, что LLM - это недетерминированные системы, которые теоретически могут делать необратимые действия на компьютере и не нести за это никакой ответственности :) Так что следует быть предельно аккуратным, не давать доступ к чувствительным данным и всегда иметь бэкапы (которые создаются автоматически и лучше в 2 местах минимум) всех важных файлов и данных.
Для тех, кто готов к будущему и экспериментам:
/mcp -> computer-use -> enable
С включенным Computer Use можно просить запускать любые приложения и автоматизировать практически любые действия с ними - от работы с документами и таблицами до серфинга в браузере (например, чтобы агент автоматически заказывал вам регулярные товары на Ozon/WB или искал авиабилеты). Если вы занимаетесь монтажом видео / блогингом - попросить обрезать или перемонтировать видео и залить его на YouTube / в Instagram.
А в сочетании с функцией Dispatch можно накидывать задачи и следить за прогрессом прямо с телефона удаленно.
Может возникнуть вопрос - является ли это заменой OpenClaw и подобным opensource агентам? Я думаю, что нет, потому что ту степень свободы и интеграций, которую можно настроить в OpenClaw, вы вряд ли позволите себе на основной машине с личными / рабочими документами и файлами :) А вот в параллель они без проблем могут существовать и закрывать разный класс задач.
К тому же, OpenClaw обычно ставят на отдельный виртуальный сервер (VPS) для изоляции, а они, как правило, идут без видеокарты и со слабым процессором. На локальном компьютере у вас, скорее всего, более мощная конфигурация с видеочипом/картой, благодаря чему вы можете запускать более высоконагруженные процессы (работа с большими файлами / рендеринг видео / работа с изображениями), а также локальные LLM модели для работы с чувствительными данными.
А еще локальный компьютер, скорее всего, работает у вас через домашнего / мобильного провайдера, у которого т.н. "резидентский" IP (то есть не серверный) - и это позволяет автоматизировать работу с веб-сайтами и реже сталкиваться с блокировками антибот систем, капчей и т.п. Что открывает дорогу к автоматизации сбора данных и работы с сайтами, не имеющими API, т.е. имитируя работу обычного человека, но через своего AI агента.
Поэтому считаю это хорошей новостью и всем рекомендую попробовать. Но стоит помнить, что LLM - это недетерминированные системы, которые теоретически могут делать необратимые действия на компьютере и не нести за это никакой ответственности :) Так что следует быть предельно аккуратным, не давать доступ к чувствительным данным и всегда иметь бэкапы (которые создаются автоматически и лучше в 2 местах минимум) всех важных файлов и данных.
Для тех, кто готов к будущему и экспериментам:
/mcp -> computer-use -> enable
👍6🔥6👾4❤2⚡2🌚2
Неплохое интервью главы OpenAI про ближайшее будущее касательно автоматизации, роботизации и агентского взаимодействия. А также проблемы и вызовы, с которыми нам предстоит столкнуться.
Смотреть на русском можно через синхронный AI перевод в Яндекс Браузере.
Или - прослушать краткое аудио саммари, составленное другим агентом:
Смотреть на русском можно через синхронный AI перевод в Яндекс Браузере.
Или - прослушать краткое аудио саммари, составленное другим агентом:
YouTube
Frontier Models & AI | Sam Altman, CEO & Co-Founder, OpenAI
Sam Altman, CEO and Co-Founder of @OpenAI explores what happens when intelligence is no longer scarce. This session examines frontier AI models and their implications for economies, institutions, and global systems.
Related links:
Explore the full agenda…
Related links:
Explore the full agenda…
🔥5❤1
Автоматизация создания каруселей для Instagram.
Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом.
Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет регулярно их верстать).
Теперь же слайды можно легко и непринуждённо создавать с помощью Claude Code / Codex / OpenClaw всего за несколько минут.
1. Откройте новый чат
2. Попросите создать структуру и контент для Instagram-карусели на 5-7 слайдов
3. Дайте все необходимые вводные материалы и контекст по вашей теме
4. Попросите сгенерировать картинки в PNG на основе HTML+CSS+Playwright (он поймёт)
И все. На выходе вы получаете готовые изображения. Может получиться не идеально с первого раза - просто попробуйте ещё раз, попросив поменять стиль или формулировки.
Ключевой особенностью данного подхода является то, что генерируется по сути не картинка, а часть веб-страницы, которую легко и быстро можно редактировать. После чего финальный вариант AI просто сам открывает в своём браузере и делает скриншот, сохраняя как готовое изображение.
И, что самое важное - в отличие от подхода с генерацией сразу изображений (напр. в Nano Banana), нет артефактов и галлюцинаций ИИ, встречающиеся в мелких текстах и деталях, а также деградации качества при многократных правках и регенерации.
P.S. кто-то уже наверное догадался, что на основе этого можно создавать полноценную «фабрику контента» с автовыкладкой в соц. сети - но об этом позже 🤫
Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом.
Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет регулярно их верстать).
Теперь же слайды можно легко и непринуждённо создавать с помощью Claude Code / Codex / OpenClaw всего за несколько минут.
1. Откройте новый чат
2. Попросите создать структуру и контент для Instagram-карусели на 5-7 слайдов
3. Дайте все необходимые вводные материалы и контекст по вашей теме
4. Попросите сгенерировать картинки в PNG на основе HTML+CSS+Playwright (он поймёт)
И все. На выходе вы получаете готовые изображения. Может получиться не идеально с первого раза - просто попробуйте ещё раз, попросив поменять стиль или формулировки.
Ключевой особенностью данного подхода является то, что генерируется по сути не картинка, а часть веб-страницы, которую легко и быстро можно редактировать. После чего финальный вариант AI просто сам открывает в своём браузере и делает скриншот, сохраняя как готовое изображение.
И, что самое важное - в отличие от подхода с генерацией сразу изображений (напр. в Nano Banana), нет артефактов и галлюцинаций ИИ, встречающиеся в мелких текстах и деталях, а также деградации качества при многократных правках и регенерации.
P.S. кто-то уже наверное догадался, что на основе этого можно создавать полноценную «фабрику контента» с автовыкладкой в соц. сети - но об этом позже 🤫
👍9🔥4❤3🤯2
AIматизация | ИИ в жизни и бизнесе
Автоматизация создания каруселей для Instagram. Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом. Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет…
Аналогично можно автоматизировать создание контента и оформления для email-рассылок (по сути верстка того же html). А также создание и воссоздание (в том числе из pdf) презентаций на любые темы.
Да, как я уже писал выше, презентации можно также создавать в пару кликов в NotebookLM, но здесь остается контроль - и можно тонко настраивать каждый слайд и его содержимое.
По сути у вас в руках магический генератор любого типа контента - от текстового до графического. И на основе этого подхода можно создавать даже видео и анимации - о чем расскажу в одном из ближайших постов
Да, как я уже писал выше, презентации можно также создавать в пару кликов в NotebookLM, но здесь остается контроль - и можно тонко настраивать каждый слайд и его содержимое.
По сути у вас в руках магический генератор любого типа контента - от текстового до графического. И на основе этого подхода можно создавать даже видео и анимации - о чем расскажу в одном из ближайших постов
❤5🔥5👍4
Последние недели выдались очень насыщенными на рабочие и личные события, в ближайшее время будет серия постов в продолжение темы автоматизации маркетинга и создания контента.
А пока можно протестировать вышедшую сегодня новую версию ChatGPT 5.5, которая, судя по бенчмаркам, уделывает в данный момент все остальные публичные модели, включая недавно вышедший Opus 4.7.
И ждём в ближайшие дни апдейт от Google?
А пока можно протестировать вышедшую сегодня новую версию ChatGPT 5.5, которая, судя по бенчмаркам, уделывает в данный момент все остальные публичные модели, включая недавно вышедший Opus 4.7.
И ждём в ближайшие дни апдейт от Google?
👍5🔥5
AIматизация | ИИ в жизни и бизнесе
Автоматизация создания каруселей для Instagram. Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом. Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет…
Media is too big
VIEW IN TELEGRAM
Продолжаем тему генерации контента с помощью AI.
Сколько времени и средств обычно занимает создание презентационных / промо роликов? Классический подход - найти монтажёра, прописать ему чёткое ТЗ, сценарий, тексты. Ожидание в несколько дней, затем ещё неделя правок, где, получив новую версию спустя день-два - уже забыл, что меняли и зачем.
Многие скажут - но ведь можно просто загрузить промпт в Veo / Kling и прочие AI генераторы видео. Но проблема в том, что хоть они и неплохо уже умеют в художественные фильмы, но когда тебе нужна чёткая последовательность смыслов и текстов, быстрые итерации создания (за секунды, а не по 5-10 минут на каждое создание) и многократная правка мелких деталей - на классических AI-генераторах видео упираешься либо в лимиты, либо в стабильное итерационное ухудшение качества (когда с каждой правкой становится нечитаемый текст, пропадают важные детали и добавляются новые).
И тут в качестве решения можем использовать новый подход, который мы рассматривали ранее - генерация контента на HTML + React (технологии вёрстки веб-сайтов) с последующим превращением полученного контента в фото/видео/анимацию уже лишь на финальном этапе, когда мы внесли все правки.
Это позволяет тонко настраивать каждый отдельный элемент и слайд, не внося галлюцинации модели и не ломая то, что уже хорошо сделано. А также с возможностью лёгкой доработки и изменений в любой момент времени и после монтажа.
Технология / проект называется Remotion.
Просто дайте своему агенту (Claude / Codex / OpenClaw и т.д.) ссылку на проект и на скилл и попросите установить его их к вам локально. После чего расскажите, что и в каком стиле хотите создать - и он сам сопроводит вам по шагам. Превью можно сразу просматривать в браузере по ссылке, которую агент даст (да и сам и откроет).
По-умолчанию он может лениться и делать шаблонный дизайн - тогда просто попросите его креативнее подходить к задаче. Экспериментируйте. Когда результат будет удовлетворительным - нажмите кнопку Render (или попросте агента). На выходе получится смонтированный файл с видео (пример во вложении).
Стоимость - околонулевая (минимальный расход токенов). Экономия времени и денег - дни и сотни долларов бюджета.
Что ещё можно так создавать?
1. GIF анимации
2. Накладывать субтитры поверх готовых видео
3. Накладывать фоновую музыку / звуки
3. Накладывать вотемарки (водные знаки, логотипы и пр.) поверх готовых изображений / видео / анимаций
4. Те же карусели изображений для соц. сетей
5. Рекламные креативы и динамичные баннеры для сайта
6. Анимированные блоки товаров для магазина / маркетплейсов и email-рассылок
7. Анимированные аватарки или стикеры для Telegram / соцсетей
8. Динамическая инфографика и аналитика данных
9. Превью для цифровых продуктов
10. Персонализированные видео-рассылки
Как видно, сгенерировать можно практически все, что угодно - из того, что можно технически открывать и просматривать в браузере и на что хватит фантазии. И даже оформить это в автоматизированный процесс, чтобы контент создавался 24/7 без остановки.
Во вложении - специально сгенерированный для этого поста проморолик.
Сколько времени и средств обычно занимает создание презентационных / промо роликов? Классический подход - найти монтажёра, прописать ему чёткое ТЗ, сценарий, тексты. Ожидание в несколько дней, затем ещё неделя правок, где, получив новую версию спустя день-два - уже забыл, что меняли и зачем.
Многие скажут - но ведь можно просто загрузить промпт в Veo / Kling и прочие AI генераторы видео. Но проблема в том, что хоть они и неплохо уже умеют в художественные фильмы, но когда тебе нужна чёткая последовательность смыслов и текстов, быстрые итерации создания (за секунды, а не по 5-10 минут на каждое создание) и многократная правка мелких деталей - на классических AI-генераторах видео упираешься либо в лимиты, либо в стабильное итерационное ухудшение качества (когда с каждой правкой становится нечитаемый текст, пропадают важные детали и добавляются новые).
И тут в качестве решения можем использовать новый подход, который мы рассматривали ранее - генерация контента на HTML + React (технологии вёрстки веб-сайтов) с последующим превращением полученного контента в фото/видео/анимацию уже лишь на финальном этапе, когда мы внесли все правки.
Это позволяет тонко настраивать каждый отдельный элемент и слайд, не внося галлюцинации модели и не ломая то, что уже хорошо сделано. А также с возможностью лёгкой доработки и изменений в любой момент времени и после монтажа.
Технология / проект называется Remotion.
Просто дайте своему агенту (Claude / Codex / OpenClaw и т.д.) ссылку на проект и на скилл и попросите установить его их к вам локально. После чего расскажите, что и в каком стиле хотите создать - и он сам сопроводит вам по шагам. Превью можно сразу просматривать в браузере по ссылке, которую агент даст (да и сам и откроет).
По-умолчанию он может лениться и делать шаблонный дизайн - тогда просто попросите его креативнее подходить к задаче. Экспериментируйте. Когда результат будет удовлетворительным - нажмите кнопку Render (или попросте агента). На выходе получится смонтированный файл с видео (пример во вложении).
Стоимость - околонулевая (минимальный расход токенов). Экономия времени и денег - дни и сотни долларов бюджета.
Что ещё можно так создавать?
1. GIF анимации
2. Накладывать субтитры поверх готовых видео
3. Накладывать фоновую музыку / звуки
3. Накладывать вотемарки (водные знаки, логотипы и пр.) поверх готовых изображений / видео / анимаций
4. Те же карусели изображений для соц. сетей
5. Рекламные креативы и динамичные баннеры для сайта
6. Анимированные блоки товаров для магазина / маркетплейсов и email-рассылок
7. Анимированные аватарки или стикеры для Telegram / соцсетей
8. Динамическая инфографика и аналитика данных
9. Превью для цифровых продуктов
10. Персонализированные видео-рассылки
Как видно, сгенерировать можно практически все, что угодно - из того, что можно технически открывать и просматривать в браузере и на что хватит фантазии. И даже оформить это в автоматизированный процесс, чтобы контент создавался 24/7 без остановки.
Во вложении - специально сгенерированный для этого поста проморолик.
👍10🔥7
This media is not supported in your browser
VIEW IN TELEGRAM
Кстати, Gemini теперь умеет создавать документы сразу в чате, которые можно скачать в один клик, без необходимости экспорта в отдельный гуглдок и последующего ре-экспорта, что занимало время.
Причём PDF получаются вполне симпатичные из коробки. А дополнительную красоту можно попросить навести, сгенерировав как слайды презентации и там же в один клик скачав полученный результат в pdf (второй файл в закрепе)
Причём PDF получаются вполне симпатичные из коробки. А дополнительную красоту можно попросить навести, сгенерировав как слайды презентации и там же в один клик скачав полученный результат в pdf (второй файл в закрепе)
🔥5👍4
Соло Маркетинг
Многие, возможно, слышали тезис Сэма Альтмана о том, что в течение ближайших 2-3 лет появится компания-единорог с оценкой свыше 1 млрд. долларов, созданная и состоящая из одного человека (и AI-агентов). И совсем недавно был кейс с компанией Medvi, в которой Мэттью Галлахер в одиночку (позже присоединился его брат) из $20000 вложений создал стартап, продающий дженерики Оземпика, используя модель дропшиппинга и десятки AI агентов для полного цикла всех бизнес процессов - от маркетинга и продаж до управления заказами и остатками. И, по разным оценкам, уже может претендовать на роль единорога (если хейт в сети и судебные иски не растоптают их бренд в ближайшее время).
Недавно стало известно, что весь отдел маркетинга у Anthropic (создатель Claude) последние 10 месяцев вел всего один человек. Причём он вовсе не технарь и даже никогда не открывал терминал до этого. Просто он выстроил все воркфлоу - от создания креативов и сценариев до управления рекламными кампаниями через Claude Code с последующей оркестрацией цепочки агентов.
Компания с оценкой $380 млрд (1 трлн на вторичном рынке) и годовой выручкой $30 млрд до сих пор придерживается философии «минимум людей -> максимум автоматизации с AI». И показывает всему миру не словом, а делом, что AIматизация - это реально.
Многие, возможно, слышали тезис Сэма Альтмана о том, что в течение ближайших 2-3 лет появится компания-единорог с оценкой свыше 1 млрд. долларов, созданная и состоящая из одного человека (и AI-агентов). И совсем недавно был кейс с компанией Medvi, в которой Мэттью Галлахер в одиночку (позже присоединился его брат) из $20000 вложений создал стартап, продающий дженерики Оземпика, используя модель дропшиппинга и десятки AI агентов для полного цикла всех бизнес процессов - от маркетинга и продаж до управления заказами и остатками. И, по разным оценкам, уже может претендовать на роль единорога (если хейт в сети и судебные иски не растоптают их бренд в ближайшее время).
Недавно стало известно, что весь отдел маркетинга у Anthropic (создатель Claude) последние 10 месяцев вел всего один человек. Причём он вовсе не технарь и даже никогда не открывал терминал до этого. Просто он выстроил все воркфлоу - от создания креативов и сценариев до управления рекламными кампаниями через Claude Code с последующей оркестрацией цепочки агентов.
Компания с оценкой $380 млрд (1 трлн на вторичном рынке) и годовой выручкой $30 млрд до сих пор придерживается философии «минимум людей -> максимум автоматизации с AI». И показывает всему миру не словом, а делом, что AIматизация - это реально.
🔥8🤯2❤1