AIматизация | ИИ в жизни и бизнесе
Но пока начну с более простых, понятных и прикладных инструментов, которые могут дать буст в "daily routine". Один из таких - это NotebookLM от Google. На первый взгляд - система заметок. Их же уже сотни? Но нет, здесь ценность совершенно в другом. Представьте…
Для тех, кто уже использует агентов (OpenClaw / Codex / Claude Code и т.д.) - есть отличная библиотека + скилл для агентской работы с NotebookLM:
https://github.com/teng-lin/notebooklm-py
С ней можно, например, просить своего агента сделать саммари по статье, или краткий аудио пересказ YouTube подкаста, или запустить автономное глубокое исследование по интересующей теме - и получить готовый результат к себе в рабочую область (телеграм / терминал / чат, где вы ведете общение со своим агентом).
Как начать? Просто скиньте ссылку своему агенту и попросите установить, он сам разберется :)
Вам останется только пройти по полученной ссылке и авторизоваться через Google, после чего можно начинать пользоваться💻
https://github.com/teng-lin/notebooklm-py
С ней можно, например, просить своего агента сделать саммари по статье, или краткий аудио пересказ YouTube подкаста, или запустить автономное глубокое исследование по интересующей теме - и получить готовый результат к себе в рабочую область (телеграм / терминал / чат, где вы ведете общение со своим агентом).
Как начать? Просто скиньте ссылку своему агенту и попросите установить, он сам разберется :)
Вам останется только пройти по полученной ссылке и авторизоваться через Google, после чего можно начинать пользоваться
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - teng-lin/notebooklm-py: Unofficial Python API and agentic skill for Google Gemini Notebook. Full programmatic access to…
Unofficial Python API and agentic skill for Google Gemini Notebook. Full programmatic access to NotebookLM's features—including capabilities the web UI doesn't expose—via Python, CL...
🔥5👀3
Claude вчера выкатил в публичный релиз Computer Use - функционал в Claude Code / Claude Desktop для полноценного управления компьютером. Правда, пока только на Mac и доступен подписчикам Pro и Max (ранее это уже было доступно через api, а также через сторонние плагины и скиллы - но теперь доступно нативно и официально).
С включенным Computer Use можно просить запускать любые приложения и автоматизировать практически любые действия с ними - от работы с документами и таблицами до серфинга в браузере (например, чтобы агент автоматически заказывал вам регулярные товары на Ozon/WB или искал авиабилеты). Если вы занимаетесь монтажом видео / блогингом - попросить обрезать или перемонтировать видео и залить его на YouTube / в Instagram.
А в сочетании с функцией Dispatch можно накидывать задачи и следить за прогрессом прямо с телефона удаленно.
Может возникнуть вопрос - является ли это заменой OpenClaw и подобным opensource агентам? Я думаю, что нет, потому что ту степень свободы и интеграций, которую можно настроить в OpenClaw, вы вряд ли позволите себе на основной машине с личными / рабочими документами и файлами :) А вот в параллель они без проблем могут существовать и закрывать разный класс задач.
К тому же, OpenClaw обычно ставят на отдельный виртуальный сервер (VPS) для изоляции, а они, как правило, идут без видеокарты и со слабым процессором. На локальном компьютере у вас, скорее всего, более мощная конфигурация с видеочипом/картой, благодаря чему вы можете запускать более высоконагруженные процессы (работа с большими файлами / рендеринг видео / работа с изображениями), а также локальные LLM модели для работы с чувствительными данными.
А еще локальный компьютер, скорее всего, работает у вас через домашнего / мобильного провайдера, у которого т.н. "резидентский" IP (то есть не серверный) - и это позволяет автоматизировать работу с веб-сайтами и реже сталкиваться с блокировками антибот систем, капчей и т.п. Что открывает дорогу к автоматизации сбора данных и работы с сайтами, не имеющими API, т.е. имитируя работу обычного человека, но через своего AI агента.
Поэтому считаю это хорошей новостью и всем рекомендую попробовать. Но стоит помнить, что LLM - это недетерминированные системы, которые теоретически могут делать необратимые действия на компьютере и не нести за это никакой ответственности :) Так что следует быть предельно аккуратным, не давать доступ к чувствительным данным и всегда иметь бэкапы (которые создаются автоматически и лучше в 2 местах минимум) всех важных файлов и данных.
Для тех, кто готов к будущему и экспериментам:
/mcp -> computer-use -> enable
С включенным Computer Use можно просить запускать любые приложения и автоматизировать практически любые действия с ними - от работы с документами и таблицами до серфинга в браузере (например, чтобы агент автоматически заказывал вам регулярные товары на Ozon/WB или искал авиабилеты). Если вы занимаетесь монтажом видео / блогингом - попросить обрезать или перемонтировать видео и залить его на YouTube / в Instagram.
А в сочетании с функцией Dispatch можно накидывать задачи и следить за прогрессом прямо с телефона удаленно.
Может возникнуть вопрос - является ли это заменой OpenClaw и подобным opensource агентам? Я думаю, что нет, потому что ту степень свободы и интеграций, которую можно настроить в OpenClaw, вы вряд ли позволите себе на основной машине с личными / рабочими документами и файлами :) А вот в параллель они без проблем могут существовать и закрывать разный класс задач.
К тому же, OpenClaw обычно ставят на отдельный виртуальный сервер (VPS) для изоляции, а они, как правило, идут без видеокарты и со слабым процессором. На локальном компьютере у вас, скорее всего, более мощная конфигурация с видеочипом/картой, благодаря чему вы можете запускать более высоконагруженные процессы (работа с большими файлами / рендеринг видео / работа с изображениями), а также локальные LLM модели для работы с чувствительными данными.
А еще локальный компьютер, скорее всего, работает у вас через домашнего / мобильного провайдера, у которого т.н. "резидентский" IP (то есть не серверный) - и это позволяет автоматизировать работу с веб-сайтами и реже сталкиваться с блокировками антибот систем, капчей и т.п. Что открывает дорогу к автоматизации сбора данных и работы с сайтами, не имеющими API, т.е. имитируя работу обычного человека, но через своего AI агента.
Поэтому считаю это хорошей новостью и всем рекомендую попробовать. Но стоит помнить, что LLM - это недетерминированные системы, которые теоретически могут делать необратимые действия на компьютере и не нести за это никакой ответственности :) Так что следует быть предельно аккуратным, не давать доступ к чувствительным данным и всегда иметь бэкапы (которые создаются автоматически и лучше в 2 местах минимум) всех важных файлов и данных.
Для тех, кто готов к будущему и экспериментам:
/mcp -> computer-use -> enable
👍6🔥6👾4❤2⚡2🌚2
Неплохое интервью главы OpenAI про ближайшее будущее касательно автоматизации, роботизации и агентского взаимодействия. А также проблемы и вызовы, с которыми нам предстоит столкнуться.
Смотреть на русском можно через синхронный AI перевод в Яндекс Браузере.
Или - прослушать краткое аудио саммари, составленное другим агентом:
Смотреть на русском можно через синхронный AI перевод в Яндекс Браузере.
Или - прослушать краткое аудио саммари, составленное другим агентом:
YouTube
Frontier Models & AI | Sam Altman, CEO & Co-Founder, OpenAI
Sam Altman, CEO and Co-Founder of @OpenAI explores what happens when intelligence is no longer scarce. This session examines frontier AI models and their implications for economies, institutions, and global systems.
Related links:
Explore the full agenda…
Related links:
Explore the full agenda…
🔥5❤1
Автоматизация создания каруселей для Instagram.
Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом.
Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет регулярно их верстать).
Теперь же слайды можно легко и непринуждённо создавать с помощью Claude Code / Codex / OpenClaw всего за несколько минут.
1. Откройте новый чат
2. Попросите создать структуру и контент для Instagram-карусели на 5-7 слайдов
3. Дайте все необходимые вводные материалы и контекст по вашей теме
4. Попросите сгенерировать картинки в PNG на основе HTML+CSS+Playwright (он поймёт)
И все. На выходе вы получаете готовые изображения. Может получиться не идеально с первого раза - просто попробуйте ещё раз, попросив поменять стиль или формулировки.
Ключевой особенностью данного подхода является то, что генерируется по сути не картинка, а часть веб-страницы, которую легко и быстро можно редактировать. После чего финальный вариант AI просто сам открывает в своём браузере и делает скриншот, сохраняя как готовое изображение.
И, что самое важное - в отличие от подхода с генерацией сразу изображений (напр. в Nano Banana), нет артефактов и галлюцинаций ИИ, встречающиеся в мелких текстах и деталях, а также деградации качества при многократных правках и регенерации.
P.S. кто-то уже наверное догадался, что на основе этого можно создавать полноценную «фабрику контента» с автовыкладкой в соц. сети - но об этом позже 🤫
Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом.
Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет регулярно их верстать).
Теперь же слайды можно легко и непринуждённо создавать с помощью Claude Code / Codex / OpenClaw всего за несколько минут.
1. Откройте новый чат
2. Попросите создать структуру и контент для Instagram-карусели на 5-7 слайдов
3. Дайте все необходимые вводные материалы и контекст по вашей теме
4. Попросите сгенерировать картинки в PNG на основе HTML+CSS+Playwright (он поймёт)
И все. На выходе вы получаете готовые изображения. Может получиться не идеально с первого раза - просто попробуйте ещё раз, попросив поменять стиль или формулировки.
Ключевой особенностью данного подхода является то, что генерируется по сути не картинка, а часть веб-страницы, которую легко и быстро можно редактировать. После чего финальный вариант AI просто сам открывает в своём браузере и делает скриншот, сохраняя как готовое изображение.
И, что самое важное - в отличие от подхода с генерацией сразу изображений (напр. в Nano Banana), нет артефактов и галлюцинаций ИИ, встречающиеся в мелких текстах и деталях, а также деградации качества при многократных правках и регенерации.
P.S. кто-то уже наверное догадался, что на основе этого можно создавать полноценную «фабрику контента» с автовыкладкой в соц. сети - но об этом позже 🤫
👍9🔥4❤3🤯2
AIматизация | ИИ в жизни и бизнесе
Автоматизация создания каруселей для Instagram. Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом. Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет…
Аналогично можно автоматизировать создание контента и оформления для email-рассылок (по сути верстка того же html). А также создание и воссоздание (в том числе из pdf) презентаций на любые темы.
Да, как я уже писал выше, презентации можно также создавать в пару кликов в NotebookLM, но здесь остается контроль - и можно тонко настраивать каждый слайд и его содержимое.
По сути у вас в руках магический генератор любого типа контента - от текстового до графического. И на основе этого подхода можно создавать даже видео и анимации - о чем расскажу в одном из ближайших постов
Да, как я уже писал выше, презентации можно также создавать в пару кликов в NotebookLM, но здесь остается контроль - и можно тонко настраивать каждый слайд и его содержимое.
По сути у вас в руках магический генератор любого типа контента - от текстового до графического. И на основе этого подхода можно создавать даже видео и анимации - о чем расскажу в одном из ближайших постов
❤5🔥5👍4
Последние недели выдались очень насыщенными на рабочие и личные события, в ближайшее время будет серия постов в продолжение темы автоматизации маркетинга и создания контента.
А пока можно протестировать вышедшую сегодня новую версию ChatGPT 5.5, которая, судя по бенчмаркам, уделывает в данный момент все остальные публичные модели, включая недавно вышедший Opus 4.7.
И ждём в ближайшие дни апдейт от Google?
А пока можно протестировать вышедшую сегодня новую версию ChatGPT 5.5, которая, судя по бенчмаркам, уделывает в данный момент все остальные публичные модели, включая недавно вышедший Opus 4.7.
И ждём в ближайшие дни апдейт от Google?
👍5🔥5
AIматизация | ИИ в жизни и бизнесе
Автоматизация создания каруселей для Instagram. Каждый, кто ведёт инстаграм, знает, как хорошо иногда залетают «карусели» - посты в формате изображений-слайдов с текстом. Но для их создания нужно много времени и ресурсов (или отдельного человека, кто будет…
Media is too big
VIEW IN TELEGRAM
Продолжаем тему генерации контента с помощью AI.
Сколько времени и средств обычно занимает создание презентационных / промо роликов? Классический подход - найти монтажёра, прописать ему чёткое ТЗ, сценарий, тексты. Ожидание в несколько дней, затем ещё неделя правок, где, получив новую версию спустя день-два - уже забыл, что меняли и зачем.
Многие скажут - но ведь можно просто загрузить промпт в Veo / Kling и прочие AI генераторы видео. Но проблема в том, что хоть они и неплохо уже умеют в художественные фильмы, но когда тебе нужна чёткая последовательность смыслов и текстов, быстрые итерации создания (за секунды, а не по 5-10 минут на каждое создание) и многократная правка мелких деталей - на классических AI-генераторах видео упираешься либо в лимиты, либо в стабильное итерационное ухудшение качества (когда с каждой правкой становится нечитаемый текст, пропадают важные детали и добавляются новые).
И тут в качестве решения можем использовать новый подход, который мы рассматривали ранее - генерация контента на HTML + React (технологии вёрстки веб-сайтов) с последующим превращением полученного контента в фото/видео/анимацию уже лишь на финальном этапе, когда мы внесли все правки.
Это позволяет тонко настраивать каждый отдельный элемент и слайд, не внося галлюцинации модели и не ломая то, что уже хорошо сделано. А также с возможностью лёгкой доработки и изменений в любой момент времени и после монтажа.
Технология / проект называется Remotion.
Просто дайте своему агенту (Claude / Codex / OpenClaw и т.д.) ссылку на проект и на скилл и попросите установить его их к вам локально. После чего расскажите, что и в каком стиле хотите создать - и он сам сопроводит вам по шагам. Превью можно сразу просматривать в браузере по ссылке, которую агент даст (да и сам и откроет).
По-умолчанию он может лениться и делать шаблонный дизайн - тогда просто попросите его креативнее подходить к задаче. Экспериментируйте. Когда результат будет удовлетворительным - нажмите кнопку Render (или попросте агента). На выходе получится смонтированный файл с видео (пример во вложении).
Стоимость - околонулевая (минимальный расход токенов). Экономия времени и денег - дни и сотни долларов бюджета.
Что ещё можно так создавать?
1. GIF анимации
2. Накладывать субтитры поверх готовых видео
3. Накладывать фоновую музыку / звуки
3. Накладывать вотемарки (водные знаки, логотипы и пр.) поверх готовых изображений / видео / анимаций
4. Те же карусели изображений для соц. сетей
5. Рекламные креативы и динамичные баннеры для сайта
6. Анимированные блоки товаров для магазина / маркетплейсов и email-рассылок
7. Анимированные аватарки или стикеры для Telegram / соцсетей
8. Динамическая инфографика и аналитика данных
9. Превью для цифровых продуктов
10. Персонализированные видео-рассылки
Как видно, сгенерировать можно практически все, что угодно - из того, что можно технически открывать и просматривать в браузере и на что хватит фантазии. И даже оформить это в автоматизированный процесс, чтобы контент создавался 24/7 без остановки.
Во вложении - специально сгенерированный для этого поста проморолик.
Сколько времени и средств обычно занимает создание презентационных / промо роликов? Классический подход - найти монтажёра, прописать ему чёткое ТЗ, сценарий, тексты. Ожидание в несколько дней, затем ещё неделя правок, где, получив новую версию спустя день-два - уже забыл, что меняли и зачем.
Многие скажут - но ведь можно просто загрузить промпт в Veo / Kling и прочие AI генераторы видео. Но проблема в том, что хоть они и неплохо уже умеют в художественные фильмы, но когда тебе нужна чёткая последовательность смыслов и текстов, быстрые итерации создания (за секунды, а не по 5-10 минут на каждое создание) и многократная правка мелких деталей - на классических AI-генераторах видео упираешься либо в лимиты, либо в стабильное итерационное ухудшение качества (когда с каждой правкой становится нечитаемый текст, пропадают важные детали и добавляются новые).
И тут в качестве решения можем использовать новый подход, который мы рассматривали ранее - генерация контента на HTML + React (технологии вёрстки веб-сайтов) с последующим превращением полученного контента в фото/видео/анимацию уже лишь на финальном этапе, когда мы внесли все правки.
Это позволяет тонко настраивать каждый отдельный элемент и слайд, не внося галлюцинации модели и не ломая то, что уже хорошо сделано. А также с возможностью лёгкой доработки и изменений в любой момент времени и после монтажа.
Технология / проект называется Remotion.
Просто дайте своему агенту (Claude / Codex / OpenClaw и т.д.) ссылку на проект и на скилл и попросите установить его их к вам локально. После чего расскажите, что и в каком стиле хотите создать - и он сам сопроводит вам по шагам. Превью можно сразу просматривать в браузере по ссылке, которую агент даст (да и сам и откроет).
По-умолчанию он может лениться и делать шаблонный дизайн - тогда просто попросите его креативнее подходить к задаче. Экспериментируйте. Когда результат будет удовлетворительным - нажмите кнопку Render (или попросте агента). На выходе получится смонтированный файл с видео (пример во вложении).
Стоимость - околонулевая (минимальный расход токенов). Экономия времени и денег - дни и сотни долларов бюджета.
Что ещё можно так создавать?
1. GIF анимации
2. Накладывать субтитры поверх готовых видео
3. Накладывать фоновую музыку / звуки
3. Накладывать вотемарки (водные знаки, логотипы и пр.) поверх готовых изображений / видео / анимаций
4. Те же карусели изображений для соц. сетей
5. Рекламные креативы и динамичные баннеры для сайта
6. Анимированные блоки товаров для магазина / маркетплейсов и email-рассылок
7. Анимированные аватарки или стикеры для Telegram / соцсетей
8. Динамическая инфографика и аналитика данных
9. Превью для цифровых продуктов
10. Персонализированные видео-рассылки
Как видно, сгенерировать можно практически все, что угодно - из того, что можно технически открывать и просматривать в браузере и на что хватит фантазии. И даже оформить это в автоматизированный процесс, чтобы контент создавался 24/7 без остановки.
Во вложении - специально сгенерированный для этого поста проморолик.
👍10🔥7
This media is not supported in your browser
VIEW IN TELEGRAM
Кстати, Gemini теперь умеет создавать документы сразу в чате, которые можно скачать в один клик, без необходимости экспорта в отдельный гуглдок и последующего ре-экспорта, что занимало время.
Причём PDF получаются вполне симпатичные из коробки. А дополнительную красоту можно попросить навести, сгенерировав как слайды презентации и там же в один клик скачав полученный результат в pdf (второй файл в закрепе)
Причём PDF получаются вполне симпатичные из коробки. А дополнительную красоту можно попросить навести, сгенерировав как слайды презентации и там же в один клик скачав полученный результат в pdf (второй файл в закрепе)
🔥5👍4
Соло Маркетинг
Многие, возможно, слышали тезис Сэма Альтмана о том, что в течение ближайших 2-3 лет появится компания-единорог с оценкой свыше 1 млрд. долларов, созданная и состоящая из одного человека (и AI-агентов). И совсем недавно был кейс с компанией Medvi, в которой Мэттью Галлахер в одиночку (позже присоединился его брат) из $20000 вложений создал стартап, продающий дженерики Оземпика, используя модель дропшиппинга и десятки AI агентов для полного цикла всех бизнес процессов - от маркетинга и продаж до управления заказами и остатками. И, по разным оценкам, уже может претендовать на роль единорога (если хейт в сети и судебные иски не растоптают их бренд в ближайшее время).
Недавно стало известно, что весь отдел маркетинга у Anthropic (создатель Claude) последние 10 месяцев вел всего один человек. Причём он вовсе не технарь и даже никогда не открывал терминал до этого. Просто он выстроил все воркфлоу - от создания креативов и сценариев до управления рекламными кампаниями через Claude Code с последующей оркестрацией цепочки агентов.
Компания с оценкой $380 млрд (1 трлн на вторичном рынке) и годовой выручкой $30 млрд до сих пор придерживается философии «минимум людей -> максимум автоматизации с AI». И показывает всему миру не словом, а делом, что AIматизация - это реально.
Многие, возможно, слышали тезис Сэма Альтмана о том, что в течение ближайших 2-3 лет появится компания-единорог с оценкой свыше 1 млрд. долларов, созданная и состоящая из одного человека (и AI-агентов). И совсем недавно был кейс с компанией Medvi, в которой Мэттью Галлахер в одиночку (позже присоединился его брат) из $20000 вложений создал стартап, продающий дженерики Оземпика, используя модель дропшиппинга и десятки AI агентов для полного цикла всех бизнес процессов - от маркетинга и продаж до управления заказами и остатками. И, по разным оценкам, уже может претендовать на роль единорога (если хейт в сети и судебные иски не растоптают их бренд в ближайшее время).
Недавно стало известно, что весь отдел маркетинга у Anthropic (создатель Claude) последние 10 месяцев вел всего один человек. Причём он вовсе не технарь и даже никогда не открывал терминал до этого. Просто он выстроил все воркфлоу - от создания креативов и сценариев до управления рекламными кампаниями через Claude Code с последующей оркестрацией цепочки агентов.
Компания с оценкой $380 млрд (1 трлн на вторичном рынке) и годовой выручкой $30 млрд до сих пор придерживается философии «минимум людей -> максимум автоматизации с AI». И показывает всему миру не словом, а делом, что AIматизация - это реально.
🔥8🤯2❤1