Стал копать глубже autoresearch Карпаты. В принципе, те же циклы исследований, что и у ML, как я говорил, состоят всего из трех вещей: статика, динамика и program.md (описание всего оверфлоу).
То есть, статика — это то, что не меняется, например, где лежат данные, как готовятся данные и как вычисляется функция, по которой будет оптимизация. Соответственно, разбивка на тестовую, точнее, на обучающую и эволюционную выборки.
Динамическая — это, все, что меняется: может меняться подход, могут меняться стратегии, могут меняться модели и так далее. То есть, все, что не связано с данными и функцией оптимизации.
Третий момент — это просто Markdown описание, как это все делать. Тут два ключевых момента: собственно, как программное описание, так и динамический код должны помещаться в контекст агента. В этом случае он все очень хорошо понимает.
У меня есть несколько проектов, где хочу эту штуку обкатать. Один достаточно похожий, потому что до моих экспериментов с алготрейдингом на криптовалютных опционах я там же начал, но пока не закончил.
А второй — это оптимизация по тестированию предсказаний по рекламным креативам (CTR). Но тут проблема в том, что каждый эксперимент — это деньги на OpenRouter, так что там я пока не зашел, но, скорее всего, зайду.
То есть, статика — это то, что не меняется, например, где лежат данные, как готовятся данные и как вычисляется функция, по которой будет оптимизация. Соответственно, разбивка на тестовую, точнее, на обучающую и эволюционную выборки.
Динамическая — это, все, что меняется: может меняться подход, могут меняться стратегии, могут меняться модели и так далее. То есть, все, что не связано с данными и функцией оптимизации.
Третий момент — это просто Markdown описание, как это все делать. Тут два ключевых момента: собственно, как программное описание, так и динамический код должны помещаться в контекст агента. В этом случае он все очень хорошо понимает.
У меня есть несколько проектов, где хочу эту штуку обкатать. Один достаточно похожий, потому что до моих экспериментов с алготрейдингом на криптовалютных опционах я там же начал, но пока не закончил.
А второй — это оптимизация по тестированию предсказаний по рекламным креативам (CTR). Но тут проблема в том, что каждый эксперимент — это деньги на OpenRouter, так что там я пока не зашел, но, скорее всего, зайду.
👍3
Продолжаю экспериментировать с этим подходом (autoresearch) и сделал автоматическую генерацию контента для YouTube Shorts. Соответственно, планирую заставить его оптимизировать видео для наибольшего количества просмотров.
Собственно, генерировать буду просто через Remotion плюс Claude code. Но оказалось довольно просто сделать на скоб гейте, добавив поддержку YouTube API. Дальше нужно сделать MCP и добавить в агента. Он сразу настроил канал как нужно, генерируя логотипы и баннеры через на на банана. Правда, загрузить пришлось руками.
Загрузка видео у меня уже решена через за engine браузер, который подключается к Хрому с моим профилем в YouTube и загружает туда видео. Все это зациклено с аналитикой успешности поста, конкурентов, тематикой и так далее.
Вот, кстати, ссылка на новый канал. https://www.youtube.com/channel/UCIgmw-EsfITrXNyKbZqxmtg
Собственно, генерировать буду просто через Remotion плюс Claude code. Но оказалось довольно просто сделать на скоб гейте, добавив поддержку YouTube API. Дальше нужно сделать MCP и добавить в агента. Он сразу настроил канал как нужно, генерируя логотипы и баннеры через на на банана. Правда, загрузить пришлось руками.
Загрузка видео у меня уже решена через за engine браузер, который подключается к Хрому с моим профилем в YouTube и загружает туда видео. Все это зациклено с аналитикой успешности поста, конкурентов, тематикой и так далее.
Вот, кстати, ссылка на новый канал. https://www.youtube.com/channel/UCIgmw-EsfITrXNyKbZqxmtg
🔥6
Касательно последних обновлений от Claude code, /btw, в принципе, тема интересная, но ей не так часто пользуюсь, чтобы задавать вопросы в рамках долгих задач.
В принципе, я обычно знаю, что происходит касательно /voice, но всё странно. Я и так большую часть работы перевёл на WisprFlow или аналогичные решения, так что у меня голосовой уже активно используется давно.
Но почему-то сейчас не попадается всё больше роликов, где говорится, что это прямо имба и что этого прям не хватало.
Пока единственное, что впечатляет, это скорость фичей, с которой Anthropic их выпускает
В принципе, я обычно знаю, что происходит касательно /voice, но всё странно. Я и так большую часть работы перевёл на WisprFlow или аналогичные решения, так что у меня голосовой уже активно используется давно.
Но почему-то сейчас не попадается всё больше роликов, где говорится, что это прямо имба и что этого прям не хватало.
Пока единственное, что впечатляет, это скорость фичей, с которой Anthropic их выпускает
❤1
Часть моих проектов я использую уже с dev container. Там, соответственно, не нужно подтверждать применение команд.
Однако часть проектов все-таки у меня связана с внешними инструментами, и там требуется подтверждение. И это сейчас самый большой блокер, потому что я работаю с несколькими проектами, и если где-то нужно подтверждение, то агент дальше не идет.
Вот начал искать, какие есть варианты решения, и оказалось, что есть новая экспериментальная команда у Claude code.
https://x.com/rohanpaul_ai/status/2030156251821392096
А есть еще и другая команда, которая работает на регулярках и хуках собственно агента. Она более топорная, но зато более надежная, и она напоминает тот проект RTK, о котором я писал выше.
https://github.com/manuelschipper/nah
https://github.com/rtk-ai/rtk
Однако часть проектов все-таки у меня связана с внешними инструментами, и там требуется подтверждение. И это сейчас самый большой блокер, потому что я работаю с несколькими проектами, и если где-то нужно подтверждение, то агент дальше не идет.
Вот начал искать, какие есть варианты решения, и оказалось, что есть новая экспериментальная команда у Claude code.
—enable-auto-mode, которая, по идее, учится на том, что ты делал, и сам принимает решение, нужно ли спрашивать подтверждение или нет.https://x.com/rohanpaul_ai/status/2030156251821392096
А есть еще и другая команда, которая работает на регулярках и хуках собственно агента. Она более топорная, но зато более надежная, и она напоминает тот проект RTK, о котором я писал выше.
https://github.com/manuelschipper/nah
https://github.com/rtk-ai/rtk
X (formerly Twitter)
Rohan Paul (@rohanpaul_ai) on X
Claude seems to be fixing a super annoying developer problem.
Anthropic announced a research preview feature called Auto Mode for Claude Code, expected to roll out by March 12, 2026.
The idea is simple: let Claude automatically handle permission prompts…
Anthropic announced a research preview feature called Auto Mode for Claude Code, expected to roll out by March 12, 2026.
The idea is simple: let Claude automatically handle permission prompts…
➜ claude-code-templates tree -a
.
└── .claude
├── commands
│ └── my-product
│ ├── analytics.md
│ ├── check-checklist.md
│ ├── follow-checklist.md
│ ├── google-ads.md
│ ├── init.md
│ ├── onboarding-flow.md
│ ├── promotion.md
│ └── search-console.md
├── launch-checklist.md
└── product.md
Завел себе шаблоны для новых продуктов.
Соответственно, команду
/init оставил только в домашней директории, а все остальные команды копируются внутрь каждого продукта.После чего, в рамках init, обновляются данные product.md.
Чтобы агент понимал что за домен, что за продукт, и другие дополнительные факты?
В итоге, внутри проекта, при запуске этих команд, агент понимает, что это за продукт, с чем он работает, что конкретно должен вызывать этих команд.
👍2
Решил я завести еще агента в почту.
Смотрел, что есть какие-то MCP и так далее. В итоге просто взял и создал новый скилл, который работает по старым добрым протоколам IMAP и SMTP.
А креды получают из переменных окружающего окружения конкретного проекта.
В итоге у меня теперь слэш-команда и скилл для работы с email по проекту.
Смотрел, что есть какие-то MCP и так далее. В итоге просто взял и создал новый скилл, который работает по старым добрым протоколам IMAP и SMTP.
А креды получают из переменных окружающего окружения конкретного проекта.
В итоге у меня теперь слэш-команда и скилл для работы с email по проекту.
Возился я тут вчера с новым тулом NixCage, который, по идее, делает изоляцию на уровне системы, но гораздо попроще, чем Docker.
В итоге выглядело, как все хорошо, но оказалось, что что-то он может не запускать, потому что нет доступа на изменение временных файлов и так далее.
В итоге таких проблем оказалось огромная куча. Я забил на это и пошел другим путем: создал новый скилл для ревью сессии по пермишенам, что чаще вызывалось на подтверждение.
Сейчас время от времени запускаю эту команду у себя и дорабатываю пермишены, которые вызывались, и я точно знаю, что они безопасны, чтобы они в следующий раз не вызывались.
Залил это все на GitHub, так что можно пользоваться))
https://github.com/alifanov/claude-code-reflect-permissions
В итоге выглядело, как все хорошо, но оказалось, что что-то он может не запускать, потому что нет доступа на изменение временных файлов и так далее.
В итоге таких проблем оказалось огромная куча. Я забил на это и пошел другим путем: создал новый скилл для ревью сессии по пермишенам, что чаще вызывалось на подтверждение.
Сейчас время от времени запускаю эту команду у себя и дорабатываю пермишены, которые вызывались, и я точно знаю, что они безопасны, чтобы они в следующий раз не вызывались.
Залил это все на GitHub, так что можно пользоваться))
https://github.com/alifanov/claude-code-reflect-permissions
GitHub
GitHub - alifanov/claude-code-reflect-permissions: Claude Code skill that learns your manual permission approvals and auto-adds…
Claude Code skill that learns your manual permission approvals and auto-adds them to project settings - alifanov/claude-code-reflect-permissions
👍1
Настраивал я тут отслеживание для Google рекламы. В каких-то проектах получилось достаточно просто, в каких-то я прям долго докручивал, разбирался, что не так. Было несколько итераций, но такие преодолел.
С любопытством пока не понял, в чем особая разница. Но комбинация настройки PostHog MCP + Google Ads MCP через ScopeGate (https://github.com/alifanov/scopegate) и запуск всего в Clade code показала себя достаточно удобной.
Можно просто соглашаться на предложение по экспериментам. За счет GITисторию можно смотреть, что было изменено и когда. Наконец, довел до конца: переключил несколько Google рекламных компаний с оптимизации по кликам на оптимизацию по конверсиям. По идее, это должно снизить CPC. Посмотрим, как это заработает
С любопытством пока не понял, в чем особая разница. Но комбинация настройки PostHog MCP + Google Ads MCP через ScopeGate (https://github.com/alifanov/scopegate) и запуск всего в Clade code показала себя достаточно удобной.
Можно просто соглашаться на предложение по экспериментам. За счет GITисторию можно смотреть, что было изменено и когда. Наконец, довел до конца: переключил несколько Google рекламных компаний с оптимизации по кликам на оптимизацию по конверсиям. По идее, это должно снизить CPC. Посмотрим, как это заработает
GitHub
GitHub - alifanov/scopegate: AI Access Proxy Layer — granular permission gateway for AI agents. Connect services, define scopes…
AI Access Proxy Layer — granular permission gateway for AI agents. Connect services, define scopes, get an MCP endpoint. - alifanov/scopegate
В рамках эксперимента с генерацией YouTube Shorts через авторесерч добавил еще новый скилл Reflect Video, который после генерации прогоняет видео через модель Gemini. Эта модель указывает, что можно улучшить в видео, и, собственно, перед публикацией он пробует улучшить это видео еще одним рендерингом по собственному скору.
Каждый раз получается улучшение..., но по просмотрам пока так себе.
Каждый раз получается улучшение..., но по просмотрам пока так себе.
🧠 Наткнулся на скрытую команду в Claude Code —
Это буквально "сон" для ИИ. Anthropic тихо добавили Auto-dream — фоновый агент, который консолидирует память между сессиями. Без официальных анонсов и документации.
Работает как REM-сон: копит сигналы за день, потом структурирует и убирает лишнее. Системный промпт буквально: "You are performing a dream".
Четыре фазы: orient, gather, consolidate, prune. Индекс памяти держится до 200 строк. Клод не просто помнит больше — а помнит лучше.
🔍 Проверить: запусти
claudefa.st
/dream.Это буквально "сон" для ИИ. Anthropic тихо добавили Auto-dream — фоновый агент, который консолидирует память между сессиями. Без официальных анонсов и документации.
Работает как REM-сон: копит сигналы за день, потом структурирует и убирает лишнее. Системный промпт буквально: "You are performing a dream".
Четыре фазы: orient, gather, consolidate, prune. Индекс памяти держится до 200 строк. Клод не просто помнит больше — а помнит лучше.
🔍 Проверить: запусти
/memory в Claude Code и ищи "Auto-dream: on". Пока тихий роллаут.claudefa.st
Claude Fast
Claude Code Dreams: Anthropic's New Memory Feature
Claude Fast | Claude Code Auto Dream consolidates memory files, pruning stale notes and merging insights. Like REM sleep for your AI agent.
👍2🔥1
https://paperclip.ing/
Последнее время склоняюсь к тому, что нужно больше автономности в своих проектах, в частности с использованием агентов. Натыкался на такой проект, мне его подсказали; выглядит прямо классно, к чему я иду.
Единственное, что я попробовал, и мне не зашло, хотя идея понравилась. В итоге начал пилить свой собственный продукт по полностью автономному AI компании.
Из интересного подхода, который есть в различных ассистентах и тут, они достаточно схожи. В особенности использование некого синхронизирующего сигнала, так называемого heartbeat, на который завязаны все повторяющиеся задачи.
Последнее время склоняюсь к тому, что нужно больше автономности в своих проектах, в частности с использованием агентов. Натыкался на такой проект, мне его подсказали; выглядит прямо классно, к чему я иду.
Единственное, что я попробовал, и мне не зашло, хотя идея понравилась. В итоге начал пилить свой собственный продукт по полностью автономному AI компании.
Из интересного подхода, который есть в различных ассистентах и тут, они достаточно схожи. В особенности использование некого синхронизирующего сигнала, так называемого heartbeat, на который завязаны все повторяющиеся задачи.
paperclip.ing
Paperclip – The app people use to manage AI agents for work
Manage a team of AI agents to run your business. Org charts, budgets, governance, and goals — all in one deployment.
Начал делать полностью автономные компании и потратил пару дней на то, чтобы добавить возможность запускать кодового агента в docker sandbox.
Собственно, чтобы он все делал с кодом, можно было сразу пушить и разворачивать это на проде.
А потом выяснил, что оказывается эта задача уже решена, и есть много готовых решений, причем даже и платных, и open source'ных.
Сейчас пока тестирую несколько из них. Вот попробовал Daytona — вроде как все нормально работает и все отлично интегрируется.
Создается sandbox, выполняется задача, и потом он удаляется по завершении.
Тем достаточно удобно. Плюс они дают 200 долларов, то есть 100 долларов сразу на баланс, а еще 100 при подвязке карты.
В принципе, с этими деньгами можно экспериментировать для своих автоматизаций с тем же OpenClaw или другими ассистентами.
Собственно, чтобы он все делал с кодом, можно было сразу пушить и разворачивать это на проде.
А потом выяснил, что оказывается эта задача уже решена, и есть много готовых решений, причем даже и платных, и open source'ных.
Сейчас пока тестирую несколько из них. Вот попробовал Daytona — вроде как все нормально работает и все отлично интегрируется.
Создается sandbox, выполняется задача, и потом он удаляется по завершении.
Тем достаточно удобно. Плюс они дают 200 долларов, то есть 100 долларов сразу на баланс, а еще 100 при подвязке карты.
В принципе, с этими деньгами можно экспериментировать для своих автоматизаций с тем же OpenClaw или другими ассистентами.
https://github.com/epistates/turbovault
последний месяц начали хайповать связку claude code плюс обсидиан я тоже решил попробовать взял все свои закладки просмотренные видео телеграм-канал и решил их залить в хранилище в качестве заметок и дальше уже разложить на обработку все это делал и нашел что оказывается есть ребяты которые делали дополнительный плагин написанный на Rust который упрощает взаимодействие с хранилищем то есть у Obsidian тоже недавно появился CLI-интерфейс но вроде как этот TurboVault еще даже поприкольнее будет фичей больше и работает быстрее
последний месяц начали хайповать связку claude code плюс обсидиан я тоже решил попробовать взял все свои закладки просмотренные видео телеграм-канал и решил их залить в хранилище в качестве заметок и дальше уже разложить на обработку все это делал и нашел что оказывается есть ребяты которые делали дополнительный плагин написанный на Rust который упрощает взаимодействие с хранилищем то есть у Obsidian тоже недавно появился CLI-интерфейс но вроде как этот TurboVault еще даже поприкольнее будет фичей больше и работает быстрее
GitHub
GitHub - Epistates/turbovault: Markdown and OFM SDK w/ MCP server that transforms your Obsidian vault into an intelligent knowledge…
Markdown and OFM SDK w/ MCP server that transforms your Obsidian vault into an intelligent knowledge system - Epistates/turbovault
Еще одну практику решил внедрить.
Последнее время много хайпа вокруг связки код-код и обсидиан.
Я тут решил для себя немного свое старое хранилище пересобрать, разложить на основные папки как минимум три input, knowledge и output, где input – это входящие знания, которые я читаю, смотрю, изучаю. Knowledge – это какая конверсия у меня произошла, что я что-то узнал, что-то поресерчил и так далее. То есть это мои внутренние знания. И output – это то, куда я что-то запостил.
И начал автоматически собирать какие-то вещи, которые я где-то закладывал, записывал, смотрел и так далее. Что разобрался только с YouTube. Там довольно-таки запарно, но в принципе можно выгрузить историю, а потом взять все видосы, которые посмотрел, выгрузить транскрипт и по ним уже сделать отдельные заметки.
Аналогично с Twitter взять все закладки, которые у меня там остались за все, и тоже разложить их на отдельные заметки.
Третьим идет Telegram. Тут я не решил, но, скорее всего, ограничусь только каналами, которые я смотрю, и, соответственно, вытаскиванием заметок по этим каналам.
Последнее время много хайпа вокруг связки код-код и обсидиан.
Я тут решил для себя немного свое старое хранилище пересобрать, разложить на основные папки как минимум три input, knowledge и output, где input – это входящие знания, которые я читаю, смотрю, изучаю. Knowledge – это какая конверсия у меня произошла, что я что-то узнал, что-то поресерчил и так далее. То есть это мои внутренние знания. И output – это то, куда я что-то запостил.
И начал автоматически собирать какие-то вещи, которые я где-то закладывал, записывал, смотрел и так далее. Что разобрался только с YouTube. Там довольно-таки запарно, но в принципе можно выгрузить историю, а потом взять все видосы, которые посмотрел, выгрузить транскрипт и по ним уже сделать отдельные заметки.
Аналогично с Twitter взять все закладки, которые у меня там остались за все, и тоже разложить их на отдельные заметки.
Третьим идет Telegram. Тут я не решил, но, скорее всего, ограничусь только каналами, которые я смотрю, и, соответственно, вытаскиванием заметок по этим каналам.
https://github.com/A-EVO-Lab/a-evolve
Начал играться с этим тулом, который в последнее время хайпит. В принципе, очень похоже на авторесерч, только немного другого уровня. Если авторесерч выдаёт и находит оптимальный алгоритм, то этот тул находит оптимального агента. То есть он меняет тулы, меняет скиллы, меняет фронты и модели, и находит оптимальное соотношение по твоей задаче. Но, как и в авторесерче, тут вопрос упирается в датасет. То есть нужно иметь датасет, на котором это всё будет тестироваться. Но хорошо, что можно сделать свою функцию оценки, потому что туда можно запихнуть, например, так называемый LLM as a judge подход, то есть вызывать другую LLM, которая проверяет эталонный вывод и тот, что выдал, и выдаёт ответ, насколько они похожи.
Начал играться с этим тулом, который в последнее время хайпит. В принципе, очень похоже на авторесерч, только немного другого уровня. Если авторесерч выдаёт и находит оптимальный алгоритм, то этот тул находит оптимального агента. То есть он меняет тулы, меняет скиллы, меняет фронты и модели, и находит оптимальное соотношение по твоей задаче. Но, как и в авторесерче, тут вопрос упирается в датасет. То есть нужно иметь датасет, на котором это всё будет тестироваться. Но хорошо, что можно сделать свою функцию оценки, потому что туда можно запихнуть, например, так называемый LLM as a judge подход, то есть вызывать другую LLM, которая проверяет эталонный вывод и тот, что выдал, и выдаёт ответ, насколько они похожи.
GitHub
GitHub - A-EVO-Lab/a-evolve: The official repository of "Position: Agentic Evolution is the Path to Evolving LLMs".
The official repository of "Position: Agentic Evolution is the Path to Evolving LLMs". - A-EVO-Lab/a-evolve
Поизучал я тут недавно фреймворки для кодинга, такие как GSD, Superpowers, BMAD и аналогичные. И в итоге оказалось, что у меня не такие большие проекты, где требуется прямо их внедрение.
И забавно, у Superpowers... Ранее было, сейчас я не уверен осталось ли, что он прямо удалял код, который не покрыт тестами. То есть у него основная тема была, что мы идем на тотальное TDD. Если его нет, то сорян, чувак, твой код удаляется.
А в итоге для себя я пришел к тому, что у меня должен быть просто правильный Claude.md, не более 200 строк, но при этом он может включать ссылки на другую документацию, например, по code style, по архитектуре, PRD и так далее.
И забавно, у Superpowers... Ранее было, сейчас я не уверен осталось ли, что он прямо удалял код, который не покрыт тестами. То есть у него основная тема была, что мы идем на тотальное TDD. Если его нет, то сорян, чувак, твой код удаляется.
А в итоге для себя я пришел к тому, что у меня должен быть просто правильный Claude.md, не более 200 строк, но при этом он может включать ссылки на другую документацию, например, по code style, по архитектуре, PRD и так далее.
я только тут обрадовался, что auto mode теперь везде доступен. После утечки появился новый mode auto, который переключается по shift+tab, но при этом он говорит, что данный режим на твоём аккаунте недоступен.
При этом подписка за 200 долларов.
Вопрос: какая должна быть подписка, чтобы он был доступен?)
При этом подписка за 200 долларов.
Вопрос: какая должна быть подписка, чтобы он был доступен?)