AI da Code
170 subscribers
222 photos
16 videos
2 files
415 links
Канал про то, как ускорить разработку продуктов с AI
Download Telegram
https://github.com/kevinrgu/autoagent/tree/main

Появился ещё один тул, называющийся Autoagent. В принципе, это немного урезанная форма A-evolve, про которую я писал выше.

По идее, если уже существует агент, его нужно улучшать итерациями, то можно использовать Autoagent. Работает через генетические алгоритмы.

В целом это все про одно и то же но на рахных уровнях
• autoresearch
• autoagent
• e-evolve
https://code.claude.com/docs/en/ultraplan

Выглядит, странно. Новая фича ещё в Research Preview в Claude code. Вроде как только несколько часов назад появилась.

Когда вводишь /ultraplan, он у тебя запускает этот план в вебе. Но что удобно, там можно редактировать отдельные какие-то компоненты, а не только в конце, что нужно исправить.

Очень похоже на команду /btw, но немного с другой стороны. Потому что когда ультраплан работает, ты ещё можешь продолжать работать в терминале. А /btw как раз наоборот. Когда у тебя что-то работает, ты можешь что-то ещё дополнительно спросить.

Посмотрим, как это будет работать. Будет ли это удобнее? Но есть мнение, что он работает сильно быстрее, чем plan mode обычный.
Долгое время проходило мимо всяких таких штук типа Cmax, Superset, Conductor и так далее. А сейчас решил попробовать.

Предначально выглядит достаточно удобненько. Посмотрел, как это будет через какое-то время. Из всех, которые я посмотрел, Cmax выглядит как наиболее просто и сразу работает с терминалом. Что прикольно, есть сразу ходки и практически все. Все основные, которые тебе делают разделение вправо, новый терминал или открывает новый браузер. Плюс сразу браузер открывается на вкладке в терминале, чтобы можно было сразу посмотреть, поправить и так далее. Посмотрю, обкатаю несколько дней, но что вроде как выглядит достаточно неплохо.
первый минус по Cmux - втсренный бразуер там рендерит не картинку в текстовое представление - потому при копировании копируется лишь текст, а не скрин((
для скрин остается нативное копирование области экрана на Маке Cmd + Shift + 4
В последнее время и в интернете, и среди моих знакомых стали массово идти жалобы на урезание лимитов по claude code. Я, конечно, это заметил, но у меня достаточно большой объем. Оказалось, у людей, которые раньше использовали, не сильно объем вырос, но теперь они упираются в свои лимиты.

Видимо, пора уже оптимизировать, не брать одну модель под все, а распределять под разные задачи и разные инструменты. В принципе, у меня несколько знакомых так уже делают, но геморрой на поддержку этого все равно до запарка остается. Но, видимо... Придется.
https://claude.com/blog/the-advisor-strategy

Интересная новая фича.
Более мелкие модели могут спрашивать более умную модель, в частном случае Opus, о том, как это сделать, таким образом, прося совет.

Единственное, что она вроде как работает только через API сейчас, именно при прямом вызове модели. Надеюсь, скоро добавят в Claude code. Хотя с этим рядом получится сэкономить токены и влезть в лимиты.
👍1
https://pageradar.app/

Я как-то ранее писал про то, что для запуска продуктов по-хорошему протестировать бы спрос. И вот пример такого подхода как раз сделал недавно. Вообще не выбирая идею, просто посмотрел, что залетело на Product Hunt.

Оказалось, это был проект, который я уже высокий написал трафик, плюс через несколько оптимизаций я снизил его до CPC меньше доллара, а на самой посадочной странице был waitlist, который сам по себе режет конверсию, но я решил его протестировать. В итоге у меня за неделю получилось 25 регистраций в waitlist, и только после этого я уже начал делать вроде как сделал основную фичу для тестирования изменений на страницах веб-сайтов.

И, соответственно, лишь сейчас буду рассылать по waitlist, что все запустилось, и дальше уже двигаться, смотреть, как народ этим будет пользоваться.
👍2
https://code.claude.com/docs/en/sandboxing

Буквально пару дней назад появилась новая фича в Claude Code — команда /sandbox. По идее, она меньше запрашивает, что нужно, но при этом работает не в DevContainer, а через свой механизм.

Для некоторых моих проектов это прям работающая тема, для некоторых не совсем, особенно для тех, которые пользуют внешние API, даже самый расширенный вариант песочницы, будут спрашивать, а точно агенту нужно ходить в эти сервисы.

Поэтому, если совсем, чтобы без запроса, я бы рекомендовал запускать в Docker или DevContainer с Dangerless Skip Permission. Если нужно хотя бы какое-то ограничение, то я бы рекомендовал использовать sandbox.
👍1
https://superset.sh

Добрался-таки попробовать эту штуку, но впечатления не очень.
Во-первых, при запуске она требует регистрации, то есть она не совсем локальная.
Во-вторых, часть функционала платная, и прям классические paywall'ы стоят на некоторых фичах. Как по мне, там много всего накручено, то есть оно прям достаточно избыточное. Да, прикольно, если ты работаешь с несколькими разными агентами, и тебе нужно под разные задачи, под разные проекты, разные использовать.

Да, прикольно, но не совсем для меня. Еще было удобно то, что можно открывать, редактировать и просматривать файлы, что во многих других вещах стараются убирать. Но в целом слишком избыточно для меня, поэтому я останусь на cmux.
👍1
Сделал еще раунд исследований по поводу использования спецификации в разработке. В итоге обманковало все с ChatGPT и параллельно еще с Claude.

Пришел к тому, что planMode — это минималка, что нужно использовать, но дальше есть такие, как BMAD, GSD, Superpowers и так далее, которые тратят токены только в шум.

В итоге ничего довольно-таки прикольного не нашел, но ChatGPT посоветовал: слушай, а давай создай сам себе отдельную команду, которая будет сначала спрашивать, что тебе нужно, что-то вроде брейншторма, а потом подробно это все будет объединить. А далее, как обычно, с готовым планом я иду и прошу у Claude Code написать код по этой спецификации.

Плюс этой команды в том, что ее можно очень сильно кастомизировать под себя.
🔥1
Нашел одну проблему в Claude Code. Странно, что про нее мало кто говорит.

Смысл ее в следующем. Не так давно они добавили возможность роутинга для разных режимов, который включается по /model opusplan. У меня в плане делается с моделью Opus, а само исполнение — с моделью Sonnet. Но когда я это пробую, пишу план, в конце он у меня спрашивает, что ты согласен на все и продолжить выполнение плана через automode. Но automode не работает на моем плане, он есть только у Team и Enterprise. И потом вешается полностью сессия, потому что дальше не идет выполнение. Он говорит, у тебя нет возможности использовать automode (точнее он недоступен на твоем плане). В итоге приходится выходить из сессии, заходить заново, выключать режим планирования, и потом продолжать то, что он написал.

Каких-то рецептов, как это преодолеть я не нашел. Единственный вариант, который так себе, это оставить этот режим, сделать план, потом перейти в 3 пункт, написать approve и нажать комбинацию shift-tab. Там прямо написано, что дать этот фидбэк с одобрением плана, и дальше он начнет выполнение. Выглядит как костыль, но это работает.
раскатали opus 4.7
👍1
https://github.com/alifanov/cc-reflexion

cмержил несколько скиллов по рефлексии для Claude code по логам сессий и затюнил под себя - теперь смотрит историю и говорит что можно добавить (skills, claude.md, subagents)
🔥2
https://www.anthropic.com/news/claude-design-anthropic-labs

Думал, что Pencil.dev убьет Figma с новым дизайном и интеграцией AI. Но, видимо, оказалось, что новый релиз Claude сделает это раньше, чем Figma снизойдет.
👍2
прошло тихо, но в релизе opsu 4.7 automode раскатили и на Max планы
теперь хоть снова можно plan mode нормально пользоваться

https://www.anthropic.com/news/claude-opus-4-7
https://www.danshapiro.com/blog/2026/01/the-five-levels-from-spicy-autocomplete-to-the-software-factory/

Из забавного
у Дэна Шапира была статья про пять уровней автономности. Для последней это темные фабрики. В принципе, это аналог того, что уже делается в Китае, когда полностью автоматизированные роботы на фабриках создают девайсы без человека.

А здесь он как раз говорил, что и с программным обеспечением скоро будет так же.

И вот наблюдая в интернете последние полторы недели, начал хайпиться новый термин, означающий dark code, то есть темный код. В чем мой прикол, что вся разработка уже перешла на спецификации, а сам код никто не пишет, никто не смотрит, пока только на хайпе.

Посмотрим, что из этого выйдет.
❤‍🔥2
https://github.com/alifanov/cmux-file-viewer

Сделал себе имбовую штуку, локальный просмотрщик различных диаграмм. Дело в том, что в cmux есть возможность открывать встроенный браузер, но диаграммы по умолчанию там не рендерятся. В итоге сделал следующее.

Поднимаю локальный просмотрщик, которому передается полный URL. Получается, что я добавил в сниппет, который я добавляю в глобальный CloudMD файл, говорит, что после генерации диаграммы нужно показывать такую ссылку. Я просто кликаю на эту ссылку, и у меня появилась эта ссылка. В правой панели показывается сама диаграмма.
🔥1
https://openrouter.ai/docs/guides/features/guardrails

Я как-то пропустил, но оказывается, на OpenRouter есть такая штука, где ты можешь ограничить, что с определённого API-ключа у тебя используются только определённые модели, да и не больше определённого бюджета. В принципе, тема прикольная, если паришься над тем, что ключи могут быть заабьюзены. Если я хочу ввести, например, чисто клиентское приложение, то здесь можно ограничить, что можно заабьюзить, но в рамках только этой моей модели и не больше определённой суммы.
не remotion единым

https://github.com/heygen-com/hyperframes

новый тул для создания видео кодом - от HeyGen - пишут что специализирован для работы с агентами

что понравилось - сразу и озвучку делает, но качество из коробки так себе - обязательно нужно докручитвать
🔥1
Токены на Claude подписке все продолжают активно улетать. Так что для некоторых задач я стал искать другое решение.

В итоге взял Ollama, погонял локальные модели, ничего хорошего там не нашел, но оказалось, что у Ollama есть подписка на улучшенный инференс. Создал по своим сессиям в Claude code тесты для своего бенчмарка, прогнал несколько моделей, которые мне больше всего подходят по этому бенчмарку, и запустил ollama launch claude с моделью, которая мне лучше всего подошла, это была GLM5.1, и вот она на постоянке сидит уже несколько дней, разбирает мои заметки в Obsidian.
👍3