SimpleAGI
293 subscribers
83 photos
2 files
70 links
Здесь ты найдешь понятные лайфхаки и примеры использования LLM в повседневной жизни и бизнесе.

Подпишись, чтобы вместе шаг за шагом разбираться в технологиях, которые уже меняют наше будущее.
Download Telegram
Обновление модели и новые фичи в claude code.
Обратил внимание на

- /less-permission-prompts - новый скилл: сканирует транскрипты и предлагает allowlist read-only команд в .claude/settings.json. Меньше подтверждений для git status, ls, python -c и т.п.

Звучит, как безопасный способ избавиться от части апрувов действий в безопасном режиме.
Но меня улыбнуло, почему комьюнити не додумалось сделать это раньше?

ls -t ~/.claude/projects/*/*.jsonl 2>/dev/null | head -50 > /tmp/transcripts.txt
wc -l /tmp/transcripts.txt
одна JSON-строка = одно событие (user message, assistant message, tool call, tool result).

bash_commands = Counter()
mcp_tools = Counter()
Два счётчика

for sep in ['&&', '||', ';', '|']:
idx = s.find(sep)
if idx != -1:
s = s[:idx]
```
функция на регулярках для парсинга команд, причем парсит первую, если ты юзаешь && твои проблемы 😫

Дальше не интересно, всякая фильтрация, чистка переменных и прочая аналитическая-прогерская штука не нужная вайб-кодерам (kek)

Ну а я в очередной раз убеждаюсь в "НЕ УСЛОЖНЯЙ"!
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥422
Отдельная благодарность за "recap", говорят, что появилась еще в 108 версии, но я только сейчас получил.

Саммари диалога с фокусом на конец беседы. Порой очень полезно, когда много окон.
Авторами задумано для сценариев:

ты возвращаешься к предыдущей сессии через:

claude --continue — продолжить последнюю сессию
claude --resume — выбрать сессию из списка
503🤩1😍1
SimpleAGI
Решил попробовать съехать с терминала VSCode на что-то нормальное. Для Claude Code хочется 100% функционала - выбор пал на Ghostty. «zero config philosophy». Поставил, запустил, красота. Переключаюсь на русскую раскладку. Ctrl+Shift+V - "52;5u" Что за?…
Да, держу в курсе, кастомные терминалы - по моему опыту, херня лагучая.
есть желание попробовать warp и\или Wave, как терминалы со встроенным AI, понять, насколько в этом есть смысл. Сейчас как раз есть задачи сидеть на удаленном серваке и учиться строить квн стендапы
512🔥2
Скрашу ваш пятничный вечер. Работают все сервисы из рф, которые беез 3 букв не заводились. Ютубчик можете глянуть
😱5🤡2
Auto Memory в Claude Code - штука, про которую все знают что "она есть", но мало кто, лишь те, кто не только слышал

"CLAUDE_CODE_DISABLE_AUTO_MEMORY": "0"

структура
~/.claude/projects/<project>/memory/
├── MEMORY.md # Индекс, грузится каждую сессию
├── name.md # имена соответствуют контексту
└── ... # Топик-файлы (Claude создаёт по необходимости)

Что он туда пишет: команды сборки, паттерны проекта, решения дебаггинга, ваши предпочтения.
Один раз сказал
"Запомни, не нужно удалять мою базу данных"

- зафиксировал, переживёт рестарт. В следующей сессии сразу помнит.

После каждого "твой вопрос-ответ агента", Claude запускает агента в фоне с инжектом всех memory и текущего turn(твой вопрос-его ответ).
Агент решает есть тут что-то ценное для будущих сессий? Если да - видишь плашку "Saved N memories"

Если ты сам попросил запомнить или записать в память, то итерация агента пропускается.

Второй нюанс: MEMORY.md - это индекс. Он грузится при старте, но только первые 200 строк / 25 КБ. Сами тематические файлы (debugging.md, api-conventions.md) при старте не грузятся.
Sonnet читает описания файлов из индекса и решает, какие из них подходят под вашу задачу (выбирает до 5 релевантных файлов).
__
Не семантика, а суждение LLM. Два файла с похожими description, но только один релевантен задаче   Sonnet обычно различает по контексту запроса лучше, чем cosine similarity на эмбеддингах. 

Такое же форматирование yml, уже как стандарт для md файлов.
---
name: Контракт управления системой
description: Основной набор правил работы Claude с Ubuntu-системой Nikita — пакеты, обновления, сервисы, файлы, сеть, безопасность
type: feedback
---


P.S. Если memory-файлы разрослись и начали противоречить друг другу - для этого есть Auto Dream. Но это тема для отдельного поста.
🔥2
6 мая в Сан-Франциско Anthropic собирает свою главную конференцию.

Год назад эта же конфа была launch-площадкой. Дарио вышел и со словами "I'm not one to hype things up" объявил, что "as of exactly this moment" релизятся Opus 4 и Sonnet 4.
Плюс шесть платформенных штук в один заход:
- серверный code execution tool,
- MCP через API, Files API,
- web search через API,
- расширенный prompt caching до часа,
- extended thinking с использованием tools.
Claude Code в тот же день вышел с расширениями для VS Code и JetBrains. Параллельно GitHub Copilot подключил Claude.

И за этот год не останавливались:
- Opus 4.5
- Opus 4.6 с Agent Teams
- Opus 4.7 с 1M tokens
- Sonnet 4.6 1M

В Claude Code за этот же период - skills, subagents, /loop, Ultraplan, /ultrareview и еще куча всего.

Я тут закопался, чтоб разобраться, как работают тулзы в CC с web search , вы могли себе представить, что контекст HTML сырым заливается в Haiku с промптом пользователя и в output лезет результат Haiku, что она смогла выжать из сырого html? Балдеж же, наглость которую позволить могут лишь не все, кек.

Между делом - вспомним про Mythos в закрытом превью, о чем, кажется, точно что-то расскажут.

Большая часть из этого закрепилась у меня в работе.
Да в жизни
____
Спикеры тоже сильные.
Boris Cherny - тот, кто собственно сделал Claude Code, до этого был в Cursor и Meta. Кажется очень веселым дядькой.

Cat Wu - Head of Product, Claude Code.
Ami Vora - Head of Product
Angela Jiang - Head of Product, Claude Platform.
Этих не знаю, но звучат то круто. 🙂
____
Зарегался на лайв-стрим во всех трёх городах.

P.S. Скорее всего посмотрю 0 трансляций. НО главное же желание
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1🤩1
Выпал из телеги, но в оповещениях видел разбор полетов про Harness, а это причина моего "вылета"☹️

Harness - слой, который задаёт модели среду. Какие тулы есть, что знает всегда, какая память переживает /clear, когда обязана остановиться или спросить.

Без harness каждая сессия начинается с нуля:
«Привет, у нас Next.js 15, не трогай .env, тесты гоняем так».
С harness это один раз описывается и работает.

Четыре вопроса, на которые модель сама не ответит:
- Что я могу делать? - тулы и пермишены
- Что знаю всегда? - стек, соглашения, ограничения
- Что делала в прошлый раз? - память между сессиями
- Когда остановиться или спросить? - границы автономии


Окно контекста конечно. И деградирует задолго до формального потолка - на 1M-моделях качество падает уже к 200K (Chroma Research). Anthropic называет это context rot(гниение контекста).

Поэтому знания раскладываем по слоям. Слой - это про цену в токенах и вероятность, что знание окажется в контексте в нужный момент.

Пять слоёв, от дорогого к дешёвому:

1. Каждый turn каждой сессии - `AGENT.md`, `CLAUDE.md`
2. На событие - hooks: `session_start`, `tool_use`, `stop`
3. На контекст - `skills/`, `rules/` с `paths:`
4. Когда позвали - `agents/`, `commands/`, MCP
5. Когда прочитали руками - `docs/`, ADR


Правило «в проекте нет Anthropic API» - слой 1, иначе модель попробует и сломается.
Детали оформления devlog - слой 3, нужны только когда реально пишет.



Отдельная история - безопасность. Удобно делить на три типа границ.

Trust gate - можно ли это вообще делать. Whitelist действий, заданный до начала работы.
allow: ["Read"] в settings.

Information gate - что модель видит прямо сейчас. Это и есть слои выше. CLAUDE.md - всегда. Skill - после триггера. Devlog - только если явно прочитала.

Containment - что сломается, если actor всё-таки ошибся. Не предотвращает ошибку, а сужает blast radius.
- Subagent со свежим контекстом и tools: [Read, Grep] физически не может писать.
- Git worktree изолирует эксперимент.
- Bubblewrap/Seatbelt отделяет процесс от системы.



В новом гайде Anthropic есть прямая фраза:

«По мере совершенствования моделей разработчикам следует избавляться от лишних вспомогательных элементов, а не усложнять структуру».

Если модель умеет X нативно - не надо расширять harness под X. С каждой новой моделью объём .claude/ должен сокращаться, а не расти.

Удаляй старое, не добавляй лишнее.

P.S.
Пост Валеры по теме
Гайд Anthropic: https://www.anthropic.com/engineering/harness-design-long-running-apps
Please open Telegram to view this post
VIEW IN TELEGRAM
51🔥3
Как я (с Claude) починил аналоговый звук на MSI в Ubuntu

Подключаю наушники к своему usb микрофону, так как джек-разъем молчал, а на Windows работает.

Некоторое время назад я пытался решить проблему с Claude- без результатов, так и подключал через микрофон.

А СЕГОДНЯ!
- начали с тех же шагов "что там в логах, может ошибки подскажут?"
«no codecs found» указывало на PCI-устройство, подписанное в BIOS как «Realtek ALC1220»

И вишенка на торте, я прям цитатой из диалога поделюсь, это забавно!
Перелом наступил, когда диагноз перевернулся. Выяснилось, что onboard-звук на X870 Tomahawk — это вообще не PCI-кодек ALC1220, а Realtek ALC4080, подключённый по внутреннему USB. Та надпись «ALC1220» у PCI-контроллера — просто легаси-строка из BIOS, а сам контроллер пустой, поэтому «no codecs found» там — нормально и безвредно. Настоящий кодек всё это время преспокойно определялся как USB-аудиоустройство

___
Я к тому, что Opus4.8 мне уже нравится 😎
Please open Telegram to view this post
VIEW IN TELEGRAM
101😁42
А еще у меня начался отпуск в неделю и я надеюсь вернуться к Вам.

К слову о популярных репозиториях и идее Harness под модели аля Клод и ГПТ,
Долго вынашиваю и тестирую прототипы Базового пресета под разработку.
И как правило, получить весомого улучшения по качеству - проблематично, только сам себе в ноги стреляешь, пытаясь описать процессы в красивые пайплайны.

Кто бы мог подумать, но в интернете опять кто-то неправ😐
Please open Telegram to view this post
VIEW IN TELEGRAM
3
Планировал отпуск как нормальный инженер.
Закрыть свои проекты, дописать наконец стартер-пак для разработки с Claude Code. Неделя же - целая вечность.

К IDE так и не подошёл. Компьютер включал ради YouTube и игры.
Вместо работы отсыпался. Отметил день рождения девушки. Съездил к родителям. Про агентов, пайплайны и проекты не думал вообще.

К концу недели заметил любопытное. Мысли перестали ходить по кругу. Вокруг будто прибавилось приятного. Самочувствие - лучше, чем после любого "продуктивного" выходного в IDE.

"Залипание" от перманентного фокуса на одном домене (не важно, "работа" или что-то другое) - сужает жизненный опыт и бьёт по качеству жизни.
Автоматизация агентами всего подряд - это круто, но фоновый процесс - отдых - тоже запускать нужно)
___🥺___
Завтра возвращаться в строй. Судорожно вспоминаю
source .venv/bin/activate
Please open Telegram to view this post
VIEW IN TELEGRAM
50🔥74😁1
Fable 5 - из новостей может показаться, что это "новый ярус" нас Opus4.8 с особой проработкой безопасности.

По факту, важно понимать- это новая модель, но с фишкой
Внешний классификатор перед/вокруг Fable решает: если запрос попадает в высокорисковую зону (наступательная кибербезопасность, биология, химия), ответ генерирует не Fable, а Opus 4.8.

Предлагаю относиться к этому, как к fallback по условию 😇

Из интересного, у модели нет параметров:
thinking
temperature
top_p
top_k
Please open Telegram to view this post
VIEW IN TELEGRAM
2
При одном проекте в 2 терминалах запустил по одному промпту на Opus и Fable
___
Задача лютая, чертовски плохо формулируется, и по кодингу и по
"Ну сформулируйте точнее задачу, тогда будет понятнее, как это считать по трудозатратам"

Сразу видно, что Fable решительнее и не "останавливается", а накидывает через AskUserQuestion варианты и шпарит дальше, причем его вопросы не "делать А или Б?", а "Эта штука так работает?"
По итогу Opus за 3 минуты остановился и зафиналил вопросом
"будем новую репу делать или попробуем упихнуть в skill?"

А Fable за 8 минут полностью подготовил миграцию и просит сказать "поехали", чтоб начать работу)
🔥4
Предупреждения о "запретных" темах вылазят непредсказуемо. Это определенно должны как-то фиксить. На запросах вполне унылых и коддерских ловить смену модели - вообще не круто. Ставлю дислайк, вот прям так и передайте Anthropic
😁2🤬1
за 12 часов прохерить 40 % недельного лимита на макс тарифе - новая модель,конечно, жопу рвет знатно.
Так быть не должно, как мне кажется.

Ребятам на других тарифах - сочувствую и ставлю свечку.
😱21
https://www.anthropic.com/news/fable-mythos-access

Чертовски неприятный пример, политика добралась окончательно
182 дня до нового года, уже меньше половины до долгих выходных.

Fable 5 вернули*
*На неделю по подпискам, а далее ток по api.

Постараюсь закончить сборку под harness или хотя бы справочных файлов.
Чтоб и вы тоже смогли "успеть" донастроить Claude code под ваши кодинг задачи и сократить количество
"Ну ты чо творишь? Мне нужно иначе и вообще верни всё в зад"

Астрологи объявили неделю fable 5.
Успеть закрыть все мета - задачи
3
Знакомая спрашивает, нужна ли кому работа с "Адекватным работодателем и оплатой по рынку"

Ищут человека оценивать генерации мультимодальных моделей — видео, аудио, речь, музыка. По факту ты смотришь, что нагенерила модель, ставишь оценки по чек-листам (насколько попало в промпт, реалистичное ли движение, не разъезжается ли картинка между кадрами, естественная ли речь, липсинк и т.д.) и объясняешь, где она врёт. Из твоих оценок собирают preference-данные, на которых модель потом дообучают через RLHF.

Условия: удалёнка/гибрид, контракт на 6 месяцев с возможным продлением, 3–6 лет опыта, подчинение напрямую CAO. Стек — Label Studio, Scale, Surge, Appen, Excel.
https://www.linkedin.com/jobs/view/4434694805/
😁2
К сожалению не получится зафиналить полноценный "пак" для вас, пока думаю, как с пользой собрать обвязку, чтоб каждому было потенциально полезно и за одну сессию с клодом доработать под себя.
А пока пытаюсь работу работать, тяжко)

P.S. Fable 5 крутая, но как же мало лимитов и долго "думает". Кто и так использует API , Я вам сочувствую, потому что с этой иглы вы не слезете и будете стучаться к Fable вне зависимости от стоимости,
пу-пу-пу
🔥4
Словить 5 часовой лимит на MAX подписке в процессе workflow - ВЫПОЛНЕНО

😈 как горит, уф ☹️
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4
Давно обещаю выложить наработки по harness для Claude Code. 🥺

Два плагина. Одна репа.

claude-code-harness - проектирует и аудирует .claude/ в проекте.
Удаляет так же охотно, как добавляет: показываешь ему свой .claude/ -
получаешь список мёртвого груза.

devlog - память проекта между сессиями. Новая сессия открывается
не холодной, а с последними записями и незакрытой работой.

Даже презентацию сделал - ссылка .
Please open Telegram to view this post
VIEW IN TELEGRAM
8🔥3🤩2
Please open Telegram to view this post
VIEW IN TELEGRAM
41