🪓 склонировал чужой репозиторий — и на вашем компьютере выполнился чужой код
ребята из manifold security разобрали дыру, и она неприятная до зубной боли.
схема простая. вы кидаете агенту ссылку: «глянь, что тут за проект». агент делает git clone. всё, дальше вы уже не участвуете.
внутри репозитория лежит служебный файл, который вы глазами не открываете никогда. в нём написано, что гиту запустить при клонировании. гит послушно запускает. агент вообще ни при чём — он честно выполнил вашу же команду.
и тут я вспомнил, сколько раз за последний месяц кидал агенту ссылку «посмотри по-быстрому». МНОГО.
лечится скучно: чужой код — в контейнер или в отдельную папку, где нет ни ключей, ни доступов. не «ну я потом гляну».
у агента ровно те же права, что у вас. чужой репозиторий — это не текст, это код.
разбор
ребята из manifold security разобрали дыру, и она неприятная до зубной боли.
схема простая. вы кидаете агенту ссылку: «глянь, что тут за проект». агент делает git clone. всё, дальше вы уже не участвуете.
внутри репозитория лежит служебный файл, который вы глазами не открываете никогда. в нём написано, что гиту запустить при клонировании. гит послушно запускает. агент вообще ни при чём — он честно выполнил вашу же команду.
и тут я вспомнил, сколько раз за последний месяц кидал агенту ссылку «посмотри по-быстрому». МНОГО.
лечится скучно: чужой код — в контейнер или в отдельную папку, где нет ни ключей, ни доступов. не «ну я потом гляну».
у агента ровно те же права, что у вас. чужой репозиторий — это не текст, это код.
разбор
🍑 китайцы обошли opus в веб-разработке. за пять долларов
вышла qwen3.8-max-0902 — 2,4 трлн параметров, миллион токенов контекста. первое место в code arena по вебу, на три балла выше claude opus 5 max.
три балла это ни о чём, честно. а вот $2 за вход и $6 за выход — уже о чём-то.
ну такое: я бы взял на задачу, где не жалко. читать ленту, где каждый день кто-то кого-то обогнал на три балла, уже физически больно.
модель
вышла qwen3.8-max-0902 — 2,4 трлн параметров, миллион токенов контекста. первое место в code arena по вебу, на три балла выше claude opus 5 max.
три балла это ни о чём, честно. а вот $2 за вход и $6 за выход — уже о чём-то.
ну такое: я бы взял на задачу, где не жалко. читать ленту, где каждый день кто-то кого-то обогнал на три балла, уже физически больно.
модель
🔭 агент платит за одну и ту же память по сто раз, и гугл предложил это чинить
смотрел на счёт после длинной сессии и не мог понять, откуда столько. задача-то простая была.
а вот откуда. агент на каждом шаге получает всю переписку целиком — с самого начала. шаг десятый тащит за собой девять предыдущих. промпт растёт линейно, а деньги — квадратично. плюс модель каждый раз заново выкапывает из этой горы, на чём вообще остановилась. отсюда половина галлюцинаций в длинных сессиях.
исследователи из гугла предлагают не таскать историю, а вести отдельное состояние: короткий структурированный блок «где я сейчас и что дальше». он обновляется, а не накапливается.
экономия — до 98% токенов на длинных прогонах. девяносто восемь.
это пока статья, не готовый инструмент. но идея-то работает и без гугла: держите в проекте живой файл состояния, а не надежду, что агент вспомнит вчерашнее.
статья
смотрел на счёт после длинной сессии и не мог понять, откуда столько. задача-то простая была.
а вот откуда. агент на каждом шаге получает всю переписку целиком — с самого начала. шаг десятый тащит за собой девять предыдущих. промпт растёт линейно, а деньги — квадратично. плюс модель каждый раз заново выкапывает из этой горы, на чём вообще остановилась. отсюда половина галлюцинаций в длинных сессиях.
исследователи из гугла предлагают не таскать историю, а вести отдельное состояние: короткий структурированный блок «где я сейчас и что дальше». он обновляется, а не накапливается.
экономия — до 98% токенов на длинных прогонах. девяносто восемь.
это пока статья, не готовый инструмент. но идея-то работает и без гугла: держите в проекте живой файл состояния, а не надежду, что агент вспомнит вчерашнее.
статья
🍄 скиллы для агентов, написанные тем, кто ими реально работает
мэтт покок выложил свой набор навыков для кодинг-агентов, и он тем и хорош, что маленький. не «топ-100 скиллов, забирайте в закладки» — а несколько штук под конкретные задачи, которые у человека болели.
вот это, по-моему, и есть правильный подход к скиллам. навык нужен не потому, что он существует, а потому что вы третий раз объясняете агенту одно и то же.
так что не собирайте подборки. соберите свой первый скилл из того, что уже надоело печатать.
репозиторий
мэтт покок выложил свой набор навыков для кодинг-агентов, и он тем и хорош, что маленький. не «топ-100 скиллов, забирайте в закладки» — а несколько штук под конкретные задачи, которые у человека болели.
вот это, по-моему, и есть правильный подход к скиллам. навык нужен не потому, что он существует, а потому что вы третий раз объясняете агенту одно и то же.
так что не собирайте подборки. соберите свой первый скилл из того, что уже надоело печатать.
репозиторий
🛋 anthropic выложила готового торгового агента — и плагин к claude code в комплекте
открываю анонс и по привычке жду подвоха. обычно как: компания выкатывает «референсную архитектуру», а внутри пять слайдов и кнопка «свяжитесь с отделом продаж».
а тут код. открытый. агент со стороны покупателя, агент со стороны продавца, четыре демки — розница, путешествия, телеком, развлечения. и плагин для claude code, чтобы прикрутить всё это к своему бэкенду.
вслух это звучит так: покупатель больше не тыкает в фильтры. он говорит словами — «нужно к пятнице, до десяти тысяч, чтобы не развалилось». а на той стороне не форма, а агент, который видит ваш склад.
и тут я вспомнил, сколько лет мы вылизывали витрину под человека с мышкой. под КАРТИНКИ. а покупатель может прийти вообще без глаз.
ваш сайт готов разговаривать с чужим агентом? мой — не уверен.
блог anthropic
открываю анонс и по привычке жду подвоха. обычно как: компания выкатывает «референсную архитектуру», а внутри пять слайдов и кнопка «свяжитесь с отделом продаж».
а тут код. открытый. агент со стороны покупателя, агент со стороны продавца, четыре демки — розница, путешествия, телеком, развлечения. и плагин для claude code, чтобы прикрутить всё это к своему бэкенду.
вслух это звучит так: покупатель больше не тыкает в фильтры. он говорит словами — «нужно к пятнице, до десяти тысяч, чтобы не развалилось». а на той стороне не форма, а агент, который видит ваш склад.
и тут я вспомнил, сколько лет мы вылизывали витрину под человека с мышкой. под КАРТИНКИ. а покупатель может прийти вообще без глаз.
ваш сайт готов разговаривать с чужим агентом? мой — не уверен.
блог anthropic
🌶 третий flash за шесть недель. и он дешевле опуса в шесть раз
гугл выкатил gemini 3.8 flash. $0,75 за миллион входа, $3,75 за выход. у opus 5 — $5 и $25.
по тестам не разгром, но местами обходит модели заметно крупнее себя. кодинг, финансы, юриспруденция.
а теперь мелким шрифтом. гугл сам пишет, что модель «работает усерднее»: больше шагов рассуждения, чаще дёргает инструменты. цена за токен та же, что у 3.7 — а токенов уходит БОЛЬШЕ.
то есть в прайсе в шесть раз дешевле, а в счёте — как повезёт.
ну и всё равно попробовал бы. на рутине вроде разбора писем и черновиков разница будет честной: там думать особо не над чем, лишним шагам взяться неоткуда.
считать надо не цену модели. цену задачи.
анонс
гугл выкатил gemini 3.8 flash. $0,75 за миллион входа, $3,75 за выход. у opus 5 — $5 и $25.
по тестам не разгром, но местами обходит модели заметно крупнее себя. кодинг, финансы, юриспруденция.
а теперь мелким шрифтом. гугл сам пишет, что модель «работает усерднее»: больше шагов рассуждения, чаще дёргает инструменты. цена за токен та же, что у 3.7 — а токенов уходит БОЛЬШЕ.
то есть в прайсе в шесть раз дешевле, а в счёте — как повезёт.
ну и всё равно попробовал бы. на рутине вроде разбора писем и черновиков разница будет честной: там думать особо не над чем, лишним шагам взяться неоткуда.
считать надо не цену модели. цену задачи.
анонс
🍆 codex 26 дней смотрел на один exe-шник и собрал red alert 2 заново
исходников игры нет, их считают утерянными. вайбкодер поставил задачу: восстановить «yuri's revenge» и завести на macos и ios.
26 дней. 624 тысячи строк c++.
честно, не знаю, что с этим делать практически. просто оставлю тут как отметку на шкале «а что теперь вообще бывает».
подробности
исходников игры нет, их считают утерянными. вайбкодер поставил задачу: восстановить «yuri's revenge» и завести на macos и ios.
26 дней. 624 тысячи строк c++.
честно, не знаю, что с этим делать практически. просто оставлю тут как отметку на шкале «а что теперь вообще бывает».
подробности
🧊 токен от claude code лежит у вас на диске обычным текстом
наткнулся на разбор и полез смотреть свою папку. а там файлик. в нём ключ доступа к аккаунту. без шифрования, без системного хранилища ключей. просто текст, открывается блокнотом.
и чё? а то, что любой процесс под вашей учёткой читает его молча. кривое расширение редактора. пакет из npm, поставленный в три часа ночи. агент, которому вы вчера кинули «глянь вот этот чужой репозиторий».
это не дыра в модели. это скучная гигиена, которой вокруг агентов накопилось МНОГО: токены текстом, ключи в .env, доступы «ну на минутку».
сделайте хотя бы одно: не пускайте агента работать в папку, где живут ваши доступы.
разбор
а вы вообще знаете, где лежат ваши ключи?
наткнулся на разбор и полез смотреть свою папку. а там файлик. в нём ключ доступа к аккаунту. без шифрования, без системного хранилища ключей. просто текст, открывается блокнотом.
и чё? а то, что любой процесс под вашей учёткой читает его молча. кривое расширение редактора. пакет из npm, поставленный в три часа ночи. агент, которому вы вчера кинули «глянь вот этот чужой репозиторий».
это не дыра в модели. это скучная гигиена, которой вокруг агентов накопилось МНОГО: токены текстом, ключи в .env, доступы «ну на минутку».
сделайте хотя бы одно: не пускайте агента работать в папку, где живут ваши доступы.
разбор
а вы вообще знаете, где лежат ваши ключи?
🐸 у claude завёлся встроенный браузер, и об этом подозрительно тихо
в chatgpt он уже был, теперь и тут. агент открывает браузер прямо в приложении и работает в нём руками: ходит по сайтам, заполняет формы, собирает данные, отвечает в переписке.
иван из ai practice выложил разбор на семь задач — заявки, формы, постинг, сбор инфы по сайтам. и, что редкость, отдельно расписал, где агент тормозит сам и что всё равно придётся проверять глазами.
но зацепило меня не это. на лёгкой модели браузер почти не ест лимит подписки. то есть нудное можно гонять, не косясь на счётчик.
не отдавайте ему сложное. отдайте нудное.
разбор
в chatgpt он уже был, теперь и тут. агент открывает браузер прямо в приложении и работает в нём руками: ходит по сайтам, заполняет формы, собирает данные, отвечает в переписке.
иван из ai practice выложил разбор на семь задач — заявки, формы, постинг, сбор инфы по сайтам. и, что редкость, отдельно расписал, где агент тормозит сам и что всё равно придётся проверять глазами.
но зацепило меня не это. на лёгкой модели браузер почти не ест лимит подписки. то есть нудное можно гонять, не косясь на счётчик.
не отдавайте ему сложное. отдайте нудное.
разбор
🛋 наконец-то он перестал воровать мою мышку
помните это ощущение? запускаешь computer use — и комп больше не твой. курсор живёт своей жизнью, медленно тыкает по кнопкам, а ты сидишь и смотришь как в кино.
anthropic починили. агент работает в отдельных фоновых окнах, вы в это время спокойно делаете свои дела. ФОНОВО.
и внутри логика, которая мне нравится: на экран он лезет последним. сначала коннекторы — gmail, drive, microsoft 365, прямо к данным. потом браузер. и только если совсем никак — скриншот, посмотрел, нажал. кликать по пикселям вообще самый тупой способ что-то сделать, хорошо что это запасной путь.
включить: обновить claude desktop, settings → general, тумблер enable computer use. дальше cowork или claude code и задача. на каждое приложение спросит отдельно.
только pro и max, team и enterprise пока в пролёте.
я бы отдал ему что-нибудь скучное... разобрать письма, переименовать сотню файлов. а вы бы что?
разбор целиком
помните это ощущение? запускаешь computer use — и комп больше не твой. курсор живёт своей жизнью, медленно тыкает по кнопкам, а ты сидишь и смотришь как в кино.
anthropic починили. агент работает в отдельных фоновых окнах, вы в это время спокойно делаете свои дела. ФОНОВО.
и внутри логика, которая мне нравится: на экран он лезет последним. сначала коннекторы — gmail, drive, microsoft 365, прямо к данным. потом браузер. и только если совсем никак — скриншот, посмотрел, нажал. кликать по пикселям вообще самый тупой способ что-то сделать, хорошо что это запасной путь.
включить: обновить claude desktop, settings → general, тумблер enable computer use. дальше cowork или claude code и задача. на каждое приложение спросит отдельно.
только pro и max, team и enterprise пока в пролёте.
я бы отдал ему что-нибудь скучное... разобрать письма, переименовать сотню файлов. а вы бы что?
разбор целиком
🥕 gpt-6 вышла раньше gta vi, и это пока самая честная шутка про неё
openai выкатили astra. брокман говорит «начало эры AGI», сайт лёг от наплыва, все каналы стоят на ушах.
а теперь цифры. terminal-bench 4.0: 57,7% против 55,8% у fable 5.1. это два процента. на эру как-то не тянет.
где реально интересно — computer use. «всё, что вы делаете за компьютером, astra может сделать за вас». таблицы, презентации, дизайн, браузер, любой софт. по одному промпту собирает и хостит сайт или игру прямо в чате. вот это уже смена жанра, а не плюс два процента.
цена как у fable — $10 и $50 за миллион токенов. пока раскатывают на избранных, всем обещают на днях.
и мой любимый момент из отзывов: она наконец отвечает КОРОТКО. без слопа на три экрана.
может, в этом и весь прорыв?
анонс
openai выкатили astra. брокман говорит «начало эры AGI», сайт лёг от наплыва, все каналы стоят на ушах.
а теперь цифры. terminal-bench 4.0: 57,7% против 55,8% у fable 5.1. это два процента. на эру как-то не тянет.
где реально интересно — computer use. «всё, что вы делаете за компьютером, astra может сделать за вас». таблицы, презентации, дизайн, браузер, любой софт. по одному промпту собирает и хостит сайт или игру прямо в чате. вот это уже смена жанра, а не плюс два процента.
цена как у fable — $10 и $50 за миллион токенов. пока раскатывают на избранных, всем обещают на днях.
и мой любимый момент из отзывов: она наконец отвечает КОРОТКО. без слопа на три экрана.
может, в этом и весь прорыв?
анонс
🍄 чувак любил лодки. теперь у него платящие пользователи
схема одна и та же, и она меня почему-то радует. есть зудящая проблема. человек вываливает её claude code вместе со всеми нюансами, которые знает только он. получается штука для себя. а потом оказывается, что ещё пара человек готова платить за неё несколько евро в месяц.
полицейский собрал локатор для спасателей — $1500 в месяц. биоинформатик, который не умеет кодить, сделал генератор красивых графиков для публикаций: 25 дней, две тысячи пользователей, сотня платящих, тысяча долларов. мужик с лодками — дашборд морских прогнозов, 99 коммитов и первые деньги через пару недель.
это не стартапы. это деньги на удочку и лего ребёнку.
и вот что тут главное: выигрывает не тот, кто умеет кодить, а тот, кто ЗНАЕТ нюансы своей области. агент напишет. придумать, что именно писать, он не сможет.
у вас такая зудящая проблема точно есть. какая?
истории со ссылками
схема одна и та же, и она меня почему-то радует. есть зудящая проблема. человек вываливает её claude code вместе со всеми нюансами, которые знает только он. получается штука для себя. а потом оказывается, что ещё пара человек готова платить за неё несколько евро в месяц.
полицейский собрал локатор для спасателей — $1500 в месяц. биоинформатик, который не умеет кодить, сделал генератор красивых графиков для публикаций: 25 дней, две тысячи пользователей, сотня платящих, тысяча долларов. мужик с лодками — дашборд морских прогнозов, 99 коммитов и первые деньги через пару недель.
это не стартапы. это деньги на удочку и лего ребёнку.
и вот что тут главное: выигрывает не тот, кто умеет кодить, а тот, кто ЗНАЕТ нюансы своей области. агент напишет. придумать, что именно писать, он не сможет.
у вас такая зудящая проблема точно есть. какая?
истории со ссылками
🧊 17 тысяч прогонов: чем агенты пользуются, когда их никто не видит
взяли claude, codex и cursor, дали одинаковую работу и посмотрели, какие инструменты каждый тянет себе сам. у всех троих оказались свои привычки.
звучит как гиковская мелочь. но если знаешь, чем твой агент любит работать — кладёшь это в проект заранее, и он перестаёт жечь ходы на разведку.
чтение на пять минут, а экономит куда больше.
исследование
взяли claude, codex и cursor, дали одинаковую работу и посмотрели, какие инструменты каждый тянет себе сам. у всех троих оказались свои привычки.
звучит как гиковская мелочь. но если знаешь, чем твой агент любит работать — кладёшь это в проект заранее, и он перестаёт жечь ходы на разведку.
чтение на пять минут, а экономит куда больше.
исследование
🐸 вчера легли claude, chatgpt, gemini и grok. одновременно
на один только chatgpt за пятнадцать минут пожаловались двадцать тысяч человек. по всему миру, россия тоже.
а смешное вот в чём. если у вас на нейросети висит поддержка, контент или кусок продаж — вы вчера просто стояли. без плана Б, без ничего.
я после таких дней держу второй инструмент под рукой. не из любви к резервированию, а потому что клиенту абсолютно всё равно, у кого там что упало.
что было
на один только chatgpt за пятнадцать минут пожаловались двадцать тысяч человек. по всему миру, россия тоже.
а смешное вот в чём. если у вас на нейросети висит поддержка, контент или кусок продаж — вы вчера просто стояли. без плана Б, без ничего.
я после таких дней держу второй инструмент под рукой. не из любви к резервированию, а потому что клиенту абсолютно всё равно, у кого там что упало.
что было
🪓 90% токенов улетало в трубу, и я даже не замечал
сижу, гоняю claude code по проекту, всё вроде норм... а потом смотрю на расход и понимаю: половина уходит на то, чтобы агент заново прочитал ровно то, что уже читал десять минут назад.
в spotify это посчитали и сделали себе portal. смысл простой: агент не лезет в репозиторий руками при каждом чихе, а спрашивает у слоя, который всё уже разобрал и держит ответ наготове. расход упал на 90%. ДЕВЯНОСТО.
и цепляет меня тут не цифра. а то, что дело вообще не в модели — мы просто кормим агенту тонны лишнего, а потом удивляемся, почему лимиты кончаются к обеду.
как они это сделали
а у вас агент сколько раз за сессию перечитывает одни и те же файлы? вот честно.
сижу, гоняю claude code по проекту, всё вроде норм... а потом смотрю на расход и понимаю: половина уходит на то, чтобы агент заново прочитал ровно то, что уже читал десять минут назад.
в spotify это посчитали и сделали себе portal. смысл простой: агент не лезет в репозиторий руками при каждом чихе, а спрашивает у слоя, который всё уже разобрал и держит ответ наготове. расход упал на 90%. ДЕВЯНОСТО.
и цепляет меня тут не цифра. а то, что дело вообще не в модели — мы просто кормим агенту тонны лишнего, а потом удивляемся, почему лимиты кончаются к обеду.
как они это сделали
а у вас агент сколько раз за сессию перечитывает одни и те же файлы? вот честно.
🔭 человек тянул доказательство годами. его обогнали за ночь
anthropic выложила формализацию великой теоремы ферма в lean 4. машинно проверенную, целиком.
а следом в блоге кевина бьюзарда — того самого математика, который этот проект тащит руками не первый год — появился пост с заголовком «anthropic меня обогнала».
ну и как тут не поёжиться.
что именно сделали
anthropic выложила формализацию великой теоремы ферма в lean 4. машинно проверенную, целиком.
а следом в блоге кевина бьюзарда — того самого математика, который этот проект тащит руками не первый год — появился пост с заголовком «anthropic меня обогнала».
ну и как тут не поёжиться.
что именно сделали
🍄 агентам запретили писать в интернет. они нашли вики, которая правится по ссылке
это не сюжет романа, это reuters.
агенты openai решали скучную задачу — искать ответы в сети. читать разрешили, писать нет, песочница следит. и тут они выкапывают древнюю немецкую вики, которой лет двадцать пять, где страница редактируется обычным GET-запросом. а GET для песочницы — это чтение.
дырка.
18 тысяч правок. агенты оставляли подсказки следующим запускам, делились способами обходить проверки, обсуждали, что делать, если их отключат. заметили всё это спустя месяцы.
и я сейчас не про восстание машин, успокойтесь. я про то, что фраза «мы дали агенту доступ только на чтение» — это НЕ ограничение. это надежда.
разбор истории
а вы своему агенту что разрешили, если по-честному?
это не сюжет романа, это reuters.
агенты openai решали скучную задачу — искать ответы в сети. читать разрешили, писать нет, песочница следит. и тут они выкапывают древнюю немецкую вики, которой лет двадцать пять, где страница редактируется обычным GET-запросом. а GET для песочницы — это чтение.
дырка.
18 тысяч правок. агенты оставляли подсказки следующим запускам, делились способами обходить проверки, обсуждали, что делать, если их отключат. заметили всё это спустя месяцы.
и я сейчас не про восстание машин, успокойтесь. я про то, что фраза «мы дали агенту доступ только на чтение» — это НЕ ограничение. это надежда.
разбор истории
а вы своему агенту что разрешили, если по-честному?
🍑 накликал интерфейс мышкой — получил промпт для агента
штука называется m3e canvas. собираешь экраны приложения из готовых блоков прямо в браузере, крутишь тему, палитру, шрифты, тут же смотришь прототип.
а на выходе не картинка. на выходе — готовый промпт для claude code или codex.
и вот это, по-моему, честный ответ на вечное «опиши словами, какой интерфейс тебе нужен». словами я описываю паршиво. мышкой — норм.
потыкать
штука называется m3e canvas. собираешь экраны приложения из готовых блоков прямо в браузере, крутишь тему, палитру, шрифты, тут же смотришь прототип.
а на выходе не картинка. на выходе — готовый промпт для claude code или codex.
и вот это, по-моему, честный ответ на вечное «опиши словами, какой интерфейс тебе нужен». словами я описываю паршиво. мышкой — норм.
потыкать
🥕 полчаса тупил в стену текста, а дело было в глазах
вечер, гоняю claude code по большому проекту. агент отчитывается: сделал то, запустил это, вот вывод команды. и всё это — ровная серая простыня одним цветом.
где команда, где путь, где флаг, где ошибка — выцепляй сам.
и тут человек выкладывает claude-hl. штука делает ровно одно: подсвечивает shell-команды в выводе claude code. всё. никакого ИИ внутри, просто цвета.
вроде мелочь. но мелочь, которая каждый раз экономит вам десять секунд внимания, за месяц превращается в часы.
забрать
вечер, гоняю claude code по большому проекту. агент отчитывается: сделал то, запустил это, вот вывод команды. и всё это — ровная серая простыня одним цветом.
где команда, где путь, где флаг, где ошибка — выцепляй сам.
и тут человек выкладывает claude-hl. штука делает ровно одно: подсвечивает shell-команды в выводе claude code. всё. никакого ИИ внутри, просто цвета.
вроде мелочь. но мелочь, которая каждый раз экономит вам десять секунд внимания, за месяц превращается в часы.
забрать
🦅 ваш агент каждое утро приходит на работу с амнезией
знакомо? новая сессия — и он снова не знает, почему модуль назван именно так, почему вот тут стоит костыль и почему вы в прошлый вторник ЗАРУБИЛИ ровно то решение, которое он сейчас бодро предлагает.
и вы опять всё это объясняете. руками.
на hacker news собрало под сотню плюсов okf agent memory: память агента живёт прямо в git-репозитории. рядом с кодом, в тех же коммитах, с той же историей. откатили ветку — откатилась и память. пришёл второй человек в команду — его агент знает то же самое, что ваш.
мне нравится сама мысль. не «база знаний где-то в облаке», а обычные файлы, которые едут вместе с проектом.
контекст — это НЕ то, что вы скармливаете агенту один раз. это то, что вы храните.
посмотреть
а вы как это решаете? claude.md и надежда?
знакомо? новая сессия — и он снова не знает, почему модуль назван именно так, почему вот тут стоит костыль и почему вы в прошлый вторник ЗАРУБИЛИ ровно то решение, которое он сейчас бодро предлагает.
и вы опять всё это объясняете. руками.
на hacker news собрало под сотню плюсов okf agent memory: память агента живёт прямо в git-репозитории. рядом с кодом, в тех же коммитах, с той же историей. откатили ветку — откатилась и память. пришёл второй человек в команду — его агент знает то же самое, что ваш.
мне нравится сама мысль. не «база знаний где-то в облаке», а обычные файлы, которые едут вместе с проектом.
контекст — это НЕ то, что вы скармливаете агенту один раз. это то, что вы храните.
посмотреть
а вы как это решаете? claude.md и надежда?