ivan zakutni
572 subscribers
158 photos
3 videos
1 file
192 links
Авторский канал про инженерию умных систем.
SDD, AI/Human collaboration, инженерное мышление.
Связь: @m0n0x41d
Download Telegram
Привет

Тут доехала до релиза запись подкаста с Александром

мы писали его примерно за неделю до стрима с Родионом, так что по меркам происходящего сейчас это уже голос из далекого далекого прошлого!

Там у меня не было веры в воскрешение Quint Code, поэтому если будете слушать – слушайте помня об этом 🤗

Из других новостей:

Люди пользуются Quint Code: кто-то в первый раз, кто-то, увидев, что оно наконец стало более дружелюбным на фоне прошлых версий, возвращается. И все несут вопросы: кто про онбординг – "а что с ним делать?", кто про внутрянку – "а оно там так, как надо, или руки не дошли доделать?"

Все понятно – нужна нормальная документация с большим количеством примеров использования, с более подробным описанием установки и онбординга.

Почти готово!
А, ой уже готово!

А еще сегодня ближе к ночи будет релиз версии 5.1, сразу с обновленной документацией кучи новых добавлений и исправлений :)
Please open Telegram to view this post
VIEW IN TELEGRAM
17🌭1
Forwarded from Тысяча фичей
63. Системное мышление для инженера.

Как инженеру остаться у кормушки в 2026?

В гостях Иван Закутний @neuralstack автор https://github.com/m0n0x41d/quint-code
--

Авторский тгк Саши @toxic_enterprise
Альтер эго Саши @sashimi_pub
--

🎧 Слушать в Apple Podcasts | Spotify | Яндекс | браузер
19🌭1
🚀 quint-code 5.1.0

Мы строили строили и наконец!

Что там внутри:

Codebase Awareness – квинткод теперь видит ваш проект не как набор файлов, а как структуру модулей. Go, TypeScript, Python, Rust – парсит импорты, строит граф зависимостей, показывает какие модули покрыты решениями, а какие нэт. Может быть полезным. Вы же хотите себе доку для каждого модуля?))) Spec Coverage блин!

Когда код под решением меняется – drift detection поднимает флаг в /q-status. Когда модуль A меняется и от него зависит модуль B – вам тоже об этом должн квинткод сказать.

Cross-Project Recall – решения теперь живут не в репе, а в вашей домашней директории. Фреймите (/q-frame) проблему в проекте B – и вам (вашему агенту, ну в общем) с высокой вероятностью всплывает похожее решение из проекта A, которое вы приняли какое-то время назад. Еще и с пометкой насколько контекст релевантен)))

Зачаточный Decision Integrity – перед записью решения агент теперь запускает adversarial check, я знаю что модели сами себя критикуют плохо, да еще с тем же контекстом, но это лучше чем ничего (этому есть куда расти в будущем).

Note-Decision Dedup – если агент попробуе записать заметку которая дублирует существующее решение то MCP даст по рукам, поймает и скажет "бро, тут эт, уже есть dec-003, может не надо?"

Ну и дока, к новой версии и еще лучше! И там больше деталей, читайте. Например там про то что quint-code еще и проблем-таск-трекер...)

Миграция с 5.0: quint-code init в каждом проекте. Данные сохранятся, база сама переедет в ~/.quint-code/. Подробности там же в доке.

Что дальше? НУ вообще надо делать нормальный Team mode.

Центральный сервер, один бинарь, PostgreSQL или SQLite на выбор, мысли такие.

Архитектура уже заложена. Но это уже следующая и длиннющая серия.

github.com/m0n0x41d/quint-code
127🌭22
Что происходит в репозитории квинткода?

Снаружи выглядит как тишина, было несколько мелких релизов с добавлением C/C++ spec coverage, мелкие и средние багфиксы.

В dev ветке тоже тихо, но это на remote origin)))

В локальном репозитории происходит жуть. Где-то на ~80% готов standalone agent.

ЧТОООО? что это значит? MCP-plugin костыли – press F?

Нет. Ядро quint-code достаточно чистое, оно выживает – мне почти ничего не мешает строить агента вокруг него. Но standalone агент – это вообще другой класс инструмента.

TL;DR: MCP-plugin – это попытка вставить FPF-инструменты в чужой reasoning loop. Standalone agent – это попытка выстроить FPF reasoning loop с собственными инструментами.

***

Фундаментальная проблема MCP-плагин режима: хост-агент (Claude Code, Cursor, кто угодно) контролирует reasoning loop.

Мы можем напихать ему инструменты через MCP или скиллы, но не можем НОРМАЛЬНО контролировать, когда и в каком порядке он их вызывает.

Мы, конечно, можем продолжать работать с дистиллятом-промптом типа "сначала сформулируй проблему, потом исследуй варианты, потом реши", но это не структурное решение, никакого контроля за работой нет. А ведь так хочется рабочий цикл (а точнее лемнискату), где между фазами будет нормальный hand-off задач, артефактов, сигналы не будут теряться.

И вот новый агент отдаёт контроль над reasoning loop естественным образом мне (а я вам).

Тотальный context engineering – я контролирую что, когда и сколько попадает в контекст LLM. Собираю системный промпт на каждой фазе.

Сделал нормальный repo-map через tree-sitter (я вообще не уверен, что Claude Code тащит его под собой, потому что мой агент УЖЕ лучше ориентируется в больших репозиториях, чем Claude Code. Это, конечно, субъективное ощущение – моё и Claude Code. Когда я последнему принёс отчёт о проблеме от нового агента, Claude Code сказал "ого, солидно, я это всё упустил". Да, догфудинг нового агента уже начинается), а значит decision records после имплементации будут не просто про файлы знать, а уже на уровне строк/сущностей в коде.

Потом появится overseer процесс в том или ином виде, который будет по шине агенту "бить по рукам", если он потенциально начнёт ломать "установленные инварианты". Туда же потом приедет LSP.

Компакт, и всё-всё-всё остальное прочее тоже пишем сами. Я не заявляю, что Борис и Ко что-то делают не так, просто цели другие, что ли.

Ну и так далее по списку.

***

Этот мой агент, конечно, целиком successor библиотек charmbracelet – всё у них хорошо (кроме нехватки функциональных возможностей crush 🤣), поэтому интерфейс обещает быть приятным.

Разумеется, я планирую "саксессировать" и на их catwalk – репозитории провайдеров и моделей, поэтому новый агент будет поддерживать всё, что поддерживается и там.

И да, к сожалению, Anthropic всё-таки встал в позу "не юзайте auth токен от Pro/Max подписки". Я до конца не решил, что с этим делать. Возможно, появится какой-то плагин/сайдкар/прокси в опенсорсе (как у opencode), который позволит использовать, возможно, нет.

Одно хорошо – поза OpenAI/Codex в этом вопросе – одобрительная, так что догфудинг уже происходит на 5.4 из codex подписки))

quint-code будет переименован, ибо "Не путайте с языком спецификаций" мне надоело. Но об этом в другой раз.


upd. Ну да, ядро то же остается, артефакты в базу пишутся – значит mcp живой, значит будет оно дружить со всеми вашими другими агентами если пожелаете)))
Please open Telegram to view this post
VIEW IN TELEGRAM
122🌭42
Вы вот вроде работаете над своим проектом, а пощупать его, показать кому-то всё никак не получается?

Эмммм-вэээ-пэээ, ауууу, где же ты?

За последний ~месяц ко мне обратилось три разных человека, из трёх разных стран, с разными проектами. На установочном звонке истории были такие:

- «полгода делаем, но продавать и рынку показать ещё нечего»

- «запустили AI-пайплайн, но слишком много "человеков-в-цикле", хочется постабильнее»

- «команда погибает под текучкой, 4 месяца назад наняли ещё 3 разработчиков – заонбордились, а ситуация качественно не поменялась»


И знаете что?
В каждом проекте, докопавшись до сути, оказалась одна и та же проблема – люди тратили ресурсы (время и экспертизу) не туда.

Кто-то вместо продуктовой системы забуксовал на разработке AI вайбкод пайплайна – и забуксовал на несколько месяцев.
Кто-то не имел элементарного процесса приоритезации задач – боялись даже формировать бэклог.
А кто-то просто боялся признать, что построили не то, что нужно, и теперь надо либо переделывать, либо как-то натягивать цифры.

Причины везде одни – мало внимания и собранности на системе, которую мы строим, и на работе, которая происходит вот «прямо сейчас».
При этом в своих прикладных областях все эти люди – сильные специалисты, вопросов нет.

Серебряной пули-пиллюли тут нет.

Но если попытаться её отлить – я как попугай повторю три слова:

внимание, собранность, экзокортекс.

И да – первые два слова по сути про одно и то же. Это действительно ТАК важно.

***

А что с экзокортексом?

Даже если вы в моменте начинаете замечать проблемы, «отклонения от курса» – вам это мало поможет, если вы это никуда не фиксируете.

Буквально – никуда. Не записал => не подумал => не вспомнишь.

Начните записывать куда угодно – в Obsidian, в description карточки в JIRA / Linear, в Apple Notes, в промпт форму Claude Code, черт возьми, вариантов слишком много!

Ибо если не фиксируете – вы каждый раз думаете одни и те же мысли заново. Зачем? Надо нарабатывать решения проблем)))

---

Если совсем упростить:

нет фиксации – нет накопления понимания
нет накопления – нет нормального развития проекта

(и вы крутитесь на месте.)

***

В случае, когда вы не готовы писать/думать – хотя бы наговаривайте.
Есть можество text-to-speech платных и бесплатных приложений, например Superwhisper.

Главное – чтобы это осталось где-то вне вашей головы.

***

Вашу личную и профессиональную деятельность этот метод изменит драматически.

Проверено неоднократно и не одним человеком! :)

***

А если у вас прямо сейчас что-то горит (или догорает) – пишите в форму или в мне личку.

@m0n0x41d 🌟
Please open Telegram to view this post
VIEW IN TELEGRAM
1159🌭7
дистилляция промптов? Нет, дистилляция скиллов! Это что то новенькое...

Мелкийсофт выкатили пейпер SkillOpt – штуковину, где обучают не модель, а skill-файл агента.

Ну конечно это не дистилляция, а optimization loop вокруг markdown-инструкций. Но направление интересное, я даже глаза не закатывал))))

Элементарное просто – берем замороженного агента, даем ему skill, гоняем на задачах и сохраняем весь роллаут: какие тулзы дергал, где поехал, какой ответ выдал, и тд.

Потом внешняя сильная модель-оптимизатор читает эти следы и предлагает патч (выборочный, весь скилл в кашу переписывать нельзя) к skill-файлу: добавить правило, выкинуть вредную инструкцию, заменить кривой кусок.

такие предложения принимаются и сразу проверяются – если справилось лучше то… применяем изменение в описание скилла.

Цифры бодрые, обещают десятки и десятки процентов улучшения… работы на бенчмарках

Это все дикая молотилка токенов, но кажется что в вертикальных кейсах должно работать норм. сложные системы скиллов (вроде haft) тренировать такой машинкой врядли получится.

Все таки сложные сценарии, измерить результат еще сложнее.

Но если у вас есть понятный AI процесс, который держится на файлике с инструкциями, и результат можно измерить и оценить в табличке – поздравляю, у вас уже есть тренируемая поверхность)))

Если у вас скиллы в проде… я не знаю что сказать 🫪
Скорее это про улучшение всякой harness прикладной истории.
176🌭1
Я первый раз попробовал v0.dev и лучше бы не пробовал.
Название, вообще, очень точное – на выходе у меня получился именно v0 фронтенд, настолько кривой, что отвратительный!
с ним ничего нельзя сделать кроме как выкинуть к чертовой слопобабушке!

Возможно... v0 работает хорошо/лучше с react. Ну мб, но зачем мне реакт? Мне надо vue.
Возможно, подумаете вы, я скормил ему плохой промпт? Но нет, я скормил ему specs из haft которые, на минуточку, формировались почти полторы недели, плюс DESIGN.md и PRODUCT.md выведенные из этих самых specs с помощью impeccable

Да, я редко пишу про прикладные штуки.
Но сейчас я все таки пишу, потому что impaccable это мощь! Сила! Класс! Срочно пробуйте!

В сетапе где у вас есть уже отличные спеки, объясняющие что вы строите (ждите, 8.2.0 haft скоро будет, и я все расскажу, что оно и как и какие спеки вам помогает писать. Да, это байт на лайки), и хороший агент который умеет генерировать изображения и ходить в браузер, смотреть и мучать что он там наделал... получится хорошо.

В моем случае "хороший агент", это codex, в частности – codex app.
Я не знаю насколько хороша интеграция с браузером в codex cli, но апп прямо из коробки хорошо молотит с playwright.
Вообще какое-то время я уже почти не пользуюсь cli агентами как основной средой, все headless и one-shot комманды.
Но об этом тоже в другой раз)))

Итак, ваша формула успеха в agentic фронтенде:

0) крутой агент и крутое окружение (читай Codex App, вам там и терминал, и worktrees, и браузер, и ничего не тормозит давно), impeccable, и shadcn (для vue или реакта, если любите пожирнее). Ставити все это в своей проект и сражаетесь.
1) Думаю что можно начать с голого поля, и собирать design и product "спеки" прямо с impeccable, но я рекомендую подойти серьезнее))
2) Все! Сверху можно добавить для ускорения и мега красоты сниппеты с каких нубудь сайтов вроде vue-bits (для реакта такого добра еще больше), ибо с shadcn не всегда вывозит с первого раза.

Impeccable умеет полировать, оптимизировать и ускорять, там вообще отличный пласт фронтенд мудрости упакован, так что с последних сайтов всякие тяжелые анимации оно успешно переписывает чтобы работало на утюгах.


Ставь:
огонек – если не понял почему я топлю за Codex App и хочешь пояснений
хотдог – если имеешь претензии по поводу отсутствия haft 8.2.0 в релизах
желтый морда с вопросом – если я пишу в блог слишком редко, а надо чаще.
12421🌭11
Привет! В ответ на реакции к посту выше поясняю свою позицию за Codex App 😈

TL;DR: я сфокусировал работу в Codex App, потому что для меня он оказался лучшей – да и вообще наиболее цельной – средой агентской разработки. Я меньше отвлекаюсь/переключаю контекст, лучше контролирую параллельную работу и, что особенно важно, я снова стал гораздо чаще читать (и писать) код, тесты и диффы.

А GPT-модели начиная с 5.5 оказались для меня намного более лучшими инженерными друзьями, чем опус и сказочка.

С месяц назад я выбирал на чем остаться Claude vs ChatGPT (200$). Выбор был сделан в пользу второго. В том числе потому, что FPF последних версий уже не влезает в Claude Desktop.

Кстати, история с Fable случилась буквально в последние дни моей активной подписки на Claude, бгг.

Скажу так – я по CC я не скучаю вообще, вот ни чуточки)

Codex App стал сейчас прям хорош. Работает шустро, GPT-модели не так прожорливы на токены, а компакт контекста просто великолепный!

В нём удобно читать код, комментировать диффы и открывать файлы во внешнем редакторе (у меня это Zed.)
это особенно актуально, потому что сложность моих последних проектов такая, что вообще не читать код, тесты и диффы абсолютно непозволительно.

ремоут сессии были последней фичей что держала меня в CC – я прям много работаю с телефона.

я не знаю что тут еще добавиь, разве этого мало?

Worktrees в один клик?  
сommit-and-push и address comments в гитхабе в пару кликов?  
Пет, который не навязчиво привлекает внимание, когда оно требуется? (open peon в CC меня задрочил до нервного тика)

Терминал под рукой?

Пока писал этот пост, увидел, что ещё и просмотр PR'ов привезли в сайдбар)

По отдельности всё это кажется набором мелких фич, но в том то и прикол, что вместе они убирают огромный слой ручной и полуручной диспетчерезации, как бы не было удобненько в tmux вкладках, но в единой среде с хорошим интерфейсом работать приятнее и проще.

Я долго был под чарами Антропик, но теперь они похоже совсем развеялись.
Антропиковские модели хороши. Особенно хороши они в прозе)

Мне не нужна проза! с прозой мне нравится разбираться самому!!!

Мне нужен peer engineer и удобная среда, в которой я могу думать, пока плюю в потолок, и в которой мне не приходится переключаться по вкладкам как амфетаминовая белка, и тратить столь много человеческой оперативки (которой так мало) на удержание в голове всего этого безобразия

Мне нужна среда в которой можно не терять активные треды и быстро понимать статус каждой активной работы.
Мне нужна среда, в которой релизы не ломают базовый функционал (че там как дела с глитчами сс?), а приносят новые полезные фичи!

вот Codex App всё это даёт.

И ещё кучу приятных вещей: быстрые скриншоты экрана, которые сразу влетают в активный тред, интеграцию с playwright из коробки и браузер с аннотациями, чтобы при разработке фронтендов лучше тягать агента за уши)))

Claude Code многое из этого нормально не даёт, а чего-то из этого в нём вообще не будет в виду ограничений среды.

Конечно, это совсем разные продукты. Я не утверждаю, что GUI в принципе лучше терминала. 

Но для управления несколькими долгоживущими агентскими задачами CLI лично для меня перестал быть самым удобным и эффективным интерфейсом.

Еще мне нравится OpenAI не стремится запирать пользователей внутри одного интерфейса. Лимиты кодекса всё ещё можно использовать через разные другие инструменты – OpenCode, Zed, name your thing – да хоть в собственных не коммерческих ИИ-приложухах, смотришь как авторизация в codex cli работает и делаешь так же)))

Сколько такая политика проживёт – посмотрим, но прямо сейчас это топ.

В конце концов, все сейчас говорят про harness, и вот harness это не про то насколько эффектно агент генерирует код, и не только про автономную молотилку goal десятки часов, но еще и про то, насколько хорошо _человек_ может управлять несколькими потоками работы и при этом сам оставаться внутри инженерного процесса.

И вот это, имхо, Codex App сейчас делает лучше всех остальных тулов.

Ставь огонь если Codex App топ, и желтый морда с вопросом, если не понимаешь зачем читать код.
Please open Telegram to view this post
VIEW IN TELEGRAM
1201110🌭44
5 вещей, которые я хотел бы осознать раньше на пути из эникейщика в инженера

Читайте весь текст => тут <=

1. Проблема, которая кажется технической, часто находится в договорённостях между людьми
2. Архитектуру нельзя выбирать лишь потому, что она стильная-модная или интеллектуально привлекательная
3. Коллекция фреймворков не заменяет развитого мышления
4. Сильные специалисты не компенсируют плохо спроектированную коллективную работу
5. Я слишком поздно научился проверять, существует ли вообще задача, которую собрались решать

***

Перешли коллеге или другу, которому это будет полезно 🙂
2139🌭4
Please open Telegram to view this post
VIEW IN TELEGRAM
355🌭11
Please open Telegram to view this post
VIEW IN TELEGRAM
5863🌭11
да, кстати, там наконец-то вышел Haft v9.

точнее он уже v9.0.2)) Дока тут. В течении какого то времени в доке еще добавится что то вроде work/cool-books для самых маленьких. Но вы можете это не ждать, ставь да пользуйся блин)

История с v9 была примерно такая:

Прямо перед моим закрытым стримом в AI подлодке несколько недель назад в FPF произошла куча изменений.

А до этих изменений я параллельно городил в Haft костыли для pattern retrieval, и вот раз и Анатолий Игоревич Левенчук взял и сделал этот условный базовый retrieval уже внутри самого FPF.

Одновременно оказалось, что извлечение карточек можно имплементировать проще, без псевдо-умных роутеров, которые якобы знают FPF лучше самого FPF))))

Туда же добавляется тот факто, что за последние полтора месяца прошло пять семинаров по FPF. Из них стало понятно много новых ходов, как улучшить Haft – в частности с самых первых семинаров пришел сильный ход на улучшение именно как проектнрй памяти

Теперь Haft стремится помнить не только отдельные решения и заметки, но держит связанный граф проекта: сущности, проблемы, варианты, наши решения, spec sections, evidence, код и отношения между ними.

Это нужно чтобы агент мог зайти через вопрос, файл или символ из кода и поднять нужный кусок этого графа))))

Помогает понять, какие решения рядом, чем они были обоснованы, какие спеки относятся к коду и даже может отловаить если оно подпротухло!

В итоге в v9.0.0 появились:

– source-native FPF Query: concern retrieval, exact lookup и inspect прямо по запеченному в релиз FPF-Spec.md (с этого дня оставание от FPF будет меньше и релизить будем чаще!)

– typed project memory с entities, aliases, relations, provenance и bounded neighborhood вокруг предмета работы (та самая проектная память, но ее надо тестить, welcome!)

– fused graph памяти о проекте, коде и reasoning-артефактах;

– улучшил онбординг и spec sections. Target System и Software System спеки это на самом деле тоже новая фича, в 8 версии они были жутко недоделанные, но сейчас кажется можно пользоваться! В старый или новый проект заходите через скиллы h-onboard / h-spec и haft сам должен проести вас по системному моделированию)

– Haft толстоват в плане интерфейса – в нем 12 независимых скиллов и 12 MCP тулов, но совсем нет никаких обязательных, детерминированных последовательностей как это было когда то дваным давно. На самом деле почти для любого вопроса можно использовать просто зонтичный скилл – h-reason. Если проблема ещё не сформулирована – h-frame. Если есть конкретный сбой и непонятна причина – h-diagnose. Но все скиллы теперь ваш агент может вызывать сам, он разберется)))) короче говоря, я думаю что порог вхождения в haft стал все таки много меньше!

При этом Haft стал потоньше на лишние штуки, полностью выпилены экспериментальные haft run, haft harness (Open-Sleigh и весь Elixir/OTP/BEAM runtime – ничего из этого не надо, полное комодити. Хост агенты прекрасно вызывают суб-агентов и они так же хорошо сами используют haft скилы и тулы).

Haft больше не пытается (и не будет пытаться) быть ещё одним агентом рядом с вашим основным.

Пусть Codex, Claude Code или еще кто нибудь выполняет работу!

Задача Haft – помнить, почему эта работа вообще делается, что было решено раньше, где это живёт в коде и на каких уликах оно держится.

***

Я не удивлюсь если там есть баги, ибо я с haft имею ноль шекелей, делалось там дофига, тестить там тоже дофига,
Тем не менее догфуддинг и еще N больших и средних проектов новая версия пережила, в том числе greenfield, поэтому релиз больше откладывать смысла нет.

В случае нахождения любых ошибок, пожеланий и предложений, вы знаете куда они идти – принимаются в порядке записи по талонам в github issue.

Всем добра ☺️
Please open Telegram to view this post
VIEW IN TELEGRAM
2143🌭1
Лучший harness — это вы и ваши AI-агенты

harness – еще одно новояз словечко которое полностью вошло в ментальность и звучит из каждого утюга.

Первоклассный зонтичный термин с эталонным фан аутом – вот говорит кто-то harness, и черт его знает что там – набор скиллов? Мега AGENTS.md? RFC? Кастомный Pi? Или другой OpenCode на стероидах? MCP сервер? Все вместе?
Каждый раз как в первый раз в первый класс))

Приглашаю вас со мной сделать zoom-out за чашкой кофе и вспомнить арку про Augmented Intelligence в свежем письме.

Прошло уже больше года с той заметки, и imho – в этом мета-моменте не поменялось вообще ничего, хотя AI и стал намного умнее.

Почитал сам – дай почитать другому :)
2621