Контент!
Я тут работу меняю, так что пока продолжу развлекаться вольной философией и безудержным коммитингом в
Надо чего-нибудь выдать про эффект пятилетки за три дня и те чудеса эффективности, которые даёт волшебная кнопочка "Claude! Do something! "
Чтоб быть в тренде, так сказать
Одна из трансформирующих инженерное мышление вещей в моём всё уплотняющемся взаимодействии с ИИ - недавно осозналось - насколько много обвязочного кода можно по-быстрому нагенерить, поиграть с ним и без зазрения совести за собой подтереть.
Конкретный кейс:
В пресловутом sgr задумал я поменять протокол стриминга. Для того чтобы что-то менять нужно сначала понять, как модельки присылают кусочки thinking, content, tool calling и ещё невесть чего.
А потом позакидывать всякие ситуации на предмет читаемости разными приëмниками + инкапсуляции,конченных конечных символов
Любое изменение протокола требовало прогона нескольких объемных запросов к разным ллмкам и просмотр их вывода
Раньше это бы решалось самозабвенным прожиганием токенов каждый раз, когда надо было отследить результат
Сейчас же это потребовало небольшой песочницы, в ходе которой сначала навайбкодилось сохранение всех эвентов со стримов llm, потом их рестриминг наружу с некоторой внутренней реорганизацией под реалии моих изменений протокола
Поднимаем апишку и вуаля! Можно гонять хоть после каждой запятой
Кейс2:
Когда надо было засунуть в БД пару миллионов записей бинарных данных и посмотреть что произойдёт.
В общем случае проще было бы покопаться а статейках и выудить похожий на правду бенч
Фокус в том, что в обычной ситуации мой ленивый мозг на полуавтомате отбрасывает подобные решения как неперспективные:
- Занимают день-два.
- В скоуп задачи не входят
- Писать их неблагодарно.
- И вообще противно
- И выглядят страшно
- Переиспользовать не получится
Ну нахер
В отличие от вайбкодинга, например, фронта - когда направленно ожидаешь за часик получить некоторое визуальное чудо - эти возможности не всплывают как крутые опции, а всё ещё происходят мимо в режиме автофильтра
Я тут работу меняю, так что пока продолжу развлекаться вольной философией и безудержным коммитингом в
sgr-agent-coreНадо чего-нибудь выдать про эффект пятилетки за три дня и те чудеса эффективности, которые даёт волшебная кнопочка "Claude! Do something! "
Чтоб быть в тренде, так сказать
Одна из трансформирующих инженерное мышление вещей в моём всё уплотняющемся взаимодействии с ИИ - недавно осозналось - насколько много обвязочного кода можно по-быстрому нагенерить, поиграть с ним и без зазрения совести за собой подтереть.
Конкретный кейс:
В пресловутом sgr задумал я поменять протокол стриминга. Для того чтобы что-то менять нужно сначала понять, как модельки присылают кусочки thinking, content, tool calling и ещё невесть чего.
А потом позакидывать всякие ситуации на предмет читаемости разными приëмниками + инкапсуляции,
Любое изменение протокола требовало прогона нескольких объемных запросов к разным ллмкам и просмотр их вывода
Раньше это бы решалось самозабвенным прожиганием токенов каждый раз, когда надо было отследить результат
Сейчас же это потребовало небольшой песочницы, в ходе которой сначала навайбкодилось сохранение всех эвентов со стримов llm, потом их рестриминг наружу с некоторой внутренней реорганизацией под реалии моих изменений протокола
Поднимаем апишку и вуаля! Можно гонять хоть после каждой запятой
Кейс2:
Когда надо было засунуть в БД пару миллионов записей бинарных данных и посмотреть что произойдёт.
В общем случае проще было бы покопаться а статейках и выудить похожий на правду бенч
Фокус в том, что в обычной ситуации мой ленивый мозг на полуавтомате отбрасывает подобные решения как неперспективные:
- Занимают день-два.
- В скоуп задачи не входят
- Писать их неблагодарно.
- И вообще противно
- И выглядят страшно
- Переиспользовать не получится
Ну нахер
В отличие от вайбкодинга, например, фронта - когда направленно ожидаешь за часик получить некоторое визуальное чудо - эти возможности не всплывают как крутые опции, а всё ещё происходят мимо в режиме автофильтра
🕊6👍1
> Общаешься со знакомой-ресёрчером.
> Осознаёте, что оперируете сходными определениями, но они как-то между собой не бьются
> Разбираетесь
*> делюсь =)
https://www.linkedin.com/pulse/least-3-ralphs-irina-nosal-trczf/
> Осознаёте, что оперируете сходными определениями, но они как-то между собой не бьются
> Разбираетесь
*> делюсь =)
https://www.linkedin.com/pulse/least-3-ralphs-irina-nosal-trczf/
Linkedin
There are at least 3 Ralphs
I started reading about Ralph loop because I thought it was one specific agent architecture. Then I had one of those annoying moments where the more I read, the less precise the term became.
👍5🤝2
Ну и активностей сегодня
По примерным подсчётам, большинство из горячо мной любимой публики должно было видеть это сообщение уже 2-3 раза.
Как раз думал, как бы прикольно вкинуть, что я теперь аффилирован с этой командой, но после такого заявления что-то ещё добавлять - только портить
П.с. А не, есть одна штука: Куда бы я не пришёл всё вокруг само превращается в RnD 😅
По примерным подсчётам, большинство из горячо мной любимой публики должно было видеть это сообщение уже 2-3 раза.
Как раз думал, как бы прикольно вкинуть, что я теперь аффилирован с этой командой, но после такого заявления что-то ещё добавлять - только портить
П.с. А не, есть одна штука: Куда бы я не пришёл всё вокруг само превращается в RnD 😅
👍3🔥3❤2
Forwarded from _rnd
Раньше канал назывался red_mad_dev.
Теперь это _rnd — публичный блог практики R&D red_mad_robot.
Это рабочая площадка для инженеров и ресёрчеров. Здесь будут наши мысли, эксперименты, короткие и длинные технические разборы, ссылки на научные статьи и git-репозитории.
Про что будем писать:
• какие гипотезы тестируем и какие результаты получаем
• какие архитектурные решения принимаем и почему
• где ошибаемся и что это меняет
• как исследования превращаются в прикладной AI
• что происходит в индустрии и что об этом думаем
Если вам интересны reasoning-архитектуры, RAG-системы, агентные пайплайны, LLM-инфраструктура и реальный продакшн AI — вы в правильном месте.
Поехали
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4👍3🕊3
https://t.me/sgragentcore/8
Вжуух!
Всего пара месяцев вечерочков после работы и мы это сделали
Я почти морально готов приближаться к 1.0.0
Вжуух!
Всего пара месяцев вечерочков после работы и мы это сделали
Я почти морально готов приближаться к 1.0.0
Telegram
SGR Agent Core
SGR Agent Core 0.7.0
Кратенько и по порядку, в этом релизе:
0️⃣ В документацию добавили страницу Highlights.
1️⃣ В ядро доехал долгострой RunCommandTool, причём не просто "запусти команду", а с разделением на safe и unsafe режимы, workspace-настройками…
Кратенько и по порядку, в этом релизе:
0️⃣ В документацию добавили страницу Highlights.
1️⃣ В ядро доехал долгострой RunCommandTool, причём не просто "запусти команду", а с разделением на safe и unsafe режимы, workspace-настройками…
🔥7🎉5
График красивый, а ситуация страшная.
Ну давайте рассматривать
Мой стиль сейчас ближе к coding with ai с production уклоном, где я всё ещё уделяю внимание коду. Нет особо мотивации предельно ускоряться и проверять какие-то гениальные рыночные идеи (Обычно у меня их нет, а если и появляются, всегда можно сделегировать в сторону Валеры)
Как заядлому сквошеру коммитов и вообще любителю поработать день-два и выкатить мини MR +1000-400 наверн сложно было ожидать каких-то бьющих рекорды циферок. Тем не менее, что-то становится понятнее:
- 2020-2022 моя типичная деятельность как усреднённого разработчика с некоторым уклоном в ресёрч.
У меня есть некоторое мнение, что комп чуть новее этой эпохи и сохранились далеко не все репо. По ощущениям я тогда работал активнее
- 2023 я становлюсь достаточно крутым чтобы успевать и там и тут, появляются сайд проекты/стартапушки с меньшим количеством обязательств, диаграммок и сопровождения -> производительность на графике растёт
- конец 2023-2024 я полноценно перехожу в район team/tech lead позиции, по сути из практического кода остаются только сайды
-2025 всё ещё остаюсь кем-то вроде бизнес кабанчика. Метаюсь-вопросики обкекиваю в виде основной деятельности. В первой половине 2025, как можно видеть, меня операционка прижала прям плотно
- Бодрый столбик в 77 коммитов в 2025 ознаменовал появление Cursor в его пригодной для моей работы форме. Вся дальнейшая активность на графике поддерживается исключительно на кодинг агентских примочках и некотором возросшем ощущении комфорта от работы в целом
Ну давайте рассматривать
Мой стиль сейчас ближе к coding with ai с production уклоном, где я всё ещё уделяю внимание коду. Нет особо мотивации предельно ускоряться и проверять какие-то гениальные рыночные идеи (Обычно у меня их нет, а если и появляются, всегда можно сделегировать в сторону Валеры)
Как заядлому сквошеру коммитов и вообще любителю поработать день-два и выкатить мини MR +1000-400 наверн сложно было ожидать каких-то бьющих рекорды циферок. Тем не менее, что-то становится понятнее:
- 2020-2022 моя типичная деятельность как усреднённого разработчика с некоторым уклоном в ресёрч.
У меня есть некоторое мнение, что комп чуть новее этой эпохи и сохранились далеко не все репо. По ощущениям я тогда работал активнее
- 2023 я становлюсь достаточно крутым чтобы успевать и там и тут, появляются сайд проекты/стартапушки с меньшим количеством обязательств, диаграммок и сопровождения -> производительность на графике растёт
- конец 2023-2024 я полноценно перехожу в район team/tech lead позиции, по сути из практического кода остаются только сайды
-2025 всё ещё остаюсь кем-то вроде бизнес кабанчика. Метаюсь-вопросики обкекиваю в виде основной деятельности. В первой половине 2025, как можно видеть, меня операционка прижала прям плотно
- Бодрый столбик в 77 коммитов в 2025 ознаменовал появление Cursor в его пригодной для моей работы форме. Вся дальнейшая активность на графике поддерживается исключительно на кодинг агентских примочках и некотором возросшем ощущении комфорта от работы в целом
❤🔥7🕊2
Так можно было?!
Непроизвольно впечатлился возможностям современной индустрии когда залетал в репо https://github.com/openai/symphony для вдохновения
И это же... гениально! Можно не выкладывать систему/код, выложить описание, спеки и приписку "Закиньте в вашего агента, он разберётся"
Если б рядом не лежал эликсирный прототипчик, я б искренне отнёс это к некоторой форме современного айтишного перфоманса
Непроизвольно впечатлился возможностям современной индустрии когда залетал в репо https://github.com/openai/symphony для вдохновения
И это же... гениально! Можно не выкладывать систему/код, выложить описание, спеки и приписку "Закиньте в вашего агента, он разберётся"
Если б рядом не лежал эликсирный прототипчик, я б искренне отнёс это к некоторой форме современного айтишного перфоманса
👍2🤯2🤣1
Media is too big
VIEW IN TELEGRAM
Что-то про разработку агентами aaand some flow
Сегодня на повестке:
Я хз как у вас, но у меня дико не хватает дисциплины выдерживать качественный ритм при фул-агентной разработке (это когда код в глаза не видишь). Рано или поздно ловишь себя в моменте, что либо устаревают описания, либо тесты, либо вместо генерации кода начинает происходить казино.
Привычный классический чатик слишком плоский. К предыдущим этапам работы над задачей сложно вернуться + какие-то существенные части/инсайты теряются в недрах истории и приходится их сгружать куда-либо. А потом искать, в какую из md ты это сгрузил и насколько оно актуально
Ну и в общем и целом формулируется это ~
Притом, думаю, у каждого практикующего спеца уже начинает собираться некоторая библиотечка излюбленных скиллов/rules/подходов, как добиться более надлежащего состояния проекта. И это тоже как-то интуитивно хочется переиспользовать как уже родное и рабочеев этом чуждом и сломанном мире
Вот из таких мыслей за пару вечерков и родилось это чудо как на демковидосе.
- Доска. Ибо двигать таски интуитивно понятно + предполагает совместную работу в перспективе
- Таска = feature в более бизнесовом её понимании. У feature обычно есть документация, контекст, скоуп затрагиваемых изменений, реализация и т.д.
- workflows шаблончики - по сути положенные на бумагу описания процессов именно под мои личные потребности (впрочем в демке пока чисто загенеренные примерчики)
- Работа над таской происходит не в едином флоу чатика, а в виде пайпа нескольких этапов, которые выполняют разные сфокусированные агенты. К каждому из этапов можно вернуться, проверить доработать.
- Отдельные консольки чтоб посмотреть более подробный лог и объяснить, что конкретно сделано не так
- Не все таски требуют одинакового объёма проработки. Этапы опциональны и настраиваемы
- git задача = выполнение в отдельном worktree + автокоммит при перетягивании в Done
Как итог
0) плодишь шаблончики под все свои запросы,
2) чувствуешь себя особенно ленивым сегодня
3) закидываешь монструозный воркфлоу, закидываешь двухсловный булшит уровня "хочу чтоб было красиво",
4) система сама разбирается как:
Если что-то не нравится - пробегаешь взглядом контекст и вмешиваешься в любой из этапов
p.s.: в изначальном видосике у меня был двенадцатиминутный подкаст с подобными же рассуждениями, но я решил пожалеть почти всех и немного ускорил. А судорожные дёргания мышкой остались. Увы
Сегодня на повестке:
Я хз как у вас, но у меня дико не хватает дисциплины выдерживать качественный ритм при фул-агентной разработке (это когда код в глаза не видишь). Рано или поздно ловишь себя в моменте, что либо устаревают описания, либо тесты, либо вместо генерации кода начинает происходить казино.
Привычный классический чатик слишком плоский. К предыдущим этапам работы над задачей сложно вернуться + какие-то существенные части/инсайты теряются в недрах истории и приходится их сгружать куда-либо. А потом искать, в какую из md ты это сгрузил и насколько оно актуально
Ну и в общем и целом формулируется это ~
"Больно/лень держать в голове весь контекст предполагаемых изменений"
Притом, думаю, у каждого практикующего спеца уже начинает собираться некоторая библиотечка излюбленных скиллов/rules/подходов, как добиться более надлежащего состояния проекта. И это тоже как-то интуитивно хочется переиспользовать как уже родное и рабочее
Вот из таких мыслей за пару вечерков и родилось это чудо как на демковидосе.
- Доска. Ибо двигать таски интуитивно понятно + предполагает совместную работу в перспективе
- Таска = feature в более бизнесовом её понимании. У feature обычно есть документация, контекст, скоуп затрагиваемых изменений, реализация и т.д.
- workflows шаблончики - по сути положенные на бумагу описания процессов именно под мои личные потребности (впрочем в демке пока чисто загенеренные примерчики)
- Работа над таской происходит не в едином флоу чатика, а в виде пайпа нескольких этапов, которые выполняют разные сфокусированные агенты. К каждому из этапов можно вернуться, проверить доработать.
- Отдельные консольки чтоб посмотреть более подробный лог и объяснить, что конкретно сделано не так
- Не все таски требуют одинакового объёма проработки. Этапы опциональны и настраиваемы
- git задача = выполнение в отдельном worktree + автокоммит при перетягивании в Done
Как итог
0) плодишь шаблончики под все свои запросы,
2) чувствуешь себя особенно ленивым сегодня
3) закидываешь монструозный воркфлоу, закидываешь двухсловный булшит уровня "хочу чтоб было красиво",
4) система сама разбирается как:
до тебя докопаться за уточнениями -> свериться с общей архитектурой -> составить развёрнутое ТЗ -> написать превью тесты -> написать реализацию -> прогнать тесты, провести итерацию фиксов -> провести ревью -> скорректировать документацию -> подготовиться на деплой -> сохранить отчёт и changelog -> помёржитьсяЕсли что-то не нравится - пробегаешь взглядом контекст и вмешиваешься в любой из этапов
p.s.: в изначальном видосике у меня был двенадцатиминутный подкаст с подобными же рассуждениями, но я решил пожалеть почти всех и немного ускорил. А судорожные дёргания мышкой остались. Увы
🔥6👏2
Циклы погонщиков агентных циклов
Не знаете, куда деть 16 часов в день? Посмотрите на меня во время маниакально-творческой стадии!
И никогда так не повторяйте
Познаю все прелести работы 2 через 2 в течение дня.
Писать код без AI я ещё как-то могу, но вот когда работа системы построена на тех же драгоценных токенах - происходит полный отстой. Весь объём сжигается ещё и на прогоне основных сценариев + нового функционала за первых 1.5 часа с кулдауном в 4...
Сидишь, теребишь почти как надо запроганную тасочку и думаешь, не купить ли ещё пару подписок, чтоб наверняка. Потом вспоминается, что есть ещё основная работа, и вопрос куда деть оставшееся время отпадает сам собой.
К третьему дню спонтанного интенсива для сохранения моральной и рабочей гигиены разделил своё рабочее место на два:
У себя на основном железе занимаюсь исключительно код-задачами в режиме бешенного сурка под кофеином
А созвонно-ресёрческая часть в гостиной с ноута - под пледиком и с закусочками
Не знаете, куда деть 16 часов в день? Посмотрите на меня во время маниакально-творческой стадии!
Познаю все прелести работы 2 через 2 в течение дня.
Писать код без AI я ещё как-то могу, но вот когда работа системы построена на тех же драгоценных токенах - происходит полный отстой. Весь объём сжигается ещё и на прогоне основных сценариев + нового функционала за первых 1.5 часа с кулдауном в 4...
Сидишь, теребишь почти как надо запроганную тасочку и думаешь, не купить ли ещё пару подписок, чтоб наверняка. Потом вспоминается, что есть ещё основная работа, и вопрос куда деть оставшееся время отпадает сам собой.
К третьему дню спонтанного интенсива для сохранения моральной и рабочей гигиены разделил своё рабочее место на два:
У себя на основном железе занимаюсь исключительно код-задачами в режиме бешенного сурка под кофеином
А созвонно-ресёрческая часть в гостиной с ноута - под пледиком и с закусочками
😢3🕊2😁1
Когда хотел почекать идею но немного увлёкся
Итак, VroooomFlow
код тут
\ /
\/
Репо: https://github.com/virrius/VroooomFlow
Почему? Потому что вы двигайте тасочку, а агенты делают vrooom
С исходными мыслями стоит ознакомиться туть. И вот мы здесь
Проблематика:
(1) Выдерживать дисциплину вайбкодинга не просто. Мой опыт показывает, что проекты на дистанции превращаются в сложноконтролируемого франкенштейна, затраты на развитие растут, темпы - снижаются
Я верю и исследую, что вайбкодить можно стабильно и прогнозируемо
(2) Совместная/командная разработка в формате вайбкодинга - сложна. Комплексность и темп локальных изменений каждого контрибьютора осложняет контроль версий
(3) Порог входа в разработку даже с агентами требует некоторого технического бэкграунда.
Простые фичи должны быть доступнее
(4) Уже сейчас выделяются паттерны, свойственные агентной разработке, которые можно автоматизировать
(5) Текущий вайбкодинг сфокусирован, внезапно, на код.
В то время как по моим личным суждениям декларативный контекст: ТЗ, проектная документация, валидационные правила должны иметь первоочередное значение. Особенно когда мы отказываемся от владения кодбазой
Ещё раз о системе:
Вариация канбан доски, работающая над кодовой базой. Предоставляет интерфейс для коллаборативного развития проекта:
- Создаётся задача. Опционально в отдельном git worktree
- Для задачи планируются этапы, выраженные workflow=шаблонами/best practices/промпт-инструкциями/контекстом этапа
- Workflow можно добавить собственные на уровне проекта под потребности команды. Они же являются фиксацией практик работы команды
- Каждый этап выполняется отдельным агентом в интерактивном режиме. В рамках работы над задачей формируется общий контекст для задачи
- По готовности изменения задачи фиксируются в done
Из доп фичей:
- роли/доступы/комментарии - прочие базовые возможности для совместной работы и коммуникации
- Задачи сохраняет собственную спецификацию и подробный лог работы агентов в годном для анализа виде
- закинуто несколько примеров workflows
- визуальный аналог git tree с историей разработки по задачам
- два вида задач: Работающая глобально над репозиторием и работающая в отдельном worktree
Идеальный сценарий использования:
Ставим воркфлоу для примера
разворачиваем над сырцами dev стенда с live-reload -> фиксируем workflow ->отдаём в команду -> даже самый далёкий от ИИ менеджер сможет накатить и мгновенно потрогать изменение, если сформулирует свой запрос. остальное система сделает сама (формулировать запрос тоже поможет)
Смотрим, как на задачу подвинуть кнопку влево жжётся 80к токенов
Итак, VroooomFlow
код тут
\/
Репо: https://github.com/virrius/VroooomFlow
Почему? Потому что вы двигайте тасочку, а агенты делают vrooom
!!! Проект на стадии демки концепций! Он функционален в базе, но не слишком красивый и удобный. Предназначается для посмотреть-вдохновиться-что-то понять. Использовать на практике пока можно но сложно
С исходными мыслями стоит ознакомиться туть. И вот мы здесь
Проблематика:
(1) Выдерживать дисциплину вайбкодинга не просто. Мой опыт показывает, что проекты на дистанции превращаются в сложноконтролируемого франкенштейна, затраты на развитие растут, темпы - снижаются
Я верю и исследую, что вайбкодить можно стабильно и прогнозируемо
(2) Совместная/командная разработка в формате вайбкодинга - сложна. Комплексность и темп локальных изменений каждого контрибьютора осложняет контроль версий
(3) Порог входа в разработку даже с агентами требует некоторого технического бэкграунда.
Простые фичи должны быть доступнее
(4) Уже сейчас выделяются паттерны, свойственные агентной разработке, которые можно автоматизировать
(5) Текущий вайбкодинг сфокусирован, внезапно, на код.
В то время как по моим личным суждениям декларативный контекст: ТЗ, проектная документация, валидационные правила должны иметь первоочередное значение. Особенно когда мы отказываемся от владения кодбазой
Ещё раз о системе:
Вариация канбан доски, работающая над кодовой базой. Предоставляет интерфейс для коллаборативного развития проекта:
- Создаётся задача. Опционально в отдельном git worktree
- Для задачи планируются этапы, выраженные workflow=шаблонами/best practices/промпт-инструкциями/контекстом этапа
- Workflow можно добавить собственные на уровне проекта под потребности команды. Они же являются фиксацией практик работы команды
- Каждый этап выполняется отдельным агентом в интерактивном режиме. В рамках работы над задачей формируется общий контекст для задачи
- По готовности изменения задачи фиксируются в done
Из доп фичей:
- роли/доступы/комментарии - прочие базовые возможности для совместной работы и коммуникации
- Задачи сохраняет собственную спецификацию и подробный лог работы агентов в годном для анализа виде
- закинуто несколько примеров workflows
- визуальный аналог git tree с историей разработки по задачам
- два вида задач: Работающая глобально над репозиторием и работающая в отдельном worktree
Идеальный сценарий использования:
Ставим воркфлоу для примера
explore request->plan task->write tdd tests->implement->review->tests->update specsразворачиваем над сырцами dev стенда с live-reload -> фиксируем workflow ->отдаём в команду -> даже самый далёкий от ИИ менеджер сможет накатить и мгновенно потрогать изменение, если сформулирует свой запрос. остальное система сделает сама (формулировать запрос тоже поможет)
🔥5🥴2
ITипичные аспекты Артёма
2025 всё ещё остаюсь кем-то вроде бизнес кабанчика
This media is not supported in your browser
VIEW IN TELEGRAM
@vakovalskii пытается замотивировать меня развернуть openclaw 😏
Please open Telegram to view this post
VIEW IN TELEGRAM
😁14🤣4❤2👀2👍1
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥12👍6❤2🕊2😁1