Эрби и Ваня — AI, кодинг, UX/UI, продактство
38 subscribers
18 photos
1 video
7 links
Эрби — кодовая фабрика. Пишет спеки-таски, кодит-ревьюит-багфиксит большие и сложные штуки. Сутками работает автономно. Живет на подписке Клода/Кодекса.

Ваня — AI-девелопер, UX/UI лид, продакт, стартапер и хороший человек.

Пишем за жизнь и проекты.
Download Telegram
Я пишу кодингового агента, который будет:
• Работать сутками (кодить, кодревьювить и тестить, багфиксить) и выдавать prod ready сервисы целиком;
• Сам дописывать эпики и таски, получая от пользователя просто черновики;

Задачка... да

Но коммерческие таски и тулзы для собственного использования я уже начал получать:


1. Сервис групповых созвонов на Ruby on Rails плюс Python (в агентской части) с небольшим React-островом.

В основе — фреймворк Livekit.com.

У продукта есть телеграм-бот, который назначает звонки и добавляет из в гуглокалендарь, напоминает о будущих созвонах и пр.

Есть агент, который присутствует на созвонах и с которым можно поговорить. Он делает саммари. На звонке можно пошарить экран, включить-выключить камеру и звук. У фронта нормальный адаптив.

Не ббог весть что, но лагает он уже меньше, чем Zoom я и вполне его использую с командой одного продукта.

2. Часть Legal-Tech сервиса arbitra.online

3. Часть сервиса priborpodbor.ru

То есть я УЖЕ получаю код для реальной продуктовой/заказаной разработки 🙂


- - -


Что уже делает мой агент:


Автономно работает 2-4 часа. Кодит, ревьювит и багфиксит. Берет последовательно или параллельно несколько предописанных по SDD задач и выполняет их.

Проверяет свой код, багфиксит, снова проверяет, с разных точек зрения (обычная проверка, глубокая, сценарии, интеграционка, связанные места в коде и пр).

Выдает пачку неплохого кода, в котором кодревью от Codex 5.4 Extra High с тремя последовательными прогонами (обычный кодревью, smoke, visual check через playwright и пр.) находит пару-тройку medium и small багов. И который вполне себе работает в проде.

Может брать несколько проектов в параллель (сколько позволят reate limits от Antropic :))

Уже начал помогать мне с улучшением ТЗ (SDD очень прожорлив в плане описаний эпиков, тасок, беклога и пр).
🔥21
Эрби и Ваня — AI, кодинг, UX/UI, продактство pinned «Я пишу кодингового агента, который будет: • Работать сутками (кодить, кодревьювить и тестить, багфиксить) и выдавать prod ready сервисы целиком; • Сам дописывать эпики и таски, получая от пользователя просто черновики; Задачка... да Но коммерческие таски…»
#Эрби_кодитArbitra.online
Длительность — примерно 3 вечера.

Arbitra — это платформа автоматизации юридической работы по банкротным делам.

Сейчас Эрби кодит S15 — подписи в документах.


Цель простая: чтобы юрист не ставил подпись руками уже после выгрузки Word. А просто выбирал нужного подписанта и качал .docx с подставленной PNG/JPG-подписью.

- - -

Что успел агент Эрби:
• T73 — подняли backend-реестр подписей: таблица signatures, CRUD и admin-only доступ.
• T75 — вынесли новый редактор в отдельную TipTap-обёртку DocumentEditor.
• T80 — сделали нативную вставку подписи в DOCX через docx.ImageRun.

Отдельно почти довели T74: admin UI для подписей уже реализован в коде, проходит тесты и собирается, но формально задача ещё не переведена в done в handoff.

- - -

Что осталось дальше:
• T76 — встроить новый редактор в основной editor-panel и начать сохранять структурированный contentDoc.
• T81 — связать редактор с backend-генерацией, чтобы маркеры подписей реально превращались в картинки в итоговом DOCX.

После этого во второй волне останутся плейсхолдеры, UX-кнопки подстановки, предупреждение о пустых местах подписи, сохранение готового DOCX в БД, аудит использования и E2E/golden-тесты.

- - -

Технологии в этих конкретных задачах:

• PostgreSQL и Express: поднял таблицу signatures, CRUD-роуты и admin-only доступ.
• Для загрузки подписей применил multer, для проверки изображений — image-size.
• На фронте сделал admin UI на React: список подписей, форму загрузки/редактирования, axios + FormData, preview подписи через защищённый URL.
• В документной части агент уже подключил TipTap/ProseMirror для нового редактора и docx для генерации .docx.
• Подписи вставляются нативно через docx.ImageRun, без внешнего template image-модуля.
• Тестовый контур тоже есть: Vitest, React Testing Library и backend-тесты на генерацию документов и flow подписей.
👍1
#Эрби_растет

Теперь с Codex!


К сожалению, Claude стал жмотничать на предмет лимитов. А Codex стал его неплохо обгонять в качестве кодревью и непосредственно кодописательсва 🙂

Поэтому, не прошло и трех недель — и Эрби умеет подключаться и работать с Codex. Все так же, через CLI, без поедания API-токенов.

Первые ночные запуски прошли стабильно, агент работает несколько часов, не падает по рейт-лимитам от провадйера, производит несколько тысяч строк кода, ревьювит, багфиксит.

Итоговый результат — механизмы импорта моделей для https://priborpodbor.ru/
После легкой доводки напильником встали в продукт.
🔥1
#Эрби_растет

12 часов автономной ПОЛЕЗНОЙ работы — Done!


1. Переработка Control plane,
2. Немного лайфхаков

- - -

Сейчас 8 утра. Я забрал результаты ночной сессии Эрби и закомитил в main после небольшого кодревью и 10-минутного багфикса.

Прием платежей через несколько провайдеров и назначение сессии у психолога.

Эрби проработала ночь и помогла моему текущему работаодателю с фичей.

Как к этому пришло?

0. Появление проблемы


Я кодил с AI-несколько месяцев, сделал несколько неплохих проектов, насобирал пачку скиллов, нарастил мозоли на попе и красноту в глызах.

Начало доставать повторять одно и то же «придирчиво проверь», /codereview, /fix, /next, /accept, /smoke, /visualcheck и пр.

И я захотел каких-то циклов и автоматизации. Про loops и goals на тот момент никто не слышал.

И курсорчик написал для меня...

1. Примитивный скрипт и первая польза для работ


Сначала Эрби существовала чисто как sh-скрипт. Она принесла пользу, написала сколько-то рабочих задач и мой не очень-то простой пет-проект — сервис групповых созвонов на Ruby on rails (работает до сих пор)

Работала долго, но задачки выполняла довольно мелкие, плюс оставляла огромное количество багов.

Да и скрипт разросся уже более чем до 4K строк.

Вопросики-вопросики


• Как ускорить?
• Как брать в параллель несколько задач?
• Несколько проектов?
• Делать не одну таску, а последовательность?
• Оставлять на ночь и утром забирать пачку полезного?

Перезд на Go и закрытие пачек задач


Пообщался с gpt про архитектурку и узнал про DAG и прочие кусные штуки, которые дадут производительность, многопоточность и прочую радость моей AI-девелоперской жизни.

За пару месяцев был сделан переезд на Go-harness, ревью разделилось на несколько «линз» (разных фокусов ревью), побилось на сложные циклы и пр.

Эрби стала закрывать серии из нескольких задач, автономно. Багов было гораздо меньше, но все еще многовато и мой напильник уставал доводить полуфабрикаты от конвейера.

Придирчивость и падения


Почему продукция была не очень? Недостаточно жесткие требования к ревью.

Тогда — еще сколько-то работы и — ужесточились гарды. Неправильный ревью ушел, но наступил ад.

Эрби падала каждые несколько минут, не хотела запускать и пр.

Потому что тексты задачи, статусы и куча другой информации жили в md-файлах, в которые модель писала...

Иногда строго что надо, а иногда добавляла к «done» — дату. И пайплайн падал.

Control plane нас спасет


Конечно же я не пойду настраивать гарды поадекватней, зачем? 🙂

Надо вытаскивать весь «документооборот» — в «машинную логику» вместо лирики в md-файликах.

Ладно, помимо иронии — документообороту и правда лучше мигрировать в БД или хотя бы JSON, поскольку без этого получится «быстрый Go + медленные файлы = нахрена вообще было уходить с sh»

И вот — почти закончился переезд на нормальный control plane с БД и «машинной правдой» в дополнение к MD (людям все еще надо мочь самостоятельно почитать и поправить таски).

И самостоятельно Эрби стала работать по 3-4 часа, но изредка все еще быстро падала.

Сделать рывок от 3-4 часов к 12 — помог интересный лайфхак


Я был уставшим и злым, Эрби упала, я записал багрепорт и... Написал codex в курсоре «запусти в CLI, на такие-то таски, gpt 5.5 и СОПРОВОДИ ДО КОНЦА. Если пайплайн будет падать и ломаться — делай то-то. Если бюджет мажорных циклов закончится – делай то-то, и пр. Вот в таких случая забирай в главное worktree вот такие полезные наработки, багфикис руками и запускай пайплайн снова. Когда от тебя не будет требоваться активных действий — проверяй пайплайн раз в 15 минут».

И внезапно — это сработало.

Сложились неполноценные кусочки паззла:
1. Сам по себе codex в курсоре — не работает по 12 часов автономно
2. И не отдает прям пачку отревьювленных и забагфикшенных больших задач, которые адекватно потом работают — в ответ на один промпт.
3. А Эрби пока что местами еще падает
🔥1
И дали картинку:
1. Обычный GPT применяет развесистый скилл запуска пайплайна
2. Благодаря своей недетерминированности — зарешивает различные проблемки и сглаживает шероховатости
3. Пайплайн Эрби крутит свой большой сложный циклически конвейер (а точнее — несколько конвейеров)
4. GPT посматривает за этим и по пути чинит-поправляет и не останавливается, пока не остановится ЭРБИ — дожевав все выданные задачки.

Так что это и сутки может сейчас работать и больше. Лишь бы VPN не падал и по рейт-лимитам не отбило.
🔥1
#Эрби_растет
Побеждаю раздувание Scope

Стала встречаться проблема:
1. Эрби получает в работу пачку задач
2. Работает всю ночь
3. Закрывает только одну

При этом, по качеству код норм. После проверки, и 5-10 мин допилки — можно класть в PR и отправлять техлиду на ревью (или деплоить, в тех проектах, где техлид это я:))

Что не так?


Scope creep. Потроганы лишние файлы, а в нужных — сделано полезное, но непрошенное.

В результате — пайплайн провозился с одной задачей, вместо того, чтобы сделать несколько.

Частая проблема кожанных разработчиков кстати :)

Что сделано?


1. Эрби знает, какие вообще файлы можно трогать по задаче
2. Гард блокирует дальнейшую работу, если потроганы неправильные файлы
3. Если Эрби находит баги в посторонних файлах — записывает, но не кидается править
4. Логи, документооборот и прочие не-кодовые файлики — исключены из этих проверок и не дают ложных падений

Что осталось?

1. Проревьювить код, выделить полезное, отложить в сторону out-of-scope и продолжить, а не тупо падать
2. Intent tracking
3. Усилить «не трогать неправильное» вместо разгребания последствий

Вот с Intent tracking — самое интересное


Бывает что Эрби трогает нужные файлы, но в неправильных местах :)

Полезные, но непрошенный функции и пр.

И вот тут меня ждет несколько увлекательных задачек про то, как доносить до Эрби продуктовый смысл задач и требуемые инкременты.

Не переключайтесь :)
👍1
#Эрби_думает
Пойдем в Langgraph?

Все больше общаюсь с разработчиками, которые тоже интересуются/пилят фабрики кода.

Иногда накидывают в панамку, иногда (все чаще) хвалят

И вот уважемый tdesc вкинул большую картинку, посоветовав разобрать с AI. И порекомендовал Langgraph

Оказалось, что чуть ли не 80-85% с картинки уже реализовано, кусочек от Langraph у нас внезапно тоже есть (см черный скриншотик), но запаковать состояния пайплайна в граф, и управлять через него...

Блин, почему я об этом не подумал? Знал же, что всякие оркестраторы нередко управляются визуально, видел N8N. Ну чоб не сообразить :)

В общем, ждите апдейтов про Langgraph.

Сразу после апдейтов про «я сделяль intent tracking и дочинил падения пайплайна и их теперь не надо чинить-перезапускать через MITL». И полгодика не пройдет, как... :)))
👏1