AV_Vibe-Кодинг
354 subscribers
175 photos
4 videos
1 file
120 links
Разбираюсь с вайб-кодингом, делюсь опытом, помогаю и рассказываю просто о сложном.

Site: https://avvibe.ru
TG: @an_valk
YT: https://www.youtube.com/@av_vibe_coding

Открыт к сотрудничеству. Ищу активные стартапы для совместной работы.
Download Telegram
Claude Code не даёт запустить yolo mode под root. Прямо пишет: "cannot be used with root/sudo privileges for security reasons". И правильно делает.

Режим --dangerously-skip-permissions отключает запросы на разрешение. Claude сам выполняет команды, пишет файлы, запускает скрипты. Удобно, но под root это как дать стажёру ключи от серверной и уйти на обед.

Кто-то обходит это через IS_SANDBOX=1. Работает, но смысл защиты теряется. Лучше потратить минуту и создать отдельного пользователя:

sudo adduser username
sudo usermod -aG sudo username
echo "username ALL=(ALL) NOPASSWD:ALL" | sudo tee /etc/sudoers.d/username
sudo chmod 440 /etc/sudoers.d/username


Теперь заходишь под username и запускаешь Claude Code спокойно. Пользователь имеет sudo, но не root. Если агент натворит дел, ущерб ограничен.

Я сам недавно перешёл на такую схему. Пять минут настройки, зато не отвлекаешься на постоянные запросы b разрешение, да и в целом спишь спокойно.

UPD! Второй уровень защиты - хуки. PreToolUse перехватывает команды до выполнения. Можно прописать паттерны вроде rm -rf, DROP TABLE, force push. Если агент попытается выполнить - хук заблокирует. Я пока с этим не разбирался глубоко, но тема на очереди.
2👍2
Наткнулся на исследование про Skills - те самые инструкции, которые дают агентам контекст перед задачей.

Авторы из кучи университетов прогнали 7000+ траекторий через Claude Code, Gemini CLI и Codex. Проверяли три сценария: без Skills, с готовыми и с самостоятельно сгенерированными.

Готовые Skills поднимают pass rate в среднем на 16 пунктов. Там, где модели плохо обучены - медицина, производство - прирост до +50%. Там, где и так знают домен - разработка ПО - всего +4,5%.

Но главный результат неожиданный: самогенерация Skills не работает.

Когда моделям предлагали сначала написать гайды, а потом решать задачу - результат упал ниже, чем вообще без Skills. Модели не умеют надёжно создавать то знание, которым умеют пользоваться.

И ещё один момент, который меня зацепил - объём. Оптимум: 2-3 модуля, прирост +18,6%. При 4 и больше - уже только +5,9%. Подробная документация даёт минус 2,9%. Агент буквально тонет в контексте.

Всё в меру - работает и с людьми, и с агентами.
👍3
Сегодня обновил LinkedIn через Claude в Chrome. Переделал профиль с CG-фрилансера под вайб-кодинг.

Получилось - но с болью.

LinkedIn официально запрещает любую автоматизацию. На практике все этим пользуются, но нормального API для агентов нет. Поэтому Claude работал вслепую: написал текст, сделал скрин, изучил картинку, кликнул, снова скрин. И так по кругу.

Всё это время горели токены. На скриншоты, на распознавание интерфейса, на повторные проверки. Лимиты сожгло прилично - за задачу, которая по сложности как "заполнить форму".

Результат есть. Но назвать это удобным - нельзя.

Думаю, дело не в том, что платформы "не знают" про агентов. Знают. Просто живой человек, который кликает сам - это трафик, сессии, поведенческие данные. Агент всё это срезает. Зачем им это поощрять?

Но выбора особо нет. Люди будут строить агентские системы всё активнее - и трафик будет уходить так или иначе. Платформам придётся адаптироваться или стать неудобным барьером на пути.

Пока - второе.
Сегодня потратил несколько часов на одну задачу - распознавание голосовых сообщений в Telegram-боте.

Идея простая: пользователь отправляет голосовое, бот его транскрибирует и отправляет текст в LLM как промт. Голосом диктовать удобнее, чем писать.

Начал с Groq API. Там Whisper large-v3 turbo, скорость 216x реального времени - реально быстро. Но сервер в РФ, и Groq банально блокирует запросы. По API должно работать, но возиться с обходом не захотелось.

Потом смотрел локальные модели - Whisper можно поднять самому, open-source, бесплатно. Но у меня сервер без GPU, а на CPU это больно медленно. Смысла нет. Голосовые в Telegram обычно короткие, так что выходят копейки за запрос.

Остановился на gpt-4o-mini-transcribe - официальное API от OpenAI. $0.003 за минуту, вдвое дешевле обычного Whisper. Удивило, что из РФ работает без проблем - при том что Groq завернул сразу.

Если делали что-то похожее - расскажите в комментах, интересно сравнить подходы.
Веб-версия ChatGPT работает магически: пишешь - получаешь ответ, контекст помнится, всё красиво. Я не сразу понял, почему с API так не выходит.

Пока не начал делать бота для клиента. Вот тогда и пришло осознание.

За красивым фасадом веб-чата - годы инженерной работы: управление историей диалога, память между сессиями, поиск, интерфейс. Это готовая инфраструктура, которую просто не видно. Когда берёшь API - берёшь голую модель. Ту же самую. Но без всего, что делало её удобной. Одни вендоры строят продукт для "обычных" людей, другие - инструмент для разработчиков. Разные рынки, разные продукты.

Когда у клиента есть своя база - товары, услуги, данные - эту инфраструктуру приходится строить заново. В нашем случае: парсинг XML-фида, embeddings поверх SQLite, векторный поиск до того, как модель вообще получает запрос.

Кинуть всё в контекст не получится - стоимость растёт кратно, плюс задокументированный эффект «lost in the middle»: модель путается в фактах из середины длинного контекста. Поэтому в модель идёт только релевантное - не всё подряд. Это сохраняет 95% точности при четверти токенов.

Веб-чат - это интерфейс для человека. Автоматизация начинается там, где его нет.
1
Собственно утро начинается не с кофе.

Антропик заблокировал мою учетную запись из-за подозрительной деятельности. Написал им письмо на почту в суппорт, будем думать.

Подозрения пока на русские IP серверов, через которые я делал проекты и стримы, так как на компьютере у меня всегда впн включен.

Но с другой стороны, прошло 1.5 месяц с момента. как я пользовался Антропиком и практически сразу через прямую установку на серверах.

Странное дело, будем разбираться. А пока можете в комментариях написать, были ли у вас такие проблемы и какие решения вы делали.

Лично я уже решил пробовать разобраться, но если не пойдет - посмотрю в сторону большого китайского брата.
Вчера подключил MiniMax M2.5 к Claude Code.

Протестировал, исправив пару мелочей, а так же попросил модель изучить репозиторий, рассказать о проекте и так далее. В целом оно как бы "нормально". Правда не получается использовать тот же code-simplifier.

Подключил, потому что все было уже настроено и устанавливать новые плагины, зависимости и так далее не хотелось, но пришло время вспомнить OpenCode.

Там как раз раздают в рамках промо MiniMax M2.5 Free.

Не приятная ситуация, но не смертельная. Будем пробовать, будем разбираться.

Тем более цены приемлемы, взял для теста базовый на 20$ тариф, если понравится, быстро перейду на подороже.
2
Пару новостей за вчера, которые потянули одна другую.

Для начал я подключил MiniMax-m2.5 в Claude Code, протестировал на мелочах и пошел изучать OpenCode. Пока возился настройками, нашел отличный плагин Oh-My-Opencode. Он создает как раз систему агентов внутри OpenCode и плюсом подключает базовые MCP:
- context7
- grep_app - модифицированный grep поиск
- свой вариант websearch

А еще, пока я разбирался и настраивал подписку для MiniMax, то наткнулся, что они так же не обошли стороной крабо-хайп и создал MaxClaw. Обещают свой песочный деплой, коннекторы и все такое - хочу попробовать, что бы понять что вообще может.

Пока утром делали уроки с ребенком, протестировал небольшую фичу для своего агента, все подхватилось, все нормально работала с планшета.

Кстати про моего агента, Сейчас, по факту, я создал базу, которую можно развивать подключением модулей разного направления, По-этому хочу поделиться с вами. Если есть желание протестировать, пишите в комментариях или в ЛС (контакты в описания канала).

Основной манифест - возможность кастомизация и разработка функционала под вас.
Друзья, тихо мирно, но на мой youtube канал подписалось 100+ человек.

А на этом канале 170+ подписчиков, что в 2 раза больше, чем было примерно месяц назад.

Я не знаю кто вы и откуда, но я... (С) конечно же благодарю за ваши просмотры и реакции.

Напомню, что каждые 2 недели я планирую проводить стримы, на которых мы можем пообщаться, обсудить, что-то попробовать.

Приходите в эту субботу, в 20.00 по мск. Думаю мы сделаем простенькую векторную память, протестируем ее.

Если есть предложения или пожелания, то пишите и мы все обсудим.

Пост носит информационно-благодарственный характер.
👍7
Друзья. Утреннее напоминание, что сегодня у нас в 20:00 по мск будет стрим созвон через яндекс телемост.

Предварительные темы:
- opencode или давай Антропик до свидания.
- minimax-m2.5 внутри claude code.
- соберем что нибудь с векторной базой, поговорим про память.

Если есть пожелания, пишите в комментариях, обсудим.
👍6
Друзья, отличный стрим, очень много поговорили, спасибо всем, кто пришел!
7👍3
Друзья, сегодня внезапно поучаствовал в третьем митапа SafeVibeCode

В самом начале, первые минут 15 активно рассказываю о себе, а потом уже только слушаю умных людей.

К сожалению не заметил, что микрофон у меня выкручен был и по этому голос мой тихий. Но в целом митап очень классный и полезный. Всем советую посмотреть.

На вчерашнем стриме мы как раз обсуждали роутер для подписок, проект живет, развивается, решаю вопрос автоматизации добавления новых аккаунтов. Как будет что-то адекватное готово, обязательно приглашу на тестирование.

Канал ребят https://t.me/SafeVibeCode
👍3🔥1
Программирование через агентов: от микроменеджмента к роли техлида.

Многие верят в «вайб-кодинг» — возможность создать приложение, просто описывая желания. Но реальный опыт автора статьи на Хабре показывает: на проектах сложнее 500 строк это превращается в управление «бандой реактивных, но безынициативных стажеров».

Главный инсайт: ИИ генерирует техдолг со сверхзвуковой скоростью. Если не контролировать архитектуру, проект сложится как карточный домик.

Прогресс подхода автора прошел через 4 стадии рефакторинга:

- Микроменеджмент: ИИ создает имитацию структуры (папки есть, а внутри — монолит). Приходится ревьюить каждую строку и вручную чинить «галлюцинации».
- Изоляция компонентов: Автор научился предсказывать, где ИИ схалтурит. На этом этапе компоненты (UI, логика) начинают реально разделяться.
- Роль Архитектора: База кода становится чище. Команды становятся высокоуровневыми: «Вынеси парсинг в отдельный слой, сделай UI тупым».
- Автономия: Финал пути. ИИ начинает сам находить неочевидные баги (гонки данных, дыры в инкапсуляции) и предлагать решения.

Горький опыт: Ошибка в выборе инструмента (Matplotlib вместо нативного QGraphicsScene) стоила 40 часов борьбы с тормозами. ИИ не обладает «здравым смыслом» и будет до последнего латать костыли, вместо того чтобы сменить парадигму.

Вывод: В 2026 году главный навык инженера — не написание кода, а умение видеть деревья за лесом и вовремя сказать нейросети «Нет, это плохая архитектура, переделывай».

UPD: в обязательном порядке прочитайте комментарии к статье, там автор продолжаем мысль в диалоге с другими пользователями. Не менее интересно и полезно. чем сама статья.
👍2
Claude не очень хорошо.

Не удивляйтесь, если у вас не проходят запросы. Похоже что-то все же случилось, даже возможно из-за ряда событий на планете.

Но в целом отличный момент протестировать minimax-m2.5 free в Opencode.

Держим кулачки, ждем когда все поднимется, труженикам вайб кодинга пожелаю терпения и нервов. Берегите себя.
🙏3🕊2🔥1
Пока сервера Claude опять лежат, мы вместе с главой отдела по мурчательным вопросам, пишем роутер для использования chatGPT подписок.

Во всем нужно искать хорошее. Мой бан на аккаунте антропиков сподвигнул меня на поиск и исследования, что привело к такому проекту.

Работа будет через терминальные клиенты, пока спокойно работают Claude code cli и opencode.

Как только роутер покажет стабильную работу, то я готов взять 10 человек на тестирование за небольшую плату, что бы наполнить пул аккаунтов на роутере. Скорее всего в районе 500р – 1000р с человека. Вся сумма пойдет на оплату сервера и покупку мелких подписок.

Если вам это интересно, пишите в комментариях, обсудим.
1
Сегодня день прошел практически мимо компьютера. Только под вечер смог спокойно сесть. Продолжаю тестировать роутер.

Из клиента используется Claude Code CLI с настроенным обращением на роутер. Модель GPT-5.3-codex.

Для теста, попросил его автономно провести оценку и рефакторинг текущей версии роутера, пусть сам себя почистит и приведет в порядок.

Сегодня хочу попробовать купить еще пачку аккаунтов и добавить на роутер, завтра будет активный день, посмотрим сколько уйдет лимитов.

Если есть вопросы или предложения, пишите в комментариях, обсудим!
И немного философии перед сном.

"Весь топ на Vercel маркетплейсе скиллов занят скам скиллами, которые с вероятностью 99% украдут всю конфиденциальную инфу у вас. Те, кто ставит скиллы с маркетплейсов через OpenClaw / find-skills не изучая процесс установки вручную – соболезную."

Вот такой текст я прочитал сегодня в одном из каналов.

Хочется предупредить людей, которые только начинают заниматься кодингом с ИИ агентами. Вам может казаться, что если вы не поставите 100500 скиллов, плагинов и свистелок - то вы ничего не добьетесь.

Это не так, абсолютли не так. В гонке с вечным чувством FOMO вы проиграете. Это как казино - еще один скилл, еще один плагин и я выиграю джекпот, вот вот мне повезет.

Мой совет - учите лучше основы разработки приложений и сервисом. Не конкретно код, а архитектуру, структуру, стеки и так далее. Развивайте в себя создателя, с пониманием того, что происходит в процессе. Однопромтовые решения только на ютубе и в реальности они не работают.

ИИ агенты дают нам возможность убрать рутину написания конкретных букв и цифр, но во что эти буковки с циферками сложится - все же решать пока нам.

Берегите себя, пользуйтесь осторожны общедоступными ресурсами, в интернете бывают люди очень разные...

PS картинку сделал chatGPT, как он увидел этот пост %)
3👍1
Хотел сегодня написать пост про агентов, рой и так далее, но дело уже к ночи и openAI выпускает GPT-5.4.

Без приписки Codex, т.е. модель общего назначения. Много всего добавили, особенно контекст на 1 миллион токенов. Это очень хорошая новость.

Модель ориентирована на рабочие и повседневные агентские задачи, взаимодействие с файлами и вызовом нужных инструментов.

В целом как я и говорил на стримах, год 2026 будет под эгидой агентских систем.

Завтра тогда как раз напишу свои мысли про агентов и как они меняют образ работы.
🔥3
Краткий утренний реакшен на новый gpt-5.4 - нравится.

Шустро шуршит.

За последние пару дней в проекте прокси роутера скопился гит мусор, по этому решил сделать чистку. Проверить актуальность веток, убрать не нужное, синхронизировать полезное.

Моделька активно проверяет, предлагает решения.

Мое утро проходит с планшетом, пока ребенок делает уроки, по этому вы не просили, но я вам принес еще одну фотографию на пледе ❤️
5🔥1