AV_Vibe-Кодинг
354 subscribers
175 photos
4 videos
1 file
120 links
Разбираюсь с вайб-кодингом, делюсь опытом, помогаю и рассказываю просто о сложном.

Site: https://avvibe.ru
TG: @an_valk
YT: https://www.youtube.com/@av_vibe_coding

Открыт к сотрудничеству. Ищу активные стартапы для совместной работы.
Download Telegram
Наткнулся на ZeroClaw - очередной open-source агент на Rust. 3.2k звёзд, 22 провайдера, бинарник 3.4 MB. Красиво упаковано.

И таких проектов сейчас - десятки. OpenClaw, ZeroClaw, ещё кто-нибудь-Claw. Каждую неделю новый репозиторий с README на полстраницы и обещанием "zero overhead, zero compromise". Это хайп, но хайп здоровый. Люди реально пилят своих агентов, разбираются в архитектуре, публикуют код. Это круто.

Я тоже делаю своего агента. Но не прыгаю от проекта к проекту, а изучаю чужие репозитории как источник идей. Не чтобы переписать всё заново, а чтобы найти конкретные решения, которые усилят мою разработку.

Из ZeroClaw забрал три вещи.
- Embedding cache. Они хешируют текст через SHA-256 и кешируют вектор. Если тот же текст приходит снова - не считают эмбеддинг заново. У меня повторные вычисления были постоянно, а это лишние вызовы и время.
- Memory hygiene. База знаний без чистки деградирует. ZeroClaw при старте удаляет дубли и мёртвые записи. Простая идея, но я про неё не думал.
- Health snapshots. Вместо раскопок в логах - структурированный файл состояния каждые несколько секунд. Какой воркер жив, где ошибка, какая задержка. Элементарно, но сильно упрощает отладку.

Не нужно копировать чужие проекты целиком. Достаточно вытащить идеи, которые решают твои конкретные проблемы и делаю твой проект лучше.
👍1
Написал промпт и Claude Code сам разложил рефакторинг на 3 цикла с 7 задачами.

Промпт:
Работай только с веткой /bot. Web не трогаем. Запусти циклическую оптимизацию без потери функционала. Каждый цикл: scan (найди дублирование и цели оптимизации) - refactor (проведи улучшения) - docs (обнови документацию). Повторяй, пока сканирование не покажет, что улучшать больше нечего.


После имплементации фич код превращается в месиво. Вместо ручной уборки я попросил агента гонять петлю оптимизации самостоятельно.

Он подумал и выдал план. Три цикла, задачи блокируют друг друга по цепочке. Агент сам определяет критерий остановки - не я говорю "хватит", а он на финальном сканировании решает, остались ли реальные улучшения.

Многие ставят плагины вроде Ralph, Boomerang и прочие обвесы для управления задачами агента. Но по факту чёткий промпт со структурой "границы - действие - цикл - критерий остановки" уже запускает ту же петлю. Без лишних зависимостей.

Это как сказать уборщику "убирай, пока не станет чисто" вместо "протри вот эту полку". Разница в уровне делегирования. И для этого не нужен специальный инструмент - нужна правильная постановка задачи.
1👍1
Так много новостей в мире, что хочется поговорить немного о локальных. А конкретно, о том, что у меня меня был собран локальный пайплайн для субтитров на YouTube Shorts теперь уже ВК Клипы.

Whisper транскрибирует, LLM чистит текст от мусора распознавания, результат накладывается на видео. Всё работало на локальных моделях через Ollama.

Локально крутилась Qwen3 14B - последняя версия, которая влезла в мою 4080 на 16 гигов. Работала нормально, но требовала настройки, жрала ресурсы, иногда выдавала странное.

Я заменил LLM-часть на облако через OpenRouter. Whisper остался локальным, а очистку текста теперь делает MiniMax 2.5.

Один шортс обходится в 40-60 копеек. Копеек. За полную корректировку текста.

Это как собирать велосипед из запчастей, когда рядом стоит готовый за копейку в час.

Локальные модели дают контроль и приватность, но когда облако стоит настолько дёшево, аргументы тают.

Раньше я верил, что локальные модели - путь для тех, кто хочет независимости от облаков. Сейчас понимаю: при такой себестоимости это скорее хобби, чем практичное решение.

Для простых задач вроде очистки текста облачные API выигрывают по всем фронтам. Проще, дешевле, стабильнее.

Если делаете что-то похожее - попробуйте связку Whisper + OpenRouter. Может сэкономить кучу нервов.
👍32
Claude Sonnet 4.6 — главный апгрейд в линейке

Anthropic представили Claude Sonnet 4.6 — свою самую мощную модель в линейке Sonnet. Что нового:

🧠 Полный апгрейд навыков
Кодинг, компьютерное использование, длинный контекст, агентное планирование, дизайн — всё улучшено. Разработчики с ранним доступом теперь предпочитают 4.6 не только 4.5, но и Opus 4.5 (от ноября 2025)! Задачи, раньше требовавшие топовой модели, теперь решает Sonnet.

🖥 Компьютерное использование
Теперь модель видит экран, кликает, заполняет формы и работает в нескольких вкладках браузера. OSWorld бенчмарк показывает огромный прогресс за 16 месяцев. Можно автоматизировать старые системы без API — просто покажите модели интерфейс.

📊 1M токенов контекста (бета)
Рекордная память для сложных задач.

💰 Цена прежняя: $3/$15 за млн токенов

🛡 Безопасность на высоте
«Тёплый, честный, полезный характер, сильные защитные механизмы» — выводы safety researchers.

Уже доступен как дефолтная модель на claude.ai и Claude Cowork.

я честно уже уходил спать, но увидел новость...
👍1🔥1
Из-за ошибки были потеряны $1.78M через дыру в AI-коде.

В блокчейн-протоколе Moonwell (Base, Optimism) произошла крупная потеря, примерно $1.78 млн из-за критической ошибки в конфигурации.

🔴 Что случилось:
Цена cbETH была установлена в $1.12 вместо реальных $2,200, а это на минутку разница в 2000 раз! Злоумышленник получил избыточный залог и моментально опустошил пулы.

🔍 Техника:
Неправильная формула расчёта цены в смарт-контракте привела к тому, что залог в 1 cbETH оценивался в ~$1 вместо ~$2,200.

⚠️ Это первый случай взлома "AI-generated" смарт-контракта в DeFi.

Примечательно, что часть кода писал Claude Opus 4.6 , это та самая модель, которую хвалили за способности к кодингу.

Аудитор Pashov уже назвал это началом новой эры, где хакеры будут искать уязвимости в AI-коде.

Полный разбор: The Block и Cryptopolitan

Вывод: такой же как и всегда - работа через аи агентов не панацея. а инструмент, которым надо уметь пользоваться и проверять.
👍2
Cloudflare запустил markdown.new — сервис, который конвертирует любой сайт в чистый Markdown

В субботу на стриме мы обсуждали, как адаптировать сайты для AI-агентов. И вот — реальный кейс.

🔹 Проблема: Веб создан для людей, а AI нужны структурированные данные. Скрипты, стили, реклама, HTML-мусор — всё это увеличивает контент на 80% без пользы.

🔹 Решение: Вставляешь markdown.new/ перед URL — получаешь чистый Markdown.

Как работает:
1. Нативный метод — Cloudflare-сайты отдают Markdown сразу
2. AI-конвертация — через Workers AI для остальных
3. Browser rendering — для JS-тяжёлых страниц

Зачем это нужно:
→ AI-агенты для browsing
→ RAG-пайплайны ( подготовка данных для LLM )
→ Архивирование контента
→ Миграция документации

Пример: https://markdown.new/pleya.ru

Вывод: это первый шаг к "AI-first вебу", где контент доступен не только людям, но и агентам. Очень в тему субботнего обсуждения.
🔥3
Web 4.0: разговоры уже идут — значит, дело движется

Разговоры о Web 4.0 уже всерьёз идут и это значит, что эволюция интернета не просто теория, а уже процесс.

Само понятие «веб четвёртого поколения» перестаёт быть абстракцией. Эксперты и энтузиасты обсуждают, каким будет следующее поколение сети: децентрализованным, персонализированным, с интеграцией искусственного интеллекта на уровне инфраструктуры.

То, что дискуссии набирают обороты выглядит как хороший знак. Обычно технологии переходят от разговоров к реальности быстрее, чем ожидаешь. Вспомните: ещё недавно Web3 звучало как термин для узкого круга.

Web 4.0: новая эра интернета, где главными участниками станут ИИ-агенты. Наблюдаем за развитием. Скоро увидим, какие идеи окажутся жизнеспособными. Советую бегло прочитать для общего развития.
Claude Code не даёт запустить yolo mode под root. Прямо пишет: "cannot be used with root/sudo privileges for security reasons". И правильно делает.

Режим --dangerously-skip-permissions отключает запросы на разрешение. Claude сам выполняет команды, пишет файлы, запускает скрипты. Удобно, но под root это как дать стажёру ключи от серверной и уйти на обед.

Кто-то обходит это через IS_SANDBOX=1. Работает, но смысл защиты теряется. Лучше потратить минуту и создать отдельного пользователя:

sudo adduser username
sudo usermod -aG sudo username
echo "username ALL=(ALL) NOPASSWD:ALL" | sudo tee /etc/sudoers.d/username
sudo chmod 440 /etc/sudoers.d/username


Теперь заходишь под username и запускаешь Claude Code спокойно. Пользователь имеет sudo, но не root. Если агент натворит дел, ущерб ограничен.

Я сам недавно перешёл на такую схему. Пять минут настройки, зато не отвлекаешься на постоянные запросы b разрешение, да и в целом спишь спокойно.

UPD! Второй уровень защиты - хуки. PreToolUse перехватывает команды до выполнения. Можно прописать паттерны вроде rm -rf, DROP TABLE, force push. Если агент попытается выполнить - хук заблокирует. Я пока с этим не разбирался глубоко, но тема на очереди.
2👍2
Наткнулся на исследование про Skills - те самые инструкции, которые дают агентам контекст перед задачей.

Авторы из кучи университетов прогнали 7000+ траекторий через Claude Code, Gemini CLI и Codex. Проверяли три сценария: без Skills, с готовыми и с самостоятельно сгенерированными.

Готовые Skills поднимают pass rate в среднем на 16 пунктов. Там, где модели плохо обучены - медицина, производство - прирост до +50%. Там, где и так знают домен - разработка ПО - всего +4,5%.

Но главный результат неожиданный: самогенерация Skills не работает.

Когда моделям предлагали сначала написать гайды, а потом решать задачу - результат упал ниже, чем вообще без Skills. Модели не умеют надёжно создавать то знание, которым умеют пользоваться.

И ещё один момент, который меня зацепил - объём. Оптимум: 2-3 модуля, прирост +18,6%. При 4 и больше - уже только +5,9%. Подробная документация даёт минус 2,9%. Агент буквально тонет в контексте.

Всё в меру - работает и с людьми, и с агентами.
👍3
Сегодня обновил LinkedIn через Claude в Chrome. Переделал профиль с CG-фрилансера под вайб-кодинг.

Получилось - но с болью.

LinkedIn официально запрещает любую автоматизацию. На практике все этим пользуются, но нормального API для агентов нет. Поэтому Claude работал вслепую: написал текст, сделал скрин, изучил картинку, кликнул, снова скрин. И так по кругу.

Всё это время горели токены. На скриншоты, на распознавание интерфейса, на повторные проверки. Лимиты сожгло прилично - за задачу, которая по сложности как "заполнить форму".

Результат есть. Но назвать это удобным - нельзя.

Думаю, дело не в том, что платформы "не знают" про агентов. Знают. Просто живой человек, который кликает сам - это трафик, сессии, поведенческие данные. Агент всё это срезает. Зачем им это поощрять?

Но выбора особо нет. Люди будут строить агентские системы всё активнее - и трафик будет уходить так или иначе. Платформам придётся адаптироваться или стать неудобным барьером на пути.

Пока - второе.
Сегодня потратил несколько часов на одну задачу - распознавание голосовых сообщений в Telegram-боте.

Идея простая: пользователь отправляет голосовое, бот его транскрибирует и отправляет текст в LLM как промт. Голосом диктовать удобнее, чем писать.

Начал с Groq API. Там Whisper large-v3 turbo, скорость 216x реального времени - реально быстро. Но сервер в РФ, и Groq банально блокирует запросы. По API должно работать, но возиться с обходом не захотелось.

Потом смотрел локальные модели - Whisper можно поднять самому, open-source, бесплатно. Но у меня сервер без GPU, а на CPU это больно медленно. Смысла нет. Голосовые в Telegram обычно короткие, так что выходят копейки за запрос.

Остановился на gpt-4o-mini-transcribe - официальное API от OpenAI. $0.003 за минуту, вдвое дешевле обычного Whisper. Удивило, что из РФ работает без проблем - при том что Groq завернул сразу.

Если делали что-то похожее - расскажите в комментах, интересно сравнить подходы.
Веб-версия ChatGPT работает магически: пишешь - получаешь ответ, контекст помнится, всё красиво. Я не сразу понял, почему с API так не выходит.

Пока не начал делать бота для клиента. Вот тогда и пришло осознание.

За красивым фасадом веб-чата - годы инженерной работы: управление историей диалога, память между сессиями, поиск, интерфейс. Это готовая инфраструктура, которую просто не видно. Когда берёшь API - берёшь голую модель. Ту же самую. Но без всего, что делало её удобной. Одни вендоры строят продукт для "обычных" людей, другие - инструмент для разработчиков. Разные рынки, разные продукты.

Когда у клиента есть своя база - товары, услуги, данные - эту инфраструктуру приходится строить заново. В нашем случае: парсинг XML-фида, embeddings поверх SQLite, векторный поиск до того, как модель вообще получает запрос.

Кинуть всё в контекст не получится - стоимость растёт кратно, плюс задокументированный эффект «lost in the middle»: модель путается в фактах из середины длинного контекста. Поэтому в модель идёт только релевантное - не всё подряд. Это сохраняет 95% точности при четверти токенов.

Веб-чат - это интерфейс для человека. Автоматизация начинается там, где его нет.
1
Собственно утро начинается не с кофе.

Антропик заблокировал мою учетную запись из-за подозрительной деятельности. Написал им письмо на почту в суппорт, будем думать.

Подозрения пока на русские IP серверов, через которые я делал проекты и стримы, так как на компьютере у меня всегда впн включен.

Но с другой стороны, прошло 1.5 месяц с момента. как я пользовался Антропиком и практически сразу через прямую установку на серверах.

Странное дело, будем разбираться. А пока можете в комментариях написать, были ли у вас такие проблемы и какие решения вы делали.

Лично я уже решил пробовать разобраться, но если не пойдет - посмотрю в сторону большого китайского брата.
Вчера подключил MiniMax M2.5 к Claude Code.

Протестировал, исправив пару мелочей, а так же попросил модель изучить репозиторий, рассказать о проекте и так далее. В целом оно как бы "нормально". Правда не получается использовать тот же code-simplifier.

Подключил, потому что все было уже настроено и устанавливать новые плагины, зависимости и так далее не хотелось, но пришло время вспомнить OpenCode.

Там как раз раздают в рамках промо MiniMax M2.5 Free.

Не приятная ситуация, но не смертельная. Будем пробовать, будем разбираться.

Тем более цены приемлемы, взял для теста базовый на 20$ тариф, если понравится, быстро перейду на подороже.
2
Пару новостей за вчера, которые потянули одна другую.

Для начал я подключил MiniMax-m2.5 в Claude Code, протестировал на мелочах и пошел изучать OpenCode. Пока возился настройками, нашел отличный плагин Oh-My-Opencode. Он создает как раз систему агентов внутри OpenCode и плюсом подключает базовые MCP:
- context7
- grep_app - модифицированный grep поиск
- свой вариант websearch

А еще, пока я разбирался и настраивал подписку для MiniMax, то наткнулся, что они так же не обошли стороной крабо-хайп и создал MaxClaw. Обещают свой песочный деплой, коннекторы и все такое - хочу попробовать, что бы понять что вообще может.

Пока утром делали уроки с ребенком, протестировал небольшую фичу для своего агента, все подхватилось, все нормально работала с планшета.

Кстати про моего агента, Сейчас, по факту, я создал базу, которую можно развивать подключением модулей разного направления, По-этому хочу поделиться с вами. Если есть желание протестировать, пишите в комментариях или в ЛС (контакты в описания канала).

Основной манифест - возможность кастомизация и разработка функционала под вас.
Друзья, тихо мирно, но на мой youtube канал подписалось 100+ человек.

А на этом канале 170+ подписчиков, что в 2 раза больше, чем было примерно месяц назад.

Я не знаю кто вы и откуда, но я... (С) конечно же благодарю за ваши просмотры и реакции.

Напомню, что каждые 2 недели я планирую проводить стримы, на которых мы можем пообщаться, обсудить, что-то попробовать.

Приходите в эту субботу, в 20.00 по мск. Думаю мы сделаем простенькую векторную память, протестируем ее.

Если есть предложения или пожелания, то пишите и мы все обсудим.

Пост носит информационно-благодарственный характер.
👍7
Друзья. Утреннее напоминание, что сегодня у нас в 20:00 по мск будет стрим созвон через яндекс телемост.

Предварительные темы:
- opencode или давай Антропик до свидания.
- minimax-m2.5 внутри claude code.
- соберем что нибудь с векторной базой, поговорим про память.

Если есть пожелания, пишите в комментариях, обсудим.
👍6
Друзья, отличный стрим, очень много поговорили, спасибо всем, кто пришел!
7👍3
Друзья, сегодня внезапно поучаствовал в третьем митапа SafeVibeCode

В самом начале, первые минут 15 активно рассказываю о себе, а потом уже только слушаю умных людей.

К сожалению не заметил, что микрофон у меня выкручен был и по этому голос мой тихий. Но в целом митап очень классный и полезный. Всем советую посмотреть.

На вчерашнем стриме мы как раз обсуждали роутер для подписок, проект живет, развивается, решаю вопрос автоматизации добавления новых аккаунтов. Как будет что-то адекватное готово, обязательно приглашу на тестирование.

Канал ребят https://t.me/SafeVibeCode
👍3🔥1
Программирование через агентов: от микроменеджмента к роли техлида.

Многие верят в «вайб-кодинг» — возможность создать приложение, просто описывая желания. Но реальный опыт автора статьи на Хабре показывает: на проектах сложнее 500 строк это превращается в управление «бандой реактивных, но безынициативных стажеров».

Главный инсайт: ИИ генерирует техдолг со сверхзвуковой скоростью. Если не контролировать архитектуру, проект сложится как карточный домик.

Прогресс подхода автора прошел через 4 стадии рефакторинга:

- Микроменеджмент: ИИ создает имитацию структуры (папки есть, а внутри — монолит). Приходится ревьюить каждую строку и вручную чинить «галлюцинации».
- Изоляция компонентов: Автор научился предсказывать, где ИИ схалтурит. На этом этапе компоненты (UI, логика) начинают реально разделяться.
- Роль Архитектора: База кода становится чище. Команды становятся высокоуровневыми: «Вынеси парсинг в отдельный слой, сделай UI тупым».
- Автономия: Финал пути. ИИ начинает сам находить неочевидные баги (гонки данных, дыры в инкапсуляции) и предлагать решения.

Горький опыт: Ошибка в выборе инструмента (Matplotlib вместо нативного QGraphicsScene) стоила 40 часов борьбы с тормозами. ИИ не обладает «здравым смыслом» и будет до последнего латать костыли, вместо того чтобы сменить парадигму.

Вывод: В 2026 году главный навык инженера — не написание кода, а умение видеть деревья за лесом и вовремя сказать нейросети «Нет, это плохая архитектура, переделывай».

UPD: в обязательном порядке прочитайте комментарии к статье, там автор продолжаем мысль в диалоге с другими пользователями. Не менее интересно и полезно. чем сама статья.
👍2
Claude не очень хорошо.

Не удивляйтесь, если у вас не проходят запросы. Похоже что-то все же случилось, даже возможно из-за ряда событий на планете.

Но в целом отличный момент протестировать minimax-m2.5 free в Opencode.

Держим кулачки, ждем когда все поднимется, труженикам вайб кодинга пожелаю терпения и нервов. Берегите себя.
🙏3🕊2🔥1