AV_Vibe-Кодинг
354 subscribers
175 photos
4 videos
1 file
120 links
Разбираюсь с вайб-кодингом, делюсь опытом, помогаю и рассказываю просто о сложном.

Site: https://avvibe.ru
TG: @an_valk
YT: https://www.youtube.com/@av_vibe_coding

Открыт к сотрудничеству. Ищу активные стартапы для совместной работы.
Download Telegram
Claude Sonnet 4.6 — главный апгрейд в линейке

Anthropic представили Claude Sonnet 4.6 — свою самую мощную модель в линейке Sonnet. Что нового:

🧠 Полный апгрейд навыков
Кодинг, компьютерное использование, длинный контекст, агентное планирование, дизайн — всё улучшено. Разработчики с ранним доступом теперь предпочитают 4.6 не только 4.5, но и Opus 4.5 (от ноября 2025)! Задачи, раньше требовавшие топовой модели, теперь решает Sonnet.

🖥 Компьютерное использование
Теперь модель видит экран, кликает, заполняет формы и работает в нескольких вкладках браузера. OSWorld бенчмарк показывает огромный прогресс за 16 месяцев. Можно автоматизировать старые системы без API — просто покажите модели интерфейс.

📊 1M токенов контекста (бета)
Рекордная память для сложных задач.

💰 Цена прежняя: $3/$15 за млн токенов

🛡 Безопасность на высоте
«Тёплый, честный, полезный характер, сильные защитные механизмы» — выводы safety researchers.

Уже доступен как дефолтная модель на claude.ai и Claude Cowork.

я честно уже уходил спать, но увидел новость...
👍1🔥1
Из-за ошибки были потеряны $1.78M через дыру в AI-коде.

В блокчейн-протоколе Moonwell (Base, Optimism) произошла крупная потеря, примерно $1.78 млн из-за критической ошибки в конфигурации.

🔴 Что случилось:
Цена cbETH была установлена в $1.12 вместо реальных $2,200, а это на минутку разница в 2000 раз! Злоумышленник получил избыточный залог и моментально опустошил пулы.

🔍 Техника:
Неправильная формула расчёта цены в смарт-контракте привела к тому, что залог в 1 cbETH оценивался в ~$1 вместо ~$2,200.

⚠️ Это первый случай взлома "AI-generated" смарт-контракта в DeFi.

Примечательно, что часть кода писал Claude Opus 4.6 , это та самая модель, которую хвалили за способности к кодингу.

Аудитор Pashov уже назвал это началом новой эры, где хакеры будут искать уязвимости в AI-коде.

Полный разбор: The Block и Cryptopolitan

Вывод: такой же как и всегда - работа через аи агентов не панацея. а инструмент, которым надо уметь пользоваться и проверять.
👍2
Cloudflare запустил markdown.new — сервис, который конвертирует любой сайт в чистый Markdown

В субботу на стриме мы обсуждали, как адаптировать сайты для AI-агентов. И вот — реальный кейс.

🔹 Проблема: Веб создан для людей, а AI нужны структурированные данные. Скрипты, стили, реклама, HTML-мусор — всё это увеличивает контент на 80% без пользы.

🔹 Решение: Вставляешь markdown.new/ перед URL — получаешь чистый Markdown.

Как работает:
1. Нативный метод — Cloudflare-сайты отдают Markdown сразу
2. AI-конвертация — через Workers AI для остальных
3. Browser rendering — для JS-тяжёлых страниц

Зачем это нужно:
→ AI-агенты для browsing
→ RAG-пайплайны ( подготовка данных для LLM )
→ Архивирование контента
→ Миграция документации

Пример: https://markdown.new/pleya.ru

Вывод: это первый шаг к "AI-first вебу", где контент доступен не только людям, но и агентам. Очень в тему субботнего обсуждения.
🔥3
Web 4.0: разговоры уже идут — значит, дело движется

Разговоры о Web 4.0 уже всерьёз идут и это значит, что эволюция интернета не просто теория, а уже процесс.

Само понятие «веб четвёртого поколения» перестаёт быть абстракцией. Эксперты и энтузиасты обсуждают, каким будет следующее поколение сети: децентрализованным, персонализированным, с интеграцией искусственного интеллекта на уровне инфраструктуры.

То, что дискуссии набирают обороты выглядит как хороший знак. Обычно технологии переходят от разговоров к реальности быстрее, чем ожидаешь. Вспомните: ещё недавно Web3 звучало как термин для узкого круга.

Web 4.0: новая эра интернета, где главными участниками станут ИИ-агенты. Наблюдаем за развитием. Скоро увидим, какие идеи окажутся жизнеспособными. Советую бегло прочитать для общего развития.
Claude Code не даёт запустить yolo mode под root. Прямо пишет: "cannot be used with root/sudo privileges for security reasons". И правильно делает.

Режим --dangerously-skip-permissions отключает запросы на разрешение. Claude сам выполняет команды, пишет файлы, запускает скрипты. Удобно, но под root это как дать стажёру ключи от серверной и уйти на обед.

Кто-то обходит это через IS_SANDBOX=1. Работает, но смысл защиты теряется. Лучше потратить минуту и создать отдельного пользователя:

sudo adduser username
sudo usermod -aG sudo username
echo "username ALL=(ALL) NOPASSWD:ALL" | sudo tee /etc/sudoers.d/username
sudo chmod 440 /etc/sudoers.d/username


Теперь заходишь под username и запускаешь Claude Code спокойно. Пользователь имеет sudo, но не root. Если агент натворит дел, ущерб ограничен.

Я сам недавно перешёл на такую схему. Пять минут настройки, зато не отвлекаешься на постоянные запросы b разрешение, да и в целом спишь спокойно.

UPD! Второй уровень защиты - хуки. PreToolUse перехватывает команды до выполнения. Можно прописать паттерны вроде rm -rf, DROP TABLE, force push. Если агент попытается выполнить - хук заблокирует. Я пока с этим не разбирался глубоко, но тема на очереди.
2👍2
Наткнулся на исследование про Skills - те самые инструкции, которые дают агентам контекст перед задачей.

Авторы из кучи университетов прогнали 7000+ траекторий через Claude Code, Gemini CLI и Codex. Проверяли три сценария: без Skills, с готовыми и с самостоятельно сгенерированными.

Готовые Skills поднимают pass rate в среднем на 16 пунктов. Там, где модели плохо обучены - медицина, производство - прирост до +50%. Там, где и так знают домен - разработка ПО - всего +4,5%.

Но главный результат неожиданный: самогенерация Skills не работает.

Когда моделям предлагали сначала написать гайды, а потом решать задачу - результат упал ниже, чем вообще без Skills. Модели не умеют надёжно создавать то знание, которым умеют пользоваться.

И ещё один момент, который меня зацепил - объём. Оптимум: 2-3 модуля, прирост +18,6%. При 4 и больше - уже только +5,9%. Подробная документация даёт минус 2,9%. Агент буквально тонет в контексте.

Всё в меру - работает и с людьми, и с агентами.
👍3
Сегодня обновил LinkedIn через Claude в Chrome. Переделал профиль с CG-фрилансера под вайб-кодинг.

Получилось - но с болью.

LinkedIn официально запрещает любую автоматизацию. На практике все этим пользуются, но нормального API для агентов нет. Поэтому Claude работал вслепую: написал текст, сделал скрин, изучил картинку, кликнул, снова скрин. И так по кругу.

Всё это время горели токены. На скриншоты, на распознавание интерфейса, на повторные проверки. Лимиты сожгло прилично - за задачу, которая по сложности как "заполнить форму".

Результат есть. Но назвать это удобным - нельзя.

Думаю, дело не в том, что платформы "не знают" про агентов. Знают. Просто живой человек, который кликает сам - это трафик, сессии, поведенческие данные. Агент всё это срезает. Зачем им это поощрять?

Но выбора особо нет. Люди будут строить агентские системы всё активнее - и трафик будет уходить так или иначе. Платформам придётся адаптироваться или стать неудобным барьером на пути.

Пока - второе.
Сегодня потратил несколько часов на одну задачу - распознавание голосовых сообщений в Telegram-боте.

Идея простая: пользователь отправляет голосовое, бот его транскрибирует и отправляет текст в LLM как промт. Голосом диктовать удобнее, чем писать.

Начал с Groq API. Там Whisper large-v3 turbo, скорость 216x реального времени - реально быстро. Но сервер в РФ, и Groq банально блокирует запросы. По API должно работать, но возиться с обходом не захотелось.

Потом смотрел локальные модели - Whisper можно поднять самому, open-source, бесплатно. Но у меня сервер без GPU, а на CPU это больно медленно. Смысла нет. Голосовые в Telegram обычно короткие, так что выходят копейки за запрос.

Остановился на gpt-4o-mini-transcribe - официальное API от OpenAI. $0.003 за минуту, вдвое дешевле обычного Whisper. Удивило, что из РФ работает без проблем - при том что Groq завернул сразу.

Если делали что-то похожее - расскажите в комментах, интересно сравнить подходы.
Веб-версия ChatGPT работает магически: пишешь - получаешь ответ, контекст помнится, всё красиво. Я не сразу понял, почему с API так не выходит.

Пока не начал делать бота для клиента. Вот тогда и пришло осознание.

За красивым фасадом веб-чата - годы инженерной работы: управление историей диалога, память между сессиями, поиск, интерфейс. Это готовая инфраструктура, которую просто не видно. Когда берёшь API - берёшь голую модель. Ту же самую. Но без всего, что делало её удобной. Одни вендоры строят продукт для "обычных" людей, другие - инструмент для разработчиков. Разные рынки, разные продукты.

Когда у клиента есть своя база - товары, услуги, данные - эту инфраструктуру приходится строить заново. В нашем случае: парсинг XML-фида, embeddings поверх SQLite, векторный поиск до того, как модель вообще получает запрос.

Кинуть всё в контекст не получится - стоимость растёт кратно, плюс задокументированный эффект «lost in the middle»: модель путается в фактах из середины длинного контекста. Поэтому в модель идёт только релевантное - не всё подряд. Это сохраняет 95% точности при четверти токенов.

Веб-чат - это интерфейс для человека. Автоматизация начинается там, где его нет.
1
Собственно утро начинается не с кофе.

Антропик заблокировал мою учетную запись из-за подозрительной деятельности. Написал им письмо на почту в суппорт, будем думать.

Подозрения пока на русские IP серверов, через которые я делал проекты и стримы, так как на компьютере у меня всегда впн включен.

Но с другой стороны, прошло 1.5 месяц с момента. как я пользовался Антропиком и практически сразу через прямую установку на серверах.

Странное дело, будем разбираться. А пока можете в комментариях написать, были ли у вас такие проблемы и какие решения вы делали.

Лично я уже решил пробовать разобраться, но если не пойдет - посмотрю в сторону большого китайского брата.
Вчера подключил MiniMax M2.5 к Claude Code.

Протестировал, исправив пару мелочей, а так же попросил модель изучить репозиторий, рассказать о проекте и так далее. В целом оно как бы "нормально". Правда не получается использовать тот же code-simplifier.

Подключил, потому что все было уже настроено и устанавливать новые плагины, зависимости и так далее не хотелось, но пришло время вспомнить OpenCode.

Там как раз раздают в рамках промо MiniMax M2.5 Free.

Не приятная ситуация, но не смертельная. Будем пробовать, будем разбираться.

Тем более цены приемлемы, взял для теста базовый на 20$ тариф, если понравится, быстро перейду на подороже.
2
Пару новостей за вчера, которые потянули одна другую.

Для начал я подключил MiniMax-m2.5 в Claude Code, протестировал на мелочах и пошел изучать OpenCode. Пока возился настройками, нашел отличный плагин Oh-My-Opencode. Он создает как раз систему агентов внутри OpenCode и плюсом подключает базовые MCP:
- context7
- grep_app - модифицированный grep поиск
- свой вариант websearch

А еще, пока я разбирался и настраивал подписку для MiniMax, то наткнулся, что они так же не обошли стороной крабо-хайп и создал MaxClaw. Обещают свой песочный деплой, коннекторы и все такое - хочу попробовать, что бы понять что вообще может.

Пока утром делали уроки с ребенком, протестировал небольшую фичу для своего агента, все подхватилось, все нормально работала с планшета.

Кстати про моего агента, Сейчас, по факту, я создал базу, которую можно развивать подключением модулей разного направления, По-этому хочу поделиться с вами. Если есть желание протестировать, пишите в комментариях или в ЛС (контакты в описания канала).

Основной манифест - возможность кастомизация и разработка функционала под вас.
Друзья, тихо мирно, но на мой youtube канал подписалось 100+ человек.

А на этом канале 170+ подписчиков, что в 2 раза больше, чем было примерно месяц назад.

Я не знаю кто вы и откуда, но я... (С) конечно же благодарю за ваши просмотры и реакции.

Напомню, что каждые 2 недели я планирую проводить стримы, на которых мы можем пообщаться, обсудить, что-то попробовать.

Приходите в эту субботу, в 20.00 по мск. Думаю мы сделаем простенькую векторную память, протестируем ее.

Если есть предложения или пожелания, то пишите и мы все обсудим.

Пост носит информационно-благодарственный характер.
👍7
Друзья. Утреннее напоминание, что сегодня у нас в 20:00 по мск будет стрим созвон через яндекс телемост.

Предварительные темы:
- opencode или давай Антропик до свидания.
- minimax-m2.5 внутри claude code.
- соберем что нибудь с векторной базой, поговорим про память.

Если есть пожелания, пишите в комментариях, обсудим.
👍6
Друзья, отличный стрим, очень много поговорили, спасибо всем, кто пришел!
7👍3
Друзья, сегодня внезапно поучаствовал в третьем митапа SafeVibeCode

В самом начале, первые минут 15 активно рассказываю о себе, а потом уже только слушаю умных людей.

К сожалению не заметил, что микрофон у меня выкручен был и по этому голос мой тихий. Но в целом митап очень классный и полезный. Всем советую посмотреть.

На вчерашнем стриме мы как раз обсуждали роутер для подписок, проект живет, развивается, решаю вопрос автоматизации добавления новых аккаунтов. Как будет что-то адекватное готово, обязательно приглашу на тестирование.

Канал ребят https://t.me/SafeVibeCode
👍3🔥1
Программирование через агентов: от микроменеджмента к роли техлида.

Многие верят в «вайб-кодинг» — возможность создать приложение, просто описывая желания. Но реальный опыт автора статьи на Хабре показывает: на проектах сложнее 500 строк это превращается в управление «бандой реактивных, но безынициативных стажеров».

Главный инсайт: ИИ генерирует техдолг со сверхзвуковой скоростью. Если не контролировать архитектуру, проект сложится как карточный домик.

Прогресс подхода автора прошел через 4 стадии рефакторинга:

- Микроменеджмент: ИИ создает имитацию структуры (папки есть, а внутри — монолит). Приходится ревьюить каждую строку и вручную чинить «галлюцинации».
- Изоляция компонентов: Автор научился предсказывать, где ИИ схалтурит. На этом этапе компоненты (UI, логика) начинают реально разделяться.
- Роль Архитектора: База кода становится чище. Команды становятся высокоуровневыми: «Вынеси парсинг в отдельный слой, сделай UI тупым».
- Автономия: Финал пути. ИИ начинает сам находить неочевидные баги (гонки данных, дыры в инкапсуляции) и предлагать решения.

Горький опыт: Ошибка в выборе инструмента (Matplotlib вместо нативного QGraphicsScene) стоила 40 часов борьбы с тормозами. ИИ не обладает «здравым смыслом» и будет до последнего латать костыли, вместо того чтобы сменить парадигму.

Вывод: В 2026 году главный навык инженера — не написание кода, а умение видеть деревья за лесом и вовремя сказать нейросети «Нет, это плохая архитектура, переделывай».

UPD: в обязательном порядке прочитайте комментарии к статье, там автор продолжаем мысль в диалоге с другими пользователями. Не менее интересно и полезно. чем сама статья.
👍2
Claude не очень хорошо.

Не удивляйтесь, если у вас не проходят запросы. Похоже что-то все же случилось, даже возможно из-за ряда событий на планете.

Но в целом отличный момент протестировать minimax-m2.5 free в Opencode.

Держим кулачки, ждем когда все поднимется, труженикам вайб кодинга пожелаю терпения и нервов. Берегите себя.
🙏3🕊2🔥1
Пока сервера Claude опять лежат, мы вместе с главой отдела по мурчательным вопросам, пишем роутер для использования chatGPT подписок.

Во всем нужно искать хорошее. Мой бан на аккаунте антропиков сподвигнул меня на поиск и исследования, что привело к такому проекту.

Работа будет через терминальные клиенты, пока спокойно работают Claude code cli и opencode.

Как только роутер покажет стабильную работу, то я готов взять 10 человек на тестирование за небольшую плату, что бы наполнить пул аккаунтов на роутере. Скорее всего в районе 500р – 1000р с человека. Вся сумма пойдет на оплату сервера и покупку мелких подписок.

Если вам это интересно, пишите в комментариях, обсудим.
1
Сегодня день прошел практически мимо компьютера. Только под вечер смог спокойно сесть. Продолжаю тестировать роутер.

Из клиента используется Claude Code CLI с настроенным обращением на роутер. Модель GPT-5.3-codex.

Для теста, попросил его автономно провести оценку и рефакторинг текущей версии роутера, пусть сам себя почистит и приведет в порядок.

Сегодня хочу попробовать купить еще пачку аккаунтов и добавить на роутер, завтра будет активный день, посмотрим сколько уйдет лимитов.

Если есть вопросы или предложения, пишите в комментариях, обсудим!