very vibe coding
119 subscribers
460 photos
126 videos
13 files
980 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic выпустили официальную библиотеку промптов для Claude.

И она полностью бесплатна. Там есть:
- Планирование, отладка, ревью кода, безопасность, автоматизация

Каждый промпт сопровождается пояснениями, как и почему он работает. Библиотека создана самой Anthropic.

🎉🎉🎉
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Прежде чем вам пересылать такие посты, я обычно спрашиваю своего кло - интересно, стоит заняться?

С память я и без кло знаю - что важно. Но вот когда дойдут до этого руки... У меня сейчас, кстати, стоят параллельно claude-mem и agentmemory. Иногда использую, но не сказать, чтобы это прям в систему вошло

https://t.me/machinelearning_interview/2855
Fable вернулся, но чуда не случилось. Склонен согласиться с критиками, что теперь это просто Опус, магия пропала. Интересно, что будет с GPT-5.6, насколько зарежут Sol.
Forwarded from Вайб-кодинг
Несколько ресурсов по harness engineering, которые я с большим удовольствием изучаю в последнее время:

» https://walkinglabs.github.io/learn-harness-engineering/en/ — отличный курс о том, как продуктивно ограничивать поведение агента, какие проблемы возникают при использовании LLM (особенно с удержанием контекста) и как сделать harness более агентным и доводящим задачи до корректного завершения.
» https://twotimespi.dev — создай упрощённого агента на Python (Tau). Начни с uv tool install tau-ai.
» https://humanlayer.dev/blog/skill-issue-harness-engineering-for-coding-agents — уроки и выводы из неудач и успехов в построении harness-ов для кодинг-агентов за 12+ месяцев.
» https://langchain.com/blog/the-anatomy-of-an-agent-harness — обзор высокого уровня множества компонентов, которые должны правильно сойтись в harness-е, чтобы агент работал.

🐸🐸🐸
Please open Telegram to view this post
VIEW IN TELEGRAM
Cursor наконец дообучил свою модельку на мощностях xAI. Раньше они работали с Kimi-2.6 - интересно, насколько новая модель ее развитие, или писали прямо все свое с нуля.

Предложение интересное, особенно для тех, кто сидит на Курсоре, но у меня и так уже три модели по подписке - GPT, Claude, GLM, плюс по апи DeepSeek - пятую уже не осилю

https://t.me/data_secrets/9508
У Клода есть фишка, которой я пользуюсь чаще и чаще - Claude Design. Начинаю отвыкать от самостоятельного изготовления презентаций. Думаю, что это уже навсегда.
Когда я вайбкодю, очень часто использую разные модели. Одна программирует - другие проверяют. Это позволяет находить много ошибок, и бонус в том, что разные модели на код смотрят по разному, здесь разнообразие принципиально важно.

Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Новый стандарт для голосовых ассистентов - надеюсь, недолго ждать когда появятся подобные локальные модели. Тот же Sber может постараться - его Salut для распознавания голоса я использую активно.

Думаю, через какое-то время и у мошенников уйдет украинский акцент..

https://t.me/vibecoding_tg/3445
Раньше были лайфхаки для домохозяек и всякие «очумелые ручки». Теперь - рецепты для вайбкодеров. Ниже - один из них.

https://t.me/vibecoding_tg/3449

Есть еще популярный промпт caveman - по моему опыту работает, хотя и не идеально, но я его использую не для выдачи моделей, а для подготовки промптов у агентов.

https://t.me/lovedeathtransformers/10809
ChatGPT вышел, а лимиты обновили у Claude code )) опять два дня можно жечь токены без разбора.

Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.

Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Ну и кстати, еще одна интересная обнова - Muse Spark 1.1. от Мета. Дешевле Grok 4.5 и по тестам сильнее. Осталось только Gemini 3.5 Pro долждаться, и вся семья в сборе (американская). А от китайцев ждем обновление DeepSeek, MiniMax..

И похоже, надо внимательнее посмотреть на OpenHands

https://t.me/data_secrets/9519
Пожалуй, такой лайфхак попробую у себя в проекте.

https://t.me/tips_ai/4799

Одна из проблем, от которой сильно страдаю - это то, что нейронки пишут очень много всего лишнего. В своем харнесе сделал специальную директорию, чтобы они могли писать туда все, что угодно. Остальные пути жестко контролирую.
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT.

Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать
Sol - Max, Terra- Ultra, Luna - Max. И дальше уже делать выбор между моделями, которые больше подходят. Основное - пищем на Терре.

В любом случае, даже у Sol, когда показываешь результаты Claude, GLM-5.2 и DeepSeek V4, ошибки находятся. И китайские модели в их поиске выглядят совсем неплохо - не сильно хуже гпт и клода.
Fable сегодня уберут из стандартных планов, оставят только по апи, но ходят слухи, что уже на следующей неделе нас ждет Opus 5 - ответ Антропика на GPT-5.6
Какое-то время назад полностью пересел с десктопного приложения Claude на терминал и его производные - Ghostty, cmux, Orca.

Теперь иду обратно - пробую ChatGPT Work. В приложении подключил booking.com и выбрал себе гостиницу - в принципе, все это можно сделать и на самом сайте, но здесь прикручен Codex и ты можешь ему ставить задачки как нейронке - ну, например, найти гостиницу рядом с водопадом или с видом на горы.

Вот и Claude Desktop также встроил в приложение браузер.

Есть ощущение, что Cloude Desktop (после того, как включат в него Design - создание презентаций) и ChatGPT Work терминал все-таки победят. Я бы на это поставил
Unsloth выпустила новые динамические квантизации для Qwen-3.6, которые работают в 2 раза быстрее обычных. Запускаются на 32 гигабайтах памяти - видимо, это лучшие локальные модели на текущий момент

https://huggingface.co/collections/unsloth/nvfp4
very vibe coding
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT. Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать Sol…
Нет, я ошибался. GPT Sol жрет токены гораздо лучше Fable. За час легко высаживает пятичасовой лимит и треть недельного лимита. Видимо, впервые придется воспользоваться обновлением лимита - если не знаете, OpenAI сделала такую опцию и вас тоже наверняка перезагрузки в запасе есть. И полностью переходить на Terra.
В продолжение темы

https://t.me/ai_machinelearning_big_data/10503
Продлили Fable. Я напоследок заказывал ему deep research, и с третьего пинка он, наконец, его сделал. Честно говоря, я впечатлен, многое для меня стало новым, хотя не первый день занимаюсь темой. Так что новости отличные

Еще из новостей - обновил Claude Desktop - и вижу, что Claude Design туда тоже перетащили. Ну все, можно возвращаться из терминала к приложению...

https://t.me/ai_newz/4648
🔥1