Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic выпустили официальную библиотеку промптов для Claude.
И она полностью бесплатна. Там есть:
- Планирование, отладка, ревью кода, безопасность, автоматизация
Каждый промпт сопровождается пояснениями, как и почему он работает. Библиотека создана самой Anthropic.
🎉 🎉 🎉
И она полностью бесплатна. Там есть:
- Планирование, отладка, ревью кода, безопасность, автоматизация
Каждый промпт сопровождается пояснениями, как и почему он работает. Библиотека создана самой Anthropic.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Прежде чем вам пересылать такие посты, я обычно спрашиваю своего кло - интересно, стоит заняться?
С память я и без кло знаю - что важно. Но вот когда дойдут до этого руки... У меня сейчас, кстати, стоят параллельно claude-mem и agentmemory. Иногда использую, но не сказать, чтобы это прям в систему вошло
https://t.me/machinelearning_interview/2855
С память я и без кло знаю - что важно. Но вот когда дойдут до этого руки... У меня сейчас, кстати, стоят параллельно claude-mem и agentmemory. Иногда использую, но не сказать, чтобы это прям в систему вошло
https://t.me/machinelearning_interview/2855
Telegram
Machine learning Interview
⚡️ 30 техник памяти для AI-агентов в Jupyter notebooks
Вышел репозиторий Agent Memory Techniques с 30 runnable notebooks по памяти в современных AI-агентах.
Внутри собраны основные подходы: conversation buffers, vector stores, knowledge graphs, episodic…
Вышел репозиторий Agent Memory Techniques с 30 runnable notebooks по памяти в современных AI-агентах.
Внутри собраны основные подходы: conversation buffers, vector stores, knowledge graphs, episodic…
Fable вернулся, но чуда не случилось. Склонен согласиться с критиками, что теперь это просто Опус, магия пропала. Интересно, что будет с GPT-5.6, насколько зарежут Sol.
Forwarded from Вайб-кодинг
Несколько ресурсов по harness engineering, которые я с большим удовольствием изучаю в последнее время:
» https://walkinglabs.github.io/learn-harness-engineering/en/ — отличный курс о том, как продуктивно ограничивать поведение агента, какие проблемы возникают при использовании LLM (особенно с удержанием контекста) и как сделать harness более агентным и доводящим задачи до корректного завершения.
» https://twotimespi.dev — создай упрощённого агента на Python (Tau). Начни с
» https://humanlayer.dev/blog/skill-issue-harness-engineering-for-coding-agents — уроки и выводы из неудач и успехов в построении harness-ов для кодинг-агентов за 12+ месяцев.
» https://langchain.com/blog/the-anatomy-of-an-agent-harness — обзор высокого уровня множества компонентов, которые должны правильно сойтись в harness-е, чтобы агент работал.
🐸 🐸 🐸
» https://walkinglabs.github.io/learn-harness-engineering/en/ — отличный курс о том, как продуктивно ограничивать поведение агента, какие проблемы возникают при использовании LLM (особенно с удержанием контекста) и как сделать harness более агентным и доводящим задачи до корректного завершения.
» https://twotimespi.dev — создай упрощённого агента на Python (Tau). Начни с
uv tool install tau-ai.» https://humanlayer.dev/blog/skill-issue-harness-engineering-for-coding-agents — уроки и выводы из неудач и успехов в построении harness-ов для кодинг-агентов за 12+ месяцев.
» https://langchain.com/blog/the-anatomy-of-an-agent-harness — обзор высокого уровня множества компонентов, которые должны правильно сойтись в harness-е, чтобы агент работал.
Please open Telegram to view this post
VIEW IN TELEGRAM
walkinglabs.github.io
Welcome to Learn Harness Engineering | Learn Harness Engineering
A project-based course on designing the environments, state, verification, and control systems that make Codex and Claude Code reliable.
Будет хорош Sol, глядишь, и не денется никуда Fable. Кастрированный, но останется работать и после 12го
https://t.me/denissexy/11545
https://t.me/denissexy/11545
Telegram
Denis Sexy IT 🤖
Fable 5 оставили в Claude Code до 12го июля
Это я что, зря всю ночь его гонял тратя лимиты вместо сна 👤
Видимо релиз 5.6 Sol совсем скоро
Это я что, зря всю ночь его гонял тратя лимиты вместо сна 👤
Видимо релиз 5.6 Sol совсем скоро
Cursor наконец дообучил свою модельку на мощностях xAI. Раньше они работали с Kimi-2.6 - интересно, насколько новая модель ее развитие, или писали прямо все свое с нуля.
Предложение интересное, особенно для тех, кто сидит на Курсоре, но у меня и так уже три модели по подписке - GPT, Claude, GLM, плюс по апи DeepSeek - пятую уже не осилю
https://t.me/data_secrets/9508
Предложение интересное, особенно для тех, кто сидит на Курсоре, но у меня и так уже три модели по подписке - GPT, Claude, GLM, плюс по апи DeepSeek - пятую уже не осилю
https://t.me/data_secrets/9508
Telegram
Data Secrets
⚡️ Вышел Grok 4.5
Релиз пришел откуда не ждали. Это первая модель от xAI (теперь уже SpaceX), ориентированная на кодинг и агентов. Итак:
– По бенчмаркам в целом уровень GPT-5.5 и Opus 4.8, но на SWE Pro пока не дотягивает.
– При этом модель быстрее…
Релиз пришел откуда не ждали. Это первая модель от xAI (теперь уже SpaceX), ориентированная на кодинг и агентов. Итак:
– По бенчмаркам в целом уровень GPT-5.5 и Opus 4.8, но на SWE Pro пока не дотягивает.
– При этом модель быстрее…
У Клода есть фишка, которой я пользуюсь чаще и чаще - Claude Design. Начинаю отвыкать от самостоятельного изготовления презентаций. Думаю, что это уже навсегда.
Когда я вайбкодю, очень часто использую разные модели. Одна программирует - другие проверяют. Это позволяет находить много ошибок, и бонус в том, что разные модели на код смотрят по разному, здесь разнообразие принципиально важно.
Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Новый стандарт для голосовых ассистентов - надеюсь, недолго ждать когда появятся подобные локальные модели. Тот же Sber может постараться - его Salut для распознавания голоса я использую активно.
Думаю, через какое-то время и у мошенников уйдет украинский акцент..
https://t.me/vibecoding_tg/3445
Думаю, через какое-то время и у мошенников уйдет украинский акцент..
https://t.me/vibecoding_tg/3445
Telegram
Вайб-кодинг
Вчера OpenAI представила GPT-Live — новое поколение голосовых моделей, которые теперь лежат в основе режима ChatGPT Voice.
Главное изменение - поддержка full-duplex. Модель одновременно слушает и говорит, поэтому может естественно вставить короткое «угу»…
Главное изменение - поддержка full-duplex. Модель одновременно слушает и говорит, поэтому может естественно вставить короткое «угу»…
Раньше были лайфхаки для домохозяек и всякие «очумелые ручки». Теперь - рецепты для вайбкодеров. Ниже - один из них.
https://t.me/vibecoding_tg/3449
Есть еще популярный промпт caveman - по моему опыту работает, хотя и не идеально, но я его использую не для выдачи моделей, а для подготовки промптов у агентов.
https://t.me/lovedeathtransformers/10809
https://t.me/vibecoding_tg/3449
Есть еще популярный промпт caveman - по моему опыту работает, хотя и не идеально, но я его использую не для выдачи моделей, а для подготовки промптов у агентов.
https://t.me/lovedeathtransformers/10809
Telegram
Вайб-кодинг
Исследователи из Стэнфорда разработали новую технику промптинга.
Добавление примерно 20 слов в промпт позволяет:
- увеличить креативность LLM в 1,6–2 раза;
- повысить разнообразие ответов по оценкам людей на 25,7%;
- превзойти дообученную модель без какого…
Добавление примерно 20 слов в промпт позволяет:
- увеличить креативность LLM в 1,6–2 раза;
- повысить разнообразие ответов по оценкам людей на 25,7%;
- превзойти дообученную модель без какого…
ChatGPT вышел, а лимиты обновили у Claude code )) опять два дня можно жечь токены без разбора.
Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.
Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.
Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Ну и кстати, еще одна интересная обнова - Muse Spark 1.1. от Мета. Дешевле Grok 4.5 и по тестам сильнее. Осталось только Gemini 3.5 Pro долждаться, и вся семья в сборе (американская). А от китайцев ждем обновление DeepSeek, MiniMax..
И похоже, надо внимательнее посмотреть на OpenHands
https://t.me/data_secrets/9519
И похоже, надо внимательнее посмотреть на OpenHands
https://t.me/data_secrets/9519
Telegram
Data Secrets
Новая Muse Spark 1.1 от Meta* показала отличные результаты на Vibe Code Bench с агентскими задачами. Обратите внимание на столбик с ценой и скоростью.
Скачок качества относительно первой версии модели, вышедшей в начале года, огромный
Скачок качества относительно первой версии модели, вышедшей в начале года, огромный
Пожалуй, такой лайфхак попробую у себя в проекте.
https://t.me/tips_ai/4799
Одна из проблем, от которой сильно страдаю - это то, что нейронки пишут очень много всего лишнего. В своем харнесе сделал специальную директорию, чтобы они могли писать туда все, что угодно. Остальные пути жестко контролирую.
https://t.me/tips_ai/4799
Одна из проблем, от которой сильно страдаю - это то, что нейронки пишут очень много всего лишнего. В своем харнесе сделал специальную директорию, чтобы они могли писать туда все, что угодно. Остальные пути жестко контролирую.
Telegram
Tips AI | IT & AI
Я конечно видел много способов harness для агентов, но это пожалуй самый прикольный:
Парень придумал для агентов papercuts, чтобы они могли жаловаться на любую ерунду которую нашли во время выполнения задачи
Потом по этим записям можно понять какие узкие…
Парень придумал для агентов papercuts, чтобы они могли жаловаться на любую ерунду которую нашли во время выполнения задачи
Потом по этим записям можно понять какие узкие…
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT.
Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать
Sol - Max, Terra- Ultra, Luna - Max. И дальше уже делать выбор между моделями, которые больше подходят. Основное - пищем на Терре.
В любом случае, даже у Sol, когда показываешь результаты Claude, GLM-5.2 и DeepSeek V4, ошибки находятся. И китайские модели в их поиске выглядят совсем неплохо - не сильно хуже гпт и клода.
Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать
Sol - Max, Terra- Ultra, Luna - Max. И дальше уже делать выбор между моделями, которые больше подходят. Основное - пищем на Терре.
В любом случае, даже у Sol, когда показываешь результаты Claude, GLM-5.2 и DeepSeek V4, ошибки находятся. И китайские модели в их поиске выглядят совсем неплохо - не сильно хуже гпт и клода.
Fable сегодня уберут из стандартных планов, оставят только по апи, но ходят слухи, что уже на следующей неделе нас ждет Opus 5 - ответ Антропика на GPT-5.6
Какое-то время назад полностью пересел с десктопного приложения Claude на терминал и его производные - Ghostty, cmux, Orca.
Теперь иду обратно - пробую ChatGPT Work. В приложении подключил booking.com и выбрал себе гостиницу - в принципе, все это можно сделать и на самом сайте, но здесь прикручен Codex и ты можешь ему ставить задачки как нейронке - ну, например, найти гостиницу рядом с водопадом или с видом на горы.
Вот и Claude Desktop также встроил в приложение браузер.
Есть ощущение, что Cloude Desktop (после того, как включат в него Design - создание презентаций) и ChatGPT Work терминал все-таки победят. Я бы на это поставил
Теперь иду обратно - пробую ChatGPT Work. В приложении подключил booking.com и выбрал себе гостиницу - в принципе, все это можно сделать и на самом сайте, но здесь прикручен Codex и ты можешь ему ставить задачки как нейронке - ну, например, найти гостиницу рядом с водопадом или с видом на горы.
Вот и Claude Desktop также встроил в приложение браузер.
Есть ощущение, что Cloude Desktop (после того, как включат в него Design - создание презентаций) и ChatGPT Work терминал все-таки победят. Я бы на это поставил
Unsloth выпустила новые динамические квантизации для Qwen-3.6, которые работают в 2 раза быстрее обычных. Запускаются на 32 гигабайтах памяти - видимо, это лучшие локальные модели на текущий момент
https://huggingface.co/collections/unsloth/nvfp4
https://huggingface.co/collections/unsloth/nvfp4
huggingface.co
NVFP4 - a unsloth Collection
Dynamic Unsloth NVFP4 Quants. Faster and more accurate.
very vibe coding
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT. Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать Sol…
Нет, я ошибался. GPT Sol жрет токены гораздо лучше Fable. За час легко высаживает пятичасовой лимит и треть недельного лимита. Видимо, впервые придется воспользоваться обновлением лимита - если не знаете, OpenAI сделала такую опцию и вас тоже наверняка перезагрузки в запасе есть. И полностью переходить на Terra.
Продлили Fable. Я напоследок заказывал ему deep research, и с третьего пинка он, наконец, его сделал. Честно говоря, я впечатлен, многое для меня стало новым, хотя не первый день занимаюсь темой. Так что новости отличные
Еще из новостей - обновил Claude Desktop - и вижу, что Claude Design туда тоже перетащили. Ну все, можно возвращаться из терминала к приложению...
https://t.me/ai_newz/4648
Еще из новостей - обновил Claude Desktop - и вижу, что Claude Design туда тоже перетащили. Ну все, можно возвращаться из терминала к приложению...
https://t.me/ai_newz/4648
Telegram
эйай ньюз
Anthropic продлили доступ к Fable 5 ещё на неделю
Кроме этого продлили увеличение лимитов на 50% на ту же неделю. Вот что конкуренция животворящая делает. Интересно, сколько ещё раз они будут проворачивать этот трюк.
@ai_newz
Кроме этого продлили увеличение лимитов на 50% на ту же неделю. Вот что конкуренция животворящая делает. Интересно, сколько ещё раз они будут проворачивать этот трюк.
@ai_newz
🔥1