У Клода есть фишка, которой я пользуюсь чаще и чаще - Claude Design. Начинаю отвыкать от самостоятельного изготовления презентаций. Думаю, что это уже навсегда.
Когда я вайбкодю, очень часто использую разные модели. Одна программирует - другие проверяют. Это позволяет находить много ошибок, и бонус в том, что разные модели на код смотрят по разному, здесь разнообразие принципиально важно.
Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Новый стандарт для голосовых ассистентов - надеюсь, недолго ждать когда появятся подобные локальные модели. Тот же Sber может постараться - его Salut для распознавания голоса я использую активно.
Думаю, через какое-то время и у мошенников уйдет украинский акцент..
https://t.me/vibecoding_tg/3445
Думаю, через какое-то время и у мошенников уйдет украинский акцент..
https://t.me/vibecoding_tg/3445
Telegram
Вайб-кодинг
Вчера OpenAI представила GPT-Live — новое поколение голосовых моделей, которые теперь лежат в основе режима ChatGPT Voice.
Главное изменение - поддержка full-duplex. Модель одновременно слушает и говорит, поэтому может естественно вставить короткое «угу»…
Главное изменение - поддержка full-duplex. Модель одновременно слушает и говорит, поэтому может естественно вставить короткое «угу»…
Раньше были лайфхаки для домохозяек и всякие «очумелые ручки». Теперь - рецепты для вайбкодеров. Ниже - один из них.
https://t.me/vibecoding_tg/3449
Есть еще популярный промпт caveman - по моему опыту работает, хотя и не идеально, но я его использую не для выдачи моделей, а для подготовки промптов у агентов.
https://t.me/lovedeathtransformers/10809
https://t.me/vibecoding_tg/3449
Есть еще популярный промпт caveman - по моему опыту работает, хотя и не идеально, но я его использую не для выдачи моделей, а для подготовки промптов у агентов.
https://t.me/lovedeathtransformers/10809
Telegram
Вайб-кодинг
Исследователи из Стэнфорда разработали новую технику промптинга.
Добавление примерно 20 слов в промпт позволяет:
- увеличить креативность LLM в 1,6–2 раза;
- повысить разнообразие ответов по оценкам людей на 25,7%;
- превзойти дообученную модель без какого…
Добавление примерно 20 слов в промпт позволяет:
- увеличить креативность LLM в 1,6–2 раза;
- повысить разнообразие ответов по оценкам людей на 25,7%;
- превзойти дообученную модель без какого…
ChatGPT вышел, а лимиты обновили у Claude code )) опять два дня можно жечь токены без разбора.
Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.
Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.
Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Ну и кстати, еще одна интересная обнова - Muse Spark 1.1. от Мета. Дешевле Grok 4.5 и по тестам сильнее. Осталось только Gemini 3.5 Pro долждаться, и вся семья в сборе (американская). А от китайцев ждем обновление DeepSeek, MiniMax..
И похоже, надо внимательнее посмотреть на OpenHands
https://t.me/data_secrets/9519
И похоже, надо внимательнее посмотреть на OpenHands
https://t.me/data_secrets/9519
Telegram
Data Secrets
Новая Muse Spark 1.1 от Meta* показала отличные результаты на Vibe Code Bench с агентскими задачами. Обратите внимание на столбик с ценой и скоростью.
Скачок качества относительно первой версии модели, вышедшей в начале года, огромный
Скачок качества относительно первой версии модели, вышедшей в начале года, огромный
Пожалуй, такой лайфхак попробую у себя в проекте.
https://t.me/tips_ai/4799
Одна из проблем, от которой сильно страдаю - это то, что нейронки пишут очень много всего лишнего. В своем харнесе сделал специальную директорию, чтобы они могли писать туда все, что угодно. Остальные пути жестко контролирую.
https://t.me/tips_ai/4799
Одна из проблем, от которой сильно страдаю - это то, что нейронки пишут очень много всего лишнего. В своем харнесе сделал специальную директорию, чтобы они могли писать туда все, что угодно. Остальные пути жестко контролирую.
Telegram
Tips AI | IT & AI
Я конечно видел много способов harness для агентов, но это пожалуй самый прикольный:
Парень придумал для агентов papercuts, чтобы они могли жаловаться на любую ерунду которую нашли во время выполнения задачи
Потом по этим записям можно понять какие узкие…
Парень придумал для агентов papercuts, чтобы они могли жаловаться на любую ерунду которую нашли во время выполнения задачи
Потом по этим записям можно понять какие узкие…
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT.
Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать
Sol - Max, Terra- Ultra, Luna - Max. И дальше уже делать выбор между моделями, которые больше подходят. Основное - пищем на Терре.
В любом случае, даже у Sol, когда показываешь результаты Claude, GLM-5.2 и DeepSeek V4, ошибки находятся. И китайские модели в их поиске выглядят совсем неплохо - не сильно хуже гпт и клода.
Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать
Sol - Max, Terra- Ultra, Luna - Max. И дальше уже делать выбор между моделями, которые больше подходят. Основное - пищем на Терре.
В любом случае, даже у Sol, когда показываешь результаты Claude, GLM-5.2 и DeepSeek V4, ошибки находятся. И китайские модели в их поиске выглядят совсем неплохо - не сильно хуже гпт и клода.
Fable сегодня уберут из стандартных планов, оставят только по апи, но ходят слухи, что уже на следующей неделе нас ждет Opus 5 - ответ Антропика на GPT-5.6
Какое-то время назад полностью пересел с десктопного приложения Claude на терминал и его производные - Ghostty, cmux, Orca.
Теперь иду обратно - пробую ChatGPT Work. В приложении подключил booking.com и выбрал себе гостиницу - в принципе, все это можно сделать и на самом сайте, но здесь прикручен Codex и ты можешь ему ставить задачки как нейронке - ну, например, найти гостиницу рядом с водопадом или с видом на горы.
Вот и Claude Desktop также встроил в приложение браузер.
Есть ощущение, что Cloude Desktop (после того, как включат в него Design - создание презентаций) и ChatGPT Work терминал все-таки победят. Я бы на это поставил
Теперь иду обратно - пробую ChatGPT Work. В приложении подключил booking.com и выбрал себе гостиницу - в принципе, все это можно сделать и на самом сайте, но здесь прикручен Codex и ты можешь ему ставить задачки как нейронке - ну, например, найти гостиницу рядом с водопадом или с видом на горы.
Вот и Claude Desktop также встроил в приложение браузер.
Есть ощущение, что Cloude Desktop (после того, как включат в него Design - создание презентаций) и ChatGPT Work терминал все-таки победят. Я бы на это поставил
Unsloth выпустила новые динамические квантизации для Qwen-3.6, которые работают в 2 раза быстрее обычных. Запускаются на 32 гигабайтах памяти - видимо, это лучшие локальные модели на текущий момент
https://huggingface.co/collections/unsloth/nvfp4
https://huggingface.co/collections/unsloth/nvfp4
huggingface.co
NVFP4 - a unsloth Collection
Dynamic Unsloth NVFP4 Quants. Faster and more accurate.
very vibe coding
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT. Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать Sol…
Нет, я ошибался. GPT Sol жрет токены гораздо лучше Fable. За час легко высаживает пятичасовой лимит и треть недельного лимита. Видимо, впервые придется воспользоваться обновлением лимита - если не знаете, OpenAI сделала такую опцию и вас тоже наверняка перезагрузки в запасе есть. И полностью переходить на Terra.
Продлили Fable. Я напоследок заказывал ему deep research, и с третьего пинка он, наконец, его сделал. Честно говоря, я впечатлен, многое для меня стало новым, хотя не первый день занимаюсь темой. Так что новости отличные
Еще из новостей - обновил Claude Desktop - и вижу, что Claude Design туда тоже перетащили. Ну все, можно возвращаться из терминала к приложению...
https://t.me/ai_newz/4648
Еще из новостей - обновил Claude Desktop - и вижу, что Claude Design туда тоже перетащили. Ну все, можно возвращаться из терминала к приложению...
https://t.me/ai_newz/4648
Telegram
эйай ньюз
Anthropic продлили доступ к Fable 5 ещё на неделю
Кроме этого продлили увеличение лимитов на 50% на ту же неделю. Вот что конкуренция животворящая делает. Интересно, сколько ещё раз они будут проворачивать этот трюк.
@ai_newz
Кроме этого продлили увеличение лимитов на 50% на ту же неделю. Вот что конкуренция животворящая делает. Интересно, сколько ещё раз они будут проворачивать этот трюк.
@ai_newz
🔥1
Посмотрел тут на результаты работы Sol - и что-то совсем разочарован. Токены уничтожены, все откатываю обратно. Видно, придется учиться более тщательно подбирать модель и усилия, чтобы держаться в лимитах, но ведь и результат пока не особо радует.. в отличие от Fable. Придется больше времени потратить на донастройку
Не только я заметил растрату токенов. OpenAI отменяет 5-часовые лимиты и перенастраивает Sol. Будем надеяться, станет работать лучше. А пока идет настройка, стоит следить за размером контекста и все-таки не злоупотреблять с max, ultra - как минимум, на Sol
https://t.me/vibecoding_tg/3470
https://t.me/vibecoding_tg/3470
Telegram
Вайб-кодинг
Хорошие новости от OpenAI: подвезли обновления для Codex и ChatGPT Work.
> внедрили оптимизации инференса и передали полученную экономию всем подписчикам GPT-5.6 Sol. В результате доступный объем использования должен увеличиться примерно на 10%.
> обнаружили…
> внедрили оптимизации инференса и передали полученную экономию всем подписчикам GPT-5.6 Sol. В результате доступный объем использования должен увеличиться примерно на 10%.
> обнаружили…
Я подобные модели использую активно - у меня стоит программка Handy, в которой живет Sber Salut - это для русского лучше чем Whisper. Но модель уже не менял давно. Видимо, пришло время
https://t.me/lovedeathtransformers/10857
https://t.me/lovedeathtransformers/10857
Telegram
Love. Death. Transformers.
GigaChat Audio и GigaAM Multilingual: новые Open Source модели с поддержкой длинного контекста и языков СНГ 🔥
Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество…
Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество…
И моделька, которая метит в лидеры по распознаванию текстов. Компактная, на 1В параметров
https://huggingface.co/ATH-MaaS/OvisOCR2
https://huggingface.co/ATH-MaaS/OvisOCR2
huggingface.co
ATH-MaaS/OvisOCR2 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Если вам нужна мощная бесплатная модель - это Hy3. На OpenRouter сейчас это самая популярная модель. Правда, все бесплатное там когда-то заканчивается. Модель весит всего 295В, так что это в теории можно будет запускать и локально на мощных Mac Studio.
https://openrouter.ai/tencent/hy3:free
https://openrouter.ai/tencent/hy3:free
openrouter.ai
Hy3 - API Pricing & Benchmarks
Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-world production use. $0.07 per million input tokens, $0.29 per million output tokens. 262,144 token…