very vibe coding
120 subscribers
460 photos
126 videos
13 files
980 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
ChatGPT вышел, а лимиты обновили у Claude code )) опять два дня можно жечь токены без разбора.

Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.

Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Ну и кстати, еще одна интересная обнова - Muse Spark 1.1. от Мета. Дешевле Grok 4.5 и по тестам сильнее. Осталось только Gemini 3.5 Pro долждаться, и вся семья в сборе (американская). А от китайцев ждем обновление DeepSeek, MiniMax..

И похоже, надо внимательнее посмотреть на OpenHands

https://t.me/data_secrets/9519
Пожалуй, такой лайфхак попробую у себя в проекте.

https://t.me/tips_ai/4799

Одна из проблем, от которой сильно страдаю - это то, что нейронки пишут очень много всего лишнего. В своем харнесе сделал специальную директорию, чтобы они могли писать туда все, что угодно. Остальные пути жестко контролирую.
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT.

Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать
Sol - Max, Terra- Ultra, Luna - Max. И дальше уже делать выбор между моделями, которые больше подходят. Основное - пищем на Терре.

В любом случае, даже у Sol, когда показываешь результаты Claude, GLM-5.2 и DeepSeek V4, ошибки находятся. И китайские модели в их поиске выглядят совсем неплохо - не сильно хуже гпт и клода.
Fable сегодня уберут из стандартных планов, оставят только по апи, но ходят слухи, что уже на следующей неделе нас ждет Opus 5 - ответ Антропика на GPT-5.6
Какое-то время назад полностью пересел с десктопного приложения Claude на терминал и его производные - Ghostty, cmux, Orca.

Теперь иду обратно - пробую ChatGPT Work. В приложении подключил booking.com и выбрал себе гостиницу - в принципе, все это можно сделать и на самом сайте, но здесь прикручен Codex и ты можешь ему ставить задачки как нейронке - ну, например, найти гостиницу рядом с водопадом или с видом на горы.

Вот и Claude Desktop также встроил в приложение браузер.

Есть ощущение, что Cloude Desktop (после того, как включат в него Design - создание презентаций) и ChatGPT Work терминал все-таки победят. Я бы на это поставил
Unsloth выпустила новые динамические квантизации для Qwen-3.6, которые работают в 2 раза быстрее обычных. Запускаются на 32 гигабайтах памяти - видимо, это лучшие локальные модели на текущий момент

https://huggingface.co/collections/unsloth/nvfp4
very vibe coding
Тестирую GPT Sol - первое впечатление: токены жрет не хуже Fable. Раньше мне никогда не удавалось так быстро высаживать лимиты у GPT. Кстати - по выбору модели. Судя по бенчмаркам и тому, что пишут в интернетах, уровень услилий у GPT-5.6 надо выбирать Sol…
Нет, я ошибался. GPT Sol жрет токены гораздо лучше Fable. За час легко высаживает пятичасовой лимит и треть недельного лимита. Видимо, впервые придется воспользоваться обновлением лимита - если не знаете, OpenAI сделала такую опцию и вас тоже наверняка перезагрузки в запасе есть. И полностью переходить на Terra.
В продолжение темы

https://t.me/ai_machinelearning_big_data/10503
Продлили Fable. Я напоследок заказывал ему deep research, и с третьего пинка он, наконец, его сделал. Честно говоря, я впечатлен, многое для меня стало новым, хотя не первый день занимаюсь темой. Так что новости отличные

Еще из новостей - обновил Claude Desktop - и вижу, что Claude Design туда тоже перетащили. Ну все, можно возвращаться из терминала к приложению...

https://t.me/ai_newz/4648
🔥1
Посмотрел тут на результаты работы Sol - и что-то совсем разочарован. Токены уничтожены, все откатываю обратно. Видно, придется учиться более тщательно подбирать модель и усилия, чтобы держаться в лимитах, но ведь и результат пока не особо радует.. в отличие от Fable. Придется больше времени потратить на донастройку
Не только я заметил растрату токенов. OpenAI отменяет 5-часовые лимиты и перенастраивает Sol. Будем надеяться, станет работать лучше. А пока идет настройка, стоит следить за размером контекста и все-таки не злоупотреблять с max, ultra - как минимум, на Sol

https://t.me/vibecoding_tg/3470
А, вру, проверил - уже стоит GigaAM v3. Откуда - не знаю
В text-to-speech моделях новый лидер. Правда, это платно..
И моделька, которая метит в лидеры по распознаванию текстов. Компактная, на 1В параметров

https://huggingface.co/ATH-MaaS/OvisOCR2
Если вам нужна мощная бесплатная модель - это Hy3. На OpenRouter сейчас это самая популярная модель. Правда, все бесплатное там когда-то заканчивается. Модель весит всего 295В, так что это в теории можно будет запускать и локально на мощных Mac Studio.

https://openrouter.ai/tencent/hy3:free
Клод отлично ищет уязвимости. Остается только один вопрос - обо всех ли уязвимостях рассказывает Claude, и не остается ли какая-то часть за кадром, в рамках программы взаимодействия с правительством США?

Уязвимости поискать хочется, только как доверять эту работу проприетарным моделям?

https://t.me/machinelearning_interview/2873
Иметь большую модель, обученную под себя? Это интересно. Проблема в том, что цена обучения с ростом модели растет. нелинейно, и обучать большие модели дорого. Но может это уже как-то порешали?

Команда этим занимается серьезная - бывшие боссы OpenAI

https://t.me/ai_machinelearning_big_data/10528
За последнюю неделю у меня человек пять спросило, в чем я делаю презентации. В Claude Design.

Уже писал, что эта программа пару месяцев назад сделала большой скачок вперед. Для успешной работы надо потратить пару часов для подготовки типового макета. На тарифе в 20 долларов рисовать можно, но токены тратятся быстро, может не хватать 5-часового лимита. В Sonnet я не очень верю, сам использую для рисования Opus, и вам того же советую.

Сама программа тоже меняется, я бы сказал, немного упрощается. Процесс подготовки презентации выглядит, конечно иначе - вместо рисования, постоянно словами говоришь, что править. Но к этому привыкаешь, рисовать больше не хочется.

Можно, кстати, писать презентации и прямо в Claude Code. Я загрузил туда шаблон, и презентация программируется Клодом на питоне. Это тоже работает, и неплохо. По ощущениям, даже как-то более экономно по токенам. Советую попробовать.

Похожие функции есть и в последнем ChatGPT Work, но честно скажу, не пробовал. Исправлюсь, как будет больше времени.
О, у Apple, судя по всему, через неделю будет событие, посвященное AI. Учитывая, что с продажи на официальном сайте сняли последние Mac Studio, надеюсь, это будет запуск новой линейки Mac mini и Mac Studio с М5. Сейчас это лучшее железо для локального ИИ.

Кстати, планируется, что максимальный студио будет с 770 Гб памяти - это позволит раскатывать на одной машине реально большие модели типа квантованной GLM-5.2.