very vibe coding
122 subscribers
464 photos
126 videos
13 files
1K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Роскомнадзор в последнее время активизировался с баном легко вычисляемых vpn, работающих через нестандартные порты. Опять будут пляски с бубном.
Ну и whapsapp сегодня не только же у меня нормально позвонить не дает? Видимо, испытания проводятся. А может на постоянку уже решили прижать
Говорят, что скоро выход Gemini 3, и по бенчмаркам она будет рвать gpt-5 и grok 4. Вспоминая прошлые релизы Google, а это можно верить. Интересно, насколько она будет бесплатная..
Несмотря на море негатива с запуском gpt-5, про модель говорят, что она чудо как хорошо а в кодинге. Мало ошибок. При этом в работе с моделью есть один нюанс - она понимает то, что вы написали буквально, т.е. в промптах нужно быть максимально точным и конкретным, без двусмысленностей и додумываний.

Есть мнение, что комбинация Claude Opus 4.1 как оркестратора и GPT-5 как программиста дает максимальный результат

Кто-то говорит, что лучше наоборот. В любом случае, я достаточно часто по одному и тому же вопросу провожу обсуждение с несколькими моделями - и это лучше, чем все яйца положить в одну корзину
Есть новости и от Антропика - теперь Claude может искать информацию в предыдущих диалогах. Казалось бы не так важно, но есть один кейс, когда это критично. Когда весь контекст для диалога выбран, он прекращается внезапно, без возможности сделать саммари для нового диалога. Вот этой проблемы теперь, надеюсь (не проверял еще) не существует - в новом диалоге можно попросить сделать выжимку из прошлого. Очевидная фича, даже непонятно, что так долго ее не выпускали, в любом случае, лучше поздно, чем никогда.

А в целом, учитывая, что большой контекст и дорого стоит, и модель на нем хуже работает, все должно прийти к тому, что контекст должен формироваться отдельной маленькой моделью чуть ли не при каждом запросе - это будет экономить множество вычислений.

В этом плане обратите внимание, что есть не только RAG, но и такая тема как CAG - управление информацией, которая сидит в кэше модели (кстати, эти токены для модели в разы дешевле)
Forwarded from Vibe Coding Community
Бесплатная альтернатива Cursor - https://www.trae.ai/

Без ограничений по токенам. С Claude 3.7. Пользуйтесь пока не закрыли.
Открытые модельки got-oss раскатали у себя много кто, и, самое интересное, точность этой модели у разных провайдеров разная - об этом можно посмотреть по ссылке. Впрочем, статистически разные результаты будут возникать и при абсолютно одинаковых моделях, здесь надо внимательно смотреть на доверительные интервалы. В любом случае, обвязка, системные промпты - важны. Надо настраивать свои модели под себя
Forwarded from CodeCamp
Внезапная годнота для VSCode — Microsoft выкатили полноценную IDE для PostgreSQL прямо внутри редактора кода.

При чём это не просто плагин (хотя это плагин), а мощнейшая станция управления базой данных с кучей инструментов.

— Полная визуализация схемы — таблицы, связи, поля. Всё прямо в редакторе;
— Подсветка синтаксиса и автокомплит;
— Под капотом Copilot, он сейчас работает на Claude 4 Sonnet;
— История запросов и быстрый доступ к часто используемым шаблонам.

Всё работает через агента @pgsql, который реально помогает работать с запросами, как будто у вас на проекте появился свой DBA.

Уже в маркетплейсе
Вроде бы начинают раздавать Claude с контекстом в миллион токенов - давно пора. А вообще, память для моделей и большой контекст, похоже, - это звенья одной цепи, которые называются "управление памятью". Готов биться о заклад, что этот миллион токенов в контексте на поверку окажется, так скажем, "гибридным", а не прямолинейным. Антропик умеет считать баблос
После того, как Mistral спалили на то, что те выдавали за свою модель дистилированный DeepSeek, даже уж и не знаю как относиться к новой модельке. В свое время я им закинул на апи $5, теперь не знаю что с этим делать - правда, говорят что есть у них SOTA модель в части распознавания сканов, но после выхода библиотеки google по извлечению информации и в этом может быть мало смысла
Конкуренция - великая сила. OpenAI тоже запустил поиск информации по прошлым разговорам
OpenAI добавила выбор моделей помимо авто режима - кроме thinking и pro появились быстрый режим и 4о. Говорят, вернут о3 и еще несколько моделей. Также раскатывают, начиная с дорогих планов, интеграцию с Google male, drive, calendar.
С утречка выбрал свой лимит общения с Клодам за два (!!) обращения к Claude Opus (вернее одно обращение, которое в первый раз сорвалось из-за проблем со связью). Пяток вопросов к Sonnet до этого не в счет. Честно говоря, не знаю что и думать, но что знаю точно - Opus использовать вместе с интернетом нельзя категорически
💯1
И по поводу большого контекста для Клода я бы пока сильно не радовался - при превышении 200 тыс токенов цена генерации сильно вырастает - проплаченные лимиты будут заканчиваться моментально. Так что, придется по-прежнему экономить
Самая милая новость недели - Google сделает за вас для ребенка сказку на ночь, да еще и с картинками. Работает и на телефоне, но думаю, что идеально будет использовать айпад. Но вот промпт все-таки еще понадобится
Новости от Qwen. Идут постоянно, вот и сегодня - развернули модельку на 30b параметров, mixture of experts, на 3b каждый. На моей машинке не запустишь, но если докупить второй мак мини, можно было бы попробовать. Метрики отличные, только веры им мало. Вообще, по метрикам из опенсорсных моделей (все - китайские, что бы без них делали?) рейтинг такой:
Qwen 235b,
Kimi K2,
Deepseek R1,
GLM 4.5,
Minimax M1.
Qwen 30b заявляет уровень Kimi K2

Початиться с моделькой можно по ссылке:
https://chat.qwen.ai/?model=Qwen3-30B-A3B-2507
Вот тоже такие планы имею, но не дорос пока, не то, чтобы это видео на 2,5 часа отсмотрел, но 8 агентов хочу очень ))

https://t.me/vibe_coding_community/4678