very vibe coding
125 subscribers
465 photos
126 videos
13 files
1.01K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Любопытный релиз от OpenAI - пока модели доступны только по Апи, но зато на неделю бесплатны. Заявленное точное следование промпту - то, что доктор прописал. Клод 3.7 для меня ассоциируется как раз с очень умным, но непослушным ребенком.

https://t.me/How2AI/953
Бесплатный vibe-coding (почти)

Программирую теперь в Cursor не с Claude Sonnet 3.7, а с Gemini 2.5 Pro. И мне очень нравится - более дисциплиннированная модель, а еще - токены подписки не тратятся вообще. На сайте https://aistudio.google.com модель тоже бесплатная, но в Курсоре она работает бесплатно по апи... Аттракцион невиданной щедрости - всяко в Курсоре вайбкодить в разы проще и быстрее, чем через сайт гугла.

Говорят, что теперь чемпионы по кодингу - новые модели от OpenAI, но это еще надо проверять (кстати, тоже хвалят за хорошую дисциплину и следование промпту). В любом случае, на эти модели токены в курсоре уже потребуются, поэтому пока сижу на Gemini, а там - посмотрим

PS Gemini оказалась таки не бесплатной - это все просто хитрые маркетинговые ходы. 5 центов за запрос и 5 центов за использование tools. Та же цена, что и у Клода. История - в установках оплаты за использование. Она начинает тратиться сразу, а не после того, как выбран лимит обычных запросов
Немного новостей (на самом деле их много)

У OpenAI - большие релизы. Вышли новые модели 4.1o (полная, мини и нано), которые во всем лучше 4o и должны из заменить, но доступны пока только по апи. Еще вышла полная ризонинг модель о3 (раньше была только o3 mini с вариациями) и o4 mini. Т.е. про o3 mini и o3 mini (high) забываем.

Для понимания - корпорация делает большую и затратную модел, а потом обучает модель меньшего размера так, чтобы она давала ответы на вопросы как большая. Это процесс, который называется дистилляция и так получены модели мини, которые почти так же хороши, как и большая, но заметно экономнее по ресурсам.

Еще у OpenAI появилась память, и она же появилась у бесплатного Grok 3 от Илона Маска (я почти перестал пользоваться этой моделью, она хорошая и бесплатная, но Gemini лучше). Теперь многие вещи повторять не придется, отличная штука.

У Клода появлась не память, но, судя по всему, векторный поиск по вашим данных, которые вы сложили на google disk, подключенный к Клоду (еще можно поключить календарь, почту и GitHub). И это не все. Появилась функция research как у chatGPT, Perplexity, Grok. Появились какие-то хитрые сценарии для тех кто пишет, тех, кто учится и тех, кому надо помочь в жизненных ситуациях - например, при сложном разговоре с начальником.

У Gemini вышла дистилированная от Gemini 2.5 Pro модель Gemini 2.5 Flash. Тоже хороша, сильно дешевле по апи (хотя в https://aistudio.google.com/ обе модельки бесплатные). Пожалуй, это первый выбор для работы по апи.

Еще у Google теперь подключена модель генерации видео - и это SOTA. Генерация бесплатная и очень качественная, судя по всему, OpenAI здесь отстает.

У китайцев из ByteDance (TikTok) тоже вышла крутая модель, но как-то они в последнее время отстают. Ждем новых моделей от DeepSeek, пора бы уже
❤2
Microsoft представил MCP сервер для превода файлов офиса в формат markdown
https://github.com/microsoft/markitdown

Было бы очень круто, если бы был и перевод в обратном направлении...
И еще новость из мира MCP - теперь можно подключиться и к WhatsApp.
https://github.com/lharries/whatsapp-mcp

Есть, правда, одна проблемка. Прочитал твит о том, как ломали WhatsApp, подключенный через MCP. Так что, на ваш страх и риск
Петля смерти вайбкодера. Думаю, что все вайбкодеры с этим сталкиваются, и очень рано. Начинаешь писать приложение, модель на энтузиазме генерит море кода, кучу всего планирует на будущее, подключает библиотеки, ставит заглушки, и даже выдает какой-то полуфабрикат. И дальше начинается ад вайбкодера – вайб-дебаггинг.

Ошибка может показаться небольшой, но модель в нее упирается, пытается раз, пытается два, не получается – переписывает код, сносит что-то, что работало раньше, ставятся какие-то очередные заглушки, пишутся скрипты чисто для запуска команд и тестов, которые превращают директорию в кучу хлама.

Если программирование идет на Клоде или в ChatGPT, то моментально заканчивается контекст, надо делать новый диалог, половину которого она просто будет разбирать ранее написанные файлы. В общем, здесь можно заканчивать, дальнейшее движение – это для очень упертых и сильных духом.

Какое решение?
Первый вариант – изучать программирование (его очень любят предлагать программисты). Есть, конечно, логика в том, что программист понимает, как исправить код, выйти из этой мертвой петли и пр. Но это годы, и конкурировать с этими ребятами, которые дают такие советы, будет тяжело. Конечно, по ходу пьесы, ты все-равно чего-то нахватаешься, станешь немножко программистом, но это можно считать предательством вайб-кодинга.

Второй подход – бесконечные промпты и документация. Очень жесткий контроль над тем, что создается, следование первоначальному плану, документирование каждого шага. Под это дело появляются отдельные пакеты для подготовки документации, например, буду тестить – расскажу.

Плюс, из хороших новостей – это контекст Gemini на 1 млн токенов, что ставит жирный крест на Claude Sonnet и ChatGPT. Правда, под Gemini пока нет MCP, что вынуждает использовать его вместе с Cursor, но Гугл постоянно добавляет новые фишки, надеюсь, добавит и эту.

Буду пытаться сосредоточиться на документации, посмотрим, как сработает.
Forwarded from Data Secrets
Anthropic выкатили гайд по вайб-кодингу 😎

23 страницы посвящены тому, как программировать с агентами (в частности, с Claude Code). Собраны советы, best practices, примеры, антипримеры и даже готовые промпты.

Отдельное внимание уделяется безопасности данных и мульти-агентным процессам.

Полезно, если пользуетесь каким-нибудь подобным инструментом каждый день

PDF
Please open Telegram to view this post
VIEW IN TELEGRAM
Data Secrets
Anthropic выкатили гайд по вайб-кодингу 😎 23 страницы посвящены тому, как программировать с агентами (в частности, с Claude Code). Собраны советы, best practices, примеры, антипримеры и даже готовые промпты. Отдельное внимание уделяется безопасности данных…
Настоящий вайбкодер, конечно, слишком ленив, чтобы все это прочитать, и, тем более, написать в виде инструкций. Он скормит этот документ Клоду и попросит его самого написать для себя все необходимые инструкции. Так гораздо быстрее, да и лучше получается…
Очень прикольно - Gemini прямо-таки отказывается обсуждать все, что связано с MCP от Антропика. Не знает такого протокола, и найти не может, и искать не хочет. Чувствуется, что ревнуют
😁2
Qwen 3 - новая китайская сетка от Alibaba. Для обычного использования при бесплатном Gemini 2.5 Pro или Grok 3 вряд ли подойдет, но тем, кто работает с нейронками по api или локально, может заменить DeepSeek или Gemma 3. Да, контекст вроде 256к - не миллион, но и не так плохо, на уровне Клода.

PS. Как пишут пользователи, модель overthinking, то бишь, пишет очень много пока думает - это плохая черта, которая также есть, например, у Claude 3.7 Sonnet thinking. Тратит очень много токенов, быстро забивает окно контекста. Тот же Gemini этой болезни не подвержен.

Ссылка на модель - ниже
https://chat.qwen.ai/
Еще одно отличное обновление прошлой недели - Perplexity от Amazon. Приложение скачивается на айфон в России и работает с голосом. Подтягивает картинки. Удобно и прикольно, если новая Siri когда-то выйдет, не факт, что сможет заменить Perplexity.

Мне вот вчера дала инструкцию с картинками, как из тетрадного листа можно сделать водяную бомбочку, чтобы бросать с балкона ))
🔥2
Набрел тут на прикольный достаточно сайт Deepwiki.com - на нем проиндексирован GitHub и есть возможность поискать продукты и получить о них более подробную информацию. Например, там, в отличие от хелпов на гитхабе, очень интересные схемки и в целом гораздо более подробные описания того, что представляет из себя продукт с GitHub. Любопытно, и может быть полезно, когда вы используете при вайб-кодинге какую-то библиотеку.

Здесь в целом есть ценный лайфхак - при вайбкодинге грузить документацию по используемой библиотеке в документацию проекта и в его контекст (при необходимости) и регулярно об этом напоминать модельке, потому что часто ошибки связаны с недостаточным пониманием того, как работает библиотека. Возможно, но не точно (пока не проверял), будет полезен и этот сайт - нейронке, как и вам, по проиндексированному содержанию проще разобраться для чего это и как оно работает.

https://deepwiki.com/
👍2
Audio
NotebookLM - если не пользовались, пора начать. А все потому, что сегодня появился ноутбук на русском языке.

Что это за штука - берете документы, ссылки по теме, которую хотите изучить (до 50 штук), а моделька делает на основе этого саммари по заданной теме или подкаст в виде диалога двух ведущих. Это прямо очень прикольно получается. Файлик с разбором руководства по созданию агентов от OpenAI ниже (с вкраплениями информации от google, anthropic, IBM, OpenAI). Зецените, очень прикольно

Да, все бесплатно, в свободном доступе (через VPN) по адресу
notebooklm.google.com
В преддверии выхода Grok 3.5 на следующей неделе напомню - моделька крутая, бесплатная, работает с картинками, голосом, есть deep research, живет в X (бывший твиттер), то есть можно с ней работать через приложение, а не браузер. Для программирования я бы ее не стал использовать, но для серфинга в интернете и бытовых вопросов - самое то. За бугром в отдельном приложении для iOS есть киллер-фича по распознаванию изображений вы реалиайме, но нам это недоступно. Попробуйте, и ждем новостей
DeepSeek Prover V2 - пока все ждут нового ризонера R2, DeepSeek выпустила SoTA модельку для решения математических задач. Любителям математических олимпиад посвящается ))

Как обычно, open source https://github.com/deepseek-ai/DeepSeek-Prover-V2
Долго не писал - но на это есть причины:
во-первых, нет новостей (дальше можно было бы не продолжать), во-вторых, три дня сидел без электричества и интернета в заснеженном подмосковье, а в третьих - иду долиной смерти вайбкодера. Эту метафору привел друг на пробежке - путь от первого восторга до первого результата оказывается радикально сложнее ожиданий, и на нем умирает большинство. Но я иду, узнаю кучу нового, осмысленности становится все больше - глядишь, что-то и получится )
🤗2
Новость дня: Gemini 2.5 обновили - проверил, действительно новая моделька в доступе. Это и раньше был №1 по кодингу, а теперь должно быть еще круче. Сегодня проверю )

Напомню, что у Gemini 2.5 есть реальная киллер-фича для вайбкодера - контекст на 1 млн токенов. Плюс мало галлюцинаций и в Cursor моделька стоит в 2 раза дешевле последних моделей Claude и ChatGPT