very vibe coding
125 subscribers
465 photos
126 videos
13 files
1.01K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Кстати, большинство моделей для рисования используют диффузию - когда сначала создается белый шум, а из него постепенно, все более четко прорисовывается изображение. У chatGPT это авторегрессия, то есть модель работает как LLM, генерирует последовательно пиксель за пикселем «начисто», без перерисовок.

Любопытно, что чуть раньше, наоборот, вышла модель для программирования, основанная на диффузии - CodeFusion. Причем модель от Майкрософт, работает очень прикольно - сразу выдает весь код, а потом за несколько шагов его причесывает. Работает сильно быстрее LLM.

Вот такая любопытная конвергенция технологий, или даже скорее конкуренция. Ждем еще новых подходов от Яна Лекуна ))
Вайб кодинг дошел до профессуры Стэнфорда - Эндрю Нг запустил бесплатный курс по вайб кодингу вместе с Replit

Нг известный своими работами в области ИИ и машинного обучения запустил курс "Vibe Coding 101" вместе с Replit

Нг преподаватель в Стэнфорде, основатель Coursera, сам активно продвигает идею, что ИИ-агенты меняют подход к написанию кода.

Курс построен так, что за 94 минуты человек может собрать и развернуть 2 веб-приложения с помощью "5 навыков вайб-кодинга": думать, использовать фреймворки, ставить чекпоинты, отлаживать и давать контекст.

Выглядит все это как знамение времени, когда мэтры, как Нг, берутся учить не классическому коду, а работе с ИИ как с соавтором.
Очень интересная статья для тех, кто строит работу с памятью на нейронках.

https://habr.com/ru/articles/893356/
🙏1
Forwarded from Data Secrets
Google сделали свою новую модель Gemini 2.5 Pro бесплатной

Теперь она доступна абсолютно всем юзерам. Все что нужно – аккаунт Google 🥳

Напоминаем, что сейчас Gemini 2.5 Pro занимает первое место во всех номинациях на арене (с отрывом), бьет на кодинге o1, o3-mini и Sonnet 3.7. А еще она мультимодальная и контекст у нее – миллион (!) токенов.

Пробуем: gemini.google.com
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Хардкорное, но любопытное видео про Deepseek из Стекловки (математический институт академии наук) - я там был аспирантом )) Оселедец - пожалуй, самый крутой наш товарищ, который нейросетками занимается, вся надежда на таких ребят. В какой-то момент подумал, что блин, надо было математикой заниматься, но нет, потом отпустило. В середине прикольно о том, как Дипсик обучают с ошибкой, но ничего, и так работает.
🤔1
Продолжаю возиться с памятью - установил себе mem0, расскажу об опыте чуть позже, пока настраиваю. Но вот после выхода Llama 4 с контекстным окном в 10 млн токенов это все начинает казаться бессмысленным. Не то, чтобы это значит, что надо переходить на Лламу, скорее это сигнал, что скоро такое окно будет у всех. У того же Gemini 2.5 окно в 1 млн по сравнению с 200K у Клода, и это чувствуется - можно вести очень длинный диалог, не прерывая его.

Видимо, следующий вопрос будет уже не столько в объеме памяти, сколько в ее структурировании.
Пока бегал и отмокал после забега, послушал интервью со светилами - Дарио Амадеем, Сэмом Альтманом, Эриком Шмидтом, Джеффри Хинтоном, бывшим боссом Гугла.

Выделяется сюжет опасности искусственного интеллекта. О чем явно говорит Google - надо договариваться с китайцами и мочить open source. Он может попасть к плохим людям.

У Anthropic. который как раз много вкладывает в изучение того, что у ИИ под капотом (интересно, как Амодей говорит, что мы не создаем, а выращиваем ИИ), мысль более сложная. Пока Китай отстает в ИИ на год, в производстве чипов отставание от NVidea на 4 года. Нужны жесткие меры экспортного контроля и это позволит использовать этот задел для рывка, который будет очень сложно догнать. Такой кирпичик в дом, который строит крыло технооптимистов под руководством Тиля в команде Трампа. В этом плане и многие решения Трампа смотрятся несколько иначе, если исходить из того, что ИИ даст суперпреимущество, которое не наверстать.

Еще была очень классная штука от Амодея - а давайте дадим моделям не отвечать на вопросы, которые им не нравятся. Ну интересно же будет посмотреть )) .

Вчера, кстати, смотрел тоже весьма интересное видео, как мы делаем оборудование для литографии на 360Нм, а в следующем сделам на 130Нм... Ну надо хотя бы с чего-то начинать...
NotebookLM от Google - очень прикольная штука. Можено посмотреть видосик, на словах - смысл в следующем: грузишь ей 50 источников в виде сайтов, файлов и пр. Пищешь, что тебе нужно изучить - она делает подкаст (пока только на английском), mindmap - можно походить по концепциям и посмотреть, как они раскрываются в источниках. Можно сделать резюме, ответы на часто возникающие вопросы и пр. Думаю, что будет интересно много кому. В качестве примера - подкаст по переработку органического мусора (сделан на основе ссылок, которые в него грузанул, но, видимо, многовато иностранерских включил)
https://notebooklm.google.com/notebook/3c0c58ba-d697-4290-8f79-b8fcf3668023/audio
👍1🔥1👏1
Про топовую нейронку у себя дома.

Похоже, Llama 4 на какое-то время станет топом опенсорса. Рейтинги высокие, хотя я бы пока осторожно подходил бы к ним. Единственный конкурент - DeepSeek V3, но у ламы есть очень большое контекстное окно и скоро выйдет ризонинг модель (впрочем, как я понимаю, у DeepSeek тоже, будет интересное соревнование).

Теперь по практике - Llama Maverik запускается на двух машинках Mac Studio M3 Ultra 512Gb, Scout - на одной, для Begemoth потребуется десяток. Цена такой машинки в России 1 139 тыс. руб. Скорость - 23 токена в секунду, можно хитрить и разогнать в два раза. Вполне доступное корпоративное или даже домашнее решение с локальной нейронкой хорошего качества (хотя с качеством еще надо смотреть, первые отзывы - не очень).
И да, Llama 4 появится в WhatsApp, но не во всех странах
Честно говоря, совсем по-мертвому уперся в установку памяти, никак не сдвинусь с места. Установил mem0, через веб работает, ставлю интеграцию с Claude Desktop или Cursor, связь с сервером обрывается, и все тут. Похожая ошибка и у других пакетов была. Разбирали все выходные проблему не только с Клодом, но и с Gemini, перепробовали все что можно, ничего не получается. Vibe Coding под угрозой - если я так каждую проблему решать буду, то и правда, пора идти учиться программированию.

Пойду другим путем
Любопытная новость про бесплатный API на модельку, показывающую результаты на уровне Клода 3.5 или О3 мини. https://openrouter.ai/openrouter/quasar-alpha

Контора, которая делала модель, никому не известна, подозревают, что это OpenAI
Агенты и МСР в VS Code

Пожалуй, одна из самых приятных новостей последнего времени, хотя хорошие новости сыплются как из рога изобилия.

Уже установил, но еще не попробовал - де-факто, VS Code получает функциональность, схожую с Cursor, только бесплатно.

Традиционно для агентских задач в VS Code использовался пакет Cline - отличная штука, через него я подключался к своему Клоду, и, если память мне не изменяет, работал через оплаченную подписку, а не по API, что экономит кучу бабла.

Кстати, Антропик с Клодом теперь тоже предлагают дорогущий пакет Max за 100 баксов (у OpenAi 200), и, у меня такое чувство, что количество обращений по дешевым подпискам могло и снизиться - по крайней мере, я вчера вышел на лимит даже не программируя, что случалось ранее крайне редко.

В целом же, в части программирования перешел с Клода на Gemini 2.5, очень доволен этой моделькой, хотя и работаю с ней в более "ручном режиме", без МСР. Впрочем, от Google тоже есть прекрасные новости, но о них в следующем посте.
Google Firebase Studio

Корпорация добра выпустила свой IDE редактор для разработки приложений, причем позволяет регистрироваться из России и работать по бесплатной подписке. Выглядит очень заманчиво. Не похоже на VS Code, акцентировано на отдельных задачах, с которыми сталкиваются разработчики - программирование, хостинг, аутентификация, работа с данными, ИИ и пр.

Для вайб-кодера выглядит более понятно, чем все это программирование в VS Code, но чувствуется, что комбайн большой, сложный, надо разбираться. Буду пробовать - надежды на успех возлагаю большие.

PS. Отбой тревоги )) Gemeni описал историю так - Firebase Studio - это совершенно другая архитектура, ориентированная на продукты Google. Проще начать, нет проблем с обслуживанием - все работает на ресурсах Гугла, но это не универсальные, а Гугловские решения, которые весьма специфичны. Интересно тем, кто сидит на Гугле или для простых продуктов. Для тех, кто хочет иметь полный контроль над разработкой - кодим по-старому.
Claude 3.7 vs Gemini 2.5

Это мои любимые модели, которыми я пользуюсь чаще всего. Сравнения и впечатления - Клод хорошо пишет, мало ленится (такое случается у других моделей). МСР, по которому подключаются tools очень широкого профиля. Последняя модель 3.7 строчит код вообще как не в себя. С этим и возникает проблема - надо брать ее под контроль, тормозить, писать промпты. А если нет, то мало того, что разработка выходит из под контроля - появляется куча файлов с разных директориях, по которым не понятно нужны они или нет, так еще и моментально заканчивается контекстное окно. Оно большое, но с МСР выбирается быстро.

И это то, из-за чего пересел в программировании на Gemini. Сегодня поймал себя на мысли, что у меня нет потребности в промптах - модель выдает столько планов и кода, сколько нужно (не исключаю, что без МСР и Клод более управляем, но все же). Очень четкие, структурированные ответы. И огромный контекст с 1 млн токенов. С Клодом постоянная проблема переноса информации в новый диалог, здесь этого нет, и это очень круто. Теперь у меня эта модель #1. Ах, да, Gemini еще и бесплатная.

Есть еще ChatGPT, которой на днях прикрутили память всех диалогов - это круто, программирует тоже неплохо. Но в Cursor модели OpenAI производили сильно меньше работы за один токен. Рабочие, хорошие модели, но для меня #3.

Есть еще Grok, DeepSeek, но с ними не программирую, потенциал есть, но посмотрим на следующие релизы
Промт инжиниринг от Google - читайте книжку по ссылке
Любопытный релиз от OpenAI - пока модели доступны только по Апи, но зато на неделю бесплатны. Заявленное точное следование промпту - то, что доктор прописал. Клод 3.7 для меня ассоциируется как раз с очень умным, но непослушным ребенком.

https://t.me/How2AI/953
Бесплатный vibe-coding (почти)

Программирую теперь в Cursor не с Claude Sonnet 3.7, а с Gemini 2.5 Pro. И мне очень нравится - более дисциплиннированная модель, а еще - токены подписки не тратятся вообще. На сайте https://aistudio.google.com модель тоже бесплатная, но в Курсоре она работает бесплатно по апи... Аттракцион невиданной щедрости - всяко в Курсоре вайбкодить в разы проще и быстрее, чем через сайт гугла.

Говорят, что теперь чемпионы по кодингу - новые модели от OpenAI, но это еще надо проверять (кстати, тоже хвалят за хорошую дисциплину и следование промпту). В любом случае, на эти модели токены в курсоре уже потребуются, поэтому пока сижу на Gemini, а там - посмотрим

PS Gemini оказалась таки не бесплатной - это все просто хитрые маркетинговые ходы. 5 центов за запрос и 5 центов за использование tools. Та же цена, что и у Клода. История - в установках оплаты за использование. Она начинает тратиться сразу, а не после того, как выбран лимит обычных запросов