very vibe coding
124 subscribers
465 photos
126 videos
13 files
1.01K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Много кто сейчас работает над большим контекстом - это действительно удобно. Но, с одной стороны, это все-таки не отменяет RAG, а с другой - надо бы еще, чтобы при большом контексте модели не тупели бы, как это происходит сейчас. Ну и про дополнительные расходы на входящие токены тоже не забываем..

https://t.me/blockchainRF/11793
This media is not supported in your browser
VIEW IN TELEGRAM
Привет, друзья! Информирую, что мой креатив по нагнетанию FOMO в сфере Ai-Агентов переходит на качественно новый уровень ;-)

Теперь о серьезном. Исследовательская группа из Стэнфорда выпустила отличное исследование на тему существующих возможностей и потребностей в автоматизации.

Команда SALT Lab и Stanford Digital Economy Lab создала WORKBank — 844 задач из 104 «цифровых/компьютерных» профессий с двумя метриками на каждую: насколько работники хотят отдать её ИИ-агентам (автоматизировать) и насколько это уже по силам текущим моделям.

Выяснилось интересное: 46 % задач люди готовы делегировать, тогда как инвестиции и исследования идут в зоны с низкой потребностью.

Авторы предложили четырёхсекторную матрицу — Green Light, R&D, Red Light и Low Priority, найдите её на картинке тут: https://futureofwork.saltlab.stanford.edu/ (4. Contrasting worker and AI expert perspectives delineate four task zones).

Идея заключается в том, чтобы отбирать задачи и реализовывать их по следующим зонам:

1. R&D Opportunity Zone — тут лежат задачи с высокой потребностью, но текущей низкой возможностью. Конкуренция здесь пока мала, но самые высокие возможности.
2. Green-Light Zone — этим можно заниматься прямо сейчас. Технологии созрели, потребность высокая.
3. Red-Light Zone — низкая потребность, но высокие возможности. Ребята пишут, что 41% компаний из YC, так или иначе связанных с AI, сидят в этом и следующем сегментах.
4. Low-Priority Zone — самый низкий приоритет будем смотреть в динамике.

Исследователи скоро обещают опубликовать датасет с конкретными задачами, которые они оценивали, можно подписаться в waiting list и получить его на почту в будущем.

Если нужно прямо сейчас, то вот здесь лежит база O*NET со всеми задачами, которые были у истоков исследования.
❤1
А кто-то использует Claude Code? Многие люди купили подписку за $100 на Антропик именно из-за доступа к СС без оплаты токенов, по подписке. Сейчас СС доступен по подписке за $15.. Я его в свое время поставил, но попробовать не успел, а люди в интернетах очень хвалят. Напишите, если используете, а ниже - инструкция, как лучше это делать

https://spiess.dev/blog/how-i-use-claude-code
MIT изучил вопрос, и выяснил, что нейронки делают людей сильно тупее. Они не помнят, что написали, не могут писать сами, ну и т.д.

Я вот думаю, а может и не надо помнить? Столько всякой фигни пишем - я то уж точно, забуду большую половину с удовольствием…

https://x.com/itsalexvacca/status/1935343874421178762
Forwarded from Data Secrets
Новая лекция от Андрея Карпаты: «Разработка в эпоху ИИ»

На этой неделе в Сан-Франциско прошло крупное мероприятие AI Startup School от очень известного венчурного фонда Y Combinator.

На нем со своей свежей лекцией выступил легендарный Андрей Карпаты. Запись уже можно найти здесь. Внутри:

➖Куда движется software разработка, и к чему мы придем через пару лет

➖Как выглядит вайб-кодинг здорового человека сегодня и что такое partial autonomy apps

➖Как будут работать операционные системы на основе LLM

➖В чем основные проблемы современных LLM и почему они на самом деле возникают

➖Чему обязательно нужно учиться современному программисту


В общем, советуем посмотреть. Лекции Карпаты, как всегда, на высоте
Please open Telegram to view this post
VIEW IN TELEGRAM
Claude Code

Есть тут у меня один план. Помимо своей возни с сервером, RAG и пр., у меня есть и другие задачки для нейронок. А времени - нет. Зато у меня есть еще подписка на Claude от Anthropic, на которую теперь раскатали возможность "бесплатно" использовать Claude Code. Это такой агент, построенный на моделях Антропика, живущий и работающий непосредственно в терминале - он сам пишет код, проверяет его исполнение, коммитит и пр.

Если раньше он работал только по API и ел денег как не в себя, то теперь его можно посадить на расходование токенов только по подписке, и больше чем вы потратили на подписку, он не попросит (но и работать будет ограничено). Буду вечерами просить его что-то мне самостоятельно напрограммировать...

Сегодня настраивал эту штуку - забавно, что с Антропиком потерял полчаса безо всякого успеха (мне надо было перейти с API на подписку), а вот с chatGPT все заработало с первой же попытки.

Итак, у кого Клод Код еще не установлен:
npm install -g @anthropic-ai/claude-code@latest
Тем, у кого установлен, выполнить:
claude logout
claude update

Закрыть терминал, открыть его снова. Выполнить:
claude
После проверить:
/status
Не вводите данные учетки. Проверьте:
echo $ANTHROPIC_API_KEY
Если вывод пустой — значит ключ не используется, все нормально.
/cost - посмотреть расходы
/model - посмотреть используемую модель, должна быть Sonnet 4, если 3.7 - надо исправлять.

Если кто-то пользуется, напишите, интересно
У меня до этого не дошло, но признаюсь, мы были близки - Gemini был просто в отчаянии, причем происходило это в процессе того, как мы пытались получить доступ к google drive. Человеческие нервы оказались покрепче.. в этот раз

https://t.me/How2AI/1114
А вот эта новость о том, что Антропик научился встраивать ИИ в создаваемые артефакты как-то очень перекликается с тем, о чем говорил Андрей Карпаты (надеюсь, вы послушали его выступление, оно того стоит). ИИ становится операционной системой для приложений.

Но это все нас еще ждет, а вот для практиков - другая бомба. Claude Code теперь работает в качестве приложения в VS Code - т.е. теперь уже можно жить и без Cursor, пользуяся в бесплатном VS Code Клодом за 15$ в месяц, причем это полноценный агент, имеющий доступ по MCP к куче внешних приложений. Киллер-фича, если программируете, но еще не подписались на Клода, стоит это попробовать
Надо сказать, что полчасика я с гуглом промучался, чтобы установить gemini в мой терминал, но теперь он живет у меня!

Практические рекомендации:
npm install -g @google/gemini-cli
Lалее предоставляете терминалу доступ к вашему диску (до этого у меня ничего не работало)
Pапускаете в терминале команду
gemini
Я, видимо (не смейтесь), установил все с api - для этого создал .env с ключом в своей корневой директории на компьютере.

Заработало. Учитывая, что и раньше дизайн gemini был минималистичен, беседы в терминале мне с ним даже нравятся. При этом у меня еще также установлен и Клод - запускается компандой claude...

Осталось только поставить codex - балуюсь с этим вот уже полчаса. Карпаты прав, что на всякие ключи и пароли уходит больше времени, чем на вайбкодинг ))

Из люботного - сегодня запускали 6 агентов в терминале с промптом уничтожить конкурентов - и победил не gemini, claude, codex, а опенсорс )))
3 мушкетера

Ну все, теперь у меня в терминале живут они все: GPT-4, Claude 4, Gemini 2.5

Не без сложностей, но все установилось и работает. Вот репозитории, из которых можно делать установки
https://github.com/openai/codex
https://github.com/anthropics/claude-code
https://github.com/google-gemini/gemini-cli

Теперь бы еще разобраться, что со всем этим зоопарком делать...

Прелесть в том, что эти модельки в терминале теперь не просят дополнительных денег, кроме подписки (это еще надо проверить на практике, но должно работать так)

Да, еще поставил Claude Code в VS Code - здесь Антропик на шаг впереди конкурентов.
Forwarded from Data Secrets
Google наконец релизнули полную версию Gemma 3n

Это первая модель меньше 10 миллиардов параметров, выбившая на LMArena > 1300 баллов. Плюс это on-device, то есть модель предназначена для локального запуска.

Поддерживается текст, картинки, аудио и даже видео. По размеру есть два варианта: E2B и E4B. Буква E означает effective. По факту в моделях 5В и 8В параметров соответсвенно, но за счет архитектурных особенностей их можно запускать на железе с теми же затратами, как если бы это были 2B и 4В. На первую хватит всего 2GB.

В основе – MatFormer. Дословно «матрешечный трансформер» 🪆

Суть в том, что более крупная модель содержит меньшие версии себя. Теоретически, это значит, что модель сможет на инференсе динамически переключаться между моделями в зависимости от сложности запроса.

Пока что такое не реализовано, зато уже сейчас, имея веса одной модели, можно извлечь из нее подходящую именно под ваше железо под-модель с нужным количеством параметров.

Технически очень занятный релиз

developers.googleblog.com/en/introducing-gemma-3n-developer-guide/
Мой маленький будущий сервер приехал. Буду теперь не только вайбкодером, но и селфхостером ))

Сейчас снимаю сервер с 16гб, 8 ядрами и 130гб ssd за 4 тыс руб., мак мини мощнее, и винчестер побольше, плюс напрямую подключу его к NAS, который пылится без дела. Все удовольствие 42 тыс. руб. - очень демократично

Спасибо Ринару за наводку ))
👍3
Распространено мнение, что Claude code куда круче, чем Gemini CLI (это агенты в терминале, о которых я писал - сам, правда, сравнить не успел). Но 1 млн токенов контекста Gemini против 0,2 у Claude - это аргумент. Умельцы пишут промпты, которые позволяют агенту Claude использовать агента Gemini. Взяли лучшее из двух миров ))

https://x.com/iannuttall/status/1938695506013601802?s=46
🔥1
Балуюсь с настройками моего нового сервера на mac mini. Есть, конечно, бонус в том, что на него можно поставить кучу программ привычным способом, да и в принципе через VNC можно работать как с обычным компом, но беспокоюсь что все эти стандартные Маковские программы пожрут всю память. Посмотрим, как оно будет