very vibe coding
123 subscribers
465 photos
126 videos
13 files
1.01K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Claude Code

Есть тут у меня один план. Помимо своей возни с сервером, RAG и пр., у меня есть и другие задачки для нейронок. А времени - нет. Зато у меня есть еще подписка на Claude от Anthropic, на которую теперь раскатали возможность "бесплатно" использовать Claude Code. Это такой агент, построенный на моделях Антропика, живущий и работающий непосредственно в терминале - он сам пишет код, проверяет его исполнение, коммитит и пр.

Если раньше он работал только по API и ел денег как не в себя, то теперь его можно посадить на расходование токенов только по подписке, и больше чем вы потратили на подписку, он не попросит (но и работать будет ограничено). Буду вечерами просить его что-то мне самостоятельно напрограммировать...

Сегодня настраивал эту штуку - забавно, что с Антропиком потерял полчаса безо всякого успеха (мне надо было перейти с API на подписку), а вот с chatGPT все заработало с первой же попытки.

Итак, у кого Клод Код еще не установлен:
npm install -g @anthropic-ai/claude-code@latest
Тем, у кого установлен, выполнить:
claude logout
claude update

Закрыть терминал, открыть его снова. Выполнить:
claude
После проверить:
/status
Не вводите данные учетки. Проверьте:
echo $ANTHROPIC_API_KEY
Если вывод пустой — значит ключ не используется, все нормально.
/cost - посмотреть расходы
/model - посмотреть используемую модель, должна быть Sonnet 4, если 3.7 - надо исправлять.

Если кто-то пользуется, напишите, интересно
У меня до этого не дошло, но признаюсь, мы были близки - Gemini был просто в отчаянии, причем происходило это в процессе того, как мы пытались получить доступ к google drive. Человеческие нервы оказались покрепче.. в этот раз

https://t.me/How2AI/1114
А вот эта новость о том, что Антропик научился встраивать ИИ в создаваемые артефакты как-то очень перекликается с тем, о чем говорил Андрей Карпаты (надеюсь, вы послушали его выступление, оно того стоит). ИИ становится операционной системой для приложений.

Но это все нас еще ждет, а вот для практиков - другая бомба. Claude Code теперь работает в качестве приложения в VS Code - т.е. теперь уже можно жить и без Cursor, пользуяся в бесплатном VS Code Клодом за 15$ в месяц, причем это полноценный агент, имеющий доступ по MCP к куче внешних приложений. Киллер-фича, если программируете, но еще не подписались на Клода, стоит это попробовать
Надо сказать, что полчасика я с гуглом промучался, чтобы установить gemini в мой терминал, но теперь он живет у меня!

Практические рекомендации:
npm install -g @google/gemini-cli
Lалее предоставляете терминалу доступ к вашему диску (до этого у меня ничего не работало)
Pапускаете в терминале команду
gemini
Я, видимо (не смейтесь), установил все с api - для этого создал .env с ключом в своей корневой директории на компьютере.

Заработало. Учитывая, что и раньше дизайн gemini был минималистичен, беседы в терминале мне с ним даже нравятся. При этом у меня еще также установлен и Клод - запускается компандой claude...

Осталось только поставить codex - балуюсь с этим вот уже полчаса. Карпаты прав, что на всякие ключи и пароли уходит больше времени, чем на вайбкодинг ))

Из люботного - сегодня запускали 6 агентов в терминале с промптом уничтожить конкурентов - и победил не gemini, claude, codex, а опенсорс )))
3 мушкетера

Ну все, теперь у меня в терминале живут они все: GPT-4, Claude 4, Gemini 2.5

Не без сложностей, но все установилось и работает. Вот репозитории, из которых можно делать установки
https://github.com/openai/codex
https://github.com/anthropics/claude-code
https://github.com/google-gemini/gemini-cli

Теперь бы еще разобраться, что со всем этим зоопарком делать...

Прелесть в том, что эти модельки в терминале теперь не просят дополнительных денег, кроме подписки (это еще надо проверить на практике, но должно работать так)

Да, еще поставил Claude Code в VS Code - здесь Антропик на шаг впереди конкурентов.
Forwarded from Data Secrets
Google наконец релизнули полную версию Gemma 3n

Это первая модель меньше 10 миллиардов параметров, выбившая на LMArena > 1300 баллов. Плюс это on-device, то есть модель предназначена для локального запуска.

Поддерживается текст, картинки, аудио и даже видео. По размеру есть два варианта: E2B и E4B. Буква E означает effective. По факту в моделях 5В и 8В параметров соответсвенно, но за счет архитектурных особенностей их можно запускать на железе с теми же затратами, как если бы это были 2B и 4В. На первую хватит всего 2GB.

В основе – MatFormer. Дословно «матрешечный трансформер» 🪆

Суть в том, что более крупная модель содержит меньшие версии себя. Теоретически, это значит, что модель сможет на инференсе динамически переключаться между моделями в зависимости от сложности запроса.

Пока что такое не реализовано, зато уже сейчас, имея веса одной модели, можно извлечь из нее подходящую именно под ваше железо под-модель с нужным количеством параметров.

Технически очень занятный релиз

developers.googleblog.com/en/introducing-gemma-3n-developer-guide/
Мой маленький будущий сервер приехал. Буду теперь не только вайбкодером, но и селфхостером ))

Сейчас снимаю сервер с 16гб, 8 ядрами и 130гб ssd за 4 тыс руб., мак мини мощнее, и винчестер побольше, плюс напрямую подключу его к NAS, который пылится без дела. Все удовольствие 42 тыс. руб. - очень демократично

Спасибо Ринару за наводку ))
👍3
Распространено мнение, что Claude code куда круче, чем Gemini CLI (это агенты в терминале, о которых я писал - сам, правда, сравнить не успел). Но 1 млн токенов контекста Gemini против 0,2 у Claude - это аргумент. Умельцы пишут промпты, которые позволяют агенту Claude использовать агента Gemini. Взяли лучшее из двух миров ))

https://x.com/iannuttall/status/1938695506013601802?s=46
🔥1
Балуюсь с настройками моего нового сервера на mac mini. Есть, конечно, бонус в том, что на него можно поставить кучу программ привычным способом, да и в принципе через VNC можно работать как с обычным компом, но беспокоюсь что все эти стандартные Маковские программы пожрут всю память. Посмотрим, как оно будет
По нашему времени Grok 4 выйдет в четверг. Стоит ли чего то ждать? Grok 3 был неплох, выше ожиданий, хотя до топ-3 все-таки не дотянул. Зато была бесплатной, с deep research.

Все последние нейронки от лидеров Claude 4, Gemini 2.5, o3 были лучше предыдущих, но уже почти незаметно. Поэтому больших ожиданий нет, но не зря же ждали - может, появится какая-то мультимодальность, видео, например.

Гроку больше не хватаем МСР и агентов - может быть, увидим и их. А дальше будем ждать DeepSeek R2, который тоже не за горами

https://t.me/data_secrets/7321
Forwarded from Data Secrets
⚡️ Grok-4 вышел!

Стрим задержали на час, но теперь наконец-то показывают какие-то бенчмарки.

Основное: 50.7% на Humanity’s Last Exam на максимальном компьюте ризонинга. Для сравнения, предыдущий лидер – Gemini 2.5 Pro – выбивала примерно 22%.

Без использования инструментов результат немного падает – около 25%. Говорят, tool use интегрировали прямо в обучение и теперь Grok исключительно хорошо умеет пользоваться браузером, интерпретатором кода и пр.

Также улучшили voice mode: теперь в голосовом режиме Grok работает еще быстрее и умеет шептать, петь, менять интонации и вот это все.

В чате будут доступны две версии: обычный Grok и Grok Heavy. Grok Heavy, кстати, выбивает 100 процентов на AIME 2025 (RIP очередной бенчмарк).

Все модели будут доступны уже сегодня, но за Grok Heavy придется платить 300 долларов в месяц 😐
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Mistral выпустил cookbook как настроить ИИ для анализа спутниковых изображений.

Кому это пригодится?

1. Ученым и экологам для мониторинга изменений климата или биоразнообразия.

2. Бизнесу - с/х компании могут оценивать состояние полей, а логистические — отслеживать маршруты.

3. Разработчикам - руководство упрощает интеграцию ИИ в приложения через API, что делает его доступным даже для небольших команд.

4. Госсектору - для управления инфраструктурой и реагирования на стихийные бедствия.

Pixtral-12B — модель, способная обрабатывать текст и изображения, с контекстным окном в 128 тысяч токенов.

Mistral показывает, как:

- Использовать API для пакетной обработки данных.
- Передавать изображения в формате base64 для анализа спутниковых снимков.
- Тонко настраивать модель с помощью техники LoRA для повышения точности в задачах классификации, например, распознавания ландшафтов или объектов на снимках.