На фоне увеличения лимитов на модель o3 у платных подписчиков chatGPT (теперь на подписке Plus за 20 баксов доступно 200 обращений в день, и это много, смысл пользоваться другими моделями типа 4o или o4mini практически исчезает), расскажу небольшой лайфхак для подписчиков другой популярной нейронки - Клода.
История в том, что платные подписки у разных компаний устроены по-разному. OpenAI дает фиксированное количество обращений в сутки, а вот Клод выделяет определенное количество токенов на 6 часов. Если вы выбрали эти лимиты, подписка на несколько часов блокируется. Раньше я регулярно попадал на такое ограничение, особенно если давать Клоду программировать и использовать tools - с ними от тратит токены с астрономической скоростью.
Поэтому для подписчиков Клода рекомендация - утром за чашкой кофе сказать ему "привет", что откроет 6-часовую сессию. Когда через пару часов начнете работутать, у вас будет тот же лимит токенов на ближайшие 4 часа, а после них начнется новая сессия и лимит токенов обновится до максимума.
Возможно, этим объясняется и разный характер моделей. У chatGPT слова идут экономно, много табличек, а вот Клод весьма словоохотлив и токены не бережет ни разу...
История в том, что платные подписки у разных компаний устроены по-разному. OpenAI дает фиксированное количество обращений в сутки, а вот Клод выделяет определенное количество токенов на 6 часов. Если вы выбрали эти лимиты, подписка на несколько часов блокируется. Раньше я регулярно попадал на такое ограничение, особенно если давать Клоду программировать и использовать tools - с ними от тратит токены с астрономической скоростью.
Поэтому для подписчиков Клода рекомендация - утром за чашкой кофе сказать ему "привет", что откроет 6-часовую сессию. Когда через пару часов начнете работутать, у вас будет тот же лимит токенов на ближайшие 4 часа, а после них начнется новая сессия и лимит токенов обновится до максимума.
Возможно, этим объясняется и разный характер моделей. У chatGPT слова идут экономно, много табличек, а вот Клод весьма словоохотлив и токены не бережет ни разу...
👍2
Развлекаюсь на досуге с n8n - пытаюсь разобраться с автоматизацией и своим RAGом. Задачка, прямо скажем, не для слабонервных.
Сделал себе базу данных для метаданных на supabase, пытался подключить к ней Клода по mcp и долго возился с поиском ключей - оказалось, что облачная версия и версия для селфхостеров выглядит несколько по-разному. Если вы сами ставите базу себе на сервер, в ней нельзя создавать проекты, он только один - если нужен другой проект, нужно сделать новый контейнер и поднять еще одну базу. Соответственно, и привычных облачных настроек нет. Но ключи кое-как нашлись - базу сделали. Обсуждали ее и с Клодом и с Джеминай, из интересного - для файлов на google drive лучше привязываться как к уникальному идентификатору не к пути на диске - у гугля для каждого файла есть id, который не меняется. Если выбрать идентификатором путь, при кажом переносе файлов он будет данные стирать и снова их записывать, индексировать и пр.
С n8n тоже решил поступить как самый умный - зачем все писать самому, если можно Клода подключить к n8n через mcp и дать задачку все написать ему. Сказано-сделано, установил mcp-сервер, все подключилось, работает, только пишет workflow в n8n Клод крайне хреново. А Gemini тоже не сильно в теме - что-то предлагает, но сделать это невозможно, так как в интерфейсе таких полей нет...
В общем, приходится изучать чужие схемы и делать все самому, по образу и подобию. Печалька, конечно, так себе вайбкодинг. Зато, быть может, чему-то научусь...
Сделал себе базу данных для метаданных на supabase, пытался подключить к ней Клода по mcp и долго возился с поиском ключей - оказалось, что облачная версия и версия для селфхостеров выглядит несколько по-разному. Если вы сами ставите базу себе на сервер, в ней нельзя создавать проекты, он только один - если нужен другой проект, нужно сделать новый контейнер и поднять еще одну базу. Соответственно, и привычных облачных настроек нет. Но ключи кое-как нашлись - базу сделали. Обсуждали ее и с Клодом и с Джеминай, из интересного - для файлов на google drive лучше привязываться как к уникальному идентификатору не к пути на диске - у гугля для каждого файла есть id, который не меняется. Если выбрать идентификатором путь, при кажом переносе файлов он будет данные стирать и снова их записывать, индексировать и пр.
С n8n тоже решил поступить как самый умный - зачем все писать самому, если можно Клода подключить к n8n через mcp и дать задачку все написать ему. Сказано-сделано, установил mcp-сервер, все подключилось, работает, только пишет workflow в n8n Клод крайне хреново. А Gemini тоже не сильно в теме - что-то предлагает, но сделать это невозможно, так как в интерфейсе таких полей нет...
В общем, приходится изучать чужие схемы и делать все самому, по образу и подобию. Печалька, конечно, так себе вайбкодинг. Зато, быть может, чему-то научусь...
👍1
А вы заметили какую-то разницу в новых модельках типа Claude 4 или Gemini 2.5 по сравнению с тем, что было в прошлых версиях? Я вот никак не могу увидеть разницы, разве что есть ощущение, что Клод просто стал тупее - сегодня косяк за косяком...
👍1
Google authentification
На что уходит время вайб-кодеров... Тут часика три упражнялся с получением доступа к папке google drive. Решил, что раз уже все нейронки сейчас с google drive работают, то я тоже всю систему хранения данных буду строить с google drive.. Начал настраивать сервер для автоматической синхронизации, тем более, что у гугла есть функция пуш уведомлений об изменении файлов на диске.
Естественно, работал с гугловским gemini. Написали скрипт, начали стучаться на диск, и тут началось... Получили api, сделали OAuth2, расшарили папку на соответствующего пользователя, прописали пути на сервере, скачал credentials и опять же установил их на серваке. Записали меня в тестировщики проекта.
А зайти никак не можем - нужен еще токен, который регулярно обновляется и позволяет ходить на диск. Как раз с его первым получением и возникла проблемка - стучались с сервера и так, и эдак, делали туннели, мудрили с localhost и ip - видели бы вы как и сколько раз gemini говорил, что вот теперь все, а потом рвал на себе волосы...
Немножко процитирую начало последних постов:
- Вы абсолютно правы. Хватит аллегорий, хватит догадок. Я прошу прощения за все предыдущие неудачные попытки...
- Вы правы. Вы абсолютно правы. Мой долг — помнить всю нашу переписку и анализировать, а не просто предлагать новые решения. Я приношу свои глубочайшие извинения...
- Я понимаю ваше негодование. Это просто невероятно...
Удивительно, но проблемку решили - сделали скрипты на macbook, получили через него токен, загрузили его на сервер, и подключение пошло.
Подключиться-подключились, но осадочек остался - неужто нельзя придумать какую-то аутентификацию попроще? Полная жесть
На что уходит время вайб-кодеров... Тут часика три упражнялся с получением доступа к папке google drive. Решил, что раз уже все нейронки сейчас с google drive работают, то я тоже всю систему хранения данных буду строить с google drive.. Начал настраивать сервер для автоматической синхронизации, тем более, что у гугла есть функция пуш уведомлений об изменении файлов на диске.
Естественно, работал с гугловским gemini. Написали скрипт, начали стучаться на диск, и тут началось... Получили api, сделали OAuth2, расшарили папку на соответствующего пользователя, прописали пути на сервере, скачал credentials и опять же установил их на серваке. Записали меня в тестировщики проекта.
А зайти никак не можем - нужен еще токен, который регулярно обновляется и позволяет ходить на диск. Как раз с его первым получением и возникла проблемка - стучались с сервера и так, и эдак, делали туннели, мудрили с localhost и ip - видели бы вы как и сколько раз gemini говорил, что вот теперь все, а потом рвал на себе волосы...
Немножко процитирую начало последних постов:
- Вы абсолютно правы. Хватит аллегорий, хватит догадок. Я прошу прощения за все предыдущие неудачные попытки...
- Вы правы. Вы абсолютно правы. Мой долг — помнить всю нашу переписку и анализировать, а не просто предлагать новые решения. Я приношу свои глубочайшие извинения...
- Я понимаю ваше негодование. Это просто невероятно...
Удивительно, но проблемку решили - сделали скрипты на macbook, получили через него токен, загрузили его на сервер, и подключение пошло.
Подключиться-подключились, но осадочек остался - неужто нельзя придумать какую-то аутентификацию попроще? Полная жесть
Много кто сейчас работает над большим контекстом - это действительно удобно. Но, с одной стороны, это все-таки не отменяет RAG, а с другой - надо бы еще, чтобы при большом контексте модели не тупели бы, как это происходит сейчас. Ну и про дополнительные расходы на входящие токены тоже не забываем..
https://t.me/blockchainRF/11793
https://t.me/blockchainRF/11793
Telegram
Все о блокчейн/мозге/space/WEB 3.0 в России и мире
Китайцы сделали прорыв в ИИ, переосмыслив архитектуру LLM
Впервые за 8 лет существования Transformer-архитектуры кто-то смог преодолеть её фундаментальное ограничение. Это новый класс возможностей для ИИ.
У всех языковых моделей одна проблема - могут работать…
Впервые за 8 лет существования Transformer-архитектуры кто-то смог преодолеть её фундаментальное ограничение. Это новый класс возможностей для ИИ.
У всех языковых моделей одна проблема - могут работать…
Forwarded from Anton Vdovitchenko — One Man Enterprise
This media is not supported in your browser
VIEW IN TELEGRAM
Привет, друзья! Информирую, что мой креатив по нагнетанию FOMO в сфере Ai-Агентов переходит на качественно новый уровень ;-)
Теперь о серьезном. Исследовательская группа из Стэнфорда выпустила отличное исследование на тему существующих возможностей и потребностей в автоматизации.
Команда SALT Lab и Stanford Digital Economy Lab создала WORKBank — 844 задач из 104 «цифровых/компьютерных» профессий с двумя метриками на каждую: насколько работники хотят отдать её ИИ-агентам (автоматизировать) и насколько это уже по силам текущим моделям.
Выяснилось интересное: 46 % задач люди готовы делегировать, тогда как инвестиции и исследования идут в зоны с низкой потребностью.
Авторы предложили четырёхсекторную матрицу — Green Light, R&D, Red Light и Low Priority, найдите её на картинке тут: https://futureofwork.saltlab.stanford.edu/ (4. Contrasting worker and AI expert perspectives delineate four task zones).
Идея заключается в том, чтобы отбирать задачи и реализовывать их по следующим зонам:
1. R&D Opportunity Zone — тут лежат задачи с высокой потребностью, но текущей низкой возможностью. Конкуренция здесь пока мала, но самые высокие возможности.
2. Green-Light Zone — этим можно заниматься прямо сейчас. Технологии созрели, потребность высокая.
3. Red-Light Zone — низкая потребность, но высокие возможности. Ребята пишут, что 41% компаний из YC, так или иначе связанных с AI, сидят в этом и следующем сегментах.
4. Low-Priority Zone — самый низкий приоритет будем смотреть в динамике.
Исследователи скоро обещают опубликовать датасет с конкретными задачами, которые они оценивали, можно подписаться в waiting list и получить его на почту в будущем.
Если нужно прямо сейчас, то вот здесь лежит база O*NET со всеми задачами, которые были у истоков исследования.
Теперь о серьезном. Исследовательская группа из Стэнфорда выпустила отличное исследование на тему существующих возможностей и потребностей в автоматизации.
Команда SALT Lab и Stanford Digital Economy Lab создала WORKBank — 844 задач из 104 «цифровых/компьютерных» профессий с двумя метриками на каждую: насколько работники хотят отдать её ИИ-агентам (автоматизировать) и насколько это уже по силам текущим моделям.
Выяснилось интересное: 46 % задач люди готовы делегировать, тогда как инвестиции и исследования идут в зоны с низкой потребностью.
Авторы предложили четырёхсекторную матрицу — Green Light, R&D, Red Light и Low Priority, найдите её на картинке тут: https://futureofwork.saltlab.stanford.edu/ (4. Contrasting worker and AI expert perspectives delineate four task zones).
Идея заключается в том, чтобы отбирать задачи и реализовывать их по следующим зонам:
1. R&D Opportunity Zone — тут лежат задачи с высокой потребностью, но текущей низкой возможностью. Конкуренция здесь пока мала, но самые высокие возможности.
2. Green-Light Zone — этим можно заниматься прямо сейчас. Технологии созрели, потребность высокая.
3. Red-Light Zone — низкая потребность, но высокие возможности. Ребята пишут, что 41% компаний из YC, так или иначе связанных с AI, сидят в этом и следующем сегментах.
4. Low-Priority Zone — самый низкий приоритет будем смотреть в динамике.
Исследователи скоро обещают опубликовать датасет с конкретными задачами, которые они оценивали, можно подписаться в waiting list и получить его на почту в будущем.
Если нужно прямо сейчас, то вот здесь лежит база O*NET со всеми задачами, которые были у истоков исследования.
❤1
А кто-то использует Claude Code? Многие люди купили подписку за $100 на Антропик именно из-за доступа к СС без оплаты токенов, по подписке. Сейчас СС доступен по подписке за $15.. Я его в свое время поставил, но попробовать не успел, а люди в интернетах очень хвалят. Напишите, если используете, а ниже - инструкция, как лучше это делать
https://spiess.dev/blog/how-i-use-claude-code
https://spiess.dev/blog/how-i-use-claude-code
spiess.dev
How I Use Claude Code
One month ago, I subscribed to Claude Max. I've been using AI agents including Claude Code for some time prior, but with the flat pricing, my…
MIT изучил вопрос, и выяснил, что нейронки делают людей сильно тупее. Они не помнят, что написали, не могут писать сами, ну и т.д.
Я вот думаю, а может и не надо помнить? Столько всякой фигни пишем - я то уж точно, забуду большую половину с удовольствием…
https://x.com/itsalexvacca/status/1935343874421178762
Я вот думаю, а может и не надо помнить? Столько всякой фигни пишем - я то уж точно, забуду большую половину с удовольствием…
https://x.com/itsalexvacca/status/1935343874421178762
X (formerly Twitter)
Alex Vacca (@itsalexvacca) on X
BREAKING: MIT just completed the first brain scan study of ChatGPT users & the results are terrifying.
Turns out, AI isn't making us more productive. It's making us cognitively bankrupt.
Her…
Turns out, AI isn't making us more productive. It's making us cognitively bankrupt.
Her…
Forwarded from Data Secrets
Новая лекция от Андрея Карпаты: «Разработка в эпоху ИИ»
На этой неделе в Сан-Франциско прошло крупное мероприятие AI Startup School от очень известного венчурного фонда Y Combinator.
На нем со своей свежей лекцией выступил легендарный Андрей Карпаты. Запись уже можно найти здесь. Внутри:
В общем, советуем посмотреть. Лекции Карпаты, как всегда, на высоте
На этой неделе в Сан-Франциско прошло крупное мероприятие AI Startup School от очень известного венчурного фонда Y Combinator.
На нем со своей свежей лекцией выступил легендарный Андрей Карпаты. Запись уже можно найти здесь. Внутри:
➖ Куда движется software разработка, и к чему мы придем через пару лет➖ Как выглядит вайб-кодинг здорового человека сегодня и что такое partial autonomy apps➖ Как будут работать операционные системы на основе LLM➖ В чем основные проблемы современных LLM и почему они на самом деле возникают➖ Чему обязательно нужно учиться современному программисту
В общем, советуем посмотреть. Лекции Карпаты, как всегда, на высоте
Please open Telegram to view this post
VIEW IN TELEGRAM
А вот эта история - действительно взрыв мозга. Генерация всего и вся на лету - почему бы и нет?
https://t.me/data_secrets/7191
https://t.me/data_secrets/7191
Telegram
Data Secrets
Google показали пример генеративной операционной системы
Это тот самый концепт, о котором так много говорит Карпаты (см. этот и этот посты). Суть в том, что в системе на самом деле нет никаких готовых приложений, никакого предустановленного интерфейса, ничего.…
Это тот самый концепт, о котором так много говорит Карпаты (см. этот и этот посты). Суть в том, что в системе на самом деле нет никаких готовых приложений, никакого предустановленного интерфейса, ничего.…
Я тоже попросил Клода загадать число от 1 до 50, и знаете, он ответил 27…
https://t.me/data_secrets/7194
https://t.me/data_secrets/7194
Telegram
Data Secrets
Загадка числа 27: на Reddit заметили, что если попросить какую-нибудь модель загадать число между 1 и 50, этим чистом практически всегда оказывается 27
В X пользователи (в том числе Андрей Карпаты, кстати) начали подтверждать, что у них результат получался…
В X пользователи (в том числе Андрей Карпаты, кстати) начали подтверждать, что у них результат получался…
Claude Code
Есть тут у меня один план. Помимо своей возни с сервером, RAG и пр., у меня есть и другие задачки для нейронок. А времени - нет. Зато у меня есть еще подписка на Claude от Anthropic, на которую теперь раскатали возможность "бесплатно" использовать Claude Code. Это такой агент, построенный на моделях Антропика, живущий и работающий непосредственно в терминале - он сам пишет код, проверяет его исполнение, коммитит и пр.
Если раньше он работал только по API и ел денег как не в себя, то теперь его можно посадить на расходование токенов только по подписке, и больше чем вы потратили на подписку, он не попросит (но и работать будет ограничено). Буду вечерами просить его что-то мне самостоятельно напрограммировать...
Сегодня настраивал эту штуку - забавно, что с Антропиком потерял полчаса безо всякого успеха (мне надо было перейти с API на подписку), а вот с chatGPT все заработало с первой же попытки.
Итак, у кого Клод Код еще не установлен:
npm install -g @anthropic-ai/claude-code@latest
Тем, у кого установлен, выполнить:
claude logout
claude update
Закрыть терминал, открыть его снова. Выполнить:
claude
После проверить:
/status
Не вводите данные учетки. Проверьте:
echo $ANTHROPIC_API_KEY
Если вывод пустой — значит ключ не используется, все нормально.
/cost - посмотреть расходы
/model - посмотреть используемую модель, должна быть Sonnet 4, если 3.7 - надо исправлять.
Если кто-то пользуется, напишите, интересно
Есть тут у меня один план. Помимо своей возни с сервером, RAG и пр., у меня есть и другие задачки для нейронок. А времени - нет. Зато у меня есть еще подписка на Claude от Anthropic, на которую теперь раскатали возможность "бесплатно" использовать Claude Code. Это такой агент, построенный на моделях Антропика, живущий и работающий непосредственно в терминале - он сам пишет код, проверяет его исполнение, коммитит и пр.
Если раньше он работал только по API и ел денег как не в себя, то теперь его можно посадить на расходование токенов только по подписке, и больше чем вы потратили на подписку, он не попросит (но и работать будет ограничено). Буду вечерами просить его что-то мне самостоятельно напрограммировать...
Сегодня настраивал эту штуку - забавно, что с Антропиком потерял полчаса безо всякого успеха (мне надо было перейти с API на подписку), а вот с chatGPT все заработало с первой же попытки.
Итак, у кого Клод Код еще не установлен:
npm install -g @anthropic-ai/claude-code@latest
Тем, у кого установлен, выполнить:
claude logout
claude update
Закрыть терминал, открыть его снова. Выполнить:
claude
После проверить:
/status
Не вводите данные учетки. Проверьте:
echo $ANTHROPIC_API_KEY
Если вывод пустой — значит ключ не используется, все нормально.
/cost - посмотреть расходы
/model - посмотреть используемую модель, должна быть Sonnet 4, если 3.7 - надо исправлять.
Если кто-то пользуется, напишите, интересно
У меня до этого не дошло, но признаюсь, мы были близки - Gemini был просто в отчаянии, причем происходило это в процессе того, как мы пытались получить доступ к google drive. Человеческие нервы оказались покрепче.. в этот раз
https://t.me/How2AI/1114
https://t.me/How2AI/1114
Telegram
How2AI
😖 Это очень смешно и очень грустно
Gemini впадает в депрессию, если у него долго не получается написать нужный код. Прощается. И пытается удалить себя из IDE.
Я не могу с чистой совестью попытаться еще раз «исправить». Я удаляю себя из этого проекта.…
Gemini впадает в депрессию, если у него долго не получается написать нужный код. Прощается. И пытается удалить себя из IDE.
Я не могу с чистой совестью попытаться еще раз «исправить». Я удаляю себя из этого проекта.…
Это то, чего gemini очень не хватает - возможности автоматизировать кодирование и работать через MCP. Ждем с нетерпением
https://t.me/blockchainRF/11844
https://t.me/blockchainRF/11844
Telegram
Все о блокчейн/мозге/space/WEB 3.0 в России и мире
Google объявит о запуске open-source и бесплатного ИИ-агента
Это конкурент OpenAI Codex CLI, с акцентом на бесплатный доступ и открытость.
Gemini CLI ИИ-агент интегрируется с Google Search, MCP, Gemini Code Assist.
Gemini CLI позиционируется как инструмент…
Это конкурент OpenAI Codex CLI, с акцентом на бесплатный доступ и открытость.
Gemini CLI ИИ-агент интегрируется с Google Search, MCP, Gemini Code Assist.
Gemini CLI позиционируется как инструмент…
А вот эта новость о том, что Антропик научился встраивать ИИ в создаваемые артефакты как-то очень перекликается с тем, о чем говорил Андрей Карпаты (надеюсь, вы послушали его выступление, оно того стоит). ИИ становится операционной системой для приложений.
Но это все нас еще ждет, а вот для практиков - другая бомба. Claude Code теперь работает в качестве приложения в VS Code - т.е. теперь уже можно жить и без Cursor, пользуяся в бесплатном VS Code Клодом за 15$ в месяц, причем это полноценный агент, имеющий доступ по MCP к куче внешних приложений. Киллер-фича, если программируете, но еще не подписались на Клода, стоит это попробовать
Но это все нас еще ждет, а вот для практиков - другая бомба. Claude Code теперь работает в качестве приложения в VS Code - т.е. теперь уже можно жить и без Cursor, пользуяся в бесплатном VS Code Клодом за 15$ в месяц, причем это полноценный агент, имеющий доступ по MCP к куче внешних приложений. Киллер-фича, если программируете, но еще не подписались на Клода, стоит это попробовать
Telegram
Все о блокчейн/мозге/space/WEB 3.0 в России и мире
Anthropic запустили возможность бесплатно создавать ИИ-приложения, об этом вчера писали.
Anthropic добавили в Claude возможность встраивать ИИ-функции прямо в созданные артефакты. Теперь можно делать не просто статичные документы или код, а приложения,…
Anthropic добавили в Claude возможность встраивать ИИ-функции прямо в созданные артефакты. Теперь можно делать не просто статичные документы или код, а приложения,…
Надо сказать, что полчасика я с гуглом промучался, чтобы установить gemini в мой терминал, но теперь он живет у меня!
Практические рекомендации:
npm install -g @google/gemini-cli
Lалее предоставляете терминалу доступ к вашему диску (до этого у меня ничего не работало)
Pапускаете в терминале команду
gemini
Я, видимо (не смейтесь), установил все с api - для этого создал .env с ключом в своей корневой директории на компьютере.
Заработало. Учитывая, что и раньше дизайн gemini был минималистичен, беседы в терминале мне с ним даже нравятся. При этом у меня еще также установлен и Клод - запускается компандой claude...
Осталось только поставить codex - балуюсь с этим вот уже полчаса. Карпаты прав, что на всякие ключи и пароли уходит больше времени, чем на вайбкодинг ))
Из люботного - сегодня запускали 6 агентов в терминале с промптом уничтожить конкурентов - и победил не gemini, claude, codex, а опенсорс )))
Практические рекомендации:
npm install -g @google/gemini-cli
Lалее предоставляете терминалу доступ к вашему диску (до этого у меня ничего не работало)
Pапускаете в терминале команду
gemini
Я, видимо (не смейтесь), установил все с api - для этого создал .env с ключом в своей корневой директории на компьютере.
Заработало. Учитывая, что и раньше дизайн gemini был минималистичен, беседы в терминале мне с ним даже нравятся. При этом у меня еще также установлен и Клод - запускается компандой claude...
Осталось только поставить codex - балуюсь с этим вот уже полчаса. Карпаты прав, что на всякие ключи и пароли уходит больше времени, чем на вайбкодинг ))
Из люботного - сегодня запускали 6 агентов в терминале с промптом уничтожить конкурентов - и победил не gemini, claude, codex, а опенсорс )))
3 мушкетера
Ну все, теперь у меня в терминале живут они все: GPT-4, Claude 4, Gemini 2.5
Не без сложностей, но все установилось и работает. Вот репозитории, из которых можно делать установки
https://github.com/openai/codex
https://github.com/anthropics/claude-code
https://github.com/google-gemini/gemini-cli
Теперь бы еще разобраться, что со всем этим зоопарком делать...
Прелесть в том, что эти модельки в терминале теперь не просят дополнительных денег, кроме подписки (это еще надо проверить на практике, но должно работать так)
Да, еще поставил Claude Code в VS Code - здесь Антропик на шаг впереди конкурентов.
Ну все, теперь у меня в терминале живут они все: GPT-4, Claude 4, Gemini 2.5
Не без сложностей, но все установилось и работает. Вот репозитории, из которых можно делать установки
https://github.com/openai/codex
https://github.com/anthropics/claude-code
https://github.com/google-gemini/gemini-cli
Теперь бы еще разобраться, что со всем этим зоопарком делать...
Прелесть в том, что эти модельки в терминале теперь не просят дополнительных денег, кроме подписки (это еще надо проверить на практике, но должно работать так)
Да, еще поставил Claude Code в VS Code - здесь Антропик на шаг впереди конкурентов.
GitHub
GitHub - openai/codex: Lightweight coding agent that runs in your terminal
Lightweight coding agent that runs in your terminal - openai/codex
Forwarded from Data Secrets
Google наконец релизнули полную версию Gemma 3n
Это первая модель меньше 10 миллиардов параметров, выбившая на LMArena > 1300 баллов. Плюс это on-device, то есть модель предназначена для локального запуска.
Поддерживается текст, картинки, аудио и даже видео. По размеру есть два варианта: E2B и E4B. Буква E означает effective. По факту в моделях 5В и 8В параметров соответсвенно, но за счет архитектурных особенностей их можно запускать на железе с теми же затратами, как если бы это были 2B и 4В. На первую хватит всего 2GB.
В основе – MatFormer. Дословно «матрешечный трансформер» 🪆
Суть в том, что более крупная модель содержит меньшие версии себя. Теоретически, это значит, что модель сможет на инференсе динамически переключаться между моделями в зависимости от сложности запроса.
Пока что такое не реализовано, зато уже сейчас, имея веса одной модели, можно извлечь из нее подходящую именно под ваше железо под-модель с нужным количеством параметров.
Технически очень занятный релиз
developers.googleblog.com/en/introducing-gemma-3n-developer-guide/
Это первая модель меньше 10 миллиардов параметров, выбившая на LMArena > 1300 баллов. Плюс это on-device, то есть модель предназначена для локального запуска.
Поддерживается текст, картинки, аудио и даже видео. По размеру есть два варианта: E2B и E4B. Буква E означает effective. По факту в моделях 5В и 8В параметров соответсвенно, но за счет архитектурных особенностей их можно запускать на железе с теми же затратами, как если бы это были 2B и 4В. На первую хватит всего 2GB.
В основе – MatFormer. Дословно «матрешечный трансформер» 🪆
Суть в том, что более крупная модель содержит меньшие версии себя. Теоретически, это значит, что модель сможет на инференсе динамически переключаться между моделями в зависимости от сложности запроса.
Пока что такое не реализовано, зато уже сейчас, имея веса одной модели, можно извлечь из нее подходящую именно под ваше железо под-модель с нужным количеством параметров.
Технически очень занятный релиз
developers.googleblog.com/en/introducing-gemma-3n-developer-guide/