very vibe coding
120 subscribers
462 photos
126 videos
13 files
986 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Кстати, в OpenCode GO обещают на подписке за $10 раздать DeepSeek и другие похожие модельки на все $60. Не знаю, насколько будет соответствовать действительности, но попробую. Интересно, наверняка поставили кванты и сами их гоняют...
Прохожу курс детокса от Антропика, использую в качестве основной модели GPT. Впечатления следующие: во-первых, если раньше лимиты GPT мне на фоне Антропика казались бездонными, то сейчас эти времена закончились. Все утекает достаточно быстро, а с Астрой - моментально.

Во-вторых, говорить с моделью тяжелее. Она, что-ли, тугая немного на фоне Клода. Ленивая. Знаете, как бывает у машин избыточная и недостаточная поворачиваемость - здесь точно недостаточная. Надо поискать опенсорс - цедим в час по чайной ложке, пока не пнешь, искать не будет. Тяжеловато.

Попробовал Qwen 3.8 - не понравилось. Больше использовать не буду. А вот DeepSeek на удивление более-менее живой. Для своего размера (а это модель флеш, которая на хороший мак студио влезет), вполне ничего.

И, видимо, верну подписку на GLM - модель была вполне себе, за исключением того, что плоховато держала длинные агентские сессии. Пока остановлюсь на этом
very vibe coding
Прохожу курс детокса от Антропика, использую в качестве основной модели GPT. Впечатления следующие: во-первых, если раньше лимиты GPT мне на фоне Антропика казались бездонными, то сейчас эти времена закончились. Все утекает достаточно быстро, а с Астрой -…
Последние впечатления от chatGPT и воспоминания о том, как Claude вместо внешних моделей гонял Sonnet и меня обманывал навели меня на мысль, прикрутить к основной модели хуки с передачей вовпросов-ответов нейронки второй модели и ее работе в фоне. Назвал проект "Суфлер", буду подключать DeepSeek Flash.

Написал прототип на GPT, пообсуждал с Qwen 38 Мах, DeepSeek Flash - прикольно, что модели сходятся в оценках почти дословно, только дипсик все объясняет в 3 раза подробнее. Замечу, что модели отличаются по размеру в 5 раз. При слепом тесте однозначно взял бы DeepSeek. Не знаю, может программирует Qwen лучше.

И еще особенность - в отличие от всех других моделей и того же GPT, DeepSeek показывает все промежуточные рассуждения. Чем дальше, тем больше проникаюсь уважением к этим ребятам.
Вернул подписку на GLM от Z.ai. Приятный бонус - у них агент AutoClaw - на основе pi и OpenClaw, но при его использовании количестов доступных токенов увеличивается в 1,5 раза. У меня сейчас основной опенкло гоняется на Луне, запасной на GLM или DeepSeek. Попробую на замену AutoClaw
Начинается OpenAI Dev Dey. Главный релиз - Astra 6.1, видимо, отложен. Жди доработок Codex а-ля DeepSeek Harness с плагинами, агентами и пр. Надеюсь, хотя бы младшие модельки выкатят.

Как положено, перед такими события конкуренты должны подложить свою ложку дегтя. В этот раз выпустили Sonnet 5.5.

И да, думаю без сброса лимитов сегодня-завтра не обойдется, токены не экономлю. Тем более что один сброс лимитов еще есть на черный день
Unsloth выпустил квантизацию Laya, которая работает на 4гб памяти. Буду тестировать.

Laya - это опенсорсный аналог Jev. А Jev - на мой взгляд, самое интересное, что происходило с момента выпуска Fable и Astra. Небольшая революция.

Суть в том, что эта модель натренирована не писать, а только выдавать ответ в виде классификатора (да/нет, какая категория и пр.) и процента уверенности. Такой датчик от нейросетей.

В чем бонус - это очень дешево и быстро. То есть маленькие модели могут во многих случаях заменить большие. Я бы сказал, что сейчас модели этого класса - главный хайп индустрии.

Кстати, оценка TypeSafe, которая выпустила Jev, за неделю выросла до 10 миллиардов баксов. Сам Jev на OpenRouter можно потестить, если не хотите с локальной моделью возиться.
👍1
Интересно, что тарифы на ИИ все больше начинают напоминать тарифы на электроэнергию. У z.ai дорогие часы (втрое дороже) с 9 до 13 по Москве. У DeepSeek - почти то же самое. Только в множитель - два, а не три, и еще с 4 до 7 утра дорого. Утренние и вечерние китайские пики потребления. Но зато в это время можно пользовать те же модели с OpenRouter без наценок - это имеет смысл для DeepSeek, так как он идет только по API, без подписки.

Отдельно скажу, что в связи с тем, что z.ai раньше шалила скачиваением репозиториев себе на сервера, обещали выдать кучу бесплатных лимитов и сборосов ограничений - но я у себя проверил, и вижу только один сборос. Так что особо не ведитесь.
Forwarded from Denis Sexy IT 🤖
– Показали GPT 6.1, стоит в 5 раз дешевле Astra, примерно такой же уровень интеллекта

– Запустили режим Ultrafast для моделей, работает с Astra пока что – модель отвечает у 8 раз быстрее в этом режиме

– Новый тир подписки на 500$:
- Ultrafast доступен
- x25 лимиты

– Запустили свой Jev, называется Decision API