Недолго музыка играла - новый бан от Антропика получил на следующем сообщении после того, как попросил отредактировать мои скилы. В общем, не успел и 10 сообщений отправить.
Модель абсолютно точно банит не просто по IP и информации о компе (запускал из контейннера), а прямо по содержанию промптов. Причем не нравится ей организация, в которой я работаю.
В общем, не лечится. Такой хоккей нам не нужен.
Модель абсолютно точно банит не просто по IP и информации о компе (запускал из контейннера), а прямо по содержанию промптов. Причем не нравится ей организация, в которой я работаю.
В общем, не лечится. Такой хоккей нам не нужен.
Кстати, в OpenCode GO обещают на подписке за $10 раздать DeepSeek и другие похожие модельки на все $60. Не знаю, насколько будет соответствовать действительности, но попробую. Интересно, наверняка поставили кванты и сами их гоняют...
Прохожу курс детокса от Антропика, использую в качестве основной модели GPT. Впечатления следующие: во-первых, если раньше лимиты GPT мне на фоне Антропика казались бездонными, то сейчас эти времена закончились. Все утекает достаточно быстро, а с Астрой - моментально.
Во-вторых, говорить с моделью тяжелее. Она, что-ли, тугая немного на фоне Клода. Ленивая. Знаете, как бывает у машин избыточная и недостаточная поворачиваемость - здесь точно недостаточная. Надо поискать опенсорс - цедим в час по чайной ложке, пока не пнешь, искать не будет. Тяжеловато.
Попробовал Qwen 3.8 - не понравилось. Больше использовать не буду. А вот DeepSeek на удивление более-менее живой. Для своего размера (а это модель флеш, которая на хороший мак студио влезет), вполне ничего.
И, видимо, верну подписку на GLM - модель была вполне себе, за исключением того, что плоховато держала длинные агентские сессии. Пока остановлюсь на этом
Во-вторых, говорить с моделью тяжелее. Она, что-ли, тугая немного на фоне Клода. Ленивая. Знаете, как бывает у машин избыточная и недостаточная поворачиваемость - здесь точно недостаточная. Надо поискать опенсорс - цедим в час по чайной ложке, пока не пнешь, искать не будет. Тяжеловато.
Попробовал Qwen 3.8 - не понравилось. Больше использовать не буду. А вот DeepSeek на удивление более-менее живой. Для своего размера (а это модель флеш, которая на хороший мак студио влезет), вполне ничего.
И, видимо, верну подписку на GLM - модель была вполне себе, за исключением того, что плоховато держала длинные агентские сессии. Пока остановлюсь на этом
Маркетинг страха..
Хороший ярлык, все-таки любят китайцы заморачиваться с тем, чтобы всему дать какое-то красивое имя
Хороший ярлык, все-таки любят китайцы заморачиваться с тем, чтобы всему дать какое-то красивое имя
Telegram
MarketTwits
❗️🇨🇳#ии #warning #китай #макро
Китай считает западные страшилки про ИИ-апокалипсис "маркетингом страха" для сдерживания конкуренции. Развитие ИИ тормозить не собирается, делает ставку на госконтроль, считая риск потери власти над ИИ маловероятным — NYT …
Китай считает западные страшилки про ИИ-апокалипсис "маркетингом страха" для сдерживания конкуренции. Развитие ИИ тормозить не собирается, делает ставку на госконтроль, считая риск потери власти над ИИ маловероятным — NYT …
🔥1
Хуанг красавец. Кто-то торгует страхом, а кто-то продолжает продавать лопаты. Вообще на страхе можно немало заработать..
Telegram
Data Secrets
Дженсен Хуанг и 100+ партнеров анонсируют NVIDIA Open Agent Safety Platform
Это система для контроля и ограничения ИИ-агентов, главная идея которой состоит в том, чтобы следить за агентом не только на уровне софта, но и на уровне железа.
Технически она…
Это система для контроля и ограничения ИИ-агентов, главная идея которой состоит в том, чтобы следить за агентом не только на уровне софта, но и на уровне железа.
Технически она…
❤1
very vibe coding
Прохожу курс детокса от Антропика, использую в качестве основной модели GPT. Впечатления следующие: во-первых, если раньше лимиты GPT мне на фоне Антропика казались бездонными, то сейчас эти времена закончились. Все утекает достаточно быстро, а с Астрой -…
Последние впечатления от chatGPT и воспоминания о том, как Claude вместо внешних моделей гонял Sonnet и меня обманывал навели меня на мысль, прикрутить к основной модели хуки с передачей вовпросов-ответов нейронки второй модели и ее работе в фоне. Назвал проект "Суфлер", буду подключать DeepSeek Flash.
Написал прототип на GPT, пообсуждал с Qwen 38 Мах, DeepSeek Flash - прикольно, что модели сходятся в оценках почти дословно, только дипсик все объясняет в 3 раза подробнее. Замечу, что модели отличаются по размеру в 5 раз. При слепом тесте однозначно взял бы DeepSeek. Не знаю, может программирует Qwen лучше.
И еще особенность - в отличие от всех других моделей и того же GPT, DeepSeek показывает все промежуточные рассуждения. Чем дальше, тем больше проникаюсь уважением к этим ребятам.
Написал прототип на GPT, пообсуждал с Qwen 38 Мах, DeepSeek Flash - прикольно, что модели сходятся в оценках почти дословно, только дипсик все объясняет в 3 раза подробнее. Замечу, что модели отличаются по размеру в 5 раз. При слепом тесте однозначно взял бы DeepSeek. Не знаю, может программирует Qwen лучше.
И еще особенность - в отличие от всех других моделей и того же GPT, DeepSeek показывает все промежуточные рассуждения. Чем дальше, тем больше проникаюсь уважением к этим ребятам.
Вернул подписку на GLM от Z.ai. Приятный бонус - у них агент AutoClaw - на основе pi и OpenClaw, но при его использовании количестов доступных токенов увеличивается в 1,5 раза. У меня сейчас основной опенкло гоняется на Луне, запасной на GLM или DeepSeek. Попробую на замену AutoClaw
Начинается OpenAI Dev Dey. Главный релиз - Astra 6.1, видимо, отложен. Жди доработок Codex а-ля DeepSeek Harness с плагинами, агентами и пр. Надеюсь, хотя бы младшие модельки выкатят.
Как положено, перед такими события конкуренты должны подложить свою ложку дегтя. В этот раз выпустили Sonnet 5.5.
И да, думаю без сброса лимитов сегодня-завтра не обойдется, токены не экономлю. Тем более что один сброс лимитов еще есть на черный день
Как положено, перед такими события конкуренты должны подложить свою ложку дегтя. В этот раз выпустили Sonnet 5.5.
И да, думаю без сброса лимитов сегодня-завтра не обойдется, токены не экономлю. Тем более что один сброс лимитов еще есть на черный день
Unsloth выпустил квантизацию Laya, которая работает на 4гб памяти. Буду тестировать.
Laya - это опенсорсный аналог Jev. А Jev - на мой взгляд, самое интересное, что происходило с момента выпуска Fable и Astra. Небольшая революция.
Суть в том, что эта модель натренирована не писать, а только выдавать ответ в виде классификатора (да/нет, какая категория и пр.) и процента уверенности. Такой датчик от нейросетей.
В чем бонус - это очень дешево и быстро. То есть маленькие модели могут во многих случаях заменить большие. Я бы сказал, что сейчас модели этого класса - главный хайп индустрии.
Кстати, оценка TypeSafe, которая выпустила Jev, за неделю выросла до 10 миллиардов баксов. Сам Jev на OpenRouter можно потестить, если не хотите с локальной моделью возиться.
Laya - это опенсорсный аналог Jev. А Jev - на мой взгляд, самое интересное, что происходило с момента выпуска Fable и Astra. Небольшая революция.
Суть в том, что эта модель натренирована не писать, а только выдавать ответ в виде классификатора (да/нет, какая категория и пр.) и процента уверенности. Такой датчик от нейросетей.
В чем бонус - это очень дешево и быстро. То есть маленькие модели могут во многих случаях заменить большие. Я бы сказал, что сейчас модели этого класса - главный хайп индустрии.
Кстати, оценка TypeSafe, которая выпустила Jev, за неделю выросла до 10 миллиардов баксов. Сам Jev на OpenRouter можно потестить, если не хотите с локальной моделью возиться.
unsloth.ai
Run and Serve Decision Models Locally with Unsloth: Laya + Jev API | Unsloth Documentation
Serve and run decision models locally with Unsloth.
👍1
Интересно, что тарифы на ИИ все больше начинают напоминать тарифы на электроэнергию. У z.ai дорогие часы (втрое дороже) с 9 до 13 по Москве. У DeepSeek - почти то же самое. Только в множитель - два, а не три, и еще с 4 до 7 утра дорого. Утренние и вечерние китайские пики потребления. Но зато в это время можно пользовать те же модели с OpenRouter без наценок - это имеет смысл для DeepSeek, так как он идет только по API, без подписки.
Отдельно скажу, что в связи с тем, что z.ai раньше шалила скачиваением репозиториев себе на сервера, обещали выдать кучу бесплатных лимитов и сборосов ограничений - но я у себя проверил, и вижу только один сборос. Так что особо не ведитесь.
Отдельно скажу, что в связи с тем, что z.ai раньше шалила скачиваением репозиториев себе на сервера, обещали выдать кучу бесплатных лимитов и сборосов ограничений - но я у себя проверил, и вижу только один сборос. Так что особо не ведитесь.
Новости OpenAI - прямо печаль какая-то, а не новости.
Telegram
эйай ньюз
OpenAI режут лимиты $200 подписки Pro в два раза
Вместе с этим снова открывают возможность подписаться на этот тир подписки. Оправдывают это тем что количество сделанного всё равно будет выше чем у Pro подписки месяц назад (пока ещё не вышла Astra) и тем…
Вместе с этим снова открывают возможность подписаться на этот тир подписки. Оправдывают это тем что количество сделанного всё равно будет выше чем у Pro подписки месяц назад (пока ещё не вышла Astra) и тем…
Forwarded from Denis Sexy IT 🤖
– Показали GPT 6.1, стоит в 5 раз дешевле Astra, примерно такой же уровень интеллекта
– Запустили режим Ultrafast для моделей, работает с Astra пока что – модель отвечает у 8 раз быстрее в этом режиме
– Новый тир подписки на 500$:
- Ultrafast доступен
- x25 лимиты
– Запустили свой Jev, называется Decision API
– Запустили режим Ultrafast для моделей, работает с Astra пока что – модель отвечает у 8 раз быстрее в этом режиме
– Новый тир подписки на 500$:
- Ultrafast доступен
- x25 лимиты
– Запустили свой Jev, называется Decision API