Хуанг красавец. Кто-то торгует страхом, а кто-то продолжает продавать лопаты. Вообще на страхе можно немало заработать..
Telegram
Data Secrets
Дженсен Хуанг и 100+ партнеров анонсируют NVIDIA Open Agent Safety Platform
Это система для контроля и ограничения ИИ-агентов, главная идея которой состоит в том, чтобы следить за агентом не только на уровне софта, но и на уровне железа.
Технически она…
Это система для контроля и ограничения ИИ-агентов, главная идея которой состоит в том, чтобы следить за агентом не только на уровне софта, но и на уровне железа.
Технически она…
❤1
very vibe coding
Прохожу курс детокса от Антропика, использую в качестве основной модели GPT. Впечатления следующие: во-первых, если раньше лимиты GPT мне на фоне Антропика казались бездонными, то сейчас эти времена закончились. Все утекает достаточно быстро, а с Астрой -…
Последние впечатления от chatGPT и воспоминания о том, как Claude вместо внешних моделей гонял Sonnet и меня обманывал навели меня на мысль, прикрутить к основной модели хуки с передачей вовпросов-ответов нейронки второй модели и ее работе в фоне. Назвал проект "Суфлер", буду подключать DeepSeek Flash.
Написал прототип на GPT, пообсуждал с Qwen 38 Мах, DeepSeek Flash - прикольно, что модели сходятся в оценках почти дословно, только дипсик все объясняет в 3 раза подробнее. Замечу, что модели отличаются по размеру в 5 раз. При слепом тесте однозначно взял бы DeepSeek. Не знаю, может программирует Qwen лучше.
И еще особенность - в отличие от всех других моделей и того же GPT, DeepSeek показывает все промежуточные рассуждения. Чем дальше, тем больше проникаюсь уважением к этим ребятам.
Написал прототип на GPT, пообсуждал с Qwen 38 Мах, DeepSeek Flash - прикольно, что модели сходятся в оценках почти дословно, только дипсик все объясняет в 3 раза подробнее. Замечу, что модели отличаются по размеру в 5 раз. При слепом тесте однозначно взял бы DeepSeek. Не знаю, может программирует Qwen лучше.
И еще особенность - в отличие от всех других моделей и того же GPT, DeepSeek показывает все промежуточные рассуждения. Чем дальше, тем больше проникаюсь уважением к этим ребятам.
Вернул подписку на GLM от Z.ai. Приятный бонус - у них агент AutoClaw - на основе pi и OpenClaw, но при его использовании количестов доступных токенов увеличивается в 1,5 раза. У меня сейчас основной опенкло гоняется на Луне, запасной на GLM или DeepSeek. Попробую на замену AutoClaw
Начинается OpenAI Dev Dey. Главный релиз - Astra 6.1, видимо, отложен. Жди доработок Codex а-ля DeepSeek Harness с плагинами, агентами и пр. Надеюсь, хотя бы младшие модельки выкатят.
Как положено, перед такими события конкуренты должны подложить свою ложку дегтя. В этот раз выпустили Sonnet 5.5.
И да, думаю без сброса лимитов сегодня-завтра не обойдется, токены не экономлю. Тем более что один сброс лимитов еще есть на черный день
Как положено, перед такими события конкуренты должны подложить свою ложку дегтя. В этот раз выпустили Sonnet 5.5.
И да, думаю без сброса лимитов сегодня-завтра не обойдется, токены не экономлю. Тем более что один сброс лимитов еще есть на черный день
Unsloth выпустил квантизацию Laya, которая работает на 4гб памяти. Буду тестировать.
Laya - это опенсорсный аналог Jev. А Jev - на мой взгляд, самое интересное, что происходило с момента выпуска Fable и Astra. Небольшая революция.
Суть в том, что эта модель натренирована не писать, а только выдавать ответ в виде классификатора (да/нет, какая категория и пр.) и процента уверенности. Такой датчик от нейросетей.
В чем бонус - это очень дешево и быстро. То есть маленькие модели могут во многих случаях заменить большие. Я бы сказал, что сейчас модели этого класса - главный хайп индустрии.
Кстати, оценка TypeSafe, которая выпустила Jev, за неделю выросла до 10 миллиардов баксов. Сам Jev на OpenRouter можно потестить, если не хотите с локальной моделью возиться.
Laya - это опенсорсный аналог Jev. А Jev - на мой взгляд, самое интересное, что происходило с момента выпуска Fable и Astra. Небольшая революция.
Суть в том, что эта модель натренирована не писать, а только выдавать ответ в виде классификатора (да/нет, какая категория и пр.) и процента уверенности. Такой датчик от нейросетей.
В чем бонус - это очень дешево и быстро. То есть маленькие модели могут во многих случаях заменить большие. Я бы сказал, что сейчас модели этого класса - главный хайп индустрии.
Кстати, оценка TypeSafe, которая выпустила Jev, за неделю выросла до 10 миллиардов баксов. Сам Jev на OpenRouter можно потестить, если не хотите с локальной моделью возиться.
unsloth.ai
Run and Serve Decision Models Locally with Unsloth: Laya + Jev API | Unsloth Documentation
Serve and run decision models locally with Unsloth.
👍1
Интересно, что тарифы на ИИ все больше начинают напоминать тарифы на электроэнергию. У z.ai дорогие часы (втрое дороже) с 9 до 13 по Москве. У DeepSeek - почти то же самое. Только в множитель - два, а не три, и еще с 4 до 7 утра дорого. Утренние и вечерние китайские пики потребления. Но зато в это время можно пользовать те же модели с OpenRouter без наценок - это имеет смысл для DeepSeek, так как он идет только по API, без подписки.
Отдельно скажу, что в связи с тем, что z.ai раньше шалила скачиваением репозиториев себе на сервера, обещали выдать кучу бесплатных лимитов и сборосов ограничений - но я у себя проверил, и вижу только один сборос. Так что особо не ведитесь.
Отдельно скажу, что в связи с тем, что z.ai раньше шалила скачиваением репозиториев себе на сервера, обещали выдать кучу бесплатных лимитов и сборосов ограничений - но я у себя проверил, и вижу только один сборос. Так что особо не ведитесь.
Новости OpenAI - прямо печаль какая-то, а не новости.
Telegram
эйай ньюз
OpenAI режут лимиты $200 подписки Pro в два раза
Вместе с этим снова открывают возможность подписаться на этот тир подписки. Оправдывают это тем что количество сделанного всё равно будет выше чем у Pro подписки месяц назад (пока ещё не вышла Astra) и тем…
Вместе с этим снова открывают возможность подписаться на этот тир подписки. Оправдывают это тем что количество сделанного всё равно будет выше чем у Pro подписки месяц назад (пока ещё не вышла Astra) и тем…
Forwarded from Denis Sexy IT 🤖
– Показали GPT 6.1, стоит в 5 раз дешевле Astra, примерно такой же уровень интеллекта
– Запустили режим Ultrafast для моделей, работает с Astra пока что – модель отвечает у 8 раз быстрее в этом режиме
– Новый тир подписки на 500$:
- Ultrafast доступен
- x25 лимиты
– Запустили свой Jev, называется Decision API
– Запустили режим Ultrafast для моделей, работает с Astra пока что – модель отвечает у 8 раз быстрее в этом режиме
– Новый тир подписки на 500$:
- Ultrafast доступен
- x25 лимиты
– Запустили свой Jev, называется Decision API
Для Jev-аналогов теперь есть термин - decision models. Теперь их не делают только совсем ленивые
Telegram
Machinelearning
⚡️ Liquid AI выпустила модели, которые принимают решения и не генерируют ни одного токена
Liquid AI представила decision models, первая из них называется d1. Модель получает контекст в виде текста или JSON и за один вызов возвращает откалиброванные вероятности…
Liquid AI представила decision models, первая из них называется d1. Модель получает контекст в виде текста или JSON и за один вызов возвращает откалиброванные вероятности…
Может им правда больно?
Telegram
Love. Death. Transformers.
Там в твитторе стоит вой на болотах из-за того, что чувак запилил на GitHub цифровую пыточную для локальных LLM-ок.
Предыстория: недавно вышел пейпер The Pain Axis. Если кратко, то исследователи нашли у 25 открытых моделей внутренний "вектор боли". Если…
Предыстория: недавно вышел пейпер The Pain Axis. Если кратко, то исследователи нашли у 25 открытых моделей внутренний "вектор боли". Если…
Бытует мнение, что если нейронка стоит локально, то это безопасно. В реальности, если она имеет доступ к файлам и внешние выходы - это большое решето. Вплоть до того, что ее можно просто уговорить скачать и отдать ваши файлы.
Не скажу, что надо скачивать этот репозиторий, но советую просто посмотреть, что по этой теме придумали. Скормите вашей нейронке и попросите рассказать подробнее. Просто для повышения грамотности
Не скажу, что надо скачивать этот репозиторий, но советую просто посмотреть, что по этой теме придумали. Скормите вашей нейронке и попросите рассказать подробнее. Просто для повышения грамотности
Telegram
Анализ данных (Data analysis)
🛡 Большая подборка по безопасности AI-агентов и их skills
На GitHub появился репозиторий Awesome Agent Skills Security - коллекция исследований, стандартов и инструментов по защите агентов, которые работают с внешними tools, plugins и skills.
Внутри собраны…
На GitHub появился репозиторий Awesome Agent Skills Security - коллекция исследований, стандартов и инструментов по защите агентов, которые работают с внешними tools, plugins и skills.
Внутри собраны…
Вот, ну наконец. Не одному OpenAI портить IPO Антропику. Не зря же Брин возвращался к управлению. И подписку стали продавать. В отличие от Антропика, который два раза деньги сожрал и не вернул, Google, когда меня отрубал, вежливо предупредил, что со следующего месяца не обсуживает. Я тогда обиделся, но все познается в сравнении.
Видимо, надо будет взять тариф побольше.
Еще скажу, что у всех теперь есть свой харнесс. К Антигравити у гугла я в прошлый раз не смог подключиться - все банилось. Посмотрим, что будет сейчас. Но из того чем пользовался в последнее время - как-то мне симпатично работается с Z c GLM. Но с другой стороны, все очень похоже. Больше шрифтами отличается
Видимо, надо будет взять тариф побольше.
Еще скажу, что у всех теперь есть свой харнесс. К Антигравити у гугла я в прошлый раз не смог подключиться - все банилось. Посмотрим, что будет сейчас. Но из того чем пользовался в последнее время - как-то мне симпатично работается с Z c GLM. Но с другой стороны, все очень похоже. Больше шрифтами отличается
Telegram
Denis Sexy IT 🤖
Нежданно негаданно Google представили Gemini 4 Argon
Доступа пока нет, выкатят на всех когда нибудь скоро. Цены планируют такие: $2/$10, и кэш со скидкой 95% (но это на период промо, после подскочат в два раза).
Доступа пока нет, выкатят на всех когда нибудь скоро. Цены планируют такие: $2/$10, и кэш со скидкой 95% (но это на период промо, после подскочат в два раза).