very vibe coding
121 subscribers
463 photos
126 videos
13 files
991 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Начинается OpenAI Dev Dey. Главный релиз - Astra 6.1, видимо, отложен. Жди доработок Codex а-ля DeepSeek Harness с плагинами, агентами и пр. Надеюсь, хотя бы младшие модельки выкатят.

Как положено, перед такими события конкуренты должны подложить свою ложку дегтя. В этот раз выпустили Sonnet 5.5.

И да, думаю без сброса лимитов сегодня-завтра не обойдется, токены не экономлю. Тем более что один сброс лимитов еще есть на черный день
Unsloth выпустил квантизацию Laya, которая работает на 4гб памяти. Буду тестировать.

Laya - это опенсорсный аналог Jev. А Jev - на мой взгляд, самое интересное, что происходило с момента выпуска Fable и Astra. Небольшая революция.

Суть в том, что эта модель натренирована не писать, а только выдавать ответ в виде классификатора (да/нет, какая категория и пр.) и процента уверенности. Такой датчик от нейросетей.

В чем бонус - это очень дешево и быстро. То есть маленькие модели могут во многих случаях заменить большие. Я бы сказал, что сейчас модели этого класса - главный хайп индустрии.

Кстати, оценка TypeSafe, которая выпустила Jev, за неделю выросла до 10 миллиардов баксов. Сам Jev на OpenRouter можно потестить, если не хотите с локальной моделью возиться.
👍1
Интересно, что тарифы на ИИ все больше начинают напоминать тарифы на электроэнергию. У z.ai дорогие часы (втрое дороже) с 9 до 13 по Москве. У DeepSeek - почти то же самое. Только в множитель - два, а не три, и еще с 4 до 7 утра дорого. Утренние и вечерние китайские пики потребления. Но зато в это время можно пользовать те же модели с OpenRouter без наценок - это имеет смысл для DeepSeek, так как он идет только по API, без подписки.

Отдельно скажу, что в связи с тем, что z.ai раньше шалила скачиваением репозиториев себе на сервера, обещали выдать кучу бесплатных лимитов и сборосов ограничений - но я у себя проверил, и вижу только один сборос. Так что особо не ведитесь.
Forwarded from Denis Sexy IT 🤖
– Показали GPT 6.1, стоит в 5 раз дешевле Astra, примерно такой же уровень интеллекта

– Запустили режим Ultrafast для моделей, работает с Astra пока что – модель отвечает у 8 раз быстрее в этом режиме

– Новый тир подписки на 500$:
- Ultrafast доступен
- x25 лимиты

– Запустили свой Jev, называется Decision API
Бытует мнение, что если нейронка стоит локально, то это безопасно. В реальности, если она имеет доступ к файлам и внешние выходы - это большое решето. Вплоть до того, что ее можно просто уговорить скачать и отдать ваши файлы.

Не скажу, что надо скачивать этот репозиторий, но советую просто посмотреть, что по этой теме придумали. Скормите вашей нейронке и попросите рассказать подробнее. Просто для повышения грамотности
Вот, ну наконец. Не одному OpenAI портить IPO Антропику. Не зря же Брин возвращался к управлению. И подписку стали продавать. В отличие от Антропика, который два раза деньги сожрал и не вернул, Google, когда меня отрубал, вежливо предупредил, что со следующего месяца не обсуживает. Я тогда обиделся, но все познается в сравнении.

Видимо, надо будет взять тариф побольше.

Еще скажу, что у всех теперь есть свой харнесс. К Антигравити у гугла я в прошлый раз не смог подключиться - все банилось. Посмотрим, что будет сейчас. Но из того чем пользовался в последнее время - как-то мне симпатично работается с Z c GLM. Но с другой стороны, все очень похоже. Больше шрифтами отличается
Ходят слухи, что недолго осталось ждать и новостей от SSI Ильи Суцкевера. Надеюсь, это будет действительно что-то прорывное, ресурсы у ребят есть
😁1
По Google Argon в нашей телеге хайпа побольше, чем в забугорных твиттерах. Похоже, что модель будет хорошей, но далеко не рекордной. Что, впрочем, тоже неплохо.

Ну а я пока запустил несколько задачек на GLM 5.3 Flash и надо скзать, что моделька меня очень радует. Посмотрим, что будет на более сложных задачах.
У меня на эту тему есть похожая, но немного другая идея (задумка Меты мне нравится, просто реализовать ее я сам не могу).

А тема следующая - вместе с основной моделью, скажем GPT Sol, поставить хуки и передавать инфу в другую модель, попроще, типа DeepSeek Flash. Задача второй модели - проверять, что основная не подвисла, не врет, не ушла в ненужную сторону. Соблюдает скиллы. Оптимизировать контекст (на случай когда из кэша выпали). То есть, если что-то не так, можно будет это увидеть в диалоге и вмешаться по ходу пьесы.

Такой харнесс на уровне хуков. Какие-то куски можно и с Jev попробовать сделать.

Начал кодировать, посмотрим, что получится
В рамках программы восстановления доверия подписчикам GLM раздется GLM Flash на 100 млн токенов с использованием до 10 октября. Извиняются за эпизоды скачивания данных пользователей.

Моделька неглупая, для рутинных задач подойдет. Сейчас она у меня лопатит региональное законодательство по одной теме - как раз лимиты пригодятся, хотя 100 млн хрен потратишь.

Ну, кстати, можно графовые базы строить - там нужны достаточно умные модели и уходит на это очень много ресурсов. Пользуясь случаем, запущу задачку.
👍1
Все, кто работает с нейронками достаточно плотно, в какой-то момент сталкиваются с харнессом. Нейронки - создания буйные, неуправляемые, без ограничений они плодят хаос. Я тоже попытался как-то выстраивать свою систему правил, но они меня победили - бросил это дело и переключился на работу.

Но проблемы особо и не исчезли. Я скорее просто смирился, чем хочу вернуться к жесткой системе скиллов. Но вот что меня удивляет - теме скиллов посвящена куча внимания. Миллионы репозиториям.

А вот хуки (они позволяют перехватывать команды, которые идут нейронке) забыты. Хотя, казалось бы это более удобная вещь для внедрения управления. Мне кажется это странным, упущением. Почему никто не говорит о хуках?