Киса | Deploy la Deploy
7.75K subscribers
870 photos
40 videos
1.56K links
Был канал по деплоям, потом по ретро и дегенству в крипте. Теперь это AI храм, в общем ничего нового, упарываемся.

Автор: @Notkisa
Гитхаб автора: https://github.com/howdeploy
Download Telegram
Киса | Deploy la Deploy
Смартики в твиттере обсасывают выход нового клода Просто доношу информацию. Я так, чисто присосаться да мемчик про ОПУСщенцев закинуть. Какой мне клод этот ваш.
Фанаты клода:

Посмотрели бэнчи, пиздец наш клодик еще лучше стал ^^

Посмотрим конечно на практике. Будут антропики конкурентов дальше в рот ебать или уже в жопу. Тупо нет альтернатив, клод лучший. Не могу ничем вайбкодить кроме клода.

Мой чат попробовав новый клод:

Сука, что за говно тупорылое. Эта херня в любом режиме на уровне Хаику. Фулл неюзабельно, Антропики пробили новое дно. Урезанный в мясо ГПТ на ультра на фоне клода в принципе хоть юзабельный. Клод для ОПУС_щенцев гоев.

А какое ваше мнение?
🐳21👍6🔥5😁22
Эти строки я посвящаю ChatGPT 5.6

Урезанному в хлам куску говна перед релизом Астра, который уже даже на MAX мышлении и Ultra режиме не может мне решить задачу более 24 часов.

Я календарь переверну
И снова третье сентября
На подписку я твою взгляну
И снова третье сентября
Но почему, но почему
Расстаться все же нам пришлось?
Ведь билдили в серьез
😁32👍7🔥72🐳1
Ну и еще в догонку

Сразу на весь сентябрь отстреляюсь мемами и заброшу канал, пойду заниматься обратно ютубом.

Подписка горит, вайбкодер плачет
Но он не смог поступить иначе
Прольется адренал-и-ин
А таурин расскажет, как он умре-е-ет
👍15🔥5😁33
А кими работает, пацаны.

Жаль они отключили акцию со своей рефкой, а от вас, любимые падпещики, налутал 2.5 месяца токенов сверху.

Вышел за все лимиты, юзаю 24на7, щас вместо ГПТ мой основной вайбкод агент.

КИТАЙ РОНЯЕТ ЗАПАД ПОЛУЧАЕТСЯ?!
🔥23👍6😁32
Codex и cc сдохли, ну.. рабочий день всё?
👍7😁3🔥1
Forwarded from KISA | arc Kimi认证专家
Love. Death. Transformers.
Codex и cc сдохли, ну.. рабочий день всё?
ВЛАДЕЛЬЦАМ КИМИ ХАРНЕССОВ ПОЕБАТЬ, ФУЛЛ.
😁23👍4🔥331
Пока ваш покорный слуга занят делами

А именно играет в игры, билдит проекты, чет вписывается в опенсурс и вот это все.

Ну и конечно же прописывает сценарии для новых ютуб роликов и планы по захвату X.

Я вам предлагаю почитать ребят из нашей СНГ тусовки, там достаточно много челиков собралось, кто плотно сел в AI нишу или постоянно работает с нейронками.

https://t.me/addlist/UdBZah4Cao4xZTMy

Тут есть прям мои приятели, с которыми я регулярно общаюсь у себя в комментариях или чате. Поэтому, добавьте папочку и посмотрите кто больше всего зайдет.

(Юникод, самурай и валенси, точно они)
🔥135👍2😁2
Мне выдали Astra

Завтра утром я встану и начну грузить задачами ChatGPT 6 Astra, а пока шо сладких снов.

Если кто уже тестирует или будет тестировать в эту ночь, конечно же, поделитесь в комментариях.

А я через 2-3 дня выпущу развернутый мега обзор, как обычно это и делаю.
27👍13🔥2😁21
Выход 2 лонгридов про релиз Астры точно сегодня. Прям зуб даю.

Поддержите анонс вашими реакциями и ставьте уведомления на канал. Отец лонгридного водяного альфового чтива — возвращается.
🔥652810👍6😁3
Привет, это Tainted Grail: The Fall of Avalon

И вы можете сказать. Киса, ты че ахуел?! Ты нам обзор игры принес вместо обзора чата гопоты?


Во-первых, это оч крутая игра, новый скайрим от мира инди игр. А во-вторых, пост не про игру а Codex.

Я понял, что тут какая-то сложная взаимосвязь..

И ты все верно понял, потому что первое о чем нам нужно поговорить с этим маркетинговым тестом AGI 100% бэнчмарк у ChatGPT 6 Astra — это 3D моделирование.

Я не буду забегать наперед, вернее сказать не хочу, но можно догадаться, что моделька точно не заслуживает слово революция.

Более того, возможно справедливо назвать это ChatGPT SOL+ версией. То есть да, я сильно скромнее оценил бы новый релиз.

Но свои почести от фронтов технологических войн, безусловно, Астра от меня сегодня получит.

3D модельки это вау

То что вы видите это полностью переработанная игровая модель, исходники которой нейронка взяла из установленной на моем ПК игры.

И возможно вам уже в интернете встречались рабочие копии майнкрафта, фактории и прочих. Если раньше ГПТ мог навайбкодить рабочую игру.

Как минимум через MCP/SDK/SKILLS внутри Unity и Roblox. Ну и простым добрым вайбкодом, написать движок с нуля (что вполне реально).

То теперь он может вайбкодить рабочую графику для этих игр, не отказывая себе в 3Д пространствах, в коих ранее был сильно ограничен.

Да ладно, вообще все иишки так-то были в состоянии, где мы не могли начать покорять 3D генерацией индустрию. Теперь на шаг ближе. Это круто.

Да у него много косяков, да я умышлено взял за основу реальную модель из видео игры лежащую на диске.

Но я как бы и не писал кастомные скиллы и не давал ему референсы поз и так далее. А гонял на High - Xhigh мышлении ради теста.

Видео с этой моделькой (переодел ее) запостил в мой X, сходите посмотрите. Заодно увидите как оно реально работает.

Поэтому, направление оное получило мега буст

Теперь можно активнее внедрять ГПТ в движки, проектирование моделей и создание видео игр или видео характера порно содержания под DLSS 5 версии, который энтузиасты уже украли и дропнули миру.

Продолжение обзор отдельным постом, а пока можете потыкать на отдельный список ссылок, которые любопытны.


- Откуда 100% AGI бэнчмарк
- В чем фокус и скам с этим бэнчем
- Nvidia DLSS 5 украли
- Разбор с демками на русском
- Где скачать DLSS 5
- Codex 3D, че умеет

Разбирать общие события вокруг игровой индустрии, и компании зеленых, и этой модели, лично мне интереснее, чем саму модель отдельно взятую. Такой вот релиз.
🔥17👍63😁1
А теперь про мозги Astra

Тут в чем фишка, главные возгласы про революцию, как я думаю, вызваны ровно двумя обманчивыми факторами.


1. ГПТ стал еще более человечным, эта тенденция явно наблюдается с версии 5.5 и у нее есть один неприятный факт, это все еще не Opus 4.6, вот так-то.

Я имею ввиду, что ГПТ изначально пошел по пути тупой прямой палки. Он делает буквально то, что сказано. А почти все вайбкодеры и энтузиасты промптят с таким высоким уровнем абстракции, что для чата гопоты их запрос буквально "сделай хуйню".

Отсюда и мнение, что клод во всем лучше. Просто для философии работы OpenAI предполагает, что вы мастер формальной логики, а не эмоциональный пубертатный билдер, который орет "ну ебани по красоте".

Но справедливо, для продукта такая себе отговорка. Вот они и работают над тем, чтобы их нейронка с полу-слова вас понимала. Чем когда-то всех и покорил клод.

И общаться в том же Hermes моделька стала еще лучше. Воды нет, бесконечных списков тоже. С этой точки зрения стало действительно лучше.

2. Ведь 5.6 был в усмерть урезан, помните?

Если так подумать, то ГПТ не освоил новые грани возможностей, его планка работы не выросла. То есть он как раньше закрывал задачи, так и сейчас.

90% тех задач, что для вас отлично закрывала прошлая версия, текущая тоже будет так же закрывать. Ничего не поменялось.

Он не стал достаточно человечным, чтобы без множества прямых уточнений сразу нормально работать с 3D, которое ему прокачали.

Этот фокус ранее провели Антропики. У вас была провальная 4.7 версия, а до нее урезанная в хлам легендарная 4.6 и когда на их фоне выходит просто ровно работающая 4.8 — выглядит как новый скачок.

Вот это история про Астру. Просто стало получше. Все.

И они взяли собрали отдельный харнесс заточенный под тест, что дает прирост свыше 40% к эффективности (хозяйке на заметку) и выдают это как буст модели.

Но это буквально буст отдельного харнесса. Так еще и тест определяет работу в замкнутых игровых средах. И к общему людскому интеллекту имеет отношение уровня моего члена и рта Альтмана.

Как вы понимаете — Альтман мне не сосал. А сосал ли я ему, вы разумеете, вольны спросить в комментах. Но я оставлю его без ответа.

Жор токенов и другие конские залупы

Пожалуй, всегда самая интересная часть обзоров на новые модели. Че там вообще по токенам то, нормально или выжирает все лимиты?

Честно говоря, по чатикам увидел общие отзывы, что стало кушать побольше. То есть на Ultra не юзабельно. Но я что так, что так — живу на Xhigh, мне норм.

Тем более мне за 2 дня задержки выкатки для меня Астры, отдали обещанные ручные сбросы, так я еще перед релизом обновился до подписки на 200 баксов.

На сотке в прошлой я проблем с лимитами, честно, не замечал.

Проблема многих в том, что они из коробки юзают нейронку в максы, а потом удивляются, что она сделала 5 лишних агентов и за 40 минут потратила 30% лимита.

Я вот как создал 3 месяца назад системные инструкции, так собственно ими и пользуюсь.

Еще Reza брадочек жаловался на удивительные лупы. А я на выходных прямо во время занятий с учениками у Кипа, столкнулся с такой залупой, что у нас у всех Астра отваливалась.

Либо делала простые таски по 30-50 минут на Normal мышлении, что просто Crazy. Полная хуйня.

В комментах увидел от моих смартиков билдеров, что на их как раз больших задачах лупы и огромный жор токенов.

Да, я знаю, что ГПТ долгий, но там явно у него обратный клин пошел и он из коробки слишком много думает, тестирует и проверяет. Это не было исправлено в новом релизе.

Движение 5.5 -> 5.6 было великим

Моделька сол научилась сама решать множество задач, это перестало быть просто крутым и главным аудитором кода.

И я весь свой стэк перевел на гопоту, построив все вокруг продуктовой линейки сэра Pidoras Альтмана. И был тем доволен.

Но релиз Astra это скорее большая пиар акция и приятное улучшение прошлой модели, нежели реально чет новое.

Это ни плохо и ни хорошо, это нормально и вполне себе приятно. Но если так подумать, если реально будут проблемы с жором токенов на всех задачах — шило на мыло. Сол был лучше.

SOL MAXI. AVE SOL.

Такие вот дела.
🔥38🐳18👍105😁33
Зай, люблю тебя!

Прочитай перед сном большой обзор на новую модель от OpenAI, пожалуйста.


Я увидел (очевидно), что просмотры резко просели, так как с папки пришел свежий трафик, который пошел смотреть мой канал. А потом я бац и дропнул два огромных лонгрида спустя 2 дня.

Комплексую из-за размера глазиков на постах. Такой труд огромный не пошли сразу же смотреть мои любимые читатели. Подумал, что потеряют в потоке постов.

- Часть первая
- Часть вторая

А я пока что делаю свой набор скиллов, чтобы Codex делал пиздатые 3д модельки. Как доделаю, разумеется, сразу дропну на канал.
🔥31👍17😁11
ОКАК

Астра сама себе задает вопросы и сама на них отвечает в стиле "нашего чата", таким образом обходя любые запреты на уровне agent.md и подобных инструкций для llm.

Поэтому, вам нужно гибче настраивать ваши харнессы используя такой простой инструмент, как hook.

И не использовать /goal, если вы реально хотите управлять процессом работы.

Чем больше мы даем агентам автономии, тем больше они начинает выдумывать себе за нас ожидаемое и правильное поведение.

А потом выходит кривая работа, которая вовремя не прошла аудит человеком. Нейронка не хочет остановится, она хочет продолжать и потому симулирует ваши разрешения.

Глубоко.
👍25😁12🔥74
ChatGPT Image 2.5 уничтожила Astra

Потому что, в отличие от основной модели может подарить вам эмоцию — ой, вау. На 10 минут.


Занятное наблюдение в работе, цензура жестко ограничивает по прежнему любые намеки на сексуализацию, но сама Астра пытается сразу вам предложить решение.

То есть не тупая заглушка "мы не можем создать", а именно агент, который объясняет на что сработала защита и как можно было бы сделать иначе.

Касаемо уровня генерации.

Я ничего не понял, стало лучше, а что именно стало лучше, моя сложно выражать русский слово-мысль.

В целом, кажется, что нейронка стала лучше понимать промпты и замечания. Они же до новой модели выкатили функции отметки комментариев и удаления фона.

В самой модели они явно повысили детализацию окружения, шире стали стили. Раньше ГПТ плохо понимал как симулировать PS1 графику, даже с референсами.

А сейчас просто попросил и хоба, готово. Также моя фраза "сделай в стиле труська чулка и присвятой подвяз" ну и тоже хоба, плюс минус похожее готово.

Да и в целом, у вас свои глаза есть. Смотрите, тестируйте.


Ваши работы в комменты!
🔥14😁55👍21
Media is too big
VIEW IN TELEGRAM
Это должно стать достоянием культуры.

Короткометражка "Токены мои горят".
😁60🔥9👍4🐳221
Обожаю бэнчмарки

Вышел Deepseek v4.1 flash и конечно же он во всем всех совокупляет. Прошлую версию, конкурентов.

Все стало в разы лучше, почти по всем тестам все растет.

Теперь смогу писать прон-фанфики про хакеров сладкоежек на 15% эффективнее.
😁30👍4🔥11
Мб мне запустить локальные модели (часть 1)

Никто об этом не просил, но лайкал в 20к старсов проекты с MoE моделями, значит подсознательно прям просили.


Поэтому, я психанул и написал свой фреймворк для агентов, чтобы они адаптировали любые локальные модели под вас.

https://github.com/howdeploy/LocalForgeLLM/

И теперь я буллишь по локальным нейронкам. Ибо с весны этого года, данная история стала сильно юзабельнее и рентабельнее, а главное дешевле.

Но. Но. Чтобы тебе кастрюлю не спаривать с пенсилом, поясню сейчас на пальцах. Предыстория.

Калибри епта

Мне мой другалек тонфлиппер aka соланафлиппер, скидывает мне иногда в личку проекты. Вот недавно он прислал Colibri, который работает как FreeToken.

Но фритокен вроде как посолиднее будет и интереснее. И дальше мы погрузимся в чудеса инженерии.

То есть уже созданная апка, которая запускает тяжелые огромные модели под ваше слабое железо. Работает все на магии упомянутого в хуке MoE. А что это?

MoE-модели (Mixture of Experts) — это архитектура нейросетей, в которой вместо одной большой и монолитной структуры используется множество меньших подсетей под названием эксперты + система маршрутизации между ними.


Простыми словами модель ту мы целиком качаем, но железо напрягается лишь на части этой модели, в зависимости от задачи.

И тут проблема в том, что на выходе иишка мне советует ставить 7B модели, а 26-31B модели через эти оптимизаторы у меня будут не юзабельны.

То есть, мне продают инструмент, что даст запустить на моей 4060 мощные модели, но толку в этом никакого. Рационально не бьется.

Однако, есть еще один известный вам метод. Который и в моем контенте ни раз упоминался. В гайдах, да и просто если погуглить. Llama или Ollama.

llama.cpp — это легковесный движок с открытым исходным кодом на языках C и C++, предназначенный для локального запуска больших языковых моделей (LLM) на домашнем или условно-домашнем железе.


И тут начинается интересное, потому что в настройках llama.cpp можно подогнать модельку строго под железо, доведя до абсолютно вылизанного состояния то, как будет работать MoE модель у вас.

А еще существуют методы предварительного сжатия вроде APEX. Ну и напомню, если кто забыл, ранее я рассказывал про виды квантований. Вернее вкинул, что их много и они разные.

И дальше мы про это подробно поговорим, ибо именно MoE APEX модельки я считаю революцией, гемой и скрытой альфой.

У этой штуки еще меньше обсуждений в сети и старсов на гитхабе, но творит она прям лютые вещи. Скоро узнаете, что там именно получается.

Так-с, а че такое фреймворк?

Framework — готовая программная платформа и набор правил, которые задают архитектуру будущего приложения и берут на себя рутинные задачи.


Я уже выпускал подобное ради интереса, когда сделал фреймворк абуза халявных токенов на любую нейронку. А теперь я сделал базис, который позволяет агенту ужать модель под ваше железо.

И как можно было понять, существует немалое количество реализаций — как бы нам модели сжать, оптимиировать aka ускорить и не потерять в качестве. Но запихнуть в микроволновку вместо серверного оборудования за много бабок.

Значит эти реализации можно выпотрашить, прогнать по ним вайбкодом личные сборки моделей, подогнать на тестах и сделать это рабочим инструментом.

Ссылка на мой фреймворк
. А дальше будет пост часть 2, где я расскажу как это работает и куда тыкать.
👍17🔥833😁1🐳1
Мб мне запустить локальные модели (часть 2)

Я поясню вам как устроен мой фреймворк и какие цифры можно выжать, а они по размеру, как мой средне-европейский хуй.


Читать строго начинать с части 1, никакого скипать. Онли кушать много букаф!

Значится, весь фреймворк базируется сразу на скилле и документации для агента, где отдельно разобрано агенту понимание как эти модели воркают.

Но смысл тут в том, что нейронка подключается и сразу знает, что вам скачать, как и где параметры поменять, чего вы получите на выходе на ваше железо.

Технически, я написал инструментарий и принципы, как модели под себя подгонять. А также добавил источники какие и откуда брать. А техническая база чужая: методы llama.ccp, apex и FreeToken.

Хотя в текущей реализации лично у меня это просто чужие apex модельки. Для меня лично самый гемовый инструмент, ноушилл темка.

Ну и на уже своих реальных тестах собрал исчерпывающую статистику, что в мое железо можно засунуть.

ЧТО ПО НАГРУЗКЕ

RTX 4060 8 ГБ + Ryzen 5 5600 + 32 ГБ RAM

- Qwen3.6-35B-A3B APEX-I-Compact в 32к контекста, 20 токенов в секунду
- Gemma 4 26B-A4B Heretic APEX-I-Balanced в 32к контекста, 10 токенов в секунду

В пике CPU грузился до 46-70%
GPU до 70-100%

При том, что расчет был в потреблении не на полную. Видео памяти не сжирало под модельку больше 5гб из 8гб.

Оперативки около половины. Агент может работать пока вы слушаете музыку, сидите в ТГ и серчите веб.

UPD: НАГРУЗКА В ПИКЕ С АГЕНТОМ ОДНОВРЕМЕННО! БУКВАЛЬНО БЕЗ НАДОБНОСТИ ХОТЬ ЧЕТ ВЫКЛЮЧИТЬ.


Из коробки реализованы от меня:

- Работает под llama-ui, модель его откроет в браузере. Этого UI более чем достаточно. Вариант юзать по умолчанию
- Навык вокруг openshell + Pi: соберет podman контейнер, изолирует от системы и даст вам строить личный харнесс
- Может поменять настройки Hermes, сделать модельку доступной там

В MVP версии весь упор сделан на LLM и метод именно от APEX, главным образом махинации с llama.cpp, а уже потом отдельный докрут самой модели.

Adaptive Precision for EXpert Models вот как это расшифровывается. Взял основу отсюда, шикарный вайбкод проект. APEX дополнительно экономит память, распределяя точность хранения весов. Он сильнее сжимает экспертов в середине сети, оставляя больше точности чувствительным крайним слоям и общим блокам.


Внутри лежат также методы прогона моделей, но придется брать большой запас памяти на диске, 80-100гб на создание модельки в 16-20гб.

Но как бы на HF уже полно моделей, агент скачивает готовую, переставляет параметры запуска: объем контекста, распределение нагрузки. Ну и вуаля, вы юзаете на локалке хорошую ллмку.

То есть агент делает нейронку под ваше железо и подключает в удобный вам интерфейс, врубая в фоне. Железо и мои результаты по моделям выше.

Как пользоваться?

1. Дать иишке ссылку
2. Попросить поставить X нейронку
3. Согласовать на сколько нагружать ваш ПК
4. Готово

Если есть желание, можно отдельно дать ссылку на модельку и попросить сделать из нее сжатую модельку. Либо найдет нужную, либо на вашем железе сделает.

Мой вердикт:

Это буквально локальные агенты, вайбкод едва ли сделают, могут затупить с отправкой/чтением файла. У них не 100% tools use, но в остальном оно работает.

С картинок изображение читает, с ллм вики работает, прогрев для гоев написать сможет. Чет потыкать в системе может.
👍13🔥105😁1🐳11