DEKSDEN notes
3.08K subscribers
760 photos
10 videos
4 files
763 links
Мои заметки на разные темы, уровень - "для продолжающих"
Vibe Coding -> AI SWE, AI Coding Tools, Agents, news, links
Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi

Админ @deksden

В канал бесплатно публикую опенсорс проекты - пишите админу

Вакансии? админу
Download Telegram
⚪️ Анонс Gpt-6 Sol + Luna состоялся


Ну - наконец то анонс с блогом. Почитаем!

Начнём с цен: 50% дешевле!

Sol: $2 ($0.20) / $10
Luna: $0.10 ($0.01) / $0.50

Цены кеша всё ещё повыше deepseek, но уже не в десятки раз - а ведь это самый важный момент в ценах.


GPT-6 Luna (max) is comparable to Fable 5 (medium) at 96% lower cost per task - это очень забавно, что Фублю уже с Луной сравнивают. Особенно выигрышно смотрится сравнение цены. Посмотрим на Луну в реальных тестах, будет ли она так же ходить кругами (ну а что вы ещё хотели от спутника то, в принципе?!)

Бенчи все лучше, кеш работает лучше - что делает систему дешевле. Надеюсь, лимиты этим поправят

Доработали: работа стала дешевле и лучше, больше надёжность работы с фактами, работа с кодом на уровне Фубли 5.1, улучшенный комьютерюз.

Важная доработка: стиоль общения модели Сол и Луна теперь такой же как у Астры-6, что есть здорово и хорошо.

Луна-6 доступна на десктопном приложении даже для бесплатных аккаунтов. Платные подписки уже все получили

🔗 Блог : https://openai.com/index/introducing-gpt-6-sol-and-luna/

—-

‼️ Тибо написал: And one more thing. We are loading a banked reset into all accounts of our Plus, Pro and Business users. Let's go!

Ждём банковый ресет на аккаунтах! У меня пока нету)

@deksden_notes
👍14🥰5🔥4❤2
⚪️ Qwen 4


Так как начало недели выдалось бедненьким на анонсы моделей, и в последние полчала никакой фронтирной СОТА модели не объявлено - то ситуацию приходится как то спасать!

Спасибо Алибабе за анонс своего Qwen в 4м поколении. Мы знаем что аръитектурные решения 4-го поколения уже тестируются вновом квен флеше 3.8, но на конференции Apsara рассказали следующее:

• нас ждут Qwen-4-Max, Qwen-4-Flash & Qwen-4-Plus
• Qwen-4-27B
• в поколении Qwen 4.5 и Qwen 5 будут модели размерностью 5-10T параметров
• дата выхода 4-го поколения: "coming soon"
• команда работает в том числе в направлении RSI (Recursive Self-Improvement) в части тренировки моделей, инференса и оптимизации модели/чипы;
• релих видео модели нового поколения (wan 3.5?) имеет целевую дату - Ноябрь 2026
• информации о 35B-A4B нет

(ц) когда мало новостей!

@deksden_notes
👍8😁8❤3
⚪️ ZCode UI mode


Добавлен переключатель - видно в Settings - Onboarding, второй экран

▶️ Не могу припомнить чтобы я видел что то подобное в каком то трёхпанельном приложении!

(ц) когда расцветают оригинальные идеи

@deksden_notes
😁10❤5
⚪️ Первые впечатления от новых моделей Gpt


Поработав немного с новыми моделями, готов поделиться своими впечатлениями

Релиз получился своеобразным. Gpt-6 Sol по качеству работы заметно от 5.6 я не пока не отличил, хотя ряд бенчей даже говорят о некоторой деградации. Впрочем, есть бенчи и про рост качества, но не особо крупный.

Этот релиз в целом - он получился скорее про цены / лимиты использования в подписке.

Самое заметное новшество - это то, что на Соле лимиты больше не тают на глазах. Да, они уменьшаются, но это, наверное, уже терпимо. Раньше было все очень плохо.

А луна и раньше радовала экономией лимитов, а сейчас даже с 1% квоты можно на ней работать очень и очень долго.

В общем, схема работы - астра решает сложные проблемы. Сол или Луну выбираем как рабочую лошадку для соответствующих задач.

Надеюсь, с нынешним поколением можно будет хотя бы на про подписках (х5/х20) работать более-менее комфортно. Посмотрим

@deksden_notes
2👍16🤝3🔥2❤‍🔥1
⚪️ Новая стелс модель на OpenCode

Space Bunny, 1m контекста, Мульти-модальная

Любопытно будет послушать отзывы / глянуть бенчи

Кто это ещё готовит модель?

Я с любопытством жду новый глм и кими

——

Upd 1️⃣ : возможно, это минимакс м4

——

Upd 2️⃣ : оно же есть на опенроутере!


@deksden_notes
😁7❤2👍2
⚪️ В Qoder бесплатно Qwen 3.8 Flash


До 30 сентября - бесплатно использовать, или дольше, если будут пользовать.

Были жалобы на медленный инференс у других провайдеров! Кто использует - отпишитесь, как оно, годное или не очень.

🔗 ссылка : https://qoder.com/download

@deksden_notes
🔥4👾2
⚪️ OpenCode Go Plus

Слухи про новый тир в тарифном плане opencode Go - Plus.

$40.

Смотрим на картинки!

(ц) не это не точно

@deksden_notes
👍7🔥6
⚪️ Ember-1, тюн К3 от Fireworks


Тут Fireworks захотел стать вендором и тюнит Кими К3. Назвали Ember-1.

🔗 Бложик : https://fireworks.ai/blog/ember-1

Там поболее графиков. Модель хуже не стала, даже местами получше.

За фичу от тюна подают что на 40% меньше токенов тратит при том же качестве.

А что нам токены? Что нам модели? Кими К3 уже удивить кого то не выйдет, нам инференс подавай быстрый и дешёвый!

Специальных условий не предложили, только возможность их чекпоинт дообучать для кастомизации модели под свои задачи.

В общем - пусть развлекаются! Будем иметь ввиду

@deksden_notes
😁4👍3👌1
⚪️ Переключение с CPA на native OpenAI API


Работаю в Кодексе app/cli. Сделал так: codex app привязан к крупным подпискам - х20, х5. Это удобнее: все функции апп доступны - и плагины, и sites, и remote привязан без заморочек.

Для cli использую пул подписок плюс/бизнес через CPA (CliProxyApi) с оболочкой Quotio. Чтобы запускать удобно, сделал враппер, который подставляет code home с конфигом, который указывает на провайдера cliproxyapi и подсовывает его ключик для авторизации.

Думаю сделать облачный прокси для себя, ну и чтобы часть проектов брала оттуда апи по необходимости.

▶️ Так вот! Какой момент хотел подсветить - не все знают, что кодекс "запекает" текущего провайдера в сессию при ряде условий (вроде бы возобновление).

Когда вы переходите из апп в cli и обратно, можете получить странные ошибки с ключиками авторизации. Это логично - ключ от openai не подходит к cliproxyapi, а openai не берет ключи CPA.

👉 Что делать? Всё просто. В нужной упряжке, на которую вы переключились, делаем форк сессии, который прописывает уже текущее ваше подключение. И можно спокойно работать. Следующая смена упряжек - новый форк.

❓Зачем это вам знать? Чтобы при таких обстоятельствах сэкономить некоторое время на разбирательство неочевидного поведения упряжки.


(ц) хозяйке на заметку!

@deksden_notes
👍9🔥3🤯2❤1
⚪️ Вести с полей


Поделюсь небольшим моментом, который отметил в работе

Делаю один экспериментальный пайплайн, который в оригинале работал на luna-5.6 high. Это кастомная упряжка, реализующая агентный поиск по базе знаний.

Сделал на неё небольшой тестовый стенд: один срез базы знаний, один вопрос. Решил сделать микро-эвал.

Взял оригинальный пайплайн на луне 5.6

Добавил новую луну 6 на идентичном пайплайне.

И сделал экспериментальный модернизированный пайплайн с привлечением Jev там, где можно - он пока не отработал и слегка нестабильный, но мне было интересно прикинуть применимость. Все запуски делались с @3 семплингом. Цифры - в табличке!

▶️ Что можно отметить: новая луна у меня не оказалась заметно быстрее. Скорее даже медленнее.

▶️ Зато луна-6 заметно экономнее по токенам, она меньше генерирует - хотя пайплайн максимально рельсовый, хоть и агентный.

‼️ Jev даёт колоссальное ускорение - в 2-3 РАЗА. Если грамотно его прикручивать, овчинка точно стоит выделки. Качество пока плавает, в том числе потому что у меня данные на русском, которые обрабатываются, а Jev не особо мульти-язычный.

Для себя я отметил, что класс таких моделей как Jev определённо стоит внимания. Буду применять.

@deksden_notes
👍20🔥2❤‍🔥1
⚪️ DeepSeek Harness Desktop


Первые релизы десктопа! Оно пока реально сырое, это для энтузиастов. Можно почитать readme (агентом).

Линки такие

🔗 Дока : https://github.com/deepseek-ai/deepseek-harness/blob/master/apps/desktop/README.md


🔗 macOS Apple Silicon: https://download.deepseek.com/dsh-desk/bin/mac-arm64/deepseek-harness-0.1.7-rc.1.20260924.1-mac-arm64.dmg

🔗 win64 : https://download.deepseek.com/dsh-desk/bin/win-x64/deepseek-harness-0.1.7-rc.1.20260924.1-win-x64.exe

@deksden_notes
👍5🔥3