⚪️ Анонс Gpt-6 Sol + Luna состоялся
Ну - наконец то анонс с блогом. Почитаем!
Начнём с цен: 50% дешевле!
Sol: $2 ($0.20) / $10
Luna: $0.10 ($0.01) / $0.50
Цены кеша всё ещё повыше deepseek, но уже не в десятки раз - а ведь это самый важный момент в ценах.
GPT-6 Luna (max) is comparable to Fable 5 (medium) at 96% lower cost per task - это очень забавно, что Фублю уже с Луной сравнивают. Особенно выигрышно смотрится сравнение цены. Посмотрим на Луну в реальных тестах, будет ли она так же ходить кругами (ну а что вы ещё хотели от спутника то, в принципе?!)
Бенчи все лучше, кеш работает лучше - что делает систему дешевле. Надеюсь, лимиты этим поправят
Доработали: работа стала дешевле и лучше, больше надёжность работы с фактами, работа с кодом на уровне Фубли 5.1, улучшенный комьютерюз.
Важная доработка: стиоль общения модели Сол и Луна теперь такой же как у Астры-6, что есть здорово и хорошо.
Луна-6 доступна на десктопном приложении даже для бесплатных аккаунтов. Платные подписки уже все получили
🔗 Блог : https://openai.com/index/introducing-gpt-6-sol-and-luna/
—-
‼️ Тибо написал: And one more thing. We are loading a banked reset into all accounts of our Plus, Pro and Business users. Let's go!
Ждём банковый ресет на аккаунтах! У меня пока нету)
@deksden_notes
Ну - наконец то анонс с блогом. Почитаем!
Начнём с цен: 50% дешевле!
Sol: $2 ($0.20) / $10
Luna: $0.10 ($0.01) / $0.50
Цены кеша всё ещё повыше deepseek, но уже не в десятки раз - а ведь это самый важный момент в ценах.
GPT-6 Luna (max) is comparable to Fable 5 (medium) at 96% lower cost per task - это очень забавно, что Фублю уже с Луной сравнивают. Особенно выигрышно смотрится сравнение цены. Посмотрим на Луну в реальных тестах, будет ли она так же ходить кругами (ну а что вы ещё хотели от спутника то, в принципе?!)
Бенчи все лучше, кеш работает лучше - что делает систему дешевле. Надеюсь, лимиты этим поправят
Доработали: работа стала дешевле и лучше, больше надёжность работы с фактами, работа с кодом на уровне Фубли 5.1, улучшенный комьютерюз.
Важная доработка: стиоль общения модели Сол и Луна теперь такой же как у Астры-6, что есть здорово и хорошо.
Луна-6 доступна на десктопном приложении даже для бесплатных аккаунтов. Платные подписки уже все получили
🔗 Блог : https://openai.com/index/introducing-gpt-6-sol-and-luna/
—-
‼️ Тибо написал: And one more thing. We are loading a banked reset into all accounts of our Plus, Pro and Business users. Let's go!
Ждём банковый ресет на аккаунтах! У меня пока нету)
@deksden_notes
👍14🥰5🔥4❤2
⚪️ Qwen 4
Так как начало недели выдалось бедненьким на анонсы моделей, и в последние полчала никакой фронтирной СОТА модели не объявлено - то ситуацию приходится как то спасать!
Спасибо Алибабе за анонс своего Qwen в 4м поколении. Мы знаем что аръитектурные решения 4-го поколения уже тестируются вновом квен флеше 3.8, но на конференции Apsara рассказали следующее:
• нас ждут Qwen-4-Max, Qwen-4-Flash & Qwen-4-Plus
• Qwen-4-27B
• в поколении Qwen 4.5 и Qwen 5 будут модели размерностью 5-10T параметров
• дата выхода 4-го поколения: "coming soon"
• команда работает в том числе в направлении RSI (Recursive Self-Improvement) в части тренировки моделей, инференса и оптимизации модели/чипы;
• релих видео модели нового поколения (wan 3.5?) имеет целевую дату - Ноябрь 2026
• информации о 35B-A4B нет
(ц) когда мало новостей!
@deksden_notes
Так как начало недели выдалось бедненьким на анонсы моделей, и в последние полчала никакой фронтирной СОТА модели не объявлено - то ситуацию приходится как то спасать!
Спасибо Алибабе за анонс своего Qwen в 4м поколении. Мы знаем что аръитектурные решения 4-го поколения уже тестируются вновом квен флеше 3.8, но на конференции Apsara рассказали следующее:
• нас ждут Qwen-4-Max, Qwen-4-Flash & Qwen-4-Plus
• Qwen-4-27B
• в поколении Qwen 4.5 и Qwen 5 будут модели размерностью 5-10T параметров
• дата выхода 4-го поколения: "coming soon"
• команда работает в том числе в направлении RSI (Recursive Self-Improvement) в части тренировки моделей, инференса и оптимизации модели/чипы;
• релих видео модели нового поколения (wan 3.5?) имеет целевую дату - Ноябрь 2026
• информации о 35B-A4B нет
(ц) когда мало новостей!
@deksden_notes
👍8😁8❤3
⚪️ ZCode UI mode
Добавлен переключатель - видно в Settings - Onboarding, второй экран
▶️ Не могу припомнить чтобы я видел что то подобное в каком то трёхпанельном приложении!
(ц) когда расцветают оригинальные идеи
@deksden_notes
Добавлен переключатель - видно в Settings - Onboarding, второй экран
▶️ Не могу припомнить чтобы я видел что то подобное в каком то трёхпанельном приложении!
(ц) когда расцветают оригинальные идеи
@deksden_notes
😁10❤5
⚪️ Первые впечатления от новых моделей Gpt
Поработав немного с новыми моделями, готов поделиться своими впечатлениями
Релиз получился своеобразным. Gpt-6 Sol по качеству работы заметно от 5.6 я не пока не отличил, хотя ряд бенчей даже говорят о некоторой деградации. Впрочем, есть бенчи и про рост качества, но не особо крупный.
Этот релиз в целом - он получился скорее про цены / лимиты использования в подписке.
Самое заметное новшество - это то, что на Соле лимиты больше не тают на глазах. Да, они уменьшаются, но это, наверное, уже терпимо. Раньше было все очень плохо.
А луна и раньше радовала экономией лимитов, а сейчас даже с 1% квоты можно на ней работать очень и очень долго.
В общем, схема работы - астра решает сложные проблемы. Сол или Луну выбираем как рабочую лошадку для соответствующих задач.
Надеюсь, с нынешним поколением можно будет хотя бы на про подписках (х5/х20) работать более-менее комфортно. Посмотрим
@deksden_notes
Поработав немного с новыми моделями, готов поделиться своими впечатлениями
Релиз получился своеобразным. Gpt-6 Sol по качеству работы заметно от 5.6 я не пока не отличил, хотя ряд бенчей даже говорят о некоторой деградации. Впрочем, есть бенчи и про рост качества, но не особо крупный.
Этот релиз в целом - он получился скорее про цены / лимиты использования в подписке.
Самое заметное новшество - это то, что на Соле лимиты больше не тают на глазах. Да, они уменьшаются, но это, наверное, уже терпимо. Раньше было все очень плохо.
А луна и раньше радовала экономией лимитов, а сейчас даже с 1% квоты можно на ней работать очень и очень долго.
В общем, схема работы - астра решает сложные проблемы. Сол или Луну выбираем как рабочую лошадку для соответствующих задач.
Надеюсь, с нынешним поколением можно будет хотя бы на про подписках (х5/х20) работать более-менее комфортно. Посмотрим
@deksden_notes
2👍16🤝3🔥2❤🔥1
⚪️ Новая стелс модель на OpenCode
Space Bunny, 1m контекста, Мульти-модальная
Любопытно будет послушать отзывы / глянуть бенчи
Кто это ещё готовит модель?
Я с любопытством жду новый глм и кими
——
Upd 1️⃣ : возможно, это минимакс м4
——
Upd 2️⃣ : оно же есть на опенроутере!
@deksden_notes
Space Bunny, 1m контекста, Мульти-модальная
Любопытно будет послушать отзывы / глянуть бенчи
Кто это ещё готовит модель?
Я с любопытством жду новый глм и кими
——
Upd 1️⃣ : возможно, это минимакс м4
——
Upd 2️⃣ : оно же есть на опенроутере!
@deksden_notes
😁7❤2👍2
⚪️ В Qoder бесплатно Qwen 3.8 Flash
До 30 сентября - бесплатно использовать, или дольше, если будут пользовать.
Были жалобы на медленный инференс у других провайдеров! Кто использует - отпишитесь, как оно, годное или не очень.
🔗 ссылка : https://qoder.com/download
@deksden_notes
До 30 сентября - бесплатно использовать, или дольше, если будут пользовать.
Были жалобы на медленный инференс у других провайдеров! Кто использует - отпишитесь, как оно, годное или не очень.
🔗 ссылка : https://qoder.com/download
@deksden_notes
🔥4👾2
⚪️ OpenCode Go Plus
Слухи про новый тир в тарифном плане opencode Go - Plus.
$40.
Смотрим на картинки!
(ц) не это не точно
@deksden_notes
Слухи про новый тир в тарифном плане opencode Go - Plus.
$40.
Смотрим на картинки!
(ц) не это не точно
@deksden_notes
👍7🔥6
⚪️ Ember-1, тюн К3 от Fireworks
Тут Fireworks захотел стать вендором и тюнит Кими К3. Назвали Ember-1.
🔗 Бложик : https://fireworks.ai/blog/ember-1
Там поболее графиков. Модель хуже не стала, даже местами получше.
За фичу от тюна подают что на 40% меньше токенов тратит при том же качестве.
А что нам токены? Что нам модели? Кими К3 уже удивить кого то не выйдет, нам инференс подавай быстрый и дешёвый!
Специальных условий не предложили, только возможность их чекпоинт дообучать для кастомизации модели под свои задачи.
В общем - пусть развлекаются! Будем иметь ввиду
@deksden_notes
Тут Fireworks захотел стать вендором и тюнит Кими К3. Назвали Ember-1.
🔗 Бложик : https://fireworks.ai/blog/ember-1
Там поболее графиков. Модель хуже не стала, даже местами получше.
За фичу от тюна подают что на 40% меньше токенов тратит при том же качестве.
А что нам токены? Что нам модели? Кими К3 уже удивить кого то не выйдет, нам инференс подавай быстрый и дешёвый!
Специальных условий не предложили, только возможность их чекпоинт дообучать для кастомизации модели под свои задачи.
В общем - пусть развлекаются! Будем иметь ввиду
@deksden_notes
😁4👍3👌1
⚪️ Переключение с CPA на native OpenAI API
Работаю в Кодексе app/cli. Сделал так: codex app привязан к крупным подпискам - х20, х5. Это удобнее: все функции апп доступны - и плагины, и sites, и remote привязан без заморочек.
Для cli использую пул подписок плюс/бизнес через CPA (CliProxyApi) с оболочкой Quotio. Чтобы запускать удобно, сделал враппер, который подставляет code home с конфигом, который указывает на провайдера cliproxyapi и подсовывает его ключик для авторизации.
Думаю сделать облачный прокси для себя, ну и чтобы часть проектов брала оттуда апи по необходимости.
▶️ Так вот! Какой момент хотел подсветить - не все знают, что кодекс "запекает" текущего провайдера в сессию при ряде условий (вроде бы возобновление).
Когда вы переходите из апп в cli и обратно, можете получить странные ошибки с ключиками авторизации. Это логично - ключ от openai не подходит к cliproxyapi, а openai не берет ключи CPA.
👉 Что делать? Всё просто. В нужной упряжке, на которую вы переключились, делаем форк сессии, который прописывает уже текущее ваше подключение. И можно спокойно работать. Следующая смена упряжек - новый форк.
❓Зачем это вам знать? Чтобы при таких обстоятельствах сэкономить некоторое время на разбирательство неочевидного поведения упряжки.
(ц) хозяйке на заметку!
@deksden_notes
Работаю в Кодексе app/cli. Сделал так: codex app привязан к крупным подпискам - х20, х5. Это удобнее: все функции апп доступны - и плагины, и sites, и remote привязан без заморочек.
Для cli использую пул подписок плюс/бизнес через CPA (CliProxyApi) с оболочкой Quotio. Чтобы запускать удобно, сделал враппер, который подставляет code home с конфигом, который указывает на провайдера cliproxyapi и подсовывает его ключик для авторизации.
Думаю сделать облачный прокси для себя, ну и чтобы часть проектов брала оттуда апи по необходимости.
▶️ Так вот! Какой момент хотел подсветить - не все знают, что кодекс "запекает" текущего провайдера в сессию при ряде условий (вроде бы возобновление).
Когда вы переходите из апп в cli и обратно, можете получить странные ошибки с ключиками авторизации. Это логично - ключ от openai не подходит к cliproxyapi, а openai не берет ключи CPA.
👉 Что делать? Всё просто. В нужной упряжке, на которую вы переключились, делаем форк сессии, который прописывает уже текущее ваше подключение. И можно спокойно работать. Следующая смена упряжек - новый форк.
❓Зачем это вам знать? Чтобы при таких обстоятельствах сэкономить некоторое время на разбирательство неочевидного поведения упряжки.
(ц) хозяйке на заметку!
@deksden_notes
👍9🔥3🤯2❤1
⚪️ Вести с полей
Поделюсь небольшим моментом, который отметил в работе
Делаю один экспериментальный пайплайн, который в оригинале работал на luna-5.6 high. Это кастомная упряжка, реализующая агентный поиск по базе знаний.
Сделал на неё небольшой тестовый стенд: один срез базы знаний, один вопрос. Решил сделать микро-эвал.
Взял оригинальный пайплайн на луне 5.6
Добавил новую луну 6 на идентичном пайплайне.
И сделал экспериментальный модернизированный пайплайн с привлечением Jev там, где можно - он пока не отработал и слегка нестабильный, но мне было интересно прикинуть применимость. Все запуски делались с @3 семплингом. Цифры - в табличке!
▶️ Что можно отметить: новая луна у меня не оказалась заметно быстрее. Скорее даже медленнее.
▶️ Зато луна-6 заметно экономнее по токенам, она меньше генерирует - хотя пайплайн максимально рельсовый, хоть и агентный.
‼️ Jev даёт колоссальное ускорение - в 2-3 РАЗА. Если грамотно его прикручивать, овчинка точно стоит выделки. Качество пока плавает, в том числе потому что у меня данные на русском, которые обрабатываются, а Jev не особо мульти-язычный.
Для себя я отметил, что класс таких моделей как Jev определённо стоит внимания. Буду применять.
@deksden_notes
Поделюсь небольшим моментом, который отметил в работе
Делаю один экспериментальный пайплайн, который в оригинале работал на luna-5.6 high. Это кастомная упряжка, реализующая агентный поиск по базе знаний.
Сделал на неё небольшой тестовый стенд: один срез базы знаний, один вопрос. Решил сделать микро-эвал.
Взял оригинальный пайплайн на луне 5.6
Добавил новую луну 6 на идентичном пайплайне.
И сделал экспериментальный модернизированный пайплайн с привлечением Jev там, где можно - он пока не отработал и слегка нестабильный, но мне было интересно прикинуть применимость. Все запуски делались с @3 семплингом. Цифры - в табличке!
▶️ Что можно отметить: новая луна у меня не оказалась заметно быстрее. Скорее даже медленнее.
▶️ Зато луна-6 заметно экономнее по токенам, она меньше генерирует - хотя пайплайн максимально рельсовый, хоть и агентный.
‼️ Jev даёт колоссальное ускорение - в 2-3 РАЗА. Если грамотно его прикручивать, овчинка точно стоит выделки. Качество пока плавает, в том числе потому что у меня данные на русском, которые обрабатываются, а Jev не особо мульти-язычный.
Для себя я отметил, что класс таких моделей как Jev определённо стоит внимания. Буду применять.
@deksden_notes
👍20🔥2❤🔥1
⚪️ DeepSeek Harness Desktop
Первые релизы десктопа! Оно пока реально сырое, это для энтузиастов. Можно почитать readme (агентом).
Линки такие
🔗 Дока : https://github.com/deepseek-ai/deepseek-harness/blob/master/apps/desktop/README.md
🔗 macOS Apple Silicon: https://download.deepseek.com/dsh-desk/bin/mac-arm64/deepseek-harness-0.1.7-rc.1.20260924.1-mac-arm64.dmg
🔗 win64 : https://download.deepseek.com/dsh-desk/bin/win-x64/deepseek-harness-0.1.7-rc.1.20260924.1-win-x64.exe
@deksden_notes
Первые релизы десктопа! Оно пока реально сырое, это для энтузиастов. Можно почитать readme (агентом).
Линки такие
🔗 Дока : https://github.com/deepseek-ai/deepseek-harness/blob/master/apps/desktop/README.md
🔗 macOS Apple Silicon: https://download.deepseek.com/dsh-desk/bin/mac-arm64/deepseek-harness-0.1.7-rc.1.20260924.1-mac-arm64.dmg
🔗 win64 : https://download.deepseek.com/dsh-desk/bin/win-x64/deepseek-harness-0.1.7-rc.1.20260924.1-win-x64.exe
@deksden_notes
👍5🔥3