DEKSDEN notes
3K subscribers
704 photos
10 videos
3 files
721 links
Мои заметки на разные темы, уровень - "для продолжающих"
Vibe Coding -> AI SWE, AI Coding Tools, Agents, news, links
Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi

Админ @deksden

В канал бесплатно публикую опенсорс проекты - пишите админу

Вакансии? админу
Download Telegram
⚪️ Codex Reset - banked


В общем, нашей ночью ещё один ручной ресет раздали всем платным пользователям! Астру можно (будет) тестить прям активно))

Мне даже на все плюсы уже долетел!

@deksden_notes
👍103❤‍🔥1🔥1
⚪️ Экспериментальный Context Management в Codex

С версии 0.153 в кодексе есть флаг:


[features.context_management]
experimental_mode = true


Он включает экспериментальное управление контекстом. Из информации пока небогато - есть ссылка в доках на абзац про это https://learn.chatgpt.com/docs/models?surface=cli#experimental-context-management

Есть заметка в changelog cli: (https://learn.chatgpt.com/docs/changelog#github-release-381669913)


• Adds the disabled-by-default features.context_management.experimental_mode configuration. When enabled for eligible ChatGPT Plus, Pro, or Pro Lite sessions using the Codex backend, it activates token-budget context, history notes, and the new_context tool. API-key sessions, custom providers, and temporary structured threads remain excluded. (#42385)


Есть тема на реддите https://www.reddit.com/r/codex/comments/1w771mv/experimental_context_setting_in_codex/

В принципе, всё.

▶️ Из исследований исходников codex cli известно такое: Это экспериментальный флаг для управления длинным контекстом диалога. Он включает механизм, который позволяет модели при необходимости начать новое окно контекста, сохранив полезное состояние.

Что активируется при подходящих условиях:

• token_budget — Codex передаёт модели сведения об оставшемся контекстном бюджете и предупреждения перед исчерпанием окна.
• Нативные history notes — модель получает инструменты для чтения/записи заметок о ходе работы.
• Инструмент new_context — модель может запросить новое окно контекста. Старые сообщения текущего окна убираются из активного prompt’а, а Codex заново добавляет базовые инструкции, состояние окружения и сохранённые заметки. Файлы, терминал, git-репозиторий и прочее окружение при этом не сбрасываются.

В текущей реализации флаг включается только для сессий через официальный Codex backend с OAuth-логином ChatGPT и тарифом Plus, Pro или Pro Lite. Он намеренно не срабатывает для API-key, Free/Enterprise, кастомных провайдеров и endpoints, провайдерских credentials, AWS-конфигурации, а также временных structured-потоков TUI. То есть на CPA подключениях не сработает.

👉 Отзывы о работе флага весьма положительные. Я попробую включить для основного аккаунта, буду делится наблюдениями.

(ц) интересное

👉 грац @mrvladd за привлечение внимания к теме!

@deksden_notes
👍16🤝5🔥31
⚪️ Квота GLM Flash на всех планах Z.ai увеличена


Возможность использования GLM Flash на всех планах была увеличена - видимо, коэффициенты подкрутили для этой модели!

Кроме того, сделали х2 для сторонних упряжек типа Hermes / Крабобот

(ц) Ну и хорошо

@deksden_notes
6
⚪️ Ollama подписка - тир для пиковых часов


Ollama ввела в подписку понятие "пиковых часов" - это с 12:00 до 18:00 UTC по будням (5am-11am pacific), (15:00 до 21:00 МСК).

В остальное время, а также по выходным, некоторые модели будут дешевле.

Первыми тир по времени получили deepseek-v4-flash / deepseek-v4-pro. Они стали дешевле х2 вне пиковых часов! Приятно.

🔗 Ценники : https://ollama.com/pricing
🔗 Анонс : https://x.com/ollama/status/2096374001119744190

С учётом недавней смены модели начисления в подписке - стало немного получше.

@deksden_notes
👍2
⚪️ Qoder добавляет custom url для BYOK


Чем важно?

Это даёт возможность использовать софт типа CliProxyApi / 9Router / Sub2api и подобное. Можно "завести" пул любых подписок в Qoder, что делает его гораздо удобнее.

В топовых упряжках типа Claude Code / Codex такая штука очень давно реализована. Но не все вендорские упряжки такое позволяют.

🔗 Анонс: https://x.com/qoder_ai_ide/status/2096234592617558440

@deksden_notes
👌21
🔥 Три разных человека. Три разных проекта. Один и тот же подход

— Юра взял «скучную» нишу с готовым спросом → сначала печальные $100/мес, через год уже ~$10K/мес
— Денис сделал Telegram-игру в одиночку на основе AI → ~ $1500 за 1,5 месяца после запуска
— Аня без кода запустила AI-бота для изучения английского → первые ~$200 уже в 1 месяц

Разные результаты. Разный масштаб. Но общие правила:

1. не придумывать «гениальную идею», а брать существующий спрос
2. делать простой MVP и быстро запускаться
3. докручивать монетизацию и продукт по факту использования

Ребята сделали всё без команды, без инвестиций, а самое главное — без ожидания «идеального момента». Да, не у всех получается сразу. И не у всех выходит на $10K. Но если системно идти по схеме выше — появляется первый доход с продукта, а дальше уже есть что масштабировать.

В комьюнити разбирают такие кейсы регулярно: @its_capitan. Что сработало, что нет, и почему.
💩24👎8🤡8🔥4👍3😁3
DEKSDEN notes pinned «🔥 Три разных человека. Три разных проекта. Один и тот же подход — Юра взял «скучную» нишу с готовым спросом → сначала печальные $100/мес, через год уже ~$10K/мес — Денис сделал Telegram-игру в одиночку на основе AI → ~ $1500 за 1,5 месяца после запуска —…»
⚪️ Hy4 preview обновился


Тенцент обновила модель - небольшой бамп бенчей. В принципе, модель ок - надо тестировать как оно на воркера поёдет

🔗 Доступно на их платформе : https://www.workbuddy.ai/

Там очередной клон кодекс апп, но небезинтересный - каналов удаленправления много, даже тележка есть! Такое же переключение work/code.

Бесплатный тарифный план есть, чуток кредитов насыпают, наверное что то можно потрогать! Hy4 preview и Hy3 пока бесплатно в нем.

🔗 Анонс : https://x.com/TencentHunyuan/status/2096899319513153543

@deksden_notes
👍1
⚪️ Codex Reset сегодня


Тибо объявил о новом ресете! К нам прилетит в ночь с сегодня на завтра, 5 утра по Москве (6pm PST today)

🔗 Пруф: https://x.com/thsottiaux/status/2097043464538264003

#codexreset

——

Upd 1️⃣ : ресет сегодня утром раскатали - все как и говорили!
У меня долетел в 04:23 утра мск.

@deksden_notes
🔥27👍2🥱2
⚪️ Xiaomi MiMO Desktop - closed beta


(ц) "ДескТоп за свои деньги!" - на самом деле, бесплатно, но по инвайтам.

Сяоми МиМо тут апп предлагает на тест, точнее, зовёт в список ожидания. Выглядит как очередной клон Кодекс апп, но МиМо в Cli сделали ряд интересных моментов, нестандартных. Я писал, к слову!

Вот и Десктоп посмотрю - чего за штука такая!

По описанию мне стало интересно глянуть: параллельные задачи встроенные в оболочку, какие интерактивные артефакты генерирует, автороутинг моделей, browser use / computer use




🔗 Запись в лист тут : https://mimo-ai.xiaomimimo.com/desktop/invite/


@deksden_notes
⚪️ Скорый релиз DeepSeek 4.1 Flash?


По хвиттеру поползли слухи про скорый релиз нового флеша от дипсиков. Текущий флеш уже очень и очень достойный, а новый будет только лучше за счёт нативной мультимодальности. То есть в обычный флеш таки добавили -vision и computer use / browser use может получить дешёвую, быструю и хорошую модель! Крутые новости. Теперь, надеюсь, все модели дпсика будут с вижином и нативно понимать картинки. Здорово если бы они двинулись в сторону омни-модальности - гуглу явно надо составлять конкуренцию в этом направлении.

Пока вроде в народе ходит некий тестовый чекпоинт, который валиден для 10 сентября.

Что ещё: новая архитектура, он конечно умнее чем раньше, и быстрее. Кто то говорил про 400 tps (https://x.com/SPAC89/status/2097248640221782311), но верится с трудом.

👉 Можно попробовать модель на официальных эндпоинтах по slug:
deepseek-v4.1-flash-expires-on-0910

#models

@deksden_notes
👍5🔥3
⚪️ ChatGPT Images 2.5


Слухи о том, что будет презентована новая модель для картинок ходили ещё на момент презентации Астры! Но релиз - только сегодня.

Новая модель:
• быстрее генерация
• улучшена детализация
• улучшена консистентность деталей при множественных правках
• возможность точечного редактирования в соовтетствии с промптами

Выкатывают сегодня на все планы, в веб, десктоп, мобильное приложение - и в кодекс, конечно.

В API будет две модели:
• GPT-Image-2.5 Flare - побыстрее
• GPT-Image-2.5 Sunburst - поточнее, но помедленнее

(ц) прикольно!

@deksden_notes
👍122🔥1
⚪️ Muse


Цук достраивает ИИ экосистему - представлен агент Muse

Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.

Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).

🔗 Анонс: https://x.com/Muse/status/2097399178376671666

🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220

🔗 Оффсайт : https://muse.ai/

(ц) пускай будет

@deksden_notes
2👍1👌1
⚪️ ZSP - Зайки ищут региональных партнёров


Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.

Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.

Интересное..

🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813

@deksden_notes
🔥7👍4
NVFP4, deepgemm, DSpark, P/D disaggr, CUDA 13.0
Это все для привлечения внимания, потому что:

Снова ищу инженеров в команду AI платформы Битрикс24

В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.

Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).

Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.

Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.

Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.

Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;

Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);

Куда писать и что присылать?
Пишите мне в личку: @Ser_no

В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;

Про платформу рассказываю тут и про команду тут.

Перешлите тому самому, верю в силу телеграма)
🔥2👍1😁1