⚪️ Codex Reset - banked
В общем, нашей ночью ещё один ручной ресет раздали всем платным пользователям! Астру можно (будет) тестить прям активно))
Мне даже на все плюсы уже долетел!
@deksden_notes
В общем, нашей ночью ещё один ручной ресет раздали всем платным пользователям! Астру можно (будет) тестить прям активно))
Мне даже на все плюсы уже долетел!
@deksden_notes
👍10❤3❤🔥1🔥1
⚪️ Экспериментальный Context Management в Codex
С версии 0.153 в кодексе есть флаг:
Он включает экспериментальное управление контекстом. Из информации пока небогато - есть ссылка в доках на абзац про это https://learn.chatgpt.com/docs/models?surface=cli#experimental-context-management
Есть заметка в changelog cli: (https://learn.chatgpt.com/docs/changelog#github-release-381669913)
Есть тема на реддите https://www.reddit.com/r/codex/comments/1w771mv/experimental_context_setting_in_codex/
В принципе, всё.
▶️ Из исследований исходников codex cli известно такое: Это экспериментальный флаг для управления длинным контекстом диалога. Он включает механизм, который позволяет модели при необходимости начать новое окно контекста, сохранив полезное состояние.
Что активируется при подходящих условиях:
• token_budget — Codex передаёт модели сведения об оставшемся контекстном бюджете и предупреждения перед исчерпанием окна.
• Нативные history notes — модель получает инструменты для чтения/записи заметок о ходе работы.
• Инструмент new_context — модель может запросить новое окно контекста. Старые сообщения текущего окна убираются из активного prompt’а, а Codex заново добавляет базовые инструкции, состояние окружения и сохранённые заметки. Файлы, терминал, git-репозиторий и прочее окружение при этом не сбрасываются.
В текущей реализации флаг включается только для сессий через официальный Codex backend с OAuth-логином ChatGPT и тарифом Plus, Pro или Pro Lite. Он намеренно не срабатывает для API-key, Free/Enterprise, кастомных провайдеров и endpoints, провайдерских credentials, AWS-конфигурации, а также временных structured-потоков TUI. То есть на CPA подключениях не сработает.
👉 Отзывы о работе флага весьма положительные. Я попробую включить для основного аккаунта, буду делится наблюдениями.
(ц) интересное
👉 грац @mrvladd за привлечение внимания к теме!
@deksden_notes
С версии 0.153 в кодексе есть флаг:
[features.context_management]
experimental_mode = true
Он включает экспериментальное управление контекстом. Из информации пока небогато - есть ссылка в доках на абзац про это https://learn.chatgpt.com/docs/models?surface=cli#experimental-context-management
Есть заметка в changelog cli: (https://learn.chatgpt.com/docs/changelog#github-release-381669913)
• Adds the disabled-by-default features.context_management.experimental_mode configuration. When enabled for eligible ChatGPT Plus, Pro, or Pro Lite sessions using the Codex backend, it activates token-budget context, history notes, and the new_context tool. API-key sessions, custom providers, and temporary structured threads remain excluded. (#42385)
Есть тема на реддите https://www.reddit.com/r/codex/comments/1w771mv/experimental_context_setting_in_codex/
В принципе, всё.
▶️ Из исследований исходников codex cli известно такое: Это экспериментальный флаг для управления длинным контекстом диалога. Он включает механизм, который позволяет модели при необходимости начать новое окно контекста, сохранив полезное состояние.
Что активируется при подходящих условиях:
• token_budget — Codex передаёт модели сведения об оставшемся контекстном бюджете и предупреждения перед исчерпанием окна.
• Нативные history notes — модель получает инструменты для чтения/записи заметок о ходе работы.
• Инструмент new_context — модель может запросить новое окно контекста. Старые сообщения текущего окна убираются из активного prompt’а, а Codex заново добавляет базовые инструкции, состояние окружения и сохранённые заметки. Файлы, терминал, git-репозиторий и прочее окружение при этом не сбрасываются.
В текущей реализации флаг включается только для сессий через официальный Codex backend с OAuth-логином ChatGPT и тарифом Plus, Pro или Pro Lite. Он намеренно не срабатывает для API-key, Free/Enterprise, кастомных провайдеров и endpoints, провайдерских credentials, AWS-конфигурации, а также временных structured-потоков TUI. То есть на CPA подключениях не сработает.
👉 Отзывы о работе флага весьма положительные. Я попробую включить для основного аккаунта, буду делится наблюдениями.
(ц) интересное
👉 грац @mrvladd за привлечение внимания к теме!
@deksden_notes
ChatGPT Learn
Models | ChatGPT Learn
Meet the AI models that power ChatGPT Work and Codex
👍16🤝5🔥3❤1
⚪️ Квота GLM Flash на всех планах Z.ai увеличена
Возможность использования GLM Flash на всех планах была увеличена - видимо, коэффициенты подкрутили для этой модели!
Кроме того, сделали х2 для сторонних упряжек типа Hermes / Крабобот
(ц) Ну и хорошо
@deksden_notes
Возможность использования GLM Flash на всех планах была увеличена - видимо, коэффициенты подкрутили для этой модели!
Кроме того, сделали х2 для сторонних упряжек типа Hermes / Крабобот
(ц) Ну и хорошо
@deksden_notes
❤6
⚪️ Ollama подписка - тир для пиковых часов
Ollama ввела в подписку понятие "пиковых часов" - это с 12:00 до 18:00 UTC по будням (5am-11am pacific), (15:00 до 21:00 МСК).
В остальное время, а также по выходным, некоторые модели будут дешевле.
Первыми тир по времени получили deepseek-v4-flash / deepseek-v4-pro. Они стали дешевле х2 вне пиковых часов! Приятно.
🔗 Ценники : https://ollama.com/pricing
🔗 Анонс : https://x.com/ollama/status/2096374001119744190
С учётом недавней смены модели начисления в подписке - стало немного получше.
@deksden_notes
Ollama ввела в подписку понятие "пиковых часов" - это с 12:00 до 18:00 UTC по будням (5am-11am pacific), (15:00 до 21:00 МСК).
В остальное время, а также по выходным, некоторые модели будут дешевле.
Первыми тир по времени получили deepseek-v4-flash / deepseek-v4-pro. Они стали дешевле х2 вне пиковых часов! Приятно.
🔗 Ценники : https://ollama.com/pricing
🔗 Анонс : https://x.com/ollama/status/2096374001119744190
С учётом недавней смены модели начисления в подписке - стало немного получше.
@deksden_notes
👍2
⚪️ Qoder добавляет custom url для BYOK
Чем важно?
Это даёт возможность использовать софт типа CliProxyApi / 9Router / Sub2api и подобное. Можно "завести" пул любых подписок в Qoder, что делает его гораздо удобнее.
В топовых упряжках типа Claude Code / Codex такая штука очень давно реализована. Но не все вендорские упряжки такое позволяют.
🔗 Анонс: https://x.com/qoder_ai_ide/status/2096234592617558440
@deksden_notes
Чем важно?
Это даёт возможность использовать софт типа CliProxyApi / 9Router / Sub2api и подобное. Можно "завести" пул любых подписок в Qoder, что делает его гораздо удобнее.
В топовых упряжках типа Claude Code / Codex такая штука очень давно реализована. Но не все вендорские упряжки такое позволяют.
🔗 Анонс: https://x.com/qoder_ai_ide/status/2096234592617558440
@deksden_notes
👌2❤1
🔥 Три разных человека. Три разных проекта. Один и тот же подход
— Юра взял «скучную» нишу с готовым спросом → сначала печальные $100/мес, через год уже ~$10K/мес
— Денис сделал Telegram-игру в одиночку на основе AI → ~ $1500 за 1,5 месяца после запуска
— Аня без кода запустила AI-бота для изучения английского → первые ~$200 уже в 1 месяц
Разные результаты. Разный масштаб. Но общие правила:
1. не придумывать «гениальную идею», а брать существующий спрос
2. делать простой MVP и быстро запускаться
3. докручивать монетизацию и продукт по факту использования
Ребята сделали всё без команды, без инвестиций, а самое главное — без ожидания «идеального момента». Да, не у всех получается сразу. И не у всех выходит на $10K. Но если системно идти по схеме выше — появляется первый доход с продукта, а дальше уже есть что масштабировать.
В комьюнити разбирают такие кейсы регулярно: @its_capitan. Что сработало, что нет, и почему.
— Юра взял «скучную» нишу с готовым спросом → сначала печальные $100/мес, через год уже ~$10K/мес
— Денис сделал Telegram-игру в одиночку на основе AI → ~ $1500 за 1,5 месяца после запуска
— Аня без кода запустила AI-бота для изучения английского → первые ~$200 уже в 1 месяц
Разные результаты. Разный масштаб. Но общие правила:
1. не придумывать «гениальную идею», а брать существующий спрос
2. делать простой MVP и быстро запускаться
3. докручивать монетизацию и продукт по факту использования
Ребята сделали всё без команды, без инвестиций, а самое главное — без ожидания «идеального момента». Да, не у всех получается сразу. И не у всех выходит на $10K. Но если системно идти по схеме выше — появляется первый доход с продукта, а дальше уже есть что масштабировать.
В комьюнити разбирают такие кейсы регулярно: @its_capitan. Что сработало, что нет, и почему.
Telegram
Короче, капитан – Запускаем мини-приложения
Веду проекты на 6млн+ юзеров.
Устроил челлендж по запуску 12 маленьких IT-проектов за 12 месяцев. Показываю как разрабатываем, где продвигаем, что зашло и что не очень. Делюсь метриками, которые обычно скрывают.
Связь с автором: @ig_zuev
Устроил челлендж по запуску 12 маленьких IT-проектов за 12 месяцев. Показываю как разрабатываем, где продвигаем, что зашло и что не очень. Делюсь метриками, которые обычно скрывают.
Связь с автором: @ig_zuev
💩24👎8🤡8🔥4👍3😁3
DEKSDEN notes pinned «🔥 Три разных человека. Три разных проекта. Один и тот же подход — Юра взял «скучную» нишу с готовым спросом → сначала печальные $100/мес, через год уже ~$10K/мес — Денис сделал Telegram-игру в одиночку на основе AI → ~ $1500 за 1,5 месяца после запуска —…»
⚪️ Hy4 preview обновился
Тенцент обновила модель - небольшой бамп бенчей. В принципе, модель ок - надо тестировать как оно на воркера поёдет
🔗 Доступно на их платформе : https://www.workbuddy.ai/
Там очередной клон кодекс апп, но небезинтересный - каналов удаленправления много, даже тележка есть! Такое же переключение work/code.
Бесплатный тарифный план есть, чуток кредитов насыпают, наверное что то можно потрогать! Hy4 preview и Hy3 пока бесплатно в нем.
🔗 Анонс : https://x.com/TencentHunyuan/status/2096899319513153543
@deksden_notes
Тенцент обновила модель - небольшой бамп бенчей. В принципе, модель ок - надо тестировать как оно на воркера поёдет
🔗 Доступно на их платформе : https://www.workbuddy.ai/
Там очередной клон кодекс апп, но небезинтересный - каналов удаленправления много, даже тележка есть! Такое же переключение work/code.
Бесплатный тарифный план есть, чуток кредитов насыпают, наверное что то можно потрогать! Hy4 preview и Hy3 пока бесплатно в нем.
🔗 Анонс : https://x.com/TencentHunyuan/status/2096899319513153543
@deksden_notes
👍1
⚪️ Codex Reset сегодня
Тибо объявил о новом ресете! К нам прилетит в ночь с сегодня на завтра, 5 утра по Москве (6pm PST today)
🔗 Пруф: https://x.com/thsottiaux/status/2097043464538264003
#codexreset
——
Upd 1️⃣ : ресет сегодня утром раскатали - все как и говорили!
У меня долетел в 04:23 утра мск.
@deksden_notes
Тибо объявил о новом ресете! К нам прилетит в ночь с сегодня на завтра, 5 утра по Москве (6pm PST today)
🔗 Пруф: https://x.com/thsottiaux/status/2097043464538264003
#codexreset
——
Upd 1️⃣ : ресет сегодня утром раскатали - все как и говорили!
У меня долетел в 04:23 утра мск.
@deksden_notes
🔥27👍2🥱2
⚪️ Xiaomi MiMO Desktop - closed beta
(ц) "ДескТоп за свои деньги!" - на самом деле, бесплатно, но по инвайтам.
Сяоми МиМо тут апп предлагает на тест, точнее, зовёт в список ожидания. Выглядит как очередной клон Кодекс апп, но МиМо в Cli сделали ряд интересных моментов, нестандартных. Я писал, к слову!
Вот и Десктоп посмотрю - чего за штука такая!
По описанию мне стало интересно глянуть: параллельные задачи встроенные в оболочку, какие интерактивные артефакты генерирует, автороутинг моделей, browser use / computer use
🔗 Запись в лист тут : https://mimo-ai.xiaomimimo.com/desktop/invite/
@deksden_notes
(ц) "ДескТоп за свои деньги!" - на самом деле, бесплатно, но по инвайтам.
Сяоми МиМо тут апп предлагает на тест, точнее, зовёт в список ожидания. Выглядит как очередной клон Кодекс апп, но МиМо в Cli сделали ряд интересных моментов, нестандартных. Я писал, к слову!
Вот и Десктоп посмотрю - чего за штука такая!
По описанию мне стало интересно глянуть: параллельные задачи встроенные в оболочку, какие интерактивные артефакты генерирует, автороутинг моделей, browser use / computer use
🔗 Запись в лист тут : https://mimo-ai.xiaomimimo.com/desktop/invite/
@deksden_notes
⚪️ Скорый релиз DeepSeek 4.1 Flash?
По хвиттеру поползли слухи про скорый релиз нового флеша от дипсиков. Текущий флеш уже очень и очень достойный, а новый будет только лучше за счёт нативной мультимодальности. То есть в обычный флеш таки добавили -vision и computer use / browser use может получить дешёвую, быструю и хорошую модель! Крутые новости. Теперь, надеюсь, все модели дпсика будут с вижином и нативно понимать картинки. Здорово если бы они двинулись в сторону омни-модальности - гуглу явно надо составлять конкуренцию в этом направлении.
Пока вроде в народе ходит некий тестовый чекпоинт, который валиден для 10 сентября.
Что ещё: новая архитектура, он конечно умнее чем раньше, и быстрее. Кто то говорил про 400 tps (https://x.com/SPAC89/status/2097248640221782311), но верится с трудом.
👉 Можно попробовать модель на официальных эндпоинтах по slug:
deepseek-v4.1-flash-expires-on-0910
#models
@deksden_notes
По хвиттеру поползли слухи про скорый релиз нового флеша от дипсиков. Текущий флеш уже очень и очень достойный, а новый будет только лучше за счёт нативной мультимодальности. То есть в обычный флеш таки добавили -vision и computer use / browser use может получить дешёвую, быструю и хорошую модель! Крутые новости. Теперь, надеюсь, все модели дпсика будут с вижином и нативно понимать картинки. Здорово если бы они двинулись в сторону омни-модальности - гуглу явно надо составлять конкуренцию в этом направлении.
Пока вроде в народе ходит некий тестовый чекпоинт, который валиден для 10 сентября.
Что ещё: новая архитектура, он конечно умнее чем раньше, и быстрее. Кто то говорил про 400 tps (https://x.com/SPAC89/status/2097248640221782311), но верится с трудом.
👉 Можно попробовать модель на официальных эндпоинтах по slug:
deepseek-v4.1-flash-expires-on-0910
#models
@deksden_notes
👍5🔥3
⚪️ ChatGPT Images 2.5
Слухи о том, что будет презентована новая модель для картинок ходили ещё на момент презентации Астры! Но релиз - только сегодня.
Новая модель:
• быстрее генерация
• улучшена детализация
• улучшена консистентность деталей при множественных правках
• возможность точечного редактирования в соовтетствии с промптами
Выкатывают сегодня на все планы, в веб, десктоп, мобильное приложение - и в кодекс, конечно.
В API будет две модели:
• GPT-Image-2.5 Flare - побыстрее
• GPT-Image-2.5 Sunburst - поточнее, но помедленнее
(ц) прикольно!
@deksden_notes
Слухи о том, что будет презентована новая модель для картинок ходили ещё на момент презентации Астры! Но релиз - только сегодня.
Новая модель:
• быстрее генерация
• улучшена детализация
• улучшена консистентность деталей при множественных правках
• возможность точечного редактирования в соовтетствии с промптами
Выкатывают сегодня на все планы, в веб, десктоп, мобильное приложение - и в кодекс, конечно.
В API будет две модели:
• GPT-Image-2.5 Flare - побыстрее
• GPT-Image-2.5 Sunburst - поточнее, но помедленнее
(ц) прикольно!
@deksden_notes
👍12❤2🔥1
⚪️ Muse
Цук достраивает ИИ экосистему - представлен агент Muse
Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.
Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).
🔗 Анонс: https://x.com/Muse/status/2097399178376671666
🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220
🔗 Оффсайт : https://muse.ai/
(ц) пускай будет
@deksden_notes
Цук достраивает ИИ экосистему - представлен агент Muse
Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.
Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).
🔗 Анонс: https://x.com/Muse/status/2097399178376671666
🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220
🔗 Оффсайт : https://muse.ai/
(ц) пускай будет
@deksden_notes
❤2👍1👌1
⚪️ ZSP - Зайки ищут региональных партнёров
Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.
Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.
Интересное..
🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813
@deksden_notes
Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.
Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.
Интересное..
🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813
@deksden_notes
🔥7👍4
Forwarded from AI да парень! / Sergei Notevskii
NVFP4, deepgemm, DSpark, P/D disaggr, CUDA 13.0
Это все для привлечения внимания, потому что:
Снова ищу инженеров в команду AI платформы Битрикс24
В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.
Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).
Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.
Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.
Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.
Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;
Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);
Куда писать и что присылать?
Пишите мне в личку: @Ser_no
В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;
Про платформу рассказываю тут и про команду тут.
Перешлите тому самому, верю в силу телеграма)
Снова ищу инженеров в команду AI платформы Битрикс24
В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.
Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).
Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.
Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.
Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.
Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;
Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);
Куда писать и что присылать?
Пишите мне в личку: @Ser_no
В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;
Про платформу рассказываю тут и про команду тут.
Перешлите тому самому, верю в силу телеграма)
🔥2👍1😁1