DEKSDEN notes
3K subscribers
708 photos
10 videos
3 files
724 links
Мои заметки на разные темы, уровень - "для продолжающих"
Vibe Coding -> AI SWE, AI Coding Tools, Agents, news, links
Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi

Админ @deksden

В канал бесплатно публикую опенсорс проекты - пишите админу

Вакансии? админу
Download Telegram
⚪️ Xiaomi MiMO Desktop - closed beta


(ц) "ДескТоп за свои деньги!" - на самом деле, бесплатно, но по инвайтам.

Сяоми МиМо тут апп предлагает на тест, точнее, зовёт в список ожидания. Выглядит как очередной клон Кодекс апп, но МиМо в Cli сделали ряд интересных моментов, нестандартных. Я писал, к слову!

Вот и Десктоп посмотрю - чего за штука такая!

По описанию мне стало интересно глянуть: параллельные задачи встроенные в оболочку, какие интерактивные артефакты генерирует, автороутинг моделей, browser use / computer use




🔗 Запись в лист тут : https://mimo-ai.xiaomimimo.com/desktop/invite/


@deksden_notes
⚪️ Скорый релиз DeepSeek 4.1 Flash?


По хвиттеру поползли слухи про скорый релиз нового флеша от дипсиков. Текущий флеш уже очень и очень достойный, а новый будет только лучше за счёт нативной мультимодальности. То есть в обычный флеш таки добавили -vision и computer use / browser use может получить дешёвую, быструю и хорошую модель! Крутые новости. Теперь, надеюсь, все модели дпсика будут с вижином и нативно понимать картинки. Здорово если бы они двинулись в сторону омни-модальности - гуглу явно надо составлять конкуренцию в этом направлении.

Пока вроде в народе ходит некий тестовый чекпоинт, который валиден для 10 сентября.

Что ещё: новая архитектура, он конечно умнее чем раньше, и быстрее. Кто то говорил про 400 tps (https://x.com/SPAC89/status/2097248640221782311), но верится с трудом.

👉 Можно попробовать модель на официальных эндпоинтах по slug:
deepseek-v4.1-flash-expires-on-0910

#models

@deksden_notes
👍5🔥3
⚪️ ChatGPT Images 2.5


Слухи о том, что будет презентована новая модель для картинок ходили ещё на момент презентации Астры! Но релиз - только сегодня.

Новая модель:
• быстрее генерация
• улучшена детализация
• улучшена консистентность деталей при множественных правках
• возможность точечного редактирования в соовтетствии с промптами

Выкатывают сегодня на все планы, в веб, десктоп, мобильное приложение - и в кодекс, конечно.

В API будет две модели:
• GPT-Image-2.5 Flare - побыстрее
• GPT-Image-2.5 Sunburst - поточнее, но помедленнее

(ц) прикольно!

@deksden_notes
👍132🔥1
⚪️ Muse


Цук достраивает ИИ экосистему - представлен агент Muse

Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.

Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).

🔗 Анонс: https://x.com/Muse/status/2097399178376671666

🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220

🔗 Оффсайт : https://muse.ai/

(ц) пускай будет

@deksden_notes
2👍1👌1
⚪️ ZSP - Зайки ищут региональных партнёров


Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.

Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.

Интересное..

🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813

@deksden_notes
🔥8👍4
NVFP4, deepgemm, DSpark, P/D disaggr, CUDA 13.0
Это все для привлечения внимания, потому что:

Снова ищу инженеров в команду AI платформы Битрикс24

В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.

Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).

Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.

Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.

Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.

Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;

Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);

Куда писать и что присылать?
Пишите мне в личку: @Ser_no

В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;

Про платформу рассказываю тут и про команду тут.

Перешлите тому самому, верю в силу телеграма)
🔥4😁4👍21
⚪️ DeepSeek v4 pro уже легаси


… становится с запуском DS 4.1 Flash. Все запросы на pro модель будут перенаправляться на новый флеш.

Почему? Новые флеш всем лучше.

🔗 Пруф : https://x.com/tianyi/status/2097584362770530674?s=46

(ц) какой то победный марш флешей!

@deksden_notes
👌10👍6👎1
⚪️ AA сделала удобные графики


Artificial Analysis, которую вы точно знаете по её Artificial Analysis Index - сделала на сайте удобные графики разного вида.

🔗 Анонс : https://x.com/ArtificialAnlys/status/2097526916760703097

🔗 оффсайт : https://artificialanalysis.ai/

🔗 пример графика : https://artificialanalysis.ai/models/muse-spark-1-3#intelligence-comparisons

Сейчас бы больше моделей в сравнение!

@deksden_notes
🔥6👍2❤‍🔥1
⚪️ OpenDesign хвалит DeepSeek 4.1 Flash


По мне так, чрезмерно даже хвалят, но по их тестам он очень здорово умеет в дизайн на их бенчмарке.

🔗 Почитать : https://x.com/OpenDesignHQ/status/2097620919778955617

Накидаю графиков в комменты ⬇️

@deksden_notes
👍7🔥5
⚪️ DeepSeek - изменение цен


Ну и раз уж нынче день новостей про дипсик, напомню - с 10 сентября меняется цена на вендорское апи:

Будет : $0.15 ($0.003) / $0.60
Сейчас : $0.22 ($0.007) / $0.66

Цены в пиковое время (01:00 - 04:00, 06:00 - 10:00 UTC по будням)- х2. По выходным нету пиковых часов.

Изменение очень значительное, в агентном применении 90% и более объёмов - это кеш, а он в х2+ раза становится дешевле! BIG

Кроме того, не забываем что все запросы на Pro модель с релизом флеша 4.1 будут уходить на него, видимо, по ценам флеша. Надеюсь, что цены флеша 4.1 будут именно такими, как объявлено - это вроде бы логично.


👉 Кстати - заметили, что китайцы делают акции и льготные цены на выходные? Заставляют работать 24/7 - а когда траву-то трогать?!))

@deksden_notes
👍14
⚪️ Codex лимиты штормит


Обратили внимание на глюки с лимитами? Вы не одиноки. В реддите и хвиттере многочисленные репорты что с лимитами кодекса что то странное творится. Они неожиданно обнуляются, или резко падают. Редеговорят что лимит неожиданно прибавился.

В общем, раньше бы радовались багу и ждали бы ресета.

Но накануне Тибо написал что дефицит компьюта на горизонте, и они подумывают даже приостановить продажу Про подписок! И сама прокомментировал.. Может, и хайп разгоняют, но дыма без огня не бывает

Или это презентация эпплов повлияла?

В общем, наблюдаем.

@deksden_notes
👍9🤔6🤣2