⚪️ Xiaomi MiMO Desktop - closed beta
(ц) "ДескТоп за свои деньги!" - на самом деле, бесплатно, но по инвайтам.
Сяоми МиМо тут апп предлагает на тест, точнее, зовёт в список ожидания. Выглядит как очередной клон Кодекс апп, но МиМо в Cli сделали ряд интересных моментов, нестандартных. Я писал, к слову!
Вот и Десктоп посмотрю - чего за штука такая!
По описанию мне стало интересно глянуть: параллельные задачи встроенные в оболочку, какие интерактивные артефакты генерирует, автороутинг моделей, browser use / computer use
🔗 Запись в лист тут : https://mimo-ai.xiaomimimo.com/desktop/invite/
@deksden_notes
(ц) "ДескТоп за свои деньги!" - на самом деле, бесплатно, но по инвайтам.
Сяоми МиМо тут апп предлагает на тест, точнее, зовёт в список ожидания. Выглядит как очередной клон Кодекс апп, но МиМо в Cli сделали ряд интересных моментов, нестандартных. Я писал, к слову!
Вот и Десктоп посмотрю - чего за штука такая!
По описанию мне стало интересно глянуть: параллельные задачи встроенные в оболочку, какие интерактивные артефакты генерирует, автороутинг моделей, browser use / computer use
🔗 Запись в лист тут : https://mimo-ai.xiaomimimo.com/desktop/invite/
@deksden_notes
⚪️ Скорый релиз DeepSeek 4.1 Flash?
По хвиттеру поползли слухи про скорый релиз нового флеша от дипсиков. Текущий флеш уже очень и очень достойный, а новый будет только лучше за счёт нативной мультимодальности. То есть в обычный флеш таки добавили -vision и computer use / browser use может получить дешёвую, быструю и хорошую модель! Крутые новости. Теперь, надеюсь, все модели дпсика будут с вижином и нативно понимать картинки. Здорово если бы они двинулись в сторону омни-модальности - гуглу явно надо составлять конкуренцию в этом направлении.
Пока вроде в народе ходит некий тестовый чекпоинт, который валиден для 10 сентября.
Что ещё: новая архитектура, он конечно умнее чем раньше, и быстрее. Кто то говорил про 400 tps (https://x.com/SPAC89/status/2097248640221782311), но верится с трудом.
👉 Можно попробовать модель на официальных эндпоинтах по slug:
deepseek-v4.1-flash-expires-on-0910
#models
@deksden_notes
По хвиттеру поползли слухи про скорый релиз нового флеша от дипсиков. Текущий флеш уже очень и очень достойный, а новый будет только лучше за счёт нативной мультимодальности. То есть в обычный флеш таки добавили -vision и computer use / browser use может получить дешёвую, быструю и хорошую модель! Крутые новости. Теперь, надеюсь, все модели дпсика будут с вижином и нативно понимать картинки. Здорово если бы они двинулись в сторону омни-модальности - гуглу явно надо составлять конкуренцию в этом направлении.
Пока вроде в народе ходит некий тестовый чекпоинт, который валиден для 10 сентября.
Что ещё: новая архитектура, он конечно умнее чем раньше, и быстрее. Кто то говорил про 400 tps (https://x.com/SPAC89/status/2097248640221782311), но верится с трудом.
👉 Можно попробовать модель на официальных эндпоинтах по slug:
deepseek-v4.1-flash-expires-on-0910
#models
@deksden_notes
👍5🔥3
⚪️ ChatGPT Images 2.5
Слухи о том, что будет презентована новая модель для картинок ходили ещё на момент презентации Астры! Но релиз - только сегодня.
Новая модель:
• быстрее генерация
• улучшена детализация
• улучшена консистентность деталей при множественных правках
• возможность точечного редактирования в соовтетствии с промптами
Выкатывают сегодня на все планы, в веб, десктоп, мобильное приложение - и в кодекс, конечно.
В API будет две модели:
• GPT-Image-2.5 Flare - побыстрее
• GPT-Image-2.5 Sunburst - поточнее, но помедленнее
(ц) прикольно!
@deksden_notes
Слухи о том, что будет презентована новая модель для картинок ходили ещё на момент презентации Астры! Но релиз - только сегодня.
Новая модель:
• быстрее генерация
• улучшена детализация
• улучшена консистентность деталей при множественных правках
• возможность точечного редактирования в соовтетствии с промптами
Выкатывают сегодня на все планы, в веб, десктоп, мобильное приложение - и в кодекс, конечно.
В API будет две модели:
• GPT-Image-2.5 Flare - побыстрее
• GPT-Image-2.5 Sunburst - поточнее, но помедленнее
(ц) прикольно!
@deksden_notes
👍13❤2🔥1
⚪️ Muse
Цук достраивает ИИ экосистему - представлен агент Muse
Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.
Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).
🔗 Анонс: https://x.com/Muse/status/2097399178376671666
🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220
🔗 Оффсайт : https://muse.ai/
(ц) пускай будет
@deksden_notes
Цук достраивает ИИ экосистему - представлен агент Muse
Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.
Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).
🔗 Анонс: https://x.com/Muse/status/2097399178376671666
🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220
🔗 Оффсайт : https://muse.ai/
(ц) пускай будет
@deksden_notes
❤2👍1👌1
⚪️ ZSP - Зайки ищут региональных партнёров
Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.
Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.
Интересное..
🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813
@deksden_notes
Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.
Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.
Интересное..
🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813
@deksden_notes
🔥8👍4
Forwarded from AI да парень! / Sergei Notevskii
NVFP4, deepgemm, DSpark, P/D disaggr, CUDA 13.0
Это все для привлечения внимания, потому что:
Снова ищу инженеров в команду AI платформы Битрикс24
В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.
Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).
Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.
Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.
Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.
Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;
Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);
Куда писать и что присылать?
Пишите мне в личку: @Ser_no
В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;
Про платформу рассказываю тут и про команду тут.
Перешлите тому самому, верю в силу телеграма)
Снова ищу инженеров в команду AI платформы Битрикс24
В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.
Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).
Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.
Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.
Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.
Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;
Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);
Куда писать и что присылать?
Пишите мне в личку: @Ser_no
В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;
Про платформу рассказываю тут и про команду тут.
Перешлите тому самому, верю в силу телеграма)
🔥4😁4👍2❤1
⚪️ DeepSeek v4 pro уже легаси
… становится с запуском DS 4.1 Flash. Все запросы на pro модель будут перенаправляться на новый флеш.
Почему? Новые флеш всем лучше.
🔗 Пруф : https://x.com/tianyi/status/2097584362770530674?s=46
(ц) какой то победный марш флешей!
@deksden_notes
… становится с запуском DS 4.1 Flash. Все запросы на pro модель будут перенаправляться на новый флеш.
Почему? Новые флеш всем лучше.
🔗 Пруф : https://x.com/tianyi/status/2097584362770530674?s=46
(ц) какой то победный марш флешей!
@deksden_notes
👌10👍6👎1
⚪️ AA сделала удобные графики
Artificial Analysis, которую вы точно знаете по её Artificial Analysis Index - сделала на сайте удобные графики разного вида.
🔗 Анонс : https://x.com/ArtificialAnlys/status/2097526916760703097
🔗 оффсайт : https://artificialanalysis.ai/
🔗 пример графика : https://artificialanalysis.ai/models/muse-spark-1-3#intelligence-comparisons
Сейчас бы больше моделей в сравнение!
@deksden_notes
Artificial Analysis, которую вы точно знаете по её Artificial Analysis Index - сделала на сайте удобные графики разного вида.
🔗 Анонс : https://x.com/ArtificialAnlys/status/2097526916760703097
🔗 оффсайт : https://artificialanalysis.ai/
🔗 пример графика : https://artificialanalysis.ai/models/muse-spark-1-3#intelligence-comparisons
Сейчас бы больше моделей в сравнение!
@deksden_notes
🔥6👍2❤🔥1
⚪️ OpenDesign хвалит DeepSeek 4.1 Flash
По мне так, чрезмерно даже хвалят, но по их тестам он очень здорово умеет в дизайн на их бенчмарке.
🔗 Почитать : https://x.com/OpenDesignHQ/status/2097620919778955617
Накидаю графиков в комменты ⬇️
@deksden_notes
По мне так, чрезмерно даже хвалят, но по их тестам он очень здорово умеет в дизайн на их бенчмарке.
🔗 Почитать : https://x.com/OpenDesignHQ/status/2097620919778955617
Накидаю графиков в комменты ⬇️
@deksden_notes
👍7🔥5
⚪️ DeepSeek - изменение цен
Ну и раз уж нынче день новостей про дипсик, напомню - с 10 сентября меняется цена на вендорское апи:
Будет : $0.15 ($0.003) / $0.60
Сейчас : $0.22 ($0.007) / $0.66
Цены в пиковое время (01:00 - 04:00, 06:00 - 10:00 UTC по будням)- х2. По выходным нету пиковых часов.
Изменение очень значительное, в агентном применении 90% и более объёмов - это кеш, а он в х2+ раза становится дешевле! BIG
Кроме того, не забываем что все запросы на Pro модель с релизом флеша 4.1 будут уходить на него, видимо, по ценам флеша. Надеюсь, что цены флеша 4.1 будут именно такими, как объявлено - это вроде бы логично.
👉 Кстати - заметили, что китайцы делают акции и льготные цены на выходные? Заставляют работать 24/7 - а когда траву-то трогать?!))
@deksden_notes
Ну и раз уж нынче день новостей про дипсик, напомню - с 10 сентября меняется цена на вендорское апи:
Будет : $0.15 ($0.003) / $0.60
Сейчас : $0.22 ($0.007) / $0.66
Цены в пиковое время (01:00 - 04:00, 06:00 - 10:00 UTC по будням)- х2. По выходным нету пиковых часов.
Изменение очень значительное, в агентном применении 90% и более объёмов - это кеш, а он в х2+ раза становится дешевле! BIG
Кроме того, не забываем что все запросы на Pro модель с релизом флеша 4.1 будут уходить на него, видимо, по ценам флеша. Надеюсь, что цены флеша 4.1 будут именно такими, как объявлено - это вроде бы логично.
👉 Кстати - заметили, что китайцы делают акции и льготные цены на выходные? Заставляют работать 24/7 - а когда траву-то трогать?!))
@deksden_notes
👍14
⚪️ Codex лимиты штормит
Обратили внимание на глюки с лимитами? Вы не одиноки. В реддите и хвиттере многочисленные репорты что с лимитами кодекса что то странное творится. Они неожиданно обнуляются, или резко падают. Редеговорят что лимит неожиданно прибавился.
В общем, раньше бы радовались багу и ждали бы ресета.
Но накануне Тибо написал что дефицит компьюта на горизонте, и они подумывают даже приостановить продажу Про подписок! И сама прокомментировал.. Может, и хайп разгоняют, но дыма без огня не бывает
Или это презентация эпплов повлияла?
В общем, наблюдаем.
@deksden_notes
Обратили внимание на глюки с лимитами? Вы не одиноки. В реддите и хвиттере многочисленные репорты что с лимитами кодекса что то странное творится. Они неожиданно обнуляются, или резко падают. Редеговорят что лимит неожиданно прибавился.
В общем, раньше бы радовались багу и ждали бы ресета.
Но накануне Тибо написал что дефицит компьюта на горизонте, и они подумывают даже приостановить продажу Про подписок! И сама прокомментировал.. Может, и хайп разгоняют, но дыма без огня не бывает
Или это презентация эпплов повлияла?
В общем, наблюдаем.
@deksden_notes
👍9🤔6🤣2