⚪️ Muse
Цук достраивает ИИ экосистему - представлен агент Muse
Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.
Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).
🔗 Анонс: https://x.com/Muse/status/2097399178376671666
🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220
🔗 Оффсайт : https://muse.ai/
(ц) пускай будет
@deksden_notes
Цук достраивает ИИ экосистему - представлен агент Muse
Это некий аналог Grok Bot / Cowork / ChatGPT Work, тоже со своим компом в облаке. На крабобота похоже меньше - нет каналов связи и сильно проще. Досупен только в US, 18+. Работает через своё мобильное приложение ios / android.
Маркетинговые материалы - общие, чем и какой агент надо смотреть! Но зарегаться не удалось ни на текущий аккаунт, ни на новый - ошибка (This account need permissions to view this page).
🔗 Анонс: https://x.com/Muse/status/2097399178376671666
🔗 Промо видео пост : https://x.com/stretchcloud/status/2097419515436937220
🔗 Оффсайт : https://muse.ai/
(ц) пускай будет
@deksden_notes
❤2👍1👌1
⚪️ ZSP - Зайки ищут региональных партнёров
Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.
Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.
Интересное..
🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813
@deksden_notes
Какая интересная программа! Комания ищет партенров, которые будут отвечать за развитие и внедрение GLM в своих странах.
Как минимум - компания ищет локальный инференс, сотрудничает по разным направлениям, в том числе ранний доступ к моделям.
Интересное..
🔗 Анонс тут: https://x.com/CarolGLMs/status/2097388230102687813
@deksden_notes
🔥8👍4
Forwarded from AI да парень! / Sergei Notevskii
NVFP4, deepgemm, DSpark, P/D disaggr, CUDA 13.0
Это все для привлечения внимания, потому что:
Снова ищу инженеров в команду AI платформы Битрикс24
В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.
Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).
Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.
Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.
Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.
Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;
Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);
Куда писать и что присылать?
Пишите мне в личку: @Ser_no
В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;
Про платформу рассказываю тут и про команду тут.
Перешлите тому самому, верю в силу телеграма)
Снова ищу инженеров в команду AI платформы Битрикс24
В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.
Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).
Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.
Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.
Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.
Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;
Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);
Куда писать и что присылать?
Пишите мне в личку: @Ser_no
В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;
Про платформу рассказываю тут и про команду тут.
Перешлите тому самому, верю в силу телеграма)
🔥4😁4👍2❤1
⚪️ DeepSeek v4 pro уже легаси
… становится с запуском DS 4.1 Flash. Все запросы на pro модель будут перенаправляться на новый флеш.
Почему? Новые флеш всем лучше.
🔗 Пруф : https://x.com/tianyi/status/2097584362770530674?s=46
(ц) какой то победный марш флешей!
@deksden_notes
… становится с запуском DS 4.1 Flash. Все запросы на pro модель будут перенаправляться на новый флеш.
Почему? Новые флеш всем лучше.
🔗 Пруф : https://x.com/tianyi/status/2097584362770530674?s=46
(ц) какой то победный марш флешей!
@deksden_notes
👌10👍6👎1
⚪️ AA сделала удобные графики
Artificial Analysis, которую вы точно знаете по её Artificial Analysis Index - сделала на сайте удобные графики разного вида.
🔗 Анонс : https://x.com/ArtificialAnlys/status/2097526916760703097
🔗 оффсайт : https://artificialanalysis.ai/
🔗 пример графика : https://artificialanalysis.ai/models/muse-spark-1-3#intelligence-comparisons
Сейчас бы больше моделей в сравнение!
@deksden_notes
Artificial Analysis, которую вы точно знаете по её Artificial Analysis Index - сделала на сайте удобные графики разного вида.
🔗 Анонс : https://x.com/ArtificialAnlys/status/2097526916760703097
🔗 оффсайт : https://artificialanalysis.ai/
🔗 пример графика : https://artificialanalysis.ai/models/muse-spark-1-3#intelligence-comparisons
Сейчас бы больше моделей в сравнение!
@deksden_notes
🔥7👍2❤🔥1
⚪️ OpenDesign хвалит DeepSeek 4.1 Flash
По мне так, чрезмерно даже хвалят, но по их тестам он очень здорово умеет в дизайн на их бенчмарке.
🔗 Почитать : https://x.com/OpenDesignHQ/status/2097620919778955617
Накидаю графиков в комменты ⬇️
@deksden_notes
По мне так, чрезмерно даже хвалят, но по их тестам он очень здорово умеет в дизайн на их бенчмарке.
🔗 Почитать : https://x.com/OpenDesignHQ/status/2097620919778955617
Накидаю графиков в комменты ⬇️
@deksden_notes
👍8🔥5
⚪️ DeepSeek - изменение цен
Ну и раз уж нынче день новостей про дипсик, напомню - с 10 сентября меняется цена на вендорское апи:
Будет : $0.15 ($0.003) / $0.60
Сейчас : $0.22 ($0.007) / $0.66
Цены в пиковое время (01:00 - 04:00, 06:00 - 10:00 UTC по будням)- х2. По выходным нету пиковых часов.
Изменение очень значительное, в агентном применении 90% и более объёмов - это кеш, а он в х2+ раза становится дешевле! BIG
Кроме того, не забываем что все запросы на Pro модель с релизом флеша 4.1 будут уходить на него, видимо, по ценам флеша. Надеюсь, что цены флеша 4.1 будут именно такими, как объявлено - это вроде бы логично.
👉 Кстати - заметили, что китайцы делают акции и льготные цены на выходные? Заставляют работать 24/7 - а когда траву-то трогать?!))
@deksden_notes
Ну и раз уж нынче день новостей про дипсик, напомню - с 10 сентября меняется цена на вендорское апи:
Будет : $0.15 ($0.003) / $0.60
Сейчас : $0.22 ($0.007) / $0.66
Цены в пиковое время (01:00 - 04:00, 06:00 - 10:00 UTC по будням)- х2. По выходным нету пиковых часов.
Изменение очень значительное, в агентном применении 90% и более объёмов - это кеш, а он в х2+ раза становится дешевле! BIG
Кроме того, не забываем что все запросы на Pro модель с релизом флеша 4.1 будут уходить на него, видимо, по ценам флеша. Надеюсь, что цены флеша 4.1 будут именно такими, как объявлено - это вроде бы логично.
👉 Кстати - заметили, что китайцы делают акции и льготные цены на выходные? Заставляют работать 24/7 - а когда траву-то трогать?!))
@deksden_notes
👍14🔥1
⚪️ Codex лимиты штормит
Обратили внимание на глюки с лимитами? Вы не одиноки. В реддите и хвиттере многочисленные репорты что с лимитами кодекса что то странное творится. Они неожиданно обнуляются, или резко падают. Редеговорят что лимит неожиданно прибавился.
В общем, раньше бы радовались багу и ждали бы ресета.
Но накануне Тибо написал что дефицит компьюта на горизонте, и они подумывают даже приостановить продажу Про подписок! И сама прокомментировал.. Может, и хайп разгоняют, но дыма без огня не бывает
Или это презентация эпплов повлияла?
В общем, наблюдаем.
@deksden_notes
Обратили внимание на глюки с лимитами? Вы не одиноки. В реддите и хвиттере многочисленные репорты что с лимитами кодекса что то странное творится. Они неожиданно обнуляются, или резко падают. Редеговорят что лимит неожиданно прибавился.
В общем, раньше бы радовались багу и ждали бы ресета.
Но накануне Тибо написал что дефицит компьюта на горизонте, и они подумывают даже приостановить продажу Про подписок! И сама прокомментировал.. Может, и хайп разгоняют, но дыма без огня не бывает
Или это презентация эпплов повлияла?
В общем, наблюдаем.
@deksden_notes
👍10🤔7🤣2
⚪️ Релиз DeepSeek v4.1 Flash
Вот и настал день релиза. Вышел новый флеш от дипсиков - 552B размер модели, асимметричное количество активных параметров 8B на вход / 16B на выход, оптимизирован KV кеш
У дипсиков в инференсе остаётся один этот флеш - V4 Flash, V4 Flash vision exp, V4 Pro теперь будут вести на v4.1 flash.
Напомню цены: $0.15 ($0.003) / $0.6 (и х2 в приковые часы)
Помимо вендорского инференса, уже есть в подписке OpenCode Go, Command Code, work buddy Ai
🔗папир с техрепортом: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf
🔗 модель на обнимашках : https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
Много картинок в комментах ⬇️
@deksden_notes
Вот и настал день релиза. Вышел новый флеш от дипсиков - 552B размер модели, асимметричное количество активных параметров 8B на вход / 16B на выход, оптимизирован KV кеш
У дипсиков в инференсе остаётся один этот флеш - V4 Flash, V4 Flash vision exp, V4 Pro теперь будут вести на v4.1 flash.
Напомню цены: $0.15 ($0.003) / $0.6 (и х2 в приковые часы)
Помимо вендорского инференса, уже есть в подписке OpenCode Go, Command Code, work buddy Ai
🔗папир с техрепортом: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf
🔗 модель на обнимашках : https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
Много картинок в комментах ⬇️
@deksden_notes
🔥7❤3
⚪️ Nebius AI Builder Program
Увидел тут что Волож тут программу придумал - $400 кредитами и скидками от компании и партнёров, cookbooks и примеры кода, общение с инженерами компании, обучающие курсы
Звучит на первый взгяд небезинтересно
🔗 Страничка : https://dev.nebius.com/builders
Но кредиты распределены так:
• $25 - инференс на Наёбиусе
• $25 - кредиты Tavily (это веб поиск для агентов)
• $100 - LangSmith кредиты
• $100 - Toloka кредиты (по другим сведениям - $50 in Toloka and $50 in Tandem credit)
• $1 - Nebius certification
• $0 - Free Agentic AI: Hands-on course
Ну - сразу не так интересно! $25 инференса это на чуток попробовать.
Дареному коню в зубы не смотрят, но казахский бизнесмен еврейского происхождения - таки, да!
Наверное, будет интересно начинающим - попробовать бесплатно и обучающие материалы. Ну и платформу посмотреть.
@deksden_notes
Увидел тут что Волож тут программу придумал - $400 кредитами и скидками от компании и партнёров, cookbooks и примеры кода, общение с инженерами компании, обучающие курсы
Звучит на первый взгяд небезинтересно
🔗 Страничка : https://dev.nebius.com/builders
Но кредиты распределены так:
• $25 - инференс на Наёбиусе
• $25 - кредиты Tavily (это веб поиск для агентов)
• $100 - LangSmith кредиты
• $100 - Toloka кредиты (по другим сведениям - $50 in Toloka and $50 in Tandem credit)
• $1 - Nebius certification
• $0 - Free Agentic AI: Hands-on course
Ну - сразу не так интересно! $25 инференса это на чуток попробовать.
Дареному коню в зубы не смотрят, но казахский бизнесмен еврейского происхождения - таки, да!
Наверное, будет интересно начинающим - попробовать бесплатно и обучающие материалы. Ну и платформу посмотреть.
@deksden_notes
❤7👎4🤣1
⚪️ Схемы оркестрации
Встретил тут любопытную схему оркестрации:
🔗 Тред : https://x.com/anshuc/status/2098014776886448337
Суть: вместо схемы "Астра оркестратор + Луна воркер" от делает реверс - "Луна оркестратор - Астра воркер", и при этом астра должна работать с пустым контекстом.
Говорит что более экономично получается, и качество сильно лучше. Типа, астра жгёт лимиты на большом контексте.
Любопытная точка зрения
@deksden_notes
Встретил тут любопытную схему оркестрации:
🔗 Тред : https://x.com/anshuc/status/2098014776886448337
Суть: вместо схемы "Астра оркестратор + Луна воркер" от делает реверс - "Луна оркестратор - Астра воркер", и при этом астра должна работать с пустым контекстом.
Говорит что более экономично получается, и качество сильно лучше. Типа, астра жгёт лимиты на большом контексте.
Любопытная точка зрения
@deksden_notes
🤔26🔥5👍2❤🔥1😁1🥴1
⚪️ Продажа подписок Codex 20x временно прекращена
Напишу всё таки про ситуацию - для ясности тем, кто внимательно не следит за новостями
Тибо тут накануне обрадовал: у клозедов немного подзакончился компьют, и они решили снизить приток пользователей на х20 подписки - продажа НОВЫХ подписок прекращена. Впрочем, это нынче каждый на сайте видит - доступа к тарифу нету.
🔗 Первоисточник : https://x.com/thsottiaux/status/2098113585683808624
НО: текущую подписку можно сохранить, просто продлив.
Другие изменения - в апи, подписках, пока не предусмотрены. Разве что 5.3-Codex-Spark отправят на пенсию и уберут. Впрочем, ею я тоже не пользовался!
(ц) такие дела!
@deksden_notes
Напишу всё таки про ситуацию - для ясности тем, кто внимательно не следит за новостями
Тибо тут накануне обрадовал: у клозедов немного подзакончился компьют, и они решили снизить приток пользователей на х20 подписки - продажа НОВЫХ подписок прекращена. Впрочем, это нынче каждый на сайте видит - доступа к тарифу нету.
🔗 Первоисточник : https://x.com/thsottiaux/status/2098113585683808624
НО: текущую подписку можно сохранить, просто продлив.
Другие изменения - в апи, подписках, пока не предусмотрены. Разве что 5.3-Codex-Spark отправят на пенсию и уберут. Впрочем, ею я тоже не пользовался!
(ц) такие дела!
@deksden_notes
❤4👏2
⚪️ Weekend Build у Заек продолжается! v5
GLM-5.3-Flash, 300M tokens
время: Friday 8AM to Sunday 6PM PT
🔗 Анонс: https://x.com/ZixuanLi_/status/2098390028787339666
🔗 Исчо : https://x.com/zcode_ai/status/2098396306750517317?s=46
👉 При этом другая акция с бесплатным флешем вечерами - продолжается!
@deksden_notes
GLM-5.3-Flash, 300M tokens
время: Friday 8AM to Sunday 6PM PT
🔗 Анонс: https://x.com/ZixuanLi_/status/2098390028787339666
🔗 Исчо : https://x.com/zcode_ai/status/2098396306750517317?s=46
👉 При этом другая акция с бесплатным флешем вечерами - продолжается!
@deksden_notes
❤2👍1🔥1
⚪️ DeepSeek v4 pro еще поработает!
Дипсики отказались от идеи выключить v4 pro и оставить один 4.1 флеш.
Народ высказался против, компания услышала!
V4 pro еще поживает!)
(ц) флеш не всех победил
@deksden_notes
Дипсики отказались от идеи выключить v4 pro и оставить один 4.1 флеш.
Народ высказался против, компания услышала!
V4 pro еще поживает!)
(ц) флеш не всех победил
@deksden_notes
👍7🔥1
⚪️ Grok 4.7 - дата релиза
Первоначальный анонс был на релиз нового грока в районе 12 сентября.
Но его, вы удивитесь - релиза вовремя не будет. Маск держит марку, стабильность - это мастерство.
Будут доделывать.
@deksden_notes
Первоначальный анонс был на релиз нового грока в районе 12 сентября.
Но его, вы удивитесь - релиза вовремя не будет. Маск держит марку, стабильность - это мастерство.
Будут доделывать.
@deksden_notes
🤣9😁5
⚪️ OpenCode новости
Немного напомним об openCode.
Бесплатные модели нынче в Zen:
• Muse Spark 1.3 (!!!) и 1.2
• MiMo V2.5
• Ling 3.0 Flash
• Nemotron 3.5 Lightning
• Nemotron 3 Ultra
• Big Pickle (традиционно)
На Go:
• добавили DeepSeek v4.1 Flash
• Лимиты на GLM 5.3 Flash уведичили x2
Грац @Bulat_Ziganshin за напоминание, что анонса бесплатного Muse 1.3 не было)
@deksden_notes
Немного напомним об openCode.
Бесплатные модели нынче в Zen:
• Muse Spark 1.3 (!!!) и 1.2
• MiMo V2.5
• Ling 3.0 Flash
• Nemotron 3.5 Lightning
• Nemotron 3 Ultra
• Big Pickle (традиционно)
На Go:
• добавили DeepSeek v4.1 Flash
• Лимиты на GLM 5.3 Flash уведичили x2
Грац @Bulat_Ziganshin за напоминание, что анонса бесплатного Muse 1.3 не было)
@deksden_notes
🔥8👍5❤1
⚪️ Codex Reset
На уикэнд нам раздали ресет! Раскатывают в моменте, прямо сейчас (утро субботы, 12 сентября).
Ждём-с
🔗 Пруф : https://x.com/thsottiaux/status/2098612714704891959
Кроме того, сделано несколько оптимизаций, а экспериментальный контекст пока отключили - глючит
@deksden_notes
На уикэнд нам раздали ресет! Раскатывают в моменте, прямо сейчас (утро субботы, 12 сентября).
Ждём-с
🔗 Пруф : https://x.com/thsottiaux/status/2098612714704891959
Кроме того, сделано несколько оптимизаций, а экспериментальный контекст пока отключили - глючит
@deksden_notes
🔥7❤3👍3
Forwarded from Циничный AI (Anton Goncharenko)
Agentnye_paiplainy_uchebnik.pdf
279.6 KB
Собрал посты Антона (@EQPRG) из нашего чата @cinicaichat в PDF-учебник по агентной разработке. О том, как организовать работу ИИ-агентов: кто ставит задачи, кто пишет код, кто проверяет, когда эскалировать на человека.
Оркестратор и исполнители, независимые тесты и ревью, хуки, ограничение числа доработок, параллельная работа через git-worktree.
Главная идея: важные правила нужно закреплять техническими ограничениями и проверять, действительно ли эти ограничения работают.
Авторские формулировки сохранены.
Астра добавила пояснения терминов, этапы внедрения после каждой главы и отдельный критический разбор: где подход полезен, где остаются дыры и как измерять качество всей системы.
34 страницы с оглавлением, примерами, шаблонами и ссылками на первоисточники.
Автор ещё не проверял. Как подключится - возможное сделаем 2-ю редакцию
P.S. Ссылка на чат: https://t.me/cinicaichat
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6❤3❤🔥2👍2💩2🤔1🤡1