Команда hh.ru на AiConf поддерживает секцию по оптимизации расходов на ИИ — очень важной и актуальной сегодня теме.
Секцию откроет их спикер Саша Рыжов с мастер-классом про движки инференса LLM в 2026 году, которые позволяют запустить on-prem-прод и не изобрести при этом велосипед.
Уже в 14:40 Саша подробно расскажет:
🌟 почему инференс LLM — это уже отдельный класс задач (KV-cache, prefill/decode, длинные контексты)
🌟 как особенности инференса влияют на латентность и утилизацию GPU
🌟 чем отличаются vLLM, SGLang и подход NVIDIA Dynamo
🌟 как выбрать стек под свои задачи и не сжечь бюджет
Приходите в Зал.2, разберёмся, как не переплачивать за инференс💵
Секцию откроет их спикер Саша Рыжов с мастер-классом про движки инференса LLM в 2026 году, которые позволяют запустить on-prem-прод и не изобрести при этом велосипед.
Уже в 14:40 Саша подробно расскажет:
Приходите в Зал.2, разберёмся, как не переплачивать за инференс
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4👍4🔥3
Делимся мини-репортажем с выступлений спикеров AiConf 2026
❤2👍2🔥2
К вечеру на конференции уже нечего делать? А вот и нет!
В 18:10 приглашаем в Зал 2 на неформальную дискуссию «AI для бизнеса без иллюзий. Откровенный разговор о том, как продавать, защищать и выращивать AI-продукты в реальном бизнесе».
Как доказать ценность AI бизнесу и команде, что делать, если продажники уже пообещали клиенту «новый GPT к пятнице», как заставить пилот «взлететь», а не загнуться — и ещё много реальных проблем из реальной жизни. Модераторы — эксперты GitVerse, Сбера, Cloud.ru, Райффайзена и НейроSet.
Приходите, будетбольно интересно.
В 18:10 приглашаем в Зал 2 на неформальную дискуссию «AI для бизнеса без иллюзий. Откровенный разговор о том, как продавать, защищать и выращивать AI-продукты в реальном бизнесе».
Как доказать ценность AI бизнесу и команде, что делать, если продажники уже пообещали клиенту «новый GPT к пятнице», как заставить пилот «взлететь», а не загнуться — и ещё много реальных проблем из реальной жизни. Модераторы — эксперты GitVerse, Сбера, Cloud.ru, Райффайзена и НейроSet.
Приходите, будет
❤2👏1
Через 15 минут на стенде Cloud.ru пройдет розыгрыш лимитированных худи из коллаборации Cloud.ru и дизайнера Глеба Костина (бренд .solutions).
В формах и деталях предметов зашифрованы коды и отсылки к Evolution AI Factory — среде для работы с генеративным ИИ.
Чтобы успеть принять участие в розыгрыше, регистрируйтесь Cloud.ru SuperApp и жмите «Участвовать» на странице розыгрышей в приложении.
Реклама ООО "Облачные технологии" ИНН 7736279160 erid: 2W5zFGH3tPj
В формах и деталях предметов зашифрованы коды и отсылки к Evolution AI Factory — среде для работы с генеративным ИИ.
Чтобы успеть принять участие в розыгрыше, регистрируйтесь Cloud.ru SuperApp и жмите «Участвовать» на странице розыгрышей в приложении.
Реклама ООО "Облачные технологии" ИНН 7736279160 erid: 2W5zFGH3tPj
❤3🔥1👏1
Близимся к финалу нашей деловой программы 🚀
❤3🔥3
Вот и завершается программная часть нашей конференции ⭐️
❤️ Приглашаем вас присоединиться к закрытию в 19:00 в Малом зале.
Но и это еще не все!
В 19:20 мы ждем вас на афтепати, где вы сможете отдохнуть, обменяться идеями с коллегами, возможно, найти единомышленников для будущих проектов и поучаствовать в квизе (команды формируются на месте). Не упустите шанс продолжить нетворкинг в неформальной обстановке!
Спасибо вам, что сегодня были с нами
До встречи на AiConf в следующем году!
Но и это еще не все!
В 19:20 мы ждем вас на афтепати, где вы сможете отдохнуть, обменяться идеями с коллегами, возможно, найти единомышленников для будущих проектов и поучаствовать в квизе (команды формируются на месте). Не упустите шанс продолжить нетворкинг в неформальной обстановке!
Спасибо вам, что сегодня были с нами
До встречи на AiConf в следующем году!
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3🔥2
AiConf 2026 официально завершилась 🚀
🤍 Ждём всех на афтепати
Также приглашаем вас на дискуссию "Как выглядит найм в 2026 году"
Поговорим про: Эксклюзивные инсайды рынка труда, АТС фильтры, AI технологии и личный бренд соискателя
🤍 Ждём всех на афтепати
Также приглашаем вас на дискуссию "Как выглядит найм в 2026 году"
Поговорим про: Эксклюзивные инсайды рынка труда, АТС фильтры, AI технологии и личный бренд соискателя
❤3🔥2
Друзья, вам привет от коллег из hh.ru 👋
Ребята были рады встретиться с вами на AiConf! Они поддерживали Секцию по оптимизации расходов на ИИ и общались с гостями конференции на своём стенде.
Если хочется не теряться и продолжить общение с командой hh.ru, подписывайтесь на их телеграм-канал. В нём ребята делятся проектами hh, рассказывают про команду, пишут про ML, DS — коротко, осмысленно и без занудства.
Присоединяйтесь🥹
Ребята были рады встретиться с вами на AiConf! Они поддерживали Секцию по оптимизации расходов на ИИ и общались с гостями конференции на своём стенде.
Спасибо всем, кто приходил познакомиться, обсудить актуальные вопросы и поделиться своими кейсами. Отдельно кайфанули от количества содержательных разговоров о применении LLM в продакшене. Видно, что интерес к теме растёт☺️
Если хочется не теряться и продолжить общение с командой hh.ru, подписывайтесь на их телеграм-канал. В нём ребята делятся проектами hh, рассказывают про команду, пишут про ML, DS — коротко, осмысленно и без занудства.
Присоединяйтесь
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🔥5❤4
Представьте: банк не просто взыскивает просроченную задолженность, а превращает этот процесс в источник прибыли, сохраняя лояльность клиентов.
В традиционном подходе взыскание часто воспринимается как неизбежная потеря или затратный процесс. Но что, если взглянуть на него под другим углом? Правильно выстроенная система Next Best Action позволяет не только минимизировать издержки, но и улучшить качество кредитного портфеля, снизить резервы и даже укрепить отношения с клиентами.
В статье от техдиректора Газпромбанк.Тех Ольги Кравченко подробно разбирается, как команда из 11 человек — дата-сайентистов, дата-инженеров и специалистов по автоматизации — построила такую систему. От архитектуры платформы данных до ML-пайплайнов и витрин Hadoop — это глубокий кейс о том, как технологии меняют банковские процессы. Узнайте, как можно совместить скорость, эффективность и минимальные затраты, избегая при этом потери лояльности.
🚀 Переходите к полной статье, чтобы узнать все детали реализации.
В традиционном подходе взыскание часто воспринимается как неизбежная потеря или затратный процесс. Но что, если взглянуть на него под другим углом? Правильно выстроенная система Next Best Action позволяет не только минимизировать издержки, но и улучшить качество кредитного портфеля, снизить резервы и даже укрепить отношения с клиентами.
В статье от техдиректора Газпромбанк.Тех Ольги Кравченко подробно разбирается, как команда из 11 человек — дата-сайентистов, дата-инженеров и специалистов по автоматизации — построила такую систему. От архитектуры платформы данных до ML-пайплайнов и витрин Hadoop — это глубокий кейс о том, как технологии меняют банковские процессы. Узнайте, как можно совместить скорость, эффективность и минимальные затраты, избегая при этом потери лояльности.
🚀 Переходите к полной статье, чтобы узнать все детали реализации.
Хабр
Next Best Action: от задолженности к прибыли через персонализацию коммуникаций
Привет, Хабр! На связи — Ольга Кравченко, техдиректор по разработке моделей Газпромбанк.Тех. Сегодня я поделюсь кейсом, как наша команда создала инструмент, позволяющий нам продвигаться от...
🔥3❤2👍2
Можно ли развернуть ASR-модель на CPU без потери качества и производительности?
Этот вопрос часто встаёт перед разработчиками, когда GPU недоступны или нужно оптимизировать ресурсы. Кажется, что компромиссы неизбежны, но так ли это на самом деле?
В этой статье мы подробно разбираем, как MWS AI удалось продуктивизировать нейросетевые решения для распознавания речи на CPU, сохраняя при этом высокое качество и сопоставимую с GPU-кластерами точность. Вы узнаете о различных бэкендах, особенностях настройки Triton Inference Server и подводных камнях, с которыми столкнулись инженеры.
Если вы работаете с ASR, оптимизацией инференса или просто ищете способы эффективного использования ресурсов, этот материал даст вам конкретные ответы и практические кейсы.
Этот вопрос часто встаёт перед разработчиками, когда GPU недоступны или нужно оптимизировать ресурсы. Кажется, что компромиссы неизбежны, но так ли это на самом деле?
В этой статье мы подробно разбираем, как MWS AI удалось продуктивизировать нейросетевые решения для распознавания речи на CPU, сохраняя при этом высокое качество и сопоставимую с GPU-кластерами точность. Вы узнаете о различных бэкендах, особенностях настройки Triton Inference Server и подводных камнях, с которыми столкнулись инженеры.
Если вы работаете с ASR, оптимизацией инференса или просто ищете способы эффективного использования ресурсов, этот материал даст вам конкретные ответы и практические кейсы.
Хабр
ASR на CPU. Как выбрать бэкенд, настроить Triton и не потерять в точности
Привет, Хабр! Меня зовут Владимир Никулин, я технический лидер команды продуктивизации нейросетевых решений в MWS AI. Мы развиваем платформу синтеза и распознавания речи Audiogram, которая, в свою...
👍2🔥1👏1
Как внедрять ML на устройствах, где памяти меньше, чем вкладок в вашем браузере? 👀
Если ваше устройство считает 1 ГБ памяти непозволительной роскошью — этот материал точно стоит открыть.
Александр Лошкарев, инженер-программист в Eltex, разбирает, как внедрять ML-модели на краевых устройствах, которые жестко ограничены в ресурсах и имеют меньше 256 МБ оперативной памяти.
📖 Часть 1 / Часть 2
Если ваше устройство считает 1 ГБ памяти непозволительной роскошью — этот материал точно стоит открыть.
Александр Лошкарев, инженер-программист в Eltex, разбирает, как внедрять ML-модели на краевых устройствах, которые жестко ограничены в ресурсах и имеют меньше 256 МБ оперативной памяти.
Обычно беспроводные устройства работают в статическом режиме: их один раз конфигурируют, и дальше они годами не меняют параметры, если только администратор не вмешается вручную. Но в современных сетях Wi-Fi такой подход неэффективен из-за постоянной интерференции и изменения радиообстановки. <...> мы решили провести эксперимент и попробовать внедрить механизмы самообучения прямо в точки доступа.
📖 Часть 1 / Часть 2
Хабр
Федеративное обучение в условиях дефицита памяти на Edge-устройствах. Часть 1
Если ваше устройство думает, что 1 ГБ — это ругательное слово, то этот доклад в двух частях для вас. Меня зовут Александр Лошкарев, я инженер-программист в компании Eltex. Этот материал основан на...
👍3🔥2