Команда hh.ru на AiConf поддерживает секцию по оптимизации расходов на ИИ — очень важной и актуальной сегодня теме.
Секцию откроет их спикер Саша Рыжов с мастер-классом про движки инференса LLM в 2026 году, которые позволяют запустить on-prem-прод и не изобрести при этом велосипед.
Уже в 14:40 Саша подробно расскажет:
🌟 почему инференс LLM — это уже отдельный класс задач (KV-cache, prefill/decode, длинные контексты)
🌟 как особенности инференса влияют на латентность и утилизацию GPU
🌟 чем отличаются vLLM, SGLang и подход NVIDIA Dynamo
🌟 как выбрать стек под свои задачи и не сжечь бюджет
Приходите в Зал.2, разберёмся, как не переплачивать за инференс💵
Секцию откроет их спикер Саша Рыжов с мастер-классом про движки инференса LLM в 2026 году, которые позволяют запустить on-prem-прод и не изобрести при этом велосипед.
Уже в 14:40 Саша подробно расскажет:
Приходите в Зал.2, разберёмся, как не переплачивать за инференс
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4👍4🔥3
Делимся мини-репортажем с выступлений спикеров AiConf 2026
❤2👍2🔥2
К вечеру на конференции уже нечего делать? А вот и нет!
В 18:10 приглашаем в Зал 2 на неформальную дискуссию «AI для бизнеса без иллюзий. Откровенный разговор о том, как продавать, защищать и выращивать AI-продукты в реальном бизнесе».
Как доказать ценность AI бизнесу и команде, что делать, если продажники уже пообещали клиенту «новый GPT к пятнице», как заставить пилот «взлететь», а не загнуться — и ещё много реальных проблем из реальной жизни. Модераторы — эксперты GitVerse, Сбера, Cloud.ru, Райффайзена и НейроSet.
Приходите, будетбольно интересно.
В 18:10 приглашаем в Зал 2 на неформальную дискуссию «AI для бизнеса без иллюзий. Откровенный разговор о том, как продавать, защищать и выращивать AI-продукты в реальном бизнесе».
Как доказать ценность AI бизнесу и команде, что делать, если продажники уже пообещали клиенту «новый GPT к пятнице», как заставить пилот «взлететь», а не загнуться — и ещё много реальных проблем из реальной жизни. Модераторы — эксперты GitVerse, Сбера, Cloud.ru, Райффайзена и НейроSet.
Приходите, будет
❤2👏1
Через 15 минут на стенде Cloud.ru пройдет розыгрыш лимитированных худи из коллаборации Cloud.ru и дизайнера Глеба Костина (бренд .solutions).
В формах и деталях предметов зашифрованы коды и отсылки к Evolution AI Factory — среде для работы с генеративным ИИ.
Чтобы успеть принять участие в розыгрыше, регистрируйтесь Cloud.ru SuperApp и жмите «Участвовать» на странице розыгрышей в приложении.
Реклама ООО "Облачные технологии" ИНН 7736279160 erid: 2W5zFGH3tPj
В формах и деталях предметов зашифрованы коды и отсылки к Evolution AI Factory — среде для работы с генеративным ИИ.
Чтобы успеть принять участие в розыгрыше, регистрируйтесь Cloud.ru SuperApp и жмите «Участвовать» на странице розыгрышей в приложении.
Реклама ООО "Облачные технологии" ИНН 7736279160 erid: 2W5zFGH3tPj
❤3🔥1👏1
Близимся к финалу нашей деловой программы 🚀
❤3🔥3
Вот и завершается программная часть нашей конференции ⭐️
❤️ Приглашаем вас присоединиться к закрытию в 19:00 в Малом зале.
Но и это еще не все!
В 19:20 мы ждем вас на афтепати, где вы сможете отдохнуть, обменяться идеями с коллегами, возможно, найти единомышленников для будущих проектов и поучаствовать в квизе (команды формируются на месте). Не упустите шанс продолжить нетворкинг в неформальной обстановке!
Спасибо вам, что сегодня были с нами
До встречи на AiConf в следующем году!
Но и это еще не все!
В 19:20 мы ждем вас на афтепати, где вы сможете отдохнуть, обменяться идеями с коллегами, возможно, найти единомышленников для будущих проектов и поучаствовать в квизе (команды формируются на месте). Не упустите шанс продолжить нетворкинг в неформальной обстановке!
Спасибо вам, что сегодня были с нами
До встречи на AiConf в следующем году!
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3🔥2
AiConf 2026 официально завершилась 🚀
🤍 Ждём всех на афтепати
Также приглашаем вас на дискуссию "Как выглядит найм в 2026 году"
Поговорим про: Эксклюзивные инсайды рынка труда, АТС фильтры, AI технологии и личный бренд соискателя
🤍 Ждём всех на афтепати
Также приглашаем вас на дискуссию "Как выглядит найм в 2026 году"
Поговорим про: Эксклюзивные инсайды рынка труда, АТС фильтры, AI технологии и личный бренд соискателя
❤3🔥2
Друзья, вам привет от коллег из hh.ru 👋
Ребята были рады встретиться с вами на AiConf! Они поддерживали Секцию по оптимизации расходов на ИИ и общались с гостями конференции на своём стенде.
Если хочется не теряться и продолжить общение с командой hh.ru, подписывайтесь на их телеграм-канал. В нём ребята делятся проектами hh, рассказывают про команду, пишут про ML, DS — коротко, осмысленно и без занудства.
Присоединяйтесь🥹
Ребята были рады встретиться с вами на AiConf! Они поддерживали Секцию по оптимизации расходов на ИИ и общались с гостями конференции на своём стенде.
Спасибо всем, кто приходил познакомиться, обсудить актуальные вопросы и поделиться своими кейсами. Отдельно кайфанули от количества содержательных разговоров о применении LLM в продакшене. Видно, что интерес к теме растёт☺️
Если хочется не теряться и продолжить общение с командой hh.ru, подписывайтесь на их телеграм-канал. В нём ребята делятся проектами hh, рассказывают про команду, пишут про ML, DS — коротко, осмысленно и без занудства.
Присоединяйтесь
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🔥5❤4
Представьте: банк не просто взыскивает просроченную задолженность, а превращает этот процесс в источник прибыли, сохраняя лояльность клиентов.
В традиционном подходе взыскание часто воспринимается как неизбежная потеря или затратный процесс. Но что, если взглянуть на него под другим углом? Правильно выстроенная система Next Best Action позволяет не только минимизировать издержки, но и улучшить качество кредитного портфеля, снизить резервы и даже укрепить отношения с клиентами.
В статье от техдиректора Газпромбанк.Тех Ольги Кравченко подробно разбирается, как команда из 11 человек — дата-сайентистов, дата-инженеров и специалистов по автоматизации — построила такую систему. От архитектуры платформы данных до ML-пайплайнов и витрин Hadoop — это глубокий кейс о том, как технологии меняют банковские процессы. Узнайте, как можно совместить скорость, эффективность и минимальные затраты, избегая при этом потери лояльности.
🚀 Переходите к полной статье, чтобы узнать все детали реализации.
В традиционном подходе взыскание часто воспринимается как неизбежная потеря или затратный процесс. Но что, если взглянуть на него под другим углом? Правильно выстроенная система Next Best Action позволяет не только минимизировать издержки, но и улучшить качество кредитного портфеля, снизить резервы и даже укрепить отношения с клиентами.
В статье от техдиректора Газпромбанк.Тех Ольги Кравченко подробно разбирается, как команда из 11 человек — дата-сайентистов, дата-инженеров и специалистов по автоматизации — построила такую систему. От архитектуры платформы данных до ML-пайплайнов и витрин Hadoop — это глубокий кейс о том, как технологии меняют банковские процессы. Узнайте, как можно совместить скорость, эффективность и минимальные затраты, избегая при этом потери лояльности.
🚀 Переходите к полной статье, чтобы узнать все детали реализации.
Хабр
Next Best Action: от задолженности к прибыли через персонализацию коммуникаций
Привет, Хабр! На связи — Ольга Кравченко, техдиректор по разработке моделей Газпромбанк.Тех. Сегодня я поделюсь кейсом, как наша команда создала инструмент, позволяющий нам продвигаться от...
🔥3❤2👍2
Можно ли развернуть ASR-модель на CPU без потери качества и производительности?
Этот вопрос часто встаёт перед разработчиками, когда GPU недоступны или нужно оптимизировать ресурсы. Кажется, что компромиссы неизбежны, но так ли это на самом деле?
В этой статье мы подробно разбираем, как MWS AI удалось продуктивизировать нейросетевые решения для распознавания речи на CPU, сохраняя при этом высокое качество и сопоставимую с GPU-кластерами точность. Вы узнаете о различных бэкендах, особенностях настройки Triton Inference Server и подводных камнях, с которыми столкнулись инженеры.
Если вы работаете с ASR, оптимизацией инференса или просто ищете способы эффективного использования ресурсов, этот материал даст вам конкретные ответы и практические кейсы.
Этот вопрос часто встаёт перед разработчиками, когда GPU недоступны или нужно оптимизировать ресурсы. Кажется, что компромиссы неизбежны, но так ли это на самом деле?
В этой статье мы подробно разбираем, как MWS AI удалось продуктивизировать нейросетевые решения для распознавания речи на CPU, сохраняя при этом высокое качество и сопоставимую с GPU-кластерами точность. Вы узнаете о различных бэкендах, особенностях настройки Triton Inference Server и подводных камнях, с которыми столкнулись инженеры.
Если вы работаете с ASR, оптимизацией инференса или просто ищете способы эффективного использования ресурсов, этот материал даст вам конкретные ответы и практические кейсы.
Хабр
ASR на CPU. Как выбрать бэкенд, настроить Triton и не потерять в точности
Привет, Хабр! Меня зовут Владимир Никулин, я технический лидер команды продуктивизации нейросетевых решений в MWS AI. Мы развиваем платформу синтеза и распознавания речи Audiogram, которая, в свою...
👍2🔥1👏1
Как внедрять ML на устройствах, где памяти меньше, чем вкладок в вашем браузере? 👀
Если ваше устройство считает 1 ГБ памяти непозволительной роскошью — этот материал точно стоит открыть.
Александр Лошкарев, инженер-программист в Eltex, разбирает, как внедрять ML-модели на краевых устройствах, которые жестко ограничены в ресурсах и имеют меньше 256 МБ оперативной памяти.
📖 Часть 1 / Часть 2
Если ваше устройство считает 1 ГБ памяти непозволительной роскошью — этот материал точно стоит открыть.
Александр Лошкарев, инженер-программист в Eltex, разбирает, как внедрять ML-модели на краевых устройствах, которые жестко ограничены в ресурсах и имеют меньше 256 МБ оперативной памяти.
Обычно беспроводные устройства работают в статическом режиме: их один раз конфигурируют, и дальше они годами не меняют параметры, если только администратор не вмешается вручную. Но в современных сетях Wi-Fi такой подход неэффективен из-за постоянной интерференции и изменения радиообстановки. <...> мы решили провести эксперимент и попробовать внедрить механизмы самообучения прямо в точки доступа.
📖 Часть 1 / Часть 2
Хабр
Федеративное обучение в условиях дефицита памяти на Edge-устройствах. Часть 1
Если ваше устройство думает, что 1 ГБ — это ругательное слово, то этот доклад в двух частях для вас. Меня зовут Александр Лошкарев, я инженер-программист в компании Eltex. Этот материал основан на...
👍3🔥2
Дайджест статей: AI, CV, LLM и оптимизация инфраструктуры
Собрали материалы, которые стоит добавить в закладки — от computer vision и Text2SQL до GraphRAG и экономии на Kubernetes 👇
Как мы разработали систему машинного зрения для детектирования СИЗ и техники
Время чтения: 10 минут
Выжимаем максимум из опенсорсных моделей и готовим Text2SQL
Время чтения: 12 минут
ИИ в промышленном IT: где заканчивается хайп и начинается измеримый эффект
Время чтения: 7 минут
GraphRAG: 8 способов укротить расширенный контекст у LLM
Время чтения: 24 минуты
Оптимизация стоимости владения K8s-кластерами в AWS и YC
Время чтения: 17 минут
Собрали материалы, которые стоит добавить в закладки — от computer vision и Text2SQL до GraphRAG и экономии на Kubernetes 👇
Как мы разработали систему машинного зрения для детектирования СИЗ и техники
Время чтения: 10 минут
Как с помощью системы машинного зрения отслеживать наличие СИЗ, опасные действия сотрудников и перемещение персонала в зонах риска? Виктор Прусаков, ведущий разработчик DSML в ГК Юзтех, рассказывает о модульной архитектуре с гибким ядром, которая обеспечивает быструю кастомизацию решения под производственные задачи, что критично для реализации концепции нулевого травматизма
Выжимаем максимум из опенсорсных моделей и готовим Text2SQL
Время чтения: 12 минут
Собрать рабочий Text2SQL — это не только выбрать модель и написать промпт. Это еще пройти через сломанные гипотезы, бесконечно растущие промпты и поиск архитектуры, которая всё-таки работает.
Джал Антонов, ведущий ML-инженер X5 Tech, делится опытом:
— что сработало, а что пришлось выбросить
— как использовали векторные индексы
— почему промпты выросли до десятков тысяч токенов и как с этим жить
ИИ в промышленном IT: где заканчивается хайп и начинается измеримый эффект
Время чтения: 7 минут
В этом обзоре мы собрали ключевые идеи и практические инсайты от руководителей AI- и IT-направлений из крупных промышленных компаний: Василия Саутина, коммерческого директора платформы «Сфера» (ИТ-холдинг Т1) и его коллеги, директора по продуктам платформы «Сфера», Сергея Полиненко.
GraphRAG: 8 способов укротить расширенный контекст у LLM
Время чтения: 24 минуты
В 22% случаев онкологи не могут назначить лечение из-за рисков, связанных с хроническими заболеваниями. В статье разобрали кейс, в котором ИИ помогает врачам решать сложнейшие когнитивные задачи, связанные с лечением различных видов рака. А также рассказали про методологию GraphRAG, разобрали, как устроены и работают решения из кейса и провели сравнительный анализ всех способов решить эту сложнейшую задачу.
Оптимизация стоимости владения K8s-кластерами в AWS и YC
Время чтения: 17 минут
Облака обещают магическую экономию и бесконечное масштабирование. На практике Kubernetes‑кластеры в AWS и Яндекс.Облаке легко превращаются в бездонную чёрную дыру для бюджета. В «Антиплагиате» научились готовить споты, научили шедулер и дешедулер работать правильно и выжали из кубов максимум надежности и производительности при минимуме затрат. В этой статье — конкретные шаги, которые позволили сэкономить миллионы рублей.
Хабр
Как мы разработали систему машинного зрения для детектирования СИЗ и техники
Привет, Хабр! Меня зовут Виктор Прусаков, я ведущий разработчик в команде DSML в ГК Юзтех и уже четыре года занимаюсь data science. Эта статья написана по мотивам моего выступления на AIConf и...
👍2🔥2