Алек, сделай
321 subscribers
199 photos
5 videos
1 file
55 links
💼 Менеджер Продукта в Сбере, преподаю в РАНХиГС, веду социальные AI проекты

🎓 ИТМО "Инновационное предпринимательство в IT", ШМЯ finished

🏆 Победитель в хакатонах: Сбер, VK, ЛЦТ


@alialek
Download Telegram
Дубай - часть 3.14
❤22
Я скачал интернет

По своей диссертации я много работаю с большими данными. Из-за того, что я всю жизнь кнопки красил и вообще ваш питон только в универе видел, я нередко обращаюсь к ChatGPT за помощью в качестве ментора. Ух, и сколько часов он мне сэкономил, чтобы не гуглить каждый раз методы pandas, bs4, scikit-learn, seaborn и даже базового питоновского синтаксиса!

Недавно мы летали в Дубай на самолете, и 5 часов без интернета и других отвлекающих факторов казались перспективными для подготовки очередного этапа исследования. Но для того, чтобы не затупить на очередной фильтрации таблиц, мне нужна была документация по основным библиотекам, которые я использую. Я думал скачать pdf-ки с инструкциями, но вовремя наткнулся на ollama - инструмент для установки и взаимодействия с LLM локально. По сути это возможность запустить аналог ChatGPT на вашем устройстве, и для него не нужен доступ в сеть.

Никаких особых навыков для запуска тоже не понадобится:
1. Качаем ollama и устанавливаем ее
2. Открываем терминал, вводим:
 ollama run llama2 

Или выбираем другую модель из списка. Ждем завершения загрузки.
3. Скачиваем расширение для chrome - ollama-ui.
4. Открываем расширение, пользуемся!

Скорость ответа по понятным причинам сравнительно медленнее, чем у ChatGPT, и будет зависеть от характеристик вашего устройства. Я ждал ответа около минуты, но мог бы и меньше, если бы задал корректный промпт и не получал кучу воды. Вот вам примеры, что можно сделать, пока вы летите в самолете:

1. Почитать историю страны, куда вы летите, и попросить составить список достопримечательностей
2. Подушнить в споре с друзьями, куда правильно ставить ударение в слове, ведь у вас есть, у кого спросить
3. Попросить сгенерировать код под ваши задачи
4. Написать свой код, понять, что он не работает, попросить ollama исправить в нем ошибки
...
Список неограничен, ведь на вашем устройстве теперь хранится по сути zip-архив всего интернета, который весит как 1.5-часовой фильм. И это действительно восхищает
🔥14✍5❤5👍2
Через 5 минут бегу свой первый полумарафон 🏃

Присоединяйтесь!
🔥21
👍9🫡2
Пополнил коллекцию!

Эх, кажется, в прошлом году медаль была интереснее
❤‍🔥22👍7❤1
А есть ли среди подписчиков кто-нибудь, кто работает с анализом данных, разрабатывает модели?

Посоветуйте, пожалуйста, какие-нибудь графические low-code инструменты по типу make.com, n8n.io (на скрине). Теряюсь в jupyter ноутбуке (в vscode), очень много ячеек становится с разными экспериментами.

Вроде нашел KNIME, но вдруг есть что-то удобнее 🤔
🤔4☃1
Исследование рынка продактов за 2024 год

Из интересного:
🔵Общение с пользователями у продактов занимает меньше 10-20% времени, а большая его часть уходит на встречи и созвоны (у кого-то до 100%)
🔵Больше половины опрошенных по выходным работают работу (потому что на выходные не поставить встречи), либо делают очередной сайд-проект.
🔵80% выгорали хотя бы раз. А вот это исследование рынка IT приводит значение в 58%, что тоже много и топ-1 среди остальных профессий. Еще бы, вы видели сколько встреч? А потом еще и пет-проект делать на выходных
🔵Топ-3 навыка, которые хотят прокачать продакты: экономика, стратегия, аналитика. Эти навыки занимали топ и два года назад. Присмотритесь, если хотите перейти в профессию. Почему-то никто не хочет качать навык отказа от встреч.

А еще там очень крутой топ книг! Многие книги из списка рекомендую даже коллегам-технарям, которые не собираются в продакты.

Ссылка на исследование
Please open Telegram to view this post
VIEW IN TELEGRAM
❤9🔥4❤‍🔥1
🎯 Путь в Школу Менеджеров Яндекса

Есть у Яндекса летние школы по разным направлениям, которые проводятся каждый год. 6 лет назад, когда я начинал путь во фронтенде, мечтал попасть в ШРИ (Школа Разработки Интерфейсов). Пробовал несколько лет, но так и не получилось - вступительные были очень жесткие (фронты, подтвердите!). 3 года назад я начал подаваться в ШМЯ (Школу Менеджеров Яндекса) и в этом году, наконец, поступил 🎉

Ежегодно туда подают заявки несколько тысяч человек, а проходят всего десятки. Обратной связи по заданиям нет, поэтому не всегда понятно, что было хорошо, а что нужно исправить в решениях. И раз у меня получилось в этом году, хочу поделиться решениями вступительных, чтобы вы смогли оттолкнуться от логики моих рассуждений, понять форму ответов, и пройти отбор в следующем году.

У меня написано несколько постов на эту тему, но сперва хочется понять ее актуальность - это определит формат и объем материалов
🔥16❤3
Developer Experience (DX) для Продакта

Все говорят про DX для разработчиков, настало время заступиться за продактов! Да, IT-продактам нужен навык создания продуктов без команды разработчиков: для валидации гипотез, идей, а может даже и для привлечения первых платящих пользователей. Под хештегом #ProductDX буду публиковать инструменты, которые значительно упрощают мне работу по созданию MVP без навыков кода (почти).

Первые шаги, к тому, чтобы начать самостоятельно проверять свои идеи:
1. Купить домен, на который будет не стыдно скинуть ссылку (~700р/год)
2. Купить VPS (облачный сервер): 1 Гб RAM, 15 Гб ПЗУ достаточно для начала (~200р/мес)
3. Поставить на сервер CapRover

CapRover - это визуальный менеджер развертывания приложений/баз данных и веб-серверов.

С чем он поможет вам:
- Разворачивать приложения в один клик: Wordpress, Postgres, nocoDB, mongoDB, Moodle LMS и еще много готовых приложений, а с базовым знанием docker можно развернуть что угодно
- Использовать один домен и сервер для тысячи экспериментов: для нового проекта caprover просто создаст новый поддомен третьего уровня
- Бесплатно подключить и обновлять SSL-сертификаты - да, за них можно не платить, когда вы делаете MVP
- Мониторинг сервера и алерты в телеграм, если ваш MVP взлетел, пока вы спали, и сервера начали отказывать
- Не платить за тысячу разных low/no-code платформ, почтовых серверов

Инструкция по установке CapRover, а вот тут можно попробовать демо-версию, чтобы понять, что это вообще такое, и какие там есть возможности.
🔥5👍4🆒4
EduTech_40_web_2.pdf
4 MB
✨ Геймификация в продуктах

Нашел полный инсайтов отчет СберУниверситета о геймификации продуктов. Если вы пробовали внедрять ее в свой продукт, то представляете, насколько это бывает непросто. Я тоже пробовал, у меня не получалось 🙂


Вот пара мыслей из отчета для следующей попытки добавить щепотку азарта в продукт:

🔵Самая простая модель “Давайте добавим рейтинг пользователей и дадим им ачивки” или PBL (P — points, B — badges, L — Leaderboard) не проработает долго без внутренней мотивации пользователя

🔵Даже простой рейтинг надо уметь правильно готовить, чтобы он не демотивировал новичков и пользователей, которые любят действовать в кооперации, а не в одиночку

🔵Геймификация не должна быть основной фичей. Игровые механики не заставят пользователя выполнять целевые действия в приложении, которые он уже не выполнял до введения механик

🔵 Геймификация помогает увеличивать возвращаемость, время сессии, удовольствие от использования, то есть, добавляет ценности существующему процессу, но не создает ее с нуля

🔵Хорошо приготовленная геймификация учитывает задачи пользователя, для выполнения которых он использует ваше приложение. А отлично приготовленная еще и ориентируется на внутреннюю мотивацию, например, стать лучшей версией себя, сэкономить

🔵Даже небольшие развлекательные элементы могут считаться геймификацией. Например, меняющиеся эмодзи при вводе пароля (😊 — безопасный пароль, 😧— слабый пароль)

🔵Визуализация выполнения долгой задачи, например, прогрессбар — тоже геймификация


P.S. Отчет заявлен изначально для сферы образования, но советы и приемы в нем универсальны — забирайте в любой продукт
Please open Telegram to view this post
VIEW IN TELEGRAM
❤17🔥5👍1💯1🏆1
Пора.
😁26🤣10✍4❤2😢2
🗡 Сайд проект по сохранению языка - как мы делаем свой переводчик и краудсорсинговую платформу

Недавно Google добавил аварский язык (один из народов Дагестана) в свой переводчик. Это очень важное событие для небольшого народа. В одном из лезгинских чатов (еще один дагестанский народ) поднялось обсуждение - как сделать свой переводчик или попросить корпорации помочь с этим. Но в любом случае для работы с языком начинать нужно со сбора данных.

Как оказалось, на лезгинском языке очень сложно найти языковой корпус. На языке говорит всего 700К человек, а параллельный корпус с переводами почти никогда не собирался.

Мы собрали небольшую группу энтузиастов, соскребли по кусочкам с интернета то, что имелось, и разметили данные. Получилось 13 тысяч строк данных (со всего интернета!), состоящих из пар предложений русский-лезгинский. Это было немного, но хоть что-то.

Далее, дообучили модель NLLB, которая создана специально для языков с небольшим количеством данных. Разместили ее на HF и получили первый в мире лезгинский переводчик, и он уже умеет переводить простые фразы! Да, качество перевода пока оставляет желать лучшего, но это получился отличный Proof-of-Concept.

На этом мы остановиться не могли и начали работу по ручной разметке нужных нам данных. Благодаря первой версии переводчика, получилось заинтересовать массовую аудиторию и уже за первые две недели собрать довольно внушительный по текущим меркам датасет.

Краудсорсинг внезапно оказался очень увлекательной продуктовой задачей. Все решения мы разрабатывали очень быстро, итеративно дорабатывая на основе данных - чистый MVP, как он есть. В следующих постах подробнее раскрою, какие мы решения принимали, и как они влияли на активность в проекте.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥50❤13💯5
Это я в Дагестанском Технологическом Университете рассказываю про последние наши разработки, как ИИ помогает сохранять языки малых народов. И призываю других энтузиастов присоединяться к нам и делиться опытом и экспертизой.

Два месяца назад я писал про платформу для краудсорсинга параллельного языкового корпуса. А в последний месяц мы один за другим проводили эксперименты по созданию Text-to-Speech модели. И тут есть, чем поделиться)

Для того чтобы натренировать такую модель, нужно иметь довольно большой размеченный датасет (аудио+текст). Качество аудио должно быть близко к идеальному. Поэтому обычно созданием таких моделей занимаются корпорации, либо используются открытые датасеты. На русском и английском, например, таких датасетов довольно много. Но чтобы у небольшого народа была проделана такая работа - это большая редкость.

И тут нам очень повезло. В рамках работы над переводчиком мы познакомились с еще одним энтузиастом, основателем PublicDictionary, который горел идеей создания синтеза речи для малых народов. Он организовал и платформу для записи аудио, и разметку, купил качественные микрофоны и нашел людей, кто очень грамотно говорит на лезгинском. Но модель создать пока что не вышло, хотя попытки предпринимались. Мы решили объединить усилия и поэкспериментировать по правилу 20/80. Так у нас на руках оказался уникальный набор данных.

Для базовой модели выбрали VITS, нашли наработки Meta по созданию модели озвучки текста на базе VITS, подсмотрели, как они работают с фонемами, и начали экспериментировать.

Несмотря на довольно небольшой датасет (30 часов аудио), полученная модель получилась в каких-то местах лучше привычных русскоязычных моделей синтеза речи. На видео я как раз рассказываю про один из примеров, как модель с выражением читает стихи. Однако она все еще не идеальна: есть проблемы с проглатыванием звуков в некоторых сценариях. Но в рамках малоресурсного языка модель такого качества выведена впервые. И рад, что аудитория это тоже заметила и оценила - было приятно получить аплодисменты аудитории после демонстрации примеров работы.

Такие модели значительно упрощают работу с контентом: вы могли и сами заметить, как много подобного видео стало появляться в социальных сетях. Буду надеяться, что наши первые шаги в эту сторону помогут наполнить рекомендательные алгоритмы тиктока, инсты и ютуба, и позволят людям не забывать, как звучит их родной язык.
❤35❤‍🔥15🔥14
Есть всё-таки у Питера и Махачкалы какой-то общий вайб

Более заметный на контрасте с Москвой
❤19🔥12👍4❤‍🔥1
Сегодня принял свой первый зачет у студентов в роли преподавателя

До этого у меня был опыт преподавания для школьников, наставничества в Яндекс Практикуме, но бакалавров обучал впервые.
Всегда было интересно оказаться "по другую сторону" и понять, как оно там происходит.

Иронично, что несмотря на свою работу продактом и опыт во фронтенде, преподавать мне выпало основы программирования на Python. Мне дали каркас программы обучения, но разрешили менять ее по своему усмотрению. И это было супер, так как обучать сухой теории я не хотел и планировал дать максимум практических знаний, а также показать возможности, которые открывает навык программирования в отрыве от языка.

Каждое занятие строилось интерактивно: весь код, который мы изучали, студенты параллельно могли запустить в Jupyter ноутбуках и там же параллельно выполнять небольшие тестовые задания. Задача была максимально сократить цикл обратной связи, сохраняя ритм, и отбрасывая сложные неприкладные задания.

А во второй части занятия мы изучали то, что не было заложено в оригинальной программе. Мы прошли основы клиент-серверной архитектуры, я показывал, как браузер работает с запросами на примере своих проектов и других сайтов, что такое DNS и как работают некоторые механизмы блокировок, объяснял как самому взаимодействовать с API, получать данные, скачивать видео и исключительно в образовательных целях бесплатно общаться с чатгпт, когда есть желание, но нет возможности занести свои кровные 20$.

Требование к зачету было простое - написать тг-бота. Спойлер: все справились. Кто-то писал сам, кто-то просил помощи у коллег или у чатгпт - основным критерием было понимание того, что написано. Очень хотелось дать студентам начальный навык создания продуктов, который уже можно монетизировать.

Сравнивая с другим опытом преподавания, это был самый приятный. Даже несмотря на подготовку по 6-12 часов перед каждым занятием. И пары в субботу в 10.40 на другом конце Москвы.
Думаю, что, во многом, из-за возможности дать студентам практичные навыки, которых мне самому не хватило в своем бакалавриате, и которые приходилось изучать самостоятельно гораздо дольше.

P.S. А на скрине один из студентов через бота сообщает, что он не придет на одно из занятий, но при этом демонстрирует свои навыки работы с ботами. Оценил его находчивость)
🔥19❤11😁3
Проект про краудсорингу и обучению переводчика - апдейт

И так, 2 месяца спустя, апдейт по проекту, где мы собираем переводы с русского языка на лезгинский. Самый главный вызов для нас заключался в возврате пользователей в продукт, который не предоставляет явной личной выгоды в моменте.

Почему это вызов? Говоря на языке JTBD, мы не упрощаем существующую работу человека, а, наоборот, создаем новую для него. Не делаем его жизнь легче, а, просим проинвестировать свободное время в проект. Хотя, верхнеуровневую работу мы действительно выполняем (привет всем, кто прошел курс Замесина по Advanced JTBD) вроде самореализации или сохранения культурного наследия. Эффект от выполнения таких целей нужно ждать месяцы. Но чтобы регулярно возвращать пользователя для выполнения такой слабо осознаваемой работы, нам нужны были механики геймификации.

За два месяца с нашими механиками мы набрали 38к переводов (ежедневно переводится 150-200 предложений). Честно, большинство механик подсмотрел вот из этого отчета. Вот, что мы сделали:

🔵Разбили работу по сбору переводов на двухнедельные спринты. Каждые две недели переводчик должен обновляться, а пользователи видеть прогресс - сокращаем цикл обратной связи
🔵В главном меню бота виден общий прогресс по переводам за сутки - драйвер причастности к общему делу и влияния на результат
🔵Ведем рейтинг спринта и поощряем небольшим мерчом победителя рейтинга - используем недорогую материальную мотивацию
🔵 Поставили ежедневные цели по 10 переводов и показываем пользователю прогресс в достижении этой цели - показываем, что цель достижима и визуализируем ее
🔵 При выполнении ежедневной цели предлагаем пользователю выполнить еще пару переводов, чтобы повысить свою позицию в рейтинге - меняем мотивацию на соревновательную
🔵Ведем канал, для дополнительного касания с пользователем, где напоминаем о смыслах и целях - драйвер "эпичное значение"

Но не все идет гладко, факапы закономерны) Уже во время второго двухнедельного спринта мы поняли, что не можем регулярно переобучать переводчик. Просчитались, но... где?
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥15👏6❤3🤔1