Ссылка на исследование , где LLM применяются для создания фишинговых e-mail (Это когда кто-то нехороший хочет, чтобы мы перешли по ссылке)
Основные выводы:
1. Получается у LLM это лучше, чем в обычных подобных письмах примерно в 4 раза (больше половины людей кликали на ссылку)
2. Для генерации текстов использовались GPT-4o and Claude 3.5, то есть сейчас o1 будет делать это намного лучше
3. Применялся следующий подход: LLM искала данные о людях в соц сетях и других открытых источниках и составляла персонализированный тект письма (маркетинг☝️)
4. Маштабировать такой "бизнес" кратно дешевле и проще
5. Все внутренние защитные механизмы моделей и разговоры о alignment'e разбиваются о реальность 😄
Основные выводы:
1. Получается у LLM это лучше, чем в обычных подобных письмах примерно в 4 раза (больше половины людей кликали на ссылку)
2. Для генерации текстов использовались GPT-4o and Claude 3.5, то есть сейчас o1 будет делать это намного лучше
3. Применялся следующий подход: LLM искала данные о людях в соц сетях и других открытых источниках и составляла персонализированный тект письма (маркетинг☝️)
4. Маштабировать такой "бизнес" кратно дешевле и проще
5. Все внутренние защитные механизмы моделей и разговоры о alignment'e разбиваются о реальность 😄
👍3😱3🔥2
Мысли про ИИ:
- США, анонсировли проект Stargate, в который планируется инвестировать 500 млрд USD, в проекте принимают участие правительсво США и ряд технологических гигантов
- Евросоюз планирует вложить 200 млрд EUR в AI, это было анонсировано на саммите в Париже
- Большую часть денег планируется привлекать с корпораций, основные средства пойдут на строительство дата-центров, на закупку железа и инфраструктуру для вычислений
- Весь прогрессвный мир понимает, что это новая гонка вооружений, в которой нельзя проиграть или отставать, также есть понимаение, что успех в развитии ИИ неотделим от масштабирования вычислительных мощностей, которые напрямую влияют на способность моделей решать те или иные задачи
- ИИ становиться важен, как источник экономического роста (есть исследования корреляции роста ВВП к замене человеческого труда на ИИ), а также как залог военной мощи (войны 21 века - это войны дронов и роботов в ближайшем будущем)
- Где будет наша страна в этой гонке? Пишите в комменты ваши мысли 💡
- США, анонсировли проект Stargate, в который планируется инвестировать 500 млрд USD, в проекте принимают участие правительсво США и ряд технологических гигантов
- Евросоюз планирует вложить 200 млрд EUR в AI, это было анонсировано на саммите в Париже
- Большую часть денег планируется привлекать с корпораций, основные средства пойдут на строительство дата-центров, на закупку железа и инфраструктуру для вычислений
- Весь прогрессвный мир понимает, что это новая гонка вооружений, в которой нельзя проиграть или отставать, также есть понимаение, что успех в развитии ИИ неотделим от масштабирования вычислительных мощностей, которые напрямую влияют на способность моделей решать те или иные задачи
- ИИ становиться важен, как источник экономического роста (есть исследования корреляции роста ВВП к замене человеческого труда на ИИ), а также как залог военной мощи (войны 21 века - это войны дронов и роботов в ближайшем будущем)
- Где будет наша страна в этой гонке? Пишите в комменты ваши мысли 💡
👍5✍2
В шататх есть компания Fiverr - это крупнейший у них gig marketplace (аналог FL или Профи Ру у нас). Там в основном сидят дизйнеры, копирайтеры, разработчики. Так вот:
- CEO Fiverr Micha Kaufman официально заявляет, что рынок фриланса по этим направлениям был "драматически обрушен" повсеместным доступом к дешевому генеративному ИИ
- Далее генеральный директор заявляет, что "мы хотим сделать наших креативных работников незаменимыми" поэтому... внимание.. мы дадим им возможность обучать нейросети на своих работах, чтобы предавать им фирменный стиль и еще и деньги будем с них за это брать (около 25$ в месяц)
Вообще, кажется, что добавочная стоимость таких нейросетей с дообучением на "своих работах" будет минимальна и бедных фриласеров просто сливают, пытаясь получить с них напоследок хоть какие-то деньги за доступ к ИИ.
А вы пишете тексты или генерируете картинки с помощью ИИ?
ссылка на статью с новостью
- CEO Fiverr Micha Kaufman официально заявляет, что рынок фриланса по этим направлениям был "драматически обрушен" повсеместным доступом к дешевому генеративному ИИ
- Далее генеральный директор заявляет, что "мы хотим сделать наших креативных работников незаменимыми" поэтому... внимание.. мы дадим им возможность обучать нейросети на своих работах, чтобы предавать им фирменный стиль и еще и деньги будем с них за это брать (около 25$ в месяц)
Вообще, кажется, что добавочная стоимость таких нейросетей с дообучением на "своих работах" будет минимальна и бедных фриласеров просто сливают, пытаясь получить с них напоследок хоть какие-то деньги за доступ к ИИ.
А вы пишете тексты или генерируете картинки с помощью ИИ?
ссылка на статью с новостью
👍4
Яндекс выложила в опенсорс свою модель YandexGPT 5 Lite на 8B параметров, а также рассказали подробности про обучение флагманской модели YandexGPT 5 Pro
- Пайплайн обучения был изначально инициализирован весами модели Qwen-2.5-32B-base. Сочетание классического Pretrain и этой инициализации позволило в 20 раз сократить длительность экспериментов
- Далее проводился Alignment, а именно SFT (Supervised Fine-Tuning), где модель обучается на парах «запрос — ответ» и RLHF, где человек оценивает более "правильный" ответ
- На этапе Alignment была предложена новая модификация метода DPO — LogDPO — для преодоления проблемы «разучивания»
- Новая самая мощная модель YandexGPT 5 Pro уже доступна в Алисе
- Разработчики говорят о хороших результатах внутренних тестов c моделями конкурентов, но на LLM Arena информации нет, так что не верим🙂
Ссылка на первоисточник
- Пайплайн обучения был изначально инициализирован весами модели Qwen-2.5-32B-base. Сочетание классического Pretrain и этой инициализации позволило в 20 раз сократить длительность экспериментов
- Далее проводился Alignment, а именно SFT (Supervised Fine-Tuning), где модель обучается на парах «запрос — ответ» и RLHF, где человек оценивает более "правильный" ответ
- На этапе Alignment была предложена новая модификация метода DPO — LogDPO — для преодоления проблемы «разучивания»
- Новая самая мощная модель YandexGPT 5 Pro уже доступна в Алисе
- Разработчики говорят о хороших результатах внутренних тестов c моделями конкурентов, но на LLM Arena информации нет, так что не верим🙂
Ссылка на первоисточник
👍3🔥1
Привет👋 Давайте сегодня проведем небольшой ликбез по LLM Arena - это рейтинг составленный некоммерческой организацией LMSYS, и он считается самым авторитетным рейтингом в мире по сравнению различных LLM.
- основа рейтинга - Arena Score. Он считается исходя из слепого сравения человеком качества ответов двух LLM на основе точности, согласованности и полезности. Для оцифровки используется система ELO, победа над сильной LLM даёт больше баллов, а поражение от слабой — отнимает больше баллов. Важны относительные значения баллов для сравения моделей, а не абсолютные
- на фото вторая колонка - Rank, выровненный по стилю, так как LLM выдают ответы разной длинны и стиля и это влияет на субъективную оценку людей
- на фото - это Overall рейтинг. Можно его отфильтровать по доменам (математика, кодинг, креативное письмо, языки итд)
- самые крутые модели - это различные GPT от Open AI, Grok от Илона Маска, Gemini и Gemma от Google, QWEN и DeepSeek из Китая. Наших российских моделей в рейтинге нет вообще! 😎
- основа рейтинга - Arena Score. Он считается исходя из слепого сравения человеком качества ответов двух LLM на основе точности, согласованности и полезности. Для оцифровки используется система ELO, победа над сильной LLM даёт больше баллов, а поражение от слабой — отнимает больше баллов. Важны относительные значения баллов для сравения моделей, а не абсолютные
- на фото вторая колонка - Rank, выровненный по стилю, так как LLM выдают ответы разной длинны и стиля и это влияет на субъективную оценку людей
- на фото - это Overall рейтинг. Можно его отфильтровать по доменам (математика, кодинг, креативное письмо, языки итд)
- самые крутые модели - это различные GPT от Open AI, Grok от Илона Маска, Gemini и Gemma от Google, QWEN и DeepSeek из Китая. Наших российских моделей в рейтинге нет вообще! 😎
🔥3
Привет 👋
Работы много, пишем мало, но будем исправляться.
Вчера провели встречу с представителями топ-3 ретейл компании в РФ, для себя зафиксировали ряд интересных инсайтов.
Уже сейчас ИИ заменяет у коллег ряд сотрудников, или дополняет работу этих сотрудников, увеличивая эффективность работы до 90%. В основном, это такие специальности как:
- маркетологи
- юристы
- разработчики (уже сейчас ИИ пишет приложения под мобильную разработку за 1 час, на что ранее бы потребовался месяц работы команды из 10 человек)
Тем не менее, по некоторым направлениям у коллег есть скептицизм. Например, несмотря на хайп вокруг аналитики данных через ИИ, и то что фонды типа YCombinator вкладывают туда десятки млн $, коллеги не видят значимой разницы в поиске инсайтов для бизнеса через ИИ в сравнении с классическим факторным анализом или подходом fuzzy featuring, которым рынок пользуется уже десятки лет.
Больше инсайтов с российского рынка ИИ ждите в нашем канале.
Работы много, пишем мало, но будем исправляться.
Вчера провели встречу с представителями топ-3 ретейл компании в РФ, для себя зафиксировали ряд интересных инсайтов.
Уже сейчас ИИ заменяет у коллег ряд сотрудников, или дополняет работу этих сотрудников, увеличивая эффективность работы до 90%. В основном, это такие специальности как:
- маркетологи
- юристы
- разработчики (уже сейчас ИИ пишет приложения под мобильную разработку за 1 час, на что ранее бы потребовался месяц работы команды из 10 человек)
Тем не менее, по некоторым направлениям у коллег есть скептицизм. Например, несмотря на хайп вокруг аналитики данных через ИИ, и то что фонды типа YCombinator вкладывают туда десятки млн $, коллеги не видят значимой разницы в поиске инсайтов для бизнеса через ИИ в сравнении с классическим факторным анализом или подходом fuzzy featuring, которым рынок пользуется уже десятки лет.
Больше инсайтов с российского рынка ИИ ждите в нашем канале.
👍7🔥2
На этом видео 4 умных мужика из руководящего состава Open AI, обсуждают обучение GPT-4.5, и наше с вами будущее. В дискуссии участвуют сам Sama, Alex (pre-tuning data), Amin (главный системный архитектор), Dan (date efficiency и алгоритмы).
Спокойно смотрится за чайком☕️, технически сложной информации на видео нет. Основные тезисы из видео:
• к запуску (pre-train) сложно подготовиться, и начинается он с кучей нерешенных проблем, которые решаются по ходу дела (всем знакомо🙂)
• GPT-4.5 в 10 раз умнее чем GPT-4? это не так, просто 4 обучалась на 10000GPU, а 4,5 на 100000GPU 🤖
• падения инфры и их виды сильно скейлятся при увеличении количества GPU, это основная проблема при масштабировании
• Основной стоп к дальнейшему скейлингу - не вычисления, а дата, которая быстро не может расти (все что можно уже пропарсили)
• 4 основных компонента для роста: чипы, процессоры, сеть, энергия. Правильным написанием кода можно нивелировать узкие места и распределять нагрузку между ними
Спокойно смотрится за чайком☕️, технически сложной информации на видео нет. Основные тезисы из видео:
• к запуску (pre-train) сложно подготовиться, и начинается он с кучей нерешенных проблем, которые решаются по ходу дела (всем знакомо🙂)
• GPT-4.5 в 10 раз умнее чем GPT-4? это не так, просто 4 обучалась на 10000GPU, а 4,5 на 100000GPU 🤖
• падения инфры и их виды сильно скейлятся при увеличении количества GPU, это основная проблема при масштабировании
• Основной стоп к дальнейшему скейлингу - не вычисления, а дата, которая быстро не может расти (все что можно уже пропарсили)
• 4 основных компонента для роста: чипы, процессоры, сеть, энергия. Правильным написанием кода можно нивелировать узкие места и распределять нагрузку между ними
👍5❤2👏1
В то время как американцы строят новые дата центры, китайцы открывают новые научные методы методы повышения эффективаности моделей👍 Статья по ссылке
Новый метод обучения называется Test-Time Reinforcement Learning и суть его описана на скриншоте. Опишу без умных слов, чтобы было всем понятно:
- обычно модели тюнингуют на размеченных данных, то есть говорят какой ответ является правильным
- ребята предложили дообучать модель на любых запросах пользователей даже без указания правильного ответа
- для этого модель несколько раз обрабатывает запрос, получив несколько ответов, из этих ответов выбирается наиболее частый, он и считается "правильным", далее за каждый из ответов модель вознаграждается в зависимости от близости ответа к "правильному"
- на некоторых бенчмарках типа AIME 2024 или MATH-500 прирост достигает 150%. Гениально 💡
Новый метод обучения называется Test-Time Reinforcement Learning и суть его описана на скриншоте. Опишу без умных слов, чтобы было всем понятно:
- обычно модели тюнингуют на размеченных данных, то есть говорят какой ответ является правильным
- ребята предложили дообучать модель на любых запросах пользователей даже без указания правильного ответа
- для этого модель несколько раз обрабатывает запрос, получив несколько ответов, из этих ответов выбирается наиболее частый, он и считается "правильным", далее за каждый из ответов модель вознаграждается в зависимости от близости ответа к "правильному"
- на некоторых бенчмарках типа AIME 2024 или MATH-500 прирост достигает 150%. Гениально 💡
⚡6👍2
Конспект LLM.pdf
38 MB
Коллеги из другого канала подготовили материал по LLM, тут и история и базовая математика, архитектура и принципы работы, а также новейшие достижения в сфере.
Как человек, подписанный на множество каналов и просмотревший различные обучающие видео - могу сказать что ребята проделали просто титаническую работу и структурно изложили огромное количество знаний в одном файле - емко, технически корректно и понятным языком 👏👏👏
Все кто хочет получить базовое понимание в формате «все обо всем» или «что есть что» - люди из 90х поймут 😄 - то welcome, пользуйтесь!
Как человек, подписанный на множество каналов и просмотревший различные обучающие видео - могу сказать что ребята проделали просто титаническую работу и структурно изложили огромное количество знаний в одном файле - емко, технически корректно и понятным языком 👏👏👏
Все кто хочет получить базовое понимание в формате «все обо всем» или «что есть что» - люди из 90х поймут 😄 - то welcome, пользуйтесь!
🔥7👍3
Диффузионные модели LLM - что это?
Если кратко, то обычные LLM (ChatGPT, DeepSeek итд) - являются авторегрессиоными, то есть просто предсказывают следующее слово, как Т9 на стероидах 🙂
Диффузные модели, которые ранее использовались в основном для генерации изображений и видео, работают сразу с предсказанием большого объема переменных, в случае с картинками «расшумляют» изображение, то есть набор пикселей, а в случае с текстом - «расшумляют» облако слов (токенов), что позволяет:
- Намного быстрее генерить текст, за счет того, что токены просчитываются не друг за другом, а сразу параллельно. Например недавно Google выпустила Gemini Diffusion, которая может генерить 2000 токенов в секунду, это в 10 раз быстрее чем в среднем модели
- генерировать сразу осмысленные предложения, а не слова друг за другом, что в теории может дать более осмысленные ответы
Пока в гонке бенчмарков диффузные LLM не занимают лидирующих мест, но есть тренд которому подключаются крупные игроки, поэтому следим 😎
Если кратко, то обычные LLM (ChatGPT, DeepSeek итд) - являются авторегрессиоными, то есть просто предсказывают следующее слово, как Т9 на стероидах 🙂
Диффузные модели, которые ранее использовались в основном для генерации изображений и видео, работают сразу с предсказанием большого объема переменных, в случае с картинками «расшумляют» изображение, то есть набор пикселей, а в случае с текстом - «расшумляют» облако слов (токенов), что позволяет:
- Намного быстрее генерить текст, за счет того, что токены просчитываются не друг за другом, а сразу параллельно. Например недавно Google выпустила Gemini Diffusion, которая может генерить 2000 токенов в секунду, это в 10 раз быстрее чем в среднем модели
- генерировать сразу осмысленные предложения, а не слова друг за другом, что в теории может дать более осмысленные ответы
Пока в гонке бенчмарков диффузные LLM не занимают лидирующих мест, но есть тренд которому подключаются крупные игроки, поэтому следим 😎
🔥7👏1