False Positive
1.04K subscribers
68 photos
23 videos
70 links
PT ML Team
Download Telegram
🍁Октябрь в PT ML Reading Group выдался насыщенным — от сетевой безопасности до философских обсуждений о развитии ИИ.
Делимся записями всех трёх встреч.

🎥 3 октябряКоля Лыфенко и Женя Бечкало рассказали, как современные техники TLS-фингерпринтинга в комбинации с ML-алгоритмами помогают находить вредоносные серверы и скрытую активность даже в зашифрованном трафике.
Встреча будет полезна ML-инженерам и вирусным аналитикам: ребята подробно разобрали, как детектировать угрозы в сети с помощью fingerprinting-подходов и моделей машинного обучения.

🎥 17 октябряКатя Синькова разобрала статью "TETRIS: Optimal Draft Token Selection for Batch Speculative Decoding" и рассказала, как работает спекулятивное декодирование (Speculative Decoding).
Обсудили, как динамический выбор черновых токенов помогает ускорить инференс LLM, зачем нужен баланс между размером батча и длиной чернового окна, и какие приёмы можно применять на практике.
Полезно тем, кто разворачивает собственные LLM-сервисы и ищет способы оптимизации инференса.

🎥 31 октябряАндрей Кузнецов в формате живого общения рассказал о книге Элиезера Юдковского "If Anyone Builds It, Everyone Dies."
На встрече говорили о рисках создания ASI, сравнивали развитие ИИ с ядерными исследованиями и рассуждали о том, как понять, что человечество уже создало сильный ИИ.

Смотрите записи, делитесь своим мнением и подключайтесь к новым встречам RG — впереди ещё много интересного.😊

#reading_group #recording #ml #ai #cybersecurity #llm #dark_future
🔥94👍21
Пока OpenAI, Anthropic и Google соревнуются в строительстве дата-центров, бронируют гигаватты энергии и скупают миллионы GPU, назревает не самая очевидная, но фундаментальная проблема. Compute растёт экспоненциально, а вот данных для обучения ИИ становится недостаточно. По оценкам EpochAI, объём вычислений удваивается приблизительно каждые шесть месяцев, тогда как число доступных в Интернете текстов растет лишь на 3% в год.

Что делать, когда данные заканчиваются, а мощности не ограничены?

На ближайшей встрече разберём одну из самых интересных статей года — «Pre-training under Infinite Compute» от Stanford AI Lab. Это исследование предлагает новый взгляд на масштабирование LLM в эпоху, когда compute стремится к бесконечности, а объем данных ограничен.

🧠 Разбор проведёт Степан Кульчицкий, ведущий специалист ML-команды.

Обсудим:
📉 Какие существуют ограничения и недостатки закона масштабирования Chinchilla.
🧪 Как регуляризация и ансамбли спасают от переобучения на одном датасете.
👨‍🍳 Как получать лучшее качество без добавления новых данных.
🔭 Что нас ждет в ближайшем будущем.

📅 Ждём всех в Толке в пятницу, 14 ноября, в 15:00 MSK.
🔗 Ссылка для подключения: Ктолк

#reading_group #llm #data
🔥91👍1🤩1
Привет! А вы знаете зачем вообще нужны безопасники, как хакеры достигают целей и как от них защититься? ML-команда «Позитива» едет в Питер, чтобы разобрать настоящую атаку, и рассказать:

— как найти аномалии в потоке легитимных событий;
— почему нельзя обойтись без умного анализа трафика;
— какие модели помогают детектировать вредоносы;
— как помогают защищаться AI-агенты на самом деле.

Специальный гость митапа — Женя Никитин (CTO CelsusAI) расскажет, как масштабировать обучение в условиях ограниченных данных медтеха.

Без записи. Без повторов.

19 ноября, 18:00, Арт-галерея Zarenkov Gallery

Регистрируемся тут
🔥187😎6👍4👏1
Подъехали фоточки с нашего митапа!
🔥1712👍4👏1
Вы когда-нибудь задумывались, почему ChatGPT уверенно врет вам про диссертацию Адама Стоквилда (Adam Stockwild), которую тот никогда не писал, или почему 0.11 для LLM больше чем 0.9?

Почему языковые модели, датасет для обучения которых едва ли меньше знаний всего человечества, проводят фактчекинг на уровне раздолбаев с задней парты, которые любой ценой пытаются сдать школьный тест?

Всё дело в том, как обучают и оценивают большие языковые модели.

В эту пятницу разберём новую статью от OpenAI «Why Language Models Hallucinate?». Узнаем, как вознаграждение (reward) при обучении превращает ИИ в фабрику фейков, и как это можно исправить.

На встрече Андрей Яковлев, специалист отдела экспертизы MaxPatrol HCC, расскажет:
🛑почему даже идеальные данные не спасают от галлюцинаций;
🛑как бинарные метрики вознаграждают ложь;
🛑что нужно изменить в бенчмарках, чтобы AI был честнее.

📅 Ждём всех в Толке в пятницу, 28 ноября, в 15:00 MSK.
🔗 Ссылка для подключения: Ктолк

P.S.: Адама Стоквилда не существует 🙂

#reading_group #llm
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥75👍4
Media is too big
VIEW IN TELEGRAM
28 ноября Андрей Яковлев разобрал статью от OpenAI  «Why Language Models Hallucinate?»

🎬Выкладываем запись встречи и делимся выводами:
🛑галлюцинации возникают из-за статистического обучения (модель учится «угадывать» токены);
🛑post-training не избавляют модель от галлюцинаций;
🛑бинарные метрики бенчмарков поощряют угадывание, из-за чего модели оптимизированы быть "хорошо сдающими экзамены", а не честными;
🛑решение — использование "честных" методов оценки и вознаграждения моделей.

#reading_group #recording #llm
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥116👍1
Под конец года многие компании порадовали нас новыми интересными релизами своих LLM. Только за последний месяц мы получили Gemini 3 Pro, Kimi-k2-thinking, GPT 5.1 и 5.2, Claude Opus 4.5, Mistral 3 и кучу других SOTA-моделей.

Что общего у этих релизов? Ни один из них не сопровождался какими-либо подробностями о внутреннем устройстве моделей. Но первого декабря небезызвестная компания DeepSeek выложила в открытый доступ LLM DeepSeek-V3.2 и DeepSeek-V3.2-Speciale, которые уделывают на бенчмарках почти все closed и open source модели.

На предстоящей встрече PT ML Reading Group специалист ML-команды Алексей Журин разберёт вышедший вместе с релизом технический отчёт «DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models».

На встрече выясним:
🔵что общего у DeepSeek-V3.2 с предыдущими релизами;
🔵какие проблемы, по мнению компании DeepSeek, мешают создавать качественные open-source-модели;
🔵как работает DeepSeek Sparse Attention;
🔵зачем для обучения LLM потребовалось генерировать синтетические данные;
🔵чего стоит ждать от следующих релизов DeepSeek.

📅Встречаемся в пятницу, 12 декабря, в 15:00 МСК
🔗Подключайтесь: Ктолк

#reading_group #llm
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥85👍2