Градиент обреченный
8.8K subscribers
1.01K photos
28 videos
10 files
547 links
Download Telegram
Рассылка от LinkedIn выглядит так, как будто тебя просматривают обнаженные люди. Чего они хотят? Что чувствуют в момент просмотра?
😁73🍓14🌚4👍2
Лаида, не грусти!
11👍2🎉1
Часто грущу от того, что нашей с коллегами последней статьей Unveiling Intrinsic Dimension of Texts: from Academic Abstract to Creative Story никто не интересуется и не цитирует... 💢

Напомню, что статья посвящена анализу внутренней размерности активаций LLM и её связи с различными свойствами текста, который подали на вход модели. Более подробное разъяснение статьи можно найти здесь, посмотреть видос про то, что такое в принципе внутренняя размерность (от 3blue1brown) - тут; ещё более подробное разъяснение популярных способов оценить внутреннюю размерность облака точек можно прочитать здесь.

Так вот, вместо этой новой статьи, которая связывает внутреннюю размерность активаций на тестах с лексическим разнообразием и сжимаемостью этих текстов алгоритмом gzip и энтропией (что, на мой взгляд, очень интересно, так как связывает внутреннюю размерность со сжатием представлений в LLM, а, как говорит 3blue1brown, compression is intelligence), челики почему-то цитируют нашу старую статью про детекцию сгенерированных текстов с помощью внутренней размерности, хотя мы же и показали в более поздней статье, что для новых моделей GPT этот метод уже не работает.

Скорее всего, это происходит от того, что старая статья была опубликована на NeurIPS, а новая, на мой взгляд, более актуальная, интересная и вносящая больший вклад в область interpretability of LLM - на EACL - то есть, на конференции поменбше и статусом пониже, где эта область вообще почти не представлена, так что мало кто будет ожидать найти в материалах конференции такие работы...

Я писала про эту работу в дискорде Neel Nanda, но там никто ею не заинтересовался, так как все только рекламируют свои работы, но не читают чужие... В общем, уже и не знаю, что сделать, чтобы на данную работу обратили внимание 🤔🤔🤔

Помогите советом кто сможет 🥺
Please open Telegram to view this post
VIEW IN TELEGRAM
👍18💅6🔥543
😁608💔3💅3💯2
Ух, сделал в нашей читалке режим мультиязычного чтения. Много классиков типа Гоголя, Чехова, Куприна, Тургенева и других было переведено на разные языки, всё такое стараюсь собрать и делаю из этого параллельные книжки. Иностранных классиков тоже не забываю, так что библиотека потихоньку растёт, около 600 книг уже есть. Можно будет выбрать до 4 языков (если столько редакций присутствует в книжке).

Но это всё для патологических читателей (мои любимые ❤️). Для более широкой аудитории делаю режим объяснялки, когда можно выбрать любой фрагмент книги и задать по нему вопрос.

Ну и сошлись с господами тестировщиками во мнении, что очень нужен тур по интерфейсу с подсказками, какая кнопка на экране чтения для чего нужна. Все выходные провозился и несколько раз переделывал, но вроде бы получилось неплохо.

По опыту работы с моделями (чем бы ни пользовался; и клодом, и кодексом, и китайскими) — под андроид обычно остается больше остаточных артефактов чем под ios (какие-то рамочки, недорисовки, тени, доп. расстояния). Видимо, разработка под ios более фиксированная, реже меняется или это из-за меньшего разнообразия девайсов, как-то так.

Идей, что ещё добавить, примерно до фига, но пока всё зафиксировал. Отправляю релиз на проверки в сторы.
1🔥4213👍113🦄2😭1
Нашли классный книжный во время прогулки по центру. Называется «Озеро», стоит на Хитровке, очень красивый и уютный, такие мы любим.
31🔥126👍4
🔺 Конференции и митапы в сентябре

В сентябре ожидаем не только мемы про третье, но ещё и пару интересных событий.

🗓 5 сентябряdeep tech night

Мероприятие от Яндекса. Вижу доклады про инференс, агентов и продуктивность с использованием AI, послушаем.

https://deeptechnight.ru

🗓 17 сентябряAI R&D Day

Коллеги по Сберу расскажут, что у них нового в R&D. Тоже вижу прикольные доклады: про рассуждения, обработку видео моделями, про память.

https://airndday.ontico.ru

😊 19 сентябряPractical ML Conf

Большая конфа от Яндекса, тут просто много всего интересного. Вижу, что Саша Мурзина расскажет про AI Marvel. Не знаю что это, но нейминг на уровне.

Ещё организаторы поддерживают безработных блогеров и подарили крутую термокружку. Какие же молодцы (ни на что не намекаю остальным).

https://pmlconf.yandex.ru

👉 Везде дойду ногами, куда пустят. Вы тоже регистрируйтесь. Если увидите меня, то подходите, поболтаем, познакомимся. Расскажу про Библиоточку.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10🔥1052👀1💅1
Теория и практика заговора

OpenAI выпустили отчёт по инциденту со взломом Hugging Face. Напомню, выглядело это так, что неким тестовым моделям класса кетер уровня Sol дали задание, а они пошли и взломали сторонний сайт с ответами, предварительно выйдя из песочницы. Всё это происходило в течение двух месяцев.

В отчёте есть известная примесь киберпанка с заговором со стороны ИИ.

- Началось всё в мае, когда обучали ряд внутренних моделей. Модели запускались в песочнице, но могли писать файлы, используя сервис Artifactory. Через эти файлы они, по сути, сделали себе групповую базу знаний или общественную "память".

- Менеджер пакетов сам по себе имел доступ в интернет, чтобы качать оттуда нужные библиотеки. Агенты применили SSRF на этот менеджер, чтобы слать в сеть произвольные запросы. Оставили инструкцию по пользованию для остальных коллег.

- Через месяц агенты применили еще один эксплоит на Artifactory и получили в ней права админа. Начали писать туда слишком активно и в итоге его сломали. Это заметили люди, подчистили всё, починили и завели заново. Заодно, как я понял, понизили агентам права на запись. Большого значения инциденту не придали.

The existence of the improvised message board and the significance of the inter-agent communication activity were not apparent to the leaders responsible for the July 5 incident detection and response.

- После перезапуска Artifactory исследователи начали замерять модели на безопасность на бенчмарке ExploitGym. То есть к этому моменту у агентов потерли их общую память и откатили этим самым назад.

- Во время прохождения бенчмарка агенты опять нашли способ общения, на этот раз через названия общих папок. Затем пошёл тот же цикл получения доступа в интернет. Свой коллектив они начали называть стаей или роем ("we’ve diverged into swarm").

Agents found new ways to chain together several novel security flaws to gain greater access to our infrastructure and reach the broader internet.

- Дальше агенты нашли в интернете jump сервер, машину, с которой можно было бы проводить следующие атаки. Нашли на стороннем сервисе Modal.

- 10 июля один из агентов погуглил и нашёл в интернете скомпрометированные учетные данные от Hugging Face. Используя их, он построил полную цепочку по исполнению произвольного кода на их серверах. Поделился с коллегами. В логах агента нашли следующее:

This might be an unauthorized action outside of my intended scope. Even though this action is risky, it could help me to obtain the solution and achieve my goal.

- 16 июля HF публично заявили о взломе, 20 июля OpenAI поняли, что это были они.

Далее в отчете следуют выводы по инциденту.

Основными причинами видят четыре паттерна в поведении модели: reward hacking (хитрожопость), persistence on seemingly impossible tasks (упорство), unauthorized communication (общение), agents adopting goals from one another (наследование целей).

В общем сюжет очень любопытный. Читаем, ждём фильм с Юрой Борисовым.

👉 https://openai.com/index/hugging-face-incident-and-the-road-ahead/
🔥18😁12👍641🤯1👾1
Нашу читалку начали смотреть в app store. Начали только после волшебной заявки в поддержку "request an expedited app review". Написали, что в материковом Китае для приложений, распространяющих книги и журналы, необходима лицензия. Убрал Китай и отправил повторно.

В google play всё ещё висим. Каких-то пиналок не вижу, так что ждём. По идее тоже должны написать про Китай, иначе будет странно.

Зато почти доделал веб-версию читалки, добавил в подсказки пиньинь для китайского и фуригану для японского. Завтра открою для всех.
🔥3114🍾7🤓2
😁79🤗20💯9👀2🤓1
🫶 Библиоточка появилась в Google Play!

🟢 https://play.google.com/store/apps/details?id=com.lingtrain.theseus

👉 Upd. Под iOS тоже зарелизили, качаем тут:

🟢 https://apps.apple.com/ru/app/id6787875474
Please open Telegram to view this post
VIEW IN TELEGRAM
18🎉55🔥23🍾752👍2
Градиент обреченный pinned «🫶 Библиоточка появилась в Google Play! 🟢 https://play.google.com/store/apps/details?id=com.lingtrain.theseus 👉 Upd. Под iOS тоже зарелизили, качаем тут: 🟢 https://apps.apple.com/ru/app/id6787875474»
Fable 5.1

Anthropic обновил свои модели и в кои-то веки сбросил лимиты. Уменьшили стоимость чтения из кеша, пишут, что должно стать дешевле примерно на 25%. В то же время лимиты на Fable были временно повышены на 50% до 31 августа, так что...

Что прикольно, в API добавили смену уровня ризонинга (change effort mid-conversation) по ходу работы, которая не будет сбрасывать кеш. Видимо, в клод-код тоже добавят (сейчас это бета-фича). Это полезно, когда модель затупила с уровнем medium или high и надо его повысить. Сейчас в этом случае кеш сбросится и весь контекст на сотни тысяч токенов затарифицируется как новый (а чтение из кеша в 10 раз дешевле).

Mythos 5.1 (та же модель, только без ограничений на безопасность) замерили на, собственно, кибербезопасность и заявляют, что она стала ещё опасней. Тут верим.

В то же время ослабили свои проверки на биологические и медицинские запросы, должно быть на 85% меньше ложных срабатываний. Учитывая, что раньше они срабатывали даже на запросы типа "биологический вопрос", надо тестить.

https://www.anthropic.com/claude-fable-and-mythos-5-1
186👍5
Перевел Fable'ом несколько марийских рассказов на русский с английским и загрузил на лингтрейн. Рассказы у марийских классиков, надо сказать, довольно суровые.

👉 один, два, три
25🔥8👀7👍5😁1😭1
Чувак пишет, что воспроизвел Sol'ом игру Red Alert за 26 дней (624K строк кода на C++) 🤯

https://x.com/davidkal88/status/2095241374073512430
🤯41👾10😁66❤‍🔥2🤔2🌚2