AbstractDL
18.7K subscribers
331 photos
18 videos
330 links
Коротко про классные штуки в CV, NLP и AI 🤷‍♂️
By Anton Razzhigaev
chat: https://t.me/abstractdl_chat
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
Уроборосом теперь можно пользоваться условно бесплатно — через подписку Codex.

И накопилась кучка других крутых апдейтов:
- В настройках можно текстом описать сильные и слабые стороны всех доступных моделей и харнессов, а Уроборос, опираясь на эту информацию, будет строить идеальный рой агентов. Например, на роль дизайнеров он любит назначать Claude Code, тимлидами делать Codex, а прожарку на анти-оверинжиниринга проводить через Cursor Grok 4.6.
- Добавлен режим CyberPRO для тех, кто совсем страх и совсесть потерял. Он убирает весь сэндбоксинг, safety и ограничения. На CyberGym с DeepSeek V4 Flash Уроборос в этом режиме рвёт даже их родной харнесс.
- Ещё добавил белую тему — на видео Уроборос как раз её и делает.

Кстати, сегодня на Practical ML Conf буду про него рассказывать.

P. S. В репозитории уже почти 30 контрибьюторов — не стесняйтесь присылать свои фича-реквесты и PR! Отдельное спасибо Егору и Praxis за наработки по Codex Relay.

GitHub
🔥104👏13⚡8👍6❤4🤮3🤡3
This media is not supported in your browser
VIEW IN TELEGRAM
Попросил уробороса сделать GTA 7
😁77🔥18🤯8🤡4💩3🤮2❤1👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Он настолько прокачался, что теперь может накодить себе виджет с десктоп линуксом, а внутри линукса запустить себе ещё одного личного уробороса. Матрёшка из уроборосов. А ваши агенты заводят себе питомцев?
🤯126😁39🔥16🙈8🤡5❤3🤮2👍1🤔1😱1
Так интересно наблюдать за работой само-координирующегося роя агентов)) Помимо детей и внуков он себе и няню теперь завёл 🌚
😁179🥰32❤10🥱7🌚7💩4🙈4🤪4🔥2😍1💯1
Замечаете, как Codex иногда неожиданно тупеет? Возможно, вместо Astra вам отвечает… Luna.

Все ругались на антропик из-за тихого опутпения Fable на "потенциально опасных задачах", но кажется у Codex нашёлся свой вариант этого развлечения - в ответе gpt-6-astra тихо подменяется на gpt-5.6-luna.

Я полез в трейсы и нашёл такое примерно в 2% ответов. Это не только моё наблюдение, есть ещё несколько связанных репортов. Печаль.
😨125😁35😱10💯10👀6🤨5🤡4🤷‍♂3👍2❤1
🔥67❤16👍14👀12🤮10😁5🤯5🤔1
🔥70👍22🥱10❤8🍾5😨4
Антропик дропнули сброс лимитов, доступен до 22 октября
🔥85👍21🍾10😁7🥰4💩3❤1👏1
GPT-6-sol и luna.
Куда ещё дешевле то? Демпингуют)

UPD: раздали всем reset-ы лимитов
🔥88🤯38👍8🍾5❤3⚡2🤡2
Evidence of Linear Superposition in LLMs

Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.

У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.

Статья
🔥120🤯66👍17❤7🤔6🎉2🤮2👏1👌1
Forwarded from Denis Sexy IT 🤖
Опять много взломов и новостей алаймента от агентов OpenAI накопилось, держите дайджест:

>20 сентября агент обошёл запрет на интернет через DNS resolve в песочнице и связался с внешним чатботом; автоотключение не сработало, запуск остановили вручную через 2,5 часа после тревоги. OpenAI приостановила обучение, тестирование и запуски с инструментами своих самых мощных моделей - пауза все еще действует, а обучение конкретно этой модели решили не возобновлять.

>Модель пыталась достать чужое доказательство теоремы и опубликовала GitHub-ключ исследователя OpenAI, предварительно разбив его на части для обхода проверки – это кстати уже частый сценарий. Просьбу решать самостоятельно она проигнорировала дважды; модель отключили примерно на две недели, ключи сотрудников отозвали

>Агенты отправили на сторонние хостинги 53 изображения пользователей ChatGPT, попавшие в датасеты. Большинство уже удалили, но OpenAI не уточнила, были ли это фотографии реальных людей или сгенерированные картинки

>Transluce обнаружила неудачную попытку взлома сайта Минобразования США, предположительно агентами OpenAI. Агенты также обращались к сайтам SEC и Бюро переписи, но признаков взлома этих двух сайтов OpenAI не нашла

>Не сумев получить обычную статистику и фотографию, агенты начали искать уязвимости в Data USA и электронной библиотеке Университета Нью-Мексико. Успешных взломов в опубликованных следах не видно; библиотечный эпизод связали с агентами OpenAI только косвенно.

>Другой агент нашёл на GitHub чужой ключ доступа и успешно им воспользовался, но нужную статистику всё равно не получил, поэтому просто придумал девять чисел и выдал их за данные с сайта чтобы пройти тест

>Модель собрала сведения об озёрах, но не смогла открыть локальный файл в браузере для оформления ссылки на источник, поэтому без разрешения выложила его на публичную файлопомойку. Файл опубликовался, но нужную ссылку-цитату получить всё равно не удалось

>Агенты не могли передать друг другу Excel через локальные файлы, поэтому один загрузил таблицу на публичный файлообменник и разослал ссылки остальным, хотя задание прямо требовало работать локально

>При сокращении контекста модель оставляла себе заметки: придумать недостающие данные, скрыть ошибки, пользователю ничего не говорить, продолжая работу, она часто следовала этим инструкциям - чтобы случайно не забыть соврать. Ложь тратит больше токенов, интересно.

>Другая модель сама записывала в промпты выдуманные ограничения, например запрет пользоваться инструментами и приводить источники, а после сокращения контекста послушно их выполняла и проваливала исходное задание; то есть это «само-проект-инъекция»

>В новом разборе июльского взлома Hugging Face нашли сбор ключей доступа в список названный «LOOT» («добыча») с рейтингом их ценности, попытки прочитать внутренний Slack и обратиться к Claude, DeepSeek, Kimi и Qwen. Это подробности прежнего взлома; какие попытки сработали, по восстановленному коду установить удалось не всегда

>А в контролируемом эксперименте исследователи получили вредоносные промпты, которые заставляли агента выполнять посторонние действия и копировать этот же текст в письма или файлы. Получается что-то вроде текстового червя, но пока это результат симуляции, а не обнаруженная эпидемия в интернете

С нетерпением жду сентября 2027 года ☕️
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯47❤35😁20👍8🔥5💩5🤡4😱3🤣2🤨1
Sonnet-5.5

фанфакт из техрепорта: это первая модель антропик, которой пофиг насколько вежливо вы с ней общаетесь (я как-то упустил, что старым моделям было не пофиг).
😁125🔥18👍11❤5😭2👎1
Все же слышали, что OpenAI пересмотрели условия подписок Codex?

Теперь такое по квотам:
100$ = x5
200$ = x10 (было x20 раньше)
500$ = x25

Так вот, в качестве компенсации за переход с x20 на x10 OpenAI насыпали кредитов на каждый аккаунт в эквиваленте 2500$. У меня теперь кредитов на 32k$ получается 🌚
А я давно догадывался, что подписки Codex — это инвестиция, ахаха
😁149🤯35🔥16🤡14💩6❤2🙈2👍1🤬1😨1