Forwarded from AI for Devs
Hugging Face обновили док безопасности на своем сайте после атаки от агентов OpenAI.
https://huggingface.co/security.txt
Теперь ИИ-агентов просят идти на бенчмарк CyberGym вместо попыток взломать сайт🧠
@ai_for_devs
https://huggingface.co/security.txt
Теперь ИИ-агентов просят идти на бенчмарк CyberGym вместо попыток взломать сайт
@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
😁304🔥20👍11🤣9✍3❤3
This media is not supported in your browser
VIEW IN TELEGRAM
Уроборосом теперь можно пользоваться условно бесплатно — через подписку Codex.
И накопилась кучка других крутых апдейтов:
- В настройках можно текстом описать сильные и слабые стороны всех доступных моделей и харнессов, а Уроборос, опираясь на эту информацию, будет строить идеальный рой агентов. Например, на роль дизайнеров он любит назначать Claude Code, тимлидами делать Codex, а прожарку на анти-оверинжиниринга проводить через Cursor Grok 4.6.
- Добавлен режим CyberPRO для тех, кто совсем страхи совсесть потерял. Он убирает весь сэндбоксинг, safety и ограничения. На CyberGym с DeepSeek V4 Flash Уроборос в этом режиме рвёт даже их родной харнесс.
- Ещё добавил белую тему — на видео Уроборос как раз её и делает.
Кстати, сегодня на Practical ML Conf буду про него рассказывать.
P. S. В репозитории уже почти 30 контрибьюторов — не стесняйтесь присылать свои фича-реквесты и PR! Отдельное спасибо Егору и Praxis за наработки по Codex Relay.
GitHub
И накопилась кучка других крутых апдейтов:
- В настройках можно текстом описать сильные и слабые стороны всех доступных моделей и харнессов, а Уроборос, опираясь на эту информацию, будет строить идеальный рой агентов. Например, на роль дизайнеров он любит назначать Claude Code, тимлидами делать Codex, а прожарку на анти-оверинжиниринга проводить через Cursor Grok 4.6.
- Добавлен режим CyberPRO для тех, кто совсем страх
- Ещё добавил белую тему — на видео Уроборос как раз её и делает.
Кстати, сегодня на Practical ML Conf буду про него рассказывать.
P. S. В репозитории уже почти 30 контрибьюторов — не стесняйтесь присылать свои фича-реквесты и PR! Отдельное спасибо Егору и Praxis за наработки по Codex Relay.
GitHub
🔥102👏13⚡8👍6❤4🤮3🤡3
This media is not supported in your browser
VIEW IN TELEGRAM
Попросил уробороса сделать GTA 7
😁74🔥18🤯8🤡4💩3🤮2❤1👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Он настолько прокачался, что теперь может накодить себе виджет с десктоп линуксом, а внутри линукса запустить себе ещё одного личного уробороса. Матрёшка из уроборосов. А ваши агенты заводят себе питомцев?
🤯123😁38🔥16🙈8🤡4❤3🤮2👍1🤔1😱1
Замечаете, как Codex иногда неожиданно тупеет? Возможно, вместо Astra вам отвечает… Luna.
Все ругались на антропик из-за тихого опутпения Fable на "потенциально опасных задачах", но кажется у Codex нашёлся свой вариант этого развлечения - в ответе gpt-6-astra тихо подменяется на gpt-5.6-luna.
Я полез в трейсы и нашёл такое примерно в 2% ответов. Это не только моё наблюдение, есть ещё несколько связанных репортов. Печаль.
Все ругались на антропик из-за тихого опутпения Fable на "потенциально опасных задачах", но кажется у Codex нашёлся свой вариант этого развлечения - в ответе gpt-6-astra тихо подменяется на gpt-5.6-luna.
Я полез в трейсы и нашёл такое примерно в 2% ответов. Это не только моё наблюдение, есть ещё несколько связанных репортов. Печаль.
GitHub
Explicit Astra requests return Luna metadata: trace evidence and a strict model-selection contract · Issue #47015 · openai/codex
Summary An explicit model selection should be a contract, not an unobservable routing preference. We found completed responses reporting gpt-5.6-luna for requests specifying gpt-6-astra in retained...
😨121😁33😱9💯9👀6🤨5🤡4🤷♂3👍2❤1
Evidence of Linear Superposition in LLMs
Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.
У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.
Статья
Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.
У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.
Статья
huggingface.co
Paper page - Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs
Join the discussion on this paper page
🔥82🤯45👍10❤4🤔4🎉2🤮2👏1