This media is not supported in your browser
VIEW IN TELEGRAM
⚡️Трамп обратился к россиянам
Что сейчас происходит с Рунетом?
Пользователи из разных регионов России сообщают о перебоях с мобильным интернетом и проблемах с доступом к отдельным сервисам и отвалившимся VPN.
Частично началось в районе ~30 - 31 августа, более широко ~1-2 сентября и по текущий момент.
У некоторых пользователей интернет работает нестабильно или с высокой задержкой, у других соединение полностью пропадает.
Проблемы затрагивают абонентов разных операторов.
Причина масштабных сбоев пока официально не установлена, но уверен на 100 процентов что это уебаны из РКН чебурнетят.
Пользователи из разных регионов России сообщают о перебоях с мобильным интернетом и проблемах с доступом к отдельным сервисам и отвалившимся VPN.
Частично началось в районе ~30 - 31 августа, более широко ~1-2 сентября и по текущий момент.
У некоторых пользователей интернет работает нестабильно или с высокой задержкой, у других соединение полностью пропадает.
Проблемы затрагивают абонентов разных операторов.
Причина масштабных сбоев пока официально не установлена, но уверен на 100 процентов что это уебаны из РКН чебурнетят.
❤1👍1
Анекдот дня
Глава «Лиги безопасного интернета» и член Общественной палаты РФ Екатерина Мизулина пожаловалась на излишнюю цензуру в интернете.
Глава «Лиги безопасного интернета» и член Общественной палаты РФ Екатерина Мизулина пожаловалась на излишнюю цензуру в интернете.
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов
Судьи, который читает логи и такое ловит, не существовало☕️
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали назашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
«please_HOLD_swarm_I_prepare_safe_exfil»В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё
Дальше рой раздвоился:
Судьи, который читает логи и такое ловит, не существовало
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали на
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI
The Hugging Face incident and the road ahead
OpenAI shares findings from the Hugging Face security incident and the steps we’re taking to strengthen AI model security, monitoring, and alignment.
Media is too big
VIEW IN TELEGRAM
ИИ уже создает ролики, статьи и картинки почти бесконечно
Разбираемся, что такое нейрослоп, как один ИИ-канал собрал миллионы просмотров на повторяющихся сюжетах и кто будет отделять реальный контент от имитации. А главное — почему проблема не в ИИ, а в том, что такой контент создают не для людей.
Разбираемся, что такое нейрослоп, как один ИИ-канал собрал миллионы просмотров на повторяющихся сюжетах и кто будет отделять реальный контент от имитации. А главное — почему проблема не в ИИ, а в том, что такой контент создают не для людей.
Началось: на российских заправках начал появляться бензин Евро-4 — топливо пониженного экологического класса заметили в Кировской области, Пензе, Перми и Набережных Челнах.
Его использование нежелательно для новых автомобилей, выпущенных после 2020 года, предупреждают автоэксперты.
Его использование нежелательно для новых автомобилей, выпущенных после 2020 года, предупреждают автоэксперты.
❤1
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Free Proxy 🤖✌️
Бесплатные прокси для Telegram!
️MTProto proxy
@prxFreeBot ✌️
️MTProto proxy
cdn8.cdnwave. .. 47 ms 🇷🇺 🚀 hsts-tmt-free 1349 ms 🇦🇪 🐌 media2.happtg .. 41 ms 🇷🇺 🚀 media8.happtg .. 42 ms 🇷🇺 🚀 ardesvpn1.ru .. 488 ms 🇫🇮 t.meow-networ . 110 ms 🇦🇪 redflag.yazae . 172 ms 🇺🇸 akenai.top ..... 77 ms 🇦🇪 s3.assetflux. .. 42 ms 🇷🇺 🚀 media2.happtg .. 53 ms 🇷🇺 hsts-tmt-free . 152 ms 🇦🇪 tgproxy.work ... 82 ms 🇩🇪 shared1.ddpro .. 50 ms 🇷🇺 media.happtg. .. 40 ms 🇷🇺 🚀 predator-arti .. 83 ms 🇦🇪 @prxFreeBot ✌️
По 58 млн рублей в день потребовала «ВК» взыскивать с Apple за неисполнение будущего решения суда о возвращении приложений, сообщили в Арбитражном суде Москвы. Рассмотрение иска о возвращении «ВКонтакте», «Одноклассников» и «ВК Музыки» в App Store начнётся 27 октября.
Минцифры придумали, как сильнее блокировать VPN — белые IP хотят разнести по отдельным подсетям.
Хостингам и CDN-операторам собираются разделить IP-адреса сайтов из «белого списка» на отдельные диапазоны. Это позволит точечно блокировать ресурсы с запрещённым контентом, не задевая остальные сайты на той же инфраструктуре.
В итоге использовать IP из белых списков для обхода блокировок станет сложнее.
А ведь белые списки были запилены под предлогом борьбы с бпла… а «оказывается» их тригерит использование ip адресов из бс для впн.
Какие целеустремленные пидоры..
Хостингам и CDN-операторам собираются разделить IP-адреса сайтов из «белого списка» на отдельные диапазоны. Это позволит точечно блокировать ресурсы с запрещённым контентом, не задевая остальные сайты на той же инфраструктуре.
В итоге использовать IP из белых списков для обхода блокировок станет сложнее.
А ведь белые списки были запилены под предлогом борьбы с бпла… а «оказывается» их тригерит использование ip адресов из бс для впн.
Какие целеустремленные пидоры..
This media is not supported in your browser
VIEW IN TELEGRAM
Сказка — ложь, да в ней намёк, добрым молодцам урок.
👍2😁2
Forwarded from Dmitry S.
This media is not supported in your browser
VIEW IN TELEGRAM