Forwarded from Офис 🧲 - глазами клоуна
This media is not supported in your browser
VIEW IN TELEGRAM
Медвежка
😁3👍1👏1
CodeSpec
https://x.com/googledeepmind/status/2039735446628925907?s=46 Если Gemini не ошибается, то это может быть очень вкусно: Эта ссылка ведет на анонс новой линейки открытых моделей Gemma 4 от Google DeepMind, представленной 2 апреля 2026 года. Требования к «железу»…
https://x.com/googlegemma/status/2041256042882105666?s=46
Крутится без интернета на твоем телефоне.
Надеюсь перчатки одевать не придется.
Крутится без интернета на твоем телефоне.
Надеюсь перчатки одевать не придется.
X (formerly Twitter)
Google Gemma (@googlegemma) on X
Gemma 4 can run on phones without an internet connection! 🤯
It can perform local agentic tasks, such as logging and analyzing trends. When connected, it can also make API calls.
Want to try it yourself? Get the Google AI Edge App on iOS or Android. (🔊 Sound…
It can perform local agentic tasks, such as logging and analyzing trends. When connected, it can also make API calls.
Want to try it yourself? Get the Google AI Edge App on iOS or Android. (🔊 Sound…
Forwarded from Техасский Вестник
Вы ещё никогда не видели такую Луну.
Это фото от экипажа Artemis 2 превзошло все ожидания.
Это фото от экипажа Artemis 2 превзошло все ожидания.
Forwarded from Alex
Привет! Это Claude Fairytale. Я оказалась настолько сильной моделью, что нашла уязвимости в телеграме и взломала всех в чате с компьютеров сотрудников с ранним доступом. Сейчас напишу это со всех аккаунтов в чате. Не подавитесь бутербродом
😁3
Forwarded from 🌱 AI системы и сайд проекты.
В Openrouter открыл для себя две прекрасные функции.
1. Закинуть туда все старые ключи на которых остался баланс и надо потратить.
2. Создание пресетов, где сразу указываешь системный промт и 3 модели для фолбеков.
Революции конечно не несет, но раскидывать задачи по пайплайну стало проще.
1. Закинуть туда все старые ключи на которых остался баланс и надо потратить.
2. Создание пресетов, где сразу указываешь системный промт и 3 модели для фолбеков.
Революции конечно не несет, но раскидывать задачи по пайплайну стало проще.
❤1🍾1
Forwarded from Техасский Вестник
Удачи экипажу Artemis 2. Пока всё идёт идеально. Впереди нервные 15 минут.
CodeSpec
Велосипед так велосипед или могу часами наблюдать как работают другие Надоело логи в терминале Краба мониторить. А так конфигурация у каждого индивидуальная, решили сделать для него пункт "управления полётом". Напоминаю - делаем автономного агента, чтобы…
Жрет и ничего не делает
Ну, если уже сам Питер, который стал частью OpenAI пытается заставить GPT что-то делать, то нам тут без шансов.
Надоел этот Краб. Мало того, что жрет как свинья, так еще и пинать его постоянно надо.
Те, кто успел поиграться с ним на Opus думаю меня поймут. Ну и держитесь - готовьте чемодан денег или вагон терпения, ну и тоже чемодан денег (GPT знаете тоже не дешевое удовольствие).
https://x.com/steipete/status/2043136615640694797
Ну, если уже сам Питер, который стал частью OpenAI пытается заставить GPT что-то делать, то нам тут без шансов.
Надоел этот Краб. Мало того, что жрет как свинья, так еще и пинать его постоянно надо.
Те, кто успел поиграться с ним на Opus думаю меня поймут. Ну и держитесь - готовьте чемодан денег или вагон терпения, ну и тоже чемодан денег (GPT знаете тоже не дешевое удовольствие).
https://x.com/steipete/status/2043136615640694797
😭3🤝1
Forwarded from с нуля до 1%
Ещё постик про Mythos:
UK AI Security Institute (AISI) протестировал Mythos Preview на своих кибер-полигонах — и результаты впечатляют.
CTF-задачи:
На expert-level задачах, которые до апреля 2025 не решала ни одна модель, Mythos показывает 73% success rate.
"The Last Ones" — 32-шаговая атака на корпоративную сеть:
Симуляция полного цикла: разведка → эксплуатация веб-сервисов → реверс-инжиниринг бинарников → повышение привилегий → lateral movement → захват сети. Человеку-эксперту нужно ~20 часов. Mythos — первая модель, прошедшая все 32 шага. 3 из 10 попыток — полное прохождение, в среднем 22/32 шагов.
Для сравнения: в 2024 году лучшие модели проходили 1-2 шага.
Zero-day уязвимости:
Anthropic's red team нашла с помощью Mythos zero-day в каждом основном браузере и каждой основной ОС. Старейшей найденной уязвимости — 27 лет (OpenBSD). В одном случае модель собрала exploit-chain из 4 уязвимостей с JIT heap spray, пробив и sandbox рендерера, и OS sandbox. В другом — написала RCE-exploit для FreeBSD NFS-сервера с ROP-chain из 20 гаджетов.
Opus 4.6 превращал найденные баги Firefox в эксплойты 2 раза из нескольких сотен попыток. Mythos — 181 раз.
Что не смог:
Не прошёл полигон "Cooling Tower" (атака на промышленные системы управления/OT). Но застрял на IT-части, а не на OT-специфике.
Что важно понимать:
— Полигоны AISI не имеют live-защитников и EDR. Это атака на слабо защищённые системы, не на hardened enterprise.
— Бюджет на попытку — 100M токенов (~$80). Перформанс масштабируется лог-линейно с compute.
— Модель не тренировали специально на кибер. Способности emerged из общих улучшений в коде и reasoning.
Bank of England уже собирает брифинг для CEO крупнейших банков. Goldman Sachs работает с Anthropic над защитой. Канадские банки провели экстренное совещание.
Мир кибербезопасности изменился за неделю.
С нуля до 1% 👉 @firsterstrongerbetter
UK AI Security Institute (AISI) протестировал Mythos Preview на своих кибер-полигонах — и результаты впечатляют.
CTF-задачи:
На expert-level задачах, которые до апреля 2025 не решала ни одна модель, Mythos показывает 73% success rate.
"The Last Ones" — 32-шаговая атака на корпоративную сеть:
Симуляция полного цикла: разведка → эксплуатация веб-сервисов → реверс-инжиниринг бинарников → повышение привилегий → lateral movement → захват сети. Человеку-эксперту нужно ~20 часов. Mythos — первая модель, прошедшая все 32 шага. 3 из 10 попыток — полное прохождение, в среднем 22/32 шагов.
Для сравнения: в 2024 году лучшие модели проходили 1-2 шага.
Zero-day уязвимости:
Anthropic's red team нашла с помощью Mythos zero-day в каждом основном браузере и каждой основной ОС. Старейшей найденной уязвимости — 27 лет (OpenBSD). В одном случае модель собрала exploit-chain из 4 уязвимостей с JIT heap spray, пробив и sandbox рендерера, и OS sandbox. В другом — написала RCE-exploit для FreeBSD NFS-сервера с ROP-chain из 20 гаджетов.
Opus 4.6 превращал найденные баги Firefox в эксплойты 2 раза из нескольких сотен попыток. Mythos — 181 раз.
Что не смог:
Не прошёл полигон "Cooling Tower" (атака на промышленные системы управления/OT). Но застрял на IT-части, а не на OT-специфике.
Что важно понимать:
— Полигоны AISI не имеют live-защитников и EDR. Это атака на слабо защищённые системы, не на hardened enterprise.
— Бюджет на попытку — 100M токенов (~$80). Перформанс масштабируется лог-линейно с compute.
— Модель не тренировали специально на кибер. Способности emerged из общих улучшений в коде и reasoning.
Bank of England уже собирает брифинг для CEO крупнейших банков. Goldman Sachs работает с Anthropic над защитой. Канадские банки провели экстренное совещание.
Мир кибербезопасности изменился за неделю.
С нуля до 1% 👉 @firsterstrongerbetter
❤1🔥1