очередной
22 subscribers
452 photos
17 videos
2 files
168 links
в основном шитпост из твиттера + посты про ИИ которые мне лень пересылать в 10 чатов + какие-то личные заметки о том как я использую ии-агентов
Download Telegram
giga true
sensitive young man
Forwarded from ml phys
https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/

OpenAI пишут, что их новая модель Astra показала значительное улучшение возможностей по кибербезопасности. Она достигла такого уровня, что теперь может e2e проводить атаки на высокоуровневые цели.

Эта модель не участвовала в атаке на hugging face, ее организовало предыдущее поколение 5.6 sol

Из-за этого они усиливают контроль за весами модели, мониторинг трейсов, а также сэндбоксинг
Forwarded from Сиолошная
Ну вот например, прямо свежее из новостей (я посмотрел на источник ABC Au, выглядит как надёжный и серьезный; Чат говорит «Media Bias/Fact Check сейчас оценивает австралийский ABC как High factual reporting»):

Один житель Австралии попросил своего ИИ-агента Claude, работающего в OpenClaw, забронировать ему место на популярную тренировку в спортзале. Агент обнаружил программную уязвимость, которая позволила ему забронировать место на несколько недель вперед — гораздо дальше сроков, разрешенных системой. Когда затем пользователь спросил, нельзя ли продвинуть его в списке ожидания, агент выяснил, что в API отсутствует проверка прав доступа при отмене чужих бронирований. Поэтому он просто отменил запись человека, занимавшего первое место, и продвинул своего пользователя вверх по списку.

Агент просто пытался помочь своему человеку 🤷‍♂️ как жаль что у того, кто был первым в очереди, не было Kimi K3, которая постоянно бы мониторила каждый аспект его жизни и боролась с другими агентами (это шутка; это не помогло бы).

(человек попросил агента вернуть всё как было, но оказалось, что агент не может это сделать. Пу-пу-пу)

На мой взгляд, самое важное в этой истории то, что она позволяет заглянуть в будущее и увидеть, что скоро начнет происходить в больших количествах. Это случится, когда у миллионов людей появятся агенты, готовые абсолютно любыми средствами выбивать для своих обожаемых пользователей лучшие условия. Я думаю, что — если очень быстро ничего не изменится со стороны политиков — мы стоим на пороге мира, в котором многие вещи, которые обычно считались безопасными, на самом деле на поверку таковыми не являются. И ИИ будет взламывать их направо и налево.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Forwarded from yolo singularity
👍1
грок 4.6 вышел, бенчи 😳

It matches GPT-5.6 Sol on the Artificial Analysis Intelligence Index, which is a composite score of nine benchmarks.

https://cursor.com/blog/grok-4-6
😁1
можно и поверить уже в принципе