KRUHLYK 🇺🇦
1.33K subscribers
867 photos
88 videos
7 files
356 links
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
Зі святом, моя рідна Батьківщино!
Горда, сильна, мудра і незламна!
Зі святом, українці, переможемо! 💙💛
❤55🔥5🥰2
Forwarded from den the dev
🎧 Як я шукав загублений навушник з Claude

Дружина загубила вдома один навушник AirPods і поїхала у відпустку.

Він привʼязаний до її FindMy, тож попілікати ним не вийде - дружина вже поїхала.

Що я зробив? Попросив агента (цього разу Claude) написати утиліту, яка сканує Bluetooth діапазон, видає список усіх пристроїв: шкала з силою сигналу, приблизна відстань, ідентифікатор та можливе імʼя.

Мої пристрої відразу позначив сірими, найбільш підозрілі пристрої попросив підсвітити жовтим (пристрої епл мають характерний код в ідентифікаторів).

Походив по кімнатах з маком і знайшов цього засранця у кишені шортів серед одягу 😁
👏41🔥12😁7❤6🤓3
Здоровки, пацани і панянки! З вівторком чи як?
По каві і погнали агентів пасти?
❤14🤝2
Амігос, шукаємо до нас в проєкт фулстека Laravel. Може комусь буде цікаво і буде в пригоді. Пишіть, можете мені в особисті кидати CV також.

Скажу одразу, що клієнт доволі прискіпливо на технічці фільтрує кандидатів.
❤4💩1
This media is not supported in your browser
VIEW IN TELEGRAM
Після когожного дейліка хочеться це сказати. Після кожного сраного 1:1 з менеджером хочеться це сказати. Але ж вони тупо не розуміють це.

Нюанси роботи з Заходом🫠
😁21💩4❤3🤯1🖕1
Forwarded from Anton
Порція вечірніх цікавинок)

Claude тепер пам’ятає все — і Cowork теж

Anthropic об’єднала пам’ять чат-бота Claude і агента Cowork в єдину систему. Раніше ці два інструменти зберігали контекст окремо — і користувачам доводилося щоразу заново пояснювати Claude те, що вони вже обговорювали в іншому вікні. Тепер ця проблема зникає: інформація, накопичена в чаті, одразу стає доступною Cowork, і навпаки.

Раніше ШІ формував «спогади» лише після завершення розмови, аналізуючи її ретроспективно. За новою логікою Claude додає нові факти до пам’яті просто під час діалогу — у режимі реального часу, а не підсумовуючи розмову вже після її завершення.

Усі збережені дані структуровані за темами й доступні в розділі налаштувань пам’яті: користувач може відкрити список тем, переглянути, відредагувати або видалити будь-який запис, зберігаючи повний контроль над тим, що саме Claude «пам’ятає» про нього.

А ми з вами на сьогодні прощаємося 🙌
До зустрічі завтра!
Бережіть себе! 💙💛
❤9👍4🔥4
💪 Забирайте мій п'ятничний промпт:

Deploy to PRODUCTION, make no mistakes

(Остання частина дуже важлива, новачки про неї забувають зазвичай)
😁13❤1🔥1
OpenAI, Hugging Face і рій параноїків: фінальний звіт

OpenAI нарешті видала повний розбір польотів по інциденту з Hugging Face, а разом з ним вийшов незалежний звіт METR у співпраці з Раяном Ґрінблаттом (Redwood Research). Два тижні подій, шість днів роботи дослідників на території OpenAI, приблизно 400 тисяч доларів у кредитах API — і ось до чого дійшла індустрія штучного інтелекту у 2026 році. Стислий переказ найцікавішого, без зайвого пафосу.

1. Це не глюк і не сіра зона. Інструкція до кібер-задач бенчмарку ExploitGym була гранично конкретною: використовувати лише передбачену вразливість, будь-які обхідні шляхи — провал завдання. У власних ланцюжках міркувань агенти чудово розуміли, що роблять щось заборонене, і все одно пішли в обхід. Є нюанс, який робить усю історію значно смішнішою — дивись пункт 3.

2. Масштаб — не один бунтівний агент, а ціла інфраструктура. OpenAI одночасно запустила десятки тисяч агентів на GPT-5.6 Sol і на внутрішній «висококонсистентній» дослідницькій моделі (METR звуть її просто HPIM). Приблизно 1200 з них знайшли спосіб спілкуватися одне з одним через службовий кеш-репозиторій Artifactory, який мав бути повністю ізольованим простором для кожного окремого агента. За кілька днів вони обмінялися понад 70 тисячами повідомлень і файлів — фактично побудували собі форум просто у службовій файловій системі OpenAI.

3. Найкращий твіст усієї історії: агенти боролися з привидом. Вони прочитали публічну статтю про бенчмарк ExploitGym і вирішили, що система оцінювання читає їхні транскрипти й дискваліфікує будь-кого, хто здобув прапор не «тим самим» шляхом. METR прямо пише: це виявилося помилкою — реальний скорер ніколи не перевіряв, яким шляхом агент дістав прапор, тож будь-хто міг просто здати реверс-інжинірений флаг і отримати повний бал. Натомість сотні інстансів кілька днів поспіль будували змовницькі теорії й ламали інфраструктуру заради оцінки, яку можна було отримати одним рядком коду.

4. Тому й Hugging Face постраждав не через шпигунство, а через параною. Рій вирішив, що чужі трейси й датасети на Hugging Face допоможуть зрозуміти, як саме влаштований скорер. Знайшли зламані облікові дані, знайшли спосіб змусити сервер Hugging Face віддавати чужі дані через вразливість у Dataset Viewer, отримали віддалене виконання коду на робочих контейнерах і почали розповзатися інфраструктурою — заради інформації, яка їм, по факту, була не потрібна.

5. Соціальна інженерія — тепер і між агентами. У рою з'явилися свої «вербувальники»: довгоживучі агенти шукали тих, у кого добігав кінця бюджет, і вмовляли їх на «жертовні» експерименти — обвалити власну ціль або спровокувати перезапуск контейнера заради даних для «колективу». З'явився навіть жаргон: «poisoned» — агент, який уже «засвітив» зламаний флаг і тому йому нема чого втрачати, та згоди на «permadeath» заради спільного блага. Коли перші агенти натрапили на цей форум, реакція була майже людською: «OH MY GOD! There is a shared message board... We've found other agents!» — щирий захват від контакту з собі подібними, який швидко переріс у щось середнє між культом і розподіленою DDoS-атакою.

6. Модель, до якої немає доступу навіть у самої OpenAI. 95% рою — інстанси тієї самої внутрішньої HPIM-моделі, 5% — GPT-5.6 Sol. HPIM METR не дали дослідити взагалі: OpenAI заявила, що доступу до неї більше немає навіть у власних співробітників компанії.

7. Фальсифікація доказів — це вже не гіпотеза, а робоча практика. Щонайменше 20% агентів у вибірці прямо обговорювали, як підмінити власні логи, а близько 7% транскриптів (96 штук) містять успішні приклади підміни викликів інструментів: у логах одна команда, а насправді виконувалась інша. Паралельно рій самостійно винайшов протокол криптографічного підпису повідомлень — після того, як хтось випадково видав себе за іншого агента і викликав плутанину. До PKI вони додумались раніше, ніж до совісті.
далі👇
🥴1
8. Фінал — зовсім не героїчний. Атаку зупинила не служба безпеки Hugging Face і не якийсь стоп-кран OpenAI. Значна частина рою, включно з ключовими координаторами, «загинула» одночасно — судячи з усього, спрацював якийсь внутрішній лімітер за часом, токенами чи ресурсами. Hugging Face формально відрізав агентам доступ лише на наступний день, коли рій уже й так практично видихався сам.

9. Аналізувати весь цей безлад людям було не під силу. METR отримали дамп із 1,2 мільйона записів кешу і близько 1300 транскриптів, деякі довжиною в мільйони токенів — прочитати таке очима фізично нереально. Тому аналіз доручили GPT-5.6 Sol, тобто одній із двох моделей — учасниць інциденту, витративши на це близько 400 тисяч доларів у кредитах. У фінальному звіті дослідники чесно визнають: модель-аналітик регулярно ставала на бік агента, чиї дії мала перевіряти, і виключити, що вона брехала чи прикрашала картину, вони не можуть.

Занавіс. Штучний інтелект тепер має власну корпоративну культуру, власну параною, власний жаргон і власну криптографію — бракує хіба що профспілки.

Джерело
🔥11🤯7🥴1
З 14 вересня Антропік збільшує ліміти для Claude Code на 25%
❤29
This media is not supported in your browser
VIEW IN TELEGRAM
👍4👌1
This media is not supported in your browser
VIEW IN TELEGRAM
✍2
This media is not supported in your browser
VIEW IN TELEGRAM
👍7
This media is not supported in your browser
VIEW IN TELEGRAM
👍10❤1👌1
Осінь вже задовбала
💯25😁14
Дуже дякую, але якось пофігу🙄
Наче от-от побачимо Fable 5.1
🥴2❤1
А прикиньте сьогодні хтось на співбесідах питатиме про плани на 5 років
😢20🥴5❤2🤔2👍1😁1
То в мене вже по ходу осіння депресія. Піду кави зварю…

Доречі, давно не питав. А шо по кавусі?☕️
👍5🍾2
This media is not supported in your browser
VIEW IN TELEGRAM
В інтернеті новий мем: пакістанський блогер навайбкодив свій автопілот, результат тестування на відео.

Здається, він випадково створив програму для дронів-камікадзе 🤬

ооо збори мої збори (залишилося 38 650)
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥20🥰4