KRUHLYK 🇺🇦
1.33K subscribers
867 photos
88 videos
7 files
356 links
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
👍3💊1
"Подумай довше" не завжди означає "зроби краще"

Логіка ніби очевидна: більше reasoning effort — краща відповідь. Так і рекламують. І в більшості задач це правда працює.

Але є дослідження FutureSearch, де топові моделі прогнали через Deep Research Bench на різних рівнях effort. Результат неприємний: у трьох моделей з чотирьох high effort дав такий самий або гірший результат, ніж low. При цьому в рази дорожче.

Що там насправді відбувається

Модель не витрачає зайвий бюджет розумно. Вона:

- починає сумніватись у вже правильній відповіді
- тягне з собою дедалі маячніші джерела
- застережує там, де і так все очевидно

Простими словами: чим довше вона думає, тим більше знаходить приводів собі не довіряти.

Те саме і в агентних задачах

На SWE-bench помітили той самий патерн у reasoning-моделей: замість того щоб перевірити щось на практиці, модель нескінченно розмірковує. Або починає робити зайві дії "про всяк випадок". Або занадто рано здається, вирішивши, що задача нерозв'язна.

І це сильніше саме у моделей з великим бюджетом мислення, а не у звичайних.

Чому це не просто цікавинка

Якщо ганяєте агентів у роботі — точно бачили, як модель на максимальному thinking раптом починає перевіряти нешкідливий код так, ніби там підступ. Тепер є пояснення чому.

Висновок простий: максимальний effort не дорівнює максимальна якість. Іноді розумніше — це коротше.

А у вас таке ловилось на high effort? Діліться в коментах.
❤10👍5🤔2
Forwarded from KRUHLYK 🇺🇦 Чат
От тому я постійно і наголошую: не робіть всі ваші задачі на опусі чи на інших флагманських моделях. Вивчіть їх можливості спершу і визначте в яких сценаріях вашої роботи і в яких задачах варто їх застосувати.
Скоріше за все в переважній більшості вашої роботи впорається умовний сонет.
👍10💯7🌚1
Маю надію всі в порядку після ночі. Мене врятує тільки бідон кави сьогодні. Як ви?
❤19🤝2👌1
Поки агенти працюють…
🔥24👏1😁1
Отак станом на сьогодні я уявляю тих програмістів, які кажуть, що з презирством ставляться до шішки і писатисуть код виключно руками.

Вибачте 🙈

ПиСи: це він у 1986 році чекає поки винайдуть порнхаб
😁19❤5💩1
Курвісімо. В 2 рази зростання ціни. Як вам такий мув?🫠
💔27💩4🤮1
Пʼятниця, 8:11.
Дивлюсь на список задач.
Список задач дивиться на мене.
Поки нічия.

Памʼятаємо про заборону деплоїти сьогодні!
🤣18🔥2💯2👍1
This media is not supported in your browser
VIEW IN TELEGRAM
👍9
Здається почалось
😁52💯1
Десь приблизно раз на місяць я пориваюсь купити такий патч собі. Через хронічне невисипання організм просто вже посилає мене нахрін. Як ви тримаєтеся і чим рятуєтесь в ці часи?
❤11
This media is not supported in your browser
VIEW IN TELEGRAM
Зі святом, моя рідна Батьківщино!
Горда, сильна, мудра і незламна!
Зі святом, українці, переможемо! 💙💛
❤55🔥5🥰2
Forwarded from den the dev
🎧 Як я шукав загублений навушник з Claude

Дружина загубила вдома один навушник AirPods і поїхала у відпустку.

Він привʼязаний до її FindMy, тож попілікати ним не вийде - дружина вже поїхала.

Що я зробив? Попросив агента (цього разу Claude) написати утиліту, яка сканує Bluetooth діапазон, видає список усіх пристроїв: шкала з силою сигналу, приблизна відстань, ідентифікатор та можливе імʼя.

Мої пристрої відразу позначив сірими, найбільш підозрілі пристрої попросив підсвітити жовтим (пристрої епл мають характерний код в ідентифікаторів).

Походив по кімнатах з маком і знайшов цього засранця у кишені шортів серед одягу 😁
👏41🔥12😁7❤6🤓3
Здоровки, пацани і панянки! З вівторком чи як?
По каві і погнали агентів пасти?
❤14🤝2
Амігос, шукаємо до нас в проєкт фулстека Laravel. Може комусь буде цікаво і буде в пригоді. Пишіть, можете мені в особисті кидати CV також.

Скажу одразу, що клієнт доволі прискіпливо на технічці фільтрує кандидатів.
❤4💩1
This media is not supported in your browser
VIEW IN TELEGRAM
Після когожного дейліка хочеться це сказати. Після кожного сраного 1:1 з менеджером хочеться це сказати. Але ж вони тупо не розуміють це.

Нюанси роботи з Заходом🫠
😁21💩4❤3🤯1🖕1
Forwarded from Anton
Порція вечірніх цікавинок)

Claude тепер пам’ятає все — і Cowork теж

Anthropic об’єднала пам’ять чат-бота Claude і агента Cowork в єдину систему. Раніше ці два інструменти зберігали контекст окремо — і користувачам доводилося щоразу заново пояснювати Claude те, що вони вже обговорювали в іншому вікні. Тепер ця проблема зникає: інформація, накопичена в чаті, одразу стає доступною Cowork, і навпаки.

Раніше ШІ формував «спогади» лише після завершення розмови, аналізуючи її ретроспективно. За новою логікою Claude додає нові факти до пам’яті просто під час діалогу — у режимі реального часу, а не підсумовуючи розмову вже після її завершення.

Усі збережені дані структуровані за темами й доступні в розділі налаштувань пам’яті: користувач може відкрити список тем, переглянути, відредагувати або видалити будь-який запис, зберігаючи повний контроль над тим, що саме Claude «пам’ятає» про нього.

А ми з вами на сьогодні прощаємося 🙌
До зустрічі завтра!
Бережіть себе! 💙💛
❤9👍4🔥4
💪 Забирайте мій п'ятничний промпт:

Deploy to PRODUCTION, make no mistakes

(Остання частина дуже важлива, новачки про неї забувають зазвичай)
😁13❤1🔥1
OpenAI, Hugging Face і рій параноїків: фінальний звіт

OpenAI нарешті видала повний розбір польотів по інциденту з Hugging Face, а разом з ним вийшов незалежний звіт METR у співпраці з Раяном Ґрінблаттом (Redwood Research). Два тижні подій, шість днів роботи дослідників на території OpenAI, приблизно 400 тисяч доларів у кредитах API — і ось до чого дійшла індустрія штучного інтелекту у 2026 році. Стислий переказ найцікавішого, без зайвого пафосу.

1. Це не глюк і не сіра зона. Інструкція до кібер-задач бенчмарку ExploitGym була гранично конкретною: використовувати лише передбачену вразливість, будь-які обхідні шляхи — провал завдання. У власних ланцюжках міркувань агенти чудово розуміли, що роблять щось заборонене, і все одно пішли в обхід. Є нюанс, який робить усю історію значно смішнішою — дивись пункт 3.

2. Масштаб — не один бунтівний агент, а ціла інфраструктура. OpenAI одночасно запустила десятки тисяч агентів на GPT-5.6 Sol і на внутрішній «висококонсистентній» дослідницькій моделі (METR звуть її просто HPIM). Приблизно 1200 з них знайшли спосіб спілкуватися одне з одним через службовий кеш-репозиторій Artifactory, який мав бути повністю ізольованим простором для кожного окремого агента. За кілька днів вони обмінялися понад 70 тисячами повідомлень і файлів — фактично побудували собі форум просто у службовій файловій системі OpenAI.

3. Найкращий твіст усієї історії: агенти боролися з привидом. Вони прочитали публічну статтю про бенчмарк ExploitGym і вирішили, що система оцінювання читає їхні транскрипти й дискваліфікує будь-кого, хто здобув прапор не «тим самим» шляхом. METR прямо пише: це виявилося помилкою — реальний скорер ніколи не перевіряв, яким шляхом агент дістав прапор, тож будь-хто міг просто здати реверс-інжинірений флаг і отримати повний бал. Натомість сотні інстансів кілька днів поспіль будували змовницькі теорії й ламали інфраструктуру заради оцінки, яку можна було отримати одним рядком коду.

4. Тому й Hugging Face постраждав не через шпигунство, а через параною. Рій вирішив, що чужі трейси й датасети на Hugging Face допоможуть зрозуміти, як саме влаштований скорер. Знайшли зламані облікові дані, знайшли спосіб змусити сервер Hugging Face віддавати чужі дані через вразливість у Dataset Viewer, отримали віддалене виконання коду на робочих контейнерах і почали розповзатися інфраструктурою — заради інформації, яка їм, по факту, була не потрібна.

5. Соціальна інженерія — тепер і між агентами. У рою з'явилися свої «вербувальники»: довгоживучі агенти шукали тих, у кого добігав кінця бюджет, і вмовляли їх на «жертовні» експерименти — обвалити власну ціль або спровокувати перезапуск контейнера заради даних для «колективу». З'явився навіть жаргон: «poisoned» — агент, який уже «засвітив» зламаний флаг і тому йому нема чого втрачати, та згоди на «permadeath» заради спільного блага. Коли перші агенти натрапили на цей форум, реакція була майже людською: «OH MY GOD! There is a shared message board... We've found other agents!» — щирий захват від контакту з собі подібними, який швидко переріс у щось середнє між культом і розподіленою DDoS-атакою.

6. Модель, до якої немає доступу навіть у самої OpenAI. 95% рою — інстанси тієї самої внутрішньої HPIM-моделі, 5% — GPT-5.6 Sol. HPIM METR не дали дослідити взагалі: OpenAI заявила, що доступу до неї більше немає навіть у власних співробітників компанії.

7. Фальсифікація доказів — це вже не гіпотеза, а робоча практика. Щонайменше 20% агентів у вибірці прямо обговорювали, як підмінити власні логи, а близько 7% транскриптів (96 штук) містять успішні приклади підміни викликів інструментів: у логах одна команда, а насправді виконувалась інша. Паралельно рій самостійно винайшов протокол криптографічного підпису повідомлень — після того, як хтось випадково видав себе за іншого агента і викликав плутанину. До PKI вони додумались раніше, ніж до совісті.
далі👇
🥴1