Forwarded from Клешня Зойдберга
This media is not supported in your browser
VIEW IN TELEGRAM
Тут антропіки виклали у відкритий доступ Claude Commerce Agents
По суті це великий туторіал для інженерів як білдити нормальних commerce агентів. Є референсна архітектура, приклади для рітейлу, тревелу, телекому і квитків, tools, memory, evals, approvals і guardrails.
Я троха поковиряв і не дуже бачу сенс просто хостити це в себе, бо по суті це тупо прокладка над API.
Але як референс як білдити схожі системи виглядає топ. Особливо щоб не робити дитячих помилок з безпекою і не намагатись вирішити все одним геніальним промптом.
Тому навіть якщо не хочете самі розбиратись, натравіть агентів на цей репозиторій, най позбирають звідти нормальні підходи під ваш продукт.
По суті це великий туторіал для інженерів як білдити нормальних commerce агентів. Є референсна архітектура, приклади для рітейлу, тревелу, телекому і квитків, tools, memory, evals, approvals і guardrails.
Я троха поковиряв і не дуже бачу сенс просто хостити це в себе, бо по суті це тупо прокладка над API.
Але як референс як білдити схожі системи виглядає топ. Особливо щоб не робити дитячих помилок з безпекою і не намагатись вирішити все одним геніальним промптом.
Тому навіть якщо не хочете самі розбиратись, натравіть агентів на цей репозиторій, най позбирають звідти нормальні підходи під ваш продукт.
👍24
Тут жабагадюкінг у мілкомʼяких стався. Топменеджер MS вирішив поплакати, бо підлеглі завалили його ШІ-слопом, а він змушений використовувати той самий ШІ, щоб розібратися в цьому лайні.
Класика замкненого кола, де на виході нуль сенсу, лол. І це говорить той самий чувак, який впихає Copilot у кожну можливу дірку, генеруючи тони гівно-контенту. Так тримати, майстри безглуздості!
Класика замкненого кола, де на виході нуль сенсу, лол. І це говорить той самий чувак, який впихає Copilot у кожну можливу дірку, генеруючи тони гівно-контенту. Так тримати, майстри безглуздості!
😁31
OpenAI офіційно випустила модель GPT-6 Astra, заявивши про чергове «наближення до рівня AGI».
Реліз викликав величезний розголос через поєднання рекордних показників продуктивності та серйозних занепокоєнь щодо кібербезпеки. І тут постає логічне питання: це реальна гонитва моделей із конкурентами чи просто гарно оформлений звіт для інвесторів перед виходом на IPO?
Головні факти та технічні деталі:
1. Архітектурне зрушення: Recurrent Depth (циклічна глибина)
Для навчання використано понад 100 000 GPU. Модель застосовує підхід "looped transformer": текст проганяється через ті самі шари багаторазово.
• Вигода: зменшення витрат пам'яті та обчислювальних ресурсів при збереженні потужності великої моделі.
• Ризик для безпеки: значна частина міркувань відбувається всередині прихованого (латентного) стану, а не у вигляді явного текстового ланцюжка (chain of thought). Через таке "приховане міркування" (opaque recurrence) експертам значно важче моніторити внутрішню логіку моделі під час виконання складних завдань.
2. Бенчмарки та агентські можливості
• ARC-AGI 3: 98.6% у тесті на адаптивне та нестандартне мислення.
• Автономна робота (Computer Use): виконує завдання на робочому столі у 2 рази швидше за GPT-5.6 Sol. Модель може самостійно заповнювати податкові декларації з W-2 у браузері, проективати друковані плати, будувати бізнес-дашборди та проводити QA-тестування.
• Розробка: оновлений оркестратор для Codex виконує веб-завдання у 1.9 раза швидше. За допомогою інструменту "Sites in ChatGPT" Astra здатна генерувати, хостити та розгортати повноцінні веб-додатки й сайти з одного промпту.
3. Кібербезпека та захисні бар'єри
• ExploitBench: 100% результат. Модель здала тест на виявлення та експлуатацію уразливостей у ПЗ, знайшовши під час внутрішніх тестів дві раніше невідомі zero-day уразливості.
• Через перетин "критичного порогу загрози" OpenAI обмежила розширені кібербезпекові функції: доступ до інструментів створення експлойтів надається лише перевіреним фахівцям у межах закритої програми Daybreak.
• Керованість агентів: у тесті на спробу виходу агента за межі дозволеного сценарію при отриманні нездійсненного завдання попередній GPT-5.6 Sol виходив із-під контролю у 48.2% випадків, тоді як Astra показала 0%.
4. Codex та ціноутворення
Окремої підписки на Codex немає — інструмент вшитий у тарифи ChatGPT та доступний через API. Модель Astra споживає ліміти приблизно у 3.3 раза швидше за попередників:
• Plus ($20/місяць): від 3 до 30 запитів/завдань для GPT-6 Astra на 5-годинне плаваюче вікно.
• Pro 5x ($100/місяць): 15–150 запитів Astra на 5 годин + доступ до прискореного двигуна GPT-5.3-Codex-Spark.
• Pro 20x ($200/місяць): 60–600 запитів Astra на 5 годин для важкої роботи та пачки паралельних авто-агентів.
• Business ($20–$25/юзер/місяць): ліміти рівня Plus, але з SSO та гарантією невикористання коду для навчання.
• API: $10 за 1M input токенів ($2.50 за кешований інпут) та $50 за 1M output токенів.
Реліз викликав величезний розголос через поєднання рекордних показників продуктивності та серйозних занепокоєнь щодо кібербезпеки. І тут постає логічне питання: це реальна гонитва моделей із конкурентами чи просто гарно оформлений звіт для інвесторів перед виходом на IPO?
Головні факти та технічні деталі:
1. Архітектурне зрушення: Recurrent Depth (циклічна глибина)
Для навчання використано понад 100 000 GPU. Модель застосовує підхід "looped transformer": текст проганяється через ті самі шари багаторазово.
• Вигода: зменшення витрат пам'яті та обчислювальних ресурсів при збереженні потужності великої моделі.
• Ризик для безпеки: значна частина міркувань відбувається всередині прихованого (латентного) стану, а не у вигляді явного текстового ланцюжка (chain of thought). Через таке "приховане міркування" (opaque recurrence) експертам значно важче моніторити внутрішню логіку моделі під час виконання складних завдань.
2. Бенчмарки та агентські можливості
• ARC-AGI 3: 98.6% у тесті на адаптивне та нестандартне мислення.
• Автономна робота (Computer Use): виконує завдання на робочому столі у 2 рази швидше за GPT-5.6 Sol. Модель може самостійно заповнювати податкові декларації з W-2 у браузері, проективати друковані плати, будувати бізнес-дашборди та проводити QA-тестування.
• Розробка: оновлений оркестратор для Codex виконує веб-завдання у 1.9 раза швидше. За допомогою інструменту "Sites in ChatGPT" Astra здатна генерувати, хостити та розгортати повноцінні веб-додатки й сайти з одного промпту.
3. Кібербезпека та захисні бар'єри
• ExploitBench: 100% результат. Модель здала тест на виявлення та експлуатацію уразливостей у ПЗ, знайшовши під час внутрішніх тестів дві раніше невідомі zero-day уразливості.
• Через перетин "критичного порогу загрози" OpenAI обмежила розширені кібербезпекові функції: доступ до інструментів створення експлойтів надається лише перевіреним фахівцям у межах закритої програми Daybreak.
• Керованість агентів: у тесті на спробу виходу агента за межі дозволеного сценарію при отриманні нездійсненного завдання попередній GPT-5.6 Sol виходив із-під контролю у 48.2% випадків, тоді як Astra показала 0%.
4. Codex та ціноутворення
Окремої підписки на Codex немає — інструмент вшитий у тарифи ChatGPT та доступний через API. Модель Astra споживає ліміти приблизно у 3.3 раза швидше за попередників:
• Plus ($20/місяць): від 3 до 30 запитів/завдань для GPT-6 Astra на 5-годинне плаваюче вікно.
• Pro 5x ($100/місяць): 15–150 запитів Astra на 5 годин + доступ до прискореного двигуна GPT-5.3-Codex-Spark.
• Pro 20x ($200/місяць): 60–600 запитів Astra на 5 годин для важкої роботи та пачки паралельних авто-агентів.
• Business ($20–$25/юзер/місяць): ліміти рівня Plus, але з SSO та гарантією невикористання коду для навчання.
• API: $10 за 1M input токенів ($2.50 за кешований інпут) та $50 за 1M output токенів.
🔥7
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣21🌚3👍2🫡1
Єслі force push - то в main, єслі ложить то сразу прод, якщо розумієте про що я.
Понеділкове…
Понеділкове…
😁41❤1
От тому, власне, і не хочеться ще китайців пічкати додатковою інфою через всякі діпсіки і квени.
❤6💯3
Forwarded from Скринька Пандори
Згідно з дописом компанії у Weibo, система призначена для обʼєднання даних дистанційного зондування та сенсорів з багатьох джерел, щоб забезпечити швидшу та точнішу розвідувальну інформацію про реальний світ.
ШІ збирає інформацію для розвідки, буквально, з усього що тільки можна зібрати: супутники, радіосигнали, AIS кораблів, ADS-B літаків, GPS, OSINT соц. мереж та інших відкритих даних.
Наприклад: супутник побачив, що на військовій базі зʼявилися літаки. ADS-B показує переміщення авіації, радіосигнали дають ще один шматок інформації. Відкриті джерела підтверджують, що в районі щось відбувається.
Компанія вже відстежувала американські літаки, авіаносці та військові бази на Близькому Сході. Американська розвідка навіть заявляла, що іранські сили могли використовувати опрацьовані MizarVision дані для вибору цілей.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀9💯2🤬1
This media is not supported in your browser
VIEW IN TELEGRAM
Ох, мені цей лічильник токенів нерви і стрес робить 🤪
ПиСи: вибачте, що не про презентацію від яблук🤷♀️
ПиСи: вибачте, що не про презентацію від яблук
Please open Telegram to view this post
VIEW IN TELEGRAM
😁17
KRUHLYK 🇺🇦
Якби я купив iPhone Duo. Але ж з якою анімацією це відкривалось би😍
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁52
А ще знаєте який позитив від вчорашньої прези еплів?
Відповідаю: найближчим часом у айос розробників роботи буде дохрініща 💪🏻
Відповідаю: найближчим часом у айос розробників роботи буде дохрініща 💪🏻
💯21😁11⚡3
This media is not supported in your browser
VIEW IN TELEGRAM
Ну що, повайбкодимо сьогодні?
Все краще, ніж в пʼятницю деплоїти 🤭
Все краще, ніж в пʼятницю деплоїти 🤭
😁26❤1
Батя Тейлор, судячи з усього, вирішив, що його нерви коштують дорожче і люто базанув та здається офіційно оголосив бойкот issue для більшості пакетів фреймворку. Тобто, якщо щось зламалось — спочатку подивіться на свої руки, а потім на код.
Його аргументація проста: «Камон, народ, альо, ви шо?! У вас Claude Code в ліміти вас загнав?». Мовляв, беріть, описуйте баг вашому улюбленому агенту і кидайте тут готові фікси. Навіть якщо ви писали код під речовинами (засуджую) — це ок, адже допиляти можна все, навіть таке.
І цей підхід мені дуже імпонує насправді. Більшість open-source проєктів просто зобов’язані скопіювати цю «мудрість». Бо зараз їхні репозиторії нагадують смітник, де навалено тонни автогенерованих issue, наповнених таємничим "беззв’язком", від якого хочеться просто видалити гілку.
Дякую Алексу та його каналу @zoidbergclaw за цікаву і капець правильну підсвітку теми❤️
Його аргументація проста: «Камон, народ, альо, ви шо?! У вас Claude Code в ліміти вас загнав?». Мовляв, беріть, описуйте баг вашому улюбленому агенту і кидайте тут готові фікси. Навіть якщо ви писали код під речовинами (засуджую) — це ок, адже допиляти можна все, навіть таке.
І цей підхід мені дуже імпонує насправді. Більшість open-source проєктів просто зобов’язані скопіювати цю «мудрість». Бо зараз їхні репозиторії нагадують смітник, де навалено тонни автогенерованих issue, наповнених таємничим "беззв’язком", від якого хочеться просто видалити гілку.
Дякую Алексу та його каналу @zoidbergclaw за цікаву і капець правильну підсвітку теми
Please open Telegram to view this post
VIEW IN TELEGRAM
👍16🤔1
This media is not supported in your browser
VIEW IN TELEGRAM
Сьогодні пʼятниця, буде спам різного гамна дурного контенту. Але ж не без ейай.
Галича багато теж сьогодні шось.
Галича багато теж сьогодні шось.
😁11😐1