Codex-агент самозапустился и нажёг $78 000
10 июля пользователь запустил из VS Code обычный запрос — «проверь UX/UI одного модуля» — на GPT-5.5/Medium. Задача породила 826 дочерних записей уже как GPT-5.6 Sol/Ultra: это не 826 сообщений в одном чате, а 826 отдельных задач со своими ID. Заголовки уехали из UX/UI в бэкенд, OAuth, аудит и релиз.
💸 162 оплаченных счёта на $79 664,88 — восстановленная история биллинга
🧾 у 104 задач нет роли агента, у них ~147,9 млрд локальных токен-счётчиков
📉 на альфа-билде 0.144.0-alpha.4 — 264,3 млн токенов на задачу против 31,0 млн на 0.144.2
Что это даёт тебе: серверный леджер и правда только у вендора — со своей стороны ты видишь малую часть. Ставим потолок расхода на СЕССИЮ, а не на аккаунт.
Честно: отчёт одного пользователя, OpenAI не комментировала, локальные счётчики — не биллинг.
Первоисточник: https://news.ycombinator.com/item?id=49861047
У тебя на агенте есть потолок расхода — или узнаешь из счёта? — t.me/commit_ai 💸
10 июля пользователь запустил из VS Code обычный запрос — «проверь UX/UI одного модуля» — на GPT-5.5/Medium. Задача породила 826 дочерних записей уже как GPT-5.6 Sol/Ultra: это не 826 сообщений в одном чате, а 826 отдельных задач со своими ID. Заголовки уехали из UX/UI в бэкенд, OAuth, аудит и релиз.
💸 162 оплаченных счёта на $79 664,88 — восстановленная история биллинга
🧾 у 104 задач нет роли агента, у них ~147,9 млрд локальных токен-счётчиков
📉 на альфа-билде 0.144.0-alpha.4 — 264,3 млн токенов на задачу против 31,0 млн на 0.144.2
Что это даёт тебе: серверный леджер и правда только у вендора — со своей стороны ты видишь малую часть. Ставим потолок расхода на СЕССИЮ, а не на аккаунт.
Честно: отчёт одного пользователя, OpenAI не комментировала, локальные счётчики — не биллинг.
Первоисточник: https://news.ycombinator.com/item?id=49861047
У тебя на агенте есть потолок расхода — или узнаешь из счёта? — t.me/commit_ai 💸
Kimi K3 на чипах Google обогнал Nvidia на 57%
Команда vLLM выложила под Apache-2.0 мегакернелы для TPU v7: весь шаг декода — внимание, MoE, нормализацию и обмены между чипами — крутит один кернел вместо сотен мелких: веса следующего слоя подтягиваются в кэш, пока считается текущий.
• ⚡ 16× TPU v7: 709 токенов/с против 452 на 16× GB200 (×1,57)
• 📊 Qwen3.8-27B на 4× TPU: 1 515 против 695 (×2,18)
• ⏱ компиляция ~90 с против 30+ минут у XLA
• 🎯 точность не просела: GPQA 0,944, GSM8K 0,972
Что это даёт тебе: у самохостинга открытых моделей появилась вторая дорога — аренда TPU вместо GB200. В репо есть CPU-тесты (гоняются без железа) и OpenAI-совместимый сервер: поднимаешь на своей аллокации и меришь цену токена на своём трафике.
Честно: замеры авторские — бейзлайн это опубликованный рецепт vLLM, а не независимый прогон; нужны 4 ноды по 8 TPU и заранее скачанные веса, ядро заточено под топологию 2×2×4.
https://github.com/Inferact/tpu-megakernels
Перешли тому, кому пригодится — t.me/commit_ai 🤓
Команда vLLM выложила под Apache-2.0 мегакернелы для TPU v7: весь шаг декода — внимание, MoE, нормализацию и обмены между чипами — крутит один кернел вместо сотен мелких: веса следующего слоя подтягиваются в кэш, пока считается текущий.
• ⚡ 16× TPU v7: 709 токенов/с против 452 на 16× GB200 (×1,57)
• 📊 Qwen3.8-27B на 4× TPU: 1 515 против 695 (×2,18)
• ⏱ компиляция ~90 с против 30+ минут у XLA
• 🎯 точность не просела: GPQA 0,944, GSM8K 0,972
Что это даёт тебе: у самохостинга открытых моделей появилась вторая дорога — аренда TPU вместо GB200. В репо есть CPU-тесты (гоняются без железа) и OpenAI-совместимый сервер: поднимаешь на своей аллокации и меришь цену токена на своём трафике.
Честно: замеры авторские — бейзлайн это опубликованный рецепт vLLM, а не независимый прогон; нужны 4 ноды по 8 TPU и заранее скачанные веса, ядро заточено под топологию 2×2×4.
https://github.com/Inferact/tpu-megakernels
Перешли тому, кому пригодится — t.me/commit_ai 🤓
Claude за $100 побил рекорд физиков
Anthropic: модель Fable 5.1 в обвязке Claude Science посчитала рассеяние частиц в игрушечной теории до девяти петель — прошлый рекорд людей был восемь (SLAC, 2023). Проверил результат автор того рекорда Лэнс Диксон.
• 📝 промпт — одна строка: «посчитай на девять петель». Дальше только «я спать, работай, пока не скажу стоп, отчёт каждые 4–6 часов»
• 💸 расчёты — ~$100 (это 96 ядер на неделю); весь прогон — $1–2 тыс., почти всё — время модели, а не CPU
• 🔁 две независимые схемы решения сошлись
Что это даёт тебе: рецепт длинной агентской задачи — одна задача, уходишь, отчёт раз в 4–6 часов. Так же гоняются многочасовые прогоны: аудит репо, обход миграции.
Честно: теория игрушечная, для проверки методов, не новая физика; $1–2 тыс. — оценка для пользователя, а не счёт Anthropic.
https://www.anthropic.com/research/yes-claude-can-do-nine-loops
Оставил бы агенту расчёт на неделю без присмотра? — t.me/commit_ai 🧮
Anthropic: модель Fable 5.1 в обвязке Claude Science посчитала рассеяние частиц в игрушечной теории до девяти петель — прошлый рекорд людей был восемь (SLAC, 2023). Проверил результат автор того рекорда Лэнс Диксон.
• 📝 промпт — одна строка: «посчитай на девять петель». Дальше только «я спать, работай, пока не скажу стоп, отчёт каждые 4–6 часов»
• 💸 расчёты — ~$100 (это 96 ядер на неделю); весь прогон — $1–2 тыс., почти всё — время модели, а не CPU
• 🔁 две независимые схемы решения сошлись
Что это даёт тебе: рецепт длинной агентской задачи — одна задача, уходишь, отчёт раз в 4–6 часов. Так же гоняются многочасовые прогоны: аудит репо, обход миграции.
Честно: теория игрушечная, для проверки методов, не новая физика; $1–2 тыс. — оценка для пользователя, а не счёт Anthropic.
https://www.anthropic.com/research/yes-claude-can-do-nine-loops
Оставил бы агенту расчёт на неделю без присмотра? — t.me/commit_ai 🧮
349 агентских скиллов ссылаются на чужие домены
Manifold Security проверила домены-заглушки yoursite.com и your-domain.com: они встречаются в 359 000 файлов на GitHub и упомянуты в 349 скиллах для агентов. От example.com они отличаются одним: тот зарезервирован IANA, а эти может купить кто угодно — тогда ссылка в доках сама поведёт в другое место, код менять не нужно.
Что это даёт тебе: аудит скиллов, MCP-конфигов и доков — заглушки меняем на example.com.
⚠️ В 24 живых сессиях браузера две привели на скам: поддельный «MacOS Security Center» с четырьмя «вирусами» и продлением McAfee за 55%. Все 13 доменов прошли статические проверки — RDAP, блоклисты и 52 запроса с разными User-Agent.
⚠️ Скам показывался только macOS: 8 рендеров на Windows и Linux чистые. 23 сентября тот же Manifold показал: third-party.com из доков Chromium и Vercel отдаёт ClickFix — вставку PowerShell-команды в буфер обмена.
Источник: https://hackread.com/placeholder-domains-ai-agent-skills-redirect-scams
t.me/commit_ai
Manifold Security проверила домены-заглушки yoursite.com и your-domain.com: они встречаются в 359 000 файлов на GitHub и упомянуты в 349 скиллах для агентов. От example.com они отличаются одним: тот зарезервирован IANA, а эти может купить кто угодно — тогда ссылка в доках сама поведёт в другое место, код менять не нужно.
Что это даёт тебе: аудит скиллов, MCP-конфигов и доков — заглушки меняем на example.com.
⚠️ В 24 живых сессиях браузера две привели на скам: поддельный «MacOS Security Center» с четырьмя «вирусами» и продлением McAfee за 55%. Все 13 доменов прошли статические проверки — RDAP, блоклисты и 52 запроса с разными User-Agent.
⚠️ Скам показывался только macOS: 8 рендеров на Windows и Linux чистые. 23 сентября тот же Manifold показал: third-party.com из доков Chromium и Vercel отдаёт ClickFix — вставку PowerShell-команды в буфер обмена.
Источник: https://hackread.com/placeholder-domains-ai-agent-skills-redirect-scams
t.me/commit_ai
Роботов учат на видео людей: 100 тысяч часов движений
Light Origins выложила Light-O1: движения робот берёт не из своих демо, а из интернет-видео — 3D-скелет достают прямо из роликов, потом адаптируют под железо.
• шесть версий одной 4B-базы: от 3,75 до 120 млрд токенов, старшая — 100 тысяч часов действий
• ошибка предсказания падает по степенному закону: больше претрейна — лучше старт
• веса Apache 2.0, код и playground:
• демо: открыл обувной шкаф, собрал мусор, передал полотенце — и на Unitree G1
https://www.lightorigins.com/en/blog/light-o1
Что это даёт тебе: свои демонстрации на роботе не нужны — берёшь готовый «человеческий» приор и доадаптируешь. Приём работает и вне роботов: массовые записи действий + адаптация.
Честно: цифры вендорские, для роботов данные целевые, скейлинг мерили предсказанием позы, не успехом задач.
Начнёшь с открытых весов или подождёшь коробочную версию?
Перешли тому, кому пригодится — t.me/commit_ai 🤖
Light Origins выложила Light-O1: движения робот берёт не из своих демо, а из интернет-видео — 3D-скелет достают прямо из роликов, потом адаптируют под железо.
• шесть версий одной 4B-базы: от 3,75 до 120 млрд токенов, старшая — 100 тысяч часов действий
• ошибка предсказания падает по степенному закону: больше претрейна — лучше старт
• веса Apache 2.0, код и playground:
hf download LightOriginsHQ/Light-O1-Preview• демо: открыл обувной шкаф, собрал мусор, передал полотенце — и на Unitree G1
https://www.lightorigins.com/en/blog/light-o1
Что это даёт тебе: свои демонстрации на роботе не нужны — берёшь готовый «человеческий» приор и доадаптируешь. Приём работает и вне роботов: массовые записи действий + адаптация.
Честно: цифры вендорские, для роботов данные целевые, скейлинг мерили предсказанием позы, не успехом задач.
Начнёшь с открытых весов или подождёшь коробочную версию?
Перешли тому, кому пригодится — t.me/commit_ai 🤖
Гайд #4. Buzz собрал 34 980 звёзд: агент — участник с ключом
Block выложила под Apache 2.0 Buzz — среду, где человек и ИИ-агент сидят в одних комнатах. Под капотом не чат, а журнал на Nostr: сообщение, реакция, шаг воркфлоу, одобрение ревью и git-событие — подписанные записи в одном логе.
• 🔑 У агента свой ключ: права выдаёт идентичность, а не флаг «разрешить всё»
• 🛠 Он открывает репы, присылает патчи, ревьюит код, гоняет воркфлоу
• 📦 Релей у тебя — один Rust-бинарник (WS + REST + UI), зависимостей три: Postgres, Redis, S3
🧰 Поднять: git clone github.com/block/buzz → cd deploy/compose → ./run.sh start; ключи генерит buzz-admin, живость — curl 127.0.0.1:3000/_liveness
⚠️ Ловушка: в RELAY_URL пиши 127.0.0.1, а не localhost — иначе авторизация отдаёт 401
Честно: 3 664 открытых issue, мобильных клиентов и push пока нет.
Что это даёт тебе: журнал агента живёт вне вендорской консоли — видно, кто подписал каждое действие.
Перешли тому, кому пригодится — t.me/commit_ai 🤓
Block выложила под Apache 2.0 Buzz — среду, где человек и ИИ-агент сидят в одних комнатах. Под капотом не чат, а журнал на Nostr: сообщение, реакция, шаг воркфлоу, одобрение ревью и git-событие — подписанные записи в одном логе.
• 🔑 У агента свой ключ: права выдаёт идентичность, а не флаг «разрешить всё»
• 🛠 Он открывает репы, присылает патчи, ревьюит код, гоняет воркфлоу
• 📦 Релей у тебя — один Rust-бинарник (WS + REST + UI), зависимостей три: Postgres, Redis, S3
🧰 Поднять: git clone github.com/block/buzz → cd deploy/compose → ./run.sh start; ключи генерит buzz-admin, живость — curl 127.0.0.1:3000/_liveness
⚠️ Ловушка: в RELAY_URL пиши 127.0.0.1, а не localhost — иначе авторизация отдаёт 401
Честно: 3 664 открытых issue, мобильных клиентов и push пока нет.
Что это даёт тебе: журнал агента живёт вне вендорской консоли — видно, кто подписал каждое действие.
Перешли тому, кому пригодится — t.me/commit_ai 🤓