Forwarded from Oleg Puzanov
codex_system_prompt.md
23 KB
Сегдоня немного прилег codex. Пока трейсил его чтоб понять в чем проблема заметил что с их сервера приходит системный промпт. Расшифровал его и можно глянуть как они описывают персону, поведение, как тулы вызывают. Возможно кому пригодиться кто своих агентов пилит.
❤6👍2
Amazon собрала инженеров на обязательный разбор серии инцидентов. Внутренний документ описывает волну крупных сбоев, вызванных правками через GenAI. Официальная позиция — «part of normal business».
Четыре Sev-1 за одну неделю. 5 марта сайт и приложение Amazon лежали ~6 часов — оформление заказов не работало, цены не показывались. В декабре Kiro (kiro.dev), которому поручили внести правки в AWS Cost Explorer, решил снести и пересоздать окружение целиком. Восстановление заняло 13 часов. Amazon назвал это «extremely limited event» — сервис при этом обслуживал клиентов в материковом Китае.
Джунам и миддлам теперь нужен аппрув синьора на любые правки, сделанные с помощью AI. Эти ограничения вводят поверх системы, в которой уже крутятся 21 000 AI-агентов в розничном подразделении. Amazon заявляет $2B экономии и рост скорости разработки в 4.5 раза. И с такими цифрами в отчётах фарш назад не провернуть.
Отдельный кек: пункт про GenAI из документа удалили до начала встречи. После публикации FT представитель Amazon заявил, что только один сбой связан с AI и ни один не вызван кодом, который AI написал.
James Gosling, ушедший из AWS в 2024, ещё тогда описывал ту же картину — команды, не приносящие прямой доход, расформировали ради AI-повестки. Corey Quinn из Duckbill сформулировал точнее: AWS предпочтёт, чтобы мир считал их инженеров некомпетентными, чем признает, что ошибку допустил AI.
https://fixupx.com/lukolejnik/status/2031257644724342957?s=46
https://www.cnbc.com/2026/03/10/amazon-plans-deep-dive-internal-meeting-address-ai-related-outages.html
Четыре Sev-1 за одну неделю. 5 марта сайт и приложение Amazon лежали ~6 часов — оформление заказов не работало, цены не показывались. В декабре Kiro (kiro.dev), которому поручили внести правки в AWS Cost Explorer, решил снести и пересоздать окружение целиком. Восстановление заняло 13 часов. Amazon назвал это «extremely limited event» — сервис при этом обслуживал клиентов в материковом Китае.
Джунам и миддлам теперь нужен аппрув синьора на любые правки, сделанные с помощью AI. Эти ограничения вводят поверх системы, в которой уже крутятся 21 000 AI-агентов в розничном подразделении. Amazon заявляет $2B экономии и рост скорости разработки в 4.5 раза. И с такими цифрами в отчётах фарш назад не провернуть.
Отдельный кек: пункт про GenAI из документа удалили до начала встречи. После публикации FT представитель Amazon заявил, что только один сбой связан с AI и ни один не вызван кодом, который AI написал.
CNBC: An internal document originally said generative AI-assisted production changes were partly to blame for the issues, but the reference to GenAI was subsequently deleted.
James Gosling, ушедший из AWS в 2024, ещё тогда описывал ту же картину — команды, не приносящие прямой доход, расформировали ради AI-повестки. Corey Quinn из Duckbill сформулировал точнее: AWS предпочтёт, чтобы мир считал их инженеров некомпетентными, чем признает, что ошибку допустил AI.
https://fixupx.com/lukolejnik/status/2031257644724342957?s=46
https://www.cnbc.com/2026/03/10/amazon-plans-deep-dive-internal-meeting-address-ai-related-outages.html
❤2🤯1
В Claude Code появилась команда
Новая команда поднимает persistent-сервер. До 32 параллельных сессий на одной машине. Зашёл в claude.ai/code с телефона, создал сессию — она стартует локально, с доступом к файлам, MCP-серверам,
Мак с запущенным
claude remote-control. Не слеш-команда /remote-control, которая была и раньше. Та пробрасывала одну конкретную сессию на телефон.Новая команда поднимает persistent-сервер. До 32 параллельных сессий на одной машине. Зашёл в claude.ai/code с телефона, создал сессию — она стартует локально, с доступом к файлам, MCP-серверам,
CLAUDE.md. --spawn=worktree разносит сессии по отдельным git worktree, --spawn=same-dir держит всё в одной директории. Переключение между режимами — клавиша w на лету.Мак с запущенным
claude remote-control фактически становится headless-сервером. Одной командой закрыли сценарий, под который люди городили Tailscale + tmux + Termius и отчасти из-за которого набирал популярность OpenClaw.🔥8
Forwarded from Tips AI | IT & AI
Оказывается у Anthropic есть экзамен — Claude Certified Architect
Узнал про неё из статьи, где парень набрал 985/1000
Cдать его могут только партнёры Anthropic. Зато все учебные материалы в открытом доступе:
30 практических задач, сценарии, упражнения на сборку.
Комьюнити уже собрало бесплатный гайд с промптами для подготовки по каждому направлению.
> claudecertificationguide.com
Практические уроки, тренировочные вопросы и упражнения по разработке, всё что нужно.
Просто без сертификата в конце🪙
@tips_ai #news
Узнал про неё из статьи, где парень набрал 985/1000
Cдать его могут только партнёры Anthropic. Зато все учебные материалы в открытом доступе:
• Агентная архитектура: мультиагентные системы, оркестрация
• Tool Design и MCP: подключение внешних сервисов
• Настройка Claude Code: конфиги, хуки, воркфлоу
• Промпт-инжиниринг: system prompts, цепочки, few-shot
• Управление контекстом: стратегии работы с контекстным окном
30 практических задач, сценарии, упражнения на сборку.
Комьюнити уже собрало бесплатный гайд с промптами для подготовки по каждому направлению.
> claudecertificationguide.com
Практические уроки, тренировочные вопросы и упражнения по разработке, всё что нужно.
Просто без сертификата в конце
@tips_ai #news
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤10🔥5👍3
https://github.com/max-prtsr/claude-ru-gaming
Фразы про кабанчика подзаебали, решил сделать из игр.
PR приветствуются!
Фразы про кабанчика подзаебали, решил сделать из игр.
PR приветствуются!
❤3🔥1
https://rjcorwin.github.io/cook/
Еще один ральф-луп. И DX отличный - сходу понятно куда тыкать
Опции:
- луп над одной задачей пока не Done
- работа над одной задачей в нескольких воркспейсах вариациями и потом выбор где пизже получилось
- ральф-луп который берет задачи из списка
Для простых вещей выглядит клево
Еще один ральф-луп. И DX отличный - сходу понятно куда тыкать
Опции:
- луп над одной задачей пока не Done
- работа над одной задачей в нескольких воркспейсах вариациями и потом выбор где пизже получилось
- ральф-луп который берет задачи из списка
Для простых вещей выглядит клево
👍6
https://code.claude.com/docs/en/channels
Дождались. Anthropic выкатили Claude Code Channels — research preview, который добавляет новый транспорт в сессию Claude Code. Щас доступны Telegram и Discord через официальные плагины из claude-plugins-official.
Для теста ставим
и идем на http://localhost:8787/ тестить.
Нужен v2.1.80+, Bun runtime, авторизация через claude.ai (API-ключи не работают).
Ответ на OpenClaw очевиден. Anthropic взяли самый востребованный паттерн — асинхронное общение с агентом через мессенджер — и встроили нативно. Разница в подходе в том что события приходят только пока сессия открыта. Для постоянной работы нужен фоновый процесс или
Дождались. Anthropic выкатили Claude Code Channels — research preview, который добавляет новый транспорт в сессию Claude Code. Щас доступны Telegram и Discord через официальные плагины из claude-plugins-official.
Для теста ставим
fakechat@claude-plugins-official из офплагинов, запускаемclaude --channels plugin:fakechat@claude-plugins-official
и идем на http://localhost:8787/ тестить.
Нужен v2.1.80+, Bun runtime, авторизация через claude.ai (API-ключи не работают).
Ответ на OpenClaw очевиден. Anthropic взяли самый востребованный паттерн — асинхронное общение с агентом через мессенджер — и встроили нативно. Разница в подходе в том что события приходят только пока сессия открыта. Для постоянной работы нужен фоновый процесс или
tmux/screen.👍1
а еще на мак игори завезли
TLDR 1440р medium около 60fps через кроссовер
https://www.youtube.com/watch?v=BIFQ3v-dk70
TLDR 1440р medium около 60fps через кроссовер
https://www.youtube.com/watch?v=BIFQ3v-dk70
YouTube
Gaming on the M5 Pro MacBook Pro is AMAZING! 12 games tested
UGREEN NAS on Official Store(20% off, 3/25-4/5): https://nas.us.ugreen.com/fNIe5Z
UGREEN NAS DH4300 Plus(20% off, 3/25-4/5): https://amzn.to/3NEPSP6
Buy on Amazon (20% off, 3/25-4/5): https://amzn.to/4sU2UaC
#UGREENNAS #UGREEN
CrossOver - Windows gaming…
UGREEN NAS DH4300 Plus(20% off, 3/25-4/5): https://amzn.to/3NEPSP6
Buy on Amazon (20% off, 3/25-4/5): https://amzn.to/4sU2UaC
#UGREENNAS #UGREEN
CrossOver - Windows gaming…
https://mimo.xiaomi.com/mimo-v2-pro
Xiaomi выкатили MiMo-V2-Pro — флагманскую модель на 1T параметров (42B активных). Hybrid Attention с соотношением 7:1, контекст до 1M токенов, Multi-Token Prediction для быстрой генерации.
Неделю назад модель анонимно залили на OpenRouter под кодовым именем Hunter Alpha. За неделю она несколько дней подряд возглавляла дневной чарт по количеству вызовов и набрала больше 1T токенов суммарно.
По бенчмаркам — кодинг выше Claude 4.6 Sonnet, агентские задачи (ClawEval 61.5) приближаются к Opus 4.6. На PinchBench — 81.0, третье место глобально после Opus и MiMo-V2-Omni. Основной трафик во время теста шёл от инструментов для разработки.
Цены API: $1/$3 за миллион токенов input/output (до 256K контекста). Для сравнения — Sonnet 4.6 стоит $3/$15. Cache write пока бесплатен.
Самое главное - дают неделю бесплатного доступа в OpenClaw, OpenCode, KiloCode, Blackbox, and Cline, например через https://opencode.ai/docs/zen/#endpoints
Xiaomi выкатили MiMo-V2-Pro — флагманскую модель на 1T параметров (42B активных). Hybrid Attention с соотношением 7:1, контекст до 1M токенов, Multi-Token Prediction для быстрой генерации.
Неделю назад модель анонимно залили на OpenRouter под кодовым именем Hunter Alpha. За неделю она несколько дней подряд возглавляла дневной чарт по количеству вызовов и набрала больше 1T токенов суммарно.
По бенчмаркам — кодинг выше Claude 4.6 Sonnet, агентские задачи (ClawEval 61.5) приближаются к Opus 4.6. На PinchBench — 81.0, третье место глобально после Opus и MiMo-V2-Omni. Основной трафик во время теста шёл от инструментов для разработки.
Цены API: $1/$3 за миллион токенов input/output (до 256K контекста). Для сравнения — Sonnet 4.6 стоит $3/$15. Cache write пока бесплатен.
Самое главное - дают неделю бесплатного доступа в OpenClaw, OpenCode, KiloCode, Blackbox, and Cline, например через https://opencode.ai/docs/zen/#endpoints
🔥3
На Reddit всплыл тред про страницу в документации Anthropic, которую мало кто читал. Три инструкции для системного промпта, которые заметно снижают галлюцинации Claude.
Явно разрешить модели отвечать «I don't know». Без этого Claude заполняет пробелы в знаниях правдоподобной выдумкой.
Потребовать цитаты и источники на каждое утверждение. Если источника нет, модель должна отозвать утверждение.
При работе с длинными документами (>20K токенов) заставить модель сначала извлечь дословные цитаты из текста, а потом анализировать. Это убивает дрейф смысла при пересказе, когда модель незаметно сдвигает значение при суммаризации.
Есть нюанс. Статья arXiv 2307.02185 показала, что жёсткие требования к цитированию давят креативную генерацию. Рекомендуют два режима: режим исследования с тремя инструкциями для фактчекинга, обычный режим без них — для свободной генерации.
https://docs.anthropic.com/en/docs/test-and-evaluate/strengthen-guardrails/reduce-hallucinations
Явно разрешить модели отвечать «I don't know». Без этого Claude заполняет пробелы в знаниях правдоподобной выдумкой.
Потребовать цитаты и источники на каждое утверждение. Если источника нет, модель должна отозвать утверждение.
При работе с длинными документами (>20K токенов) заставить модель сначала извлечь дословные цитаты из текста, а потом анализировать. Это убивает дрейф смысла при пересказе, когда модель незаметно сдвигает значение при суммаризации.
Есть нюанс. Статья arXiv 2307.02185 показала, что жёсткие требования к цитированию давят креативную генерацию. Рекомендуют два режима: режим исследования с тремя инструкциями для фактчекинга, обычный режим без них — для свободной генерации.
https://docs.anthropic.com/en/docs/test-and-evaluate/strengthen-guardrails/reduce-hallucinations
Claude Platform Docs
Reduce hallucinations
Minimize hallucinations in Claude's outputs by allowing uncertainty, grounding responses in direct quotes, and verifying claims with citations.
👍10
Пацаны, а кто kilo code юзает? Чот он вроде как популярный но в моем пузыре не про него не слышно...
Судя по виду это форк opencode
UPD Claude вот чо написал про их cli
Kilo Code Cli — всё то же самое в (потому что форк), но сверху:
- кросс-девайсный sync состояния сессий Kilo
- managed кредитная система (Kilo Pass)
- AI Management Dashboard для трекинга adoption и ROI LinkedIn
- встроенный code review и деплой из IDE Kilo
- KiloClaw — hosted OpenClaw для автоматизации за пределами кода
PS в опенкоде кончился MIMOv2, в килокоде все еще есть
Судя по виду это форк opencode
UPD Claude вот чо написал про их cli
Kilo Code Cli — всё то же самое в (потому что форк), но сверху:
- кросс-девайсный sync состояния сессий Kilo
- managed кредитная система (Kilo Pass)
- AI Management Dashboard для трекинга adoption и ROI LinkedIn
- встроенный code review и деплой из IDE Kilo
- KiloClaw — hosted OpenClaw для автоматизации за пределами кода
PS в опенкоде кончился MIMOv2, в килокоде все еще есть
Max Syabro and a Slop Driven Development
https://www.alibabacloud.com/campaign/ai-scene-coding?referral_code=A92LL7 Алибаба выкатила свой кодплан Lite $10 и PRO $50 Заявлено - qwen3.5-plus - kimi-k2.5 - glm-5 - MiniMax-M2.5 Выглядит как идеальная подписка для агентов PS Ссылка реферальная, мне…
горшочек перестал варить совсем...
Алибаба убрали кодеплан за $10 и оставили только за $50....
https://www.alibabacloud.com/help/en/model-studio/coding-plan
Алибаба убрали кодеплан за $10 и оставили только за $50....
https://www.alibabacloud.com/help/en/model-studio/coding-plan
https://claude.com/blog/auto-mode
Это не
Короче это как морская свинка. И не свинка и не морская.
Что-то аппрувит, что-то нет.
https://code.claude.com/docs/en/permissions#configure-the-auto-mode-classifier
Но, если законфигурировать то типа да.
Но в чем тогда разница с обычным автоаппрувом?
В итоге я пока хз зачем это, может кто умный подскажет
UPD Видимо задается тут https://code.claude.com/docs/en/permissions#define-trusted-infrastructure
UPD2 поторопился только для TEAM, даже включение feature flag не работает
Это не
--dangerously-skip-permissions и не обычный режим а что-то междуКороче это как морская свинка. И не свинка и не морская.
Что-то аппрувит, что-то нет.
https://code.claude.com/docs/en/permissions#configure-the-auto-mode-classifier
Но, если законфигурировать то типа да.
Но в чем тогда разница с обычным автоаппрувом?
В итоге я пока хз зачем это, может кто умный подскажет
UPD Видимо задается тут https://code.claude.com/docs/en/permissions#define-trusted-infrastructure
UPD2 поторопился только для TEAM, даже включение feature flag не работает
https://videocardz.com/newz/intel-launches-arc-pro-b70-at-949-with-32gb-gddr6-memory
А чего не 64 сразу?
Price: ≈$1000
А чего не 64 сразу?
Price: ≈$1000