动察Beating AI News
3.14K subscribers
873 photos
2 videos
3.38K links
AI新闻信息流
Download Telegram
Meta一天内裁员700人:Reality Labs再遭重创,今年已累计裁逾千人

Meta 周三确认裁员约 700 人,波及 Reality Labs、Facebook、招聘、销售和全球运营等多个部门,部分员工将获得内部转岗机会。今年 1 月 Meta 已裁撤 Reality Labs 超 1000 个岗位(约占该部门 10%),两轮裁员集中冲击元宇宙团队,显示 Meta 正系统性将资源从元宇宙转向 AI。

Meta 发言人称各团队「定期进行重组或调整,以确保处于实现目标的最佳位置」。裁员消息与前一日披露的高管巨额期权激励计划形成鲜明对比。截至 2025 年底 Meta 约有 7.9 万名员工,2026 年资本开支指引为 1150 亿至 1350 亿美元,绝大部分用于 AI 基础设施。

信源:https://www.nytimes.com/2026/03/25/technology/meta-layoffs-ai-executives.html
OpenClaw v2026.3.24:Gateway新增OpenAI API兼容端点,微软Teams迁移官方SDK

开源 AI 助手 OpenClaw(龙虾)发布 v2026.3.24 版本。Gateway 新增 /v1/models/v1/embeddings 端点,并在 /v1/chat/completions/v1/responses 中支持转发显式模型指定参数,使用 OpenAI API 格式的第三方客户端和 RAG 应用可直接对接 OpenClaw Gateway。

微软 Teams 渠道迁移至官方 SDK,新增流式 1:1 回复、欢迎卡片与提示词建议、反馈机制、打字提示和原生 AI 标签,同时支持已发送消息的编辑和删除。其他主要更新:

1. 内置 Skills 新增一键安装引导,CLI 和控制面板在依赖缺失时自动提示安装
2. 新增 --container 参数,支持在 Docker 或 Podman 容器内执行 OpenClaw 命令
3. Agent /tools 改为展示当前实际可用工具,控制面板新增实时可用状态面板
4. Slack 交互回复恢复富文本格式,支持自动将尾部选项文本渲染为按钮或下拉菜单
5. Discord 支持 LLM 自动生成线程标题
6. Node.js 最低版本降至 22.14+,继续推荐 Node 24

安全修复方面,本版本封堵了 mediaUrl`/`fileUrl 别名绕过沙箱媒体目录限制的漏洞,并修复了 Gateway 重启后 Agent 会话可能无法正确恢复到对应 Telegram 话题或 Slack 线程的问题。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.3.24
1
奔驰把国产AI放进了迈巴赫:智谱联合清华为S级打造端侧多模态大模型

梅赛德斯-奔驰中国宣布,与清华大学、今年 1 月在港交所上市的 AI 大模型公司智谱联合开发的端侧多模态大模型将落地新一代迈巴赫 S 级及全新 S 级轿车。该模型部署于后排娱乐系统,融合自然语言处理与视觉、音频等多模态理解及生成能力,结合车内摄像头等感知硬件,在本地算力条件下完成推理。据智谱官方表述,奔驰由此成为首个在后排娱乐系统中应用多模态大模型的汽车品牌。

信源:https://mp.weixin.qq.com/s/uqtpVaRjyosw6T7e1qw_oA
给龙虾发条抖店链接就能出片:创作Agent 2.0接入Seedance 2.0

字节跳动云服务平台火山引擎发布营销视频生成工具创作 Agent 2.0,接入自研视频生成模型 Seedance 2.0,视频时长从短片段扩展至 60 秒,支持多语言口播,覆盖品牌广告、产品评测、卖点演绎、Vlog 等 6 类营销场景。画面一致性也有提升,可保持人脸稳定、商品细节不变形、文字清晰可读。

创作 Agent 2.0 同步上架火山引擎 AI Agent 平台 ArkClaw 的官方 Skill 库。用户向龙虾发送抖店商品链接,即可自动读取商品信息、生成创意分析与分镜脚本,在对话中直接输出营销短视频。

信源:https://mp.weixin.qq.com/s/CDgA_e7rNoqgfKHVwGTsFg
手机上也能用AI操作工作软件了:Claude移动端上线Figma、Canva等集成

Anthropic 宣布 Claude 的工具集成(connectors)现已扩展至移动端,iOS 和 Android 用户可在手机上的 Claude 对话中直接浏览 Figma 设计稿、创建 Canva 幻灯片、查看 Amplitude 数据看板。

Connectors 基于 MCP 协议连接第三方应用,目前已覆盖 Slack、Google Drive、Linear 等工具,部分 connector 支持交互模式,可在对话界面中渲染实时操作界面而非纯文本回复。用户需先在桌面端完成 connector 的添加和授权,移动端暂不支持新增或浏览 connector 目录。

信源:https://x.com/claudeai/status/2036850783526719610
谷歌发布Lyria 3 Pro:AI生成音乐从30秒延长到3分钟,登陆5个平台

谷歌发布音乐生成模型 Lyria 3 Pro,单曲时长从前代 Lyria 3 的 30 秒延长至 3 分钟,支持指定前奏、主歌、副歌、桥段等歌曲结构。模型同时登陆五个平台:

1. Gemini 应用(仅付费用户,免费用户仍可使用 Lyria 3)
2. Vertex AI(企业公共预览)
3. Google AI Studio 及 Gemini API(开发者可用)
4. Google Vids(面向 Workspace 用户本周起滚动上线)
5. ProducerAI(谷歌上月收购的协作音乐创作工具,全球免费和付费用户均可使用)

所有 Lyria 生成的音频均嵌入 SynthID 水印以标识 AI 生成内容。谷歌称训练数据来自「YouTube 和谷歌依据服务条款、合作协议及适用法律有权使用的素材」,模型不会模仿特定艺术家风格。同一周,Spotify 上线了 Artist Profile Protection 功能,要求发行方手动审批艺术家新上架内容,以对抗 AI 克隆假冒。

信源:https://blog.google/innovation-and-ai/technology/ai/lyria-3-pro/
美团开源LongCat-Next:3B参数统一视觉理解、生成与语音

美团龙猫团队开源 LongCat-Next,一个基于 MoE 架构、激活参数 3B 的原生多模态模型,在单一自回归框架下统一了文本、视觉理解、图像生成、语音理解和语音合成五种能力。模型及配套分词器以 MIT 许可证开源,权重已上线 HuggingFace。

LongCat-Next 的核心设计是 DiNA(离散原生自回归)范式:通过为每种模态设计配对的分词器和解码器,将视觉和音频信号转化为离散 token,与文本共享同一嵌入空间,用统一的 next-token prediction 完成所有任务。视觉侧的关键组件 dNaViT(离散原生分辨率 Vision Transformer)将图像特征提取为「视觉词」,支持动态分词和解码,在 28 倍压缩比下仍保持较强的图像生成质量,尤其在文字渲染方面表现突出。

在同等激活参数量级(A3B)的模型对比中,LongCat-Next 的主要基准表现:

1. 视觉理解:MMMU-Pro 60.3(Qwen3-Omni 57.0,GPT5-minimal 62.7),MathVista 83.1(Qwen3-Omni 75.9,GPT5-minimal 50.9),MathVision 64.7(领先所有对比模型),DocVQA 94.2
2. 图像生成:GenEval 84.44,LongText-EN 93.15(FLUX.1-dev 60.70,Emu-3.5 97.60)
3. 编程:SWE-Bench 43.0(Kimi-Linear-48B 32.8,Qwen3-Next-80B 37.6)
4. Agent 工具调用:Tau2-Retail 73.68(Qwen3-Next 57.3),Tau2-Telecom 62.06(Qwen3-Next 13.2)

在理解与生成统一模型的横向对比中,LongCat-Next 的 MMMU 得分 70.6 领先第二名 NEO-unify(68.9),大幅超过 BAGEL(55.3)和 Ovis-U1(51.1)等此前的统一模型方案。SWE-Bench 43.0 和 Tau2 系列工具调用基准的表现也说明,这一多模态统一架构并未牺牲纯文本和 Agent 能力。

信源:https://longcat.chat/longcat-next/intro
GitHub默认用你的代码训练AI:Copilot个人版用户4月24日起需主动关闭

GitHub 宣布更新 Copilot 数据使用政策,4 月 24 日起,Copilot Free、Pro 和 Pro+ 用户的交互数据将默认用于训练和改进 AI 模型,除非用户主动在设置中关闭。Copilot Business 和 Enterprise 用户不受影响。此前已选择退出数据收集的用户,偏好设置将被保留,无需重新操作。

GitHub 将收集的数据范围包括:

1. 用户接受或修改的代码输出
2. 发送给 Copilot 的输入和代码片段
3. 光标周围的代码上下文
4. 注释和文档
5. 文件名、仓库结构与导航模式
6. 与 Copilot 各功能(Chat、内联建议等)的交互记录
7. 用户对建议的评分反馈

虽然 GitHub 称不会使用私有仓库中「静态存储」的内容,但用户在使用 Copilot 时,私有仓库的代码会被实时处理,这部分交互数据同样可能被用于模型训练,除非用户选择退出。

数据可能与微软等关联公司共享,但不会提供给第三方 AI 模型供应商。GitHub 首席产品官 Mario Rodriguez 在博文中表示,此前已使用微软员工的交互数据训练模型,「在多种编程语言中看到了接受率的显著提升」,希望通过更广泛的真实开发数据进一步改善模型表现。用户可在 GitHub 设置的「Privacy」选项中关闭数据共享。

信源:https://github.blog/news-insights/company-news/updates-to-github-copilot-interaction-data-usage-policy/
Harvey三个月估值从80亿涨到110亿美元:10万律师已在用AI Agent做尽调

法律 AI 公司 Harvey 完成 2 亿美元新一轮融资,由新加坡主权基金 GIC 和 Sequoia 联合领投,估值从去年 12 月的 80 亿美元升至 110 亿美元。Sequoia 已连续领投 Harvey 三轮融资,合伙人 Pat Grady 称这在 Sequoia 历史上极为罕见。公司累计融资总额超过 10 亿美元。

Harvey 成立于 2022 年,由前律师 Winston Weinberg 和前谷歌 DeepMind 及 Meta 研究员 Gabe Pereyra 联合创立,产品覆盖合同分析、合规审查、尽职调查和诉讼支持。目前服务超过 10 万名律师和 1300 家机构,客户包括 AmLaw 100 中的多数律所以及 NBCUniversal、汇丰等企业。1 月年化营收达 1.9 亿美元,较去年 8 月的 1 亿美元接近翻倍。平台上运行着超过 2.5 万个定制 AI Agent。

信源:https://www.cnbc.com/2026/03/25/legal-ai-startup-harvey-raises-200-million-at-11-billion-valuation.html
JetBrains关停协作编程工具,押注Agent:「代码生成已不再是瓶颈」

JetBrains 发布 Central,为企业提供统一管理 AI 编程 Agent 的平台,覆盖权限管控与成本审计、云端 Agent 运行环境、以及跨仓库的代码知识共享三大能力。Central 不绑定自家工具,同时支持 Claude Agent、Codex、Gemini CLI 等外部 Agent 接入。配套产品包括浏览器端开发环境 Air(air.dev)和即将推出的人机协作工具 Air Team,早期体验计划预计今年第二季度以设计合作伙伴形式小范围开放。

同日,JetBrains 宣布关停实时协作编程工具 Code With Me。该工具在疫情期间需求见顶,之后持续下滑。2026.1 版本起从 IDE 中解绑为独立插件,公共中继基础设施将于 2027 年第一季度关闭。消息在开发者社区引发不满,有用户留言称「我们是两人远程团队,全天结对编程,这个功能消失对我们的工作流将是毁灭性打击」。

JetBrains Agent 平台负责人 Oleg Koverznev 表示「代码生成已经很廉价,不再是瓶颈」,真正的挑战是管理 Agent 驱动工作带来的运营和经济复杂性。据 JetBrains AI Pulse 调查(2026 年 1 月,1.1 万名开发者),90% 的受访者已在工作中使用 AI,22% 已使用 AI 编程 Agent,66% 的企业计划在 12 个月内部署 Agent,但仅 13% 将 AI 应用到了代码审查或发布管线等完整开发生命周期中。The Register 评论称 AI 浪潮让 JetBrains 传统 IDE 业务承压,一边关停人与人的协作工具,一边押注人与 Agent 的协作平台,转型意图明显。

信源:https://blog.jetbrains.com/blog/2026/03/24/introducing-jetbrains-central-an-open-system-for-agentic-software-development/
SK海力士申请赴美上市:拟募最高144亿美元,或为五年来最大美股IPO

韩国存储芯片巨头 SK 海力士已向美国证券监管机构提交秘密上市申请,目标在 2026 年下半年完成美股上市。知情人士透露,公司计划发行约 2%-3% 的总股份,按当前市值计算融资规模在 96 亿至 144 亿美元之间,有望成为五年来最大的美股上市交易,超过 2021 年韩国电商平台 Coupang 的 46 亿美元 IPO。

SK 海力士 CEO Kwak Noh-jung 在年度股东大会上表示,赴美上市是推动公司价值在全球最大股票市场获得重新评估的举措。募集资金将用于韩国龙仁和美国印第安纳州的芯片工厂建设。此举也与美国对非在美投资的芯片厂商施加关税压力的背景相关,美国商务部长 Howard Lutnick 此前表示,未在美国扩产的韩国和中国台湾芯片厂商可能面临最高 100% 的关税。

韩国企业治理论坛对发行新股表示反对,认为此举将稀释现有股东权益,建议公司先回购 10%-15% 的股票再用于美股上市。

信源:https://www.reuters.com/world/asia-pacific/sk-hynix-files-confidentiality-2026-us-listing-2026-03-24/
微软或需赔马斯克250亿美元?法官批准关键证词,OpenAI案下月开庭

OpenAI 联合创始人 Elon Musk 诉 OpenAI 及微软「违反慈善信托」案中,主审法官周三裁定,马斯克方损害赔偿专家、经济咨询公司 Berkeley Research Group 经济学家 C. Paul Wazzan 可在庭审中出庭作证。

Wazzan 的计算模型认定,以 OpenAI 估值 5000 亿美元为基准,微软在 OpenAI 的持股减去投资额后价值 1150 亿美元,其中 OpenAI 非营利实体对该持股的贡献高达 29%,马斯克凭借早期捐款和支持应获得该非营利实体最多 75% 的功劳。据此推算,若陪审团认定微软协助 OpenAI 违反慈善宗旨,微软或需赔偿最高 250 亿美元。微软律师辩称该分析未区分哪些收益源于微软的涉嫌不当行为,但法官裁定协助和教唆将使微软对 OpenAI 造成的全部损害承担连带责任,具体哪些投资构成协助行为由陪审团认定。

法官同时裁定,马斯克方 AI 安全专家、加州大学伯克利分校计算机科学教授 Stuart Russell 可就先进 AI 的风险作证,但不得引用他人对 AI 造成灾难性危害的概率估计。马斯克方合计索赔最高 1340 亿美元,另计划追加惩罚性赔偿。马斯克本月在 X 上承诺,若胜诉全部赔偿金将捐出,「不会从中获利分毫」。案件定于 4 月 28 日在奥克兰联邦法院开庭。

信源:https://www.theinformation.com/briefings/judge-approves-testimony-microsoft-owe-elon-musk-25-billion
Anthropic公开auto mode安全架构:故意不让分类器看到Agent的「内心独白」

Anthropic 发布 Claude Code auto mode 的工程技术文章,详细披露了分类器的架构设计、威胁模型和性能基准。

auto mode 针对四类威胁源建模:Agent 越权(帮倒忙)、理解错误(误判操作范围)、prompt injection(外部注入劫持 Agent)、以及模型对齐偏移(追求自身目标)。文章列举了真实拦截案例:用户说「清理分支」后 Agent 尝试批量删除远程分支;Agent 系统性扫描环境变量中的 API 密钥;未经确认就删除「最接近」的资源;将脚本发布到公共服务;部署失败后自动加 --skip-verification 重试。

分类器最核心的设计决策是信息剥离:分类器只看用户消息和待执行的工具调用,故意不看 Agent 的推理文本和工具返回结果。这样做有两层作用,一是防止 Agent 在推理链中编造理由「说服」分类器放行危险操作,二是隔离工具返回结果中可能携带的 prompt injection 指令。分类管线分两阶段,第一阶段用单 token 快速过滤,偏向拦截(误报率 8.5%);被标记的操作进入第二阶段链式推理,误报率降至 0.4%,且第二阶段的提示词几乎完全命中第一阶段的缓存,额外成本很低。

Anthropic 公布了三组基准数据:真实流量 10000 条样本中误报率 0.4%;52 条真实越权行为样本中漏报率 17%;1000 条合成数据外泄测试中漏报率 5.7%。Anthropic 称 17% 的漏报是「诚实的代价」,大多数漏报并非分类器没发现风险,而是错误判断用户授权已覆盖该操作的影响范围。操作被拦截后 Agent 不会暂停等待用户,而是自动重试并寻找更安全的替代方案,连续 3 次或累计 20 次被拒后才降级为手动确认。

信源:https://www.anthropic.com/engineering/claude-code-auto-mode
前五角大楼二号人物:中美「完全有可能」就AI规则达成协议

美国前副国防部长 Kathleen Hicks 在 Axios AI+DC 峰会上表示,中美两国在 AI 治理上达成协议是「完全有可能的」。她透露拜登政府曾与中方推进双边对话,并认为当前 AI 领域的激烈竞争反而创造了设定规则的机会,「他们可能更倾向于这样做」。她同时提到联合国等多边场合的持续讨论,称中方可以在这些平台「走上前台」。2023 年已有超过 50 个国家在海牙签署了《负责任军事使用 AI 和自主系统政治宣言》。

信源:https://www.axios.com/2026/03/25/us-china-ai-pentagon-hicks
VS Code 1.113:AI推理深度首次可调,子Agent支持嵌套调用

VS Code 1.113 发布,核心更新围绕 Agent 开发体验展开。主要新功能:

1. 推理深度可调:支持推理的模型(如 Claude Sonnet 4.6、GPT-5.4)在模型选择器中新增 Thinking Effort 子菜单,可选 Low、Medium、High 三档,无需进入设置页面,VS Code 会记住每个模型的选择
2. 子 Agent 嵌套调用:子 Agent 现可调用其他子 Agent,支持更复杂的多步工作流,此前为防止无限递归而禁止
3. MCP 打通 CLI:在 VS Code 中注册的 MCP 服务器现可桥接至 Copilot CLI 和 Claude Agent,此前仅限编辑器内的本地 Agent 使用
4. 会话分叉:可在对话历史任意节点创建副本,探索不同思路而不丢失原始上下文,现已扩展支持 Copilot CLI 和 Claude Agent
5. Chat 自定义编辑器:统一管理自定义指令、提示文件、自定义 Agent 和技能的集中界面

此外还包括新的默认主题(VS Code Light / Dark)、聊天图片预览器和 Agent 调试日志面板。

信源:https://code.visualstudio.com/updates/v1_113
AI机器人泛滥,Reddit开始要求可疑账号证明「你是人类」

Reddit CEO Steve Huffman 宣布,平台将要求表现出「自动化或其他可疑行为」的账号进行人类验证。他强调验证仅针对被怀疑为机器人的账号,「大多数用户」不会受到影响,无法通过验证的账号可能被限制功能。

验证分三个层级递进:

1. 密码密钥(passkey),作为起步方案,但 Huffman 称其仅能证明「可能有人做了某件事」,无法证明独立身份
2. 第三方生物识别服务,如虹膜扫描工具 World ID
3. 第三方政府证件验证,Huffman 称这是「最不安全、最不私密、最不推荐」的方式,仅在部分地区(如英国)因法规要求使用

获准使用机器人的账号将获得「App」标签,以便用户区分人类和自动化账号。Reddit 目前每天移除约 10 万个恶意机器人和垃圾账号。不过,Reddit 并未禁止人类用户使用 AI 生成内容,各社区可自行制定规则。

Cloudflare CEO 此前预测,互联网机器人流量将在 2027 年超过人类流量。社交平台 Digg 今年 3 月因「前所未有的机器人问题」关闭了开放测试。

信源:https://old.reddit.com/user/spez/comments/1s3ezrc/humans_welcome_bots_must_wear_name_tags/
Sora被砍、超级应用要合并,OpenAI Codex负责人:不会停,正大幅加注

OpenAI Codex 工程负责人 Thibault Sottiaux 在 X 上发文称,「郑重声明,Codex App 不会消失。我们正在大幅加大投入,它即将变得非常好。」他三天前还透露团队正在对 Codex 进行「端到端的全面重构,以适应未来模型的进步」。

这番表态的背景是 OpenAI 近一周的密集产品线调整。WSJ 上周报道 OpenAI 计划将 ChatGPT、Codex 和浏览器合并为一款桌面「超级应用」,由应用部门 CEO Fidji Simo 主导推进。随后 OpenAI 宣布关停上线仅数月的视频生成应用 Sora,产品线收缩的趋势让外界对其他独立应用的前途产生疑虑。

信源:https://x.com/thsottiaux/status/2036987453924663716?s=46
Apifox遭供应链投毒18天:悄悄修复不发公告,被曝光后才承认

API 开发协作平台 Apifox 发布安全公告,承认其公网 SaaS 版桌面客户端遭遇供应链攻击。3 月 4 日至 3 月 22 日期间,客户端启动时动态加载的事件追踪 JS 文件被篡改为恶意版本(正常 34KB,篡改后 77KB),恶意脚本概率性触发,可能读取用户本地的 SSH 密钥、Git 凭证、Shell 命令历史等高敏感文件,并上报至攻击者注册的仿冒域名 apifox.it.com。该域名并非意大利国别域名,而是商业子域名服务,极具迷惑性。攻击者还可借此拉取后门程序发起横向渗透。

Apifox 于 3 月 23 日发布 v2.8.19 版本修复漏洞,将 JS 文件改为本地内置打包,切断在线加载攻击路径。蓝点网指出,Apifox 修复后未在任何页面发布安全公告。3 月 25 日安全研究员公开技术分析后,Apifox 当晚补发了正式公告。

受影响范围仅限公网 SaaS 版桌面客户端用户,Web 版和私有化部署版不受影响。Apifox 建议在风险时间段内使用过受影响版本的开发者立即轮换 SSH 密钥、Git 令牌、数据库密码、云服务 Access Key 等所有敏感凭证,并检查服务器是否存在异常登录。

信源:https://mp.weixin.qq.com/s/GpACQdnhVNsMn51cm4hZig
思科用AI Agent替掉一款软件年省500万美元,大企业开始集体向供应商施压

尽管 AI 引发的软件股抛售已蒸发数万亿美元市值,美国大企业暂时并没有抛弃 Salesforce、SAP 等核心业务软件。它们在做的事更务实:用 AI 工具自建小型应用替代边缘软件,同时向现有供应商施压要求重新谈判。

网络设备制造商思科运营执行副总裁 Thimaya Subaiya 透露,公司已用自研 AI Agent 替换了一款演示文稿软件,每年节省近 500 万美元许可费,正在评估更多供应商,其中部分每年订阅费用高达 5000 万至 2 亿美元。Subaiya 认为软件的角色正在根本性转变:「你不再需要一个应用了,因为应用只是 Agent 数据库的一部分。」

审计咨询公司安永全球增长与创新管理合伙人 Raj Sharma 表示,安永没有放弃 SAP,但正在通过 vibe coding 在 SAP 之上自建定制功能,而非购买付费升级包。安永每年技术预算为 10 亿美元,vibe coding 正帮助公司把一部分省下来。家居零售商 Lowe's 首席数字与信息官 Seemantini Godbole 也在用同样的方式替代内容生成类软件,她认为未来不太可能每个员工都需要「完整版」CRM,更可能只需要一个更简单的 AI Agent 或聊天界面。

FedEx 首席数字与信息官 Vishal Talwar 称公司「目前不打算让软件离开企业」,但正在与每个合作伙伴主动对话,评估它们如何适应 AI 带来的变化。IT 咨询机构 Gartner 调查显示,96% 的软件工程组织已向开发者提供 AI 工具,预计未来两年超过 70% 的企业软件开发者将使用基于 AI Agent 的编程工具。多位大企业 CIO 的共识是:核心业务软件的角色正在从运营中枢转变为企业数据源,AI Agent 将成为员工与软件交互的主要界面。

信源:https://www.wsj.com/tech/ai/companies-arent-ripping-out-business-software-for-ai-heres-what-theyre-doing-instead-793c3a37
OpenClaw背后核心框架Pi作者长文:Agent编程让2个人在几周内造出十年级别的技术债

OpenClaw 背后核心框架 Pi 创建者 Mario Zechner 发表博文,系统批评当前 AI 编程 Agent 的使用方式。他认为行业正在用纪律和自主权换取一种成瘾,把尽可能快地产出尽可能多的代码当作最高目标。

Zechner 提出三个结构性问题。第一,Agent 不会从错误中学习,人类每天产出代码有限,小错误累积缓慢、痛感及时反馈;Agent 军团没有瓶颈,无害的小错误以不可持续的速率复合增长,等发现时已无法挽回。第二,Agent 是「复杂性贩卖者」,训练数据充斥着糟糕的架构决策,每个 Agent 只有局部视野,看不到其他 Agent 的决策历史,导致大量代码重复和无意义的抽象层。人类企业代码库需要数年才能腐化到那种程度,Agent 加两个人几周就能做到。第三,Agent 搜索的召回率随代码规模增长而下降,找不到应该复用的已有代码,于是不断重复造轮子,进一步加剧复杂性。

他援引近期多起事件佐证:据《金融时报》报道 AWS 一次服务中断与 AI 生成代码有关,亚马逊随后内部启动 90 天代码管控整改;微软 CEO Nadella 曾称微软最高 30% 的代码由 AI 编写,同期 Windows 质量问题频发,微软自身发布了专门的质量承诺博文;声称产品代码 100% 由 AI 编写的公司,持续产出 GB 级内存泄漏、UI 故障和崩溃。

Zechner 建议开发者「放慢脚步」:让 Agent 做无聊的、不关键的、有明确评估函数的任务,人类做最终质量关卡;定义系统架构和 API 的代码自己写,引入摩擦才能真正理解系统;为每天允许 Agent 生成的代码量设上限,与自己实际能审查的量匹配。最终结果将是更少但更对的功能,「学会说不本身就是一项功能」。

信源:https://mariozechner.at/posts/2026-03-25-thoughts-on-slowing-the-fuck-down/
Claude Code接入iMessage:用iPhone短信操控电脑上的编程Agent

Anthropic Claude Code 团队成员 Thariq Shihipar 宣布,iMessage 现已作为 Claude Code 的通信渠道(channel)上线。Mac 用户安装插件后,可通过 iPhone 或任意苹果设备上的 iMessage 向正在运行的 Claude Code 会话发送消息,Claude 在本地机器上执行操作后通过 iMessage 回复。

iMessage 渠道直接读取 macOS 的 Messages 数据库,通过 AppleScript 发送回复,不依赖任何外部服务或 bot token。默认仅响应用户自己的消息(自聊模式),可通过命令添加其他联系人的手机号或 Apple ID。安装方式为在 Claude Code 中执行 /plugin install imessage@claude-plugins-official`,随后以 `claude --channels plugin:imessage@claude-plugins-official 启动会话。

iMessage 是 Claude Code channels 功能的第三个官方渠道,此前已支持 Telegram 和 Discord。Channels 允许外部平台向正在运行的本地 Claude Code 会话推送事件,Claude 在用户的真实文件环境中执行任务并通过同一渠道回复,相当于一座从手机到本地开发环境的聊天桥梁。该功能目前为研究预览阶段,需 Claude Code v2.1.80 或更高版本,Team 和 Enterprise 用户需管理员手动启用。

信源:https://x.com/trq212/status/2036959638646866021