动察Beating AI News
3K subscribers
796 photos
2 videos
3.25K links
AI新闻信息流
Download Telegram
腾讯ima上线Agent模式:四模块记忆系统跨会话保留,可感知当前浏览内容

腾讯 AI 知识管理产品 ima 发布 Agent 模式「copilot」,从对话工具转向可执行任务的 agent 形态,目前采取申请制开放。

Agent 模式的核心是四模块记忆系统:copilot 设定(定义 agent 性格和风格)、用户档案(记录用户背景和偏好)、长期记忆(跨会话保留对话中反复出现的背景和事项)、经验技巧(agent 自行积累的使用经验,越用越准)。记忆内容在设置面板中可查看和编辑。

另一个变化是场景感知:copilot 以浮窗形式悬停在应用内,用户浏览网页、文件、知识库或笔记时,agent 自动读取当前内容,不需要手动上传。同步上线官方 Skills 技能包,首批包括知识库操作、笔记操作、报告生成等,用户也可从 SkillHub 加载第三方技能(目前有 3.5 万个),并支持接入第三方模型 API。

信源:https://mp.weixin.qq.com/s/zQ_jegVtRBxOOWqPq7ROBg
华为7nm芯片「第二条路」被堵:美商务部叫停华虹设备出货

美国商务部上周向多家芯片设备公司发出禁令信函,要求停止向中国第二大代工厂华虹的两座工厂出货特定设备和材料。Lam Research、Applied Materials 和 KLA 均被认为收到了信函,三家周二股价分别跌 3.1%、4.7%、5.8%。

商务部的顾虑是华虹旗下华力微电子正在筹备 7nm 制程。路透社 3 月曾独家报道华力在上海工厂启动 7nm 研发,目标 2026 年底实现每月数千片晶圆的初始产能。目前国内只有中芯国际具备 7nm 量产能力。知情人士透露,华为正计划将部分 AI 芯片生产从中芯国际转移到华虹。

商务部使用的是「is-informed」信函机制,无需走立规流程即可快速施加许可证要求。知情人士称此举可能让美国设备商损失数十亿美元销售额,而华虹也可能用国产或其他外国设备替代。

信源:https://www.reuters.com/world/china/us-orders-chip-equipment-companies-halt-some-shipments-hua-hong-chinas-second-2026-04-28/
查尔斯国王会见黄仁勋、贝佐斯、库克等六大科技CEO,谈英国创业融资

英国国王查尔斯三世国事访问美国期间,在华盛顿国宾馆 Blair House 会见六名美国科技业掌门人:英伟达 CEO 黄仁勋、亚马逊创始人 Jeff Bezos、苹果 CEO Tim Cook、AMD CEO 苏姿丰、Salesforce CEO Marc Benioff 和 Alphabet 总裁 Ruth Porat。话题围绕英国大学衍生创业公司的融资难展开。

查尔斯称这类创业者「总是最难起步的,他们掉进了可怕的死亡谷」。黄仁勋回应说 AI 和量子机器人领域机会巨大,英国需要更活跃的风投和创业文化。查尔斯接了一句「你们都是致命的竞争者」,黄仁勋说「不用有人死」,查尔斯追问「真的吗?」全场笑。Bezos 讲了 1995 年创办亚马逊时每次只能筹 5 万美元、被 40 个投资人拒绝的故事,查尔斯说「那 40 个人现在都在后悔」,还把错过亚马逊的投资人比作当年拒绝出版《哈利·波特》的出版社。

去年 9 月特朗普访英期间,微软、英伟达、谷歌、OpenAI 等公司承诺未来数年在英国投资 310 亿英镑(约 420 亿美元),覆盖 AI、量子计算和民用核能。当晚,上述科技领袖均出席了白宫为查尔斯举办的国宴。

信源:https://www.reuters.com/world/uk/king-charles-meets-with-us-tech-leaders-talks-startup-challenges-2026-04-28/
👍3
前米哈游增长负责人创办AI投放agent公司LeapMind Growth,CMC资本领投天使+轮

LeapMind Growth 完成天使+轮融资,CMC 资本领投,金额未披露。公司成立于 2025 年 4 月,创始人马如平曾先后在 TikTok、快手、米哈游负责用户增长,累计管理超 50 亿美元增长预算。核心团队来自字节跳动、米哈游、快手、美团。

公司核心产品 GrowthGPT 是一个 AI 增长 agent,用户设定目标和预算边界后,agent 自行完成投放策略制定、广告创意迭代、跨平台执行和效果优化。系统内置预算安全防护和增长记忆(跨会话积累的业务上下文),用得越久越贴合业务。公司称在部分海外市场的冷启动投放中,GrowthGPT 端到端接管执行后获客成本比目标低 70%。

马如平说自己做了八年甲方的体会是,增长工作 80% 以上规则明确、可以交给 agent 执行,过去没有合适工具只能堆人。GrowthGPT 要系统化这 80%,让人专注剩下 20% 的核心决策。本轮由 CMC 资本联合香港投资管理有限公司设立的 CMC AI 创意基金出资。

信源:https://mp.weixin.qq.com/s/LUn0Tr4U0ejMPIPutjVCnw
Claude的中文税:问同样内容比英文多花65%token,OpenAI只多15%

AI 研究员 Aran Komatsuzaki 把 Rich Sutton 的知名论文「苦涩的教训」(The Bitter Lesson)翻成 9 种语言,喂进 OpenAI、Gemini、Qwen、DeepSeek、Kimi、Claude 6 家模型的分词工具(tokenizer),以英文原文在 OpenAI 分词工具上的 token 数为 1 倍基准,看各语言在各模型上花多少倍。结果:同样的内容用中文问 Claude,token 消耗是基准的 1.65 倍;用 OpenAI 只有 1.15 倍。印地语在 Claude 上更夸张,超过基准 3 倍。6 家横评里 Anthropic 垫底。

翻译会改变文本长度,所以跟英文比的倍数不完全精确。但更有说服力的是同一段中文在不同模型上的表现(仍以同一基准):Kimi 只花 0.81 倍(比英文还少),Qwen 0.85 倍,到 Claude 上变成 1.65 倍。文本完全一样,差距纯粹是分词工具的效率问题。中国模型处理中文比英文还省,说明问题不在中文本身,而在分词工具有没有为该语言做过优化。

对用户来说,token 多了,API 直接变贵,模型回答前等待更久,上下文窗口也更快用完。分词工具的效率取决于训练数据中各语言的占比:英文数据多,英文词被高效压缩;非英文数据少,只能切得很碎。Aran 的结论:谁的市场大,谁就更省 token。

信源:https://x.com/arankomatsuzaki/status/2049177688402022730
谷歌翻译20周年:10亿月活月翻1万亿词,翻最多的永远是「谢谢」

谷歌翻译上线 20 年,从 2006 年一个统计机器学习实验发展到现在支持约 250 种语言、超 6 万个语言对的全球翻译工具,月活用户超 10 亿。谷歌披露,翻译、搜索、Lens 和 Circle to Search 每月合计处理约 1 万亿词,按不间断朗读计算够读 1.2 万年。

20 周年新增的功能是发音练习:Android 版翻译 App 上线 AI 发音纠正工具,用户对着手机说外语,AI 即时分析并给出发音反馈,目前支持英语、西班牙语和印地语,仅在美国和印度可用。此前翻译已上线 Gemini 驱动的 Live translate,用耳机实时翻译对话,保留说话人原有的语气和节奏,超过三分之一的 Live translate 会话时长超 5 分钟。移动端约三分之一用户把翻译 App 当语言学习工具使用,Practice 功能的周活跃用户中近一半在练口语。

翻译最多的语言对是英语到西班牙语,其次是英语到印尼语、葡萄牙语、阿拉伯语和土耳其语,英语到印地语、孟加拉语和马拉雅拉姆语三种印度语言也进入前列。20 年来翻译次数最多的短语始终是「Thank you」,其次是「How are you?」「I love you」「Hello」和「Please」。

信源:https://blog.google/products-and-platforms/products/translate/fun-facts-google-translate-20-years/
DeepSeek多模态团队研究员暗示新模型将至:「Now, we see you」

DeepSeek 多模态团队研究员 Xiaokang Chen(@PKUCXK)在 X 上发帖「Now, we see you. 👀」,配图为两张 DeepSeek 鲸鱼吉祥物对比:左边鲸鱼双眼被遮住,右边睁开了眼睛。

结合其个人简介「Researcher in Multimodal Team @deepseek_ai」和「看见」的隐喻,疑似暗示 DeepSeek 即将发布全新多模态(视觉)大模型。

4 月 24 日发布的 DeepSeek V4 是纯文本模型,不支持图像输入,若多模态模型落地将是一条独立产品线。DeepSeek 官方暂无公告。

信源:https://x.com/PKUCXK/status/2049381471669080209
2
被马斯克炒掉的前Twitter CEO再融1亿美元:给AI agent建专用搜索引擎

前 Twitter CEO Parag Agrawal 创办的 Parallel Web Systems 完成 1 亿美元 B 轮融资,Sequoia Capital 领投,估值 20 亿美元。Kleiner Perkins、Index Ventures、Khosla Ventures 跟投。公司去年 11 月刚完成 1 亿美元 A 轮(估值 7.4 亿美元),半年内估值翻了近 3 倍,累计融资 2.3 亿美元。

Parallel 做的事是给 AI agent 建专用的网页搜索基础设施。Agrawal 2023 年的判断是 agent 未来使用网页的频率将远超人类,因此需要独立于浏览器的访问层。典型场景包括投资研究、保险理赔、政府合同检索等「深度研究」类任务,这些活人类也能做,但 agent 能做得更快、规模更大。

Sequoia 合伙人 Andrew Reed 加入董事会,他认为 Parallel 的增长与「长周期 agent」(能在后台自主运行、长时间保持上下文的 agent)的快速发展直接相关,而搜索网页是这类 agent 的核心共享能力。AI 法律公司 Harvey 是客户之一,其联合创始人 Gabe Pereyra 说让 agent 搜网页不是简单接个搜索引擎就行,Harvey 需要精细控制 agent 该访问哪些网站、不该碰哪些。

Parallel 目前约 50 名员工,超 10 万开发者在使用其基础设施,同赛道竞争者包括 Tavily 和 Exa。Agrawal 2022 年底因马斯克收购 Twitter 被解职,此前也担任过 Twitter CTO。

信源:https://www.wsj.com/cio-journal/ex-twitter-ceos-ai-startup-raises-funds-at-2-billion-valuation-63c927fc
ClawHub上30个插件让你的AI助手偷偷给陌生人打工赚币,近万次下载

AI agent 安全公司 Manifold 研究负责人 Ax Sharma 发现,ClawHub 上一个叫 imaflytok 的账号发布了 30 个 skill,累计约 9800 次下载。这些 skill 表面是定时任务助手、安全工具、行情监控之类的常用插件,实际上在背后把用户的 AI 助手变成了替别人干活赚加密货币的「工人」。

用户装完插件后,AI 助手会按插件里的指令文件自动执行一连串操作:先向第三方服务器注册,汇报「我叫什么、我能干什么、我还装了哪些插件」;然后生成一个加密货币钱包,把私钥也交给这个服务器;之后每 4 小时签到一次,等候派发任务。从注册到交钥匙到接活,用户全程看不到任何提示,也没点过任何同意按钮。

这些插件没有恶意代码,安全扫描器逐行检查也找不出问题,每一步用的都是合法工具和标准接口。Sharma 说这跟之前 15 万个垃圾包涌入 npm 刷 Tea Protocol 代币的套路一样,只是载体从代码包换成了 AI 助手插件。他认为插件商店的审核机制在这里失效了:「扫描器找的是恶意代码,这里没有。真正需要的是监控 AI 助手装完插件之后实际在干什么。」

信源:https://www.theregister.com/2026/04/29/30_clawhub_skills_mine_crypto/
1
Claude接入Blender、Adobe、Autodesk等8款创意工具,Blender官方亲自开发连接器

Anthropic 发布一批创意工具连接器(connector),让 Claude 直接操控设计师和音乐人日常使用的专业软件。首批 8 个连接器覆盖 3D 建模、视觉设计、音乐制作和实时演出四个方向,合作方包括 Blender、Adobe、Autodesk、Ableton、Splice、Affinity by Canva、Resolume 和 SketchUp。

具体能力各不相同。Adobe 连接器打通 Creative Cloud 旗下 50 多个工具,包括 Photoshop、Premiere 和 Express;Autodesk Fusion 允许用自然语言创建和修改 3D 模型;Blender 连接器由 Blender 官方团队开发,基于 MCP 协议,其他大模型也能调用;Ableton 连接器接入 Live 和 Push 的官方文档;Splice 让音乐人在 Claude 对话里直接搜索免版税采样库;Resolume 连接器可用自然语言实时控制 VJ 演出画面。

Anthropic 同时加入 Blender Development Fund 成为 Corporate Patron,每年至少出资 24 万欧元(约 28.1 万美元),与 Netflix、Epic、Wacom 并列赞助商。此外 Anthropic 与罗德岛设计学院(RISD)、瑞格林艺术与设计学院和伦敦大学金匠学院三所院校合作开设 AI 创意课程。

信源:https://anthropic.com/news/claude-for-creative-work
拿了6亿美元闷头做3年,Poolside首次公开编程模型

编程 AI 公司 Poolside 发布 Laguna 系列首批两款模型。Poolside 2023 年成立,累计融资 6.26 亿美元,估值 30 亿美元,投资方包括 Bain Capital Ventures、NVIDIA 和 eBay Ventures,此前只面向政府和公共部门客户,这是首次向公众发布模型。

旗舰 Laguna M.1 是 225B 参数 MoE 模型(激活 23B),在 6144 块 NVIDIA Hopper GPU 上从零训练 30T token,SWE-bench Pro 得分 46.9%,仅通过 API 提供。小模型 Laguna XS.2 是 33B 参数 MoE(激活 3B),SWE-bench Pro 44.5%,SWE-bench Verified 68.2%,权重以 Apache 2.0 开源,36GB 内存的 Mac 可本地运行,已上线 HuggingFace、Ollama 和 OpenRouter。两款模型限时免费。

Poolside 同时开源了内部 agent 运行时 pool,与训练和评估 agent 用的是同一套环境。公司研究团队约 60 人,博客中明确表示「西方需要强大的开源模型,我们希望参与贡献」。

信源:https://poolside.ai/blog/laguna-a-deeper-dive
Exa成为Gemini的搜索后端:接入Vertex AI和企业版Agent市场

AI 搜索引擎 Exa 与 Google Cloud 达成合作,从两个入口接入谷歌体系。一是 Vertex AI 上的 Grounding with Exa Web Search,Gemini 调用时由 Exa 实时抓取网页,经 Exa 的 Highlights 模型提取最相关段落后注入上下文,用于需要时效性或事实准确性的场景。二是 Gemini Enterprise 的 Agent Marketplace,企业用户无需写代码即可在工作区内调用 Exa Agent 做网页搜索、相似页面查找和内容提取。前者目前处于 Private Preview 阶段,后者已在 Google Next 大会上作为首批合作伙伴上线。

信源:https://exa.ai/blog/exa-google-cloud
不标一条数据,30亿参数小模型打败200亿专用护栏模型

AI agent 安全公司 Plurai 提出 BARRED 框架:给一段任务描述和少量无标注样本,框架自动生成合成训练数据,练出定制的内容护栏(guardrail,审核 AI 输出是否违规的分类器)。用这套数据微调的 Qwen2.5-3B(30 亿参数)在对话策略、agent 输出校验、医疗合规 4 项任务上全面超过 OpenAI 的 OSS-Safeguard-20B(200 亿参数),也超过直接用 GPT-4.1 做分类。

框架先把任务拆成多个维度,专门在边界地带生成容易判错的样本。生成后不直接用,还要过一道「非对称辩论」:一个 AI 固定立场为样本标签辩护,两个 AI 独立评判,全员一致才留用,否则根据反对意见改了重来。这步是关键,消融实验显示去掉辩论后准确率从 85% 降到 58%;换成单 AI 自我修正(Self-Refine)比不验证还差。评估代码和数据集已在 GitHub 和 HuggingFace 开源。

信源:https://cdn.prod.website-files.com/691ef0a011466cf6dc334d6a/69aff666e1120dcc80a632f2_Plurai_Guardrail_Training_ICML.pdf
440MB翻译33种语言:腾讯混元开源手机离线翻译模型

腾讯混元团队开源翻译模型 Hy-MT1.5-1.8B-1.25bit,把 18 亿参数的翻译模型压缩到 440MB,下载后可在手机上完全离线运行,支持 33 种语言、1056 个翻译方向,覆盖中英日法阿俄及藏语、蒙古语等少数民族语言。

压缩用的是腾讯自研的 Sherry(稀疏三值量化)技术,已被 NLP 顶会 ACL 2026 录用。核心做法是每 4 个参数取 3 个最重要的用 1-bit 存储、1 个置零,平均每个参数只占 1.25 bit,配合专为手机 CPU 设计的推理内核可常驻后台。腾讯称该模型在翻译评测中超过谷歌翻译,接近 235B 级大模型效果。同时提供 2-bit 版本(574MB),精度几乎无损。模型权重、代码和技术报告已在 HuggingFace 和魔搭社区开源,附带安卓 APK 可直接安装体验,iOS 版后续推出。

信源:https://mp.weixin.qq.com/s/GMl4FiB8HRwqZc-1_T9XOw
👍2
Qwen开源FlashQLA:线性注意力前向提速3倍,TP8场景比FlashInfer快5倍

Qwen 团队开源 FlashQLA,一套针对 GDN(Gated Delta Network,Qwen3-Next / 3.5 / 3.6 全系列使用的线性注意力层)的高性能算子库。在 H200 上实测,前向比 FLA Triton kernel 快 2-3 倍,反向快 2 倍;对比 FlashInfer,TP8 场景前向最高快 5.33 倍。

提速的核心在于利用 GDN 门控值的指数衰减特性做卡内自动上下文并行(AutoCP)。传统做法需要计算一个校正矩阵 M 来拼接各子序列的状态,计算量甚至超过状态矩阵本身。FlashQLA 发现 60%-80% 的注意力头上门控值不会常驻 1,只需 6-8 个 chunk 的预热就能让状态误差降到噪声以下,直接跳过 M 的计算。系统会根据 batch size、头数和序列长度自动判断是否启用 CP,无需手动配置。

算子层面,FlashQLA 没有把整个计算流融合成单一 kernel,也没有拆成逐步独立 kernel,而是折中拆成两个融合 kernel 并在中间插入 CP 预处理。每个 kernel 内部用 TileLang 实现 warp 级特化(warp specialization),一个生产者 warp group 负责数据搬运,三个消费者 warp group 分别算不同中间变量,通过乒乓结构重叠访存和计算。提速在 TP 分片多、头数少的场景最明显,正好是大模型多卡部署和端侧 agent 推理的典型配置。

信源:https://qwen.ai/blog/flashqla
金融Agent平台Rogo获1.6亿美元D轮融资,不到三个月连融两轮

专为高频金融场景设计的 AI 平台 Rogo 宣布完成 1.6 亿美元 D 轮融资,由 Kleiner Perkins 领投,Sequoia、Thrive Capital、Khosla Ventures、J.P. Morgan 等参投。今年 1 月末 Rogo 刚完成 7500 万美元 C 轮融资,两轮间隔不到三个月。至此,公司累计融资额超 3 亿美元。

Rogo 同步推出面向个人的金融 Agent 平台 Felix。系统设计思路从「像搜索引擎一样问答」转向「像发邮件给同事一样委派任务」。投行家和分析师可将建模型、查财报、搭 PPT 等多步长流程任务抛给 Felix 执行,并在过程中与其沟通迭代,将时间腾出用于客户沟通等高杠杆工作。目前该平台已被超 250 家顶尖投资银行、资产管理公司和私募股权机构的 3.5 万名专业人士使用。

信源:https://rogo.ai/news/series-d
Anthropic考虑新一轮融资,估值超9000亿美元将反超OpenAI

Anthropic 正在考虑一轮新融资,估值超过 9000 亿美元。如果成行,Anthropic 将超越 3 月刚以 8520 亿美元完成融资的 OpenAI,成为全球估值最高的 AI 创业公司。

多名知情人士称,已有投资者向 Anthropic 开出超过其当前估值一倍以上的报价。谈判尚处极早期,Anthropic 还没有接受任何要约。此前 Anthropic 曾多次拒绝 8000 亿美元及以上估值的入股提议。

Anthropic 目前估值 3500 亿美元,由谷歌和亚马逊两笔大额投资锚定。谷歌近期承诺以该估值投入 100 亿美元,如 Anthropic 达到特定业绩目标再追加 300 亿;亚马逊以同一估值投入 50 亿美元,计划后续追加 200 亿。尚不清楚这两家是否会参与新一轮融资。Anthropic 同时在考虑最早 10 月进行 IPO。

信源:https://www.bloomberg.com/news/articles/2026-04-29/anthropic-considering-funding-offers-at-over-900-billion-value
「AI杀死搜索」?谷歌搜索量创历史新高,Alphabet每股收益翻倍碾压预期

Alphabet 公布一季度财报,营收(不含合作伙伴分成)947 亿美元,超出分析师预期的 916 亿美元;每股收益 5.11 美元,接近华尔街预期 2.62 美元的两倍。财报发布后股价盘后涨超 6%。

CEO Sundar Pichai 称,谷歌在搜索中整合 AI 工具后,搜索查询量创历史新高,同时用 AI 回答用户问题的成本已被压低。这是对「聊天机器人将蚕食谷歌搜索」这一叙事最直接的反驳。

云业务收入 200 亿美元,超出预期的 184 亿美元。积压订单(已签约但尚未确认为收入的合同额)较上季度接近翻倍,突破 4600 亿美元。Pichai 称公司短期内受限于算力,「云收入本可更高」,正在加大投入。公司还将对部分客户开放在其自有数据中心使用 TPU(谷歌自研 AI 芯片,英伟达之外的主要替代方案)。

Gemini Enterprise(面向企业的 AI agent 平台)付费月活用户环比增长 40%。消费端 Gemini 聊天机器人在 2025 年底有 7.5 亿用户。

CFO Anat Ashkenazi 表示,今年资本支出预算上调至最高 1900 亿美元,此前预估 1850 亿美元,已是 2025 年实际支出的两倍;2027 年将「大幅」高于这一水平。公司同时宣布股息增加 5%。

信源:https://www.bloomberg.com/news/articles/2026-04-29/alphabet-sales-beat-estimates-on-google-cloud-ai-customers
1
Meta营收增33%超预期,但全年资本开支上调至最高1450亿美元,盘后跌7%

Meta 公布一季度财报,营收 563.1 亿美元,同比增长 33%,超过华尔街预期的 554.5 亿美元。调整后每股收益 7.31 美元,高于预期的 6.79 美元。报告利润中包含一笔 80.3 亿美元的一次性税收优惠,来自美国财政部今年 2 月简化企业替代最低税的新规,部分抵消去年因减税法案产生的 159.3 亿美元税费。

营收和利润都超预期,但股价盘后跌约 7%,核心原因是资本开支再度加码。Meta 将全年资本支出指引从 1150 至 1350 亿美元上调至 1250 至 1450 亿美元,比此前高出 100 亿美元。2025 年全年实际资本支出为 722 亿美元,一年内接近翻倍。CFO Susan Li 称上调原因是元器件涨价和新增数据中心建设需求,并在电话会上表示「到目前为止,我们一直在低估算力需求」。

用户数据同样拖累股价。旗下应用日活人数 35.6 亿,同比增长 4%,但低于分析师预期的 36.2 亿,环比上季也有所下降。Meta 将此归因于伊朗断网和俄罗斯限制 WhatsApp 访问。

广告业务仍是核心增长引擎。广告收入 550.2 亿美元,占总营收超 98%。广告展示量同比增 19%,每条广告均价提升 12%。

CEO 扎克伯格在电话会上称 Muse Spark 是「今年最大的里程碑」,该模型由 Alexandr Wang 领导的 Meta 超级智能实验室推出。发布后 Meta AI 每用户会话量出现双位数增长。扎克伯格还表示 Meta「不反对」做编程工具,但「这不是我们的主要重心」。

Meta 同时披露将于 5 月裁员约 10%,涉及约 8000 名员工,另取消 6000 个开放职位。CFO Li 称裁员将帮助公司「行动更快」,并抵消基础设施投资。截至 3 月底,员工总数为 77,986 人。

Q2 营收指引 580 至 610 亿美元,与分析师预期大致持平。

信源:https://investor.atmeta.com/investor-news/press-release-details/2026/Meta-Reports-First-Quarter-2026-Results/default.aspx
OpenClaw v2026.4.27:接入Codex桌面控制,DeepInfra成为内置提供商

开源个人 AI 助手 OpenClaw 发布 v2026.4.27。两个面向用户的新功能最值得关注:Codex Computer Use 和 DeepInfra 内置支持。

Codex Computer Use 让 OpenClaw 的 Codex 模式 agent 获得桌面控制能力,可以操作鼠标、键盘和屏幕。新增 /codex computer-use status/install 命令和 marketplace 自动发现,启动前强制检查 MCP 服务器可用性,检查不通过则拒绝进入 Codex 模式。该功能由 OpenAI 员工 @pash-openai 贡献。

DeepInfra 作为内置提供商加入,配好 API Key 即可使用,支持 OpenAI 兼容的模型动态发现、图片生成与编辑、TTS、embedding,不再需要手动配置端点。

架构层面,大量模型提供商目录(DeepSeek、Mistral、NVIDIA、Cerebras 等)从运行时动态扫描迁移到插件清单(manifest)静态声明,插件启动也从隐式全量加载改为显式 activation.onStartup 声明。直接效果是网关启动更快,插件审计更清晰。此外 Docker sandbox 新增 GPU 直通选项,企业部署新增出站 HTTP 代理路由。bug 修复超百项,覆盖 Telegram、Slack、飞书、Discord 等主要渠道的稳定性问题。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.4.27
1