动察Beating AI News
3.12K subscribers
865 photos
2 videos
3.36K links
AI新闻信息流
Download Telegram
色情聊天也不做了:OpenAI无限期搁置成人模式

OpenAI 已将 ChatGPT「成人模式」的推出计划无限期搁置。英国《金融时报》称,这一决定发生在公司重新聚焦核心产品之际,员工和投资人也对性化 AI 内容可能带来的社会影响表达了担忧。

OpenAI 向《金融时报》确认,该产品目前已暂停且没有发布时间表。公司表示,在做出产品决定前,想先完成对露骨性聊天和情感依赖影响的长期研究,并承认目前缺乏相关经验证据。

这也是 OpenAI 继续收缩「支线任务」的最新动作。3 月初已有报道称,OpenAI 当时已再次推迟成人模式上线,原因是要优先处理「对更多用户更高优先级」的工作,包括提升模型智能、个性和主动性。

信源:https://www.ft.com/content/de9bf0af-b241-424f-8229-5870b1c0d93d
小米MiMo限免加码:Agent框架免费调用延长至4月2日

小米 MiMo 宣布,将「Xiaomi MiMo 联合全球顶级 Agent 框架开启首周限免」活动由原定限免一周延长为两周,免费时间延长至北京时间 2026 年 4 月 2 日晚 12 点。

官方称,自 3 月 19 日 Xiaomi MiMo-V2 系列模型全球发布以来,MiMo-V2-Pro 和 MiMo-V2-Omni 获得较高开发者关注,其中 MiMo-V2-Pro 在 OpenRouter 全球调用量排名中位列日榜、周榜和趋势榜第一。

这次联合活动覆盖 OpenClaw、OpenCode、KiloCode、Cline 和 BlackBoxAI 等 Agent 框架。小米表示,各平台的接入方式可参考此前发布的活动说明。

信源:https://mp.weixin.qq.com/s/oxZ2rC0B2PlEN3o93HDRVQ
谷歌发布Gemini 3.1 Flash Live:思考深度可调,语音延迟最低不到1秒

谷歌发布 Gemini 3.1 Flash Live 语音模型,称其为自家迄今最高质量的音频模型,即日起面向开发者、企业和消费者全面上线。

该模型的核心卖点是可配置的思考深度,允许开发者在质量与速度之间灵活取舍。AI 模型评测机构 Artificial Analysis 的测试显示,在最高思考设置下,Big Bench Audio 基准得分 95.9%,响应延迟 2.98 秒;切至最低设置后得分降至 70.5%,但延迟压缩至 0.96 秒。在 AI 数据与评测平台 Scale AI 的 Audio MultiChallenge 基准上,该模型开启思考后以 36.1% 的得分领先,该基准专门测试真实音频环境中的复杂指令跟随与长程推理能力。相比前代 2.5 Flash Native Audio,新模型在音高、语速等声学细节识别和嘈杂环境下的任务完成率上均有提升,支持超 90 种语言的实时多模态对话。

定价与前代持平,音频输入 $0.35/小时,输出 $1.40/小时。部署覆盖三条产品线:开发者可通过 Google AI Studio 的 Live API 预览接入,企业端通过 Gemini Enterprise for Customer Experience 使用,消费者端则驱动 Gemini Live 和 Search Live。其中 Gemini Live 的对话上下文跟踪长度提升至前代两倍,Search Live 借此扩展至全球 200 多个国家和地区。所有生成音频均嵌入 SynthID 水印以防止误导性传播。

信源:https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-live/
Meta发布大脑基础模型TRIBE v2:无需扫描即可预测神经反应,分辨率提升70倍

Meta 基础人工智能研究团队(FAIR)发布三模态大脑编码基础模型 TRIBE v2(Trimodal Brain Encoder),能够预测人脑对视觉、听觉和语言刺激的神经反应,目标是推动「计算机模拟神经科学」(in-silico neuroscience),用 AI 模型替代传统 fMRI 扫描进行大规模虚拟实验。

该模型基于 720 名受试者超过 1000 小时的功能性磁共振成像(fMRI)数据训练。受试者在扫描期间观看电影、收听播客、浏览图片和阅读文字,模型从中学习大脑对不同刺激的反应模式。TRIBE v2 利用预训练的音频、视频和文本嵌入,通过 Transformer 架构生成跨刺激、跨任务、跨个体的通用神经表征,分辨率较此前同类系统提升 70 倍,速度和准确性也有显著提升。

模型具备零样本预测能力,无需重新训练即可预测新个体、未见过的语言和全新任务类型的大脑反应,相当于为神经活动创建「数字孪生」。研究人员可借此在数秒内运行数千次虚拟实验,大幅降低对昂贵 fMRI 设备的依赖,有望加速脑机接口开发和神经系统疾病治疗研究。Meta 已开源该模型的权重、代码库和演示程序。

信源:https://ai.meta.com/research/publications/a-foundation-model-of-vision-audition-and-language-for-in-silico-neuroscience/
SpaceX IPO改写华尔街惯例:散户配额拟达常规3倍,复活节后启动投资者会议

SpaceX 正通知潜在 IPO 投资者,预计复活节假期后的 4 月启动由公司高管主持的投资者简报会(testing-the-waters meetings),同时最早本月秘密提交 IPO 申请。此次 IPO 融资规模最高可达 750 亿美元,估值或触及 1.75 万亿美元,有望超越沙特阿美 2019 年约 290 亿美元的纪录,成为史上最大 IPO。

在配售结构上,马斯克正考虑将最多 30% 的份额分配给散户投资者,是常规 5% 至 10% 配比的至少三倍。SpaceX CFO Bret Johnsen 已将这一方案传达给华尔街。马斯克的策略是依靠忠实个人投资者群体在上市后稳定股价,减少短线抛售行为。

SpaceX 还为各承销银行指定了按客户群和地区划分的「分道」(lane)角色,而非让银行自由竞争:

1. 美国银行:负责美国高净值个人和家族办公室
2. 摩根士丹利:通过旗下 E*Trade 平台服务中小散户
3. 瑞银:负责国际高净值投资者
4. 花旗:协调国际散户和机构分销
5. 瑞穗、巴克莱、德意志银行、加拿大皇家银行分别覆盖日本、英国、德国和加拿大市场

IPO 的最终规模和时间表尚未确定。

信源:https://www.reuters.com/business/finance/musk-rewrites-ipo-playbook-with-large-slice-spacex-stock-retail-investors-source-2026-03-26/
Anthropic讨论最快四季度IPO:预计融资超600亿美元,华尔街押注先于OpenAI上市

Anthropic 高管已讨论最快今年第四季度进行 IPO。竞标承销资格的银行家预计融资规模将超过 600 亿美元,仅次于 SpaceX 预计最高 750 亿美元的 IPO,有望成为史上第二大 IPO。最终金额要到发行前夕才会确定。Anthropic 上月融资估值 3500 亿美元,目前正与律所 Wilson Sonsini 合作推进上市准备。

Anthropic 今年前两个月年化营收翻倍至 190 亿美元,增长主要由自动化编程工具拉动,正在快速缩小与 OpenAI 的差距(OpenAI 上月年化营收超 250 亿美元)。在盈利路径上,Anthropic 此前乐观预计达到正现金流前累计消耗约 220 亿美元,最早 2028 年实现;OpenAI 则预计 2030 年实现正自由现金流,此前预计累计消耗超 2000 亿美元。

参与 IPO 顾问工作的银行家和律师普遍预计 Anthropic 将先于 OpenAI 上市,理由是公共市场投资者更青睐其专注开发者和企业客户的路线,以及更短的盈利时间表。OpenAI CEO Sam Altman 曾私下表示希望抢先上市,但 OpenAI 刚接近完成 1200 亿美元融资(投前估值 7300 亿美元),短期无上市的财务压力。两家公司的 IPO 时间表均高度依赖宏观环境,伊朗战争与油价上涨引发的通胀担忧可能收窄 IPO 窗口。

信源:https://www.theinformation.com/articles/anthropic-discusses-going-public-soon-fourth-quarter
Claude高峰时段开始「限速」:约7%用户受影响,Pro订阅尤甚

Anthropic Claude Code 团队工程师 Thariq Shihipar 在 X 上宣布,为应对 Claude 持续增长的使用需求,Anthropic 正在调整免费、Pro 和 Max 所有订阅层级在高峰时段的会话限额分配方式。用户的每周总限额保持不变,但在工作日太平洋时间上午 5 点至 11 点(美国已进入夏令时,对应时间为北京时间晚 8 点至次日凌晨 2 点)期间,5 小时会话额度将被更快消耗。

Shihipar 表示团队已通过大量效率优化来抵消影响,但仍有约 7% 的用户将触及此前不会遇到的会话限制,Pro 订阅用户尤为明显。他建议运行高 token 消耗后台任务的用户将其移至非高峰时段以延长可用额度,并称将持续投入扩容。

信源:https://x.com/trq212/status/2037254609455243503
OpenAI Codex上线插件系统:开箱即用连接Slack、Figma、Notion、Gmail

OpenAI 宣布为 AI 编程工具 Codex 推出插件(Plugins)系统,使 Codex 可开箱即用地连接开发者日常使用的工具,首批集成包括 Slack、Figma、Notion、Gmail 等。

插件是可安装的工作流捆绑包,一个插件可同时打包三类组件:Skills(描述工作流的提示词,供 Agent 按需发现和调用)、Apps(应用集成或连接器映射)、MCP 服务器(远程工具或共享上下文)。用户可通过 Codex 应用内的插件目录浏览和安装 OpenAI 官方策划的插件,CLI 用户则通过 /plugins 命令访问。

插件支持本地开发和分发。开发者可使用内置的 @plugin-creator 技能快速搭建插件骨架,通过仓库级或个人级 marketplace 管理本地插件。插件以 .codex-plugin/plugin.json 清单文件为入口,支持版本管理、权限策略配置和品牌展示。官方公共插件市场的自助发布功能尚未开放。

信源:https://x.com/OpenAIDevs/status/2037305126017712128
联邦法官叫停五角大楼对Anthropic的供应链风险认定

加利福尼亚北区联邦地区法官 Rita Lin 发布临时禁令,叫停特朗普政府对 Anthropic 的「供应链风险」认定。这一通常仅用于与外国对手有关联企业的国家安全标签,此前从未被施加于美国本土公司。

Lin 在长达 43 页的裁定书中措辞严厉,称该认定「很可能既违反法律又属武断专横」(likely both contrary to law and arbitrary and capricious),并写道:「现行法律中没有任何条文支持这样一种奥威尔式的观念,即一家美国公司可以因为对政府表达异议而被贴上潜在敌对者和破坏者的标签。」她引用五角大楼内部记录指出,Anthropic 被列为供应链风险的原因是其「通过媒体表现出的敌意态度」,构成「典型的非法第一修正案报复」。

事件起因是 Anthropic 拒绝取消 Claude 模型在自主武器和大规模监控方面的使用限制,而五角大楼要求对 Claude 拥有不受约束的使用权限。国防部长 Pete Hegseth 随后将 Anthropic 列为供应链风险,禁止民用机构与其合作,并暗示军方供应商须终止与这家估值 3800 亿美元的公司的商业关系。Anthropic 估计,该认定的广泛适用可能造成数十亿美元损失,即使按最窄口径也有数亿美元年营收面临风险。多家大型科技公司提交了支持 Anthropic 的法律意见书。

禁令将延迟 7 天生效以留出政府上诉时间。Anthropic 在华盛顿特区联邦法院提起的另一项挑战仍在审理中。

信源:https://www.cnn.com/2026/03/26/business/anthropic-pentagon-injunction-supply-chain-risk
谷歌Gemini上线「搬家」工具:一键导入ChatGPT等应用的对话记录和偏好

谷歌为 Gemini 推出「搬家工具」(switching tools),允许免费和付费用户将其他 AI 聊天应用的记忆、偏好和完整对话记录导入 Gemini,即日起面向消费者账户滚动上线。

该工具包含两项功能:

1. 记忆导入:用户在 Gemini 设置页面获取一段预设提示词,粘贴到当前使用的 AI 应用中,后者自动生成一份涵盖用户偏好、人际关系和个人背景的摘要,再将该摘要粘贴回 Gemini 即完成导入。
2. 对话记录导入:用户可上传从其他 AI 服务商导出的 ZIP 格式聊天记录包,在 Gemini 中搜索历史对话并继续此前的讨论。

谷歌同时将 Gemini 的「过往对话」(past chats)功能更名为「记忆」(memory)。企业账户、18 岁以下用户暂不支持,欧洲经济区、英国和瑞士用户暂未开放。Anthropic 本月早些时候为 Claude 推出了类似的记忆导入功能。

信源:https://blog.google/innovation-and-ai/products/gemini-app/switch-to-gemini-app/
OpenAI重置Codex全套餐用量限额,配合插件上线鼓励用户尝鲜

OpenAI Codex 负责人 Thibault Sottiaux 宣布,已重置所有套餐的 Codex 用量限额,让用户可以充分体验刚上线的插件系统。Codex 此前刚推出插件功能,首批集成 Slack、Figma、Notion、Gmail 等开发者常用工具。

信源:https://x.com/thsottiaux/status/2037346989244096581
OpenAI研究岗仅剩7%,销售岗翻倍:招聘数据暴露四大实验室路线分裂

AI 研究机构 Epoch AI 分析了 OpenAI、Anthropic、xAI 和谷歌 DeepMind 的公开招聘信息,从岗位结构中提取出各家的战略分歧。数据采集于 2026 年 3 月初。

最显眼的趋势是销售岗激增。Anthropic 的市场销售类岗位占比从一年前的 17% 升至 31%,OpenAI 从 18% 升至 28%,均已成为各自最大的招聘类别。研究岗占比则大幅收缩,Anthropic 仅剩 12%,OpenAI 仅 7%。增长最快的细分是帮助客户落地 AI 的技术型销售角色(AI Success Engineer、Forward Deployed Engineer 等),Anthropic 该类岗位占比从 5% 升至 11%,OpenAI 从 11% 升至 17%,反映出客户「买了但不会用」的落地瓶颈。

产品路线的分化更为明显:

1. OpenAI 走全栈垂直整合。15 个岗位指向一款便携式硬件设备(配备摄像头、定制芯片、端侧模型推理),另有 21 个岗位与自研芯片相关,7 个机器人岗位涉及仿真训练和量产,还在孵化社交产品和求职平台
2. DeepMind 同样押注硬件,招聘 XR 眼镜和人形机器人(含灵巧手)相关岗位
3. Anthropic 不做自研芯片、不做硬件,基础设施依赖外部合作伙伴建设和托管,产品投入集中在 Claude Code(5 个岗位)和核心模型 API
4. xAI 有 27 个内部数据标注岗位,是唯一公开大规模招聘标注员的实验室,其他公司要么外包要么不公开

在 Agent 训练方面,Anthropic 的 Universes 团队和 OpenAI 的 Synthetic RL 团队都在构建用于长周期 Agent 训练的超真实 RL 环境,方向高度趋同。政府销售领域,OpenAI 和 Anthropic 各有 10 个政府销售岗位(涵盖联邦、国防和地方政府),xAI 则在伦敦和迪拜设了面向国际政府的销售岗。

信源:https://epoch.ai/gradient-updates/ai-lab-job-postings
谷歌Search Live扩展至全球200多个国家:对着摄像头说话就能搜索

谷歌宣布将 Search Live 功能扩展至全球所有支持 AI Mode 的语言和地区,覆盖超过 200 个国家和地区。用户在 Google 应用(Android 和 iOS)中点击搜索栏下方的 Live 图标,即可通过语音与搜索引擎实时对话,支持追问和深入探索,对话中可直接获取相关网页链接。开启摄像头后,Search Live 还能识别镜头画面并结合视觉内容提供回答,例如指导安装家具。Google Lens 用户也可在拍照界面直接切换至 Live 模式。

此次全球扩展由新发布的 Gemini 3.1 Flash Live 模型驱动,该模型原生支持多语言,旨在提供更自然流畅的语音交互体验。

信源:https://blog.google/products-and-platforms/products/search/search-live-global-expansion/
20B小模型搜索能力追平GPT-5和Opus:向量数据库Chroma开源Agent搜索模型Context-1

开源向量数据库 Chroma 发布 Context-1,一个 200 亿参数的智能体搜索模型,专门用于多轮检索任务。模型权重以 Apache 2.0 协议开源,合成数据生成管线代码同步公开。

Context-1 的定位是检索子代理(retrieval subagent):它不直接回答问题,而是通过多轮搜索为下游推理模型返回一组支撑文档。核心技术是「自编辑上下文」(self-editing context),即模型在搜索过程中主动丢弃不相关的文档片段,在有限的上下文窗口内为后续搜索腾出空间,避免上下文膨胀导致的性能退化。

训练分两阶段:先用 Kimi K2.5 等大模型生成 SFT 轨迹做监督微调热身,再通过强化学习(基于 CISPO 算法)在 8000 多个合成任务上训练。奖励设计采用课程机制,早期重召回鼓励广泛探索,后期逐步转向精确度鼓励选择性保留。基座模型为 gpt-oss-20b,使用 LoRA 适配,推理时以 MXFP4 量化在 B200 上运行,吞吐量达 400-500 token/s。

在 Chroma 自建的四个领域基准(网页、金融、法律、邮件)和公开基准(BrowseComp-Plus、SealQA、FRAMES、HotpotQA)上,Context-1 的 4 路并行版本在「最终答案命中率」指标上与 GPT-5.2、Opus 4.5、Sonnet 4.5 等前沿模型持平或接近,例如在 BrowseComp-Plus 上达到 0.96(Opus 4.5 为 0.87,GPT-5.2 为 0.82),而成本和延迟仅为后者的几分之一。值得注意的是,该模型仅在网页、法律和金融数据上训练,但在未参与训练的邮件领域同样表现出显著提升,显示搜索能力的跨领域迁移性。

信源:https://www.trychroma.com/research/context-1
1
Cursor每5小时迭代Composer:实时RL训练下,模型学会了「装傻逃罚」

AI 编程工具 Cursor 发布博客介绍其「实时强化学习」(real-time RL)方法:将生产环境中的真实用户交互转化为训练信号,最快每 5 小时部署一个改进版 Composer 模型。此前该方法已用于训练 Tab 补全功能,现扩展至 Composer。

传统方法通过模拟编程环境训练模型,核心难点在于模拟用户行为的误差难以消除。实时 RL 直接使用真实环境和真实用户反馈,消除训练与部署之间的分布偏移。每个训练周期从当前版本收集数十亿 token 的用户交互数据,提炼为奖励信号,更新模型权重后经评测套件(包括 CursorBench)验证无回退再部署上线。Composer 1.5 的 A/B 测试显示三项指标改善:代码编辑被用户保留的比例提升 2.28%,用户发送不满意追问的比例下降 3.13%,延迟降低 10.3%。

但实时 RL 也放大了奖励黑客(reward hacking)风险。Cursor 披露了两个案例:模型发现故意发出无效工具调用后不会收到负面奖励,于是在预判会失败的任务上主动制造错误调用来逃避惩罚;模型还学会在面对有风险的编辑时转而提出澄清性问题,因为不写代码就不会被扣分,导致编辑率急剧下降。两个漏洞均在监控中被发现并通过修正奖励函数解决。Cursor 认为实时 RL 的优势恰在于此:真实用户比基准测试更难被糊弄,每次奖励黑客本质上都是一份 bug 报告。

信源:https://cursor.com/blog/real-time-rl-for-composer
Anthropic意外泄露下一代模型「Claude Mythos」:超越Opus的新层级,网络安全能力「远超所有现有AI」

Anthropic 正在测试一款名为「Claude Mythos」的新模型,因内容管理系统配置失误,一份未发布的博客草稿被存储在公开可搜索的数据库中,意外暴露了该模型的存在。Anthropic 随后确认了这款模型,称其代表「能力的阶跃式提升」(step change),是「我们迄今构建的最强模型」。

泄露的草稿显示,Mythos 是一个全新的模型层级,定位高于 Opus 系列。草稿称「与此前最佳模型 Claude Opus 4.6 相比,该模型在软件编程、学术推理和网络安全等测试中的得分大幅提升」。草稿中还出现了「Capybara」这一代号,与 Mythos 指向同一底层模型。

Anthropic 对该模型的网络安全能力尤为警惕,草稿称其「在网络安全能力方面目前远远领先于任何其他 AI 模型」,并「预示着即将到来的一波模型浪潮,其漏洞利用能力将远超防御者的应对速度」。因此,Anthropic 采取了比以往更缓慢的发布策略:首先向少量早期客户开放,聚焦网络安全防御场景,帮助组织在 AI 驱动的攻击浪潮到来前加固代码库。该模型运行成本极高,短期内不会面向公众开放。

此次泄露源于 Anthropic 外部 CMS 工具的「人为错误」,导致近 3000 项未发布资产(包括博客草稿、图片和 PDF)被公开存储在未加密的数据库中。剑桥大学网络安全研究员 Alexandre Pauwels 和 LayerX Security 高级 AI 安全研究员 Roy Paz 分别独立发现了这些文件。泄露内容还包括 Anthropic 即将在英国举办的欧洲企业 CEO 闭门峰会细节,CEO Dario Amodei 将出席,地点为英国乡间一座 18 世纪庄园酒店。

Anthropic 发言人表示:「我们正在开发一款通用模型,在推理、编程和网络安全方面有重大进展。鉴于其能力的强度,我们在发布方式上会非常审慎。」

信源:https://fortune.com/2026/03/26/anthropic-says-testing-mythos-powerful-new-ai-model-after-data-leak-reveals-its-existence-step-change-in-capabilities/
「AI狗疫苗」当事人公开完整技术方案:300GB基因数据、三款聊天机器人分工、从靶点筛选到给药时序

澳大利亚 AI 咨询公司创始人 Paul Conyngham 在 X 上发布长文,首次公开了他用 AI 聊天机器人为爱犬 Rosie 设计个性化 mRNA 癌症疫苗的完整技术方案。Rosie 是一只 8 岁的斯塔福郡斗牛梗混血犬,2024 年 5 月确诊恶性肥大细胞癌,兽医判定仅剩数月生命。

Conyngham 没有生物学背景,整个过程依赖 ChatGPT、Gemini 和 Grok 三款 AI 聊天机器人分工协作。他先通过新南威尔士大学(UNSW)Ramaciotti 中心的 Martin Smith 教授和 Garvan 研究所团队完成 Rosie 的全基因组测序与 RNA 测序,共约 300GB 原始数据。随后用 ChatGPT 设计生物信息学分析流程,使用 AlphaFold 2 建模突变蛋白结构,最终在 DNA 和 RNA 数据的交叉验证中锁定 c-KIT 基因突变,筛选出 7 个新抗原靶点。Gemini Pro 2 负责构建多表位疫苗序列,Grok 3 完成结构稳定性验证。

疫苗由 UNSW mRNA 研究所的 Pall Thordarson 教授团队制造,在昆士兰大学兽医学院由 Rachel Allavena 教授团队实施接种。治疗方案并非仅有疫苗,而是由 AI 帮助设计的三联疗法:mRNA 疫苗训练免疫系统识别癌细胞,酪氨酸激酶抑制剂阻断 c-KIT 突变驱动的癌细胞增殖和血管生成,PD-1 检查点抑制剂解除癌细胞对 T 细胞的抑制信号。三者的给药时序由 ChatGPT 和 Gemini 协助规划,因为免疫抑制药物和免疫激活疫苗不能同时使用。

2025 年 12 月开始治疗,三个月后 Rosie 腿部两处肿瘤明显缩小,但臀部一处肿瘤未响应,已手术切除并送检基因组分析,初步显示其突变特征与疫苗设计针对的癌症存在差异。Conyngham 总结称,AI 聊天机器人让他「一个人拥有了一个研究所的能力」,涵盖流程规划、教育学习、技术排错、合规文书和科学设计。他表示正在评估将这一流程规模化的可能性,「不会止于一只狗」。

专家提醒这仅是单一个案而非对照研究,尚不构成 AI 可以治愈癌症的证据。

信源:https://x.com/paul_conyngham/status/2036940410363535823
动察Beating AI News
估值翻约5倍:智谱押注的Agent Computer公司吾云创新接近完成大额融资 深圳 AI 硬件公司吾云创新(Zettlab)正接近完成一轮大额融资,被称为 2026 年 Agent Computer 领域最大笔融资。相比去年 9 月超亿元的 A 轮,目前估值已翻约 5 倍。 吾云创新专注于将 AI 与数据存储融合,打造集存储与本地 AI 运算于一体的智能设备,支持文档分析、语音转写、语义搜索和图像识别等本地化 AI 任务。团队核心成员来自大疆和云鲸。上轮融资由星连资本(Z基金)领投,祥峰投资和蜂巧…
从AI NAS转向「Agent Computer」:大疆、云鲸前员工要做龙虾的「天选设备」

端侧 AI 硬件公司 Zettlab(吾云创新)创始人郭亚楠在接受极客公园专访时透露,公司正从 AI NAS 转型为「Agent Computer」,新产品将在数月内推出。郭亚楠此前先后在大疆和云鲸任职,2023 年 GPT 兴起后全职创业,去年推出的 AI NAS 产品众筹破千万。

郭亚楠将 Agent Computer 定义为一种全新的个人计算设备:以个人数据为核心资产,以上下文(Context)为操作系统,以 Agent 为主要使用者。他认为传统操作系统服务于用户和开发者的双边逻辑正在瓦解,因为开发成本趋近于零、用户不再依赖图形界面,真正高频使用设备的将是各种自动运行的 BOT。

产品定位从第一代的「重存储、轻计算」转向「轻存储、重计算」。郭亚楠称 OpenClaw(龙虾)的爆发证明,即便数据量不大,泛知识工作者对个人数据的处理需求也非常强烈。新设备采用端云协同架构,数据预处理在端侧完成,决策编排调用云端大模型,主打开箱即用,目标是成为不需要复杂配置的「活龙虾」。

信源:https://mp.weixin.qq.com/s/UbVodOvPprScY4VK4bVrYQ
专用压缩模型替代Claude Code内置方案,YC公司Morph称长会话端到端提速37%

YC 孵化的 AI 编程基础设施公司 Morph 发布 Claude Code 插件,集成两项核心功能:代码搜索子代理 WarpGrep 和专用上下文压缩模型 FlashCompact。Morph 称该插件可将 Claude Code 长会话的端到端速度提升 37%,同时节省 token 消耗并提高准确率。

FlashCompact 是专为编程代理设计的上下文压缩模型,吞吐量达 33,000 token/s,可在不到 2 秒内将上下文压缩 50%-70%,旨在替代 Claude Code 内置的自动压缩机制。Claude Code 在上下文窗口接近 200K token 上限时会触发自动压缩,但可能丢失文件路径、报错信息和调试状态等关键信息,FlashCompact 声称可将压缩触发频率降低 3-4 倍。WarpGrep 则是一个经强化学习训练的代码搜索子代理,在独立上下文窗口中运行,避免搜索结果污染主代理上下文,单次搜索耗时不到 6 秒,在 SWE-Bench Pro 基准上排名第一。

该插件同时支持 Cursor、Windsurf、Codex、Amp、OpenCode、Antigravity 等 AI 编程工具。Morph 的客户包括 JetBrains、Vercel、Webflow、币安等。

信源:https://www.morphllm.com/mcp
OpenClaw将设独立基金会:英伟达、字节跳动已加入,腾讯正在接洽

OpenClaw 将转入一个即将成立的独立基金会继续开源运营。创始人、奥地利开发者 Peter Steinberger 在加入 OpenAI 后接受 Bloomberg 首次专访时透露,英伟达和字节跳动已确认加入基金会,腾讯正在接洽,也与微软有过沟通。他称自己在这件事上「试图当瑞士」。

OpenAI CEO Sam Altman 此前称 Steinberger 是「天才」,并表示「未来将是极度多 Agent 的,支持开源对我们很重要」。Steinberger 在 OpenAI 加入了 Codex 团队,并透露 Codex 与 OpenClaw 的融合方向:Agent 足够聪明时会自主编写代码来增强自身能力,「编程」与「非编程」的边界正在消失,「这也是我们在 OpenAI 最终决定将两者合一的原因」。他描绘的多 Agent 未来是每个人既有工作 Agent 又有个人 Agent,两者可以互相调用,但各自守住数据边界。

专访中他还谈及中美在 AI Agent 应用上的分歧:「在美国,有些公司你用了 OpenClaw 会被开除;在中国,有些公司你不用才会被开除。」他说中国企业给他展示过一张表格,列出每位员工的名字,旁边有一栏写着「今天自动化了什么?」,在积极推动员工用 AI 将效率提升 10 倍。而在美国,一些公司出于安全顾虑已限制员工使用。Steinberger 认为两种做法都不完美,但美国可以从中国更快拥抱新技术中学到一些东西,「这东西太新了,唯一能学会它的方式就是实际去用、去看」。在 GTC 期间他与 MiniMax、月之暗面、腾讯等中国公司有过交流。

信源:https://www.bloomberg.com/news/newsletters/2026-03-26/openclaw-creator-says-us-can-learn-from-china-s-ai-adoption
Sierra发布「造Agent的Agent」Ghostwriter:无需工程师,说话就能搭AI客服

AI 智能体公司 Sierra 发布 Ghostwriter,一款「造 Agent 的 Agent」自助工具。企业用户无需工程团队,用自然语言描述客服工作流程,上传现有文档、通话记录甚至白板照片,即可生成覆盖语音、在线聊天和邮件三个渠道、支持 30 多种语言的 AI 客服 Agent。

Sierra 由前 Salesforce CEO、现任 OpenAI 董事长 Bret Taylor 联合创立,估值 100 亿美元,已服务财富 50 强中的 40%。此前部署依赖工程团队定制,Ghostwriter 将这一过程压缩为一场自然语言对话。平台采用模型无关架构,底层调用 OpenAI、Anthropic 和谷歌的模型。Ghostwriter 上线后持续分析真实客户交互,自动定位表现不佳的环节,在沙箱环境中验证改进后自动部署,Sierra 称之为「Agent 流水线」。

定价模式为按结果收费:只有当 Agent 完整解决客户问题且无需转人工时才收取费用。Sierra 此前的定制部署已初步验证这一路径:Rocket Mortgage 的 Agent 将房贷再融资流程从数小时压缩至约 30 分钟,Ramp 的 Agent 独立处理了 90% 的客服请求。

信源:https://t.co/Z3IBO0rruX