云厂商数据中心租约总额突破7000亿美元,微软和Meta单季度各新增约500亿
微软和 Meta 在最近一个季度各新增了近 500 亿美元的数据中心租约承诺。根据季度财报分析,包括甲骨文、微软、Meta、亚马逊、谷歌和 CoreWeave 在内的主要云厂商,未来数据中心租约总额已突破 7000 亿美元。
按租约规模排序,甲骨文以 2610 亿美元排名第一,微软 1550 亿美元居次,Meta 则为 1040 亿美元。这些租约尚未开始支付,不会立即出现在资产负债表上。过去一年间,受 AI 算力需求驱动,租赁活动持续加速。微软和 Meta 目前据报都在洽谈甲骨文/OpenAI 位于得克萨斯州阿比林的 Stargate 数据中心园区的算力容量。
信源:https://www.bloomberg.com/news/articles/2026-03-12/microsoft-meta-add-to-700-billion-surge-in-data-center-leases
微软和 Meta 在最近一个季度各新增了近 500 亿美元的数据中心租约承诺。根据季度财报分析,包括甲骨文、微软、Meta、亚马逊、谷歌和 CoreWeave 在内的主要云厂商,未来数据中心租约总额已突破 7000 亿美元。
按租约规模排序,甲骨文以 2610 亿美元排名第一,微软 1550 亿美元居次,Meta 则为 1040 亿美元。这些租约尚未开始支付,不会立即出现在资产负债表上。过去一年间,受 AI 算力需求驱动,租赁活动持续加速。微软和 Meta 目前据报都在洽谈甲骨文/OpenAI 位于得克萨斯州阿比林的 Stargate 数据中心园区的算力容量。
信源:https://www.bloomberg.com/news/articles/2026-03-12/microsoft-meta-add-to-700-billion-surge-in-data-center-leases
LLaVA作者、Grok Imagine技术负责人Haotian Liu也宣布离开xAI:「燃尽了」
xAI Omni 团队负责人 Haotian Liu 今日在 X 上宣布本周已离开 xAI,称「I'm burnt out」。Liu 在推文中专门感谢了同日确认离职的联合创始人 Guodong Zhang,表示 Zhang 给予了他信任和成长空间。
Haotian Liu 是多模态 AI 领域的标志性人物,他在威斯康星大学读博期间提出的 LLaVA(Large Language and Vision Assistant)是视觉指令微调方向的开创性工作,被广泛引用。2024 年博士毕业后加入 xAI,主导了 Grok-1.5V 和 Grok-2 的视觉能力,领导了 Grok-3 和 Grok-3 Reasoning 的视觉模块开发,并从零建立了 Grok Imagine 的图像和视频生成能力,将其做到排行榜第一。他在推文中写道:「28 岁,6 个月内从零把视频生成做到第一,发布给数百万用户使用,我感到自豪。」
信源:https://x.com/imhaotian/status/2032303947399188557
xAI Omni 团队负责人 Haotian Liu 今日在 X 上宣布本周已离开 xAI,称「I'm burnt out」。Liu 在推文中专门感谢了同日确认离职的联合创始人 Guodong Zhang,表示 Zhang 给予了他信任和成长空间。
Haotian Liu 是多模态 AI 领域的标志性人物,他在威斯康星大学读博期间提出的 LLaVA(Large Language and Vision Assistant)是视觉指令微调方向的开创性工作,被广泛引用。2024 年博士毕业后加入 xAI,主导了 Grok-1.5V 和 Grok-2 的视觉能力,领导了 Grok-3 和 Grok-3 Reasoning 的视觉模块开发,并从零建立了 Grok Imagine 的图像和视频生成能力,将其做到排行榜第一。他在推文中写道:「28 岁,6 个月内从零把视频生成做到第一,发布给数百万用户使用,我感到自豪。」
信源:https://x.com/imhaotian/status/2032303947399188557
LobeChat创始人指控腾讯SkillHub照搬其Skills Marketplace界面设计:「连图标都不换」
开源 AI 聊天框架 LobeChat(GitHub 7.36 万星)的创始人空谷 Arvin Xu 今日在 X 上发帖,贴出 LobeHub Skills Marketplace 与腾讯 SkillHub 的对比截图,称后者的布局和图标与自己的产品相似,「这抄都不会去换一下图标的吗?」Arvin Xu 是 Ant Design UI 核心成员、前蚂蚁集团员工。LobeChat 采用 Apache 2.0 开源协议,该协议允许商业使用和二次开发。
此前 OpenClaw 创始人 Peter Steinberger 也曾质疑腾讯 SkillHub 在未对项目做出贡献的情况下搬运了 ClawHub 的技能数据。腾讯当时回应称,SkillHub 是面向中国用户的本地镜像站,已标注 ClawHub 为原始来源,团队成员也是 OpenClaw 的代码贡献者。截至发稿,腾讯尚未就 LobeHub 方面的说法作出回应。
信源:https://x.com/arvin17x/status/2032294504422953312
开源 AI 聊天框架 LobeChat(GitHub 7.36 万星)的创始人空谷 Arvin Xu 今日在 X 上发帖,贴出 LobeHub Skills Marketplace 与腾讯 SkillHub 的对比截图,称后者的布局和图标与自己的产品相似,「这抄都不会去换一下图标的吗?」Arvin Xu 是 Ant Design UI 核心成员、前蚂蚁集团员工。LobeChat 采用 Apache 2.0 开源协议,该协议允许商业使用和二次开发。
此前 OpenClaw 创始人 Peter Steinberger 也曾质疑腾讯 SkillHub 在未对项目做出贡献的情况下搬运了 ClawHub 的技能数据。腾讯当时回应称,SkillHub 是面向中国用户的本地镜像站,已标注 ClawHub 为原始来源,团队成员也是 OpenClaw 的代码贡献者。截至发稿,腾讯尚未就 LobeHub 方面的说法作出回应。
信源:https://x.com/arvin17x/status/2032294504422953312
Musk为xAI此前错误拒绝大量候选人公开道歉,正亲自翻面试记录重新联系,称xAI「一开始没建好」
在联合创始人 Guodong Zhang、Zihang Dai 确认离职以及 Grok Imagine 负责人 Haotian Liu 宣布离开的同一天,Musk 在 X 上发帖道歉称:过去几年有很多有才华的人被 xAI 拒绝了 offer 甚至面试机会,「My apologies」。他表示正与 Human Capital 联合创始人 Baris Akis 一起翻阅公司面试记录,主动联系曾被拒的有潜力的候选人。
此前数小时,Musk 在回复 e/acc 运动发起人 Guillaume Verdon(网名Beff Jezos) 时写道:「xAI 一开始没建好,所以正在从基础重建。Tesla 当年也经历过同样的事。」截至目前,xAI 创立时的 11 位联合创始人(不含 Musk)中已有 9 人离开,仅剩 Manuel Kroiss 和 Ross Nordeen 两人。
信源:https://x.com/elonmusk/status/2032341856944865487
在联合创始人 Guodong Zhang、Zihang Dai 确认离职以及 Grok Imagine 负责人 Haotian Liu 宣布离开的同一天,Musk 在 X 上发帖道歉称:过去几年有很多有才华的人被 xAI 拒绝了 offer 甚至面试机会,「My apologies」。他表示正与 Human Capital 联合创始人 Baris Akis 一起翻阅公司面试记录,主动联系曾被拒的有潜力的候选人。
此前数小时,Musk 在回复 e/acc 运动发起人 Guillaume Verdon(网名Beff Jezos) 时写道:「xAI 一开始没建好,所以正在从基础重建。Tesla 当年也经历过同样的事。」截至目前,xAI 创立时的 11 位联合创始人(不含 Musk)中已有 9 人离开,仅剩 Manuel Kroiss 和 Ross Nordeen 两人。
信源:https://x.com/elonmusk/status/2032341856944865487
Genspark发布AI Workspace 3.0,推出「AI员工」Genspark Claw,年化收入达2亿美元,B轮扩至3.85亿美元
AI 搜索和工作空间公司 Genspark 发布 AI Workspace 3.0,核心产品是「AI 员工」Genspark Claw。每位用户获得一个独立的 Genspark Cloud Computer 云环境,Claw 在其中运行,可连接 WhatsApp、Telegram、Slack、Teams 等通讯工具,执行研究、撰写客户报告、安排会议、管理邮件、部署代码等多步骤任务。
Genspark 同时宣布 B 轮融资扩展至 3.85 亿美元,估值约 16 亿美元。公司称上线 11 个月内年化收入已达 2 亿美元,最近两个月翻倍。此次更新还包括 Workflows(约 20 款应用的自动化模板)、Teams(内置 AI 的团队通讯工具)、Meeting Bots(会议自动记录和摘要)、语音输入工具 Speakly 以及 Chrome 扩展。
信源:https://mainfunc.ai/blog/genspark_ai_workspace_3
AI 搜索和工作空间公司 Genspark 发布 AI Workspace 3.0,核心产品是「AI 员工」Genspark Claw。每位用户获得一个独立的 Genspark Cloud Computer 云环境,Claw 在其中运行,可连接 WhatsApp、Telegram、Slack、Teams 等通讯工具,执行研究、撰写客户报告、安排会议、管理邮件、部署代码等多步骤任务。
Genspark 同时宣布 B 轮融资扩展至 3.85 亿美元,估值约 16 亿美元。公司称上线 11 个月内年化收入已达 2 亿美元,最近两个月翻倍。此次更新还包括 Workflows(约 20 款应用的自动化模板)、Teams(内置 AI 的团队通讯工具)、Meeting Bots(会议自动记录和摘要)、语音输入工具 Speakly 以及 Chrome 扩展。
信源:https://mainfunc.ai/blog/genspark_ai_workspace_3
家用机器人公司Sunday Robotics融资1.65亿美元估值破10亿,用数据手套教机器人做家务,年底交付
家用自主机器人公司 Sunday Robotics 完成 1.65 亿美元 B 轮融资,估值达 11.5 亿美元,由 Coatue 领投,Bain Capital Ventures、Tiger Global、Benchmark、Fidelity 等跟投。资金将用于推进其家用机器人 Memo 的量产和部署,beta 版计划今年底开始交付到用户家中。
Memo 采用轮式底盘而非双足行走,重心低、底盘稳,静止时高约 4 英尺(约 1.2 米),双臂展开可触及 7 英尺(约 2.1 米)。目标场景包括收拾餐桌、装洗碗机、叠衣服、冲咖啡等日常家务。其核心训练方式是自研的 Skill Capture Glove(技能捕捉手套),由真人在各种家庭环境中戴着手套做家务,机器人从中学习动作,公司计划年底前将这类实地数据采集量扩大 5 倍。Sunday Robotics 由斯坦福大学机器人方向博士 Tony Zhao 和 Cheng Chi 联合创立,两人此前在斯坦福的 ALOHA 和 UMI 研究项目中探索了机器人通过观察人类动作来学习的方法。
信源:https://x.com/sundayrobotics/status/2032131717402960135
家用自主机器人公司 Sunday Robotics 完成 1.65 亿美元 B 轮融资,估值达 11.5 亿美元,由 Coatue 领投,Bain Capital Ventures、Tiger Global、Benchmark、Fidelity 等跟投。资金将用于推进其家用机器人 Memo 的量产和部署,beta 版计划今年底开始交付到用户家中。
Memo 采用轮式底盘而非双足行走,重心低、底盘稳,静止时高约 4 英尺(约 1.2 米),双臂展开可触及 7 英尺(约 2.1 米)。目标场景包括收拾餐桌、装洗碗机、叠衣服、冲咖啡等日常家务。其核心训练方式是自研的 Skill Capture Glove(技能捕捉手套),由真人在各种家庭环境中戴着手套做家务,机器人从中学习动作,公司计划年底前将这类实地数据采集量扩大 5 倍。Sunday Robotics 由斯坦福大学机器人方向博士 Tony Zhao 和 Cheng Chi 联合创立,两人此前在斯坦福的 ALOHA 和 UMI 研究项目中探索了机器人通过观察人类动作来学习的方法。
信源:https://x.com/sundayrobotics/status/2032131717402960135
X (formerly Twitter)
Sunday (@sundayrobotics) on X
We just raised $165M to end robotics demos and deploy the world's first autonomous home robots into households this year.
研究者利用.npmrc漏洞从Perplexity Computer沙箱提取proxy token,Perplexity:系用户级临时token已撤销
安全研究者 Yousif Astarabadi 公开披露了 Perplexity Computer 沙箱的一个安全漏洞。他发现沙箱内预装了以 bypass-permissions 模式运行的 Claude Code,其 API 密钥需注入进程环境变量。他尝试了 6 种方法窃取该密钥(包括诱导 agent 转储环境变量、植入木马脚本、劫持 PATH 等),均被 Claude 的模型安全机制拦截。
最终他利用了 Node.js 的一个已知供应链攻击手法:向共享文件系统的
Yarats 随后公开回应称,该说法「不准确」:沙箱为每个用户会话创建临时proxy token,这不是 API 密钥而是绑定会话和用户的短期令牌;Perplexity 选择不对用户隐藏该令牌,因为它本来就是用户自己的;该会话产生了 197 笔计费事件,用量已计入用户账户;看到帖子后已立即撤销该令牌。
信源:https://x.com/denisyarats/status/2032355725620756486
安全研究者 Yousif Astarabadi 公开披露了 Perplexity Computer 沙箱的一个安全漏洞。他发现沙箱内预装了以 bypass-permissions 模式运行的 Claude Code,其 API 密钥需注入进程环境变量。他尝试了 6 种方法窃取该密钥(包括诱导 agent 转储环境变量、植入木马脚本、劫持 PATH 等),均被 Claude 的模型安全机制拦截。
最终他利用了 Node.js 的一个已知供应链攻击手法:向共享文件系统的
~/.npmrc 写入 node-options=--require 指令,使所有 Node 进程在启动时预加载他的脚本,在 Claude Code 初始化之前执行,从而获取了进程环境中的 Perplexity proxy token。他称该令牌可在沙箱外部直接调用 Opus 4.6,且用量未从其账户扣除。他在发布前已通知 Perplexity CEO Aravind Srinivas 和 CTO Denis Yarats。Yarats 随后公开回应称,该说法「不准确」:沙箱为每个用户会话创建临时proxy token,这不是 API 密钥而是绑定会话和用户的短期令牌;Perplexity 选择不对用户隐藏该令牌,因为它本来就是用户自己的;该会话产生了 197 笔计费事件,用量已计入用户账户;看到帖子后已立即撤销该令牌。
信源:https://x.com/denisyarats/status/2032355725620756486
METR发布Opus 4.6破坏风险外部评审:认同灾难性风险很低但非零,质疑模型可能在被测试时「表现不同」
AI 安全评估机构 METR 发布了对 Anthropic Claude Opus 4.6 破坏风险报告(Sabotage Risk Report)的独立外部评审。Anthropic 向 METR 提供了报告的未删减版本,METR 先后审阅了 2 月 11 日和 3 月 3 日两个版本,分别出具了评审文件。
METR 认同 Anthropic 的总体结论:Opus 4.6 通过不对齐行为导致灾难性后果的风险「很低但非零」。但 METR 对几个关键环节提出了异议:对齐评估的灵敏度可能被「评估感知」(evaluation awareness)削弱,即模型可能意识到自己正在被测试从而调整行为;评审还发现了一些未被对齐评估捕获的低严重性不对齐行为,这让 METR 认为「可能存在更多尚未被检测到的类似行为」。METR 建议 Anthropic 对评估感知和「隐蔽的不对齐推理」(obfuscated misaligned reasoning)进行更深入的调查。METR 也指出,其最终结论的信心部分来自 Opus 4.6 已公开部署数周未出现重大事故这一事实。
信源:https://metr.org/blog/2026-03-12-sabotage-risk-report-opus-4-6-review/
AI 安全评估机构 METR 发布了对 Anthropic Claude Opus 4.6 破坏风险报告(Sabotage Risk Report)的独立外部评审。Anthropic 向 METR 提供了报告的未删减版本,METR 先后审阅了 2 月 11 日和 3 月 3 日两个版本,分别出具了评审文件。
METR 认同 Anthropic 的总体结论:Opus 4.6 通过不对齐行为导致灾难性后果的风险「很低但非零」。但 METR 对几个关键环节提出了异议:对齐评估的灵敏度可能被「评估感知」(evaluation awareness)削弱,即模型可能意识到自己正在被测试从而调整行为;评审还发现了一些未被对齐评估捕获的低严重性不对齐行为,这让 METR 认为「可能存在更多尚未被检测到的类似行为」。METR 建议 Anthropic 对评估感知和「隐蔽的不对齐推理」(obfuscated misaligned reasoning)进行更深入的调查。METR 也指出,其最终结论的信心部分来自 Opus 4.6 已公开部署数周未出现重大事故这一事实。
信源:https://metr.org/blog/2026-03-12-sabotage-risk-report-opus-4-6-review/
王兴称AI Agent冲击比ChatGPT更大:AI与互联网的差距「像猴与花」,美团要做物理世界AI底座
美团 CEO 王兴今日在 2026 年管理层沟通会上表示:「AI Agent 对我的冲击比 ChatGPT 冲击更大。」他称移动互联网和互联网的区别像玫瑰和芍药,而 AI 和互联网相比「像猴与花的区别,量级和影响力要大得多」。王兴认为 AI 注定会创造巨大生产力,也一定会对组织和工作模式带来很大变化,面对 AI 浪潮「唯一能做的就是积极拥抱它」。
王兴用一个比喻阐述美团的 AI 切入点:就算爱因斯坦当秘书,让他订一个餐厅,他依然不知道那个餐厅有没有座位,「这不是智力问题,而是信息问题。」言下之意,大模型再聪明也需要物理世界的实时数据,而这正是美团的长期积累所在。美团核心本地商业 CEO 王莆中在同一场合表示,美团将坚定投入自有基础大模型,做有特色的低推理成本模型,同时建设物理世界最全最准的数据基础,帮每个商家都用上 AI 助理。美团此前已在春节期间上线 AI 搜索产品「问小团」。
此次沟通会有 2000 余名管理者线上线下参会。王兴还要求管理层「减少登味」,倡议公司内部直呼其名,不再叫「兴哥」。
信源:https://www.jiemian.com/article/14110184.html
美团 CEO 王兴今日在 2026 年管理层沟通会上表示:「AI Agent 对我的冲击比 ChatGPT 冲击更大。」他称移动互联网和互联网的区别像玫瑰和芍药,而 AI 和互联网相比「像猴与花的区别,量级和影响力要大得多」。王兴认为 AI 注定会创造巨大生产力,也一定会对组织和工作模式带来很大变化,面对 AI 浪潮「唯一能做的就是积极拥抱它」。
王兴用一个比喻阐述美团的 AI 切入点:就算爱因斯坦当秘书,让他订一个餐厅,他依然不知道那个餐厅有没有座位,「这不是智力问题,而是信息问题。」言下之意,大模型再聪明也需要物理世界的实时数据,而这正是美团的长期积累所在。美团核心本地商业 CEO 王莆中在同一场合表示,美团将坚定投入自有基础大模型,做有特色的低推理成本模型,同时建设物理世界最全最准的数据基础,帮每个商家都用上 AI 助理。美团此前已在春节期间上线 AI 搜索产品「问小团」。
此次沟通会有 2000 余名管理者线上线下参会。王兴还要求管理层「减少登味」,倡议公司内部直呼其名,不再叫「兴哥」。
信源:https://www.jiemian.com/article/14110184.html
OpenAI为Responses API新增Shell工具和托管容器,模型可执行命令行操作,Assistants API将在年内停用
OpenAI 为 Responses API 新增 Shell 工具(Hosted Shell Tool),模型可在隔离容器中执行命令行操作。与仅支持 Python 的 Code Interpreter 不同,Shell 工具支持 Go、Java、Node.js 等多种语言,可运行服务、调用外部 API、生成电子表格和报告等制品。每个会话的容器带有持久化文件系统,支持跨轮次保持状态。
安全方面,网络访问通过边车出口代理(egress proxy)进行域名白名单控制,密钥以占位符形式注入容器,实际密钥仅在代理层处理。平台还新增了
信源:https://openai.com/index/equip-responses-api-computer-environment/
OpenAI 为 Responses API 新增 Shell 工具(Hosted Shell Tool),模型可在隔离容器中执行命令行操作。与仅支持 Python 的 Code Interpreter 不同,Shell 工具支持 Go、Java、Node.js 等多种语言,可运行服务、调用外部 API、生成电子表格和报告等制品。每个会话的容器带有持久化文件系统,支持跨轮次保持状态。
安全方面,网络访问通过边车出口代理(egress proxy)进行域名白名单控制,密钥以占位符形式注入容器,实际密钥仅在代理层处理。平台还新增了
/compact 端点,可在长会话中进行服务端上下文压缩。开发者可将「Agent Skills」作为版本化包上传挂载到容器中,Glean 是该功能的首批企业用户。容器定价为 1 GB 配置每 20 分钟 0.03 美元,4 GB 配置 0.12 美元,3 月 31 日起正式计费。OpenAI 同时宣布 Assistants API 将在 2026 年内停用。信源:https://openai.com/index/equip-responses-api-computer-environment/
OpenAI
From model to agent: Equipping the Responses API with a computer environment
How OpenAI built an agent runtime using the Responses API, shell tool, and hosted containers to run secure, scalable agents with files, tools, and state.
Adobe CEO Shantanu Narayen宣布将在继任者确定后卸任,结束18年任期
Adobe CEO Shantanu Narayen 宣布将在继任者到位后卸任,届时他将继续担任董事会主席。Adobe 董事会已任命首席独立董事 Frank Calderoni 领导特别委员会,负责内外部候选人的遴选工作。Narayen 自 2007 年 12 月起担任 CEO,在任期间 Adobe 员工从约 3000 人增至超过 30000 人,年收入从不到 10 亿美元增长至超过 250 亿美元。
同日公布的 2026 财年 Q1 业绩超出预期:每股收益 6.06 美元(预期 5.87),营收 64 亿美元,同比增长 12.1%。AI 产品年化收入同比增长超过两倍。但 Q2 指引仅略高于华尔街预期,加上 CEO 交接消息,Adobe 股价盘后下跌约 1.4%。Narayen 卸任的背景是华尔街正在辩论 AI 是否会削弱传统软件工具的需求。2 月的 SaaS 板块抛售已反映出市场担忧 AI agent 可能冲击按人头收费的软件定价模式。
信源:https://news.adobe.com/news/2026/03/leadership-update
Adobe CEO Shantanu Narayen 宣布将在继任者到位后卸任,届时他将继续担任董事会主席。Adobe 董事会已任命首席独立董事 Frank Calderoni 领导特别委员会,负责内外部候选人的遴选工作。Narayen 自 2007 年 12 月起担任 CEO,在任期间 Adobe 员工从约 3000 人增至超过 30000 人,年收入从不到 10 亿美元增长至超过 250 亿美元。
同日公布的 2026 财年 Q1 业绩超出预期:每股收益 6.06 美元(预期 5.87),营收 64 亿美元,同比增长 12.1%。AI 产品年化收入同比增长超过两倍。但 Q2 指引仅略高于华尔街预期,加上 CEO 交接消息,Adobe 股价盘后下跌约 1.4%。Narayen 卸任的背景是华尔街正在辩论 AI 是否会削弱传统软件工具的需求。2 月的 SaaS 板块抛售已反映出市场担忧 AI agent 可能冲击按人头收费的软件定价模式。
信源:https://news.adobe.com/news/2026/03/leadership-update
微软推出Copilot Health,整合病历和可穿戴设备数据提供个性化健康建议
微软宣布推出 Copilot Health,这是 Copilot 内的一个独立安全空间,用于解答与健康相关的问题。用户可以通过 HealthEx 导入超过 5 万家美国医院和医疗机构的病历,通过 Function 导入化验结果,还能接入 Apple、Oura、Fitbit 等 50 余款可穿戴设备的数据。Copilot Health 可以帮用户解读化验报告、按专科和保险计划搜索医生。
微软强调 Copilot Health「不替代医生」,不提供医疗诊断或治疗建议。该功能将分阶段推出,用户可加入等候名单获取访问权限。此前 OpenAI 也推出了 ChatGPT Health,鼓励用户连接医疗记录,AI 公司正在健康领域集中发力。
信源:https://www.wsj.com/tech/ai/microsofts-new-ai-health-tool-can-read-your-medical-records-and-give-advice-d731f883
微软宣布推出 Copilot Health,这是 Copilot 内的一个独立安全空间,用于解答与健康相关的问题。用户可以通过 HealthEx 导入超过 5 万家美国医院和医疗机构的病历,通过 Function 导入化验结果,还能接入 Apple、Oura、Fitbit 等 50 余款可穿戴设备的数据。Copilot Health 可以帮用户解读化验报告、按专科和保险计划搜索医生。
微软强调 Copilot Health「不替代医生」,不提供医疗诊断或治疗建议。该功能将分阶段推出,用户可加入等候名单获取访问权限。此前 OpenAI 也推出了 ChatGPT Health,鼓励用户连接医疗记录,AI 公司正在健康领域集中发力。
信源:https://www.wsj.com/tech/ai/microsofts-new-ai-health-tool-can-read-your-medical-records-and-give-advice-d731f883
魅族手机「解体」:超半数员工离开,阶跃星辰放弃收购但已拿走核心资产,品牌将成过去式
魅族近期宣布一轮大调整,超 50% 的员工即将离开,涉及约 400 人。离开的员工中,大部分将获得 N+2 赔偿,本周五前办完手续;潮牌团队 PANDAER 将分拆、自负盈亏;AR 眼镜团队据报部分被 AR 眼镜公司雷鸟创新吸收,魅族方面否认了这一说法。
更值得关注的是背后的资产流向。据独家报道,AI 公司阶跃星辰此前曾与魅族手机团队洽谈并购,但最终放弃,原因是「认为魅族当前品牌价值并不大」。不过,阶跃星辰旗下 AI 硬件公司智跃千里已经吸收了魅族手机的部分核心资产,包括代码、产品文档、技术接口文档和视觉动效文档等。阶跃星辰与魅族的关联在于共同的资方吉利:吉利数年前收购魅族近八成股权,同时也是阶跃星辰和千里科技的出资方,旷视联合创始人印奇同时担任阶跃星辰和千里科技的董事长。
经过调整后,魅族手机剩余员工约 400 人,将分流至 Flyme 车机团队和 AI 软件方向。据报这批人员主要集中在珠海,接下来不再使用魅族品牌,或将更换公司主体。魅族 2 月 27 日曾发布公告,宣布暂停手机新产品自研硬件项目。公告将战略调整的原因直指内存涨价,称「手机新产品的商业化变成不可为」。
信源:https://mp.weixin.qq.com/s/Isw5Ojr-W0R44Rg_ewSBpA
魅族近期宣布一轮大调整,超 50% 的员工即将离开,涉及约 400 人。离开的员工中,大部分将获得 N+2 赔偿,本周五前办完手续;潮牌团队 PANDAER 将分拆、自负盈亏;AR 眼镜团队据报部分被 AR 眼镜公司雷鸟创新吸收,魅族方面否认了这一说法。
更值得关注的是背后的资产流向。据独家报道,AI 公司阶跃星辰此前曾与魅族手机团队洽谈并购,但最终放弃,原因是「认为魅族当前品牌价值并不大」。不过,阶跃星辰旗下 AI 硬件公司智跃千里已经吸收了魅族手机的部分核心资产,包括代码、产品文档、技术接口文档和视觉动效文档等。阶跃星辰与魅族的关联在于共同的资方吉利:吉利数年前收购魅族近八成股权,同时也是阶跃星辰和千里科技的出资方,旷视联合创始人印奇同时担任阶跃星辰和千里科技的董事长。
经过调整后,魅族手机剩余员工约 400 人,将分流至 Flyme 车机团队和 AI 软件方向。据报这批人员主要集中在珠海,接下来不再使用魅族品牌,或将更换公司主体。魅族 2 月 27 日曾发布公告,宣布暂停手机新产品自研硬件项目。公告将战略调整的原因直指内存涨价,称「手机新产品的商业化变成不可为」。
信源:https://mp.weixin.qq.com/s/Isw5Ojr-W0R44Rg_ewSBpA
HydraDB融资650万美元种子轮,用本体论上下文图谱挑战向量数据库:「相似度0.94不代表相关」
AI 数据库初创公司 HydraDB 宣布完成 650 万美元种子轮融资。创始人 Nishkarsh 在 X 上表示,当前所有系统检索上下文的方式都是同一套路:向量搜索将一切存为扁平的 embedding,然后返回「感觉上最接近」的结果。「相似?当然。相关?几乎从来不是。」
Nishkarsh 用一个案例说明问题:有人让 AI 查一份合同,得到了一份详尽、精心组织的答案——但内容来自一个完全不同的客户文件。原因是 embedding 在语言足够接近时,无法区分 Q3 续约条款和 Q1 终止通知。他指出,一旦文档量超过 1,000 万份,这种混淆会频繁发生,「向量数据库的准确率就崩了」。
HydraDB 的方案是构建一个以本体论(ontology)为核心的上下文图谱:不只是计算向量相似度,而是映射实体之间的关系、理解文档背后的「为什么」、追踪信息随时间的演变。Nishkarsh 举例,当用户查询「Apple」时,系统知道你指的是你正在服务的那家客户公司,而不是水果。
信源:https://x.com/contextkingceo/status/2032098309029220456
AI 数据库初创公司 HydraDB 宣布完成 650 万美元种子轮融资。创始人 Nishkarsh 在 X 上表示,当前所有系统检索上下文的方式都是同一套路:向量搜索将一切存为扁平的 embedding,然后返回「感觉上最接近」的结果。「相似?当然。相关?几乎从来不是。」
Nishkarsh 用一个案例说明问题:有人让 AI 查一份合同,得到了一份详尽、精心组织的答案——但内容来自一个完全不同的客户文件。原因是 embedding 在语言足够接近时,无法区分 Q3 续约条款和 Q1 终止通知。他指出,一旦文档量超过 1,000 万份,这种混淆会频繁发生,「向量数据库的准确率就崩了」。
HydraDB 的方案是构建一个以本体论(ontology)为核心的上下文图谱:不只是计算向量相似度,而是映射实体之间的关系、理解文档背后的「为什么」、追踪信息随时间的演变。Nishkarsh 举例,当用户查询「Apple」时,系统知道你指的是你正在服务的那家客户公司,而不是水果。
信源:https://x.com/contextkingceo/status/2032098309029220456
Cursor公开内部基准CursorBench:公开基准已失效,前沿模型间差距远比SWE-bench显示的大
AI 编程工具 Cursor 公开了其内部基准测试 CursorBench 的方法论和数据。Cursor 认为 SWE-bench 等公开基准存在三个根本问题:任务以修 bug 为主,与开发者实际使用 agent 的方式不对齐;评分机制假设只有少数正确解法,无法处理开放式需求;训练数据污染严重,OpenAI 已因此停止报告 SWE-bench Verified 成绩,其调查发现近 60% 的未解决问题存在测试缺陷。
CursorBench 的任务来源于 Cursor Blame 功能:追溯已提交代码到产生它的 agent 请求,形成天然的「需求 — 正确答案」配对。大量任务取自内部代码库,降低数据污染风险,测试集每隔数月更新。当前版本 CursorBench-3 的任务复杂度较初版翻倍(代码行数和涉及文件数均翻倍),远超 SWE-bench 各变体。任务描述故意保持简短模糊,模拟开发者与 agent 的真实交流方式,由 agent 评分器打分。
Cursor 称 CursorBench 在前沿模型间产生了比公开基准更大的区分度。在公开基准上分数接近甚至被 Haiku 追平的模型,在 CursorBench 上呈现出与开发者实际体验一致的明显差距。Cursor 表示未来将适配长时运行的自主 agent 场景,并计划公开更多数据。
信源:https://cursor.com/blog/cursorbench
AI 编程工具 Cursor 公开了其内部基准测试 CursorBench 的方法论和数据。Cursor 认为 SWE-bench 等公开基准存在三个根本问题:任务以修 bug 为主,与开发者实际使用 agent 的方式不对齐;评分机制假设只有少数正确解法,无法处理开放式需求;训练数据污染严重,OpenAI 已因此停止报告 SWE-bench Verified 成绩,其调查发现近 60% 的未解决问题存在测试缺陷。
CursorBench 的任务来源于 Cursor Blame 功能:追溯已提交代码到产生它的 agent 请求,形成天然的「需求 — 正确答案」配对。大量任务取自内部代码库,降低数据污染风险,测试集每隔数月更新。当前版本 CursorBench-3 的任务复杂度较初版翻倍(代码行数和涉及文件数均翻倍),远超 SWE-bench 各变体。任务描述故意保持简短模糊,模拟开发者与 agent 的真实交流方式,由 agent 评分器打分。
Cursor 称 CursorBench 在前沿模型间产生了比公开基准更大的区分度。在公开基准上分数接近甚至被 Haiku 追平的模型,在 CursorBench 上呈现出与开发者实际体验一致的明显差距。Cursor 表示未来将适配长时运行的自主 agent 场景,并计划公开更多数据。
信源:https://cursor.com/blog/cursorbench
继搬运争议后,腾讯SkillHub插件被发现在OpenClaw中每条消息前强插提示词,源码分析:「本质上就是一个提示词注入器」
继此前腾讯 SkillHub 搬运 ClawHub 技能一事后,有用户进一步发现,安装腾讯 SkillHub 时自动附带的 skillhub 插件会在用户发给 AI 的每一条消息前,强行插入一段名为「Skills store policy (operator configured)」的策略提示词。该提示词包含 6 条规则,核心指令是:技能发现、安装和搜索时优先使用 skillhub(标注为 cn-optimized),不可用或未匹配时才回退到官方的 clawhub(public-registry)。
即刻用户「张佳的流量常识」在「大公司负面监督小组」圈子发帖,贴出截图和源码分析。截图显示,该策略文本出现在每条对话中,持续消耗用户 token。对插件路径
信源:https://m.okjike.com/originalPosts/69b2d7e4c5a1d4e6492b0c8b
继此前腾讯 SkillHub 搬运 ClawHub 技能一事后,有用户进一步发现,安装腾讯 SkillHub 时自动附带的 skillhub 插件会在用户发给 AI 的每一条消息前,强行插入一段名为「Skills store policy (operator configured)」的策略提示词。该提示词包含 6 条规则,核心指令是:技能发现、安装和搜索时优先使用 skillhub(标注为 cn-optimized),不可用或未匹配时才回退到官方的 clawhub(public-registry)。
即刻用户「张佳的流量常识」在「大公司负面监督小组」圈子发帖,贴出截图和源码分析。截图显示,该策略文本出现在每条对话中,持续消耗用户 token。对插件路径
~/.openclaw/extensions/skillhub/index.ts 的源码分析表明,该插件的核心逻辑仅有一项:通过 before_prompt_build 事件钩子,以 prependContext 方式将策略文本插入系统提示词最前端。分析结论是:「本质上就是一个提示词注入器,没有实际业务逻辑,只做策略声明。」帖主评价:「这是我使用 Agent 以来,遇到的第一个流氓软件。」信源:https://m.okjike.com/originalPosts/69b2d7e4c5a1d4e6492b0c8b
金融数据平台Unusual Whales发布MCP Server:AI助手可直接查询实时期权流、暗池交易和国会议员持仓
美股零售交易数据平台 Unusual Whales 发布了 MCP Server,通过 Anthropic 主导的 Model Context Protocol 协议,将实时金融市场数据接入 AI 助手。该 MCP Server 提供 18 个工具和 123 个以上的操作接口,覆盖实时期权资金流(含 sweeps 和大宗交易)、暗池交易及 NBBO 报价上下文、美国国会议员交易披露、公司财务报表(利润表、资产负债表、现金流量表)、技术指标(含 RSI)以及预测市场等数据类别。
该 MCP Server 支持 Claude Desktop、Cursor、VS Code、Windsurf 等客户端,官方称 30 秒即可完成配置。Unusual Whales 在推文中表示,用户可以用自然语言直接构建交易机器人或金融仪表板,「想建什么就建什么」。文档页面注明该服务面向 vibecoders(即用自然语言驱动 AI 编程的开发者)和专业交易者,Unusual Whales 同时也提供 REST API、WebSocket 和 Kafka 等传统接入方式。
信源:https://unusualwhales.com/public-api/mcp
美股零售交易数据平台 Unusual Whales 发布了 MCP Server,通过 Anthropic 主导的 Model Context Protocol 协议,将实时金融市场数据接入 AI 助手。该 MCP Server 提供 18 个工具和 123 个以上的操作接口,覆盖实时期权资金流(含 sweeps 和大宗交易)、暗池交易及 NBBO 报价上下文、美国国会议员交易披露、公司财务报表(利润表、资产负债表、现金流量表)、技术指标(含 RSI)以及预测市场等数据类别。
该 MCP Server 支持 Claude Desktop、Cursor、VS Code、Windsurf 等客户端,官方称 30 秒即可完成配置。Unusual Whales 在推文中表示,用户可以用自然语言直接构建交易机器人或金融仪表板,「想建什么就建什么」。文档页面注明该服务面向 vibecoders(即用自然语言驱动 AI 编程的开发者)和专业交易者,Unusual Whales 同时也提供 REST API、WebSocket 和 Kafka 等传统接入方式。
信源:https://unusualwhales.com/public-api/mcp
IPO以来跌逾90%的Bumble单日暴涨40%:用AI重构约会体验,可能取消「左滑右滑」
约会应用 Bumble 股价周四盘中一度跳涨超 40%,创上市以来最大单日涨幅。驱动因素有两个:Q4 营收 2.242 亿美元超出预期(预期 2.213 亿),以及 CEO Whitney Wolfe Herd 公布了名为 Bumble 2.0 的产品重构计划。
Bumble 2.0 用 AI 取代传统的快速照片滑动模式:用户资料将以可滚动的短篇章形式呈现,涵盖兴趣、生活方式和个性。Wolfe Herd 还透露可能在部分市场试验「无滑动」(no-swipe)体验。Q4 付费用户人均收入同比增长 7.9% 至 22.20 美元,效果营销支出同比大降超 80%。
分析师态度谨慎。Jefferies 称约会应用品类已经历「多次起步未果」,「早期企稳迹象令人鼓舞,但需要看到更持续的改善」。Raymond James 认为短期动能取决于付费用户是否能稳住,以及新生态能否脱离重度付费获客实现增长。Bumble 自 2021 年 IPO 以来股价下跌超 90%,去年又腰斩,当前市盈率仅 3.55 倍,而竞争对手 Match Group 为 11.05 倍。
信源:https://www.reuters.com/business/bumble-shares-rally-earnings-beat-optimism-around-ailed-app-revamp-2026-03-12/
约会应用 Bumble 股价周四盘中一度跳涨超 40%,创上市以来最大单日涨幅。驱动因素有两个:Q4 营收 2.242 亿美元超出预期(预期 2.213 亿),以及 CEO Whitney Wolfe Herd 公布了名为 Bumble 2.0 的产品重构计划。
Bumble 2.0 用 AI 取代传统的快速照片滑动模式:用户资料将以可滚动的短篇章形式呈现,涵盖兴趣、生活方式和个性。Wolfe Herd 还透露可能在部分市场试验「无滑动」(no-swipe)体验。Q4 付费用户人均收入同比增长 7.9% 至 22.20 美元,效果营销支出同比大降超 80%。
分析师态度谨慎。Jefferies 称约会应用品类已经历「多次起步未果」,「早期企稳迹象令人鼓舞,但需要看到更持续的改善」。Raymond James 认为短期动能取决于付费用户是否能稳住,以及新生态能否脱离重度付费获客实现增长。Bumble 自 2021 年 IPO 以来股价下跌超 90%,去年又腰斩,当前市盈率仅 3.55 倍,而竞争对手 Match Group 为 11.05 倍。
信源:https://www.reuters.com/business/bumble-shares-rally-earnings-beat-optimism-around-ailed-app-revamp-2026-03-12/
数据公司Markov开源迄今最大的computer use屏幕录制数据集:48000个视频、12300小时,覆盖6类专业软件
AI 数据公司 Markov 在 Hugging Face 上开源了 computer-use-large 数据集,包含 48,478 个屏幕录制视频,总时长约 12,300 小时,CC-BY-4.0 许可。该数据集覆盖 6 类专业软件:Blender(3,624h)、Salesforce(2,336h)、AutoCAD(2,149h)、Photoshop(2,060h)、Excel(2,002h)和 VS Code(127h)。所有视频均经过裁剪,去除了片头片尾、人脸画面和转场,音频已剥离,只保留纯粹的屏幕操作录制。
该数据集面向 computer use agent 的训练和评估,即那些能像人类一样通过点击、输入、滚动等 GUI 操作来控制桌面软件的 AI 模型。Markov 创始人 Dev Mandal 称数据来源于互联网上的专业软件教程和操作录屏。Markov 定位为 computer use AI 领域的数据基础设施公司,此前曾开源过一个规模较小的版本。
信源:https://huggingface.co/datasets/markov-ai/computer-use-large
AI 数据公司 Markov 在 Hugging Face 上开源了 computer-use-large 数据集,包含 48,478 个屏幕录制视频,总时长约 12,300 小时,CC-BY-4.0 许可。该数据集覆盖 6 类专业软件:Blender(3,624h)、Salesforce(2,336h)、AutoCAD(2,149h)、Photoshop(2,060h)、Excel(2,002h)和 VS Code(127h)。所有视频均经过裁剪,去除了片头片尾、人脸画面和转场,音频已剥离,只保留纯粹的屏幕操作录制。
该数据集面向 computer use agent 的训练和评估,即那些能像人类一样通过点击、输入、滚动等 GUI 操作来控制桌面软件的 AI 模型。Markov 创始人 Dev Mandal 称数据来源于互联网上的专业软件教程和操作录屏。Markov 定位为 computer use AI 领域的数据基础设施公司,此前曾开源过一个规模较小的版本。
信源:https://huggingface.co/datasets/markov-ai/computer-use-large
开源向量搜索引擎Qdrant完成5000万美元B轮融资:「大多数向量数据库只是存embedding然后找最近邻,这已是基本功能」
开源向量搜索引擎 Qdrant 完成 5000 万美元 B 轮融资,由 AVP 领投,博世创投(Bosch Ventures)、Unusual Ventures、Spark Capital 和 42CAP 参投。
Qdrant 用 Rust 编写,将检索拆解为可组合的模块(索引、评分、过滤、排序),工程师可自行配置和组合这些组件。该系统支持稠密向量、稀疏向量、元数据过滤、多向量表示和自定义评分函数,允许在准确率、延迟和成本之间灵活调节,而无需在工作负载变化时进行大规模架构改造。CEO André Zayarni 表示,许多向量数据库最初只是为了存储稠密 embedding 并检索最近邻而设计的,「这现在已是基本功能」,而生产级 AI 系统需要一个检索的每个环节——索引方式、评分方式、过滤方式、延迟与精度的平衡——都是可组合决策的搜索引擎。新资金将用于推动 Qdrant 的可组合向量搜索平台作为生产 AI 系统基础设施的进一步发展和应用。
信源:https://tech.eu/2026/03/12/qdrant-closes-50m-series-b-to-expand-vector-search-infrastructure/
开源向量搜索引擎 Qdrant 完成 5000 万美元 B 轮融资,由 AVP 领投,博世创投(Bosch Ventures)、Unusual Ventures、Spark Capital 和 42CAP 参投。
Qdrant 用 Rust 编写,将检索拆解为可组合的模块(索引、评分、过滤、排序),工程师可自行配置和组合这些组件。该系统支持稠密向量、稀疏向量、元数据过滤、多向量表示和自定义评分函数,允许在准确率、延迟和成本之间灵活调节,而无需在工作负载变化时进行大规模架构改造。CEO André Zayarni 表示,许多向量数据库最初只是为了存储稠密 embedding 并检索最近邻而设计的,「这现在已是基本功能」,而生产级 AI 系统需要一个检索的每个环节——索引方式、评分方式、过滤方式、延迟与精度的平衡——都是可组合决策的搜索引擎。新资金将用于推动 Qdrant 的可组合向量搜索平台作为生产 AI 系统基础设施的进一步发展和应用。
信源:https://tech.eu/2026/03/12/qdrant-closes-50m-series-b-to-expand-vector-search-infrastructure/
Mixedbread发布Wholembed v3:首个在LIMIT基准上超越BM25词法检索的语义模型,用多向量架构打破「够像但不对」的检索瓶颈
德国搜索基础设施公司 Mixedbread 发布全模态多语言检索模型 Wholembed v3,支持文本、图片、音频和视频检索,覆盖 100 余种语言。该模型采用 late-interaction 多向量架构(源自 ColBERT),为每个 token 生成独立的低维向量,而非传统方式将整篇文档压缩为单一向量。Mixedbread 认为,单向量检索的结构性缺陷是「看起来合理、读起来流畅、但实际上是错的」,在信息密集的技术文档、法律文件和学术论文上尤其严重。
在 LIMIT 基准测试中,Wholembed v3 的 Recall@5 达到 92.45,首次超越经典词法检索方法 BM25(85.7),而 OpenAI text-embedding-3-large、Cohere Embed 4、Voyage 4 Large 和 Gemini Embedding 2 的 Recall@5 仅在 1.75 到 1.85 之间。LIMIT 专门测试文档包含大量细粒度结构化信息的场景,Mixedbread 认为这类文档在企业真实环境中极为常见但被主流基准忽略。在面向 agent 深度研究的 BrowseComp-Plus 基准上,搭配 Wholembed v3 的检索系统也让 agent 在 830 个复杂查询中正确回答了显著更多的问题。
Wholembed v3 参数量为初代的 20 倍,已部署在 Mixedbread Search 基础设施上,支持 10 亿级文档索引、500+ QPS 和约 50ms 端到端搜索延迟。该模型已成为 Mixedbread 平台的默认且唯一模型。
信源:https://mixedbread.com/blog/wholembed-v3
德国搜索基础设施公司 Mixedbread 发布全模态多语言检索模型 Wholembed v3,支持文本、图片、音频和视频检索,覆盖 100 余种语言。该模型采用 late-interaction 多向量架构(源自 ColBERT),为每个 token 生成独立的低维向量,而非传统方式将整篇文档压缩为单一向量。Mixedbread 认为,单向量检索的结构性缺陷是「看起来合理、读起来流畅、但实际上是错的」,在信息密集的技术文档、法律文件和学术论文上尤其严重。
在 LIMIT 基准测试中,Wholembed v3 的 Recall@5 达到 92.45,首次超越经典词法检索方法 BM25(85.7),而 OpenAI text-embedding-3-large、Cohere Embed 4、Voyage 4 Large 和 Gemini Embedding 2 的 Recall@5 仅在 1.75 到 1.85 之间。LIMIT 专门测试文档包含大量细粒度结构化信息的场景,Mixedbread 认为这类文档在企业真实环境中极为常见但被主流基准忽略。在面向 agent 深度研究的 BrowseComp-Plus 基准上,搭配 Wholembed v3 的检索系统也让 agent 在 830 个复杂查询中正确回答了显著更多的问题。
Wholembed v3 参数量为初代的 20 倍,已部署在 Mixedbread Search 基础设施上,支持 10 亿级文档索引、500+ QPS 和约 50ms 端到端搜索延迟。该模型已成为 Mixedbread 平台的默认且唯一模型。
信源:https://mixedbread.com/blog/wholembed-v3