动察Beating AI News
3.45K subscribers
1.14K photos
2 videos
1 file
3.77K links
AI新闻信息流
Download Telegram
产品还没发人先走了:苹果智能家居硬件负责人加入Oura

苹果负责家庭设备硬件工程的高级总监 Brian Lynch 已正式离职,加入智能戒指公司 Oura Health 担任硬件工程高级副总裁。Oura CEO Tom Hale 向彭博社确认了这一任命。Lynch 在苹果任职超过 20 年,2022 年起主导家庭设备部门的硬件工作,此前还曾在苹果自动驾驶汽车项目(2024 年终止)中担任核心工程管理职位,更早期参与了多款 iPod 的研发。

Lynch 离开时,他负责的多款产品均未发布:一款搭载 AI 与人脸识别功能的智能家居显示屏原计划去年推出,因 Siri 大规模重构多次推迟,目前最早计划今年 9 月发布;一台配备 9 英寸可移动屏幕的桌面机器人和一款家庭安全与自动化传感器则计划明年推出。这是该团队近年来第二次高层变动,项目管理副总裁 DJ Novotney 已于 2024 年离职。目前团队由 Matt Costello 统领,他同时负责音频工程及 Beats 产品线,向硬件工程高级副总裁 John Ternus 汇报。

过去数月苹果已有多位高管离职或宣布离任计划,包括用户界面设计主管 Alan Dye、环境事务负责人 Lisa Jackson,前 AI 主管 John Giannandrea 及前总法律顾问 Kate Adams 也将于今年晚些时候离任。Oura 是苹果人才的流向之一,此前已从苹果健康团队挖来首席医疗官 Ricky Bloomfield,其设计总监 Miklu Silvanto 同样出身苹果设计部门。Oura 去年完成 E 轮融资后估值达 110 亿美元。

信源:https://www.bloomberg.com/news/articles/2026-03-17/apple-s-head-of-home-hardware-leaves-for-smart-ring-maker-oura
阶跃星辰大模型上车极氪8X:说句话,车自己去接娃、买麦当劳、泊车

吉利集团在 GTC 2026 大会上宣布,联合智能驾驶公司千里科技和 AI 公司阶跃星辰打造的整车级智能体「超级 Eva」即将量产上车,极氪 8X 将首发搭载。超级 Eva 以阶跃星辰 Step 3.5 Flash 大模型为核心驱动,与智能座舱、智能辅助驾驶、底盘、动力等底层系统原生融合,能基于一句自然语言指令自主完成导航规划、启动智驾、途中点餐、到达后自动泊车等全链路任务。

同时搭载阶跃星辰的端到端语音模型和视觉理解模型,前者具备情绪理解能力和更自然的音色,后者让系统能识别车辆周围环境并做出判断。智驾层面搭配由吉利与千里科技联合研发的千里浩瀚 G-ASD 4.0 辅助驾驶系统,今年 1 月量产上车后已在两个月内完成从 3.0 到 4.0 的迭代。极氪 8X 已开启预售。

信源:https://mp.weixin.qq.com/s/qAugBVaIVDggdzIrnSegrg
谷歌为Colab推出MCP Server:AI Agent可直接操控笔记本环境

谷歌发布 Colab MCP Server,让任何支持 MCP 协议的 AI Agent 通过标准接口直接控制 Google Colab 笔记本环境。Agent 可执行创建 .ipynb 文件、添加 Markdown 单元格、编写并运行 Python 代码、安装依赖包等操作。官方文档明确列举了 Gemini CLI 和 Claude Code 作为兼容客户端。

项目已在 GitHub 开源(googlecolab/colab-mcp),目前处于初期发布阶段。用户在浏览器打开 Colab 笔记本后,只需在本地 Agent 的 MCP 配置中添加该 Server,即可通过自然语言指令驱动 Colab 完成数据分析和编程任务。

信源:https://developers.googleblog.com/announcing-the-colab-mcp-server-connect-any-ai-agent-to-google-colab/
SK集团董事长:内存芯片晶圆短缺超20%,2030年前无法缓解

SK 集团董事长崔泰源在 GTC 大会期间接受采访时表示,AI 对高带宽内存(HBM)的需求旺盛,生产 HBM 需要消耗大量晶圆,而扩充晶圆产能至少需要四到五年。他预计到 2030 年,全球晶圆供应量仍将比需求低 20% 以上。

SK 海力士目前以 57% 的份额位居全球 HBM 市场第一,同时以 32% 的份额排名 DRAM 市场第二。崔泰源还透露 SK 海力士正在评估在纽交所发行 ADR(美国存托凭证),但明确表示不会在美国建厂,将继续专注韩国本地生产。

信源:https://www.reuters.com/world/asia-pacific/south-koreas-sk-group-chairman-expects-chip-wafer-shortage-last-until-2030-eyes-2026-03-16/
手机派活电脑干:Claude上线Dispatch,人走了AI还在忙

Anthropic 在 Claude 桌面端的 Cowork 模式中上线新功能 Dispatch(研究预览版),Claude Cowork 工程负责人 Felix Rieseberg 在 X 上宣布了这一功能。Dispatch 的核心逻辑是在 Mac 上保持 Claude 桌面应用运行,用户通过手机端 Claude 应用发送指令,Claude 在电脑上的沙盒环境中执行任务,文件留在本地,每一步操作需用户确认后才执行。该功能类似此前 Claude Code 的 Remote Control,但面向 Cowork 的图形化环境,用户出门后可通过手机下达任务,回来时查看完成的工作。

设置方式为在 Mac 端 Claude 应用中扫描二维码与手机配对。Dispatch 目前仅向 Max 订阅用户开放,Pro 用户将在数天内获得权限。MacStories 的上手测试显示,该功能目前速度较慢,任务成功率约五成,查找文件和调用 Connectors 效果较好,但发送 iMessage、打开应用等操作尚不可用。

信源:https://x.com/felixrieseberg/status/2034005745822540201
不写代码本地微调大模型:Unsloth开源发布Studio训练平台

开源模型训练加速工具 Unsloth 发布 Unsloth Studio(Beta),一个无代码的本地 Web UI,将模型训练、推理和导出整合进统一界面。Studio 支持在 Mac、Windows 和 Linux 上运行 GGUF 和 safetensor 模型,训练速度提升 2 倍,显存占用降低 70%,覆盖文本、视觉、语音合成和 Embedding 等 500 余种模型。核心功能包括:

1. Data Recipes:上传 PDF、CSV、JSON 等文件,通过图形化工作流自动生成训练数据集,底层由英伟达 DataDesigner 驱动
2. 无代码训练:支持 LoRA、QLoRA、FP8、全参数微调,实时监控训练损失和 GPU 利用率,内置 GRPO 强化学习(DeepSeek-R1 所用技术),可在消费级显卡上训练推理模型
3. Model Arena:两个模型并排对比输出,方便评估微调效果
4. 一键导出:支持导出为 GGUF、safetensors 等格式,直接用于 llama.cpp、vLLM、Ollama 和 LM Studio

Studio 完全本地运行,支持离线使用,不收集用户数据。训练需要英伟达 GPU(RTX 30/40/50 系列、Blackwell、DGX Spark 等),Mac 和纯 CPU 环境目前仅支持推理,MLX 训练即将推出。主库仍为 Apache 2.0 许可,Studio UI 部分采用 AGPL-3.0 许可。

信源:https://unsloth.ai/docs/new/studio
3个工程师干了原本16个人的活:Meta用AI Agent自动调优广告模型,连续工作数周无需人类介入

Meta 发布 Ranking Engineer Agent(REA),用 AI 替代广告推荐模型调优中大量重复性工程工作。简单来说,Meta 的广告系统依赖机器学习模型决定给每个用户展示什么广告,而改进这些模型过去需要工程师反复执行一套流程:提出优化假设、配置训练任务、等待数小时甚至数天的训练完成、排查失败原因、分析结果、再提出下一轮假设。REA 把这整个循环交给 AI 自主完成。

与 Copilot 类编程助手的关键区别在于时间跨度。编程助手是「问一句答一句」,而 REA 能连续自主运行数周:它启动一个训练任务后进入休眠,训练跑完后自动唤醒、分析结果、决定下一步,全程不需要工程师盯着。遇到训练报错也能自行诊断修复,只在关键决策节点才需人类审批。

首次生产验证中,REA 在 6 个模型上将平均准确率提升至基线的 2 倍。效率方面,3 名工程师借助 REA 完成了 8 个模型的改进方案,而过去每个模型需要 2 名工程师,相当于同等人力产出提升约 5 倍。

信源:https://engineering.fb.com/2026/03/17/developer-tools/ranking-engineer-agent-rea-autonomous-ai-system-accelerating-meta-ads-ranking-innovation/
微软威胁起诉亚马逊和OpenAI:500亿美元云交易踩到API独占红线

《金融时报》报道称,微软正考虑就亚马逊与 OpenAI 的 500 亿美元云合作交易采取法律行动。该交易的核心产品 Frontier 是 OpenAI 的企业级 AI Agent 平台,微软认为其在 AWS 上运行可能违反双方的 API 独占协议。

微软去年 10 月批准 OpenAI 架构重组时放弃了独家云服务商地位,但保留了一项关键条款:所有通过 API 访问 OpenAI 模型的请求必须经由 Azure 路由。亚马逊和 OpenAI 为此在 Amazon Bedrock 上开发了「有状态运行时环境」(SRE)来绕开这一限制,SRE 可访问企业存储在 AWS 上的数据,使 Agent 具备跨工具的记忆和操作能力。微软认为这一技术路径在合同条款下不可行,即使可行也违反了协议精神。

一位了解微软立场的知情人士说:「我们清楚合同内容。如果他们违约,我们会起诉。如果亚马逊和 OpenAI 想赌他们合同律师的创意能赢,我押我们这边。」OpenAI 则认为 Frontier 并非主要作为 API 提供,不触碰红线,并认为微软不太可能真的起诉,因为微软自身正面临美、英、欧盟对其 Azure 许可行为的反垄断调查。

此前 Business Insider 曝光了亚马逊的内部备忘录,其中严格限定了员工描述 SRE 的措辞:可以说「由 OpenAI 驱动」「集成 OpenAI」,但禁止说「提供 OpenAI 模型访问」或「调用 OpenAI 模型」,也不能暗示 OpenAI 前沿模型已在 AWS 上可用。Frontier 上线前,三方仍在谈判寻求和解。如果纠纷最终进入法庭,可能影响 OpenAI 最早今年进行的 IPO 计划。

信源:https://www.ft.com/content/e814f4c3-4fb5-4e2e-90a6-470044436b39
字节也来了:火山引擎上线OpenClaw技能广场Find Skill

火山引擎上线 Agent 技能广场 Find Skill,聚合 GitHub、ClawHub 等平台的 Skill 镜像,供开发者搜索和下载可复用的 Agent 技能包。火山引擎旗下云端 OpenClaw 服务 ArkClaw 已默认将 Skill 来源切换至该平台,社区版 OpenClaw 用户也可通过配置 API 端点(skills.volces.com/v1)接入。

此前腾讯云已在本月推出定位类似的 SkillHub,两家国内云厂商相继为 OpenClaw 搭建本土化 Skill 分发渠道。

信源:https://mp.weixin.qq.com/s/bk-l9SkhHTYAia32l_wpcA
不降级也能卖:英伟达Groq推理芯片拟5月入华,或可绕开GPU出口管制线

Reuters 引述两名知情人士称,英伟达正准备向中国市场推出 Groq 3 LPU 推理芯片,预计最快 5 月上市。知情人士强调该芯片「并非降级版或专为中国市场定制」。这是英伟达 2025 年底以约 170 亿美元收购 AI 推理芯片公司 Groq 后,首次将其产品线引入中国,与此前已获批重启生产的 H200 GPU 属于独立的对华芯片策略。

Groq 3 LPU 是一款推理专用协处理器,内置 500MB 片上 SRAM,推理带宽高达 150 TB/s,但浮点算力较低,不擅长模型训练。据电子工程专辑分析,这一架构使其峰值算力可能落在美国现行出口管制的性能阈值(TPP < 21,000 且 DRAM 带宽 < 6,500 GB/s)以下,从而规避 H200 等 GPU 面临的出口限制。不过,Groq LPU 在英伟达原方案中需搭配无法对华出口的 Vera Rubin GPU 使用(推荐比例约 25:75),中国版本需适配其他系统独立运行,实际性能发挥仍有待观察。

信源:https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/
争端升级:美司法部要求将Anthropic逐出全部联邦机构,称其可能在战时关停AI

美国司法部周二向法院提交文件,要求将 Anthropic 逐出全部联邦机构,将争端范围从此前的战争部直接合同扩大到整个行政分支。文件称,「出于国家安全原因,Anthropic 的 AI 技术服务条款已不被行政分支所接受。」

司法部在文件中披露了此前未公开的谈判细节:2026 年初,战争部曾要求在合同中加入允许将 Anthropic 技术用于「任何合法用途」的条款,遭 Anthropic 以其 Claude 使用政策为由拒绝。美国国防研究与工程副部长 Emil Michael 在宣誓文件中称 Anthropic 在谈判中表现出「敌意」(hostility),其立场「似乎主要服务于公众形象,而非基于事实」。

文件中最具争议的一段警告称:「AI 系统极易被操控,如果 Anthropic 自行判定其企业红线被触碰,它可能在进行中的战时行动期间试图关闭其技术或提前改变模型行为。」Anthropic 此前要求美方承诺其 AI 不会被用于大规模监控美国公民或自主武器部署。Anthropic 发言人回应称正在审阅政府文件,重申「寻求司法审查不会改变我们对利用 AI 保护国家安全的长期承诺」。听证会定于下周二举行。

信源:https://www.bloomberg.com/news/articles/2026-03-18/trump-administration-vows-legal-fight-on-anthropic-ai-tool-ban
百度把龙虾搬进客厅:小度智能音箱接入OpenClaw,喊一句话就能跨App点外卖

百度在 AI DAY 上发布「龙虾全家桶」系列产品,核心是「小度龙虾」,将 OpenClaw 的复杂任务处理能力接入小度智能音箱。用户对小度说一句话(如「让龙虾帮我点一杯麦当劳咖啡」),系统即可自动打开对应 App 完成下单,无需解锁手机或打开应用。百度集团执行副总裁沈抖称,这可能成为新时代的操作系统级能力,「打通几乎所有硬件,打破设备之间的壁垒」。他同时坦言「这只龙虾还不完美,会犯错、走弯路,有时甚至把简单的事情复杂化」。

除小度龙虾外,百度还同步发布了桌面端助手 DuMate、Android 移动端 RedClaw(3 月 12 日已上线,iOS 版本月内推出)和云端服务 DuClaw,覆盖家庭、桌面、移动和云端四个场景。小度生态目前部署在超过 7 亿台智能设备上,月语音交互超 71 亿次,连接 IoT 设备超 3 亿台。在腾讯、阿里纷纷推出 OpenClaw 产品之际,百度选择从硬件和语音切入,押注「不用打字、不用看屏幕」的交互方式作为差异化路径。

信源:https://www.bloomberg.com/news/articles/2026-03-17/baidu-taps-openclaw-smart-speakers-to-fuel-agentic-ai-paradigm
小米新SU7明日发布:全系标配激光雷达+AI大模型,驾驶系统首次与机器人共享底座

新一代小米 SU7 将于 3 月 19 日 19:00 发布并开启大规模交付,预售价 22.99 万元起(标准版 22.99 万、Pro 25.99 万、Max 30.99 万),全系较上代上涨 1.0-1.4 万元。雷军表示成本上升明显,但「车主一定会觉得更值」。

核心升级在智驾系统。新车全系标配小米 HAD 辅助驾驶,搭载全新 XLA 认知大模型,融合小米自研的 MiMo-Embodied 具身基座模型,首次将辅助驾驶和具身机器人作为统一任务处理,提升复杂场景理解和类人决策能力。硬件方面,此前仅顶配 Max 搭载的激光雷达现已下放至全系标配,算力平台为 700 TOPS 的索尔芯片,还新增 4D 毫米波雷达。续航方面,标准版 CLTC 720 公里,Pro 版 902 公里,Max 版 835 公里(双电机四驱,508kW/690 马力),全系支持 15 分钟快充补能 450-670 公里。

信源:https://www.ithome.com/0/930/079.htm
AI Agent也需要密码管理器:1Password发布Unified Access

密码管理服务商 1Password 发布 Unified Access 平台,将凭证安全从人类用户扩展至 AI Agent 和机器身份。平台采用「发现、保护、审计」三步模型:扫描端点和开发环境中暴露的凭证与 Agent 活动,将明文 SSH 密钥和 .env 文件一键收入加密保险库,并追踪每次凭证访问的身份和授权链路。发现和保护功能已随 Unified Access Pro 上线,审计功能稍后推出。

首批合作方覆盖 AI 模型、开发工具和 Agent 浏览器三个层面:

1. Anthropic:Claude 浏览器扩展、Cowork 和 Claude Code 将集成 1Password,Agent 可在用户授权下从保险库自动填充凭证登录网站和服务
2. OpenAI:支持在本地开发环境中调用 1Password 保险库
3. Cursor、GitHub、Vercel:覆盖 IDE、云沙盒和 CI/CD 流水线,Cursor Agent 和 GitHub Actions 已有可用 Hook
4. AI 浏览器:Anchor Browser、Browserbase、KERNEL 和 Perplexity Comet 接入,通过即时授权和最小权限控制 Agent 的凭证访问

1Password 目前保护超过 13 亿条凭证和密钥,服务超 18 万家企业。

信源:https://1password.com/press/2026/mar/1password-unified-access
模型自己迭代自己:MiniMax M2.7发布,编程接近Opus水平

MiniMax 发布 M2.7,称其为「第一个模型深度参与迭代自己的模型」。团队基于 M2 早期版本构建研究型 Agent 框架,让模型自主完成强化学习 Skill 构建、记忆更新和过程优化。在一项内部实验中,M2.7 自主运行超 100 轮迭代循环(分析失败轨迹、修改脚手架、运行评测、对比结果),最终在内部评测上效果提升 30%。在 MLE Bench Lite 的 22 个机器学习任务中,三次测试平均得牌率 66.6%,与 Gemini-3.1 持平,仅次于 Opus 4.6(75.7%)和 GPT-5.4(71.2%)。

编程方面,M2.7 在 SWE-Pro 得分 56.22%,追平 GPT-5.3-Codex;VIBE-Pro 55.6%,接近 Opus 4.6;Terminal Bench 2 得分 57.0%。MiniMax 称已多次将线上生产故障恢复时间缩短至三分钟以内。办公场景方面,GDPval-AA ELO 得分 1500,在 45 个模型中仅次于 Opus 4.6、Sonnet 4.6 和 GPT-5.4。OpenClaw 评测 MM-Claw 正确率 62.7%,接近 Sonnet 4.6,40 个复杂 Skill(>2000 Token)遵循率达 97%。

MiniMax 同时开源 Agent 交互系统 OpenRoom(github.com/MiniMax-AI/OpenRoom),将 AI 互动置入可视化 Web 空间。M2.7 已在 MiniMax Agent 和开放平台全量上线。

信源:https://mp.weixin.qq.com/s/Xfsq8YDP7xkOLzbh1HwdjA
元宇宙旗舰产品退场:Meta将于6月关停Horizon Worlds VR版,转为纯移动端

Meta 宣布其元宇宙社交平台 Horizon Worlds 将于 6 月 15 日从 Quest VR 头显下架,此后仅可通过手机和平板访问。3 月 31 日起,Horizon Worlds 和 Events 将从 Quest 商店中移除,包括 Horizon Central、Events Arena 等标志性虚拟世界将率先关闭 VR 入口。

Meta 的 Reality Labs 副总裁 Samantha Ryan 在 2 月的开发者博文中已预告了这一转向,称 2025 年移动端月活增长超 4 倍,移动端原生世界从零增长到 2000 多个,公司决定「全面押注移动端」。Forrester 分析师 Mike Proulx 评价称,「Meta 在 Horizon Worlds 上的转向是一个大胆高风险押注的必然结局,你无法在一个大多数人既不拥有也不愿长时间佩戴的硬件上建成大众社交平台。」Moor Insights 分析师 Anshel Sag 更直接:「这件事是不可避免的,它已经死了很久了。」

Horizon Worlds 自 2021 年发布以来一直不温不火,曾因无腿虚拟人、人气不及 VRChat 等问题饱受嘲讽。Meta 向其投入了数十亿美元,包括举办 Imagine Dragons 和 Coldplay 虚拟演唱会。2 月 Reality Labs 还裁撤了 VR 部门 10% 的员工。Meta 发言人强调,公司仍是 VR 行业最大的投资者,并有明确的未来 VR 头显路线图,但战略重心已转向 AI 和 Ray-Ban Meta 智能眼镜。

信源:https://www.wired.com/story/meta-is-shutting-down-horizon-worlds-on-meta-quest/
「做不了颠覆者就做慈善家」:智谱全球负责人给AI实验室分了四个等级

智谱 AI(Z.ai)全球负责人李子玄在 X 上发布了一套 AI 模型竞赛的分级框架,将所有 AI 实验室按野心层级分为四类:

1. 颠覆者(The Disruptors):不只做模型,而是重写行业规则、定义范式转移
2. 强者(The Powerhouses):稳定输出顶级基准成绩,是可靠的「大脑」供应商
3. 专才(The Specialists):靠速度、个性或垂直领域优势成为某些用户的不可替代选择
4. 慈善家(The Philanthropists):前三级够不到时,以开放社区和利他姿态寻找存在感

他总结称:「目标永远是向上攀升。如果你无法重新发明世界,就瞄准顶级水准;如果基准跑不赢,就打磨独门手艺;如果什么都做不了,就做那个给予的人。」

信源:https://x.com/ZixuanLi_/status/2034154555856880079
一个计费周期450万次谷歌搜索:Browserbase为AI Agent内置专用搜索API

AI Agent 云浏览器平台 Browserbase 推出内置 Search API,由 AI 搜索引擎 Exa 提供底层能力。Browserbase 发现一个浪费问题:Agent 在浏览网页前几乎都要先搜索,而此前的做法是启动一个完整的云浏览器会话去访问 google.com,仅上一个计费周期就产生了 450 万次这样的请求。这相当于每次只为了查个地址就发动整辆车。新 API 将搜索变成一次轻量 API 调用,把浏览器资源留给真正需要交互的场景(点击、填表、登录等),形成「搜索 → 抓取 → 浏览」的分层工作流。API 支持 REST、TypeScript 和 Python SDK,返回 JSON、Markdown 或 HTML 格式结果,所有套餐每月包含 1000 次免费搜索。

信源:https://www.browserbase.com/blog/search
IBM史上第二大收购落地:110亿美元拿下Confluent,为AI Agent铺实时数据管道

IBM 周二宣布完成对数据流处理平台 Confluent 的收购,交易额约 110 亿美元(每股 31 美元全现金),为 IBM 历史上仅次于 2019 年 330 亿美元收购红帽的第二大交易。Confluent 由前 LinkedIn 工程师 Jay Kreps 等人于 2014 年创立,基于开源数据流标准 Apache Kafka 构建,服务超过 6500 家企业客户,覆盖 40% 的财富 500 强。

IBM CEO Arvind Krishna 接受华尔街日报采访时称,要让 AI Agent 真正工作,「你需要能够即时获取任何位置的数据」,Confluent 的技术将成为 IBM 帮助企业客户为 AI 应用提供数据的「骨干」。他将这笔交易比作红帽收购:红帽成了 IBM 帮客户现代化软件架构的默认技术底座,Confluent 将在实时数据领域扮演同样的角色。收购于 2025 年 12 月 8 日宣布,交割当日 IBM 股价上涨 2.75%。

信源:https://newsroom.ibm.com/2026-03-17-ibm-completes-acquisition-of-confluent,-making-real-time-data-the-engine-of-enterprise-ai-and-agents
「资本是生命线」:陈天桥亲自在LinkedIn为MiroMind招CFO

盛大网络创始人陈天桥在 LinkedIn 上亲自发帖,为其 AI 公司 MiroMind 招聘 CFO,帖中直言「资本是我们的生命线」(Capital is our lifeline)。招聘要求十年以上经验,具备高盛、摩根士丹利或摩根大通等顶级投行背景,熟悉主权财富基金和风险投资网络,中英双语,常驻美国并能定期出差新加坡。

MiroMind 定位为「发现式智能」引擎,致力于将大语言模型从「会说话」进化为「能发现的求解器」。上周刚宣布三位科学家加入核心团队:xAI 前核心成员、华盛顿大学副教授杜少雷负责推理模型,南洋理工大学终身教授安波负责运行时与智能体系统,前 Meta FAIR 研究科学家杨凯峪负责可验证 AI 实验室。

信源:https://www.linkedin.com/feed/update/urn:li:activity:7439047249290039296/?originTrackingId=eeEeVlKVaN85fXEk%2BsjDEg%3D%3D
大模型价格战结束了:开年至今七家云厂商接连涨价,最高涨幅超400%

年初以来已有七家国内外云厂商宣布涨价,AI 算力从「打价格战」全面转向「供需定价」:

1. 亚马逊 AWS 1 月 22 日将 EC2 ML 容量块服务价格上调约 15%,打破二十年「只降不涨」的定价传统,被视为行业转折信号
2. 智谱 2 月将 GLM Coding Plan 套餐上调 30%,3 月 16 日再将 GLM-5-Turbo API 上调 20%,年内累计涨幅达 83%
3. 优刻得 3 月 1 日宣布全线云产品与服务价格上浮
4. 腾讯云 3 月 11 日宣布 GLM 5、MiniMax 2.5、Kimi 2.5 结束免费公测转商用收费,混元系列模型涨价,部分涨幅超 400%
5. 阿里云 3 月 18 日宣布平头哥真武 810E 等 AI 算力卡产品上涨 5%-34%,文件存储 CPFS(智算版)上涨 30%
6. 百度智能云 3 月 18 日宣布 AI 算力产品上调 5%-30%,并行文件存储上调约 30%
7. 谷歌云宣布自 5 月 1 日起上调全球数据传输服务价格,北美地区每 GB 费率从 0.04 美元翻倍至 0.08 美元

涨价潮的直接催化剂是 OpenClaw(龙虾)引爆的 Token 消耗。中邮证券分析认为,OpenClaw 将 Token 消耗模式从「人机对话」升级为「机器自循环」,24 小时运行的单个 OpenClaw 月耗可达数千万 Token。OpenRouter 数据显示,OpenClaw 是过去一个月全球 Token 消耗最高的应用,3 月 16 日当天消耗量是第二名的 3.6 倍。知情人士透露,阿里云百炼 MaaS 业务今年 1-3 月创下历史最高增速,公司正将紧缺的 AI 算力资源向 Token 业务倾斜。

更深层的背景是全球 AI 算力供应链成本上升。IDC 中国研究经理崔婷婷表示,AI 需求爆发导致核心硬件供应紧张,交付周期拉长,硬件供应商在供需失衡下加速涨价。新建算力数据中心对电力和液冷系统要求更高,进一步推高成本。崔婷婷认为,如果供应链成本继续上升,不排除云厂商再次涨价。