OpenAI正式关闭Sora,迪士尼10亿美元投资随之作废
OpenAI 宣布关闭视频生成平台 Sora 的独立应用,该应用去年 9 月才上线。迪士尼同步表示双方合作「不再推进」,此前达成的协议包括迪士尼向 OpenAI 投资 10 亿美元并授权米老鼠、灰姑娘等 IP 用于 Sora 创作,但实际上资金从未完成交割。
Sora 是 OpenAI 近期收缩的第二个「支线任务」,此前已砍掉 ChatGPT 内的 Instant Checkout 购物结账功能。OpenAI 正将资源集中于算力、芯片和企业产品,面对 Anthropic 和谷歌的竞争压力,实验性项目的优先级持续下降。
信源:https://x.com/soraofficialapp/status/2036546752535470382?s=46
OpenAI 宣布关闭视频生成平台 Sora 的独立应用,该应用去年 9 月才上线。迪士尼同步表示双方合作「不再推进」,此前达成的协议包括迪士尼向 OpenAI 投资 10 亿美元并授权米老鼠、灰姑娘等 IP 用于 Sora 创作,但实际上资金从未完成交割。
Sora 是 OpenAI 近期收缩的第二个「支线任务」,此前已砍掉 ChatGPT 内的 Instant Checkout 购物结账功能。OpenAI 正将资源集中于算力、芯片和企业产品,面对 Anthropic 和谷歌的竞争压力,实验性项目的优先级持续下降。
信源:https://x.com/soraofficialapp/status/2036546752535470382?s=46
苹果要把Siri变成独立App:iOS 27将彻底重做AI体验
彭博社记者 Mark Gurman 报道称,苹果正在测试 iOS 27 和 macOS 27 中的独立 Siri 应用,将 Siri 从系统级助手升级为类似聊天机器人的全新界面。新版支持文字和语音对话,具备对话历史列表、收藏聊天、搜索历史和新建对话等功能。Siri 的视觉呈现将移至屏幕顶部灵动岛区域,搜索提示栏显示为「Search or Ask」,并新增「Ask Siri」按钮。
新版 Siri 由苹果自研的 Apple Foundation Models 驱动,同时整合谷歌 Gemini 技术,双方去年达成约 10 亿美元合作协议。WWDC26 定于 6 月 8 日开幕,届时将正式公布。
信源:https://www.bloomberg.com/news/articles/2026-03-24/ios-27-features-apple-ai-reboot-with-siri-app-new-interface-ask-siri-button
彭博社记者 Mark Gurman 报道称,苹果正在测试 iOS 27 和 macOS 27 中的独立 Siri 应用,将 Siri 从系统级助手升级为类似聊天机器人的全新界面。新版支持文字和语音对话,具备对话历史列表、收藏聊天、搜索历史和新建对话等功能。Siri 的视觉呈现将移至屏幕顶部灵动岛区域,搜索提示栏显示为「Search or Ask」,并新增「Ask Siri」按钮。
新版 Siri 由苹果自研的 Apple Foundation Models 驱动,同时整合谷歌 Gemini 技术,双方去年达成约 10 亿美元合作协议。WWDC26 定于 6 月 8 日开幕,届时将正式公布。
信源:https://www.bloomberg.com/news/articles/2026-03-24/ios-27-features-apple-ai-reboot-with-siri-app-new-interface-ask-siri-button
❤1
35年来首次卖芯片:Arm发布AGI CPU,Meta为头号客户
Arm 打破 35 年来只做架构授权的传统,首次发布自研芯片 AGI CPU,面向 Agent AI 云端推理场景。芯片最高 136 核,功耗 300W,采用台积电 3nm 制程。Meta 为首批客户,另有 OpenAI、Cloudflare、SAP 等共 8 家公司已签约。
CEO René Haas 预计该芯片五年内带来 150 亿美元年收入,Arm 整体年收入届时将达 250 亿美元。此举意味着 Arm 从纯架构授权商转向芯片制造商,将直接与英伟达、高通等自家客户竞争。
信源:https://www.bloomberg.com/news/articles/2026-03-24/arm-to-sell-its-own-chips-for-first-time-in-bid-for-ai-revenue
Arm 打破 35 年来只做架构授权的传统,首次发布自研芯片 AGI CPU,面向 Agent AI 云端推理场景。芯片最高 136 核,功耗 300W,采用台积电 3nm 制程。Meta 为首批客户,另有 OpenAI、Cloudflare、SAP 等共 8 家公司已签约。
CEO René Haas 预计该芯片五年内带来 150 亿美元年收入,Arm 整体年收入届时将达 250 亿美元。此举意味着 Arm 从纯架构授权商转向芯片制造商,将直接与英伟达、高通等自家客户竞争。
信源:https://www.bloomberg.com/news/articles/2026-03-24/arm-to-sell-its-own-chips-for-first-time-in-bid-for-ai-revenue
OpenAI本轮融资突破1200亿美元,再追加100亿下周交割
OpenAI CFO Sarah Friar 确认公司在 2 月 1100 亿美元融资之外再获 100 亿美元追加投资,本轮总额「超过 1200 亿美元」,刷新全球单轮融资纪录。追加轮投资方包括 a16z、阿布扎比 MGX、D.E. Shaw Ventures、TPG 和 T. Rowe Price,预计下周完成交割。
2 月主轮由亚马逊(500 亿美元)、英伟达(300 亿美元)和软银(300 亿美元)领投,投前估值 7300 亿美元。
信源:https://www.cnbc.com/2026/03/24/openai-secures-an-extra-10-billion-in-record-funding-round-cfo-friar-says.html
OpenAI CFO Sarah Friar 确认公司在 2 月 1100 亿美元融资之外再获 100 亿美元追加投资,本轮总额「超过 1200 亿美元」,刷新全球单轮融资纪录。追加轮投资方包括 a16z、阿布扎比 MGX、D.E. Shaw Ventures、TPG 和 T. Rowe Price,预计下周完成交割。
2 月主轮由亚马逊(500 亿美元)、英伟达(300 亿美元)和软银(300 亿美元)领投,投前估值 7300 亿美元。
信源:https://www.cnbc.com/2026/03/24/openai-secures-an-extra-10-billion-in-record-funding-round-cfo-friar-says.html
谷歌TurboQuant:3bit量化KV缓存无精度损失,推理最高快8倍
谷歌研究院发布量化压缩算法 TurboQuant,可将大语言模型的 KV 缓存压缩至 3 bit,内存占用缩减至少 6 倍,无需训练或微调,不损失模型精度。4 bit 模式下,在英伟达 H100 GPU 上计算注意力的速度较 32 bit 未量化基线提升最高 8 倍。
研究团队在 LongBench、Needle In A Haystack、ZeroSCROLLS 等长上下文基准上用 Gemma 和 Mistral 模型验证,TurboQuant 在所有测试中均达到最优表现。该算法由两个子算法组成:PolarQuant 通过极坐标变换消除传统量化方法的内存开销,QJL 仅用 1 bit 校正残余误差。
该研究由谷歌研究院 Amir Zandieh 和副总裁兼 Google Fellow Vahab Mirrokni 主导,与韩国 KAIST 和纽约大学合作完成,将在 ICLR 2026 上发表。谷歌表示该技术的主要应用之一是解决 Gemini 等模型的 KV 缓存瓶颈。
信源:https://research.google/blog/turboquant-redefining-ai-efficiency-with-extreme-compression/
谷歌研究院发布量化压缩算法 TurboQuant,可将大语言模型的 KV 缓存压缩至 3 bit,内存占用缩减至少 6 倍,无需训练或微调,不损失模型精度。4 bit 模式下,在英伟达 H100 GPU 上计算注意力的速度较 32 bit 未量化基线提升最高 8 倍。
研究团队在 LongBench、Needle In A Haystack、ZeroSCROLLS 等长上下文基准上用 Gemma 和 Mistral 模型验证,TurboQuant 在所有测试中均达到最优表现。该算法由两个子算法组成:PolarQuant 通过极坐标变换消除传统量化方法的内存开销,QJL 仅用 1 bit 校正残余误差。
该研究由谷歌研究院 Amir Zandieh 和副总裁兼 Google Fellow Vahab Mirrokni 主导,与韩国 KAIST 和纽约大学合作完成,将在 ICLR 2026 上发表。谷歌表示该技术的主要应用之一是解决 Gemini 等模型的 KV 缓存瓶颈。
信源:https://research.google/blog/turboquant-redefining-ai-efficiency-with-extreme-compression/
「看起来是在试图摧毁Anthropic」:联邦法官公开质疑五角大楼
旧金山联邦法院法官 Rita Lin 在 Anthropic 诉五角大楼案听证会上称国防部的做法「令人不安」:「我不确定这是否算谋杀,但看起来是在试图摧毁 Anthropic。」她质疑 Anthropic 是否因在媒体上批评政府合同立场而遭到惩罚。
Anthropic 此前因拒绝移除防止 AI 用于全自主武器和大规模国内监控的安全防护措施而被列入黑名单。Anthropic 请求法院在诉讼期间恢复被标记前的状态,以减轻声誉损害。
信源:https://www.axios.com/2026/03/24/judge-pentagon-anthropic-troubling
旧金山联邦法院法官 Rita Lin 在 Anthropic 诉五角大楼案听证会上称国防部的做法「令人不安」:「我不确定这是否算谋杀,但看起来是在试图摧毁 Anthropic。」她质疑 Anthropic 是否因在媒体上批评政府合同立场而遭到惩罚。
Anthropic 此前因拒绝移除防止 AI 用于全自主武器和大规模国内监控的安全防护措施而被列入黑名单。Anthropic 请求法院在诉讼期间恢复被标记前的状态,以减轻声誉损害。
信源:https://www.axios.com/2026/03/24/judge-pentagon-anthropic-troubling
亚马逊收购纽约人形机器人公司Fauna,42英寸高、会走会跳舞
亚马逊收购了纽约人形机器人创业公司 Fauna Robotics,交易已于上周完成。Fauna 正在开发一款约 42 英寸(107 厘米)高的类人机器人,具备行走、抓取物品、跳舞和与人互动能力,定位消费级市场。
亚马逊此前在仓储物流中大规模部署工业机器人,收购 Fauna 标志着其将触角正式伸向消费级人形机器人。这也是继谷歌 DeepMind 扩大机器人合作伙伴版图、Meta 密集收购 Agent 团队之后,又一家科技巨头加注具身智能。
信源:https://www.bloomberg.com/news/articles/2026-03-24/amazon-acquires-fauna-robotics-entering-consumer-humanoid-market
亚马逊收购了纽约人形机器人创业公司 Fauna Robotics,交易已于上周完成。Fauna 正在开发一款约 42 英寸(107 厘米)高的类人机器人,具备行走、抓取物品、跳舞和与人互动能力,定位消费级市场。
亚马逊此前在仓储物流中大规模部署工业机器人,收购 Fauna 标志着其将触角正式伸向消费级人形机器人。这也是继谷歌 DeepMind 扩大机器人合作伙伴版图、Meta 密集收购 Agent 团队之后,又一家科技巨头加注具身智能。
信源:https://www.bloomberg.com/news/articles/2026-03-24/amazon-acquires-fauna-robotics-entering-consumer-humanoid-market
ChatGPT购物大转向:拍照比价取代一键下单,沃尔玛Shopify同日接入
OpenAI 上线改版后的 ChatGPT 购物体验。此前未能起量的 Instant Checkout 一键结账功能已被放弃,新版转向商品发现模式:用户可拍照上传或文字描述想买的商品,设定预算和偏好,ChatGPT 返回可视化比价结果。
商家通过两种方式接入:共享商品数据让产品直接展示在 ChatGPT 中,或开发 ChatGPT 内嵌应用掌控完整购物和结账体验。Target、丝芙兰、Nordstrom 已率先接入。沃尔玛同日上线 ChatGPT 内置购物服务,支持关联会员账户和 Walmart Pay。Shopify 也宣布推出「Agentic Plan」,让非 Shopify 商家也能通过其工具在 ChatGPT 和 Gemini 中展示商品。
信源:https://www.cnbc.com/2026/03/24/openai-revamps-shopping-experience-in-chatgpt-after-instant-checkout.html
OpenAI 上线改版后的 ChatGPT 购物体验。此前未能起量的 Instant Checkout 一键结账功能已被放弃,新版转向商品发现模式:用户可拍照上传或文字描述想买的商品,设定预算和偏好,ChatGPT 返回可视化比价结果。
商家通过两种方式接入:共享商品数据让产品直接展示在 ChatGPT 中,或开发 ChatGPT 内嵌应用掌控完整购物和结账体验。Target、丝芙兰、Nordstrom 已率先接入。沃尔玛同日上线 ChatGPT 内置购物服务,支持关联会员账户和 Walmart Pay。Shopify 也宣布推出「Agentic Plan」,让非 Shopify 商家也能通过其工具在 ChatGPT 和 Gemini 中展示商品。
信源:https://www.cnbc.com/2026/03/24/openai-revamps-shopping-experience-in-chatgpt-after-instant-checkout.html
Cloudflare发布Dynamic Workers:AI Agent代码启动快100倍,每天2毫美元
Cloudflare 发布 Dynamic Workers(公开测试版),采用基于 V8 引擎的轻量级隔离沙盒架构,按需创建、执行完立即销毁。启动耗时毫秒级,比传统 Linux 容器快 100 倍,内存效率高 10 至 100 倍,单个 Worker 仅需几 MB 内存。定价 $0.002/Worker/天。
Cloudflare 去年九月推出「Code Mode」策略:AI Agent 直接编写代码调用 API,而非通过 MCP 逐步发起工具调用。将 MCP 服务器转为 TypeScript API 后,token 消耗减少 81%。配套发布 @cloudflare/codemode、@cloudflare/worker-bundler、@cloudflare/shell 三个 npm 包。
信源:https://t.co/c36Vkb7I0R
Cloudflare 发布 Dynamic Workers(公开测试版),采用基于 V8 引擎的轻量级隔离沙盒架构,按需创建、执行完立即销毁。启动耗时毫秒级,比传统 Linux 容器快 100 倍,内存效率高 10 至 100 倍,单个 Worker 仅需几 MB 内存。定价 $0.002/Worker/天。
Cloudflare 去年九月推出「Code Mode」策略:AI Agent 直接编写代码调用 API,而非通过 MCP 逐步发起工具调用。将 MCP 服务器转为 TypeScript API 后,token 消耗减少 81%。配套发布 @cloudflare/codemode、@cloudflare/worker-bundler、@cloudflare/shell 三个 npm 包。
信源:https://t.co/c36Vkb7I0R
OpenAI Foundation宣布未来一年至少投入10亿美元,聚焦疾病研究和AI安全
OpenAI 旗下非营利机构 OpenAI Foundation 董事会主席 Bret Taylor 发文公布基金会最新进展,宣布未来一年将至少投入 10 亿美元,覆盖生命科学、就业与经济影响、AI 安全韧性和社区项目四大方向。这笔支出是此前宣布的 250 亿美元总承诺的一部分。
生命科学方面,基金会将与研究机构合作,利用 AI 攻克阿尔茨海默病的疾病通路映射、生物标志物检测和个性化治疗,同时创建开放医疗数据集,并针对资金长期不足的高死亡率疾病领域组织 AI 研究者与疾病专家联合工作坊。该方向由 Jacob Trefethen 负责,他此前在慈善咨询机构 Coefficient Giving 管理超 5 亿美元拨款。
AI 安全韧性方向由 OpenAI 联合创始人 Wojciech Zaremba 领导,聚焦三个领域:AI 对儿童和青少年的影响研究与安全措施开发、生物安全威胁的检测与防御、以及支持独立的 AI 模型安全测试和行业标准建设。
人事方面,基金会同步宣布多项任命:Robert Kaiden 出任 CFO,此前在德勤、Twitter 和旅游公司 Inspirato 担任高管;Anna Makanju 将于 4 月中旬加入,担任 AI for Civil Society and Philanthropy 负责人,此前为 OpenAI 全球影响力副总裁;Jeff Arnold 任运营总监,他是 OpenAI 早期成员。基金会目前仍在招募执行董事。
去年 10 月,OpenAI 宣布从非营利组织重组为公益公司,原非营利实体以 OpenAI Foundation 的名义保留对公司的控制权和财务权益。此次大规模支出计划是重组后基金会的首批重大举措。
信源:https://openaifoundation.org/news/update-on-the-openai-foundation
OpenAI 旗下非营利机构 OpenAI Foundation 董事会主席 Bret Taylor 发文公布基金会最新进展,宣布未来一年将至少投入 10 亿美元,覆盖生命科学、就业与经济影响、AI 安全韧性和社区项目四大方向。这笔支出是此前宣布的 250 亿美元总承诺的一部分。
生命科学方面,基金会将与研究机构合作,利用 AI 攻克阿尔茨海默病的疾病通路映射、生物标志物检测和个性化治疗,同时创建开放医疗数据集,并针对资金长期不足的高死亡率疾病领域组织 AI 研究者与疾病专家联合工作坊。该方向由 Jacob Trefethen 负责,他此前在慈善咨询机构 Coefficient Giving 管理超 5 亿美元拨款。
AI 安全韧性方向由 OpenAI 联合创始人 Wojciech Zaremba 领导,聚焦三个领域:AI 对儿童和青少年的影响研究与安全措施开发、生物安全威胁的检测与防御、以及支持独立的 AI 模型安全测试和行业标准建设。
人事方面,基金会同步宣布多项任命:Robert Kaiden 出任 CFO,此前在德勤、Twitter 和旅游公司 Inspirato 担任高管;Anna Makanju 将于 4 月中旬加入,担任 AI for Civil Society and Philanthropy 负责人,此前为 OpenAI 全球影响力副总裁;Jeff Arnold 任运营总监,他是 OpenAI 早期成员。基金会目前仍在招募执行董事。
去年 10 月,OpenAI 宣布从非营利组织重组为公益公司,原非营利实体以 OpenAI Foundation 的名义保留对公司的控制权和财务权益。此次大规模支出计划是重组后基金会的首批重大举措。
信源:https://openaifoundation.org/news/update-on-the-openai-foundation
Palantir CTO称对伊朗行动为「首个AI驱动的重大冲突」:48小时2000次打击
Palantir CTO Shyam Sankar 在 Fox News 节目上称美国对伊朗的「壮阔之怒」行动(Operation Epic Fury,2 月 28 日启动)是首个 AI 在军事打击中发挥核心作用的重大冲突。他称 48 小时内完成约 2000 次打击,「规划在以往同等规模冲突所需时间的零头内完成,每天的打击量超过此前同类行动的两倍。」据华盛顿邮报和 NBC 报道,Palantir 的 AI 目标生成平台 Maven 在行动首 24 小时内生成了约 1000 个优先打击目标。
Sankar 将人机协作比喻为「钢铁侠战甲」,强调决策权仍由人类掌握。围绕该行动的争议持续发酵,有报道称一次打击击中伊朗女子学校造成超 100 名平民死亡,特朗普政府声称该打击由伊朗自身军队实施,国防部正在调查。
信源:https://www.foxnews.com/media/palantir-executive-says-ai-enabling-rapid-battlefield-planning-high-speed-us-strike-operations
Palantir CTO Shyam Sankar 在 Fox News 节目上称美国对伊朗的「壮阔之怒」行动(Operation Epic Fury,2 月 28 日启动)是首个 AI 在军事打击中发挥核心作用的重大冲突。他称 48 小时内完成约 2000 次打击,「规划在以往同等规模冲突所需时间的零头内完成,每天的打击量超过此前同类行动的两倍。」据华盛顿邮报和 NBC 报道,Palantir 的 AI 目标生成平台 Maven 在行动首 24 小时内生成了约 1000 个优先打击目标。
Sankar 将人机协作比喻为「钢铁侠战甲」,强调决策权仍由人类掌握。围绕该行动的争议持续发酵,有报道称一次打击击中伊朗女子学校造成超 100 名平民死亡,特朗普政府声称该打击由伊朗自身军队实施,国防部正在调查。
信源:https://www.foxnews.com/media/palantir-executive-says-ai-enabling-rapid-battlefield-planning-high-speed-us-strike-operations
OpenAI COO:AI瓶颈已从电力转向内存芯片
OpenAI COO Brad Lightcap 在华盛顿 Hill and Valley Forum 上表示,内存芯片短缺是当前 AI 基础设施扩张的首要瓶颈:「现在是内存。过去是电力。」
科技公司正消耗越来越多的内存芯片产能,大量采购英伟达 AI 加速器是主因。内存短缺已从 AI 行业蔓延至消费电子和汽车。
信源:https://www.bloomberg.com/news/articles/2026-03-24/openai-s-lightcap-sees-memory-shortage-as-bottleneck-risk-for-ai
OpenAI COO Brad Lightcap 在华盛顿 Hill and Valley Forum 上表示,内存芯片短缺是当前 AI 基础设施扩张的首要瓶颈:「现在是内存。过去是电力。」
科技公司正消耗越来越多的内存芯片产能,大量采购英伟达 AI 加速器是主因。内存短缺已从 AI 行业蔓延至消费电子和汽车。
信源:https://www.bloomberg.com/news/articles/2026-03-24/openai-s-lightcap-sees-memory-shortage-as-bottleneck-risk-for-ai
Meta让CTO接管「AI原生」转型:Bosworth从元宇宙转向AI For Work
Meta 任命 CTO Andrew Bosworth(内部称 Boz)负责公司「AI For Work」计划,接替此前负责人 Guy Rosen。Bosworth 2006 年加入 Facebook,2022 年出任 CTO,此前主管 VR/AR 元宇宙业务。今年 1 月 Meta 裁撤元宇宙部门约 1500 个岗位后,将投入转向 AI 眼镜等方向。
Bosworth 在内部备忘录中称:「早期试点、对新想法的压力测试意愿,以及让团队快速拥抱 AI 工具的速度,创造了真正的动力。」AI For Work 旨在加速 AI 在 Meta 7.8 万人团队中的全面应用。
信源:https://www.wsj.com/tech/ai/meta-names-new-leader-of-companys-efforts-to-become-ai-native-8d7fe912
Meta 任命 CTO Andrew Bosworth(内部称 Boz)负责公司「AI For Work」计划,接替此前负责人 Guy Rosen。Bosworth 2006 年加入 Facebook,2022 年出任 CTO,此前主管 VR/AR 元宇宙业务。今年 1 月 Meta 裁撤元宇宙部门约 1500 个岗位后,将投入转向 AI 眼镜等方向。
Bosworth 在内部备忘录中称:「早期试点、对新想法的压力测试意愿,以及让团队快速拥抱 AI 工具的速度,创造了真正的动力。」AI For Work 旨在加速 AI 在 Meta 7.8 万人团队中的全面应用。
信源:https://www.wsj.com/tech/ai/meta-names-new-leader-of-companys-efforts-to-become-ai-native-8d7fe912
一句pip install偷光所有密钥:Karpathy称LiteLLM投毒为「软件界最恐怖的事」
OpenAI 创始成员 Andrej Karpathy 发帖称 AI 代理开发工具 LiteLLM 遭遇的供应链攻击是「现代软件中基本上最恐怖的事」。LiteLLM 月下载量 9700 万次,v1.82.7 和 v1.82.8 两个中毒版本已从 PyPI 下架。
仅一句
更危险的是传染性:任何依赖 LiteLLM 的项目都会连带中招,例如 `pip install dspy`(依赖 litellm>=1.64.0)同样会触发恶意代码。中毒版本在 PyPI 上仅存活约 1 小时便被发现,原因颇为讽刺:攻击者自己的恶意代码有个 bug,导致内存耗尽崩溃。开发者 Callum McMahon 在 AI 编程工具 Cursor 中使用一个 MCP 插件时,LiteLLM 作为传递依赖被拉入,安装后机器直接崩溃,由此暴露了攻击。Karpathy 评论称:「如果攻击者没有 vibe code 这次攻击,它可能数天甚至数周都不会被发现。」
攻击组织 TeamPCP 于 2 月底利用 LiteLLM 的 CI/CD 管道中 Trivy 漏洞扫描器在 GitHub Actions 中的配置缺陷入侵,窃取了 PyPI 发布令牌,随后绕过 GitHub 直接向 PyPI 上传恶意版本。LiteLLM 维护方 Berri AI CEO Krrish Dholakia 表示已删除所有发布令牌,计划转向基于 JWT 的可信发布机制。PyPA 发布安全通告 PYSEC-2026-2,建议所有安装过受影响版本的用户假设环境中所有凭证已泄露,应立即轮换。
信源:https://x.com/karpathy/status/2036487306585268612
OpenAI 创始成员 Andrej Karpathy 发帖称 AI 代理开发工具 LiteLLM 遭遇的供应链攻击是「现代软件中基本上最恐怖的事」。LiteLLM 月下载量 9700 万次,v1.82.7 和 v1.82.8 两个中毒版本已从 PyPI 下架。
仅一句
pip install litellm 就足以窃取机器上的 SSH 密钥、AWS/GCP/Azure 云凭证、Kubernetes 配置、git 凭证、环境变量(含所有 API 密钥)、shell 历史记录、加密钱包、SSL 私钥、CI/CD 密钥和数据库密码。恶意代码通过 4096 位 RSA 加密打包数据外传至伪装域名 models.litellm.cloud`,还会尝试在 Kubernetes 集群的 `kube-system 命名空间中创建特权容器植入持久后门。更危险的是传染性:任何依赖 LiteLLM 的项目都会连带中招,例如 `pip install dspy`(依赖 litellm>=1.64.0)同样会触发恶意代码。中毒版本在 PyPI 上仅存活约 1 小时便被发现,原因颇为讽刺:攻击者自己的恶意代码有个 bug,导致内存耗尽崩溃。开发者 Callum McMahon 在 AI 编程工具 Cursor 中使用一个 MCP 插件时,LiteLLM 作为传递依赖被拉入,安装后机器直接崩溃,由此暴露了攻击。Karpathy 评论称:「如果攻击者没有 vibe code 这次攻击,它可能数天甚至数周都不会被发现。」
攻击组织 TeamPCP 于 2 月底利用 LiteLLM 的 CI/CD 管道中 Trivy 漏洞扫描器在 GitHub Actions 中的配置缺陷入侵,窃取了 PyPI 发布令牌,随后绕过 GitHub 直接向 PyPI 上传恶意版本。LiteLLM 维护方 Berri AI CEO Krrish Dholakia 表示已删除所有发布令牌,计划转向基于 JWT 的可信发布机制。PyPA 发布安全通告 PYSEC-2026-2,建议所有安装过受影响版本的用户假设环境中所有凭证已泄露,应立即轮换。
信源:https://x.com/karpathy/status/2036487306585268612
OpenAI完成下一代模型Spud预训练,Altman卸下安全职责全力建数据中心
OpenAI CEO Sam Altman 在全员会上宣布,公司下一代主力模型代号 Spud 已完成预训练,预计「几周内」会有一个「非常强的模型」,Altman 称团队相信它「真的能推动经济发展」。
Altman 同时宣布将 AI 安全(safety)团队移交首席研究官 Mark Chen 的研究部门,信息安全(security)团队划归联合创始人兼总裁 Greg Brockman 领导的「规模化」部门,自己将专注于融资、供应链和「以前所未有的规模建设数据中心」。高管 Fidji Simo 负责的产品部门更名为「AGI Deployment」。OpenAI 上周已告知员工,将把 ChatGPT、编程 Agent Codex 和浏览器 Atlas 合并为桌面端「超级应用」。
信源:https://www.theinformation.com/articles/openai-ceo-shifts-responsibilities-preps-spud-ai-model
OpenAI CEO Sam Altman 在全员会上宣布,公司下一代主力模型代号 Spud 已完成预训练,预计「几周内」会有一个「非常强的模型」,Altman 称团队相信它「真的能推动经济发展」。
Altman 同时宣布将 AI 安全(safety)团队移交首席研究官 Mark Chen 的研究部门,信息安全(security)团队划归联合创始人兼总裁 Greg Brockman 领导的「规模化」部门,自己将专注于融资、供应链和「以前所未有的规模建设数据中心」。高管 Fidji Simo 负责的产品部门更名为「AGI Deployment」。OpenAI 上周已告知员工,将把 ChatGPT、编程 Agent Codex 和浏览器 Atlas 合并为桌面端「超级应用」。
信源:https://www.theinformation.com/articles/openai-ceo-shifts-responsibilities-preps-spud-ai-model
全球仅三家:火山引擎日均词元(Token)调用破百万亿,不到两月涨超60%
字节跳动云计算业务火山引擎的日均云端大模型调用量已超过 100 万亿词元(Token),春节以来不到两个月上涨超 60%。全球目前仅 OpenAI、谷歌与字节跳动三家公司达到这一量级,字节的消耗主要来自中国市场,海外市场处于快速增长阶段。
火山引擎人士称,增长还是在约束条件下实现的,视频生成模型 Seedance 2.0 API 尚未在海外正式上线。过去一个多月,来自个人用户的词元(Token)消耗增长了约 16 倍,OpenClaw 等 Agent 产品将 AI 推向大众用户是主要推动力。
火山引擎此前定下 2026 年 MaaS(模型即服务)业务收入超百亿元的目标,随着 Seed 2.0、Seedance 2.0 等模型发布和 OpenClaw 持续爆火,团队已上调收入目标。字节在国内云计算起步最晚,将 MaaS 视为弯道超车的核心战场。
国家数据局昨日披露,中国日均词元(Token)调用量今年 3 月已突破 140 万亿。2024 年初这一数字为 1000 亿,2025 年底跃升至 100 万亿,两年增长超千倍。
信源:https://mp.weixin.qq.com/s/sHL6k9vf8UNgYkfaj2qmbA
字节跳动云计算业务火山引擎的日均云端大模型调用量已超过 100 万亿词元(Token),春节以来不到两个月上涨超 60%。全球目前仅 OpenAI、谷歌与字节跳动三家公司达到这一量级,字节的消耗主要来自中国市场,海外市场处于快速增长阶段。
火山引擎人士称,增长还是在约束条件下实现的,视频生成模型 Seedance 2.0 API 尚未在海外正式上线。过去一个多月,来自个人用户的词元(Token)消耗增长了约 16 倍,OpenClaw 等 Agent 产品将 AI 推向大众用户是主要推动力。
火山引擎此前定下 2026 年 MaaS(模型即服务)业务收入超百亿元的目标,随着 Seed 2.0、Seedance 2.0 等模型发布和 OpenClaw 持续爆火,团队已上调收入目标。字节在国内云计算起步最晚,将 MaaS 视为弯道超车的核心战场。
国家数据局昨日披露,中国日均词元(Token)调用量今年 3 月已突破 140 万亿。2024 年初这一数字为 1000 亿,2025 年底跃升至 100 万亿,两年增长超千倍。
信源:https://mp.weixin.qq.com/s/sHL6k9vf8UNgYkfaj2qmbA
商汤下半年EBITDA上市后首次转正:全年营收破50亿增33%,亏损收窄近六成
商汤科技发布 2025 年全年业绩公告,总收入超 50 亿元,同比增长 33%,创历史新高,增幅为近三年最快。全年净亏损收窄 58.6%,下半年息税折旧摊销前利润(EBITDA)为 3.8 亿元,上市后首次转正。下半年经营性现金流也自上市以来首次实现正向净流入,贸易应收回款达 48.7 亿元创历史新高。
其中生成式 AI 业务增长 51%。泛办公领域的小浣熊家族累计服务 1500 万个人用户与数千家企业客户,全年月活增长 7 倍。商汤宣布将于 2026 年第二季度推出基于第二代 NEO 架构的全新模型,去年 12 月商汤发布并开源了首代 NEO 原生多模态模型架构。
信源:https://www.ithome.com/0/932/300.htm
商汤科技发布 2025 年全年业绩公告,总收入超 50 亿元,同比增长 33%,创历史新高,增幅为近三年最快。全年净亏损收窄 58.6%,下半年息税折旧摊销前利润(EBITDA)为 3.8 亿元,上市后首次转正。下半年经营性现金流也自上市以来首次实现正向净流入,贸易应收回款达 48.7 亿元创历史新高。
其中生成式 AI 业务增长 51%。泛办公领域的小浣熊家族累计服务 1500 万个人用户与数千家企业客户,全年月活增长 7 倍。商汤宣布将于 2026 年第二季度推出基于第二代 NEO 架构的全新模型,去年 12 月商汤发布并开源了首代 NEO 原生多模态模型架构。
信源:https://www.ithome.com/0/932/300.htm
博通称台积电产能触顶:AI芯片供应链全面吃紧,PCB交期从6周拉到半年
芯片设计公司博通的物理层产品部门产品营销总监 Natarajan Ramachandran 表示,台积电的生产产能正在触及上限,「几年前我还会说它的产能是无限的」。他称台积电将在 2027 年前扩充产能,但 2026 年这一产能瓶颈已经「卡住了供应链」。
短缺已蔓延至半导体以外。Ramachandran 称激光器领域出现明显供应约束,PCB(印刷电路板)成为「意想不到的」瓶颈,用于光收发器的 PCB 交期从约 6 周拉长至 6 个月,台湾和中国大陆的 PCB 供应商均面临产能上限。许多客户正与供应商签订 3 至 4 年的长期协议以锁定产能,三星电子上周也表示正与主要客户转向 3 至 5 年的长约。
信源:https://www.reuters.com/world/asia-pacific/broadcom-flags-supply-constraints-says-tsmc-capacity-bottleneck-2026-03-24/
芯片设计公司博通的物理层产品部门产品营销总监 Natarajan Ramachandran 表示,台积电的生产产能正在触及上限,「几年前我还会说它的产能是无限的」。他称台积电将在 2027 年前扩充产能,但 2026 年这一产能瓶颈已经「卡住了供应链」。
短缺已蔓延至半导体以外。Ramachandran 称激光器领域出现明显供应约束,PCB(印刷电路板)成为「意想不到的」瓶颈,用于光收发器的 PCB 交期从约 6 周拉长至 6 个月,台湾和中国大陆的 PCB 供应商均面临产能上限。许多客户正与供应商签订 3 至 4 年的长期协议以锁定产能,三星电子上周也表示正与主要客户转向 3 至 5 年的长约。
信源:https://www.reuters.com/world/asia-pacific/broadcom-flags-supply-constraints-says-tsmc-capacity-bottleneck-2026-03-24/
全球最大主权基金半数员工用Claude编程,下一步让AI自主做投资决策
管理 2.1 万亿美元资产的挪威主权财富基金(Norges Bank Investment Management)约半数员工已在使用 Anthropic 的 Claude 大语言模型自行编写 AI 工具。基金机器学习与 AI 负责人 Stian Kirkeberg 在一场 AI 研讨会上介绍,员工主要用这些工具辅助决策,包括监控基金投资的 7000 家公司的 ESG 和财务风险、模拟合同谈判、准备公司会议等。
Kirkeberg 表示,未来将允许部分 AI 智能体在人类监督下自主做出有限决策。「原则是让 AI 为我们分析,从而做出更好的人类决策,」他说,「到某个阶段,我们会信任智能体能做出部分决策,我们只需监控它的行为。」他强调目前尚未实施这一模式,人类监督仍不可或缺。
基金 CEO Nicolai Tangen 曾称不采用 AI 的公司是「彻头彻尾的蠢货」(complete morons)。他表示基金在 AI 上投入了「数百万克朗」,回报达到「数十亿克朗」级别。基金目前已在用 AI 分析交易时机以降低交易成本,员工规模将维持约 700 人,但岗位将从后台行政向前端投资转移。
信源:https://www.reuters.com/business/norway-wealth-fund-moves-towards-some-ai-driven-decisions-with-humans-control-2026-03-24/
管理 2.1 万亿美元资产的挪威主权财富基金(Norges Bank Investment Management)约半数员工已在使用 Anthropic 的 Claude 大语言模型自行编写 AI 工具。基金机器学习与 AI 负责人 Stian Kirkeberg 在一场 AI 研讨会上介绍,员工主要用这些工具辅助决策,包括监控基金投资的 7000 家公司的 ESG 和财务风险、模拟合同谈判、准备公司会议等。
Kirkeberg 表示,未来将允许部分 AI 智能体在人类监督下自主做出有限决策。「原则是让 AI 为我们分析,从而做出更好的人类决策,」他说,「到某个阶段,我们会信任智能体能做出部分决策,我们只需监控它的行为。」他强调目前尚未实施这一模式,人类监督仍不可或缺。
基金 CEO Nicolai Tangen 曾称不采用 AI 的公司是「彻头彻尾的蠢货」(complete morons)。他表示基金在 AI 上投入了「数百万克朗」,回报达到「数十亿克朗」级别。基金目前已在用 AI 分析交易时机以降低交易成本,员工规模将维持约 700 人,但岗位将从后台行政向前端投资转移。
信源:https://www.reuters.com/business/norway-wealth-fund-moves-towards-some-ai-driven-decisions-with-humans-control-2026-03-24/
黄金穹顶核心软件首次曝光:Anduril和Palantir牵头,军工巨头反当分包商
Anduril Industries 和 Palantir 正在牵头开发特朗普政府 1850 亿美元「黄金穹顶」反导防御系统的核心指控软件,目标今年夏天完成测试。参与开发的还包括从谷歌母公司 Alphabet 脱胎的网络公司 Aalyria Technologies、AI 创业公司 Scale AI 和软件公司 Swoop Technologies。
该软件被项目负责人、太空军上将 Michael Guetlein 称为「胶水层」,负责连接分布在不同军种的雷达、太空传感器和导弹拦截系统,让指挥官统一调度武器应对空中威胁。Guetlein 称:「我们从第一天就认识到,指挥与控制将是我们的核心优势。」该软件是唯一由 Guetlein 办公室直接管理的黄金穹顶项目。
传统上直接与五角大楼签约的洛克希德·马丁、诺斯罗普·格鲁曼和 RTX 三家军工巨头,在该项目中反而以分包商身份加入,为科技公司提供支持。Anduril 本月还赢得了美国陆军一项价值最高 200 亿美元的十年期合同。
信源:https://www.wsj.com/politics/national-security/anduril-palantir-are-developing-golden-dome-missile-shields-software-63c36db4?gaa_at=eafs&gaa_n=AWEtsqcuLJJO8XhVNlJ_6GZuvQM_CMBMyjLtQoFD3Hf9em_xcc2CgnLniiD4P-L-N2E%3D&gaa_ts=69c36170&gaa_sig=JS5g9nFvUsiNB-zowWEe_JSDSTdDzO-t76sPPJXM-f0PjOZ_6_k0Wno4Ph_xEA3R4V0vRw4Hp9HksHmr-pQX5w%3D%3D
Anduril Industries 和 Palantir 正在牵头开发特朗普政府 1850 亿美元「黄金穹顶」反导防御系统的核心指控软件,目标今年夏天完成测试。参与开发的还包括从谷歌母公司 Alphabet 脱胎的网络公司 Aalyria Technologies、AI 创业公司 Scale AI 和软件公司 Swoop Technologies。
该软件被项目负责人、太空军上将 Michael Guetlein 称为「胶水层」,负责连接分布在不同军种的雷达、太空传感器和导弹拦截系统,让指挥官统一调度武器应对空中威胁。Guetlein 称:「我们从第一天就认识到,指挥与控制将是我们的核心优势。」该软件是唯一由 Guetlein 办公室直接管理的黄金穹顶项目。
传统上直接与五角大楼签约的洛克希德·马丁、诺斯罗普·格鲁曼和 RTX 三家军工巨头,在该项目中反而以分包商身份加入,为科技公司提供支持。Anduril 本月还赢得了美国陆军一项价值最高 200 亿美元的十年期合同。
信源:https://www.wsj.com/politics/national-security/anduril-palantir-are-developing-golden-dome-missile-shields-software-63c36db4?gaa_at=eafs&gaa_n=AWEtsqcuLJJO8XhVNlJ_6GZuvQM_CMBMyjLtQoFD3Hf9em_xcc2CgnLniiD4P-L-N2E%3D&gaa_ts=69c36170&gaa_sig=JS5g9nFvUsiNB-zowWEe_JSDSTdDzO-t76sPPJXM-f0PjOZ_6_k0Wno4Ph_xEA3R4V0vRw4Hp9HksHmr-pQX5w%3D%3D
GPT-5.2也只答对四分之一:Sierra发布τ³-Bench测出AI Agent真实水平
AI 智能体公司 Sierra 发布 τ³-Bench 基准测试,在 2024 年 6 月推出的 τ-Bench 基础上新增知识库和语音两个评估维度。
τ-Knowledge 构建了一个金融科技客服场景 τ-Banking,包含 698 篇文档、21 个产品类别、约 19.5 万 token 的知识库。智能体需要在其中检索正确策略文档,推理并执行多步工具调用,例如找到争议交易的退款政策、冻结银行卡、发起争议并发放临时信用额度,且顺序必须正确。表现最好的前沿模型 GPT-5.2(高推理模式)仅通过约 25% 的任务;即使直接提供完成任务所需的全部文档,通过率也只升至 40%,表明瓶颈不仅在于检索,更在于理解信息并正确执行操作。
τ-Voice 在 OpenAI Realtime、谷歌 Gemini Live 和 xAI Grok Voice 三家语音服务上进行测试,模拟真实通话环境:带口音的用户从嘈杂咖啡店拨入,网络信号不稳,且会随时打断智能体。在理想条件下,最佳语音智能体的任务完成率接近非推理文本模型(约 54% 对比 31%-51%),引入真实音频条件后降至 26%-38%。文本推理模型可达约 85%,差距悬殊。身份验证是最大的失败点,智能体一旦听错用户姓名或邮箱地址,后续所有操作都会连锁失败。
此次更新还纳入了亚马逊 τ²-Bench Verified 团队和 Anthropic 等提交的社区修正,提升了原有航空、零售和电信场景的评估准确性。
信源:https://sierra.ai/blog/bench-advancing-agent-benchmarking-to-knowledge-and-voice
AI 智能体公司 Sierra 发布 τ³-Bench 基准测试,在 2024 年 6 月推出的 τ-Bench 基础上新增知识库和语音两个评估维度。
τ-Knowledge 构建了一个金融科技客服场景 τ-Banking,包含 698 篇文档、21 个产品类别、约 19.5 万 token 的知识库。智能体需要在其中检索正确策略文档,推理并执行多步工具调用,例如找到争议交易的退款政策、冻结银行卡、发起争议并发放临时信用额度,且顺序必须正确。表现最好的前沿模型 GPT-5.2(高推理模式)仅通过约 25% 的任务;即使直接提供完成任务所需的全部文档,通过率也只升至 40%,表明瓶颈不仅在于检索,更在于理解信息并正确执行操作。
τ-Voice 在 OpenAI Realtime、谷歌 Gemini Live 和 xAI Grok Voice 三家语音服务上进行测试,模拟真实通话环境:带口音的用户从嘈杂咖啡店拨入,网络信号不稳,且会随时打断智能体。在理想条件下,最佳语音智能体的任务完成率接近非推理文本模型(约 54% 对比 31%-51%),引入真实音频条件后降至 26%-38%。文本推理模型可达约 85%,差距悬殊。身份验证是最大的失败点,智能体一旦听错用户姓名或邮箱地址,后续所有操作都会连锁失败。
此次更新还纳入了亚马逊 τ²-Bench Verified 团队和 Anthropic 等提交的社区修正,提升了原有航空、零售和电信场景的评估准确性。
信源:https://sierra.ai/blog/bench-advancing-agent-benchmarking-to-knowledge-and-voice