字节跳动2025年净利润传降超70%,AI投入开始吃掉利润
知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。
转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。
信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。
转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。
信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
中国至少10家AI芯片公司已在同步出货,英伟达在华份额今年或从40%跌至8%
《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。
Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。
路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。
两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。
阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。
供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。
信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms
《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。
Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。
路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。
两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。
阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。
供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。
信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms
Google Cloud Next前夕,市场预期TPUv8亮相
Google Cloud Next 2026 将于 4 月 22 日至 24 日在拉斯维加斯举行。市场预期 Google 会在大会前后展示 v8 架构 TPU。Google 目前还没正式确认这代芯片的名称、型号和发布时间。Google 准备让联发科参与下一代 TPU,同时维持和博通的合作。
信源:https://money.udn.com/money/story/5612/9451634
Google Cloud Next 2026 将于 4 月 22 日至 24 日在拉斯维加斯举行。市场预期 Google 会在大会前后展示 v8 架构 TPU。Google 目前还没正式确认这代芯片的名称、型号和发布时间。Google 准备让联发科参与下一代 TPU,同时维持和博通的合作。
信源:https://money.udn.com/money/story/5612/9451634
經濟日報
Google 新 TPU 來了 光聖、奇鋐、台達電跟著紅 | 產業熱點 | 產業 | 經濟日報
Google最新v8架構張量處理器(TPU)有望在本周亮相,不僅帶旺半導體、組裝協力廠後市,也將掀起一系列周邊元件升級商機,包括OCS全光交換器、液冷、電源、光通訊等業者跟著吃補。
阿里开放下一代旗舰 Qwen3.6-Max-Preview 预览,主打智能体编程
阿里千问团队发布 Qwen3.6-Max-Preview,定位是下一代旗舰模型的早期预览版,接替现有的 Qwen3.6-Plus。用户可在 Qwen Studio(chat.qwen.ai)直接对话体验,随后通过阿里云百炼以
这一版主要面向智能体编程(agentic coding),让模型像程序员一样自己写代码、运行、看报错、调用工具,完成多步骤编程任务。官方相对前代 Qwen3.6-Plus 给出的提升集中在编程:SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0、Terminal-Bench 2.0 +3.8 分;世界知识与工具调用格式遵循另三项各有 2.3 到 5.3 分的提升。官方自称在 SWE-bench Pro、Terminal-Bench 2.0、SciCode 等六项编程基准上取得最高分,其中 QwenClawBench、QwenWebBench 从命名看是千问自建评测集,需与公开基准分开看。
API 这一侧还新增了
信源:https://mp.weixin.qq.com/s/DKxrFnBwisNjjOnFQRqsqA
阿里千问团队发布 Qwen3.6-Max-Preview,定位是下一代旗舰模型的早期预览版,接替现有的 Qwen3.6-Plus。用户可在 Qwen Studio(chat.qwen.ai)直接对话体验,随后通过阿里云百炼以
qwen3.6-max-preview 的模型名开放 API 调用;接口兼容 OpenAI 的 chat completions、responses 规范以及 Anthropic 的协议。这一版主要面向智能体编程(agentic coding),让模型像程序员一样自己写代码、运行、看报错、调用工具,完成多步骤编程任务。官方相对前代 Qwen3.6-Plus 给出的提升集中在编程:SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0、Terminal-Bench 2.0 +3.8 分;世界知识与工具调用格式遵循另三项各有 2.3 到 5.3 分的提升。官方自称在 SWE-bench Pro、Terminal-Bench 2.0、SciCode 等六项编程基准上取得最高分,其中 QwenClawBench、QwenWebBench 从命名看是千问自建评测集,需与公开基准分开看。
API 这一侧还新增了
preserve_thinking 选项:打开后消息会保留前几轮的 thinking 内容。推理模型默认每轮只把「本轮思考」返回一次,多轮智能体对话里上下文缺了前面几步的思考,模型重新规划时容易走回头路或忘记自己已经试过什么,这个开关补的就是这个断档。信源:https://mp.weixin.qq.com/s/DKxrFnBwisNjjOnFQRqsqA
Anthropic 开源 claude-desktop-buddy,让 Claude 桌面端充当硬件外设的蓝牙网关
Anthropic 近日在 GitHub 开源 claude-desktop-buddy 仓库,公开了 Claude 桌面应用面向创客社区的蓝牙 API,并附带一个 ESP32 桌宠参考实现。
具体做法是,Claude 的 macOS 和 Windows 客户端在开发者模式下(Help → Troubleshooting → Enable Developer Mode)开放一个 BLE 接口,通过 Nordic UART Service(低功耗蓝牙里一个常用的自定义串口服务)把会话状态、权限请求和最近消息推送给配对的硬件,硬件也能把「通过 / 拒绝」按钮回传给桌面。对想做 AI 外设的开发者,这条通路省掉了自己对接 Claude API 的环节:只要用户桌面客户端开着,硬件就能拿到会话的实时状态,并在本地按键完成审批。
仓库提供的示例用 M5StickC Plus 做了一个桌宠:桌面没活跃会话时它睡觉,会话启动后醒来,有权限请求挂起时会变得焦急,用户按 A 通过、B 拒绝。这款微型开发板的生产商 M5Stack(中文名明栈)2024 年已被 ESP32 芯片母公司乐鑫科技(Espressif)收购,现为乐鑫子公司;板上主控正是乐鑫自家的 ESP32-PICO-D4 双核 240 MHz 芯片,工程配置文件
Anthropic 在仓库说明里强调,这个 BLE API 只在开发者模式下生效,不是官方支持的产品功能,定位是给创客社区一个需要用户手动开启的轻量接口。
信源:https://github.com/anthropics/claude-desktop-buddy
Anthropic 近日在 GitHub 开源 claude-desktop-buddy 仓库,公开了 Claude 桌面应用面向创客社区的蓝牙 API,并附带一个 ESP32 桌宠参考实现。
具体做法是,Claude 的 macOS 和 Windows 客户端在开发者模式下(Help → Troubleshooting → Enable Developer Mode)开放一个 BLE 接口,通过 Nordic UART Service(低功耗蓝牙里一个常用的自定义串口服务)把会话状态、权限请求和最近消息推送给配对的硬件,硬件也能把「通过 / 拒绝」按钮回传给桌面。对想做 AI 外设的开发者,这条通路省掉了自己对接 Claude API 的环节:只要用户桌面客户端开着,硬件就能拿到会话的实时状态,并在本地按键完成审批。
仓库提供的示例用 M5StickC Plus 做了一个桌宠:桌面没活跃会话时它睡觉,会话启动后醒来,有权限请求挂起时会变得焦急,用户按 A 通过、B 拒绝。这款微型开发板的生产商 M5Stack(中文名明栈)2024 年已被 ESP32 芯片母公司乐鑫科技(Espressif)收购,现为乐鑫子公司;板上主控正是乐鑫自家的 ESP32-PICO-D4 双核 240 MHz 芯片,工程配置文件
platformio.ini 里 board 字段明确写成 `m5stick-c`。固件预置 18 种 ASCII 角色,每种配七套动画,覆盖睡觉、空闲、工作、待审批、升级、被摇晃和快速通过这七种状态;每累计 50K tokens 触发一次升级庆祝,五秒内通过审批则冒出爱心。若想换成 GIF 角色,桌面应用支持把一个包含 manifest.json 和若干 96 像素宽 GIF 的文件夹直接推到设备,整包不得超过 1.8 MB。Anthropic 在仓库说明里强调,这个 BLE API 只在开发者模式下生效,不是官方支持的产品功能,定位是给创客社区一个需要用户手动开启的轻量接口。
信源:https://github.com/anthropics/claude-desktop-buddy
「神经计算机」论文9天内换v2,删掉「模型本身就是计算机」的断言
4 月 7 日,Meta AI 与 LSTM 共同发明人 Jürgen Schmidhuber 团队联合发布论文《Neural Computers》,提出「神经计算机」(Neural Computer,NC)这一设想:让一个模型同时承担计算、存储和输入输出,不再像智能体那样调用外部程序,也不再像世界模型那样只学环境动态。论文把终极形态称为 Completely Neural Computer(CNC),并用视频模型做了两个原型,分别在 CLI 和 GUI 环境里从指令、屏幕像素和用户操作预测下一帧画面。
4 月 16 日,作者把论文换成 v2,没有新增实验,但摘要里的关键措辞被系统性调软。v1 中那句定义「NCs aim to make the model itself the running computer」整句删掉。两个修饰词改了,「early NC primitives」换成「elementary NC primitives」,「remain open」换成「remain challenging」。v1 摘要开头原本通过和传统计算机、智能体、世界模型正面对比来立论,v2 去掉了这段对比,把「新的计算范式」从定义句挪到结尾,当作远期路线图提出。
换句话说,论文的核心实验没变,但作者把自我定位从「NC 的目标就是让模型成为计算机」调到了「NC 还只是起点,很多事仍有挑战」。
信源:https://arxiv.org/abs/2604.06425v2
4 月 7 日,Meta AI 与 LSTM 共同发明人 Jürgen Schmidhuber 团队联合发布论文《Neural Computers》,提出「神经计算机」(Neural Computer,NC)这一设想:让一个模型同时承担计算、存储和输入输出,不再像智能体那样调用外部程序,也不再像世界模型那样只学环境动态。论文把终极形态称为 Completely Neural Computer(CNC),并用视频模型做了两个原型,分别在 CLI 和 GUI 环境里从指令、屏幕像素和用户操作预测下一帧画面。
4 月 16 日,作者把论文换成 v2,没有新增实验,但摘要里的关键措辞被系统性调软。v1 中那句定义「NCs aim to make the model itself the running computer」整句删掉。两个修饰词改了,「early NC primitives」换成「elementary NC primitives」,「remain open」换成「remain challenging」。v1 摘要开头原本通过和传统计算机、智能体、世界模型正面对比来立论,v2 去掉了这段对比,把「新的计算范式」从定义句挪到结尾,当作远期路线图提出。
换句话说,论文的核心实验没变,但作者把自我定位从「NC 的目标就是让模型成为计算机」调到了「NC 还只是起点,很多事仍有挑战」。
信源:https://arxiv.org/abs/2604.06425v2
arXiv.org
Neural Computers
We propose a new frontier: Neural Computers (NCs) that unify computation, memory, and I/O of traditional computers in a learned runtime state. Our long-term goal is the Completely Neural Computer...
英伟达芯片架构师Max Lv开源mcp-cli,尝试减少Codex进程开销
英伟达芯片架构师 Max Lv 公开
作者用 Codex CLI 0.120.0 跑了一次基准,目标仓库是
这组数据先说明了一件事:代码智能体的开销,确实有一部分不在模型,而在反复起本地命令和回传长文本上。不过它还没证明自己能让 Codex 整体更快。同一份基准里,总耗时反而增加了 45%,因为原来一条 Bash 流水线能做完的事,换成 MCP 后往往被拆成多次调用。换句话说,`mcp-cli` 先证明了「少起进程」这条路值得做,但离真正好用还差一步,后面还得补批量读文件、组合搜索这类更贴近智能体工作流的工具。
信源:https://github.com/madeye/mcp-cli
英伟达芯片架构师 Max Lv 公开
mcp-cli 原型。它盯的是 Codex、Claude Code 这类代码智能体在本地干活时,老要反复起 cat`、`rg`、`git status 这类小命令。`mcp-cli` 的做法是让一个常驻进程把读文件、搜代码、查 Git 状态这些活接过去,少一点「现用现起」的折腾。作者用 Codex CLI 0.120.0 跑了一次基准,目标仓库是
openai/codex 的 rust-v0.121.0 标签。结果是 execve 总数从 103 次降到 22 次,少了 79%;输入 token 从 215.96 万降到 175.56 万,少了 19%。作者还加了 --prefer-mcp 参数,让 Codex 优先走 MCP 工具,不再默认先走 Bash。这组数据先说明了一件事:代码智能体的开销,确实有一部分不在模型,而在反复起本地命令和回传长文本上。不过它还没证明自己能让 Codex 整体更快。同一份基准里,总耗时反而增加了 45%,因为原来一条 Bash 流水线能做完的事,换成 MCP 后往往被拆成多次调用。换句话说,`mcp-cli` 先证明了「少起进程」这条路值得做,但离真正好用还差一步,后面还得补批量读文件、组合搜索这类更贴近智能体工作流的工具。
信源:https://github.com/madeye/mcp-cli
GitHub
GitHub - madeye/mcp-cli: a prototype to save fork/exec overhead of ai code agent
a prototype to save fork/exec overhead of ai code agent - madeye/mcp-cli
字节高管回应「净利润降超70%」:经营面没这么差
抖音集团副总裁李亮在微博转发相关报道时回应,今日流传的「字节跳动 2025 年净利润下降 70%」是按国际会计准则计算的结果,除新兴业务投资加大外,还包含优先股和期权成本变动,这些因素「不反映运营实质」。他给出的口径是:受抖音电商增速放缓和新业务投入影响,字节下半年经营利润率只是小幅下滑,远没有媒体报道的那么大;若不考虑优先股和期权成本变动,总体营收和利润仍在增长,TikTok 电商和新兴业务趋势也不错。
信源:https://weibo.com/7965906915/5289821159294724
抖音集团副总裁李亮在微博转发相关报道时回应,今日流传的「字节跳动 2025 年净利润下降 70%」是按国际会计准则计算的结果,除新兴业务投资加大外,还包含优先股和期权成本变动,这些因素「不反映运营实质」。他给出的口径是:受抖音电商增速放缓和新业务投入影响,字节下半年经营利润率只是小幅下滑,远没有媒体报道的那么大;若不考虑优先股和期权成本变动,总体营收和利润仍在增长,TikTok 电商和新兴业务趋势也不错。
信源:https://weibo.com/7965906915/5289821159294724
美国纽约州议会众议员Alex Bores提AI分红,拟在AI挤掉岗位时发钱
纽约州议会众议员、纽约第 12 选区民主党国会候选人 Alex Bores 推出一项「AI 分红」方案。这套机制会在 AI 明显替代美国岗位时启动,一部分钱直接发给美国人,另一部分投向职业培训、教育和政府独立监管能力建设。
筹资思路有三块:对 AI 使用征收一项低税率的「token 税」、通过持有前沿 AI 公司的股权分享收益,以及修改税制,减少企业在「用 AI 少雇人」场景继续加码投入的激励。Bores 自己公开的竞选平台里,已经把「向大型 AI 公司征税,给美国人发 AI 分红」列成主张。
和泛泛谈全民基本收入不同,这份方案把触发条件写成了「AI 明显替代岗位」,也把资金来源直接对准 AI 使用和 AI 公司收益。Bores 此前在纽约州推动通过 RAISE Act,主打 AI 安全;这次则把焦点往分配问题挪了一步。美国围绕 AI 的政治争论,开始从「要不要管」往「效率红利归谁」延伸。
信源:https://www.axios.com/2026/04/20/alex-bores-ai-dividend-plan-wealth
纽约州议会众议员、纽约第 12 选区民主党国会候选人 Alex Bores 推出一项「AI 分红」方案。这套机制会在 AI 明显替代美国岗位时启动,一部分钱直接发给美国人,另一部分投向职业培训、教育和政府独立监管能力建设。
筹资思路有三块:对 AI 使用征收一项低税率的「token 税」、通过持有前沿 AI 公司的股权分享收益,以及修改税制,减少企业在「用 AI 少雇人」场景继续加码投入的激励。Bores 自己公开的竞选平台里,已经把「向大型 AI 公司征税,给美国人发 AI 分红」列成主张。
和泛泛谈全民基本收入不同,这份方案把触发条件写成了「AI 明显替代岗位」,也把资金来源直接对准 AI 使用和 AI 公司收益。Bores 此前在纽约州推动通过 RAISE Act,主打 AI 安全;这次则把焦点往分配问题挪了一步。美国围绕 AI 的政治争论,开始从「要不要管」往「效率红利归谁」延伸。
信源:https://www.axios.com/2026/04/20/alex-bores-ai-dividend-plan-wealth
Axios
Exclusive: Alex Bores rolls out "AI dividend" plan to share AI wealth
Bores is a Democratic House candidate in New York and a top target of AI super PACs.
阿里HappyHorse-1.0定于4月27日开测
阿里视频生成模型 HappyHorse-1.0 将于 4 月 27 日通过阿里云百炼逐步开放 API 测试,首批邀测对象是企业级客户,5 月份正式商用。
HappyHorse 项目由阿里 ATH 创新事业部主导,阿里平台技术、通义实验室和淘天技术等团队共同参与。
信源:https://www.yicai.com/news/103141257.html
阿里视频生成模型 HappyHorse-1.0 将于 4 月 27 日通过阿里云百炼逐步开放 API 测试,首批邀测对象是企业级客户,5 月份正式商用。
HappyHorse 项目由阿里 ATH 创新事业部主导,阿里平台技术、通义实验室和淘天技术等团队共同参与。
信源:https://www.yicai.com/news/103141257.html
Yicai
阿里HappyHorse将于4月27日开放测试
阿里ATH今日宣布,HappyHorse-1.0将于4月27日通过阿里云百炼平台逐步开放API测试,首批邀测对象为企业级客户。 阿里ATH方面透露,阿里巴巴在AI视频生成领域已深耕多年,HappyHorse项目由ATH创新事业部主导,联合阿里平台技术、通义实验室及淘天技术等多个团队协同打造。4月底开放测试后,HappyHorse-1.0将于5月份正式发布商用。(第一财经记者 陈杨园)
OpenAI 科研工作空间 Prism 下线,上线不到 3 个月
OpenAI 已下线科研工作空间 Prism。4 月 20 日有用户在 X 上反馈无法再打开该产品。其中一位用 Prism 合作写论文的用户表示,关停前没有收到导出文件的提醒,目前只能把最后一次生成的 PDF 用 Codex 转回 LaTeX 源码。
Prism 是 OpenAI 今年 1 月 27 日发布的免费科研工作空间,基于 GPT-5.2,与 LaTeX 深度集成,支持多人协作写论文,脱胎于 OpenAI 去年收购的云 LaTeX 平台 Crixet。
Prism 的消失是 OpenAI 近期收缩非核心业务的一部分。4 月 17 日 OpenAI for Science 部门被拆分并入其他研究团队,负责人 Kevin Weil 离职;3 月 24 日,Sora 作为独立产品关停。更早在 3 月 16 日,OpenAI 应用业务 CEO Fidji Simo 在全员会上称公司「不能因 side quests 分心」,要把重心放到面向企业和编码工具上,并把 Anthropic 的 Claude Code 称作「警钟」。
OpenAI 已下线科研工作空间 Prism。4 月 20 日有用户在 X 上反馈无法再打开该产品。其中一位用 Prism 合作写论文的用户表示,关停前没有收到导出文件的提醒,目前只能把最后一次生成的 PDF 用 Codex 转回 LaTeX 源码。
Prism 是 OpenAI 今年 1 月 27 日发布的免费科研工作空间,基于 GPT-5.2,与 LaTeX 深度集成,支持多人协作写论文,脱胎于 OpenAI 去年收购的云 LaTeX 平台 Crixet。
Prism 的消失是 OpenAI 近期收缩非核心业务的一部分。4 月 17 日 OpenAI for Science 部门被拆分并入其他研究团队,负责人 Kevin Weil 离职;3 月 24 日,Sora 作为独立产品关停。更早在 3 月 16 日,OpenAI 应用业务 CEO Fidji Simo 在全员会上称公司「不能因 side quests 分心」,要把重心放到面向企业和编码工具上,并把 Anthropic 的 Claude Code 称作「警钟」。
月之暗面开源Kimi K2.6,多项编程基准反超闭源旗舰
月之暗面开源新一代旗舰 Kimi K2.6,同步在 Kimi.com 网页、Kimi App、开放平台 API 和自研编程工具 Kimi Code 上线。K2.6 此前一个月只在 Kimi Code 内部以 code-preview 名义给 Beta 用户试用,今天首次把完整模型对外开源并开放 API。
官方基准表里,K2.6 在多项编程与代理任务上反超当前最强闭源旗舰:SWE-Bench Pro 58.6(GPT-5.4 xhigh 57.7、Claude Opus 4.6 max effort 53.4、Gemini 3.1 Pro 54.2);HLE 全集带工具 54.0,三家闭源都低于这个数;DeepSearchQA f1 92.5,同项 GPT-5.4 只有 78.6。Terminal-Bench 2.0 拿 66.7,只输给 Gemini 3.1 Pro 的 68.5;SWE-Bench Verified 80.2,与 Opus 4.6 的 80.8、Gemini 3.1 Pro 的 80.6 基本同档。开源阵营过去在这种级别的编程基准上几乎没有能和闭源前沿旗舰对位的选项。
官方博客还给了两组长程执行的实测数字。一是让 K2.6 在 Mac 本地用 Zig(一种小众系统级编程语言)重写 Qwen3.5-0.8B 推理,4000 余次工具调用、12 小时连续运行、14 轮迭代后,吞吐从大约 15 tokens/sec 提升到 193 tokens/sec,比 LM Studio 快约 20%。二是接管一个 8 年历史的开源撮合引擎 exchange-core,跑完 13 小时、过千次工具调用、修改 4000 多行代码,并重配核心线程拓扑(4ME+2RE 改为 2ME+1RE),吞吐提高 185%。这两个数字都是官方自测,暂无独立复现。
K2.6 同步升级的 Agent Swarm 可同时运行 300 个子代理、最多 4000 步,前代 K2.5 的上限是 100 个、1500 步。月之暗面自家 RL 基础设施团队已经用 K2.6 跑了一个 5 天自主值班的运维代理,官方放出了这份工作日志的节选。
信源:https://www.kimi.com/blog/kimi-k2-6
月之暗面开源新一代旗舰 Kimi K2.6,同步在 Kimi.com 网页、Kimi App、开放平台 API 和自研编程工具 Kimi Code 上线。K2.6 此前一个月只在 Kimi Code 内部以 code-preview 名义给 Beta 用户试用,今天首次把完整模型对外开源并开放 API。
官方基准表里,K2.6 在多项编程与代理任务上反超当前最强闭源旗舰:SWE-Bench Pro 58.6(GPT-5.4 xhigh 57.7、Claude Opus 4.6 max effort 53.4、Gemini 3.1 Pro 54.2);HLE 全集带工具 54.0,三家闭源都低于这个数;DeepSearchQA f1 92.5,同项 GPT-5.4 只有 78.6。Terminal-Bench 2.0 拿 66.7,只输给 Gemini 3.1 Pro 的 68.5;SWE-Bench Verified 80.2,与 Opus 4.6 的 80.8、Gemini 3.1 Pro 的 80.6 基本同档。开源阵营过去在这种级别的编程基准上几乎没有能和闭源前沿旗舰对位的选项。
官方博客还给了两组长程执行的实测数字。一是让 K2.6 在 Mac 本地用 Zig(一种小众系统级编程语言)重写 Qwen3.5-0.8B 推理,4000 余次工具调用、12 小时连续运行、14 轮迭代后,吞吐从大约 15 tokens/sec 提升到 193 tokens/sec,比 LM Studio 快约 20%。二是接管一个 8 年历史的开源撮合引擎 exchange-core,跑完 13 小时、过千次工具调用、修改 4000 多行代码,并重配核心线程拓扑(4ME+2RE 改为 2ME+1RE),吞吐提高 185%。这两个数字都是官方自测,暂无独立复现。
K2.6 同步升级的 Agent Swarm 可同时运行 300 个子代理、最多 4000 步,前代 K2.5 的上限是 100 个、1500 步。月之暗面自家 RL 基础设施团队已经用 K2.6 跑了一个 5 天自主值班的运维代理,官方放出了这份工作日志的节选。
信源:https://www.kimi.com/blog/kimi-k2-6
Kimi
Kimi K2.6 Tech Blog: Advancing Open-Source Coding
Kimi K2.6 advances open-source coding, featuring long-horizon coding, coding-driven design, agent swarms, proactive agents, and the Claw Groups research preview.
Anthropic与AWS签十年合约,1000亿美元换5GW算力
Anthropic 与 Amazon 宣布扩展合作,未来十年向 AWS 技术投入超过 1000 亿美元,锁定最多 5 吉瓦(GW)新增算力用于训练和运行 Claude。这份承诺覆盖 Graviton CPU 和 Trainium2 到 Trainium4 系列 AI 芯片,合约里还保留了后续几代 Amazon 自研芯片的采购选项。Amazon 同步再注资 50 亿美元给 Anthropic,未来最多再追加 200 亿美元;加上此前已投入的 80 亿美元,两家目前累计投资 130 亿美元、最高可达 330 亿美元。
算力节奏上,Anthropic 披露了两个关键时间点。第一批 Trainium2 产能将在 2026 年上半年上线,到 2026 年底 Trainium2 加 Trainium3 合计接近 1 GW 产能就位,剩余容量后续陆续交付。公司自述目前已在用超过 100 万颗 Trainium2 训练和服务 Claude,承载主力是与 Amazon 合建的 Project Rainier 集群。Anthropic 也透露现在已有超过 10 万家客户在 Amazon Bedrock 上调用 Claude。
协议同步把 Claude Platform 直接搬进 AWS:同一个 AWS 账号、同一套权限控制和账单,不需要再单独签 Anthropic 的合同或申请独立凭证。Claude 也因此仍是唯一同时上架三大云(AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure Foundry)的前沿模型。
同时披露的还有收入数据:Anthropic 的年化收入(run-rate revenue,按最近一段时间收入外推到全年的口径)已超过 300 亿美元,2025 年底这个数字还约为 90 亿美元。Dario Amodei 在官宣里直接承认,消费级产品增长让免费版、Pro、Max 和 Team 用户在高峰时段出现可靠性和性能下滑,新增算力首先要消化这部分需求。这也是 Anthropic 近期第二次官宣算力扩容,此前刚与 Google 和 Broadcom 签了另一笔算力合作协议。
信源:https://www.anthropic.com/news/anthropic-amazon-compute
Anthropic 与 Amazon 宣布扩展合作,未来十年向 AWS 技术投入超过 1000 亿美元,锁定最多 5 吉瓦(GW)新增算力用于训练和运行 Claude。这份承诺覆盖 Graviton CPU 和 Trainium2 到 Trainium4 系列 AI 芯片,合约里还保留了后续几代 Amazon 自研芯片的采购选项。Amazon 同步再注资 50 亿美元给 Anthropic,未来最多再追加 200 亿美元;加上此前已投入的 80 亿美元,两家目前累计投资 130 亿美元、最高可达 330 亿美元。
算力节奏上,Anthropic 披露了两个关键时间点。第一批 Trainium2 产能将在 2026 年上半年上线,到 2026 年底 Trainium2 加 Trainium3 合计接近 1 GW 产能就位,剩余容量后续陆续交付。公司自述目前已在用超过 100 万颗 Trainium2 训练和服务 Claude,承载主力是与 Amazon 合建的 Project Rainier 集群。Anthropic 也透露现在已有超过 10 万家客户在 Amazon Bedrock 上调用 Claude。
协议同步把 Claude Platform 直接搬进 AWS:同一个 AWS 账号、同一套权限控制和账单,不需要再单独签 Anthropic 的合同或申请独立凭证。Claude 也因此仍是唯一同时上架三大云(AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure Foundry)的前沿模型。
同时披露的还有收入数据:Anthropic 的年化收入(run-rate revenue,按最近一段时间收入外推到全年的口径)已超过 300 亿美元,2025 年底这个数字还约为 90 亿美元。Dario Amodei 在官宣里直接承认,消费级产品增长让免费版、Pro、Max 和 Team 用户在高峰时段出现可靠性和性能下滑,新增算力首先要消化这部分需求。这也是 Anthropic 近期第二次官宣算力扩容,此前刚与 Google 和 Broadcom 签了另一笔算力合作协议。
信源:https://www.anthropic.com/news/anthropic-amazon-compute
Anthropic
Anthropic and Amazon expand collaboration for up to 5 gigawatts of new compute
Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.
Google AI Pro 和 Ultra 订阅接入 AI Studio,原型阶段可绕开 API 计费
Google 宣布,Google AI Pro 和 Ultra 订阅者从 4 月 20 日起在 Google AI Studio 里自动获得更高的使用额度,并可调用 Nano Banana Pro 图像模型和 Gemini Pro 语言模型。
AI Studio 是 Google 面向开发者的 Gemini 试验场,本身免费但额度有限。过去想超出免费额度,唯一办法是启用按请求计费的 Gemini API key,需要单独配好账单和预算。这次改动直接把消费级订阅接入了开发者工具。已经订 AI Pro($19.99/月)或 Ultra($249.99/月)的人不必再单独开 API key,就能在 AI Studio 里跑更多 prompt、出更多图。
Google 把这个选项定位为从免费额度到 API 计费之间的过渡方案,适合想试手 vibe coding 或做原型的开发者;真要上线生产,官方仍推荐切换到 API 模式,AI Studio 内可直接迁移。
信源:https://blog.google/innovation-and-ai/technology/
Google 宣布,Google AI Pro 和 Ultra 订阅者从 4 月 20 日起在 Google AI Studio 里自动获得更高的使用额度,并可调用 Nano Banana Pro 图像模型和 Gemini Pro 语言模型。
AI Studio 是 Google 面向开发者的 Gemini 试验场,本身免费但额度有限。过去想超出免费额度,唯一办法是启用按请求计费的 Gemini API key,需要单独配好账单和预算。这次改动直接把消费级订阅接入了开发者工具。已经订 AI Pro($19.99/月)或 Ultra($249.99/月)的人不必再单独开 API key,就能在 AI Studio 里跑更多 prompt、出更多图。
Google 把这个选项定位为从免费额度到 API 计费之间的过渡方案,适合想试手 vibe coding 或做原型的开发者;真要上线生产,官方仍推荐切换到 API 模式,AI Studio 内可直接迁移。
信源:https://blog.google/innovation-and-ai/technology/
blog.google
Technology
Read the latest updates about Google technology across products, from AI to security.
谷歌DeepMind组建编码突击队追赶Anthropic,布林亲自督战
《The Information》援引三位知情人士称,谷歌 DeepMind 已组建一支由研究员和工程师构成的突击队,专门提升自家编码模型的能力。突击队由 DeepMind 研究工程师 Sebastian Borgeaud 领衔,他此前负责 DeepMind 的预训练工作;联合创始人 Sergey Brin 和 DeepMind 首席技术官 Koray Kavukcuoglu 都直接参与。
组队的直接触发点是 Anthropic 近期的模型发布。DeepMind 内部研究员认为,Anthropic 的编码工具已经超过 Gemini 的代码生成能力。Brin 在最近一份备忘录里写道,团队必须「紧迫地补上代理执行能力上的差距,把模型变成写代码的主力开发者」,以赢下最后这一段冲刺。代理指能处理多步骤任务的 AI。
差距有具体数字。Anthropic 的 Claude Code 负责人 Boris Cherny 在 1 月称,公司「几乎 100%」的代码由 AI 写成;谷歌 CFO Anat Ashkenazi 在 2 月财报会上说,编码代理在谷歌内部只承担约 50% 的代码工作。
突击队主攻长周期编码任务,比如从零写一个新软件,这类任务要求模型通读多个文件、理解用户意图,是目前 AI 编码工具最吃力的环节。训练语料也在调整:谷歌开始用自己的私有代码库训练模型,因为内部代码和公开代码差异很大,通用编码模型在内部项目上表现不够好。这类内训模型不能对外发布,但可以反过来帮助迭代能公开的版本。
内部推广层面,谷歌设了一个名叫 Jetski 的内部编码工具使用排行榜;DeepMind 之外的一些团队开始组织强制性 AI 培训。Brin 在备忘录里要求,每位 Gemini 工程师在做复杂多步任务时必须使用内部代理。
更长远的目标是 Brin 口中的「AI 起飞」,即能自我改进的 AI。他多次告诉员工,提升编码能力是通往这一步的关键;配合能做数学、跑实验的 AI,理论上可以大规模自动化 AI 研究员和工程师的工作。OpenAI 已经有类似的内部工具,帮研究员更快生成实验代码。
信源:https://www.theinformation.com/articles/google-creates-strike-team-improve-coding-models
《The Information》援引三位知情人士称,谷歌 DeepMind 已组建一支由研究员和工程师构成的突击队,专门提升自家编码模型的能力。突击队由 DeepMind 研究工程师 Sebastian Borgeaud 领衔,他此前负责 DeepMind 的预训练工作;联合创始人 Sergey Brin 和 DeepMind 首席技术官 Koray Kavukcuoglu 都直接参与。
组队的直接触发点是 Anthropic 近期的模型发布。DeepMind 内部研究员认为,Anthropic 的编码工具已经超过 Gemini 的代码生成能力。Brin 在最近一份备忘录里写道,团队必须「紧迫地补上代理执行能力上的差距,把模型变成写代码的主力开发者」,以赢下最后这一段冲刺。代理指能处理多步骤任务的 AI。
差距有具体数字。Anthropic 的 Claude Code 负责人 Boris Cherny 在 1 月称,公司「几乎 100%」的代码由 AI 写成;谷歌 CFO Anat Ashkenazi 在 2 月财报会上说,编码代理在谷歌内部只承担约 50% 的代码工作。
突击队主攻长周期编码任务,比如从零写一个新软件,这类任务要求模型通读多个文件、理解用户意图,是目前 AI 编码工具最吃力的环节。训练语料也在调整:谷歌开始用自己的私有代码库训练模型,因为内部代码和公开代码差异很大,通用编码模型在内部项目上表现不够好。这类内训模型不能对外发布,但可以反过来帮助迭代能公开的版本。
内部推广层面,谷歌设了一个名叫 Jetski 的内部编码工具使用排行榜;DeepMind 之外的一些团队开始组织强制性 AI 培训。Brin 在备忘录里要求,每位 Gemini 工程师在做复杂多步任务时必须使用内部代理。
更长远的目标是 Brin 口中的「AI 起飞」,即能自我改进的 AI。他多次告诉员工,提升编码能力是通往这一步的关键;配合能做数学、跑实验的 AI,理论上可以大规模自动化 AI 研究员和工程师的工作。OpenAI 已经有类似的内部工具,帮研究员更快生成实验代码。
信源:https://www.theinformation.com/articles/google-creates-strike-team-improve-coding-models
The Information
Google Creates Strike Team to Improve Coding Models
Google has assembled a strike team of researchers and engineers to improve its AI coding models, according to three people with direct knowledge of the situation, as it looks to automate more of its own coding and ultimately its AI research. The push was…
OpenAI 测试新一代图像模型 gpt-image-2,主攻复杂图表和真实感
OpenAI 即将发布的新一代图像生成模型已在 ChatGPT 部分用户里测试,并以代号出现在第三方榜单上,部分用户称之为 gpt-image-2。该模型预计未来几周正式发布。
知情人士提到两个关键改进。一是复杂图表能力显著提升。例如把便利贴或文字精准摆在白板特定位置,旧模型一直做不好。二是输出不再有「AI 感」,过完美的光线、磨皮般的人脸过去是公认破绽。
新模型背后是 OpenAI 的用户增长压力。ChatGPT 周活跃用户最近停在约 9.2 亿,错过了 2025 年底冲到 10 亿的目标。Sam Altman 去年底已发出公司内部「code red」,触发点是 Google 图像模型 Nano Banana 走红,改进图像生成被列为 code red 的优先事项之一。
OpenAI 希望复刻 2025 年初的「吉卜力时刻」,当时数亿用户涌入 ChatGPT 把自己和朋友的照片改成吉卜力风格。文字渲染能力提升后,图像还能更可靠地用在广告和教育图表里。这是 OpenAI 与 Anthropic 拉开差距的一个方向,后者近期靠编程模型在收入上反超了 OpenAI。
信源:https://www.theinformation.com/newsletters/ai-agenda/openai-takes-aim-google-new-image-model
OpenAI 即将发布的新一代图像生成模型已在 ChatGPT 部分用户里测试,并以代号出现在第三方榜单上,部分用户称之为 gpt-image-2。该模型预计未来几周正式发布。
知情人士提到两个关键改进。一是复杂图表能力显著提升。例如把便利贴或文字精准摆在白板特定位置,旧模型一直做不好。二是输出不再有「AI 感」,过完美的光线、磨皮般的人脸过去是公认破绽。
新模型背后是 OpenAI 的用户增长压力。ChatGPT 周活跃用户最近停在约 9.2 亿,错过了 2025 年底冲到 10 亿的目标。Sam Altman 去年底已发出公司内部「code red」,触发点是 Google 图像模型 Nano Banana 走红,改进图像生成被列为 code red 的优先事项之一。
OpenAI 希望复刻 2025 年初的「吉卜力时刻」,当时数亿用户涌入 ChatGPT 把自己和朋友的照片改成吉卜力风格。文字渲染能力提升后,图像还能更可靠地用在广告和教育图表里。这是 OpenAI 与 Anthropic 拉开差距的一个方向,后者近期靠编程模型在收入上反超了 OpenAI。
信源:https://www.theinformation.com/newsletters/ai-agenda/openai-takes-aim-google-new-image-model
The Information
OpenAI Takes Aim at Google with New Image Model
If you’ve been on X or Reddit in recent weeks, you’ve likely seen images created by an upcoming model from OpenAI floating around. Sharp-eyed people have pointed out that the new model is potentially being tested with some ChatGPT users and on leaderboards…
OpenAI 给 Codex 上线屏幕观察记忆 Chronicle,仅限 macOS 上的 ChatGPT Pro
OpenAI 为编程代理产品 Codex 上线研究预览功能 Chronicle。开启后,macOS 上的 Codex 客户端会申请屏幕录制和辅助功能权限,持续抓取屏幕画面。后台把截图摘要成本地记忆文件,下次新会话时作为上下文调用。功能目前只面向 ChatGPT Pro 订阅用户,欧盟、英国、瑞士暂不开放。
Chronicle 针对的是 Codex 记忆系统之前的死角。过去记忆只能从对话本身生成,用户切窗口、查文档、看邮件等操作都不会留下痕迹,每次新开会话还得重讲一遍「我在做什么」。官方文档给的第一个例子:用户只输入「这个为什么失败」。Codex 会先扫最近的屏幕画面,识别出当前正在看一条 GitHub Actions 的失败记录,然后自己打开日志,定位到 MDX 文档里一个没转义的
指代不清的指令也能补全。比如「把最新的 docs 草稿同步过来,然后在 Slack 上告诉 Romain」这样的话,Chronicle 会从最近屏幕识别出是哪份 Google Doc 草稿、哪个 Romain,Codex 随后顺着完成。
截图会上传到 OpenAI 服务器生成摘要,处理完不保留,也不用于训练。但生成的记忆是未加密的 Markdown,存在
OpenAI 把开关做在了菜单栏图标里。开会或查看敏感内容前,可以随时点 Pause Chronicle 暂停。临时截图存放在 `$TMPDIR/chronicle/screen_recording/`,超过 6 小时自动清掉。
信源:https://developers.openai.com/codex/memories/chronicle
OpenAI 为编程代理产品 Codex 上线研究预览功能 Chronicle。开启后,macOS 上的 Codex 客户端会申请屏幕录制和辅助功能权限,持续抓取屏幕画面。后台把截图摘要成本地记忆文件,下次新会话时作为上下文调用。功能目前只面向 ChatGPT Pro 订阅用户,欧盟、英国、瑞士暂不开放。
Chronicle 针对的是 Codex 记忆系统之前的死角。过去记忆只能从对话本身生成,用户切窗口、查文档、看邮件等操作都不会留下痕迹,每次新开会话还得重讲一遍「我在做什么」。官方文档给的第一个例子:用户只输入「这个为什么失败」。Codex 会先扫最近的屏幕画面,识别出当前正在看一条 GitHub Actions 的失败记录,然后自己打开日志,定位到 MDX 文档里一个没转义的
> 符号。指代不清的指令也能补全。比如「把最新的 docs 草稿同步过来,然后在 Slack 上告诉 Romain」这样的话,Chronicle 会从最近屏幕识别出是哪份 Google Doc 草稿、哪个 Romain,Codex 随后顺着完成。
截图会上传到 OpenAI 服务器生成摘要,处理完不保留,也不用于训练。但生成的记忆是未加密的 Markdown,存在
~/.codex/memories_extensions/chronicle/ 下,同一台机器上其他程序也能读。屏幕里如果出现恶意指令(比如浏览到带代理指令的网页),Codex 可能跟着执行,提示注入(prompt injection)的风险比原来大。后台沙盒代理持续处理截图,还会快速消耗 Codex 的调用额度。OpenAI 把开关做在了菜单栏图标里。开会或查看敏感内容前,可以随时点 Pause Chronicle 暂停。临时截图存放在 `$TMPDIR/chronicle/screen_recording/`,超过 6 小时自动清掉。
信源:https://developers.openai.com/codex/memories/chronicle
OpenAI凌晨全线宕机4小时,ChatGPT、Codex、API平台同时不可用
北京时间 4 月 20 日 22:35 起,OpenAI 状态页开始调查一起影响 ChatGPT、Codex 和 API 平台的故障。用户普遍反映无法加载,官方将其定性为部分宕机(partial outage)。登记在案的受影响组件包含 ChatGPT 的 12 个和 Codex 的 1 个。
宕机前后持续约 4 小时 13 分钟。官方在 4 月 21 日 00:48、01:43、02:17 三度发布缓解进展,最终于 02:48 宣布全部恢复(均为北京时间,下同)。同一时间窗内,欧洲地区 ChatGPT 对话错误率另行升高,4 月 21 日 00:50 起、01:49 缓解。更早从 4 月 20 日 15:13 起,ChatGPT Business 在升级或新增座席时也出现最长一小时的异常,17:43 开始监测恢复。
主宕机恢复约 4 小时后,Codex 又在 4 月 21 日 07 时前后出现一轮短暂故障。Codex 工程负责人 Thomas Sottiaux 随后在 X 上通报,事件持续约 10 分钟。他提到修复过程中 Codex 自己也出了力,但这次最终的关键洞察还是来自人类。OpenAI 同步预告,将给受影响用户重置速率限制作为补偿。
信源:https://status.openai.com/
北京时间 4 月 20 日 22:35 起,OpenAI 状态页开始调查一起影响 ChatGPT、Codex 和 API 平台的故障。用户普遍反映无法加载,官方将其定性为部分宕机(partial outage)。登记在案的受影响组件包含 ChatGPT 的 12 个和 Codex 的 1 个。
宕机前后持续约 4 小时 13 分钟。官方在 4 月 21 日 00:48、01:43、02:17 三度发布缓解进展,最终于 02:48 宣布全部恢复(均为北京时间,下同)。同一时间窗内,欧洲地区 ChatGPT 对话错误率另行升高,4 月 21 日 00:50 起、01:49 缓解。更早从 4 月 20 日 15:13 起,ChatGPT Business 在升级或新增座席时也出现最长一小时的异常,17:43 开始监测恢复。
主宕机恢复约 4 小时后,Codex 又在 4 月 21 日 07 时前后出现一轮短暂故障。Codex 工程负责人 Thomas Sottiaux 随后在 X 上通报,事件持续约 10 分钟。他提到修复过程中 Codex 自己也出了力,但这次最终的关键洞察还是来自人类。OpenAI 同步预告,将给受影响用户重置速率限制作为补偿。
信源:https://status.openai.com/
苹果换帅,John Ternus9月1日接任CEO,Tim Cook转任执行董事长
苹果宣布 John Ternus 将在 9 月 1 日接替 Tim Cook 出任 CEO,Cook 同日转任执行董事长。董事会 4 月 17 日通过这份任命决议,Cook 会在过渡期内继续担任 CEO 直到 9 月 1 日正式交棒。
Ternus 今年 50 岁,过去是苹果硬件工程高级副总裁,2001 年以机械工程师身份入职,此后带过 iPhone、iPad、Mac、Apple Watch、AirPods 和 Vision Pro 等主要硬件产品线的工程团队。他将同步进入苹果董事会,成为公司历史上第八任 CEO。硬件工程改由 Johny Srouji 接手,职位是新设的首席硬件官(chief hardware officer)。现任非执行董事长 Arthur Levinson 改任首席独立董事。
Cook 今年 65 岁,2011 年从乔布斯手里接任 CEO。任内苹果市值翻了超过 20 倍,周一收盘报 4 万亿美元;营收也从他接班时翻了近四倍,最新财年超过 4000 亿美元。
Ternus 上任后最先要应对的是 AI 业务。苹果在 AI 上的进度比 Google、OpenAI、Anthropic 大约晚了一年:去年承诺的 Siri 升级没如期推出,12 月公司换掉原 AI 负责人,改由一位从 Google 挖来的高管接管。官方已明确新版 Siri 会接入 Google 的 Gemini 模型,计划今年内上线。除 AI 外,Trump 关税以及 AI 芯片需求暴涨带来的内存紧缺,也都将落到 Ternus 手上。
时机本身也出乎行业预期。Cook 上月还在美国 ABC 电视台节目《早安美国》上否认自己要退休;Wedbush 分析师 Dan Ives 对 CNBC 表示,多数人原以为 Cook 至少再干一年。
信源:https://www.cnbc.com/2026/04/20/apple-names-john-ternus-ceo-replacing-tim-cook-who-becomes-chairman.html
苹果宣布 John Ternus 将在 9 月 1 日接替 Tim Cook 出任 CEO,Cook 同日转任执行董事长。董事会 4 月 17 日通过这份任命决议,Cook 会在过渡期内继续担任 CEO 直到 9 月 1 日正式交棒。
Ternus 今年 50 岁,过去是苹果硬件工程高级副总裁,2001 年以机械工程师身份入职,此后带过 iPhone、iPad、Mac、Apple Watch、AirPods 和 Vision Pro 等主要硬件产品线的工程团队。他将同步进入苹果董事会,成为公司历史上第八任 CEO。硬件工程改由 Johny Srouji 接手,职位是新设的首席硬件官(chief hardware officer)。现任非执行董事长 Arthur Levinson 改任首席独立董事。
Cook 今年 65 岁,2011 年从乔布斯手里接任 CEO。任内苹果市值翻了超过 20 倍,周一收盘报 4 万亿美元;营收也从他接班时翻了近四倍,最新财年超过 4000 亿美元。
Ternus 上任后最先要应对的是 AI 业务。苹果在 AI 上的进度比 Google、OpenAI、Anthropic 大约晚了一年:去年承诺的 Siri 升级没如期推出,12 月公司换掉原 AI 负责人,改由一位从 Google 挖来的高管接管。官方已明确新版 Siri 会接入 Google 的 Gemini 模型,计划今年内上线。除 AI 外,Trump 关税以及 AI 芯片需求暴涨带来的内存紧缺,也都将落到 Ternus 手上。
时机本身也出乎行业预期。Cook 上月还在美国 ABC 电视台节目《早安美国》上否认自己要退休;Wedbush 分析师 Dan Ives 对 CNBC 表示,多数人原以为 Cook 至少再干一年。
信源:https://www.cnbc.com/2026/04/20/apple-names-john-ternus-ceo-replacing-tim-cook-who-becomes-chairman.html
CNBC
Apple taps John Ternus as CEO to replace Tim Cook, who will become chairman
Apple said on Monday that John Ternus is succeeding Tim Cook as CEO, with Cook assuming the role of executive chairman on Sept. 1.
GitHub Copilot Pro、Pro+、Student三档停收新客,Opus退出Pro计划
GitHub 4 月 20 日对个人版 Copilot 做了三项调整。一是 Pro、Pro+、Student 三档付费计划暂停新注册,只有免费的 Copilot Free 仍对外开放。二是收紧 Pro 和 Pro+ 的用量上限,Pro+ 的额度是 Pro 的 5 倍以上。三是 Claude Opus 系列不再进 Pro 计划。只有 Opus 4.7 留在 Pro+ 上,此前官方已预告 Opus 4.5 和 4.6 也会从 Pro+ 下架。
产品副总裁 Joe Binder 在官方博客把原因写得很直白。agentic 工作流改变了 Copilot 的算力需求。模型自己起子代理、并行跑长任务,一次会话的算力消耗远超原套餐结构的设计预期。他写的原话是:「现在经常几次请求花掉的成本就超过整个套餐定价」。GitHub 因此先关掉新增入口,保住老客户体验。
新规下的用量限制也做了拆解。Copilot 现在有 session(会话级)和 weekly(周级)两层上限。计量基于 token 消耗乘以模型乘数,与原来的 premium request 额度是两套独立系统。也就是说,用户 premium request 还剩不少,也可能已经撞上 token 限额。撞到周限额后,如果还有 premium request,可以改用 Auto 模型选择继续跑。要拿回模型选择权,得等周期重置或从 Pro 升 Pro+。VS Code 和 Copilot CLI 现在会在接近上限时弹窗提示。
GitHub 同时给老用户开了退款窗口。老用户如果觉得新规不合适,可在 4 月 20 日到 5 月 20 日之间联系 GitHub 支持。取消订阅后 4 月全额退还。
信源:https://github.blog/changelog/2026-04-20-changes-to-github-copilot-plans-for-individuals/
GitHub 4 月 20 日对个人版 Copilot 做了三项调整。一是 Pro、Pro+、Student 三档付费计划暂停新注册,只有免费的 Copilot Free 仍对外开放。二是收紧 Pro 和 Pro+ 的用量上限,Pro+ 的额度是 Pro 的 5 倍以上。三是 Claude Opus 系列不再进 Pro 计划。只有 Opus 4.7 留在 Pro+ 上,此前官方已预告 Opus 4.5 和 4.6 也会从 Pro+ 下架。
产品副总裁 Joe Binder 在官方博客把原因写得很直白。agentic 工作流改变了 Copilot 的算力需求。模型自己起子代理、并行跑长任务,一次会话的算力消耗远超原套餐结构的设计预期。他写的原话是:「现在经常几次请求花掉的成本就超过整个套餐定价」。GitHub 因此先关掉新增入口,保住老客户体验。
新规下的用量限制也做了拆解。Copilot 现在有 session(会话级)和 weekly(周级)两层上限。计量基于 token 消耗乘以模型乘数,与原来的 premium request 额度是两套独立系统。也就是说,用户 premium request 还剩不少,也可能已经撞上 token 限额。撞到周限额后,如果还有 premium request,可以改用 Auto 模型选择继续跑。要拿回模型选择权,得等周期重置或从 Pro 升 Pro+。VS Code 和 Copilot CLI 现在会在接近上限时弹窗提示。
GitHub 同时给老用户开了退款窗口。老用户如果觉得新规不合适,可在 4 月 20 日到 5 月 20 日之间联系 GitHub 支持。取消订阅后 4 月全额退还。
信源:https://github.blog/changelog/2026-04-20-changes-to-github-copilot-plans-for-individuals/
The GitHub Blog
Changes to GitHub Copilot plans for individuals - GitHub Changelog
As shared in our recent blog post, we’re making the following changes to Copilot plans for individuals as part of our ongoing efforts to ensure service reliability and a sustainable…
❤1
谷歌把 Gemini in Chrome 推到亚太 7 国,代理浏览功能仍只给美国付费用户
谷歌把浏览器内置助手 Gemini in Chrome 开放给澳大利亚、印度尼西亚、日本、菲律宾、新加坡、韩国、越南 7 个新市场。除日本外,其余 6 国同时覆盖桌面端和 iOS。该功能今年 1 月在美国首发,3 月扩至印度、加拿大、新西兰,这次是第三轮扩区。
Gemini in Chrome 以侧边栏形式常驻浏览器,可跨多个打开的标签页回答问题。今年早些时候加入的 Personal Intelligence 模块能接入 Gmail 和 Google Photos 的数据做个性化回答,也能调用 Calendar 安排日程、Maps 查地点、Gmail 起草并发送邮件。侧边栏里还能用 Nano Banana 2 改图。
这次扩区不覆盖 Gemini in Chrome 的代理功能(agentic)。谷歌把能替用户操作浏览器、自动完成多步任务的这部分仍留在测试阶段,只对美国 AI Pro 和 AI Ultra 两档付费订阅用户开放。7 国新增用户拿到的是问答与账号助手形态,不是能自己点按钮、自己填表单的那一版。
信源:https://x.com/Google/status/2046393908629004443
谷歌把浏览器内置助手 Gemini in Chrome 开放给澳大利亚、印度尼西亚、日本、菲律宾、新加坡、韩国、越南 7 个新市场。除日本外,其余 6 国同时覆盖桌面端和 iOS。该功能今年 1 月在美国首发,3 月扩至印度、加拿大、新西兰,这次是第三轮扩区。
Gemini in Chrome 以侧边栏形式常驻浏览器,可跨多个打开的标签页回答问题。今年早些时候加入的 Personal Intelligence 模块能接入 Gmail 和 Google Photos 的数据做个性化回答,也能调用 Calendar 安排日程、Maps 查地点、Gmail 起草并发送邮件。侧边栏里还能用 Nano Banana 2 改图。
这次扩区不覆盖 Gemini in Chrome 的代理功能(agentic)。谷歌把能替用户操作浏览器、自动完成多步任务的这部分仍留在测试阶段,只对美国 AI Pro 和 AI Ultra 两档付费订阅用户开放。7 国新增用户拿到的是问答与账号助手形态,不是能自己点按钮、自己填表单的那一版。
信源:https://x.com/Google/status/2046393908629004443
X (formerly Twitter)
Google (@Google) on X
Gemini in @GoogleChrome is expanding to more Asia-Pacific countries. 🌏
Starting today, users in Australia, Indonesia, Japan, Philippines, Singapore, South Korea, Vietnam and more can chat with their own personal browsing assistant in Chrome.
Summarize pages…
Starting today, users in Australia, Indonesia, Japan, Philippines, Singapore, South Korea, Vietnam and more can chat with their own personal browsing assistant in Chrome.
Summarize pages…