OpenAI 科研工作空间 Prism 下线,上线不到 3 个月
OpenAI 已下线科研工作空间 Prism。4 月 20 日有用户在 X 上反馈无法再打开该产品。其中一位用 Prism 合作写论文的用户表示,关停前没有收到导出文件的提醒,目前只能把最后一次生成的 PDF 用 Codex 转回 LaTeX 源码。
Prism 是 OpenAI 今年 1 月 27 日发布的免费科研工作空间,基于 GPT-5.2,与 LaTeX 深度集成,支持多人协作写论文,脱胎于 OpenAI 去年收购的云 LaTeX 平台 Crixet。
Prism 的消失是 OpenAI 近期收缩非核心业务的一部分。4 月 17 日 OpenAI for Science 部门被拆分并入其他研究团队,负责人 Kevin Weil 离职;3 月 24 日,Sora 作为独立产品关停。更早在 3 月 16 日,OpenAI 应用业务 CEO Fidji Simo 在全员会上称公司「不能因 side quests 分心」,要把重心放到面向企业和编码工具上,并把 Anthropic 的 Claude Code 称作「警钟」。
OpenAI 已下线科研工作空间 Prism。4 月 20 日有用户在 X 上反馈无法再打开该产品。其中一位用 Prism 合作写论文的用户表示,关停前没有收到导出文件的提醒,目前只能把最后一次生成的 PDF 用 Codex 转回 LaTeX 源码。
Prism 是 OpenAI 今年 1 月 27 日发布的免费科研工作空间,基于 GPT-5.2,与 LaTeX 深度集成,支持多人协作写论文,脱胎于 OpenAI 去年收购的云 LaTeX 平台 Crixet。
Prism 的消失是 OpenAI 近期收缩非核心业务的一部分。4 月 17 日 OpenAI for Science 部门被拆分并入其他研究团队,负责人 Kevin Weil 离职;3 月 24 日,Sora 作为独立产品关停。更早在 3 月 16 日,OpenAI 应用业务 CEO Fidji Simo 在全员会上称公司「不能因 side quests 分心」,要把重心放到面向企业和编码工具上,并把 Anthropic 的 Claude Code 称作「警钟」。
月之暗面开源Kimi K2.6,多项编程基准反超闭源旗舰
月之暗面开源新一代旗舰 Kimi K2.6,同步在 Kimi.com 网页、Kimi App、开放平台 API 和自研编程工具 Kimi Code 上线。K2.6 此前一个月只在 Kimi Code 内部以 code-preview 名义给 Beta 用户试用,今天首次把完整模型对外开源并开放 API。
官方基准表里,K2.6 在多项编程与代理任务上反超当前最强闭源旗舰:SWE-Bench Pro 58.6(GPT-5.4 xhigh 57.7、Claude Opus 4.6 max effort 53.4、Gemini 3.1 Pro 54.2);HLE 全集带工具 54.0,三家闭源都低于这个数;DeepSearchQA f1 92.5,同项 GPT-5.4 只有 78.6。Terminal-Bench 2.0 拿 66.7,只输给 Gemini 3.1 Pro 的 68.5;SWE-Bench Verified 80.2,与 Opus 4.6 的 80.8、Gemini 3.1 Pro 的 80.6 基本同档。开源阵营过去在这种级别的编程基准上几乎没有能和闭源前沿旗舰对位的选项。
官方博客还给了两组长程执行的实测数字。一是让 K2.6 在 Mac 本地用 Zig(一种小众系统级编程语言)重写 Qwen3.5-0.8B 推理,4000 余次工具调用、12 小时连续运行、14 轮迭代后,吞吐从大约 15 tokens/sec 提升到 193 tokens/sec,比 LM Studio 快约 20%。二是接管一个 8 年历史的开源撮合引擎 exchange-core,跑完 13 小时、过千次工具调用、修改 4000 多行代码,并重配核心线程拓扑(4ME+2RE 改为 2ME+1RE),吞吐提高 185%。这两个数字都是官方自测,暂无独立复现。
K2.6 同步升级的 Agent Swarm 可同时运行 300 个子代理、最多 4000 步,前代 K2.5 的上限是 100 个、1500 步。月之暗面自家 RL 基础设施团队已经用 K2.6 跑了一个 5 天自主值班的运维代理,官方放出了这份工作日志的节选。
信源:https://www.kimi.com/blog/kimi-k2-6
月之暗面开源新一代旗舰 Kimi K2.6,同步在 Kimi.com 网页、Kimi App、开放平台 API 和自研编程工具 Kimi Code 上线。K2.6 此前一个月只在 Kimi Code 内部以 code-preview 名义给 Beta 用户试用,今天首次把完整模型对外开源并开放 API。
官方基准表里,K2.6 在多项编程与代理任务上反超当前最强闭源旗舰:SWE-Bench Pro 58.6(GPT-5.4 xhigh 57.7、Claude Opus 4.6 max effort 53.4、Gemini 3.1 Pro 54.2);HLE 全集带工具 54.0,三家闭源都低于这个数;DeepSearchQA f1 92.5,同项 GPT-5.4 只有 78.6。Terminal-Bench 2.0 拿 66.7,只输给 Gemini 3.1 Pro 的 68.5;SWE-Bench Verified 80.2,与 Opus 4.6 的 80.8、Gemini 3.1 Pro 的 80.6 基本同档。开源阵营过去在这种级别的编程基准上几乎没有能和闭源前沿旗舰对位的选项。
官方博客还给了两组长程执行的实测数字。一是让 K2.6 在 Mac 本地用 Zig(一种小众系统级编程语言)重写 Qwen3.5-0.8B 推理,4000 余次工具调用、12 小时连续运行、14 轮迭代后,吞吐从大约 15 tokens/sec 提升到 193 tokens/sec,比 LM Studio 快约 20%。二是接管一个 8 年历史的开源撮合引擎 exchange-core,跑完 13 小时、过千次工具调用、修改 4000 多行代码,并重配核心线程拓扑(4ME+2RE 改为 2ME+1RE),吞吐提高 185%。这两个数字都是官方自测,暂无独立复现。
K2.6 同步升级的 Agent Swarm 可同时运行 300 个子代理、最多 4000 步,前代 K2.5 的上限是 100 个、1500 步。月之暗面自家 RL 基础设施团队已经用 K2.6 跑了一个 5 天自主值班的运维代理,官方放出了这份工作日志的节选。
信源:https://www.kimi.com/blog/kimi-k2-6
Kimi
Kimi K2.6 Tech Blog: Advancing Open-Source Coding
Kimi K2.6 advances open-source coding, featuring long-horizon coding, coding-driven design, agent swarms, proactive agents, and the Claw Groups research preview.
Anthropic与AWS签十年合约,1000亿美元换5GW算力
Anthropic 与 Amazon 宣布扩展合作,未来十年向 AWS 技术投入超过 1000 亿美元,锁定最多 5 吉瓦(GW)新增算力用于训练和运行 Claude。这份承诺覆盖 Graviton CPU 和 Trainium2 到 Trainium4 系列 AI 芯片,合约里还保留了后续几代 Amazon 自研芯片的采购选项。Amazon 同步再注资 50 亿美元给 Anthropic,未来最多再追加 200 亿美元;加上此前已投入的 80 亿美元,两家目前累计投资 130 亿美元、最高可达 330 亿美元。
算力节奏上,Anthropic 披露了两个关键时间点。第一批 Trainium2 产能将在 2026 年上半年上线,到 2026 年底 Trainium2 加 Trainium3 合计接近 1 GW 产能就位,剩余容量后续陆续交付。公司自述目前已在用超过 100 万颗 Trainium2 训练和服务 Claude,承载主力是与 Amazon 合建的 Project Rainier 集群。Anthropic 也透露现在已有超过 10 万家客户在 Amazon Bedrock 上调用 Claude。
协议同步把 Claude Platform 直接搬进 AWS:同一个 AWS 账号、同一套权限控制和账单,不需要再单独签 Anthropic 的合同或申请独立凭证。Claude 也因此仍是唯一同时上架三大云(AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure Foundry)的前沿模型。
同时披露的还有收入数据:Anthropic 的年化收入(run-rate revenue,按最近一段时间收入外推到全年的口径)已超过 300 亿美元,2025 年底这个数字还约为 90 亿美元。Dario Amodei 在官宣里直接承认,消费级产品增长让免费版、Pro、Max 和 Team 用户在高峰时段出现可靠性和性能下滑,新增算力首先要消化这部分需求。这也是 Anthropic 近期第二次官宣算力扩容,此前刚与 Google 和 Broadcom 签了另一笔算力合作协议。
信源:https://www.anthropic.com/news/anthropic-amazon-compute
Anthropic 与 Amazon 宣布扩展合作,未来十年向 AWS 技术投入超过 1000 亿美元,锁定最多 5 吉瓦(GW)新增算力用于训练和运行 Claude。这份承诺覆盖 Graviton CPU 和 Trainium2 到 Trainium4 系列 AI 芯片,合约里还保留了后续几代 Amazon 自研芯片的采购选项。Amazon 同步再注资 50 亿美元给 Anthropic,未来最多再追加 200 亿美元;加上此前已投入的 80 亿美元,两家目前累计投资 130 亿美元、最高可达 330 亿美元。
算力节奏上,Anthropic 披露了两个关键时间点。第一批 Trainium2 产能将在 2026 年上半年上线,到 2026 年底 Trainium2 加 Trainium3 合计接近 1 GW 产能就位,剩余容量后续陆续交付。公司自述目前已在用超过 100 万颗 Trainium2 训练和服务 Claude,承载主力是与 Amazon 合建的 Project Rainier 集群。Anthropic 也透露现在已有超过 10 万家客户在 Amazon Bedrock 上调用 Claude。
协议同步把 Claude Platform 直接搬进 AWS:同一个 AWS 账号、同一套权限控制和账单,不需要再单独签 Anthropic 的合同或申请独立凭证。Claude 也因此仍是唯一同时上架三大云(AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure Foundry)的前沿模型。
同时披露的还有收入数据:Anthropic 的年化收入(run-rate revenue,按最近一段时间收入外推到全年的口径)已超过 300 亿美元,2025 年底这个数字还约为 90 亿美元。Dario Amodei 在官宣里直接承认,消费级产品增长让免费版、Pro、Max 和 Team 用户在高峰时段出现可靠性和性能下滑,新增算力首先要消化这部分需求。这也是 Anthropic 近期第二次官宣算力扩容,此前刚与 Google 和 Broadcom 签了另一笔算力合作协议。
信源:https://www.anthropic.com/news/anthropic-amazon-compute
Anthropic
Anthropic and Amazon expand collaboration for up to 5 gigawatts of new compute
Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.
Google AI Pro 和 Ultra 订阅接入 AI Studio,原型阶段可绕开 API 计费
Google 宣布,Google AI Pro 和 Ultra 订阅者从 4 月 20 日起在 Google AI Studio 里自动获得更高的使用额度,并可调用 Nano Banana Pro 图像模型和 Gemini Pro 语言模型。
AI Studio 是 Google 面向开发者的 Gemini 试验场,本身免费但额度有限。过去想超出免费额度,唯一办法是启用按请求计费的 Gemini API key,需要单独配好账单和预算。这次改动直接把消费级订阅接入了开发者工具。已经订 AI Pro($19.99/月)或 Ultra($249.99/月)的人不必再单独开 API key,就能在 AI Studio 里跑更多 prompt、出更多图。
Google 把这个选项定位为从免费额度到 API 计费之间的过渡方案,适合想试手 vibe coding 或做原型的开发者;真要上线生产,官方仍推荐切换到 API 模式,AI Studio 内可直接迁移。
信源:https://blog.google/innovation-and-ai/technology/
Google 宣布,Google AI Pro 和 Ultra 订阅者从 4 月 20 日起在 Google AI Studio 里自动获得更高的使用额度,并可调用 Nano Banana Pro 图像模型和 Gemini Pro 语言模型。
AI Studio 是 Google 面向开发者的 Gemini 试验场,本身免费但额度有限。过去想超出免费额度,唯一办法是启用按请求计费的 Gemini API key,需要单独配好账单和预算。这次改动直接把消费级订阅接入了开发者工具。已经订 AI Pro($19.99/月)或 Ultra($249.99/月)的人不必再单独开 API key,就能在 AI Studio 里跑更多 prompt、出更多图。
Google 把这个选项定位为从免费额度到 API 计费之间的过渡方案,适合想试手 vibe coding 或做原型的开发者;真要上线生产,官方仍推荐切换到 API 模式,AI Studio 内可直接迁移。
信源:https://blog.google/innovation-and-ai/technology/
blog.google
Technology
Read the latest updates about Google technology across products, from AI to security.
谷歌DeepMind组建编码突击队追赶Anthropic,布林亲自督战
《The Information》援引三位知情人士称,谷歌 DeepMind 已组建一支由研究员和工程师构成的突击队,专门提升自家编码模型的能力。突击队由 DeepMind 研究工程师 Sebastian Borgeaud 领衔,他此前负责 DeepMind 的预训练工作;联合创始人 Sergey Brin 和 DeepMind 首席技术官 Koray Kavukcuoglu 都直接参与。
组队的直接触发点是 Anthropic 近期的模型发布。DeepMind 内部研究员认为,Anthropic 的编码工具已经超过 Gemini 的代码生成能力。Brin 在最近一份备忘录里写道,团队必须「紧迫地补上代理执行能力上的差距,把模型变成写代码的主力开发者」,以赢下最后这一段冲刺。代理指能处理多步骤任务的 AI。
差距有具体数字。Anthropic 的 Claude Code 负责人 Boris Cherny 在 1 月称,公司「几乎 100%」的代码由 AI 写成;谷歌 CFO Anat Ashkenazi 在 2 月财报会上说,编码代理在谷歌内部只承担约 50% 的代码工作。
突击队主攻长周期编码任务,比如从零写一个新软件,这类任务要求模型通读多个文件、理解用户意图,是目前 AI 编码工具最吃力的环节。训练语料也在调整:谷歌开始用自己的私有代码库训练模型,因为内部代码和公开代码差异很大,通用编码模型在内部项目上表现不够好。这类内训模型不能对外发布,但可以反过来帮助迭代能公开的版本。
内部推广层面,谷歌设了一个名叫 Jetski 的内部编码工具使用排行榜;DeepMind 之外的一些团队开始组织强制性 AI 培训。Brin 在备忘录里要求,每位 Gemini 工程师在做复杂多步任务时必须使用内部代理。
更长远的目标是 Brin 口中的「AI 起飞」,即能自我改进的 AI。他多次告诉员工,提升编码能力是通往这一步的关键;配合能做数学、跑实验的 AI,理论上可以大规模自动化 AI 研究员和工程师的工作。OpenAI 已经有类似的内部工具,帮研究员更快生成实验代码。
信源:https://www.theinformation.com/articles/google-creates-strike-team-improve-coding-models
《The Information》援引三位知情人士称,谷歌 DeepMind 已组建一支由研究员和工程师构成的突击队,专门提升自家编码模型的能力。突击队由 DeepMind 研究工程师 Sebastian Borgeaud 领衔,他此前负责 DeepMind 的预训练工作;联合创始人 Sergey Brin 和 DeepMind 首席技术官 Koray Kavukcuoglu 都直接参与。
组队的直接触发点是 Anthropic 近期的模型发布。DeepMind 内部研究员认为,Anthropic 的编码工具已经超过 Gemini 的代码生成能力。Brin 在最近一份备忘录里写道,团队必须「紧迫地补上代理执行能力上的差距,把模型变成写代码的主力开发者」,以赢下最后这一段冲刺。代理指能处理多步骤任务的 AI。
差距有具体数字。Anthropic 的 Claude Code 负责人 Boris Cherny 在 1 月称,公司「几乎 100%」的代码由 AI 写成;谷歌 CFO Anat Ashkenazi 在 2 月财报会上说,编码代理在谷歌内部只承担约 50% 的代码工作。
突击队主攻长周期编码任务,比如从零写一个新软件,这类任务要求模型通读多个文件、理解用户意图,是目前 AI 编码工具最吃力的环节。训练语料也在调整:谷歌开始用自己的私有代码库训练模型,因为内部代码和公开代码差异很大,通用编码模型在内部项目上表现不够好。这类内训模型不能对外发布,但可以反过来帮助迭代能公开的版本。
内部推广层面,谷歌设了一个名叫 Jetski 的内部编码工具使用排行榜;DeepMind 之外的一些团队开始组织强制性 AI 培训。Brin 在备忘录里要求,每位 Gemini 工程师在做复杂多步任务时必须使用内部代理。
更长远的目标是 Brin 口中的「AI 起飞」,即能自我改进的 AI。他多次告诉员工,提升编码能力是通往这一步的关键;配合能做数学、跑实验的 AI,理论上可以大规模自动化 AI 研究员和工程师的工作。OpenAI 已经有类似的内部工具,帮研究员更快生成实验代码。
信源:https://www.theinformation.com/articles/google-creates-strike-team-improve-coding-models
The Information
Google Creates Strike Team to Improve Coding Models
Google has assembled a strike team of researchers and engineers to improve its AI coding models, according to three people with direct knowledge of the situation, as it looks to automate more of its own coding and ultimately its AI research. The push was…
OpenAI 测试新一代图像模型 gpt-image-2,主攻复杂图表和真实感
OpenAI 即将发布的新一代图像生成模型已在 ChatGPT 部分用户里测试,并以代号出现在第三方榜单上,部分用户称之为 gpt-image-2。该模型预计未来几周正式发布。
知情人士提到两个关键改进。一是复杂图表能力显著提升。例如把便利贴或文字精准摆在白板特定位置,旧模型一直做不好。二是输出不再有「AI 感」,过完美的光线、磨皮般的人脸过去是公认破绽。
新模型背后是 OpenAI 的用户增长压力。ChatGPT 周活跃用户最近停在约 9.2 亿,错过了 2025 年底冲到 10 亿的目标。Sam Altman 去年底已发出公司内部「code red」,触发点是 Google 图像模型 Nano Banana 走红,改进图像生成被列为 code red 的优先事项之一。
OpenAI 希望复刻 2025 年初的「吉卜力时刻」,当时数亿用户涌入 ChatGPT 把自己和朋友的照片改成吉卜力风格。文字渲染能力提升后,图像还能更可靠地用在广告和教育图表里。这是 OpenAI 与 Anthropic 拉开差距的一个方向,后者近期靠编程模型在收入上反超了 OpenAI。
信源:https://www.theinformation.com/newsletters/ai-agenda/openai-takes-aim-google-new-image-model
OpenAI 即将发布的新一代图像生成模型已在 ChatGPT 部分用户里测试,并以代号出现在第三方榜单上,部分用户称之为 gpt-image-2。该模型预计未来几周正式发布。
知情人士提到两个关键改进。一是复杂图表能力显著提升。例如把便利贴或文字精准摆在白板特定位置,旧模型一直做不好。二是输出不再有「AI 感」,过完美的光线、磨皮般的人脸过去是公认破绽。
新模型背后是 OpenAI 的用户增长压力。ChatGPT 周活跃用户最近停在约 9.2 亿,错过了 2025 年底冲到 10 亿的目标。Sam Altman 去年底已发出公司内部「code red」,触发点是 Google 图像模型 Nano Banana 走红,改进图像生成被列为 code red 的优先事项之一。
OpenAI 希望复刻 2025 年初的「吉卜力时刻」,当时数亿用户涌入 ChatGPT 把自己和朋友的照片改成吉卜力风格。文字渲染能力提升后,图像还能更可靠地用在广告和教育图表里。这是 OpenAI 与 Anthropic 拉开差距的一个方向,后者近期靠编程模型在收入上反超了 OpenAI。
信源:https://www.theinformation.com/newsletters/ai-agenda/openai-takes-aim-google-new-image-model
The Information
OpenAI Takes Aim at Google with New Image Model
If you’ve been on X or Reddit in recent weeks, you’ve likely seen images created by an upcoming model from OpenAI floating around. Sharp-eyed people have pointed out that the new model is potentially being tested with some ChatGPT users and on leaderboards…
OpenAI 给 Codex 上线屏幕观察记忆 Chronicle,仅限 macOS 上的 ChatGPT Pro
OpenAI 为编程代理产品 Codex 上线研究预览功能 Chronicle。开启后,macOS 上的 Codex 客户端会申请屏幕录制和辅助功能权限,持续抓取屏幕画面。后台把截图摘要成本地记忆文件,下次新会话时作为上下文调用。功能目前只面向 ChatGPT Pro 订阅用户,欧盟、英国、瑞士暂不开放。
Chronicle 针对的是 Codex 记忆系统之前的死角。过去记忆只能从对话本身生成,用户切窗口、查文档、看邮件等操作都不会留下痕迹,每次新开会话还得重讲一遍「我在做什么」。官方文档给的第一个例子:用户只输入「这个为什么失败」。Codex 会先扫最近的屏幕画面,识别出当前正在看一条 GitHub Actions 的失败记录,然后自己打开日志,定位到 MDX 文档里一个没转义的
指代不清的指令也能补全。比如「把最新的 docs 草稿同步过来,然后在 Slack 上告诉 Romain」这样的话,Chronicle 会从最近屏幕识别出是哪份 Google Doc 草稿、哪个 Romain,Codex 随后顺着完成。
截图会上传到 OpenAI 服务器生成摘要,处理完不保留,也不用于训练。但生成的记忆是未加密的 Markdown,存在
OpenAI 把开关做在了菜单栏图标里。开会或查看敏感内容前,可以随时点 Pause Chronicle 暂停。临时截图存放在 `$TMPDIR/chronicle/screen_recording/`,超过 6 小时自动清掉。
信源:https://developers.openai.com/codex/memories/chronicle
OpenAI 为编程代理产品 Codex 上线研究预览功能 Chronicle。开启后,macOS 上的 Codex 客户端会申请屏幕录制和辅助功能权限,持续抓取屏幕画面。后台把截图摘要成本地记忆文件,下次新会话时作为上下文调用。功能目前只面向 ChatGPT Pro 订阅用户,欧盟、英国、瑞士暂不开放。
Chronicle 针对的是 Codex 记忆系统之前的死角。过去记忆只能从对话本身生成,用户切窗口、查文档、看邮件等操作都不会留下痕迹,每次新开会话还得重讲一遍「我在做什么」。官方文档给的第一个例子:用户只输入「这个为什么失败」。Codex 会先扫最近的屏幕画面,识别出当前正在看一条 GitHub Actions 的失败记录,然后自己打开日志,定位到 MDX 文档里一个没转义的
> 符号。指代不清的指令也能补全。比如「把最新的 docs 草稿同步过来,然后在 Slack 上告诉 Romain」这样的话,Chronicle 会从最近屏幕识别出是哪份 Google Doc 草稿、哪个 Romain,Codex 随后顺着完成。
截图会上传到 OpenAI 服务器生成摘要,处理完不保留,也不用于训练。但生成的记忆是未加密的 Markdown,存在
~/.codex/memories_extensions/chronicle/ 下,同一台机器上其他程序也能读。屏幕里如果出现恶意指令(比如浏览到带代理指令的网页),Codex 可能跟着执行,提示注入(prompt injection)的风险比原来大。后台沙盒代理持续处理截图,还会快速消耗 Codex 的调用额度。OpenAI 把开关做在了菜单栏图标里。开会或查看敏感内容前,可以随时点 Pause Chronicle 暂停。临时截图存放在 `$TMPDIR/chronicle/screen_recording/`,超过 6 小时自动清掉。
信源:https://developers.openai.com/codex/memories/chronicle
OpenAI凌晨全线宕机4小时,ChatGPT、Codex、API平台同时不可用
北京时间 4 月 20 日 22:35 起,OpenAI 状态页开始调查一起影响 ChatGPT、Codex 和 API 平台的故障。用户普遍反映无法加载,官方将其定性为部分宕机(partial outage)。登记在案的受影响组件包含 ChatGPT 的 12 个和 Codex 的 1 个。
宕机前后持续约 4 小时 13 分钟。官方在 4 月 21 日 00:48、01:43、02:17 三度发布缓解进展,最终于 02:48 宣布全部恢复(均为北京时间,下同)。同一时间窗内,欧洲地区 ChatGPT 对话错误率另行升高,4 月 21 日 00:50 起、01:49 缓解。更早从 4 月 20 日 15:13 起,ChatGPT Business 在升级或新增座席时也出现最长一小时的异常,17:43 开始监测恢复。
主宕机恢复约 4 小时后,Codex 又在 4 月 21 日 07 时前后出现一轮短暂故障。Codex 工程负责人 Thomas Sottiaux 随后在 X 上通报,事件持续约 10 分钟。他提到修复过程中 Codex 自己也出了力,但这次最终的关键洞察还是来自人类。OpenAI 同步预告,将给受影响用户重置速率限制作为补偿。
信源:https://status.openai.com/
北京时间 4 月 20 日 22:35 起,OpenAI 状态页开始调查一起影响 ChatGPT、Codex 和 API 平台的故障。用户普遍反映无法加载,官方将其定性为部分宕机(partial outage)。登记在案的受影响组件包含 ChatGPT 的 12 个和 Codex 的 1 个。
宕机前后持续约 4 小时 13 分钟。官方在 4 月 21 日 00:48、01:43、02:17 三度发布缓解进展,最终于 02:48 宣布全部恢复(均为北京时间,下同)。同一时间窗内,欧洲地区 ChatGPT 对话错误率另行升高,4 月 21 日 00:50 起、01:49 缓解。更早从 4 月 20 日 15:13 起,ChatGPT Business 在升级或新增座席时也出现最长一小时的异常,17:43 开始监测恢复。
主宕机恢复约 4 小时后,Codex 又在 4 月 21 日 07 时前后出现一轮短暂故障。Codex 工程负责人 Thomas Sottiaux 随后在 X 上通报,事件持续约 10 分钟。他提到修复过程中 Codex 自己也出了力,但这次最终的关键洞察还是来自人类。OpenAI 同步预告,将给受影响用户重置速率限制作为补偿。
信源:https://status.openai.com/
苹果换帅,John Ternus9月1日接任CEO,Tim Cook转任执行董事长
苹果宣布 John Ternus 将在 9 月 1 日接替 Tim Cook 出任 CEO,Cook 同日转任执行董事长。董事会 4 月 17 日通过这份任命决议,Cook 会在过渡期内继续担任 CEO 直到 9 月 1 日正式交棒。
Ternus 今年 50 岁,过去是苹果硬件工程高级副总裁,2001 年以机械工程师身份入职,此后带过 iPhone、iPad、Mac、Apple Watch、AirPods 和 Vision Pro 等主要硬件产品线的工程团队。他将同步进入苹果董事会,成为公司历史上第八任 CEO。硬件工程改由 Johny Srouji 接手,职位是新设的首席硬件官(chief hardware officer)。现任非执行董事长 Arthur Levinson 改任首席独立董事。
Cook 今年 65 岁,2011 年从乔布斯手里接任 CEO。任内苹果市值翻了超过 20 倍,周一收盘报 4 万亿美元;营收也从他接班时翻了近四倍,最新财年超过 4000 亿美元。
Ternus 上任后最先要应对的是 AI 业务。苹果在 AI 上的进度比 Google、OpenAI、Anthropic 大约晚了一年:去年承诺的 Siri 升级没如期推出,12 月公司换掉原 AI 负责人,改由一位从 Google 挖来的高管接管。官方已明确新版 Siri 会接入 Google 的 Gemini 模型,计划今年内上线。除 AI 外,Trump 关税以及 AI 芯片需求暴涨带来的内存紧缺,也都将落到 Ternus 手上。
时机本身也出乎行业预期。Cook 上月还在美国 ABC 电视台节目《早安美国》上否认自己要退休;Wedbush 分析师 Dan Ives 对 CNBC 表示,多数人原以为 Cook 至少再干一年。
信源:https://www.cnbc.com/2026/04/20/apple-names-john-ternus-ceo-replacing-tim-cook-who-becomes-chairman.html
苹果宣布 John Ternus 将在 9 月 1 日接替 Tim Cook 出任 CEO,Cook 同日转任执行董事长。董事会 4 月 17 日通过这份任命决议,Cook 会在过渡期内继续担任 CEO 直到 9 月 1 日正式交棒。
Ternus 今年 50 岁,过去是苹果硬件工程高级副总裁,2001 年以机械工程师身份入职,此后带过 iPhone、iPad、Mac、Apple Watch、AirPods 和 Vision Pro 等主要硬件产品线的工程团队。他将同步进入苹果董事会,成为公司历史上第八任 CEO。硬件工程改由 Johny Srouji 接手,职位是新设的首席硬件官(chief hardware officer)。现任非执行董事长 Arthur Levinson 改任首席独立董事。
Cook 今年 65 岁,2011 年从乔布斯手里接任 CEO。任内苹果市值翻了超过 20 倍,周一收盘报 4 万亿美元;营收也从他接班时翻了近四倍,最新财年超过 4000 亿美元。
Ternus 上任后最先要应对的是 AI 业务。苹果在 AI 上的进度比 Google、OpenAI、Anthropic 大约晚了一年:去年承诺的 Siri 升级没如期推出,12 月公司换掉原 AI 负责人,改由一位从 Google 挖来的高管接管。官方已明确新版 Siri 会接入 Google 的 Gemini 模型,计划今年内上线。除 AI 外,Trump 关税以及 AI 芯片需求暴涨带来的内存紧缺,也都将落到 Ternus 手上。
时机本身也出乎行业预期。Cook 上月还在美国 ABC 电视台节目《早安美国》上否认自己要退休;Wedbush 分析师 Dan Ives 对 CNBC 表示,多数人原以为 Cook 至少再干一年。
信源:https://www.cnbc.com/2026/04/20/apple-names-john-ternus-ceo-replacing-tim-cook-who-becomes-chairman.html
CNBC
Apple taps John Ternus as CEO to replace Tim Cook, who will become chairman
Apple said on Monday that John Ternus is succeeding Tim Cook as CEO, with Cook assuming the role of executive chairman on Sept. 1.
GitHub Copilot Pro、Pro+、Student三档停收新客,Opus退出Pro计划
GitHub 4 月 20 日对个人版 Copilot 做了三项调整。一是 Pro、Pro+、Student 三档付费计划暂停新注册,只有免费的 Copilot Free 仍对外开放。二是收紧 Pro 和 Pro+ 的用量上限,Pro+ 的额度是 Pro 的 5 倍以上。三是 Claude Opus 系列不再进 Pro 计划。只有 Opus 4.7 留在 Pro+ 上,此前官方已预告 Opus 4.5 和 4.6 也会从 Pro+ 下架。
产品副总裁 Joe Binder 在官方博客把原因写得很直白。agentic 工作流改变了 Copilot 的算力需求。模型自己起子代理、并行跑长任务,一次会话的算力消耗远超原套餐结构的设计预期。他写的原话是:「现在经常几次请求花掉的成本就超过整个套餐定价」。GitHub 因此先关掉新增入口,保住老客户体验。
新规下的用量限制也做了拆解。Copilot 现在有 session(会话级)和 weekly(周级)两层上限。计量基于 token 消耗乘以模型乘数,与原来的 premium request 额度是两套独立系统。也就是说,用户 premium request 还剩不少,也可能已经撞上 token 限额。撞到周限额后,如果还有 premium request,可以改用 Auto 模型选择继续跑。要拿回模型选择权,得等周期重置或从 Pro 升 Pro+。VS Code 和 Copilot CLI 现在会在接近上限时弹窗提示。
GitHub 同时给老用户开了退款窗口。老用户如果觉得新规不合适,可在 4 月 20 日到 5 月 20 日之间联系 GitHub 支持。取消订阅后 4 月全额退还。
信源:https://github.blog/changelog/2026-04-20-changes-to-github-copilot-plans-for-individuals/
GitHub 4 月 20 日对个人版 Copilot 做了三项调整。一是 Pro、Pro+、Student 三档付费计划暂停新注册,只有免费的 Copilot Free 仍对外开放。二是收紧 Pro 和 Pro+ 的用量上限,Pro+ 的额度是 Pro 的 5 倍以上。三是 Claude Opus 系列不再进 Pro 计划。只有 Opus 4.7 留在 Pro+ 上,此前官方已预告 Opus 4.5 和 4.6 也会从 Pro+ 下架。
产品副总裁 Joe Binder 在官方博客把原因写得很直白。agentic 工作流改变了 Copilot 的算力需求。模型自己起子代理、并行跑长任务,一次会话的算力消耗远超原套餐结构的设计预期。他写的原话是:「现在经常几次请求花掉的成本就超过整个套餐定价」。GitHub 因此先关掉新增入口,保住老客户体验。
新规下的用量限制也做了拆解。Copilot 现在有 session(会话级)和 weekly(周级)两层上限。计量基于 token 消耗乘以模型乘数,与原来的 premium request 额度是两套独立系统。也就是说,用户 premium request 还剩不少,也可能已经撞上 token 限额。撞到周限额后,如果还有 premium request,可以改用 Auto 模型选择继续跑。要拿回模型选择权,得等周期重置或从 Pro 升 Pro+。VS Code 和 Copilot CLI 现在会在接近上限时弹窗提示。
GitHub 同时给老用户开了退款窗口。老用户如果觉得新规不合适,可在 4 月 20 日到 5 月 20 日之间联系 GitHub 支持。取消订阅后 4 月全额退还。
信源:https://github.blog/changelog/2026-04-20-changes-to-github-copilot-plans-for-individuals/
The GitHub Blog
Changes to GitHub Copilot plans for individuals - GitHub Changelog
As shared in our recent blog post, we’re making the following changes to Copilot plans for individuals as part of our ongoing efforts to ensure service reliability and a sustainable…
❤1
谷歌把 Gemini in Chrome 推到亚太 7 国,代理浏览功能仍只给美国付费用户
谷歌把浏览器内置助手 Gemini in Chrome 开放给澳大利亚、印度尼西亚、日本、菲律宾、新加坡、韩国、越南 7 个新市场。除日本外,其余 6 国同时覆盖桌面端和 iOS。该功能今年 1 月在美国首发,3 月扩至印度、加拿大、新西兰,这次是第三轮扩区。
Gemini in Chrome 以侧边栏形式常驻浏览器,可跨多个打开的标签页回答问题。今年早些时候加入的 Personal Intelligence 模块能接入 Gmail 和 Google Photos 的数据做个性化回答,也能调用 Calendar 安排日程、Maps 查地点、Gmail 起草并发送邮件。侧边栏里还能用 Nano Banana 2 改图。
这次扩区不覆盖 Gemini in Chrome 的代理功能(agentic)。谷歌把能替用户操作浏览器、自动完成多步任务的这部分仍留在测试阶段,只对美国 AI Pro 和 AI Ultra 两档付费订阅用户开放。7 国新增用户拿到的是问答与账号助手形态,不是能自己点按钮、自己填表单的那一版。
信源:https://x.com/Google/status/2046393908629004443
谷歌把浏览器内置助手 Gemini in Chrome 开放给澳大利亚、印度尼西亚、日本、菲律宾、新加坡、韩国、越南 7 个新市场。除日本外,其余 6 国同时覆盖桌面端和 iOS。该功能今年 1 月在美国首发,3 月扩至印度、加拿大、新西兰,这次是第三轮扩区。
Gemini in Chrome 以侧边栏形式常驻浏览器,可跨多个打开的标签页回答问题。今年早些时候加入的 Personal Intelligence 模块能接入 Gmail 和 Google Photos 的数据做个性化回答,也能调用 Calendar 安排日程、Maps 查地点、Gmail 起草并发送邮件。侧边栏里还能用 Nano Banana 2 改图。
这次扩区不覆盖 Gemini in Chrome 的代理功能(agentic)。谷歌把能替用户操作浏览器、自动完成多步任务的这部分仍留在测试阶段,只对美国 AI Pro 和 AI Ultra 两档付费订阅用户开放。7 国新增用户拿到的是问答与账号助手形态,不是能自己点按钮、自己填表单的那一版。
信源:https://x.com/Google/status/2046393908629004443
X (formerly Twitter)
Google (@Google) on X
Gemini in @GoogleChrome is expanding to more Asia-Pacific countries. 🌏
Starting today, users in Australia, Indonesia, Japan, Philippines, Singapore, South Korea, Vietnam and more can chat with their own personal browsing assistant in Chrome.
Summarize pages…
Starting today, users in Australia, Indonesia, Japan, Philippines, Singapore, South Korea, Vietnam and more can chat with their own personal browsing assistant in Chrome.
Summarize pages…
Meta从Thinking Machines再挖两位创始成员,累计七人出走
Thinking Machines Lab(TML)是 OpenAI 前 CTO Mira Murati 去年创办的 AI 初创公司,估值 120 亿美元、完成过 20 亿美元融资,员工扩至 130 人。Business Insider 4 月 20 日独家披露,TML 又有三名员工转投 Meta:创始团队成员 Mark Jen 和 Yinghai Lu,以及研究员 Tianyi Zhang。Jen 是软件工程师,此前就在 Meta 工作过;Lu 先后待过 Meta 和 OpenAI,研究方向是 inference,直接决定聊天机器人的多步推理能不能跑起来;Zhang 不属于创始团队,署名过多篇被广泛引用的论文。三人都未在 LinkedIn 更新雇主,BI 通过两位知情人士确认此事。
算上这三人,BI 已确认至少七名 TML 创始团队成员跳到 Meta,其中包括构建并发布了 TML 旗舰产品 Tinker 的 Joshua Gross。OpenAI 也挖走了创始成员、安全工程师 Jolene Parish。
流入与流出方向正好相反。现任 CTO Soumith Chintala 是开源项目 PyTorch 的创造者,去年从 Meta 跳槽加入 TML。TML 同期还低调招入了在编程奥林匹克拿过三枚金牌的 Neal Wu。顶级研究人员仍愿意加入 TML,但创始团队里把研究做成产品的那批工程骨干被 Meta 反向挖走得最快。
信源:https://www.businessinsider.com/meta-attracts-more-thinking-machines-lab-talent-in-ai-shakeup-2026-4
Thinking Machines Lab(TML)是 OpenAI 前 CTO Mira Murati 去年创办的 AI 初创公司,估值 120 亿美元、完成过 20 亿美元融资,员工扩至 130 人。Business Insider 4 月 20 日独家披露,TML 又有三名员工转投 Meta:创始团队成员 Mark Jen 和 Yinghai Lu,以及研究员 Tianyi Zhang。Jen 是软件工程师,此前就在 Meta 工作过;Lu 先后待过 Meta 和 OpenAI,研究方向是 inference,直接决定聊天机器人的多步推理能不能跑起来;Zhang 不属于创始团队,署名过多篇被广泛引用的论文。三人都未在 LinkedIn 更新雇主,BI 通过两位知情人士确认此事。
算上这三人,BI 已确认至少七名 TML 创始团队成员跳到 Meta,其中包括构建并发布了 TML 旗舰产品 Tinker 的 Joshua Gross。OpenAI 也挖走了创始成员、安全工程师 Jolene Parish。
流入与流出方向正好相反。现任 CTO Soumith Chintala 是开源项目 PyTorch 的创造者,去年从 Meta 跳槽加入 TML。TML 同期还低调招入了在编程奥林匹克拿过三枚金牌的 Neal Wu。顶级研究人员仍愿意加入 TML,但创始团队里把研究做成产品的那批工程骨干被 Meta 反向挖走得最快。
信源:https://www.businessinsider.com/meta-attracts-more-thinking-machines-lab-talent-in-ai-shakeup-2026-4
Business Insider
Meta has now hired 7 founding members from $12 billion Thinking Machines Lab
Mira Murati's Thinking Machines Lab faces an AI talent drain to Meta, with founders and a researcher among recent departures from the startup.
Sierra 开源真实客服语音评测 μ-Bench,普通话错误率可达英语的 5 倍
客服 AI 公司 Sierra 开源多语言语音识别(ASR)评测集 μ-Bench,数据来自 250 通真实电话客服录音、4270 条人工标注语音,采样率 8kHz、单声道。过去公开的 ASR 评测要么只做英语,要么用录音棚里朗读的语料,对打算把语音 agent 接进多语言客服场景的团队几乎不可参考。μ-Bench 直接用真实通话填这个空档。
这次公开的是 Sierra 内部一整套评测的子集。内部覆盖 42 种语言、79 个地区变体和 13 家以上供应商,这次开源的是其中英语、西班牙语、土耳其语、越南语和普通话五个地区,以及 Deepgram Nova-3、Google Chirp-3、Microsoft Azure Speech、ElevenLabs Scribe v2、OpenAI GPT-4o Mini Transcribe 五家厂商的跑分。代码、数据集(挂在 Hugging Face)和一个开放榜单一并公开,欢迎其他厂商提交。
评测里真正有新信息的是指标。Sierra 提出一个新指标 UER(Utterance Error Rate,话语级错误率),把会改变原意的错误和无关紧要的错误分开算。传统的 WER(字错误率)把漏掉一声「呃」和听错一位电话号码算成同一种错,但对一个照着转写去执行动作的语音 agent,后者才会让流程出岔。Sierra 称两家 WER 相近的厂商,UER 可能差得很远,因为他们犯的错误种类就不同。
结果层面,Google Chirp-3 准确率领先但推理较慢;Deepgram Nova-3 的 p50 延迟快将近 8 倍,多语言准确率却垫底。普通话识别错误率可以达到英语的 5 倍,越南语在不同厂商间的差距也很大,这些差距只看英语基准是看不到的。
信源:https://sierra.ai/blog/mu-bench-an-open-multilingual-transcription-benchmark
客服 AI 公司 Sierra 开源多语言语音识别(ASR)评测集 μ-Bench,数据来自 250 通真实电话客服录音、4270 条人工标注语音,采样率 8kHz、单声道。过去公开的 ASR 评测要么只做英语,要么用录音棚里朗读的语料,对打算把语音 agent 接进多语言客服场景的团队几乎不可参考。μ-Bench 直接用真实通话填这个空档。
这次公开的是 Sierra 内部一整套评测的子集。内部覆盖 42 种语言、79 个地区变体和 13 家以上供应商,这次开源的是其中英语、西班牙语、土耳其语、越南语和普通话五个地区,以及 Deepgram Nova-3、Google Chirp-3、Microsoft Azure Speech、ElevenLabs Scribe v2、OpenAI GPT-4o Mini Transcribe 五家厂商的跑分。代码、数据集(挂在 Hugging Face)和一个开放榜单一并公开,欢迎其他厂商提交。
评测里真正有新信息的是指标。Sierra 提出一个新指标 UER(Utterance Error Rate,话语级错误率),把会改变原意的错误和无关紧要的错误分开算。传统的 WER(字错误率)把漏掉一声「呃」和听错一位电话号码算成同一种错,但对一个照着转写去执行动作的语音 agent,后者才会让流程出岔。Sierra 称两家 WER 相近的厂商,UER 可能差得很远,因为他们犯的错误种类就不同。
结果层面,Google Chirp-3 准确率领先但推理较慢;Deepgram Nova-3 的 p50 延迟快将近 8 倍,多语言准确率却垫底。普通话识别错误率可以达到英语的 5 倍,越南语在不同厂商间的差距也很大,这些差距只看英语基准是看不到的。
信源:https://sierra.ai/blog/mu-bench-an-open-multilingual-transcription-benchmark
Sierra
μ-Bench: an open multilingual transcription benchmark
μ-Bench is an open multilingual transcription benchmark built from customer service phone calls across five locales. It aims to measure transcription providers on the errors that matter in production: not just how closely transcripts match their reference…
贝索斯AI实验室据称接近380亿美元估值
《金融时报》援引知情人士称,杰夫·贝索斯参与运营的 AI 实验室 Project Prometheus 正接近完成新一轮融资。规模约 100 亿美元,投后估值约 380 亿美元。摩根大通和贝莱德参与了本轮融资。交易尚未最终敲定。
Project Prometheus 不是做通用聊天机器人。它主打能理解物理世界的 AI。目标是把模型用进工程、设计和制造流程。Axios 上月援引知情人士称,这家公司更想先切原型设计、材料和前期工程这类环节,不是直接用机器人替代工厂工人。
信源:https://www.ft.com/content/87ea0ced-bf3c-4822-8dda-437241570ded
《金融时报》援引知情人士称,杰夫·贝索斯参与运营的 AI 实验室 Project Prometheus 正接近完成新一轮融资。规模约 100 亿美元,投后估值约 380 亿美元。摩根大通和贝莱德参与了本轮融资。交易尚未最终敲定。
Project Prometheus 不是做通用聊天机器人。它主打能理解物理世界的 AI。目标是把模型用进工程、设计和制造流程。Axios 上月援引知情人士称,这家公司更想先切原型设计、材料和前期工程这类环节,不是直接用机器人替代工厂工人。
信源:https://www.ft.com/content/87ea0ced-bf3c-4822-8dda-437241570ded
Vercel安全事件更新:npm 包未被污染,新建环境变量默认即「敏感」
Vercel 官方账号 4 月 21 日上午宣布,称与 GitHub、Microsoft、npm、Socket 四方联合排查后,Vercel 在 npm 上发布的任何包均未被篡改,供应链「仍然安全」。Vercel 在 npm 上维护 Next.js、Turbopack、SWR 等开源库,合计每月下载量以亿次计,若被攻击者借员工账号投毒,影响会远超 Vercel 自身客户。这次核查排除了事件里最大的一项连带风险。
同日官方安全公告同步更新三处细节。受影响范围首次明确到字段级别。公告称,遭泄露的是未被标记为「敏感」的那部分客户环境变量,其在后台解密后以明文存储。是否有更多数据被带走,Vercel 仍在调查。给客户的建议里多了一条「删除 Vercel 项目或账号本身不能消除风险」。必须先轮换所有未标记为敏感的密钥,再考虑删除动作,攻击者拿到的凭证仍可直连生产系统。
产品侧改了默认值。新建环境变量现在默认即是「敏感」(sensitive: on)。老账号过去新增变量默认是普通类型,要手动勾选才启用敏感。这正是本次攻击者能读到明文变量的直接入口。Dashboard 同步上线了更密集的活动日志界面和团队级环境变量管理;所有安全建议里「启用双因素认证」被顶到最前。
信源:https://vercel.com/kb/bulletin/vercel-april-2026-security-incident
Vercel 官方账号 4 月 21 日上午宣布,称与 GitHub、Microsoft、npm、Socket 四方联合排查后,Vercel 在 npm 上发布的任何包均未被篡改,供应链「仍然安全」。Vercel 在 npm 上维护 Next.js、Turbopack、SWR 等开源库,合计每月下载量以亿次计,若被攻击者借员工账号投毒,影响会远超 Vercel 自身客户。这次核查排除了事件里最大的一项连带风险。
同日官方安全公告同步更新三处细节。受影响范围首次明确到字段级别。公告称,遭泄露的是未被标记为「敏感」的那部分客户环境变量,其在后台解密后以明文存储。是否有更多数据被带走,Vercel 仍在调查。给客户的建议里多了一条「删除 Vercel 项目或账号本身不能消除风险」。必须先轮换所有未标记为敏感的密钥,再考虑删除动作,攻击者拿到的凭证仍可直连生产系统。
产品侧改了默认值。新建环境变量现在默认即是「敏感」(sensitive: on)。老账号过去新增变量默认是普通类型,要手动勾选才启用敏感。这正是本次攻击者能读到明文变量的直接入口。Dashboard 同步上线了更密集的活动日志界面和团队级环境变量管理;所有安全建议里「启用双因素认证」被顶到最前。
信源:https://vercel.com/kb/bulletin/vercel-april-2026-security-incident
Claude Cowork 上线 Live Artifacts,仪表盘每次打开都会拉取当前数据重新渲染
Claude Cowork 现在可以生成 Live Artifacts:接到用户的应用和本地文件的仪表盘与追踪器,随时打开都会拉取一次当前数据重新渲染。每个产物自动保存到新的「Live Artifacts」标签页并带版本历史,换设备或在另一段对话里也能从原位置接着用。所有付费档可用。
信源:https://x.com/claudeai/status/2046328619249684989
Claude Cowork 现在可以生成 Live Artifacts:接到用户的应用和本地文件的仪表盘与追踪器,随时打开都会拉取一次当前数据重新渲染。每个产物自动保存到新的「Live Artifacts」标签页并带版本历史,换设备或在另一段对话里也能从原位置接着用。所有付费档可用。
信源:https://x.com/claudeai/status/2046328619249684989
腾讯 QClaw 海外版开启内测,通过 WhatsApp、Telegram 调用本地 Agent
QClaw 海外版开启内测,官网为 qclawsg.qq.com。首批上线美国、加拿大、新加坡、韩国,支持中、英、法、西、韩等多语言。内测期间每日赠送 4000 万 token,官方称价值约 700 美元。同时开放 20000 个「创始龙虾(Founding Claw)」名额,先到先得。
腾讯披露,海外版基于国内版 80 多项功能迭代,5 天完成开发,约 99% 的代码由 QClaw 自己写。所有数据在用户设备上本地处理;国内版已跑通的「龙虾管家(The Gateway)」安全模块同步移植到海外版,对 prompt、skills、执行脚本做实时拦截。海外版另开放 QClaw Playground(专家广场),预置健身教练、金融顾问、语言教师等角色,用户点选即用,不必从零写指令。
信源:https://mp.weixin.qq.com/s/c_H4s_0WMmyutfrwkaWhcw
QClaw 海外版开启内测,官网为 qclawsg.qq.com。首批上线美国、加拿大、新加坡、韩国,支持中、英、法、西、韩等多语言。内测期间每日赠送 4000 万 token,官方称价值约 700 美元。同时开放 20000 个「创始龙虾(Founding Claw)」名额,先到先得。
腾讯披露,海外版基于国内版 80 多项功能迭代,5 天完成开发,约 99% 的代码由 QClaw 自己写。所有数据在用户设备上本地处理;国内版已跑通的「龙虾管家(The Gateway)」安全模块同步移植到海外版,对 prompt、skills、执行脚本做实时拦截。海外版另开放 QClaw Playground(专家广场),预置健身教练、金融顾问、语言教师等角色,用户点选即用,不必从零写指令。
信源:https://mp.weixin.qq.com/s/c_H4s_0WMmyutfrwkaWhcw
谷歌DeepMind Inception组招5人,把SIMA、Genie从研究原型推向游戏产品
谷歌DeepMind Inception团队总监Alexandre Moufarek在X上放出5个招聘岗位:游戏设计师、高级产品经理、QA工程师、高级软件工程师和研究工程师(Staff级),链接统一指向Google Careers。Moufarek加入DeepMind前在育碧做过《幽灵行动:未来战士》和《看门狗》两款3A游戏,之后在软银负责Pepper家用机器人的产品。进入DeepMind后,他参与过Project Astra、SIMA、Genie和Gemini四条线。
关键在Inception这个团队的定位。DeepMind把它描述成「和研究团队并肩工作的创意、设计、工程团队」,目标是探索「以前没有AI时做不出来的游戏体验」。它不是研究组,而是把研究成果做成可玩原型的产品团队。
再看岗位构成。5个里有产品经理、游戏设计师和QA工程师,这三个位置过去不会出现在纯研究团队。DeepMind之前演示过SIMA 2和Genie 3的组合:前者是2025年11月发布的基于Gemini的3D虚拟世界agent,后者是可实时生成3D世界的世界模型,DeepMind把两者接起来,让agent在新生成的世界里执行指令。但SIMA 2至今只是「有限研究预览」,只向少数学者和游戏开发者开放。这轮招聘要补的,就是把研究演示做成能交付给外部开发者的产品。
信源:https://x.com/amoufarek/status/2046370200644173831
谷歌DeepMind Inception团队总监Alexandre Moufarek在X上放出5个招聘岗位:游戏设计师、高级产品经理、QA工程师、高级软件工程师和研究工程师(Staff级),链接统一指向Google Careers。Moufarek加入DeepMind前在育碧做过《幽灵行动:未来战士》和《看门狗》两款3A游戏,之后在软银负责Pepper家用机器人的产品。进入DeepMind后,他参与过Project Astra、SIMA、Genie和Gemini四条线。
关键在Inception这个团队的定位。DeepMind把它描述成「和研究团队并肩工作的创意、设计、工程团队」,目标是探索「以前没有AI时做不出来的游戏体验」。它不是研究组,而是把研究成果做成可玩原型的产品团队。
再看岗位构成。5个里有产品经理、游戏设计师和QA工程师,这三个位置过去不会出现在纯研究团队。DeepMind之前演示过SIMA 2和Genie 3的组合:前者是2025年11月发布的基于Gemini的3D虚拟世界agent,后者是可实时生成3D世界的世界模型,DeepMind把两者接起来,让agent在新生成的世界里执行指令。但SIMA 2至今只是「有限研究预览」,只向少数学者和游戏开发者开放。这轮招聘要补的,就是把研究演示做成能交付给外部开发者的产品。
信源:https://x.com/amoufarek/status/2046370200644173831
X (formerly Twitter)
Alexandre Moufarek (@amoufarek) on X
For 15+ years, games have driven Al breakthroughs @GoogleDeepMind
I'm hiring 5 roles to partner with game developers, advance AI research and explore new gaming experiences that wouldn't be possible without AI.
Game Designer, Product Manager, QA, Research…
I'm hiring 5 roles to partner with game developers, advance AI research and explore new gaming experiences that wouldn't be possible without AI.
Game Designer, Product Manager, QA, Research…
Anthropic招募STEM驻场研究员,暑期在旧金山测Claude做科研
Anthropic 挂出「Anthropic STEM Fellow」岗位。这是一项面向 STEM 研究者的暑期驻场研究员计划。项目从 6 月 15 日到 9 月 15 日,5 月 15 日截止申请。入选者需要全职在旧金山办公室工作,补贴约为每周 3800 美元。
Anthropic 希望这些驻场研究员和内部团队一起做三类事:给 Claude 设计更不容易刷分的科研评测,看它能不能规划实验、解读数据、理解具体机制;补数据和方法,专门盯能力缺口;把科学软件接进来,让模型在真实研究流程里跑。官方举的例子包括材料科学和气候科学。
岗位简介把目标写成「AI scientist」,也就是能自己推进科研的 AI 系统。
信源:https://job-boards.greenhouse.io/anthropic/jobs/5189848008
Anthropic 挂出「Anthropic STEM Fellow」岗位。这是一项面向 STEM 研究者的暑期驻场研究员计划。项目从 6 月 15 日到 9 月 15 日,5 月 15 日截止申请。入选者需要全职在旧金山办公室工作,补贴约为每周 3800 美元。
Anthropic 希望这些驻场研究员和内部团队一起做三类事:给 Claude 设计更不容易刷分的科研评测,看它能不能规划实验、解读数据、理解具体机制;补数据和方法,专门盯能力缺口;把科学软件接进来,让模型在真实研究流程里跑。官方举的例子包括材料科学和气候科学。
岗位简介把目标写成「AI scientist」,也就是能自己推进科研的 AI 系统。
信源:https://job-boards.greenhouse.io/anthropic/jobs/5189848008
job-boards.greenhouse.io
Anthropic
阿里云百炼上线 Token Plan 团队版,最低每月 198 元/坐席订阅多家模型
阿里云百炼上线 Token Plan 团队版,面向 AI 编程工具与 Agent 工具按坐席包月。套餐分三档:标准坐席 198 元/月 25,000 Credits、高级坐席 698 元/月 100,000 Credits、尊享坐席 1,398 元/月 250,000 Credits。超出额度时可加购共享用量包,每包 5,000 元换 625,000 Credits,有效期一个月。目前仅开放华北 2(北京)地域。
一个订阅下能切换的模型来自四家厂商:文本生成支持 qwen3.6-plus、智谱 glm-5、MiniMax-M2.5、DeepSeek-V3.2;图像生成支持 qwen-image-2.0 与 wan2.7-image 系列。所有调用以 Credits 统一抵扣,不再按模型分别计费。官方示例显示,qwen3.6-plus 一次总量约 5 万 token 的请求约消耗 4 Credits。
兼容主流 AI 编程工具:OpenAI 兼容端点可接 Codex、OpenCode,Anthropic 兼容端点可接 Claude Code、OpenClaw,DeepSeek V3.2 仅走 OpenAI 协议。图像生成模型需借助各工具的 Slash Command、Skill 等扩展机制调用。
使用范围有明确限制:只能在编程工具或 OpenClaw 类 Agent 中交互式使用。Dify、n8n、Coze 等自动化平台、应用后端和批量调用都不允许,违规会被暂停订阅或封 API Key。套餐订阅人专享,禁止多人共享,不支持退款。
信源:https://help.aliyun.com/zh/model-studio/token-plan-overview
阿里云百炼上线 Token Plan 团队版,面向 AI 编程工具与 Agent 工具按坐席包月。套餐分三档:标准坐席 198 元/月 25,000 Credits、高级坐席 698 元/月 100,000 Credits、尊享坐席 1,398 元/月 250,000 Credits。超出额度时可加购共享用量包,每包 5,000 元换 625,000 Credits,有效期一个月。目前仅开放华北 2(北京)地域。
一个订阅下能切换的模型来自四家厂商:文本生成支持 qwen3.6-plus、智谱 glm-5、MiniMax-M2.5、DeepSeek-V3.2;图像生成支持 qwen-image-2.0 与 wan2.7-image 系列。所有调用以 Credits 统一抵扣,不再按模型分别计费。官方示例显示,qwen3.6-plus 一次总量约 5 万 token 的请求约消耗 4 Credits。
兼容主流 AI 编程工具:OpenAI 兼容端点可接 Codex、OpenCode,Anthropic 兼容端点可接 Claude Code、OpenClaw,DeepSeek V3.2 仅走 OpenAI 协议。图像生成模型需借助各工具的 Slash Command、Skill 等扩展机制调用。
使用范围有明确限制:只能在编程工具或 OpenClaw 类 Agent 中交互式使用。Dify、n8n、Coze 等自动化平台、应用后端和批量调用都不允许,违规会被暂停订阅或封 API Key。套餐订阅人专享,禁止多人共享,不支持退款。
信源:https://help.aliyun.com/zh/model-studio/token-plan-overview
前Stability AI创始人新公司Intelligent Internet推出Logos推理工具
前 Stability AI 创始人 Emad Mostaque 新公司 Intelligent Internet 发布 Logos,这是一套还在早期开发的推理工具。官网说,Logos 想做的,是帮人把复杂问题按最基本的规则一步步往下推,再把过程公开给人检查。公司这次先公开的是物理方向,数学、生物和经济学还没放出完整内容。
同时放出的第一份结果叫《Only One Postulate Needed》。团队拿狭义相对论做样例,声称只靠「相对性原理」这一条前提,就能推出必须存在一个固定的最高速度。实验要做的,只是测出这个速度到底是多少,不用再额外加一条「光速不变」的前提。
信源:https://ii.inc/web/blog/post/logos
前 Stability AI 创始人 Emad Mostaque 新公司 Intelligent Internet 发布 Logos,这是一套还在早期开发的推理工具。官网说,Logos 想做的,是帮人把复杂问题按最基本的规则一步步往下推,再把过程公开给人检查。公司这次先公开的是物理方向,数学、生物和经济学还没放出完整内容。
同时放出的第一份结果叫《Only One Postulate Needed》。团队拿狭义相对论做样例,声称只靠「相对性原理」这一条前提,就能推出必须存在一个固定的最高速度。实验要做的,只是测出这个速度到底是多少,不用再额外加一条「光速不变」的前提。
信源:https://ii.inc/web/blog/post/logos
ii.inc
Introducing Logos - Intelligent Internet
A First-Principles Augmented Intelligence System
We are happy to announce Logos, a first-principles augmented intelligence system.
Logos is in early development, but the results so far have been insightful across domains. Over the next few weeks we will…
We are happy to announce Logos, a first-principles augmented intelligence system.
Logos is in early development, but the results so far have been insightful across domains. Over the next few weeks we will…