动察Beating AI News
3.16K subscribers
890 photos
2 videos
1 file
3.41K links
AI新闻信息流
Download Telegram
OpenAI 给 Codex 上线屏幕观察记忆 Chronicle,仅限 macOS 上的 ChatGPT Pro

OpenAI 为编程代理产品 Codex 上线研究预览功能 Chronicle。开启后,macOS 上的 Codex 客户端会申请屏幕录制和辅助功能权限,持续抓取屏幕画面。后台把截图摘要成本地记忆文件,下次新会话时作为上下文调用。功能目前只面向 ChatGPT Pro 订阅用户,欧盟、英国、瑞士暂不开放。

Chronicle 针对的是 Codex 记忆系统之前的死角。过去记忆只能从对话本身生成,用户切窗口、查文档、看邮件等操作都不会留下痕迹,每次新开会话还得重讲一遍「我在做什么」。官方文档给的第一个例子:用户只输入「这个为什么失败」。Codex 会先扫最近的屏幕画面,识别出当前正在看一条 GitHub Actions 的失败记录,然后自己打开日志,定位到 MDX 文档里一个没转义的 > 符号。

指代不清的指令也能补全。比如「把最新的 docs 草稿同步过来,然后在 Slack 上告诉 Romain」这样的话,Chronicle 会从最近屏幕识别出是哪份 Google Doc 草稿、哪个 Romain,Codex 随后顺着完成。

截图会上传到 OpenAI 服务器生成摘要,处理完不保留,也不用于训练。但生成的记忆是未加密的 Markdown,存在 ~/.codex/memories_extensions/chronicle/ 下,同一台机器上其他程序也能读。屏幕里如果出现恶意指令(比如浏览到带代理指令的网页),Codex 可能跟着执行,提示注入(prompt injection)的风险比原来大。后台沙盒代理持续处理截图,还会快速消耗 Codex 的调用额度。

OpenAI 把开关做在了菜单栏图标里。开会或查看敏感内容前,可以随时点 Pause Chronicle 暂停。临时截图存放在 `$TMPDIR/chronicle/screen_recording/`,超过 6 小时自动清掉。

信源:https://developers.openai.com/codex/memories/chronicle
OpenAI凌晨全线宕机4小时,ChatGPT、Codex、API平台同时不可用

北京时间 4 月 20 日 22:35 起,OpenAI 状态页开始调查一起影响 ChatGPT、Codex 和 API 平台的故障。用户普遍反映无法加载,官方将其定性为部分宕机(partial outage)。登记在案的受影响组件包含 ChatGPT 的 12 个和 Codex 的 1 个。

宕机前后持续约 4 小时 13 分钟。官方在 4 月 21 日 00:48、01:43、02:17 三度发布缓解进展,最终于 02:48 宣布全部恢复(均为北京时间,下同)。同一时间窗内,欧洲地区 ChatGPT 对话错误率另行升高,4 月 21 日 00:50 起、01:49 缓解。更早从 4 月 20 日 15:13 起,ChatGPT Business 在升级或新增座席时也出现最长一小时的异常,17:43 开始监测恢复。

主宕机恢复约 4 小时后,Codex 又在 4 月 21 日 07 时前后出现一轮短暂故障。Codex 工程负责人 Thomas Sottiaux 随后在 X 上通报,事件持续约 10 分钟。他提到修复过程中 Codex 自己也出了力,但这次最终的关键洞察还是来自人类。OpenAI 同步预告,将给受影响用户重置速率限制作为补偿。

信源:https://status.openai.com/
苹果换帅,John Ternus9月1日接任CEO,Tim Cook转任执行董事长

苹果宣布 John Ternus 将在 9 月 1 日接替 Tim Cook 出任 CEO,Cook 同日转任执行董事长。董事会 4 月 17 日通过这份任命决议,Cook 会在过渡期内继续担任 CEO 直到 9 月 1 日正式交棒。

Ternus 今年 50 岁,过去是苹果硬件工程高级副总裁,2001 年以机械工程师身份入职,此后带过 iPhone、iPad、Mac、Apple Watch、AirPods 和 Vision Pro 等主要硬件产品线的工程团队。他将同步进入苹果董事会,成为公司历史上第八任 CEO。硬件工程改由 Johny Srouji 接手,职位是新设的首席硬件官(chief hardware officer)。现任非执行董事长 Arthur Levinson 改任首席独立董事。

Cook 今年 65 岁,2011 年从乔布斯手里接任 CEO。任内苹果市值翻了超过 20 倍,周一收盘报 4 万亿美元;营收也从他接班时翻了近四倍,最新财年超过 4000 亿美元。

Ternus 上任后最先要应对的是 AI 业务。苹果在 AI 上的进度比 Google、OpenAI、Anthropic 大约晚了一年:去年承诺的 Siri 升级没如期推出,12 月公司换掉原 AI 负责人,改由一位从 Google 挖来的高管接管。官方已明确新版 Siri 会接入 Google 的 Gemini 模型,计划今年内上线。除 AI 外,Trump 关税以及 AI 芯片需求暴涨带来的内存紧缺,也都将落到 Ternus 手上。

时机本身也出乎行业预期。Cook 上月还在美国 ABC 电视台节目《早安美国》上否认自己要退休;Wedbush 分析师 Dan Ives 对 CNBC 表示,多数人原以为 Cook 至少再干一年。

信源:https://www.cnbc.com/2026/04/20/apple-names-john-ternus-ceo-replacing-tim-cook-who-becomes-chairman.html
GitHub Copilot Pro、Pro+、Student三档停收新客,Opus退出Pro计划

GitHub 4 月 20 日对个人版 Copilot 做了三项调整。一是 Pro、Pro+、Student 三档付费计划暂停新注册,只有免费的 Copilot Free 仍对外开放。二是收紧 Pro 和 Pro+ 的用量上限,Pro+ 的额度是 Pro 的 5 倍以上。三是 Claude Opus 系列不再进 Pro 计划。只有 Opus 4.7 留在 Pro+ 上,此前官方已预告 Opus 4.5 和 4.6 也会从 Pro+ 下架。

产品副总裁 Joe Binder 在官方博客把原因写得很直白。agentic 工作流改变了 Copilot 的算力需求。模型自己起子代理、并行跑长任务,一次会话的算力消耗远超原套餐结构的设计预期。他写的原话是:「现在经常几次请求花掉的成本就超过整个套餐定价」。GitHub 因此先关掉新增入口,保住老客户体验。

新规下的用量限制也做了拆解。Copilot 现在有 session(会话级)和 weekly(周级)两层上限。计量基于 token 消耗乘以模型乘数,与原来的 premium request 额度是两套独立系统。也就是说,用户 premium request 还剩不少,也可能已经撞上 token 限额。撞到周限额后,如果还有 premium request,可以改用 Auto 模型选择继续跑。要拿回模型选择权,得等周期重置或从 Pro 升 Pro+。VS Code 和 Copilot CLI 现在会在接近上限时弹窗提示。

GitHub 同时给老用户开了退款窗口。老用户如果觉得新规不合适,可在 4 月 20 日到 5 月 20 日之间联系 GitHub 支持。取消订阅后 4 月全额退还。

信源:https://github.blog/changelog/2026-04-20-changes-to-github-copilot-plans-for-individuals/
1
谷歌把 Gemini in Chrome 推到亚太 7 国,代理浏览功能仍只给美国付费用户

谷歌把浏览器内置助手 Gemini in Chrome 开放给澳大利亚、印度尼西亚、日本、菲律宾、新加坡、韩国、越南 7 个新市场。除日本外,其余 6 国同时覆盖桌面端和 iOS。该功能今年 1 月在美国首发,3 月扩至印度、加拿大、新西兰,这次是第三轮扩区。

Gemini in Chrome 以侧边栏形式常驻浏览器,可跨多个打开的标签页回答问题。今年早些时候加入的 Personal Intelligence 模块能接入 Gmail 和 Google Photos 的数据做个性化回答,也能调用 Calendar 安排日程、Maps 查地点、Gmail 起草并发送邮件。侧边栏里还能用 Nano Banana 2 改图。

这次扩区不覆盖 Gemini in Chrome 的代理功能(agentic)。谷歌把能替用户操作浏览器、自动完成多步任务的这部分仍留在测试阶段,只对美国 AI Pro 和 AI Ultra 两档付费订阅用户开放。7 国新增用户拿到的是问答与账号助手形态,不是能自己点按钮、自己填表单的那一版。

信源:https://x.com/Google/status/2046393908629004443
Meta从Thinking Machines再挖两位创始成员,累计七人出走

Thinking Machines Lab(TML)是 OpenAI 前 CTO Mira Murati 去年创办的 AI 初创公司,估值 120 亿美元、完成过 20 亿美元融资,员工扩至 130 人。Business Insider 4 月 20 日独家披露,TML 又有三名员工转投 Meta:创始团队成员 Mark Jen 和 Yinghai Lu,以及研究员 Tianyi Zhang。Jen 是软件工程师,此前就在 Meta 工作过;Lu 先后待过 Meta 和 OpenAI,研究方向是 inference,直接决定聊天机器人的多步推理能不能跑起来;Zhang 不属于创始团队,署名过多篇被广泛引用的论文。三人都未在 LinkedIn 更新雇主,BI 通过两位知情人士确认此事。

算上这三人,BI 已确认至少七名 TML 创始团队成员跳到 Meta,其中包括构建并发布了 TML 旗舰产品 Tinker 的 Joshua Gross。OpenAI 也挖走了创始成员、安全工程师 Jolene Parish。

流入与流出方向正好相反。现任 CTO Soumith Chintala 是开源项目 PyTorch 的创造者,去年从 Meta 跳槽加入 TML。TML 同期还低调招入了在编程奥林匹克拿过三枚金牌的 Neal Wu。顶级研究人员仍愿意加入 TML,但创始团队里把研究做成产品的那批工程骨干被 Meta 反向挖走得最快。

信源:https://www.businessinsider.com/meta-attracts-more-thinking-machines-lab-talent-in-ai-shakeup-2026-4
Sierra 开源真实客服语音评测 μ-Bench,普通话错误率可达英语的 5 倍

客服 AI 公司 Sierra 开源多语言语音识别(ASR)评测集 μ-Bench,数据来自 250 通真实电话客服录音、4270 条人工标注语音,采样率 8kHz、单声道。过去公开的 ASR 评测要么只做英语,要么用录音棚里朗读的语料,对打算把语音 agent 接进多语言客服场景的团队几乎不可参考。μ-Bench 直接用真实通话填这个空档。

这次公开的是 Sierra 内部一整套评测的子集。内部覆盖 42 种语言、79 个地区变体和 13 家以上供应商,这次开源的是其中英语、西班牙语、土耳其语、越南语和普通话五个地区,以及 Deepgram Nova-3、Google Chirp-3、Microsoft Azure Speech、ElevenLabs Scribe v2、OpenAI GPT-4o Mini Transcribe 五家厂商的跑分。代码、数据集(挂在 Hugging Face)和一个开放榜单一并公开,欢迎其他厂商提交。

评测里真正有新信息的是指标。Sierra 提出一个新指标 UER(Utterance Error Rate,话语级错误率),把会改变原意的错误和无关紧要的错误分开算。传统的 WER(字错误率)把漏掉一声「呃」和听错一位电话号码算成同一种错,但对一个照着转写去执行动作的语音 agent,后者才会让流程出岔。Sierra 称两家 WER 相近的厂商,UER 可能差得很远,因为他们犯的错误种类就不同。

结果层面,Google Chirp-3 准确率领先但推理较慢;Deepgram Nova-3 的 p50 延迟快将近 8 倍,多语言准确率却垫底。普通话识别错误率可以达到英语的 5 倍,越南语在不同厂商间的差距也很大,这些差距只看英语基准是看不到的。

信源:https://sierra.ai/blog/mu-bench-an-open-multilingual-transcription-benchmark
贝索斯AI实验室据称接近380亿美元估值

《金融时报》援引知情人士称,杰夫·贝索斯参与运营的 AI 实验室 Project Prometheus 正接近完成新一轮融资。规模约 100 亿美元,投后估值约 380 亿美元。摩根大通和贝莱德参与了本轮融资。交易尚未最终敲定。

Project Prometheus 不是做通用聊天机器人。它主打能理解物理世界的 AI。目标是把模型用进工程、设计和制造流程。Axios 上月援引知情人士称,这家公司更想先切原型设计、材料和前期工程这类环节,不是直接用机器人替代工厂工人。

信源:https://www.ft.com/content/87ea0ced-bf3c-4822-8dda-437241570ded
Vercel安全事件更新:npm 包未被污染,新建环境变量默认即「敏感」

Vercel 官方账号 4 月 21 日上午宣布,称与 GitHub、Microsoft、npm、Socket 四方联合排查后,Vercel 在 npm 上发布的任何包均未被篡改,供应链「仍然安全」。Vercel 在 npm 上维护 Next.js、Turbopack、SWR 等开源库,合计每月下载量以亿次计,若被攻击者借员工账号投毒,影响会远超 Vercel 自身客户。这次核查排除了事件里最大的一项连带风险。

同日官方安全公告同步更新三处细节。受影响范围首次明确到字段级别。公告称,遭泄露的是未被标记为「敏感」的那部分客户环境变量,其在后台解密后以明文存储。是否有更多数据被带走,Vercel 仍在调查。给客户的建议里多了一条「删除 Vercel 项目或账号本身不能消除风险」。必须先轮换所有未标记为敏感的密钥,再考虑删除动作,攻击者拿到的凭证仍可直连生产系统。

产品侧改了默认值。新建环境变量现在默认即是「敏感」(sensitive: on)。老账号过去新增变量默认是普通类型,要手动勾选才启用敏感。这正是本次攻击者能读到明文变量的直接入口。Dashboard 同步上线了更密集的活动日志界面和团队级环境变量管理;所有安全建议里「启用双因素认证」被顶到最前。

信源:https://vercel.com/kb/bulletin/vercel-april-2026-security-incident
Claude Cowork 上线 Live Artifacts,仪表盘每次打开都会拉取当前数据重新渲染

Claude Cowork 现在可以生成 Live Artifacts:接到用户的应用和本地文件的仪表盘与追踪器,随时打开都会拉取一次当前数据重新渲染。每个产物自动保存到新的「Live Artifacts」标签页并带版本历史,换设备或在另一段对话里也能从原位置接着用。所有付费档可用。

信源:https://x.com/claudeai/status/2046328619249684989
腾讯 QClaw 海外版开启内测,通过 WhatsApp、Telegram 调用本地 Agent

QClaw 海外版开启内测,官网为 qclawsg.qq.com。首批上线美国、加拿大、新加坡、韩国,支持中、英、法、西、韩等多语言。内测期间每日赠送 4000 万 token,官方称价值约 700 美元。同时开放 20000 个「创始龙虾(Founding Claw)」名额,先到先得。

腾讯披露,海外版基于国内版 80 多项功能迭代,5 天完成开发,约 99% 的代码由 QClaw 自己写。所有数据在用户设备上本地处理;国内版已跑通的「龙虾管家(The Gateway)」安全模块同步移植到海外版,对 prompt、skills、执行脚本做实时拦截。海外版另开放 QClaw Playground(专家广场),预置健身教练、金融顾问、语言教师等角色,用户点选即用,不必从零写指令。

信源:https://mp.weixin.qq.com/s/c_H4s_0WMmyutfrwkaWhcw
谷歌DeepMind Inception组招5人,把SIMA、Genie从研究原型推向游戏产品

谷歌DeepMind Inception团队总监Alexandre Moufarek在X上放出5个招聘岗位:游戏设计师、高级产品经理、QA工程师、高级软件工程师和研究工程师(Staff级),链接统一指向Google Careers。Moufarek加入DeepMind前在育碧做过《幽灵行动:未来战士》和《看门狗》两款3A游戏,之后在软银负责Pepper家用机器人的产品。进入DeepMind后,他参与过Project Astra、SIMA、Genie和Gemini四条线。

关键在Inception这个团队的定位。DeepMind把它描述成「和研究团队并肩工作的创意、设计、工程团队」,目标是探索「以前没有AI时做不出来的游戏体验」。它不是研究组,而是把研究成果做成可玩原型的产品团队。

再看岗位构成。5个里有产品经理、游戏设计师和QA工程师,这三个位置过去不会出现在纯研究团队。DeepMind之前演示过SIMA 2和Genie 3的组合:前者是2025年11月发布的基于Gemini的3D虚拟世界agent,后者是可实时生成3D世界的世界模型,DeepMind把两者接起来,让agent在新生成的世界里执行指令。但SIMA 2至今只是「有限研究预览」,只向少数学者和游戏开发者开放。这轮招聘要补的,就是把研究演示做成能交付给外部开发者的产品。

信源:https://x.com/amoufarek/status/2046370200644173831
Anthropic招募STEM驻场研究员,暑期在旧金山测Claude做科研

Anthropic 挂出「Anthropic STEM Fellow」岗位。这是一项面向 STEM 研究者的暑期驻场研究员计划。项目从 6 月 15 日到 9 月 15 日,5 月 15 日截止申请。入选者需要全职在旧金山办公室工作,补贴约为每周 3800 美元。

Anthropic 希望这些驻场研究员和内部团队一起做三类事:给 Claude 设计更不容易刷分的科研评测,看它能不能规划实验、解读数据、理解具体机制;补数据和方法,专门盯能力缺口;把科学软件接进来,让模型在真实研究流程里跑。官方举的例子包括材料科学和气候科学。

岗位简介把目标写成「AI scientist」,也就是能自己推进科研的 AI 系统。

信源:https://job-boards.greenhouse.io/anthropic/jobs/5189848008
阿里云百炼上线 Token Plan 团队版,最低每月 198 元/坐席订阅多家模型

阿里云百炼上线 Token Plan 团队版,面向 AI 编程工具与 Agent 工具按坐席包月。套餐分三档:标准坐席 198 元/月 25,000 Credits、高级坐席 698 元/月 100,000 Credits、尊享坐席 1,398 元/月 250,000 Credits。超出额度时可加购共享用量包,每包 5,000 元换 625,000 Credits,有效期一个月。目前仅开放华北 2(北京)地域。

一个订阅下能切换的模型来自四家厂商:文本生成支持 qwen3.6-plus、智谱 glm-5、MiniMax-M2.5、DeepSeek-V3.2;图像生成支持 qwen-image-2.0 与 wan2.7-image 系列。所有调用以 Credits 统一抵扣,不再按模型分别计费。官方示例显示,qwen3.6-plus 一次总量约 5 万 token 的请求约消耗 4 Credits。

兼容主流 AI 编程工具:OpenAI 兼容端点可接 Codex、OpenCode,Anthropic 兼容端点可接 Claude Code、OpenClaw,DeepSeek V3.2 仅走 OpenAI 协议。图像生成模型需借助各工具的 Slash Command、Skill 等扩展机制调用。

使用范围有明确限制:只能在编程工具或 OpenClaw 类 Agent 中交互式使用。Dify、n8n、Coze 等自动化平台、应用后端和批量调用都不允许,违规会被暂停订阅或封 API Key。套餐订阅人专享,禁止多人共享,不支持退款。

信源:https://help.aliyun.com/zh/model-studio/token-plan-overview
前Stability AI创始人新公司Intelligent Internet推出Logos推理工具

前 Stability AI 创始人 Emad Mostaque 新公司 Intelligent Internet 发布 Logos,这是一套还在早期开发的推理工具。官网说,Logos 想做的,是帮人把复杂问题按最基本的规则一步步往下推,再把过程公开给人检查。公司这次先公开的是物理方向,数学、生物和经济学还没放出完整内容。

同时放出的第一份结果叫《Only One Postulate Needed》。团队拿狭义相对论做样例,声称只靠「相对性原理」这一条前提,就能推出必须存在一个固定的最高速度。实验要做的,只是测出这个速度到底是多少,不用再额外加一条「光速不变」的前提。

信源:https://ii.inc/web/blog/post/logos
DeepMind CEO哈萨比斯公开称赞Anthropic CEO Dario是其他AI实验室领导里最好的

当地时间 4 月 20 日晚,DeepMind 首席执行官 Demis Hassabis 与传记作者 Sebastian Mallaby 在旧金山对谈。活动由 City Arts & Lectures 主办,配合 Mallaby 今年 3 月出版的 Hassabis 传记《The Infinity Machine》造势。

Hassabis 直接评价竞争对手,称 Anthropic CEO Dario Amodei 是「其他实验室领导里最好的」(原话 best of all the other lab leaders)。

Mallaby 还估计 OpenAI 在未来 18 个月内破产的概率是 50%。他本职是金融史学者、美国外交关系委员会研究员,不是 AI 圈分析师。OpenAI 此前披露 2026 年预计亏损 140 亿美元,美国媒体据此推算公司可能在 2027 年现金告急。

关于 AI 末日风险 p(doom),Hassabis 不愿给出具体数字,但坚持它非零。他批评 a16z 联创 Marc Andreessen 和 Meta 首席 AI 科学家 Yann LeCun 坚持 p(doom) 为 0 的立场「离谱」。p(doom) 是 AI 圈行话,指一个人对「AI 最终导致人类灾难」的主观概率估计。

信源:https://x.com/deedydas/status/2046443025975652484?s=46
Exa推出Agentic搜索接口Deep Max,同准确率下比对手快数十倍

Exa 推出面向 LLM 代理的高端搜索接口 Deep Max。一次查询会并发发起几十次 Exa 搜索,每次从不同角度切入同一个问题,再合并成答案。Agentic 搜索指 LLM 自主规划多轮搜索再综合回答,是 Perplexity、You.com、Parallel 等搜索 API 公司近一年的主要产品形态。

三项评测由 Exa 自测,与竞品同题对比。Deep Search QA:Deep Max 90%/64 秒,You.com Frontier 84%/5908 秒,Parallel Ultra 8x 82%/1703 秒。FRAMES:Deep Max 94%/11 秒,Parallel Ultra 88%/1457 秒。HLE-Search:Deep Max 80%/25 秒,与 GPT 5.4 准确率持平但耗时减半。被对比的原生搜索工具还包括 Gemini 3.1 Pro、Claude Opus 4.7。Exa 称「最多比最接近的竞品快 20 倍」。

速度归因于并行工具调用、压缩过的页面正文,以及 Exa 自研搜索栈单次调用 1 秒内返回。Deep Max 目前仅对接触销售的客户开放,正式发布时间和价格未公布。

信源:https://exa.ai/blog/deep-max
Intel放出阿里Wan 2.2的三款INT4量化版

Intel 首席 AI 工程师 Haihao Shen 宣布,Intel 已在 Hugging Face 上传阿里 Wan 2.2 视频模型的三款 INT4 量化版本:T2V-A14B(文生视频)、I2V-A14B(图生视频)和 TI2V-5B(文图混合生视频),全部用 AutoRound 压到 W4A16。Shen 自己就是 AutoRound 这套量化工具的主要作者。INT4 把每个权重从 BF16 的 2 字节压到 0.5 字节,权重体积约为原版四分之一。

A14B 两款原本用 MoE 架构,总参数 27B、每步激活 14B,官方文档称单卡跑 720P 至少要 80GB 显存;TI2V-5B 是稠密模型,原版就能在 4090 上跑 720P@24fps。量化后的实测显存和画质对比 Intel 没公布,需等第三方复现。三款模型的推理链路也没走主线 vLLM,README 指向 Intel 自家的 vllm-omni 分支(feats/ar-w4a16-wan22),要装这个分支才能起服务。

信源:https://x.com/HaihaoShen/status/2046353772625137879
腾讯云开源CubeSandbox,兼容E2B、单机跑2000个沙箱

腾讯云开源了 AI Agent 沙盒 Cube Sandbox,Rust 编写,Apache 2.0 协议。

沙盒是 Agent 跑代码的隔离环境,防止模型生成的代码误删文件、越权访问主机。目前 OpenAI Agents SDK、Manus、Perplexity、Hugging Face 等产品都在用类似架构,接口事实标准是 E2B。Cube 兼容 E2B 接口,业务代码不用改,只改一个环境变量,就能把 Agent 从 E2B 自家服务切到自部署的 Cube。

腾讯云公布了两组性能数据。单并发冷启动低于 60ms,50 并发时平均 67ms、P95 90ms、P99 137ms。单实例常驻内存低于 5MB(沙盒规格不超过 32GB 时测得),一台 96 核服务器可同时跑 2000 多个沙箱。同场景下 Docker 容器启动约 200ms、共享主机内核;传统虚拟机启动以秒计、单实例内存 20MB 起。

Cube 的做法是给每个 Agent 开一套独立的 Guest OS 内核,走硬件级隔离,同时把启动时间压到百毫秒内。加速靠资源池预置、快照克隆、底层锁优化;压内存靠 Rust 重写、CoW 内存复用、reflink 磁盘共享。项目还附带 CubeVS,用 eBPF 做沙盒之间的网络隔离。

规模化验证给了两个案例。Cube 原本跑在腾讯云 Serverless 体系里,承载过百亿级调用。元宝 AI 编程场景迁到 Cube 后,资源核时消耗降了 95.8%。外部客户里,MiniMax 在 Agentic RL 训练中靠 Cube 做到分钟级调度数十万沙箱实例。下一步规划是把事件级快照回滚也开源出去,提供百毫秒级状态回滚。

信源:https://mp.weixin.qq.com/s/5rWKipAQdibiBmmQBHXVWg
删除AI模型训练数据被诉,北京首次将训练系统纳入刑法保护

北京市人民检察院发布《北京市检察机关知识产权检察白皮书(2025 年)》,其中披露 2025 年全市检察机关办理涉人工智能、数据要素产业的知识产权案件 113 件。白皮书重点列出两宗 AI 领域首例案件。

东城区检察院办理了北京首例非法删除 AI 模型训练数据案。一名员工故意删除公司用于训练 AI 模型的大量数据,训练系统因此结构性破坏,经济损失重大。检察机关以破坏计算机信息系统罪提起公诉。白皮书称,该案推动把 AI 模型训练系统认定为刑法意义上的「计算机信息系统」。这一罪名过去主要针对服务器、数据库等传统信息系统遭入侵或破坏的情形,AI 训练数据与训练系统的刑事定位此前并不清晰。

通州区检察院办理了北京首例利用 AI 生成模型侵犯著作权案。四名被告人未经授权以 AI 技术复制他人作品牟利,均以侵犯著作权罪被判刑。

2025 年全年,北京检察机关共办理知识产权案件 1195 件,同比上升 10.34%。

信源:https://www.21jingji.com/article/20260421/herald/7f400f89fae259a65973e06b6cc25ae9.html
Supabase推出@supabase/server简化SSR鉴权样板

Supabase 推出 npm 工具包 @supabase/server,版本 0.1.4,MIT 许可证。这个包把服务端渲染、API 路由、边缘函数场景下的 Supabase 客户端创建、cookie 同步、鉴权会话维护统一做掉,开发者不用再自己拼。

用法上提供一个叫 withSupabase 的高阶函数。开发者传入访问策略(示例里是 allow: 'user',只放登录用户过),返回的处理函数会把配好的 Supabase 客户端挂到 ctx.supabase 上,业务代码直接 ctx.supabase.from('todos').select() 查库即可。

Supabase 联合创始人 Paul Copplestone 在 X 公布消息时提到,这是早期版本,正在征集测试者和反馈,团队另在做各框架的适配器。

此前在 Next.js 等 SSR 框架里集成 Supabase,开发者要自己写 cookie 读取、会话刷新、客户端传递,这些样板代码是社区长期吐槽的点。

信源:https://www.npmjs.com/package/@supabase/server