动察Beating AI News
3.19K subscribers
902 photos
2 videos
1 file
3.44K links
AI新闻信息流
Download Telegram
SpaceX宣布与Cursor合作并获600亿美元收购期权

SpaceX 宣布与代码编辑器公司 Cursor 达成合作,联合开发下一代编码和知识工作 AI。具体条款:Cursor 授予 SpaceX 今年晚些时候以 600 亿美元收购公司的期权,若 SpaceX 不行使,则改付 100 亿美元作为合作款。

合作中,SpaceX 提供 Colossus 超算,推文称其算力相当于 100 万块英伟达 H100;Cursor 提供编码 AI 产品与面向专业软件工程师的分发渠道。

上周,xAI 已开始向 Cursor 出租数万块芯片,用于训练最新模型。Cursor 目前正以 500 亿美元目标估值融资,上一轮估值为 293 亿美元。

信源:https://x.com/SpaceX/status/2046713419978453374
谷歌发布Deep Research Max,基于Gemini 3.1 Pro

谷歌推出两款自主研究代理 Deep Research 和 Deep Research Max,均基于 Gemini 3.1 Pro 构建,以公开预览形式在 Gemini API 付费层上线,通过 Interactions API 调用,稍后进入 Google Cloud 面向创企和企业客户。

Deep Research 优化延迟和成本,替换去年 12 月的首发预览版,面向直接接入对话界面的场景;Deep Research Max 为新增配置,会投入更多算力反复检索和修正报告,官方设想的典型用法是夜间 cron 跑批,分析师团队早上拿到尽调报告。

新版本新增四块能力。一是接入 Model Context Protocol,可挂接金融、市场等第三方数据源或自定义工具;二是原生生成图表和信息图,用 HTML 或 Nano Banana 作图,不再只输出文字;三是支持 PDF、CSV、图片、音频、视频作为多模态上下文;四是执行前可审阅并改写代理给出的研究计划,Google Search、URL Context、Code Execution、File Search 和 MCP 能同时启用,也可完全关闭网页访问、仅在私有数据内部检索。实时流式接口会推送中间推理步骤和文本、图像产出。

谷歌同时在和 FactSet、S&P Global、PitchBook 合作搭建 MCP 服务,让三家客户把各自的专业数据接进 Deep Research 工作流。博客未公布具体基准分数,只称 Deep Research Max 比去年 12 月版「咨询的信源明显更多」,能「识别老版本常忽略的关键细节」。

信源:https://blog.google/innovation-and-ai/models-and-research/gemini-models/next-generation-gemini-deep-research/
Meta部署MCI工具采集员工键鼠数据训练AI智能体

Meta 开始向美国员工电脑安装追踪软件「Model Capability Initiative」(MCI),采集鼠标移动、点击、键盘输入并不定期截屏,用于训练能自动完成工作任务的 AI 智能体。工具只在工作类应用和网站上运行。

Meta SuperIntelligence Labs 团队内部备忘录显示,MCI 主要用来补齐模型在下拉菜单选择、键盘快捷键等人机交互环节的短板,员工做日常工作就能帮助模型改进。Meta CTO Andrew Bosworth 在另一份备忘录里称,公司「AI for Work」项目已更名为「Agent Transformation Accelerator」(ATA),目标是让智能体承担主要工作,员工负责指导、审查和改进。

Meta 发言人 Andy Stone 表示,MCI 数据不会用于绩效评估,对「敏感内容」有保护机制,但未说明具体排除哪些数据类型。

Meta 计划 5 月 20 日启动全球 10% 裁员,下半年还会有更多大规模裁员。公司上月新设 Applied AI(AAI)工程团队,让 AI 智能体承担未来产品构建、测试、发布的大部分工作,本月已开始把骨干工程师转岗至 AAI。

信源:https://www.reuters.com/sustainability/boards-policy-regulation/meta-start-capturing-employee-mouse-movements-keystrokes-ai-training-data-2026-04-21/
OpenAI发布ChatGPT Images 2.0,支持2K与双模式

OpenAI 发布图像生成新模型 ChatGPT Images 2.0,作为上一代 ChatGPT 原生图像模型的接替版,在网页端和 API 同步上线。新模型分 Instant 和 Thinking 两档。Instant 主打快速出图,上线前曾以 duct tape 代号在 LMArena 内测;Thinking 会先推理再生成,用于跨帧保持角色一致和多场景叙事,适合漫画分镜、多格连续设计。

技术规格上,Images 2.0 最高输出 2K 分辨率,长宽比从 3:1 到 1:3 自由切换,单次最多生成 8 张图。知识截止推进到 2025 年 12 月,生成前可联网检索最新信息并带进图像。

交互方式从一次性生成改为对话式编辑,用户可在同一会话里放大、改构图、替换元素,模型在编辑之间保留上下文。现场演示里,模型基于一张上传图给出 8 套夏季穿搭;另一个案例是先抓取社交媒体对前代模型的评价,再把结论可视化输出并附上 QR 码回链 ChatGPT。

文字渲染和非拉丁文字是另一条主线。官方强调日文、韩文、中文、印地文、孟加拉文的表现明显改善,这是扩散模型长期的弱项。

信源:https://openai.com/index/introducing-chatgpt-images-2-0/
月之暗面开源FlashKDA,Kimi Linear推理速度提升1.7到2.2倍

月之暗面在 GitHub 开源 FlashKDA,一套专门给英伟达 Hopper 系列显卡(H100、H20 等)加速模型推理的工具,MIT 协议。它服务的对象是 KDA,月之暗面去年在 Kimi Linear 论文里提出的新注意力机制。大模型读长文本时,老式注意力的计算量会随长度平方级膨胀,线性注意力让这个代价降到线性增长,KDA 是这条路线里的一种改良版。Kimi Linear 模型的结构是 3 层 KDA 搭 1 层老式注意力轮着用。

KDA 之前已经有一份用 Triton 语言写的版本,挂在开源库 flash-linear-attention(简称 fla)里。FlashKDA 改用英伟达的底层 GPU 库 CUTLASS 重写了一遍,专门榨 Hopper 显卡的性能。官方在 H20 上实测,同一次前向计算,FlashKDA 比 Triton 版快 1.7 到 2.2 倍,输入长度参差不齐、拼批次跑的场景加速尤其明显。只是官方只跟自家 Triton 版做了对比,没跟其他线性注意力方案比。

这次只开源了前向计算,意思是只能「跑模型」(推理),还不能「训模型」,训练仍得用原来的 Triton 版。使用门槛:显卡需 Hopper 及之后(SM90 架构起步)、CUDA 12.9 以上、PyTorch 2.4 以上。FlashKDA 同时作为新后端合并进了 fla 上游(PR #852),老用户切过去只要改一行配置。

信源:https://github.com/MoonshotAI/FlashKDA
SpaceX招股书披露双层股权结构,Musk去年增持14亿美元

《The Information》看到的 SpaceX 保密 IPO 招股书草稿显示,Elon Musk 去年通过其个人信托从现任及前员工手中买入 14 亿美元 SpaceX 股票;公司拟采用双层股权结构,Class B 股每股 10 票,Class A 股每股 1 票。招股书原文称该结构「把投票控制权集中于 Musk 及其他 B 股股东」,Musk 最终持股与投票占比暂未披露。

招股书风险因素还新增强制仲裁条款,股东就薪酬及公司事务提起诉讼将受限。美国证监会去年明确不会因带仲裁条款而延迟 IPO 注册文件,相当于放行了这类条款入表。

2025 年 12 月员工股售中 SpaceX 估值翻倍至 8000 亿美元,2026 年 2 月并入 xAI 后升至 1.25 万亿美元。IPO 计划 6 月中完成,目标融资 750 亿美元,估值上限 1.5 万亿美元,规模将是史上最大 IPO。

信源:https://www.theinformation.com/articles/musk-bought-1-4-billion-spacex-shares-helping-boost-control
传OpenRouter神秘100B模型Elephant Alpha出自蚂蚁百灵

量子位独家称,OpenRouter 此前匿名上线的 100B 新模型 Elephant Alpha 出自蚂蚁集团旗下 AI 实验室蚂蚁百灵(Inclusion AI)。OpenRouter 官方只公布了参数规模、同级 SOTA、Token 效率三项描述,没有提及厂商。蚂蚁百灵此前已开源 Ling-1T 等近 20 款模型,多走大参数路线,Elephant Alpha 是其首次在 OpenRouter 匿名频道露面的小参数模型。

信源:https://mp.weixin.qq.com/s/j1phsXkfNB9OLfnjlPInZw
X推出Custom Timelines,Premium用户可将话题钉在主页

X 产品负责人 Nikita Bier 宣布推出 Custom Timelines,Premium 订阅者可把一个具体话题钉到主页标签,支持超过 75 个话题。功能由 Grok 对每条帖子的理解叠加算法个性化驱动,同一话题在每个人面前排出的时间线并不相同,用户自己互动较多的话题效果更好。先上 iOS,Android 随后跟进。

X 今年 2 月曾在 iOS 的美加区试过一轮话题过滤器,只开放政治、体育、加密、AI 四个话题,20 分钟后自动重置。Custom Timelines 把话题数扩到 75+ 并改为可钉固定的形态,等于把那次限时实验升级为 Premium 里的常驻功能。

信源:https://x.com/nikitabier/status/2046736181002645520
Anthropic自称高危的新模型Mythos测试首日即遭未授权访问

彭博社援引知情人士称,一小批用户通过一个私人在线论坛访问了 Anthropic 的新 AI 模型 Mythos。Anthropic 此前称 Mythos 能力强到足以被用于发起危险的网络攻击。

就在 Anthropic 首次对外宣布将向少数企业开放 Mythos 有限测试的当天,这批用户已经拿到访问权限。此后他们一直在经常使用该模型,但用途不是网络攻击。知情人士向彭博提供了截图,并现场演示了模型。

信源:https://www.bloomberg.com/news/articles/2026-04-21/anthropic-s-mythos-model-is-being-accessed-by-unauthorized-users
Anthropic测试将Claude Code移出Pro订阅,OpenAI表态Codex保留免费层

Anthropic 把 Claude Code 从 Pro 订阅中下架,没发公告,只改了定价页。Pro 新用户如需使用 Claude Code,须升级至 $100/月起的 Max 订阅。Anthropic 增长负责人 Amol Avasare 随后在 X 发文澄清,这是针对约 2% 新注册 Pro 用户的小规模测试,现有 Pro 和 Max 订阅者不受影响。

Amol 解释,Max 一年前推出时并不包含 Claude Code,Cowork 和长时间运行的 agents 也不存在,当时只为重度聊天设计。Claude Code 被打包进 Max 之后、在 Opus 4 发布后使用量大增,长时间异步 agents 成为日常工作流,订阅者人均使用量大幅上升,现有订阅并不是按这种用法设计的。Anthropic 此前已加过每周上限和高峰时段限制,目前仍在测试不同方案并收集反馈。他承诺如果最终方案影响现有订阅者,会提前充分通知,「消息会从我们这里发出,而不是 X 或 Reddit 上的截图」。

OpenAI Codex 负责人 Thibault Sottiaux 随即在 X 表态:Codex 将继续在 Free 和 Plus($20/月)订阅中提供,OpenAI 有算力和高效模型支持,重大变更会提前与社区沟通,「透明和信任是我们不会破坏的两个原则,即便短期会少赚一些」。Sam Altman 转发 Tibo 推文并配文「我们希望你们拥有大量 AI」。

信源:https://x.com/sama/status/2046752492093165708
Roo Code安装量破300万后宣布关停,团队全力转向云端代理Roomote

Roo Code 联合创始人兼 CEO Matt Rubens 宣布关停这款 VS Code 编码代理插件,团队全部精力转向新产品 Roomote。Roo Code 于 2024 年底从 Cline 分叉而来,加入允许代理跳过所有权限确认的一键自动批准模式,累计装机突破 300 万。团队将在 5 月 15 日发布最后一个插件版本,归档 GitHub 仓库并退还未使用余额;仍需插件的用户被引导回 Cline。

Rubens 写道,内部从 2025 年秋开始把 Roo Code 放进云容器里并发跑,打开全部自动批准,让代理自己修 bug、跑应用、验证结果再交给人审。他把这种模式归结为「输入 prompt,拿到高质量 PR」,认为 IDE 本身由此变得次要,Roo Code 原本服务的那种工作方式正在消失。

新产品 Roomote 以 Slack 为主入口,同时接入 Linear、GitHub、Sentry、Notion 等工具,按任务挑选不同厂商的前沿模型,不绑定单一供应商。每次改动它会在隔离容器里跑完整应用自检,UI 改动附截图后再开 PR。Rubens 希望非工程师(PM、支持、运营、市场、创始人)也能靠它拿到可合并的 PR。Roomote 现阶段以 waitlist 模式开放注册,入口在 roomote.dev。

信源:https://x.com/mattrubens/status/2046636598859559114
谷歌正将内部AI编码工具整合至Antigravity

彭博社援引知情人士称,谷歌担心在 AI 编码工具市场落后于 Anthropic 和 OpenAI,正着手把内部分散的编码产品整合到 Antigravity 平台。首席 AI 架构师 Koray Kavukcuoglu 将在未来几周与主工程团队合作推进整合。Antigravity 是谷歌去年以 24 亿美元收购 Windsurf 人才与技术后推出的 AI 编码平台,目前公司对外的编码产品仍分散在 Gemini Code Assist、Gemini CLI、AI Studio、Firebase Studio、Jules 等多条线,品牌不一、定位重叠。

整合之外,DeepMind 同步向 AI 编码投入资源,单独组建了一支团队,由研究工程师 Sebastian Borgeaud 带队,2024 年诺贝尔奖得主 John Jumper 也在参与该方向的研究。

多名现任和前员工透露,部分谷歌工程师更愿意用 Anthropic 的 Claude Code。出于安全考虑,谷歌禁止大多数员工使用 Claude Code 或 OpenAI Codex,须提供业务理由才能申请例外;但 DeepMind 内部负责 Gemini 模型、内部应用和开源模型的若干团队已在用 Claude Code。

本月原 Jules 负责人 Kathy Korevec 离职加入 OpenAI,她在 X 上写,谷歌的问题是「并行工具、重叠界面」,是「系统问题,不是人才问题」;推动谷歌内部 AI 编码使用的高管 Brian Saluzzo 也已离开。

信源:https://www.bloomberg.com/news/articles/2026-04-21/google-struggles-to-gain-ground-in-ai-coding-as-rivals-advance
X推出Snooze Topics,Premium用户可把话题静音24小时

X 产品负责人 Nikita Bier 宣布上线 Snooze Topics,Premium 订阅者可在 For You 主页把选中的话题隐藏 24 小时。可选话题包括政治、视频、体育、商业与金融、科学与科技、娱乐与艺术、人工智能等,点 Reset 可随时解除。功能覆盖 iOS 和网页端,与同日推出的 Custom Timelines 一同上线。

Custom Timelines 把话题钉到首页是做加法,Snooze Topics 把话题临时移出 For You 是做减法,Premium 用户现在可以双向调节自己的信息流。

信源:https://x.com/nikitabier/status/2046776546858532993
SpaceX在招股书中警告太空AI数据中心可能不具备商业可行性

SpaceX S-1 招股书草稿显示,公司向投资者发出警告,其在轨道建设 AI 数据中心以及星际工业化的计划正处于早期阶段,涉及重大的技术复杂性和未经验证的技术,可能无法实现商业可行性。

文件指出,未来的轨道数据中心将在严酷且不可预测的太空环境中运行,面临独特且广泛的风险,可能导致设备故障或完全失效。此外,招股书强调了对下一代星舰(Starship)火箭的严重依赖,称星舰在规模化开发、发射节奏或复用能力上的任何失败或延迟,都会拖累公司的增长战略。

作为旨在向投资者披露风险并规避法律责任的法定文件,招股书展现了比外部愿景更谨慎的内部预期。CEO Elon Musk 今年 1 月曾公开称太空 AI 数据中心是「理所当然的事」,并在 2 月表示太空 AI 是「扩展规模的唯一途径」。

信源:https://www.reuters.com/world/spacex-says-unproven-ai-space-data-centers-may-not-be-commercially-viable-filing-2026-04-21/
🤡2
GPT-5.5已上线Codex,OpenAI尚未正式宣布

GPT-5.5 已出现在 OpenAI Codex 的模型选择器下拉列表中,位于列表最顶部。

选择 GPT-5.5 后提交请求,Codex 返回 400 错误,提示「The 'gpt-5.5' model is not supported when using Codex with a ChatGPT account」,模型当前不可用。OpenAI 截至目前没有发布任何关于 GPT-5.5 的官方公告或文档。

此前多家媒体报道,OpenAI 内部代号「Spud」的下一代前沿模型预训练已于 3 月底完成,外界普遍猜测其正式名称为 GPT-5.5 或 GPT-6,预计在第二季度发布。
1
蚂蚁百灵发布Ling-2.6-flash,确认即OpenRouter匿名模型Elephant

蚂蚁集团旗下 AI 实验室蚂蚁百灵(Inclusion AI)正式发布 Ling-2.6-flash 模型,确认其即为此前在 OpenRouter 匿名上线的 Elephant Alpha。该模型总参数为 104B,激活参数 7.4B,底层采用混合线性架构(Hybrid Linear Architecture)提升计算效率,专为连续的 Agent 场景设计。

为解决传统模型在多步 Agent 工作流中算力消耗大、输出冗长的问题,Ling-2.6-flash 针对精简输出进行了训练。蚂蚁百灵称,其在执行 Agent 测试时的 Token 用量仅为 Nemotron-3-Super 的约十分之一;预填充吞吐量则是后者的 2.2 倍。模型在 4 张 H20 显卡上生成速度可达 340 tokens/s,并在 SWE-bench Verified、TAU2-bench 等测试中取得同级 SOTA 成绩。

目前,该模型已在 OpenRouter 及官方平台开放为期一周的免费 API。蚂蚁百灵表示,未来将开源该模型及 BF16、FP8、INT4 量化版本,并与蚂蚁数科合作推出商业版 LingDT。

信源:https://x.com/AntLingAGI/status/2046660999491858521
OpenClaw发布2026.4.21修复越权漏洞,画图默认接入GPT-Image-2

开源 AI Agent 平台 OpenClaw 在同日紧接着发布 2026.4.21 版本。这次更新主要是为了接上 OpenAI 刚发布的新一代画图模型,并补上一个指令权限漏洞。

系统自带的图像生成通道和自动化测试现在默认走 `gpt-image-2`,并在文档和元数据里加上了新的 2K 和 4K 尺寸提示。如果在生成时首选模型失败,网关现在会先把报错打进日志再触发自动回退,避免此前静默切换导致查不出 OpenAI 接口的错误原因。

安全方面修补了指令越权漏洞(#69774)。此前如果开启了所有者专属命令控制(`enforceOwnerForCommands`)但没配白名单(`ownerAllowFrom`),普通用户可能会借着宽泛的兜底策略绕过限制;现在系统强制要求核实所有者身份或 operator.admin 权限。

此外,日常修补方面,浏览器插件找不到无障碍节点时不再硬等超时而是立即拦截,对外发的 Slack 消息也修好了无法保持在原讨论线程里的问题。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.4.21
谷歌Labs开源Stitch设计格式DESIGN.md

Google Labs 公开 AI 设计工具 Stitch 内部使用的 DESIGN.md 格式草案规范。这是一份让 AI agent 读懂设计系统的文件格式,此前只在 Stitch 内部使用,开源后可在 Stitch 之外的工具里复用同一份设计规则。

一个 DESIGN.md 文件分两层:顶部 YAML 前言写设计 token,机器可读,字段涵盖颜色(hex 值)、字体(含 fontFamily、fontSize、fontWeight、lineHeight 等)、间距、圆角和组件;下方 Markdown 正文按 Overview、Colors、Typography、Layout、Elevation & Depth、Shapes、Components、Do's and Don'ts 的顺序写设计理由,给人看。组件属性通过 {colors.primary} 这类语法引用上方 token。

配套 CLI 工具提供 lint(含 7 条规则和 WCAG 对比度校验)、diff(比对两版差异)、export(导出为 Tailwind 或 DTCG 格式)和 spec(输出规范文档)。token 体系参考了 W3C Design Tokens Format Module。

当前版本为 alpha 0.1.0,采用 Apache-2.0 协议,由 davideast 等 5 名贡献者维护。用户可在 stitch.withgoogle.com 生成自己的 DESIGN.md,或到 GitHub 仓库 google-labs-code/design.md 提交修改。

对 AI 编程 agent 来说,这相当于一份可机器校验的设计契约:agent 不必再猜一个颜色的用途或一个组件的布局逻辑,而是能对照 token 验证选择,并用 WCAG 规则自检配色可访问性。

信源:https://blog.google/innovation-and-ai/models-and-research/google-labs/stitch-design-md/
OpenAI联手埃森哲等咨询机构销售Codex

OpenAI 正在与埃森哲(Accenture)、凯捷(Capgemini)和普华永道(PwC)等咨询机构合作,向企业客户销售其 AI 编程工具 Codex。这是 OpenAI 削减「支线任务」、聚焦编程与企业市场的最新举措。

OpenAI 同时宣布,Codex 的周活跃用户已达 400 万,较两周前的 300 万和上个月的 200 万大幅增长。为推进该合作计划,OpenAI 聘请了前谷歌云高管 Colleen Kapase 担任全球合作伙伴与生态系统副总裁。

OpenAI 首席营收官 Denise Dresser 表示,合作伙伴不仅将帮助客户更新代码,还会将 Codex 及其 Agent 开发平台 Frontier 引入营销、财务和销售等非研发类知识工作领域。

信源:https://www.wsj.com/cio-journal/openai-is-working-with-consultants-to-sell-codex-f355b1b9
OpenClaw创始人回应Claude CLI「解禁」传闻:口头允许但实际仍被封

有人把 OpenClaw 最新文档里那句「Anthropic 允许 OpenClaw 风格的 Claude CLI 使用」截图发到 Hacker News,帖子被顶上首页,又在 X 被连带转起来。OpenClaw 创始人 Peter Steinberger 先后在两边回应,给出目前最清楚的版本:口头允许是真的,实际封锁也是真的。

按 Steinberger 的说法,Claude Code 负责人 Boris Cherny 此前在 X 公开说过 CLI 使用被允许,OpenClaw 据此重新加回支持,默认关掉了 heartbeat 这类高 token 消耗功能。但团队测试下来,Anthropic 服务端仍在封锁 OpenClaw 的系统提示片段,调用照样被拒。他补充,只要几个重命名就能绕开分类器,但他不想玩这种猫鼠游戏。

OpenClaw 接 Claude Code,底层就是调用 claude -p`,也就是官方 Claude CLI 的一次性非交互模式,没有绕开它的独立通道;使用的是 API key 还是 Pro / Max / Team 订阅额度,看本地 Claude CLI 当时登录的是哪个。Anthropic 这轮「封禁 OpenClaw」不是禁 `claude -p 这条命令,而是在服务端按系统提示指纹识别 OpenClaw,命中就拒。Boris 口头的「CLI 允许」和文档里的「`claude -p 复用默许」说的是同一件事,跟订阅额度能不能跑 OpenClaw 之间只差一个分类器放不放行。

OpenClaw 在 v2026.4.5 把 Claude CLI 从新用户默认引导中移除,两天后 v2026.4.7 又加回来,同时对 Claude CLI 运行环境加了一批变量清理和权限限制。本轮文档的「再次被允许」对应的就是 v2026.4.7 这次改动。

信源:https://news.ycombinator.com/item?id=47853799
特斯拉中国车机语音大模型服务完成备案,将接入豆包与DeepSeek

网信上海公布,特斯拉(上海)有限公司的「车机语音大模型服务」于 4 月 20 日完成生成式人工智能服务备案。

特斯拉中国官网此前发布的《特斯拉车机语音助手使用条款》已披露分工方案:Model Y L 车型将搭载豆包大模型与 DeepSeek 模型,均通过火山引擎加密 API 接入。豆包负责语音命令,覆盖导航设定、媒体播放、空调温度调节和车主手册查询;DeepSeek 负责 AI 互动,用于闲聊、查询新闻与天气等场景。

备案完成意味着合规流程已走通,但具体 OTA 推送时间和适用车型范围尚未公布。

信源:https://finance.sina.com.cn/wm/2026-04-21/doc-inhvhrra4893933.shtml