动察Beating AI News
3.19K subscribers
902 photos
2 videos
1 file
3.44K links
AI新闻信息流
Download Telegram
Anthropic测试将Claude Code移出Pro订阅,OpenAI表态Codex保留免费层

Anthropic 把 Claude Code 从 Pro 订阅中下架,没发公告,只改了定价页。Pro 新用户如需使用 Claude Code,须升级至 $100/月起的 Max 订阅。Anthropic 增长负责人 Amol Avasare 随后在 X 发文澄清,这是针对约 2% 新注册 Pro 用户的小规模测试,现有 Pro 和 Max 订阅者不受影响。

Amol 解释,Max 一年前推出时并不包含 Claude Code,Cowork 和长时间运行的 agents 也不存在,当时只为重度聊天设计。Claude Code 被打包进 Max 之后、在 Opus 4 发布后使用量大增,长时间异步 agents 成为日常工作流,订阅者人均使用量大幅上升,现有订阅并不是按这种用法设计的。Anthropic 此前已加过每周上限和高峰时段限制,目前仍在测试不同方案并收集反馈。他承诺如果最终方案影响现有订阅者,会提前充分通知,「消息会从我们这里发出,而不是 X 或 Reddit 上的截图」。

OpenAI Codex 负责人 Thibault Sottiaux 随即在 X 表态:Codex 将继续在 Free 和 Plus($20/月)订阅中提供,OpenAI 有算力和高效模型支持,重大变更会提前与社区沟通,「透明和信任是我们不会破坏的两个原则,即便短期会少赚一些」。Sam Altman 转发 Tibo 推文并配文「我们希望你们拥有大量 AI」。

信源:https://x.com/sama/status/2046752492093165708
Roo Code安装量破300万后宣布关停,团队全力转向云端代理Roomote

Roo Code 联合创始人兼 CEO Matt Rubens 宣布关停这款 VS Code 编码代理插件,团队全部精力转向新产品 Roomote。Roo Code 于 2024 年底从 Cline 分叉而来,加入允许代理跳过所有权限确认的一键自动批准模式,累计装机突破 300 万。团队将在 5 月 15 日发布最后一个插件版本,归档 GitHub 仓库并退还未使用余额;仍需插件的用户被引导回 Cline。

Rubens 写道,内部从 2025 年秋开始把 Roo Code 放进云容器里并发跑,打开全部自动批准,让代理自己修 bug、跑应用、验证结果再交给人审。他把这种模式归结为「输入 prompt,拿到高质量 PR」,认为 IDE 本身由此变得次要,Roo Code 原本服务的那种工作方式正在消失。

新产品 Roomote 以 Slack 为主入口,同时接入 Linear、GitHub、Sentry、Notion 等工具,按任务挑选不同厂商的前沿模型,不绑定单一供应商。每次改动它会在隔离容器里跑完整应用自检,UI 改动附截图后再开 PR。Rubens 希望非工程师(PM、支持、运营、市场、创始人)也能靠它拿到可合并的 PR。Roomote 现阶段以 waitlist 模式开放注册,入口在 roomote.dev。

信源:https://x.com/mattrubens/status/2046636598859559114
谷歌正将内部AI编码工具整合至Antigravity

彭博社援引知情人士称,谷歌担心在 AI 编码工具市场落后于 Anthropic 和 OpenAI,正着手把内部分散的编码产品整合到 Antigravity 平台。首席 AI 架构师 Koray Kavukcuoglu 将在未来几周与主工程团队合作推进整合。Antigravity 是谷歌去年以 24 亿美元收购 Windsurf 人才与技术后推出的 AI 编码平台,目前公司对外的编码产品仍分散在 Gemini Code Assist、Gemini CLI、AI Studio、Firebase Studio、Jules 等多条线,品牌不一、定位重叠。

整合之外,DeepMind 同步向 AI 编码投入资源,单独组建了一支团队,由研究工程师 Sebastian Borgeaud 带队,2024 年诺贝尔奖得主 John Jumper 也在参与该方向的研究。

多名现任和前员工透露,部分谷歌工程师更愿意用 Anthropic 的 Claude Code。出于安全考虑,谷歌禁止大多数员工使用 Claude Code 或 OpenAI Codex,须提供业务理由才能申请例外;但 DeepMind 内部负责 Gemini 模型、内部应用和开源模型的若干团队已在用 Claude Code。

本月原 Jules 负责人 Kathy Korevec 离职加入 OpenAI,她在 X 上写,谷歌的问题是「并行工具、重叠界面」,是「系统问题,不是人才问题」;推动谷歌内部 AI 编码使用的高管 Brian Saluzzo 也已离开。

信源:https://www.bloomberg.com/news/articles/2026-04-21/google-struggles-to-gain-ground-in-ai-coding-as-rivals-advance
X推出Snooze Topics,Premium用户可把话题静音24小时

X 产品负责人 Nikita Bier 宣布上线 Snooze Topics,Premium 订阅者可在 For You 主页把选中的话题隐藏 24 小时。可选话题包括政治、视频、体育、商业与金融、科学与科技、娱乐与艺术、人工智能等,点 Reset 可随时解除。功能覆盖 iOS 和网页端,与同日推出的 Custom Timelines 一同上线。

Custom Timelines 把话题钉到首页是做加法,Snooze Topics 把话题临时移出 For You 是做减法,Premium 用户现在可以双向调节自己的信息流。

信源:https://x.com/nikitabier/status/2046776546858532993
SpaceX在招股书中警告太空AI数据中心可能不具备商业可行性

SpaceX S-1 招股书草稿显示,公司向投资者发出警告,其在轨道建设 AI 数据中心以及星际工业化的计划正处于早期阶段,涉及重大的技术复杂性和未经验证的技术,可能无法实现商业可行性。

文件指出,未来的轨道数据中心将在严酷且不可预测的太空环境中运行,面临独特且广泛的风险,可能导致设备故障或完全失效。此外,招股书强调了对下一代星舰(Starship)火箭的严重依赖,称星舰在规模化开发、发射节奏或复用能力上的任何失败或延迟,都会拖累公司的增长战略。

作为旨在向投资者披露风险并规避法律责任的法定文件,招股书展现了比外部愿景更谨慎的内部预期。CEO Elon Musk 今年 1 月曾公开称太空 AI 数据中心是「理所当然的事」,并在 2 月表示太空 AI 是「扩展规模的唯一途径」。

信源:https://www.reuters.com/world/spacex-says-unproven-ai-space-data-centers-may-not-be-commercially-viable-filing-2026-04-21/
🤡2
GPT-5.5已上线Codex,OpenAI尚未正式宣布

GPT-5.5 已出现在 OpenAI Codex 的模型选择器下拉列表中,位于列表最顶部。

选择 GPT-5.5 后提交请求,Codex 返回 400 错误,提示「The 'gpt-5.5' model is not supported when using Codex with a ChatGPT account」,模型当前不可用。OpenAI 截至目前没有发布任何关于 GPT-5.5 的官方公告或文档。

此前多家媒体报道,OpenAI 内部代号「Spud」的下一代前沿模型预训练已于 3 月底完成,外界普遍猜测其正式名称为 GPT-5.5 或 GPT-6,预计在第二季度发布。
1
蚂蚁百灵发布Ling-2.6-flash,确认即OpenRouter匿名模型Elephant

蚂蚁集团旗下 AI 实验室蚂蚁百灵(Inclusion AI)正式发布 Ling-2.6-flash 模型,确认其即为此前在 OpenRouter 匿名上线的 Elephant Alpha。该模型总参数为 104B,激活参数 7.4B,底层采用混合线性架构(Hybrid Linear Architecture)提升计算效率,专为连续的 Agent 场景设计。

为解决传统模型在多步 Agent 工作流中算力消耗大、输出冗长的问题,Ling-2.6-flash 针对精简输出进行了训练。蚂蚁百灵称,其在执行 Agent 测试时的 Token 用量仅为 Nemotron-3-Super 的约十分之一;预填充吞吐量则是后者的 2.2 倍。模型在 4 张 H20 显卡上生成速度可达 340 tokens/s,并在 SWE-bench Verified、TAU2-bench 等测试中取得同级 SOTA 成绩。

目前,该模型已在 OpenRouter 及官方平台开放为期一周的免费 API。蚂蚁百灵表示,未来将开源该模型及 BF16、FP8、INT4 量化版本,并与蚂蚁数科合作推出商业版 LingDT。

信源:https://x.com/AntLingAGI/status/2046660999491858521
OpenClaw发布2026.4.21修复越权漏洞,画图默认接入GPT-Image-2

开源 AI Agent 平台 OpenClaw 在同日紧接着发布 2026.4.21 版本。这次更新主要是为了接上 OpenAI 刚发布的新一代画图模型,并补上一个指令权限漏洞。

系统自带的图像生成通道和自动化测试现在默认走 `gpt-image-2`,并在文档和元数据里加上了新的 2K 和 4K 尺寸提示。如果在生成时首选模型失败,网关现在会先把报错打进日志再触发自动回退,避免此前静默切换导致查不出 OpenAI 接口的错误原因。

安全方面修补了指令越权漏洞(#69774)。此前如果开启了所有者专属命令控制(`enforceOwnerForCommands`)但没配白名单(`ownerAllowFrom`),普通用户可能会借着宽泛的兜底策略绕过限制;现在系统强制要求核实所有者身份或 operator.admin 权限。

此外,日常修补方面,浏览器插件找不到无障碍节点时不再硬等超时而是立即拦截,对外发的 Slack 消息也修好了无法保持在原讨论线程里的问题。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.4.21
谷歌Labs开源Stitch设计格式DESIGN.md

Google Labs 公开 AI 设计工具 Stitch 内部使用的 DESIGN.md 格式草案规范。这是一份让 AI agent 读懂设计系统的文件格式,此前只在 Stitch 内部使用,开源后可在 Stitch 之外的工具里复用同一份设计规则。

一个 DESIGN.md 文件分两层:顶部 YAML 前言写设计 token,机器可读,字段涵盖颜色(hex 值)、字体(含 fontFamily、fontSize、fontWeight、lineHeight 等)、间距、圆角和组件;下方 Markdown 正文按 Overview、Colors、Typography、Layout、Elevation & Depth、Shapes、Components、Do's and Don'ts 的顺序写设计理由,给人看。组件属性通过 {colors.primary} 这类语法引用上方 token。

配套 CLI 工具提供 lint(含 7 条规则和 WCAG 对比度校验)、diff(比对两版差异)、export(导出为 Tailwind 或 DTCG 格式)和 spec(输出规范文档)。token 体系参考了 W3C Design Tokens Format Module。

当前版本为 alpha 0.1.0,采用 Apache-2.0 协议,由 davideast 等 5 名贡献者维护。用户可在 stitch.withgoogle.com 生成自己的 DESIGN.md,或到 GitHub 仓库 google-labs-code/design.md 提交修改。

对 AI 编程 agent 来说,这相当于一份可机器校验的设计契约:agent 不必再猜一个颜色的用途或一个组件的布局逻辑,而是能对照 token 验证选择,并用 WCAG 规则自检配色可访问性。

信源:https://blog.google/innovation-and-ai/models-and-research/google-labs/stitch-design-md/
OpenAI联手埃森哲等咨询机构销售Codex

OpenAI 正在与埃森哲(Accenture)、凯捷(Capgemini)和普华永道(PwC)等咨询机构合作,向企业客户销售其 AI 编程工具 Codex。这是 OpenAI 削减「支线任务」、聚焦编程与企业市场的最新举措。

OpenAI 同时宣布,Codex 的周活跃用户已达 400 万,较两周前的 300 万和上个月的 200 万大幅增长。为推进该合作计划,OpenAI 聘请了前谷歌云高管 Colleen Kapase 担任全球合作伙伴与生态系统副总裁。

OpenAI 首席营收官 Denise Dresser 表示,合作伙伴不仅将帮助客户更新代码,还会将 Codex 及其 Agent 开发平台 Frontier 引入营销、财务和销售等非研发类知识工作领域。

信源:https://www.wsj.com/cio-journal/openai-is-working-with-consultants-to-sell-codex-f355b1b9
OpenClaw创始人回应Claude CLI「解禁」传闻:口头允许但实际仍被封

有人把 OpenClaw 最新文档里那句「Anthropic 允许 OpenClaw 风格的 Claude CLI 使用」截图发到 Hacker News,帖子被顶上首页,又在 X 被连带转起来。OpenClaw 创始人 Peter Steinberger 先后在两边回应,给出目前最清楚的版本:口头允许是真的,实际封锁也是真的。

按 Steinberger 的说法,Claude Code 负责人 Boris Cherny 此前在 X 公开说过 CLI 使用被允许,OpenClaw 据此重新加回支持,默认关掉了 heartbeat 这类高 token 消耗功能。但团队测试下来,Anthropic 服务端仍在封锁 OpenClaw 的系统提示片段,调用照样被拒。他补充,只要几个重命名就能绕开分类器,但他不想玩这种猫鼠游戏。

OpenClaw 接 Claude Code,底层就是调用 claude -p`,也就是官方 Claude CLI 的一次性非交互模式,没有绕开它的独立通道;使用的是 API key 还是 Pro / Max / Team 订阅额度,看本地 Claude CLI 当时登录的是哪个。Anthropic 这轮「封禁 OpenClaw」不是禁 `claude -p 这条命令,而是在服务端按系统提示指纹识别 OpenClaw,命中就拒。Boris 口头的「CLI 允许」和文档里的「`claude -p 复用默许」说的是同一件事,跟订阅额度能不能跑 OpenClaw 之间只差一个分类器放不放行。

OpenClaw 在 v2026.4.5 把 Claude CLI 从新用户默认引导中移除,两天后 v2026.4.7 又加回来,同时对 Claude CLI 运行环境加了一批变量清理和权限限制。本轮文档的「再次被允许」对应的就是 v2026.4.7 这次改动。

信源:https://news.ycombinator.com/item?id=47853799
特斯拉中国车机语音大模型服务完成备案,将接入豆包与DeepSeek

网信上海公布,特斯拉(上海)有限公司的「车机语音大模型服务」于 4 月 20 日完成生成式人工智能服务备案。

特斯拉中国官网此前发布的《特斯拉车机语音助手使用条款》已披露分工方案:Model Y L 车型将搭载豆包大模型与 DeepSeek 模型,均通过火山引擎加密 API 接入。豆包负责语音命令,覆盖导航设定、媒体播放、空调温度调节和车主手册查询;DeepSeek 负责 AI 互动,用于闲聊、查询新闻与天气等场景。

备案完成意味着合规流程已走通,但具体 OTA 推送时间和适用车型范围尚未公布。

信源:https://finance.sina.com.cn/wm/2026-04-21/doc-inhvhrra4893933.shtml
开发者批评Anthropic暗改订阅计划,社区口碑向OpenAI倾斜

Anthropic 在定价页测试将终端工具 Claude Code 移出 20 美元 Pro 计划,引发开发者圈大面积批评。大量用户指责 Anthropic 沟通极其糟糕、做法「贪婪」,抨击这种毫无预警的变相涨价破坏了工具的可靠性,并纷纷扬言退订。

与此同时,社区口碑正明显向 OpenAI 倾斜。一方面是因为 OpenAI 明确承诺 Codex 保留免费和基础订阅档位;另一方面也得益于其近期模型的良好表现:旗舰模型 GPT-5.4 在 OSWorld 计算机使用等测试中超越人类专家基线,刚推出的 ChatGPT Images 2.0 也在 Image Arena 榜单登顶。

商业策略的对比与新模型的坚实表现加速了用户流转。大量原本依赖 Claude Code 的开发者表示正转投 Codex,并调侃 Anthropic 是在主动帮 OpenAI 免费收割用户。根据昨日官方公布的数据,Codex 周活跃用户已突破 400 万。

信源:https://www.reddit.com/r/ClaudeAI/comments/1srzhd7/psa_claude_pro_no_longer_lists_claude_code_as_an/
智谱4月30日起停订GLM Coding Plan无周限额老套餐

智谱发布公告,宣布将于北京时间 2026 年 4 月 30 日 10:00 起,停止 AI 编程辅助服务 GLM Coding Plan「无周限额」老套餐的自动续订。受影响的用户将获赠 2 个月同等级的新套餐权益。

官方表示,由于使用规模持续增长,原有的无周额度供给方式已难以支撑长期稳定的服务。本次调整仅针对当前订阅该老套餐且已开启自动续订的用户。用户当前订阅周期的价格和权益不受影响,赠送的 2 个月权益将于 4 月 30 日自动发放。补偿期结束后,如需继续使用,需要用户自行订阅届时线上的最新套餐。

信源:https://mp.weixin.qq.com/s/5_8RUEKVqTkRQBt2SGhRVw
传清华副教授代季峰创立Naive.ai,获约3亿美元融资

微信公众号「Top华人科创社」爆料称,清华大学电子工程系副教授代季峰创立了 Naive.ai,做开源模型后训练 Agent。融资总额约 3 亿美元,估值约 8 亿美元,投资方包括一线基金和科技巨头,具体机构未披露。

代季峰是计算机视觉领域知名学者,代表作包括可变形卷积网络和多模态基础模型 InternVL,论文总引用超 5 万次。他曾在微软亚洲研究院任首席研究员,后转任商汤执行研究总监,2022 年回清华任教。2025 年加入陈天桥旗下盛大网络孵化的 AI 公司 MiroMind,任联合发起人。

多家媒体此前报道,MiroMind 因合规原因于今年 1 月停止中国运营,代季峰随后离职。爆料称其新公司核心团队包括前 MiroMind 成员及联合创始人朱锡洲,后者为中科大与微软亚研院联培博士,曾任商汤高级研究员、上海 AI Lab 青年研究员。

信源:https://mp.weixin.qq.com/s/dEOwpgwE-HGOSwUbDvSTLw
华盛顿邮报:中国警告陈天桥的AI公司MiroMind勿外迁人才

《华盛顿邮报》援引十余名业内人士称,中国正加力阻止 AI 初创公司将人才和技术转移至海外。除已公开的 Manus AI 调查外,当局直接警告另一家 AI 公司 MiroMind 不得将核心人才和研究成果迁出中国。

MiroMind 母公司盛大集团创始人陈天桥近期被中国监管部门告诫不要将 AI 资源迁出中国,但未对 MiroMind 展开正式调查。MiroMind 自称总部位于加州红木城,联合研发中心设在新加坡,但其早期研究大部分在中国完成。今年 1 月公司要求员工离开中国。

此前担任 MiroMind 首席科学家的清华大学副教授代季峰向《华盛顿邮报》确认已离开该公司,原因是盛大集团要求 AI 研究人员迁往新加坡或日本,他无法接受。目前 MiroMind 正在美国融资,中国已无在职员工,并计划将产品 MiroThinker 改名以淡化中国背景。

信源:https://www.washingtonpost.com/world/2026/04/21/china-ai-competition-manus-meta/
谷歌发布ReasoningBank,智能体从成败经验中提炼推理策略

谷歌研究院发布智能体记忆框架 ReasoningBank,让大模型驱动的智能体在部署后持续学习。核心做法是把过往任务的成功和失败经验都提炼成通用的推理策略存入记忆库,下次遇到类似任务先检索再执行。相关论文在 ICLR 发表,代码已在 GitHub 开源。

此前两类主流方案各有缺陷:Synapse 记录完整行动轨迹,粒度太细难迁移;Agent Workflow Memory 只从成功案例提炼工作流。ReasoningBank 改了两处:存储对象从「动作序列」换成「推理模式」,每条记忆含标题、描述、内容三段结构化字段;失败轨迹也纳入学习。模型调用另一个大模型对执行轨迹自评,失败经验被拆成防踩坑规则,例如从「看见 Load More 按钮就点」升级为「先核对当前页面标识,避免陷入无限滚动,再点击加载更多」。

论文另提出 Memory-aware Test-time Scaling(MaTTS),在推理时投入更多算力反复尝试,并把探索过程存入记忆库。并行扩展让智能体对同一任务跑多条不同轨迹,通过自对比提炼更稳健的策略;顺序扩展在单条轨迹内反复精修,把中间推理记入记忆库。

在 WebArena 浏览器任务和 SWE-Bench-Verified 代码任务两个基准上,用 Gemini 2.5 Flash 做 ReAct 智能体,ReasoningBank 相比无记忆基线在 WebArena 上成功率高 8.3%,SWE-Bench-Verified 上高 4.6%,每项任务平均少走约 3 步;叠加 MaTTS 并行扩展(k=5)后,WebArena 成功率再提 3 个百分点,步数再少 0.4 步。

信源:https://research.google/blog/reasoningbank-enabling-agents-to-learn-from-experience/
OpenAI拟向私募股权合资公司DeployCo投入最多15亿美元

OpenAI 正与多家私募股权机构组建合资公司 DeployCo,注册于特拉华州,OpenAI 持多数股权和超级投票权股份。OpenAI 先注入 5 亿美元股权,后续有权追加 10 亿美元;TPG、贝恩资本、Advent International、博枫(Brookfield)和 Goanna Capital 另外注入 40 亿美元。DeployCo 预计 5 月初完成融资,估值 100 亿美元。

DeployCo 目前由 OpenAI 前 COO Brad Lightcap 管理,已开始招聘自有员工,OpenAI 同时派人借调。Lightcap 此前主导招募了数十名「前线部署工程师」(forward deployed engineers),嵌入客户公司内部帮助落地技术,该模式最早由 Palantir 开创。

DeployCo 的商业模式是向 PE 机构旗下被投企业收费,帮它们将 AI 嵌入业务流程。PE 投资者锁定 5 年,OpenAI 保证每年至少 17.5% 的回报率,知情人士称「这是底线,实际预期远高于此」。DeployCo 持有的 OpenAI 股权未来还可用于收购技术和知识产权。

OpenAI 高管将当前局面描述为 AI 的「能力过剩」(capability overhang):模型能力远超实际使用程度。首席营收官 Denise Dresser 本月在内部销售邮件中称,企业用 AI 的最大瓶颈不是技术,而是「能不能部署下去」。OpenAI 还在同步与麦肯锡和埃森哲合作推动企业采用。Anthropic 也在与黑石和 Hellman & Friedman 谈判类似的合资方案,计划组建 AI 部署咨询公司。

信源:https://www.ft.com/content/87727c4e-05c4-4d84-a9de-4190a9d681a6
Hugging Face开源ml-intern,自动读论文、选数据、跑训练的ML研究代理

Hugging Face 开源 ml-intern,一个能自主完成「读论文、整理数据集、启动 GPU 训练、评估结果、迭代改进」全流程的 ML 研究代理。项目基于自家 smolagents 框架构建,提供 CLI 和网页端两种入口,代码在 GitHub 开源。

ml-intern 的工具链围绕 Hugging Face 生态搭建:在 arXiv 和 HF Papers 上检索论文并沿引用链深读;浏览 HF Hub 上的数据集,检查质量后重新格式化再投入训练;本地没有 GPU 时可调用 HF Jobs 启动云端训练任务,训练结束后自动读取评估输出、诊断失败原因并重跑。默认调用 Claude Sonnet 4.5 驱动决策循环,单次最多迭代 300 轮,上下文超过 170k token 自动压缩。

Hugging Face 在发布帖中给出三个案例。科学推理任务中,代理从基准论文的引用链里找到 OpenScience 和 NemoTron-CrossThink 数据集,从 ARC、SciQ、MMLU 中按难度过滤出 7 个变体,在 Qwen3-1.7B 上跑了 12 轮 SFT,GPQA 得分从 10% 提到 32%,耗时不到 10 小时。医疗场景中,代理判断现有数据集质量不够,自行编写脚本生成 1100 条合成数据并扩增 50 倍用于训练,在 HealthBench 上超过 Codex 60%。竞赛数学场景中,代理自行编写 GRPO 训练脚本并在 A100 上通过 HF Spaces 启动训练,观测到奖励塌缩后跑消融实验排查原因。

信源:https://github.com/huggingface/ml-intern
1
AirJelly上线桌面端主动式AI助手,以Enter键为锚点捕捉用户意图

前字节跳动产品经理柏特创立的持续低熵(Low Entropy AI)发布桌面 AI 助手 AirJelly,已获五源资本融资。柏特此前在字节主导了上下文工程产品 MineContext,随后带着原团队离职创业,团队共 11 人,均在北京线下办公。

AirJelly 不做全量屏幕录制,而是以 Enter 键为锚点:用户每次按下 Enter 时截取屏幕,同时通过 Accessibility 权限获取当前应用、输入框类型和上下文,将这些信息建模为 Event,再由 AI 归纳成 Task。相比此前 MineContext 每天约 1500 张截图的全量方案,Enter 机制将截图量压缩到约 300 张,成本降至五分之一,同时减少了无关截图带来的误判。

记忆系统分两层:静态信息建模为 Entity(人物、项目等),动态信息建模为 Task,每个 Task 包含标题、摘要、进度、下一步和关联 Event。召回时综合向量检索、关键词检索和时间衰减权重,数据全部存在本地。在此基础上,AirJelly 会判断 Task 更新是否达到推送阈值,主动向用户推荐下一步操作,团队称之为 Proactive 触发。

底层 agent 执行能力接入了 OpenClaw 的 Pi 框架,结合 MineContext 的屏幕理解能力。产品目前支持 macOS,Windows 和 Linux 版本在开发中,可在 airjelly.ai 免费下载。团队下一步计划推出「Next Enter Prediction」功能,基于历史行为轨迹预测用户下一次 Enter 要输入的内容,以及支持多人协作的团队版。

信源:https://x.com/airjellyAI/status/2046621478662402498
分析:SpaceX与Cursor的600亿期权实为编码数据对赌

AI 模型评估公司 PatronusAI 联合创始人 Anand Kannappan 在 X 发文,认为外界把 SpaceX 与 Cursor 的交易当成并购是误读,核心是一场实验:开发者行为数据到底是不是编码模型的真正瓶颈。

按他的分析,xAI 的 Grok 在编码能力上一直追不上 Claude Code 和 Codex,而 Cursor 手握全球规模最大的开发者操作轨迹。交易让 Cursor 在 SpaceX 的 Colossus 超算上训练自家 Composer 模型,xAI 同时用相同数据训练 Grok,双方一起验证 Cursor 的数据能否拉开差距。

他认为期权结构正是为这种不确定性定价:数据有用,SpaceX 以 600 亿美元买下 Cursor 和整条管线;没用,付 100 亿美元当实验费。他总结称,一家准上市公司刚为「开发者轨迹是否是编码 Agent 的稀缺资源」标了价,100 亿是实验成本,600 亿是答案为「是」时的估值。

信源:https://x.com/anandnk24/status/2046784367456841969