动察Beating AI News
3.69K subscribers
1.44K photos
4 videos
1 file
4.41K links
AI新闻信息流
Download Telegram
LoopX升到1.0:一个页面管Codex、Claude Code等Agent长任务

开源项目 LoopX 发布 1.0。它装在 Codex、Claude Code、Cursor 等 Agent 上层,把原本分散在不同会话里的长期任务统一收进一个工作台。

用户可以在一个页面看到所有已接入 LoopX 的任务。哪些正在执行、哪些等你确认、哪些在持续监控、哪些已经排期,都会集中显示。进入单个项目后,还能继续查看不同 Agent 的待办、完成记录、文件和运行状态。

这个工作台可以直接在浏览器打开,也提供 macOS 和 Windows 桌面版。两种入口共用同一套本地服务和任务状态。它不会自动读取电脑上所有 Agent,会显示的是已经注册并接入 LoopX 的 Agent 和任务。

多个 Agent 也可以一起完成同一个目标。它们能分别认领任务、并行工作和相互接力。比如一个 Agent 做完后留下后续任务,下一个 Agent 再接着做。这里的协作靠共享任务和状态完成,并不是让多个 Agent 在一个聊天室里自由对话。

信源

动察 Beating 频道 · 动察 Beating 交流群
2👍1
Codex重置卡疑似缩水50%?Tibo:和正常额度一样

OpenAI 最近因为 GPT-6 Astra 分批上线,给晚用到的 Plus、Pro 和 Business 用户发了 Codex 额度重置卡。

但有用户发现,用卡后的额度似乎掉得特别快。他对比了重置前后各消耗 14% 周额度的记录。重置前用了约 1.14 亿输入 token、738 次模型响应;重置后只有 6360 万 token、489 次响应。据此,他推算重置卡实际只有正常周额度的一半。

不过这组数据并非严格对照。重置前后都主要跑 Astra,但推理档位和 Agent 使用方式并不一样。Codex 负责人 Tibo 随后直接否认,称重置前后的可用额度没有区别。

信源

动察 Beating 频道 · 动察 Beating 交流群
💩1
分析:2026年二季度DRAM产业营收环比大增59.5%,AI需求增长仍快于供给扩张

9 月 7 日,TrendForce 集邦咨询发布最新存储器产业研究,2026 年第二季度受一般型 DRAM(Conventional DRAM)合约价格显著上涨推动,整体 DRAM 产业营收环比增长 59.5%,达到约 1547.3 亿美元。

需求方面,随着 LLM 模型训练和 AI 推理持续刺激 AI 服务器需求,HBM3e、LPDDR5X 及高容量 RDIMM 出货量同步增长;Agentic AI 应用进一步带动不同容量规格 RDIMM 的采购需求。

供给方面,TrendForce 表示,DRAM 原厂库存目前处于低位,新增产能优先供应服务器市场,导致第二季度 DRAM 整体位元出货量仅小幅增长,供给扩张速度仍低于 AI 等应用带来的需求增长。

信源

动察 Beating 频道 · 动察 Beating 交流群
10万张Blackwell训出GPT-6 Astra,中国大模型算力差在哪?

英伟达 CEO 黄仁勋今早披露,GPT-6 Astra 训练用了约 10 万张以上 Grace Blackwell GPU,通过 NVLink72 组成高速互联集群。他还称下一批有 40 万张 GPU 上线,但没有说明具体型号和归属。

拿 Astra 当基准,中国头部模型公司的公开算力仍有明显差距。字节目前最接近,它今年通过马来西亚接入约 3.6 万张 B200。这批芯片和 Astra 使用的 GB200 同属 Blackwell 一代,但算力部署在海外。字节今年公开介绍中国境内集群时,主要使用的仍是 Hopper 架构的中国特供版 H20 和 H800。

Kimi 最近被曝通过阿里获得约 2 万张 Hopper GPU。Bloomberg 信源称具体为 H200,但阿里否认了 H200 这一型号说法。H200 属于上一代 Hopper;B200 已升级到 Blackwell。GB200 则进一步把 Grace CPU 和 Blackwell GPU 组合起来,NVL72 能把 72 张 GPU 放进同一个高速互联域。

DeepSeek 没有公布 V4 的完整训练硬件。流出的梁文锋投资者交流会转写稿称,公司 5 月约有 2 万张 H 等效算力,大部分刚刚到货,接下来采购「基本都是英伟达」。华为给 DeepSeek 的 950 产能约 1.6 万张。梁文锋称这批国产卡约相当于 4000 张 Nvidia B 系列,只够当前一代模型训练。

而 Astra 用的 Blackwell 也已经不是 Nvidia 最新一代。Vera Rubin 已进入全面量产。NVIDIA 估算,Rubin 训练大型 MoE 模型所需 GPU 数量可降到 Blackwell 的四分之一。

公开资料里,还没有中国公司披露过 10 万张同代先进 GPU 用于一次模型训练的案例。所以中美 AI 公司现在公开可见的差距,已经不单纯是卡的数量。真正拉开差距的,是先进芯片的数量,以及单次训练能集中调动的规模。

动察 Beating 频道 · 动察 Beating 交流群
👍7🤡1
Anthropic 11个月狂签5170亿美元算力,但规模仍可能低于OpenAI

The Information 统计发现,Anthropic 过去 11 个月新签下至少 14.8GW 算力,未来几年可以陆续使用。按目前公开合同估算,潜在总成本最高达到 5170 亿美元,大部分支出会发生在未来十年。加上去年 10 月前已经锁定的 1–2GW,Anthropic 已签下的算力总规模约 16GW。

这轮扩张主要是被 Claude 的需求推着走。今年 Claude Code 和 Cowork 增长超出 Anthropic 预期,公司开始集中抢算力。Amazon 新协议最高提供 5GW,Google 和 Broadcom 再提供 5GW;Microsoft 和 NVIDIA 最高约 1GW。Anthropic 还租下 SpaceX Colossus 1 全部算力,一次拿到超过 22 万张 NVIDIA GPU,包括 H100、H200 和 GB200。

但这么大的投入,Anthropic 的算力规划仍可能低于 OpenAI。Anthropic 已锁定约 16GW,其中不少合同延续到 2030 年后;OpenAI 向投资者给出的目标是 2030 年达到 30GW,并预计到 2030 年累计投入约 7500 亿美元算力。

5170 亿美元是 The Information 按现有云服务、芯片和数据中心合同估出的潜在最高成本。部分算力可能延期甚至不用,一些合同还允许提前取消。

信源

动察 Beating 频道 · 动察 Beating 交流群
3
a16z这波AI押对了:Cursor、OpenRouter两笔投资价值超80亿美元

a16z 的 AI 基础设施团队 5 天内接连押中两笔收购:Cursor 被 SpaceX 收购,Stripe 宣布收购 OpenRouter。《The Information》称,这两笔投资对应的 a16z 持股价值合计已超过 80 亿美元。

其中 Cursor 的回报最夸张。2024 年,a16z 参与了 Cursor 的 6000 万美元 A 轮,当时公司估值只有 4 亿美元。如今 SpaceX 以 600 亿美元收购 Cursor。彭博此前称,a16z 是 Cursor 最大的外部股东,持股约 10%,按收购价计算价值约 60 亿美元。

回报速度也很少见。a16z 2024 年才成立首只 12.5 亿美元基础设施专项基金。《The Information》称,Cursor 和 OpenRouter 两笔交易已经足以让相关基金返还 LP(基金出资人)的全部本金,还能额外分钱。VC 基金通常按十年周期看回报。

a16z 接下来准备继续押 AI 基础设施。今年它又募了 17 亿美元基础设施基金,最近还新筹 11 亿美元专门投 AI 硬件。AI 基础设施负责人 Martin Casado 称,几年前他接触的创业项目里只有约 5% 做硬件,现在已经接近 20%。

信源

动察 Beating 频道 · 动察 Beating 交流群
谷歌澄清Antigravity封号不会连Google账号一起封

谷歌修改了 Antigravity 服务条款。用 OpenClaw 等第三方工具通过 Antigravity OAuth 接入,依然属于违规;但新版已经明确,这类违规可能被暂停或终止的是 Antigravity 和/或 Gemini CLI 账号,不是整个 Google 账号。

此前条款只写「your account」,处罚范围容易让人误解为连带整个 Google 账号。这轮争议由知名开发者、T3 Code 创始人 Theo Browne 和《The Pragmatic Engineer》作者 Gergely Orosz 带起来。两人都警告,拿 Gemini 订阅去第三方工具里用,可能导致整个 Google 账号被封。Antigravity 负责人 Varun Mohan 随后回应,这个说法不对,是条款写得不清楚,并承诺修改。现在新版条款明确了处罚的边界。

不过核心限制一点没松。谷歌 FAQ 仍明确禁止 Claude Code、OpenClaw、OpenCode 等第三方工具使用 Antigravity 登录。想在第三方 coding agent 里调用 Gemini,官方建议改用 Vertex AI 或 AI Studio API Key。事实上,今年 2 月谷歌就曾因此大规模封禁,后来重置了首轮封禁并增加申诉流程。

信源

动察 Beating 频道 · 动察 Beating 交流群
👎7💩3
华为30B端侧MoE正式落地Mate XT 2

华为正式把一款总参数 30B、激活参数 2B 的端侧 MoE 大模型落地新一代三折叠手机 Mate XT 2。华为称,这是「行业首个端侧 MoE 全模态大模型」。模型运行在新发布的麒麟 9050 Pro 上,由达芬奇架构 NPU 提供端侧算力。

这套 30B/2B 端侧模型其实早在 6 月就已经预告。华为当时称,它针对麒麟芯片专门优化,并通过专家预测等技术降低内存占用、提高推理吞吐,计划秋季进入麒麟芯片和手机。

动察 Beating 频道 · 动察 Beating 交流群
Serenity:AI算力需求下激光器厂商或具备更大扩张空间,Lumentum案例值得关注

9 月 7 日,Serenity 发文表示,此前基于 Sivers(SIVE)每年 1 亿颗 CW DFB 激光器产能目标进行的收入测算仅是示意性模型,而其看好激光器公司的更重要原因在于,这类企业并不局限于单一激光器产品,可以进一步向数据中心光通信的其他环节扩张。

Serenity 以 Lumentum(LITE)为例称,其此前收购 Cloud Light(主要涉及可插拔光模块)后,能够将数据中心内的潜在服务市场扩大至此前的 5 倍以上;Lumentum 的 OFC 演示材料还显示,基于 UHP 激光芯片的 ELS 业务可带来约 2 倍的 TAM 扩张机会。

他同时指出,仅一家 UHP 激光晶圆厂的激光器业务,预计产能爬坡后年收入规模就可达到约 50 亿美元。结合 AAOI 提到的 CPO 激光器约 55%-65% 毛利率,激光器本身已经具备较高盈利能力。Serenity 认为,即使行业持续扩产,激光器市场仍可能存在供需缺口。

此外,随着 NPO、CPO 以及 1.6T 可插拔光模块等多个技术周期重叠,激光器厂商有望持续进入新的产品市场。因此,相较于长期停留在单一供应链层级的公司,Serenity 认为市场可能应给予激光器企业更高的估值溢价。

信源

动察 Beating 频道 · 动察 Beating 交流群
Hy4 preview优化「想太多」:复杂任务轮次和Token消耗双降

腾讯混元和 WorkBuddy 给 Hy4 preview 做了一轮专项优化,已经在 WorkBuddy 全量上线。官方称,这次主要针对复杂任务里的长思考和过度自我验证,在不损失任务效果的前提下,显著减少任务轮次和输入、输出 token 消耗。

Hy4 preview 是腾讯 8 月底发布的开源旗舰 MoE,总参数 770B、激活参数 49B,支持 1M 上下文,重点面向代码、办公和科研等长任务。腾讯发布时就主动把「复杂任务长思考、过度自我验证」列为已知问题。

信源

动察 Beating 频道 · 动察 Beating 交流群
腾讯开源TeamAI:用一个Git仓库统一Claude Code、Codex等Agent配置

腾讯开源了 TeamAI CLI,把 Claude Code、Codex、Cursor、WorkBuddy 等不同 Agent 的 Skills、Rules、Hooks、MCP 配置统一放进一个 Git 仓库管理。同一套配置可以自动写入不同 Agent 各自的目录和原生格式,每次启动会话还能自动拉取最新版本。

它也把团队经验接进了这套流程。开发者踩坑后的经验可以沉淀进知识库,后续由 Agent 自动检索复用;团队成员修改 Skill 或 Rule 后,可以继续走 Git 的 MR 审核,合并后再同步给其他人。

信源

动察 Beating 频道 · 动察 Beating 交流群
Codex远程控制现在可直接遥控Linux服务器

OpenAI 的 Codex 已经支持用手机直接控制 Linux 服务器上的 Agent。在服务器运行 codex remote-control start,再用 codex remote-control pair 生成临时配对码。手机打开 ChatGPT 的 Remote 页面输入配对码,就能连接这台机器。Codex 仍在服务器本地运行,手机负责查看任务、发新指令和处理审批。

这对 GPU 集群和无界面的 Linux 服务器尤其有用。研究者 Tanishq Mathew Abraham 就用它从手机管理 Slurm GPU 集群上的自动研究实验和训练任务。社区里也已经有人在 Ubuntu、Arch Linux 等环境跑通。

不过这个功能目前仍被 OpenAI 标成 Experimental。官方文档也还没完全跟上:Developer Commands 已经列出 CLI 配对方法,Remote Connections 主文档却仍写着手机配对需要从 Mac 或 Windows 桌面 App 发起。GitHub 上也还有 Linux 与 Android 配对失败、设备不显示等报告。

信源

动察 Beating 频道 · 动察 Beating 交流群
👍3
AlphaGo团队老将离开DeepMind创业:把AlphaGo式推理搬进机器人

谷歌 AlphaGo 团队老将 Thore Graepel 已离开 Google DeepMind,准备创业做机器人。方向是把「AlphaGo 式推理」带到物理世界,让机器人能在不确定环境中自己规划和行动。

Graepel 2015 年加入 DeepMind,参与 AlphaGo、AlphaZero 和 MuZero。2021 年转投 Altos Labs,2025 年又回到 DeepMind 的 Post-AGI 团队。新公司的名字、融资规模和联合创始人目前都没有公开。

信源

动察 Beating 频道 · 动察 Beating 交流群
OpenAI CEO:GPT-6Astra让每个人拥有天才级员工,AI时代迎来「创意人士的复仇」

据 AXIOS 报道,OpenAI 首席执行官 Sam Altman 表示,当前时代正迎来「创意人士」的复仇——那些曾经令人厌烦、空有创业想法却缺乏技术能力去实现的有志创业者。

这就像说「我有一个很好的歌曲创意,只需要那个拿吉他的人帮我做出来」一样。「我以前确实觉得这很可笑,」Altman 在北卡罗来纳州教堂山表示,「但现在我们看到整整一代人以前所未有的速度迭代创意。创办小型或大型企业的经济逻辑已经被重新定义。」

民调显示多数美国人认为 AI 风险大于收益,数据中心问题已成为中期选举中两党共同的争议焦点。正试图在强烈反对声中推广 AI 的 Altman 希望提醒美国人,在诸多现实风险之中,AI 也意味着机会。「这将是世界上创办初创公司最好的时代,」Altman 近期表示。

Altman 表示,借助 OpenAI 强大的新模型 GPT-6 Astra,你可以有效地创办和运营一家小企业……任何想拥有公司的人,现在在每个专业领域都拥有天才级的员工。

动察 Beating 频道 · 动察 Beating 交流群
知乎豪掷15亿元成立AI子公司,AI布局从产品试水迈向独立业务载体

知乎近日成立北京智者探索科技有限公司,注册资本 15 亿元,法定代表人为知乎创始人周源。新公司由知乎境内核心运营主体北京智者天下科技有限公司全资持股,经营范围涵盖大数据服务、互联网数据服务、人工智能基础软件及应用软件开发等。

值得注意的是,15 亿元属于股东认缴的注册资本,并不等同于知乎已实际投入 15 亿元现金。目前智者探索的实缴金额、出资方式及具体业务规划尚未披露。

此次设立新公司正值知乎加速推进 AI 商业化。知乎已将 AI 业务拓展至 AI 搜索、品牌内容资产、专家数据解决方案及开发者工具等领域,但管理层此前表示,相关 AI 业务仍处于商业验证阶段,尚未形成稳定、规模化收入。

信源

动察 Beating 频道 · 动察 Beating 交流群
2
OpenAI Astra发布再点燃AI算力热情,存储芯片成新主线

OpenAI 最新旗舰模型 Astra 发布再度点燃市场对 AI 基础设施的热情,存储芯片成为率先受益的板块。美股半导体股上周五集体走强,美光科技涨超 6%、闪迪涨近 12%;周一亚洲市场延续涨势,SK 海力士涨约 8%、三星电子涨超 5%、铠侠涨约 10%。

机构认为,随着前沿 AI 模型能力持续提升,算力需求将进一步增长,存储和网络环节的瓶颈也可能加剧,HBM、DRAM 等有望重新成为 AI 基础设施交易的重要主线。高盛和摩根士丹利预计,2027 年全球 AI 资本支出将达到 1.3 万亿至 1.5 万亿美元,其中超过一半或将用于内存建设。

盛宝银行首席投资策略师 Charu Channa 表示,Astra 的发布进一步支持 AI 支出持续增长,前沿模型不断提升的算力需求将利好 SK 海力士、三星电子等存储芯片厂商。

随着 AI 模型越来越强,单纯关注 GPU 的「算力交易」正在向 HBM、DRAM 等「存储交易」扩散,存储芯片或成为新一轮 AI 基础设施投资的重要受益环节。

信源

动察 Beating 频道 · 动察 Beating 交流群
消息称英特尔CPU将再涨价10%

供应链人士透露,因应整体成本飙升,英特尔 (INTC.O)PC CPU 过去 1 年来已陆续涨价,暂定 10 月上旬再涨 10%。在 PC 终端市场 2027 年预估小幅衰退的情况下,英特尔仍选择调高 CPU 价格,显见拉升毛利率为首要目标,过往杀价抢市占已不复见。

供应链分析,若英特尔将低毛利率设定为产品去留的重要门槛,势必有部分产品被迫退出。这些需求一旦释出,恐令联发科、高通等 Arm 阵营业者有机会切入。尤其在 IPC、边缘运算及 IoT 市场,Arm SoC 具备高整合度及低功耗优势。

动察 Beating 频道 · 动察 Beating 交流群
💩5
张一鸣亲自盯字节世界模型:Seedance底座实时生成可交互世界

彭博援引知情人士称,字节跳动正在开发一款实时空间视频模型,最快 10 月发布,由创始人张一鸣亲自督导。模型建立在 Seedance 之上,目标是边生成边响应用户的声音和动作,实时形成可交互的虚拟世界。

这套模型计划与 Pico 头显结合。知情人士称,它可在云端以约 20 帧/秒生成内容,延迟约 0.05 秒。把主要计算放到云端,可以降低头显本身的算力要求。除了 VR,字节还准备把它用于直播、短剧和游戏。

这并不是字节突然转向世界模型。36 氪今年 6 月就披露,世界模型是字节 2026 年 AI 四大重点之一,目标年底前至少发布一版,对标 Google Genie 3。Genie 3 已能以 20–24 帧/秒生成 720p 可交互世界,并连续运行数分钟。

信源

动察 Beating 频道 · 动察 Beating 交流群
👍42
Astra太烧额度,OpenAI给所有付费用户再重置一轮

OpenAI 已经给所有付费订阅统一重置一次使用额度。核心产品负责人 Tibo Sottiaux 称,目的是让已经把额度用光的用户继续跑 GPT-6 Astra。

Astra 上线后,社区一直在抱怨额度消耗太快。有 Plus 用户称,Astra 跑半小时左右就能耗掉整周额度;也有人报告单个任务就撞上 5 小时限制。Tibo 前一天刚把重度场景的订阅额度消耗最多压低到原来的约 1/3 至 1/4,现在又直接补了一次全局重置。

信源

动察 Beating 频道 · 动察 Beating 交流群
DeepSeek再招约150名后端,重点补Agent基础设施

DeepSeek 新开放约 150 个社招名额,集中在服务端开发工程师和 Agent 弹性计算研发工程师两个岗位。这批人主要负责大模型研究平台、Agent 框架、研发基建、API、线上服务、数据工程,以及 Agent 的底层运行环境。

DeepSeek Harness 团队负责人崔添翼解释,数据、机器和容器、训练任务、评测任务、Agent 环境、用户和请求量都在快速增加。原有后端系统逐渐无法满足未来规模,需要大量工程师继续升级、维护和重写。

其中一个重点是 DSec,也就是 DeepSeek 给 Agent 搭的弹性计算平台。Agent 执行代码、调用工具时,可以在这里批量获得相互隔离的运行环境。DeepSeek-V4 技术报告显示,单个 DSec 集群已经能同时运行数十万个沙箱。新岗位还要继续优化操作系统、虚拟机、网络、存储和调度等底层系统。

信源

动察 Beating 频道 · 动察 Beating 交流群
🐳4
Anthropic放弃以60亿美元收购AI初创公司Decart

据彭博社报道,知情人士透露,Anthropic 已决定不再推进对人工智能初创公司 Decart AI 的收购。Anthropic 此前曾研究相关交易并对 Decart 进行尽职调查,但最终选择退出,双方未来仍可能探索其他合作机会。

Anthropic 和 Decart 的代表均拒绝置评。彭博社此前报道称,Claude 开发商 Anthropic 曾商谈以约 60 亿美元收购 Decart,但交易尚未最终敲定。

Decart 主要开发提升芯片运行效率的软件,以降低人工智能模型的训练及运行成本。Anthropic 较少进行大型收购,目前正持续投入算力以开发新产品、服务客户,并为备受关注的上市计划做准备。

信源

动察 Beating 频道 · 动察 Beating 交流群