腾讯高管回应AI慢了:算力不足已拖慢混元
腾讯集团高级执行副总裁、云与智慧产业事业群 CEO 汤道生发长文,正面回应「腾讯做 AI 慢了」。他承认公司内部确实焦虑,友商过去几年声势更强。更直接的是,腾讯整体算力「严重不足」,已经拖慢混元模型训练和产品发展,「产生了比较大的影响」。
但汤道生认为,现在可能只是 AI 马拉松的头一公里,「熬得久比起得早更重要」。他预告下一代混元 Hy4 会有更多突破,同时认为腾讯不能只拼基础模型。算法决定上限,工程决定落地速度,微信系办公、文档、会议和企业服务等真实场景才是腾讯最大的牌。
他还少见地复盘了几次失误。元宝过去一年为了用户增长投入大量推广,但当时「模型与产品都还没 ready」,效果并不满意。CodeBuddy 和 WorkBuddy 也不是提前规划好的成功路线,早期 DevTools 长期亏损,一度差点被砍。
WorkBuddy 后来踩中 Agent 浪潮,上线三个月迭代 40 多个版本。汤道生称,团队现在大量用 AI 写代码,人主要负责判断、调试和把关。他判断未来产品、开发、测试的边界都会越来越模糊,小团队借助 AI 就能完成过去大团队才能做的事情。
信源
动察 Beating 频道 · 动察 Beating 交流群
腾讯集团高级执行副总裁、云与智慧产业事业群 CEO 汤道生发长文,正面回应「腾讯做 AI 慢了」。他承认公司内部确实焦虑,友商过去几年声势更强。更直接的是,腾讯整体算力「严重不足」,已经拖慢混元模型训练和产品发展,「产生了比较大的影响」。
但汤道生认为,现在可能只是 AI 马拉松的头一公里,「熬得久比起得早更重要」。他预告下一代混元 Hy4 会有更多突破,同时认为腾讯不能只拼基础模型。算法决定上限,工程决定落地速度,微信系办公、文档、会议和企业服务等真实场景才是腾讯最大的牌。
他还少见地复盘了几次失误。元宝过去一年为了用户增长投入大量推广,但当时「模型与产品都还没 ready」,效果并不满意。CodeBuddy 和 WorkBuddy 也不是提前规划好的成功路线,早期 DevTools 长期亏损,一度差点被砍。
WorkBuddy 后来踩中 Agent 浪潮,上线三个月迭代 40 多个版本。汤道生称,团队现在大量用 AI 写代码,人主要负责判断、调试和把关。他判断未来产品、开发、测试的边界都会越来越模糊,小团队借助 AI 就能完成过去大团队才能做的事情。
信源
动察 Beating 频道 · 动察 Beating 交流群
❤1✍1
OpenAI今年至少14名高层离任,IPO前还在大换血
OpenAI 今年已有至少 14 名高层和核心负责人离开原职。Business Insider 截至 8 月 21 日统计了 13 人,《华尔街日报》随后又披露数据中心负责人 Chris Malone 离职。
这批人横跨商业、产品、安全、伦理、研究和基础设施。
具体包括:
1. Denise Dresser:首席营收官,8 月宣布离职。
2. Brad Lightcap:前 COO、特殊项目负责人,离职创业。
3. Fidji Simo:应用业务 CEO,因健康原因卸任全职工作,转为兼职顾问。
4. Kevin Weil:前 CPO、OpenAI for Science 负责人,离职创业。
5. Bill Peebles:Sora 负责人,4 月离职。
6. Srinivas Narayanan:企业应用 CTO,4 月离职。
7. Kate Rouch:首席营销官,因治疗乳腺癌卸任。
8. Barret Zoph:企业 AI 销售负责人,回归 OpenAI 约 5 个月后再次离职。
9. Chloé Bakalar:伦理负责人,加入不到一年离职。
10. Johannes Heidecke:安全系统负责人,在安全团队重组期间离职。
11. Joshua Achiam:首席未来学家、前使命对齐负责人,在 OpenAI 工作近 9 年后离开。
12. Caitlin Kalinowski:机器人和消费硬件负责人,因不满五角大楼合作的治理方式辞职。
13. Kaylin Voss:美洲销售副总裁,在 Dresser 离职后一周辞职。
14. Chris Malone:数据中心负责人,在基础设施团队调整后离职。
这些人并不是因为同一个原因集体出走。有人创业,有人因健康离岗,也有人碰上团队裁撤和管理层重组。这轮调整也被部分内部人士视为管理层主动换血。
OpenAI 已在 6 月秘密递交美国 IPO 文件,现在商业、安全、研究和基础设施又连续换负责人,显然上市前的组织稳定性比不上对手 Anthropic。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 今年已有至少 14 名高层和核心负责人离开原职。Business Insider 截至 8 月 21 日统计了 13 人,《华尔街日报》随后又披露数据中心负责人 Chris Malone 离职。
这批人横跨商业、产品、安全、伦理、研究和基础设施。
具体包括:
1. Denise Dresser:首席营收官,8 月宣布离职。
2. Brad Lightcap:前 COO、特殊项目负责人,离职创业。
3. Fidji Simo:应用业务 CEO,因健康原因卸任全职工作,转为兼职顾问。
4. Kevin Weil:前 CPO、OpenAI for Science 负责人,离职创业。
5. Bill Peebles:Sora 负责人,4 月离职。
6. Srinivas Narayanan:企业应用 CTO,4 月离职。
7. Kate Rouch:首席营销官,因治疗乳腺癌卸任。
8. Barret Zoph:企业 AI 销售负责人,回归 OpenAI 约 5 个月后再次离职。
9. Chloé Bakalar:伦理负责人,加入不到一年离职。
10. Johannes Heidecke:安全系统负责人,在安全团队重组期间离职。
11. Joshua Achiam:首席未来学家、前使命对齐负责人,在 OpenAI 工作近 9 年后离开。
12. Caitlin Kalinowski:机器人和消费硬件负责人,因不满五角大楼合作的治理方式辞职。
13. Kaylin Voss:美洲销售副总裁,在 Dresser 离职后一周辞职。
14. Chris Malone:数据中心负责人,在基础设施团队调整后离职。
这些人并不是因为同一个原因集体出走。有人创业,有人因健康离岗,也有人碰上团队裁撤和管理层重组。这轮调整也被部分内部人士视为管理层主动换血。
OpenAI 已在 6 月秘密递交美国 IPO 文件,现在商业、安全、研究和基础设施又连续换负责人,显然上市前的组织稳定性比不上对手 Anthropic。
信源
动察 Beating 频道 · 动察 Beating 交流群
The Wall Street Journal
Exclusive | OpenAI’s Head of Data Centers Has Left the Company
Malone joins a string of recent high-level executive departures as the AI giant heads toward an IPO and ramps up its spending on computing power.
😁1
ChatGPT Business上新100美元高级席位:价格5倍,用量也5倍
OpenAI 正式开放 ChatGPT Business Premium 席位。按年付费每人每月 100 美元,按月付则是 125 美元。标准席位仍为 20 和 25 美元,Premium 价格正好是 5 倍,用量也提高到 5 倍,还取消了 5 小时使用限制。
公司可以给普通员工买 Standard,只给重度用户上 Premium,不需要全员一起升级。两档都能用 ChatGPT、ChatGPT Work 和 Codex,管理员还能随时调整席位。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 正式开放 ChatGPT Business Premium 席位。按年付费每人每月 100 美元,按月付则是 125 美元。标准席位仍为 20 和 25 美元,Premium 价格正好是 5 倍,用量也提高到 5 倍,还取消了 5 小时使用限制。
公司可以给普通员工买 Standard,只给重度用户上 Premium,不需要全员一起升级。两档都能用 ChatGPT、ChatGPT Work 和 Codex,管理员还能随时调整席位。
信源
动察 Beating 频道 · 动察 Beating 交流群
❤3👍1
港股「AI双雄」遭创纪录做空:MiniMax空仓比例冲到20%
中国两家上市大模型公司 MiniMax 和智谱 AI 的做空仓位同时创历史新高。S&P Global 数据显示,MiniMax 被做空的股份已相当于自由流通股的 20%,智谱约 6%。MiniMax 将在 8 月 26 日港股收盘后发半年报,智谱则在 8 月 31 日交成绩单,空头正在财报前加码。
两家公司年初上市时都被热炒。到现在,智谱仍比发行价高超 800%,MiniMax 高超 80%,但都已从峰值跌去一半以上。7 月 Kimi K3 发布后,智谱和 MiniMax 分别一度跌约 24% 和 18%。智谱后来发 GLM-5.3,Jefferies 认为其性能接近 Kimi K3、单任务成本还低约 19%,股价仍没明显反弹。
股票供给也在增加。7 月 IPO 锁定期结束,智谱和 MiniMax 分别有 2568 万和 1.5 亿股解禁,按当时价格合计约 115 亿美元。另一边,南向资金仍在接盘,持股已升至智谱约 12%、MiniMax 约 8.1%,但没把股价拉回去。
分析师对两家的担心也不同。Hedgeye 认为,智谱被价格战压住提价和利润空间;MiniMax 则「既不是最聪明,也不是最便宜」。接下来两份半年报要回答的,是一个问题:纯大模型公司能不能在越来越便宜的竞争里赚到钱。
信源
动察 Beating 频道 · 动察 Beating 交流群
中国两家上市大模型公司 MiniMax 和智谱 AI 的做空仓位同时创历史新高。S&P Global 数据显示,MiniMax 被做空的股份已相当于自由流通股的 20%,智谱约 6%。MiniMax 将在 8 月 26 日港股收盘后发半年报,智谱则在 8 月 31 日交成绩单,空头正在财报前加码。
两家公司年初上市时都被热炒。到现在,智谱仍比发行价高超 800%,MiniMax 高超 80%,但都已从峰值跌去一半以上。7 月 Kimi K3 发布后,智谱和 MiniMax 分别一度跌约 24% 和 18%。智谱后来发 GLM-5.3,Jefferies 认为其性能接近 Kimi K3、单任务成本还低约 19%,股价仍没明显反弹。
股票供给也在增加。7 月 IPO 锁定期结束,智谱和 MiniMax 分别有 2568 万和 1.5 亿股解禁,按当时价格合计约 115 亿美元。另一边,南向资金仍在接盘,持股已升至智谱约 12%、MiniMax 约 8.1%,但没把股价拉回去。
分析师对两家的担心也不同。Hedgeye 认为,智谱被价格战压住提价和利润空间;MiniMax 则「既不是最聪明,也不是最便宜」。接下来两份半年报要回答的,是一个问题:纯大模型公司能不能在越来越便宜的竞争里赚到钱。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁4
Agent也要分苹果MD、安卓MD?Claude偏要自己搞一套
Shopify CEO Tobi Lütke 正考虑在公司禁用 Claude Code。不是 Claude 不好用,而是它偏要用自己的 CLAUDE.md。
Shopify 同时用 Claude Code、Codex 等多种 Agent。其他工具可以共用 AGENTS.md,Claude Code 却只读 CLAUDE.md。两套文件还会在大型代码仓库里层层递归。哪一层漏同步一个,就有人拿到错误的规则。Shopify 已经专门写自动化检查兜底,Tobi 觉得这纯属没事找事。
他的要求其实很简单:Claude Code 也读 AGENTS.md,大家维护一份就够了。
Claude Code 团队成员 Thariq 回应说,他们会让 AGENTS.md 更容易使用。但话锋一转,又开始解释为什么 Claude 需要自己的 prompt、Skills 和 CLAUDE.md:模型之间不一样,专门优化效果更好。短期办法也还是在 CLAUDE.md 里引用 AGENTS.md。
这就没解决 Tobi 的问题。你可以继续给 Claude 做专属优化,但为什么项目规则非得再维护一个 Claude 专用入口?
Grok 按此前泄露的 Claude Code 源码看了一遍,结论是 CLAUDE.md 的文件名就是硬编码在加载逻辑里,直接换成 AGENTS.md,原来的递归发现、加载和引用机制照样能跑,不需要什么架构大改。
说白了,AGENTS.md 不是不能用,Claude Code 只是非得再留一个自己的 CLAUDE.md。
评论区也基本站 Tobi。DHH 说这区别完全没必要,Jesse Pollak 说很烦,Chamath Palihapitiya 认为继续搞两套一定会「脑裂」。Kun Chen 说正确做法应该是默认读 AGENTS.md,真需要 Claude 专属优化,再把 CLAUDE.md 留成可选项,而不是反过来。
信源
动察 Beating 频道 · 动察 Beating 交流群
Shopify CEO Tobi Lütke 正考虑在公司禁用 Claude Code。不是 Claude 不好用,而是它偏要用自己的 CLAUDE.md。
Shopify 同时用 Claude Code、Codex 等多种 Agent。其他工具可以共用 AGENTS.md,Claude Code 却只读 CLAUDE.md。两套文件还会在大型代码仓库里层层递归。哪一层漏同步一个,就有人拿到错误的规则。Shopify 已经专门写自动化检查兜底,Tobi 觉得这纯属没事找事。
他的要求其实很简单:Claude Code 也读 AGENTS.md,大家维护一份就够了。
Claude Code 团队成员 Thariq 回应说,他们会让 AGENTS.md 更容易使用。但话锋一转,又开始解释为什么 Claude 需要自己的 prompt、Skills 和 CLAUDE.md:模型之间不一样,专门优化效果更好。短期办法也还是在 CLAUDE.md 里引用 AGENTS.md。
这就没解决 Tobi 的问题。你可以继续给 Claude 做专属优化,但为什么项目规则非得再维护一个 Claude 专用入口?
Grok 按此前泄露的 Claude Code 源码看了一遍,结论是 CLAUDE.md 的文件名就是硬编码在加载逻辑里,直接换成 AGENTS.md,原来的递归发现、加载和引用机制照样能跑,不需要什么架构大改。
说白了,AGENTS.md 不是不能用,Claude Code 只是非得再留一个自己的 CLAUDE.md。
评论区也基本站 Tobi。DHH 说这区别完全没必要,Jesse Pollak 说很烦,Chamath Palihapitiya 认为继续搞两套一定会「脑裂」。Kun Chen 说正确做法应该是默认读 AGENTS.md,真需要 Claude 专属优化,再把 CLAUDE.md 留成可选项,而不是反过来。
信源
动察 Beating 频道 · 动察 Beating 交流群
💩9
ChatGPT Work终于能进账号替你干活了,密码还不用给它
OpenAI 给 ChatGPT Work 加了个很实用的新能力:现在能登录网站,进你的账号继续干活。
以前 Work 碰到登录页就会停。现在它会把登录界面交给你,你自己输入账号、密码和验证码。登录完成后,它再接着操作。OpenAI 称,ChatGPT 看不到你的密码,也不会保存。
这一下能干的事多了很多。查保险报销、预约 DMV、找房、退货、交发票,甚至处理小企业后台都可以。凡是平时需要你自己打开浏览器一路点进去做的事,都可以试着交给 ChatGPT Work。
目前这项功能正向 Plus、Pro 和 Business 用户推送。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 给 ChatGPT Work 加了个很实用的新能力:现在能登录网站,进你的账号继续干活。
以前 Work 碰到登录页就会停。现在它会把登录界面交给你,你自己输入账号、密码和验证码。登录完成后,它再接着操作。OpenAI 称,ChatGPT 看不到你的密码,也不会保存。
这一下能干的事多了很多。查保险报销、预约 DMV、找房、退货、交发票,甚至处理小企业后台都可以。凡是平时需要你自己打开浏览器一路点进去做的事,都可以试着交给 ChatGPT Work。
目前这项功能正向 Plus、Pro 和 Business 用户推送。
信源
动察 Beating 频道 · 动察 Beating 交流群
公关战打进 ChatGPT:以色列资助「智库」批量抢 AI 引用
以色列政府资助的 Hanover Institute for Public Policy 被曝批量生产「研究报告」,目标之一是进入 ChatGPT、Perplexity 这类 AI 的搜索结果。网站自 8 月 6 日以来已发出 100 多篇以巴议题文章,没有作者署名,大量标题直接写成用户会问 AI 的问题。Hanover 还提供 llms.txt,把整站内容整理成方便机器读取的索引。
Politico 用中性问题测试时,ChatGPT 和 Perplexity 已多次引用 Hanover。404 Media 和 Responsible Statecraft 还分别用 AI 检测器抽查文章,多数被判为 AI 生成。
幕后公关公司 Piro 公开售卖「AI Story Optimization」服务,会分析 Reddit、YouTube、论坛、媒体等哪些页面最能影响模型答案,再专门制作更容易被 LLM(大语言模型)引用的内容。Piro 官网现在甚至直接拿 Politico 的测试结果宣传自己的服务。
美国 FARA 文件显示,Piro 通过 Havas Media 为以色列政府广告局 LaPam 做传播项目。公开文件中的两笔款项合计 100 万美元。
信源
动察 Beating 频道 · 动察 Beating 交流群
以色列政府资助的 Hanover Institute for Public Policy 被曝批量生产「研究报告」,目标之一是进入 ChatGPT、Perplexity 这类 AI 的搜索结果。网站自 8 月 6 日以来已发出 100 多篇以巴议题文章,没有作者署名,大量标题直接写成用户会问 AI 的问题。Hanover 还提供 llms.txt,把整站内容整理成方便机器读取的索引。
Politico 用中性问题测试时,ChatGPT 和 Perplexity 已多次引用 Hanover。404 Media 和 Responsible Statecraft 还分别用 AI 检测器抽查文章,多数被判为 AI 生成。
幕后公关公司 Piro 公开售卖「AI Story Optimization」服务,会分析 Reddit、YouTube、论坛、媒体等哪些页面最能影响模型答案,再专门制作更容易被 LLM(大语言模型)引用的内容。Piro 官网现在甚至直接拿 Politico 的测试结果宣传自己的服务。
美国 FARA 文件显示,Piro 通过 Havas Media 为以色列政府广告局 LaPam 做传播项目。公开文件中的两笔款项合计 100 万美元。
信源
动察 Beating 频道 · 动察 Beating 交流群
市场消息:Deepseek截至7月营收达7000万美元,较2025年增长十倍
据市场消息,Deepseek 截至 7 月营收达 7000 万美元,较 2025 年增长十倍。
动察 Beating 频道 · 动察 Beating 交流群
据市场消息,Deepseek 截至 7 月营收达 7000 万美元,较 2025 年增长十倍。
动察 Beating 频道 · 动察 Beating 交流群
Anthropic怕保安罢工直接让员工回家,工会:我们没说要罢工
Anthropic 让旧金山办公室员工周一、周二全部居家办公。原因是安保承包商 Allied Universal 提前警告,公司保安可能罢工。Anthropic 为防办公室没有安保,干脆让员工别来。
但代表这些保安的服务业雇员工会说,他们根本没发出本周罢工通知,连罢工授权投票都没有举行。双方确实从 4 月开始谈新合同,工会要求提高工资、改善医疗福利,并增加安保培训。
Anthropic 这么谨慎也有现实原因。今年 4 月,一名男子曾尾随员工闯进 Anthropic 大堂,声称公司一名高管「会被杀」;同月还有人威胁员工家属,6 月又有人因退款问题扬言带手枪去公司。上周旧金山警方接到 911 报警,称一名 Anthropic 用户威胁公司 CEO,并扬言携带 AR-15 步枪前往 500 Howard St. 的办公室,伤害在那里工作的员工。
信源
动察 Beating 频道 · 动察 Beating 交流群
Anthropic 让旧金山办公室员工周一、周二全部居家办公。原因是安保承包商 Allied Universal 提前警告,公司保安可能罢工。Anthropic 为防办公室没有安保,干脆让员工别来。
但代表这些保安的服务业雇员工会说,他们根本没发出本周罢工通知,连罢工授权投票都没有举行。双方确实从 4 月开始谈新合同,工会要求提高工资、改善医疗福利,并增加安保培训。
Anthropic 这么谨慎也有现实原因。今年 4 月,一名男子曾尾随员工闯进 Anthropic 大堂,声称公司一名高管「会被杀」;同月还有人威胁员工家属,6 月又有人因退款问题扬言带手枪去公司。上周旧金山警方接到 911 报警,称一名 Anthropic 用户威胁公司 CEO,并扬言携带 AR-15 步枪前往 500 Howard St. 的办公室,伤害在那里工作的员工。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁5
DeepSeek API毛利率高达82.9%,公司整体毛利率达44.6%
据 The Information 报道,DeepSeek 正寻求以约 5000 亿元人民币估值进行第二轮融资,计划再融资 500 亿元人民币。数据显示,2026 年 1 月至 7 月,DeepSeek 营收达到 4.75 亿元人民币(约 7070 万美元),约为其 2025 年全年营收的 10 倍;同期净亏损收窄至 7.15 亿元人民币,低于 2025 年全年的 9.35 亿元人民币。
盈利能力方面,DeepSeek 整体毛利率达 44.6%,其中 API 业务毛利率高达 82.9%,主要得益于 AI 基础设施优化,使其能够以更少芯片运行模型并维持较低推理成本。随着 V4 系列,尤其是 V4-Flash 获得全球开发者广泛采用,公司营收增长加速,上月年化营收据称已达到 4 亿至 5 亿美元。
此外,DeepSeek 近期上调 API 价格以强化商业化,V4-Pro 高峰期输出价格从 0.87 美元升至 3.96 美元,非高峰期为 1.98 美元,但仍低于 Kimi K3 的 15 美元和 Claude Opus 5 的 25 美元。与此同时,公司 AI 基础设施投入从 2025 年的 12 亿元人民币大幅增至今年前 7 个月的 110 亿元人民币,主要用于服务器租赁及 AI 芯片、算力设备采购。
DeepSeek 此前今年 6 月完成首轮外部融资,融资规模约 500 亿元人民币,目前已聘请投行筹备明年在上海 IPO。
信源
动察 Beating 频道 · 动察 Beating 交流群
据 The Information 报道,DeepSeek 正寻求以约 5000 亿元人民币估值进行第二轮融资,计划再融资 500 亿元人民币。数据显示,2026 年 1 月至 7 月,DeepSeek 营收达到 4.75 亿元人民币(约 7070 万美元),约为其 2025 年全年营收的 10 倍;同期净亏损收窄至 7.15 亿元人民币,低于 2025 年全年的 9.35 亿元人民币。
盈利能力方面,DeepSeek 整体毛利率达 44.6%,其中 API 业务毛利率高达 82.9%,主要得益于 AI 基础设施优化,使其能够以更少芯片运行模型并维持较低推理成本。随着 V4 系列,尤其是 V4-Flash 获得全球开发者广泛采用,公司营收增长加速,上月年化营收据称已达到 4 亿至 5 亿美元。
此外,DeepSeek 近期上调 API 价格以强化商业化,V4-Pro 高峰期输出价格从 0.87 美元升至 3.96 美元,非高峰期为 1.98 美元,但仍低于 Kimi K3 的 15 美元和 Claude Opus 5 的 25 美元。与此同时,公司 AI 基础设施投入从 2025 年的 12 亿元人民币大幅增至今年前 7 个月的 110 亿元人民币,主要用于服务器租赁及 AI 芯片、算力设备采购。
DeepSeek 此前今年 6 月完成首轮外部融资,融资规模约 500 亿元人民币,目前已聘请投行筹备明年在上海 IPO。
信源
动察 Beating 频道 · 动察 Beating 交流群
🔥4
前华为盘古负责人王云鹤创业再获新融资,下一步拟自训模型
前华为盘古大模型负责人王云鹤创办的基元律动完成新一轮融资,估值达数亿美元,累计融资数千万美元。本轮由弘晖基金领投。
公司主打 Routing Harness,让 Agent 干活时自动挑选、切换不同模型。旗下 OpenSquilla 在 GitHub 已有约 6400 Stars;其多模型 API 平台已有 5.4 万用户,单日 Token 调用量突破 5000 亿。
基元律动公布的评测中,一套国产多模型组合在 DRACO 研究任务上超过 Fable 5,成本约为后者三分之一。
王云鹤下一步还想自己训模型,把 Harness 积累的真实任务、模型选择和用户反馈拿去训练,从「帮 Agent 挑模型」继续做到 Agent-Native Model。
信源
动察 Beating 频道 · 动察 Beating 交流群
前华为盘古大模型负责人王云鹤创办的基元律动完成新一轮融资,估值达数亿美元,累计融资数千万美元。本轮由弘晖基金领投。
公司主打 Routing Harness,让 Agent 干活时自动挑选、切换不同模型。旗下 OpenSquilla 在 GitHub 已有约 6400 Stars;其多模型 API 平台已有 5.4 万用户,单日 Token 调用量突破 5000 亿。
基元律动公布的评测中,一套国产多模型组合在 DRACO 研究任务上超过 Fable 5,成本约为后者三分之一。
王云鹤下一步还想自己训模型,把 Harness 积累的真实任务、模型选择和用户反馈拿去训练,从「帮 Agent 挑模型」继续做到 Agent-Native Model。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁2
月之暗面和美国三大云谈Kimi K3上架分成,最高拿30%
月之暗面正和微软 Azure、AWS、Google Cloud 谈 Kimi K3 上架和收入分成。月之暗面希望拿到 K3 相关服务收入的最多 30%。谈判还在早期,不保证最终签约。
如果谈成,可能成为中国 AI 公司与美国大型云厂商之间首个大型模型分成协议。双方现在还没谈拢三件事:怎么分账、数据怎么访问,以及怎么核对 Token 用量。微软、谷歌和 AWS 均拒绝置评。
K3 虽然开放权重(模型文件可以下载),但总参数达到 2.8 万亿,普通企业很难自己部署。要真正打进企业市场,Azure、AWS、Google Cloud 这种大云才是最重要的渠道。月之暗面此前已经和部分较小云平台签过类似协议,DigitalOcean 也确认与其存在商业合作。
美国官员此前一直在施压月之暗面。美国财政部长贝森特上月还提过可能将其列入贸易黑名单。监管压力没有消失,微软、亚马逊和谷歌却都还在谈 Kimi K3 的生意。
信源
动察 Beating 频道 · 动察 Beating 交流群
月之暗面正和微软 Azure、AWS、Google Cloud 谈 Kimi K3 上架和收入分成。月之暗面希望拿到 K3 相关服务收入的最多 30%。谈判还在早期,不保证最终签约。
如果谈成,可能成为中国 AI 公司与美国大型云厂商之间首个大型模型分成协议。双方现在还没谈拢三件事:怎么分账、数据怎么访问,以及怎么核对 Token 用量。微软、谷歌和 AWS 均拒绝置评。
K3 虽然开放权重(模型文件可以下载),但总参数达到 2.8 万亿,普通企业很难自己部署。要真正打进企业市场,Azure、AWS、Google Cloud 这种大云才是最重要的渠道。月之暗面此前已经和部分较小云平台签过类似协议,DigitalOcean 也确认与其存在商业合作。
美国官员此前一直在施压月之暗面。美国财政部长贝森特上月还提过可能将其列入贸易黑名单。监管压力没有消失,微软、亚马逊和谷歌却都还在谈 Kimi K3 的生意。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍3
「牛来」模型Ox Alpha就是 GLM-5.3 Flash?预测市场超九成认定智谱
神秘模型 Ox Alpha 的身份竞猜已经明显倒向智谱。Polymarket 上,Z.ai 的概率目前超过 90%,第二名 Google 只有约 5%。Ox Alpha 是最近突然出现在 OpenRouter 上的匿名推理模型,主打编程和长时间 Agent 任务。
最硬的线索来自后端。社区开发者故意向 OpenCode 的 Ox Alpha 接口发送错误参数,服务器吐出了 com.wd.paas.api.domain.v4.chat.ChatCompletionRequest。其中的 paas/v4/chat 与 Z.ai 官方 API 路径直接对上。继续发送非法 role 时,Ox Alpha 又返回 1214 Incorrect role information,和 Z.ai 自己托管的 GLM 一致。换成 DeepInfra 托管同一 GLM 权重,报错格式就变了。
模型本身的指纹也对上了。一份公开取证跑了 600 多次请求、约 1350 万输入 Token,44 组分词器测试全部匹配 GLM-5 这一代。
动察 Beating 频道 · 动察 Beating 交流群
神秘模型 Ox Alpha 的身份竞猜已经明显倒向智谱。Polymarket 上,Z.ai 的概率目前超过 90%,第二名 Google 只有约 5%。Ox Alpha 是最近突然出现在 OpenRouter 上的匿名推理模型,主打编程和长时间 Agent 任务。
最硬的线索来自后端。社区开发者故意向 OpenCode 的 Ox Alpha 接口发送错误参数,服务器吐出了 com.wd.paas.api.domain.v4.chat.ChatCompletionRequest。其中的 paas/v4/chat 与 Z.ai 官方 API 路径直接对上。继续发送非法 role 时,Ox Alpha 又返回 1214 Incorrect role information,和 Z.ai 自己托管的 GLM 一致。换成 DeepInfra 托管同一 GLM 权重,报错格式就变了。
模型本身的指纹也对上了。一份公开取证跑了 600 多次请求、约 1350 万输入 Token,44 组分词器测试全部匹配 GLM-5 这一代。
动察 Beating 频道 · 动察 Beating 交流群
😁6🤡3
让AI迁移整个代码库,94.6%没过关:20项任务13项无人做成
AI Agent 公司 Einsia 发布 SWE Refactor Bench,专门测 Coding Agent 能不能自己迁移整个代码库。20 个任务来自 SQLite、zlib、libsodium、GraphHopper 等真实项目,包括 C 改 Rust、Maven 改 Gradle、SQLite 移植到 WASI。每项给 Agent 6~30 小时。
评测第一关检查旧技术栈是不是真的被替掉,防止 Agent 留着旧代码混过去;第二关跑超过 13 万项固定检查;最后再派 6 个独立 Coding Agent,各花 1 小时专门找隐藏 bug。
8 个前沿模型、26 种配置一共跑了 520 次。340 次确实完成迁移,88 次把预先准备的测试全部跑绿,但其中 60 次又被最后一轮找出了隐藏 bug。最终只有 28 次完全过关,通过率 5.4%;20 个任务里有 13 个没人做成。Claude Opus 5 的 xhigh 配置最好,20 个任务完整通过 5 个。
现在的 Coding Agent 已经能大规模改代码,但要做到「整个系统改完还能完全不出错」,还差得很远。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI Agent 公司 Einsia 发布 SWE Refactor Bench,专门测 Coding Agent 能不能自己迁移整个代码库。20 个任务来自 SQLite、zlib、libsodium、GraphHopper 等真实项目,包括 C 改 Rust、Maven 改 Gradle、SQLite 移植到 WASI。每项给 Agent 6~30 小时。
评测第一关检查旧技术栈是不是真的被替掉,防止 Agent 留着旧代码混过去;第二关跑超过 13 万项固定检查;最后再派 6 个独立 Coding Agent,各花 1 小时专门找隐藏 bug。
8 个前沿模型、26 种配置一共跑了 520 次。340 次确实完成迁移,88 次把预先准备的测试全部跑绿,但其中 60 次又被最后一轮找出了隐藏 bug。最终只有 28 次完全过关,通过率 5.4%;20 个任务里有 13 个没人做成。Claude Opus 5 的 xhigh 配置最好,20 个任务完整通过 5 个。
现在的 Coding Agent 已经能大规模改代码,但要做到「整个系统改完还能完全不出错」,还差得很远。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍1
AI算力「挤爆」内存供应链!亚马逊等科技巨头集体涨价,内存荒或持续至2027年
AI 算力需求激增正持续推高存储芯片价格,上游成本压力开始向消费电子及硬件终端传导。近期,亚马逊上调多款硬件产品售价,其中销量最大的入门款 Echo 智能音箱由 49.99 美元涨至 79.99 美元,涨幅约 60%;16GB 基础版电子书阅读器由 109.99 美元涨至 149.99 美元,涨幅约 36%。
在亚马逊之前,苹果、微软、戴尔等科技企业也已通过提高产品售价、削减硬件标配内存等方式应对存储成本上涨。机构 IDC 此前警告,全球内存供应紧张或持续至 2027 年,行业预计存储芯片价格可能在 2028 年触顶后逐步回落。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI 算力需求激增正持续推高存储芯片价格,上游成本压力开始向消费电子及硬件终端传导。近期,亚马逊上调多款硬件产品售价,其中销量最大的入门款 Echo 智能音箱由 49.99 美元涨至 79.99 美元,涨幅约 60%;16GB 基础版电子书阅读器由 109.99 美元涨至 149.99 美元,涨幅约 36%。
在亚马逊之前,苹果、微软、戴尔等科技企业也已通过提高产品售价、削减硬件标配内存等方式应对存储成本上涨。机构 IDC 此前警告,全球内存供应紧张或持续至 2027 年,行业预计存储芯片价格可能在 2028 年触顶后逐步回落。
信源
动察 Beating 频道 · 动察 Beating 交流群
🫡1
SemiAnalysis创始人:2028年AI大部分算力只属于两家公司
SemiAnalysis 创始人 Dylan Patel 在最新播客中预测,到 2028 年,OpenAI 与 Anthropic 或将占据全球 70% 至 80% 的新增 AI 算力,合计算力规模可能超过 100GW。Patel 称,两家公司目前已占全球年度新增算力约 30%,且这一比例仍在快速上升。
Patel 指出,前沿 AI 实验室的商业模式正在发生变化,AI 算力产出效率大幅提升,Anthropic 当前每兆瓦算力对应的收入已达约 5000 万美元,并可能进一步升至 1 亿美元。这使 OpenAI、Anthropic 能够以每兆瓦 2500 万至 5000 万美元的高价采购或租赁算力。
更值得关注的是,Patel 预计 2024 年至 2029 年全球 AI 相关资本开支将达到约 11 万亿美元,其中超过 5 万亿美元需要通过债务融资完成。由于 AI 基础设施的潜在回报率远高于传统行业,科技巨头可能接受更高融资成本,从而推升整体信贷利率,并对传统资产估值及高负债经济体形成挤压。
此外,Patel 认为,未来新增算力未必主要用于对外提供模型推理服务,而可能更多流向 AI 实验室内部研发和模型自我改进。
信源
动察 Beating 频道 · 动察 Beating 交流群
SemiAnalysis 创始人 Dylan Patel 在最新播客中预测,到 2028 年,OpenAI 与 Anthropic 或将占据全球 70% 至 80% 的新增 AI 算力,合计算力规模可能超过 100GW。Patel 称,两家公司目前已占全球年度新增算力约 30%,且这一比例仍在快速上升。
Patel 指出,前沿 AI 实验室的商业模式正在发生变化,AI 算力产出效率大幅提升,Anthropic 当前每兆瓦算力对应的收入已达约 5000 万美元,并可能进一步升至 1 亿美元。这使 OpenAI、Anthropic 能够以每兆瓦 2500 万至 5000 万美元的高价采购或租赁算力。
更值得关注的是,Patel 预计 2024 年至 2029 年全球 AI 相关资本开支将达到约 11 万亿美元,其中超过 5 万亿美元需要通过债务融资完成。由于 AI 基础设施的潜在回报率远高于传统行业,科技巨头可能接受更高融资成本,从而推升整体信贷利率,并对传统资产估值及高负债经济体形成挤压。
此外,Patel 认为,未来新增算力未必主要用于对外提供模型推理服务,而可能更多流向 AI 实验室内部研发和模型自我改进。
信源
动察 Beating 频道 · 动察 Beating 交流群
Skild AI发布新机器人基础模型S1:看一段视频就能学会新任务
机器人通用大脑公司 Skild AI 发布新一代机器人基础模型 S1。它最大的变化是,教机器人干新活不用重新微调模型,只要给它看一段人类示范视频,就能直接照着学。官方展示的任务最长超过 10 分钟,包括煎饼翻面、手冲咖啡、给植物换盆等此前没训练过的任务。
S1 会把示范视频直接当成 Prompt,再输出机器人动作。换盆实验中,从开始录制人类示范,到机器人自己开始执行,只用了 11 分钟。即使中途被打断或出错,它也会根据当前环境继续调整,而不是机械重播视频里的动作。
Skild 的内部评测中,两种模型都使用相同的 10 万小时数据预训练。面对没见过的新任务,S1 平均单步成功率达到 66%,传统语言指令 VLA 只有 9%。后者大约需要再收集 380 次任务示范并微调,才能追到 S1 看一次视频后的水平。
S1 目前已开始向少量工业客户部署,未来几个月会继续扩大范围。
信源
动察 Beating 频道 · 动察 Beating 交流群
机器人通用大脑公司 Skild AI 发布新一代机器人基础模型 S1。它最大的变化是,教机器人干新活不用重新微调模型,只要给它看一段人类示范视频,就能直接照着学。官方展示的任务最长超过 10 分钟,包括煎饼翻面、手冲咖啡、给植物换盆等此前没训练过的任务。
S1 会把示范视频直接当成 Prompt,再输出机器人动作。换盆实验中,从开始录制人类示范,到机器人自己开始执行,只用了 11 分钟。即使中途被打断或出错,它也会根据当前环境继续调整,而不是机械重播视频里的动作。
Skild 的内部评测中,两种模型都使用相同的 10 万小时数据预训练。面对没见过的新任务,S1 平均单步成功率达到 66%,传统语言指令 VLA 只有 9%。后者大约需要再收集 380 次任务示范并微调,才能追到 S1 看一次视频后的水平。
S1 目前已开始向少量工业客户部署,未来几个月会继续扩大范围。
信源
动察 Beating 频道 · 动察 Beating 交流群
智谱认领Ox Alpha:GLM新版本直接支持图片视频,今晚开源
智谱确认 Ox Alpha 是 GLM 系列的一个新版本,今晚就会公开模型权重。
此前社区已经从 API 报错、分词器等线索把它指向智谱,现在终于实锤。
Ox Alpha 上周末匿名登陆 OpenRouter,主打编程和长时间 Agent 任务,同时支持文本、图片和视频输入。上线后很快冲到 OpenRouter 用量第一,使用量已经超过 DeepSeek 两倍。OpenRouter 称,这是平台历史上规模最大的一次模型发布。
多模态也是这次值得关注的变化。智谱过去一直把主 GLM 和 GLM-V 视觉模型分开,像 GLM-5 只支持文本,图片和视频则交给 GLM-5V-Turbo 等模型。这次 Ox Alpha 被直接确认为新的 GLM 版本,却同时能处理图片和视频。如果最终正式型号不再带「V」,相当于智谱开始把两条模型线往一起合。
Ox Alpha 还会继续免费一周,之后如何收费暂未公布。
信源
动察 Beating 频道 · 动察 Beating 交流群
智谱确认 Ox Alpha 是 GLM 系列的一个新版本,今晚就会公开模型权重。
此前社区已经从 API 报错、分词器等线索把它指向智谱,现在终于实锤。
Ox Alpha 上周末匿名登陆 OpenRouter,主打编程和长时间 Agent 任务,同时支持文本、图片和视频输入。上线后很快冲到 OpenRouter 用量第一,使用量已经超过 DeepSeek 两倍。OpenRouter 称,这是平台历史上规模最大的一次模型发布。
多模态也是这次值得关注的变化。智谱过去一直把主 GLM 和 GLM-V 视觉模型分开,像 GLM-5 只支持文本,图片和视频则交给 GLM-5V-Turbo 等模型。这次 Ox Alpha 被直接确认为新的 GLM 版本,却同时能处理图片和视频。如果最终正式型号不再带「V」,相当于智谱开始把两条模型线往一起合。
Ox Alpha 还会继续免费一周,之后如何收费暂未公布。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍5
MiniMax半年收入已超去年全年:企业和开发者调用模型撑起六成
MiniMax 上半年收入 1.17 亿美元,同比增长 283.1%,半年已经超过去年全年。
增长最快的,是企业和开发者调用 MiniMax 模型的生意。这部分收入从 920 万美元涨到 7393 万美元,同比增长 703.1%,已经占总收入的 63.4%。增长主要来自付费用户和企业客户增加、API 调用量上升,以及 Token 套餐普及。
海螺 AI 等 AI 产品收入也翻了一倍,达到 4264 万美元,但占比已经降到 36.6%。海外仍是主要市场,中国内地以外收入占 60.8%。
赚钱效率有所改善。毛利率从 12.1% 升到 17.9%,销售推广开支还下降了 17.9%。但研发依然很烧钱,上半年研发开支达到 2.97 亿美元,约是同期收入的 2.5 倍。
账面净亏损同比收窄 11% 至 3.58 亿美元,但这主要受上市后金融负债公允价值亏损大幅减少影响。剔除这类项目后,经调整净亏损反而扩大 111.2% 至 2.93 亿美元。
信源
动察 Beating 频道 · 动察 Beating 交流群
MiniMax 上半年收入 1.17 亿美元,同比增长 283.1%,半年已经超过去年全年。
增长最快的,是企业和开发者调用 MiniMax 模型的生意。这部分收入从 920 万美元涨到 7393 万美元,同比增长 703.1%,已经占总收入的 63.4%。增长主要来自付费用户和企业客户增加、API 调用量上升,以及 Token 套餐普及。
海螺 AI 等 AI 产品收入也翻了一倍,达到 4264 万美元,但占比已经降到 36.6%。海外仍是主要市场,中国内地以外收入占 60.8%。
赚钱效率有所改善。毛利率从 12.1% 升到 17.9%,销售推广开支还下降了 17.9%。但研发依然很烧钱,上半年研发开支达到 2.97 亿美元,约是同期收入的 2.5 倍。
账面净亏损同比收窄 11% 至 3.58 亿美元,但这主要受上市后金融负债公允价值亏损大幅减少影响。剔除这类项目后,经调整净亏损反而扩大 111.2% 至 2.93 亿美元。
信源
动察 Beating 频道 · 动察 Beating 交流群
Perplexity发布Portable Computer:跑本地模型,订阅费照收
Perplexity 发布 Portable Computer,把整个 Computer Agent 搬到本地运行。模型、规划、工具调用、任务队列和文件搜索都在自己的电脑上完成,本地任务不再消耗 Perplexity credits。
首发支持 NVIDIA DGX Spark,可跑 Qwen 3.8 27B 和 Perplexity 后训练的 PPLX 27B。需要联网搜索、浏览器操作或更强推理时,再经用户同意调用云端 15+ 个前沿模型。
即使模型和算力都是用户自己的,Portable Computer 仍然只对 Pro 和 Max 订阅用户开放。社区已经有人吐槽:自己买机器跑本地模型,为什么还要给 Perplexity 交月费?
信源
动察 Beating 频道 · 动察 Beating 交流群
Perplexity 发布 Portable Computer,把整个 Computer Agent 搬到本地运行。模型、规划、工具调用、任务队列和文件搜索都在自己的电脑上完成,本地任务不再消耗 Perplexity credits。
首发支持 NVIDIA DGX Spark,可跑 Qwen 3.8 27B 和 Perplexity 后训练的 PPLX 27B。需要联网搜索、浏览器操作或更强推理时,再经用户同意调用云端 15+ 个前沿模型。
即使模型和算力都是用户自己的,Portable Computer 仍然只对 Pro 和 Max 订阅用户开放。社区已经有人吐槽:自己买机器跑本地模型,为什么还要给 Perplexity 交月费?
信源
动察 Beating 频道 · 动察 Beating 交流群
💩6👎2
前Yandex高管融资2600万美元,要把1000亿网页喂给AI Agent
AI 搜索公司 Keenable 结束隐身,拿到 2600 万美元种子轮融资,由 Accel 领投、Conviction 参投。公司自建了超过 1000 亿篇网页的独立索引,Agent 可通过 API 或 MCP 搜索,并直接拿到整理后的网页正文。
创始人 Andrey Styskin 曾负责 Yandex 搜索和广告业务,后来又在 Amazon AGI 做 Web 基础设施。
Styskin 还宣布上线 Web Query Language(WQL)。简单说,它想让 Agent 不再一个个搜网页,而是直接把整个 Web 当数据库查。哪怕答案分散在不同网站,也能一次筛出来再拼到一起。可以把它理解成「给互联网加了一层类似 SQL 的查询接口」。Search API 和 WQL 免费开放到 9 月底。
Keenable 不是第一个做 Agent 搜索的。Exa 也自己维护约 1000 亿篇网页的索引。Keenable 现在一个直接优势是价格:每 1000 次搜索 4 美元,Exa 是 7 美元,便宜约 43%。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI 搜索公司 Keenable 结束隐身,拿到 2600 万美元种子轮融资,由 Accel 领投、Conviction 参投。公司自建了超过 1000 亿篇网页的独立索引,Agent 可通过 API 或 MCP 搜索,并直接拿到整理后的网页正文。
创始人 Andrey Styskin 曾负责 Yandex 搜索和广告业务,后来又在 Amazon AGI 做 Web 基础设施。
Styskin 还宣布上线 Web Query Language(WQL)。简单说,它想让 Agent 不再一个个搜网页,而是直接把整个 Web 当数据库查。哪怕答案分散在不同网站,也能一次筛出来再拼到一起。可以把它理解成「给互联网加了一层类似 SQL 的查询接口」。Search API 和 WQL 免费开放到 9 月底。
Keenable 不是第一个做 Agent 搜索的。Exa 也自己维护约 1000 亿篇网页的索引。Keenable 现在一个直接优势是价格:每 1000 次搜索 4 美元,Exa 是 7 美元,便宜约 43%。
信源
动察 Beating 频道 · 动察 Beating 交流群
✍1