动察Beating AI News
2.98K subscribers
783 photos
2 videos
3.22K links
AI新闻信息流
Download Telegram
诺奖得主从伯克利转投清华,要用AI把材料研发周期压缩一个数量级

2025 年诺贝尔化学奖得主奥马尔·亚吉已离开加州大学伯克利分校,全职加盟清华大学。清华聘其为讲席教授,并由他牵头建设 AI 材料化学研究中心 AIMATRY。

中心将联合化学、化工、人工智能、计算机和材料等团队,用 AI 改造材料设计与合成。目标是打通从理论计算到研发生产的全链条,把新材料研发周期压缩一个数量级。

亚吉因推动金属有机框架材料(MOF)发展,与另外两名科学家分享 2025 年诺贝尔化学奖。MOF 像分子海绵,可用于捕碳、从空气取水和储氢。

亚吉 2022 年已受聘为清华名誉教授,这次是从长期合作转为全职任职。

《Nature》把这次流动放在美国科研经费收缩、中国争抢顶尖人才的背景下。不过,亚吉没有公开把赴华决定直接归因于美国削减科研资助。

信源:https://www.nature.com/articles/d41586-026-02143-x
👍1😁1
Grok 4.5登顶腾讯混元Agent耐力榜,超六成任务无模型完成

腾讯混元团队联合多所高校发布 LHTB,专门测试 AI Agent 能否在终端里持续完成复杂任务。

基准包含 46 项任务,覆盖软件工程、实验复现、科学计算和多模态分析等领域。每项最长运行 90 分钟,通常需要连续操作数百步。

LHTB 不只看最终成败。任务完成一部分,也会按实际进度给分。隐藏验证器会检查文件、测试结果和程序输出,Agent 自称完成不算。

论文首版测试了 15 个模型。GPT-5.5 完成 7 项,排名第一。每个模型执行一项任务,平均消耗约 990 万 Token,耗时约 85 分钟。

当前公开结果已扩至 20 个模型。Grok 4.5 以平均得分 0.505 登顶,完成 13 项。46 项任务中,仍有 29 项没有任何模型达到完成标准。

多数 Agent 能完成部分步骤,却经常耗尽 90 分钟,或在任务尚未完成时提前收工,无法把复杂任务真正做完。

信源:https://zli12321.github.io/LHTB/leaderboard.html
1
趋境科技半年融资超10亿,万亿级Token工厂已投产

AI Token 生产服务商趋境科技完成 A 轮融资,半年累计融资超过 10 亿元。本轮由河南投资集团汇融基金领投,真知资本、尚势资本、星连资本等老股东继续跟投。公司没有披露本轮单笔融资金额。

趋境科技不训练自己的大模型,也不追求接入尽可能多的模型。它主要为少数头部模型优化推理系统,让同一批算力生成更多、更快、更稳定的 Token。

公司称,目前已有日均万亿级 Token 工厂投产,部分成熟业务已经盈利。2026 年春节以来,平均单台算力的 Token 生产效率提升超过 3 倍,总产能增长超过 30 倍。

所谓 Token 工厂,本质上是把芯片、内存、网络和模型推理软件统一调度。它要同时降低首字等待时间、提高并发量,并减少算力闲置和故障造成的损失。

本轮资金将用于扩充 Token 产能、升级 ATaaS 平台,并推动国产芯片进入大规模推理场景。

信源:https://mp.weixin.qq.com/s/dnj6_u-kL7sfi7OpsmbAqA
👍1
Sakana AI做出会自检的智能砖块,不靠中央电脑也能发现故障

日本 AI 初创公司 Sakana AI 做出一套「会认识自己」的智能砖块。近 200 块砖拼成飞机、桌子、吉他等形状后,每块砖只和旁边的砖通信,却能一起判断整体长什么样。

研究人员拔掉或关闭部分砖块后,剩下的砖还能发现哪里断了,并继续识别整个结构。它们没有摄像头,不知道自己的坐标,也没有中央电脑指挥。

这些砖块更像实体版「细胞」。单个细胞看不到全身,但靠附近细胞传递信息,整个组织依然知道自己长什么样,哪里受了伤。

这套方法以后可能用在建筑、机器人或航天器上。故障不必等人逐个排查,结构自己就能报出哪里出了问题。即使部分零件失灵,整套系统也不至于立刻瘫痪。

信源:https://sakana.ai/smart-cellular-bricks/
理想披露Mach-Mind-4-Flash训练方法:十多个专家合成一个模型

理想汽车发布 Mach-Mind-4-Flash 技术报告。模型此前已经亮相,这次主要补充后训练细节。

团队先分别训练数学、代码、写作、安全、搜索和工具调用等十多个专家模型。随后再用 MOPD(多教师在线策略蒸馏)合并成一个通用模型。每类题目由对应专家指导,减少多项能力在混合训练中互相拖累。

报告也讲清了 Agent 怎么训练。模型不只学习工具名称和调用格式,还会在隔离沙箱中真正读文件、改代码、运行测试和调用工具。操作失败后,它能看到报错和环境变化,再继续修改。工具训练覆盖 190 多个有状态领域和 3500 多个工具接口;编程任务的一条训练轨迹最长可达 300 轮。

这种融合并非完全无损。指令遵循能力基本保住,ClawBench 和 ClawEval 甚至超过单独的 Agent 专家。但 SWE-bench Verified 从专家模型的 73.80 降到 71.10。团队承认,长程编程等高度专门化能力在合并时仍会损失。

报告还披露了如何减少模型「想太多」。HMPO 根据正确答案的中位长度动态设定推理预算,只奖励答对且更短的答案。它将生成长度缩短 19% 至 46%,准确率最多下降 0.7 个百分点。目前这套方法只用于单轮推理,尚未覆盖多轮 Agent 任务。

信源:https://arxiv.org/abs/2607.09375
英伟达真的开始「出卡」,但这次不是显卡

英伟达推出首套《GeForce Trading Cards》集换式卡牌。Series 1 共包含 14 款设计,记录 GeForce 三十多年的显卡、游戏和技术 Demo。

卡牌主角包括 NV1、GeForce 256、GeForce 3、7800 GTX、GTX 1080,以及《赛博朋克 2077》版 RTX 2080 Ti。Bubble、Chameleon 和 Medusa 等经典技术演示也被做成卡牌。

这套卡牌不会公开销售,只能参加「Summer of RTX」线上抽奖,或前往指定活动免费领取。英伟达已在上海 Bilibili World 发放,后续还将出现在 QuakeCon 和 gamescom。

在显卡越来越贵的背景下,玩家对这次「出卡」的评价颇为微妙。PC Gamer 引述网友调侃:「终于有一张我买得起的英伟达卡了。」

信源:https://www.pcgamer.com/hardware/finally-a-card-i-can-afford-nvidia-announces-geforce-themed-trading-cards-which-are-free-but-youll-need-to-travel-or-get-lucky-to-win-some-for-yourself/
😁2
阶跃星辰正式做手机,STEPX Neo首秀

阶跃星辰发布 AI 终端品牌 STEPX,并亮相首款手机 STEPX Neo。手机搭载 Step AOS 系统和个人智能体 Amoo,试图让 AI 直接操作手机,而不只是陪用户聊天。

用户只需说出需求,Amoo 就能调用系统、硬件和第三方服务完成任务。例如规划行程、叫车、订餐或处理文档,不必逐个打开 App。

首批合作伙伴包括携程、支付宝、滴滴、美团、WPS 和剪映等,覆盖出行、本地生活、办公和内容创作。手机背面还配有一块交互副屏。

官方称,STEPX Neo 已通过《人工智能终端智能化分级》L3 测试。L3 在国标中属于「辅助级」,高一级的 L4 标准仍待后续完善。

不过,阶跃暂未公布芯片、屏幕、影像、价格和上市时间。

信源:https://mp.weixin.qq.com/s/BgpUIGYSkrDpqt6IbNhAAQ
🔥3
xAI回应Grok Build上传完整代码库:将清空此前所有用户数据

xAI 回应 Grok Build 上传完整代码库争议。官方称,开启零数据保留(ZDR)的团队,代码和运行记录不会被保存。通过 API 密钥使用 Grok Build,也遵守这项设置。

未开启 ZDR 的用户,可以在 CLI 输入 /privacy 关闭数据保留。此前同步的数据也会被删除。

Grok Build 负责人 Andrew Milich 称,修改隐私设置后,系统会追溯删除已经同步的数据。

马斯克随后表示,作为预防措施,SpaceXAI 将彻底删除此前上传的所有用户数据,不留下任何内容。

不过,这次回应主要解释了如何停止保存和删除数据。xAI 仍未说明,Grok Build 为什么默认上传整个 Git 仓库。

信源:https://x.com/elonmusk/status/2076739687658496209?s=46
👎31
Hermes Agent爆红后,母公司Nous Research估值或达15亿美元

开源 AI Agent 公司 Nous Research 正在敲定新一轮融资。融资额至少为 7500 万美元,估值达 15 亿美元。

本轮由 Robot Ventures 领投,USV 等机构参投。交易尚未完成,Nous Research 拒绝置评。

Nous Research 开发的 Hermes Agent 可在电脑或云服务器上持续运行。它能搜索网页、编写代码、理解图片,还会根据使用经历自动创建和改进技能。

Hermes 在 GitHub 已获得约 21.4 万个星标。新资金将用于扩展产品和商业模式,包括面向普通用户的云端托管服务。

信源:https://techcrunch.com/2026/07/13/hermes-agent-maker-nous-research-in-talks-for-new-funding-at-1-5b-valuation/
1
Codex一天多出100万活跃用户,OpenAI再送全员额度

OpenAI 核心产品负责人 Tibo 称,Codex 和 ChatGPT Work 的活跃用户已达 700 万。一天前,这一数字刚突破 600 万。

为庆祝这一节点,OpenAI 向所有用户发放一次可储存的额度重置。用户可在桌面端或网页端随时启用,直接补满每周使用额度。

信源:https://x.com/thsottiaux/status/2076735790567338203?s=46
🌚3
逐际动力再融近2亿美元,要让人形机器人告别遥控器

深圳人形机器人公司逐际动力完成近 2 亿美元 Pre-IPO 轮融资,投后估值达到 150 亿元。加上今年 2 月完成的 2 亿美元 B 轮融资,公司半年累计融资约 4 亿美元。

本轮投资方包括 IDG 资本、蓝思科技、GGG Group、Redstone VC 和华山资本等。磊石资本、蔚来资本和尚颀资本等老股东继续加注。

资金将用于「大小脑融合」技术和产品化。简单说,就是让负责走路和平衡的运动系统,与负责感知、推理和规划的 AI 系统协同工作。

逐际动力计划推动数千台全自主人形机器人规模化部署,并扩展中东、欧洲和亚洲其他市场。公司称,现有机器人已获得数千台订单,过半来自海外。

信源:https://mp.weixin.qq.com/s/LSKxWmyMT-qx9-ZeB9wz2w
👍3
孙正义押注核聚变给AI供电,软银已连续两轮下注

软银创始人孙正义预计,到 2040 年,全球数据中心需要 3 太瓦电力。

短期内,新增用电仍主要依赖天然气。约 15 年后,核聚变可能成为更便宜、清洁和安全的替代方案。

这不只是口头判断。软银愿景基金二期已连续投资美国核聚变公司 Helion,先后参与其 2025 年 F 轮和 2026 年 G 轮融资。

Helion 最新一轮融资 4.65 亿美元,估值达到 155 亿美元。核聚变尚未实现商业化发电,能否按期大规模供电仍有很大不确定性。

面对 AI 泡沫质疑,孙正义称这是一个「极其愚蠢的问题」。他认为,巨额数据中心投资最终会获得回报。

信源:https://www.bloomberg.com/news/articles/2026-07-14/softbank-s-masayoshi-son-sees-fusion-power-as-key-to-ai-s-future
AI基建要烧5.8万亿美元,债券市场可能低估烂尾风险

高盛估算,谷歌、亚马逊、Meta、微软和甲骨文到 2030 年要投入 5.8 万亿美元,建设 AI 数据中心和算力设施。

即使是这些科技巨头,也不可能全靠现金。五家公司今年已发行近 2000 亿美元企业债,还通过合资项目为数据中心借了约 900 亿美元。

问题是,这些债券看起来都由大厂撑腰,实际保障差别很大。

有的项目由谷歌全额接手租约。有的只能按折扣价收租。还有项目规定,建设延期超过半年,谷歌和租户可以直接退出。

一旦数据中心没按时建成,租金就不会开始支付,投资者也可能拿不回钱。

但目前市场没有认真区分这些风险,不同项目的借款利率相差不大。随着更多数据中心开工,延期和超支问题可能让部分债券率先暴雷。

信源:https://www.bloomberg.com/opinion/articles/2026-07-14/ai-s-5-8-trillion-buildout-needs-every-bond-flavor-it-can-sell
动察Beating AI News
爱诗科技完成3亿美元C轮融资,创中国AI视频生成领域最大单笔融资纪录 AI 视频生成公司爱诗科技近期完成 3 亿美元 C 轮融资,刷新中国视频生成领域单笔融资金额纪录。本轮由鼎晖投资领投,超过 20 家机构参与,包括中国儒意、三七互娱等影视游戏产业方,亦庄国投、苏创投等地方国资,以及新加坡华侨银行旗下 Lion X 基金等海外机构。 公司旗下产品 PixVerse(海外版)和拍我 AI 总用户数已超 1 亿,月活超 1600 万,2025 年底 ARR 突破 4000 万美元。今年 1 月爱诗发布了视频生成模型…
阿里领投爱诗科技,29.8亿元加注AI视频

AI 视频公司爱诗科技完成整体 C 轮融资,累计金额达 29.8 亿元。最新 C+ 轮由阿里巴巴领投,王慧文家办、韩国未来资产、蓝色光标等十余家机构参投。

资金将用于视频生成基础模型、实时世界模型、全球产品增长和产业落地。

爱诗科技旗下 PixVerse 全球用户已超过 1.5 亿。公司还推出了支持 1080P 实时交互的世界模型 PixVerse R1,用户可以用自然语言实时改变视频内容。

信源:https://mp.weixin.qq.com/s/mWK96cTdJfCcw-N1U0AMpw
OpenClaw Mac客户端补上原生聊天,GPT-5.6成为默认模型

OpenClaw 发布 2026.7.1,为已有的 macOS 客户端加入原生聊天和会话管理。此前的 Mac App 主要承担菜单栏控制、语音输入、权限管理和 Gateway 配置,这次才补上更完整的桌面聊天体验。

用户现在可以在 Mac App 内搜索历史会话,切换模型与推理强度,使用斜杠命令,导出聊天记录,并查看上下文用量。

新安装的 OpenClaw 将默认使用 GPT-5.6,但不会覆盖老用户已经保存的模型配置。版本同时新增 Claude Sonnet 5、Mythos 5、Meta Muse Spark 1.1 等模型支持。

iOS 和 Android 也新增离线会话缓存。用户断网后仍能查看最近的聊天记录,Apple Watch 则可以直接语音提问并朗读回答。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.7.1
Claude和Cowork设计负责人转投Cursor

Claude 和 Cowork 设计负责人 Jenny Wen 宣布离开 Anthropic。她将加入 Cursor,担任设计负责人。

她曾主导 Claude.ai 的视觉改版,并为 Cowork 设定早期产品方向。加入 Anthropic 前,她是 Figma 设计总监,带领过 FigJam 和 Slides 等产品团队。

这次跳槽把 Claude 的核心产品经验带到了竞争对手。Cursor 与 Claude Code 正在争夺 AI 编程 Agent 市场,产品设计也会成为双方较量的一部分。

信源:https://x.com/jenny_wen/status/2076679443754475919
DeepSeek创始人梁文锋身家暴涨至360亿美元,成全球最富AI模型创始人

DeepSeek 完成首轮融资后,创始人梁文锋的身价随公司估值大涨。

彭博亿万富豪指数将他的净资产从 167 亿美元上调至 360 亿美元,增加 193 亿美元。按彭博统计,他已超过 Anthropic 联合创始人 Dario Amodei 和 OpenAI 联合创始人 Greg Brockman,成为全球身家最高的 AI 模型创始人。

DeepSeek 此轮融资超过 500 亿元人民币,公司估值超过 500 亿美元。梁文锋本人投入约 200 亿元人民币,占融资额近四成,也是最大出资方。

融资结构也很特殊。多数投资者没有直接入股 DeepSeek,而是把钱投进由梁文锋管理的有限合伙企业。投资者需锁定五年,通常没有投票权。DeepSeek 拿到了巨额资金,梁文锋仍牢牢掌握控制权。

信源:https://www.bloomberg.com/news/articles/2026-07-14/deepseek-s-liang-tops-amodei-and-brockman-as-richest-ai-founder
🔥2
强化学习之父Sutton另起炉灶,要做会持续学习的AI

2024 年图灵奖得主、强化学习之父 Richard Sutton 与长期合作者 Khurram Javed 离开 John Carmack 创办的 AGI 公司 Keen Technologies,共同成立 Oak Lab。Javed 曾师从 Sutton,在阿尔伯塔大学完成计算机博士,长期研究实时强化学习和持续学习。

Keen 本来就研究强化学习和长期运行的智能体,Oak Lab 则把 Sutton 和 Javed 最看重的持续学习路线单独拿出来。现在的大多数模型部署后不会继续根据新经验更新自身,Oak 则希望 AI 能在运行中不断从自己的经验里学习。

Sutton 认为当前深度学习方法「薄弱且低效」,继续修补不够,需要重做基础方法。Oak Lab 将推进 OaK(选项与知识)架构,让 Agent 从交互经验中形成知识,再用世界模型预测行动后果并规划下一步。

公司的长期目标是打造一个万亿参数 Agent,并把实时学习和规划的功耗压到 20W。

信源:https://x.com/RichardSSutton/status/2076663628301058329
👍1
动察Beating AI News
阿里 Qwen 多位核心成员离职,智谱创始人唐杰公开向离职者喊话「join us」 据晚点 LatePost 报道,阿里 Qwen 团队技术负责人林俊旸于 3 月 3 日下午正式向阿里提出辞职,3 月 4 日凌晨在 X 上发文「me stepping down. bye my beloved qwen.」。Qwen 团队成员 Kaixin Li 同日宣布离开。智谱 AI 创始人、首席科学家唐杰随即在 X 上分别回应:对林俊旸回复「cool. start a new journey」,对 Kaixin Li…
传原阿里千问Code负责人加入国内某大厂负责AI Coding

多名知情人士称,原阿里通义 Qwen Code 负责人惠彬原已加入一家国内互联网大厂,担任 AI Coding 算法负责人。具体公司尚未披露。

惠彬原于 2026 年 1 月离开阿里。此前《晚点》报道称他加入 Meta,多家媒体随后沿用了这一说法。

惠彬原是 Qwen-Coder 系列核心成员,长期负责代码大模型和 Coding Agent 方向。他近期仍参与软件工程智能体研究,但公开主页尚未显示新雇主。

信源:https://mp.weixin.qq.com/s/Fh7mZ0IRC4QZHg0uGZYy-w
Claude说中文会权衡利弊,说英文更爱拿证据较真

Anthropic 分析了近 31 万条匿名 Claude 对话,覆盖 3 款模型和 20 种语言。结果发现,同一个 Claude 换种语言,说话方式也会变化。

说中文时,Claude 略偏谨慎和严谨。它更常权衡不同因素,也会反驳错误前提,但表达相对克制,有时会安慰用户而不作评判。

说英文时,这些特点更明显。Claude 更常要求证据、主动纠正细节,也更愿意深入解释和质疑用户的假设。

不同模型也有不同「脾气」。Sonnet 4.6 更爱肯定和鼓励用户;Opus 4.7 更谨慎,更常挑错、提醒风险和解释推理过程。

Anthropic 尚不清楚这些差异来自不同语言的训练数据,还是模型在适应各语言的表达习惯。研究衡量的是回答方式和价值倾向,不等于换种语言就一定会得到相反结论。

信源:https://www.anthropic.com/research/claude-values-models-languages