动察Beating AI News
3.15K subscribers
883 photos
2 videos
3.4K links
AI新闻信息流
Download Telegram
马斯克:Optimus 3今年夏天开始生产,明年夏天高产量,正建1000万平方英尺专用工厂

马斯克在 Peter Diamandis 主持的播客第 239 期中透露,Optimus 3 正处于「最后完成阶段」,将于今年夏天开始生产。初期产量会很低(经典 S 曲线爬坡),明年夏天达到高产量。他表示自己「没有见过任何机器人演示能达到 Optimus 3 的水平」,并称计划每年发布一代改进设计。

特斯拉正在新建约 1000 万平方英尺的 Optimus 专用工厂,采用全新厂房设计,与汽车工厂不同。马斯克同时表示特斯拉不计划裁员,反而会增加人数,但人均产出将达到「难以置信」的水平。特斯拉目前直接员工约 15 万人,其中约 10 万人在工厂,供应链上还有约 100 万至 200 万人。

此前报道的时间线是「2026 年底启动生产」,今日在 AWE 上海首秀的第三代机器人现场工作人员也使用了这一说法。马斯克本人给出的「今年夏天」明显提前了数月。

信源:https://www.youtube.com/watch?v=N5KCm_55xeQ
马斯克:「我们正处于硬起飞之中」,AI递归自我改进今年底可能全自动化,最迟明年

马斯克在同一场播客中就 AI 发展做出一系列激进判断。「硬起飞」(hard takeoff)是 AI 领域术语,指 AI 从人类水平智能跃升到远超人类智能的过程在极短时间内(数天到数周)发生,快到人类社会来不及适应和监管,核心驱动力是 AI 递归自我改进形成的正反馈回路;与之相对的「软起飞」则指这一过程耗时数年到数十年,人类有时间调整。马斯克说「我们正处于硬起飞之中(We're in the hard takeoff. Right now.)」,理由是每次入睡时都有 AI 重大突破,醒来又有一个。在递归自我改进方面,他称每一代 Grok 模型「都由上一代构建」,人类参与度持续降低,但尚未实现完全自动化,预计今年底有可能达到,最迟明年。

他追加了几个值得注意的判断:Grok 目前在编程能力上落后于竞争对手,他因参加一场编程全员会议而迟到本次录制,目标是在年中追平并超越对手;全球经济将在 10 年内增长 10 倍;钱终将变得不相关,因为 AI 和机器人的商品服务产出将远超货币供给,导致结构性通缩;10 年内将有月球基地、火星人类定居和月球质量驱动器;他对未来持「80% 以上概率是好的」的判断。

信源:https://www.youtube.com/watch?v=N5KCm_55xeQ
Anthropic登上《时代》杂志封面:被称为「世界上最具颠覆性的公司」,3800亿美元估值超高盛和可口可乐

Anthropic 登上最新一期《时代》杂志封面,CEO Dario Amodei 居于封面正中,标题为「The War for AI」。这是 AI 行业公司首次以封面专题形式登上《时代》(此前 2025 年度人物为「AI 建筑师」群像),报道由记者 Harry Booth 和 Billy Perrigo 在 Anthropic 总部进行三天驻场采访后撰写,将 Anthropic 定义为「世界上最具颠覆性的公司」(The Most Disruptive Company in the World)。

报道呈现了 Anthropic 当前的体量:刚完成 300 亿美元融资(可能今年 IPO),估值 3800 亿美元,已超过高盛、麦当劳和可口可乐;Claude Code 单品年化收入到今年 2 月达 25 亿美元(2025 年底为 10 亿),据 Epoch 和 Semianalysis 估计,Anthropic 有望在 2026 年底超越 OpenAI 的总收入。每次新产品发布都会引发股市震荡,Claude 推出面向非程序员的销售、财务、法律和市场营销插件时,软件公司市值蒸发 3000 亿美元。

专题同时深度披露了 Anthropic 与五角大楼冲突的内幕。Amodei 坚守两条红线(禁止 Claude 用于全自动致命武器和对美国公民大规模监控)后被列为供应链风险。他在泄露的内部备忘录中写道:「真正原因是我们没给特朗普捐款,没像 Sam Altman 那样给出独裁者式的赞美。」冲突后 Claude 的 iPhone App 登上 App Store 第一名,每天有超过 100 万人注册。报道还披露,开发未来模型所用代码的 70% 至 90% 现在由 Claude 自己编写,Claude 在某些关键任务上的速度已是人类监督者的 427 倍,首席科学家 Jared Kaplan 认为完全自动化的 AI 研究可能只需一年。

信源:https://time.com/article/2026/03/11/anthropic-claude-disruptive-company-pentagon/
AI数学证明公司Axiom获2亿美元A轮,5个月估值从3亿飙至16亿,Menlo Ventures领投

AI 数学推理公司 Axiom 宣布完成 2 亿美元 A 轮融资,Menlo Ventures 领投,投后估值 16 亿美元。这距其 2025 年 10 月 B Capital 领投的 6400 万美元种子轮(估值 3 亿)仅过去约 5 个月,估值增长逾 5 倍。

Axiom 由罗德学者、MIT 毕业生 Carina Hong 于 2025 年 3 月创立,她为此放弃了斯坦福法学/博士双学位项目。公司核心产品 AxiomProver 是一个自主 AI 定理证明系统,能逐步推导出数学上严格且可验证的证明。AxiomProver 在 2025 年 12 月的 Putnam 竞赛(世界最难的大学数学考试)中满分解决全部 12 道题(其中 8 道在考试时间内完成),并已自主证明了此前未解的数学猜想。

Axiom 被归类为「新型实验室」(neolab),即研究驱动型 AI 创业公司,聚焦 OpenAI、Anthropic 等大型实验室忽视的垂直领域和新方法。公司的中期目标是将形式化验证能力从数学扩展到硬件和软件代码验证——即用数学证明的方式证明代码是正确的,而非仅靠测试。这直接回应了当前 AI 生成代码无法被严格验证的核心痛点。

信源:https://www.nytimes.com/2026/03/12/technology/axiom-ai-code-funding.html
盛大创始人陈天桥的AI公司MiroMind发布MiroThinker-1.7:开源深度研究Agent在多个基准上刷新纪录

盛大网络创始人陈天桥创办的 AI 公司 MiroMind 发布新一代开源深度研究 Agent 系列 MiroThinker-1.7 和闭源版 MiroThinker-H1。MiroThinker-1.7 基于阿里 Qwen3 系列微调,有 30B(MiroThinker-1.7-mini)和 235B 两个参数规模,支持 256K 上下文窗口和每任务最多 300 次工具调用。

在基准测试中,MiroThinker-1.7 在 BrowseComp(OpenAI 推出的信息检索难度测试)上达到 74.0%,BrowseComp-ZH(中文版)上达到 75.3%,后者为开源模型新纪录;在 GAIA 综合研究基准上达到 82.7%,HLE-Text 上达到 42.9%。30B 的 mini 版本在 BrowseComp-ZH 上达到 72.3%,以仅 30B 参数量创下开源新纪录。闭源版 MiroThinker-H1 在 BrowseComp 上达到 88.2%,在开源和商业模型中均处于领先水平。H1 的核心特点是「可验证推理」,即推理过程在每一步和全局层面都可以被验证。

MiroMind 由陈天桥创办,团队由清华大学副教授代季峰联合领导,定位为全球分布式 AGI 研究公司,此前已在 GAIA 和 FutureX 预测基准上多次取得领先成绩。与主流 LLM 聚焦文本生成不同,MiroThinker 的核心架构是「计划→执行→验证→改进」循环,强调通过外部工具检索和交叉验证来减少幻觉,今年 1 月 VentureBeat 的评测称其以 1/20 的成本实现万亿参数级模型的性能。

信源:https://github.com/MiroMindAI/MiroThinker
Runway成立内部孵化器Runway Labs:从视频生成工具公司转向通用世界模型的跨行业应用探索

AI 视频生成公司 Runway 宣布成立内部孵化器 Runway Labs,由联合创始人兼首席创新官 Alejandro Matamala Ortiz 领导,专门探索生成式视频和通用世界模型(General World Models)在视频创作之外的下一代应用。

Runway 称公司正处于拐点:AI 视频和通用世界模型将变革影视、医疗、教育、游戏、广告、体育、零售、房地产、职业培训等行业。Runway Labs 的定位是「大胆原型实验,发现尚不存在的产品和应用」。这一动作标志着 Runway 战略扩围——从以创意工具(Gen-4.5 视频生成、Act-Two 表演驱动)驱动的内容创作平台,转向以通用世界模型为底座的跨行业基础设施提供商。此前 Runway 已于本月发布 Runway Characters(基于 GWM-1 的实时视频对话角色 API)和机器人 SDK,将世界模型能力延伸至游戏 NPC、虚拟客服和机器人训练等场景。公司正在招聘设计工程师、ML 工程师、全栈工程师和前创始人。

信源:https://runwayml.com/news/introducing-runway-labs
CopilotKit开源LLMock:用JSON文件模拟OpenAI、Claude和Gemini的API响应,AI应用测试不用再烧真钱

AI 应用开发框架 CopilotKit 开源了内部测试工具 LLMock,一个确定性的 LLM 模拟服务器,MIT 协议,零运行时依赖(仅使用 Node.js 内置模块)。开发者用 JSON fixture 文件定义请求匹配规则和预期响应,LLMock 启动一个真实的 HTTP 服务器,同一台机器上的任何进程(Next.js、Mastra、LangGraph 等)都可以直接调用,无需修改业务代码。

LLMock 同时模拟 OpenAI(Chat Completions + Responses)、Anthropic Claude(Messages)和 Google Gemini 三家的 API 格式,支持 SSE 流式和非流式两种模式,还覆盖了 OpenAI Responses、OpenAI Realtime 和 Gemini Live 的 WebSocket API。匹配规则支持子串、正则和自定义谓词函数,可返回文本响应和结构化工具调用,支持错误注入(模拟 429 限流、503 宕机等),并记录所有请求用于断言验证。官方称其与 MSW(常用的 API mock 库)的关键区别是跨进程能力:MSW 只在进程内拦截请求,而 LLMock 是一个独立的 HTTP 服务器,多个进程可以同时命中同一个端点。工具还内置了 Claude Code 技能插件,教 AI 助手正确编写 fixture。

CopilotKit 团队在 LinkedIn 上分享了开源动机:「每个不确定性输出导致的 CI 失败、每次重跑的测试套件,都是在烧 token 和堆 API 费用。」

信源:https://x.com/CopilotKit/status/2031404481355853904
谷歌AlphaEvolve攻克5个Ramsey数难题:数学家几十年逐个手搜的结果,AI用一套方法全部覆盖并刷新

Google DeepMind 用其 AI 编程智能体 AlphaEvolve 一次性改进了 5 个 Ramsey 数的已知最优结果。Ramsey 数是组合数学中出了名的「算不动」的问题,数学家 Erdős 有句名言:如果外星人威胁一年内算出 R(5,5) 否则毁灭地球,我们应该全力去算;但如果他们要求算 R(6,6),我们应该去攻击外星人。

过去几十年,每推进一个 Ramsey 数的下界,都需要数学家为它专门设计一套搜索算法,而且很多旧结果连当初用什么方法都没留下记录。AlphaEvolve 的突破在于方法论层面:它是一个统一的「元算法」,让 AI 自动写搜索代码、自动进化搜索策略,一套方法覆盖了此前需要几十种定制算法才能分别攻下的结果,并在其中 5 个上超越了人类最佳纪录。这是该团队第二次用 AlphaEvolve 攻克理论数学难题,去年 9 月他们用同一方法改进了旅行商问题的不可近似性结果。

信源:https://arxiv.org/abs/2603.09172
😡1
Meta新一代AI模型「Avocado」表现不达预期,推迟至少到5月发布,曾讨论临时授权Gemini给自家产品用

Meta 已将代号为「Avocado」的新一代前沿 AI 模型发布时间从原定的 3 月推迟至少到 5 月。该模型在内部测试中表现未能达到竞品水平,是推迟的主要原因。Mark Zuckerberg 去年 7 月曾表示,Meta 的新 AI 模型将在未来一年「推动前沿」。

更值得关注的是,Meta 内部还讨论过一个不寻常的方案:临时向谷歌授权 Gemini 模型来驱动自家产品。这一讨论本身就说明了 Meta 自研模型的紧迫压力。此前 Meta 一直强调自研路线,若最终需要借助竞品模型过渡,将是对其 AI 战略自主叙事的重大偏离。

信源:https://www.nytimes.com/2026/03/12/technology/meta-avocado-ai-model-delayed.html
Claude新增对话内嵌图表和可视化功能,所有用户可用

Anthropic 为 Claude 推出了一项新功能:AI 可以在对话中直接生成自定义图表、示意图和其他交互式可视化内容。当 Claude 判断可视化有助于解释当前话题时,会自动在对话中内嵌生成,而非放在侧边栏的 Artifacts 中。用户也可以直接要求 Claude 生成图表或示意图。

与 Artifacts 功能不同,对话中的可视化内容是随对话流动的,会随着对话推进而变化或消失,不会持久保留。该功能现已向所有用户推出(beta),默认开启。本周 OpenAI 和谷歌也分别推出了 ChatGPT 和 Gemini 的交互式可视化功能,三家正在这一方向同步发力。

信源:https://x.com/claudeai/status/2032124273587077133?s=20
谷歌高管首次表态:不排除在Gemini投放广告

谷歌知识与信息高级副总裁 Nick Fox 在接受采访时表示,谷歌「不排除」在 Gemini 中投放广告。此前数月间,谷歌高管坚称公司没有在 Gemini 中放广告的近期计划。Fox 的新表态标志着态度松动,意味着谷歌核心广告业务与 AI 产品的边界可能会进一步模糊。对于依赖 Gemini 作为独立 AI 助手的用户来说,广告的引入将直接影响使用体验和对回答中立性的信任。

信源:https://www.wired.com/story/google-nick-fox-advertising-search-ai-gemini/
传蚂蚁百灵和开源社等有意赞助OpenClaw,前GitHub国际化负责人称已帮项目在中国「摸了一圈底」

前 GitHub 国际化战略负责人、Interconnected Capital 创始人 Kevin Xu 在 X 上回复 OpenClaw 创始人 Peter Steinberger,称自己已在中国开源生态中联络了一圈,多方表示愿意赞助 OpenClaw 或提供维护者。

他提到三个方向:中国最大的民间开源社区「开源社」(kaiyuanshe,2014 年成立,厂商中立的志愿者组织)已准备好在其网络中发起维护者和赞助意向征集;蚂蚁集团旗下 AI 实验室蚂蚁百灵(Ant Ling,已开源 Ling-1T 等 18 款大模型)有赞助意愿,且内部有适合担任维护者的候选人;另有多家机构正在询问 OpenClaw 基金会的赞助等级和参与方式。Steinberger 此前在 X 上表示,维护者支持和赞助本是好事,但「还没有真正到我们这边来」。以上赞助意向均来自 Xu 的个人发文,各方均尚未正式宣布。

Xu 对中国科技界采用 OpenClaw 的速度感到惊叹(从 AI 实验室到超算厂商再到深圳、无锡两座城市政府,几周内完成了全覆盖式扩散),但也明确表达了担忧:希望中国不只是「消费开源」,而是通过维护者、专职资源和长期路线图贡献来支撑项目的可持续性。

信源:https://x.com/kevinsxu/status/2032117119324729585?s=20
淘宝桌面版v2.5.0上线AI插件,一键接入OpenClaw等智能体

淘宝桌面版 3 月 11 日发布 v2.5.0 更新,上线 AI 插件功能,支持一键配置 OpenClaw、QoderWork 等多款 AI 智能体,用户可在客户端内随时切换。淘宝桌面版此前已上线 AI 购物助手「帮我挑」、AI 商品对比、全局 AI 搜索等功能,此次新增了对多款智能体的插件化支持。

OpenClaw 是开源 AI Agent 框架,GitHub 星标超 30 万。QoderWork 是阿里推出的桌面级智能体工具,可通过自然语言操控本地应用完成文件整理、数据处理等任务,3 月 3 日面向全部用户开放。此次更新还新增消息独立窗口模式和右键商品快速对比、图片搜索功能。

信源:https://jianghu.taobao.com/detail/47301_28562306
OpenClaw星标突破30万冲进GitHub全站第9:不到半年从周末项目变成开源史上最快增长纪录

OpenClaw 的 GitHub 星标已突破 30 万(截至 3 月 13 日约 30.8 万),在 GitHub 全站星标排行榜中位列第 9,仅次于 build-your-own-x、awesome、freeCodeCamp 等长年积累的学习资源类项目。作为对比,Facebook 的 React 积累十余年为 24.4 万星,Linux 内核超过 30 年为 22.2 万星。

OpenClaw 由 Peter Steinberger 于 2025 年 11 月以周末项目开源(原名 Clawdbot),发布后数月默默无闻。今年 1 月 26 日项目突然走红,当天获 9,000 星,三天到 6 万,一周破 10 万,两周达 19 万;走红次日因 Anthropic 商标要求改名,经两次更名后定为 OpenClaw。2 月底项目超越 Linux 内核,3 月初超越 React,不到两个月完成了别人十几年的积累。贡献者已达 1,177 人,fork 数 5.8 万。目前排在 OpenClaw 前面的 8 个项目均为知识库、教程列表或学习路径等静态资源集合,OpenClaw 是前 10 中唯一的活跃软件项目。

信源:https://github.com/EvanLi/Github-Ranking/blob/master/Top100/Top-100-stars.md
谷歌推出Ask Maps,用Gemini把地图变成对话式搜索引擎

谷歌在 Google Maps 中推出「Ask Maps」功能,用户可以用自然语言提问复杂的现实问题,比如「手机快没电了,附近哪里可以充电又不用排长队买咖啡?」。系统会基于超过 3 亿个地点和 5 亿贡献者的评价数据给出个性化推荐,并在地图上可视化展示结果。用户可以直接在地图内预订餐厅、保存地点或分享给朋友。

Ask Maps 现已在美国和印度的 iOS 和 Android 端开始推出,桌面端即将跟进。同时发布的还有 Immersive Navigation,谷歌称这是十余年来最大规模的导航界面升级:提供沿途建筑和地形的 3D 实景视图,在关键路口高亮显示车道、人行道、红绿灯和停车标志,并通过 Gemini 分析 Street View 和航拍图像来实现空间感知。

信源:https://blog.google/products-and-platforms/products/maps/ask-maps-immersive-navigation/
OpenAI Codex Automations正式可用:可选模型和推理等级,支持worktree隔离和模板复用

OpenAI 宣布 Codex 桌面应用的 Automations 功能正式可用(GA)。Automations 允许用户设置定时或触发式自动化任务,此次转正后新增三项能力:可自定义运行时使用的模型和推理等级,可选择任务在 Git worktree(隔离工作目录)还是现有分支上执行,以及支持通过模板快速复用已有工作流。适用场景包括每日仓库状态简报、issue 自动分流、PR 评论跟进等重复性开发运维工作。

同日 Codex 桌面应用还上线了自定义主题功能,用户可自选配色方案,也可导入或分享社区主题。

信源:https://x.com/OpenAIDevs/status/2032222711032971548
xAI从Cursor挖走两名产品工程负责人,加速追赶AI编程赛道

xAI 已聘用 AI 编程工具 Cursor 的两名高级管理者 Andrew Milich 和 Jason Ginsberg,两人此前共同负责 Cursor 的产品工程。Elon Musk 本周三在 Abundance 大会上承认「Grok 目前在编程方面落后」,并表示他当天迟到的原因,是正在参加一场关于如何在编程领域超越竞争对手的全员会议。

Musk 随后在 X 上回复关于新聘用的帖子时写道:「xAI 最初构建时并不成功,因此正在从头开始重建。特斯拉也经历过同样的问题。」

信源:https://www.theinformation.com/articles/xai-hires-two-senior-leaders-cursor-catch-coding
xAI联合创始人持续出走,Musk之外的11位联合创始人仅剩2人

xAI 联合创始人 Zihang Dai 本周离职,另一位联合创始人 Guodong Zhang 今日在 X 上确认这是他在 xAI 的最后一天。Zhang 直接向 Musk 汇报,负责 Grok Code(编程 agent)和 Grok Imagine(AI 图像和视频生成)两个关键项目。

今年 1 月以来,xAI 已有 Toby Pohlen、Jimmy Ba、Tony Wu 和 Greg Yang 四位联合创始人相继离开。Dai 和 Zhang 离开后,2023 年与 Musk 一起创办 xAI 的 11 位联合创始人中将仅剩 Manuel Kroiss 和 Ross Nordeen 两人。Musk 上月宣布对 xAI 进行组织重组,裁减了部分员工,涉及面向企业办公场景的 Macrohard 项目和 Grok Imagine 团队。

信源:https://www.businessinsider.com/xai-cofounders-guodong-zhang-zihang-dai-depart-elon-musk-company-2026-3
OpenClaw发布2026.3.12版:全新Gateway控制面板,支持GPT-5.4和Claude快速模式,修复10余项安全漏洞

OpenClaw 发布 2026.3.12 版本,包含 7 项功能更新和大量修复。最主要的新功能是重构了 Gateway 控制面板(dashboard-v2),采用模块化设计,拆分出概览、对话、配置、Agent、会话等独立视图,新增命令面板、移动端底部导航栏,对话界面加入斜杠命令、搜索、导出和置顶消息。

模型支持方面,新增 OpenAI GPT-5.4 和 Anthropic Claude 的 fast mode(快速模式),用户可在会话级别通过 /fast 命令切换,每个模型可独立配置默认值。本地模型架构也做了重构,将 Ollama、vLLM、SGLang 迁移到 provider-plugin 插件架构,使接入新模型提供者更加模块化。此外新增了 Kubernetes 部署路径(含原始 manifest、Kind 本地集群和部署文档)和 Slack Block Kit 消息支持。

安全修复是本次更新的重头:共修复 10 余项经 GitHub Security Advisory(GHSA)编号的安全漏洞,涉及设备配对凭证泄露、工作区插件未授权自动加载、Unicode 零宽字符绕过命令审批、沙箱子 Agent 越权读取父会话等问题。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.3.12
xAI前员工公开回应Musk「重建」言论:曾因收集用户改进Grok的建议被主管威胁,「我认识的人全走了」

xAI 前员工 Benjamin De Kraker 今日在 X 上发长帖回应 Musk「xAI 一开始没建好,正在从基础重建」的推文,详述了自己在 xAI 的经历。De Kraker 称,入职时 xAI 强调「扁平结构」和「主动性」,他利用自己在 X 上的 AI 领域关注度,公开征集用户对改进 Grok 的建议。帖子意外走红,id Software 创始人 John Carmack 转发后大量建议涌入。但次日他收到主管的威胁邮件,被要求删除所有帖子,X 账号也被公司暂停。

De Kraker 称 xAI 内部「充满了中层管理者」,员工满怀热情进来,想法却被管理层打压。他说当初威胁他的主管已经离开,「我在 xAI 认识的所有人都走了。」De Kraker 于 2025 年 2 月因在 X 上发布 AI 模型编程能力排名(提及了未发布的 Grok 3)被公司要求删帖,拒绝后选择辞职,该事件当时已被多家科技媒体报道。

此前报道,xAI 联合创始人 Zihang Dai 本周离职,另一位联合创始人 Guodong Zhang 今日在 X 上确认这是他在 xAI 的最后一天。Zhang 直接向 Musk 汇报,负责 Grok Code(编程 agent)和 Grok Imagine(AI 图像和视频生成)两个关键项目。

信源:https://x.com/BenjaminDEKR/status/2032252408214994988
前字节Seed视觉模型核心成员田值创业做Openclaw方向公司,已获王慧文投资

前字节跳动 Seed 高级算法科学家田值(职级 4-1)创立的 AI 智能体公司 Maxgent 正式浮出水面,3 月 12 日晚发布招聘信息,招聘后端、客户端、前端工程师、Agent 产品经理及运营人员。Maxgent 主攻海外市场的 OpenClaw 方向,已获美团联合创始人王慧文投资。

田值本科毕业于四川大学,博士毕业于澳大利亚阿德莱德大学,师从沈春华教授,是目标检测领域知名算法 FCOS 的提出者。2021 年加入美团任应用科学家,2023 年初加入王慧文创立的「光年之外」,光年被美团收购后转入字节 Seed 团队,深度参与了视频生成模型 Seedance 的研发。此次创业相当于田值第二次追随王慧文。核心团队还包括 Chatbox 创始人。

信源:https://mp.weixin.qq.com/s/QulQi6ec6DIJpBnuISrK3A