动察Beating AI News
3.16K subscribers
890 photos
2 videos
1 file
3.41K links
AI新闻信息流
Download Telegram
「看起来是在试图摧毁Anthropic」:联邦法官公开质疑五角大楼

旧金山联邦法院法官 Rita Lin 在 Anthropic 诉五角大楼案听证会上称国防部的做法「令人不安」:「我不确定这是否算谋杀,但看起来是在试图摧毁 Anthropic。」她质疑 Anthropic 是否因在媒体上批评政府合同立场而遭到惩罚。

Anthropic 此前因拒绝移除防止 AI 用于全自主武器和大规模国内监控的安全防护措施而被列入黑名单。Anthropic 请求法院在诉讼期间恢复被标记前的状态,以减轻声誉损害。

信源:https://www.axios.com/2026/03/24/judge-pentagon-anthropic-troubling
亚马逊收购纽约人形机器人公司Fauna,42英寸高、会走会跳舞

亚马逊收购了纽约人形机器人创业公司 Fauna Robotics,交易已于上周完成。Fauna 正在开发一款约 42 英寸(107 厘米)高的类人机器人,具备行走、抓取物品、跳舞和与人互动能力,定位消费级市场。

亚马逊此前在仓储物流中大规模部署工业机器人,收购 Fauna 标志着其将触角正式伸向消费级人形机器人。这也是继谷歌 DeepMind 扩大机器人合作伙伴版图、Meta 密集收购 Agent 团队之后,又一家科技巨头加注具身智能。

信源:https://www.bloomberg.com/news/articles/2026-03-24/amazon-acquires-fauna-robotics-entering-consumer-humanoid-market
ChatGPT购物大转向:拍照比价取代一键下单,沃尔玛Shopify同日接入

OpenAI 上线改版后的 ChatGPT 购物体验。此前未能起量的 Instant Checkout 一键结账功能已被放弃,新版转向商品发现模式:用户可拍照上传或文字描述想买的商品,设定预算和偏好,ChatGPT 返回可视化比价结果。

商家通过两种方式接入:共享商品数据让产品直接展示在 ChatGPT 中,或开发 ChatGPT 内嵌应用掌控完整购物和结账体验。Target、丝芙兰、Nordstrom 已率先接入。沃尔玛同日上线 ChatGPT 内置购物服务,支持关联会员账户和 Walmart Pay。Shopify 也宣布推出「Agentic Plan」,让非 Shopify 商家也能通过其工具在 ChatGPT 和 Gemini 中展示商品。

信源:https://www.cnbc.com/2026/03/24/openai-revamps-shopping-experience-in-chatgpt-after-instant-checkout.html
Cloudflare发布Dynamic Workers:AI Agent代码启动快100倍,每天2毫美元

Cloudflare 发布 Dynamic Workers(公开测试版),采用基于 V8 引擎的轻量级隔离沙盒架构,按需创建、执行完立即销毁。启动耗时毫秒级,比传统 Linux 容器快 100 倍,内存效率高 10 至 100 倍,单个 Worker 仅需几 MB 内存。定价 $0.002/Worker/天。

Cloudflare 去年九月推出「Code Mode」策略:AI Agent 直接编写代码调用 API,而非通过 MCP 逐步发起工具调用。将 MCP 服务器转为 TypeScript API 后,token 消耗减少 81%。配套发布 @cloudflare/codemode、@cloudflare/worker-bundler、@cloudflare/shell 三个 npm 包。

信源:https://t.co/c36Vkb7I0R
OpenAI Foundation宣布未来一年至少投入10亿美元,聚焦疾病研究和AI安全

OpenAI 旗下非营利机构 OpenAI Foundation 董事会主席 Bret Taylor 发文公布基金会最新进展,宣布未来一年将至少投入 10 亿美元,覆盖生命科学、就业与经济影响、AI 安全韧性和社区项目四大方向。这笔支出是此前宣布的 250 亿美元总承诺的一部分。

生命科学方面,基金会将与研究机构合作,利用 AI 攻克阿尔茨海默病的疾病通路映射、生物标志物检测和个性化治疗,同时创建开放医疗数据集,并针对资金长期不足的高死亡率疾病领域组织 AI 研究者与疾病专家联合工作坊。该方向由 Jacob Trefethen 负责,他此前在慈善咨询机构 Coefficient Giving 管理超 5 亿美元拨款。

AI 安全韧性方向由 OpenAI 联合创始人 Wojciech Zaremba 领导,聚焦三个领域:AI 对儿童和青少年的影响研究与安全措施开发、生物安全威胁的检测与防御、以及支持独立的 AI 模型安全测试和行业标准建设。

人事方面,基金会同步宣布多项任命:Robert Kaiden 出任 CFO,此前在德勤、Twitter 和旅游公司 Inspirato 担任高管;Anna Makanju 将于 4 月中旬加入,担任 AI for Civil Society and Philanthropy 负责人,此前为 OpenAI 全球影响力副总裁;Jeff Arnold 任运营总监,他是 OpenAI 早期成员。基金会目前仍在招募执行董事。

去年 10 月,OpenAI 宣布从非营利组织重组为公益公司,原非营利实体以 OpenAI Foundation 的名义保留对公司的控制权和财务权益。此次大规模支出计划是重组后基金会的首批重大举措。

信源:https://openaifoundation.org/news/update-on-the-openai-foundation
Palantir CTO称对伊朗行动为「首个AI驱动的重大冲突」:48小时2000次打击

Palantir CTO Shyam Sankar 在 Fox News 节目上称美国对伊朗的「壮阔之怒」行动(Operation Epic Fury,2 月 28 日启动)是首个 AI 在军事打击中发挥核心作用的重大冲突。他称 48 小时内完成约 2000 次打击,「规划在以往同等规模冲突所需时间的零头内完成,每天的打击量超过此前同类行动的两倍。」据华盛顿邮报和 NBC 报道,Palantir 的 AI 目标生成平台 Maven 在行动首 24 小时内生成了约 1000 个优先打击目标。

Sankar 将人机协作比喻为「钢铁侠战甲」,强调决策权仍由人类掌握。围绕该行动的争议持续发酵,有报道称一次打击击中伊朗女子学校造成超 100 名平民死亡,特朗普政府声称该打击由伊朗自身军队实施,国防部正在调查。

信源:https://www.foxnews.com/media/palantir-executive-says-ai-enabling-rapid-battlefield-planning-high-speed-us-strike-operations
OpenAI COO:AI瓶颈已从电力转向内存芯片

OpenAI COO Brad Lightcap 在华盛顿 Hill and Valley Forum 上表示,内存芯片短缺是当前 AI 基础设施扩张的首要瓶颈:「现在是内存。过去是电力。」

科技公司正消耗越来越多的内存芯片产能,大量采购英伟达 AI 加速器是主因。内存短缺已从 AI 行业蔓延至消费电子和汽车。

信源:https://www.bloomberg.com/news/articles/2026-03-24/openai-s-lightcap-sees-memory-shortage-as-bottleneck-risk-for-ai
Meta让CTO接管「AI原生」转型:Bosworth从元宇宙转向AI For Work

Meta 任命 CTO Andrew Bosworth(内部称 Boz)负责公司「AI For Work」计划,接替此前负责人 Guy Rosen。Bosworth 2006 年加入 Facebook,2022 年出任 CTO,此前主管 VR/AR 元宇宙业务。今年 1 月 Meta 裁撤元宇宙部门约 1500 个岗位后,将投入转向 AI 眼镜等方向。

Bosworth 在内部备忘录中称:「早期试点、对新想法的压力测试意愿,以及让团队快速拥抱 AI 工具的速度,创造了真正的动力。」AI For Work 旨在加速 AI 在 Meta 7.8 万人团队中的全面应用。

信源:https://www.wsj.com/tech/ai/meta-names-new-leader-of-companys-efforts-to-become-ai-native-8d7fe912
一句pip install偷光所有密钥:Karpathy称LiteLLM投毒为「软件界最恐怖的事」

OpenAI 创始成员 Andrej Karpathy 发帖称 AI 代理开发工具 LiteLLM 遭遇的供应链攻击是「现代软件中基本上最恐怖的事」。LiteLLM 月下载量 9700 万次,v1.82.7 和 v1.82.8 两个中毒版本已从 PyPI 下架。

仅一句 pip install litellm 就足以窃取机器上的 SSH 密钥、AWS/GCP/Azure 云凭证、Kubernetes 配置、git 凭证、环境变量(含所有 API 密钥)、shell 历史记录、加密钱包、SSL 私钥、CI/CD 密钥和数据库密码。恶意代码通过 4096 位 RSA 加密打包数据外传至伪装域名 models.litellm.cloud`,还会尝试在 Kubernetes 集群的 `kube-system 命名空间中创建特权容器植入持久后门。

更危险的是传染性:任何依赖 LiteLLM 的项目都会连带中招,例如 `pip install dspy`(依赖 litellm>=1.64.0)同样会触发恶意代码。中毒版本在 PyPI 上仅存活约 1 小时便被发现,原因颇为讽刺:攻击者自己的恶意代码有个 bug,导致内存耗尽崩溃。开发者 Callum McMahon 在 AI 编程工具 Cursor 中使用一个 MCP 插件时,LiteLLM 作为传递依赖被拉入,安装后机器直接崩溃,由此暴露了攻击。Karpathy 评论称:「如果攻击者没有 vibe code 这次攻击,它可能数天甚至数周都不会被发现。」

攻击组织 TeamPCP 于 2 月底利用 LiteLLM 的 CI/CD 管道中 Trivy 漏洞扫描器在 GitHub Actions 中的配置缺陷入侵,窃取了 PyPI 发布令牌,随后绕过 GitHub 直接向 PyPI 上传恶意版本。LiteLLM 维护方 Berri AI CEO Krrish Dholakia 表示已删除所有发布令牌,计划转向基于 JWT 的可信发布机制。PyPA 发布安全通告 PYSEC-2026-2,建议所有安装过受影响版本的用户假设环境中所有凭证已泄露,应立即轮换。

信源:https://x.com/karpathy/status/2036487306585268612
OpenAI完成下一代模型Spud预训练,Altman卸下安全职责全力建数据中心

OpenAI CEO Sam Altman 在全员会上宣布,公司下一代主力模型代号 Spud 已完成预训练,预计「几周内」会有一个「非常强的模型」,Altman 称团队相信它「真的能推动经济发展」。

Altman 同时宣布将 AI 安全(safety)团队移交首席研究官 Mark Chen 的研究部门,信息安全(security)团队划归联合创始人兼总裁 Greg Brockman 领导的「规模化」部门,自己将专注于融资、供应链和「以前所未有的规模建设数据中心」。高管 Fidji Simo 负责的产品部门更名为「AGI Deployment」。OpenAI 上周已告知员工,将把 ChatGPT、编程 Agent Codex 和浏览器 Atlas 合并为桌面端「超级应用」。

信源:https://www.theinformation.com/articles/openai-ceo-shifts-responsibilities-preps-spud-ai-model
全球仅三家:火山引擎日均词元(Token)调用破百万亿,不到两月涨超60%

字节跳动云计算业务火山引擎的日均云端大模型调用量已超过 100 万亿词元(Token),春节以来不到两个月上涨超 60%。全球目前仅 OpenAI、谷歌与字节跳动三家公司达到这一量级,字节的消耗主要来自中国市场,海外市场处于快速增长阶段。

火山引擎人士称,增长还是在约束条件下实现的,视频生成模型 Seedance 2.0 API 尚未在海外正式上线。过去一个多月,来自个人用户的词元(Token)消耗增长了约 16 倍,OpenClaw 等 Agent 产品将 AI 推向大众用户是主要推动力。

火山引擎此前定下 2026 年 MaaS(模型即服务)业务收入超百亿元的目标,随着 Seed 2.0、Seedance 2.0 等模型发布和 OpenClaw 持续爆火,团队已上调收入目标。字节在国内云计算起步最晚,将 MaaS 视为弯道超车的核心战场。

国家数据局昨日披露,中国日均词元(Token)调用量今年 3 月已突破 140 万亿。2024 年初这一数字为 1000 亿,2025 年底跃升至 100 万亿,两年增长超千倍。

信源:https://mp.weixin.qq.com/s/sHL6k9vf8UNgYkfaj2qmbA
商汤下半年EBITDA上市后首次转正:全年营收破50亿增33%,亏损收窄近六成

商汤科技发布 2025 年全年业绩公告,总收入超 50 亿元,同比增长 33%,创历史新高,增幅为近三年最快。全年净亏损收窄 58.6%,下半年息税折旧摊销前利润(EBITDA)为 3.8 亿元,上市后首次转正。下半年经营性现金流也自上市以来首次实现正向净流入,贸易应收回款达 48.7 亿元创历史新高。

其中生成式 AI 业务增长 51%。泛办公领域的小浣熊家族累计服务 1500 万个人用户与数千家企业客户,全年月活增长 7 倍。商汤宣布将于 2026 年第二季度推出基于第二代 NEO 架构的全新模型,去年 12 月商汤发布并开源了首代 NEO 原生多模态模型架构。

信源:https://www.ithome.com/0/932/300.htm
博通称台积电产能触顶:AI芯片供应链全面吃紧,PCB交期从6周拉到半年

芯片设计公司博通的物理层产品部门产品营销总监 Natarajan Ramachandran 表示,台积电的生产产能正在触及上限,「几年前我还会说它的产能是无限的」。他称台积电将在 2027 年前扩充产能,但 2026 年这一产能瓶颈已经「卡住了供应链」。

短缺已蔓延至半导体以外。Ramachandran 称激光器领域出现明显供应约束,PCB(印刷电路板)成为「意想不到的」瓶颈,用于光收发器的 PCB 交期从约 6 周拉长至 6 个月,台湾和中国大陆的 PCB 供应商均面临产能上限。许多客户正与供应商签订 3 至 4 年的长期协议以锁定产能,三星电子上周也表示正与主要客户转向 3 至 5 年的长约。

信源:https://www.reuters.com/world/asia-pacific/broadcom-flags-supply-constraints-says-tsmc-capacity-bottleneck-2026-03-24/
全球最大主权基金半数员工用Claude编程,下一步让AI自主做投资决策

管理 2.1 万亿美元资产的挪威主权财富基金(Norges Bank Investment Management)约半数员工已在使用 Anthropic 的 Claude 大语言模型自行编写 AI 工具。基金机器学习与 AI 负责人 Stian Kirkeberg 在一场 AI 研讨会上介绍,员工主要用这些工具辅助决策,包括监控基金投资的 7000 家公司的 ESG 和财务风险、模拟合同谈判、准备公司会议等。

Kirkeberg 表示,未来将允许部分 AI 智能体在人类监督下自主做出有限决策。「原则是让 AI 为我们分析,从而做出更好的人类决策,」他说,「到某个阶段,我们会信任智能体能做出部分决策,我们只需监控它的行为。」他强调目前尚未实施这一模式,人类监督仍不可或缺。

基金 CEO Nicolai Tangen 曾称不采用 AI 的公司是「彻头彻尾的蠢货」(complete morons)。他表示基金在 AI 上投入了「数百万克朗」,回报达到「数十亿克朗」级别。基金目前已在用 AI 分析交易时机以降低交易成本,员工规模将维持约 700 人,但岗位将从后台行政向前端投资转移。

信源:https://www.reuters.com/business/norway-wealth-fund-moves-towards-some-ai-driven-decisions-with-humans-control-2026-03-24/
黄金穹顶核心软件首次曝光:Anduril和Palantir牵头,军工巨头反当分包商

Anduril Industries 和 Palantir 正在牵头开发特朗普政府 1850 亿美元「黄金穹顶」反导防御系统的核心指控软件,目标今年夏天完成测试。参与开发的还包括从谷歌母公司 Alphabet 脱胎的网络公司 Aalyria Technologies、AI 创业公司 Scale AI 和软件公司 Swoop Technologies。

该软件被项目负责人、太空军上将 Michael Guetlein 称为「胶水层」,负责连接分布在不同军种的雷达、太空传感器和导弹拦截系统,让指挥官统一调度武器应对空中威胁。Guetlein 称:「我们从第一天就认识到,指挥与控制将是我们的核心优势。」该软件是唯一由 Guetlein 办公室直接管理的黄金穹顶项目。

传统上直接与五角大楼签约的洛克希德·马丁、诺斯罗普·格鲁曼和 RTX 三家军工巨头,在该项目中反而以分包商身份加入,为科技公司提供支持。Anduril 本月还赢得了美国陆军一项价值最高 200 亿美元的十年期合同。

信源:https://www.wsj.com/politics/national-security/anduril-palantir-are-developing-golden-dome-missile-shields-software-63c36db4?gaa_at=eafs&gaa_n=AWEtsqcuLJJO8XhVNlJ_6GZuvQM_CMBMyjLtQoFD3Hf9em_xcc2CgnLniiD4P-L-N2E%3D&gaa_ts=69c36170&gaa_sig=JS5g9nFvUsiNB-zowWEe_JSDSTdDzO-t76sPPJXM-f0PjOZ_6_k0Wno4Ph_xEA3R4V0vRw4Hp9HksHmr-pQX5w%3D%3D
GPT-5.2也只答对四分之一:Sierra发布τ³-Bench测出AI Agent真实水平

AI 智能体公司 Sierra 发布 τ³-Bench 基准测试,在 2024 年 6 月推出的 τ-Bench 基础上新增知识库和语音两个评估维度。

τ-Knowledge 构建了一个金融科技客服场景 τ-Banking,包含 698 篇文档、21 个产品类别、约 19.5 万 token 的知识库。智能体需要在其中检索正确策略文档,推理并执行多步工具调用,例如找到争议交易的退款政策、冻结银行卡、发起争议并发放临时信用额度,且顺序必须正确。表现最好的前沿模型 GPT-5.2(高推理模式)仅通过约 25% 的任务;即使直接提供完成任务所需的全部文档,通过率也只升至 40%,表明瓶颈不仅在于检索,更在于理解信息并正确执行操作。

τ-Voice 在 OpenAI Realtime、谷歌 Gemini Live 和 xAI Grok Voice 三家语音服务上进行测试,模拟真实通话环境:带口音的用户从嘈杂咖啡店拨入,网络信号不稳,且会随时打断智能体。在理想条件下,最佳语音智能体的任务完成率接近非推理文本模型(约 54% 对比 31%-51%),引入真实音频条件后降至 26%-38%。文本推理模型可达约 85%,差距悬殊。身份验证是最大的失败点,智能体一旦听错用户姓名或邮箱地址,后续所有操作都会连锁失败。

此次更新还纳入了亚马逊 τ²-Bench Verified 团队和 Anthropic 等提交的社区修正,提升了原有航空、零售和电信场景的评估准确性。

信源:https://sierra.ai/blog/bench-advancing-agent-benchmarking-to-knowledge-and-voice
问一句话终端长出仪表盘:Vercel json-render推出Generative TUI

Vercel 开源 Generative UI 框架 json-render 的创建者 Chris Tate 发布终端渲染器 @json-render/ink,将 AI 生成界面的能力带入命令行。用户输入自然语言提问,即可在终端中实时渲染包含图表、表格、指标卡片等组件的数据仪表盘,演示中展示了一个完整的 iPhone 销售趋势面板,含柱状图、季度明细表和市场份额图。

该渲染器基于 Ink(基于 React 的终端 UI 库)构建,提供 27 个预置组件,支持流式渲染,AI 生成的 JSON spec 随模型响应逐步呈现。开发者可通过 npx skills add vercel-labs/json-render --skill ink 一键安装为 Claude Code skill。

json-render 今年 1 月开源,GitHub 星标超 1.33 万,支持 React、Vue、Svelte、SolidJS、React Native、PDF、邮件、终端和 3D 场景共 9 个渲染目标,均从同一组件目录生成。核心机制是 AI 只能使用开发者预定义的组件,输出受 JSON schema 约束,确保可预测性。

信源:https://x.com/ctatedev/status/2036149934441783691
元宝派上电脑了:视频连麦、共享屏幕、边聊边问AI

腾讯 AI 助手元宝宣布「元宝派」电脑版正式上线。元宝派是今年 1 月内测的多人社交空间,深度打通微信和 QQ,用户将元宝电脑版升级至最新版本后可在侧边栏进入。

电脑版新增视频连麦和屏幕共享功能,连麦时弹出独立窗口,可同步电脑声音并自定义画质。用户在群聊中可随时 @元宝 提问,不用退出对话即可调用 AI。手机与电脑消息实时同步,文件拖入聊天框即可上传。龙虾(OpenClaw)Bot 也已登陆电脑端,3 月 24 日至 4 月 1 日每天中午 12 点和晚 8 点可免费领取,每只自带 Token 额度。

信源:https://mp.weixin.qq.com/s/10A13ZuOVNDFQrKDIm6KjA
中国模型上次SWE-rebench全落前十被嘲「刷分」,这次占了四席

SWE-rebench 是一个每月从 GitHub 抽取全新软件工程任务(issue + PR)的实时基准测试,模型无法提前针对题目优化。维护者 Ibragim 3 月 23 日公布榜单更新,取消了此前的示例演示和 80 步操作限制,新增辅助评估任务。

最新前十排名:

1. Claude Opus 4.6:65.3%
2. GPT-5.2 medium:64.4%
3. GLM-5:62.8%
4. GPT-5.4 medium:62.8%
5. Gemini 3.1 Pro Preview:62.3%
6. DeepSeek-V3.2:60.9%
7. Claude Sonnet 4.6:60.7%
8. Claude Sonnet 4.5:60.0%
9. Qwen3.5-397B-A17B:59.9%
10. Step-3.5-Flash:59.6%

智谱 AI 的开源模型 GLM-5(MIT 协议)以 62.8% 排名第三,是榜上最高的开源模型。中国模型占前十中四席,除 GLM-5 外,还有深度求索 DeepSeek-V3.2(第六)、阿里通义千问 Qwen3.5-397B-A17B(第九)以及阶跃星辰 Step-3.5-Flash(第十)。智谱 Z.ai 全球负责人李子玄评论称,上一次 SWE-rebench 更新时中国模型全部落在前十之外,被批评为「benchmaxing」(刷分)。

信源:https://x.com/ZixuanLi_/status/2036114799029821491
AI密钥不再裸奔:Tailscale网关Aperture开放自助注册,Agent调用全程可追踪

组网工具 Tailscale 将其 AI 网关 Aperture 从候补名单制改为自助注册,开发者可直接开通使用,目前为 alpha 阶段。

Aperture 解决的是 AI 时代的密钥扩散问题:开发者将 LLM API 密钥复制到本地 .env 文件、CI 管道、容器、Agent 运行时,每一步都扩大攻击面。Aperture 将密钥集中存储在网关内,客户端通过 Tailscale 身份认证发起请求,网关代为向模型提供商鉴权,密钥不再出现在应用环境中。以 Claude Code 为例,只需将 ANTHROPIC_BASE_URL 设为 http://ai 即可接入,无需在本地存储任何密钥。

目前支持 Anthropic、OpenAI、AWS Bedrock、Google Vertex AI、Google AI Studio、Vercel AI Gateway、OpenRouter 及本地部署模型共 8 类提供商。平台提供按用户和 Agent 维度的 token 消耗与 API 调用量追踪,员工离职或密钥泄露时只需在 Tailscale 中移除权限,无需逐一轮换密钥。Aperture 可独立于 Tailscale 付费计划单独购买。

信源:https://tailscale.com/blog/aperture-self-serve
只看截图就能操作浏览器:AI2开源80亿参数网页Agent,四项基准超GPT-4o方案

非营利 AI 研究机构 AI2(Allen Institute for AI)发布开源视觉网页智能体 MolmoWeb,基于其 Molmo 2 多模态模型构建,提供 4B 和 8B 两个版本,模型权重、训练数据、代码和评估工具全部公开。

MolmoWeb 的核心设计是纯视觉驱动:通过截图理解网页界面,不依赖 HTML 或无障碍树等结构化页面数据。模型在每一步接收任务指令和当前页面截图,生成推理过程和下一步浏览器操作(点击、输入、滚动等),可完成搜索、表单填写、商品比价等日常任务。单张截图远比序列化的页面结构紧凑,且视觉界面在底层代码变动时仍保持稳定。

在 WebVoyager、Online-Mind2Web、DeepShop、WebTailBench 四个主流基准上,MolmoWeb (8B) 均为开源模型最优:WebVoyager 78.2%、DeepShop 42.3%、WebTailBench 49.5%,全面超越此前最强的开源模型 Fara-7B。4B 版本在 30 步限制下也优于 Fara-7B 的 100 步表现。MolmoWeb 还超越了基于 GPT-4o 等闭源模型构建的网页智能体,后者使用了标注截图和结构化页面数据等更丰富的输入。通过测试时扩展(运行多次独立推理取最优),8B 模型在 WebVoyager 上可达 94.7%(pass@4)。

AI2 同步开源训练数据集 MolmoWebMix,包含 3.6 万条人类操作轨迹(覆盖 1100 多个网站、62.3 万个子任务演示)、由文本智能体生成的合成轨迹,以及 220 万组网页截图问答对。训练过程未使用任何闭源视觉智能体的蒸馏数据。

信源:https://allenai.org/blog/molmoweb