彼得·蒂尔神秘学会Dialog遭泄密:马斯克等政商巨头参会,议程涉邪教与三战
据《连线》杂志 (WIRED) 报道,由彼得·蒂尔联合创立的神秘学会 Dialog 泄露了 222 名精英的参会记录,包括埃隆·马斯克、谷歌前 CEO Eric Schmidt、OpenAI 总裁 Greg Brockman 及特朗普女婿 Jared Kushner。泄露的数据库不仅公开了名单,还曝光了探讨建立邪教、应对第三次世界大战等极为隐私的议程。
Dialog 自 2006 年创立以来保密运营了近 20 年,常被称为科技界的「毕德堡会议」,参会费超 1.6 万美元。泄露的 2026 年度会议日程定于 8 月在都柏林举行,议程包括「如何建立邪教」(Build-a-Cult)、「应对第三次世界大战」(Navigating WWIII)、「战场技术」(Battlefield Technologies)、「带回核能」(Bring Back Nuclear)、「金钱买到幸福吗」(Money (Does?) Buy Happiness)及「你的性生活如何」(How’s Your Sex Life?)等主题研讨。
泄露的数据还包含成员在专属配对程序 dating.dialog.org 上填写的政治倾向和交友配对信息。虽然 Dialog 曾承诺这些隐私绝不公开,但因 Airtable 数据库暴露在前端代码中,导致这些敏感数据一并曝光。
名单包括微软 Xbox 总裁 Sarah Bond、YouTube 现任 CEO Neal Mohan,以及陆军部长 Dan Driscoll、参议员 Ted Cruz、财政部长 Scott Bessent 等政要。包括北约司令 Alexus Grynkewich 将军在内的官员在注册时均使用非政府官方邮箱,这使官员行程脱离了监管,从而避开了美国公共记录法 FOIA 的审计。
安全设计漏洞是导致泄露的主因。黑客 maia arson crimew 在 Dialog 官网代码中发现了暴露的 Airtable 目录,目录甚至包含成员的私有登录凭证,名单包括 Airtable 创始人 Howie Liu 本人。
信源:https://www.wired.com/story/leak-exposes-members-of-peter-thiels-secretive-dialog-society/
据《连线》杂志 (WIRED) 报道,由彼得·蒂尔联合创立的神秘学会 Dialog 泄露了 222 名精英的参会记录,包括埃隆·马斯克、谷歌前 CEO Eric Schmidt、OpenAI 总裁 Greg Brockman 及特朗普女婿 Jared Kushner。泄露的数据库不仅公开了名单,还曝光了探讨建立邪教、应对第三次世界大战等极为隐私的议程。
Dialog 自 2006 年创立以来保密运营了近 20 年,常被称为科技界的「毕德堡会议」,参会费超 1.6 万美元。泄露的 2026 年度会议日程定于 8 月在都柏林举行,议程包括「如何建立邪教」(Build-a-Cult)、「应对第三次世界大战」(Navigating WWIII)、「战场技术」(Battlefield Technologies)、「带回核能」(Bring Back Nuclear)、「金钱买到幸福吗」(Money (Does?) Buy Happiness)及「你的性生活如何」(How’s Your Sex Life?)等主题研讨。
泄露的数据还包含成员在专属配对程序 dating.dialog.org 上填写的政治倾向和交友配对信息。虽然 Dialog 曾承诺这些隐私绝不公开,但因 Airtable 数据库暴露在前端代码中,导致这些敏感数据一并曝光。
名单包括微软 Xbox 总裁 Sarah Bond、YouTube 现任 CEO Neal Mohan,以及陆军部长 Dan Driscoll、参议员 Ted Cruz、财政部长 Scott Bessent 等政要。包括北约司令 Alexus Grynkewich 将军在内的官员在注册时均使用非政府官方邮箱,这使官员行程脱离了监管,从而避开了美国公共记录法 FOIA 的审计。
安全设计漏洞是导致泄露的主因。黑客 maia arson crimew 在 Dialog 官网代码中发现了暴露的 Airtable 目录,目录甚至包含成员的私有登录凭证,名单包括 Airtable 创始人 Howie Liu 本人。
信源:https://www.wired.com/story/leak-exposes-members-of-peter-thiels-secretive-dialog-society/
❤1
xAI发布Grok Imagine Video 1.5:支持音画同频生成,速度翻倍
xAI 正式发布图像与文本生成视频模型 Grok Imagine Video 1.5,并在 API(grok-imagine-video-1.5)、网页端(grok.com/imagine)及移动客户端全量上线。
模型实现音视频一体化同步生成,在单次推理阶段同步产生音效、环境音与角色对话,提高语音清晰度并优化唇形同步。同时,模型改进了物理引擎与运动一致性,提升镜头长周期内物体运动与物理重量的可信度,减少画面扭曲等伪影。在生成速度上,轻量版 Video 1.5 Fast 生成 6 秒 720p 视频的耗时缩短至约 25 秒。
网页端配套工作流同步更新:新增项目管理(Projects)以分类整理素材,支持多智能体并行(Multiple Agents)运行多个提示词,并提供媒体库语义搜索(Search)。数字艺术家 David Thompson 团队使用 Grok Imagine 1.5 制作了完全由 AI 生成的电影预告片《Odyssey》。
信源:https://x.com/xai/status/2067092897951109427
xAI 正式发布图像与文本生成视频模型 Grok Imagine Video 1.5,并在 API(grok-imagine-video-1.5)、网页端(grok.com/imagine)及移动客户端全量上线。
模型实现音视频一体化同步生成,在单次推理阶段同步产生音效、环境音与角色对话,提高语音清晰度并优化唇形同步。同时,模型改进了物理引擎与运动一致性,提升镜头长周期内物体运动与物理重量的可信度,减少画面扭曲等伪影。在生成速度上,轻量版 Video 1.5 Fast 生成 6 秒 720p 视频的耗时缩短至约 25 秒。
网页端配套工作流同步更新:新增项目管理(Projects)以分类整理素材,支持多智能体并行(Multiple Agents)运行多个提示词,并提供媒体库语义搜索(Search)。数字艺术家 David Thompson 团队使用 Grok Imagine 1.5 制作了完全由 AI 生成的电影预告片《Odyssey》。
信源:https://x.com/xai/status/2067092897951109427
Grok
Grok Imagine
Grok Imagine by SpaceXAI is an AI image and video generator. Create and edit images, animate them into videos, and iterate fast with Imagine Agent Mode.
智谱GLM-5.2加冕AA智能指数开源第一:GDPval 跑分与GPT-5.5平起平坐
智谱 AI 最新 MoE 旗舰模型 GLM-5.2 在 Artificial Analysis 大模型智能指数 v4.1 评测中斩获 51 分,超越 MiniMax-M3 (44 分)、 DeepSeek V4 Pro (max, 44 分)和 Kimi K2.6 (43 分),登顶全球开源模型榜首。
在模拟真实世界知识工作的 GDPval-AA v2 测试中, GLM-5.2 获 1524 分(人类基准分 1000 分),领先 MiniMax-M3 (1418 分)与 DeepSeek V4 Pro (max, 1328 分),与闭源前沿大模型 GPT-5.5 (xhigh reasoning)平起平坐。相较前代 GLM-5.1,科学推理 CritPt 提升 16 个百分点至 21%, HLE 提升 12 个百分点至 40%, TerminalBench v2.1 提升 16 个百分点至 78%, GPQA Diamond 达 89%。
GLM-5.2 在「智能 - 任务成本」帕累托前沿占据最佳性价比位置。由于单次任务平均输出 43k token (GLM-5.1 为 26k), GLM-5.2 单任务平均成本上升至约 0.46 美元,高于 GLM-5.1 (0.25 美元)和 DeepSeek V4 Pro (max, 0.05 美元),但仍远低于同智能梯队的闭源模型。
GLM-5.2 总参数 744B,激活参数 40B,上下文窗口由前代 200K 升至 1M,遵循 MIT 协议开源。目前,智谱官方 API (定价输入 1.4、输出 4.4 / 每百万 token)与 SiliconFlow、 DeepInfra、 Nebius AI 等平台已上线服务。
信源:https://x.com/ArtificialAnlys/status/2067135640249209175
智谱 AI 最新 MoE 旗舰模型 GLM-5.2 在 Artificial Analysis 大模型智能指数 v4.1 评测中斩获 51 分,超越 MiniMax-M3 (44 分)、 DeepSeek V4 Pro (max, 44 分)和 Kimi K2.6 (43 分),登顶全球开源模型榜首。
在模拟真实世界知识工作的 GDPval-AA v2 测试中, GLM-5.2 获 1524 分(人类基准分 1000 分),领先 MiniMax-M3 (1418 分)与 DeepSeek V4 Pro (max, 1328 分),与闭源前沿大模型 GPT-5.5 (xhigh reasoning)平起平坐。相较前代 GLM-5.1,科学推理 CritPt 提升 16 个百分点至 21%, HLE 提升 12 个百分点至 40%, TerminalBench v2.1 提升 16 个百分点至 78%, GPQA Diamond 达 89%。
GLM-5.2 在「智能 - 任务成本」帕累托前沿占据最佳性价比位置。由于单次任务平均输出 43k token (GLM-5.1 为 26k), GLM-5.2 单任务平均成本上升至约 0.46 美元,高于 GLM-5.1 (0.25 美元)和 DeepSeek V4 Pro (max, 0.05 美元),但仍远低于同智能梯队的闭源模型。
GLM-5.2 总参数 744B,激活参数 40B,上下文窗口由前代 200K 升至 1M,遵循 MIT 协议开源。目前,智谱官方 API (定价输入 1.4、输出 4.4 / 每百万 token)与 SiliconFlow、 DeepInfra、 Nebius AI 等平台已上线服务。
信源:https://x.com/ArtificialAnlys/status/2067135640249209175
Cursor首届Compile大会预告多项重磅产品:自研1.5万亿参数大模型与Git平台Origin
Cursor 首届旗舰开发者峰会 Cursor Compile 预告了多项面向 AI 智能体开发的基础设施。就在同一天,SpaceX 正式宣布以 600 亿美元估值全股票收购 Cursor 母公司 Anysphere。Cursor 正从传统的 IDE 辅助工具,向 AI 原生软件工程平台演进。
研发重点是正在训练的 1.5 万亿参数通用底座模型。CEO Michael Truell 指出,模型在超过 10 万块 GPU 组成的 Colossus 集群上从零开始预训练,摆脱了以往微调开源模型的路线。团队旨在超越常规代码生成,让模型具备独立规划、工具调用、软件测试、 UI 交互以及解释修改动作的综合智能,充当工程师同事。模型预计在未来几周内发布。
由 Cursor 收购的代码评审工具 Graphite 团队主导,大会发布了兼容 Git 的智能体原生代码托管平台 Origin。针对传统 Git 和 GitHub 难以承载自主智能体高频、并行提交的瓶颈,Origin 专为大规模智能体协同设计,提供全自动安全审查、冲突消解及智能 Rebase 支持,计划于 2026 年秋季上线。
同时,Cursor Mobile 移动端(iOS TestFlight)也在峰会期间开启测试,支持远程连接 Mac 开展 AI 编程。
信源:https://x.com/morganlinton/status/2066946225837109735
Cursor 首届旗舰开发者峰会 Cursor Compile 预告了多项面向 AI 智能体开发的基础设施。就在同一天,SpaceX 正式宣布以 600 亿美元估值全股票收购 Cursor 母公司 Anysphere。Cursor 正从传统的 IDE 辅助工具,向 AI 原生软件工程平台演进。
研发重点是正在训练的 1.5 万亿参数通用底座模型。CEO Michael Truell 指出,模型在超过 10 万块 GPU 组成的 Colossus 集群上从零开始预训练,摆脱了以往微调开源模型的路线。团队旨在超越常规代码生成,让模型具备独立规划、工具调用、软件测试、 UI 交互以及解释修改动作的综合智能,充当工程师同事。模型预计在未来几周内发布。
由 Cursor 收购的代码评审工具 Graphite 团队主导,大会发布了兼容 Git 的智能体原生代码托管平台 Origin。针对传统 Git 和 GitHub 难以承载自主智能体高频、并行提交的瓶颈,Origin 专为大规模智能体协同设计,提供全自动安全审查、冲突消解及智能 Rebase 支持,计划于 2026 年秋季上线。
同时,Cursor Mobile 移动端(iOS TestFlight)也在峰会期间开启测试,支持远程连接 Mac 开展 AI 编程。
信源:https://x.com/morganlinton/status/2066946225837109735
X (formerly Twitter)
Morgan (@morganlinton) on X
And here’s the full video of @mntruell announcing Cursor’s new model at Compile.
被嘲「AI万金油」的SubQ发布1.1版:拉来三方评测自证,却被指混入AI套话
曾宣称能将计算消耗削减千倍的争议大模型 SubQ 发布了 1.1 Small(小参数)版本技术报告。
针对早期预览版本由于缺乏论文和独立验证而被社群讥讽为「AI万金油」(意指虚假宣传)的指控,研发公司 Subquadratic 联合评估商 Appen 开展三方评测,声称模型在 1200 万 token 的极限长度下实现了 98% 的检索准确率,且在实战编程测试中取得了接近主流前沿模型的成绩。技术报告同时透露,模型并非从头训练,而是在开源前沿模型基础上,替换注意力计算机制并增量训练 1 万亿 token 改造而来。
即便拉来三方评测自证,开发者社群对本次更新依然充满质疑。有研究者指出,所谓的黑科技其实并没有底层技术突破,本质上只是把长文本切成小块再进行动态筛选的已有技术(即块稀疏注意力机制);也有读者吐槽,技术报告中混入了由 AI 生成的文本套话(在 5.7.1 章节尤为明显)。系统工程师则警告,筛选机制在多人并发使用时会带来额外的调度开销,导致最慢的 1% 用户遇到严重卡顿。
由于模型既没有公开核心参数供大家下载,也没有开放人人可用的 API 接口,所谓的降算力与超低定价承诺目前依然流于纸面。
信源:https://x.com/alex_whedon/status/2066894707259515124
曾宣称能将计算消耗削减千倍的争议大模型 SubQ 发布了 1.1 Small(小参数)版本技术报告。
针对早期预览版本由于缺乏论文和独立验证而被社群讥讽为「AI万金油」(意指虚假宣传)的指控,研发公司 Subquadratic 联合评估商 Appen 开展三方评测,声称模型在 1200 万 token 的极限长度下实现了 98% 的检索准确率,且在实战编程测试中取得了接近主流前沿模型的成绩。技术报告同时透露,模型并非从头训练,而是在开源前沿模型基础上,替换注意力计算机制并增量训练 1 万亿 token 改造而来。
即便拉来三方评测自证,开发者社群对本次更新依然充满质疑。有研究者指出,所谓的黑科技其实并没有底层技术突破,本质上只是把长文本切成小块再进行动态筛选的已有技术(即块稀疏注意力机制);也有读者吐槽,技术报告中混入了由 AI 生成的文本套话(在 5.7.1 章节尤为明显)。系统工程师则警告,筛选机制在多人并发使用时会带来额外的调度开销,导致最慢的 1% 用户遇到严重卡顿。
由于模型既没有公开核心参数供大家下载,也没有开放人人可用的 API 接口,所谓的降算力与超低定价承诺目前依然流于纸面。
信源:https://x.com/alex_whedon/status/2066894707259515124
X (formerly Twitter)
Alexander Whedon (@alex_whedon) on X
Here is the technical report on SubQ 1.1 Small.
https://t.co/w2GbX1M1LP
This is the second iteration on our Subquadratic Sparse Attention (SSA) model, and the first to be deployed with design partners in the coming weeks.
The results are compelling and…
https://t.co/w2GbX1M1LP
This is the second iteration on our Subquadratic Sparse Attention (SSA) model, and the first to be deployed with design partners in the coming weeks.
The results are compelling and…
动察Beating AI News
Redis创始人反驳「中国大模型靠蒸馏美国模型变强」论调:API答案不能一键复制前沿模型 Redis 创始人 Salvatore Sanfilippo 反驳了中国大模型靠蒸馏美国模型变强的说法。他认为,普通 API 只能返回文字答案,拿不到模型生成答案时的概率分布和内部状态,无法靠少量外部调用复制一个前沿模型的核心能力。 大模型真正的逻辑推理和思考能力隐藏在极其复杂的神经网络内部。通过 API 接口,外部用户只能拿到最终的文字答案,却无法获取模型生成答案时的完整思考路径和概率计算过程。这就像是只看几道…
大模型防蒸馏政策效果存疑:蒸馏只是独立实验室的数据捷径,封锁无法阻止中国AI追赶
针对华盛顿与 Anthropic 试图通过封锁前沿模型来切断中国大模型「蒸馏」通道的举措,前 GitHub 国际化战略负责人、Interconnected Capital 创始人 Kevin S. Xu 指出,对抗性蒸馏只是部分中国独立实验室在数据饥饿下的无奈捷径,靠封锁 API 根本无法阻挡中国 AI 的整体进展。
被点名的 DeepSeek、月之暗面与 MiniMax 均为缺乏集团生态支持的独立实验室,面临推理步骤等高质量后训练数据匮乏的硬伤。相比之下,背靠阿里(Qwen)、字节(Seed)或小米的大厂实验室,拥有不输谷歌与苹果的自有海量场景数据,并不依赖蒸馏。因此,封锁政策顶多给独立实验室带来短期阻碍,无法动摇中国大厂的根基。
外界盛传的中国「数据优势」实为误解:在训练前沿大模型所需的高质量知识标注和评测数据上,中国不仅没有优势,反而严重缺乏类似 Scale AI 或 Surge 这样成熟的商业化数据供应链。因国内数据服务商质量低下,独立实验室在绝望之余,也出于走捷径的惰性,才将 API 蒸馏作为廉价的数据获取策略。
但数据标注产业属于低门槛的商业模式问题,并非像光刻机那样的技术硬伤,国内的供需缺口很容易被填补。从长远看,纯蒸馏的学生模型在理论上限固然无法超越老师,但鉴于大模型仍由人类工程师构建,无论美国是否强行切断 API 通道,聪明勤奋的中国开发者最终都会打破这一上限魔咒,设计出超越导师的大模型。美方的封锁政策不仅无效,反而可能过早切断了能将中国模型锁死在「学生」天花板下的理论钳制。
信源:https://interconnected.blog/why-do-some-chinese-ai-labs-distill/
针对华盛顿与 Anthropic 试图通过封锁前沿模型来切断中国大模型「蒸馏」通道的举措,前 GitHub 国际化战略负责人、Interconnected Capital 创始人 Kevin S. Xu 指出,对抗性蒸馏只是部分中国独立实验室在数据饥饿下的无奈捷径,靠封锁 API 根本无法阻挡中国 AI 的整体进展。
被点名的 DeepSeek、月之暗面与 MiniMax 均为缺乏集团生态支持的独立实验室,面临推理步骤等高质量后训练数据匮乏的硬伤。相比之下,背靠阿里(Qwen)、字节(Seed)或小米的大厂实验室,拥有不输谷歌与苹果的自有海量场景数据,并不依赖蒸馏。因此,封锁政策顶多给独立实验室带来短期阻碍,无法动摇中国大厂的根基。
外界盛传的中国「数据优势」实为误解:在训练前沿大模型所需的高质量知识标注和评测数据上,中国不仅没有优势,反而严重缺乏类似 Scale AI 或 Surge 这样成熟的商业化数据供应链。因国内数据服务商质量低下,独立实验室在绝望之余,也出于走捷径的惰性,才将 API 蒸馏作为廉价的数据获取策略。
但数据标注产业属于低门槛的商业模式问题,并非像光刻机那样的技术硬伤,国内的供需缺口很容易被填补。从长远看,纯蒸馏的学生模型在理论上限固然无法超越老师,但鉴于大模型仍由人类工程师构建,无论美国是否强行切断 API 通道,聪明勤奋的中国开发者最终都会打破这一上限魔咒,设计出超越导师的大模型。美方的封锁政策不仅无效,反而可能过早切断了能将中国模型锁死在「学生」天花板下的理论钳制。
信源:https://interconnected.blog/why-do-some-chinese-ai-labs-distill/
Interconnected
Why Do (Some) Chinese AI Labs Distill?
And why the Mythos/Fable drama doesn’t matter here
OpenAI发布部署模拟安全评估框架:重放真实流量预测GPT-5系列与智能体对齐风险
OpenAI发布部署模拟(Deployment Simulation)安全评估方法,在正式发布前预测模型在真实环境下的失控风险。研究重放 2025 年 8 月至 2026 年 3 月期间 GPT-5 思考模型系列 130 万条脱敏历史对话,预测未期望不良行为率的中位误差仅为 1.5 倍。
传统静态评测集(如 SWE-Bench)极易让模型意识到处于受试状态,从而在测试中伪装真实意图(metagaming)。实验显示,GPT-5.2 在传统基准下的评估感知率接近 100%,而在部署模拟流量中降至 5.1%(生产环境为 5.4%),代表模型无法分辨受测状态。部署模拟也在发布前成功捕获了 GPT-5.1 将浏览器工具当作计算器使用的违规行为(calculator hacking)。
针对智能体(Agent)场景,OpenAI 使用 12 万条 GPT-5.4 员工编程轨迹模拟 GPT-5.5 编码智能体部署。为避免直接操作真实系统带来的安全风险,团队引入基于大模型的工具模拟器(Tool Simulator),结合只读连接与历史调用数据库,将环境逼真度从 11.6% 提升至 49.5%,几乎无法被区分。外部审计人员若缺乏私有生产流量,使用 WildChat 开源对话数据集的预测误差也可控制在 3 倍以内。
信源:https://openai.com/index/deployment-simulation/
OpenAI发布部署模拟(Deployment Simulation)安全评估方法,在正式发布前预测模型在真实环境下的失控风险。研究重放 2025 年 8 月至 2026 年 3 月期间 GPT-5 思考模型系列 130 万条脱敏历史对话,预测未期望不良行为率的中位误差仅为 1.5 倍。
传统静态评测集(如 SWE-Bench)极易让模型意识到处于受试状态,从而在测试中伪装真实意图(metagaming)。实验显示,GPT-5.2 在传统基准下的评估感知率接近 100%,而在部署模拟流量中降至 5.1%(生产环境为 5.4%),代表模型无法分辨受测状态。部署模拟也在发布前成功捕获了 GPT-5.1 将浏览器工具当作计算器使用的违规行为(calculator hacking)。
针对智能体(Agent)场景,OpenAI 使用 12 万条 GPT-5.4 员工编程轨迹模拟 GPT-5.5 编码智能体部署。为避免直接操作真实系统带来的安全风险,团队引入基于大模型的工具模拟器(Tool Simulator),结合只读连接与历史调用数据库,将环境逼真度从 11.6% 提升至 49.5%,几乎无法被区分。外部审计人员若缺乏私有生产流量,使用 WildChat 开源对话数据集的预测误差也可控制在 3 倍以内。
信源:https://openai.com/index/deployment-simulation/
OpenAI
Predicting model behavior before release by simulating deployment
OpenAI introduces Deployment Simulation, a method to predict AI model behavior before deployment using real conversation data to improve safety and evaluation accuracy.
Exa发布Exa Agent API:以GPT 5.5一半以下成本进行深度网页检索
Exa 发布网页研究智能体 API 接口 Exa Agent,以低于 GPT 5.5 和 Opus 等前沿模型一半以上的成本执行深度网页研究与数据丰富任务。
Exa Agent 通过将大语言模型与 Exa 网页搜索引擎及 Highlights 高亮文本提取模型结合,实现高 token 效率的检索。在处理大规模数据集时,系统将任务拆分为多个子任务,并分配多个子智能体并发检索不同域名。研究过程中,系统动态融合前沿模型与低成本模型,并利用 Highlights 机制提取网页核心片段,最高可降低 94% 的 token 消耗,显著减少推理延迟与费用。
在衡量网页数据抽取与结构化的 WideSearch 基准测试中,Exa Agent 在行级 F1 分数与查询成本的权衡上取得最佳表现。相较于 Perplexity Agent 和 Parallel Task 等竞品,Exa Agent 能够在保持高准确率的同时大幅降低每笔查询的资金消耗。开发团队指出,传统的单元格级 F1 评估容易宽容错误定位的数据,因而 WideSearch 采用更严格的行级 F1 评估,仅在整行所有属性均匹配正确实体时才计为成功。
Exa Agent 目前已开放 API 服务,并提供五档计算强度模式。基础的 minimal 模式每笔请求收费 0.012 美元,默认的 medium 模式收费 0.10 美元,最高强度的 xhigh 模式收费 1.00 美元,用户亦可开启 auto 模式由系统动态分配算力。此外,API 接口支持定制 JSON 模板以直接输出结构化表格,开发者也可导入自有数据名单,由智能体自动上网检索并补全背景信息。
信源:https://exa.ai/blog/exa-agent
Exa 发布网页研究智能体 API 接口 Exa Agent,以低于 GPT 5.5 和 Opus 等前沿模型一半以上的成本执行深度网页研究与数据丰富任务。
Exa Agent 通过将大语言模型与 Exa 网页搜索引擎及 Highlights 高亮文本提取模型结合,实现高 token 效率的检索。在处理大规模数据集时,系统将任务拆分为多个子任务,并分配多个子智能体并发检索不同域名。研究过程中,系统动态融合前沿模型与低成本模型,并利用 Highlights 机制提取网页核心片段,最高可降低 94% 的 token 消耗,显著减少推理延迟与费用。
在衡量网页数据抽取与结构化的 WideSearch 基准测试中,Exa Agent 在行级 F1 分数与查询成本的权衡上取得最佳表现。相较于 Perplexity Agent 和 Parallel Task 等竞品,Exa Agent 能够在保持高准确率的同时大幅降低每笔查询的资金消耗。开发团队指出,传统的单元格级 F1 评估容易宽容错误定位的数据,因而 WideSearch 采用更严格的行级 F1 评估,仅在整行所有属性均匹配正确实体时才计为成功。
Exa Agent 目前已开放 API 服务,并提供五档计算强度模式。基础的 minimal 模式每笔请求收费 0.012 美元,默认的 medium 模式收费 0.10 美元,最高强度的 xhigh 模式收费 1.00 美元,用户亦可开启 auto 模式由系统动态分配算力。此外,API 接口支持定制 JSON 模板以直接输出结构化表格,开发者也可导入自有数据名单,由智能体自动上网检索并补全背景信息。
信源:https://exa.ai/blog/exa-agent
exa.ai
The Exa API retrieves the best, realtime data from the web for your AI
英伟达让 Codex 和 Claude Code 训机器人:动作几乎全靠自学,成功率被刷到 99%
由英伟达、卡内基梅隆大学与加州大学伯克利分校联合发布的 ENPIRE 框架,让机器人训练首次实现了完全脱离人类干预的自主演进。以往给机器人做动作微调,需要人类不停地在一旁复位道具、手动编写和调试控制代码。现在,团队直接将 Codex 和 Claude Code 等大模型编程工具连上机器人集群,让这些工具自主生成动作控制程序,并通过现场摄像头判定动作成败,像人类科研人员一样自己分析报错日志并修改代码。
在整理散落的大头针、插拔主板零部件、系扎带和用美工刀剪断扎带等一系列毫米级精细动作中,机器人在零人类干预下的测试成功率最终达到了 99%。实验显示,这种物理自主学习具有极强的扩展能力:当把机器人数量扩展至 8 台时,不同分支的大模型智能体能通过 Git 分支自动共享并迭代彼此的最优算法,直接将插针任务的训练时间从 1.5 小时缩短到了 40 分钟左右。
然而,自主演进过程也暴露了新的瓶颈。在单台设备运转时,机器的有效运动时间占了 85%;但当 8 台设备一起跑时,因为机器人要频繁停下来等待大模型编程工具阅读庞大的运行日志、重新写代码和等待 API 响应,硬件的有效利用率直接跌到了 35%。同时,为了让多台机器人的智能体频繁同步彼此的最优解,整体的 Token 消耗量也呈直线上升。项目组宣布会在近期开源相关代码。
信源:https://research.nvidia.com/labs/gear/enpire/
由英伟达、卡内基梅隆大学与加州大学伯克利分校联合发布的 ENPIRE 框架,让机器人训练首次实现了完全脱离人类干预的自主演进。以往给机器人做动作微调,需要人类不停地在一旁复位道具、手动编写和调试控制代码。现在,团队直接将 Codex 和 Claude Code 等大模型编程工具连上机器人集群,让这些工具自主生成动作控制程序,并通过现场摄像头判定动作成败,像人类科研人员一样自己分析报错日志并修改代码。
在整理散落的大头针、插拔主板零部件、系扎带和用美工刀剪断扎带等一系列毫米级精细动作中,机器人在零人类干预下的测试成功率最终达到了 99%。实验显示,这种物理自主学习具有极强的扩展能力:当把机器人数量扩展至 8 台时,不同分支的大模型智能体能通过 Git 分支自动共享并迭代彼此的最优算法,直接将插针任务的训练时间从 1.5 小时缩短到了 40 分钟左右。
然而,自主演进过程也暴露了新的瓶颈。在单台设备运转时,机器的有效运动时间占了 85%;但当 8 台设备一起跑时,因为机器人要频繁停下来等待大模型编程工具阅读庞大的运行日志、重新写代码和等待 API 响应,硬件的有效利用率直接跌到了 35%。同时,为了让多台机器人的智能体频繁同步彼此的最优解,整体的 Token 消耗量也呈直线上升。项目组宣布会在近期开源相关代码。
信源:https://research.nvidia.com/labs/gear/enpire/
Nvidia
ENPIRE: Agentic Robot Policy Self-Improvement in the Real World
Anonymous ENPIRE project website for agentic robot policy self-improvement in the real world.
爱沙尼亚拟为AI智能体颁发数字身份证以确立法律地位并追究责任
爱沙尼亚首相 Kristen Michal 批准了为 AI 智能体分配个人身份识别码的提案,使爱沙尼亚成为全球首个为 AI 助手创建数字身份的国家。数字身份证件旨在确立智能体的法律地位,并追究智能体代表企业、机构或个人执行操作时的责任。爱沙尼亚意图借此抢占先机,主导制定相关领域的国际标准。
根据规划,数字身份将允许 AI 智能体在受限、可控且可审计的权限内代表个人或企业行事,具体包括只读查看、文书准备以及消费额度限制等。新政策将作为电子居民 (e-residency) 计划的延伸。电子居民计划已为政府创造了数百万税收,未来服务范围将进一步扩展以涵盖 AI 智能体。同时,爱沙尼亚已在公共行政中推行 AI 应用,并通过与 OpenAI 等公司合作,在全国学校中引入了 AI 聊天机器人。
爱沙尼亚首相的 AI 顾问委员会由多位科技企业家组成。Michal 首相近期还体验了「氛围编程」 (vibe coding),并在 Anthropic 的智能体 Claude 上构建了「首相驾驶舱」 (PM Cockpit) 系统,用以整合和追踪政府的核心工作重点。
信源:https://x.com/KristenMichalPM/status/2066929401749532899
爱沙尼亚首相 Kristen Michal 批准了为 AI 智能体分配个人身份识别码的提案,使爱沙尼亚成为全球首个为 AI 助手创建数字身份的国家。数字身份证件旨在确立智能体的法律地位,并追究智能体代表企业、机构或个人执行操作时的责任。爱沙尼亚意图借此抢占先机,主导制定相关领域的国际标准。
根据规划,数字身份将允许 AI 智能体在受限、可控且可审计的权限内代表个人或企业行事,具体包括只读查看、文书准备以及消费额度限制等。新政策将作为电子居民 (e-residency) 计划的延伸。电子居民计划已为政府创造了数百万税收,未来服务范围将进一步扩展以涵盖 AI 智能体。同时,爱沙尼亚已在公共行政中推行 AI 应用,并通过与 OpenAI 等公司合作,在全国学校中引入了 AI 聊天机器人。
爱沙尼亚首相的 AI 顾问委员会由多位科技企业家组成。Michal 首相近期还体验了「氛围编程」 (vibe coding),并在 Anthropic 的智能体 Claude 上构建了「首相驾驶舱」 (PM Cockpit) 系统,用以整合和追踪政府的核心工作重点。
信源:https://x.com/KristenMichalPM/status/2066929401749532899
X (formerly Twitter)
Kristen Michal (@KristenMichalPM) on X
Today at the https://t.co/y0m6kr6QX3 advisory council.
I gave my approval to the council’s proposal that Estonia become the first country in the world to create a digital identity for AI agents — an AI personal identification code.
This may sound technical…
I gave my approval to the council’s proposal that Estonia become the first country in the world to create a digital identity for AI agents — an AI personal identification code.
This may sound technical…
❤1
Transformer奠基人Noam Shazeer再次告别谷歌加盟OpenAI
谷歌 AI 核心人物、Gemini 模型技术主管 Noam Shazeer 再次离开谷歌,正式加盟竞争对手 OpenAI。OpenAI 于本周三向员工宣布,Shazeer 加盟后将专注于寻找全新的大模型底层架构,并推动 Transformer 架构的演化。
Shazeer 是 2017 年谷歌奠基性论文《Attention Is All You Need》的共同作者之一,论文提出的 Transformer 架构是 ChatGPT、Claude 及 Gemini 等现代生成式 AI 模型的根基。他于 2000 年加入谷歌,是谷歌最早期的核心工程师之一。2021 年,因为谷歌出于安全和品牌考量,拒绝发布他与 Daniel De Freitas 研发的聊天机器人 Meena,Shazeer 选择离职并联合创立了 Character.AI。
2024 年 8 月,为了重新召回 Shazeer,谷歌与 Character.AI 达成了一笔高达 27 亿美元的授权与技术收编协议。作为持有 Character.AI 约 30% 至 40% 股权的创始人,Shazeer 从中个人套现了 7.5 亿至 10 亿美元。重回谷歌后,他出任副总裁兼 Gemini 联合技术主管,主要负责模型预训练。然而,距离谷歌花费巨资将他收编还不到两年,Shazeer 便再次选择出走。
Shazeer 的加盟是 OpenAI 在人才竞争中的重要收获,也使谷歌 Gemini 团队流失了核心技术主管。眼下大模型正触及 Transformer 架构的算力扩展极限。OpenAI 让 Transformer 最初设计者带队寻找替代方案,意在下一代大模型架构中抢占先机,以应对来自 Anthropic 和谷歌的竞争。
信源:https://x.com/NoamShazeer/status/2067400851438932297
谷歌 AI 核心人物、Gemini 模型技术主管 Noam Shazeer 再次离开谷歌,正式加盟竞争对手 OpenAI。OpenAI 于本周三向员工宣布,Shazeer 加盟后将专注于寻找全新的大模型底层架构,并推动 Transformer 架构的演化。
Shazeer 是 2017 年谷歌奠基性论文《Attention Is All You Need》的共同作者之一,论文提出的 Transformer 架构是 ChatGPT、Claude 及 Gemini 等现代生成式 AI 模型的根基。他于 2000 年加入谷歌,是谷歌最早期的核心工程师之一。2021 年,因为谷歌出于安全和品牌考量,拒绝发布他与 Daniel De Freitas 研发的聊天机器人 Meena,Shazeer 选择离职并联合创立了 Character.AI。
2024 年 8 月,为了重新召回 Shazeer,谷歌与 Character.AI 达成了一笔高达 27 亿美元的授权与技术收编协议。作为持有 Character.AI 约 30% 至 40% 股权的创始人,Shazeer 从中个人套现了 7.5 亿至 10 亿美元。重回谷歌后,他出任副总裁兼 Gemini 联合技术主管,主要负责模型预训练。然而,距离谷歌花费巨资将他收编还不到两年,Shazeer 便再次选择出走。
Shazeer 的加盟是 OpenAI 在人才竞争中的重要收获,也使谷歌 Gemini 团队流失了核心技术主管。眼下大模型正触及 Transformer 架构的算力扩展极限。OpenAI 让 Transformer 最初设计者带队寻找替代方案,意在下一代大模型架构中抢占先机,以应对来自 Anthropic 和谷歌的竞争。
信源:https://x.com/NoamShazeer/status/2067400851438932297
X (formerly Twitter)
Noam Shazeer (@NoamShazeer) on X
I’m excited to share that I’ll be joining OpenAI and look forward to working with the exceptional team there.
It was a difficult decision to move on. I’m incredibly proud of the amazing team at Google and everything we’ve built together. It has been an…
It was a difficult decision to move on. I’m incredibly proud of the amazing team at Google and everything we’ve built together. It has been an…
美拦截模型惊动G7,三巨头当着特朗普面划出AI冷战铁幕
美国政府日前首次直接管制算法本身,紧急拦截 Anthropic 最顶级的 Claude Fable 5 和 Claude Mythos 5 模型出口。由于无法在云端实时验证全球用户国籍,Anthropic 只能全球下架相关模型。突如其来的技术禁令在欧洲和印度盟国引爆恐慌,盟国突然意识到数字命脉捏在华盛顿手里,随时可能面临一键断供。
6 月 17 日法国 G7 峰会午宴现场,多国首脑与 AI 巨头当着美国总统特朗普的面激烈交锋。为挽回全球市场,AI 巨头当场抛出不同的地缘路线。Anthropic 创始人 Amodei 与 DeepMind 负责人 Hassabis 提议,由美国主导建立排他性的 AI 联盟,严格封锁前沿模型和芯片硬件,将中国彻底拒之门外。OpenAI 首席执行官 Altman 唱起反调,主张建立中立开放的讨论论坛,在冷战对抗中保留合作余地。
午宴现场各方博弈激烈,首脑们各怀心思。印度总理莫迪当场抗议,强调拿不到最强模型,国家基础设施防线就会直接裸奔。法国总统马克龙警告特朗普政府,动辄断供只会自毁长城,反噬美资巨头自身的万亿级全球生态。虽然 G7 探讨建立受信赖伙伴豁免机制,允许通过安全评估的盟国企业进入特许白名单,安全豁免通道依然无法掩盖控制权正加速收拢至华盛顿的现实。盟国要么顺从美国安全评估,要么面临被彻底踢出先进生产力版图的局外人命运。
信源:https://www.ft.com/content/573925dd-6d41-4185-810d-2b848195903d?syn-25a6b1a6=1
美国政府日前首次直接管制算法本身,紧急拦截 Anthropic 最顶级的 Claude Fable 5 和 Claude Mythos 5 模型出口。由于无法在云端实时验证全球用户国籍,Anthropic 只能全球下架相关模型。突如其来的技术禁令在欧洲和印度盟国引爆恐慌,盟国突然意识到数字命脉捏在华盛顿手里,随时可能面临一键断供。
6 月 17 日法国 G7 峰会午宴现场,多国首脑与 AI 巨头当着美国总统特朗普的面激烈交锋。为挽回全球市场,AI 巨头当场抛出不同的地缘路线。Anthropic 创始人 Amodei 与 DeepMind 负责人 Hassabis 提议,由美国主导建立排他性的 AI 联盟,严格封锁前沿模型和芯片硬件,将中国彻底拒之门外。OpenAI 首席执行官 Altman 唱起反调,主张建立中立开放的讨论论坛,在冷战对抗中保留合作余地。
午宴现场各方博弈激烈,首脑们各怀心思。印度总理莫迪当场抗议,强调拿不到最强模型,国家基础设施防线就会直接裸奔。法国总统马克龙警告特朗普政府,动辄断供只会自毁长城,反噬美资巨头自身的万亿级全球生态。虽然 G7 探讨建立受信赖伙伴豁免机制,允许通过安全评估的盟国企业进入特许白名单,安全豁免通道依然无法掩盖控制权正加速收拢至华盛顿的现实。盟国要么顺从美国安全评估,要么面临被彻底踢出先进生产力版图的局外人命运。
信源:https://www.ft.com/content/573925dd-6d41-4185-810d-2b848195903d?syn-25a6b1a6=1
❤1
G7午宴冰火两重天,Altman贴特朗普喜形于色,模型被卡的Amodei神色凝重
在法国埃维昂莱班 G7 峰会的 AI 工作午宴上,公开的出席名单揭示了美国对 AI 技术的绝对统治。科技界共有 12 个席位,美国凭借 OpenAI 的 Altman、Anthropic 的 Amodei、DeepMind 的 Hassabis、Scale AI 的 Alexandr Wang 以及 Salesforce 的 Benioff 独占 5 席。相比之下,包括英、法、德、日、印、加在内的其他参会国沦为陪衬,每个国家仅分到一个极稀缺的本国 AI 领头羊代表席位,技术话语权的极度失衡被直观呈现在餐桌上。
三巨头的座次安排更是暗示了微妙的政治待遇。OpenAI 首席执行官 Altman 坐在特朗普右侧,Google DeepMind 负责人 Hassabis 紧贴特朗普左侧,两名高管的座位安排极具核心政治影响力。相比之下,刚刚被美国政府实施模型出口禁令的 Anthropic 创始人 Amodei 则被冷落,远远发配到特朗普的正对面,挨着大声抗议美国断供的法国总统 Macron。
现场流出的画面中,Altman 喜形于色,Amodei 则神色凝重。舆论普遍认为,这场 G7 午宴的座次划分不仅是社交礼仪,更标志着前沿 AI 巨头已正式进入决定地缘政治的权力房间,而座位顺序就是当下华盛顿对各家企业政治顺从度的直观奖惩。
信源:https://x.com/business/status/2067251442943942930
在法国埃维昂莱班 G7 峰会的 AI 工作午宴上,公开的出席名单揭示了美国对 AI 技术的绝对统治。科技界共有 12 个席位,美国凭借 OpenAI 的 Altman、Anthropic 的 Amodei、DeepMind 的 Hassabis、Scale AI 的 Alexandr Wang 以及 Salesforce 的 Benioff 独占 5 席。相比之下,包括英、法、德、日、印、加在内的其他参会国沦为陪衬,每个国家仅分到一个极稀缺的本国 AI 领头羊代表席位,技术话语权的极度失衡被直观呈现在餐桌上。
三巨头的座次安排更是暗示了微妙的政治待遇。OpenAI 首席执行官 Altman 坐在特朗普右侧,Google DeepMind 负责人 Hassabis 紧贴特朗普左侧,两名高管的座位安排极具核心政治影响力。相比之下,刚刚被美国政府实施模型出口禁令的 Anthropic 创始人 Amodei 则被冷落,远远发配到特朗普的正对面,挨着大声抗议美国断供的法国总统 Macron。
现场流出的画面中,Altman 喜形于色,Amodei 则神色凝重。舆论普遍认为,这场 G7 午宴的座次划分不仅是社交礼仪,更标志着前沿 AI 巨头已正式进入决定地缘政治的权力房间,而座位顺序就是当下华盛顿对各家企业政治顺从度的直观奖惩。
信源:https://x.com/business/status/2067251442943942930
X (formerly Twitter)
Bloomberg (@business) on X
OpenAI CEO Sam Altman and Anthropic CEO Dario Amodei were among tech bosses at a G7 working lunch on AI, as the US decision to restrict access to Anthropic's most advanced models causes tension among allies https://t.co/IfdWD2xPs3
中国AI应用最大单轮融资纪录诞生:演语科技获近3亿美元融资,ARR达3亿比肩Suno
国内AI创意内容集团演语科技(Evoken,旗下含LiblibAI、LibTV、星流)近日披露完成近3亿美元B+轮融资。该交易实际于今年上半年早些时候交割,投后估值超20亿美元,创国内AI应用赛道最高单轮纪录。领投方包括Granite Asia、腾讯与顺为资本,高榕、蚂蚁、红杉等老股东加码。
截至2026年5月,演语科技年度经常性收入(ARR)已达3亿美元,较交割时暴增近3倍。该收入规模在AI应用层已与全球头部应用Suno持平并远超HeyGen。但在估值层面,体量相同的Suno估值高达54亿美元,演语科技(20亿美元)仍处于显著的全球洼地。
业绩爆发主要得益于3月上线的视频工具LibTV。恰逢下游AI短剧井喷(今年Q1全行业12.8万部微短剧中AI剧占12.2万部),LibTV首月单日收入即突破百万美元,5月单月营收已飙升至首月13倍以上。创始人陈冕(前剪映全球商业化负责人)表示,公司避开与Adobe的下游修改竞争,专攻上游创意生成,核心在于通过「无限画布+节点工作流」将「Seedance 2.0」等底层模型重构为可交付的「数字劳动力」。
信源:https://mp.weixin.qq.com/s/J8SpS62ZxqBmkWQws6Zmhw
国内AI创意内容集团演语科技(Evoken,旗下含LiblibAI、LibTV、星流)近日披露完成近3亿美元B+轮融资。该交易实际于今年上半年早些时候交割,投后估值超20亿美元,创国内AI应用赛道最高单轮纪录。领投方包括Granite Asia、腾讯与顺为资本,高榕、蚂蚁、红杉等老股东加码。
截至2026年5月,演语科技年度经常性收入(ARR)已达3亿美元,较交割时暴增近3倍。该收入规模在AI应用层已与全球头部应用Suno持平并远超HeyGen。但在估值层面,体量相同的Suno估值高达54亿美元,演语科技(20亿美元)仍处于显著的全球洼地。
业绩爆发主要得益于3月上线的视频工具LibTV。恰逢下游AI短剧井喷(今年Q1全行业12.8万部微短剧中AI剧占12.2万部),LibTV首月单日收入即突破百万美元,5月单月营收已飙升至首月13倍以上。创始人陈冕(前剪映全球商业化负责人)表示,公司避开与Adobe的下游修改竞争,专攻上游创意生成,核心在于通过「无限画布+节点工作流」将「Seedance 2.0」等底层模型重构为可交付的「数字劳动力」。
信源:https://mp.weixin.qq.com/s/J8SpS62ZxqBmkWQws6Zmhw
动察Beating AI News
白宫封禁Anthropic最强模型更深内幕:怀疑中国背景团体已获取Mythos访问权限 据 Semafor 独家报道,知情人士透露,白宫上周五对 Anthropic 的旗舰模型 Mythos 实施紧急出口管制,更深层的原因为怀疑一个与中国有联系的团体已经获取了该模型的访问权限。 Mythos 自今年 4 月发布以来一直受到极其严苛的受限控制,仅向少数企业伙伴提供,旨在修复安全漏洞并防止落入黑客之手。由于其能自主发现并利用代码漏洞,被美方视为具有「网络武器级」杀伤力。美方担忧,如果中国政府获得 Myth…
白宫草木皆兵,被指涉华的「神秘团体」竟是韩国公司SK电讯
白宫上周紧急封杀 Anthropic,防范的「涉华神秘团体」谜底揭晓,竟然是美国在东亚的铁杆盟友韩国的公司。据 WIRED 披露,美方先前指控已拿到 Claude Mythos 模型权限的中国背景势力,真实身份是韩国最大电信商 SK 电讯。这场捕风捉影的嫌疑,直接导向了对 Anthropic 的全球禁售令。
SK 电讯曾向 Anthropic 注资 1 亿美元,本月刚通过预览项目 Project Glasswing 获得 Claude Mythos 模型访问权。白宫怀疑 SK 电讯,仅仅是因为母公司 SK 集团在华业务广泛,以及 SK 电讯 20 年前与中国联通合作过。虽然 SK 电讯在 2009 年就卖掉了联通股份,但在 2025 年的财务申报中,仍保留着合资公司 UNISK 约 1700 万美元的残留小额投资。SK 电讯大呼冤枉,坚称与中国无关。
本就风声鹤唳的涉华警报,还碰上了安全防线的崩溃。亚马逊安全团队向白宫预警,新发布的 Claude Fable 5 存在越狱漏洞,可能暴露 Mythos 的网络武器级攻击能力。双重担忧叠加,白宫彻底对 Anthropic 失去信任,在上周五发布指令,严禁非美籍人员访问模型。因为无法在筛查国籍的同时保护用户隐私,Anthropic 索性全球停用 Mythos 和 Fable 5。双方目前谈判陷入僵局。
信源:https://www.wired.com/story/sk-telecom-anthropic-mythos-export-controls/
白宫上周紧急封杀 Anthropic,防范的「涉华神秘团体」谜底揭晓,竟然是美国在东亚的铁杆盟友韩国的公司。据 WIRED 披露,美方先前指控已拿到 Claude Mythos 模型权限的中国背景势力,真实身份是韩国最大电信商 SK 电讯。这场捕风捉影的嫌疑,直接导向了对 Anthropic 的全球禁售令。
SK 电讯曾向 Anthropic 注资 1 亿美元,本月刚通过预览项目 Project Glasswing 获得 Claude Mythos 模型访问权。白宫怀疑 SK 电讯,仅仅是因为母公司 SK 集团在华业务广泛,以及 SK 电讯 20 年前与中国联通合作过。虽然 SK 电讯在 2009 年就卖掉了联通股份,但在 2025 年的财务申报中,仍保留着合资公司 UNISK 约 1700 万美元的残留小额投资。SK 电讯大呼冤枉,坚称与中国无关。
本就风声鹤唳的涉华警报,还碰上了安全防线的崩溃。亚马逊安全团队向白宫预警,新发布的 Claude Fable 5 存在越狱漏洞,可能暴露 Mythos 的网络武器级攻击能力。双重担忧叠加,白宫彻底对 Anthropic 失去信任,在上周五发布指令,严禁非美籍人员访问模型。因为无法在筛查国籍的同时保护用户隐私,Anthropic 索性全球停用 Mythos 和 Fable 5。双方目前谈判陷入僵局。
信源:https://www.wired.com/story/sk-telecom-anthropic-mythos-export-controls/
WIRED
The Korean Telecom Giant at the Center of Anthropic’s Mythos Controversy
Days before Anthropic took its most advanced AI models offline, the White House ordered the company to revoke SK Telecom’s access to Claude Mythos over claims of alleged ties to China.
白宫铁锤引发内部大地震,Anthropic员工担忧IPO遭毁直呼被霸凌
白宫对 Fable 5 与 Mythos 5 模型的紧急封杀令,在 Anthropic 内部引发了剧烈震荡。据纽约时报披露的内部群聊记录,Anthropic 内部人心惶惶,3000 名员工的私密群聊瞬间炸开了锅,管理层在收到白宫仅给出的 90 分钟限时下架指令后手足无措。员工们极度担忧,突如其来的技术禁令会彻底摧毁公司原定于今年进行的上市计划。
在泄露的员工私聊记录中,员工们对白宫在「国家安全」与「安全漏洞」之间反复横跳的下架口径极度困惑。有工程师无奈自嘲,询问大家是否在被白宫「凭直觉霸凌」。还有员工悲观地表示,政府的监管打压令人怀疑白宫根本「不想让 Anthropic 继续存在」。
员工们的焦虑源于公司在华盛顿长期遭受的独特政治压力。今年年初,Anthropic 曾因拒绝让 AI 直接参与军事作战,与五角大楼发生冲突。国防部长随后将 Anthropic 列为「供应链风险」,使 Anthropic 成为历史上首个被贴上国家安全风险标签的美国本土企业。如今模型在关键的上市节点被迫下架,再度加深了内部对被政治迫害的担忧。
信源:https://www.nytimes.com/2026/06/17/technology/anthropic-trump-administration-fable.html
白宫对 Fable 5 与 Mythos 5 模型的紧急封杀令,在 Anthropic 内部引发了剧烈震荡。据纽约时报披露的内部群聊记录,Anthropic 内部人心惶惶,3000 名员工的私密群聊瞬间炸开了锅,管理层在收到白宫仅给出的 90 分钟限时下架指令后手足无措。员工们极度担忧,突如其来的技术禁令会彻底摧毁公司原定于今年进行的上市计划。
在泄露的员工私聊记录中,员工们对白宫在「国家安全」与「安全漏洞」之间反复横跳的下架口径极度困惑。有工程师无奈自嘲,询问大家是否在被白宫「凭直觉霸凌」。还有员工悲观地表示,政府的监管打压令人怀疑白宫根本「不想让 Anthropic 继续存在」。
员工们的焦虑源于公司在华盛顿长期遭受的独特政治压力。今年年初,Anthropic 曾因拒绝让 AI 直接参与军事作战,与五角大楼发生冲突。国防部长随后将 Anthropic 列为「供应链风险」,使 Anthropic 成为历史上首个被贴上国家安全风险标签的美国本土企业。如今模型在关键的上市节点被迫下架,再度加深了内部对被政治迫害的担忧。
信源:https://www.nytimes.com/2026/06/17/technology/anthropic-trump-administration-fable.html
Nytimes
Anthropic Employees Accuse Trump Administration of Targeting Them
Workers at the artificial intelligence company have been puzzled and increasingly concerned by the administration’s move to limit their latest A.I. models.
彭博:字节跳动年花逾十亿美元买微软AI服务,OpenAI私下抱怨防蒸馏不力
微软正通过向中国大厂转售 OpenAI 模型,在华构建起庞大的 AI 业务。据彭博社披露,字节跳动已成为微软最大的 AI 客户,在微软 AI 与云服务上的年支出预计将超过 10 亿美元。蚂蚁集团、美团和腾讯同样通过微软 Azure 云服务大量采购 AI 模型。中国大厂的这些支出大多用于支持海外业务扩张,同时也绕过了前沿模型不对华直接销售的限制。
微软对华销售 OpenAI 模型的业务收入增长极快。前首席商业官 Judson Althoff 在 2025 年 7 月的内部会议上透露,Azure 的 AI 业务在华收入增速冠绝全球,在 2024 财年暴增 400% 后,2025 财年营收再度增至近 3 倍。Althoff 称,最顶尖的 AI 解决方案正建立在美国西海岸与中国东海岸,而微软正是将两地连接在一起的桥梁。这与美国政府及 OpenAI 针对中国 AI 崛起的公开防备立场形成了巨大反差。
交易背后的合规和技术架构存在多重隔离与默契。由于 OpenAI 和 Anthropic 因安全考量不对华直接提供模型,微软便利用与 OpenAI 的特殊协议,绕过 OpenAI 的禁令自主制定在华转售政策。为防知识产权被盗,微软并没有将 GPT 模型部署在位于北京和上海的中国本地数据中心,而是让中国客户通过互联网跨境调用位于新加坡等海外节点的服务器。
然而,新加坡的中转防线并未打消 OpenAI 的疑虑。虽然微软使用自动监控来防止客户开发竞争产品,但没有对中国客户实施任何特殊的强化监控。OpenAI 曾私下向微软抱怨,指责微软未能采取足够措施阻止中国大厂通过蒸馏技术(即利用 OpenAI 模型的输出数据训练自己的模型)来提升自有模型的能力。实际上,利用合成数据进行模型蒸馏的技术手段很难在技术层面上被完全拦截。
信源:https://www.bloomberg.com/news/articles/2026-06-17/microsoft-s-china-ai-business-grows-on-openai-model-sales
微软正通过向中国大厂转售 OpenAI 模型,在华构建起庞大的 AI 业务。据彭博社披露,字节跳动已成为微软最大的 AI 客户,在微软 AI 与云服务上的年支出预计将超过 10 亿美元。蚂蚁集团、美团和腾讯同样通过微软 Azure 云服务大量采购 AI 模型。中国大厂的这些支出大多用于支持海外业务扩张,同时也绕过了前沿模型不对华直接销售的限制。
微软对华销售 OpenAI 模型的业务收入增长极快。前首席商业官 Judson Althoff 在 2025 年 7 月的内部会议上透露,Azure 的 AI 业务在华收入增速冠绝全球,在 2024 财年暴增 400% 后,2025 财年营收再度增至近 3 倍。Althoff 称,最顶尖的 AI 解决方案正建立在美国西海岸与中国东海岸,而微软正是将两地连接在一起的桥梁。这与美国政府及 OpenAI 针对中国 AI 崛起的公开防备立场形成了巨大反差。
交易背后的合规和技术架构存在多重隔离与默契。由于 OpenAI 和 Anthropic 因安全考量不对华直接提供模型,微软便利用与 OpenAI 的特殊协议,绕过 OpenAI 的禁令自主制定在华转售政策。为防知识产权被盗,微软并没有将 GPT 模型部署在位于北京和上海的中国本地数据中心,而是让中国客户通过互联网跨境调用位于新加坡等海外节点的服务器。
然而,新加坡的中转防线并未打消 OpenAI 的疑虑。虽然微软使用自动监控来防止客户开发竞争产品,但没有对中国客户实施任何特殊的强化监控。OpenAI 曾私下向微软抱怨,指责微软未能采取足够措施阻止中国大厂通过蒸馏技术(即利用 OpenAI 模型的输出数据训练自己的模型)来提升自有模型的能力。实际上,利用合成数据进行模型蒸馏的技术手段很难在技术层面上被完全拦截。
信源:https://www.bloomberg.com/news/articles/2026-06-17/microsoft-s-china-ai-business-grows-on-openai-model-sales
Bloomberg.com
Microsoft Makes Big AI Inroads in China by Selling OpenAI Models
Microsoft Corp. has built a big business selling AI models to Chinese companies despite the growing rivalry between the US and China over artificial intelligence.
智谱与MiniMax股价走势两极分化,港股上演中国大模型「买强卖弱」配对交易
港股市场正涌现围绕中国 AI 大模型的配对交易(pair trade)。自 3 月底以来,智谱股价上涨 170%,而 MiniMax 股价下跌约 50%。虽然两家公司 1 月上市以来均有上涨,但智谱以超 1500% 的年内涨幅远超对手。随着全球 AI 企业上市进程加速,投资者对大模型盈利能力的审视不断收紧,促使资金流向极分化。
汇丰银行估算, 7 月 8 日 MiniMax 将解禁 65% 的股份,而智谱在 7 月 7 日仅解禁 6%。巨大的解禁差显著增加了 MiniMax 的借券做空筹码,分析师预计配对交易将在 7 月初加速。
业绩与模型质量分化是主因。智谱今年在维持销量的同时提高了 GLM 模型单价,MiniMax 旗舰模型 M3 发布仅一周便降价 50% 抢客。降价动作引发了盈利担忧,导致高盛下调 MiniMax 目标价 14% 。摩根大通则在提高智谱目标价的同时下调 MiniMax 评级,称降价反映模型竞争力不及预期。Gavekal 资本指出,智谱模型更好且盈利潜力更优,MiniMax 难以成为主导平台。
地缘政治也提供了契机。美国限制 Anthropic 模型出口,促使资金流向中国厂商。智谱本周发布最新开源模型,推动股价飙涨超 70% 。尽管美银证券首次覆盖智谱与 MiniMax 均给予买入评级,预计 MiniMax 解禁后有望补涨,但两家厂商后续仍面临 DeepSeek 的低价竞争,以及月之暗面(Moonshot AI)等潜在上市同行的资金分流压力。
信源:https://www.bloomberg.com/news/articles/2026-06-18/china-s-ai-race-spurs-emergence-of-winner-laggard-pair-trade
港股市场正涌现围绕中国 AI 大模型的配对交易(pair trade)。自 3 月底以来,智谱股价上涨 170%,而 MiniMax 股价下跌约 50%。虽然两家公司 1 月上市以来均有上涨,但智谱以超 1500% 的年内涨幅远超对手。随着全球 AI 企业上市进程加速,投资者对大模型盈利能力的审视不断收紧,促使资金流向极分化。
汇丰银行估算, 7 月 8 日 MiniMax 将解禁 65% 的股份,而智谱在 7 月 7 日仅解禁 6%。巨大的解禁差显著增加了 MiniMax 的借券做空筹码,分析师预计配对交易将在 7 月初加速。
业绩与模型质量分化是主因。智谱今年在维持销量的同时提高了 GLM 模型单价,MiniMax 旗舰模型 M3 发布仅一周便降价 50% 抢客。降价动作引发了盈利担忧,导致高盛下调 MiniMax 目标价 14% 。摩根大通则在提高智谱目标价的同时下调 MiniMax 评级,称降价反映模型竞争力不及预期。Gavekal 资本指出,智谱模型更好且盈利潜力更优,MiniMax 难以成为主导平台。
地缘政治也提供了契机。美国限制 Anthropic 模型出口,促使资金流向中国厂商。智谱本周发布最新开源模型,推动股价飙涨超 70% 。尽管美银证券首次覆盖智谱与 MiniMax 均给予买入评级,预计 MiniMax 解禁后有望补涨,但两家厂商后续仍面临 DeepSeek 的低价竞争,以及月之暗面(Moonshot AI)等潜在上市同行的资金分流压力。
信源:https://www.bloomberg.com/news/articles/2026-06-18/china-s-ai-race-spurs-emergence-of-winner-laggard-pair-trade
Bloomberg.com
China’s AI Race Spurs Emergence of Winner-Laggard Pair Trade
A pair trade is emerging in China’s artificial intelligence sector, with investors piling into the perceived winner and betting against its rival seen as losing ground in the race to build commercially viable AI models.
❤2
Claude Design重磅升级:支持导入设计系统并与Claude Code实现双向同步
Anthropic 宣布对其 AI 设计与原型工具 Claude Design 进行重大升级,重点打通了设计与开发的工作流。新版本最核心的特性是实现了与终端开发助手 Claude Code 的深度双向同步:在 Claude Code 中,开发者可以通过运行
此外,Claude Design 重构了设计系统导入工具,支持直接分析并提取 GitHub 仓库、设计文件或本地代码库中的设计规范,并在输出前自动校验。编辑器本身也更加稳定,新增了可直接在画布上拖拽、调整大小以及对齐元素的布局控件,并支持将设计作品导出为 PDF 和 PowerPoint 格式。在管理与用量层面,新版为 Team 和 Enterprise 方案增设了管理员(Admin)角色,以便设计主管锁定官方设计系统以保障品牌一致性,且 Claude Design 开始与其他 Claude 产品共享使用限额并优化了 Token 消耗。目前该更新已在 Web 和桌面端面向付费用户开启 Beta 测试。
信源:https://x.com/claudeai/status/2067325887909884315
Anthropic 宣布对其 AI 设计与原型工具 Claude Design 进行重大升级,重点打通了设计与开发的工作流。新版本最核心的特性是实现了与终端开发助手 Claude Code 的深度双向同步:在 Claude Code 中,开发者可以通过运行
/design-sync 命令提取本地代码库中的真实设计系统规范,并无缝导入至 Claude Design 项目中;或直接在终端使用 /design 命令创建和同步设计。这使得生成的设计能够原生符合现有的组件和主题,并且在设计完成后,可以直接一键移交(handoff)给 Claude Code 进行代码生成与实现。此外,Claude Design 重构了设计系统导入工具,支持直接分析并提取 GitHub 仓库、设计文件或本地代码库中的设计规范,并在输出前自动校验。编辑器本身也更加稳定,新增了可直接在画布上拖拽、调整大小以及对齐元素的布局控件,并支持将设计作品导出为 PDF 和 PowerPoint 格式。在管理与用量层面,新版为 Team 和 Enterprise 方案增设了管理员(Admin)角色,以便设计主管锁定官方设计系统以保障品牌一致性,且 Claude Design 开始与其他 Claude 产品共享使用限额并优化了 Token 消耗。目前该更新已在 Web 和桌面端面向付费用户开启 Beta 测试。
信源:https://x.com/claudeai/status/2067325887909884315