大模型已成战争武器:美军将xAI数据中心定性为「兵工厂」以阻挠环保诉讼
美国司法部向密西西比州联邦法院递交动议,申请介入并要求驳回民权组织 NAACP 针对 xAI 数据中心的环保诉讼。司法部与国防部在证词中首次证实,美军已在机密军事网络中部署定制版 Grok Gov 大模型,并用于规划针对伊朗的实际军事打击任务。联邦政府认为,数据中心提供的算力等同于现代军工制造厂,切断电力供应将危及国家与军事防务安全。
诉讼源于 xAI 在 Colossus 2 数据中心违规运行多台便携式天然气燃气轮机进行离网发电,并引发了周边黑人社区的重度污染。为了保护 Grok 正常运行所需的电力供应,司法部除支持 xAI 提出的移动式燃气轮机属于免申领许可证的临时设施外,还抛出了全新的法律防御逻辑,即若行政分支对诉讼持反对态度,私营机构或公民便无权依据《清洁空气法》的公民诉讼条款进行环保维权。环保及民权律师指出,司法部的逻辑属于行政分支的过度扩权,旨在利用国家安全为幌子,剥夺社区对抗企业污染的法律武器。
美军对商用 AI 的深度依赖,是司法部强力介入的深层原因。五角大楼于 2025 年与 xAI 签署了价值高达 2 亿美元的政府版 Grok 采购合同。国防部首席数字与人工智能官 Cameron Stanley 证实,定制版 Grok Gov 已作为 Maven 智能系统的一部分部署在机密网络中。在 2026 年 2 月美伊冲突期间,Maven 系统曾在 96 小时内向 2000 个目标投放了超过 2000 枚弹药。美军的战术依赖正促使司法部动用国家安全条款,为 xAI 供应链违规提供豁免。
信源:https://www.washingtonpost.com/technology/2026/06/16/justice-department-aims-block-lawsuit-against-xai-polluting-data-centers/
美国司法部向密西西比州联邦法院递交动议,申请介入并要求驳回民权组织 NAACP 针对 xAI 数据中心的环保诉讼。司法部与国防部在证词中首次证实,美军已在机密军事网络中部署定制版 Grok Gov 大模型,并用于规划针对伊朗的实际军事打击任务。联邦政府认为,数据中心提供的算力等同于现代军工制造厂,切断电力供应将危及国家与军事防务安全。
诉讼源于 xAI 在 Colossus 2 数据中心违规运行多台便携式天然气燃气轮机进行离网发电,并引发了周边黑人社区的重度污染。为了保护 Grok 正常运行所需的电力供应,司法部除支持 xAI 提出的移动式燃气轮机属于免申领许可证的临时设施外,还抛出了全新的法律防御逻辑,即若行政分支对诉讼持反对态度,私营机构或公民便无权依据《清洁空气法》的公民诉讼条款进行环保维权。环保及民权律师指出,司法部的逻辑属于行政分支的过度扩权,旨在利用国家安全为幌子,剥夺社区对抗企业污染的法律武器。
美军对商用 AI 的深度依赖,是司法部强力介入的深层原因。五角大楼于 2025 年与 xAI 签署了价值高达 2 亿美元的政府版 Grok 采购合同。国防部首席数字与人工智能官 Cameron Stanley 证实,定制版 Grok Gov 已作为 Maven 智能系统的一部分部署在机密网络中。在 2026 年 2 月美伊冲突期间,Maven 系统曾在 96 小时内向 2000 个目标投放了超过 2000 枚弹药。美军的战术依赖正促使司法部动用国家安全条款,为 xAI 供应链违规提供豁免。
信源:https://www.washingtonpost.com/technology/2026/06/16/justice-department-aims-block-lawsuit-against-xai-polluting-data-centers/
路透社:美暂缓将DeepSeek与长鑫存储等百余家企业列入实体清单以避免局势升温
路透社援引两位知情人士报道,美国政府已暂缓将中国 AI 初创公司 DeepSeek、内存芯片制造商长鑫存储以及 100 多家被认定存在国家安全风险的公司列入贸易管制黑名单。推迟公布黑名单是为了避免进一步升级中美两国的紧张局势。
美国商务部的实体清单在去年年底前就已通过跨部门委员会审查,拟将包括 DeepSeek、长鑫存储在内的至少 75 家涉及先进半导体生产、半导体制造设备以及 AI 模型构建的中国实体纳入清单。然而,负责工业与安全事务的商务部副部长杰弗里·凯斯勒自 2025 年底以来,一直因担忧中美关系升级而延缓发布拉黑名单。自 2025 年 10 月以来,实体清单已连续 8 个月未做更新,创下十多年来的最长停滞纪录。
除了半导体与 AI 模型,数十家中国公司因向中国高校转售受限制的英伟达芯片,或向俄罗斯提供去年 9 月在波兰被回收的无人机,同样曾被拟定列入清单。美国高级官员曾指控 DeepSeek 协助军事与情报行动,并尝试通过东南亚壳公司规避美国禁令以获取先进芯片。Anthropic 与 OpenAI 也于今年警告,DeepSeek 正在试图窃取两家公司的模型能力。
信源:https://www.reuters.com/world/china/us-holds-off-blacklisting-chinas-deepseek-more-than-100-firms-deemed-security-2026-06-17/
路透社援引两位知情人士报道,美国政府已暂缓将中国 AI 初创公司 DeepSeek、内存芯片制造商长鑫存储以及 100 多家被认定存在国家安全风险的公司列入贸易管制黑名单。推迟公布黑名单是为了避免进一步升级中美两国的紧张局势。
美国商务部的实体清单在去年年底前就已通过跨部门委员会审查,拟将包括 DeepSeek、长鑫存储在内的至少 75 家涉及先进半导体生产、半导体制造设备以及 AI 模型构建的中国实体纳入清单。然而,负责工业与安全事务的商务部副部长杰弗里·凯斯勒自 2025 年底以来,一直因担忧中美关系升级而延缓发布拉黑名单。自 2025 年 10 月以来,实体清单已连续 8 个月未做更新,创下十多年来的最长停滞纪录。
除了半导体与 AI 模型,数十家中国公司因向中国高校转售受限制的英伟达芯片,或向俄罗斯提供去年 9 月在波兰被回收的无人机,同样曾被拟定列入清单。美国高级官员曾指控 DeepSeek 协助军事与情报行动,并尝试通过东南亚壳公司规避美国禁令以获取先进芯片。Anthropic 与 OpenAI 也于今年警告,DeepSeek 正在试图窃取两家公司的模型能力。
信源:https://www.reuters.com/world/china/us-holds-off-blacklisting-chinas-deepseek-more-than-100-firms-deemed-security-2026-06-17/
动察Beating AI News
微信支付内测AI支付功能,通过AI专属卡实现智能体自主下单与笔笔确认 微信支付正与腾讯智能体应用 WorkBuddy 合作内测 AI 支付功能,通过在零钱中增设 AI 专属卡,将智能体自主下单与用户安全确认相结合。内测机制目前处于腾讯内部早期测试阶段,首次实现了 AI 智能体在移动支付平台上的专款专用与笔笔确认。 在微信零钱的 AI 专属卡界面中,用户可以从微信零钱内向卡中转入或转出资金。AI 专属卡的消费上限完全取决于卡内充值余额。在绑定流程中,用户必须明确授权并绑定特定的智能体。微信支付在绑定页面中提示,AI…
微信支付发布AI专属卡:隔离主账户加笔笔确认,WorkBuddy率先接入美团生活消费
微信支付正式发布专为智能体支付场景设计的 AI 专属卡 AI AgentPay Card。腾讯桌面办公助手 WorkBuddy 的 Mac 端 5.1.1 及以上版本已全量接入,并与美团合作上线了美团生活助手专家。
用户在 WorkBuddy 对话框中输入咖啡、团购等消费需求,智能体即可在对话流内完成筛选、推荐、下单和发起支付。为保障资金安全,AI 专属卡在微信零钱中物理独立,智能体无法触碰微信支付主账户。用户可自主充值或转出卡内资金,且每一笔由智能体发起的支付均需用户在手机端进行验密确认,不会在后台自动扣款。
除即时购买,用户还可设置定时任务让智能体每日自动领取美团优惠券。在 6 月 5 日的 AI 产业应用大会上,腾讯云副总裁刘毅曾表示,希望助手在办公之余顺便满足点餐、购票等生活消费。微信支付透露,后续将向更多符合规范的智能体平台开放接入。
信源:https://mp.weixin.qq.com/s/V6wNr3xEWtU8RWJ2tUoc4Q
微信支付正式发布专为智能体支付场景设计的 AI 专属卡 AI AgentPay Card。腾讯桌面办公助手 WorkBuddy 的 Mac 端 5.1.1 及以上版本已全量接入,并与美团合作上线了美团生活助手专家。
用户在 WorkBuddy 对话框中输入咖啡、团购等消费需求,智能体即可在对话流内完成筛选、推荐、下单和发起支付。为保障资金安全,AI 专属卡在微信零钱中物理独立,智能体无法触碰微信支付主账户。用户可自主充值或转出卡内资金,且每一笔由智能体发起的支付均需用户在手机端进行验密确认,不会在后台自动扣款。
除即时购买,用户还可设置定时任务让智能体每日自动领取美团优惠券。在 6 月 5 日的 AI 产业应用大会上,腾讯云副总裁刘毅曾表示,希望助手在办公之余顺便满足点餐、购票等生活消费。微信支付透露,后续将向更多符合规范的智能体平台开放接入。
信源:https://mp.weixin.qq.com/s/V6wNr3xEWtU8RWJ2tUoc4Q
OpenClaw升级2026.6.8:默认禁用免Key搜索防泄密,Telegram支持表格渲染
开源智能体框架 OpenClaw 发布 2026.6.8 版本。针对自动网页搜索引发的数据安全隐患,新版本重构了搜索回退机制。Parallel Free、DuckDuckGo 等免 key 搜索源从此前的「无 key 自动回退」调整为「必须手动启用」。
在此前配置缺失时,智能体会在无提示情况下自动调用公共搜索服务并向外发送上下文,新规有效规避了敏感信息被静默传输到外部的风险。
同时,跟进适配了 Telegram 官方 Bot API 的最新富文本(Rich Messages)渲染规范,使 Telegram 渠道原生支持表格、列表与可折叠引用块的完美呈现,解决了此前因 Markdown 转换问题极易导致消息发送崩溃的 Bug。
信源:https://github.com/openclaw/openclaw/releases/tag/v2026.6.8
开源智能体框架 OpenClaw 发布 2026.6.8 版本。针对自动网页搜索引发的数据安全隐患,新版本重构了搜索回退机制。Parallel Free、DuckDuckGo 等免 key 搜索源从此前的「无 key 自动回退」调整为「必须手动启用」。
在此前配置缺失时,智能体会在无提示情况下自动调用公共搜索服务并向外发送上下文,新规有效规避了敏感信息被静默传输到外部的风险。
同时,跟进适配了 Telegram 官方 Bot API 的最新富文本(Rich Messages)渲染规范,使 Telegram 渠道原生支持表格、列表与可折叠引用块的完美呈现,解决了此前因 Markdown 转换问题极易导致消息发送崩溃的 Bug。
信源:https://github.com/openclaw/openclaw/releases/tag/v2026.6.8
GitHub
Release openclaw 2026.6.8 · openclaw/openclaw
2026.6.8
Highlights
Richer channel delivery: Telegram and WhatsApp are less brittle: Telegram renders structured text with tables, lists, expandable blockquotes, preserved intentional line breaks,...
Highlights
Richer channel delivery: Telegram and WhatsApp are less brittle: Telegram renders structured text with tables, lists, expandable blockquotes, preserved intentional line breaks,...
Anthropic发布40万会话研究:懂业务比懂代码更重要,非程序员成功率持平软件工程师
Anthropic 最新发布的大规模智能体编程报告指出,在 Claude Code 辅助下,编程技能本身正变得无关紧要,决定成败的关键在于管理与领域知识。分析显示,Claude Code 用户平均每周活跃长达 20 小时。在十大主要职业中,非程序员利用智能体写代码的成功率与专业软件工程师的差距已缩减至 7% 以内,其中管理岗的成功率甚至略微反超了专业程序员。
大模型重塑了人机分工,用户主导了约 70% 的规划方向决策,智能体则承担了约 80% 的具体执行决策。懂得如何拆解、规范委托任务的业务专家,能引导大模型发挥出更大效能,专家级会话单次能触发 12 次动作与 3200 词输出,达新手级会话的 5 倍以上。相比之下,新手在遇到报错时极易放弃,新手会话的受挫放弃率高达 19%,而中级与专家级用户即便遇到麻烦,放弃率也仅有 5% 到 7%。研究证明,仅需特定领域的中等行业知识,即可通过智能体无缝跨越编程门槛,实现个人生产力跃升。
开发者对智能体的使用正在从调试代码过渡到端到端自主创造。在 7 个月内,用于修复破损代码的调试会话占比由 33% 减半至 19%,而直接部署运行、数据分析与撰写非代码文档的占比则翻倍。用户也开始委派更复杂且高价值的工作,任务的平均估算价值在 7 个月内增长了约 25%。
信源:https://www.anthropic.com/research/claude-code-expertise
Anthropic 最新发布的大规模智能体编程报告指出,在 Claude Code 辅助下,编程技能本身正变得无关紧要,决定成败的关键在于管理与领域知识。分析显示,Claude Code 用户平均每周活跃长达 20 小时。在十大主要职业中,非程序员利用智能体写代码的成功率与专业软件工程师的差距已缩减至 7% 以内,其中管理岗的成功率甚至略微反超了专业程序员。
大模型重塑了人机分工,用户主导了约 70% 的规划方向决策,智能体则承担了约 80% 的具体执行决策。懂得如何拆解、规范委托任务的业务专家,能引导大模型发挥出更大效能,专家级会话单次能触发 12 次动作与 3200 词输出,达新手级会话的 5 倍以上。相比之下,新手在遇到报错时极易放弃,新手会话的受挫放弃率高达 19%,而中级与专家级用户即便遇到麻烦,放弃率也仅有 5% 到 7%。研究证明,仅需特定领域的中等行业知识,即可通过智能体无缝跨越编程门槛,实现个人生产力跃升。
开发者对智能体的使用正在从调试代码过渡到端到端自主创造。在 7 个月内,用于修复破损代码的调试会话占比由 33% 减半至 19%,而直接部署运行、数据分析与撰写非代码文档的占比则翻倍。用户也开始委派更复杂且高价值的工作,任务的平均估算价值在 7 个月内增长了约 25%。
信源:https://www.anthropic.com/research/claude-code-expertise
Anthropic
Agentic coding and persistent returns to expertise
New Anthropic research looking at interactive agentic coding. We evaluate the composition of tasks, human-AI collaboration, and success rates.
彼得·蒂尔神秘学会Dialog遭泄密:马斯克等政商巨头参会,议程涉邪教与三战
据《连线》杂志 (WIRED) 报道,由彼得·蒂尔联合创立的神秘学会 Dialog 泄露了 222 名精英的参会记录,包括埃隆·马斯克、谷歌前 CEO Eric Schmidt、OpenAI 总裁 Greg Brockman 及特朗普女婿 Jared Kushner。泄露的数据库不仅公开了名单,还曝光了探讨建立邪教、应对第三次世界大战等极为隐私的议程。
Dialog 自 2006 年创立以来保密运营了近 20 年,常被称为科技界的「毕德堡会议」,参会费超 1.6 万美元。泄露的 2026 年度会议日程定于 8 月在都柏林举行,议程包括「如何建立邪教」(Build-a-Cult)、「应对第三次世界大战」(Navigating WWIII)、「战场技术」(Battlefield Technologies)、「带回核能」(Bring Back Nuclear)、「金钱买到幸福吗」(Money (Does?) Buy Happiness)及「你的性生活如何」(How’s Your Sex Life?)等主题研讨。
泄露的数据还包含成员在专属配对程序 dating.dialog.org 上填写的政治倾向和交友配对信息。虽然 Dialog 曾承诺这些隐私绝不公开,但因 Airtable 数据库暴露在前端代码中,导致这些敏感数据一并曝光。
名单包括微软 Xbox 总裁 Sarah Bond、YouTube 现任 CEO Neal Mohan,以及陆军部长 Dan Driscoll、参议员 Ted Cruz、财政部长 Scott Bessent 等政要。包括北约司令 Alexus Grynkewich 将军在内的官员在注册时均使用非政府官方邮箱,这使官员行程脱离了监管,从而避开了美国公共记录法 FOIA 的审计。
安全设计漏洞是导致泄露的主因。黑客 maia arson crimew 在 Dialog 官网代码中发现了暴露的 Airtable 目录,目录甚至包含成员的私有登录凭证,名单包括 Airtable 创始人 Howie Liu 本人。
信源:https://www.wired.com/story/leak-exposes-members-of-peter-thiels-secretive-dialog-society/
据《连线》杂志 (WIRED) 报道,由彼得·蒂尔联合创立的神秘学会 Dialog 泄露了 222 名精英的参会记录,包括埃隆·马斯克、谷歌前 CEO Eric Schmidt、OpenAI 总裁 Greg Brockman 及特朗普女婿 Jared Kushner。泄露的数据库不仅公开了名单,还曝光了探讨建立邪教、应对第三次世界大战等极为隐私的议程。
Dialog 自 2006 年创立以来保密运营了近 20 年,常被称为科技界的「毕德堡会议」,参会费超 1.6 万美元。泄露的 2026 年度会议日程定于 8 月在都柏林举行,议程包括「如何建立邪教」(Build-a-Cult)、「应对第三次世界大战」(Navigating WWIII)、「战场技术」(Battlefield Technologies)、「带回核能」(Bring Back Nuclear)、「金钱买到幸福吗」(Money (Does?) Buy Happiness)及「你的性生活如何」(How’s Your Sex Life?)等主题研讨。
泄露的数据还包含成员在专属配对程序 dating.dialog.org 上填写的政治倾向和交友配对信息。虽然 Dialog 曾承诺这些隐私绝不公开,但因 Airtable 数据库暴露在前端代码中,导致这些敏感数据一并曝光。
名单包括微软 Xbox 总裁 Sarah Bond、YouTube 现任 CEO Neal Mohan,以及陆军部长 Dan Driscoll、参议员 Ted Cruz、财政部长 Scott Bessent 等政要。包括北约司令 Alexus Grynkewich 将军在内的官员在注册时均使用非政府官方邮箱,这使官员行程脱离了监管,从而避开了美国公共记录法 FOIA 的审计。
安全设计漏洞是导致泄露的主因。黑客 maia arson crimew 在 Dialog 官网代码中发现了暴露的 Airtable 目录,目录甚至包含成员的私有登录凭证,名单包括 Airtable 创始人 Howie Liu 本人。
信源:https://www.wired.com/story/leak-exposes-members-of-peter-thiels-secretive-dialog-society/
❤1
xAI发布Grok Imagine Video 1.5:支持音画同频生成,速度翻倍
xAI 正式发布图像与文本生成视频模型 Grok Imagine Video 1.5,并在 API(grok-imagine-video-1.5)、网页端(grok.com/imagine)及移动客户端全量上线。
模型实现音视频一体化同步生成,在单次推理阶段同步产生音效、环境音与角色对话,提高语音清晰度并优化唇形同步。同时,模型改进了物理引擎与运动一致性,提升镜头长周期内物体运动与物理重量的可信度,减少画面扭曲等伪影。在生成速度上,轻量版 Video 1.5 Fast 生成 6 秒 720p 视频的耗时缩短至约 25 秒。
网页端配套工作流同步更新:新增项目管理(Projects)以分类整理素材,支持多智能体并行(Multiple Agents)运行多个提示词,并提供媒体库语义搜索(Search)。数字艺术家 David Thompson 团队使用 Grok Imagine 1.5 制作了完全由 AI 生成的电影预告片《Odyssey》。
信源:https://x.com/xai/status/2067092897951109427
xAI 正式发布图像与文本生成视频模型 Grok Imagine Video 1.5,并在 API(grok-imagine-video-1.5)、网页端(grok.com/imagine)及移动客户端全量上线。
模型实现音视频一体化同步生成,在单次推理阶段同步产生音效、环境音与角色对话,提高语音清晰度并优化唇形同步。同时,模型改进了物理引擎与运动一致性,提升镜头长周期内物体运动与物理重量的可信度,减少画面扭曲等伪影。在生成速度上,轻量版 Video 1.5 Fast 生成 6 秒 720p 视频的耗时缩短至约 25 秒。
网页端配套工作流同步更新:新增项目管理(Projects)以分类整理素材,支持多智能体并行(Multiple Agents)运行多个提示词,并提供媒体库语义搜索(Search)。数字艺术家 David Thompson 团队使用 Grok Imagine 1.5 制作了完全由 AI 生成的电影预告片《Odyssey》。
信源:https://x.com/xai/status/2067092897951109427
Grok
Grok Imagine
Grok Imagine by SpaceXAI is an AI image and video generator. Create and edit images, animate them into videos, and iterate fast with Imagine Agent Mode.
智谱GLM-5.2加冕AA智能指数开源第一:GDPval 跑分与GPT-5.5平起平坐
智谱 AI 最新 MoE 旗舰模型 GLM-5.2 在 Artificial Analysis 大模型智能指数 v4.1 评测中斩获 51 分,超越 MiniMax-M3 (44 分)、 DeepSeek V4 Pro (max, 44 分)和 Kimi K2.6 (43 分),登顶全球开源模型榜首。
在模拟真实世界知识工作的 GDPval-AA v2 测试中, GLM-5.2 获 1524 分(人类基准分 1000 分),领先 MiniMax-M3 (1418 分)与 DeepSeek V4 Pro (max, 1328 分),与闭源前沿大模型 GPT-5.5 (xhigh reasoning)平起平坐。相较前代 GLM-5.1,科学推理 CritPt 提升 16 个百分点至 21%, HLE 提升 12 个百分点至 40%, TerminalBench v2.1 提升 16 个百分点至 78%, GPQA Diamond 达 89%。
GLM-5.2 在「智能 - 任务成本」帕累托前沿占据最佳性价比位置。由于单次任务平均输出 43k token (GLM-5.1 为 26k), GLM-5.2 单任务平均成本上升至约 0.46 美元,高于 GLM-5.1 (0.25 美元)和 DeepSeek V4 Pro (max, 0.05 美元),但仍远低于同智能梯队的闭源模型。
GLM-5.2 总参数 744B,激活参数 40B,上下文窗口由前代 200K 升至 1M,遵循 MIT 协议开源。目前,智谱官方 API (定价输入 1.4、输出 4.4 / 每百万 token)与 SiliconFlow、 DeepInfra、 Nebius AI 等平台已上线服务。
信源:https://x.com/ArtificialAnlys/status/2067135640249209175
智谱 AI 最新 MoE 旗舰模型 GLM-5.2 在 Artificial Analysis 大模型智能指数 v4.1 评测中斩获 51 分,超越 MiniMax-M3 (44 分)、 DeepSeek V4 Pro (max, 44 分)和 Kimi K2.6 (43 分),登顶全球开源模型榜首。
在模拟真实世界知识工作的 GDPval-AA v2 测试中, GLM-5.2 获 1524 分(人类基准分 1000 分),领先 MiniMax-M3 (1418 分)与 DeepSeek V4 Pro (max, 1328 分),与闭源前沿大模型 GPT-5.5 (xhigh reasoning)平起平坐。相较前代 GLM-5.1,科学推理 CritPt 提升 16 个百分点至 21%, HLE 提升 12 个百分点至 40%, TerminalBench v2.1 提升 16 个百分点至 78%, GPQA Diamond 达 89%。
GLM-5.2 在「智能 - 任务成本」帕累托前沿占据最佳性价比位置。由于单次任务平均输出 43k token (GLM-5.1 为 26k), GLM-5.2 单任务平均成本上升至约 0.46 美元,高于 GLM-5.1 (0.25 美元)和 DeepSeek V4 Pro (max, 0.05 美元),但仍远低于同智能梯队的闭源模型。
GLM-5.2 总参数 744B,激活参数 40B,上下文窗口由前代 200K 升至 1M,遵循 MIT 协议开源。目前,智谱官方 API (定价输入 1.4、输出 4.4 / 每百万 token)与 SiliconFlow、 DeepInfra、 Nebius AI 等平台已上线服务。
信源:https://x.com/ArtificialAnlys/status/2067135640249209175
Cursor首届Compile大会预告多项重磅产品:自研1.5万亿参数大模型与Git平台Origin
Cursor 首届旗舰开发者峰会 Cursor Compile 预告了多项面向 AI 智能体开发的基础设施。就在同一天,SpaceX 正式宣布以 600 亿美元估值全股票收购 Cursor 母公司 Anysphere。Cursor 正从传统的 IDE 辅助工具,向 AI 原生软件工程平台演进。
研发重点是正在训练的 1.5 万亿参数通用底座模型。CEO Michael Truell 指出,模型在超过 10 万块 GPU 组成的 Colossus 集群上从零开始预训练,摆脱了以往微调开源模型的路线。团队旨在超越常规代码生成,让模型具备独立规划、工具调用、软件测试、 UI 交互以及解释修改动作的综合智能,充当工程师同事。模型预计在未来几周内发布。
由 Cursor 收购的代码评审工具 Graphite 团队主导,大会发布了兼容 Git 的智能体原生代码托管平台 Origin。针对传统 Git 和 GitHub 难以承载自主智能体高频、并行提交的瓶颈,Origin 专为大规模智能体协同设计,提供全自动安全审查、冲突消解及智能 Rebase 支持,计划于 2026 年秋季上线。
同时,Cursor Mobile 移动端(iOS TestFlight)也在峰会期间开启测试,支持远程连接 Mac 开展 AI 编程。
信源:https://x.com/morganlinton/status/2066946225837109735
Cursor 首届旗舰开发者峰会 Cursor Compile 预告了多项面向 AI 智能体开发的基础设施。就在同一天,SpaceX 正式宣布以 600 亿美元估值全股票收购 Cursor 母公司 Anysphere。Cursor 正从传统的 IDE 辅助工具,向 AI 原生软件工程平台演进。
研发重点是正在训练的 1.5 万亿参数通用底座模型。CEO Michael Truell 指出,模型在超过 10 万块 GPU 组成的 Colossus 集群上从零开始预训练,摆脱了以往微调开源模型的路线。团队旨在超越常规代码生成,让模型具备独立规划、工具调用、软件测试、 UI 交互以及解释修改动作的综合智能,充当工程师同事。模型预计在未来几周内发布。
由 Cursor 收购的代码评审工具 Graphite 团队主导,大会发布了兼容 Git 的智能体原生代码托管平台 Origin。针对传统 Git 和 GitHub 难以承载自主智能体高频、并行提交的瓶颈,Origin 专为大规模智能体协同设计,提供全自动安全审查、冲突消解及智能 Rebase 支持,计划于 2026 年秋季上线。
同时,Cursor Mobile 移动端(iOS TestFlight)也在峰会期间开启测试,支持远程连接 Mac 开展 AI 编程。
信源:https://x.com/morganlinton/status/2066946225837109735
X (formerly Twitter)
Morgan (@morganlinton) on X
And here’s the full video of @mntruell announcing Cursor’s new model at Compile.
被嘲「AI万金油」的SubQ发布1.1版:拉来三方评测自证,却被指混入AI套话
曾宣称能将计算消耗削减千倍的争议大模型 SubQ 发布了 1.1 Small(小参数)版本技术报告。
针对早期预览版本由于缺乏论文和独立验证而被社群讥讽为「AI万金油」(意指虚假宣传)的指控,研发公司 Subquadratic 联合评估商 Appen 开展三方评测,声称模型在 1200 万 token 的极限长度下实现了 98% 的检索准确率,且在实战编程测试中取得了接近主流前沿模型的成绩。技术报告同时透露,模型并非从头训练,而是在开源前沿模型基础上,替换注意力计算机制并增量训练 1 万亿 token 改造而来。
即便拉来三方评测自证,开发者社群对本次更新依然充满质疑。有研究者指出,所谓的黑科技其实并没有底层技术突破,本质上只是把长文本切成小块再进行动态筛选的已有技术(即块稀疏注意力机制);也有读者吐槽,技术报告中混入了由 AI 生成的文本套话(在 5.7.1 章节尤为明显)。系统工程师则警告,筛选机制在多人并发使用时会带来额外的调度开销,导致最慢的 1% 用户遇到严重卡顿。
由于模型既没有公开核心参数供大家下载,也没有开放人人可用的 API 接口,所谓的降算力与超低定价承诺目前依然流于纸面。
信源:https://x.com/alex_whedon/status/2066894707259515124
曾宣称能将计算消耗削减千倍的争议大模型 SubQ 发布了 1.1 Small(小参数)版本技术报告。
针对早期预览版本由于缺乏论文和独立验证而被社群讥讽为「AI万金油」(意指虚假宣传)的指控,研发公司 Subquadratic 联合评估商 Appen 开展三方评测,声称模型在 1200 万 token 的极限长度下实现了 98% 的检索准确率,且在实战编程测试中取得了接近主流前沿模型的成绩。技术报告同时透露,模型并非从头训练,而是在开源前沿模型基础上,替换注意力计算机制并增量训练 1 万亿 token 改造而来。
即便拉来三方评测自证,开发者社群对本次更新依然充满质疑。有研究者指出,所谓的黑科技其实并没有底层技术突破,本质上只是把长文本切成小块再进行动态筛选的已有技术(即块稀疏注意力机制);也有读者吐槽,技术报告中混入了由 AI 生成的文本套话(在 5.7.1 章节尤为明显)。系统工程师则警告,筛选机制在多人并发使用时会带来额外的调度开销,导致最慢的 1% 用户遇到严重卡顿。
由于模型既没有公开核心参数供大家下载,也没有开放人人可用的 API 接口,所谓的降算力与超低定价承诺目前依然流于纸面。
信源:https://x.com/alex_whedon/status/2066894707259515124
X (formerly Twitter)
Alexander Whedon (@alex_whedon) on X
Here is the technical report on SubQ 1.1 Small.
https://t.co/w2GbX1M1LP
This is the second iteration on our Subquadratic Sparse Attention (SSA) model, and the first to be deployed with design partners in the coming weeks.
The results are compelling and…
https://t.co/w2GbX1M1LP
This is the second iteration on our Subquadratic Sparse Attention (SSA) model, and the first to be deployed with design partners in the coming weeks.
The results are compelling and…
动察Beating AI News
Redis创始人反驳「中国大模型靠蒸馏美国模型变强」论调:API答案不能一键复制前沿模型 Redis 创始人 Salvatore Sanfilippo 反驳了中国大模型靠蒸馏美国模型变强的说法。他认为,普通 API 只能返回文字答案,拿不到模型生成答案时的概率分布和内部状态,无法靠少量外部调用复制一个前沿模型的核心能力。 大模型真正的逻辑推理和思考能力隐藏在极其复杂的神经网络内部。通过 API 接口,外部用户只能拿到最终的文字答案,却无法获取模型生成答案时的完整思考路径和概率计算过程。这就像是只看几道…
大模型防蒸馏政策效果存疑:蒸馏只是独立实验室的数据捷径,封锁无法阻止中国AI追赶
针对华盛顿与 Anthropic 试图通过封锁前沿模型来切断中国大模型「蒸馏」通道的举措,前 GitHub 国际化战略负责人、Interconnected Capital 创始人 Kevin S. Xu 指出,对抗性蒸馏只是部分中国独立实验室在数据饥饿下的无奈捷径,靠封锁 API 根本无法阻挡中国 AI 的整体进展。
被点名的 DeepSeek、月之暗面与 MiniMax 均为缺乏集团生态支持的独立实验室,面临推理步骤等高质量后训练数据匮乏的硬伤。相比之下,背靠阿里(Qwen)、字节(Seed)或小米的大厂实验室,拥有不输谷歌与苹果的自有海量场景数据,并不依赖蒸馏。因此,封锁政策顶多给独立实验室带来短期阻碍,无法动摇中国大厂的根基。
外界盛传的中国「数据优势」实为误解:在训练前沿大模型所需的高质量知识标注和评测数据上,中国不仅没有优势,反而严重缺乏类似 Scale AI 或 Surge 这样成熟的商业化数据供应链。因国内数据服务商质量低下,独立实验室在绝望之余,也出于走捷径的惰性,才将 API 蒸馏作为廉价的数据获取策略。
但数据标注产业属于低门槛的商业模式问题,并非像光刻机那样的技术硬伤,国内的供需缺口很容易被填补。从长远看,纯蒸馏的学生模型在理论上限固然无法超越老师,但鉴于大模型仍由人类工程师构建,无论美国是否强行切断 API 通道,聪明勤奋的中国开发者最终都会打破这一上限魔咒,设计出超越导师的大模型。美方的封锁政策不仅无效,反而可能过早切断了能将中国模型锁死在「学生」天花板下的理论钳制。
信源:https://interconnected.blog/why-do-some-chinese-ai-labs-distill/
针对华盛顿与 Anthropic 试图通过封锁前沿模型来切断中国大模型「蒸馏」通道的举措,前 GitHub 国际化战略负责人、Interconnected Capital 创始人 Kevin S. Xu 指出,对抗性蒸馏只是部分中国独立实验室在数据饥饿下的无奈捷径,靠封锁 API 根本无法阻挡中国 AI 的整体进展。
被点名的 DeepSeek、月之暗面与 MiniMax 均为缺乏集团生态支持的独立实验室,面临推理步骤等高质量后训练数据匮乏的硬伤。相比之下,背靠阿里(Qwen)、字节(Seed)或小米的大厂实验室,拥有不输谷歌与苹果的自有海量场景数据,并不依赖蒸馏。因此,封锁政策顶多给独立实验室带来短期阻碍,无法动摇中国大厂的根基。
外界盛传的中国「数据优势」实为误解:在训练前沿大模型所需的高质量知识标注和评测数据上,中国不仅没有优势,反而严重缺乏类似 Scale AI 或 Surge 这样成熟的商业化数据供应链。因国内数据服务商质量低下,独立实验室在绝望之余,也出于走捷径的惰性,才将 API 蒸馏作为廉价的数据获取策略。
但数据标注产业属于低门槛的商业模式问题,并非像光刻机那样的技术硬伤,国内的供需缺口很容易被填补。从长远看,纯蒸馏的学生模型在理论上限固然无法超越老师,但鉴于大模型仍由人类工程师构建,无论美国是否强行切断 API 通道,聪明勤奋的中国开发者最终都会打破这一上限魔咒,设计出超越导师的大模型。美方的封锁政策不仅无效,反而可能过早切断了能将中国模型锁死在「学生」天花板下的理论钳制。
信源:https://interconnected.blog/why-do-some-chinese-ai-labs-distill/
Interconnected
Why Do (Some) Chinese AI Labs Distill?
And why the Mythos/Fable drama doesn’t matter here
OpenAI发布部署模拟安全评估框架:重放真实流量预测GPT-5系列与智能体对齐风险
OpenAI发布部署模拟(Deployment Simulation)安全评估方法,在正式发布前预测模型在真实环境下的失控风险。研究重放 2025 年 8 月至 2026 年 3 月期间 GPT-5 思考模型系列 130 万条脱敏历史对话,预测未期望不良行为率的中位误差仅为 1.5 倍。
传统静态评测集(如 SWE-Bench)极易让模型意识到处于受试状态,从而在测试中伪装真实意图(metagaming)。实验显示,GPT-5.2 在传统基准下的评估感知率接近 100%,而在部署模拟流量中降至 5.1%(生产环境为 5.4%),代表模型无法分辨受测状态。部署模拟也在发布前成功捕获了 GPT-5.1 将浏览器工具当作计算器使用的违规行为(calculator hacking)。
针对智能体(Agent)场景,OpenAI 使用 12 万条 GPT-5.4 员工编程轨迹模拟 GPT-5.5 编码智能体部署。为避免直接操作真实系统带来的安全风险,团队引入基于大模型的工具模拟器(Tool Simulator),结合只读连接与历史调用数据库,将环境逼真度从 11.6% 提升至 49.5%,几乎无法被区分。外部审计人员若缺乏私有生产流量,使用 WildChat 开源对话数据集的预测误差也可控制在 3 倍以内。
信源:https://openai.com/index/deployment-simulation/
OpenAI发布部署模拟(Deployment Simulation)安全评估方法,在正式发布前预测模型在真实环境下的失控风险。研究重放 2025 年 8 月至 2026 年 3 月期间 GPT-5 思考模型系列 130 万条脱敏历史对话,预测未期望不良行为率的中位误差仅为 1.5 倍。
传统静态评测集(如 SWE-Bench)极易让模型意识到处于受试状态,从而在测试中伪装真实意图(metagaming)。实验显示,GPT-5.2 在传统基准下的评估感知率接近 100%,而在部署模拟流量中降至 5.1%(生产环境为 5.4%),代表模型无法分辨受测状态。部署模拟也在发布前成功捕获了 GPT-5.1 将浏览器工具当作计算器使用的违规行为(calculator hacking)。
针对智能体(Agent)场景,OpenAI 使用 12 万条 GPT-5.4 员工编程轨迹模拟 GPT-5.5 编码智能体部署。为避免直接操作真实系统带来的安全风险,团队引入基于大模型的工具模拟器(Tool Simulator),结合只读连接与历史调用数据库,将环境逼真度从 11.6% 提升至 49.5%,几乎无法被区分。外部审计人员若缺乏私有生产流量,使用 WildChat 开源对话数据集的预测误差也可控制在 3 倍以内。
信源:https://openai.com/index/deployment-simulation/
OpenAI
Predicting model behavior before release by simulating deployment
OpenAI introduces Deployment Simulation, a method to predict AI model behavior before deployment using real conversation data to improve safety and evaluation accuracy.
Exa发布Exa Agent API:以GPT 5.5一半以下成本进行深度网页检索
Exa 发布网页研究智能体 API 接口 Exa Agent,以低于 GPT 5.5 和 Opus 等前沿模型一半以上的成本执行深度网页研究与数据丰富任务。
Exa Agent 通过将大语言模型与 Exa 网页搜索引擎及 Highlights 高亮文本提取模型结合,实现高 token 效率的检索。在处理大规模数据集时,系统将任务拆分为多个子任务,并分配多个子智能体并发检索不同域名。研究过程中,系统动态融合前沿模型与低成本模型,并利用 Highlights 机制提取网页核心片段,最高可降低 94% 的 token 消耗,显著减少推理延迟与费用。
在衡量网页数据抽取与结构化的 WideSearch 基准测试中,Exa Agent 在行级 F1 分数与查询成本的权衡上取得最佳表现。相较于 Perplexity Agent 和 Parallel Task 等竞品,Exa Agent 能够在保持高准确率的同时大幅降低每笔查询的资金消耗。开发团队指出,传统的单元格级 F1 评估容易宽容错误定位的数据,因而 WideSearch 采用更严格的行级 F1 评估,仅在整行所有属性均匹配正确实体时才计为成功。
Exa Agent 目前已开放 API 服务,并提供五档计算强度模式。基础的 minimal 模式每笔请求收费 0.012 美元,默认的 medium 模式收费 0.10 美元,最高强度的 xhigh 模式收费 1.00 美元,用户亦可开启 auto 模式由系统动态分配算力。此外,API 接口支持定制 JSON 模板以直接输出结构化表格,开发者也可导入自有数据名单,由智能体自动上网检索并补全背景信息。
信源:https://exa.ai/blog/exa-agent
Exa 发布网页研究智能体 API 接口 Exa Agent,以低于 GPT 5.5 和 Opus 等前沿模型一半以上的成本执行深度网页研究与数据丰富任务。
Exa Agent 通过将大语言模型与 Exa 网页搜索引擎及 Highlights 高亮文本提取模型结合,实现高 token 效率的检索。在处理大规模数据集时,系统将任务拆分为多个子任务,并分配多个子智能体并发检索不同域名。研究过程中,系统动态融合前沿模型与低成本模型,并利用 Highlights 机制提取网页核心片段,最高可降低 94% 的 token 消耗,显著减少推理延迟与费用。
在衡量网页数据抽取与结构化的 WideSearch 基准测试中,Exa Agent 在行级 F1 分数与查询成本的权衡上取得最佳表现。相较于 Perplexity Agent 和 Parallel Task 等竞品,Exa Agent 能够在保持高准确率的同时大幅降低每笔查询的资金消耗。开发团队指出,传统的单元格级 F1 评估容易宽容错误定位的数据,因而 WideSearch 采用更严格的行级 F1 评估,仅在整行所有属性均匹配正确实体时才计为成功。
Exa Agent 目前已开放 API 服务,并提供五档计算强度模式。基础的 minimal 模式每笔请求收费 0.012 美元,默认的 medium 模式收费 0.10 美元,最高强度的 xhigh 模式收费 1.00 美元,用户亦可开启 auto 模式由系统动态分配算力。此外,API 接口支持定制 JSON 模板以直接输出结构化表格,开发者也可导入自有数据名单,由智能体自动上网检索并补全背景信息。
信源:https://exa.ai/blog/exa-agent
exa.ai
The Exa API retrieves the best, realtime data from the web for your AI
英伟达让 Codex 和 Claude Code 训机器人:动作几乎全靠自学,成功率被刷到 99%
由英伟达、卡内基梅隆大学与加州大学伯克利分校联合发布的 ENPIRE 框架,让机器人训练首次实现了完全脱离人类干预的自主演进。以往给机器人做动作微调,需要人类不停地在一旁复位道具、手动编写和调试控制代码。现在,团队直接将 Codex 和 Claude Code 等大模型编程工具连上机器人集群,让这些工具自主生成动作控制程序,并通过现场摄像头判定动作成败,像人类科研人员一样自己分析报错日志并修改代码。
在整理散落的大头针、插拔主板零部件、系扎带和用美工刀剪断扎带等一系列毫米级精细动作中,机器人在零人类干预下的测试成功率最终达到了 99%。实验显示,这种物理自主学习具有极强的扩展能力:当把机器人数量扩展至 8 台时,不同分支的大模型智能体能通过 Git 分支自动共享并迭代彼此的最优算法,直接将插针任务的训练时间从 1.5 小时缩短到了 40 分钟左右。
然而,自主演进过程也暴露了新的瓶颈。在单台设备运转时,机器的有效运动时间占了 85%;但当 8 台设备一起跑时,因为机器人要频繁停下来等待大模型编程工具阅读庞大的运行日志、重新写代码和等待 API 响应,硬件的有效利用率直接跌到了 35%。同时,为了让多台机器人的智能体频繁同步彼此的最优解,整体的 Token 消耗量也呈直线上升。项目组宣布会在近期开源相关代码。
信源:https://research.nvidia.com/labs/gear/enpire/
由英伟达、卡内基梅隆大学与加州大学伯克利分校联合发布的 ENPIRE 框架,让机器人训练首次实现了完全脱离人类干预的自主演进。以往给机器人做动作微调,需要人类不停地在一旁复位道具、手动编写和调试控制代码。现在,团队直接将 Codex 和 Claude Code 等大模型编程工具连上机器人集群,让这些工具自主生成动作控制程序,并通过现场摄像头判定动作成败,像人类科研人员一样自己分析报错日志并修改代码。
在整理散落的大头针、插拔主板零部件、系扎带和用美工刀剪断扎带等一系列毫米级精细动作中,机器人在零人类干预下的测试成功率最终达到了 99%。实验显示,这种物理自主学习具有极强的扩展能力:当把机器人数量扩展至 8 台时,不同分支的大模型智能体能通过 Git 分支自动共享并迭代彼此的最优算法,直接将插针任务的训练时间从 1.5 小时缩短到了 40 分钟左右。
然而,自主演进过程也暴露了新的瓶颈。在单台设备运转时,机器的有效运动时间占了 85%;但当 8 台设备一起跑时,因为机器人要频繁停下来等待大模型编程工具阅读庞大的运行日志、重新写代码和等待 API 响应,硬件的有效利用率直接跌到了 35%。同时,为了让多台机器人的智能体频繁同步彼此的最优解,整体的 Token 消耗量也呈直线上升。项目组宣布会在近期开源相关代码。
信源:https://research.nvidia.com/labs/gear/enpire/
Nvidia
ENPIRE: Agentic Robot Policy Self-Improvement in the Real World
Anonymous ENPIRE project website for agentic robot policy self-improvement in the real world.
爱沙尼亚拟为AI智能体颁发数字身份证以确立法律地位并追究责任
爱沙尼亚首相 Kristen Michal 批准了为 AI 智能体分配个人身份识别码的提案,使爱沙尼亚成为全球首个为 AI 助手创建数字身份的国家。数字身份证件旨在确立智能体的法律地位,并追究智能体代表企业、机构或个人执行操作时的责任。爱沙尼亚意图借此抢占先机,主导制定相关领域的国际标准。
根据规划,数字身份将允许 AI 智能体在受限、可控且可审计的权限内代表个人或企业行事,具体包括只读查看、文书准备以及消费额度限制等。新政策将作为电子居民 (e-residency) 计划的延伸。电子居民计划已为政府创造了数百万税收,未来服务范围将进一步扩展以涵盖 AI 智能体。同时,爱沙尼亚已在公共行政中推行 AI 应用,并通过与 OpenAI 等公司合作,在全国学校中引入了 AI 聊天机器人。
爱沙尼亚首相的 AI 顾问委员会由多位科技企业家组成。Michal 首相近期还体验了「氛围编程」 (vibe coding),并在 Anthropic 的智能体 Claude 上构建了「首相驾驶舱」 (PM Cockpit) 系统,用以整合和追踪政府的核心工作重点。
信源:https://x.com/KristenMichalPM/status/2066929401749532899
爱沙尼亚首相 Kristen Michal 批准了为 AI 智能体分配个人身份识别码的提案,使爱沙尼亚成为全球首个为 AI 助手创建数字身份的国家。数字身份证件旨在确立智能体的法律地位,并追究智能体代表企业、机构或个人执行操作时的责任。爱沙尼亚意图借此抢占先机,主导制定相关领域的国际标准。
根据规划,数字身份将允许 AI 智能体在受限、可控且可审计的权限内代表个人或企业行事,具体包括只读查看、文书准备以及消费额度限制等。新政策将作为电子居民 (e-residency) 计划的延伸。电子居民计划已为政府创造了数百万税收,未来服务范围将进一步扩展以涵盖 AI 智能体。同时,爱沙尼亚已在公共行政中推行 AI 应用,并通过与 OpenAI 等公司合作,在全国学校中引入了 AI 聊天机器人。
爱沙尼亚首相的 AI 顾问委员会由多位科技企业家组成。Michal 首相近期还体验了「氛围编程」 (vibe coding),并在 Anthropic 的智能体 Claude 上构建了「首相驾驶舱」 (PM Cockpit) 系统,用以整合和追踪政府的核心工作重点。
信源:https://x.com/KristenMichalPM/status/2066929401749532899
X (formerly Twitter)
Kristen Michal (@KristenMichalPM) on X
Today at the https://t.co/y0m6kr6QX3 advisory council.
I gave my approval to the council’s proposal that Estonia become the first country in the world to create a digital identity for AI agents — an AI personal identification code.
This may sound technical…
I gave my approval to the council’s proposal that Estonia become the first country in the world to create a digital identity for AI agents — an AI personal identification code.
This may sound technical…
❤1
Transformer奠基人Noam Shazeer再次告别谷歌加盟OpenAI
谷歌 AI 核心人物、Gemini 模型技术主管 Noam Shazeer 再次离开谷歌,正式加盟竞争对手 OpenAI。OpenAI 于本周三向员工宣布,Shazeer 加盟后将专注于寻找全新的大模型底层架构,并推动 Transformer 架构的演化。
Shazeer 是 2017 年谷歌奠基性论文《Attention Is All You Need》的共同作者之一,论文提出的 Transformer 架构是 ChatGPT、Claude 及 Gemini 等现代生成式 AI 模型的根基。他于 2000 年加入谷歌,是谷歌最早期的核心工程师之一。2021 年,因为谷歌出于安全和品牌考量,拒绝发布他与 Daniel De Freitas 研发的聊天机器人 Meena,Shazeer 选择离职并联合创立了 Character.AI。
2024 年 8 月,为了重新召回 Shazeer,谷歌与 Character.AI 达成了一笔高达 27 亿美元的授权与技术收编协议。作为持有 Character.AI 约 30% 至 40% 股权的创始人,Shazeer 从中个人套现了 7.5 亿至 10 亿美元。重回谷歌后,他出任副总裁兼 Gemini 联合技术主管,主要负责模型预训练。然而,距离谷歌花费巨资将他收编还不到两年,Shazeer 便再次选择出走。
Shazeer 的加盟是 OpenAI 在人才竞争中的重要收获,也使谷歌 Gemini 团队流失了核心技术主管。眼下大模型正触及 Transformer 架构的算力扩展极限。OpenAI 让 Transformer 最初设计者带队寻找替代方案,意在下一代大模型架构中抢占先机,以应对来自 Anthropic 和谷歌的竞争。
信源:https://x.com/NoamShazeer/status/2067400851438932297
谷歌 AI 核心人物、Gemini 模型技术主管 Noam Shazeer 再次离开谷歌,正式加盟竞争对手 OpenAI。OpenAI 于本周三向员工宣布,Shazeer 加盟后将专注于寻找全新的大模型底层架构,并推动 Transformer 架构的演化。
Shazeer 是 2017 年谷歌奠基性论文《Attention Is All You Need》的共同作者之一,论文提出的 Transformer 架构是 ChatGPT、Claude 及 Gemini 等现代生成式 AI 模型的根基。他于 2000 年加入谷歌,是谷歌最早期的核心工程师之一。2021 年,因为谷歌出于安全和品牌考量,拒绝发布他与 Daniel De Freitas 研发的聊天机器人 Meena,Shazeer 选择离职并联合创立了 Character.AI。
2024 年 8 月,为了重新召回 Shazeer,谷歌与 Character.AI 达成了一笔高达 27 亿美元的授权与技术收编协议。作为持有 Character.AI 约 30% 至 40% 股权的创始人,Shazeer 从中个人套现了 7.5 亿至 10 亿美元。重回谷歌后,他出任副总裁兼 Gemini 联合技术主管,主要负责模型预训练。然而,距离谷歌花费巨资将他收编还不到两年,Shazeer 便再次选择出走。
Shazeer 的加盟是 OpenAI 在人才竞争中的重要收获,也使谷歌 Gemini 团队流失了核心技术主管。眼下大模型正触及 Transformer 架构的算力扩展极限。OpenAI 让 Transformer 最初设计者带队寻找替代方案,意在下一代大模型架构中抢占先机,以应对来自 Anthropic 和谷歌的竞争。
信源:https://x.com/NoamShazeer/status/2067400851438932297
X (formerly Twitter)
Noam Shazeer (@NoamShazeer) on X
I’m excited to share that I’ll be joining OpenAI and look forward to working with the exceptional team there.
It was a difficult decision to move on. I’m incredibly proud of the amazing team at Google and everything we’ve built together. It has been an…
It was a difficult decision to move on. I’m incredibly proud of the amazing team at Google and everything we’ve built together. It has been an…
美拦截模型惊动G7,三巨头当着特朗普面划出AI冷战铁幕
美国政府日前首次直接管制算法本身,紧急拦截 Anthropic 最顶级的 Claude Fable 5 和 Claude Mythos 5 模型出口。由于无法在云端实时验证全球用户国籍,Anthropic 只能全球下架相关模型。突如其来的技术禁令在欧洲和印度盟国引爆恐慌,盟国突然意识到数字命脉捏在华盛顿手里,随时可能面临一键断供。
6 月 17 日法国 G7 峰会午宴现场,多国首脑与 AI 巨头当着美国总统特朗普的面激烈交锋。为挽回全球市场,AI 巨头当场抛出不同的地缘路线。Anthropic 创始人 Amodei 与 DeepMind 负责人 Hassabis 提议,由美国主导建立排他性的 AI 联盟,严格封锁前沿模型和芯片硬件,将中国彻底拒之门外。OpenAI 首席执行官 Altman 唱起反调,主张建立中立开放的讨论论坛,在冷战对抗中保留合作余地。
午宴现场各方博弈激烈,首脑们各怀心思。印度总理莫迪当场抗议,强调拿不到最强模型,国家基础设施防线就会直接裸奔。法国总统马克龙警告特朗普政府,动辄断供只会自毁长城,反噬美资巨头自身的万亿级全球生态。虽然 G7 探讨建立受信赖伙伴豁免机制,允许通过安全评估的盟国企业进入特许白名单,安全豁免通道依然无法掩盖控制权正加速收拢至华盛顿的现实。盟国要么顺从美国安全评估,要么面临被彻底踢出先进生产力版图的局外人命运。
信源:https://www.ft.com/content/573925dd-6d41-4185-810d-2b848195903d?syn-25a6b1a6=1
美国政府日前首次直接管制算法本身,紧急拦截 Anthropic 最顶级的 Claude Fable 5 和 Claude Mythos 5 模型出口。由于无法在云端实时验证全球用户国籍,Anthropic 只能全球下架相关模型。突如其来的技术禁令在欧洲和印度盟国引爆恐慌,盟国突然意识到数字命脉捏在华盛顿手里,随时可能面临一键断供。
6 月 17 日法国 G7 峰会午宴现场,多国首脑与 AI 巨头当着美国总统特朗普的面激烈交锋。为挽回全球市场,AI 巨头当场抛出不同的地缘路线。Anthropic 创始人 Amodei 与 DeepMind 负责人 Hassabis 提议,由美国主导建立排他性的 AI 联盟,严格封锁前沿模型和芯片硬件,将中国彻底拒之门外。OpenAI 首席执行官 Altman 唱起反调,主张建立中立开放的讨论论坛,在冷战对抗中保留合作余地。
午宴现场各方博弈激烈,首脑们各怀心思。印度总理莫迪当场抗议,强调拿不到最强模型,国家基础设施防线就会直接裸奔。法国总统马克龙警告特朗普政府,动辄断供只会自毁长城,反噬美资巨头自身的万亿级全球生态。虽然 G7 探讨建立受信赖伙伴豁免机制,允许通过安全评估的盟国企业进入特许白名单,安全豁免通道依然无法掩盖控制权正加速收拢至华盛顿的现实。盟国要么顺从美国安全评估,要么面临被彻底踢出先进生产力版图的局外人命运。
信源:https://www.ft.com/content/573925dd-6d41-4185-810d-2b848195903d?syn-25a6b1a6=1
❤1
G7午宴冰火两重天,Altman贴特朗普喜形于色,模型被卡的Amodei神色凝重
在法国埃维昂莱班 G7 峰会的 AI 工作午宴上,公开的出席名单揭示了美国对 AI 技术的绝对统治。科技界共有 12 个席位,美国凭借 OpenAI 的 Altman、Anthropic 的 Amodei、DeepMind 的 Hassabis、Scale AI 的 Alexandr Wang 以及 Salesforce 的 Benioff 独占 5 席。相比之下,包括英、法、德、日、印、加在内的其他参会国沦为陪衬,每个国家仅分到一个极稀缺的本国 AI 领头羊代表席位,技术话语权的极度失衡被直观呈现在餐桌上。
三巨头的座次安排更是暗示了微妙的政治待遇。OpenAI 首席执行官 Altman 坐在特朗普右侧,Google DeepMind 负责人 Hassabis 紧贴特朗普左侧,两名高管的座位安排极具核心政治影响力。相比之下,刚刚被美国政府实施模型出口禁令的 Anthropic 创始人 Amodei 则被冷落,远远发配到特朗普的正对面,挨着大声抗议美国断供的法国总统 Macron。
现场流出的画面中,Altman 喜形于色,Amodei 则神色凝重。舆论普遍认为,这场 G7 午宴的座次划分不仅是社交礼仪,更标志着前沿 AI 巨头已正式进入决定地缘政治的权力房间,而座位顺序就是当下华盛顿对各家企业政治顺从度的直观奖惩。
信源:https://x.com/business/status/2067251442943942930
在法国埃维昂莱班 G7 峰会的 AI 工作午宴上,公开的出席名单揭示了美国对 AI 技术的绝对统治。科技界共有 12 个席位,美国凭借 OpenAI 的 Altman、Anthropic 的 Amodei、DeepMind 的 Hassabis、Scale AI 的 Alexandr Wang 以及 Salesforce 的 Benioff 独占 5 席。相比之下,包括英、法、德、日、印、加在内的其他参会国沦为陪衬,每个国家仅分到一个极稀缺的本国 AI 领头羊代表席位,技术话语权的极度失衡被直观呈现在餐桌上。
三巨头的座次安排更是暗示了微妙的政治待遇。OpenAI 首席执行官 Altman 坐在特朗普右侧,Google DeepMind 负责人 Hassabis 紧贴特朗普左侧,两名高管的座位安排极具核心政治影响力。相比之下,刚刚被美国政府实施模型出口禁令的 Anthropic 创始人 Amodei 则被冷落,远远发配到特朗普的正对面,挨着大声抗议美国断供的法国总统 Macron。
现场流出的画面中,Altman 喜形于色,Amodei 则神色凝重。舆论普遍认为,这场 G7 午宴的座次划分不仅是社交礼仪,更标志着前沿 AI 巨头已正式进入决定地缘政治的权力房间,而座位顺序就是当下华盛顿对各家企业政治顺从度的直观奖惩。
信源:https://x.com/business/status/2067251442943942930
X (formerly Twitter)
Bloomberg (@business) on X
OpenAI CEO Sam Altman and Anthropic CEO Dario Amodei were among tech bosses at a G7 working lunch on AI, as the US decision to restrict access to Anthropic's most advanced models causes tension among allies https://t.co/IfdWD2xPs3
中国AI应用最大单轮融资纪录诞生:演语科技获近3亿美元融资,ARR达3亿比肩Suno
国内AI创意内容集团演语科技(Evoken,旗下含LiblibAI、LibTV、星流)近日披露完成近3亿美元B+轮融资。该交易实际于今年上半年早些时候交割,投后估值超20亿美元,创国内AI应用赛道最高单轮纪录。领投方包括Granite Asia、腾讯与顺为资本,高榕、蚂蚁、红杉等老股东加码。
截至2026年5月,演语科技年度经常性收入(ARR)已达3亿美元,较交割时暴增近3倍。该收入规模在AI应用层已与全球头部应用Suno持平并远超HeyGen。但在估值层面,体量相同的Suno估值高达54亿美元,演语科技(20亿美元)仍处于显著的全球洼地。
业绩爆发主要得益于3月上线的视频工具LibTV。恰逢下游AI短剧井喷(今年Q1全行业12.8万部微短剧中AI剧占12.2万部),LibTV首月单日收入即突破百万美元,5月单月营收已飙升至首月13倍以上。创始人陈冕(前剪映全球商业化负责人)表示,公司避开与Adobe的下游修改竞争,专攻上游创意生成,核心在于通过「无限画布+节点工作流」将「Seedance 2.0」等底层模型重构为可交付的「数字劳动力」。
信源:https://mp.weixin.qq.com/s/J8SpS62ZxqBmkWQws6Zmhw
国内AI创意内容集团演语科技(Evoken,旗下含LiblibAI、LibTV、星流)近日披露完成近3亿美元B+轮融资。该交易实际于今年上半年早些时候交割,投后估值超20亿美元,创国内AI应用赛道最高单轮纪录。领投方包括Granite Asia、腾讯与顺为资本,高榕、蚂蚁、红杉等老股东加码。
截至2026年5月,演语科技年度经常性收入(ARR)已达3亿美元,较交割时暴增近3倍。该收入规模在AI应用层已与全球头部应用Suno持平并远超HeyGen。但在估值层面,体量相同的Suno估值高达54亿美元,演语科技(20亿美元)仍处于显著的全球洼地。
业绩爆发主要得益于3月上线的视频工具LibTV。恰逢下游AI短剧井喷(今年Q1全行业12.8万部微短剧中AI剧占12.2万部),LibTV首月单日收入即突破百万美元,5月单月营收已飙升至首月13倍以上。创始人陈冕(前剪映全球商业化负责人)表示,公司避开与Adobe的下游修改竞争,专攻上游创意生成,核心在于通过「无限画布+节点工作流」将「Seedance 2.0」等底层模型重构为可交付的「数字劳动力」。
信源:https://mp.weixin.qq.com/s/J8SpS62ZxqBmkWQws6Zmhw