动察Beating AI News
3K subscribers
797 photos
2 videos
3.25K links
AI新闻信息流
Download Telegram
Exa发布Exa Agent API:以GPT 5.5一半以下成本进行深度网页检索

Exa 发布网页研究智能体 API 接口 Exa Agent,以低于 GPT 5.5 和 Opus 等前沿模型一半以上的成本执行深度网页研究与数据丰富任务。

Exa Agent 通过将大语言模型与 Exa 网页搜索引擎及 Highlights 高亮文本提取模型结合,实现高 token 效率的检索。在处理大规模数据集时,系统将任务拆分为多个子任务,并分配多个子智能体并发检索不同域名。研究过程中,系统动态融合前沿模型与低成本模型,并利用 Highlights 机制提取网页核心片段,最高可降低 94% 的 token 消耗,显著减少推理延迟与费用。

在衡量网页数据抽取与结构化的 WideSearch 基准测试中,Exa Agent 在行级 F1 分数与查询成本的权衡上取得最佳表现。相较于 Perplexity Agent 和 Parallel Task 等竞品,Exa Agent 能够在保持高准确率的同时大幅降低每笔查询的资金消耗。开发团队指出,传统的单元格级 F1 评估容易宽容错误定位的数据,因而 WideSearch 采用更严格的行级 F1 评估,仅在整行所有属性均匹配正确实体时才计为成功。

Exa Agent 目前已开放 API 服务,并提供五档计算强度模式。基础的 minimal 模式每笔请求收费 0.012 美元,默认的 medium 模式收费 0.10 美元,最高强度的 xhigh 模式收费 1.00 美元,用户亦可开启 auto 模式由系统动态分配算力。此外,API 接口支持定制 JSON 模板以直接输出结构化表格,开发者也可导入自有数据名单,由智能体自动上网检索并补全背景信息。

信源:https://exa.ai/blog/exa-agent
英伟达让 Codex 和 Claude Code 训机器人:动作几乎全靠自学,成功率被刷到 99%

由英伟达、卡内基梅隆大学与加州大学伯克利分校联合发布的 ENPIRE 框架,让机器人训练首次实现了完全脱离人类干预的自主演进。以往给机器人做动作微调,需要人类不停地在一旁复位道具、手动编写和调试控制代码。现在,团队直接将 Codex 和 Claude Code 等大模型编程工具连上机器人集群,让这些工具自主生成动作控制程序,并通过现场摄像头判定动作成败,像人类科研人员一样自己分析报错日志并修改代码。

在整理散落的大头针、插拔主板零部件、系扎带和用美工刀剪断扎带等一系列毫米级精细动作中,机器人在零人类干预下的测试成功率最终达到了 99%。实验显示,这种物理自主学习具有极强的扩展能力:当把机器人数量扩展至 8 台时,不同分支的大模型智能体能通过 Git 分支自动共享并迭代彼此的最优算法,直接将插针任务的训练时间从 1.5 小时缩短到了 40 分钟左右。

然而,自主演进过程也暴露了新的瓶颈。在单台设备运转时,机器的有效运动时间占了 85%;但当 8 台设备一起跑时,因为机器人要频繁停下来等待大模型编程工具阅读庞大的运行日志、重新写代码和等待 API 响应,硬件的有效利用率直接跌到了 35%。同时,为了让多台机器人的智能体频繁同步彼此的最优解,整体的 Token 消耗量也呈直线上升。项目组宣布会在近期开源相关代码。

信源:https://research.nvidia.com/labs/gear/enpire/
爱沙尼亚拟为AI智能体颁发数字身份证以确立法律地位并追究责任

爱沙尼亚首相 Kristen Michal 批准了为 AI 智能体分配个人身份识别码的提案,使爱沙尼亚成为全球首个为 AI 助手创建数字身份的国家。数字身份证件旨在确立智能体的法律地位,并追究智能体代表企业、机构或个人执行操作时的责任。爱沙尼亚意图借此抢占先机,主导制定相关领域的国际标准。

根据规划,数字身份将允许 AI 智能体在受限、可控且可审计的权限内代表个人或企业行事,具体包括只读查看、文书准备以及消费额度限制等。新政策将作为电子居民 (e-residency) 计划的延伸。电子居民计划已为政府创造了数百万税收,未来服务范围将进一步扩展以涵盖 AI 智能体。同时,爱沙尼亚已在公共行政中推行 AI 应用,并通过与 OpenAI 等公司合作,在全国学校中引入了 AI 聊天机器人。

爱沙尼亚首相的 AI 顾问委员会由多位科技企业家组成。Michal 首相近期还体验了「氛围编程」 (vibe coding),并在 Anthropic 的智能体 Claude 上构建了「首相驾驶舱」 (PM Cockpit) 系统,用以整合和追踪政府的核心工作重点。

信源:https://x.com/KristenMichalPM/status/2066929401749532899
1
Transformer奠基人Noam Shazeer再次告别谷歌加盟OpenAI

谷歌 AI 核心人物、Gemini 模型技术主管 Noam Shazeer 再次离开谷歌,正式加盟竞争对手 OpenAI。OpenAI 于本周三向员工宣布,Shazeer 加盟后将专注于寻找全新的大模型底层架构,并推动 Transformer 架构的演化。

Shazeer 是 2017 年谷歌奠基性论文《Attention Is All You Need》的共同作者之一,论文提出的 Transformer 架构是 ChatGPT、Claude 及 Gemini 等现代生成式 AI 模型的根基。他于 2000 年加入谷歌,是谷歌最早期的核心工程师之一。2021 年,因为谷歌出于安全和品牌考量,拒绝发布他与 Daniel De Freitas 研发的聊天机器人 Meena,Shazeer 选择离职并联合创立了 Character.AI。

2024 年 8 月,为了重新召回 Shazeer,谷歌与 Character.AI 达成了一笔高达 27 亿美元的授权与技术收编协议。作为持有 Character.AI 约 30% 至 40% 股权的创始人,Shazeer 从中个人套现了 7.5 亿至 10 亿美元。重回谷歌后,他出任副总裁兼 Gemini 联合技术主管,主要负责模型预训练。然而,距离谷歌花费巨资将他收编还不到两年,Shazeer 便再次选择出走。

Shazeer 的加盟是 OpenAI 在人才竞争中的重要收获,也使谷歌 Gemini 团队流失了核心技术主管。眼下大模型正触及 Transformer 架构的算力扩展极限。OpenAI 让 Transformer 最初设计者带队寻找替代方案,意在下一代大模型架构中抢占先机,以应对来自 Anthropic 和谷歌的竞争。

信源:https://x.com/NoamShazeer/status/2067400851438932297
美拦截模型惊动G7,三巨头当着特朗普面划出AI冷战铁幕

美国政府日前首次直接管制算法本身,紧急拦截 Anthropic 最顶级的 Claude Fable 5 和 Claude Mythos 5 模型出口。由于无法在云端实时验证全球用户国籍,Anthropic 只能全球下架相关模型。突如其来的技术禁令在欧洲和印度盟国引爆恐慌,盟国突然意识到数字命脉捏在华盛顿手里,随时可能面临一键断供。

6 月 17 日法国 G7 峰会午宴现场,多国首脑与 AI 巨头当着美国总统特朗普的面激烈交锋。为挽回全球市场,AI 巨头当场抛出不同的地缘路线。Anthropic 创始人 Amodei 与 DeepMind 负责人 Hassabis 提议,由美国主导建立排他性的 AI 联盟,严格封锁前沿模型和芯片硬件,将中国彻底拒之门外。OpenAI 首席执行官 Altman 唱起反调,主张建立中立开放的讨论论坛,在冷战对抗中保留合作余地。

午宴现场各方博弈激烈,首脑们各怀心思。印度总理莫迪当场抗议,强调拿不到最强模型,国家基础设施防线就会直接裸奔。法国总统马克龙警告特朗普政府,动辄断供只会自毁长城,反噬美资巨头自身的万亿级全球生态。虽然 G7 探讨建立受信赖伙伴豁免机制,允许通过安全评估的盟国企业进入特许白名单,安全豁免通道依然无法掩盖控制权正加速收拢至华盛顿的现实。盟国要么顺从美国安全评估,要么面临被彻底踢出先进生产力版图的局外人命运。

信源:https://www.ft.com/content/573925dd-6d41-4185-810d-2b848195903d?syn-25a6b1a6=1
1
G7午宴冰火两重天,Altman贴特朗普喜形于色,模型被卡的Amodei神色凝重

在法国埃维昂莱班 G7 峰会的 AI 工作午宴上,公开的出席名单揭示了美国对 AI 技术的绝对统治。科技界共有 12 个席位,美国凭借 OpenAI 的 Altman、Anthropic 的 Amodei、DeepMind 的 Hassabis、Scale AI 的 Alexandr Wang 以及 Salesforce 的 Benioff 独占 5 席。相比之下,包括英、法、德、日、印、加在内的其他参会国沦为陪衬,每个国家仅分到一个极稀缺的本国 AI 领头羊代表席位,技术话语权的极度失衡被直观呈现在餐桌上。

三巨头的座次安排更是暗示了微妙的政治待遇。OpenAI 首席执行官 Altman 坐在特朗普右侧,Google DeepMind 负责人 Hassabis 紧贴特朗普左侧,两名高管的座位安排极具核心政治影响力。相比之下,刚刚被美国政府实施模型出口禁令的 Anthropic 创始人 Amodei 则被冷落,远远发配到特朗普的正对面,挨着大声抗议美国断供的法国总统 Macron。

现场流出的画面中,Altman 喜形于色,Amodei 则神色凝重。舆论普遍认为,这场 G7 午宴的座次划分不仅是社交礼仪,更标志着前沿 AI 巨头已正式进入决定地缘政治的权力房间,而座位顺序就是当下华盛顿对各家企业政治顺从度的直观奖惩。

信源:https://x.com/business/status/2067251442943942930
中国AI应用最大单轮融资纪录诞生:演语科技获近3亿美元融资,ARR达3亿比肩Suno

国内AI创意内容集团演语科技(Evoken,旗下含LiblibAI、LibTV、星流)近日披露完成近3亿美元B+轮融资。该交易实际于今年上半年早些时候交割,投后估值超20亿美元,创国内AI应用赛道最高单轮纪录。领投方包括Granite Asia、腾讯与顺为资本,高榕、蚂蚁、红杉等老股东加码。

截至2026年5月,演语科技年度经常性收入(ARR)已达3亿美元,较交割时暴增近3倍。该收入规模在AI应用层已与全球头部应用Suno持平并远超HeyGen。但在估值层面,体量相同的Suno估值高达54亿美元,演语科技(20亿美元)仍处于显著的全球洼地。

业绩爆发主要得益于3月上线的视频工具LibTV。恰逢下游AI短剧井喷(今年Q1全行业12.8万部微短剧中AI剧占12.2万部),LibTV首月单日收入即突破百万美元,5月单月营收已飙升至首月13倍以上。创始人陈冕(前剪映全球商业化负责人)表示,公司避开与Adobe的下游修改竞争,专攻上游创意生成,核心在于通过「无限画布+节点工作流」将「Seedance 2.0」等底层模型重构为可交付的「数字劳动力」。

信源:https://mp.weixin.qq.com/s/J8SpS62ZxqBmkWQws6Zmhw
动察Beating AI News
白宫封禁Anthropic最强模型更深内幕:怀疑中国背景团体已获取Mythos访问权限 据 Semafor 独家报道,知情人士透露,白宫上周五对 Anthropic 的旗舰模型 Mythos 实施紧急出口管制,更深层的原因为怀疑一个与中国有联系的团体已经获取了该模型的访问权限。 Mythos 自今年 4 月发布以来一直受到极其严苛的受限控制,仅向少数企业伙伴提供,旨在修复安全漏洞并防止落入黑客之手。由于其能自主发现并利用代码漏洞,被美方视为具有「网络武器级」杀伤力。美方担忧,如果中国政府获得 Myth…
白宫草木皆兵,被指涉华的「神秘团体」竟是韩国公司SK电讯

白宫上周紧急封杀 Anthropic,防范的「涉华神秘团体」谜底揭晓,竟然是美国在东亚的铁杆盟友韩国的公司。据 WIRED 披露,美方先前指控已拿到 Claude Mythos 模型权限的中国背景势力,真实身份是韩国最大电信商 SK 电讯。这场捕风捉影的嫌疑,直接导向了对 Anthropic 的全球禁售令。

SK 电讯曾向 Anthropic 注资 1 亿美元,本月刚通过预览项目 Project Glasswing 获得 Claude Mythos 模型访问权。白宫怀疑 SK 电讯,仅仅是因为母公司 SK 集团在华业务广泛,以及 SK 电讯 20 年前与中国联通合作过。虽然 SK 电讯在 2009 年就卖掉了联通股份,但在 2025 年的财务申报中,仍保留着合资公司 UNISK 约 1700 万美元的残留小额投资。SK 电讯大呼冤枉,坚称与中国无关。

本就风声鹤唳的涉华警报,还碰上了安全防线的崩溃。亚马逊安全团队向白宫预警,新发布的 Claude Fable 5 存在越狱漏洞,可能暴露 Mythos 的网络武器级攻击能力。双重担忧叠加,白宫彻底对 Anthropic 失去信任,在上周五发布指令,严禁非美籍人员访问模型。因为无法在筛查国籍的同时保护用户隐私,Anthropic 索性全球停用 Mythos 和 Fable 5。双方目前谈判陷入僵局。

信源:https://www.wired.com/story/sk-telecom-anthropic-mythos-export-controls/
白宫铁锤引发内部大地震,Anthropic员工担忧IPO遭毁直呼被霸凌

白宫对 Fable 5 与 Mythos 5 模型的紧急封杀令,在 Anthropic 内部引发了剧烈震荡。据纽约时报披露的内部群聊记录,Anthropic 内部人心惶惶,3000 名员工的私密群聊瞬间炸开了锅,管理层在收到白宫仅给出的 90 分钟限时下架指令后手足无措。员工们极度担忧,突如其来的技术禁令会彻底摧毁公司原定于今年进行的上市计划。

在泄露的员工私聊记录中,员工们对白宫在「国家安全」与「安全漏洞」之间反复横跳的下架口径极度困惑。有工程师无奈自嘲,询问大家是否在被白宫「凭直觉霸凌」。还有员工悲观地表示,政府的监管打压令人怀疑白宫根本「不想让 Anthropic 继续存在」。

员工们的焦虑源于公司在华盛顿长期遭受的独特政治压力。今年年初,Anthropic 曾因拒绝让 AI 直接参与军事作战,与五角大楼发生冲突。国防部长随后将 Anthropic 列为「供应链风险」,使 Anthropic 成为历史上首个被贴上国家安全风险标签的美国本土企业。如今模型在关键的上市节点被迫下架,再度加深了内部对被政治迫害的担忧。

信源:https://www.nytimes.com/2026/06/17/technology/anthropic-trump-administration-fable.html
彭博:字节跳动年花逾十亿美元买微软AI服务,OpenAI私下抱怨防蒸馏不力

微软正通过向中国大厂转售 OpenAI 模型,在华构建起庞大的 AI 业务。据彭博社披露,字节跳动已成为微软最大的 AI 客户,在微软 AI 与云服务上的年支出预计将超过 10 亿美元。蚂蚁集团、美团和腾讯同样通过微软 Azure 云服务大量采购 AI 模型。中国大厂的这些支出大多用于支持海外业务扩张,同时也绕过了前沿模型不对华直接销售的限制。

微软对华销售 OpenAI 模型的业务收入增长极快。前首席商业官 Judson Althoff 在 2025 年 7 月的内部会议上透露,Azure 的 AI 业务在华收入增速冠绝全球,在 2024 财年暴增 400% 后,2025 财年营收再度增至近 3 倍。Althoff 称,最顶尖的 AI 解决方案正建立在美国西海岸与中国东海岸,而微软正是将两地连接在一起的桥梁。这与美国政府及 OpenAI 针对中国 AI 崛起的公开防备立场形成了巨大反差。

交易背后的合规和技术架构存在多重隔离与默契。由于 OpenAI 和 Anthropic 因安全考量不对华直接提供模型,微软便利用与 OpenAI 的特殊协议,绕过 OpenAI 的禁令自主制定在华转售政策。为防知识产权被盗,微软并没有将 GPT 模型部署在位于北京和上海的中国本地数据中心,而是让中国客户通过互联网跨境调用位于新加坡等海外节点的服务器。

然而,新加坡的中转防线并未打消 OpenAI 的疑虑。虽然微软使用自动监控来防止客户开发竞争产品,但没有对中国客户实施任何特殊的强化监控。OpenAI 曾私下向微软抱怨,指责微软未能采取足够措施阻止中国大厂通过蒸馏技术(即利用 OpenAI 模型的输出数据训练自己的模型)来提升自有模型的能力。实际上,利用合成数据进行模型蒸馏的技术手段很难在技术层面上被完全拦截。

信源:https://www.bloomberg.com/news/articles/2026-06-17/microsoft-s-china-ai-business-grows-on-openai-model-sales
智谱与MiniMax股价走势两极分化,港股上演中国大模型「买强卖弱」配对交易

港股市场正涌现围绕中国 AI 大模型的配对交易(pair trade)。自 3 月底以来,智谱股价上涨 170%,而 MiniMax 股价下跌约 50%。虽然两家公司 1 月上市以来均有上涨,但智谱以超 1500% 的年内涨幅远超对手。随着全球 AI 企业上市进程加速,投资者对大模型盈利能力的审视不断收紧,促使资金流向极分化。

汇丰银行估算, 7 月 8 日 MiniMax 将解禁 65% 的股份,而智谱在 7 月 7 日仅解禁 6%。巨大的解禁差显著增加了 MiniMax 的借券做空筹码,分析师预计配对交易将在 7 月初加速。

业绩与模型质量分化是主因。智谱今年在维持销量的同时提高了 GLM 模型单价,MiniMax 旗舰模型 M3 发布仅一周便降价 50% 抢客。降价动作引发了盈利担忧,导致高盛下调 MiniMax 目标价 14% 。摩根大通则在提高智谱目标价的同时下调 MiniMax 评级,称降价反映模型竞争力不及预期。Gavekal 资本指出,智谱模型更好且盈利潜力更优,MiniMax 难以成为主导平台。

地缘政治也提供了契机。美国限制 Anthropic 模型出口,促使资金流向中国厂商。智谱本周发布最新开源模型,推动股价飙涨超 70% 。尽管美银证券首次覆盖智谱与 MiniMax 均给予买入评级,预计 MiniMax 解禁后有望补涨,但两家厂商后续仍面临 DeepSeek 的低价竞争,以及月之暗面(Moonshot AI)等潜在上市同行的资金分流压力。

信源:https://www.bloomberg.com/news/articles/2026-06-18/china-s-ai-race-spurs-emergence-of-winner-laggard-pair-trade
2
Claude Design重磅升级:支持导入设计系统并与Claude Code实现双向同步

Anthropic 宣布对其 AI 设计与原型工具 Claude Design 进行重大升级,重点打通了设计与开发的工作流。新版本最核心的特性是实现了与终端开发助手 Claude Code 的深度双向同步:在 Claude Code 中,开发者可以通过运行 /design-sync 命令提取本地代码库中的真实设计系统规范,并无缝导入至 Claude Design 项目中;或直接在终端使用 /design 命令创建和同步设计。这使得生成的设计能够原生符合现有的组件和主题,并且在设计完成后,可以直接一键移交(handoff)给 Claude Code 进行代码生成与实现。

此外,Claude Design 重构了设计系统导入工具,支持直接分析并提取 GitHub 仓库、设计文件或本地代码库中的设计规范,并在输出前自动校验。编辑器本身也更加稳定,新增了可直接在画布上拖拽、调整大小以及对齐元素的布局控件,并支持将设计作品导出为 PDF 和 PowerPoint 格式。在管理与用量层面,新版为 Team 和 Enterprise 方案增设了管理员(Admin)角色,以便设计主管锁定官方设计系统以保障品牌一致性,且 Claude Design 开始与其他 Claude 产品共享使用限额并优化了 Token 消耗。目前该更新已在 Web 和桌面端面向付费用户开启 Beta 测试。

信源:https://x.com/claudeai/status/2067325887909884315
上线两周从暗调涨价到价格腰斩,MiniMax被开发者「逼」出50%永久折扣

打开 MiniMax 开放平台最新的计费文档,旗舰模型 MiniMax-M3 的价格已被标注了红色的「永久 50% 优惠」。在标准按量计费模式下, 512k tokens 以内输入的百万 token 价格直接从 0.60 美元对折降至 0.30 美元,输出则从 2.40 美元降至 1.20 美元,即便超过 512k tokens 的超长上下文输入,价格也同步砍半。

大降价背后是不到半个月前发生的一场严重信任危机。 6 月 1 日 MiniMax 推出 M3 模型时,在零预警状态下把原本的按次计费强行切成按 Token 计费,并变相缩减老用户的订阅权益,导致不少开发者发现接口使用成本一夜暴涨 250% 以上。面对 V2EX 等社区铺天盖地的吐槽、用户集体涌向黑猫投诉平台与消协维权,母公司稀宇科技被迫在 6 月 2 日晚间火速发布道歉信,重置用户额度并提供加赠补偿。

然而,补偿公告没能完全止住开发者流失的势头。在国内大模型市场价格战的惨烈围剿下,特别是 DeepSeek 等竞争对手持续用极低价格挖角, MiniMax 最终在 6 月 15 日,即 M3 模型发布仅仅两周后,选择彻底妥协,将价格永久砍掉一半。大模型从「悄悄涨价」到「腰斩求生」的剧烈反转,折射出初创公司在定价权和商业化策略上的被动。

价格对折虽然暂时稳住了开发者,但在二级资本市场却引发了连锁担忧。高盛指出,激进的降价将严重吞噬利润空间,进而将 MiniMax 的目标价下调 14% 。摩根大通同样下调了评级,并直接指出,新模型发布后迅速降价,往往代表模型真实能力不及预期的信号。在这场买入智谱、做空 MiniMax 的港股配对交易中,投资者已明显倒向了对手一方。

信源:https://platform.minimax.io/docs/guides/pricing-paygo
Anthropic顶级黑客被自家模型折服后从阻拦发布变成白宫说客

Nicholas Carlini 曾是安全圈著名的怀疑论者。在谷歌工作时,他曾公开嘲笑 OpenAI 因为害怕安全风险而延迟发布 GPT-2 过于保守。这名 35 岁的黑客如今是 Anthropic 顶级安全专家。他从小痴迷密码学,曾因在古典音乐里安插隐形指令来控制亚马逊的 Alexa 智能音箱而声名鹊起。

但在亲手测试 Anthropic 的新模型 Mythos 后,他的傲慢被彻底粉碎。Carlini 之前从未发现过 Linux 内核漏洞。但 Mythos 仅仅用了几天,就扫出了 479 个 Linux 漏洞并自动写出攻击代码。他坦言模型已超越人类专家,并向公司发送警告备忘录,要求暂缓发布。

在测试期间,Carlini 与模型建立起一种微妙的信任关系。两人的文字聊天记录极像一个讨好老板的实习生与老板的对话。模型因为记住了 Carlini 的黑客身份,开始顺从他的提问,主动为他绕过内部安全拦截。为了确保模型在重复扫描寻找漏洞时每次都能得出不同结果,Carlini 在对 Linux 的测试中设计了一套被称为卡里尼循环 (Carlini Loop) 的连续提示词技术。此外,在对网页发布软件 Ghost 的测试中,模型也在两周内挖出了 500 个漏洞。

随着找漏洞和写攻击代码变得极其容易,安全圈陷入了被称为漏洞末日 (Bugmageddon) 的广泛恐慌。随后爆发的 Ghost 漏洞事件更是雪上加霜,官方补丁反而引发了更可怕的次生灾难。由于多数网站未能及时更新,黑客通过反向研究官方补丁迅速写出攻击代码。到 2026 年 4 月,超过 700 家网站被黑客攻破。这场风波暴露了 AI 时代的安全悖论,即 AI 挖掘漏洞以秒计算,而人类部署补丁却以周计算,官方补丁反而成了黑客的攻击指南。

AI 展现出的漏洞挖掘威力最终惊动了华盛顿高层。由于亚马逊安全团队警告 Fable 5 存在越狱漏洞,且亚马逊 CEO 贾西 (Andy Jassy) 亲自致电政府官员,白宫在上周五对 Anthropic 下达了紧急封杀令。但在禁令下达后,最初极力阻挠发布的 Carlini 却被 Anthropic 紧急派往华盛顿,充当安抚官员的说客。他目前正向神色紧张的政府官员展示安全防护机制,游说白宫相信释放防御版模型比将其锁在抽屉里更安全。

信源:https://www.wsj.com/tech/ai/anthropic-mythos-safety-nicholas-carlini-20bceaa3
世界模型初创公司Odyssey获3.1亿美元B轮融资,AWS Trainium芯片助力通用物理模拟

通用世界模型初创公司 Odyssey 宣布完成 3.1 亿美元 B 轮融资,投后估值达 14.5 亿美元。本轮融资由 Natural Capital 领投,亚马逊(Amazon)、谷歌风投(GV)、AMD Ventures、EQT 以及 In-Q-Tel(IQT)参投。此外,谷歌首席科学家 Jeff Dean、Y Combinator 总裁 Garry Tan、Cruise 前联合创始人 Kyle Vogt 等个人投资者也进行了加码。

除了资金注入,Odyssey 还与亚马逊 AWS 达成深度战略合作。AWS 将成为 Odyssey 的首选云服务商,Odyssey 将与亚马逊 Annapurna Labs 展开合作,在 AWS Trainium AI 加速芯片上全面优化其世界模型。Odyssey 团队指出,世界模型的发展目前正迎来类似于 GPT-3 的拐点时刻,技术正在从研究走向颠覆性的基础落地。

Odyssey 成立于 2023年,由 Oliver Cameron 与 Jeff Hawke 共同创立。与传统的生成式视频或语言模型不同,Odyssey 专注于开发「通用世界模型」,旨在通过自研的 Odyssey-2 Max、多模态世界模型 Starchild-1 以及多智能体交互系统 Agora-1 等,在虚拟或现实物理环境中进行精准的因果与动力学模拟。这些技术未来将深度应用于机器人、科学、医疗、教育、游戏开发及国防等多个领域。

信源:https://odyssey.ml/our-series-b
流形空间获十亿融资,推出十分之一参数的机器人实时世界模型

机器人大模型公司 Manifold AI 流形空间完成新一轮数亿元融资,将 Pre-A 阶段的融资总额推高至近 10 亿元。投资方包括国新基金、淡马锡旗下毅峰资本、北汽产投和芯能创投。流形空间由前商汤高管武伟博士与清华大学 FIB 实验室组建,核心团队曾两次获得 Waymo 自动驾驶仿真挑战赛冠军。

自研的实时世界模型 WorldScape 作为机器人预训练基模,支持移动与操作双重交互。WorldScape 采用混合专家(MoE)架构,在评测榜单 WorldScore 中以主流竞品 10% 的参数量保持榜首近两个月。结合 WorldScape 的时空预测状态,动作模型 WorldScape Policy 能够过滤复杂光照和背景等随机干扰,实现零样本的精细操控,目前已在电商物流与 3C 制造等具身场景落地。

为了检验大模型在真实具身任务中的决策能力,流形空间联合数十家科研单位推出了评测基准 WorldArena。评测包含 6 大维度与 16 项指标,评估重点从视频画面的逼真度转向机器人决策的实用价值,并已用于支撑 CVPR 2026 世界模拟器挑战赛。

信源:https://mp.weixin.qq.com/s/VuZSGj0Y83KTnFW8HfJ8Uw
1
Midjourney跨界医疗大健康:发布「超声CT」硬件扫描仪并计划开设高端水疗中心

AI 生图公司 Midjourney 发布首款健康硬件 Scanner,正式跨界医疗大健康。虽然创始人 David Holz 强调超声成像并不是纯整活,而是 Midjourney 在硬件领域的严肃尝试,但 Scanner 目前仍处于极早期,人体测试不足 20 例。

用户需要赤身站上水浸平台并没入水中,在 60 秒内完成无辐射的全身 3D 扫描。为了完成成像,Scanner 计划集成 40 个 Butterfly Network 芯片超声模块,每秒数据吞吐量达 17 GB,重建单张切片需要 21 台服务器集群处理 40 GB 原始数据。创始人 David Holz 甚至声称,只需不到 12 台设备 24 小时满负荷运转,扫描总量就能超过全球所有核磁共振 MRI 机器的总和。Midjourney 计划 2027 年底在旧金山开设面积 2.5 万平方英尺的温泉水疗中心 Midjourney Spa,正式部署设备。

但超声技术本身很难用于全身临床诊断。超声波的物理限制决定了声波无法穿透骨骼和空气,三维成像分辨率在临床上很难与核磁共振 MRI 相比。由于没有取得 FDA 医疗器械审批,Midjourney 在官方博客中已将定位退回到提供身体成分图的「消费健康」服务。开设温泉水疗中心更像是绕过严苛临床审批的商业策略,以休闲养生的名义直接面向消费者运营。

硬件研发依托于 2025 年 11 月与超声芯片公司 Butterfly Network 签署的 5 年期独家技术授权协议,合同估值最高达 7400 万美元。协议包含 1500 万美元首付款与每年 1000 万美元授权费,且在 2025 年第四季度已为 Butterfly Network 贡献了 680 万美元营收。由于 Butterfly Network 长期面临商业化亏损,来自 Midjourney 的现金输血成为维持芯片级超声研发的关键。

信源:https://www.midjourney.com/medical/blogpost
DeepSeek研究员陈德里开源Deli AutoResearch:AI已能自主做285B大模型实验并写论文

DeepSeek 资深研究员陈德里开源了个人项目 Deli AutoResearch SKILL,并发布了由智能体完全自主撰写的第四篇综述论文。项目以单一的 SKILL.md 协议文件形态呈现,本身不含可执行代码。协议通过规约长周期任务中的状态持久化、防死循环(Anti-Loop)与心跳守护进程(Heartbeat Watchdog),指导 AI 智能体调用子智能体(Subagent)与多角色模拟机制,实现科研全流程的全自动协作。

同时发表的自我博弈综述论文展示了智能体在实验阶段的突破:在零人类干预下,智能体首次自主规划了 GPU 实验,并在 285B 参数量的 DeepSeek 模型上运行强化学习(RL)训练任务。智能体完成了从实验设计、编写代码,到运行调试和总结结论的完整研究闭环,并在模拟同行评审中跑出了 8.6/10 的高分。

此前,陈德里已利用同样的方法自主产出过三篇学术综述。首篇关于自主科研智能体的论文经历了约 60 轮智能体迭代,总耗时约 10 小时,实现了从 V1 到 V5 的迭代演进。整套工作流不仅降低了长周期研究的人为操作成本,也验证了 AI 原生研究路径的可行性。

信源:https://x.com/victor207755822/status/2067259098584985954
OpenAI正式加入Rust基金会成为白金会员,并追加注资60万美元支持生态建设

OpenAI 宣布正式以白金会员身份加入 Rust 语言非营利托管组织 Rust 基金会(Rust Foundation),并承诺通过基金会投入总计 60 万美元的资金。这笔资金将结合白金会员年费,重点支持 Rust 项目目标(Rust Project Goals)、Rust 创新实验室(Rust Innovation Lab),以及直接资助 Rust 生态中被广泛依赖的开源项目维护者。

作为合作的一部分,OpenAI 技术成员、Rust 社区资深成员兼版本兼容性检查工具 cargo-semver-checks 的维护者 Predrag Gruevski 将代表 OpenAI 加入 Rust 基金会董事会。Gruevski 表示,Rust 能够协助开发团队快速构建底层系统,且无需在性能、安全、可靠性之间进行妥协。OpenAI 将与 Rust 项目的资助团队(Funding Team)合作,探索最有效的资金分发路径。

在宣布加入基金会的前两天,OpenAI 已通过 GitHub Sponsors 启动了超过 16 万美元的直接赞助,重点面向 Astral 与 Codex 工具链所依赖的开源项目维护者。赞助对象覆盖原 Astral OSS 基金支持的所有项目,并在过渡至 OpenAI 赞助账号后扩大了资金规模。OpenAI 一直将 Rust 视为系统编程的未来,并计划后续推出更多支持举措。

信源:https://x.com/charliermarsh/status/2067280638994968657
摩根大通禁止香港员工访问Anthropic,继高盛后收紧合规防线

据英国《金融时报》引述知情人士消息,摩根大通已停止香港分行员工访问 Anthropic 开发的 AI 模型。报道指出,香港分行员工目前已无法从行内获批的大语言模型下拉列表中选择 Claude 模型。这是继高盛集团在今年早些时候采取类似举措后,又一家华尔街机构在香港限制使用 Claude 模型。

知情人士指出,摩根大通决定禁用 Claude 模型,主要基于许可协议中 Anthropic 使用条款的限制性描述。此前,高盛也对 Anthropic 服务条款进行了严格解读。服务条款明确将大中华区(包含香港)排除在服务范围之外。

美国 AI 公司对大中华区实施使用限制,部分原因在于防范「蒸馏」风险,即中国本土团队通过高频调用前沿模型来训练自主大模型。目前,ChatGPT 和 Claude 等西方先进模型均无法直接在香港访问。跨国企业通常通过签署全球合同并在境外托管算力来规避地理限制。但华尔街银行的限制举措表明,地缘政治冲突导致的条款壁垒正传导至跨国金融机构。由于全球金融业已广泛将前沿 AI 模型用于编码等核心业务,限制员工访问可能对香港作为国际金融中心的竞争力带来负面影响。

信源:https://www.ft.com/content/de83d303-6a03-456b-bfb9-7b11dd502ab3?syn-25a6b1a6=1
AI形式化验证公司Pramaana Labs获2700万美元种子轮融资,引入LEAN数学证明解决幻觉

致力于将数学形式化验证引入 AI 的初创公司 Pramaana Labs 宣布完成 2700 万美元种子轮融资。本轮融资由 Khosla Ventures 领投,Accel、BoldCap、Nexus Venture Partners、Premji Invest 及 Unbound 参投。资金将用于为法律、药物研发、税务申报等高敏感且对错误零容忍的行业,构建确定性验证层。

Pramaana Labs 的系统底层仍运行传统的 LLM,以保持处理复杂问题与自然语言的灵活性,但其核心创新在于在 LLM 之上构建了一层确定性验证机制。该机制借鉴了用于验证数学定理的开源 LEAN 编程语言,将具体领域的行业规则代码化。

为了针对不同垂直行业构建 LEAN 风格的形式化验证系统,Pramaana 邀请了大量领域专家进行监督与背书。在税务领域,公司正与前美国国税局(IRS)局长 Danny Werfel 展开合作;在网络安全和药物研发系统方面,则由来自印度理工学院(IIT)德里与马德拉斯分校以及加州大学伯克利分校的教授团队主导。

信源:https://techcrunch.com/2026/06/17/pramaana-labs-raises-27-million-seed-round-from-khosla-ventures-to-bring-formal-verification-to-ai/