动察Beating AI News
3.13K subscribers
869 photos
2 videos
3.38K links
AI新闻信息流
Download Telegram
腾讯混元开源Hy-MT2系列翻译大模型,并同步上线「腾讯Hy翻译」小程序

腾讯混元官方正式宣布开源 Hy-MT2 系列多语种翻译大模型,发布包含 1.8B、7B 及 30B-A3B(MoE架构)三个规模版本。该系列模型支持 33 种语言及 5 种中国方言互译,相关权重与代码已在 Hugging Face、ModelScope 及 GitHub 同步上线,并在 ARM、高通、Intel、沐曦、天数智芯等多个硬件平台完成适配部署。同时,腾讯混元与 WMT26 官方达成合作,共同主办“视频字幕翻译比赛”。

端侧部署是此次升级的重点。借助混元自研的 AngelSlim/Sherry 框架,1.8B 模型实现了 1.25-bit 的极低精度量化,体积压缩至仅 440MB。该版本在苹果 A15 芯片上的推理速度较前代 4-bit 量化版提升 1.5 倍,完全具备在主流手机端侧流畅进行离线推理的能力。此外,7B 与 30B-A3B 版本在 FLORES-200 榜单上击败了 DeepSeek-V4-Pro,并在真实世界与垂直领域测试中,达到 Gemini 3.1 Pro 约 96% 至 99% 的性能水平。官方还一并开源了翻译指令遵循评估基准 IFMTBench。

基于该模型底座的「腾讯Hy翻译」小程序现已开放体验,主打语音输入、风格预设与个性化定制指令。支持离线端侧推理的 iOS 和安卓 APP 也即将在近期上架。

信源:https://mp.weixin.qq.com/s/a_GPa-brAIB5aqXyd8W4-Q
美股AI初创三巨头,竞相上市

随着科技股新一轮狂欢的到来,SpaceX、OpenAI 与 Anthropic 正掀起一场史诗级的 IPO 浪潮。这三家巨头的总估值预计将超过 3 万亿美元,或将重塑未来科技投资的格局。

SpaceX 已正式提交 IPO 招股书,目标估值高达 1.75 万亿至 2.3 万亿美元,预计最早于 2026 年 6 月 12 日挂牌。尽管文件显示公司整体仍面临数十亿美元亏损,但其星链(Starlink)业务在 2025 年已实现 114 亿美元营收和 44 亿美元营业利润。文件还披露了确保马斯克(Elon Musk)维持绝对控制权的超级投票权结构,以及与“建立可容纳 100 万人口的火星殖民地及太空数据中心”挂钩的巨额期权奖励。据悉,高盛 CEO David Solomon 曾通过社交平台私信马斯克直接争取主承销商资格。

在 AI 赛道,OpenAI 正与高盛、摩根士丹利合作,最快将于本周五秘密提交 IPO 招股书草案,计划在 2026 年底前(或最早 9 月)上市。OpenAI 此前在一级市场已累计融资约 1800 亿美元,此次上市估值区间落在 8500 亿至 1.1 万亿美元。受此消息提振,持有其约 13% 股份的主要股东软银(SoftBank)股价大涨 20%,目前已在该笔投资上录得约 450 亿美元的未实现收益。

作为主要竞争对手,Anthropic 同样已正式委托律师团队推进上市流程,计划在 2026 年下半年申请纳斯达克上市,目标估值高达 9000 亿美元。得益于商业化的迅猛进展,Anthropic 今年一季度营收达 48 亿美元,并预计二季度营收将达到 109 亿美元,有望借此实现公司史上首个单季盈利。

信源:https://www.timesnownews.com/business-economy/markets/spacex-vs-openai-vs-anthropic-the-next-tech-ipo-war-article-154366685
1
AI搜索引擎Exa完成2.5亿美元C轮融资,估值一年翻三倍

专为 AI Agent 构建底层搜索基础设施的 Exa 宣布完成 2.5 亿美元 C 轮融资,由 a16z 领投,投后估值从去年 9 月的 7 亿美元飙升至 22 亿美元。本轮资金将用于扩充专有索引库、训练新一代检索模型,并将底层吞吐量扩容至每秒数十万次并发请求。

Exa 强调其核心护城河是「全栈自建」:拥有独立爬虫、追踪超五千亿 URL 的原生索引系统、自研 embedding 模型及第三代向量数据库,彻底告别业内普遍的「套壳谷歌」方案。这套专为 AI 设计的引擎,支持从 200 毫秒极速响应(Exa Instant)到分钟级的自主深度检索(Deep Max,近期在 DeepSearchQA 取得 SOTA)。最新研究还表明,使用 Exa 替代传统搜索引擎进行 RL 智能体训练,可节省 69% 的 Token 消耗,搜索正从「推理工具」进化为不可或缺的「训练基底」。

目前 Exa 的月查询量已达 10 亿次,一年激增十倍,服务客户包括 Cursor、Cognition 等头部 AI 公司。颇具戏剧性的是,曾立起「10^18 > 10^100」(Exa 大于 Google)挑衅广告牌的 Exa,近期也作为首批伙伴接入了 Google Cloud Vertex AI,为 Gemini 企业客户提供 Grounding 搜索落地服务。

信源:https://x.com/ExaAILabs/status/2057132080317042697
👍1
Manus创始人拟融资10亿美元以撤销Meta收购案并谋求在港上市

智能体 AI 初创公司 Manus 的三位创始人肖弘、季逸超与张涛正探讨回购方案,拟从外部投资者处融资约 10 亿美元,以应对北京监管机构此前要求撤销 Meta 收购案的决定。

知情人士透露,上述回购估值将至少匹配 Meta 收购时支付的 20 亿美元。除计划引入 10 亿美元外部资金外,创始人还可能自掏腰包补齐余款。若谈判达成,Manus 将与这些投资方在华设立合资企业,并谋求在香港上市。

今年 4 月,北京监管机构向当事方发出通知,要求取消这笔在 2025 年 12 月宣布的收购案。监管层明确表示,将全力阻止敏感技术流向美国企业。此前,监管部门已采取类似严厉立场,禁止字节跳动和月之暗面等本土科技巨头在未经批准的情况下接受美资,并收紧了离岸中国企业在港上市的监管路径。

由于大部分交易已经完成,在实际操作中彻底逆转交易面临极大难度。Manus 员工目前已入职 Meta 位于新加坡的办公室,技术已与后者的系统深度整合,腾讯、红杉中国及真格基金等早期投资方也已收到退出资金。目前,相关的回购和拆分方案仍处于初步探讨阶段,估值和条款随时可能发生变化,三位创始人最终也可能选择放弃。

信源:https://www.bloomberg.com/news/articles/2026-05-21/manus-weighs-raising-1-billion-to-unwind-meta-takeover
AMD第六代EPYC处理器Venice在台积电2nm量产,百亿美元投资扩充台湾先进封装

AMD 第六代 EPYC 处理器(代号 Venice)已在台积电台湾晶圆厂的 2nm 节点启动量产。这是业界首款基于台积电 2nm 工艺量产的高性能计算(HPC)产品。面向智能体(Agentic)AI 激增的内存需求,AMD 后续的 Verano 处理器将沿用 2nm 工艺并整合 LPDDR 内存。台积电亚利桑那州工厂也已列入后续量产版图。

AMD 同步在台湾生态圈投资逾 100 亿美元,集中扩建先进封装产能。资金流向日月光(ASE)、硅品(SPIL)和力成科技(PTI)等产业链企业。其中,力成科技已完成业界首个面板级 EFB(Elevated Fanout Bridge)2.5D 互连技术验证,负责拔高 Venice CPU 的互连带宽与能效。

搭载 Venice CPU 与 Instinct MI450X GPU 的 AMD Helios 机架级系统正交由新美亚(Sanmina)、纬颖、纬创与英业达进行系统构建。整套平台预计于 2026 年下半年启动数千兆瓦(multi-gigawatt)规模的部署。

信源:https://ir.amd.com/news-events/press-releases/detail/1287/amd-announces-production-ramp-of-next-generation-amd-epyc-processor-venice-on-tsmc-2nm-process-technology
Meta单日裁员8000人,凌晨4点发解雇邮件且监控留任员工训练AI

Meta 于 2026 年 5 月 20 日裁员 8000 人。多位员工披露解雇邮件在当天凌晨 4 点集中发出,公司此前已要求全员在家办公。被裁名单包含每天睡眠不足 4 小时、常在凌晨 3 点提交代码的 IC4 级别高绩效且无 PIP 记录的骨干工程师。

未被裁员的留任员工电脑已被安装监控软件。内部员工 Marco 指出,公司正在追踪留任者的操作轨迹来训练 AI,目标是利用这些 AI 进一步替代现有岗位。Meta 当前正处于创纪录利润期。前员工 Jeremy Bernier 证实内部仍在执行末位淘汰(Stack Ranking),大量背负房贷的初中级工程师及 H1B 签证持有者在无底线加班后,依然直接成为推高股价的牺牲品。

信源:https://x.com/jeremybernier/status/2057089908175679663
阿里云发布万镜一刻全链路AI视频创作平台

阿里云正式发布全链路 AI 视频创作平台万镜一刻 WonderClip,集成 Happy Horse、Wan、Qwen-image 与 Z-image 等阿里系大模型并向全行业开放。

平台提供三种核心工作流。第一,故事板模式专为剧情视频与 AI 短漫剧设计,用户上传剧本或小说后,编剧、分镜和导演智能体自动协同解析,生成分镜和运镜指令以批量产出人物一致的画面。第二,无限画布模式面向广告创意与短剧,用户在单一画布内即可通过自然语言引导智能体搭建生产流,并支持将创作链路保存为协同模板。第三,Agent 模式通过多智能体协同提供对话式成片能力,近期将开启灰度测试。

针对商业营销中常见的字符渲染难题,万镜一刻引入营销意图理解智能体与专用排版渲染引擎,保证生成的字幕、数字及品牌视觉元素精准无误,解决了大模型在视频中文字生成容易出错的痛点。

在交付与协作层面,平台提供品牌定制、轻量化嵌入及全栈 API 集成,支持企业部署具有独立域名和 UI 的品牌空间,并支持多工作室资产管理与精细权限隔离。针对已拥有智能体架构的企业,平台开放了音视频创作技能与 API 接口,供其无缝集成至现有业务流程。目前,史密斯、钛动科技与天阅剧场等企业已接入万镜一刻,用于生成虚拟品牌官视频及短剧量产。

信源:https://mp.weixin.qq.com/s/gV1jZDiOhqe_79Q_k-ngbw
OpenAI模型推翻80年单位距离猜想,AI首次独立解决核心数学公开难题

OpenAI 内部一款通用推理模型推翻了埃尔德什在 1946 年提出的平面单位距离猜想。根据原猜想,在平面上放置 n 个点,距离刚好为 1 的点对数量不会显著超过 n^{1+o(1)},数学界长期认为类似方格的构造已接近极值。

完成这项证明的模型不是专门的数学系统,也没有使用搜索脚手架针对这道难题定制。模型给出一族新的点集构造,把单位距离点对数量拉高到 n^{1+δ} 级别(δ 为大于 0 的常数),打破了学术界沿用近 80 年的上界预期。

新解法直接跨越了常规的学科边界。模型将代数数论的深层工具引入欧氏平面组合几何。Noga Alon、Tim Gowers 和 Arul Shankar 等外部数学家在检查原始证明后,于 arXiv 发布了配套说明论文,指出推导过程依赖 Ellenberg-Venkatesh 和 Golod-Shafarevich 等复杂的代数数论思想。

菲尔兹奖得主 Tim Gowers 将这一成果视作 AI 数学里程碑。数论学者 Arul Shankar 认为当前模型已具备提出原创想法并推进完整论证的能力。相比于证明结论,更大的技术增量在于通用模型在没有专属工具链的环境下,独立跑通了一条人类专家长期未能触及的反例路线。

信源:https://openai.com/index/model-disproves-discrete-geometry-conjecture/
草稿模型开始退场,MTP推测解码冲上本地推理前台

以往做推测解码提速,推理系统习惯外挂一个草稿模型:小模型先猜后续 token,主模型再批量核对。随着带原生多 Token 预测(MTP)能力的模型出现,这个过程正被拉回主模型内部。

MTP 的思路是让主模型自己预判并验证后续 token。对比外接方案,它省掉了一套独立的模型权重和适配环节,也避开了两者 tokenizer 或词表对不齐的麻烦。

上游模型已经给出了动作。DeepSeek-V3 在技术报告中将 MTP 列为训练目标,并指出其可在推理时用于 speculative decoding。DeepSeek-V4 报告也明确沿用了与 V3 相同的 MTP 策略。Qwen3.6 则直接在官方模型卡里写明了 SGLang 和 vLLM 的启动命令。

下游推理框架和工具也开始了密集适配:

• llama.cpp 在 2026 年 5 月 16 日合入了 MTP 支持。据开发者在 Qwen3.6 27B 和 35B-A3B 上的测试,稳定接受率达到 75% 左右,部分配置下生成速度翻倍。但 PR 同样提醒,开启 MTP 会拖慢 prompt processing,并行解码也还待优化。
• vLLM 已将 MTP 加入官方 speculative decoding 列表。按 Qwen3.6 官方推荐,加上 --speculative-config '{"method":"qwen3_next_mtp","num_speculative_tokens":2}' 参数即可启用。不过 vLLM 文档也交了底:真实的提速收益依然取决于具体模型和部署环境。
• LM Studio 0.4.14 Beta 加入了 MTP 手动开关,用户下载好支持 MTP 的模型后,在高级加载设置里开启即可。
• Ollama 现阶段相对谨慎,官方日志目前仅确认在 Mac 的 MLX runner 上支持 Gemma 4 MTP,尚未看到针对 Qwen3.6 或通用 MTP-GGUF 的默认加速说明。
腾讯会议AI同传上线支持音色模仿,时延压低至3秒内

腾讯会议正式上线 AI 同传功能,首期支持中英互译。新功能将同传时延压缩至 3 秒以内,并支持用户开启「模仿你的音色」功能,使 AI 语音翻译能够还原发言人的声音特征。

传统的同传类似于接力赛,需要发言人讲完整句后翻译才能开始。腾讯会议 AI 同传采用实时翻译机制,实现发言与翻译几乎同步。在多人会议场景中,开启音色模仿不仅能让翻译听起来像参会者本人在用外语说话,还能帮助听众轻松分辨不同的发言人,避免被单一的机器合成音混淆。用户也可以随时切换回系统音色,并自由调节原声音量与同传音量比例。

新推出的同传服务与腾讯会议原有的实时转写和会中字幕深度打通,构建起由双语字幕、文字记录与同传语音组成的完整 AI 会议工作流。这一闭环流程能够精准捕捉并即时传递跨语言发言,生成可被 AI 读取和调动的高质量会议上下文素材,从而提高跨语言会议中 AI 纪要、待办提取以及会后问答的准确度。

信源:https://mp.weixin.qq.com/s/fUeZi5zv9ky2nxeLZVhb6A
Grok订阅打通开源终端智能体OpenCode

开源终端编程智能体 OpenCode 正式接入 xAI Grok 订阅服务。拥有 SuperGrok 或 X Premium 个人订阅的用户,可通过 OAuth 授权机制在 OpenCode 中连接并使用个人账号的算力额度,免去单独申请与配置大模型 API Key 的步骤。

用户在 OpenCode 中运行 /connect 并选择 xAI 后,即可开始调用专属代码模型 Grok Build 进行编程。这一模型也是 xAI 官方终端编码智能体的底层驱动模型。针对不同的部署环境,授权流程提供两种接入方式。在常规桌面端,系统通过 xAI Grok OAuth 直接拉起本地浏览器登录。若在无 GUI 交互的远程服务器、VPS 或 SSH 终端中,系统则会打印出临时验证码与认证 URL,支持以 Headless 模式远程授权。

这是继 5 月 16 日首发接入开源智能体 Hermes Agent,以及 5 月 20 日打通 OpenClaw 之后,xAI 在一周内第三次向下释放个人订阅算力。xAI 官方在公告中确认,未来还将引入更多开源智能体与集成通道。

信源:https://x.ai/news/grok-opencode
ChatGPT官方PowerPoint插件上线Beta版,Office套件集成拼图再落一子

OpenAI 官方宣布推出 ChatGPT for PowerPoint 官方插件,目前处于 Beta 测试阶段。用户可以直接在 PowerPoint 的侧边栏中开启 ChatGPT,使用自然语言指令直接创建和修改演示文稿,且生成的幻灯片保留完全的可编辑性。此外,该插件还支持重写单页标题、提炼多文字幻灯片,并能联动 Gmail、Outlook 及 SharePoint 等关联服务,依据用户已有的邮件和文档快速梳理并生成汇报 PPT。

在此之前,OpenAI 已于 2026 年 3 月 5 日推出了官方的 ChatGPT for Excel** 插件 Beta 版,并于 5 月 5 日正式推向 General Availability (GA),覆盖 Free、Plus、Pro 及企业版等所有计划,支持用户直接在 Excel 侧边栏进行公式生成、表格修改和跨 Sheet 数据分析。

不过,对于 Microsoft Word,OpenAI 目前尚未推出官方的 ChatGPT 插件。如果用户需要在 Word 中使用深度集成的 AI 体验,目前主要依赖微软官方推出的 Microsoft 365 Copilot,或者从 Office Add-ins 应用商店中安装由第三方开发者发布的 GPT 插件(需要自行配置 OpenAI API Key )。

信源:https://x.com/ChatGPTapp/status/2057375218765275136
智谱发布GLM-5.1高速版API,400 tokens/s刷新全球速度纪录

智谱面向部分企业客户推出 GLM-5.1 高速版 API ,其模型输出速度达到 400 tokens/s ,刷新了全球大模型官方接口的端到端速度上限。

在完整保留原有旗舰模型能力的前提下,此高速版通过智谱与 TileRT 团队联合研发的高性能推理引擎进行驱动。此引擎彻底重构了 GPU 的运行调度机制,在编译期将模型静态编排为一个常驻 GPU 的 persistent Engine Kernel 。单卡推理时,计算、异步 IO 与通信被全部拆解为 tile 级微任务并仅启动一次 kernel ,算子间的中间结果通过寄存器和共享缓存直传,消除了传统推理中频繁内核启动与显存读写带来的延迟空泡。

当扩展至多卡尺度时, TileRT 进一步将 specialization 并行思路扩展到整张 8 卡 NVL 拓扑,将原本同构的 GPU 节点特化为承担不同任务的异构 Worker 。在处理 GLM-5.1 的注意层计算时,系统指派 GPU 0 运行稀疏索引 Worker ,专门进行稀疏索引构建与路由决策。同时指派 GPU 1 至 GPU 7 运行 MLA Worker ,负责计算密集阶段并将通信完全下沉至 tile 级任务流水线内部,实现了计算与跨卡通信的深度重叠。

此高速版服务目前已面向智谱 MaaS 平台的部分企业客户开放。未来,此技术还将进一步优化 FP8 推理与超长上下文生产环境,为 AI 编程、实时交互和实时语音等低延迟敏感场景提供更具确定性的性能支持。

信源:https://mp.weixin.qq.com/s/FJn5athj8G4y2narTzMSyA
OpenAI推出Codex黑屏锁屏接管功能,防物理窥屏且碰实体键即锁

OpenAI 旗下 Agent 产品 Codex 推出锁定态屏幕控制功能,支持用户在 Mac 处于锁屏且黑屏状态下,通过手机等移动端设备远程安全接管并操作电脑软件。

为实现锁定状态下的安全托管, Codex 会在 macOS 系统中引入经 Apple 授权的底层辅助插件,深度接入系统级解锁流程。移动端发起操作请求时,此插件会在后台悄悄临时解锁系统以运行目标应用。在此期间,系统会完全屏蔽本地物理键盘与鼠标指针输入,同时向所有相连的显示器投射纯黑覆盖层,在物理感官上彻底「致盲」本地屏幕,确保电脑外观始终保持黑屏和锁定状态。

这一后台自动解锁通道受到极严苛的安全边界限制。它只会在移动端安全认证的短暂控制周期内开启,其他本地软件或第三方进程完全无法调用。操作运行中,系统一旦检测到本地物理键盘或鼠标被触碰,会瞬间触发警报,立即收回后台解锁状态并拉起锁屏,暂停所有自动操作,直到用户在现场手动完成解锁。

此外,出于防提权安全考量,这一机制本质上是一个受限的「隐形沙箱」,无法接管终端应用( Terminal ),无法影响 Codex 自身,亦无法私自执行管理员身份认证( Sudo )或批准系统的隐私安全弹窗。

信源:https://x.com/OpenAIDevs/status/2057536706778378692
谷歌Antigravity宣布Gemini额度提升至9倍,社区吐槽「先砍后加」套路

谷歌 Antigravity 团队核心成员(原 Windsurf 创始人)Varun Mohan 宣布,即日起再次将所有付费订阅计划的每周 Gemini 模型调用额度上限提升 3 倍。加上前一日 3 倍的额度调整,目前的基准配额已累计达到最初版本的 9 倍。同时,官方已将所有付费用户的当周用量清零重置,以期为开发者提供更充足的算力余量。

然而,这一「加量」声明并未获得开发者社区的完全认可。多位用户在评论区指出,Antigravity 此前曾经历过一次严重的「配额缩水」(rug-pull),当时的调用限制严苛到哪怕只是偶尔使用侧边栏对话的轻度用户都会迅速触发限制,导致产品陷入完全不可用的「窒息状态」。有开发者直言吐槽称,官方此举本质上只是在修复之前极度不合理的严苛限制,如今却将其包装成慷慨的「免费福利」来进行营销。

信源:https://x.com/_mohansolo/status/2057656550286885284
💩5
OpenAI首季营收57亿美元,但年化营收近450亿美元的Anthropic已将其反超

OpenAI 在 2026 年第一季度实现约 57 亿美元营收,领先竞争对手 Anthropic 约 10 亿美元。不过,Anthropic 的年化营收近期已达到近 450 亿美元,反超 OpenAI 的 300 亿美元年化营收。

OpenAI 的首季增长主要受到 Codex 代码智能体、企业端销售以及 ChatGPT 广告测试的推动。尽管 OpenAI 有望完成 2026 年 300 亿美元的营收目标,但第一季度调整后运营利润率降至 -122% ,意味着每产生 1 美元营收就净亏损 1.22 美元(不含股权激励等大额项目)。得益于首季业绩,OpenAI 从亚马逊和英伟达等供应商处获得 1220 亿美元新融资,而 Anthropic 正在寻求 300 亿美元融资。两家公司均计划最早在 2026 年第四季度启动首次公开募股。

在用户端,ChatGPT 第一季度周活跃用户平均为 9.05 亿,较 2 月份 9.2 亿的峰值有所下滑,未达到 OpenAI 先前设定的 10 亿用户目标。OpenAI 曾在去年警告员工,谷歌将 Gemini 接入搜索底层会带来竞争压力。不过自 4 月推出 GPT 5.5 以及最新图像生成模型以来,ChatGPT 的用户增长已重新加速。在付费订阅方面,ChatGPT 第一季度个人付费用户达到 5500 万,高于 2025 年底的 4700 万。根据规划,OpenAI 计划在 2030 年前通过 ChatGPT 广告业务实现 1020 亿美元年营收。

信源:https://www.theinformation.com/articles/openai-held-1-billion-revenue-lead-anthropic-first-quarter
微软算力加速向Anthropic倾斜,双方正洽谈Maia自研芯片租用协议

Anthropic 正在与微软就租用微软自研 AI 芯片 Maia 进行早期洽谈,以获取更多算力支持。如果达成协议,双方的合作将进一步深化,Anthropic 也将成为微软 Maia 200 芯片的大客户。微软已在 2026 年 1 月开始在 Azure 云数据中心部署 Maia 200 ,主要用于降低 Copilot 智能体的运行成本。

租用自研芯片契合 Anthropic 长期推行的多芯片硬件策略。相比依赖单一英伟达芯片的 OpenAI ,Anthropic 已经长期租用谷歌的 TPU 以及亚马逊的自研芯片,并正在与一家英国芯片初创公司讨论合作。在财务层面,虽然 Anthropic 在当前季度预计实现近 110 亿美元营收和 5.6 亿美元营业利润,但已对三大美国云服务商做出了至少 3300 亿美元的云支出承诺,这包括向 Azure 支付的 300 亿美元。使用云厂商的自研芯片不仅能为 Anthropic 带来定制化硬件优势,还能通过云厂商的成本补贴缓解高昂的算力开支压力。

微软与 Anthropic 的关系近期正在迅速升温。微软在去年底向 Anthropic 投资高达 50 亿美元,目前已成为 Anthropic 的核心客户,计划购买至少 5 亿美元的 Claude 模型使用权以驱动 Copilot 智能体。为了满足 Anthropic 持续飙升的算力需求,微软从 2025 年 11 月起稳步增加了对 Anthropic 的资源倾斜,不仅将更多现有的英伟达服务器划拨给 Anthropic ,还开始为 Anthropic 构建全新的服务器集群。相比之下,一些小型云客户的算力需求则被选择性推后。

信源:https://www.theinformation.com/articles/anthropic-talks-use-microsofts-ai-chips
OpenClaw v2026.5.20重构执行授权并增强Discord语音

开源终端编程智能体 OpenClaw 发布 v2026.5.20 版本,重构了底层执行授权机制,并深度集成 Discord 实时语音与策略控制。

新版本彻底移除了旧版基于 cat 命令组合的执行允许列表。安全机制升级后,用户必须使用专门的 read 工具来加载 Skill 文件,且系统仅会自动放行经过验证的 Skill 执行文件,从而封堵了非标准脚本调用的安全漏洞。

Discord 实时语音会话新增了用户动态跟随功能。 AI 能够智能跟随指定用户跨越语音频道,支持多用户无缝切换,并保留了 DAVE 恢复机制。系统默认在实时语音会话中注入 IDENTITY.mdUSER.md 以及 SOUL.md 等文件承载的画像与角色上下文,增强语音互动的拟真度,用户也可通过 voice.realtime.bootstrapContextFiles 参数直接关闭。

在运行控制与管理上,新版本在命令行中内置了 Policy 策略插件,支持进行通道一致性检查与工作区修复。新版本为 xAI 接口新增了设备代码登录方式,用户无需本地浏览器回调即可通过 OAuth 完成授权。

精简本地模型开关 experimental.localModelLean 现在支持针对单个 Agent 独立开启,无需再全局强制生效。 OpenRouter 接口已全面遵循服务商级别的 params.provider 路由策略,并允许利用模型和智能体参数进行覆盖。

底层依赖中,捆绑的 Codex 套件已升级至 0.132.0 版本,修复了计划任务占用主会话通道以及 Codex 加密响应丢失等异常。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.5.20
Qwen3.7-Max正式上线API,百炼提供Token Plan订阅调用

阿里千问最新旗舰大模型 Qwen3.7-Max 登陆阿里云百炼平台,正式开放 API 接口与 Token Plan 订阅服务调用,输入每百万 Tokens 12 元,输出每百万 Tokens 36 元。

百炼 Token Plan 订阅服务已同步上线 Qwen3.7-Max,订阅用户无需额外付费即可直接调用。

据 Artificial Analysis 评测,此前已发布的 Qwen3.7-Max 得分 56.6 分,位列全球第五、国产大模型第一。

Qwen3.7-Max 专为智能体设计,在自主编程和多工具调用等长程任务中进行了架构优化。在实际长程测试中,Qwen3.7-Max 协同 Claude Code、OpenClaw、Hermes Agent 和 Qwen Code 等框架,能够独立完成长达 35 小时、超过 1000 次工具调用的企业级复杂任务。

信源:https://mp.weixin.qq.com/s/wUSqHErGrillzGxyPOZMOQ
美团开源LongCat-Video-Avatar 1.5数字人框架推理缩至8步

美团 LongCat 团队开源数字人生成框架 LongCat-Video-Avatar 1.5,全面重构音频提取与视频生成算法。框架主打工业级时空稳定性与极速推理,以缩短研究原型与真实部署的性能差距。

框架将先前 Wav2Vec2 编码器替换为 Whisper-large-v3 音频编码器,以提升口型同步和唇形动态。Whisper-large-v3 音频编码器带来的声学表征大幅提升了多语种和跨语言口型生成的鲁棒性。

模型通过 GRPO 强化学习对齐优化,降低了手部变形和异常抽帧等常见生成伪影,提升了长视频的身份一致性。在长视频生成中,框架采用多片段滚动推理,利用前序视频建立全局时序上下文,保持角色身份连贯。

推理端引入基于 DMD2 的少步步数蒸馏技术,将生成去噪迭代压缩至 8 步,以平衡推理效率与图像保真度。

在评估测试中,团队基于 508 组图像与音频配对样本进行测试。众包测试引入了 770 名评估者并收集了 13240 次人工判断,另由 10 名专家从物理合理性、时序稳定性、画面协调性及身份一致性等维度进行评分。官方展示了与 HeyGen、Kling Avatar 2.0、OmniHuman-1.5 的同场对比,并称在时序稳定性、身份一致性和自然口型方面取得了重点提升。除写实人像外,框架可泛化至动漫与动物等风格,并原生支持单声道与多声道音频输入以驱动多人对话与手物交互场景。

模型权重以 MIT 协议发布。同时,项目页伦理声明称页面展示所用生成内容仅供学术使用,不允许商业使用。实际商用仍需单独核对权重、代码、素材和生成内容边界。

信源:https://huggingface.co/meituan-longcat/LongCat-Video-Avatar-1.5
DeepSeek 100亿美元巨额融资进入谈判后期,梁文锋表态专注AGI与开源

DeepSeek(深度求索)目前正处于一轮高达 700 亿元人民币(约合 100 亿美元)巨额融资谈判的最后阶段,较 5 月 8 日市场传闻的 500 亿元(约 73.5 亿美元)规模再度追加。本轮融资以约 450 亿美元的投前估值推进,投后估值将被推升至 550 亿美元。

在资本结构与投资方博弈方面,本轮融资呈现出最新的多方博弈格局。此前 5 月上旬有报道称,创始人梁文锋计划个人出资最高 200 亿元人民币(约 30 亿美元,占本轮约 40% 的份额)以确保团队的绝对控制权,从而取代此前传闻领投的国家人工智能产业投资基金,使后者预计退居第二大资方。

而根据 5 月 22 日的最新进展,随着总融资额扩大,本轮资方的豪华阵容已基本明朗:除国家队基金与梁文锋本人的巨额自有资金跟投外,包括腾讯控股、IDG 资本以及砺思资本(Monolith Capital)在内的多家头部科技巨头与顶尖创投机构已接近确定参与本轮投资,共同构建起「国资+大厂+头部 VC+创始团队」的联合战线。

DeepSeek 管理层在谈判中表现得极其强势。知情人士透露,梁文锋及高管团队在与投资者的多场关键会面中立下硬性承诺:公司即使拿走百亿美元,也将坚定把实现通用人工智能(AGI)作为核心战略目标,优先把资源向开源 AI 模型与前沿探索性研究倾斜,明确将短期商业化变现与盈利压力置于次要地位。

信源:https://www.bloomberg.com/news/articles/2026-05-22/deepseek-founder-declares-agi-goal-as-10-billion-round-advances
👍2