xAI正式将Grok Build下放至SuperGrok和X Premium+订阅用户
xAI 宣布旗下终端编程智能体 Grok Build (Beta) 正式面向所有 SuperGrok 和 X Premium+ 订阅用户开放。开发者现在可以通过官方命令行接口在本地终端以自然语言进行代码调试、修改与重构。此前,测试权限仅向每月 300 美元的旗舰级 SuperGrok Heavy 订阅用户提供。
作为专为专业软件工程设计的终端工具,Grok Build 引入规划优先 (Plan Mode) 工作流,在执行任何代码变更前,先分析项目全局并生成详细的实施方案供用户审核。工具在底层原生支持模型上下文协议 (MCP) 与多智能体并行协同,并允许在无图形界面交互环境下以无头 (Headless) 模式运行。开发者还能在 CLI 界面直接调用 Imagine 图像和视频生成能力,构建自动化任务或编排工作流。
信源:https://x.com/xai/status/2058973760708091907
xAI 宣布旗下终端编程智能体 Grok Build (Beta) 正式面向所有 SuperGrok 和 X Premium+ 订阅用户开放。开发者现在可以通过官方命令行接口在本地终端以自然语言进行代码调试、修改与重构。此前,测试权限仅向每月 300 美元的旗舰级 SuperGrok Heavy 订阅用户提供。
作为专为专业软件工程设计的终端工具,Grok Build 引入规划优先 (Plan Mode) 工作流,在执行任何代码变更前,先分析项目全局并生成详细的实施方案供用户审核。工具在底层原生支持模型上下文协议 (MCP) 与多智能体并行协同,并允许在无图形界面交互环境下以无头 (Headless) 模式运行。开发者还能在 CLI 界面直接调用 Imagine 图像和视频生成能力,构建自动化任务或编排工作流。
信源:https://x.com/xai/status/2058973760708091907
阿里Qwen3.7-Max上线自动隐式缓存,最高减免80%输入成本
阿里 Qwen 团队宣布在阿里云百炼平台为旗下旗舰模型 Qwen3.7-Max 默认开启自动隐式缓存。开发者无需修改代码或额外指定参数,即可直接享用缓存降本。
在全新的计费机制下,系统会自动识别并提取请求中的重复上下文前缀。一旦发生缓存命中,命中部分的输入 token 费用仅按原单价的 20% 收取,直接免去八成输入成本。
隐式缓存直接针对长文本与 Agent 智能体场景下的巨额开销。拥有 100 万 tokens 长上下文窗口的 Qwen3.7-Max 在运行自主编码等高阶任务时,需要高频、重复读取庞大的代码库或知识文档。一名开发者测试 Qwen3.7 后反馈,仅花不到一小时构建坦克大战网页 demo,就消耗了接近 100 万 tokens。如果放手让智能体在后台自主执行代码审查与循环迭代,单日用量能轻松冲上数亿 tokens。
同行在缓存定价上的内卷,是促成阿里降价的另一个直接诱因。此前, DeepSeek V4-Pro 凭借极低的缓存命中价格吸引了大量开发者。在五月底宣布转为永久降价后, DeepSeek V4-Pro 的缓存命中计费被压到了每百万 tokens 仅 0.003625 美元(约合人民币 0.025 元),相当于在标准输入价格基础上直接免去 99.17% 的成本。大量开发者配合 Reasonix 等专属工具,将单次会话的缓存命中率最高推至 99% 这一极限,使得长会话智能体的运行账单几近为零。
面对竞争压力, Qwen3.7-Max 不仅上线了无需任何配置的隐式缓存,还保留了需要手动声明 cache_control 标识的显式缓存模式。相比于自动缓存,显式缓存的命中确定性更高,命中费用低至标准输入单价的 10% (一折),但首次创建缓存时需支付 125% 的溢价,且缓存块仅有 5 分钟的生命周期(每次发生命中可重新计时)。
信源:https://x.com/Alibaba_Qwen/status/2058932656797368619
阿里 Qwen 团队宣布在阿里云百炼平台为旗下旗舰模型 Qwen3.7-Max 默认开启自动隐式缓存。开发者无需修改代码或额外指定参数,即可直接享用缓存降本。
在全新的计费机制下,系统会自动识别并提取请求中的重复上下文前缀。一旦发生缓存命中,命中部分的输入 token 费用仅按原单价的 20% 收取,直接免去八成输入成本。
隐式缓存直接针对长文本与 Agent 智能体场景下的巨额开销。拥有 100 万 tokens 长上下文窗口的 Qwen3.7-Max 在运行自主编码等高阶任务时,需要高频、重复读取庞大的代码库或知识文档。一名开发者测试 Qwen3.7 后反馈,仅花不到一小时构建坦克大战网页 demo,就消耗了接近 100 万 tokens。如果放手让智能体在后台自主执行代码审查与循环迭代,单日用量能轻松冲上数亿 tokens。
同行在缓存定价上的内卷,是促成阿里降价的另一个直接诱因。此前, DeepSeek V4-Pro 凭借极低的缓存命中价格吸引了大量开发者。在五月底宣布转为永久降价后, DeepSeek V4-Pro 的缓存命中计费被压到了每百万 tokens 仅 0.003625 美元(约合人民币 0.025 元),相当于在标准输入价格基础上直接免去 99.17% 的成本。大量开发者配合 Reasonix 等专属工具,将单次会话的缓存命中率最高推至 99% 这一极限,使得长会话智能体的运行账单几近为零。
面对竞争压力, Qwen3.7-Max 不仅上线了无需任何配置的隐式缓存,还保留了需要手动声明 cache_control 标识的显式缓存模式。相比于自动缓存,显式缓存的命中确定性更高,命中费用低至标准输入单价的 10% (一折),但首次创建缓存时需支付 125% 的溢价,且缓存块仅有 5 分钟的生命周期(每次发生命中可重新计时)。
信源:https://x.com/Alibaba_Qwen/status/2058932656797368619
阿里发布 AgentScope 2.0:解决 Agent 落地时的环境解耦与安全防线问题
阿里通义实验室发布了多智能体(Multi-Agent)开发框架 AgentScope 2.0 版本。相比 1.0 偏向可视化展示消息的「透明开发」定位,新版本聚焦于智能体在真实生产环境中的高可用与安全控制,试图解决长任务中断、权限失控等痛点。
在调用和消息层,框架引入了重试与备用模型机制,防止因单次模型超时导致任务中断。消息模块重构为支持多模态流式数据的 Content Block,配合事件系统提供流式输出和人工确认(Human-in-the-loop)能力。针对 Agent 自主运行的安全隐患,2.0 新增了权限系统,能对高危 Shell 命令、敏感文件读写进行静态与动态拦截。
此外,2.0 引入了 Workspace 环境抽象,将 Agent 的业务逻辑与执行环境解耦。同一个智能体不需要修改代码,即可在本地、Docker 容器或 E2B 云沙箱中运行;配合预热池机制,能降低强化学习等高并发场景下的容器创建开销。目前,框架已完成 Python 版的 2.0 升级,并全新推出 TypeScript 版本,Java 版本也将在近期跟进更新。
信源:https://mp.weixin.qq.com/s/AcBTESODnZqpADRELcK5MQ
阿里通义实验室发布了多智能体(Multi-Agent)开发框架 AgentScope 2.0 版本。相比 1.0 偏向可视化展示消息的「透明开发」定位,新版本聚焦于智能体在真实生产环境中的高可用与安全控制,试图解决长任务中断、权限失控等痛点。
在调用和消息层,框架引入了重试与备用模型机制,防止因单次模型超时导致任务中断。消息模块重构为支持多模态流式数据的 Content Block,配合事件系统提供流式输出和人工确认(Human-in-the-loop)能力。针对 Agent 自主运行的安全隐患,2.0 新增了权限系统,能对高危 Shell 命令、敏感文件读写进行静态与动态拦截。
此外,2.0 引入了 Workspace 环境抽象,将 Agent 的业务逻辑与执行环境解耦。同一个智能体不需要修改代码,即可在本地、Docker 容器或 E2B 云沙箱中运行;配合预热池机制,能降低强化学习等高并发场景下的容器创建开销。目前,框架已完成 Python 版的 2.0 升级,并全新推出 TypeScript 版本,Java 版本也将在近期跟进更新。
信源:https://mp.weixin.qq.com/s/AcBTESODnZqpADRELcK5MQ
谷歌CEO解释AI编程落后原因:缺少Cursor这样的用户入口
谷歌首席执行官桑达尔·皮查伊(Sundar Pichai)在接受《纽约时报》专访时,首次坦承谷歌在前沿 AI 编程、工具调用与长程任务上目前落后于行业最前沿。皮查伊将落后原因归结为:谷歌手里缺少像 Cursor 或 Claude Code 这样能直接接触开发者日常工作的编辑器入口,导致流失了最关键的动态工作流数据。
但关于「尚未打通公开入口」的表态,与旗下 AI 编程产品 Antigravity 的实际市场进程并不完全一致。事实上,谷歌早在去年 11 月便已将首代 Antigravity IDE 推向公开市场,但因配额锁死 Bug、服务器频频过载崩溃以及限制第三方开源 API 接入等运营事故,导致首代公测版未能建立稳定的开发者信任生态,大批早期用户流向了竞品。
专访中,皮查伊侧重展示了 Antigravity 在谷歌内部闭环运行时的测试数据——包括内部 Token 消耗量每周翻倍,以及在极端性能测试中用 12 小时从零构建出操作系统。此处侧重展示内部数据,旨在重塑市场对谷歌底层 Agent 编程能力的信心,向外界表明谷歌底层的技术底座依然完备,在公开市场的被动主要源于应用场景与反馈闭环的广度限制。
上周紧急发布的 Antigravity 2.0 开始全面公测,试图用技术肌肉和让利动作赢回开发者的键盘入口。专访中高调宣传内部战绩并坦承缺少入口,本质上是为了给 2.0 的反攻树立行业信心,从而打通全球开发反馈与算法迭代的真实数据闭环。
信源:https://www.youtube.com/watch?v=RgV57kDzcng
谷歌首席执行官桑达尔·皮查伊(Sundar Pichai)在接受《纽约时报》专访时,首次坦承谷歌在前沿 AI 编程、工具调用与长程任务上目前落后于行业最前沿。皮查伊将落后原因归结为:谷歌手里缺少像 Cursor 或 Claude Code 这样能直接接触开发者日常工作的编辑器入口,导致流失了最关键的动态工作流数据。
但关于「尚未打通公开入口」的表态,与旗下 AI 编程产品 Antigravity 的实际市场进程并不完全一致。事实上,谷歌早在去年 11 月便已将首代 Antigravity IDE 推向公开市场,但因配额锁死 Bug、服务器频频过载崩溃以及限制第三方开源 API 接入等运营事故,导致首代公测版未能建立稳定的开发者信任生态,大批早期用户流向了竞品。
专访中,皮查伊侧重展示了 Antigravity 在谷歌内部闭环运行时的测试数据——包括内部 Token 消耗量每周翻倍,以及在极端性能测试中用 12 小时从零构建出操作系统。此处侧重展示内部数据,旨在重塑市场对谷歌底层 Agent 编程能力的信心,向外界表明谷歌底层的技术底座依然完备,在公开市场的被动主要源于应用场景与反馈闭环的广度限制。
上周紧急发布的 Antigravity 2.0 开始全面公测,试图用技术肌肉和让利动作赢回开发者的键盘入口。专访中高调宣传内部战绩并坦承缺少入口,本质上是为了给 2.0 的反攻树立行业信心,从而打通全球开发反馈与算法迭代的真实数据闭环。
信源:https://www.youtube.com/watch?v=RgV57kDzcng
YouTube
Sundar Pichai on A.I. Backlash, the Future of Work and Google’s Next Era
When Sundar Pichai, Google’s chief executive, took the stage at Google I/O 2026, he outlined a vision of an A.I.-assisted future aimed at making life just a little bit easier in myriad ways.
This comes, however, against the backdrop of a growing public opinion…
This comes, however, against the backdrop of a growing public opinion…
谷歌租TPU给Anthropic的底层逻辑:用前沿模型反哺自研芯片
在英伟达 GPU 一卡难求、各大实验室疯狂囤积算力并建起高墙的背景下,谷歌依然持续向外界提供自研 TPU 芯片服务,其中包括 Anthropic 的研发团队。
皮查伊(Sundar Pichai)在被问及为何不封锁算力以确保绝对竞争优势时,首次阐述了谷歌的商业逻辑与算力生态学。谷歌云的商业化运作在财务和规划上与自家的模型研发团队(谷歌 DeepMind)完全独立。在皮查伊看来,芯片供应并非零和博弈:只要代工厂能生产出足够数量的芯片,自研模型训练和对外租售算力就可以同时满足,互不冲突。
更深层的考量在于,前沿团队的极限使用,能为谷歌迭代自研芯片软硬件生态提供不可替代的战略价值。皮查伊直言:「让最顶尖的研究机构使用 TPU,正是谷歌能够设计并制造出下一代最强 AI 硬件的关键动因。」
前沿芯片的迭代历程表明,顶尖自研芯片不可能在实验室里闭门造车,必须经历前沿模型在极限压力下的物理测试与性能反馈。Anthropic 运行超大规模模型时产生的网络拓扑、内存吞吐及互联瓶颈反馈,能够直接指导下一代 TPU 架构的流片设计与编译优化。
算力军备竞赛的现状表明,成为芯片与底层生态的供应商,战略纵深远比单纯把芯片锁在自家机房更为开阔。
信源:https://www.youtube.com/watch?v=RgV57kDzcng
在英伟达 GPU 一卡难求、各大实验室疯狂囤积算力并建起高墙的背景下,谷歌依然持续向外界提供自研 TPU 芯片服务,其中包括 Anthropic 的研发团队。
皮查伊(Sundar Pichai)在被问及为何不封锁算力以确保绝对竞争优势时,首次阐述了谷歌的商业逻辑与算力生态学。谷歌云的商业化运作在财务和规划上与自家的模型研发团队(谷歌 DeepMind)完全独立。在皮查伊看来,芯片供应并非零和博弈:只要代工厂能生产出足够数量的芯片,自研模型训练和对外租售算力就可以同时满足,互不冲突。
更深层的考量在于,前沿团队的极限使用,能为谷歌迭代自研芯片软硬件生态提供不可替代的战略价值。皮查伊直言:「让最顶尖的研究机构使用 TPU,正是谷歌能够设计并制造出下一代最强 AI 硬件的关键动因。」
前沿芯片的迭代历程表明,顶尖自研芯片不可能在实验室里闭门造车,必须经历前沿模型在极限压力下的物理测试与性能反馈。Anthropic 运行超大规模模型时产生的网络拓扑、内存吞吐及互联瓶颈反馈,能够直接指导下一代 TPU 架构的流片设计与编译优化。
算力军备竞赛的现状表明,成为芯片与底层生态的供应商,战略纵深远比单纯把芯片锁在自家机房更为开阔。
信源:https://www.youtube.com/watch?v=RgV57kDzcng
YouTube
Sundar Pichai on A.I. Backlash, the Future of Work and Google’s Next Era
When Sundar Pichai, Google’s chief executive, took the stage at Google I/O 2026, he outlined a vision of an A.I.-assisted future aimed at making life just a little bit easier in myriad ways.
This comes, however, against the backdrop of a growing public opinion…
This comes, however, against the backdrop of a growing public opinion…
发布一月即登顶,DeepSeek领衔中国大模型霸榜OpenRouter
在模型聚合平台 OpenRouter 公布的大模型调用量排行榜中,中国大模型呈现出历史性的「霸榜」态势。其中,4 月 24 日发布的 DeepSeek V4 Flash,在上线仅一个月的首秀中便以 7.99T(万亿)tokens 的调用量直接登上月度排行榜第一。
根据 OpenRouter 最新的 LLM 调用量月度榜单,前十名排位如下:
1. DeepSeek V4 Flash:7.99T tokens
2. Hy3 preview (腾讯混元3.0预览版):7T tokens
3. Claude Sonnet 4.6:6.65T tokens
4. Claude Opus 4.7:6.07T tokens
5. Hy3 preview (free):5.83T tokens
6. Kimi K2.6:5.45T tokens
7. Gemini 3 Flash Preview:4.57T tokens
8. DeepSeek V3.2:4.06T tokens
9. DeepSeek V4 Pro:3.4T tokens
10. MiniMax M2.7:2.95T tokens
除 DeepSeek 独占三席(V4 Flash、V3.2、V4 Pro)外,腾讯混元(Hy3 预览版与免费版共计 12.83T tokens)、月之暗面(Kimi K2.6)、MiniMax(M2.7)表现同样强劲。西方主流模型中仅剩 Anthropic 与 Google 守住三个席位,在总量与声势上均显被动。
这一流量版图的剧变,核心得益于中国大模型在「极致性价比」与「长文本处理」上的双重突破。以 DeepSeek V4 Flash 为代表的轻量级 MoE 架构,完美切合了 Cursor、Claude Code 等自主编程智能体在高频、大上下文读取时的刚性降本需求,成为全球开发者在智能体(Agent)场景下的默认首选。
信源:https://openrouter.ai/models?tab=leaderboard
在模型聚合平台 OpenRouter 公布的大模型调用量排行榜中,中国大模型呈现出历史性的「霸榜」态势。其中,4 月 24 日发布的 DeepSeek V4 Flash,在上线仅一个月的首秀中便以 7.99T(万亿)tokens 的调用量直接登上月度排行榜第一。
根据 OpenRouter 最新的 LLM 调用量月度榜单,前十名排位如下:
1. DeepSeek V4 Flash:7.99T tokens
2. Hy3 preview (腾讯混元3.0预览版):7T tokens
3. Claude Sonnet 4.6:6.65T tokens
4. Claude Opus 4.7:6.07T tokens
5. Hy3 preview (free):5.83T tokens
6. Kimi K2.6:5.45T tokens
7. Gemini 3 Flash Preview:4.57T tokens
8. DeepSeek V3.2:4.06T tokens
9. DeepSeek V4 Pro:3.4T tokens
10. MiniMax M2.7:2.95T tokens
除 DeepSeek 独占三席(V4 Flash、V3.2、V4 Pro)外,腾讯混元(Hy3 预览版与免费版共计 12.83T tokens)、月之暗面(Kimi K2.6)、MiniMax(M2.7)表现同样强劲。西方主流模型中仅剩 Anthropic 与 Google 守住三个席位,在总量与声势上均显被动。
这一流量版图的剧变,核心得益于中国大模型在「极致性价比」与「长文本处理」上的双重突破。以 DeepSeek V4 Flash 为代表的轻量级 MoE 架构,完美切合了 Cursor、Claude Code 等自主编程智能体在高频、大上下文读取时的刚性降本需求,成为全球开发者在智能体(Agent)场景下的默认首选。
信源:https://openrouter.ai/models?tab=leaderboard
全球首个AI编写预训练框架开源,清华与面壁推出ForgeTrain
面壁智能与清华 NLP 实验室在 OpenBMB 社区联合开源全球首个完全由 AI 编写的生产级大模型预训练框架 ForgeTrain,并发布由 ForgeTrain 训练的端侧小模型 MiniCPM5-1B。作为首个展示「AI 制造 AI」工程闭环的样本, ForgeTrain 在相同硬件条件下性能超越英伟达的 Megatron,在华为昇腾上预训练时也实现了 10% 的加速。同时, MiniCPM5-1B 登顶 Artificial Analysis 开放权重小模型榜第一。
为了让 AI 自主构建底层预训练基础设施,面壁智能提出「代工工程」(Forge Engineering)软件编程范式,摒弃兼容一切硬件与任务的通用框架,转而利用 AI 低成本代码生成能力为特定模型和硬件现场锻造专用代码。在构建机制上, ForgeTrain 采用三阶段方法:首先从现有预训练框架采集关键数据形成测试考场(Harness),接着在自动闭环中迭代生成二进制一致的框架代码,最终解除限制并实现对参考实现的超越。整个自动化演进对应 AI 制造 AI 的 L3 至 L4 阶段。
作为 ForgeTrain 的首个产出模型, MiniCPM5-1B 拥有 10.8 亿参数,核心架构基于标准的 LlamaForCausalLM 设计,大幅降低了下游集成与推理部署门槛。在 Artificial Analysis 评测中,模型以 18 分超越 2B 规模的 Qwen3.5-2B(16 分),并领先 Qwen3.5-0.8B(11 分)与 LFM2.5-1.2B-Thinking(8 分)。模型支持 MLX 4-bit 与 GGUF Q4_K_M 等部署格式, INT4 量化后权重仅为 0.5GB,并原生支持 131,072 tokens 长文本上下文与基于 enable_thinking 的混合双模推理。依托极低的硬件开销, OpenBMB 同步开源了纯离线运行的桌面浮窗伴侣应用 MiniCPM Desk Pet,支持实时响应 Cursor 等开发工具中的编码活动与 LoRA 人设切换。
信源:https://mp.weixin.qq.com/s/Ci0BXKMJHy086MycdqH77w
面壁智能与清华 NLP 实验室在 OpenBMB 社区联合开源全球首个完全由 AI 编写的生产级大模型预训练框架 ForgeTrain,并发布由 ForgeTrain 训练的端侧小模型 MiniCPM5-1B。作为首个展示「AI 制造 AI」工程闭环的样本, ForgeTrain 在相同硬件条件下性能超越英伟达的 Megatron,在华为昇腾上预训练时也实现了 10% 的加速。同时, MiniCPM5-1B 登顶 Artificial Analysis 开放权重小模型榜第一。
为了让 AI 自主构建底层预训练基础设施,面壁智能提出「代工工程」(Forge Engineering)软件编程范式,摒弃兼容一切硬件与任务的通用框架,转而利用 AI 低成本代码生成能力为特定模型和硬件现场锻造专用代码。在构建机制上, ForgeTrain 采用三阶段方法:首先从现有预训练框架采集关键数据形成测试考场(Harness),接着在自动闭环中迭代生成二进制一致的框架代码,最终解除限制并实现对参考实现的超越。整个自动化演进对应 AI 制造 AI 的 L3 至 L4 阶段。
作为 ForgeTrain 的首个产出模型, MiniCPM5-1B 拥有 10.8 亿参数,核心架构基于标准的 LlamaForCausalLM 设计,大幅降低了下游集成与推理部署门槛。在 Artificial Analysis 评测中,模型以 18 分超越 2B 规模的 Qwen3.5-2B(16 分),并领先 Qwen3.5-0.8B(11 分)与 LFM2.5-1.2B-Thinking(8 分)。模型支持 MLX 4-bit 与 GGUF Q4_K_M 等部署格式, INT4 量化后权重仅为 0.5GB,并原生支持 131,072 tokens 长文本上下文与基于 enable_thinking 的混合双模推理。依托极低的硬件开销, OpenBMB 同步开源了纯离线运行的桌面浮窗伴侣应用 MiniCPM Desk Pet,支持实时响应 Cursor 等开发工具中的编码活动与 LoRA 人设切换。
信源:https://mp.weixin.qq.com/s/Ci0BXKMJHy086MycdqH77w
将顶尖大模型工程师视为战略资产,中国拟加强民营AI头部企业关键人才出境审批与合规管理
彭博社报道,中国正计划对阿里巴巴、DeepSeek(深度求索)等民营科技巨头和初创公司的顶尖人工智能(AI)专业人才实施海外出行合规管理。据知情人士透露,有关部门已开始对从事前沿AI研发且被认为对国家具有战略重要性的关键人员施加出行限制。这意味着相关人员在出国旅行前,需要获得有关部门的批准与报备。
长期以来,针对高校核心科研人员、核物理学家以及国有企业高管的因公及因私出国(境)管理是常规机制。然而,将此类出行审批与合规报备机制延伸至民营高科技企业的顶尖AI人才,这一举措颇具风向标意义。知情人士指出,名单的制定并非仅仅依据行政级别或职位高低,而是基于对其技术研发重要性的综合评估,涵盖了多位AI初创公司创始人、核心算法科学家和高级管理人员。
这一举措凸显出在前沿大模型和智能体革命中,顶尖AI工程技术人才已被视为核心战略资产。在中国AI产业加速追赶全球前沿的背景下,大部分核心技术人才在ChatGPT爆发后涌现,并高度集中在民营科技巨头和明星创业公司。此前,Meta以20亿美元收购由中国团队创立并已迁至新加坡的AI Agent初创公司Manus,因涉及技术与人才跨境流失风险引发了国内监管机构的深入审查。为防止敏感技术外流,有关部门在调查期间限制了Manus的两位联合创始人离境。
事实上,针对AI人才的出行合规引导早有端倪。知情人士透露,此前部分民营企业的AI工程师已被要求向相关部门主动报备其海外行程,但并未实行前置审批制。去年,也有媒体报道称有关部门建议顶尖AI创始人及核心研究人员尽量减少非必要的赴美行程。业界分析指出,加强出行审批管理一方面旨在筑牢国家前沿技术安全防线,防止敏感专利及底层模型技术外流;但另一方面,也可能对国内民营大模型企业吸引并留住具备全球化视野的顶尖科学家与海外高端人才带来新的合规考验。
信源:https://www.bloomberg.com/news/articles/2026-05-26/china-expands-travel-curbs-to-top-ai-talent-at-private-firms
彭博社报道,中国正计划对阿里巴巴、DeepSeek(深度求索)等民营科技巨头和初创公司的顶尖人工智能(AI)专业人才实施海外出行合规管理。据知情人士透露,有关部门已开始对从事前沿AI研发且被认为对国家具有战略重要性的关键人员施加出行限制。这意味着相关人员在出国旅行前,需要获得有关部门的批准与报备。
长期以来,针对高校核心科研人员、核物理学家以及国有企业高管的因公及因私出国(境)管理是常规机制。然而,将此类出行审批与合规报备机制延伸至民营高科技企业的顶尖AI人才,这一举措颇具风向标意义。知情人士指出,名单的制定并非仅仅依据行政级别或职位高低,而是基于对其技术研发重要性的综合评估,涵盖了多位AI初创公司创始人、核心算法科学家和高级管理人员。
这一举措凸显出在前沿大模型和智能体革命中,顶尖AI工程技术人才已被视为核心战略资产。在中国AI产业加速追赶全球前沿的背景下,大部分核心技术人才在ChatGPT爆发后涌现,并高度集中在民营科技巨头和明星创业公司。此前,Meta以20亿美元收购由中国团队创立并已迁至新加坡的AI Agent初创公司Manus,因涉及技术与人才跨境流失风险引发了国内监管机构的深入审查。为防止敏感技术外流,有关部门在调查期间限制了Manus的两位联合创始人离境。
事实上,针对AI人才的出行合规引导早有端倪。知情人士透露,此前部分民营企业的AI工程师已被要求向相关部门主动报备其海外行程,但并未实行前置审批制。去年,也有媒体报道称有关部门建议顶尖AI创始人及核心研究人员尽量减少非必要的赴美行程。业界分析指出,加强出行审批管理一方面旨在筑牢国家前沿技术安全防线,防止敏感专利及底层模型技术外流;但另一方面,也可能对国内民营大模型企业吸引并留住具备全球化视野的顶尖科学家与海外高端人才带来新的合规考验。
信源:https://www.bloomberg.com/news/articles/2026-05-26/china-expands-travel-curbs-to-top-ai-talent-at-private-firms
Bloomberg.com
China Expands Travel Curbs to Top AI Talent at Private Firms
China is restricting overseas travel for top AI professionals in private firms such as Alibaba Group Holding Ltd. and DeepSeek, suggesting an escalation in measures intended to safeguard its technology and catch up to the US in a pivotal sphere.
🤮3🖕2🤡1
AI现在还当不了自主科学家,CUSP评测揭示大模型缺乏前瞻科研视野
Sakana AI、斯坦福大学、牛津大学、艾伦人工智能研究所和图灵研究所联合推出时序基准 CUSP,用以评估 AI 的科学进展预测能力。
基准包含 Nature 和 Science 等期刊的 4,760 个科学里程碑,衍生出 17,429 个具体任务,用以测试 GPT-5.4、Claude Sonnet 4.5 和 DeepSeek R1 等前沿大模型能否预测未知的科学未来。
大模型通常通过死记硬背训练数据来回答问题。如果直接测试 AI 对已有科学发现的看法,模型会因为读过「标准答案」而表现完美。
为防模型作弊, CUSP 通过截止条件锁定模型可用信息。例如对于某项 2025 年的科学突破,系统仅允许大模型使用 2025 年之前的历史文献,并设置 pre-cutoff 联网搜索对照实验。这相当于强迫模型回到过去的某个时间点,在零已知答案的盲测环境下预测未来,以此区分模型的知识记忆与真正的科学前瞻能力。
测试结果显示,大模型预测科学进展极其低效。大模型虽能在机制推理中识别合理研究方向,如 GPT-5.4 准确率达 81.9%。但在判定断言能否实现时,各模型精度仅在 45% 到 52% 之间,近乎抛硬币。
此外,模型预测的突破年份普遍严重滞后。 GPT-5.4 预测中位数滞后 14 个月, Claude S4.5 滞后 17 个月,仅 LLaMA 3.3 滞后 4 个月。在方案设计中,即使 GPT-5.4 获得 5.04/10 的最高分,也无法命中后来真正发生的具体技术路径。
这表明,即使 Sakana AI 等团队持续推进自主科研,前沿 AI 暂时也当不了自主科学家。大模型目前仅能作为回顾性的合理解释者,而非合格的前瞻性预言家。对于开创性突破,预测缺口更加显著。
信源:https://arxiv.org/pdf/2605.22681
Sakana AI、斯坦福大学、牛津大学、艾伦人工智能研究所和图灵研究所联合推出时序基准 CUSP,用以评估 AI 的科学进展预测能力。
基准包含 Nature 和 Science 等期刊的 4,760 个科学里程碑,衍生出 17,429 个具体任务,用以测试 GPT-5.4、Claude Sonnet 4.5 和 DeepSeek R1 等前沿大模型能否预测未知的科学未来。
大模型通常通过死记硬背训练数据来回答问题。如果直接测试 AI 对已有科学发现的看法,模型会因为读过「标准答案」而表现完美。
为防模型作弊, CUSP 通过截止条件锁定模型可用信息。例如对于某项 2025 年的科学突破,系统仅允许大模型使用 2025 年之前的历史文献,并设置 pre-cutoff 联网搜索对照实验。这相当于强迫模型回到过去的某个时间点,在零已知答案的盲测环境下预测未来,以此区分模型的知识记忆与真正的科学前瞻能力。
测试结果显示,大模型预测科学进展极其低效。大模型虽能在机制推理中识别合理研究方向,如 GPT-5.4 准确率达 81.9%。但在判定断言能否实现时,各模型精度仅在 45% 到 52% 之间,近乎抛硬币。
此外,模型预测的突破年份普遍严重滞后。 GPT-5.4 预测中位数滞后 14 个月, Claude S4.5 滞后 17 个月,仅 LLaMA 3.3 滞后 4 个月。在方案设计中,即使 GPT-5.4 获得 5.04/10 的最高分,也无法命中后来真正发生的具体技术路径。
这表明,即使 Sakana AI 等团队持续推进自主科研,前沿 AI 暂时也当不了自主科学家。大模型目前仅能作为回顾性的合理解释者,而非合格的前瞻性预言家。对于开创性突破,预测缺口更加显著。
信源:https://arxiv.org/pdf/2605.22681
Kimi误封后仅用英文致歉海外用户,国内开发者怒斥双标并永久停更开源插件
月之暗面旗下模型订阅服务 Kimi Code Plan 近日因封号事件在中文开发者社区引发抗议。风波始于开源开发者 Leechael 针对终端 Agent 工具 Pi Coding Agent 开发了 Kimi 适配器 pi-provider-kimi-code 。由于 Pi 官方最初未支持 Kimi , Leechael 编写了适配代码方便付费用户在终端复用自身额度 。然而,适配器上线后, Kimi 官方对 Leechael 的账号实施了封禁。
与此同时,海外开发者 Noemi 也声称在 Docker 容器中将 Kimi Code 接入 Pi 运行两天后遭遇封号,并贴出 403 权限被拒的截图质问月之暗面官方。
面对开发者群体的集体声讨,封号事件在 5 月 26 日下午迎来了戏剧性解决。 Kimi Code 团队成员 Young 在 X 上仅回复海外开发者 Noemi 表示 「We immediately adjusted our strategy and restored normal access to the affected accounts. 🫡」 ,紧急解封了受影响的付费账户。
然而,风波并未停息,反而迅速演变成第二波舆论危机。官方的致歉与解封声明仅用英文发布,且只在 X 上选择性回复了国外开发者,对国内开发者在中文渠道发起的抗议与退款请求完全不予正面回应。双重态度彻底引爆了国内付费用户的不满。 Leechael 公开晒出 pi-provider-kimi-code 插件 README 停更声明的截图,直言 「解封了。申请退款。只给老外用户公开道歉,中文用户不值得一个解释。👋🏻」 。
停更声明以英文直白列出三条弃用原因:首先是官方错误封禁,其次是解封后无任何解释与道歉,最后是平台对中文用户存在 「差别对待(Discriminatory treatment of Chinese users)」 的系统性倾向,包括更严苛的规则执行、不透明的风控以及缺乏申诉渠道。声明指出,在一个 「先封号且事后拒绝解释」 的厂商底座上开发没有任何长期价值,适配器自此无限期停更,不接受任何合并请求与新版本发布。
信源:https://x.com/Leechael/status/2059212729022595319
月之暗面旗下模型订阅服务 Kimi Code Plan 近日因封号事件在中文开发者社区引发抗议。风波始于开源开发者 Leechael 针对终端 Agent 工具 Pi Coding Agent 开发了 Kimi 适配器 pi-provider-kimi-code 。由于 Pi 官方最初未支持 Kimi , Leechael 编写了适配代码方便付费用户在终端复用自身额度 。然而,适配器上线后, Kimi 官方对 Leechael 的账号实施了封禁。
与此同时,海外开发者 Noemi 也声称在 Docker 容器中将 Kimi Code 接入 Pi 运行两天后遭遇封号,并贴出 403 权限被拒的截图质问月之暗面官方。
面对开发者群体的集体声讨,封号事件在 5 月 26 日下午迎来了戏剧性解决。 Kimi Code 团队成员 Young 在 X 上仅回复海外开发者 Noemi 表示 「We immediately adjusted our strategy and restored normal access to the affected accounts. 🫡」 ,紧急解封了受影响的付费账户。
然而,风波并未停息,反而迅速演变成第二波舆论危机。官方的致歉与解封声明仅用英文发布,且只在 X 上选择性回复了国外开发者,对国内开发者在中文渠道发起的抗议与退款请求完全不予正面回应。双重态度彻底引爆了国内付费用户的不满。 Leechael 公开晒出 pi-provider-kimi-code 插件 README 停更声明的截图,直言 「解封了。申请退款。只给老外用户公开道歉,中文用户不值得一个解释。👋🏻」 。
停更声明以英文直白列出三条弃用原因:首先是官方错误封禁,其次是解封后无任何解释与道歉,最后是平台对中文用户存在 「差别对待(Discriminatory treatment of Chinese users)」 的系统性倾向,包括更严苛的规则执行、不透明的风控以及缺乏申诉渠道。声明指出,在一个 「先封号且事后拒绝解释」 的厂商底座上开发没有任何长期价值,适配器自此无限期停更,不接受任何合并请求与新版本发布。
信源:https://x.com/Leechael/status/2059212729022595319
字节跳动首次发行Seed期权,派发豆包特股防范腾讯挖角
字节跳动首次针对特定业务部门派发独立期权。据英国《金融时报》报道,为了防范腾讯等竞争对手挖角,字节跳动近期向旗下 AI 实验室 Seed 部门员工发放了以豆包命名的低价特股期权,使员工可以直接分享 AI 业务的增长红利,而不会受到集团不同业务线股权稀释的影响。期权方案是字节跳动成立以来首次发行与单一业务单元绑定的特殊期权。
随着国内大模型领域的人才争夺战升温,基础设施和数据标注等核心工程岗位成为抢夺重点。字节跳动自 2023 年建立 Seed 实验室以来,凭借大规模的算力基础设施投资成为 Nvidia 在中国的最大客户,吸引了大量顶尖 AI 研究员。然而,腾讯自 2025 年底承认大模型开发滞后以来,近期由前 OpenAI 研究员姚顺雨带队,开展了密集的定向挖角。近期离职的 Seed 视觉平台资深成员肖雪峰与基础设施专家张驰均已加入腾讯。
为了应对挖角,字节跳动在本月向全球 Seed 员工提供了每股 13 美元的豆包特股认购选择权,相比 2025 年底的每股 10 美元上涨了近 30%,上涨反映出豆包大模型商业化与模型性能的提升。尽管期权机制能够提供丰厚的潜在收益,但组织内部也存在争议。部分内部人士透露,Seed 实验室团队规模已达 2000 人,内部组织架构面临官僚化和职责碎片化挑战。相比之下,腾讯的 AI 团队规模更小,且向研究人员承诺了更广泛的自主权、管理职责和更具吸引力的薪酬方案。除腾讯外,DeepSeek 同样面临激烈的人才竞争压力,目前正向投资者募集首轮资金以保留核心团队,而字节跳动在 2025 年也曾成功挖角多位 DeepSeek 的基础设施核心成员。
信源:https://www.ft.com/content/557561df-4b72-48e8-89cb-239829de694a
字节跳动首次针对特定业务部门派发独立期权。据英国《金融时报》报道,为了防范腾讯等竞争对手挖角,字节跳动近期向旗下 AI 实验室 Seed 部门员工发放了以豆包命名的低价特股期权,使员工可以直接分享 AI 业务的增长红利,而不会受到集团不同业务线股权稀释的影响。期权方案是字节跳动成立以来首次发行与单一业务单元绑定的特殊期权。
随着国内大模型领域的人才争夺战升温,基础设施和数据标注等核心工程岗位成为抢夺重点。字节跳动自 2023 年建立 Seed 实验室以来,凭借大规模的算力基础设施投资成为 Nvidia 在中国的最大客户,吸引了大量顶尖 AI 研究员。然而,腾讯自 2025 年底承认大模型开发滞后以来,近期由前 OpenAI 研究员姚顺雨带队,开展了密集的定向挖角。近期离职的 Seed 视觉平台资深成员肖雪峰与基础设施专家张驰均已加入腾讯。
为了应对挖角,字节跳动在本月向全球 Seed 员工提供了每股 13 美元的豆包特股认购选择权,相比 2025 年底的每股 10 美元上涨了近 30%,上涨反映出豆包大模型商业化与模型性能的提升。尽管期权机制能够提供丰厚的潜在收益,但组织内部也存在争议。部分内部人士透露,Seed 实验室团队规模已达 2000 人,内部组织架构面临官僚化和职责碎片化挑战。相比之下,腾讯的 AI 团队规模更小,且向研究人员承诺了更广泛的自主权、管理职责和更具吸引力的薪酬方案。除腾讯外,DeepSeek 同样面临激烈的人才竞争压力,目前正向投资者募集首轮资金以保留核心团队,而字节跳动在 2025 年也曾成功挖角多位 DeepSeek 的基础设施核心成员。
信源:https://www.ft.com/content/557561df-4b72-48e8-89cb-239829de694a
李开复透露零一万物正筹备上市,明年实现单季度盈利,拒绝「六小虎」标签欲做「金钱豹」
在放弃预训练与 AGI 路线、将核心研发团队并入阿里云并转向 To B 业务一年后,零一万物创始人兼 CEO 李开复接受《晚点 LatePost》采访,首次对外披露了公司的关键财务表现与战略走向。李开复透露,零一万物目前正在拆除红筹架构筹备上市,并预计明年成为中国第一家实现单季度盈利的 AI 2.0 公司。由于业务增长突飞猛进,团队内部已不再满足于被归为大模型「六小虎」,而是以追求真金白银造血能力的「金钱豹」自诩。
财务数据显示,零一万物 2025 年经审计收入达 2.5 亿元人民币(合同订单 5 亿元);而截至 2026 年 5 月,其已锁定的合同订单总额已超过 15 亿元人民币,正向 20 亿元目标冲刺。更具商业价值的是,今年的订单中近一半为经常性订阅收入(ARR),这有望为公司在资本市场争取到更高的估值倍数。由于放弃了耗资巨大的超大模型预训练,零一万物目前一年的运营成本仅为 2 亿多元,主要集中于人力开支,GPU 算力消耗极低。
在产品定位与市场拓展上,零一万物找到了以「一号位工程」为核心的 PMF(产品市场匹配)。李开复扮演客户的「首席 AI 战略官」,直接与企业一号位对接。公司向 Palantir 学习,不盲目追求基座模型迭代(内部对第三方大模型奉行「谁好用谁,零黏性」原则),而是基于本体论(Ontology)和多智能体(Multi-Agent)技术,为企业抽象出 AI 转型地图,并开发了针对 CEO、CFO 等管理者的专属 Agent 智能工具包(如内置 19 个 Agent 的「开复 AI」助手)。目前,零一万物已手握数个上亿元级的战略大客户,并在哈萨克斯坦等国家开展主权 AI 部署。为激励团队,李开复宣布在公司三周年之际增发 2000 万股期权,并设立 100 万元起步、上不封顶的 CEO 专项激励。
信源:https://mp.weixin.qq.com/s/DPNowUxKF8Bw_BI7ZdOYgg
在放弃预训练与 AGI 路线、将核心研发团队并入阿里云并转向 To B 业务一年后,零一万物创始人兼 CEO 李开复接受《晚点 LatePost》采访,首次对外披露了公司的关键财务表现与战略走向。李开复透露,零一万物目前正在拆除红筹架构筹备上市,并预计明年成为中国第一家实现单季度盈利的 AI 2.0 公司。由于业务增长突飞猛进,团队内部已不再满足于被归为大模型「六小虎」,而是以追求真金白银造血能力的「金钱豹」自诩。
财务数据显示,零一万物 2025 年经审计收入达 2.5 亿元人民币(合同订单 5 亿元);而截至 2026 年 5 月,其已锁定的合同订单总额已超过 15 亿元人民币,正向 20 亿元目标冲刺。更具商业价值的是,今年的订单中近一半为经常性订阅收入(ARR),这有望为公司在资本市场争取到更高的估值倍数。由于放弃了耗资巨大的超大模型预训练,零一万物目前一年的运营成本仅为 2 亿多元,主要集中于人力开支,GPU 算力消耗极低。
在产品定位与市场拓展上,零一万物找到了以「一号位工程」为核心的 PMF(产品市场匹配)。李开复扮演客户的「首席 AI 战略官」,直接与企业一号位对接。公司向 Palantir 学习,不盲目追求基座模型迭代(内部对第三方大模型奉行「谁好用谁,零黏性」原则),而是基于本体论(Ontology)和多智能体(Multi-Agent)技术,为企业抽象出 AI 转型地图,并开发了针对 CEO、CFO 等管理者的专属 Agent 智能工具包(如内置 19 个 Agent 的「开复 AI」助手)。目前,零一万物已手握数个上亿元级的战略大客户,并在哈萨克斯坦等国家开展主权 AI 部署。为激励团队,李开复宣布在公司三周年之际增发 2000 万股期权,并设立 100 万元起步、上不封顶的 CEO 专项激励。
信源:https://mp.weixin.qq.com/s/DPNowUxKF8Bw_BI7ZdOYgg
❤1
美团发布「跑腿Skill」,可接入多家AI助手
美团正式将下单与配送履约能力封装为标准化接口「跑腿 Skill」,面向外部 AI 助手生态开放。目前已有多家第三方 AI 助手完成接入,支持用户直接在外部交互界面完成即时配送下单,无需跳转美团客户端。
Skill 接口旨在将原有的配送调度网络与履约闭环延伸至外部入口。除了即时配送,美团孵化的 AI 原生社交社区「觅游」也已于 5 月开启公测,后续计划与本地生活业务展开联动。
行业分析指出,开放「跑腿 Skill」是 C 端高频即时履约业务与外部 AI 结合的典型尝试。接口集成并非对外输出底层大模型,而是将调度履约、下单等成熟业务进行组件化封装,直接嵌入主流 AI 助手。虽然接入有助于拓宽服务入口,但仅靠开放 Skill 难以构成核心技术壁垒。在即时配送赛道,美团仍需面对阿里即时配送体系、字节智能履约与 AI 生态,以及京东到家、闪送等垂直平台的竞争,后续竞争优势的构建仍取决于配送调度网络的数据闭环与复用效率。
信源:https://mp.weixin.qq.com/s/rEBvyzSqHJO8KDknbgMM4w
美团正式将下单与配送履约能力封装为标准化接口「跑腿 Skill」,面向外部 AI 助手生态开放。目前已有多家第三方 AI 助手完成接入,支持用户直接在外部交互界面完成即时配送下单,无需跳转美团客户端。
Skill 接口旨在将原有的配送调度网络与履约闭环延伸至外部入口。除了即时配送,美团孵化的 AI 原生社交社区「觅游」也已于 5 月开启公测,后续计划与本地生活业务展开联动。
行业分析指出,开放「跑腿 Skill」是 C 端高频即时履约业务与外部 AI 结合的典型尝试。接口集成并非对外输出底层大模型,而是将调度履约、下单等成熟业务进行组件化封装,直接嵌入主流 AI 助手。虽然接入有助于拓宽服务入口,但仅靠开放 Skill 难以构成核心技术壁垒。在即时配送赛道,美团仍需面对阿里即时配送体系、字节智能履约与 AI 生态,以及京东到家、闪送等垂直平台的竞争,后续竞争优势的构建仍取决于配送调度网络的数据闭环与复用效率。
信源:https://mp.weixin.qq.com/s/rEBvyzSqHJO8KDknbgMM4w
👍1
Kimi与开源社区达成和解:风控升级误伤第三方工具,「双标公关」系误会
月之暗面旗下 Kimi Code 团队与开源社区于 5 月 26 日晚达成和解,彻底平息了封号事件引发的订阅风控与公关双标危机。开源开发者 Leechael 宣布删除早前言论过激的发言,并确认 pi-provider-kimi-code 插件将继续维护。付费订阅会员未来可在 Pi Coding Agent 等第三方工具中继续安全使用 Kimi Code Plan 。
Kimi Code 团队成员 Young 发布官方中文声明,解释了封号防御的技术细节。团队近期为打击中转站售卖和异常请求,升级了风控防御策略,并将 User-Agent 标识作为判定依据之一。然而,风控模型未充分考虑社区存在较多构造为 Kimi CLI User-Agent 的第三方 Code Agent (如 Pi ),导致系统将正常请求判定为恶意伪造,误伤了大量合规订阅用户。
双标争议实为多渠道沟通时差导致的误会。 Young 向本频道解释,由于国内大模型开发者主要聚集在月之暗面的官方飞书大群,团队在事件发生后第一时间已在飞书内部做了解答与安抚,而 X 平台的英文回复由于时差和跨平台运营出现延迟,无意间造成了只向外网道歉的双标假象。目前,月之暗面已全面调整风控策略,受限账号已全部恢复正常,并开始主动联系第三方开发者优化 User-Agent 判定。
和解达成后, Leechael 透露 Kimi 研发人员已与 Leechael 进行深入沟通,重新建立起对国产大模型生态的基本信心,并开始为 Kimi 个人智能体编写专属的前缀缓存优化指南。
信源:https://x.com/Leechael/status/2059202023539822987
月之暗面旗下 Kimi Code 团队与开源社区于 5 月 26 日晚达成和解,彻底平息了封号事件引发的订阅风控与公关双标危机。开源开发者 Leechael 宣布删除早前言论过激的发言,并确认 pi-provider-kimi-code 插件将继续维护。付费订阅会员未来可在 Pi Coding Agent 等第三方工具中继续安全使用 Kimi Code Plan 。
Kimi Code 团队成员 Young 发布官方中文声明,解释了封号防御的技术细节。团队近期为打击中转站售卖和异常请求,升级了风控防御策略,并将 User-Agent 标识作为判定依据之一。然而,风控模型未充分考虑社区存在较多构造为 Kimi CLI User-Agent 的第三方 Code Agent (如 Pi ),导致系统将正常请求判定为恶意伪造,误伤了大量合规订阅用户。
双标争议实为多渠道沟通时差导致的误会。 Young 向本频道解释,由于国内大模型开发者主要聚集在月之暗面的官方飞书大群,团队在事件发生后第一时间已在飞书内部做了解答与安抚,而 X 平台的英文回复由于时差和跨平台运营出现延迟,无意间造成了只向外网道歉的双标假象。目前,月之暗面已全面调整风控策略,受限账号已全部恢复正常,并开始主动联系第三方开发者优化 User-Agent 判定。
和解达成后, Leechael 透露 Kimi 研发人员已与 Leechael 进行深入沟通,重新建立起对国产大模型生态的基本信心,并开始为 Kimi 个人智能体编写专属的前缀缓存优化指南。
信源:https://x.com/Leechael/status/2059202023539822987
Get笔记更名得到大脑,引入主动式AI Agent并上调会员年费
2026 年 5 月 26 日得到 App 上线十周年,个人知识管理与录音转写软件 Get 笔记更名为「得到大脑」,系统从被动整理转为主动交互的智能体模式。
得到大脑项目始于 2018 年。在 2019 年 5 月 26 日得到三周年的公开信中,项目首次以得到大脑计划公开,由首席科学家杨溥主导,设计目标是搭建个人知识地图。2022 年底 ChatGPT 发布后,项目研发加速。Get 笔记起源于飞书内部的会议整理工具,于 2024 年 5 月推出微信小程序,11 月发布 App 完整版。运营两年期间,Get 笔记注册用户达到 270 万,每日处理约 9000 场会议记录。
更名后的得到大脑新增了主动交互的智能体功能,包含点评一下、发芽一下、拷问一下与润色一下。系统支持主动挖掘历史记录,提示知识盲区,并能将口语化内容转换成发布稿。得到大脑打通了得到平台十年的电子书与课程库,用户在平台内阅读和学习的记录可作为智能体的运行素材。软件提供 Skill 接口与命令行工具(CLI),支持将记录数据接入第三方 AI 工作流。
随着功能调整,会员资费同步上涨。标准版年费从 Get 笔记时期的 199 元/年调整为 299 元/年(限时优惠价,日常价为 399 元/年,单月订阅为 49 元/月),涨幅约 50%。得到大脑首次推出 1999 元/年的专家版,提供包含选题、素材、排版在内的 8 个 AI 写作分工角色。老用户在当前会员有效期内可免费过渡到标准版,个人会议纪要与录音等历史数据均完整保留。由于提价未作提前预告,且部分承诺的运动数据打通等主动功能尚未实现,部分老用户对调价的透明度与产品成熟度提出质疑。
2026 年 5 月 26 日得到 App 上线十周年,个人知识管理与录音转写软件 Get 笔记更名为「得到大脑」,系统从被动整理转为主动交互的智能体模式。
得到大脑项目始于 2018 年。在 2019 年 5 月 26 日得到三周年的公开信中,项目首次以得到大脑计划公开,由首席科学家杨溥主导,设计目标是搭建个人知识地图。2022 年底 ChatGPT 发布后,项目研发加速。Get 笔记起源于飞书内部的会议整理工具,于 2024 年 5 月推出微信小程序,11 月发布 App 完整版。运营两年期间,Get 笔记注册用户达到 270 万,每日处理约 9000 场会议记录。
更名后的得到大脑新增了主动交互的智能体功能,包含点评一下、发芽一下、拷问一下与润色一下。系统支持主动挖掘历史记录,提示知识盲区,并能将口语化内容转换成发布稿。得到大脑打通了得到平台十年的电子书与课程库,用户在平台内阅读和学习的记录可作为智能体的运行素材。软件提供 Skill 接口与命令行工具(CLI),支持将记录数据接入第三方 AI 工作流。
随着功能调整,会员资费同步上涨。标准版年费从 Get 笔记时期的 199 元/年调整为 299 元/年(限时优惠价,日常价为 399 元/年,单月订阅为 49 元/月),涨幅约 50%。得到大脑首次推出 1999 元/年的专家版,提供包含选题、素材、排版在内的 8 个 AI 写作分工角色。老用户在当前会员有效期内可免费过渡到标准版,个人会议纪要与录音等历史数据均完整保留。由于提价未作提前预告,且部分承诺的运动数据打通等主动功能尚未实现,部分老用户对调价的透明度与产品成熟度提出质疑。
周处理25万亿tokens,OpenRouter完成1.13亿美元B轮融资
OpenRouter 宣布完成 1.13 亿美元 B 轮融资,由谷歌母公司 Alphabet 旗下独立成长基金 CapitalG 领投,NVentures、ServiceNow Ventures、MongoDB Ventures、Snowflake Ventures、Databricks Ventures 参投,a16z 与 Menlo Ventures 等老股东继续跟投。
OpenRouter 是一个 AI 模型交易与路由平台,企业可通过一个 API 调用 Anthropic、Google、OpenAI、xAI、DeepSeek 等提供方的 400 多个模型。
这轮融资最硬的支撑是用量增长。公司称,其平台每周处理量已升至 25 万亿 tokens,约合每月 100 万亿 tokens,较 6 个月前的每周 5 万亿 tokens 增长 5 倍。平台目前服务超过 800 万全球用户,包括 AI 原生创业公司和大型企业。
OpenRouter 要解决的是企业从单模型调用转向多模型调度后的控制问题。不同任务需要在成本、延迟、能力和数据处理政策之间取舍,企业需要统一的路由、权限、支出可视化和审计型使用报告。公司称,新融资将用于扩展路由、治理和优化能力。
模型公司继续卷价格和能力,开发者反而更需要一个中间层来比较、切换和调度模型。谁掌握真实调用流量,谁就更接近企业 AI 采购和模型分发的关键位置。
信源:https://x.com/openrouter/status/2059277623629664758?s=46
OpenRouter 宣布完成 1.13 亿美元 B 轮融资,由谷歌母公司 Alphabet 旗下独立成长基金 CapitalG 领投,NVentures、ServiceNow Ventures、MongoDB Ventures、Snowflake Ventures、Databricks Ventures 参投,a16z 与 Menlo Ventures 等老股东继续跟投。
OpenRouter 是一个 AI 模型交易与路由平台,企业可通过一个 API 调用 Anthropic、Google、OpenAI、xAI、DeepSeek 等提供方的 400 多个模型。
这轮融资最硬的支撑是用量增长。公司称,其平台每周处理量已升至 25 万亿 tokens,约合每月 100 万亿 tokens,较 6 个月前的每周 5 万亿 tokens 增长 5 倍。平台目前服务超过 800 万全球用户,包括 AI 原生创业公司和大型企业。
OpenRouter 要解决的是企业从单模型调用转向多模型调度后的控制问题。不同任务需要在成本、延迟、能力和数据处理政策之间取舍,企业需要统一的路由、权限、支出可视化和审计型使用报告。公司称,新融资将用于扩展路由、治理和优化能力。
模型公司继续卷价格和能力,开发者反而更需要一个中间层来比较、切换和调度模型。谁掌握真实调用流量,谁就更接近企业 AI 采购和模型分发的关键位置。
信源:https://x.com/openrouter/status/2059277623629664758?s=46
X (formerly Twitter)
OpenRouter (@OpenRouter) on X
Today we’re announcing our $113M Series B led by @CapitalGVC.
Over the last 6 months, weekly volume on OpenRouter grew from 5T to 25T tokens as AI rapidly shifts from experimentation into production.
We’re excited for what comes next.
Over the last 6 months, weekly volume on OpenRouter grew from 5T to 25T tokens as AI rapidly shifts from experimentation into production.
We’re excited for what comes next.
永久降价最高99%并统一上下文计费,小米MiMo大模型全面升级计费与套餐体系
小米旗下大模型 API 迎来大范围价格调整,对自研大模型 MiMo-V2.5 系列实施永久性大幅降价,降幅最高达到 99 %。本次降价不仅大幅压低了基础单价,还取消了长文本计费溢价,实现所有上下文长度统一计费。
具体计费方案显示,旗舰级模型 MiMo-V2.5-Pro 的输入缓存命中价格被压至每百万 tokens 仅 0.0036 美元,较长文本计费降幅达 99 %,输入缓存未命中价格调整为每百万 tokens 0.435 美元,降幅为 78 %,输出价格则降至每百万 tokens 0.87 美元,较原定价降低 86 %。标准版模型 MiMo-V2.5 的输入缓存命中价格降至每百万 tokens 0.0028 美元,较长文本计费降低 98 %,输入缓存未命中价格为每百万 tokens 0.14 美元,降幅达 83 %,输出价格则降至每百万 tokens 0.28 美元,降幅为 93 %。
除了直接降低 API 单价,大模型订阅套餐也迎来了全面升级,引入统一的点数计费机制。新套餐维持原有的 6 美元、 16 美元、 50 美元与 100 美元四档包月价格不变,但可用点数额度分别提升至 41 亿点、 110 亿点、 380 亿点与 820 亿点。在新规则下,调用 MiMo-V2.5 系列模型消耗的点数极低,如 MiMo-V2.5 输入缓存命中每 token 仅消耗 2 点,缓存未命中消耗 100 点,输出消耗 200 点。凭借新模型极低的点数消耗率,订阅用户在相同包月价格下可获得相当于原额度 5 至 8 倍的可用 token 额度。为回馈现有订阅用户,所有历史套餐额度将获得全额重置。
伴随价格下调,前期推出的开发者扶持计划也宣布提前收官。于 4 月 28 日启动的小米 MiMo 100 万亿 Token 开发者扶持计划已经正式结束,全球共计 548,664 名开发者递交申请,最终批准 241,879 人,累计发放了 100 万亿 tokens 的额度,折合人民币价值达 65,834,211 元。虽然扶持计划提前结束,但面向 Apache 软件基金会 committers 的专项福利维持长期开放,不受本次收官影响。
信源:https://x.com/XiaomiMiMo/status/2059314052892099070
小米旗下大模型 API 迎来大范围价格调整,对自研大模型 MiMo-V2.5 系列实施永久性大幅降价,降幅最高达到 99 %。本次降价不仅大幅压低了基础单价,还取消了长文本计费溢价,实现所有上下文长度统一计费。
具体计费方案显示,旗舰级模型 MiMo-V2.5-Pro 的输入缓存命中价格被压至每百万 tokens 仅 0.0036 美元,较长文本计费降幅达 99 %,输入缓存未命中价格调整为每百万 tokens 0.435 美元,降幅为 78 %,输出价格则降至每百万 tokens 0.87 美元,较原定价降低 86 %。标准版模型 MiMo-V2.5 的输入缓存命中价格降至每百万 tokens 0.0028 美元,较长文本计费降低 98 %,输入缓存未命中价格为每百万 tokens 0.14 美元,降幅达 83 %,输出价格则降至每百万 tokens 0.28 美元,降幅为 93 %。
除了直接降低 API 单价,大模型订阅套餐也迎来了全面升级,引入统一的点数计费机制。新套餐维持原有的 6 美元、 16 美元、 50 美元与 100 美元四档包月价格不变,但可用点数额度分别提升至 41 亿点、 110 亿点、 380 亿点与 820 亿点。在新规则下,调用 MiMo-V2.5 系列模型消耗的点数极低,如 MiMo-V2.5 输入缓存命中每 token 仅消耗 2 点,缓存未命中消耗 100 点,输出消耗 200 点。凭借新模型极低的点数消耗率,订阅用户在相同包月价格下可获得相当于原额度 5 至 8 倍的可用 token 额度。为回馈现有订阅用户,所有历史套餐额度将获得全额重置。
伴随价格下调,前期推出的开发者扶持计划也宣布提前收官。于 4 月 28 日启动的小米 MiMo 100 万亿 Token 开发者扶持计划已经正式结束,全球共计 548,664 名开发者递交申请,最终批准 241,879 人,累计发放了 100 万亿 tokens 的额度,折合人民币价值达 65,834,211 元。虽然扶持计划提前结束,但面向 Apache 软件基金会 committers 的专项福利维持长期开放,不受本次收官影响。
信源:https://x.com/XiaomiMiMo/status/2059314052892099070
MiniMax预告M3稀疏注意力,1M上下文提速9.7倍
MiniMax 工程负责人 Skyler Miao 在 X 预告新一代模型 M3,并公布了全新注意力架构:MiniMax Sparse Attention (MSA,稀疏注意力机制)。
在 100 万 (1M) tokens 超长上下文场景下,相较于采用全注意力架构(Full Attention,即稠密注意力)的 M2,M3 在 Prefill(预填充)阶段的注意力延迟下降,对应提速约 9.7 倍;Decode(解码)阶段的注意力延迟下降,对应提速约 15.6 倍。
随着上下文窗口迈向百万级别,长文本推理的瓶颈正在发生转移。以往显存容量(VRAM)是核心限制,而当上下文达到 100k 以上时,全稠密注意力高昂的计算成本(FLOPs)便成为本地部署的主要瓶颈。Redis 创始人 Salvatore Sanfilippo (antirez) 评价 MSA 路线为「正确的道路」,认为在本地推理中稠密注意力的开销难以为继。这与行业内其他长文本方案的探索方向一致:例如 DeepSeek V4 在 1M 上下文上的系统级优化,同样依赖混合注意力设计,通过压缩 KV 轴、压缩稀疏注意力(CSA)、高压缩率注意力(HCA,指 128 倍压缩后执行稠密注意力)与滑动窗口注意力(SWA),在降低 KV 缓存压力与节省计算开销之间取得平衡。
对长文本注意力机制的攻坚,是 MiniMax 路线选择的又一次折返。早期 M1 系列曾深度使用 Lightning Attention 等线性注意力,但 M2 却退回了全注意力架构。2025 年 10 月 29 日,预训练负责人孙浩海在官方博客中详解过折返背后的技术权衡:线性或稀疏注意力在常规榜单上表现良好,但在代码、数学、Agent 及长链 CoT(链式思考)等复杂推理场景下容易暴露性能退化问题;同时,当时前缀缓存(Prefix Caching)、低精度状态存储与投机解码等配套系统也尚不成熟。MSA 的推出表明 MiniMax 正在重新进攻高效注意力路线。
虽然分块索引和稀疏计算的设计路径清晰,但 MSA 是否能在不损害模型推理能力的前提下稳定落地,仍有待正式技术报告、权重开源与第三方复现的检验。
信源:https://x.com/SkylerMiao7/status/2059285750458544561
MiniMax 工程负责人 Skyler Miao 在 X 预告新一代模型 M3,并公布了全新注意力架构:MiniMax Sparse Attention (MSA,稀疏注意力机制)。
在 100 万 (1M) tokens 超长上下文场景下,相较于采用全注意力架构(Full Attention,即稠密注意力)的 M2,M3 在 Prefill(预填充)阶段的注意力延迟下降,对应提速约 9.7 倍;Decode(解码)阶段的注意力延迟下降,对应提速约 15.6 倍。
随着上下文窗口迈向百万级别,长文本推理的瓶颈正在发生转移。以往显存容量(VRAM)是核心限制,而当上下文达到 100k 以上时,全稠密注意力高昂的计算成本(FLOPs)便成为本地部署的主要瓶颈。Redis 创始人 Salvatore Sanfilippo (antirez) 评价 MSA 路线为「正确的道路」,认为在本地推理中稠密注意力的开销难以为继。这与行业内其他长文本方案的探索方向一致:例如 DeepSeek V4 在 1M 上下文上的系统级优化,同样依赖混合注意力设计,通过压缩 KV 轴、压缩稀疏注意力(CSA)、高压缩率注意力(HCA,指 128 倍压缩后执行稠密注意力)与滑动窗口注意力(SWA),在降低 KV 缓存压力与节省计算开销之间取得平衡。
对长文本注意力机制的攻坚,是 MiniMax 路线选择的又一次折返。早期 M1 系列曾深度使用 Lightning Attention 等线性注意力,但 M2 却退回了全注意力架构。2025 年 10 月 29 日,预训练负责人孙浩海在官方博客中详解过折返背后的技术权衡:线性或稀疏注意力在常规榜单上表现良好,但在代码、数学、Agent 及长链 CoT(链式思考)等复杂推理场景下容易暴露性能退化问题;同时,当时前缀缓存(Prefix Caching)、低精度状态存储与投机解码等配套系统也尚不成熟。MSA 的推出表明 MiniMax 正在重新进攻高效注意力路线。
虽然分块索引和稀疏计算的设计路径清晰,但 MSA 是否能在不损害模型推理能力的前提下稳定落地,仍有待正式技术报告、权重开源与第三方复现的检验。
信源:https://x.com/SkylerMiao7/status/2059285750458544561
Anthropic发布Claude Code自动漏扫与修复插件
Anthropic 推出终端编程智能体 Claude Code 专属安全插件 security-guidance ,支持在代码编写会话中实时拦截并自动修复安全漏洞。 Anthropic 内部基准测试与灰度数据显示,启用安全审查后,拉取请求 PR 的安全修复意见减少 30 % 至 40 %,在代码交付人工评审前构建起第一道弹性防线。
安全检验分段在文件编辑、会话结束与代码提交三个阶段触发。编辑文件时,本地规则将实时匹配动态代码执行(如
企业可向
信源:https://code.claude.com/docs/en/security-guidance
Anthropic 推出终端编程智能体 Claude Code 专属安全插件 security-guidance ,支持在代码编写会话中实时拦截并自动修复安全漏洞。 Anthropic 内部基准测试与灰度数据显示,启用安全审查后,拉取请求 PR 的安全修复意见减少 30 % 至 40 %,在代码交付人工评审前构建起第一道弹性防线。
安全检验分段在文件编辑、会话结束与代码提交三个阶段触发。编辑文件时,本地规则将实时匹配动态代码执行(如
eval 或 child_process.exec ),不安全反序列化(如 pickle )与 DOM 注入等已知高危模式,扫描不调用大模型,无额外 API 费用。会话结束时,后台模型异步比对工作区的 Git 差异( Git Diff ),拦截授权绕过、不安全直接对象引用与弱加密等逻辑漏洞。当开发者使用命令行执行 git commit 或 git push 提交推送时,则触发深度智能体评审,自动读取调用链与消毒器等周边代码上下文以排除误报。企业可向
.claude/claude-security-guidance.md 写入纯文本安全规则,或通过 .claude/security-patterns.yaml 自定义正则匹配,规则将被作为附加上下文与内置清单共同加载。运行插件需保证 Claude Code CLI 在 2.1.144 及以上版本,且本地 PATH 包含 Python 3.8 或更高版本。首次激活时,系统将在本地 ~/.claude/security/ 路径下自动部署虚拟环境并安装 Agent SDK 。信源:https://code.claude.com/docs/en/security-guidance
Claude Code Docs
Catch security issues as Claude writes code - Claude Code Docs
Install the security-guidance plugin to have Claude review its own code changes for vulnerabilities and fix them in the same session.