动察Beating AI News
3.14K subscribers
877 photos
2 videos
3.39K links
AI新闻信息流
Download Telegram
Anthropic为Claude装上「外置良心」:调用道德工具后违规行为显著下降

大模型的对齐方式,正从单向被动的规则灌输,走向探索构建更具韧性的「道德性格」。Anthropic 宣布针对 AI 系统的道德性格培养展开专项研究,并在近期实验中赋予 Claude 一项新功能:一个可在执行任务中途调用的道德提醒工具。

实验结果显示,Claude 经常在采取关键行动前主动触发这个工具,并会明确指出自身面临的利益冲突。引入这一机制后,Claude 在多项内部对齐评估中的不对齐行为率出现显著下降。Anthropic 目前仍在拆解背后的技术归因:不对齐行为的减少,究竟是得益于道德提醒的具体内容,还是模型执行「停顿反思」这一物理动作本身。

这次实验的灵感来源于人类社会的道德导师机制。过去数月,Anthropic 组织了一轮跨宗教与跨文化的深度对话,邀请超 15 个群体的神经科学家、哲学家和神职人员参与,探讨如何将人类在遇到违背价值观压力时向「安全他者」求助的机制,尝试接入到 Claude 的决策流程中。

下一步,Anthropic 将把外部讨论范围扩大至法律学者、心理学家和公民机构,议题也将从单纯的模型道德培养,延伸至 AI 将如何重塑当前的工作形态与权力分配体系。

信源:https://www.anthropic.com/news/widening-conversation-ai
阿里发布为Agent而生官网「千问云」:全站Skill与CLI化重构,智能体一键调用

未来模型服务平台的使用主力不再是人类,而是智能体本身。今天,阿里云在峰会发布了首个专门为 Agent 而生的 AI 产品官网「千问云」(www.qianwenai.com),提供 150 多款主流模型的 API 服务。此官网最大的重构在于,通过将模型服务链路全面进行 Skill 化、MCP(模型上下文协议)化与客户端(CLI)化重构,让 Agent 能够直接「读懂」并一键自主调用网站的全部能力。

不同于以往为人设计的控制台交互,千问云彻底摒弃了人类开发者繁琐阅读文档、手写集成代码以及调试 API 参数的传统流程。原因很简单,传统的模型接口是为人点击和手动对接设计的,而 Agent 需要的是极度敏捷的瞬态调用。通过这一全新的架构重构,诸如 OpenClaw、Hermes Agent、Claude Code 等智能体仅需一句简单的指令,就能自主「学会」官网的所有核心功能。

在技术实现上,千问云 Skills 封装了模型选型、调用、认证及用量查询的全链路能力。Agent 在此架构下,可根据具体任务自主进行动态路由:遇到图片则自动调用视觉大模型处理,需要插画则自动转接生图大模型,实现多模型的自动化编排。而千问云 CLI 客户端工具则全量覆盖了登录认证、状态查询和环境诊断等任务,支持 Agent 直接以命令行或脚本在后台自动化流转全部工作流。目前,这两套核心工具包已在 GitHub 开源。

除了接口的系统级重构,千问云还让 Agent 深度介入了模型费用的后台管理。智能体可实时拉取高频调用的用量数据,分析消费趋势并识别异常,自主为用户输出成本优化建议。为应对高频 AI 编程和多智能体协作等新型用量特征,千问云在常规按量付费之外,特别推出了 Token Plan 订阅模式,旨在显著降低 Agent 场景下的 Token 消耗成本。

信源:https://mp.weixin.qq.com/s/ERTLfMCEPQA7j00LYmMhsw
个人通道6月18日关闭,谷歌下线旧版Gemini CLI强推Antigravity

谷歌开发者官网发布公告,公布命令行工具 Gemini CLI 向 Antigravity CLI 迁移的详细时间表。因为底层框架全面变更,个人及免费用户必须在 2026 年 6 月 18 日前手动迁出,届时旧版工具将停止响应请求。

此次停服主要影响个人及独立开发者。自 6 月 18 日起,使用 Google AI Pro、Ultra 以及个人免费版 Gemini Code Assist 的账户将无法调用旧版 CLI。GitHub 组织的 Gemini Code Assist 插件也将于同日停止新装,并在随后数周内全面切断 API 响应。谷歌现已上线迁移文档(antigravity.google/docs/gcli-migration)以供参考。

企业通道则不受停服影响:购买 Gemini Code Assist 授权的组织,既能继续调用旧版以保障老业务稳定性,也能直接将全新的 Antigravity CLI 接入现有项目进行尝鲜。个人或独立开发者若想保留旧版访问权限,则须手动切换为付费的 API 密钥。

新发布的 Antigravity CLI 采用 Go 语言编写,运行响应更加轻快。它全量集成了旧版的 Agent Skills、Hooks 与 Subagents 机制,但在运行逻辑上彻底转向后台异步流转。用户可在终端并行启动大型重构或多源技术调研,不再锁定当前会话。同时,新工具与 Antigravity 2.0 桌面端共享相同的智能体管理内核,无论使用命令行还是桌面端,核心智能体的优化和改动都会自动同步生效。

信源:https://developers.googleblog.com/an-important-update-transitioning-gemini-cli-to-antigravity-cli/?utm_source=social
OpenAI联手对手谷歌:ChatGPT全线接入DeepMind隐形水印,并推出图片真伪验证工具

OpenAI 宣布与昔日对手谷歌 DeepMind 展开合作,在 ChatGPT 、 Codex 以及 API 生成的图像中全面接入 SynthID 隐形水印,并正式成为 C2PA 图像凭证标准合规产品,同时上线了图片真伪验证工具的公众预览版。

作为行业标准的 C2PA 元数据依靠密码学签名记录来源,但在用户下载、截图或转换图片格式时,这些元数据极易丢失。

为了修补这一漏洞, OpenAI 引入了谷歌 DeepMind 开发的 SynthID 隐形水印技术,直接在图像像素中嵌入肉眼不可见的标识。

即使图片经过截图等二次处理, SynthID 依然能够留存。双层防御机制将元数据的丰富上下文与隐形水印的持久性结合在一起。

配合这次更新, OpenAI 还上线了一个查真伪的官方网站( openai.com/research/verify ),目前已面向公众开放预览。

用户可以直接在网页端上传图片,由这一工具检测其中是否含有 OpenAI 的 Content Credentials 凭证或 SynthID 隐形水印。

不过, OpenAI 在检测结论上表现得十分谨慎。由于水印和元数据在极端情况下仍有被强行剥离的可能,即使工具查不出任何防伪信号,也无法武断地断定图片一定不是由 AI 生成的。

信源:https://openai.com/index/advancing-content-provenance/
扎克伯格解释追踪员工键鼠原因:外包太笨,而你们很聪明

美国劳工媒体 More Perfect Union 曝光了一段 Meta 内部大会录音,首席执行官马克· 扎克伯格在 4 月 30 日的全员会议中,承认公司已实施名为「模型能力计划」 (MCI) 的内部追踪项目,通过在员工电脑上运行监控工具,记录其鼠标移动轨迹、点击位置、键盘按键以及屏幕截图。

面对内部抵触,扎克伯格在录音中极力辩护:目前行业大模型训练数据高度依赖外包,而 Meta 员工的平均智力远高于普通外包人员。

在他眼中,数千名精英工程师解决编程任务、构建工具时的日常轨迹,是极其稀缺的高质量训练素材。Meta 试图借此让旗下模型的代码进化速度彻底甩开同行。

除了写代码,这套系统还必须学会像人类一样「使用电脑」。要让 AI 智能体掌握导航下拉菜单、使用快捷键等连环操作,最直接的路径就是让它持续观察聪明人的电脑使用过程。

面对员工关于暗中监视的质问,扎克伯格保证,没有任何人类会查看这些记录,敏感内容会在数据流出前被尽可能剥离,且数据绝不用于绩效考核或员工监控。

由于 Meta 正面临裁员,不少员工对被迫交出个人电脑数据、甚至用它来训练「能替代自己的 AI」感到十分抗拒。扎克伯格在会议中承认前期沟通不够,但强调项目必须保密:AI 竞争太残酷,这种能拉开身位的独家套路一旦公开,对手会立刻照抄。

而且这只是个开始。扎克伯格直言,只要证明这套路能提升模型能力,Meta 接下来就会在全公司推广,把高水平员工的电脑操作痕迹全面变成 AI 模型的训练养料。

信源:https://x.com/i/status/2056842597117636890
谷歌重构AI会员体系!上线百元级Ultra方案并降价,加码免单YouTube会员

谷歌在 I/O 2026 大会上宣布对旗下 Google AI 订阅体系(Plus、Pro、Ultra)进行重大重构,正式推出起售价 100 美元/月的全新 AI Ultra 级别以主打开发者与极客,将顶配 Ultra 月费降至 200 美元,并全面将 YouTube 会员、AI 智能体等高价值生态权益下放至各档会员中。

新增的 100 美元/月 AI Ultra 档位主要面向开发者与技术骨干,提供 20TB 云存储空间,并在 Gemini 应用和 Google Antigravity 平台中享有比 Pro 级别高出 5 倍的算力额度,且附赠 YouTube Premium 个人版会员。与此同时,顶配的 AI Ultra 订阅月费由原本的 250 美元降至 200 美元,算力配额依然为 Pro 的 20 倍,且独占三维世界构建原型 Project Genie 等前沿研究功能的优先体验权。两档 Ultra 用户均将在下周首批体验锁屏状态下自动跑任务的 24/7 云端智能体 Gemini Spark。

为了扩大市场覆盖,谷歌将核心技术与生活福利大范围向下延展。所有订阅档位(Plus、Pro、Ultra)将全量接入新一代大模型 Gemini Omni 与 Gemini 3.5 Flash,并在美区逐步上线能提取待办、拟定回复的 AI Inbox 邮箱管家和每日晨报智能体 Daily Brief。在非 AI 福利上,原本仅限高档会员的 YouTube 免广告服务也实现下放:价格为 19.99 美元/月的 Pro 付费订阅将免费获赠价值 8.99 美元/月的 YouTube Premium Lite 轻量版会员。

信源:https://blog.google/products-and-platforms/products/google-one/google-ai-subscriptions/
谷歌开放智能体底层基建:支持单次调用云端Linux沙盒,Markdown手写即可起AI

智能体开发正在告别繁琐的服务器运维与沙盒搭建,直接转变为定义配置文件的云端瞬态调用。谷歌在 I/O 2026 大会上正式推出 Gemini API 托管智能体(Managed Agents)预览版,向开发者开放其智能体底层基建。开发者只需一次 API 调用,便能瞬间在云端拉起一个由谷歌托管的隔离、临时 Linux 环境,运行由新一代中端模型 Gemini 3.5 Flash 驱动的 Antigravity 智能体。

托管智能体免去了复杂的编排代码与环境搭建工作。开发者无需编写冗长的胶水代码,只需在项目中编写 AGENTS.mdSKILL.md 这两个 Markdown 格式的版本化配置文件,即可直接定义智能体的系统角色与特定技能,并注册为自定义的托管智能体。

这一云端临时 Linux 环境赋予了智能体极高的物理活动边界。智能体不仅能在沙盒内进行多步推理、任务规划与工具调用,还能独立执行代码、读写文件以及调用外部网络抓取实时数据。每次交互都会自动保存或还原当前沙盒的环境状态,方便后续的 API 调用无缝恢复会话,确保所有文件与运行时状态完好如初。

这套托管思路与 Anthropic 在 4 月份发布的 Claude Managed Agents 如出一辙。两家大模型巨头在智能体基建上走向了合流,都在试图从单纯的 API 模型供应商,升格为打理智能体安全沙盒与会话状态的容器云平台。

目前,托管智能体已在 Gemini API 开启预览测试,开发者可通过 Google AI Studio 游乐场(Playground)中的定制模板快速启动。同时,谷歌为编码智能体专门设计了一项全新的 Gemini API 智能体技能,帮助智能体自行构建与管理自定义智能体。面向企业用户,Gemini 智能体平台(Gemini Enterprise Agent Platform)也已同步开启私密预览。

信源:https://blog.google/innovation-and-ai/technology/developers-tools/managed-agents-gemini-api/
万亿参数开源模型跑出981词/秒,Cerebras测试KimiK2.6提速29倍

晶圆级芯片公司 Cerebras 宣布在企业测试中上线万亿参数大模型 Kimi K2.6,通过跨多张 12 英寸硅晶圆分配权重并流式传输激活值,消除了传统板级通信的互联延迟。

第三方评测机构 Artificial Analysis 实测显示,其生成速度达到 981 tokens/s,比主流 GPU 云服务快 6.7 倍。在 10000 输入、500 输出 token 的长文本任务中,总响应耗时从 Kimi 官方接口的 163.7 秒缩短至 5.6 秒,提速达 29 倍。

由于万亿参数模型超出了单张硅晶圆的容纳极限,系统将其权重分配到多块晶圆中流式传输激活值。在晶圆内部,其层间通信完全运行在片上网络织网上,物理通信带宽达到英伟达 NVL72 架构中 NVLink 的 200 倍以上。配合分布式计算优化,Kimi K2.6 以原始的 4-bit(4 位)权重进行低损存储,计算时使用 16-bit(16 位)浮点数维持精度,并采用定制算子内核与推测性解码最终达成实时化运行。

信源:https://www.cerebras.ai/blog/cerebras-kimi-k2-Enterprise
Opus 4.7低思考度压过Sonnet 4.6最大值,Anthropic发布首份智能体操控调优指南

Anthropic 发布首份官方开发指南,深入披露了 Claude 4.6 与 Opus 4.7 在电脑和浏览器操控场景下的分辨率上限、思考深度配比及缓存降本机制。

屏幕分辨率直接决定了智能体点击的精准度。Claude 4.6 解析截图的长边上限为 1568 像素,Opus 4.7 为 2576 像素。一旦截图超出限制,API 服务端会自动等比缩小图片,这会导致模型生成的点击坐标与客户端原图产生错位漂移。因此,开发者必须提前在客户端将截图缩放至 1280x720 (Claude 4.6 推荐) 或 1080p (Opus 4.7 推荐)。

界面操控主要依赖视觉感知与元素定位,对长链条逻辑推理要求不高。测试表明,Opus 4.7 在低思考深度 (low) 下的操控表现便能追平 Sonnet 4.6 的最大思考深度 (max),且 token 成本仅为后者的十分之一。官方建议将思考选项设为 high,相比 max 深度不仅 token 消耗减半,成功率也完全持平,应避免开启 max 以防模型过度思考导致账单翻倍。

由于单张截图在上下文中最高消耗 1800 个 token,官方给出了三层降本方案:常驻 1 个系统级缓存断点,并将另 3 个断点动态分配给最近几轮工具的执行结果;在客户端进行滚动剪枝,仅在上下文中保留最近 3 张截图,其余用占位符替代;在上下文深度逼近 90% 时触发总结压缩。

此外,API 引入了批量工具 computer_batch,支持单次调用打包执行多项无视觉依赖的操作;并提供智能体顾问机制 (Advisor Tool),允许主模型在后台直接召唤高阶的 Opus 模型来审计执行步骤。开发者还可通过录制引导模式 (Teach Mode,即录制用户的真实操作轨迹并在回放时作为指令参考) 来大幅提升任务成功率。

信源:https://claude.com/blog/best-practices-for-computer-and-browser-use-with-claude
智谱AutoClaw上架iOS:支持双模式,手机可直接遥控PC执行任务

智谱 AI 近日在 App Store 上架了 AutoClaw APP,距离其 PC 端首发仅过去两个月。新版本实现了移动端与 PC 端的账号实时同步,用户可以直接在手机上编辑资料、创建群聊,指挥多个 Agent 协作完成复杂任务。

执行环境保留了「本地龙虾」与「云龙虾」双模式。用户既可以在电脑离线时直接调用云端算力,也能在保持 PC 在线的情况下,把手机当成遥控器来指挥电脑执行任务。

为了适配移动端,首版直接去掉了多个高阶数据面板与服务入口。目前 APP 无法查看「Hermes进化看板」与 Token 用量统计,移除了 MCP(模型上下文协议)服务入口,一键接入第三方 IM 平台的 Skill 商店也被阉割。目前的 APP 仅优先保障基础的创建与执行功能。

信源:https://mp.weixin.qq.com/s/NPDf9G92c_XrIr4pVBiI6w
阿里首个C端爆火AI应用妙鸭相机团队解散,上线不到三年停止升级与推广

阿里巴巴旗下、曾被视作国内 AIGC 领域首款 C 端爆火应用的妙鸭相机,近日被证实已解散团队。目前项目仅维持低成本运营,产品不再升级,也不再进行推广。

妙鸭相机于 2023 年 7 月正式发布,凭借 9.9 元生成数字分身和精美写真,在同年 8 月登顶苹果应用商店 App Store 免费榜,日活跃用户一度突破 60 万。然而在上线不到三年后,项目技术优势流失与组织频繁调整加速了其退潮。

在技术机制上,妙鸭相机采用阿里大文娱(现更名为虎鲸文娱)自研的 AI 图像模型「提香」,但在集团大模型快速迭代的浪潮中,并未接入通义千问等核心大模型以共享红利。随着字节跳动旗下的抖音、老牌美图工具美图秀秀等竞品迅速推出免费且功能丰富的 AI 相机、AI 消除与 AI 扩图等替代功能,妙鸭相机功能单一的工具属性使其很快在流量与社交竞争中失去优势。2023 年 11 月,产品负责人张月光离职创业,项目进一步走向式微。

大厂内部创新的生态冲突和组织变动,也决定了妙鸭相机的命运。项目诞生之初,管理层为了避免业务协同产生反作用力,选择让其独立发展,导致项目未能在优酷等阿里大文娱核心业务中获得持续的生态与流量红利。随后,阿里巴巴经历组织架构大变革,虎鲸文娱全面转向自负盈亏与追求盈利,致使妙鸭相机的后期投入大幅缩水。随着集团 AI 战略核心聚焦于服务电商与阿里云计算,这类 C 端娱乐智能体项目最终退化为被孤立的试错边界。

信源:https://mp.weixin.qq.com/s/2hUbX3ZWsR4AM2a2-4RZGA
1
Anthropic每月12.5亿美元包下SpaceX算力,六月接入Colossus2

Anthropic 联合创始人 Tom Brown 宣布将扩大与 SpaceX 的算力合作,于 2026 年 6 月在 Colossus 2 集群中扩展 NVIDIA GB200 算力。最新披露的招股书显示,Anthropic 已同意向 SpaceX 每月支付 12.5 亿美元,合约期将持续至 2029 年 5 月,且在 5 月和 6 月的算力爬坡阶段享有优惠费率。

SpaceX 创始人马斯克随后证实,SpaceX 已正式进入 AI 算力托管服务(CaaS)市场,目前正与多家公司开展算力租赁谈判。SpaceX 在招股书中,也将 AI 与航天及星链网络并列为公司的三大核心增长支柱。

除现有的 Memphis 地面集群外,SpaceX 还计划利用其庞大的低轨卫星星座,建设利用太阳能与太空天然冷却的在轨数据中心,提供极具规模的太空 AI 算力。

信源:https://x.com/elonmusk/status/2057228707606196434
优化子智能体流转与证书轮换,OpenClaw新版修复Gemini上下文截断错误

个人 AI 智能体项目 OpenClaw 正式发布 v2026.5.19 版本,本次小步快跑的更新将核心精力集中在多模型容错、移动端安全通信及子智能体的生命周期同步上。

在模型生态适配方面,系统专门针对 Google Gemini 修复了严重中断缺陷。新版会在对话重放前主动丢弃被系统压缩机制截断的 Gemini 思维签名,防止畸形 Base64 数据导致助手下一轮响应直接终止。

针对国产大模型容错,系统重新分类了 Moonshot(Kimi)余额耗尽时抛出的 HTTP 429 载荷。这些错误不再被粗暴当作通用速率限制,而是精确识别为计费阻断,从而触发正确的计费引导与备用模型回退。

在跨设备通信层,Android 客户端引入了平滑的 TLS 证书轮换机制。当网关 TLS 指纹发生变化时,系统会弹出新旧 SHA-256 指纹供用户核对并放行,彻底取代了此前因公钥固定导致的硬性崩溃。

底层的子智能体流转也迎来了严谨的竞态修复。新版强制要求队列中的交接信号必须完整落入父级上下文中,系统才会将其标记为已宣告。这一改造结合父级会话的抗超时保活机制,从根本上消除了极端繁忙状态下子级运行结果丢失的隐患。

此外,浏览器插件现在会优先采信 Chrome CDP 托管诊断,消除了冷启动 HTTP 探测竞争导致的误报失败;WhatsApp 通道则全面放开了强制原图与视频的文档级投递。

从消除跨代并发损耗到精准识别厂商错误码,OpenClaw 通过打磨运行时的细微边界,正在逐步夯实多级智能体系统在极复杂网络与长会话下的调度稳定性。

信源:https://github.com/openclaw/openclaw/releases/tag/v2026.5.19
字节跳动医疗业务「小荷门诊」在沪设立,打通线上线下诊疗闭环

工商信息显示,上海小荷门诊有限公司已于今年 2 月注册成立,由字节跳动大健康业务核心负责人吴海锋出任法人与经理,标志着字节跳动在历经多轮业务线调整后,再度加码实体医疗领域。

目前,字节「小荷健康」的发展思路逐渐明朗。线上通过「小荷医学」深耕 AI 医疗技术研发,并推出「小荷 AI 医生」提供智能问诊、分诊等便捷服务;线下则通过实体门诊部的落地,将 AI 技术融入真实就医场景,搭建起完整的医疗服务闭环。

与此同时,字节旗下另一主攻高端医疗的「美中宜和」板块也在稳步发展。定位大众普惠的小荷健康与主打高端私立分娩的美中宜和,共同构成了字节全面覆盖不同人群的医疗产业版图。

信源:https://mp.weixin.qq.com/s/3pyHqcjKrfJUG-nqdcr9Fw
Cohere开源Command A+:218B参数MoE大模型,主打企业级Agent与数据主权

Cohere 正式开源 2180 亿参数的稀疏混合专家模型 Command A+,采用 Apache 2.0 协议支持企业级 Agent 构建与私有化部署。新模型专为关键基础设施的数据主权需求设计,支持企业在无厂商锁定的情况下进行物理隔离部署。

新模型总参数量为 2180 亿(218B),但单次推理仅激活 250 亿(25B)参数,实现了计算效率与生成性能的平衡。优化后的推理效率使其仅需两张 NVIDIA H100 或单张 B200 GPU 即可运行,Hugging Face 也同步上线了 W4A4 等低精度量化版本,进一步降低了部署门槛。

Command A+ 原生支持多模态图文输入,提供 12.8 万(128K) Token 的输入上下文窗口以及 6.4 万 Token 的输出长度。它针对复杂的逻辑推理、自主工具调用、数据库查询等 Agentic 工作流以及长文档处理进行了深度优化,并支持包含所有欧盟官方语言在内的 48 种语言。

信源:https://huggingface.co/CohereLabs/command-a-plus-05-2026-w4a4
白宫定调AI审查行政令属于「自愿」,遭实验室极力游说共享期限压缩至发布前14天

美国白宫国家网络总监办公室(ONCD)于 2026 年 5 月 19 日召集 OpenAI 等前沿实验室举行闭门会,通报即将签署的 AI 行政令。这项行政令最快将于周四由总统特朗普签署。随着新规文本定调为自愿性前置审查框架,此前引发行业恐慌的类似食品药品监督管理局(FDA)的强制许可设想宣告出局。

新规首次明确了时间参数,要求前沿 AI 模型在公开发布前,提前最多 90 天共享给政府。但各大实验室正极力游说,争取将共享期限压缩至发布前 14 天。

受审的前沿模型标准拟由国家安全局(NSA)、ONCD、科学技术政策办公室(OSTP)等机构共同定义。上述安全与情报部门还将联合国防部,制定一套机密流程来评估符合定义的模型。此前,Anthropic 扣留的 Mythos 模型所展现的零日漏洞挖掘能力,是促成这项新规加速成型的直接导火索。

信源:https://www.theinformation.com/articles/white-house-briefs-ai-companies-plan-review-models-release
xAI悄然发布专为Agentic Coding优化的最新代码模型grok-build-0.1

xAI 推出专为智能体编程(Agentic Coding)训练的快速代码模型 `grok-build-0.1`。模型支持文本与图像多模态输入,原生具备工具调用、结构化输出与推理思考能力,现处于早期访问阶段。

grok-build-0.1 的上下文窗口为 256k。API 基础定价为输入 1 美元/1M Tokens,输出 2 美元/1M Tokens。模型开启提示词缓存后,命中部分的输入成本降至 0.20 美元/1M Tokens。

xAI 已经开放 Grok 个人订阅账号的第三方授权。拥有 SuperGrok 或 X Premium 订阅的用户,可通过 OAuth 机制在开源智能体 Hermes Agent 与 OpenClaw 直接复用官方算力配额,支持直接调用 `grok-build-0.1`。

信源:https://docs.x.ai/developers/models/grok-build-0.1
1
AI开支挤压IT预算,康明斯与联邦快递要求缩短SaaS合同并引入重新定价机制

受 Anthropic 与 OpenAI 模型支出增加影响,企业买家开始向传统 SaaS 供应商施压,要求缩短软件合同期限并增加防御条款。传感器组件商 Ralliant 过去签署五年期软件合同,目前已将期限缩短至一到三年,Ralliant 内部开发的 AI 智能体现已接管部分 ERP 系统的分析工作。

IT 服务商 Ibex 将续约周期缩短至一年。康明斯(Cummins)要求获得 90 天的合同修改权限,以便随时评估和替换 AI 工具。

买家同时在续约中引入新的成本控制条款。联邦快递(FedEx)要求加入重新定价触发机制,规定当 AI 使用成本达到特定阈值时必须重新谈判价格。保险公司 National Life Group 要求写入可替换性条款,禁止供应商在推出新 AI 功能时加价,并设定性能未达标即可提前退出合同的选项。

安永(EY-Parthenon)数据显示,传统软件提供商的净留存率在过去半年下降约 15 个百分点,大量客户拒绝在现有供应商上增加长期投入。

信源:https://www.theinformation.com/articles/anthropic-costs-mount-businesses-pressure-software-firms-shorten-contracts
Anthropic预计二季度实现5.59亿美元利润,领跑OpenAI率先达成单季盈利

Anthropic 向投资者透露,2026 年第二季度营收预计达 109 亿美元,较第一季度的 48 亿美元实现翻倍,并将录得 5.59 亿美元运营利润。Anthropic 由此先于 OpenAI 与 xAI,成为首家实现单季盈利的前沿 AI 实验室。

竞争对手目前仍因高昂的模型训练成本深陷亏损。SpaceX 最新招股书披露,与其合并的 xAI 业务已产生 64 亿美元运营亏损。OpenAI 向投资者预计需到 2030 年才能扭亏为盈,并计划在此之前投入超 6000 亿美元扩容算力。

盈利并未减缓 Anthropic 的硬件投资步伐。Anthropic 与 SpaceX 签订了每年 150 亿美元的算力租赁协议,并与 Google 和亚马逊达成规模达数千亿美元的潜在合作。Anthropic 正接近完成一笔 300 亿美元的融资,投后估值将升至 9000 亿美元。Anthropic 已于去年聘请律所 Wilson Sonsini 筹备上市,加速推进年内公开募股。

信源:https://www.ft.com/content/a67248e7-f819-4dba-b0f7-3847df0a75f3?syn-25a6b1a6=1
😁2🤔1
智谱联合提出下一代大模型推理网络架构ZCube,破解PD分离引发的结构性网络拥塞

针对大模型 PD(Prefill-Decode)分离部署中日益严峻的结构性网络拥塞难题,智谱、驭驯网络与清华大学开展联合攻关,提出并在 GLM-5.1 coding 千卡线上生产环境落地了 ZCube 组网架构。

随着长上下文和 PD 分离推理成为主流,KV Cache 的跨节点传输使推理流量呈现出严重的不对称特征,传统 ROFT(Rail-Optimized Fat-Tree)架构极易引发局部热点和链路冲突。ZCube 通过取消 Spine 层交换机,采用全网扁平化拓扑(2跳网络直径),结合单/多轨混合接入机制,在架构层面实现了跨节点全网交换机之间的流量负载均衡。

在实际生产集群的基准测试中,保持 GPU、软件栈及应用不变的前提下,ZCube 架构相比传统架构减少了 33% 的交换机与光模块硬件支出,同时 GPU 平均推理吞吐率提升了 15%,首 Token 时延(TTFT)P99 分位数下降了 40.6%。

信源:https://mp.weixin.qq.com/s/JYyLD4U2235obw9WH45v9g
腾讯混元依托Hy-MT2大模型推出轻量化翻译产品,内置9种语气预设解决场景翻译偏差

腾讯混元团队推出轻量化 AI 翻译产品 Hy翻译。新产品依托自研 Hy-MT2 大模型,在自动识别与语种切换功能外,新增风格预设与个性化设定两大核心模块。

风格预设内置 9 种模板,涵盖学术论文、法律合同、日常口语及商业新闻等场景。这项设计直接为不同情境匹配专属翻译语气模型,解决通用机器翻译语气偏差与术语不当的通病。个性化模块允许用户自定义规则,支持保留特定专业缩写或品牌名不译,并通过快捷输入一键切换社媒文风与地道意译模式。

底层技术上,Hy-MT2 大模型针对跨境沟通与学习办公等高频场景做了专项优化,通过强化多领域术语库覆盖来提升准确率。产品的机制重点从单纯字面对应转向场景化适配。

信源:https://mp.weixin.qq.com/s/piuaCr9-DbyUgvgbEb4IKg