🙏1
月之暗面寻求从微软 Azure、亚马逊 AWS 和 Google 云平台上 K3 相关服务的收入中获得最高 30% 的分成
月之暗面正与微软、亚马逊和 Google 协商收益分成协议,协议将允许美国云巨头托管其旗舰模型 Kimi K3。如果协议达成,这将是中国 AI 公司与美国云巨头之间首个大型收益分成协议。这一协商也凸显了中国领先的、通常比美国同类产品更便宜的 AI 模型在美国日益增长的市场需求。月之暗面寻求从微软 Azure、亚马逊 AWS 和 Google 云平台上 K3 相关服务的收入中获得最高 30% 的分成。谈判还处于早期阶段,能否达成协议还无法确定。
月之暗面正与微软、亚马逊和 Google 协商收益分成协议,协议将允许美国云巨头托管其旗舰模型 Kimi K3。如果协议达成,这将是中国 AI 公司与美国云巨头之间首个大型收益分成协议。这一协商也凸显了中国领先的、通常比美国同类产品更便宜的 AI 模型在美国日益增长的市场需求。月之暗面寻求从微软 Azure、亚马逊 AWS 和 Google 云平台上 K3 相关服务的收入中获得最高 30% 的分成。谈判还处于早期阶段,能否达成协议还无法确定。
阿里通义发布 Qwen3.8-Flash 模型,称其性能比肩 Opus 4.6 和 V4-Flash
阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。
相比 Qwen3.7-Plus,训练成本仅约九分之一,编码与办公任务表现更优。每百万输入 tokens 定价 0.16 美元、输出 0.47 美元。
Qwen | Qwen | Bloomberg
阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。
相比 Qwen3.7-Plus,训练成本仅约九分之一,编码与办公任务表现更优。每百万输入 tokens 定价 0.16 美元、输出 0.47 美元。
Qwen | Qwen | Bloomberg
Z.ai 发布 GLM-5.3-Flash,18B 激活参数价格仅上代十分之一,限时价格低至每百万 Tokens 输入 0.075 美元
Z.ai 发布 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash,总参数 320B、激活参数仅 18B。其在多项编程和智能体基准上超过 GLM-5.2,价格降至约十分之一,并接近 Claude Opus 4.8。限时优惠期间,API输入价格为每百万Tokens 0.075美元,缓存输入为0.015美元,输出为0.25美元,缓存存储暂时免费;原价分别为0.15美元、0.03美元和0.50美元。
该模型采用稀疏与线性注意力混合架构,匿名测试期间成为本周最受欢迎模型,且全部流量由国产 AI 芯片服务;官方称在国产芯片上端到端推理性能提升 3 倍,成本可比肩主流英伟达 GPU。
Z.ai
Z.ai 发布 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash,总参数 320B、激活参数仅 18B。其在多项编程和智能体基准上超过 GLM-5.2,价格降至约十分之一,并接近 Claude Opus 4.8。限时优惠期间,API输入价格为每百万Tokens 0.075美元,缓存输入为0.015美元,输出为0.25美元,缓存存储暂时免费;原价分别为0.15美元、0.03美元和0.50美元。
该模型采用稀疏与线性注意力混合架构,匿名测试期间成为本周最受欢迎模型,且全部流量由国产 AI 芯片服务;官方称在国产芯片上端到端推理性能提升 3 倍,成本可比肩主流英伟达 GPU。
Z.ai
Telegram 推出欢迎消息等功能,消息按钮与礼物签名同步上线
Telegram 发布更新,群组和频道新增仅新成员可见的欢迎消息,支持多条消息、媒体和富文本。
开发者可在单条消息内加入多个按钮,用于问卷、游戏和商品浏览等互动;富文本编辑器支持插入文档、文件和音乐,礼物市场支持为购买的礼物添加签名和评论。
Telegram
Telegram 发布更新,群组和频道新增仅新成员可见的欢迎消息,支持多条消息、媒体和富文本。
开发者可在单条消息内加入多个按钮,用于问卷、游戏和商品浏览等互动;富文本编辑器支持插入文档、文件和音乐,礼物市场支持为购买的礼物添加签名和评论。
Telegram
英伟达洽购 Hugging Face,估值超 130 亿美元
据知情人士透露,英伟达近期与开源 AI 平台 Hugging Face 进行收购洽谈,交易估值可能超过 130 亿美元。双方尚未达成协议,谈判仍可能破裂。微软也曾接触,但目前谈判已停止。
英伟达已是 Hugging Face 股东,曾参与其 2023 年 2.35 亿美元融资(当时估值 45 亿美元)。去年 Hugging Face 还拒绝了英伟达 5 亿美元的投资要约。
Business Insider
据知情人士透露,英伟达近期与开源 AI 平台 Hugging Face 进行收购洽谈,交易估值可能超过 130 亿美元。双方尚未达成协议,谈判仍可能破裂。微软也曾接触,但目前谈判已停止。
英伟达已是 Hugging Face 股东,曾参与其 2023 年 2.35 亿美元融资(当时估值 45 亿美元)。去年 Hugging Face 还拒绝了英伟达 5 亿美元的投资要约。
Business Insider
GLM-5.3-Flash 还有个更猛的细节。
它匿名叫 Ox Alpha 的这一周,OpenCode 和 OpenRouter 的推理流量全部由国产 AI 芯片承载。
仅 OpenRouter 前 6 个完整日就跑了 23.2T Token;OpenCode 当时给出的供应能力更是每天 100T Token。
智谱称,他们在相同中国国产硬件上把端到端推理性能优化到了最初的 3 倍,现在硬件效率和单 Token 成本已经能做到接近主流英伟达 GPU。
SemiAnalysis 特意把这一点挑了出来。此前外界看到每天 100 万亿 Token 的供给能力,还在猜这种规模是不是只有顶级实验室和英伟达 GPU 扛得住。结果这次从头到尾用的都是中国国产芯片!
它匿名叫 Ox Alpha 的这一周,OpenCode 和 OpenRouter 的推理流量全部由国产 AI 芯片承载。
仅 OpenRouter 前 6 个完整日就跑了 23.2T Token;OpenCode 当时给出的供应能力更是每天 100T Token。
智谱称,他们在相同中国国产硬件上把端到端推理性能优化到了最初的 3 倍,现在硬件效率和单 Token 成本已经能做到接近主流英伟达 GPU。
SemiAnalysis 特意把这一点挑了出来。此前外界看到每天 100 万亿 Token 的供给能力,还在猜这种规模是不是只有顶级实验室和英伟达 GPU 扛得住。结果这次从头到尾用的都是中国国产芯片!