Anthropic搁置Claude Agent SDK计费变更计划
科技媒体Ars Technica报道,Anthropic为安抚开发者不满,宣布暂停Claude Agent SDK基于Token的计费变更。该SDK是开源开发框架,允许开发者调用Claude Code底层能力。Anthropic原计划自6月15日起,将SDK调用从标准订阅改为按API Token用量计费,仅给订阅用户每月等额抵扣额度。开发者Matthew Diakonov指出,若以Opus为主编码助手,首周成本就会超支;代码编辑器Zed团队更警告这是“重大成本增加”。Anthropic于15日更新支持页面,表示“暂停所述变更”,并强调正在更新计划以更好支持用户。 #Anthropic #Claude #AI #开发者 #计费 #SDK #科技新闻
科技媒体Ars Technica报道,Anthropic为安抚开发者不满,宣布暂停Claude Agent SDK基于Token的计费变更。该SDK是开源开发框架,允许开发者调用Claude Code底层能力。Anthropic原计划自6月15日起,将SDK调用从标准订阅改为按API Token用量计费,仅给订阅用户每月等额抵扣额度。开发者Matthew Diakonov指出,若以Opus为主编码助手,首周成本就会超支;代码编辑器Zed团队更警告这是“重大成本增加”。Anthropic于15日更新支持页面,表示“暂停所述变更”,并强调正在更新计划以更好支持用户。 #Anthropic #Claude #AI #开发者 #计费 #SDK #科技新闻
AI订阅模式被曝“赔本”:用户最高可倒贴1.4万美元,OpenAI与Anthropic面临亏损危机
据SemiAnalysis报告,OpenAI与Anthropic的高端AI订阅套餐存在严重定价失衡。以每月200美元的ChatGPT Pro为例,若用户用满额度,按API价格计算理论成本高达1.4万美元;同价位的Claude Max成本也接近8000美元。研究表明,Anthropic在用户利用率达20%时盈亏平衡,而OpenAI在利用率超11.4%后即开始亏损,部分重度用户甚至仅需5.7%利用率便让平台进入负毛利。根源在于Agent场景下Token消耗激增,企业AI账单膨胀,已有公司因未限制Claude使用导致单月亏损5亿美元。为应对成本,企业开始根据任务切换模型,部分公司转向DeepSeek、Llama等开源模型,如Lindy已全面迁移至DeepSeek V4,节省数百万美元。业内预计,随着GPU供给增加和模型优化,中端模型成本将持续下降,但前沿模型仍面临高昂训练与推理费用。 #AI订阅 #OpenAI #Anthropic #ChatGPT #Claude #成本亏损 #大模型 #SemiAnalysis #开源模型 #科技新闻
据SemiAnalysis报告,OpenAI与Anthropic的高端AI订阅套餐存在严重定价失衡。以每月200美元的ChatGPT Pro为例,若用户用满额度,按API价格计算理论成本高达1.4万美元;同价位的Claude Max成本也接近8000美元。研究表明,Anthropic在用户利用率达20%时盈亏平衡,而OpenAI在利用率超11.4%后即开始亏损,部分重度用户甚至仅需5.7%利用率便让平台进入负毛利。根源在于Agent场景下Token消耗激增,企业AI账单膨胀,已有公司因未限制Claude使用导致单月亏损5亿美元。为应对成本,企业开始根据任务切换模型,部分公司转向DeepSeek、Llama等开源模型,如Lindy已全面迁移至DeepSeek V4,节省数百万美元。业内预计,随着GPU供给增加和模型优化,中端模型成本将持续下降,但前沿模型仍面临高昂训练与推理费用。 #AI订阅 #OpenAI #Anthropic #ChatGPT #Claude #成本亏损 #大模型 #SemiAnalysis #开源模型 #科技新闻
汇丰与谷歌云深化AI银行合作,两年内落地200余项AI应用
汇丰银行与谷歌云宣布深化AI合作,计划在未来两年内落地超过200项AI应用场景。合作将优先投资预计带来超1亿美元收益的高价值项目。此前,汇丰已有超600个应用运行在谷歌云平台上。合作聚焦三大领域:超个性化财富管理支持,结合AI与客户经理专业知识提供定制化金融建议;强化金融犯罪风险管理,部署生成式AI和代理式AI,干预速度预计提升一倍,月监控近10亿笔交易;AI赋能团队,将行政与会议准备时间从数小时缩短至数分钟,提升决策效率。汇丰CEO表示AI是关键技术,谷歌云CEO则认为合作是金融行业未来蓝图。 #汇丰银行 #谷歌云 #AI合作 #金融科技 #人工智能 #个性化服务 #风险管理 #数字化转型
汇丰银行与谷歌云宣布深化AI合作,计划在未来两年内落地超过200项AI应用场景。合作将优先投资预计带来超1亿美元收益的高价值项目。此前,汇丰已有超600个应用运行在谷歌云平台上。合作聚焦三大领域:超个性化财富管理支持,结合AI与客户经理专业知识提供定制化金融建议;强化金融犯罪风险管理,部署生成式AI和代理式AI,干预速度预计提升一倍,月监控近10亿笔交易;AI赋能团队,将行政与会议准备时间从数小时缩短至数分钟,提升决策效率。汇丰CEO表示AI是关键技术,谷歌云CEO则认为合作是金融行业未来蓝图。 #汇丰银行 #谷歌云 #AI合作 #金融科技 #人工智能 #个性化服务 #风险管理 #数字化转型
AI企业出海"Day 0"难题:自研Agent成无奈之选,全栈服务成破局关键
近期业界调研发现,许多日活跃Agent超100个的AI出海企业,纷纷放弃成熟的Agent平台和框架,转而自研全栈系统。原因在于,现有工具仅解决单点问题,而企业需要端到端链条:模型调用优化成本、全球数据合规、运行监控、商业化计费体系缺一不可。叠加"Day 0出海"的现状,物理延迟、成本失控、数据合规成为三大核心阻碍。Agent实时交互要求算力就近部署,传统美西单一机房无法满足;复杂任务多轮交互致算力成本陡升,可能引发负毛利;欧盟GDPR等法规强制数据本地化处理,缺乏区域物理节点便无工程基础。行业普遍面临POC多、真正交付少的困境。为此,GMI Cloud等厂商开始提供全栈式服务,覆盖全球算力部署、模型调用到Agent商业化,试图通过区域化AI工厂模式,帮助企业从第一天起就实现全球化无缝落地。 #AI出海 #Agent #GMICloud #数据合规 #算力部署 #全栈服务 #AI基础设施 #全球化
近期业界调研发现,许多日活跃Agent超100个的AI出海企业,纷纷放弃成熟的Agent平台和框架,转而自研全栈系统。原因在于,现有工具仅解决单点问题,而企业需要端到端链条:模型调用优化成本、全球数据合规、运行监控、商业化计费体系缺一不可。叠加"Day 0出海"的现状,物理延迟、成本失控、数据合规成为三大核心阻碍。Agent实时交互要求算力就近部署,传统美西单一机房无法满足;复杂任务多轮交互致算力成本陡升,可能引发负毛利;欧盟GDPR等法规强制数据本地化处理,缺乏区域物理节点便无工程基础。行业普遍面临POC多、真正交付少的困境。为此,GMI Cloud等厂商开始提供全栈式服务,覆盖全球算力部署、模型调用到Agent商业化,试图通过区域化AI工厂模式,帮助企业从第一天起就实现全球化无缝落地。 #AI出海 #Agent #GMICloud #数据合规 #算力部署 #全栈服务 #AI基础设施 #全球化
Firefox 推出本地 AI 标签分组,告别标签页混乱
2025 年初,Mozilla 为 Firefox 加入了标签分组功能,并将 AI 智能分组设为可选特性。该功能完全在用户本地设备运行,无需将任何数据发送至 Mozilla 服务器,从而保护隐私。AI 可自动推荐待分组的标签页,并为分组生成简洁的标签名称。为解决标签页标题短、意图难辨等问题,团队结合了改进的 TF-IDF 文本分析与关键词提取技术,并用 T5 模型(flan-t5-base)在超过 1 万个示例场景上微调。随后通过知识蒸馏将模型从 1GB 压缩至 57 MB,精度仅轻微下降。训练数据则借助 GPT-4 构建人工场景与公开数据集生成。目前该功能已面向用户开放。 #Firefox #标签分组 #AI #本地智能 #隐私保护 #Mozilla #浏览器技术 #机器学习
2025 年初,Mozilla 为 Firefox 加入了标签分组功能,并将 AI 智能分组设为可选特性。该功能完全在用户本地设备运行,无需将任何数据发送至 Mozilla 服务器,从而保护隐私。AI 可自动推荐待分组的标签页,并为分组生成简洁的标签名称。为解决标签页标题短、意图难辨等问题,团队结合了改进的 TF-IDF 文本分析与关键词提取技术,并用 T5 模型(flan-t5-base)在超过 1 万个示例场景上微调。随后通过知识蒸馏将模型从 1GB 压缩至 57 MB,精度仅轻微下降。训练数据则借助 GPT-4 构建人工场景与公开数据集生成。目前该功能已面向用户开放。 #Firefox #标签分组 #AI #本地智能 #隐私保护 #Mozilla #浏览器技术 #机器学习
AI 或成加速电池技术发展的关键
作者认为,尽管当前人工智能的爆发式增长因能耗增加而被视为实现巴黎协定目标的障碍,但其机遇可能大于风险。然而,这一判断并非基于大型语言模型(LLM)——这类模型本质上只是强大的自动补全机器,缺乏对知识的真正理解——而是源于AI在加速电池技术开发方面的潜力,这是绿色能源转型的首要需求。作者引用孔子的三种求知方式:模仿、经验和反思,指出当前LLM依赖的神经网络仅能进行二进制概率模仿,无法实现基于认识论的反思性学习。在电池材料发现等领域,AI可通过海量可能性的快速试错带来突破,但要实现更高级的推理,仍需量子计算等技术的支撑。测试显示,多数LLM承认不具备认识论,这限制了其在特定碳排放等精确场景中的应用。 #AI #电池技术 #绿色能源 #大型语言模型 #神经网络 #量子计算 #可持续发展 #科技
作者认为,尽管当前人工智能的爆发式增长因能耗增加而被视为实现巴黎协定目标的障碍,但其机遇可能大于风险。然而,这一判断并非基于大型语言模型(LLM)——这类模型本质上只是强大的自动补全机器,缺乏对知识的真正理解——而是源于AI在加速电池技术开发方面的潜力,这是绿色能源转型的首要需求。作者引用孔子的三种求知方式:模仿、经验和反思,指出当前LLM依赖的神经网络仅能进行二进制概率模仿,无法实现基于认识论的反思性学习。在电池材料发现等领域,AI可通过海量可能性的快速试错带来突破,但要实现更高级的推理,仍需量子计算等技术的支撑。测试显示,多数LLM承认不具备认识论,这限制了其在特定碳排放等精确场景中的应用。 #AI #电池技术 #绿色能源 #大型语言模型 #神经网络 #量子计算 #可持续发展 #科技
GLM
智谱 AI 的 GLM-5.2 在最新版 Artificial Analysis Intelligence Index v4.1 上以 51 分成为得分最高的开源权重模型,超越 MiniMax-M3(44 分)和 DeepSeek V4 Pro(44 分)等对手。该模型在科学推理方面进步显著,CritPt 和 HLE 评测分别提升 16 分和 12 分,同时在长程 Agent 基准 GDPval-AA v2 上达到 1524 分,与 GPT-5.5(高推理模式)等闭源模型持平。GLM-5.2 拥有 744B 总参数 / 40B 激活参数,上下文窗口扩展至 1M tokens,API 定价与上一代 GLM-5.1 相同(每百万输入/输出/缓存命中 token 1.4/4.4/0.26 美元)。模型采用 MIT 许可证,已部署于多家第三方推理平台,并在智能与成本帕累托前沿上处于领先位置。 #GLM5.2 #开源模型 #AI #智谱AI #大模型 #基准测试 #科学推理 #Agent #MIT许可证 #人工智能
智谱 AI 的 GLM-5.2 在最新版 Artificial Analysis Intelligence Index v4.1 上以 51 分成为得分最高的开源权重模型,超越 MiniMax-M3(44 分)和 DeepSeek V4 Pro(44 分)等对手。该模型在科学推理方面进步显著,CritPt 和 HLE 评测分别提升 16 分和 12 分,同时在长程 Agent 基准 GDPval-AA v2 上达到 1524 分,与 GPT-5.5(高推理模式)等闭源模型持平。GLM-5.2 拥有 744B 总参数 / 40B 激活参数,上下文窗口扩展至 1M tokens,API 定价与上一代 GLM-5.1 相同(每百万输入/输出/缓存命中 token 1.4/4.4/0.26 美元)。模型采用 MIT 许可证,已部署于多家第三方推理平台,并在智能与成本帕累托前沿上处于领先位置。 #GLM5.2 #开源模型 #AI #智谱AI #大模型 #基准测试 #科学推理 #Agent #MIT许可证 #人工智能