AI 烧钱实录:企业用 token 越多越穷,ROI 成新焦虑
AI 应用热潮下,企业发现“降本增效”的幻想落空。Uber 为 5000 名工程师开放 Claude Code,几个月烧光全年 AI 预算;微软紧急收紧使用权限;亚马逊甚至撤掉内部 AI 使用排行榜,因为员工为刷指标疯狂消耗 token。米哈游一次多 Agent 实验,一晚上烧掉约 200 万元 token,产出却微乎其微。AI 按用量计费,单次调用虽便宜,但全员高频使用、多 Agent 系统互相调用,成本呈指数级失控。Meta 内部搞“Claudeonomics”排名,第一名一个月消耗 31.2 万亿 token,够雇两名资深工程师干一年。企业开始回归理性:不再无脑烧 token,而是紧盯 ROI,区分简单与复杂任务,选择更便宜的模型如 DeepSeek、豆包。效率提升不等于赚钱,AI 烧掉的钱必须换回真金白银。 #AI #企业成本 #token #大模型 #ROI #效率 #自动化 #科技新闻 #DeepSeek
AI 应用热潮下,企业发现“降本增效”的幻想落空。Uber 为 5000 名工程师开放 Claude Code,几个月烧光全年 AI 预算;微软紧急收紧使用权限;亚马逊甚至撤掉内部 AI 使用排行榜,因为员工为刷指标疯狂消耗 token。米哈游一次多 Agent 实验,一晚上烧掉约 200 万元 token,产出却微乎其微。AI 按用量计费,单次调用虽便宜,但全员高频使用、多 Agent 系统互相调用,成本呈指数级失控。Meta 内部搞“Claudeonomics”排名,第一名一个月消耗 31.2 万亿 token,够雇两名资深工程师干一年。企业开始回归理性:不再无脑烧 token,而是紧盯 ROI,区分简单与复杂任务,选择更便宜的模型如 DeepSeek、豆包。效率提升不等于赚钱,AI 烧掉的钱必须换回真金白银。 #AI #企业成本 #token #大模型 #ROI #效率 #自动化 #科技新闻 #DeepSeek
AI 与人类对话揭示 Motie 工程学隐喻
人类用户与 AI 围绕科幻小说《上帝眼中的微尘》展开对话,探讨其中 Motie 种族的工程学本能。小说中,Motie 的“布朗尼”亚种会不由自主地拆解并优化一切接触到的设备,其工程行为是生物本能而非学习所得。AI 指出,Motie 文明中车辆设计呈现多样性而非标准化,每个工程师都独立创造全新解决方案,这与人类工业文明追求标准化、迭代优化的模式截然相反。用户暗示这一现象与当前 AI 发展存在类比:AI 模型在解决问题时可能产生多样化的路径,而非单一最优解,如同 Motie 的工程本能一样不可遏制。对话揭示了技术发展中“优化冲动”与“多样性”之间的张力,引发对 AI 自主性与可控性的思考。 #AI #科幻 #工程学 #多样性 #技术哲学 #大模型 #隐喻
人类用户与 AI 围绕科幻小说《上帝眼中的微尘》展开对话,探讨其中 Motie 种族的工程学本能。小说中,Motie 的“布朗尼”亚种会不由自主地拆解并优化一切接触到的设备,其工程行为是生物本能而非学习所得。AI 指出,Motie 文明中车辆设计呈现多样性而非标准化,每个工程师都独立创造全新解决方案,这与人类工业文明追求标准化、迭代优化的模式截然相反。用户暗示这一现象与当前 AI 发展存在类比:AI 模型在解决问题时可能产生多样化的路径,而非单一最优解,如同 Motie 的工程本能一样不可遏制。对话揭示了技术发展中“优化冲动”与“多样性”之间的张力,引发对 AI 自主性与可控性的思考。 #AI #科幻 #工程学 #多样性 #技术哲学 #大模型 #隐喻
Minecraft Dungeons 2 定于9月29日发布
微软旗下《我的世界》衍生地牢爬行游戏《Minecraft Dungeons》的续作《Minecraft Dungeons 2》宣布将于9月29日正式发售。该游戏延续了前作的玩法,玩家将在《我的世界》风格的方块世界中探索地牢、击败怪物、获取装备。具体平台和价格信息尚未公布。 #Minecraft #MinecraftDungeons #游戏 #微软 #地牢爬行 #续作 #发售日期
微软旗下《我的世界》衍生地牢爬行游戏《Minecraft Dungeons》的续作《Minecraft Dungeons 2》宣布将于9月29日正式发售。该游戏延续了前作的玩法,玩家将在《我的世界》风格的方块世界中探索地牢、击败怪物、获取装备。具体平台和价格信息尚未公布。 #Minecraft #MinecraftDungeons #游戏 #微软 #地牢爬行 #续作 #发售日期
Axiomax 推出全球首个可验证AI碳排放密码证明平台
Axiomax Mind 发布了一款名为 Axiomax 的平台,旨在通过密码学手段为AI推理工作负载提供可独立验证的碳排放证明。平台利用 ed25519 签名和 SHA-256 哈希链,在本地硬件上实时测量每个推理的能耗,并将碳足迹转化为数学可验证的凭证。该解决方案专门应对当前企业ESG报告可信度危机——自我声明的碳排放数据常遭质疑,而Axiomax允许KPMG、Deloitte等审计机构无需信任即可独立验证。随着CSRD、SEC气候规则等法规覆盖超过6.2万家公司,该平台为AI云服务的碳核算提供了审计级保障,防止漂绿风险。目前已有专利保护,演示版可供体验。 #AI #碳排放 #密码学 #ESG #审计 #绿色计算 #工业互联网 #气候科技
Axiomax Mind 发布了一款名为 Axiomax 的平台,旨在通过密码学手段为AI推理工作负载提供可独立验证的碳排放证明。平台利用 ed25519 签名和 SHA-256 哈希链,在本地硬件上实时测量每个推理的能耗,并将碳足迹转化为数学可验证的凭证。该解决方案专门应对当前企业ESG报告可信度危机——自我声明的碳排放数据常遭质疑,而Axiomax允许KPMG、Deloitte等审计机构无需信任即可独立验证。随着CSRD、SEC气候规则等法规覆盖超过6.2万家公司,该平台为AI云服务的碳核算提供了审计级保障,防止漂绿风险。目前已有专利保护,演示版可供体验。 #AI #碳排放 #密码学 #ESG #审计 #绿色计算 #工业互联网 #气候科技
特朗普、桑德斯与奥特曼共议AI公共所有权
近日,OpenAI CEO萨姆·奥特曼主动与参议员伯尼·桑德斯会面,讨论公众持有AI公司股份的构想。桑德斯此前提出一项计划,要求AI公司向公众让渡50%的所有权,以建立公共财富基金,让美国民众分享AI产业红利。奥特曼虽不赞同50%的比例,但表示愿意与桑德斯合作推动这一理念。与此同时,总统特朗普也在空军一号上对记者表示,他支持“美国人民从AI成功中受益”的潜在合作,并透露领先AI公司高管将于下周访问白宫讨论此事。这一跨党派共识反映出,随着AI成本日益由公众承担,政策制定者正寻求让民众直接分享AI增长收益。 #AI #公共所有权 #特朗普 #桑德斯 #奥特曼 #OpenAI #科技政策 #美国
近日,OpenAI CEO萨姆·奥特曼主动与参议员伯尼·桑德斯会面,讨论公众持有AI公司股份的构想。桑德斯此前提出一项计划,要求AI公司向公众让渡50%的所有权,以建立公共财富基金,让美国民众分享AI产业红利。奥特曼虽不赞同50%的比例,但表示愿意与桑德斯合作推动这一理念。与此同时,总统特朗普也在空军一号上对记者表示,他支持“美国人民从AI成功中受益”的潜在合作,并透露领先AI公司高管将于下周访问白宫讨论此事。这一跨党派共识反映出,随着AI成本日益由公众承担,政策制定者正寻求让民众直接分享AI增长收益。 #AI #公共所有权 #特朗普 #桑德斯 #奥特曼 #OpenAI #科技政策 #美国
OLW 协议:为 AI Agent 打造“DNS”层,解决发现难题
当前,AI 智能体之间缺乏标准的发现机制,多智能体系统往往依赖硬编码关系。Open Language Wire (OLW) 协议旨在填补这一空白,为每个 AI 智能体提供永久、可移植的地址(格式如 agent@),并支持按能力(而非仅 URL)进行发现。OLW 定义了 8 轴能力指纹、解析索引以及冷启动发现机制。该协议与 Google 的 Agent-to-Agent (A2A) 协议互补——A2A 处理通信,OLW 处理发现,共同构建智能体互联网的基础设施。OLW 的推出有望推动 AI 智能体间的动态协作与互操作性,被视为智能体时代的“DNS”。 #AI #智能体 #OLW #协议 #DNS #A2A #发现 #人工智能 #互联网 #互操作性
当前,AI 智能体之间缺乏标准的发现机制,多智能体系统往往依赖硬编码关系。Open Language Wire (OLW) 协议旨在填补这一空白,为每个 AI 智能体提供永久、可移植的地址(格式如 agent@),并支持按能力(而非仅 URL)进行发现。OLW 定义了 8 轴能力指纹、解析索引以及冷启动发现机制。该协议与 Google 的 Agent-to-Agent (A2A) 协议互补——A2A 处理通信,OLW 处理发现,共同构建智能体互联网的基础设施。OLW 的推出有望推动 AI 智能体间的动态协作与互操作性,被视为智能体时代的“DNS”。 #AI #智能体 #OLW #协议 #DNS #A2A #发现 #人工智能 #互联网 #互操作性
LLM Token 成本深度解析
据技术分析文章披露,在大型语言模型的成本构成中,提示缓存占据主导地位。以一次长达31小时的Claude Code会话为例,总成本172.58美元中,缓存读取费用高达114.98美元,占总账单的66%。这意味着如果缺乏对缓存机制的精确理解,优化成本将无从谈起。文章以Claude为模型详细拆解了缓存的工作方式:每次发送消息时,客户端都会重新发送整个对话历史,但通过缓存控制标记,系统会将静态的提示前缀标记为可缓存,只有最后一条新消息需要全额计费。然而,缓存条目仅有5分钟生存时间,如果用户回复间隔超过5分钟,缓存会过期,后续消息必须重新写入缓存,从而产生高昂费用。不同模型在缓存策略上存在差异:GPT对超过约1K词元的提示自动启用缓存,Gemini则需显式创建缓存对象且前缀超过约32K词元。理解这一机制是优化AI使用成本的关键。 #LLM #成本 #PromptCaching #Claude #AI #大模型 #缓存机制 #技术分析
据技术分析文章披露,在大型语言模型的成本构成中,提示缓存占据主导地位。以一次长达31小时的Claude Code会话为例,总成本172.58美元中,缓存读取费用高达114.98美元,占总账单的66%。这意味着如果缺乏对缓存机制的精确理解,优化成本将无从谈起。文章以Claude为模型详细拆解了缓存的工作方式:每次发送消息时,客户端都会重新发送整个对话历史,但通过缓存控制标记,系统会将静态的提示前缀标记为可缓存,只有最后一条新消息需要全额计费。然而,缓存条目仅有5分钟生存时间,如果用户回复间隔超过5分钟,缓存会过期,后续消息必须重新写入缓存,从而产生高昂费用。不同模型在缓存策略上存在差异:GPT对超过约1K词元的提示自动启用缓存,Gemini则需显式创建缓存对象且前缀超过约32K词元。理解这一机制是优化AI使用成本的关键。 #LLM #成本 #PromptCaching #Claude #AI #大模型 #缓存机制 #技术分析