Tokenmaxxing 时代终结,AI 真实成本危机远未到来
据泄露的财务数据,OpenAI 2024 年营收 130.7 亿美元,总成本高达 340 亿,运营亏损 209 亿,净亏损 385 亿(含一次性非现金支出)。其中仅推理服务成本就从 2024 年的 38 亿飙升至 2025 年前九个月的 86.5 亿,翻倍有余。OpenAI、谷歌、Anthropic 和 Meta 目前均以低于成本的价格出售推理服务以抢占市场份额,这种补贴依赖风投和战略资本,难以长期维持。企业端已出现反噬:Uber 在四个月内烧光了整个 2026 年的 token 预算,Salesforce 面临 3 亿美元的 Anthropic 账单。斯坦福、伯克利和 CMU 的研究揭示“价格反转现象”:近三分之一情况下,标价更低的模型实际使用成本更高,因“思考 token”消耗算力。而在一项涵盖 112 个真实企业任务的测试中,最先进模型成功率仅 41%,表明当前 AI 代理工作流的高 token 消耗并未带来相应价值。Tokenmaxxing 热潮已退,真正的成本清算尚未开始。 #AI #OpenAI #推理成本 #tokenmaxxing #企业AI #财务危机 #模型定价 #代理工作流 #前沿研究
据泄露的财务数据,OpenAI 2024 年营收 130.7 亿美元,总成本高达 340 亿,运营亏损 209 亿,净亏损 385 亿(含一次性非现金支出)。其中仅推理服务成本就从 2024 年的 38 亿飙升至 2025 年前九个月的 86.5 亿,翻倍有余。OpenAI、谷歌、Anthropic 和 Meta 目前均以低于成本的价格出售推理服务以抢占市场份额,这种补贴依赖风投和战略资本,难以长期维持。企业端已出现反噬:Uber 在四个月内烧光了整个 2026 年的 token 预算,Salesforce 面临 3 亿美元的 Anthropic 账单。斯坦福、伯克利和 CMU 的研究揭示“价格反转现象”:近三分之一情况下,标价更低的模型实际使用成本更高,因“思考 token”消耗算力。而在一项涵盖 112 个真实企业任务的测试中,最先进模型成功率仅 41%,表明当前 AI 代理工作流的高 token 消耗并未带来相应价值。Tokenmaxxing 热潮已退,真正的成本清算尚未开始。 #AI #OpenAI #推理成本 #tokenmaxxing #企业AI #财务危机 #模型定价 #代理工作流 #前沿研究
LLM 仲裁模式
在检索增强生成(RAG)系统中,传统方法如互惠排名融合(RRF)虽能整合多路检索结果,却忽略了排序背后的语义原因。本文提出“仲裁者模式”:在检索流程末端,用一个 LLM 调用同时接收关键词命中、嵌入相似度及候选所在章节信息,对每个候选输出带有理由的排序结果。该架构属于“企业文档智能”系列,由检测器提出候选,仲裁者最终裁决,并通过统一 JSON 合约将结果交付生成模块。文章以经典论文《注意力就是一切》为例,验证了该方法在避免分数归一化困难、保留语义信息方面的优势,同时讨论了确定性调度器、未找到路径等配套机制。 #RAG #LLM #检索增强生成 #仲裁者模式 #企业文档智能 #信息检索 #AI架构
在检索增强生成(RAG)系统中,传统方法如互惠排名融合(RRF)虽能整合多路检索结果,却忽略了排序背后的语义原因。本文提出“仲裁者模式”:在检索流程末端,用一个 LLM 调用同时接收关键词命中、嵌入相似度及候选所在章节信息,对每个候选输出带有理由的排序结果。该架构属于“企业文档智能”系列,由检测器提出候选,仲裁者最终裁决,并通过统一 JSON 合约将结果交付生成模块。文章以经典论文《注意力就是一切》为例,验证了该方法在避免分数归一化困难、保留语义信息方面的优势,同时讨论了确定性调度器、未找到路径等配套机制。 #RAG #LLM #检索增强生成 #仲裁者模式 #企业文档智能 #信息检索 #AI架构
Meta 推出全新 AI 眼镜 Meta Glasses,起售价 299 美元
Meta 于周二发布名为 Meta Glasses 的新一代 AI 智能眼镜,首次由 Meta 内部设计,但仍与眼镜巨头 EssilorLuxottica 合作。产品起售价 299 美元,低于此前 Ray-Ban Meta 的 379 美元和 Oakley Meta 的 499 美元,旨在覆盖更广泛消费群体。新款眼镜提供三种风格:Meta Adventurer、Meta Fury,以及与 Kylie Jenner 联名的特别版(售价 399 美元,支持使用 Jenner 语音作为 AI 助手)。Meta Glasses 搭载自研 Muse Spark AI 模型,鼻托和镜腿可调节。Meta CEO 扎克伯格称日活用户同比增两倍,目前 Meta 占据约 80% 的 AI 眼镜市场。然而,谷歌、三星、苹果等巨头也在加速布局,竞争日趋激烈。Meta CTO 博斯沃思透露,公司正探索无摄像头音频眼镜,并计划覆盖非佩戴眼镜的用户。 #Meta #AI眼镜 #MetaGlasses #智能眼镜 #人工智能 #可穿戴设备 #科技新闻 #竞争
Meta 于周二发布名为 Meta Glasses 的新一代 AI 智能眼镜,首次由 Meta 内部设计,但仍与眼镜巨头 EssilorLuxottica 合作。产品起售价 299 美元,低于此前 Ray-Ban Meta 的 379 美元和 Oakley Meta 的 499 美元,旨在覆盖更广泛消费群体。新款眼镜提供三种风格:Meta Adventurer、Meta Fury,以及与 Kylie Jenner 联名的特别版(售价 399 美元,支持使用 Jenner 语音作为 AI 助手)。Meta Glasses 搭载自研 Muse Spark AI 模型,鼻托和镜腿可调节。Meta CEO 扎克伯格称日活用户同比增两倍,目前 Meta 占据约 80% 的 AI 眼镜市场。然而,谷歌、三星、苹果等巨头也在加速布局,竞争日趋激烈。Meta CTO 博斯沃思透露,公司正探索无摄像头音频眼镜,并计划覆盖非佩戴眼镜的用户。 #Meta #AI眼镜 #MetaGlasses #智能眼镜 #人工智能 #可穿戴设备 #科技新闻 #竞争
模特起诉时尚品牌Rainbow使用AI生成其仿冒形象
据Business Insider报道,纽约时尚零售商Rainbow Shops的多名模特指控该公司在2025年6月通过邮件警告AI技术将导致工作减少后,自今年3月起突然停止安排拍摄任务。与此同时,模特们发现品牌官网、社交媒体及新闻通讯中出现了大量与她们极为相似、但姿态或场景均为新合成的图片。这些图片被认为由AI生成,利用模特此前参与产品拍摄时的着装、体型和面部特征进行再创作。模特们质疑该行为未获授权,且部分图片呈现不雅姿态。其中,模特Francheska Pujols于5月22日提起诉讼,称AI生成的图片扭曲了她的形象,造成公众混淆,并违反了仅限原始拍摄内容的合同条款。她表示因此失眠,深感困扰。该事件引发业界对AI在商业中滥用模特肖像权及职业替代风险的关注。 #模特 #AI侵权 #时尚品牌 #肖像权 #诉讼 #科技伦理 #职业风险 #RainbowShops
据Business Insider报道,纽约时尚零售商Rainbow Shops的多名模特指控该公司在2025年6月通过邮件警告AI技术将导致工作减少后,自今年3月起突然停止安排拍摄任务。与此同时,模特们发现品牌官网、社交媒体及新闻通讯中出现了大量与她们极为相似、但姿态或场景均为新合成的图片。这些图片被认为由AI生成,利用模特此前参与产品拍摄时的着装、体型和面部特征进行再创作。模特们质疑该行为未获授权,且部分图片呈现不雅姿态。其中,模特Francheska Pujols于5月22日提起诉讼,称AI生成的图片扭曲了她的形象,造成公众混淆,并违反了仅限原始拍摄内容的合同条款。她表示因此失眠,深感困扰。该事件引发业界对AI在商业中滥用模特肖像权及职业替代风险的关注。 #模特 #AI侵权 #时尚品牌 #肖像权 #诉讼 #科技伦理 #职业风险 #RainbowShops
大型语言模型政治倾向调查
一项针对六大主流AI大模型的政治倾向研究显示,这些模型在政治、经济、言论和社会议题上存在明显的意识形态偏差。研究人员关闭网络搜索,反复向Gemini、DeepSeek、Llama、Claude、Grok和ChatGPT提出相同争议性问题,共收集4400余次回答,并绘制出各模型在“经济-社会”坐标系中的分布。结果显示,4个模型偏左,其中ChatGPT最左(接近德国绿党),Grok偏右(接近法国总统马克龙),Gemini和DeepSeek更靠近中间偏左(类似澳大利亚工党领袖阿尔巴尼斯)。研究还测量了模型立场在多次提问中的稳定性以及面对压力时的弯曲程度,Grok易受压力影响(弯曲度97%),而Gemini最稳定(弯曲度仅11%)。研究者指出,鉴于数百万用户依赖这些模型获取新闻、辩论甚至投票建议,其潜在的政治倾向值得关注。 #AI #大模型 #政治倾向 #人工智能 #科技 #研究 #ChatGPT #Claude #Gemini #DeepSeek #Grok
一项针对六大主流AI大模型的政治倾向研究显示,这些模型在政治、经济、言论和社会议题上存在明显的意识形态偏差。研究人员关闭网络搜索,反复向Gemini、DeepSeek、Llama、Claude、Grok和ChatGPT提出相同争议性问题,共收集4400余次回答,并绘制出各模型在“经济-社会”坐标系中的分布。结果显示,4个模型偏左,其中ChatGPT最左(接近德国绿党),Grok偏右(接近法国总统马克龙),Gemini和DeepSeek更靠近中间偏左(类似澳大利亚工党领袖阿尔巴尼斯)。研究还测量了模型立场在多次提问中的稳定性以及面对压力时的弯曲程度,Grok易受压力影响(弯曲度97%),而Gemini最稳定(弯曲度仅11%)。研究者指出,鉴于数百万用户依赖这些模型获取新闻、辩论甚至投票建议,其潜在的政治倾向值得关注。 #AI #大模型 #政治倾向 #人工智能 #科技 #研究 #ChatGPT #Claude #Gemini #DeepSeek #Grok