微软叫停内部Claude Code,“Token不经济”问题凸显
微软近期收回内部使用的Claude Code许可。作为Anthropic推出的AI编程工具,Claude Code在微软内部仅六个月便成为最受欢迎的辅助开发软件,但随之而来的token消耗剧增与成本暴涨,而产出质量却不尽人意。微软转而引导员工使用自家Copilot CLI。这一现象并非孤例:Uber仅四个月便耗尽2026全年AI编程工具预算,亚马逊部分员工无意义消耗token,Meta也悄悄撤下内部token消耗排行榜。企业普遍面临token消耗与实际产出不成比例的“token不经济”困境。文章分析指出,背后原因包括企业管控不力、模型回报有限以及Agent架构设计的内耗。同时,各大模型厂商的定价策略也在推高成本:Anthropic凭借旗舰模型分层定价实现高利润,OpenAI和Google则被迫跟进调整,但经济型token市场的价格中枢却在悄然上移。 #Token不经济 #AI编程 #ClaudeCode #Anthropic #OpenAI #Google #大模型定价 #企业AI #科技前沿
微软近期收回内部使用的Claude Code许可。作为Anthropic推出的AI编程工具,Claude Code在微软内部仅六个月便成为最受欢迎的辅助开发软件,但随之而来的token消耗剧增与成本暴涨,而产出质量却不尽人意。微软转而引导员工使用自家Copilot CLI。这一现象并非孤例:Uber仅四个月便耗尽2026全年AI编程工具预算,亚马逊部分员工无意义消耗token,Meta也悄悄撤下内部token消耗排行榜。企业普遍面临token消耗与实际产出不成比例的“token不经济”困境。文章分析指出,背后原因包括企业管控不力、模型回报有限以及Agent架构设计的内耗。同时,各大模型厂商的定价策略也在推高成本:Anthropic凭借旗舰模型分层定价实现高利润,OpenAI和Google则被迫跟进调整,但经济型token市场的价格中枢却在悄然上移。 #Token不经济 #AI编程 #ClaudeCode #Anthropic #OpenAI #Google #大模型定价 #企业AI #科技前沿
KitForge 发布安全可控的 AI 代理生成工具
多数 AI 代理安全框架的“护栏”仅停留在文档层面,代码并不真正执行。KitForge 则反其道而行之:它提供一个确定性脚手架,将验证后的蓝图自动生成为 LangGraph 风格的代理,并通过硬性安全门控强制执行控制。该工具包含 HMAC 链式审计日志、工具调用和 Token 计数耗尽即停止、审批门控(超时或拒绝直接阻断动作)、以及断路器(重复工具失败后禁止调用)。所有生成代码携带“Generated by”署名,Python 实现,MIT 许可证,无需注册账户。开发者在网页上绘制代理草图后可一键合规扫描,生成的代码在本地由 CLI 执行。项目内置 13 个测试用例验证安全机制有效,确保篡改日志或绕过审批等违规行为被切实阻止。框架本身不替代部署安全审查,但已作为 AgentKits 治理工具套件的一部分开源。 #AI #代理安全 #开源 #KitForge #LangGraph #Python #开发工具 #软件工程
多数 AI 代理安全框架的“护栏”仅停留在文档层面,代码并不真正执行。KitForge 则反其道而行之:它提供一个确定性脚手架,将验证后的蓝图自动生成为 LangGraph 风格的代理,并通过硬性安全门控强制执行控制。该工具包含 HMAC 链式审计日志、工具调用和 Token 计数耗尽即停止、审批门控(超时或拒绝直接阻断动作)、以及断路器(重复工具失败后禁止调用)。所有生成代码携带“Generated by”署名,Python 实现,MIT 许可证,无需注册账户。开发者在网页上绘制代理草图后可一键合规扫描,生成的代码在本地由 CLI 执行。项目内置 13 个测试用例验证安全机制有效,确保篡改日志或绕过审批等违规行为被切实阻止。框架本身不替代部署安全审查,但已作为 AgentKits 治理工具套件的一部分开源。 #AI #代理安全 #开源 #KitForge #LangGraph #Python #开发工具 #软件工程
华尔街押注美光成为下一个AI芯片赢家
华尔街正全力寻找下一个英伟达,目光聚焦于美光科技。随着AI数据中心对内存芯片的需求与GPU同步飙升,投资者蜂拥至这家爱达荷州的内存制造商,其热情堪比三年前推动英伟达股价暴涨3000%的那波浪潮。逻辑很简单:每台搭载昂贵英伟达芯片的AI服务器,都需要更昂贵的高带宽内存来供能,而美光控制着该市场三分之一份额。美光股价过去一年已上涨超85%,但其HBM(高带宽内存)收入预计将从2023年近乎为零跃升至2026年每年80亿美元以上。分析师指出,在英伟达GPU短缺抢尽风头之后,HBM3及HBM3E内存模块已成为AI部署的真正瓶颈。美光正加速扩张在美国爱达荷州和纽约州的HBM产能,与三星、SK海力士三分天下。 #美光 #AI芯片 #HBM #华尔街 #英伟达 #半导体 #数据中心
华尔街正全力寻找下一个英伟达,目光聚焦于美光科技。随着AI数据中心对内存芯片的需求与GPU同步飙升,投资者蜂拥至这家爱达荷州的内存制造商,其热情堪比三年前推动英伟达股价暴涨3000%的那波浪潮。逻辑很简单:每台搭载昂贵英伟达芯片的AI服务器,都需要更昂贵的高带宽内存来供能,而美光控制着该市场三分之一份额。美光股价过去一年已上涨超85%,但其HBM(高带宽内存)收入预计将从2023年近乎为零跃升至2026年每年80亿美元以上。分析师指出,在英伟达GPU短缺抢尽风头之后,HBM3及HBM3E内存模块已成为AI部署的真正瓶颈。美光正加速扩张在美国爱达荷州和纽约州的HBM产能,与三星、SK海力士三分天下。 #美光 #AI芯片 #HBM #华尔街 #英伟达 #半导体 #数据中心
TraceLab:构建LLM服务中编码代理工作负载的特征分析工具
随着Anthropic的Claude Code、OpenAI的Codex和Google的Gemini CLI等编码代理进入市场,高效服务于这些代理成为重要的系统问题。现有基准测试难以反映实际服务性能。为此,研究团队发布SyFI编码轨迹数据集,包含约4300个会话和550亿token,来自日常Claude Code和Codex使用记录。分析发现:每个用户请求平均需8.8次自主循环(LLM-工具交替)和10.8次工具调用,88%的LLM回合响应工具结果而非人类;端到端响应时间呈长尾分布,中位数38秒,均值4分钟,p99近44分钟;输入token数量是输出的294倍(52.56B缓存输入+2.34B新输入 vs 1.87亿输出);解码速度中位数约40.7 tok/s。这些观察为设计更高效的编码代理服务系统提供了方向。 #LLM #编码代理 #工作负载 #系统性能 #TraceLab #AI服务
随着Anthropic的Claude Code、OpenAI的Codex和Google的Gemini CLI等编码代理进入市场,高效服务于这些代理成为重要的系统问题。现有基准测试难以反映实际服务性能。为此,研究团队发布SyFI编码轨迹数据集,包含约4300个会话和550亿token,来自日常Claude Code和Codex使用记录。分析发现:每个用户请求平均需8.8次自主循环(LLM-工具交替)和10.8次工具调用,88%的LLM回合响应工具结果而非人类;端到端响应时间呈长尾分布,中位数38秒,均值4分钟,p99近44分钟;输入token数量是输出的294倍(52.56B缓存输入+2.34B新输入 vs 1.87亿输出);解码速度中位数约40.7 tok/s。这些观察为设计更高效的编码代理服务系统提供了方向。 #LLM #编码代理 #工作负载 #系统性能 #TraceLab #AI服务
Unslop 推出“识别人工智能写作”互动测验及改写引擎
Unslop 发布了一款名为“Spot the AI”的趣味测验,旨在测试用户能否区分人类写作与AI生成文本。该测验包含十道题,每道题给出两个相似段落,用户需判断哪段由AI撰写。Unslop 指出,当前读者和搜索引擎已能轻易识别AI写作特征,并可能降权此类内容。为解决此问题,Unslop 提供了自然化改写引擎,可将AI生成的、带有机械感的文本转化为更像人类自然表达的风格,从而帮助用户绕过检测过滤器。该引擎会随着AI模型更新和检测技术升级而持续优化,确保用户内容既保留原意又去除AI痕迹。目前,Unslop 还提供定价方案、更多示例及详细产品介绍。 #AI写作 #文本检测 #搜索引擎优化 #自然语言处理 #AI检测 #内容创作 #Unslop
Unslop 发布了一款名为“Spot the AI”的趣味测验,旨在测试用户能否区分人类写作与AI生成文本。该测验包含十道题,每道题给出两个相似段落,用户需判断哪段由AI撰写。Unslop 指出,当前读者和搜索引擎已能轻易识别AI写作特征,并可能降权此类内容。为解决此问题,Unslop 提供了自然化改写引擎,可将AI生成的、带有机械感的文本转化为更像人类自然表达的风格,从而帮助用户绕过检测过滤器。该引擎会随着AI模型更新和检测技术升级而持续优化,确保用户内容既保留原意又去除AI痕迹。目前,Unslop 还提供定价方案、更多示例及详细产品介绍。 #AI写作 #文本检测 #搜索引擎优化 #自然语言处理 #AI检测 #内容创作 #Unslop
第零智能冲刺港股
深圳第零智能科技股份有限公司以“企业AI智能体解决方案提供商”身份递交港股上市申请,成立仅五年即实现过亿营收与连续盈利,市场份额跻身全国前五。然而,招股书揭示其核心收入超七成来自“合同助理”催收辅助业务,销售成本中支付给外聘律师事务所的费用占比高达98%以上。公司客户极度集中且频繁更迭,前五大客户几乎每年全部替换,部分客户成立当年即成为大客户,引发市场对其业务真实性与可持续性的质疑。同时,公司研发投入占比不足9%,仅拥有3项专利,与AI科技公司定位形成落差。在催收行业监管趋严的背景下,第零智能的商业模式合规风险也备受关注。 #第零智能 #AI智能体 #催收 #港股上市 #监管风险 #商业模式 #科技公司
深圳第零智能科技股份有限公司以“企业AI智能体解决方案提供商”身份递交港股上市申请,成立仅五年即实现过亿营收与连续盈利,市场份额跻身全国前五。然而,招股书揭示其核心收入超七成来自“合同助理”催收辅助业务,销售成本中支付给外聘律师事务所的费用占比高达98%以上。公司客户极度集中且频繁更迭,前五大客户几乎每年全部替换,部分客户成立当年即成为大客户,引发市场对其业务真实性与可持续性的质疑。同时,公司研发投入占比不足9%,仅拥有3项专利,与AI科技公司定位形成落差。在催收行业监管趋严的背景下,第零智能的商业模式合规风险也备受关注。 #第零智能 #AI智能体 #催收 #港股上市 #监管风险 #商业模式 #科技公司
Apache Burr 实战:状态机构建可恢复 AI Agent 对比 LangGraph
许多 LLM 应用开发者都经历过从简单脚本到复杂状态管理的痛苦转变:初版只需几行 prompt 和模型调用,但随着多轮对话、记忆、人工审批、错误恢复等需求加入,代码迅速膨胀为一团混乱的全局变量和 if/else 分支。Apache Burr 提供了一种基于状态机的架构,显式管理 Agent 的状态流转,支持从任一步骤恢复执行,并可与 LangGraph 进行对比。该实战教程展示了如何利用 Burr 构建可恢复、可重放的 AI Agent,为复杂 LLM 应用提供更可控的状态管理方案。 #ApacheBurr #LangGraph #状态机 #AI代理 #LLM应用 #可恢复性 #实战教程
许多 LLM 应用开发者都经历过从简单脚本到复杂状态管理的痛苦转变:初版只需几行 prompt 和模型调用,但随着多轮对话、记忆、人工审批、错误恢复等需求加入,代码迅速膨胀为一团混乱的全局变量和 if/else 分支。Apache Burr 提供了一种基于状态机的架构,显式管理 Agent 的状态流转,支持从任一步骤恢复执行,并可与 LangGraph 进行对比。该实战教程展示了如何利用 Burr 构建可恢复、可重放的 AI Agent,为复杂 LLM 应用提供更可控的状态管理方案。 #ApacheBurr #LangGraph #状态机 #AI代理 #LLM应用 #可恢复性 #实战教程
近期技术动态:图像修复模型浏览器运行、sqlite-utils更新及Datasette新功能
据最新技术博客文章汇总,Moebius 0.2B图像修复模型已成功通过Claude Code移植至浏览器端运行,实现了在客户端直接进行图像修复任务。同时,sqlite-utils 4.0rc1版本发布,新增数据库迁移支持和嵌套事务功能,大幅提升数据处理灵活性。此外,Datasette推出Apps功能,允许用户在Datasette内部托管自定义HTML应用程序,拓展了数据可视化与部署场景。这些更新均聚焦于优化Web端AI推理能力、数据库工具链及数据平台扩展性。 #技术 #AI #开源 #数据库 #Web应用 #图像修复 #数据工具 #开发者
据最新技术博客文章汇总,Moebius 0.2B图像修复模型已成功通过Claude Code移植至浏览器端运行,实现了在客户端直接进行图像修复任务。同时,sqlite-utils 4.0rc1版本发布,新增数据库迁移支持和嵌套事务功能,大幅提升数据处理灵活性。此外,Datasette推出Apps功能,允许用户在Datasette内部托管自定义HTML应用程序,拓展了数据可视化与部署场景。这些更新均聚焦于优化Web端AI推理能力、数据库工具链及数据平台扩展性。 #技术 #AI #开源 #数据库 #Web应用 #图像修复 #数据工具 #开发者