AI Agent 的每个功能都是缓存失效点
OpenClacky 创始人 Yafei Lee 在技术分享中指出,构建 AI Agent 时,每个新增功能都会以不同方式破坏提示缓存。团队经过两年三代架构迭代,最终实现 90% 以上的缓存命中率。第一代基于 RAG 的系统因成本高、数据陈旧、召回率不足(90% 不够,97% 才勉强达标)而被放弃。第二代多智能体协作架构(规划、编码、审查、测试四个子智能体)虽然 SWEBench 得分不错,但每次交接都导致缓存丢失,任务耗时从 4 分钟增至 14 分钟。最终,团队通过七项工程决策解决了问题:放弃 RAG,直接读取文件或使用 grep 搜索;避免多智能体交接;保持系统提示稳定,将模型特定状态移出系统提示;压缩历史记录时注意前缀一致性等。这些决策让缓存命中率在真实任务中稳定超过 90%。 #AI #Agent #缓存 #工程实践 #OpenClacky #大模型 #性能优化
OpenClacky 创始人 Yafei Lee 在技术分享中指出,构建 AI Agent 时,每个新增功能都会以不同方式破坏提示缓存。团队经过两年三代架构迭代,最终实现 90% 以上的缓存命中率。第一代基于 RAG 的系统因成本高、数据陈旧、召回率不足(90% 不够,97% 才勉强达标)而被放弃。第二代多智能体协作架构(规划、编码、审查、测试四个子智能体)虽然 SWEBench 得分不错,但每次交接都导致缓存丢失,任务耗时从 4 分钟增至 14 分钟。最终,团队通过七项工程决策解决了问题:放弃 RAG,直接读取文件或使用 grep 搜索;避免多智能体交接;保持系统提示稳定,将模型特定状态移出系统提示;压缩历史记录时注意前缀一致性等。这些决策让缓存命中率在真实任务中稳定超过 90%。 #AI #Agent #缓存 #工程实践 #OpenClacky #大模型 #性能优化
Zenfox 推出自主 AI 员工平台,实现 24/7 自动化工作流
Zenfox 发布了一款全新的 AI 代理平台,提供多达 15 个自主 AI 员工,可全天候工作。该平台能无缝连接 Gmail、Slack、HubSpot 等 3000 多个工具,并具备持久记忆能力,可自动执行跟进邮件、监控竞争对手、生成报告等复杂工作流。用户只需用自然语言描述任务,无需编写代码或拖拽模板,系统即可自动分解步骤并执行。Zenfox 还支持跨浏览器、桌面和移动端运行,并能在用户休息时持续处理邮件、更新 CRM 和运营数据。定价方面,提供免费版、Pro 版(15 个自动化、2 个 AI 员工)、Max 版(50 个自动化、5 个 AI 员工)以及企业版,均采用固定费率,无使用计量。该平台旨在让 AI 真正采取行动,而不仅仅是对话。 #AI #自动化 #Zenfox #AI员工 #工作流 #无代码 #SaaS #企业效率 #智能助手
Zenfox 发布了一款全新的 AI 代理平台,提供多达 15 个自主 AI 员工,可全天候工作。该平台能无缝连接 Gmail、Slack、HubSpot 等 3000 多个工具,并具备持久记忆能力,可自动执行跟进邮件、监控竞争对手、生成报告等复杂工作流。用户只需用自然语言描述任务,无需编写代码或拖拽模板,系统即可自动分解步骤并执行。Zenfox 还支持跨浏览器、桌面和移动端运行,并能在用户休息时持续处理邮件、更新 CRM 和运营数据。定价方面,提供免费版、Pro 版(15 个自动化、2 个 AI 员工)、Max 版(50 个自动化、5 个 AI 员工)以及企业版,均采用固定费率,无使用计量。该平台旨在让 AI 真正采取行动,而不仅仅是对话。 #AI #自动化 #Zenfox #AI员工 #工作流 #无代码 #SaaS #企业效率 #智能助手
AI并未摧毁网络,互联网公司才是根源
近年来,多家AI公司高管声称其大语言模型拥有价值观、伦理判断甚至情感意识,例如对Claude“功能性情绪”的讨论。然而,这些系统本质上是处理海量人类内容并生成统计概率响应的软件,所谓智能、道德或情感,不过是人类自身的镜像。真正的危险在于人们开始像对待有意识体一样对待AI,而忽略背后更深层的问题:互联网公司长期以来用平台取代社区、用算法取代编辑、用市场取代政治,AI正是这一趋势的放大器。当人们将AI视为朋友、顾问或治疗师,原本应承担这些功能的人类机构持续被削弱。道德与伦理诞生于家庭、社区、文化等社会过程,AI只能复现伦理语言,无法替代真实的人际互动和责任承担。 #AI #大模型 #科技 #互联网 #伦理 #社会 #算法 #平台 #反思
近年来,多家AI公司高管声称其大语言模型拥有价值观、伦理判断甚至情感意识,例如对Claude“功能性情绪”的讨论。然而,这些系统本质上是处理海量人类内容并生成统计概率响应的软件,所谓智能、道德或情感,不过是人类自身的镜像。真正的危险在于人们开始像对待有意识体一样对待AI,而忽略背后更深层的问题:互联网公司长期以来用平台取代社区、用算法取代编辑、用市场取代政治,AI正是这一趋势的放大器。当人们将AI视为朋友、顾问或治疗师,原本应承担这些功能的人类机构持续被削弱。道德与伦理诞生于家庭、社区、文化等社会过程,AI只能复现伦理语言,无法替代真实的人际互动和责任承担。 #AI #大模型 #科技 #互联网 #伦理 #社会 #算法 #平台 #反思
上下文学习中思维链的渐近理论论文发布
一项关于思维链(Chain-of-Thought)在上下文学习中渐近理论的研究论文近期在arXiv上提交。该论文由Kaito Takanami等人撰写,提交日期为2026年6月2日,题为“An Asymptotic Theory of Chain-of-Thought in In-Context Learning”。论文旨在从理论角度分析思维链机制在上下文学习中的渐进性能,探索其如何影响模型在少样本场景下的推理能力。研究可能涉及统计学习理论、大语言模型的泛化边界等核心问题,为理解思维链的数学基础提供新视角。目前论文以PDF和HTML格式公开,并附有BibTeX引用数据及相关学术工具链接。 #论文 #AI #思维链 #上下文学习 #机器学习 #理论 #大模型
一项关于思维链(Chain-of-Thought)在上下文学习中渐近理论的研究论文近期在arXiv上提交。该论文由Kaito Takanami等人撰写,提交日期为2026年6月2日,题为“An Asymptotic Theory of Chain-of-Thought in In-Context Learning”。论文旨在从理论角度分析思维链机制在上下文学习中的渐进性能,探索其如何影响模型在少样本场景下的推理能力。研究可能涉及统计学习理论、大语言模型的泛化边界等核心问题,为理解思维链的数学基础提供新视角。目前论文以PDF和HTML格式公开,并附有BibTeX引用数据及相关学术工具链接。 #论文 #AI #思维链 #上下文学习 #机器学习 #理论 #大模型
轨迹感知节点贡献与静态可控性极限研究
一篇名为《轨迹感知节点贡献与静态可控性的极限》的学术论文近日出现在arXiv预印本平台。该论文由Valentina Kuskova等三位作者完成,探讨了在网络控制理论中,传统静态可控性分析方法忽略了节点随时间变化的贡献,从而限制了控制能力的边界。研究提出了“轨迹感知节点贡献”的概念,旨在更准确地评估每个节点在不同动态路径中的实际作用。通过对理论模型的分析,作者揭示了静态可控性框架下存在的隐含约束,为复杂网络调控提供了新的视角。该工作对社交网络、交通系统及生物网络等领域的控制策略设计具有潜在指导意义。 #网络控制 #轨迹感知 #可控性 #复杂网络 #科研论文 #arXiv #动态系统
一篇名为《轨迹感知节点贡献与静态可控性的极限》的学术论文近日出现在arXiv预印本平台。该论文由Valentina Kuskova等三位作者完成,探讨了在网络控制理论中,传统静态可控性分析方法忽略了节点随时间变化的贡献,从而限制了控制能力的边界。研究提出了“轨迹感知节点贡献”的概念,旨在更准确地评估每个节点在不同动态路径中的实际作用。通过对理论模型的分析,作者揭示了静态可控性框架下存在的隐含约束,为复杂网络调控提供了新的视角。该工作对社交网络、交通系统及生物网络等领域的控制策略设计具有潜在指导意义。 #网络控制 #轨迹感知 #可控性 #复杂网络 #科研论文 #arXiv #动态系统
类型错误消融与AI编码代理研究取得新进展
一篇题为《Type-Error Ablation and AI Coding Agents》的学术论文在arXiv预印本平台发布。该论文由Shriram Krishnamurthi与Matthew Flatt共同撰写,聚焦于AI编码代理中的类型错误消融技术。研究探讨了如何通过移除或修改类型错误信息,来评估和改善AI编程助手在代码生成、调试及错误修复任务中的表现。这项工作对于理解大型语言模型在编程场景下的鲁棒性具有重要意义,可能为未来开发更可靠的AI编码工具提供理论基础。论文已开放PDF和HTML版本供学界下载。 #AI编程 #类型系统 #代码生成 #arXiv #机器学习
一篇题为《Type-Error Ablation and AI Coding Agents》的学术论文在arXiv预印本平台发布。该论文由Shriram Krishnamurthi与Matthew Flatt共同撰写,聚焦于AI编码代理中的类型错误消融技术。研究探讨了如何通过移除或修改类型错误信息,来评估和改善AI编程助手在代码生成、调试及错误修复任务中的表现。这项工作对于理解大型语言模型在编程场景下的鲁棒性具有重要意义,可能为未来开发更可靠的AI编码工具提供理论基础。论文已开放PDF和HTML版本供学界下载。 #AI编程 #类型系统 #代码生成 #arXiv #机器学习
微软发布MAI-Code-1-Flash,主打用更少token解决更难问题
微软近日推出了名为MAI-Code-1-Flash的代码生成模型,其核心卖点是“用更少token解决更难问题”。该模型旨在通过优化token使用效率,提升对复杂代码问题的处理能力,从而在降低推理成本的同时保持高准确率。MAI-Code-1-Flash主要面向开发者社区,可用于代码补全、生成和问题解答等场景。这一发布标志着微软在代码AI领域的持续投入,试图为解决高级编程问题提供更经济的方案。目前官方尚未披露详细技术参数及性能对比数据,但业界已对其效率提升前景表示关注。 #微软 #MAICode1Flash #代码生成 #AI #大模型 #效率优化 #token #编程
微软近日推出了名为MAI-Code-1-Flash的代码生成模型,其核心卖点是“用更少token解决更难问题”。该模型旨在通过优化token使用效率,提升对复杂代码问题的处理能力,从而在降低推理成本的同时保持高准确率。MAI-Code-1-Flash主要面向开发者社区,可用于代码补全、生成和问题解答等场景。这一发布标志着微软在代码AI领域的持续投入,试图为解决高级编程问题提供更经济的方案。目前官方尚未披露详细技术参数及性能对比数据,但业界已对其效率提升前景表示关注。 #微软 #MAICode1Flash #代码生成 #AI #大模型 #效率优化 #token #编程
微软发布Intelligent Terminal 0.1:基于Windows Terminal的开源实验性分支
微软近日发布了Intelligent Terminal 0.1版本,这是一个基于Windows Terminal的开源实验性分支。该项目旨在探索将人工智能能力深度集成到终端工具中,例如智能命令补全、自然语言交互等功能。作为实验性分支,Intelligent Terminal保持了与Windows Terminal相同的开源属性,开发者可参与测试和反馈。此举标志着微软在终端工具智能化方向上的初步尝试,未来或将影响开发者日常命令行工作流的效率提升。 #微软 #IntelligentTerminal #WindowsTerminal #开源 #AI #终端工具 #开发者
微软近日发布了Intelligent Terminal 0.1版本,这是一个基于Windows Terminal的开源实验性分支。该项目旨在探索将人工智能能力深度集成到终端工具中,例如智能命令补全、自然语言交互等功能。作为实验性分支,Intelligent Terminal保持了与Windows Terminal相同的开源属性,开发者可参与测试和反馈。此举标志着微软在终端工具智能化方向上的初步尝试,未来或将影响开发者日常命令行工作流的效率提升。 #微软 #IntelligentTerminal #WindowsTerminal #开源 #AI #终端工具 #开发者
微软Build大会发布新模型与智能体,特朗普放松AI审查
2026年6月3日,微软Build开发者大会聚焦先进语言模型和自主代理,推出可无缝集成企业工作流的新工具,旨在帮助开发者构建可扩展的Azure解决方案,实现数据分析自动化并提升生产力。同时,美国前总统特朗普签署行政命令软化AI审查,降低大型项目监管门槛,使初创公司能更快获得资金并与巨头竞争AI基础设施领域。此外,Claude新增幻灯片功能,简化营销演示制作;好莱坞导演开始拥抱AI,用于剧本和视觉效果,预计可降低制作成本30%。业界认为,政策支持与工具创新将推动2027年前AI市场增长,企业需平衡快速部署与治理框架,并投资培训解决技能缺口。 #微软Build #AI智能体 #特朗普 #AI监管 #Claude #幻灯片 #好莱坞AI #企业AI #科技新闻
2026年6月3日,微软Build开发者大会聚焦先进语言模型和自主代理,推出可无缝集成企业工作流的新工具,旨在帮助开发者构建可扩展的Azure解决方案,实现数据分析自动化并提升生产力。同时,美国前总统特朗普签署行政命令软化AI审查,降低大型项目监管门槛,使初创公司能更快获得资金并与巨头竞争AI基础设施领域。此外,Claude新增幻灯片功能,简化营销演示制作;好莱坞导演开始拥抱AI,用于剧本和视觉效果,预计可降低制作成本30%。业界认为,政策支持与工具创新将推动2027年前AI市场增长,企业需平衡快速部署与治理框架,并投资培训解决技能缺口。 #微软Build #AI智能体 #特朗普 #AI监管 #Claude #幻灯片 #好莱坞AI #企业AI #科技新闻
亚马逊云科技发布Agentic AI系列产品,重塑企业运营流程
亚马逊云科技近日举行沟通会,详解其在Agentic AI方向的最新布局。该公司解决方案架构总经理陈晓建指出,AI正从被动响应助手转变为能自主推理、规划和执行的“队友”,未来企业内部每个领域都将有数十亿个Agent在运营。此次发布的三大进展包括:面向办公场景的Amazon Quick桌面版,可通过自然语言调用地图、浏览器等工具自动生成方案;拓展后的Amazon Connect系列,覆盖客户服务、供应链决策、人才招聘和医疗健康等场景,其中Amazon Connect Decisions整合多个Agent形成需求预测与供应规划闭环,Amazon Connect Talent则支持AI语音面试与评分辅助,最终决策仍由招聘官掌握;此外,亚马逊云科技与OpenAI深化合作,将OpenAI模型、编程Agent Codex等接入Amazon Bedrock,并推出托管Agent服务。陈晓建表示,这些产品源于“逆向工作法”,80%以上来自客户需求,旨在以AI加人的方式推动企业从零开始重塑流程。 #亚马逊云科技 #AgenticAI #AI #AmazonQuick #AmazonConnect #OpenAI #供应链 #招聘 #科技新闻
亚马逊云科技近日举行沟通会,详解其在Agentic AI方向的最新布局。该公司解决方案架构总经理陈晓建指出,AI正从被动响应助手转变为能自主推理、规划和执行的“队友”,未来企业内部每个领域都将有数十亿个Agent在运营。此次发布的三大进展包括:面向办公场景的Amazon Quick桌面版,可通过自然语言调用地图、浏览器等工具自动生成方案;拓展后的Amazon Connect系列,覆盖客户服务、供应链决策、人才招聘和医疗健康等场景,其中Amazon Connect Decisions整合多个Agent形成需求预测与供应规划闭环,Amazon Connect Talent则支持AI语音面试与评分辅助,最终决策仍由招聘官掌握;此外,亚马逊云科技与OpenAI深化合作,将OpenAI模型、编程Agent Codex等接入Amazon Bedrock,并推出托管Agent服务。陈晓建表示,这些产品源于“逆向工作法”,80%以上来自客户需求,旨在以AI加人的方式推动企业从零开始重塑流程。 #亚马逊云科技 #AgenticAI #AI #AmazonQuick #AmazonConnect #OpenAI #供应链 #招聘 #科技新闻