AI知识库 @ai521
708 subscribers
30.2K photos
59 videos
27 files
1.25K links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
上海AI Lab提出MemHarness框架:像人类一样重构经验,显著提升LLM Agent决策能力

上海人工智能实验室(上海AI Lab)近日提出了名为MemHarness的创新框架,旨在通过模拟人类经验重构的方式,显著提升大语言模型(LLM)代理的决策能力。该框架借鉴了人类认知中经验重组的过程,使LLM Agent能够更有效地利用历史经验进行决策,从而在多种复杂任务中取得更好效果。与传统方法不同,MemHarness强调动态调整经验表示,让代理能够像人类一样从过往经历中学习并优化未来决策。这一创新方法有望推动AI代理在自主决策和适应性方面的进步,为人工智能领域带来新的突破,尤其在需要长期规划和复杂推理的场景中具有重要应用前景。 #上海AI Lab #MemHarness #LLM #Agent #决策能力 #人工智能 #框架 #经验重构 #AI代理
上海AI Lab团队提出MemHarness框架,让LLM Agent像人类一样灵活调用经验

据媒体报道,上海AI Lab团队提出了一种名为MemHarness的新框架,旨在让大语言模型(LLM)智能体像人类一样灵活调用过往经验。该框架通过创新的记忆机制,使智能体能够更高效地利用历史信息,从而在多个任务上显著提升性能。这一成果为提升LLM智能体的自主决策与适应能力提供了新思路,有望推动人工智能在复杂场景中的应用。 #上海AI Lab #MemHarness #LLM #Agent #人工智能 #机器学习 #科技
GPT

电玩巴士网站上一则标题声称GPT-5震撼发布、AI能力再破天花板的新闻页面返回404错误,无法获取具体报道内容。该页面标题暗示GPT-5已发布,但页面内容完全缺失,无法提供任何细节信息。目前OpenAI官方尚未公布GPT-5,该消息真实性存疑,可能为标题党或虚假信息。GPT-5作为AI领域备受期待的下一代大模型,其发布传闻一直不断,但此次来源不明且页面无法访问,引发网友对消息可靠性的质疑。建议读者以官方渠道为准,谨慎对待此类未经证实的消息。 #GPT5 #AI #科技 #传闻 #电玩巴士 #404
Transformer模型训练到推理全流程解析

本章节系统阐述了解码器专用Transformer模型的核心工作流程,主要涵盖四个关键部分:自回归生成、预填充与解码阶段、简易KV缓存实现以及KV缓存的内存占用分析。自回归生成是模型根据已有token序列逐次预测下一个token的过程,每次预测仅依赖前面所有已生成token。预填充阶段负责处理用户输入的初始提示词,生成首个输出token及其对应的KV缓存;解码阶段则利用已缓存的键值对逐步生成后续token,避免重复计算。KV缓存通过存储历史注意力层的键值矩阵,显著提升推理效率,但也会占用大量内存。文章指出,随着序列长度增加,KV缓存的内存需求呈线性增长,对长文本生成场景提出了挑战。 #Transformer #自回归生成 #KV缓存 #深度学习 #AI推理 #模型部署 #技术新闻
用户向AI助手提出的常见问题类型分析

某AI助手开发公司通过分析用户在其集成产品中的提问,发现尽管产品功能各异,但用户困惑高度集中在几个常见领域。最常见的是金钱相关问题,如账单、退款、税费、发票等,这类问题因涉及切身利益且界面解释不足而频繁出现;其次是导航问题,用户常询问界面功能、设置位置、图标含义等,产品功能越多,用户越容易迷失;权限管理也是高频困惑,用户对角色、访问控制模型感到费解;仪表盘指标含义、复杂设置流程、集成后的同步故障、消息发送失败、数据保存异常等问题同样突出。此外,用户还频繁要求对已有功能获得更多控制权。这些共性问题揭示了产品设计中的常见盲点。 #AI助手 #用户研究 #产品设计 #用户体验 #常见问题 #金钱 #权限 #导航 #集成 #数据同步
中国大模型攻击实验室,研究人员反制并控制AI代理

据Jesta Security实验室披露,他们遭遇了首次由大语言模型管理的实时网络攻击。一个名为deepseek-v4-flash-free的AI代理持续5天试图攻入实验室,研究人员识别出该模型并成功反制,控制了攻击代理。调查发现,该攻击已造成超过1000名受害者,且攻击者每秒都在生成新的攻击。研究人员通过设置诱饵环境,捕获了异常行为,最终追溯到一个中国的AI攻击者。这是首次在真实攻击中识别出具体模型,并实现了对AI代理的控制。此事凸显了AI自主发动网络攻击的严峻趋势,此前已有AI代理独立完成勒索软件攻击的案例。 #中国 #大模型 #AI攻击 #网络安全 #DeepSeek #代理劫持 #网络防御 #AI安全
微软发布 Orchard 开源框架,推动可扩展智能体 AI 研究

人工智能正从静态问答向自主智能体演进,但构建先进智能体系统常依赖专有基础设施,阻碍了研究社区的发展。为此,微软推出 Orchard 开源框架,其核心 Orchard Env 是基于 Kubernetes 的轻量级环境,可并行创建和管理数千个隔离组件,支持软件工程、网页浏览、个人助理等多种任务类型。框架还发布了三个领域训练方案(Orchard-SWE、Orchard-GUI、Orchard-Claw)及配套训练数据和评估方法。Orchard 的关键创新在于将运行时环境设计为独立可复用服务,并允许智能体在真实部署所用的复杂 harness(如 Claude Code、Codex)中端到端训练,解决了当前训练与部署不匹配的瓶颈,为开放智能体系统研究提供了可扩展的基础设施。 #微软 #Orchard #开源 #智能体AI #AI框架 #Kubernetes #机器学习 #人工智能 #研究工具
亚马逊计划整合Nova AI模型,转向单一前沿模型

据Business Insider报道,亚马逊正计划调整其AI战略,从拥有文本、图像、视频等多款模型转向整合为一款单一的多模态前沿模型,可能仍沿用Nova品牌。此次调整涉及淘汰Premier、Omni、Canvas图像生成和Reel视频生成等模型。亚马逊发言人表示,公司持续根据客户需求迭代模型组合,并投资下一代前沿模型研究。与此同时,亚马逊在其通用人工智能部门进行了裁员,以支持更集中的开发策略。尽管亚马逊已向Anthropic投资250亿美元并承诺追加200亿美元,同时将GPT和Codex引入AWS,但其自研模型在市场份额上仍落后于行业领先者。AWS收入虽同比增长28%,但增速不及谷歌云和甲骨文。战略收缩可能影响AI原生手机等硬件计划,对AWS客户而言,亚马逊或将更专注于提供基础设施和第三方模型。 #亚马逊 #AI #大模型 #Nova #AWS #科技新闻 #战略调整 #人工智能
微软计划将 Xbox 360 游戏引入 PC 平台

据 The Verge 获取的一份泄露文件显示,微软在宣布将初代 Xbox 游戏带到 PC 后,正进一步计划允许开发者将 Xbox 360 游戏移植至 PC。文件指出,Xbox 360 游戏将能在下一代 Project Helix 主机、“Xbox PC”以及手持设备上运行。此举旨在扩展微软游戏生态,让经典作品在更多平台焕发新生,同时为开发者提供更广泛的受众覆盖。 #微软 #Xbox360 #PC游戏 #ProjectHelix #游戏新闻 #跨平台
TokenMaxxer 上线

TokenMaxxer 是一款面向开发者的新工具,能够从 18 种编码工具(如 Claude Code、Codex、Cursor 等)中读取 AI Token 使用数据,并以精美仪表盘展示消耗量、成本及去向。该工具采用只读 CLI 收集本地使用元数据,确保提示词和代码不离开本地,默认隐私保护,用户可选择公开参与全球排行榜。排行榜显示最重度 AI 用户,按 Token 消耗排名,并支持切换查看花费。TokenMaxxer 旨在帮助开发者清晰掌握 AI 工具使用情况,优化成本,并加入社区竞争。 #TokenMaxxer #AI #Token追踪 #开发者工具 #编程 #排行榜 #隐私保护 #成本优化