AI知识库 @ai521
345 subscribers
23.7K photos
42 videos
20 files
904 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
新研究提出多智能体系统提示与通信拓扑协同进化新方法

研究人员发布了一篇题为《TCP-MCP:面向多智能体系统的地形引导提示与通信拓扑协同进化》的论文。该研究探讨了在复杂的多智能体系统中,如何共同优化智能体的交互提示(prompts)与它们之间的通信网络结构(拓扑),以提升系统整体的任务执行效能。论文提出了一种名为“地形引导”的方法,将问题优化过程类比为在景观中寻找最优路径,从而协同演化出更有效的提示策略和通信模式。这项研究由Yi Ding等多位作者共同完成,于2026年5月提交至arXiv平台。该工作旨在为设计更高效、更自适应的多智能体协作框架提供新的理论和方法支撑。 #人工智能 #多智能体系统 #机器学习 #算法优化 #学术论文 #提示工程 #通信拓扑 #协同进化 #智能系统
新型优化方法EAPO提升开放式问答策略表现

研究人员提出一种名为EAPO的新方法,通过基于熵的自适应正负样本加权技术,优化开放式问答中的策略学习过程。该方法旨在解决传统策略优化中正负样本利用效率不均衡的问题,通过动态调整不同样本的权重,使模型能更有效地从多样化反馈中学习。论文表明,EAPO在提升开放式问答任务的策略优化效果方面展现出潜力,为相关领域的模型训练提供了新的思路。 #论文 #人工智能 #自然语言处理 #问答系统 #机器学习 #策略优化 #AI研究
新论文提出高风险AI系统治理框架

随着人工智能技术在医疗、金融等关键领域的深入应用,其部署安全与治理问题成为全球关注的焦点。2026年5月27日,学者Khalid Adnan Alsayed在预印本平台arXiv上提交了一篇研究论文,标题为《操作性AI部署保障:阈值敏感部署条件下的治理-状态协调——高风险AI系统的治理框架》。该论文针对高风险AI系统在动态部署环境中的挑战,提出了一套完整的治理框架,核心在于通过协调治理机制与系统状态来应对阈值敏感条件,确保AI的可靠性与安全性。此框架不仅为技术开发者提供了实操指南,也为监管机构和政策制定者注入了理论支持,有望推动行业标准的建立,增强公众对AI应用的信任。 #AI治理 #学术论文 #人工智能 #高风险系统 #安全部署 #arXiv #技术创新 #政策研究
新论文揭示算法演绎电路在逻辑推理中的应用

2026年5月27日,一篇题为《揭示用于逻辑推理的算法演绎电路》的论文在arXiv预印本平台正式提交。该研究由Phuong Minh Nguyen等作者共同完成,论文探讨了算法演绎电路在逻辑推理任务中的应用机制,旨在为相关算法设计提供新思路。目前,论文的PDF版本和HTML实验版均已发布,同时公开了代码、数据等资源链接。这一成果可能对人工智能、认知科学和计算机逻辑推理领域的发展产生推动作用,为未来研究提供参考。 #论文 #arXiv #逻辑推理 #算法 #人工智能 #学术研究 #AI #科技新闻
EgoBench:面向工具使用智能体的交互式自我中心多模态基准发布

研究人员提出了一种名为 EgoBench 的新型多模态基准测试,该测试专注于从第一人称(自我中心)视角评估智能体使用工具的能力。该基准具有交互性特点,旨在为开发能够理解环境并与之交互的 AI 智能体提供更贴近现实场景的评测标准。该研究论文已由 Yunqi Liu 等作者提交至 arXiv 预印本平台,发布时间为 2026 年 5 月。EgoBench 的推出有望推动相关领域在具身智能、人机交互及工具使用理解方面的研究进展。 #EgoBench #多模态AI #智能体 #基准测试 #arXiv #AI研究 #计算机科学 #人机交互
Robinhood 推出 AI 代理交易与代理信用卡,开启自主金融服务

金融科技券商 Robinhood 于 5 月 27 日正式发布了两款基于 AI 智能体的创新产品:代理交易与代理信用卡。这标志着金融服务模式从“AI 提供建议”向“AI 自主执行”的关键转变。通过其模型上下文协议(MCP)服务器,用户可将自己的第三方 AI 智能体接入 Robinhood 平台,直接操作交易和银行基础设施。 在代理交易中,AI 智能体可在独立于用户主账户的专用账户内,自动执行投资组合分析、资产再平衡等策略,目前 Beta 版仅支持股票交易。代理信用卡则关联一张虚拟卡,让 AI 在设定的月度消费限额和安全规则(如人工审批)下,自动完成网络购物、抢票等任务。为确保安全,用户可实时监控 AI 操作、一键断开连接,平台亦提供专门的争议解决服务。 目前,这两项服务优先向 Robinhood Gold Card 持有者开放。此举被视为金融行业在 AI 应用上的激进探索,旨在推动金融民主化与自动化,未来可能引发行业效仿。 #金融科技 #AI智能体 #代理交易 #自主金融 #自动化 #Robinhood
约束自动竞价新方法

近日,一篇题为《Constrained Auto-Bidding via Generative Response Modeling》的学术论文在arXiv平台上正式发布,作者包括Eunseok Yang及其他两位研究者。该论文于2026年5月27日提交,提出了一种通过生成式响应建模来实现约束自动竞价的新方法。在自动竞价系统中,处理复杂约束条件一直是技术难点,该方法旨在利用生成模型更灵活地应对竞价中的限制,可能应用于在线广告、电力市场等需要动态竞价的领域。论文提供了完整版本供查阅,包括PDF和HTML格式,但具体技术实现和实验结果需进一步参考原文。这一研究为自动竞价技术的发展提供了新思路,有望推动相关领域的创新应用。 #学术论文 #人工智能 #自动竞价 #生成式模型 #计算机科学 #arXiv #广告技术 #机器学习
新算法 GraD

研究人员提出了一种名为 GraD-IBD 的新型图表示学习算法,用于通过分析患者的诊断轨迹数据,实现对炎症性肠病的早期检测。该模型由 Leo Y. Li-Han 等人开发,其核心思路是将患者的多次就诊与诊断记录构建为图结构,从而捕捉疾病发展的动态模式与潜在关联。 该算法旨在克服传统方法在利用纵向、异构医疗数据方面的局限,通过对诊断序列的深度学习,识别出可用于早期预警的关键特征。这项研究为利用人工智能技术提升慢性疾病的早期发现率提供了新的技术路径,有望在未来辅助临床决策,实现更及时的医疗干预。 #医学AI #早期诊断 #图表示学习 #炎症性肠病 #医疗科技 #科研进展 #算法研究
新论文提出LLM评估新标准:固定预算与集群感知结合多跳RAG压力测试

2026年5月27日,研究人员Camilo Chacón Sartori和José H. García在学术平台arXiv上发布了一篇研究论文,提出了一种针对大语言模型(LLM)评估的创新标准。该标准名为“固定预算、集群感知的LLM-as-a-Judge评估”,旨在解决现有评估方法中可能存在的公平性和效率问题。论文通过引入固定预算限制来控制评估成本,并利用集群感知技术优化模型在不同数据分组上的表现分析。作者还设计了多跳RAG压力测试,对标准进行了严格验证,以检验其在复杂、多步骤推理任务中的鲁棒性。这项研究为AI模型评估领域提供了新的基准框架,可能推动未来LLM开发的优化,并促进评估方法在学术界和工业界的更广泛应用。 #LLM #AI #评估标准 #RAG #压力测试 #学术论文 #大语言模型 #机器学习 #研究发布 #技术前沿
Kenny Daniel 提交“代理查询引擎”论文至学术平台 arXiv

2026年5月27日,研究人员 Kenny Daniel 在知名学术预印本服务器 arXiv 上提交了一篇题为《A Query Engine for the Agents》的论文。该论文聚焦于为代理系统设计一个高效的查询引擎,旨在优化代理与数据源的交互及处理能力,属于人工智能或计算机科学领域的技术研究。论文文件大小为15KB,目前可通过PDF、HTML及TeX源码等多种格式访问,表明其内容已进入初步传播阶段。作为学术社区的重要平台,arXiv 通过 arXivLabs 实验项目支持研究者协作开发新功能,推动开放科学实践。此论文的发布可能为代理技术、数据查询系统等领域提供新的工具和方法,促进相关研究的进一步发展。 #arXiv #论文 #代理系统 #查询引擎 #AI #学术研究 #科技新闻 #计算机科学
研究团队提出大语言模型智能体运行时指令冲突的诊断新方法

近期,由Lu Yan等人组成的研究团队提交了一项关于大语言模型智能体的新研究,旨在解决其在实际运行时可能遇到的“策略内指令冲突”问题。论文提出了一种名为“见证解决概况”的新诊断框架,能够实时检测和识别LLM智能体在处理多个指令时可能产生的内部逻辑矛盾。该方法有助于提高模型在复杂任务中的可靠性和安全性,对于推动LLM智能体在现实世界中的稳定应用具有重要意义。论文已于2026年5月27日提交至arXiv平台。 #大语言模型 #人工智能 #AI安全 #智能体 #学术研究 #LLM #技术前沿
新论文提出可审计决策模型,集成学习式弃权与实时转向能力

近日,一篇题为“具有学习式弃权和实时转向的可审计决策模型”的学术论文在arXiv平台正式发布。该研究由Sankaranarayanan Palamadai Chandrasekaran等人提出,于2026年5月26日提交。论文聚焦于人工智能决策系统的透明度和可控性,创新性地引入学习式弃权机制,使模型在面临不确定性时能够主动弃权以提升可靠性,并结合实时转向功能,允许在运行中动态调整决策策略。这一方法旨在增强AI模型的可审计性,为其在医疗诊断、自动驾驶等高风险领域的应用提供更安全的基础。论文提供了PDF下载和实验性HTML版本,供学术界参考与验证。该成果有望推动可解释AI和负责任人工智能的发展,为未来智能系统的设计开辟新路径。 #人工智能 #机器学习 #决策模型 #学术研究 #arXiv #AI安全 #可解释AI
新研究揭示LLM代理在多系统中隐私泄露风险

2026年5月26日,一篇题为“有秘密?LLM代理守不住:评估多代理系统中的隐私”的论文在学术平台arXiv上正式提交。该研究由Aman Priyanshu等研究人员进行,重点探讨了大型语言模型(LLM)代理在多代理协作环境中的隐私保护能力。论文指出,随着LLM代理在复杂任务中的广泛应用,其信息交互过程可能存在隐私泄露隐患,这对系统安全构成挑战。研究通过评估框架分析了相关风险,为多代理系统的设计优化提供了参考依据,有望推动人工智能安全领域的进一步关注。 #LLM #多代理系统 #隐私 #AI安全 #研究 #arXiv #科技新闻 #人工智能
研究者提出参数化具身智能体记忆框架PEAM

一项最新研究提出了名为PEAM(参数化具身智能体记忆)的新框架,旨在通过对比学习的方式,让在《我的世界》等复杂环境中行动的具身智能体更有效地内化和利用经验记忆。该研究由郭雨辰等人完成,相关论文已在arXiv平台发布。与传统方法不同,PEAM试图将过往经验参数化,使智能体能够通过内部对比机制进行学习和决策,从而提升其在开放环境中的适应能力与行为效率。这一方法有望为游戏智能体、机器人探索及虚拟环境模拟等领域的研究提供新的思路。 #人工智能 #游戏智能体 #强化学习 #机器学习 #计算机科学 #具身智能 #我的世界 #研究论文
新研究提出SkillGrad方法,借鉴梯度下降优化智能体技能

一篇题为《SkillGrad: Optimizing Agent Skills Like Gradient Descent》的学术论文近日在预印本平台arXiv发布。该研究由Hanyu Wang等人提出,其核心思想是将梯度下降这一经典优化算法,创新性地应用于智能体技能的学习与优化过程。这种方法旨在为智能体提供一种系统化的技能改进框架,使其能够像神经网络调整参数一样,更高效地习得和提升复杂技能。 该研究的主要意义在于,它为强化学习及多智能体系统中的技能学习问题提供了一个新的理论视角和潜在的高效优化路径,有望推动智能体在复杂环境中的自适应能力与发展。 #人工智能 #智能体 #机器学习 #学术论文 #技术研究 #SkillGrad #优化方法 #多智能体
MiniMax全球企业和开发者客户突破百万,ARR收入近两月翻番

5月28日,生成式人工智能公司MiniMax披露最新业务数据,宣布其服务的全球企业和开发者客户数量正式突破100万,全球用户基数约3亿。这一进展表明B端企业客户群较半年前增长五倍,公司商业化引擎已全面进入垂直加速阶段。当前,全球大模型行业正从技术涌现转向商业落地,MiniMax的核心数据激增,不仅证明了其M2系列模型在企业级应用中的高适应性和技术粘性,也反映了全球开发者对高性价比、高稳定性AI基础设施的蓬勃需求。作为中国人工智能公司,MiniMax致力于通用人工智能探索,其商业化路径的成功为大模型行业如何从技术投资走向高质量商业变现提供了具有参考价值的行业模型。 #MiniMax #人工智能 #大模型 #商业 #科技新闻 #AI #生成式AI #客户增长
教皇发布通谕反思人工智能,强调人类有限性与尊严

梵蒂冈近日发布由教皇利奥十四世签署的250页通谕《光辉的人性》(Magnifica Humanitas),这是首份正式探讨人工智能的官方天主教文件。通谕的核心并非仅仅警示AI的风险,而是旨在捍卫人性,反对那些对人类共同本质感到厌倦的观点,并警告社会不要将人类的能力——如理性、创造力、同情心——轻易外包给计算机。教皇提出一个关键洞见:人类的许多美好正源于其有限性而非无限性,这种接纳自身脆弱、苦难与失败的状态,是认识自我与他人尊严的基础。 这份文件延续了基督教批判炫目技术的传统,类比工业革命带来生产力提升的同时也催生了新的剥削形式。在硅谷部分声音质疑人类价值的当下,通谕明确反对将人类的有限性视为缺陷。文中虽未点名,但回应了像彼得·蒂尔等科技投资者所倾向的、将道德等决策完全交由超级智能AI的观点。通谕认为,正是人类的局限激发了同情与反思,并赋予伟大艺术以美感,这是机器生成的文学所缺乏的。该文件是对当前技术发展潮流的一次重要人文主义介入。 #人工智能 #梵蒂冈 #教宗通谕 #科技伦理 #人文主义 #宗教与科技 #AI争议 #新闻
前谷歌、苹果研究员创立Trajectory,构建AI持续学习平台

一群曾任职于谷歌DeepMind、苹果、OpenAI及Meta超级智能实验室的AI研究人员宣布成立新创公司Trajectory,旨在构建一个能让AI通过真实用户交互持续学习的平台。目前,即使是最先进的AI模型在完成训练后也会停止进化,无法从错误中实时学习,而持续学习能力被业界公认为实现更强大AI的关键障碍。图灵奖得主Richard Sutton等人亦强调其重要性。 Trajectory已完成由Conviction领投的1500万美元种子轮融资,估值达1.15亿美元,投资方还包括谷歌DeepMind首席科学家Jeff Dean及斯坦福教授李飞飞等知名人士。公司联合创始人及CEO Ronak Malde指出,一些领先的AI编程产品已通过利用用户交互数据进行后训练和持续改进取得了成功,Trajectory希望将这一模式应用于编程之外的更广泛领域。不过,他也承认将此逻辑应用于其他行业存在挑战,因为不同领域对于“成功”的定义可能更模糊,而公司的平台旨在帮助企业针对其特定需求优化AI模型。
研究揭示LLM置信度校准中协议敏感性的重要性

近日,一篇题为《仅有询问是不够的:LLM置信度校准中的协议敏感性》的学术论文在arXiv平台发布。该研究由Hankyeol Kim和Pilsung Kang于2026年5月提交,探讨了在评估大型语言模型置信度时,评估协议的敏感性如何显著影响校准结果。研究指出,传统上仅通过直接询问来校准LLM置信度的方法存在局限性,因为协议的细微变化可能导致模型输出可靠性的评估出现偏差。这一发现强调了在AI模型评估中需要更精细地设计协议,以提高校准的准确性和稳健性。该研究为大语言模型的开发和评估提供了新的理论视角,可能推动相关领域制定更标准化的评估流程,从而增强AI系统在实际应用中的安全性和可靠性。 #AI #大模型 #LLM #置信度校准 #学术研究 #arXiv #计算机科学 #人工智能 #机器学习
面向智能体大语言模型服务的策略驱动运行时层

该论文提出了一种专为智能体大语言模型服务设计的“策略驱动运行时层”新框架。研究背景是,随着能执行复杂任务的智能体系统兴起,其服务部署面临独特的动态性与可靠性挑战。该框架通过引入可编程的策略层,在运行时动态管理智能体与LLM的交互、资源分配及错误处理。它旨在提升智能体LLM服务的可扩展性、稳健性与效率,为构建更强大、可靠的下一代智能体应用提供了底层系统支持。 #AI #LLM #大模型 #智能体 #机器学习 #系统优化 #云计算 #学术论文 #计算机科学