AI知识库 @ai521
345 subscribers
23.7K photos
42 videos
20 files
904 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
具身智能算子与基准研究

一项关于具身智能的研究提出"具身算子"概念,并构建了相应的基准测试框架,旨在推动智能系统走向可复用与可部署。该论文由Junwu Xiong等13位作者共同完成,于2026年7月3日提交至arXiv预印本平台。研究团队提出了具身算子的标准化定义,将其作为智能系统的基本功能模块,并设计了配套的基准测试方法,评估算子在多种现实场景下的表现。这项工作的核心目标是解决当前具身智能领域存在的碎片化问题,通过建立统一的算子库和评估体系,降低智能体开发与部署的门槛,促进研究成果的实际应用。论文以PDF格式发布,附带HTML预览和TeX源码,目前收录于计算机科学分类下,并可通过Google Scholar、Semantic Scholar等学术工具检索引用。 #具身智能 #AI算子 #基准测试 #arXiv #智能系统 #计算机科学 #可复用AI
组织记忆赋能智能业务流程执行

研究人员提出了一种名为“组织记忆”的新框架,旨在提升代理化业务流程执行的智能化水平。该论文由Lukas Kirchdorfer等人撰写,并已在arXiv平台发布。传统业务流程执行依赖预定义规则,难以适应动态变化。该研究通过构建一个可存储、检索和复用历史执行经验与知识的“组织记忆”系统,使智能代理能够根据过往案例和最佳实践,更灵活、高效地处理复杂业务。初步实验表明,该方法在任务完成效率和准确性上均有显著提升,为下一代企业业务流程自动化提供了新思路。 #arXiv #人工智能 #智能代理 #业务流程 #组织记忆 #机器学习 #自动化
APeB

一篇题为“APeB: Benchmarking Personalization Ability of Large Language Model Agents”的学术论文于2026年7月3日提交至arXiv预印本平台。该研究由杨浩辰(音译)等12位作者共同完成,旨在建立一个衡量大语言模型智能体个性化能力的基准测试。论文提出了APeB框架,通过系统评估模型在理解用户偏好、生成个性化响应等方面的表现,推动AI智能体在定制化服务中的发展。研究团队计划在后续工作中公开相关代码与数据,以促进学术社区对这一方向的研究。 #大语言模型 #智能体 #个性化 #基准测试 #AI研究 #arXiv
跨调查传输的硅采样方法研究

一项名为“跨调查传输的硅采样”的研究在arXiv预印本上发布,由Chan-Tung Ku等五位作者共同完成。该研究提出了一种新的数据采样方法,能够通过跨调查传输技术,在硅基样本中实现高效的数据采集与处理。论文详细介绍了该方法的技术框架和实验验证结果,并提供了PDF全文供学术社区参考。研究内容涉及计算机科学和统计学领域,目前已通过NASA ADS、Google Scholar和Semantic Scholar等平台提供引用和参考文献链接。相关代码、数据和媒体资源也在alphaXiv、DagsHub和Hugging Face等平台开放共享,以促进学术交流与复现。 #跨调查传输 #硅采样 #数据采样 #人工智能 #学术论文 #计算机科学 #统计学
面向人机协同决策的以人为本反思架构

一篇题为“面向人机协同决策的以人为本反思架构”的学术论文已提交至arXiv预印本平台。该论文由Andreas Kouridakis等三位作者共同完成,提出了一种以人为中心的新型反思架构,旨在提升人类与人工智能在协同决策过程中的交互质量与决策效果。研究聚焦于如何让人工智能系统在不确定或复杂情境下,主动反思自身推理过程并调整策略,从而更好地辅助人类决策者。这一架构强调人类在决策链中的核心地位,避免AI过度自主而忽视人类意图。论文附有PDF、HTML及TeX源码等完整资料,并提供了相关文献引用、代码链接及工具推荐等服务。 #人机协同 #AI决策 #反思架构 #人工智能 #学术论文 #arXiv #人机交互
预测市场智能体研究

一篇由Yuxuan Wang等人提交至arXiv的学术论文提出了预测市场智能体的新架构。该研究超越传统预测方法,重点关注智能体从形成信念到执行交易的全过程,构建了“信念到交易”层。这一框架旨在提升智能体在复杂市场环境中的决策能力与预测准确性,为人工智能与市场预测领域的交叉研究提供了新思路。论文已通过DataCite获取DOI,并开放HTML和TeX源文件供查阅。 #AI #预测市场 #智能体 #arXiv #人工智能
强化学习赋能大模型证据驱动诊断推理

一篇发表在arXiv上的新论文提出,利用强化学习提升大语言模型在证据导向的临床诊断推理能力。研究团队由Shengyi Hua等人组成,该方法旨在让模型在诊断过程中主动寻求并整合关键证据,而非依赖固定知识模式。通过强化学习框架,模型学会在复杂病例中逐步收集信息、评估假设,并基于证据链做出准确诊断。实验结果显示,该技术在多种临床诊断任务上显著优于传统微调方法,尤其在需要动态推理和多步证据追踪的场景中表现突出。该工作为提升AI辅助医疗决策的可靠性和可解释性提供了新思路。 #强化学习 #大语言模型 #诊断推理 #AI医疗 #临床决策 #论文
新型AI评测框架Incognita:基于社会分布式任务的生成式Agent评估

一项发表于arXiv的研究提出了名为Incognita的新型评估框架,用于衡量生成式AI智能体在社会分布式任务环境中的表现。该框架通过模拟真实世界的任务分布与协作场景,评估AI在动态、多因素环境下的行动能力。研究者指出,传统评测方法往往局限于静态任务,难以反映AI在复杂社会互动中的实际表现。Incognita框架通过构建具有社会性分布特征的任务环境,要求AI智能体在信息不对称、资源受限等条件下自主决策并完成目标。初步实验表明,该框架能有效区分不同能力层次的AI系统,为下一代AI评估标准化提供了新思路。该研究同时开源了相关数据与工具,以促进社区协作与透明度。 #AI #评估框架 #生成式Agent #社会分布式任务 #Incognita #arXiv #人工智能评测
滑动窗口强化学习助力动态装配流水车间调度

研究人员提出一种基于滑动窗口的强化学习方法,用于解决多产品交付的动态装配流水车间调度问题。该方法通过滑动窗口技术实时捕捉生产环境的动态变化,结合强化学习算法优化调度决策,有效应对订单到达、机器故障等不确定性因素。实验结果表明,该算法在降低制造周期、提高交付准时率等方面优于传统调度方法,为智能制造中的复杂调度问题提供了新的解决方案。 #强化学习 #装配流水车间 #调度优化 #智能制造 #滑动窗口 #多产品交付 #动态调度
VERITAS

近日,一篇名为《VERITAS:面向科学研究的通用复制工具》的论文在arXiv上发布,作者为Haokun Liu等人。该论文提出了一种名为VERITAS的通用复制工具,旨在解决科学研究中的结果可重复性问题。论文介绍了该工具的设计与实现,并提供了PDF、HTML及TeX源码等多种访问方式。此外,论文页面还集成了多种学术工具和资源,如参考文献检索(NASA ADS、Google Scholar)、BibTeX导出、代码链接(通过CatalyzeX)、演示平台(Replicate、Hugging Face Spaces)以及相关论文推荐(Connected Papers、Litmaps)。该研究反映了科学界对开放性和可复制性的重视,并在arXiv社区通过arXivLabs项目支持实验性功能,强调用户数据隐私和社区协作。 #科学研究 #可重复性 #工具 #arXiv #学术论文
Oyster-II

一篇题为《Oyster-II: 强化学习用于大型语言模型的建设性安全对齐》的研究论文于2026年7月3日提交至arXiv预印本平台。该研究由Jiyang Guan等九位作者共同完成,提出了一种基于强化学习的“建设性安全对齐”方法,旨在引导大型语言模型在保持有用性的同时,主动规避生成有害或不当内容,而非简单地拒绝回答。该方法强调通过奖励机制塑造模型行为,在安全防护与回答质量之间寻求平衡,为AI安全对齐领域提供了新的技术思路。 #AI安全 #强化学习 #大模型 #安全对齐 #arXiv #人工智能 #科技论文
MedCalc-Pro

来自arXiv的一篇研究论文介绍了名为MedCalc-Pro的系统,旨在利用大语言模型(LLM)代理解决复杂的医学计算任务。该系统针对传统AI在临床计算中面临的挑战开发,通过将LLM作为智能代理,整合专门的计算工具和医学知识库,能够处理如药物剂量、生化指标换算等需要深度专业理解的复杂计算。论文详细阐述了MedCalc-Pro的架构,包括其如何通过多步推理和工具调用,提高计算准确性与可解释性。该研究实验结果表明,MedCalc-Pro在多个标准医学计算基准测试上表现优异,有望辅助临床决策,减少人为计算错误,为未来智能医疗应用提供了新的方向。 #大语言模型 #医学计算 #人工智能 #LLM #MedCalcPro #临床决策 #arXiv
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
面向智能体任务的对象中心环境建模方法

一篇学术论文提出了面向智能体任务的对象中心环境建模方法。该论文由Yiyang Li等四位作者共同完成,于2026年7月3日提交至arXiv预印本平台,目前正在等待DataCite分配DOI。研究聚焦于如何构建以对象为中心的智能体环境模型,旨在提升智能体在复杂任务中的理解与执行能力。论文提供了HTML及TeX源代码格式的全文访问链接,并展示了相关参考文献、引用工具及实验性平台arXivLabs的协作功能。 #arXiv #智能体 #环境建模 #对象中心 #人工智能
SwarmResearch 提出利用编码智能体进行开放式科学发现

一项名为 SwarmResearch 的新研究发表于 arXiv 预印本平台,提出了一种通过协调多个编码智能体来进行开放式科学发现的方法。该系统利用多个 AI 智能体协同工作,旨在自主探索和解决复杂问题,从而扩展科学研究的能力边界。论文作者展示了该方法在编程和算法发现等任务中的潜力,认为这种方式能够推动科研自动化和创新。 #AI #智能体 #科学研究 #自动化 #arXiv
自动化数据就绪度

一篇题为《面向科学人工智能的自动化数据就绪度》的论文在arXiv上发布。该论文由Sean R. Wilkinson等11位作者共同撰写,探讨了科学人工智能领域数据准备工作的自动化方法。研究关注如何提升数据质量与可用性,以支持更可靠的AI模型训练。文中还提供了PDF、HTML和TeX源码等完整文本链接,并支持文献引用、相关论文推荐等学术工具。这项研究得到了NASA ADS、Google Scholar和Semantic Scholar等学术平台的索引支持。 #学术论文 #科学AI #数据就绪 #机器学习 #arXiv
ASK in the Dark

近日,一篇题为《ASK in the Dark: Uncertainty-Gated LLM Assistance under Partial Observability》的学术论文在arXiv上发布。该研究由Juarez Monteiro等5位作者共同完成,提出了一种名为“ASK”的不确定性门控机制,旨在提升大语言模型在部分可观测环境下的辅助决策能力。传统LLM在面对信息不完整时容易出现错误或过度自信,而ASK框架通过动态评估模型自身的置信度,在不确定时主动暂停输出或请求澄清,从而显著提高回答的可靠性与安全性。该方法有望在自动驾驶、医疗诊断、金融风控等需要强鲁棒性的领域发挥关键作用。 #AI #大模型 #不确定性 #机器学习 #论文 #arXiv #LLM
内部多元主义与成对比较的局限性

来自 arXiv 预印本网站的信息显示,一篇题为《内部多元主义与成对比较的局限性》的学术论文由 Bailey Flanigan 和 Michelle Si 撰写,并于 2026 年 7 月 2 日提交。该研究聚焦于成对比较方法在多元环境中的内在限制,探讨了当决策群体内存在多种不同观点时,传统比较框架可能无法有效反映真实偏好或达成共识的问题。当前论文可在 arXiv 上以 PDF 或 HTML 形式查阅,并附有相关引文、代码与数据链接。 #内部多元主义 #成对比较 #论文 #研究方法 #决策理论
讯飞发布具身智能全模态技术报告,探索人机交互新范式

近日,科大讯飞团队在arXiv平台发布《iFLYTEK-Embodied-Omni Technical Report》技术报告。该报告详细阐述了讯飞在具身智能领域的全模态感知与交互技术,旨在实现机器人对物理世界更全面、自然的理解与操作。报告由张远等15位研究者共同完成,内容涉及多模态融合、环境感知、动作规划等核心模块,展示了讯飞在AI与机器人交叉领域的最新探索。这一工作为推进下一代智能机器人的自主交互能力提供了技术参考。 #科大讯飞 #具身智能 #全模态 #AI #机器人 #技术报告
时序网络上的去中心化联邦学习

该研究探讨了在时序网络环境下,去中心化联邦学习(DFL)中异质性的影响。论文由Arash Badie-Modiri等学者独立撰写,于2026年7月提交至arXiv。研究聚焦于非结构化网络节点间的协同学习,重点分析了节点计算能力、数据分布和网络拓扑等异质性因素对模型收敛和性能的制约。通过理论分析,揭示了去中心化环境中异质性如何通过时间序列传播并影响全局模型。该工作对边缘计算、社交网络分析及物联网等依赖分布式学习的场景具有参考价值,为设计更鲁棒的联邦学习协议提供了理论基础。 #联邦学习 #时序网络 #异质性 #去中心化学习 #机器学习 #AI #边缘计算
重新定义神经非线性为门控机制

一篇题为《》的研究论文在arXiv上发布,作者为Muhammad Sabih等人。该论文提出将传统神经网络中的非线性激活函数重新诠释为门控机制,旨在从新视角理解神经网络的运作原理。论文详细阐述了这一理论框架,并可能对深度学习模型的设计与优化产生影响。目前该论文已公开PDF与TeX源文件,供学术界查阅与引用。 #机器学习 #神经网络 #门控机制 #深度学习 #AI研究