赋予用户更大系统控制权如何影响新闻过滤气泡
一篇发表于国际人工智能会议AAAI ICWSM 2024的研究论文,系统探讨了赋予用户对新闻推荐系统更大控制权对过滤气泡现象的影响。研究通过实验方法,让用户能够自定义推荐参数、屏蔽特定来源或调整算法权重,观察其信息接触模式的变化。结果表明,增强用户控制权在一定程度上能够降低过滤气泡的强度,使内容多样性有所提升;但同时也发现,部分用户主动选择的偏好反而加剧了信息窄化,形成“自我强化的过滤气泡”。研究指出,单纯赋予控制权并不能完全解决问题,需要结合算法透明度和用户教育。该工作为设计更健康的个性化推荐系统提供了实证依据。 #新闻过滤气泡 #用户控制权 #推荐系统 #AI研究 #信息茧房 #社交媒体 #个性化推荐 #学术论文
一篇发表于国际人工智能会议AAAI ICWSM 2024的研究论文,系统探讨了赋予用户对新闻推荐系统更大控制权对过滤气泡现象的影响。研究通过实验方法,让用户能够自定义推荐参数、屏蔽特定来源或调整算法权重,观察其信息接触模式的变化。结果表明,增强用户控制权在一定程度上能够降低过滤气泡的强度,使内容多样性有所提升;但同时也发现,部分用户主动选择的偏好反而加剧了信息窄化,形成“自我强化的过滤气泡”。研究指出,单纯赋予控制权并不能完全解决问题,需要结合算法透明度和用户教育。该工作为设计更健康的个性化推荐系统提供了实证依据。 #新闻过滤气泡 #用户控制权 #推荐系统 #AI研究 #信息茧房 #社交媒体 #个性化推荐 #学术论文
CRAFT方法:聚类规则诊断大模型弱点并生成针对性微调数据
来自arXiv预印本的一篇论文提出一种名为CRAFT(Clustering Rubrics)的新方法,旨在通过聚类规则来诊断大语言模型(LLM)的薄弱能力,并自动生成针对性的微调数据。该方法的核心思路是:首先设计一组细粒度的评估规则(rubrics),覆盖模型在推理、知识、语言等维度的表现;然后利用聚类算法对模型在这些规则上的失败案例进行归因分析,识别出系统性能力短板;最后基于聚类结果中的错误模式,自动生成相应的训练样本用于微调。实验表明,CRAFT能够有效发现传统评估方法难以捕捉的隐性弱点,并显著提升针对性微调的数据质量与效率,有望降低人工标注成本,推动LLM在特定领域的精细化优化。 #CRAFT #大语言模型 #微调 #弱能力诊断 #聚类规则 #AI #机器学习
来自arXiv预印本的一篇论文提出一种名为CRAFT(Clustering Rubrics)的新方法,旨在通过聚类规则来诊断大语言模型(LLM)的薄弱能力,并自动生成针对性的微调数据。该方法的核心思路是:首先设计一组细粒度的评估规则(rubrics),覆盖模型在推理、知识、语言等维度的表现;然后利用聚类算法对模型在这些规则上的失败案例进行归因分析,识别出系统性能力短板;最后基于聚类结果中的错误模式,自动生成相应的训练样本用于微调。实验表明,CRAFT能够有效发现传统评估方法难以捕捉的隐性弱点,并显著提升针对性微调的数据质量与效率,有望降低人工标注成本,推动LLM在特定领域的精细化优化。 #CRAFT #大语言模型 #微调 #弱能力诊断 #聚类规则 #AI #机器学习
协调AI安全阈值
近日,一篇题为《协调AI安全阈值》的学术论文在arXiv预印本平台发布。该论文由Wilber Sean Anterola等四位研究人员撰写,提交日期为2026年7月17日。论文聚焦于人工智能系统安全阈值的统一与协调问题,旨在解决当前不同AI模型在安全标准上存在的分歧。随着AI技术的快速发展,确保其运行安全成为重要议题,而不同组织采用的安全阈值各异,可能带来系统性风险。该研究提出了一种理论框架,试图为AI安全评估提供更一致的标准。论文目前以PDF形式公开,并附带HTML预览和TeX源码,供学术界及产业界参考讨论。虽然具体方法论尚未公开,但该工作有望为AI安全领域的标准化进程提供新思路。 #AI安全 #阈值协调 #学术论文 #arXiv #机器学习 #人工智能 #安全标准 #前沿研究
近日,一篇题为《协调AI安全阈值》的学术论文在arXiv预印本平台发布。该论文由Wilber Sean Anterola等四位研究人员撰写,提交日期为2026年7月17日。论文聚焦于人工智能系统安全阈值的统一与协调问题,旨在解决当前不同AI模型在安全标准上存在的分歧。随着AI技术的快速发展,确保其运行安全成为重要议题,而不同组织采用的安全阈值各异,可能带来系统性风险。该研究提出了一种理论框架,试图为AI安全评估提供更一致的标准。论文目前以PDF形式公开,并附带HTML预览和TeX源码,供学术界及产业界参考讨论。虽然具体方法论尚未公开,但该工作有望为AI安全领域的标准化进程提供新思路。 #AI安全 #阈值协调 #学术论文 #arXiv #机器学习 #人工智能 #安全标准 #前沿研究
SciForge
近日,arXiv上发布了一篇题为《SciForge: An AI-Native, Multimodal Workbench for Scientific Discovery》的论文。该论文由张阳(Zhangyang Gao)等12位作者组成的团队撰写,提出了一种名为SciForge的新型科研工作台。SciForge以AI原生和多模态为核心理念,旨在整合多种数据与工具,为科学家提供更高效、更智能的发现平台。论文详细介绍了其架构设计、多模态交互能力以及在科学实验中的潜在应用。该工作台有望通过深度学习与自动化流程,加速从数据收集到假设验证的科研周期,推动人工智能与科学发现深度融合。 #AI #科学发现 #多模态 #工作台 #arXiv #科研工具 #论文
近日,arXiv上发布了一篇题为《SciForge: An AI-Native, Multimodal Workbench for Scientific Discovery》的论文。该论文由张阳(Zhangyang Gao)等12位作者组成的团队撰写,提出了一种名为SciForge的新型科研工作台。SciForge以AI原生和多模态为核心理念,旨在整合多种数据与工具,为科学家提供更高效、更智能的发现平台。论文详细介绍了其架构设计、多模态交互能力以及在科学实验中的潜在应用。该工作台有望通过深度学习与自动化流程,加速从数据收集到假设验证的科研周期,推动人工智能与科学发现深度融合。 #AI #科学发现 #多模态 #工作台 #arXiv #科研工具 #论文
基于形式化方法的ODRL评估器
一篇题为《基于形式化方法的ODRL评估器:实现与对比》的学术论文近期在arXiv上发布。该论文由Jaime Osvaldo Salas等四位作者共同完成,提出并实现了一种基于数学形式化框架的ODRL(开放数字版权语言)策略评估器。ODRL是万维网联盟(W3C)推荐的用于表达数字版权及策略管理的标准语言,但现有实现缺乏严格的形式化基础,导致评估结果可能存在歧义或错误。研究团队通过构建形式化语义模型,设计并开发了一个新的评估器,并与多个主流ODRL评估工具进行了性能与准确性对比实验。实验结果表明,该评估器在策略冲突检测和合规性判定方面具有更高的精确度,同时保持了可接受的执行效率。该工作为数字版权管理系统的可靠实现提供了理论支撑和实践参考。 #ODRL #数字版权 #策略评估 #形式化方法 #语义网 #学术论文 #arXiv
一篇题为《基于形式化方法的ODRL评估器:实现与对比》的学术论文近期在arXiv上发布。该论文由Jaime Osvaldo Salas等四位作者共同完成,提出并实现了一种基于数学形式化框架的ODRL(开放数字版权语言)策略评估器。ODRL是万维网联盟(W3C)推荐的用于表达数字版权及策略管理的标准语言,但现有实现缺乏严格的形式化基础,导致评估结果可能存在歧义或错误。研究团队通过构建形式化语义模型,设计并开发了一个新的评估器,并与多个主流ODRL评估工具进行了性能与准确性对比实验。实验结果表明,该评估器在策略冲突检测和合规性判定方面具有更高的精确度,同时保持了可接受的执行效率。该工作为数字版权管理系统的可靠实现提供了理论支撑和实践参考。 #ODRL #数字版权 #策略评估 #形式化方法 #语义网 #学术论文 #arXiv
DSWorld: 面向高效自主智能体的数据科学世界模型论文发布
据arXiv预印本,一篇题为《DSWorld: A Data Science World Model for Efficient Autonomous Agents》的学术论文由Zherui Yang等三位作者提交。该研究提出了一种数据科学领域的世界模型,旨在提升自主智能体的决策效率与任务执行能力。论文详细阐述了模型构建方法及其在复杂数据场景中的应用潜力,目前已在arXiv平台开放全文访问。该工作有望推动AI智能体在数据科学自动化、自适应推理等方向的进一步发展,为构建更高效的自主系统提供理论支撑。 #论文 #人工智能 #数据科学 #自主智能体 #世界模型 #arXiv #研究 #AI #机器学习
据arXiv预印本,一篇题为《DSWorld: A Data Science World Model for Efficient Autonomous Agents》的学术论文由Zherui Yang等三位作者提交。该研究提出了一种数据科学领域的世界模型,旨在提升自主智能体的决策效率与任务执行能力。论文详细阐述了模型构建方法及其在复杂数据场景中的应用潜力,目前已在arXiv平台开放全文访问。该工作有望推动AI智能体在数据科学自动化、自适应推理等方向的进一步发展,为构建更高效的自主系统提供理论支撑。 #论文 #人工智能 #数据科学 #自主智能体 #世界模型 #arXiv #研究 #AI #机器学习
知识中心智能体
arXiv平台近日收录了一篇题为《Knowledge-Centric Agents for Workflow Generation》的研究论文。该论文由Zhendong Li等七位作者共同完成,首次提出以知识为中心的智能体框架用于自动化工作流生成。传统工作流生成往往依赖规则或模板,缺乏对领域知识的深度利用。研究团队创新性地将知识图谱与智能体系统结合,让智能体能够主动检索、推理并应用结构化知识,从而动态生成更灵活、精准的工作流。实验表明,该方法在多个复杂任务场景下显著提升了生成效率和准确性。目前论文已开放PDF全文下载,并支持HTML、TeX源文件等浏览方式,研究社区可通过arXiv链接获取详细内容。 #论文 #AI #智能体 #工作流生成 #知识图谱 #arXiv #学术新闻
arXiv平台近日收录了一篇题为《Knowledge-Centric Agents for Workflow Generation》的研究论文。该论文由Zhendong Li等七位作者共同完成,首次提出以知识为中心的智能体框架用于自动化工作流生成。传统工作流生成往往依赖规则或模板,缺乏对领域知识的深度利用。研究团队创新性地将知识图谱与智能体系统结合,让智能体能够主动检索、推理并应用结构化知识,从而动态生成更灵活、精准的工作流。实验表明,该方法在多个复杂任务场景下显著提升了生成效率和准确性。目前论文已开放PDF全文下载,并支持HTML、TeX源文件等浏览方式,研究社区可通过arXiv链接获取详细内容。 #论文 #AI #智能体 #工作流生成 #知识图谱 #arXiv #学术新闻
AgentFAIR:多智能体协同评估地理空间数据FAIR性框架
研究人员提出了一种名为AgentFAIR的多智能体协作框架,旨在自动化评估地理空间数据的FAIR(可发现、可访问、可互操作、可重用)程度。该框架利用多个协同工作的智能体,分别负责数据解析、标准匹配、质量打分等任务,从而实现对地理空间数据集合规性的高效、可重复评估。与传统手动评估相比,AgentFAIR显著降低了人工成本并提高了评估一致性。该论文已提交至arXiv预印本平台,并提供了完整PDF及HTML版本,相关代码和数据链接也已公开。这项工作有望推动地理空间数据管理与共享的标准化进程,为科研数据基础设施提供有力支撑。 #地理空间数据 #FAIR原则 #多智能体 #数据评估 #arXiv #人工智能 #数据治理
研究人员提出了一种名为AgentFAIR的多智能体协作框架,旨在自动化评估地理空间数据的FAIR(可发现、可访问、可互操作、可重用)程度。该框架利用多个协同工作的智能体,分别负责数据解析、标准匹配、质量打分等任务,从而实现对地理空间数据集合规性的高效、可重复评估。与传统手动评估相比,AgentFAIR显著降低了人工成本并提高了评估一致性。该论文已提交至arXiv预印本平台,并提供了完整PDF及HTML版本,相关代码和数据链接也已公开。这项工作有望推动地理空间数据管理与共享的标准化进程,为科研数据基础设施提供有力支撑。 #地理空间数据 #FAIR原则 #多智能体 #数据评估 #arXiv #人工智能 #数据治理
基于LLM的神经符号框架NeurOWL,致力于不完整OWL本体推理
据arXiv预印本显示,研究人员提出了一种名为NeurOWL的新型框架,该框架融合大语言模型(LLM)与符号推理技术,专门解决不完整OWL本体推理难题。传统本体推理依赖完整且一致的逻辑公理,但在现实场景中,本体常因缺失或噪声数据而不完整。NeurOWL利用LLM对自然语言和模式的理解能力,生成候选推理路径,再通过符号引擎进行逻辑验证与补全,从而提升推理的鲁棒性和准确性。该框架在多个标准本体数据集上取得优异表现,为知识图谱、语义网等领域提供了新的解决思路。 #LLM #神经符号 #OWL #本体推理 #知识图谱 #AI #语义网 #学术研究
据arXiv预印本显示,研究人员提出了一种名为NeurOWL的新型框架,该框架融合大语言模型(LLM)与符号推理技术,专门解决不完整OWL本体推理难题。传统本体推理依赖完整且一致的逻辑公理,但在现实场景中,本体常因缺失或噪声数据而不完整。NeurOWL利用LLM对自然语言和模式的理解能力,生成候选推理路径,再通过符号引擎进行逻辑验证与补全,从而提升推理的鲁棒性和准确性。该框架在多个标准本体数据集上取得优异表现,为知识图谱、语义网等领域提供了新的解决思路。 #LLM #神经符号 #OWL #本体推理 #知识图谱 #AI #语义网 #学术研究
智能体模型行为可控性研究
一篇发表于arXiv的论文系统探讨了智能体模型在信息抽取任务中的行为可控性问题。论文题为《Behavioral Controllability of Agentic Models for Information Extraction: From Fixed Workflows to Reflective Agents》,作者包括Lujia Zhang等人。研究指出,传统固定工作流在信息抽取中缺乏灵活性,而反思型智能体通过引入自我反馈和动态调整机制,显著提升了模型对复杂任务的适应性和可控性。该工作为构建更可靠的AI信息抽取系统提供了新的理论框架,对自然语言处理与智能体自主决策领域的交叉研究具有推动作用。 #arXiv #论文 #信息抽取 #智能体 #行为可控性 #AI #学术研究 #NLP
一篇发表于arXiv的论文系统探讨了智能体模型在信息抽取任务中的行为可控性问题。论文题为《Behavioral Controllability of Agentic Models for Information Extraction: From Fixed Workflows to Reflective Agents》,作者包括Lujia Zhang等人。研究指出,传统固定工作流在信息抽取中缺乏灵活性,而反思型智能体通过引入自我反馈和动态调整机制,显著提升了模型对复杂任务的适应性和可控性。该工作为构建更可靠的AI信息抽取系统提供了新的理论框架,对自然语言处理与智能体自主决策领域的交叉研究具有推动作用。 #arXiv #论文 #信息抽取 #智能体 #行为可控性 #AI #学术研究 #NLP
ToolVerse:为智能体强化学习解锁大规模环境与长时任务
arXiv上最新发表的一篇论文《ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning》引起关注。该研究由Shuaiyu Zhou等七位作者共同完成,提出一个名为ToolVerse的新型框架,旨在攻克智能体强化学习在复杂场景下难以处理大规模环境与长时任务的瓶颈。论文详细介绍了ToolVerse的设计理念、核心机制及潜在应用,为提升强化学习智能体的决策与持续学习能力提供了新思路。相关代码与数据已公开,供学界进一步探索。 #论文 #AI #强化学习 #智能体 #ToolVerse #科研 #arXiv
arXiv上最新发表的一篇论文《ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning》引起关注。该研究由Shuaiyu Zhou等七位作者共同完成,提出一个名为ToolVerse的新型框架,旨在攻克智能体强化学习在复杂场景下难以处理大规模环境与长时任务的瓶颈。论文详细介绍了ToolVerse的设计理念、核心机制及潜在应用,为提升强化学习智能体的决策与持续学习能力提供了新思路。相关代码与数据已公开,供学界进一步探索。 #论文 #AI #强化学习 #智能体 #ToolVerse #科研 #arXiv
神经符号AI助力LEED合规:文档基准测试、确定性数值检查与多模态的局限性
来自德州大学奥斯汀分校的研究人员近日在arXiv上提交了一篇论文,提出了一种神经符号AI方法用于LEED(建筑能效认证)合规性检查。该方法构建了文档中心的基准测试,并采用确定性数值检查来验证建筑设计与LEED标准的符合程度。研究还重点分析了多模态模型的适用性,发现在处理部分合规条款时,引入图像等多模态数据反而会降低模型性能。实验表明,纯文本的神经符号方法在准确性和可解释性上表现更优。这一工作为自动化建筑合规审查提供了新范式,有望提升认证效率并减少人为错误。论文详细介绍了基准数据集的构建和实验设置,为后续研究奠定了坚实基础。 #神经符号AI #LEED #绿色建筑 #合规检查 #多模态 #人工智能 #建筑能源 #arXiv #论文
来自德州大学奥斯汀分校的研究人员近日在arXiv上提交了一篇论文,提出了一种神经符号AI方法用于LEED(建筑能效认证)合规性检查。该方法构建了文档中心的基准测试,并采用确定性数值检查来验证建筑设计与LEED标准的符合程度。研究还重点分析了多模态模型的适用性,发现在处理部分合规条款时,引入图像等多模态数据反而会降低模型性能。实验表明,纯文本的神经符号方法在准确性和可解释性上表现更优。这一工作为自动化建筑合规审查提供了新范式,有望提升认证效率并减少人为错误。论文详细介绍了基准数据集的构建和实验设置,为后续研究奠定了坚实基础。 #神经符号AI #LEED #绿色建筑 #合规检查 #多模态 #人工智能 #建筑能源 #arXiv #论文
MGDT:多模态知识图谱补全新模型利用MLLM引导扩散变换器
近日,研究人员在arXiv上提交了一篇题为“MGDT: MLLM-Guided Diffusion Transformer with Relation-Adaptive Mixture-of-Experts for Multimodal Knowledge Graph Completion”的论文。该工作聚焦于多模态知识图谱补全(KGC)任务,提出了一种名为MGDT的新模型。模型创新性地将多模态大语言模型(MLLM)的引导能力与扩散变换器(Diffusion Transformer)相结合,并引入关系自适应混合专家(Relation-Adaptive Mixture-of-Experts)模块,以动态适配不同语义关系下的多模态特征融合。该方法旨在更精准地预测多模态知识图谱中缺失的实体或关系,从而提升补全性能。论文由Xu Hou等8位作者共同完成,目前处于公开预印本状态,相关代码与数据待后续发布。 #多模态 #知识图谱补全 #扩散变换器 #MLLM #混合专家 #AI #KGC #arXiv #论文
近日,研究人员在arXiv上提交了一篇题为“MGDT: MLLM-Guided Diffusion Transformer with Relation-Adaptive Mixture-of-Experts for Multimodal Knowledge Graph Completion”的论文。该工作聚焦于多模态知识图谱补全(KGC)任务,提出了一种名为MGDT的新模型。模型创新性地将多模态大语言模型(MLLM)的引导能力与扩散变换器(Diffusion Transformer)相结合,并引入关系自适应混合专家(Relation-Adaptive Mixture-of-Experts)模块,以动态适配不同语义关系下的多模态特征融合。该方法旨在更精准地预测多模态知识图谱中缺失的实体或关系,从而提升补全性能。论文由Xu Hou等8位作者共同完成,目前处于公开预印本状态,相关代码与数据待后续发布。 #多模态 #知识图谱补全 #扩散变换器 #MLLM #混合专家 #AI #KGC #arXiv #论文
SeerGuard:基于世界模型预测的移动GUI代理安全框架
一篇发表于arXiv的论文提出了名为SeerGuard的安全框架,专门针对移动图形用户界面(GUI)代理中的潜在风险。该框架通过构建世界模型,预测代理在执行任务时可能导致的危险行为,如误操作、隐私泄露或越权访问,从而在动作执行前进行干预和阻止。研究团队由Xue Yu等五位学者组成,他们指出,现有移动GUI代理缺乏可靠的运行时安全保障,而SeerGuard利用环境模拟和因果推理,显著降低了代理在真实设备上的事故率。该工作为移动端AI代理的安全部署提供了理论支持,有望应用于自动化测试、无障碍服务及个人助理等领域,推动更负责任的自主智能体发展。 #AI安全 #移动代理 #GUI #世界模型 #arXiv #自主智能体 #安全框架
一篇发表于arXiv的论文提出了名为SeerGuard的安全框架,专门针对移动图形用户界面(GUI)代理中的潜在风险。该框架通过构建世界模型,预测代理在执行任务时可能导致的危险行为,如误操作、隐私泄露或越权访问,从而在动作执行前进行干预和阻止。研究团队由Xue Yu等五位学者组成,他们指出,现有移动GUI代理缺乏可靠的运行时安全保障,而SeerGuard利用环境模拟和因果推理,显著降低了代理在真实设备上的事故率。该工作为移动端AI代理的安全部署提供了理论支持,有望应用于自动化测试、无障碍服务及个人助理等领域,推动更负责任的自主智能体发展。 #AI安全 #移动代理 #GUI #世界模型 #arXiv #自主智能体 #安全框架