提出对抗子空间对齐方法,增强多模态知识编辑鲁棒性
https://arxiv.org/abs/2605.23780
一项最新研究提出了名为“对抗子空间对齐”的新方法,旨在实现超越传统二元编辑模式的、更为鲁棒的多模态知识编辑。多模态知识编辑旨在不重新训练整个模型的情况下,精准修正或更新大语言模型中的特定知识,而该方法通过引入对抗性子空间对齐技术,旨在提升编辑过程在复杂场景下的稳定性和有效性,解决了现有编辑方法可能面临的脆弱性问题。该研究为维护和更新日益庞大的多模态AI模型的知识库提供了新的技术思路。 #人工智能 #机器学习 #多模态 #知识编辑 #鲁棒学习 #对抗训练 #学术研究 #AI
https://arxiv.org/abs/2605.23780
一项最新研究提出了名为“对抗子空间对齐”的新方法,旨在实现超越传统二元编辑模式的、更为鲁棒的多模态知识编辑。多模态知识编辑旨在不重新训练整个模型的情况下,精准修正或更新大语言模型中的特定知识,而该方法通过引入对抗性子空间对齐技术,旨在提升编辑过程在复杂场景下的稳定性和有效性,解决了现有编辑方法可能面临的脆弱性问题。该研究为维护和更新日益庞大的多模态AI模型的知识库提供了新的技术思路。 #人工智能 #机器学习 #多模态 #知识编辑 #鲁棒学习 #对抗训练 #学术研究 #AI
arXiv.org
Beyond Binary Edits Robust Multimodal Knowledge Editing with...
Multimodal large language models (MLLMs) need efficient mechanisms to update knowledge without degrading existing capabilities. While intrinsic multimodal knowledge editing achieves strong...
arXiv推出协作框架,支持程序验证研究
https://arxiv.org/abs/2605.23772
学术预印本平台arXiv发布了名为“arXivLabs”的协作框架,旨在邀请研究社区成员共同开发与分享网站新功能。该平台鼓励个人及组织在坚持其开放、社区、卓越与用户数据隐私等核心价值观的前提下参与创新。arXiv表示,此举措旨在通过众包方式为社区增添价值,具体项目已开放申请。 #arXiv #程序验证 #开源 #学术 #计算机科学 #软件工程 #研究工具
https://arxiv.org/abs/2605.23772
学术预印本平台arXiv发布了名为“arXivLabs”的协作框架,旨在邀请研究社区成员共同开发与分享网站新功能。该平台鼓励个人及组织在坚持其开放、社区、卓越与用户数据隐私等核心价值观的前提下参与创新。arXiv表示,此举措旨在通过众包方式为社区增添价值,具体项目已开放申请。 #arXiv #程序验证 #开源 #学术 #计算机科学 #软件工程 #研究工具
arXiv.org
Agentic Proving for Program Verification
Agentic systems have recently emerged as state-of-the-art approaches for automated theorem proving in formal mathematics. To assess how far these capabilities extend to program verification, we...
MemAudit:基于因果归因和结构异常检测的代理记忆审计工具发布
https://arxiv.org/abs/2605.23723
arXivLabs是一个支持在arXiv网站上协作开发与分享新功能的框架,秉持开放、社区、卓越及用户数据隐私的价值观。近期,与该框架相关的MemAudit工具被提出,旨在对AI代理中可能被毒化的记忆进行事后审计。该工具结合因果归因和结构异常检测技术,通过分析记忆数据中的因果关系和结构偏差,识别潜在的恶意干扰或数据毒化,从而增强AI系统的安全性和可靠性。这一进展反映了随着AI代理学习系统日益复杂,对其记忆完整性和安全审计的需求不断增长,MemAudit为开发者提供了有效的检测和修正手段
https://arxiv.org/abs/2605.23723
arXivLabs是一个支持在arXiv网站上协作开发与分享新功能的框架,秉持开放、社区、卓越及用户数据隐私的价值观。近期,与该框架相关的MemAudit工具被提出,旨在对AI代理中可能被毒化的记忆进行事后审计。该工具结合因果归因和结构异常检测技术,通过分析记忆数据中的因果关系和结构偏差,识别潜在的恶意干扰或数据毒化,从而增强AI系统的安全性和可靠性。这一进展反映了随着AI代理学习系统日益复杂,对其记忆完整性和安全审计的需求不断增长,MemAudit为开发者提供了有效的检测和修正手段
arXiv.org
MemAudit: Post-hoc Auditing of Poisoned Agent Memory via Causal...
Large language model agents increasingly rely on persistent memory to store past interactions, retrieve relevant demonstrations, and improve long-horizon task execution. However, this memory...
研究提出共享强化学习策略打造无限可追踪人格游戏NPC
https://arxiv.org/abs/2605.23652
近期,一项新研究提出了一种基于共享强化学习策略的方法,名为“Persona-Traceable Shared RL Policies”,旨在创建可扩展的游戏代理。该方法允许开发者使用单一策略控制无限数量的非玩家角色(NPC),同时确保每个NPC的人格特征可追踪,从而解决传统游戏AI中NPC行为多样性不足和开发成本高昂的挑战。研究论文通过arXiv平台及其arXivLabs协作框架分享,强调了开放、社区导向和数据隐私的科研价值观。该方法的潜在影响包括提升游戏开发效率、丰富游戏体验,并推动人工智能在互动娱乐领域的创新应用。 #游戏AI #强化学习 #NPC #人工智能 #arXiv #科技新闻 #共享策略 #研究突破
https://arxiv.org/abs/2605.23652
近期,一项新研究提出了一种基于共享强化学习策略的方法,名为“Persona-Traceable Shared RL Policies”,旨在创建可扩展的游戏代理。该方法允许开发者使用单一策略控制无限数量的非玩家角色(NPC),同时确保每个NPC的人格特征可追踪,从而解决传统游戏AI中NPC行为多样性不足和开发成本高昂的挑战。研究论文通过arXiv平台及其arXivLabs协作框架分享,强调了开放、社区导向和数据隐私的科研价值观。该方法的潜在影响包括提升游戏开发效率、丰富游戏体验,并推动人工智能在互动娱乐领域的创新应用。 #游戏AI #强化学习 #NPC #人工智能 #arXiv #科技新闻 #共享策略 #研究突破
arXiv.org
One Policy, Infinite NPCs: Persona-Traceable Shared RL Policies...
On a 300-persona life-simulation benchmark, pcsp achieves compositional zero-shot persona identification up to 17x above chance, Spearman rho approx 0.73 semantic-behavioral alignment, and 22x...
Solving the Aircraft Disassembly Scheduling Problem
https://arxiv.org/abs/2605.23592
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
https://arxiv.org/abs/2605.23592
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
arXiv.org
Solving the Aircraft Disassembly Scheduling Problem
Dismantling aircrafts reaching their end of life is a complex endeavour that is necessary in terms of sustainability but yields small income margins for air transport companies. An efficient...
Co-ReAct:为ReAct智能体引入步骤级协作者评分标准
https://arxiv.org/abs/2605.23590
一种名为Co-ReAct的新方法被提出,旨在提升ReAct类型智能体的性能。该方法创新性地将结构化评分标准作为步骤级协作者整合到智能体的推理过程中,从而引导其进行更规范、更可靠的逐步推理。此项目目前依托于arXivLabs平台进行开发和展示。 #CoReAct #AI智能体 #机器学习 #人工智能 #学术研究 #arXiv #技术前沿
https://arxiv.org/abs/2605.23590
一种名为Co-ReAct的新方法被提出,旨在提升ReAct类型智能体的性能。该方法创新性地将结构化评分标准作为步骤级协作者整合到智能体的推理过程中,从而引导其进行更规范、更可靠的逐步推理。此项目目前依托于arXivLabs平台进行开发和展示。 #CoReAct #AI智能体 #机器学习 #人工智能 #学术研究 #arXiv #技术前沿
arXiv.org
Co-ReAct: Rubrics as Step-Level Collaborators for ReAct Agents
ReAct-style agents for search-intensive, multi-step reasoning tasks rely largely on their own internal judgment to decide what evidence to seek, which reasoning or action step to take next, and...
研究创新结合约束规划与动态规划求解部分车间调度问题
https://arxiv.org/abs/2605.23569
一项新的学术研究探讨了在部分车间调度问题中整合约束规划与动态规划两种方法的可能性。该研究针对一个具体的生产调度案例,提出了一种混合求解策略,旨在充分利用约束规划在建模灵活性和动态规划在特定结构问题上的效率优势,以期提升复杂调度场景下的求解性能。这种方法论上的融合尝试,为优化算法领域提供了新的思路,对理论研究和实际工业应用中的排产优化均具有潜在的参考价值。 #运筹学 #算法 #调度优化 #学术研究 #AI应用
https://arxiv.org/abs/2605.23569
一项新的学术研究探讨了在部分车间调度问题中整合约束规划与动态规划两种方法的可能性。该研究针对一个具体的生产调度案例,提出了一种混合求解策略,旨在充分利用约束规划在建模灵活性和动态规划在特定结构问题上的效率优势,以期提升复杂调度场景下的求解性能。这种方法论上的融合尝试,为优化算法领域提供了新的思路,对理论研究和实际工业应用中的排产优化均具有潜在的参考价值。 #运筹学 #算法 #调度优化 #学术研究 #AI应用
arXiv.org
CP or DP? Why Not Both: A Case Study in the Partial Shop Scheduling Problem
Dynamic Programming (DP) and Constraint Programming (CP) are well-established paradigms for solving combinatorial optimization problems. Usually, these two approaches are used separately. This...
EDGE-OPD: Internalizing Privileged Context with Evidence Guided On-Policy Distillation
https://arxiv.org/abs/2605.23493
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
https://arxiv.org/abs/2605.23493
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
arXiv.org
EDGE-OPD: Internalizing Privileged Context with Evidence Guided...
On-Policy Distillation (OPD) has gained wide attraction as an LLM post-training paradigm due to its effectiveness in improving capabilities without introducing model distribution drift, and...
arXiv 推出 arXivLabs 框架,促进社区合作与创新
https://arxiv.org/abs/2605.23414
arXiv 最近发布了 arXivLabs 框架,这是一个全新平台,旨在允许研究人员和开发者直接在 arXiv 网站上开发并共享新特性。该框架强调开放性、社区参与、卓越标准和用户数据隐私等核心价值观,只有认同并遵守这些原则的合作伙伴才能参与项目开发。通过这一举措,arXiv 希望鼓励社区成员提出创新想法,以增强平台功能,推动学术交流和科技进展。arXiv 表示,这不仅是为了提升用户体验,还致力于构建更协作的科研生态系统,预计将吸引更多机构和个人加入,共同探索未来科研工具的发展方向。 #arXiv #科研 #开放科学 #社区合作 #科技新闻 #AI #框架开发 #创新平台
https://arxiv.org/abs/2605.23414
arXiv 最近发布了 arXivLabs 框架,这是一个全新平台,旨在允许研究人员和开发者直接在 arXiv 网站上开发并共享新特性。该框架强调开放性、社区参与、卓越标准和用户数据隐私等核心价值观,只有认同并遵守这些原则的合作伙伴才能参与项目开发。通过这一举措,arXiv 希望鼓励社区成员提出创新想法,以增强平台功能,推动学术交流和科技进展。arXiv 表示,这不仅是为了提升用户体验,还致力于构建更协作的科研生态系统,预计将吸引更多机构和个人加入,共同探索未来科研工具的发展方向。 #arXiv #科研 #开放科学 #社区合作 #科技新闻 #AI #框架开发 #创新平台
arXiv.org
When Planning Fails Despite Correct Execution: On Epistemic...
LLM-based multi-agent systems can fail even when planned actions are executed correctly because agents may misjudge their knowledge when evaluating plan feasibility, a phenomenon we term epistemic...
新研究提出人机协同多智能体呼吸机决策支持系统
https://arxiv.org/abs/2605.23320
一篇发布于学术平台的论文提出了一种名为“Human-in-the-Loop Multi-Agent Ventilator Decision Support with Contextual Bandit Preference Learning”的新方法。该研究旨在结合人类专家的判断与多智能体系统的协同分析,通过一种名为“情境强盗偏好学习”的技术,为临床呼吸机参数设置提供智能决策支持。该工作的目标是提升危重症治疗场景下关键决策的准确性与效率。 该论文通过arXiv平台发布。arXivLabs是一个开放框架,允许研究者直接在arXiv网站上协作开发和分享新功能,其核心价值包括开放、协作、卓越和保护用户数据隐私。 #arXiv #医学研究 #呼吸机 #人工智能 #决策支持系统 #医疗AI #临床智能
https://arxiv.org/abs/2605.23320
一篇发布于学术平台的论文提出了一种名为“Human-in-the-Loop Multi-Agent Ventilator Decision Support with Contextual Bandit Preference Learning”的新方法。该研究旨在结合人类专家的判断与多智能体系统的协同分析,通过一种名为“情境强盗偏好学习”的技术,为临床呼吸机参数设置提供智能决策支持。该工作的目标是提升危重症治疗场景下关键决策的准确性与效率。 该论文通过arXiv平台发布。arXivLabs是一个开放框架,允许研究者直接在arXiv网站上协作开发和分享新功能,其核心价值包括开放、协作、卓越和保护用户数据隐私。 #arXiv #医学研究 #呼吸机 #人工智能 #决策支持系统 #医疗AI #临床智能
arXiv.org
Human-in-the-Loop Multi-Agent Ventilator Decision Support with...
Ventilator decision support requires sequential decisions that track evolving physiology and disease trajectories while respecting safety boundaries and clinician specific tuning styles. Rule...
arXivLabs 推出 DART 语义恢复技术,助力结构化工具代理优化
https://arxiv.org/abs/2605.23311
arXivLabs 作为 arXiv 平台的协作框架,长期秉持开放性、社区卓越和用户数据隐私的核心价值观,支持协作者直接开发和共享新功能。近期,该框架引入了 DART 技术,专注于结构化工具代理的语义可恢复性。DART 旨在提升代理工具在复杂场景下的语义理解和恢复能力,从而增强用户体验和社区协作效率。通过这一技术,arXiv 进一步推动学术资源共享和工具创新,为全球研究者提供更可靠的支撑。此举不仅强化了 arXiv 对开放科学的承诺,还预计吸引更多合作伙伴加入,共同促进技术生态的繁荣发展。 #arXiv #DART #语义可恢复性 #工具代理 #AI #学术技术 #开放科学 #社区协作
https://arxiv.org/abs/2605.23311
arXivLabs 作为 arXiv 平台的协作框架,长期秉持开放性、社区卓越和用户数据隐私的核心价值观,支持协作者直接开发和共享新功能。近期,该框架引入了 DART 技术,专注于结构化工具代理的语义可恢复性。DART 旨在提升代理工具在复杂场景下的语义理解和恢复能力,从而增强用户体验和社区协作效率。通过这一技术,arXiv 进一步推动学术资源共享和工具创新,为全球研究者提供更可靠的支撑。此举不仅强化了 arXiv 对开放科学的承诺,还预计吸引更多合作伙伴加入,共同促进技术生态的繁荣发展。 #arXiv #DART #语义可恢复性 #工具代理 #AI #学术技术 #开放科学 #社区协作
arXiv.org
DART: Semantic Recoverability for Structured Tool Agents
When a structured tool agent fails mid-execution, the runtime faces a dilemma: replaying the entire task is safe but wasteful, while restoring from a local checkpoint is efficient but can leave...
Ontological Knowledge Blocks: Executable Compliance and Profile-Based Validation for Trustworthy AI Systems
https://arxiv.org/abs/2605.23297
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
https://arxiv.org/abs/2605.23297
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
arXiv.org
Ontological Knowledge Blocks: Executable Compliance and...
AI-enabled services deployed in critical digital infrastructure are subject to governance obligations spanning transparency, accountability, fairness, and traceability. Compliance today remains...
arXivLabs 框架发布,推动开放协作与创新
https://arxiv.org/abs/2605.23296
近日,学术预印本平台 arXiv 正式推出 arXivLabs 框架,旨在通过开放协作推动平台功能创新。该框架设计为一个协作环境,允许个人和组织直接在 arXiv 网站上参与新特性的创建与分享。arXiv 强调,所有参与者需认同其核心价值观,包括开放性、社区精神、卓越追求以及用户数据隐私保护。平台承诺只与遵守这些原则的伙伴合作。通过 arXivLabs,arXiv 希望激发社区创新,鼓励研究人员提出有价值的项目想法,从而增强平台服务,推动开放科学的发展。这一举措预计将提升学术交流的效率,并扩大 arXiv 在全球研究社区中的影响力,进一步促进学术资源的共享与协作。 #arXiv #arXivLabs #开放科学 #学术协作 #科技创新 #数据隐私 #社区创新 #开源框架
https://arxiv.org/abs/2605.23296
近日,学术预印本平台 arXiv 正式推出 arXivLabs 框架,旨在通过开放协作推动平台功能创新。该框架设计为一个协作环境,允许个人和组织直接在 arXiv 网站上参与新特性的创建与分享。arXiv 强调,所有参与者需认同其核心价值观,包括开放性、社区精神、卓越追求以及用户数据隐私保护。平台承诺只与遵守这些原则的伙伴合作。通过 arXivLabs,arXiv 希望激发社区创新,鼓励研究人员提出有价值的项目想法,从而增强平台服务,推动开放科学的发展。这一举措预计将提升学术交流的效率,并扩大 arXiv 在全球研究社区中的影响力,进一步促进学术资源的共享与协作。 #arXiv #arXivLabs #开放科学 #学术协作 #科技创新 #数据隐私 #社区创新 #开源框架
arXiv.org
Parallel Context Compaction for Long-Horizon LLM Agent Serving
Long-horizon LLM agents accumulate growing conversation histories that eventually exceed the model's context window. Context compaction via LLM-based summarization keeps the conversation bounded,...
arXivLabs 推广开放框架,邀全球学者共建学术平台
https://arxiv.org/abs/2605.23262
arXiv 近期积极推广其创新的 arXivLabs 框架,这是一个专为学术社区设计的协作平台,允许研究人员和开发者直接在 arXiv 网站上开发和分享新功能。该框架严格遵循开放、社区、卓越和用户数据隐私的核心价值观,要求所有合作的个人或组织必须遵守这些原则。通过 arXivLabs,arXiv 旨在激发全球学者的创造力,鼓励他们提出有价值的项目以增强平台功能,从而促进学术资源共享、推动开放科学的发展,并加强研究社区的协作与创新。 #arXiv #arXivLabs #开放科学 #学术社区 #数据隐私 #研究 #科技新闻 #知识工作
https://arxiv.org/abs/2605.23262
arXiv 近期积极推广其创新的 arXivLabs 框架,这是一个专为学术社区设计的协作平台,允许研究人员和开发者直接在 arXiv 网站上开发和分享新功能。该框架严格遵循开放、社区、卓越和用户数据隐私的核心价值观,要求所有合作的个人或组织必须遵守这些原则。通过 arXivLabs,arXiv 旨在激发全球学者的创造力,鼓励他们提出有价值的项目以增强平台功能,从而促进学术资源共享、推动开放科学的发展,并加强研究社区的协作与创新。 #arXiv #arXivLabs #开放科学 #学术社区 #数据隐私 #研究 #科技新闻 #知识工作
arXiv.org
Design and Report Benchmarks for Knowledge Work
The development of LLM agents has led to a growing body of work on knowledge-work AI, including coding, research, and healthcare. However, current knowledge-work evaluation and benchmark design...
GENSTRAT
https://arxiv.org/abs/2605.23238
一项名为GENSTRAT的前沿研究提出,旨在为大型语言模型的战略推理能力建立系统性的科学框架。该研究发表于预印本平台arXiv,其依托的arXivLabs是一个鼓励开放协作的框架,致力于推动社区创新,同时恪守开放、卓越与用户数据隐私等核心价值。该研究的目标是超越当前模型在复杂决策与博弈场景中的表现,深入探索并科学化其战略推理的内在机制,这一方向对于提升AI的自主决策与协作能力具有关键意义。 #人工智能 #大语言模型 #战略推理 #学术研究 #arXiv #GENSTRAT #AI科学
https://arxiv.org/abs/2605.23238
一项名为GENSTRAT的前沿研究提出,旨在为大型语言模型的战略推理能力建立系统性的科学框架。该研究发表于预印本平台arXiv,其依托的arXivLabs是一个鼓励开放协作的框架,致力于推动社区创新,同时恪守开放、卓越与用户数据隐私等核心价值。该研究的目标是超越当前模型在复杂决策与博弈场景中的表现,深入探索并科学化其战略推理的内在机制,这一方向对于提升AI的自主决策与协作能力具有关键意义。 #人工智能 #大语言模型 #战略推理 #学术研究 #arXiv #GENSTRAT #AI科学
arXiv.org
GENSTRAT: Toward a Science of Strategic Reasoning in Large Language Models
Large language models (LLMs) are increasingly deployed as economic agents in marketplaces, auctions, and bidding settings. Anticipating their behavior in any specific deployment is hard. Existing...
arXiv 推出 Labs 协作框架,助力学术社区功能共建
https://arxiv.org/abs/2605.23218
专注于预印本服务的学术平台 arXiv 推出了名为“arXivLabs”的协作框架。该框架旨在搭建一个开放的合作层,允许全球的研究人员、开发者以及相关机构直接在其网站上协作开发与分享新功能,从而更灵活地响应学术社区的需求。arXiv 强调,所有参与 Labs 的合作方都需认同其开放、社区、卓越与用户数据隐私的核心价值观,并鼓励有想法的社区成员通过该项目为平台增添价值。 #学术 #开放科学 #科研平台 #技术协作 #用户参与
https://arxiv.org/abs/2605.23218
专注于预印本服务的学术平台 arXiv 推出了名为“arXivLabs”的协作框架。该框架旨在搭建一个开放的合作层,允许全球的研究人员、开发者以及相关机构直接在其网站上协作开发与分享新功能,从而更灵活地响应学术社区的需求。arXiv 强调,所有参与 Labs 的合作方都需认同其开放、社区、卓越与用户数据隐私的核心价值观,并鼓励有想法的社区成员通过该项目为平台增添价值。 #学术 #开放科学 #科研平台 #技术协作 #用户参与
arXiv.org
Foundation Protocol: A Coordination Layer for Agentic Society
Autonomous agents are moving from tools into a layer of social infrastructure: they browse, purchase, deploy software, manage systems, and increasingly interact with one another. As these systems...
arXivLabs推出新框架,助力AI驱动科研自动化
https://arxiv.org/abs/2605.23204
学术预印本平台arXiv近日重点介绍了其arXivLabs框架,旨在推动科研流程的自动化与智能化。该框架允许开发者直接在arXiv平台上协作开发与分享创新功能。平台强调,所有参与合作的个人与组织均需秉持开放、社区、卓越和保护用户数据隐私的核心价值观。arXiv表示,致力于通过此模式吸引志同道合的伙伴,共同为全球科研社群增加价值,探索利用AI等先进技术加速科学发现的新路径。 #AI科研 #自动化 #arXiv #科技新闻 #人工智能 #学术开源 #科研工具
https://arxiv.org/abs/2605.23204
学术预印本平台arXiv近日重点介绍了其arXivLabs框架,旨在推动科研流程的自动化与智能化。该框架允许开发者直接在arXiv平台上协作开发与分享创新功能。平台强调,所有参与合作的个人与组织均需秉持开放、社区、卓越和保护用户数据隐私的核心价值观。arXiv表示,致力于通过此模式吸引志同道合的伙伴,共同为全球科研社群增加价值,探索利用AI等先进技术加速科学发现的新路径。 #AI科研 #自动化 #arXiv #科技新闻 #人工智能 #学术开源 #科研工具
arXiv.org
AutoResearch AI: Towards AI-Powered Research Automation for...
Scientific research is being reshaped by AI systems that move beyond isolated assistance toward longer-horizon workflows spanning literature grounding, hypothesis generation, experimentation,...
arXiv 推出 arXivLabs 框架,促进 AI 功能开源协作
https://arxiv.org/abs/2605.23179
全球知名学术预印本平台 arXiv 近期正式推出 arXivLabs 框架,旨在通过开放协作加速人工智能功能开发。该框架允许研究人员、开发者和机构直接在 arXiv 网站上创建、测试和分享新工具与特性,从而降低创新门槛,提升平台实用性和社区参与度。arXiv 强调其核心价值观,包括开放性、社区驱动、卓越标准和用户数据隐私保护,确保所有合作项目均符合这些原则。此举预计将推动 AI 领域工具生态的繁荣,支持学术研究和应用突破,为全球研究者提供更高效的协作环境,进一步巩固 arXiv 在科技学术界的引领地位。 #arXiv #AI #开源 #科技 #学术 #机器学习 #框架 #创新 #协作
https://arxiv.org/abs/2605.23179
全球知名学术预印本平台 arXiv 近期正式推出 arXivLabs 框架,旨在通过开放协作加速人工智能功能开发。该框架允许研究人员、开发者和机构直接在 arXiv 网站上创建、测试和分享新工具与特性,从而降低创新门槛,提升平台实用性和社区参与度。arXiv 强调其核心价值观,包括开放性、社区驱动、卓越标准和用户数据隐私保护,确保所有合作项目均符合这些原则。此举预计将推动 AI 领域工具生态的繁荣,支持学术研究和应用突破,为全球研究者提供更高效的协作环境,进一步巩固 arXiv 在科技学术界的引领地位。 #arXiv #AI #开源 #科技 #学术 #机器学习 #框架 #创新 #协作
arXiv.org
Redrawing the AI Map: A Theory of Accountability Boundaries in...
Agentic AI orchestrators reduce the interface and assembly costs of composing information systems capabilities across organizational boundaries, seemingly accelerating modularization and...
Inductive Deductive Synthesis: Enabling AI to Generate Formally Verified Systems
https://arxiv.org/abs/2605.23109
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
https://arxiv.org/abs/2605.23109
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
arXiv.org
Inductive Deductive Synthesis: Enabling AI to Generate Formally...
AI agents increasingly excel at generating, testing, and refining code. However, they fall short on tasks requiring formal guarantees of full coverage that testing alone cannot provide....
arXiv 推出 arXivLabs 协作框架促进开源创新
https://arxiv.org/abs/2605.23074
arXiv 学术预印本平台正式发布了名为 arXivLabs 的协作框架,旨在为研究者和开发者提供直接在网站上共同开发与分享新功能的渠道。该框架强调开放性、社区参与、卓越品质及用户数据隐私等核心价值观,arXiv 表示将只与秉持相同理念的合作伙伴携手。平台鼓励社区成员提出能为学术生态增添价值的创新项目构想,并呼吁更多人深入了解 arXivLabs 的详细信息,以推动资源共享与技术进步。 #arXiv #开源框架 #学术协作 #社区开发 #技术新闻 #数据隐私 #创新项目
https://arxiv.org/abs/2605.23074
arXiv 学术预印本平台正式发布了名为 arXivLabs 的协作框架,旨在为研究者和开发者提供直接在网站上共同开发与分享新功能的渠道。该框架强调开放性、社区参与、卓越品质及用户数据隐私等核心价值观,arXiv 表示将只与秉持相同理念的合作伙伴携手。平台鼓励社区成员提出能为学术生态增添价值的创新项目构想,并呼吁更多人深入了解 arXivLabs 的详细信息,以推动资源共享与技术进步。 #arXiv #开源框架 #学术协作 #社区开发 #技术新闻 #数据隐私 #创新项目
arXiv.org
PathCal: State-Aware Reflection-Marker Calibration for Efficient Reasoning
The emergence of Large Reasoning Language Models (LRMs) has paved the way for tackling complex reasoning tasks through test-time scaling by generating long-form Chain-of-Thought (CoT) trajectories...
arXiv 推出 arXivLabs 框架,赋能可信AI系统设计研究
https://arxiv.org/abs/2605.23024
在人工智能系统可信性与安全性成为核心议题的当下,学术平台 arXiv 近期正式推出 arXivLabs 框架,旨在为研究社区提供协作创新的基础设施。该框架允许研究人员和开发者直接在 arXiv 网站上共同开发及分享新功能,其核心价值观涵盖开放、社区、卓越和用户数据隐私,arXiv 强调只与遵守这些原则的伙伴合作。通过 arXivLabs,社区成员可以提出并实施能为平台增添价值的项目,特别支持对可信AI系统设计规范的前沿探索,例如利用不可能结果作为理论指导,从而推动相关领域的技术突破与学术交流。 #arXiv #AI #可信AI #研究框架 #学术新闻 #科技创新 #机器学习 #安全AI
https://arxiv.org/abs/2605.23024
在人工智能系统可信性与安全性成为核心议题的当下,学术平台 arXiv 近期正式推出 arXivLabs 框架,旨在为研究社区提供协作创新的基础设施。该框架允许研究人员和开发者直接在 arXiv 网站上共同开发及分享新功能,其核心价值观涵盖开放、社区、卓越和用户数据隐私,arXiv 强调只与遵守这些原则的伙伴合作。通过 arXivLabs,社区成员可以提出并实施能为平台增添价值的项目,特别支持对可信AI系统设计规范的前沿探索,例如利用不可能结果作为理论指导,从而推动相关领域的技术突破与学术交流。 #arXiv #AI #可信AI #研究框架 #学术新闻 #科技创新 #机器学习 #安全AI
arXiv.org
The Deterministic Horizon: Impossibility Results as Design...
Large language models now write software, draft legal documents, and produce clinical notes, yet fundamental limits, from Turing and Arrow to the No Free Lunch theorems, shape what computation can...