DASH-OPD 新框架
来自 arXiv 的一项最新研究提出 DASH-OPD(Discrepancy-Aware Switching with Hysteresis for On-Policy Distillation)框架,旨在改进强化学习中的在线策略蒸馏效率。该方法通过差异感知切换机制动态评估教师与学生策略的分布差异,并结合滞回控制避免频繁或过早的模型切换,从而提升训练稳定性和样本利用率。论文作者 Yuchen Xia 等六人已在 arXiv 公开全文,并提供 PDF、HTML 及源码链接,感兴趣的读者可进一步查看。该研究为在线蒸馏策略的稳健设计提供了新思路,或对大规模智能体训练具有参考价值。 #机器学习 #强化学习 #策略蒸馏 #ArXiv #AI #论文
来自 arXiv 的一项最新研究提出 DASH-OPD(Discrepancy-Aware Switching with Hysteresis for On-Policy Distillation)框架,旨在改进强化学习中的在线策略蒸馏效率。该方法通过差异感知切换机制动态评估教师与学生策略的分布差异,并结合滞回控制避免频繁或过早的模型切换,从而提升训练稳定性和样本利用率。论文作者 Yuchen Xia 等六人已在 arXiv 公开全文,并提供 PDF、HTML 及源码链接,感兴趣的读者可进一步查看。该研究为在线蒸馏策略的稳健设计提供了新思路,或对大规模智能体训练具有参考价值。 #机器学习 #强化学习 #策略蒸馏 #ArXiv #AI #论文
联邦基础模型微调新方法
一篇题为《Federated Foundation Models Fine-Tuning with Heterogeneous Compressed Clients》的论文近日在arXiv预印本平台发布。该研究由Shengkun Zhu等八位作者共同完成,主要探讨在联邦学习框架下,如何利用异构压缩客户端对基础模型进行高效微调。联邦学习允许数据不出本地,但客户端设备计算能力和网络带宽差异巨大,传统方法难以兼顾模型精度与通信效率。该论文提出了一种针对异构压缩客户端的微调策略,旨在平衡各参与方的资源约束,同时保持基础模型在下游任务上的性能。研究有望推动大模型在隐私敏感场景中的实际部署,例如医疗、金融等领域。论文已提供PDF及HTML版本供学术社区参考。 #联邦学习 #基础模型 #模型微调 #异构计算 #压缩 #arXiv #人工智能 #隐私保护
一篇题为《Federated Foundation Models Fine-Tuning with Heterogeneous Compressed Clients》的论文近日在arXiv预印本平台发布。该研究由Shengkun Zhu等八位作者共同完成,主要探讨在联邦学习框架下,如何利用异构压缩客户端对基础模型进行高效微调。联邦学习允许数据不出本地,但客户端设备计算能力和网络带宽差异巨大,传统方法难以兼顾模型精度与通信效率。该论文提出了一种针对异构压缩客户端的微调策略,旨在平衡各参与方的资源约束,同时保持基础模型在下游任务上的性能。研究有望推动大模型在隐私敏感场景中的实际部署,例如医疗、金融等领域。论文已提供PDF及HTML版本供学术社区参考。 #联邦学习 #基础模型 #模型微调 #异构计算 #压缩 #arXiv #人工智能 #隐私保护
谁在哪里胜出?保形模型比较用于局部优势判断
一篇题为“Who Wins Where? Conformal Model Comparison for Local Superiority”的学术论文于2026年7月31日提交至arXiv平台,作者为Yi Zhou等四人。该研究聚焦于模型比较中的局部优势判定问题,提出基于保形推断(conformal inference)的方法,用于在数据子区域中识别哪个模型表现更优,并给出统计保证。这一方法有望为机器学习模型的选择与评估提供更精细的工具,尤其在模型性能随输入分布变化时具有重要意义。 #学术论文 #arXiv #保形推断 #模型比较 #机器学习 #统计方法
一篇题为“Who Wins Where? Conformal Model Comparison for Local Superiority”的学术论文于2026年7月31日提交至arXiv平台,作者为Yi Zhou等四人。该研究聚焦于模型比较中的局部优势判定问题,提出基于保形推断(conformal inference)的方法,用于在数据子区域中识别哪个模型表现更优,并给出统计保证。这一方法有望为机器学习模型的选择与评估提供更精细的工具,尤其在模型性能随输入分布变化时具有重要意义。 #学术论文 #arXiv #保形推断 #模型比较 #机器学习 #统计方法
DFSC:用于分数阶科学机器学习的误差控制可微Mittag
近日,一篇题为“DFSC: Error-Controlled Differentiable Mittag-Leffler Propagation for Fractional Scientific Machine Learning”的研究论文在arXiv平台提交。该论文由Ning Hu等四位作者完成,提出了一种面向分数阶科学机器学习的新方法。论文核心在于引入可微的Mittag-Leffler传播机制,并实现误差控制,以提升模型在分数阶动力学系统中的学习能力与数值稳定性。研究展示了在复杂科学计算场景下,该方法相比传统整数阶传播策略具有更好的适应性和精度。目前论文已提供PDF、HTML及TeX源码等多种访问形式,并可通过相关工具进行引用与检索。 #科研 #机器学习 #分数阶 #MittagLeffler #arXiv #论文 #AI #科学计算
近日,一篇题为“DFSC: Error-Controlled Differentiable Mittag-Leffler Propagation for Fractional Scientific Machine Learning”的研究论文在arXiv平台提交。该论文由Ning Hu等四位作者完成,提出了一种面向分数阶科学机器学习的新方法。论文核心在于引入可微的Mittag-Leffler传播机制,并实现误差控制,以提升模型在分数阶动力学系统中的学习能力与数值稳定性。研究展示了在复杂科学计算场景下,该方法相比传统整数阶传播策略具有更好的适应性和精度。目前论文已提供PDF、HTML及TeX源码等多种访问形式,并可通过相关工具进行引用与检索。 #科研 #机器学习 #分数阶 #MittagLeffler #arXiv #论文 #AI #科学计算
动力学感知方法可从稀疏噪声数据中识别控制方程
一篇题为《Dynamics-aware identification of governing equations from sparse and noisy data》的论文近日在arXiv上提交,作者为Pongpisit Thanasutives与Yoshinobu Kawahara。该研究聚焦于从稀疏且含噪的观测数据中自动识别系统控制方程的问题,属于科学机器学习与动力系统建模的前沿方向。传统符号回归或稀疏识别方法在数据质量不佳时容易失效,而该方法引入动力学感知机制,旨在提升对噪声和缺失信息的鲁棒性,从而更可靠地重构潜在物理规律。论文已提供PDF及HTML全文,并附带参考文献和代码关联工具。 #科研 #AI #动力学 #控制方程 #稀疏数据 #arXiv #机器学习
一篇题为《Dynamics-aware identification of governing equations from sparse and noisy data》的论文近日在arXiv上提交,作者为Pongpisit Thanasutives与Yoshinobu Kawahara。该研究聚焦于从稀疏且含噪的观测数据中自动识别系统控制方程的问题,属于科学机器学习与动力系统建模的前沿方向。传统符号回归或稀疏识别方法在数据质量不佳时容易失效,而该方法引入动力学感知机制,旨在提升对噪声和缺失信息的鲁棒性,从而更可靠地重构潜在物理规律。论文已提供PDF及HTML全文,并附带参考文献和代码关联工具。 #科研 #AI #动力学 #控制方程 #稀疏数据 #arXiv #机器学习
SILVA网络:通过动态交互场实现结构化隐式层与向量吸引子
据arXiv预印本平台信息,一篇题为"SILVA Networks as Structured Implicit Layers and Vector Attractors via Dynamic Interaction Fields"的论文于2026年7月31日提交,作者为Jose Luis Lima de Jesus Silva。该论文提出了一种名为SILVA网络的新型架构,将网络建模为结构化隐式层,并引入向量吸引子概念,通过动态交互场驱动学习过程。这一研究方向可能对深度学习中的隐层表示和动力学系统有重要影响。目前论文以PDF格式提供。 #SILVA #神经网络 #隐式层 #向量吸引子 #动态交互场 #arXiv #机器学习
据arXiv预印本平台信息,一篇题为"SILVA Networks as Structured Implicit Layers and Vector Attractors via Dynamic Interaction Fields"的论文于2026年7月31日提交,作者为Jose Luis Lima de Jesus Silva。该论文提出了一种名为SILVA网络的新型架构,将网络建模为结构化隐式层,并引入向量吸引子概念,通过动态交互场驱动学习过程。这一研究方向可能对深度学习中的隐层表示和动力学系统有重要影响。目前论文以PDF格式提供。 #SILVA #神经网络 #隐式层 #向量吸引子 #动态交互场 #arXiv #机器学习
挖掘神经网络验证中的判定边界新方法
一项题为“Mining Verdict Boundaries for Neural Network Verification”的研究论文正式发布,并被收录于形式化方法领域顶级会议FM 2026的论文集。该论文由Jiawei Ren等人撰写,主要关注神经网络验证中的关键问题:如何有效区分满足与违反安全属性的判定边界。研究提出了一种挖掘判定边界的方法,旨在提升神经网络验证的可扩展性与精确度。随着神经网络在安全关键系统中的广泛应用,严格验证其行为变得至关重要,但传统验证方法往往面临状态空间爆炸或过度近似等挑战。该工作通过从验证过程中提取边界信息,有望为复杂网络的鲁棒性分析提供更高效的途径。论文已在arXiv平台公开,并提供PDF及HTML版本供研究人员查阅。 #神经网络 #形式化验证 #安全关键系统 #FM2026 #人工智能 #科技论文
一项题为“Mining Verdict Boundaries for Neural Network Verification”的研究论文正式发布,并被收录于形式化方法领域顶级会议FM 2026的论文集。该论文由Jiawei Ren等人撰写,主要关注神经网络验证中的关键问题:如何有效区分满足与违反安全属性的判定边界。研究提出了一种挖掘判定边界的方法,旨在提升神经网络验证的可扩展性与精确度。随着神经网络在安全关键系统中的广泛应用,严格验证其行为变得至关重要,但传统验证方法往往面临状态空间爆炸或过度近似等挑战。该工作通过从验证过程中提取边界信息,有望为复杂网络的鲁棒性分析提供更高效的途径。论文已在arXiv平台公开,并提供PDF及HTML版本供研究人员查阅。 #神经网络 #形式化验证 #安全关键系统 #FM2026 #人工智能 #科技论文
利用异构编辑重组克服LLM驱动的程序优化中的“最弱链路”效应
arXiv上的一篇预印本论文提出了一种新方法,旨在解决大语言模型(LLM)在程序优化任务中面临的“最弱链路”效应。该效应指LLM生成的多个优化编辑中,若存在一个错误或低效的编辑,会拖累整体优化效果。研究团队通过引入“异构编辑重组”策略,将LLM生成的不同类型编辑(如性能优化、代码简化、错误修复等)进行智能组合与筛选,从而绕过单一编辑链的短板。实验表明,该方法在多个基准测试上显著提升了代码的运行效率和正确性,为LLM在自动化编程优化领域的应用提供了新思路。 #LLM #程序优化 #最弱链路效应 #异构编辑重组 #arXiv #人工智能 #代码优化
arXiv上的一篇预印本论文提出了一种新方法,旨在解决大语言模型(LLM)在程序优化任务中面临的“最弱链路”效应。该效应指LLM生成的多个优化编辑中,若存在一个错误或低效的编辑,会拖累整体优化效果。研究团队通过引入“异构编辑重组”策略,将LLM生成的不同类型编辑(如性能优化、代码简化、错误修复等)进行智能组合与筛选,从而绕过单一编辑链的短板。实验表明,该方法在多个基准测试上显著提升了代码的运行效率和正确性,为LLM在自动化编程优化领域的应用提供了新思路。 #LLM #程序优化 #最弱链路效应 #异构编辑重组 #arXiv #人工智能 #代码优化
基于Shapley值的特征归因方法用于数据掩码
近日,一篇题为《基于Shapley值的特征归因用于数据掩码》的论文在arXiv预印本平台发布。该研究由Xinxue(Shawn)Qu等人完成,提出利用博弈论中的Shapley值对特征重要性进行归因,并应用于数据掩码(即数据脱敏/隐私保护)场景。传统数据掩码方法往往缺乏对特征重要性的量化评估,可能导致关键信息泄露或过度遮蔽。该工作通过计算每个特征对模型预测的边际贡献,实现更精准、可解释的数据遮蔽策略,在保护隐私的同时尽量保留数据的可用性。论文有望为隐私保护机器学习、数据安全领域提供新思路。 #Shapley值 #特征归因 #数据掩码 #隐私保护 #机器学习 #arXiv #论文
近日,一篇题为《基于Shapley值的特征归因用于数据掩码》的论文在arXiv预印本平台发布。该研究由Xinxue(Shawn)Qu等人完成,提出利用博弈论中的Shapley值对特征重要性进行归因,并应用于数据掩码(即数据脱敏/隐私保护)场景。传统数据掩码方法往往缺乏对特征重要性的量化评估,可能导致关键信息泄露或过度遮蔽。该工作通过计算每个特征对模型预测的边际贡献,实现更精准、可解释的数据遮蔽策略,在保护隐私的同时尽量保留数据的可用性。论文有望为隐私保护机器学习、数据安全领域提供新思路。 #Shapley值 #特征归因 #数据掩码 #隐私保护 #机器学习 #arXiv #论文
异构多视图数据谱联合子空间估计
近日,arXiv上发布了一篇题为《Spectral Joint Subspace Estimation for Heterogeneous Multi-View Data: Geometry and Reweighting》的研究论文。该论文由Jingyang Li和Zhongyuan Lyu撰写,聚焦于异构多视图数据的联合子空间估计问题,提出了一种融合几何信息与重加权策略的谱方法。传统方法在处理来自不同来源、具有不同特征分布的多视图数据时,往往难以有效捕捉各视图间的共享结构。该研究通过引入几何先验,并设计自适应重加权机制,提升了子空间估计的鲁棒性和准确性。实验表明,新方法在多种异构数据场景下均优于现有基线,为多模态数据融合、跨视图学习等任务提供了新的理论工具。该论文已通过arXiv平台公开,并附有完整PDF及代码链接。 #机器学习 #多视图数据 #子空间估计 #谱方法 #几何重加权 #arXiv论文 #数据融合
近日,arXiv上发布了一篇题为《Spectral Joint Subspace Estimation for Heterogeneous Multi-View Data: Geometry and Reweighting》的研究论文。该论文由Jingyang Li和Zhongyuan Lyu撰写,聚焦于异构多视图数据的联合子空间估计问题,提出了一种融合几何信息与重加权策略的谱方法。传统方法在处理来自不同来源、具有不同特征分布的多视图数据时,往往难以有效捕捉各视图间的共享结构。该研究通过引入几何先验,并设计自适应重加权机制,提升了子空间估计的鲁棒性和准确性。实验表明,新方法在多种异构数据场景下均优于现有基线,为多模态数据融合、跨视图学习等任务提供了新的理论工具。该论文已通过arXiv平台公开,并附有完整PDF及代码链接。 #机器学习 #多视图数据 #子空间估计 #谱方法 #几何重加权 #arXiv论文 #数据融合
强化顺序蒙特卡洛方法用于摊销采样研究发布
该预印本论文题为《Reinforced sequential Monte Carlo for amortised sampling》,由Sanghyeok Choi等五位研究者合作完成,于2025年10月首次提交至arXiv,后经两次修订。论文探讨了将强化学习与顺序蒙特卡洛方法相结合,以改进摊销采样(amortised sampling)的效率与稳定性。顺序蒙特卡洛是一类用于复杂概率分布推断的经典方法,而摊销采样则通过机器学习模型实现可复用的快速推断。该研究有望为概率编程、贝叶斯推断和生成模型等领域提供新的技术路径。 #机器学习 #贝叶斯推断 #arXiv #学术论文 #强化学习 #蒙特卡洛 #采样方法
该预印本论文题为《Reinforced sequential Monte Carlo for amortised sampling》,由Sanghyeok Choi等五位研究者合作完成,于2025年10月首次提交至arXiv,后经两次修订。论文探讨了将强化学习与顺序蒙特卡洛方法相结合,以改进摊销采样(amortised sampling)的效率与稳定性。顺序蒙特卡洛是一类用于复杂概率分布推断的经典方法,而摊销采样则通过机器学习模型实现可复用的快速推断。该研究有望为概率编程、贝叶斯推断和生成模型等领域提供新的技术路径。 #机器学习 #贝叶斯推断 #arXiv #学术论文 #强化学习 #蒙特卡洛 #采样方法