面向离散选择估计的表格基础模型
近日,一篇题为《Tabular Foundation Models for Discrete Choice Estimation》的预印本论文出现在arXiv上。该研究由Liu Liu和Dan Zhang共同完成,旨在探索利用表格基础模型解决离散选择估计问题。离散选择模型广泛应用于经济学、交通科学等领域,传统方法依赖手工特征工程和参数假设。论文提出了一种基于大规模表格数据预训练的基础模型框架,能够自动从结构化数据中学习选择模式,提升估计的准确性和泛化能力。这一方法有望为市场调研、交通需求预测等应用提供更高效的解决方案。目前论文已提交,等待正式出版。 #表格基础模型 #离散选择 #经济学 #机器学习 #arXiv #预训练模型 #科技新闻
近日,一篇题为《Tabular Foundation Models for Discrete Choice Estimation》的预印本论文出现在arXiv上。该研究由Liu Liu和Dan Zhang共同完成,旨在探索利用表格基础模型解决离散选择估计问题。离散选择模型广泛应用于经济学、交通科学等领域,传统方法依赖手工特征工程和参数假设。论文提出了一种基于大规模表格数据预训练的基础模型框架,能够自动从结构化数据中学习选择模式,提升估计的准确性和泛化能力。这一方法有望为市场调研、交通需求预测等应用提供更高效的解决方案。目前论文已提交,等待正式出版。 #表格基础模型 #离散选择 #经济学 #机器学习 #arXiv #预训练模型 #科技新闻
解构Actor-Critic
一项大规模实证研究系统性地分析了Actor-Critic强化学习算法中的关键设计组件。研究团队通过大量实验,评估了不同架构选择、更新策略、探索机制等对算法性能的影响,并针对实际应用场景给出了具体的组件选择建议。该工作旨在为强化学习从业者提供可操作的指导,帮助他们更高效地设计和部署Actor-Critic算法。研究成果已提交至arXiv预印本平台,论文标题为《Deconstructing Actor-Critic: A Large-scale Empirical Study of Design Components for Practitioners》,作者包括Haseeb Shah等。这一研究填补了Actor-Critic算法组件对比的空白,对推动强化学习在机器人控制、游戏AI等领域的工程化落地具有重要参考价值。 #强化学习 #ActorCritic #大规模实证 #机器学习 #AI研究 #算法设计 #论文
一项大规模实证研究系统性地分析了Actor-Critic强化学习算法中的关键设计组件。研究团队通过大量实验,评估了不同架构选择、更新策略、探索机制等对算法性能的影响,并针对实际应用场景给出了具体的组件选择建议。该工作旨在为强化学习从业者提供可操作的指导,帮助他们更高效地设计和部署Actor-Critic算法。研究成果已提交至arXiv预印本平台,论文标题为《Deconstructing Actor-Critic: A Large-scale Empirical Study of Design Components for Practitioners》,作者包括Haseeb Shah等。这一研究填补了Actor-Critic算法组件对比的空白,对推动强化学习在机器人控制、游戏AI等领域的工程化落地具有重要参考价值。 #强化学习 #ActorCritic #大规模实证 #机器学习 #AI研究 #算法设计 #论文
联合图像理解与生成
Minh-Quan Le 等研究人员在 arXiv 上提交了一篇题为《Concurrent Image Understanding and Generation: Self-Correcting Coupled Markov Jump Processes》的论文。该研究提出了一种基于自校正耦合马尔可夫跳跃过程的新框架,旨在同时实现图像理解与生成。该方法通过引入耦合过程与自校正机制,提升了模型在多任务处理中的鲁棒性和准确性,为计算机视觉领域提供了新的理论工具。论文已于2026年7月14日提交,并可在 arXiv 上获取全文。 #计算机视觉 #图像理解 #图像生成 #马尔可夫过程 #AI #arXiv #论文
Minh-Quan Le 等研究人员在 arXiv 上提交了一篇题为《Concurrent Image Understanding and Generation: Self-Correcting Coupled Markov Jump Processes》的论文。该研究提出了一种基于自校正耦合马尔可夫跳跃过程的新框架,旨在同时实现图像理解与生成。该方法通过引入耦合过程与自校正机制,提升了模型在多任务处理中的鲁棒性和准确性,为计算机视觉领域提供了新的理论工具。论文已于2026年7月14日提交,并可在 arXiv 上获取全文。 #计算机视觉 #图像理解 #图像生成 #马尔可夫过程 #AI #arXiv #论文
SteinGate:通过Stein散度实现尾部敏感的安全强化学习
来自Yassine Chemingui等研究者的论文《SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy》已提交至arXiv预印本平台。该工作针对安全强化学习中的尾部风险问题,提出一种基于Stein散度的新方法SteinGate,通过度量分布差异来更敏感地捕捉极端不利事件的概率,从而在保证安全约束的同时提升策略性能。该方法在多个连续控制基准任务上表现出优于现有算法的安全性和样本效率,为高风险场景下的决策优化提供了新思路。 #强化学习 #安全RL #Stein散度 #尾部风险 #AI安全 #arXiv论文 #机器学习
来自Yassine Chemingui等研究者的论文《SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy》已提交至arXiv预印本平台。该工作针对安全强化学习中的尾部风险问题,提出一种基于Stein散度的新方法SteinGate,通过度量分布差异来更敏感地捕捉极端不利事件的概率,从而在保证安全约束的同时提升策略性能。该方法在多个连续控制基准任务上表现出优于现有算法的安全性和样本效率,为高风险场景下的决策优化提供了新思路。 #强化学习 #安全RL #Stein散度 #尾部风险 #AI安全 #arXiv论文 #机器学习
HEDGEHOG: Hierarchical Evaluation of Drug Generators Through Rigorous Filtration
Daria A. Ryabchenko 等研究团队在 arXiv 预印本上提交了一篇题为《HEDGEHOG: Hierarchical Evaluation of Drug Generators Through Rigorous Filtration》的论文。该论文提出了一种名为 HEDGEHOG 的层次化评估框架,旨在通过严格的过滤流程系统评价药物分子生成模型的性能。药物生成器是人工智能驱动的分子设计工具,但其输出质量参差不齐,缺乏统一的评估标准。HEDGEHOG 框架通过多层级指标和逐步筛选机制,能够更全面、更可靠地衡量生成分子的有效性、多样性和可合成性,从而帮助研究人员在药物发现过程中选择最优模型。该工作有望推动 AI 药物设计领域的标准化评估,加速新药研发进程。论文目前已在 arXiv 存档,并附带补充数据文件。 #AI #药物发现 #深度学习 #评估框架 #arXiv #分子生成 #HEDGEHOG
Daria A. Ryabchenko 等研究团队在 arXiv 预印本上提交了一篇题为《HEDGEHOG: Hierarchical Evaluation of Drug Generators Through Rigorous Filtration》的论文。该论文提出了一种名为 HEDGEHOG 的层次化评估框架,旨在通过严格的过滤流程系统评价药物分子生成模型的性能。药物生成器是人工智能驱动的分子设计工具,但其输出质量参差不齐,缺乏统一的评估标准。HEDGEHOG 框架通过多层级指标和逐步筛选机制,能够更全面、更可靠地衡量生成分子的有效性、多样性和可合成性,从而帮助研究人员在药物发现过程中选择最优模型。该工作有望推动 AI 药物设计领域的标准化评估,加速新药研发进程。论文目前已在 arXiv 存档,并附带补充数据文件。 #AI #药物发现 #深度学习 #评估框架 #arXiv #分子生成 #HEDGEHOG
CoDiffGRN论文提出基因调控网络推断新方法
近日,一篇题为《CoDiffGRN: Rethinking Gene Regulatory Network Inference via the BEELINE-KGC Benchmark and Co-evolutionary Discrete Diffusion》的论文引起关注。该研究由Jiaze Song等人完成,在BEELINE-KGC基准下重新审视基因调控网络(GRN)推断问题,并提出一种基于共进化离散扩散模型的新方法。该方法通过模拟基因间的共进化动态,结合离散扩散过程,有效提升了GRN推断的准确性和鲁棒性。研究团队在多个标准数据集上进行了验证,结果显示所提方法在性能上优于现有主流算法。这一工作有望为生物网络推断和系统生物学研究提供新的技术路径,尤其在单细胞转录组数据分析中具有潜在应用价值。 #基因调控网络 #CoDiffGRN #离散扩散 #生物信息学 #系统生物学 #论文 #机器学习 #AI
近日,一篇题为《CoDiffGRN: Rethinking Gene Regulatory Network Inference via the BEELINE-KGC Benchmark and Co-evolutionary Discrete Diffusion》的论文引起关注。该研究由Jiaze Song等人完成,在BEELINE-KGC基准下重新审视基因调控网络(GRN)推断问题,并提出一种基于共进化离散扩散模型的新方法。该方法通过模拟基因间的共进化动态,结合离散扩散过程,有效提升了GRN推断的准确性和鲁棒性。研究团队在多个标准数据集上进行了验证,结果显示所提方法在性能上优于现有主流算法。这一工作有望为生物网络推断和系统生物学研究提供新的技术路径,尤其在单细胞转录组数据分析中具有潜在应用价值。 #基因调控网络 #CoDiffGRN #离散扩散 #生物信息学 #系统生物学 #论文 #机器学习 #AI
混合Mamba模型用于音频
近期,研究团队在arXiv上提交了一篇题为“A Hybrid Mamba for Audio-Visual Navigation”的论文。该工作针对机器人或智能体在复杂环境中结合音频与视觉信息进行导航的任务,提出了一种基于混合Mamba架构的新方法。Mamba作为近年兴起的状态空间模型,在长序列建模中具有高效优势,而混合设计则旨在融合音频和视觉两种模态的特征。论文通过仿真实验验证了该方法在导航精度和鲁棒性上的提升,为多模态感知与自主导航领域提供了新思路。目前该论文已可在线获取全文及代码资源。 #AI #机器人 #音频视觉导航 #Mamba #多模态 #arXiv #科技论文
近期,研究团队在arXiv上提交了一篇题为“A Hybrid Mamba for Audio-Visual Navigation”的论文。该工作针对机器人或智能体在复杂环境中结合音频与视觉信息进行导航的任务,提出了一种基于混合Mamba架构的新方法。Mamba作为近年兴起的状态空间模型,在长序列建模中具有高效优势,而混合设计则旨在融合音频和视觉两种模态的特征。论文通过仿真实验验证了该方法在导航精度和鲁棒性上的提升,为多模态感知与自主导航领域提供了新思路。目前该论文已可在线获取全文及代码资源。 #AI #机器人 #音频视觉导航 #Mamba #多模态 #arXiv #科技论文
STKAN:基于Kolmogorov
近期,研究团队在arXiv上提交了题为《STKAN: Kolmogorov-Arnold Networks for Spatio-Temporal Forecasting》的论文。该论文提出了一种名为STKAN的新型时空预测模型,其核心创新在于将Kolmogorov-Arnold网络(KAN)引入时空序列分析领域。KAN基于Kolmogorov-Arnold表示定理,与传统的多层感知机不同,它使用可学习的激活函数而非固定非线性函数,从而更高效地捕捉复杂非线性关系。STKAN模型通过将KAN层融入时空网络架构,旨在提升交通流量、气象数据等时空预测任务的准确性。作者Sicong Lai等人已在arXiv上公开论文全文及代码链接,为相关领域提供了新的研究思路。 #STKAN #KolmogorovArnold #时空预测 #深度学习 #AI论文 #arXiv #科技前沿
近期,研究团队在arXiv上提交了题为《STKAN: Kolmogorov-Arnold Networks for Spatio-Temporal Forecasting》的论文。该论文提出了一种名为STKAN的新型时空预测模型,其核心创新在于将Kolmogorov-Arnold网络(KAN)引入时空序列分析领域。KAN基于Kolmogorov-Arnold表示定理,与传统的多层感知机不同,它使用可学习的激活函数而非固定非线性函数,从而更高效地捕捉复杂非线性关系。STKAN模型通过将KAN层融入时空网络架构,旨在提升交通流量、气象数据等时空预测任务的准确性。作者Sicong Lai等人已在arXiv上公开论文全文及代码链接,为相关领域提供了新的研究思路。 #STKAN #KolmogorovArnold #时空预测 #深度学习 #AI论文 #arXiv #科技前沿
TSSM: 三轴状态空间模型实现全球气象站高精度预报
近日,一篇题为《TSSM: Triaxial State Space Model for Global Station Weather Forecasting with Temporal-Variable-Historical Modeling》的论文在arXiv预印本平台发布。该研究针对全球气象站预报中的复杂时空依赖问题,提出了一种新颖的三轴状态空间模型(TSSM),通过同时建模时间、变量和历史三个维度的动态特征,显著提升了预报精度。传统模型往往仅考虑时间或空间维度,而TSSM通过三轴结构有效捕获了气象变量间的因果关联与长期记忆效应。实验表明,该模型在全球多站点数据集上优于现有基线方法,尤其在极端天气事件预测中的表现更为突出。这一工作为气象预报领域提供了一种高效且可扩展的深度学习范式。 #人工智能 #天气预报 #状态空间模型 #三轴建模 #TSSM #深度学习 #气象学 #arXiv
近日,一篇题为《TSSM: Triaxial State Space Model for Global Station Weather Forecasting with Temporal-Variable-Historical Modeling》的论文在arXiv预印本平台发布。该研究针对全球气象站预报中的复杂时空依赖问题,提出了一种新颖的三轴状态空间模型(TSSM),通过同时建模时间、变量和历史三个维度的动态特征,显著提升了预报精度。传统模型往往仅考虑时间或空间维度,而TSSM通过三轴结构有效捕获了气象变量间的因果关联与长期记忆效应。实验表明,该模型在全球多站点数据集上优于现有基线方法,尤其在极端天气事件预测中的表现更为突出。这一工作为气象预报领域提供了一种高效且可扩展的深度学习范式。 #人工智能 #天气预报 #状态空间模型 #三轴建模 #TSSM #深度学习 #气象学 #arXiv
从零实现自动微分:PyTorch在物理信息神经网络中如何计算梯度
一篇题为《从零实现自动微分:PyTorch如何在物理信息神经网络中计算梯度》的论文近日在arXiv上公开。作者Abdeladhim Tahimi深入探讨了自动微分的底层原理,详细阐述了如何在不借助高级框架的情况下自行构建这一核心技术。论文重点聚焦物理信息神经网络(PINNs),系统解释了PyTorch如何通过自动微分机制高效计算损失函数对网络参数的梯度,从而满足物理方程约束。这项工作为理解深度学习中的梯度计算提供了从理论到实践的完整路径,对PINNs的研究与教学具有重要参考价值。 #自动微分 #PyTorch #物理信息神经网络 #PINNs #深度学习 #梯度计算 #arXiv #论文
一篇题为《从零实现自动微分:PyTorch如何在物理信息神经网络中计算梯度》的论文近日在arXiv上公开。作者Abdeladhim Tahimi深入探讨了自动微分的底层原理,详细阐述了如何在不借助高级框架的情况下自行构建这一核心技术。论文重点聚焦物理信息神经网络(PINNs),系统解释了PyTorch如何通过自动微分机制高效计算损失函数对网络参数的梯度,从而满足物理方程约束。这项工作为理解深度学习中的梯度计算提供了从理论到实践的完整路径,对PINNs的研究与教学具有重要参考价值。 #自动微分 #PyTorch #物理信息神经网络 #PINNs #深度学习 #梯度计算 #arXiv #论文
部分观测结构因果模型
一篇题为《Partially Observed Structural Causal Models》(部分观测结构因果模型)的论文已在arXiv预印本平台发布。该论文由Turan Orujlu等四位作者撰写,首次提交于2026年5月5日,并在后续更新了第二版本。论文聚焦于因果推断中观测数据不完整(如存在隐变量或缺失值)时的结构因果建模问题,提出了相应的理论框架与算法。该工作旨在扩展传统结构因果模型对部分观测场景的适用性,提升因果分析在实际数据中的应用能力。 #部分观测结构因果模型 #因果推断 #arXiv #论文 #TuranOrujlu #结构方程模型
一篇题为《Partially Observed Structural Causal Models》(部分观测结构因果模型)的论文已在arXiv预印本平台发布。该论文由Turan Orujlu等四位作者撰写,首次提交于2026年5月5日,并在后续更新了第二版本。论文聚焦于因果推断中观测数据不完整(如存在隐变量或缺失值)时的结构因果建模问题,提出了相应的理论框架与算法。该工作旨在扩展传统结构因果模型对部分观测场景的适用性,提升因果分析在实际数据中的应用能力。 #部分观测结构因果模型 #因果推断 #arXiv #论文 #TuranOrujlu #结构方程模型