AI知识库 @ai521
309 subscribers
21.6K photos
42 videos
19 files
829 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
TSSM: 三轴状态空间模型实现全球气象站高精度预报

近日,一篇题为《TSSM: Triaxial State Space Model for Global Station Weather Forecasting with Temporal-Variable-Historical Modeling》的论文在arXiv预印本平台发布。该研究针对全球气象站预报中的复杂时空依赖问题,提出了一种新颖的三轴状态空间模型(TSSM),通过同时建模时间、变量和历史三个维度的动态特征,显著提升了预报精度。传统模型往往仅考虑时间或空间维度,而TSSM通过三轴结构有效捕获了气象变量间的因果关联与长期记忆效应。实验表明,该模型在全球多站点数据集上优于现有基线方法,尤其在极端天气事件预测中的表现更为突出。这一工作为气象预报领域提供了一种高效且可扩展的深度学习范式。 #人工智能 #天气预报 #状态空间模型 #三轴建模 #TSSM #深度学习 #气象学 #arXiv
从神经网络中定向恢复权重空间机制的新方法

一篇由Antoine Vigouroux等人提交至arXiv的论文提出了从神经网络中定向恢复权重空间机制的方法。该方法旨在解析神经网络内部复杂的权重空间结构,实现对特定功能模块的精准定位与恢复,有助于提升模型的可解释性和安全性。研究团队通过实验验证了该方法的有效性,为理解深度学习模型的内部工作机制提供了新工具。 #神经网络 #权重空间 #可解释性 #AI安全 #深度学习 #arXiv #学术研究
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
从零实现自动微分:PyTorch在物理信息神经网络中如何计算梯度

一篇题为《从零实现自动微分:PyTorch如何在物理信息神经网络中计算梯度》的论文近日在arXiv上公开。作者Abdeladhim Tahimi深入探讨了自动微分的底层原理,详细阐述了如何在不借助高级框架的情况下自行构建这一核心技术。论文重点聚焦物理信息神经网络(PINNs),系统解释了PyTorch如何通过自动微分机制高效计算损失函数对网络参数的梯度,从而满足物理方程约束。这项工作为理解深度学习中的梯度计算提供了从理论到实践的完整路径,对PINNs的研究与教学具有重要参考价值。 #自动微分 #PyTorch #物理信息神经网络 #PINNs #深度学习 #梯度计算 #arXiv #论文
部分观测结构因果模型

一篇题为《Partially Observed Structural Causal Models》(部分观测结构因果模型)的论文已在arXiv预印本平台发布。该论文由Turan Orujlu等四位作者撰写,首次提交于2026年5月5日,并在后续更新了第二版本。论文聚焦于因果推断中观测数据不完整(如存在隐变量或缺失值)时的结构因果建模问题,提出了相应的理论框架与算法。该工作旨在扩展传统结构因果模型对部分观测场景的适用性,提升因果分析在实际数据中的应用能力。 #部分观测结构因果模型 #因果推断 #arXiv #论文 #TuranOrujlu #结构方程模型
广义指数梯度方法增强分类公平性

该研究提出一种广义指数梯度优化方法,旨在提升二分类及多分类任务中的算法公平性。传统分类模型常因数据偏差导致对特定群体的不公平对待,而现有公平性约束方法往往在准确率与公平性间难以平衡。研究者通过扩展指数梯度算法,使其能适应多类别场景,并引入可调节的公平性约束项。实验表明,该方法在多个公开数据集上相较于基线模型,在保持分类精度的同时显著降低了群体间的不平等指标,尤其对性别、种族等敏感属性具有更强的鲁棒性。论文还讨论了该方法在不同分类任务中的泛化能力及实际应用潜力。 #机器学习 #公平性 #分类算法 #指数梯度 #AI公平 #多分类 #优化方法
三角最优传输映射用于滤波的误差分析

一篇题为《Error Analysis of Triangular Optimal Transport Maps for Filtering》的论文近日在arXiv预印本平台发布。该研究聚焦于三角最优传输映射在滤波问题中的误差分析,作者通过理论推导和数值验证,系统分析了该映射在滤波过程中的近似误差与收敛性质,提出了误差界估计方法。研究工作为最优传输理论在信号处理、数据同化等领域的实际应用提供了数学基础,有助于提升滤波算法的精度与稳定性。 #arXiv #最优传输 #滤波 #误差分析 #三角映射 #数学 #信号处理 #机器学习 #预印本
在线资源分配新研究

近日,一篇题为《受约束在线资源分配中的效率、可行性与激励感知》的学术论文在arXiv平台发布。该研究由Yan Dai等人完成,聚焦于在线资源分配问题中效率、可行性与激励感知三者的平衡。论文深入分析了在资源有限且存在约束条件下,如何设计机制以实现社会福利最大化,同时确保分配方案的可行性并防止参与者策略性操纵。研究成果对于云计算资源调度、广告投放、网络带宽分配等实际应用具有重要理论指导意义,为构建更加公平高效的在线资源分配系统提供了新思路。 #在线资源分配 #效率 #可行性 #激励感知 #机制设计 #学术论文 #arXiv #资源调度
深加权多项式对非对称增长与衰减函数的均匀逼近

该论文提出了一种使用深度加权多项式网络来均匀逼近具有非对称增长与衰减特性的函数的新方法。研究团队通过构造特定的加权多项式层,有效解决了传统逼近方法在处理函数左右增长/衰减速率不一致时的精度瓶颈。理论分析证明了该网络在加权范数下的逼近阶,数值实验验证了其相比标准多项式基函数在边界区域和极端变化区域的显著优势。该工作为深度学习在科学计算与函数逼近领域的应用提供了新的理论支撑。 #深度学习 #函数逼近 #加权多项式 #神经网络 #科学计算 #数学 #理论创新 #AI #arXiv
切片最优传输分布匹配收敛速率研究取得理论突破

一篇题为《Convergence Rates for Distribution Matching with Sliced Optimal Transport》的论文被国际机器学习顶会COLT 2026接收。该研究由Gauthier Thurin(ENS-PSL)等学者完成,深入分析了基于切片最优传输(Sliced Optimal Transport)进行概率分布匹配时的收敛速率。切片最优传输通过将高维分布投影到一维直线,极大降低了计算复杂度。论文给出了在有限样本下该方法的误差上界,证明了其相较于传统最优传输方法在收敛速度上的优势,为生成模型、领域适应等应用提供了坚实的理论保障。该成果将于2026年6月在美国圣地亚哥举行的COLT会议上正式发布。 #机器学习 #最优传输 #分布匹配 #收敛速率 #COLT2026 #理论计算机科学 #概率论
利用可微偏分方程求解器实现稀疏测量下的半神经空间重建

来自arXiv预印本的一篇研究提出了一种新方法,将可微偏微分方程求解器与神经网络相结合,用于从稀疏测量数据中重建空间场。该方法被称为“半神经空间重建”,旨在克服传统纯数据驱动或纯物理模型方法的局限性。研究团队利用可微PDE求解器作为可学习的物理先验层,使网络能够在不依赖大量标注数据的情况下,从稀疏、不完整的观测中推断出高分辨率空间分布。实验表明,该技术在地球物理、气候科学和工程检测等需要从有限传感器数据重建连续场的领域具有潜在应用价值,有望显著降低对密集采样网络的依赖。 #arXiv #论文 #可微PDE #半神经网络 #空间重建 #稀疏测量 #科学计算
自适应共形推断新视角:Blackwell Approachability 的应用

一篇题为《通过 Blackwell Approachability 视角的自适应共形推断》的论文在 arXiv 上发表。该研究由 Guillaume Principato 和 Gilles Stoltz 完成,旨在将博弈论中的 Blackwell Approachability 理论引入自适应共形推断领域,以提升预测区间的覆盖保证与统计效率。传统共形推断在处理分布变化或序列数据时存在局限性,而该论文通过动态调整推断策略,实现了在不确定环境下的稳健性能。研究为机器学习中的不确定性量化提供了新的理论工具,对在线预测、风险控制等应用具有潜在价值。 #机器学习 #共形推断 #BlackwellApproachability #自适应 #博弈论 #不确定性量化 #学术论文
线性最优传输独立成分分析新方法提出

近日,一篇题为《Linear Independent Component Analysis via Optimal Transport》的学术论文在arXiv预印本平台发布。该研究由Ashutosh Jha等人完成,提出了一种基于最优输运理论的线性独立成分分析新方法。独立成分分析是信号处理和机器学习中的经典技术,旨在将多变量信号分解为统计独立的源成分。传统方法通常依赖于高阶统计量或非高斯性假设,而该工作利用最优输运框架,从分布匹配的角度重新诠释了线性独立成分问题,并给出了理论上的可识别性条件。实验结果表明,新方法在合成数据和实际应用场景中均展现出良好性能,为盲源分离问题提供了新的解决思路。该研究得到学界关注,目前可通过arXiv获取全文。 #机器学习 #独立成分分析 #最优传输 #信号处理 #学术论文 #AI #arXiv
基于似然深度学习的散斑回归极小极大理论

近日,一篇题为《Minimax Theory of Likelihood-Based Deep Learning for Speckle Regression》的学术论文在arXiv平台预发布。该论文由学者Soham Jana撰写,提出了一种针对散斑回归问题的基于似然函数的深度学习极小极大理论。研究聚焦于在图像散斑噪声建模中,从统计学角度分析深度网络的逼近误差与泛化界,推导了最优收敛速率。这一理论框架有望为光学成像、超声医学等领域的散斑噪声去除提供更严谨的数学基础。 #深度学习 #散斑回归 #极小极大理论 #统计学习 #arXiv #计算机视觉
新论文提出吹哨人可否认性保证机制

arXiv 上最新发布的一篇论文《Plausible Deniability Guarantees for Whistleblowers》由 Leo Richter 等人撰写。该研究聚焦于保护吹哨人隐私,提出了一种可否认性保证机制,使举报人在揭露内部不当行为时能够合理否认自己进行了举报,从而降低被报复的风险。论文探讨了相关技术原理与应用场景,为信息安全与隐私保护领域提供了新的思路。 #学术论文 #arXiv #吹哨人 #隐私保护 #数据安全 #可否认性 #科技研究
干预分布公式验证方法研究

近日,一篇题为《Verifying formulas for interventional distributions》的论文提交至arXiv预印本平台。该研究由Francesco Freni等人完成,旨在开发验证因果推断中干预分布公式的可靠方法。论文探讨了如何系统性地检查干预分布表达式的正确性,这对于因果科学和机器学习领域具有重要理论意义。相关代码和资源已在论文页面提供,供学界进一步研究和复现。 #arXiv #因果推断 #干预分布 #公式验证 #机器学习 #论文
Heavy-Tailed Flow Matching via Random Clocks

该论文由Zhouhao Yang等作者于2026年7月15日提交至arXiv。研究提出了一种名为“重尾流匹配”的新方法,通过引入随机时钟机制来改进对重尾分布的建模能力。该方法在生成模型领域具有潜在应用,旨在解决传统流匹配模型在处理长尾或极端值分布时的局限性。论文全文可在arXiv上获取。 #论文 #机器学习 #生成模型 #流匹配 #重尾分布 #随机时钟 #arXiv #AI研究
代数可表示性作为Grokking的极限状态

该研究提出一个具有全纯激活函数的精确可解模型,将代数可表示性视为神经网络中“grokking”现象(即长期训练后突然泛化)的极限状态。通过解析分析,作者证明了在特定条件下,模型的表示能力会收敛到代数结构,从而揭示了grokking的涌现机制。这一理论框架为理解深度学习中的隐式偏置和泛化现象提供了新的数学基础,有助于解释模型为何能在过拟合后突然实现泛化。 #机器学习 #深度学习 #Grokking #代数可表示性 #神经网络 #AI #理论研究 #arXiv #数学
DAGR:通过差异感知目标交叉注意力实现状态条件的目标表示

来自arXiv的预印本论文提出了一种名为DAGR(Difference-Aware Goal Cross-Attention)的新方法,用于强化学习中的目标表示。该方法通过差异感知机制,使智能体能够根据当前状态动态调整对目标的关注,从而更有效地学习状态与目标之间的关联。传统目标表示往往固定不变,而DAGR通过交叉注意力模块捕捉状态与目标的差异信息,生成更灵活的状态条件目标表征。实验表明,该方法在多个连续控制任务中显著提升了成功率与样本效率,为复杂环境下的目标导向策略学习提供了新思路。论文作者来自多所机构,目前已在arXiv上公开全文。 #arXiv #DAGR #强化学习 #目标表示 #注意力机制 #机器学习 #机器人 #学术论文
向量搜索中的拍卖聚类

一篇题为"Cluster with Auctions for Vector Search"的论文于2026年7月15日提交至arXiv预印本平台,作者包括Swann Bessa等五人。该研究提出了一种将拍卖机制引入向量搜索聚类过程的新方法,旨在通过竞价策略优化高维向量的分组与检索效率。传统向量搜索依赖静态聚类或近似最近邻算法,但在大规模数据下常面临精度与速度的权衡。该论文的方法通过引入拍卖框架,让数据点根据与簇中心的相似度进行动态竞标,从而自适应地形成更合理的聚类结构。这种设计有望改善向量搜索的召回率与查询响应时间,尤其适用于推荐系统、图像检索等高效搜索场景。目前论文提供PDF和HTML版本,具体技术细节和实验验证需通过全文查阅。 #向量搜索 #聚类 #拍卖机制 #机器学习 #arXiv #论文 #高维数据 #检索效率
新研究提出规范不变且参数不敏感的正则化方法用于有向图势恢复

近日,一篇题为《规范不变、参数不敏感的正则化方法用于有向图势恢复》的论文提交至arXiv。该研究针对从有向图上的流数据中恢复潜在势函数这一经典反问题,提出了一种全新的正则化框架。该方法的核心优势在于具备规范不变性(Gauge-Invariance)以及对正则化参数变化的不敏感性(Parameter-Insensitivity),从而提高了恢复结果的稳定性和鲁棒性。相关工作有望在交通网络分析、生物信息流、分布式系统监控等领域发挥重要作用。该论文由Mohammad Hossein Forouhesh Tehrani等人完成,目前已在arXiv上开放获取。 #有向图 #势恢复 #正则化 #规范不变性 #arXiv #论文 #机器学期 #网络分析