AI知识库 @ai521
344 subscribers
23.7K photos
42 videos
20 files
904 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
DiPhon

一篇题为《DiPhon: Diffusion on Graphons for Scalable Graph Generation》的学术论文近日在arXiv预印本平台发布。该研究由Sergio Rozada等五位作者共同完成,提出了一种创新的图生成框架,将扩散模型与图on(Graphon)理论相结合,旨在解决现有图生成方法在大规模图数据上的可扩展性问题。图on作为无限图的极限对象,能够表示任意大小的图结构,而扩散模型在其中运行可有效捕捉图的全局与局部特征。该方法在保证生成质量的同时显著降低计算复杂度,为社交网络、生物信息学等领域的大规模图生成任务提供了新思路。论文已提供PDF全文及HTML实验版本,并附带代码链接,目前处于2026年7月的最新提交版本。 #图生成 #扩散模型 #图on #可扩展性 #arXiv #AI #论文 #图神经网络
面向隐马尔可夫和因子隐马尔可夫模型的张量化算法与可扩展滤波方法

近日,一篇来自arXiv的学术论文提出了一系列张量化的算法与可扩展的滤波方法,旨在解决隐马尔可夫模型(HMM)及因子隐马尔可夫模型(FHMM)在大规模数据下的计算效率问题。论文作者Roxana Barrios等人通过引入张量结构,对传统推理流程进行重构,显著降低了状态空间爆炸带来的计算复杂度。该方法不仅适用于经典HMM,还能高效处理FHMM中多链交互的滤波难题。实验表明,该框架在保持精度的前提下大幅提升了可扩展性,有望推动HMM在语音识别、生物信息学、时间序列分析等领域的实际应用。 #隐马尔可夫模型 #张量化 #滤波方法 #机器学习 #AI #学术论文 #算法 #可扩展性
随机凸优化问题中稳定点寻找方法研究论文发布

据arXiv预印本平台显示,一篇题为《Finding a stationary point of a stochastic convex problem》的学术论文于2026年7月8日提交。该论文由Felipe Areces、John Duchi和Malo Sommers共同撰写,聚焦于随机凸优化问题中稳定点的求解方法。研究有望为机器学习、统计学习等领域中的优化问题提供理论支撑,相关算法和分析对理解随机凸问题的收敛性具有重要意义。目前论文提供PDF和HTML版本,并附有引用工具及代码链接,供学术界参考。 #arXiv #机器学习 #凸优化 #随机算法 #论文 #优化理论 #学术研究
张量列扩散

该论文提出了一种名为“张量列扩散”的新方法,旨在通过利用张量列(Tensor Train)的低秩结构来改进高维空间中基于分数的采样。在扩散模型中,高维数据的采样往往面临巨大的计算复杂度和存储开销。作者引入张量列分解对评分函数进行低秩近似,从而显著降低模型参数数量并提升采样效率。实验表明,该方法在多个高维基准数据集上能够保持生成质量的同时,大幅减少计算资源消耗。该工作已被ICML 2026接收,为扩散模型在高维应用场景下的实用化提供了新思路。 #机器学习 #扩散模型 #张量网络 #高维采样 #ICML2026 #低秩近似 #生成模型
流形加权测度的热核熵轮廓与几何有效样本量

一篇题为《流形加权测度的热核熵轮廓与几何有效样本量》的论文近日在arXiv上发布。该研究由Kisung You完成,提出了一种基于热核的熵轮廓分析方法,用于量化流形上加权测度的几何特性。通过引入几何有效样本量的概念,论文为高维数据在流形上的采样质量评估提供了新工具,有望在机器学习、统计推断和几何数据分析等领域发挥重要作用。 #流形学习 #热核 #熵 #几何有效样本量 #数据分析 #机器学习 #arXiv #论文
快速确定性采样方法在一般空间与扩散几何中的新进展

一篇题为《Fast determinantal sampling on general spaces and diffusion geometry》的学术论文于2026年7月7日提交至arXiv预印本平台。该论文由Hoang-Son Tran等三位作者共同完成,主要探讨在一般空间与扩散几何背景下,如何实现快速确定性采样。研究提出了一种新的算法框架,旨在提高采样效率,并可能对机器学习、统计学及数学领域中的相关应用产生重要影响。论文目前可通过arXiv获取PDF及HTML版本,并已开放TeX源码供研究者参考。 #arXiv #确定性采样 #扩散几何 #机器学习 #数学 #统计学 #学术论文
不精确概率下的信息价值:决策规则特定值与信度集上的固定测度包络

该论文研究了在不精确概率框架下信息价值的量化问题。传统信息价值理论通常假设精确概率,但在实际决策中,概率往往是不精确的。作者提出了一种新方法,通过定义决策规则特定值(Decision-Rule-Specific Values)和固定测度包络(Fixed-Measure Envelopes)来评估信度集(Credal Set)上的信息价值。该方法能够为不同决策规则提供针对性的信息价值度量,并利用固定测度包络处理概率分布的不确定性。论文为不精确概率环境下的决策分析提供了理论工具,有望应用于风险管理、人工智能和统计推断等领域。 #arXiv #论文 #不精确概率 #信息价值 #决策理论 #信度集 #固定测度包络 #决策规则 #风险分析 #人工智能
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
Dynamic-in-Few-Step:统一动态计算与少步蒸馏实现高效视频生成

一篇发表于arXiv的论文提出名为“Dynamic-in-Few-Step”的视频生成方法,旨在统一动态计算与少步蒸馏技术,以提升视频生成的效率。传统视频生成模型往往依赖大量计算资源和多步采样,生成速度较慢。该工作通过结合动态计算机制,在推理过程中根据输入复杂度动态分配计算资源,并利用少步蒸馏技术大幅减少所需采样步数,从而在不牺牲生成质量的前提下显著加速视频生成过程。实验结果表明,该方法在多个基准数据集上实现了速度和质量的良好平衡,为实时视频生成应用提供了新的技术路径。 #视频生成 #动态计算 #少步蒸馏 #高效推理 #arXiv #AI #深度学习 #计算机视觉
跨轨迹嵌合体干预揭示权重幅度和方向在Grokking中的可分离作用

这篇来自arXiv的论文(2026年7月预印本)聚焦神经网络中的“Grokking”现象——模型在长时间过拟合后突然泛化的机制。作者提出一种新颖的“跨轨迹嵌合体干预”方法,通过混合不同训练阶段检出的权重幅度与方向,系统研究二者在泛化过程中的独立贡献。实验结果显示,权重方向主导神经网络的泛化能力,而权重幅度主要影响收敛速度与训练稳定性。该发现将Grokking的成因拆解为两个可分离的维度,为理解深度学习中的突然泛化行为提供了新的理论框架,并可能启发更高效的训练算法设计。 #arXiv #深度学习 #Grokking #神经网络 #权重分析 #泛化 #AI研究 #机器学习
专家模型适应中的开放式场景推理方法研究

一篇题为“Open-Ended Scenario Reasoning for Specialist Model Adaptation”的研究论文近日在arXiv上预印发布。该论文由Youcheng Zong等四位作者共同完成,提交时间为2026年7月7日。研究聚焦于专家模型在开放式场景下的适应问题,提出了一种基于场景推理的方法,旨在提升模型面对复杂、非预设环境时的泛化与决策能力。论文提供了完整的PDF、HTML及TeX源文件,并附有相关代码和数据链接,可供学术界进一步参考与复现。 #计算机科学 #人工智能 #机器学习 #模型适应 #场景推理 #arXiv #学术论文
LLM 引导的任务语义场分解方法,助力工业过程预测

近日,一篇题为《LLM-Guided Task-Semantic Field Factorization for Industrial Process Forecasting》的论文在 arXiv 上预发布。该研究由 Youcheng Zong 等三位作者共同完成,提出了一种结合大语言模型(LLM)的任务语义场分解方法,用于工业过程预测。该方法通过利用 LLM 的语义理解能力,对工业过程中的复杂任务进行分解与特征提取,从而提升预测精度和泛化能力。传统工业预测模型往往依赖手工特征工程,而该研究引入语义场概念,将任务相关的语义信息融入分解过程,实现了更高效的特征表示。论文还展示了在多个工业数据集上的实验效果,表明该方法在预测准确性上优于现有基线模型。该工作为工业智能化和过程控制提供了新的技术思路,有望应用于制造、能源等领域。 #AI #大模型 #工业预测 #机器学习 #语义场 #LLM #论文 #arXiv
SpaR3D-MoE

近日,一篇题为"SpaR3D-MoE"的论文在arXiv预印本平台发布。该研究提出了一种自适应3D空间推理模型,旨在解决从稀疏视图进行3D推理的难题。模型创新性地将几何归纳偏置与混合专家(MoE)架构相结合,能够高效利用有限视角信息进行准确的3D空间理解。实验表明,该方法在多个基准上显著优于现有技术,为计算机视觉和机器人导航等领域提供了新思路。论文由Haida Feng等作者完成。 #3D推理 #计算机视觉 #混合专家 #稀疏视图 #arXiv #AI #空间智能
NLPCC 2026 共享任务聚焦多语言多模态医学教学视频理解难度评估

该任务由Shenxi Liu等人提出,旨在推动多语言、多模态医学教学视频理解评估的研究,特别引入了“难度感知”维度。任务要求模型同时处理视频、语音、文本等多种模态信息,并准确理解不同语言下医学教学内容的复杂程度。这一研究有望提升医疗教育资源的智能化利用水平,为跨语言、跨模态的AI理解能力设立新基准。相关论文已在arXiv预印本平台发布,详细介绍了任务设计、评估指标及基线方法。 #NLPCC #共享任务 #医学教学视频 #多模态 #多语言 #难度感知 #人工智能 #自然语言处理
Inertia-1

由Zongzhe Xu等六位研究人员共同完成的论文《Inertia-1: An Open Exploration of Wearable Motion Foundation Models》近日在arXiv上公开。该研究聚焦于可穿戴设备中的运动数据建模,提出了一种名为Inertia-1的基础模型框架,旨在通过大规模预训练和开放生态推动运动感知技术的标准化与可复用性。论文以开放获取形式发布,并附有源代码和数据集链接,为后续研究者提供了可复现的基准。这一工作有望加速智能穿戴设备在健康监测、运动分析和人机交互等领域的应用落地。 #科技 #论文 #可穿戴设备 #运动模型 #Inertia-1 #基础模型 #开放科学 #人工智能
预算感知的合成增强缓解联邦学习标签偏斜问题

一篇来自2026年的arXiv论文提出了一种针对联邦学习中标签分布不均问题的解决方案。研究团队指出,在参与联邦学习的客户端数据存在标签偏斜时,传统的本地数据增强方法效果有限,且生成数据的成本需纳入考量。为此,他们提出了一种预算感知的合成数据增强框架,通过智能选择生成位置和内容,在有限的生成预算下最大程度提升模型性能。实验表明,该方法能有效缓解标签偏斜带来的模型精度下降,同时节约计算资源。该工作为联邦学习在实际场景中应对非独立同分布数据提供了新的思路。 #联邦学习 #标签偏斜 #数据增强 #合成数据 #机器学习 #AI #论文 #联邦学习 #数据分布 #预算优化
STAGformer:面向微移动出行需求的时空智能体图Transformer

该论文提出一种名为STAGformer的时空智能体图Transformer模型,旨在提升微移动出行需求预测的准确性。微移动(如共享单车、电动滑板车)在现代城市交通中日益普及,但其需求受时空交互和个体行为影响,传统模型难以精确捕捉。STAGformer通过构建智能体图结构,将用户、站点和时空上下文建模为图节点与边,并利用Transformer架构处理长程依赖和动态变化。实验表明,该模型在多个真实数据集上优于现有基准,显著降低了预测误差,为城市智能交通系统提供了更高效的调度与资源分配方案。 #STAGformer #微移动 #需求预测 #时空图 #Transformer #人工智能 #智能交通 #论文
PRoVeFL 框架:实现联邦学习中的隐私、鲁棒与可验证聚合

一篇题为“PRoVeFL: Private Robust and Verifiable Aggregation in Federated Learning”的论文近日在 arXiv 上发布。该研究由 Harsh Kasyap 等人提出,旨在解决联邦学习中数据隐私、模型鲁棒性和聚合结果可验证性这三个核心挑战。PRoVeFL 框架通过结合密码学技术与鲁棒聚合算法,确保客户端本地数据不被泄露的同时,能够抵御恶意攻击者或异常参与者的干扰,并允许任何一方对聚合结果进行公开验证。该方法有望提升联邦学习在金融、医疗等对隐私和安全要求极高领域的实用性与可信度。论文详细介绍了其协议设计、安全性分析及实验验证结果。 #联邦学习 #隐私保护 #鲁棒性 #可验证聚合 #密码学 #arXiv #论文 #AI #安全
音频情感分析新方法

一篇arXiv预印本论文提出,通过知识蒸馏和跨模态集成技术,利用生成的多语言转录文本进行音频情感分析。研究团队(Andrei-George Durdun等)探索了如何将语音信号与自动生成的多种语言转录相结合,借助蒸馏方法压缩模型,并跨模态融合音频与文本特征,以提升情感识别的准确性和泛化能力。该方法有望解决多语言场景下音频情感分析的数据稀缺与模型迁移难题,为语音情感计算领域提供新思路。论文已提交至arXiv,并开放PDF全文。 #音频情感分析 #跨模态学习 #知识蒸馏 #多语言 #语音识别 #情感计算 #AI #arXiv
深度强化学习实现可靠双目标投资组合优化

一篇题为《基于可靠性的双目标投资组合优化深度强化学习》的学术论文近日在arXiv预印本平台发布。该研究由Sounaq Das等三位学者共同完成,提出利用深度强化学习方法,在考虑投资组合可靠性的前提下,同时优化收益与风险两个目标。传统投资组合优化往往仅关注收益最大化或风险最小化,而该研究将可靠性作为约束条件,通过强化学习智能体在动态市场环境中学习最优配置策略。实验结果表明,该方法在平衡收益、风险与可靠性的综合表现上优于传统模型,为金融投资决策提供了新的技术路径。 #深度强化学习 #投资组合优化 #可靠性 #双目标优化 #金融科技 #量化投资 #arXiv论文
D2PO

来自arXiv的论文显示,Jinkyu Kim等研究者提出了一种名为D2PO的新方法,旨在通过动态偏好来优化扩散模型的采样器。扩散模型在生成领域应用广泛,但采样器效率与质量一直是挑战。D2PO通过引入动态偏好机制,自适应调整采样过程,从而提升生成质量和计算效率。该方法在多个基准测试上表现优异,有望推动扩散模型在图像、音频等生成任务中的实际应用。论文已提交至arXiv平台,并公开了相关代码与数据。 #论文 #扩散模型 #采样优化 #AI #生成模型 #科研