AI知识库 @ai521
706 subscribers
30.2K photos
59 videos
27 files
1.25K links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
SP3O: 从片段偏好出发的强化学习新方法,无需奖励建模

一篇来自arXiv的论文提出了一种名为SP3O的强化学习新方法,该方法无需显式奖励建模,而是直接从片段偏好中学习。论文由Evan Assmus等人提交,于2026年8月3日发布。SP3O通过将人类对行为片段的偏好信号直接转化为学习信号,避免了传统RL中复杂的奖励函数设计,有望在机器人控制、游戏AI等领域降低训练成本并提高样本效率。该研究尚在预印本阶段,代码与数据已通过相关平台开放。 #强化学习 #SP3O #偏好学习 #机器学习 #AI研究 #arXiv
航班时刻表驱动的机场安检吞吐量逐时预测新方法

来自arXiv的一篇最新研究论文提出了一种基于航班时刻表信息的时间融合预测模型,用于精准预测机场每小时安检通道的客流量。该模型将航班计划时刻表作为关键输入,融合时间序列特征,有效提升了预测的准确性。研究指出,机场安检吞吐量受航班起降时间、旅客密度等因素影响,传统方法难以捕捉其动态变化。新方法通过引入时间融合机制,能够更好地利用时刻表信息,为机场运力调度和旅客分流提供决策支持,有望减少排队时间,提升安检效率。该研究由Yinxiao Zhang等人完成,目前已在arXiv上发布。 #机场安检 #预测模型 #航班时刻表 #时间序列 #AI #交通 #学术论文
Rubrics 作为特权信息提升开放式生成任务质量

Deepika Bablani 等研究者近日在 arXiv 上发布论文《Rubrics as Privileged Information for Open-Ended Generation》,提出将评分标准(rubrics)作为训练过程中的特权信息,以改善开放式生成任务的效果。所谓特权信息,是指在训练时可用但推理时不可用的额外知识。该研究通过将人工设计的评分标准融入模型训练,使生成结果更符合既定评价维度,从而在文本摘要、问答等开放性任务中取得更优性能。论文已提交至 arXiv,并附有完整 PDF 及实验代码链接。 #论文 #AI #生成模型 #自然语言处理 #机器学习
ATFlash 提出基于 RoPE 波长的注意力窗口,优化 LLM 推理效率

这篇论文提出了一种名为 ATFlash 的新方法,针对大型语言模型推理中的注意力机制进行优化。通过为每个旋转位置编码(RoPE)波长设定独立的注意力窗口,ATFlash 能够动态调整注意力范围,在不显著损失模型精度的前提下大幅减少计算量和内存占用。实验结果显示,该方法在处理长序列输入时尤为高效,显著提升了推理速度并降低了显存需求,为资源受限环境下的 LLM 部署提供了可行方案。该研究已在 arXiv 上以预印本形式发布。 #论文 #LLM #注意力机制 #AI推理 #RoPE #计算效率 #内存优化 #arXiv
基于CNN-BiLSTM模型的可穿戴传感器久坐行为分类研究

近日,一篇题为《基于CNN-BiLSTM模型的可穿戴传感器久坐行为分类》的学术论文在arXiv预印本平台发布。该研究由Yuliang Chen等13位学者共同完成,提出了一种结合卷积神经网络(CNN)与双向长短期记忆网络(BiLSTM)的混合模型,用于从可穿戴传感器数据中准确识别久坐行为。实验表明,该模型在捕捉时间序列特征和空间特征方面具有优势,可有效提升分类精度,为健康监测与运动分析提供了新的技术方案。论文已开放全文下载,相关代码与数据资源同步公开。 #可穿戴传感器 #久坐行为 #CNN #BiLSTM #深度学习 #健康监测 #论文 #arXiv
联邦生成事件模型助力电子健康记录隐私保护

近日,一篇题为《Federated generative event models for tokenized electronic health records》的论文在arXiv预印本平台发布。该研究由Michael C. Burkhart等学者提出,旨在利用联邦学习框架构建生成式事件模型,处理经过标记化处理的电子健康记录数据。传统医疗数据共享面临隐私泄露风险,而联邦学习允许模型在本地训练,仅聚合参数更新,无需集中原始数据。论文创新性地将生成式模型与事件序列建模相结合,在保护患者隐私的同时,实现高保真度的数据生成。实验表明,该模型能够有效模拟真实医疗事件的时间动态,为下游任务如疾病预测、临床决策支持提供高质量合成数据。这一方法有望推动医疗AI在合规前提下加速发展,促进跨机构协作。 #联邦学习 #生成模型 #电子健康记录 #隐私保护 #医疗AI #arXiv #论文
图注意力稀疏化研究

来自arXiv的一项新研究探讨了图注意力机制中何时应该采用稀疏化策略。论文提出了一种方法,通过学习每条边的Tsallis指数来动态决定注意力权重是否需要稀疏化,从而在保持模型表达能力的同时提升计算效率。该方法能够根据图结构特征自适应调整,在多个基准数据集上取得了优于传统固定稀疏化策略的性能表现。该研究为图神经网络的高效设计提供了新的思路。 #图神经网络 #注意力机制 #稀疏化 #Tsallis指数 #机器学习 #AI #论文 #深度学习
利用客户基础驱动因素预测收入

一项最新研究探讨了如何利用客户基础驱动因素进行收入预测,并分析了协调机制在其中的作用。来自Kyeongbin Kim等人的论文《Forecasting Revenue with its Customer-Base Drivers: When and Why Coordination Helps》指出,传统的收入预测往往忽略客户行为数据,而该研究通过将客户获取、留存、流失等动态指标纳入模型,显著提升了预测准确性。研究进一步揭示,在销售、市场与财务部门之间进行协调,能够更有效地整合分散的客户数据,从而优化预测结果,减少误差。该工作为企业在动态市场中制定精准收入策略提供了理论依据和实践指导。 #收入预测 #客户基础 #协调机制 #商业分析 #数据驱动 #论文研究
贝叶斯数据重加权提升多模态检索,增强知识型视觉问答

一项最新研究提出,通过贝叶斯数据重加权方法可显著改进多模态检索在知识型视觉问答任务中的表现。该方法基于贝叶斯推断,对训练数据中的不同样本进行自适应权重分配,从而优化检索模型对多模态信息(如图像与文本)的整合能力。实验结果表明,该方法在多个标准基准上均取得了性能提升,尤其在处理复杂跨模态关联时效果突出。该研究为提升视觉问答系统的知识利用效率提供了新思路,有望推动相关应用在智能教育、医疗辅助、自动驾驶等领域的发展。 #贝叶斯方法 #数据重加权 #多模态检索 #视觉问答 #人工智能 #机器学习 #计算机视觉 #知识推理
AnchorKV 论文提出锚点残差 KV 缓存压缩方法

一篇题为《AnchorKV: Anchor-Residual KV Cache Compression》的学术论文于近日提交至 arXiv 预印本平台。该论文由 Malik Khalaf 等四位作者共同完成,主要关注大语言模型推理过程中的关键瓶颈——KV 缓存(Key-Value Cache)的存储与计算开销。传统 KV 缓存机制在长序列推理时占用大量显存,限制了模型的实际部署效率。AnchorKV 提出一种基于锚点残差结构的压缩方案,通过保留重要锚点并压缩残差信息,显著降低缓存大小,同时保持模型输出质量。该工作有望在保持推理精度的前提下,大幅提升大模型在长文本生成、实时对话等场景中的运行效率和资源利用率。 #论文 #AI #大模型 #KV缓存 #压缩 #推理效率 #arXiv #机器学习
基于非确定性因果模型的鲁棒反事实策略优化方法

近日,一篇题为《Robust Counterfactual Policy Optimisation via Nondeterministic Causal Models》的论文在arXiv预印本平台发布。该论文由Jessica Lally等五位作者共同完成,提出了一种基于非确定性因果模型的鲁棒反事实策略优化方法。研究旨在解决传统反事实推理在不确定性环境下策略优化鲁棒性不足的问题,通过引入非确定性因果模型,增强了模型对复杂因果关系的建模能力,并提高了策略优化的稳定性和可靠性。论文目前提供PDF和HTML版本,并附有相关代码、数据及引用工具,供学术界进一步研究。 #arXiv #机器学习 #因果推理 #策略优化 #鲁棒性 #论文
基于广义福利优化的人口鲁棒特征选择方法

该论文提出了一种基于广义福利优化的人口鲁棒特征选择方法,旨在解决传统特征选择算法在面对不同人口群体时性能差异过大的问题。研究团队通过将福利经济学中的优化框架引入机器学习,构建了一个能够平衡群体间准确性和公平性的特征选择模型。该方法在多个基准数据集上进行了测试,实验结果表明,在保证整体预测性能的同时,显著降低了不同群体间的性能差异,提高了模型的公平性和鲁棒性。该工作为敏感场景下的特征选择提供了新的理论依据和实用工具。 #机器学习 #特征选择 #公平性 #鲁棒性 #人工智能 #论文 #arXiv
GoT-CD: 图思维因果发现及后验路径特定公平性审计的脆弱性

来自arXiv的一篇预印本论文提出了一种名为GoT-CD(图思维因果发现)的新方法,并揭示了后验路径特定公平性审计的脆弱性。该方法将大语言模型中的“思维链”概念扩展为“图思维”,通过构建因果图来发现变量间的因果关系。论文同时指出,现有的后验路径特定公平性审计方法在面对干预分布变化时存在根本性缺陷,容易产生误导性结果。这一发现对AI系统的公平性评估提出了重要警示,提示审计方法需要更鲁棒的设计。 #因果发现 #公平性审计 #图思维 #大语言模型 #AI安全 #arXiv
Maglev: Sliding Recurrent Memory 论文提交至arXiv

据arXiv预印本平台显示,一篇题为“Maglev: Sliding Recurrent Memory”的论文于2026年8月3日提交。该论文由Bo Liu等人撰写,提出了一种名为Maglev的滑动递归内存机制,旨在改进递归神经网络中的长期记忆能力。目前论文以PDF和HTML格式可供访问,尚未正式发表,正在等待DataCite的DOI注册。该研究可能对序列建模和机器学习领域产生影响。 #Maglev #递归内存 #滑动内存 #arXiv #机器学习 #神经网络 #预印本 #论文
对比不变深度叠层成像神经网络研究新进展

据arXiv预印本平台发布,研究人员提出了一种名为“对比不变深度叠层成像神经网络”的新方法。该研究由Albert Vong等作者完成,旨在解决传统叠层成像技术中因对比度变化导致的成像质量下降问题。通过引入深度学习架构,该网络能够在不同对比度条件下保持成像稳定性,无需额外校准即可实现高精度重建。这一成果有望推动计算光学成像领域的发展,为生物医学成像和材料科学提供更可靠的工具。论文于2026年8月提交,目前可在arXiv上获取全文。 #叠层成像 #深度学习 #对比不变 #arXiv #光学成像 #AI #科技论文
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
自适应采样助力灾后快速损伤评估,新方法基于成本感知贝叶斯优化

一篇发表于arXiv的论文提出了一种新型自适应采样方法,用于自动化灾后快速损伤评估。该方法结合了水平集(Level-Set)与成本感知贝叶斯优化(Cost-Aware Bayesian Optimization),旨在高效采集关键区域数据,以加速灾后建筑损伤的识别与评估。传统灾后评估依赖人工或随机采样,耗时且成本高,而新方法通过智能优先级排序,能在有限资源下最大化评估精度。该研究由Boyang Xu等人完成,相关代码与数据已公开,未来有望为应急救援提供实时决策支持。 #自适应采样 #灾后评估 #贝叶斯优化 #机器学习 #计算机视觉 #论文 #AI
NOMADD: Numerical Optimization of Models Adapting to Data Drift

Focus to learn more arXiv-issued DOI via DataCite (pending registration) Submission history From: Swapn Shah [ view email ] [v1] Mon, 3 Aug 2026 20:02:22 UTC (1,646 KB) Full-text links: Access Paper: View a PDF of the paper titled NOMADD: Numerical Optimization of Models Adapting to Data Drift, by Swapn Shah and 1 other authors View PDF HTML (experimental) TeX Source view license Current browse context: < prev | next > new | recent | 2026-08 Change to browse by: cs References & Citations NASA ADS Google Scholar Semantic Scholar export BibTeX citation Loading... BibTeX formatted citation × loading... Data provided by: Bookmark Bibliographic Tools Bibliographic and Citation Tools Bibliographic Explorer Toggle Bibliographic Explorer ( What is the Explorer? ) Connected Papers Toggle Connected Papers ( What is C
onnected Papers? ) Litmaps Toggle Litmaps ( What is Litmaps? ) Toggle scite Smart Citations ( What are Smart Citations? ) Code, Data, Media Code, Data and Media Associated with this Article alphaXiv Toggle alphaXiv ( What is alphaXiv? ) Links to Code Toggle CatalyzeX Code Finder for Papers ( What is CatalyzeX? ) DagsHub Toggle DagsHub ( What is DagsHub? ) GotitPub Toggle ( What is GotitPub? ) Huggingface Toggle Hugging Face ( What is Huggingface? ) ScienceCast Toggle ScienceCast ( What is ScienceCast? ) Demos Demos Replicate Toggle Replicate ( What is Replicate? ) Spaces Toggle Hugging Face Spaces ( What is Spaces? ) Spaces Toggle ( What is ? ) Related Papers Recommenders and Search Tools Link to Influence Flower Influence Flower ( What are Influence Flowers? ) Core recommender toggle CORE Recommender ( What is CORE? ) IArxiv recommender toggle IArxiv Recommender ( What is IArxiv? ) Author Venue Institution Topic About arXivLabs arXivLabs: experimental projects with community collaborators arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
布线胜过混合:Transformer 不同规模间的知识迁移研究

近日,一篇题为“Wiring Beats Blending: What Transfers Between Transformer Sizes — and What Doesn't”的论文在 arXiv 上预印发布。该论文由 Ravi Satya Durga Prasad Yenugula 撰写,主要探讨了在不同规模的 Transformer 模型之间,哪些知识能够有效迁移,哪些则不能。研究通过对比“布线”(wiring)与“混合”(blending)两种迁移策略,揭示了模型规模变化对知识转移效果的影响。这一发现对于理解大模型的可扩展性、优化模型训练策略以及跨尺度知识复用具有重要参考价值。论文已提供 PDF 及 HTML 版本供公开查阅。 #AI #Transformer #知识迁移 #论文 #arXiv #大模型 #机器学习 #深度学习
预测编码网络中的拓扑简化研究

近日,研究人员在arXiv上提交了一篇题为《Topological Simplification in Predictive Coding Networks》的预印本论文。该论文由Adam Shaw等五位作者共同完成,聚焦于预测编码网络中的拓扑简化问题。预测编码是一种源自神经科学的计算框架,常用于机器学习中的自监督学习和生成模型。拓扑简化旨在通过减少网络结构的冗余连接,提升计算效率与泛化能力。研究团队可能提出了新的算法或理论分析,以实现在保持预测编码性能的同时,对网络拓扑进行精简。这一工作有望推动高效脑启发计算模型的发展,并为理解生物神经网络中的信息处理机制提供新视角。论文目前已在arXiv平台公开,并可获取PDF全文。 #预测编码 #拓扑简化 #神经网络 #机器学习 #arXiv #预印本 #脑科学 #计算神经科学 #AI #高效计算