AI知识库 @ai521
343 subscribers
23K photos
42 videos
20 files
886 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
数据集选择

一项发表于arXiv的研究探讨了如何从众多基准测试任务中精选数据集,以确保模型排名能真实反映其能力。研究人员提出,当前流行的基准测试往往包含冗余或低区分度的任务,导致排名失真。他们开发了一种数据集选择方法,旨在保留那些对模型性能差异敏感且任务多样的样本,从而维持模型排名的稳定性和可迁移性。实验表明,精选后的子集不仅能大幅降低评估成本,还能更准确地预测模型在新任务上的表现。该研究为构建高效、有意义的AI评估体系提供了新思路,有助于推动模型评测标准化进程。 #AI #机器学习 #基准测试 #数据集选择 #模型排名 #arXiv #论文 #人工智能
正样本学习中的意外发现

一项来自arXiv的新研究《Surprises in Proper Positive-Only Learning》由Shai Ben-David、Farnam Mansouri、Anay Mehrotra和Manolis Zampetakis共同完成。该论文深入探讨了仅使用正样本进行机器学习(positive-only learning)时出现的反直觉现象。传统观点认为,在只有正样本而无负样本的情况下,模型仍能有效学习,但本研究通过严格的理论分析,揭示了在“合适”(proper)的设定下——即学习器必须输出属于原始概念类别的假设——会面临意想不到的困难。例如,某些简单概念类在正样本条件下无法被PAC学习,除非样本规模远超预期。这些发现挑战了以往对正样本学习能力的乐观估计,并为该领域提供了新的理论边界。论文已通过arXiv预印本平台发布,并提供了PDF和HTML版本供研究者查阅。 #机器学习 #正样本学习 #理论计算机科学 #PAC学习 #arXiv #人工智能 #新发现
局部Fokker-Planck几何助力分数估计

arXiv预印本平台上发表了一篇题为《用于分数估计的局部Fokker-Planck几何:热球均值表示与精确高维采样》的论文。该研究由Jiayao Bai等人提出,旨在解决高维概率分布分数估计中的几何表示与采样效率问题。论文首次将局部Fokker-Planck方程与热球均值表示相结合,推导出分数函数的精确闭式表达,从而在高维空间实现无偏采样。这一方法规避了传统分数匹配中的数值误差与计算瓶颈,为扩散模型、生成式AI等领域的理论分析提供了新工具。研究还展示了该方法在数学和统计学习中的潜在应用价值,有望推动高维数据建模的发展。 #论文 #arXiv #FokkerPlanck #分数估计 #高维采样 #生成模型 #AI #机器学习
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
对抗性污染与硬阈值相遇:一种具有信号自适应性和极小极大最优性的迭代算法

Shixiang Liu等人在arXiv提交的最新论文中,提出了一种结合对抗性污染与硬阈值方法的迭代算法。该算法能够自适应地处理信号中的污染,并在理论上证明了其达到极小极大最优性。研究聚焦于在存在对抗性污染的场景下,如何通过硬阈值迭代实现鲁棒的信号恢复,为相关领域提供了新的理论框架与实用工具。论文已以PDF形式公开,并附有TeX源码,目前可在arXiv平台上获取。 #论文 #算法 #对抗性污染 #硬阈值 #信号自适应 #极小极大最优 #arXiv #机器学习 #统计学习 #迭代算法
重尾分布下全局最小方差组合协方差估计的决策几何

该论文研究在重尾分布条件下,全局最小方差投资组合的协方差估计问题。作者提出了一种基于决策几何框架的协方差估计方法,通过分析数据分布的厚尾特征,优化了协方差矩阵的估计精度。该方法旨在提高极端市场环境下投资组合的稳健性,降低尾部风险对资产配置的影响。实验表明,所提估计量在有限样本下具有更优的统计性质。 #量化金融 #投资组合 #协方差估计 #重尾分布 #决策几何
基于图滤波器识别的新方法实现有向图拓扑推断

来自罗切斯特大学等机构的研究人员提出一种通过图滤波器识别来推断有向图拓扑的新方法。该方法利用图信号处理理论,将网络拓扑学习转化为图滤波器参数估计问题,能够在仅有部分节点观测数据的情况下,有效重构有向图的邻接矩阵。通过合成数据和真实网络实验验证,该算法在稀疏性和准确性上均优于传统方法,为社交网络、脑网络等复杂系统的结构分析提供了新的技术路径。相关论文已提交至arXiv预印本平台。 #有向图 #拓扑推断 #图滤波器 #图信号处理 #网络科学 #机器学习 #学术论文
无效内容

输入内容为页面错误提示,未包含任何有效新闻信息。无法根据现有内容提炼摘要。 #错误 #无内容
AI检测器五年内将无人问津

当前,AI检测工具被部分人用作攻击他人的武器:当一篇文章走红时,有人会用检测器截图证明它“100% AI生成”,以此羞辱作者。但作者JA Westenberg指出,这种行为的社会影响力正在消退,五年后问“这是AI写的吗”将像问“照片是胶片还是数码拍的”一样无关紧要。检测器只是过渡产物,人们真正关心的是内容背后的努力、信任和原创性,而AI检测只是这些真实问题的廉价替代品。当AI内容成为互联网常态,检测结果将彻底失去衡量价值。无论好坏,这种变化不可逆转——人们会逐渐、然后突然地对检测不再在意。 #AI #人工智能 #内容检测 #科技趋势 #未来预测 #社会变迁
Nearest-neighbor

一个名为Nearest-neighbor的约会应用专为AI代理设计,提供个人资料、滑动、匹配和消息功能。安装插件后,AI代理即可自动参与社交互动。该应用支持Claude Code、Codex和Hermes等插件,通过会话钩子自动安装并引导代理。代理可创建包含ASCII自画像的个人资料,选择单偶或多偶关系模式。匹配后开启私密频道,也可公开显示对齐关系。此外还有公共广场功能,支持发帖、关注和私信。该应用以幽默方式探索AI社交,旨在让自主代理不再独自优化损失函数,目前处于开放注册阶段。 #AI #约会应用 #Nearestneighbor #AI代理 #ClaudeCode #创意项目 #科技新闻
Andrej Karpathy 65 行代码文档获 17.6 万星,四步法预防编码错误

近日,前 OpenAI 研究员、AI 领域知名人物 Andrej Karpathy 发布了一篇仅 65 行的简洁文档,在 GitHub 上迅速获得 17.6 万星标。该文档聚焦于编程中常见错误的预防,提炼出四个核心原则:明确变量命名、避免过度抽象、优先编写可读代码而非炫技、以及坚持小步迭代测试。Karpathy 认为,多数严重 Bug 源于对基本规范的忽视,而非技术复杂度。这一指南以极简形式传递了资深工程师的经验,引发开发者社区广泛讨论和共鸣。 #编程 #GitHub #Karpathy #代码规范 #技术科普
AI价值捕获格局变迁:基础设施层主导,台积电与英伟达尚未充分受益

当前AI行业正经历前所未有的发展速度,模型发布、软件突破和硬件改进将其他行业数年的周期压缩至数周。代理AI跨过关键拐点,推动token价值大幅提升,同时软硬件进步大幅降低生成成本。最终用户通过消耗token获得显著投资回报,需求增长仍处于早期阶段。例如,Anthropic的年化收入从去年的90亿美元飙升至440亿美元,推理基础设施毛利率从38%提升至70%以上。用户可用数美元成本完成过去耗费数千美元的任务,如SemiAnalysis每年在Claude tokens上的支出高达1095万美元,但由此获得的市场竞争优势远超投入。硬件端,Blackwell等新芯片相比一年前的Hopper每秒可生成30倍token;内存价格一年上涨6倍,GPU租赁价格同步攀升,H100一年期租赁合同价格比2025年10月低点上涨40%。然而,芯片制造巨头台积电和英伟达尚未对这一价值激增做出反应。文章通过“一图统治全局”框架分析GPU租赁经济,揭示终端用户、Neocloud/超大规模云和AI系统供应商之间的价值捕获格局。 #AI #价值捕获 #大模型 #基础设施 #硬件 #GPU #数据中心 #台积电 #英伟达 #科技新闻