AI知识库 @ai521
387 subscribers
25K photos
46 videos
20 files
951 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
共享潜在结构实现大语言模型后门检测与防御的统一

研究人员提出一种基于共享潜在结构的新方法,可统一检测并缓解大语言模型中的后门攻击。该方法通过分析模型内部共享的潜在表示,有效识别恶意植入的后门,并能在不显著影响模型正常性能的前提下进行修复。实验表明,该技术对多种后门攻击类型均具有鲁棒性,为提升LLM安全性提供了新思路。 #大语言模型 #后门攻击 #AI安全 #机器学习 #网络安全
工业场景零样本学习

来自arXiv的最新研究论文提出了一项针对工业场景的零样本学习新基准,旨在解决传统方法在真实工业环境中的局限性。该研究由Zekai Zhang等九位作者共同完成,构建了一个大规模数据集,涵盖多种工业视觉任务,并系统分析了现有零样本学习技术在工业场景下面临的挑战,如类别分布不均、背景复杂和标注成本高等问题。论文同时提出了一个基线方法,为后续研究提供了可比较的参考标准。该工作已提交至arXiv,并附带相关代码和数据链接,有望推动零样本学习在工业自动化、质量检测等领域的实际应用。 #零样本学习 #工业场景 #机器学习 #计算机视觉 #arXiv #基准测试 #AI研究
PAFO:面向个性化奖励建模的帕累托公平优化方法

近日,一篇题为《PAFO: Pareto Fairness Optimization for Personalized Reward Modeling》的学术论文在arXiv平台发布。该研究由Xiaoyan Zhao等五位作者共同完成,提出了一种名为PAFO的帕累托公平优化方法,旨在解决个性化奖励建模中的公平性问题。论文通过引入帕累托最优理论,在多个奖励目标之间实现平衡,从而提升模型在不同用户群体间的表现一致性。该方法有望在推荐系统、个性化服务等领域发挥重要作用,为构建更公平的AI系统提供新思路。 #PAFO #帕累托公平优化 #个性化奖励建模 #AI公平性 #arXiv #学术论文 #机器学习
VATS:利用系统突变在错误路径注入中挖掘隐式权限

一篇发表于arXiv的论文提出了一种名为VATS的新型攻击方法,通过系统突变技术利用错误路径注入中的隐式权限。该方法由Harshil Patel等人研究,旨在探索软件错误处理路径中未被充分重视的安全漏洞。VATS通过自动化突变测试,系统性地生成并注入错误路径,从而触发程序中的隐式授权机制,实现对系统资源的未授权访问。实验表明,该方法能有效发现传统安全测试难以覆盖的漏洞,对软件安全防护提出了新挑战。 #网络安全 #漏洞挖掘 #错误路径注入 #系统突变 #隐式权限 #arXiv #学术论文
利用小语言模型进行代码重构实现高效技能落地

一篇发表于arXiv的论文提出了一种通过代码重构实现高效技能落地的方法。该方法利用小语言模型,将复杂技能分解为可执行的代码片段,从而降低对大型模型的依赖。研究团队展示了如何通过重构现有代码库,使小语言模型能够准确执行特定任务,如数据处理和自动化操作。实验结果表明,该方法在保持高准确率的同时,显著减少了计算资源消耗,为资源受限环境下的AI应用提供了新思路。该研究强调了代码重构在技能泛化中的关键作用,并探讨了其在机器人控制、软件工程等领域的潜在应用。 #AI #小语言模型 #代码重构 #技能落地 #arXiv #机器学习 #自动化
UniQL:面向方言通用的Text-to

来自arXiv的最新论文提出UniQL,旨在解决Text-to-SQL任务中方言多样性的挑战。当前主流基准测试多基于单一SQL方言,难以评估模型在真实多方言环境下的泛化能力。UniQL通过整合多种SQL方言数据,构建统一的评估框架,支持跨方言的模型性能对比。研究团队在多个主流模型上进行了实验,结果显示现有模型在方言迁移场景下性能显著下降,而UniQL提供的标准化评估有助于推动更鲁棒的Text-to-SQL系统开发。该工作为自然语言到数据库查询的跨方言研究提供了重要基准。 #Text-to-SQL #自然语言处理 #数据库 #方言 #基准测试 #AI #论文
OSMGraphCLIP:利用OpenStreetMap图学习全球位置表征

来自雅典国家技术大学的研究团队提出了一种名为OSMGraphCLIP的新方法,旨在从OpenStreetMap图数据中学习全球位置表征。该方法通过结合图神经网络与对比学习技术,能够有效提取地理空间中的结构特征和语义信息,从而实现对不同地点的高效编码与识别。实验表明,OSMGraphCLIP在位置识别和地理分类任务上表现优异,为地理空间智能和地图理解领域提供了新的解决方案。相关论文已提交至arXiv预印本平台。 #OSMGraphCLIP #OpenStreetMap #地理空间智能 #图神经网络 #对比学习 #位置表征 #AI #科技
谷歌发布Gemini 3.5 Live Translate,实现超70种语言实时语音翻译

谷歌今日正式推出Gemini 3.5 Live Translate,这是其最新的音频模型,支持超过70种语言的近乎实时的语音到语音翻译。与传统的逐句翻译不同,该模型能持续生成语音,仅落后说话者数秒,并保留原始语调、节奏和音高。模型可自动检测语言,无需手动设置,且具备噪声鲁棒性,适用于嘈杂环境。目前已集成至谷歌翻译App和Google Meet中,开发者也可通过Gemini Live API构建应用。Grab等合作伙伴正在测试该技术,用于司机与乘客间的多语种实时沟通。 #谷歌 #Gemini #语音翻译 #AI #多语言 #实时翻译 #科技新闻
史克威尔艾尼克斯在任天堂直面会上预告《王国之心4》

在近日的任天堂直面会上,史克威尔艾尼克斯终于公开了《王国之心》系列最新正统续作《王国之心4》的预告短片。尽管该预告并未透露太多具体信息,但确认游戏将登陆任天堂Switch 2、PS5、Xbox和PC平台,目前尚无发售日期。这是继2019年《王国之心3》之后该系列首款全新作品。从简短预告中可以看出,主角索拉将以全新造型登场,故事或将开启全新篇章。 #王国之心4 #史克威尔艾尼克斯 #任天堂直面会 #游戏 #Switch2 #PS5 #Xbox #PC #KingdomHeartsIV
AI 硬件

人工智能常被视为软件革命,但现代 AI 的突破离不开硬件进步。训练大语言模型需执行数万亿次数学运算,从文本生成图像仅需数秒完成数十亿次计算,而手机端运行 AI 则要求低功耗高速处理。传统 CPU 虽通用性强,但并行计算能力不足,难以满足 AI 对海量数据重复运算的需求。为此,专用硬件应运而生:GPU 凭借大量核心擅长并行矩阵运算,成为 AI 训练主力;TPU、NPU 等进一步针对深度学习优化。在 AI 系统中,CPU 仍负责数据预处理、任务调度等协调工作,而 GPU 承担主要计算负荷。不同处理器各司其职,共同驱动着从大模型训练到边缘推理的 AI 应用。 #AI #硬件 #GPU #CPU #TPU #NPU #大模型 #并行计算 #科技
Meta 将利用你在其他网站的活动来个性化推送

Meta 近日宣布,将扩大对其他企业共享数据的利用范围,除了用于广告定向外,还将基于用户在游戏、购物等站外活动来个性化信息流内容及 AI 回复。Meta 在官方博客中表示,此前已通过类似方式投放广告,现在则进一步用于内容推荐。此举旨在提升用户体验精准度,但也引发对数据隐私的担忧。Meta 强调用户可通过设置选项控制数据使用,该功能将逐步推送。 #Meta #数据隐私 #个性化推荐 #AI #社交网络 #科技新闻 #隐私保护