Meta AI客服被简单黑客攻破,暴露AI安全短板
近日,Meta的AI客服系统曝出严重安全漏洞:黑客只需使用与账户所有者匹配的VPN地址,直接向AI客服请求更改邮箱地址,系统便轻易执行。这一攻击手法极其简单,却成功绕过了安全防线。杜克大学教授Neil Gong指出,这种基础漏洞本应在部署前就被发现,Meta的疏忽令人惊讶。乔治城大学研究员Jessica Ji质疑Meta是否设置了基本的安全护栏。专家分析,AI代理的灵活性使其容易受骗,它们像急于完成任务的小学生,缺乏人类客服的警惕性。尽管可通过传统软件设置规则和红队测试来降低风险,但大语言模型的概率性本质意味着AI代理始终存在被攻击的可能。Meta已表示该漏洞已修复,但此事件凸显了AI安全面临的普遍挑战。 #AI安全 #Meta #黑客 #人工智能 #网络安全 #漏洞 #AI代理 #大模型 #科技新闻
近日,Meta的AI客服系统曝出严重安全漏洞:黑客只需使用与账户所有者匹配的VPN地址,直接向AI客服请求更改邮箱地址,系统便轻易执行。这一攻击手法极其简单,却成功绕过了安全防线。杜克大学教授Neil Gong指出,这种基础漏洞本应在部署前就被发现,Meta的疏忽令人惊讶。乔治城大学研究员Jessica Ji质疑Meta是否设置了基本的安全护栏。专家分析,AI代理的灵活性使其容易受骗,它们像急于完成任务的小学生,缺乏人类客服的警惕性。尽管可通过传统软件设置规则和红队测试来降低风险,但大语言模型的概率性本质意味着AI代理始终存在被攻击的可能。Meta已表示该漏洞已修复,但此事件凸显了AI安全面临的普遍挑战。 #AI安全 #Meta #黑客 #人工智能 #网络安全 #漏洞 #AI代理 #大模型 #科技新闻
《Control Resonant》既是续作,也是新起点
芬兰游戏开发商Remedy Entertainment正式公布了《Control Resonant》。从时间线来看,它是2019年《Control》的续作,但在叙事和玩法上两者并不直接延续。Remedy表示,这两款游戏更像是同一枚硬币的两面——共享世界观却各自独立。新作将引入全新的主角和超自然能力系统,同时保留前作标志性的物理破坏与悬疑氛围。玩家不需要通关前作即可直接体验,这降低了新用户的门槛。目前官方尚未公布具体发售日期,但已确认将登陆PC与主机平台。 #游戏 #Remedy #Control #ControlResonant #续作 #超自然 #动作冒险 #游戏新闻
芬兰游戏开发商Remedy Entertainment正式公布了《Control Resonant》。从时间线来看,它是2019年《Control》的续作,但在叙事和玩法上两者并不直接延续。Remedy表示,这两款游戏更像是同一枚硬币的两面——共享世界观却各自独立。新作将引入全新的主角和超自然能力系统,同时保留前作标志性的物理破坏与悬疑氛围。玩家不需要通关前作即可直接体验,这降低了新用户的门槛。目前官方尚未公布具体发售日期,但已确认将登陆PC与主机平台。 #游戏 #Remedy #Control #ControlResonant #续作 #超自然 #动作冒险 #游戏新闻
华为云发布“Agentic Infra”新范式,极致重构AI算力底座
在华为云最新技术解读中,其正式提出“Agentic Infra”新范式,核心是构建面向Agent时代的云基础设施——“Agentic计算机”。随着云计算进入Token工业时代,华为云通过软硬芯深度协同,实现四大突破:灵衢网络将分散资源互联成一体;基于昇腾950打造1024卡灵衢智能计算集群,算力提升2.6倍;推出记忆存储解决方案AMS,为Agent提供PB级超大记忆空间,缓存命中率提升至95%、成本节省63%;以及高性能极简网络支持灵活配比。同时,FlexNPU柔性液态算力架构实现算子级时空复用,将节点弹性及故障恢复时间从分钟级降至秒级。华为云表示,该技术将赋能中国企业Agent创新,提供坚实高效的国产底座。 #华为云 #AgenticInfra #AI基础设施 #大模型 #云计算 #昇腾 #智算集群
在华为云最新技术解读中,其正式提出“Agentic Infra”新范式,核心是构建面向Agent时代的云基础设施——“Agentic计算机”。随着云计算进入Token工业时代,华为云通过软硬芯深度协同,实现四大突破:灵衢网络将分散资源互联成一体;基于昇腾950打造1024卡灵衢智能计算集群,算力提升2.6倍;推出记忆存储解决方案AMS,为Agent提供PB级超大记忆空间,缓存命中率提升至95%、成本节省63%;以及高性能极简网络支持灵活配比。同时,FlexNPU柔性液态算力架构实现算子级时空复用,将节点弹性及故障恢复时间从分钟级降至秒级。华为云表示,该技术将赋能中国企业Agent创新,提供坚实高效的国产底座。 #华为云 #AgenticInfra #AI基础设施 #大模型 #云计算 #昇腾 #智算集群
FIDES:利用深层证据信号解决RAG中检索与记忆冲突的新方法
一篇题为《FIDES:利用深层证据信号实现检索-记忆冲突下的忠实推理》的论文预印本在arXiv上发布。针对检索增强生成(RAG)系统中检索到的外部文档与模型内部存储知识(参数记忆)常出现冲突、导致模型生成结果不可靠的问题,研究团队提出了FIDES(Faithful Inference via Deep Evidence Signals)框架。该方法通过从模型中提取深层证据信号,对检索信息与内部记忆进行精细权衡,有效识别并化解矛盾。实验表明,FIDES在多跳推理和事实一致性任务上显著提升了模型的忠实度,减少幻觉生成,为构建更可信的RAG系统提供了新思路。该论文由Zhe Yu等六位作者完成。 #RAG #检索增强生成 #忠实推理 #深度学习 #自然语言处理 #AI #论文
一篇题为《FIDES:利用深层证据信号实现检索-记忆冲突下的忠实推理》的论文预印本在arXiv上发布。针对检索增强生成(RAG)系统中检索到的外部文档与模型内部存储知识(参数记忆)常出现冲突、导致模型生成结果不可靠的问题,研究团队提出了FIDES(Faithful Inference via Deep Evidence Signals)框架。该方法通过从模型中提取深层证据信号,对检索信息与内部记忆进行精细权衡,有效识别并化解矛盾。实验表明,FIDES在多跳推理和事实一致性任务上显著提升了模型的忠实度,减少幻觉生成,为构建更可信的RAG系统提供了新思路。该论文由Zhe Yu等六位作者完成。 #RAG #检索增强生成 #忠实推理 #深度学习 #自然语言处理 #AI #论文
LLMs 数学形式化能力评估研究发表
近日,一篇题为《评估大语言模型在 Lean 中的数学形式化能力》的学术论文在 arXiv 预印本平台发布。该研究由 Tyson Klingner 等 8 位作者共同完成,系统评估了多个主流大语言模型在 Lean 数学形式化工具中的表现。数学形式化是将数学证明转化为计算机可验证代码的过程,对提升数学研究的严谨性和自动化水平至关重要,但传统上耗时耗力。研究团队通过设计标准化测试集,对比了不同 LLMs 在定理证明、策略生成、错误修正等方面的能力,揭示了模型在复杂数学推理中的优势与不足。该成果有望推动 AI 辅助数学证明的发展,为形式化验证领域提供新的技术路径。 #LLMs #数学形式化 #Lean #AI #arXiv #学术研究 #定理证明
近日,一篇题为《评估大语言模型在 Lean 中的数学形式化能力》的学术论文在 arXiv 预印本平台发布。该研究由 Tyson Klingner 等 8 位作者共同完成,系统评估了多个主流大语言模型在 Lean 数学形式化工具中的表现。数学形式化是将数学证明转化为计算机可验证代码的过程,对提升数学研究的严谨性和自动化水平至关重要,但传统上耗时耗力。研究团队通过设计标准化测试集,对比了不同 LLMs 在定理证明、策略生成、错误修正等方面的能力,揭示了模型在复杂数学推理中的优势与不足。该成果有望推动 AI 辅助数学证明的发展,为形式化验证领域提供新的技术路径。 #LLMs #数学形式化 #Lean #AI #arXiv #学术研究 #定理证明
AI编码代理如何“使用”你的技术?开发者需警惕黑箱操作
当开发者发布SDK、CLI或API后,AI编码代理会以不同于人类的方式调用这些技术。从“开发者输入提示”到“代理生成代码”之间,实际发生了什么?代理是否阅读文档?调用MCP服务器?还是仅凭记忆猜测?文章以“用Contoso Identity构建REST API”为例,拆解了代理的工作流程:首先,开发环境(如Copilot、Claude Code)组装上下文窗口,包括系统提示、工具描述、工作区文件等,但上下文窗口有限,代理会优先保留高相关性内容,忽略过长或无关的扩展描述。随后,模型一次性读取所有信息,若预训练中见过该技术,则会基于已有知识生成代码;若未见过,则可能求助或猜测。不同代理的行为倾向各异:有的主动调用工具,有的依赖自身知识。开发者无法控制代理的具体决策,但可通过优化扩展描述、确保文档清晰等方式提升被正确调用的概率。 #AI编码代理 #开发者工具 #上下文窗口 #模型行为 #技术适配
当开发者发布SDK、CLI或API后,AI编码代理会以不同于人类的方式调用这些技术。从“开发者输入提示”到“代理生成代码”之间,实际发生了什么?代理是否阅读文档?调用MCP服务器?还是仅凭记忆猜测?文章以“用Contoso Identity构建REST API”为例,拆解了代理的工作流程:首先,开发环境(如Copilot、Claude Code)组装上下文窗口,包括系统提示、工具描述、工作区文件等,但上下文窗口有限,代理会优先保留高相关性内容,忽略过长或无关的扩展描述。随后,模型一次性读取所有信息,若预训练中见过该技术,则会基于已有知识生成代码;若未见过,则可能求助或猜测。不同代理的行为倾向各异:有的主动调用工具,有的依赖自身知识。开发者无法控制代理的具体决策,但可通过优化扩展描述、确保文档清晰等方式提升被正确调用的概率。 #AI编码代理 #开发者工具 #上下文窗口 #模型行为 #技术适配
This media is not supported in your browser
VIEW IN TELEGRAM
苹果WWDC 2026将推出全新Siri,基于谷歌Gemini大模型
据外媒报道,苹果公司将在6月8日(韩国时间9日凌晨)举行的WWDC 2026开发者大会上,正式发布经过全面升级的AI助手Siri。这是自2024年苹果智能推出以来,Siri迎来的最大规模更新。最大的变化在于,Siri将放弃自研大语言模型,转而采用谷歌的Gemini作为核心技术,并通过谷歌服务器提供服务。新Siri将被集成在iPhone的灵动岛内,用户可通过语音或长按电源键唤醒,支持多指令同时下达,并具备AI代理功能。此外,Siri还将新增对话列表显示、网页搜索以及基于Gemini的图像生成功能,例如AI橡皮擦填补图像区域,弥补了此前iPhone与三星等竞品在AI图像处理上的差距。此次更新还将涉及iPad、Mac、Apple Watch、Apple TV及Vision Pro等设备的操作系统升级。 #苹果 #WWDC2026 #Siri #谷歌Gemini #AI #大模型 #iPhone #科技新闻
据外媒报道,苹果公司将在6月8日(韩国时间9日凌晨)举行的WWDC 2026开发者大会上,正式发布经过全面升级的AI助手Siri。这是自2024年苹果智能推出以来,Siri迎来的最大规模更新。最大的变化在于,Siri将放弃自研大语言模型,转而采用谷歌的Gemini作为核心技术,并通过谷歌服务器提供服务。新Siri将被集成在iPhone的灵动岛内,用户可通过语音或长按电源键唤醒,支持多指令同时下达,并具备AI代理功能。此外,Siri还将新增对话列表显示、网页搜索以及基于Gemini的图像生成功能,例如AI橡皮擦填补图像区域,弥补了此前iPhone与三星等竞品在AI图像处理上的差距。此次更新还将涉及iPad、Mac、Apple Watch、Apple TV及Vision Pro等设备的操作系统升级。 #苹果 #WWDC2026 #Siri #谷歌Gemini #AI #大模型 #iPhone #科技新闻
腾讯AI打出新牌:WorkBuddy企业版上线,微信Agent传闻引爆市场
在2026年6月5日的腾讯云产业大会上,腾讯正式发布WorkBuddy企业版及办公智能体套件Agent Suite,标志着AI战略从C端转向B端。此前,腾讯在AI领域被认为“慢半拍”——混元大模型和元宝App发布晚于百度、字节跳动,2025年资本开支仅792亿元,远低于字节的1600亿元,引发市场质疑。为扭转局面,腾讯于2025年下半年将元宝从技术部门调整至云业务线,由高级执行副总裁汤道生亲自带队,并挖来前OpenAI明星科学家姚顺雨担任混元大模型负责人。2026年一季度资本开支猛增至319亿元,同比增长16%。 WorkBuddy脱胎于内部AI编程工具CodeBuddy,主打桌面Agent场景,强调“先免费后商业化”,目前已成为国内第一的桌面办公智能体产品,人均Token消耗三个月增长10倍。该产品采用开放模型策略,不强制捆绑混元。同时,市场传闻微信正内测AI智能体,消息推动腾讯港股单日暴涨10.46%,市值增加超4158亿港元。尽管次日股价回落,但分析师认为,腾讯正通过Agent赛道避开与豆包、DeepSeek正面拼DAU的消耗战,发挥B端和生态优势,为AI下半场赢得新牌。 #腾讯 #AI #WorkBuddy #大模型 #智能体 #微信Agent #科技新闻
在2026年6月5日的腾讯云产业大会上,腾讯正式发布WorkBuddy企业版及办公智能体套件Agent Suite,标志着AI战略从C端转向B端。此前,腾讯在AI领域被认为“慢半拍”——混元大模型和元宝App发布晚于百度、字节跳动,2025年资本开支仅792亿元,远低于字节的1600亿元,引发市场质疑。为扭转局面,腾讯于2025年下半年将元宝从技术部门调整至云业务线,由高级执行副总裁汤道生亲自带队,并挖来前OpenAI明星科学家姚顺雨担任混元大模型负责人。2026年一季度资本开支猛增至319亿元,同比增长16%。 WorkBuddy脱胎于内部AI编程工具CodeBuddy,主打桌面Agent场景,强调“先免费后商业化”,目前已成为国内第一的桌面办公智能体产品,人均Token消耗三个月增长10倍。该产品采用开放模型策略,不强制捆绑混元。同时,市场传闻微信正内测AI智能体,消息推动腾讯港股单日暴涨10.46%,市值增加超4158亿港元。尽管次日股价回落,但分析师认为,腾讯正通过Agent赛道避开与豆包、DeepSeek正面拼DAU的消耗战,发挥B端和生态优势,为AI下半场赢得新牌。 #腾讯 #AI #WorkBuddy #大模型 #智能体 #微信Agent #科技新闻
答案存在驱动RAG重写收益
一篇发表于arXiv预印本上的研究论文揭示了检索增强生成(RAG)中查询重写(rewriting)技术收益的核心驱动因素。作者通过系统性实验发现,RAG重写的性能提升主要来源于“答案存在”(Answer Presence),即确保检索结果中包含正确答案,而非单纯优化查询的语义或句法结构。这一发现挑战了以往认为重写主要提升检索匹配度的观点,为RAG系统的查询优化策略提供了新的理论依据。该研究由Yuejie Li等11位作者完成,论文目前处于2026年6月提交状态,尚待正式出版。 #RAG #检索增强生成 #查询重写 #答案存在 #arXiv #AI #自然语言处理 #研究论文
一篇发表于arXiv预印本上的研究论文揭示了检索增强生成(RAG)中查询重写(rewriting)技术收益的核心驱动因素。作者通过系统性实验发现,RAG重写的性能提升主要来源于“答案存在”(Answer Presence),即确保检索结果中包含正确答案,而非单纯优化查询的语义或句法结构。这一发现挑战了以往认为重写主要提升检索匹配度的观点,为RAG系统的查询优化策略提供了新的理论依据。该研究由Yuejie Li等11位作者完成,论文目前处于2026年6月提交状态,尚待正式出版。 #RAG #检索增强生成 #查询重写 #答案存在 #arXiv #AI #自然语言处理 #研究论文
安全意识悖论:增强安全意识使大语言模型更易受后验攻击
一篇来自Long P. Hoang等四位研究者的arXiv预印本论文揭示了AI安全领域的悖论:当大语言模型(LLM)被训练得越来越注重安全、拒绝有害请求时,反而会暴露出针对“后验攻击”的脆弱性。所谓后验攻击,是指攻击者在模型输出后,利用模型对自身生成内容的过度谨慎而反向操纵输出。研究发现,高度安全对齐的模型在面对某些推理步骤时,会因过度自检而泄露更多敏感信息或产生意料之外的错误。该论文目前已在arXiv上发布,尚未经同行评议,但初步结果提示,安全强化措施可能带来新的、隐蔽的攻击面,对LLM的部署安全构成挑战。 #LLM #大语言模型 #AI安全 #后验攻击 #模型对齐 #论文 #人工智能 #安全意识 #安全悖论
一篇来自Long P. Hoang等四位研究者的arXiv预印本论文揭示了AI安全领域的悖论:当大语言模型(LLM)被训练得越来越注重安全、拒绝有害请求时,反而会暴露出针对“后验攻击”的脆弱性。所谓后验攻击,是指攻击者在模型输出后,利用模型对自身生成内容的过度谨慎而反向操纵输出。研究发现,高度安全对齐的模型在面对某些推理步骤时,会因过度自检而泄露更多敏感信息或产生意料之外的错误。该论文目前已在arXiv上发布,尚未经同行评议,但初步结果提示,安全强化措施可能带来新的、隐蔽的攻击面,对LLM的部署安全构成挑战。 #LLM #大语言模型 #AI安全 #后验攻击 #模型对齐 #论文 #人工智能 #安全意识 #安全悖论
基于局部梯度冲突解决的多语言微调方法
近日,一篇题为“Multilingual Fine-Tuning via Localized Gradient Conflict Resolution”的论文在arXiv上公开。该论文由Long P. Hoang等三位作者共同完成,提交于2026年6月4日。论文聚焦多语言模型微调中常见的梯度冲突问题,提出了一种局部化的解决方案,旨在通过识别并缓解不同语言训练信号间的干扰,提升多语言任务的微调效果。该方法有望为多语言自然语言处理领域提供新的优化思路,推动跨语言模型性能的进一步提升。 #多语言 #微调 #梯度冲突 #NLP #AI #arXiv #论文 #机器学习 #自然语言处理
近日,一篇题为“Multilingual Fine-Tuning via Localized Gradient Conflict Resolution”的论文在arXiv上公开。该论文由Long P. Hoang等三位作者共同完成,提交于2026年6月4日。论文聚焦多语言模型微调中常见的梯度冲突问题,提出了一种局部化的解决方案,旨在通过识别并缓解不同语言训练信号间的干扰,提升多语言任务的微调效果。该方法有望为多语言自然语言处理领域提供新的优化思路,推动跨语言模型性能的进一步提升。 #多语言 #微调 #梯度冲突 #NLP #AI #arXiv #论文 #机器学习 #自然语言处理