英伟达发布RTX Spark超级芯片,正式进军消费PC市场
在GTC Taipei 2026大会上,英伟达CEO黄仁勋宣布推出RTX Spark超级芯片,首次进入消费级PC市场。该芯片集成20核Arm Grace CPU和Blackwell RTX GPU,AI算力达1 petaflop,可本地运行1200亿参数模型,定位为“代理式AI操作系统”的承载平台。同时,英伟达自研Vera CPU进入全面量产,并获得Anthropic、OpenAI、xAI等前沿模型公司的早期支持。Adobe宣布将重写Photoshop和Premiere Pro以原生适配该架构,解决了Windows on Arm生态的软件痛点。此举标志着英伟达完成从数据中心到消费PC的AI栈纵向一体化,对Intel、AMD、Qualcomm形成直接竞争。RTX Spark预计2026年秋季上市,首批面向创作者、AI开发者和玩家。 #英伟达 #RTXSpark #AI芯片 #消费PC #黄仁勋 #代理式AI #ArmCPU #科技新闻
在GTC Taipei 2026大会上,英伟达CEO黄仁勋宣布推出RTX Spark超级芯片,首次进入消费级PC市场。该芯片集成20核Arm Grace CPU和Blackwell RTX GPU,AI算力达1 petaflop,可本地运行1200亿参数模型,定位为“代理式AI操作系统”的承载平台。同时,英伟达自研Vera CPU进入全面量产,并获得Anthropic、OpenAI、xAI等前沿模型公司的早期支持。Adobe宣布将重写Photoshop和Premiere Pro以原生适配该架构,解决了Windows on Arm生态的软件痛点。此举标志着英伟达完成从数据中心到消费PC的AI栈纵向一体化,对Intel、AMD、Qualcomm形成直接竞争。RTX Spark预计2026年秋季上市,首批面向创作者、AI开发者和玩家。 #英伟达 #RTXSpark #AI芯片 #消费PC #黄仁勋 #代理式AI #ArmCPU #科技新闻
类别特定分支注意力
近日,一篇题为《Class-Specific Branch Attention for Mitigating Gradient Interference under Class Imbalance》的学术论文在arXiv预印本平台发布。该论文由Arush Singhal和Umang Soni共同撰写,针对深度学习在类别不平衡场景下常见的梯度干扰问题,提出了一种新颖的类别特定分支注意力机制。该方法通过为每个类别设计独立的分支网络并引入注意力权重,有效减少了不同类别间梯度更新时的相互干扰,从而提升模型在少数类上的学习能力。实验结果表明,该机制在多个标准不平衡数据集上显著优于现有基线方法,为处理长尾分布等现实数据挑战提供了新思路。论文已提交DataCite进行DOI注册,目前处于待处理状态。 #深度学习 #类别不平衡 #梯度干扰 #注意力机制 #神经网络 #机器学习 #论文 #arXiv #AI研究
近日,一篇题为《Class-Specific Branch Attention for Mitigating Gradient Interference under Class Imbalance》的学术论文在arXiv预印本平台发布。该论文由Arush Singhal和Umang Soni共同撰写,针对深度学习在类别不平衡场景下常见的梯度干扰问题,提出了一种新颖的类别特定分支注意力机制。该方法通过为每个类别设计独立的分支网络并引入注意力权重,有效减少了不同类别间梯度更新时的相互干扰,从而提升模型在少数类上的学习能力。实验结果表明,该机制在多个标准不平衡数据集上显著优于现有基线方法,为处理长尾分布等现实数据挑战提供了新思路。论文已提交DataCite进行DOI注册,目前处于待处理状态。 #深度学习 #类别不平衡 #梯度干扰 #注意力机制 #神经网络 #机器学习 #论文 #arXiv #AI研究
Jürgen Schmidhuber
本期播客邀请了现代AI奠基人之一Jürgen Schmidhuber。他回顾了90年代初其团队在算力昂贵百万倍的时代,如何提出LSTM、世界模型、人工好奇心、Transformer变体等如今价值千亿美元的核心思想。他强调,当前大语言模型只是优秀的预测机器,能模仿网络数据,但真正的智能需要“控制器”利用世界模型进行规划。他早在1990年就提出了世界模型和人工好奇心,其中控制器通过实验改进自身模型获得奖励,这种对抗性设置比GAN早多年。他还指出,毫秒级规划不可扩展,需要子目标;压缩是理解的核心,从苹果落地到爱因斯坦公式皆如此。他批评了当前的奖励机制和学术评审体系,并预测未来将有自我复制机器人在太空中工作。 #AI #JürgenSchmidhuber #世界模型 #强化学习 #大语言模型 #人工好奇心 #深度学习 #AGI
本期播客邀请了现代AI奠基人之一Jürgen Schmidhuber。他回顾了90年代初其团队在算力昂贵百万倍的时代,如何提出LSTM、世界模型、人工好奇心、Transformer变体等如今价值千亿美元的核心思想。他强调,当前大语言模型只是优秀的预测机器,能模仿网络数据,但真正的智能需要“控制器”利用世界模型进行规划。他早在1990年就提出了世界模型和人工好奇心,其中控制器通过实验改进自身模型获得奖励,这种对抗性设置比GAN早多年。他还指出,毫秒级规划不可扩展,需要子目标;压缩是理解的核心,从苹果落地到爱因斯坦公式皆如此。他批评了当前的奖励机制和学术评审体系,并预测未来将有自我复制机器人在太空中工作。 #AI #JürgenSchmidhuber #世界模型 #强化学习 #大语言模型 #人工好奇心 #深度学习 #AGI
超越输出匹配:NVFP4大语言模型蒸馏中保持内部几何结构
一篇来自arXiv的新论文《Beyond Output Matching: Preserving Internal Geometry in NVFP4 LLM Distillation》提出,在将大语言模型蒸馏到NVFP4精度时,仅匹配输出分布会损失模型内部表征的几何结构。作者团队提出一种保留内部几何关系的方法,通过在蒸馏过程中对齐隐层表示的相对距离和角度,使量化后的模型在推理时保持更完整的语义空间。实验表明,该方法在多项自然语言理解与生成任务上优于传统输出匹配方案,且对推理效率影响极小。该研究为大模型高效部署提供了新思路,尤其适用于资源受限场景下的低比特量化。 #大模型 #模型蒸馏 #NVFP4 #量化 #自然语言处理 #arXiv #AI #机器学习
一篇来自arXiv的新论文《Beyond Output Matching: Preserving Internal Geometry in NVFP4 LLM Distillation》提出,在将大语言模型蒸馏到NVFP4精度时,仅匹配输出分布会损失模型内部表征的几何结构。作者团队提出一种保留内部几何关系的方法,通过在蒸馏过程中对齐隐层表示的相对距离和角度,使量化后的模型在推理时保持更完整的语义空间。实验表明,该方法在多项自然语言理解与生成任务上优于传统输出匹配方案,且对推理效率影响极小。该研究为大模型高效部署提供了新思路,尤其适用于资源受限场景下的低比特量化。 #大模型 #模型蒸馏 #NVFP4 #量化 #自然语言处理 #arXiv #AI #机器学习
AI公司转向衬线字体以营造人性化形象
随着公众对人工智能无处不在的抵制加剧,人们开始识别并拒绝AI的痕迹。继破折号和“三法则”之后,衬线字体成为新的标志。设计师指出,AI原生公司如Anthropic的Claude、Perplexity等纷纷采用衬线字体,试图传递温暖和人性化。衬线字体源于书法,带有学术和权威感,能建立信任。设计师Vadgama称之为“衬线复兴”,认为这是AI公司为了消除用户的恐惧,营造“我们是AI,但由真人制作”的印象。然而,这种策略也被批评为“品味垃圾”,试图让AI设计显得表面高雅。 #AI #衬线字体 #设计 #人性化 #科技 #字体 #品牌信任 #Perplexity #Claude
随着公众对人工智能无处不在的抵制加剧,人们开始识别并拒绝AI的痕迹。继破折号和“三法则”之后,衬线字体成为新的标志。设计师指出,AI原生公司如Anthropic的Claude、Perplexity等纷纷采用衬线字体,试图传递温暖和人性化。衬线字体源于书法,带有学术和权威感,能建立信任。设计师Vadgama称之为“衬线复兴”,认为这是AI公司为了消除用户的恐惧,营造“我们是AI,但由真人制作”的印象。然而,这种策略也被批评为“品味垃圾”,试图让AI设计显得表面高雅。 #AI #衬线字体 #设计 #人性化 #科技 #字体 #品牌信任 #Perplexity #Claude
持续学习基准问世:评估前沿AI在真实世界有状态环境中的表现
一篇来自arXiv的论文提出了名为“Continual Learning Bench”的新型基准,旨在评估前沿AI系统在真实世界有状态环境中的持续学习能力。传统基准多聚焦于静态任务,而该基准模拟了动态、交互式的场景,要求AI在状态不断变化的环境中持续适应和学习。研究团队通过机器人控制、对话系统等多项真实世界任务,对当前最先进的AI模型进行了测试,揭示了它们在长期交互中性能退化的关键问题。这一基准为AI系统的实用性、鲁棒性和安全性提供了全新评估维度,对推动持续学习研究及AI在复杂环境中的部署具有深远意义。 #AI #持续学习 #基准测试 #机器学习 #论文 #前沿AI #有状态环境 #评估 #arXiv
一篇来自arXiv的论文提出了名为“Continual Learning Bench”的新型基准,旨在评估前沿AI系统在真实世界有状态环境中的持续学习能力。传统基准多聚焦于静态任务,而该基准模拟了动态、交互式的场景,要求AI在状态不断变化的环境中持续适应和学习。研究团队通过机器人控制、对话系统等多项真实世界任务,对当前最先进的AI模型进行了测试,揭示了它们在长期交互中性能退化的关键问题。这一基准为AI系统的实用性、鲁棒性和安全性提供了全新评估维度,对推动持续学习研究及AI在复杂环境中的部署具有深远意义。 #AI #持续学习 #基准测试 #机器学习 #论文 #前沿AI #有状态环境 #评估 #arXiv
研究重新评估AI生成测试对LLM软件工程代理的价值
近日,一项题为《重新思考由代理生成的测试对基于LLM的软件工程代理的价值》的研究在arXiv上发布。该研究由Zhi Chen等七位作者共同完成,旨在深入探讨大型语言模型(LLM)驱动的软件工程代理所自动生成的测试用例的实际效用。研究指出,当前广泛使用的由代理自生成测试的方法可能存在偏差或过度拟合问题,其对于提升代码质量与修复缺陷的真实价值有待厘清。作者通过系统性实验重新评估了这类测试的有效性,并提出了更稳健的评估框架,以指导未来LLM在软件工程中的可靠应用。这一工作对于推动AI辅助编程工具的健康发展具有重要意义。 #LLM #软件工程 #测试生成 #AI #研究 #arXiv #代码质量
近日,一项题为《重新思考由代理生成的测试对基于LLM的软件工程代理的价值》的研究在arXiv上发布。该研究由Zhi Chen等七位作者共同完成,旨在深入探讨大型语言模型(LLM)驱动的软件工程代理所自动生成的测试用例的实际效用。研究指出,当前广泛使用的由代理自生成测试的方法可能存在偏差或过度拟合问题,其对于提升代码质量与修复缺陷的真实价值有待厘清。作者通过系统性实验重新评估了这类测试的有效性,并提出了更稳健的评估框架,以指导未来LLM在软件工程中的可靠应用。这一工作对于推动AI辅助编程工具的健康发展具有重要意义。 #LLM #软件工程 #测试生成 #AI #研究 #arXiv #代码质量
英伟达发布首款PC超级芯片,黄仁勋称Agentic AI时代全面到来
在COMPUTEX 2026主题演讲中,英伟达CEO黄仁勋宣布智能体AI(Agentic AI)时代全面到来,指出token成为利润单位,算力即收入与利润。同时,英伟达正式进军PC市场,发布基于Arm架构的RTX Spark超级芯片(含此前代号N1X),专为Windows笔记本和小型工作站设计,自称“有史以来最高效的平台”。黄仁勋还透露,专为AI智能体打造的Vera CPU已全面投产,速度比x86处理器快1.8倍,可驱动多样化工作负载。他强调,传统应用代码在操作系统内运行的模式已被打破,新模式以大语言模型为核心,通过安全套件编排,处理包含工作记忆、长期记忆及工具使用的复杂工作流。 #英伟达 #PC超级芯片 #RTXSpark #AgenticAI #黄仁勋 #COMPUTEX #VeraCPU #芯片 #AI
在COMPUTEX 2026主题演讲中,英伟达CEO黄仁勋宣布智能体AI(Agentic AI)时代全面到来,指出token成为利润单位,算力即收入与利润。同时,英伟达正式进军PC市场,发布基于Arm架构的RTX Spark超级芯片(含此前代号N1X),专为Windows笔记本和小型工作站设计,自称“有史以来最高效的平台”。黄仁勋还透露,专为AI智能体打造的Vera CPU已全面投产,速度比x86处理器快1.8倍,可驱动多样化工作负载。他强调,传统应用代码在操作系统内运行的模式已被打破,新模式以大语言模型为核心,通过安全套件编排,处理包含工作记忆、长期记忆及工具使用的复杂工作流。 #英伟达 #PC超级芯片 #RTXSpark #AgenticAI #黄仁勋 #COMPUTEX #VeraCPU #芯片 #AI