LLM 引导自动调优:Helion 内核调优时间从分钟级降至秒级
PyTorch 领域特定语言 Helion 用于编写高性能可移植机器学习内核,其性能高度依赖自动调优。现有基于似然无关贝叶斯优化(LFBO)的调优器虽效果出色,但每个内核仍需数百次编译与基准测试。为此,研究人员提出一种 LLM 引导的自动调优器:在每轮调优中,LLM 根据内核、工作负载和当前最优配置建议新配置。在 B200 上对 33 个案例(11 个内核 × 3 种形状)的测试表明,新方法达到与 LFBO 相当的核性能(几何平均 1.009 倍),但编译/基准测试的配置数量减少约 10 倍,墙钟时间缩短约 6.7 倍。对于少数性能落后超过 5% 的内核,采用 LLM 初始化后接 LFBO 精细搜索的混合策略可弥补差距,同时仍比纯 LFBO 搜索快约 3 倍。此外,该方法的性能对 LLM 模型基本无关(Opus-4.8、gpt-5.5、Sonnet-4.6 性能相差不到 2%),表明 LLM 引导的自动调优是生产级内核调优的实用加速方案。 #PyTorch #Helion #LLM #自动调优 #AI #性能优化 #内核调优 #NVIDIA
PyTorch 领域特定语言 Helion 用于编写高性能可移植机器学习内核,其性能高度依赖自动调优。现有基于似然无关贝叶斯优化(LFBO)的调优器虽效果出色,但每个内核仍需数百次编译与基准测试。为此,研究人员提出一种 LLM 引导的自动调优器:在每轮调优中,LLM 根据内核、工作负载和当前最优配置建议新配置。在 B200 上对 33 个案例(11 个内核 × 3 种形状)的测试表明,新方法达到与 LFBO 相当的核性能(几何平均 1.009 倍),但编译/基准测试的配置数量减少约 10 倍,墙钟时间缩短约 6.7 倍。对于少数性能落后超过 5% 的内核,采用 LLM 初始化后接 LFBO 精细搜索的混合策略可弥补差距,同时仍比纯 LFBO 搜索快约 3 倍。此外,该方法的性能对 LLM 模型基本无关(Opus-4.8、gpt-5.5、Sonnet-4.6 性能相差不到 2%),表明 LLM 引导的自动调优是生产级内核调优的实用加速方案。 #PyTorch #Helion #LLM #自动调优 #AI #性能优化 #内核调优 #NVIDIA
特朗普政府因Anthropic拒绝开发自主武器而实施报复性制裁
特朗普政府在AI监管上呈现矛盾态度:一方面以“赢得全球竞赛”为由放松对大多数AI企业的监管,另一方面却对AI公司Anthropic实施严厉制裁。Anthropic因拒绝美国政府要求其模型用于自主杀人或监控美国公民,被五角大楼列为“供应链风险”,导致联邦机构及承包商禁止与其合作。法院在公民自由组织的推动下发布了初步禁令,阻止制裁生效,否则公司将损失数亿美元。然而,政府随后通过行政命令对Anthropic的Mythos和Fable模型实施出口管制,迫使公司完全关闭这些模型。民权组织指出,这些行动是基于Anthropic不合作的报复,违反宪法第一修正案。尽管政府声称出于安全担忧,但同类模型并未受类似管制,政策实为打击异己。 #AI监管 #特朗普政府 #Anthropic #宪法第一修正案 #报复性制裁 #科技政策 #自主武器 #出口管制
特朗普政府在AI监管上呈现矛盾态度:一方面以“赢得全球竞赛”为由放松对大多数AI企业的监管,另一方面却对AI公司Anthropic实施严厉制裁。Anthropic因拒绝美国政府要求其模型用于自主杀人或监控美国公民,被五角大楼列为“供应链风险”,导致联邦机构及承包商禁止与其合作。法院在公民自由组织的推动下发布了初步禁令,阻止制裁生效,否则公司将损失数亿美元。然而,政府随后通过行政命令对Anthropic的Mythos和Fable模型实施出口管制,迫使公司完全关闭这些模型。民权组织指出,这些行动是基于Anthropic不合作的报复,违反宪法第一修正案。尽管政府声称出于安全担忧,但同类模型并未受类似管制,政策实为打击异己。 #AI监管 #特朗普政府 #Anthropic #宪法第一修正案 #报复性制裁 #科技政策 #自主武器 #出口管制
AI数字主权风险并不存在
在区块链泡沫高峰期,我曾指出加密怪人们玩的是偷换概念的把戏。他们声称能用“智能合约”解决信任和制度设计问题,比如通过去中心化自治组织(DAO)来筹集资金竞拍美国宪法副本。但问题在于,DAO无法直接参与拍卖,最终仍需选出一个代表拿着所有钱去现场举牌。这个代表完全可以卷款跑路,而DAO成员甚至可能因缺乏法律实体而无法起诉他。这揭示了一个核心矛盾:用复杂的区块链智能合约来筹集和管理资金,最终却还是要信任一个可能背叛的人,那区块链的意义何在?简而言之,如果问题加区块链等于问题减区块链,那么区块链就等于零。同样,数字主权问题也存在类似的虚构解决方案。全球(中国影响力范围之外)都依赖美国科技平台,这确实是真实问题,但所谓的“数字主权”解决方案往往只是另一种形式的偷换概念,并未真正解决核心问题。 #区块链 #数字主权 #DAO #科技泡沫 #信任问题
在区块链泡沫高峰期,我曾指出加密怪人们玩的是偷换概念的把戏。他们声称能用“智能合约”解决信任和制度设计问题,比如通过去中心化自治组织(DAO)来筹集资金竞拍美国宪法副本。但问题在于,DAO无法直接参与拍卖,最终仍需选出一个代表拿着所有钱去现场举牌。这个代表完全可以卷款跑路,而DAO成员甚至可能因缺乏法律实体而无法起诉他。这揭示了一个核心矛盾:用复杂的区块链智能合约来筹集和管理资金,最终却还是要信任一个可能背叛的人,那区块链的意义何在?简而言之,如果问题加区块链等于问题减区块链,那么区块链就等于零。同样,数字主权问题也存在类似的虚构解决方案。全球(中国影响力范围之外)都依赖美国科技平台,这确实是真实问题,但所谓的“数字主权”解决方案往往只是另一种形式的偷换概念,并未真正解决核心问题。 #区块链 #数字主权 #DAO #科技泡沫 #信任问题
GLM-5.2 内部评测击败 Claude Opus 4.8,美国 AI 护城河面临崩塌
据希图科技报道,国产大模型 GLM-5.2 在内部评测中表现优异,成功击败了美国顶尖模型 Claude Opus 4.8。这一结果引发业界对中美 AI 实力对比的重新审视。评测显示,GLM-5.2 在多项关键指标上展现出显著优势,尤其是在复杂推理和多模态理解方面。分析认为,这标志着美国在 AI 领域的传统护城河正面临崩塌风险,国产大模型的技术突破正加速全球 AI 格局的重塑。该事件不仅凸显了中国在人工智能领域的快速进步,也预示着未来国际竞争将更加激烈。 #GLM #Claude #AI #大模型 #国产AI #科技竞争 #人工智能
据希图科技报道,国产大模型 GLM-5.2 在内部评测中表现优异,成功击败了美国顶尖模型 Claude Opus 4.8。这一结果引发业界对中美 AI 实力对比的重新审视。评测显示,GLM-5.2 在多项关键指标上展现出显著优势,尤其是在复杂推理和多模态理解方面。分析认为,这标志着美国在 AI 领域的传统护城河正面临崩塌风险,国产大模型的技术突破正加速全球 AI 格局的重塑。该事件不仅凸显了中国在人工智能领域的快速进步,也预示着未来国际竞争将更加激烈。 #GLM #Claude #AI #大模型 #国产AI #科技竞争 #人工智能