特朗普签署行政令,要求前沿AI模型发布前须通过安全测试
经过数日波折,美国总统特朗普最终签署了一项关于人工智能监管的行政命令,要求前沿AI模型在发布前必须接受独立安全测试。此前外界曾以为该命令已被搁置,但特朗普在做出修改后仍予以签署。此举标志着AI监管政策风向转变,各方关于立法行动的呼声日益高涨。众议员Lori Trahan强调,联邦政府应建立问责机制,要求大型AI公司发布并遵守安全框架,接受第三方审计,并保护举报人权益。她还呼吁更新相关法律,要求企业在因AI导致大规模裁员时予以披露,并加强网络安全防御。该行政令的签署被视为在缺乏全面联邦AI立法背景下的一项关键步骤,旨在为快速发展中的AI技术设立必要护栏。 #AI安全 #特朗普 #监管 #行政令 #前沿模型 #政策 #科技新闻
经过数日波折,美国总统特朗普最终签署了一项关于人工智能监管的行政命令,要求前沿AI模型在发布前必须接受独立安全测试。此前外界曾以为该命令已被搁置,但特朗普在做出修改后仍予以签署。此举标志着AI监管政策风向转变,各方关于立法行动的呼声日益高涨。众议员Lori Trahan强调,联邦政府应建立问责机制,要求大型AI公司发布并遵守安全框架,接受第三方审计,并保护举报人权益。她还呼吁更新相关法律,要求企业在因AI导致大规模裁员时予以披露,并加强网络安全防御。该行政令的签署被视为在缺乏全面联邦AI立法背景下的一项关键步骤,旨在为快速发展中的AI技术设立必要护栏。 #AI安全 #特朗普 #监管 #行政令 #前沿模型 #政策 #科技新闻
AI专家与超级预测者上调AI影响力预期
根据预测研究所最新发布的纵向专家AI小组(LEAP)第八轮调查,AI专家、超级预测者及公众对AI到2040年的社会影响进行了重新评估。结果显示,专家和超级预测者显著提高了AI达到“千年技术”级别(如农业革命)的概率,平均认为AI达到“世纪技术”级别(如电力)的概率为35%,达到“千年技术”为24%,达到“时代技术”为11%。超级预测者的判断与专家高度一致,而公众则更为保守。与2025年首次调查相比,专家和超级预测者的平均预期技术影响等级分别上升了0.20和0.39,表明对AI长期影响力的信心增强。该调查还涉及AGI时间线、任务完成时间基准等议题。 #AI #人工智能 #超级预测 #技术影响 #AGI #科技趋势 #预测研究 #LEAP
根据预测研究所最新发布的纵向专家AI小组(LEAP)第八轮调查,AI专家、超级预测者及公众对AI到2040年的社会影响进行了重新评估。结果显示,专家和超级预测者显著提高了AI达到“千年技术”级别(如农业革命)的概率,平均认为AI达到“世纪技术”级别(如电力)的概率为35%,达到“千年技术”为24%,达到“时代技术”为11%。超级预测者的判断与专家高度一致,而公众则更为保守。与2025年首次调查相比,专家和超级预测者的平均预期技术影响等级分别上升了0.20和0.39,表明对AI长期影响力的信心增强。该调查还涉及AGI时间线、任务完成时间基准等议题。 #AI #人工智能 #超级预测 #技术影响 #AGI #科技趋势 #预测研究 #LEAP
Claude Opus 4.8 发布,正面挑战 GPT
Anthropic 公司近日推出其最新大语言模型 Claude Opus 4.8,目标直指 OpenAI 的 GPT-5.5。作为 Claude 系列的高端版本,Opus 4.8 在推理能力、代码生成和多模态理解等方面进行了优化升级,试图在性能上追赶甚至超越竞争对手。目前官方尚未公布详细的基准测试数据,但业界普遍关注这款新模型能否在复杂任务处理中展现出与 GPT-5.5 相当的水平。此次发布标志着 AI 大模型领域的竞争进一步白热化,Anthropic 正通过持续迭代巩固其市场地位。 #Claude #Opus #GPT #大模型 #AI #Anthropic #OpenAI #科技竞争
Anthropic 公司近日推出其最新大语言模型 Claude Opus 4.8,目标直指 OpenAI 的 GPT-5.5。作为 Claude 系列的高端版本,Opus 4.8 在推理能力、代码生成和多模态理解等方面进行了优化升级,试图在性能上追赶甚至超越竞争对手。目前官方尚未公布详细的基准测试数据,但业界普遍关注这款新模型能否在复杂任务处理中展现出与 GPT-5.5 相当的水平。此次发布标志着 AI 大模型领域的竞争进一步白热化,Anthropic 正通过持续迭代巩固其市场地位。 #Claude #Opus #GPT #大模型 #AI #Anthropic #OpenAI #科技竞争
Persist AI 销售代理上线,多渠道自动跟进直至对方回复
一款名为 Persist 的 AI 销售代理工具正式开放早期访问。该工具以聊天界面为基础,用户只需用自然语言描述目标客户,便可从超过 2 亿 LinkedIn 资料、X 平台及专业邮件列表中自动筛选匹配对象,生成个性化消息,并通过邮件、短信、LinkedIn、X 等多渠道自动跟进,直到对方回复为止。Persist 支持自定义跟进节奏和渠道顺序,对方一旦回复即自动停止,并可将会议直接加入日历。目前已有超过 2400 名创始人和销售团队加入等待列表。 #AI销售 #自动化营销 #SaaS #Persist #多渠道跟进 #初创公司 #销售工具 #早期访问
一款名为 Persist 的 AI 销售代理工具正式开放早期访问。该工具以聊天界面为基础,用户只需用自然语言描述目标客户,便可从超过 2 亿 LinkedIn 资料、X 平台及专业邮件列表中自动筛选匹配对象,生成个性化消息,并通过邮件、短信、LinkedIn、X 等多渠道自动跟进,直到对方回复为止。Persist 支持自定义跟进节奏和渠道顺序,对方一旦回复即自动停止,并可将会议直接加入日历。目前已有超过 2400 名创始人和销售团队加入等待列表。 #AI销售 #自动化营销 #SaaS #Persist #多渠道跟进 #初创公司 #销售工具 #早期访问
AI焦虑是否在加剧“氛围衰退”?一项调查
关于“氛围衰退”(Vibecession)的争论主要分为三派:一派认为社交媒体上的误导性病毒内容导致经济情绪与实际表现脱节;另一派指出物价水平高企是主因,人们不满于商品比2021年更贵;第三派则坚持经济基本面不佳,信用卡债务和必需品负担能力等指标被忽视。经济学家马特·达林的研究显示,消费者信心指数在2022年与基本面预测出现明显偏离,而同年ChatGPT发布。作者推测,AI可能取代工作的持续报道加剧了公众的就业焦虑,即使失业率较低,人们仍对经济前景感到悲观。密歇根大学调查显示,2025年受访者对未来五年失业概率的预估均值偏高,进一步佐证了AI焦虑对经济情绪的潜在影响。 #AI焦虑 #氛围衰退 #消费者信心 #经济情绪 #ChatGPT #就业焦虑 #社交媒体 #经济基本面
关于“氛围衰退”(Vibecession)的争论主要分为三派:一派认为社交媒体上的误导性病毒内容导致经济情绪与实际表现脱节;另一派指出物价水平高企是主因,人们不满于商品比2021年更贵;第三派则坚持经济基本面不佳,信用卡债务和必需品负担能力等指标被忽视。经济学家马特·达林的研究显示,消费者信心指数在2022年与基本面预测出现明显偏离,而同年ChatGPT发布。作者推测,AI可能取代工作的持续报道加剧了公众的就业焦虑,即使失业率较低,人们仍对经济前景感到悲观。密歇根大学调查显示,2025年受访者对未来五年失业概率的预估均值偏高,进一步佐证了AI焦虑对经济情绪的潜在影响。 #AI焦虑 #氛围衰退 #消费者信心 #经济情绪 #ChatGPT #就业焦虑 #社交媒体 #经济基本面
AI 批评者被批忽视现实
近期一篇登上 Hacker News 榜首的文章《请用 AI》引发热议。作者尖锐指出,反 AI 言论常构建一种虚假对立:仿佛不用 AI 就必然产出最用心、最真挚的作品。但现实是,大多数人类创造——无论是代码、影视还是作文——在 AI 出现前早已是敷衍的“垃圾”。以编程为例,作者称 Claude Code / Opus 4.8 生成的代码比其职业生涯中 99% 以上的人类代码更安全、更易维护。许多程序员在压力下写的代码本身漏洞百出,却对 AI 输出嗤之以鼻。同理,电视电影多为老套翻拍,艺术音乐流派本就模仿成风,学生作文更是模板化严重。作者认为,批评者高估了人类劳动的普遍质量,AI 的价值在于它比大部分人类产出更可靠。 #AI #反AI #编程 #人类创作 #科技评论 #质量差距 #ClaudeCode #HackerNews
近期一篇登上 Hacker News 榜首的文章《请用 AI》引发热议。作者尖锐指出,反 AI 言论常构建一种虚假对立:仿佛不用 AI 就必然产出最用心、最真挚的作品。但现实是,大多数人类创造——无论是代码、影视还是作文——在 AI 出现前早已是敷衍的“垃圾”。以编程为例,作者称 Claude Code / Opus 4.8 生成的代码比其职业生涯中 99% 以上的人类代码更安全、更易维护。许多程序员在压力下写的代码本身漏洞百出,却对 AI 输出嗤之以鼻。同理,电视电影多为老套翻拍,艺术音乐流派本就模仿成风,学生作文更是模板化严重。作者认为,批评者高估了人类劳动的普遍质量,AI 的价值在于它比大部分人类产出更可靠。 #AI #反AI #编程 #人类创作 #科技评论 #质量差距 #ClaudeCode #HackerNews
英伟达AI PC芯片被指落后苹果两年,N1X效能仅追平M3
英伟达在Computex 2026上发布RTX Spark超级芯片,高调进军Windows AI PC市场。该芯片采用20核Grace CPU、Blackwell GPU及统一存储器设计,支持本地运行大模型和4K AI视频生成。然而,外媒《AppleInsider》分析指出,根据2025年流出的Geekbench数据,其N1X工程样品单核得分约3096分,多核约18837分,仅与2023年发布的苹果M3系列相当,远落后于M5系列(单核4224分,多核近30000分)。尽管英伟达拥有CUDA平台和AI生态优势,但CPU性能差距明显,正式产品可能通过优化提升,但短期内难以撼动苹果在高效能笔电芯片的领先地位。 #英伟达 #苹果 #AI芯片 #PC #科技 #Computex #RTXSpark #AppleSilicon
英伟达在Computex 2026上发布RTX Spark超级芯片,高调进军Windows AI PC市场。该芯片采用20核Grace CPU、Blackwell GPU及统一存储器设计,支持本地运行大模型和4K AI视频生成。然而,外媒《AppleInsider》分析指出,根据2025年流出的Geekbench数据,其N1X工程样品单核得分约3096分,多核约18837分,仅与2023年发布的苹果M3系列相当,远落后于M5系列(单核4224分,多核近30000分)。尽管英伟达拥有CUDA平台和AI生态优势,但CPU性能差距明显,正式产品可能通过优化提升,但短期内难以撼动苹果在高效能笔电芯片的领先地位。 #英伟达 #苹果 #AI芯片 #PC #科技 #Computex #RTXSpark #AppleSilicon
亚马逊起诉Perplexity获初步禁令,AI代理购物引发法律争议
2026年3月9日,美国法官切斯尼对亚马逊诉Perplexity案作出初步禁令裁决,认定亚马逊很可能依据《计算机欺诈和滥用法》(CFAA)及加州刑法第502条胜诉。Perplexity开发的Comet浏览器和购物代理允许用户通过登录账户在亚马逊上自动完成购物任务,包括比价、筛选商品并直接下单。亚马逊认为这种自动化访问未经授权,发送停止函后仍继续,遂提起诉讼。法院支持亚马逊立场,但批评该裁决未能深入探讨CFAA在《范布伦案》后对代理型AI技术的适用性。代理型AI能自主分解目标、使用工具并执行多步骤任务,对电商平台构成商业模式威胁——它绕过了亚马逊的搜索广告、产品推荐等盈利环节。此案凸显传统法律框架应对新兴AI代理的困境,可能重塑电商与AI服务的边界。 #亚马逊 #Perplexity #AI代理 #CFAA #法律诉讼 #电商 #人工智能 #科技新闻
2026年3月9日,美国法官切斯尼对亚马逊诉Perplexity案作出初步禁令裁决,认定亚马逊很可能依据《计算机欺诈和滥用法》(CFAA)及加州刑法第502条胜诉。Perplexity开发的Comet浏览器和购物代理允许用户通过登录账户在亚马逊上自动完成购物任务,包括比价、筛选商品并直接下单。亚马逊认为这种自动化访问未经授权,发送停止函后仍继续,遂提起诉讼。法院支持亚马逊立场,但批评该裁决未能深入探讨CFAA在《范布伦案》后对代理型AI技术的适用性。代理型AI能自主分解目标、使用工具并执行多步骤任务,对电商平台构成商业模式威胁——它绕过了亚马逊的搜索广告、产品推荐等盈利环节。此案凸显传统法律框架应对新兴AI代理的困境,可能重塑电商与AI服务的边界。 #亚马逊 #Perplexity #AI代理 #CFAA #法律诉讼 #电商 #人工智能 #科技新闻
Gaia2 基准测试:评估LLM智能体在动态异步环境中的表现
一项新的学术研究发布了名为 Gaia2 的基准测试,旨在评估大语言模型(LLM)智能体在动态和异步环境中的能力。该论文由 Romain Froger 等 24 位作者共同撰写,于 2026 年 2 月 12 日提交至 arXiv 平台。与静态基准不同,Gaia2 专注于测试 LLM 智能体在需要实时适应、处理非同步信息以及持续决策的场景下的表现,更贴近真实世界应用。这项工作为评估智能体的复杂交互能力提供了新框架,有助于推动更实用、更可靠的 AI 代理系统开发。 #Gaia2 #LLM #智能体 #基准测试 #ArXiv #AI #人工智能
一项新的学术研究发布了名为 Gaia2 的基准测试,旨在评估大语言模型(LLM)智能体在动态和异步环境中的能力。该论文由 Romain Froger 等 24 位作者共同撰写,于 2026 年 2 月 12 日提交至 arXiv 平台。与静态基准不同,Gaia2 专注于测试 LLM 智能体在需要实时适应、处理非同步信息以及持续决策的场景下的表现,更贴近真实世界应用。这项工作为评估智能体的复杂交互能力提供了新框架,有助于推动更实用、更可靠的 AI 代理系统开发。 #Gaia2 #LLM #智能体 #基准测试 #ArXiv #AI #人工智能