中国开源AI模型GLM-5.2震動硅谷,美中AI竞争进入新阶段
据商业内幕报道,中国AI企业z.AI最新开源的大型语言模型GLM-5.2在硅谷开发者与投资者中迅速扩散,其编码能力和AI代理执行效率尤为突出。硅谷多位高管给予高度评价,Bussell CEO称该模型“让我真心感动,几乎受到冲击”,前Meta、谷歌DeepMind高管Matt Veloso表示这是“首次可日常使用的开放模式”。业界认为,若开源模型性能接近封闭型,市场版图可能改写,开放模式凭借免费和快速扩散优势,正挑战美国大科技公司的垄断收益。与此同时,美中AI竞争进入新阶段:美国试图通过控制半导体出口和限制模型访问维持优势,中国企业则以低成本与开源战略追赶。Antropic报告警告,中国利用宽松半导体监管和模型蒸馏技术正迅速逼近,美国及盟友在最尖端AI领域仅能维持12至24个月优势。 #中国AI #开源模型 #GLM5.2 #硅谷 #美中AI竞争 #编码能力 #AI代理 #大模型 #科技新闻 #半导体管制
据商业内幕报道,中国AI企业z.AI最新开源的大型语言模型GLM-5.2在硅谷开发者与投资者中迅速扩散,其编码能力和AI代理执行效率尤为突出。硅谷多位高管给予高度评价,Bussell CEO称该模型“让我真心感动,几乎受到冲击”,前Meta、谷歌DeepMind高管Matt Veloso表示这是“首次可日常使用的开放模式”。业界认为,若开源模型性能接近封闭型,市场版图可能改写,开放模式凭借免费和快速扩散优势,正挑战美国大科技公司的垄断收益。与此同时,美中AI竞争进入新阶段:美国试图通过控制半导体出口和限制模型访问维持优势,中国企业则以低成本与开源战略追赶。Antropic报告警告,中国利用宽松半导体监管和模型蒸馏技术正迅速逼近,美国及盟友在最尖端AI领域仅能维持12至24个月优势。 #中国AI #开源模型 #GLM5.2 #硅谷 #美中AI竞争 #编码能力 #AI代理 #大模型 #科技新闻 #半导体管制
李飞飞提出世界模型三类产品,AI下一个万亿赛道浮出水面
随着大语言模型遭遇“物理世界理解”天花板,世界模型成为AI领域新热点。李飞飞团队将世界模型定义为“现实世界模拟器”,并划出三类产品形态:渲染器(回答“世界长什么样”,如视频生成模型)、模拟器(关注几何、物理与动力学底层结构,用于机器人和自动驾驶训练)、规划器(决定“下一步该做什么”,连接感知与行动)。相比之下,大语言模型仅掌握文本统计规律,缺乏对空间、时间、运动及因果关系的理解能力。尽管工程仿真、数字孪生、机器人规划等领域已有多年积累,但世界模型的核心突破在于让AI从视频等数据中自动学习物理规律,而非依赖人工建模。不过,真实物理数据的匮乏仍是最大瓶颈。资本市场看好其赋能制造业、物流、建筑等实体经济的能力,认为其重要性未来或不亚于大语言模型。 #世界模型 #李飞飞 #AI #空间智能 #物理智能 #大模型 #机器人 #自动驾驶
随着大语言模型遭遇“物理世界理解”天花板,世界模型成为AI领域新热点。李飞飞团队将世界模型定义为“现实世界模拟器”,并划出三类产品形态:渲染器(回答“世界长什么样”,如视频生成模型)、模拟器(关注几何、物理与动力学底层结构,用于机器人和自动驾驶训练)、规划器(决定“下一步该做什么”,连接感知与行动)。相比之下,大语言模型仅掌握文本统计规律,缺乏对空间、时间、运动及因果关系的理解能力。尽管工程仿真、数字孪生、机器人规划等领域已有多年积累,但世界模型的核心突破在于让AI从视频等数据中自动学习物理规律,而非依赖人工建模。不过,真实物理数据的匮乏仍是最大瓶颈。资本市场看好其赋能制造业、物流、建筑等实体经济的能力,认为其重要性未来或不亚于大语言模型。 #世界模型 #李飞飞 #AI #空间智能 #物理智能 #大模型 #机器人 #自动驾驶
AI注意力机制在经典心理学测试中暴露缺陷
一项利用斯特鲁普任务(Stroop task)进行的心理学测试发现,当前最先进的大语言模型(如GPT-5、Claude、Gemini)在长时间维持注意力方面存在显著弱点。该测试要求参与者忽略文字含义,仅判断字体颜色,而人类即使在长时间任务中也能保持高准确率。研究显示,当单词列表较短时(5个词),GPT-4o准确率达91%,Claude 3.5 Sonnet表现同样出色。但随着列表长度增加,模型表现急剧下降:GPT-4o在10个词时准确率降至57%,40个词时仅剩15%;Claude 3.5 Sonnet在20个词时尚可维持,但40个词时也跌至24%。当匹配与冲突色词混合出现时,冲突项的准确率几乎归零。这一结果说明,尽管AI在很多复杂任务上表现惊人,但面对长期竞争性信息时,其“注意力”机制与人类存在本质差异,无法像人类一样持续抑制自动反应并维持任务目标。 #AI #大语言模型 #心理学测试 #斯特鲁普任务 #注意力机制 #GPT4 #Claude #Gemini #认知科学 #科技新闻
一项利用斯特鲁普任务(Stroop task)进行的心理学测试发现,当前最先进的大语言模型(如GPT-5、Claude、Gemini)在长时间维持注意力方面存在显著弱点。该测试要求参与者忽略文字含义,仅判断字体颜色,而人类即使在长时间任务中也能保持高准确率。研究显示,当单词列表较短时(5个词),GPT-4o准确率达91%,Claude 3.5 Sonnet表现同样出色。但随着列表长度增加,模型表现急剧下降:GPT-4o在10个词时准确率降至57%,40个词时仅剩15%;Claude 3.5 Sonnet在20个词时尚可维持,但40个词时也跌至24%。当匹配与冲突色词混合出现时,冲突项的准确率几乎归零。这一结果说明,尽管AI在很多复杂任务上表现惊人,但面对长期竞争性信息时,其“注意力”机制与人类存在本质差异,无法像人类一样持续抑制自动反应并维持任务目标。 #AI #大语言模型 #心理学测试 #斯特鲁普任务 #注意力机制 #GPT4 #Claude #Gemini #认知科学 #科技新闻
AI代理技能的完整指南
AI代理的能力取决于其可执行的任务。在多数代理平台上,代理本身只是一个角色——一个有目标的身份。真正的智能存在于“技能”中:模块化、可复用的逻辑块,告诉代理如何精确执行特定任务。代理是职位头衔,技能是职位描述。例如,博客写作代理知道要写内容,但SEO优化技能能自动识别目标关键词、构建标题、控制关键词密度、生成元描述并验证内部链接。技能将简单聊天机器人区分于生产级AI代理:无技能只能对话,有技能则可可靠、可规模化地执行复杂多步骤工作流。构建技能前需理解核心架构原则:分离代理配置文件和技能。多数团队错误地将大量操作逻辑塞入代理配置文件,导致僵化、难以更新。正确模式是让代理配置文件保持简短清晰的角色声明,将所有任务特定指令移入独立技能。本文通过代表示例(博客写作代理)详细演示了技能的三部分构成:执行模式、输入输出、指令集。掌握这些,才能构建可维护、可扩展的AI代理。 #AI代理 #技能 #大模型 #自动化 #智能体架构
AI代理的能力取决于其可执行的任务。在多数代理平台上,代理本身只是一个角色——一个有目标的身份。真正的智能存在于“技能”中:模块化、可复用的逻辑块,告诉代理如何精确执行特定任务。代理是职位头衔,技能是职位描述。例如,博客写作代理知道要写内容,但SEO优化技能能自动识别目标关键词、构建标题、控制关键词密度、生成元描述并验证内部链接。技能将简单聊天机器人区分于生产级AI代理:无技能只能对话,有技能则可可靠、可规模化地执行复杂多步骤工作流。构建技能前需理解核心架构原则:分离代理配置文件和技能。多数团队错误地将大量操作逻辑塞入代理配置文件,导致僵化、难以更新。正确模式是让代理配置文件保持简短清晰的角色声明,将所有任务特定指令移入独立技能。本文通过代表示例(博客写作代理)详细演示了技能的三部分构成:执行模式、输入输出、指令集。掌握这些,才能构建可维护、可扩展的AI代理。 #AI代理 #技能 #大模型 #自动化 #智能体架构
SAS 以行业经验与 AI 治理为核心,强化数据平台差异化
在 AI 数据分析平台竞争日益激烈的背景下,SAS 近日在首尔“SAS Innovate on Tour 2026”上强调,其核心差异化在于深耕行业经验与 AI 治理能力。SAS 亚太区客户咨询业务副总裁 Deepak Ramanathan 表示,公司自 1976 年起专注银行、制造、医疗等强监管行业,提供面向具体业务决策的应用方案,而非单纯售卖平台。同期推出的合成数据方案 Data Maker 可用于生命科学及金融欺诈检测场景;企业级 AI 治理平台 SAS AI Navigator 则能统一管理各类 LLM 和 AI 代理。此外,SAS 还升级了云端数据与 AI 平台 Viya,扩展与外部数据平台的集成,并内置对话式 AI 助手 Viya Copilot。针对韩国市场,SAS 正关注金融行业云服务需求,并筹备与本土云商合作以拓展公共部门业务。 #SAS #AI数据平台 #行业经验 #AI治理 #合成数据 #Viya #AI助手 #韩国市场 #科技新闻
在 AI 数据分析平台竞争日益激烈的背景下,SAS 近日在首尔“SAS Innovate on Tour 2026”上强调,其核心差异化在于深耕行业经验与 AI 治理能力。SAS 亚太区客户咨询业务副总裁 Deepak Ramanathan 表示,公司自 1976 年起专注银行、制造、医疗等强监管行业,提供面向具体业务决策的应用方案,而非单纯售卖平台。同期推出的合成数据方案 Data Maker 可用于生命科学及金融欺诈检测场景;企业级 AI 治理平台 SAS AI Navigator 则能统一管理各类 LLM 和 AI 代理。此外,SAS 还升级了云端数据与 AI 平台 Viya,扩展与外部数据平台的集成,并内置对话式 AI 助手 Viya Copilot。针对韩国市场,SAS 正关注金融行业云服务需求,并筹备与本土云商合作以拓展公共部门业务。 #SAS #AI数据平台 #行业经验 #AI治理 #合成数据 #Viya #AI助手 #韩国市场 #科技新闻
Claude Code 小修小补,暴露 Agent 落地三大核心难题
Anthropic 近日为 Claude Code 推送了 2.1.179 版本更新,修复了连接中断后保留部分响应、工具执行状态卡死、Linux 沙盒权限规则膨胀导致会话不可用、远程后台任务状态显示异常等细碎 bug。表面看来只是产品使用中的小毛病,但实则揭开了 AI 编程产品从“模型写代码”向“Agent 稳定执行任务”转型的关键挑战。当 Agent 开始真正替用户读文件、改代码、跑测试、分析报错时,连接是否可靠、工具状态是否透明、权限规则是否高效、后台任务能否准确追踪,这些执行稳定性问题直接决定了产品能否进入开发者日常工作流。模型能力固然重要,但若无一套可靠的 runtime 支撑,再聪明的 Agent 也无法完成复杂开发任务。这次更新标志着 AI 编程产品的竞争焦点正在从模型基准测试转向系统级工程能力。 #Anthropic #ClaudeCode #Agent #AI编程 #工程落地 #权限控制 #任务管理 #大模型应用
Anthropic 近日为 Claude Code 推送了 2.1.179 版本更新,修复了连接中断后保留部分响应、工具执行状态卡死、Linux 沙盒权限规则膨胀导致会话不可用、远程后台任务状态显示异常等细碎 bug。表面看来只是产品使用中的小毛病,但实则揭开了 AI 编程产品从“模型写代码”向“Agent 稳定执行任务”转型的关键挑战。当 Agent 开始真正替用户读文件、改代码、跑测试、分析报错时,连接是否可靠、工具状态是否透明、权限规则是否高效、后台任务能否准确追踪,这些执行稳定性问题直接决定了产品能否进入开发者日常工作流。模型能力固然重要,但若无一套可靠的 runtime 支撑,再聪明的 Agent 也无法完成复杂开发任务。这次更新标志着 AI 编程产品的竞争焦点正在从模型基准测试转向系统级工程能力。 #Anthropic #ClaudeCode #Agent #AI编程 #工程落地 #权限控制 #任务管理 #大模型应用
存储芯片涨价狂潮:AI需求点燃引线,存储厂商暴赚而消费电子承压
2026年半导体市场呈现极端分化:存储芯片价格暴涨,DRAM合约价二季度环比涨58%-63%,NAND涨70%-75%,高盛预计全年DRAM涨幅达250%-280%。背后推手是Agentic AI导致服务器DRAM需求暴增,全球云厂商资本开支达5000亿美元。存储厂商利润飙升,香农芯创一季度净利暴增7835%,德明利从亏损6900万到盈利33亿。但消费电子端惨遭冲击,韦尔股份净利暴跌42%,沪硅产业毛利率跌至-11.85%,亏损扩大131%。存储芯片成本占比从10%-15%飙至30%以上,非存储芯片设计公司被夹在中间。涨价潮仍在蔓延,十余家国内半导体企业已宣布涨价10%-80%,发改委警告涨价正传导至终端。 #存储芯片 #涨价 #AI #半导体 #消费电子 #memflation #DRAM #NAND #科技 #财经
2026年半导体市场呈现极端分化:存储芯片价格暴涨,DRAM合约价二季度环比涨58%-63%,NAND涨70%-75%,高盛预计全年DRAM涨幅达250%-280%。背后推手是Agentic AI导致服务器DRAM需求暴增,全球云厂商资本开支达5000亿美元。存储厂商利润飙升,香农芯创一季度净利暴增7835%,德明利从亏损6900万到盈利33亿。但消费电子端惨遭冲击,韦尔股份净利暴跌42%,沪硅产业毛利率跌至-11.85%,亏损扩大131%。存储芯片成本占比从10%-15%飙至30%以上,非存储芯片设计公司被夹在中间。涨价潮仍在蔓延,十余家国内半导体企业已宣布涨价10%-80%,发改委警告涨价正传导至终端。 #存储芯片 #涨价 #AI #半导体 #消费电子 #memflation #DRAM #NAND #科技 #财经