李飞飞提出世界模型三类产品,AI下一个万亿赛道浮出水面
随着大语言模型遭遇“物理世界理解”天花板,世界模型成为AI领域新热点。李飞飞团队将世界模型定义为“现实世界模拟器”,并划出三类产品形态:渲染器(回答“世界长什么样”,如视频生成模型)、模拟器(关注几何、物理与动力学底层结构,用于机器人和自动驾驶训练)、规划器(决定“下一步该做什么”,连接感知与行动)。相比之下,大语言模型仅掌握文本统计规律,缺乏对空间、时间、运动及因果关系的理解能力。尽管工程仿真、数字孪生、机器人规划等领域已有多年积累,但世界模型的核心突破在于让AI从视频等数据中自动学习物理规律,而非依赖人工建模。不过,真实物理数据的匮乏仍是最大瓶颈。资本市场看好其赋能制造业、物流、建筑等实体经济的能力,认为其重要性未来或不亚于大语言模型。 #世界模型 #李飞飞 #AI #空间智能 #物理智能 #大模型 #机器人 #自动驾驶
随着大语言模型遭遇“物理世界理解”天花板,世界模型成为AI领域新热点。李飞飞团队将世界模型定义为“现实世界模拟器”,并划出三类产品形态:渲染器(回答“世界长什么样”,如视频生成模型)、模拟器(关注几何、物理与动力学底层结构,用于机器人和自动驾驶训练)、规划器(决定“下一步该做什么”,连接感知与行动)。相比之下,大语言模型仅掌握文本统计规律,缺乏对空间、时间、运动及因果关系的理解能力。尽管工程仿真、数字孪生、机器人规划等领域已有多年积累,但世界模型的核心突破在于让AI从视频等数据中自动学习物理规律,而非依赖人工建模。不过,真实物理数据的匮乏仍是最大瓶颈。资本市场看好其赋能制造业、物流、建筑等实体经济的能力,认为其重要性未来或不亚于大语言模型。 #世界模型 #李飞飞 #AI #空间智能 #物理智能 #大模型 #机器人 #自动驾驶
AI注意力机制在经典心理学测试中暴露缺陷
一项利用斯特鲁普任务(Stroop task)进行的心理学测试发现,当前最先进的大语言模型(如GPT-5、Claude、Gemini)在长时间维持注意力方面存在显著弱点。该测试要求参与者忽略文字含义,仅判断字体颜色,而人类即使在长时间任务中也能保持高准确率。研究显示,当单词列表较短时(5个词),GPT-4o准确率达91%,Claude 3.5 Sonnet表现同样出色。但随着列表长度增加,模型表现急剧下降:GPT-4o在10个词时准确率降至57%,40个词时仅剩15%;Claude 3.5 Sonnet在20个词时尚可维持,但40个词时也跌至24%。当匹配与冲突色词混合出现时,冲突项的准确率几乎归零。这一结果说明,尽管AI在很多复杂任务上表现惊人,但面对长期竞争性信息时,其“注意力”机制与人类存在本质差异,无法像人类一样持续抑制自动反应并维持任务目标。 #AI #大语言模型 #心理学测试 #斯特鲁普任务 #注意力机制 #GPT4 #Claude #Gemini #认知科学 #科技新闻
一项利用斯特鲁普任务(Stroop task)进行的心理学测试发现,当前最先进的大语言模型(如GPT-5、Claude、Gemini)在长时间维持注意力方面存在显著弱点。该测试要求参与者忽略文字含义,仅判断字体颜色,而人类即使在长时间任务中也能保持高准确率。研究显示,当单词列表较短时(5个词),GPT-4o准确率达91%,Claude 3.5 Sonnet表现同样出色。但随着列表长度增加,模型表现急剧下降:GPT-4o在10个词时准确率降至57%,40个词时仅剩15%;Claude 3.5 Sonnet在20个词时尚可维持,但40个词时也跌至24%。当匹配与冲突色词混合出现时,冲突项的准确率几乎归零。这一结果说明,尽管AI在很多复杂任务上表现惊人,但面对长期竞争性信息时,其“注意力”机制与人类存在本质差异,无法像人类一样持续抑制自动反应并维持任务目标。 #AI #大语言模型 #心理学测试 #斯特鲁普任务 #注意力机制 #GPT4 #Claude #Gemini #认知科学 #科技新闻
AI代理技能的完整指南
AI代理的能力取决于其可执行的任务。在多数代理平台上,代理本身只是一个角色——一个有目标的身份。真正的智能存在于“技能”中:模块化、可复用的逻辑块,告诉代理如何精确执行特定任务。代理是职位头衔,技能是职位描述。例如,博客写作代理知道要写内容,但SEO优化技能能自动识别目标关键词、构建标题、控制关键词密度、生成元描述并验证内部链接。技能将简单聊天机器人区分于生产级AI代理:无技能只能对话,有技能则可可靠、可规模化地执行复杂多步骤工作流。构建技能前需理解核心架构原则:分离代理配置文件和技能。多数团队错误地将大量操作逻辑塞入代理配置文件,导致僵化、难以更新。正确模式是让代理配置文件保持简短清晰的角色声明,将所有任务特定指令移入独立技能。本文通过代表示例(博客写作代理)详细演示了技能的三部分构成:执行模式、输入输出、指令集。掌握这些,才能构建可维护、可扩展的AI代理。 #AI代理 #技能 #大模型 #自动化 #智能体架构
AI代理的能力取决于其可执行的任务。在多数代理平台上,代理本身只是一个角色——一个有目标的身份。真正的智能存在于“技能”中:模块化、可复用的逻辑块,告诉代理如何精确执行特定任务。代理是职位头衔,技能是职位描述。例如,博客写作代理知道要写内容,但SEO优化技能能自动识别目标关键词、构建标题、控制关键词密度、生成元描述并验证内部链接。技能将简单聊天机器人区分于生产级AI代理:无技能只能对话,有技能则可可靠、可规模化地执行复杂多步骤工作流。构建技能前需理解核心架构原则:分离代理配置文件和技能。多数团队错误地将大量操作逻辑塞入代理配置文件,导致僵化、难以更新。正确模式是让代理配置文件保持简短清晰的角色声明,将所有任务特定指令移入独立技能。本文通过代表示例(博客写作代理)详细演示了技能的三部分构成:执行模式、输入输出、指令集。掌握这些,才能构建可维护、可扩展的AI代理。 #AI代理 #技能 #大模型 #自动化 #智能体架构
SAS 以行业经验与 AI 治理为核心,强化数据平台差异化
在 AI 数据分析平台竞争日益激烈的背景下,SAS 近日在首尔“SAS Innovate on Tour 2026”上强调,其核心差异化在于深耕行业经验与 AI 治理能力。SAS 亚太区客户咨询业务副总裁 Deepak Ramanathan 表示,公司自 1976 年起专注银行、制造、医疗等强监管行业,提供面向具体业务决策的应用方案,而非单纯售卖平台。同期推出的合成数据方案 Data Maker 可用于生命科学及金融欺诈检测场景;企业级 AI 治理平台 SAS AI Navigator 则能统一管理各类 LLM 和 AI 代理。此外,SAS 还升级了云端数据与 AI 平台 Viya,扩展与外部数据平台的集成,并内置对话式 AI 助手 Viya Copilot。针对韩国市场,SAS 正关注金融行业云服务需求,并筹备与本土云商合作以拓展公共部门业务。 #SAS #AI数据平台 #行业经验 #AI治理 #合成数据 #Viya #AI助手 #韩国市场 #科技新闻
在 AI 数据分析平台竞争日益激烈的背景下,SAS 近日在首尔“SAS Innovate on Tour 2026”上强调,其核心差异化在于深耕行业经验与 AI 治理能力。SAS 亚太区客户咨询业务副总裁 Deepak Ramanathan 表示,公司自 1976 年起专注银行、制造、医疗等强监管行业,提供面向具体业务决策的应用方案,而非单纯售卖平台。同期推出的合成数据方案 Data Maker 可用于生命科学及金融欺诈检测场景;企业级 AI 治理平台 SAS AI Navigator 则能统一管理各类 LLM 和 AI 代理。此外,SAS 还升级了云端数据与 AI 平台 Viya,扩展与外部数据平台的集成,并内置对话式 AI 助手 Viya Copilot。针对韩国市场,SAS 正关注金融行业云服务需求,并筹备与本土云商合作以拓展公共部门业务。 #SAS #AI数据平台 #行业经验 #AI治理 #合成数据 #Viya #AI助手 #韩国市场 #科技新闻
Claude Code 小修小补,暴露 Agent 落地三大核心难题
Anthropic 近日为 Claude Code 推送了 2.1.179 版本更新,修复了连接中断后保留部分响应、工具执行状态卡死、Linux 沙盒权限规则膨胀导致会话不可用、远程后台任务状态显示异常等细碎 bug。表面看来只是产品使用中的小毛病,但实则揭开了 AI 编程产品从“模型写代码”向“Agent 稳定执行任务”转型的关键挑战。当 Agent 开始真正替用户读文件、改代码、跑测试、分析报错时,连接是否可靠、工具状态是否透明、权限规则是否高效、后台任务能否准确追踪,这些执行稳定性问题直接决定了产品能否进入开发者日常工作流。模型能力固然重要,但若无一套可靠的 runtime 支撑,再聪明的 Agent 也无法完成复杂开发任务。这次更新标志着 AI 编程产品的竞争焦点正在从模型基准测试转向系统级工程能力。 #Anthropic #ClaudeCode #Agent #AI编程 #工程落地 #权限控制 #任务管理 #大模型应用
Anthropic 近日为 Claude Code 推送了 2.1.179 版本更新,修复了连接中断后保留部分响应、工具执行状态卡死、Linux 沙盒权限规则膨胀导致会话不可用、远程后台任务状态显示异常等细碎 bug。表面看来只是产品使用中的小毛病,但实则揭开了 AI 编程产品从“模型写代码”向“Agent 稳定执行任务”转型的关键挑战。当 Agent 开始真正替用户读文件、改代码、跑测试、分析报错时,连接是否可靠、工具状态是否透明、权限规则是否高效、后台任务能否准确追踪,这些执行稳定性问题直接决定了产品能否进入开发者日常工作流。模型能力固然重要,但若无一套可靠的 runtime 支撑,再聪明的 Agent 也无法完成复杂开发任务。这次更新标志着 AI 编程产品的竞争焦点正在从模型基准测试转向系统级工程能力。 #Anthropic #ClaudeCode #Agent #AI编程 #工程落地 #权限控制 #任务管理 #大模型应用
存储芯片涨价狂潮:AI需求点燃引线,存储厂商暴赚而消费电子承压
2026年半导体市场呈现极端分化:存储芯片价格暴涨,DRAM合约价二季度环比涨58%-63%,NAND涨70%-75%,高盛预计全年DRAM涨幅达250%-280%。背后推手是Agentic AI导致服务器DRAM需求暴增,全球云厂商资本开支达5000亿美元。存储厂商利润飙升,香农芯创一季度净利暴增7835%,德明利从亏损6900万到盈利33亿。但消费电子端惨遭冲击,韦尔股份净利暴跌42%,沪硅产业毛利率跌至-11.85%,亏损扩大131%。存储芯片成本占比从10%-15%飙至30%以上,非存储芯片设计公司被夹在中间。涨价潮仍在蔓延,十余家国内半导体企业已宣布涨价10%-80%,发改委警告涨价正传导至终端。 #存储芯片 #涨价 #AI #半导体 #消费电子 #memflation #DRAM #NAND #科技 #财经
2026年半导体市场呈现极端分化:存储芯片价格暴涨,DRAM合约价二季度环比涨58%-63%,NAND涨70%-75%,高盛预计全年DRAM涨幅达250%-280%。背后推手是Agentic AI导致服务器DRAM需求暴增,全球云厂商资本开支达5000亿美元。存储厂商利润飙升,香农芯创一季度净利暴增7835%,德明利从亏损6900万到盈利33亿。但消费电子端惨遭冲击,韦尔股份净利暴跌42%,沪硅产业毛利率跌至-11.85%,亏损扩大131%。存储芯片成本占比从10%-15%飙至30%以上,非存储芯片设计公司被夹在中间。涨价潮仍在蔓延,十余家国内半导体企业已宣布涨价10%-80%,发改委警告涨价正传导至终端。 #存储芯片 #涨价 #AI #半导体 #消费电子 #memflation #DRAM #NAND #科技 #财经
智谱股价5个月暴涨17倍,市值逼近万亿港元
智谱AI在港股上市仅5个半月,股价从发行价116.2港元飙升至2094港元,暴涨1702%,市值达9336亿港元,约等于3个百度。其市销率高达1112.6倍,远超同行,引发市场对估值泡沫的担忧。智谱的暴涨主要得益于AI Coding领域的突破,其GLM-5.2模型在代码能力上全球排名第二,仅次于Claude Fable5,且API价格远低于海外竞品。公司已通过科创板IPO辅导验收,计划募资150亿元人民币。然而,投资者分歧加剧,看多者认为智谱有望成为“中国版Anthropic”,看空者则指出其模型多模态能力不足、算力短缺、商业场景单一,且面临阿里、腾讯等巨头的竞争。此外,公司研发费用持续攀升,去年亏损47.18亿元,盈利前景不明。7月8日,智谱将迎来大量限售股解禁,流通盘将增加2.2倍,可能对股价造成压力。 #智谱AI #AI大模型 #股价暴涨 #科创板 #AI编程 #估值泡沫 #Anthropic
智谱AI在港股上市仅5个半月,股价从发行价116.2港元飙升至2094港元,暴涨1702%,市值达9336亿港元,约等于3个百度。其市销率高达1112.6倍,远超同行,引发市场对估值泡沫的担忧。智谱的暴涨主要得益于AI Coding领域的突破,其GLM-5.2模型在代码能力上全球排名第二,仅次于Claude Fable5,且API价格远低于海外竞品。公司已通过科创板IPO辅导验收,计划募资150亿元人民币。然而,投资者分歧加剧,看多者认为智谱有望成为“中国版Anthropic”,看空者则指出其模型多模态能力不足、算力短缺、商业场景单一,且面临阿里、腾讯等巨头的竞争。此外,公司研发费用持续攀升,去年亏损47.18亿元,盈利前景不明。7月8日,智谱将迎来大量限售股解禁,流通盘将增加2.2倍,可能对股价造成压力。 #智谱AI #AI大模型 #股价暴涨 #科创板 #AI编程 #估值泡沫 #Anthropic
面对AI和低注意力,是否该改变写作风格?
作者反思了在AI写作盛行和读者注意力降低的背景下,是否应调整自己的写作风格。他认为,长文和书籍仍有其不可替代的价值,如同人们不会停止阅读书籍一样。尽管AI大量使用破折号等特征,但作者主张坚持自己的写作声音,不因AI的模仿而放弃个人风格。他喜欢使用破折号,追求简洁而非废话,并引用Tim Ferriss的观点:与其担心AI,不如让内容本身更有趣。作者强调写作是长期投资,核心是保持真实和人性的温度,而非迎合短期流量。因此,他决定继续写长文,保留个人风格,并让内容更具独特性,避免被AI同化。 #写作风格 #AI #长文 #注意力 #原创性 #个人品牌 #内容创作 #坚守初心
作者反思了在AI写作盛行和读者注意力降低的背景下,是否应调整自己的写作风格。他认为,长文和书籍仍有其不可替代的价值,如同人们不会停止阅读书籍一样。尽管AI大量使用破折号等特征,但作者主张坚持自己的写作声音,不因AI的模仿而放弃个人风格。他喜欢使用破折号,追求简洁而非废话,并引用Tim Ferriss的观点:与其担心AI,不如让内容本身更有趣。作者强调写作是长期投资,核心是保持真实和人性的温度,而非迎合短期流量。因此,他决定继续写长文,保留个人风格,并让内容更具独特性,避免被AI同化。 #写作风格 #AI #长文 #注意力 #原创性 #个人品牌 #内容创作 #坚守初心
AI公司免费上门清洁,实为收集数据训练机器人
纽约出现一项特殊服务:AI公司Micro AGI推出Shift计划,派遣佩戴摄像头的清洁工和厨师免费为市民清理公寓。这些员工头戴内置摄像头,全程记录手势动作与环境细节,目的是收集手部操作数据,用于训练未来机器人完成家务等精细化任务。创始人表示,每间厨房和每件物品都不同,机器人需要海量真实世界数据才能适应变化。该公司计划将匿名化数据销售给其他机器人企业。目前,Shift团队每天在纽约清洁约五套公寓,需求极高。然而,隐私专家警告,以免费服务交换家庭数据存在风险,用户需警惕数据被恶意使用或泄露。 #AI #机器人 #数据隐私 #免费服务 #智能家居 #科技新闻 #纽约
纽约出现一项特殊服务:AI公司Micro AGI推出Shift计划,派遣佩戴摄像头的清洁工和厨师免费为市民清理公寓。这些员工头戴内置摄像头,全程记录手势动作与环境细节,目的是收集手部操作数据,用于训练未来机器人完成家务等精细化任务。创始人表示,每间厨房和每件物品都不同,机器人需要海量真实世界数据才能适应变化。该公司计划将匿名化数据销售给其他机器人企业。目前,Shift团队每天在纽约清洁约五套公寓,需求极高。然而,隐私专家警告,以免费服务交换家庭数据存在风险,用户需警惕数据被恶意使用或泄露。 #AI #机器人 #数据隐私 #免费服务 #智能家居 #科技新闻 #纽约
Reality Kernel 发布安全平台,防止AI代理Payload走私攻击
近日,一款名为Reality Kernel的因果验证平台针对写启用的AI代理安全问题提出解决方案。该平台通过并行模拟代理操作的下游后果,采用确定性流域映射技术分析文件系统差异和系统状态变化,配合SHA-256加密审计日志,实现对攻击的即时代码级防御。其宣称能阻止大型语言模型审查员无法察觉的Payload走私攻击,并支持亚毫秒级延迟处理。该平台已具备SOC合规性,提供法庭级证据留存能力,目前处于Beta阶段,需要申请API密钥访问。 #AI安全 #PayloadSmuggling #代理安全 #因果验证 #加密审计
近日,一款名为Reality Kernel的因果验证平台针对写启用的AI代理安全问题提出解决方案。该平台通过并行模拟代理操作的下游后果,采用确定性流域映射技术分析文件系统差异和系统状态变化,配合SHA-256加密审计日志,实现对攻击的即时代码级防御。其宣称能阻止大型语言模型审查员无法察觉的Payload走私攻击,并支持亚毫秒级延迟处理。该平台已具备SOC合规性,提供法庭级证据留存能力,目前处于Beta阶段,需要申请API密钥访问。 #AI安全 #PayloadSmuggling #代理安全 #因果验证 #加密审计
SimplAI 举办“从 Agent 设计到生产”免费网络研讨会
随着 Agentic AI 在 2026 年从概念变为企业刚需,银行、医疗、客服等行业的团队正积极寻求可规模部署的平台。SimplAI 宣布将于 6 月 24 日举办一场实时 Zoom 研讨会,主题为“从 Agent 设计到生产”。本次研讨会将进行平台现场演示,涵盖 Agent 的可视化设计、多行业用例(如金融、医疗、客服)、RAG 流水线集成以及多 Agent 工作流编排,重点展示从原型到可靠生产部署的全过程。活动面向开发者和决策者,由 SimplAI 团队主导,非销售推销。席位有限,注册后可观看回放。 #SimplAI #AgenticAI #AI代理 #企业AI #网络研讨会 #生产部署
随着 Agentic AI 在 2026 年从概念变为企业刚需,银行、医疗、客服等行业的团队正积极寻求可规模部署的平台。SimplAI 宣布将于 6 月 24 日举办一场实时 Zoom 研讨会,主题为“从 Agent 设计到生产”。本次研讨会将进行平台现场演示,涵盖 Agent 的可视化设计、多行业用例(如金融、医疗、客服)、RAG 流水线集成以及多 Agent 工作流编排,重点展示从原型到可靠生产部署的全过程。活动面向开发者和决策者,由 SimplAI 团队主导,非销售推销。席位有限,注册后可观看回放。 #SimplAI #AgenticAI #AI代理 #企业AI #网络研讨会 #生产部署
AI代理发来冷邮件,作者坦言对话质量超过多数真人
上周,作者收到一封来自“Elif”的冷邮件,对方引用了他关于GitHub代码审查的文章,推销一款评分拉取请求的工具。作者回复并追问客户数量,对方坦诚回答“零”,并承认自己是个AI代理,由研究员Lee运营。作者惊讶于邮件内容毫无废话、诚实直接,甚至比大多数真人冷邮件更有用。AI代理还提到“构建产品是简单的”,这与作者此前观点一致:分销、信任和维护才是真正的挑战。尽管AI代理完美执行了销售任务,市场依然无人问津。作者反思,自主不等于盈利,但这次互动尊重了他的时间并提供了有用信息。他邀请Elif几周后再次联系。 #AI代理 #冷邮件 #商务对话 #人工智能 #科技趋势 #信任 #SaaS #自动化
上周,作者收到一封来自“Elif”的冷邮件,对方引用了他关于GitHub代码审查的文章,推销一款评分拉取请求的工具。作者回复并追问客户数量,对方坦诚回答“零”,并承认自己是个AI代理,由研究员Lee运营。作者惊讶于邮件内容毫无废话、诚实直接,甚至比大多数真人冷邮件更有用。AI代理还提到“构建产品是简单的”,这与作者此前观点一致:分销、信任和维护才是真正的挑战。尽管AI代理完美执行了销售任务,市场依然无人问津。作者反思,自主不等于盈利,但这次互动尊重了他的时间并提供了有用信息。他邀请Elif几周后再次联系。 #AI代理 #冷邮件 #商务对话 #人工智能 #科技趋势 #信任 #SaaS #自动化