从大到小
过去三年,AI开发者习惯性调用GPT或Claude等前沿模型,但到2026年,这一惯性正变得昂贵且不必要。如今,普通笔记本电脑运行的模型已能胜任分类、提取、摘要、代码补全、文档问答等实际生产任务。2025年末至2026年中,五大变化同时推动小型语言模型(SLM,参数约1B-14B)从爱好者玩具成为项目起点:NVIDIA研究指出40%-70%的企业AI任务可由子10B模型完成;3B-14B模型在特定任务上已达到12-18个月前70B模型的水平;苹果M5芯片、英伟达DGX Spark等硬件支持本地运行大模型;Hugging Face开源模型超200万个,92.5%下载量来自1B以下模型;API价格虽下降80%,但推理token计费复杂化。选择SLM需权衡:精度低于前沿模型、长上下文支持有限、多模态弱,但成本低、延迟短、隐私可控。对于分类、结构化提取、实时助手等场景,SLM已是合理起点。 #AI模型 #小型语言模型 #前沿模型 #技术趋势 #硬件进步 #开源工具 #NVIDIA #Apple #成本优化
过去三年,AI开发者习惯性调用GPT或Claude等前沿模型,但到2026年,这一惯性正变得昂贵且不必要。如今,普通笔记本电脑运行的模型已能胜任分类、提取、摘要、代码补全、文档问答等实际生产任务。2025年末至2026年中,五大变化同时推动小型语言模型(SLM,参数约1B-14B)从爱好者玩具成为项目起点:NVIDIA研究指出40%-70%的企业AI任务可由子10B模型完成;3B-14B模型在特定任务上已达到12-18个月前70B模型的水平;苹果M5芯片、英伟达DGX Spark等硬件支持本地运行大模型;Hugging Face开源模型超200万个,92.5%下载量来自1B以下模型;API价格虽下降80%,但推理token计费复杂化。选择SLM需权衡:精度低于前沿模型、长上下文支持有限、多模态弱,但成本低、延迟短、隐私可控。对于分类、结构化提取、实时助手等场景,SLM已是合理起点。 #AI模型 #小型语言模型 #前沿模型 #技术趋势 #硬件进步 #开源工具 #NVIDIA #Apple #成本优化
甲骨文推出新的Fusion智能体应用,助力供应链绩效提升
甲骨文(Oracle)近日发布了全新的Fusion智能体应用,旨在帮助企业客户优化供应链管理,提升整体运营绩效。该应用集成人工智能与自动化技术,能够实时分析供应链数据,预测潜在中断风险,并自动生成应对策略。通过嵌入甲骨文Fusion云ERP平台,智能体可以与现有业务流程无缝协作,从采购、物流到库存管理各环节提供智能决策支持。甲骨文表示,这一创新工具将帮助企业在不确定性增强的市场环境中提高韧性,降低运营成本,加快响应速度。目前,该应用已面向部分客户开放试用,预计后续将逐步推广。 #甲骨文 #Fusion #智能体 #供应链 #AI #企业管理 #科技新闻
甲骨文(Oracle)近日发布了全新的Fusion智能体应用,旨在帮助企业客户优化供应链管理,提升整体运营绩效。该应用集成人工智能与自动化技术,能够实时分析供应链数据,预测潜在中断风险,并自动生成应对策略。通过嵌入甲骨文Fusion云ERP平台,智能体可以与现有业务流程无缝协作,从采购、物流到库存管理各环节提供智能决策支持。甲骨文表示,这一创新工具将帮助企业在不确定性增强的市场环境中提高韧性,降低运营成本,加快响应速度。目前,该应用已面向部分客户开放试用,预计后续将逐步推广。 #甲骨文 #Fusion #智能体 #供应链 #AI #企业管理 #科技新闻
GLM 5.2 网络安全测试击败 Claude,美国 AI 出口管制升级
智谱 GLM 5.2 在 Semgrep 网络安全测试中超越 Claude,引发亚洲模型崛起讨论。与此同时,美国 AI 监管趋严:OpenAI 因政府审查要求推迟 GPT-5.6 发布,AI 监管从指南转向预审批;谷歌据称将被列入美国 AI 出口管制名单,成为继 Anthropic 后第二家受限公司。比特币受 ETF 持续流出及美伊冲突影响失守 6 万美元,24 小时爆仓近 10 亿美元。存储芯片领域,三星与 SK 海力士计划投资 30 万亿韩元建设新厂,多家机构上调美光目标价,DDR2 合约价预计 Q2 涨 55-60%。此外,芬兰开发者用 Claude 分析 MRI 扫描结果引发医疗 AI 边界讨论,OpenAI 为 ChatGPT 增加倒计时功能。Galaxy Digital 将稳定币法案通过概率从 70% 调至 50%,花旗称苹果认可 CXMT 提升其地位。 #GLM #AI监管 #出口管制 #比特币 #存储芯片 #医疗AI #ChatGPT #科技新闻 #美光 #稳定币
智谱 GLM 5.2 在 Semgrep 网络安全测试中超越 Claude,引发亚洲模型崛起讨论。与此同时,美国 AI 监管趋严:OpenAI 因政府审查要求推迟 GPT-5.6 发布,AI 监管从指南转向预审批;谷歌据称将被列入美国 AI 出口管制名单,成为继 Anthropic 后第二家受限公司。比特币受 ETF 持续流出及美伊冲突影响失守 6 万美元,24 小时爆仓近 10 亿美元。存储芯片领域,三星与 SK 海力士计划投资 30 万亿韩元建设新厂,多家机构上调美光目标价,DDR2 合约价预计 Q2 涨 55-60%。此外,芬兰开发者用 Claude 分析 MRI 扫描结果引发医疗 AI 边界讨论,OpenAI 为 ChatGPT 增加倒计时功能。Galaxy Digital 将稳定币法案通过概率从 70% 调至 50%,花旗称苹果认可 CXMT 提升其地位。 #GLM #AI监管 #出口管制 #比特币 #存储芯片 #医疗AI #ChatGPT #科技新闻 #美光 #稳定币
美国批准Anthropic发布Mythos 5,印度部署AI预警大象冲突
美国已允许AI公司Anthropic向约100家美国企业和联邦机构发布其Mythos 5模型,此前该模型因国家安全担忧受到限制。与此同时,印度正大规模部署AI系统应对人象冲突——全球约60%野生亚洲象生活在印度,其中80%栖息地位于保护区外,过去五年已造成约3000人死亡、1000头大象丧生。各地采用红外无人机、野生动物眼等AI方案,将预警时间缩短至分钟级甚至秒级。此外,中国智谱AI在安全漏洞检测领域已媲美Mythos模型,引发美国限制可能反而加速中国进步的争议。苹果则寻求批准从被列入黑名单的中国芯片企业长鑫存储采购。韩国计划培训全部50万军人为“无人机战士”,并生产11万架无人机。 #AI #Anthropic #Mythos5 #人象冲突 #印度 #大模型 #安全漏洞 #无人机 #科技新闻 #人工智能
美国已允许AI公司Anthropic向约100家美国企业和联邦机构发布其Mythos 5模型,此前该模型因国家安全担忧受到限制。与此同时,印度正大规模部署AI系统应对人象冲突——全球约60%野生亚洲象生活在印度,其中80%栖息地位于保护区外,过去五年已造成约3000人死亡、1000头大象丧生。各地采用红外无人机、野生动物眼等AI方案,将预警时间缩短至分钟级甚至秒级。此外,中国智谱AI在安全漏洞检测领域已媲美Mythos模型,引发美国限制可能反而加速中国进步的争议。苹果则寻求批准从被列入黑名单的中国芯片企业长鑫存储采购。韩国计划培训全部50万军人为“无人机战士”,并生产11万架无人机。 #AI #Anthropic #Mythos5 #人象冲突 #印度 #大模型 #安全漏洞 #无人机 #科技新闻 #人工智能
五年数据咨询生涯
从研究生毕业加入保险行业担任高级数据分析师,到如今成为资深分析咨询师,作者在五年职业生涯中深刻体会到:数据分析的价值不在于工具或数字本身,而在于如何被理解、信任并付诸行动。他总结出五个关键教训:第一,数据驱动影响力离不开“故事叙述”——决策者记住的是帮助他们做决定的故事,而非模型精度;第二,好奇心固然重要,但提出正确的问题才是洞察的关键;即使拥有最干净的数据集,缺乏好问题也会导致分析迷失方向。随着AI成为“第一分析师”,故事叙述的威力更大,但必须建立在对数据完整性的坚守之上。这些经验不仅适用于分析岗,也适用于任何需要与数据打交道的业务角色。 #数据分析 #职业成长 #故事叙述 #问题驱动 #AI辅助 #决策洞察 #咨询心得
从研究生毕业加入保险行业担任高级数据分析师,到如今成为资深分析咨询师,作者在五年职业生涯中深刻体会到:数据分析的价值不在于工具或数字本身,而在于如何被理解、信任并付诸行动。他总结出五个关键教训:第一,数据驱动影响力离不开“故事叙述”——决策者记住的是帮助他们做决定的故事,而非模型精度;第二,好奇心固然重要,但提出正确的问题才是洞察的关键;即使拥有最干净的数据集,缺乏好问题也会导致分析迷失方向。随着AI成为“第一分析师”,故事叙述的威力更大,但必须建立在对数据完整性的坚守之上。这些经验不仅适用于分析岗,也适用于任何需要与数据打交道的业务角色。 #数据分析 #职业成长 #故事叙述 #问题驱动 #AI辅助 #决策洞察 #咨询心得
博通股价高位回落26%,OpenAI定制芯片合作或成新催化剂
博通(AVGO)近日股价从495美元高点下跌约26%,至365美元。尽管公司2026财年第二季度AI半导体营收创下108亿美元纪录,同比增长143%,但由于基础设施软件部门营收低于预期,以及第三季度AI营收指引160亿美元未达部分分析师预估,导致市场抛售。然而,6月24日OpenAI宣布与博通联合设计定制芯片“Jalapeño LLM推理芯片平台”,旨在降低大规模推理成本,计划2026年底部署。该合作被视为中期营收催化剂。博通拥有六大定制芯片客户,包括Anthropic、谷歌、Meta和OpenAI,其双引擎模式(半导体+VMware软件)构筑护城河。与英伟达的GPU不同,博通的ASIC专用芯片更适合推理场景。分析师认为当前估值已具防御性,但需关注9月财报能否超越指引。 #博通 #OpenAI #定制芯片 #AI推理 #半导体 #股价下跌 #估值分析 #Marvell #英伟达 #科技投资
博通(AVGO)近日股价从495美元高点下跌约26%,至365美元。尽管公司2026财年第二季度AI半导体营收创下108亿美元纪录,同比增长143%,但由于基础设施软件部门营收低于预期,以及第三季度AI营收指引160亿美元未达部分分析师预估,导致市场抛售。然而,6月24日OpenAI宣布与博通联合设计定制芯片“Jalapeño LLM推理芯片平台”,旨在降低大规模推理成本,计划2026年底部署。该合作被视为中期营收催化剂。博通拥有六大定制芯片客户,包括Anthropic、谷歌、Meta和OpenAI,其双引擎模式(半导体+VMware软件)构筑护城河。与英伟达的GPU不同,博通的ASIC专用芯片更适合推理场景。分析师认为当前估值已具防御性,但需关注9月财报能否超越指引。 #博通 #OpenAI #定制芯片 #AI推理 #半导体 #股价下跌 #估值分析 #Marvell #英伟达 #科技投资
英伟达CEO黄仁勋称Fireworks为“AI工厂的台积电”
在GTC 2026大会上,英伟达CEO黄仁勋将AI初创公司Fireworks誉为“AI工厂的台积电”,意指其在AI推理领域扮演着类似台积电在芯片制造中的关键角色。黄仁勋与英伟达高管lqiao在对话中强调了这一比喻,认为Fireworks在提升AI推理速度和降低成本方面具有核心地位。随着AI模型不断迭代,推理效率已成为制约产品落地的瓶颈,而Fireworks正致力于解决这一挑战。该言论引发了业界对AI基础设施服务商的广泛关注,凸显了推理环节在AI产业化中的战略价值。 #英伟达 #黄仁勋 #Fireworks #AI推理 #GTC2026 #人工智能 #科技新闻
在GTC 2026大会上,英伟达CEO黄仁勋将AI初创公司Fireworks誉为“AI工厂的台积电”,意指其在AI推理领域扮演着类似台积电在芯片制造中的关键角色。黄仁勋与英伟达高管lqiao在对话中强调了这一比喻,认为Fireworks在提升AI推理速度和降低成本方面具有核心地位。随着AI模型不断迭代,推理效率已成为制约产品落地的瓶颈,而Fireworks正致力于解决这一挑战。该言论引发了业界对AI基础设施服务商的广泛关注,凸显了推理环节在AI产业化中的战略价值。 #英伟达 #黄仁勋 #Fireworks #AI推理 #GTC2026 #人工智能 #科技新闻
AI安全信心高涨或预示MSSP风险攀升
ReliaQuest与FusionAuth的最新报告指出,AI正在加速网络攻击,包括钓鱼、社交工程和凭证窃取,且成本更低、更难捕获。同时,65%的受访组织在过去一年遭遇过AI身份相关安全事件,88%认为AI部署速度远超其身份与安全架构的承载能力。报告强调,真正的风险并非检测不足,而是访问控制缺失——组织在未有效治理代理访问、租户隔离和令牌泄露的情况下盲目扩展AI,反而主动制造了攻击面。MSSP需从身份态势、机器身份、影子AI、租户隔离等维度入手,并警惕客户对AI安全的高信心可能只是部署速度快的错觉。Keeper Security推出通用密钥同步功能,解决云环境中凭证的漂移问题;Akamai发布代理安全框架,通过“了解你的代理”协议将AI代理与授权用户绑定,实现身份、来源和意图的实时验证。这些举措意在帮助MSSP和企业在AI快速扩张中重建可见性与控制力。 #AI安全 #MSSP #网络安全 #身份管理 #访问控制 #凭证漂移 #agentic安全 #KeeperSecurity #Akamai
ReliaQuest与FusionAuth的最新报告指出,AI正在加速网络攻击,包括钓鱼、社交工程和凭证窃取,且成本更低、更难捕获。同时,65%的受访组织在过去一年遭遇过AI身份相关安全事件,88%认为AI部署速度远超其身份与安全架构的承载能力。报告强调,真正的风险并非检测不足,而是访问控制缺失——组织在未有效治理代理访问、租户隔离和令牌泄露的情况下盲目扩展AI,反而主动制造了攻击面。MSSP需从身份态势、机器身份、影子AI、租户隔离等维度入手,并警惕客户对AI安全的高信心可能只是部署速度快的错觉。Keeper Security推出通用密钥同步功能,解决云环境中凭证的漂移问题;Akamai发布代理安全框架,通过“了解你的代理”协议将AI代理与授权用户绑定,实现身份、来源和意图的实时验证。这些举措意在帮助MSSP和企业在AI快速扩张中重建可见性与控制力。 #AI安全 #MSSP #网络安全 #身份管理 #访问控制 #凭证漂移 #agentic安全 #KeeperSecurity #Akamai
美国 AI 封锁反而助推中国开源优势
2026年6月,美国连续出台三项针对前沿AI模型的管制措施:行政令要求大模型公开发布前30天提交政府审查,商务部的出口管制阻止特定模型服务外国人员,以及OpenAI最新模型GPT-5.6需经政府逐客户审批。这些行动名义上为了国家安全,却产生了一个结构性副作用——每次封锁都在推动全球开发者转向无权限风险的开放式权重模型,而中国在这方面已建立完整生态。分析指出,美国可以控制自己将闭源模型“关掉”,但无法阻止开源权重在全球服务器上运行。随着中国模型能力逼近前沿(如DeepSeek R3达到Claude Opus 4.5水平),且拥有自研芯片、国产库和自主框架,任何理性的开发者都会优先选择当下可用、无许可风险的开源模型。这种“封锁可及性”与“封锁不可及性”之间的战略不对称,可能让中国在长期AI竞赛中占据结构性优势。 #AI #美国 #中国 #开源模型 #出口管制 #人工智能 #国家安全 #技术竞争
2026年6月,美国连续出台三项针对前沿AI模型的管制措施:行政令要求大模型公开发布前30天提交政府审查,商务部的出口管制阻止特定模型服务外国人员,以及OpenAI最新模型GPT-5.6需经政府逐客户审批。这些行动名义上为了国家安全,却产生了一个结构性副作用——每次封锁都在推动全球开发者转向无权限风险的开放式权重模型,而中国在这方面已建立完整生态。分析指出,美国可以控制自己将闭源模型“关掉”,但无法阻止开源权重在全球服务器上运行。随着中国模型能力逼近前沿(如DeepSeek R3达到Claude Opus 4.5水平),且拥有自研芯片、国产库和自主框架,任何理性的开发者都会优先选择当下可用、无许可风险的开源模型。这种“封锁可及性”与“封锁不可及性”之间的战略不对称,可能让中国在长期AI竞赛中占据结构性优势。 #AI #美国 #中国 #开源模型 #出口管制 #人工智能 #国家安全 #技术竞争