Arm:Agentic AI或使数据中心CPU核心需求增至4倍以上
Arm首席执行官Rene Haas在Computex演讲中指出,随着Agentic AI加速落地,数据中心对CPU的需求增速已超预期。未来在相同电力条件下,CPU核心数可能增至当前的4倍以上。过去两年生成式AI投资主要集中于GPU,但Agentic AI因需持续执行任务、调用工具、管理工作流及代理协同,其调度、协调等负载正更多由CPU承担。Arm自研了“Arm AGI CPU”,基于Neoverse架构,每瓦性能约为同级x86系统两倍。该产品已获OCI和字节跳动采用。此外,Google、AWS、NVIDIA等厂商的数据中心CPU也基于Arm架构。Agentic AI的影响还延伸至PC市场,NVIDIA RTX Spark平台搭载Arm架构CPU,未来PC可运行千亿参数AI模型。Arm估算,大规模导入其CPU可减少约10GW电力需求,节省超100亿美元基础设施投资。 #ARM #AgenticAI #数据中心 #CPU #人工智能 #芯片 #能效 #科技新闻
Arm首席执行官Rene Haas在Computex演讲中指出,随着Agentic AI加速落地,数据中心对CPU的需求增速已超预期。未来在相同电力条件下,CPU核心数可能增至当前的4倍以上。过去两年生成式AI投资主要集中于GPU,但Agentic AI因需持续执行任务、调用工具、管理工作流及代理协同,其调度、协调等负载正更多由CPU承担。Arm自研了“Arm AGI CPU”,基于Neoverse架构,每瓦性能约为同级x86系统两倍。该产品已获OCI和字节跳动采用。此外,Google、AWS、NVIDIA等厂商的数据中心CPU也基于Arm架构。Agentic AI的影响还延伸至PC市场,NVIDIA RTX Spark平台搭载Arm架构CPU,未来PC可运行千亿参数AI模型。Arm估算,大规模导入其CPU可减少约10GW电力需求,节省超100亿美元基础设施投资。 #ARM #AgenticAI #数据中心 #CPU #人工智能 #芯片 #能效 #科技新闻
AI 爱好者在与时间赛跑,AI 怀疑者在与熵增赛跑
近期一场技术演讲中,主讲人声称通过纯“氛围编程”(vibe coding)快速解决了复杂工程问题,几周内完成以往需要一年的重写任务,台下AI爱好者欢呼雀跃,认为终于找到了说服团队不读代码就交付的证据。然而,该公司的其他员工透露,这些项目留下了大量混乱和清理工作,数月后仍有团队在处理烂摊子。这暴露了AI爱好者和怀疑者之间日益扩大的鸿沟:前者担心不积极拥抱AI会被竞争对手淘汰,后者则担忧快速生成无法理解的代码会侵蚀系统可靠性、积累技术债务。双方都面临真实的生存威胁,但已停止对话,互相视对方为障碍或威胁。这种局面需要的是理解而非对立。 #AI #编程 #技术争议 #vibe_coding #工程师 #管理 #软件工程 #效率 #风险
近期一场技术演讲中,主讲人声称通过纯“氛围编程”(vibe coding)快速解决了复杂工程问题,几周内完成以往需要一年的重写任务,台下AI爱好者欢呼雀跃,认为终于找到了说服团队不读代码就交付的证据。然而,该公司的其他员工透露,这些项目留下了大量混乱和清理工作,数月后仍有团队在处理烂摊子。这暴露了AI爱好者和怀疑者之间日益扩大的鸿沟:前者担心不积极拥抱AI会被竞争对手淘汰,后者则担忧快速生成无法理解的代码会侵蚀系统可靠性、积累技术债务。双方都面临真实的生存威胁,但已停止对话,互相视对方为障碍或威胁。这种局面需要的是理解而非对立。 #AI #编程 #技术争议 #vibe_coding #工程师 #管理 #软件工程 #效率 #风险
Titan Network以众包家庭设备抢占亚洲AI数据市场5%份额
Titan Network仅凭借100万美元的种子轮融资,构建了基于众包家庭设备的计算基础设施。该模式通过整合普通家庭中闲置的电脑、路由器等设备,为AI训练提供低成本算力,并成功吸引了腾讯、阿里巴巴等科技巨头成为其客户。据公司宣称,其已占据亚洲AI数据市场约5%的份额。这一成绩凸显出众包计算在降低AI基础设施成本方面的潜力,也反映出大型科技公司对分布式、灵活算力的迫切需求。目前Titan Network正计划进一步扩展其设备网络,以应对持续增长的AI计算需求。 #TitanNetwork #众包计算 #AI数据市场 #云计算 #阿里巴巴 #腾讯 #算力 #人工智能 #科技创业
Titan Network仅凭借100万美元的种子轮融资,构建了基于众包家庭设备的计算基础设施。该模式通过整合普通家庭中闲置的电脑、路由器等设备,为AI训练提供低成本算力,并成功吸引了腾讯、阿里巴巴等科技巨头成为其客户。据公司宣称,其已占据亚洲AI数据市场约5%的份额。这一成绩凸显出众包计算在降低AI基础设施成本方面的潜力,也反映出大型科技公司对分布式、灵活算力的迫切需求。目前Titan Network正计划进一步扩展其设备网络,以应对持续增长的AI计算需求。 #TitanNetwork #众包计算 #AI数据市场 #云计算 #阿里巴巴 #腾讯 #算力 #人工智能 #科技创业
ContextWall:为AI代理与RAG管道打造上下文防火墙
ContextWall 是一款针对 AI 代理和检索增强生成(RAG)管道的上下文安全防火墙。它能够在 LLM 处理前拦截并筛选所有来自网络、文档及 API 的未信任内容,有效防御提示注入、凭证泄露等攻击。传统 LLM 无法区分系统指令与未信任内容,导致微软 365 Copilot 曾因邮件嵌入指令而被动泄露文件,USENIX 研究也证实 RAG 系统会因检索恶意文档而输出虚假信息。ContextWall 通过为每个上下文来源打上信任等级标签,并执行安全策略,在内容进入模型前阻断风险。它支持自托管、无需修改代理代码、运行在用户基础设施中,且筛选路径不经过 LLM。产品适用于 AI 工程师、安全团队及合规审计,已成功拦截直接指令覆盖、RTL 隐藏字符、AWS 密钥等攻击,但不处理模型幻觉和系统提示设计缺陷。 #ContextWall #AI安全 #提示注入 #RAG #防火墙 #LLM安全 #凭证保护 #自托管
ContextWall 是一款针对 AI 代理和检索增强生成(RAG)管道的上下文安全防火墙。它能够在 LLM 处理前拦截并筛选所有来自网络、文档及 API 的未信任内容,有效防御提示注入、凭证泄露等攻击。传统 LLM 无法区分系统指令与未信任内容,导致微软 365 Copilot 曾因邮件嵌入指令而被动泄露文件,USENIX 研究也证实 RAG 系统会因检索恶意文档而输出虚假信息。ContextWall 通过为每个上下文来源打上信任等级标签,并执行安全策略,在内容进入模型前阻断风险。它支持自托管、无需修改代理代码、运行在用户基础设施中,且筛选路径不经过 LLM。产品适用于 AI 工程师、安全团队及合规审计,已成功拦截直接指令覆盖、RTL 隐藏字符、AWS 密钥等攻击,但不处理模型幻觉和系统提示设计缺陷。 #ContextWall #AI安全 #提示注入 #RAG #防火墙 #LLM安全 #凭证保护 #自托管
Mozilla 发布 Firefox 项目 AI 编码政策,强调开发者责任
Mozilla 日前公布了适用于 Firefox 浏览器的 AI 编码政策,明确了贡献者在使用 AI 或辅助工具编写生产代码时的期望与要求。政策指出,AI 工具能加速开发、提前发现问题,但也可能生成看似正确实则错误的代码。Mozilla 信任贡献者审慎使用这些工具,但强调人类开发者应对所有更改负最终责任。AI 辅助的贡献必须达到与传统补丁相同的正确性、安全性和可维护性标准。贡献者需确保补丁小而聚焦,充分理解并能够解释每项变更,在提交前进行自我审查,并避免将敏感数据输入外部 AI 工具。对于新贡献者,政策建议应通过“Good First”等标签学习代码库,而非单纯依赖 AI 完成大量任务。 #Mozilla #Firefox #AI编码政策 #软件工程 #开发者责任 #开源 #代码质量
Mozilla 日前公布了适用于 Firefox 浏览器的 AI 编码政策,明确了贡献者在使用 AI 或辅助工具编写生产代码时的期望与要求。政策指出,AI 工具能加速开发、提前发现问题,但也可能生成看似正确实则错误的代码。Mozilla 信任贡献者审慎使用这些工具,但强调人类开发者应对所有更改负最终责任。AI 辅助的贡献必须达到与传统补丁相同的正确性、安全性和可维护性标准。贡献者需确保补丁小而聚焦,充分理解并能够解释每项变更,在提交前进行自我审查,并避免将敏感数据输入外部 AI 工具。对于新贡献者,政策建议应通过“Good First”等标签学习代码库,而非单纯依赖 AI 完成大量任务。 #Mozilla #Firefox #AI编码政策 #软件工程 #开发者责任 #开源 #代码质量
微Python WebAssembly 版 0.1a1 发布
近日,MicroPython 的 WebAssembly 移植版本 0.1a1 正式发布。MicroPython 是 Python 语言针对微控制器和嵌入式系统的精简实现,此次推出的 wasm 端口允许开发者将 MicroPython 代码编译为 WebAssembly 模块,从而在浏览器中直接运行 Python 脚本。这一版本尚处于早期 alpha 阶段,主要面向技术尝鲜者与开源社区。该项目的发布标志着 Python 在浏览器端的应用生态进一步扩展,未来或可用于在线编程教学、物联网模拟等场景。开发者可前往 GitHub 仓库获取源码及使用说明。 #MicroPython #WebAssembly #Python #嵌入式 #浏览器 #编程 #技术新闻 #开源
近日,MicroPython 的 WebAssembly 移植版本 0.1a1 正式发布。MicroPython 是 Python 语言针对微控制器和嵌入式系统的精简实现,此次推出的 wasm 端口允许开发者将 MicroPython 代码编译为 WebAssembly 模块,从而在浏览器中直接运行 Python 脚本。这一版本尚处于早期 alpha 阶段,主要面向技术尝鲜者与开源社区。该项目的发布标志着 Python 在浏览器端的应用生态进一步扩展,未来或可用于在线编程教学、物联网模拟等场景。开发者可前往 GitHub 仓库获取源码及使用说明。 #MicroPython #WebAssembly #Python #嵌入式 #浏览器 #编程 #技术新闻 #开源
阶跃星辰发布 Step 3.7 Flash 多模态大模型,400 tokens/秒吞吐将 Agent 成本降至 Claude 零头
阶跃星辰正式推出国产多模态大模型 Step 3.7 Flash,实现 400TPS 的超高推理吞吐,显著提升生产级 Flash 模型效率。该模型直接瞄准当前 Agent 落地中“烧钱”的痛点,通过极致性价比打破全球大模型价格壁垒,将 Agent 任务成本压缩至 Claude 模型的零头水平。这一技术突破标志着国产 AI 在高性能、低成本多模态推理领域迈出关键一步,有望加速推动 AI 应用的规模化落地。模型发布后迅速引发开发者广泛关注,被视为大模型产业降本增效的重要里程碑。 #阶跃星辰 #多模态大模型 #Agent #Flash模型 #400TPS #AI成本 #国产大模型 #技术突破
阶跃星辰正式推出国产多模态大模型 Step 3.7 Flash,实现 400TPS 的超高推理吞吐,显著提升生产级 Flash 模型效率。该模型直接瞄准当前 Agent 落地中“烧钱”的痛点,通过极致性价比打破全球大模型价格壁垒,将 Agent 任务成本压缩至 Claude 模型的零头水平。这一技术突破标志着国产 AI 在高性能、低成本多模态推理领域迈出关键一步,有望加速推动 AI 应用的规模化落地。模型发布后迅速引发开发者广泛关注,被视为大模型产业降本增效的重要里程碑。 #阶跃星辰 #多模态大模型 #Agent #Flash模型 #400TPS #AI成本 #国产大模型 #技术突破