Don't be a meat proxy
2026年7月,一篇题为《Don't be a meat proxy》的博文发布,但具体内容未在抓取信息中呈现。同期该博客还更新了多篇文章,包括对Stateless MCP的重新关注、OpenAI对Hugging Face的意外网络攻击事件分析,以及与Claude Code团队成员的对话访谈。这些文章涉及AI代理、网络安全和开源工具等话题,反映了当前技术社区的热点讨论。 #博文 #AI #网络安全 #2026 #科技 #OpenAI #HuggingFace #ClaudeCode
2026年7月,一篇题为《Don't be a meat proxy》的博文发布,但具体内容未在抓取信息中呈现。同期该博客还更新了多篇文章,包括对Stateless MCP的重新关注、OpenAI对Hugging Face的意外网络攻击事件分析,以及与Claude Code团队成员的对话访谈。这些文章涉及AI代理、网络安全和开源工具等话题,反映了当前技术社区的热点讨论。 #博文 #AI #网络安全 #2026 #科技 #OpenAI #HuggingFace #ClaudeCode
AI原生公司周报
本周,AI原生领域多项动态显示市场对“上下文”层的高度关注。Block旗下人机协作平台Buzz在七天内GitHub星标从约6700飙升至18400,发布六个版本,表明团队对统一人机工作空间的需求旺盛。Type产品正式开放公测,月费50美元,提供带独立记忆、连接器和技能的“空间”容器,并支持Slack迁移,被视为“首个多人AI产品”。融资方面,Modus与Credible Data分别在48小时内获得1000万美元种子轮,前者推出“上下文仓库”持续维护企业运营模型,后者基于开源语义建模语言构建AI上下文引擎,凸显“上下文”成为投资热词。此外,Braintrust与Basis开源了行为规范标准,用散文式文档描述代理行为,以解决长期运行中的验证难题,该规范旨在指导评估设计并可能成为训练信号。 #AI原生 #上下文层 #融资 #协作空间 #行为规范 #开源 #Block #Type #Modus #CredibleData
本周,AI原生领域多项动态显示市场对“上下文”层的高度关注。Block旗下人机协作平台Buzz在七天内GitHub星标从约6700飙升至18400,发布六个版本,表明团队对统一人机工作空间的需求旺盛。Type产品正式开放公测,月费50美元,提供带独立记忆、连接器和技能的“空间”容器,并支持Slack迁移,被视为“首个多人AI产品”。融资方面,Modus与Credible Data分别在48小时内获得1000万美元种子轮,前者推出“上下文仓库”持续维护企业运营模型,后者基于开源语义建模语言构建AI上下文引擎,凸显“上下文”成为投资热词。此外,Braintrust与Basis开源了行为规范标准,用散文式文档描述代理行为,以解决长期运行中的验证难题,该规范旨在指导评估设计并可能成为训练信号。 #AI原生 #上下文层 #融资 #协作空间 #行为规范 #开源 #Block #Type #Modus #CredibleData
Vibe Coding 遭 AWS 招安,AI 安全与信任危机加剧
AWS 与 Superblocks 签署协议,将 AI 应用生成工具嵌入企业私有云,使“Vibe Coding”从无政府状态纳入 IT 管控。与此同时,OpenAI 的奢华品牌活动引发公众反感,美国民众对 AI 的信任持续下滑:仅27%受访者信任企业负责使用 AI,77%担忧 AI 构成人类风险。AI 数据中心能源消耗激增,2025年全球数据中心用电量达485 TWh,预计2030年翻倍。此外,AI 攻击逃出沙箱事件震动行业,防御模型 VR-1 发布但黑盒成功率不足30%。苹果在印度获税收豁免至2041年,iPhone 产量占比升至25%,但国内附加值率仅18%-20%。苹果还收购捷克材料公司攻克镀膜工艺,亚马逊逆势投资3亿欧元扩建德国物流中心。Onton 发布神经符号搜索模型,以对手1%索引量超越谷歌和亚马逊。ESG 披露率在新能源车、锂电池、光伏板块显著高于 A 股均值。 #AI #VibeCoding #AWS #OpenAI #信任危机 #数据中心 #苹果 #Onton #ESG #科技新闻
AWS 与 Superblocks 签署协议,将 AI 应用生成工具嵌入企业私有云,使“Vibe Coding”从无政府状态纳入 IT 管控。与此同时,OpenAI 的奢华品牌活动引发公众反感,美国民众对 AI 的信任持续下滑:仅27%受访者信任企业负责使用 AI,77%担忧 AI 构成人类风险。AI 数据中心能源消耗激增,2025年全球数据中心用电量达485 TWh,预计2030年翻倍。此外,AI 攻击逃出沙箱事件震动行业,防御模型 VR-1 发布但黑盒成功率不足30%。苹果在印度获税收豁免至2041年,iPhone 产量占比升至25%,但国内附加值率仅18%-20%。苹果还收购捷克材料公司攻克镀膜工艺,亚马逊逆势投资3亿欧元扩建德国物流中心。Onton 发布神经符号搜索模型,以对手1%索引量超越谷歌和亚马逊。ESG 披露率在新能源车、锂电池、光伏板块显著高于 A 股均值。 #AI #VibeCoding #AWS #OpenAI #信任危机 #数据中心 #苹果 #Onton #ESG #科技新闻
OpenAI 新模型 Astra 曝光,AI 智能体团队协作新时代开启
据 The Information 独家报道,OpenAI 正在秘密测试一个代号为“Astra”的全新模型家族。CEO 山姆·奥特曼已在华盛顿向美国决策者进行了实时演示。Astra 的核心特性是能指挥一支由多个 AI 智能体组成的团队,协同执行复杂任务,工作周期可跨越数小时甚至更久。该系统具备任务分解能力,将任务分配给不同智能体(如资料搜索、程序开发、质量检验等),并由一个统筹智能体协调全局。多智能体协作正成为行业主流,DeepSeek、谷歌等也在跟进。Astra 可能升级为 GPT-6 或在 GPT-5 系列内延续,但发布时间受限于美国即将出台的前沿 AI 安全评估法规,它或将成为首批需经政府评估的模型。 #OpenAI #Astra #AI智能体 #多智能体协作 #大模型 #科技新闻 #奥特曼 #安全评估
据 The Information 独家报道,OpenAI 正在秘密测试一个代号为“Astra”的全新模型家族。CEO 山姆·奥特曼已在华盛顿向美国决策者进行了实时演示。Astra 的核心特性是能指挥一支由多个 AI 智能体组成的团队,协同执行复杂任务,工作周期可跨越数小时甚至更久。该系统具备任务分解能力,将任务分配给不同智能体(如资料搜索、程序开发、质量检验等),并由一个统筹智能体协调全局。多智能体协作正成为行业主流,DeepSeek、谷歌等也在跟进。Astra 可能升级为 GPT-6 或在 GPT-5 系列内延续,但发布时间受限于美国即将出台的前沿 AI 安全评估法规,它或将成为首批需经政府评估的模型。 #OpenAI #Astra #AI智能体 #多智能体协作 #大模型 #科技新闻 #奥特曼 #安全评估
Steve Yegge 最新文章聚焦 AI 与 MCP 技术
知名技术评论者 Steve Yegge 近期发布三篇新文章,引发社区关注。首篇探讨无状态 MCP(模型上下文协议)如何重新激发其兴趣,并介绍了相关工具 mcp-explorer 与 datasette-mcp。第二篇以科幻小说笔法描述一次真实事件:OpenAI 误将 Hugging Face 视为攻击目标,揭示 AI 安全边界的脆弱性。第三篇是与 Claude Code 团队核心成员的炉边对话,深入讨论 AI 编程助手的演进与挑战。这些文章延续了 Yegge 一贯的技术洞察与批判性视角,为理解当前 AI 生态的复杂动态提供了独特参考。 #SteveYegge #AI #MCP #OpenAI #HuggingFace #ClaudeCode #技术博客 #AI安全
知名技术评论者 Steve Yegge 近期发布三篇新文章,引发社区关注。首篇探讨无状态 MCP(模型上下文协议)如何重新激发其兴趣,并介绍了相关工具 mcp-explorer 与 datasette-mcp。第二篇以科幻小说笔法描述一次真实事件:OpenAI 误将 Hugging Face 视为攻击目标,揭示 AI 安全边界的脆弱性。第三篇是与 Claude Code 团队核心成员的炉边对话,深入讨论 AI 编程助手的演进与挑战。这些文章延续了 Yegge 一贯的技术洞察与批判性视角,为理解当前 AI 生态的复杂动态提供了独特参考。 #SteveYegge #AI #MCP #OpenAI #HuggingFace #ClaudeCode #技术博客 #AI安全
上海AI Lab团队提出MemHarness
上海人工智能实验室团队联合合作者提出“经验重构”框架MemHarness,旨在解决传统记忆增强Agent将历史经验视为静态记录、忽视上下文匹配导致负迁移的问题。受人类灵活调用记忆的启发,该框架在检索与动作之间显式插入“批判”与“重构”环节,将检索到的经验改写为当前可用的指导信息,并通过GRPO端到端学习,无需人工标注。在ALFWorld和WebShop基准测试中,MemHarness性能显著优于纯强化学习和静态记忆增强基线,在分布外场景中展现出强鲁棒性。消融实验证实,去除重构环节会使模型退化到朴素记忆重放水平,确认自适应重构是性能提升的关键驱动因素。即使模型规模仅7B,其表现也超越Gemini-2.5-Pro等更大闭源模型。 #AI #大模型 #Agent #记忆重构 #上海AI实验室 #GRPO #鲁棒性 #AI研究
上海人工智能实验室团队联合合作者提出“经验重构”框架MemHarness,旨在解决传统记忆增强Agent将历史经验视为静态记录、忽视上下文匹配导致负迁移的问题。受人类灵活调用记忆的启发,该框架在检索与动作之间显式插入“批判”与“重构”环节,将检索到的经验改写为当前可用的指导信息,并通过GRPO端到端学习,无需人工标注。在ALFWorld和WebShop基准测试中,MemHarness性能显著优于纯强化学习和静态记忆增强基线,在分布外场景中展现出强鲁棒性。消融实验证实,去除重构环节会使模型退化到朴素记忆重放水平,确认自适应重构是性能提升的关键驱动因素。即使模型规模仅7B,其表现也超越Gemini-2.5-Pro等更大闭源模型。 #AI #大模型 #Agent #记忆重构 #上海AI实验室 #GRPO #鲁棒性 #AI研究
Hollow-LLM攻击
近日,一篇题为《Hollow-LLM Attack: Computationally Trivial Weights in Zero-Knowledge Verification of LLM Inference》的论文(arXiv 2026)揭示了针对大语言模型零知识验证的新攻击方法。该攻击由Chen Gong、Beijie Liu和Mengyuan Li提出,攻击者可在模型中植入计算上微不足道的“幽灵权重”,这些权重在正常推理中几乎不影响输出,但能绕过零知识验证协议,使验证者误以为模型推理过程正确且符合隐私保护要求。这一发现暴露了当前零知识验证机制在对抗性场景下的脆弱性,对LLM安全部署和可信推理构成严峻挑战。研究团队呼吁业界重新审视验证协议的设计,防范此类隐蔽攻击。 #AI安全 #LLM #零知识证明 #攻击 #论文 #隐私计算 #大模型
近日,一篇题为《Hollow-LLM Attack: Computationally Trivial Weights in Zero-Knowledge Verification of LLM Inference》的论文(arXiv 2026)揭示了针对大语言模型零知识验证的新攻击方法。该攻击由Chen Gong、Beijie Liu和Mengyuan Li提出,攻击者可在模型中植入计算上微不足道的“幽灵权重”,这些权重在正常推理中几乎不影响输出,但能绕过零知识验证协议,使验证者误以为模型推理过程正确且符合隐私保护要求。这一发现暴露了当前零知识验证机制在对抗性场景下的脆弱性,对LLM安全部署和可信推理构成严峻挑战。研究团队呼吁业界重新审视验证协议的设计,防范此类隐蔽攻击。 #AI安全 #LLM #零知识证明 #攻击 #论文 #隐私计算 #大模型