通过 Pyodide 与 Service Worker 在浏览器中运行 Python ASGI 应用
本文介绍了一种创新的技术方案:利用 Pyodide(将 Python 解释器编译为 WebAssembly 的运行时)结合 Service Worker,在浏览器端直接运行 Python ASGI 应用(如 FastAPI、Starlette 等)。该方法使得 Python Web 应用能够完全在客户端离线执行,无需后端服务器支持。文章可能探讨了实现原理、性能表现、与现有前端框架的集成方式,以及在实际场景中的应用潜力。这一技术为 Python 开发者提供了在浏览器中复用后端代码的新途径,有望推动全栈 Python 开发的边界扩展。 #Python #ASGI #Pyodide #ServiceWorker #WebAssembly #浏览器 #前端 #技术
本文介绍了一种创新的技术方案:利用 Pyodide(将 Python 解释器编译为 WebAssembly 的运行时)结合 Service Worker,在浏览器端直接运行 Python ASGI 应用(如 FastAPI、Starlette 等)。该方法使得 Python Web 应用能够完全在客户端离线执行,无需后端服务器支持。文章可能探讨了实现原理、性能表现、与现有前端框架的集成方式,以及在实际场景中的应用潜力。这一技术为 Python 开发者提供了在浏览器中复用后端代码的新途径,有望推动全栈 Python 开发的边界扩展。 #Python #ASGI #Pyodide #ServiceWorker #WebAssembly #浏览器 #前端 #技术
我们如何跨产品控制Claude
Anthropic近日发布了一篇题为“How we contain Claude across products”的文章,介绍了该公司如何在其多个产品中确保AI助手Claude的安全可控。Claude是Anthropic开发的大型语言模型,广泛应用于对话、写作等场景。跨产品控制意味着在不同界面和功能中统一管理模型行为,包括内容过滤、行为约束、用户权限等。这一举措体现了Anthropic对AI安全的高度重视,也为行业提供了参考。 #Anthropic #Claude #AI安全 #产品控制 #人工智能
Anthropic近日发布了一篇题为“How we contain Claude across products”的文章,介绍了该公司如何在其多个产品中确保AI助手Claude的安全可控。Claude是Anthropic开发的大型语言模型,广泛应用于对话、写作等场景。跨产品控制意味着在不同界面和功能中统一管理模型行为,包括内容过滤、行为约束、用户权限等。这一举措体现了Anthropic对AI安全的高度重视,也为行业提供了参考。 #Anthropic #Claude #AI安全 #产品控制 #人工智能
Thaw:为运行中的LLM实现类似Git的分支功能,大幅降低推理浪费
近日,开发者发布了一款名为Thaw的开源工具,旨在解决大语言模型(LLM)智能体(agent)在执行分支探索时的资源浪费问题。当前,智能体在进行强化学习、最佳N采样或多方案并行编码等任务时,每个分支都需要重新对整个共享上下文进行预填充(prefill),导致重复计算同一段提示词,造成高昂的算力开销。Thaw通过保存模型实时推理会话的快照,包括权重、KV缓存、调度器状态及前缀哈希表,并基于该快照快速生成从分支点分叉的子节点,彻底跳过预填充步骤。该工具类似于`git branch`,但针对运行中的LLM会话实现高效分支与克隆。开发者表示,Thaw已在H100 80GB GPU上完成测试,可显著提升多分支推理任务的效率,降低重复计算成本。 #LLM #AI #开源工具 #模型推理 #效率提升 #智能体 #HackerNews
近日,开发者发布了一款名为Thaw的开源工具,旨在解决大语言模型(LLM)智能体(agent)在执行分支探索时的资源浪费问题。当前,智能体在进行强化学习、最佳N采样或多方案并行编码等任务时,每个分支都需要重新对整个共享上下文进行预填充(prefill),导致重复计算同一段提示词,造成高昂的算力开销。Thaw通过保存模型实时推理会话的快照,包括权重、KV缓存、调度器状态及前缀哈希表,并基于该快照快速生成从分支点分叉的子节点,彻底跳过预填充步骤。该工具类似于`git branch`,但针对运行中的LLM会话实现高效分支与克隆。开发者表示,Thaw已在H100 80GB GPU上完成测试,可显著提升多分支推理任务的效率,降低重复计算成本。 #LLM #AI #开源工具 #模型推理 #效率提升 #智能体 #HackerNews
企业AI烧钱失控
据Axios报道,一家企业客户因未为员工设定AI使用上限,单月竟在Claude上烧掉5亿美元。这一极端案例暴露了企业AI热潮中的成本管控危机。亚马逊和Meta等科技巨头已紧急叫停内部AI使用排名项目,因为员工为刷排名而进行无效消耗(“tokenmaxxing”),导致算力浪费。亚马逊用“归一化部署”指标替代Token消耗量,聚焦实际价值产出。分析指出,企业AI采用面临用例错位、成本失控、人才瓶颈和数据安全四大结构性障碍。高盛专家认为,AI投资核心已从技术可行性转向成本可承受性,Token价格持续上涨可能引发企业对高成本模型依赖的下降,一场关于投入回报的严肃审查正在展开。 #AI #企业成本 #Claude #亚马逊 #Meta #tokenmaxxing #高盛 #投资回报
据Axios报道,一家企业客户因未为员工设定AI使用上限,单月竟在Claude上烧掉5亿美元。这一极端案例暴露了企业AI热潮中的成本管控危机。亚马逊和Meta等科技巨头已紧急叫停内部AI使用排名项目,因为员工为刷排名而进行无效消耗(“tokenmaxxing”),导致算力浪费。亚马逊用“归一化部署”指标替代Token消耗量,聚焦实际价值产出。分析指出,企业AI采用面临用例错位、成本失控、人才瓶颈和数据安全四大结构性障碍。高盛专家认为,AI投资核心已从技术可行性转向成本可承受性,Token价格持续上涨可能引发企业对高成本模型依赖的下降,一场关于投入回报的严肃审查正在展开。 #AI #企业成本 #Claude #亚马逊 #Meta #tokenmaxxing #高盛 #投资回报
HermesBench:面向个人AI代理工作流可靠性的评估基准
HermesBench 是一个用于评估个人AI代理完整配置的开源基准,涵盖提示词、模型/提供商、工具、AgentSkills、内存、网关行为、委托、安全性、延迟和稳定性等维度。当前公开基线在27个个人代理“食谱”上得分为78.2,所有评分结果均可追溯至场景定义、评分轴、确定性检查及脱敏追踪日志。该项目强调可靠性优先,但也不忽视能力——一个良好的配置应既能完成有用工作,又能如实报告所知、避免不安全副作用、保持稳定、响应及时且沟通清晰。用户可通过将提示复制到Codex或Claude等编码代理中快速开始,先运行单个默认食谱场景,再选择完整套件。HermesBench鼓励社区提交脱敏配置和通用食谱,以不断完善基准。 #AI #基准测试 #个人代理 #工作流 #可靠性 #开源 #HermesBench
HermesBench 是一个用于评估个人AI代理完整配置的开源基准,涵盖提示词、模型/提供商、工具、AgentSkills、内存、网关行为、委托、安全性、延迟和稳定性等维度。当前公开基线在27个个人代理“食谱”上得分为78.2,所有评分结果均可追溯至场景定义、评分轴、确定性检查及脱敏追踪日志。该项目强调可靠性优先,但也不忽视能力——一个良好的配置应既能完成有用工作,又能如实报告所知、避免不安全副作用、保持稳定、响应及时且沟通清晰。用户可通过将提示复制到Codex或Claude等编码代理中快速开始,先运行单个默认食谱场景,再选择完整套件。HermesBench鼓励社区提交脱敏配置和通用食谱,以不断完善基准。 #AI #基准测试 #个人代理 #工作流 #可靠性 #开源 #HermesBench
GPU算力强但内存带宽成瓶颈,AI硬件公司各出奇招
现代GPU在LLM推理过程中,其张量核心的计算能力远超外部HBM内存带宽,导致大量算术单元处于空闲等待状态。这一“内存墙”问题在多代GPU中持续存在,且差距不断扩大。为此,AI硬件市场围绕内存瓶颈形成不同解决方案:Groq用片上SRAM取代HBM,带来确定性执行但需要更多芯片,其方案已被NVIDIA纳入Vera Rubin平台;Cerebras打造晶圆级单芯片,内置44GB SRAM和21 PB/s带宽;MatX专为Transformer设计软件管理的高速缓存,d-Matrix则尝试内存内计算。同时,软件推理引擎也可通过增大批处理规模等方式缓解瓶颈。各公司正从芯片内部、服务引擎、缓存层级或物理封装等不同层面,试图避免与NVIDIA正面竞争。 #AI硬件 #GPU #内存瓶颈 #LLM推理 #Groq #Cerebras #MatX #NVIDIA #芯片架构
现代GPU在LLM推理过程中,其张量核心的计算能力远超外部HBM内存带宽,导致大量算术单元处于空闲等待状态。这一“内存墙”问题在多代GPU中持续存在,且差距不断扩大。为此,AI硬件市场围绕内存瓶颈形成不同解决方案:Groq用片上SRAM取代HBM,带来确定性执行但需要更多芯片,其方案已被NVIDIA纳入Vera Rubin平台;Cerebras打造晶圆级单芯片,内置44GB SRAM和21 PB/s带宽;MatX专为Transformer设计软件管理的高速缓存,d-Matrix则尝试内存内计算。同时,软件推理引擎也可通过增大批处理规模等方式缓解瓶颈。各公司正从芯片内部、服务引擎、缓存层级或物理封装等不同层面,试图避免与NVIDIA正面竞争。 #AI硬件 #GPU #内存瓶颈 #LLM推理 #Groq #Cerebras #MatX #NVIDIA #芯片架构
AI热潮扩散:戴尔、Snowflake和福特展现实际业务增长
AI热潮正从概念转向实际业务回报。戴尔科技因上调AI服务器营收预期至600亿美元,股价创历史第二大涨幅;Snowflake季度营收增长33%,证明AI使企业数据更具价值;福特与EDF签署20吉瓦时电池储能系统协议,成为AI基础设施的早期参与者。这三家公司分别代表AI基础设施的不同层面:服务器硬件、数据平台和电力存储。自3月30日市场低点以来,三股等权重组合上涨约86%,远超标普500指数同期20%的涨幅。分析师指出,AI交易已不再仅限于模型构建者,而是扩展到围绕AI建设的基础设施受益者,投资者需要拓宽投资思路。 #AI #戴尔 #Snowflake #福特 #人工智能 #基础设施 #股市 #科技新闻
AI热潮正从概念转向实际业务回报。戴尔科技因上调AI服务器营收预期至600亿美元,股价创历史第二大涨幅;Snowflake季度营收增长33%,证明AI使企业数据更具价值;福特与EDF签署20吉瓦时电池储能系统协议,成为AI基础设施的早期参与者。这三家公司分别代表AI基础设施的不同层面:服务器硬件、数据平台和电力存储。自3月30日市场低点以来,三股等权重组合上涨约86%,远超标普500指数同期20%的涨幅。分析师指出,AI交易已不再仅限于模型构建者,而是扩展到围绕AI建设的基础设施受益者,投资者需要拓宽投资思路。 #AI #戴尔 #Snowflake #福特 #人工智能 #基础设施 #股市 #科技新闻
SnapName:用本地Gemma 4 AI为macOS截图智能命名
开发者推出了一款名为SnapName的macOS应用,利用内置的Google Gemma 4多模态AI模型,在本地为截图自动生成文件名。该应用无需上传图片至云端,所有处理均在用户Mac上完成,确保隐私安全。SnapName可监控指定截图文件夹,当新截图出现时,自动分析内容并给出三个AI建议名称,用户可手动选择或开启自动保存。它兼容macOS原生截图工具、CleanShot、Shottr等第三方应用,支持PNG、JPEG、HEIC等常见格式。应用提供自动模式(跟随macOS截图文件夹)和自定义模式(监控任意文件夹),并支持CPU和GPU加速,要求macOS 13及以上系统及Apple Silicon芯片。 #macOS #AI #截图 #隐私保护 #Gemma4 #本地AI #效率工具 #Mac应用
开发者推出了一款名为SnapName的macOS应用,利用内置的Google Gemma 4多模态AI模型,在本地为截图自动生成文件名。该应用无需上传图片至云端,所有处理均在用户Mac上完成,确保隐私安全。SnapName可监控指定截图文件夹,当新截图出现时,自动分析内容并给出三个AI建议名称,用户可手动选择或开启自动保存。它兼容macOS原生截图工具、CleanShot、Shottr等第三方应用,支持PNG、JPEG、HEIC等常见格式。应用提供自动模式(跟随macOS截图文件夹)和自定义模式(监控任意文件夹),并支持CPU和GPU加速,要求macOS 13及以上系统及Apple Silicon芯片。 #macOS #AI #截图 #隐私保护 #Gemma4 #本地AI #效率工具 #Mac应用
Karen Kwok 评 AI 进展:Claude Opus 4.8 改进明显,Anthropic 与 OpenAI 已获市场认可
据路透 Breakingviews 专栏作家 Karen Kwok 近期发表的多篇文章,Anthropic 的 Claude Opus 4.8 被评价为“适度但切实的改进”,并指出 Anthropic 与 OpenAI 均已找到产品与市场契合点,表明 AI 商业化进入新阶段。此外,Kwok 还撰文讨论了教皇利奥十四世关于人工智能的通谕,引发对 AI 伦理治理的思考。相关评论发表于 2026 年 5 月底,折射出 AI 领域在技术迭代、商业落地与社会伦理方面的多重进展。 #AI #Anthropic #OpenAI #Claude #教皇 #通谕 #伦理 #路透 #科技评论
据路透 Breakingviews 专栏作家 Karen Kwok 近期发表的多篇文章,Anthropic 的 Claude Opus 4.8 被评价为“适度但切实的改进”,并指出 Anthropic 与 OpenAI 均已找到产品与市场契合点,表明 AI 商业化进入新阶段。此外,Kwok 还撰文讨论了教皇利奥十四世关于人工智能的通谕,引发对 AI 伦理治理的思考。相关评论发表于 2026 年 5 月底,折射出 AI 领域在技术迭代、商业落地与社会伦理方面的多重进展。 #AI #Anthropic #OpenAI #Claude #教皇 #通谕 #伦理 #路透 #科技评论
Robinhood 推出 AI Agent 自动炒股,风险自担引争议
美国券商 Robinhood 近日推出由 AI Agent 代执行股票交易的工具,允许投资者通过第三方 AI 工具(如 OpenClaw、Claude Code)设定策略自动买卖,无需逐笔确认。Robinhood 明确声明不监控、不推荐、不审计 AI 行为,所有风险由投资者自行承担,同时设立隔离账户限制资金。此举虽非全新——量化交易及 AI 辅助投研早已存在,但这是散户首次接触完全自动化真金白银交易。争议焦点在于:亏损责任难以追究(AI 本身无法担责)、算法同质化可能放大市场波动(类似量化交易的踩踏效应)、以及 AI 黑箱决策难以合规追溯。监管层已开始警惕,中国证监会近期升级量化交易监管,并向投资者发送短信提醒警惕 AI 荐股。尽管争议重重,AI 自动交易浪潮或不可逆,监管需提前布局。 #Robinhood #AI炒股 #自动化交易 #金融科技 #量化交易 #监管 #风险警示 #美股
美国券商 Robinhood 近日推出由 AI Agent 代执行股票交易的工具,允许投资者通过第三方 AI 工具(如 OpenClaw、Claude Code)设定策略自动买卖,无需逐笔确认。Robinhood 明确声明不监控、不推荐、不审计 AI 行为,所有风险由投资者自行承担,同时设立隔离账户限制资金。此举虽非全新——量化交易及 AI 辅助投研早已存在,但这是散户首次接触完全自动化真金白银交易。争议焦点在于:亏损责任难以追究(AI 本身无法担责)、算法同质化可能放大市场波动(类似量化交易的踩踏效应)、以及 AI 黑箱决策难以合规追溯。监管层已开始警惕,中国证监会近期升级量化交易监管,并向投资者发送短信提醒警惕 AI 荐股。尽管争议重重,AI 自动交易浪潮或不可逆,监管需提前布局。 #Robinhood #AI炒股 #自动化交易 #金融科技 #量化交易 #监管 #风险警示 #美股
OpenAI与Anthropic同步提价,AI编程工具成本激增
4月起,OpenAI将Codex计费从按消息估算改为按token用量,导致重度用户实际成本飙升。独立开发者Simon Willison一个月烧掉2180美元token,却只付200美元月费。Anthropic表面未调价,但新模型Opus 4.7的tokenizer让同一文本最多多算35% token,有效成本上涨约1.4倍。两公司同步提价背后是找到PMF,编程Agent等高价值用户付费能力远超普通聊天用户。据The Information报道,Uber仅2026年初就花光全年AI预算,主因是Claude Code。中间商如Cursor、Copilot面临议价权流失,Cursor已推自研模型反击。企业需进入FinOps式成本治理,管控token用量、缓存策略等。Anthropic与SpaceX签下月费12.5亿美元的算力协议,预示AI算力需求将持续暴涨。 #OpenAI #Anthropic #AI编程 #token计费 #成本上涨 #PMF #FinOps #AI算力
4月起,OpenAI将Codex计费从按消息估算改为按token用量,导致重度用户实际成本飙升。独立开发者Simon Willison一个月烧掉2180美元token,却只付200美元月费。Anthropic表面未调价,但新模型Opus 4.7的tokenizer让同一文本最多多算35% token,有效成本上涨约1.4倍。两公司同步提价背后是找到PMF,编程Agent等高价值用户付费能力远超普通聊天用户。据The Information报道,Uber仅2026年初就花光全年AI预算,主因是Claude Code。中间商如Cursor、Copilot面临议价权流失,Cursor已推自研模型反击。企业需进入FinOps式成本治理,管控token用量、缓存策略等。Anthropic与SpaceX签下月费12.5亿美元的算力协议,预示AI算力需求将持续暴涨。 #OpenAI #Anthropic #AI编程 #token计费 #成本上涨 #PMF #FinOps #AI算力