AI模型通过肿瘤突变预测治疗反应
加州大学圣地亚哥分校的研究团队开发了一款名为MutationProjector的人工智能模型,能够将肿瘤复杂的基因图谱转化为对治疗反应的预测。该模型基于超过3万份肿瘤基因组数据训练,涵盖10种实体癌类型,通过分析肿瘤中多种基因变异的组合,生成肿瘤生物状态的紧凑表征,从而揭示哪些分子通路可能被破坏,进而判断哪些疗法最有效。研究发表在《癌症发现》期刊上,团队在膀胱癌、肺癌和黑色素瘤等多个独立患者队列中验证,该模型在预测免疫疗法和化疗反应方面达到或超越了现有方法,并识别出已知和未知的生物标志物。目前仅约8%的病例能基于基因检测匹配到FDA批准的疗法,而MutationProjector有望使肿瘤DNA检测更具临床可操作性,帮助医生更精准地制定治疗方案。 #AI #肿瘤 #基因突变 #治疗预测 #癌症研究 #机器学习 #精准医疗 #生物标志物
加州大学圣地亚哥分校的研究团队开发了一款名为MutationProjector的人工智能模型,能够将肿瘤复杂的基因图谱转化为对治疗反应的预测。该模型基于超过3万份肿瘤基因组数据训练,涵盖10种实体癌类型,通过分析肿瘤中多种基因变异的组合,生成肿瘤生物状态的紧凑表征,从而揭示哪些分子通路可能被破坏,进而判断哪些疗法最有效。研究发表在《癌症发现》期刊上,团队在膀胱癌、肺癌和黑色素瘤等多个独立患者队列中验证,该模型在预测免疫疗法和化疗反应方面达到或超越了现有方法,并识别出已知和未知的生物标志物。目前仅约8%的病例能基于基因检测匹配到FDA批准的疗法,而MutationProjector有望使肿瘤DNA检测更具临床可操作性,帮助医生更精准地制定治疗方案。 #AI #肿瘤 #基因突变 #治疗预测 #癌症研究 #机器学习 #精准医疗 #生物标志物
Google AI 搜索再出低级错误
据科技媒体报道,Google 的 AI 搜索功能再次暴露出令人啼笑皆非的缺陷。尽管该公司在今年的 I/O 大会上大力推广“AI 驱动的交互式体验”,并投入数十亿美元研发,但用户发现,当询问“一周中有几天包含‘鱼’字”这一简单问题时,AI 每次都会给出不同的荒谬答案。只有一次回答正确(没有一天包含“fish”),但其他时候,它声称“Saturday”包含“fish”(实际是“Saturfish”),或认为“Thursday”与“thirst-day”有关,甚至引用俄罗斯的“鱼日”政策。此前,Google AI 还曾因无法处理“disregard”一词而陷入死循环。这些错误表明,AI 并非真正理解语义,而只是强大的模式匹配机器,其“最佳猜测”往往偏离常识。 #Google #AI搜索 #人工智能 #Bug #科技新闻 #算法缺陷 #模式匹配
据科技媒体报道,Google 的 AI 搜索功能再次暴露出令人啼笑皆非的缺陷。尽管该公司在今年的 I/O 大会上大力推广“AI 驱动的交互式体验”,并投入数十亿美元研发,但用户发现,当询问“一周中有几天包含‘鱼’字”这一简单问题时,AI 每次都会给出不同的荒谬答案。只有一次回答正确(没有一天包含“fish”),但其他时候,它声称“Saturday”包含“fish”(实际是“Saturfish”),或认为“Thursday”与“thirst-day”有关,甚至引用俄罗斯的“鱼日”政策。此前,Google AI 还曾因无法处理“disregard”一词而陷入死循环。这些错误表明,AI 并非真正理解语义,而只是强大的模式匹配机器,其“最佳猜测”往往偏离常识。 #Google #AI搜索 #人工智能 #Bug #科技新闻 #算法缺陷 #模式匹配
AI生成买家测试产品,准确率高达90%
随着企业对产品和服务性能的持续洞察需求超出传统研究方法的极限,AI生成的合成顾客——即基于真实客户数据构建的数字孪生或细分人群画像——正成为市场研究的新利器。这些合成代理可模拟人类行为、偏好和决策,帮助企业在真实测试前快速迭代、验证创意。例如,美国银行利用合成受众测试高净值家庭对金融话题的反应,塔吉特则用其模拟消费者对产品和促销的反馈。然而,传统调查面临欺诈增多、参与度波动、B2B样本稀缺等问题。最新研究表明,结合企业专有数据的大语言模型能显著提升合成顾客的准确性。一家领先消费科技公司的回测显示,基于历史数据的数字孪生可复制约90%的关键研究结果,包括特征重要性、价格敏感度等,为市场领导者提供更快、更经济的洞察循环。 #AI #合成顾客 #产品测试 #市场研究 #数字孪生 #大模型 #定量洞察 #创新方法
随着企业对产品和服务性能的持续洞察需求超出传统研究方法的极限,AI生成的合成顾客——即基于真实客户数据构建的数字孪生或细分人群画像——正成为市场研究的新利器。这些合成代理可模拟人类行为、偏好和决策,帮助企业在真实测试前快速迭代、验证创意。例如,美国银行利用合成受众测试高净值家庭对金融话题的反应,塔吉特则用其模拟消费者对产品和促销的反馈。然而,传统调查面临欺诈增多、参与度波动、B2B样本稀缺等问题。最新研究表明,结合企业专有数据的大语言模型能显著提升合成顾客的准确性。一家领先消费科技公司的回测显示,基于历史数据的数字孪生可复制约90%的关键研究结果,包括特征重要性、价格敏感度等,为市场领导者提供更快、更经济的洞察循环。 #AI #合成顾客 #产品测试 #市场研究 #数字孪生 #大模型 #定量洞察 #创新方法
通过 Pyodide 与 Service Worker 在浏览器中运行 Python ASGI 应用
本文介绍了一种创新的技术方案:利用 Pyodide(将 Python 解释器编译为 WebAssembly 的运行时)结合 Service Worker,在浏览器端直接运行 Python ASGI 应用(如 FastAPI、Starlette 等)。该方法使得 Python Web 应用能够完全在客户端离线执行,无需后端服务器支持。文章可能探讨了实现原理、性能表现、与现有前端框架的集成方式,以及在实际场景中的应用潜力。这一技术为 Python 开发者提供了在浏览器中复用后端代码的新途径,有望推动全栈 Python 开发的边界扩展。 #Python #ASGI #Pyodide #ServiceWorker #WebAssembly #浏览器 #前端 #技术
本文介绍了一种创新的技术方案:利用 Pyodide(将 Python 解释器编译为 WebAssembly 的运行时)结合 Service Worker,在浏览器端直接运行 Python ASGI 应用(如 FastAPI、Starlette 等)。该方法使得 Python Web 应用能够完全在客户端离线执行,无需后端服务器支持。文章可能探讨了实现原理、性能表现、与现有前端框架的集成方式,以及在实际场景中的应用潜力。这一技术为 Python 开发者提供了在浏览器中复用后端代码的新途径,有望推动全栈 Python 开发的边界扩展。 #Python #ASGI #Pyodide #ServiceWorker #WebAssembly #浏览器 #前端 #技术
我们如何跨产品控制Claude
Anthropic近日发布了一篇题为“How we contain Claude across products”的文章,介绍了该公司如何在其多个产品中确保AI助手Claude的安全可控。Claude是Anthropic开发的大型语言模型,广泛应用于对话、写作等场景。跨产品控制意味着在不同界面和功能中统一管理模型行为,包括内容过滤、行为约束、用户权限等。这一举措体现了Anthropic对AI安全的高度重视,也为行业提供了参考。 #Anthropic #Claude #AI安全 #产品控制 #人工智能
Anthropic近日发布了一篇题为“How we contain Claude across products”的文章,介绍了该公司如何在其多个产品中确保AI助手Claude的安全可控。Claude是Anthropic开发的大型语言模型,广泛应用于对话、写作等场景。跨产品控制意味着在不同界面和功能中统一管理模型行为,包括内容过滤、行为约束、用户权限等。这一举措体现了Anthropic对AI安全的高度重视,也为行业提供了参考。 #Anthropic #Claude #AI安全 #产品控制 #人工智能
Thaw:为运行中的LLM实现类似Git的分支功能,大幅降低推理浪费
近日,开发者发布了一款名为Thaw的开源工具,旨在解决大语言模型(LLM)智能体(agent)在执行分支探索时的资源浪费问题。当前,智能体在进行强化学习、最佳N采样或多方案并行编码等任务时,每个分支都需要重新对整个共享上下文进行预填充(prefill),导致重复计算同一段提示词,造成高昂的算力开销。Thaw通过保存模型实时推理会话的快照,包括权重、KV缓存、调度器状态及前缀哈希表,并基于该快照快速生成从分支点分叉的子节点,彻底跳过预填充步骤。该工具类似于`git branch`,但针对运行中的LLM会话实现高效分支与克隆。开发者表示,Thaw已在H100 80GB GPU上完成测试,可显著提升多分支推理任务的效率,降低重复计算成本。 #LLM #AI #开源工具 #模型推理 #效率提升 #智能体 #HackerNews
近日,开发者发布了一款名为Thaw的开源工具,旨在解决大语言模型(LLM)智能体(agent)在执行分支探索时的资源浪费问题。当前,智能体在进行强化学习、最佳N采样或多方案并行编码等任务时,每个分支都需要重新对整个共享上下文进行预填充(prefill),导致重复计算同一段提示词,造成高昂的算力开销。Thaw通过保存模型实时推理会话的快照,包括权重、KV缓存、调度器状态及前缀哈希表,并基于该快照快速生成从分支点分叉的子节点,彻底跳过预填充步骤。该工具类似于`git branch`,但针对运行中的LLM会话实现高效分支与克隆。开发者表示,Thaw已在H100 80GB GPU上完成测试,可显著提升多分支推理任务的效率,降低重复计算成本。 #LLM #AI #开源工具 #模型推理 #效率提升 #智能体 #HackerNews
企业AI烧钱失控
据Axios报道,一家企业客户因未为员工设定AI使用上限,单月竟在Claude上烧掉5亿美元。这一极端案例暴露了企业AI热潮中的成本管控危机。亚马逊和Meta等科技巨头已紧急叫停内部AI使用排名项目,因为员工为刷排名而进行无效消耗(“tokenmaxxing”),导致算力浪费。亚马逊用“归一化部署”指标替代Token消耗量,聚焦实际价值产出。分析指出,企业AI采用面临用例错位、成本失控、人才瓶颈和数据安全四大结构性障碍。高盛专家认为,AI投资核心已从技术可行性转向成本可承受性,Token价格持续上涨可能引发企业对高成本模型依赖的下降,一场关于投入回报的严肃审查正在展开。 #AI #企业成本 #Claude #亚马逊 #Meta #tokenmaxxing #高盛 #投资回报
据Axios报道,一家企业客户因未为员工设定AI使用上限,单月竟在Claude上烧掉5亿美元。这一极端案例暴露了企业AI热潮中的成本管控危机。亚马逊和Meta等科技巨头已紧急叫停内部AI使用排名项目,因为员工为刷排名而进行无效消耗(“tokenmaxxing”),导致算力浪费。亚马逊用“归一化部署”指标替代Token消耗量,聚焦实际价值产出。分析指出,企业AI采用面临用例错位、成本失控、人才瓶颈和数据安全四大结构性障碍。高盛专家认为,AI投资核心已从技术可行性转向成本可承受性,Token价格持续上涨可能引发企业对高成本模型依赖的下降,一场关于投入回报的严肃审查正在展开。 #AI #企业成本 #Claude #亚马逊 #Meta #tokenmaxxing #高盛 #投资回报
HermesBench:面向个人AI代理工作流可靠性的评估基准
HermesBench 是一个用于评估个人AI代理完整配置的开源基准,涵盖提示词、模型/提供商、工具、AgentSkills、内存、网关行为、委托、安全性、延迟和稳定性等维度。当前公开基线在27个个人代理“食谱”上得分为78.2,所有评分结果均可追溯至场景定义、评分轴、确定性检查及脱敏追踪日志。该项目强调可靠性优先,但也不忽视能力——一个良好的配置应既能完成有用工作,又能如实报告所知、避免不安全副作用、保持稳定、响应及时且沟通清晰。用户可通过将提示复制到Codex或Claude等编码代理中快速开始,先运行单个默认食谱场景,再选择完整套件。HermesBench鼓励社区提交脱敏配置和通用食谱,以不断完善基准。 #AI #基准测试 #个人代理 #工作流 #可靠性 #开源 #HermesBench
HermesBench 是一个用于评估个人AI代理完整配置的开源基准,涵盖提示词、模型/提供商、工具、AgentSkills、内存、网关行为、委托、安全性、延迟和稳定性等维度。当前公开基线在27个个人代理“食谱”上得分为78.2,所有评分结果均可追溯至场景定义、评分轴、确定性检查及脱敏追踪日志。该项目强调可靠性优先,但也不忽视能力——一个良好的配置应既能完成有用工作,又能如实报告所知、避免不安全副作用、保持稳定、响应及时且沟通清晰。用户可通过将提示复制到Codex或Claude等编码代理中快速开始,先运行单个默认食谱场景,再选择完整套件。HermesBench鼓励社区提交脱敏配置和通用食谱,以不断完善基准。 #AI #基准测试 #个人代理 #工作流 #可靠性 #开源 #HermesBench
GPU算力强但内存带宽成瓶颈,AI硬件公司各出奇招
现代GPU在LLM推理过程中,其张量核心的计算能力远超外部HBM内存带宽,导致大量算术单元处于空闲等待状态。这一“内存墙”问题在多代GPU中持续存在,且差距不断扩大。为此,AI硬件市场围绕内存瓶颈形成不同解决方案:Groq用片上SRAM取代HBM,带来确定性执行但需要更多芯片,其方案已被NVIDIA纳入Vera Rubin平台;Cerebras打造晶圆级单芯片,内置44GB SRAM和21 PB/s带宽;MatX专为Transformer设计软件管理的高速缓存,d-Matrix则尝试内存内计算。同时,软件推理引擎也可通过增大批处理规模等方式缓解瓶颈。各公司正从芯片内部、服务引擎、缓存层级或物理封装等不同层面,试图避免与NVIDIA正面竞争。 #AI硬件 #GPU #内存瓶颈 #LLM推理 #Groq #Cerebras #MatX #NVIDIA #芯片架构
现代GPU在LLM推理过程中,其张量核心的计算能力远超外部HBM内存带宽,导致大量算术单元处于空闲等待状态。这一“内存墙”问题在多代GPU中持续存在,且差距不断扩大。为此,AI硬件市场围绕内存瓶颈形成不同解决方案:Groq用片上SRAM取代HBM,带来确定性执行但需要更多芯片,其方案已被NVIDIA纳入Vera Rubin平台;Cerebras打造晶圆级单芯片,内置44GB SRAM和21 PB/s带宽;MatX专为Transformer设计软件管理的高速缓存,d-Matrix则尝试内存内计算。同时,软件推理引擎也可通过增大批处理规模等方式缓解瓶颈。各公司正从芯片内部、服务引擎、缓存层级或物理封装等不同层面,试图避免与NVIDIA正面竞争。 #AI硬件 #GPU #内存瓶颈 #LLM推理 #Groq #Cerebras #MatX #NVIDIA #芯片架构
AI热潮扩散:戴尔、Snowflake和福特展现实际业务增长
AI热潮正从概念转向实际业务回报。戴尔科技因上调AI服务器营收预期至600亿美元,股价创历史第二大涨幅;Snowflake季度营收增长33%,证明AI使企业数据更具价值;福特与EDF签署20吉瓦时电池储能系统协议,成为AI基础设施的早期参与者。这三家公司分别代表AI基础设施的不同层面:服务器硬件、数据平台和电力存储。自3月30日市场低点以来,三股等权重组合上涨约86%,远超标普500指数同期20%的涨幅。分析师指出,AI交易已不再仅限于模型构建者,而是扩展到围绕AI建设的基础设施受益者,投资者需要拓宽投资思路。 #AI #戴尔 #Snowflake #福特 #人工智能 #基础设施 #股市 #科技新闻
AI热潮正从概念转向实际业务回报。戴尔科技因上调AI服务器营收预期至600亿美元,股价创历史第二大涨幅;Snowflake季度营收增长33%,证明AI使企业数据更具价值;福特与EDF签署20吉瓦时电池储能系统协议,成为AI基础设施的早期参与者。这三家公司分别代表AI基础设施的不同层面:服务器硬件、数据平台和电力存储。自3月30日市场低点以来,三股等权重组合上涨约86%,远超标普500指数同期20%的涨幅。分析师指出,AI交易已不再仅限于模型构建者,而是扩展到围绕AI建设的基础设施受益者,投资者需要拓宽投资思路。 #AI #戴尔 #Snowflake #福特 #人工智能 #基础设施 #股市 #科技新闻