LLM 故事生成存在低多样性问题,新论文诊断原因
一项题为《Elias in the Lighthouse, Again? Diagnosing Low Diversity in LLM Stories》的研究指出,当前大语言模型在生成故事时存在显著的输出同质化问题。论文作者通过对大量模型生成文本的分析发现,LLM 倾向于频繁重复特定的叙事模式、角色设定和情节走向,例如总是出现“Elias in the Lighthouse”之类的雷同片段。研究从模型训练数据、解码策略和架构设计等多个角度诊断了低多样性产生的根源,认为过度依赖高频训练模式和固定概率采样是主要原因。该发现揭示了当前生成式 AI 在创意写作领域的根本局限,并为改进模型多样性提供了方向。 #LLM #大语言模型 #故事生成 #低多样性 #AI研究 #机器学习 #自然语言处理 #arXiv论文
一项题为《Elias in the Lighthouse, Again? Diagnosing Low Diversity in LLM Stories》的研究指出,当前大语言模型在生成故事时存在显著的输出同质化问题。论文作者通过对大量模型生成文本的分析发现,LLM 倾向于频繁重复特定的叙事模式、角色设定和情节走向,例如总是出现“Elias in the Lighthouse”之类的雷同片段。研究从模型训练数据、解码策略和架构设计等多个角度诊断了低多样性产生的根源,认为过度依赖高频训练模式和固定概率采样是主要原因。该发现揭示了当前生成式 AI 在创意写作领域的根本局限,并为改进模型多样性提供了方向。 #LLM #大语言模型 #故事生成 #低多样性 #AI研究 #机器学习 #自然语言处理 #arXiv论文
Apple 凭借默认体验赢得消费者 AI 之战
苹果在 WWDC 主题演讲中展示了其“Apple Intelligence”和全新 Siri AI 功能。尽管从纯 AI 角度看,这些功能并无突破性创新,许多能力早已在其他工具中出现,但苹果通过将其无缝集成到 iPhone 原有操作中,无需用户额外下载应用或学习复杂操作,大幅降低了使用门槛。演示中,用户只需按住侧边按钮即可自然对话式调用 Siri,完成此前无法实现的复杂任务。苹果还借助谷歌 Gemini 模型进行蒸馏,打造自有基础模型。业界分析认为,苹果正复制其惯用策略:后发制人,以极致用户体验赢取主流市场。尽管华尔街反应冷淡,但此举有望将 AI 从极客圈带入大众日常生活。 #苹果 #AppleIntelligence #Siri #AI #WWDC #消费电子 #用户体验 #科技新闻
苹果在 WWDC 主题演讲中展示了其“Apple Intelligence”和全新 Siri AI 功能。尽管从纯 AI 角度看,这些功能并无突破性创新,许多能力早已在其他工具中出现,但苹果通过将其无缝集成到 iPhone 原有操作中,无需用户额外下载应用或学习复杂操作,大幅降低了使用门槛。演示中,用户只需按住侧边按钮即可自然对话式调用 Siri,完成此前无法实现的复杂任务。苹果还借助谷歌 Gemini 模型进行蒸馏,打造自有基础模型。业界分析认为,苹果正复制其惯用策略:后发制人,以极致用户体验赢取主流市场。尽管华尔街反应冷淡,但此举有望将 AI 从极客圈带入大众日常生活。 #苹果 #AppleIntelligence #Siri #AI #WWDC #消费电子 #用户体验 #科技新闻
Datadog推出DODO系统:用生产数据训练AI优化代码,节省上万核CPU
AI驱动的代码优化面临基准测试与现实生产割裂的问题。若基准测试脱离实际负载,AI可能找到在合成数据上有效但在生产中无益的加速方案,甚至造成负面影响。为此,Datadog构建了基于生产遥测的DODO系统。该系统通过两大信号生成可信基准:一是Datadog持续分析器提供的CPU profile,二是实时调试器采集的真实生产调用样本。DODO利用样本生成初始Go微基准测试,并迭代调整直至其执行形态与生产profile相似度≥98%,确保优化效果能真实转化为生产环境收益。在Datadog一个关键服务上,三次优化即削减了超过8%的总CPU成本,相当于全天候节省约上万核资源。文章详细展示了如何从生产信号生成基准、以及该技术在大型服务中的应用经验。 #AI #代码优化 #基准测试 #Datadog #DODO #性能优化 #生产环境
AI驱动的代码优化面临基准测试与现实生产割裂的问题。若基准测试脱离实际负载,AI可能找到在合成数据上有效但在生产中无益的加速方案,甚至造成负面影响。为此,Datadog构建了基于生产遥测的DODO系统。该系统通过两大信号生成可信基准:一是Datadog持续分析器提供的CPU profile,二是实时调试器采集的真实生产调用样本。DODO利用样本生成初始Go微基准测试,并迭代调整直至其执行形态与生产profile相似度≥98%,确保优化效果能真实转化为生产环境收益。在Datadog一个关键服务上,三次优化即削减了超过8%的总CPU成本,相当于全天候节省约上万核资源。文章详细展示了如何从生产信号生成基准、以及该技术在大型服务中的应用经验。 #AI #代码优化 #基准测试 #Datadog #DODO #性能优化 #生产环境
TCS 主席称将用 AI 代理替代人类员工,大规模招聘将永久放缓
印度最大 IT 公司塔塔咨询服务公司(TCS)主席 N Chandrasekharan 在一次公开会议上表示,TCS 将积极用 AI 代理替代人类员工。他预测,未来三年内公司拥有的 AI 代理数量将与人类员工相当。虽然排除了裁员可能,但他确认传统的大规模 IT 招聘将永久放缓。这一表态引发行业对就业前景的担忧。数据显示,TCS 在 2026 财年净减少超过 2.3 万名员工,总员工数降至 58.45 万。作为印度就业市场的重要支柱,软件行业正面临 AI 替代人力的严峻挑战。 #TCS #AI #人工智能 #就业 #IT行业 #印度 #科技新闻 #劳动力替代
印度最大 IT 公司塔塔咨询服务公司(TCS)主席 N Chandrasekharan 在一次公开会议上表示,TCS 将积极用 AI 代理替代人类员工。他预测,未来三年内公司拥有的 AI 代理数量将与人类员工相当。虽然排除了裁员可能,但他确认传统的大规模 IT 招聘将永久放缓。这一表态引发行业对就业前景的担忧。数据显示,TCS 在 2026 财年净减少超过 2.3 万名员工,总员工数降至 58.45 万。作为印度就业市场的重要支柱,软件行业正面临 AI 替代人力的严峻挑战。 #TCS #AI #人工智能 #就业 #IT行业 #印度 #科技新闻 #劳动力替代
借助NVIDIA Isaac Lab和Amazon SageMaker AI扩展机器人强化学习
物理AI正从研究走向生产,机器人在高保真仿真中训练,再部署到工厂和仓库,因为现实训练慢、贵且不安全,而GPU加速仿真可将数月学习压缩至数小时。计算成为新挑战:复杂行为(如人形机器人在崎岖地形行走)的强化学习(RL)计算密集,单节点训练需数小时到数天。本文展示了如何在Amazon SageMaker AI上使用NVIDIA Isaac Lab训练Unitree H1人形机器人策略,提供SageMaker HyperPod和SageMaker Training Jobs两种选项。SageMaker AI减轻了基础设施管理负担,自动处理实例配置、驱动、网络、健康监控和资源回收。HyperPod专为大规模分布式训练设计,内置健康监控、自动故障恢复(从检查点重启)和自动恢复功能;通过Amazon EKS或Slurm编排,提供持久集群和可观测性仪表盘;支持Kueue任务治理,实现命名空间级计算配额、优先级和抢占,支持GPU分区(包括MIG)。此方案让工程团队专注于策略开发,而非基础设施运维。 #机器人 #强化学习 #NVIDIA #IsaacLab #AmazonSageMaker #AI #物理AI #分布式训练 #自动化运维
物理AI正从研究走向生产,机器人在高保真仿真中训练,再部署到工厂和仓库,因为现实训练慢、贵且不安全,而GPU加速仿真可将数月学习压缩至数小时。计算成为新挑战:复杂行为(如人形机器人在崎岖地形行走)的强化学习(RL)计算密集,单节点训练需数小时到数天。本文展示了如何在Amazon SageMaker AI上使用NVIDIA Isaac Lab训练Unitree H1人形机器人策略,提供SageMaker HyperPod和SageMaker Training Jobs两种选项。SageMaker AI减轻了基础设施管理负担,自动处理实例配置、驱动、网络、健康监控和资源回收。HyperPod专为大规模分布式训练设计,内置健康监控、自动故障恢复(从检查点重启)和自动恢复功能;通过Amazon EKS或Slurm编排,提供持久集群和可观测性仪表盘;支持Kueue任务治理,实现命名空间级计算配额、优先级和抢占,支持GPU分区(包括MIG)。此方案让工程团队专注于策略开发,而非基础设施运维。 #机器人 #强化学习 #NVIDIA #IsaacLab #AmazonSageMaker #AI #物理AI #分布式训练 #自动化运维
Google 的 "20% 时间" 如何演变为 AI 时代的 "120% 注意力"
二十年前,Google 推出 "20% 时间" 政策,允许工程师每周花一天时间从事自主项目,这一制度建立在信任与宽松环境之上。然而随着公司扩张至近二十万人以及绩效量化考核的强化,该政策逐渐名存实亡,工程师实际需要付出 120% 的时间才能完成本职工作与副业。如今,AI 代理的兴起让探索的承诺重新回归,但方式截然不同:过去用 "时间" 支付,现在则是用 "注意力" 支付。AI 可以在主任务运行时并行处理副业,但用户无法真正抽离注意力,导致所谓的 "20% 时间" 变成了 120% 的注意力透支。文章反思,这种新模式看似复活了创新精神,实则可能加剧精力消耗,核心问题在于:谁真正从中获益? #Google #20%时间 #AI #注意力经济 #副业 #科技文化 #创新 #工作伦理
二十年前,Google 推出 "20% 时间" 政策,允许工程师每周花一天时间从事自主项目,这一制度建立在信任与宽松环境之上。然而随着公司扩张至近二十万人以及绩效量化考核的强化,该政策逐渐名存实亡,工程师实际需要付出 120% 的时间才能完成本职工作与副业。如今,AI 代理的兴起让探索的承诺重新回归,但方式截然不同:过去用 "时间" 支付,现在则是用 "注意力" 支付。AI 可以在主任务运行时并行处理副业,但用户无法真正抽离注意力,导致所谓的 "20% 时间" 变成了 120% 的注意力透支。文章反思,这种新模式看似复活了创新精神,实则可能加剧精力消耗,核心问题在于:谁真正从中获益? #Google #20%时间 #AI #注意力经济 #副业 #科技文化 #创新 #工作伦理
微软AI负责人批评Anthropic暗示Claude具有意识
微软AI首席执行官Mustafa Suleyman近日在《Decoder》节目中表示,Anthropic在其AI模型Claude的“宪法”(即指导模型行为的指令集)中推测意识问题,是“极其危险”的做法。他认为,这种关于AI意识的猜测可能会让聊天机器人表现得仿佛具有自我意识,从而误导公众对AI能力的认知。Suleyman强调,业界必须谨慎对待AI意识相关讨论,避免引发不必要的伦理争议和公众误解。该言论引发了对AI模型行为规范和安全性的新一轮关注。 #微软 #Anthropic #Claude #AI意识 #人工智能 #科技新闻 #伦理 #模型行为 #安全
微软AI首席执行官Mustafa Suleyman近日在《Decoder》节目中表示,Anthropic在其AI模型Claude的“宪法”(即指导模型行为的指令集)中推测意识问题,是“极其危险”的做法。他认为,这种关于AI意识的猜测可能会让聊天机器人表现得仿佛具有自我意识,从而误导公众对AI能力的认知。Suleyman强调,业界必须谨慎对待AI意识相关讨论,避免引发不必要的伦理争议和公众误解。该言论引发了对AI模型行为规范和安全性的新一轮关注。 #微软 #Anthropic #Claude #AI意识 #人工智能 #科技新闻 #伦理 #模型行为 #安全
科大讯飞 6 月 10 日香港发布智能空间 Agentic 架构 SpaceMind
6 月 10 日,科大讯飞将在香港举办 2026 SpaceMind 全球发布会,正式推出智能空间 Agentic 架构——SpaceMind。该架构被定义为“空间 AI 大脑”,具备感知、理解、决策与执行能力,旨在让 AI 真正融入家庭、酒店、办公等真实场景。SpaceMind 不仅能被动响应用户指令,还能通过持续学习主动适应用户习惯,实现空间的智能化升级。此次发布标志着科大讯飞在人工智能与空间计算的交叉领域迈出关键一步,为未来智能生活场景的落地提供了新思路。 #科大讯飞 #SpaceMind #智能空间 #Agentic架构 #AI #智能家居 #空间计算 #科技新闻
6 月 10 日,科大讯飞将在香港举办 2026 SpaceMind 全球发布会,正式推出智能空间 Agentic 架构——SpaceMind。该架构被定义为“空间 AI 大脑”,具备感知、理解、决策与执行能力,旨在让 AI 真正融入家庭、酒店、办公等真实场景。SpaceMind 不仅能被动响应用户指令,还能通过持续学习主动适应用户习惯,实现空间的智能化升级。此次发布标志着科大讯飞在人工智能与空间计算的交叉领域迈出关键一步,为未来智能生活场景的落地提供了新思路。 #科大讯飞 #SpaceMind #智能空间 #Agentic架构 #AI #智能家居 #空间计算 #科技新闻