Google 发布 DiffusionGemma 模型,文本生成速度提升4倍
Google 今日推出实验性开源模型 DiffusionGemma,采用文本扩散技术实现非自回归生成。该模型基于Gemma 4架构,拥有260亿参数,采用混合专家(MoE)设计,可同时生成整个文本块,在专用GPU上推理速度提升高达4倍。与逐字生成的传统自回归大语言模型不同,DiffusionGemma通过并行处理256个token的段落,充分利用硬件算力,特别适合本地低并发场景下的实时交互应用,如内联编辑、快速迭代和非线性文本结构生成。模型采用Apache 2.0许可,支持微调以优化特定任务性能,例如解决数独问题。然而,在高并发云端部署中,其并行解码优势会减弱,可能导致服务成本上升。该模型为研究速度关键型本地工作流的开发者提供了新工具。 #Google #DiffusionGemma #文本生成 #AI #开源模型 #大模型 #科技新闻
Google 今日推出实验性开源模型 DiffusionGemma,采用文本扩散技术实现非自回归生成。该模型基于Gemma 4架构,拥有260亿参数,采用混合专家(MoE)设计,可同时生成整个文本块,在专用GPU上推理速度提升高达4倍。与逐字生成的传统自回归大语言模型不同,DiffusionGemma通过并行处理256个token的段落,充分利用硬件算力,特别适合本地低并发场景下的实时交互应用,如内联编辑、快速迭代和非线性文本结构生成。模型采用Apache 2.0许可,支持微调以优化特定任务性能,例如解决数独问题。然而,在高并发云端部署中,其并行解码优势会减弱,可能导致服务成本上升。该模型为研究速度关键型本地工作流的开发者提供了新工具。 #Google #DiffusionGemma #文本生成 #AI #开源模型 #大模型 #科技新闻
微软限制员工使用Claude Fable,担忧数据留存问题
Anthropic昨日发布了其首款Mythos级AI模型Claude Fable,但该模型已在微软内部引发担忧。据知情人士透露,由于Anthropic新增的数据留存要求,微软正在限制员工使用Claude Fable 5。这一限制措施反映出大型科技公司在采用外部AI模型时对数据安全与隐私保护的审慎态度。微软作为AI领域的重要参与者,此举可能影响Claude Fable在企业市场的推广,同时也凸显了AI服务商与客户在数据管理政策上的潜在分歧。 #微软 #Anthropic #ClaudeFable #AI #数据安全 #科技新闻
Anthropic昨日发布了其首款Mythos级AI模型Claude Fable,但该模型已在微软内部引发担忧。据知情人士透露,由于Anthropic新增的数据留存要求,微软正在限制员工使用Claude Fable 5。这一限制措施反映出大型科技公司在采用外部AI模型时对数据安全与隐私保护的审慎态度。微软作为AI领域的重要参与者,此举可能影响Claude Fable在企业市场的推广,同时也凸显了AI服务商与客户在数据管理政策上的潜在分歧。 #微软 #Anthropic #ClaudeFable #AI #数据安全 #科技新闻