三星电子引入谷歌Gemini Enterprise加速AI业务创新
三星电子与谷歌云合作,向其全球设备体验(DX)部门员工提供谷歌云企业级AI服务“Gemini Enterprise”,以推动代理型人工智能在业务中的应用。谷歌云于13日宣布,此次合作覆盖韩国及全球三星DX部门,旨在通过生成式AI提升工作效率和创新能力。谷歌云指出,这是韩国企业中代理型人工智能建设的重要案例,标志着三星电子在数字化转型中加速拥抱先进AI工具。通过Gemini Enterprise,三星员工可利用多模态理解和智能辅助功能优化流程,预计将显著提升业务决策和响应速度。 #三星电子 #谷歌云 #GeminiEnterprise #人工智能 #数字化转型 #代理型AI
三星电子与谷歌云合作,向其全球设备体验(DX)部门员工提供谷歌云企业级AI服务“Gemini Enterprise”,以推动代理型人工智能在业务中的应用。谷歌云于13日宣布,此次合作覆盖韩国及全球三星DX部门,旨在通过生成式AI提升工作效率和创新能力。谷歌云指出,这是韩国企业中代理型人工智能建设的重要案例,标志着三星电子在数字化转型中加速拥抱先进AI工具。通过Gemini Enterprise,三星员工可利用多模态理解和智能辅助功能优化流程,预计将显著提升业务决策和响应速度。 #三星电子 #谷歌云 #GeminiEnterprise #人工智能 #数字化转型 #代理型AI
AI打工能力排行榜更新:Claude Fable 5自动化率16.1%,是GPT
AI安全中心(CAIS)与Scale AI联合开发的远程劳动力指数(RLI)发布最新评估结果。该基准通过240个来自Upwork平台、总价值超14.4万美元的真实自由职业项目,评估AI自主完成完整商业委托的能力。Claude Fable 5以16.1%的自动化率位居榜首,是第二名Opus 4.8(8.3%)的两倍,第三名GPT-5.5(6.3%)的2.5倍。相比8个月前RLI刚发布时最高仅2.5%的自动化率,前沿AI模型的能力在不到八个月内翻了四倍以上。Fable 5的突破得益于新的Worker-critic Loop框架,允许评审Agent以苛刻客户视角检查并打回交付物,直至质量达标。然而,评估因美国政府出口管制中断了22个项目,即便将这些项目全部视为失败,Fable 5的自动化率仍达14.6%。值得注意的是,虽然AI在视觉质量上有显著提升,但84%的真实商业项目仍超出其能力范围。此外,用AI替代人类评审的尝试也遭遇瓶颈,AI评审对GPT-5.5的能力高估了近3倍。 #AI #自动化 #劳动力市场 #Claude #GPT5
AI安全中心(CAIS)与Scale AI联合开发的远程劳动力指数(RLI)发布最新评估结果。该基准通过240个来自Upwork平台、总价值超14.4万美元的真实自由职业项目,评估AI自主完成完整商业委托的能力。Claude Fable 5以16.1%的自动化率位居榜首,是第二名Opus 4.8(8.3%)的两倍,第三名GPT-5.5(6.3%)的2.5倍。相比8个月前RLI刚发布时最高仅2.5%的自动化率,前沿AI模型的能力在不到八个月内翻了四倍以上。Fable 5的突破得益于新的Worker-critic Loop框架,允许评审Agent以苛刻客户视角检查并打回交付物,直至质量达标。然而,评估因美国政府出口管制中断了22个项目,即便将这些项目全部视为失败,Fable 5的自动化率仍达14.6%。值得注意的是,虽然AI在视觉质量上有显著提升,但84%的真实商业项目仍超出其能力范围。此外,用AI替代人类评审的尝试也遭遇瓶颈,AI评审对GPT-5.5的能力高估了近3倍。 #AI #自动化 #劳动力市场 #Claude #GPT5
AI 打工排行榜更新:Claude Fable 5 自动化率 16.1%,是 GPT
AI 安全中心(CAIS)与 Scale AI 联合发布的远程劳动力指数(RLI)最新数据显示,Claude Fable 5 以 16.1% 的自动化率位居榜首,约为第二名 Opus 4.8(8.3%)的两倍,是第三名 GPT-5.5(6.3%)的 2.5 倍。该指数基于 240 个来自 Upwork 的真实自由职业项目,涵盖 3D 建模、平面设计、数据分析等 23 个领域,评估 AI 能否独立完成客户付费级别的工作。相比 8 个月前榜单最高分仅 2.5%,前沿模型自动化能力已提升四倍以上。Fable 5 的高分得益于“工人-评审循环”框架,即一个独立评审 Agent 模拟苛刻客户审核并返工修改,同时其项目预算上限为 150 美元,高于其他模型的 50 美元。然而,测试发现 AI 评审在取代人工评审时存在严重偏差,对部分模型评分高估数倍。此外,84% 的项目目前仍无法被 AI 独立完成,AI 能力呈现出“锯齿状前沿”特征,而非简单随任务耗时增加而下降。 #AI #Claude #Fable5 #GPT5 #RLI #自动化 #科技新闻 #远程工作
AI 安全中心(CAIS)与 Scale AI 联合发布的远程劳动力指数(RLI)最新数据显示,Claude Fable 5 以 16.1% 的自动化率位居榜首,约为第二名 Opus 4.8(8.3%)的两倍,是第三名 GPT-5.5(6.3%)的 2.5 倍。该指数基于 240 个来自 Upwork 的真实自由职业项目,涵盖 3D 建模、平面设计、数据分析等 23 个领域,评估 AI 能否独立完成客户付费级别的工作。相比 8 个月前榜单最高分仅 2.5%,前沿模型自动化能力已提升四倍以上。Fable 5 的高分得益于“工人-评审循环”框架,即一个独立评审 Agent 模拟苛刻客户审核并返工修改,同时其项目预算上限为 150 美元,高于其他模型的 50 美元。然而,测试发现 AI 评审在取代人工评审时存在严重偏差,对部分模型评分高估数倍。此外,84% 的项目目前仍无法被 AI 独立完成,AI 能力呈现出“锯齿状前沿”特征,而非简单随任务耗时增加而下降。 #AI #Claude #Fable5 #GPT5 #RLI #自动化 #科技新闻 #远程工作