微软发布 Orchard 开源框架,推动可扩展智能体 AI 研究
人工智能正从静态问答向自主智能体演进,但构建先进智能体系统常依赖专有基础设施,阻碍了研究社区的发展。为此,微软推出 Orchard 开源框架,其核心 Orchard Env 是基于 Kubernetes 的轻量级环境,可并行创建和管理数千个隔离组件,支持软件工程、网页浏览、个人助理等多种任务类型。框架还发布了三个领域训练方案(Orchard-SWE、Orchard-GUI、Orchard-Claw)及配套训练数据和评估方法。Orchard 的关键创新在于将运行时环境设计为独立可复用服务,并允许智能体在真实部署所用的复杂 harness(如 Claude Code、Codex)中端到端训练,解决了当前训练与部署不匹配的瓶颈,为开放智能体系统研究提供了可扩展的基础设施。 #微软 #Orchard #开源 #智能体AI #AI框架 #Kubernetes #机器学习 #人工智能 #研究工具
人工智能正从静态问答向自主智能体演进,但构建先进智能体系统常依赖专有基础设施,阻碍了研究社区的发展。为此,微软推出 Orchard 开源框架,其核心 Orchard Env 是基于 Kubernetes 的轻量级环境,可并行创建和管理数千个隔离组件,支持软件工程、网页浏览、个人助理等多种任务类型。框架还发布了三个领域训练方案(Orchard-SWE、Orchard-GUI、Orchard-Claw)及配套训练数据和评估方法。Orchard 的关键创新在于将运行时环境设计为独立可复用服务,并允许智能体在真实部署所用的复杂 harness(如 Claude Code、Codex)中端到端训练,解决了当前训练与部署不匹配的瓶颈,为开放智能体系统研究提供了可扩展的基础设施。 #微软 #Orchard #开源 #智能体AI #AI框架 #Kubernetes #机器学习 #人工智能 #研究工具
亚马逊计划整合Nova AI模型,转向单一前沿模型
据Business Insider报道,亚马逊正计划调整其AI战略,从拥有文本、图像、视频等多款模型转向整合为一款单一的多模态前沿模型,可能仍沿用Nova品牌。此次调整涉及淘汰Premier、Omni、Canvas图像生成和Reel视频生成等模型。亚马逊发言人表示,公司持续根据客户需求迭代模型组合,并投资下一代前沿模型研究。与此同时,亚马逊在其通用人工智能部门进行了裁员,以支持更集中的开发策略。尽管亚马逊已向Anthropic投资250亿美元并承诺追加200亿美元,同时将GPT和Codex引入AWS,但其自研模型在市场份额上仍落后于行业领先者。AWS收入虽同比增长28%,但增速不及谷歌云和甲骨文。战略收缩可能影响AI原生手机等硬件计划,对AWS客户而言,亚马逊或将更专注于提供基础设施和第三方模型。 #亚马逊 #AI #大模型 #Nova #AWS #科技新闻 #战略调整 #人工智能
据Business Insider报道,亚马逊正计划调整其AI战略,从拥有文本、图像、视频等多款模型转向整合为一款单一的多模态前沿模型,可能仍沿用Nova品牌。此次调整涉及淘汰Premier、Omni、Canvas图像生成和Reel视频生成等模型。亚马逊发言人表示,公司持续根据客户需求迭代模型组合,并投资下一代前沿模型研究。与此同时,亚马逊在其通用人工智能部门进行了裁员,以支持更集中的开发策略。尽管亚马逊已向Anthropic投资250亿美元并承诺追加200亿美元,同时将GPT和Codex引入AWS,但其自研模型在市场份额上仍落后于行业领先者。AWS收入虽同比增长28%,但增速不及谷歌云和甲骨文。战略收缩可能影响AI原生手机等硬件计划,对AWS客户而言,亚马逊或将更专注于提供基础设施和第三方模型。 #亚马逊 #AI #大模型 #Nova #AWS #科技新闻 #战略调整 #人工智能
TokenMaxxer 上线
TokenMaxxer 是一款面向开发者的新工具,能够从 18 种编码工具(如 Claude Code、Codex、Cursor 等)中读取 AI Token 使用数据,并以精美仪表盘展示消耗量、成本及去向。该工具采用只读 CLI 收集本地使用元数据,确保提示词和代码不离开本地,默认隐私保护,用户可选择公开参与全球排行榜。排行榜显示最重度 AI 用户,按 Token 消耗排名,并支持切换查看花费。TokenMaxxer 旨在帮助开发者清晰掌握 AI 工具使用情况,优化成本,并加入社区竞争。 #TokenMaxxer #AI #Token追踪 #开发者工具 #编程 #排行榜 #隐私保护 #成本优化
TokenMaxxer 是一款面向开发者的新工具,能够从 18 种编码工具(如 Claude Code、Codex、Cursor 等)中读取 AI Token 使用数据,并以精美仪表盘展示消耗量、成本及去向。该工具采用只读 CLI 收集本地使用元数据,确保提示词和代码不离开本地,默认隐私保护,用户可选择公开参与全球排行榜。排行榜显示最重度 AI 用户,按 Token 消耗排名,并支持切换查看花费。TokenMaxxer 旨在帮助开发者清晰掌握 AI 工具使用情况,优化成本,并加入社区竞争。 #TokenMaxxer #AI #Token追踪 #开发者工具 #编程 #排行榜 #隐私保护 #成本优化
Amazon Bedrock 推出自动策略改进功能,简化形式化验证流程
Amazon Bedrock 宣布其 Automated Reasoning 策略新增自动改进功能,替代以往手动诊断、编辑、测试的重复循环。该引擎可自动检测失败测试并生成形式逻辑修复方案,用户需批准每一项更改后方可生效。Automated Reasoning 检查利用形式化验证,通过将自然语言转换为形式逻辑,实现高达99%的验证准确率。此次发布包含两种改进模式:针对规则问题的迭代改进,以及针对语言问题的模糊变量改进。文章详细介绍了两种模式的API工作流和可重复的控制台操作,帮助用户将失败策略转化为通过策略。该功能旨在解决策略开发中最大的痛点——迭代调优。 #AmazonBedrock #AutomatedReasoning #形式化验证 #策略改进 #AWS #AI #机器学习
Amazon Bedrock 宣布其 Automated Reasoning 策略新增自动改进功能,替代以往手动诊断、编辑、测试的重复循环。该引擎可自动检测失败测试并生成形式逻辑修复方案,用户需批准每一项更改后方可生效。Automated Reasoning 检查利用形式化验证,通过将自然语言转换为形式逻辑,实现高达99%的验证准确率。此次发布包含两种改进模式:针对规则问题的迭代改进,以及针对语言问题的模糊变量改进。文章详细介绍了两种模式的API工作流和可重复的控制台操作,帮助用户将失败策略转化为通过策略。该功能旨在解决策略开发中最大的痛点——迭代调优。 #AmazonBedrock #AutomatedReasoning #形式化验证 #策略改进 #AWS #AI #机器学习