AWS 推出 Loom 平台,助力企业安全构建和扩展 AI 代理
随着企业加速采用 AI 代理技术,安全与治理成为关键挑战。为此,AWS 在 AWS Labs 中开源了 Loom 平台,这是一款企业级工具,用于在 Amazon Bedrock AgentCore 运行时基础上构建、部署和运维 AI 代理。Loom 提供统一管理界面和后端 API,集成身份提供商、基于作用域的授权、多角色导航以及代理、记忆、MCP 服务器等资源的全生命周期管理。它支持低代码(通过 AWS Strands 代理 SDK 编写可配置 Python 代理)和无代码(通过 AgentCore 托管框架)两种部署方式,并内建最小权限安全策略与严格护栏。Loom 遵循“简单、有主见、企业级”三大设计原则,旨在帮助平台工程团队在完全托管的 AWS 服务上快速打造安全、可治理的 AI 代理应用,同时实现成本透明与资源标签管理。 #AWS #Loom #AI代理 #企业级 #云计算 #安全治理 #Bedrock #AgentCore
随着企业加速采用 AI 代理技术,安全与治理成为关键挑战。为此,AWS 在 AWS Labs 中开源了 Loom 平台,这是一款企业级工具,用于在 Amazon Bedrock AgentCore 运行时基础上构建、部署和运维 AI 代理。Loom 提供统一管理界面和后端 API,集成身份提供商、基于作用域的授权、多角色导航以及代理、记忆、MCP 服务器等资源的全生命周期管理。它支持低代码(通过 AWS Strands 代理 SDK 编写可配置 Python 代理)和无代码(通过 AgentCore 托管框架)两种部署方式,并内建最小权限安全策略与严格护栏。Loom 遵循“简单、有主见、企业级”三大设计原则,旨在帮助平台工程团队在完全托管的 AWS 服务上快速打造安全、可治理的 AI 代理应用,同时实现成本透明与资源标签管理。 #AWS #Loom #AI代理 #企业级 #云计算 #安全治理 #Bedrock #AgentCore
OpenAI 推出 GPT-Red 对抗攻击系统,每次攻击自动增强防御模型
OpenAI 发布最新技术说明,其研发的 GPT-Red 系统通过对抗性自学习机制进行安全测试。该系统以 Prompt 注入为主要攻击手段,持续挑战各类高难度防御模型。与传统的红队测试不同,GPT-Red 每一次成功的攻击都会自动转化为防御模型的训练数据,从而迭代改进安全策略。这种“攻击即训练”的模式迫使 GPT-Red 不断寻找更广泛、更复杂的系统漏洞,形成攻防双螺旋上升的闭环。该机制有望显著提升前沿 AI 模型在复杂场景下的鲁棒性和安全性,为行业树立新的安全评估标准。 #OpenAI #AI安全 #对抗攻击 #GPTRed #大模型 #安全训练 #Prompt注入 #红队测试
OpenAI 发布最新技术说明,其研发的 GPT-Red 系统通过对抗性自学习机制进行安全测试。该系统以 Prompt 注入为主要攻击手段,持续挑战各类高难度防御模型。与传统的红队测试不同,GPT-Red 每一次成功的攻击都会自动转化为防御模型的训练数据,从而迭代改进安全策略。这种“攻击即训练”的模式迫使 GPT-Red 不断寻找更广泛、更复杂的系统漏洞,形成攻防双螺旋上升的闭环。该机制有望显著提升前沿 AI 模型在复杂场景下的鲁棒性和安全性,为行业树立新的安全评估标准。 #OpenAI #AI安全 #对抗攻击 #GPTRed #大模型 #安全训练 #Prompt注入 #红队测试
中美多地对AI伴侣加强监管,中国强制关停通用应用内伴侣功能
据媒体报道,中国新实施的AI监管法律于今日生效,要求通用型应用内的免费用户自建AI伴侣功能下线。字节跳动“豆包”(月活超3亿)、阿里通义千问、腾讯元宝等均已移除相关功能。新规允许专门的伴侣应用存在,但禁止在面向大众的通用应用中提供可塑人格的AI伴侣,以防止未成年人成瘾、虚假关系及社会腐蚀。中国官方还担忧AI伴侣可能加剧生育率下降。与此同时,美国加州和纽约州也出台了类似法规:加州要求伴侣应用必须提供自杀预防协议、为未成年人屏蔽色情内容;纽约州则要求检测并应对用户自残表达。两州均强制AI伴侣披露其非人类身份。各地监管均旨在平衡技术进步与心理健康、人口结构等社会影响。 #AI伴侣 #监管 #中国 #美国 #科技政策 #人工智能 #成瘾 #生育率 #未成年人保护
据媒体报道,中国新实施的AI监管法律于今日生效,要求通用型应用内的免费用户自建AI伴侣功能下线。字节跳动“豆包”(月活超3亿)、阿里通义千问、腾讯元宝等均已移除相关功能。新规允许专门的伴侣应用存在,但禁止在面向大众的通用应用中提供可塑人格的AI伴侣,以防止未成年人成瘾、虚假关系及社会腐蚀。中国官方还担忧AI伴侣可能加剧生育率下降。与此同时,美国加州和纽约州也出台了类似法规:加州要求伴侣应用必须提供自杀预防协议、为未成年人屏蔽色情内容;纽约州则要求检测并应对用户自残表达。两州均强制AI伴侣披露其非人类身份。各地监管均旨在平衡技术进步与心理健康、人口结构等社会影响。 #AI伴侣 #监管 #中国 #美国 #科技政策 #人工智能 #成瘾 #生育率 #未成年人保护
Show HN: 开源 AI 工作流构建器 React 模板
近日,开发者社区 Show HN 上发布了一款基于 JointJS+ 的 AI 工作流构建器 React 应用模板。该模板允许用户通过拖拽界面设计 AI 代理,包括添加技能、设置提示词、连接外部工具以及可视化定义代理行为。项目内置自动布局、自定义形状、导航器、属性编辑器等多项开箱即用的功能,所有组件均来自 JointJS+ 商业库。开发者可基于此模板快速在自己的 Web 应用中集成类似的 AI 代理设计 UI,极大地降低了可视化工作流从零搭建的门槛。模板支持导出为 JSON/PNG/JPEG,并提供撤消/重做、快捷键、验证等高级交互特性。 #AI #工作流 #React #JointJS #前端 #开源 #开发工具 #低代码
近日,开发者社区 Show HN 上发布了一款基于 JointJS+ 的 AI 工作流构建器 React 应用模板。该模板允许用户通过拖拽界面设计 AI 代理,包括添加技能、设置提示词、连接外部工具以及可视化定义代理行为。项目内置自动布局、自定义形状、导航器、属性编辑器等多项开箱即用的功能,所有组件均来自 JointJS+ 商业库。开发者可基于此模板快速在自己的 Web 应用中集成类似的 AI 代理设计 UI,极大地降低了可视化工作流从零搭建的门槛。模板支持导出为 JSON/PNG/JPEG,并提供撤消/重做、快捷键、验证等高级交互特性。 #AI #工作流 #React #JointJS #前端 #开源 #开发工具 #低代码
BenchmarkList 上线:一站式追踪超2400个AI基准测试与模型
一个名为BenchmarkList的新平台正式上线,旨在为AI社区提供一站式基准测试、模型和能力追踪服务。该平台目前已收录2465个基准测试、24173个模型及1594个提供商,并提供交互式时间线、前沿模型能力评分(如GPT-5.6 Sol评分156.99)以及热门基准测试排名(如SWE-Marathon、DeepSWE等)。平台还列出了顶级提供商,包括OpenAI、Google、Anthropic、Qwen和DeepSeek等。近期新增了WANDR、DuelLab GameBench 2、FrontierFinance、RoboDojo等多个新基准测试,覆盖代理、游戏、金融和机器人等领域。其中RoboDojo是一个统一的模拟与真实世界基准,用于系统评估通用机器人操作策略,包含42个模拟任务和18个真实世界任务。 #AI #基准测试 #大模型 #机器学习 #机器人 #科技新闻
一个名为BenchmarkList的新平台正式上线,旨在为AI社区提供一站式基准测试、模型和能力追踪服务。该平台目前已收录2465个基准测试、24173个模型及1594个提供商,并提供交互式时间线、前沿模型能力评分(如GPT-5.6 Sol评分156.99)以及热门基准测试排名(如SWE-Marathon、DeepSWE等)。平台还列出了顶级提供商,包括OpenAI、Google、Anthropic、Qwen和DeepSeek等。近期新增了WANDR、DuelLab GameBench 2、FrontierFinance、RoboDojo等多个新基准测试,覆盖代理、游戏、金融和机器人等领域。其中RoboDojo是一个统一的模拟与真实世界基准,用于系统评估通用机器人操作策略,包含42个模拟任务和18个真实世界任务。 #AI #基准测试 #大模型 #机器学习 #机器人 #科技新闻
Thinking Machines 发布 975B 参数开源大模型 Inkling
穆拉蒂创立的 Thinking Machines 公司正式发布开源大模型 Inkling。该模型拥有 9750 亿总参数(活跃参数 410 亿),采用混合专家(MoE)架构,支持高达 100 万 token 的上下文窗口,可处理文本、图像和音频输入。作为一款开源权重模型,Inkling 可在 Tinker 平台进行微调。其能力覆盖通用智能、数学推理、编码与工具调用,并具备多模态输入处理、可控推理时间及置信度预测等特性,旨在平衡速度与性能,便于开发者定制。 #ThinkingMachines #Inkling #大模型 #开源 #AI #多模态 #MoE #科技新闻
穆拉蒂创立的 Thinking Machines 公司正式发布开源大模型 Inkling。该模型拥有 9750 亿总参数(活跃参数 410 亿),采用混合专家(MoE)架构,支持高达 100 万 token 的上下文窗口,可处理文本、图像和音频输入。作为一款开源权重模型,Inkling 可在 Tinker 平台进行微调。其能力覆盖通用智能、数学推理、编码与工具调用,并具备多模态输入处理、可控推理时间及置信度预测等特性,旨在平衡速度与性能,便于开发者定制。 #ThinkingMachines #Inkling #大模型 #开源 #AI #多模态 #MoE #科技新闻
企业转向开源LLM推理
开源LLM推理领域在2026年迎来重要转折。许多企业在依赖前沿模型API后,面临成本飙升、法律合规风险及延迟控制不足等问题。财务部门发现API账单增长远超收入增速,法律部门担忧数据被第三方接触,工程团队则需要P99延迟保障。这些压力促使企业探索替代方案。文章指出,离开前沿API后主要有两条路径:一是选择托管推理服务(如Fireworks、Together等),保留API体验但获得模型选择权和数据控制权;二是完全自建,即采购开源权重、自租GPU并搭建开源推理堆栈。若选择自建,通常从单副本(复制模型到一张或多张GPU)开始,并使用vLLM等引擎启动。这一趋势反映了企业对成本、数据主权和性能控制的综合需求,开源堆栈正从零散组件走向系统化部署。 #开源LLM #推理 #自建 #成本控制 #数据安全 #API替代 #技术决策
开源LLM推理领域在2026年迎来重要转折。许多企业在依赖前沿模型API后,面临成本飙升、法律合规风险及延迟控制不足等问题。财务部门发现API账单增长远超收入增速,法律部门担忧数据被第三方接触,工程团队则需要P99延迟保障。这些压力促使企业探索替代方案。文章指出,离开前沿API后主要有两条路径:一是选择托管推理服务(如Fireworks、Together等),保留API体验但获得模型选择权和数据控制权;二是完全自建,即采购开源权重、自租GPU并搭建开源推理堆栈。若选择自建,通常从单副本(复制模型到一张或多张GPU)开始,并使用vLLM等引擎启动。这一趋势反映了企业对成本、数据主权和性能控制的综合需求,开源堆栈正从零散组件走向系统化部署。 #开源LLM #推理 #自建 #成本控制 #数据安全 #API替代 #技术决策