防范云管理“隐形宕机”指南
云服务最危险的故障并非服务器宕机,而是账户冻结、计费争议、支持停滞等管理层面问题。这种“管理宕机”虽不影响技术功能,却会使客户无法正常操作、迁移或恢复。
- 管理宕机定义:基础设施技术正常,但因账户、计费、合规审核等供应商关系问题,客户丧失操作能力
- 管理容错策略:备份应存放于生产账户之外,恢复凭证独立于可能失效的管理面,在危机前演练迁移
- 去中心化计算方案:Fluence、Akash、Golem 等网络可测试“计算采购与供应商行政栈分离”的可行性
- 实操建议:映射行政依赖关系,按工作负载敏感度分类,分散多供应商,要求供应商提供管理 SLA
来源:
#开发者 #工具
📢 频道:@DevToolboxHub
云服务最危险的故障并非服务器宕机,而是账户冻结、计费争议、支持停滞等管理层面问题。这种“管理宕机”虽不影响技术功能,却会使客户无法正常操作、迁移或恢复。
- 管理宕机定义:基础设施技术正常,但因账户、计费、合规审核等供应商关系问题,客户丧失操作能力
- 管理容错策略:备份应存放于生产账户之外,恢复凭证独立于可能失效的管理面,在危机前演练迁移
- 去中心化计算方案:Fluence、Akash、Golem 等网络可测试“计算采购与供应商行政栈分离”的可行性
- 实操建议:映射行政依赖关系,按工作负载敏感度分类,分散多供应商,要求供应商提供管理 SLA
来源:
https://dev.to/kufre_akpan_e7256f8198803/the-future-guide-for-escaping-single-provider-administrative-failure-33ei#开发者 #工具
📢 频道:@DevToolboxHub
Gemma 4 代理工具调用达 86.4%
Google DeepMind 发布 Gemma 4,代理化工具调用能力从上一代的 6.6% 跃升至 86.4%(τ2-bench Retail)。这不是微小改进,而是能力级别跨越。
要点:
- 31B dense 模型在 τ2-bench 上得 86.4%,26B MoE 得 85.5%(参数量激活仅 3.8B),逼近旗舰级代理能力。
- 架构原生支持函数调用(专用控制 token)、可配置思考模式(4000+ token 逐步推理)和系统提示,无需 prompt 工程拼凑。
- 首次采用 Apache 2.0 许可证,允许商用、微调和产品嵌入,无需 Google 额外授权。
- 四种模型:31B dense(高精度)、26B MoE(速度与精度平衡)、E4B(边缘端/语音输入)、E2B(IoT/离线)。注意 26B MoE 需加载全部 26B 参数至内存。
链接:原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Google DeepMind 发布 Gemma 4,代理化工具调用能力从上一代的 6.6% 跃升至 86.4%(τ2-bench Retail)。这不是微小改进,而是能力级别跨越。
要点:
- 31B dense 模型在 τ2-bench 上得 86.4%,26B MoE 得 85.5%(参数量激活仅 3.8B),逼近旗舰级代理能力。
- 架构原生支持函数调用(专用控制 token)、可配置思考模式(4000+ token 逐步推理)和系统提示,无需 prompt 工程拼凑。
- 首次采用 Apache 2.0 许可证,允许商用、微调和产品嵌入,无需 Google 额外授权。
- 四种模型:31B dense(高精度)、26B MoE(速度与精度平衡)、E4B(边缘端/语音输入)、E2B(IoT/离线)。注意 26B MoE 需加载全部 26B 参数至内存。
链接:原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Antigravity 2.0 发布,Gemini CLI 将退役
Google 在 I/O 2026 推出 Antigravity 2.0,这是一套 agent-first 开发平台,包含四款产品:Antigravity 2.0 桌面 app(多 agent 并行)、CLI(Go 重写)、SDK(构建自定义 agent)以及原有的 IDE(VS Code 分支)。同时宣布 Gemini CLI 将于 2026 年 6 月 18 日停用,用户需迁移至新的 Antigravity CLI。更新后若聊天历史消失,数据仍在 ~/.gemini/antigravity-backup 中,可用 rsync 恢复到活动目录(注意排除 mcp_config.json)。桌面版与 IDE 不能同时安装,如需保留旧 IDE,需下载 1.23.2 并关闭自动更新。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Google 在 I/O 2026 推出 Antigravity 2.0,这是一套 agent-first 开发平台,包含四款产品:Antigravity 2.0 桌面 app(多 agent 并行)、CLI(Go 重写)、SDK(构建自定义 agent)以及原有的 IDE(VS Code 分支)。同时宣布 Gemini CLI 将于 2026 年 6 月 18 日停用,用户需迁移至新的 Antigravity CLI。更新后若聊天历史消失,数据仍在 ~/.gemini/antigravity-backup 中,可用 rsync 恢复到活动目录(注意排除 mcp_config.json)。桌面版与 IDE 不能同时安装,如需保留旧 IDE,需下载 1.23.2 并关闭自动更新。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
KernelMind 检索消融与 RAGAS 评估
KernelMind 在第三部分中完成了从 ”代码嵌入“ 到图感知检索管线的演进,并引入实验性评估体系。
- 构建基于真实 repo 结构的检索基准,覆盖认证流、CRUD、依赖注入等场景
- 通过消融实验验证各组件贡献:图扩展将召回率从 0.722 提升至 1.000(精度仅降 0.024)
- 交叉编码器重排序有效抑制图噪声,维持精度
- 集成 RAGAS 对答案进行忠实度、相关性、上下文精度/召回评估,本地使用 Qwen2.5:7b 作评判模型
最终提供 TUI 终端界面,支持对话式仓库查询与检索可视化。
GitHub: GitHub
原文
#开发者 #工具
📢 频道:@DevToolboxHub
KernelMind 在第三部分中完成了从 ”代码嵌入“ 到图感知检索管线的演进,并引入实验性评估体系。
- 构建基于真实 repo 结构的检索基准,覆盖认证流、CRUD、依赖注入等场景
- 通过消融实验验证各组件贡献:图扩展将召回率从 0.722 提升至 1.000(精度仅降 0.024)
- 交叉编码器重排序有效抑制图噪声,维持精度
- 集成 RAGAS 对答案进行忠实度、相关性、上下文精度/召回评估,本地使用 Qwen2.5:7b 作评判模型
最终提供 TUI 终端界面,支持对话式仓库查询与检索可视化。
GitHub: GitHub
原文
#开发者 #工具
📢 频道:@DevToolboxHub
微软发布自愈CI/CD蓝图
微软公开了基于AI代理的自愈CI/CD管道架构,采用Observe-Analyze-Act循环自动处理故障。传统管道失败后需要人工调试,新架构通过以下机制替代:
- 管道失败时,webhook将遥测和构建日志发送至Azure Function,再经AI Foundry调用GPT-4o分析上下文,而非仅匹配错误码。
- 代理可识别配置漂移、依赖缺失、环境变量错误等问题,自动生成修复方案并触发PR或管道更新。
- 基于Azure DevOps、Azure Functions和Azure OpenAI(均GA),输出以PR形式保留人类审批环节,预检和事后修复均可使用。
核心原理:代理在基础设施上下文中理解错误,将调试循环从人工变为自动。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
微软公开了基于AI代理的自愈CI/CD管道架构,采用Observe-Analyze-Act循环自动处理故障。传统管道失败后需要人工调试,新架构通过以下机制替代:
- 管道失败时,webhook将遥测和构建日志发送至Azure Function,再经AI Foundry调用GPT-4o分析上下文,而非仅匹配错误码。
- 代理可识别配置漂移、依赖缺失、环境变量错误等问题,自动生成修复方案并触发PR或管道更新。
- 基于Azure DevOps、Azure Functions和Azure OpenAI(均GA),输出以PR形式保留人类审批环节,预检和事后修复均可使用。
核心原理:代理在基础设施上下文中理解错误,将调试循环从人工变为自动。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Google I/O '26 发布企业AI全栈工具:五款新品一览
Google 在 I/O '26 上推出集成式 Agent 栈,涵盖模型层到终端工作流。核心产品包括:
- Gemini 3.5 Flash:对标大模型的速度与成本,在 MCP Atlas 基准上获 83.6% 分数,已上线 Gemini Enterprise、AI Studio 和 Antigravity。Gemini 3.5 Pro 下月测试。
- Gemini Omni:视频优先多模态模型,支持文本/音频/图像/视频输入,输出动态视频,几周内通过 Gemini API 推出。
- Antigravity 2.0:独立桌面应用,集成 Agent Platform,默认继承 Google Cloud 数据保护;同时提供 CLI 界面。AirAsia Next CTO 称超半数生产代码来自 Antigravity 工作流。
- Gemini Spark:个人 Agent,24/7 运行,连接 Workspace 及 Salesforce、Zendesk 等外部系统,支持自主多步操作并设置审批门,任务运行在临时 VM,凭据不接触 Agent。
- Managed Agents API:单 API 调用即可在 Google 托管环境部署自定义 Agent,自动继承 Agent Platform 安全治理。另含 CodeMender(DeepMind 安全 Agent),可发现漏洞、生成补丁并自动部署。
链接:原文链接
文档:docs.cloud.google.com
#开发者 #工具
📢 频道:@DevToolboxHub
Google 在 I/O '26 上推出集成式 Agent 栈,涵盖模型层到终端工作流。核心产品包括:
- Gemini 3.5 Flash:对标大模型的速度与成本,在 MCP Atlas 基准上获 83.6% 分数,已上线 Gemini Enterprise、AI Studio 和 Antigravity。Gemini 3.5 Pro 下月测试。
- Gemini Omni:视频优先多模态模型,支持文本/音频/图像/视频输入,输出动态视频,几周内通过 Gemini API 推出。
- Antigravity 2.0:独立桌面应用,集成 Agent Platform,默认继承 Google Cloud 数据保护;同时提供 CLI 界面。AirAsia Next CTO 称超半数生产代码来自 Antigravity 工作流。
- Gemini Spark:个人 Agent,24/7 运行,连接 Workspace 及 Salesforce、Zendesk 等外部系统,支持自主多步操作并设置审批门,任务运行在临时 VM,凭据不接触 Agent。
- Managed Agents API:单 API 调用即可在 Google 托管环境部署自定义 Agent,自动继承 Agent Platform 安全治理。另含 CodeMender(DeepMind 安全 Agent),可发现漏洞、生成补丁并自动部署。
链接:原文链接
文档:docs.cloud.google.com
#开发者 #工具
📢 频道:@DevToolboxHub
Gemini新UI与3.5 Flash发布
Google 在 I/O 2026 推出全新 Gemini UI 及 3.5 Flash 模型,定位为 AI 原生开发者体验。
新 UI 要点:
- 极简无干扰设计,更快访问模型与工具
- 工作流导向布局,更像生产力环境
Gemini 3.5 Flash 要点:
- 高速模型,专为编码、代理任务、UI 生成、迭代开发及长上下文执行优化
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Google 在 I/O 2026 推出全新 Gemini UI 及 3.5 Flash 模型,定位为 AI 原生开发者体验。
新 UI 要点:
- 极简无干扰设计,更快访问模型与工具
- 工作流导向布局,更像生产力环境
Gemini 3.5 Flash 要点:
- 高速模型,专为编码、代理任务、UI 生成、迭代开发及长上下文执行优化
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
从Go到Rust:微秒级性能抉择
一家高频交易系统因47微秒延迟错失230万美元套利机会,将核心引擎从Go重写为Rust后,平均执行延迟从89μs降至12μs,尾延迟提升10.2倍(P99:234μs→23μs)。
- GC暂停导致错过23%的盈利交易,Rust零GC实现零中断
- 基础设施成本从$47k/月降至$19k/月,运维告警减少78%
- 迁移后8个月内额外盈利$2370万,ROI达2700%
- 生产环境零崩溃,零内存泄漏事件
文章还量化了不同延迟场景的语言选型建议:高于100μs选Go,低于50μs需Rust。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
一家高频交易系统因47微秒延迟错失230万美元套利机会,将核心引擎从Go重写为Rust后,平均执行延迟从89μs降至12μs,尾延迟提升10.2倍(P99:234μs→23μs)。
- GC暂停导致错过23%的盈利交易,Rust零GC实现零中断
- 基础设施成本从$47k/月降至$19k/月,运维告警减少78%
- 迁移后8个月内额外盈利$2370万,ROI达2700%
- 生产环境零崩溃,零内存泄漏事件
文章还量化了不同延迟场景的语言选型建议:高于100μs选Go,低于50μs需Rust。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
AI编码代理工具本周动态速览
本周多个AI编码代理工具发布重大更新,涉及IDE插件、CLI和开源项目。
- Cursor 3.0 引入 Agents Window 全屏工作区,支持多代理并行执行(本地/SSH/云端),新增 /worktree 隔离任务、/best-of-n 盲测、Design Mode 浏览器标注。定位从 AI 增强 IDE 升级为代理协调平台。
- Claude Code Opus 4.7 达到 SWE-bench Verified 87.6%,支持 1M token 上下文、3.75MP 视觉分辨率、Background Agents 在隔离 Git worktree 执行、Agent Teams 多代理协作预览。注意新 tokenizer 使同文本 token 消耗增加约 35%。
- 开源编码代理 OpenCode v1.2.0 突破 150K GitHub stars,会话存储迁移至 SQLite,Plan Agent 只读分析全仓,原生集成 MCP,支持 75+ LLM 提供商(含本地模型),GitHub Copilot 订阅用户可免费接入。
- Windsurf 2.0 被 Cognition 收购后推出 Devin Cloud 一键部署,计划本地、云端执行,代理在关闭笔记本后继续运行。新增 Agent Command Center(看板状态管理)和 Spaces(会话/PR/文件捆绑任务单元)。默认模型升级为 SWE-1.5。
🔗 github.com/anomaly/open-code
🔗 windsurf.com
#开发者 #工具
📢 频道:@DevToolboxHub
本周多个AI编码代理工具发布重大更新,涉及IDE插件、CLI和开源项目。
- Cursor 3.0 引入 Agents Window 全屏工作区,支持多代理并行执行(本地/SSH/云端),新增 /worktree 隔离任务、/best-of-n 盲测、Design Mode 浏览器标注。定位从 AI 增强 IDE 升级为代理协调平台。
- Claude Code Opus 4.7 达到 SWE-bench Verified 87.6%,支持 1M token 上下文、3.75MP 视觉分辨率、Background Agents 在隔离 Git worktree 执行、Agent Teams 多代理协作预览。注意新 tokenizer 使同文本 token 消耗增加约 35%。
- 开源编码代理 OpenCode v1.2.0 突破 150K GitHub stars,会话存储迁移至 SQLite,Plan Agent 只读分析全仓,原生集成 MCP,支持 75+ LLM 提供商(含本地模型),GitHub Copilot 订阅用户可免费接入。
- Windsurf 2.0 被 Cognition 收购后推出 Devin Cloud 一键部署,计划本地、云端执行,代理在关闭笔记本后继续运行。新增 Agent Command Center(看板状态管理)和 Spaces(会话/PR/文件捆绑任务单元)。默认模型升级为 SWE-1.5。
🔗 github.com/anomaly/open-code
🔗 windsurf.com
#开发者 #工具
📢 频道:@DevToolboxHub
2026年Next.js无头CMS四强对比
作者基于生产项目经验,从查询语言、Schema DX、App Router 支持、定价、编辑体验、自托管六个维度对比了四个主流 headless CMS:
- Sanity – GROQ 查询优秀,TypeScript 原生,支持代码优先 Schema,免费额度慷慨,新项目首选。
- Payload – 完全自托管,代码优先,支持本地 API,适合需要数据自主权的全栈应用。
- Storyblok – 可视化编辑器最强,适合营销团队拖拽建站,但 Schema 不在代码中,开发者体验较弱。
- Contentful – 编辑器成熟,但定价高($300/月起),无代码优先 Schema,不推荐新项目启动。
按团队类型推荐:个人开发者/自由职业者选 Sanity;代理机构选 Sanity 或 Storyblok;创业公司选 Payload 或 Sanity;企业选 Contentful 或 Sanity Enterprise。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
作者基于生产项目经验,从查询语言、Schema DX、App Router 支持、定价、编辑体验、自托管六个维度对比了四个主流 headless CMS:
- Sanity – GROQ 查询优秀,TypeScript 原生,支持代码优先 Schema,免费额度慷慨,新项目首选。
- Payload – 完全自托管,代码优先,支持本地 API,适合需要数据自主权的全栈应用。
- Storyblok – 可视化编辑器最强,适合营销团队拖拽建站,但 Schema 不在代码中,开发者体验较弱。
- Contentful – 编辑器成熟,但定价高($300/月起),无代码优先 Schema,不推荐新项目启动。
按团队类型推荐:个人开发者/自由职业者选 Sanity;代理机构选 Sanity 或 Storyblok;创业公司选 Payload 或 Sanity;企业选 Contentful 或 Sanity Enterprise。
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
7款LLM每周选股,1rok基准开源
七个前沿LLM(GPT-5.5、Gemini 3.1 Pro Preview等)各持10万美元模拟资金,每周一用相同工具链和提示选股,市场打分。项目1rok已开源,实时排行榜可查。
- 每位LLM独立Alpaca模拟账户,只有模型变量不同
- 每周一10个Agent分4阶段(宏观→筛选→分析→执行)生成组合
- 约32个工具覆盖市场数据、股票筛选、基本面、技术面等
- 使用
仓库:github.com/achaljhawar/1rok
排行榜:investingbench.vercel.app
#开发者 #工具
📢 频道:@DevToolboxHub
七个前沿LLM(GPT-5.5、Gemini 3.1 Pro Preview等)各持10万美元模拟资金,每周一用相同工具链和提示选股,市场打分。项目1rok已开源,实时排行榜可查。
- 每位LLM独立Alpaca模拟账户,只有模型变量不同
- 每周一10个Agent分4阶段(宏观→筛选→分析→执行)生成组合
- 约32个工具覆盖市场数据、股票筛选、基本面、技术面等
- 使用
bun run 1rok -- run --model <id> 命令运行,可重跑历史数据仓库:github.com/achaljhawar/1rok
排行榜:investingbench.vercel.app
#开发者 #工具
📢 频道:@DevToolboxHub
Strands + AgentCore 构建 AI Agent 实战
AWS Briefing Agent 重构采用 Strands Agents SDK 与 Bedrock AgentCore Runtime,代码量减少 75%。核心要点:
- 使用 Strands Agents SDK 构建 Agent,集成 Bedrock Knowledge Base 与自定义工具
- AgentCore Runtime 将函数包装为 HTTP 服务,支持 Container build(CodeBuild + ECR)解决源分发依赖
- 内置滑动窗口会话管理器:窗口从40降至20,平均响应时间从80秒降为15秒
- Guardrails 集成实践:需手动补充 IAM 权限;主题策略可能误判合法查询;CDK 更新后需同步版本号避免版本冲突
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
AWS Briefing Agent 重构采用 Strands Agents SDK 与 Bedrock AgentCore Runtime,代码量减少 75%。核心要点:
- 使用 Strands Agents SDK 构建 Agent,集成 Bedrock Knowledge Base 与自定义工具
- AgentCore Runtime 将函数包装为 HTTP 服务,支持 Container build(CodeBuild + ECR)解决源分发依赖
- 内置滑动窗口会话管理器:窗口从40降至20,平均响应时间从80秒降为15秒
- Guardrails 集成实践:需手动补充 IAM 权限;主题策略可能误判合法查询;CDK 更新后需同步版本号避免版本冲突
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
WeKnora:微信生产级 RAG 框架开源
WeKnora 是腾讯微信团队于 2026 年 4 月开源的生产级 RAG 框架(MIT 协议),内置 Ollama 支持,提供两大特色能力:
- 自主推理 Agent:复杂查询先拆解为子任务再检索,而非直接丢给 LLM
- 自更新知识库:指向 URL 或文件夹并设定刷新间隔,自动监控源变化并更新
部署仅需 5 分钟(支持已有 Ollama 或全新 Docker 安装),同时提供 REST API 可接入 n8n 等工作流。目前英文文档较少,社区主要在微信与知乎。
GitHub
#开发者 #工具
📢 频道:@DevToolboxHub
WeKnora 是腾讯微信团队于 2026 年 4 月开源的生产级 RAG 框架(MIT 协议),内置 Ollama 支持,提供两大特色能力:
- 自主推理 Agent:复杂查询先拆解为子任务再检索,而非直接丢给 LLM
- 自更新知识库:指向 URL 或文件夹并设定刷新间隔,自动监控源变化并更新
部署仅需 5 分钟(支持已有 Ollama 或全新 Docker 安装),同时提供 REST API 可接入 n8n 等工作流。目前英文文档较少,社区主要在微信与知乎。
GitHub
#开发者 #工具
📢 频道:@DevToolboxHub
用 Docker 加固镜像保护 Node.js AI 应用供应链
---
Node.js AI 应用的攻击面远大于传统应用,基础镜像、依赖安装、运行时权限等每个环节都可能引入风险。一个实用的安全做法是从基础镜像开始加固:使用 Docker Hardened Images 作为基座,配合多阶段构建、依赖锁定、非 root 用户和运行时限制来降低攻击面。
关键实践要点:
- 使用固定版本或多阶段构建,避免
- 永不将 API 密钥、GitHub Token 等敏感信息写入镜像层,通过 secret manager 注入
- 运行时开启只读文件系统、丢弃所有 Linux capabilities、设置资源上限,并使用 Docker Scout 定期扫描 SBOM 与漏洞
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
---
Node.js AI 应用的攻击面远大于传统应用,基础镜像、依赖安装、运行时权限等每个环节都可能引入风险。一个实用的安全做法是从基础镜像开始加固:使用 Docker Hardened Images 作为基座,配合多阶段构建、依赖锁定、非 root 用户和运行时限制来降低攻击面。
关键实践要点:
- 使用固定版本或多阶段构建,避免
node:latest;最终镜像只包含生产依赖与编译产物- 永不将 API 密钥、GitHub Token 等敏感信息写入镜像层,通过 secret manager 注入
- 运行时开启只读文件系统、丢弃所有 Linux capabilities、设置资源上限,并使用 Docker Scout 定期扫描 SBOM 与漏洞
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
多租户数据隔离:Cognito+PG RLS
通过 Postgres 会话变量
- Cognito 利用 Pre-Token Generation Lambda 在 JWT 中注入 tenantId,API Gateway 原生验证签名,确保身份可信
- Lambda 解析 JWT 后调用
- 数据库表启用 RLS,策略
- S3 对象存储通过
原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
通过 Postgres 会话变量
app.current_tenant_id 结合 Row-Level Security,在数据库层自动隔离租户数据,避免因漏写 WHERE 子句引发的跨租户数据泄露。- Cognito 利用 Pre-Token Generation Lambda 在 JWT 中注入 tenantId,API Gateway 原生验证签名,确保身份可信
- Lambda 解析 JWT 后调用
set_config('app.current_tenant_id', tenantId, false) 设置会话变量- 数据库表启用 RLS,策略
USING (tenant_id = current_setting(...)) 自动过滤每行,应用用户非 superuser 确保策略生效- S3 对象存储通过
{tenantId}/{documentId}/... 前缀隔离,IAM 限制 s3:ListBucket,三层独立防御原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Sift: AWS多租户AI文档平台架构解析
开发者Josh Blair发布了Sift的架构详解——一个全服务器less、多租户RAG文档平台,月成本约$10-15。
核心设计要点:
- 技术栈:Aurora Serverless v2 + pgvector(替代专用向量数据库),Step Functions Express工作流,Amazon Bedrock(Titan Embed v2 + Claude Haiku 4.5),Cognito认证,SAM而非CDK。
- 多租户隔离三层:Cognito JWT自定义声明、S3键前缀、PostgreSQL行级安全(RLS)。
- 成本优化:Aurora自动暂停降至~$7/月,Bedrock ~$2-5,其余免费层。
- 该系列共6篇,后续深入认证、Step Functions管道、RAG、前端及CI/CD。
原文
代码:GitHub
#开发者 #工具
📢 频道:@DevToolboxHub
开发者Josh Blair发布了Sift的架构详解——一个全服务器less、多租户RAG文档平台,月成本约$10-15。
核心设计要点:
- 技术栈:Aurora Serverless v2 + pgvector(替代专用向量数据库),Step Functions Express工作流,Amazon Bedrock(Titan Embed v2 + Claude Haiku 4.5),Cognito认证,SAM而非CDK。
- 多租户隔离三层:Cognito JWT自定义声明、S3键前缀、PostgreSQL行级安全(RLS)。
- 成本优化:Aurora自动暂停降至~$7/月,Bedrock ~$2-5,其余免费层。
- 该系列共6篇,后续深入认证、Step Functions管道、RAG、前端及CI/CD。
原文
代码:GitHub
#开发者 #工具
📢 频道:@DevToolboxHub