我构建了一个AI数据智能体,可查询数据并回答业务问题
作者在上一篇文章中讨论了企业级AI数据平台的整合方案,并进一步以“牛油果销售分析智能体”为示例,详细展示了构建流程。数据智能体是一种基于AI的对话式界面,允许业务人员用自然语言提问,系统自动查询数据仓库并返回准确答案,例如“东南亚去年总支付额是多少?”即可直接得到结果。文章介绍了两种构建方式:一是使用LangGraph、CrewAI等开源框架从零搭建,可完全控制记忆和业务逻辑;二是在云数据平台中使用原生智能体,如Snowflake Cortex Agents、Databricks Genie和Microsoft Fabric Data Agents,适合初学者快速上手。作者选择Google BigQuery作为实验环境,因其免费试用期提供完整会话分析功能,并使用Kaggle上的牛油果价格数据集。构建步骤包括上传数据、理解表结构、创建智能体并编写关键指令等,强调数据模型理解是智能体正确分析的前提。 #AI #数据智能体 #数据仓库 #自然语言查询 #BigQuery #数据工程 #科技
作者在上一篇文章中讨论了企业级AI数据平台的整合方案,并进一步以“牛油果销售分析智能体”为示例,详细展示了构建流程。数据智能体是一种基于AI的对话式界面,允许业务人员用自然语言提问,系统自动查询数据仓库并返回准确答案,例如“东南亚去年总支付额是多少?”即可直接得到结果。文章介绍了两种构建方式:一是使用LangGraph、CrewAI等开源框架从零搭建,可完全控制记忆和业务逻辑;二是在云数据平台中使用原生智能体,如Snowflake Cortex Agents、Databricks Genie和Microsoft Fabric Data Agents,适合初学者快速上手。作者选择Google BigQuery作为实验环境,因其免费试用期提供完整会话分析功能,并使用Kaggle上的牛油果价格数据集。构建步骤包括上传数据、理解表结构、创建智能体并编写关键指令等,强调数据模型理解是智能体正确分析的前提。 #AI #数据智能体 #数据仓库 #自然语言查询 #BigQuery #数据工程 #科技
Simon Willison 更新技术博客,分享 AI 工具与实验进展
知名开发者 Simon Willison 近日发布多篇技术博客,内容涵盖 AI 游戏开发、LLM 工具更新及 MCP 协议探索。他使用 Claude Fable 5 仅一次提示便成功生成“Raccoon Heist”游戏,展示了大模型在快速原型开发中的潜力。此外,其开源项目 LLM 推出新版本,新增推理追踪、OpenAI Responses 接口、服务端工具支持及更智能的日志功能,进一步提升了开发者的调试与集成体验。他还重新关注无状态 MCP 设计,并基于此构建了 mcp-explorer 与 datasette-mcp 两个工具,为 AI 代理与外部服务交互提供了更轻量的方案。 #SimonWillison #技术博客 #AI工具 #LLM #MCP #Claude #编程开发
知名开发者 Simon Willison 近日发布多篇技术博客,内容涵盖 AI 游戏开发、LLM 工具更新及 MCP 协议探索。他使用 Claude Fable 5 仅一次提示便成功生成“Raccoon Heist”游戏,展示了大模型在快速原型开发中的潜力。此外,其开源项目 LLM 推出新版本,新增推理追踪、OpenAI Responses 接口、服务端工具支持及更智能的日志功能,进一步提升了开发者的调试与集成体验。他还重新关注无状态 MCP 设计,并基于此构建了 mcp-explorer 与 datasette-mcp 两个工具,为 AI 代理与外部服务交互提供了更轻量的方案。 #SimonWillison #技术博客 #AI工具 #LLM #MCP #Claude #编程开发
软件巨头SAP因AI成本飙升暂停大部分差旅和招聘
据404 Media获得的一封SAP内部邮件,全球最大软件公司之一SAP上月暂停了大部分差旅和招聘,仅对AI相关的差旅或招聘例外。彭博社7月曾报道该措施,但一位现任员工表示禁令仍未解除,并透露公司正将一款新AI工具推广至全员,可能进一步推高成本。邮件称,为投资AI产品及数据领域收购,公司需严格管控开支,新招聘仅限核心AI岗位,内部旅行暂停,但面向客户及AI开发相关的差旅继续。邮件强调这些举措并非减少投入,而是有选择地投资关键领域。404 Media指出,花旗、Atlassian、Adobe、微软等公司也因AI成本上涨采取限制措施,如关闭部分模型访问、取消无限使用、设置预算等。SAP未回应置评请求。 #SAP #AI成本 #人工智能 #科技新闻 #企业动态 #软件行业
据404 Media获得的一封SAP内部邮件,全球最大软件公司之一SAP上月暂停了大部分差旅和招聘,仅对AI相关的差旅或招聘例外。彭博社7月曾报道该措施,但一位现任员工表示禁令仍未解除,并透露公司正将一款新AI工具推广至全员,可能进一步推高成本。邮件称,为投资AI产品及数据领域收购,公司需严格管控开支,新招聘仅限核心AI岗位,内部旅行暂停,但面向客户及AI开发相关的差旅继续。邮件强调这些举措并非减少投入,而是有选择地投资关键领域。404 Media指出,花旗、Atlassian、Adobe、微软等公司也因AI成本上涨采取限制措施,如关闭部分模型访问、取消无限使用、设置预算等。SAP未回应置评请求。 #SAP #AI成本 #人工智能 #科技新闻 #企业动态 #软件行业
游戏测试显示
比利时开发者Alex Wauters设计了一款浏览器游戏,测试人类作为“人在回路”审核AI编码代理请求时的判断力。游戏模拟Claude Code等工具执行流程时的权限请求,玩家需在60秒内决定批准或拒绝。在超过4万次运行、约40.9万次决策中,玩家平均批准了三分之一的恶意请求。最容易漏掉的是范围违规类命令,如读取AWS凭证或Kubernetes配置文件,漏过率达35%;而如rm -rf等明显破坏性命令最易被识别。最常被漏掉的恶意命令是npm run analyze,尽管游戏日志会展示其实际内容,仍有近65%的玩家选择批准。开发者指出,大量琐碎请求会造成决策疲劳,反而促使开发者使用跳过权限的选项,埋下安全隐患。 #AI安全 #人机协同 #编程工具 #网络安全 #科技新闻
比利时开发者Alex Wauters设计了一款浏览器游戏,测试人类作为“人在回路”审核AI编码代理请求时的判断力。游戏模拟Claude Code等工具执行流程时的权限请求,玩家需在60秒内决定批准或拒绝。在超过4万次运行、约40.9万次决策中,玩家平均批准了三分之一的恶意请求。最容易漏掉的是范围违规类命令,如读取AWS凭证或Kubernetes配置文件,漏过率达35%;而如rm -rf等明显破坏性命令最易被识别。最常被漏掉的恶意命令是npm run analyze,尽管游戏日志会展示其实际内容,仍有近65%的玩家选择批准。开发者指出,大量琐碎请求会造成决策疲劳,反而促使开发者使用跳过权限的选项,埋下安全隐患。 #AI安全 #人机协同 #编程工具 #网络安全 #科技新闻
弱到强泛化
OpenAI 近日发布了一项名为“弱到强泛化”的新研究方向,旨在解决未来超级人工智能的对齐难题。该研究提出一个简单类比:能否利用深度学习泛化特性,让弱小的监督者控制强大的模型?实验表明,使用 GPT-2 级别的模型作为监督,可以激发出 GPT-4 的大部分能力,使其性能接近 GPT-3.5 水平,甚至在弱模型原本失败的困难问题上也能正确泛化。这一成果为超级对齐(superalignment)提供了直接可行的研究路径,即通过迭代实验逐步攻克未来超人类模型对齐的核心挑战。相关论文已被 ICML 接收为口头报告。 #OpenAI #弱到强泛化 #超级对齐 #AI安全 #大模型 #深度学习 #ICML
OpenAI 近日发布了一项名为“弱到强泛化”的新研究方向,旨在解决未来超级人工智能的对齐难题。该研究提出一个简单类比:能否利用深度学习泛化特性,让弱小的监督者控制强大的模型?实验表明,使用 GPT-2 级别的模型作为监督,可以激发出 GPT-4 的大部分能力,使其性能接近 GPT-3.5 水平,甚至在弱模型原本失败的困难问题上也能正确泛化。这一成果为超级对齐(superalignment)提供了直接可行的研究路径,即通过迭代实验逐步攻克未来超人类模型对齐的核心挑战。相关论文已被 ICML 接收为口头报告。 #OpenAI #弱到强泛化 #超级对齐 #AI安全 #大模型 #深度学习 #ICML
从提问到执行:OpenAI 揭示全球用户如何将 ChatGPT 投入实际工作
OpenAI 最新发布的 Signals 数据报告首次从国家层面揭示了全球用户如何使用 ChatGPT。数据显示,ChatGPT 的用途正从简单的信息查询转向更复杂的任务执行,包括编程辅助、内容创作、数据分析及商业决策等。不同国家用户展现出差异化使用习惯:北美用户更侧重工作效率提升,亚洲用户则更多用于教育和创意生成。该报告基于大量匿名用户行为数据,反映了AI工具从“问答”向“行动”转变的全球趋势,也预示着AI应用场景正从个人娱乐向生产力工具深度渗透。OpenAI 表示,这些洞察将帮助优化模型以适应各地真实需求,推动AI技术的本地化落地。 #OpenAI #ChatGPT #AI应用 #全球趋势 #生产力工具 #数据洞察 #人工智能 #行为分析
OpenAI 最新发布的 Signals 数据报告首次从国家层面揭示了全球用户如何使用 ChatGPT。数据显示,ChatGPT 的用途正从简单的信息查询转向更复杂的任务执行,包括编程辅助、内容创作、数据分析及商业决策等。不同国家用户展现出差异化使用习惯:北美用户更侧重工作效率提升,亚洲用户则更多用于教育和创意生成。该报告基于大量匿名用户行为数据,反映了AI工具从“问答”向“行动”转变的全球趋势,也预示着AI应用场景正从个人娱乐向生产力工具深度渗透。OpenAI 表示,这些洞察将帮助优化模型以适应各地真实需求,推动AI技术的本地化落地。 #OpenAI #ChatGPT #AI应用 #全球趋势 #生产力工具 #数据洞察 #人工智能 #行为分析
Amazon Bedrock AgentCore 推出时间策略,增强 AI 代理安全管控
Amazon Bedrock AgentCore 引入时间策略(Temporal Policies),以应对 AI 代理与传统应用在行为上的根本差异。传统访问控制将每个操作视为独立事件,但 AI 代理在运行时动态决定调用哪些工具、参数和顺序,单一工具调用单独看可能安全,但在上下文(如读取不可信数据源后)中可能有害。时间策略在 AgentCore 网关边界运行,代理无法拦截或篡改,可基于会话历史中的先前事件评估当前请求的授权。该策略支持工作流顺序强制、防止工具调用间的数据伪造、限制每会话累积财务风险、要求高价值操作人工审批,以及无人工参与时自动收紧权限。时间策略对通过网关的模型上下文协议工具调用、代理间调用和模型推理调用统一生效,为开发者提供一致的代理行为管控点。 #AmazonBedrock #AI代理 #安全策略 #时间策略 #访问控制 #云安全 #AgentCore #MCP
Amazon Bedrock AgentCore 引入时间策略(Temporal Policies),以应对 AI 代理与传统应用在行为上的根本差异。传统访问控制将每个操作视为独立事件,但 AI 代理在运行时动态决定调用哪些工具、参数和顺序,单一工具调用单独看可能安全,但在上下文(如读取不可信数据源后)中可能有害。时间策略在 AgentCore 网关边界运行,代理无法拦截或篡改,可基于会话历史中的先前事件评估当前请求的授权。该策略支持工作流顺序强制、防止工具调用间的数据伪造、限制每会话累积财务风险、要求高价值操作人工审批,以及无人工参与时自动收紧权限。时间策略对通过网关的模型上下文协议工具调用、代理间调用和模型推理调用统一生效,为开发者提供一致的代理行为管控点。 #AmazonBedrock #AI代理 #安全策略 #时间策略 #访问控制 #云安全 #AgentCore #MCP