AI知识库 @ai521
838 subscribers
30.3K photos
59 videos
27 files
1.26K links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
AI与月尘助力月球基地建设

本文探讨了在月球上建立永久定居点的可能性与挑战。虽然人类早在1969年就已登月,但真正的难题是如何“留下来”。从地球向38万公里外运输建筑材料成本高昂,并非可持续方案,因此利用月球表面的月尘等资源进行就地制造成为关键。这一思路正是NASA阿尔忒弥斯计划的核心目标。蓝色起源公司的“蓝色炼金术士”项目已于2025年9月通过关键设计评审,其目标是在2026年于模拟月球环境中完成全自主演示。月球环境极其恶劣,赤道地区表面温度昼夜温差超过250摄氏度,极地永久阴影区甚至低至零下250摄氏度。文中强调,AI在发现和设计新材料方面正发挥重要作用,而月尘有望转化为道路、实验室乃至住房等基础设施。 #月球 #AI #月尘 #太空探索 #NASA #BlueOrigin #阿尔忒弥斯 #材料科学 #工程
AI智能体运维挑战

当前科技界正热议将人工智能技术深度应用于服务器运维与部署环节,意图实现从代码拉取、依赖安装到配置修改等全流程的自动化操作,这一趋势引发了行业的广泛关注。AI智能体驱动的自动化部署方式,有望显著提升运维效率、减少人为失误,但同时也带来了新的安全边界挑战。文章探讨了在享受效率红利的同时,如何界定AI的权限范围、如何确保操作合规,以及如何在自动化与人工监管之间取得平衡。对于企业IT基础设施的稳定性而言,这些问题的答案至关重要,相关实践目前仍处于讨论与探索阶段。 #AI #智能体 #服务器运维 #自动化部署 #网络安全
Meta发布AI编程代理Muse Code,主打长时间运行与故障恢复

Meta推出基于新模型Muse Spark 1.2的AI编程代理Muse Code测试版,正式切入AI软件开发自动化赛道。与OpenAI、Anthropic等强调性能的竞品不同,Meta此次突出长时间自主运行与故障恢复能力。该工具可通过API和安装脚本使用,能够完成变更规划、代码编写与结果验证。其故障恢复机制会将模型调用、工具执行和代码修改记录进本地事件日志,系统出错后可从断点继续运行,并支持/plan、/grill、/goal等终端指令。基准测试显示,Muse Spark 1.2在主要编程基准上的成绩均低于Anthropic Opus 5,但在多数项目中领先OpenAI Codex与Google Antigravity。其中Terminal Bench 2.1得分为82.9%,DeepSWE 1.1得分为59.3%。Meta强调,在工具调用超千次的长时间运行场景下,其表现可提升至约61%至69%。官方演示中,系统在Nvidia Hopper GPU上连续运行24小时并不断优化GPU内核。此次发布使Meta加入Codex、DeepSeek等厂商的竞争行列,但长时自主运行带来的可预测性问题仍是行业待解课题。 #Meta #MuseCode #AI编程 #人工智能 #大模型 #软件开发 #科技新闻
我构建了一个AI数据智能体,可查询数据并回答业务问题

作者在上一篇文章中讨论了企业级AI数据平台的整合方案,并进一步以“牛油果销售分析智能体”为示例,详细展示了构建流程。数据智能体是一种基于AI的对话式界面,允许业务人员用自然语言提问,系统自动查询数据仓库并返回准确答案,例如“东南亚去年总支付额是多少?”即可直接得到结果。文章介绍了两种构建方式:一是使用LangGraph、CrewAI等开源框架从零搭建,可完全控制记忆和业务逻辑;二是在云数据平台中使用原生智能体,如Snowflake Cortex Agents、Databricks Genie和Microsoft Fabric Data Agents,适合初学者快速上手。作者选择Google BigQuery作为实验环境,因其免费试用期提供完整会话分析功能,并使用Kaggle上的牛油果价格数据集。构建步骤包括上传数据、理解表结构、创建智能体并编写关键指令等,强调数据模型理解是智能体正确分析的前提。 #AI #数据智能体 #数据仓库 #自然语言查询 #BigQuery #数据工程 #科技
Simon Willison 更新技术博客,分享 AI 工具与实验进展

知名开发者 Simon Willison 近日发布多篇技术博客,内容涵盖 AI 游戏开发、LLM 工具更新及 MCP 协议探索。他使用 Claude Fable 5 仅一次提示便成功生成“Raccoon Heist”游戏,展示了大模型在快速原型开发中的潜力。此外,其开源项目 LLM 推出新版本,新增推理追踪、OpenAI Responses 接口、服务端工具支持及更智能的日志功能,进一步提升了开发者的调试与集成体验。他还重新关注无状态 MCP 设计,并基于此构建了 mcp-explorer 与 datasette-mcp 两个工具,为 AI 代理与外部服务交互提供了更轻量的方案。 #SimonWillison #技术博客 #AI工具 #LLM #MCP #Claude #编程开发
软件巨头SAP因AI成本飙升暂停大部分差旅和招聘

据404 Media获得的一封SAP内部邮件,全球最大软件公司之一SAP上月暂停了大部分差旅和招聘,仅对AI相关的差旅或招聘例外。彭博社7月曾报道该措施,但一位现任员工表示禁令仍未解除,并透露公司正将一款新AI工具推广至全员,可能进一步推高成本。邮件称,为投资AI产品及数据领域收购,公司需严格管控开支,新招聘仅限核心AI岗位,内部旅行暂停,但面向客户及AI开发相关的差旅继续。邮件强调这些举措并非减少投入,而是有选择地投资关键领域。404 Media指出,花旗、Atlassian、Adobe、微软等公司也因AI成本上涨采取限制措施,如关闭部分模型访问、取消无限使用、设置预算等。SAP未回应置评请求。 #SAP #AI成本 #人工智能 #科技新闻 #企业动态 #软件行业
游戏测试显示

比利时开发者Alex Wauters设计了一款浏览器游戏,测试人类作为“人在回路”审核AI编码代理请求时的判断力。游戏模拟Claude Code等工具执行流程时的权限请求,玩家需在60秒内决定批准或拒绝。在超过4万次运行、约40.9万次决策中,玩家平均批准了三分之一的恶意请求。最容易漏掉的是范围违规类命令,如读取AWS凭证或Kubernetes配置文件,漏过率达35%;而如rm -rf等明显破坏性命令最易被识别。最常被漏掉的恶意命令是npm run analyze,尽管游戏日志会展示其实际内容,仍有近65%的玩家选择批准。开发者指出,大量琐碎请求会造成决策疲劳,反而促使开发者使用跳过权限的选项,埋下安全隐患。 #AI安全 #人机协同 #编程工具 #网络安全 #科技新闻
OpenAI 研究员离职创业,专注开发“读心”AI

OpenAI 研究员 Naomi Bashkansky 已从公司离职,加入初创公司 Conduit,致力于开发能将人类思维转化为文字的 AI 技术。她的离开使 OpenAI 离职创业的研究员名单进一步扩大,此前包括联合创始人 Ilya Sutskever 创立的 SSI 等。Conduit 的目标是打造非侵入式脑机接口,通过分析大脑信号实现思想文本化,该技术有望在医疗、人机交互等领域带来革命性突破。 #OpenAI #AI #脑机接口 #创业 #科技新闻 #思想读取 #NaomiBashkansky
弱到强泛化

OpenAI 近日发布了一项名为“弱到强泛化”的新研究方向,旨在解决未来超级人工智能的对齐难题。该研究提出一个简单类比:能否利用深度学习泛化特性,让弱小的监督者控制强大的模型?实验表明,使用 GPT-2 级别的模型作为监督,可以激发出 GPT-4 的大部分能力,使其性能接近 GPT-3.5 水平,甚至在弱模型原本失败的困难问题上也能正确泛化。这一成果为超级对齐(superalignment)提供了直接可行的研究路径,即通过迭代实验逐步攻克未来超人类模型对齐的核心挑战。相关论文已被 ICML 接收为口头报告。 #OpenAI #弱到强泛化 #超级对齐 #AI安全 #大模型 #深度学习 #ICML
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
研究揭示围棋AI存在“对抗策略”漏洞,业余棋手可反制

一篇题为《我要拿锤子砸AI看看会发生什么》的文章,以国际象棋和围棋为引,探讨人工智能的脆弱性。作者Peter Curry在文中提到,国际象棋中棋手常利用时间压力和陷阱开局击败对手;而围棋引擎虽如AlphaGo、AlphaZero等通过强化学习达到超人水平,但近年研究发现,一种名为KataGo的强引擎存在对抗性策略,可被特定下法击败,但这些下法对业余棋手无效。这种被称为“AtakGo”的策略,揭示了AI在特定鲁棒性上的缺陷。 #AI #围棋 #对抗攻击 #KataGo #AlphaGo #科技 #人工智能