AI知识库 @ai521
373 subscribers
24.4K photos
45 videos
20 files
930 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
美国四座微型核反应堆达到临界里程碑

去年特朗普政府设定目标,要求在美国250周年生日前有三座微型反应堆达到临界状态(即实现自持链式反应)。结果不仅三座,而是四座反应堆恰好赶在7月4日截止日期前完成这一里程碑。Antares Nuclear率先在6月达到临界,随后Valar Atomics、Deployable Energy和Aalo Atomics相继成功。这是美国能源部反应堆试点计划的成果,该计划为原型反应堆提供土地和国家实验室支持,加速开发。然而,达到临界只是零功率测试,不产生实际电力,距离并网发电还需解决冷却系统等工程难题。各公司计划在2027-2028年部署商业反应堆,但专家对初创公司的进度表持谨慎态度,因为核能项目常面临监管和技术挑战。这一进展对全球清洁能源转型具有积极信号,但实际发电仍需时日。 #核能 #微型反应堆 #美国 #能源 #科技 #碳中和 #临界 #链式反应 #清洁能源
尚硅谷推出MCP与A2A协议实战课程,聚焦AI编程新标准

知名IT教育机构尚硅谷近日发布了一套以“MCP & A2A”为主题的实战课程,重点讲解Cursor和Claude AI编程的最新标准与应用。该课程旨在帮助开发者掌握模型上下文协议(MCP)和代理到代理协议(A2A),提升AI编程效率与互操作性。课程内容涵盖协议原理、实战案例与工具链整合,适用于具备一定编程基础的学员。此举反映了AI开发工具标准化趋势,为开发者提供了系统化学习路径。 #尚硅谷 #MCP #A2A #Claude #Cursor #AI编程 #实战课程 #IT教育 #开发者
Agent Draw:基于 tldraw 的 AI 智能体绘图工具,实现边讲边画

Agent Draw 是一款基于 tldraw 无限画布 SDK 构建的 AI 智能体工具,其核心功能是“边讲边画”——用户通过语音或文字描述,AI 即可实时在画布上生成相应图形。该工具利用大语言模型理解自然语言指令,并调用绘图 API 完成动作,适用于课堂演示、创意构思、远程协作等场景。开发者可将其嵌入网页或应用中,实现动态交互式绘图体验。目前该工具已开源,受到开发者社区关注,有望降低非专业用户的绘图门槛,提升内容创作效率。 #AgentDraw #tldraw #AI绘图 #智能体 #边讲边画 #开源工具 #内容创作 #科技新闻
Kastor:用 Terraform 风格声明式配置管理 AI 智能体

开发者在 GitHub 上推出了名为 Kastor 的创新开源项目,旨在将 DevOps 领域成熟的声明式配置管理理念引入 AI 智能体部署。受 HashiCorp Terraform 启发,Kastor 允许用户通过 YAML 或 JSON 配置文件定义智能体的行为、知识库、工具调用及依赖关系,实现基础设施即代码(IaC)式的智能体编排。项目支持多模型后端(如 OpenAI、Anthropic),并提供版本控制与可复现性,让开发者能像管理云资源一样管理 AI Agent 的生命周期。Kastor 的发布有望降低智能体工程的门槛,推动 AI 驱动的自动化与运维实践。 #开源 #AI智能体 #声明式配置 #Terraform #DevOps #Kastor #GitHub #AI运维 #自动化
开源本地 AI 工作台 Atrium:集成 MCP 与 Subagent 的桌面客户端

一位开发者为了积累 AI Agent 实践经验,构建并开源了一款名为 Atrium 的本地优先桌面客户端。该工具集成了 MCP 与 Subagent,旨在为用户提供一个高效、轻量的本地 AI 工作环境。Atrium 支持多种模型接入,能够离线运行,强调数据隐私与低延迟交互。项目已在 GitHub 上公开,吸引了不少开发者的关注,有望推动本地 AI 工具链的普及。 #开源 #AI #本地 #Agent #MCP #Subagent #开发者 #GitHub
中国阶跃星辰将推出AI Agent智能手机,AI竞赛转向设备端

据一财全球报道,中国AI初创公司阶跃星辰(StepFun)计划推出一款集成AI Agent的智能手机,这标志着AI技术竞争正从云端向终端设备转移。该举措顺应了行业趋势:将AI大模型直接部署于手机端,可降低延迟、保护隐私并增强离线能力。StepFun此前已发布多模态大模型,此次进军硬件领域,表明其希望抢占端侧AI入口。目前具体配置及发布时间尚未公布,但业界关注其如何平衡性能与功耗。 #阶跃星辰 #StepFun #AI智能手机 #AIAgent #端侧AI #科技新闻 #大模型
Claude 官方发布 Loops 入门教程,详解 AI 智能体循环设计

随着 AI Agent 能力增强,Loops(循环)成为热门概念。Claude 开发者官方账号发布 Loops 入门教程,将循环定义为智能体反复执行工作直到满足停止条件的过程。教程将循环分为手动循环、目标驱动循环和定时循环三类:手动循环由用户主导每轮交互;目标驱动循环通过定义成功标准让智能体自主迭代;定时循环则按指定间隔执行周期性任务。教程强调,并非所有任务都需要复杂循环,应从简单方案入手。为控制 Token 消耗,循环应有清晰边界,并建议将失败案例编码进系统,让未来迭代受益。Claude Code 还支持 auto mode 和动态工作流等高级功能。 #Claude #AI #Loops #智能体 #编程教程 #Token优化 #自动化
GPTZero 调查发现 KPMG 报告存在大量“幻觉引用”

GPTZero 调查团队利用其“幻觉检查”工具,对四大会计师事务所之一的 KPMG 于 2025 年 10 月发布的一份关于客户体验与智能体 AI 的报告进行了分析。报告题为《总体验:在智能体 AI 时代重新定义卓越》,其中引用了 45 条文献,但仅有 5 条准确指向真实来源;28 条引用的标题或部分信息被篡改,12 条过于模糊难以验证。此外,约一半被引用支持的主张实为虚假或错误归因,很可能是 AI 研究工具过度迎合指令所致。GPTZero 将此类现象称为“氛围引用”,指大模型在生成幻觉时意外编造虚假参考文献的行为,其严重程度不一。该调查揭示了咨询行业在引用规范上的漏洞,并引发对 AI 工具在专业报告中可靠性的质疑。 #GPTZero #KPMG #AI幻觉 #咨询报告 #虚假引用 #总体验 #智能体AI #新闻调查
LLM 雅可比指纹识别

研究人员开发了一种名为“作者2vec”的技术,通过分析大型语言模型(LLM)内部层的雅可比矩阵,实现对代码作者的精确识别。该方法利用开源代码的 git 历史,逐行提取作者写作风格,并使用代码嵌入模型生成“指纹”。通过将模型内部激活映射到输出,研究者发现这些指纹不仅存在于最终输出中,更存储在模型内部的雅可比矩阵里。在 13 位代码作者的测试中,基于内部雅可比读出的最近作者识别准确率达 50%,远超随机水平(8%),甚至高于直接输出识别(38%)。进一步分析表明,模型深层在中间层出现低秩“工作空间”瓶颈,指纹特征在此压缩。该技术可应用于代码溯源、版权保护及AI安全领域,揭示了LLM在训练过程中无意中编码了作者的独特写作模式。 #LLM #代码指纹 #雅可比矩阵 #作者识别 #AI安全 #技术新闻 #开源 #机器学习
调查:97%的网站未为AI Agent提供可用工具

一项针对近10,000个网站的分析显示,当前互联网尚未准备好迎接AI Agent时代。研究使用两组独立数据集,分别测试AI能否回答买家问题以及AI Agent能否在网站上执行操作。结果显示,在Agent可操作性方面,网站平均得分仅56分(满分100),仅有约7%的网站得分高于75。其中,AI工具类别(检查网站是否暴露WebMCP工具注册、MCP端点或API)平均得分仅为5分,97.4%的网站完全没有提供任何Agent可用的工具。这意味着AI Agent只能浏览页面,无法预订、查询订单或操作库存。与此同时,这些网站在HTTPS、移动端渲染等传统技术指标上平均得分高达98分,表明网站完成了过去十年的技术清单,却未为未来写下一行代码。另一项覆盖9,846个网站、52,158个答案的测试发现,AI回答买家问题的平均得分为67分,但在关键商业信息上表现极差:价格(43分)、取消/退款政策(33分)、注册流程(38分),而关于产品如何工作、适用人群等软性信息得分较高。约37%的扫描得分低于50分,40%高于75分,呈现两极分化。这些失败并非同一原因:网站可能在技术上优异,却在商业信息可回答性上糟糕。 #AI #Agent #网站 #技术 #商业 #工具 #MCP #可操作性 #调查 #互联网
Isnad 框架:用1200年伊斯兰逻辑为多智能体AI构建可信传播链

近日,开发者 Ali Zahid Raja 发布开源 Python 框架 Isnad,灵感源自1200年前伊斯兰教法中的“isnad”(传播链)概念,旨在解决多智能体AI系统中信息溯源与信任传递的难题。在多智能体协同工作流中,信息经过检索、摘要、撰写、校验等多个环节,一旦最终结果出现错误,往往难以定位是哪个环节引入了偏差。传统溯源系统虽能记录过程,但无法动态评估置信度的变化。Isnad 框架借鉴了古代学者评价传述链条的方法:每个智能体被视为一个“叙述者”,其可靠性被持续评估,信息通过独立链条交叉验证,从而让信任在传播过程中得以量化。该框架为构建更可靠、可解释的AI系统提供了新的历史视角,目前已在 GitHub 开源。 #AI #开源框架 #多智能体 #信任溯源 #伊斯兰逻辑 #Python #可信AI