AI知识库 @ai521
321 subscribers
21.9K photos
42 videos
19 files
839 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Hugging Face 一键接入 SageMaker Studio,简化模型开发流程

Hugging Face 与亚马逊 SageMaker AI 宣布推出一项深度链接集成功能。开发者现在可以直接在 Hugging Face 模型页面上点击"自定义"或"部署"按钮,一键跳转至 SageMaker Studio 工作环境。所选模型会自动预加载,所有权限和配置也由系统自动完成,无需手动创建域、配置 IAM 权限或申请 GPU 配额。此前,从 Hugging Face 发现模型到在 SageMaker Studio 开始实验需要多个繁琐步骤,严重拖慢开发迭代速度。此次集成直接在支持的模型页面上添加了操作按钮,点击后即可跳转至已配置好的 SageMaker AI 控制台。新创建的环境预置了包括监督微调、直接偏好优化、可验证奖励强化学习及 AI 反馈强化学习在内的全套模型定制权限,并支持部署至 SageMaker AI 或 Amazon Bedrock 端点。对于现有 Studio 环境,系统也会提供引导链接帮助用户添加必要权限。Arcee AI 创始人表示,这一整合让开源模型从发现到企业级部署的最后一公里变得极为顺畅,开发者可以完全在自有 AWS 环境中进行实验。 #HuggingFace #SageMaker #AI #云计算 #模型部署
Amazon Nova 推出“选择性遗忘”技术,让AI模型精准合规

企业部署基础模型时常面临两难:内置的内容审核机制虽保障安全,却可能误伤合法业务需求,例如安全团队要求生成钓鱼邮件样本用于员工培训时,模型会因安全策略拒绝执行。亚马逊云科技发布Amazon Nova可定制内容审核设置(CCMS),通过逆向直接偏好优化(rDPO)技术实现模型的“选择性遗忘”。该技术在不重新训练的情况下,利用低秩适配(LoRA)适配器精准移除模型对特定策略的偏离行为,使模型在客户批准的政策领域生成内容,同时保持其他方面的对齐。核心挑战在于平衡:模型需在不再回绝目标内容的同时,维持指令遵循、编程、数学等通用能力,并保持非目标领域的合规。研究表明,直接微调可能损害模型质量,而rDPO通过优化偏好学习方法,有效减少过度回绝,提升业务实用性。 #亚马逊云科技 #AI合规 #模型遗忘 #大模型 #机器学习
xAI 推出语音智能体构建工具

据 xAI 官方发布,该公司推出了名为 Voice Agent Builder 的新型工具,用于构建语音智能体。该工具旨在简化语音交互功能的开发流程,支持用户通过自然语言指令创建定制化的语音助手。xAI 此前开发的 Grok 聊天机器人已集成语音对话、图像和视频生成、实时搜索及高级推理功能。此次推出的 Voice Agent Builder 进一步扩展了其 AI 生态,为企业及开发者提供了更便捷的语音应用开发平台。 #xAI #语音智能体 #AI工具 #Grok #科技新闻
AK-RAG 模式

大语言模型生成式检索增强生成(RAG)系统常会虚构不存在的字段名称,这在金融风控、医疗合规等强监管行业会导致严重的数据治理失败。传统 RAG 检索文档片段后允许 LLM 自由生成字段名,而 Attribute Knowledge RAG(AK-RAG)通过将企业治理属性目录索引为独立知识对象,使 LLM 只能输出实际存在的 attribute_id。该架构包含两条独立管道:数据摄入管道将 Excel、CSV 等属性元数据转化为可搜索的版本化索引;查询管道则将自然语言转译为已治理的领域特定语言,杜绝字段虚构风险。AK-RAG 改变了检索单元粒度,从按文档页面嵌入转向按单个属性嵌入,确保输出完全受控于数据治理目录。 #RAG #生成式AI #数据治理 #LLM #架构设计 #企业AI #合规技术
银行与超大规模企业齐声警告

国际清算银行(BIS)近日发布报告,警告人工智能泡沫可能破裂并拖累全球经济。这份被称为"央行的央行"的报告指出,当前AI领域吸引了远超实际产出的资本投入,与19世纪英国铁路狂热、运河投资泡沫以及互联网泡沫如出一辙。与此同时,最大AI曝光者之一甲骨文公司股价在过去一个月暴跌超过40%,市值蒸发显著。甲骨文近期也详细阐述了若AI发展不及预期可能面临的风险。大型超大规模企业持续投入巨额资本支出,推高了硬件成本,导致内存供应紧张,甚至影响消费者购买电脑。业内专家认为,这些迹象表明AI行业可能面临大规模收缩。本期播客特邀系统编辑Tobias Mann和资深记者Tom Claburn,深入分析了这一现象背后的逻辑与潜在影响。 #AI泡沫 #国际清算银行 #甲骨文 #资本市场 #科技投资 #超大规模企业 #经济风险
阿波罗首席经济学家警告

阿波罗全球管理公司首席经济学家托尔斯滕·斯洛克近日发出警告,指出目前人工智能领域存在投资回报不足的风险,市场可能需要进行一次“痛苦的重估”。他表示,尽管AI技术备受追捧,但实际应用中尚未产生足够的商业回报,投资者对AI的期望与现实之间可能存在巨大落差。斯洛克认为,这种高估值与低回报之间的张力,可能导致AI相关资产价格出现显著下调。他的观点反映出市场对于AI炒作泡沫的担忧正在升温,尤其是在全球科技股估值高企的背景下,投资人对AI企业的盈利能力和商业模式可持续性提出了更多质疑。 #AI #市场 #经济 #投资 #科技 #泡沫 #风险
AMD 发布 Ryzen AI Halo 本地 AI 工作站,起售价接近 4000 美元

AMD 近日推出 Ryzen AI Halo 迷你 AI 工作站,搭载 128GB 内存,旨在为用户提供本地运行和微调企业级 AI 模型的便捷体验。该产品对标英伟达 DGX Spark(当前售价 4699 美元),但受内存短缺影响,其价格从最初预期的 2000 美元涨至近 4000 美元。AI Halo 的主要卖点并非硬件革命,而是集成了预装软件、文档和针对 AMD HIP 及 ROCm 软件栈的优化,让用户能开箱即用运行 OpenClaw 和 Cline 等 AI 代理。相比传统搭建 128GB 显存工作站需花费 2 万美元,该设备仍具性价比。不过,其基于一年前旧款芯片,对于熟悉 Linux 和 AMD 生态的开发者吸引力有限。对于初次接触机器学习的用户,ROCm 和 PyTorch 兼容性问题仍是挑战,但 AMD 希望通过“AI 实验室集成化”方案减少配置烦恼。 #AMD #RyzenAIHalo #AI工作站 #本地AI #ROCm #硬件新闻 #人工智能
Dike:欧盟AI产品合规网关,一键实现审计级日志与报告

Dike是一款专为欧盟AI产品设计的合规网关服务,旨在简化企业在《欧盟AI法案》下的合规流程。用户只需更改基础URL,将LLM流量路由至Dike代理,即可自动获得审计级日志、人工监督记录和事件报告。该服务针对《欧盟AI法案》的重要时间节点(如2026年12月前的AI内容透明度义务、2027年12月前的高风险AI系统义务)提供支持。Dike能实时屏蔽PII信息、阻止恶意调用(如提示注入),并为标记内容添加AI生成标签。它支持RAG和聊天机器人场景,记录模型使用的参考文档,为Article 12(2)提供精确证据。人工审批、编辑和覆盖操作均作为一级事件记录,满足Article 14要求。严重事件触发15天报告倒计时(Article 73),自动生成向市场监督机构提交的报告。PII在网关层面即被去除,存储仅限欧盟境内,保留期默认6个月,可配置。系统设计为fail-open模式,即使审计存储不可用,网关仍传递请求,延迟小于毫秒级,支持流式传输。目前Dike处于封闭测试阶段,违法最高罚款为全球营业额的7%或3500万欧元。 #AI合规 #欧盟AI法案 #合规网关 #数据隐私 #LLM
Ekka:大语言模型推理中“静默错误”的自动诊断系统

现代大语言模型推理框架(如vLLM和SGLang)虽然功能强大,但也容易引入“静默错误”——这些错误不会引发崩溃或报错,却悄悄降低输出质量。研究人员从vLLM和SGLang的GitHub问题中收集了90个真实静默错误案例,发现最常见症状是基准测试分数下降(占43.8%),但症状与根本原因之间几乎无直接关联。例如,vLLM服务Gemma 3模型时,HellaSwag基准准确率下降30%,最终诊断耗时三个月才发现是注意力窗口配置错误。为此,研究团队开发了Ekka自动诊断系统。该系统将诊断视为差分调试:对齐并比较错误框架与可信参考框架的中间执行状态,精准定位偏离点。在vLLM和SGLang的17个真实错误上,Ekka实现了80%的首次诊断准确率,每次诊断成本约30美元,并已发现4个被开发者确认的新错误。该成果将在ICML 2026上展示。 #大语言模型 #静默错误 #自动诊断 #AI基础设施 #ICML2026
AMD Ryzen AI Halo 迷你主机正式发货,支持本地AI大模型与开源系统

AMD Ryzen AI Halo 迷你主机基于其顶级 Ryzen AI Max+ "Strix Halo" 平台打造,现已正式发货。该设备专为本地AI开发和推理设计,配备128GB统一内存(LPDDR5x-8000MT/s)和Radeon 8060S显卡,可运行高达2000亿参数的大语言模型。它采用紧凑且节能的设计(150×150×45mm,重约1.2千克,TDP 120瓦),性能可与英伟达 DGX Spark/GB10 媲美。机器可运行 Windows 11 或基于 Debian 定制的 AMD Ryzen AI 开发者平台 Linux 系统,并内置2TB PCIe Gen5 NVMe 固态硬盘。接口包括三个USB-C(支持电力传输和视频输出)、10GbE网口、WiFi 7、蓝牙5.4及HDMI 2.1b。评测者称,这款设备在其22年的Linux硬件评测生涯中,是发布一年后仍保持高度满意度的罕见案例。AMD未来还将推出基于 Ryzen AI Max 400 "Gorgon Halo" 的版本。 #AMD #RyzenAI #Halo #迷你主机 #AI #大模型 #Linux #开源
Hoto PixelDrive 电动螺丝刀降价至 60 美元,追平历史最低价

如果你在 Prime Day 购买了新桌子、电视柜、书架等尚未组装的家具,Hoto 推出的 PixelDrive 无线电动螺丝刀将助你加快组装速度。目前该产品在亚马逊上售价为 59.99 美元(优惠 20 美元),已追平其历史最低价。这款螺丝刀以其便携性和高效性能备受好评,适合日常家庭组装和维修任务。 #Hoto #PixelDrive #电动螺丝刀 #亚马逊 #PrimeDay #家居工具 #科技产品
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025