AI知识库 @ai521
312 subscribers
21.7K photos
42 videos
19 files
833 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Show HN

一位开发者推出了一个名为MCP服务器的工具,旨在让大语言模型(LLM)能够安全地访问数据库。该工具隶属于Polymr平台,允许LLM在建立上下文时自由执行SELECT查询,但在涉及数据修改操作时,开发者希望保留绝对控制权并充分了解LLM的意图。其核心功能包括DML预览模式,让查询可以在实际执行前进行模拟,从而避免潜在风险。这一工具为AI代理与数据库的交互提供了更安全的方案,特别适用于敏感环境下的数据管理。 #AI安全 #数据库 #MCP #LLM #Polymr #技术工具
This media is not supported in your browser
VIEW IN TELEGRAM
Cy:AI同事入驻Slack,端到端完成工作并汇报

一款名为Cy的AI同事正式推出,它嵌入在Slack中,能够端到端处理销售、营销、财务、招聘、运营和支持等实际工作。用户只需用自然语言在Slack中下达指令,如“催收逾期发票”或“生成每周复盘”,Cy即可自动登录现有工具(CRM、邮箱、账本等),完成整个流程并直接返回结果至对话线程,无需学习新工具或组建专门团队。例如,Cy可自动触达150人、更新CRM,或追讨逾期账款并记录已回收金额。其核心理念是让软件主动完成工作,而非仅仅提供辅助。Cy安装仅需60秒,免费试用,且每完成一项任务都会学习形成可复用的技能。 #AI #Slack #AI助手 #自动化 #效率工具 #科技新闻 #产品发布 #工作自动化
Adam 发布开源 AI CAD 工具,推动机械设计代码化

来自 YC W25 孵化的初创公司 Adam 正式推出开源文本转 CAD 平台 CADAM。创始人 Zach 在 Hacker News 上介绍,该平台基于两大核心理念:AI 将成为机械设计的主要创作媒介,就像当前在软件开发中那样;最理想的 CAD 生成范式是将设计作为代码来生成(文本→代码→CAD)。CADAM 是一个 React 应用(基于 TanStack Start),后端采用 Supabase 处理身份验证、数据库和文件存储。这一开源项目旨在让机械设计师通过自然语言直接生成三维模型,降低传统 CAD 软件的使用门槛,加速产品设计流程。 #AI #CAD #开源 #机械设计 #YC #创业 #文本转CAD #人工智能
Snap 推出 2195 美元智能眼镜,CEO 称研发超 12 年

Snap 公司近日发布了其最新款智能眼镜 Specs,售价高达 2195 美元。Snap CEO 埃文·斯皮格尔在接受 CNBC 采访时透露,这款产品已研发超过 12 年,旨在“将计算带入现实世界”并“使其更人性化”。他表示,人们已经厌倦了屏幕,该设备能帮助用户更专注于周围的世界,而非低头看手机。 #Snap #智能眼镜 #可穿戴设备 #科技新闻 #AR
LLM 基准测试的真相

通用 LLM 基准测试(如 MMLU、HumanEval)得分亮眼,但对于绝大多数用 AI 构建流程和产品的企业而言,这些数据毫无意义。真正关键的是你的系统在实际任务中的表现。作者指出,依赖用户投诉来发现模型退化会错过大量静默失败——用户得到错误答案却默默放弃,或支持工单仅捕捉到部分质量下降。推荐的做法是编写反映具体任务、数据和失败模式的评估(Evals)。评估方法分为三类:LLM 作裁判(快速但带有偏见)、人工评估(黄金标准但昂贵)、以及任务特定自动化检查(推荐:速度快、确定性强、与系统实际需求挂钩)。在更换模型或提示词之前,应先明确定义“糟糕输出”是什么,并用代码实现可编程的检查,例如验证 JSON 格式、确保引用有依据、检查响应长度等。只有针对自身工作负载的定制化评测,才能真实衡量模型的好坏。 #LLM #AI #基准测试 #Eval #企业应用 #模型评估 #质量保障 #自动化测试 #实际落地
AI时代正在把FP64硬件从科学计算领域抽走

科学高性能计算(HPC)依赖双精度浮点运算(FP64),例如计算流体力学需要高精度解析多尺度物理。然而,AI训练和推理仅需低精度(8位甚至4位),两者硬件需求相悖。芯片厂商追逐利润更丰厚的AI市场,倾向削减FP64核心,转而投入低精度计算单元。NVIDIA H100的FP64为34 TFLOP/s,B200约40 TFLOP/s,而Blackwell取消了专用FP64张量核心;AMD MI300X的FP81.7 TFLOP/s,后续MI355X降至78.6;Intel取消独立HPC GPU,Jaguar Shores未公布FP64指标;消费级芯片NVIDIA N1X甚至完全不提FP64。唯一的逆流是AMD MI430X,专为欧洲百亿亿次超算设计,FP64超过200 TFLOP/s,但仅此一款产品。长期看,科学计算正面临硬件精度支持的削弱。 #AI #高性能计算 #FP64 #芯片 #NVIDIA #AMD #Intel #HPC #科学计算
Anthropic 高危 AI 模型因美国出口管制被迫下线

Anthropic 公司近日发布两款新型 AI 模型——Claude Fable 5 与 Mythos 5,后者具备发现软件漏洞并加以利用的双重能力,可能被恶意行为者滥用。美国政府随后依据出口管制指令,以“任何外国国民不得使用”为由要求下线。Anthropic 虽与白宫协商,但尚未达成恢复服务的协议。公司承认该模型是“双刃剑”,最初仅向特定工作组(Project Glasswing)开放 Mythos 5 预览版,并向公众推出经防护处理的 Fable 5。然而政府认为 Fable 5 的防护可被绕过,进而获取 Mythos 5 的全部能力,构成国家安全风险。网络安全专家指出,这一冲突只是暂时掩盖了更严峻的现实:其他公司甚至开源社区很快将推出类似能力的模型,Anthropic 并非孤例。OpenAI 也已开始私下发布网络安全模型。政策争论无法阻止技术趋势,社会必须为高危 AI 能力在未来6至24个月内广泛可用做好准备。 #AI #人工智能 #Anthropic #出口管制 #国家安全 #双重用途 #网络安全 #科技新闻 #Claude #Mythos
Rockstar宣布GTA V免费升级PS5和Xbox Series X

据Rockstar Games官方消息,在备受期待的《GTA VI》发售仅数月前,公司宣布将为玩家提供免费的《GTA V》次世代版本升级服务。从6月18日起,凡在PS4上拥有任意版本《GTA V》或在Xbox One上拥有数字版游戏的玩家,均可免费获取对应PS5或Xbox Series X/S版本,无需额外付费。此举被视为Rockstar在《GTA VI》发布前维持玩家热度的重要举措。此前的升级选项曾需要付费,本次免费升级政策适用于所有符合条件的玩家,但Xbox One实体版用户无法直接享受该优惠。 #GTA #Rockstar #免费升级 #游戏新闻 #PS5 #XboxSeriesX #GTAVI
AI Native 人机协同重构内容安全新范式|AICon 上海

AICon 2026 上海站将于 6 月 26 日至 27 日举行,以“构建可信赖、可规模化、可商业化的 Agentic 操作系统”为核心命题,汇聚清华、复旦等高校教授及阿里、腾讯、快手等头部公司技术专家。快手商业化技术部风控大模型负责人宫兆汉将分享《商业安全大模型 BLM:AI Native 人机协同重构内容安全新范式》。该自研大模型具备图文视频跨模态统一理解与细粒度营销意图感知能力,构建“精细拒绝—AI 修复—自动过审”的生成式安全闭环,将拦截终点转化为内容修复起点。通过 Multi-Agent 协同架构实现审核、回扫、验真全链路智能化,并采用 HITL 设计将人工介入聚焦于高价值例外处理,形成持续自进化的增强型安全体系。大会还将深入探讨多智能体协调、记忆管理、工程化落地等议题,为 AGI 时代的智能化风控基础设施提供新思路。 #AICon #AI #人机协同 #内容安全 #大模型 #快手 #BLM #Agent #HITL #多模态
Testkube 举办 AI 调试测试失败网络研讨会

Testkube 宣布将于2026年6月18日举办一场主题为“使用AI进行测试失败分析”的网络研讨会。该会议由 CTO Ole Lensmar 主讲,旨在解决大规模测试中常见的瓶颈——分析测试失败原因。研讨将涵盖如何利用AI进行失败分类、根因分析及稳定性检测;AI代理所需的有效上下文(日志、指标、工件、源代码及MCP服务器集成);处理大规模测试数据时成本、精度与隐私的权衡;以及从基础失败分类到自主修复的扩展策略。此外还将进行Testkube原生AI功能的现场演示。 #AI #测试 #调试 #Testkube #自动化 #软件测试 #网络研讨会
AI智能体凭证代理

随着企业广泛采用AI智能体处理自动化任务,如何安全管理其访问敏感凭证成为关键问题。凭证代理(Credential Brokering)是一种新兴方法,旨在通过集中管理、动态颁发和实时审计,避免将静态密钥直接嵌入智能体代码或配置中。该方案结合了秘密管理、PKI、PAM等技术,可有效降低凭证泄露风险。目前Infisical等平台已推出相关解决方案,支持与Vault等工具对比选择。专家建议,在部署AI智能体时应优先采用凭证代理架构,确保秘密不离开安全边界。 #AI安全 #凭证管理 #秘密管理 #智能体 #网络安全 #DevSecOps #最佳实践
客户流失模型的阈值选择,本质是一场定价决策

当流失模型预测某客户离开概率为0.4,而你的代码以0.5为阈值判定其留下时,你已做出了一个定价决策:你认为向本可留下的客户发送挽留offer的成本,恰好等于失去一个真正要离开的客户的代价。然而,对于IBM Telco数据集(Kaggle上最常被使用的流失数据集),这一默认阈值会导致成本估算偏差高达13倍。作者整理了36个公开分析报告,发现约九成只报告准确率或F1分数,仅一成多报告利润曲线,无一使用生存分析计算客户生命周期价值。按照标准20%测试集分割,每个客户的潜在损失约为86美元;若将比例放大至10万订阅用户规模,可挽回成本高达860万美元。文章指出,阈值决策依赖于生命周期价值(LTV),而生存分析是准确计算LTV的关键。通过公开的2026年B2C SaaS基准数据,作者演示了如何利用平均每用户收入、毛利率和获客成本计算分类错误的真实成本,并证明在SMOTE平衡数据上训练时,教科书式的贝叶斯最优阈值公式不如暴力搜索有效。 #客户流失 #机器学习 #定价决策 #数据科学 #SaaS #生存分析 #成本优化 #AI商业应用 #客户生命周期价值