AI知识库 @ai521
712 subscribers
30.2K photos
59 videos
27 files
1.25K links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Show HN:新工具可生成海量域名列表供 LLM 排序筛选

随着优质 .com 域名日益稀缺,现有域名生成工具往往只能基于搜索词盲目猜测上下文。近日有开发者推出了一款新工具,可批量生成大量可用的域名组合,并支持导出 CSV 文件,让用户借助 ChatGPT、Claude 等大语言模型从中筛选出最佳选项。该工具内置域名生成器,支持自定义词表或上传自有词汇,同时兼容替代域名后缀。用户仅需一次搜索,即可生成超过 5 万个候选域名,再由 LLM 快速扫描并评估其价值,大幅提升域名挖掘效率。 #ShowHN #域名 #LLM #AI #工具 #创业 #科技
LLM 表现差异源于需求复杂性

不同用户对大型语言模型的体验存在显著差异,有人觉得变革性,有人觉得无能。本文认为,除了技能和态度外,关键问题在于需求本身。LLM 在需求少且目标宽泛时表现优异,例如“氛围编程”、安全漏洞测试和短篇创意写作;但在需求多且复杂时则力不从心,如代码维护、面向技术读者的写作、代码库演进和深度研究。原因在于 LLM 倾向于生成接近训练数据中位数的方案,当需求模糊时,其自由度恰好契合这一特性,而需求密集时,模型难以平衡交叉依赖、历史背景和微妙细节。作者假设,衡量 LLM 与需求的关系,比单纯褒贬技术更能解释其能力边界。 #LLM #大模型 #AI #技术写作 #需求分析 #代码维护 #人工智能
Just how big is the hidden leverage of AI hyperscalers?

Then $75 per month. Complete digital access to quality FT journalism on any device. Cancel or change your plan anytime during your trial. Get essential digital access to quality FT journalism on any device. Pay a year upfront and save 20% Complete digital access to quality FT journalism with expert analysis from industry leaders. Pay a year upfront and save 20%. Check whether you already have access via your university or organisation. Terms & Conditions apply Discover all the plans currently available in your country Digital access for organisations. Includes exclusive features and content.
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
AI幻觉检测新方案

一家初创公司推出API,可为前沿大模型生成的每个token返回幻觉分数。由于GPT、Claude等黑盒模型不开放内部状态,该公司采用白盒代理模型方案:使用Gemma-4重放目标模型输出,并基于其隐藏状态训练探针,以判断模型是否处于“困惑”状态。在验证集上,该探针与裁判LLM的判定一致率超过95%。API兼容现有黑盒模型调用,只需替换接口地址和密钥,即可在返回结果中附带逐token的幻觉评分。示例显示,模型正确识别新任教皇,但对参选枢机人数产生幻觉并被准确标出。相比裁判LLM方案,该方法成本更低、延迟更小,但分数反映的是代理模型的状态而非原模型本身。 #AI #大模型 #幻觉检测 #API #白盒模型 #科技新闻
McMaster 工业用品平台展示全品类产品分类

McMaster 网站日前展示了一套完整的工业用品分类体系,覆盖研磨抛光、建筑维护、电气照明、加工制造、紧固连接、过滤、流体控制、家具存储、手动工具、五金、加热冷却、润滑、物料搬运、测量检测、办公用品、管道管件、水暖清洁、动力传输、压力温度控制、起重吊装、原材料、安全防护、锯切切割、密封及运输等众多领域。在紧固与密封大类下,细分有螺栓、螺母、垫圈、销钉、锚固件、粘合剂、胶带等;动力传动部分则包含轴承、电机、减速机、链条、皮带、齿轮、液压及气动元件等。整体来看,该平台面向工业制造与设备维护场景,提供从基础原材料到专业工具的一站式产品导航,便于采购人员按类别快速查找所需物料,体现了其作为工业用品供应平台的高覆盖度与专业化组织能力。 #工业品 #MRO #McMaster #五金工具 #产品分类 #紧固件 #采购 #电商平台
Stoa Markets 发布 GPU 与 AI 服务器交易市场,解决硬件价格发现与交易对手风险

Stoa Markets 作为 YC S26 孵化的创业公司,正式推出面向 GPU 和 AI 服务器的交易平台,旨在应对市场分散、价格信号不透明和交易对手风险高等问题。平台整合 OEM 分配、云容量、经纪商、运营商及二手卖家等多方供应,通过标准化流程提供明确报价、绑定交易和全程记录。买卖双方可用自然语言描述硬件或上传报价 PDF,AI 辅助起草询价单,并与验证过的交易对手完成交易。结算流程包含付款、发货、验收等时间节点,资金在交付确认前由平台托管。目标用户涵盖 GPU 经纪商、数据中心运营商、AI 实验室、企业、转售商及资本方,目前平台已开放访问申请。 #StoaMarkets #GPU #AI服务器 #YC #创业 #交易平台 #价格发现 #AI硬件
欧盟AI法案GPAI条款正式执法,违规最高罚全球营业额3%

欧盟《人工智能法案》中针对通用目的AI(GPAI)模型的执法机制于2026年8月2日正式生效。欧盟AI办公室现可对违规提供者处以最高全球年营业额3%或1500万欧元的罚款,并有权要求提交技术文档、独立开展模型评估、责令整改,乃至要求相关模型退出欧盟市场。这些义务自2025年8月2日已在法律层面存在,但此前缺乏监管执行机构。对于被认定具有系统性风险的模型(训练算力超过10^25 FLOP),还需承担模型评估、对抗性测试、建立安全框架、向AI办公室报告严重事件以及保护模型权重等更严格义务。自愿性行为准则可换取监管“轻触”,但无法豁免责任。2025年8月2日前已上市的模型可宽限至2027年8月2日合规。与此同时,欧盟配套的《产品责任指令》从民事层面引入严格责任,形成监管罚款与司法索赔双重夹击,显著加大AI开发者的合规压力。 #欧盟AI法案 #GPAI #AI监管 #人工智能 #合规 #科技新闻
评估AI代理编排平台的五个关键考量

AI代理编排平台用于协调基于角色和任务的AI代理及其依赖的工具、数据和人员,形成多步骤工作流。随着企业将AI代理从少量扩展至数千个,这类平台的重要性日益凸显。MCP(模型上下文协议)和A2A(代理间协议)是两个关键开放标准,分别赋予代理受控访问工具与数据的能力,以及发现并委托其他代理的能力。编排层则在其上提供路由、共享状态、护栏、治理、安全和可观测性。目前市面上已有超过60个商业及开源平台。专家指出,评估平台时应重点考察:管理员能否对自主决策实施有效控制与护栏,并明确人工介入的时机;平台是否从架构之初就内置治理与可观测性,管理好上下文访问;以及代理与企业资源交互时能否保持可信和合规。这些考量直接关系到AI代理规模化部署的风险与价值平衡。 #AI #代理编排 #MCP #A2A #企业技术 #可观测性 #AI治理 #科技新闻
超半数 AI 生成的补丁存在缺陷

据 CyberScoop 报道,1Password 研究人员测试了 OpenAI ChatGPT 5.5 和 Anthropic Claude Opus 4.8 两款商业模型的漏洞修复能力,结果显示其生成的补丁成功率不足一半。研究人员要求模型修复六个“高影响、高复杂度”的 CVE 漏洞,包括可让攻击者获得 Linux 云环境 root 权限的内核缺陷“Copy Fail”,最终完全修复且未引入新问题的成功率仅为 47%。测试发现,模型常只修复部分漏洞路径,添加的防护代码虽能通过测试却未解决根本问题,有时还会改变应用行为。另一份来自 Veracode 的报告也指出,AI 生成代码的安全通过率平均仅约 56%,在 44% 的测试中模型引入了新的 OWASP Top 10 漏洞。研究人员认为,完全自主的漏洞发现与修复在当下尚不可靠,仍需人类专家介入把关。 #AI安全 #漏洞修复 #大模型 #网络安全 #技术新闻
AI 工作流构建器之死

曾被视为AI代理未来方向的可视化无代码编辑器,在不到一年内便被编码代理所取代。2025年10月,OpenAI推出Agent Builder,当时业界普遍预测团队将通过拖拽节点、工具和护栏来构建代理,而非编写编排代码。同期,微软在Copilot Studio中推出可视化代理流程,谷歌也发布了Vertex Agent Designer。然而如今这些工具均已弃用或关闭。多家初创公司的AI工作流构建器也相继停运或被收购。根本原因在于模型能力快速提升:Claude Opus 4.5发布后,Claude Code和Codex等编码代理迅速崛起,模型在规划、工具调用和长指令遵循方面表现更好,能自行创建和维护确定性工作流代码,比在界面中配置复杂图更简便。Flowise在停运公告中直言“开发者已转向编码代理”。未来方向可能是确定性工作流脚本,配合稳健的代理封装,在脚本失败时自动介入修复。Kadoa已用此方法构建自愈式网页数据管道,但大规模运行与维护仍面临挑战,确保可验证输出依然困难。 #AI #工作流 #编码代理 #无代码 #技术趋势 #OpenAI #Claude
我并非反AI,但显然对大模型炒作持有疑虑

作者坦言对当前大语言模型的炒作持强烈批评态度,却不愿自称“反AI”,因为“AI”与“反AI”两个概念均存在定义模糊。他坚决反对炒作背后的核心假设:将词共现频率的统计模型当作通用问答、文本或代码生成工具的基础。即便模型使用创作者明确授权的文本训练、完全依靠可再生能源运行,他依然认为这不是好主意。商业大模型无视授权与版权、消耗惊人资源,只是让原本就根本性的问题雪上加霜。为此,他提议一套替代性命名来准确表达立场。文章还回顾了“人工智能”一词源自1956年达特茅斯会议,最初泛指用计算机模拟人类思维效果的各种尝试,早期多为规则系统,随后才发展出机器学习等路径。 #AI #大模型 #LLM #人工智能 #技术批判 #机器学习
AI能否追随爱因斯坦的脚步?arXiv新论文探讨AI科学创造力

预印本平台arXiv近日收录了一篇题为“Can AI Follow In Einstein's Footsteps?”的研究论文,作者为Michael Shalyt、Nathan Regev、Marin Soljačić和Ido Kaminer。该论文以爱因斯坦的科学思维为参照,探讨人工智能在基础科学发现中可能扮演的角色。论文页面显示,其内容涉及物理学与计算机科学的交叉领域,并提供PDF和HTML等阅读格式。目前论文的具体摘要尚未在抓取信息中呈现,但标题所示的问题指向AI与人类创造力之间的对比,也反映了学术界对AI能否独立提出重大科学理论的持续关注。 #AI #爱因斯坦 #arXiv #物理学 #人工智能 #科学发现 #科技论文 #大模型