AI知识库 @ai521
329 subscribers
22.3K photos
42 videos
19 files
854 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
AI红队测试

组织正加速部署AI助手、代理和面向客户的生成式AI系统,但传统安全方法已难以应对这些系统的新攻击面——它们不仅能生成内容,还能推理、使用工具、访问敏感数据并自主决策。Alice公司首席产品与工程官Avi Golan指出,保护代理AI需要根本不同的方法,AI红队测试正成为每项AI安全策略的关键层。通过真实案例和新兴攻击模式,他展示了组织如何利用AI驱动的对抗测试先于对手发现漏洞。前Google Cloud CISO Phil Venables强调领导者需关注AI安全范式的转变,医疗CISO Sandy Dunn则探讨了AI获取患者数据后的隐私风险。核心结论:AI系统通过所有常规检查并不意味着安全,必须使用AI驱动的红队测试来发现隐藏的缺口。 #AI安全 #红队测试 #代理AI #网络安全 #AI防御 #自主系统 #数据隐私 #GenAI #对抗测试 #安全策略
AI 破解图论领域20年未解猜想

近日,一项由研究者 Sepehr Assadi、Mangooqwq 等提出的成果在学术圈引发关注:他们借助AI技术(包括 Lean 形式化验证工具)成功证明了一个存在20年的图论猜想——在半流式匹配问题中,贪心算法可实现最优近似比。该猜想此前长期悬而未决,而AI通过生成并验证一个仅10行的核心算法,完成了关键突破。这一进展不仅深化了对图论中匹配问题的理解,也展示了AI在数学定理证明中的潜力,为算法优化与理论计算机科学提供了新的方法论。 #AI #图论 #数学猜想 #算法 #形式化验证 #Lean #科技突破
2026年三种搜索模型并存

当前网络搜索领域存在三种截然不同的模型:经典的关键词模型(如Google)、基于检索增强生成(RAG)的答案引擎(如AI Overview、Perplexity)以及纯对话式大语言模型(如ChatGPT)。它们并非进化替代关系,而是不同架构下的并行范式。关键词模型依赖爬虫、倒排索引和排序算法,本质是统计匹配,无法真正理解用户意图。RAG模型通过检索获取相关文档后由LLM生成自然语言答案,能整合多源信息,但面临检索质量不稳定、幻觉、透明度不足以及文本稀疏站点被低估等结构性难题。纯对话式LLM完全依赖训练数据中的概率分布生成内容,其架构本身就会导致幻觉——模型无法区分“事实”与“高概率预测”。2026年,网站建设者必须同时针对这三种模型优化内容结构,否则将面临流量损失。 #搜索模型 #关键词搜索 #RAG #对话式LLM #搜索引擎优化 #AI #幻觉 #网站建设 #2026趋势
Stoke 推出 AI 代理“紧急终止开关”

Stoke 发布了一项名为“Kill Switch”的新功能,用于防止 AI 代理失控运行。该工具允许用户为每个 API 密钥设置美元支出上限,在每次请求前检查预算,超限则直接返回 429 Budget exceeded 错误,代理可据此自行处理,而非事后审计。实时支出可通过 /v1/budget 端点查看,非流式响应中包含 stoke_cost 字段记录单次成本。流式响应也会累计费用,Stoke 会在流结束或客户端断开时根据提供商报告的用量结算;若提供商不报告用量,则基于估算计费并标记,避免出现零费用。该功能基于 Rust 实现,旨在帮助开发者在前端动态控制 AI 代理的调用成本。 #AI安全 #预算控制 #API管理 #Stoke #Rust #AI代理 #成本管理
Manzia AI 发布《2026年AI代理景观》研究报告

Manzia AI 在其信息门户上发布了关于2026年AI代理景观的研究报告。该报告专注于可信代理的研究、设计与部署模式,并推出了包含ATLAS、SAFE-A、TRACE三个层次的代理信任框架,分别借鉴了不同的信任体系。此外,网站还提供了相关文章、代理可靠性评估方法、SDK模式以及分阶段部署指南,旨在为AI代理的买家、用户、构建者、供应商和监管者提供横向架构参考。该平台强调长期建设、部署与基准测试可信代理。 #AI代理 #ManziaAI #信任框架 #2026 #研究报告 #ATLAS #SAFE-A #TRACE #科技
Nvidia 携手日本打造首个“国家级 AI”基础设施

据 TechRadar 报道,Nvidia 与日本企业联盟 Noetra(由 NEC、索尼、本田、软银等 44 家公司组成)共同推进 FRONTia 项目,该项目于 2026 年 6 月 30 日中标,将在五年内投资高达 1 万亿日元(约 61 亿美元)。FRONTia 旨在建设日本主权 AI 生态系统的核心,为开发先进多模态基础模型提供算力,重点推动物理 AI 在工业、医疗等领域的应用,涵盖机器人、数字孪生和 AI 代理。日本经济产业大臣赤濑良成表示,该项目将通过联合全球创新领导者(包括 Nvidia)与日本制造业专长,利用真实工业数据,“成为日本物理 AI 生态系统的核心”。Nvidia 创始人黄仁勋指出,“日本发明了现代制造业,现在正在建设推动下一次工业革命的 AI 工厂。”不过,该计划也引发批评,包括 Noetra 与政府的财务透明度不足,以及 Nvidia 作为战略竞争对手的参与。此外,AI 设施的庞大能源消耗也被视为潜在问题。Nvidia Vera Rubin AI 设施建成后将为国内模型开发商和企业提供多模态模型及 Nvidia 的 AI 软件库。 #Nvidia #AI基础设施 #日本 #物理AI #机器人 #多模态模型 #智能制造 #科技新闻
AI 编码模型对决

近日,Hacker News 上一项名为“AI World Bakeoff”的评测引发关注。开发者要求 9 个主流 AI 编码模型(Fable 5、GPT-5.6 Sol、Opus 4.8、Kimi K3、Grok 4.5、MiniMax M3、MiMo v2.5 Pro、Gemini 3.5 Flash 和 Qwen3.7 Max)在没有人类帮助的情况下,各自独立构建三个可探索的 3D 世界:黄金时段的漂浮岛群岛、赛博朋克雨城以及沉没的亚特兰蒂斯。每项输出需为一个自包含的 HTML 文件,仅使用 WebGL2 和程序化生成,不得引用外部资源。所有场景由编码代理在一次会话中自动生成并渲染,直观展示了各模型在复杂 3D 编程任务上的能力差异,也反映出当前 AI 在代码生成和实时渲染方面的进展与局限。 #AI #编码模型 #3D生成 #Fable5 #GPT5 #Opus #Kimi #Grok #MiniMax #Qwen
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025