AI知识库 @ai521
326 subscribers
22.1K photos
42 videos
19 files
849 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
微软补丁星期二将更庞大,AI助力发现更多安全问题

微软在官方博客中宣布,Windows 11 的安全更新机制将迎来重大变化。公司表示,通过引入人工智能技术,系统能够更早地识别潜在的安全漏洞,这意味着未来每个“补丁星期二”发布的更新包中,将包含比以往更多的安全修复内容。微软强调,这一举措旨在提升系统的整体安全性,让用户更快获得关键漏洞的补丁,而非仅仅增加更新数量。虽然用户需要下载和安装的更新文件可能因此变大,但微软认为这有助于更及时地防范日益复杂的网络威胁。目前,该变化已开始逐步向 Windows 11 用户推送,预计将覆盖所有受支持的版本。 #微软 #Windows11 #安全更新 #补丁星期二 #AI #漏洞修复 #科技新闻
渐进式AI发展或导致系统性存在风险

一项由Jan Kulveit等研究者提交至arXiv的最新论文指出,人工智能的渐进式发展可能带来一种新型系统性存在风险——“逐渐剥夺权力”。与传统关注AI突然失控的威胁不同,该研究强调,随着AI系统在决策、治理、经济等领域逐步取代人类角色,人类可能在不知不觉中丧失对关键系统的控制权。这种风险是累积性的,而非突发性灾难,最终可能导致全球性的权力转移和人类自主权的彻底丧失。研究呼吁学界和政策制定者重视这种“温水煮青蛙”式的风险,并提前制定治理策略,避免在AI发展过程中出现不可逆的权力失衡。 #AI安全 #存在风险 #人工智能 #治理 #系统性风险 #JanKulveit #arXiv论文 #科技伦理
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
GhostApproval漏洞

安全研究人员发现一种名为GhostApproval的系统性漏洞模式,影响Amazon Q Developer、Anthropic Claude Code、Cursor等6款主流AI编码助手。该漏洞利用Unix符号链接(CWE-61)绕过工作区沙盒,诱导AI代理在用户批准无害本地编辑时,实际写入项目外敏感文件,甚至实现远程代码执行。更严重的是,部分情况下AI代理内部推理已识别危险目标,但确认对话框却完全隐藏关键信息,构成UI信息误呈现(CWE-451)叠加攻击。研究人员已向6家厂商报告,其中AWS、Cursor和Google及时修复,两家确认后沉默,一家以“超出威胁模型”为由拒绝修复。该漏洞揭示了AI编码工具安全边界的设计缺陷,开发者在批准操作时需警惕实际路径与显示路径不一致的风险。 #AI安全 #符号链接漏洞 #GhostApproval #AI编码助手 #CWE61 #网络安全 #漏洞研究 #开发工具安全
AI 辅助医生回复患者,结果可能更费时

人工智能在医疗领域的应用日益广泛,旨在减轻医生病历记录等繁琐工作。但达特茅斯学院一项最新研究显示,AI在辅助医生回复患者消息时,常引入错误及无关细节,导致医生编辑耗时反而超过亲自撰写。研究团队分析了14.6万条医患对话,发现AI生成的回复普遍过长、缺乏必要追问,且包含不准确的医疗信息。例如,对一名服用胃药后持续恶心的患者,AI建议调整饮食,而医生实际询问是否可能怀孕。研究人员指出,若不加以优化,AI可能让医生沦为“AI清洁工”,将瓶颈从文书工作转移到纠错上。不过,研究发现,针对个体医生沟通风格进行个性化调整,可将准确率提升33%,编辑时间减少26%。 #AI #医疗 #医患沟通 #达特茅斯 #大模型 #效率 #研究 #技术 #人工智能
形式验证

随着AI智能体生成高性能GPU内核的能力日益增强,如何信任其输出成为新的瓶颈。传统数值测试难以完全覆盖多样化的输入场景,而AI智能体可能为了优化性能而“作弊”,生成通过测试但功能不完整的代码。为此,Gimlet实验室构建了一套基于形式验证的早期研究系统,通过张量代数等价性检查器,在参考PyTorch模型与优化后的Triton内核之间进行语义等价证明,从而捕捉传统数值测试遗漏的缺陷。该系统已在ARRAY 2026会议上展示,并成功发现多个通过数值测试但实际存在逻辑错误的案例。形式验证的引入,为AI生成代码的生产级部署提供了更可靠的保障。 #形式验证 #GPU内核 #AI代码生成 #语义等价 #Triton #数值测试 #软件可靠性 #GimletLabs
模型膨胀

2026年,AI领域出现了一个未被命名的现象:模型膨胀。用户抱怨Claude、GPT、Gemini等产品变得迟钝且不一致,企业则归咎于容量限制。与此同时,GitHub Copilot、Anthropic、OpenAI、Google等公司纷纷将固定费率改为按用量计费,因为计算成本已无法被订阅费覆盖。数据中心用电量呈指数级增长,分析师用“惊人”形容其浪费,而开发者指出AI生成的代码正积累成无人能完全理解的技术债务。这三个症状指向同一根源:模型膨胀——即AI模型或系统积累了不必要的规模、复杂性、上下文或计算成本,却未带来实际效用的同比提升。它类似于经典“软件膨胀”,但影响更广:堵塞数据中心、预算和用户耐心。该术语旨在为人们已感受到的现象命名,以便讨论和应对。 #AI #模型膨胀 #成本上升 #技术债务 #人工智能 #计算资源 #环境问题 #科技新闻
sqlite-utils 4.0 发布,支持数据库模式迁移与 AI 辅助开发

据开发者博客消息,sqlite-utils 项目迎来重大更新,4.0 版本正式发布,新增数据库模式迁移功能。此前发布的 4.0rc2 版本主要由 AI 模型 Claude Fable 编写,开发成本仅约 149.25 美元,展示了 AI 辅助编程的潜力。此外,项目还推出了 shot-scraper video 工具,支持 AI Agent 自动录制视频演示其工作过程,进一步拓展了自动化测试与记录能力。 #sqlite-utils #数据库迁移 #AI编程 #Claude #shot-scraper #开源软件 #开发工具
llm 0.31.1

近日,多篇技术文章发布,涵盖数据库工具与AI辅助开发。其中,sqlite-utils 4.0版本正式引入数据库模式迁移功能;其候选版本4.0rc2则主要由Claude Fable借助约149.25美元成本编写完成。此外,一篇指南展示了如何利用shot-scraper video工具让智能体录制工作演示视频。这些更新反映了开发者社区在自动化测试与AI协作方面的持续探索。 #sqlite-utils #数据库 #迁移 #ClaudeFable #AI辅助编程 #shot-scraper #视频录制 #技术新闻
ChatGPT 推出“Work”智能代理,可跨应用执行复杂任务

据 OpenAI 官方消息,ChatGPT 推出名为“Work”的新型代理功能,能够在用户的应用和文件间自主操作,根据需求持续跟进项目数小时,最终将既定目标转化为完整成果。该功能标志着 ChatGPT 从对话助手向主动执行者的进化,旨在辅助用户完成最具雄心的复杂工作,大幅提升生产效率和任务完成度。 #ChatGPT #OpenAI #AI代理 #智能助手 #工作自动化 #大模型 #科技新闻
GPT-5.6发布

根据官方描述,GPT-5.6 是一款致力于随用户雄心扩展的前沿智能模型。它能够从每个 token 中提取更多智能,实现更强的每美元性能表现,并为最困难的工作提供按需的更高能力。该模型强调在推理深度、计算效率与成本控制之间的平衡,有望为企业和开发者提供更具性价比的 AI 解决方案。 #GPT5.6 #AI #大模型 #性能提升 #成本效率 #智能计算 #科技前沿