AI知识库 @ai521
342 subscribers
23.2K photos
42 videos
20 files
889 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
利用LLM代理黑客攻击Salesforce网站

安全研究公司Reco开发了一款基于大语言模型(LLM)的AI代理,能够完全自主地对Salesforce Experience Cloud网站进行端到端安全评估。该代理只需提供一个URL,即可自动发现攻击面、分析每个暴露端点、识别漏洞、编写并执行工作漏洞。研究人员将其指向多家大型科技公司的真实Salesforce网站,结果令人震惊:代理在那些投入大量安全资源的网站上发现了高危漏洞,从零编写了可运行的漏洞利用脚本,提取了真实数据,甚至自主从公共来源检索数据以构建有效载荷。该代理并非单一脚本,而是一个由LLM控制的智能管道,涵盖侦察、分析、利用和验证等阶段,无需人工干预即可推理、调整策略并做出判断。它首先通过Salesforce Aura框架枚举所有可访问的对象、Apex控制器方法、路由和内容,构建完整的攻击面地图,随后对每个对象进行敏感性分类,识别可能包含敏感数据的表。 #网络安全 #AI代理 #LLM #Salesforce #漏洞利用 #黑客攻击 #安全研究
AI 必须拥抱专业化,通过超人类自适应智能实现突破

一篇来自 arXiv 的学术论文指出,人工智能的发展方向应从通用模型转向专业化,通过超人类自适应智能实现突破。论文作者 Judah Goldfeder 等人认为,当前 AI 系统在广泛任务中表现优异,但在特定领域仍存在局限,专业化路径能更高效地解决复杂问题。该研究强调,自适应智能可使 AI 在动态环境中快速调整,超越人类能力,从而在医疗、工程等关键领域发挥更大作用。论文已提交至 arXiv,并附带 PDF 和 HTML 版本供查阅。 #AI #专业化 #自适应智能 #学术论文 #arXiv
GPU 利用率谎言

凌晨两点,某基础设施团队因推理延迟突然飙升60%而收到警报。仪表盘显示GPU利用率看似正常,自动扩展启动后添加了更多节点,但延迟几乎没有改善,云账单却不断攀升。一小时后,真正的问题被发现:三个节点悄然进入降级RAID重建状态,存储吞吐量骤降,导致推理工作负载因数据饥饿而停滞。调度器仍将这些节点视为“足够健康”,因为GPU和内存指标尚可。这种故障在现代AI基础设施中日益常见,暴露了生成式AI系统下的深层幻觉:GPU可能忙碌却无产出。从表面看,用户向ChatGPT、Claude或Gemini发送提示后能迅速获得答案,但背后是巨大的协调难题——GPU执行张量运算,CPU处理请求和移动数据,HBM存储激活值和KV缓存,SSD流式传输嵌入和检索上下文,网络跨节点混洗梯度和推理流量,存储系统吸收重建、重试和后台工作。调度器决定工作负载运行位置,它悄然决定了集群是像连贯计算系统还是昂贵交通堵塞。GPU利用率是AI基础设施中最被过度信任的指标之一,高利用率可能掩盖资源以不可用组合存在的真相,导致有效容量低下。这不仅是调度算法问题,更是系统问题,也是经济问题。 #AI基础设施 #GPU利用率 #系统性能 #调度器 #存储瓶颈 #生成式AI #云计算
员工每周花费超6小时“照看”AI,加剧工作挫败感

据商业内幕网报道,一项最新调查显示,企业员工平均每周需花费超过6小时来“照看”人工智能系统,即监控、修正和调试AI输出结果。这种被称为“botsitting”的现象正日益普遍,不仅未能如预期般解放劳动力,反而增加了员工的工作负担和挫败感。许多受访者表示,AI工具经常产生不准确或无关的结果,需要人工反复核查与调整,这导致工作效率不升反降。专家指出,企业在部署AI时往往高估其自动化能力,而低估了人工监督所需的时间和精力,这种“人机协作”的失衡正在引发新的职场焦虑。 #AI #人工智能 #职场 #工作压力 #科技 #自动化 #员工体验
CitedBy 推出 AI 推荐跟踪服务,最低仅需 1 美元

一项名为 CitedBy 的新服务上线,旨在帮助企业追踪 AI 模型对其品牌的推荐情况。该服务能识别并修复导致企业在 AI 搜索结果中“隐身”的信号问题,从而将 AI 搜索转化为可预测的收入渠道。其定价策略从 1 美元起步,极具吸引力。随着 AI 推荐系统在商业决策中的影响力日益增强,这类服务为中小企业提供了低成本监测品牌可见度的新方式。 #人工智能 #AI搜索 #品牌监测 #企业服务 #科技新闻
玩家再次怀疑游戏使用了AI,这次轮到了《1666

开发商Panache Digital Games在Steam上发布了《1666:阿姆斯特丹》的可玩序章,玩家很快发现游戏画面中存在AI生成的痕迹。工作室在Reddit上承认,序章中的部分游戏内肖像和外部营销素材确实使用了早期版本的AI生成资产。他们表示正在审查相关资产,并将很快发布由人类艺术家重新制作的版本,同时承诺正式版游戏不会包含任何AI生成内容。然而,这种“先使用AI再替换”的做法引发了争议,玩家认为即便最终替换,AI仍被用于游戏开发过程。PC Gamer评论指出,随着夏季游戏节等大型活动到来,此类AI争议将越来越常见,开发商道歉后仍继续使用AI,让玩家不得不对每个新预告片进行AI侦探工作。尽管《1666:阿姆斯特丹》看起来确实很酷,但AI的使用已削弱了部分玩家的期待。 #游戏 #AI #争议 #1666阿姆斯特丹 #游戏开发 #玩家反应 #PC游戏
Fundamentalio 开源 AI 股票分析工具发布

一位开发者基于彼得·林奇的投资方法,构建了一款名为 Fundamentalio 的开源 AI 股票分析工具。该工具利用人工智能加速公司分析流程,旨在帮助投资者更高效地进行股票研究。开发者表示,未来还计划为其创建代理技能,使用户不再依赖网页应用。目前该工具已开源,并欢迎用户反馈。 #开源 #AI #股票分析 #投资工具 #彼得林奇 #科技
Fono 工具

开发者发布了一款名为 Fono 的语音前端工具,可完全在本地运行,无需云端、账户或音频外传。然而,本地大模型在对话中响应缓慢,首次回答需近3秒,第六轮对话时延迟接近7秒。文章深入分析了延迟根源:预填充阶段(模型读取提示)是主要瓶颈,而解码阶段(逐字生成)受内存带宽限制。通过优化,开发者成功将首字响应时间缩短至约三分之一秒。文章还揭示了常见错误,并提供了可复现的优化命令。 #本地大模型 #AI优化 #语音助手 #延迟优化 #技术博客
Show HN

该工具允许用户通过语音指令浏览网站。用户只需输入网站 URL、吉祥物名称及性格描述,并上传吉祥物图片,即可启动语音导航功能。系统基于 GPT 实时技术,可理解自然语言指令并执行页面跳转、内容搜索等操作,提升无障碍浏览体验。 #语音导航 #GPT #实时工具 #网站浏览 #无障碍技术
大模型校对能力评测

一项针对大语言模型校对能力的最新评测显示,Claude Fable 5 和 Claude Opus 4.6 在词汇选择、混淆词识别和习语用法等任务中表现突出,均取得满分成绩。评测数据集包含5个样本,主要考察模型对复杂英文文本中语法、用词和表达习惯的纠错能力。结果显示,Claude 系列多个版本(包括高、中、低配置)均达到100%正确率,Gemini 3.1 Pro Preview 也获得满分,而部分 Claude Opus 4.8 和 4.7 版本正确率在80%至86.7%之间。该评测为选择适合文本校对场景的AI模型提供了参考依据。 #大语言模型 #AI评测 #文本校对 #Claude #Gemini #自然语言处理
OpenAI 研究员揭示AI评测真相

OpenAI研究员Noam Brown发表长文,直指当前AI行业评测体系的根本缺陷。他指出,所有AI跑分排行榜都忽略了一个关键变量:推理计算量。同一个模型,在1美元和1万美元的推理预算下,表现天差地别。例如,GPT-5.5在100万token长度测试中得分74%,而GPT-5.4仅36.6%,但在标准benchmark中这一差异被完全掩盖。Brown认为,正确的评测方式应是绘制“性能vs推理计算量”曲线,而非给出单一分数。他警告,随着推理时计算成为标配,AI能力上限可能远超想象,但测量成本极高。这一观点颠覆了传统评估范式,暗示“超级智能”可能不是质变节点,而是资源投入的连续函数。 #AI评测 #推理计算 #OpenAI #GPT5 #人工智能 #科技新闻 #大模型 #算力
AI智能体预执行检查清单

人类给出的指令常常不完整,而AI却试图将其当作完整指令来解读,这正是问题的根源。如果AI在执行任务前未验证必要信息,那么结果并非简单的模型错误,而是预执行确认失败。许多所谓的“氛围编码”错误并非源于编码能力不足,而是因为AI在执行前没有提出关键问题。正确的做法是:不确定时就询问,绝不猜测。该清单强调,AI只有在确认所有必要信息后方可行动,避免因假设导致错误输出。 #AI #智能体 #预执行检查 #不确定性 #编程错误 #科技 #提示工程
AI 与生产率悖论

经济学研究发现,尽管企业近年来大规模投资人工智能技术,但全球生产率增长依然疲软。这一“生产率悖论”引发学界热议:AI 的潜力是否被高估?部分专家指出,技术落地需要配套的组织变革和技能培训,且当前 AI 应用多集中于自动化简单任务,而非突破性创新。尽管 AI 在特定领域表现优异,但其对整体经济效率的拉动尚未显现。 #AI #生产率 #经济学 #技术投资 #悖论
Brooks-Lint:基于12本经典工程书籍的AI代码审查工具

一位技术管理者在带领团队时发现,实习生使用AI工具编写的项目虽然运行正确,但目录结构混乱,违背了软件工程最佳实践。受此启发,他开发了Brooks-Lint,一款基于12本经典工程书籍(如《人月神话》《代码大全》等)的AI代码审查工具。该工具能够自动检测代码结构问题,帮助开发者遵循经过验证的工程原则,提升代码质量和可维护性,尤其适用于AI辅助编程场景下的代码规范检查。 #AI #代码审查 #软件工程 #BrooksLint #编程 #工具 #技术新闻 #工程实践