AI 是安全领域最好的事情
大语言模型(LLM)已存在一段时间。当 Anthropic 报告称国家级攻击者正使用 Claude 进行攻击时,我最初持怀疑态度——过去模型调用工具困难,难以想象攻击者能获得实际价值。但过去六个月,工具调用问题被解决,模型能可靠输出结构化数据,AI 实验室还将推理能力下放至可本地运行的小模型。这一转变对自动化攻击代理意义重大:代理能可靠使用工具、编辑 HTTP 请求、追踪数据流、读取输出、存储记忆并自主决策。做个思想实验:让猴子按按钮运行 SQLmap 可以攻破很多漏洞;现在将 SQLmap 替换为 AI 框架(如 OpenCode、Codex),代理会根据目标响应实时切换工具,组合多种操作,不再依赖单一工具。虽然 AI 代理是非确定性的,但“偶然成功”远好于“全部失败”。另一方面,开源模型(如 DeepSeek、GLM)可脱敏部署,且存在工具永久移除安全限制。这些无审查模型可被直接用于攻击,无需伪装授权。同时,AI 辅助编程加速了代码生成,导致更多 API、基础设施和攻击面出现。因此,AI 既是威胁也是机遇——它提升了攻击上限,也放大了风险敞口。 #AI安全 #大模型 #自动化攻击 #网络安全 #开源模型 #LLM #渗透测试 #风险敞口
大语言模型(LLM)已存在一段时间。当 Anthropic 报告称国家级攻击者正使用 Claude 进行攻击时,我最初持怀疑态度——过去模型调用工具困难,难以想象攻击者能获得实际价值。但过去六个月,工具调用问题被解决,模型能可靠输出结构化数据,AI 实验室还将推理能力下放至可本地运行的小模型。这一转变对自动化攻击代理意义重大:代理能可靠使用工具、编辑 HTTP 请求、追踪数据流、读取输出、存储记忆并自主决策。做个思想实验:让猴子按按钮运行 SQLmap 可以攻破很多漏洞;现在将 SQLmap 替换为 AI 框架(如 OpenCode、Codex),代理会根据目标响应实时切换工具,组合多种操作,不再依赖单一工具。虽然 AI 代理是非确定性的,但“偶然成功”远好于“全部失败”。另一方面,开源模型(如 DeepSeek、GLM)可脱敏部署,且存在工具永久移除安全限制。这些无审查模型可被直接用于攻击,无需伪装授权。同时,AI 辅助编程加速了代码生成,导致更多 API、基础设施和攻击面出现。因此,AI 既是威胁也是机遇——它提升了攻击上限,也放大了风险敞口。 #AI安全 #大模型 #自动化攻击 #网络安全 #开源模型 #LLM #渗透测试 #风险敞口
Transformer如何成长为真正的LLM
上一篇文章讲解了单层Transformer的运作机制。但仅有堆叠的多层架构并不等于产品——未经训练的模型只是一堆随机数字。本文继续追踪从架构到可对话模型的完整路径。残差连接解决了深层网络训练中的梯度消失问题:让原始信号绕过每个子层,将输入与子层输出相加再传递,确保早期层能稳定学习微小调整。此外,大模型处理的并非单词,而是通过分词器将常见字符组分割成“令牌”(token)。普通英文平均每个单词对应1.5-2个令牌,代码或非英语文本则更高。分词器缩小了词汇表规模,使模型能高效处理数百万种组合。 #Transformer #残差连接 #分词器 #大模型 #LLM #深度学习 #AI
上一篇文章讲解了单层Transformer的运作机制。但仅有堆叠的多层架构并不等于产品——未经训练的模型只是一堆随机数字。本文继续追踪从架构到可对话模型的完整路径。残差连接解决了深层网络训练中的梯度消失问题:让原始信号绕过每个子层,将输入与子层输出相加再传递,确保早期层能稳定学习微小调整。此外,大模型处理的并非单词,而是通过分词器将常见字符组分割成“令牌”(token)。普通英文平均每个单词对应1.5-2个令牌,代码或非英语文本则更高。分词器缩小了词汇表规模,使模型能高效处理数百万种组合。 #Transformer #残差连接 #分词器 #大模型 #LLM #深度学习 #AI
政策制定者应为潜在AI就业灾难做好准备
目前人工智能对劳动力市场影响有限,虽有个别AI导致裁员新闻,但失业率并未显著上升。然而,未来几年可能出现剧烈冲击,政策制定者应提前准备。一种流行方案是“就业保障”,即政府直接创造就业岗位。调查显示54%美国人支持此举,仅17%支持无条件收入补助。美国在大萧条时期曾通过公共就业计划解决大规模失业。但现有文献表明,大规模就业保障计划需谨慎看待:为就业而创造的工作未必提供有价值技能,也无法带来真正意义。政策制定者应借鉴1976年CBO的劳动市场干预分类,包括技能发展、工作经验、就业能力培养等项目,以更有效应对AI可能引发的失业问题。 #AI #就业 #劳动力市场 #政策 #人工智能 #失业 #就业保障
目前人工智能对劳动力市场影响有限,虽有个别AI导致裁员新闻,但失业率并未显著上升。然而,未来几年可能出现剧烈冲击,政策制定者应提前准备。一种流行方案是“就业保障”,即政府直接创造就业岗位。调查显示54%美国人支持此举,仅17%支持无条件收入补助。美国在大萧条时期曾通过公共就业计划解决大规模失业。但现有文献表明,大规模就业保障计划需谨慎看待:为就业而创造的工作未必提供有价值技能,也无法带来真正意义。政策制定者应借鉴1976年CBO的劳动市场干预分类,包括技能发展、工作经验、就业能力培养等项目,以更有效应对AI可能引发的失业问题。 #AI #就业 #劳动力市场 #政策 #人工智能 #失业 #就业保障
2026年使用AI的真实成本分析
作者通过分析自己60天的token消费账单发现,91%的token支出流向无法本地运行的昂贵模型(如Claude订阅),而可本地部署的开源模型(Qwen、DeepSeek等)仅花费约30美元。文章梳理了四种获取大模型推理能力的方式:按月订阅(如ChatGPT Plus、Claude Pro)、按token付费API(如OpenRouter)、按小时租用云端GPU(如RunPod)、以及自购硬件本地运行。作者以自身每年约7800万输入token、1300万输出token的中等使用量为例,分别计算四种方案的成本,旨在揭示不同使用场景下最经济的选择。 #AI #成本分析 #订阅 #API #GPU #硬件 #开源模型 #人工智能 #token
作者通过分析自己60天的token消费账单发现,91%的token支出流向无法本地运行的昂贵模型(如Claude订阅),而可本地部署的开源模型(Qwen、DeepSeek等)仅花费约30美元。文章梳理了四种获取大模型推理能力的方式:按月订阅(如ChatGPT Plus、Claude Pro)、按token付费API(如OpenRouter)、按小时租用云端GPU(如RunPod)、以及自购硬件本地运行。作者以自身每年约7800万输入token、1300万输出token的中等使用量为例,分别计算四种方案的成本,旨在揭示不同使用场景下最经济的选择。 #AI #成本分析 #订阅 #API #GPU #硬件 #开源模型 #人工智能 #token
AI时代竞争核心转向“AI Ready数据”,企业争相布局
随着AI代理时代正式到来,AI产业的竞争焦点正从开发大型语言模型迅速转向确保“AI Ready数据”。这类数据是经过结构化、精制化处理,具备元数据、版本管理和质量验证,AI可直接使用的状态。市场研究机构Gartner在2025年报告中将其列为最值得关注的核心技术。全球科技巨头为此积极进行并购:IBM斥资约16万亿韩元收购实时数据流媒体企业Confluent,SAP收购Master数据管理企业Reltio。全球AI学习数据集市场预计从2025年的32亿美元增长至2033年的163亿美元。韩国企业也备受关注:产业音响AI企业Deply积累超1000万件制造数据和210万小时工厂噪音;专利AI企业Wat Intelligence将2500亿专利文章结构化;医疗AI企业Lunit通过收购获得1亿张乳房影像。专家指出,实际确保现场数据是左右AI性能的核心竞争力,这一趋势已从民间扩散至政府层面。 #AI #数据 #AI代理 #生成型AI #科技新闻 #并购 #数据竞争力
随着AI代理时代正式到来,AI产业的竞争焦点正从开发大型语言模型迅速转向确保“AI Ready数据”。这类数据是经过结构化、精制化处理,具备元数据、版本管理和质量验证,AI可直接使用的状态。市场研究机构Gartner在2025年报告中将其列为最值得关注的核心技术。全球科技巨头为此积极进行并购:IBM斥资约16万亿韩元收购实时数据流媒体企业Confluent,SAP收购Master数据管理企业Reltio。全球AI学习数据集市场预计从2025年的32亿美元增长至2033年的163亿美元。韩国企业也备受关注:产业音响AI企业Deply积累超1000万件制造数据和210万小时工厂噪音;专利AI企业Wat Intelligence将2500亿专利文章结构化;医疗AI企业Lunit通过收购获得1亿张乳房影像。专家指出,实际确保现场数据是左右AI性能的核心竞争力,这一趋势已从民间扩散至政府层面。 #AI #数据 #AI代理 #生成型AI #科技新闻 #并购 #数据竞争力