AI知识库 @ai521
563 subscribers
30.2K photos
59 videos
27 files
1.24K links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
通过 Pyodide 与 Service Worker 在浏览器中运行 Python ASGI 应用

本文介绍了一种创新的技术方案:利用 Pyodide(将 Python 解释器编译为 WebAssembly 的运行时)结合 Service Worker,在浏览器端直接运行 Python ASGI 应用(如 FastAPI、Starlette 等)。该方法使得 Python Web 应用能够完全在客户端离线执行,无需后端服务器支持。文章可能探讨了实现原理、性能表现、与现有前端框架的集成方式,以及在实际场景中的应用潜力。这一技术为 Python 开发者提供了在浏览器中复用后端代码的新途径,有望推动全栈 Python 开发的边界扩展。 #Python #ASGI #Pyodide #ServiceWorker #WebAssembly #浏览器 #前端 #技术
ProReview:AI命令审查训练工具,助工程师规避生产风险

ProReview 是一款专为工程师设计的交互式训练工具,旨在提升对 AI 生成命令的审查能力。用户可在 60 秒内判断 bash、kubectl、SQL 等命令是否安全,并标出风险片段。工具涵盖 Kubernetes、云基础设施、数据库、CI/CD 及后端安全五大领域,提供 50 余道挑战。通过盲审、分段评分和专家解析,帮助团队在部署前识别 AI 生成的潜在故障,降低生产事故风险。无需登录,免费使用。 #AI #代码审查 #工程师 #安全 #Kubernetes #DevOps #工具 #训练
我们如何跨产品控制Claude

Anthropic近日发布了一篇题为“How we contain Claude across products”的文章,介绍了该公司如何在其多个产品中确保AI助手Claude的安全可控。Claude是Anthropic开发的大型语言模型,广泛应用于对话、写作等场景。跨产品控制意味着在不同界面和功能中统一管理模型行为,包括内容过滤、行为约束、用户权限等。这一举措体现了Anthropic对AI安全的高度重视,也为行业提供了参考。 #Anthropic #Claude #AI安全 #产品控制 #人工智能
Thaw:为运行中的LLM实现类似Git的分支功能,大幅降低推理浪费

近日,开发者发布了一款名为Thaw的开源工具,旨在解决大语言模型(LLM)智能体(agent)在执行分支探索时的资源浪费问题。当前,智能体在进行强化学习、最佳N采样或多方案并行编码等任务时,每个分支都需要重新对整个共享上下文进行预填充(prefill),导致重复计算同一段提示词,造成高昂的算力开销。Thaw通过保存模型实时推理会话的快照,包括权重、KV缓存、调度器状态及前缀哈希表,并基于该快照快速生成从分支点分叉的子节点,彻底跳过预填充步骤。该工具类似于`git branch`,但针对运行中的LLM会话实现高效分支与克隆。开发者表示,Thaw已在H100 80GB GPU上完成测试,可显著提升多分支推理任务的效率,降低重复计算成本。 #LLM #AI #开源工具 #模型推理 #效率提升 #智能体 #HackerNews
企业AI烧钱失控

据Axios报道,一家企业客户因未为员工设定AI使用上限,单月竟在Claude上烧掉5亿美元。这一极端案例暴露了企业AI热潮中的成本管控危机。亚马逊和Meta等科技巨头已紧急叫停内部AI使用排名项目,因为员工为刷排名而进行无效消耗(“tokenmaxxing”),导致算力浪费。亚马逊用“归一化部署”指标替代Token消耗量,聚焦实际价值产出。分析指出,企业AI采用面临用例错位、成本失控、人才瓶颈和数据安全四大结构性障碍。高盛专家认为,AI投资核心已从技术可行性转向成本可承受性,Token价格持续上涨可能引发企业对高成本模型依赖的下降,一场关于投入回报的严肃审查正在展开。 #AI #企业成本 #Claude #亚马逊 #Meta #tokenmaxxing #高盛 #投资回报
HermesBench:面向个人AI代理工作流可靠性的评估基准

HermesBench 是一个用于评估个人AI代理完整配置的开源基准,涵盖提示词、模型/提供商、工具、AgentSkills、内存、网关行为、委托、安全性、延迟和稳定性等维度。当前公开基线在27个个人代理“食谱”上得分为78.2,所有评分结果均可追溯至场景定义、评分轴、确定性检查及脱敏追踪日志。该项目强调可靠性优先,但也不忽视能力——一个良好的配置应既能完成有用工作,又能如实报告所知、避免不安全副作用、保持稳定、响应及时且沟通清晰。用户可通过将提示复制到Codex或Claude等编码代理中快速开始,先运行单个默认食谱场景,再选择完整套件。HermesBench鼓励社区提交脱敏配置和通用食谱,以不断完善基准。 #AI #基准测试 #个人代理 #工作流 #可靠性 #开源 #HermesBench
GPU算力强但内存带宽成瓶颈,AI硬件公司各出奇招

现代GPU在LLM推理过程中,其张量核心的计算能力远超外部HBM内存带宽,导致大量算术单元处于空闲等待状态。这一“内存墙”问题在多代GPU中持续存在,且差距不断扩大。为此,AI硬件市场围绕内存瓶颈形成不同解决方案:Groq用片上SRAM取代HBM,带来确定性执行但需要更多芯片,其方案已被NVIDIA纳入Vera Rubin平台;Cerebras打造晶圆级单芯片,内置44GB SRAM和21 PB/s带宽;MatX专为Transformer设计软件管理的高速缓存,d-Matrix则尝试内存内计算。同时,软件推理引擎也可通过增大批处理规模等方式缓解瓶颈。各公司正从芯片内部、服务引擎、缓存层级或物理封装等不同层面,试图避免与NVIDIA正面竞争。 #AI硬件 #GPU #内存瓶颈 #LLM推理 #Groq #Cerebras #MatX #NVIDIA #芯片架构
AI热潮扩散:戴尔、Snowflake和福特展现实际业务增长

AI热潮正从概念转向实际业务回报。戴尔科技因上调AI服务器营收预期至600亿美元,股价创历史第二大涨幅;Snowflake季度营收增长33%,证明AI使企业数据更具价值;福特与EDF签署20吉瓦时电池储能系统协议,成为AI基础设施的早期参与者。这三家公司分别代表AI基础设施的不同层面:服务器硬件、数据平台和电力存储。自3月30日市场低点以来,三股等权重组合上涨约86%,远超标普500指数同期20%的涨幅。分析师指出,AI交易已不再仅限于模型构建者,而是扩展到围绕AI建设的基础设施受益者,投资者需要拓宽投资思路。 #AI #戴尔 #Snowflake #福特 #人工智能 #基础设施 #股市 #科技新闻
Vercel BotID 保护 AI 端点

Vercel 推出 BotID 功能,通过 checkBotId() 方法对 AI 端点的每个请求进行验证,确保只有经过身份认证的调用者才能执行推理任务。该方案覆盖了设置流程、深度分析以及已验证机器人的识别,有效防止未授权访问和滥用。开发者可借此为 AI 应用构建一道安全屏障,降低推理成本与安全风险。 #Vercel #BotID #AI安全 #端点保护 #推理验证 #开发者工具 #网络安全
SnapName:用本地Gemma 4 AI为macOS截图智能命名

开发者推出了一款名为SnapName的macOS应用,利用内置的Google Gemma 4多模态AI模型,在本地为截图自动生成文件名。该应用无需上传图片至云端,所有处理均在用户Mac上完成,确保隐私安全。SnapName可监控指定截图文件夹,当新截图出现时,自动分析内容并给出三个AI建议名称,用户可手动选择或开启自动保存。它兼容macOS原生截图工具、CleanShot、Shottr等第三方应用,支持PNG、JPEG、HEIC等常见格式。应用提供自动模式(跟随macOS截图文件夹)和自定义模式(监控任意文件夹),并支持CPU和GPU加速,要求macOS 13及以上系统及Apple Silicon芯片。 #macOS #AI #截图 #隐私保护 #Gemma4 #本地AI #效率工具 #Mac应用
Karen Kwok 评 AI 进展:Claude Opus 4.8 改进明显,Anthropic 与 OpenAI 已获市场认可

据路透 Breakingviews 专栏作家 Karen Kwok 近期发表的多篇文章,Anthropic 的 Claude Opus 4.8 被评价为“适度但切实的改进”,并指出 Anthropic 与 OpenAI 均已找到产品与市场契合点,表明 AI 商业化进入新阶段。此外,Kwok 还撰文讨论了教皇利奥十四世关于人工智能的通谕,引发对 AI 伦理治理的思考。相关评论发表于 2026 年 5 月底,折射出 AI 领域在技术迭代、商业落地与社会伦理方面的多重进展。 #AI #Anthropic #OpenAI #Claude #教皇 #通谕 #伦理 #路透 #科技评论
Robinhood 推出 AI Agent 自动炒股,风险自担引争议

美国券商 Robinhood 近日推出由 AI Agent 代执行股票交易的工具,允许投资者通过第三方 AI 工具(如 OpenClaw、Claude Code)设定策略自动买卖,无需逐笔确认。Robinhood 明确声明不监控、不推荐、不审计 AI 行为,所有风险由投资者自行承担,同时设立隔离账户限制资金。此举虽非全新——量化交易及 AI 辅助投研早已存在,但这是散户首次接触完全自动化真金白银交易。争议焦点在于:亏损责任难以追究(AI 本身无法担责)、算法同质化可能放大市场波动(类似量化交易的踩踏效应)、以及 AI 黑箱决策难以合规追溯。监管层已开始警惕,中国证监会近期升级量化交易监管,并向投资者发送短信提醒警惕 AI 荐股。尽管争议重重,AI 自动交易浪潮或不可逆,监管需提前布局。 #Robinhood #AI炒股 #自动化交易 #金融科技 #量化交易 #监管 #风险警示 #美股
Claude Opus 4.8 发布,两个史上首次改写历史

因目标网页返回错误,无法获取完整新闻内容。标题提示该版本实现了两项历史性突破,具体细节待进一步核实。建议直接访问原链接或关注官方渠道了解详情。 #AI #Claude #大模型 #人工智能 #科技新闻
连续批处理技术提升LLM推理效率

该文章深入探讨了如何通过连续批处理技术优化大语言模型(LLM)的推理效率。文章分为四个部分:首先指出静态批处理将多个请求分组为固定大小批次处理,存在资源浪费和延迟问题;其次通过代码示例展示静态批处理的局限性;接着介绍连续批处理(动态调度与不规则批处理)如何动态调整批次,提高吞吐量;最后给出完整实现方案。该技术能显著降低推理成本,提升多用户并发场景下的响应速度。 #LLM #推理效率 #连续批处理 #静态批处理 #AI #技术 #机器学习 #大模型
千问3.5横扫开源模型排行榜,全球前五千问独占四席

据品玩报道,阿里云通义千问3.5系列模型在多个国际开源大模型排行榜中表现抢眼。在最新的全局排名中,全球前五名中有四个席位被千问3.5系列占据,包括千问3.5-32B、千问3.5-72B等。这一成绩展示了国产大模型在开源领域的强劲竞争力,尤其在数学推理、代码生成等核心指标上超越同级别模型。千问3.5的出色表现不仅印证了阿里云在AI技术研发上的深厚积累,也为开源生态注入了新活力,推动大模型技术更广泛地应用于实际场景。 #千问3.5 #通义千问 #开源大模型 #阿里云 #AI排行 #人工智能
微软发布Skills自我进化框架,一周获3.3k星标

微软研究院推出名为“Skills”的创新框架,旨在让AI技能像神经网络一样实现自我进化。该框架通过类似梯度下降的优化机制,自动生成、筛选和组合技能模块,使AI系统能持续提升任务执行能力。项目在GitHub开源后迅速引发关注,一周内获得超过3300颗星标。这一方法有望大幅降低人工编写技能的成本,推动AI在复杂场景下的自主适应能力,为智能体开发提供新范式。 #微软 #AI #技能进化 #神经网络 #开源 #GitHub #人工智能 #技术前沿
OpenAI与Anthropic同步提价,AI编程工具成本激增

4月起,OpenAI将Codex计费从按消息估算改为按token用量,导致重度用户实际成本飙升。独立开发者Simon Willison一个月烧掉2180美元token,却只付200美元月费。Anthropic表面未调价,但新模型Opus 4.7的tokenizer让同一文本最多多算35% token,有效成本上涨约1.4倍。两公司同步提价背后是找到PMF,编程Agent等高价值用户付费能力远超普通聊天用户。据The Information报道,Uber仅2026年初就花光全年AI预算,主因是Claude Code。中间商如Cursor、Copilot面临议价权流失,Cursor已推自研模型反击。企业需进入FinOps式成本治理,管控token用量、缓存策略等。Anthropic与SpaceX签下月费12.5亿美元的算力协议,预示AI算力需求将持续暴涨。 #OpenAI #Anthropic #AI编程 #token计费 #成本上涨 #PMF #FinOps #AI算力