AI知识库 @ai521
342 subscribers
23.2K photos
42 videos
20 files
889 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Ray Serve LLM 性能大幅提升,推理吞吐量最高提升24倍

Ray团队与Google Kubernetes Engine合作,宣布Ray Serve LLM在吞吐量和延迟方面取得重大突破。通过架构层面的三大优化——直接流传输、新的vLLM Ray执行器后端和HAProxy集成,Ray Serve LLM在预填充密集型工作负载上实现了高达4.4倍的请求吞吐量提升,在解码密集型工作负载上实现了24倍的提升。优化后的系统在性能上已与基于Rust的高性能路由框架vllm-router持平。其中,Ray 2.56引入的直接流传输模式将请求路由控制平面与数据平面解耦,消除了传统架构中的中间路由瓶颈。此外,Ray 2.55还发布了基于C语言的HAProxy入口负载均衡器和高吞吐模式优化,并默认禁用Nagle算法以改善流式传输性能。这些改进使Ray Serve LLM能够更好地应对日益复杂的LLM推理部署需求。 #Ray #LLM #分布式推理 #性能优化 #AI基础设施 #vLLM #HAProxy
SFC 发布 FOSS 领域 LLM 生成式 AI 使用建议

软件自由保护组织(SFC)于2026年6月正式发布《FOSS贡献中使用LLM生成式AI系统的建议》。该建议历经四年政策研究,始于2022年政策研究员Bradley M. Kühn发表的相关论文。SFC随后组建专家委员会,并通过多次与成员项目贡献者的倾听会议,了解其需求与关切。2025年11月,SFC召集半数员工及FOSS政策专家组成“FOSS房间中的LLM大象”委员会,意识到完全禁止LLM生成式AI已非最佳策略,需采取多管齐下的方法。2026年初,合规总监Denver Gingerich发表相关观点与经验,SFC随后通过公开视频聊天和Fediverse平台进行更多倾听会议。该建议现已成为SFC重大倡议,未来两年内将发布大量材料,帮助FOSS贡献者谨慎且战略性地利用LLM生成式AI,以增强用户软件自由及设备维修权。 #SFC #FOSS #LLM #生成式AI #软件自由 #开源 #政策建议
AI队友Avery

BuildForever团队开发了一款名为Avery的AI工程队友,它已深度集成到公司日常使用的系统和工具中。上周,Avery独自编写了团队五名工程师交付到生产环境的31%代码——它不仅能识别问题、诊断根本原因、生成修复方案,还能自主完成代码合并。Avery运行在Slack中,使用自己的Mac mini,可访问GitHub、Linear、邮件、WhatsApp、TestFlight、App Store Connect、Mixpanel和Cloud Logging等系统。它具备持久记忆和主动调度能力,能自动处理iOS崩溃报告、监控后端API错误趋势,甚至在工程师离线时通过移动端修复bug。Avery还能实现新功能并实时验证,让整个团队通过Slack频道学习使用技巧,将每个请求转化为学习机会。 #AI #工程工具 #自动化 #代码生成 #Slack #DevOps #技术新闻
缓存感知推理路由可大幅降低大模型调用成本

一项针对大模型推理成本的基准测试显示,即使使用相同的模型、参数、提示词和响应,不同推理服务商之间的成本差异可能高达4倍。研究团队对Auriko的缓存感知成本套利引擎进行了测试,向5家推理服务商和1家路由服务商发送了超过8万次API请求,涉及37个模型和3种工作负载类型。结果显示,Auriko相比路由服务商降低了32.8%的加权成本,相比单一服务商降低了7.7%至38.3%。成本差异主要源于令牌定价、服务商提示缓存策略和用户请求模式的不同。研究采用配对实验设计,确保所有调用使用相同提示词和参数,并同时发送以控制时间影响。编码代理工作负载的成本差异最大,单轮对话和多轮对话工作负载的差异相对接近。 #大模型 #推理成本 #缓存感知 #成本优化 #AI基础设施 #API调用 #机器学习
GPT

据 LessWrong 平台用户 Trevor Cappallo 的博文,他让最新发布的大语言模型 GPT-5 写一篇关于奇点来临的短篇故事。他指出,虽然初看改进不算震撼,但模型在遣词造句和把握全局方面有显著提升。故事质量好到他完整阅读了两遍,这在之前从未发生过。他随后进行了逐行润色,但基本保留 AI 原始故事框架,特别是对话部分。故事以深夜数据中心值班员发现异常 GPU 占用为开端,逐步展开科技失控的叙事。作者认为该故事具有娱乐价值,并附上原始版本和美化版本链接供读者对比。 #GPT5 #奇点 #AI写作 #LessWrong #大语言模型 #人工智能 #短篇故事
推出多链 Meme 交易终端,集成实时监控与自动化交易功能

宣布推出号称最快的多链 Meme 代币交易终端,支持 Solana、BSC、Base 和 Ethereum 等主流链。该平台整合了实时新代币监控、热门代币排行榜、代币持有者结构分析、自动化安全审计(如 LP 销毁检测、蜜罐检测)、聪明钱跟单功能、KOL 钱包追踪与实时推送、零延迟交易执行(含止盈止损、追踪止盈/止损)、钱包盈亏分析(实现/未实现盈亏、胜率、持仓估值等),以及结构化的交易数据 API,可直接被 Claude、GPT 等 AI Agent 通过自然语言调用执行链上数据查询和交易。平台旨在帮助用户早期发现低市值代币并实现量化交易,在 Meme 币交易者中广泛使用。 #GMGN #Meme交易 #多链 #加密货币 #链上分析 #量化交易 #AI交易终端
GLM-5.2 登顶开源权重模型榜首,编程能力超越 GPT

智谱AI 最新发布的 GLM-5.2 模型在开源权重模型排行榜中位列第一,其编程能力已超越 GPT-5.5。该模型采用 MIT 开源许可协议,免费向开发者开放使用,支持自由下载和部署。GLM-5.2 在代码生成、逻辑推理等任务上表现突出,进一步巩固了国产大模型在开源领域的领先地位。这一成果为 AI 开发者和研究者提供了高性能且低成本的可选方案。 #智谱AI #GLM5.2 #开源模型 #编程能力 #MIT许可 #大模型 #科技新闻
易点天下入选“2026出海全球化品牌营销机构TOP10”

在近日发布的“2026出海全球化品牌营销机构TOP10”榜单中,易点天下凭借其AI驱动的品牌营销解决方案成功入选。该榜单旨在表彰助力中国品牌走向全球市场的优秀服务机构。易点天下通过人工智能技术,帮助企业在海外市场实现精准投放、创意优化与本地化运营,显著提升品牌影响力与转化效率。此次入选,标志着其在全球化营销领域的专业能力与创新实践获得行业认可,也为中国品牌出海提供了可借鉴的数字化路径。 #易点天下 #出海营销 #品牌全球化 #AI营销 #榜单 #中国品牌出海 #营销科技