AI知识库 @ai521
365 subscribers
24.2K photos
45 videos
20 files
925 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Anthropic 推出 Claude Opus 5,登陆 AWS 平台

Anthropic 宣布其最新旗舰模型 Claude Opus 5 在 Amazon Bedrock 和 Claude Platform on AWS 上正式可用。这是第五代首个 Opus 级别模型,在代理编码、知识工作、视觉理解和长时间运行任务方面实现显著提升。Opus 5 能像资深工程师一样理解代码库、编写生产级代码,并支持数小时甚至过夜自主运行的代理,自动绕过障碍、恢复错误。在专业工作中,它对长篇文档的更深层推理和复杂分析准确度均有突破,尤其适用于金融、合规、文档密集型等企业场景。默认启用零数据保留,确保企业数据治理安全。需注意,在高风险网络安全领域,Opus 5 可能回退至 Opus 4.8,用户会收到通知。 #Anthropic #ClaudeOpus5 #亚马逊云 #生成式AI #大模型 #企业AI #AWS #Bedrock #AI编码
AWS 发布银行可解释的下一个最佳产品推荐系统方案

近日,AWS 发布了一项基于深度学习的架构方案,旨在帮助银行等金融机构构建可解释的下一个最佳产品推荐系统。该系统利用多塔神经网络分别处理交易历史、产品持有、人口统计等异构客户数据,并通过注意力机制将各塔特征融合,不仅提升推荐准确率,还能为每位客户生成个性化的推荐解释,以满足金融监管对模型可解释性的要求。方案采用 Amazon SageMaker AI 进行模型训练与部署,以 PyTorch 构建动态计算图,使用 AWS Glue 实现无服务器数据预处理,数据以 Parquet 格式压缩存储于 Amazon S3。该架构针对传统规则与协同过滤方法难以捕捉客户购买时序模式的痛点,提供了端到端的解决思路,可广泛应用于银行、保险等领域的个性化产品推荐。 #AWS #SageMaker #AI #推荐系统 #银行 #可解释AI #深度学习 #多塔神经网络 #PyTorch
OpenAI GPT-5.6 Sol、Terra 和 Luna 登陆 Amazon Bedrock

OpenAI 最新一代模型 GPT-5.6 的三个版本——Sol、Terra 和 Luna——已在 Amazon Bedrock 上正式可用。Sol 是旗舰推理模型,适合自主编码代理和长程推理;Terra 平衡性能与成本,适用于日常生产工作;Luna 则面向高吞吐、低延迟推理场景。三个模型均支持文本和图像输入、272K 上下文窗口,并通过 OpenAI Responses API 在 bedrock-mantle 端点提供访问。定价与 OpenAI 官方一致,使用量计入现有 AWS 承诺额度,且推理数据仅保留用于安全检测,不会用于模型训练。用户可通过 OpenAI Python 和 TypeScript SDK 直接调用,并在 AWS IAM 策略和 VPC 内运行,满足数据驻留要求。 #OpenAI #GPT56 #AmazonBedrock #大模型 #AI #云计算 #推理模型 #Sol #Terra #Luna
有状态 vs 无状态代理设计

本文探讨了有状态代理与无状态代理在构建可扩展智能体系统时的核心差异。有状态设计允许代理在交互中持续维护会话记忆和历史上下文,从而实现更连贯、更个性化的用户交互,但会增加系统复杂性和资源消耗。无状态设计则使每个请求独立处理,无需依赖过去状态,因此更易于水平扩展、容错和调试,但可能丢失对话的上下文学一致性。文章深入分析了这两种设计模式在部署成本、性能、开发复杂度等方面的取舍,并提供了根据应用场景选择合适架构的建议,为开发者构建面向大规模应用的代理系统提供了实用指导。 #人工智能 #代理系统 #有状态 #无状态 #系统架构 #可扩展性 #软件开发 #技术选型
表格大模型崛起

一种名为“表格大模型”(tabular LLMs)的新型预测模型正在颠覆传统数据分析方式。这类模型无需针对用户数据进行训练,即可像语言模型补全文本一样,零样本预测表格中缺失的列。在TabArena排行榜上,所有单模型超越最优化梯度提升树的记录均来自此类模型。作者在自有硬件上独立复现了最强开放权重模型TabICLv2,使用51个数据集的标准协议,耗时2.1小时(成本约2美元)完成验证。结果显示其性能与官方数据高度吻合,中位数相对差异仅0.08%,证实了排行榜的有效性。表格基础模型本质上是经过预训练的Transformer,通过上下文学习(in-context learning)工作:将已知标签的行作为上下文,模型通过注意力机制计算与待预测行的相似度并给出加权答案。近年来该家族快速壮大,包括TabPFN、TabICL系列、TabDPT及谷歌的TabFM等。尽管被称为“表格LLM”,但这些模型并非处理语言,而是直接处理表格中的单元格、列和行,使用无固定词汇表的数值与类别数据。 #表格大模型 #TabLLM #基础模型 #零样本预测 #机器学习 #AI #TabArena #TabICLv2
AI安全护栏阻碍合法黑客,研究人员被迫转向外国模型

据CryptoRank报道,当前AI系统中广泛部署的安全护栏(Guardrails)在防范恶意攻击的同时,也严重阻碍了合法安全研究人员的工作。许多白帽黑客因无法绕过限制进行漏洞测试,转而使用外国开源模型或未受限制的AI平台,导致本国AI安全生态面临人才流失与技术外溢风险。业界呼吁在安全与开放之间寻求平衡,避免因过度限制而削弱本土AI竞争力。 #AI安全 #安全护栏 #黑客 #开源模型 #技术外溢 #CryptoRank #人工智能 #网络安全
多代理系统负载感知缓存研究论文提交至arXiv

近日,一篇题为《Workload-Aware Caching for Multi-Agent Systems》的研究论文被提交至arXiv预印本平台。该论文由Anas Mohamed等六位作者共同完成,于2026年6月14日发布。论文聚焦于多代理系统中的缓存优化问题,提出了一种负载感知的缓存策略,通过动态感知各代理的工作负载来调整缓存分配,旨在提升系统整体效率和响应速度。该工作属于计算机科学领域,目前论文全文已开放访问,为分布式AI和物联网等场景中的代理协作提供了新的研究思路。 #多代理系统 #负载感知 #缓存 #人工智能 #arXiv #计算机科学 #研究论文
从错误到规则

一篇题为《从错误到规则:文本分类的迭代提示优化》的论文近期在arXiv预印本平台发布。该研究由Cui Yueying等学者提出,旨在通过分析模型在分类任务中的错例,自动生成修正规则,并迭代优化提示词,从而提升文本分类性能。相比传统静态提示方法,迭代优化策略能动态适应数据分布,显著降低错误率。研究展示了如何将模型输出的错误模式转化为可重复使用的规则,为少样本与零样本场景下的分类任务提供了新思路。 #arXiv #文本分类 #提示优化 #机器学习 #AI
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025