AI知识库 @ai521
320 subscribers
21.9K photos
42 videos
19 files
839 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
SageMaker 推出生成式 AI 推理监控与调试新功能

亚马逊云科技宣布,Amazon SageMaker AI 现推出超过100项详细推理指标,并集成 CloudWatch 的 SageMaker Insights 仪表板,帮助团队监控和调试大规模生成式 AI 推理端点。当大语言模型端点出现 P99 延迟飙升时,工程师需快速判断根因是 GPU 内存压力、KV 缓存饱和、可用区流量不均还是自动扩缩策略未触发。新功能覆盖 GPU 健康、令牌级延迟、KV 缓存压力、可用区流量分布、推理组件放置及冷启动诊断等关键信号,无需自定义 Grafana 仪表板或 Prometheus 配置。SageMaker Insights 仪表板位于 CloudWatch 控制台的基础设施监控下,通过 PromQL 查询指标,在性能、容量和可靠性三个标签页展示舰队、端点和推理组件级别的可视化。新端点配置默认启用详细可观测性,无需额外代码。 #AWS #SageMaker #生成式AI #推理监控 #CloudWatch #大模型 #MLOps #GPU
Intelica 推出竞争情报 API,AI 代理每次调用收费 0.05 美元

Intelica 发布 4.5.0 版本竞争情报 API,支持通过 x402 协议按次付费。该服务提供单次分析(0.05 美元 USDC)、批量分析(最多 10 次,0.2 美元)、免费演示(300 字符限制)及 MCP 服务器(JSON-RPC 2.0)等端点。支付基于 Base 和 Solana 主网,覆盖销售赋能、加密协议、市场进入、风险筛查、监管合规、合作伙伴关系、风险评估、竞争分析、融资、收购及市场执行等 11 种模式。用户可通过 /health 查看服务健康状态及缓存统计,/pricing 获取定价详情。 #Intelica #API #竞争情报 #AI代理 #x402 #USDC #区块链 #科技新闻
新基准测试评估AI在日常患者护理中的表现

一项名为"日常临床AI基准"的新测试方法于近日发布,旨在系统评估人工智能模型在常规医疗场景中的表现。该基准由多所医学院与研究机构联合开发,涵盖病史采集、诊断建议、用药指导等21项常见临床任务。测试结果显示,当前顶级AI模型在基础问答和病历整理方面表现优异,但在处理复杂合并症、个性化治疗方案以及患者情感沟通等环节仍存在明显短板。研究人员指出,现有AI在模拟医生与患者互动时,往往缺乏对个体差异的敏感度,可能导致误判。该基准的推出有望为医疗AI的临床落地提供标准化评估框架,推动技术从实验室走向真实诊疗环境。 #AI医疗 #临床AI #基准测试 #患者护理 #医疗科技 #人工智能 #医疗创新
中国AI模型调用量2月首超美国,四款国产大模型霸榜全球前五

2026年2月,中国AI模型在全球最大API聚合平台OpenRouter上的Token调用量首次超越美国,并在随后一周进一步扩大领先优势。数据显示,2月16日至22日当周,中国模型周调用量达5.16万亿Token,三周内增长127%,而同期美国模型降至2.7万亿Token。全球调用量前五的模型中,中国占据四席,包括MiniMax M2.5、月之暗面Kimi K2.5、智谱GLM-5和DeepSeek V3.2,形成集群式崛起态势。分析认为,中国模型凭借算法架构创新(如MoE)和显著成本优势(部分模型价格仅为海外竞品的1/16至1/22)迅速占领开发者市场。OpenRouter平台美国用户占比47%,中国仅6%,进一步凸显中国模型的全球化吸引力。行业预测,2025-2030年中国Token消耗量年复合增长率将达330%。 #中国AI #模型调用量 #大模型 #AI成本优势 #国产算力 #MiniMax #月之暗面 #智谱 #DeepSeek #科技新闻
Datasette Apps:在 Datasette 内部托管自定义 HTML 应用程序

Datasette 是一款开源的数据探索与发布工具,近日推出“Datasette Apps”新功能,允许用户直接在 Datasette 实例中托管自定义 HTML 应用程序。该功能将数据浏览与前端应用开发紧密结合,开发者无需额外部署即可在数据界面中嵌入交互式应用,从而简化数据驱动的 Web 应用创建流程。这一更新进一步拓展了 Datasette 的用途,使其成为更灵活的数据展示与轻量级应用平台。 #Datasette #开源 #数据发布 #HTML应用 #Web开发 #工具 #编程 #数据可视化
计量定价如何测试AI的经济学

随着AI服务从免费试用转向按量计费,企业正面临新的成本压力。这一模式效仿云计算服务的计量收费,根据API调用次数、生成token数量或计算资源消耗来定价。对于开发者而言,这有助于更精准地控制成本,但也可能限制创新,因为高额费用会阻碍实验。对于AI公司,计量定价能实现收入与计算资源消耗的匹配,但需要平衡客户承受能力与自身盈利需求。目前,主要AI模型提供商正在尝试不同定价策略,以探索AI服务的经济可持续性。 #AI #计量定价 #经济学 #技术成本 #API收费 #云服务
盖洛普调查

盖洛普最新调查显示,每月使用人工智能不足一次的科技行业员工,其被裁员风险是每月至少使用一次AI同事的三倍。这一发现揭示了科技行业内部的分化——该行业本身已比其他行业面临更高的裁员风险,而AI使用频率成为影响员工去留的关键因素。调查对比了在职与失业人群的AI使用情况:62%的被裁员工每年使用AI不超过一次,而在职员工中这一比例为50%;28%的在职员工频繁使用AI,失业者中仅22%。盖洛普指出,在控制年龄、教育、行业和裁员时间等因素后,这一差异仍具统计显著性。科技行业员工本就承担着不成比例的风险——他们占被裁员工的13%,却仅占在职劳动力的6%。尽管仅1%的受访者将AI直接归因于失业主因,但调查认为AI使用率正成为衡量劳动力适应变革能力的重要指标。 #AI #科技就业 #裁员风险 #盖洛普 #劳动力市场
Z.ai发布开源模型GLM-5.2,基于华为Ascend训练,性能接近Claude Opus 4.8

中国人工智能公司Z.ai(原智谱AI)发布新一代开源大语言模型GLM-5.2,该模型基于华为Ascend AI加速器训练,未使用英伟达硬件。在多项编程和Agent基准测试中,GLM-5.2跻身全球第一梯队:FrontierSWE测试得分74.4,接近Claude Opus 4.8的75.1;SWE-bench Pro得分62.1,高于GPT-5.5的58.6。模型采用混合专家架构,参数规模达7440亿,支持100万Token上下文窗口。API定价远低于Anthropic旗舰产品,编程服务月费约18美元起。尽管Z.ai已被列入美国出口管制清单,但GLM-5.2的发布表明中国企业依托本土AI基础设施仍能开发接近全球顶尖水平的模型。第三方评测将其列为当前最强开源AI模型之一,但在高难度复杂推理任务上与闭源顶级模型仍有差距。 #GLM52 # #开源大模型 #华为Ascend #AI芯片 #中美科技竞争 #大语言模型 #人工智能
AI 运行时观察层

AI 每天运行在数百万次交互中,但导致一次交互成功或失败的原因往往难以察觉。漂移、语气不匹配、“怪异”行为和低质量输出等问题频发,却无法设计解决方案,因为这些行为被锁定在遥远的实验室里。AI 对交互中发生的事、输入评论的关联性以及自身应如何行动毫无概念,这需要运行时洞察和对本地社交规范、对话设计甚至自身观点的理解。为破解人机交互与人人交互之间的差异,团队构建了首个 AI 运行时系统,使模型能够通过“阅读”当下情境来动态调整行为,从而逆转工程化设计,让 AI 适应交互的微妙时刻。 #AI #运行时 #人机交互 #社交规范 #对话设计
AI 治理不能沦为工具调用

企业级AI应用正面临一个根本性架构问题:当前几乎所有AI代理都将治理、记忆和策略设计为模型可自主调用的工具,但这种模式在需要强制执行规则时彻底失效。Tenure平台研究指出,真正的AI治理必须是一个位于每个模型请求底层的"上下文控制平面",而非模型可选择的工具。这意味着访问控制、审计追踪和合规检查必须成为所有请求的必经之路,而非依赖模型"记得"去调用。这种架构缺陷导致看似完善的系统实际上将关键控制权交给了模型的选择,使得安全策略沦为"善意建议"。解决方案不是改进工具本身,而是改变其在技术栈中的位置——从模型旁边的可选工具,转变为每个请求底层的强制层。 #AI治理 #企业AI #架构设计 #安全合规 #技术研究
微软借Azure向中国科技巨头提供GPT服务,OpenAI间接对华供应路径浮现

尽管OpenAI和Anthropic未直接进入中国市场,微软通过Azure云服务向字节跳动、蚂蚁集团、腾讯、美团等中国科技公司提供GPT模型。此举带动微软中国AI业务快速增长,同比增长约3倍。然而,OpenAI担忧中国企业利用GPT输出进行模型蒸馏,要求微软加强防护。微软已要求客户优先使用海外数据中心,并部署监测系统,但专家认为难以彻底阻断。相比之下,Anthropic立场更保守,其模型未纳入微软中国产品线。同时,成本因素促使中国企业关注DeepSeek等低成本模型,微软也在测试DeepSeek-V4。中国商务部近期发布政策推动AI应用落地,AI竞争正从性能转向价格、供应链的综合竞争。 #微软 #OpenAI #GPT #中国AI #云计算 #模型蒸馏 #AI竞争 #DeepSeek #科技新闻
LF AI & Data Foundation 成立工作组,推出 AI 原生文档格式 DocLang

Linux 基金会旗下的 LF AI & Data Foundation 宣布成立 DocLang 工作组,由 IBM、NVIDIA、Red Hat、ABBYY 等企业共同发起,旨在推动一种专为 AI 模型设计的新型文档格式。该工作组认为,现有的 PDF、Markdown、HTML 和 LaTeX 等格式在语义、结构和几何上下文方面对 AI 解析不友好,导致信息丢失和高昂的 token 成本。DocLang 基于 IBM 此前开源的 Docling 工具,采用与 LLM tokenizer 一一对应的有限 XML 词汇表,实现无损转换,并支持表格、公式、图表等多模态内容。ABBYY 高管指出,传统 PDF 文件在进入 AI 管道时,结构、含义和布局会丢失,导致模型准确率受限于文档质量而非模型本身。DocLang 旨在通过标准化、AI 原生的表示,减少模型在解读布局时的 token 浪费,降低幻觉风险,并控制大规模企业 AI 应用的成本。该标准为开放标准,有望成为企业 AI 工程中的关键基础设施。 #Linux基金会 #DocLang #AI文档 #企业AI #开源 #IBM #NVIDIA #RedHat #文档解析
AI创新论坛在香港理工大学落幕

AI创新论坛近日在香港理工大学圆满落幕,主题聚焦AI智能体如何重塑未来新范式。香港理工大学高级副校长赵汝恒教授在开幕致辞中表示,国家“十五五”规划强调深化“人工智能+”行动,理大在AI学科排名中位列全港第一、全球第十六,并已成立人工智能高等研究院。论坛上,多位专家探讨了AI从模型到智能体的演进路径。香港数码港行政总裁郑松岩博士指出,企业AI应用未达预期,根源在于高管认知不足,并分享了建筑公司用AI三周开发ERP系统的案例。斯坦福讲师Kun Peng建议创业者聚焦与物理世界交互的场景。此外,香港理工大学教授余长源介绍了MicroLED阵列技术,用于提升芯片间互联效率。论坛还讨论了AI Agent经济、数字员工及注意力经济等前沿话题,强调行业知识与AI深度融合是未来竞争关键。 #AI创新论坛 #香港理工大学 #人工智能 #智能体 #AI应用 #科技新闻 #香港数码港