AI知识库 @ai521
316 subscribers
21.8K photos
42 videos
19 files
838 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Codex 进入 ChatGPT 移动应用,实现随时随地跨设备协作

OpenAI 的 Codex 工具现已集成到 ChatGPT 移动应用中,并开始在 iOS 和 Android 平台上逐步推出预览版本。这一更新允许用户直接从手机远程管理 Codex 任务,连接到笔记本电脑、Mac mini 或远程环境中的运行实例,实时同步状态和上下文。超过 400 万用户每周使用 Codex,新功能通过安全中继层确保连接安全,支持审批命令、查看输出和调整方向,从而提升协作效率,减少不必要的等待。此外,Remote SSH 功能现已普遍可用,使 Codex 能够直接连接团队的管理远程环境,简化跨设备工作流程。 #Codex #ChatGPT #移动应用 #AI开发 #远程协作 #OpenAI #科技新闻 #软件更新
信用评分模型优化

在信用风险建模中,变量预处理常被忽视,却直接影响模型稳定性。文章指出,原始变量需通过分类转化为少数风险类别,以增强与违约风险的关联。对于连续变量,分类能捕捉非线性关系、处理异常值和缺失值;对于分类变量,则减少模态,提升模型可解释性。尤其在逻辑回归中,分类步骤使模型更透明、更易转化为评分卡。文章介绍了等宽分箱、等频分箱、卡方分组等方法,强调分类能优化变量输入,提高模型在生产环境中的预测准确性和可靠性,避免因数据问题导致的模型失效。 #信用评分 #数据预处理 #风险建模 #机器学习 #统计学 #金融科技 #AI #模型优化
Anthropic 调查 Claude Mythos 模型遭未授权访问声称

人工智能公司 Anthropic 正在调查一项声称,即一小群人未经正常许可访问了其 Claude Mythos 模型。该模型是一个网络安全工具,公司认为其能力过于强大,不宜向公众发布。公司声明表示,调查起源于一份报告,该报告称用户通过第三方供应商环境获得了对 Mythos Preview 的未授权访问。 据彭博社报道,一个私人论坛的用户设法在没有标准权限的情况下使用了该模型。目前尚无证据表明恶意行为者已获取模型,但此事件引发了关于大型 AI 公司能否有效防止其先进模型落入错误之手的质疑。网络安全专家分析认为,这很可能是对已有访问权限的滥用,而非传统的黑客入侵。英国国家网络安全中心负责人则表示,先进 AI 工具若能确保安全使用,将可能带来“净正面效益”,并呼吁业界专注于夯实网络安全基础。 #Anthropic #ClaudeMythos #网络安全 #AI安全 #数据泄露 #前沿AI #英国
美制AI芯片如何暗中流入中国

美国严格管制的AI芯片正通过走私渠道大量流入中国,其根源在于监管执行与企业责任之间的巨大缺口。美国相关机构人手严重不足,无法逐一审查每笔芯片交易或追踪其最终去向,这使得执法责任很大程度上落在了销售和分销芯片的企业身上。然而,这些企业缺乏足够动力去进行严格的客户审查与供应链监控以防止走私。 根据Epoch AI的一份新报告,截至2025年,约有29万至160万块H100等效算力的芯片被走私至中国,其中位估计为66万块,这相当于中国总算力的大约三分之一。近期美国已就AI芯片走私提起多项诉讼,其中一起涉及美国超微公司内部人员的案件涉案金额高达25亿美元,为史上最严重的出口管制违规案。尽管走私问题严重,但分析认为其规模尚不足以使芯片出口管制措施完全失效。该措施仍是中国在前沿AI领域落后美国约八个月并差距持续扩大的关键因素之一。然而,走私问题依然严峻而紧迫。 #AI #芯片 #地缘科技 #走私 #半导体 #新闻 #中美科技
Liquid AI 发布 AI 代理调优工具 Harness,一条命令完成模型微调

Liquid AI 近日发布了其面向 AI 代理的微调工具 Liquid Harness 的私人测试版。该工具旨在简化复杂的机器学习流程,使用户无需具备 ML 经验,仅通过一条命令即可完成从数据准备、基准测试到模型微调和迭代的全流程,最终交付一个性能超越基线的可部署模型。该工具通过与用户交互来理解任务,并自动生成任务专属的数据管道,利用大语言模型作为裁判来评分和筛选样本,实现了端到端的自动化。Liquid Harness 建立在 Liquid 自有的小型、高效基础模型之上,默认使用 LFM2-1.2B-Instruct。目前,该工具处于邀请制测试阶段,用户需申请获取安装链接。 #人工智能 #大模型 #AI开发 #机器学习 #科技新闻 #AI工具 #模型微调 #LiquidAI
安大略审计发现医生AI笔记助手可能编造信息

近年来,为减轻工作负担,许多医生开始使用AI医疗记录助手,自动将患者对话、诊断和护理决策整理为结构化病历记录。然而,安大略省审计总长在最新报告中指出,该省政府推荐并预审的20家AI供应商产品普遍存在严重问题。审计测试显示,所有供应商在至少一项简单模拟对话测试中均出现准确性或完整性错误,包括九家虚构患者信息、十二家错误转录内容、十七家遗漏心理健康关键细节。这些错误可能直接导致不完整或有害的治疗方案,影响患者健康结局,例如AI助手虚构了不存在的血液测试转诊、错误记录处方药名,或忽视讨论中的心理健康问题。审计总长强调,此类缺陷凸显了AI在医疗领域应用的风险,亟需加强监管以确保患者安全。 #AI医疗 #审计 #患者安全 #安大略 #人工智能 #医疗技术 #健康记录 #技术风险
GA4错误归类AI流量,掩盖真实用户来源

一位拥有20多年经验的网站开发者发现,其网站PressMeGPT在Google Analytics 4(GA4)中直接流量占比异常高达88.3%。为探究原因,作者在注册表单中添加了“您从何处听说我们?”的问题。近400名用户的反馈显示,超过40%的流量来自ChatGPT等AI聊天工具,若加上Perplexity、Grok等,AI引荐约占45%。然而,GA4将这些流量全部归类为“直接流量”,因为AI界面缺乏传统引荐参数和HTTP头信息,导致数据追踪失效。作者指出,GA4仅准确报告了约4.84%的谷歌自然搜索流量,但严重低估了AI的影响。这一发现不仅揭示了GA4在追踪AI流量时的技术缺陷,还可能误导营销决策,使企业基于失真数据优化策略。文章进一步质疑Google可能有意淡化AI对搜索流量的影响,以维护其核心业务叙事。事件凸显了当前数据分析工具在适应AI驱动互联网生态时的滞后性。 #GoogleAnalytics #AI流量 #数据分析 #SEO #科技新闻 #ChatGPT #营销策略
大语言模型上下文窗口过载导致输出质量下降,影响开发效率

近期,软件工程师发现大语言模型如Claude 3.7在实际应用中存在上下文窗口质量问题。该模型宣传拥有200k的上下文窗口,但当输入接近147k-152k时,输出质量开始下降,类似于DJ音频信号过载导致音质受损的现象。具体表现为工具调用失败,例如执行git命令时无法正确处理,从而影响开发流程和效率。哈佛商学院的研究显示,使用这类AI工具能显著提升工程师生产力,但高昂的tokens成本成为关键因素。专家建议企业应为每个开发者每天预算100至500美元,以维持高效运作,否则可能在竞争中落后。这一现象凸显了AI工具在实际部署中的成本与性能平衡挑战。 #大语言模型 #上下文窗口 #AI #开发者工具 #生产力 #成本预算 #科技新闻
发布架构检查工具,专为AI辅助编程时代的代码质量保驾护航

针对AI生成代码可能潜藏架构问题的痛点,Revos作为一款新兴的架构治理工具正式亮相。该工具专为使用AI编程助手的团队设计,旨在解决“代码能通过编译和测试,但架构却悄然偏离正轨”的隐患。它通过扫描代码库、构建依赖图谱,来自动检测循环依赖等架构违规,不仅清晰解释问题根源,还会提供具体的修复建议,帮助开发团队在架构腐化初期就将其遏制。Revos支持快速初始化多种主流框架的预设规则,并生成易于阅读的报告,可轻松集成到CI/CD流程中,充当AI时代的“架构护栏”。 #AI编程 #代码质量 #软件架构 #DevOps #工具发布 #GitHub
梅奥诊所采用AI监听急诊室就诊,患者隐私与知情同意受质疑

梅奥诊所,作为美国大型医院网络,近年推广“环境监听”技术,通过设备记录患者与护士在急诊室等场景的互动,并借助AI处理数据以优化电子健康记录。该系统设置为“选择退出”模式,而非需患者主动同意的“选择加入”,导致许多患者,尤其是在紧急状况下,可能未察觉记录正在进行。通知海报尺寸小且位置不显眼,引发对知情同意的伦理争议。同时,研究指出AI笔记工具在背景噪音、佩戴口罩或患者有口音时准确性显著低于人类,进一步质疑其可靠性。梅奥诊所已与医疗技术公司Epic及AI企业Abridge合作,将这一技术应用于临床文档流程,约翰霍普金斯医院等机构也采用类似方案,凸显医疗AI普及中的隐私与准确性挑战。 #医疗AI #隐私保护 #知情同意 #梅奥诊所 #急诊室 #人工智能 #医疗科技 #健康数据
谷歌更新反垃圾政策,将AI操纵行为标记为垃圾内容

据Search Engine Land报道,谷歌近期对其垃圾邮件政策进行了重要更新,明确将任何试图“操纵”谷歌AI模型的行为视为垃圾邮件。这一新政策直接针对搜索结果中的AI Overview和AI Mode功能,旨在应对日益增多的恶意操纵尝试,通过不正当手段影响AI生成的内容。谷歌表示,此举是为了确保搜索生态的完整性和用户获得真实、高质量的信息,维护搜索结果的准确性和公平性。随着AI技术在搜索引擎中的深度集成,防止滥用变得尤为关键。该政策更新预计将影响SEO策略和数字营销实践,促使行业采用更合规的优化方法,从而提升整体搜索体验的质量,并体现了谷歌对AI伦理和用户保护的重视。 #谷歌 #AI #垃圾邮件 #搜索引擎 #科技新闻 #政策更新 #AI操纵 #SEO
安全团队评估AI渗透测试供应商的十个警示信号

随着AI渗透测试的兴起,它旨在帮助安全团队应对当前的规模化测试挑战,并以高质量结果完成更多测试。然而,作为一个新兴领域,各方对“AI渗透测试”的具体内涵尚未形成共识,且供应商的宣传中常常存在“AI洗白”现象。为此,业界梳理出十个需要在评估早期阶段重点质疑的警示信号,以帮助安全团队做出明智决策。 这些警示信号包括:警惕供应商对“自动化”程度的模糊描述;要求其详细解释如何实现“零误报”;注意测试环境是否贴近真实场景;质疑其“持续测试”承诺的实质;深入探查其声称覆盖的“数千漏洞类别”是否具体且能发现新威胁;要求查看真实的漏洞报告样本以评估透明度;并确保供应商对数据治理和安全防护措施有清晰、稳固的方案。通过提前审视这些问题,安全团队可以更有效地筛选出真正可靠、技术扎实的AI渗透测试解决方案。 #AI安全 #渗透测试 #网络安全 #供应商评估 #AI洗白 #信息安全 #安全技术
Sx 开源工具发布,革新 AI 技能管理与共享方式

一款名为 Sx 的开源包管理器近日亮相,旨在解决 AI 开发者技能和配置难以跨团队共享的痛点。该工具允许用户捕获最佳实践,如自定义技能、MCP 配置和命令,并通过版本控制、自动化分发及灵活的作用域管理(如组织、仓库或个人级别),将这些知识传播到整个团队。Sx 支持多种安装方式,并提供云服务、审计功能和用法分析,方便跨机器同步与监控。随着 AI 应用的普及,Sx 有望提升开发效率,促进社区协作,优化 AI 工作流程的标准化。 #Sx #开源 #AI #包管理器 #技能管理 #团队协作 #科技新闻 #工具 #开发效率
中国AI短剧工厂崛起,世卫组织警示全球健康目标倒退

据《麻省理工科技评论》报道,中国短剧产业正经历AI革命。今年1月,平均每天有470部AI生成的短剧上线,这些通常为手机浏览设计的煽情、狗血剧集如今大量无需真人演员和摄制团队。AI将制作周期从数月压缩至数周,成本最高降低90%,故事创作也日益由数据驱动。该模式正迅速向海外扩张,并重塑编剧和制作团队的工作方式。 与此同时,世界卫生组织最新报告敲响警钟,全球多项关键健康目标进展停滞甚至倒退。2024年新增130万HIV病例,疟疾在部分地区卷土重来,美洲疫苗接种率下滑,4280万儿童遭受严重营养不良。世界正严重偏离联合国2030年全球健康目标的轨道。报告凸显了全球卫生体系面临的严峻挑战。 #AI #短剧 #全球健康 #科技新闻 #人工智能 #公共卫生 #制造业 #联合国
彼得·诺维格加入40亿美元项目,在'Recursive'构建自我改进AI

人工智能领域资深专家彼得·诺维格已确认加入一个名为'Recursive'的大型项目,该项目获得了高达40亿美元的资金支持,专注于开发能够自我改进的人工智能系统。自我改进AI旨在通过算法优化实现自动学习和能力提升,减少对人工干预的依赖。诺维格作为该领域的权威人士,其参与预计将为项目注入关键技术洞察,推动AI在自主性和效率方面的突破。这一合作反映了全球科技界对前沿AI研发的持续投入,可能加速下一代智能技术的商业化应用。 #PeterNorvig #AI #自我改进AI #科技新闻 #投资 #Recursive #人工智能
2024深度解析:从PDF到AI

PDF文件在工业和日常生活中应用广泛,但处理起来却异常复杂。本文深入探讨了如何将PDF及类似文档转换为AI-ready的结构化数据,并提出了一种模块化工作流。尽管强大的视觉语言模型(VLMs)使PDF端到端任务如问答或信息提取变得可行,但作者指出,将PDF视为“源数据”会导致机器学习操作繁琐。相反,应尽早将数据提取到结构化格式,以简化自然语言处理(NLP)流程。通过将文档格式从任务中分离,如分类等操作变得更直接高效。这种方法有望提升大规模文档理解和信息提取的工业应用,为AI驱动的产品提供更可靠的数据基础。 #PDF处理 #AI #结构化数据 #NLP #文档理解 #深度学习 #技术新闻 #数据处理
安永因AI幻觉问题撤回研究报告

安永会计师事务所近日宣布撤回一份研究报告,原因是研究人员发现报告中使用了人工智能生成的内容,存在AI幻觉现象,即信息不准确或虚构。这一事件凸显了AI技术在数据处理和报告生成中的潜在风险,引发了对AI在学术和商业应用中可靠性的广泛关注。安永表示将加强审核流程,确保研究质量,并可能促使行业重新评估AI工具的使用标准,以维护研究诚信和公众信任。 #安永 #AI幻觉 #研究撤回 #人工智能 #科技新闻 #数据可靠性 #商业新闻
国际AI电影语料库发布,深度解析银幕上的未来想象

由Andrew Maynard领导的团队近日发布了一个国际AI电影语料库,旨在系统梳理人工智能在电影叙事中的演变与影响。该语料库收录了169部从1927年至2026年的影片,覆盖31个国家、21种语言,每部电影均标注了其描绘的未来类型(如反乌托邦或乌托邦)以及AI的刻画方式,支持跨年代、地域和愿景的比较研究。项目使用Claude Code等工具构建,提供免费在线查看器,支持按国家、语言、年代等多维度过滤和全文搜索,所有数据以CC BY 4.0许可公开,方便学术引用和公众探索。这一资源不仅为AI叙事研究提供了标准化框架,也揭示了全球文化对技术未来的多元想象。 #AI #电影 #语料库 #未来研究 #科技 #文化 #数据科学 #开放数据
AI治理工具ai_glue发布,助力企业监控与管控AI应用

随着OpenAI、Anthropic等大模型API在企业应用中普及,成本管控、数据安全与合规性成为关键挑战。开源项目ai_glue旨在解决这一问题。它并非一个新的AI框架,而是一个透明的代理与治理层,可无缝集成到现有应用中,无需代码重写。 该工具的核心功能是全面记录每一次AI API调用,包括提供商、模型、令牌用量、成本和延迟,并提供统一的仪表盘进行可视化分析。其治理功能强大,可设置模型白名单以阻止未授权模型调用,设定每日成本上限和频率限制以实施硬性管控,并内置正则表达式驱动的PII检测,自动标记含敏感信息的请求。部署方式灵活,既可个人本地评估,也支持团队在共享服务器部署,开发者仅需更改一个环境变量即可接入,实现日志、治理与审计的集中管理。 #AI治理 #开源工具 #数据安全 #企业AI #API管理
一人独撑14国市场不堪重负,打造日成本0.41美元的AI员工

18个月前,销售员Alan Scott Encinas加入一家毫无美国市场基础的中国初创公司。他一人从零搭建网站、营销内容和销售体系,涵盖批发、B2B等五种模式,并管理拉丁美洲、北美等14个国家的业务,使用五种语言。工作量巨大导致他身心疲惫,压力累积。为应对挑战,他基于早年在健身行业积累的销售心理学经验,构建了一个日成本仅0.41美元的AI员工,以自动化执行复杂的销售任务,从而提升效率并缓解个人负担。 #AI #创业 #销售自动化 #职场故事 #国际业务 #中国初创 #科技应用 #压力管理
ArXiv 将禁止提交 AI 生成垃圾论文的研究者一年

学术预印本平台 ArXiv 近期宣布,将对提交明显由 AI 生成论文的作者实施为期一年的禁令。该政策旨在应对学术诚信挑战,防止低质量或误导性内容污染研究文献。ArXiv 计算机科学部分主席 Thomas Dietterich 在社交平台 X 上详细说明,若论文包含幻觉引用、AI 元评论等确凿证据,表明作者未核实生成内容,将触发惩罚。受罚作者将被禁止提交一年,之后需先在知名同行评审期刊上获得接受,方可再次投稿。此举强调了研究者对 AI 生成内容的责任,推动维护学术质量与可信度。 #ArXiv #AI #学术诚信 #科研 #科技新闻 #人工智能 #学术出版 #预印本