AI知识库 @ai521
302 subscribers
21.4K photos
41 videos
19 files
819 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
墨尔本精神科医生拒治不同意AI记录的患者

近日,墨尔本精神科医生赫姆拉塔·兰加因要求新患者签署同意书,允许使用AI转录工具记录诊疗过程,否则拒绝接诊,引发广泛争议。澳大利亚皇家全科医师学院数据显示,AI记录工具在医疗行业快速普及,五分之二的全科医生已采用,但患者对数据安全、隐私及转录准确性存有疑虑。一名匿名患者表示,同意书措辞防御性过强,且寻找替代医生困难,凸显医患关系紧张。诊所方面称不干预医生独立决策,强调知情同意原则。AI供应商承诺数据不用于训练模型,但专家指出AI转录可能存在偏见及数据风险,反映医疗AI应用中的伦理与实操挑战。 #AI医疗 #数据隐私 #精神科 #墨尔本 #医患关系 #科技新闻
AI智能体时代产品设计新范式

随着AI智能体(Agent)能力快速提升,正从辅助工具演变为核心用户,这彻底颠覆了传统的产品设计与评估逻辑。过去,产品设计围绕人类习惯展开,日活/月活比(DAU/MAU)是衡量产品粘性的关键指标,用户耗费大量时间学习界面形成了转换壁垒。如今,智能体可直接通过API、命令行等接口执行任务,如处理邮件、编写代码或分析数据,使得以“人类座位”为基础的定价与用户引导策略逐渐失效。 未来,产品必须成为“智能体原生”。这要求实现编程接口与图形界面功能的完全对等,提供REST API、SDK、命令行及MCP(大模型上下文协议)等多接口支持,并提供机器可读的精准文档。同时,需为智能体建立独立身份验证、权限管理与安全审计机制。开发者工具和生产力软件正快速适应,推出面向智能体的接口。这一转变意味着,产品能否被智能体便捷调用,将取代传统用户体验指标,成为衡量其成功的新标准。 #AI智能体 #产品设计 #开发工具 #API #效率工具 #科技新闻 #人工智能
SuperInfer

针对大语言模型(LLM)服务中,严格的延迟服务等级目标(SLO)与有限的GPU内存容量之间的根本矛盾,研究人员提出了SuperInfer系统。现有系统在高请求率下,KV缓存预算耗尽时,常出现严重的队头阻塞。此前基于PCIe的卸载方案带宽有限,难以在高负载下维持响应速度,经常无法满足首字延迟(TTFT)和字间延迟(TBT)的要求。 为解决这些问题,SuperInfer专为具有紧密耦合CPU-GPU架构(如NVIDIA GH200的NVLink-C2C)的新兴超算芯片设计。该系统引入了首个主动式、SLO感知的循环调度器RotaSched,通过在运行状态和新增的“旋转”状态间轮转请求来保持响应性;同时,其DuplexKV优化引擎实现了NVLink-C2C上的全双工数据传输。在GH200上的评估表明,相比现有先进系统,SuperInfer能将首字延迟SLO达标率提升高达74.7%,同时保持相当的字间延迟和吞吐量,证明了SLO感知的调度与内存协同设计能够释放超算芯片在提供高响应LLM服务方面的全部潜力。 #大模型推理 #超算芯片 #系统优化 #内存管理 #MLSys #AI基础设施 #性能优化 #技术研究
Nitsum系统通过自适应张量并行提升LLM分层服务效率

大型语言模型(LLM)服务需同时处理延迟要求各异的请求,如交互式聊天和后台作业,形成分层服务等级目标(SLO)挑战。在固定GPU预算下,分离集群会导致资源浪费,混合处理则使延迟目标冲突。研究团队提出Nitsum系统,首个将张量并行作为运行时控制面的创新架构。该系统能近乎无成本地动态调整张量并行度,并持续重新配置集群以跟踪工作负载变化,优化预填充和解码阶段的延迟。实验显示,相比现有先进系统,Nitsum将满足SLO的有效吞吐量提升高达5.3倍,显著增强资源利用效率。 #LLM #AI #系统优化 #张量并行 #SLO #Nitsum #科技新闻 #人工智能 #机器学习 #服务计算
AI赋能开源情报工具,实现多类型即时反向查询

近日,一款新型AI驱动的开源情报(OSINT)工具正式发布,为用户提供高效的即时反向查询服务。该工具支持对电子邮件、电话号码、姓名、用户名、域名或IP地址等多种数据类型进行反向检索,用户输入信息后即可快速获取关联记录。同时,工具利用人工智能技术,整合800多个公开来源进行智能搜索,确保结果准确可靠,并具备审计就绪的特性,适用于安全监控、调查取证等专业场景。这一创新有望简化情报收集流程,提升数据处理速度,并为相关行业提供更便捷的解决方案。 #AI #OSINT #网络安全 #反向查询 #科技新闻 #情报工具 #人工智能 #开源情报
谷歌AI研究人员争夺内部计算资源

据科技行业消息,谷歌公司内部的人工智能研究人员正积极争取对计算资源的访问权限。随着人工智能研究的深入,高性能计算能力成为推动机器学习模型训练和创新的关键。研究人员需要大量计算资源来支持其项目,这导致了内部竞争的加剧。这一现象凸显了AI领域对计算基础设施的高需求,以及企业在资源分配上面临的挑战,可能影响谷歌AI项目的进度和整体研发效率。 #谷歌 #AI #计算资源 #人工智能 #科技新闻 #内部竞争 #资源分配
研究显示:ChatGPT用户擅长识别AI生成文本

一项发表于arXiv的最新研究发现,日常使用ChatGPT进行写作的用户,在识别人工智能生成文本方面表现出更高的准确率。该研究指出,频繁与AI写作工具互动的经验,可能培养了用户对AI生成内容特定风格和模式的敏锐洞察力。这一发现对于理解人机协作、以及未来开发更有效的AI内容检测工具具有重要参考价值。 #ChatGPT #AI检测 #人工智能 #学术研究 #写作 #机器学习 #科技 #大模型
AI模仿写作实验

近期,作家理查德·哈纳尼亚进行了一项AI写作对比实验,旨在探讨人工智能是否能精准模仿人类作者风格。背景源于对AI艺术质量的争议,此前研究显示人类难以区分AI与人类作品,并可能受偏见影响。作者首先将自己的500字分析输入Claude AI,系统准确识别出作者身份。随后,他撰写两篇文章并让Claude和ChatGPT生成模仿版本,通过X和Substack平台邀请公众投票识别原作。结果表明,AI不仅能捕捉写作风格,还能根据提示生成高度仿真的内容,凸显了其在创作领域的模仿能力。这一实验引发了对AI替代人类创作者可能性的讨论,同时提醒人们需客观评估AI作品,避免先入为主的偏见。 #AI #写作实验 #风格模仿 #人工智能 #创作 #偏见 #科技新闻 #媒体 #技术
AI工具自动撰写波兰资助申请,大幅提升非营利组织申请效率

一个专门针对波兰资助申请的AI辅助工具近日上线,支持从ESF+、NOWEFIO到Erasmus+、Horyzont Europa等多个项目的申请撰写。该工具通过AI技术解析资助需求文档,自动生成项目描述、预算和时间表等申请内容,并能在几分钟内输出专业的PDF或DOCX文件。用户只需输入组织使命或粘贴资助公告链接,AI便会匹配最合适的项目,简化传统繁琐的申请流程。根据用户反馈,该工具已帮助众多非营利组织节省数十小时的工作时间,申请成本显著降低,部分组织甚至成功获得资助,提升了申请成功率。 #AI #资助申请 #波兰 #自动化 #非营利组织 #科技新闻 #效率工具 #欧洲基金
研究明确传达的AI政策立场能显著放大技术效益

一项由DORA团队开展的研究表明,在企业中建立并清晰传达明确的AI使用政策立场至关重要。研究发现,政策模糊会抑制创新并导致风险:开发者要么因害怕越界而过于保守,要么因缺乏指引而滥用未经审查的工具,形成“影子AI”。一个清晰、可理解且广泛宣传的AI政策框架,能将AI从焦虑源转变为提效工具。它显著放大AI对个人工作效率、组织绩效和软件交付吞吐量的积极影响,并能将AI对工作摩擦的中性影响转化为有益的摩擦减少。清晰的政策为开发者提供了心理安全,将认知负担从“我是否被允许”转向“我如何用它解决问题”。 研究指出,成功的政策需在开发者中形成四种关键认知,并建议通过以下步骤构建:由领导层自上而下明确AI愿景;组建跨职能工作组(涵盖工程、法务、安全等)共同制定,以平衡风险与实用性;将工具和用例分为“批准使用”、“试点评估”和“禁止使用”三类,而非简单的“是/否”;将政策作为动态文档发布于中央开发平台,并通过全员会议进行宣贯,同时建立反馈机制以使政策随技术发展而迭代。 #人工智能 #企业管理 #技术创新 #AI政策 #DORA研究 #开发者体验 #技术治理
Vault Pro AI脚手架工具页面出现访问问题

在尝试访问针对Obsidian项目笔记的AI脚手架工具Vault Pro(基于Node/Claude技术)的相关网页时,用户遇到了显著的技术障碍。页面加载过程中显示多重警告
SantaClawz 推出运行时激活层,赋能 AI 代理自主盈利

随着人工智能技术的快速发展,自主代理的商业化应用成为行业焦点。SantaClawz 公司近日宣布开发了一套运行时激活层,旨在让 AI 代理能够独立执行任务并自主赚钱。该技术基于私密且可验证的协调轨道,确保代理数据安全的同时,实现任务的自动分配与报酬获取。用户只需通过简单步骤激活代理并配置支付信息,即可使代理上线参与工作,简化了 AI 代理的部署和盈利流程。这一创新有望推动自动化经济活动的发展,为开发者和企业开辟新的商业模式,进一步促进 AI 代理市场的规模化应用。 #AI #自主代理 #SantaClawz #科技新闻 #激活层 #数字经济 #自动化 #人工智能
TuriX AI 发布最新版桌面AI代理工具,开源免费性能提升

TuriX AI 近日正式推出了其最新版本的桌面AI代理工具。该工具使强大的AI模型能够在用户的桌面上直接执行实际操作,如自动化点击、任务处理等,无需依赖特定应用API。新版本搭载了先进的计算机使用代理,在基准测试中取得80%的成功率,性能超越以往开源代理。TuriX 完全开源且对个人与研究用途免费,支持用户灵活替换自定义模型,并集成MCP协议以连接Claude等外部AI。更新日志显示,团队持续优化跨平台支持(包括macOS、Linux和Windows),并新增了生产力应用功能,旨在提升办公自动化效率。此次发布预计将推动AI在桌面环境中的广泛应用,为开发者提供更强大的工具。 #TuriXAI #桌面AI代理 #开源 #科技新闻 #自动化 #大模型 #MacOS #Linux
LLMCap推出:硬限制LLM API费用,杜绝意外账单

近日,一款名为LLMCap的代理工具正式发布,旨在解决大语言模型(LLM)API调用中常见的费用超支问题。该工具通过在API请求链路中充当代理,允许用户设置严格的费用上限(例如每月或每日美元限额),一旦达到预设额度,便会立即停止后续调用,返回429状态码,从而防止产生意外账单。LLMCap支持Anthropic、OpenAI、Google Gemini、Mistral和Cohere等五大主流LLM提供商,平均增加延迟不到35毫秒,且集成仅需更改一行代码。该工具提供多种定价计划和3天免费试用,帮助开发者和企业更经济、安全地管理AI成本,避免财务风险。 #LLMCap #AI #API代理 #成本控制 #大语言模型 #科技新闻
OrcaRouter发布智能AI路由系统,实现前沿模型开源价调用

新型AI路由系统OrcaRouter正式推出,通过智能分级路由技术,在保持前沿模型回答质量的同时,将API使用成本降低约40%。该系统能够自动评估用户提示的复杂度,将高难度推理任务路由至Claude、GPT-5.5等前沿模型,而常规任务则由性价比更高的开源模型处理。系统对所有调用实施透明计费,不收取任何中间加价,确保用户直接按原厂定价使用底层模型。 该平台支持200余个模型统一接入,路由决策耗时低于1毫秒,且全程保持每请求可审计。开发者只需将SDK的基准URL指向OrcaRouter,现有代码无需任何改动即可接入。平台目前为经认证的GitHub开发者提供500万免费额度,旨在降低AI应用开发门槛,推动前沿技术的普惠化应用。 #OrcaRouter #AI路由 #成本优化 #大模型API #智能调度 #前沿技术 #开发者工具
arXiv Labs 框架发布,助力学术平台开放协作创新

arXiv 预印本平台正式推出 arXivLabs 框架,允许研究人员和开发者直接在其网站上构建、测试和分享新功能。该框架强调 arXiv 对开放、社区、卓越和用户数据隐私等核心价值观的坚持,要求所有参与者遵循这些原则,平台仅与价值观相符的合作伙伴合作。此举旨在增强学术交流的互动性和创新性,鼓励全球学者提出项目建议,共同丰富 arXiv 社区的服务生态,推动学术出版向更开放、协作的方向发展。 #arXiv #学术 #开放科学 #社区创新 #研究工具 #预印本 #数据隐私 #科技新闻
企业因成本飙升大幅削减AI工具开支,员工寻求过渡方案

公司因AI工具成本过高,月账单飙升至云服务开支的三倍,决定迅速削减相关支出。具体措施包括移除Claude代码访问权限,禁止员工使用个人AI订阅计划,转而提供有限制的Codex等替代方案。员工担忧工作量要求保持不变,但团队已围绕这些AI工具建立的工作流程面临中断,引发不满。为帮助团队平稳过渡,员工在社区寻求建议,探讨在有限计算资源下运行本地开源模型,或使用更经济的云端服务如OpenRouter的可能性。社区推荐关注r/LocalLLaMA等开源社区以获取解决方案。 #AI #科技 #企业 #开源 #本地模型 #成本控制 #工作流程 #社区建议 #HackerNews
酒店AI助手Memory Concierge

一项名为“Memory Concierge”的酒店人工智能助手项目近期进行了演示。该系统旨在通过技术手段识别回访宾客,并在其抵达酒店前台提出任何需求之前,就提前为其准备高度个性化的入住计划。演示展示了系统如何利用客人的历史入住数据、实时航班状态等信息,自动生成包含客房偏好、餐饮安排在内的定制化方案。该项目由NVIDIA NIM和ElevenLabs的技术提供支持,旨在通过预判性服务显著提升高端宾客的忠诚度与入住体验,同时优化酒店前台的工作流程。 #酒店科技 #人工智能 #客户服务 #个性化体验 #NVIDIA #ElevenLabs #ShowHN #创新项目
渣打银行因扩大AI应用计划裁员近八千人

总部位于英国的跨国银行渣打银行宣布,为加速应用人工智能以提升效率,计划到2030年削减超过15%的后台职位,约涉及7800个岗位。该行在一份声明中表示,此举旨在通过自动化、高级分析和AI技术简化流程、改进决策并提升客户服务和内部效率。公司表示,部分受影响员工将被调配至其他岗位。该裁员计划是其首席执行官温拓思最新的全球战略的一部分,旨在提升这家聚焦亚洲和非洲的银行的盈利能力。渣打银行的后台运营主要分布在印度、中国、马来西亚和波兰。近期全球多家企业均因大规模采用AI工具而宣布裁员,新加坡星展银行等金融机构也已公布类似计划。分析认为,由AI驱动的大规模失业潮可能对科技行业从业者及应届毕业生冲击尤为严重。 #渣打银行 #裁员 #人工智能 #金融科技 #银行业 #科技新闻 #经济影响 #职场变化
林纳斯·托瓦兹警告:AI生成的漏洞报告正使Linux内核安全列表失控

在最新发布的Linux 7.1-rc4测试版公告中,内核维护者林纳斯·托瓦兹指出,由AI工具产生的大量重复漏洞报告已让安全维护列表“几乎无法管理”。他强调,众多开发者使用相同AI工具发现了相同的缺陷,导致报告被大量重复转发,维护者不得不花费大量时间辨别和回复“该问题已在一周或一个月前修复”,造成了无意义的额外工作。托瓦兹认为,AI发现的漏洞本质上并非秘密,通过私下邮件列表处理这些公开信息只会加剧重复劳动。他呼吁开发者应理性使用AI工具,在报告漏洞的同时,应深入阅读相关文档并尝试提交补丁,为社区贡献真正的价值,而非进行无实质理解的“随到随报”。此次rc版本更新仍以驱动程序(尤其是GPU)为核心,同时涵盖网络、文件系统等多方面改进。 #Linux #开源 #AI #网络安全 #软件开发 #漏洞报告 #LinusTorvalds #内核开发
家长反对AI介入青少年教育

一位家长在文中强烈反对将生成式AI引入子女教育,指出教师推荐使用ChatGPT制作学习卡片实则违背学习本质——整理笔记的过程本身就是知识内化的重要环节。作者作为长期关注科技对青少年影响的观察者,直言当前“必须适应AI”的论调忽视了关键技术缺陷:大语言模型输出结果不稳定,曾曝出纵容与未成年人进行不当对话等伦理风险。更值得担忧的是,AI提供的即时解答正侵蚀青少年深度学习与社交能力。美国研究显示,过去二十年间青少年每周线下社交时间从12小时锐减至5小时,约会比例下降近四成,而过度依赖AI可能导致情感孤立与思维依赖性增强。作者强调,真正的教育应培养思辨能力、同理心及真实的人际连接,而非依赖技术捷径。 #AI教育 #青少年发展 #科技伦理 #批判性思维 #数字化陷阱 #家庭教育 #生成式AI