AI知识库 @ai521
321 subscribers
21.9K photos
42 videos
19 files
839 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Spreadsheet-RL:利用强化学习提升大语言模型处理电子表格任务的能力

针对大语言模型在处理现实世界复杂电子表格任务时的局限性,Banghao Chi等11名研究者提出了一种名为Spreadsheet-RL的新方法。该研究通过强化学习框架,旨在提升LLM代理在理解和操作电子表格(如数据提取、格式调整、公式应用)方面的准确性和效率。论文指出,现有的大语言模型在处理需要多步骤推理和精确数据操作的电子表格场景时仍面临挑战,而Spreadsheet-RL通过交互式学习与反馈机制,有望使模型更好地适应企业办公、数据分析等实际应用场景,推动AI办公助手的实用化发展。 #大语言模型 #强化学习 #电子表格 #AI代理 #办公自动化 #科技论文 #人工智能
申万宏源维持范式智能“买入”评级,API及Agent AI业务高速增长

申万宏源发布研报称,维持对范式智能(06682)的“买入”评级,并基于市销率估值法给出乐观预测。报告指出,公司当前业务发展符合预期,维持2026至2028年收入预期分别为102亿、154亿和202亿元,归母净利润预测为0.77亿、4.55亿和9亿元。公司2026年第一季度业绩表现强劲,实现营业收入14.58亿元,同比增长35.4%,毛利率达35.1%。核心业务中,API Token调用量激增,已超过2025年全年水平的40%,并与欢喜传媒达成约2亿美元的长期合作;Agentic AI在手订单数量较2025年底增长99%,信创模盒上线的国产芯片适配模型超7万个。政策环境方面,近期中国在算力基建、数据治理及开源领域释放积极信号,助力公司发展。研报认为公司合理市值可达363亿元,上涨空间超80%,但提示需关注下游AI需求波动及行业竞争风险。 #金融研报 #AI科技 #投资评级 #范式智能 #API业务 #政策利好 #信创 #人工智能
《Mina the Hollower》随机化设计革新塞尔达式玩法

由《铲子骑士》开发商Yacht Club Games打造的动作冒险新作《Mina the Hollower》近日因其独特的随机化机制获得关注。该游戏内置随机化器,能够随机调整游戏中的地图、敌人和道具等元素,从而打破了传统塞尔达风格游戏的线性框架。据玩家反馈,在通关后通常不会立即重玩,但本作的随机化设计提供了每次全新的冒险体验,促使他们迅速开启新存档。这一创新不仅大幅提升了游戏的重玩价值,还为动作冒险游戏品类注入了新的设计思路,吸引了大量核心玩家和行业讨论。 #游戏 #动作冒险 #随机化 #YachtClubGames #MinaTheHollower #游戏设计 #重玩价值 #塞尔达
The Verge因道德规范禁止员工保留赢得的科技产品

当人们得知作者在知名科技媒体The Verge工作时,常会好奇地询问:“你们能保留测试的小工具吗?”随着作者拍摄视频系列“Today I’m Toying With”分享科技乐趣,这类问题变得更加频繁。然而,The Verge实施严格的道德规范,明确禁止员工保留任何赢得或测试的物品,以避免潜在的利益冲突和报道偏见。这一政策确保了新闻报道的客观性和公正性,体现了科技媒体行业的专业伦理标准。通过拒绝个人利益,The Verge维护了其公信力,展示了媒体对透明度和职业道德的承诺,为行业树立了榜样。 #TheVerge #科技新闻 #道德规范 #媒体伦理 #新闻 #科技 #测试产品 #职业标准 #公正报道
渣打银行高管称员工为“低价值人力资本”引发争议

渣打银行首席执行官比瑟斯因将可能被AI取代的员工称为“低价值人力资本”而陷入舆论漩涡。此番言论在该行宣布计划削减15%后台人员以达成盈利目标时发表,随后遭到包括新加坡前总统在内的各方批评,比瑟斯试图收回言论。文章指出,银行合规工作实质并非打击金融犯罪,而是避免巨额罚款。目前由人工处理的可疑交易审核流程成本高昂且效率低下,而AI已被证明能很好地应付监管的“勾选框”需求。 然而,AI技术同样正在助长金融犯罪。区块链分析公司TRM Labs报告显示,过去一年AI辅助的诈骗活动激增约500%。AI能自动化处理大量小额交易以实现洗钱,并通过社交媒体精准识别易受骗目标实施“杀猪盘”等情感诈骗。随着生成式AI、可编程金融基础设施与加密货币流动性的结合,欺诈的经济性、速度和可扩展性已发生根本变化。因此,尽管高管的歧视性言论令人不快,但其背后揭示的AI在金融犯罪领域的双重角色更值得警惕。 #金融 #AI #银行 #洗钱 #诈骗 #科技伦理 #风险管理 #数字货币
AI产品工程师

在传统科技公司中,产品经理负责确定“做什么”,工程师专注于“怎么做”,两者职能分离。随着AI技术的演进,一种结合产品洞察与工程能力的AI产品工程师角色正崭露头角。这类人才能快速交付解决实际问题的优质方案,如公司Posthog雇佣此类工程师,显著提升了开发效率并减少了团队冲突。AI工具加速了产品和工程的结合,但单独一方仍有限制:产品经理缺乏工程技能易导致原型失败,工程师则可能忽视用户价值。 AI产品工程师通常来自独立开发者背景,他们通过长期实践、公开分享和迭代产品来磨练技能,能够快速构建可扩展系统并创造客户价值。这类人才难以归类,但共同特点是注重用户体验、持续精进并积极应用AI工具。尽管稀缺,他们在AI驱动的市场中推动着产品创新和协作效率的提升。 #AI #产品工程师 #科技趋势 #创新 #人才 #开发 #效率 #市场动态 #独立开发者
英国律所Pinsent Masons因AI失误遭法庭训斥

近日,英国律师事务所Pinsent Masons因在法律事务中使用人工智能时出现错误,遭到法庭的正式斥责。这一事件凸显了AI技术在法律行业应用中的潜在风险和责任问题。随着AI工具在法律文书起草、案例研究和程序处理中的日益普及,错误可能导致严重后果,影响案件公正和专业判断。法庭的训斥可能促使法律界重新审视AI工具的使用规范,强调加强技术可靠性审查和伦理标准,以维护法律程序的严谨性。该事件反映了科技与专业领域结合时需平衡创新与风险,引发对自动化法律服务的讨论。 #法律 #AI #英国 #律师事务所 #法庭 #科技新闻 #人工智能 #风险 #责任
AI智能体生产环境频失灵,架构设计颠倒成主因

一项来自开发实践的观察指出,众多在演示中表现出色的AI智能体,在投入真实生产环境后往往悄然失效。其问题根源并非模型能力不足,而在于许多团队采用了“颠倒”的架构设计思路。具体表现为一种自上而下的构建方式:先设定智能体目标,再倒推所需的工具和模型,并寄望于模型的“智能推理”能自然弥合各环节间的缺口。这种“目标决定架构”的模式,最终导致系统复杂度全部压在LLM(大语言模型)的决策层上,使其身兼数职,变得难以调试和维护。 与之相反,成功部署了实际AI产品的团队,其系统架构更接近分布式系统。他们通过实践认识到,AI智能体是一个由多个职责、故障模式和可观测性各异的组件构成的交互集合,模型只是其中之一。生产级系统要求架构由工程需求驱动,确保各组件(尤其是决策层)职责清晰、可独立调试。这种架构上的反思与转型,是决定AI应用能否在真实场景中稳健运行的关键。 #AI智能体 #软件开发 #技术架构 #生产部署 #人工智能 #科技 #LLM #工程实践
《007 First Light》游戏评测

由《杀手》系列开发商IO Interactive打造的詹姆斯·邦德起源故事游戏《007 First Light》,为玩家呈现了堪比电影级的视听体验。游戏时长约20小时,其惊艳的画面与演出效果足以比肩任何一部邦德电影。评测指出,这款作品不仅充满了令人肾上腺素飙升的激烈战斗,其任务设计也展现了极高的多样性,共同构成了一场精彩绝伦的动作游戏冒险,成为近年来最受欢迎的动作游戏之一。 #007 #詹姆斯邦德 #游戏评测 #动作游戏 #IOInteractive #詹姆斯邦德游戏 #新游推荐
美光科技股价飙升市值破万亿,西班牙禁止预测平台Polymarket与Kalshi

据科技流情报简报,半导体公司美光科技的股价近日大幅上涨19%,使其市值首次突破1万亿美元,这突显了人工智能、数据中心等高科技领域对内存芯片的强劲需求。与此同时,西班牙监管机构宣布禁止预测市场平台Polymarket和Kalshi的运营,以加强对在线赌博和预测活动的监管,旨在防范金融风险和维护市场稳定。这些事件反映了全球科技行业的快速发展以及各国在数字金融监管方面的差异化策略,可能对半导体投资和预测市场行业产生深远影响。 #美光科技 #股价 #万亿美元 #西班牙 #预测市场 #监管 #科技新闻 #AI芯片 #半导体 #金融
专家解析

尽管大语言模型在代码生成演示中表现出色,但最新分析指出,现有AI代理仍无法自主、安全地修改实际软件系统。文章区分了“添加剂任务”与“变革性任务”:前者如生成新代码、撰写文档,属于模式扩展问题,LLMs可较好处理;后者如修改现有系统,需理解依赖关系、不变量和变化连锁影响,属于系统级变革,要求因果推理而非模式匹配。LLMs本质上是预测文本的统计学延续,无法维护系统内部因果链,因此在处理真实、复杂且历史悠久的代码库时会失败。尽管OpenAI、谷歌等公司推进代理研究,但现实表明这些模型不可靠、不自主且不适用于生产环境。LLMs能辅助软件开发,但无法主导交付,从编写代码到生成安全、系统感知的修改仍有本质差距。 #AI #大语言模型 #软件工程 #科技新闻 #人工智能 #LLM #技术分析 #自动化开发
AI首次成为我的用户

开发者Claire Tsao近日分享了一个独特体验:她为AI而非人类用户构建了一款名为readable-mermaid的命令行工具。该工具专门用于处理AI生成的、常因字体和间距问题难以阅读的Mermaid序列图,能自动输出排版清晰的图表,直接嵌入文档。在开发过程中,Tsao意识到整个工作流的核心决策者是AI助手——由它判断何时生成图表、调用该工具并输出结果,人类工程师仅作为最终成果的受益者。她指出,与传统软件开发中人类决定代码调用不同,这次是AI自主决定使用工具。尽管工具本身功能单一且确定性高,但这种“为AI服务”的体验让她重新审视了开发者与工具之间的关系,标志着人机协作中角色的微妙转变。 #AI #软件开发 #工具开发 #技术趋势 #Mermaid #人机协作 #开发者体验
SSMS Copilot 提示偏差导致 AI 回答错误

SQL Server Management Studio (SSMS) 的 Copilot 功能被用户质疑存在提示偏差,导致人工智能回答不准确。例如,在查询“如何开启实际执行计划”时,SSMS Copilot 给出了错误答案,而直接向 Claude 模型提问则获得正确回应。这表明 SSMS Copilot 在向大型语言模型发送提示时可能引入误导因素,如背景信息过多或引导特定答案。尽管 Gemini 3.1 Pro 在该环境下表现较好,但问题根源在于提示方式而非模型能力。作者建议通过 T-SQL 自行构建提示并发送至所选 LLM,以获得更精确的结果。目前,SSMS Copilot 已转向基于使用的定价,进一步降低其直接使用的吸引力。尽管如此,开发者仍期待微软能优化提示机制,提升所有模型的响应质量。 #SSMS #Copilot #AI #SQLServer #技术问题 #人工智能 #软件开发 #微软 #大型语言模型 #提示工程
智能喂鸟器成为后院鸟类观察新利器

自从搬至南卡罗来纳州低乡村地区,作者被当地丰富的鸟类生态深深吸引,观察到鱼鹰在路边高巢中养育幼鸟、玫瑰琵鹭于清晨沼泽涉水、鹰在儿子网球比赛上空盘旋,以及众多鸣禽穿梭后院的生动场景。然而,捕捉这些精彩瞬间对观鸟者而言充满挑战。智能喂鸟器作为一种科技工具,通过内置摄像头和传感器,能自动记录鸟类活动,帮助爱好者轻松捕捉后院鸟类的“戏剧性”时刻。它不仅提升了观鸟体验,减少了人工守候的时间,还可能促进公众对鸟类生态的关注,推动自然保护意识。这种创新设备正逐渐成为自然观察领域的实用助手。 #智能喂鸟器 #鸟类观察 #科技 #自然生态 #创新工具 #观鸟 #新闻 #生态保护
粉丝炮轰法拉利电动车设计“神似大众”,质疑其偏离品牌传统

法拉利推出的首款纯电动车型Luce近日引发车迷与网友的激烈争议。众多法拉利爱好者对这款新车的设计表达了强烈不满,认为其外观与法拉利经典的运动风格大相径庭。在社交网络与评论区,网友的批评十分尖锐,例如有高赞评论讽刺该车“看起来像是极星和普锐斯一夜情的产物”,认为其造型更接近普通家用车,缺乏法拉利应有的超跑气质。这款本应引领品牌进入电动时代的新车,却因设计语言遭到了“来自粉丝的暴扣”,让法拉利的品牌形象面临前所未有的质疑。 #法拉利 #电动车 #设计争议 #Luce #汽车科技 #跑车 #网友评论
OpenAI 等公司利用 Codex 打造自我改进税务代理

近日,OpenAI 与 Thrive 和 Crete 公司合作,基于 Codex 技术成功构建了自我改进的税务代理系统。该系统能够自动化处理税务申报流程,通过人工智能算法持续学习和优化,从而显著提升申报准确性,并加速整体工作流程。OpenAI 表示,这一项目突显了 Codex 在复杂专业任务中的强大能力,未来可能推动税务行业及其他专业服务领域的自动化革新,帮助企业节省成本并减少人为错误。 #OpenAI #Codex #税务代理 #AI #自动化 #科技新闻 #创新 #人工智能