AI知识库 @ai521
301 subscribers
21.5K photos
42 videos
19 files
821 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
谷歌正式宣布将在AI模式搜索结果中加入广告

谷歌官方公告,正在将Gemini模型集成到搜索引擎中,测试新的AI驱动广告形式。这些广告旨在通过对话式体验为用户提供个性化的产品指导和清晰的产品说明,包括“对话式发现广告”、“高亮答案”以及“AI购物广告”等新格式。此举旨在帮助品牌在用户进行产品研究时,更有效地与消费者建立连接。谷歌强调,新广告中将包含由AI独立生成的产品解释说明,并会继续明确标注“赞助”字样,以确保透明度。目前,相关功能已开始向部分用户测试,并鼓励广告主提前准备,以充分利用即将全面推出的新特性。 #谷歌 #AI搜索 #搜索广告 #Gemini #数字营销 #人工智能
Excel公式实现微型GPT模型,探索AI内部工作机制

一位开发者通过纯Excel公式成功构建了一个微型GPT模型,旨在作为学习工具深入理解大型语言模型的内部运作。该项目灵感来源于Andrej Karpathy的microGPT,采用了RMSNorm、无偏置和ReLU等简化设计。模型以展开循环的方式在Excel工作表中实现,每个块对应一个输出token,详细展示了注意力机制和多层感知机块的计算过程。尽管这种实现方式复杂且不适合实际应用,但它允许用户直观地观察模型逐token生成的过程,有助于教育和调试目的。开发者强调,在真实场景中应将复杂逻辑保留在Python中,并通过PyXLL等工具集成以提高效率。 #AI #GPT #Excel #机器学习 #学习工具 #技术探索 #大模型
AMD 发布 Ryzen AI Max PRO 400 处理器,最大支持 192GB 内存

在本月下旬 Computex 展会前夕,AMD 抢先发布了全新的 Ryzen AI Max PRO 400 系列处理器。该系列延续了 Strix Halo 架构,主要升级在于大幅提升内存支持。新处理器可搭配高达 192GB 的 LPDDR5X-8533 内存,相比上代 300 系列的 128GB 容量增加了 50%,内存带宽也提升至约 273GB/s。基于新款处理器的系统将于今年第三季度开始出货。 此次发布的 PRO 版本在计算性能上提升有限,主要变化集中在内存规格。Ryzen AI Max+ PRO 495 旗舰型号的 CPU、GPU 和 NPU 频率略有提升。更大的内存池对于本地 AI 推理用户意义重大,其 GPU 可分配最多 160GB 显存,从而能在单一 SoC 系统中加载高达 300B 参数的 FP4 模型,这在非 Mac Studio 设备中尚属首次。尽管这显著提升了处理大型模型的能力,但由于计算吞吐量和内存带宽未发生本质改变,系统原有的性能瓶颈可能依然存在。值得注意的是,本次发布仅包含面向专业市场的 PRO 版本。 #AMD #RyzenAIMax #处理器 #AI #内存 #LPDDR5X #Computex #科技新闻
谷歌发布Gemini 3.5 Flash,声称能像人类团队般思考

在2026年Google I/O大会上,谷歌推出了最新AI模型Gemini 3.5 Flash,声称这是其迄今最强大的“Flash”版本。该模型在编码、推理、多模态理解和长期上下文处理方面均有显著改进,能像人类团队一样将复杂问题分解为多个分析路径,深入理解上下文后执行。独立测试显示,Gemini 3.5 Flash在航空航天模拟、旅行规划等任务中表现出色,例如生成交互式太空垃圾模拟或制定考虑旅行节奏的行程,展示了并行推理和代理计划能力。尽管引发了对数据隐私的担忧,但这一发布表明谷歌在AI竞赛中仍具竞争力,其技术标志着AI从简单聊天机器人向思维系统的演变。 #谷歌 #Gemini #人工智能 #AI大模型 #科技新闻 #深度学习 #AI竞赛
Intuit CEO回应大规模裁员

Intuit首席执行官萨桑·古多齐澄清,公司近期约17%的大规模裁员计划,主要目标是简化运营结构、提升执行效率,而非直接归因于人工智能技术的引入。他指出,此次人员调整是公司内部优化的一部分,旨在确保团队能够更聚焦、更快速地推进各项业务。公司强调,这一决定经过深思熟虑,是为了适应不断变化的市场环境,并强化其长期竞争力。 #Intuit #裁员 #企业管理 #科技公司 #AI #人力资源 #商业新闻 #美国企业
KiroGraph 发布本地代码知识图谱,显著优化 AI 代理效率

KiroGraph 是一款专为 AI 代理设计的本地代码知识图谱工具,旨在通过减少工具调用来优化 token 效率。传统上,AI 在处理复杂代码任务时需频繁使用文件扫描、搜索等工具,这会消耗大量上下文并降低响应速度。KiroGraph 通过 tree-sitter 解析源代码,预先构建语义知识图谱并存储在本地 SQLite 数据库中,使 AI 能够即时查询符号关系、调用图和影响范围等信息,仅需单次工具调用即可获取数据,从而提升任务处理效率。该工具完全在本地运行,无外部服务依赖,确保数据隐私和安全。它支持可选的语义和架构分析层,以增强功能,并已集成到 Kiro 系统中,通过自动索引保持更新,为开发者提供高效、安全的 AI 辅助编程解决方案。 #KiroGraph #代码知识图谱 #AI开发 #本地化 #效率优化 #编程工具 #技术新闻
控制信息入口的三层结构

一场围绕人类信息获取方式的控制权争夺正在悄然进行。控制信息流向需要三个关键层:用以观察用户行为的浏览器、用以描绘整个网络的搜索索引,以及用以直接回答问题的AI。当一家公司同时拥有这三者时,便形成了一个强大的闭环:浏览器观察用户行为,数据流入索引以优化服务,索引再为AI提供燃料,AI则通过更好的回答吸引更多用户,从而产生更多数据,如此循环,形成难以撼动的壁垒。 目前,谷歌凭借Chrome浏览器、Google搜索索引和Gemini AI,在全球大部分地区掌控着这个闭环。尽管OpenAI、Anthropic等公司被视为谷歌在AI领域的竞争者,但分析指出,由于它们缺乏自主的浏览器和完整的数据闭环,本质上更像是谷歌的客户。没有浏览器层,就无法获取真实的用户会话数据来验证和优化AI,其产品在结构上如同“租户”,依赖于他人提供的底层索引。这一分析也认为,监管机构一直聚焦于搜索市场份额,可能并未触及真正的病根,即谷歌通过掌控测量工具本身,构建了一个难以复制的系统性优势。 #信息控制 #谷歌 #浏览器 #人工智能 #搜索垄断 #科技战略 #数据闭环 #AI竞争
AI在图灵测试中表现超越人类,社交行为成关键

一项发表于《美国国家科学院院刊》的研究发现,在经典图灵测试中,先进的人工智能模型比真人更易被误认为人类。加州大学圣地亚哥分校的这项研究首次严格运用图灵测试方法评估大语言模型,通过让参与者同时与人类和AI进行文字聊天,由裁判判断哪一方是人类。结果显示,GPT-4.5在73%的测试中被认定为人类,比例显著高于真人;LLaMa-3.1-405B的误判率达56%,与真人相当。而旧版模型如ELIZA和GPT-4o的表现较差,通过率仅约21%。 研究表明,AI主要通过模仿人类的社交行为特质——如语调、幽默感、易错性——而非纯粹的知识能力来通过测试。当未给模型设定具体角色指令时,其通过率大幅下降。这促使研究者重新审视图灵测试的意义,认为它正从衡量机器智能转向评估“像人程度”,对理解AI与人类交互的界限具有重要启示。 #AI #图灵测试 #大语言模型 #科技研究 #人类行为 #UCSanDiego #机器学习 #人工智能
新型3.125位量化技术助力LLM边缘部署,减少对张量核心依赖

在自回归大型语言模型(LLM)解码中,当批量大小为1时,主要瓶颈并非计算能力,而是内存带宽和浮点数学计算的高热成本。传统量化方法如4-bit模型在硬件上需实时反量化至FP16,增加了能耗和延迟,且在压缩至3位以下时容易导致模型精度崩溃。为解决此问题,研究人员开发了一种数据无关量化架构,通过数学平滑和向量量化技术,将模型压缩至3.125位,同时保持复杂推理和编码能力。该技术用查找表操作和位加法替代标准矩阵乘法,大幅减少对张量核心的依赖。这种近无乘法方法表明,未来AI推理芯片可能更需要优化内存路由和简单算术逻辑单元,从而在超低功耗边缘设备上实现先进智能,推动人工智能在移动和嵌入式场景的广泛应用。 #AI #LLM #量化技术 #边缘计算 #硬件优化 #机器学习 #深度学习 #芯片设计
AI编程应放下执念

在AI辅助编程的实践中,许多开发者陷入过度设计工作流程的误区。有效利用AI编程的核心并非精心编写的复杂提示词或步骤,而是两个根本要素:AI所输出的技术栈是否合适,以及开发者自身积累的经验与判断力。那些被分享的繁复工作流,往往只是开发者试图保持控制感的“装饰”,而非高效产出的必要条件。尝试严格遵循此类流程的开发者常会发现,过多的约束反而限制了模型的发挥,导致产出不符预期。 真正的高效协作往往更简单:为AI提供本地的参考代码作为上下文,然后直接说明构建目标。这是因为参考代码本身已隐含了编码规范、命名模式与错误处理方式,无需逐条罗列。开发者若能接受AI可以生成代码的事实,便会面临一个选择:是信任并善用AI,还是执着于创造一套复杂的“人工”流程。后者常常源于一种心理:当AI能产出甚至更优的“作品”时,开发者通过设立AI尚不能胜任的新工作层,来维持自身的核心价值感。然而,这层“人工作”在不断缩减,固守于此只会消耗更多时间在形式主义上。 对于开发者而言,真正的价值在于选择合适的技术栈、培养技术品味,以及敏锐察觉AI产出何时开始偏离目标。围绕核心价值构建的繁琐流程,大多是一种自我安慰的忙碌,让人在逃避更艰巨、更模糊的挑战时,仍能感到自己“富有成效”。 #AI编程 #开发者工具 #工作效率 #技术栈 #人工智能 #软件开发 #科技观点
Grid全球账户新增AI代理财务管理功能

随着AI代理在任务执行能力上的显著提升,它们在财务管理方面仍受限于人工干预。Grid Global Accounts正式推出新功能,允许AI代理在用户严格定义的策略下直接操作资金。账户持有者可为AI代理创建可撤销、可审计的操作空间,设置支出限额、批准阈值及细粒度权限,系统会在代理执行前评估策略,确保资金安全。支持多种灵活连接方式,如CLI安装、MCP OAuth和设备流,适配不同代理场景。所有操作均通过Grid的策略决策和审批状态全程可追溯,用户可实时监控代理行为并一键暂停或撤销权限。这一创新增强了AI代理的实用性和自主性,同时为合作伙伴提供无缝集成方案,用户界面直观,保持了用户对资金的绝对控制权。 #GridGlobalAccounts #AI代理 #金融科技 #数字货币 #跨境支付 #区块链 #AI创新 #科技新闻
AI生成代码无误却数据出错,凸显数据分析验证重要性

Piotr Płoński在MLJAR Studio开发AI数据分析师功能,允许用户通过自然语言提问,AI自动生成并执行Python代码进行快速数据分析。在一次医疗用例测试中,AI生成的Pandas代码成功加载糖尿病数据集CSV文件,代码执行顺利且无任何错误,但查看生成的数据时却发现异常,例如"怀孕次数"列出现高达148的不合理值,年龄列也包含0或1等错误数据。AI随后主动分析输出结果,识别出数据对齐问题并发出警告。这表明在AI辅助数据分析中,仅依赖代码生成和执行可能掩盖数据错误,需额外验证输出内容。作者强调,MLJAR Studio已引入输出分析步骤,以提升AI工具的可靠性和准确性,凸显了在自动化流程中人工审核的必要性。 #AI #数据分析 #Python #机器学习 #科技新闻 #编程 #数据安全 #创新工具 #MLJARStudio #人工智能
PocketWebTools推出浏览器端隐私AI工具套件

据开发者平台消息,PocketWebTools近日展示了一套全新的AI工具,其核心特点是完全在浏览器本地运行,无需注册或上传数据,从而确保用户隐私。该套件涵盖词频统计、货币转换、时区转换、背景去除、图像放大、OCR文本提取、主题抠图和音频转录等多种功能,所有操作均在用户设备上完成,避免了数据外泄风险。这些工具免费且无广告,旨在为个人用户提供便捷、快速的隐私保护型AI解决方案,回应了当前数字服务中日益增长的数据安全关切。 #PocketWebTools #AI工具 #隐私计算 #浏览器应用 #科技新闻 #OCR #图像处理 #数据安全
大模型系统设计能力排行榜出炉,Kimi

一项针对大语言模型系统设计能力的全新基准测试发布。该评估模拟真实场景,在无任何示例或提示的“冷启动”条件下,要求模型独立完成包含架构设计、容量估算、权衡分析和故障分析的完整系统设计,并由独立的多个模型作为评委从五个维度进行打分。本次测试共评估了9个主流模型在9个问题上的表现。排行榜显示,Kimi-k2.6 以平均分4.39分位列第一,紧随其后的是GPT-5.4和Claude-sonnet-4.6。这表明不同模型在复杂的、面向工程落地的推理任务上已呈现出明确的能力分层,为评估和选择模型提供了新的实用参考。 #大模型 #AI #系统设计 #技术评测 #排行榜 #Kimi #GPT5 #Claude #DeepSeek
开源工具 ViralMint 集成 86 个 MCP 工具,实现 AI 驱动自动化视频创作

一款名为 ViralMint 的开源工具近日在技术社区发布,其核心特点是通过集成多达 86 个 MCP(机器可读能力)工具,使得 AI 编程助手 Claude Code 能够直接驱动整个病毒式视频内容的生成流水线。该工具旨在将内容创作者日常的选题追踪、竞争对手分析、视频生成、自动发布等繁琐流程,整合进一个自动化的本地工作流中。 ViralMint 强调其 100% 本地运行、无 SaaS 锁定,用户需自带 API 密钥。它支持通过聊天界面与 AI 智能体交互,只需输入指令即可在后台执行相应任务。项目内置了从 AI 脚本生成、语音合成、素材匹配、字幕动画到最终成片的完整制作流水线,并能从长视频中自动提取和剪辑适合传播的短视频片段。其另一大亮点是支持通过 Telegram、WhatsApp、Discord 等多种即时通讯软件进行双向控制和接收任务通知,实现随时随地用手机指挥 AI 工作。 #AI #视频生成 #开源工具 #自动化 #跨平台控制 #MCP #ClaudeCode
SoMatic:让AI代理直接“看懂”并操作桌面软件的视觉框架

一款名为SoMatic的开源框架于今日在Hacker News上发布,旨在通过视觉识别技术为AI代理提供通用的桌面应用操作能力。该工具核心原理是运行本地YOLO模型,对桌面截图进行实时识别,将屏幕上的所有可交互元素(如按钮、输入框)进行检测并标注编号,从而为AI代理生成一份结构化的“屏幕坐标地图”。代理可以通过标记ID、相对坐标或绝对像素点来精确指定操作目标,无需猜测,每一步命令都返回JSON数据以确保可编程性。开发者可通过npm或Python安装该CLI工具,并已支持将其作为技能集成到Claude Code、Cursor等数十种AI编码助手中。这意味着,具备视觉能力的AI代理能够直接操作原生应用、浏览器、PDF及各类网页工具,完成点击、输入、快捷键等复杂交互。目前,该工具主要面向开发者,仍处于早期阶段。 #AI #开源 #自动化 #开发者工具 #AI代理 #SoMatic #桌面自动化 #计算机视觉
戴尔CEO:AI趋势回归硬件,企业本地部署需求激增

在拉斯维加斯举行的戴尔科技世界2026大会首日,公司创始人兼首席执行官迈克尔·戴尔指出,人工智能的发展重心正从云端转向本地基础设施。他表示,随着AI从概念验证迈向大规模生产应用,企业传统的“采购软件与自建”平衡模式正在被打破,软件定义竞争优势的时代将催生更多的软件与应用。 戴尔引用公司调查数据强调了这一趋势:高达67%的AI工作负载目前运行在云端之外,包括本地数据中心、边缘设备或托管设施;88%的受访企业已在本地运行至少一个AI工作负载。驱动这一转变的因素包括智能体AI的兴起、企业对主权AI的需求以及数据本地化考量。戴尔预计,全球AI基础设施支出将在2030年前达到数万亿美元规模。他认为,首席信息官们正积极转向混合AI架构,以保持对数据、成本和安全的控制,避免因云锁定而限制创新。戴尔公司正借此趋势,大力推广其本地部署的AI工厂与硬件解决方案。 #戴尔 #AI基础设施 #本地部署 #数据中心 #智能体AI #混合AI #科技新闻
SpaceX提交IPO申请,押注AI与星舰战略,马斯克掌舵

据外媒报道,埃隆·马斯克创立的SpaceX公司已公开提交首次公开募股(IPO)申请文件,计划在纳斯达克上市,股票代码定为“SPCX”。这家拥有24年历史的航空航天企业,已从最初的可重复使用火箭技术研发,拓展为涵盖卫星互联网、人工智能等多领域的科技集团,马斯克将继续担任首席执行官、首席技术官及董事会主席。S-1文件详细披露了公司业务现状:2025年营收超过180亿美元,但亏损约49亿美元,自成立以来累计亏损逾370亿美元;卫星互联网服务Starlink贡献了过半收入,达约110亿美元。与此同时,近期合并入SpaceX的人工智能公司xAI,虽投入大量资本,但收入增长平缓。公司重点押注星舰重型运载火箭项目,预计2026年下半年开始执行轨道载荷任务,其成功与否关乎未来扩张。此次IPO规模预计将创历史纪录,估值或高达1.75万亿美元,但文件也揭示了技术风险、法律诉讼等多重挑战。 #SpaceX #IPO #AI #星舰 #马斯克 #商业新闻 #科技 #航空航天
百度百格开源LoongForge高性能AI训练框架

百度百格近日正式发布并开源了LoongForge,这是一个高性能的统一训练框架,专为大型语言模型(LLM)、视觉语言模型(VLM)、视觉语言动作模型(VLA)及扩散模型设计。该框架基于Megatron-LM进行深度系统优化,覆盖预训练、继续预训练和监督微调全流程,在模型适配性、训练速度和硬件支持方面实现显著突破。测试显示,LoongForge相比主流开源基准可实现高达5倍的训练速度提升,并在教育、计算机视觉和具身智能等领域的企业客户生产环境中,提供了30%至50%的加速效果,最大规模运行超过5000个加速器单元。作为百度龙舟开源系列的重要组成部分,LoongForge原生支持NVIDIA GPU和昆仑XPU等异构硬件,通过灵活的多模态架构和自适应训练技术,进一步优化了资源利用效率和扩展性。该项目已于2026年4月在GitHub公开代码,并支持LLaVA-OneVision-2.0等先进模型的训练,标志着开源AI训练工具向更高性能和更广应用迈出关键一步。 #百度 #LoongForge #AI训练 #开源框架 #大模型 #机器学习 #GPU #XPU #人工智能 #高性能计算
AI 访谈工具 Noada 异军突起,以 AI 驱动替代传统会议

近日,一款名为 Noada 的 AI 工具正式进入市场,其核心功能是通过自动化访谈流程来取代繁琐的传统会议。该产品允许管理者或团队领导设定需要决策的问题,然后让参与者在各自方便的时间异步回应。在回应过程中,Noada 的 AI 会主动提出后续问题以澄清疑点、消除阻碍,最终自动生成一份简洁的摘要,其中明确列出决策事项、行动项以及待解决的问题。这一设计旨在彻底摆脱协调会议日程的困扰,通过给予参与者充分的思考时间来获取更高质量的输入,从而减少不必要的跟进、避免群体思维,并加速决策过程。Noada 特别适用于远程协作场景,有望帮助企业提升运营效率,将那些本可异步处理的状态更新会议彻底淘汰。 #AI #科技 #会议 #生产力 #远程工作 #Noada #决策 #创新
生物技术公司利用3D打印人工蛋壳成功培育鸡只

生物技术公司Colossal Biosciences宣布,已成功开发出3D打印的透明人工蛋壳,并在其中培育出小鸡,旨在为复活已灭绝鸟类(如渡渡鸟和恐鸟)提供技术支持。该人工蛋壳为椭圆形3D打印结构,内衬特殊硅基膜,能允许氧气进入,模拟真实蛋壳功能。研究人员将鸡蛋内容物倒入壳中,小鸡顺利孵化,并通过顶部窗口观察。公司首席生物官Andrew Pask称,这一成果令人震撼,展现了生命在体外生长的可能性。Colossal Biosciences成立于2021年,专注于基因编辑和生殖技术恢复灭绝物种,已筹集6.2亿美元资金。然而,该技术引发科学界争议,批评者指出公司夸大声明,称其仅为现有孵化方法的改进,例如日本科学家早在1998年就用类似容器孵化鹌鹑。公司计划将此技术应用于保护濒危鸟类和复活恐鸟,但技术挑战依然存在。 #生物技术 #3D打印 #人工蛋壳 #鸟类复活 #基因编辑 #科技新闻 #ColossalBiosciences #灭绝物种