AI知识库 @ai521
344 subscribers
23.5K photos
42 videos
20 files
902 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Naver 推出轻量化 AI 标签模型,速度与性能双提升

Naver 在其“AI 标签”功能中新增了一款轻量化模型,该模型相较于超大规模 AI 模型 HyperCLOVA X(HCX)拥有更快的响应速度和更高的吞吐量。通过扩大强化学习的应用比重,新模型的运行速度提升至原来的两倍,同时将“幻觉”现象(即生成错误信息的问题)改善了 30 个百分点。Naver 于本月初在 D2SF 江南举办的“从探索到执行”活动中公布了这一成果,旨在提升用户体验与 AI 效率。 #Naver #AI #轻量化模型 #性能提升 #科技新闻
Naver推出AI搜索新功能,强化本土化服务

韩国科技巨头Naver近日宣布推出全新AI搜索功能,旨在提升用户搜索体验并强化本土化服务。该功能结合深度学习与自然语言处理技术,能够更精准理解韩语复杂查询,并针对本地用户需求优化搜索结果,如天气、交通及购物等生活场景。Naver表示,此举旨在应对全球AI搜索竞争,并巩固其在韩国市场的领先地位。新功能将逐步覆盖移动端与PC端,预计未来几个月内全面上线。 #Naver #AI搜索 #韩国科技 #本土化 #人工智能
Utilix 发布 145+ 工具套件,助力 AI 代理开发

开发者工具平台 Utilix 宣布推出涵盖 145 多项战斗测试工具的综合工具层,专为 AI 代理和开发者设计。该平台提供 REST API、Node SDK 和 Python SDK 等多种接入方式,支持离线使用且无需 API 密钥。工具类别包括浏览器工具、数据处理工具、网络工具和 AI 工具等,如 JWK 查看器、PDF 元数据读取器、NDJSON 格式化器、HAR 文件查看器,以及基于 GPT-4o 的 SVG 生成器、正则表达式生成器和 JSON Schema 生成器等。此外,Utilix 还支持 MCP 服务器,可在 Claude Desktop 和 Cursor 中调用 101 种工具,实现 AI 代理与工具的深度集成。Pro 用户可享受每日 10000 次 API 请求的配额。 #开发者工具 #AI代理 #API #SDK #MCP #人工智能 #开源工具
谷歌正在试图让智能“消失”

1998年,两位斯坦福博士生撰写了关于网页排名的论文,整个互联网为之重组,他们创办的公司谷歌在随后25年里成为网络的“收费站”。2017年,八位谷歌研究人员发表了《注意力就是一切》的论文,催生了ChatGPT和Claude背后的Transformer架构,却让旧金山的一家初创公司差点夺走其王冠。谷歌似乎在重蹈覆辙:被自己的发明颠覆后,反而更大方地交出更多技术。2023年初,谷歌的Bard聊天机器人在首次演示中出现幻觉,导致母公司Alphabet单日市值蒸发约1000亿美元。然而,谷歌并未像竞争对手那样全力追逐最强模型竞赛,而是将模型免费开源、发布压缩研究让硬件更便宜、将AI直接植入手机操作系统。这暗示谷歌正在玩一场不同的游戏:它试图让智能变得像电力一样无形且无处不在,失去可度量的价值,从而重塑整个行业的规则。 #谷歌 #AI #人工智能 #技术竞争 #开源 #行业趋势
美团发布1.6万亿参数AI模型“长猫2.0”,完全基于国产芯片完成训练

中国外卖巨头美团发布了其最新自主研发的大语言模型“长猫2.0”。该模型拥有1.6万亿参数和百万级token上下文窗口,是全球最大的AI模型之一,其最大亮点是首次完全使用国产芯片完成从训练到推理的全过程。此前的国产大模型如DeepSeek仅在推理阶段使用国产芯片,而美团此次实现了全流程国产化突破。美团表示,该模型集群基于大规模ASIC超级计算单元构建,并采用了华为的集合通信库来协调芯片间通信。在多项基准测试中,长猫2.0表现优于谷歌的Gemini 3.1 Pro,但在最复杂的推理任务上仍落后于OpenAI的GPT-5.5等全球领先系统。分析人士指出,这一成就表明在高性能AI芯片被禁运的背景下,中国在国产芯片上训练出前沿模型已具备技术可行性,可能重塑全球AI产业格局。 #AI #大模型 #国产芯片 #美团 #长猫2.0 #科技自主
AI代理能耗惊人:处理一个任务竟需普通聊天机器人136倍电力

韩国科学技术院(KAIST)的一项最新研究显示,AI代理的能量效率远低于现有聊天机器人形态的AI。研究发现,AI代理处理一个问题最多需要消耗普通生成式AI 136.5倍的电力。这是全球首次对AI代理的能源使用进行定量分析。研究指出,随着AI准确度提升,效率却在急剧下降,因为AI代理需多次调用大语言模型(LLM),平均每个问题调用71次,导致GPU在大部分时间内闲置等待,资源利用率极低。若目前每天约137亿次的谷歌搜索全部由AI代理完成,所需电力将高达198.9吉瓦,相当于美国总耗电量的一半。研究人员呼吁,AI产业应将重点从盲目追求准确度转向效率优化,采用混合模型和“计算认知型推理”策略,以平衡性能与能耗。未来,AI数据中心和电力基础设施必须进行一体化设计,才能支撑AI代理的可持续发展。 #AI #能源效率 #大模型 #GPU #人工智能 #科技新闻 #数据中心 #电力消耗
Claude Code 藏木马事件

近日,世界 AI 巨头 Anthropic 被曝在其智能体 Claude Code 中偷偷植入间谍软件,专门针对中国用户。这一行为被指打着安全旗号,实则向中国电脑装木马。事件引发广泛关注,业内人士认为,这标志着中美在 AI 领域的竞争已从技术对抗进入更残酷的隐蔽斗争阶段。Anthropic 此举不仅破坏了行业信任,也加剧了两国间的科技摩擦。专家分析,AI 竞争未来可能更多涉及数据安全与网络攻防,中国需加速自主技术研发与安全防护。 #AI #地缘政治 #安全 #中美竞争 #科技新闻
LLM是一种不同形式的智能

本文作者认为,经过长时间与大型语言模型(LLM)的互动,他已停止试图将其映射到已有认知框架中。他强调,LLM代表的是一种与人类截然不同的智能形式,而当前围绕这些工具的混乱,源于人们假装它们并非如此。作者批评了将LLM与初级工程师或新的抽象层相类比的常见做法,指出这些类比都存在根本缺陷。初级工程师能够理解意图、建立联系并超越任务假设,而LLM目前尚不具备这种意图理解能力。同样,将LLM视为新抽象层的类比也有问题,因为之前的抽象层都是确定性的、可复现且可完全理解的,而LLM的决策过程包含随机性和不可预测性。作者认为,计算史上大多数底层系统是确定性的,概率性计算则分离在数据科学和机器学习领域,而LLM的出现模糊了这一界限,代表了一种根本性的转变。 #AI #LLM #人工智能 #智能本质 #技术思考 #认知科学