AI知识库 @ai521
334 subscribers
22.5K photos
42 videos
19 files
870 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Anthropic 发布 Claude Fable 5,最强公开模型实测有短板

6月10日,Anthropic 发布 Claude Fable 5 与 Claude Mythos 5 两款模型,前者面向所有用户开放,后者仅限政府与科研机构使用。Fable 5 被定位为当前最强公开模型,在长周期、高复杂度工程任务上表现断层领先。实测显示,其在 SWE-Bench Pro 得分 80.3%,比 Opus 4.8 高出 11 个百分点;在 FrontierCode Diamond 得分 29.3%,是竞品 GPT-5.5 的五倍。Stripe 让 Fable 5 在 5000 万行 Ruby 代码库中执行全仓库迁移,一天完成团队两个多月的工作量。视觉能力同样突出,可裸眼通关《宝可梦 火红》,从科学图表提取精确数值,凭截图重建 Web 应用源码。然而,Fable 5 定价翻倍,且存在用户吐槽的“静默降级”风险,花高价可能买到非完整版。模型不再提供思考开关,改为自适应思考深度,并支持交叉思考。 独立测试显示,Fable 5 在逻辑、数学、编程、多模态等任务中表现优异,但在某些推理题上结论站不住脚,SVG 动态叙事优于 Opus 4.8,3D 沙盒游戏 Demo 可直接游玩,但视效华丽度不及 Opus 4.8。 #Anthropic #Claude #Fable5 #大模型 #AI #科技新闻 #编码 #多模态
中国警告西方AI模型存在安全风险,美国企业却争相采用DeepSeek

中国国家安全部近日发出警告,指出用户通过第三方工具和市场访问美国AI模型的计算资源时,可能面临安全风险和网络间谍活动的潜在后门。该部门强调加密不足、模型替换欺诈以及数据留存等问题是主要担忧,这与美国安全机构对DeepSeek等模型在国内市场兴起时的反应如出一辙。尽管中美两国政府均以安全威胁为由对对方AI模型日益警惕,但美国消费者仍在积极使用阿里巴巴的Qwen 3.6、DeepSeek V4 Pro和GLM 5.1等中国开源模型。这些模型不仅提供本地化AI部署选项,其托管推理成本也远低于OpenAI和Anthropic的收费。原因归结为成本因素:DeepSeek等蒸馏模型不仅价格低廉,还能在现有硬件上无需许可费用直接部署。与此同时,中国开发者也在通过淘宝、GitHub和Telegram上的API“中转站”以官方价格十分之一获取美国AI模型访问权限,这些服务使用批量注册账户、共享订阅甚至盗刷信用卡等方式运作,给各方带来安全与财务风险。 #AI安全 #DeepSeek #中美科技竞争 #大模型 #网络安全 #科技新闻
Claude Fable 5 智能体评测:登顶 Arena 却败给 GPT

近日,Anthropic 发布的 Claude Fable 5 在 AI 圈引发热议。据大模型评测平台 Arena 的智能体基准测试结果,Fable 5(High)综合排名第一,超越 OpenAI 的 GPT-5.5(xHigh),并在成功率和可引导性上领先。然而,在加州大学伯克利分校宋晓东团队推出的“智能体的最后考试”(ALE)中,Fable 5 得分 22.0%,低于 GPT-5.5 的 24.0%。ALE 覆盖 55 个非体力职业、1500+ 真实任务,评测显示 Fable 5 每项任务平均花费约 15.70 美元,是 GPT-5.5(3.80 美元)的 4 倍多。更关键的是,在最难的“Last-Exam”档位,所有前沿智能体通过率均为 0%,表明其离胜任复杂长周期专业工作仍差距显著。团队指出,不存在全能 Agent,不同模型各有擅长与短板,常见失败模式是 Agent 未验证工作即擅自宣告完成。 #Claude #Fable5 #智能体 #AI评测 #ALE #大模型 #科技新闻
小米发布开源编程Agent MiMo Code,5人14天获5.1k星但bug频出

6月11日凌晨,小米MiMo团队发布基于OpenCode构建的终端编程Agent产品MiMo Code,采用MIT协议开源。该产品定位长程自动化编程任务,旨在解决AI编程Agent在持续执行中的决策质量与状态连续性问题,基于MiMo-V2.5模型,支持100万token上下文。小米披露,MiMo Code在离线benchmark中优于Claude Code,但在真实开发场景中,当任务步数超过200步时胜率升至65%以上。然而,开源后迅速引发开发者争议,GitHub Issues已超200条。用户反馈包括Agent未经确认自动卸载全局npm包导致开发环境破坏、疑似内存泄露、思考陷入重复螺旋等bug。此外,默认开启遥测功能及自动检查更新等设计也引发隐私担忧。有开发者认为,MiMo Code作为OpenCode分支并无独特优势,而小米团队需应对大量PR审核压力。该事件也引发关于coding harness是否应开源、以及企业商业模式与用户迁移成本之间平衡的讨论。 #小米 #MiMoCode #AI编程 #开源 #bug #开发者 #ClaudeCode #大模型
进门科技推出AI投研智能体“进宝”,金融圈迎来干活型AI

成立于2013年的进门科技,最初以券商研究所路演会议平台闻名,市占率达95%。2023年获得腾讯战投后,全面迭代为“机构AI投研工作台”。2025年,其推出业内首个投研版Agent“AI进宝”,帮助研究员处理海量信息、捕捉边际变化。CEO程建辉表示,Agentic AI让AI从聊天模式进入干活模式,可自动扫描自选股、分析变化、做量化回测等复杂任务。面对金融行业对AI幻觉的零容忍,腾讯云提供安全可靠的底层架构,包括音频水印定位、多Agent编排等能力,确保数据安全。程建辉认为,AI投研不会取代研究员,反而会放大认知差的价值:顶尖分析师的效率从日处理10份研报提升到10万份,年轻一代则能借AI快速成长。进门旨在深耕垂直场景,让AI真正落地金融业务。 #进门科技 #AI进宝 #投研智能体 #金融科技 #AI落地 #腾讯云 #认知差 #金融安全
IPO 前夜,OpenAI 与 Anthropic 讲“故事”争夺 AI 定义权

在首次公开募股(IPO)前夕,OpenAI 与 Anthropic 两大 AI 公司展开了一场关于“AI 定义权”的叙事竞争。双方都试图通过发布技术路线图、伦理声明及未来愿景,向投资者和市场传递自家的“AI 故事”,以争取更高的估值和公众信任。这场定义权之争不仅关乎两家企业的商业命运,更将深刻影响全球人工智能的发展方向与监管框架。市场正密切关注谁能在这场叙事博弈中占据上风。 #OpenAI #Anthropic #AI #IPO #人工智能 #定义权 #科技竞争 #市场信任
通义千问上线足球预测AI助手,精准预测世界杯赛况

2026年美加墨世界杯开幕之际,阿里通义千问App于6月12日上线足球预测AI助手并面向全体用户开放。在首日比赛中,该助手精准预测了墨西哥2:0战胜南非的比分及红牌趋势,还成功预判韩国2:1绝杀逆转捷克,被网友称为AI版“章鱼哥”。据产品负责人介绍,该助手基于海量大数据训练,除历史战绩和球员数据外,创新引入举办地地貌、海拔高度及开球时段天气等因素,例如充分考虑了墨西哥城超过2200米高海拔对客队的影响。研发团队强调AI旨在逼近准确率极限,但足球的魅力仍在于不可预测性。产品设计打破传统竞猜,用户参与可赢取万元现金大奖,并通过互动机制为乡村学校捐建足球场,实现了前沿AI技术、体育竞技与社会公益的深度融合。 #通义千问 #足球预测 #AI #世界杯 #章鱼哥 #大数据 #公益 #科技新闻
高盛发布AI行业研报:市场低估AI需求,2030年Token消耗或将暴涨24倍

知名投行高盛发布最新行业研报指出,当前市场普遍低估了人工智能领域的发展需求。报告测算,2027年超大规模数据中心运营商的AI相关资本支出将达1.1万亿美元,远超华尔街预期的9200亿美元,乐观场景下更可能增至1.4万亿美元。受企业级AI代理普及推动,机构预测2030年全球AI Token消耗量将增长24倍,庞大的算力需求将持续带动数据中心、芯片、网络设备及电力等AI基础设施发展。研报判断,AI行业供需失衡状态至少持续至2027年下半年。同时,高盛也提示了多项风险:AI工具成本投入能否转化为效率提升有待验证,内存、电力、人力等资源短缺已导致部分数据中心项目延期,且AI基建相关个股估值快速走高,股价涨幅脱离盈利基本面,市场波动风险加大。 #高盛 #AI #人工智能 #Token #算力 #数据中心 #资本支出 #行业研报
2026上半年AI十大事件

2026年上半年,人工智能领域经历了从“大模型分数比拼”到“实际应用集成”的深刻转折。核心变化包括:Agent Skills成为行业通用标准,通过文件夹结构和渐进式披露机制,让个人和团队的工作方法可被共享、重用和版本管理;开源项目OpenClaw实现全民Agent化,打通浏览器与终端路线,支持多平台接入,但存在高昂token消耗问题;Harness工程化概念兴起,为大模型装上“管制系统”,代表作Hermes Agent成为新宠。此外,Multi-Agent、Coding Plan、CLI重新流行、Desktop Agent、Physical AI、语音交互、Seedance 2.0等领域也涌现突破。2026年下半年的竞争焦点将不再是通用聊天机器人,而是每个人专属的个性化Agent。 #AI #AgentSkills #OpenClaw #Harness #人工智能 #技术趋势 #开源 #大模型 #2026 #应用落地
Valvoline推出Beyond冷却流体平台,剑指AI与高性能计算散热

Valvoline全球运营部门推出全新“Beyond by Valvoline”流体平台,专为人工智能基础设施、高性能计算及公用事业规模电池储能等先进热管理应用设计。随着AI集群规模扩大与机架功耗激增,传统风冷已难以满足新一代GPU的散热需求,直接液冷和浸没式冷却技术加速普及。Valvoline表示,Beyond平台融合其160年润滑油与流体技术经验,旨在解决高发热计算和能源系统的性能、效率与可靠性挑战。公司首席技术官Roger England指出,有效散热管理对维持技术平台可靠性至关重要,性能提升伴随更高热负荷,Beyond平台可帮助系统保持最佳运行状态。此次发布凸显浸没式冷却生态系统的持续成熟,流体化学专业供应商正成为AI基础设施供应链的关键参与者。 #Valvoline #冷却液 #浸没式冷却 #AI基础设施 #高性能计算 #储能 #热管理 #数据中心 #液冷 #科技新闻
最危险AI模型开发游戏《Shepherd's Dog》一次性生成

Anthropic公司近日发布了此前被认为过于危险而不宜公开的AI模型。开发者Koen van Gilst用这个模型测试自己的个人基准:能否一次性构建他构思多年的游戏想法。模型进行了漫长的推理,耗费45分钟和超过20欧元的token后,成功生成了《Shepherd's Dog》——一款零依赖、共2319行的完整游戏。作者表示游戏非常有趣,完全符合他的想象,这是AI首次能一次性为他创作出这样的作品。此前使用早期模型的多次尝试均未能成功。 #AI #大模型 #Anthropic #游戏开发 #ShepherdSDog #一次性生成 #技术突破