AI知识库 @ai521
389 subscribers
25K photos
46 videos
20 files
954 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Google发布Gemini 3.6 Flash等新模型,效率与成本显著优化

Google于近日正式推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber三款新模型,旨在满足开发者在构建AI代理时对高效率、低延迟和可靠性的需求。其中,Gemini 3.6 Flash基于3.5 Flash的用户反馈改进,在编码和知识类任务上性能提升,同时将输出Token效率提高17%,整体价格更低(输入$1.50/百万Token,输出$7.50/百万Token),显著降低代理任务的运行成本。3.5 Flash-Lite则是该系列最快模型,每秒可处理350个输出Token,定价仅为输入$0.3/百万Token、输出$2.5/百万Token,适合高吞吐量生产任务。此外,3.6 Flash还增强了针对化学、生物、放射、核及网络攻击等前沿安全防护,同时减少对有益用处的拒绝。这些模型目前已向开发者开放,Gemini 3.5 Pro仍在与合作伙伴测试中。 #Gemini #AI #大模型 #效率 #成本优化 #安全 #科技新闻 #Google #Flash
谷歌推出Gemini 3.5 Flash Cyber专用网络安全模型

谷歌近日发布 Gemini 3.5 Flash Cyber,这是一款基于 Gemini 3.5 Flash 微调而来的轻量级网络安全模型,专注于快速发现、验证和修补软件漏洞。该模型利用Flash系列的高性能与高性价比,能够以低成本扫描大规模代码库,并通过CodeMender安全代理多次调用实现深度分析,生成高质量漏洞报告。谷歌表示,鉴于该技术的双重用途特性,初期将采取有限访问试点模式,仅向政府和可信合作伙伴开放,以帮助防御者先于攻击者修复关键漏洞。在CyberGym等基准测试中,该模型在无安全护栏的情况下,对Chrome和Safari等复杂代码库的漏洞发现能力显著超越标准Flash系列模型。此外,CodeMender的基础能力也将通过Gemini企业代理平台向客户开放。 #谷歌 #网络安全 #Gemini #Flash #AI #漏洞发现 #CodeMender #大模型
谷歌发布Gemini 3.6 Flash与3.5 Flash

谷歌近日推出Gemini 3.6 Flash和3.5 Flash-Lite两款新模型,进一步压低AI模型调用价格。其中3.6 Flash在性能上对标GPT-4o,但输入价格仅为每百万token 0.15美元,输出价格0.6美元,较同类产品便宜一半以上。3.5 Flash-Lite则主打极致性价比,适用于轻量级任务。此举被视为谷歌在AI云服务市场对OpenAI和Anthropic的正面宣战,意图通过价格优势抢占开发者生态。分析师指出,大模型厂商间的价格竞争正在加速,中小型AI初创公司面临更大生存压力。 #谷歌 #Gemini #AI #大模型 #价格战 #科技新闻 #云计算
深演智能黄晓南:将AI切入企业工作流,释放企业级AI价值

深演智能创始人兼CEO黄晓南在最新访谈中指出,当前企业AI应用普遍存在三大困局:单点散落、价值错位、底座缺乏。多数企业仅用AI完成孤立任务(Task),而未嵌入完整业务流程(Job),导致价值难以显现。黄晓南提出破局之道在于“Agentic Software+Agentic Service”双轮驱动,前者让企业内部工作流AI化,后者让外部服务交付AI化,核心是让AI深入企业核心工作流,而非停留在单点应用。她强调,AI价值的释放依赖统一的数据、知识与内容底座,企业应聚焦“AI for Growth”而非单纯降本,将AI从效率工具转化为增长引擎。 #深演智能 #黄晓南 #企业AI #AgenticSoftware #工作流 #数智化 #AI落地
Agent取代人类成Token消耗新主人,端侧AI迎拐点

2026世界人工智能大会(WAIC)首次将“Token经济”设为核心议题,多家企业推出“Token工厂”解决方案。行业共识指出,Token的主要消耗方已从人类转向Agent,如Hermes等智能体应用在Openrouter上的消耗量已超越人类聊天。Agent的7×24小时无休工作模式,使Token需求呈指数级增长,预计2026年将是转型关键年。为应对成本痛点,基础设施厂商从不同路径降本:PPIO通过智能模型网关调度模型,可将成本降低50%-60%;无问芯穹推出跨集群异构PD分离架构,使单Token成本降低37.5%。同时,端侧AI迎来拐点,清华大学“密度法则”显示大模型能力每3.5个月翻番,未来200-300B模型可媲美当前云端旗舰,推理成本若下降90%,将引爆数据不出端的隐私敏感场景。CPU在端侧的重要性随之提升,智能体80%的计算时间将在端侧通过CPU调用工具。内存涨价对端侧芯片影响有限,厂商通过支持多种DDR类型抵御供应链波动。 #AI #Token经济 #Agent #端侧智能 #WAIC2026 #模型成本 #推理优化