AI知识库 @ai521
706 subscribers
30.2K photos
59 videos
27 files
1.25K links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
用烘焙比喻理解大语言模型训练

Kent Beck 在一篇博客中,将训练大语言模型(LLM)的过程比作烘焙。他回忆早年对计算机底层机制着迷,如今对AI模型的构建充满好奇。模型实际上是一堆数字,这些数字并非通过传统编程写就,而是通过训练得来。训练分为预训练、后训练等阶段,如同烘焙中先准备原料再低温发酵。预训练是批量处理数据,反复迭代调整数字,最终得到可用的模型。这一比喻生动揭示了模型构建的“魔法”本质,以及其中对初始条件的敏感性。 #AI #大模型 #LLM #训练 #比喻 #技术科普
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
模型表现差可能真不赖 AI:代码坏味道正成为编程大模型的最大绊脚石

该文章指出,大型语言模型在编码任务中的表现不佳,很大程度上并非模型本身能力不足,而是受限于训练数据中的“代码坏味道”——即低质量、有潜在缺陷的代码。这些代码坏味道包括过长函数、冗余注释、未使用变量等,会误导模型学习错误的编程模式,导致生成代码质量低下。研究强调,单纯增加模型参数或训练数据量无法解决根本问题,必须重视数据清洗与代码质量控制。这一发现对AI辅助编程的实用化具有重要启示:提升模型表现的关键在于从源头优化训练数据,而非一味追求模型规模。 #AI编程 #代码质量 #坏味道 #大模型 #机器学习 #软件开发 #技术新闻
Gemini 3.7 Flash 突袭发布

距 Gemini 3.6 发布仅三周,Google DeepMind 再度推出 Gemini 3.7 Flash 模型。该版本在推理速度、多模态能力上接近旗舰级表现,同时价格大幅降低,被业界视为重新定义性价比标杆之作。新模型在代码生成、数学推理等场景中表现突出,旨在抢占中小开发者市场。DeepMind 新帅表示,后续将持续优化成本结构,推动 AI 普惠化。 #Google #Gemini #DeepMind #AI模型 #性价比 #科技新闻
ShieldFont 发布新工具,强力打击无视 的 AI 爬虫

在互联网早期,网站可通过 文件告知搜索引擎爬虫哪些内容可抓取。然而,随着 AI 数据采集需求激增,许多爬虫开始无视这一规则,强行抓取网站内容用于训练模型。为此,ShieldFont 推出了一款新型防护工具,能够识别并阻断不遵守 的 AI 爬虫,保护网站所有者对自身数据的使用控制权。该工具通过分析爬虫行为模式,自动生成拦截规则,并支持实时更新,有效降低网站被非法抓取的风险。此举引发了对 AI 数据采集伦理与网站权益保护的广泛讨论。 #ShieldFont #AI爬虫 #RobotsTxt #网络安全 #数据保护 #AI伦理 #网站防护
DeepSeek 插件生态上新:OpenBiliClaw 接入 DSH 打造个性化推荐 Agent

开源项目 OpenBiliClaw 近日宣布接入 DeepSeek Harness (DSH) 框架,推出基于 DeepSeek 大模型的个性化推荐 Agent。该 Agent 能够利用 DSH 的推理能力,对 Bilibili 视频内容进行深度语义理解,并结合用户历史行为实现精准推荐。这一更新标志着 DeepSeek 插件生态进一步扩展,为开发者提供了更灵活的自定义推荐方案。OpenBiliClaw 项目旨在通过 AI 优化视频观看体验,此次接入 DSH 后,推荐逻辑可基于用户偏好动态调整,同时支持多轮对话式交互,增强了交互的智能性。业内分析认为,此举将推动大模型在视频平台的个性化应用落地,降低开发者构建智能推荐系统的门槛。 #DeepSeek #OpenBiliClaw #DSH #个性化推荐 #AI #开源 #插件生态
webcodex v0.3.7 发布:开源Agent实现Computer Use本地化,支持Windows UI自动化

开源AI编程项目webcodex推出v0.3.7版本,核心更新是实现了Agent功能的本地化,并新增对Windows UI自动化的支持。该版本允许AI代理直接操作计算机桌面,执行点击、输入、选择等界面交互任务,从而实现更智能的编程辅助与自动化流程。这一更新将Computer Use技术从云端迁移至本地,提升了隐私性与响应速度,对开发者构建自主编程工具链具有重要意义。Webcodex团队表示,后续将继续优化Agent的稳定性和跨平台兼容性。 #webcodex #开源 #AI编程 #Agent #ComputerUse #WindowsUI自动化 #科技新闻 #自动化
DeepSeek 思维链复现研究

近日,科技社区发布了一项关于 DeepSeek 模型内部行为机制的研究成果。该研究通过巧妙构造输入提示,在无需任何注入或修改模型参数的情况下,成功复现了 DeepSeek 在推理过程中触发“we need”特定思维链模式的现象。研究表明,这一现象源于模型对任务指令中隐含的“需要”语义的深度理解与自洽性推理,而非简单的外部注入。该发现揭示了大型语言模型在复杂推理任务中可能存在的潜在行为模式,对理解模型决策过程、提升可解释性具有参考价值。研究团队还探讨了该模式在逻辑推理、问题解决等场景下的表现,并指出其对模型安全性和可控性研究的意义。 #DeepSeek #思维链 #AI安全 #模型可解释性 #大语言模型 #推理机制 #科技研究
AI提升生产力或导致全球碳排放净增加

一项最新研究利用全球可计算一般均衡模型,将人工智能视为双向生产力放大器,同时评估其对化石能源和可再生能源领域的影响。结果显示,在并行采用情景下,AI将导致全球年净二氧化碳排放增加0.47至1.8亿吨,相当于2024年全球能源相关排放的1.2%至4.8%。只有当可再生能源领域的效率增益达到化石燃料领域的4至5倍时,才能实现净减排。研究指出,若无政策引导,AI的部署将加剧全球经济碳强度,并巩固化石燃料的既有地位,而当前的分析与治理框架尚未充分捕捉这一风险。 #AI #碳排放 #气候变化 #能源转型 #化石燃料 #可再生能源 #净零排放 #科技影响