AI知识库 @ai521
312 subscribers
21.7K photos
42 videos
19 files
833 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
AI交易回测被Reddit用户揪出过拟合,修正后结果令人警醒

一位使用AI构建交易机器人的开发者近日在Reddit上发布回测结果后,遭到两名用户质疑其存在过拟合问题。此前他声称在324个参数组合中测试后,最佳组合实现了+68.6%的收益,但网友指出这属于典型的多重比较问题——组合数量足够多时,总会有看似出色的结果只是随机噪声。专业市场数据从业者还详细说明了正确检验应包含三步:保留所有结果而非只取最佳、检验参数趋势的稳健性、以及划分样本内外数据。迫于压力,开发者进行了全面核查。结果显示,大多数参数组合实际上亏损,先前公布的68.6%位于概率分布极端边缘。更关键的是,他原以为可靠的ADX阈值信号趋势也被证伪:不同ADX值对应的平均收益分别为-5.4%、-4.2%和-6.2%,并非单调趋势。在划分数据样本外测试中,其实际运行的交易机器人表现优于网格搜索选出的“统计最优”组合。这一经历表明,未经严格样本外验证的回测结果只是声称而非证据,未来任何参数变更都必须通过在未参与选择的数据上进行验证才能采纳。 #AI交易 #量化投资 #过拟合 #回测 #机器学习 #金融科技 #数据验证
Kimi K3 大模型排名跃居第三,逼近具身智能领先者

在最新一期人工智能模型与API提供商综合评测排行榜中,国产大模型Kimi K3表现亮眼,以微弱差距位列第三,总分仅比排名第二的Sol模型低2分。该榜单从质量、价格、输出速度及延迟等关键性能指标进行独立基准测试,覆盖多家知名AI厂商。Kimi K3的快速崛起表明国产大模型在推理质量与工程效率上已具备全球竞争力,进一步缩短了与国际顶尖模型的差距。 #KimiK3 #AI排行 #大模型 #国产模型 #综合评测
当AI编码成为常态,开发者如何保持对代码的熟悉感

随着大语言模型(LLM)越来越多地参与代码编写,开发人员正面临一个根本性挑战:他们对自己生产的代码熟悉度正在急剧下降。一个月前由LLM写成的代码,如今可能难以回忆起其决策逻辑;当客户报告Bug时,那种曾经“哦,我知道这是什么”的直觉反应正在消失。开发者不再本能地知道代码存放在哪里,遇到问题需要回访LLM而非脱口而出答案。这种渐进式的知识流失导致对LLM的引导越来越差,当模型难以编写下一个功能时,开发者甚至无法判断问题根源。更危险的是,随着LLM看到越来越多自己生成的代码而非人类编写的代码,代码库正被拖向“均值化”的危险境地。然而,仍然有方法可以培养这种“直觉理解”:主动制造“惊喜感”——通过故意让LLM尝试极端优化、分析其优劣势、或者在没有反馈的情况下思考可能出错的地方。就像犯错后反而能牢记正确答案一样,这种主动发现和验证的过程能帮助程序员重建对代码的深刻理解。 #AI编程 #软件开发 #代码质量 #LLM #开发者体验 #人工审核 #技术债
Kimi 发布 2.8 万亿参数大模型 K3,百万级上下文窗口

月之暗面旗下 AI 助手 Kimi 正式发布新一代大语言模型 K3,该模型拥有 2.8 万亿参数,支持百万级 token 上下文窗口,并具备原生多模态能力。K3 采用创新的 Kimi Delta 注意力机制,在处理百万 tokens 长文本时,解码速度最高可提升 6.3 倍。同时,注意力残差技术在不增加 2% 以上额外成本的前提下,将训练效率提升了约 25%。该模型专为长期智能体编程和自进化工作流设计,现已登陆 Kimi 官方及 API 平台,并计划于 2026 年 7 月 27 日开放模型权重。 #KimiK3 #月之暗面 #大模型 #多模态AI #长上下文 #科技新闻 #AI #人工智能
Kalshi 指控特朗普提词器操作员进行内幕交易

据媒体报道,美国预测市场平台 Kalshi 发现,其用户在对总统特朗普的演讲内容进行下注时,面临一位非同寻常的对手——总统本人的提词器操作员。Kalshi 指控这名操作员利用提前获取的演讲内容进行内幕交易,从而在相关预测市场中获利。这一事件暴露了新兴预测市场在监管和公平性方面的漏洞。Kalshi 已采取行动冻结相关账户,并警告用户内幕交易将受到严厉惩处。该事件引发了关于预测市场法律边界和监管必要性的广泛讨论。 #Kalshi #内幕交易 #特朗普 #预测市场 #金融监管
月之暗面发布K3国产大模型,网友实测称超越GPT

国内人工智能公司月之暗面近日推出其最新大模型K3。该模型在多项评测中表现惊艳,据网友实测对比,其综合能力已超越业界标杆Fable 5及GPT-5.6版本。月之暗面表示,K3在自然语言理解、逻辑推理和代码生成方面进行了系统性优化,尤其在中文语境下的表现尤为突出。目前,K3已向部分开发者开放内测,吸引大量科技博主和专业人士参与实测,获得较高评价。作为国内规模最大的大模型之一,K3的发布被视为中国AI领域追赶国际先进水平的重要一步,有望推动国产大模型在商业应用和基础研究上的进一步发展。 #月之暗面 #K3 #国产大模型 #AI #人工智能 #科技新闻 #大模型
AI冲击波

国际清算银行(BIS)最新报告显示,美国商业发展公司(BDC)已向软件企业发放约1150亿美元贷款,占其贷款总额的五分之一,更占据其快速增长的技术投资组合的80%以上。尽管生成式人工智能给借款人带来收入不确定性,但目前尚未对这些贷款产生影响,BDC及其股权投资者也未对软件敞口进行差异化定价。近期信用利差收窄,削弱了吸收损失的缓冲空间,部分大型BDC面临共同借款人集中风险。不过,低杠杆率和担保贷款安排可能限制风险的跨机构扩散。 #BDC #私人信贷 #AI风险 #软件行业 #金融稳定 #国际清算银行
Linus Torvalds 强硬支持 AI 代码审查工具,反对者被要求“走人”

近日,Linux 创始人 Linus Torvalds 在邮件列表中明确表态,坚决支持在 Linux 内核开发中使用 AI 工具。此前,开发者 Laurent Pinchart 建议对 AI 工具 Sashiko 的输出进行人工筛选后再发给补丁作者,遭到 Torvalds 严厉驳斥。Torvalds 指出,Linux 不是“反 AI 项目”,任何反对者可以选择分支项目或离开。他称 AI 是工具,如同其他开发工具一样实用,并强调 Sashiko 已能发现 53.6% 的补丁漏洞,远超人工审查水平。Torvalds 还讽刺道,“自然智能也不是总那么好”,暗示开发者需要自我反思。此次争论源于 Sashiko 工具的使用,其设计者为 Google 工程师 Roman Gushchin。Torvalds 的立场与其 2024 年对 AI 工具“夸大其词”的评价形成鲜明对比。 #Linux #LinusTorvalds #AI #代码审查 #开源 #Sashiko #开发工具 #技术新闻