Neural Collapse 被否定
近日,一篇发表在 arXiv 上的研究论文《Neural Collapse Is Forbidden: Information Floors in Language Models》提出新观点。传统上,语言模型表示中的类内方差常被视为不完全的神经坍缩,但该研究认为,这种方差实际上是分配的信息存储,且遵循某种规律。一个单行的中心化恒等式否定了包括研究者此前成果在内的多个单纯形等角紧框架主张。在 14 个模型的无量纲方差份额中,宏观类别结构仅承载 4-12% 的表示方差,而词元内共…(由于论文摘要被截断,更多细节需查阅全文)。该发现挑战了神经坍缩在语言模型领域的适用性,暗示信息存储机制更为复杂。 #NeuralCollapse #语言模型 #信息存储 #AI研究 #arXiv
近日,一篇发表在 arXiv 上的研究论文《Neural Collapse Is Forbidden: Information Floors in Language Models》提出新观点。传统上,语言模型表示中的类内方差常被视为不完全的神经坍缩,但该研究认为,这种方差实际上是分配的信息存储,且遵循某种规律。一个单行的中心化恒等式否定了包括研究者此前成果在内的多个单纯形等角紧框架主张。在 14 个模型的无量纲方差份额中,宏观类别结构仅承载 4-12% 的表示方差,而词元内共…(由于论文摘要被截断,更多细节需查阅全文)。该发现挑战了神经坍缩在语言模型领域的适用性,暗示信息存储机制更为复杂。 #NeuralCollapse #语言模型 #信息存储 #AI研究 #arXiv
高概率求解随机不动点方程的新方法公布
研究人员Jelena Diakonikolas提出了一种求解随机不动点方程的高概率方法。该论文已被收录至arXiv预印本平台,目前正在等待DataCite的DOI分配。研究聚焦于在概率框架下确保不动点求解的稳定性与精度,相关算法有望为机器学习、优化理论及数值计算等领域提供更可靠的工具。论文提供了PDF、HTML及TeX源码等多种访问形式,并获得了NASA ADS、Google Scholar等学术平台的引用链接。arXivLabs社区也对该成果表示关注,强调其开放性及数据隐私保护。 #随机不动点方程 #高概率求解 #机器学习 #数值计算 #arXiv #学术研究
研究人员Jelena Diakonikolas提出了一种求解随机不动点方程的高概率方法。该论文已被收录至arXiv预印本平台,目前正在等待DataCite的DOI分配。研究聚焦于在概率框架下确保不动点求解的稳定性与精度,相关算法有望为机器学习、优化理论及数值计算等领域提供更可靠的工具。论文提供了PDF、HTML及TeX源码等多种访问形式,并获得了NASA ADS、Google Scholar等学术平台的引用链接。arXivLabs社区也对该成果表示关注,强调其开放性及数据隐私保护。 #随机不动点方程 #高概率求解 #机器学习 #数值计算 #arXiv #学术研究
EHR-MPC 论文提出脓毒症治疗新方法,实现智能用药控制
一项发表于 arXiv 的研究提出了名为 EHR-MPC 的脓毒症治疗新框架。该方法利用生成式患者数字孪生技术,在模型推理阶段实现用药控制的动态优化。与传统静态治疗方案不同,EHR-MPC 能够根据患者的实时电子健康记录数据,生成个性化的治疗策略,从而更精准地应对脓毒症这一复杂疾病。该研究由 Joshua Pickard 等七位作者完成,论文已在 arXiv 预印本平台公开,并提供了 HTML 和 PDF 版本的全文链接。这一方法有望为临床决策支持系统提供新的思路,提升脓毒症患者的治疗效果。 #脓毒症 #治疗 #EHR #数字孪生 #AI #医疗 #arXiv #论文
一项发表于 arXiv 的研究提出了名为 EHR-MPC 的脓毒症治疗新框架。该方法利用生成式患者数字孪生技术,在模型推理阶段实现用药控制的动态优化。与传统静态治疗方案不同,EHR-MPC 能够根据患者的实时电子健康记录数据,生成个性化的治疗策略,从而更精准地应对脓毒症这一复杂疾病。该研究由 Joshua Pickard 等七位作者完成,论文已在 arXiv 预印本平台公开,并提供了 HTML 和 PDF 版本的全文链接。这一方法有望为临床决策支持系统提供新的思路,提升脓毒症患者的治疗效果。 #脓毒症 #治疗 #EHR #数字孪生 #AI #医疗 #arXiv #论文
GPT-5.6与Grok 4.5同日发布,性能与成本成焦点
Grok 4.5与GPT-5.6几乎同日发布,在评测界引发分裂。SpaceXAI于7月8日推出Grok 4.5,次日OpenAI发布GPT-5.6系列,包含旗舰Sol及更便宜的Terra和Luna。基准测试显示,Grok 4.5智力得分54分,排名第四。直接对比中,GPT-5.6 Sol综合得分86分,领先Grok 4.5的82分,优势主要在智能体任务(91.9%对83.3%),但纯编码得分几乎持平。然而,经济性上Grok优势明显,其输入侧每百万代币收费2美元,远低于Sol的5美元。实测显示,Sol一次性完成率63.7%,Grok则以响应速度和稳定输出著称,延迟小于5秒。但Grok的幻觉风险不容忽视,其幻觉率从25%飙升至54%。市场关注SpaceXAI收购整合与OpenAI面临监管的背景,这场对决在模型能力与性价比之间划出了清晰的分界线。 #GPT5 #Grok4 #AI #机器学习 #科技新闻 #大模型 #人工智能 #OpenAI #SpaceXAI
Grok 4.5与GPT-5.6几乎同日发布,在评测界引发分裂。SpaceXAI于7月8日推出Grok 4.5,次日OpenAI发布GPT-5.6系列,包含旗舰Sol及更便宜的Terra和Luna。基准测试显示,Grok 4.5智力得分54分,排名第四。直接对比中,GPT-5.6 Sol综合得分86分,领先Grok 4.5的82分,优势主要在智能体任务(91.9%对83.3%),但纯编码得分几乎持平。然而,经济性上Grok优势明显,其输入侧每百万代币收费2美元,远低于Sol的5美元。实测显示,Sol一次性完成率63.7%,Grok则以响应速度和稳定输出著称,延迟小于5秒。但Grok的幻觉风险不容忽视,其幻觉率从25%飙升至54%。市场关注SpaceXAI收购整合与OpenAI面临监管的背景,这场对决在模型能力与性价比之间划出了清晰的分界线。 #GPT5 #Grok4 #AI #机器学习 #科技新闻 #大模型 #人工智能 #OpenAI #SpaceXAI