无问芯穹发布“前店后厂一中心”战略,应对AI推理Token成本难题
在2026年世界人工智能大会上,AI基础设施公司无问芯穹提出“前店后厂一中心”的Agentic Infra战略布局。创始人夏立雪表示,随着大模型从训练走向推理和Agent时代,企业频繁遭遇“Token刺客”——Token账单增长迅速,却难以衡量实际价值。无问芯穹自2021年成立以来,专注于打通M种模型与N种芯片的异构优化,从早期的“Token工厂”演进为面向Agent应用的基础设施平台。夏立雪将商业模式总结为“算力即收入,优化即利润”,强调通过系统优化使Token成本在已下降10倍的基础上,未来仍有超过10倍的下降空间。公司通过技术迭代实现单日调用量40倍增长,并与多家头部大模型企业合作,推动AI基础设施从资源供给转向效率竞争。 #无问芯穹 #AI基础设施 #Token成本 #人工智能 #WAIC2026 #夏立雪 #前店后厂一中心 #AgenticInfra
在2026年世界人工智能大会上,AI基础设施公司无问芯穹提出“前店后厂一中心”的Agentic Infra战略布局。创始人夏立雪表示,随着大模型从训练走向推理和Agent时代,企业频繁遭遇“Token刺客”——Token账单增长迅速,却难以衡量实际价值。无问芯穹自2021年成立以来,专注于打通M种模型与N种芯片的异构优化,从早期的“Token工厂”演进为面向Agent应用的基础设施平台。夏立雪将商业模式总结为“算力即收入,优化即利润”,强调通过系统优化使Token成本在已下降10倍的基础上,未来仍有超过10倍的下降空间。公司通过技术迭代实现单日调用量40倍增长,并与多家头部大模型企业合作,推动AI基础设施从资源供给转向效率竞争。 #无问芯穹 #AI基础设施 #Token成本 #人工智能 #WAIC2026 #夏立雪 #前店后厂一中心 #AgenticInfra
提示工程并非万能:上下文工程四模块如何阻止RAG“幻觉”
传统观点认为,通过优化提示词(Prompt Engineering)可以缓解大模型在检索增强生成(RAG)中的“幻觉”问题。然而,最新研究指出,真正有效的方案是构建完整的上下文工程(Context Engineering)体系,包含四个关键模块:上下文锚定、语义边界、引用验证和噪声过滤。在NIST和世界银行真实文档测试中,单独使用提示工程会导致模型“忠实”地回答错误上下文,而四模块协同工作能够精准锁定信息源、剔除无关数据,并强制模型基于正确事实生成回答,从而从根本上消除幻觉。该方法已在企业文档智能场景中验证,可显著提升生成内容的可信度与准确性。 #RAG #大模型 #幻觉 #上下文工程 #提示工程 #企业智能 #AI可靠性
传统观点认为,通过优化提示词(Prompt Engineering)可以缓解大模型在检索增强生成(RAG)中的“幻觉”问题。然而,最新研究指出,真正有效的方案是构建完整的上下文工程(Context Engineering)体系,包含四个关键模块:上下文锚定、语义边界、引用验证和噪声过滤。在NIST和世界银行真实文档测试中,单独使用提示工程会导致模型“忠实”地回答错误上下文,而四模块协同工作能够精准锁定信息源、剔除无关数据,并强制模型基于正确事实生成回答,从而从根本上消除幻觉。该方法已在企业文档智能场景中验证,可显著提升生成内容的可信度与准确性。 #RAG #大模型 #幻觉 #上下文工程 #提示工程 #企业智能 #AI可靠性
David Vélez 与 Robin Vince 加入 OpenAI 基金会及 OpenAI Group PBC 董事会
据悉,金融科技领域知名企业家 David Vélez(Nubank 创始人兼首席执行官)与金融业资深领袖 Robin Vince 已正式加入 OpenAI 基金会及 OpenAI Group PBC 的董事会。两人将凭借在金融、技术与治理领域的全球领导力,为 Open AI 的战略决策与机构治理提供重要支持。此次任命正值 OpenAI 从非营利向营利性转型的关键阶段,旨在进一步完善董事会结构,平衡商业发展与公益使命。此外,两位新董事的加入也反映了 OpenAI 对强化顶层治理、应对人工智能行业监管及社会责任挑战的重视。 #OpenAI #DavidVélez #RobinVince #董事会 #AI治理 #金融科技 #人工智能 #基金会 #PBC #科技新闻
据悉,金融科技领域知名企业家 David Vélez(Nubank 创始人兼首席执行官)与金融业资深领袖 Robin Vince 已正式加入 OpenAI 基金会及 OpenAI Group PBC 的董事会。两人将凭借在金融、技术与治理领域的全球领导力,为 Open AI 的战略决策与机构治理提供重要支持。此次任命正值 OpenAI 从非营利向营利性转型的关键阶段,旨在进一步完善董事会结构,平衡商业发展与公益使命。此外,两位新董事的加入也反映了 OpenAI 对强化顶层治理、应对人工智能行业监管及社会责任挑战的重视。 #OpenAI #DavidVélez #RobinVince #董事会 #AI治理 #金融科技 #人工智能 #基金会 #PBC #科技新闻
GPT-5.6、Claude、Gemini 与 Grok 同台“画”蒙娜丽莎,成本相差20倍
一项有趣的AI绘画实验让四大前沿模型——GPT-5.6 Sol、Claude Fable 5、Grok 4.5 和 Gemini 3.6 Flash——使用完全相同的彩色铅笔工具集,自主绘制蒙娜丽莎与星月夜等目标。模型可自由选择颜色、笔尖宽度、压力,通过笔触、涂抹、擦除和自检画布来迭代改进。实验共完成28幅画作,目标图像以结构相似度打分,开放式主题则供主观对比。结果令人惊讶:模型使用工具的方式截然不同——GPT-5.6直接将参数内嵌于绘图调用,Claude偏爱涂抹,Gemini频繁自检,而Grok则耗费大量调用设置画笔参数。成本差距更为悬殊:Claude Fable 5七幅画花费约160美元,是GPT-5.6 Sol(7.74美元)的20倍,Grok 4.5(9.72美元)和Gemini 3.6 Flash(13.66美元)则居中。实验者强调,这并非客观能力测试,而是探索模型在开放式模糊任务中的行为差异。 #AI绘画 #GPT5 #Claude #Grok #Gemini #模型对比 #成本分析 #科技实验
一项有趣的AI绘画实验让四大前沿模型——GPT-5.6 Sol、Claude Fable 5、Grok 4.5 和 Gemini 3.6 Flash——使用完全相同的彩色铅笔工具集,自主绘制蒙娜丽莎与星月夜等目标。模型可自由选择颜色、笔尖宽度、压力,通过笔触、涂抹、擦除和自检画布来迭代改进。实验共完成28幅画作,目标图像以结构相似度打分,开放式主题则供主观对比。结果令人惊讶:模型使用工具的方式截然不同——GPT-5.6直接将参数内嵌于绘图调用,Claude偏爱涂抹,Gemini频繁自检,而Grok则耗费大量调用设置画笔参数。成本差距更为悬殊:Claude Fable 5七幅画花费约160美元,是GPT-5.6 Sol(7.74美元)的20倍,Grok 4.5(9.72美元)和Gemini 3.6 Flash(13.66美元)则居中。实验者强调,这并非客观能力测试,而是探索模型在开放式模糊任务中的行为差异。 #AI绘画 #GPT5 #Claude #Grok #Gemini #模型对比 #成本分析 #科技实验
智能并非医学进步的主要瓶颈
在近期一次晚宴上,一位AI实验室人员质疑作者为何执着于医疗监管瓶颈,并坚信通用人工智能很快将通过超强说服力改变一切。作者却认为,无论AI变得多“智能”,现实世界改变的瓶颈往往并非智能本身,而是制度性障碍——如住房领域技术早已存在,却因政治意愿缺失而愈发昂贵。她指出,AI实验室CEO们常以“治愈疾病”为由证明AI风险值得承担,但医学进步被临床试验的繁琐、监管的僵化等多重因素所困,这些都与“智能”水平无关。作者观察旧金山的社会动态与医学实践后表示,当前社会盲目相信AI能解决所有问题,却忽略了那些不性感但关键的瓶颈。她坚持认为,除非我们清晰思考这些问题,否则AI难以触及人们真正关心的医疗痛点。 #AI #医学 #监管 #临床试验 #瓶颈 #AGI #科技 #政策 #社会 #医疗
在近期一次晚宴上,一位AI实验室人员质疑作者为何执着于医疗监管瓶颈,并坚信通用人工智能很快将通过超强说服力改变一切。作者却认为,无论AI变得多“智能”,现实世界改变的瓶颈往往并非智能本身,而是制度性障碍——如住房领域技术早已存在,却因政治意愿缺失而愈发昂贵。她指出,AI实验室CEO们常以“治愈疾病”为由证明AI风险值得承担,但医学进步被临床试验的繁琐、监管的僵化等多重因素所困,这些都与“智能”水平无关。作者观察旧金山的社会动态与医学实践后表示,当前社会盲目相信AI能解决所有问题,却忽略了那些不性感但关键的瓶颈。她坚持认为,除非我们清晰思考这些问题,否则AI难以触及人们真正关心的医疗痛点。 #AI #医学 #监管 #临床试验 #瓶颈 #AGI #科技 #政策 #社会 #医疗