三重利好密集来袭:海外大模型解禁,马斯克官宣,国内政策加码
美国解除对OpenAI最强模型GPT-5.6的限制,OpenAI宣布将于7月11日发布Sol、Terra和Luna三款模型,其中Sol旗舰型号在编程测试中表现优异,上下文窗口扩展至150万Tokens。与此同时,马斯克宣布SpaceX AI将于7月9日向公众开放Grok 4.5,称其速度更快、成本更低。国内方面,人社部等四部门印发《关于加快推进“人工智能+人社”应用发展的实施意见》,提出到2030年形成人工智能普遍应用格局。受多重利好刺激,A股及港股AI概念股集体走高,智谱、MINIMAX等涨幅显著,美股中概股阿里巴巴、金山云盘前涨超10%。银河证券认为,AI应用有望加速渗透内容生产、电商等场景。 #AI #人工智能 #OpenAI #马斯克 #Grok #GPT5.6 #政策利好 #A股 #科技新闻
美国解除对OpenAI最强模型GPT-5.6的限制,OpenAI宣布将于7月11日发布Sol、Terra和Luna三款模型,其中Sol旗舰型号在编程测试中表现优异,上下文窗口扩展至150万Tokens。与此同时,马斯克宣布SpaceX AI将于7月9日向公众开放Grok 4.5,称其速度更快、成本更低。国内方面,人社部等四部门印发《关于加快推进“人工智能+人社”应用发展的实施意见》,提出到2030年形成人工智能普遍应用格局。受多重利好刺激,A股及港股AI概念股集体走高,智谱、MINIMAX等涨幅显著,美股中概股阿里巴巴、金山云盘前涨超10%。银河证券认为,AI应用有望加速渗透内容生产、电商等场景。 #AI #人工智能 #OpenAI #马斯克 #Grok #GPT5.6 #政策利好 #A股 #科技新闻
AI的个性究竟从何而来?
一个AI预约系统准确无误地完成了订餐任务,却让用户感到沮丧——这个案例揭示了一个现象:正确不等于好打交道。两个能力相同、评分相同的语言模型,在用同一提示词时可能表现出截然不同的“性格”:一个反复确认,一个果断决策。这种差异并非来自设计,而是源自模型训练中两个相互矛盾的目标——一致性与适应性。一致性要求语气可靠、行为可预测;适应性则需要根据用户和场景调整风格。团队在后训练、奖励模型、系统提示等环节不断进行权衡,却很少承认这正是塑造AI个性的关键。所谓AI个性,本质上是一堆未解决的取舍,披着对齐选择的外衣。它不是有意识设计的结果,而是工程实践中偶然产生的副产品。 #AI #人工智能 #大模型 #人机交互 #模型对齐 #系统设计 #科技新闻
一个AI预约系统准确无误地完成了订餐任务,却让用户感到沮丧——这个案例揭示了一个现象:正确不等于好打交道。两个能力相同、评分相同的语言模型,在用同一提示词时可能表现出截然不同的“性格”:一个反复确认,一个果断决策。这种差异并非来自设计,而是源自模型训练中两个相互矛盾的目标——一致性与适应性。一致性要求语气可靠、行为可预测;适应性则需要根据用户和场景调整风格。团队在后训练、奖励模型、系统提示等环节不断进行权衡,却很少承认这正是塑造AI个性的关键。所谓AI个性,本质上是一堆未解决的取舍,披着对齐选择的外衣。它不是有意识设计的结果,而是工程实践中偶然产生的副产品。 #AI #人工智能 #大模型 #人机交互 #模型对齐 #系统设计 #科技新闻
SoulOS 发布:为 AI Agent 提供状态与人格管理,无需放弃大模型
SoulOS 是一个面向 AI 代理的状态与人格管理工具,允许开发者在不更换底层大语言模型的前提下,灵活配置和控制 Agent 的个性特征与行为逻辑。项目基于 HEXACO 心理测量模型,支持通过可视化向导调整 Agent 的人格参数,并监控人格漂移。SoulOS 提供了多种集成方式,包括 Python SDK、MCP 协议、SSE 流式传输等,支持本地自托管部署。该项目还提供了一系列交互式教程,涵盖快速入门、深度构建、心理测量、API 调用及与 Claude/Cursor 集成等场景,旨在降低 Agent 开发中状态管理的复杂度,提升 Agent 行为的一致性与可控性。 #SoulOS #AI代理 #状态管理 #人格管理 #HEXACO #大模型 #开源 #教程 #开发者工具
SoulOS 是一个面向 AI 代理的状态与人格管理工具,允许开发者在不更换底层大语言模型的前提下,灵活配置和控制 Agent 的个性特征与行为逻辑。项目基于 HEXACO 心理测量模型,支持通过可视化向导调整 Agent 的人格参数,并监控人格漂移。SoulOS 提供了多种集成方式,包括 Python SDK、MCP 协议、SSE 流式传输等,支持本地自托管部署。该项目还提供了一系列交互式教程,涵盖快速入门、深度构建、心理测量、API 调用及与 Claude/Cursor 集成等场景,旨在降低 Agent 开发中状态管理的复杂度,提升 Agent 行为的一致性与可控性。 #SoulOS #AI代理 #状态管理 #人格管理 #HEXACO #大模型 #开源 #教程 #开发者工具
LLM-as-a-Verifier
一篇题为"LLM-as-a-Verifier: A General-Purpose Verification Framework"的论文于2026年7月提交至arXiv预印本平台,作者包括Jacky Kwok等9位研究者。该论文提出将大语言模型本身作为通用验证器,用于检验和提升模型输出的准确性与可靠性,可应用于多种AI任务场景。这一框架有望解决大模型在生成内容时可能出现的幻觉和错误问题,为构建更可信的AI系统提供新思路。论文目前提供PDF版本,并附带相关代码与数据链接,引发了学术界的关注。 #AI #大模型 #LLM #验证框架 #arXiv #论文 #可靠性 #通用验证
一篇题为"LLM-as-a-Verifier: A General-Purpose Verification Framework"的论文于2026年7月提交至arXiv预印本平台,作者包括Jacky Kwok等9位研究者。该论文提出将大语言模型本身作为通用验证器,用于检验和提升模型输出的准确性与可靠性,可应用于多种AI任务场景。这一框架有望解决大模型在生成内容时可能出现的幻觉和错误问题,为构建更可信的AI系统提供新思路。论文目前提供PDF版本,并附带相关代码与数据链接,引发了学术界的关注。 #AI #大模型 #LLM #验证框架 #arXiv #论文 #可靠性 #通用验证
零代码构建AI行动代理,可实时调用API
传统聊天机器人只能被动应答,无法执行查询汇率、订单状态等实时操作。Quickchat平台提供一套零代码方案,通过构建AI行动代理解决这一问题。该代理由三部分组成:知识库、提示词和行动模块。用户只需描述一个HTTP请求(方法、URL及参数),并编写触发条件,模型便能在对话中自主判断何时调用API、填充参数并返回结果。以虚构项目管理工具"Meridian"的支持代理为例,它能在十分钟内完成:知识问答和实时调用免费汇率API(Frankfurter)。这一模式可扩展至CRM写入、Discord管理等多种场景,核心在于用描述性HTTP请求替代传统硬编码集成。 #AI代理 #零代码 #API集成 #Quickchat #自动化 #SaaS
传统聊天机器人只能被动应答,无法执行查询汇率、订单状态等实时操作。Quickchat平台提供一套零代码方案,通过构建AI行动代理解决这一问题。该代理由三部分组成:知识库、提示词和行动模块。用户只需描述一个HTTP请求(方法、URL及参数),并编写触发条件,模型便能在对话中自主判断何时调用API、填充参数并返回结果。以虚构项目管理工具"Meridian"的支持代理为例,它能在十分钟内完成:知识问答和实时调用免费汇率API(Frankfurter)。这一模式可扩展至CRM写入、Discord管理等多种场景,核心在于用描述性HTTP请求替代传统硬编码集成。 #AI代理 #零代码 #API集成 #Quickchat #自动化 #SaaS