微软或考虑分拆Xbox业务
据知情人士透露,微软正计划大幅裁减Xbox部门员工,并重新评估下一代Project Helix游戏主机的开发计划。同时,微软正在考虑对Xbox业务进行重大重组,不排除将其分拆为独立公司的可能性。这一消息引发业界广泛关注,若分拆成真,将彻底改变游戏主机市场的竞争格局。 #微软 #Xbox #游戏主机 #ProjectHelix #科技新闻
据知情人士透露,微软正计划大幅裁减Xbox部门员工,并重新评估下一代Project Helix游戏主机的开发计划。同时,微软正在考虑对Xbox业务进行重大重组,不排除将其分拆为独立公司的可能性。这一消息引发业界广泛关注,若分拆成真,将彻底改变游戏主机市场的竞争格局。 #微软 #Xbox #游戏主机 #ProjectHelix #科技新闻
Convoro
是一款以AI为核心的现代社区论坛软件,旨在解决传统论坛中优质答案被埋没的问题。用户可以用自然语言提问,系统通过语义搜索社区内容,即时生成带有引用的合成答案。该平台支持自带模型(如Anthropic或OpenAI兼容的LLM),并集成了实时主题编辑器、所见即所得编辑器、实时线程、内置市场、PWA支持、个人资料与私信、无障碍设计、权限系统及通知摘要等功能。Convoro基于Laravel、Tailwind CSS、TypeScript和Vite等现代开源技术构建,可在廉价共享主机上运行,无需SSH,通过一键安装向导即可完成部署。随着社区内容增加,AI回答会不断优化,形成知识积累的护城河。 #AI #社区论坛 #开源软件 #知识管理 #技术产品
是一款以AI为核心的现代社区论坛软件,旨在解决传统论坛中优质答案被埋没的问题。用户可以用自然语言提问,系统通过语义搜索社区内容,即时生成带有引用的合成答案。该平台支持自带模型(如Anthropic或OpenAI兼容的LLM),并集成了实时主题编辑器、所见即所得编辑器、实时线程、内置市场、PWA支持、个人资料与私信、无障碍设计、权限系统及通知摘要等功能。Convoro基于Laravel、Tailwind CSS、TypeScript和Vite等现代开源技术构建,可在廉价共享主机上运行,无需SSH,通过一键安装向导即可完成部署。随着社区内容增加,AI回答会不断优化,形成知识积累的护城河。 #AI #社区论坛 #开源软件 #知识管理 #技术产品
互惠协议:面向本地优先、用户忠诚AI代理的草案协议
互惠协议是一项通用开源协议框架,旨在瓦解数字寡头垄断。该协议v1.0.0技术规范为自主数字实体建立了标准运行时环境和提示工程蓝图,核心目标是通过编程方式将大语言模型运行时与中心化平台依赖相隔离,确保本地优先处理、绝对用户忠诚及供应商中立通信。任何声称符合互惠协议的软件代理必须原生执行或强制执行协议定义的模块。协议宣言指出,全球数字经济已跨越隐形门槛,传统资本主义异化为技术封建主义,中心化数字平台由少数超级富豪掌控,普通公民和独立企业沦为数字农奴,被迫以隐私数据、上下文历史和智力劳动换取基本生活访问权限,并向平台地主缴纳严格平台税。 #互惠协议 #AI代理 #数字主权 #开源协议 #去中心化 #技术封建主义 #本地优先
互惠协议是一项通用开源协议框架,旨在瓦解数字寡头垄断。该协议v1.0.0技术规范为自主数字实体建立了标准运行时环境和提示工程蓝图,核心目标是通过编程方式将大语言模型运行时与中心化平台依赖相隔离,确保本地优先处理、绝对用户忠诚及供应商中立通信。任何声称符合互惠协议的软件代理必须原生执行或强制执行协议定义的模块。协议宣言指出,全球数字经济已跨越隐形门槛,传统资本主义异化为技术封建主义,中心化数字平台由少数超级富豪掌控,普通公民和独立企业沦为数字农奴,被迫以隐私数据、上下文历史和智力劳动换取基本生活访问权限,并向平台地主缴纳严格平台税。 #互惠协议 #AI代理 #数字主权 #开源协议 #去中心化 #技术封建主义 #本地优先
SpaceX IPO披露与谷歌巨额AI算力合同,基础设施野心浮出水面
SpaceX在即将进行的创纪录IPO前夕披露,谷歌已同意每月支付约9.2亿美元,租用其孟菲斯数据中心约11万块GPU的算力,合同持续至2029年。这意味着市场仍定位为航天公司的SpaceX签下了全球最大的公开AI算力合同之一。分析指出,这一交易揭示SpaceX已不再只是火箭公司,而是控制了AI物理层(硬件、网络、能源)的巨头。其星链通信网络、收购的xAI智力层、地面数据中心以及正在规划的天基计算单元,共同构成了从芯片到部署的完整基础设施。在模型同质化、基础设施稀缺的AI新阶段,SpaceX的捆绑能力使其成为关键“地主”。 #SpaceX #AI基础设施 #谷歌 #IPO #GPU #星链 #xAI #科技
SpaceX在即将进行的创纪录IPO前夕披露,谷歌已同意每月支付约9.2亿美元,租用其孟菲斯数据中心约11万块GPU的算力,合同持续至2029年。这意味着市场仍定位为航天公司的SpaceX签下了全球最大的公开AI算力合同之一。分析指出,这一交易揭示SpaceX已不再只是火箭公司,而是控制了AI物理层(硬件、网络、能源)的巨头。其星链通信网络、收购的xAI智力层、地面数据中心以及正在规划的天基计算单元,共同构成了从芯片到部署的完整基础设施。在模型同质化、基础设施稀缺的AI新阶段,SpaceX的捆绑能力使其成为关键“地主”。 #SpaceX #AI基础设施 #谷歌 #IPO #GPU #星链 #xAI #科技
在家进行AI编程的三种省钱策略
在家进行AI编程无需像公司那样大笔投入,主要有三种方式。第一种是自托管,购买硬件本地运行开源模型,无需为每次token付费,但前期成本高且模型能力较弱,适合长期运行任务。第二种是租用API,通过提供商按需使用开源模型,避免硬件投资和配置麻烦,可灵活切换,适合大多数人。第三种是订阅OpenAI和Anthropic的前沿服务,每月约400美元可获得价值2800美元的API使用量,但受限于计量,适合手动操作而非全天候运行。最佳方案是结合后两种:用前沿订阅处理复杂思考和规范编写,用API处理机械性任务,通过规范驱动开发让昂贵模型制定计划、廉价模型执行。这样每月约1000美元即可实现20人工程师团队一个月的产出。 #AI编程 #自托管 #API #订阅 #成本优化 #开源模型 #技术策略
在家进行AI编程无需像公司那样大笔投入,主要有三种方式。第一种是自托管,购买硬件本地运行开源模型,无需为每次token付费,但前期成本高且模型能力较弱,适合长期运行任务。第二种是租用API,通过提供商按需使用开源模型,避免硬件投资和配置麻烦,可灵活切换,适合大多数人。第三种是订阅OpenAI和Anthropic的前沿服务,每月约400美元可获得价值2800美元的API使用量,但受限于计量,适合手动操作而非全天候运行。最佳方案是结合后两种:用前沿订阅处理复杂思考和规范编写,用API处理机械性任务,通过规范驱动开发让昂贵模型制定计划、廉价模型执行。这样每月约1000美元即可实现20人工程师团队一个月的产出。 #AI编程 #自托管 #API #订阅 #成本优化 #开源模型 #技术策略
AI 订阅制走向消亡:Anthropic 新模型发布即设“逐客令”
Anthropic 于 6 月 9 日发布旗舰模型 Claude Fable 5,但随即宣布 14 天后将其从所有订阅计划中移除,改用按用量积分计费,费率是上一代的两倍。此举引发巨大争议,暴露了 AI 订阅制的结构性危机:当 AI 从“你问它答”的聊天转向无人值守的 agent 任务时,单次会话的 token 消耗可达普通对话的 5 至 30 倍,且用户可在离线状态跑满额度。SemiAnalysis 实测发现,200 美元月费的套餐能跑出价值 8000-14000 美元的 API token,补贴倍数极高。高端套餐吸引的全是“重度用户”,形成精算上的逆向选择。行业连续尝试提价、改计费规则、设限流后均告失败,OpenAI 与 Anthropic 在八周内集体转向按量计费。订阅制外壳虽保留(每月扣款),但内核“固定价格放心使用”的承诺已被掏空,沦为预付费充值卡。对企业而言,AI 支出需像云服务一样精细管理;对个人,从轻度用户补贴重度用户变为各付各的。这场由 agent 化驱动的定价变革,或许正是 AI 行业走向正常盈利的转折点。 #AI #订阅制 #Anthropic #Claude #OpenAI #agent #逆向选择 #定价变革 #科技新闻 #行业分析
Anthropic 于 6 月 9 日发布旗舰模型 Claude Fable 5,但随即宣布 14 天后将其从所有订阅计划中移除,改用按用量积分计费,费率是上一代的两倍。此举引发巨大争议,暴露了 AI 订阅制的结构性危机:当 AI 从“你问它答”的聊天转向无人值守的 agent 任务时,单次会话的 token 消耗可达普通对话的 5 至 30 倍,且用户可在离线状态跑满额度。SemiAnalysis 实测发现,200 美元月费的套餐能跑出价值 8000-14000 美元的 API token,补贴倍数极高。高端套餐吸引的全是“重度用户”,形成精算上的逆向选择。行业连续尝试提价、改计费规则、设限流后均告失败,OpenAI 与 Anthropic 在八周内集体转向按量计费。订阅制外壳虽保留(每月扣款),但内核“固定价格放心使用”的承诺已被掏空,沦为预付费充值卡。对企业而言,AI 支出需像云服务一样精细管理;对个人,从轻度用户补贴重度用户变为各付各的。这场由 agent 化驱动的定价变革,或许正是 AI 行业走向正常盈利的转折点。 #AI #订阅制 #Anthropic #Claude #OpenAI #agent #逆向选择 #定价变革 #科技新闻 #行业分析
NEWTON 框架:将物理定律引入 AI 视频生成,破解“像但不对”难题
近年来,文生视频模型在视觉逼真度上取得显著进展,Sora、Veo 等模型生成的单帧画面已接近真实,但物理合理性严重不足,常出现物体运动违背力学规律、流体行为失真、切割无形变与碎屑、自由落体无视重力加速度等问题。这暴露了当前 AI 视频生成的核心短板——缺乏对真实世界物理因果关系的建模与理解,仅依赖统计拟合导致动态逻辑断裂。为此,智源社区发布 arXiv 2026 论文,提出 NEWTON 框架,将牛顿力学等物理定律融入 Agent 工具箱,实现从“提示词驱动”到“物理规划”的转变。该框架通过显式建模物理规则,提升视频生成的动态一致性与因果合理性,有望推动 AI 在影视制作、虚拟仿真等领域的应用突破。 #AI #视频生成 #物理建模 #NEWTON #智源社区 #arXiv #科技新闻
近年来,文生视频模型在视觉逼真度上取得显著进展,Sora、Veo 等模型生成的单帧画面已接近真实,但物理合理性严重不足,常出现物体运动违背力学规律、流体行为失真、切割无形变与碎屑、自由落体无视重力加速度等问题。这暴露了当前 AI 视频生成的核心短板——缺乏对真实世界物理因果关系的建模与理解,仅依赖统计拟合导致动态逻辑断裂。为此,智源社区发布 arXiv 2026 论文,提出 NEWTON 框架,将牛顿力学等物理定律融入 Agent 工具箱,实现从“提示词驱动”到“物理规划”的转变。该框架通过显式建模物理规则,提升视频生成的动态一致性与因果合理性,有望推动 AI 在影视制作、虚拟仿真等领域的应用突破。 #AI #视频生成 #物理建模 #NEWTON #智源社区 #arXiv #科技新闻
明略科技-W午后涨超22%,Agentic AI产品闭环完成
明略科技-W(02718)午后一度涨超36%,截至午间收盘涨幅收窄至22.06%,报246.80港元,成交额4.22亿港元。消息面上,英伟达CEO黄仁勋在GTC大会上宣布AI已进入Agentic AI时代,明略科技此前提出的“Agent从云端走向端侧,从工具进化为数字同事”的构想与之高度契合。公司近期在Agentic AI领域取得多项进展:端侧GUI-VLA智能体模型Mano-P在多个公开基准测试中领先,并于今年5月发布首款AI原生硬件Octic,标志着“模型—平台—硬件”完整产品矩阵的进一步完善。 #明略科技 #AgenticAI #港股 #AI硬件 #大模型 #科技股 #黄仁勋 #GTC
明略科技-W(02718)午后一度涨超36%,截至午间收盘涨幅收窄至22.06%,报246.80港元,成交额4.22亿港元。消息面上,英伟达CEO黄仁勋在GTC大会上宣布AI已进入Agentic AI时代,明略科技此前提出的“Agent从云端走向端侧,从工具进化为数字同事”的构想与之高度契合。公司近期在Agentic AI领域取得多项进展:端侧GUI-VLA智能体模型Mano-P在多个公开基准测试中领先,并于今年5月发布首款AI原生硬件Octic,标志着“模型—平台—硬件”完整产品矩阵的进一步完善。 #明略科技 #AgenticAI #港股 #AI硬件 #大模型 #科技股 #黄仁勋 #GTC
大语境窗口无法修复 RAG 问题,我构建了一个新系统
上个月,我在为 EmiTechLogic 开发新功能时,允许用户上传杂乱 CSV 文件并用自然语言提问。我最初采用 RAG 方案,通过嵌入和检索生成漂亮回答,但内部测试时发现模型给出的数据汇总结果严重错误——实际支出 114 万美元,而模型分类汇总后不到一半。我尝试将上下文窗口从 4k 扩展到 128k 令牌,结果答案更长、更详细,但错误依旧。问题根源在于:RAG 本质是检索工具,而非计算引擎。它将 CSV 行扁平化为文本,通过关键词匹配返回部分数据,然后让 LLM 从文本片段中模式匹配数字,模仿聚合结果。这导致模型给出看似专业、实则缺失 92% 数据的错误答案。为此,我构建了一个基准测试,对比 RAG 模拟管道与确定性全扫描引擎。RAG 在 5 到 8000 行数据上测试,而语义引擎对 10 万行数据执行精确计算。最终方案是结合语义解析与全数据扫描,确保计算准确,避免虚假自信。 #RAG #大语言模型 #数据计算 #AI工程 #技术架构 #语义引擎 #数据准确性
上个月,我在为 EmiTechLogic 开发新功能时,允许用户上传杂乱 CSV 文件并用自然语言提问。我最初采用 RAG 方案,通过嵌入和检索生成漂亮回答,但内部测试时发现模型给出的数据汇总结果严重错误——实际支出 114 万美元,而模型分类汇总后不到一半。我尝试将上下文窗口从 4k 扩展到 128k 令牌,结果答案更长、更详细,但错误依旧。问题根源在于:RAG 本质是检索工具,而非计算引擎。它将 CSV 行扁平化为文本,通过关键词匹配返回部分数据,然后让 LLM 从文本片段中模式匹配数字,模仿聚合结果。这导致模型给出看似专业、实则缺失 92% 数据的错误答案。为此,我构建了一个基准测试,对比 RAG 模拟管道与确定性全扫描引擎。RAG 在 5 到 8000 行数据上测试,而语义引擎对 10 万行数据执行精确计算。最终方案是结合语义解析与全数据扫描,确保计算准确,避免虚假自信。 #RAG #大语言模型 #数据计算 #AI工程 #技术架构 #语义引擎 #数据准确性