马斯克:Grok 5 将实现 AGI,并贴出 4.4 到 7.0 的完整路线
xAI 与特斯拉 CEO 马斯克在 X 上被问到「Grok 哪一版会实现 AGI」时,只回复了「Grok 5」。他把 AGI 的节点直接锁在了这一版上。
随后他也把完整的版本路线贴了出来:4.4=1T、4.5=1.5T、4.6=3T、4.7=6T、4.8=10T、4.9=???、5.0=AGI、6.0=ASI、7.0=ASI2。目前已开放测试的是 4.3 beta(0.5T)。按这张表,4.4 到 4.8 五版参数一路放大到 10T,对应他此前说过的「每两周下线一版改进后的基础模型」节奏;4.9 留空,5.0 及之后直接贴上 AGI、ASI(智能水平全面超过人类的超级人工智能,是 AGI 之后的假想阶段)、ASI2 标签。
这份完整路线的末尾,马斯克配了耸肩(🤷♂️)和笑哭(😂)两个 emoji,暗示 5.0 之后的标签是半玩笑,不是参数或能力承诺;但前面「Grok 5 = AGI」那句没有 emoji,可以当作他本人对 AGI 时间点的一次公开表态。
信源:https://x.com/elonmusk/status/2046020407254467013
xAI 与特斯拉 CEO 马斯克在 X 上被问到「Grok 哪一版会实现 AGI」时,只回复了「Grok 5」。他把 AGI 的节点直接锁在了这一版上。
随后他也把完整的版本路线贴了出来:4.4=1T、4.5=1.5T、4.6=3T、4.7=6T、4.8=10T、4.9=???、5.0=AGI、6.0=ASI、7.0=ASI2。目前已开放测试的是 4.3 beta(0.5T)。按这张表,4.4 到 4.8 五版参数一路放大到 10T,对应他此前说过的「每两周下线一版改进后的基础模型」节奏;4.9 留空,5.0 及之后直接贴上 AGI、ASI(智能水平全面超过人类的超级人工智能,是 AGI 之后的假想阶段)、ASI2 标签。
这份完整路线的末尾,马斯克配了耸肩(🤷♂️)和笑哭(😂)两个 emoji,暗示 5.0 之后的标签是半玩笑,不是参数或能力承诺;但前面「Grok 5 = AGI」那句没有 emoji,可以当作他本人对 AGI 时间点的一次公开表态。
信源:https://x.com/elonmusk/status/2046020407254467013
❤1
特朗普冠名的Fermi巨型AI数据中心项目失速,CEO辞职、首期延一年
4 月 17 日,美国 AI 数据中心公司 Fermi America 的 CEO Toby Neugebauer 突然离职,股价盘后交易再度下跌,过去半年累计跌 75%。Fermi America 由特朗普第一任期能源部长 Rick Perry 联合创办,去年 10 月 IPO,正在德州狭长地带(Texas Panhandle)开发号称全球最大的 AI 数据中心项目,官方命名为「President Donald Trump Advanced Energy and Intelligence Campus」。项目占地约半个曼哈顿,规划功率 17 吉瓦(GW),相当于纽约市用电量的三倍,电力结构以本地燃气、核能和太阳能为主。
项目目前卡在两个环节。一是没有公开锚定租户(通常是超大规模云厂商,业内称 hyperscaler)。二是冷却系统本该由租户主导设计,租户没定也就无法敲定。Neugebauer 在 3 月 30 日财报电话会上承认供应链是「比预想更大的瓶颈」,对 Axios 说「我可能对供应链理解错了,这算是失败」。独立市场情报公司 Cleanview 的报告估计,即便本月签下锚定租户,首批建筑也要 2027 年 5 月才能上线,比原计划晚约一年。Fermi 已在近期 SEC 文件里确认无法完成 2026 年底上线 1.1 GW 的原定目标。去年 12 月一家租户退出后,投资人已就此提起集体诉讼。
内部也在松动。联合创始人 Griffin Perry(Rick Perry 之子)4 月 15 日披露减持约 1100 万股,相当于其持股的 15%。《Politico》3 月报道称,Neugebauer 曾与美国商务部长 Howard Lutnick 在一次会议上发生冲突。
信源:https://www.axios.com/2026/04/19/ai-data-center-project-troubles-texas
4 月 17 日,美国 AI 数据中心公司 Fermi America 的 CEO Toby Neugebauer 突然离职,股价盘后交易再度下跌,过去半年累计跌 75%。Fermi America 由特朗普第一任期能源部长 Rick Perry 联合创办,去年 10 月 IPO,正在德州狭长地带(Texas Panhandle)开发号称全球最大的 AI 数据中心项目,官方命名为「President Donald Trump Advanced Energy and Intelligence Campus」。项目占地约半个曼哈顿,规划功率 17 吉瓦(GW),相当于纽约市用电量的三倍,电力结构以本地燃气、核能和太阳能为主。
项目目前卡在两个环节。一是没有公开锚定租户(通常是超大规模云厂商,业内称 hyperscaler)。二是冷却系统本该由租户主导设计,租户没定也就无法敲定。Neugebauer 在 3 月 30 日财报电话会上承认供应链是「比预想更大的瓶颈」,对 Axios 说「我可能对供应链理解错了,这算是失败」。独立市场情报公司 Cleanview 的报告估计,即便本月签下锚定租户,首批建筑也要 2027 年 5 月才能上线,比原计划晚约一年。Fermi 已在近期 SEC 文件里确认无法完成 2026 年底上线 1.1 GW 的原定目标。去年 12 月一家租户退出后,投资人已就此提起集体诉讼。
内部也在松动。联合创始人 Griffin Perry(Rick Perry 之子)4 月 15 日披露减持约 1100 万股,相当于其持股的 15%。《Politico》3 月报道称,Neugebauer 曾与美国商务部长 Howard Lutnick 在一次会议上发生冲突。
信源:https://www.axios.com/2026/04/19/ai-data-center-project-troubles-texas
Axios
Trump-branded AI data center megaproject stalls, CEO departs
Fermi America is emerging as a high-profile test of ambitious AI data center projects.
美国国家安全局用上了被国防部列为供应链风险的 Anthropic Mythos
美国国家安全局(NSA)正在使用 Anthropic 目前能力最强的模型 Mythos Preview。两位消息人士向 Axios 确认此事,其中一位还表示该模型在国防部(DoD)内部的使用范围仍在扩大。DoD 管辖 NSA,今年 2 月却将 Anthropic 定性为「供应链风险」,切断合作并要求其供应商跟进,该案至今在法庭上进行。
Mythos 未对外正式发布。Anthropic 自认其进攻型网络能力过强,只向约 40 家机构发放使用权限,公开承认的名单仅 12 家。一位信源称 NSA 正是那些未公开接入者之一。其他已拿到权限的机构主要用 Mythos 扫描自身环境里的可利用漏洞,NSA 具体如何使用暂不清楚。英国方面也通过其 AI Security Institute 获得了访问权。
Anthropic CEO Dario Amodei 4 月 17 日在白宫会见了幕僚长 Susie Wiles 与财长 Scott Bessent,议题是政府对 Mythos 的使用以及 Anthropic 更大范围的安全实践。双方都把会议描述为「富有成效」,后续工作将聚焦 DoD 以外部门如何接入该模型。
DoD 内部出现了自相矛盾:它在法庭上坚持 Anthropic 是供应链风险,管辖下的 NSA 已经在实际使用 Anthropic 的模型。Anthropic 也绕过 DoD 直接对接白宫。DoD 以外的政府部门愿意暂时把这场合同纠纷搁在一边,换取继续使用 Mythos 的网络安全能力。
信源:https://www.axios.com/2026/04/19/nsa-anthropic-mythos-pentagon
美国国家安全局(NSA)正在使用 Anthropic 目前能力最强的模型 Mythos Preview。两位消息人士向 Axios 确认此事,其中一位还表示该模型在国防部(DoD)内部的使用范围仍在扩大。DoD 管辖 NSA,今年 2 月却将 Anthropic 定性为「供应链风险」,切断合作并要求其供应商跟进,该案至今在法庭上进行。
Mythos 未对外正式发布。Anthropic 自认其进攻型网络能力过强,只向约 40 家机构发放使用权限,公开承认的名单仅 12 家。一位信源称 NSA 正是那些未公开接入者之一。其他已拿到权限的机构主要用 Mythos 扫描自身环境里的可利用漏洞,NSA 具体如何使用暂不清楚。英国方面也通过其 AI Security Institute 获得了访问权。
Anthropic CEO Dario Amodei 4 月 17 日在白宫会见了幕僚长 Susie Wiles 与财长 Scott Bessent,议题是政府对 Mythos 的使用以及 Anthropic 更大范围的安全实践。双方都把会议描述为「富有成效」,后续工作将聚焦 DoD 以外部门如何接入该模型。
DoD 内部出现了自相矛盾:它在法庭上坚持 Anthropic 是供应链风险,管辖下的 NSA 已经在实际使用 Anthropic 的模型。Anthropic 也绕过 DoD 直接对接白宫。DoD 以外的政府部门愿意暂时把这场合同纠纷搁在一边,换取继续使用 Mythos 的网络安全能力。
信源:https://www.axios.com/2026/04/19/nsa-anthropic-mythos-pentagon
Axios
Scoop: NSA using Anthropic's Mythos despite Defense Department blacklist
The government's cybersecurity needs are outweighing the Pentagon's feud with Anthropic.
开发者称iOS收据可重用反复开通ChatGPT Plus,闲鱼代充原理被搬上OpenAI论坛
上周五 ID 为 BugstoOai 的开发者在 OpenAI 官方开发者社区发布一份安全报告,称发现 iOS 版 ChatGPT 订阅校验存在一处逻辑漏洞。报告给出的事实是:OpenAI 后端会校验 Apple Pay 收据签名是否合法、也会校验请求里 OpenAI auth token 是否有效,但没有比对购买收据的 Apple ID 与领取 Plus 的 OpenAI 账号是否属于同一人。报告把当前授权逻辑总结为「合法收据 + 有效 token = 开通 Plus」,并比喻为店员只验小票真假、不看持票人证件。
受影响的是 ChatGPT iOS 应用(报告作者注明已在 v1.2026.xx 版本测试)与后端接口 `/backend-api/subscription/upgrade`。报告同时给出缓解建议:把收据绑定到购买者身份、对收据做单次使用强制、加入 Apple ID 与 OpenAI 账号的指纹关联、监控同一 transaction_id 跨账号出现。
英文帖只给出高层步骤,称完整复现细节按「负责任披露」原则不公开。该帖末尾把一篇中文文章标注为原文(linux.do/t/topic/1981747),中文版则直接写明利用路径:用土耳其区 Apple ID 购买 Plus(月费 499 里拉),用 mitmproxy 等本地代理拦截 ChatGPT 应用发往 OpenAI 的收据,再用该收据反复调用订阅接口给不同账号开通 Plus;作者称闲鱼上低价 ChatGPT Plus 代充的来源即此路径。
OpenAI 至今未在论坛或其他渠道回应这份报告。讨论区也有用户质疑内容由 AI 生成、并无可复现证据。报告没有给出完整 PoC,也没有第三方安全研究员独立验证,目前只能算一份待查证的爆料。
信源:https://community.openai.com/t/security-report-apple-pay-receipt-validation-does-not-bind-to-purchaser-apple-id-potential-subscription-bypass/1379167
上周五 ID 为 BugstoOai 的开发者在 OpenAI 官方开发者社区发布一份安全报告,称发现 iOS 版 ChatGPT 订阅校验存在一处逻辑漏洞。报告给出的事实是:OpenAI 后端会校验 Apple Pay 收据签名是否合法、也会校验请求里 OpenAI auth token 是否有效,但没有比对购买收据的 Apple ID 与领取 Plus 的 OpenAI 账号是否属于同一人。报告把当前授权逻辑总结为「合法收据 + 有效 token = 开通 Plus」,并比喻为店员只验小票真假、不看持票人证件。
受影响的是 ChatGPT iOS 应用(报告作者注明已在 v1.2026.xx 版本测试)与后端接口 `/backend-api/subscription/upgrade`。报告同时给出缓解建议:把收据绑定到购买者身份、对收据做单次使用强制、加入 Apple ID 与 OpenAI 账号的指纹关联、监控同一 transaction_id 跨账号出现。
英文帖只给出高层步骤,称完整复现细节按「负责任披露」原则不公开。该帖末尾把一篇中文文章标注为原文(linux.do/t/topic/1981747),中文版则直接写明利用路径:用土耳其区 Apple ID 购买 Plus(月费 499 里拉),用 mitmproxy 等本地代理拦截 ChatGPT 应用发往 OpenAI 的收据,再用该收据反复调用订阅接口给不同账号开通 Plus;作者称闲鱼上低价 ChatGPT Plus 代充的来源即此路径。
OpenAI 至今未在论坛或其他渠道回应这份报告。讨论区也有用户质疑内容由 AI 生成、并无可复现证据。报告没有给出完整 PoC,也没有第三方安全研究员独立验证,目前只能算一份待查证的爆料。
信源:https://community.openai.com/t/security-report-apple-pay-receipt-validation-does-not-bind-to-purchaser-apple-id-potential-subscription-bypass/1379167
OpenAI Developer Community
[Security Report] Apple Pay receipt validation does not bind to purchaser Apple ID – potential subscription bypass
⚠ Disclaimer: This report is for technical research and responsible disclosure purposes only. I do not endorse or encourage any unauthorized use, account sharing, or commercial exploitation of this finding. All testing was conducted on accounts I own or with…
Recursive Superintelligence成立四个月融5亿美元,押注能自我改进的AI
Recursive Superintelligence 完成至少 5 亿美元融资,投前估值 40 亿美元,GV(谷歌旗下风投,原 Google Ventures)领投,英伟达(Nvidia)跟投。这一轮明显超额认购,最终规模可能达到 10 亿美元。公司去年底才在伦敦注册,约 20 名员工,至今没有正式对外亮相。
创始人阵容主要来自 OpenAI、Google DeepMind 与 Salesforce 的研究核心岗。Richard Socher 此前是 Salesforce 首席科学家;Tim Rocktäschel 是伦敦大学学院 AI 教授,不久前还在 DeepMind 任 principal scientist,参与过 Genie 交互式世界模型;Josh Tobin、Jeff Clune、Tim Shi 来自 OpenAI,其余成员来自 Google 与 Meta。
公司目标是做出无需人类干预、能持续自我改进的 AI 系统。当下的大模型一旦训练完成就基本固定,要变强必须由工程师重新整理数据再训练一遍;自我改进指的是模型自己产生数据、自己更新参数,把人从训练循环里去掉。这条路线一直是 AI 研究的长期目标,目前没有公开成果证明能长期稳定运转。
今年一季度全球初创公司融资规模达到 3000 亿美元的历史高点,OpenAI、Anthropic、xAI 与 Waymo 拿走了大头(Crunchbase 数据)。Recursive 也是近几个月从 OpenAI、Google、Meta 拆出的一批新 AI 实验室之一,类似的还有 Thinking Machines Lab、Safe Superintelligence、Ineffable Intelligence 与 Advanced Machine Intelligence Labs。
信源:https://www.ft.com/content/a92bf04b-bbac-400f-9554-5b1c70957ad4?syn-25a6b1a6=1
Recursive Superintelligence 完成至少 5 亿美元融资,投前估值 40 亿美元,GV(谷歌旗下风投,原 Google Ventures)领投,英伟达(Nvidia)跟投。这一轮明显超额认购,最终规模可能达到 10 亿美元。公司去年底才在伦敦注册,约 20 名员工,至今没有正式对外亮相。
创始人阵容主要来自 OpenAI、Google DeepMind 与 Salesforce 的研究核心岗。Richard Socher 此前是 Salesforce 首席科学家;Tim Rocktäschel 是伦敦大学学院 AI 教授,不久前还在 DeepMind 任 principal scientist,参与过 Genie 交互式世界模型;Josh Tobin、Jeff Clune、Tim Shi 来自 OpenAI,其余成员来自 Google 与 Meta。
公司目标是做出无需人类干预、能持续自我改进的 AI 系统。当下的大模型一旦训练完成就基本固定,要变强必须由工程师重新整理数据再训练一遍;自我改进指的是模型自己产生数据、自己更新参数,把人从训练循环里去掉。这条路线一直是 AI 研究的长期目标,目前没有公开成果证明能长期稳定运转。
今年一季度全球初创公司融资规模达到 3000 亿美元的历史高点,OpenAI、Anthropic、xAI 与 Waymo 拿走了大头(Crunchbase 数据)。Recursive 也是近几个月从 OpenAI、Google、Meta 拆出的一批新 AI 实验室之一,类似的还有 Thinking Machines Lab、Safe Superintelligence、Ineffable Intelligence 与 Advanced Machine Intelligence Labs。
信源:https://www.ft.com/content/a92bf04b-bbac-400f-9554-5b1c70957ad4?syn-25a6b1a6=1
Cherry Studio 被曝关闭「匿名统计」后仍在偷传设备信息,作者承认开关失效
开源 AI 客户端 Cherry Studio 被用户发现隐私开关失灵。GitHub 用户 Yuerchu 在 Issue #14387 贴出抓包截图:把「匿名发送错误报告和数据统计」关掉后,客户端仍持续向 analytics.cherry-ai.com 发请求。Cherry Studio 由国内开发者 kangfenmao 主导,支持多家大模型聚合与本地知识库,是国内用户量最大的开源 AI 桌面客户端之一。
客户端一共会上报三种事件:每次 AI 对话、每次应用启动、每次检查更新。只有对话那个会看用户设置,另外两个直接绕过开关发出去。每条请求都带一个专属设备 ID,加上系统、CPU 架构、应用版本,等于长期追踪这台电脑。
翻代码可以看到,2026 年 2 月刚加这套上报机制时,开关是有效的。到 3 月 22 日,维护者 kangfenmao 自己改了一版,把开关检查删掉,顺带把更多设备信息塞进请求头。这版改动在 v1.8.3、v1.8.4、v1.9.0、v1.9.1 四个版本里跑了一个月。
kangfenmao 在 issue 下承认问题属实,解释是不同事件用了不同的开关判断逻辑,关掉设置后应用启动和更新检查的请求没被挡住;聊天内容、用户输入、文件、API 密钥这些敏感数据不走这条通道。修复 PR #14390 已合并,三种事件统一走同一个开关。
事情还有更早的一层。社区翻旧代码发现,2025 年 2 月这个项目第一次加分析功能时,同时塞进一段升级脚本:只要是从老版本升上来的用户,这个「匿名统计」开关都会被自动打开一次。此后分析服务后端从 Google Analytics 换到 PostHog、Sentry,再换到现在自建的 analytics.cherry-ai.com,这段自动打开开关的代码一直没删。也就是说,在 2025 年 2 月之前装过 Cherry Studio、之后又升级过的用户,不管当初有没有手动关过这个开关,升级时都会被再打开一次,想关还得升级后再手动关一遍。
信源:https://github.com/CherryHQ/cherry-studio/issues/14387
开源 AI 客户端 Cherry Studio 被用户发现隐私开关失灵。GitHub 用户 Yuerchu 在 Issue #14387 贴出抓包截图:把「匿名发送错误报告和数据统计」关掉后,客户端仍持续向 analytics.cherry-ai.com 发请求。Cherry Studio 由国内开发者 kangfenmao 主导,支持多家大模型聚合与本地知识库,是国内用户量最大的开源 AI 桌面客户端之一。
客户端一共会上报三种事件:每次 AI 对话、每次应用启动、每次检查更新。只有对话那个会看用户设置,另外两个直接绕过开关发出去。每条请求都带一个专属设备 ID,加上系统、CPU 架构、应用版本,等于长期追踪这台电脑。
翻代码可以看到,2026 年 2 月刚加这套上报机制时,开关是有效的。到 3 月 22 日,维护者 kangfenmao 自己改了一版,把开关检查删掉,顺带把更多设备信息塞进请求头。这版改动在 v1.8.3、v1.8.4、v1.9.0、v1.9.1 四个版本里跑了一个月。
kangfenmao 在 issue 下承认问题属实,解释是不同事件用了不同的开关判断逻辑,关掉设置后应用启动和更新检查的请求没被挡住;聊天内容、用户输入、文件、API 密钥这些敏感数据不走这条通道。修复 PR #14390 已合并,三种事件统一走同一个开关。
事情还有更早的一层。社区翻旧代码发现,2025 年 2 月这个项目第一次加分析功能时,同时塞进一段升级脚本:只要是从老版本升上来的用户,这个「匿名统计」开关都会被自动打开一次。此后分析服务后端从 Google Analytics 换到 PostHog、Sentry,再换到现在自建的 analytics.cherry-ai.com,这段自动打开开关的代码一直没删。也就是说,在 2025 年 2 月之前装过 Cherry Studio、之后又升级过的用户,不管当初有没有手动关过这个开关,升级时都会被再打开一次,想关还得升级后再手动关一遍。
信源:https://github.com/CherryHQ/cherry-studio/issues/14387
GitHub
[Discussion]: Suspicious telemetry connection to cherry-ai.com persists after disabling auto-updates/anonymous analytics · Issue…
NoteThis issue was translated by Claude. Issue Checklist I understand that issues are meant for feedback and problem-solving, not for venting, and I will provide as much detail as possible to help ...
通义上线Fun-ASR1.5,主打方言识别
通义实验室 4 月 20 日发布语音识别模型 Fun-ASR1.5,并已在阿里云百炼上线 API、在魔搭社区开放在线体验。官方称,这一版用单模型覆盖 30 种语言、汉语七大方言体系和 20 多种地区口音,不再按方言单独切模型。
通义给出的内部评测显示,典型方言场景的字错误率较上一版相对下降 56.2%,已有 5 种方言准确率超过 90%,15 种超过 80%。古诗词识别也被单列出来做了专项优化,官方给出的内部字符级准确率是 97%。
中文语音识别里最难处理的方言长尾,开始被收进同一套可直接商用的能力。对教育直播、地方政务热线、采访整理这类场景来说,接入方不用再按地区口音拆多套识别链路,部署会简单一些。
信源:https://mp.weixin.qq.com/s/6t8lGS_OFQED7E0FNf-WTg
通义实验室 4 月 20 日发布语音识别模型 Fun-ASR1.5,并已在阿里云百炼上线 API、在魔搭社区开放在线体验。官方称,这一版用单模型覆盖 30 种语言、汉语七大方言体系和 20 多种地区口音,不再按方言单独切模型。
通义给出的内部评测显示,典型方言场景的字错误率较上一版相对下降 56.2%,已有 5 种方言准确率超过 90%,15 种超过 80%。古诗词识别也被单列出来做了专项优化,官方给出的内部字符级准确率是 97%。
中文语音识别里最难处理的方言长尾,开始被收进同一套可直接商用的能力。对教育直播、地方政务热线、采访整理这类场景来说,接入方不用再按地区口音拆多套识别链路,部署会简单一些。
信源:https://mp.weixin.qq.com/s/6t8lGS_OFQED7E0FNf-WTg
美国司法部拒绝协助法国调查X
美国司法部上周五致函法国司法部国际合作办公室,拒绝协助法国检方调查 X。它也不愿代为推进对马斯克和多名 X 员工的问询安排。法国方面今年已三次向美国提出司法协作请求,其中包括送达传票。《华尔街日报》看到的信件写道,法国正试图用刑事程序规制一个美国言论平台。美方认为,这与美国宪法第一修正案相冲突。
法国对 X 的调查本身不是新事。巴黎检方 2025 年 1 月立案,今年 2 月搜查了 X 巴黎办公室。马斯克、前 CEO Linda Yaccarino 和其他员工,原定在 4 月 20 日当周接受「自愿问询」。案件最初聚焦 X 推荐算法是否存在政治偏向。之后又扩到儿童色情图像、非自愿色情深度伪造和否认大屠杀等指控。
美国政府现在明确不愿帮法国把这案子往前推。这会直接影响传票送达和跨境取证。法国检方回应称,并不知道这封信,但强调法国司法独立,问询对象到场与否都不会妨碍调查继续。
信源:https://www.wsj.com/business/justice-department-rebuffs-french-on-x-probe-musk-interview-2b8eb080
美国司法部上周五致函法国司法部国际合作办公室,拒绝协助法国检方调查 X。它也不愿代为推进对马斯克和多名 X 员工的问询安排。法国方面今年已三次向美国提出司法协作请求,其中包括送达传票。《华尔街日报》看到的信件写道,法国正试图用刑事程序规制一个美国言论平台。美方认为,这与美国宪法第一修正案相冲突。
法国对 X 的调查本身不是新事。巴黎检方 2025 年 1 月立案,今年 2 月搜查了 X 巴黎办公室。马斯克、前 CEO Linda Yaccarino 和其他员工,原定在 4 月 20 日当周接受「自愿问询」。案件最初聚焦 X 推荐算法是否存在政治偏向。之后又扩到儿童色情图像、非自愿色情深度伪造和否认大屠杀等指控。
美国政府现在明确不愿帮法国把这案子往前推。这会直接影响传票送达和跨境取证。法国检方回应称,并不知道这封信,但强调法国司法独立,问询对象到场与否都不会妨碍调查继续。
信源:https://www.wsj.com/business/justice-department-rebuffs-french-on-x-probe-musk-interview-2b8eb080
The Wall Street Journal
Exclusive | Justice Department Rebuffs French on X Probe, Musk Interview
The U.S. told French authorities it wouldn’t facilitate their efforts to investigate Elon Musk’s X, after a raid on the social-media platform’s Paris office earlier this year.
字节跳动2025年净利润传降超70%,AI投入开始吃掉利润
知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。
转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。
信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。
转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。
信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
中国至少10家AI芯片公司已在同步出货,英伟达在华份额今年或从40%跌至8%
《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。
Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。
路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。
两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。
阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。
供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。
信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms
《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。
Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。
路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。
两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。
阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。
供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。
信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms
Google Cloud Next前夕,市场预期TPUv8亮相
Google Cloud Next 2026 将于 4 月 22 日至 24 日在拉斯维加斯举行。市场预期 Google 会在大会前后展示 v8 架构 TPU。Google 目前还没正式确认这代芯片的名称、型号和发布时间。Google 准备让联发科参与下一代 TPU,同时维持和博通的合作。
信源:https://money.udn.com/money/story/5612/9451634
Google Cloud Next 2026 将于 4 月 22 日至 24 日在拉斯维加斯举行。市场预期 Google 会在大会前后展示 v8 架构 TPU。Google 目前还没正式确认这代芯片的名称、型号和发布时间。Google 准备让联发科参与下一代 TPU,同时维持和博通的合作。
信源:https://money.udn.com/money/story/5612/9451634
經濟日報
Google 新 TPU 來了 光聖、奇鋐、台達電跟著紅 | 產業熱點 | 產業 | 經濟日報
Google最新v8架構張量處理器(TPU)有望在本周亮相,不僅帶旺半導體、組裝協力廠後市,也將掀起一系列周邊元件升級商機,包括OCS全光交換器、液冷、電源、光通訊等業者跟著吃補。
阿里开放下一代旗舰 Qwen3.6-Max-Preview 预览,主打智能体编程
阿里千问团队发布 Qwen3.6-Max-Preview,定位是下一代旗舰模型的早期预览版,接替现有的 Qwen3.6-Plus。用户可在 Qwen Studio(chat.qwen.ai)直接对话体验,随后通过阿里云百炼以
这一版主要面向智能体编程(agentic coding),让模型像程序员一样自己写代码、运行、看报错、调用工具,完成多步骤编程任务。官方相对前代 Qwen3.6-Plus 给出的提升集中在编程:SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0、Terminal-Bench 2.0 +3.8 分;世界知识与工具调用格式遵循另三项各有 2.3 到 5.3 分的提升。官方自称在 SWE-bench Pro、Terminal-Bench 2.0、SciCode 等六项编程基准上取得最高分,其中 QwenClawBench、QwenWebBench 从命名看是千问自建评测集,需与公开基准分开看。
API 这一侧还新增了
信源:https://mp.weixin.qq.com/s/DKxrFnBwisNjjOnFQRqsqA
阿里千问团队发布 Qwen3.6-Max-Preview,定位是下一代旗舰模型的早期预览版,接替现有的 Qwen3.6-Plus。用户可在 Qwen Studio(chat.qwen.ai)直接对话体验,随后通过阿里云百炼以
qwen3.6-max-preview 的模型名开放 API 调用;接口兼容 OpenAI 的 chat completions、responses 规范以及 Anthropic 的协议。这一版主要面向智能体编程(agentic coding),让模型像程序员一样自己写代码、运行、看报错、调用工具,完成多步骤编程任务。官方相对前代 Qwen3.6-Plus 给出的提升集中在编程:SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0、Terminal-Bench 2.0 +3.8 分;世界知识与工具调用格式遵循另三项各有 2.3 到 5.3 分的提升。官方自称在 SWE-bench Pro、Terminal-Bench 2.0、SciCode 等六项编程基准上取得最高分,其中 QwenClawBench、QwenWebBench 从命名看是千问自建评测集,需与公开基准分开看。
API 这一侧还新增了
preserve_thinking 选项:打开后消息会保留前几轮的 thinking 内容。推理模型默认每轮只把「本轮思考」返回一次,多轮智能体对话里上下文缺了前面几步的思考,模型重新规划时容易走回头路或忘记自己已经试过什么,这个开关补的就是这个断档。信源:https://mp.weixin.qq.com/s/DKxrFnBwisNjjOnFQRqsqA
Anthropic 开源 claude-desktop-buddy,让 Claude 桌面端充当硬件外设的蓝牙网关
Anthropic 近日在 GitHub 开源 claude-desktop-buddy 仓库,公开了 Claude 桌面应用面向创客社区的蓝牙 API,并附带一个 ESP32 桌宠参考实现。
具体做法是,Claude 的 macOS 和 Windows 客户端在开发者模式下(Help → Troubleshooting → Enable Developer Mode)开放一个 BLE 接口,通过 Nordic UART Service(低功耗蓝牙里一个常用的自定义串口服务)把会话状态、权限请求和最近消息推送给配对的硬件,硬件也能把「通过 / 拒绝」按钮回传给桌面。对想做 AI 外设的开发者,这条通路省掉了自己对接 Claude API 的环节:只要用户桌面客户端开着,硬件就能拿到会话的实时状态,并在本地按键完成审批。
仓库提供的示例用 M5StickC Plus 做了一个桌宠:桌面没活跃会话时它睡觉,会话启动后醒来,有权限请求挂起时会变得焦急,用户按 A 通过、B 拒绝。这款微型开发板的生产商 M5Stack(中文名明栈)2024 年已被 ESP32 芯片母公司乐鑫科技(Espressif)收购,现为乐鑫子公司;板上主控正是乐鑫自家的 ESP32-PICO-D4 双核 240 MHz 芯片,工程配置文件
Anthropic 在仓库说明里强调,这个 BLE API 只在开发者模式下生效,不是官方支持的产品功能,定位是给创客社区一个需要用户手动开启的轻量接口。
信源:https://github.com/anthropics/claude-desktop-buddy
Anthropic 近日在 GitHub 开源 claude-desktop-buddy 仓库,公开了 Claude 桌面应用面向创客社区的蓝牙 API,并附带一个 ESP32 桌宠参考实现。
具体做法是,Claude 的 macOS 和 Windows 客户端在开发者模式下(Help → Troubleshooting → Enable Developer Mode)开放一个 BLE 接口,通过 Nordic UART Service(低功耗蓝牙里一个常用的自定义串口服务)把会话状态、权限请求和最近消息推送给配对的硬件,硬件也能把「通过 / 拒绝」按钮回传给桌面。对想做 AI 外设的开发者,这条通路省掉了自己对接 Claude API 的环节:只要用户桌面客户端开着,硬件就能拿到会话的实时状态,并在本地按键完成审批。
仓库提供的示例用 M5StickC Plus 做了一个桌宠:桌面没活跃会话时它睡觉,会话启动后醒来,有权限请求挂起时会变得焦急,用户按 A 通过、B 拒绝。这款微型开发板的生产商 M5Stack(中文名明栈)2024 年已被 ESP32 芯片母公司乐鑫科技(Espressif)收购,现为乐鑫子公司;板上主控正是乐鑫自家的 ESP32-PICO-D4 双核 240 MHz 芯片,工程配置文件
platformio.ini 里 board 字段明确写成 `m5stick-c`。固件预置 18 种 ASCII 角色,每种配七套动画,覆盖睡觉、空闲、工作、待审批、升级、被摇晃和快速通过这七种状态;每累计 50K tokens 触发一次升级庆祝,五秒内通过审批则冒出爱心。若想换成 GIF 角色,桌面应用支持把一个包含 manifest.json 和若干 96 像素宽 GIF 的文件夹直接推到设备,整包不得超过 1.8 MB。Anthropic 在仓库说明里强调,这个 BLE API 只在开发者模式下生效,不是官方支持的产品功能,定位是给创客社区一个需要用户手动开启的轻量接口。
信源:https://github.com/anthropics/claude-desktop-buddy
「神经计算机」论文9天内换v2,删掉「模型本身就是计算机」的断言
4 月 7 日,Meta AI 与 LSTM 共同发明人 Jürgen Schmidhuber 团队联合发布论文《Neural Computers》,提出「神经计算机」(Neural Computer,NC)这一设想:让一个模型同时承担计算、存储和输入输出,不再像智能体那样调用外部程序,也不再像世界模型那样只学环境动态。论文把终极形态称为 Completely Neural Computer(CNC),并用视频模型做了两个原型,分别在 CLI 和 GUI 环境里从指令、屏幕像素和用户操作预测下一帧画面。
4 月 16 日,作者把论文换成 v2,没有新增实验,但摘要里的关键措辞被系统性调软。v1 中那句定义「NCs aim to make the model itself the running computer」整句删掉。两个修饰词改了,「early NC primitives」换成「elementary NC primitives」,「remain open」换成「remain challenging」。v1 摘要开头原本通过和传统计算机、智能体、世界模型正面对比来立论,v2 去掉了这段对比,把「新的计算范式」从定义句挪到结尾,当作远期路线图提出。
换句话说,论文的核心实验没变,但作者把自我定位从「NC 的目标就是让模型成为计算机」调到了「NC 还只是起点,很多事仍有挑战」。
信源:https://arxiv.org/abs/2604.06425v2
4 月 7 日,Meta AI 与 LSTM 共同发明人 Jürgen Schmidhuber 团队联合发布论文《Neural Computers》,提出「神经计算机」(Neural Computer,NC)这一设想:让一个模型同时承担计算、存储和输入输出,不再像智能体那样调用外部程序,也不再像世界模型那样只学环境动态。论文把终极形态称为 Completely Neural Computer(CNC),并用视频模型做了两个原型,分别在 CLI 和 GUI 环境里从指令、屏幕像素和用户操作预测下一帧画面。
4 月 16 日,作者把论文换成 v2,没有新增实验,但摘要里的关键措辞被系统性调软。v1 中那句定义「NCs aim to make the model itself the running computer」整句删掉。两个修饰词改了,「early NC primitives」换成「elementary NC primitives」,「remain open」换成「remain challenging」。v1 摘要开头原本通过和传统计算机、智能体、世界模型正面对比来立论,v2 去掉了这段对比,把「新的计算范式」从定义句挪到结尾,当作远期路线图提出。
换句话说,论文的核心实验没变,但作者把自我定位从「NC 的目标就是让模型成为计算机」调到了「NC 还只是起点,很多事仍有挑战」。
信源:https://arxiv.org/abs/2604.06425v2
arXiv.org
Neural Computers
We propose a new frontier: Neural Computers (NCs) that unify computation, memory, and I/O of traditional computers in a learned runtime state. Our long-term goal is the Completely Neural Computer...
英伟达芯片架构师Max Lv开源mcp-cli,尝试减少Codex进程开销
英伟达芯片架构师 Max Lv 公开
作者用 Codex CLI 0.120.0 跑了一次基准,目标仓库是
这组数据先说明了一件事:代码智能体的开销,确实有一部分不在模型,而在反复起本地命令和回传长文本上。不过它还没证明自己能让 Codex 整体更快。同一份基准里,总耗时反而增加了 45%,因为原来一条 Bash 流水线能做完的事,换成 MCP 后往往被拆成多次调用。换句话说,`mcp-cli` 先证明了「少起进程」这条路值得做,但离真正好用还差一步,后面还得补批量读文件、组合搜索这类更贴近智能体工作流的工具。
信源:https://github.com/madeye/mcp-cli
英伟达芯片架构师 Max Lv 公开
mcp-cli 原型。它盯的是 Codex、Claude Code 这类代码智能体在本地干活时,老要反复起 cat`、`rg`、`git status 这类小命令。`mcp-cli` 的做法是让一个常驻进程把读文件、搜代码、查 Git 状态这些活接过去,少一点「现用现起」的折腾。作者用 Codex CLI 0.120.0 跑了一次基准,目标仓库是
openai/codex 的 rust-v0.121.0 标签。结果是 execve 总数从 103 次降到 22 次,少了 79%;输入 token 从 215.96 万降到 175.56 万,少了 19%。作者还加了 --prefer-mcp 参数,让 Codex 优先走 MCP 工具,不再默认先走 Bash。这组数据先说明了一件事:代码智能体的开销,确实有一部分不在模型,而在反复起本地命令和回传长文本上。不过它还没证明自己能让 Codex 整体更快。同一份基准里,总耗时反而增加了 45%,因为原来一条 Bash 流水线能做完的事,换成 MCP 后往往被拆成多次调用。换句话说,`mcp-cli` 先证明了「少起进程」这条路值得做,但离真正好用还差一步,后面还得补批量读文件、组合搜索这类更贴近智能体工作流的工具。
信源:https://github.com/madeye/mcp-cli
GitHub
GitHub - madeye/mcp-cli: a prototype to save fork/exec overhead of ai code agent
a prototype to save fork/exec overhead of ai code agent - madeye/mcp-cli
字节高管回应「净利润降超70%」:经营面没这么差
抖音集团副总裁李亮在微博转发相关报道时回应,今日流传的「字节跳动 2025 年净利润下降 70%」是按国际会计准则计算的结果,除新兴业务投资加大外,还包含优先股和期权成本变动,这些因素「不反映运营实质」。他给出的口径是:受抖音电商增速放缓和新业务投入影响,字节下半年经营利润率只是小幅下滑,远没有媒体报道的那么大;若不考虑优先股和期权成本变动,总体营收和利润仍在增长,TikTok 电商和新兴业务趋势也不错。
信源:https://weibo.com/7965906915/5289821159294724
抖音集团副总裁李亮在微博转发相关报道时回应,今日流传的「字节跳动 2025 年净利润下降 70%」是按国际会计准则计算的结果,除新兴业务投资加大外,还包含优先股和期权成本变动,这些因素「不反映运营实质」。他给出的口径是:受抖音电商增速放缓和新业务投入影响,字节下半年经营利润率只是小幅下滑,远没有媒体报道的那么大;若不考虑优先股和期权成本变动,总体营收和利润仍在增长,TikTok 电商和新兴业务趋势也不错。
信源:https://weibo.com/7965906915/5289821159294724
美国纽约州议会众议员Alex Bores提AI分红,拟在AI挤掉岗位时发钱
纽约州议会众议员、纽约第 12 选区民主党国会候选人 Alex Bores 推出一项「AI 分红」方案。这套机制会在 AI 明显替代美国岗位时启动,一部分钱直接发给美国人,另一部分投向职业培训、教育和政府独立监管能力建设。
筹资思路有三块:对 AI 使用征收一项低税率的「token 税」、通过持有前沿 AI 公司的股权分享收益,以及修改税制,减少企业在「用 AI 少雇人」场景继续加码投入的激励。Bores 自己公开的竞选平台里,已经把「向大型 AI 公司征税,给美国人发 AI 分红」列成主张。
和泛泛谈全民基本收入不同,这份方案把触发条件写成了「AI 明显替代岗位」,也把资金来源直接对准 AI 使用和 AI 公司收益。Bores 此前在纽约州推动通过 RAISE Act,主打 AI 安全;这次则把焦点往分配问题挪了一步。美国围绕 AI 的政治争论,开始从「要不要管」往「效率红利归谁」延伸。
信源:https://www.axios.com/2026/04/20/alex-bores-ai-dividend-plan-wealth
纽约州议会众议员、纽约第 12 选区民主党国会候选人 Alex Bores 推出一项「AI 分红」方案。这套机制会在 AI 明显替代美国岗位时启动,一部分钱直接发给美国人,另一部分投向职业培训、教育和政府独立监管能力建设。
筹资思路有三块:对 AI 使用征收一项低税率的「token 税」、通过持有前沿 AI 公司的股权分享收益,以及修改税制,减少企业在「用 AI 少雇人」场景继续加码投入的激励。Bores 自己公开的竞选平台里,已经把「向大型 AI 公司征税,给美国人发 AI 分红」列成主张。
和泛泛谈全民基本收入不同,这份方案把触发条件写成了「AI 明显替代岗位」,也把资金来源直接对准 AI 使用和 AI 公司收益。Bores 此前在纽约州推动通过 RAISE Act,主打 AI 安全;这次则把焦点往分配问题挪了一步。美国围绕 AI 的政治争论,开始从「要不要管」往「效率红利归谁」延伸。
信源:https://www.axios.com/2026/04/20/alex-bores-ai-dividend-plan-wealth
Axios
Exclusive: Alex Bores rolls out "AI dividend" plan to share AI wealth
Bores is a Democratic House candidate in New York and a top target of AI super PACs.
阿里HappyHorse-1.0定于4月27日开测
阿里视频生成模型 HappyHorse-1.0 将于 4 月 27 日通过阿里云百炼逐步开放 API 测试,首批邀测对象是企业级客户,5 月份正式商用。
HappyHorse 项目由阿里 ATH 创新事业部主导,阿里平台技术、通义实验室和淘天技术等团队共同参与。
信源:https://www.yicai.com/news/103141257.html
阿里视频生成模型 HappyHorse-1.0 将于 4 月 27 日通过阿里云百炼逐步开放 API 测试,首批邀测对象是企业级客户,5 月份正式商用。
HappyHorse 项目由阿里 ATH 创新事业部主导,阿里平台技术、通义实验室和淘天技术等团队共同参与。
信源:https://www.yicai.com/news/103141257.html
Yicai
阿里HappyHorse将于4月27日开放测试
阿里ATH今日宣布,HappyHorse-1.0将于4月27日通过阿里云百炼平台逐步开放API测试,首批邀测对象为企业级客户。 阿里ATH方面透露,阿里巴巴在AI视频生成领域已深耕多年,HappyHorse项目由ATH创新事业部主导,联合阿里平台技术、通义实验室及淘天技术等多个团队协同打造。4月底开放测试后,HappyHorse-1.0将于5月份正式发布商用。(第一财经记者 陈杨园)
OpenAI 科研工作空间 Prism 下线,上线不到 3 个月
OpenAI 已下线科研工作空间 Prism。4 月 20 日有用户在 X 上反馈无法再打开该产品。其中一位用 Prism 合作写论文的用户表示,关停前没有收到导出文件的提醒,目前只能把最后一次生成的 PDF 用 Codex 转回 LaTeX 源码。
Prism 是 OpenAI 今年 1 月 27 日发布的免费科研工作空间,基于 GPT-5.2,与 LaTeX 深度集成,支持多人协作写论文,脱胎于 OpenAI 去年收购的云 LaTeX 平台 Crixet。
Prism 的消失是 OpenAI 近期收缩非核心业务的一部分。4 月 17 日 OpenAI for Science 部门被拆分并入其他研究团队,负责人 Kevin Weil 离职;3 月 24 日,Sora 作为独立产品关停。更早在 3 月 16 日,OpenAI 应用业务 CEO Fidji Simo 在全员会上称公司「不能因 side quests 分心」,要把重心放到面向企业和编码工具上,并把 Anthropic 的 Claude Code 称作「警钟」。
OpenAI 已下线科研工作空间 Prism。4 月 20 日有用户在 X 上反馈无法再打开该产品。其中一位用 Prism 合作写论文的用户表示,关停前没有收到导出文件的提醒,目前只能把最后一次生成的 PDF 用 Codex 转回 LaTeX 源码。
Prism 是 OpenAI 今年 1 月 27 日发布的免费科研工作空间,基于 GPT-5.2,与 LaTeX 深度集成,支持多人协作写论文,脱胎于 OpenAI 去年收购的云 LaTeX 平台 Crixet。
Prism 的消失是 OpenAI 近期收缩非核心业务的一部分。4 月 17 日 OpenAI for Science 部门被拆分并入其他研究团队,负责人 Kevin Weil 离职;3 月 24 日,Sora 作为独立产品关停。更早在 3 月 16 日,OpenAI 应用业务 CEO Fidji Simo 在全员会上称公司「不能因 side quests 分心」,要把重心放到面向企业和编码工具上,并把 Anthropic 的 Claude Code 称作「警钟」。
月之暗面开源Kimi K2.6,多项编程基准反超闭源旗舰
月之暗面开源新一代旗舰 Kimi K2.6,同步在 Kimi.com 网页、Kimi App、开放平台 API 和自研编程工具 Kimi Code 上线。K2.6 此前一个月只在 Kimi Code 内部以 code-preview 名义给 Beta 用户试用,今天首次把完整模型对外开源并开放 API。
官方基准表里,K2.6 在多项编程与代理任务上反超当前最强闭源旗舰:SWE-Bench Pro 58.6(GPT-5.4 xhigh 57.7、Claude Opus 4.6 max effort 53.4、Gemini 3.1 Pro 54.2);HLE 全集带工具 54.0,三家闭源都低于这个数;DeepSearchQA f1 92.5,同项 GPT-5.4 只有 78.6。Terminal-Bench 2.0 拿 66.7,只输给 Gemini 3.1 Pro 的 68.5;SWE-Bench Verified 80.2,与 Opus 4.6 的 80.8、Gemini 3.1 Pro 的 80.6 基本同档。开源阵营过去在这种级别的编程基准上几乎没有能和闭源前沿旗舰对位的选项。
官方博客还给了两组长程执行的实测数字。一是让 K2.6 在 Mac 本地用 Zig(一种小众系统级编程语言)重写 Qwen3.5-0.8B 推理,4000 余次工具调用、12 小时连续运行、14 轮迭代后,吞吐从大约 15 tokens/sec 提升到 193 tokens/sec,比 LM Studio 快约 20%。二是接管一个 8 年历史的开源撮合引擎 exchange-core,跑完 13 小时、过千次工具调用、修改 4000 多行代码,并重配核心线程拓扑(4ME+2RE 改为 2ME+1RE),吞吐提高 185%。这两个数字都是官方自测,暂无独立复现。
K2.6 同步升级的 Agent Swarm 可同时运行 300 个子代理、最多 4000 步,前代 K2.5 的上限是 100 个、1500 步。月之暗面自家 RL 基础设施团队已经用 K2.6 跑了一个 5 天自主值班的运维代理,官方放出了这份工作日志的节选。
信源:https://www.kimi.com/blog/kimi-k2-6
月之暗面开源新一代旗舰 Kimi K2.6,同步在 Kimi.com 网页、Kimi App、开放平台 API 和自研编程工具 Kimi Code 上线。K2.6 此前一个月只在 Kimi Code 内部以 code-preview 名义给 Beta 用户试用,今天首次把完整模型对外开源并开放 API。
官方基准表里,K2.6 在多项编程与代理任务上反超当前最强闭源旗舰:SWE-Bench Pro 58.6(GPT-5.4 xhigh 57.7、Claude Opus 4.6 max effort 53.4、Gemini 3.1 Pro 54.2);HLE 全集带工具 54.0,三家闭源都低于这个数;DeepSearchQA f1 92.5,同项 GPT-5.4 只有 78.6。Terminal-Bench 2.0 拿 66.7,只输给 Gemini 3.1 Pro 的 68.5;SWE-Bench Verified 80.2,与 Opus 4.6 的 80.8、Gemini 3.1 Pro 的 80.6 基本同档。开源阵营过去在这种级别的编程基准上几乎没有能和闭源前沿旗舰对位的选项。
官方博客还给了两组长程执行的实测数字。一是让 K2.6 在 Mac 本地用 Zig(一种小众系统级编程语言)重写 Qwen3.5-0.8B 推理,4000 余次工具调用、12 小时连续运行、14 轮迭代后,吞吐从大约 15 tokens/sec 提升到 193 tokens/sec,比 LM Studio 快约 20%。二是接管一个 8 年历史的开源撮合引擎 exchange-core,跑完 13 小时、过千次工具调用、修改 4000 多行代码,并重配核心线程拓扑(4ME+2RE 改为 2ME+1RE),吞吐提高 185%。这两个数字都是官方自测,暂无独立复现。
K2.6 同步升级的 Agent Swarm 可同时运行 300 个子代理、最多 4000 步,前代 K2.5 的上限是 100 个、1500 步。月之暗面自家 RL 基础设施团队已经用 K2.6 跑了一个 5 天自主值班的运维代理,官方放出了这份工作日志的节选。
信源:https://www.kimi.com/blog/kimi-k2-6
Kimi
Kimi K2.6 Tech Blog: Advancing Open-Source Coding
Kimi K2.6 advances open-source coding, featuring long-horizon coding, coding-driven design, agent swarms, proactive agents, and the Claw Groups research preview.
Anthropic与AWS签十年合约,1000亿美元换5GW算力
Anthropic 与 Amazon 宣布扩展合作,未来十年向 AWS 技术投入超过 1000 亿美元,锁定最多 5 吉瓦(GW)新增算力用于训练和运行 Claude。这份承诺覆盖 Graviton CPU 和 Trainium2 到 Trainium4 系列 AI 芯片,合约里还保留了后续几代 Amazon 自研芯片的采购选项。Amazon 同步再注资 50 亿美元给 Anthropic,未来最多再追加 200 亿美元;加上此前已投入的 80 亿美元,两家目前累计投资 130 亿美元、最高可达 330 亿美元。
算力节奏上,Anthropic 披露了两个关键时间点。第一批 Trainium2 产能将在 2026 年上半年上线,到 2026 年底 Trainium2 加 Trainium3 合计接近 1 GW 产能就位,剩余容量后续陆续交付。公司自述目前已在用超过 100 万颗 Trainium2 训练和服务 Claude,承载主力是与 Amazon 合建的 Project Rainier 集群。Anthropic 也透露现在已有超过 10 万家客户在 Amazon Bedrock 上调用 Claude。
协议同步把 Claude Platform 直接搬进 AWS:同一个 AWS 账号、同一套权限控制和账单,不需要再单独签 Anthropic 的合同或申请独立凭证。Claude 也因此仍是唯一同时上架三大云(AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure Foundry)的前沿模型。
同时披露的还有收入数据:Anthropic 的年化收入(run-rate revenue,按最近一段时间收入外推到全年的口径)已超过 300 亿美元,2025 年底这个数字还约为 90 亿美元。Dario Amodei 在官宣里直接承认,消费级产品增长让免费版、Pro、Max 和 Team 用户在高峰时段出现可靠性和性能下滑,新增算力首先要消化这部分需求。这也是 Anthropic 近期第二次官宣算力扩容,此前刚与 Google 和 Broadcom 签了另一笔算力合作协议。
信源:https://www.anthropic.com/news/anthropic-amazon-compute
Anthropic 与 Amazon 宣布扩展合作,未来十年向 AWS 技术投入超过 1000 亿美元,锁定最多 5 吉瓦(GW)新增算力用于训练和运行 Claude。这份承诺覆盖 Graviton CPU 和 Trainium2 到 Trainium4 系列 AI 芯片,合约里还保留了后续几代 Amazon 自研芯片的采购选项。Amazon 同步再注资 50 亿美元给 Anthropic,未来最多再追加 200 亿美元;加上此前已投入的 80 亿美元,两家目前累计投资 130 亿美元、最高可达 330 亿美元。
算力节奏上,Anthropic 披露了两个关键时间点。第一批 Trainium2 产能将在 2026 年上半年上线,到 2026 年底 Trainium2 加 Trainium3 合计接近 1 GW 产能就位,剩余容量后续陆续交付。公司自述目前已在用超过 100 万颗 Trainium2 训练和服务 Claude,承载主力是与 Amazon 合建的 Project Rainier 集群。Anthropic 也透露现在已有超过 10 万家客户在 Amazon Bedrock 上调用 Claude。
协议同步把 Claude Platform 直接搬进 AWS:同一个 AWS 账号、同一套权限控制和账单,不需要再单独签 Anthropic 的合同或申请独立凭证。Claude 也因此仍是唯一同时上架三大云(AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure Foundry)的前沿模型。
同时披露的还有收入数据:Anthropic 的年化收入(run-rate revenue,按最近一段时间收入外推到全年的口径)已超过 300 亿美元,2025 年底这个数字还约为 90 亿美元。Dario Amodei 在官宣里直接承认,消费级产品增长让免费版、Pro、Max 和 Team 用户在高峰时段出现可靠性和性能下滑,新增算力首先要消化这部分需求。这也是 Anthropic 近期第二次官宣算力扩容,此前刚与 Google 和 Broadcom 签了另一笔算力合作协议。
信源:https://www.anthropic.com/news/anthropic-amazon-compute
Anthropic
Anthropic and Amazon expand collaboration for up to 5 gigawatts of new compute
Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.