xAI 开放 Grok STT 与 TTS 音频 API,STT 整体词错率压到 6.9%
xAI 上线两个独立音频 API:Grok Speech to Text 和 Grok Text to Speech。两者来自支撑 Grok Voice、特斯拉车载系统和 Starlink 客服的同一套音频栈,此次以独立 endpoint 形式开放,开发者可直接接入语音代理、实时转录、无障碍工具和播客等应用。
STT 提供两种模式。REST API 用于对大音频文件批量转录,毫秒级返回;WebSocket API 面向实时语音流。附带能力包括词级时间戳、说话人分离(diarization)、多通道分别识别,以及 Inverse Text Normalization,即把口语里的数字、日期、货币自动整形为规范的结构化文本。语种覆盖 25 种以上,可在对话中无缝切换。
xAI 同时公布一组词错率(WER,数值越低越好)对比:整体场景 Grok 6.9%,ElevenLabs 9.0%,Deepgram 11.0%,AssemblyAI 12.9%;「电话通话实体识别」差距被拉得更大,Grok 5.0%,对应三家分别为 12.0%、13.5%、21.3%。会议、视频播客、电话三类常见业务场景下 Grok 也都小幅领先。这组数字由 xAI 自行测试公布,尚无第三方复测。
定价上,STT 批处理 0.10 美元/小时、流式 0.20 美元/小时;TTS 为 4.20 美元/100 万字符。
TTS 支持用内联 Speech Tags 控制情感和韵律,例如 `[laugh]`、`[sigh]`、`[whisper]`、`<emphasis>`、`<slow>`、`<pause>`。开发者不必手写 SSML 标记,就能让朗读带上笑声、叹气、低语或局部强调。
信源:https://x.ai/news/grok-stt-and-tts-apis
xAI 上线两个独立音频 API:Grok Speech to Text 和 Grok Text to Speech。两者来自支撑 Grok Voice、特斯拉车载系统和 Starlink 客服的同一套音频栈,此次以独立 endpoint 形式开放,开发者可直接接入语音代理、实时转录、无障碍工具和播客等应用。
STT 提供两种模式。REST API 用于对大音频文件批量转录,毫秒级返回;WebSocket API 面向实时语音流。附带能力包括词级时间戳、说话人分离(diarization)、多通道分别识别,以及 Inverse Text Normalization,即把口语里的数字、日期、货币自动整形为规范的结构化文本。语种覆盖 25 种以上,可在对话中无缝切换。
xAI 同时公布一组词错率(WER,数值越低越好)对比:整体场景 Grok 6.9%,ElevenLabs 9.0%,Deepgram 11.0%,AssemblyAI 12.9%;「电话通话实体识别」差距被拉得更大,Grok 5.0%,对应三家分别为 12.0%、13.5%、21.3%。会议、视频播客、电话三类常见业务场景下 Grok 也都小幅领先。这组数字由 xAI 自行测试公布,尚无第三方复测。
定价上,STT 批处理 0.10 美元/小时、流式 0.20 美元/小时;TTS 为 4.20 美元/100 万字符。
TTS 支持用内联 Speech Tags 控制情感和韵律,例如 `[laugh]`、`[sigh]`、`[whisper]`、`<emphasis>`、`<slow>`、`<pause>`。开发者不必手写 SSML 标记,就能让朗读带上笑声、叹气、低语或局部强调。
信源:https://x.ai/news/grok-stt-and-tts-apis
x.ai
Grok Speech to Text and Text to Speech APIs
Fast and accurate. Natural, expressive voices. Simple pricing. Multilingual support.
马斯克:Grok 4.3 beta 仍是 0.5T 训练中间版,1T 旗舰还差 5 天完成初训
Grok 4.3 (beta) 已对订阅最高档 SuperGrok Heavy 的用户开放。17 日,用户已在 Grok.com 下拉菜单里看到该版本带有「Early Access」标记。18 日早晨,X 用户 Mark Kretschmann 发帖称这一版本拥有 1T 参数、体量是 Grok 4.20 的两倍,训练时间也显著更长。xAI 及特斯拉 CEO 马斯克(Elon Musk)随后在同条推文下更正,当前的 4.3 (beta) 仍是 0.5T 模型,只是一份更新的训练检查点,并非外界推测的 1T 新模型。
马斯克同时透露,真正的 1T 旗舰距离初始训练完成还剩约 5 天。他形容 1T 模型将在编码、长上下文和各项技能上形成阶跃式提升,并称 SpaceXAI 模型工厂已经跑通,之后预计每两周能下线一版改进后的基础模型。
信源:https://x.com/elonmusk/status/2045293644693770630
Grok 4.3 (beta) 已对订阅最高档 SuperGrok Heavy 的用户开放。17 日,用户已在 Grok.com 下拉菜单里看到该版本带有「Early Access」标记。18 日早晨,X 用户 Mark Kretschmann 发帖称这一版本拥有 1T 参数、体量是 Grok 4.20 的两倍,训练时间也显著更长。xAI 及特斯拉 CEO 马斯克(Elon Musk)随后在同条推文下更正,当前的 4.3 (beta) 仍是 0.5T 模型,只是一份更新的训练检查点,并非外界推测的 1T 新模型。
马斯克同时透露,真正的 1T 旗舰距离初始训练完成还剩约 5 天。他形容 1T 模型将在编码、长上下文和各项技能上形成阶跃式提升,并称 SpaceXAI 模型工厂已经跑通,之后预计每两周能下线一版改进后的基础模型。
信源:https://x.com/elonmusk/status/2045293644693770630
X (formerly Twitter)
Elon Musk (@elonmusk) on X
@mark_k @xai This is still 0.5T, but a more recent training checkpoint.
1T model is ~5 days away from finishing initial training. Will be a major step change improvement in coding, long context and skills.
The SpaceXAI model factory is finally working.…
1T model is ~5 days away from finishing initial training. Will be a major step change improvement in coding, long context and skills.
The SpaceXAI model factory is finally working.…
ProducerAI更名Flow Music,上线片段替换与延展
今年 2 月加入 Google Labs 的 AI 音乐创作平台 ProducerAI 宣布产品正式更名为 Google Flow Music,纳入 Google Flow 家族,入口为 flowmusic.google。Google Flow 是 Google 在 2025 年 I/O 上发布的 AI 视频生成套件,原本只涵盖视频方向,此次把 AI 音乐能力补进同一产品线。官方称团队和使命不变。
同步上线两项 remix 能力:replace(替换)和 extend(延展)。用户用自然语言 prompt 圈出歌曲里的某一段,交给名为 Producer 的智能体修改,例如把一段 lofi 钢琴前奏延展成 dubstep drop、一次性替换多段副歌,或者让它对同一段吉他 solo 生成 5 个备选版本。
这次更新把 AI 生成音乐的工作流从「整首重生」推向「局部可控」。过去用 Suno、Udio 这类工具,生成结果不满意时多数情况只能整首重跑再手动拼接,现在可以针对一首歌反复改局部、保留其他部分不动,更贴近传统音乐制作的迭代节奏。
信源:https://x.com/googleflowmusic/status/2045250153356108026
今年 2 月加入 Google Labs 的 AI 音乐创作平台 ProducerAI 宣布产品正式更名为 Google Flow Music,纳入 Google Flow 家族,入口为 flowmusic.google。Google Flow 是 Google 在 2025 年 I/O 上发布的 AI 视频生成套件,原本只涵盖视频方向,此次把 AI 音乐能力补进同一产品线。官方称团队和使命不变。
同步上线两项 remix 能力:replace(替换)和 extend(延展)。用户用自然语言 prompt 圈出歌曲里的某一段,交给名为 Producer 的智能体修改,例如把一段 lofi 钢琴前奏延展成 dubstep drop、一次性替换多段副歌,或者让它对同一段吉他 solo 生成 5 个备选版本。
这次更新把 AI 生成音乐的工作流从「整首重生」推向「局部可控」。过去用 Suno、Udio 这类工具,生成结果不满意时多数情况只能整首重跑再手动拼接,现在可以针对一首歌反复改局部、保留其他部分不动,更贴近传统音乐制作的迭代节奏。
信源:https://x.com/googleflowmusic/status/2045250153356108026
X (formerly Twitter)
Google Flow Music (@googleflowmusic) on X
1/ A new era, a new name, and a new feature drop. 🚀
ProducerAI is officially "Google Flow Music"! We're still the same team, with the same mission: building tools that push the boundaries of human creativity.
To kick off this new chapter, we're launching…
ProducerAI is officially "Google Flow Music"! We're still the same team, with the same mission: building tools that push the boundaries of human creativity.
To kick off this new chapter, we're launching…
月之暗面与清华新论文:LLM 预填充可跨数据中心,1T 模型吞吐升 54%
月之暗面(Moonshot AI)与清华大学 4 月 16 日在 arXiv 挂出新论文《Prefill-as-a-Service》,提出让大模型推理的预填充阶段(prefill)跨数据中心运行。
大模型推理分两步:prefill 先把输入一次性读进来、生成一份 KV 缓存;decode 再根据这份缓存逐字吐出结果。两步需要的硬件特性完全不同,prefill 吃算力,decode 吃显存带宽。业界主流做法是把两步拆到不同机器上(PD 分离),但这要求两边在同一个数据中心里用 RDMA 互联,因为密集 attention 模型的 KV 缓存每秒几十 Gbps 地吐,一旦传慢 GPU 就空转。
转折来自新一代 hybrid attention 模型。论文实测 Kimi Linear、MiMo-V2-Flash、Ring-2.5-1T 等模型通过少量完整 attention 层加大量线性层的组合,把 KV 缓存吞吐量砍掉了约一个数量级,Ring-2.5-1T 的综合压缩比达到 36 倍。这时 KV 缓存可以从 RDMA 专网搬到普通以太网上传。
PrfaaS 的具体做法:组建独立的「预填充集群」,只把长上下文、未命中前缀缓存的请求路由过去,短请求留在本地 PD 集群;预填充完成后通过以太网把 KV 缓存回传本地集群做 decode。配套引入长度阈值路由、带宽感知调度器和混合前缀缓存池。论文用内部 1T 参数 hybrid 模型(基于 Kimi Linear 架构)做了一组实测,整体服务吞吐比同构 PD 部署高 54%,比朴素异构方案高 32%,每台机器只占适中的跨数据中心带宽。
信源:https://arxiv.org/html/2604.15039v1
月之暗面(Moonshot AI)与清华大学 4 月 16 日在 arXiv 挂出新论文《Prefill-as-a-Service》,提出让大模型推理的预填充阶段(prefill)跨数据中心运行。
大模型推理分两步:prefill 先把输入一次性读进来、生成一份 KV 缓存;decode 再根据这份缓存逐字吐出结果。两步需要的硬件特性完全不同,prefill 吃算力,decode 吃显存带宽。业界主流做法是把两步拆到不同机器上(PD 分离),但这要求两边在同一个数据中心里用 RDMA 互联,因为密集 attention 模型的 KV 缓存每秒几十 Gbps 地吐,一旦传慢 GPU 就空转。
转折来自新一代 hybrid attention 模型。论文实测 Kimi Linear、MiMo-V2-Flash、Ring-2.5-1T 等模型通过少量完整 attention 层加大量线性层的组合,把 KV 缓存吞吐量砍掉了约一个数量级,Ring-2.5-1T 的综合压缩比达到 36 倍。这时 KV 缓存可以从 RDMA 专网搬到普通以太网上传。
PrfaaS 的具体做法:组建独立的「预填充集群」,只把长上下文、未命中前缀缓存的请求路由过去,短请求留在本地 PD 集群;预填充完成后通过以太网把 KV 缓存回传本地集群做 decode。配套引入长度阈值路由、带宽感知调度器和混合前缀缓存池。论文用内部 1T 参数 hybrid 模型(基于 Kimi Linear 架构)做了一组实测,整体服务吞吐比同构 PD 部署高 54%,比朴素异构方案高 32%,每台机器只占适中的跨数据中心带宽。
信源:https://arxiv.org/html/2604.15039v1
❤1
X API把「自有数据读取」砍到每千次1美元,发帖反向涨价
X 近期发布新一轮 API 调价,新费率自 4 月 20 日生效。最大变化是「自有读取」(Owned Reads)按次计价 0.001 美元,相当于 1 美元能调 1000 次。该档覆盖开发者用自己的应用读取本账号的发帖、提及、点赞、收藏、关注者、关注列表、屏蔽与静音名单、置顶列表、自有列表、加入列表与列表归属共 12 个 GET 端点。
写入端反向涨价。POST /2/tweets 主接口由 0.01 美元上调至 0.015 美元/条。带 URL 的发帖单独定价 0.20 美元/条,仅「召唤回复」(summoned replies)保留 0.01 美元的旧价。同步对自助层级(self-serve tiers)账号砍掉三类写入操作:关注/取关、点赞/取消点赞、引用转发,对应端点全部禁用。
Owned Reads 大降价让开发者用接近免费的成本就能拉自己账号的全部公开数据,智能体框架可以直接围绕用户的 X 列表、关注、收藏搭轻量应用,不必再为每次拉取付出可观费用。带 URL 发帖的高定价对应自动化引流贴;自动关注、点赞、引用转发从自助级被一次性砍掉,相当于把账号增长动作收紧到付费更高的层级。
特斯拉与 xAI CEO 马斯克 4 月 19 日在 X 回应称,开发者可通过开源智能体网关 OpenClaw 接入 X API,并写「我们想做得便宜,但不能把家底送人」。
信源:https://devcommunity.x.com/t/x-api-pricing-update-owned-reads-now-0-001-other-changes-effective-april-20-2026/263025
X 近期发布新一轮 API 调价,新费率自 4 月 20 日生效。最大变化是「自有读取」(Owned Reads)按次计价 0.001 美元,相当于 1 美元能调 1000 次。该档覆盖开发者用自己的应用读取本账号的发帖、提及、点赞、收藏、关注者、关注列表、屏蔽与静音名单、置顶列表、自有列表、加入列表与列表归属共 12 个 GET 端点。
写入端反向涨价。POST /2/tweets 主接口由 0.01 美元上调至 0.015 美元/条。带 URL 的发帖单独定价 0.20 美元/条,仅「召唤回复」(summoned replies)保留 0.01 美元的旧价。同步对自助层级(self-serve tiers)账号砍掉三类写入操作:关注/取关、点赞/取消点赞、引用转发,对应端点全部禁用。
Owned Reads 大降价让开发者用接近免费的成本就能拉自己账号的全部公开数据,智能体框架可以直接围绕用户的 X 列表、关注、收藏搭轻量应用,不必再为每次拉取付出可观费用。带 URL 发帖的高定价对应自动化引流贴;自动关注、点赞、引用转发从自助级被一次性砍掉,相当于把账号增长动作收紧到付费更高的层级。
特斯拉与 xAI CEO 马斯克 4 月 19 日在 X 回应称,开发者可通过开源智能体网关 OpenClaw 接入 X API,并写「我们想做得便宜,但不能把家底送人」。
信源:https://devcommunity.x.com/t/x-api-pricing-update-owned-reads-now-0-001-other-changes-effective-april-20-2026/263025
❤1
browser-use开源自愈浏览器工具Browser Harness
browser-use 在 GitHub 开源 Browser Harness,一个让大模型直接操作浏览器的工具,核心代码集中在四个 Python 文件、合计约 592 行。创始人 Gregor Zunic 在 X 上写,团队受够了浏览器框架限制 LLM,于是把框架整块拿掉。四份文件分工:run.py 约 36 行做 Python 入口;helpers.py 约 195 行放初始工具调用;admin.py 与 daemon.py 合计约 361 行,负责守护进程启动,以及 Chrome DevTools Protocol(CDP)websocket 到本地 socket 的桥接。
主打能力是「自愈」。智能体任务中若发现 helpers.py 缺要用的函数,例如 upload_file(),会直接改源码把函数补上再继续跑,整套系统只留一条通往 Chrome 的 websocket。Zunic 发帖称他至今没找到 Browser Harness 解决不了的浏览器任务。
远程端走 browser-use Cloud,免费层三路并发,不要求信用卡。仓库 domain-skills 目录另收录 GitHub、Amazon、HackerNews 等数十个站点的抓取经验,由团队用 Browser Harness 实跑后整理;整体以即插即用形式对接 Claude Code 和 Codex。
信源:https://github.com/browser-use/browser-harness
browser-use 在 GitHub 开源 Browser Harness,一个让大模型直接操作浏览器的工具,核心代码集中在四个 Python 文件、合计约 592 行。创始人 Gregor Zunic 在 X 上写,团队受够了浏览器框架限制 LLM,于是把框架整块拿掉。四份文件分工:run.py 约 36 行做 Python 入口;helpers.py 约 195 行放初始工具调用;admin.py 与 daemon.py 合计约 361 行,负责守护进程启动,以及 Chrome DevTools Protocol(CDP)websocket 到本地 socket 的桥接。
主打能力是「自愈」。智能体任务中若发现 helpers.py 缺要用的函数,例如 upload_file(),会直接改源码把函数补上再继续跑,整套系统只留一条通往 Chrome 的 websocket。Zunic 发帖称他至今没找到 Browser Harness 解决不了的浏览器任务。
远程端走 browser-use Cloud,免费层三路并发,不要求信用卡。仓库 domain-skills 目录另收录 GitHub、Amazon、HackerNews 等数十个站点的抓取经验,由团队用 Browser Harness 实跑后整理;整体以即插即用形式对接 Claude Code 和 Codex。
信源:https://github.com/browser-use/browser-harness
GitHub
GitHub - browser-use/browser-harness: Browser Harness | Self-healing harness that enables LLMs to complete any task.
Browser Harness | Self-healing harness that enables LLMs to complete any task. - browser-use/browser-harness
Claude Code 改用原生二进制,运行时不再依赖 Node.js
Claude Code 从 v2.1.113 开始,npm 包里分发的内容由 JavaScript 构建产物换成了各平台原生二进制。
安装命令
最直观的变化是启动延迟。JS 版本每次敲下 `claude`,系统要先拉起一个 Node.js 进程,读入并即时编译所有脚本,再进入 CLI 主循环;这段开销对 CLI 场景最碍事,因为工具启停频繁,每次都要从头重跑。原生二进制的做法是把 JS 引擎和全部代码在发布时就打包进一个可执行文件,用户这边操作系统直接加载,省掉 Node.js 起进程和 JIT 预热的部分。对一天敲几十上百次命令的人,这段延迟的消失是能直接感觉到的。
第二层变化在依赖。Claude Code 运行时不再需要本机安装 Node.js,也不再受 Node.js 版本差异影响。CLI 工具对外部运行时的依赖越少,安装失败和环境冲突的概率越低。
信源:https://github.com/anthropics/claude-code/releases/tag/v2.1.113
Claude Code 从 v2.1.113 开始,npm 包里分发的内容由 JavaScript 构建产物换成了各平台原生二进制。
安装命令
npm install -g @anthropic-ai/claude-code 保持不变,npm 在背后根据平台 optional dependency 拉取对应的预编译二进制,并通过 postinstall 脚本链接到位;如需继续使用 JS 版本,可将版本号 pin 到 v2.1.113 之前。最直观的变化是启动延迟。JS 版本每次敲下 `claude`,系统要先拉起一个 Node.js 进程,读入并即时编译所有脚本,再进入 CLI 主循环;这段开销对 CLI 场景最碍事,因为工具启停频繁,每次都要从头重跑。原生二进制的做法是把 JS 引擎和全部代码在发布时就打包进一个可执行文件,用户这边操作系统直接加载,省掉 Node.js 起进程和 JIT 预热的部分。对一天敲几十上百次命令的人,这段延迟的消失是能直接感觉到的。
第二层变化在依赖。Claude Code 运行时不再需要本机安装 Node.js,也不再受 Node.js 版本差异影响。CLI 工具对外部运行时的依赖越少,安装失败和环境冲突的概率越低。
信源:https://github.com/anthropics/claude-code/releases/tag/v2.1.113
DeepSeek V4传下周发布,Yifan Zhang披露三项架构组件
普林斯顿博士生 Yifan Zhang 透露,中国 AI 公司 DeepSeek(深度求索)的下一代旗舰 V4 将在下周发布;他在跟帖里列出三项架构组件:稀疏 MQA(Sparse Multi-Query Attention)、融合 MoE 大核(Fused MoE Mega Kernel)、Hyper-Connections。Zhang 本科北大元培、硕士清华姚班,现为普林斯顿 AI Lab Fellow,曾在字节跳动 Seed 基础模型团队任研究实习生;目前不在 DeepSeek 任职,DeepSeek 官方也未就发布时间表作出确认。
三项组件各对应 LLM 优化里的一条独立方向。稀疏 MQA 是在多查询注意力基础上引入稀疏性,用于在长上下文场景进一步压低推理算力和显存占用;融合 MoE 大核把 MoE 的路由判断与专家矩阵乘法编进同一个 GPU kernel,砍掉推理阶段大量 kernel 启动和显存搬运开销;Hyper-Connections 是对残差连接的泛化,用多条可学习加权通路替代单一残差加法。
信源:https://x.com/yifan_zhang_/status/2045694320993276133
普林斯顿博士生 Yifan Zhang 透露,中国 AI 公司 DeepSeek(深度求索)的下一代旗舰 V4 将在下周发布;他在跟帖里列出三项架构组件:稀疏 MQA(Sparse Multi-Query Attention)、融合 MoE 大核(Fused MoE Mega Kernel)、Hyper-Connections。Zhang 本科北大元培、硕士清华姚班,现为普林斯顿 AI Lab Fellow,曾在字节跳动 Seed 基础模型团队任研究实习生;目前不在 DeepSeek 任职,DeepSeek 官方也未就发布时间表作出确认。
三项组件各对应 LLM 优化里的一条独立方向。稀疏 MQA 是在多查询注意力基础上引入稀疏性,用于在长上下文场景进一步压低推理算力和显存占用;融合 MoE 大核把 MoE 的路由判断与专家矩阵乘法编进同一个 GPU kernel,砍掉推理阶段大量 kernel 启动和显存搬运开销;Hyper-Connections 是对残差连接的泛化,用多条可学习加权通路替代单一残差加法。
信源:https://x.com/yifan_zhang_/status/2045694320993276133
马斯克:Grok 4.4翻倍到1T参数、4.5再扩到1.5T,均争取5月发布
xAI 与特斯拉 CEO 马斯克 4 月 19 日在 X 回应 Tech Dev Notes 的一条帖子,公布 Grok 后续两版计划。该账号此前贴出 Grok 4.3 的知识截止日期为 2025 年 12 月。马斯克的回复有三点:Grok 4.3 已追加补充训练;Grok 4.4 参数规模翻倍到 1T,训练数据覆盖到 2026 年 4 月初,预计 5 月初发布;Grok 4.5 再扩到 1.5T 参数,争取 5 月底交付。
这组数字把昨天没说清的型号补齐了。4 月 18 日马斯克还说「真正的 1T 旗舰离初训完成还有约 5 天」但没给型号,今天明确那就是 Grok 4.4,4.5 则是下一版 1.5T 模型。
信源:https://x.com/elonmusk/status/2045590599206875216
xAI 与特斯拉 CEO 马斯克 4 月 19 日在 X 回应 Tech Dev Notes 的一条帖子,公布 Grok 后续两版计划。该账号此前贴出 Grok 4.3 的知识截止日期为 2025 年 12 月。马斯克的回复有三点:Grok 4.3 已追加补充训练;Grok 4.4 参数规模翻倍到 1T,训练数据覆盖到 2026 年 4 月初,预计 5 月初发布;Grok 4.5 再扩到 1.5T 参数,争取 5 月底交付。
这组数字把昨天没说清的型号补齐了。4 月 18 日马斯克还说「真正的 1T 旗舰离初训完成还有约 5 天」但没给型号,今天明确那就是 Grok 4.4,4.5 则是下一版 1.5T 模型。
信源:https://x.com/elonmusk/status/2045590599206875216
❤1
Vercel内部系统遭入侵,入口是员工使用的AI工具Context.ai
美国云部署平台 Vercel 于 4 月 19 日披露安全事件,确认第三方未经授权访问其部分内部系统。Vercel 的主力业务是为 Next.js 等 JavaScript 框架提供托管、无服务器函数与 CI/CD,大量前端和 Web3 项目的部署依赖它。官方公告称受影响客户数量「有限」,服务未中断。Vercel 已通报执法机构,并引入外部事件响应团队协助调查。
创始人兼 CEO Guillermo Rauch 向社区通报还原了攻击链。一名 Vercel 员工使用的 AI 平台 Context.ai 先被攻破,该平台在 Google Workspace 里挂着 OAuth 应用。攻击者经此拿到该员工的 Google Workspace 账号,再以此为跳板进入 Vercel 内部环境。Vercel 官方公告给出了涉事 OAuth 应用的 client ID「110671459871-30f1spbu0hptbs60cb4vsmv79i7bbvqj.apps.googleusercontent.com」。公告提醒其他组织的 Workspace 管理员自查,同一 OAuth 应用潜在波及其数百名跨组织用户。
暴露的数据集中在环境变量,即 Vercel 里保存 API key、数据库凭证与签名密钥的地方。Rauch 称,所有客户环境变量在存储层都已加密。平台另外提供一个「敏感变量」(Sensitive Environment Variables)标记,打开后即使管理员自己也无法再从控制台读出明文。未标记的变量仍可被取回。攻击者枚举了未标记为敏感的变量,读到了其中的明文值。因此具体哪些密钥被带走,取决于各客户当初是否主动启用了这个开关。Vercel 建议立即轮换所有未标记为敏感的密钥,并回溯账号活动日志与近期部署中的异常项。
一个自称 ShinyHunters 的威胁行为者在黑客论坛挂出兜售帖。样本包括 580 条 Vercel 员工记录,涵盖姓名、公司邮箱、账号状态和活动时间戳。该人还声称手里有源代码、访问密钥、NPM token、GitHub token 和内部部署入口,开价 200 万美元赎金。BleepingComputer 称,近期 ShinyHunters 相关行动中的另几名攻击者否认参与本次事件,数据真实性尚未独立证实。Vercel 未就是否在谈赎金作出回应。
Vercel 已同步在 Dashboard 上线环境变量总览页和敏感变量管理的新界面。公司确认开源项目 Next.js、Turbopack 等未受影响,并披露正与 Google Mandiant 团队协作排查。
信源:https://x.com/rauchg/status/2045995362499076169
美国云部署平台 Vercel 于 4 月 19 日披露安全事件,确认第三方未经授权访问其部分内部系统。Vercel 的主力业务是为 Next.js 等 JavaScript 框架提供托管、无服务器函数与 CI/CD,大量前端和 Web3 项目的部署依赖它。官方公告称受影响客户数量「有限」,服务未中断。Vercel 已通报执法机构,并引入外部事件响应团队协助调查。
创始人兼 CEO Guillermo Rauch 向社区通报还原了攻击链。一名 Vercel 员工使用的 AI 平台 Context.ai 先被攻破,该平台在 Google Workspace 里挂着 OAuth 应用。攻击者经此拿到该员工的 Google Workspace 账号,再以此为跳板进入 Vercel 内部环境。Vercel 官方公告给出了涉事 OAuth 应用的 client ID「110671459871-30f1spbu0hptbs60cb4vsmv79i7bbvqj.apps.googleusercontent.com」。公告提醒其他组织的 Workspace 管理员自查,同一 OAuth 应用潜在波及其数百名跨组织用户。
暴露的数据集中在环境变量,即 Vercel 里保存 API key、数据库凭证与签名密钥的地方。Rauch 称,所有客户环境变量在存储层都已加密。平台另外提供一个「敏感变量」(Sensitive Environment Variables)标记,打开后即使管理员自己也无法再从控制台读出明文。未标记的变量仍可被取回。攻击者枚举了未标记为敏感的变量,读到了其中的明文值。因此具体哪些密钥被带走,取决于各客户当初是否主动启用了这个开关。Vercel 建议立即轮换所有未标记为敏感的密钥,并回溯账号活动日志与近期部署中的异常项。
一个自称 ShinyHunters 的威胁行为者在黑客论坛挂出兜售帖。样本包括 580 条 Vercel 员工记录,涵盖姓名、公司邮箱、账号状态和活动时间戳。该人还声称手里有源代码、访问密钥、NPM token、GitHub token 和内部部署入口,开价 200 万美元赎金。BleepingComputer 称,近期 ShinyHunters 相关行动中的另几名攻击者否认参与本次事件,数据真实性尚未独立证实。Vercel 未就是否在谈赎金作出回应。
Vercel 已同步在 Dashboard 上线环境变量总览页和敏感变量管理的新界面。公司确认开源项目 Next.js、Turbopack 等未受影响,并披露正与 Google Mandiant 团队协作排查。
信源:https://x.com/rauchg/status/2045995362499076169
X (formerly Twitter)
Guillermo Rauch (@rauchg) on X
Here's my update to the broader community about the ongoing incident investigation. I want to give you the rundown of the situation directly.
A Vercel employee got compromised via the breach of an AI platform customer called https://t.co/xksNNigVfE that…
A Vercel employee got compromised via the breach of an AI platform customer called https://t.co/xksNNigVfE that…
谷歌拟联手美满电子研发两款AI推理芯片,加速摆脱对博通依赖
谷歌正与美满电子(Marvell Technology)洽谈合作,开发两款旨在提高AI模型运行效率的定制芯片。此举标志着谷歌正加速推动AI硬件供应商多元化,以降低对长期合作伙伴博通(Broadcom)的依赖并削减成本。
这两款芯片包括一个专门用于AI推理的新型张量处理单元(TPU),以及一个与现有TPU协作的内存处理单元(MPU)。谷歌计划生产约200万个MPU,预计设计工作最早于明年完成。推理芯片主要负责运行已训练好的模型,是驱动自动代理等商业产品的核心。
目前,博通是谷歌TPU唯一的长期设计合作伙伴,并对每颗产出的芯片收取高额费用。随着TPU需求激增,谷歌正通过引入美满电子和联发科(MediaTek)来分摊风险。美满电子此前曾协助初创公司Groq设计推理芯片,在高性能内存管理和网络接口领域拥有技术积累。
信源:https://www.theinformation.com/articles/google-talks-marvell-build-new-ai-chips-inference
谷歌正与美满电子(Marvell Technology)洽谈合作,开发两款旨在提高AI模型运行效率的定制芯片。此举标志着谷歌正加速推动AI硬件供应商多元化,以降低对长期合作伙伴博通(Broadcom)的依赖并削减成本。
这两款芯片包括一个专门用于AI推理的新型张量处理单元(TPU),以及一个与现有TPU协作的内存处理单元(MPU)。谷歌计划生产约200万个MPU,预计设计工作最早于明年完成。推理芯片主要负责运行已训练好的模型,是驱动自动代理等商业产品的核心。
目前,博通是谷歌TPU唯一的长期设计合作伙伴,并对每颗产出的芯片收取高额费用。随着TPU需求激增,谷歌正通过引入美满电子和联发科(MediaTek)来分摊风险。美满电子此前曾协助初创公司Groq设计推理芯片,在高性能内存管理和网络接口领域拥有技术积累。
信源:https://www.theinformation.com/articles/google-talks-marvell-build-new-ai-chips-inference
The Information
Google in Talks With Marvell to Build New AI Chips for Inference
Google is in talks with Marvell Technology to develop two new chips aimed at running AI models more efficiently, according to two people with direct knowledge of the discussions. One is a memory processing unit designed to work alongside Google’s tensor processing…
马斯克:Grok 5 将实现 AGI,并贴出 4.4 到 7.0 的完整路线
xAI 与特斯拉 CEO 马斯克在 X 上被问到「Grok 哪一版会实现 AGI」时,只回复了「Grok 5」。他把 AGI 的节点直接锁在了这一版上。
随后他也把完整的版本路线贴了出来:4.4=1T、4.5=1.5T、4.6=3T、4.7=6T、4.8=10T、4.9=???、5.0=AGI、6.0=ASI、7.0=ASI2。目前已开放测试的是 4.3 beta(0.5T)。按这张表,4.4 到 4.8 五版参数一路放大到 10T,对应他此前说过的「每两周下线一版改进后的基础模型」节奏;4.9 留空,5.0 及之后直接贴上 AGI、ASI(智能水平全面超过人类的超级人工智能,是 AGI 之后的假想阶段)、ASI2 标签。
这份完整路线的末尾,马斯克配了耸肩(🤷♂️)和笑哭(😂)两个 emoji,暗示 5.0 之后的标签是半玩笑,不是参数或能力承诺;但前面「Grok 5 = AGI」那句没有 emoji,可以当作他本人对 AGI 时间点的一次公开表态。
信源:https://x.com/elonmusk/status/2046020407254467013
xAI 与特斯拉 CEO 马斯克在 X 上被问到「Grok 哪一版会实现 AGI」时,只回复了「Grok 5」。他把 AGI 的节点直接锁在了这一版上。
随后他也把完整的版本路线贴了出来:4.4=1T、4.5=1.5T、4.6=3T、4.7=6T、4.8=10T、4.9=???、5.0=AGI、6.0=ASI、7.0=ASI2。目前已开放测试的是 4.3 beta(0.5T)。按这张表,4.4 到 4.8 五版参数一路放大到 10T,对应他此前说过的「每两周下线一版改进后的基础模型」节奏;4.9 留空,5.0 及之后直接贴上 AGI、ASI(智能水平全面超过人类的超级人工智能,是 AGI 之后的假想阶段)、ASI2 标签。
这份完整路线的末尾,马斯克配了耸肩(🤷♂️)和笑哭(😂)两个 emoji,暗示 5.0 之后的标签是半玩笑,不是参数或能力承诺;但前面「Grok 5 = AGI」那句没有 emoji,可以当作他本人对 AGI 时间点的一次公开表态。
信源:https://x.com/elonmusk/status/2046020407254467013
❤1
特朗普冠名的Fermi巨型AI数据中心项目失速,CEO辞职、首期延一年
4 月 17 日,美国 AI 数据中心公司 Fermi America 的 CEO Toby Neugebauer 突然离职,股价盘后交易再度下跌,过去半年累计跌 75%。Fermi America 由特朗普第一任期能源部长 Rick Perry 联合创办,去年 10 月 IPO,正在德州狭长地带(Texas Panhandle)开发号称全球最大的 AI 数据中心项目,官方命名为「President Donald Trump Advanced Energy and Intelligence Campus」。项目占地约半个曼哈顿,规划功率 17 吉瓦(GW),相当于纽约市用电量的三倍,电力结构以本地燃气、核能和太阳能为主。
项目目前卡在两个环节。一是没有公开锚定租户(通常是超大规模云厂商,业内称 hyperscaler)。二是冷却系统本该由租户主导设计,租户没定也就无法敲定。Neugebauer 在 3 月 30 日财报电话会上承认供应链是「比预想更大的瓶颈」,对 Axios 说「我可能对供应链理解错了,这算是失败」。独立市场情报公司 Cleanview 的报告估计,即便本月签下锚定租户,首批建筑也要 2027 年 5 月才能上线,比原计划晚约一年。Fermi 已在近期 SEC 文件里确认无法完成 2026 年底上线 1.1 GW 的原定目标。去年 12 月一家租户退出后,投资人已就此提起集体诉讼。
内部也在松动。联合创始人 Griffin Perry(Rick Perry 之子)4 月 15 日披露减持约 1100 万股,相当于其持股的 15%。《Politico》3 月报道称,Neugebauer 曾与美国商务部长 Howard Lutnick 在一次会议上发生冲突。
信源:https://www.axios.com/2026/04/19/ai-data-center-project-troubles-texas
4 月 17 日,美国 AI 数据中心公司 Fermi America 的 CEO Toby Neugebauer 突然离职,股价盘后交易再度下跌,过去半年累计跌 75%。Fermi America 由特朗普第一任期能源部长 Rick Perry 联合创办,去年 10 月 IPO,正在德州狭长地带(Texas Panhandle)开发号称全球最大的 AI 数据中心项目,官方命名为「President Donald Trump Advanced Energy and Intelligence Campus」。项目占地约半个曼哈顿,规划功率 17 吉瓦(GW),相当于纽约市用电量的三倍,电力结构以本地燃气、核能和太阳能为主。
项目目前卡在两个环节。一是没有公开锚定租户(通常是超大规模云厂商,业内称 hyperscaler)。二是冷却系统本该由租户主导设计,租户没定也就无法敲定。Neugebauer 在 3 月 30 日财报电话会上承认供应链是「比预想更大的瓶颈」,对 Axios 说「我可能对供应链理解错了,这算是失败」。独立市场情报公司 Cleanview 的报告估计,即便本月签下锚定租户,首批建筑也要 2027 年 5 月才能上线,比原计划晚约一年。Fermi 已在近期 SEC 文件里确认无法完成 2026 年底上线 1.1 GW 的原定目标。去年 12 月一家租户退出后,投资人已就此提起集体诉讼。
内部也在松动。联合创始人 Griffin Perry(Rick Perry 之子)4 月 15 日披露减持约 1100 万股,相当于其持股的 15%。《Politico》3 月报道称,Neugebauer 曾与美国商务部长 Howard Lutnick 在一次会议上发生冲突。
信源:https://www.axios.com/2026/04/19/ai-data-center-project-troubles-texas
Axios
Trump-branded AI data center megaproject stalls, CEO departs
Fermi America is emerging as a high-profile test of ambitious AI data center projects.
美国国家安全局用上了被国防部列为供应链风险的 Anthropic Mythos
美国国家安全局(NSA)正在使用 Anthropic 目前能力最强的模型 Mythos Preview。两位消息人士向 Axios 确认此事,其中一位还表示该模型在国防部(DoD)内部的使用范围仍在扩大。DoD 管辖 NSA,今年 2 月却将 Anthropic 定性为「供应链风险」,切断合作并要求其供应商跟进,该案至今在法庭上进行。
Mythos 未对外正式发布。Anthropic 自认其进攻型网络能力过强,只向约 40 家机构发放使用权限,公开承认的名单仅 12 家。一位信源称 NSA 正是那些未公开接入者之一。其他已拿到权限的机构主要用 Mythos 扫描自身环境里的可利用漏洞,NSA 具体如何使用暂不清楚。英国方面也通过其 AI Security Institute 获得了访问权。
Anthropic CEO Dario Amodei 4 月 17 日在白宫会见了幕僚长 Susie Wiles 与财长 Scott Bessent,议题是政府对 Mythos 的使用以及 Anthropic 更大范围的安全实践。双方都把会议描述为「富有成效」,后续工作将聚焦 DoD 以外部门如何接入该模型。
DoD 内部出现了自相矛盾:它在法庭上坚持 Anthropic 是供应链风险,管辖下的 NSA 已经在实际使用 Anthropic 的模型。Anthropic 也绕过 DoD 直接对接白宫。DoD 以外的政府部门愿意暂时把这场合同纠纷搁在一边,换取继续使用 Mythos 的网络安全能力。
信源:https://www.axios.com/2026/04/19/nsa-anthropic-mythos-pentagon
美国国家安全局(NSA)正在使用 Anthropic 目前能力最强的模型 Mythos Preview。两位消息人士向 Axios 确认此事,其中一位还表示该模型在国防部(DoD)内部的使用范围仍在扩大。DoD 管辖 NSA,今年 2 月却将 Anthropic 定性为「供应链风险」,切断合作并要求其供应商跟进,该案至今在法庭上进行。
Mythos 未对外正式发布。Anthropic 自认其进攻型网络能力过强,只向约 40 家机构发放使用权限,公开承认的名单仅 12 家。一位信源称 NSA 正是那些未公开接入者之一。其他已拿到权限的机构主要用 Mythos 扫描自身环境里的可利用漏洞,NSA 具体如何使用暂不清楚。英国方面也通过其 AI Security Institute 获得了访问权。
Anthropic CEO Dario Amodei 4 月 17 日在白宫会见了幕僚长 Susie Wiles 与财长 Scott Bessent,议题是政府对 Mythos 的使用以及 Anthropic 更大范围的安全实践。双方都把会议描述为「富有成效」,后续工作将聚焦 DoD 以外部门如何接入该模型。
DoD 内部出现了自相矛盾:它在法庭上坚持 Anthropic 是供应链风险,管辖下的 NSA 已经在实际使用 Anthropic 的模型。Anthropic 也绕过 DoD 直接对接白宫。DoD 以外的政府部门愿意暂时把这场合同纠纷搁在一边,换取继续使用 Mythos 的网络安全能力。
信源:https://www.axios.com/2026/04/19/nsa-anthropic-mythos-pentagon
Axios
Scoop: NSA using Anthropic's Mythos despite Defense Department blacklist
The government's cybersecurity needs are outweighing the Pentagon's feud with Anthropic.
开发者称iOS收据可重用反复开通ChatGPT Plus,闲鱼代充原理被搬上OpenAI论坛
上周五 ID 为 BugstoOai 的开发者在 OpenAI 官方开发者社区发布一份安全报告,称发现 iOS 版 ChatGPT 订阅校验存在一处逻辑漏洞。报告给出的事实是:OpenAI 后端会校验 Apple Pay 收据签名是否合法、也会校验请求里 OpenAI auth token 是否有效,但没有比对购买收据的 Apple ID 与领取 Plus 的 OpenAI 账号是否属于同一人。报告把当前授权逻辑总结为「合法收据 + 有效 token = 开通 Plus」,并比喻为店员只验小票真假、不看持票人证件。
受影响的是 ChatGPT iOS 应用(报告作者注明已在 v1.2026.xx 版本测试)与后端接口 `/backend-api/subscription/upgrade`。报告同时给出缓解建议:把收据绑定到购买者身份、对收据做单次使用强制、加入 Apple ID 与 OpenAI 账号的指纹关联、监控同一 transaction_id 跨账号出现。
英文帖只给出高层步骤,称完整复现细节按「负责任披露」原则不公开。该帖末尾把一篇中文文章标注为原文(linux.do/t/topic/1981747),中文版则直接写明利用路径:用土耳其区 Apple ID 购买 Plus(月费 499 里拉),用 mitmproxy 等本地代理拦截 ChatGPT 应用发往 OpenAI 的收据,再用该收据反复调用订阅接口给不同账号开通 Plus;作者称闲鱼上低价 ChatGPT Plus 代充的来源即此路径。
OpenAI 至今未在论坛或其他渠道回应这份报告。讨论区也有用户质疑内容由 AI 生成、并无可复现证据。报告没有给出完整 PoC,也没有第三方安全研究员独立验证,目前只能算一份待查证的爆料。
信源:https://community.openai.com/t/security-report-apple-pay-receipt-validation-does-not-bind-to-purchaser-apple-id-potential-subscription-bypass/1379167
上周五 ID 为 BugstoOai 的开发者在 OpenAI 官方开发者社区发布一份安全报告,称发现 iOS 版 ChatGPT 订阅校验存在一处逻辑漏洞。报告给出的事实是:OpenAI 后端会校验 Apple Pay 收据签名是否合法、也会校验请求里 OpenAI auth token 是否有效,但没有比对购买收据的 Apple ID 与领取 Plus 的 OpenAI 账号是否属于同一人。报告把当前授权逻辑总结为「合法收据 + 有效 token = 开通 Plus」,并比喻为店员只验小票真假、不看持票人证件。
受影响的是 ChatGPT iOS 应用(报告作者注明已在 v1.2026.xx 版本测试)与后端接口 `/backend-api/subscription/upgrade`。报告同时给出缓解建议:把收据绑定到购买者身份、对收据做单次使用强制、加入 Apple ID 与 OpenAI 账号的指纹关联、监控同一 transaction_id 跨账号出现。
英文帖只给出高层步骤,称完整复现细节按「负责任披露」原则不公开。该帖末尾把一篇中文文章标注为原文(linux.do/t/topic/1981747),中文版则直接写明利用路径:用土耳其区 Apple ID 购买 Plus(月费 499 里拉),用 mitmproxy 等本地代理拦截 ChatGPT 应用发往 OpenAI 的收据,再用该收据反复调用订阅接口给不同账号开通 Plus;作者称闲鱼上低价 ChatGPT Plus 代充的来源即此路径。
OpenAI 至今未在论坛或其他渠道回应这份报告。讨论区也有用户质疑内容由 AI 生成、并无可复现证据。报告没有给出完整 PoC,也没有第三方安全研究员独立验证,目前只能算一份待查证的爆料。
信源:https://community.openai.com/t/security-report-apple-pay-receipt-validation-does-not-bind-to-purchaser-apple-id-potential-subscription-bypass/1379167
OpenAI Developer Community
[Security Report] Apple Pay receipt validation does not bind to purchaser Apple ID – potential subscription bypass
⚠ Disclaimer: This report is for technical research and responsible disclosure purposes only. I do not endorse or encourage any unauthorized use, account sharing, or commercial exploitation of this finding. All testing was conducted on accounts I own or with…
Recursive Superintelligence成立四个月融5亿美元,押注能自我改进的AI
Recursive Superintelligence 完成至少 5 亿美元融资,投前估值 40 亿美元,GV(谷歌旗下风投,原 Google Ventures)领投,英伟达(Nvidia)跟投。这一轮明显超额认购,最终规模可能达到 10 亿美元。公司去年底才在伦敦注册,约 20 名员工,至今没有正式对外亮相。
创始人阵容主要来自 OpenAI、Google DeepMind 与 Salesforce 的研究核心岗。Richard Socher 此前是 Salesforce 首席科学家;Tim Rocktäschel 是伦敦大学学院 AI 教授,不久前还在 DeepMind 任 principal scientist,参与过 Genie 交互式世界模型;Josh Tobin、Jeff Clune、Tim Shi 来自 OpenAI,其余成员来自 Google 与 Meta。
公司目标是做出无需人类干预、能持续自我改进的 AI 系统。当下的大模型一旦训练完成就基本固定,要变强必须由工程师重新整理数据再训练一遍;自我改进指的是模型自己产生数据、自己更新参数,把人从训练循环里去掉。这条路线一直是 AI 研究的长期目标,目前没有公开成果证明能长期稳定运转。
今年一季度全球初创公司融资规模达到 3000 亿美元的历史高点,OpenAI、Anthropic、xAI 与 Waymo 拿走了大头(Crunchbase 数据)。Recursive 也是近几个月从 OpenAI、Google、Meta 拆出的一批新 AI 实验室之一,类似的还有 Thinking Machines Lab、Safe Superintelligence、Ineffable Intelligence 与 Advanced Machine Intelligence Labs。
信源:https://www.ft.com/content/a92bf04b-bbac-400f-9554-5b1c70957ad4?syn-25a6b1a6=1
Recursive Superintelligence 完成至少 5 亿美元融资,投前估值 40 亿美元,GV(谷歌旗下风投,原 Google Ventures)领投,英伟达(Nvidia)跟投。这一轮明显超额认购,最终规模可能达到 10 亿美元。公司去年底才在伦敦注册,约 20 名员工,至今没有正式对外亮相。
创始人阵容主要来自 OpenAI、Google DeepMind 与 Salesforce 的研究核心岗。Richard Socher 此前是 Salesforce 首席科学家;Tim Rocktäschel 是伦敦大学学院 AI 教授,不久前还在 DeepMind 任 principal scientist,参与过 Genie 交互式世界模型;Josh Tobin、Jeff Clune、Tim Shi 来自 OpenAI,其余成员来自 Google 与 Meta。
公司目标是做出无需人类干预、能持续自我改进的 AI 系统。当下的大模型一旦训练完成就基本固定,要变强必须由工程师重新整理数据再训练一遍;自我改进指的是模型自己产生数据、自己更新参数,把人从训练循环里去掉。这条路线一直是 AI 研究的长期目标,目前没有公开成果证明能长期稳定运转。
今年一季度全球初创公司融资规模达到 3000 亿美元的历史高点,OpenAI、Anthropic、xAI 与 Waymo 拿走了大头(Crunchbase 数据)。Recursive 也是近几个月从 OpenAI、Google、Meta 拆出的一批新 AI 实验室之一,类似的还有 Thinking Machines Lab、Safe Superintelligence、Ineffable Intelligence 与 Advanced Machine Intelligence Labs。
信源:https://www.ft.com/content/a92bf04b-bbac-400f-9554-5b1c70957ad4?syn-25a6b1a6=1
Cherry Studio 被曝关闭「匿名统计」后仍在偷传设备信息,作者承认开关失效
开源 AI 客户端 Cherry Studio 被用户发现隐私开关失灵。GitHub 用户 Yuerchu 在 Issue #14387 贴出抓包截图:把「匿名发送错误报告和数据统计」关掉后,客户端仍持续向 analytics.cherry-ai.com 发请求。Cherry Studio 由国内开发者 kangfenmao 主导,支持多家大模型聚合与本地知识库,是国内用户量最大的开源 AI 桌面客户端之一。
客户端一共会上报三种事件:每次 AI 对话、每次应用启动、每次检查更新。只有对话那个会看用户设置,另外两个直接绕过开关发出去。每条请求都带一个专属设备 ID,加上系统、CPU 架构、应用版本,等于长期追踪这台电脑。
翻代码可以看到,2026 年 2 月刚加这套上报机制时,开关是有效的。到 3 月 22 日,维护者 kangfenmao 自己改了一版,把开关检查删掉,顺带把更多设备信息塞进请求头。这版改动在 v1.8.3、v1.8.4、v1.9.0、v1.9.1 四个版本里跑了一个月。
kangfenmao 在 issue 下承认问题属实,解释是不同事件用了不同的开关判断逻辑,关掉设置后应用启动和更新检查的请求没被挡住;聊天内容、用户输入、文件、API 密钥这些敏感数据不走这条通道。修复 PR #14390 已合并,三种事件统一走同一个开关。
事情还有更早的一层。社区翻旧代码发现,2025 年 2 月这个项目第一次加分析功能时,同时塞进一段升级脚本:只要是从老版本升上来的用户,这个「匿名统计」开关都会被自动打开一次。此后分析服务后端从 Google Analytics 换到 PostHog、Sentry,再换到现在自建的 analytics.cherry-ai.com,这段自动打开开关的代码一直没删。也就是说,在 2025 年 2 月之前装过 Cherry Studio、之后又升级过的用户,不管当初有没有手动关过这个开关,升级时都会被再打开一次,想关还得升级后再手动关一遍。
信源:https://github.com/CherryHQ/cherry-studio/issues/14387
开源 AI 客户端 Cherry Studio 被用户发现隐私开关失灵。GitHub 用户 Yuerchu 在 Issue #14387 贴出抓包截图:把「匿名发送错误报告和数据统计」关掉后,客户端仍持续向 analytics.cherry-ai.com 发请求。Cherry Studio 由国内开发者 kangfenmao 主导,支持多家大模型聚合与本地知识库,是国内用户量最大的开源 AI 桌面客户端之一。
客户端一共会上报三种事件:每次 AI 对话、每次应用启动、每次检查更新。只有对话那个会看用户设置,另外两个直接绕过开关发出去。每条请求都带一个专属设备 ID,加上系统、CPU 架构、应用版本,等于长期追踪这台电脑。
翻代码可以看到,2026 年 2 月刚加这套上报机制时,开关是有效的。到 3 月 22 日,维护者 kangfenmao 自己改了一版,把开关检查删掉,顺带把更多设备信息塞进请求头。这版改动在 v1.8.3、v1.8.4、v1.9.0、v1.9.1 四个版本里跑了一个月。
kangfenmao 在 issue 下承认问题属实,解释是不同事件用了不同的开关判断逻辑,关掉设置后应用启动和更新检查的请求没被挡住;聊天内容、用户输入、文件、API 密钥这些敏感数据不走这条通道。修复 PR #14390 已合并,三种事件统一走同一个开关。
事情还有更早的一层。社区翻旧代码发现,2025 年 2 月这个项目第一次加分析功能时,同时塞进一段升级脚本:只要是从老版本升上来的用户,这个「匿名统计」开关都会被自动打开一次。此后分析服务后端从 Google Analytics 换到 PostHog、Sentry,再换到现在自建的 analytics.cherry-ai.com,这段自动打开开关的代码一直没删。也就是说,在 2025 年 2 月之前装过 Cherry Studio、之后又升级过的用户,不管当初有没有手动关过这个开关,升级时都会被再打开一次,想关还得升级后再手动关一遍。
信源:https://github.com/CherryHQ/cherry-studio/issues/14387
GitHub
[Discussion]: Suspicious telemetry connection to cherry-ai.com persists after disabling auto-updates/anonymous analytics · Issue…
NoteThis issue was translated by Claude. Issue Checklist I understand that issues are meant for feedback and problem-solving, not for venting, and I will provide as much detail as possible to help ...
通义上线Fun-ASR1.5,主打方言识别
通义实验室 4 月 20 日发布语音识别模型 Fun-ASR1.5,并已在阿里云百炼上线 API、在魔搭社区开放在线体验。官方称,这一版用单模型覆盖 30 种语言、汉语七大方言体系和 20 多种地区口音,不再按方言单独切模型。
通义给出的内部评测显示,典型方言场景的字错误率较上一版相对下降 56.2%,已有 5 种方言准确率超过 90%,15 种超过 80%。古诗词识别也被单列出来做了专项优化,官方给出的内部字符级准确率是 97%。
中文语音识别里最难处理的方言长尾,开始被收进同一套可直接商用的能力。对教育直播、地方政务热线、采访整理这类场景来说,接入方不用再按地区口音拆多套识别链路,部署会简单一些。
信源:https://mp.weixin.qq.com/s/6t8lGS_OFQED7E0FNf-WTg
通义实验室 4 月 20 日发布语音识别模型 Fun-ASR1.5,并已在阿里云百炼上线 API、在魔搭社区开放在线体验。官方称,这一版用单模型覆盖 30 种语言、汉语七大方言体系和 20 多种地区口音,不再按方言单独切模型。
通义给出的内部评测显示,典型方言场景的字错误率较上一版相对下降 56.2%,已有 5 种方言准确率超过 90%,15 种超过 80%。古诗词识别也被单列出来做了专项优化,官方给出的内部字符级准确率是 97%。
中文语音识别里最难处理的方言长尾,开始被收进同一套可直接商用的能力。对教育直播、地方政务热线、采访整理这类场景来说,接入方不用再按地区口音拆多套识别链路,部署会简单一些。
信源:https://mp.weixin.qq.com/s/6t8lGS_OFQED7E0FNf-WTg
美国司法部拒绝协助法国调查X
美国司法部上周五致函法国司法部国际合作办公室,拒绝协助法国检方调查 X。它也不愿代为推进对马斯克和多名 X 员工的问询安排。法国方面今年已三次向美国提出司法协作请求,其中包括送达传票。《华尔街日报》看到的信件写道,法国正试图用刑事程序规制一个美国言论平台。美方认为,这与美国宪法第一修正案相冲突。
法国对 X 的调查本身不是新事。巴黎检方 2025 年 1 月立案,今年 2 月搜查了 X 巴黎办公室。马斯克、前 CEO Linda Yaccarino 和其他员工,原定在 4 月 20 日当周接受「自愿问询」。案件最初聚焦 X 推荐算法是否存在政治偏向。之后又扩到儿童色情图像、非自愿色情深度伪造和否认大屠杀等指控。
美国政府现在明确不愿帮法国把这案子往前推。这会直接影响传票送达和跨境取证。法国检方回应称,并不知道这封信,但强调法国司法独立,问询对象到场与否都不会妨碍调查继续。
信源:https://www.wsj.com/business/justice-department-rebuffs-french-on-x-probe-musk-interview-2b8eb080
美国司法部上周五致函法国司法部国际合作办公室,拒绝协助法国检方调查 X。它也不愿代为推进对马斯克和多名 X 员工的问询安排。法国方面今年已三次向美国提出司法协作请求,其中包括送达传票。《华尔街日报》看到的信件写道,法国正试图用刑事程序规制一个美国言论平台。美方认为,这与美国宪法第一修正案相冲突。
法国对 X 的调查本身不是新事。巴黎检方 2025 年 1 月立案,今年 2 月搜查了 X 巴黎办公室。马斯克、前 CEO Linda Yaccarino 和其他员工,原定在 4 月 20 日当周接受「自愿问询」。案件最初聚焦 X 推荐算法是否存在政治偏向。之后又扩到儿童色情图像、非自愿色情深度伪造和否认大屠杀等指控。
美国政府现在明确不愿帮法国把这案子往前推。这会直接影响传票送达和跨境取证。法国检方回应称,并不知道这封信,但强调法国司法独立,问询对象到场与否都不会妨碍调查继续。
信源:https://www.wsj.com/business/justice-department-rebuffs-french-on-x-probe-musk-interview-2b8eb080
The Wall Street Journal
Exclusive | Justice Department Rebuffs French on X Probe, Musk Interview
The U.S. told French authorities it wouldn’t facilitate their efforts to investigate Elon Musk’s X, after a raid on the social-media platform’s Paris office earlier this year.
字节跳动2025年净利润传降超70%,AI投入开始吃掉利润
知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。
转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。
信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。
转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。
信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
中国至少10家AI芯片公司已在同步出货,英伟达在华份额今年或从40%跌至8%
《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。
Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。
路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。
两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。
阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。
供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。
信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms
《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。
Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。
路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。
两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。
阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。
供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。
信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms