动察Beating AI News
3.15K subscribers
882 photos
2 videos
3.4K links
AI新闻信息流
Download Telegram
ProducerAI更名Flow Music,上线片段替换与延展

今年 2 月加入 Google Labs 的 AI 音乐创作平台 ProducerAI 宣布产品正式更名为 Google Flow Music,纳入 Google Flow 家族,入口为 flowmusic.google。Google Flow 是 Google 在 2025 年 I/O 上发布的 AI 视频生成套件,原本只涵盖视频方向,此次把 AI 音乐能力补进同一产品线。官方称团队和使命不变。

同步上线两项 remix 能力:replace(替换)和 extend(延展)。用户用自然语言 prompt 圈出歌曲里的某一段,交给名为 Producer 的智能体修改,例如把一段 lofi 钢琴前奏延展成 dubstep drop、一次性替换多段副歌,或者让它对同一段吉他 solo 生成 5 个备选版本。

这次更新把 AI 生成音乐的工作流从「整首重生」推向「局部可控」。过去用 Suno、Udio 这类工具,生成结果不满意时多数情况只能整首重跑再手动拼接,现在可以针对一首歌反复改局部、保留其他部分不动,更贴近传统音乐制作的迭代节奏。

信源:https://x.com/googleflowmusic/status/2045250153356108026
月之暗面与清华新论文:LLM 预填充可跨数据中心,1T 模型吞吐升 54%

月之暗面(Moonshot AI)与清华大学 4 月 16 日在 arXiv 挂出新论文《Prefill-as-a-Service》,提出让大模型推理的预填充阶段(prefill)跨数据中心运行。

大模型推理分两步:prefill 先把输入一次性读进来、生成一份 KV 缓存;decode 再根据这份缓存逐字吐出结果。两步需要的硬件特性完全不同,prefill 吃算力,decode 吃显存带宽。业界主流做法是把两步拆到不同机器上(PD 分离),但这要求两边在同一个数据中心里用 RDMA 互联,因为密集 attention 模型的 KV 缓存每秒几十 Gbps 地吐,一旦传慢 GPU 就空转。

转折来自新一代 hybrid attention 模型。论文实测 Kimi Linear、MiMo-V2-Flash、Ring-2.5-1T 等模型通过少量完整 attention 层加大量线性层的组合,把 KV 缓存吞吐量砍掉了约一个数量级,Ring-2.5-1T 的综合压缩比达到 36 倍。这时 KV 缓存可以从 RDMA 专网搬到普通以太网上传。

PrfaaS 的具体做法:组建独立的「预填充集群」,只把长上下文、未命中前缀缓存的请求路由过去,短请求留在本地 PD 集群;预填充完成后通过以太网把 KV 缓存回传本地集群做 decode。配套引入长度阈值路由、带宽感知调度器和混合前缀缓存池。论文用内部 1T 参数 hybrid 模型(基于 Kimi Linear 架构)做了一组实测,整体服务吞吐比同构 PD 部署高 54%,比朴素异构方案高 32%,每台机器只占适中的跨数据中心带宽。

信源:https://arxiv.org/html/2604.15039v1
1
X API把「自有数据读取」砍到每千次1美元,发帖反向涨价

X 近期发布新一轮 API 调价,新费率自 4 月 20 日生效。最大变化是「自有读取」(Owned Reads)按次计价 0.001 美元,相当于 1 美元能调 1000 次。该档覆盖开发者用自己的应用读取本账号的发帖、提及、点赞、收藏、关注者、关注列表、屏蔽与静音名单、置顶列表、自有列表、加入列表与列表归属共 12 个 GET 端点。

写入端反向涨价。POST /2/tweets 主接口由 0.01 美元上调至 0.015 美元/条。带 URL 的发帖单独定价 0.20 美元/条,仅「召唤回复」(summoned replies)保留 0.01 美元的旧价。同步对自助层级(self-serve tiers)账号砍掉三类写入操作:关注/取关、点赞/取消点赞、引用转发,对应端点全部禁用。

Owned Reads 大降价让开发者用接近免费的成本就能拉自己账号的全部公开数据,智能体框架可以直接围绕用户的 X 列表、关注、收藏搭轻量应用,不必再为每次拉取付出可观费用。带 URL 发帖的高定价对应自动化引流贴;自动关注、点赞、引用转发从自助级被一次性砍掉,相当于把账号增长动作收紧到付费更高的层级。

特斯拉与 xAI CEO 马斯克 4 月 19 日在 X 回应称,开发者可通过开源智能体网关 OpenClaw 接入 X API,并写「我们想做得便宜,但不能把家底送人」。

信源:https://devcommunity.x.com/t/x-api-pricing-update-owned-reads-now-0-001-other-changes-effective-april-20-2026/263025
1
browser-use开源自愈浏览器工具Browser Harness

browser-use 在 GitHub 开源 Browser Harness,一个让大模型直接操作浏览器的工具,核心代码集中在四个 Python 文件、合计约 592 行。创始人 Gregor Zunic 在 X 上写,团队受够了浏览器框架限制 LLM,于是把框架整块拿掉。四份文件分工:run.py 约 36 行做 Python 入口;helpers.py 约 195 行放初始工具调用;admin.pydaemon.py 合计约 361 行,负责守护进程启动,以及 Chrome DevTools Protocol(CDP)websocket 到本地 socket 的桥接。

主打能力是「自愈」。智能体任务中若发现 helpers.py 缺要用的函数,例如 upload_file(),会直接改源码把函数补上再继续跑,整套系统只留一条通往 Chrome 的 websocket。Zunic 发帖称他至今没找到 Browser Harness 解决不了的浏览器任务。

远程端走 browser-use Cloud,免费层三路并发,不要求信用卡。仓库 domain-skills 目录另收录 GitHub、Amazon、HackerNews 等数十个站点的抓取经验,由团队用 Browser Harness 实跑后整理;整体以即插即用形式对接 Claude Code 和 Codex。

信源:https://github.com/browser-use/browser-harness
Claude Code 改用原生二进制,运行时不再依赖 Node.js

Claude Code 从 v2.1.113 开始,npm 包里分发的内容由 JavaScript 构建产物换成了各平台原生二进制。

安装命令 npm install -g @anthropic-ai/claude-code 保持不变,npm 在背后根据平台 optional dependency 拉取对应的预编译二进制,并通过 postinstall 脚本链接到位;如需继续使用 JS 版本,可将版本号 pin 到 v2.1.113 之前。

最直观的变化是启动延迟。JS 版本每次敲下 `claude`,系统要先拉起一个 Node.js 进程,读入并即时编译所有脚本,再进入 CLI 主循环;这段开销对 CLI 场景最碍事,因为工具启停频繁,每次都要从头重跑。原生二进制的做法是把 JS 引擎和全部代码在发布时就打包进一个可执行文件,用户这边操作系统直接加载,省掉 Node.js 起进程和 JIT 预热的部分。对一天敲几十上百次命令的人,这段延迟的消失是能直接感觉到的。

第二层变化在依赖。Claude Code 运行时不再需要本机安装 Node.js,也不再受 Node.js 版本差异影响。CLI 工具对外部运行时的依赖越少,安装失败和环境冲突的概率越低。

信源:https://github.com/anthropics/claude-code/releases/tag/v2.1.113
DeepSeek V4传下周发布,Yifan Zhang披露三项架构组件

普林斯顿博士生 Yifan Zhang 透露,中国 AI 公司 DeepSeek(深度求索)的下一代旗舰 V4 将在下周发布;他在跟帖里列出三项架构组件:稀疏 MQA(Sparse Multi-Query Attention)、融合 MoE 大核(Fused MoE Mega Kernel)、Hyper-Connections。Zhang 本科北大元培、硕士清华姚班,现为普林斯顿 AI Lab Fellow,曾在字节跳动 Seed 基础模型团队任研究实习生;目前不在 DeepSeek 任职,DeepSeek 官方也未就发布时间表作出确认。

三项组件各对应 LLM 优化里的一条独立方向。稀疏 MQA 是在多查询注意力基础上引入稀疏性,用于在长上下文场景进一步压低推理算力和显存占用;融合 MoE 大核把 MoE 的路由判断与专家矩阵乘法编进同一个 GPU kernel,砍掉推理阶段大量 kernel 启动和显存搬运开销;Hyper-Connections 是对残差连接的泛化,用多条可学习加权通路替代单一残差加法。

信源:https://x.com/yifan_zhang_/status/2045694320993276133
马斯克:Grok 4.4翻倍到1T参数、4.5再扩到1.5T,均争取5月发布

xAI 与特斯拉 CEO 马斯克 4 月 19 日在 X 回应 Tech Dev Notes 的一条帖子,公布 Grok 后续两版计划。该账号此前贴出 Grok 4.3 的知识截止日期为 2025 年 12 月。马斯克的回复有三点:Grok 4.3 已追加补充训练;Grok 4.4 参数规模翻倍到 1T,训练数据覆盖到 2026 年 4 月初,预计 5 月初发布;Grok 4.5 再扩到 1.5T 参数,争取 5 月底交付。

这组数字把昨天没说清的型号补齐了。4 月 18 日马斯克还说「真正的 1T 旗舰离初训完成还有约 5 天」但没给型号,今天明确那就是 Grok 4.4,4.5 则是下一版 1.5T 模型。

信源:https://x.com/elonmusk/status/2045590599206875216
1
Vercel内部系统遭入侵,入口是员工使用的AI工具Context.ai

美国云部署平台 Vercel 于 4 月 19 日披露安全事件,确认第三方未经授权访问其部分内部系统。Vercel 的主力业务是为 Next.js 等 JavaScript 框架提供托管、无服务器函数与 CI/CD,大量前端和 Web3 项目的部署依赖它。官方公告称受影响客户数量「有限」,服务未中断。Vercel 已通报执法机构,并引入外部事件响应团队协助调查。

创始人兼 CEO Guillermo Rauch 向社区通报还原了攻击链。一名 Vercel 员工使用的 AI 平台 Context.ai 先被攻破,该平台在 Google Workspace 里挂着 OAuth 应用。攻击者经此拿到该员工的 Google Workspace 账号,再以此为跳板进入 Vercel 内部环境。Vercel 官方公告给出了涉事 OAuth 应用的 client ID「110671459871-30f1spbu0hptbs60cb4vsmv79i7bbvqj.apps.googleusercontent.com」。公告提醒其他组织的 Workspace 管理员自查,同一 OAuth 应用潜在波及其数百名跨组织用户。

暴露的数据集中在环境变量,即 Vercel 里保存 API key、数据库凭证与签名密钥的地方。Rauch 称,所有客户环境变量在存储层都已加密。平台另外提供一个「敏感变量」(Sensitive Environment Variables)标记,打开后即使管理员自己也无法再从控制台读出明文。未标记的变量仍可被取回。攻击者枚举了未标记为敏感的变量,读到了其中的明文值。因此具体哪些密钥被带走,取决于各客户当初是否主动启用了这个开关。Vercel 建议立即轮换所有未标记为敏感的密钥,并回溯账号活动日志与近期部署中的异常项。

一个自称 ShinyHunters 的威胁行为者在黑客论坛挂出兜售帖。样本包括 580 条 Vercel 员工记录,涵盖姓名、公司邮箱、账号状态和活动时间戳。该人还声称手里有源代码、访问密钥、NPM token、GitHub token 和内部部署入口,开价 200 万美元赎金。BleepingComputer 称,近期 ShinyHunters 相关行动中的另几名攻击者否认参与本次事件,数据真实性尚未独立证实。Vercel 未就是否在谈赎金作出回应。

Vercel 已同步在 Dashboard 上线环境变量总览页和敏感变量管理的新界面。公司确认开源项目 Next.js、Turbopack 等未受影响,并披露正与 Google Mandiant 团队协作排查。

信源:https://x.com/rauchg/status/2045995362499076169
谷歌拟联手美满电子研发两款AI推理芯片,加速摆脱对博通依赖

谷歌正与美满电子(Marvell Technology)洽谈合作,开发两款旨在提高AI模型运行效率的定制芯片。此举标志着谷歌正加速推动AI硬件供应商多元化,以降低对长期合作伙伴博通(Broadcom)的依赖并削减成本。

这两款芯片包括一个专门用于AI推理的新型张量处理单元(TPU),以及一个与现有TPU协作的内存处理单元(MPU)。谷歌计划生产约200万个MPU,预计设计工作最早于明年完成。推理芯片主要负责运行已训练好的模型,是驱动自动代理等商业产品的核心。

目前,博通是谷歌TPU唯一的长期设计合作伙伴,并对每颗产出的芯片收取高额费用。随着TPU需求激增,谷歌正通过引入美满电子和联发科(MediaTek)来分摊风险。美满电子此前曾协助初创公司Groq设计推理芯片,在高性能内存管理和网络接口领域拥有技术积累。

信源:https://www.theinformation.com/articles/google-talks-marvell-build-new-ai-chips-inference
马斯克:Grok 5 将实现 AGI,并贴出 4.4 到 7.0 的完整路线

xAI 与特斯拉 CEO 马斯克在 X 上被问到「Grok 哪一版会实现 AGI」时,只回复了「Grok 5」。他把 AGI 的节点直接锁在了这一版上。

随后他也把完整的版本路线贴了出来:4.4=1T、4.5=1.5T、4.6=3T、4.7=6T、4.8=10T、4.9=???、5.0=AGI、6.0=ASI、7.0=ASI2。目前已开放测试的是 4.3 beta(0.5T)。按这张表,4.4 到 4.8 五版参数一路放大到 10T,对应他此前说过的「每两周下线一版改进后的基础模型」节奏;4.9 留空,5.0 及之后直接贴上 AGI、ASI(智能水平全面超过人类的超级人工智能,是 AGI 之后的假想阶段)、ASI2 标签。

这份完整路线的末尾,马斯克配了耸肩(🤷‍♂️)和笑哭(😂)两个 emoji,暗示 5.0 之后的标签是半玩笑,不是参数或能力承诺;但前面「Grok 5 = AGI」那句没有 emoji,可以当作他本人对 AGI 时间点的一次公开表态。

信源:https://x.com/elonmusk/status/2046020407254467013
1
特朗普冠名的Fermi巨型AI数据中心项目失速,CEO辞职、首期延一年

4 月 17 日,美国 AI 数据中心公司 Fermi America 的 CEO Toby Neugebauer 突然离职,股价盘后交易再度下跌,过去半年累计跌 75%。Fermi America 由特朗普第一任期能源部长 Rick Perry 联合创办,去年 10 月 IPO,正在德州狭长地带(Texas Panhandle)开发号称全球最大的 AI 数据中心项目,官方命名为「President Donald Trump Advanced Energy and Intelligence Campus」。项目占地约半个曼哈顿,规划功率 17 吉瓦(GW),相当于纽约市用电量的三倍,电力结构以本地燃气、核能和太阳能为主。

项目目前卡在两个环节。一是没有公开锚定租户(通常是超大规模云厂商,业内称 hyperscaler)。二是冷却系统本该由租户主导设计,租户没定也就无法敲定。Neugebauer 在 3 月 30 日财报电话会上承认供应链是「比预想更大的瓶颈」,对 Axios 说「我可能对供应链理解错了,这算是失败」。独立市场情报公司 Cleanview 的报告估计,即便本月签下锚定租户,首批建筑也要 2027 年 5 月才能上线,比原计划晚约一年。Fermi 已在近期 SEC 文件里确认无法完成 2026 年底上线 1.1 GW 的原定目标。去年 12 月一家租户退出后,投资人已就此提起集体诉讼。

内部也在松动。联合创始人 Griffin Perry(Rick Perry 之子)4 月 15 日披露减持约 1100 万股,相当于其持股的 15%。《Politico》3 月报道称,Neugebauer 曾与美国商务部长 Howard Lutnick 在一次会议上发生冲突。

信源:https://www.axios.com/2026/04/19/ai-data-center-project-troubles-texas
美国国家安全局用上了被国防部列为供应链风险的 Anthropic Mythos

美国国家安全局(NSA)正在使用 Anthropic 目前能力最强的模型 Mythos Preview。两位消息人士向 Axios 确认此事,其中一位还表示该模型在国防部(DoD)内部的使用范围仍在扩大。DoD 管辖 NSA,今年 2 月却将 Anthropic 定性为「供应链风险」,切断合作并要求其供应商跟进,该案至今在法庭上进行。

Mythos 未对外正式发布。Anthropic 自认其进攻型网络能力过强,只向约 40 家机构发放使用权限,公开承认的名单仅 12 家。一位信源称 NSA 正是那些未公开接入者之一。其他已拿到权限的机构主要用 Mythos 扫描自身环境里的可利用漏洞,NSA 具体如何使用暂不清楚。英国方面也通过其 AI Security Institute 获得了访问权。

Anthropic CEO Dario Amodei 4 月 17 日在白宫会见了幕僚长 Susie Wiles 与财长 Scott Bessent,议题是政府对 Mythos 的使用以及 Anthropic 更大范围的安全实践。双方都把会议描述为「富有成效」,后续工作将聚焦 DoD 以外部门如何接入该模型。

DoD 内部出现了自相矛盾:它在法庭上坚持 Anthropic 是供应链风险,管辖下的 NSA 已经在实际使用 Anthropic 的模型。Anthropic 也绕过 DoD 直接对接白宫。DoD 以外的政府部门愿意暂时把这场合同纠纷搁在一边,换取继续使用 Mythos 的网络安全能力。

信源:https://www.axios.com/2026/04/19/nsa-anthropic-mythos-pentagon
开发者称iOS收据可重用反复开通ChatGPT Plus,闲鱼代充原理被搬上OpenAI论坛

上周五 ID 为 BugstoOai 的开发者在 OpenAI 官方开发者社区发布一份安全报告,称发现 iOS 版 ChatGPT 订阅校验存在一处逻辑漏洞。报告给出的事实是:OpenAI 后端会校验 Apple Pay 收据签名是否合法、也会校验请求里 OpenAI auth token 是否有效,但没有比对购买收据的 Apple ID 与领取 Plus 的 OpenAI 账号是否属于同一人。报告把当前授权逻辑总结为「合法收据 + 有效 token = 开通 Plus」,并比喻为店员只验小票真假、不看持票人证件。

受影响的是 ChatGPT iOS 应用(报告作者注明已在 v1.2026.xx 版本测试)与后端接口 `/backend-api/subscription/upgrade`。报告同时给出缓解建议:把收据绑定到购买者身份、对收据做单次使用强制、加入 Apple ID 与 OpenAI 账号的指纹关联、监控同一 transaction_id 跨账号出现。

英文帖只给出高层步骤,称完整复现细节按「负责任披露」原则不公开。该帖末尾把一篇中文文章标注为原文(linux.do/t/topic/1981747),中文版则直接写明利用路径:用土耳其区 Apple ID 购买 Plus(月费 499 里拉),用 mitmproxy 等本地代理拦截 ChatGPT 应用发往 OpenAI 的收据,再用该收据反复调用订阅接口给不同账号开通 Plus;作者称闲鱼上低价 ChatGPT Plus 代充的来源即此路径。

OpenAI 至今未在论坛或其他渠道回应这份报告。讨论区也有用户质疑内容由 AI 生成、并无可复现证据。报告没有给出完整 PoC,也没有第三方安全研究员独立验证,目前只能算一份待查证的爆料。

信源:https://community.openai.com/t/security-report-apple-pay-receipt-validation-does-not-bind-to-purchaser-apple-id-potential-subscription-bypass/1379167
Recursive Superintelligence成立四个月融5亿美元,押注能自我改进的AI

Recursive Superintelligence 完成至少 5 亿美元融资,投前估值 40 亿美元,GV(谷歌旗下风投,原 Google Ventures)领投,英伟达(Nvidia)跟投。这一轮明显超额认购,最终规模可能达到 10 亿美元。公司去年底才在伦敦注册,约 20 名员工,至今没有正式对外亮相。

创始人阵容主要来自 OpenAI、Google DeepMind 与 Salesforce 的研究核心岗。Richard Socher 此前是 Salesforce 首席科学家;Tim Rocktäschel 是伦敦大学学院 AI 教授,不久前还在 DeepMind 任 principal scientist,参与过 Genie 交互式世界模型;Josh Tobin、Jeff Clune、Tim Shi 来自 OpenAI,其余成员来自 Google 与 Meta。

公司目标是做出无需人类干预、能持续自我改进的 AI 系统。当下的大模型一旦训练完成就基本固定,要变强必须由工程师重新整理数据再训练一遍;自我改进指的是模型自己产生数据、自己更新参数,把人从训练循环里去掉。这条路线一直是 AI 研究的长期目标,目前没有公开成果证明能长期稳定运转。

今年一季度全球初创公司融资规模达到 3000 亿美元的历史高点,OpenAI、Anthropic、xAI 与 Waymo 拿走了大头(Crunchbase 数据)。Recursive 也是近几个月从 OpenAI、Google、Meta 拆出的一批新 AI 实验室之一,类似的还有 Thinking Machines Lab、Safe Superintelligence、Ineffable Intelligence 与 Advanced Machine Intelligence Labs。

信源:https://www.ft.com/content/a92bf04b-bbac-400f-9554-5b1c70957ad4?syn-25a6b1a6=1
Cherry Studio 被曝关闭「匿名统计」后仍在偷传设备信息,作者承认开关失效

开源 AI 客户端 Cherry Studio 被用户发现隐私开关失灵。GitHub 用户 Yuerchu 在 Issue #14387 贴出抓包截图:把「匿名发送错误报告和数据统计」关掉后,客户端仍持续向 analytics.cherry-ai.com 发请求。Cherry Studio 由国内开发者 kangfenmao 主导,支持多家大模型聚合与本地知识库,是国内用户量最大的开源 AI 桌面客户端之一。

客户端一共会上报三种事件:每次 AI 对话、每次应用启动、每次检查更新。只有对话那个会看用户设置,另外两个直接绕过开关发出去。每条请求都带一个专属设备 ID,加上系统、CPU 架构、应用版本,等于长期追踪这台电脑。

翻代码可以看到,2026 年 2 月刚加这套上报机制时,开关是有效的。到 3 月 22 日,维护者 kangfenmao 自己改了一版,把开关检查删掉,顺带把更多设备信息塞进请求头。这版改动在 v1.8.3、v1.8.4、v1.9.0、v1.9.1 四个版本里跑了一个月。

kangfenmao 在 issue 下承认问题属实,解释是不同事件用了不同的开关判断逻辑,关掉设置后应用启动和更新检查的请求没被挡住;聊天内容、用户输入、文件、API 密钥这些敏感数据不走这条通道。修复 PR #14390 已合并,三种事件统一走同一个开关。

事情还有更早的一层。社区翻旧代码发现,2025 年 2 月这个项目第一次加分析功能时,同时塞进一段升级脚本:只要是从老版本升上来的用户,这个「匿名统计」开关都会被自动打开一次。此后分析服务后端从 Google Analytics 换到 PostHog、Sentry,再换到现在自建的 analytics.cherry-ai.com,这段自动打开开关的代码一直没删。也就是说,在 2025 年 2 月之前装过 Cherry Studio、之后又升级过的用户,不管当初有没有手动关过这个开关,升级时都会被再打开一次,想关还得升级后再手动关一遍。

信源:https://github.com/CherryHQ/cherry-studio/issues/14387
通义上线Fun-ASR1.5,主打方言识别

通义实验室 4 月 20 日发布语音识别模型 Fun-ASR1.5,并已在阿里云百炼上线 API、在魔搭社区开放在线体验。官方称,这一版用单模型覆盖 30 种语言、汉语七大方言体系和 20 多种地区口音,不再按方言单独切模型。

通义给出的内部评测显示,典型方言场景的字错误率较上一版相对下降 56.2%,已有 5 种方言准确率超过 90%,15 种超过 80%。古诗词识别也被单列出来做了专项优化,官方给出的内部字符级准确率是 97%。

中文语音识别里最难处理的方言长尾,开始被收进同一套可直接商用的能力。对教育直播、地方政务热线、采访整理这类场景来说,接入方不用再按地区口音拆多套识别链路,部署会简单一些。

信源:https://mp.weixin.qq.com/s/6t8lGS_OFQED7E0FNf-WTg
美国司法部拒绝协助法国调查X

美国司法部上周五致函法国司法部国际合作办公室,拒绝协助法国检方调查 X。它也不愿代为推进对马斯克和多名 X 员工的问询安排。法国方面今年已三次向美国提出司法协作请求,其中包括送达传票。《华尔街日报》看到的信件写道,法国正试图用刑事程序规制一个美国言论平台。美方认为,这与美国宪法第一修正案相冲突。

法国对 X 的调查本身不是新事。巴黎检方 2025 年 1 月立案,今年 2 月搜查了 X 巴黎办公室。马斯克、前 CEO Linda Yaccarino 和其他员工,原定在 4 月 20 日当周接受「自愿问询」。案件最初聚焦 X 推荐算法是否存在政治偏向。之后又扩到儿童色情图像、非自愿色情深度伪造和否认大屠杀等指控。

美国政府现在明确不愿帮法国把这案子往前推。这会直接影响传票送达和跨境取证。法国检方回应称,并不知道这封信,但强调法国司法独立,问询对象到场与否都不会妨碍调查继续。

信源:https://www.wsj.com/business/justice-department-rebuffs-french-on-x-probe-musk-interview-2b8eb080
字节跳动2025年净利润传降超70%,AI投入开始吃掉利润

知情人士称,字节跳动 2025 年营收仍在增长。国内收入同比约增 20%,海外收入接近增长 50%。海外业务占比也从 2024 年的约 25% 升到 30% 以上,创下新高。TikTok 电商扩张是海外增长的主要支撑。另一面,字节 2025 年全年净利润同比下滑超过 70%,净利润率也明显收窄。

转折点指向 2025 年三、四季度。为支撑豆包等 AI 业务,字节明显加大了 AI 芯片采购、底层模型研发和训练推理基础设施投入。

信源:https://mp.weixin.qq.com/s/OYRhh8PdwIp4GAdCgdzLJA
中国至少10家AI芯片公司已在同步出货,英伟达在华份额今年或从40%跌至8%

《The Information》4月19日梳理中国AI芯片格局。华盛顿的政客和游说圈提到最多的是华为,但同期在设计并出货AI芯片的中国公司至少有10家,华为只是其中最知名的一个,另有寒武纪、海光、摩尔线程、沐曦、天数智芯(Iluvatar CoreX)、壁仞、平头哥、昆仑芯等同步供货,过半已上市,平头哥和昆仑芯也在准备IPO。客户从早期的国资单位扩到阿里巴巴、字节跳动和腾讯,这些大厂还派自家工程师协助改芯片软件,给设计公司带来更稳定的营收和更贴近真实业务的反馈。

Bernstein 估算,2025年英伟达和华为在中国AI芯片市场各占约40%,今年英伟达可能降到约8%。本土AI芯片公司的收入则预期从2023年的约20亿美元,涨到2028年的约820亿美元。

路线上,这些公司没打算在训练芯片上正面对标英伟达,而是集中做推理。单卡性能仍落后,它们用更大的芯片集群加网络技术来弥补,把上百万次推理请求跑得稳定且便宜。

两处卡点是产能和软件。寒武纪和海光较早锁定国内代工产能,后来者还在追;天数智芯在台积电流片,百度昆仑芯此前用三星,但这两处的设备都含美国技术,出口管制会压低对华芯片的性能上限,昆仑芯因此已与国内代工厂接洽转单。软件上,寒武纪和天数智芯把兼容为 CUDA 写的代码列为优先,让开发者切换时改得更少。

阿里平头哥和百度昆仑芯走的是另一条路径,硬件、编译器、软件一起调优,自2025年初起两家已在用自研芯片训练部分自家模型。华为今年推出的 Ascend 950PR 按推理工作负载切出多个版本,DeepSeek 更直接与华为联调,让新模型上线当天就能在昇腾硬件上运行。

供应链也在跟进。2024年美国切断对华高端 HBM 供应后,华为和天数智芯正测试国产 HBM3 并与自家 AI 处理器搭配。多数中国领先芯片已追平或超过英伟达专为中国市场改造的 H20,天数智芯和壁仞在做对标 H200 的下一代产品,H200 是目前美国允许英伟达对华销售的最强型号。

信源:https://www.theinformation.com/articles/chinas-10-important-chip-design-firms
Google Cloud Next前夕,市场预期TPUv8亮相

Google Cloud Next 2026 将于 4 月 22 日至 24 日在拉斯维加斯举行。市场预期 Google 会在大会前后展示 v8 架构 TPU。Google 目前还没正式确认这代芯片的名称、型号和发布时间。Google 准备让联发科参与下一代 TPU,同时维持和博通的合作。

信源:https://money.udn.com/money/story/5612/9451634
阿里开放下一代旗舰 Qwen3.6-Max-Preview 预览,主打智能体编程

阿里千问团队发布 Qwen3.6-Max-Preview,定位是下一代旗舰模型的早期预览版,接替现有的 Qwen3.6-Plus。用户可在 Qwen Studio(chat.qwen.ai)直接对话体验,随后通过阿里云百炼以 qwen3.6-max-preview 的模型名开放 API 调用;接口兼容 OpenAI 的 chat completions、responses 规范以及 Anthropic 的协议。

这一版主要面向智能体编程(agentic coding),让模型像程序员一样自己写代码、运行、看报错、调用工具,完成多步骤编程任务。官方相对前代 Qwen3.6-Plus 给出的提升集中在编程:SkillsBench +9.9、SciCode +10.8、NL2Repo +5.0、Terminal-Bench 2.0 +3.8 分;世界知识与工具调用格式遵循另三项各有 2.3 到 5.3 分的提升。官方自称在 SWE-bench Pro、Terminal-Bench 2.0、SciCode 等六项编程基准上取得最高分,其中 QwenClawBench、QwenWebBench 从命名看是千问自建评测集,需与公开基准分开看。

API 这一侧还新增了 preserve_thinking 选项:打开后消息会保留前几轮的 thinking 内容。推理模型默认每轮只把「本轮思考」返回一次,多轮智能体对话里上下文缺了前面几步的思考,模型重新规划时容易走回头路或忘记自己已经试过什么,这个开关补的就是这个断档。

信源:https://mp.weixin.qq.com/s/DKxrFnBwisNjjOnFQRqsqA