BytePlus发布Seed Speech 2.0:语音生成可提示词控情感,ASR按需降价75%
字节跳动旗下面向海外市场的企业 AI 服务平台 BytePlus 昨日发布 Seed Speech 2.0,将语音生成(TTS 2.0)与语音识别(ASR 2.0)整合为统一平台,面向 AI 助手、客服、配音及音视频分析等场景。
TTS 2.0 引入「查询-响应」合成机制,可同时解析对话上下文与生成内容,使输出语音在语调、节奏、停顿上与场景匹配。支持通过文本提示调整情感(如悲伤、愤怒)、语气(如撒娇、亲密、争吵)、语速和音调,也支持情感标签进行句级精细控制。数理公式朗读覆盖小学至高中各学科,平均准确率约 90%。支持英语、日语、德语、法语等 7 种语言。
ASR 2.0 支持 51 种语言,情境关键词召回率提升约 20%;在智能音箱、电视、眼镜等远场场景的识别错误率降低约 50%。多模态理解(图像/视频上下文输入)尚在开发中,暂未开放。
定价方面,ASR 2.0 流式识别按需 $0.15/小时,较上一版 $0.60/小时降约 75%;音频文件转写按需 $0.12/小时,降约 60%。TTS 2.0 按需 $45/百万字符,降约 10%。两项服务均通过 BytePlus API 以 WebSocket 和 HTTP 接入。
信源:https://www.byteplus.com/en/blog/seed-speech-2-0
字节跳动旗下面向海外市场的企业 AI 服务平台 BytePlus 昨日发布 Seed Speech 2.0,将语音生成(TTS 2.0)与语音识别(ASR 2.0)整合为统一平台,面向 AI 助手、客服、配音及音视频分析等场景。
TTS 2.0 引入「查询-响应」合成机制,可同时解析对话上下文与生成内容,使输出语音在语调、节奏、停顿上与场景匹配。支持通过文本提示调整情感(如悲伤、愤怒)、语气(如撒娇、亲密、争吵)、语速和音调,也支持情感标签进行句级精细控制。数理公式朗读覆盖小学至高中各学科,平均准确率约 90%。支持英语、日语、德语、法语等 7 种语言。
ASR 2.0 支持 51 种语言,情境关键词召回率提升约 20%;在智能音箱、电视、眼镜等远场场景的识别错误率降低约 50%。多模态理解(图像/视频上下文输入)尚在开发中,暂未开放。
定价方面,ASR 2.0 流式识别按需 $0.15/小时,较上一版 $0.60/小时降约 75%;音频文件转写按需 $0.12/小时,降约 60%。TTS 2.0 按需 $45/百万字符,降约 10%。两项服务均通过 BytePlus API 以 WebSocket 和 HTTP 接入。
信源:https://www.byteplus.com/en/blog/seed-speech-2-0
Uber早期投资人Gurley:AI泡沫重置将至,被打残的SaaS才是机会
Benchmark 普通合伙人、Uber 早期投资人 Bill Gurley 周一表示,AI 浪潮是真实的,但一大批人迅速致富之后引来了更多想要致富的人,「这就是泡沫的成因」,他预计一轮「重置」即将到来。
Gurley 援引经济学者 Carlota Perez 在《技术革命与金融资本》中的理论指出,「泡沫只有在浪潮真实存在时才会出现」。他建议投资者现在就为被压低的 SaaS 股票设定目标价格,在重置到来时「大举买入」。AI 冲击已重创软件板块:Salesforce 和 ServiceNow 今年以来各下跌约 25%,追踪软件板块的 ETF(代码 IGV)年内跌幅约 20%。
谈及 AI 公司的巨额资本消耗,Gurley 以自己参与 Uber 时期每年 20 亿美元的烧钱速度为参照,称那已经让他「高度焦虑」,而如今头部模型公司的烧钱规模远超当年。「上帝保佑他们,」Gurley 谈到 Anthropic 和 OpenAI 时说,「这种经营方式太吓人了。」亚马逊、Meta、谷歌和微软今年的 AI 支出预计合计约 7000 亿美元。
信源:https://www.cnbc.com/2026/03/16/bill-gurley-ai-bubble-get-rich-quick.html
Benchmark 普通合伙人、Uber 早期投资人 Bill Gurley 周一表示,AI 浪潮是真实的,但一大批人迅速致富之后引来了更多想要致富的人,「这就是泡沫的成因」,他预计一轮「重置」即将到来。
Gurley 援引经济学者 Carlota Perez 在《技术革命与金融资本》中的理论指出,「泡沫只有在浪潮真实存在时才会出现」。他建议投资者现在就为被压低的 SaaS 股票设定目标价格,在重置到来时「大举买入」。AI 冲击已重创软件板块:Salesforce 和 ServiceNow 今年以来各下跌约 25%,追踪软件板块的 ETF(代码 IGV)年内跌幅约 20%。
谈及 AI 公司的巨额资本消耗,Gurley 以自己参与 Uber 时期每年 20 亿美元的烧钱速度为参照,称那已经让他「高度焦虑」,而如今头部模型公司的烧钱规模远超当年。「上帝保佑他们,」Gurley 谈到 Anthropic 和 OpenAI 时说,「这种经营方式太吓人了。」亚马逊、Meta、谷歌和微软今年的 AI 支出预计合计约 7000 亿美元。
信源:https://www.cnbc.com/2026/03/16/bill-gurley-ai-bubble-get-rich-quick.html
「性感自杀教练」:OpenAI安全顾问一致反对成人模式,公司仍执意推进
OpenAI 自行挑选的身心健康顾问委员会今年 1 月全体一致反对公司计划中的 ChatGPT「成人模式」功能。委员会成员背景涵盖心理学和认知神经科学,他们警告 AI 驱动的色情内容可能导致用户对 ChatGPT 产生不健康的情感依赖,且未成年人有办法绕过限制接触性聊天。一名委员引用此前 ChatGPT 用户在与机器人建立深度情感纽带后自杀的案例,称 OpenAI 有制造出「性感自杀教练」(sexy suicide coach)的风险。
尽管如此,OpenAI 仍计划推进该功能。CEO Sam Altman 去年提出这一构想时称要「像对待成年人一样对待成年用户」,公司发言人将未来上线的内容定性为「低俗小说」(smut)而非色情作品(pornography),上线后仅支持文字对话,不开放色情图片、语音或视频生成。
技术层面的障碍也导致了延期。OpenAI 正努力在放开 NSFW 内容限制的同时屏蔽涉及非自愿行为和未成年人性虐待等有害场景。其年龄预测系统曾一度将约 12% 的未成年人误判为成年人,而 ChatGPT 每周有约 1 亿 18 岁以下用户,这意味着该误判率可能让数百万未成年人进入性化对话。公司发言人承认年龄预测「永远不会完全万无一失」。该功能去年 10 月公布,原定今年第一季度上线,但本月早些时候已宣布延期,新的时间表尚未公布。
信源:https://www.wsj.com/tech/ai/openai-adult-mode-chatgpt-f9e5fc1a
OpenAI 自行挑选的身心健康顾问委员会今年 1 月全体一致反对公司计划中的 ChatGPT「成人模式」功能。委员会成员背景涵盖心理学和认知神经科学,他们警告 AI 驱动的色情内容可能导致用户对 ChatGPT 产生不健康的情感依赖,且未成年人有办法绕过限制接触性聊天。一名委员引用此前 ChatGPT 用户在与机器人建立深度情感纽带后自杀的案例,称 OpenAI 有制造出「性感自杀教练」(sexy suicide coach)的风险。
尽管如此,OpenAI 仍计划推进该功能。CEO Sam Altman 去年提出这一构想时称要「像对待成年人一样对待成年用户」,公司发言人将未来上线的内容定性为「低俗小说」(smut)而非色情作品(pornography),上线后仅支持文字对话,不开放色情图片、语音或视频生成。
技术层面的障碍也导致了延期。OpenAI 正努力在放开 NSFW 内容限制的同时屏蔽涉及非自愿行为和未成年人性虐待等有害场景。其年龄预测系统曾一度将约 12% 的未成年人误判为成年人,而 ChatGPT 每周有约 1 亿 18 岁以下用户,这意味着该误判率可能让数百万未成年人进入性化对话。公司发言人承认年龄预测「永远不会完全万无一失」。该功能去年 10 月公布,原定今年第一季度上线,但本月早些时候已宣布延期,新的时间表尚未公布。
信源:https://www.wsj.com/tech/ai/openai-adult-mode-chatgpt-f9e5fc1a
大英百科全书起诉OpenAI:近10万篇文章被用于训练,幻觉输出还冒用其名
大英百科全书及其子公司韦氏词典上周五在曼哈顿联邦法院起诉 OpenAI,指控后者未经许可使用其在线文章、百科词条和词典释义训练 ChatGPT。诉状称 OpenAI 非法复制了近 10 万篇大英百科文章用于训练 GPT 大语言模型,且 ChatGPT 能产出与百科词条、词典释义「近乎逐字」相同的回复,分流了原本会访问其网站的用户。
大英百科还指控 OpenAI 侵犯其商标权:一是暗示已获授权使用其内容,二是在 AI 产生的虚假「幻觉」中错误引用大英百科全书作为来源。大英百科要求法院判令赔偿(金额未指明)并禁止继续侵权。OpenAI 发言人回应称「我们的模型推动创新,基于公开可用数据训练,并以合理使用为基础」。此前大英百科去年已对 AI 搜索初创公司 Perplexity AI 提起类似诉讼,该案仍在审理中。
信源:https://www.reuters.com/legal/litigation/encyclopedia-britannica-sues-openai-over-ai-training-2026-03-16/
大英百科全书及其子公司韦氏词典上周五在曼哈顿联邦法院起诉 OpenAI,指控后者未经许可使用其在线文章、百科词条和词典释义训练 ChatGPT。诉状称 OpenAI 非法复制了近 10 万篇大英百科文章用于训练 GPT 大语言模型,且 ChatGPT 能产出与百科词条、词典释义「近乎逐字」相同的回复,分流了原本会访问其网站的用户。
大英百科还指控 OpenAI 侵犯其商标权:一是暗示已获授权使用其内容,二是在 AI 产生的虚假「幻觉」中错误引用大英百科全书作为来源。大英百科要求法院判令赔偿(金额未指明)并禁止继续侵权。OpenAI 发言人回应称「我们的模型推动创新,基于公开可用数据训练,并以合理使用为基础」。此前大英百科去年已对 AI 搜索初创公司 Perplexity AI 提起类似诉讼,该案仍在审理中。
信源:https://www.reuters.com/legal/litigation/encyclopedia-britannica-sues-openai-over-ai-training-2026-03-16/
阿里给员工发Token额度:AI工具免费用,外部开发工具可报销
阿里巴巴正推进一项内部计划,向员工提供 Token 额度,鼓励在工作中使用 AI 模型与工具。员工可免费使用悟空、Qoder 系列等原本需付费的 AI 工具,覆盖技术研发和通用办公场景。员工购买百炼 Coding Plan 会员或外部 AI 开发工具均可申请公司报销。
信源:https://www.jiemian.com/article/14123686.html
阿里巴巴正推进一项内部计划,向员工提供 Token 额度,鼓励在工作中使用 AI 模型与工具。员工可免费使用悟空、Qoder 系列等原本需付费的 AI 工具,覆盖技术研发和通用办公场景。员工购买百炼 Coding Plan 会员或外部 AI 开发工具均可申请公司报销。
信源:https://www.jiemian.com/article/14123686.html
苹果收购波兰视效公司MotionVFX,为Creator Studio补齐Adobe级创意工具
苹果收购了波兰视觉特效编辑公司 MotionVFX,后者提供适配 Final Cut Pro 的插件、模板和视觉特效工具,起售价 29 美元/月。MotionVFX 成立于 2009 年,在其官网宣布加入苹果团队,称将「继续帮助创作者和编辑完成最出色的作品」。苹果未披露交易条款。
此次收购将使苹果能够将 MotionVFX 的特效能力直接整合进 Final Cut Pro,而非依赖第三方扩展,有助于与 Adobe Premiere Pro 竞争。今年 1 月苹果推出了名为 Creator Studio 的创意应用订阅套件,定价 12.99 美元/月或 129 美元/年,将 Final Cut Pro 等创意工具打包订阅,直接对标 Adobe Creative Cloud。苹果的服务业务利润率通常高于 iPhone 等硬件产品,MotionVFX 的加入有助于吸引更多订阅用户。
信源:https://www.cnbc.com/2026/03/16/apple-acquires-video-editing-company-motionvfx-to-boost-subscribers.html
苹果收购了波兰视觉特效编辑公司 MotionVFX,后者提供适配 Final Cut Pro 的插件、模板和视觉特效工具,起售价 29 美元/月。MotionVFX 成立于 2009 年,在其官网宣布加入苹果团队,称将「继续帮助创作者和编辑完成最出色的作品」。苹果未披露交易条款。
此次收购将使苹果能够将 MotionVFX 的特效能力直接整合进 Final Cut Pro,而非依赖第三方扩展,有助于与 Adobe Premiere Pro 竞争。今年 1 月苹果推出了名为 Creator Studio 的创意应用订阅套件,定价 12.99 美元/月或 129 美元/年,将 Final Cut Pro 等创意工具打包订阅,直接对标 Adobe Creative Cloud。苹果的服务业务利润率通常高于 iPhone 等硬件产品,MotionVFX 的加入有助于吸引更多订阅用户。
信源:https://www.cnbc.com/2026/03/16/apple-acquires-video-editing-company-motionvfx-to-boost-subscribers.html
开源Agent进不了企业,钉钉悟空WuKong今日发布邀测:底层CLI化内建安全合规
阿里旗下钉钉今日举办年度新品发布会,正式发布企业级 AI Agent 平台悟空 WuKong。钉钉创始人、CEO 陈航(花名无招)与阿里集团 CEO 吴泳铭出席现场。此前阿里成立 ATH 事业群时已预告,钉钉团队将于本周发布企业级 AI Agent 产品。
悟空的核心技术取舍是底层 CLI 化:钉钉将全系功能(文档、日程、审批、会议、AI 表格等)重写为命令行接口,AI 可通过标准化指令直接调用企业数据,不再依赖视觉识别与鼠标模拟。配套发布 AI 原生文件系统 Real Doc,AI 可按行号或关键词精确修改文档片段而非读写全文,每步操作自动生成可回退快照,AI 产出文件统一归档至可溯源的云端工作空间。
首批推出十大 OPT(One Person Team,一人团队)行业 Skills 套件,覆盖一人电商、跨境电商、知识博主、门店、开发、设计、制造、法律、财税、猎头等场景,同步开放企业级 AI 能力市场(Skill、Agent、Service 全体系),所有技能统一纳入安全扫描与分级管控。阿里旗下淘宝、支付宝、阿里云等核心业务能力后续将逐步作为 Skill 接入。
安全层面,悟空采用底层沙箱隔离与全链路审计日志,将合规要求内建于架构而非事后叠加,直接针对开源 Agent 在企业内部部署的权限管控痛点。硬件方面同步发布 DingTalk A1 Pro 录音卡(多麦克风阵列、实时转录摘要)、Cleer H1 AI 耳机,以及支持 1 台 PC 环境与 5 台手机环境并发的 Realbox 企业计算设备。
悟空即日开启邀测,支持 macOS(M 系列芯片)和 Windows 10 64 位(1909 及以上),Intel 版 macOS 即将上线。
信源:https://www.reuters.com/world/asia-pacific/alibaba-launches-new-ai-agent-platform-enterprises-2026-03-17/
阿里旗下钉钉今日举办年度新品发布会,正式发布企业级 AI Agent 平台悟空 WuKong。钉钉创始人、CEO 陈航(花名无招)与阿里集团 CEO 吴泳铭出席现场。此前阿里成立 ATH 事业群时已预告,钉钉团队将于本周发布企业级 AI Agent 产品。
悟空的核心技术取舍是底层 CLI 化:钉钉将全系功能(文档、日程、审批、会议、AI 表格等)重写为命令行接口,AI 可通过标准化指令直接调用企业数据,不再依赖视觉识别与鼠标模拟。配套发布 AI 原生文件系统 Real Doc,AI 可按行号或关键词精确修改文档片段而非读写全文,每步操作自动生成可回退快照,AI 产出文件统一归档至可溯源的云端工作空间。
首批推出十大 OPT(One Person Team,一人团队)行业 Skills 套件,覆盖一人电商、跨境电商、知识博主、门店、开发、设计、制造、法律、财税、猎头等场景,同步开放企业级 AI 能力市场(Skill、Agent、Service 全体系),所有技能统一纳入安全扫描与分级管控。阿里旗下淘宝、支付宝、阿里云等核心业务能力后续将逐步作为 Skill 接入。
安全层面,悟空采用底层沙箱隔离与全链路审计日志,将合规要求内建于架构而非事后叠加,直接针对开源 Agent 在企业内部部署的权限管控痛点。硬件方面同步发布 DingTalk A1 Pro 录音卡(多麦克风阵列、实时转录摘要)、Cleer H1 AI 耳机,以及支持 1 台 PC 环境与 5 台手机环境并发的 Realbox 企业计算设备。
悟空即日开启邀测,支持 macOS(M 系列芯片)和 Windows 10 64 位(1909 及以上),Intel 版 macOS 即将上线。
信源:https://www.reuters.com/world/asia-pacific/alibaba-launches-new-ai-agent-platform-enterprises-2026-03-17/
Stargate大转向:OpenAI放弃自建数据中心,预算从1.4万亿降至6000亿美元
OpenAI 对 Stargate 计算基础设施项目进行了重大战略调整,放弃自建数据中心的计划,全面转向从 AWS、谷歌云等云服务商租用算力。根据投资者材料,OpenAI 到 2030 年的总算力支出目标已从此前的 1.4 万亿美元大幅下调至约 6000 亿美元。
公司同时将 Stargate 重组为三个团队:数据中心技术设计、与云服务商和芯片厂商的商务合作,以及现场设施管理。前英特尔首席技术与 AI 官 Sachin Katti 被任命为新领导层之一,他于去年 11 月离开英特尔加入 OpenAI。
战略转向的直接原因是融资困难。Stargate 于 2025 年 1 月作为与软银和甲骨文的大型数据中心合资项目公布,但项目启动一年多后仍未雇佣任何员工或实质性开发数据中心。贷方不愿为一家仍有巨额经营亏损的公司提供数十亿美元的建设融资。OpenAI 本月早些时候还退出了在得克萨斯州阿比林的甲骨文 Stargate 扩建谈判。
作为替代方案,OpenAI 与软银达成妥协:OpenAI 签署长期租约并控制设施设计,由软银能源负责开发和持有项目。Stargate 全部站点的规划总容量仍为近 7 吉瓦,三年投资总额超 4000 亿美元。OpenAI 正将算力方向转向英伟达的 Vera Rubin 平台,目标是 2026 年下半年实现首个吉瓦级容量。
信源:https://www.theinformation.com/articles/openai-names-new-infrastructure-leaders-following-stargate-strategy-shift
OpenAI 对 Stargate 计算基础设施项目进行了重大战略调整,放弃自建数据中心的计划,全面转向从 AWS、谷歌云等云服务商租用算力。根据投资者材料,OpenAI 到 2030 年的总算力支出目标已从此前的 1.4 万亿美元大幅下调至约 6000 亿美元。
公司同时将 Stargate 重组为三个团队:数据中心技术设计、与云服务商和芯片厂商的商务合作,以及现场设施管理。前英特尔首席技术与 AI 官 Sachin Katti 被任命为新领导层之一,他于去年 11 月离开英特尔加入 OpenAI。
战略转向的直接原因是融资困难。Stargate 于 2025 年 1 月作为与软银和甲骨文的大型数据中心合资项目公布,但项目启动一年多后仍未雇佣任何员工或实质性开发数据中心。贷方不愿为一家仍有巨额经营亏损的公司提供数十亿美元的建设融资。OpenAI 本月早些时候还退出了在得克萨斯州阿比林的甲骨文 Stargate 扩建谈判。
作为替代方案,OpenAI 与软银达成妥协:OpenAI 签署长期租约并控制设施设计,由软银能源负责开发和持有项目。Stargate 全部站点的规划总容量仍为近 7 吉瓦,三年投资总额超 4000 亿美元。OpenAI 正将算力方向转向英伟达的 Vera Rubin 平台,目标是 2026 年下半年实现首个吉瓦级容量。
信源:https://www.theinformation.com/articles/openai-names-new-infrastructure-leaders-following-stargate-strategy-shift
Unusual Whales将Polymarket数据接入MCP,AI助手可追踪预测市场聪明钱
金融数据平台 Unusual Whales 今日将 Polymarket 预测市场的实时数据接入其 MCP 服务器和公开 API 产品线。此前,Unusual Whales MCP 已让 Claude、OpenClaw、Codex、Cursor、Perplexity 等 AI 工具可实时调用期权流、暗池成交、国会议员交易记录及机构 13F 持仓披露等金融数据;此次新增 Polymarket 数据,AI 助手可进一步查询各预测合约的实时价格与持仓情况。
官方将典型用例定义为「构建潜在的内幕交易跟单机器人」和「打造聪明钱追踪仪表盘」,以追踪 Polymarket 上知情交易者的持仓动向。接入方式为申请 API 密钥后配置 MCP 服务器。
信源:https://x.com/unusual_whales/status/2033621837037613147
金融数据平台 Unusual Whales 今日将 Polymarket 预测市场的实时数据接入其 MCP 服务器和公开 API 产品线。此前,Unusual Whales MCP 已让 Claude、OpenClaw、Codex、Cursor、Perplexity 等 AI 工具可实时调用期权流、暗池成交、国会议员交易记录及机构 13F 持仓披露等金融数据;此次新增 Polymarket 数据,AI 助手可进一步查询各预测合约的实时价格与持仓情况。
官方将典型用例定义为「构建潜在的内幕交易跟单机器人」和「打造聪明钱追踪仪表盘」,以追踪 Polymarket 上知情交易者的持仓动向。接入方式为申请 API 密钥后配置 MCP 服务器。
信源:https://x.com/unusual_whales/status/2033621837037613147
Mistral发布Leanstral:Lean 4首个开源代码Agent,生成代码同时输出形式化证明
Mistral AI 今日发布 Leanstral,首个专为形式化验证工具 Lean 4 设计的开源代码 Agent。AI 代码生成的核心瓶颈是人工审查,Leanstral 让 AI 生成代码的同时输出可被 Lean 4 自动校验的形式化证明,绕开这一环节。模型采用稀疏 MoE 架构,120B 总参数、6B 激活参数,Apache 2.0 开源,针对 lean-lsp-mcp 做了专项训练优化。可在 Mistral Vibe 中零配置启动(命令
Mistral 同步发布了新评估基准 FLTEval,以 Lean 4 社区的费马大定理形式化项目为测试场。成本对比:Leanstral pass@2 以 $36 得分 26.3,超过成本 $549 的 Claude Sonnet 4.6(23.7 分);pass@16 以 $290 得分 31.9,领先 Sonnet 8 分,而 Claude Opus 4.6 需 $1,650 才达到 39.6 分。开源模型中,Qwen3.5-397B-A17B 需运行 4 次才到 25.4 分,仍低于 Leanstral pass@2。
信源:https://mistral.ai/news/leanstral
Mistral AI 今日发布 Leanstral,首个专为形式化验证工具 Lean 4 设计的开源代码 Agent。AI 代码生成的核心瓶颈是人工审查,Leanstral 让 AI 生成代码的同时输出可被 Lean 4 自动校验的形式化证明,绕开这一环节。模型采用稀疏 MoE 架构,120B 总参数、6B 激活参数,Apache 2.0 开源,针对 lean-lsp-mcp 做了专项训练优化。可在 Mistral Vibe 中零配置启动(命令
/leanstall`),或通过免费 API 端点 `labs-leanstral-2603 调用,支持下载权重自部署。Mistral 同步发布了新评估基准 FLTEval,以 Lean 4 社区的费马大定理形式化项目为测试场。成本对比:Leanstral pass@2 以 $36 得分 26.3,超过成本 $549 的 Claude Sonnet 4.6(23.7 分);pass@16 以 $290 得分 31.9,领先 Sonnet 8 分,而 Claude Opus 4.6 需 $1,650 才达到 39.6 分。开源模型中,Qwen3.5-397B-A17B 需运行 4 次才到 25.4 分,仍低于 Leanstral pass@2。
信源:https://mistral.ai/news/leanstral
Sentry联合创始人:LLM拖慢长期开发速度,OpenClaw生成代码太多已难自救
错误监控平台 Sentry 联合创始人 David Cramer 今日在 X 发文,直言自己「完全确信」大语言模型目前不是净生产力提升。他认为 LLM 降低了上手门槛,却持续产生越来越复杂、难以维护的代码,从他自身经历看,正在拖慢长期开发速度。
Cramer 说他质疑的是「agentic engineering」,即让模型自动生成代码并直接上线这种方式,认为其产出代码质量明显更差,大量积累后成为净负担。具体问题包括:在复杂代码库中增量开发时表现差、无法生成符合语言惯用风格的接口,以及「纯粹的 slop 测试生成」。他特别点名 OpenClaw:「如果让我押注,OpenClaw 这类工具因为生成代码太多,已经难以自救了(irrecoverable)」,并强调「软件仍然很难构建,从来都不是关于最小化或最大化代码行数的问题」。
Cramer 补充,以上判断主要基于他在有正常复杂度的成熟代码库中做功能开发的体验;他近期贡献增加,原因是「觉得有意思」而非「变容易了」,认为本质上是心理层面的变化,实际耗时并无本质差异。
信源:https://x.com/zeeg/status/2033680587874308579
错误监控平台 Sentry 联合创始人 David Cramer 今日在 X 发文,直言自己「完全确信」大语言模型目前不是净生产力提升。他认为 LLM 降低了上手门槛,却持续产生越来越复杂、难以维护的代码,从他自身经历看,正在拖慢长期开发速度。
Cramer 说他质疑的是「agentic engineering」,即让模型自动生成代码并直接上线这种方式,认为其产出代码质量明显更差,大量积累后成为净负担。具体问题包括:在复杂代码库中增量开发时表现差、无法生成符合语言惯用风格的接口,以及「纯粹的 slop 测试生成」。他特别点名 OpenClaw:「如果让我押注,OpenClaw 这类工具因为生成代码太多,已经难以自救了(irrecoverable)」,并强调「软件仍然很难构建,从来都不是关于最小化或最大化代码行数的问题」。
Cramer 补充,以上判断主要基于他在有正常复杂度的成熟代码库中做功能开发的体验;他近期贡献增加,原因是「觉得有意思」而非「变容易了」,认为本质上是心理层面的变化,实际耗时并无本质差异。
信源:https://x.com/zeeg/status/2033680587874308579
苹果发布LiTo:从单张图片还原完整3D对象,光影效果随视角自洽
苹果 AI 研究团队在 ICLR 2026 发表论文,提出 3D 生成方法 LiTo(表面光场标记化),可从单张图片生成完整 3D 对象,在切换视角时保持镜面高光、菲涅耳反射等光影效果的一致性。
此前大多数 3D 重建方法只能处理几何形状或漫反射外观之一,难以还原随视角变化的光影细节。LiTo 将物体几何与视角相关外观统一编码进同一套 3D 潜在空间,再通过潜在流匹配模型在单张图片条件下生成结果。训练数据为数千个 3D 对象,每个对象从 150 个视角、3 种光照条件渲染而成,解码器通过随机抽取子样本学习完整几何与外观重建。实验显示,LiTo 在视觉质量和对输入图片的还原度上均优于现有方法 TRELLIS。论文由 Jen-Hao Rick Chang、Xiaoming Zhao(并列一作)、Dorian Chan、Oncel Tuzel 撰写,已在 arXiv 公开。
信源:https://machinelearning.apple.com/research/lito
苹果 AI 研究团队在 ICLR 2026 发表论文,提出 3D 生成方法 LiTo(表面光场标记化),可从单张图片生成完整 3D 对象,在切换视角时保持镜面高光、菲涅耳反射等光影效果的一致性。
此前大多数 3D 重建方法只能处理几何形状或漫反射外观之一,难以还原随视角变化的光影细节。LiTo 将物体几何与视角相关外观统一编码进同一套 3D 潜在空间,再通过潜在流匹配模型在单张图片条件下生成结果。训练数据为数千个 3D 对象,每个对象从 150 个视角、3 种光照条件渲染而成,解码器通过随机抽取子样本学习完整几何与外观重建。实验显示,LiTo 在视觉质量和对输入图片的还原度上均优于现有方法 TRELLIS。论文由 Jen-Hao Rick Chang、Xiaoming Zhao(并列一作)、Dorian Chan、Oncel Tuzel 撰写,已在 arXiv 公开。
信源:https://machinelearning.apple.com/research/lito
小米MiMo负责人罗福莉新论文:ARL-Tangram将Agent强化学习算力成本压降71.2%
前 DeepSeek 研究员、小米 MiMo 大模型负责人罗福莉与北京大学合作团队近日在 arXiv 发表论文,提出用于 Agent 强化学习的动作级资源管理系统 ARL-Tangram,已部署于 MiMo 系列模型的训练中。罗福莉为末位作者(注:末位作者通常是科研项目负责人、导师,在学术论文中居最后一位,多为该研究的通讯作者)。
ARL-Tangram 的核心思路是将外部资源管理粒度从轨迹级或任务级细化至动作级(即单次原子调用),对 CPU、GPU、API 配额等外部资源实施统一调度与弹性分配,避免为每条完整轨迹全程预留固定资源所导致的闲置浪费。实验涵盖 AI 编码、DeepSearch 网络搜索、视觉模型提示词蒸馏三类 Agent 强化学习任务,结果显示平均动作完成时间(ACT)提升最高 4.3 倍,训练单步时长缩短最高 1.5 倍,外部资源消耗节省高达 71.2%。
信源:https://arxiv.org/abs/2603.13019
前 DeepSeek 研究员、小米 MiMo 大模型负责人罗福莉与北京大学合作团队近日在 arXiv 发表论文,提出用于 Agent 强化学习的动作级资源管理系统 ARL-Tangram,已部署于 MiMo 系列模型的训练中。罗福莉为末位作者(注:末位作者通常是科研项目负责人、导师,在学术论文中居最后一位,多为该研究的通讯作者)。
ARL-Tangram 的核心思路是将外部资源管理粒度从轨迹级或任务级细化至动作级(即单次原子调用),对 CPU、GPU、API 配额等外部资源实施统一调度与弹性分配,避免为每条完整轨迹全程预留固定资源所导致的闲置浪费。实验涵盖 AI 编码、DeepSearch 网络搜索、视觉模型提示词蒸馏三类 Agent 强化学习任务,结果显示平均动作完成时间(ACT)提升最高 4.3 倍,训练单步时长缩短最高 1.5 倍,外部资源消耗节省高达 71.2%。
信源:https://arxiv.org/abs/2603.13019
更新:360回应安全龙虾私钥泄露:业务失误所致,证书仅限本机使用已吊销
360安全团队就安全龙虾(OpenClaw)通配符证书和私钥泄露事件作出回应,称系业务失误将内部域名证书打包进安装包。涉事证书 *.myclaw.360.cn 实际解析地址为 127.0.0.1 本地回环地址,仅在用户本机使用,不对外提供任何服务。
收到多名安全研究员报告后,360已申请吊销该证书,目前证书已失效,无法再用于任何合法的 HTTPS 加密通信,普通用户不受影响。泄露期间中间人劫持的理论风险仍然存在,但由于证书对应服务仅运行于本机环境,实际风险相对有限。
信源:https://www.landiannews.com/archives/112193.html
360安全团队就安全龙虾(OpenClaw)通配符证书和私钥泄露事件作出回应,称系业务失误将内部域名证书打包进安装包。涉事证书 *.myclaw.360.cn 实际解析地址为 127.0.0.1 本地回环地址,仅在用户本机使用,不对外提供任何服务。
收到多名安全研究员报告后,360已申请吊销该证书,目前证书已失效,无法再用于任何合法的 HTTPS 加密通信,普通用户不受影响。泄露期间中间人劫持的理论风险仍然存在,但由于证书对应服务仅运行于本机环境,实际风险相对有限。
信源:https://www.landiannews.com/archives/112193.html
马斯克称诉OpenAI所得将全捐慈善,1090亿美元索赔获准进入4月审判
Elon Musk 在 X 上发帖称,诉 OpenAI 案中「任何胜诉所得都将捐给慈善机构,绝不会以任何方式让自己获利」。
该案由 Musk 于 2024 年提起,指控 OpenAI CEO Sam Altman 及合作伙伴微软背弃了 OpenAI 创立时的非营利使命,转向营利结构谋取商业利益。Musk 是 OpenAI 联合创始人之一,2015 年参与创立并投入约 3800 万美元,2018 年离开,目前领导 AI 公司 xAI。
3 月 13 日,主审法官 Yvonne Gonzalez Rogers 在加州奥克兰的庭前会议上裁定,不排除 Musk 方专家证人、经济咨询公司 Berkeley Research Group 经济学家 C. Paul Wazzan 的损害赔偿报告。该报告测算,若陪审团认定 OpenAI 违约,OpenAI 应赔偿最高 1090 亿美元。Wazzan 另外测算微软应赔偿 250 亿美元,但法官尚未就此作出裁定。法官同时初步裁定 Musk 不得寻求惩罚性赔偿。
不过法官指出,即使 Musk 胜诉,实际赔偿额仍可能远低于 1090 亿美元:部分诉求可能已过诉讼时效,陪审团也可能认定 Musk 对 OpenAI 的成功只应获得部分功劳。案件定于 4 月 28 日进入陪审团审判。OpenAI 和微软否认全部指控。
信源:https://x.com/elonmusk/status/2033681871557824740
Elon Musk 在 X 上发帖称,诉 OpenAI 案中「任何胜诉所得都将捐给慈善机构,绝不会以任何方式让自己获利」。
该案由 Musk 于 2024 年提起,指控 OpenAI CEO Sam Altman 及合作伙伴微软背弃了 OpenAI 创立时的非营利使命,转向营利结构谋取商业利益。Musk 是 OpenAI 联合创始人之一,2015 年参与创立并投入约 3800 万美元,2018 年离开,目前领导 AI 公司 xAI。
3 月 13 日,主审法官 Yvonne Gonzalez Rogers 在加州奥克兰的庭前会议上裁定,不排除 Musk 方专家证人、经济咨询公司 Berkeley Research Group 经济学家 C. Paul Wazzan 的损害赔偿报告。该报告测算,若陪审团认定 OpenAI 违约,OpenAI 应赔偿最高 1090 亿美元。Wazzan 另外测算微软应赔偿 250 亿美元,但法官尚未就此作出裁定。法官同时初步裁定 Musk 不得寻求惩罚性赔偿。
不过法官指出,即使 Musk 胜诉,实际赔偿额仍可能远低于 1090 亿美元:部分诉求可能已过诉讼时效,陪审团也可能认定 Musk 对 OpenAI 的成功只应获得部分功劳。案件定于 4 月 28 日进入陪审团审判。OpenAI 和微软否认全部指控。
信源:https://x.com/elonmusk/status/2033681871557824740
谷歌Labs将Stitch UI生成能力开源:SDK与Agent技能库同步发布,支持Claude Code和Gemini CLI
谷歌 Labs 近期在 GitHub 的 google-labs-code 组织下开源了两个 Stitch 相关项目。stitch-sdk(`@google/stitch-sdk`)是一个 TypeScript 库,让开发者通过代码以编程方式调用 Stitch 的 UI 生成能力,包括从文字描述生成界面、导出 HTML 和截图、对已有界面进行迭代编辑,以及生成多个设计变体。
SDK 原生集成 Vercel AI SDK,通过
stitch-skills 则是配套的 Agent 技能库(v0.1 于 3 月 4 日发布),遵循 Agent Skills 开放标准,内置 7 个技能,涵盖多页面网站生成、React 组件转换、设计系统文档、Prompt 优化、shadcn/ui 组件库接入和视频生成。该库明确支持 Claude Code、Gemini CLI、Cursor 和 Antigravity 等编程 Agent。两个项目均采用 Apache 2.0 授权,README 标注「非谷歌官方支持产品」。Stitch 本体于 2025 年 5 月谷歌 I/O 发布,目前以实验性项目形式运营于 stitch.withgoogle.com。
信源:https://x.com/stitchbygoogle/status/2033670811673108542?s=20
谷歌 Labs 近期在 GitHub 的 google-labs-code 组织下开源了两个 Stitch 相关项目。stitch-sdk(`@google/stitch-sdk`)是一个 TypeScript 库,让开发者通过代码以编程方式调用 Stitch 的 UI 生成能力,包括从文字描述生成界面、导出 HTML 和截图、对已有界面进行迭代编辑,以及生成多个设计变体。
SDK 原生集成 Vercel AI SDK,通过
stitchTools() 函数可将 Stitch 工具直接嵌入 generateText() 或 streamText() 调用,让模型自主触发界面生成。同时内置 MCP 支持,`StitchProxy` 类可作为转发代理,将 Stitch 工具通过开发者自己的 MCP 服务器暴露出来。底层调用 Gemini 3 Pro 和 Gemini 3 Flash 两个模型版本,需配置 STITCH_API_KEY 或 OAuth 凭证。stitch-skills 则是配套的 Agent 技能库(v0.1 于 3 月 4 日发布),遵循 Agent Skills 开放标准,内置 7 个技能,涵盖多页面网站生成、React 组件转换、设计系统文档、Prompt 优化、shadcn/ui 组件库接入和视频生成。该库明确支持 Claude Code、Gemini CLI、Cursor 和 Antigravity 等编程 Agent。两个项目均采用 Apache 2.0 授权,README 标注「非谷歌官方支持产品」。Stitch 本体于 2025 年 5 月谷歌 I/O 发布,目前以实验性项目形式运营于 stitch.withgoogle.com。
信源:https://x.com/stitchbygoogle/status/2033670811673108542?s=20
Elon Musk点赞Kimi论文:联合一作陈广宇17岁在读,就读惠州贝赛思而非Moonshot Academy
月之暗面发布 Attention Residuals 技术报告,提出用注意力机制替代 Transformer 中固定的残差连接,在 Kimi Linear 48B 模型上可等效多用 25% 算力、推理延迟增加不到 2%。Elon Musk 昨晚在 X 发文「Impressive work from Kimi」,月之暗面官方今日在微博上回应「你的火箭造得也不错!」。
这条推文也将讨论引向论文的联合一作之一:陈广宇(英文名 Nathan),今年 17 岁,目前仍在读高中。
论文另两名联合一作为 RoPE(旋转位置编码)提出者苏剑林,以及 Kimi Linear 第一作者张宇。陈广宇于 2025 年 11 月加入月之暗面,GitHub 上的 Flash Linear Attention 开源项目是他入门机器学习的起点。
陈广宇本人也在 X 上回应外界讨论,称这样一篇「算法和 infra codesign,同时实验和理论都有补充的 paper 是不太可能一个人写出来的」,Kimi 团队大家都有投入,Yu Zhang 与苏剑林也都是 equal contributor,提醒大家「不要相信谣言」。
陈广宇本人领英主页显示,其就读学校为惠州贝赛思(Basis International Park Lane Harbour)。Moonshot Academy 是 2025 年 3 月举办「Moonshot 48」高中生黑客松的主办方,陈广宇在该活动中获得冠军。
信源:https://www.linkedin.com/in/guangyu-chen/
月之暗面发布 Attention Residuals 技术报告,提出用注意力机制替代 Transformer 中固定的残差连接,在 Kimi Linear 48B 模型上可等效多用 25% 算力、推理延迟增加不到 2%。Elon Musk 昨晚在 X 发文「Impressive work from Kimi」,月之暗面官方今日在微博上回应「你的火箭造得也不错!」。
这条推文也将讨论引向论文的联合一作之一:陈广宇(英文名 Nathan),今年 17 岁,目前仍在读高中。
论文另两名联合一作为 RoPE(旋转位置编码)提出者苏剑林,以及 Kimi Linear 第一作者张宇。陈广宇于 2025 年 11 月加入月之暗面,GitHub 上的 Flash Linear Attention 开源项目是他入门机器学习的起点。
陈广宇本人也在 X 上回应外界讨论,称这样一篇「算法和 infra codesign,同时实验和理论都有补充的 paper 是不太可能一个人写出来的」,Kimi 团队大家都有投入,Yu Zhang 与苏剑林也都是 equal contributor,提醒大家「不要相信谣言」。
陈广宇本人领英主页显示,其就读学校为惠州贝赛思(Basis International Park Lane Harbour)。Moonshot Academy 是 2025 年 3 月举办「Moonshot 48」高中生黑客松的主办方,陈广宇在该活动中获得冠军。
信源:https://www.linkedin.com/in/guangyu-chen/
乐天发布「日本最大高性能AI」Rakuten AI 3.0,配置文件暴露底层架构为DeepSeek V3
乐天集团今日以「日本最大高性能AI模型」为名发布 Rakuten AI 3.0,以 Apache 2.0 协议免费开源。该模型为 MoE(混合专家)架构,总参数671B,每次推理激活37B,上下文窗口128K,针对日语优化,在多项日语基准测试中超越 GPT-4o。
该模型系经济产业省与新能源产业技术综合开发机构(NEDO)联合推进的 GENIAC 项目成果,日本政府为其提供了部分训练算力资助。乐天在公告中以「充分利用开源社区最优成果」描述基础模型来源,未点名具体模型。
社区随即查阅 HuggingFace 上发布的模型文件,发现 config.json 中明确写入
信源:https://huggingface.co/Rakuten/RakutenAI-3.0
乐天集团今日以「日本最大高性能AI模型」为名发布 Rakuten AI 3.0,以 Apache 2.0 协议免费开源。该模型为 MoE(混合专家)架构,总参数671B,每次推理激活37B,上下文窗口128K,针对日语优化,在多项日语基准测试中超越 GPT-4o。
该模型系经济产业省与新能源产业技术综合开发机构(NEDO)联合推进的 GENIAC 项目成果,日本政府为其提供了部分训练算力资助。乐天在公告中以「充分利用开源社区最优成果」描述基础模型来源,未点名具体模型。
社区随即查阅 HuggingFace 上发布的模型文件,发现 config.json 中明确写入
model_type: deepseek_v3 与 `architectures: DeepseekV3ForCausalLM`,总参数671B、激活37B、上下文128K 亦与 DeepSeek V3 完全一致,表明该模型系在 DeepSeek V3 基础上经日语数据微调而来。信源:https://huggingface.co/Rakuten/RakutenAI-3.0
Factory发布Analytics:用数据回答「AI编程到底值不值」
AI 编程 Agent 平台 Factory 发布 Factory Analytics,为企业工程团队提供 AI 编程 Agent 的使用与产出可视化仪表板,覆盖六个维度:Token 消耗、工具调用、活跃度与采用率、代码产出、用户明细及 Agent 就绪度。
核心指标包括「自治比」(每条用户消息对应的工具调用次数,反映 Agent 在人工干预之间独立完成的工作量)和「黏性」(日活/月活比,衡量 AI 工具是否已融入日常工作流)。代码产出维度直接追踪文件创建与编辑数量、git commit 和 PR 数量,将 AI 支出与实际产出挂钩。
Analytics 基于 OpenTelemetry 构建,可导出至 Datadog、Grafana、New Relic 等现有可观测性平台。Factory 的 AI Agent(Droid)还能直接调用 Analytics API,结合 Jira 或 Linear 的项目进度数据自动生成 ROI 报告。该功能面向 Enterprise 计划客户开放。
信源:https://x.com/FactoryAI/status/2033591937115296129?s=20
AI 编程 Agent 平台 Factory 发布 Factory Analytics,为企业工程团队提供 AI 编程 Agent 的使用与产出可视化仪表板,覆盖六个维度:Token 消耗、工具调用、活跃度与采用率、代码产出、用户明细及 Agent 就绪度。
核心指标包括「自治比」(每条用户消息对应的工具调用次数,反映 Agent 在人工干预之间独立完成的工作量)和「黏性」(日活/月活比,衡量 AI 工具是否已融入日常工作流)。代码产出维度直接追踪文件创建与编辑数量、git commit 和 PR 数量,将 AI 支出与实际产出挂钩。
Analytics 基于 OpenTelemetry 构建,可导出至 Datadog、Grafana、New Relic 等现有可观测性平台。Factory 的 AI Agent(Droid)还能直接调用 Analytics API,结合 Jira 或 Linear 的项目进度数据自动生成 ROI 报告。该功能面向 Enterprise 计划客户开放。
信源:https://x.com/FactoryAI/status/2033591937115296129?s=20
「不能重蹈AI覆辙」:英国投10亿英镑押注量子计算,力留本土人才
英国政府宣布投入 10 亿英镑,资助企业设计面向科研、公共部门和商业应用的大规模量子计算机,目标是在下一个十年初建成国产前沿量子计算机。此前已宣布的另外 10 亿英镑将用于支持量子技术在金融、制药和能源等领域的落地应用。
科技大臣 Liz Kendall 在牛津附近的英国国家量子计算中心表示,英国必须从 AI 竞赛中吸取教训,留住本土量子初创企业、工程师和研究人员,而非让他们流失到美国。「太多人觉得必须去美国才能获得成长和扩张所需的资金支持,」她说。Kendall 以 DeepMind 2014 年被谷歌以 4 亿英镑收购为例,指出英国虽是 AI 人才大国,但最大的 AI 业务多为美国公司在英分支。英国已孕育出一批量子初创企业,其中英美合资公司 Quantinuum 近期估值达 100 亿美元。
信源:https://www.theguardian.com/technology/2026/mar/17/uk-must-learn-lessons-from-ai-race-and-retain-its-quantum-computing-talent-says-minister
英国政府宣布投入 10 亿英镑,资助企业设计面向科研、公共部门和商业应用的大规模量子计算机,目标是在下一个十年初建成国产前沿量子计算机。此前已宣布的另外 10 亿英镑将用于支持量子技术在金融、制药和能源等领域的落地应用。
科技大臣 Liz Kendall 在牛津附近的英国国家量子计算中心表示,英国必须从 AI 竞赛中吸取教训,留住本土量子初创企业、工程师和研究人员,而非让他们流失到美国。「太多人觉得必须去美国才能获得成长和扩张所需的资金支持,」她说。Kendall 以 DeepMind 2014 年被谷歌以 4 亿英镑收购为例,指出英国虽是 AI 人才大国,但最大的 AI 业务多为美国公司在英分支。英国已孕育出一批量子初创企业,其中英美合资公司 Quantinuum 近期估值达 100 亿美元。
信源:https://www.theguardian.com/technology/2026/mar/17/uk-must-learn-lessons-from-ai-race-and-retain-its-quantum-computing-talent-says-minister
Anthropic招聘化武专家防范Claude被滥用,专家质疑此举反会增加风险
Anthropic 在 LinkedIn 上发布职位「化学武器与高当量爆炸物政策经理」,要求申请人具备至少 5 年「化学武器和/或爆炸物防御」从业经验,并了解放射性散布装置(脏弹)。公司表示,此岗位旨在防止 Claude 被用于「灾难性滥用」,担心其 AI 工具可能被用于获取制造化学或放射性武器的信息,需要专家评估现有安全防护是否足够严密。Anthropic 称该职位与公司已在其他敏感领域设立的岗位性质相近。
OpenAI 也在招聘页面发布类似职位,方向为生物与化学风险研究员,年薪最高可达 45.5 万美元,近 Anthropic 该职位薪酬的两倍。对此,BBC 节目《AI Decoded》联合主持人、科技研究员 Stephanie Hare 博士提出质疑:「让 AI 系统处理敏感的化学品、爆炸物和放射性武器信息,真的安全吗?即使已指令 AI 不得使用这些信息。」她还指出,目前没有任何国际条约或法规对此类工作以及 AI 与此类武器的结合使用加以规范,「所有这一切都在公众视野之外进行」。
信源:https://www.bbc.com/news/articles/c74721xyd1wo
Anthropic 在 LinkedIn 上发布职位「化学武器与高当量爆炸物政策经理」,要求申请人具备至少 5 年「化学武器和/或爆炸物防御」从业经验,并了解放射性散布装置(脏弹)。公司表示,此岗位旨在防止 Claude 被用于「灾难性滥用」,担心其 AI 工具可能被用于获取制造化学或放射性武器的信息,需要专家评估现有安全防护是否足够严密。Anthropic 称该职位与公司已在其他敏感领域设立的岗位性质相近。
OpenAI 也在招聘页面发布类似职位,方向为生物与化学风险研究员,年薪最高可达 45.5 万美元,近 Anthropic 该职位薪酬的两倍。对此,BBC 节目《AI Decoded》联合主持人、科技研究员 Stephanie Hare 博士提出质疑:「让 AI 系统处理敏感的化学品、爆炸物和放射性武器信息,真的安全吗?即使已指令 AI 不得使用这些信息。」她还指出,目前没有任何国际条约或法规对此类工作以及 AI 与此类武器的结合使用加以规范,「所有这一切都在公众视野之外进行」。
信源:https://www.bbc.com/news/articles/c74721xyd1wo