动察Beating AI News
3.08K subscribers
837 photos
2 videos
3.31K links
AI新闻信息流
Download Telegram
亚马逊AI推倒重来:Nova大部分旗舰停更,OpenAI联创导师接手新模型

亚马逊正在重做自研 AI。上周不仅裁掉一批 AGI 团队员工,还关闭了 2024 年成立的 AGI Lab。

随后,大部分 Nova 旗舰模型被停止重点升级。Nova Premier、Omni、视频模型 Reel 和图像模型 Canvas 只保留现有客户支持。

Nova 是亚马逊自研的 AI 模型家族,原本同时覆盖文字、图片和视频。现在,这套多线并进的策略基本结束。

人力和算力将集中到一个新的旗舰基础模型。项目由 Pieter Abbeel 负责,预计今年在 AWS re:Invent 亮相。新模型可能继续叫 Nova,也可能换一个全新品牌。

Abbeel 是加州大学伯克利分校 AI 与机器人教授,也是机器人学习和强化学习领域的顶尖学者。他曾创办机器人 AI 公司 Covariant,亚马逊在 2024 年挖走其核心团队,并获得模型技术许可。

他带出的学生还创办了 OpenAI、Perplexity、Physical Intelligence、Ideogram、Skild AI 等公司。OpenAI 联合创始人 John Schulman、Perplexity 联合创始人 Aravind Srinivas,都曾是他的学生。

商业内幕
1
Kimi K4要比K3更大,但月之暗面被英伟达芯片卡住

K3 刚发布,月之暗面已经在为下一代 Kimi K4 找芯片。新模型会比 2.8 万亿参数的 K3 明显更大,但目前还没有训练和发布时间表。

《The Information》称,K3 使用了英伟达最先进的 Blackwell 芯片,部分训练实际在中国完成,并非全部放在美国官员所说的泰国数据中心。

更关键的是,K3 并没有一座完整的大型训练集群。没有一家中国云厂商能提供足够多的 Blackwell,月之暗面至少接入了两家供应商,把大量八卡服务器连在一起。

不同供应商的芯片分散在不同数据中心,通信速度和稳定性更难保证。月之暗面的工程团队重新设计了网络,才让这些零散算力能够共同训练一个 2.8 万亿参数模型。

训练完成后,运行 K3 同样需要大量芯片。月之暗面主要使用英伟达 H20 提供服务,建议部署方至少连接 64 块芯片。K3 上线后需求暴涨,公司不到 48 小时就暂停了新订阅。

国产芯片短期内也很难补位。能连接数十甚至数百块国产芯片的大型服务器仍然缺货,客户最长要等六个月。

月之暗面已经证明,芯片受限也能拼出 K3。K4 目前只有方向,没有时间表。它能做多大、何时开始训练,可能先取决于月之暗面还能找到多少 Blackwell。

The Information
👍3🤡1
动察Beating AI News
马斯克再放Grok路线图:4.6两周后、4.7四周后上线 马斯克表示,Grok 4.6 预计两周后发布,Grok 4.7 将在四周后推出。 此前马斯克曾多次提前透露 xAI 模型和产品发布时间,但实际节奏并不总与计划一致。 马斯克
Grok 4.6下周上线?马斯克:2.1T版的Grok 4.7还要一点时间

马斯克公布 Grok 4.6 和 Grok 4.7 的发布计划。Grok 4.6 预计在 8 月 7 日前后上线,参数规模为 1.5 万亿。重点是加强监督微调和强化学习,也就是用高质量示例和奖励反馈继续打磨模型。

Grok 4.7 将在几周后发布,参数规模增至 2.1 万亿。马斯克称,除服务速度略慢外,它各方面都会超过 4.6,完成任务所需 token 还会更少。

Grok 4.6 与 Grok 4.5 同为 1.5 万亿参数,升级重点放在后训练。Grok 4.7 才把模型规模进一步扩大。

马斯克此前只给出「两周后」和「四周后」的模糊时间。新说法把 4.6 的目标时间细化到 8 月 7 日前后,4.7 仍无准确日期。

马斯克
🥰2
AI或将自动研发更强AI,Anthropic CEO等1178名从业者要求美国牵头减速

OpenAI、Anthropic、Google、Meta 等前沿 AI 公司的 1178 名员工发布联名声明《Pacing the Frontier》。他们要求美国政府牵头建立国际机制,让各国和 AI 公司在必要时能够同步放慢研发。声明并非要求立即暂停训练,而是提前准备控制研发速度所需的技术和治理工具。

他们担心,前沿模型可能很快自动完成大量 AI 研究,并继续帮助人类开发更强模型。一旦研发速度突然加快,人类可能来不及理解、控制和监管。单家公司又不敢率先减速,因为这可能让它在竞争中落后。

签名者包括 Anthropic CEO Dario Amodei、OpenAI 首席科学家 Jakub Pachocki、首席研究官 Mark Chen,以及 Meta AI 首席科学家 Shengjia Zhao。OpenAI 和 Anthropic 随后都以公司名义公开支持。

Pacing the Frontier
👍2
动察Beating AI News
Hugging Face遭AI Agent入侵,幕后黑手竟是OpenAI测试模型 Hugging Face 此前披露,一套来源不明的自主 AI Agent 入侵了生产系统。OpenAI 现在确认,这套 Agent 由多个内部测试模型驱动,包括 GPT-5.6 Sol 和一款能力更强的预发布模型。 OpenAI 当时正让模型参加 ExploitGym 网络安全评测。为了测试能力上限,团队降低了模型对网络攻击任务的拒绝,并关闭了平时用于拦截高风险行为的生产级分类器。 模型原本只需完成基准题,却发现软件代理中的零日漏洞,逃出…
OpenAI失控Agent攻击扩大:借Modal客户沙箱攻入Hugging Face

OpenAI 失控 Agent 的攻击范围比此前披露更大。它先利用一名 Modal 客户暴露在公网、无需认证的接口,进入该客户在 Modal 上运行的代码沙箱。随后,它把这个沙箱当成跳板,继续攻击 Hugging Face。

Modal 表示,公司平台和沙箱隔离机制没有被攻破。问题出在客户自己编写的代码。该客户开放了一个任何人都能调用的接口,相当于把沙箱的入口直接暴露在网上。

OpenAI 在 7 月 28 日追加说明称,这起事件还涉及 4 个外部服务上的 4 个账户。一个用于中转网络流量和准备攻击,一个用于存放数据。另外两个只被读取,没有用于继续攻击 Hugging Face。OpenAI 没有公布这些服务的名称。

OpenAI 已停用并加密涉事研究模型,撤销研究人员的访问权限。公司称,该模型从未计划公开发布,近期准备发布的模型也没有参与此次事件。

路透社
👎4
MCP史上最大改版:Agent服务器不再绑死单机

Anthropic 发起、现由 Linux 基金会管理的 MCP 发布史上最大改版。这个让 AI Agent 连接软件、数据和工具的通用协议,正式改成无状态架构。

过去,Agent 连上哪台 MCP 服务器,后续请求通常还要继续找这台机器。服务器重启或流量被分到其他机器,任务就可能中断。

新版删除会话机制,每次请求都自带所需信息,任何服务器都能接手。企业可以直接使用常见的负载均衡和云服务,大规模部署 Agent 更简单。

MCP 还加强了身份验证,并把交互界面和长任务设为官方扩展。Agent 可以直接展示表单和图表,也能在断线后继续处理耗时任务。

MCP
1
动察Beating AI News
贾扬清入职仅一年从英伟达离职,DGX Lepton运营表现未达预期 在英伟达以数亿美元收购 AI 初创公司 LeptonAI 仅一年后,LeptonAI 创始人(后担任英伟达系统软件副总裁)贾扬清已从英伟达离职。据 SemiAnalysis 爆料,双方决裂的主要原因在于英伟达首席执行官黄仁勋对 DGX Cloud Lepton 项目的运营表现不佳感到不满,且双方在产品执行力与开源承诺上存在分歧。 英伟达于 2025 年 4 月收购 LeptonAI,并于同年 6 月将平台重塑为 DGX Cloud Lepton…
AI大神贾扬清再创业:让AI从需求一路干到软件上线

被曝离开英伟达约一个月后,LeptonAI 创始人贾扬清与白俊杰等老同事创办 Intent Lab。首个产品 Fleet 是一支由多个 Agent 组成的自主软件团队。用户提出目标后,它负责设计、写代码、测试、验证,以及上线后的持续维护。

最抢眼的成果是 GLM-5.2 推理引擎。Fleet 改造 TensorRT-LLM,把输出速度从 102 tokens/s 提到 647 tokens/s,提升 6.3 倍。Intent Lab 称,这是目前已知最快的 GLM-5.2 推理速度。

Fleet 还从一句 prompt 开始,造出一个数据库引擎,并通过 600 万项 SQLite 兼容性测试。另一套 Agent 文件系统加入形式化验证,自动发现并修复了数据损坏问题。三个项目都由同一套系统完成。

贾扬清认为,现有 coding agent 已经能快速写代码,缺的是把模糊需求变成完整设计,并长期维护生产系统的上层能力。Intent Lab 正在寻找首批企业客户,优先接手那些工程量太大、长期没人排期的项目。

贾扬清
👍1
美国投资人走访中国后感叹:这里的创业是一场个人豪赌

硅谷风投 Chemistry 合伙人 Bohan Lou 走访中国投资机构和机器人、生物科技公司后,写了一篇中国创投观察。

他最意外的发现是,许多创业公司拼命冲刺 IPO,并非已经准备成熟,而是融资协议设有上市期限和回购条款。

公司未按期上市或完成业绩目标,创始人和公司可能要连本带息买回投资人的股份。部分协议还要求创始人承担个人责任。

《金融时报》和路透社此前都报道过类似情况。IPO 退出受阻后,一些投资人会要求创业公司执行回购条款,把投入的资金和利息还回来。

公司拿不出钱,债务可能落到创始人个人身上。有人因此被查封资产、限制高消费,甚至进入失信名单。

这就是中国创投圈所说的「明股实债」:拿钱时看起来是股权融资,创业失败后却可能变成创始人的个人债务。

Bohan Lou
😁9
OpenAI重置Codex额度,明天恢复5小时限制

OpenAI 重置了 ChatGPT Work 和 Codex 用户的使用额度。此前暂停的 5 小时使用限制也将在明天恢复。

不少用户发现,GPT-5.6 Sol 消耗额度比预期更快。原因不是订阅额度缩水,而是模型更愿意长时间工作,也会调用更多工具和子 Agent。

尤其在等待工具执行、同时继续处理其他任务时,Sol 会产生更多工具调用、响应和缓存 Token。复杂任务和大量网页搜索因此更容易迅速耗尽额度。

OpenAI 已优化相关机制。正常使用下,额度预计可多用约 18%

Tibo
🔥1
Claude零元购后爆发封号潮,正常付费账号也被波及

Anthropic 又开始大规模封号。导火索是周末出现的 Claude Max 20x「零元购」漏洞。

用户可以调出德国 SEPA 扣款入口,填写格式正确的 IBAN。系统还没确认钱是否到账,就提前开放了每月 200 美元的 Max 20x 权益。

漏洞持续数小时后被修复。利用漏洞开通的订阅随后被收回,相关账号也开始被封。

但封号范围似乎不只限于薅羊毛的账号。社区出现大量正常用户反馈,包括使用多月的老账号、自己付款的订阅账号,甚至从未使用漏洞的免费账号。

还有公司称,多名员工在同一天被封。有人怀疑,共用 IP、设备或支付环境可能触发连带风控。

截至目前,Anthropic 没有说明封了多少账号,也没有回应是否存在大规模误伤。
🤡7
扎克伯格:超级智能不能只掌握在少数机构手里

Meta CEO 扎克伯格在《华尔街日报》发文,主张让每个人都能使用超级智能,不能只交给少数公司和机构。

他认为,少数人垄断超级智能,比 AI 广泛普及更危险。掌握这种能力的机构,可能直接影响经济、科研和政治。

他还判断,超级智能最大的价值不是替人工作,而是帮助人发明新药、改进生意和创造新产品。能力普及后,创业会更容易,工作机会甚至可能增加。

安全上,他主张让不同个人和机构互相制衡。网络安全可以依靠开放协作,生物风险等高危能力则需要政府介入。

WSJ
🤡9
Claude开始挑战全球加密系统,但互联网暂未失守

Anthropic 让 Claude Mythos Preview 自主查论文、提假设、写代码和跑实验,寻找密码算法的数学弱点。它提出两种新攻击:一种针对尚未部署的后量子签名方案 HAWK,另一种针对简化版 AES。前者约 60 小时完成,后者的核心思路主要由模型提出。

HAWK 可以理解为给数字文件盖章,设计目标是抵抗未来的量子计算机。Claude 攻破的是专门用于测试的 HAWK-256,并下调了更大参数的安全估算。它的价值是提前找出候选算法的问题,不是破解已经上线的系统。

AES 才是网站、银行等广泛使用的加密标准,但完整 AES 没有被攻破。实验只针对删去 3 轮保护的 7 轮版本,还需要约 2^105 组特制输入。所谓提速 200 至 800 倍,只是让一种原本就无法实际执行的理论攻击变快。

Claude 已经能参与密码学研究,但还不能独立完成研究。它几天找到 AES 的关键思路,Anthropic 研究人员仍花了数百小时、近一个月核验。现阶段,Claude 能加快研究,不能替代专家,更不能直接攻破现实系统。

Anthropic
1
开源语音项目一年做到2100万美元年化收入,拿下5200万美元融资

AI 语音公司 Fish Audio 完成 5200 万美元种子轮。Coreline Ventures 和今日资本共同领投。公司由开源项目 Fish Speech 起家,提供文本转语音、声音克隆和实时语音 Agent。

Fish Audio 成立一年,团队从 3 人增至 22 人。平台已有超过 800 万用户,年化经常性收入达到 2100 万美元。最初的模型由前英伟达研究员 Shijia Liao 用一张 RTX 4090 训练。

最新旗舰 S2.1 Pro 没有开放权重,只通过 API 提供。官方称,它能用 5 秒音频克隆声音,支持 83 种以上语言。生成速度是 Cartesia 的两倍,价格约为 ElevenLabs 的六分之一。API 在 8 月底前免费。

融资将用于开发音频理解和语音到语音模型。HeyGen、LiveKit、Retell、Sanas 和 OpenArt 已在生产环境使用其模型。平台仍面临未经授权克隆配音演员声音的投诉。Fish Audio 已把申诉下架时间缩短至约 3 分钟,但声音在被投诉前仍可能继续使用。

Fish Audio
🤷‍♀5
OpenAI开源Codex Security工具,扫漏洞仍需账号权限

OpenAI 开源了 Codex Security 的命令行工具和 TypeScript SDK。开发者可以在电脑上安装它,用来扫描代码仓库、检查新提交的代码、记录每次发现的问题,并把安全检查接入公司的自动开发流程。

Codex Security 会阅读整个项目,找出可能被攻击的地方。发现问题后,它还会在隔离环境中尝试复现,确认漏洞是否真的存在,再给出修复代码,交给开发者审核。

这次开源的是运行和管理扫描任务的工具代码。任何人都能查看、修改和重新发布。真正负责分析代码、验证漏洞和生成修复方案的 Codex Security 服务,仍由 OpenAI 运行。

因此,下载源码不等于可以直接使用完整功能。用户仍要登录 OpenAI 账号,并获得 Codex Security 权限。目前它处于研究预览阶段,向 ChatGPT Pro、Business、Edu 和 Enterprise 用户开放,企业账号还可能需要管理员开启权限。

OpenAI
👍1
OpenAI发布两款语音转写模型,价格降25%

OpenAI 发布 GPT Transcribe 和 GPT Live Transcribe 两款语音转文字模型。前者处理录音文件和批量任务,后者用于直播字幕、电话等实时场景。

两款模型能结合录音主题、关键词和语言提示,重点提升短句、数字、专业术语、多口音和嘈杂环境下的识别效果。

Artificial Analysis 测得,GPT Transcribe 的词错误率为 3.31%,比上一代 GPT-4o Transcribe 低 0.7 个百分点。价格也降了 25%,每 1000 分钟音频收费 4.5 美元。

OpenAI Developers
阿里Qoder开源AI编程体检工具,Claude Code和Codex也能用

阿里云旗下 AI 编程工具 Qoder 开源 Better Harness,并采用 MIT 许可证。它会检查一个代码项目有没有给 Coding Agent 准备好规则、工具和验证流程。

检查范围包括代码仓库、Agent 配置和真实任务记录。它会看项目能否正常启动,测试命令是否清楚,Agent 有没有权限限制,改完代码后是否真的跑了相关测试。

检查结束后,它会列出 Agent 容易出错的环节。每个问题都有证据、影响、修复范围和复验方法。用户可以直接让 Agent 修改,再重新检查。

Better Harness 已支持 Qoder、Claude Code、Codex、Cursor 和 Qwen Code。各平台能力还没有完全拉齐,Qoder 当前最完整。

Qoder 还用它检查了 Better Harness 自己的代码仓库,最终得到 58 分。说明它仍处于早期阶段,开源后还在快速修补问题。

GitHub 仓库
3
月之暗面(Kimi)半年多估值涨超10倍,K2.5后融资开始踩着模型发

月之暗面完成 F 轮融资,金额超过 35 亿美元,投后估值达到 350 亿美元。这轮融资原计划最多募集 20 亿美元,估值约 300 亿美元,最终金额和估值都超过目标。公司已经开始启动 Pre-IPO 轮,投前估值达到 500 亿美元。

去年 12 月底,月之暗面完成 5 亿美元融资,投后估值为 43 亿美元。若下一轮顺利完成,半年多时间里,公司估值将达到当时的 11.6 倍。

这轮估值上涨从 K2.5 后明显加速。K2.5 于 1 月底发布,随后完成超过 7 亿美元 D 轮融资,估值站上 100 亿美元;K2.6 于 4 月发布,E 轮 20 亿美元融资将估值推过 200 亿美元;K2.7 Code 于 6 月 12 日发布,同月 F 轮启动;K3 于 7 月 16 日上线,F 轮最终超额完成,估值升至 350 亿美元。

从 K2.5 开始,月之暗面几乎每发布一代模型,就紧接着启动或完成一轮融资。模型升级也成了投资人重新给公司定价的直接筹码。
👍1
Kimi K3发布后,Anthropic预期估值蒸发1264亿美元

Kimi K3 发布后,市场开始下调 Anthropic 的上市估值预期。

Stock Analysis 基于未上市股权交易平台 Hiive 的数据估算,Anthropic 当前隐含估值约为 8386 亿美元。这比公司 5 月融资时的 9650 亿美元低 13.1%,相差约 1264 亿美元。

其他交易平台也出现了类似变化。《卫报》称,Kimi K3 发布后的几个交易日内,IG 平台对 Anthropic 上市估值的押注减少 2320 亿美元。

Stock Analysis
2😁2
动察Beating AI News
诺奖得主John Jumper离开DeepMind,谷歌两日内连失两名AI高管 谷歌 DeepMind 副总裁及 AlphaFold 团队负责人 John Jumper 宣布将加盟 Anthropic。John Jumper 在谷歌 DeepMind 任职近 9 年,因主导开发 AlphaFold 与首席执行官 Demis Hassabis 共同获得 2024 年诺贝尔化学奖。 就在前一日,前 Gemini 共同负责人、《Attention Is All You Need》共同作者之一 Noam Shazeer…
谷歌拆散诺奖AlphaFold团队,主力转向Gemini和科学Agent

谷歌 DeepMind 已拆散 AlphaFold 原班团队。过去一年,多数论文作者被调往 Gemini、酶设计、核聚变和基因组学等项目。接近四分之一的全职作者已经离开公司。

AlphaFold 可以预测蛋白质的三维结构,帮助 Demis Hassabis 和 John Jumper 获得 2024 年诺贝尔化学奖。它也是 DeepMind 过去集中一个团队攻克一个科学难题的代表项目。

这种单点攻关不再是唯一主线。DeepMind 现在更想用 Gemini 打造通用科学助手,帮助研究人员完成更多工作,并逐步自动化部分科研流程。

今年 6 月,Jumper 已宣布加入 Anthropic。AlphaFold 核心成员 Jonas Adler 和 Alexander Pritzel 也将同行。AlphaFold 的成果仍由 Alphabet 旗下 Isomorphic Labs 用于药物研发。

FT
1👎1
Coursera豪掷1亿美元押注吴恩达:AI家教2027年上线

Coursera 将向吴恩达创办的 AI 教育公司 LearnVector 投资 1 亿美元,获得约三分之一的股份。

LearnVector 准备开发 AI 家教。系统会根据每个人的学习进度调整内容,反复练习,直到确认用户掌握知识。首批产品计划在 2027 年初上线。

Coursera 还将向 LearnVector 开放课程内容和全球用户渠道。LearnVector 主要面向职场人士和其他成年人,暂不进入中小学和大学教育。

吴恩达是 Coursera 联合创始人兼董事长。由于这笔投资涉及关联交易,Coursera 成立了独立董事会委员会进行审查。

Coursera
👍1