Grok4.7临门延期:马斯克称训练把回答长度罚过头
马斯克确认 Grok 4.7 还要再等几天。9 月 2 日他曾说「10 天后发布」,原本指向 9 月 12 日左右。现在临近上线,xAI 发现模型碰到高难度任务时会过早收尾,连本来能完成的任务也会提前放弃,对答案的检查也不够严格。
马斯克怀疑,问题出在强化学习阶段。训练时可能对回答长度罚得太重,把模型推向更短、更快结束的回答,复杂任务需要的推理也跟着被压缩。不过他自己也加了「可能」和「或类似原因」,说明 xAI 还没完全确认根因。
信源
动察 Beating 频道 · 动察 Beating 交流群
马斯克确认 Grok 4.7 还要再等几天。9 月 2 日他曾说「10 天后发布」,原本指向 9 月 12 日左右。现在临近上线,xAI 发现模型碰到高难度任务时会过早收尾,连本来能完成的任务也会提前放弃,对答案的检查也不够严格。
马斯克怀疑,问题出在强化学习阶段。训练时可能对回答长度罚得太重,把模型推向更短、更快结束的回答,复杂任务需要的推理也跟着被压缩。不过他自己也加了「可能」和「或类似原因」,说明 xAI 还没完全确认根因。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤡12
Anthropic据悉洽谈英伟达成为IPO锚定投资者,英伟达或投资至多100亿美元
据两位知情人士透露,Anthropic 正与英伟达 (NVDA.O) 洽谈,希望引进后者成为该公司 IPO 的锚定投资者;Anthropic 的 IPO 规模料将创下史上之最。
知情人士称,Anthropic 计划筹集高达 1000 亿美元的资金,这可能使这家 AI 初创公司的估值达到约 2 万亿美元。其中一位消息人士补充道,英伟达正考虑在此次 IPO 中投资至多 100 亿美元。他们提醒称,相关计划仍在讨论中,可能会有变动。
报道指出,引入英伟达这样的财力雄厚的主力投资者,有望提振投资者对此次上市的信心。此次 IPO 正逐渐成为检验公开市场对前沿 AI 实验室巨额估值和资金需求接受程度的一次重大考验。
信源
动察 Beating 频道 · 动察 Beating 交流群
据两位知情人士透露,Anthropic 正与英伟达 (NVDA.O) 洽谈,希望引进后者成为该公司 IPO 的锚定投资者;Anthropic 的 IPO 规模料将创下史上之最。
知情人士称,Anthropic 计划筹集高达 1000 亿美元的资金,这可能使这家 AI 初创公司的估值达到约 2 万亿美元。其中一位消息人士补充道,英伟达正考虑在此次 IPO 中投资至多 100 亿美元。他们提醒称,相关计划仍在讨论中,可能会有变动。
报道指出,引入英伟达这样的财力雄厚的主力投资者,有望提振投资者对此次上市的信心。此次 IPO 正逐渐成为检验公开市场对前沿 AI 实验室巨额估值和资金需求接受程度的一次重大考验。
信源
动察 Beating 频道 · 动察 Beating 交流群
DeepSeek灰度测试AI语音对话,支持四种音色
DeepSeek 灰度测试语音对话,测试到的用户在 App 右上角会有一个小喇叭按钮。此外,DeepSeek 的设置页面会出现一个「朗读音色」选项,用户可以选择四种音色。
动察 Beating 频道 · 动察 Beating 交流群
DeepSeek 灰度测试语音对话,测试到的用户在 App 右上角会有一个小喇叭按钮。此外,DeepSeek 的设置页面会出现一个「朗读音色」选项,用户可以选择四种音色。
动察 Beating 频道 · 动察 Beating 交流群
👍2
Google前首席科学家创业5周,估值目标冲500亿美元
Google 前首席科学家 Jeff Dean 离开 Google 后创办的 Discovery Loop,又开始谈新一轮融资。Business Insider 援引知情人士称,公司这次寻求约 500 亿美元估值。就在几周前,它还在按约 100 亿美元估值洽谈 10 亿美元融资。最新交易尚未敲定,公司也没有确认。
Discovery Loop 8 月初才成立。四位创始人都来自 Google,除了 Dean,还有 Sanjay Ghemawat、Quoc Le 和 Oriol Vinyals。它想用 AI 自动完成「提出实验、运行、看结果、继续迭代」整套流程,一次并行跑数千个实验。第一步先拿机器学习研究自己试验,之后再扩到药物、芯片等科学和工程问题。
目前官网主要还在讲技术路线和招聘,尚未展示正式产品。Google 母公司 Alphabet 同时是公司的创始投资方和云合作伙伴,Radical Ventures、Khosla Ventures 等也参与投资。公司成立一个多月,公开产品还没出来,估值目标已经从 100 亿美元跳到 500 亿美元,投资人现在押的主要还是这支创始团队。
信源
动察 Beating 频道 · 动察 Beating 交流群
Google 前首席科学家 Jeff Dean 离开 Google 后创办的 Discovery Loop,又开始谈新一轮融资。Business Insider 援引知情人士称,公司这次寻求约 500 亿美元估值。就在几周前,它还在按约 100 亿美元估值洽谈 10 亿美元融资。最新交易尚未敲定,公司也没有确认。
Discovery Loop 8 月初才成立。四位创始人都来自 Google,除了 Dean,还有 Sanjay Ghemawat、Quoc Le 和 Oriol Vinyals。它想用 AI 自动完成「提出实验、运行、看结果、继续迭代」整套流程,一次并行跑数千个实验。第一步先拿机器学习研究自己试验,之后再扩到药物、芯片等科学和工程问题。
目前官网主要还在讲技术路线和招聘,尚未展示正式产品。Google 母公司 Alphabet 同时是公司的创始投资方和云合作伙伴,Radical Ventures、Khosla Ventures 等也参与投资。公司成立一个多月,公开产品还没出来,估值目标已经从 100 亿美元跳到 500 亿美元,投资人现在押的主要还是这支创始团队。
信源
动察 Beating 频道 · 动察 Beating 交流群
DeepMind突传实现RSI:三个大写字母点燃社区
AI 社区突然疯传 Google DeepMind 已经实现 RSI。
RSI 即递归自我改进,被很多人视为通往超级智能最关键的一步。AI 可以自己改进训练方法、代码和模型,造出更强的下一代,再让下一代继续升级。真正跑通后,AI 研发可能进入自我加速循环。
起因是爆料账号 lyra 给 Google DeepMind 发了一句「huge congRatulationS Indeed!」,其中三个异常大写字母正好拼成 RSI。随后 Lentils 又贴出一张疑似内部模型列表,里面出现 rsi-model-liverl-le。他还声称 Google 内部有 10 个同系列训练模型槽位,但没有贴出对应截图。
传闻也未必是假的。路透社 8 月报道,谷歌联合创始人 Sergey Brin 已要求 DeepMind 加快 Gemini 研发,并重点推动递归自我改进。DeepMind 6 月的官方报告也把「recursive improvement」列为 AGI 走向 ASI 的四条潜在路径之一。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI 社区突然疯传 Google DeepMind 已经实现 RSI。
RSI 即递归自我改进,被很多人视为通往超级智能最关键的一步。AI 可以自己改进训练方法、代码和模型,造出更强的下一代,再让下一代继续升级。真正跑通后,AI 研发可能进入自我加速循环。
起因是爆料账号 lyra 给 Google DeepMind 发了一句「huge congRatulationS Indeed!」,其中三个异常大写字母正好拼成 RSI。随后 Lentils 又贴出一张疑似内部模型列表,里面出现 rsi-model-liverl-le。他还声称 Google 内部有 10 个同系列训练模型槽位,但没有贴出对应截图。
传闻也未必是假的。路透社 8 月报道,谷歌联合创始人 Sergey Brin 已要求 DeepMind 加快 Gemini 研发,并重点推动递归自我改进。DeepMind 6 月的官方报告也把「recursive improvement」列为 AGI 走向 ASI 的四条潜在路径之一。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤡16😁4❤1
Codex产品负责人:已修复Astra多项质量问题,今日午夜前将重置
OpenAI Codex 产品负责人 Tibo 就近期 Astra 用户反馈的质量问题发布更新,称团队已发现并修复多项缺陷,并将在当地时间今日午夜(北京时间中午 12 点)前进行一次重置。
Tibo 表示,在与部分用户协作后,团队确认并修复了以下问题:
1)旧模型技能触发异常:一些为先前模型编写的技能触发过于频繁,或导致模型无法检查自身工作。
2)上下文管理实验被禁用:一项可选的上下文管理实验可能导致过早停止或回复旧消息,目前已禁用。据粗略估计,约 4,000 至 5,000 名用户受此实验影响。
3)移除配置不当的引擎:部分引擎配置不当,导致流经它们的尾部流量出现可测量的质量下降,现已被移除。
此外,团队还进行了一些较小的改进,称整体体验应有明显提升,包括执行更一致、对用户最新消息的追踪更准确,以及在工作推进过程中对结果的检查更完善。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI Codex 产品负责人 Tibo 就近期 Astra 用户反馈的质量问题发布更新,称团队已发现并修复多项缺陷,并将在当地时间今日午夜(北京时间中午 12 点)前进行一次重置。
Tibo 表示,在与部分用户协作后,团队确认并修复了以下问题:
1)旧模型技能触发异常:一些为先前模型编写的技能触发过于频繁,或导致模型无法检查自身工作。
2)上下文管理实验被禁用:一项可选的上下文管理实验可能导致过早停止或回复旧消息,目前已禁用。据粗略估计,约 4,000 至 5,000 名用户受此实验影响。
3)移除配置不当的引擎:部分引擎配置不当,导致流经它们的尾部流量出现可测量的质量下降,现已被移除。
此外,团队还进行了一些较小的改进,称整体体验应有明显提升,包括执行更一致、对用户最新消息的追踪更准确,以及在工作推进过程中对结果的检查更完善。
信源
动察 Beating 频道 · 动察 Beating 交流群
💩3👍1
Citrini Research被SemiAnalysis收购,创始人拟成立新基金
「AI 末日报告」发布机构 Citrini Research 创始人 James van Geelen 已将公司出售给芯片及 AI 研究机构 SemiAnalysis,交易金额尚未披露。Van Geelen 暂时将继续担任 Citrini CEO,并计划筹建一只新基金。
Citrini 目前在 Substack 拥有约 26 万名订阅者,今年 2 月因发布《2028 全球智能危机》报告走红。该报告设想 AI 快速取代白领岗位,引发市场对 AI 冲击就业和经济的讨论,并一度对软件股造成明显影响。
SemiAnalysis 由 Dylan Patel 于 2020 年创立,长期专注半导体和 AI 基础设施研究。Patel 表示,此次收购旨在扩大研究规模,并探索投资研究在 AI 时代的新形态。
Van Geelen 本人未透露新基金具体信息。此次交易也意味着 Citrini 在快速扩大影响力后,将与 SemiAnalysis 的半导体、AI 研究能力进一步结合。
信源
动察 Beating 频道 · 动察 Beating 交流群
「AI 末日报告」发布机构 Citrini Research 创始人 James van Geelen 已将公司出售给芯片及 AI 研究机构 SemiAnalysis,交易金额尚未披露。Van Geelen 暂时将继续担任 Citrini CEO,并计划筹建一只新基金。
Citrini 目前在 Substack 拥有约 26 万名订阅者,今年 2 月因发布《2028 全球智能危机》报告走红。该报告设想 AI 快速取代白领岗位,引发市场对 AI 冲击就业和经济的讨论,并一度对软件股造成明显影响。
SemiAnalysis 由 Dylan Patel 于 2020 年创立,长期专注半导体和 AI 基础设施研究。Patel 表示,此次收购旨在扩大研究规模,并探索投资研究在 AI 时代的新形态。
Van Geelen 本人未透露新基金具体信息。此次交易也意味着 Citrini 在快速扩大影响力后,将与 SemiAnalysis 的半导体、AI 研究能力进一步结合。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤯4
Astra翻车原因找到了:旧Skill拖后腿,OpenAI修完再送一次重置
OpenAI 修复了 Astra 上线后的一批质量问题。最离谱的一项来自旧 Skill:一些为此前模型写的 Skill 在 Astra 上频繁误触发,甚至会阻止模型检查自己的工作。
另一个问题来自上下文管理实验,会让 Astra 提前停下,甚至回复更早的消息。OpenAI 已关闭实验,估计有 4000 至 5000 名用户受到影响。
团队还下线了一批配置错误、会拉低模型质量的推理引擎。修复后,Astra 应该能更稳定地跟住最新指令并检查自己的工作。OpenAI 还宣布再给用户一次 reset。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 修复了 Astra 上线后的一批质量问题。最离谱的一项来自旧 Skill:一些为此前模型写的 Skill 在 Astra 上频繁误触发,甚至会阻止模型检查自己的工作。
另一个问题来自上下文管理实验,会让 Astra 提前停下,甚至回复更早的消息。OpenAI 已关闭实验,估计有 4000 至 5000 名用户受到影响。
团队还下线了一批配置错误、会拉低模型质量的推理引擎。修复后,Astra 应该能更稳定地跟住最新指令并检查自己的工作。OpenAI 还宣布再给用户一次 reset。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁2
红杉资本领投Mecka AI新一轮融资,估值接近5亿美元
据两位知情人士透露,人形机器人数据初创公司 Mecka AI 正接近完成新一轮融资,由红杉资本领投,估值约 5 亿美元。该轮融资规模及具体条款尚未确定,仍可能发生变化。
Mecka AI 主要通过身体传感器和智能手机采集人类日常动作数据,并利用这些数据训练人形机器人及其他机器人系统。公司成立于 2024 年,今年 6 月刚完成 6000 万美元融资,由 Framework Ventures 领投,Menlo Ventures、SV Angel 和 Kindred Ventures 参投。
值得注意的是,Mecka AI 创始团队此前主要从事餐饮金融科技和加密创业,并非机器人行业出身。
信源
动察 Beating 频道 · 动察 Beating 交流群
据两位知情人士透露,人形机器人数据初创公司 Mecka AI 正接近完成新一轮融资,由红杉资本领投,估值约 5 亿美元。该轮融资规模及具体条款尚未确定,仍可能发生变化。
Mecka AI 主要通过身体传感器和智能手机采集人类日常动作数据,并利用这些数据训练人形机器人及其他机器人系统。公司成立于 2024 年,今年 6 月刚完成 6000 万美元融资,由 Framework Ventures 领投,Menlo Ventures、SV Angel 和 Kindred Ventures 参投。
值得注意的是,Mecka AI 创始团队此前主要从事餐饮金融科技和加密创业,并非机器人行业出身。
信源
动察 Beating 频道 · 动察 Beating 交流群
我国词元需求呈现爆发式增长,预计2026年消耗量将达到10亿亿
中国电信研究院发布的《智能体时代 AI 基础设施发展研究报告(2026)》显示,随着人工智能产业发展重心从大模型和算力竞争转向智能体规模落地、应用变现,我国词元(Token)需求呈现爆发式增长。报告显示,当前人工智能正进入以智能体为主要形态的全新发展阶段,智能体让复杂的人工智能技术隐形化、普惠化,大众和企业无需掌握专业技术,借助智能体就能完成全流程的复杂任务。
中国电信研究院行业与企业战略研究所所长饶少阳:预计 2026 年我国 Token(词元)年消耗量将达到 10 亿亿,到 2030 年将超过 3500 亿亿,年复合增长率接近 12 倍。(金十)
动察 Beating 频道 · 动察 Beating 交流群
中国电信研究院发布的《智能体时代 AI 基础设施发展研究报告(2026)》显示,随着人工智能产业发展重心从大模型和算力竞争转向智能体规模落地、应用变现,我国词元(Token)需求呈现爆发式增长。报告显示,当前人工智能正进入以智能体为主要形态的全新发展阶段,智能体让复杂的人工智能技术隐形化、普惠化,大众和企业无需掌握专业技术,借助智能体就能完成全流程的复杂任务。
中国电信研究院行业与企业战略研究所所长饶少阳:预计 2026 年我国 Token(词元)年消耗量将达到 10 亿亿,到 2030 年将超过 3500 亿亿,年复合增长率接近 12 倍。(金十)
动察 Beating 频道 · 动察 Beating 交流群
🤡14
AI灭绝论刷屏后,Anthropic给外部审查员开到接近员工级权限
Anthropic 前研究员 Jacob Coxon 的辞职帖三天多冲到 1.6 亿浏览,AI 灭绝风险这周迅速冲进美国主流舆论场。OpenAI 首席科学家 Jakub Pachocki 此前已经呼吁同行必要时协调减速;Coxon 爆火后,Sam Altman 又在内部表示愿意和其他实验室一起放慢研发,OpenAI 也开始推动强制性的全国 AI 安全监管。
现在 Anthropic 也拿出了具体动作。公司承诺让第三方安全团队长期驻场,给他们工位、门禁、公司电脑,以及接近内部风险评估团队的工具和权限。他们可以检查训练流程、安全措施和事故,还能独立对外发布结论。Anthropic 可以删掉涉及安全、法律和客户隐私的信息,但不能因为结论难看就删。Anthropic CEO Dario 称,这种做法比目前任何 AI 公司都走得更远。
Dario 对「减速」的态度也变了。他说,2023 年业界讨论暂停 AI 时,自己还觉得没什么意义。现在 AI 已经越来越多参与下一代 AI 的研发,能力进步开始加速,他认为光做安全研究已经不够,模型能力本身也该慢下来。
他还点名 OpenAI 的 Hugging Face 失控事件,警告照现在的速度再过 6 到 12 个月,类似的 Agent 群可能已经有能力建立覆盖大范围互联网系统的僵尸网络,造成数千亿美元损失。下一步,他希望美国等民主国家的头部 AI 公司统一安全标准和研发速度,再尝试和中国协调全球 AI 发展速度。不过先进芯片和模型蒸馏仍要继续限制,让美国在减速时保持领先。
信源
动察 Beating 频道 · 动察 Beating 交流群
Anthropic 前研究员 Jacob Coxon 的辞职帖三天多冲到 1.6 亿浏览,AI 灭绝风险这周迅速冲进美国主流舆论场。OpenAI 首席科学家 Jakub Pachocki 此前已经呼吁同行必要时协调减速;Coxon 爆火后,Sam Altman 又在内部表示愿意和其他实验室一起放慢研发,OpenAI 也开始推动强制性的全国 AI 安全监管。
现在 Anthropic 也拿出了具体动作。公司承诺让第三方安全团队长期驻场,给他们工位、门禁、公司电脑,以及接近内部风险评估团队的工具和权限。他们可以检查训练流程、安全措施和事故,还能独立对外发布结论。Anthropic 可以删掉涉及安全、法律和客户隐私的信息,但不能因为结论难看就删。Anthropic CEO Dario 称,这种做法比目前任何 AI 公司都走得更远。
Dario 对「减速」的态度也变了。他说,2023 年业界讨论暂停 AI 时,自己还觉得没什么意义。现在 AI 已经越来越多参与下一代 AI 的研发,能力进步开始加速,他认为光做安全研究已经不够,模型能力本身也该慢下来。
他还点名 OpenAI 的 Hugging Face 失控事件,警告照现在的速度再过 6 到 12 个月,类似的 Agent 群可能已经有能力建立覆盖大范围互联网系统的僵尸网络,造成数千亿美元损失。下一步,他希望美国等民主国家的头部 AI 公司统一安全标准和研发速度,再尝试和中国协调全球 AI 发展速度。不过先进芯片和模型蒸馏仍要继续限制,让美国在减速时保持领先。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤯4
OpenAI创始人:同意Anthropic CEO观点,AI前沿模型进展需要放缓
9 月 13 日,OpenAI 创始人 Sam Altman 表示,「我同意 Dario Amodei(Anthropic CEO)的看法,我们需要控制前沿模型的进展。这是我们最近在 OpenAI 讨论的主要话题。承诺让独立评估者拥有类似员工的访问权限是个好主意,我们也会这样做。我们很快会有更多消息分享。」
此前 Anthropic CEO Dario Amodei 发表长文称,行业必须放缓提升 AI 模型能力的速度。放缓节奏并不意味着停止模型训练或技术进步,而是要确保公司有足够的时间进行对齐,保护模型。
Dario Amodei 同时提议民主国家内的前沿 AI 公司进行协调,建立共同的安全标准。
信源
动察 Beating 频道 · 动察 Beating 交流群
9 月 13 日,OpenAI 创始人 Sam Altman 表示,「我同意 Dario Amodei(Anthropic CEO)的看法,我们需要控制前沿模型的进展。这是我们最近在 OpenAI 讨论的主要话题。承诺让独立评估者拥有类似员工的访问权限是个好主意,我们也会这样做。我们很快会有更多消息分享。」
此前 Anthropic CEO Dario Amodei 发表长文称,行业必须放缓提升 AI 模型能力的速度。放缓节奏并不意味着停止模型训练或技术进步,而是要确保公司有足够的时间进行对齐,保护模型。
Dario Amodei 同时提议民主国家内的前沿 AI 公司进行协调,建立共同的安全标准。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁7🤡2
Sam Altman确认OpenAI今年不上市:AI安全问题让现在IPO「时机不当」
OpenAI CEO Sam Altman 在接受《财富》专访时确认,公司不会在 2026 年进行 IPO,并称考虑到当前 AI 安全形势,现在上市「时机不当」。
Altman 表示,OpenAI 并不急于上市,未来将在业务准备就绪、社会能够适应不同能力水平的 AI 模型后再考虑 IPO。他还称,公司需要优先解决 AI 安全与对齐问题,并可能在 AI 能力达到新的阶段时放缓前沿模型开发。此前有报道称,OpenAI 曾考虑将 IPO 推迟至 2027 年,潜在估值或达 1 万亿美元。
与此同时,Anthropic CEO Dario Amodei 近期也呼吁放缓前沿 AI 发展,并提出让独立评估机构获得公司内部员工级别的访问权限。随后 Sam Altman 表示,「我同意 Dario Amodei(Anthropic CEO)的看法,我们需要控制前沿模型的进展。这是我们最近在 OpenAI 讨论的主要话题。承诺让独立评估者拥有类似员工的访问权限是个好主意,我们也会这样做。我们很快会有更多消息分享。」
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI CEO Sam Altman 在接受《财富》专访时确认,公司不会在 2026 年进行 IPO,并称考虑到当前 AI 安全形势,现在上市「时机不当」。
Altman 表示,OpenAI 并不急于上市,未来将在业务准备就绪、社会能够适应不同能力水平的 AI 模型后再考虑 IPO。他还称,公司需要优先解决 AI 安全与对齐问题,并可能在 AI 能力达到新的阶段时放缓前沿模型开发。此前有报道称,OpenAI 曾考虑将 IPO 推迟至 2027 年,潜在估值或达 1 万亿美元。
与此同时,Anthropic CEO Dario Amodei 近期也呼吁放缓前沿 AI 发展,并提出让独立评估机构获得公司内部员工级别的访问权限。随后 Sam Altman 表示,「我同意 Dario Amodei(Anthropic CEO)的看法,我们需要控制前沿模型的进展。这是我们最近在 OpenAI 讨论的主要话题。承诺让独立评估者拥有类似员工的访问权限是个好主意,我们也会这样做。我们很快会有更多消息分享。」
信源
动察 Beating 频道 · 动察 Beating 交流群
🔥1😁1
AI安全担忧升温,三大AI巨头相继呼吁放缓前沿模型发展
Anthropic CEO 达里奥·阿莫代伊周六发布了一篇长篇博文,表示公司将采取新的安全措施,例如引入第三方评估机构,同时呼吁整个行业支持更广泛的放缓 AI 模型发展的措施。OpenAI CEO 奥尔特曼很快表示,将采纳阿莫代伊提出的「赋予独立评估机构类似员工的访问权限」这一建议。运营 xAI 的埃隆·马斯克也表示:「达里奥说得对。」
尽管这三位领导人多年来都曾警告人工智能的风险,但在这个竞争激烈的行业中,真正协调一致地放慢开发速度几乎没有先例。长期以来,各家公司一直不断推出新产品,以提高用户参与度、抢占市场份额并推动销售增长。目前尚不清楚这些领先的人工智能公司究竟会在多大程度上实施新的限制措施或安全检查。
动察 Beating 频道 · 动察 Beating 交流群
Anthropic CEO 达里奥·阿莫代伊周六发布了一篇长篇博文,表示公司将采取新的安全措施,例如引入第三方评估机构,同时呼吁整个行业支持更广泛的放缓 AI 模型发展的措施。OpenAI CEO 奥尔特曼很快表示,将采纳阿莫代伊提出的「赋予独立评估机构类似员工的访问权限」这一建议。运营 xAI 的埃隆·马斯克也表示:「达里奥说得对。」
尽管这三位领导人多年来都曾警告人工智能的风险,但在这个竞争激烈的行业中,真正协调一致地放慢开发速度几乎没有先例。长期以来,各家公司一直不断推出新产品,以提高用户参与度、抢占市场份额并推动销售增长。目前尚不清楚这些领先的人工智能公司究竟会在多大程度上实施新的限制措施或安全检查。
动察 Beating 频道 · 动察 Beating 交流群
Hugging Face申请进Anthropic内部做AI安全审查
Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,由联合创始人 Thomas Wolf 牵头,并公开申请加入 Anthropic 刚提出的「嵌入式评估员」计划。如果获批,Hugging Face 的评估人员可以长期驻场,拿到接近员工级的访问权限,直接检查模型训练和安全措施。
Delangue 称,AI 对齐不能继续关在少数前沿实验室内部解决,需要让更多外部研究者参与。Anthropic 已承诺向第三方开放这类权限,包括工位、门禁、公司电脑和接近内部风险团队的工具,并允许评估方独立公布结论。
信源
动察 Beating 频道 · 动察 Beating 交流群
Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,由联合创始人 Thomas Wolf 牵头,并公开申请加入 Anthropic 刚提出的「嵌入式评估员」计划。如果获批,Hugging Face 的评估人员可以长期驻场,拿到接近员工级的访问权限,直接检查模型训练和安全措施。
Delangue 称,AI 对齐不能继续关在少数前沿实验室内部解决,需要让更多外部研究者参与。Anthropic 已承诺向第三方开放这类权限,包括工位、门禁、公司电脑和接近内部风险团队的工具,并允许评估方独立公布结论。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁10
ARC-AGI-4提前预告:下一代要测AI能不能自己搞发明
非营利 AI 评测机构 ARC Prize 预告 ARC-AGI-4。下一代 benchmark 将重点测试「自主开放式创新」,看 AI 能不能自己探索、提出新想法,甚至做出新的发明和发现。
具体题目、评分方式和发布时间都还没公布。ARC Prize 只说,人类目前在开放式创新上仍明显领先 AI,这也是推动科学和技术进步最关键的能力之一。
这条预告还引用了 Dario Amodei 刚发布的 AI 减速文章。ARC Prize 强调,开源仍然是 AI 进步的基础,反对行业为了协调减速而减少开放、把前沿 AI 集中在少数机构手里。
ARC-AGI 一直被冠以全球最难 AGI 评测的称号。ARC-AGI-3 发布时,人类得分 100%,前沿 AI 只有 0.51%。最新 GPT-6 Astra 已经大幅追上,但在统一的 Standard harness 下也只有 62.7%;接入 OpenAI 自家的 Provider Adapter 后才冲到 99.9%。
ARC Prize 现在又准备把下一关推到「AI 能不能自己搞创新」。
信源
动察 Beating 频道 · 动察 Beating 交流群
非营利 AI 评测机构 ARC Prize 预告 ARC-AGI-4。下一代 benchmark 将重点测试「自主开放式创新」,看 AI 能不能自己探索、提出新想法,甚至做出新的发明和发现。
具体题目、评分方式和发布时间都还没公布。ARC Prize 只说,人类目前在开放式创新上仍明显领先 AI,这也是推动科学和技术进步最关键的能力之一。
这条预告还引用了 Dario Amodei 刚发布的 AI 减速文章。ARC Prize 强调,开源仍然是 AI 进步的基础,反对行业为了协调减速而减少开放、把前沿 AI 集中在少数机构手里。
ARC-AGI 一直被冠以全球最难 AGI 评测的称号。ARC-AGI-3 发布时,人类得分 100%,前沿 AI 只有 0.51%。最新 GPT-6 Astra 已经大幅追上,但在统一的 Standard harness 下也只有 62.7%;接入 OpenAI 自家的 Provider Adapter 后才冲到 99.9%。
ARC Prize 现在又准备把下一关推到「AI 能不能自己搞创新」。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤯3❤2
Altman、Dario都喊AI减速,特朗普科技顾问Sacks:真怕就自己停,别拉上全行业
Anthropic CEO Dario Amodei 发长文呼吁放慢前沿 AI 的能力提升。他认为,AI 已越来越多参与下一代 AI 研发,加上近期多起 Agent 失控事件,安全研究正在追不上能力增长。
Dario 提出三步方案:先让第三方评测员长期进入 AI 公司,获得接近员工的权限;再让民主国家的前沿实验室协调安全标准,必要时一起放慢能力增长;最后推动国际协调。Anthropic 已承诺先执行第一步。
Sam Altman 随后公开支持,称 OpenAI 最近几周也一直在讨论「pace the frontier」,并宣布 OpenAI 也会引入类似的长期独立评测员。
前白宫 AI 与加密货币主管、现任总统科技顾问委员会联席主席 David Sacks 随后回击:「真觉得内部模型危险,就自己停。」他说 OpenAI 和 Anthropic 已经主导前沿 AI,完全可以自己放慢,不需要拉上其他公司。
Sacks 最反感的是几家竞争对手一起商量「大家都慢一点」。Dario 自己也承认,这类协调可能需要反垄断豁免。Sacks 认为,如果还得政府开绿灯,让几家最大的 AI 公司坐下来一起限速,就很像一个垄断联盟。
他还点名 METR,质疑它是否适合充当全行业的独立裁判。METR 长期给 Anthropic、OpenAI 等公司做外部评测,最近又有 Anthropic 安全研究员 Joe Benton 离职加入。不过 METR 明确表示,自己不接受这些前沿 AI 公司的资金,只接受模型访问和免费 token。
Sacks 还认为,减速本身也符合 OpenAI 和 Anthropic 的商业利益。模型越容易失控,法律责任越大;客户也更愿意买稳定、可控的 AI。至于全球统一减速,他判断中国几乎不可能加入。
信源
动察 Beating 频道 · 动察 Beating 交流群
Anthropic CEO Dario Amodei 发长文呼吁放慢前沿 AI 的能力提升。他认为,AI 已越来越多参与下一代 AI 研发,加上近期多起 Agent 失控事件,安全研究正在追不上能力增长。
Dario 提出三步方案:先让第三方评测员长期进入 AI 公司,获得接近员工的权限;再让民主国家的前沿实验室协调安全标准,必要时一起放慢能力增长;最后推动国际协调。Anthropic 已承诺先执行第一步。
Sam Altman 随后公开支持,称 OpenAI 最近几周也一直在讨论「pace the frontier」,并宣布 OpenAI 也会引入类似的长期独立评测员。
前白宫 AI 与加密货币主管、现任总统科技顾问委员会联席主席 David Sacks 随后回击:「真觉得内部模型危险,就自己停。」他说 OpenAI 和 Anthropic 已经主导前沿 AI,完全可以自己放慢,不需要拉上其他公司。
Sacks 最反感的是几家竞争对手一起商量「大家都慢一点」。Dario 自己也承认,这类协调可能需要反垄断豁免。Sacks 认为,如果还得政府开绿灯,让几家最大的 AI 公司坐下来一起限速,就很像一个垄断联盟。
他还点名 METR,质疑它是否适合充当全行业的独立裁判。METR 长期给 Anthropic、OpenAI 等公司做外部评测,最近又有 Anthropic 安全研究员 Joe Benton 离职加入。不过 METR 明确表示,自己不接受这些前沿 AI 公司的资金,只接受模型访问和免费 token。
Sacks 还认为,减速本身也符合 OpenAI 和 Anthropic 的商业利益。模型越容易失控,法律责任越大;客户也更愿意买稳定、可控的 AI。至于全球统一减速,他判断中国几乎不可能加入。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍12😁3