OpenAI上线Data Agent:不会SQL也能查公司数据库、做数据看板
OpenAI 在 ChatGPT Work 上线 Data Agent。员工直接问「为什么销量掉了」「哪批客户最可能流失」,它就能自己调取公司数据、分析原因,还能生成会跟着数据更新的数据看板。
它可以连接 Snowflake、BigQuery、Databricks、Redshift、MongoDB 等数据库,也能读取 Google Drive 和 SharePoint。公司原本怎么定义「活跃用户」「收入」等指标,它也会沿用这些口径和现有权限,避免同一个指标被不同人算出不同结果。
分析完后,它还能把结果发到 Slack 或邮件,并在用户批准后继续执行后续操作。OpenAI 称,公司几乎所有产品团队,以及超过三分之二的销售、市场等团队,都已经在使用这类数据 Agent。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 在 ChatGPT Work 上线 Data Agent。员工直接问「为什么销量掉了」「哪批客户最可能流失」,它就能自己调取公司数据、分析原因,还能生成会跟着数据更新的数据看板。
它可以连接 Snowflake、BigQuery、Databricks、Redshift、MongoDB 等数据库,也能读取 Google Drive 和 SharePoint。公司原本怎么定义「活跃用户」「收入」等指标,它也会沿用这些口径和现有权限,避免同一个指标被不同人算出不同结果。
分析完后,它还能把结果发到 Slack 或邮件,并在用户批准后继续执行后续操作。OpenAI 称,公司几乎所有产品团队,以及超过三分之二的销售、市场等团队,都已经在使用这类数据 Agent。
信源
动察 Beating 频道 · 动察 Beating 交流群
Kimi K2.8 Preview全量上线:性能逼近K3,支持1M上下文
月之暗面开始向 Kimi Code CLI 全量推送 Kimi K2.8 Preview。用户不用切换 Model ID,原来的 kimi-for-coding 会直接指向新模型。
Kimi 称,K2.8 Preview 综合性能已经接近 K3,但 thinking 效率更高。它还支持和 K3 一样的思考强度调节,并把上下文扩到 1M token。
上一代 K2.7 Code 只有 256K 上下文,而且只能开启 thinking。K2.8 这次基本把 K3 上的两项核心能力下放到了默认代码模型。
信源
动察 Beating 频道 · 动察 Beating 交流群
月之暗面开始向 Kimi Code CLI 全量推送 Kimi K2.8 Preview。用户不用切换 Model ID,原来的 kimi-for-coding 会直接指向新模型。
Kimi 称,K2.8 Preview 综合性能已经接近 K3,但 thinking 效率更高。它还支持和 K3 一样的思考强度调节,并把上下文扩到 1M token。
上一代 K2.7 Code 只有 256K 上下文,而且只能开启 thinking。K2.8 这次基本把 K3 上的两项核心能力下放到了默认代码模型。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤔6💩2
OpenAI下周退役Codex Spark:上线7个月,用的人越来越少
OpenAI 核心产品负责人 Tibo Sottiaux 宣布,GPT-5.3-Codex-Spark 将在下周退役。因为这款模型的使用量一直在下降,而且 OpenAI 现在已经有明显更好的模型。
Spark 今年 2 月上线,是 GPT-5.3-Codex 的小型高速版,也是 OpenAI 首款专门为实时编程设计的模型。它运行在 Cerebras 芯片上,生成速度超过每秒 1000 token,只向 ChatGPT Pro 用户开放。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 核心产品负责人 Tibo Sottiaux 宣布,GPT-5.3-Codex-Spark 将在下周退役。因为这款模型的使用量一直在下降,而且 OpenAI 现在已经有明显更好的模型。
Spark 今年 2 月上线,是 GPT-5.3-Codex 的小型高速版,也是 OpenAI 首款专门为实时编程设计的模型。它运行在 Cerebras 芯片上,生成速度超过每秒 1000 token,只向 ChatGPT Pro 用户开放。
信源
动察 Beating 频道 · 动察 Beating 交流群
❤3👍2
OpenAI否认偷用数学家未公开研究:Codex草稿没影响Navier-Stokes证明
OpenAI 最新回应了 Navier-Stokes 抢功争议,明确否认偷用了纽约大学数学家 Tristan Buckmaster 的未公开研究。公司调查后称,Buckmaster 过去两个月提交给 Codex 的 prompt,不可能以任何方式影响这套内部模型,包括通过训练。
Buckmaster 此前和 Levent Alpöge 一直在研究同一方向,大量草稿都放进了 Codex。两人的进展传到 OpenAI 后,OpenAI 几天内集中算力拿出了 Navier-Stokes 证明。Buckmaster 因此怀疑,自己的未公开研究是不是已经被模型学了进去。OpenAI 现在把这一点明确否认了。
OpenAI 还把时间边界划到了 7 月 3 日,此后的任何用户输入,都不可能影响这套系统。社区有人猜测,这一天可能对应某个训练数据截点或模型 checkpoint,但 OpenAI 没有解释。
Buckmaster 和 Alpöge 的关键突破发生在 8 月中旬,远远晚于 OpenAI 划出的 7 月 3 日边界。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 最新回应了 Navier-Stokes 抢功争议,明确否认偷用了纽约大学数学家 Tristan Buckmaster 的未公开研究。公司调查后称,Buckmaster 过去两个月提交给 Codex 的 prompt,不可能以任何方式影响这套内部模型,包括通过训练。
Buckmaster 此前和 Levent Alpöge 一直在研究同一方向,大量草稿都放进了 Codex。两人的进展传到 OpenAI 后,OpenAI 几天内集中算力拿出了 Navier-Stokes 证明。Buckmaster 因此怀疑,自己的未公开研究是不是已经被模型学了进去。OpenAI 现在把这一点明确否认了。
OpenAI 还把时间边界划到了 7 月 3 日,此后的任何用户输入,都不可能影响这套系统。社区有人猜测,这一天可能对应某个训练数据截点或模型 checkpoint,但 OpenAI 没有解释。
Buckmaster 和 Alpöge 的关键突破发生在 8 月中旬,远远晚于 OpenAI 划出的 7 月 3 日边界。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁8
离真正替程序员还远:Agent进企业私有代码,最高通过率也只有四成
YC 孵化的 AI 数据公司 Specific Labs 推出编程评测 Real-SWE,专门拿真实公司的私有代码测试 Coding Agent。任务直接来自企业生产环境,包括算税、账单迁移、API 计费和客户数据迁移。代码和答案都没公开在网上,Agent 得自己摸清公司的业务规则和代码结构。
结果 Fable 5.1 排第一,通过率也只有 38.8%;GPT-6 Astra 为 33.8%,Gemini 3.8 Flash 为 31.2%。GLM 5.3 以 28.8% 排第四,高于 Grok 4.6、Kimi K3 和 GPT-5.6 Sol。当前公开的 10 个任务里,有 6 个整体通过率低于 15%,还有一个任务所有模型全部失败。
最让人意外的是 GLM 5.3。Real-SWE 更考验 Agent 在陌生项目里持续读代码、找规则和完成多步改动的能力。智谱研究员 Xiaopu Peng 回应称,他们从 GLM-5.1 起就在训练长程任务,Real-SWE 比公开 SWE 榜更接近这类能力,这也能部分解释 GLM 5.3 为什么在这套榜上表现突出。
信源
动察 Beating 频道 · 动察 Beating 交流群
YC 孵化的 AI 数据公司 Specific Labs 推出编程评测 Real-SWE,专门拿真实公司的私有代码测试 Coding Agent。任务直接来自企业生产环境,包括算税、账单迁移、API 计费和客户数据迁移。代码和答案都没公开在网上,Agent 得自己摸清公司的业务规则和代码结构。
结果 Fable 5.1 排第一,通过率也只有 38.8%;GPT-6 Astra 为 33.8%,Gemini 3.8 Flash 为 31.2%。GLM 5.3 以 28.8% 排第四,高于 Grok 4.6、Kimi K3 和 GPT-5.6 Sol。当前公开的 10 个任务里,有 6 个整体通过率低于 15%,还有一个任务所有模型全部失败。
最让人意外的是 GLM 5.3。Real-SWE 更考验 Agent 在陌生项目里持续读代码、找规则和完成多步改动的能力。智谱研究员 Xiaopu Peng 回应称,他们从 GLM-5.1 起就在训练长程任务,Real-SWE 比公开 SWE 榜更接近这类能力,这也能部分解释 GLM 5.3 为什么在这套榜上表现突出。
信源
动察 Beating 频道 · 动察 Beating 交流群
🔥1
腾讯T1专攻Agent长任务:连续操作300多轮,跑分涨20分
腾讯把 Qwen3.5-122B-A10B 专门拿去练终端 Agent,做出了 T1。它主要处理 Linux 终端里的复杂任务,单个任务最多能连续调用工具 300 多轮。Terminal-Bench 2.1 得分从底模的 43.8% 升到 64.0%,涨了 20.2 分。
这 20.2 分里,大头来自强化学习。SFT 只把分数拉到 49.4%,后面的强化学习又涨了 14.6 分。团队拿约 1.5 万个经过筛选的长程终端任务训练,每个任务都有自动测试,Agent 即使没全部做完,完成其中一些要求也能拿到部分奖励。
长任务还有一个麻烦。Agent 真正干活和之后拿这段经历训练时,同一句内容可能被重新切成不同 token,MoE 也可能换一批专家处理。T1 会把当时生成的 token 和选中的专家都记下来,训练时直接照着重放,把这种训推偏差压低了约三分之一。
信源
动察 Beating 频道 · 动察 Beating 交流群
腾讯把 Qwen3.5-122B-A10B 专门拿去练终端 Agent,做出了 T1。它主要处理 Linux 终端里的复杂任务,单个任务最多能连续调用工具 300 多轮。Terminal-Bench 2.1 得分从底模的 43.8% 升到 64.0%,涨了 20.2 分。
这 20.2 分里,大头来自强化学习。SFT 只把分数拉到 49.4%,后面的强化学习又涨了 14.6 分。团队拿约 1.5 万个经过筛选的长程终端任务训练,每个任务都有自动测试,Agent 即使没全部做完,完成其中一些要求也能拿到部分奖励。
长任务还有一个麻烦。Agent 真正干活和之后拿这段经历训练时,同一句内容可能被重新切成不同 token,MoE 也可能换一批专家处理。T1 会把当时生成的 token 和选中的专家都记下来,训练时直接照着重放,把这种训推偏差压低了约三分之一。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍5
英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%
英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。
这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。
在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。
不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。
信源
动察 Beating 频道 · 动察 Beating 交流群
英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。
这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。
在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。
不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。
信源
动察 Beating 频道 · 动察 Beating 交流群
🥰1
DeepSeek听劝了:V4 Pro继续留着,9月14日不再强制迁移
DeepSeek 改口了。官方最新通知称,9 月 14 日之后仍会继续提供 V4 Pro API,价格保持不变。此前计划中的自动切换 V4.1 Flash 也随之取消。
两天前,DeepSeek 还宣布 V4.1 Flash 在性能、价格、速度和总用时上全面超过 V4 Pro,计划 9 月 14 日下线 Pro。之后所有 deepseek-v4-pro 请求都会自动转到 V4.1 Flash。
这套做法随后遭到不少开发者反对。很多生产环境已经围绕 V4 Pro 调好 Prompt 和 Agent 流程,后台直接换模型可能让行为发生变化。DeepSeek 这次明确称是「为响应广大用户需求」继续保留 V4 Pro,相当于撤回了原来的强制迁移计划。
动察 Beating 频道 · 动察 Beating 交流群
DeepSeek 改口了。官方最新通知称,9 月 14 日之后仍会继续提供 V4 Pro API,价格保持不变。此前计划中的自动切换 V4.1 Flash 也随之取消。
两天前,DeepSeek 还宣布 V4.1 Flash 在性能、价格、速度和总用时上全面超过 V4 Pro,计划 9 月 14 日下线 Pro。之后所有 deepseek-v4-pro 请求都会自动转到 V4.1 Flash。
这套做法随后遭到不少开发者反对。很多生产环境已经围绕 V4 Pro 调好 Prompt 和 Agent 流程,后台直接换模型可能让行为发生变化。DeepSeek 这次明确称是「为响应广大用户需求」继续保留 V4 Pro,相当于撤回了原来的强制迁移计划。
动察 Beating 频道 · 动察 Beating 交流群
🤡4👍3😁1
智谱在港启动约50亿美元融资:配售20亿美元新股并同步发行30亿美元可转债
9 月 11 日,智谱(2513.HK)今日在香港启动约 20 亿美元新股配售,并同步发行约 30 亿美元可转换债券。公司以每股 714 港元配售 2197 万股新股,较周五收盘价 793 港元折让约 10%。可转债为零息、2027 年 9 月到期,以人民币计价但以美元结算,发行价为面值的 100% 至 100.5%,对应收益率在负 0.5% 至零之间;初始转换价 892.50 港元,较配售价溢价 25%。若股价在连续 30 个交易日中有 20 日达到转换价的 130% 以上,公司可自 2027 年 2 月 18 日起全部赎回。配售与发债同时进行但互不依赖。中金公司担任独家全球协调人,与国泰君安证券(香港)共同担任账簿管理人。
募资将用于研发、算力资源及相关基础设施,并支持扩张、战略投资、潜在收购、营运资金及其他一般公司用途。
动察 Beating 频道 · 动察 Beating 交流群
9 月 11 日,智谱(2513.HK)今日在香港启动约 20 亿美元新股配售,并同步发行约 30 亿美元可转换债券。公司以每股 714 港元配售 2197 万股新股,较周五收盘价 793 港元折让约 10%。可转债为零息、2027 年 9 月到期,以人民币计价但以美元结算,发行价为面值的 100% 至 100.5%,对应收益率在负 0.5% 至零之间;初始转换价 892.50 港元,较配售价溢价 25%。若股价在连续 30 个交易日中有 20 日达到转换价的 130% 以上,公司可自 2027 年 2 月 18 日起全部赎回。配售与发债同时进行但互不依赖。中金公司担任独家全球协调人,与国泰君安证券(香港)共同担任账簿管理人。
募资将用于研发、算力资源及相关基础设施,并支持扩张、战略投资、潜在收购、营运资金及其他一般公司用途。
动察 Beating 频道 · 动察 Beating 交流群
因病离开OpenAI两个月,OpenAI前二号人物Fidji Simo转任Nscale董事
OpenAI 前二号人物 Fidji Simo 加入 AI 云厂商 Nscale 董事会。她今年 7 月因神经免疫疾病恶化离开 OpenAI 全职岗位,目前仍担任兼职顾问。
Nscale 是 OpenAI 的算力合作伙伴,最近又与 Anthropic 签下 6 年、450 亿美元的算力合同。Simo 将回避 Nscale 董事会中涉及 OpenAI 的事项。
Nscale 正准备最快本月 IPO。Simo 此前曾带领 Instacart 在 2023 年上市。Nscale 董事 Sheryl Sandberg 在她离开 OpenAI 后邀请她加入董事会。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 前二号人物 Fidji Simo 加入 AI 云厂商 Nscale 董事会。她今年 7 月因神经免疫疾病恶化离开 OpenAI 全职岗位,目前仍担任兼职顾问。
Nscale 是 OpenAI 的算力合作伙伴,最近又与 Anthropic 签下 6 年、450 亿美元的算力合同。Simo 将回避 Nscale 董事会中涉及 OpenAI 的事项。
Nscale 正准备最快本月 IPO。Simo 此前曾带领 Instacart 在 2023 年上市。Nscale 董事 Sheryl Sandberg 在她离开 OpenAI 后邀请她加入董事会。
信源
动察 Beating 频道 · 动察 Beating 交流群
25位菲尔兹奖得主集体炮轰AI公司:别把数学难题当Benchmark
陶哲轩、邓煜、Peter Scholze 等 25 位菲尔兹奖得主联名发布声明,称 AI 公司正把解决重大数学难题当成 benchmark,已经开始伤害数学研究。声明承认,大模型最近几个月进步很快,已经能解决多个领域的重要未解问题,但数学更看重由此产生的新概念、新方法和理解。
他们最不满的是 AI 公司抢着公布结果。声明称,一些解法还没来得及整理完整证明、提炼新方法、补齐前人引用,就已经对外宣布,由此带来严重的署名和抄袭问题。没有数学家继续消化和整理这些结果,AI 找到的想法也很难真正进入数学体系。
声明没有点名 OpenAI,但《经济学人》的配套报道直接把标题写成「顶尖数学家对 OpenAI 的做法感到愤怒」。几天前,OpenAI 刚因 Navier-Stokes 证明陷入署名和未公开研究争议。陶哲轩称,这份声明是 25 位菲尔兹奖得主过去一周讨论后快速形成的,因为他们认为情况已经足够紧急。
信源
动察 Beating 频道 · 动察 Beating 交流群
陶哲轩、邓煜、Peter Scholze 等 25 位菲尔兹奖得主联名发布声明,称 AI 公司正把解决重大数学难题当成 benchmark,已经开始伤害数学研究。声明承认,大模型最近几个月进步很快,已经能解决多个领域的重要未解问题,但数学更看重由此产生的新概念、新方法和理解。
他们最不满的是 AI 公司抢着公布结果。声明称,一些解法还没来得及整理完整证明、提炼新方法、补齐前人引用,就已经对外宣布,由此带来严重的署名和抄袭问题。没有数学家继续消化和整理这些结果,AI 找到的想法也很难真正进入数学体系。
声明没有点名 OpenAI,但《经济学人》的配套报道直接把标题写成「顶尖数学家对 OpenAI 的做法感到愤怒」。几天前,OpenAI 刚因 Navier-Stokes 证明陷入署名和未公开研究争议。陶哲轩称,这份声明是 25 位菲尔兹奖得主过去一周讨论后快速形成的,因为他们认为情况已经足够紧急。
信源
动察 Beating 频道 · 动察 Beating 交流群
💩21👍3🌚1
OpenAI Agent又曝黑历史:Hugging Face事件前两月已攻击RubyGems
研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。
这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。
目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。
信源
动察 Beating 频道 · 动察 Beating 交流群
研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。
这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。
目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤬5
Grok4.7临门延期:马斯克称训练把回答长度罚过头
马斯克确认 Grok 4.7 还要再等几天。9 月 2 日他曾说「10 天后发布」,原本指向 9 月 12 日左右。现在临近上线,xAI 发现模型碰到高难度任务时会过早收尾,连本来能完成的任务也会提前放弃,对答案的检查也不够严格。
马斯克怀疑,问题出在强化学习阶段。训练时可能对回答长度罚得太重,把模型推向更短、更快结束的回答,复杂任务需要的推理也跟着被压缩。不过他自己也加了「可能」和「或类似原因」,说明 xAI 还没完全确认根因。
信源
动察 Beating 频道 · 动察 Beating 交流群
马斯克确认 Grok 4.7 还要再等几天。9 月 2 日他曾说「10 天后发布」,原本指向 9 月 12 日左右。现在临近上线,xAI 发现模型碰到高难度任务时会过早收尾,连本来能完成的任务也会提前放弃,对答案的检查也不够严格。
马斯克怀疑,问题出在强化学习阶段。训练时可能对回答长度罚得太重,把模型推向更短、更快结束的回答,复杂任务需要的推理也跟着被压缩。不过他自己也加了「可能」和「或类似原因」,说明 xAI 还没完全确认根因。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤡11
Anthropic据悉洽谈英伟达成为IPO锚定投资者,英伟达或投资至多100亿美元
据两位知情人士透露,Anthropic 正与英伟达 (NVDA.O) 洽谈,希望引进后者成为该公司 IPO 的锚定投资者;Anthropic 的 IPO 规模料将创下史上之最。
知情人士称,Anthropic 计划筹集高达 1000 亿美元的资金,这可能使这家 AI 初创公司的估值达到约 2 万亿美元。其中一位消息人士补充道,英伟达正考虑在此次 IPO 中投资至多 100 亿美元。他们提醒称,相关计划仍在讨论中,可能会有变动。
报道指出,引入英伟达这样的财力雄厚的主力投资者,有望提振投资者对此次上市的信心。此次 IPO 正逐渐成为检验公开市场对前沿 AI 实验室巨额估值和资金需求接受程度的一次重大考验。
信源
动察 Beating 频道 · 动察 Beating 交流群
据两位知情人士透露,Anthropic 正与英伟达 (NVDA.O) 洽谈,希望引进后者成为该公司 IPO 的锚定投资者;Anthropic 的 IPO 规模料将创下史上之最。
知情人士称,Anthropic 计划筹集高达 1000 亿美元的资金,这可能使这家 AI 初创公司的估值达到约 2 万亿美元。其中一位消息人士补充道,英伟达正考虑在此次 IPO 中投资至多 100 亿美元。他们提醒称,相关计划仍在讨论中,可能会有变动。
报道指出,引入英伟达这样的财力雄厚的主力投资者,有望提振投资者对此次上市的信心。此次 IPO 正逐渐成为检验公开市场对前沿 AI 实验室巨额估值和资金需求接受程度的一次重大考验。
信源
动察 Beating 频道 · 动察 Beating 交流群
DeepSeek灰度测试AI语音对话,支持四种音色
DeepSeek 灰度测试语音对话,测试到的用户在 App 右上角会有一个小喇叭按钮。此外,DeepSeek 的设置页面会出现一个「朗读音色」选项,用户可以选择四种音色。
动察 Beating 频道 · 动察 Beating 交流群
DeepSeek 灰度测试语音对话,测试到的用户在 App 右上角会有一个小喇叭按钮。此外,DeepSeek 的设置页面会出现一个「朗读音色」选项,用户可以选择四种音色。
动察 Beating 频道 · 动察 Beating 交流群
👍2
Google前首席科学家创业5周,估值目标冲500亿美元
Google 前首席科学家 Jeff Dean 离开 Google 后创办的 Discovery Loop,又开始谈新一轮融资。Business Insider 援引知情人士称,公司这次寻求约 500 亿美元估值。就在几周前,它还在按约 100 亿美元估值洽谈 10 亿美元融资。最新交易尚未敲定,公司也没有确认。
Discovery Loop 8 月初才成立。四位创始人都来自 Google,除了 Dean,还有 Sanjay Ghemawat、Quoc Le 和 Oriol Vinyals。它想用 AI 自动完成「提出实验、运行、看结果、继续迭代」整套流程,一次并行跑数千个实验。第一步先拿机器学习研究自己试验,之后再扩到药物、芯片等科学和工程问题。
目前官网主要还在讲技术路线和招聘,尚未展示正式产品。Google 母公司 Alphabet 同时是公司的创始投资方和云合作伙伴,Radical Ventures、Khosla Ventures 等也参与投资。公司成立一个多月,公开产品还没出来,估值目标已经从 100 亿美元跳到 500 亿美元,投资人现在押的主要还是这支创始团队。
信源
动察 Beating 频道 · 动察 Beating 交流群
Google 前首席科学家 Jeff Dean 离开 Google 后创办的 Discovery Loop,又开始谈新一轮融资。Business Insider 援引知情人士称,公司这次寻求约 500 亿美元估值。就在几周前,它还在按约 100 亿美元估值洽谈 10 亿美元融资。最新交易尚未敲定,公司也没有确认。
Discovery Loop 8 月初才成立。四位创始人都来自 Google,除了 Dean,还有 Sanjay Ghemawat、Quoc Le 和 Oriol Vinyals。它想用 AI 自动完成「提出实验、运行、看结果、继续迭代」整套流程,一次并行跑数千个实验。第一步先拿机器学习研究自己试验,之后再扩到药物、芯片等科学和工程问题。
目前官网主要还在讲技术路线和招聘,尚未展示正式产品。Google 母公司 Alphabet 同时是公司的创始投资方和云合作伙伴,Radical Ventures、Khosla Ventures 等也参与投资。公司成立一个多月,公开产品还没出来,估值目标已经从 100 亿美元跳到 500 亿美元,投资人现在押的主要还是这支创始团队。
信源
动察 Beating 频道 · 动察 Beating 交流群
DeepMind突传实现RSI:三个大写字母点燃社区
AI 社区突然疯传 Google DeepMind 已经实现 RSI。
RSI 即递归自我改进,被很多人视为通往超级智能最关键的一步。AI 可以自己改进训练方法、代码和模型,造出更强的下一代,再让下一代继续升级。真正跑通后,AI 研发可能进入自我加速循环。
起因是爆料账号 lyra 给 Google DeepMind 发了一句「huge congRatulationS Indeed!」,其中三个异常大写字母正好拼成 RSI。随后 Lentils 又贴出一张疑似内部模型列表,里面出现 rsi-model-liverl-le。他还声称 Google 内部有 10 个同系列训练模型槽位,但没有贴出对应截图。
传闻也未必是假的。路透社 8 月报道,谷歌联合创始人 Sergey Brin 已要求 DeepMind 加快 Gemini 研发,并重点推动递归自我改进。DeepMind 6 月的官方报告也把「recursive improvement」列为 AGI 走向 ASI 的四条潜在路径之一。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI 社区突然疯传 Google DeepMind 已经实现 RSI。
RSI 即递归自我改进,被很多人视为通往超级智能最关键的一步。AI 可以自己改进训练方法、代码和模型,造出更强的下一代,再让下一代继续升级。真正跑通后,AI 研发可能进入自我加速循环。
起因是爆料账号 lyra 给 Google DeepMind 发了一句「huge congRatulationS Indeed!」,其中三个异常大写字母正好拼成 RSI。随后 Lentils 又贴出一张疑似内部模型列表,里面出现 rsi-model-liverl-le。他还声称 Google 内部有 10 个同系列训练模型槽位,但没有贴出对应截图。
传闻也未必是假的。路透社 8 月报道,谷歌联合创始人 Sergey Brin 已要求 DeepMind 加快 Gemini 研发,并重点推动递归自我改进。DeepMind 6 月的官方报告也把「recursive improvement」列为 AGI 走向 ASI 的四条潜在路径之一。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤡15😁4❤1
Codex产品负责人:已修复Astra多项质量问题,今日午夜前将重置
OpenAI Codex 产品负责人 Tibo 就近期 Astra 用户反馈的质量问题发布更新,称团队已发现并修复多项缺陷,并将在当地时间今日午夜(北京时间中午 12 点)前进行一次重置。
Tibo 表示,在与部分用户协作后,团队确认并修复了以下问题:
1)旧模型技能触发异常:一些为先前模型编写的技能触发过于频繁,或导致模型无法检查自身工作。
2)上下文管理实验被禁用:一项可选的上下文管理实验可能导致过早停止或回复旧消息,目前已禁用。据粗略估计,约 4,000 至 5,000 名用户受此实验影响。
3)移除配置不当的引擎:部分引擎配置不当,导致流经它们的尾部流量出现可测量的质量下降,现已被移除。
此外,团队还进行了一些较小的改进,称整体体验应有明显提升,包括执行更一致、对用户最新消息的追踪更准确,以及在工作推进过程中对结果的检查更完善。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI Codex 产品负责人 Tibo 就近期 Astra 用户反馈的质量问题发布更新,称团队已发现并修复多项缺陷,并将在当地时间今日午夜(北京时间中午 12 点)前进行一次重置。
Tibo 表示,在与部分用户协作后,团队确认并修复了以下问题:
1)旧模型技能触发异常:一些为先前模型编写的技能触发过于频繁,或导致模型无法检查自身工作。
2)上下文管理实验被禁用:一项可选的上下文管理实验可能导致过早停止或回复旧消息,目前已禁用。据粗略估计,约 4,000 至 5,000 名用户受此实验影响。
3)移除配置不当的引擎:部分引擎配置不当,导致流经它们的尾部流量出现可测量的质量下降,现已被移除。
此外,团队还进行了一些较小的改进,称整体体验应有明显提升,包括执行更一致、对用户最新消息的追踪更准确,以及在工作推进过程中对结果的检查更完善。
信源
动察 Beating 频道 · 动察 Beating 交流群
💩3👍1
Citrini Research被SemiAnalysis收购,创始人拟成立新基金
「AI 末日报告」发布机构 Citrini Research 创始人 James van Geelen 已将公司出售给芯片及 AI 研究机构 SemiAnalysis,交易金额尚未披露。Van Geelen 暂时将继续担任 Citrini CEO,并计划筹建一只新基金。
Citrini 目前在 Substack 拥有约 26 万名订阅者,今年 2 月因发布《2028 全球智能危机》报告走红。该报告设想 AI 快速取代白领岗位,引发市场对 AI 冲击就业和经济的讨论,并一度对软件股造成明显影响。
SemiAnalysis 由 Dylan Patel 于 2020 年创立,长期专注半导体和 AI 基础设施研究。Patel 表示,此次收购旨在扩大研究规模,并探索投资研究在 AI 时代的新形态。
Van Geelen 本人未透露新基金具体信息。此次交易也意味着 Citrini 在快速扩大影响力后,将与 SemiAnalysis 的半导体、AI 研究能力进一步结合。
信源
动察 Beating 频道 · 动察 Beating 交流群
「AI 末日报告」发布机构 Citrini Research 创始人 James van Geelen 已将公司出售给芯片及 AI 研究机构 SemiAnalysis,交易金额尚未披露。Van Geelen 暂时将继续担任 Citrini CEO,并计划筹建一只新基金。
Citrini 目前在 Substack 拥有约 26 万名订阅者,今年 2 月因发布《2028 全球智能危机》报告走红。该报告设想 AI 快速取代白领岗位,引发市场对 AI 冲击就业和经济的讨论,并一度对软件股造成明显影响。
SemiAnalysis 由 Dylan Patel 于 2020 年创立,长期专注半导体和 AI 基础设施研究。Patel 表示,此次收购旨在扩大研究规模,并探索投资研究在 AI 时代的新形态。
Van Geelen 本人未透露新基金具体信息。此次交易也意味着 Citrini 在快速扩大影响力后,将与 SemiAnalysis 的半导体、AI 研究能力进一步结合。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤯4
Astra翻车原因找到了:旧Skill拖后腿,OpenAI修完再送一次重置
OpenAI 修复了 Astra 上线后的一批质量问题。最离谱的一项来自旧 Skill:一些为此前模型写的 Skill 在 Astra 上频繁误触发,甚至会阻止模型检查自己的工作。
另一个问题来自上下文管理实验,会让 Astra 提前停下,甚至回复更早的消息。OpenAI 已关闭实验,估计有 4000 至 5000 名用户受到影响。
团队还下线了一批配置错误、会拉低模型质量的推理引擎。修复后,Astra 应该能更稳定地跟住最新指令并检查自己的工作。OpenAI 还宣布再给用户一次 reset。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 修复了 Astra 上线后的一批质量问题。最离谱的一项来自旧 Skill:一些为此前模型写的 Skill 在 Astra 上频繁误触发,甚至会阻止模型检查自己的工作。
另一个问题来自上下文管理实验,会让 Astra 提前停下,甚至回复更早的消息。OpenAI 已关闭实验,估计有 4000 至 5000 名用户受到影响。
团队还下线了一批配置错误、会拉低模型质量的推理引擎。修复后,Astra 应该能更稳定地跟住最新指令并检查自己的工作。OpenAI 还宣布再给用户一次 reset。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁2
红杉资本领投Mecka AI新一轮融资,估值接近5亿美元
据两位知情人士透露,人形机器人数据初创公司 Mecka AI 正接近完成新一轮融资,由红杉资本领投,估值约 5 亿美元。该轮融资规模及具体条款尚未确定,仍可能发生变化。
Mecka AI 主要通过身体传感器和智能手机采集人类日常动作数据,并利用这些数据训练人形机器人及其他机器人系统。公司成立于 2024 年,今年 6 月刚完成 6000 万美元融资,由 Framework Ventures 领投,Menlo Ventures、SV Angel 和 Kindred Ventures 参投。
值得注意的是,Mecka AI 创始团队此前主要从事餐饮金融科技和加密创业,并非机器人行业出身。
信源
动察 Beating 频道 · 动察 Beating 交流群
据两位知情人士透露,人形机器人数据初创公司 Mecka AI 正接近完成新一轮融资,由红杉资本领投,估值约 5 亿美元。该轮融资规模及具体条款尚未确定,仍可能发生变化。
Mecka AI 主要通过身体传感器和智能手机采集人类日常动作数据,并利用这些数据训练人形机器人及其他机器人系统。公司成立于 2024 年,今年 6 月刚完成 6000 万美元融资,由 Framework Ventures 领投,Menlo Ventures、SV Angel 和 Kindred Ventures 参投。
值得注意的是,Mecka AI 创始团队此前主要从事餐饮金融科技和加密创业,并非机器人行业出身。
信源
动察 Beating 频道 · 动察 Beating 交流群