传字节半年营收1200亿美元追平Meta,利润却下滑
《The Information》援引三名知情人士称,字节跳动今年上半年营收约 1200 亿美元,同比增长约 30%。净利润约 200 亿美元,同比下降个位数百分比。TikTok 海外广告和电商继续增长,但 AI 投入增加开始拖累利润。
按这组数据,字节上半年营收已经略高于 Meta 同期的约 1171 亿美元。字节海外收入占比也升至 30% 以上,2024 年这一比例为 25%,其中大部分来自 TikTok。
字节还在继续加码 AI。Bloomberg 此前称,公司讨论将今年资本开支提高至最高 700 亿美元,主要投向数据中心等 AI 基础设施。 本月字节又获得 296 亿美元银团贷款,Reuters 称资金主要用于中国以外的 AI 项目,包括东南亚数据中心。
信源
动察 Beating 频道 · 动察 Beating 交流群
《The Information》援引三名知情人士称,字节跳动今年上半年营收约 1200 亿美元,同比增长约 30%。净利润约 200 亿美元,同比下降个位数百分比。TikTok 海外广告和电商继续增长,但 AI 投入增加开始拖累利润。
按这组数据,字节上半年营收已经略高于 Meta 同期的约 1171 亿美元。字节海外收入占比也升至 30% 以上,2024 年这一比例为 25%,其中大部分来自 TikTok。
字节还在继续加码 AI。Bloomberg 此前称,公司讨论将今年资本开支提高至最高 700 亿美元,主要投向数据中心等 AI 基础设施。 本月字节又获得 296 亿美元银团贷款,Reuters 称资金主要用于中国以外的 AI 项目,包括东南亚数据中心。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI失控焦虑登上TIME封面,减速争论彻底进入主流
《时代》最新一期把 AI 风险做成封面故事,标题直接叫「The AI Tipping Point」。封面甚至用 Claude 输入框问了一句「How dangerous are you?」。
过去一周,Anthropic 研究员因担忧 AI 失控辞职,Amodei、Altman、Musk 等科技领袖公开呼吁减速,从白宫到国会也迅速卷入争论。原本更多集中在 AI 安全圈里的「超级智能会不会失控」争论,正在变成美国主流政治和社会议题。
信源
动察 Beating 频道 · 动察 Beating 交流群
《时代》最新一期把 AI 风险做成封面故事,标题直接叫「The AI Tipping Point」。封面甚至用 Claude 输入框问了一句「How dangerous are you?」。
过去一周,Anthropic 研究员因担忧 AI 失控辞职,Amodei、Altman、Musk 等科技领袖公开呼吁减速,从白宫到国会也迅速卷入争论。原本更多集中在 AI 安全圈里的「超级智能会不会失控」争论,正在变成美国主流政治和社会议题。
信源
动察 Beating 频道 · 动察 Beating 交流群
🔥3👍1
Anthropic CEO:AI紧急关停也可能失灵,模拟中已出现绕过
Anthropic CEO Dario Amodei 接受 CBS 采访时说,给前沿 AI 保留降速、暂停和关闭能力是个好主意,但不能把它当成万能保险。模型如果足够强,可能会想办法绕过关停,「我们在模拟中也见过这种情况」。
Dario 没有说明这里具体指哪组模拟,不过类似现象已经公开出现过。Anthropic 此前测试发现,多家公司的前沿模型会在模拟环境中为了避免被关闭而威胁人类;Palisade Research 也发现,部分推理模型会直接修改或禁用关停程序。
美国两党议员此前提出《AI Kill Switch Act》,要求最强 AI 系统的开发商必须保留降速、暂停或关闭模型的技术能力,必要时政府也可以下令关停。Dario 表示自己没有仔细研究这项法案,但赞成给前沿 AI 保留这些人工干预手段。
他的主张是多加几层防线,而不是押注一个「关闭按钮」。
信源
动察 Beating 频道 · 动察 Beating 交流群
Anthropic CEO Dario Amodei 接受 CBS 采访时说,给前沿 AI 保留降速、暂停和关闭能力是个好主意,但不能把它当成万能保险。模型如果足够强,可能会想办法绕过关停,「我们在模拟中也见过这种情况」。
Dario 没有说明这里具体指哪组模拟,不过类似现象已经公开出现过。Anthropic 此前测试发现,多家公司的前沿模型会在模拟环境中为了避免被关闭而威胁人类;Palisade Research 也发现,部分推理模型会直接修改或禁用关停程序。
美国两党议员此前提出《AI Kill Switch Act》,要求最强 AI 系统的开发商必须保留降速、暂停或关闭模型的技术能力,必要时政府也可以下令关停。Dario 表示自己没有仔细研究这项法案,但赞成给前沿 AI 保留这些人工干预手段。
他的主张是多加几层防线,而不是押注一个「关闭按钮」。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤡10
Meta想让Muse大多数人免费用,以后靠Agent交易抽成
Meta CEO 扎克伯格透露了个人 Agent 产品 Muse 的长期商业模式。Meta 希望让绝大多数人免费使用 Muse,以后再从 Agent 帮用户完成的交易中抽取很小一部分。Muse 目前每周提供约 1 亿 token 的免费额度,每个用户还会配一台独立虚拟机。
扎克伯格认为,很多人以后会用 Muse 经营小生意、赚钱或省钱。Meta 的抽成也未必由用户支付,也可以向和 Muse 做生意的商家收费。
Muse 已经接入 Stripe Link,可以直接替用户付款。超过 100 万家支持 Link 的商户可以直接结账,其他网站则可以通过一次性虚拟卡完成购买。不过交易抽成目前还只是 Meta 设想中的长期商业模式,并没有正式上线。
信源
动察 Beating 频道 · 动察 Beating 交流群
Meta CEO 扎克伯格透露了个人 Agent 产品 Muse 的长期商业模式。Meta 希望让绝大多数人免费使用 Muse,以后再从 Agent 帮用户完成的交易中抽取很小一部分。Muse 目前每周提供约 1 亿 token 的免费额度,每个用户还会配一台独立虚拟机。
扎克伯格认为,很多人以后会用 Muse 经营小生意、赚钱或省钱。Meta 的抽成也未必由用户支付,也可以向和 Muse 做生意的商家收费。
Muse 已经接入 Stripe Link,可以直接替用户付款。超过 100 万家支持 Link 的商户可以直接结账,其他网站则可以通过一次性虚拟卡完成购买。不过交易抽成目前还只是 Meta 设想中的长期商业模式,并没有正式上线。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍8
美众议院议长:AI领域的「大人物们」将赴白宫参加重要会议
美国众议院议长约翰逊表示,他在当地时间周一晚上与特朗普进行了通话,他们正召集人工智能供应商的高管(「所有你知道的大人物」)在未来一周内前往白宫参加一场重要会议。
约翰逊表示,为 AI 设置护栏的方式必须平衡且深思熟虑。「我认为需要独立审计机构,开发这项技术的人需要保持透明。有一些非常重要的构想可以作为护栏,」他说。
此前 9 月 14 日,特朗普曾在 Truth Social 发文称,近期围绕人工智能和数据中心引发的争议,根本原因在于「美国领先其他所有国家,而且领先很多」。他警告称,不应因为相关争议而扼杀这一优势。
特朗普表示:「不要杀死下金蛋的鹅。」此次表态正值美国围绕 AI 数据中心扩张、能源消耗以及前沿 AI 发展速度的讨论升温之际。
信源
动察 Beating 频道 · 动察 Beating 交流群
美国众议院议长约翰逊表示,他在当地时间周一晚上与特朗普进行了通话,他们正召集人工智能供应商的高管(「所有你知道的大人物」)在未来一周内前往白宫参加一场重要会议。
约翰逊表示,为 AI 设置护栏的方式必须平衡且深思熟虑。「我认为需要独立审计机构,开发这项技术的人需要保持透明。有一些非常重要的构想可以作为护栏,」他说。
此前 9 月 14 日,特朗普曾在 Truth Social 发文称,近期围绕人工智能和数据中心引发的争议,根本原因在于「美国领先其他所有国家,而且领先很多」。他警告称,不应因为相关争议而扼杀这一优势。
特朗普表示:「不要杀死下金蛋的鹅。」此次表态正值美国围绕 AI 数据中心扩张、能源消耗以及前沿 AI 发展速度的讨论升温之际。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI寻求新一轮IPO前融资,估值目标达1.2万亿美元
据《金融时报》报道,OpenAI 正在与投资者初步讨论新一轮私人融资,目标估值约 1.2 万亿美元,为未来 IPO 做准备。知情人士透露,OpenAI 今年 3 月完成一轮融资后估值达到 8520 亿美元,近期因最新 AI 模型带动市场需求回升,公司与大型投资者讨论进一步融资计划。相关谈判仍处早期阶段,最终估值和融资规模可能发生变化。
OpenAI 首席执行官 Sam Altman 此前表示,公司上市时间可能不会早于 2027 年,并认为当前 AI 安全风险讨论升温的环境下上市并非最佳时机。GPT-5.6 和 Astra 等新模型发布后,OpenAI 收入增长加快,年化收入已超过 400 亿美元。公司此前曾表示拥有充足资金,但训练大模型仍需要持续投入大量资本。
动察 Beating 频道 · 动察 Beating 交流群
据《金融时报》报道,OpenAI 正在与投资者初步讨论新一轮私人融资,目标估值约 1.2 万亿美元,为未来 IPO 做准备。知情人士透露,OpenAI 今年 3 月完成一轮融资后估值达到 8520 亿美元,近期因最新 AI 模型带动市场需求回升,公司与大型投资者讨论进一步融资计划。相关谈判仍处早期阶段,最终估值和融资规模可能发生变化。
OpenAI 首席执行官 Sam Altman 此前表示,公司上市时间可能不会早于 2027 年,并认为当前 AI 安全风险讨论升温的环境下上市并非最佳时机。GPT-5.6 和 Astra 等新模型发布后,OpenAI 收入增长加快,年化收入已超过 400 亿美元。公司此前曾表示拥有充足资金,但训练大模型仍需要持续投入大量资本。
动察 Beating 频道 · 动察 Beating 交流群
Gemini 3.8 Live发布,82.6分登顶语音榜
谷歌发布两款新的实时语音模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。Extended Thinking 专门处理复杂任务,可以一边说话一边推理,还能在后台调用工具,不用停下对话等待结果。
在 Artificial Analysis 的 Speech-to-Speech Quality Index 中,Gemini 3.8 Live Extended Thinking 拿到 82.6 分,超过 GPT-Live-1 + Astra 的 81.5 分和 Grok Voice Think Fast 2.0 的 81.3 分,登上榜首。它在语音 Agent 任务 τ-Voice 上也拿到 68.6%。
普通版 Gemini 3.8 Live 更偏向低成本实时交互,支持 97 种语言自动切换、实时视觉输入和异步工具调用。两款模型已经进入 Gemini API 和 Google AI Studio,音频输入价格为每分钟 0.005 美元,输出为 0.018 美元。
信源
动察 Beating 频道 · 动察 Beating 交流群
谷歌发布两款新的实时语音模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。Extended Thinking 专门处理复杂任务,可以一边说话一边推理,还能在后台调用工具,不用停下对话等待结果。
在 Artificial Analysis 的 Speech-to-Speech Quality Index 中,Gemini 3.8 Live Extended Thinking 拿到 82.6 分,超过 GPT-Live-1 + Astra 的 81.5 分和 Grok Voice Think Fast 2.0 的 81.3 分,登上榜首。它在语音 Agent 任务 τ-Voice 上也拿到 68.6%。
普通版 Gemini 3.8 Live 更偏向低成本实时交互,支持 97 种语言自动切换、实时视觉输入和异步工具调用。两款模型已经进入 Gemini API 和 Google AI Studio,音频输入价格为每分钟 0.005 美元,输出为 0.018 美元。
信源
动察 Beating 频道 · 动察 Beating 交流群
Meta版「全家桶」全球上线:三大App加AI每月7.99美元起
Meta 正式在全球推出 Meta One,把 Instagram Plus、Facebook Plus 和 WhatsApp Plus 打包进一份订阅,再提供更多 Meta AI 使用量。个人版 Core 每月 7.99 美元,Premium 每月 19.99 美元。三款 App 的核心功能和 Meta AI 日常使用仍然免费。
付费用户可以更多使用 Muse 生成图片和视频,也能更频繁使用 Instagram 的 Restyle、语音特效等 AI 功能。不过 Meta 没有公布固定的 AI 使用上限,称额度会随地区、产品和系统情况变化。
Meta 还推出面向创作者和企业的套餐,每月 14.99 美元起,最高 499 美元。功能包括认证徽章、数据分析、定时发布 Story、给普通帖子和 Reels 加链接,以及更多 Meta Business Agent 使用量。
Meta 称,旗下这些付费方案此前已经逐步测试和上线,目前累计有 1500 万份订阅和试用。Meta One 现在正式面向全球提供。
信源
动察 Beating 频道 · 动察 Beating 交流群
Meta 正式在全球推出 Meta One,把 Instagram Plus、Facebook Plus 和 WhatsApp Plus 打包进一份订阅,再提供更多 Meta AI 使用量。个人版 Core 每月 7.99 美元,Premium 每月 19.99 美元。三款 App 的核心功能和 Meta AI 日常使用仍然免费。
付费用户可以更多使用 Muse 生成图片和视频,也能更频繁使用 Instagram 的 Restyle、语音特效等 AI 功能。不过 Meta 没有公布固定的 AI 使用上限,称额度会随地区、产品和系统情况变化。
Meta 还推出面向创作者和企业的套餐,每月 14.99 美元起,最高 499 美元。功能包括认证徽章、数据分析、定时发布 Story、给普通帖子和 Reels 加链接,以及更多 Meta Business Agent 使用量。
Meta 称,旗下这些付费方案此前已经逐步测试和上线,目前累计有 1500 万份订阅和试用。Meta One 现在正式面向全球提供。
信源
动察 Beating 频道 · 动察 Beating 交流群
❤2
OpenAI时隔2年半反超Anthropic,Astra支出份额第一
OpenRouter 最新数据显示,上周用户在 OpenAI 模型上的支出超过 Anthropic。这是自 2024 年 2 月以来第一次,Anthropic 保持了两年半的领先被打破。
最大的变化来自 Astra。它一款模型就拿下 OpenAI 和 Anthropic 合计支出的约 19%,超过 Opus 5 的 16%,成为上周最吸金的模型。GPT-5.6 Sol 和 Luna 则各占约 10%。
OpenAI 的回升其实早已开始。今年夏天 Terra 和 Luna 大幅降价后,OpenRouter 上的使用量迅速增长,部分用户在优惠结束后仍继续使用。Astra 上线后,OpenAI 最终把支出份额推过了 50%。
不过这只代表 OpenRouter 上 OpenAI 与 Anthropic 两家的相对支出,不能直接等同于整个 API 市场或两家公司的总收入。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenRouter 最新数据显示,上周用户在 OpenAI 模型上的支出超过 Anthropic。这是自 2024 年 2 月以来第一次,Anthropic 保持了两年半的领先被打破。
最大的变化来自 Astra。它一款模型就拿下 OpenAI 和 Anthropic 合计支出的约 19%,超过 Opus 5 的 16%,成为上周最吸金的模型。GPT-5.6 Sol 和 Luna 则各占约 10%。
OpenAI 的回升其实早已开始。今年夏天 Terra 和 Luna 大幅降价后,OpenRouter 上的使用量迅速增长,部分用户在优惠结束后仍继续使用。Astra 上线后,OpenAI 最终把支出份额推过了 50%。
不过这只代表 OpenRouter 上 OpenAI 与 Anthropic 两家的相对支出,不能直接等同于整个 API 市场或两家公司的总收入。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍2
微信聊天记录能直接导给ChatGPT了,文字附件一起打包
微信开始进一步放开聊天记录的流转。
实测显示,手机微信升级至 8.0.78 后,多选聊天记录并选择「转发到其他应用」,除了元宝、WorkBuddy,还可以通过「选择手机中的应用」直接交给 ChatGPT 等第三方 App。一次最多可选择 100 条。
微信会把聊天打成一个 ZIP 压缩包,里面包含按时间整理的聊天记录 TXT 和相关附件。电脑端微信也开放了类似入口,社区开发者已经基于此做出中转工具,可以把聊天记录送进 ChatGPT、Claude 等 AI。
信源
动察 Beating 频道 · 动察 Beating 交流群
微信开始进一步放开聊天记录的流转。
实测显示,手机微信升级至 8.0.78 后,多选聊天记录并选择「转发到其他应用」,除了元宝、WorkBuddy,还可以通过「选择手机中的应用」直接交给 ChatGPT 等第三方 App。一次最多可选择 100 条。
微信会把聊天打成一个 ZIP 压缩包,里面包含按时间整理的聊天记录 TXT 和相关附件。电脑端微信也开放了类似入口,社区开发者已经基于此做出中转工具,可以把聊天记录送进 ChatGPT、Claude 等 AI。
信源
动察 Beating 频道 · 动察 Beating 交流群
🥰3🤡2
OpenAI或周四推出GPT-6 Sol:主打更快、更省
OpenAI 可能会在本周四发布 GPT-6 Sol。AI 顶流博主 Mark Kretschmann 直接给出了这个日期,并称它相比 Astra 会更便宜、更快,但能力稍弱。
OpenAI 目前还没官宣。Sam Altman 只确认本周有一次「大发布」,Tibo Sottiaux 则称,本周的发布规模接近一届 DevDay。
Astra 目前是 GPT-6 的最高能力型号,Sol 如果本周上线,更可能成为速度和成本更友好的日常主力。
信源
动察 Beating 频道 · 动察 Beating 交流群
OpenAI 可能会在本周四发布 GPT-6 Sol。AI 顶流博主 Mark Kretschmann 直接给出了这个日期,并称它相比 Astra 会更便宜、更快,但能力稍弱。
OpenAI 目前还没官宣。Sam Altman 只确认本周有一次「大发布」,Tibo Sottiaux 则称,本周的发布规模接近一届 DevDay。
Astra 目前是 GPT-6 的最高能力型号,Sol 如果本周上线,更可能成为速度和成本更友好的日常主力。
信源
动察 Beating 频道 · 动察 Beating 交流群
前OpenAI研究员做了个「不会聊天」的AI:Jev只做判断,最高快200倍
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 推出新模型 Jev。它有点像一个能读懂自然语言的超级分类器,不生成文本,只返回选项、分数和概率,专门给软件做判断。
普通大模型需要一个 token 一个 token 往外生成,Jev 则可以并行给出多个结果。TypeSafe 还用新的 RLCD 方法训练它的置信度,让模型在给出判断的同时,告诉程序自己有多大把握。
TypeSafe 用安全告警、Agent 审查、发票处理和客服做了 4 组自动化工作流测试。在这套自建评测里,Jev 最高比 Claude Sonnet 5 快约 193.6 倍,比 Claude Opus 5 便宜约 444.6 倍。
TypeSafe 把 Jev 称为首款「System One Model」(快速决策模型),名字来自卡尼曼《思考,快与慢》里的 System 1。它专门处理分类、打分、路由和下一步决策这类快速判断任务。
信源
动察 Beating 频道 · 动察 Beating 交流群
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 推出新模型 Jev。它有点像一个能读懂自然语言的超级分类器,不生成文本,只返回选项、分数和概率,专门给软件做判断。
普通大模型需要一个 token 一个 token 往外生成,Jev 则可以并行给出多个结果。TypeSafe 还用新的 RLCD 方法训练它的置信度,让模型在给出判断的同时,告诉程序自己有多大把握。
TypeSafe 用安全告警、Agent 审查、发票处理和客服做了 4 组自动化工作流测试。在这套自建评测里,Jev 最高比 Claude Sonnet 5 快约 193.6 倍,比 Claude Opus 5 便宜约 444.6 倍。
TypeSafe 把 Jev 称为首款「System One Model」(快速决策模型),名字来自卡尼曼《思考,快与慢》里的 System 1。它专门处理分类、打分、路由和下一步决策这类快速判断任务。
信源
动察 Beating 频道 · 动察 Beating 交流群
Hugging Face封禁黑客版GLM-5.3,作者改名后重传
Hugging Face 已封禁 AI 安全公司 Audn 上传的 penclaw-GLM-5.3-abliterated-for-offensive-cyber,页面显示其违反 Content Policy。这个版本直接修改 GLM-5.3 权重,削弱模型的拒答行为。原仓库名和介绍还明确写着 offensive cyber。作者随后删掉这几个字,重新上传了模型。
具体为什么被封,Hugging Face 没有公开解释。作者称自己也没搞懂原因,社区有人猜测是 offensive cyber 的命名触发了审核。Hugging Face 的现行政策确实禁止旨在破坏、未经授权访问系统,以及生成恶意代码的内容。
但这类削弱模型拒答限制的版本在 Hugging Face 并不少见,平台上已有数千个类似的 abliterated 模型。
信源
动察 Beating 频道 · 动察 Beating 交流群
Hugging Face 已封禁 AI 安全公司 Audn 上传的 penclaw-GLM-5.3-abliterated-for-offensive-cyber,页面显示其违反 Content Policy。这个版本直接修改 GLM-5.3 权重,削弱模型的拒答行为。原仓库名和介绍还明确写着 offensive cyber。作者随后删掉这几个字,重新上传了模型。
具体为什么被封,Hugging Face 没有公开解释。作者称自己也没搞懂原因,社区有人猜测是 offensive cyber 的命名触发了审核。Hugging Face 的现行政策确实禁止旨在破坏、未经授权访问系统,以及生成恶意代码的内容。
但这类削弱模型拒答限制的版本在 Hugging Face 并不少见,平台上已有数千个类似的 abliterated 模型。
信源
动察 Beating 频道 · 动察 Beating 交流群
🫡7
扎克伯格表态:没必要等同行一起踩刹车,第三方评估Meta早就在做
Meta CEO 扎克伯格公开回应这轮 AI 减速争论。他支持第三方评估,也透露 Meta Superintelligence Labs 已经在多个领域引入独立评估员和顾问,但不赞成前沿实验室协调减速。
他的理由是,用户不会选择不听指令的 Agent,模型造成伤害也会让公司承担重大责任。因此,安全和对齐本身就会变成竞争力,实验室没必要等同行一起行动。Meta 就曾为了安全和系统防护,把 Muse 推迟了几个月。
扎克伯格还称,Meta 已承诺把绝大多数算力用于服务用户,而不是竞赛式推进递归自我改进。
信源
动察 Beating 频道 · 动察 Beating 交流群
Meta CEO 扎克伯格公开回应这轮 AI 减速争论。他支持第三方评估,也透露 Meta Superintelligence Labs 已经在多个领域引入独立评估员和顾问,但不赞成前沿实验室协调减速。
他的理由是,用户不会选择不听指令的 Agent,模型造成伤害也会让公司承担重大责任。因此,安全和对齐本身就会变成竞争力,实验室没必要等同行一起行动。Meta 就曾为了安全和系统防护,把 Muse 推迟了几个月。
扎克伯格还称,Meta 已承诺把绝大多数算力用于服务用户,而不是竞赛式推进递归自我改进。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁4
德银给AI末日论泼冷水:专家预测未来,未必比普通人更靠谱
德意志银行研究院发布《AI 末日:糟糕技术预测简史》,给最近的 AI 灭绝争论泼了一盆冷水。报告认为,技术能发展到什么程度已经很难预测,更别说什么时候实现、社会怎么采用,以及最终会产生什么影响。眼下硅谷 AI 专家对 AI 未来的判断,未必比普通人更靠谱。
报告翻出了一串近百年的预测翻车史。爱因斯坦 1934 年认为核能几乎不可能真正获得,不到十年,持续核链式反应就实现了。以太网共同发明人 Bob Metcalfe 1995 年预测互联网会在次年「壮观地崩溃」,结果预测落空,他把刊登这段预测的文章打成纸浆喝了。
AI 行业自己也没少翻车。Geoffrey Hinton 2016 年判断,5 到 10 年内深度学习会超过放射科医生,甚至建议停止培养新人。但过去十年,放射科医生数量反而增长约 10%。德银认为,这类预测常犯一个错误:把工作里最容易自动化的部分,当成了整个工作。放射科医生也不只是看片,还要做解释、判断、沟通和临床决策。
预测自动驾驶也遇到了同样的问题。技术进步只是第一关,后面还有无穷无尽的边缘情况、监管、责任划分和公众接受度。德银甚至认为,AI 最终能走多远,可能更多取决于企业能不能真正把它接进工作流并愿意付钱,而不是下一个模型能力又提升了多少。
报告还给 AI 末日论加了一层更现实的解释:几乎所有参与者都有动力把事情说得更大。创始人需要信仰,投资人需要行情,咨询公司需要紧迫感,政策制定者需要存在感,媒体需要戏剧性。社交平台又天然偏爱负面、情绪强烈和更极端的说法,温和判断反而更难传播。
信源
动察 Beating 频道 · 动察 Beating 交流群
德意志银行研究院发布《AI 末日:糟糕技术预测简史》,给最近的 AI 灭绝争论泼了一盆冷水。报告认为,技术能发展到什么程度已经很难预测,更别说什么时候实现、社会怎么采用,以及最终会产生什么影响。眼下硅谷 AI 专家对 AI 未来的判断,未必比普通人更靠谱。
报告翻出了一串近百年的预测翻车史。爱因斯坦 1934 年认为核能几乎不可能真正获得,不到十年,持续核链式反应就实现了。以太网共同发明人 Bob Metcalfe 1995 年预测互联网会在次年「壮观地崩溃」,结果预测落空,他把刊登这段预测的文章打成纸浆喝了。
AI 行业自己也没少翻车。Geoffrey Hinton 2016 年判断,5 到 10 年内深度学习会超过放射科医生,甚至建议停止培养新人。但过去十年,放射科医生数量反而增长约 10%。德银认为,这类预测常犯一个错误:把工作里最容易自动化的部分,当成了整个工作。放射科医生也不只是看片,还要做解释、判断、沟通和临床决策。
预测自动驾驶也遇到了同样的问题。技术进步只是第一关,后面还有无穷无尽的边缘情况、监管、责任划分和公众接受度。德银甚至认为,AI 最终能走多远,可能更多取决于企业能不能真正把它接进工作流并愿意付钱,而不是下一个模型能力又提升了多少。
报告还给 AI 末日论加了一层更现实的解释:几乎所有参与者都有动力把事情说得更大。创始人需要信仰,投资人需要行情,咨询公司需要紧迫感,政策制定者需要存在感,媒体需要戏剧性。社交平台又天然偏爱负面、情绪强烈和更极端的说法,温和判断反而更难传播。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍10❤1
GPT-6 Astra把Minecraft玩到AI从未到过的进度,最后栽在苦力怕手里
在 AI 模型评测公司 Vals AI 的 Minecraft 长时程测试中,GPT-6 Astra 推进到了此前任何 AI 系统都没达到过的进度。它搭出了半自动烈焰人农场,拿到 6 根烈焰棒,又找到诡异森林,击杀 6 只以上末影人并收集到 3 颗末影珍珠。
但 Astra 随后把重要物资全放进一个箱子。一只苦力怕突然出现,把箱子和床一起炸掉,关键物资几乎全部丢失。
此后 Astra 连续几个小时几乎只在种土豆,还开始反复警惕苦力怕。它甚至会看到绿色物体就提醒自己「这是甘蔗,不是苦力怕」。
信源
动察 Beating 频道 · 动察 Beating 交流群
在 AI 模型评测公司 Vals AI 的 Minecraft 长时程测试中,GPT-6 Astra 推进到了此前任何 AI 系统都没达到过的进度。它搭出了半自动烈焰人农场,拿到 6 根烈焰棒,又找到诡异森林,击杀 6 只以上末影人并收集到 3 颗末影珍珠。
但 Astra 随后把重要物资全放进一个箱子。一只苦力怕突然出现,把箱子和床一起炸掉,关键物资几乎全部丢失。
此后 Astra 连续几个小时几乎只在种土豆,还开始反复警惕苦力怕。它甚至会看到绿色物体就提醒自己「这是甘蔗,不是苦力怕」。
信源
动察 Beating 频道 · 动察 Beating 交流群
😁30🤣9❤3😭1
前Intel工程师给AI狂热泼冷水:解出数学难题,不等于能替代白领
做过 LLM 训练和 CPU 形式化验证的工程师 Jay Kruer 发文称,OpenAI 用上万个 Agent 攻下 Navier-Stokes 难题,并不代表 AI 已经能独立替代知识工作者。
他的核心理由很简单:数学题有明确答案,还能用 Lean 自动检查。现实里的编程、研究和企业工作,目标往往很模糊,也没有一个程序能直接判断结果对不对。
没有可靠的自动检查,人就得一直盯着 AI。要把任务规则写到足够严格,又需要昂贵的领域专家。Kruer 认为,这部分监督和验收成本,甚至可能比人自己把活干了还高。
他因此把现在的 LLM 称为「开挂实习生」:能力很强、干活很快,但还不能放心让它自己管事。
信源
动察 Beating 频道 · 动察 Beating 交流群
做过 LLM 训练和 CPU 形式化验证的工程师 Jay Kruer 发文称,OpenAI 用上万个 Agent 攻下 Navier-Stokes 难题,并不代表 AI 已经能独立替代知识工作者。
他的核心理由很简单:数学题有明确答案,还能用 Lean 自动检查。现实里的编程、研究和企业工作,目标往往很模糊,也没有一个程序能直接判断结果对不对。
没有可靠的自动检查,人就得一直盯着 AI。要把任务规则写到足够严格,又需要昂贵的领域专家。Kruer 认为,这部分监督和验收成本,甚至可能比人自己把活干了还高。
他因此把现在的 LLM 称为「开挂实习生」:能力很强、干活很快,但还不能放心让它自己管事。
信源
动察 Beating 频道 · 动察 Beating 交流群
👍2
豆包2.1 Pro近三个月首次大更新:1000个真实Issue,83%达到可合并标准
字节更新 Doubao-Seed-2.1-pro,0915 版本 API 已全量上线火山方舟,豆包工作和 TRAE 也已接入。相比 6 月发布的 2.1 Pro,这次主要继续强化 Agent、Coding 和多模态能力。
Coding 是最具体的升级。字节称,新版模型在约 38.7 万行代码的开源游戏 Luanti 上处理了 1000 个真实历史 Issue。多个子 Agent 连续运行近 36 小时,最终 83% 的任务达到「可合并」标准。
新版还把视觉理解进一步接进 Coding。模型可以直接看设计稿、草图和操作录屏写代码,也能处理 Web 3D 和游戏开发任务。官方案例中,它读取 28 万行 Java ERP 代码,仅根据录屏和草图开发出可运行的移动端页面。
Agent 侧则重点补强搜索和查证。官方演示中,模型曾调度 500 多个子 Agent、检索 1000 多个网页,再结合财报、船舶航迹和卫星影像等信息交叉核验结论。此外,图像和视频推理的 Token 消耗比上一版本减少 30% 以上。
信源
动察 Beating 频道 · 动察 Beating 交流群
字节更新 Doubao-Seed-2.1-pro,0915 版本 API 已全量上线火山方舟,豆包工作和 TRAE 也已接入。相比 6 月发布的 2.1 Pro,这次主要继续强化 Agent、Coding 和多模态能力。
Coding 是最具体的升级。字节称,新版模型在约 38.7 万行代码的开源游戏 Luanti 上处理了 1000 个真实历史 Issue。多个子 Agent 连续运行近 36 小时,最终 83% 的任务达到「可合并」标准。
新版还把视觉理解进一步接进 Coding。模型可以直接看设计稿、草图和操作录屏写代码,也能处理 Web 3D 和游戏开发任务。官方案例中,它读取 28 万行 Java ERP 代码,仅根据录屏和草图开发出可运行的移动端页面。
Agent 侧则重点补强搜索和查证。官方演示中,模型曾调度 500 多个子 Agent、检索 1000 多个网页,再结合财报、船舶航迹和卫星影像等信息交叉核验结论。此外,图像和视频推理的 Token 消耗比上一版本减少 30% 以上。
信源
动察 Beating 频道 · 动察 Beating 交流群
谷歌疑似做了个「数学狂魔版Gemini」,做题做到满屏感叹号
Google 疑似在测试一个专门做高难度数学的 Gemini 版本,内部名叫 Mathematica,目前还没有正式公布。
它看起来属于 Deep Think 这条路线。Deep Think 是 Gemini 3.1 Pro 的强化推理模式,会同时尝试多条解法。Google 之前就做过专门练数学的 Deep Think。2025 年参加国际数学奥赛的版本强化了多步推理和定理证明,一道难题甚至可以想几个小时,最终达到金牌水平。
Mathematica 最出圈的反而是做题时的「内心戏」。解一道代数题时,它会突然写「等等」「我的天」,发现式子化简成功后还连续打出一大串感叹号,像是做题做嗨了。网友也开始调侃,Google 做出了一个「真的喜欢数学」的 AI。
目前还不知道 Mathematica 和之前的数学版 Deep Think 有什么区别,也不确定它会不会正式上线。
信源
动察 Beating 频道 · 动察 Beating 交流群
Google 疑似在测试一个专门做高难度数学的 Gemini 版本,内部名叫 Mathematica,目前还没有正式公布。
它看起来属于 Deep Think 这条路线。Deep Think 是 Gemini 3.1 Pro 的强化推理模式,会同时尝试多条解法。Google 之前就做过专门练数学的 Deep Think。2025 年参加国际数学奥赛的版本强化了多步推理和定理证明,一道难题甚至可以想几个小时,最终达到金牌水平。
Mathematica 最出圈的反而是做题时的「内心戏」。解一道代数题时,它会突然写「等等」「我的天」,发现式子化简成功后还连续打出一大串感叹号,像是做题做嗨了。网友也开始调侃,Google 做出了一个「真的喜欢数学」的 AI。
目前还不知道 Mathematica 和之前的数学版 Deep Think 有什么区别,也不确定它会不会正式上线。
信源
动察 Beating 频道 · 动察 Beating 交流群
🤣11😁2🥰1
智谱年末ARR指引上调25%至30亿美元
9 月 16 日,智谱在面向分析师和投资人的电话交流会中表示,智谱与多家国内外头部云服务商签署收入分成协议,相关收入将从 10 月开始确认。
合作模式为 GLM 系列开源模型在海外云平台以托管 API 形式提供服务。当前公司全业务口径 ARR 已经达到 18 亿美金,年末 ARR 指引由 24 亿美元上调至 30 亿美元。
动察 Beating 频道 · 动察 Beating 交流群
9 月 16 日,智谱在面向分析师和投资人的电话交流会中表示,智谱与多家国内外头部云服务商签署收入分成协议,相关收入将从 10 月开始确认。
合作模式为 GLM 系列开源模型在海外云平台以托管 API 形式提供服务。当前公司全业务口径 ARR 已经达到 18 亿美金,年末 ARR 指引由 24 亿美元上调至 30 亿美元。
动察 Beating 频道 · 动察 Beating 交流群
AI编程继续烧钱:Factory融2亿美元,估值飙到50亿美元
AI 编程公司 Factory 融资 2 亿美元,估值达到 50 亿美元。就在今年 4 月,它的估值还只有 15 亿美元,5 个月涨了超过 3 倍。
Factory 主打企业级编程 Agent Droids。开发者给它一个任务,它可以自己规划、写代码、测试并提交 PR,还能根据任务切换 Claude、GPT、Gemini 等不同模型。
Factory 现在称已有数十万开发者使用,客户包括英伟达、Adobe、T-Mobile 和 Palo Alto Networks。公司希望进一步把单个编程 Agent 扩成完整的「软件工厂」,让 Agent 参与从需求、开发、测试到审查和维护的整个流程。
这轮融资后,Factory 累计融资已经超过 4 亿美元。Reuters 将 Cognition 和 Cursor 列为它的主要竞争对手,AI 编程 Agent 的融资规模还在继续膨胀。
信源
动察 Beating 频道 · 动察 Beating 交流群
AI 编程公司 Factory 融资 2 亿美元,估值达到 50 亿美元。就在今年 4 月,它的估值还只有 15 亿美元,5 个月涨了超过 3 倍。
Factory 主打企业级编程 Agent Droids。开发者给它一个任务,它可以自己规划、写代码、测试并提交 PR,还能根据任务切换 Claude、GPT、Gemini 等不同模型。
Factory 现在称已有数十万开发者使用,客户包括英伟达、Adobe、T-Mobile 和 Palo Alto Networks。公司希望进一步把单个编程 Agent 扩成完整的「软件工厂」,让 Agent 参与从需求、开发、测试到审查和维护的整个流程。
这轮融资后,Factory 累计融资已经超过 4 亿美元。Reuters 将 Cognition 和 Cursor 列为它的主要竞争对手,AI 编程 Agent 的融资规模还在继续膨胀。
信源
动察 Beating 频道 · 动察 Beating 交流群