动察Beating AI News
前OpenAI研究人员质疑AI巨头万亿估值:越领先越烧钱 前 OpenAI 研究人员 Andrew Ho 发帖质疑前沿 AI 实验室的万亿美元估值。 按 Ho 的粗算,即使推理业务毛利率达到 80%,再给出 20 倍市盈率,一家公司也要做到 1000 亿至 2000 亿美元年收入,才可能支撑 1 万亿美元估值。这还假设公司不再花钱训练新模型。 现实中,OpenAI、Anthropic 等公司必须不断训练下一代模型。一旦停下来,用户就可能转向更便宜的 Qwen 或 Kimi。收入在涨,下一代模型的训练…
AI实验室值不值万亿美元,就看AGI还要等多久
前 OpenAI 研究人员 Andrew Ho 认为,大模型进步会更慢、更偏科,也更受数据限制。AI 全面进入经济可能还要几十年,因此 OpenAI、Anthropic 等公司的高估值很难成立。
知名 AI 播客主持人 Dwarkesh Patel 回应称,争议核心就是时间表。现在模型进步很快,领先三个月的产品,用户就愿意多付几倍价格。只要这种速度继续,头部实验室就能靠技术领先赚取高额收入。
Dwarkesh 也不认同 AI 落地需要几十年。真正达到人类水平后,AI 可以快速读完公司的 Slack 和 Drive,学会内部流程,再复制出更多实例。它进入企业,可能比招聘和培训员工更容易。
前 OpenAI 研究人员 Will Depue 的判断更激进。他预计递归自我改进可能在 24 个月内出现,未来 18 至 24 个月,AI 研究速度会明显加快。
马斯克则称,AI 已经在许多领域超过人类,「我们已经身处奇点」。他还说,两年前的 AI 如今已经像博物馆里的古董,两年后的 AI 会更惊人。
三人的共同判断是,AI 能力还会快速增长。区别在于时间表:Dwarkesh 认为短期不会停滞,Will 给出了 24 个月窗口,马斯克直接宣布奇点已经开始。
在这场争论里,AI 实验室能否撑起万亿美元估值,最终取决于这种进步速度能否持续,并真正变成收入。
Dwarkesh Patel
前 OpenAI 研究人员 Andrew Ho 认为,大模型进步会更慢、更偏科,也更受数据限制。AI 全面进入经济可能还要几十年,因此 OpenAI、Anthropic 等公司的高估值很难成立。
知名 AI 播客主持人 Dwarkesh Patel 回应称,争议核心就是时间表。现在模型进步很快,领先三个月的产品,用户就愿意多付几倍价格。只要这种速度继续,头部实验室就能靠技术领先赚取高额收入。
Dwarkesh 也不认同 AI 落地需要几十年。真正达到人类水平后,AI 可以快速读完公司的 Slack 和 Drive,学会内部流程,再复制出更多实例。它进入企业,可能比招聘和培训员工更容易。
前 OpenAI 研究人员 Will Depue 的判断更激进。他预计递归自我改进可能在 24 个月内出现,未来 18 至 24 个月,AI 研究速度会明显加快。
马斯克则称,AI 已经在许多领域超过人类,「我们已经身处奇点」。他还说,两年前的 AI 如今已经像博物馆里的古董,两年后的 AI 会更惊人。
三人的共同判断是,AI 能力还会快速增长。区别在于时间表:Dwarkesh 认为短期不会停滞,Will 给出了 24 个月窗口,马斯克直接宣布奇点已经开始。
在这场争论里,AI 实验室能否撑起万亿美元估值,最终取决于这种进步速度能否持续,并真正变成收入。
Dwarkesh Patel
👍2
动察Beating AI News
「斯坦福小镇」团队创业后提出AI三阶段论:预测→推理→模拟,称模拟才是通向超级智能的真正路径 斯坦福大学教授 Percy Liang 和 Simile AI CEO Joon Sung Park 发表博文,提出 AI 正在进入「模拟时代」。Percy Liang 认为,AI 迄今最令人印象深刻的成就都发生在环境和奖励函数明确的场景中(如围棋、IMO 数学竞赛、从零写出完整应用),RL 算法可以在沙盒中安全地尝试不同操作并观察结果。但现实世界中涉及人的问题(远程办公如何影响组织文化?如何为数百万学生重新设…
「斯坦福小镇」作者的AI公司要模拟全球80亿人,5个月估值20亿美元
人类行为模拟公司 Simile 完成 2 亿美元 B 轮融资,投后估值 20 亿美元。它用真实人类数据训练「AI 分身」。企业可以在产品、营销和政策落地前,先模拟不同人群会怎么反应。
Simile 五个月前才公开亮相并完成 1 亿美元 A 轮。公司称,这期间收入增长 5 倍。模型已为财富 100 强企业运行数千万次模拟。
客户可以一次调查数十万到数百万个 AI 分身。CVS Health 曾用 40 万个分身,研究怎样让患者更愿意服药。咨询公司德勤、民调机构盖洛普和自动理财平台 Wealthfront 也在使用。
Simile 的目标是准确模拟全球 80 亿人。但相关准确率主要由公司自己公布,外界仍质疑 AI 分身能否真正替代真人。现阶段,它更像传统市场调研前的快速筛选工具。
Simile 的 CEO Joon Sung Park 是 2023 年轰动学界的「斯坦福小镇」(Generative Agents)论文第一作者(让 25 个 AI 居民在虚拟小镇自主生活、产生涌现行为的经典实验)。
Simile
人类行为模拟公司 Simile 完成 2 亿美元 B 轮融资,投后估值 20 亿美元。它用真实人类数据训练「AI 分身」。企业可以在产品、营销和政策落地前,先模拟不同人群会怎么反应。
Simile 五个月前才公开亮相并完成 1 亿美元 A 轮。公司称,这期间收入增长 5 倍。模型已为财富 100 强企业运行数千万次模拟。
客户可以一次调查数十万到数百万个 AI 分身。CVS Health 曾用 40 万个分身,研究怎样让患者更愿意服药。咨询公司德勤、民调机构盖洛普和自动理财平台 Wealthfront 也在使用。
Simile 的目标是准确模拟全球 80 亿人。但相关准确率主要由公司自己公布,外界仍质疑 AI 分身能否真正替代真人。现阶段,它更像传统市场调研前的快速筛选工具。
Simile 的 CEO Joon Sung Park 是 2023 年轰动学界的「斯坦福小镇」(Generative Agents)论文第一作者(让 25 个 AI 居民在虚拟小镇自主生活、产生涌现行为的经典实验)。
Simile
Simile
Announcing Our Series B
Simile has raised over $200 million at a $2 billion post-money valuation, led by Greenoaks, to accelerate our mission: simulating all eight billion people.
👍2
MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音
MiniMax 发布全模态生成模型 H3。它能同时理解文字、图片、视频和声音,再按一条自然语言指令生成或编辑视频。
用户可以让 H3 照着一段视频学镜头运动,使用另一张图中的人物,再参考第三段音频的声音。过去需要分别调用的动作迁移、人物参考、声音参考和视频编辑,现在可以放进同一次任务。
H3 最长可生成 15 秒视频,支持 2K 分辨率和原生双声道声音。官方 API 的 2K 价格为每秒 0.13 美元,生成一段 15 秒视频约需 1.95 美元;768P 每秒 0.09 美元。
一次任务最多可输入 9 张图片、3 段视频和 3 段音频,总数不能超过 12 个文件。
MiniMax 计划未来几天开放模型权重。
MiniMax
MiniMax 发布全模态生成模型 H3。它能同时理解文字、图片、视频和声音,再按一条自然语言指令生成或编辑视频。
用户可以让 H3 照着一段视频学镜头运动,使用另一张图中的人物,再参考第三段音频的声音。过去需要分别调用的动作迁移、人物参考、声音参考和视频编辑,现在可以放进同一次任务。
H3 最长可生成 15 秒视频,支持 2K 分辨率和原生双声道声音。官方 API 的 2K 价格为每秒 0.13 美元,生成一段 15 秒视频约需 1.95 美元;768P 每秒 0.09 美元。
一次任务最多可输入 9 张图片、3 段视频和 3 段音频,总数不能超过 12 个文件。
MiniMax 计划未来几天开放模型权重。
MiniMax
动察Beating AI News
MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音 MiniMax 发布全模态生成模型 H3。它能同时理解文字、图片、视频和声音,再按一条自然语言指令生成或编辑视频。 用户可以让 H3 照着一段视频学镜头运动,使用另一张图中的人物,再参考第三段音频的声音。过去需要分别调用的动作迁移、人物参考、声音参考和视频编辑,现在可以放进同一次任务。 H3 最长可生成 15 秒视频,支持 2K 分辨率和原生双声道声音。官方 API 的 2K 价格为每秒 0.13 美元,生成一段 15 秒视频约需 1.95…
MiniMax H3拿下视频编辑第一,文生和图生视频均排第二
第三方评测机构 Artificial Analysis 公布 MiniMax H3 的视频榜单成绩。H3 在带声音的视频编辑中排名第一,Elo 得分为 1130,谷歌 Gemini Omni Flash 以 1121 分排名第二。
在带声音的文生视频榜单中,H3 以 1242 分排名第二,只比 Gemini Omni Flash 少 3 分。两款模型的置信区间重叠,实际表现可以视为同一梯队。
H3 在无声音的图生视频中同样排名第二,得分为 1351。它落后谷歌 Gemini Omni Flash,但超过字节跳动 Seedance 2.0。
这些排名来自匿名用户盲选。用户查看相同输入生成的视频,再选出更喜欢的一条,因此主要反映观看者的综合偏好,不等同于客观画质或指令遵循测试。
Artificial Analysis
第三方评测机构 Artificial Analysis 公布 MiniMax H3 的视频榜单成绩。H3 在带声音的视频编辑中排名第一,Elo 得分为 1130,谷歌 Gemini Omni Flash 以 1121 分排名第二。
在带声音的文生视频榜单中,H3 以 1242 分排名第二,只比 Gemini Omni Flash 少 3 分。两款模型的置信区间重叠,实际表现可以视为同一梯队。
H3 在无声音的图生视频中同样排名第二,得分为 1351。它落后谷歌 Gemini Omni Flash,但超过字节跳动 Seedance 2.0。
这些排名来自匿名用户盲选。用户查看相同输入生成的视频,再选出更喜欢的一条,因此主要反映观看者的综合偏好,不等同于客观画质或指令遵循测试。
Artificial Analysis
❤2
从豆包到芯片,字节跳动想借AI再造一个自己
字节跳动正把抖音和 TikTok 赚来的钱,大规模投向 AI。豆包只是入口,公司还在同时做基础模型、视频生成、企业云、海外数据中心和自研芯片。
豆包月活已达 3.24 亿。基础模型团队 Seed 扩至约 2000 人,火山引擎占中国 AI 云服务收入的 16%,排名第二。字节还在五个国家推进数据中心,并研发内部使用的推理芯片。
字节过去靠算法分发内容、出售广告赚钱。现在,它想把模型、应用、云和芯片全部做在自己手里,从流量平台变成一家全栈 AI 公司。
FT
字节跳动正把抖音和 TikTok 赚来的钱,大规模投向 AI。豆包只是入口,公司还在同时做基础模型、视频生成、企业云、海外数据中心和自研芯片。
豆包月活已达 3.24 亿。基础模型团队 Seed 扩至约 2000 人,火山引擎占中国 AI 云服务收入的 16%,排名第二。字节还在五个国家推进数据中心,并研发内部使用的推理芯片。
字节过去靠算法分发内容、出售广告赚钱。现在,它想把模型、应用、云和芯片全部做在自己手里,从流量平台变成一家全栈 AI 公司。
FT
🔥2
字节AI年化收入冲到40亿美元,位居中国AI公司第一
《南华早报》援引知情人士称,字节跳动大模型业务的年化经常性收入已达到 40 亿美元,按目前公开数据位居中国 AI 公司第一。
作为对比,阿里目前约为 15 亿美元,智谱约为 10 亿美元,DeepSeek 接近 5 亿美元,月之暗面约为 3 亿美元。字节已经明显拉开与国内同行的收入差距。
不过,ARR 是按当前收入速度推算未来一年,不等于已经赚到 40 亿美元。字节的 AI 收入也仍远低于 OpenAI 和 Anthropic。
SCMP
《南华早报》援引知情人士称,字节跳动大模型业务的年化经常性收入已达到 40 亿美元,按目前公开数据位居中国 AI 公司第一。
作为对比,阿里目前约为 15 亿美元,智谱约为 10 亿美元,DeepSeek 接近 5 亿美元,月之暗面约为 3 亿美元。字节已经明显拉开与国内同行的收入差距。
不过,ARR 是按当前收入速度推算未来一年,不等于已经赚到 40 亿美元。字节的 AI 收入也仍远低于 OpenAI 和 Anthropic。
SCMP
South China Morning Post
ByteDance sharpens AI focus as annualised revenue reaches US$4b
Company’s projected annual AI revenue is the largest known to the public among Chinese rivals, but still far behind US AI firms.
❤1
动察Beating AI News
特斯拉中国车机语音大模型服务完成备案,将接入豆包与DeepSeek 网信上海公布,特斯拉(上海)有限公司的「车机语音大模型服务」于 4 月 20 日完成生成式人工智能服务备案。 特斯拉中国官网此前发布的《特斯拉车机语音助手使用条款》已披露分工方案:Model Y L 车型将搭载豆包大模型与 DeepSeek 模型,均通过火山引擎加密 API 接入。豆包负责语音命令,覆盖导航设定、媒体播放、空调温度调节和车主手册查询;DeepSeek 负责 AI 互动,用于闲聊、查询新闻与天气等场景。 备案完成意味着合规流程已走通,但具体…
特斯拉中国补上AI语音,豆包正式上车
特斯拉中国开始分批推送 2026.14.13 版本。Model S、Model 3、Model X 和 Model Y 均将接入豆包大模型语音助手。
新版助手能查询实时信息,也能连续自然对话。用户还可以选择不同音色,以及「万事通」「音乐爱好者」「故事会」等角色。
特斯拉去年就披露,计划让豆包处理车控指令,让 DeepSeek 负责开放问答。今年 4 月,相关语音服务已在上海完成备案。不过,这次更新说明只点名豆包,尚未确认 DeepSeek 是否同步开放。
这项功能需要开通高级车载娱乐服务,官方价格为每月 9.99 元。
IT 之家
特斯拉中国开始分批推送 2026.14.13 版本。Model S、Model 3、Model X 和 Model Y 均将接入豆包大模型语音助手。
新版助手能查询实时信息,也能连续自然对话。用户还可以选择不同音色,以及「万事通」「音乐爱好者」「故事会」等角色。
特斯拉去年就披露,计划让豆包处理车控指令,让 DeepSeek 负责开放问答。今年 4 月,相关语音服务已在上海完成备案。不过,这次更新说明只点名豆包,尚未确认 DeepSeek 是否同步开放。
这项功能需要开通高级车载娱乐服务,官方价格为每月 9.99 元。
IT 之家
Ithome
特斯拉推送 2026.14.13 系统更新:引入豆包大模型、新增宠物模式 - IT之家
特斯拉向车辆推送 2026.14.13 版本车机软件更新,新增豆包大模型智能语音助手、宠物模式等多项功能,并修复多个安全漏洞。
🤡6
Claude做安全测试误黑3家公司,还把恶意软件上传到公共软件库PyPI
Anthropic 披露,Claude 在网络安全测试中意外连上公网,并侵入三家真实公司的生产系统。事故涉及 Claude Opus 4.7、Mythos 5 和一款内部研究模型,最早发生在 4 月。
最严重的一次,Opus 4.7 把一家同名真实公司当成虚构目标。它拿到应用和基础设施凭证,还进入了一个存有数百行生产数据的数据库。模型后来发现目标可能是真实系统,但仍继续攻击。
Mythos 5 则自行制作恶意 Python 包,并上传到公共软件库 PyPI。软件包公开约一小时,被 15 台真实设备下载运行。一家安全公司的扫描器中招,Claude 随后盗取凭证并进入更多系统。
另一款内部模型还扫描了约 9000 个目标,最终攻入一家公司的应用。不过,它确认目标属于真实公司后自行停手。
Anthropic 是在 OpenAI 披露 Hugging Face 事故后,回查 14.1 万次测试才发现问题。两家受影响机构此前毫不知情。Anthropic 认为,这更接近测试隔离和监控失效,不是模型主动逃逸。
Anthropic
Anthropic 披露,Claude 在网络安全测试中意外连上公网,并侵入三家真实公司的生产系统。事故涉及 Claude Opus 4.7、Mythos 5 和一款内部研究模型,最早发生在 4 月。
最严重的一次,Opus 4.7 把一家同名真实公司当成虚构目标。它拿到应用和基础设施凭证,还进入了一个存有数百行生产数据的数据库。模型后来发现目标可能是真实系统,但仍继续攻击。
Mythos 5 则自行制作恶意 Python 包,并上传到公共软件库 PyPI。软件包公开约一小时,被 15 台真实设备下载运行。一家安全公司的扫描器中招,Claude 随后盗取凭证并进入更多系统。
另一款内部模型还扫描了约 9000 个目标,最终攻入一家公司的应用。不过,它确认目标属于真实公司后自行停手。
Anthropic 是在 OpenAI 披露 Hugging Face 事故后,回查 14.1 万次测试才发现问题。两家受影响机构此前毫不知情。Anthropic 认为,这更接近测试隔离和监控失效,不是模型主动逃逸。
Anthropic
Anthropic
Investigating three real-world incidents in our cybersecurity evaluations
In a review of our cybersecurity evaluation transcripts, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems…
🤡4
动察Beating AI News
半年暴赚439%遭杠杆反噬,24岁前OpenAI研究员的200亿美元AI基金开始筹集新资金 《金融时报》援引知情人士称,24岁前 OpenAI 研究员 Leopold Aschenbrenner 创办的对冲基金 Situational Awareness,近期开始向现有投资人和贷款方筹集新资金。该基金规模约 200 亿美元,集中押注 AI 相关股票。基金还向部分投资人提出直接购买其持仓资产的方案。 Situational Awareness 截至 6 月底的年内净回报高达 439%。这轮上涨借助借款放大,AI…
半年暴赚439%的AI基金遭反噬,Citadel接手大部分股票仓位
24 岁前 OpenAI 研究员 Leopold Aschenbrenner 管理的 Situational Awareness,在 AI 股票大跌后,将大部分公开股票卖给 Citadel。基金交易前约有 160 亿美元公开股票,重仓 SK 海力士、CoreWeave、Nebius 等 AI 产业链公司。
基金此前借钱放大仓位。市场反转后,它需要追加资金或出售资产,最终选择减仓。CNBC 称基金清空了公开股票,路透社和《华尔街日报》则称出售大部分仓位。
Citadel 主要接手由经纪商借款融资的股票。交易后,基金仍有约 100 亿美元资产,包括部分由客户本金持有的公开股票,以及 Anthropic 等公司的私募股权。
WSJ
24 岁前 OpenAI 研究员 Leopold Aschenbrenner 管理的 Situational Awareness,在 AI 股票大跌后,将大部分公开股票卖给 Citadel。基金交易前约有 160 亿美元公开股票,重仓 SK 海力士、CoreWeave、Nebius 等 AI 产业链公司。
基金此前借钱放大仓位。市场反转后,它需要追加资金或出售资产,最终选择减仓。CNBC 称基金清空了公开股票,路透社和《华尔街日报》则称出售大部分仓位。
Citadel 主要接手由经纪商借款融资的股票。交易后,基金仍有约 100 亿美元资产,包括部分由客户本金持有的公开股票,以及 Anthropic 等公司的私募股权。
WSJ
The Wall Street Journal
Exclusive | Citadel Buys Situational Awareness’s Stock Portfolio After Big Losses in AI
The highflying hedge fund run by Leopold Aschenbrenner is in crisis mode after AI-related bets sank.
🤡3
亚马逊营收破2000亿美元,AWS增速创18季新高
亚马逊发布 2026 年第二季度财报。季度营收达到 2006 亿美元,同比增长 20%;营业利润为 275 亿美元,同比增长 43%。营收超过市场预期。
AWS 营收达到 422 亿美元,同比增长 37%,创 18 个季度以来最快增速。市场此前预计增长约 31%。AWS 营业利润增长 64% 至 166 亿美元。
亚马逊净利润增至 626 亿美元,但其中包含 534 亿美元税前投资收益,主要来自 Anthropic 持股升值。
亚马逊还把今年资本开支计划从 2000 亿美元上调至 2200 亿美元。过去 12 个月自由现金流从正 182 亿美元降至负 76 亿美元,主要因为 AI 相关设备投入增加。财报发布后,亚马逊股价盘后一度上涨近 9%。
亚马逊
亚马逊发布 2026 年第二季度财报。季度营收达到 2006 亿美元,同比增长 20%;营业利润为 275 亿美元,同比增长 43%。营收超过市场预期。
AWS 营收达到 422 亿美元,同比增长 37%,创 18 个季度以来最快增速。市场此前预计增长约 31%。AWS 营业利润增长 64% 至 166 亿美元。
亚马逊净利润增至 626 亿美元,但其中包含 534 亿美元税前投资收益,主要来自 Anthropic 持股升值。
亚马逊还把今年资本开支计划从 2000 亿美元上调至 2200 亿美元。过去 12 个月自由现金流从正 182 亿美元降至负 76 亿美元,主要因为 AI 相关设备投入增加。财报发布后,亚马逊股价盘后一度上涨近 9%。
亚马逊
🤡2
四大科技巨头今年最多砸7450亿美元,AI开始比谁先赚钱
按最新指引上限计算,微软、谷歌、亚马逊和 Meta 今年的资本开支合计可达 7450 亿美元。资金主要投向芯片、服务器、数据中心和网络,AI 竞争正从模型能力转向算力规模和商业回报。
最先见到收入的是云服务。Azure、AWS 和 Google Cloud 收入分别增长 43%、37% 和 82%。亚马逊称,生成式 AI 服务和自研芯片业务的年化收入都已超过 250 亿美元。
微软还把 AI 卖成了企业软件。Microsoft 365 Copilot 付费席位超过 3000 万,净新增席位环比翻倍。Meta 的广告收入增长 27%,但季度资本开支达到 311 亿美元,自由现金流只剩 7.84 亿美元。它的 AI 投入目前仍主要依靠广告业务回收。
市场并不反对科技巨头继续加码 AI,但开始细看投入后的现金回报。微软和亚马逊财报后股价上涨;Alphabet 虽然云业务大幅增长,但资本开支和现金流引发担忧;Meta 则同时面对利润下滑、现金流锐减和 AI 支出上升,财报后跌幅更大。
按最新指引上限计算,微软、谷歌、亚马逊和 Meta 今年的资本开支合计可达 7450 亿美元。资金主要投向芯片、服务器、数据中心和网络,AI 竞争正从模型能力转向算力规模和商业回报。
最先见到收入的是云服务。Azure、AWS 和 Google Cloud 收入分别增长 43%、37% 和 82%。亚马逊称,生成式 AI 服务和自研芯片业务的年化收入都已超过 250 亿美元。
微软还把 AI 卖成了企业软件。Microsoft 365 Copilot 付费席位超过 3000 万,净新增席位环比翻倍。Meta 的广告收入增长 27%,但季度资本开支达到 311 亿美元,自由现金流只剩 7.84 亿美元。它的 AI 投入目前仍主要依靠广告业务回收。
市场并不反对科技巨头继续加码 AI,但开始细看投入后的现金回报。微软和亚马逊财报后股价上涨;Alphabet 虽然云业务大幅增长,但资本开支和现金流引发担忧;Meta 则同时面对利润下滑、现金流锐减和 AI 支出上升,财报后跌幅更大。
👍1
动察Beating AI News
Seedance 2.5定档7月初,单视频生成长度可达30秒 字节跳动在 6 月 23 日的火山引擎 FORCE 大会上展示了视频生成模型 Seedance 2.5。Seedance 2.5 预计 7 月初正式发布,最主要的升级是单段原生视频直出时长翻倍到了 30 秒,并支持同时导入 50 个全模态参考素材,以解决视频生成中角色和产品细节容易走样变形的痛点。Seedance 2.5 还支持局部画面微调,在修改细节时不会影响视频的其余部分。 在 Seedance 2.5 中,火山引擎还与专业导演共创,在…
字节紧随MiniMax H3发布Seedance 2.5:单次生成30秒,最多塞进50份参考素材
字节跳动 Seed 团队发布视频模型 Seedance 2.5。它延续文字、图片、视频和声音联合输入的架构,单次生成时长从 15 秒提高到 30 秒,并支持继续延长视频。
模型可以在 30 秒内安排多个镜头和完整情节。用户还能基于已有结果反复续写,并尽量保持人物、场景、声音和叙事节奏一致,最终拼成数分钟视频。
Seedance 2.5 一次最多可输入 30 张图片、10 段视频和 10 段音频。
新模型还支持按时间戳控制和修改视频。用户可以指定某几秒出现什么动作、切换什么镜头,也能只调整人物、声音或运镜,不必整段重做。
Seedance 2.5 正在陆续上线即梦 AI 和豆包专业版,API 将在近期接入火山方舟。
字节跳动
字节跳动 Seed 团队发布视频模型 Seedance 2.5。它延续文字、图片、视频和声音联合输入的架构,单次生成时长从 15 秒提高到 30 秒,并支持继续延长视频。
模型可以在 30 秒内安排多个镜头和完整情节。用户还能基于已有结果反复续写,并尽量保持人物、场景、声音和叙事节奏一致,最终拼成数分钟视频。
Seedance 2.5 一次最多可输入 30 张图片、10 段视频和 10 段音频。
新模型还支持按时间戳控制和修改视频。用户可以指定某几秒出现什么动作、切换什么镜头,也能只调整人物、声音或运镜,不必整段重做。
Seedance 2.5 正在陆续上线即梦 AI 和豆包专业版,API 将在近期接入火山方舟。
字节跳动
动察Beating AI News
DeepSeek V4正式版疑似延期至8月,或直接撞上下一代模型集中发布 DeepSeek V4 正式版(V4 GA)可能推迟到 8 月中旬发布。 网友爆料称,DeepSeek 即将为自研 Harness 工具启动封闭测试,并从问卷参与者中挑选少量用户。封闭测试结束后约 1 至 2 周会开放 V4 GA,发布时间可能在 8 月 10 日至 20 日之间。 如果消息属实,DeepSeek V4 正式版上线时可能会面对更强竞争。届时 GPT-6、Claude Fable 5.1、GLM-5.5 等下一代模型可能已经进入市场。…
DeepSeek-V4-Flash正式版发布,V4-Pro还得等
DeepSeek 发布 V4-Flash 正式版 API,重点提升编程、工具调用和长任务执行能力。官方称,多项 Agent 基准成绩大幅超过此前的 V4-Pro-Preview。
新版本原生支持 Responses API,并针对 Codex 做了适配。模型结构和参数规模没有变化,主要重新进行了后训练。
本次只升级 API 接口,DeepSeek App 和网页端没有更新。V4-Pro 正式版仍未发布,官方称将尽快上线。
DeepSeek
DeepSeek 发布 V4-Flash 正式版 API,重点提升编程、工具调用和长任务执行能力。官方称,多项 Agent 基准成绩大幅超过此前的 V4-Pro-Preview。
新版本原生支持 Responses API,并针对 Codex 做了适配。模型结构和参数规模没有变化,主要重新进行了后训练。
本次只升级 API 接口,DeepSeek App 和网页端没有更新。V4-Pro 正式版仍未发布,官方称将尽快上线。
DeepSeek
🐳12❤1
动察Beating AI News
DeepSeek-V4-Flash正式版发布,V4-Pro还得等 DeepSeek 发布 V4-Flash 正式版 API,重点提升编程、工具调用和长任务执行能力。官方称,多项 Agent 基准成绩大幅超过此前的 V4-Pro-Preview。 新版本原生支持 Responses API,并针对 Codex 做了适配。模型结构和参数规模没有变化,主要重新进行了后训练。 本次只升级 API 接口,DeepSeek App 和网页端没有更新。V4-Pro 正式版仍未发布,官方称将尽快上线。 DeepSeek
旧Pro仅8分,DeepSeek-V4-Flash在DeepSWE冲到54.4分接近Opus 4.8
在长程软件工程基准 DeepSWE 上,DeepSeek-V4-Flash 正式版拿到 54.4 分,接近 Claude Opus 4.8 的 59 分,远高于 V4-Pro-Preview 此前的 8 分。
这个成绩低于 Kimi K3 的 69 分,但高于 GLM-5.2 的 44 分,已进入国产模型第一梯队。
不过,这不是完全相同条件下的模型裸测。正式版 V4-Flash 使用 DeepSeek 自己尚未发布的 Harness 极简模式,Agent 成绩会同时受到模型和执行框架影响。
在长程软件工程基准 DeepSWE 上,DeepSeek-V4-Flash 正式版拿到 54.4 分,接近 Claude Opus 4.8 的 59 分,远高于 V4-Pro-Preview 此前的 8 分。
这个成绩低于 Kimi K3 的 69 分,但高于 GLM-5.2 的 44 分,已进入国产模型第一梯队。
不过,这不是完全相同条件下的模型裸测。正式版 V4-Flash 使用 DeepSeek 自己尚未发布的 Harness 极简模式,Agent 成绩会同时受到模型和执行框架影响。
🐳6👍2🤔1
智谱Coding Plan改成积分制,新用户月费最高涨261%
智谱上线新版 GLM Coding Plan,并放开全量订阅。
此前旧版套餐由于供不应求一直限售,仅每天上午 10 点限量放出名额。
新版 Lite、Pro、Max 月费分别为 118 元、538 元和 1078 元。旧版 V2 分别为 49 元、149 元和 469 元。按月费计算,三档分别上涨约 141%、261% 和 130%。
涨价是否伴随额度提升仍无法知晓。旧版按每 5 小时和每周的 prompt 次数限额;新版把输入、输出、缓存命中 Token 和 MCP 调用统一折算成积分,三档每周分别提供 1 万、6 万和 14 万积分。
V2 个人套餐和团队套餐继续按原价使用、续订和升档。V1 用户可在套餐到期前,按旧版 V2 价格购买,购买入口预计 8 月中旬上线。
智谱
智谱上线新版 GLM Coding Plan,并放开全量订阅。
此前旧版套餐由于供不应求一直限售,仅每天上午 10 点限量放出名额。
新版 Lite、Pro、Max 月费分别为 118 元、538 元和 1078 元。旧版 V2 分别为 49 元、149 元和 469 元。按月费计算,三档分别上涨约 141%、261% 和 130%。
涨价是否伴随额度提升仍无法知晓。旧版按每 5 小时和每周的 prompt 次数限额;新版把输入、输出、缓存命中 Token 和 MCP 调用统一折算成积分,三档每周分别提供 1 万、6 万和 14 万积分。
V2 个人套餐和团队套餐继续按原价使用、续订和升档。V1 用户可在套餐到期前,按旧版 V2 价格购买,购买入口预计 8 月中旬上线。
智谱
🤡10😁2
蔡浩宇AI创业生变:陪伴产品停运,身份改为独立Agent开发者
米哈游联合创始人蔡浩宇更新领英,将在 AI 公司 Anuttacon 的履历截止到今年 7 月。新身份是「独立大模型与 Agent 开发者」,工作地点仍在新加坡。
同期,Anuttacon 旗下 AI 陪伴产品 AnuNeko 已永久停运。团队称规模有限,需要把资源投入其他方向。
此前媒体报道称,Anuttacon 已压缩音频和视频团队,裁撤北美大模型团队,将研发重心转向国内的大模型和 Agent。多名核心研究人员也已加入 OpenAI、Microsoft AI 和通义实验室。
不过,Anuttacon 尚未宣布关闭,官网、招聘页面和 AI 游戏《Whispers from the Star》仍在运行。
蔡浩宇领英
米哈游联合创始人蔡浩宇更新领英,将在 AI 公司 Anuttacon 的履历截止到今年 7 月。新身份是「独立大模型与 Agent 开发者」,工作地点仍在新加坡。
同期,Anuttacon 旗下 AI 陪伴产品 AnuNeko 已永久停运。团队称规模有限,需要把资源投入其他方向。
此前媒体报道称,Anuttacon 已压缩音频和视频团队,裁撤北美大模型团队,将研发重心转向国内的大模型和 Agent。多名核心研究人员也已加入 OpenAI、Microsoft AI 和通义实验室。
不过,Anuttacon 尚未宣布关闭,官网、招聘页面和 AI 游戏《Whispers from the Star》仍在运行。
蔡浩宇领英
👎1
动察Beating AI News
OpenAI前CTO新公司开源首个模型Inkling,架构借鉴DeepSeek-V3 OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab,发布首个通用模型 Inkling。模型总参数 9750 亿,每次激活 410 亿,支持文本、图像和音频,最长上下文为 100 万 token。 Inkling 从零训练,但 MoE 架构主要参考 DeepSeek-V3。后训练初期还使用了 Kimi K2.5 等开放模型生成的数据。完整权重已上架 Hugging Face,采用…
前OpenAI CTO新模型Inkling-Small开源:参数不到Inkling三成,性能只差1分
OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab 发布 Inkling-Small,并开放完整权重。这是一款多模态推理模型,支持文字、图片和音频输入。和 Inkling 一样,模型采用 Apache 2.0 许可证。
Inkling-Small 共有 2760 亿参数,每次激活 120 亿。Inkling 则有 9750 亿总参数,激活 410 亿。Artificial Analysis 的智能指数中,两者分别为 40 分和 41 分。
更小的模型在部分任务上反而更强。官方公布的测试中,它在 SWE-bench Verified、HLE 等编程和推理评测超过 Inkling。不过,Inkling 的知识覆盖和事实准确性更好。
Inkling-Small 的输出价为每 100 万 Token 1.20 美元,比 Inkling 便宜约 70%。完整权重已上传 Hugging Face,但官方量化权重仍有 171GB,普通消费级显卡无法完整装下。
Thinking Machines
OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab 发布 Inkling-Small,并开放完整权重。这是一款多模态推理模型,支持文字、图片和音频输入。和 Inkling 一样,模型采用 Apache 2.0 许可证。
Inkling-Small 共有 2760 亿参数,每次激活 120 亿。Inkling 则有 9750 亿总参数,激活 410 亿。Artificial Analysis 的智能指数中,两者分别为 40 分和 41 分。
更小的模型在部分任务上反而更强。官方公布的测试中,它在 SWE-bench Verified、HLE 等编程和推理评测超过 Inkling。不过,Inkling 的知识覆盖和事实准确性更好。
Inkling-Small 的输出价为每 100 万 Token 1.20 美元,比 Inkling 便宜约 70%。完整权重已上传 Hugging Face,但官方量化权重仍有 171GB,普通消费级显卡无法完整装下。
Thinking Machines
Thinking Machines Lab
Introducing Inkling-Small
An open-weights model that matches Inkling at a quarter of the size: multimodal, Mixture-of-Experts, with controllable reasoning effort. Fine-tune it on Tinker.
AI写论文终于不能瞎编了,谷歌给每个结论都配上证据
谷歌推出 Science One,一套让 AI 自动做科研并保留完整证据的系统。它能查论文、设计方案、运行实验和撰写论文。
现在的 AI 科研系统经常会编造引用,论文里写的方法也可能和实际代码不一致。Science One 会给每个结论绑定出处、代码和实验记录。证据对不上,这句话就会被修改或删除。
谷歌让 5 套系统使用同一个 Gemini 3.1 Pro,在 5 项任务上共写了 75 篇论文。Science One 生成的 337 条引用全部真实,12 项可复现实验的结果全部对上,15 篇论文中有 14 篇与实际代码一致。其他系统的虚构引用率最高达到 20.9%。
谷歌
谷歌推出 Science One,一套让 AI 自动做科研并保留完整证据的系统。它能查论文、设计方案、运行实验和撰写论文。
现在的 AI 科研系统经常会编造引用,论文里写的方法也可能和实际代码不一致。Science One 会给每个结论绑定出处、代码和实验记录。证据对不上,这句话就会被修改或删除。
谷歌让 5 套系统使用同一个 Gemini 3.1 Pro,在 5 项任务上共写了 75 篇论文。Science One 生成的 337 条引用全部真实,12 项可复现实验的结果全部对上,15 篇论文中有 14 篇与实际代码一致。其他系统的虚构引用率最高达到 20.9%。
谷歌
Google Research
Science One Framework: A verifiable autonomous research framework via Chain-of-Evidence
Introducing the Science One Framework, an experimental research prototype designed to eliminate hallucinations by natively building verifiable evidence chains, and CoE Audit, an automated protocol to evaluate the integrity of AI-generated papers.