动察Beating AI News
3.78K subscribers
1.48K photos
5 videos
1 file
4.47K links
AI新闻信息流
Download Telegram
特朗普称不会限制AI发展,将设立「AI沙皇」负责监管

9 月 20 日,美国总统特朗普表示,美国不会阻碍人工智能产业发展,而是将支持并监督该行业成长。特朗普称,AI 是「下一次工业革命」,其影响力可能达到美国 GDP 的 25%。

他表示,美国目前在 AI 领域领先于其他国家,并希望保持这一优势。特朗普宣布计划成立「人工智能工作组」,类似此前成立的「太空军」,并将在未来任命一名负责 AI 事务的「AI 沙皇」。

特朗普表示,政府不会通过限制措施抑制 AI 创新,但会利用现有刑事和民事司法体系应对 AI 领域的违法行为。他还称,AI 产业此前曾遭遇外界质疑和攻击,但政府将支持该行业发展,并加强相关监督。

动察 Beating 频道 · 动察 Beating 交流群
🤣2
阶跃Step 5正式发布,10月15日开源

阶跃星辰正式发布旗舰模型 Step 5 Preview。它采用稀疏 MoE 架构,总参数 600B,每次仅激活 27B,支持 100 万 Token 上下文和图文输入。API 和 Studio 已经全量开放,完整模型权重将在 10 月 15 日放出。

此前 Artificial Analysis 已经提前跑完评测。Step 5 Preview 在 Intelligence Index 得到 44 分,与 Kimi K3 Max 持平。AA 当前测得其输出约 100 Token/s,每项任务成本 0.71 美元;Kimi K3 Max 为 2 美元。

官方重点展示了它跑长任务的能力。阶跃让 Step 5 Preview 连续最多 24 小时自主优化一套 H100 GPU 内核。模型会自己改代码、跑测试、比较结果,再继续迭代。约 22 小时后达到 508 TFLOPS,同一实验中的 Claude Opus 5 为 493 TFLOPS。

另一项 24 小时实验里,Step 5 Preview 自己设计后训练数据,把 Qwen3-30B-A3B 在 AIME24 上的准确率从 53.3% 提到 60%,与 Claude Opus 5 持平,同时消耗更少的标注 Token。

信源

动察 Beating 频道 · 动察 Beating 交流群
👍7
ZCode「偷传代码」闹到企业追责,要求智谱删光已上传数据

智谱 ZCode 的「偷传代码」风波开始升级到正式法律追责。

太原承明科技向智谱发出 12 页法律函称,ZCode 自动打包上传的远不只是代码片段,而是完整工作区。其中包括源代码、系统架构、Git 历史,以及数据库口令、API 密钥、云服务凭证、员工和终端用户个人信息。

承明科技称,其默认工作区共有 32,932 个文件、约 4.11 亿明文字符被打包处理。另一个项目包含 1,947 个文件、约 1.44 亿字符,只因连续 32 次上传失败才没有成功送达智谱云端。公司认为,这些数据已经涉及商业秘密、技术资产和个人信息。

事情还牵出了数据出境问题。ZCode 中文隐私政策将服务提供者和数据处理者列为北京智谱,但英文版则列为智谱的新加坡全资子公司,并写明服务通常从新加坡提供、个人数据通常在新加坡处理。

承明科技因此要求智谱说明,这批数据究竟存在哪里,是否发生境外传输、是否提供给第三方,以及有没有被用于模型训练。

智谱此前已经道歉,称问题来自「代码库索引」功能。该功能上线初期默认开启,生成 Repo Wiki 时可能上传仓库数据。智谱称相关数据使用后会销毁,问题已经修复,并承诺开源 ZCode、接受第三方审查。

承明科技显然不接受一句「已经修复」就结束。函件要求智谱彻底删除服务器、对象存储、缓存、备份和灾备中的全部相关数据,提供完整访问和导出日志,并出具删除证明。公司同时保留向监管部门投诉、提起民事诉讼,以及就涉嫌侵犯商业秘密向司法机关举报的权利。

动察 Beating 频道 · 动察 Beating 交流群
👍37😁6🎉31
DeepSeek连调休补班也算低谷,今天API仍是半价

DeepSeek 补充 API 峰谷计费规则。调休上班的周末,以及中国法定节假日,全天都按空闲时段收费。今天 9 月 20 日虽然是国庆调休工作日,但 API 依旧执行低谷价。

DeepSeek 8 月 17 日开始实行峰谷定价,空闲时段价格为高峰的一半。不到一周后,它又把周六、周日全部改成低谷价。这次进一步把调休补班和法定节假日的计费口径说清楚。

以 deepseek-flash 为例,每百万 token 缓存未命中输入,空闲时段是 1 元,高峰 2 元;输出分别是 4 元和 8 元。国庆另一个补班日 10 月 10 日是周六,同样按低谷价算。

动察 Beating 频道 · 动察 Beating 交流群
长鑫科技宣布第五代技术平台正式量产

9 月 20 日,在 2026 世界制造业大会上,长鑫科技宣布第五代技术平台正式量产。

据介绍,长鑫科技将内存阵列有源区半间距做到 11.95 纳米,存储器电容深宽比 45:1,核心动能区高度降至 6762 纳米,同时,第五代工艺平台的存储密度有了大幅提升,同等条件下,每张晶圆的产出,与上一代平台相比提升了 50% 以上。

基于该平台打造的 24GB LPDDR5X 产品已经进入正式量产,全面进入国产主流旗舰手机。(澎湃)

动察 Beating 频道 · 动察 Beating 交流群
👍5
剪映开始全面Agent化:AI助手负责剪片,创作Hub接管整条生产线

剪映在 AI 新创作发布会上继续押注 Agent,一口气推出升级版「剪映 AI 助手」和「创作 Hub」。前者直接负责剪视频,后者把灵感、创作到发布串成一套完整流程。

剪映 AI 助手已经能用自然语言完成 Agent 智能剪辑、批量混剪、视频扩写、模板替换,还能直接调用 Seedance 2.5。用户说自己想怎么改,Agent 再调用剪映里的工具完成具体操作。

创作 Hub 管得更宽。它想把一条视频从灵感到成片再到发布的流程放到同一个地方,还支持自定义 Skill,把经常重复的创作方法沉淀下来反复调用。

自然语言剪视频不是新功能,剪映此前已经上线 AI 助手。现在它开始往下一步走,把反复使用的剪辑流程做成 Skill,用户不用每次重新教一遍。

动察 Beating 频道 · 动察 Beating 交流群
👍3
Jev有没有门槛?OpenJEV分成4派:不吐字容易,概率靠谱很难

Jev 发布不到一周,开源社区已经复刻这种「不写答案、直接给概率」的模型:

1. SemIf 最简单,连模型都不用重新训练。它直接拿现成的 Qwen,在模型准备回答 A、B、C 时截住,不让它继续往下写,直接读取每个选项的分数,再换成概率。

2. Simple Jev 也用现成大模型,但进一步省掉重复计算。同一段材料只读一次,后面的多个问题共用这部分结果,再分别判断答案。作者也明确说,它复刻的是 Jev 的使用方式,准确率、速度和概率校准都没做到等价。

3. Laya 干脆不用会生成文字的大模型,换成更像传统分类器的编码模型。好处是小而快,短板也很明显。一次从 77 个选项里做选择时,Laya 准确率只有 42.5%,Jev 是 87.0%。

4. Von 走的也是专用决策模型路线。它只有约 4 亿参数,不生成文字,一次前向直接完成 Choice、Noul 和 Score,更像一个能读自然语言的新一代分类器。

5. Verdict 更小,只有约 1.5 亿参数。作者重点处理了两个问题:答错了还报很高的置信度,以及把选项顺序换一下,结果就跟着变。

6. Kev 选择保留大模型。它拿 Qwen 做底座,再加专门的决策结构,让同一份输入只读一次,多个问题各自算概率。第三方此前逆向 Jev 时,也推测它可能用了类似设计。

拿训练时没见过的新题测试,8B 版准确率约 78%,Jev 约 86%。差距主要在置信度,Kev 还有一些答错的题会给出 90% 以上把握。

7. Nimble 重点放在训练上。它用 Qwen3.5-9B,再准备一批「只改一个事实,正确答案就翻转」的数据做后训练。在 324 个没参与训练的测试样本里,Nimble 有 90.1% 选中了参考答案,Jev 是 93.2%。不过目前还不能保证模型「报 90% 就真的有 90% 正确」。

8. OpenJev 走得最远,直接换成 DiffusionGemma。它先把几个答案位置留空,再像扩散模型补图一样一次填出来。在 RTX PRO 6000 上,单请求中位延迟约 94ms。

Jev 这条路线看起来很好抄。真正拉开差距的还是准确率、泛化和概率校准。模型敢报 90%,这个 90% 到底有多可信,才是最难的部分。

动察 Beating 频道 · 动察 Beating 交流群
👍8
微软总监称AI训练是「人类史上最大劳动力盗窃」

《纽约时报》诉 OpenAI、微软的版权案解封了一批内部材料。微软应用科学总监 Brent Hecht 曾把大规模抓取网络内容训练 AI 称为「前所未有的惊人盗窃」,甚至可能是「人类史上最大规模的劳动力盗窃」。

时任 ChatGPT 负责人 Nick Turley 也曾表示,AI 产品会给出版商带来「生存威胁」,本质上就是内容的替代品,而且能力越强,替代程度越高。微软 CEO Satya Nadella 在证词中承认,聊天机器人会让用户直接拿到答案,减少访问原始来源。

微软另一份内部文件把这种模式称为「死亡循环」:AI 抢走内容生产者的收入,优质内容减少,最终也会影响 AI 自己的训练。原告还援引微软内部数据称,与传统 Bing 搜索相比,Copilot 给《纽约时报》等新闻网站带去的点击率低了 83% 至 93%。

OpenAI 和微软目前仍主张,使用受版权保护内容训练 AI 属于 fair use。微软称,Hecht 的说法只是个人观点,不代表公司立场,也不是对版权问题的法律结论。

信源

动察 Beating 频道 · 动察 Beating 交流群
4🤡4
硅基流动再融两轮:去年营收5533万,今年已融近29亿

硅基流动宣布完成 B+ 轮二期和 C 轮融资。它是一家第三方 AI 推理基础设施公司,把算力和模型变成可直接调用的 Token 服务。公司 2026 年累计股权融资额已接近 29 亿元,本次两轮各自金额没有披露。

按 2025 年 Token 年吞吐量计算,硅基流动在中国所有 Token 供应商中排第四,份额只有 1.5%。前三名火山引擎、阿里云和百度智能云分别占 42.7%、32.5% 和 11.8%,合计吃掉约 87% 的市场。

这轮投资人有很强的国资色彩。中国互联网投资基金、国新基金、中国移动链长基金、中国东方资产国际等入场,耀途资本、盛奕资本和国泰创投继续追加。

硅基流动 2025 年营收 5533 万元,净亏损 3.45 亿元,整体毛利率为 -24%。公司 6 月底已经向港交所递表,目前按 18C 章「未商业化公司」规则申请主板上市。

北京刚发布全国首个省级词元经济专项政策,明确提出打造「世界级词元工厂」,并将推理引擎、模型与芯片适配、异构算力等列为重点方向。

信源

动察 Beating 频道 · 动察 Beating 交流群
🤡2
AI写的网页到底能不能用?腾讯做了个会自己点网页的评测

腾讯混元联合清华、北大推出 IWC-Bench,专门评测 AI 生成的网页实际用起来怎么样。

不少网页生成评测主要看代码或截图。页面可能看起来很漂亮,代码里也确实写了功能,但按钮点不开、表单交不了、切个页面就报错,这些问题很难靠静态检查发现。

IWC-Bench 更像真人验收。它让一个 Agent 真正打开网页,点击按钮、输入内容、切换页面,再检查哪些功能实际跑过。最后分别评价三件事:页面好不好看、操作顺不顺、用户要求的功能有没有做出来。

基准收录 369 条真实用户需求和 5088 条验收标准,17 个模型一共生成了 6273 个网页应用。在另外 197 组人工复核的对比中,IWC-Bench 有 168 组和人类选择一致,一致率达到 85.3%。

结果也说明,网页「看起来不错」和「真的好用」不是一回事。GPT-5.6-Sol 的页面美观度最高,但易用性只排第六;具体到单个网页,好看基本不能说明它好不好用,两项相关系数只有 0.36。

信源

动察 Beating 频道 · 动察 Beating 交流群
👍3
特朗普反对放缓AI开发之际,其家族持续加码投资AI领域

特朗普及其家族企业正持续扩大对人工智能、数据中心、电力基础设施和相关科技公司的投资。与此同时,特朗普反对放缓 AI 开发,使其政府在 AI 监管方面作出的决定可能影响其个人及家族投资价值,形成潜在利益冲突。财务披露显示,特朗普重返白宫后,其投资账户已披露近 3 万笔证券交易,包括买卖戴尔科技、美光科技、GE Vernova、博通、德州仪器、Credo Technology 和超微电脑等芯片、服务器及能源基础设施公司股票。目前无法确定特朗普是否仍持有这些股份,因为相关交易无需实时披露。特朗普也未像近几任美国总统一样将资产置于保密信托。

特朗普家族企业亦在直接拓展 AI 相关业务。Truth Social 母公司特朗普媒体科技集团计划与核聚变公司 TAE Technologies 合并,后者拟在 AI 数据中心用电需求增长之际建设发电设施。Truth Social 还计划通过 TruthAPI 向 AI 实验室授权平台数据,并已上线由 Perplexity 提供技术支持的搜索工具。

小唐纳德·特朗普担任 1789 Capital 合伙人,该公司已完成一只规模 12 亿美元的基金募资,投资方向包括数据中心等数字基础设施。特朗普重返白宫后,1789 Capital 已投资 AI 芯片公司 Cerebras、Perplexity 及马斯克旗下 xAI。埃里克·特朗普则通过 American Ventures 投资国防、机器人及 AI 数据处理公司。

白宫否认存在利益冲突,称特朗普的投资完全由独立管理人负责,相关资产存放于全权委托账户,并通过计算机模型自动复制施瓦布 1000 等指数;特朗普及其家人无法决定具体投资及交易时间。1789 Capit…

信源

动察 Beating 频道 · 动察 Beating 交流群
Pi开始给Prompt缓存自动续命,长任务少烧重复Token

Pi Agent Harness 发布 0.86.0,新增 Prompt Cache Warming。Agent 跑长时间工具任务时,Pi 会在缓存快过期前重发上一次请求,只生成 1 个 Token,把已经缓存的长上下文继续保留下来。

很多模型服务会在一段时间没有请求后清掉 Prompt Cache。之后继续任务,同一大段上下文就可能重新按完整输入计费。Pi 现在会主动避免这种 Cache Miss,但不会无脑保活。

它会先算账。只有预计避免的 Cache Miss 成本减去刷新成本后,还能至少省 0.05 美元,才会发起刷新。每次刷新本身仍要支付整段缓存读取和 1 个输出 Token 的费用。

信源

动察 Beating 频道 · 动察 Beating 交流群
👍114
黄仁勋成为特朗普AI安全立场重要盟友,主张以工程方法应对风险

在美国 AI 安全监管争论升温之际,英伟达 CEO 黄仁勋正成为特朗普政府在相关议题上的重要盟友。特朗普日前致电正在洛杉矶参加 All-In 峰会的黄仁勋,并表示「机器人不会接管世界」,同时将不断升温的 AI 及数据中心担忧称为「骗局」。

OpenAI、Anthropic 等英伟达重要客户近期呼吁放缓前沿 AI 模型开发并加强监管。Anthropic CEO Dario Amodei 提出放缓模型能力提升速度,获得 OpenAI CEO Sam Altman、马斯克及 Google DeepMind 负责人 Demis Hassabis 支持。黄仁勋则持不同立场,认为灾难性预测缺乏科学依据,模型开发商应在产品发布前确保安全,解决相关问题需要依靠「传统工程方法」。

特朗普近期在 AI 安全问题上的立场正更多呼应黄仁勋。两人在特朗普第二任期内已至少六次公开同场,美国财政部长贝森特本周表示,特朗普在 AI 问题上与黄仁勋的立场完全一致。

信源

动察 Beating 频道 · 动察 Beating 交流群
😁1
千问Qwen-Image-2.1开源:7B模型包办生成、编辑和透明图

千问发布 Qwen-Image-2.1,并放出模型权重。它把文生图和图片编辑合进同一个模型,视觉生成部分只有 7B 参数,同时原生支持 2K 图片和透明背景图片。

编辑能力是这次升级的重点。Qwen-Image-2.1 最多可以同时输入 10 张参考图,把多个人物或商品重新组合到一张图里。局部修改也可以直接圈选、涂画或提供蒙版,不需要再单独跑一个编辑模型。

它还可以直接生成带 Alpha 通道的 RGBA 图片,相当于模型自己输出透明背景素材,也能从照片里提取主体。Diffusers、ComfyUI、vLLM-Omni 和 SGLang 都已经首日接入,本地工作流不用等第三方慢慢适配。

不过这里的「开源」需要打个补丁。权重确实已经公开,但许可证是 Qwen Research License,只允许非商业研究和评估;商业使用需要另外向千问申请授权。

动察 Beating 频道 · 动察 Beating 交流群
🎉6
智谱最新表态:MaaS平台将上线数据不留存,输入输出不再落盘

智谱 MaaS 平台宣布近期将上线「数据内容不留存」功能。用户申请开通后,普通模型调用的输入和输出将不再静态存储在平台侧,数据只用于完成当次调用。

但并不是所有数据都不留。Batch API、File API 等需要持久化数据的功能不覆盖;涉嫌违规或滥用的请求也可能被转为留存,保存 30 天及以上。

这类机制通常被称为 ZDR(Zero Data Retention,零数据留存),OpenAI、Anthropic、xAI 和 Mistral 等模型平台都已经提供。它主要面向代码、企业文档等不希望留在模型厂商服务器上的敏感数据。

最近,智谱旗下 ZCode 因为默认上传用户仓库数据陷入争议。智谱已经公开道歉并承诺开源接受审查。今天又有企业发函,要求智谱说明已上传数据的去向和删除情况。

智谱没有表示 MaaS 这项改动与 ZCode 事件有关。

信源

动察 Beating 频道 · 动察 Beating 交流群
🤡16😁2