动察Beating AI News
Parallel搜索MCP免费开放,无需账号和API密钥 前 Twitter CEO Parag Agrawal 创办的 AI 网页基础设施公司 Parallel Web Systems 宣布其搜索 MCP 服务器免费开放。此前使用 Parallel Search 需要注册账号并配置 API 密钥,现在任何 MCP 兼容客户端直接连接即可使用,零成本。 免费版提供两项核心能力:`web_search` 执行实时网页搜索,返回为 LLM 上下文窗口优化的精简摘要;`web_fetch` 将任意 URL 转换为干净的…
Parallel拿下AI搜索API第一,Exa、Firecrawl紧随其后
AI 评测机构 Artificial Analysis 推出 Search Index,开始给 Agent 使用的搜索 API 跑分。搜索 API 就是 Agent 联网找资料的接口。
评测固定使用 GPT-5.6 Luna 和同一套 Harness 框架,每题最多运行 25 个 Agent 回合,只替换背后的搜索服务。首发测试 7 家厂商的 11 个配置,Parallel advanced 以 75 分第一,Exa auto 74 分,Firecrawl 73 分。同一模型完全不用搜索只有 33 分。
评测把 DeepSearchQA、BrowseComp 和 AA-Omniscience 三项等权平均,分别测试深度检索、多跳找事实和知识问答。
有点意外的是,Parallel advanced 的搜索费用比 basic 更高,但模型平均 Token 用量从约 33.9 万降到 16.9 万。整题总成本反而从 0.11 美元降到 0.084 美元,得分还从 73 升到 75。搜索 API 贵一点,不代表 Agent 最终更费钱。
不过 75 分只代表搜索质量,不是质量、价格和速度的综合排名。Artificial Analysis 把成本和延迟单独统计,并用帕累托前沿比较不同方案的取舍。
Artificial Analysis
AI 评测机构 Artificial Analysis 推出 Search Index,开始给 Agent 使用的搜索 API 跑分。搜索 API 就是 Agent 联网找资料的接口。
评测固定使用 GPT-5.6 Luna 和同一套 Harness 框架,每题最多运行 25 个 Agent 回合,只替换背后的搜索服务。首发测试 7 家厂商的 11 个配置,Parallel advanced 以 75 分第一,Exa auto 74 分,Firecrawl 73 分。同一模型完全不用搜索只有 33 分。
评测把 DeepSearchQA、BrowseComp 和 AA-Omniscience 三项等权平均,分别测试深度检索、多跳找事实和知识问答。
有点意外的是,Parallel advanced 的搜索费用比 basic 更高,但模型平均 Token 用量从约 33.9 万降到 16.9 万。整题总成本反而从 0.11 美元降到 0.084 美元,得分还从 73 升到 75。搜索 API 贵一点,不代表 Agent 最终更费钱。
不过 75 分只代表搜索质量,不是质量、价格和速度的综合排名。Artificial Analysis 把成本和延迟单独统计,并用帕累托前沿比较不同方案的取舍。
Artificial Analysis
动察Beating AI News
李纪为团队开源Ornith编程模型:397B旗舰版在多项编程基准击败Claude Opus 4.7 由知名 NLP 学者李纪为创立的 AI 团队 DeepReinforce 开源了四款专攻编程智能体的 Ornith-1.0 模型,全系采用 MIT 协议发布。Ornith-1.0 在 Gemma 4 与 Qwen 3.5 基础上训练而成,涵盖 Dense(稠密)和 MoE(混合专家)两种架构。在 Terminal-Bench 2.1 (Claude Code) 编程智能体测试中,旗舰款 Ornith-1.0…
李纪为团队开源Ornith-1.5:397B版本部分评测追上Opus4.8,35B版本没打过Qwen3.8-27B
由知名 NLP 学者李纪为创立的 AI 团队 DeepReinforce 发布开源模型 Ornith-1.5,共有 9B、35B MoE 和 397B MoE 三档。新版本主打「自我改进」训练。模型会自己出训练题、生成任务专用 scaffold,再生成解题过程做强化学习。
旗舰 397B 的官方成绩在部分评测上已经追平 Claude Opus 4.8。Terminal-Bench 2.1 是 86.1 对 85.0,SWE-bench Verified 是 86.0 对 85.8。但 Opus 4.8 在 SWE-bench Pro、DeepSWE、HLE 和 Toolathlon 上仍然领先。
35B 这档每个 Token 只激活约 3B 参数,和 Qwen3.8-27B 比,多项成绩仍然落后。Terminal-Bench 2.1 是 67.8 对 73.0,DeepSWE 是 22.0 对 42.2。Ornith 在 NL2Repo 以 46.2 对 42.3 领先,GPQA Diamond 两边都是 89.2。
Ornith
由知名 NLP 学者李纪为创立的 AI 团队 DeepReinforce 发布开源模型 Ornith-1.5,共有 9B、35B MoE 和 397B MoE 三档。新版本主打「自我改进」训练。模型会自己出训练题、生成任务专用 scaffold,再生成解题过程做强化学习。
旗舰 397B 的官方成绩在部分评测上已经追平 Claude Opus 4.8。Terminal-Bench 2.1 是 86.1 对 85.0,SWE-bench Verified 是 86.0 对 85.8。但 Opus 4.8 在 SWE-bench Pro、DeepSWE、HLE 和 Toolathlon 上仍然领先。
35B 这档每个 Token 只激活约 3B 参数,和 Qwen3.8-27B 比,多项成绩仍然落后。Terminal-Bench 2.1 是 67.8 对 73.0,DeepSWE 是 22.0 对 42.2。Ornith 在 NL2Repo 以 46.2 对 42.3 领先,GPQA Diamond 两边都是 89.2。
Ornith
😁1
动察Beating AI News
AI编程公司Cognition估值冲上400亿美元,不到3个月再涨超50% AI 编程公司 Cognition 又准备融资了。公司核心产品 Devin 是一个 AI 编程 Agent,可以自己接任务、写代码、跑测试并交付代码。彭博援引知情人士称,Cognition 正在和投资者初步接触,计划按至少 400 亿美元估值融资,融资额预计超过 10 亿美元。Cognition 官网也将 Devin 定义为可以自己规划、编写、测试和交付代码的软件工程 Agent。 这个速度相当夸张。Cognition 5 月底才刚融了超过…
SpaceX刚600亿美元买下Cursor,又被曝出价收购Cognition
SpaceX 刚花 600 亿美元买下 Cursor,又被曝盯上另一家 AI 编程公司 Cognition。彭博援引知情人士称,SpaceX 曾主动提出收购 Cognition,但后者没有参与收购谈判。双方据称还在讨论其他合作,包括让 Cognition 使用 SpaceX 的算力。
Cognition 的核心产品是 AI 编程 Agent Devin,可以自己接任务、写代码、修 Bug 和跑测试。公司 5 月融资时估值达到 260 亿美元,目前又在按至少 400 亿美元估值洽谈新一轮融资。彭博称,SpaceX 看中的不只是 Cognition 的技术,还有它已经做起来的企业业务。
不过 Cognition CEO Scott Wu 随后在 X 上称报道「不是真的」,强调 Cognition「不卖」,双方也「没有在谈」。彭博记者 Rebecca Torrence 随后回应称,报道只是说 SpaceX 主动提出了收购报价,并没有说 Cognition 接受报价或参与谈判。
彭博社
SpaceX 刚花 600 亿美元买下 Cursor,又被曝盯上另一家 AI 编程公司 Cognition。彭博援引知情人士称,SpaceX 曾主动提出收购 Cognition,但后者没有参与收购谈判。双方据称还在讨论其他合作,包括让 Cognition 使用 SpaceX 的算力。
Cognition 的核心产品是 AI 编程 Agent Devin,可以自己接任务、写代码、修 Bug 和跑测试。公司 5 月融资时估值达到 260 亿美元,目前又在按至少 400 亿美元估值洽谈新一轮融资。彭博称,SpaceX 看中的不只是 Cognition 的技术,还有它已经做起来的企业业务。
不过 Cognition CEO Scott Wu 随后在 X 上称报道「不是真的」,强调 Cognition「不卖」,双方也「没有在谈」。彭博记者 Rebecca Torrence 随后回应称,报道只是说 SpaceX 主动提出了收购报价,并没有说 Cognition 接受报价或参与谈判。
彭博社
🤡3
动察Beating AI News
OpenRouter卖身造富:a16z和Menlo两年套现近20亿美元 Stripe 收购 OpenRouter 还没正式官宣,背后的 VC 已经准备赚麻了。Business Insider 爆料称,如果交易按超过 80 亿美元完成,a16z 和 Menlo Ventures 手里的股份合计将价值接近 20 亿美元。 其中最夸张的是 a16z。它去年从种子轮开始投资 OpenRouter,总共只花了约 2000 万美元,现在持股超过 17%。按 80 亿美元收购价算,这部分股份价值接近 15 亿美元,相当于不到两年涨了约…
Stripe给投资人写信:AI奇点已开始,私有化反而成了优势
Stripe 三位负责人在最新投资人信中称,他们把今年 1 月 1 日视为「奇点的开始」。
这里不是说 AI 已经超过人类,而是 Stripe 认为多个长期趋势出现明显拐点,比如新公司创办速度大幅上升。
Stripe 自己也吃到了这波增长。今年上半年净收入同比增长 41%,自由现金流增长 43%。Forbes AI 50 中有 88% 的公司在使用 Stripe,包括 OpenAI 和 Anthropic;剩下的 12% 大多还没有开始商业化。AI 公司和加密公司贡献的收入占比,也都比一年前翻了一倍以上。
Stripe 现在把「资本」和「智能」看成企业未来最重要的两种数字流。过去 Stripe 帮公司管钱,接下来还想帮公司管理 AI 调用,包括一个任务值不值得做、该用哪个模型,以及谁来付钱。OpenRouter 正好补上这一块,其今年 Token 消耗量按周复合增长约 9%。
Stripe 已宣布收购 OpenRouter,信中说这是他们史上最大规模的一笔收购,交易预计未来几周完成。Axios 称交易价格超过 80 亿美元,主要以股票支付。
信中还明确表示,继续保持私有化现在反而是优势。AI 让未来更难预测,Stripe 不想为了短期市场压力牺牲长期决策。
虽然近几年一直投资和收购,但 Stripe 没有靠大量增发股份来买单,目前已发行股份总数甚至比三年前更少。从 10 年前 Series D 融资算起,其私募每股定价年化增长约 31%。
Axios
Stripe 三位负责人在最新投资人信中称,他们把今年 1 月 1 日视为「奇点的开始」。
这里不是说 AI 已经超过人类,而是 Stripe 认为多个长期趋势出现明显拐点,比如新公司创办速度大幅上升。
Stripe 自己也吃到了这波增长。今年上半年净收入同比增长 41%,自由现金流增长 43%。Forbes AI 50 中有 88% 的公司在使用 Stripe,包括 OpenAI 和 Anthropic;剩下的 12% 大多还没有开始商业化。AI 公司和加密公司贡献的收入占比,也都比一年前翻了一倍以上。
Stripe 现在把「资本」和「智能」看成企业未来最重要的两种数字流。过去 Stripe 帮公司管钱,接下来还想帮公司管理 AI 调用,包括一个任务值不值得做、该用哪个模型,以及谁来付钱。OpenRouter 正好补上这一块,其今年 Token 消耗量按周复合增长约 9%。
Stripe 已宣布收购 OpenRouter,信中说这是他们史上最大规模的一笔收购,交易预计未来几周完成。Axios 称交易价格超过 80 亿美元,主要以股票支付。
信中还明确表示,继续保持私有化现在反而是优势。AI 让未来更难预测,Stripe 不想为了短期市场压力牺牲长期决策。
虽然近几年一直投资和收购,但 Stripe 没有靠大量增发股份来买单,目前已发行股份总数甚至比三年前更少。从 10 年前 Series D 融资算起,其私募每股定价年化增长约 31%。
Axios
🤡2
动察Beating AI News
DeepSeek Harness正式上线:首款Agent产品,整个Agent都能自己组装 DeepSeek 正式上线首款 Agent 产品 DeepSeek Harness,软件包已经发布至 npm。此前 V4-Flash 的公开 Code Agent 评测,用的就是 Harness 内置的极简模式。 它不只是一款类似 Codex 的 Coding Agent。Harness 支持管理项目、长任务、多 Agent、Skill、联网搜索和上下文管理,还允许用户创建不同的「Agent 预设」。写代码、研究…
DeepSeek Harness增强多Agent编排:把Claude Code、Codex做成按需安装组件
DeepSeek 更新开源 Agent 框架 Harness,RC.8 继续加强多 Agent 编排。Claude Code 和 Codex 现在可以做成独立的 Profile Bundle,用户需要时再安装。两者此前已经能作为 Harness 的子代理运行,新增的是安装和配置方式进一步模块化。
Codex 也多了两项能力。它现在支持非交互权限模式,更适合放进自动化流程;同时可以配置多个命名实例,让 Harness 在同一套工作流里管理多个 Codex。
多模态输入也进一步补齐。/goal、/plan 等核心命令现在可以直接带图片,@ 菜单还可以引用本地文件和历史会话。模型适配器也增加了原生图片请求能力,让支持视觉输入的模型可以直接接收图片。
工具调用方面,web_search 现在支持并发搜索。子代理完成任务后,也可以主动把结果交回并唤醒父 Agent。Windows 端则加入持久 PowerShell 会话,并在 Minimal 预设中默认开启。
DeepSeek Harness Releases
DeepSeek 更新开源 Agent 框架 Harness,RC.8 继续加强多 Agent 编排。Claude Code 和 Codex 现在可以做成独立的 Profile Bundle,用户需要时再安装。两者此前已经能作为 Harness 的子代理运行,新增的是安装和配置方式进一步模块化。
Codex 也多了两项能力。它现在支持非交互权限模式,更适合放进自动化流程;同时可以配置多个命名实例,让 Harness 在同一套工作流里管理多个 Codex。
多模态输入也进一步补齐。/goal、/plan 等核心命令现在可以直接带图片,@ 菜单还可以引用本地文件和历史会话。模型适配器也增加了原生图片请求能力,让支持视觉输入的模型可以直接接收图片。
工具调用方面,web_search 现在支持并发搜索。子代理完成任务后,也可以主动把结果交回并唤醒父 Agent。Windows 端则加入持久 PowerShell 会话,并在 Minimal 预设中默认开启。
DeepSeek Harness Releases
🎉4❤1
动察Beating AI News
MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音 MiniMax 发布全模态生成模型 H3。它能同时理解文字、图片、视频和声音,再按一条自然语言指令生成或编辑视频。 用户可以让 H3 照着一段视频学镜头运动,使用另一张图中的人物,再参考第三段音频的声音。过去需要分别调用的动作迁移、人物参考、声音参考和视频编辑,现在可以放进同一次任务。 H3 最长可生成 15 秒视频,支持 2K 分辨率和原生双声道声音。官方 API 的 2K 价格为每秒 0.13 美元,生成一段 15 秒视频约需 1.95…
MiniMax推出「视频版Codex」:从脚本、分镜一路做到成片
MiniMax 今天正式推出多模态创作 Agent MiniMax Design,可以自己拆任务、写脚本、做分镜、生成图片和视频,再完成剪辑、配音和字幕,最后直接交付成片。简单理解,它有点像视频创作版的 Codex:用户负责说清楚想做什么,Agent 负责把后面的制作流程跑完。
MiniMax 把自家视频模型 H3 深度做进了 Agent 和 Skills。系统会根据任务判断哪些素材该作为参考、哪些内容需要保留或修改,再整理成更适合 H3 执行的输入。复杂镜头还可以先用 3D 导演台摆好人物、动作和机位,再交给 H3 生成,减少反复试错。
专业用户也可以接入已有的 ComfyUI 工作流,在云端或本地运行,并让 Agent 帮忙调整节点和生成参数。除了 H3,MiniMax Design 也可以调用其他模型完成图片、视频和音频等环节。
MiniMax Design 并不是突然冒出来的新产品,而是在此前多模态创作工具 MiniMax Hub 的基础上持续演进而来。现在它进一步把脚本、分镜、素材生成、剪辑和修改串到一起,主要面向广告、电商、MV、科普等需要持续生成和反复修改的商业内容。
MiniMax
MiniMax 今天正式推出多模态创作 Agent MiniMax Design,可以自己拆任务、写脚本、做分镜、生成图片和视频,再完成剪辑、配音和字幕,最后直接交付成片。简单理解,它有点像视频创作版的 Codex:用户负责说清楚想做什么,Agent 负责把后面的制作流程跑完。
MiniMax 把自家视频模型 H3 深度做进了 Agent 和 Skills。系统会根据任务判断哪些素材该作为参考、哪些内容需要保留或修改,再整理成更适合 H3 执行的输入。复杂镜头还可以先用 3D 导演台摆好人物、动作和机位,再交给 H3 生成,减少反复试错。
专业用户也可以接入已有的 ComfyUI 工作流,在云端或本地运行,并让 Agent 帮忙调整节点和生成参数。除了 H3,MiniMax Design 也可以调用其他模型完成图片、视频和音频等环节。
MiniMax Design 并不是突然冒出来的新产品,而是在此前多模态创作工具 MiniMax Hub 的基础上持续演进而来。现在它进一步把脚本、分镜、素材生成、剪辑和修改串到一起,主要面向广告、电商、MV、科普等需要持续生成和反复修改的商业内容。
MiniMax
👍4❤2😁1
李彦宏给文心定目标:重回基础大模型第一梯队
百度创始人兼 CEO 李彦宏在最新财报电话会上明确表示,要加快文心大模型迭代,让文心「重回基础模型第一梯队」。他承认,百度作为国内最早投入基础模型的公司之一,过去一路走来「有过试错」,接下来仍会继续投入资源。
李彦宏认为,现在基础模型的竞争还远没有定局,每隔几个月就会有不同模型在部分能力上领先。百度接下来会继续给文心投入资源,同时调整组织、引进顶尖 AI 人才,加快模型更新。
不过百度不会追求文心在所有能力上都第一。李彦宏称,接下来会优先强化百度自己最需要的能力,包括 AI 搜索、数字人、秒哒和通用 Agent 等,再把这些产品产生的反馈用于继续训练文心。
财报狗
百度创始人兼 CEO 李彦宏在最新财报电话会上明确表示,要加快文心大模型迭代,让文心「重回基础模型第一梯队」。他承认,百度作为国内最早投入基础模型的公司之一,过去一路走来「有过试错」,接下来仍会继续投入资源。
李彦宏认为,现在基础模型的竞争还远没有定局,每隔几个月就会有不同模型在部分能力上领先。百度接下来会继续给文心投入资源,同时调整组织、引进顶尖 AI 人才,加快模型更新。
不过百度不会追求文心在所有能力上都第一。李彦宏称,接下来会优先强化百度自己最需要的能力,包括 AI 搜索、数字人、秒哒和通用 Agent 等,再把这些产品产生的反馈用于继续训练文心。
财报狗
Baidu Inc
Baidu Announces Second Quarter 2026 Results | Baidu Inc
BEIJING, Aug. 18, 2026 /PRNewswire/ -- Baidu, Inc. (NASDAQ: BIDU and HKEX: 9888 (HKD Counter) and 89888 (RMB Counter)), ("Baidu" or the "Company"), a leading AI company with strong Internet foundation, today announced its unaudited financial results for the…
🤡19💩4❤1🤣1
动察Beating AI News
因数据保留政策,传微软限制员工在内部使用Claude Fable 5 因担忧 Anthropic 新发布模型的数据保留风险,有消息称微软限制员工在内部使用 Claude Fable 5。虽然微软已向外部 GitHub Copilot 和 Foundry 客户推出 Claude Fable 5,但员工使用的内部版选择器并未提供 Claude Fable 5。 微软法律团队正在评估 Anthropic 的数据保留服务条款。不同于微软内部提供、遵循零数据保留(Zero Data Retention,简称 ZDR)规则的…
OpenAI推「零数据留存」,矛头直指Anthropic的30天政策
OpenAI 预览新服务 Private Safety Processing,让符合条件的企业和 API 客户在使用前沿模型时,仍能保持零数据保留。系统可以跨多轮对话检查潜在滥用,但 OpenAI 员工看不到客户的 prompt 和模型回复。
客户数据可以继续留在自己的服务器。也可以存在 OpenAI,但由客户自己的密钥加密,OpenAI 拿不到密钥。系统发现风险后,只会向 OpenAI 返回一个有限的安全信号,例如检测到哪类可疑活动,不会把原始对话一起交过去。
这正好打在 Anthropic 的一个争议点上。Fable 5 和 Mythos 5 要求保留用户输入和模型输出 30 天,用来检查跨多次请求的攻击行为。微软此前还因为这一政策限制员工使用 Fable 5。Anthropic 认为留数据是做好安全监控的必要代价,OpenAI 现在则想证明两件事可以同时做到。
Private Safety Processing 目前只在少量客户中测试,OpenAI 计划 9 月开始推出,并发布技术白皮书。普通 ChatGPT Free、Plus、Go 和 Pro 用户不在这套 ZDR 方案里,现有数据设置不会因此改变。
OpenAI
OpenAI 预览新服务 Private Safety Processing,让符合条件的企业和 API 客户在使用前沿模型时,仍能保持零数据保留。系统可以跨多轮对话检查潜在滥用,但 OpenAI 员工看不到客户的 prompt 和模型回复。
客户数据可以继续留在自己的服务器。也可以存在 OpenAI,但由客户自己的密钥加密,OpenAI 拿不到密钥。系统发现风险后,只会向 OpenAI 返回一个有限的安全信号,例如检测到哪类可疑活动,不会把原始对话一起交过去。
这正好打在 Anthropic 的一个争议点上。Fable 5 和 Mythos 5 要求保留用户输入和模型输出 30 天,用来检查跨多次请求的攻击行为。微软此前还因为这一政策限制员工使用 Fable 5。Anthropic 认为留数据是做好安全监控的必要代价,OpenAI 现在则想证明两件事可以同时做到。
Private Safety Processing 目前只在少量客户中测试,OpenAI 计划 9 月开始推出,并发布技术白皮书。普通 ChatGPT Free、Plus、Go 和 Pro 用户不在这套 ZDR 方案里,现有数据设置不会因此改变。
OpenAI
OpenAI
Offering Zero Data Retention for frontier models
OpenAI reaffirms Zero Data Retention for eligible API customers and previews Private Safety Processing for advanced AI safety without compromising data privacy.
👍2
Meta推出Mac版AI聊天应用,能直接看屏幕给建议
Meta 推出 Meta AI 的 Mac 桌面应用,目前处于测试阶段。用户可以把正在使用的窗口共享给 Meta AI,让它根据屏幕内容回答问题、给建议或生成内容。它还支持全局语音听写,可以直接在其他 Mac 应用里使用。
不过它目前还不是电脑 Agent。Meta AI 可以理解你共享的屏幕,但不能替你点击按钮、操作应用或控制电脑。
Meta 同时还在加强企业和创作者功能。Meta AI 可以连接 Instagram、Facebook 专业账号、Meta Ads 和 Google Workspace,分析账号和广告数据,也能生成文档、演示文稿,并定期完成周报等任务。
Meta
Meta 推出 Meta AI 的 Mac 桌面应用,目前处于测试阶段。用户可以把正在使用的窗口共享给 Meta AI,让它根据屏幕内容回答问题、给建议或生成内容。它还支持全局语音听写,可以直接在其他 Mac 应用里使用。
不过它目前还不是电脑 Agent。Meta AI 可以理解你共享的屏幕,但不能替你点击按钮、操作应用或控制电脑。
Meta 同时还在加强企业和创作者功能。Meta AI 可以连接 Instagram、Facebook 专业账号、Meta Ads 和 Google Workspace,分析账号和广告数据,也能生成文档、演示文稿,并定期完成周报等任务。
Meta
👍1🥴1
动察Beating AI News
Anthropic洽购英国芯片初创Fractile推理芯片,后者估值冲10亿美元 Anthropic 正与伦敦初创公司 Fractile 谈判采购其推理芯片,芯片最早明年量产进入数据中心。Fractile 成立于 2022 年底,核心方案是用 SRAM(静态随机存取存储器)替代 GPU 依赖的 HBM(高带宽存储器),减少数据在芯片与外部存储之间的来回搬运,从而降低推理功耗和成本。采用类似路线的还有 Cerebras 和 Groq。 协议尚在早期,规模未知,存在谈崩可能。但这笔潜在订单已成为 Fractile…
Anthropic给出2.5亿美元采购协议,Fractile估值3个月涨6倍
英国 AI 芯片初创 Fractile 正在洽谈新一轮融资。彭博援引知情人士称,公司计划融资约 6 亿美元,融资前估值达到 65 亿美元。
这个估值涨得很快。Fractile 今年 5 月才完成 2.2 亿美元融资,当时估值约 10 亿美元,由 Accel、Founders Fund 和 Factorial Funds 领投。不到三个月,新一轮拟议估值已经达到此前的 6.5 倍。
最大的新增筹码来自 Anthropic。双方已经达成初步协议,Anthropic 计划购买约 2.5 亿美元的 Fractile 芯片,未来还可能扩大采购。
Fractile 专门做 AI 推理芯片,不过它的芯片预计到 2027 年才会投入使用。产品还没真正交付,估值已经冲到 65 亿美元,这轮融资押的主要还是未来的交付能力和 Anthropic 这类大客户订单。
彭博
英国 AI 芯片初创 Fractile 正在洽谈新一轮融资。彭博援引知情人士称,公司计划融资约 6 亿美元,融资前估值达到 65 亿美元。
这个估值涨得很快。Fractile 今年 5 月才完成 2.2 亿美元融资,当时估值约 10 亿美元,由 Accel、Founders Fund 和 Factorial Funds 领投。不到三个月,新一轮拟议估值已经达到此前的 6.5 倍。
最大的新增筹码来自 Anthropic。双方已经达成初步协议,Anthropic 计划购买约 2.5 亿美元的 Fractile 芯片,未来还可能扩大采购。
Fractile 专门做 AI 推理芯片,不过它的芯片预计到 2027 年才会投入使用。产品还没真正交付,估值已经冲到 65 亿美元,这轮融资押的主要还是未来的交付能力和 Anthropic 这类大客户订单。
彭博
Bloomberg.com
AI Chip Startup Fractile Seeks $6.5 Billion Value After Anthropic Deal
Fractile, a startup developing chips tailored for artificial intelligence use that has a deal to supply Anthropic PBC, is in advanced talks to notch a valuation more than six times higher than the price it landed in May.
❤1
癌症开始被「编程」:AI挑靶点、mRNA现做,III期成功
mRNA 药物开发公司 Moderna 和默沙东联合开发的个体化癌症疗法 intismeran,在 III 期临床中取得阳性结果。1137 名高风险黑色素瘤患者接受手术后,使用 intismeran 加 Keytruda,相比单用 Keytruda,复发和远处转移两项主要观察指标均显著改善。详细疗效数据还没有公布。
这款药最特别的地方,是每个患者拿到的都不一样。医生先对患者的肿瘤和血液进行测序,找出癌细胞独有的突变。Moderna 再用一组 AI 算法分析这些突变,预测最多 34 个最可能引发免疫反应的「新抗原」,也就是适合让免疫系统攻击的癌细胞靶点。
选完靶点后,Moderna 会把它们编码进一段专门为这个患者制造的 mRNA。注射进入人体后,mRNA 会让细胞制造这些癌症特征,训练免疫系统识别并攻击携带相同特征的癌细胞。一个人的肿瘤突变不同,AI 选出的靶点不同,最后生产出来的 mRNA 也不同。
过去的癌症药通常是先造出一种药,再给符合条件的一群患者使用。intismeran 反过来了:先读取一个人的癌症,把肿瘤变成测序数据,再计算靶点,最后把结果重新编码成药。这次 III 期成功,至少证明这套「一人一药」的路线已经能在大规模临床试验里跑通。
默沙东
mRNA 药物开发公司 Moderna 和默沙东联合开发的个体化癌症疗法 intismeran,在 III 期临床中取得阳性结果。1137 名高风险黑色素瘤患者接受手术后,使用 intismeran 加 Keytruda,相比单用 Keytruda,复发和远处转移两项主要观察指标均显著改善。详细疗效数据还没有公布。
这款药最特别的地方,是每个患者拿到的都不一样。医生先对患者的肿瘤和血液进行测序,找出癌细胞独有的突变。Moderna 再用一组 AI 算法分析这些突变,预测最多 34 个最可能引发免疫反应的「新抗原」,也就是适合让免疫系统攻击的癌细胞靶点。
选完靶点后,Moderna 会把它们编码进一段专门为这个患者制造的 mRNA。注射进入人体后,mRNA 会让细胞制造这些癌症特征,训练免疫系统识别并攻击携带相同特征的癌细胞。一个人的肿瘤突变不同,AI 选出的靶点不同,最后生产出来的 mRNA 也不同。
过去的癌症药通常是先造出一种药,再给符合条件的一群患者使用。intismeran 反过来了:先读取一个人的癌症,把肿瘤变成测序数据,再计算靶点,最后把结果重新编码成药。这次 III 期成功,至少证明这套「一人一药」的路线已经能在大规模临床试验里跑通。
默沙东
🎉6
OpenAI把Codex从编程工具扩成通用Agent引擎
OpenAI 开始把 Codex 从编程工具推向更广泛的 Agent 场景。开发者可以直接把 Codex 背后的 Agent 运行系统接进自己的软件,用来做客服、运营、安全、研究等任务,不再局限于写代码和开发工具。
这套系统叫 Codex Harness,早就已经开源。过去它主要用来支撑 Codex 写代码,现在 OpenAI 明确提出,也可以直接拿它去做客服、运营、安全等其他 Agent 产品。
OpenAI 展示了一个物流后台 Demo。遇到异常订单后,Codex 会自动查数据、调用企业工具、比较处理方案,需要真正修改订单时再让人工确认。整个过程直接发生在业务软件里,用户不需要打开 Codex,也不用单独和聊天机器人对话。
OpenAI
OpenAI 开始把 Codex 从编程工具推向更广泛的 Agent 场景。开发者可以直接把 Codex 背后的 Agent 运行系统接进自己的软件,用来做客服、运营、安全、研究等任务,不再局限于写代码和开发工具。
这套系统叫 Codex Harness,早就已经开源。过去它主要用来支撑 Codex 写代码,现在 OpenAI 明确提出,也可以直接拿它去做客服、运营、安全等其他 Agent 产品。
OpenAI 展示了一个物流后台 Demo。遇到异常订单后,Codex 会自动查数据、调用企业工具、比较处理方案,需要真正修改订单时再让人工确认。整个过程直接发生在业务软件里,用户不需要打开 Codex,也不用单独和聊天机器人对话。
OpenAI
OpenAI Developers
Codex as a platform: build on the open agent harness | OpenAI Developers
Build Codex into the products and workflows your users already know.
Superwhisper开源6亿参数小模型,专门整理语音转写
AI 语音输入工具 Superwhisper 发布首个开源模型 S1-mini。它只有约 6 亿参数,基于 Qwen3-0.6B 微调,专门负责整理语音转写出来的草稿,可以完全在本地设备运行。
S1-mini 本身不负责听音频。Whisper、Parakeet 等语音识别模型先把声音转成文字,再交给它处理。它会删除「嗯、呃」等口头填充词,处理说错后改口的内容,补上标点和大小写,还能把口述的数字、日期、时间、金额和邮箱改成正常书面格式。
模型目前只支持英文。官方量化版本约 462MiB,可在普通笔记本 CPU 上运行,也提供 GGUF,可接入 llama.cpp、Ollama 和 LM Studio。官方在 7519 条英文测试数据上测得 94.8% 的 token 准确率,不过没有给出与其他文本整理模型的横向成绩。
S1-mini 其实早在 6 月就进入 Superwhisper App 做实验性测试,当时官方称多数机器处理速度可达到约 200 token/s。现在权重正式公开,其他语音输入、会议记录和字幕应用也可以直接拿去本地部署。
Superwhisper
AI 语音输入工具 Superwhisper 发布首个开源模型 S1-mini。它只有约 6 亿参数,基于 Qwen3-0.6B 微调,专门负责整理语音转写出来的草稿,可以完全在本地设备运行。
S1-mini 本身不负责听音频。Whisper、Parakeet 等语音识别模型先把声音转成文字,再交给它处理。它会删除「嗯、呃」等口头填充词,处理说错后改口的内容,补上标点和大小写,还能把口述的数字、日期、时间、金额和邮箱改成正常书面格式。
模型目前只支持英文。官方量化版本约 462MiB,可在普通笔记本 CPU 上运行,也提供 GGUF,可接入 llama.cpp、Ollama 和 LM Studio。官方在 7519 条英文测试数据上测得 94.8% 的 token 准确率,不过没有给出与其他文本整理模型的横向成绩。
S1-mini 其实早在 6 月就进入 Superwhisper App 做实验性测试,当时官方称多数机器处理速度可达到约 200 token/s。现在权重正式公开,其他语音输入、会议记录和字幕应用也可以直接拿去本地部署。
Superwhisper
👍3❤1
谷歌给大学生白送1年Gemini:美国送Pro,其他地区送Plus
谷歌开始给大学生免费送一整年 Google AI 付费订阅。
符合条件的美国大学生可以拿 Google AI Pro,原价 19.99 美元/月,包含 Gemini 4 倍使用额度、5TB 存储和 Gemini Spark。
美国以外 140 多个国家则提供 Google AI Plus,Gemini 额度为免费版的 2 倍,存储为 400GB。
免费订阅需要验证学生身份并绑定付款方式,领取截止到 2026 年 12 月 31 日。免费期结束后如果没有取消,会自动转为付费订阅。
美国 2025 年学生 Pro 试用已经到期的用户,今年也可以重新申请。
谷歌
谷歌开始给大学生免费送一整年 Google AI 付费订阅。
符合条件的美国大学生可以拿 Google AI Pro,原价 19.99 美元/月,包含 Gemini 4 倍使用额度、5TB 存储和 Gemini Spark。
美国以外 140 多个国家则提供 Google AI Plus,Gemini 额度为免费版的 2 倍,存储为 400GB。
免费订阅需要验证学生身份并绑定付款方式,领取截止到 2026 年 12 月 31 日。免费期结束后如果没有取消,会自动转为付费订阅。
美国 2025 年学生 Pro 试用已经到期的用户,今年也可以重新申请。
谷歌
❤3
智谱的Coding翻身仗:DeepSeek逼它换方向,用户替它选了路
36 氪复盘了智谱靠 Coding 翻身的幕后过程:
2025 年春节 DeepSeek R1 爆火后,智谱原本最依赖的企业定制业务受到直接冲击。一名员工估算,当时近 30% 的客户转向 DeepSeek。为了留住客户,智谱一度给出很低的折扣。
5 月,智谱开了一场关键战略会。公司放弃文本、多模态、编程分别做垂直模型的路线,决定把 Reasoning、Coding、Agentic 三类能力塞进同一个大模型。这个临时转向也让原定 4 月发布的 GLM-4.5 一直拖到 7 月。
有意思的是,智谱一开始也没认准 Coding。三类能力最初没有明显主次,真正把模型推向 Coding 的是用户。研发过程中,「提高研发效率」一直是客户反馈最集中的需求。GLM-4.5 上线后,越来越多企业要求把它接进程序员工作流,开发者也开始把它当成 Claude 的平替。Coding 很快成了 GLM-4.5 反响最好的能力。
这之后,智谱开始收缩战线。Coding 和文本方向目前有百人左右,多模态训练团队则缩减到 10 人。训练上也越来越重数据、后训练和真实客户反馈。遇到技术路线拿不准,就让几组研究员分别去跑 A/B Test,谁效果好就选谁。模型发布前,一边测通用能力,一边让交付团队拿真实场景再测一轮。
GLM-4.5 之后,智谱推出 Coding Plan 和企业版,并一路把 Coding 做成 GLM 系列最重要的能力之一。到了 GLM-5.2,模型口碑和 API 收入一起起飞。智谱 ARR 从今年 5 月的 5 亿至 6 亿美元,一下子在 7 月升到 10 亿美元。
智谱并不是一开始就押中了 Coding。DeepSeek 先打掉了它原来的舒适区,客户再替它选出了新方向。
智能涌现
36 氪复盘了智谱靠 Coding 翻身的幕后过程:
2025 年春节 DeepSeek R1 爆火后,智谱原本最依赖的企业定制业务受到直接冲击。一名员工估算,当时近 30% 的客户转向 DeepSeek。为了留住客户,智谱一度给出很低的折扣。
5 月,智谱开了一场关键战略会。公司放弃文本、多模态、编程分别做垂直模型的路线,决定把 Reasoning、Coding、Agentic 三类能力塞进同一个大模型。这个临时转向也让原定 4 月发布的 GLM-4.5 一直拖到 7 月。
有意思的是,智谱一开始也没认准 Coding。三类能力最初没有明显主次,真正把模型推向 Coding 的是用户。研发过程中,「提高研发效率」一直是客户反馈最集中的需求。GLM-4.5 上线后,越来越多企业要求把它接进程序员工作流,开发者也开始把它当成 Claude 的平替。Coding 很快成了 GLM-4.5 反响最好的能力。
这之后,智谱开始收缩战线。Coding 和文本方向目前有百人左右,多模态训练团队则缩减到 10 人。训练上也越来越重数据、后训练和真实客户反馈。遇到技术路线拿不准,就让几组研究员分别去跑 A/B Test,谁效果好就选谁。模型发布前,一边测通用能力,一边让交付团队拿真实场景再测一轮。
GLM-4.5 之后,智谱推出 Coding Plan 和企业版,并一路把 Coding 做成 GLM 系列最重要的能力之一。到了 GLM-5.2,模型口碑和 API 收入一起起飞。智谱 ARR 从今年 5 月的 5 亿至 6 亿美元,一下子在 7 月升到 10 亿美元。
智谱并不是一开始就押中了 Coding。DeepSeek 先打掉了它原来的舒适区,客户再替它选出了新方向。
智能涌现
👍3
动察Beating AI News
中美AI衍生品竞速,上海期交所筹建Token期货 上海期货交易所正在筹划推出针对 AI Token(人工智能模型处理的最小信息单位)的期货合约,标志着中美两国在人工智能与金融衍生品领域竞争的进一步升级。与美国芝加哥商品交易所(CME)和洲际交易所(ICE)筹备中的 GPU 算力租赁期货不同,上海期交所的期货合约直接挂钩用于 AI 服务定价的 Token 消耗量,旨在为整个 AI 产业链提供对冲算力与推理成本的新型金融工具。 Token 期货的研究设计,旨在应对中国急剧膨胀的算力与 Token 消费需求。官方数据显示,自…
美国开始给AI算力期货建立监管框架,CME拟10月开盘
美国商品期货交易委员会(CFTC)开始就 AI 算力衍生品公开征求意见。这是美国监管层为算力期货建立规则的第一步。CME 已计划在 10 月 5 日推出首批产品,目前还要经过监管审查。
CME 首批会做英伟达 H100 和 B200 两种算力期货。它们跟踪 GPU 每小时租金,每份合约对应一个月的租用成本,最后用现金结算。AI 公司可以提前锁定未来算力成本,投资者也可以交易未来 GPU 租金涨跌。
不过算力比石油难标准化。CFTC 指出,同一种 GPU 在不同云厂商、地区和合同下价格差别很大,大量交易价格也不公开。目前市场可能还缺乏足够的标准化、流动性和统一价格。监管部门因此重点询问价格指数是否容易被操纵,以及永久算力期货、散户保护等问题。
上海期货交易所也在研究 AI Token 期货。两边路线不同:中国想直接跟踪 AI 服务消耗的 Token,美国主要盯 GPU 租金。此前美国还停留在交易所准备产品,现在已经走到监管层开始研究具体规则。中国方案目前仍处于早期设计阶段,尚未确定推出时间。
CFTC
美国商品期货交易委员会(CFTC)开始就 AI 算力衍生品公开征求意见。这是美国监管层为算力期货建立规则的第一步。CME 已计划在 10 月 5 日推出首批产品,目前还要经过监管审查。
CME 首批会做英伟达 H100 和 B200 两种算力期货。它们跟踪 GPU 每小时租金,每份合约对应一个月的租用成本,最后用现金结算。AI 公司可以提前锁定未来算力成本,投资者也可以交易未来 GPU 租金涨跌。
不过算力比石油难标准化。CFTC 指出,同一种 GPU 在不同云厂商、地区和合同下价格差别很大,大量交易价格也不公开。目前市场可能还缺乏足够的标准化、流动性和统一价格。监管部门因此重点询问价格指数是否容易被操纵,以及永久算力期货、散户保护等问题。
上海期货交易所也在研究 AI Token 期货。两边路线不同:中国想直接跟踪 AI 服务消耗的 Token,美国主要盯 GPU 租金。此前美国还停留在交易所准备产品,现在已经走到监管层开始研究具体规则。中国方案目前仍处于早期设计阶段,尚未确定推出时间。
CFTC
CFTC
CFTC Requests Comment on the Listing of Compute Derivatives Contracts
The CFTC issued a request for comment to better inform its understanding and oversight of derivatives markets in compute.
动察Beating AI News
投资人:Anthropic狂放增长数据为IPO造势,OpenAI很快也会跟 Atreides Management 管理合伙人兼 CIO Gavin Baker 怀疑,Anthropic 最近密集流出的增长数据是在给 IPO 路演造势。650 亿美元 ARR 可能只是第一步,公司希望随着 7、8、9 月更多算力上线,在正式面对投资者时拿出更高的增长数字。 Baker 预计 OpenAI 很快也会跟进,放出最新的增长数据,证明自己正在重新抢回份额,而且增长速度更快。 Anthropic 和 OpenAI…
OpenAI CFO内部放出三组增长数据:整体涨35%,企业涨50%,周活2000万
OpenAI CFO Sarah Friar 在全员会上展示最新数据:本季度至今,公司整体年化收入跑率增长 35%,企业业务增长 50%;AI 编程和办公产品周活跃用户达到 2000 万。
这组数据比二季度明显提速。OpenAI 二季度实际营收 67 亿美元,环比只增长 18%,同期 Anthropic 达到 116 亿美元,首次超过 OpenAI。现在 OpenAI 想证明,三季度已经重新加速,企业业务尤其快。
Friar 同时表示,OpenAI 计划在 2027 年上市,如果业务继续加速,也可能提前。公司已经秘密递交 IPO 文件,但不打算和 Anthropic 抢谁先上市。
CNBC
OpenAI CFO Sarah Friar 在全员会上展示最新数据:本季度至今,公司整体年化收入跑率增长 35%,企业业务增长 50%;AI 编程和办公产品周活跃用户达到 2000 万。
这组数据比二季度明显提速。OpenAI 二季度实际营收 67 亿美元,环比只增长 18%,同期 Anthropic 达到 116 亿美元,首次超过 OpenAI。现在 OpenAI 想证明,三季度已经重新加速,企业业务尤其快。
Friar 同时表示,OpenAI 计划在 2027 年上市,如果业务继续加速,也可能提前。公司已经秘密递交 IPO 文件,但不打算和 Anthropic 抢谁先上市。
CNBC
CNBC
OpenAI 'will be a public company in 2027' or sooner, CFO Friar tells employees
In an all hands meeting, Friar told employees not worry about rival Anthropic's IPO timeline.
❤1