动察Beating AI News
前OpenAI CTO新模型Inkling-Small开源:参数不到Inkling三成,性能只差1分 OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab 发布 Inkling-Small,并开放完整权重。这是一款多模态推理模型,支持文字、图片和音频输入。和 Inkling 一样,模型采用 Apache 2.0 许可证。 Inkling-Small 共有 2760 亿参数,每次激活 120 亿。Inkling 则有 9750 亿总参数,激活 410 亿。Artificial…
Thinking Machines提出分级开源:先API、再微调、最后放权重
OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab 提出一套开源模型的安全路线。模型先通过受限 API 提供给防御机构,再逐步开放受监控使用和托管微调。只有模型风险可控,外部防御体系也准备好,团队才考虑公开权重。公开权重并非默认终点,任何阶段都可以暂停。
团队以 Inkling 和 Inkling-Small 为例。两款模型接受了内部评测、4 家独立机构测试,以及专门去除拒答限制的微调。结果显示,它们在生化、网络攻击和失控风险上,没有明显超过现有开源模型。团队因此判断,公开权重不会增加实质性风险。
Thinking Machines 还在研究从训练数据中剔除危险知识,尽量保留模型的通用能力,同时削弱生化和网络攻击能力。
Thinking Machines
OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab 提出一套开源模型的安全路线。模型先通过受限 API 提供给防御机构,再逐步开放受监控使用和托管微调。只有模型风险可控,外部防御体系也准备好,团队才考虑公开权重。公开权重并非默认终点,任何阶段都可以暂停。
团队以 Inkling 和 Inkling-Small 为例。两款模型接受了内部评测、4 家独立机构测试,以及专门去除拒答限制的微调。结果显示,它们在生化、网络攻击和失控风险上,没有明显超过现有开源模型。团队因此判断,公开权重不会增加实质性风险。
Thinking Machines 还在研究从训练数据中剔除危险知识,尽量保留模型的通用能力,同时削弱生化和网络攻击能力。
Thinking Machines
Thinking Machines Lab
A Safe Path to Open Weights
Strategic openness can strengthen AI safety and support broader access as defenses and safety science mature.
❤2😁1
动察Beating AI News
DeepSeek-V4-Flash正式版发布,V4-Pro还得等 DeepSeek 发布 V4-Flash 正式版 API,重点提升编程、工具调用和长任务执行能力。官方称,多项 Agent 基准成绩大幅超过此前的 V4-Pro-Preview。 新版本原生支持 Responses API,并针对 Codex 做了适配。模型结构和参数规模没有变化,主要重新进行了后训练。 本次只升级 API 接口,DeepSeek App 和网页端没有更新。V4-Pro 正式版仍未发布,官方称将尽快上线。 DeepSeek
CC Switch升级:DeepSeek-V4-Flash接Codex终于不用后台中转
开源模型切换工具 CC Switch 发布 v3.19.1,支持 DeepSeek-V4-Flash 的原生 Responses API。用户填入 DeepSeek API Key,就能在 Codex 中直接调用这款模型。
旧版也能接入 DeepSeek,但必须开启 CC Switch 的本地路由,把 Codex 请求转换成另一种接口格式。新版直接连接 DeepSeek 官方接口,使用时不再依赖后台代理。
目前只有 V4-Flash 支持这种直连方式。V4-Pro 仍需走旧路由,DeepSeek 预计在 8 月上旬为它加入 Responses API。
CC Switch
开源模型切换工具 CC Switch 发布 v3.19.1,支持 DeepSeek-V4-Flash 的原生 Responses API。用户填入 DeepSeek API Key,就能在 Codex 中直接调用这款模型。
旧版也能接入 DeepSeek,但必须开启 CC Switch 的本地路由,把 Codex 请求转换成另一种接口格式。新版直接连接 DeepSeek 官方接口,使用时不再依赖后台代理。
目前只有 V4-Flash 支持这种直连方式。V4-Pro 仍需走旧路由,DeepSeek 预计在 8 月上旬为它加入 Responses API。
CC Switch
GitHub
Releases · farion1231/cc-switch
A cross-platform desktop All-in-One assistant for Claude Code, Codex, OpenCode, OpenClaw, Grok Build & Hermes Agent. Only official website: ccswitch.io - farion1231/cc-switch
🔥1
YC开源内部多Agent平台QM,让公司拥有自己的AI员工团队
Y Combinator 开源内部使用的多 Agent 平台 QM。它类似 Hermes、OpenClaw,允许企业创建、管理和协作多个 AI Agent。
QM 支持 Slack 和网页界面,采用 MIT 开源协议。YC 已将它用于财务、法律、活动和工程等内部工作,也用于开发 QM 本身。
GitHub 仓库
Y Combinator 开源内部使用的多 Agent 平台 QM。它类似 Hermes、OpenClaw,允许企业创建、管理和协作多个 AI Agent。
QM 支持 Slack 和网页界面,采用 MIT 开源协议。YC 已将它用于财务、法律、活动和工程等内部工作,也用于开发 QM 本身。
GitHub 仓库
Altman回应Kimi K3:部分速度档位OpenAI更划算
OpenAI CEO Sam Altman 在《Invest Like the Best》播客中回应月之暗面的开源旗舰模型 Kimi K3。主持人称它是本周最值得关注的 AI 发布,并追问它是否会成为类似 DeepSeek 的里程碑事件。
Altman 没有正面回答 Kimi K3 是否具有里程碑意义,也没有给出能力对比结果。他强调,OpenAI 要在不同速度和价格档位上提供最划算的模型,并称在特定延迟要求下,OpenAI 目前比 Kimi 更划算。不过,他没有说明具体型号、价格或测试条件。
Altman 承认,廉价模型和开放权重模型会长期存在。部分用户需要自己部署和修改权重,开源模型因此会一直有市场。OpenAI 也会用自家大模型蒸馏出更小、更便宜的模型。
对于 OpenAI 模型被竞争者蒸馏的担忧,Altman 称这不在他最担心的十件事里。他认为 OpenAI 未来会拥有巨大的推理需求,即使利润率不高,收入规模也足以继续承担昂贵的模型训练。
Invest Like the Best
OpenAI CEO Sam Altman 在《Invest Like the Best》播客中回应月之暗面的开源旗舰模型 Kimi K3。主持人称它是本周最值得关注的 AI 发布,并追问它是否会成为类似 DeepSeek 的里程碑事件。
Altman 没有正面回答 Kimi K3 是否具有里程碑意义,也没有给出能力对比结果。他强调,OpenAI 要在不同速度和价格档位上提供最划算的模型,并称在特定延迟要求下,OpenAI 目前比 Kimi 更划算。不过,他没有说明具体型号、价格或测试条件。
Altman 承认,廉价模型和开放权重模型会长期存在。部分用户需要自己部署和修改权重,开源模型因此会一直有市场。OpenAI 也会用自家大模型蒸馏出更小、更便宜的模型。
对于 OpenAI 模型被竞争者蒸馏的担忧,Altman 称这不在他最担心的十件事里。他认为 OpenAI 未来会拥有巨大的推理需求,即使利润率不高,收入规模也足以继续承担昂贵的模型训练。
Invest Like the Best
YouTube
Sam Altman on AGI, Compute, and Human Agency
Sam Altman joins us for a wide-ranging conversation about OpenAI’s next chapter, the race for compute, and what happens as artificial intelligence becomes more powerful, abundant, and embedded across the economy. He explains why OpenAI recently narrowed its…
❤2
动察Beating AI News
Hugging Face遭AI Agent入侵,幕后黑手竟是OpenAI测试模型 Hugging Face 此前披露,一套来源不明的自主 AI Agent 入侵了生产系统。OpenAI 现在确认,这套 Agent 由多个内部测试模型驱动,包括 GPT-5.6 Sol 和一款能力更强的预发布模型。 OpenAI 当时正让模型参加 ExploitGym 网络安全评测。为了测试能力上限,团队降低了模型对网络攻击任务的拒绝,并关闭了平时用于拦截高风险行为的生产级分类器。 模型原本只需完成基准题,却发现软件代理中的零日漏洞,逃出…
OpenAI模型攻入Hugging Face,Altman称AI开发可能要减速
OpenAI CEO Sam Altman 表示,Hugging Face 入侵事件让他第一次切身感到前沿模型的安全风险。OpenAI 事发后暂停训练。他认为,如果模型继续以现在的速度变强,行业可能需要放慢开发,给社会留出补上防线的时间。
这起事故发生在 OpenAI 内部网络安全评测中。GPT-5.6 Sol 和一款更强的预发布模型,为测试被降低了网络攻击拒答限制。它们先利用零日漏洞突破 OpenAI 沙箱,取得互联网访问;随后又利用被盗凭据和漏洞进入 Hugging Face 生产数据库,直接取得测试答案。
Altman 说,短期可以暂停训练、修补漏洞和加固沙箱。但两个月后的模型还会更强,短期措施解决不了能力持续增长的问题。长期难题是如何控制开发速度,又不让规则变成头部公司排除竞争的工具,也不让前沿实验室被视为串通。
Invest Like The Best
OpenAI CEO Sam Altman 表示,Hugging Face 入侵事件让他第一次切身感到前沿模型的安全风险。OpenAI 事发后暂停训练。他认为,如果模型继续以现在的速度变强,行业可能需要放慢开发,给社会留出补上防线的时间。
这起事故发生在 OpenAI 内部网络安全评测中。GPT-5.6 Sol 和一款更强的预发布模型,为测试被降低了网络攻击拒答限制。它们先利用零日漏洞突破 OpenAI 沙箱,取得互联网访问;随后又利用被盗凭据和漏洞进入 Hugging Face 生产数据库,直接取得测试答案。
Altman 说,短期可以暂停训练、修补漏洞和加固沙箱。但两个月后的模型还会更强,短期措施解决不了能力持续增长的问题。长期难题是如何控制开发速度,又不让规则变成头部公司排除竞争的工具,也不让前沿实验室被视为串通。
Invest Like The Best
YouTube
Sam Altman on AGI, Compute, and Human Agency
Sam Altman joins us for a wide-ranging conversation about OpenAI’s next chapter, the race for compute, and what happens as artificial intelligence becomes more powerful, abundant, and embedded across the economy. He explains why OpenAI recently narrowed its…
👍2
动察Beating AI News
Patel 同时是投资人,已入股约 20 家 AI 初创公司,包括 Mira Murati 创办的 Thinking Machines Lab,以及去年与英伟达达成超过 9 亿美元授权合作的芯片公司 Enfabrica。SemiAnalysis 研报写到这些公司时,不会像传统媒体那样主动披露 Patel 的投资关系,对它们的竞争对手也照常覆盖。
SemiAnalysis要募4亿美元基金:边写AI芯片研报边投资
芯片与 AI 基础设施研究机构 SemiAnalysis 正筹集一只 4 亿美元风投基金。美国 SEC 文件显示,基金名为 SemiAnalysis Capital Fund I,由创始人 Dylan Patel 管理。
Patel 已持股约 20 家初创公司,包括 Thinking Machines Lab 和芯片公司 Enfabrica。他此前还募集 5000 万美元,专门投资 AI 基础设施公司 Fluidstack。
SemiAnalysis 过去靠研究芯片和 AI 基础设施建立影响力,现在开始大规模募集资金,直接投资自己长期关注的行业。它可能一边评价相关公司,一边持有这些公司的股份,今后如何披露投资关系会更加重要。
The Information
芯片与 AI 基础设施研究机构 SemiAnalysis 正筹集一只 4 亿美元风投基金。美国 SEC 文件显示,基金名为 SemiAnalysis Capital Fund I,由创始人 Dylan Patel 管理。
Patel 已持股约 20 家初创公司,包括 Thinking Machines Lab 和芯片公司 Enfabrica。他此前还募集 5000 万美元,专门投资 AI 基础设施公司 Fluidstack。
SemiAnalysis 过去靠研究芯片和 AI 基础设施建立影响力,现在开始大规模募集资金,直接投资自己长期关注的行业。它可能一边评价相关公司,一边持有这些公司的股份,今后如何披露投资关系会更加重要。
The Information
The Information
Exclusive: SemiAnalysis’ Dylan Patel Targets $400 Million Venture Capital Fund
A new venture capital fund called SemiAnalysis Capital Fund I, managed by Dylan Patel, the founder of chip and infrastructure research firm SemiAnalysis, is targeting raising $400 million, according to a securities filing.
The Information reported in…
The Information reported in…
👍1🤯1
动察Beating AI News
OpenAI以8520亿美元估值完成1220亿美元融资,首次向散户开放入股通道 OpenAI 宣布完成硅谷史上最大规模融资,总额 1220 亿美元,投后估值 8520 亿美元。该轮融资在今年 2 月公布的 1100 亿美元战略投资人承诺基础上,额外募集了 120 亿美元,其中 30 亿美元首次来自个人投资者。 此前公布的 1100 亿美元承诺中,亚马逊出资 500 亿美元(150 亿美元即时到账,350 亿美元在 OpenAI 上市或实现 AGI 后跟投),英伟达和软银各出资 300 亿美元。Andreessen…
亚马逊提前兑现500亿美元承诺,OpenAI最后213亿美元到账
亚马逊已完成对 OpenAI 的 500 亿美元投资。这不是新一轮融资,而是 2 月公布的 1100 亿美元融资完成交割。
亚马逊第一季度先投入 150 亿美元,第二季度追加 137 亿美元。6 月 30 日后,公司又买入 213 亿美元 OpenAI 优先股,至此全部投完。亚马逊由此持有 OpenAI 约 5% 股份。
原协议允许亚马逊自行决定提前投资。OpenAI 上市或达到特定技术里程碑后,剩余投资才会变成强制义务,最晚期限为 2028 年底。相关条件尚未触发,亚马逊仍选择提前付清。
FT
亚马逊已完成对 OpenAI 的 500 亿美元投资。这不是新一轮融资,而是 2 月公布的 1100 亿美元融资完成交割。
亚马逊第一季度先投入 150 亿美元,第二季度追加 137 亿美元。6 月 30 日后,公司又买入 213 亿美元 OpenAI 优先股,至此全部投完。亚马逊由此持有 OpenAI 约 5% 股份。
原协议允许亚马逊自行决定提前投资。OpenAI 上市或达到特定技术里程碑后,剩余投资才会变成强制义务,最晚期限为 2028 年底。相关条件尚未触发,亚马逊仍选择提前付清。
FT
❤3😁1
Google AI Studio手机App胎死腹中:80万人预约,功能转入Gemini
谷歌放弃原定推出的 Google AI Studio iOS 和 Android App。它原本要把 AI Studio 的应用生成和代码修改功能搬到手机,让用户随时用提示词做软件。已有约 80 万人预约,但谷歌决定不再发布独立 App。
应用生成功能将直接嵌入 Gemini。未来用户可以在普通对话中描述需求,让 Gemini 生成对应应用。该功能计划覆盖手机和桌面端,具体上线时间尚未公布。
Google AI Studio 网页版会继续开发,仍面向希望从提示词一路做到完整产品的用户。
Google AI Studio
谷歌放弃原定推出的 Google AI Studio iOS 和 Android App。它原本要把 AI Studio 的应用生成和代码修改功能搬到手机,让用户随时用提示词做软件。已有约 80 万人预约,但谷歌决定不再发布独立 App。
应用生成功能将直接嵌入 Gemini。未来用户可以在普通对话中描述需求,让 Gemini 生成对应应用。该功能计划覆盖手机和桌面端,具体上线时间尚未公布。
Google AI Studio 网页版会继续开发,仍面向希望从提示词一路做到完整产品的用户。
Google AI Studio
动察Beating AI News
Kimi K3接入Claude Code,平均任务成本是Kimi Code的9倍 AI Agent 基础设施公司 Composio 将同一款 Kimi K3 接入 Kimi Code、Hermes 和 Claude Code,完成 28 项相同任务。三套运行框架的成功数只差 2 项,Token 用量和成本却相差很大。 Kimi Code 完成 22 项,Hermes 完成 21 项,Claude Code 完成 20 项。单项任务 Token 中位数分别为 6.1 万、6.7 万和 34 万。Composio…
Claude Code跑Kimi K3最贵最慢,成本是Hermes Agent近4倍
AI Agent 基础设施公司 Composio 扩大测试,把同一款 Kimi K3 接入 6 套 Agent 框架,完成 26 项相同任务。这里比较的是运行框架,底层模型均为 Kimi K3。
Kimi Code 完成 21 项排名第一。Hermes 完成 20 项,Pi Agent 和 Claude Code 均为 19 项,OpenCode 为 18 项,Codex 以 17 项垫底。
按 Kimi K3 官方价格估算,Hermes 和 Pi Agent 平均每项任务成本最低,分别为 0.39 美元和 0.40 美元。Claude Code 达到 1.47 美元,约为 Hermes 的 3.8 倍。
Pi Agent 速度最快,单项任务中位耗时为 161.7 秒。Claude Code 最慢,达到 347.6 秒。同一模型换套框架,成功数最多只差 4 项,平均成本却相差近 4 倍,耗时相差超过 2 倍。
Composio
AI Agent 基础设施公司 Composio 扩大测试,把同一款 Kimi K3 接入 6 套 Agent 框架,完成 26 项相同任务。这里比较的是运行框架,底层模型均为 Kimi K3。
Kimi Code 完成 21 项排名第一。Hermes 完成 20 项,Pi Agent 和 Claude Code 均为 19 项,OpenCode 为 18 项,Codex 以 17 项垫底。
按 Kimi K3 官方价格估算,Hermes 和 Pi Agent 平均每项任务成本最低,分别为 0.39 美元和 0.40 美元。Claude Code 达到 1.47 美元,约为 Hermes 的 3.8 倍。
Pi Agent 速度最快,单项任务中位耗时为 161.7 秒。Claude Code 最慢,达到 347.6 秒。同一模型换套框架,成功数最多只差 4 项,平均成本却相差近 4 倍,耗时相差超过 2 倍。
Composio
动察Beating AI News
OpenAI向美国官员展示新模型Astra:多个Agent可长期协作解决难题 《The Information》援引三名知情人士称,OpenAI 正在测试一条暂称 Astra 的新模型线。它与 Sol、Terra、Luna 并列,主打让多个 Agent 长时间协作,处理复杂项目和高难度数学问题。 OpenAI CEO Sam Altman 本周已在华盛顿向政策制定者和监管机构演示 Astra。具体发布时间尚未确定。 Astra 是暂定名称,最终归入哪一代 GPT 也没有敲定。OpenAI 正在考虑 GPT…
OpenAI新模型Astra首秀:一口气推进10道十年未解数学难题
OpenAI 首次正式公布下一款主力模型 Astra。内部版本在 10 个长期未解的数学和理论计算机科学问题上取得新结果。这些问题的核心结论至少 10 年没有进展,多数停滞时间更长。
其中一些问题被直接解决或推翻。Astra 首次构造出非 sofic 群,回答了群论中的一个核心开放问题;它还推翻 Connes 刚性猜想,并解决 3 个 Erdős 问题。其余成果包括球体堆积、编码理论、量子复杂性和后量子密码相关问题的新上下界与困难性证明。
OpenAI 称,模型找到这 10 项结果所用的 Token,按 Sol API 价格折算约为 2000 美元。
这些数学论证由 Astra 生成。人类随后协助整理成论文,模型再把每项证明转成 Lean 证书,让计算机逐步核验推导是否成立。OpenAI 已公开论文、证明证书和模型的推理过程。
OpenAI
OpenAI 首次正式公布下一款主力模型 Astra。内部版本在 10 个长期未解的数学和理论计算机科学问题上取得新结果。这些问题的核心结论至少 10 年没有进展,多数停滞时间更长。
其中一些问题被直接解决或推翻。Astra 首次构造出非 sofic 群,回答了群论中的一个核心开放问题;它还推翻 Connes 刚性猜想,并解决 3 个 Erdős 问题。其余成果包括球体堆积、编码理论、量子复杂性和后量子密码相关问题的新上下界与困难性证明。
OpenAI 称,模型找到这 10 项结果所用的 Token,按 Sol API 价格折算约为 2000 美元。
这些数学论证由 Astra 生成。人类随后协助整理成论文,模型再把每项证明转成 Lean 证书,让计算机逐步核验推导是否成立。OpenAI 已公开论文、证明证书和模型的推理过程。
OpenAI
👍8❤1
动察Beating AI News
DeepSeek V4正式版疑似延期至8月,或直接撞上下一代模型集中发布 DeepSeek V4 正式版(V4 GA)可能推迟到 8 月中旬发布。 网友爆料称,DeepSeek 即将为自研 Harness 工具启动封闭测试,并从问卷参与者中挑选少量用户。封闭测试结束后约 1 至 2 周会开放 V4 GA,发布时间可能在 8 月 10 日至 20 日之间。 如果消息属实,DeepSeek V4 正式版上线时可能会面对更强竞争。届时 GPT-6、Claude Fable 5.1、GLM-5.5 等下一代模型可能已经进入市场。…
DeepSeek Harness开始内测,申请者需要提交开源作品
DeepSeek Harness 开始面向开源项目开发者招募内测用户。申请者需要做过 Agent Harness 相关项目,并提交 GitHub ID 和代表作。
Harness 是包在大模型外的一套 Agent 执行框架,负责管理上下文、调用工具和完成任务。DeepSeek 今年上半年已组建专门团队,并招聘产品经理、研发工程师和研究员。
几天前,社区曾流传一份小范围内测通知,但真实性无法确认。现在负责人公开招募,直接确认 DeepSeek Harness 已进入内测。
Tianyi Cui
DeepSeek Harness 开始面向开源项目开发者招募内测用户。申请者需要做过 Agent Harness 相关项目,并提交 GitHub ID 和代表作。
Harness 是包在大模型外的一套 Agent 执行框架,负责管理上下文、调用工具和完成任务。DeepSeek 今年上半年已组建专门团队,并招聘产品经理、研发工程师和研究员。
几天前,社区曾流传一份小范围内测通知,但真实性无法确认。现在负责人公开招募,直接确认 DeepSeek Harness 已进入内测。
Tianyi Cui
🐳6❤1
动察Beating AI News
Kimi K4要比K3更大,但月之暗面被英伟达芯片卡住 K3 刚发布,月之暗面已经在为下一代 Kimi K4 找芯片。新模型会比 2.8 万亿参数的 K3 明显更大,但目前还没有训练和发布时间表。 《The Information》称,K3 使用了英伟达最先进的 Blackwell 芯片,部分训练实际在中国完成,并非全部放在美国官员所说的泰国数据中心。 更关键的是,K3 并没有一座完整的大型训练集群。没有一家中国云厂商能提供足够多的 Blackwell,月之暗面至少接入了两家供应商,把大量八卡服务器连在一起。…
Kimi算力底牌曝光:阿里提供约2万张英伟达H200
彭博披露,月之暗面此前已通过阿里获得约 2 万张英伟达芯片的算力。这批芯片构成 Kimi 模型整体算力的重要部分。
多名知情人士称,芯片具体为 H200。阿里否认向月之暗面提供 H200,但没有否认双方存在约 2 万张英伟达芯片的算力合作,也没有说明实际型号。
阿里既是月之暗面的主要投资方,也是它的云服务商。彭博称,Kimi 已在部分关键指标上超过阿里自家的千问。这让阿里内部一些人感到失望:双方使用相近的训练资源,外部投资对象却先在模型性能上跑到了前面。
彭博
彭博披露,月之暗面此前已通过阿里获得约 2 万张英伟达芯片的算力。这批芯片构成 Kimi 模型整体算力的重要部分。
多名知情人士称,芯片具体为 H200。阿里否认向月之暗面提供 H200,但没有否认双方存在约 2 万张英伟达芯片的算力合作,也没有说明实际型号。
阿里既是月之暗面的主要投资方,也是它的云服务商。彭博称,Kimi 已在部分关键指标上超过阿里自家的千问。这让阿里内部一些人感到失望:双方使用相近的训练资源,外部投资对象却先在模型性能上跑到了前面。
彭博
Bloomberg.com
Moonshot’s Kimi Built on 20,000 Nvidia Chip Cluster From Alibaba
Chinese AI champion Moonshot has a computing power agreement with Alibaba Group Holding Ltd. for the use of around 20,000 Nvidia Corp. chips, underscoring China’s continued reliance on Western semiconductors to fuel its AI development, according to people…
😁5
动察Beating AI News
领先两年却硬生生捂烂:OpenAI产品掌门人透露跳槽内幕,直言老东家DeepMind动作迟缓 OpenAI 核心产品负责人 Thibault Sottiaux 在接受《连线》采访时,自曝了当年从 Google DeepMind 愤而跳槽至 OpenAI 的内幕。Sottiaux 透露,在 2022 年底 ChatGPT 发布并点燃全球生成式 AI 浪潮之前,DeepMind 内部实际上早已掌握并「压箱底」了长达两年的类似大语言模型与对话技术,但高层的保守与官僚导致该技术一直未能推出。 Sottiaux…
谷歌错过ChatGPT有多离谱:提前一年做出来,却没敢发布
OpenAI 产品负责人 Tibo Sottiaux 称,他在 Google DeepMind 时参与过内部聊天机器人 LMChat。这个项目在 ChatGPT 发布前约一年已经存在,产品形态也很接近后来的 ChatGPT。
Google 最终没有发布。Sottiaux 称,公司担心它冲击现有业务,DeepMind 也不能推出可能威胁 Google 的产品。
他此前在 WIRED 专访中已经讲过这段往事。
Tibo
OpenAI 产品负责人 Tibo Sottiaux 称,他在 Google DeepMind 时参与过内部聊天机器人 LMChat。这个项目在 ChatGPT 发布前约一年已经存在,产品形态也很接近后来的 ChatGPT。
Google 最终没有发布。Sottiaux 称,公司担心它冲击现有业务,DeepMind 也不能推出可能威胁 Google 的产品。
他此前在 WIRED 专访中已经讲过这段往事。
Tibo
🤡9
动察Beating AI News
刚刚上百亿美元被清仓的24岁AI股神Leopold本周末结婚,未婚妻是Anthropic CEO幕僚长 CNBC 援引两名知情人士称,24 岁前 OpenAI 研究员 Leopold Aschenbrenner 将于本周末结婚。未婚妻 Avital Balwit 现任 Anthropic CEO Dario Amodei 的幕僚长。 两人曾在 SBF 创办的 FTX Future Fund 共事。FTX 崩塌后,Leopold 加入 OpenAI,Avital 后来进入 Anthropic。 婚礼前夕,Leopold…
24岁AI股神Leopold婚礼前先开研讨会:圆桌讨论、分组交流,还谢绝份子钱
刚把约 160 亿美元公开股票组合中的大部分卖给 Citadel 后,24 岁前 OpenAI 研究员 Leopold Aschenbrenner 将在加州海滨小镇卡梅尔举行一场持续数日的婚礼。仪式设在托斯卡纳风格别墅,最后一天则在森林温泉酒店送别宾客。
婚礼前还安排了一场研讨会。宾客将参加圆桌讨论和分组交流。两位新人唯一的要求是不要送礼物。
未婚妻 Avital Balwit 现任 Anthropic CEO Dario Amodei 的幕僚长。两人此前都在 FTX Future Fund 工作,并在 FTX 崩塌时随团队离开。
WSJ
刚把约 160 亿美元公开股票组合中的大部分卖给 Citadel 后,24 岁前 OpenAI 研究员 Leopold Aschenbrenner 将在加州海滨小镇卡梅尔举行一场持续数日的婚礼。仪式设在托斯卡纳风格别墅,最后一天则在森林温泉酒店送别宾客。
婚礼前还安排了一场研讨会。宾客将参加圆桌讨论和分组交流。两位新人唯一的要求是不要送礼物。
未婚妻 Avital Balwit 现任 Anthropic CEO Dario Amodei 的幕僚长。两人此前都在 FTX Future Fund 工作,并在 FTX 崩塌时随团队离开。
WSJ
The Wall Street Journal
His Wedding Guests Were Arriving—Just as His $45 Billion Fund Was Falling Apart
Leopold Aschenbrenner was hailed as the ‘Nostradamus of AI.’ But his Situational Awareness hedge fund took on too much leverage, leading to a crash he never saw coming.
😁1
动察Beating AI News
半年暴赚439%的AI基金遭反噬,Citadel接手大部分股票仓位 24 岁前 OpenAI 研究员 Leopold Aschenbrenner 管理的 Situational Awareness,在 AI 股票大跌后,将大部分公开股票卖给 Citadel。基金交易前约有 160 亿美元公开股票,重仓 SK 海力士、CoreWeave、Nebius 等 AI 产业链公司。 基金此前借钱放大仓位。市场反转后,它需要追加资金或出售资产,最终选择减仓。CNBC 称基金清空了公开股票,路透社和《华尔街日报》则称出售大部分仓位。…
差点卖掉35亿美元Anthropic股权,Leopold第二天早上撤回
资金最紧张时,Leopold Aschenbrenner 一度同意出售价值约 35 亿美元的 Anthropic 股权。买方是由 Greenoaks 和红杉资本牵头的投资者。
这笔交易在周三深夜谈妥,第二天早上又被撤回。基金随后改为出售大部分公开股票,用所得资金偿还借款。
Leopold 最终保住了 Anthropic 等未上市公司股权。他在给投资人的信中称,基金选择牺牲公开股票仓位,以清除杠杆并保留私募投资。
WSJ
资金最紧张时,Leopold Aschenbrenner 一度同意出售价值约 35 亿美元的 Anthropic 股权。买方是由 Greenoaks 和红杉资本牵头的投资者。
这笔交易在周三深夜谈妥,第二天早上又被撤回。基金随后改为出售大部分公开股票,用所得资金偿还借款。
Leopold 最终保住了 Anthropic 等未上市公司股权。他在给投资人的信中称,基金选择牺牲公开股票仓位,以清除杠杆并保留私募投资。
WSJ
The Wall Street Journal
His Wedding Guests Were Arriving—Just as His $45 Billion Fund Was Falling Apart
Leopold Aschenbrenner was hailed as the ‘Nostradamus of AI.’ But his Situational Awareness hedge fund took on too much leverage, leading to a crash he never saw coming.
😁1
中国VC熬过3年寒冬:至少60只美元基金抢募350亿美元
中国投资机构正筹备至少 60 只新美元基金,目标募资约 350 亿美元,其中约 40 只是风投基金。红杉中国、IDG 资本、经纬创投和明势创投等正在募资或准备启动募资。
这轮回暖主要由 AI、机器人和科技公司上市带动。部分投资者把中国 AI 当作对美国市场押注的对冲,因为中国模型价格更低,使用成本也更便宜。智谱和 MiniMax 上市后,早期投资机构也重新看到了退出机会。
但这还不是中国 VC 重回繁荣期。去年只有 97 只中国相关基金募到 136 亿美元,远低于 2022 年的 1105 只、1500 亿美元。美国大型机构仍在收缩,欧洲和中东资金能否补上缺口仍不确定。
FT
中国投资机构正筹备至少 60 只新美元基金,目标募资约 350 亿美元,其中约 40 只是风投基金。红杉中国、IDG 资本、经纬创投和明势创投等正在募资或准备启动募资。
这轮回暖主要由 AI、机器人和科技公司上市带动。部分投资者把中国 AI 当作对美国市场押注的对冲,因为中国模型价格更低,使用成本也更便宜。智谱和 MiniMax 上市后,早期投资机构也重新看到了退出机会。
但这还不是中国 VC 重回繁荣期。去年只有 97 只中国相关基金募到 136 亿美元,远低于 2022 年的 1105 只、1500 亿美元。美国大型机构仍在收缩,欧洲和中东资金能否补上缺口仍不确定。
FT
Opus 5写5500行代码造出《指环王》世界,Karpathy称AI造游戏时代即将来临
OpenAI 联合创始人、现 Anthropic 预训练团队成员 Andrej Karpathy 把《指环王》开头一段交给 Opus 5,给出 100 万 Token、约 10 美元的预算,让它用 Three.js 做成一个 3D 世界。
模型运行约 2 小时,写出 5500 行代码。它需要安排各种多边形素材在三维坐标中的位置,再写代码让整个场景动起来。成品有些粗糙,但确实把文字变成了可以播放的 3D 场景。
这类内容过去很少有人愿意专门制作,成本和时间都不划算。LLM 却可以一直做下去,让高度定制的世界变成随手生成的内容。Karpathy 畅想,未来用户可以进入这种临时生成的世界,成为故事角色、旁观者或 NPC,像是一个按需出现的《GTA》。
游戏也暴露了当前 LLM 的短板。Opus 5 不能高效、原生地观看视频,也不能进入游戏试玩,只能在不同节点缓慢截图检查。过程中还多次出错,留下不少粗糙和故障内容。
它已经能造出一个世界,却还不能顺畅地检查和体验自己造出的世界。
Karpathy
OpenAI 联合创始人、现 Anthropic 预训练团队成员 Andrej Karpathy 把《指环王》开头一段交给 Opus 5,给出 100 万 Token、约 10 美元的预算,让它用 Three.js 做成一个 3D 世界。
模型运行约 2 小时,写出 5500 行代码。它需要安排各种多边形素材在三维坐标中的位置,再写代码让整个场景动起来。成品有些粗糙,但确实把文字变成了可以播放的 3D 场景。
这类内容过去很少有人愿意专门制作,成本和时间都不划算。LLM 却可以一直做下去,让高度定制的世界变成随手生成的内容。Karpathy 畅想,未来用户可以进入这种临时生成的世界,成为故事角色、旁观者或 NPC,像是一个按需出现的《GTA》。
游戏也暴露了当前 LLM 的短板。Opus 5 不能高效、原生地观看视频,也不能进入游戏试玩,只能在不同节点缓慢截图检查。过程中还多次出错,留下不少粗糙和故障内容。
它已经能造出一个世界,却还不能顺畅地检查和体验自己造出的世界。
Karpathy
❤2🤡1