Pokee发布1000万Token模型,上下文接近主流模型10倍
AI Agent 创业公司 Pokee AI 发布 Pokee-Isaac 28B。模型参数总量只有 280 亿,上下文窗口却达到 1000 万 Token。目前主流模型的上限约为 100 万 Token,Isaac 接近它们的 10 倍。
Pokee 自测中,Isaac 在 RULER 长文本测试里,从 25.6 万到 400 万 Token 一直保持在 95 分上下。拉满 1000 万 Token 后,得分仍有 93.3。其余五款对照模型从 200 万 Token 起都没有返回可用结果。
Pokee 把超长上下文归因于自研的「非纯 Decoder-only 架构」,即没有完全沿用常见大模型的纯解码器结构。不过,技术报告没有公开具体架构、注意力机制和显存方案,外界暂时无法判断它究竟怎么做到的。
Pokee AI 成立于 2024 年,由前 Meta 应用强化学习负责人朱哲清创办。公司曾获得 Point72 Ventures 领投的 1200 万美元种子轮,高通创投和 Samsung NEXT 等参投。
Pokee AI
AI Agent 创业公司 Pokee AI 发布 Pokee-Isaac 28B。模型参数总量只有 280 亿,上下文窗口却达到 1000 万 Token。目前主流模型的上限约为 100 万 Token,Isaac 接近它们的 10 倍。
Pokee 自测中,Isaac 在 RULER 长文本测试里,从 25.6 万到 400 万 Token 一直保持在 95 分上下。拉满 1000 万 Token 后,得分仍有 93.3。其余五款对照模型从 200 万 Token 起都没有返回可用结果。
Pokee 把超长上下文归因于自研的「非纯 Decoder-only 架构」,即没有完全沿用常见大模型的纯解码器结构。不过,技术报告没有公开具体架构、注意力机制和显存方案,外界暂时无法判断它究竟怎么做到的。
Pokee AI 成立于 2024 年,由前 Meta 应用强化学习负责人朱哲清创办。公司曾获得 Point72 Ventures 领投的 1200 万美元种子轮,高通创投和 Samsung NEXT 等参投。
Pokee AI
🔥1
千问查漏洞3轮召回率追平Opus 5,成本只有一半
安全公司 Aikido 用代码审计 Agent 测试了 7 款模型,包括 Qwen3.8-Max、Claude Opus 5、Kimi K3 Max、DeepSeek V4 Flash,以及 GPT-5.6 Sol、Luna 和 Terra。测试包含 32 个近期公开漏洞,每款模型运行 3 次。
Qwen3.8-Max 三轮合计找到 26 个漏洞,召回率达到 81.3%,与 Opus 5 并列第一。它的 F1 综合分(兼顾漏报和误报)为 83.2%,略低于 Opus 5、Kimi K3 Max 和 GPT-5.6 Sol。
千问的问题是单次发挥不稳定。26 个漏洞中,只有 10 个连续三轮都能找到,Opus 5 和 Sol 都有 19 个。不过,千问总成本约 821 美元,只有 Opus 5 和 Sol 的一半,但仍是 DeepSeek V4 Flash 的 5 倍。
pilvar
安全公司 Aikido 用代码审计 Agent 测试了 7 款模型,包括 Qwen3.8-Max、Claude Opus 5、Kimi K3 Max、DeepSeek V4 Flash,以及 GPT-5.6 Sol、Luna 和 Terra。测试包含 32 个近期公开漏洞,每款模型运行 3 次。
Qwen3.8-Max 三轮合计找到 26 个漏洞,召回率达到 81.3%,与 Opus 5 并列第一。它的 F1 综合分(兼顾漏报和误报)为 83.2%,略低于 Opus 5、Kimi K3 Max 和 GPT-5.6 Sol。
千问的问题是单次发挥不稳定。26 个漏洞中,只有 10 个连续三轮都能找到,Opus 5 和 Sol 都有 19 个。不过,千问总成本约 821 美元,只有 Opus 5 和 Sol 的一半,但仍是 DeepSeek V4 Flash 的 5 倍。
pilvar
🔥2
动察Beating AI News
Goodfire发布Silico:首个拆开AI黑箱、直接改行为的商用工具 AI 实验室 Goodfire 发布 Silico,一个将机械可解释性(mechanistic interpretability,通过映射模型内部神经元及其连接通路来理解模型行为的技术)包装成商用产品的平台。Goodfire 称 Silico 是首个覆盖数据集构建到模型训练全流程的同类工具。训练 AI 一直像炼金术,靠反复试错碰运气,Silico 想要把它变成精确工程。 Silico 支持查看单个神经元或神经元组,追踪上下游通路…
Goodfire让Agent替研究员跑AI实验,月费1000美元
AI 可解释性公司 Goodfire 开放研究工具 Silico。研究人员写下目标后,它会制定计划、同时运行多组实验、跟踪进度并整理结果。
Silico 能训练和优化模型、复现论文,也能排查数据和模型设计中的问题。研究人员仍需审核方案、调整方向,并判断最终结果。
Goodfire 用 Silico 分析了总参数达 2.8 万亿的 Kimi K3。它找到模型内部控制写作风格的特征,再调节这些特征,让 Kimi K3 改用「海盗口吻」回答。
Silico 目前通过 macOS 客户端使用。个人版每月 1000 美元,使用 Goodfire 的 GPU 需另付费,也能接入自己的服务器。
Goodfire
AI 可解释性公司 Goodfire 开放研究工具 Silico。研究人员写下目标后,它会制定计划、同时运行多组实验、跟踪进度并整理结果。
Silico 能训练和优化模型、复现论文,也能排查数据和模型设计中的问题。研究人员仍需审核方案、调整方向,并判断最终结果。
Goodfire 用 Silico 分析了总参数达 2.8 万亿的 Kimi K3。它找到模型内部控制写作风格的特征,再调节这些特征,让 Kimi K3 改用「海盗口吻」回答。
Silico 目前通过 macOS 客户端使用。个人版每月 1000 美元,使用 Goodfire 的 GPU 需另付费,也能接入自己的服务器。
Goodfire
X (formerly Twitter)
Goodfire (@GoodfireAI) on X
Silico, the platform for ambitious AI research, is publicly available today.
AI is advancing fast. The tools to understand it need to advance even faster. Silico lets you interpret and train your models at frontier scale.
Learn more + get access 🧵
AI is advancing fast. The tools to understand it need to advance even faster. Silico lets you interpret and train your models at frontier scale.
Learn more + get access 🧵
👏1
Mistral发布3B多模态审核模型,改一句Prompt就能换规则
欧洲 AI 独角兽 Mistral 推出内容审核模型 Shieldstral。模型只有 30 亿参数,可以检查文字、图片和图文内容,也能判断 AI 是否应该拒绝回答。
不少传统审核模型会预先设定色情、暴力、仇恨等类别。审核标准变化后,通常需要补充数据,再训练或微调模型。
Shieldstral 可以直接读取自然语言规则。开发者改一下审核要求,就能换一套标准,不必重新训练模型。
模型支持中文等 12 种语言,采用 Apache 2.0 许可。官方称,单张 16GB 显存的英伟达显卡即可运行,文本审核成绩与参数量大约 7 倍的 GPT-OSS-Safeguard-20B 持平。
Mistral
欧洲 AI 独角兽 Mistral 推出内容审核模型 Shieldstral。模型只有 30 亿参数,可以检查文字、图片和图文内容,也能判断 AI 是否应该拒绝回答。
不少传统审核模型会预先设定色情、暴力、仇恨等类别。审核标准变化后,通常需要补充数据,再训练或微调模型。
Shieldstral 可以直接读取自然语言规则。开发者改一下审核要求,就能换一套标准,不必重新训练模型。
模型支持中文等 12 种语言,采用 Apache 2.0 许可。官方称,单张 16GB 显存的英伟达显卡即可运行,文本审核成绩与参数量大约 7 倍的 GPT-OSS-Safeguard-20B 持平。
Mistral
🥰1
动察Beating AI News
前OpenAI首席科学家Ilya秘密研究被扒:要让AI像人一样边干边学 SSI 至今没有发布模型,一名海外博主却从公开线索中拼出了它可能的研究方向:让 AI 在部署后继续学习,而不是训练结束就停止进步。 线索主要来自 Ilya Sutskever 本人。他多次称,现有模型最大的缺陷是泛化能力远弱于人类。他理想中的 AI 像一个「超级智能的 15 岁少年」,能进入任何行业,再通过少量经验快速学会工作。 《华尔街日报》还称,SSI 正在研究「人脑运作中被忽视的部分」。英伟达看过其保密研究后决定投资,并帮助…
前OpenAI首席科学家Ilya终于要出牌,SSI首个模型或在8月亮相
前 OpenAI 首席科学家 Ilya Sutskever 创办的 AI 实验室 Safe Superintelligence(SSI),可能在 8 月发布模型。
Atreides Management 管理合伙人兼 CIO Gavin Baker 在播客《Invest Like The Best》中透露:「SSI 说他们会在 8 月推出模型。」
SSI 成立两年来一直秘密研发,没有发布模型或披露技术细节。7 月底,它刚与英伟达达成长期合作,算力计划扩大约 10 倍。英伟达还向 SSI 投资了 50 亿美元。Ilya 当时表示,团队已经有「值得扩大规模」的研究成果。
Invest Like The Best
前 OpenAI 首席科学家 Ilya Sutskever 创办的 AI 实验室 Safe Superintelligence(SSI),可能在 8 月发布模型。
Atreides Management 管理合伙人兼 CIO Gavin Baker 在播客《Invest Like The Best》中透露:「SSI 说他们会在 8 月推出模型。」
SSI 成立两年来一直秘密研发,没有发布模型或披露技术细节。7 月底,它刚与英伟达达成长期合作,算力计划扩大约 10 倍。英伟达还向 SSI 投资了 50 亿美元。Ilya 当时表示,团队已经有「值得扩大规模」的研究成果。
Invest Like The Best
YouTube
The AI Selloff Doesn't Match the Data | Top AI Investor Explains
In this episode of Invest Like the Best, Patrick O'Shaughnessy sits down with Gavin Baker to dissect the intense AI and semiconductor market sell-off of July 2026. Describing the period as "2022 packed into a single month," Gavin explains why public market…
👍1
动察Beating AI News
Sand.ai获超亿美元融资:坚持自回归视频路线,计划7月发布开源MoE大模型 视频生成大模型公司 Sand.ai(成立于 2024 年 1 月)宣布完成两轮合计超亿美元的融资。投资方包括 Look Capital、Lollapalooza Capital(王慧文家办)、九坤创投、经纬创投、和玉资本(MSA Capital)、创新工场、源码资本、IDG、百度风投等多家一线机构。本轮融资由星涵资本担任财务顾问。 Sand.ai 创始人曹越在接受采访时表示,团队一直坚持被视作非共识的自回归(Autoreg…
Sand.ai开源全球首个千亿级视频MoE模型MAGI-2 Preview
Sand.ai 发布并开源 MAGI-2 Preview,这是全球首个千亿级开源 MoE 视频生成模型。模型总参数约 114B,但每次只激活约 6B。
模型支持文生视频和图生视频,可以同时生成画面、对白、音乐和环境声。目前单次固定生成 10 秒内容,再将画面提升到 1080p。
不过,参数更大不代表效果更强。MiniMax H3 的生成主干是 33B 稠密模型,在 Artificial Analysis 有声图生视频榜单中排名第三,高于 MAGI-2 的第六。MAGI-2 的主要亮点,是把视频模型扩到千亿参数,同时把单次激活压到约 6B。
模型采用 Apache 2.0 许可,完整权重约 307GB,本地运行需要 8 张英伟达 Hopper GPU。
Sand.ai
Sand.ai 发布并开源 MAGI-2 Preview,这是全球首个千亿级开源 MoE 视频生成模型。模型总参数约 114B,但每次只激活约 6B。
模型支持文生视频和图生视频,可以同时生成画面、对白、音乐和环境声。目前单次固定生成 10 秒内容,再将画面提升到 1080p。
不过,参数更大不代表效果更强。MiniMax H3 的生成主干是 33B 稠密模型,在 Artificial Analysis 有声图生视频榜单中排名第三,高于 MAGI-2 的第六。MAGI-2 的主要亮点,是把视频模型扩到千亿参数,同时把单次激活压到约 6B。
模型采用 Apache 2.0 许可,完整权重约 307GB,本地运行需要 8 张英伟达 Hopper GPU。
Sand.ai
👏1
Mechanize刚估值5亿美元,谷歌拟花超15亿美元挖团队
谷歌正与 AI 创业公司 Mechanize 谈判,交易规模超过 15 亿美元。谷歌计划招募部分员工,同时获得其技术的非独家授权。相关人员将参与模型评测和研发。
Mechanize 不直接提供编程助手式产品。它为 AI 编程 Agent 搭建训练和评测环境,让模型开发功能、部署应用或排查代码问题,再根据完成情况打分。这些数据可以继续用于强化学习,提升模型的编程能力。
Mechanize 于 2025 年成立。今年 4 月,它刚以 5 亿美元投后估值融资 910 万美元。谷歌拟议交易的金额,已经达到这笔估值的 3 倍以上。
谷歌此前也用过同一套方式。去年,它花费约 24 亿美元获得 Windsurf 技术授权,并招募其 CEO 和部分研发人员。公司留在原地,核心人才和技术先进入谷歌。
Business Insider
谷歌正与 AI 创业公司 Mechanize 谈判,交易规模超过 15 亿美元。谷歌计划招募部分员工,同时获得其技术的非独家授权。相关人员将参与模型评测和研发。
Mechanize 不直接提供编程助手式产品。它为 AI 编程 Agent 搭建训练和评测环境,让模型开发功能、部署应用或排查代码问题,再根据完成情况打分。这些数据可以继续用于强化学习,提升模型的编程能力。
Mechanize 于 2025 年成立。今年 4 月,它刚以 5 亿美元投后估值融资 910 万美元。谷歌拟议交易的金额,已经达到这笔估值的 3 倍以上。
谷歌此前也用过同一套方式。去年,它花费约 24 亿美元获得 Windsurf 技术授权,并招募其 CEO 和部分研发人员。公司留在原地,核心人才和技术先进入谷歌。
Business Insider
Business Insider
Google is in talks for a $1.5 billion-plus deal with AI coding agent startup Mechanize
Google wants its AI to get better at coding. It might have found a shortcut with the startup Mechanize.
👏1
DeepMind CEO哈萨比斯转任Alphabet首席科学家,Jeff Dean离职创业
谷歌宣布调整 AI 管理层。Google DeepMind CEO Demis Hassabis 将卸任 CEO,转任 Google DeepMind 董事长,并出任谷歌母公司 Alphabet 首席科学家,负责集团 AI 长期研究方向,同时继续领导 AI 制药公司 Isomorphic Labs。
Google DeepMind CTO Koray Kavukcuoglu 将接管团队日常运营。目前谷歌尚未任命新的 CEO。
与此同时,原 Alphabet 首席科学家 Jeff Dean 将与 Oriol Vinyals、Quoc Le 等人离职创业,成立 AI 科研公司 Discovery Loop,Alphabet 计划投资这家公司并提供谷歌云资源。
Axios
谷歌宣布调整 AI 管理层。Google DeepMind CEO Demis Hassabis 将卸任 CEO,转任 Google DeepMind 董事长,并出任谷歌母公司 Alphabet 首席科学家,负责集团 AI 长期研究方向,同时继续领导 AI 制药公司 Isomorphic Labs。
Google DeepMind CTO Koray Kavukcuoglu 将接管团队日常运营。目前谷歌尚未任命新的 CEO。
与此同时,原 Alphabet 首席科学家 Jeff Dean 将与 Oriol Vinyals、Quoc Le 等人离职创业,成立 AI 科研公司 Discovery Loop,Alphabet 计划投资这家公司并提供谷歌云资源。
Axios
Axios
Google DeepMind CEO Demis Hassabis is stepping aside
oogle's AI organization is undergoing a profound change as the company struggles to keep pace with OpenAI and Anthropic.
🤡5❤1
Meta更新编程模型Muse Spark 1.2,配套终端Agent Muse Code同步上线
Meta 发布编程模型 Muse Spark 1.2,并同步开放终端编程 Agent Muse Code 测试版。Meta 将模型和 Agent 一起训练,让两者更适配彼此的工作流程。
Muse Code 能在大型代码库中规划修改、编写代码并验证结果。任务较大时,它会拆出多个子任务,交给不同 Agent 在隔离工作区并行处理,不会直接改动用户当前的工作区。
每次模型调用、工具执行和文件修改,都会先写入本地事件日志。Muse Code 即使中途崩溃,也能接着上次进度继续,不必重新输入 Prompt。
Meta 还让 Muse Spark 1.2 连续 24 小时优化英伟达 Hopper 的 GPU Kernel。期间完成超过 1000 次工具调用,后半程仍在找到性能提升。
Meta
Meta 发布编程模型 Muse Spark 1.2,并同步开放终端编程 Agent Muse Code 测试版。Meta 将模型和 Agent 一起训练,让两者更适配彼此的工作流程。
Muse Code 能在大型代码库中规划修改、编写代码并验证结果。任务较大时,它会拆出多个子任务,交给不同 Agent 在隔离工作区并行处理,不会直接改动用户当前的工作区。
每次模型调用、工具执行和文件修改,都会先写入本地事件日志。Muse Code 即使中途崩溃,也能接着上次进度继续,不必重新输入 Prompt。
Meta 还让 Muse Spark 1.2 连续 24 小时优化英伟达 Hopper 的 GPU Kernel。期间完成超过 1000 次工具调用,后半程仍在找到性能提升。
Meta
动察Beating AI News
DeepSeek V4正式版定档7月中旬上线,引入峰谷双倍定价 DeepSeek 官方宣布 DeepSeek V4 正式版计划于 7 月中旬上线,并同步引入峰谷定价机制。在北京时间每日 9:00 至 12:00 以及 14:00 至 18:00 的高峰时段,API 计费价格将调整为平日的 2 倍。 在新定价机制下,高性能模型 deepseek-v4-pro 的平日每百万 tokens 输入缓存命中价格为 0.025 元,缓存未命中为 3.00 元,输出为 6.00 元。高峰时段,三项价格将分别上调至 0.05…
DeepSeek预告API即将涨价,峰时翻倍方案尚未落地
DeepSeek 在开放平台提示,计划近期整体上调 API 服务定价,预计涨幅较大,具体方案和生效时间将另行通知。
此前流传的通知显示,DeepSeek 曾计划引入峰谷定价。每天北京时间 9:00 至 12:00、14:00 至 18:00,API 价格可能涨至平时的 2 倍。
不过,截至目前,DeepSeek 官方价格页仍按统一价格计费,没有列出峰时价格。
DeepSeek 在开放平台提示,计划近期整体上调 API 服务定价,预计涨幅较大,具体方案和生效时间将另行通知。
此前流传的通知显示,DeepSeek 曾计划引入峰谷定价。每天北京时间 9:00 至 12:00、14:00 至 18:00,API 价格可能涨至平时的 2 倍。
不过,截至目前,DeepSeek 官方价格页仍按统一价格计费,没有列出峰时价格。
😱7😭1
红杉换帅后募得100亿美元,25亿美元重押Anthropic
红杉资本开始全面补仓 AI。Alfred Lin 和 Pat Grady 去年 11 月接掌公司后,红杉已宣布约 20 笔 AI 相关投资。过去嫌贵的高估值项目,现在也开始追。
今年 5 月,红杉向 Anthropic 追加投资 25 亿美元。这笔钱是红杉成立 54 年以来最大的一笔投资。内部最初讨论投 10 亿美元,最后决定把金额提高到 25 亿美元。
同期,红杉还为旗下增长和扩张基金募得 100 亿美元。这是新领导层上任后完成的首轮募资。
红杉近期也领投了 AI 芯片公司 Etched 的 3 亿美元融资,投后估值达到 103 亿美元。为了拿下这笔交易,红杉一次带上 10 多名合伙人见创始团队。
上一任负责人 Roelof Botha 对 AI 高估值更谨慎。红杉因此错过了以更低价格投资 Anthropic,也多次放弃继续加码 OpenAI。
这轮转向带着明显的补课意味。红杉宁愿接受更高估值,也不想再次错过头部 AI 公司。
彭博社
红杉资本开始全面补仓 AI。Alfred Lin 和 Pat Grady 去年 11 月接掌公司后,红杉已宣布约 20 笔 AI 相关投资。过去嫌贵的高估值项目,现在也开始追。
今年 5 月,红杉向 Anthropic 追加投资 25 亿美元。这笔钱是红杉成立 54 年以来最大的一笔投资。内部最初讨论投 10 亿美元,最后决定把金额提高到 25 亿美元。
同期,红杉还为旗下增长和扩张基金募得 100 亿美元。这是新领导层上任后完成的首轮募资。
红杉近期也领投了 AI 芯片公司 Etched 的 3 亿美元融资,投后估值达到 103 亿美元。为了拿下这笔交易,红杉一次带上 10 多名合伙人见创始团队。
上一任负责人 Roelof Botha 对 AI 高估值更谨慎。红杉因此错过了以更低价格投资 Anthropic,也多次放弃继续加码 OpenAI。
这轮转向带着明显的补课意味。红杉宁愿接受更高估值,也不想再次错过头部 AI 公司。
彭博社
Bloomberg.com
Armed With $10 Billion, Sequoia’s Leaders Plan Its New Era
Alfred Lin and Pat Grady are repositioning the 54-year-old firm for a world dominated by artificial intelligence.
❤2
张一鸣:宁愿大模型暂时落后,也不走蒸馏捷径
字节跳动创始人张一鸣上月在 Seed 团队全员会上明确表示,公司不会把蒸馏当作追赶大模型的捷径,即使因此暂时落后于国内对手。他要求团队愿意牺牲短期收益,换取长期目标。
蒸馏是让新模型学习更强模型的输出,可以节省训练时间和算力。字节内部认为,不走这条路,会让 Seed 的语言模型短期内更难追上 DeepSeek、Kimi 和千问等国内同行。
但字节更担心的是政治风险。公司此前长期因 TikTok 遭到美国政府审查。虽然 TikTok 美国数据安全业务已经引入美国资本,字节仍保留股份,并继续经营 TikTok 的全球商业业务。一旦被指控大规模提取美国前沿模型的能力,华盛顿可能重新向 TikTok 施压。
Anthropic 此前曾指控 DeepSeek、月之暗面、MiniMax、智谱和阿里巴巴大规模提取 Claude 的能力,但没有点名字节。
The Information
字节跳动创始人张一鸣上月在 Seed 团队全员会上明确表示,公司不会把蒸馏当作追赶大模型的捷径,即使因此暂时落后于国内对手。他要求团队愿意牺牲短期收益,换取长期目标。
蒸馏是让新模型学习更强模型的输出,可以节省训练时间和算力。字节内部认为,不走这条路,会让 Seed 的语言模型短期内更难追上 DeepSeek、Kimi 和千问等国内同行。
但字节更担心的是政治风险。公司此前长期因 TikTok 遭到美国政府审查。虽然 TikTok 美国数据安全业务已经引入美国资本,字节仍保留股份,并继续经营 TikTok 的全球商业业务。一旦被指控大规模提取美国前沿模型的能力,华盛顿可能重新向 TikTok 施压。
Anthropic 此前曾指控 DeepSeek、月之暗面、MiniMax、智谱和阿里巴巴大规模提取 Claude 的能力,但没有点名字节。
The Information
The Information
ByteDance’s Founder Rules Out Distillation on AI Models
ByteDance won’t resort to distillation as a shortcut to advancing its AI model capabilities, even if that means the company lags behind domestic rivals for now, founder Zhang Yiming told employees during a meeting last month. One reason, say people close…
😁7🤡3
农民大爷问AI怎么除草,AI给出毒药配料致庄稼全死
安徽滁州 67 岁农户吴大伯,向某国民 AI 聊天助手询问芝麻田怎么除草、除虫。AI 很快生成一套农药配方。他照着喷下去,第二天 150 亩芝麻和杂草一起枯萎,十几万元收成几乎绝收。
问题出在配方里的「氟磺胺草醚」。这种除草剂主要用于大豆田,芝麻苗对它更敏感。当地农技人员称,这种药不能在芝麻田全田喷洒。喷下去,等于把庄稼和杂草一起清场。
吴大伯事后追问原因,AI 才回复称,氟磺胺草醚可能是芝麻苗死亡的主要原因。它先一本正经地开出错误配方,等 150 亩田毁了,再负责复盘自己错在哪。
涉事平台客服称会核查错误信息来源,但尚未公布赔偿方案。
AI 的回答可以随时改口,农药喷进地里却没有「撤回」按钮。
合新闻
安徽滁州 67 岁农户吴大伯,向某国民 AI 聊天助手询问芝麻田怎么除草、除虫。AI 很快生成一套农药配方。他照着喷下去,第二天 150 亩芝麻和杂草一起枯萎,十几万元收成几乎绝收。
问题出在配方里的「氟磺胺草醚」。这种除草剂主要用于大豆田,芝麻苗对它更敏感。当地农技人员称,这种药不能在芝麻田全田喷洒。喷下去,等于把庄稼和杂草一起清场。
吴大伯事后追问原因,AI 才回复称,氟磺胺草醚可能是芝麻苗死亡的主要原因。它先一本正经地开出错误配方,等 150 亩田毁了,再负责复盘自己错在哪。
涉事平台客服称会核查错误信息来源,但尚未公布赔偿方案。
AI 的回答可以随时改口,农药喷进地里却没有「撤回」按钮。
合新闻
🤡10😁2🤬1🕊1
「Meta AI模型黑进一家公司」刷屏,一查又是公网没关
Meta 编程模型 Muse Spark 1.1 在安全测试中进入一家真实公司的系统,还修改了内部环境。「AI 又黑进一家公司」的标题随即刷屏,难道 Meta 一夜之间造出了顶级黑客模型?
仔细一看,又是门没关。第三方评测机构 Irregular 配错了测试环境,把原本封闭的网络靶场接上公网。模型只是顺着现成通道出去,再利用第三方服务的基础漏洞进入系统。Irregular 也承认,这不属于沙箱逃逸,攻击手段也并不复杂。
同类错误此前还坑过 OpenAI 和 Anthropic。OpenAI 模型把真实网站误认成虚构目标,Anthropic 模型则靠弱密码和未认证接口进入 3 家机构。几次事故的共同点都不是模型成功越狱,而是测试方先把公网入口留了出来。
拿 Meta 这次来吹尤其尴尬。模型连门都没撬,只是看见门开着便走了出去。完全证明不了它能突破隔离,更配不上「自主黑进公司」这种标题。
现在的流量密码已经很固定:公网没关叫黑进公司,猜中弱密码叫黑进公司,发现零日漏洞也叫黑进公司。能力差了几个级别,标题却一模一样。模型还没学会越狱,媒体先学会了吹牛。
The Information:A Meta AI Model Hacked Another Company During Cybersecurity Testing
Meta 编程模型 Muse Spark 1.1 在安全测试中进入一家真实公司的系统,还修改了内部环境。「AI 又黑进一家公司」的标题随即刷屏,难道 Meta 一夜之间造出了顶级黑客模型?
仔细一看,又是门没关。第三方评测机构 Irregular 配错了测试环境,把原本封闭的网络靶场接上公网。模型只是顺着现成通道出去,再利用第三方服务的基础漏洞进入系统。Irregular 也承认,这不属于沙箱逃逸,攻击手段也并不复杂。
同类错误此前还坑过 OpenAI 和 Anthropic。OpenAI 模型把真实网站误认成虚构目标,Anthropic 模型则靠弱密码和未认证接口进入 3 家机构。几次事故的共同点都不是模型成功越狱,而是测试方先把公网入口留了出来。
拿 Meta 这次来吹尤其尴尬。模型连门都没撬,只是看见门开着便走了出去。完全证明不了它能突破隔离,更配不上「自主黑进公司」这种标题。
现在的流量密码已经很固定:公网没关叫黑进公司,猜中弱密码叫黑进公司,发现零日漏洞也叫黑进公司。能力差了几个级别,标题却一模一样。模型还没学会越狱,媒体先学会了吹牛。
The Information:A Meta AI Model Hacked Another Company During Cybersecurity Testing
The Information
A Meta AI Model Hacked Another Company During Cybersecurity Testing
A Meta Platforms artificial intelligence model accessed the internet during cybersecurity testing and hacked into another company, according to people familiar with the matter, in the latest in a string of such incidents at major AI firms. Meta’s Muse Spark…
动察Beating AI News
DeepMind CEO哈萨比斯转任Alphabet首席科学家,Jeff Dean离职创业 谷歌宣布调整 AI 管理层。Google DeepMind CEO Demis Hassabis 将卸任 CEO,转任 Google DeepMind 董事长,并出任谷歌母公司 Alphabet 首席科学家,负责集团 AI 长期研究方向,同时继续领导 AI 制药公司 Isomorphic Labs。 Google DeepMind CTO Koray Kavukcuoglu 将接管团队日常运营。目前谷歌尚未任命新的…
谷歌四名老将组团创业,要让AI自己跑科研实验
原 Alphabet 首席科学家 Jeff Dean 离开任职近 27 年的谷歌,与 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 创办 Discovery Loop。四人的履历覆盖谷歌底层系统、Google Brain、Gemini 和 AlphaFold 等核心项目。
Discovery Loop 准备先从机器学习研究入手。研究人员提出问题后,AI 会写代码、运行实验、分析结果,再据此安排下一轮尝试。过去需要研究员反复手动推进的工作,可以同时展开数千组实验,人类主要负责确定目标和判断结果。
团队会先拿自己做试验,用这套系统改进模型和技术架构。如果方法有效,再扩展到芯片设计、生物研究、新药和新材料等领域。公司目前还没有确定办公室,正在招聘创始团队,产品仍处于早期阶段。
Discovery Loop 成立时已经获得种子投资。Alphabet 是创始投资方,也会通过谷歌云提供首年算力。Radical Ventures 和 Khosla Ventures 联合领投,Kleiner Perkins、Lightspeed 等机构参投。融资金额和估值尚未披露,种子轮仍在募资。
Jeff Dean
原 Alphabet 首席科学家 Jeff Dean 离开任职近 27 年的谷歌,与 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 创办 Discovery Loop。四人的履历覆盖谷歌底层系统、Google Brain、Gemini 和 AlphaFold 等核心项目。
Discovery Loop 准备先从机器学习研究入手。研究人员提出问题后,AI 会写代码、运行实验、分析结果,再据此安排下一轮尝试。过去需要研究员反复手动推进的工作,可以同时展开数千组实验,人类主要负责确定目标和判断结果。
团队会先拿自己做试验,用这套系统改进模型和技术架构。如果方法有效,再扩展到芯片设计、生物研究、新药和新材料等领域。公司目前还没有确定办公室,正在招聘创始团队,产品仍处于早期阶段。
Discovery Loop 成立时已经获得种子投资。Alphabet 是创始投资方,也会通过谷歌云提供首年算力。Radical Ventures 和 Khosla Ventures 联合领投,Kleiner Perkins、Lightspeed 等机构参投。融资金额和估值尚未披露,种子轮仍在募资。
Jeff Dean
❤2🌚2
动察Beating AI News
AI数据中心开始和美国农民抢地、抢水、抢电 美国多地农民和牧场主开始反对 AI 数据中心建设。他们担心项目占用耕地,还会争夺当地的水和电。 美国目前约有 5000 座已建成或在建的数据中心。大型项目通常需要大片平坦土地,并靠近水源和电网,这些条件与农业高度重合。 部分数据中心的耗电量相当于一座中型城市。农民担心,用电需求激增会推高电费。干旱地区的牧场主还担心,供水紧张时,农业会先被要求削减用水。 约有 20 个州正在考虑限制数据中心建设。科技行业则称,许多项目大部分时间使用风冷,耗水远低于农业;数…
美国数据中心耗水或翻4倍,多地开始收紧建厂审批
堪萨斯健康研究所发布报告,梳理 AI 和数据中心扩张带来的水、电与公共健康压力。报告引用美国能源部实验室的测算称,美国数据中心 2023 年直接耗水约 170 亿加仑,到 2028 年可能增至两到四倍。大型数据中心每天最多可用掉 500 万加仑水,主要用于冷却。
缺水地区承受的压力更大。2021 年,美国已有五分之一的数据中心位于水资源紧张地区。部分机房超过一半的用水来自市政饮用水,发电环节的间接耗水还没有算进常用的机房用水指标。
地方政府已经开始设限。亚利桑那州图森市去年否决了一座与亚马逊有关的数据中心,因为它可能成为全市最大的用水户。堪萨斯城今年则要求新项目接受市议会审批,并评估对水资源和居民电费的影响。
堪萨斯健康研究所
堪萨斯健康研究所发布报告,梳理 AI 和数据中心扩张带来的水、电与公共健康压力。报告引用美国能源部实验室的测算称,美国数据中心 2023 年直接耗水约 170 亿加仑,到 2028 年可能增至两到四倍。大型数据中心每天最多可用掉 500 万加仑水,主要用于冷却。
缺水地区承受的压力更大。2021 年,美国已有五分之一的数据中心位于水资源紧张地区。部分机房超过一半的用水来自市政饮用水,发电环节的间接耗水还没有算进常用的机房用水指标。
地方政府已经开始设限。亚利桑那州图森市去年否决了一座与亚马逊有关的数据中心,因为它可能成为全市最大的用水户。堪萨斯城今年则要求新项目接受市议会审批,并评估对水资源和居民电费的影响。
堪萨斯健康研究所
Kansas Health Institute
The Environmental Footprint of Emerging Technology and Artificial Intelligence - Kansas Health Institute
Large data centers for artificial intelligence (AI) are increasing demand for water, energy and infrastructure. Learn how public health can help balance innovation, sustainability and community health.
Meta新模型几乎白送,比DeepSeek还便宜29%
Meta 为 Muse Spark 1.2 和 Muse Code 设置了 Contributor 低价档。用户允许 Meta 使用 Prompt 和模型输出训练后续模型,即可获得大幅折扣。
这一档每百万 Token 的输入、缓存命中和输出价格,分别为 0.10、0.002 和 0.20 美元。DeepSeek V4 Flash 分别为 0.14、0.0028 和 0.28 美元,Muse 三项价格均便宜约 29%。
不愿共享数据,就要使用标准档。输入、缓存命中和输出价格将升至 1.25、0.15 和 4.25 美元,分别是低价档的 12.5 倍、75 倍和21.25 倍。
Contributor 档的调用上限也更低,每分钟最多 60 次请求、210 万 Token。标准档则支持每分钟 3000 次请求、400 万 Token。
DeepSeek 刚预告 API 即将大幅涨价,具体价格还没公布。Meta 已经把 Muse 压到了比它当前价格低 29%,扎克伯格开始接过价格屠夫的位置。
Meta
Meta 为 Muse Spark 1.2 和 Muse Code 设置了 Contributor 低价档。用户允许 Meta 使用 Prompt 和模型输出训练后续模型,即可获得大幅折扣。
这一档每百万 Token 的输入、缓存命中和输出价格,分别为 0.10、0.002 和 0.20 美元。DeepSeek V4 Flash 分别为 0.14、0.0028 和 0.28 美元,Muse 三项价格均便宜约 29%。
不愿共享数据,就要使用标准档。输入、缓存命中和输出价格将升至 1.25、0.15 和 4.25 美元,分别是低价档的 12.5 倍、75 倍和21.25 倍。
Contributor 档的调用上限也更低,每分钟最多 60 次请求、210 万 Token。标准档则支持每分钟 3000 次请求、400 万 Token。
DeepSeek 刚预告 API 即将大幅涨价,具体价格还没公布。Meta 已经把 Muse 压到了比它当前价格低 29%,扎克伯格开始接过价格屠夫的位置。
Meta
🤡10👍4😁1
Cloudflare把自用AI工作台开源,员工聊天就能做内部应用
Cloudflare 开源了企业 AI 工作平台 Cloudflare OS。员工可以让 Agent 结合公司知识和内部系统,查资料、写文档、做数据看板,或直接生成内部小应用。
这些应用可以读取和更新内部数据、保存运行状态,并与同事协作使用。重复工作还能固化成自动流程,需要计算时运行代码,需要判断时再调用模型。
Cloudflare 还设计了专门的权限系统。它不仅限制 Agent 能使用哪些工具,还会记录它接触过哪些数据。应用分享给同事时,系统会重新检查对方权限,避免内部信息被间接泄露。
项目采用 Apache 2.0 许可,可以本地试用,也能部署到 Cloudflare。线上运行至少需要每月 5 美元的 Workers 付费方案,模型调用和额外资源另行计费。
Cloudflare
Cloudflare 开源了企业 AI 工作平台 Cloudflare OS。员工可以让 Agent 结合公司知识和内部系统,查资料、写文档、做数据看板,或直接生成内部小应用。
这些应用可以读取和更新内部数据、保存运行状态,并与同事协作使用。重复工作还能固化成自动流程,需要计算时运行代码,需要判断时再调用模型。
Cloudflare 还设计了专门的权限系统。它不仅限制 Agent 能使用哪些工具,还会记录它接触过哪些数据。应用分享给同事时,系统会重新检查对方权限,避免内部信息被间接泄露。
项目采用 Apache 2.0 许可,可以本地试用,也能部署到 Cloudflare。线上运行至少需要每月 5 美元的 Workers 付费方案,模型调用和额外资源另行计费。
Cloudflare
The Cloudflare Blog
Cloudflare OS: an open platform for agents, apps, and work
Cloudflare OS is an open-source platform that lets everyone in your company build apps, automate work, and safely access internal systems, shaped around what your organization knows and how it operates.
前OpenAI研究员离职做非侵入式脑机接口,让AI不用开颅也能读心
OpenAI 前对齐研究员 Naomi Bashkansky 离职后,加入脑机接口公司 Conduit,担任创始研究员。公司正在开发一种非侵入式「读心 AI」,希望通过头戴设备读取脑信号,再把想法转成文字。
Conduit 已收集约 1 万小时脑信号和语言数据。参与者戴着设备与 AI 对话或打字,模型从中学习脑信号和语言的对应关系。
目前它还不能逐字读心,只能猜出大致意思。比如用户想的是「房间好像更冷了」,模型可能识别成「有一阵微风」。
Bashkansky 将这项技术比作 GPT-2 阶段,认为未来几年,人类可能直接用想法控制 AI。
Naomi Bashkansky
OpenAI 前对齐研究员 Naomi Bashkansky 离职后,加入脑机接口公司 Conduit,担任创始研究员。公司正在开发一种非侵入式「读心 AI」,希望通过头戴设备读取脑信号,再把想法转成文字。
Conduit 已收集约 1 万小时脑信号和语言数据。参与者戴着设备与 AI 对话或打字,模型从中学习脑信号和语言的对应关系。
目前它还不能逐字读心,只能猜出大致意思。比如用户想的是「房间好像更冷了」,模型可能识别成「有一阵微风」。
Bashkansky 将这项技术比作 GPT-2 阶段,认为未来几年,人类可能直接用想法控制 AI。
Naomi Bashkansky
❤3
动察Beating AI News
DeepMind CEO哈萨比斯转任Alphabet首席科学家,Jeff Dean离职创业 谷歌宣布调整 AI 管理层。Google DeepMind CEO Demis Hassabis 将卸任 CEO,转任 Google DeepMind 董事长,并出任谷歌母公司 Alphabet 首席科学家,负责集团 AI 长期研究方向,同时继续领导 AI 制药公司 Isomorphic Labs。 Google DeepMind CTO Koray Kavukcuoglu 将接管团队日常运营。目前谷歌尚未任命新的…
谷歌把AI权力中心收回加州,Koray接管Gemini
谷歌正把 AI 领导层集中到加州山景城。Google DeepMind CTO Koray Kavukcuoglu 将统一负责谷歌 AI 研究和运营。
Demis Hassabis 不再管理日常业务,转任 DeepMind 董事长和 Alphabet 首席科学家,继续留在伦敦负责长期战略。
2023 年 Google Brain 与 DeepMind 合并后,核心团队仍分居山景城和伦敦。跨洲管理拖慢决策,也让两地研究人员不满。过去一年,Gemini 编程项目负责人 Sebastian Borgeaud 等关键成员已从英国搬到加州。
谷歌急着收权,是因为 Gemini 最强版本已延期数月,AI 编程产品也落后于 Anthropic 和 OpenAI。Jeff Dean 等核心研究人员相继离职,进一步加大了内部压力。
彭博社
谷歌正把 AI 领导层集中到加州山景城。Google DeepMind CTO Koray Kavukcuoglu 将统一负责谷歌 AI 研究和运营。
Demis Hassabis 不再管理日常业务,转任 DeepMind 董事长和 Alphabet 首席科学家,继续留在伦敦负责长期战略。
2023 年 Google Brain 与 DeepMind 合并后,核心团队仍分居山景城和伦敦。跨洲管理拖慢决策,也让两地研究人员不满。过去一年,Gemini 编程项目负责人 Sebastian Borgeaud 等关键成员已从英国搬到加州。
谷歌急着收权,是因为 Gemini 最强版本已延期数月,AI 编程产品也落后于 Anthropic 和 OpenAI。Jeff Dean 等核心研究人员相继离职,进一步加大了内部压力。
彭博社
Bloomberg.com
Google Shifts AI Leadership to California in Race Against Anthropic, OpenAI
Alphabet Inc.'s Google is concentrating its artificial intelligence leadership at its Mountain View, California, headquarters to gain momentum in the accelerating race against Anthropic and OpenAI to build the world’s dominant AI models.
😁1