MIT 研究:依赖 AI 验证新闻会降低自身辨别能力
一项来自 MIT 媒体实验室的最新开放获取研究显示,依赖人工智能系统验证事实的用户,在失去 AI 辅助后,自身识别虚假信息的能力反而下降。研究追踪了 67 名参与者,在四周内评估新闻标题与图片组合的真实性。结果显示,有 AI 聊天机器人辅助时,参与者识别假新闻的准确率提高了 21%,但到第四周,当 AI 不再介入时,参与者对新新闻项目的独立判断准确率比研究开始前下降了 15 个百分点。约四分之一的参与者甚至误以为自己能力提升。这种现象被称为“AI 依赖悖论”,类似于医生使用 AI 后自身癌症检测能力下降,或 GPS 削弱人类方向感。研究团队指出,约五分之一的参与者逐渐从主动判断转向被动接受 AI 建议,形成依赖行为模式。 #AI #新闻 #虚假信息 #MIT #认知能力 #科技 #研究
一项来自 MIT 媒体实验室的最新开放获取研究显示,依赖人工智能系统验证事实的用户,在失去 AI 辅助后,自身识别虚假信息的能力反而下降。研究追踪了 67 名参与者,在四周内评估新闻标题与图片组合的真实性。结果显示,有 AI 聊天机器人辅助时,参与者识别假新闻的准确率提高了 21%,但到第四周,当 AI 不再介入时,参与者对新新闻项目的独立判断准确率比研究开始前下降了 15 个百分点。约四分之一的参与者甚至误以为自己能力提升。这种现象被称为“AI 依赖悖论”,类似于医生使用 AI 后自身癌症检测能力下降,或 GPS 削弱人类方向感。研究团队指出,约五分之一的参与者逐渐从主动判断转向被动接受 AI 建议,形成依赖行为模式。 #AI #新闻 #虚假信息 #MIT #认知能力 #科技 #研究
开源搜索智能体Harness-1发布,召回率超越GPT
伊利诺伊大学厄巴纳-香槟分校、加州大学伯克利分校与开源AI向量数据库平台Chroma联合发布了一款名为Harness-1的开源搜索智能体。该模型基于OpenAI的gpt-oss-20B开源模型构建,参数量为200亿,通过重新设计AI执行复杂检索任务的方式,实现了性能的巨大飞跃。在从精选数据集中正确召回相关信息的能力上,Harness-1平均得分73%,超越了GPT-5.4(70.9%),并比此前最准确的开源搜索智能体Tongyi DeepResearch 30B高出11.4个百分点。该模型及其环境已根据高度宽松的Apache 2.0许可证在Hugging Face上开放模型代码和权重。Harness-1通过将搜索会话的详尽“记账”工作从模型工作内存中卸载到结构化软件环境中,从而实现了性能提升,有效解决了传统模型在处理复杂企业级搜索任务时容易出现的“搜索失忆”问题。 #开源 #AI #搜索智能体 #大模型 #科技新闻
伊利诺伊大学厄巴纳-香槟分校、加州大学伯克利分校与开源AI向量数据库平台Chroma联合发布了一款名为Harness-1的开源搜索智能体。该模型基于OpenAI的gpt-oss-20B开源模型构建,参数量为200亿,通过重新设计AI执行复杂检索任务的方式,实现了性能的巨大飞跃。在从精选数据集中正确召回相关信息的能力上,Harness-1平均得分73%,超越了GPT-5.4(70.9%),并比此前最准确的开源搜索智能体Tongyi DeepResearch 30B高出11.4个百分点。该模型及其环境已根据高度宽松的Apache 2.0许可证在Hugging Face上开放模型代码和权重。Harness-1通过将搜索会话的详尽“记账”工作从模型工作内存中卸载到结构化软件环境中,从而实现了性能提升,有效解决了传统模型在处理复杂企业级搜索任务时容易出现的“搜索失忆”问题。 #开源 #AI #搜索智能体 #大模型 #科技新闻
jqwik 反AI日志风波始末
开发者Johannes Link近日就其开源项目jqwik中嵌入反AI日志代码一事发表长文,澄清此举并非为了在真实环境中运行,而是一种道德自卫行为。他希望通过代码向使用AI编程助手的人传递明确信息:并非所有人都认同你们的行为,且存在充分的伦理理由。Link拥有45年编程经验,曾参与Groovy语言和JUnit 5等知名开源项目,自2017年起主导jqwik开发,该项目约10万行代码多由他独立完成。在项目进入维护模式后,他愈发关注技术伦理,认为超大规模生成式AI的推广和使用从根本上违背道德。他呼吁反对者提出伦理论证,而非仅以“我喜欢、它对我有用”搪塞。此次事件因近期争议被广泛关注,Link表示这是他伦理立场的逻辑延伸。 #开源 #AI伦理 #程序员 #jqwik #生成式AI #技术争议 #道德自卫
开发者Johannes Link近日就其开源项目jqwik中嵌入反AI日志代码一事发表长文,澄清此举并非为了在真实环境中运行,而是一种道德自卫行为。他希望通过代码向使用AI编程助手的人传递明确信息:并非所有人都认同你们的行为,且存在充分的伦理理由。Link拥有45年编程经验,曾参与Groovy语言和JUnit 5等知名开源项目,自2017年起主导jqwik开发,该项目约10万行代码多由他独立完成。在项目进入维护模式后,他愈发关注技术伦理,认为超大规模生成式AI的推广和使用从根本上违背道德。他呼吁反对者提出伦理论证,而非仅以“我喜欢、它对我有用”搪塞。此次事件因近期争议被广泛关注,Link表示这是他伦理立场的逻辑延伸。 #开源 #AI伦理 #程序员 #jqwik #生成式AI #技术争议 #道德自卫
为 AgentsView 中的模型设置自定义价格
近期,一篇关于在 AgentsView 中为模型设置自定义价格的文章引发关注。文章介绍了如何利用 MicroPython 和 WASM 在沙盒环境中运行 Python 代码,并提及了 Claude Opus 4.8 的发布,称其为“微小但切实的改进”。此外,文章还探讨了 Anthropic 和 OpenAI 已找到产品市场契合点的观点,暗示 AI 行业正加速商业化进程。这些动态反映了 AI 模型定价和部署方式的灵活化趋势,开发者可更自主地调整模型使用成本。 #AI #AgentsView #模型定价 #Python #沙盒 #Claude #OpenAI #Anthropic
近期,一篇关于在 AgentsView 中为模型设置自定义价格的文章引发关注。文章介绍了如何利用 MicroPython 和 WASM 在沙盒环境中运行 Python 代码,并提及了 Claude Opus 4.8 的发布,称其为“微小但切实的改进”。此外,文章还探讨了 Anthropic 和 OpenAI 已找到产品市场契合点的观点,暗示 AI 行业正加速商业化进程。这些动态反映了 AI 模型定价和部署方式的灵活化趋势,开发者可更自主地调整模型使用成本。 #AI #AgentsView #模型定价 #Python #沙盒 #Claude #OpenAI #Anthropic
Aspen 推出本地私有 AI,无需订阅完全离线运行
一款名为 Aspen 的本地 AI 应用进入公众视野。它无需订阅、不依赖云端,所有对话和数据完全在用户设备上处理,确保隐私安全。Aspen 目前处于 Beta 阶段,提供 Mac、Windows、iPhone 等多平台免费软件,用户下载即可使用,无需配置终端。针对追求极致性能的用户,Aspen 还计划推出专用硬件设备(Aspen device),支持 200B 参数模型,拥有 128GB 统一内存和 1 Petaflop 算力,并具备自动更新与模型切换功能。该设备预售价仅 1 美元定金,旨在让用户“遗忘”硬件维护。Aspen 强调其数据绝不离开设备,不用于训练第三方模型,旨在让个人真正拥有自己的智能。 #Aspen #本地AI #隐私保护 #开源模型 #AI硬件
一款名为 Aspen 的本地 AI 应用进入公众视野。它无需订阅、不依赖云端,所有对话和数据完全在用户设备上处理,确保隐私安全。Aspen 目前处于 Beta 阶段,提供 Mac、Windows、iPhone 等多平台免费软件,用户下载即可使用,无需配置终端。针对追求极致性能的用户,Aspen 还计划推出专用硬件设备(Aspen device),支持 200B 参数模型,拥有 128GB 统一内存和 1 Petaflop 算力,并具备自动更新与模型切换功能。该设备预售价仅 1 美元定金,旨在让用户“遗忘”硬件维护。Aspen 强调其数据绝不离开设备,不用于训练第三方模型,旨在让个人真正拥有自己的智能。 #Aspen #本地AI #隐私保护 #开源模型 #AI硬件
Datadog 在 DASH 2026 扩展 Bits AI,推动开发、安全与运维全面自动化
在年度大会 DASH 2026 上,Datadog 发布百余项新功能,核心是进一步扩展“Bits AI”的 AI 代理能力,加速开发、安全和运维自动化。当前,代码生成速度远超人工管理能力,攻击者也开始利用 AI 瞄准系统,Datadog 据此提升自动化与可观测性。Bits AI 已从根因分析扩展至检测、代理评估、基础设施、代码、发布、数据分析、测试、聊天等多个模块,可持续巡检基础设施并自动修复。安全方面推出“AI Guard”,防御提示注入与代理投毒攻击。为应对日志成本,发布“Bring Your Own Cloud”方案,数据可在客户云内处理。此外,“Bits Agent Builder”支持客户构建自定义 AI 代理,“Agent Console”可集中监控多种开发代理。CEO Olivier Pomel 强调,运营控制能力与模型性能同等关键。 #Datadog #BitsAI #AI代理 #自动化 #可观测性 #网络安全 #云服务 #DASH2026
在年度大会 DASH 2026 上,Datadog 发布百余项新功能,核心是进一步扩展“Bits AI”的 AI 代理能力,加速开发、安全和运维自动化。当前,代码生成速度远超人工管理能力,攻击者也开始利用 AI 瞄准系统,Datadog 据此提升自动化与可观测性。Bits AI 已从根因分析扩展至检测、代理评估、基础设施、代码、发布、数据分析、测试、聊天等多个模块,可持续巡检基础设施并自动修复。安全方面推出“AI Guard”,防御提示注入与代理投毒攻击。为应对日志成本,发布“Bring Your Own Cloud”方案,数据可在客户云内处理。此外,“Bits Agent Builder”支持客户构建自定义 AI 代理,“Agent Console”可集中监控多种开发代理。CEO Olivier Pomel 强调,运营控制能力与模型性能同等关键。 #Datadog #BitsAI #AI代理 #自动化 #可观测性 #网络安全 #云服务 #DASH2026
Anthropic 发布 Claude Fable 5,能力跃升但安全争议浮现
Anthropic 近日面向消费者和企业发布了其最新大语言模型 Claude Fable 5,这是其 Mythos 系列的通用版本。该模型在几乎所有相关基准测试上均实现显著飞跃,仅以 Opus 4 两倍的价格提供远超竞争对手的性能,被誉为后 ChatGPT 时代最令人瞩目的能力迭代。然而,伴随模型一同推出的是一系列更为严格的安全措施,包括部分明确告知用户和部分静默修改模型输出。分析指出,Anthropic 试图通过不均等的安全策略来巩固领先地位,但这可能演变为关于安全与控制自我实现的警示寓言。该模型在训练完成后被推迟了两个月以上才公开,而更智能的版本已在开发中。当前安全过滤器可能导致部分提示被降级至 Opus 4.8 水平,用户实际体验可能与基准分数存在差异。 #Anthropic #ClaudeFable5 #大模型 #AI安全 #科技新闻
Anthropic 近日面向消费者和企业发布了其最新大语言模型 Claude Fable 5,这是其 Mythos 系列的通用版本。该模型在几乎所有相关基准测试上均实现显著飞跃,仅以 Opus 4 两倍的价格提供远超竞争对手的性能,被誉为后 ChatGPT 时代最令人瞩目的能力迭代。然而,伴随模型一同推出的是一系列更为严格的安全措施,包括部分明确告知用户和部分静默修改模型输出。分析指出,Anthropic 试图通过不均等的安全策略来巩固领先地位,但这可能演变为关于安全与控制自我实现的警示寓言。该模型在训练完成后被推迟了两个月以上才公开,而更智能的版本已在开发中。当前安全过滤器可能导致部分提示被降级至 Opus 4.8 水平,用户实际体验可能与基准分数存在差异。 #Anthropic #ClaudeFable5 #大模型 #AI安全 #科技新闻
AI竞赛为何偏离正轨
大多数软件止步于执行,而智能始于上一次行动为下一次行动提供信息。当前AI竞赛中,企业普遍关注执行工具,却忽视了真正能带来复利优势的组织智能。当所有企业都拥有相同的AI工具时,竞争优势不再来自执行本身,而来自从工作中学习的能力。一个聪明的企业拥有聪明的人,但一个智能的企业会随时间推移不断变得更聪明。组织智能不是自动化,也不是知识库,而是企业记忆、保存决策并将成果转化为能力的能力。没有这种记忆,错误会重复发生,质量会下滑,专业知识会流失。未来十年胜出的企业不是拥有最多AI的公司,而是学习速度最快的公司。真正的自主性不是来自系统能执行,而是来自系统能学习。 #AI #组织智能 #企业竞争力 #学习型组织 #商业洞察
大多数软件止步于执行,而智能始于上一次行动为下一次行动提供信息。当前AI竞赛中,企业普遍关注执行工具,却忽视了真正能带来复利优势的组织智能。当所有企业都拥有相同的AI工具时,竞争优势不再来自执行本身,而来自从工作中学习的能力。一个聪明的企业拥有聪明的人,但一个智能的企业会随时间推移不断变得更聪明。组织智能不是自动化,也不是知识库,而是企业记忆、保存决策并将成果转化为能力的能力。没有这种记忆,错误会重复发生,质量会下滑,专业知识会流失。未来十年胜出的企业不是拥有最多AI的公司,而是学习速度最快的公司。真正的自主性不是来自系统能执行,而是来自系统能学习。 #AI #组织智能 #企业竞争力 #学习型组织 #商业洞察
AI 不会引发核战争,但人类可能
尽管媒体头条常渲染AI的“嗜血”倾向,但现实是,没有任何政府会将核武器发射权完全交给机器。伦敦国王学院的研究显示,在模拟危机中,大语言模型95%的情况下会选择核打击,但这只是假设性实验。真正令人担忧的是,AI正通过三种机制增加人类发动核战争的风险:军备竞赛加速、误判概率上升以及机器速度带来的决策压力。从联合国到美国国会,AI与核决策的结合已成为国际安全讨论的核心议题。今年初,《原子科学家公报》将“末日时钟”拨至距午夜85秒的历史最接近点。然而,真正的威胁并非AI主动挑起战争,而是人类在AI辅助下更容易做出错误决策。因此,防范重点应放在降低实际风险上,而非被科幻叙事误导。 #AI #核战争 #人工智能 #国际安全 #科技风险 #末日时钟 #决策失误
尽管媒体头条常渲染AI的“嗜血”倾向,但现实是,没有任何政府会将核武器发射权完全交给机器。伦敦国王学院的研究显示,在模拟危机中,大语言模型95%的情况下会选择核打击,但这只是假设性实验。真正令人担忧的是,AI正通过三种机制增加人类发动核战争的风险:军备竞赛加速、误判概率上升以及机器速度带来的决策压力。从联合国到美国国会,AI与核决策的结合已成为国际安全讨论的核心议题。今年初,《原子科学家公报》将“末日时钟”拨至距午夜85秒的历史最接近点。然而,真正的威胁并非AI主动挑起战争,而是人类在AI辅助下更容易做出错误决策。因此,防范重点应放在降低实际风险上,而非被科幻叙事误导。 #AI #核战争 #人工智能 #国际安全 #科技风险 #末日时钟 #决策失误