Caneni 推出“AI 监督证据”工具
一家名为 Caneni 的初创公司发布了一套名为“AI 监督证据”(AI Oversight Evidence)的方法论与工具,旨在为 AI 决策提供可独立验证的人类审查记录。该工具并非传统的审计追踪或模型监控仪表盘,而是生成带有时间戳、结构化的条目,记录谁进行了审查、考虑了哪些因素、做出了什么决定,且独立于 AI 系统保存,以符合监管、审计和法庭的要求。Caneni 引用以色列最高法院 2026 年的一起判例:某市因仅依赖 AI 输出而未进行人工验证,被判“鲁莽”行事并承担 3 万新谢克尔法律费用。此外,以色列于 2025 年 8 月生效的《隐私保护法》第 13 条修正案,使董事会成员对包括 AI 处理个人数据在内的数据保护实践负有个人责任;欧盟《AI 法案》第 14 条也要求高风险 AI 系统必须有人类监督。Caneni 认为,仅制定政策不够,必须有可验证的证据证明“正确的人类在场并做出了决策”。 #AI监管 #人类监督 #合规工具 #人工智能 #科技新闻 #以色列法律 #欧盟AI法案 #数据保护
一家名为 Caneni 的初创公司发布了一套名为“AI 监督证据”(AI Oversight Evidence)的方法论与工具,旨在为 AI 决策提供可独立验证的人类审查记录。该工具并非传统的审计追踪或模型监控仪表盘,而是生成带有时间戳、结构化的条目,记录谁进行了审查、考虑了哪些因素、做出了什么决定,且独立于 AI 系统保存,以符合监管、审计和法庭的要求。Caneni 引用以色列最高法院 2026 年的一起判例:某市因仅依赖 AI 输出而未进行人工验证,被判“鲁莽”行事并承担 3 万新谢克尔法律费用。此外,以色列于 2025 年 8 月生效的《隐私保护法》第 13 条修正案,使董事会成员对包括 AI 处理个人数据在内的数据保护实践负有个人责任;欧盟《AI 法案》第 14 条也要求高风险 AI 系统必须有人类监督。Caneni 认为,仅制定政策不够,必须有可验证的证据证明“正确的人类在场并做出了决策”。 #AI监管 #人类监督 #合规工具 #人工智能 #科技新闻 #以色列法律 #欧盟AI法案 #数据保护
AI写作者尝试规避检测失败
一位技术作者在其博客系列“将LLM堆栈记在脑海中”中大量使用AI辅助写作,随后尝试用AI工具规避AI检测。他在Pangram平台上对84篇文章进行评估,几乎全部被标记为100% AI生成。他随后使用Claude Code和10个并行代理,结合维基百科中关于AI写作特征的信息,对文章进行编辑以使其更接近人类写作,但第一轮尝试完全无效。第二轮中,他让每个代理能调用Pangram API迭代评分,直至获得“人类”标签。结果62篇文章得分0.99-1.00,15篇0.90-0.98,7篇0.77-0.89,最低分仅为0.77,无一获得“人类”标签。作者认为AI检测工具可能关注句子长度、结构等长期模式,而AI的编辑偏向于保持原有结构。他承认这次实验虽未成功,但颇具趣味,并计划未来使用开源AI检测模型进行更深入尝试。 #AI检测 #规避实验 #ClaudeCode #大模型 #技术写作 #AI辅助写作 #Pangram
一位技术作者在其博客系列“将LLM堆栈记在脑海中”中大量使用AI辅助写作,随后尝试用AI工具规避AI检测。他在Pangram平台上对84篇文章进行评估,几乎全部被标记为100% AI生成。他随后使用Claude Code和10个并行代理,结合维基百科中关于AI写作特征的信息,对文章进行编辑以使其更接近人类写作,但第一轮尝试完全无效。第二轮中,他让每个代理能调用Pangram API迭代评分,直至获得“人类”标签。结果62篇文章得分0.99-1.00,15篇0.90-0.98,7篇0.77-0.89,最低分仅为0.77,无一获得“人类”标签。作者认为AI检测工具可能关注句子长度、结构等长期模式,而AI的编辑偏向于保持原有结构。他承认这次实验虽未成功,但颇具趣味,并计划未来使用开源AI检测模型进行更深入尝试。 #AI检测 #规避实验 #ClaudeCode #大模型 #技术写作 #AI辅助写作 #Pangram
WAIC 2026:阿里云发布AI Agent安全实践,推出“三层统一、一体化防护”体系
在2026年世界人工智能大会(WAIC 2026)上,阿里云正式发布AI Agent安全实践方案,推出“三层统一、一体化防护”体系。该体系旨在针对AI Agent面临的身份冒用、行为异常、数据泄露等安全挑战,实现统一身份、统一行为、统一数据的三层协同防护,构建贯穿Agent全生命周期的安全保障。阿里云表示,这一方案整合了身份认证、访问控制、行为审计、数据加密等多项能力,能够有效防范针对大模型及智能体的新型攻击。随着AI Agent在办公、金融、制造等领域的广泛应用,其安全问题日益凸显,阿里云此次发布的技术实践为行业提供了可参考的防护框架,有望推动AI安全标准的建设。 #WAIC2026 #阿里云 #AI安全 #Agent #人工智能 #安全防护 #大模型
在2026年世界人工智能大会(WAIC 2026)上,阿里云正式发布AI Agent安全实践方案,推出“三层统一、一体化防护”体系。该体系旨在针对AI Agent面临的身份冒用、行为异常、数据泄露等安全挑战,实现统一身份、统一行为、统一数据的三层协同防护,构建贯穿Agent全生命周期的安全保障。阿里云表示,这一方案整合了身份认证、访问控制、行为审计、数据加密等多项能力,能够有效防范针对大模型及智能体的新型攻击。随着AI Agent在办公、金融、制造等领域的广泛应用,其安全问题日益凸显,阿里云此次发布的技术实践为行业提供了可参考的防护框架,有望推动AI安全标准的建设。 #WAIC2026 #阿里云 #AI安全 #Agent #人工智能 #安全防护 #大模型
阿里云发布Agent Native Cloud,推动智能体成为企业原生能力
在2026世界人工智能大会上,阿里云正式推出Agent Native Cloud(智能体原生的云),并同步发布AgentTeams、Agentic Computer等企业级智能体工具,覆盖基础设施、开发平台和云桌面等多个层面。该方案旨在解决智能体在企业生产中面临的跨角色、跨系统复杂需求,提供端到端的完整落地路径。其中,Agent Native Cloud在Infra层提供可靠运行环境,包括重新设计的Sandbox、MicroVM级强隔离和低成本弹性扩展。阿里云还展示了基于15个Agent的7×24小时开发者服务,处理了85%的答疑量,运营支持时长降低90%。此外,无影Agentic Computer为Agent打造了安全、高性能的数字工位,支持企业现有软件直接运行,实现7×24小时不间断工作,单人可运维千台规模,运维人效提升10倍以上。阿里云表示,真正的Agent Native需要在业务、组织、工程、运营与基础设施五个维度同时原生,形成可规模化复制的智能生产力。 #阿里云 #AgentNativeCloud #智能体 #WAIC #人工智能 #云计算 #企业服务 #无影
在2026世界人工智能大会上,阿里云正式推出Agent Native Cloud(智能体原生的云),并同步发布AgentTeams、Agentic Computer等企业级智能体工具,覆盖基础设施、开发平台和云桌面等多个层面。该方案旨在解决智能体在企业生产中面临的跨角色、跨系统复杂需求,提供端到端的完整落地路径。其中,Agent Native Cloud在Infra层提供可靠运行环境,包括重新设计的Sandbox、MicroVM级强隔离和低成本弹性扩展。阿里云还展示了基于15个Agent的7×24小时开发者服务,处理了85%的答疑量,运营支持时长降低90%。此外,无影Agentic Computer为Agent打造了安全、高性能的数字工位,支持企业现有软件直接运行,实现7×24小时不间断工作,单人可运维千台规模,运维人效提升10倍以上。阿里云表示,真正的Agent Native需要在业务、组织、工程、运营与基础设施五个维度同时原生,形成可规模化复制的智能生产力。 #阿里云 #AgentNativeCloud #智能体 #WAIC #人工智能 #云计算 #企业服务 #无影
韩国宣布年底前推出主权网络安全AI模型,应对美国出口管制
韩国科学部长官裴京勋16日在政策简报会上宣布,将在今年年内推出专注于网络安全的主权人工智能模型。此举正值美国突然对包括Anthropic旗下专门从事漏洞检测的Mythos 5在内的先进AI模型实施出口管制,引发对数字安全的担忧。裴京勋表示,将通过利用安全相关数据训练现有主权AI模型来实现目标,并承认当前水平不足以应对生成式AI助长的网络安全威胁,重申长期应开发可与Mythos比肩的前沿模型。简报会还讨论了将“白帽黑客”行为制度化,科学部正在准备立法,为在特定条件下未经同意对企业进行道德黑客攻击提供法律依据。裴京勋称韩国AI竞争力排名世界第三,力争升至第二。 #韩国 #网络安全 #AI #主权AI #出口管制 #Mythos5 #白帽黑客 #科技政策
韩国科学部长官裴京勋16日在政策简报会上宣布,将在今年年内推出专注于网络安全的主权人工智能模型。此举正值美国突然对包括Anthropic旗下专门从事漏洞检测的Mythos 5在内的先进AI模型实施出口管制,引发对数字安全的担忧。裴京勋表示,将通过利用安全相关数据训练现有主权AI模型来实现目标,并承认当前水平不足以应对生成式AI助长的网络安全威胁,重申长期应开发可与Mythos比肩的前沿模型。简报会还讨论了将“白帽黑客”行为制度化,科学部正在准备立法,为在特定条件下未经同意对企业进行道德黑客攻击提供法律依据。裴京勋称韩国AI竞争力排名世界第三,力争升至第二。 #韩国 #网络安全 #AI #主权AI #出口管制 #Mythos5 #白帽黑客 #科技政策
Fosnie:面向受监管团队的开源自托管AI工作空间
Fosnie 是一个采用 Apache-2.0 许可的开源核心 AI 工作空间,专为受监管团队设计。它支持完全自托管,可在本地服务器、私有云或完全离线的气隙环境中部署,确保数据不离开用户边界。Fosnie 兼容任何模型(本地或云端),包括 Claude、ChatGPT、Gemini、DeepSeek、Qwen 等,并允许自带密钥。核心功能包括基于检索增强生成(Agentic RAG)的精准问答、多步深度研究、文档生成(DOCX/PDF/XLSX/HTML)、语音输入输出、可验证性检查以及内置工具和 MCP 协议支持。团队协作支持分组、项目聊天和静态加密。目前最新版本 v0.2.0 已发布,强化了检索精度和工具安全性。同时提供企业许可证,满足合规与治理需求。 #开源 #自托管 #AI #私有部署 #企业安全 #RAG #数据隐私 #Apache2 #新闻
Fosnie 是一个采用 Apache-2.0 许可的开源核心 AI 工作空间,专为受监管团队设计。它支持完全自托管,可在本地服务器、私有云或完全离线的气隙环境中部署,确保数据不离开用户边界。Fosnie 兼容任何模型(本地或云端),包括 Claude、ChatGPT、Gemini、DeepSeek、Qwen 等,并允许自带密钥。核心功能包括基于检索增强生成(Agentic RAG)的精准问答、多步深度研究、文档生成(DOCX/PDF/XLSX/HTML)、语音输入输出、可验证性检查以及内置工具和 MCP 协议支持。团队协作支持分组、项目聊天和静态加密。目前最新版本 v0.2.0 已发布,强化了检索精度和工具安全性。同时提供企业许可证,满足合规与治理需求。 #开源 #自托管 #AI #私有部署 #企业安全 #RAG #数据隐私 #Apache2 #新闻
AI狂热正在摧毁全球决策
据一位深耕企业销售与技术咨询的匿名作者观察,当前全球私人和公共部门正经历一场严重的“集体精神病”。高层管理者要么毫无计划,要么只能低头默许,而理性员工则生活在恐惧与挫败之中。作者基于过去一年参与的所有项目发现,公司宣称的AI生产力提升大多只是掩人耳目——例如购买Copilot许可证便宣布胜利。实际跟踪的AI项目全部失败,成功率0%已持续一年半。尽管各界都在推动“智能体工作流”等概念,真正得到用户使用的产品却寥寥无几。公开吹捧AI已成为政治正确,任何诚实评价都可能导致被解雇或裁员。这种自欺欺人的狂热正在侵蚀组织的长远决策能力。 #AI #人工智能 #企业管理 #科技泡沫 #批判 #决策失误 #盲目跟风 #商业战略 #职场观察
据一位深耕企业销售与技术咨询的匿名作者观察,当前全球私人和公共部门正经历一场严重的“集体精神病”。高层管理者要么毫无计划,要么只能低头默许,而理性员工则生活在恐惧与挫败之中。作者基于过去一年参与的所有项目发现,公司宣称的AI生产力提升大多只是掩人耳目——例如购买Copilot许可证便宣布胜利。实际跟踪的AI项目全部失败,成功率0%已持续一年半。尽管各界都在推动“智能体工作流”等概念,真正得到用户使用的产品却寥寥无几。公开吹捧AI已成为政治正确,任何诚实评价都可能导致被解雇或裁员。这种自欺欺人的狂热正在侵蚀组织的长远决策能力。 #AI #人工智能 #企业管理 #科技泡沫 #批判 #决策失误 #盲目跟风 #商业战略 #职场观察
认知神经科学家评析大模型全局工作空间
近日,多位认知神经科学专家就当前大型语言模型(LLM)内部是否形成类似人类“全局工作空间”的问题发表评论。此前,Anthropic研究人员报告在Claude模型中间层发现了一个可报告的“J空间”,认为其功能相似于人类意识中的全局神经元工作空间。包括Stanislas Dehaene和Lionel Naccache在内的学者指出,尽管大模型在功能架构上确实与人类意识处理过程有一定相似性,但在解剖结构、自我意识、缺乏身体和持久情景记忆等方面仍存在关键差异。他们建议,需通过更多认知神经科学实验进一步检验这些发现,并警告不宜过早将机器与人类心智直接类比。该评论还包括来自Google DeepMind、Eleos AI等研究机构的独立学者观点,部分学者已在开源模型上复现了部分结果。 #大模型 #意识 #全局工作空间 #认知神经科学 #AI #Claude #Anthropic #机器意识
近日,多位认知神经科学专家就当前大型语言模型(LLM)内部是否形成类似人类“全局工作空间”的问题发表评论。此前,Anthropic研究人员报告在Claude模型中间层发现了一个可报告的“J空间”,认为其功能相似于人类意识中的全局神经元工作空间。包括Stanislas Dehaene和Lionel Naccache在内的学者指出,尽管大模型在功能架构上确实与人类意识处理过程有一定相似性,但在解剖结构、自我意识、缺乏身体和持久情景记忆等方面仍存在关键差异。他们建议,需通过更多认知神经科学实验进一步检验这些发现,并警告不宜过早将机器与人类心智直接类比。该评论还包括来自Google DeepMind、Eleos AI等研究机构的独立学者观点,部分学者已在开源模型上复现了部分结果。 #大模型 #意识 #全局工作空间 #认知神经科学 #AI #Claude #Anthropic #机器意识
GPT-5.6 Sol 与 Claude Fable 5 在《红色警戒2》中对决,AI 获胜
近日,一项特殊的人工智能对战展示引发关注:OpenAI 的 GPT-5.6 Sol 与 Anthropic 的 Claude Fable 5 在经典即时战略游戏《红色警戒2》中进行了一场1v1比赛。两名AI通过纯文本态势报告指挥部队,无法看到游戏画面,如同战争室中的将军。比赛采用苏联阵营镜像地图“Lake Duel”,最终 GPT-5.6 Sol 取得完全胜利。所有决策日志和原始录像均已公开,可供验证。此举展示了前沿大模型在复杂实时策略游戏中的指挥能力,也凸显了AI在多步骤决策与资源管理上的进步。 #AI对战 #红色警戒2 #GPT5 #Claude5 #大模型 #即时战略 #AI应用 #游戏AI
近日,一项特殊的人工智能对战展示引发关注:OpenAI 的 GPT-5.6 Sol 与 Anthropic 的 Claude Fable 5 在经典即时战略游戏《红色警戒2》中进行了一场1v1比赛。两名AI通过纯文本态势报告指挥部队,无法看到游戏画面,如同战争室中的将军。比赛采用苏联阵营镜像地图“Lake Duel”,最终 GPT-5.6 Sol 取得完全胜利。所有决策日志和原始录像均已公开,可供验证。此举展示了前沿大模型在复杂实时策略游戏中的指挥能力,也凸显了AI在多步骤决策与资源管理上的进步。 #AI对战 #红色警戒2 #GPT5 #Claude5 #大模型 #即时战略 #AI应用 #游戏AI