AI模型对批评专制政权更保守,拒绝率高出两倍多
监督委员会(Oversight Board)首次评估大型语言模型对言论自由的保护,发现来自Anthropic、DeepSeek、谷歌、Meta和OpenAI等公司的全球最常用模型,在批评限制言论自由的政治体制时,拒绝率显著更高。研究基于该委员会针对政府施压社交媒体平台的案例工作,测试AI输出在多大程度上反映了禁止批评领导人和政府的国家法律。结果显示,模型对限制性政权的批评请求拒绝率达34%,而对宽松政权的拒绝率仅14%,前者是后者的两倍多。这种差异可能使用户通过代理遭受言论自由侵犯,且透明度有限。无论是否出于有意设计,模型输出都强化了限制言论政权的法律和习俗。研究强调,在训练和评估LLM过程中纳入系统性人权分析至关重要。 #AI #言论自由 #大模型 #人权 #科技新闻 #监督委员会 #Anthropic #DeepSeek
监督委员会(Oversight Board)首次评估大型语言模型对言论自由的保护,发现来自Anthropic、DeepSeek、谷歌、Meta和OpenAI等公司的全球最常用模型,在批评限制言论自由的政治体制时,拒绝率显著更高。研究基于该委员会针对政府施压社交媒体平台的案例工作,测试AI输出在多大程度上反映了禁止批评领导人和政府的国家法律。结果显示,模型对限制性政权的批评请求拒绝率达34%,而对宽松政权的拒绝率仅14%,前者是后者的两倍多。这种差异可能使用户通过代理遭受言论自由侵犯,且透明度有限。无论是否出于有意设计,模型输出都强化了限制言论政权的法律和习俗。研究强调,在训练和评估LLM过程中纳入系统性人权分析至关重要。 #AI #言论自由 #大模型 #人权 #科技新闻 #监督委员会 #Anthropic #DeepSeek
中国AI模型占据美国企业人工智能应用六成份额
据最新行业报告,中国企业开发的人工智能模型已在美国企业的人工智能应用中占据约60%的份额。这一数据表明,尽管存在技术竞争和供应链安全讨论,中国AI技术在全球商业场景中仍获得广泛采纳。分析人士指出,中国模型在性价比、本地化适配以及开源生态方面具有优势,推动了美国企业在自然语言处理、代码生成、数据分析等核心业务中大规模部署。不过,这一趋势也引发了对数据安全和依赖性的关注,部分美国公司正在考虑通过多供应商策略降低风险。报告同时显示,中国AI企业在模型训练成本和推理效率上的持续突破,是赢得海外企业订单的关键因素。 #AI #人工智能 #中国模型 #美国企业 #科技新闻 #全球化 #开源模型 #商业应用
据最新行业报告,中国企业开发的人工智能模型已在美国企业的人工智能应用中占据约60%的份额。这一数据表明,尽管存在技术竞争和供应链安全讨论,中国AI技术在全球商业场景中仍获得广泛采纳。分析人士指出,中国模型在性价比、本地化适配以及开源生态方面具有优势,推动了美国企业在自然语言处理、代码生成、数据分析等核心业务中大规模部署。不过,这一趋势也引发了对数据安全和依赖性的关注,部分美国公司正在考虑通过多供应商策略降低风险。报告同时显示,中国AI企业在模型训练成本和推理效率上的持续突破,是赢得海外企业订单的关键因素。 #AI #人工智能 #中国模型 #美国企业 #科技新闻 #全球化 #开源模型 #商业应用
AI辅助开发为何比想象中更令人疲惫
AI辅助开发本应减轻开发者负担,但现实中却导致许多程序员陷入过劳与倦怠。除了公司因追逐AI热潮而产生不切实际的期望外,更深层的原因在于人机交互心理学中的“模式切换”问题。软件开发自然包含规划、实现与集成三种认知模式:规划需要权衡约束与架构,认知负荷最高;实现通过编写代码获得小胜利,起到认知重置作用;集成则通过代码审查保证质量。AI辅助工具打破了这种节奏,让开发者频繁在不同模式间跳跃,无法享受实现阶段的流畅感与成就感,反而因持续的模式转换消耗更多精力。这种隐藏的认知成本,使得AI辅助开发比传统开发更令人心力交瘁。 #AI #开发者 #HCI #认知负荷 #软件工程 #疲劳 #人工智能
AI辅助开发本应减轻开发者负担,但现实中却导致许多程序员陷入过劳与倦怠。除了公司因追逐AI热潮而产生不切实际的期望外,更深层的原因在于人机交互心理学中的“模式切换”问题。软件开发自然包含规划、实现与集成三种认知模式:规划需要权衡约束与架构,认知负荷最高;实现通过编写代码获得小胜利,起到认知重置作用;集成则通过代码审查保证质量。AI辅助工具打破了这种节奏,让开发者频繁在不同模式间跳跃,无法享受实现阶段的流畅感与成就感,反而因持续的模式转换消耗更多精力。这种隐藏的认知成本,使得AI辅助开发比传统开发更令人心力交瘁。 #AI #开发者 #HCI #认知负荷 #软件工程 #疲劳 #人工智能
天气数据遭篡改风险加剧
全球航空调度、电网运营和农业生产等决策高度依赖天气预报,但预测市场的兴起以及AI预报技术的普及正使数据准确性面临新的威胁。今年4月,巴黎戴高乐机场气象站被曝遭人为篡改——有人用吹风机或打火机加热传感器,导致记录出现异常高温峰值,从而让在线预测市场的赌徒获利,其中一人赢得2万美元。尽管传统气象系统通过数据同化和人工监测能及时发现单站点异常,但若缺乏人工审核或出现远程大规模操纵,现有防护机制可能不堪一击。专家警告,随着预测市场资金规模扩大和AI模型对观测数据依赖加深,天气数据遭破坏的风险正在系统性上升,亟需建立更强大的监测与防御体系。 #天气数据 #预测市场 #AI预报 #数据安全 #气象风险 #篡改事件 #预测市场风险 #科技新闻
全球航空调度、电网运营和农业生产等决策高度依赖天气预报,但预测市场的兴起以及AI预报技术的普及正使数据准确性面临新的威胁。今年4月,巴黎戴高乐机场气象站被曝遭人为篡改——有人用吹风机或打火机加热传感器,导致记录出现异常高温峰值,从而让在线预测市场的赌徒获利,其中一人赢得2万美元。尽管传统气象系统通过数据同化和人工监测能及时发现单站点异常,但若缺乏人工审核或出现远程大规模操纵,现有防护机制可能不堪一击。专家警告,随着预测市场资金规模扩大和AI模型对观测数据依赖加深,天气数据遭破坏的风险正在系统性上升,亟需建立更强大的监测与防御体系。 #天气数据 #预测市场 #AI预报 #数据安全 #气象风险 #篡改事件 #预测市场风险 #科技新闻
五篇新研究重塑对AI辅助软件工程的认知
近日,五篇独立研究论文几乎同时发布,共同揭示了AI在软件工程领域的影响新图景。研究涵盖了AI编码助手对生产效率的实际测量、价值在交付链路中的传导、开发者对AI系统的真实需求,以及在AI辅助世界中应关注的新型技术债务。其中一项针对16,223名开发者的纵向研究发现,高强度使用GitHub Copilot的时段,每小时编码时间可完成约40%更多的PR(拉取请求),且该效应通过了多项稳健性检验。然而,研究者指出,代码生成速度已超过理解、验证和交付所需的安全系统的构建速度。核心结论是:AI正在压缩软件工程的上游工作,但新的瓶颈出现在代码生成之后——能否真正交付更多价值、新瓶颈在哪、以及当理解速度跟不上生成速度时的代价是什么。 #AI #软件工程 #代码助手 #生产力 #技术债务 #开发效率 #GitHubCopilot #研究
近日,五篇独立研究论文几乎同时发布,共同揭示了AI在软件工程领域的影响新图景。研究涵盖了AI编码助手对生产效率的实际测量、价值在交付链路中的传导、开发者对AI系统的真实需求,以及在AI辅助世界中应关注的新型技术债务。其中一项针对16,223名开发者的纵向研究发现,高强度使用GitHub Copilot的时段,每小时编码时间可完成约40%更多的PR(拉取请求),且该效应通过了多项稳健性检验。然而,研究者指出,代码生成速度已超过理解、验证和交付所需的安全系统的构建速度。核心结论是:AI正在压缩软件工程的上游工作,但新的瓶颈出现在代码生成之后——能否真正交付更多价值、新瓶颈在哪、以及当理解速度跟不上生成速度时的代价是什么。 #AI #软件工程 #代码助手 #生产力 #技术债务 #开发效率 #GitHubCopilot #研究
JetBrains 研究:AI 与 XR 融合将催生编程交互新范式
JetBrains 研究团队发布报告指出,AI 与扩展现实(XR)硬件的结合正在开启自鼠标窗口范式诞生以来六十年的首次人机交互革命。通过对剑桥、Meta 等机构的13位专家进行深度访谈,团队归纳出五大主题。研究发现,XR 提供眼动、手势、语音、姿态等丰富的输入方式,结合 AI 可构建高效的多模态人机协作体验,尤其对软件工程师、设计师等技术创作者而言,XR 环境正在模糊编码、设计与创作的边界,甚至可能成为机器人 AI 的训练沙箱。但报告也警示,XR-AI 走向主流仍需克服技术障碍,并需警惕人类在高度沉浸式交互中可能面临的风险与失控。 #JetBrains #AI #XR #人机交互 #编程 #科技研究 #扩展现实
JetBrains 研究团队发布报告指出,AI 与扩展现实(XR)硬件的结合正在开启自鼠标窗口范式诞生以来六十年的首次人机交互革命。通过对剑桥、Meta 等机构的13位专家进行深度访谈,团队归纳出五大主题。研究发现,XR 提供眼动、手势、语音、姿态等丰富的输入方式,结合 AI 可构建高效的多模态人机协作体验,尤其对软件工程师、设计师等技术创作者而言,XR 环境正在模糊编码、设计与创作的边界,甚至可能成为机器人 AI 的训练沙箱。但报告也警示,XR-AI 走向主流仍需克服技术障碍,并需警惕人类在高度沉浸式交互中可能面临的风险与失控。 #JetBrains #AI #XR #人机交互 #编程 #科技研究 #扩展现实