OpenAI 升级 GPT-5.5
OpenAI 近日升级了其网络安全专用模型 GPT-5.5-Cyber,新增对大规模代码库的深度分析能力,支持漏洞识别、验证以及软件补丁的开发和测试。在 CyberGym 基准测试中,该模型得分为 85.6%,高于 GPT-5.5 的 81.8%,该测试主要衡量 AI 代理在测试环境中复现已知软件漏洞的能力。此前,获批机构通常只能在自有系统或已获得测试授权的系统中使用这类模型。OpenAI 还与 Trail of Bits、HackerOne 和 Calypso 合作,支持“Patch the Planet”倡议,帮助开源项目维护者修复通过 AI 辅助工具发现的漏洞。此外,OpenAI 已与澳大利亚、加拿大、法国、德国、日本、波兰、韩国以及欧盟相关机构建立合作关系,并正与关键基础设施运营方及政府网络安全领域开展合作。 #OpenAI #GPT5.5 #网络安全 #AI #漏洞修复 #大模型 #科技新闻
OpenAI 近日升级了其网络安全专用模型 GPT-5.5-Cyber,新增对大规模代码库的深度分析能力,支持漏洞识别、验证以及软件补丁的开发和测试。在 CyberGym 基准测试中,该模型得分为 85.6%,高于 GPT-5.5 的 81.8%,该测试主要衡量 AI 代理在测试环境中复现已知软件漏洞的能力。此前,获批机构通常只能在自有系统或已获得测试授权的系统中使用这类模型。OpenAI 还与 Trail of Bits、HackerOne 和 Calypso 合作,支持“Patch the Planet”倡议,帮助开源项目维护者修复通过 AI 辅助工具发现的漏洞。此外,OpenAI 已与澳大利亚、加拿大、法国、德国、日本、波兰、韩国以及欧盟相关机构建立合作关系,并正与关键基础设施运营方及政府网络安全领域开展合作。 #OpenAI #GPT5.5 #网络安全 #AI #漏洞修复 #大模型 #科技新闻
加州承认使用六款高风险AI系统,此前零报告
加利福尼亚州政府近日发布报告,承认目前正在使用六种高风险自动化决策系统,用于影响居民生活的重要决策。一年前,该州依据一项新法律要求各机构报告此类系统使用情况时,曾声称“从未使用”,这一说法当时引发质疑。如今,该州科技部门通过更彻底的调查(包括与各机构面谈并详细审查其系统),发现了这些长期存在却未上报的系统。它们被用于假释/保释风险评估、儿童福利安全筛查、医疗资源分配等领域。此前,加州惩教部门已被曝使用COMPAS系统给囚犯打分并至少十年,就业发展部门也在2020年圣诞节期间因欺诈检测系统暂停了60万人的福利。报告还披露了另外六个最初被标记为高风险但最终被判定不属于的系统,以及两个正在开发或已停用的系统。此事件表明,政府机构对AI系统的实际使用可能存在严重的信息不透明问题,加剧了隐私、偏见和问责方面的担忧。 #AI #加州 #高风险AI #自动化决策 #政府透明度 #隐私 #偏见 #科技监管
加利福尼亚州政府近日发布报告,承认目前正在使用六种高风险自动化决策系统,用于影响居民生活的重要决策。一年前,该州依据一项新法律要求各机构报告此类系统使用情况时,曾声称“从未使用”,这一说法当时引发质疑。如今,该州科技部门通过更彻底的调查(包括与各机构面谈并详细审查其系统),发现了这些长期存在却未上报的系统。它们被用于假释/保释风险评估、儿童福利安全筛查、医疗资源分配等领域。此前,加州惩教部门已被曝使用COMPAS系统给囚犯打分并至少十年,就业发展部门也在2020年圣诞节期间因欺诈检测系统暂停了60万人的福利。报告还披露了另外六个最初被标记为高风险但最终被判定不属于的系统,以及两个正在开发或已停用的系统。此事件表明,政府机构对AI系统的实际使用可能存在严重的信息不透明问题,加剧了隐私、偏见和问责方面的担忧。 #AI #加州 #高风险AI #自动化决策 #政府透明度 #隐私 #偏见 #科技监管
AI编写前端测试常见代码坏味道
近年来,AI工具如Claude Code大幅改变了软件开发模式,许多开发者依赖AI来自动生成代码和测试。然而,作者在实践中发现,AI在编写前端测试时反复引入多种代码坏味道,这些模式虽能快速通过测试,却会在数月后造成维护问题。常见问题包括:AI会完全忘记编写测试,除非明确指示;即使写了测试,也往往只覆盖部分代码,尤其偏爱单元测试小函数或自定义Hook,却忽略对主组件的集成测试;同时,AI很少主动测试边缘情况和错误路径,通常只测试“快乐路径”;在处理已包含边缘处理的组件时,AI甚至可能让错误的行为通过测试。作者强调,这些坏味道相互矛盾(如某些情况过度测试、某些情况测试不足),根本解决办法是完善提示词、配置文件和代码规范,以引导AI写出更合理、可维护的测试。 #AI #前端测试 #代码坏味道 #ClaudeCode #React #Vitest #Playwright #测试质量 #软件工程
近年来,AI工具如Claude Code大幅改变了软件开发模式,许多开发者依赖AI来自动生成代码和测试。然而,作者在实践中发现,AI在编写前端测试时反复引入多种代码坏味道,这些模式虽能快速通过测试,却会在数月后造成维护问题。常见问题包括:AI会完全忘记编写测试,除非明确指示;即使写了测试,也往往只覆盖部分代码,尤其偏爱单元测试小函数或自定义Hook,却忽略对主组件的集成测试;同时,AI很少主动测试边缘情况和错误路径,通常只测试“快乐路径”;在处理已包含边缘处理的组件时,AI甚至可能让错误的行为通过测试。作者强调,这些坏味道相互矛盾(如某些情况过度测试、某些情况测试不足),根本解决办法是完善提示词、配置文件和代码规范,以引导AI写出更合理、可维护的测试。 #AI #前端测试 #代码坏味道 #ClaudeCode #React #Vitest #Playwright #测试质量 #软件工程
Valve 公布 Steam Machine 售价,512GB 版高达 1049 美元
Valve 近日正式公布了其新一代游戏主机 Steam Machine 的售价,512GB 版本定价 1049 美元,2TB 版本则高达 1349 美元,且均不包含手柄,额外购买手柄将进一步增加成本。Valve 在描述 2026 年内存谈判的艰难时,暗示了硬件成本上涨的压力。这一价格远高于此前预期,可能影响玩家购买意愿,但 Valve 强调其高性能配置和 Steam 生态的整合优势。目前该设备尚未公布具体发售日期。 #Valve #SteamMachine #游戏主机 #硬件定价 #游戏新闻
Valve 近日正式公布了其新一代游戏主机 Steam Machine 的售价,512GB 版本定价 1049 美元,2TB 版本则高达 1349 美元,且均不包含手柄,额外购买手柄将进一步增加成本。Valve 在描述 2026 年内存谈判的艰难时,暗示了硬件成本上涨的压力。这一价格远高于此前预期,可能影响玩家购买意愿,但 Valve 强调其高性能配置和 Steam 生态的整合优势。目前该设备尚未公布具体发售日期。 #Valve #SteamMachine #游戏主机 #硬件定价 #游戏新闻