AI知识库 @ai521
341 subscribers
23.3K photos
42 videos
20 files
892 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
OpenAI 升级 GPT-5.5

OpenAI 近日升级了其网络安全专用模型 GPT-5.5-Cyber,新增对大规模代码库的深度分析能力,支持漏洞识别、验证以及软件补丁的开发和测试。在 CyberGym 基准测试中,该模型得分为 85.6%,高于 GPT-5.5 的 81.8%,该测试主要衡量 AI 代理在测试环境中复现已知软件漏洞的能力。此前,获批机构通常只能在自有系统或已获得测试授权的系统中使用这类模型。OpenAI 还与 Trail of Bits、HackerOne 和 Calypso 合作,支持“Patch the Planet”倡议,帮助开源项目维护者修复通过 AI 辅助工具发现的漏洞。此外,OpenAI 已与澳大利亚、加拿大、法国、德国、日本、波兰、韩国以及欧盟相关机构建立合作关系,并正与关键基础设施运营方及政府网络安全领域开展合作。 #OpenAI #GPT5.5 #网络安全 #AI #漏洞修复 #大模型 #科技新闻
AI 引发软件工程师“身份危机”,风投合伙人发声

据商业内幕网报道,一位风险投资合伙人指出,随着人工智能技术的快速发展,软件工程师正面临一场深刻的“身份危机”。AI 工具在代码生成、调试和自动化测试等方面的能力日益增强,使得传统编程工作的核心价值受到挑战。许多工程师开始担忧自己的技能是否会被取代,职业发展方向也变得模糊不清。这位合伙人认为,未来软件工程师的角色将从“编写代码”转向“定义问题”和“管理AI系统”,需要更注重创造力、系统思维和跨领域协作能力。这一转变虽然带来焦虑,但也催生了新的职业机遇。 #AI #软件工程师 #身份危机 #科技 #职业发展 #人工智能
AI评估常忽略“上游决策失败”

许多AI评估将错误归咎于生成环节,如邮件内容生硬或重复。但真正问题常发生在更早阶段:系统在发送前,未验证收件人身份、所属公司、是否已是客户、是否允许外联等关键事实。这些检查一旦缺失或错误,更强大的模型只会写出更漂亮的错误操作。因此,评估AI代理应聚焦其行动前的搜索、抓取、引用和权限检查,而非仅看最终输出是否流畅。文章以Linear公司销售代理连续向现有客户发送6封错误公司名邮件为例,指出是上游决策链的断裂导致了这一低劣行为。 #AI评估 #代理系统 #错误分析 #上游检查 #人工智能 #销售自动化 #GroundEval
Meta 暂停追踪员工击键的 AI 训练项目,起因内部泄露

Meta 公司近日暂停了一项通过追踪员工键盘敲击来训练 AI 的项目,该项目细节因内部泄露而被披露。据悉,该项目旨在收集员工击键数据以优化人工智能模型,但此举引发了对员工隐私和监控的广泛担忧。目前 Meta 官方尚未就此作出正式回应,但暂停决定表明公司正重新评估该计划的合规性与伦理风险。 #Meta #AI训练 #员工监控 #隐私 #内部泄露 #科技新闻 #人工智能 #数据安全
五眼联盟发布联合声明,警告AI模型可导致政府与企业瘫痪

2025年1月16日,五眼联盟(美国、英国、加拿大、澳大利亚、新西兰)发布联合声明,聚焦人工智能模型对国家安全和关键基础设施构成的重大威胁。声明指出,先进AI模型可能被恶意利用,发动针对政府系统和企业的网络攻击,甚至导致公共服务中断和经济崩溃。联盟呼吁各国加强AI安全评估、建立跨境应急响应机制,并敦促科技公司配合制定更严格的AI部署规范。该声明标志着五眼联盟在数字治理领域的又一重要协同行动,旨在构建国家韧性以应对前所未有的技术颠覆。 #五眼联盟 #AI安全 #网络威胁 #国家安全 #关键基础设施 #科技治理 #联合声明
加州承认使用六款高风险AI系统,此前零报告

加利福尼亚州政府近日发布报告,承认目前正在使用六种高风险自动化决策系统,用于影响居民生活的重要决策。一年前,该州依据一项新法律要求各机构报告此类系统使用情况时,曾声称“从未使用”,这一说法当时引发质疑。如今,该州科技部门通过更彻底的调查(包括与各机构面谈并详细审查其系统),发现了这些长期存在却未上报的系统。它们被用于假释/保释风险评估、儿童福利安全筛查、医疗资源分配等领域。此前,加州惩教部门已被曝使用COMPAS系统给囚犯打分并至少十年,就业发展部门也在2020年圣诞节期间因欺诈检测系统暂停了60万人的福利。报告还披露了另外六个最初被标记为高风险但最终被判定不属于的系统,以及两个正在开发或已停用的系统。此事件表明,政府机构对AI系统的实际使用可能存在严重的信息不透明问题,加剧了隐私、偏见和问责方面的担忧。 #AI #加州 #高风险AI #自动化决策 #政府透明度 #隐私 #偏见 #科技监管
AI编写前端测试常见代码坏味道

近年来,AI工具如Claude Code大幅改变了软件开发模式,许多开发者依赖AI来自动生成代码和测试。然而,作者在实践中发现,AI在编写前端测试时反复引入多种代码坏味道,这些模式虽能快速通过测试,却会在数月后造成维护问题。常见问题包括:AI会完全忘记编写测试,除非明确指示;即使写了测试,也往往只覆盖部分代码,尤其偏爱单元测试小函数或自定义Hook,却忽略对主组件的集成测试;同时,AI很少主动测试边缘情况和错误路径,通常只测试“快乐路径”;在处理已包含边缘处理的组件时,AI甚至可能让错误的行为通过测试。作者强调,这些坏味道相互矛盾(如某些情况过度测试、某些情况测试不足),根本解决办法是完善提示词、配置文件和代码规范,以引导AI写出更合理、可维护的测试。 #AI #前端测试 #代码坏味道 #ClaudeCode #React #Vitest #Playwright #测试质量 #软件工程
Valve 公布 Steam Machine 售价,512GB 版高达 1049 美元

Valve 近日正式公布了其新一代游戏主机 Steam Machine 的售价,512GB 版本定价 1049 美元,2TB 版本则高达 1349 美元,且均不包含手柄,额外购买手柄将进一步增加成本。Valve 在描述 2026 年内存谈判的艰难时,暗示了硬件成本上涨的压力。这一价格远高于此前预期,可能影响玩家购买意愿,但 Valve 强调其高性能配置和 Steam 生态的整合优势。目前该设备尚未公布具体发售日期。 #Valve #SteamMachine #游戏主机 #硬件定价 #游戏新闻