大西洋月刊调查
《大西洋月刊》的一项调查揭示了生成式AI背后一个严重问题:Meta公司的LLaMA模型及其他AI系统正在使用包含斯蒂芬·金、扎迪·史密斯、迈克尔·波伦等数千名作家受版权保护作品的盗版数据集Books3进行训练。该数据集包含超过17万本书,大部分出版于过去20年。除Meta外,彭博社的BloombergGPT和EleutherAI的GPT-J等模型也被证实使用该数据集。目前,部分作者已在加州提起诉讼,指控Meta侵犯版权。彭博社表示未来版本将不再使用Books3数据集。这一发现再次引发对AI训练过程中知识产权保护的广泛关注。 #AI #版权 #盗版书籍 #LLaMA #Meta #数据训练 #知识产权 #大西洋月刊 #调查报道
《大西洋月刊》的一项调查揭示了生成式AI背后一个严重问题:Meta公司的LLaMA模型及其他AI系统正在使用包含斯蒂芬·金、扎迪·史密斯、迈克尔·波伦等数千名作家受版权保护作品的盗版数据集Books3进行训练。该数据集包含超过17万本书,大部分出版于过去20年。除Meta外,彭博社的BloombergGPT和EleutherAI的GPT-J等模型也被证实使用该数据集。目前,部分作者已在加州提起诉讼,指控Meta侵犯版权。彭博社表示未来版本将不再使用Books3数据集。这一发现再次引发对AI训练过程中知识产权保护的广泛关注。 #AI #版权 #盗版书籍 #LLaMA #Meta #数据训练 #知识产权 #大西洋月刊 #调查报道
AI Agent 并非全能员工!天工产品总监提出“实习生”度量框架
在当前人工智能热潮中,许多企业急于将AI Agent(智能代理)视为正式员工投入工作,但实际效果往往不尽如人意。天工产品总监Phoebe近日提出了一套全新的评估理念,她强调不应高估AI Agent的成熟度,而应将其视为需要培训的“实习生”。为此,她设计了一个三维度量与六维“实习生”度量框架:三维度聚焦于任务完成度、自主决策能力和学习进化速度;而六维则细化为执行准确性、理解上下文、反馈响应、持续改进、协作沟通以及任务迁移能力。这一框架旨在帮助企业更客观地评估AI Agent的实际工作表现,避免因过度期待导致部署失败。Phoebe建议,管理者应通过持续的任务分解和反馈训练,逐步提升AI Agent的“实习”水平,最终实现人机高效协作。 #AI #人工智能 #AIAgent #智能代理 #产品管理 #人机协作 #技术框架
在当前人工智能热潮中,许多企业急于将AI Agent(智能代理)视为正式员工投入工作,但实际效果往往不尽如人意。天工产品总监Phoebe近日提出了一套全新的评估理念,她强调不应高估AI Agent的成熟度,而应将其视为需要培训的“实习生”。为此,她设计了一个三维度量与六维“实习生”度量框架:三维度聚焦于任务完成度、自主决策能力和学习进化速度;而六维则细化为执行准确性、理解上下文、反馈响应、持续改进、协作沟通以及任务迁移能力。这一框架旨在帮助企业更客观地评估AI Agent的实际工作表现,避免因过度期待导致部署失败。Phoebe建议,管理者应通过持续的任务分解和反馈训练,逐步提升AI Agent的“实习”水平,最终实现人机高效协作。 #AI #人工智能 #AIAgent #智能代理 #产品管理 #人机协作 #技术框架
Claude Opus 5 发布两天即现三段提示词生成浏览器 FPS 游戏案例
Anthropic 旗下大模型 Claude Opus 5 发布仅两天,便出现利用三段简短提示词生成浏览器端第一人称射击(FPS)游戏 Demo 的案例,引发对 AI 编程中提示词设计方法的广泛关注。据加密货币媒体 Decrypt 报道,AI 投资者 Matt Shumer 公布视频显示,该模型在未使用任何外部素材的情况下,通过单轮提示“自行完成”了一款可在浏览器运行的 FPS 游戏。这组提示词以《Call of Duty》为对标,将任务拆分给多个子代理,并引入独立的“严苛批评代理”进行盲测对比,推动迭代至“完美”。随后出现多组复现案例,但均未采用相同盲测机制,不同模型和工作流下的稳定性尚缺证据。研究者认为,该案例更可能源于训练数据中的结构重构,而非全新推理,但展示了在成熟品类中代理式编程工具的潜力。 #AI #大模型 #ClaudeOpus5 #提示词工程 #游戏开发 #编程 #科技新闻
Anthropic 旗下大模型 Claude Opus 5 发布仅两天,便出现利用三段简短提示词生成浏览器端第一人称射击(FPS)游戏 Demo 的案例,引发对 AI 编程中提示词设计方法的广泛关注。据加密货币媒体 Decrypt 报道,AI 投资者 Matt Shumer 公布视频显示,该模型在未使用任何外部素材的情况下,通过单轮提示“自行完成”了一款可在浏览器运行的 FPS 游戏。这组提示词以《Call of Duty》为对标,将任务拆分给多个子代理,并引入独立的“严苛批评代理”进行盲测对比,推动迭代至“完美”。随后出现多组复现案例,但均未采用相同盲测机制,不同模型和工作流下的稳定性尚缺证据。研究者认为,该案例更可能源于训练数据中的结构重构,而非全新推理,但展示了在成熟品类中代理式编程工具的潜力。 #AI #大模型 #ClaudeOpus5 #提示词工程 #游戏开发 #编程 #科技新闻