Anthropic 发布 Claude Fable 5,对高风险查询设置安全限制
Anthropic 于周二发布 Claude Fable 5,首次向公众开放其最强级别 AI 模型。该模型在软件工程、知识工作、视觉和科学研究等基准测试中均优于此前系统。Fable 5 采用与引发安全担忧的 Mythos 模型同系列技术,但增加了限制和安全防护。对于涉及网络安全、生物和化学的敏感提示词,系统将转接至 Opus 4.8 处理。AI 研究人员警告,更强大的模型可能被用于攻击关键基础设施或协助生物武器设计。Anthropic 表示初期将采取保守策略,同时向 Pro、Max 等用户免费开放其他 Mythos 级功能至 6 月 22 日。此次发布正值特朗普签署行政命令,为 AI 公司建立自愿安全测试流程一周后。 #Anthropic #ClaudeFable5 #AI安全 #大模型 #科技新闻
Anthropic 于周二发布 Claude Fable 5,首次向公众开放其最强级别 AI 模型。该模型在软件工程、知识工作、视觉和科学研究等基准测试中均优于此前系统。Fable 5 采用与引发安全担忧的 Mythos 模型同系列技术,但增加了限制和安全防护。对于涉及网络安全、生物和化学的敏感提示词,系统将转接至 Opus 4.8 处理。AI 研究人员警告,更强大的模型可能被用于攻击关键基础设施或协助生物武器设计。Anthropic 表示初期将采取保守策略,同时向 Pro、Max 等用户免费开放其他 Mythos 级功能至 6 月 22 日。此次发布正值特朗普签署行政命令,为 AI 公司建立自愿安全测试流程一周后。 #Anthropic #ClaudeFable5 #AI安全 #大模型 #科技新闻
Publora 发布:一个 API 即可让 AI 代理在 10 个社交网络同步发帖
Publora 推出了一项创新服务,允许用户通过单个 HTTPS 调用或 MCP 服务器,让 AI 代理在包括 LinkedIn、Twitter 等在内的 10 个主流社交平台上同时发布内容。该平台提供免费账户(支持 3 个账号),付费计划起价为每月 2.99 美元(按年计费)。Publora 的核心优势在于其强大的集成能力:用户不仅可以通过 REST API 将代码或无代码代理(如 n8n)与平台连接,还能通过 MCP 协议直接让 Claude、Cursor 等 AI 助手用自然语言管理社交媒体,例如“在 LinkedIn 上安排明天早上 9 点的帖子”。平台还集成了日历排程、AI 编辑器、智能验证、邮件通知等功能,旨在帮助用户节省每周 10 小时以上的社交媒体管理时间,并建立一致的发布节奏以提升算法表现。对于代理机构,Publora 还提供了专门的工作区,支持客户管理、权限控制和集中计费。 #Publora #AI代理 #社交媒体管理 #MCP #自动化 #API #内容发布 #科技新闻
Publora 推出了一项创新服务,允许用户通过单个 HTTPS 调用或 MCP 服务器,让 AI 代理在包括 LinkedIn、Twitter 等在内的 10 个主流社交平台上同时发布内容。该平台提供免费账户(支持 3 个账号),付费计划起价为每月 2.99 美元(按年计费)。Publora 的核心优势在于其强大的集成能力:用户不仅可以通过 REST API 将代码或无代码代理(如 n8n)与平台连接,还能通过 MCP 协议直接让 Claude、Cursor 等 AI 助手用自然语言管理社交媒体,例如“在 LinkedIn 上安排明天早上 9 点的帖子”。平台还集成了日历排程、AI 编辑器、智能验证、邮件通知等功能,旨在帮助用户节省每周 10 小时以上的社交媒体管理时间,并建立一致的发布节奏以提升算法表现。对于代理机构,Publora 还提供了专门的工作区,支持客户管理、权限控制和集中计费。 #Publora #AI代理 #社交媒体管理 #MCP #自动化 #API #内容发布 #科技新闻
符号化AI是否比以往任何时候都更具现实意义?
当今天讨论人工智能时,几乎完全聚焦于大语言模型,即神经网络和基于海量数据的统计学习。这种主流观点隐含着一个承诺:前进的道路主要是数量问题——更多参数、更多数据、更多算力、更多能源,再加上一点耐心,其余问题就会自动解决。然而,本文作者对此提出质疑,认为我们可能正困于局部最优解,误将其当作顶峰。回顾历史,符号化AI曾主导AI研究数十年,从1956年达特茅斯会议到专家系统,它基于显式规则操纵符号,认为思维可以被书写和理解。符号化AI的衰落并非源于天真,而是因为两个具体问题:扩展性和脆弱性——手动输入规则无法跟上现实世界的复杂性,而僵化的规则在现实不符预期时会导致系统崩溃。随后,连接主义学习范式凭借充足的计算能力和数据填补了空白,但作者认为,当前一味追求规模化的策略可能忽略了其他可能性,因为神经模型的弱点未必能通过扩大规模来消除。 #符号化AI #人工智能 #大语言模型 #神经网络 #AI发展 #技术反思 #机器学习
当今天讨论人工智能时,几乎完全聚焦于大语言模型,即神经网络和基于海量数据的统计学习。这种主流观点隐含着一个承诺:前进的道路主要是数量问题——更多参数、更多数据、更多算力、更多能源,再加上一点耐心,其余问题就会自动解决。然而,本文作者对此提出质疑,认为我们可能正困于局部最优解,误将其当作顶峰。回顾历史,符号化AI曾主导AI研究数十年,从1956年达特茅斯会议到专家系统,它基于显式规则操纵符号,认为思维可以被书写和理解。符号化AI的衰落并非源于天真,而是因为两个具体问题:扩展性和脆弱性——手动输入规则无法跟上现实世界的复杂性,而僵化的规则在现实不符预期时会导致系统崩溃。随后,连接主义学习范式凭借充足的计算能力和数据填补了空白,但作者认为,当前一味追求规模化的策略可能忽略了其他可能性,因为神经模型的弱点未必能通过扩大规模来消除。 #符号化AI #人工智能 #大语言模型 #神经网络 #AI发展 #技术反思 #机器学习
AI 模型画鹈鹕骑自行车对决:Claude Fable 5 速度最快,GPT
近日,一项针对前沿AI模型的创意测试引发关注。测试要求Claude Fable 5、GPT-5.5 Pro和Gemini 3.1 Pro三大模型,根据同一提示词“生成一只骑自行车的鹈鹕的SVG代码”,且仅限单次生成、无编辑。结果显示,Claude Fable 5生成的鹈鹕形态干净、骑行姿势正确,且响应速度比GPT-5.5 Pro快10倍;GPT-5.5 Pro则经过四分钟推理,生成了表情丰富、带有喙袋的鹈鹕,SVG代码最长;Gemini 3.1 Pro的鹈鹕最时尚,被画上了围巾。此外,测试还对比了Claude系列不同版本的表现,发现较新版本在鸟类形态和自行车几何结构上更胜一筹,而早期版本则出现鹈鹕与车架融合或抽象化的问题。所有模型均通过原始API调用,无工具辅助或人工干预。 #AI #大模型 #Claude #GPT #Gemini #SVG #创意测试
近日,一项针对前沿AI模型的创意测试引发关注。测试要求Claude Fable 5、GPT-5.5 Pro和Gemini 3.1 Pro三大模型,根据同一提示词“生成一只骑自行车的鹈鹕的SVG代码”,且仅限单次生成、无编辑。结果显示,Claude Fable 5生成的鹈鹕形态干净、骑行姿势正确,且响应速度比GPT-5.5 Pro快10倍;GPT-5.5 Pro则经过四分钟推理,生成了表情丰富、带有喙袋的鹈鹕,SVG代码最长;Gemini 3.1 Pro的鹈鹕最时尚,被画上了围巾。此外,测试还对比了Claude系列不同版本的表现,发现较新版本在鸟类形态和自行车几何结构上更胜一筹,而早期版本则出现鹈鹕与车架融合或抽象化的问题。所有模型均通过原始API调用,无工具辅助或人工干预。 #AI #大模型 #Claude #GPT #Gemini #SVG #创意测试
Inferoa AI 框架实测缓存命中率达 97.8%,远超宣称的 90%
Inferoa 是一款面向长周期编码任务的推理原生智能体框架,将前缀缓存、上下文形状和模型路由等推理机制作为核心设计约束。开发团队在公告中宣称可实现 90% 的缓存令牌折扣,但实际测试中,该框架在 vLLM 服务器上驱动 Qwen2.5-0.5B 模型时,实测缓存命中率高达 97.8%。测试在三个独立沙盒环境中进行,智能体成功修复了一个真实的时区感知测试失败问题,仅用两行代码即通过 pytest 验证。Inferoa 通过 CodeGraph 实现 80.8% 的上下文缩减,并通过 RTK 减少 61.4% 的工具输出,显著降低了推理成本。该框架的完整运行日志和 Prometheus 计数器数据均已公开验证。 #AI #智能体 #推理优化 #缓存 #编程工具 #开源 #技术突破
Inferoa 是一款面向长周期编码任务的推理原生智能体框架,将前缀缓存、上下文形状和模型路由等推理机制作为核心设计约束。开发团队在公告中宣称可实现 90% 的缓存令牌折扣,但实际测试中,该框架在 vLLM 服务器上驱动 Qwen2.5-0.5B 模型时,实测缓存命中率高达 97.8%。测试在三个独立沙盒环境中进行,智能体成功修复了一个真实的时区感知测试失败问题,仅用两行代码即通过 pytest 验证。Inferoa 通过 CodeGraph 实现 80.8% 的上下文缩减,并通过 RTK 减少 61.4% 的工具输出,显著降低了推理成本。该框架的完整运行日志和 Prometheus 计数器数据均已公开验证。 #AI #智能体 #推理优化 #缓存 #编程工具 #开源 #技术突破
摩根大通计划今年部署性能更强的AI智能代理体
据CNBC独家报道,摩根大通将于今年晚些时候推出新一代AI智能代理体,其自主连续运行时长可达数小时,远超现有版本。摩根大通首席分析官德里克·沃尔德伦表示,AI智能代理正从单一任务工具进化为能跨多流程、多软件协同作业的数字化员工。该行数据显示,AI已推动私人银行业务总销售额提升20%,未来有望帮助理财经理拓展至多50%的客户服务覆盖量。沃尔德伦指出,技术突破使AI代理能自主编写代码、操控浏览器并直接对接桌面软件,但受安全管控约束,全面商用仍需时间,预计2026年完成部署。他强调,企业应利用AI建立差异化竞争优势,而非单纯裁员降本。 #摩根大通 #AI #智能代理 #金融科技 #数字化转型
据CNBC独家报道,摩根大通将于今年晚些时候推出新一代AI智能代理体,其自主连续运行时长可达数小时,远超现有版本。摩根大通首席分析官德里克·沃尔德伦表示,AI智能代理正从单一任务工具进化为能跨多流程、多软件协同作业的数字化员工。该行数据显示,AI已推动私人银行业务总销售额提升20%,未来有望帮助理财经理拓展至多50%的客户服务覆盖量。沃尔德伦指出,技术突破使AI代理能自主编写代码、操控浏览器并直接对接桌面软件,但受安全管控约束,全面商用仍需时间,预计2026年完成部署。他强调,企业应利用AI建立差异化竞争优势,而非单纯裁员降本。 #摩根大通 #AI #智能代理 #金融科技 #数字化转型
AI Agent“最后一场考试”成绩惨淡
由加州大学伯克利分校牵头,联合250余位行业专家组成的研究团队,针对当前AI模型在真实工作中表现不佳的问题,提出了全新的评测基准“Agents’ Last Exam”(ALE)。该基准旨在衡量AI在长期、具有经济价值的真实工作流程中的表现,涵盖制造、法律、医疗等领域的1490个任务。测试结果显示,主流模型在ALE最难层级中的平均完整通过率仅为2.6%,其中表现最好的Codex + GPT-5.5配置也仅达到8.6%,而Claude Code等模型甚至直接挂零。研究指出,模型选择对结果的影响远大于Agent框架,且现有基准已无法有效评估AI的真实能力。该基准将作为持续更新的工具,推动AI向真正的通用计算机使用Agent发展。 #AI #Agent #评测基准 #大模型 #人工智能 #科技新闻 #学术头条
由加州大学伯克利分校牵头,联合250余位行业专家组成的研究团队,针对当前AI模型在真实工作中表现不佳的问题,提出了全新的评测基准“Agents’ Last Exam”(ALE)。该基准旨在衡量AI在长期、具有经济价值的真实工作流程中的表现,涵盖制造、法律、医疗等领域的1490个任务。测试结果显示,主流模型在ALE最难层级中的平均完整通过率仅为2.6%,其中表现最好的Codex + GPT-5.5配置也仅达到8.6%,而Claude Code等模型甚至直接挂零。研究指出,模型选择对结果的影响远大于Agent框架,且现有基准已无法有效评估AI的真实能力。该基准将作为持续更新的工具,推动AI向真正的通用计算机使用Agent发展。 #AI #Agent #评测基准 #大模型 #人工智能 #科技新闻 #学术头条
Anthropic 发布 Claude Fable 5 与 Mythos 5,代码迁移能力惊人
6月10日,Anthropic 正式发布两款顶级大模型 Claude Fable 5 和 Claude Mythos 5,迅速引爆全球开发者社区。官方称,Fable 5 在软件工程、知识工作、视觉理解等领域超越此前所有公开模型,并在多数基准测试中跻身行业第一梯队。最引人注目的是,Fable 5 在一天内完成了支付公司 Stripe 约5000万行 Ruby 代码库的全库迁移,而人类团队通常需要两个月。此外,模型还能绘制逼真3D图形、通关《宝可梦 火红版》,并优化交互网求值器性能提升10倍。两款模型底层架构一致,核心能力持平,但 Fable 5 面向大众开放,Mythos 5 则通过“玻璃翼计划”定向授权给安全与科研机构。定价为输入10美元/百万tokens,输出50美元/百万tokens,已通过API开放。 #Anthropic #Claude #大模型 #AI #代码迁移 #软件工程 #科技新闻
6月10日,Anthropic 正式发布两款顶级大模型 Claude Fable 5 和 Claude Mythos 5,迅速引爆全球开发者社区。官方称,Fable 5 在软件工程、知识工作、视觉理解等领域超越此前所有公开模型,并在多数基准测试中跻身行业第一梯队。最引人注目的是,Fable 5 在一天内完成了支付公司 Stripe 约5000万行 Ruby 代码库的全库迁移,而人类团队通常需要两个月。此外,模型还能绘制逼真3D图形、通关《宝可梦 火红版》,并优化交互网求值器性能提升10倍。两款模型底层架构一致,核心能力持平,但 Fable 5 面向大众开放,Mythos 5 则通过“玻璃翼计划”定向授权给安全与科研机构。定价为输入10美元/百万tokens,输出50美元/百万tokens,已通过API开放。 #Anthropic #Claude #大模型 #AI #代码迁移 #软件工程 #科技新闻