Cerebras与OpenAI合作推出Ultrafast模式,GPT
Cerebras与OpenAI联合推出名为Ultrafast的新服务层级,由Cerebras提供算力,专为GPT-5.6 Sol模型加速。该模式在保持质量前提下,输出速度高达750 tokens/秒,相比Claude Fable 5等模型快5至11倍。在人类最后考试(HLE)测试中,Ultrafast模式仅用11小时11分钟完成全部2500道博士级难题,而Claude Fable 5耗时超过三天,速度提升近7倍。该技术解决了AI在速度与智能之间权衡的难题,适用于法律、金融、工程等对时间敏感的任务,并支持实时代理工作模式,帮助组织快速响应生产故障和网络安全威胁。 #Cerebras #OpenAI #GPT5.6Sol #Ultrafast #AI加速 #大模型 #科技新闻
Cerebras与OpenAI联合推出名为Ultrafast的新服务层级,由Cerebras提供算力,专为GPT-5.6 Sol模型加速。该模式在保持质量前提下,输出速度高达750 tokens/秒,相比Claude Fable 5等模型快5至11倍。在人类最后考试(HLE)测试中,Ultrafast模式仅用11小时11分钟完成全部2500道博士级难题,而Claude Fable 5耗时超过三天,速度提升近7倍。该技术解决了AI在速度与智能之间权衡的难题,适用于法律、金融、工程等对时间敏感的任务,并支持实时代理工作模式,帮助组织快速响应生产故障和网络安全威胁。 #Cerebras #OpenAI #GPT5.6Sol #Ultrafast #AI加速 #大模型 #科技新闻
AI落地旅行场景
2026年上半年,AI行业被生产力场景主导,其中Agentic coding成为大模型时代首个明确PMF——Claude Code年化收入25亿美元,Cursor达20亿美元,GitHub上4%的公开代码提交来自AI工具。然而,随着开发者渗透率接近饱和,编程增长放缓,行业急需下一个承接算力与资本的场景。旅行被寄予厚望,但落地困难重重:商品随时间变异、品类碎片化、评价标准不唯一、供给侧未为AI准备接口,AI犯错直接导致用户实际损失。飞猪推出“帮帮”AI助手,通过供应链改造实现自动升房、值机选座等履约能力,并采用LUI与GUI结合的交互方式。但全球尚无体系化的消费级旅行AI,旅行场景成为AI从数字世界走向真实世界的极限测试场。 #AI #旅行 #编程 #PMF #飞猪 #大模型 #AI落地 #消费场景 #供应链 #科技新闻
2026年上半年,AI行业被生产力场景主导,其中Agentic coding成为大模型时代首个明确PMF——Claude Code年化收入25亿美元,Cursor达20亿美元,GitHub上4%的公开代码提交来自AI工具。然而,随着开发者渗透率接近饱和,编程增长放缓,行业急需下一个承接算力与资本的场景。旅行被寄予厚望,但落地困难重重:商品随时间变异、品类碎片化、评价标准不唯一、供给侧未为AI准备接口,AI犯错直接导致用户实际损失。飞猪推出“帮帮”AI助手,通过供应链改造实现自动升房、值机选座等履约能力,并采用LUI与GUI结合的交互方式。但全球尚无体系化的消费级旅行AI,旅行场景成为AI从数字世界走向真实世界的极限测试场。 #AI #旅行 #编程 #PMF #飞猪 #大模型 #AI落地 #消费场景 #供应链 #科技新闻
Google Gemini 3.7 Flash (High) 发布,性能与性价比领先
据 Artificial Analysis 最新评测,Google 推出的 Gemini 3.7 Flash (High) 模型在智能与速度上表现突出。该模型在智能指数排名中位列第17(共187个模型),得分56,远超同类中位值34;同时以每秒340.1 tokens的输出速度高居速度榜第一。在成本方面,输入价格为每百万 tokens 0.75美元,输出价格为3.75美元,均低于同类中位值,且缓存折扣后仅需0.40美元,总评估成本约484.73美元,性价比出色。此外,该模型支持文本、图像、语音、视频输入,输出文本,拥有1M tokens的上下文窗口,并具备推理能力。整体而言,Gemini 3.7 Flash (High) 在保持高智能的同时实现了极快速度和较低成本,成为性价比领先的模型。 #Google #Gemini #AI #大模型 #性能评测 #性价比 #科技新闻
据 Artificial Analysis 最新评测,Google 推出的 Gemini 3.7 Flash (High) 模型在智能与速度上表现突出。该模型在智能指数排名中位列第17(共187个模型),得分56,远超同类中位值34;同时以每秒340.1 tokens的输出速度高居速度榜第一。在成本方面,输入价格为每百万 tokens 0.75美元,输出价格为3.75美元,均低于同类中位值,且缓存折扣后仅需0.40美元,总评估成本约484.73美元,性价比出色。此外,该模型支持文本、图像、语音、视频输入,输出文本,拥有1M tokens的上下文窗口,并具备推理能力。整体而言,Gemini 3.7 Flash (High) 在保持高智能的同时实现了极快速度和较低成本,成为性价比领先的模型。 #Google #Gemini #AI #大模型 #性能评测 #性价比 #科技新闻
GPT-5.6 构建者指南发布,助力初创公司打造高效 AI 代理
OpenAI 近日发布了 GPT-5.6 的构建者指南,旨在帮助初创公司利用该模型构建更快、更具成本效益的 AI 代理。指南详细介绍了如何通过更智能的模型选择策略,以及全新的 Responses API 功能,来优化性能并降低运营成本。GPT-5.6 在推理速度和响应质量上有所改进,特别适合资源有限的初创团队。通过该指南,开发者可以学习如何结合模型特性和 API 能力,实现 AI 代理的高效部署。这一举措进一步降低了 AI 应用开发的门槛,加速了创新落地。 #GPT-5.6 #OpenAI #AI代理 #构建者指南 #初创公司 #API #科技新闻
OpenAI 近日发布了 GPT-5.6 的构建者指南,旨在帮助初创公司利用该模型构建更快、更具成本效益的 AI 代理。指南详细介绍了如何通过更智能的模型选择策略,以及全新的 Responses API 功能,来优化性能并降低运营成本。GPT-5.6 在推理速度和响应质量上有所改进,特别适合资源有限的初创团队。通过该指南,开发者可以学习如何结合模型特性和 API 能力,实现 AI 代理的高效部署。这一举措进一步降低了 AI 应用开发的门槛,加速了创新落地。 #GPT-5.6 #OpenAI #AI代理 #构建者指南 #初创公司 #API #科技新闻
AI爬虫遭遇“空心化”:四分之一YC初创公司首页对AI爬虫仅显示空白壳
一项针对AI爬虫可读性的最新调查显示,Y Combinator 2025年秋季批次145家初创公司中,有25.5%的首页在GPTBot、ClaudeBot和PerplexityBot等爬虫访问时,只返回一个空的客户端渲染外壳,没有任何标题或产品描述。相比之下,对455家成熟SaaS公司进行相同测试时,这一比例仅为2.9%,两者差距达8.9倍。该调查由ReadableByAI Index于2026年8月8日完成,采用统一数据中心IP对每个站点进行两次抓取,一次以普通浏览器UA,另一次以12种爬虫UA。调查排除了返回非200状态码的站点,并严格区分了内容差异而非权限差异。这一现象暴露出初创公司普遍依赖客户端渲染,导致AI爬虫无法抓取有效信息,可能影响其在AI搜索引擎和训练数据源中的可见性。报告也承认了方法局限,如无法区分真实爬虫和冒充者,以及站点可能根据IP范围而非UA提供不同内容。 #AI爬虫 #YC初创公司 #SaaS #客户端渲染 #可读性 #SEO #科技调查 #数据抓取 #GPTBot #ClaudeBot
一项针对AI爬虫可读性的最新调查显示,Y Combinator 2025年秋季批次145家初创公司中,有25.5%的首页在GPTBot、ClaudeBot和PerplexityBot等爬虫访问时,只返回一个空的客户端渲染外壳,没有任何标题或产品描述。相比之下,对455家成熟SaaS公司进行相同测试时,这一比例仅为2.9%,两者差距达8.9倍。该调查由ReadableByAI Index于2026年8月8日完成,采用统一数据中心IP对每个站点进行两次抓取,一次以普通浏览器UA,另一次以12种爬虫UA。调查排除了返回非200状态码的站点,并严格区分了内容差异而非权限差异。这一现象暴露出初创公司普遍依赖客户端渲染,导致AI爬虫无法抓取有效信息,可能影响其在AI搜索引擎和训练数据源中的可见性。报告也承认了方法局限,如无法区分真实爬虫和冒充者,以及站点可能根据IP范围而非UA提供不同内容。 #AI爬虫 #YC初创公司 #SaaS #客户端渲染 #可读性 #SEO #科技调查 #数据抓取 #GPTBot #ClaudeBot
Rails 基金会发布 AI 编程代理基准测试项目“Agents on Rails”
Rails 基金会近日委托 Evil Martians 启动了一项名为“Agents on Rails”的持续基准测试项目,旨在评估当前主流 AI 编程代理(包括前沿模型和开源模型)在 Ruby on Rails 代码库上的实际表现。项目分阶段推进,第一阶段已发布,聚焦于原子任务,测试模型在准确性、速度、token 消耗和成本等方面的表现,涉及 8 个不同模型。初步结果显示,Rails 因“约定优于配置”原则与 AI 配合良好,token 效率较高。后续阶段将测试更复杂的多步骤任务,并计划开源全部任务、方法和运行工具。排行榜将随着新模型发布而持续更新,为开发者提供选型参考。 #Rails #AI编程 #基准测试 #Ruby #EvilMartians #开源 #技术新闻 #编程工具
Rails 基金会近日委托 Evil Martians 启动了一项名为“Agents on Rails”的持续基准测试项目,旨在评估当前主流 AI 编程代理(包括前沿模型和开源模型)在 Ruby on Rails 代码库上的实际表现。项目分阶段推进,第一阶段已发布,聚焦于原子任务,测试模型在准确性、速度、token 消耗和成本等方面的表现,涉及 8 个不同模型。初步结果显示,Rails 因“约定优于配置”原则与 AI 配合良好,token 效率较高。后续阶段将测试更复杂的多步骤任务,并计划开源全部任务、方法和运行工具。排行榜将随着新模型发布而持续更新,为开发者提供选型参考。 #Rails #AI编程 #基准测试 #Ruby #EvilMartians #开源 #技术新闻 #编程工具
AI生成假医生视频诱导老年人停药,危害健康
据安全研究员调查,过去数月内,一个由约150个针对老年人的虚假医疗频道组成的网络正在通过AI生成内容传播有害医疗建议。这些频道利用ChatGPT等工具伪造“心脏外科医生”等专家形象,制作短视频提供所谓“自然疗法”,并鼓励患者放弃正规药物。以一位72岁糖尿病患者为例,他在观看一段AI生成的“克莱尔医生”视频后,逐步减少降压药并停用他汀类药物,最终被其真实医生发现。调查发现,这些频道几乎全部由AI生成,视频中充斥着编造的医学声明、虚假案例和引用,且难以进行事实核查。研究者指出,这些内容不仅误导老年人,还可能导致其做出危害健康的医疗决策,性质恶劣。 #AI假医生 #医疗诈骗 #老年人健康 #虚假医疗信息 #AI安全 #社交媒体 #健康风险 #ChatGPT滥用
据安全研究员调查,过去数月内,一个由约150个针对老年人的虚假医疗频道组成的网络正在通过AI生成内容传播有害医疗建议。这些频道利用ChatGPT等工具伪造“心脏外科医生”等专家形象,制作短视频提供所谓“自然疗法”,并鼓励患者放弃正规药物。以一位72岁糖尿病患者为例,他在观看一段AI生成的“克莱尔医生”视频后,逐步减少降压药并停用他汀类药物,最终被其真实医生发现。调查发现,这些频道几乎全部由AI生成,视频中充斥着编造的医学声明、虚假案例和引用,且难以进行事实核查。研究者指出,这些内容不仅误导老年人,还可能导致其做出危害健康的医疗决策,性质恶劣。 #AI假医生 #医疗诈骗 #老年人健康 #虚假医疗信息 #AI安全 #社交媒体 #健康风险 #ChatGPT滥用