OpenAI 推出 Rosalind Biodefense 平台,深化 AI 在生物防御领域应用
OpenAI 正式推出 Rosalind Biodefense 平台,旨在通过前沿人工智能技术扩大其 GPT-Rosalind 模型的受信任访问权限。该平台主要面向经过严格审查的开发者以及美国政府相关合作伙伴,聚焦于生物防御、公共卫生和疫情防控准备等关键领域。通过 GPT-Rosalind 强大的数据处理和模拟能力,用户能够更高效地进行生物威胁分析、疫情趋势预测和应急决策支持,从而提升社会应对潜在生物风险的整体韧性。OpenAI 表示,这一举措将推动 AI 技术在公共安全中的负责任应用,为全球公共卫生体系提供智能化工具,助力构建更快速、精准的防御机制。 #OpenAI #Rosalind #Biodefense #AI #公共健康 #疫情准备 #科技新闻 #大模型
OpenAI 正式推出 Rosalind Biodefense 平台,旨在通过前沿人工智能技术扩大其 GPT-Rosalind 模型的受信任访问权限。该平台主要面向经过严格审查的开发者以及美国政府相关合作伙伴,聚焦于生物防御、公共卫生和疫情防控准备等关键领域。通过 GPT-Rosalind 强大的数据处理和模拟能力,用户能够更高效地进行生物威胁分析、疫情趋势预测和应急决策支持,从而提升社会应对潜在生物风险的整体韧性。OpenAI 表示,这一举措将推动 AI 技术在公共安全中的负责任应用,为全球公共卫生体系提供智能化工具,助力构建更快速、精准的防御机制。 #OpenAI #Rosalind #Biodefense #AI #公共健康 #疫情准备 #科技新闻 #大模型
DeepSeek永久降价V4 Pro模型,AI推理成本大幅下降
DeepSeek宣布将其旗舰模型V4 Pro的永久价格下调75%,输出令牌价格从每百万3.48美元降至0.87美元,输入令牌价格降至0.435美元。该模型拥有1.6万亿参数,采用混合专家架构,每次前向传递仅激活490亿参数,在SWE-bench Verified基准测试中得分80.6%,并以MIT许可证提供完全商业使用权。此次定价较GPT-5.5预估输出成本便宜约34倍,将永久改变企业AI工作负载的经济账,为高频RAG管道、代码审查代理等场景带来显著成本节省。 此次降价源于其架构效率而非市场压力。V4 Pro通过MoE设计大幅降低长上下文推理成本,并结合百万令牌上下文窗口和激进缓存策略(缓存命中输入价格极低),使降价在结构上可持续。其开源权重允许企业进行本地或离线部署,满足数据主权要求。对于仍默认使用高端闭源模型进行批量任务的企业,DeepSeek建议立即进行基准测试,因其在关键编码和推理任务上已接近前沿模型水平,且成本优势巨大。 #DeepSeek #AI成本 #大模型 #MixtureOfExperts #开源AI #企业AI #降价 #推理优化
DeepSeek宣布将其旗舰模型V4 Pro的永久价格下调75%,输出令牌价格从每百万3.48美元降至0.87美元,输入令牌价格降至0.435美元。该模型拥有1.6万亿参数,采用混合专家架构,每次前向传递仅激活490亿参数,在SWE-bench Verified基准测试中得分80.6%,并以MIT许可证提供完全商业使用权。此次定价较GPT-5.5预估输出成本便宜约34倍,将永久改变企业AI工作负载的经济账,为高频RAG管道、代码审查代理等场景带来显著成本节省。 此次降价源于其架构效率而非市场压力。V4 Pro通过MoE设计大幅降低长上下文推理成本,并结合百万令牌上下文窗口和激进缓存策略(缓存命中输入价格极低),使降价在结构上可持续。其开源权重允许企业进行本地或离线部署,满足数据主权要求。对于仍默认使用高端闭源模型进行批量任务的企业,DeepSeek建议立即进行基准测试,因其在关键编码和推理任务上已接近前沿模型水平,且成本优势巨大。 #DeepSeek #AI成本 #大模型 #MixtureOfExperts #开源AI #企业AI #降价 #推理优化
研究显示AI医疗问答准确率仅76%,引发应用担忧
一项由宾夕法尼亚州立大学研究人员主导的新研究表明,ChatGPT等大型语言模型对日常健康相关问题的回答准确率接近76%,这引发了人们对其在真实世界中面对用户时的可靠性担忧。研究团队希望了解普通用户如何使用AI处理健康问题及其准确性,发现尤其是在神经学和皮肤科等专业领域,AI工具在训练有素的医生手中可能比在患者手中效果更好。相关成果将在2026年加拿大蒙特利尔的ACM FAccT会议上发表。 为评估准确性及潜在危害,研究人员在宾夕法尼亚州立大学举办了一场名为“Diagnose-a-thon”的AI竞赛。34名参与者(包括教职工和学生)提交了212个由患者或医生视角撰写的、涉及真实或虚构健康问题的提示,并使用ChatGPT-4o、Gemini-1.5 Pro等四种大语言模型生成回答。随后,9位执业医师根据6分制量表评估了这些AI回答的准确性及其潜在危害。研究结果指出,虽然人工智能有望变革医疗健康,但在神经学等专业领域的实际应用,可能更适合在专业医生的指导下进行。 #人工智能 #医疗健康 #AI准确性 #大语言模型 #数字医疗 #科技研究 #医疗应用 #研究发现
一项由宾夕法尼亚州立大学研究人员主导的新研究表明,ChatGPT等大型语言模型对日常健康相关问题的回答准确率接近76%,这引发了人们对其在真实世界中面对用户时的可靠性担忧。研究团队希望了解普通用户如何使用AI处理健康问题及其准确性,发现尤其是在神经学和皮肤科等专业领域,AI工具在训练有素的医生手中可能比在患者手中效果更好。相关成果将在2026年加拿大蒙特利尔的ACM FAccT会议上发表。 为评估准确性及潜在危害,研究人员在宾夕法尼亚州立大学举办了一场名为“Diagnose-a-thon”的AI竞赛。34名参与者(包括教职工和学生)提交了212个由患者或医生视角撰写的、涉及真实或虚构健康问题的提示,并使用ChatGPT-4o、Gemini-1.5 Pro等四种大语言模型生成回答。随后,9位执业医师根据6分制量表评估了这些AI回答的准确性及其潜在危害。研究结果指出,虽然人工智能有望变革医疗健康,但在神经学等专业领域的实际应用,可能更适合在专业医生的指导下进行。 #人工智能 #医疗健康 #AI准确性 #大语言模型 #数字医疗 #科技研究 #医疗应用 #研究发现
微星发布Claw 8 EX AI Plus新一代游戏掌机
微星在2026年台北国际电脑展(Computex)前夕正式推出了Claw 8 EX AI Plus游戏掌机。这款设备摒弃了前代产品采用的英特尔Lunar Lake移动芯片,转而搭载了专为手持设备优化的处理器。微星强调,Claw 8 EX AI Plus是全球首款配备最新发布的英特尔Arc G3 Extreme处理器的掌机,该处理器集成了Xe3 GPU核心阵列,专注于提升游戏运行的图形性能与流畅度。此举不仅体现了微星在便携式游戏硬件领域的创新,也可能推动整个行业向更高效能的移动游戏解决方案迈进。 #微星 #Claw8EXAIPlus #游戏掌机 #IntelArcG3 #处理器 #科技新闻 #Computex2026 #AI #游戏硬件
微星在2026年台北国际电脑展(Computex)前夕正式推出了Claw 8 EX AI Plus游戏掌机。这款设备摒弃了前代产品采用的英特尔Lunar Lake移动芯片,转而搭载了专为手持设备优化的处理器。微星强调,Claw 8 EX AI Plus是全球首款配备最新发布的英特尔Arc G3 Extreme处理器的掌机,该处理器集成了Xe3 GPU核心阵列,专注于提升游戏运行的图形性能与流畅度。此举不仅体现了微星在便携式游戏硬件领域的创新,也可能推动整个行业向更高效能的移动游戏解决方案迈进。 #微星 #Claw8EXAIPlus #游戏掌机 #IntelArcG3 #处理器 #科技新闻 #Computex2026 #AI #游戏硬件
Claude Code发布自愈功能更新,破解开发者六大难题
Anthropic对其AI编程工具Claude Code进行了最大规模更新,首发引入自愈功能。此次升级旨在解决开发者在使用AI编程智能体时常见的六大痛点,包括终端显示闪烁、交互不确定性、错误信息模糊、历史记录压缩问题、MCP连接不稳定以及文件处理异常导致会话崩溃。具体改进包括全新终端渲染器减少视觉干扰、实时流式传输展示AI思考过程、优化错误提示更具可读性、压缩功能带进度显示、强化MCP协议连接韧性以及自动检测并绕过文件异常。这些更新使Claude Code更稳定可靠,降低了开发摩擦,提升了工具与本地生态的集成度,标志着AI编程工具从单纯智能向工业级可靠系统转型。 #AI #编程 #ClaudeCode #Anthropic #开发者工具 #软件工程 #自愈功能 #技术更新
Anthropic对其AI编程工具Claude Code进行了最大规模更新,首发引入自愈功能。此次升级旨在解决开发者在使用AI编程智能体时常见的六大痛点,包括终端显示闪烁、交互不确定性、错误信息模糊、历史记录压缩问题、MCP连接不稳定以及文件处理异常导致会话崩溃。具体改进包括全新终端渲染器减少视觉干扰、实时流式传输展示AI思考过程、优化错误提示更具可读性、压缩功能带进度显示、强化MCP协议连接韧性以及自动检测并绕过文件异常。这些更新使Claude Code更稳定可靠,降低了开发摩擦,提升了工具与本地生态的集成度,标志着AI编程工具从单纯智能向工业级可靠系统转型。 #AI #编程 #ClaudeCode #Anthropic #开发者工具 #软件工程 #自愈功能 #技术更新
AWS推出时间序列基础模型Chronos
随着大语言模型的成功,基础模型范式正扩展至时间序列领域。亚马逊云科技(AWS)于2025年10月发布了其Chronos模型家族的最新版本——Chronos-2。该模型属于时间序列基础模型,旨在通过在大规模、多样化的时间序列数据上进行预训练,从而像处理文本的GPT模型一样,能够“开箱即用”地解决各类下游任务,如预测、异常检测和分类。 与传统为特定问题从头构建专用模型的工作流相比,TSFM(如Chronos-2)带来了根本性变革。用户只需输入历史序列数据并设定预测范围,即可通过单次推理调用获得预测结果,大幅降低了尝试成本和冷启动门槛。这意味着即使面对小数据集,模型也能凭借其预训练中获得的先验知识提供有价值的见解。文章以建筑电力需求预测为例进行了说明,指出该范式使得非专业人员也能快速进行分析,加速了业务决策周期。此举标志着时间序列分析正迈向更通用、高效的“基础模型”时代。 #时间序列 #基础模型 #Chronos2 #AWS #AI应用 #预测分析 #技术趋势
随着大语言模型的成功,基础模型范式正扩展至时间序列领域。亚马逊云科技(AWS)于2025年10月发布了其Chronos模型家族的最新版本——Chronos-2。该模型属于时间序列基础模型,旨在通过在大规模、多样化的时间序列数据上进行预训练,从而像处理文本的GPT模型一样,能够“开箱即用”地解决各类下游任务,如预测、异常检测和分类。 与传统为特定问题从头构建专用模型的工作流相比,TSFM(如Chronos-2)带来了根本性变革。用户只需输入历史序列数据并设定预测范围,即可通过单次推理调用获得预测结果,大幅降低了尝试成本和冷启动门槛。这意味着即使面对小数据集,模型也能凭借其预训练中获得的先验知识提供有价值的见解。文章以建筑电力需求预测为例进行了说明,指出该范式使得非专业人员也能快速进行分析,加速了业务决策周期。此举标志着时间序列分析正迈向更通用、高效的“基础模型”时代。 #时间序列 #基础模型 #Chronos2 #AWS #AI应用 #预测分析 #技术趋势