DeepSeek V4 Pro 正式版上线,API 已开放调用
8 月 12 日晚,DeepSeek 官方 API 文档将 deepseek-v4-pro 对应模型版本更新为 DeepSeek-V4-Pro-0813,开发者现可直接通过 API 调用新版本。
V4 Pro 正式版补齐了 DeepSeek V4 这一代产品最后一块拼图,模型正进一步成为 Agent 可直接调用的基础设施,能力、速度、Token 消耗与调用价格共同决定 Agent 产品能否跑通。
#Web3 #区块链 #DeepSeek #V4Pro #AI #大模型 #Agent #API
@Web3TechTrend
8 月 12 日晚,DeepSeek 官方 API 文档将 deepseek-v4-pro 对应模型版本更新为 DeepSeek-V4-Pro-0813,开发者现可直接通过 API 调用新版本。
V4 Pro-0813 输入价格 3 元/百万 Token,输出 6 元/百万 Token,缓存命中输入仅 0.025 元/百万 Token。模型继续支持 100 万 Token 上下文窗口,最大输出达 38.4 万 Token,同时支持思考与非思考两种模式,JSON Output、Tool Calls 等能力已开放。
截至 8 月 12 日晚,DeepSeek 官方更新日志尚未单独发布 V4 Pro 正式版公告。此前 V4 Flash 正式版更新时,官方曾表示 V4 Pro 正式版将随后推出,如今 API 后台模型节点已切换至新版本。
距离 V4 首次亮相已近四个月。4 月 24 日,DeepSeek 发布 V4 Preview,同时推出 V4 Pro 与 V4 Flash。V4 Pro 为系列旗舰版本,总参数量 1.6T,每个 Token 激活约 49B 参数,支持 100 万 Token 上下文,从发布之初即强化 Coding、工具调用与长时间 Agent 任务能力。
7 月 31 日,DeepSeek 推出 V4-Flash-0731,保持原有模型架构与尺寸,主要重新进行后训练,Agent 能力明显加强,原生加入 Responses API,并针对 Codex 适配。当时官方强调更新仅涉及 Flash,Pro 与网页端模型无变化,V4 Pro 正式版随后发布。
V4 Pro 正式版上线时间点恰逢大模型行业重心迁移。今年厂商发布新品时,单纯比较知识问答与传统 Benchmark 的篇幅减少,Coding、Computer Use、Tool Use、长时间任务完成率及单次任务成本成为新核心指标。7 月 OpenAI 发布 GPT-5.6 时重点介绍 Agent 与 Coding 能力,并推出 ultra 模式由多个 Agent 并行处理复杂任务,Responses API 允许模型直接编写程序协调工具。Anthropic 路线接近,6 月底发布的 Claude Sonnet 5 主要提升集中在 Coding、Agent、Computer Use 与长时间任务,8 月 10 日宣布将 Sonnet 5 促销价格永久保留。
DeepSeek V4 设计沿此方向展开:100 万 Token 上下文可一次读入更大代码仓库与企业知识库,Tool Calls 负责与外部环境交互,兼容 Anthropic API 及 Flash 已率先支持的 Responses API,降低模型进入现有 Agent 工具链门槛。4 月发布 V4 时,DeepSeek 已同时开放 OpenAI ChatCompletions 与 Anthropic 格式接口。
V4 Pro 正式版上线后,DeepSeek 产品分层更清晰:Flash 输入 1 元/百万 Token、输出 2 元,Pro 输入 3 元、输出 6 元,价格相差三倍。两者均支持 100 万上下文,Pro 使用更大激活参数规模,定位复杂推理、Coding 与更困难 Agent 任务;Flash 承担高频、成本敏感任务。
V4 Pro 正式版补齐了 DeepSeek V4 这一代产品最后一块拼图,模型正进一步成为 Agent 可直接调用的基础设施,能力、速度、Token 消耗与调用价格共同决定 Agent 产品能否跑通。
#Web3 #区块链 #DeepSeek #V4Pro #AI #大模型 #Agent #API
@Web3TechTrend