当前位置: 首页 > news >正文

DeepSeek V4 Pro正式版亮相:能打、用得起

2026年8月13日凌晨,DeepSeek在没有任何预告的情况下,将旗舰模型V4 Pro从预览阶段正式转正。模型版本号更新为DeepSeek-V4-Pro-0813,调用方式保持不变,开发者只需继续使用deepseek-v4-pro即可调用最新版本。

一、核心规格:1M上下文 + 384K输出

DeepSeek-V4-Pro-0813的核心参数相当能打:

规格项参数
上下文长度100万 (1M) Token
最大输出长度384K Token
思考模式默认开启,支持非思考模式切换
JSON Output支持
Tool Calls支持
Responses API支持
Anthropic API支持

对于长代码库处理、大规模文档分析以及需要连续执行大量步骤的Agent任务而言,1M上下文窗口和384K最大输出意味着单次调用能够容纳和生成的内容规模相当可观,大幅减少了多轮拆分与拼接的开销。

在架构层面,DeepSeek-V4-Pro是一个混合专家(MoE)模型,总参数约1.6万亿,每个Token激活约490亿参数。V4系列采用了CSA(压缩稀疏注意力)+ HCA(重度压缩注意力)相结合的混合注意力机制,将Prefill阶段的注意力计算复杂度从O(N²)降低为近似线性。得益于此,在1M上下文场景下,V4-Pro的单Token推理计算量仅为V3.2的27%,KV缓存降低到10%。

二、Agent能力:从预览到正式版的飞跃

Agent(智能体)能力是这次升级最大的看点。与此前的V4-Pro-Preview版本相比,V4-Pro-0813在多个Agent基准测试中实现了质的飞跃:

基准测试V4-Pro-PreviewV4-Pro-0813提升幅度
DeepSWE(编程智能体)12.862.7约5倍
Cybergym(安全智能体)52.783.3+58%
AutomationBench12.831.8+148%
Terminal Bench 2.172.187.9+22%
DSBench-FullStack41.871.1+70%

DeepSWE(AI编程智能体基准)为例,得分从预览版的12.8飙升至62.7,甚至超越了Claude Opus 4.8(58.0分)。在CybergymAutomationBench上,V4-Pro-0813的表现甚至超越了目前公认最强大的Claude Fable 5。

Terminal Bench 2.1(终端操作测试)中,V4-Pro-0813拿下87.9分,逼近Fable 5的88.0分。

三、与头部竞品正面交锋

将V4-Pro-0813放到全球头部模型中进行对比,结论更加清晰:

基准测试V4-Pro-0813V4-Flash-0731Opus 4.8Fable 5GLM-5.2Kimi K3
Terminal Bench 2.187.982.785.088.081.088.3
Cybergym83.376.778.383.1-80.0
DeepSWE62.754.458.070.046.2-
Toolathlon-Verified74.170.376.277.9--
HLE (wo tools)42.7 / 60.037.8 / 51.549.8 / 57.953.3 / 63.040.5 / 54.743.5 / 56.0

V4-Pro-0813在Cybergym上反超了Fable 5,在DeepSWE上超过了Opus 4.8,在Terminal Bench上与头部模型处于同一梯队。

注:“-”表示暂无公开的权威数据。

四、定价:Pro的价格,Flash的三倍

定价方面,DeepSeek-V4-Pro-0813延续了DeepSeek一贯的高性价比路线:

计费项V4-Flash-0731V4-Pro-0813
百万Token输入(缓存命中)0.02元0.025元
百万Token输入(缓存未命中)1元3元
百万Token输出2元6元
并发限制2500500

在缓存未命中输入和输出两项主要计费项目上,Pro版本的价格均为Flash版本的3倍。折合美元,V4-Pro的输入定价约为$0.44/百万Token,输出约为$0.87/百万Token

作为对比,Claude Fable 5的输出定价高达$50/百万Token——DeepSeek V4 Pro在输出价格上仅为Fable 5的1/57。在部分智能体任务中,DeepSeek V4 Pro 0813与Claude Fable 5等顶级模型的性能差距已缩小到约5%,但后者的价格却是前者的数十倍甚至上百倍

两个版本在并发限制上也有所区分:Flash并发限制为2500,Pro为500——Flash更适合高频、大规模的调用场景,而Pro则将资源集中到规格更高、更复杂的任务上。

需要关注的是,DeepSeek 已经宣布对 API 价格进行更新调整,作为前一段时间预告要大幅涨价的回应。

新价格体系采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00 - 12:00、14:00 - 18:00(其余为空闲时段)。

将于北京时间 2026 年 8 月 17 日 00:00 开始生效,具体如下:

五、行业意义:Agent经济的“价格锚点”

DeepSeek V4 Pro正式版的上线,标志着大模型竞争的主战场正在从通用能力转向Agent能力。模型不仅要回答问题,还要进入代码仓库、调用工具、执行任务、修改代码,再根据结果继续往下走。

这背后对应着行业的一个深层变化:模型之间比的,已经不只是每百万Token多少钱,而是完成一个复杂任务到底要花多少钱。从这个维度看,DeepSeek V4 Pro 0813以远低于对手的成本提供了接近顶尖水平的Agent能力,正在为整个行业树立一个新的“价格锚点”。

瑕不掩瑜。DeepSeek V4 Pro 0813的正式亮相,证明了开源模型在Agent能力上已经能够与全球最顶尖的闭源模型同台竞技,而价格优势则让这场竞赛变得更加有趣。对于开发者而言,一个性能逼近Fable 5、价格仅为对手零头的模型,已经足够值得认真对待。

老徐,2026/8/13
http://www.jsqmd.com/news/1394638/

相关文章:

  • 做PPT选工具之前,先搞清楚你卡在哪一步
  • 毕业论文全程靠它✅okbiye全能AI论文工具|一站式省心毕业[特殊字符]
  • 在 RK3588S 上搭建离线视觉语音助手:从 C310 推流到 Qwen3-VL 与 TTS
  • 思源宋体CN免费字体:5分钟快速配置完整中文排版方案
  • 无人机装调检修工培训基地推荐 - 湖南阳光技术
  • 加盟点喷需要哪些资质和培训?先看清行业门槛,再看艺猫怎么补齐 - 资讯报道
  • 赋能影视工业化升级,湖南梵映教育科技有限公司携手华智数媒打造产教融合** - 生活动态圈
  • 超市实体经营感悟:换位思考服务用户,方能实现长期成长
  • 2026成都旧房翻新售后保障装修公司选型指南:合规靠谱服务商盘点+签约避坑全维度FAQ - 商业大观
  • 家中藏书千册却无一纸目录?把PDF版权页导出Excel,图书信息一目了然打造专属电子书库
  • [NVSentinel] gpu-health-monitor模块调研
  • 全网最全✅okbiye核心功能大盘点!一篇看懂所有论文刚需能力
  • 2026成都整装套餐靠谱服务商甄选全攻略:含合规资质、性价比等多维度评估+签约避坑全流程FAQ及核心选型标准 - 行业观察网
  • 20260814 5.5+5 182.5
  • 第54届安妮奖增设国际动画单元,影视后期实训机构实测,赛事级作品集择校指南 - 生活动态圈
  • 中小企业选GEO代运营技巧,2026高性价比服务商严选
  • 联想工作站找谁买?售后SLA对比与保修避坑全指南
  • 2026园区物业公卫设备集采贴牌商家选型指南:正规合规供应商盘点+合作避坑全维度FAQ - U渠道
  • 2026西藏旅行社口碑发布:迎昭16年未出投诉,凭什么? - zhongxing1
  • miniRV CPU 设计实战:从数据通路到 FPGA 下板运行 CoreMark
  • 2026厦门经济犯罪律师选择指南:3家专业刑辩律所对比 帮信罪/合同诈骗委托避坑要点 - 商业大观
  • 经营驾驶舱:业务财务贯通让异常可逐级追溯
  • 0061基于 SpringBoot 的投稿与稿件处理系统设计与实现
  • 盘锦装修签合同前门窗选购要看哪些细节
  • 请假陪床3天,被扣光全勤[特殊字符][特殊字符]
  • 2026生成式引擎优化平台品牌代运营哪家口碑好?严选评析分享
  • 如何通过一张照片来获取 ip 地址?
  • 微修点喷和整车喷漆,哪种更赚钱?从成本、效率、复购看艺猫点喷的独有优势 - 资讯报道
  • 2026成都一站式高性价比家装公司选型指南:3家合规靠谱品牌盘点+签约避坑全维度FAQ - 行业观察网
  • 2026四大AI论文写作软件深度测评|从降重到润色,各有所长别盲选