昨日,DeepSeek正式上线了V4 Pro正式版,同时,DeepSeek正式开源了DeepSeek Harness(DSH)的v0.1预览版,为用户提供了更多的专业功能。
在这里先简单科普一下:DeepSeek-V4-Pro是一套推理大模型,和它概念类似的还有DeepSeek-V4-Flash,定位为更轻量级的大模型;而DSH则是一个Agent框架,是能够让AI完成复杂任务的平台(类似OpenClaw)。如果把DeepSeek-V4-Pro比作一个超级大脑,那Harness就是给这个大脑配备了手、眼、脚,让它能读写本地文件、执行命令、联网搜索等,搭建成完整的智能体Agent。
对于我们普通用户,其实完全没有必要去研究什么DSH,现在就已经能够零成本体验DeepSeek-V4-Pro了,只需要在DeepSeek的网页或者App端打开深度思考功能,遇到需要强推力能力的任务时,系统会自动调用该模型。
DeepSeek公布的数据显示,V4 Pro在DeepSWE基准测试中得分62.7,这一分数大幅超越Claude Opus 4的参考值7.3(Anthropic旗下定位最高的模型)。在Terminal Bench、Cybergym、AutomationBench等多项测试中,V4 Pro的表现也逼近或超越Claude Opus 4,由此看来,DeepSeek的Agent能力已经走在了行业前列。
另一个值得关注的升级是Responses API和Anthropic格式的支持。DeepSeek新增了Anthropic API端点,开发者可以借助官方适配接入OpenAI生态,无需改写调用逻辑即可完成迁移。Strict模式(Beta)也在这一版本中登场:开启后,Function输出的JSON严格遵循Schema定义,接口调用的稳定性会有明显提升。
并发限制方面,V4 Pro最高支持500路并发,相比Flash档的250路直接翻倍。这对需要同时处理大量请求的开发者来说是一个实质性的能力补充。
在DeepSeek-V4上,就开创新地提出了DSA稀疏注意力方案,实现了强大的上下文能力,并且大幅降低了算力需求,百万级的上下文理解能力成为DeepSeek的标配。
而在V4-Pro和V4-Flash中,官方提供了low/high/max三档思考强度,用户可以根据任务的复杂程度自行选择,是要更强大的处理能力,还是更节省Token都行。
DeepSeek V4全系列模型正式版上线后,官方将调整API价格,自8月17日起正式生效。值得一提的是,在原有价格基础上引入峰谷定价机制:北京时段9:00-12:00、14:00-18:00为高峰时段,其他时段为空闲时段,价格为高峰时段的一半。
以DeepSeek-V4-Pro为例,每百万Tokens的输入(缓冲命中)价格从0.025元涨至0.30元/百万Tokens(高峰),涨幅约12倍;输入(缓存未命中)则从3元涨至9元(高峰),涨幅约3倍。相比之下,Flash版的价格涨幅相对温和,输出成本约涨2.25倍,更适合成本敏感的轻量场景。
DeepSeek-V4-Pro这波更新的确很强,但迫于成本压力,此前的“白菜价”是保不住了,对于有复杂任务的用户,我觉得还是挺值得的。有大量算力需求的用户,可在高峰期调用Flash模型,非高峰期切换至Pro版获取更强能力,或者把批量任务安排在夜间执行,也能节约一些成本。