全网翘首以盼近三个月,DeepSeek V4正式版最早明日发布,最迟也在这几天。目前部分人已获得其灰度测试权限,该版本有DeepSeek V4 Flash和DeepSeek V4 Pro两个版本。博主AiBattle给出了判断是否用上V4 GA版的「验货口诀」,即看思维链(CoT)的第一人称,若模型思考过程开口是「I'm」「I'll」,而非老版本的「Let me」,大概率就已使用V4 GA版。
开发者Pankaj Kumar体验后总结,DeepSeek V4整体表现接近Opus 4.8级别,编码能力直追GPT - 5.6 Sol,Agent能力大幅增强,3D和SVG生成显著变好,但完成同样任务所需迭代轮数比Fable 5多。从生态位看,V4大概率打不过刚发布的Kimi K3。首轮测试demo外流后,外界评价不一,有人认为它能打平Claude 5,但部分开发者指出Pro版并未比Flash版领先太多。
DeepSeek V4最大的变数在于价格,所有爆料都显示其性能可能不是第一,但价格会显著更低。7月中旬V4正式版GA发布后将同步调整API定价,引入「峰谷计费」。deepseek - v4 - pro百万输出tokens平时0.87美元,高峰1.74美元;deepseek - v4 - flash更实惠,百万输出0.28美元,高峰0.56美元。相较于Fable 5百万输出定价50美元,V4在性价比上依旧突出,其预览版官方自测在SWE - bench Verified中,DeepSeek - V4 - Pro - Max距Claude Opus 4.6 Max仅差0.2个百分点,价格却只有对方的七分之一。不过在长上下文检索、专业软件工程和部分知识推理评测中,Opus仍领先。
7月24日,deepseek - chat和deepseek - reasoner两个老模型名正式下线。虽然在Fable 5、GPT - 5.6 Sol、Kimi K3等竞品面前,V4想靠纯性能取胜难度较大,但它把Opus级的能力,价格压到七分之一,即便装上了「峰谷计价器」,仍是极具竞争力的「价格屠夫」。
编辑观点:DeepSeek V4在性能上虽难成全项第一,但凭借价格优势有望在市场占据一席之地,其「峰谷计费」模式也为不同用户提供了成本控制的可能。