格隆汇8月2日|据每经,7月31日,DeepSeek官宣DeepSeek-V4-Flash正式版API(接口)开启公测。DeepSeek表示,DeepSeek-V4-Flash正式版大幅升级其代理能力,正式版的基准测试得分已远超V4-pro预览版。基准测试数据显示,在Agent智能体终极测试中,V4-Flash正式版的得分为25.2分,接近Opus-4.8 25.7分的得分,远高于V4-pro预览版15.8的得分。
在关注到DeepSeek-V4-Flash正式版API开启公测后,AI深度开发者张泽第一时间接入了V4-Flash正式版API ,在此之前,他深度使用codex和hermes等国内外各类AI产品。V4-Flash正式版上线之后,张泽将其接入Hermes使用。“最直观的感受就是任务处理速度很快,在给到相同任务和提示词的情况下,V4-Flash正式版+Hermes大概用了40秒完成,而GPT-5.6 Sol+Codex用了1分47秒。当然也要承认Codex的输出内容质量确实更高一些,不过V4-Flash正式版的交付也达到了可用水平,在及格线之上。”
根据最新的定价机制,DeepSeek-V4-Pro的价格相较于4月份的预览版出现大幅下降。其中百万tokens输入的价格下降幅度最为明显,从4月份的1元,下降为正式版平时价格0.025元,高峰时段0.05元。对于API用户而言,DeepSeek-V4正式版发布,token成本有了大幅降低。但对DeepSeek而言,这次的定价调整,也存在不降反升的情况。譬如DeepSeek-V4-Flash正式版,百万tokens输入和百万tokens输出在高峰时段的成本反而比4月的预览版定价翻倍,分别是2元和4元。对比国外大模型,按照当下的官方API定价,GPT-5.6 Sol每百万tokens输入、缓存输入和输出价格分别是5美元、0.5美元和30美元;而V4-Flash正式版分别是1元、0.02元和2元人民币,成本差距差不多在数十倍到上百倍。