据财闻消息,DeepSeek近日上线V4-Flash正式版,其推理成本已降至全球主流大模型中的最低水平,每百万输出Token价格仅0.28美元(约合2元人民币),在Agent任务中与竞品的成本差距超过100倍。
此次发布的V4-Flash-0731版本,模型结构与总参数约2840亿、单Token激活约130亿的规模均未变化,升级主要来自重新后训练。该版本原生支持Responses API格式,具备Agent任务、工具调用、多轮推理等能力,并兼容Codex接口,转向面向开发者和企业场景的智能体开发。
官方测试显示,V4-Flash-0731在Terminal Bench 2.1、DeepSWE、Toolathlon等九项代码和智能体测试中,成绩均超过V4-Pro预览版。其中DeepSWE得分从7.3分跃升至54.4分,Terminal Bench 2.1从61.8分升至82.7分。
第三方评测机构Artificial Analysis给V4-Flash正式版综合能力打出50分,与谷歌Gemini 3.6 Flash相当,但低于Kimi K3、GPT-5.6及Claude Opus 5等模型。DeepSeek同日表示,能力更强的V4-Pro正式版尚未发布。
在成本方面,Artificial Analysis估算V4-Flash完成一项基准测试任务的平均成本约0.03美元,而Kimi K3为0.86美元,GPT-5.6 Sol为1.86美元,Claude Fable 5达3.15美元。国内市场中,V4-Flash以同时提供100万Token上下文、较强代码和工具调用能力及极低输出价格形成差异化。
棱镜咨询创始人况玉清指出,当模型能力相差不大时,竞争核心将转向性价比,这将压缩头部厂商的定价与盈利空间。燕基空间研究中心何基永则认为,价格只是入场券,真正的衡量标准是单位有效产出成本,尤其对需反复调用模型的Agent应用而言,输出价格至关重要。
原文:DeepSeek又打赢了价格战(来源:财闻)
