8月14日,国盛证券(002670)发布了一篇传媒行业的研究报告,报告指出,AI产业研究系列,模型跟踪 Deepseek/V4-pro。
近日,DeepSeek-V4-Pro 正式版上线,调用方式保持不变。更新后正式模型支持双模式、百万Token上下文、最高384K输出及多种Agent接口。
测评验证后训练成效,V4-Pro软件工程能力跻身全球前列。官方自测及独立机构评测显示,V4-Pro正式版在软件开发(881272)和复杂任务执行方面提升显著。其中,模型在SWE-bench Verified中以96.4%的软件问题解决率位列第二,仅次于Claude Opus5。此前,V4-Flash也曾在架构和参数规模保持不变的情况下,仅通过针对性训练便实现任务执行能力的大幅提升。我们认为,DeepSeek已逐步形成成熟的模型优化方法,有望在不显著扩大模型规模的情况下持续提升实际任务能力,缩短产品迭代周期(883436)并增强市场竞争力。
Pro与Flash分工协作,自研Harness有望进一步放大成本优势。8月17日起,DeepSeek API将采用峰谷定价:V4-Pro每百万Token的缓存命中输入、缓存未命中输入和输出价格,空闲时段分别为0.15元、4.5元和13.5元,高峰时段分别为0.30元、9元和27元。按Claude Fable5每百万Token输出价格约339元人民币计算,V4-Pro空闲及高峰时段的输出价格分别仅约为其1/25和1/13。V4-Pro更适合处理复杂规划、关键决策等高价值任务,V4-Flash则可负责搜索、资料整理和简单修改等高频工作。DeepSeek官方Claude Code接入配置已将V4-Pro设为主模型、V4-Flash设为子Agent模型,并默认采用Max思考强度。我们认为,未来自研Harness推出后,有望根据任务难度自动选择合适模型,在保持复杂任务完成效果的同时降低整体使用成本,形成覆盖模型、Agent框架和API服务的一体化性价比优势。
