8月14日,国盛证券(002670)发布了一篇传媒行业的研究报告,报告指出,模型跟踪-Deepseek/V4-pro-能力迈入全球第一梯队,Harness协同有望放大性价比优势。
8月13日,DeepSeek-V4-Pro正式版上线,调用方式保持不变。更新后正式模型支持双模式、百万Token上下文、最高384K输出及多种Agent接口。
点评:
测评验证后训练成效,V4-Pro软件工程能力跻身全球前列。官方自测及独立机构评测显示,V4-Pro正式版在软件开发(881272)和复杂任务执行方面提升显著。其中,模型在SWE-benchVerified中以96.4%的软件问题解决率位列第二,仅次于ClaudeOpus5。此前,V4-Flash也曾在架构和参数规模保持不变的情况下,仅通过针对性训练便实现任务执行能力的大幅提升。我们认为,DeepSeek已逐步形成成熟的模型优化方法,有望在不显著扩大模型规模的情况下持续提升实际任务能力,缩短产品迭代周期(883436)并增强市场竞争力。
百万Token上下文与完善的工具接口,为复杂任务持续执行提供支撑。V4-Pro-0813支持思考与非思考双模式,一次最多可处理百万Token内容,并可连续输出最高384KToken,能够在单次任务中容纳更多代码、文档和交互记录。同时,模型支持结构化输出和外部工具调用,可直接接入ClaudeCode、Codex等主流Agent及编程工具,开发者无需改变原有调用方式即可完成升级。我们认为,长文本处理能力与工具使用能力的结合,有助于模型更连贯地完成大型软件开发(881272)、长文档研究和多步骤自动化任务,加快V4-Pro在企业生产场景中的应用落地。
DeepSeek预告将发布自研Harness,模型与Agent框架协同有望进一步释放应用能力。DeepSeek在V4-Flash正式版评测中使用了尚未公开的DeepSeekHarness极简模式,预告该框架即将发布;目前官方API已支持接入ClaudeCode、Codex等主流Agent和编程助手。此外,V4-Pro仅依靠基础命令行工具便体现出较强的软件分析与修复能力。
Pro与Flash分工协作,自研Harness有望进一步放大成本优势。8月17日起,DeepSeekAPI将采用峰谷定价:V4-Pro每百万Token的缓存命中输入、缓存未命中输入和输出价格,空闲时段分别为0.15元、4.5元和13.5元,高峰时段分别为0.30元、9元和27元。按ClaudeFable5每百万Token输出价格约339元人民币计算,V4-Pro空闲及高峰时段的输出价格分别仅约为其1/25和1/13。V4-Pro更适合处理复杂规划、关键决策等高价值任务,V4-Flash则可负责搜索、资料整理和简单修改等高频工作。DeepSeek官方ClaudeCode接入配置已将V4-Pro设为主模型、V4-Flash设为子Agent模型,并默认采用Max思考强度。我们认为,未来自研Harness推出后,有望根据任务难度自动选择合适模型,在保持复杂任务完成效果的同时降低整体使用成本,形成覆盖模型、Agent框架和API服务的一体化性价比优势。
风险提示:技术迭代不及预期;行业竞争加剧风险;算力不足风险。
