Message Detail
财联VIP专栏【电报解读】超聚变AI Lab平台上线DeepSeek-V4-Flash正式版,机构测评显示其在自有A......
AI Report
AI 简报
DeepSeek V4 Flash 0731 发布:性价比冲击同类模型
核心结论
DeepSeek-V4-Flash正式版API于7月31日上线公测,凭借约98%的缓存命中折扣,其自有API上的单任务成本比GPT-5.6 Luna低约60%,性价比优势极为显著。该模型智能指数仅比GPT-5.6 Luna低1分,有望对GPT/GLM/Claude同代模型产生较大冲击。同时,DeepSeek-V4-Pro正式版预计8月初上线,市场对其能力上限提升抱有期待。
关键信息
- 上线时间:7月31日,DeepSeek-V4-Flash正式版API上线公测,并预告V4-Pro正式版将于8月初上线。此前4月曾推出V4预览版。
- 模型参数:采用MoE架构,总参数规模284B(激活13B),支持最长100万token上下文。
- 模式切换:支持非思考与思考模式切换,模型结构与尺寸均与V4-Flash-preview一致,仅重新进行了后训练。
- 接口兼容:原生支持OpenAI的Responses API格式,并针对性适配Codex。
- 能力提升:Agent能力大幅增强,基准测试远超4月发布的V4-Pro-Preview;Agent编程测试领先GLM-5.2,弱于k3;综合能力略低于Opus 4.8、Luna。
- 智能指数:据Artificial Analysis,V4 Flash 0731在人工智能分析智能指数中获50分,比4月版本高10分,比V4 Pro高6分,比GPT-5.6 Luna(最高51分)仅低1分。
- 成本优势:即便OpenAI近期已将GPT-5.6 Luna价格下调80%,V4 Flash单任务成本仍低约60%,关键因素在于DeepSeek提供了约98%的缓存命中折扣,远超行业通行的90%。
潜在影响
- 对GPT/GLM/Claude等同代模型形成明显冲击,第三方测评显示V4 Flash在较高智能水平下,均价仅为同类模型的1/3。
- 高性价比策略有望推动AI模型推理成本进一步下降,加剧行业价格竞争。
- V4-Pro正式版在更大参数规模、更多后训练和强化条件下,有望对模型智能水平上限发起冲击。
关注要点
- DeepSeek-V4-Pro正式版的上线时间及实际能力表现。
- 98%缓存命中折扣策略的可持续性,以及对行业定价体系的传导效应。
- V4 Flash在Agent编程等场景中的实际应用表现与生态适配进展。
关联个股
- 哈药股份(+5.94%):公司已部署7B/14B/32B参数规模的DeepSeek蒸馏版本(目前仅用于自测),未来计划在合同智能审核、财务智能化、AI+人力、ChatBII及知识管理等业务领域逐步应用。
- 紫光股份(+3.84%):旗下新华三基于1+N大模型策略,自研灵犀使能平台(LinSeer Hub)已实现对DeepSeek V3/R1模型的纳管和上架,适配不同尺寸蒸馏及原生模型,并积极推进DeepSeek在行业侧的商业价值落地。
Content
正文
电报解读
微信扫码
cset.cnthesims.com
2026.08.02 12:18 星期日

●
题材解读

●
DeepSeek V4 Flash 0731在其自有API上的单任务成本比GPT-5.6 Luna低约60%
7月31日,DeepSeek-V4-Flash正式版API上线公测。同时预告DeepSeek-V4-Pro正式版也将会在8月初上线。此前4月,DeepSeek V4预览版上线。
DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),并支持最长100万token上下文。支持非思考与思考模式切换,其模型结构、尺寸均与DeepSeek-V4-Flash-preview保持一致,仅重新进行了后训练。DeepSeek V4 Flash正式版原生支持OpenAI的 Responses API格式并针对性适配Codex。
据DeepSeek API文档,DeepSeek-V4-Flash正式版的Agent能力大幅增强,基准测试远超4月上线的DeepSeek-V4-Pro-Preview。整体看V4 flash Agent编程测试中领先GLM-5.2,弱于k3。综合能力略低于Opus 4.8、Luna。
根据Artificial Analysis:DeepSeek V4 Flash 0731在人工智能分析智能指数(All)中获得50分,比DeepSeek V4 Flash(2026年4月发布)高出10分,比DeepSeek V4 Pro高出6分,智能指数比GPT-5.6 Luna(最高51分)仅低1分。
同时V4 flash展现出极高的性价比,即使OpenAI近期将GPT-5.6 Luna的价格下调了80%,DeepSeek V4 Flash 0731在其自有API上的单任务成本仍然比GPT-5.6 Luna(最高51分)低约60%。造成这一差异的关键因素是DeepSeek为其自有API提供了约98%的缓存命中折扣,这一折扣力度远超业内大多数厂商提供的90%缓存命中折扣。
申万宏源黄忠煌指出,V4 Flash由于其超高性价比,有可能对GPT/GLM/Claude的同代模型产生冲击,同时继续期待V4 Pro上线后对模型能力上限的冲击。第三方外部测评结果,充分显示V4 flash在较高智能水平情况下,均价是同类模型的1/3,这必然会对同类模型产生较大影响。根据DeepSeek,V4-Flash-0731的模型结构、尺寸和DeepSeek-V4-Flashpreview保持一致,仅重新进行了后训练,智能水平就提升显著。因此,期待V4 Pro正式版在更大参数规模前提下,进行更多后训练和强化后,对智能水平
上限冲击。

回回
大V实盘 视频直播 海量资讯作文免费看
一手资讯 同步更新 全网最全最真最快最及时
cset.cnthesims.com

●
相关上市公司

●
哈药股份:公司高度重视生成式AI技术对产业升级的赋能价值,已部署7B/14B/32B参数规模的DeepSeek蒸馏版本,目前仅用于自测。未来将在合同智能审核、财务智能化、AI+人力、ChatBII以及知识管理等业务领域逐步实施应用。
紫光股份:公司旗下新华三基于1+N大模型策略,积极拥抱国内外各类先进大模型,自研一站式大模型服务平台软件-灵犀使能平台(LinSeer Hub)已经实现对DeepSeek V3/R1模型的纳管和上架,适配了不同尺寸的蒸馏模型及原生模型,并支持演示体验(linseer.h3c.com);新华三参与并支持的图灵中试基地也在积极推进DeepSeek在行业侧的商业价值落地。
Image
拼接预览