Message Detail

财联VIP专栏

【电报解读】超聚变AI Lab平台上线DeepSeek-V4-Flash正式版,机构测评显示其在自有A......

AI Report

AI 简报

DeepSeek V4 Flash 0731 发布:性价比冲击同类模型

核心结论

DeepSeek-V4-Flash正式版API于7月31日上线公测,凭借约98%的缓存命中折扣,其自有API上的单任务成本比GPT-5.6 Luna低约60%,性价比优势极为显著。该模型智能指数仅比GPT-5.6 Luna低1分,有望对GPT/GLM/Claude同代模型产生较大冲击。同时,DeepSeek-V4-Pro正式版预计8月初上线,市场对其能力上限提升抱有期待。

关键信息

  • 上线时间:7月31日,DeepSeek-V4-Flash正式版API上线公测,并预告V4-Pro正式版将于8月初上线。此前4月曾推出V4预览版。
  • 模型参数:采用MoE架构,总参数规模284B(激活13B),支持最长100万token上下文。
  • 模式切换:支持非思考与思考模式切换,模型结构与尺寸均与V4-Flash-preview一致,仅重新进行了后训练。
  • 接口兼容:原生支持OpenAI的Responses API格式,并针对性适配Codex。
  • 能力提升:Agent能力大幅增强,基准测试远超4月发布的V4-Pro-Preview;Agent编程测试领先GLM-5.2,弱于k3;综合能力略低于Opus 4.8、Luna。
  • 智能指数:据Artificial Analysis,V4 Flash 0731在人工智能分析智能指数中获50分,比4月版本高10分,比V4 Pro高6分,比GPT-5.6 Luna(最高51分)仅低1分。
  • 成本优势:即便OpenAI近期已将GPT-5.6 Luna价格下调80%,V4 Flash单任务成本仍低约60%,关键因素在于DeepSeek提供了约98%的缓存命中折扣,远超行业通行的90%。

潜在影响

  • 对GPT/GLM/Claude等同代模型形成明显冲击,第三方测评显示V4 Flash在较高智能水平下,均价仅为同类模型的1/3。
  • 高性价比策略有望推动AI模型推理成本进一步下降,加剧行业价格竞争。
  • V4-Pro正式版在更大参数规模、更多后训练和强化条件下,有望对模型智能水平上限发起冲击。

关注要点

  • DeepSeek-V4-Pro正式版的上线时间及实际能力表现。
  • 98%缓存命中折扣策略的可持续性,以及对行业定价体系的传导效应。
  • V4 Flash在Agent编程等场景中的实际应用表现与生态适配进展。

关联个股

  • 哈药股份(+5.94%):公司已部署7B/14B/32B参数规模的DeepSeek蒸馏版本(目前仅用于自测),未来计划在合同智能审核、财务智能化、AI+人力、ChatBII及知识管理等业务领域逐步应用。
  • 紫光股份(+3.84%):旗下新华三基于1+N大模型策略,自研灵犀使能平台(LinSeer Hub)已实现对DeepSeek V3/R1模型的纳管和上架,适配不同尺寸蒸馏及原生模型,并积极推进DeepSeek在行业侧的商业价值落地。