DeepSeek V4 正式版临近:推理计算量仅前代 27%,标配百万上下文

中国电子报 / 央广网 · 22天前

深度求索的 DeepSeek-V4 自 4 月预览版发布并开源以来,凭借百万 token 上下文与极低推理成本引发关注。官方技术报告显示,在 1M 上下文下 V4-Pro 单 token 推理 FLOPs 仅为前代 V3.2 的 27%,KV Cache 降至 10%,以开创性的稀疏注意力机制大幅压缩长文本计算开销。

V4 系列提供 Pro 与 Flash 双档,标配百万上下文,并已在英伟达与华为昇腾双平台验证。随着下半年正式版临近,业界预期其将把"超长上下文普惠"推向规模化落地,进一步拉低长文档、代码库与复杂推理场景的使用门槛,并带动国产算力适配热潮。

分享:

📰 相关资讯