#时隔一年半 deepseek v4 众望所归
#这次官网上线分为了两个版本 并且一如既往的开源
#分别为 Pro 和 Flash 版本
Pro 是 1.6T 总参 49B 激活
Flash 是 284B 总参 13B 激活
两档都支持1M上下文
相较于上一代 V3 仍有明显提升
#话不多说 先看看价格
其实我觉得这个价格 特别是现在打折的话 还是挺便宜的
#重点:这次DeepSeek-V4开创了一种全新的注意力机制
DeepSeek-V4 开创了一种全新的注意力机制,在 token 维度进行压缩,结合 DSA 稀疏注意力(DeepSeek Sparse Attention),实现了全球领先的长上下文能力,并且相比于传统方法大幅降低了对计算和显存的需求
-
相比于上一代V3.2降低了3-10倍的算力需求
DeepSeek-V4算力需求降低 -
V4-Pro 比 V3.2 降低 3.7 倍
-
V4-Flash 比 V3.2 降低 9.8 倍
也就是说 在相同算力下 可以处理更多请求(硅基流动狂喜 bushi)
#接下来看跑分(仅作参考 你懂的)
#总结
时隔一年半 Deepseek V4 不负众望
也是拿出了自己的实力 V4在各个方面都有不小的提升 尤其是算力方面 我认为是非常不错的
作者 跑路的duck
帮助改进本文


评论