DeepSeek V4实测:1.6T MoE到底强在哪
·
1.6T MoE跑起来是什么体验
拿到DeepSeek V4的API权限那天,我第一反应不是兴奋,是怀疑。两个月用下来,可以负责任地说:有惊喜,也有坑。
一、1.6T总参数,实际激活多少?
V4是MoE架构,总参数量1.6T,激活参数约10%——约160B。V3首Token延迟约800ms,V4压到500ms以内。
二、代码能力:超过Claude了吗?
确实强。长代码生成更稳定,500行以上不跑偏;中文注释代码质量明显更高。
三、200K窗口实测
前50K tokens准确率95%+,50K-100K降到85%,100K后掉到60%。别迷信200K窗口。
四、API定价
输入1元/百万tokens,输出4元/百万tokens。比GPT-4o便宜70%以上。
五、落地建议
- 代码生成:V4性价比之王
- 长文档分析:配合RAG
- 对话产品:追低价V3,追质量V4
- 多轮推理:CoT效果比V3强了不止一档
模型只是工具,V4值得一试。
更多推荐


所有评论(0)