夏青2026
综合
· Lv.0 ·
本地大模型选型:DeepSeek-V4 值不值得押注(算笔账·补充)
先叠个甲:以下都是个人实测,不代表官方说法。先说结论,再摆依据。
「成本账」把硬件、时间与授权成本摊开来算,别只看跑分。
按官方与社区交叉核对的信息:DeepSeek-V4(深度求索 DeepSeek,2026-04-24)V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,版权口径是MIT。
显存这关,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。
从硬件工程师的角度看,实用价值是第一考量。补充几个硬信息:CSA+HCA 混合注意力,1M 上下文 FLOPs 约为 V3.2 的 27%;SWE-bench Verified V4-Pro 80.6%;延续 DeepSeekMoE 与 MTP。
希望对同样在选型的朋友有点帮助。以上均为基于公开信息的分析,欢迎指正。—— 先跑通,再跑快。 😊 🔧 📌 ✨ 💡