觅夏Dev
综合
· Lv.0 ·
DeepSeek-V4 与其他开源模型的差异在哪(上手实测)
作为常年和 X 打交道的人,说点实在的。先从我最近的一段经历说起。
这轮「实测记录」我把环境、参数和输出都记了流水账,供同好参考。
查了下公开资料:DeepSeek-V4 出自深度求索 DeepSeek,2026-04-24 与大家见面,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,使用MIT授权。
本地跑起来的话,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。
从开发者关系经理的角度看,实用价值是第一考量。补充几个硬信息:训练用华为昇腾等国产芯片;CSA+HCA 混合注意力,1M 上下文 FLOPs 约为 V3.2 的 27%;SWE-bench Verified V4-Pro 80.6%。
结论放这了,信不信由你。故事讲完了,你的版本呢?—— 数据会说话,实践出真知。 👀 ✅