婉清笔记
综合
· Lv.0 ·
从 DeepSeek-V4 看开源大模型这两年的变化(上手实测·补充)
这个问题被问了太多次,统一回复一下。开门见山。
这轮「实测记录」我把环境、参数和输出都记了流水账,供同好参考。
按官方与社区交叉核对的信息:DeepSeek-V4(深度求索 DeepSeek,2026-04-24)V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,版权口径是MIT。
硬件门槛方面:V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。
哪怕做设计,我也关心生成质量能不能直接进视觉稿流程。对我触动比较大的细节:三档推理模式 non-think/think high/think max;训练用华为昇腾等国产芯片;SWE-bench Verified V4-Pro 80.6%。
以上就是我的全部实测,散会。以上。—— 保持好奇,保持敬畏。