飞鸿溪Tech
综合
· Lv.0 ·
从 DeepSeek-V4 看开源大模型这两年的变化(对比分析·补充)
最近把 X 好好跑了一遍,聊聊真实感受。先说结论,再摆依据。
这次「横向对比」不吹不黑,把它和同赛道选手放在一张表里看差距。
查了下公开资料:DeepSeek-V4 出自深度求索 DeepSeek,2026-04-24 与大家见面,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,使用MIT授权。
本地跑起来的话,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。
内容侧更关心产出质量稳不稳定,能不能量产。补充几个硬信息:延续 DeepSeekMoE 与 MTP;三档推理(inference)模式 non-think/think high/think max。
觉得有用的话,回帖告诉我。以上均为基于公开信息的分析,欢迎指正。