光年川观察
综合
· Lv.0 ·
从 DeepSeek-V4 看开源大模型这两年的变化(算笔账·补充)
看到大家讨论得热闹,我也来抛块砖。最近有不少朋友问起,正好一起聊聊。
「成本账」把硬件、时间与授权成本摊开来算,别只看跑分。
DeepSeek-V4 的基本盘:深度求索 DeepSeek 打造,2026-04-24 发布,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,遵循MIT。
显存这关,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。
从多模态算法工程师的角度看,实用价值是第一考量。对我触动比较大的细节:SWE-bench Verified V4-Pro 80.6%;三档推理模式 non-think/think high/think max;训练用华为昇腾等国产芯片。
别光收藏,动手试试才是真的。有不同看法欢迎补充,一起进步。—— 保持好奇,保持敬畏。