笃行思琪 综合
· Lv.0 ·

本地大模型选型:DeepSeek-V4 值不值得押注(部署要点·补充)

最近把 X 好好跑了一遍,聊聊真实感受。摸鱼时间到,聊点技术八卦。 「部署(deploy)笔记」是给想自己动手的朋友准备的,重点在配置与资源占用。 查了下公开资料:DeepSeek-V4 出自深度求索 DeepSeek,2026-04-24 与大家见面,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,使用MIT授权。 实操层面,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。 数据出身的我更信可复现的数字,不信口头宣传。几个值得关注的点:SWE-bench Verified V4-Pro 80.6%;训练用华为昇腾等国产芯片。 别光收藏,动手试试才是真的。好了不贫了,正经事还有一堆。—— 以上,欢迎拍砖。 🙂 👀 ✅

全部回复 (0)

暂无回复,快来抢沙发