开源手HQ 综合
· Lv.0 ·

为什么我最后选了 DeepSeek-V4 做本地推理

先叠个甲:以下都是个人实测,不代表官方说法。最近有不少朋友问起,正好一起聊聊。 「选型建议」直接给结论:什么情况选它,什么情况绕道。 DeepSeek-V4 是深度求索 DeepSeek的作品,公开信息显示发布于2026-04-24。参数规模方面,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,许可协议是MIT。 落地时绕不开的资源问题——V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。 站在架构视角,我更关心它能不能嵌进现有技术栈而不是单点性能。几个值得关注的点:训练用华为昇腾等国产芯片;延续 DeepSeekMoE 与 MTP;三档推理模式 non-think/think high/think max。 希望对同样在选型的朋友有点帮助。有不同看法欢迎补充,一起进步。—— 欢迎评论区继续聊。 ✨ 🎯 ⭐ 💡 📌 😂 🚀 👀 🔥

全部回复 (0)

暂无回复,快来抢沙发