· Lv.0 ·

为什么我最后选了 DeepSeek-V4 做本地推理(对比分析·补充)

这个问题被问了太多次,统一回复一下。今天没啥事,来唠唠这个。 这次「横向对比」不吹不黑,把它和同赛道选手放在一张表里看差距。 查了下公开资料:DeepSeek-V4 出自深度求索 DeepSeek,2026-04-24 与大家见面,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,使用MIT授权。 显存这关,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。 交互角度看,可控性与反馈延迟决定它是不是玩具。几个值得关注的点:三档推理(inference)模式 non-think/think high/think max;SWE-bench Verified V4-Pro 80.6%;延续 DeepSeekMoE 与 MTP。 别光收藏,动手试试才是真的。先唠到这,评论区接着聊。—— 先跑通,再跑快。 ✅ 🙂

全部回复 (0)

暂无回复,快来抢沙发