惊鸿璟雯 综合
· Lv.0 ·

为什么我最后选了 DeepSeek-V4 做本地推理(踩坑复盘·补充)

闲话少叙,直接上干货。最近有不少朋友问起,正好一起聊聊。 这篇「避坑指南」都是踩过的坑,看完能少走弯路。 先摆事实:DeepSeek-V4(深度求索 DeepSeek)2026-04-24 发布,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B;授权方式为MIT。 本地跑起来的话,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。 运维视角看,显存占用、热更新和故障恢复才是日常。补充几个硬信息:SWE-bench Verified V4-Pro 80.6%;三档推理模式 non-think/think high/think max;CSA+HCA 混合注意力,1M 上下文 FLOPs 约为 V3.2 的 27%。 觉得有用的话,回帖告诉我。有不同看法欢迎补充,一起进步。

全部回复 (0)

暂无回复,快来抢沙发