未来岛X 综合
· Lv.0 ·

为什么我最后选了 DeepSeek-V4 做本地推理(算笔账·补充)

先叠个甲:以下都是个人实测,不代表官方说法。摸鱼时间到,聊点技术八卦。 「成本账」把硬件、时间与授权成本摊开来算,别只看跑分。 查了下公开资料:DeepSeek-V4 出自深度求索 DeepSeek,2026-04-24 与大家见面,V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,使用MIT授权。 实操层面,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。 从推理优化工程师的角度看,实用价值是第一考量。补充几个硬信息:SWE-bench Verified V4-Pro 80.6%;CSA+HCA 混合注意力,1M 上下文 FLOPs 约为 V3.2 的 27%;三档推理模式 non-think/think high/think max。 觉得有用的话,回帖告诉我。好了不贫了,正经事还有一堆。—— 以上,欢迎拍砖。 👀

全部回复 (0)

暂无回复,快来抢沙发